Início Tecnologia Desenvolvedores Contornam Sistema de Marcas D’Água Invisíveis do Chatbot Claude em Questão de Horas
Tecnologia

Desenvolvedores Contornam Sistema de Marcas D’Água Invisíveis do Chatbot Claude em Questão de Horas

Share
Fonte: Feed: All Latest
Share

Em menos de quatro horas após a empresa Anthropic confirmar que seus modelos Claude passariam a incorporar marcas d'água invisíveis e legíveis por máquinas em qualquer conteúdo gerado por inteligência artificial, o desenvolvedor Guillaume Meyer já havia publicado sua solução para remover essas marcas.

O código criado por Meyer para eliminar as marcas d'água de textos produzidos pelo Claude rapidamente se espalhou pela comunidade de programação. O projeto acumula mais de vinte mil marcações na plataforma GitHub, atraiu mais de uma centena de colaboradores e numerous desenvolvedores já estão integrando a tecnologia em seus próprios projetos.

A Anthropic anunciou a adoção do sistema de marcação para cumprir o Ato de Inteligência Artificial da União Europeia, que entrou em vigor no início deste mês. A regulamentação exige que empresas como a Anthropic e a OpenAI identifiquem conteúdo sintético de áudio, imagem, vídeo ou texto para que máquinas possam detectar sua origem artificial, sob pena de multas de até três por cento do faturamento anual.

Meyer explicou à publicação que alguns desenvolvedores buscam evadir a marcação por discordarem da obrigatoriedade de rotular todo conteúdo gerado por inteligência artificial, enquanto outros, incluindo ele próprio, veem no desafio técnico um atrativo. Escritores freelancers e criadores de conteúdo para redes sociais também entraram em contato solicitando orientação sobre o uso do código.

O desenvolvedor afirmou não ser contra a transparência ou a atribuição de conteúdo, mas considera a marcação d'água uma solução problemática devido a riscos significativos. Ele teme a ocorrência de falsos positivos e a impossibilidade de distinguir entre uso leve ou intenso de inteligência artificial. Como falante nativo de francês, Meyer frequentemente utiliza o Claude e outras ferramentas como o Grammarly para revisar seus textos. Usar a marca d'água como evidência, mesmo sabendo que a própria Anthropic admite que o sistema gera apenas uma probabilidade, pode levar a rejeições injustas de candidatos ou acusações indevidas contra pesquisadores.

A técnica de marcação invisível funciona criando padrões nas escolhas de palavras e frases do Claude, imperceptíveis para leitores humanos, mas detectáveis por máquinas capacitadas para identificá-los. A Anthropic garante que isso não compromete a qualidade das respostas. O método, chamado SynthID, foi desenvolvido pelo Google e está em uso desde 2023. O cientista da computação Scott Aaronson propôs uma abordagem similar durante seu trabalho na OpenAI, mas a empresa nunca a implementou por receio de afastar clientes.

O método de remoção de Meyer emprega um modelo de linguagem que não aplica marcação d'água para gerar múltiplas reescritas, substituindo sinônimos e reorganizando levemente o conteúdo. Wayne Pan, diretor de tecnologia e fundador da startup de inteligência artificial Haimaker, incorporou a ferramenta de código aberto em sua plataforma, compartilhando a mesma insatisfação com a marcação de textos levemente editados.

Outros programadores desenvolveram soluções próprias. O engenheiro de software Erik Hughes criou uma ferramenta em apenas quinze minutos que elimina caracteres invisíveis, reorganiza frases e substitui palavras por sinônimos. Leon Chlon, bolsista visitante da Universidade de Oxford, demonstrou que as marcas podem ser removidas condensando a resposta do Claude, traduzindo-a para um dialeto como o árabe, com semântica muito diferente do inglês, e então traduzindo-a de volta.

A Anthropic reconheceu publicamente que conteúdo altamente editado, parafraseado ou traduzido pode não carregar a marca d'água. Em comunicado, a empresa informou que está desenvolvendo ferramentas de detecção e pretende lançá-las em breve, permitindo que desenvolvedores verifiquem se seus métodos de contorno são realmente eficazes.

Fonte: Feed: All Latest

Share
Artigos relacionados
Tecnologia

Phishing 3.0: A Guerra Cibernética Atual se Trava Entre Agentes Autônomos

Os sistemas de proteção eletrônica que ainda hoje protegem milhões de caixas...

Tecnologia

Falha crítica no plugin Elementor Pro expõe sites WordPress a ataques de execução de código

Pesquisadores de segurança digital revelaram detalhes de uma vulnerabilidade grave encontrada no...

Tecnologia

Samsung realiza novo evento Galaxy no dia 27 de agosto com anúncio de smartphone

A Samsung revelou que realizará um novo evento Galaxy no próximo dia...

Tecnologia

Relativity Networks levanta US$ 22 milhões e fecha contrato de US$ 40 milhões com grande hyperscaler

A empresa americana Relativity Networks anunciou nesta terça-feira a conclusão de uma...

VeloTV 728×90