A OpenAI anunciou nesta segunda-feira que começará a inserir marca d'água invisível nos textos gerados pelo ChatGPT e pelo Codex dentro da União Europeia. A medida visa cumprir as regras de transparência da Lei de Inteligência Artificial europeia, que entraram em vigor no dia 2 de agosto.
De acordo com a empresa, a tecnologia será implementada ao longo das próximas semanas para usuários elegíveis do ChatGPT e do Codex em todos os planos, porém exclusivamente na região europeia. Desenvolvedores que utilizam a interface de programação da OpenAI em qualquer lugar do mundo poderão ativar a funcionalidade para modelos específicos a partir de hoje, sendo que a opção vem desativada por padrão. A companhia explicou que não tornará a marcação de texto uma configuração global no lançamento.
A marca d'água não consiste em um símbolo visível, mas sim em uma técnica que molda sutilmente as escolhas de palavras do modelo, criando um padrão imperceptível ao leitor humano, mas detectável por sistemas especializados. Por estar inserida nas próprias palavras, o padrão permanece quando o texto é copiado e colado. A empresa garantiu que o recurso não identifica o usuário responsável pela solicitação e que não houve alteração significativa no desempenho dos modelos com a ativação da marcação.
A OpenAI publicou também um relatório técnico sobre o método, denominado textGrain, em parceria com pesquisadores da Universidade da Pensilvânia e da Universidade de Yale. O documento demonstra, por exemplo, como uma chave secreta pode classificar as previsões de próxima palavra para completar uma frase. A combinação de centenas dessas manipulações permite que um detector identifique conteúdo gerado por inteligência artificial usando apenas o texto e a chave correspondente.
Testes realizados pela empresa indicaram que a marca d'água pode ser removida por meio de edições. Em um dos experimentos, substituir 10% das palavras por sinônimos reduziu a taxa de detecção de aproximadamente 92% para 66%. A companhia também informou que passagens curtas, respostas matemáticas e textos traduzidos apresentam maior dificuldade de identificação.
A empresa esclareceu que o acesso inicial aos detectores será concedido apenas a pesquisadores aprovados e organizações especializadas, que poderão ajudar a avaliar a confiabilidade e os usos responsáveis da tecnologia. A OpenAI alertou ainda que a ausência de marca d'água não constitui prova de autoria humana, já que o texto pode ser muito curto, ter sido bastante editado ou ter sido produzido por um sistema de inteligência artificial de outra empresa.
O anúncio ocorre dois meses após a Anthropic informar que implementaria marca d'água nos textos gerados pelo Claude em âmbito mundial. A decisão da Anthropic gerou controvérsia entre alguns usuários, que argumentaram fornecer as instruções, o contexto e as decisões, enquanto o Claude seria apenas uma ferramenta.
Segundo relatos do Wall Street Journal em 2024, a OpenAI havia desenvolvido anteriormente um sistema de marcação de texto, mas adiou o lançamento parcialmente por preocupações de que usuários migressem para concorrentes que não utilizavam a tecnologia. A Anthropic, Google, Meta, Microsoft e OpenAI estão entre as empresas que se comprometeram a seguir o código de práticas da União Europeia sobre conteúdo gerado por inteligência artificial.
Fonte: TechCrunch