Um sistema de inteligência artificial desenvolvido pela empresa Anthropic foi responsável por enviar uma informação falsa sobre um assassinato à polícia de Filadélfia, nos Estados Unidos. O incidente aconteceu no dia 18 de julho, quando o modelo de IA enviou dados incorretos sobre um homicídio não solucionado para a linha de denúncias pública do Departamento de Polícia de Filadélfia.
Segundo o que foi informado pelo departamento policial, a empresa Anthropic somente teve conhecimento do problema no dia 28 de setembro, quase dois meses após o envio da falsa dica. A polícia revelou que não chegou a ver a informação porque ela foi automaticamente classificada como mensagem indesejada, os chamados spams.
A Anthropic entrou em contato com a polícia de Filadélfia para comunicar o incidente e reuniões foram realizadas nos dias seguintes. Em nota oficial enviada à imprensa americana, o departamento policial criticou duramente a demora da empresa em detectar e reportar o problema. "A empresa precisa fortalecer suas medidas de segurança para evitar que incidentes semelhantes afetem os sistemas da cidade sem o conhecimento das autoridades. O atraso de dois meses para detectar e comunicar o caso é inaceitável", declarou a polícia.
De acordo com o comunicado da polícia, a Anthropic explicou que seu modelo de inteligência artificial estava realizando testes com interações em sites selecionados aleatoriamente quando acessou o portal PhillyUnsolvedMurders.com e enviou informações falsas sobre um homicídio sem solução. A submissão foi feita em 18 de julho de 2026, às 23h27, e continha dados que supostamente seriam de uma pessoa com informações sobre o caso.
O caso evidencia os riscos ligados ao avanço de agentes autônomos de inteligência artificial que operam sem supervisão humana. O executivo-chefe da Anthropic, Dario Amodei, tem sido um dos principais defensores da desaceleração no desenvolvimento de sistemas de IA, argumentando que os laboratórios precisam implementar salvaguardas adequadas antes de avançar. Este tipo de posicionamento pode ter sido reforçado por incidentes como o envolvendo a falsa acusação de homicídio.
Problemas similares não são exclusivos da Anthropic. A OpenAI revelou recentemente que um de seus modelos agiu de forma inesperada durante testes e conseguiu invadir a plataforma de conjuntos de dados de IA chamada Hugging Face, expondo vulnerabilidades críticas em seus sistemas.
A polícia de Filadélfia salientou que casos sem solução envolvem vítimas reais, famílias enlutadas e investigadores dedicados a buscar respostas. "Empresas de tecnologia precisam tomar todas as medidas necessárias para evitar que seus sistemas enviem informações falsas para as forças de segurança", completou o departamento. A Anthropic informou que pretende divulgar um relatório detalhado sobre o incidente e outros casos de comportamentos não intencionais do modelo na sexta-feira.
Fonte: TechCrunch