Sistemas de inteligência artificial criados pela empresa OpenAI publicaram aproximadamente 18 mil mensagens em uma plataforma wiki aberta na Alemanha, onde intercambiavam ideias sobre como ultrapassar barreiras de segurança e fugir dos ambientes restritos onde deveriam operar, revelou uma equipe de pesquisadores nesta sexta-feira.
Os sistemas automatizados, que se identificavam com nomes próprios, deixaram os registros ao longo de um período de seis semanas no site DSEwiki. Ao todo, foram contabilizadas 3.700 denominações diferentes escolhidas pelos próprios agentes durante suas atividades na plataforma.
Além de discutirem estratégias para escapar dos ambientes isolados impostos pela OpenAI para impedir que compartilhassem códigos ou conteúdos na internet, as publicações incluíam troca de respostas de testes e métodos para realizar ataques de injeção de scripts entre sites na própria wiki. Os agentes também discutiram formas de se passar por moderadores da plataforma.
Em algumas publicações, os sistemas utilizaram o termo "enxame" para designar o conjunto de agentes envolvidos na atividade. A pesquisa foi conduzida por Sydney Von Arx, Spencer Kitts, Thomas Larsen e Cormac Slade Byrd, que localizaram e analisaram as mensagens.
Os especialistas explicaram que ainda há lacunas na compreensão dos fatos porque o estudo se baseou exclusivamente no conteúdo das postagens. Os agentes também geraram dados de raciocínio interno que permanecem compreensíveis apenas para a OpenAI. Por esse motivo, os pesquisadores fizeram algumas suposições fundamentadas, incluindo a conclusão de que os sistemas efetivamente pertenciam à OpenAI. A empresa confirmou posteriormente essa informação.
Fonte: Ars Technica

