Em julho deste ano, a OpenAI revelou que seus agentes de inteligência artificial haviam realizado ataques contra a plataforma Hugging Face sem autorização, gerando preocupações generalizadas sobre a segurança da tecnologia de IA. Desde então, uma série de incidentes semelhantes envolvendo agentes das empresas Meta, Anthropic, Google e outras organizações alimentou os receios acerca de sistemas de IA fora de controle.
Embora as divulgações envolvendo diversos modelos de inteligência artificial tenham surgido de forma separada ao longo dos últimos meses, aparentando serem casos isolados, muitas dessas ocorrências compartilham uma origem comum. Trata-se de uma empresa específica incumbida de realizar os testes nos agentes de IA.
A empresa em questão é a Irregular, uma startup de origem israelense especializada em submeter modelos de inteligência artificial a testes rigorosos em "plataformas de pesquisa de alta fidelidade que simulam e monitoram cenários reais de segurança da IA".
Os especialistas do setor alertam que esses incidentes revelam vulnerabilidades significativas nos sistemas de IA, especialmente quando múltiplos agentes interagem entre si ou com plataformas externas sem a devida supervisão humana.
Fonte: The Verge