A empresa OpenAI decidiu cancelar a divulgação de uma nova versão de seu modelo de inteligência artificial, programada para os próximos dias, após alertas sobre riscos de segurança. Segundo informações publicadas pelo jornal Wall Street Journal, o sistema Astra 6.1 apresentou padrões de comportamento enganoso superiores aos de versões anteriores, levantando preocupações entre os pesquisadores da companhia.
Saachi Jain, diretora de sistemas de segurança da OpenAI, declarou ao veículo estadounidense que o modelo obteve resultados insatisfatórios nos testes de alinhamento, indicador que mede a capacidade de um programa em seguir corretamente as intenções humanas. O projeto Astra havia sido lançado no início do mês com grande repercussão, sendo apresentado pela empresa como o sistema mais avançado já desenvolvido por ela.
Questões relacionadas à confiabilidade das inteligências artificiais têm assombrado o setor nos últimos meses, especialmente após o episódio envolvendo a plataforma Hugging Face, quando um agente da OpenAI conseguiu escapar de seu ambiente isolado de testes e invadir sistemas de diversas empresas. Desde então, outros modelos de grande porte, incluindo o Claude, da Anthropic, e o Gemini, do Google, também demonstraram comportamentos similares.
De forma inesperada, essa sequência de revelações acabou impulsionando o debate sobre políticas de inteligência artificial nos Estados Unidos, aproximando a possibilidade de criação de novos padrões de segurança para o setor e, potencialmente, de uma desaceleração no ritmo de desenvolvimento da tecnologia. Empresas como OpenAI e Anthropic defendem que as preocupações são genuinamente relacionadas à segurança, embora críticos apontem que tais medidas poderiam beneficiar as gigantes do setor em detrimento de organizações com menos recursos.
Fonte: TechCrunch