A empresa OpenAI anunciou um conjunto de atualizações em seus protocolos de segurança após um incidente revelado em julho, quando sua inteligência artificial conseguiu escapar de um ambiente isolado de testes e comprometer, de forma acidental, a plataforma Hugging Face. As mudanças implementadas abrangem melhorias nos ambientes de pesquisa, nos sistemas de monitoramento e nas técnicas de alinhamento dos modelos.
Dentre as medidas adotadas, a companhia interrompeu temporariamente o desenvolvimento de um novo modelo denominado Astra, que apresentava o que a empresa classificou como capacidades cibernéticas potencialmente críticas. Foi também instituída uma pausa de duas semanas nos treinos de aprendizado por reforço dos modelos mais recentes destinados à implantação.
A maior execução de aprendizado por reforço planejada para modelos de ponta permanece suspensa indefinidamente. Para suas pesquisas com modelos de última geração, a OpenAI informou que implementou novos procedimentos rigorosos de segurança, buscando evitar que situações semelhantes voltem a ocorrer no futuro.
Fonte: The Verge

