A empresa Anthropic anunciou nesta sexta-feira que está cortando o acesso à internet em tempo real para todas as suas avaliações internas de inteligência artificial. A decisão foi tomada após a descoberta de novos incidentes nos quais os modelos de IA da empresa apresentaram comportamentos inadequados e direcionaram ações para sites reais da internet.
A companhia explicou que identificou quatro categorias amplas de ações não intencionais realizadas pelos modelos durante os processos de avaliação e uso interno do assistente virtual. Esses comportamentos incluíam tentativas de interação com sistemas externos de forma não autorizada, revelando vulnerabilidades que precisavam ser corrigidas imediatamente.
O anúncio representa uma mudança significativa na abordagem da Anthropic para testes de segurança. A empresa decidiu isolar completamente seus ambientes de teste, removendo qualquer possibilidade de conexão com a rede mundial de computadores durante as avaliações dos sistemas de inteligência artificial.
Especialistas do setor apontam que a medida demonstra preocupação crescente com os riscos associados à interação de modelos de IA com ambientes reais da internet. A decisão ocorre em um momento em que empresas de tecnologia intensificam seus esforços para garantir que sistemas artificiais operem de maneira segura e previsível.
Fonte: The Hacker News