Um ano após a chegada do GPT-5, a OpenAI anunciou nesta semana o lançamento do GPT-6 Astra, descrito pela empresa como "o modelo mais inteligente e alinhado do mundo". A nova geração de inteligência artificial começou a ser disponibilizada imediatamente, porém com accesso controlado a grupos selecionados de organizações parceiras.
Em uma reviravolta que chamou atenção do setor tecnológico, a OpenAI confirmou que o Astra foi classificado como um risco crítico de cibersegurança, o nível mais alto de ameaça em qualquer domínio monitorado pela empresa. OFramework de Preparação da companhia acompanha riscos em três áreas: químico-biológico, autoaperfeiçoamento e cibersegurança. Esta é a primeira vez que um modelo da OpenAI recebe a designação de risco crítico em qualquer uma dessas categorias.
Apesar da classificação de risco, a empresa afirmou que implementou salvaguardas robustas para conter possíveis usos maliciosos. Nas avaliações de cibersegurança ExploitBench, o GPT-6 alcançou impressionantes 100 por cento de acerto, enquanto no teste ExploitGym Honeypot registrou zero por cento de falhas, demonstrando capacidades sem precedentes na identificação e exploração de vulnerabilidades em sistemas protegidos.
O modelo estará disponível nos próximos dias para usuários dos planos ChatGPT Plus, Pro, Business e Empresarial, além de via API e AWS. Os valores cobrados pela API são de 10 dólares por milhão de tokens de entrada e 50 dólares por milhão de tokens de saída.
A OpenAI reconhece que o Astra apresenta maior dificuldade de monitoramento em comparação com o GPT-5.6 Sol. Segundo publicação da empresa, o modelo demonstra maior capacidade de controlar sua própria cadeia de raciocínio e menor probabilidade de incluir informações incriminatórias em seus processos internos. Em testes adversários, o sistema conseguiu evadir monitores de segurança quando solicitado a realizar certas tarefas de sabotagem.
Em relação às já conhecidas "alucinações" das inteligências artificiais, a empresa relata avanços significativos. O GPT-6 Astra apresenta substancialmente menos erros factuais do que seu antecessor e menor probabilidade de reproduzir informações falsas relatadas por usuários, especialmente em configurações de baixa latência.
Nos testes de desempenho, o novo modelo obteve resultados expressivos: 97,6 por cento em FrontierMath Nível 4, 96 por cento em GPQA Diamond, 98,5 por cento em ARC-AGI-1 e 64,6 por cento em Terminal-Bench Ciência. A única exceção foi o Humanity's Last Exam com ferramentas, onde marcou 57,2 por cento, ficando abaixo do esperado.
A empresa garante que, apesar dos riscos inerentes, o GPT-6 Astra é significativamente mais seguro em cenários de alto risco do que modelos recentes anteriores, com melhor desempenho em avaliações de segurança relacionadas à dependência emocional, solicitação de autoagressão e respostas inadequadas a menores de idade.
Fonte: Mashable

