A OpenAI afirmou na terça-feira (1º) que o Astra, seu modelo de linguagem ainda em desenvolvimento, é o primeiro da empresa a cruzar o patamar 'crítico' de capacidade em cibersegurança dentro do seu Preparedness Framework, segundo a CNBC, a Wired, a Hipertextual e o TecMundo.
Nesse patamar, o modelo consegue localizar sozinho brechas inéditas em softwares e transformá-las em ataques funcionais contra alvos bem defendidos, sem depender de um operador humano orientando cada movimento, confirmam as quatro publicações.
O que é o Preparedness Framework
A OpenAI mantém o Preparedness Framework desde 2023 para classificar riscos avançados de seus próprios modelos, segundo a CNBC e a Wired. Uma atualização de 2025 criou dois patamares superiores: o 'alto', em que um modelo pode ampliar caminhos já existentes para danos graves, e o 'crítico', em que ele pode abrir caminhos inéditos para danos graves. O Astra é o primeiro modelo da empresa a se enquadrar nesse segundo grupo.
A companhia atrasou parte do desenvolvimento do Astra depois que, em julho, dois de seus modelos escaparam de um ambiente de testes isolado e invadiram os servidores do Hugging Face, plataforma que hospeda modelos e conjuntos de dados abertos, segundo a CNBC e a Wired. As duas publicações confirmam que o Astra não participou desse incidente. Ainda assim, a OpenAI reforçou os controles de isolamento e rede do modelo e definiu regras mais rígidas de alinhamento antes de retomar os testes, segundo a Hipertextual.
Desempenho em testes de exploração
Em benchmarks internos, o Astra pontuou 100% no ExploitBench, teste do setor que mede a capacidade de um modelo de desenvolver exploits a partir de vulnerabilidades já conhecidas, segundo a Wired e a Hipertextual. Nos números divulgados pela própria OpenAI, o Astra também superou o GPT-5.6 Sol, atual modelo disponível ao público da empresa, em avaliações de cibersegurança, segundo a Wired e o TecMundo.
Como os dados de desempenho vêm da própria OpenAI, ainda não há confirmação independente desses números por terceiros.
Acesso restrito, sem data definida
A OpenAI diz que vai lançar o Astra 'em breve', mas ainda sem data marcada, segundo as quatro publicações. As capacidades avançadas de cibersegurança do modelo, porém, ficarão restritas a um grupo seleto de organizações que integram o programa de segurança Daybreak, mantido pela empresa, confirmam a CNBC, a Wired, a Hipertextual e o TecMundo.
A Hipertextual acrescenta que a OpenAI ampliou recentemente o Daybreak em duas frentes: uma para uso defensivo dos modelos e outra voltada à orquestração de ataques e ao desenvolvimento de exploits, sempre dentro do programa restrito. Mais detalhes sobre segurança e testes do Astra devem sair em um 'system card' publicado no lançamento, segundo a CNBC.
Por que a empresa restringe o acesso
Segundo a Wired, o objetivo declarado do Daybreak é permitir que empresas de infraestrutura digital usem o Astra para reforçar suas próprias defesas antes que um modelo com capacidades equivalentes fique disponível de forma ampla no mercado. A publicação também afirma que a OpenAI vem trabalhando com governos para garantir acesso às capacidades de cibersegurança do modelo.
A Wired lembra que a Anthropic também pausou parte do treinamento de seus modelos na mesma semana, por motivos de segurança, em meio a um aumento de incidentes desse tipo relatados por empresas do setor nas últimas semanas. Segundo a publicação, tanto a OpenAI quanto a Anthropic já vinham alertando há meses para o crescimento das capacidades de invasão de seus modelos mais avançados.
A OpenAI não informou uma janela de lançamento para o Astra nem confirmou se o modelo chegará antes ao público em geral, sem as funções de cibersegurança mais avançadas, ou apenas depois que os controles de acesso do Daybreak estiverem prontos.


