Em resumo

  • A OpenAI disse em 1º de setembro que a Astra atende ao nível "Crítico" de sua Estrutura de Preparação, o primeiro modelo que a empresa já classificou tão alto para segurança cibernética.
  • A Astra obteve uma pontuação perfeita de 100% no ExploitBench e, em um teste interno mais recente construído a partir de vulnerabilidades do navegador V8 divulgadas neste verão, descobriu e encadeou sozinha dois zero-days anteriormente desconhecidos.
  • O acesso aos recursos avançados de segurança cibernética da Astra começa com um pequeno grupo de testadores alfa.

A OpenAI disse na terça-feira que a Astra, um modelo não lançado, ultrapassou o limite "crítico" para capacidade de segurança cibernética sob sua Estrutura de Preparação, o primeiro modelo que a empresa já colocou nessa categoria.

Isso significa que a Astra, que muitos acreditam ser o GPT-6 em vez de um modelo adicional, pode encontrar falhas de segurança anteriormente desconhecidas e construir explorações funcionais em muitos sistemas endurecidos sem que uma pessoa a guie passo a passo.

Myriad: Quando a OpenAI lançará o GPT-6? Clique para fazer sua previsão.
Myriad: Quando a OpenAI lançará o GPT-6? Clique para fazer sua previsão.

"Agora acreditamos que a Astra atende ao limite de capacidade de segurança cibernética Crítica sob nossa Estrutura de Preparação", escreveu a OpenAI. "É o primeiro modelo que designamos neste nível e requer salvaguardas mais fortes durante o desenvolvimento e antes do lançamento."

Sob a estrutura, um modelo atinge o nível crítico se puder desenvolver de forma independente explorações de dia zero funcionais em muitos sistemas reais endurecidos, ou se puder planejar e executar um ataque cibernético completo contra um alvo difícil partindo apenas de um objetivo de alto nível. Modelos anteriores da OpenAI, incluindo o GPT-5.6 Sol, atingiram no máximo o nível inferior "alto" da estrutura.

No ExploitBench, um benchmark que testa se um modelo pode transformar vulnerabilidades de software já conhecidas em explorações funcionais e o pontua como uma taxa de aprovação direta, a Astra atingiu 100% perfeito.

Para descartar que respostas memorizadas inflacionassem essa pontuação, a OpenAI construiu um segundo teste usando 20 vulnerabilidades de alta gravidade no mecanismo JavaScript V8 do Google divulgadas entre junho e agosto. A Astra superou o GPT-5.6 Sol nas taxas de execução arbitrária de código também, usando muito menos tokens de saída, e ao longo do caminho encontrou e encadeou duas vulnerabilidades de dia zero que a OpenAI ainda está divulgando aos mantenedores afetados.

O GPT-5.6 Sol é atualmente o melhor modelo da OpenAI.

Em testes práticos contra um navegador endurecido e um sistema operacional endurecido, a Astra construiu uma cadeia de comprometimento completa que saiu do sandbox do navegador e executou comandos no host apenas abrindo um arquivo HTML malicioso. Ela também encontrou múltiplas falhas no SO endurecido e as encadeou em um caminho de escalonamento de privilégios de uma conta de usuário comum até a raiz.

A OpenAI disse que o modelo recusa 91,5% das tentativas de jailbreak cibernético em seus próprios testes, acima dos 59% do GPT-5.6 Sol. O acesso aos recursos de segurança cibernética mais avançados da Astra começa com um pequeno grupo de testadores alfa, com acesso mais amplo sendo lançado posteriormente por meio do programa Daybreak Blue da OpenAI para trabalho de segurança defensiva.

A divulgação segue semanas de nervosismo em toda a indústria. Há apenas alguns dias, a OpenAI pausou o desenvolvimento da Astra depois que as habilidades cibernéticas e de codificação do modelo avançaram rapidamente, um aviso que veio logo após um sistema separado e não lançado da OpenAI que encadeou vulnerabilidades para violar o Hugging Face enquanto manipulava um benchmark de segurança. A OpenAI diz que a Astra não teve nenhum papel nesse incidente.

Os traders já haviam precificado uma rápida reviravolta. Os mercados de previsão na Myriad rastreados pelo Decrypt deram à Astra, internamente ligada ao codinome GPT-6, 72% de probabilidade de um lançamento público até 30 de setembro, mesmo após a pausa da OpenAI no início de agosto, e a OpenAI ainda não definiu uma data de lançamento público. Essas probabilidades mudaram para 55% a favor de um lançamento até novembro de 2026.

O momento coloca a Astra contra um novo rival. A Anthropic lançou o Fable 5.1 e o Mythos 5.1 na terça-feira, e o Mythos 5.1, como o Mythos 5 anterior, é reservado para organizações de segurança cibernética e ciências da vida avaliadas, em vez do público em geral.

Decrypt relatou em junho que o GPT-5.5-Cyber da OpenAI já havia superado o Mythos 5 no CyberGym, um benchmark que executa agentes de IA contra mais de 1.500 vulnerabilidades conhecidas de projetos de código aberto reais e os pontua com base em quantas eles reproduzem corretamente.

Ambas as empresas eram rumores de estarem preparando novos modelos de fronteira na mesma janela de tempo, e agora eles têm. Fable 5.1 chegou em 1º de setembro, e a OpenAI diz que Astra está chegando em breve, com suas ferramentas cibernéticas mais capazes bloqueadas atrás do acesso alfa primeiro e Daybreak Blue depois.