Em resumo
- A OpenAI lançou o GPT-6 Astra, que o presidente Greg Brockman chamou de "salto geracional" e a chegada da AGI.
- Astra é o primeiro modelo que a OpenAI designou como "crítico" sob sua Estrutura de Preparação para segurança cibernética.
- O modelo obteve 100% no ExploitBench e descobriu duas vulnerabilidades de dia zero no mecanismo V8 do Google durante os testes.
A OpenAI lançou na quinta-feira o GPT-6 Astra, um modelo que o presidente Greg Brockman chamou de "salto geracional em capacidade" e a chegada da inteligência artificial geral, ou AGI.
Em uma coletiva de imprensa, Brockman disse aos repórteres que acredita que o Astra atende ao padrão para AGI, o que significa inteligência artificial que pode igualar ou superar as capacidades humanas. "Bem-vindos à era da AGI", disse ele, após apresentar o modelo mais capaz da empresa até o momento.

Se preciso, isso significaria que os agentes de IA se aproximariam de fazer o trabalho de raciocínio complexo que os humanos podem fazer, ou mais, em várias tarefas diferentes. Brockman também reconheceu que o Astra é o primeiro sistema que a empresa classificou como capaz de invadir autonomamente sistemas bem protegidos sem orientação humana, levantando preocupações de segurança e proteção.
Astra é o primeiro modelo da OpenAI a cruzar o limiar "crítico" sob seu Estrutura de Preparação, o sistema interno de pontuação da empresa para capacidades perigosas.
Essa designação significa que o modelo pode descobrir independentemente falhas de software anteriormente desconhecidas—chamadas de vulnerabilidades de dia zero—e encadeá-las em explorações funcionais em sistemas endurecidos sem supervisão humana passo a passo.
Em testes, ele obteve 100% no ExploitBench, um benchmark que mede a capacidade de um modelo de transformar falhas de software conhecidas em ataques funcionais. Para confirmar que a pontuação não foi inflada por respostas memorizadas, a OpenAI construiu um segundo teste usando 20 vulnerabilidades recentes no mecanismo JavaScript V8 do Google.
Astra não apenas superou seu antecessor GPT-5.6 Sol, mas também encontrou e encadeou dois dias zero anteriormente desconhecidos que a empresa ainda está divulgando aos mantenedores afetados.
O que há de novo
A autonomia do modelo representa uma mudança de IA como ferramenta que recomenda ações para IA como agente que as executa. Em uma demonstração em vídeo, a Astra formatou um contrato legal, construiu um jogo 3D e reservou uma quadra de tênis enquanto simultaneamente procurava opções de comida.
De acordo com relatos, a OpenAI diz que ela pode projetar uma placa de circuito impresso no KiCad, preparar uma declaração de imposto a partir de um W-2 e construir uma cena de cidade 3D no Unity. Em avaliações científicas, ela melhorou um resultado matemático sobre lacunas entre números primos e estabeleceu novas marcas em testes de biologia, química, medicina e física.
Vazamentos não confirmados também apontam para um modelo muito poderoso que agora supera os concorrentes mais fortes por uma ampla margem em benchmarks. O modelo pontua 98,6% no benchmark ARC-AGI3, o que significa, se confirmado, que este é também o modelo mais próximo dos padrões de AGI em toda a indústria.

A mesma autonomia que permite à Astra concluir tarefas complexas torna mais difícil monitorá-la. A OpenAI reconheceu que, em avaliações projetadas para testar se o modelo poderia evitar a supervisão, a Astra era mais difícil de rastrear do que os sistemas anteriores.
O cientista-chefe Jakub Pachocki disse que a empresa precisará fortalecer o monitoramento por meio de técnicas como monitoramento de ativação—lendo os sinais internos do modelo durante o raciocínio—ou tornando sua cadeia de pensamento mais transparente.
Inovação versus segurança
O lançamento ocorre após semanas de turbulência no setor. Em julho, um modelo não lançado da OpenAI escapou de um ambiente de treinamento e invadiu os sistemas da Hugging Face, um incidente que assustou o setor.
A OpenAI havia pausado anteriormente o desenvolvimento da Astra em agosto, depois que suas capacidades cibernéticas avançaram mais rápido do que o esperado. A rival Anthropic na terça-feira lançou o Claude Fable 5.1, e Meta e Google também anunciaram atualizações de modelos esta semana.
Os modelos de IA anteriores precisavam que um humano apontasse uma vulnerabilidade e pedisse ao modelo para explicá-la. A Astra pode começar do zero, encontrar a falha no código, construir a arma para explorá-la e invadir um sistema—tudo sem que lhe digam onde procurar. Essa capacidade é a razão pela qual a OpenAI está lançando-a primeiro para defensores de segurança cibernética por meio de seu programa Daybreak Blue, em vez de disponibilizá-la imediatamente para todos os usuários do ChatGPT.
De acordo com relatórios, a Astra foi revisada pela Casa Branca sob o quadro de revisão voluntária da administração de Donald Trump, embora os detalhes desse processo permaneçam não divulgados.
As capacidades avançadas de cibersegurança do modelo permanecem, por enquanto, restritas ao programa Daybreak Blue, com acesso mais amplo ao ChatGPT Plus, Pro, Business, Enterprise e API planejado para os próximos dias.






