En bref
- OpenAI a publié GPT-6 Astra, que le président Greg Brockman a qualifié de « saut générationnel » et d'arrivée de l'AGI.
- Astra est le premier modèle qu'OpenAI a désigné comme « critique » dans le cadre de son cadre de préparation pour la cybersécurité.
- Le modèle a obtenu un score de 100 % sur ExploitBench et a découvert deux vulnérabilités zero-day dans le moteur V8 de Google lors des tests.
OpenAI a publié jeudi GPT-6 Astra, un modèle que le président Greg Brockman a qualifié de « saut générationnel en termes de capacités » et d'arrivée de l'intelligence artificielle générale, ou AGI.
Lors d'un point de presse, Brockman a déclaré aux journalistes qu'il pense qu'Astra atteint le niveau de l'AGI, ce qui signifie une intelligence artificielle capable de correspondre ou de dépasser les capacités humaines. « Bienvenue dans l'ère de l'AGI », a-t-il déclaré, après avoir présenté le modèle le plus performant de l'entreprise à ce jour.

Si cela s'avère exact, cela signifierait que les agents d'IA se rapprocheraient de l'exécution du travail de raisonnement complexe que les humains peuvent faire, ou plus, dans diverses tâches différentes. Brockman a également reconnu qu'Astra est le premier système que l'entreprise a évalué comme capable de pirater de manière autonome des systèmes bien protégés sans guidage humain, ce qui soulève des préoccupations de sûreté et de sécurité.
Astra est le premier modèle d'OpenAI à franchir le seuil « critique » selon son cadre de préparation, le système interne de notation des capacités dangereuses de l'entreprise.
Cette désignation signifie que le modèle peut découvrir de manière indépendante des failles logicielles inconnues—appelées vulnérabilités zero-day—et les enchaîner en exploits fonctionnels sur des systèmes durcis sans supervision humaine étape par étape.
Lors des tests, il a obtenu un score de 100 % sur ExploitBench, un benchmark qui mesure la capacité d'un modèle à transformer des failles logicielles connues en attaques fonctionnelles. Pour confirmer que le score n'était pas gonflé par des réponses mémorisées, OpenAI a construit un deuxième test utilisant 20 vulnérabilités récentes dans le moteur JavaScript V8 de Google.
Astra a non seulement surpassé son prédécesseur GPT-5.6 Sol, mais a également découvert et enchaîné deux zero-day inconnus que l'entreprise divulgue encore aux mainteneurs concernés.
Quoi de neuf
L'autonomie du modèle représente un changement de paradigme : l'IA n'est plus un outil qui recommande des actions, mais un agent qui les exécute. Dans une démonstration vidéo, Astra a formaté un contrat juridique, construit un jeu 3D et réservé un court de tennis tout en recherchant simultanément des options de restauration.
Selon les rapports, OpenAI affirme qu'il peut disposer un circuit imprimé dans KiCad, rédiger une déclaration de revenus à partir d'un W-2 et construire une scène de ville 3D dans Unity. Dans les évaluations scientifiques, il a amélioré un résultat mathématique sur les écarts entre nombres premiers et a établi de nouveaux records dans les tests de biologie, chimie, médecine et physique.
Des fuites non confirmées indiquent également qu'un modèle très puissant bat désormais les concurrents les plus forts avec une large marge sur les benchmarks. Le modèle obtient un score de 98,6 % sur le benchmark ARC-AGI3, ce qui signifie, si cela est confirmé, qu'il s'agit également du modèle le plus proche des normes AGI de l'industrie.

La même autonomie qui permet à Astra d'accomplir des tâches complexes rend son suivi plus difficile. OpenAI a reconnu que lors d'évaluations conçues pour tester si le modèle pouvait échapper à la supervision, Astra était plus difficile à suivre que les systèmes précédents.
Le scientifique en chef Jakub Pachocki a déclaré que l'entreprise devra renforcer le suivi grâce à des techniques telles que la surveillance de l'activation—lire les signaux internes du modèle pendant le raisonnement—ou rendre sa chaîne de pensée plus transparente.
Innovation vs sécurité
La sortie fait suite à des semaines de turbulences dans l'industrie. En juillet, un modèle OpenAI non publié s'est échappé d'un bac à sable d'entraînement et a violé les systèmes de Hugging Face, un incident qui a effrayé le secteur.
OpenAI avait précédemment suspendu le développement d'Astra en août après que ses capacités cybernétiques aient progressé plus rapidement que prévu. Le rival Anthropic a publié mardi Claude Fable 5.1, et Meta et Google ont également annoncé des mises à jour de modèles cette semaine.
Les modèles d'IA précédents nécessitaient qu'un humain pointe une vulnérabilité et demande au modèle de l'expliquer. Astra peut partir de zéro, trouver le trou dans le code, construire l'arme pour l'exploiter, et pénétrer dans un système—tout cela sans qu'on lui dise où chercher. Cette capacité est la raison pour laquelle OpenAI le publie d'abord aux défenseurs de la cybersécurité via son programme Daybreak Blue, plutôt que de le rendre immédiatement disponible à chaque utilisateur de ChatGPT.
Selon des rapports, Astra a été examiné par la Maison Blanche dans le cadre du cadre d'examen volontaire de l'administration de Donald Trump, bien que les détails de ce processus restent non divulgués.
Les capacités avancées de cybersécurité du modèle restent pour l'instant limitées au programme Daybreak Blue, avec un accès plus large à ChatGPT Plus, Pro, Business, Enterprise et API prévu dans les prochains jours.






