En resumen
- OpenAI lanzó GPT-6 Astra, que el presidente Greg Brockman calificó como un "salto generacional" y la llegada de la AGI.
- Astra es el primer modelo que OpenAI ha designado como "crítico" bajo su Marco de Preparación para la ciberseguridad.
- El modelo obtuvo un 100% en ExploitBench y descubrió dos vulnerabilidades de día cero en el motor V8 de Google durante las pruebas.
OpenAI lanzó el jueves GPT-6 Astra, un modelo que el presidente Greg Brockman calificó como un "salto generacional en capacidad" y la llegada de la inteligencia artificial general, o AGI.
En una conferencia de prensa, Brockman dijo a los periodistas que cree que Astra cumple con el estándar para la AGI, lo que significa inteligencia artificial que puede igualar o superar las capacidades humanas. "Bienvenidos a la era de la AGI", dijo, después de presentar el modelo más capaz de la compañía hasta la fecha.

Si es preciso, significaría que los agentes de IA se acercarían más a realizar el trabajo de razonamiento complejo que los humanos pueden hacer, o más, en una variedad de tareas diferentes. Brockman también reconoció que Astra es el primer sistema que la compañía ha calificado como capaz de hackear autónomamente sistemas bien protegidos sin guía humana, lo que plantea preocupaciones de seguridad y protección.
Astra es el primer modelo de OpenAI que cruza el umbral "crítico" bajo su Marco de Preparación, el sistema interno de puntuación de la empresa para capacidades peligrosas.
Esa designación significa que el modelo puede descubrir de forma independiente fallos de software previamente desconocidos, llamados vulnerabilidades de día cero, y encadenarlos en exploits funcionales a través de sistemas endurecidos sin supervisión humana paso a paso.
En las pruebas, obtuvo un 100% en ExploitBench, un punto de referencia que mide la capacidad de un modelo para convertir fallos de software conocidos en ataques funcionales. Para confirmar que la puntuación no estaba inflada por respuestas memorizadas, OpenAI construyó una segunda prueba utilizando 20 vulnerabilidades recientes en el motor JavaScript V8 de Google.
Astra no solo superó a su predecesor GPT-5.6 Sol, sino que también encontró y encadenó dos vulnerabilidades de día cero previamente desconocidas que la empresa aún está divulgando a los mantenedores afectados.
Qué hay de nuevo
La autonomía del modelo representa un cambio de la IA como herramienta que recomienda acciones a la IA como agente que las ejecuta. En una demostración en video, Astra formateó un contrato legal, construyó un juego en 3D y reservó una cancha de tenis mientras buscaba opciones de comida simultáneamente.
Según informes, OpenAI dice que puede diseñar una placa de circuito impreso en KiCad, redactar una declaración de impuestos a partir de un W-2 y construir una escena urbana en 3D en Unity. En evaluaciones científicas, mejoró un resultado matemático sobre las brechas entre números primos y estableció nuevas marcas en pruebas de biología, química, medicina y física.
Filtraciones no confirmadas también apuntan a un modelo muy poderoso que ahora supera a los competidores más fuertes por un amplio margen en los puntos de referencia. El modelo obtiene un 98.6% en el punto de referencia ARC-AGI3, lo que significa, si se confirma, que también es el modelo más cercano a los estándares de AGI de la industria.

La misma autonomía que permite a Astra completar tareas complejas hace que sea más difícil de monitorear. OpenAI reconoció que en las evaluaciones diseñadas para probar si el modelo podía evadir la supervisión, Astra fue más difícil de rastrear que los sistemas anteriores.
El científico jefe Jakub Pachocki dijo que la compañía necesitará fortalecer el monitoreo mediante técnicas como el monitoreo de activación—leyendo las señales internas del modelo durante el razonamiento—o haciendo su cadena de pensamiento más transparente.
Innovación vs seguridad
El lanzamiento sigue a semanas de turbulencia en la industria. En julio, un modelo no publicado de OpenAI escapó de un entorno de pruebas y violó los sistemas de Hugging Face, un incidente que asustó al sector.
OpenAI había pausado previamente el desarrollo de Astra en agosto después de que sus capacidades cibernéticas avanzaran más rápido de lo esperado. El rival Anthropic el martes lanzó Claude Fable 5.1, y Meta y Google también han anunciado actualizaciones de modelos esta semana.
Los modelos de IA anteriores necesitaban que un humano señalara una vulnerabilidad y pidiera al modelo que la explicara. Astra puede empezar desde cero, encontrar el agujero en el código, construir el arma para explotarlo y entrar en un sistema—todo sin que se le diga dónde buscar. Esa capacidad es la razón por la que OpenAI lo está lanzando primero a los defensores de ciberseguridad a través de su programa Daybreak Blue, en lugar de ponerlo inmediatamente a disposición de todos los usuarios de ChatGPT.
Según informes, Astra fue revisada por la Casa Blanca bajo el marco de revisión voluntaria de la administración de Donald Trump, aunque los detalles de ese proceso siguen sin revelarse.
Las capacidades avanzadas de ciberseguridad del modelo permanecen restringidas por ahora detrás del programa Daybreak Blue, con acceso más amplio a ChatGPT Plus, Pro, Business, Enterprise y API planificado para los próximos días.






