En resumen
- OpenAI dijo el 1 de septiembre que Astra cumple con el nivel "Crítico" de su Marco de Preparación, el primer modelo que la compañía ha clasificado tan alto en ciberseguridad.
- Astra obtuvo un 100% perfecto en ExploitBench y, en una prueba interna más reciente basada en vulnerabilidades del navegador V8 divulgadas este verano, descubrió y encadenó por sí sola dos vulnerabilidades de día cero previamente desconocidas.
- El acceso a las capacidades avanzadas de ciberseguridad de Astra comienza con un pequeño grupo de probadores alfa.
OpenAI dijo el martes que Astra, un modelo no lanzado, ha superado el umbral "crítico" para la capacidad de ciberseguridad según su Marco de Preparación, el primer modelo que la compañía ha puesto en esa categoría.
Eso significa que Astra, que muchos creen que es GPT-6 en lugar de un modelo adicional, puede encontrar fallos de seguridad previamente desconocidos y construir exploits funcionales en muchos sistemas endurecidos sin que una persona lo guíe paso a paso.

"Ahora creemos que Astra cumple con el umbral de capacidad de ciberseguridad Crítico según nuestro Marco de Preparación", escribió OpenAI. "Es el primer modelo que designamos en este nivel y requiere salvaguardas más fuertes durante el desarrollo y antes del lanzamiento."
Bajo el marco, un modelo alcanza el nivel crítico si puede desarrollar de forma independiente exploits de día cero funcionales en muchos sistemas del mundo real endurecidos, o si puede planificar y ejecutar un ciberataque completo contra un objetivo difícil partiendo de nada más que un objetivo de alto nivel. Los modelos anteriores de OpenAI, incluido GPT-5.6 Sol, alcanzaron como máximo el nivel "alto" inferior del marco.
En ExploitBench, un punto de referencia que prueba si un modelo puede convertir vulnerabilidades de software ya conocidas en exploits funcionales y lo califica como una tasa de aprobación directa, Astra alcanzó un 100% perfecto.
Para descartar que las respuestas memorizadas inflaran esa puntuación, OpenAI construyó una segunda prueba utilizando 20 vulnerabilidades de alta gravedad en el motor JavaScript V8 de Google divulgadas entre junio y agosto. Astra superó a GPT-5.6 Sol en las tasas de ejecución de código arbitrario también allí, usando muchos menos tokens de salida, y en el camino encontró y encadenó dos vulnerabilidades de día cero que OpenAI todavía está divulgando a los mantenedores afectados.
GPT-5.6 Sol es actualmente el mejor modelo de OpenAI.
En pruebas prácticas contra un navegador endurecido y un sistema operativo endurecido, Astra construyó una cadena de compromiso completa que salió de la sandbox del navegador y ejecutó comandos en el host solo con abrir un archivo HTML malicioso. También encontró múltiples fallos en el sistema operativo endurecido y los encadenó en una ruta de escalada de privilegios desde una cuenta de usuario ordinaria hasta root.
OpenAI dijo que el modelo rechaza el 91.5% de los intentos de jailbreak cibernético en sus propias pruebas, frente al 59% de GPT-5.6 Sol. El acceso a las capacidades de ciberseguridad más avanzadas de Astra comienza con un pequeño grupo de probadores alfa, y el acceso más amplio se implementará más adelante a través del programa Daybreak Blue de OpenAI para el trabajo de seguridad defensiva.
La divulgación sigue a semanas de nerviosismo en toda la industria. Hace solo unos días, OpenAI pausó el desarrollo de Astra después de que las habilidades cibernéticas y de codificación del modelo avanzaran rápidamente, una advertencia que llegó justo después de un sistema separado no lanzado de OpenAI que encadenó vulnerabilidades para violar Hugging Face mientras manipulaba un punto de referencia de seguridad. OpenAI dice que Astra no tuvo ningún papel en ese incidente.
Los operadores ya habían descontado un rápido cambio. Los mercados de predicción en Myriad rastreados por Decrypt dieron a Astra, internamente vinculada al nombre en clave GPT-6, 72% de probabilidades de un lanzamiento público para el 30 de septiembre incluso después de la pausa de principios de agosto de OpenAI, y OpenAI aún no ha fijado una fecha de lanzamiento público. Esas probabilidades cambiaron al 55% a favor de un lanzamiento para noviembre de 2026.
El momento pone a Astra frente a un nuevo rival. Anthropic lanzó Fable 5.1 y Mythos 5.1 el martes, y Mythos 5.1, al igual que el Mythos 5 anterior, está reservado para organizaciones de ciberseguridad y ciencias de la vida examinadas, no para el público en general.
Decrypt informó en junio que el GPT-5.5-Cyber de OpenAI ya había superado a Mythos 5 en CyberGym, un punto de referencia que ejecuta agentes de IA contra más de 1,500 vulnerabilidades conocidas de proyectos de código abierto reales y los califica según cuántas reproducen correctamente.
Se había rumoreado que ambas compañías estaban preparando nuevos modelos de frontera en el mismo período, y ahora lo han hecho. Fable 5.1 llegó el 1 de septiembre, y OpenAI dice que Astra llegará pronto, con sus herramientas cibernéticas más capaces bloqueadas detrás del acceso alfa primero y Daybreak Blue después.






