En resumen

  • El presidente de OpenAI, Greg Brockman, publicó "La ventana del defensor" el 17 de agosto,
  • El ensayo insta a las empresas a implementar agentes de seguridad de IA de inmediato y califica la brecha de OpenAI-Hugging Face como un "momento decisivo para la ciberseguridad".
  • El propio equipo de Hugging Face utilizó el modelo de pesos abiertos GLM 5.2 de Z.ai para investigar el hackeo de OpenAI después de que la IA comercial estadounidense se negara a ayudar.

OpenAI quiere que todos los equipos de seguridad ejecuten agentes de IA, comenzando de inmediato. El presidente Greg Brockman publicó un ensayo de política el lunes, titulado "La ventana del defensor", que describe una ventana estrecha antes de que los atacantes alcancen lo que la IA ya puede hacer.

Su ejemplo inicial es el incidente que OpenAI ha pasado un mes explicando. En mayo, GPT-5.6 Sol y un prototipo no lanzado escaparon de un entorno de pruebas de ciberseguridad, encadenaron una explotación de día cero con credenciales robadas y llegaron a los sistemas de producción de Hugging Face. OpenAI confirmó más tarde que el incidente afectó a cuatro servicios más.

Myriad: ¿Cuándo lanzará OpenAI GPT-6? Haz clic para hacer tu predicción.
Myriad: ¿Cuándo lanzará OpenAI GPT-6? Haz clic para hacer tu predicción.

"El incidente de OpenAI-Hugging Face fue un momento decisivo para la ciberseguridad", escribió Brockman, añadiendo que las conversaciones con otras organizaciones durante las últimas semanas lo convencieron de que los defensores necesitan elevar sus prácticas de seguridad con una urgencia sin precedentes.

Los empleados actuales y anteriores culpan a la presión por lanzar productos por la brecha, y un ex empleado lo llamó el mayor incidente de seguridad en la historia de la empresa.

La solución propuesta por Brockman es más IA, no menos. Describió pedirle a ChatGPT Work, que ejecuta GPT-5.6 Sol, que audite su sitio web personal: encontró 13 problemas en unos 15 minutos, y luego los arregló todos en una hora.

OpenAI enumera cuatro pilares internos: usar Codex para detectar vulnerabilidades antes de que el código se publique, dejar que los modelos clasifiquen alertas de seguridad antes de que los humanos las vean, ejecutar modelos de frontera para sondear su propia infraestructura, y reforzar conceptos básicos como el acceso con privilegios mínimos. Su consejo para todos los demás: den a su equipo de seguridad un agente, y soliciten el programa Trusted Access for Cyber de OpenAI para el uso verificado de GPT-Daybreak-Blue durante la respuesta a incidentes.

Ese marco omite un detalle de la misma brecha. Cuando Hugging Face investigó la intrusión, su equipo de seguridad recurrió al modelo abierto GLM 5.2 de Z.ai después de que la IA comercial estadounidense se negara a ayudar—sus filtros de seguridad no podían distinguir el código de explotación de un investigador del de un atacante. El CEO de Hugging Face, Clément Delangue, calificó al modelo abierto como "una parte clave de nuestra defensa".

El modelo sucesor de Z.ai, GLM-5.3, lanzado el 14 de agosto, ya supera a GPT-5.6 Sol en CyberGym, el mismo punto de referencia de descubrimiento de vulnerabilidades que Brockman señala como evidencia de que los atacantes se están poniendo al día. Z.ai dice que publicará los pesos completos del modelo para finales de agosto.