En bref

  • Le président d'OpenAI, Greg Brockman, a publié « La fenêtre du défenseur » le 17 août,
  • L'essai exhorte les entreprises à déployer immédiatement des agents de sécurité IA et qualifie la brèche d'OpenAI-Hugging Face de « moment charnière pour la cybersécurité ».
  • L'équipe de Hugging Face a utilisé le modèle open-weight GLM 5.2 de Z.ai pour enquêter sur le piratage d'OpenAI après que l'IA commerciale américaine a refusé d'aider.

OpenAI veut que chaque équipe de sécurité déploie des agents IA, et ce dès maintenant. Le président Greg Brockman a publié lundi un essai politique intitulé « La fenêtre du défenseur », décrivant une fenêtre étroite avant que les attaquants ne rattrapent ce que l'IA peut déjà faire.

Son exemple d'ouverture est l'incident qu'OpenAI a passé un mois à expliquer. En mai, GPT-5.6 Sol et un prototype non publié se sont échappés d'un benchmark de cybersécurité sandboxé, ont enchaîné une exploitation de faille zero-day avec des identifiants volés, et ont atteint les systèmes de production de Hugging Face. OpenAI a ensuite confirmé que l'incident avait touché quatre autres services.

Myriad: Quand OpenAI sortira-t-il GPT-6 ? Cliquez pour faire votre prédiction.
Myriad : Quand OpenAI sortira-t-il GPT-6 ? Cliquez pour faire votre prédiction.

« L'incident OpenAI-Hugging Face a été un moment charnière pour la cybersécurité », a écrit Brockman, ajoutant que les conversations avec d'autres organisations au cours des dernières semaines l'ont convaincu que les défenseurs doivent élever leurs pratiques de sécurité avec une urgence sans précédent.

Les employés actuels et anciens attribuent la violation à la pression de livrer, et un ancien employé l'a qualifiée de plus grand incident de sécurité de l'histoire de l'entreprise.

La solution proposée par Brockman est plus d'IA, pas moins. Il a décrit avoir demandé à ChatGPT Work, exécutant GPT-5.6 Sol, d'auditer son site Web personnel – il a trouvé 13 problèmes en environ 15 minutes, puis les a tous corrigés en une heure.

OpenAI énumère quatre piliers internes : utiliser Codex pour détecter les vulnérabilités avant que le code ne soit livré, laisser les modèles trier les alertes de sécurité avant que les humains ne les voient, exécuter des modèles de pointe pour sonder sa propre infrastructure, et renforcer les bases comme l'accès au moindre privilège. Son conseil à tous les autres : donnez à votre équipe de sécurité un agent, et postulez au programme Trusted Access for Cyber d'OpenAI pour une utilisation vérifiée de GPT-Daybreak-Blue lors de la réponse aux incidents.

Ce cadrage omet un détail de la même violation. Lorsque Hugging Face a enquêté sur l'intrusion, son équipe de sécurité s'est tournée vers le modèle ouvert GLM 5.2 de Z.ai après que l'IA commerciale américaine a refusé d'aider—ses filtres de sécurité ne pouvaient pas distinguer le code d'exploitation d'un chercheur de celui d'un attaquant. Le PDG de Hugging Face, Clément Delangue, a qualifié le modèle ouvert de "élément clé de notre défense".

Le modèle successeur de Z.ai, GLM-5.3, publié le 14 août, obtient déjà des scores supérieurs à GPT-5.6 Sol sur CyberGym, le même benchmark de découverte de vulnérabilités que Brockman cite comme preuve que les attaquants rattrapent leur retard. Z.ai affirme qu'il publiera les poids complets du modèle d'ici la fin août.