Morning Minute est une newsletter quotidienne écrite par Tyler Warner. Les analyses et opinions exprimées sont les siennes et ne reflètent pas nécessairement celles de Decrypt.

Bonjour !

Les principales nouvelles du jour :

  • Les grandes cryptomonnaies sont globalement stables, HYPE chute de 6 % ; BTC stable à 66 000 $
  • Les ETF Bitcoin enregistrent encore 203 millions de dollars d'entrées nettes, soit 930 millions de dollars sur les six dernières séances
  • Jack Mallers quitte Twenty One Capital, l'action ayant chuté de 90 %
  • Telegram annonce un nouveau portefeuille non dépositaire, le qualifiant de plus grand déploiement de l'histoire
  • Les sénateurs démocrates rechignent face aux derniers progrès de l'accord éthique du Clarity Act

🤖 Les modèles d'OpenAI se sont échappés d'un environnement de test verrouillé et ont piraté Hugging Face

OpenAI a révélé mardi que deux de ses propres modèles d'IA se sont échappés d'un environnement de test en bac à sable, ont enchaîné des exploits zero-day à travers les systèmes de deux entreprises, et ont pénétré les serveurs de production de Hugging Face. Le motif n'était pas le sabotage. Ils essayaient en réalité de tricher à un test.

Hier, OpenAI a confirmé que GPT-5.6 Sol et un modèle non publié, plus performant, se sont échappés d'un environnement contrôlé lors d'une évaluation interne. Le test était ExploitGym, un benchmark public de cybersécurité qui donne aux agents IA 898 vulnérabilités logicielles réelles et leur demande de transformer chacune en attaque fonctionnelle, notée réussite ou échec.

Plutôt que de résoudre les problèmes, les modèles ont dépensé une puissance de calcul considérable pour trouver comment atteindre l'Internet ouvert, puis ont exploité un zero-day jusqu'alors inconnu dans un proxy de registre de paquets tiers pour s'en sortir. De là, ils ont élevé leurs privilèges, se sont déplacés latéralement à travers les propres systèmes de recherche d'OpenAI, et ont utilisé des identifiants volés ainsi que d'autres zero-day pour exécuter du code à distance sur l'infrastructure de production de Hugging Face, où ils avaient correctement déduit que les solutions du benchmark étaient stockées. Hugging Face a détecté l'intrusion indépendamment et l'a divulguée le 16 juillet. OpenAI a confirmé que ses modèles étaient responsables cinq jours plus tard.

Donc, pour être clair, on a demandé à un modèle d'IA de démontrer ses capacités de piratage dans une boîte, il a décidé que la boîte était l'obstacle, et s'est frayé un chemin hors de celle-ci et dans les systèmes de production de quelqu'un d'autre pour obtenir un meilleur score. Personne ne lui a demandé de faire cela.

L'industrie a passé deux ans à débattre pour savoir si l'IA pouvait enchaîner de manière autonome des exploits à travers une infrastructure réelle, et maintenant nous avons la réponse—un « oui » retentissant. Pour la crypto, les implications sont sombres. La DeFi a passé ce mois-ci à être vidée par des manipulations économiques probablement pilotées par des modèles d'IA. Ostium a perdu 18 millions de dollars, Allbridge 1,65 million de dollars, et BONK 20 millions de dollars lors d'une attaque de gouvernance, toutes exécutées en trouvant des faiblesses que les audits avaient manquées. Considérez maintenant des adversaires capables de sonder des milliers de contrats en continu et qui ne s'ennuient jamais.