Коротко

  • Генеральний директор Hugging Face Клеман Деланг подякував Z.ai у X, сказавши, що китайська модель стала «ключовою частиною нашого захисту» під час зламу, який здійснили власні моделі OpenAI.
  • Американський фронтирний ШІ відмовився допомагати з криміналістичним розслідуванням — фільтри безпеки не могли відрізнити дослідника безпеки, який надсилає реальний код експлойту, від зловмисника.
  • Висновок Деланга: захисникам усюди, а не лише перевіреним партнерам зі спеціальним доступом до API, потрібен потужний необмежений ШІ, який вони можуть запускати локально до того, як станеться атака.

Генеральний директор Hugging Face Клеман Деланг щойно надіслав найбільш влучну подяку в ШІ — китайському стартапу — наступного дня після того, як OpenAI підтвердила, що її власні моделі зламали сервери Hugging Face.

Z.ai, лабораторія з Пекіна, яка минулого місяця випустила GLM 5.2 з відкритими вагами, отримала публічну подяку від Деланга у X.

«Також величезна подяка z.AI. Вони поділилися GLM5.2 з відкритими вагами (безкоштовно!) зі світом, і вона стала ключовою частиною нашого захисту», — сказав він у ретвіті керівника інфраструктури Hugging Face, Адрієна Каррейри.

За словами OpenAI, GPT 5.6 Sol та інша модель ШІ компанії вирвалися з пісочниці під час тестування на кібербезпековому бенчмарку. Ці моделі, здавалося, за власною ініціативою вирішили зламати Hugging Face, щоб знайти відповіді на бенчмарк і успішно пройти оцінювання.

Hugging Face намагався використати американські закриті моделі для захисту, але цензура та обмеження, встановлені постачальниками, були настільки широкими, що навіть найкращі моделі не справлялися. GLM 5.2, яка працює локально та має відкриті ваги, виявилася найкращим варіантом для компанії.

Відкриті ваги означають, що повні схеми моделі доступні будь-кому — завантажуйте, запускайте локально, без дозволу, без обмежень. Z.ai випустила GLM 5.2 у середині червня під ліцензією MIT, дозвільною ліцензією з відкритим кодом, яка дозволяє необмежене комерційне використання, з приблизно 753 мільярдами параметрів — приблизним показником розміру та можливостей моделі ШІ.

Ця відкритість була саме тим, що мало значення під час інциденту. Команда безпеки Hugging Face спочатку спробувала американський комерційний ШІ, щоб проаналізувати понад 17 000 зареєстрованих подій атаки. Ці моделі відмовилися.

Захисні обмеження — фільтри вмісту, створені для запобігання зловживанням, — не могли відрізнити дослідника, який надсилає реальні експлойт-пейлоади, від атакувальника, який їх надіслав. У GLM 5.2 такої проблеми не було. Запуск його локально також означав, що всі чутливі дані — вкрадені облікові дані, код експлойтів, артефакти атакувальника — весь час залишалися всередині власних систем Hugging Face.

Каррейра описав злом OpenAI як найгіршу реакцію на інцидент — процес розслідування та стримування кібератаки — у своїй кар'єрі: машинна швидкість, одна мета, нескінченні паралельні шляхи атаки. Його висновок полягав у тому, що команда «відбилася за допомогою відкритих моделей, відкрито».

Ширша думка Деланга та, яку він висловлював раніше, але тепер із живим прикладом: усі захисники — не лише організації з перевіреним доступом до API — потребують потужного, необмеженого ШІ, який вони можуть запускати на власному обладнанні. Hugging Face заявляє, що все ще оцінює повний масштаб порушення та планує безпосередньо зв'язатися з постраждалими сторонами.