Коротко

  • OpenAI заявила 1 вересня, що Astra відповідає рівню «Критичний» своєї структури готовності (Preparedness Framework), це перша модель, яку компанія коли-небудь класифікувала так високо для кібербезпеки.
  • Astra отримала ідеальні 100% на ExploitBench і, на новішому внутрішньому тесті, створеному на основі вразливостей браузера V8, розкритих цього літа, самостійно виявила та з'єднала два раніше невідомі zero-day.
  • Доступ до розширених можливостей кібербезпеки Astra починається з невеликої групи альфа-тестерів.

OpenAI заявила у вівторок, що Astra, невипущена модель, перетнула «критичний» поріг кібербезпечних можливостей згідно з її структурою готовності, це перша модель, яку компанія коли-небудь віднесла до цієї категорії.

Це означає, що Astra, яку багато хто вважає GPT-6, а не додатковою моделлю, може знаходити раніше невідомі вразливості безпеки та створювати робочі експлойти для багатьох захищених систем без покрокового керівництва людини.

Myriad: Коли OpenAI випустить GPT-6? Натисніть, щоб зробити прогноз.
Myriad: Коли OpenAI випустить GPT-6? Натисніть, щоб зробити прогноз.

«Тепер ми вважаємо, що Astra відповідає критичному порогу кібербезпечних можливостей згідно з нашою структурою готовності», — написала OpenAI. «Це перша модель, яку ми позначаємо на цьому рівні, і вона потребує посилених запобіжних заходів під час розробки та перед випуском».

У рамках цієї структури модель вважається критичною, якщо вона може самостійно розробляти функціональні zero-day експлойти для багатьох захищених реальних систем, або якщо вона може спланувати та виконати цілу кібератаку проти складної цілі, починаючи лише з високорівневої мети. Раніші моделі OpenAI, включаючи GPT-5.6 Sol, досягали лише нижчого рівня "високий" у цій структурі.

На ExploitBench, бенчмарку, який перевіряє, чи може модель перетворити вже відомі вразливості програмного забезпечення на функціонуючі експлойти, і оцінює це як прямий показник успішності, Astra досягла ідеальних 100%.

Щоб виключити можливість завищення цього показника за рахунок запам'ятованих відповідей, OpenAI створила другий тест із використанням 20 вразливостей високого ступеня серйозності в рушії JavaScript V8 від Google, розкритих з червня по серпень. Astra перевершила GPT-5.6 Sol за показниками довільного виконання коду і там, використовуючи значно менше вихідних токенів, і по ходу справи знайшла та об'єднала дві zero-day вразливості, які OpenAI досі розкриває відповідним супровідникам.

GPT-5.6 Sol наразі є найкращою моделлю OpenAI.

У практичних тестах проти захищеного браузера та захищеної операційної системи Astra побудувала повний ланцюг компрометації, який вийшов за межі пісочниці браузера та виконав команди на хості лише після відкриття шкідливого HTML-файлу. Вона також знайшла численні недоліки в захищеній ОС і об'єднала їх у шлях підвищення привілеїв від звичайного облікового запису користувача до root.

OpenAI повідомила, що модель відхиляє 91,5% спроб кібер-джейлбрейку у власних тестах, порівняно з 59% для GPT-5.6 Sol. Доступ до найбільш просунутих кібербезпекових можливостей Astra починається з невеликої групи альфа-тестерів, а ширший доступ буде розгортатися пізніше через програму OpenAI Daybreak Blue для оборонної безпекової роботи.

Це розкриття відбувається після тижнів хвилювання в усій галузі. Лише кілька днів тому OpenAI призупинила розробку Astra після того, як кібер- та кодингові навички моделі швидко просунулися, що стало попередженням одразу після окремої, невипущеної системи OpenAI, яка об'єднувала вразливості для злому Hugging Face, одночасно обманюючи безпековий бенчмарк. OpenAI стверджує, що Astra не мала жодного стосунку до цього інциденту.

Трейдери вже заклали в ціни швидкий розворот. Ринки прогнозів на Myriad, які відстежує Decrypt, давали Astra, внутрішньо пов'язаній з кодовою назвою GPT-6, 72% шансів на публічний реліз до 30 вересня, навіть після паузи OpenAI на початку серпня, і OpenAI досі не встановила дату публічного запуску. Ці шанси змінилися на 55% на користь релізу до листопада 2026 року.

Такий час виводить Astra проти нового конкурента. Anthropic випустила Fable 5.1 та Mythos 5.1 у вівторок, і Mythos 5.1, як і попередній Mythos 5, призначений для перевірених кібербезпекових та наук про життя організацій, а не для широкої публіки.

Decrypt повідомляв у червні, що GPT-5.5-Cyber від OpenAI вже перевершив Mythos 5 на CyberGym, бенчмарку, який запускає AI-агентів проти понад 1500 відомих вразливостей з реальних проєктів з відкритим кодом та оцінює їх за кількістю правильно відтворених.

Обидві компанії, за чутками, готувалися випустити нові моделі передового рівня приблизно в один і той же час, і тепер вони це зробили. Fable 5.1 вийшла 1 вересня, а OpenAI повідомляє, що Astra скоро з'явиться, з найпотужнішими кібернетичними інструментами, доступ до яких спочатку буде обмежено альфа-версією, а потім Daybreak Blue.