Кратко
- OpenAI заявила 1 сентября, что Astra соответствует «критическому» уровню своей системы готовности, и это первая модель, которую компания когда-либо классифицировала так высоко для кибербезопасности.
- Astra набрала 100% в ExploitBench и, на более новом внутреннем тесте, созданном на основе уязвимостей браузера V8, раскрытых этим летом, самостоятельно обнаружила и связала две ранее неизвестные уязвимости нулевого дня.
- Доступ к расширенным возможностям кибербезопасности Astra начинается с небольшой группы альфа-тестеров.
OpenAI сообщила во вторник, что Astra, невыпущенная модель, пересекла «критический» порог возможностей кибербезопасности в соответствии с ее системой готовности, и это первая модель, которую компания когда-либо относила к этой категории.
Это означает, что Astra, которую многие считают GPT-6, а не дополнительной моделью, может находить ранее неизвестные уязвимости безопасности и создавать работающие эксплойты для многих защищенных систем без пошагового руководства человека.

«Теперь мы считаем, что Astra соответствует критическому порогу возможностей кибербезопасности в соответствии с нашей системой готовности», — написала OpenAI. «Это первая модель, которую мы относим к этому уровню, и она требует более строгих мер защиты во время разработки и перед выпуском».
В рамках этой структуры модель считается критической, если она может самостоятельно разрабатывать функциональные эксплойты нулевого дня для многих защищенных реальных систем, или если она может спланировать и выполнить целую кибератаку на сложную цель, начиная с ничего, кроме высокоуровневой цели. Более ранние модели OpenAI, включая GPT-5.6 Sol, достигали лишь нижнего уровня «высокий» в этой структуре.
На ExploitBench, эталоне, который проверяет, может ли модель превращать уже известные уязвимости программного обеспечения в работающие эксплойты, и оценивает ее как прямую долю успеха, Astra достигла идеальных 100%.
Чтобы исключить возможность того, что заученные ответы завышают этот показатель, OpenAI создала второй тест, используя 20 уязвимостей высокой степени серьезности в движке JavaScript V8 от Google, раскрытых в период с июня по август. Astra превзошла GPT-5.6 Sol по показателям произвольного выполнения кода и там, используя гораздо меньше выходных токенов, и по ходу дела она нашла и объединила две уязвимости нулевого дня, которые OpenAI все еще раскрывает затронутым сопровождающим.
GPT-5.6 Sol в настоящее время является лучшей моделью OpenAI.
В практических тестах против защищенного браузера и защищенной операционной системы Astra построила полную цепочку компрометации, которая вырвалась из песочницы браузера и выполняла команды на хосте, просто открыв вредоносный HTML-файл. Она также нашла множество недостатков в защищенной ОС и объединила их в путь повышения привилегий от обычной учетной записи пользователя до root.
OpenAI заявила, что модель отклоняет 91,5% попыток кибер-джейлбрейка в ее собственных тестах, по сравнению с 59% для GPT-5.6 Sol. Доступ к наиболее продвинутым возможностям кибербезопасности Astra начинается с небольшой группы альфа-тестеров, а более широкий доступ будет постепенно внедряться позже через программу OpenAI Daybreak Blue для оборонительной безопасности.
Это раскрытие последовало за неделями беспокойства по всей отрасли. Всего несколько дней назад OpenAI приостановила разработку Astra после того, как кибер- и кодировочные навыки модели быстро продвинулись, что стало предупреждением, последовавшим за отдельной, неопубликованной системой OpenAI, которая объединила уязвимости для взлома Hugging Face, одновременно обманывая эталон безопасности. OpenAI утверждает, что Astra не играла роли в этом инциденте.
Трейдеры уже заложили в цены быстрый разворот. Рынки предсказаний на Myriad, отслеживаемые Decrypt, давали Astra, внутренне связанной с кодовым названием GPT-6, 72% шансов на публичный выпуск к 30 сентября, даже после паузы OpenAI в начале августа, и OpenAI до сих пор не установила дату публичного запуска. Эти шансы изменились на 55% в пользу выпуска к ноябрю 2026 года.
Сроки ставят Astra против нового соперника. Anthropic выпустила Fable 5.1 и Mythos 5.1 во вторник, и Mythos 5.1, как и более ранний Mythos 5, предназначен для проверенных организаций в области кибербезопасности и биологических наук, а не для широкой публики.
Decrypt сообщил в июне, что GPT-5.5-Cyber от OpenAI уже превзошел Mythos 5 на CyberGym, эталоне, который запускает ИИ-агентов против более чем 1500 известных уязвимостей из реальных проектов с открытым исходным кодом и оценивает их по тому, сколько из них они правильно воспроизводят.
Обе компании, по слухам, готовили новые передовые модели примерно в одно и то же время, и теперь они это сделали. Fable 5.1 вышла 1 сентября, а OpenAI сообщает, что Astra скоро появится, при этом самые мощные кибернетические инструменты будут сначала доступны через альфа-доступ, а затем Daybreak Blue.






