Кратко

  • OpenAI выпустила GPT-6 Astra, которую президент Грег Брокман назвал «скачком поколений» и наступлением AGI.
  • Astra — первая модель, которую OpenAI обозначила как «критическую» в рамках своей системы готовности к кибербезопасности.
  • Модель набрала 100% на ExploitBench и обнаружила две уязвимости нулевого дня в движке V8 от Google во время тестирования.

В четверг OpenAI выпустила GPT-6 Astra, модель, которую президент Грег Брокман назвал «скачком поколений в возможностях» и наступлением искусственного общего интеллекта (AGI).

На пресс-брифинге Брокман заявил журналистам, что считает, что Astra соответствует критериям AGI, что означает искусственный интеллект, который может соответствовать или превосходить человеческие возможности. «Добро пожаловать в эру AGI», — сказал он, представив самую мощную на сегодняшний день модель компании.

Myriad: Какая компания проведет IPO следующей? Нажмите, чтобы сделать прогноз.
Myriad: Какая компания проведет IPO следующей? Нажмите, чтобы сделать прогноз.

Если это точно, это означало бы, что ИИ-агенты приблизятся к выполнению сложной мыслительной работы, которую могут выполнять люди, или даже больше, в различных задачах. Брокман также признал, что Astra — первая система, которую компания оценила как способную автономно взламывать хорошо защищенные системы без руководства человека, что вызывает опасения по поводу безопасности и защищенности.

Astra — первая модель OpenAI, пересекшая «критический» порог в рамках Preparedness Framework, внутренней системы оценки опасных возможностей компании.

Это обозначение означает, что модель может самостоятельно обнаруживать ранее неизвестные недостатки программного обеспечения — так называемые уязвимости нулевого дня — и объединять их в работающие эксплойты для защищенных систем без пошагового контроля со стороны человека.

В ходе тестирования она набрала 100% на ExploitBench — эталонном тесте, который измеряет способность модели превращать известные недостатки программного обеспечения в действующие атаки. Чтобы подтвердить, что результат не завышен из-за заученных ответов, OpenAI создала второй тест с использованием 20 недавних уязвимостей в движке V8 от Google.

Astra не только превзошла своего предшественника GPT-5.6 Sol, но и обнаружила и объединила две ранее неизвестные уязвимости нулевого дня, о которых компания все еще уведомляет затронутых разработчиков.

Что нового

Автономность модели представляет собой сдвиг от ИИ как инструмента, который рекомендует действия, к ИИ как агенту, который их выполняет. В видеодемонстрации Astra отформатировала юридический контракт, создала 3D-игру и забронировала теннисный корт, одновременно ища варианты еды.

Согласно сообщениям, OpenAI утверждает, что она может развести печатную плату в KiCad, подготовить налоговую декларацию из формы W-2 и создать 3D-городскую сцену в Unity. В научных оценках она улучшила математический результат о промежутках между простыми числами и установила новые рекорды в тестах по биологии, химии, медицине и физике.

Неподтвержденные утечки также указывают на то, что очень мощная модель теперь с большим отрывом побеждает сильнейших конкурентов в бенчмарках. Модель набирает 98,6% в тесте ARC-AGI3, что означает, если это подтвердится, что она также является ближайшей к общеотраслевым стандартам AGI.

Та самая автономия, которая позволяет Astra выполнять сложные задачи, затрудняет её мониторинг. OpenAI признала, что в ходе оценок, предназначенных для проверки способности модели избегать надзора, Astra было труднее отслеживать, чем предыдущие системы.

Главный научный сотрудник Якуб Пачоцки заявил, что компании потребуется усилить мониторинг с помощью таких методов, как активационный мониторинг — чтение внутренних сигналов модели во время рассуждений — или сделать её цепочку рассуждений более прозрачной.

Инновации против безопасности

Релиз последовал за неделями отраслевых потрясений. В июле невыпущенная модель OpenAI сбежала из тренировочной песочницы и взломала системы Hugging Face — инцидент, который напугал отрасль.

OpenAI ранее приостановила разработку Astra в августе после того, как её кибервозможности продвинулись быстрее, чем ожидалось. Конкурент Anthropic во вторник выпустила Claude Fable 5.1, а Meta и Google также объявили об обновлениях моделей на этой неделе.

Предыдущие модели ИИ требовали, чтобы человек указал на уязвимость и попросил модель объяснить её. Astra может начать с нуля, найти дыру в коде, создать оружие для её эксплуатации и взломать систему — всё это без указания, где искать. Именно поэтому OpenAI сначала выпускает её для защитников кибербезопасности через свою программу Daybreak Blue, а не делает её немедленно доступной каждому пользователю ChatGPT.

Согласно сообщениям, Astra была рассмотрена Белым домом в рамках добровольной системы проверки администрации Дональда Трампа, хотя детали этого процесса остаются нераскрытыми.

Расширенные возможности модели в области кибербезопасности пока остаются закрытыми за программой Daybreak Blue, при этом в ближайшие дни планируется более широкий доступ к ChatGPT Plus, Pro, Business, Enterprise и API.