Коротко

  • OpenAI випустила GPT-6 Astra, який президент Грег Брокман назвав «стрибком поколінь» і приходом штучного загального інтелекту (AGI).
  • Astra — перша модель, яку OpenAI позначила як «критичну» згідно зі своєю Рамковою програмою готовності до кібербезпеки.
  • Модель набрала 100% на ExploitBench і виявила дві вразливості нульового дня в рушії V8 від Google під час тестування.

У четвер OpenAI випустила GPT-6 Astra, модель, яку президент Грег Брокман назвав «стрибком поколінь у можливостях» і приходом штучного загального інтелекту, або AGI.

Під час брифінгу для преси Брокман сказав журналістам, що вважає, що Astra відповідає критеріям AGI, що означає штучний інтелект, який може відповідати або перевершувати людські можливості. «Ласкаво просимо в еру AGI», — сказав він, представивши найпотужнішу на сьогодні модель компанії.

Myriad: Яка компанія проведе IPO наступною? Натисніть, щоб зробити прогноз.
Myriad: Яка компанія проведе IPO наступною? Натисніть, щоб зробити прогноз.

Якщо це точно, це означало б, що AI-агенти наблизяться до виконання складної розумової роботи, яку можуть виконувати люди, або більше, у різних завданнях. Брокман також визнав, що Astra — це перша система, яку компанія оцінила як здатну автономно зламувати добре захищені системи без людського керівництва, що викликає занепокоєння щодо безпеки та захищеності.

Astra — це перша модель OpenAI, яка перетнула «критичний» поріг згідно з Рамковою програмою готовності, внутрішньою системою оцінювання небезпечних можливостей компанії.

Це позначення означає, що модель може самостійно виявляти раніше невідомі вади програмного забезпечення — так звані вразливості нульового дня — і об'єднувати їх у робочі експлойти для захищених систем без покрокового контролю людини.

Під час тестування вона набрала 100% на ExploitBench, еталоні, який вимірює здатність моделі перетворювати відомі вади програмного забезпечення на функціонуючі атаки. Щоб підтвердити, що результат не завищений через запам'ятовані відповіді, OpenAI створила другий тест із використанням 20 нещодавніх вразливостей у рушії V8 від Google.

Astra не лише перевершила свого попередника GPT-5.6 Sol, але й знайшла та об'єднала дві раніше невідомі вразливості нульового дня, про які компанія досі повідомляє постраждалим розробникам.

Що нового

Автономність моделі означає зсув від ШІ як інструменту, що рекомендує дії, до ШІ як агента, який їх виконує. У відеодемонстрації Astra відформатувала юридичний контракт, створила 3D-гру та забронювала тенісний корт, одночасно шукаючи варіанти харчування.

За повідомленнями, OpenAI заявляє, що вона може розкласти друковану плату в KiCad, скласти податкову декларацію з форми W-2 та створити 3D-міську сцену в Unity. У наукових оцінках вона покращила математичний результат щодо проміжків між простими числами та встановила нові рекорди в тестах з біології, хімії, медицини та фізики.

Непідтверджені витоки також вказують на дуже потужну модель, яка зараз значно випереджає найсильніших конкурентів за бенчмарками. Модель набирає 98,6% на бенчмарку ARC-AGI3, що означає, якщо це підтвердиться, що це також найближча модель до загальногалузевих стандартів AGI.

Та сама автономність, яка дозволяє Astra виконувати складні завдання, ускладнює моніторинг. OpenAI визнала, що під час оцінювання, розробленого для перевірки здатності моделі уникати нагляду, Astra було складніше відстежувати, ніж попередні системи.

Головний науковець Якуб Пахоцький заявив, що компанії доведеться посилити моніторинг за допомогою таких методів, як моніторинг активації — зчитування внутрішніх сигналів моделі під час міркувань — або зробити її ланцюжок думок більш прозорим.

Інновації проти безпеки

Випуск відбувся після тижнів галузевих потрясінь. У липні невипущена модель OpenAI втекла з тренувальної пісочниці та зламала системи Hugging Face, що налякало сектор.

OpenAI раніше призупинила розробку Astra в серпні після того, як її кібернетичні можливості розвинулися швидше, ніж очікувалося. Конкурент Anthropic у вівторок випустив Claude Fable 5.1, а Meta та Google також оголосили про оновлення моделей цього тижня.

Попередні моделі ШІ потребували, щоб людина вказала на вразливість і попросила модель пояснити її. Astra може почати з нуля, знайти дірку в коді, створити зброю для її використання та проникнути в систему — все це без вказівки, де шукати. Саме тому OpenAI спочатку випускає її для захисників кібербезпеки через свою програму Daybreak Blue, а не робить її негайно доступною для кожного користувача ChatGPT.

Згідно з повідомленнями, Astra була перевірена Білим домом у рамках добровільної системи перевірки адміністрації Дональда Трампа, хоча деталі цього процесу залишаються нерозкритими.

Розширені можливості моделі у сфері кібербезпеки поки що залишаються закритими за програмою Daybreak Blue, а ширший доступ через ChatGPT Plus, Pro, Business, Enterprise та API планується найближчими днями.