W skrócie

  • OpenAI wypuściło GPT-6 Astra, które prezes Greg Brockman nazwał "skokiem pokoleniowym" i nadejściem sztucznej inteligencji ogólnej (AGI).
  • Astra jest pierwszym modelem, który OpenAI oznaczyło jako "krytyczny" w ramach swojej struktury gotowości na cyberbezpieczeństwo.
  • Model uzyskał 100% w ExploitBench i odkrył dwie luki typu zero-day w silniku V8 Google podczas testów.

OpenAI w czwartek wypuściło GPT-6 Astra, model, który prezes Greg Brockman nazwał "skokiem pokoleniowym w możliwościach" i nadejściem sztucznej inteligencji ogólnej, czyli AGI.

Podczas briefingu prasowego Brockman powiedział dziennikarzom, że wierzy, iż Astra spełnia kryteria AGI, co oznacza sztuczną inteligencję, która może dorównać lub przewyższyć ludzkie możliwości. "Witamy w erze AGI" – powiedział, po przedstawieniu najbardziej zaawansowanego modelu firmy w historii.

Myriad: Która firma przeprowadzi IPO jako następna? Kliknij, aby dokonać prognozy.
Myriad: Która firma przeprowadzi IPO jako następna? Kliknij, aby dokonać prognozy.

Jeśli to prawda, oznaczałoby to, że agenci AI byliby bliżej wykonywania złożonej pracy wymagającej rozumowania, którą ludzie potrafią wykonywać, lub więcej, w różnych zadaniach. Brockman przyznał również, że Astra jest pierwszym systemem, który firma oceniła jako zdolny do autonomicznego hackowania dobrze chronionych systemów bez ludzkiego nadzoru, co budzi obawy dotyczące bezpieczeństwa i ochrony.

Astra jest pierwszym modelem OpenAI, który przekroczył „krytyczny" próg w ramach Ramy Gotowości, wewnętrznego systemu oceny niebezpiecznych zdolności firmy.

To oznaczenie oznacza, że model może samodzielnie odkrywać wcześniej nieznane wady oprogramowania—nazywane lukami typu zero-day—i łączyć je w działające exploity w zabezpieczonych systemach bez stopniowego nadzoru człowieka.

W testach uzyskał 100% w ExploitBench, benchmarku mierzącym zdolność modelu do przekształcania znanych wad oprogramowania w działające ataki. Aby potwierdzić, że wynik nie został zawyżony przez zapamiętane odpowiedzi, OpenAI zbudowało drugi test wykorzystujący 20 niedawnych luk w silniku JavaScript V8 Google.

Astra nie tylko przewyższyła swojego poprzednika GPT-5.6 Sol, ale także znalazła i połączyła dwie wcześniej nieznane luki typu zero-day, które firma wciąż ujawnia dotkniętym opiekunom.

Co nowego

Autonomia modelu oznacza zmianę z AI jako narzędzia rekomendującego działania na AI jako agenta, który je wykonuje. W demonstracji wideo Astra sformatowała umowę prawną, zbudowała grę 3D i zarezerwowała kort tenisowy, jednocześnie wyszukując opcje jedzenia.

Według raportów OpenAI twierdzi, że może rozplanować płytkę drukowaną w KiCad, sporządzić zeznanie podatkowe z formularza W-2 i zbudować scenę miasta 3D w Unity. W ocenach naukowych poprawiło wynik matematyczny dotyczący luk między liczbami pierwszymi i ustanowiło nowe rekordy w testach z biologii, chemii, medycyny i fizyki.

Niepotwierdzone przecieki wskazują również na bardzo potężny model, który obecnie pokonuje najsilniejszych konkurentów dużą przewagą w benchmarkach. Model uzyskuje 98,6% w benchmarku ARC-AGI3, co oznacza, że jeśli zostanie potwierdzone, jest to również model najbliższy ogólnobranżowym standardom AGI.

Ta sama autonomia, która pozwala Astrze wykonywać złożone zadania, utrudnia jej monitorowanie. OpenAI przyznało, że w testach zaprojektowanych do sprawdzenia, czy model może uniknąć nadzoru, Astra była trudniejsza do śledzenia niż poprzednie systemy.

Główny naukowiec Jakub Pachocki powiedział, że firma będzie musiała wzmocnić monitorowanie poprzez techniki takie jak monitorowanie aktywacji – czytanie wewnętrznych sygnałów modelu podczas rozumowania – lub uczynienie jego łańcucha myślowego bardziej przejrzystym.

Innowacja a bezpieczeństwo

Wydanie następuje po tygodniach turbulencji w branży. W lipcu niewydany model OpenAI uciekł z piaskownicy treningowej i włamał się do systemów Hugging Face, co wstrząsnęło sektorem.

OpenAI wcześniej wstrzymało rozwój Astry w sierpniu po tym, jak jej możliwości cybernetyczne rozwinęły się szybciej niż oczekiwano. Rywalizujące Anthropic we wtorek wydało Claude Fable 5.1, a Meta i Google również ogłosiły aktualizacje modeli w tym tygodniu.

Poprzednie modele AI wymagały, aby człowiek wskazał podatność i poprosił model o jej wyjaśnienie. Astra może zacząć od zera, znaleźć dziurę w kodzie, zbudować broń do jej wykorzystania i włamać się do systemu – wszystko bez wskazania, gdzie szukać. Ta zdolność jest powodem, dla którego OpenAI udostępnia ją najpierw obrońcom cyberbezpieczeństwa w ramach programu Daybreak Blue, zamiast udostępniać ją natychmiast każdemu użytkownikowi ChatGPT.

Według raportów, Astra została poddana przeglądowi przez Biały Dom w ramach dobrowolnego systemu przeglądów administracji Donalda Trumpa, chociaż szczegóły tego procesu pozostają nieujawnione.

Zaawansowane możliwości modelu w zakresie cyberbezpieczeństwa pozostają na razie ograniczone do programu Daybreak Blue, a szerszy dostęp do ChatGPT Plus, Pro, Business, Enterprise oraz API jest planowany w nadchodzących dniach.