W skrócie
- OpenAI poinformowało 1 września, że Astra spełnia poziom „Krytyczny” swojego Frameworku Gotowości, co czyni ją pierwszym modelem, który firma kiedykolwiek sklasyfikowała tak wysoko pod względem cyberbezpieczeństwa.
- Astra uzyskała 100% wynik w ExploitBench, a w nowszym wewnętrznym teście opartym na lukach w przeglądarce V8 ujawnionych tego lata, samodzielnie odkryła i połączyła dwa wcześniej nieznane exploity typu zero-day.
- Dostęp do zaawansowanych możliwości cyberbezpieczeństwa Astry rozpoczyna się od małej grupy testerów alfa.
OpenAI poinformowało we wtorek, że Astra, niewydany model, przekroczyła „krytyczny” próg zdolności cyberbezpieczeństwa zgodnie z jego Frameworkiem Gotowości, co czyni ją pierwszym modelem, który firma kiedykolwiek umieściła w tej kategorii.
Oznacza to, że Astra, która według wielu jest GPT-6, a nie dodatkowym modelem, może znajdować wcześniej nieznane luki w zabezpieczeniach i tworzyć działające exploity w wielu wzmocnionych systemach bez prowadzenia jej krok po kroku przez człowieka.

„Uważamy teraz, że Astra spełnia próg krytycznych zdolności cyberbezpieczeństwa zgodnie z naszym Frameworkiem Gotowości” – napisało OpenAI. „To pierwszy model, któremu przypisujemy ten poziom, i wymaga silniejszych zabezpieczeń podczas rozwoju i przed wydaniem.”
W ramach tych ram, model osiąga poziom krytyczny, jeśli potrafi samodzielnie opracować funkcjonalne exploity typu zero-day w wielu zabezpieczonych systemach rzeczywistych, lub jeśli potrafi zaplanować i przeprowadzić cały cyberatak na trudny cel, zaczynając tylko od ogólnego celu. Wcześniejsze modele OpenAI, w tym GPT-5.6 Sol, osiągały najwyżej niższy poziom „wysoki” w tych ramach.
W teście ExploitBench, który sprawdza, czy model potrafi przekształcić już znane luki w oprogramowaniu w działające exploity i ocenia go jako prosty wskaźnik zaliczeń, Astra osiągnęła doskonałe 100%.
Aby wykluczyć, że zapamiętane odpowiedzi zawyżają ten wynik, OpenAI zbudowało drugi test wykorzystujący 20 luk o wysokiej dotkliwości w silniku JavaScript V8 Google, ujawnionych między czerwcem a sierpniem. Astra pokonała GPT-5.6 Sol pod względem wskaźników arbitralnego wykonywania kodu również tam, używając znacznie mniejszej liczby tokenów wyjściowych, a po drodze znalazła i połączyła dwie luki typu zero-day, które OpenAI wciąż ujawnia dotkniętym opiekunom.
GPT-5.6 Sol jest obecnie najlepszym modelem OpenAI.
W testach praktycznych przeciwko zabezpieczonej przeglądarce i zabezpieczonemu systemowi operacyjnemu Astra zbudowała pełny łańcuch kompromitacji, który wydostał się z piaskownicy przeglądarki i uruchamiał polecenia na hoście tylko po otwarciu złośliwego pliku HTML. Znalazła również wiele wad w zabezpieczonym systemie operacyjnym i połączyła je w ścieżkę eskalacji uprawnień od zwykłego konta użytkownika do roota.
OpenAI poinformowało, że model odmawia 91,5% prób cyberataków typu jailbreak we własnych testach, w porównaniu z 59% dla GPT-5.6 Sol. Dostęp do najbardziej zaawansowanych możliwości cyberbezpieczeństwa Astry zaczyna się od małej grupy testerów alfa, a szerszy dostęp będzie wdrażany później w ramach programu Daybreak Blue OpenAI do prac obronnych w zakresie bezpieczeństwa.
Ujawnienie to następuje po tygodniach niepokoju w całej branży. Zaledwie kilka dni temu OpenAI wstrzymało rozwój Astry po tym, jak umiejętności cybernetyczne i kodowania modelu szybko się rozwinęły, co było ostrzeżeniem, które pojawiło się tuż po osobnym, nieopublikowanym systemie OpenAI, który połączył luki, aby naruszyć Hugging Face, jednocześnie manipulując benchmarkiem bezpieczeństwa. OpenAI twierdzi, że Astra nie miała roli w tym incydencie.
Handlowcy już wcześniej uwzględnili szybki zwrot. Rynki prognoz na Myriad śledzone przez Decrypt dawały Astrze, wewnętrznie powiązanej z kryptonimem GPT-6, 72% szans na publiczne wydanie do 30 września, nawet po wstrzymaniu przez OpenAI na początku sierpnia, a OpenAI wciąż nie ustaliło publicznej daty premiery. Te szanse zmieniły się na 55% za wydaniem do listopada 2026 roku.
Termin stawia Astrę przeciwko nowemu rywalowi. Anthropic wydał Fable 5.1 i Mythos 5.1 we wtorek, a Mythos 5.1, podobnie jak wcześniejszy Mythos 5, jest zarezerwowany dla zweryfikowanych organizacji zajmujących się cyberbezpieczeństwem i naukami przyrodniczymi, a nie dla ogółu społeczeństwa.
Decrypt poinformował w czerwcu, że GPT-5.5-Cyber od OpenAI już przewyższył Mythos 5 w teście CyberGym, benchmarku, który uruchamia agentów AI przeciwko ponad 1500 znanym lukom z rzeczywistych projektów open-source i ocenia ich na podstawie tego, ile z nich poprawnie odtworzą.
Obie firmy były wcześniej plotkowane, że przygotowują nowe modele graniczne w podobnym czasie, i teraz to zrobiły. Fable 5.1 pojawił się 1 września, a OpenAI twierdzi, że Astra wkrótce nadejdzie, z najbardziej zaawansowanymi narzędziami cybernetycznymi najpierw za dostępem alfa, a potem Daybreak Blue.






