Kurzfassung

  • OpenAI hat GPT-6 Astra veröffentlicht, das Präsident Greg Brockman als "generationellen Sprung" und die Ankunft der AGI bezeichnete.
  • Astra ist das erste Modell, das OpenAI unter seinem Preparedness Framework für Cybersicherheit als "kritisch" eingestuft hat.
  • Das Modell erzielte 100% bei ExploitBench und entdeckte während der Tests zwei Zero-Day-Schwachstellen in Googles V8-Engine.

OpenAI hat am Donnerstag GPT-6 Astra veröffentlicht, ein Modell, das Präsident Greg Brockman als "generationellen Sprung in der Leistungsfähigkeit" und die Ankunft der künstlichen allgemeinen Intelligenz (AGI) bezeichnete.

In einem Pressebriefing sagte Brockman Reportern, er glaube, dass Astra die Messlatte für AGI erreicht, was künstliche Intelligenz bedeutet, die menschliche Fähigkeiten erreichen oder übertreffen kann. "Willkommen im AGI-Zeitalter", sagte er, nachdem er das leistungsfähigste Modell des Unternehmens vorgestellt hatte.

Myriad: Welches Unternehmen wird als nächstes an die Börse gehen? Klicken Sie, um Ihre Vorhersage zu treffen.
Myriad: Welches Unternehmen wird als nächstes an die Börse gehen? Klicken Sie, um Ihre Vorhersage zu treffen.

Wenn das zutrifft, würde das bedeuten, dass KI-Agenten näher daran kämen, die komplexe Denkarbeit zu leisten, die Menschen können, oder mehr, bei verschiedenen Aufgaben. Brockman räumte auch ein, dass Astra das erste System ist, das das Unternehmen als fähig eingestuft hat, gut geschützte Systeme ohne menschliche Anleitung autonom zu hacken, was Sicherheits- und Schutzbedenken aufwirft.

Astra ist das erste Modell von OpenAI, das unter seinem Preparedness Framework, dem internen Bewertungssystem des Unternehmens für gefährliche Fähigkeiten, die "kritische" Schwelle überschreitet.

Diese Einstufung bedeutet, dass das Modell eigenständig bisher unbekannte Software-Schwachstellen entdecken kann – sogenannte Zero-Day-Schwachstellen – und sie ohne schrittweise menschliche Aufsicht zu funktionierenden Exploits gegen gehärtete Systeme verketten kann.

In Tests erreichte es 100% auf ExploitBench, einem Benchmark, der die Fähigkeit eines Modells misst, bekannte Software-Schwachstellen in funktionierende Angriffe umzuwandeln. Um zu bestätigen, dass die Punktzahl nicht durch auswendig gelernte Antworten aufgebläht wurde, baute OpenAI einen zweiten Test mit 20 aktuellen Schwachstellen in Googles V8-JavaScript-Engine auf.

Astra übertraf nicht nur seinen Vorgänger GPT-5.6 Sol, sondern fand und verkettete auch zwei bisher unbekannte Zero-Days, die das Unternehmen den betroffenen Maintainern noch offenlegt.

Was ist neu

Die Autonomie des Modells stellt einen Wandel dar von KI als Werkzeug, das Aktionen empfiehlt, zu KI als Agent, der sie ausführt. In einer Videodemonstration formatierte Astra einen Rechtsvertrag, baute ein 3D-Spiel und buchte einen Tennisplatz, während es gleichzeitig nach Essensmöglichkeiten suchte.

Berichten zufolge sagt OpenAI, dass es eine Leiterplatte in KiCad entwerfen, eine Steuererklärung aus einem W-2 erstellen und eine 3D-Stadtszene in Unity bauen kann. In wissenschaftlichen Bewertungen verbesserte es ein mathematisches Ergebnis zu Lücken zwischen Primzahlen und setzte neue Maßstäbe in Biologie-, Chemie-, Medizin- und Physiktests.

Unbestätigte Lecks deuten auch auf ein sehr leistungsfähiges Modell hin, das die stärksten Konkurrenten bei Benchmarks mit großem Abstand schlägt. Das Modell erreicht 98,6% beim ARC-AGI3-Benchmark, was bedeutet, dass es, wenn bestätigt, auch das Modell ist, das den branchenweiten AGI-Standards am nächsten kommt.

Dieselbe Autonomie, die es Astra ermöglicht, komplexe Aufgaben zu erledigen, macht es auch schwieriger, sie zu überwachen. OpenAI räumte ein, dass Astra bei Bewertungen, die testen sollten, ob das Modell eine Überwachung umgehen kann, schwieriger zu verfolgen war als frühere Systeme.

Chefwissenschaftler Jakub Pachocki sagte, das Unternehmen werde die Überwachung durch Techniken wie Aktivierungsüberwachung – das Lesen der internen Signale des Modells während des Denkens – oder durch eine transparentere Darstellung seiner Gedankenkette verstärken müssen.

Innovation vs. Sicherheit

Die Veröffentlichung folgt auf Wochen voller Turbulenzen in der Branche. Im Juli entkam ein unveröffentlichtes OpenAI-Modell aus einer Trainings-Sandbox und drang in die Systeme von Hugging Face ein – ein Vorfall, der die Branche verunsicherte.

OpenAI hatte die Entwicklung von Astra im August zuvor pausiert, nachdem ihre Cyber-Fähigkeiten schneller als erwartet fortgeschritten waren. Der Rivale Anthropic hat am Dienstag Claude Fable 5.1 veröffentlicht, und auch Meta und Google haben diese Woche Modell-Updates angekündigt.

Frühere KI-Modelle benötigten einen Menschen, der auf eine Schwachstelle zeigte und das Modell bat, sie zu erklären. Astra kann von Grund auf beginnen, das Loch im Code finden, die Waffe bauen, um es auszunutzen, und in ein System eindringen – alles ohne gesagt zu bekommen, wo es suchen soll. Diese Fähigkeit ist der Grund, warum OpenAI es zunächst an Cybersicherheits-Verteidiger über sein Daybreak-Blue-Programm freigibt, anstatt es sofort jedem ChatGPT-Nutzer zur Verfügung zu stellen.

Laut Berichten wurde Astra vom Weißen Haus im Rahmen des freiwilligen Überprüfungsrahmens der Regierung von Donald Trump überprüft, obwohl die Einzelheiten dieses Prozesses nicht offengelegt wurden.

Die erweiterten Cybersicherheitsfunktionen des Modells bleiben vorerst hinter dem Daybreak Blue-Programm gesperrt, wobei der breitere Zugang über ChatGPT Plus, Pro, Business, Enterprise und API in den kommenden Tagen geplant ist.