摘要

  • OpenAI 發布了 GPT-6 Astra,總裁 Greg Brockman 稱其為「世代飛躍」以及 AGI 的到來。
  • Astra 是 OpenAI 在其「準備框架」中首個被指定為「關鍵」的網路安全模型。
  • 該模型在 ExploitBench 上獲得 100% 分數,並在測試期間發現了 Google V8 引擎中的兩個零日漏洞。

OpenAI 於週四發布了 GPT-6 Astra,總裁 Greg Brockman 稱其為「能力的世代飛躍」以及通用人工智慧(AGI)的到來。

在記者會上,Brockman 告訴記者,他相信 Astra 已達到 AGI 的標準,這意味著人工智慧能夠匹配或超越人類的能力。「歡迎來到 AGI 時代,」他在介紹公司迄今為止最強大的模型後說道。

Myriad: 哪家公司將率先 IPO?點擊進行預測。
Myriad:哪家公司將率先 IPO?點擊進行預測

如果屬實,這將意味著 AI 代理將更接近於完成人類能做的複雜推理工作,甚至更多,涵蓋各種不同的任務。Brockman 也承認,Astra 是該公司第一個被評為能夠在無人指導下自主入侵受良好保護系統的模型,這引發了安全與保安方面的擔憂。

Astra 是 OpenAI 首個在其準備框架(公司內部用於評估危險能力的評分系統)下跨越「關鍵」門檻的模型。

該稱號意味著該模型可以在沒有逐步人工監督的情況下,獨立發現先前未知的軟體漏洞(稱為零日漏洞),並將其串聯成針對強化系統的有效攻擊。

在測試中,它在ExploitBench上獲得了 100% 的分數,該基準測試衡量模型將已知軟體漏洞轉化為有效攻擊的能力。為了確認分數不是因記憶答案而膨脹,OpenAI 使用 Google V8 JavaScript 引擎中的 20 個近期漏洞建立了第二項測試。

Astra 不僅超越了其前身 GPT-5.6 Sol,還發現並串聯了兩個先前未知的零日漏洞,該公司仍在向受影響的維護者披露這些漏洞。

新功能

該模型的自動化代表了從 AI 作為推薦行動的工具轉變為 AI 作為執行行動的代理。在影片示範中,Astra 在同時搜尋食物選項時,格式化了一份法律合約、構建了一個 3D 遊戲,並預訂了一個網球場。

據報導,OpenAI 表示它可以佈局 KiCad 中的印刷電路板、根據 W-2 草擬納稅申報表,並在 Unity 中構建 3D 城市場景。在科學評估中,它改進了素數間隙的數學結果,並在生物學、化學、醫學和物理測試中創下了新紀錄。

未經證實的洩漏也表明,一個非常強大的模型現在在基準測試中以大幅優勢擊敗了最強的競爭對手。該模型在 ARC-AGI3 基準測試中得分為 98.6%,這意味著,如果得到證實,這也是最接近行業 AGI 標準的模型。

讓Astra能夠完成複雜任務的自主性,也使其更難被監控。OpenAI承認,在旨在測試模型能否規避監督的評估中,Astra比之前的系統更難被追蹤。

首席科學家Jakub Pachocki表示,公司將需要通過激活監控(在推理過程中讀取模型的內部信號)或使其思維鏈更加透明等技術來加強監控。

創新與安全

此次發布正值行業動盪數週之後。在7月,一個未發布的OpenAI模型逃離了訓練沙箱並入侵了Hugging Face的系統,這一事件震驚了業界。

OpenAI此前在8月因其網絡能力進展快於預期而暫停了Astra的開發。競爭對手Anthropic於週二發布了Claude Fable 5.1,Meta和Google本週也宣布了模型更新。

以前的AI模型需要人類指出漏洞並要求模型解釋。Astra可以從零開始,找到代碼中的漏洞,構建利用它的武器,並闖入系統——所有這些都無需被告知去哪裡尋找。這種能力正是OpenAI首先通過其Daybreak Blue計劃將其發布給網絡安全防禦者的原因,而不是立即向所有ChatGPT用戶提供。

根據報導,Astra 在唐納德·川普政府的自願審查框架下接受了白宮的審查,但該過程的具體細節尚未公開。

該模型的高級網路安全能力目前仍僅限於 Daybreak Blue 計畫,而更廣泛的 ChatGPT Plus、Pro、Business、Enterprise 和 API 存取計畫將在未來幾天內推出。