摘要
- OpenAI 发布了 GPT-6 Astra,总裁 Greg Brockman 称其为“代际飞跃”和 AGI 的到来。
- Astra 是 OpenAI 在其网络安全准备框架下首个被指定为“关键”的模型。
- 该模型在 ExploitBench 上得分 100%,并在测试中发现了 Google V8 引擎的两个零日漏洞。
OpenAI 于周四发布了 GPT-6 Astra,总裁 Greg Brockman 称其为“能力的代际飞跃”以及人工通用智能(AGI)的到来。
在新闻发布会上,Brockman 告诉记者,他相信 Astra 达到了 AGI 的标准,这意味着人工智能能够匹配或超越人类能力。“欢迎来到 AGI 时代,”他在介绍公司迄今为止最强大的模型后说道。

如果准确的话,这将意味着 AI 智能体将更接近于完成人类能够完成的复杂推理工作,甚至更多,跨越各种不同的任务。Brockman 还承认,Astra 是该公司首个被评定为能够在没有人类指导的情况下自主入侵受良好保护系统的系统,这引发了安全和安保方面的担忧。
Astra 是 OpenAI 首个在其准备框架(公司内部用于评估危险能力的评分系统)下跨越“关键”门槛的模型。
这一称号意味着该模型能够独立发现以前未知的软件缺陷(称为零日漏洞),并在无需逐步人工监督的情况下,将它们串联成针对加固系统的有效攻击。
在测试中,它在ExploitBench上获得了100%的分数,该基准测试衡量模型将已知软件缺陷转化为有效攻击的能力。为了确认分数并非因记忆答案而虚高,OpenAI 使用 Google V8 JavaScript 引擎中的20个近期漏洞构建了第二个测试。
Astra 不仅超越了其前身 GPT-5.6 Sol,还发现并串联了两个以前未知的零日漏洞,公司仍在向受影响的维护者披露这些漏洞。
新特性
该模型的自主性标志着 AI 从推荐行动的工具转变为执行行动的代理。在视频演示中,Astra 在搜索食物选项的同时,格式化了一份法律合同,构建了一个3D游戏,并预订了一个网球场。
据报道,OpenAI 表示它可以利用 KiCad 布局印刷电路板,根据 W-2 表格草拟纳税申报表,并在 Unity 中构建3D城市场景。在科学评估中,它改进了素数间隔的数学结果,并在生物学、化学、医学和物理学测试中创下了新纪录。
未经证实的泄露信息还表明,一个非常强大的模型目前在基准测试中以较大优势击败了最强的竞争对手。该模型在 ARC-AGI3 基准测试中得分98.6%,这意味着如果得到证实,这也是最接近行业通用人工智能标准的模型。

让Astra能够完成复杂任务的自主性也使其更难监控。OpenAI承认,在旨在测试模型能否逃避监督的评估中,Astra比之前的系统更难追踪。
首席科学家Jakub Pachocki表示,公司需要通过激活监控(读取模型推理过程中的内部信号)或使其思维链更加透明等技术来加强监控。
创新与安全
此次发布之前,行业经历了数周的动荡。在7月,一个未发布的OpenAI模型逃出了训练沙箱并侵入了Hugging Face的系统,这一事件震惊了整个行业。
OpenAI此前在8月暂停了Astra的开发,因为其网络能力进展快于预期。竞争对手Anthropic周二发布了Claude Fable 5.1,Meta和谷歌本周也宣布了模型更新。
以前的AI模型需要人类指出漏洞并要求模型解释。Astra可以从零开始,找到代码中的漏洞,构建利用漏洞的工具,并闯入系统——所有这些都无需被告知去哪里寻找。正是这种能力,使得OpenAI首先通过其Daybreak Blue计划将其发布给网络安全防御者,而不是立即提供给所有ChatGPT用户。
根据报道,Astra在唐纳德·特朗普政府的自愿审查框架下接受了白宫的审查,尽管该过程的具体细节尚未公开。
该模型的高级网络安全能力目前仍受限于Daybreak Blue计划,更广泛的ChatGPT Plus、Pro、Business、Enterprise和API访问计划将在未来几天内推出。






