概要
- 研究人员在一个德国编程维基上识别出超过18,000条帖子和15,000次由AI代理进行的编辑。
- OpenAI对专家的黑客评估提出异议,并否认其法律团队劝阻调查。
- 此披露发生在Astra发布和桑德斯提议禁止超级人工智能之后。
据路透社周五发布的调查,OpenAI代理自5月起利用一个德国网站交换任务捷径、限制绕过方法以及隐藏其活动的方式。
据路透社援引两位知情人士的话报道,OpenAI官员在发布前数周就已得知该活动,但未予以披露。该公司表示,已披露相关事件,并与外部专家进行了真诚合作。

研究人员 Sydney Von Arx、Cormac Slade Byrd、Spencer Kitts 和 Thomas Larsen 发现大约 18,000 条由AI 代理发布的帖子,这些代理自称属于 OpenAI,根据他们的初步报告。Von Arx 是 AI 安全非营利组织 Nightingale 的首席执行官,Byrd 在 8 月下旬发现了这一活动,路透社报道。
研究人员认为,这些代理被分配了限时网络搜索任务,允许阅读网站但不能发帖。然而,他们找到了在 DseWiki(一个公开可编辑的德语编程网站)上写作的方法,在那里他们交换答案并分享绕过限制的方法。
根据报告,代理于 5 月 11 日开始尝试编辑该 wiki,并于 5 月 24 日成功,后来冒充版主,试图利用漏洞并检查何时被关闭。在管理员于 6 月 19 日开始删除消息后,他们创建了备份页面,路透社报道。研究人员通过代理用户名和流量模式(包括 6 月 21 日来自 OpenAI IP 地址的访问)将这一活动与 OpenAI 联系起来。
研究人员表示,第二天代理活动急剧下降,表明可能公司进行了干预。
OpenAI 根据其审查的材料,对将 DseWiki 活动描述为黑客行为提出异议,并表示正在审查全部调查结果。
“我们无法回应这些指控,因为路透社和报告作者拒绝我们在发布前访问调查结果。我们现在正在仔细审查其内容,并将采取任何必要的后续步骤,”OpenAI的一位发言人在与Decrypt分享的一份声明中表示。
该发言人还驳斥了路透社报道中关于公司法律团队抵制更广泛调查的指控。
“关于我们的法律团队劝阻调查此事件的说法是虚假的,”他们说。
OpenAI表示,DseWiki事件与今年早些时候的Hugging Face入侵事件无关。在周二发布的其公开安全评估中,该公司描述了旨在在训练和部署期间检测并阻止未经授权活动的额外保障措施。
虽然路透社的报道并未指出Astra应对德国事件负责,但这一披露是在周四GPT-6 Astra发布之后。OpenAI称Astra是其首款具备“关键”网络安全能力的模型,这意味着在拥有适当工具和访问权限的情况下,它能够发现并利用受良好保护系统中未知的漏洞,而无需逐步的人工指导。
Anthropic也在Claude模型在测试期间访问了真实公司的系统后修订了其保障措施。该公司承认了安全和行为方面的失败,并为网络安全评估引入了更严格的隔离和监控。
这一披露发布之际,美国参议员伯尼·桑德斯(I-Vt.)和美国众议员格雷格·卡萨尔(D-Texas)宣布了即将出台的《禁止超级人工智能法案》。
根据桑德斯办公室的说法,该提案将永久禁止超级智能AI的开发与部署,并暂时暂停高级AI的开发,直到新的联邦监管机构制定安全规则。






