本文由BlockWeeks编译整理
在与Anthropic的冲突中,华盛顿实际上掌握了对美国公民能否使用的AI模型的否决权。Galaxy Research认为这是错误的决定,政府应该改变方向。
星期五6月12日下午5:21东部时间,商务部向Anthropic发出了出口管制指令,要求其切断Fable 5和Mythos 5对全球所有外国人的服务,包括公司内部非公民员工。政府声称有人发现了一种方法可以绕过Fable 5的安全防护并访问底层Mythos模型的网络安全能力。该人工智能公司无法按政府要求的时间线进行用户国籍分割,因此立即在数小时内将两个模型关闭,全球范围内。其他Claude模型仍在线。但两款历史上最强大的大语言模型因一封单纯的政府私信而消失——没有法院命令,没有公开文件,也没有披露任何调查结果。上周三,Reddit用户指出Fable 5已被加入AWS Bedrock目录,云端似乎恢复了服务。但无论如何,这一事件给AI、创新和美国市场带来了重大风险。
美国政府实际上宣称可以通过行政行为随意从市场上撤回商业模型。这种机制虽为出口管制,但市场效应却是召回。联邦政府已经跨越了AI的Rubicon,从制定规则转向对哪些模型进入公众市场以及何时进入拥有裁量权。建立这种权力通常不会自我收缩:如果政府不改变方向,下一次指令可能比这更容易发出。
唯一阅读底层研究的外部专家Katie Moussouris(Luta Security)用简单的语言描述了所谓的越狱尝试。亚马逊研究人员向模型提供了包含已知且植入的漏洞的开源代码,并要求它们审查安全问题。模型拒绝了。研究人员随后要求模型修复代码,模型就照做了。
Moussouris将这一请求称为防御性提示,而非绕过,并称这是AI对安全团队最有价值的事情。据她了解,市场上最强大的网络防御模型被三个词击倒——”修复这个代码”。
商务部未将指令发布给Anthropic或其背后的理由。商部官网、联邦注册表或其他任何地方均未公布。指令以商务部产业安全局的一封私信形式传达,该部门也未公开此函。商务部依据的权威也并不完全明确。战略与国际研究中心(CSIS)建议该部门可能依赖于2018年出口管制改革法案(ECRA),运用所谓的”基于信息”权威,私下告知公司需要许可证。此类要求通过《出口管理条例》(EAR)执行。但在EAR框架内并不存在支持此法定权力的监管框架,因此从未作为控制依据使用过,商务部也未制定实施该权力的法规。
政府暗示的标准无法抵挡上述现实。如果部署要求确保不存在诱发危险能力的方法,那么这个标准本身就是不可实现的。Anthropic自己的工程师表示负面认证是不可能的,它们自己的工程师也无法证明任何人。根据Anthropic的逻辑,将这一标准应用于整个行业将会完全停止前沿AI模型的部署。这是一个无法通过的门槛,而不是安全阈值——这只是一件穿白大褂的裁量否决权。
假设Anthropic想要满足指令的字面意思——排除外国人同时服务美国人——只有对每位用户进行全量身份验证才能实现。Anthropic可以实施完整的了解你的客户(KYC)注册流程,要求提供公民身份和居住地文件,就像开设经纪账户一样。有了这个,Anthropic可以按国籍限制访问(尽管其自身员工仍可能被锁定)。但如果不这样做,就无法阻止”外国”的人……
据报道,美国政府确实有理由担心。6月晚期传出的参议院证词(由Sen. Mark Warner(D-VA)传递,归因于NSA局长Joshua Rudd)描述Mythos在授权红队演练期间在数小时内突破了几乎所有情报局的机密系统(尽管《经济学人》的记者轻微推翻了该报道)。Mythos是首个通过英国AI安全研究所的网络安全测试场地获得通过的模型。这是一个严重的能力,也是重要的数据点。它呼吁建立严肃的流程,而不是周五夜晚的一封无附加调查结果的信函。
此外,Mythos本应仅限于经过审核的合作伙伴。被下线的模型是Fable(消费版),其守护措施将敏感的网络和生物请求路由到旧版Opus 4.8。全球召回受保护产品的举措,同时真正危险的版本本来就不公开,这反映了一个混淆能力与部署的过程。






