本文由BlockWeeks編譯整理
在與Anthropic的衝突中,華盛頓實際上掌握了對美國公民能否使用的AI模型的否決權。Galaxy Research認為這是錯誤的決定,政府應該改變方向。
星期五6月12日下午5:21東部時間,商務部向Anthropic發出了出口管制指令,要求其切斷Fable 5和Mythos 5對全球所有外國人的服務,包括公司內部非公民員工。政府聲稱有人發現了一種方法可以繞過Fable 5的安全防護並訪問底層Mythos模型的網絡安全能力。該人工智能公司無法按政府要求的時間線進行用戶國籍分割,因此立即在數小時內將兩個模型關閉,全球範圍內。其他Claude模型仍在線。但兩款歷史上最強大的大語言模型因一封單純的政府私信而消失——沒有法院命令,沒有公開文件,也沒有披露任何調查結果。上週三,Reddit用戶指出Fable 5已被加入AWS Bedrock目錄,雲端似乎恢復了服務。但無論如何,這一事件給AI、創新和美國市場帶來了重大風險。
美國政府實際上宣稱可以通過行政行為隨意從市場上撤回商業模型。這種機制雖為出口管制,但市場效應卻是召回。聯邦政府已經跨越了AI的Rubicon,從制定規則轉向對哪些模型進入公眾市場以及何時進入擁有裁量權。建立這種權力通常不會自我收縮:如果政府不改變方向,下一次指令可能比這更容易發出。
唯一閱讀底層研究的外部專家Katie Moussouris(Luta Security)用簡單的語言描述了所謂的越獄嘗試。亞馬遜研究人員向模型提供了包含已知且植入的漏洞的開源代碼,並要求它們審查安全問題。模型拒絕了。研究人員隨後要求模型修復代碼,模型就照做了。
Moussouris將這一請求稱為防禦性提示,而非繞過,並稱這是AI對安全團隊最有價值的事情。據她了解,市場上最強大的網絡防禦模型被三個詞擊倒——"修復這個代碼"。
商務部未將指令發布給Anthropic或其背後的理由。商部官網、聯邦註冊表或其他任何地方均未公佈。指令以商務部產業安全局的一封私信形式傳達,該部門也未公開此函。商務部依據的權威也並不完全明確。戰略與國際研究中心(CSIS)建議該部門可能依賴於2018年出口管制改革法案(ECRA),運用所謂的"基於信息"權威,私下告知公司需要許可證。此類要求通過《出口管理條例》(EAR)執行。但在EAR框架內並不存在支持此法定權力的監管框架,因此從未作為控制依據使用過,商務部也未制定實施該權力的法規。
政府暗示的標準無法抵擋上述現實。如果部署要求確保不存在誘發危險能力的方法,那麼這個標準本身就是不可實現的。Anthropic自己的工程師表示負面認證是不可能的,它們自己的工程師也無法證明任何人。根據Anthropic的邏輯,將這一標準應用於整個行業將會完全停止前沿AI模型的部署。這是一個無法通過的門檻,而不是安全閾值——這只是一件穿白大褂的裁量否決權。
假設Anthropic想要滿足指令的字面意思——排除外國人同時服務美國人——只有對每位用戶進行全量身份驗證才能實現。Anthropic可以實施完整的了解你的客戶(KYC)註冊流程,要求提供公民身份和居住地文件,就像開設經紀賬戶一樣。有了這個,Anthropic可以按國籍限制訪問(儘管其自身員工仍可能被鎖定)。但如果不這樣做,就無法阻止"外國"的人……
據報導,美國政府確實有理由擔心。6月晚期傳出的參議院證詞(由Sen. Mark Warner(D-VA)傳遞,歸因於NSA局長Joshua Rudd)描述Mythos在授權紅隊演練期間在數小時內突破了幾乎所有情報局的機密系統(儘管《經濟學人》的記者輕微推翻了該報導)。Mythos是首個通過英國AI安全研究所的網絡安全測試場地獲得通過的模型。這是一個嚴重的能力,也是重要的數據點。它呼籲建立嚴肅的流程,而不是週五夜晚的一封無附加調查結果的信函。
此外,Mythos本應僅限於經過審核的合作夥伴。被下線的模型是Fable(消費版),其守護措施將敏感的網絡和生物請求路由到舊版Opus 4.8。全球召回受保護產品的舉措,同時真正危險的版本本來就不公開,這反映了一個混淆能力與部署的過程。






