前 Ripple 工程師、現任 Anthropic 研究員 Evan Hubinger 估計,人工智慧(AI)在未來十年內消滅人類的可能性超過 10%。
Hubinger 是在回應前 Anthropic 研究員 Jacob Coxon 時發表此番言論。後者於週三宣布從這家 AI 公司辭職,此前他指責業界領先的實驗室在缺乏充分安全保障的情況下,競相開發自我改進的超級智慧。
「Jacob 說得對——我們確實真心相信 AI 可能毀滅所有人類!」Hubinger 在 X 上寫道。「我個人認為在未來十年內機率大於 10%。」
Hubinger 強調,他的估計並非指責 Anthropic 完全忽視這個問題。
「我相信 Anthropic 正在盡最大努力,但我們尚未有解決超級智慧對齊的計畫,而且顯然尚未步入正軌。」他說。
這個略帶聳人聽聞的警告之所以引起廣泛關注,是因為 Hubinger 直接從事他所警告的問題。在 Anthropic,他的工作是對齊壓力測試,這意味著他目前正在監控安全技術在 AI 領域可能失效的方式。
「拿我們的生命賭博」
Coxon 表示,OpenAI 和 Anthropic 都沒有負責任地行事。
「兩家公司都沒有負責任地行事,」他寫道。「他們正直奔自我改進的超級智慧,拿我們的生命賭博。」
根據 Coxon 的說法,前沿系統可能很快就會獲得在受控環境之外施加有意義影響的能力。
「這些很快就會成為超人系統,可以破解任何東西,一夜之間革新任何領域,並獲取真正的權力和資源。」他說。
Coxon 表示,主要實驗室沒有向公眾充分披露與 AI 相關的風險。
儘管如此,Coxon 表示他仍然樂觀地認為,主要 AI 實驗室可以協調以減緩這場競賽。
Hubinger 和 Coxon 的警告發布之際,距離 OpenAI 和 Anthropic 發布一些最強大的模型僅數天。
OpenAI 於 9 月 3 日推出了 GPT-6 Astra,Nvidia 執行長黃仁勳將其描述為超級智慧的到來。
與此同時,Anthropic 推出了 Claude Fable 5.1 和 Claude Mythos 5.1。這些是該公司用於編碼和科學研究的最先進模型。
Ripple 與 Interledger
在成為 AI 對齊領域較為知名的研究員之前,他曾在 2014 年 6 月至 2015 年 8 月期間,在 Ripple 擔任了約一年的軟體工程實習生。
Hubinger 參與了 Interledger 的早期設計,這是一個旨在讓支付在不同帳本和貨幣之間流動的協議。
Hubinger 後來轉向理論電腦科學和 AI 安全,包括在機器智慧研究所的工作。
Ripple 對 AI 的立場
據 U.Today 報導,Ripple 執行長 Brad Garlinghouse 表示,該公司一直在「積極」採用 AI,並預測這可能促進增長。Garlinghouse 承認他對 AI 的樂觀態度在某種程度上是逆向的。
「我對此有些逆向觀點,」Garlinghouse 在 SALT Wyoming 會議上露面時表示。






