簡介
- Anthropic 於 9 月 1 日發布了 Claude Fable 5.1 和 Claude Mythos 5.1,在 Terminal-Bench-Science 0.1 上得分 52.6%,而 Fable 5 為 24.7%;在 Terminal-Bench 4.0 上得分 55.8%,而 Fable 5 為 42.0%。
- 緩存讀取成本現在降低 75%,典型工作負載成本降低約 25%,高度代理型工作負載成本降低高達 45%,基礎定價保持不變,仍為每百萬 tokens 10 美元/50 美元。
- Fable 5.1 不包含在 Pro 計劃或標準 Team 席位中,這些計劃使用用量積分運行;Max 和高級 Team 或 Enterprise 席位則包含該模型,每週限額最多可使用 50%。
Anthropic 於週二發布了 Claude Fable 5.1 和 Claude Mythos 5.1,這是自 6 月 9 日 Fable 5 發布以來,Mythos 級模型系列的首次更新。
該公司聲稱,新的 AI 模型是世界上「最先進」的編碼和知識工作模型,而此時距離發布週期開始僅三個月,期間已發生過 18 天的出口管制停擺、夏季中期的訂閱訪問價格爭議,以及 7 月發布的 Claude Opus 5 在價格上低於 Fable 5。

据 Anthropic 称,Fable 5.1 和 Mythos 5.1 是同一个底层模型,只是附加了不同的安全过滤器。Fable 5.1 对任何拥有 Claude 账户的用户普遍可用。Mythos 5.1 仍仅限于经过审查的网络安全和生命科学专业人士使用,通过 Anthropic 的网络安全验证计划和生命科学验证计划,该计划是 Project Glasswing 访问通道的继承者,该通道曾限制 Mythos 5 的使用。
基准测试实际衡量的是什么
Anthropic 的头条数字来自 Terminal-Bench-Science 0.1,这是一个基准测试,测试 AI 代理能否在命令行环境中执行科学研究任务,以通过率计分。
Fable 5.1 达到 52.6%,而 Fable 5 为 24.7%,Opus 5 为 29.0%,是其前身的两倍多。
Terminal-Bench 4.0 测试通过终端进行的代理编码——在多步骤命令行会话中编写、运行和调试代码,以正确完成任务的百分比计分。Fable 5.1 得分 55.8%,高于 Fable 5 的 42.0%,也领先于 Opus 5 的 52.3%。
Mythos 5.1 在较轻的网络安全过滤器下运行,在同一测试中得分 60.9%;Anthropic 表示,这一差距反映了其安全防护措施拦截并重新路由到 Opus 4.8 的任务。

在人類最後考試(Humanity's Last Exam)中,這是一項跨學科推理測試,由數十個學術領域的專家級問題組成,並以通過率計分,Fable 5.1 在未使用外部工具時達到 60.9%,使用工具時達到 65.0%,兩者均領先 Opus 5,顯示這是 Anthropic 在學術用途上最先進的模型。

它勝過 Opus 5 的地方,以及數學變得更模糊的地方
Opus 5 於七月推出,其每個 token 的價格僅為 Fable 5 的一半,同時在大多數主要基準測試中表現優於 Fable 5,實際上使旗艦模型對大多數付費用戶而言變得多餘。
Fable 5.1 扭轉了這一局面:它在 Anthropic 發布的每一項基準測試中都擊敗了 Opus 5,包括 Opus 5 先前勝過 Fable 5 的那些測試。
但 Fable 5.1 每個 token 的價格仍是 Opus 5 的兩倍——輸入 $10、輸出 $50,而 Opus 5 分別為 $5 和 $25。Token 是模型能處理的基本資訊量(通常約為平均英文單字的三分之二),公司按使用量付費,因為繁重的工作流程通常很快就會耗盡訂閱方案中設定的配額。
Anthropic 對該模型的宣傳重點在於推理強度等級,而非原始分數:它表示,以低或中推理強度運行 Fable 5.1,其表現可媲美或超越 Fable 5 先前的結果,且成本更低,同時將最高強度等級保留給那些難倒其他所有模型的問題。
對於例行工作而言,完全跳過 Opus 5 的論點會隨著強度調低而減弱。
存取權限的劃分與 Anthropic 調整條款數月後適用於 Fable 5 的方式相同。在 Pro 方案及標準 Team 或 Enterprise 席位中,Fable 5.1 完全從按 API 費率計費的預付使用額度中扣除,因為它不屬於這些方案的每週限額。在 Max 方案及高級 Team 或 Enterprise 席位中,它作為訂閱的標準部分包含在內,最多可佔每週使用量的 50%。
Claude Fable 5.1 現已於 Claude API、Amazon Bedrock、Google Cloud 和 Microsoft Foundry 上提供,模型 ID 為「claude-fable-5-1」。






