Claude Fable 5.1 與 Mythos 5.1:全新功能詳解
Anthropic 最新前沿模型,分兩個安全防護層級——成本更低、代理任務能力更強,現已足以推動真實科學研究。

2026 年 9 月 1 日,Anthropic 發布了 Claude Fable 5.1 與 Claude Mythos 5.1——同一底層模型以兩個安全防護層級推出。Fable 5.1 即日起全面開放;Mythos 5.1 採用相同模型但安全限制較寬鬆,僅限經審核的網絡安全及生命科學機構使用。如果只記一件事:它在長時間代理任務上比 Fable 5 更聰明,對上下文密集型工作而言成本明顯更低,而其研究成果更是最受矚目的亮點。
以下是實際的變化內容,以及這些變化對你構建代理應用的影響。
Fable 5.1 與 Mythos 5.1:同一模型,兩個層級
Anthropic 以兩套安全防護機制封裝同一模型推出,詳見其公告:
- Fable 5.1 — 配備生產級安全防護的正式版本。可透過 API(
claude-fable-5-1)、Claude.ai、Claude Code 和 Claude Cowork,以及 AWS、Google Cloud 和 Azure 存取。 - Mythos 5.1 — 採用相同模型權重但安全限制較寬鬆,僅可透過兩個受信任存取計劃使用:面向防禦性安全工作的網絡安全驗證計劃,以及與美國政府合作推行的生命科學驗證計劃。
命名上的區分至關重要,因為兩個「模型」在某些基準測試上的得分有所不同,純粹是因為 Fable 的安全防護會對特定任務進行干預。Anthropic 表示,未來的安全防護改進應能縮小這一差距。
在 Anthropic 的產品系列中,Fable 位於 Haiku、Sonnet 和 Opus 之上,是能力最強的層級。
相較 Fable 5 的新變化
與 2026 年 6 月發布的 Fable 5 相比,有三點尤為突出:成本、代理能力,以及科學研究表現。
1. 成本更低,主要得益於快取讀取
Fable 5.1 的主要降價來自快取讀取(cache reads)——即模型重複使用已處理過的上下文。Anthropic 將該價格下調 75%,至每百萬 token $0.25。連帶效應如下:
- 按 token 計費的典型工作負載成本降低約 25%。
- 對於快取讀取佔主要費用的高度代理化、上下文密集型工作,最多可降低約 45%。
其他定價維持不變:輸入 token 每百萬 $10,輸出 token 每百萬 $50。因此,如果你運行需要反覆讀取大量上下文的長時程代理,這是實質性的降價;若你的調用較短且以輸出為主,則降幅較小。
Fable 5.1 在低或中等努力程度(Low 或 Medium effort)下的質量與 Fable 5 相當甚至更優——這意味著你通常可以降低努力程度,以更低成本獲得相同結果。(注意默認值有所不同:Claude Code 默認為 High,Claude Cowork 和 Claude.ai 默認為 Medium。)
2. 長時程代理任務能力更強
最明顯的提升在於長時間運行、工具密集型任務。根據 Anthropic 發布的基準測試表,Fable 5.1 在編程、電腦使用和業務工作流程方面均優於 Fable 5:
| 基準測試 | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52.6% | 24.7% | 29.0% | 22.4% |
| Terminal-Bench 4.0 | 55.8%(Mythos 5.1 為 60.9%) | 42.0% | 52.3% | 37.3% |
| GDPval-AA v2(知識工作) | 1853 | 1723 | 1824 | 1711 |
| OSWorld 2.0(嚴格模式) | 41.7% | 36.1% | 39.6% | — |
| Humanity's Last Exam(含工具) | 65.0% | 63.8% | 63.6% | — |
| AutomationBench | 31.4% | 17.1% | 26.9% | 19.6% |
| CursorBench 3.2.0 | 73.4% | 70.5% | 70.0% | 67.2% |
資料來源:Anthropic。最大的單項差距在於代理科學研究,得分較 Fable 5 翻逾一倍。
除基準測試外,定性評價指出 Fable 5.1 在長時間運行中能保持清晰的輸出並專注於任務,且能修復根本原因而非走捷徑。Anthropic 引用了投資公司 Millennium 的案例:Fable 5.1 通過反彙編供應商庫並與核心轉儲(core dump)進行比對,追蹤到一個百萬分之一概率的崩潰問題——這個問題多年來無法解釋,其他任何模型(包括 Fable 5)均無法破解。
3. 科學研究才是真正的亮點
值得重點關注的是研究工作,主要在 Mythos 5.1 層級上完成:
- 蛋白質設計: 在使用開源折疊與設計工具的情況下,Mythos 5.1 針對 12 個靶點設計出高親和力結合物,命中率接近 50%——Anthropic 表示目前典型命中率為 10–15%——並在 Adaptyv Bio 競賽的三個靶點上以約 10 倍的親和力超越最佳參賽作品。
- 行星地圖繪製: Fable 5.1 訓練了一個神經網絡,利用 30 年前 NASA Magellan 雷達的數據,為金星三分之一的區域構建了更高分辨率的高程圖,將細節精度從 10–20 公里提升至 2–3 公里。Anthropic 將以 Creative Commons 授權發布該成果。
- GPU 核心優化: Mythos 5.1 編寫了自定義核心(kernel),在輸出完全相同的情況下,將七個開源基因組學和蛋白質模型的速度提升最多 2.5 倍,令全基因組分析的預估 GPU 成本降低 30–60%。
這些是演示成果,並非同行評審的研究結果——但它們具體、部分經過外部驗證,並指向代理模型的發展方向。
成本、數據保留與安全防護
除原始能力外,Anthropic 還借此次發布回應了三項長期存在的企業訴求。
數據保留。 一個名為 Enterprise Frontier Safeguards(EFS)的新系統,通過將數據存儲在客戶自己的雲端基礎設施上並由客戶進行人工審查,為客戶提供零數據保留級別的隱私保護。該系統將於今年秋季分階段推出;在此之前,符合條件的客戶可在零數據保留的條件下運行 Fable 5.1。
減少誤報。 安全防護現在對良性內容的標記頻率更低——Anthropic 表示網絡安全防護的誤報減少了 60%,Claude Code 用戶每次會話中遭遇的網絡安全防護干預預計也將減少約 60%。Fable 5.1 現在可用於發現軟件漏洞(防禦性工作),但漏洞利用生成、滲透測試和二進制漏洞掃描仍會被路由至 Opus 模型處理。
防蒸餾。 新 API 帳戶不再能夠在保留思維記錄(thinking transcript)的同時編輯 Claude 的先前上下文——這關閉了一種已記錄在案的、用於提取推理軌跡的技術。現有帳戶暫不受影響,但該變更將適用於未來版本的所有用戶。
你應該切換嗎?
按使用場景快速解讀:
- 長時程編程代理 — 很可能值得切換。代理能力的提升加上快取讀取節省,正是針對多步驟、上下文密集型運行而設計的。Cognition(Devin)表示將在發布時把 Opus 5 的流量遷移至 Fable 5.1,從代碼審查開始。
- 短暫、以輸出為主的調用 — 由於降價主要來自快取讀取而非輸出 token,此類場景的降幅較小。切換前請先測試,不要假設一定能節省成本。
- 網絡安全或生命科學研發 — 你會遇到 Fable 將雙重用途任務路由至 Opus 的情況。Mythos 5.1 正是為此而設,但僅可通過經審核的存取計劃使用。
- 注重隱私的企業 — EFS 是你最關注的亮點,但它將在秋季分階段推出,請在承諾使用前確認你所在平台的可用性。
對大多數開發者而言,誠實的總結是:同等頂級質量,過去昂貴的工作負載成本更低,安全防護的干預也更少。
用你自己的 AI 工作團隊來完成這些任務
Fable 5.1 的真正優勢在於長時間運行、工具密集型工作——這與填滿真實工作日的多代理任務形態完全吻合。Eigent 是一款開源的「Cowork」桌面應用,可在本地運行多代理 AI 工作團隊,讓你能夠在自己的電腦上將 Claude 等前沿模型應用於編程、研究和文檔工作流程——如果你對數據保留有顧慮,這是一個天然的理想選擇。查看它如何處理多步驟工程任務,請參閱我們的 GitHub PR 審查工作流程,或立即下載 Eigent 並配置你自己的代理。
Recent Posts

Gemini 3.8 Flash:編程與 AI 代理的全新升級
Gemini 3.8 Flash 在保持低價的同時,大幅提升編程與代理推理能力,並推出全新 3.8 Flash Cyber 變體。涵蓋基準測試、定價及使用方法。

GPT-6 Astra:OpenAI 全新模型的真實能力
GPT-6 Astra 是 OpenAI 的全新旗艦模型。本文詳解其功能、基準測試表現、定價方案,以及 AGI 標題背後的注意事項。

Muse Spark 1.3:Meta 前沿編程與智能代理模型詳解
Muse Spark 1.3 是 Meta 最新的前沿編程與智能代理模型。查看基準測試、定價、xhigh 與 max 版本對比、功能變化及與競品的比較。