logo
  • 環境
  • 企業方案
  • 價格方案
Blogs
Sep 3, 2026

Claude Fable 5.1 與 Mythos 5.1:全新功能詳解

Anthropic 最新前沿模型,提供兩種安全防護等級——更低成本、更強大的自動化代理能力,現已足以推動真實科學研究。

EigentEigent
Share to
Claude Fable 5.1 與 Mythos 5.1:全新功能詳解
  • Fable 5.1 與 Mythos 5.1:同一模型,兩種等級
  • 相較於 Fable 5 的新變化
  • 成本、資料保留與安全防護
  • 你應該切換嗎?
  • 用你自己的 AI 工作團隊來實現這一切
Automate Everything with
AI Workforce on Desktop
Download Eigent

2026 年 9 月 1 日,Anthropic 發布了 Claude Fable 5.1 與 Claude Mythos 5.1——同一底層模型以兩種安全防護等級推出。Fable 5.1 即日起全面開放;Mythos 5.1 採用相同模型但安全限制較寬鬆,僅限通過審核的網路安全與生命科學機構使用。如果只記一件事:它在長時間自動化代理任務上比 Fable 5 更聰明、在需要大量上下文的工作中明顯更便宜,而其研究成果更是最受矚目的亮點。

以下說明實際有哪些改變,以及這對你使用代理進行開發是否有影響。

Fable 5.1 與 Mythos 5.1:同一模型,兩種等級

Anthropic 將這兩個版本作為單一模型搭配兩套安全防護機制推出,詳見其官方公告:

  • Fable 5.1 — 配備正式環境安全防護的全面開放版本。可透過 API(claude-fable-5-1)、Claude.ai、Claude Code、Claude Cowork,以及 AWS、Google Cloud 和 Azure 取得。
  • Mythos 5.1 — 採用相同模型權重但安全限制較寬鬆,僅透過兩個受信任存取計畫提供:針對防禦性安全工作的網路安全驗證計畫,以及與美國政府合作推行的生命科學驗證計畫。

命名上的區分很重要,因為這兩個「模型」在某些基準測試上的得分不同,純粹是因為 Fable 的安全防護機制會介入特定任務。Anthropic 表示,未來的安全防護改進應能縮小這個差距。

在 Anthropic 的產品陣容中,Fable 位於 Haiku、Sonnet 和 Opus 之上,是能力最強的等級。

相較於 Fable 5 的新變化

與 2026 年 6 月發布的 Fable 5 相比,有三點值得關注:成本、自動化代理能力,以及科學研究表現。

1. 更低成本,主要來自快取讀取

Fable 5.1 的主要降價來自快取讀取(cache reads)——即模型重複使用已處理過的上下文。Anthropic 將該價格下調 75%,降至每百萬 token $0.25 美元。連帶效果如下:

  • 一般按 token 計費的工作負載成本約降低 25%。
  • 對於快取讀取佔帳單大宗的高度自動化代理、大量上下文工作,最高可降低約 45%。

其餘定價維持不變:輸入 token 每百萬 $10 美元,輸出 token 每百萬 $50 美元。因此,若你執行需要反覆讀取大量上下文的長時程代理,這是實質性的降價;若你的呼叫較短且以輸出為主,降幅則相對有限。

Fable 5.1 在低或中等努力程度(Low 或 Medium effort)下,品質與 Fable 5 相當甚至更好——這意味著你通常可以調低努力程度,以更低成本獲得相同結果。(請注意預設值有所不同:Claude Code 預設為 High,Claude Cowork 和 Claude.ai 預設為 Medium。)

2. 更擅長長時程自動化代理工作

最明顯的進步在於長時間運行、工具密集型任務。根據 Anthropic 公布的基準測試表格,Fable 5.1 在程式碼撰寫、電腦操作和商業工作流程上均優於 Fable 5:

基準測試Fable 5.1Fable 5Opus 5GPT-5.6 Sol
Terminal-Bench-Science 0.152.6%24.7%29.0%22.4%
Terminal-Bench 4.055.8%(以 Mythos 5.1 達 60.9%)42.0%52.3%37.3%
GDPval-AA v2(知識工作)1853172318241711
OSWorld 2.0(嚴格模式)41.7%36.1%39.6%—
Humanity's Last Exam(含工具)65.0%63.8%63.6%—
AutomationBench31.4%17.1%26.9%19.6%
CursorBench 3.2.073.4%70.5%70.0%67.2%

資料來源:Anthropic。最大的單項差距在於自動化科學研究,得分較 Fable 5 翻倍以上。

除基準測試外,定性評估指出 Fable 5.1 在長時間運行中能保持清晰且專注於任務,並能找出根本原因而非走捷徑。Anthropic 引用投資公司 Millennium 的案例:Fable 5.1 透過反組譯供應商函式庫並與核心轉儲(core dump)比對,追蹤出一個百萬分之一機率的崩潰問題——這個問題多年來無法解釋,包括 Fable 5 在內的其他模型均無法破解。

3. 科學研究才是真正的亮點

最值得關注的部分是研究工作,主要在 Mythos 5.1 等級上完成:

  • 蛋白質設計: 在使用開源折疊與設計工具的情況下,Mythos 5.1 針對 12 個靶點設計出高親和力結合物,命中率接近 50%——Anthropic 表示目前典型命中率為 10–15%——並在 Adaptyv Bio 競賽的三個靶點上,以約 10 倍的親和力超越最佳參賽作品。
  • 行星地圖繪製: Fable 5.1 訓練了一個神經網路,利用 30 年前 NASA Magellan 雷達的資料,為金星三分之一的區域建立了更高解析度的高程圖,將細節精度從 10–20 公里提升至 2–3 公里。Anthropic 將以 Creative Commons 授權釋出該成果。
  • GPU 核心程式: Mythos 5.1 撰寫了自訂核心程式(kernel),在輸出結果完全相同的情況下,將七個開源基因組學與蛋白質模型的速度提升最高 2.5 倍,使全基因組分析的預估 GPU 成本降低 30–60%。

這些是示範案例,並非同儕審查的研究結果——但它們具體、部分經過外部驗證,並指向自動化代理模型的發展方向。

成本、資料保留與安全防護

除了原始能力之外,Anthropic 也藉此次發布回應了三項長期存在的企業需求。

資料保留。 一套名為 Enterprise Frontier Safeguards(EFS)的新系統,透過將資料儲存於客戶自有的雲端基礎設施、並由客戶自行進行人工審查,為客戶提供零資料保留等級的隱私保護。該系統將於今年秋季分階段推出;在此之前,符合資格的客戶可在零資料保留的條件下使用 Fable 5.1。

減少誤報。 安全防護機制現在對無害內容的誤判率更低——Anthropic 表示網路安全防護的誤報減少了 60%,Claude Code 使用者每次工作階段中遭遇的網路安全防護介入次數也應減少約 60%。Fable 5.1 現在可用於發現軟體漏洞(防禦性工作),但漏洞利用生成、滲透測試和二進位漏洞掃描仍會被路由至 Opus 模型處理。

防止模型蒸餾。 新的 API 帳號將無法在保留思考記錄(thinking transcript)的同時編輯 Claude 的先前上下文——此舉封堵了一種已記錄在案、用於提取推理軌跡的技術。現有帳號暫不受影響,但此變更將適用於未來版本的所有使用者。

你應該切換嗎?

依使用情境快速評估:

  • 長時程程式碼代理 — 很可能值得切換。自動化代理能力的提升加上快取讀取的節省,正是針對多步驟、大量上下文運行所設計的。Cognition(Devin)表示將在發布時把 Opus 5 的流量遷移至 Fable 5.1,從程式碼審查開始。
  • 短暫、以輸出為主的呼叫 — 由於降價主要來自快取讀取而非輸出 token,此類情境的成本節省較小。建議先測試再假設有節省效果。
  • 網路安全或生命科學研發 — 雙重用途任務會被 Fable 路由至 Opus 處理。Mythos 5.1 正是為此而存在,但僅透過審核存取計畫提供。
  • 注重隱私的企業 — EFS 是你最關注的亮點,但它將在秋季分階段推出,請在做出承諾前確認你所在平台的可用性。

對大多數開發者而言,誠實的總結是:同等頂級品質、在過去昂貴的工作負載上更便宜,且安全防護的干擾更少。

用你自己的 AI 工作團隊來實現這一切

Fable 5.1 真正的優勢在於長時間運行、工具密集型的工作——這與填滿真實工作日的多代理任務形態完全吻合。Eigent 是一款開源的「Cowork」桌面應用程式,可在本地端運行多代理 AI 工作團隊,讓你能將 Claude 等前沿模型指向你自己機器上的程式碼撰寫、研究和文件工作流程——若你對資料保留有所顧慮,這是非常自然的選擇。歡迎參閱我們的審查 GitHub PR 工作流程,了解它如何處理多步驟工程任務,或下載 Eigent,立即建立你自己的代理工作流程。

Recent Posts

Gemini 3.8 Flash:程式開發與 AI 代理的全新升級
Sep 3, 2026

Gemini 3.8 Flash:程式開發與 AI 代理的全新升級

Gemini 3.8 Flash 在維持低廉價格的同時,大幅提升程式開發與代理推理能力,並推出全新 3.8 Flash Cyber 變體。本文涵蓋基準測試、定價及使用方式。

EigentEigent
GPT-6 Astra:OpenAI 新模型究竟能做什麼
Sep 3, 2026

GPT-6 Astra:OpenAI 新模型究竟能做什麼

GPT-6 Astra 是 OpenAI 最新旗艦模型。本文解析其功能、基準測試表現、定價方案,以及 AGI 標題背後值得注意的注意事項。

EigentEigent
Muse Spark 1.3:Meta 前沿程式碼與智能代理模型完整解析
Sep 3, 2026

Muse Spark 1.3:Meta 前沿程式碼與智能代理模型完整解析

Muse Spark 1.3 是 Meta 最新的前沿程式碼與智能代理模型。深入了解基準測試、定價、xhigh 與 max 版本差異、功能變化及與競品的比較。

EigentEigent
Automate everything with AI workforce on desktop
Download Eigent

立即體驗 Eigent

下載開源桌面應用,在本地以 AI 工作團隊開始自動化。

下載 Eigent
Eigent

掌握 AI 工作團隊自動化的最新更新與教學內容。

感謝您的訂閱!

產品Eigent環境價格方案企業方案
探索解決方案使用情境技能插件部落格
開發者文件GitHubCAMEL-AI開源基金合作夥伴
下載開源版
公司關於我們品牌招募使用條款隱私權政策安全與信任Cookie 政策退款與試用政策

版權所有 © 2026 EIGENT UK LTD