Anthropic 於 2026 年 9 月 1 日 發佈 Fable 5.1,作為其面向程式設計與知識工作、最強大的可用一般模型。該模型瞄準長程任務:數小時的編碼、多步驟研究、文件密集的專業工作,以及能反覆使用工具並保留大量上下文的代理式流程。
Claude Fable 5.1 結合了100 萬 token 的上下文視窗、最高 128K 的輸出 token、文字與圖片輸入,以及始終開啟的自適應思考。基礎定價維持每 MTok 輸入 $10、輸出 $50;重要的成本變化是每 MTok 快取讀取 $0.25。
Claude Fable 5.1 規格一覽
以下規格來自 Anthropic 的模型文件。價格為 Anthropic 的標價,應與任何 CometAPI 價格分開看待。
| 官方規格 | Claude Fable 5.1 |
|---|---|
| 發佈與模型 ID | 2026 年 9 月 1 日 — claude-fable-5-1 |
| 主要角色 | 高要求推理與長程代理式工作 |
| 上下文與最大輸出 | 100 萬 token 上下文 — 最高 128K 輸出 |
| 輸入 → 輸出 | 文字與圖片 → 文字 |
| 思考與預設 API 努力等級 | 自適應思考,始終開啟 — 高努力等級 |
| 可靠的知識截止日期 | 2026 年 6 月 |
| 標價 | 每 MTok 輸入 $10 — 輸出 $50 — 每 MTok 快取讀取 $0.25 |
除了數字本身,另有兩點值得注意。100 萬的上下文視窗是預設提供,而非特殊的長上下文等級。自適應思考始終開啟,effort 控制模型投入的工作量;Anthropic 表示預設在 Claude Code 為 High,在 Claude Cowork 與 Claude.ai 為 Medium。
什麼是 Claude Fable 5.1
Claude Fable 5.1 是 Anthropic 面向需要在多個步驟中持續推理、使用工具並保留上下文的工作而打造的前沿模型。它不是針對短問答互動,而是為持續執行而設計:探索程式碼庫、運行終端工作流、綜整大型文件集,以及完成可能耗時數小時的專業任務。
其核心組合是100 萬 token 的上下文視窗與最高 128K 輸出、文字與圖片輸入,以及在整個請求過程中保持啟用的自適應思考。這讓代理能在同一工作上下文中保留冗長指令、來源資料、工具結果與中間決策,並依每一步的難度動態調整推理投入。
最佳適用情境是高價值的工作流,當失敗、返工或上下文遺失的成本高於高階 token 價時更具意義。範例包括倉庫規模的工程作業、多階段研究、電腦操作型代理、合規密集的文件分析,以及伴隨大量重複工具呼叫的商業自動化。對於常規分類、高量抽取或延遲敏感的聊天,更低成本的 Claude 等級可能仍是更好的起點。
預設的 Fable 使用需要 30 天的資料保留以用於安全監測。符合條件的企業客戶可在 Enterprise Frontier Safeguards 推出期間使用零資料保留;Anthropic 表示規劃中的架構會將受監測的資料儲存在客戶控制的雲端基礎設施中。受監管團隊在部署前應確認帳戶的特定條款。
Claude Fable 5.1 vs. Fable 5:有何變化?
5.1 版本並非整齊一致的能力躍升。最明顯的變化是重複上下文的成本更低,且在代理式研究、終端編碼與商業工作流上的執行力大幅提升,而一般工具輔助推理的變化較小。
| 面向 | Claude Fable 5 | Claude Fable 5.1 | 變化 |
|---|---|---|---|
| 基礎輸入 / 輸出 | $10 / $50 每 MTok | $10 / $50 每 MTok | 無變化 |
| 快取讀取 | $1.00 每 MTok | $0.25 每 MTok | 降低 75% |
| Terminal-Bench-Science 0.1 | 24.7% | 52.6% | +27.9 個百分點 |
| Terminal-Bench 4.0 | 42.0% | 55.8% | +13.8 個百分點 |
| AutomationBench | 17.1% | 31.4% | +14.3 個百分點 |
| HLE with tools | 63.8% | 65.0% | +1.2 個百分點 |
基礎價格不變,快取讀取費用下降 75%
輸入仍為每 MTok $10,輸出仍為每 MTok $50,因此表面費率未下降。實質變化是快取讀取價格從每 MTok $1.00 降至 $0.25。這對反覆載入包含程式庫、政策、文件、工具定義與先前狀態的長前綴之代理影響最大。即使新鮮輸入與輸出費率不變,其每個完成工作流的成本也可能下降。
代理式科學研究的提升最大
Terminal-Bench-Science 0.1 從 24.7% 提升至 52.6%,上升 27.9 個百分點,且超過先前分數的兩倍。這是 Fable 5.1 改善長程執行力的最強證據:規劃研究、操作工具、解讀結果,並從中間錯誤中恢復。
終端編碼與商業自動化有實質提升
Terminal-Bench 4.0 從 42.0% 提升至 55.8%,AutomationBench 從 17.1% 提升至 31.4%。這些結果指向更佳的端到端任務完成率,而不僅是更好的程式碼生成。團隊可在需要模型檢查環境、選擇行動、使用工具並在多步驟中驗證成果的工作流中獲得最大收益。
一般推理的提升小於執行力
Humanity’s Last Exam with tools 從 63.8% 移至 65.0%,僅 1.2 個百分點,而 CursorBench 增加 2.9 個百分點。因此,無法據此宣稱所有能力均等提升。更應將 Fable 5.1 理解為以執行為核心的升級,其最顯著的收益出現在必須透過工具與長任務鏈來持續推理的情境中。
比較結果: 現有的 Fable 5 使用者若運行長程、工具密集的代理,升級理由最明確:大幅更便宜的快取讀取,以及在偏執行的基準上更少失敗。使用短提示或一般知識任務的團隊,應在遷移前將較小的提升與延遲與總成本進行驗證。
Claude Fable 5.1 的基準測試表現
Anthropic 的官方基準表將新模型與其前代 Claude Opus 5 以及 GPT-5.6 Sol 比較。下列選定行涵蓋研究、編碼、知識工作、電腦操作與自動化。
| 官方基準 | Claude Fable 5.1 | Claude Fable 5 | Claude Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52.6% | 24.7% | 29.0% | 22.4% |
| Terminal-Bench 4.0 | 55.8% | 42.0% | 52.3% | 37.3% |
| GDPval-AA v2 | 1853 | 1723 | 1824 | 1711 |
| OSWorld 2.0 partial | 77.9% | 72.9% | 75.4% | — |
| OSWorld 2.0 strict | 41.7% | 36.1% | 39.6% | — |
| AutomationBench | 31.4% | 17.1% | 26.9% | 19.6% |
| CursorBench 3.2.0 | 73.4% | 70.5% | 70.0% | 67.2% |
上方圖表為自官方文件複製之 Anthropic 官方基準圖,非本地重繪。Anthropic 指出 Terminal-Bench-Science 的標準誤約為 ±3.5–4.5 個百分點,且在評測期間啟用了生產防護措施,因此對小幅差異應審慎看待。

來源:Anthropic 官方 Fable 5.1 基準圖表
如何解讀基準結果
這些分數不應被視為模型品質的普適衡量。Anthropic 在啟用生產防護的情況下評估了 Claude Fable 5.1,部分基準任務可能受到防護介入的影響。Terminal-Bench-Science 也對每個模型報告約 ±3.5–4.5 個百分點的標準誤。
OSWorld 2.0 的結果使用了基準作者在 2026 年 8 月發佈的任務版本,因此不應與更早任務版本的分數直接比較。
Claude Fable 5.1 價格
輸入與輸出定價
Anthropic 對 Claude Fable 5.1 的標價為每 MTok 輸入 $10、輸出 $50。CometAPI 上的 Claude Fable 5.1 API 為每 MTok 輸入 $8、輸出 $40,較官方標價降低 20%。這些為用量計費;投入生產前請查看即時的模型頁面,因平台價格與計費規則可能變動。
提示快取定價
Anthropic 將 5 分鐘快取寫入定價為每 MTok $12.50、1 小時快取寫入為每 MTok $20,而快取讀取為每 MTok $0.25。該讀取費率較 Fable 5 的每 MTok $1 低 75%,因此重複使用程式庫、政策、工具定義或先前狀態的長程代理,比起短且一次性的提示受益更多。
代理工作流成本範例
一個代理在 1,000 個步驟中,每步讀取 150K 的快取 token,將消耗 150 MTok 的快取讀取。在 Fable 5.1 每 MTok $0.25 的費率下,該部分成本為 $37.50;在 Fable 5 每 MTok $1 的費率下,則為 $150——節省 $112.50。新鮮輸入、輸出、快取寫入與平台費用仍需另計,因此團隊應比較每個成功完成工作流的總成本,而非僅看快取成本。
為何快取定價會改變代理經濟性
傳統請求的費用多數花在新鮮輸入與輸出上。代理有所不同:每次工具步驟都可能重新讀取包含政策、程式碼、文件、工具定義與較早狀態的大型快取前綴。Anthropic 的快取讀取費率下調 75% 對長迴路的影響尤為顯著。
例如,一個代理在 1,000 個步驟中重讀 150K 的快取 token,將消耗 1.5 億個快取讀取 token。在每 MTok $1 的費率下,該部分成本為 $150;在每 MTok $0.25 的費率下,成本為 $37.50。此例不含新鮮輸入、輸出、快取寫入與平台費用,但能說明為何在基礎價格不變的情況下,完成任務的成本仍可能更低。
Anthropic 估計,對典型的 token 計費工作負載約降低 25% 成本,對高度代理式的工作負載最高可達約 45%。這些是工作負載組合的估算,而非對每個 token 的通用折扣。
Claude Fable 5.1 vs Opus 5 vs Sonnet 5
前沿模型代表能力上限,但 Anthropic 建議大多數工作負載以 Opus 等級作為起點。當重視吞吐與延遲時,Sonnet 等級仍是更快且更低成本的選擇。更深入的雙模型分析可參考 CometAPI 的 Fable vs Sonnet 比較。
| 面向 | Claude Fable 5.1 | Claude Opus 5 | Claude Sonnet 5 |
|---|---|---|---|
| 上下文視窗 | 1M | 1M | 1M |
| 最大輸出 | 128K | 128K | 128K |
| 輸入 / 輸出標價 | $10 / $50 | $5 / $25 | $2 / $10 |
| 相對延遲 | 較慢 | 適中 | 快速 |
| 最佳適用 | 最艱難的長程代理與推理 | 預設的高階起點 | 以速度與成本為優先的高吞吐工作 |
選擇結果: 從能滿足任務需求的較低成本等級開始。僅在生產評估顯示前沿模型能提高通過率、減少重試或降低每個成功工作流的總成本時,再行升級。
開發者在遷移時必須測試的變更
新模型多數情況下可直接替換,但 Anthropic 文件列出三項破壞性變更,會影響代理框架與長對話。
| 遷移變更 | 會發生什麼事 | 開發者需採取的行動 |
|---|---|---|
| 強制工具選擇 | 設定 tool_choice = any 或指定工具將回傳 HTTP 400 | 使用 auto,並以指示引導模型;必要時計入嚴格的輸入結構(schema) |
| 跨模型切換的思考區塊 | 舊版模型無法讀取新的思考區塊 | 測試路由器,並預期在向後路由時推理區塊會被丟棄 |
| 編輯較早的對話輪次 | 變更的歷史可能使思考區塊失效 | 將歷史保持僅追加,或使用支援的壓縮模式 |
同時測試逐訊息努力等級、回合作用域的系統訊息、工具呼叫之間的進度更新、快取行為與內容溯源,並在導入生產流量前進行確認。泛用的 SDK 設定與請求範例仍以現有的 Fable API 教學 為佳。
誰該使用 Claude Fable 5.1?
Claude Fable 5.1 最適合在乎持續推理與成功完成率、而非最低延遲或最低 token 價的工作負載。當任務跨越多個步驟、反覆使用工具,或具有足夠商業價值、以致於減少失敗與返工可抵消高階模型成本時,請選用它。
- 倉庫規模的工程:除錯、遷移、多檔重構、測試執行與無人值守的編碼代理
- 多步驟研究:搜尋、證據評估、執行分析並產出有根據的最終報告
- 大型文件與專業工作:合約、技術文件、財務資料、試算表與簡報工作流
- 電腦操作與自動化:需要多次工具呼叫、介面導覽、驗證並從中間錯誤中恢復的任務
對於常規分類、高量抽取或延遲敏感的聊天,請先從 Claude Opus 5 或 Claude Sonnet 5 開始
透過 CometAPI 的可用性
截至 2026 年 9 月 4 日,CometAPI 模型頁面顯示 Claude Fable 5.1 已上線且可用。模型 ID 為 claude-fable-5-1。
- 建立或登入 CometAPI 帳號,並在儀表板產生 API 金鑰。
- 選擇 Claude Fable 5.1,並將
claude-fable-5-1作為模型 ID。 - 透過與 Anthropic 相容的
/v1/messages端點,或與 OpenAI 相容的/v1/chat/completions端點發送請求。 - 在遷移流量前,進行貼近生產的評估以確認延遲、上下文處理、工具行為與計費。
開發者也可透過 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry,以及 AWS 上的 Claude Platform 直接使用該模型。
結論
Claude Fable 5.1 更應被理解為一次執行力的升級。最具說服力的證據不是未變的 100 萬上下文視窗或每 MTok $10/$50 的高階標價,而是在代理式研究、終端編碼與自動化上的大幅提升,並結合大幅更便宜的快取讀取。
當任務困難、長程且足夠有價值,以至於更少失敗能支撐高階定價時,請選用它。對於常規、高量或延遲敏感的工作,先從較低成本的等級開始,僅在你的評估顯示完成成果率可量化提升時再行升級。
常見問題
Claude Fable 5.1 是否可透過 API 使用?
可以。Anthropic 表示 Claude Fable 5.1 自 2026 年 9 月 1 日起已啟用。可透過 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 與 AWS 上的 Claude Platform 使用。
Claude Fable 5.1 API 的費用是多少?
Anthropic 官方標價為每 MTok 輸入 $10、輸出 $50。CometAPI 目前為每 MTok 輸入 $8、輸出 $40。部署前請查看即時路由價格。
Claude Fable 5.1 的上下文視窗有多大?
該模型支援 100 萬 token 的上下文視窗與最高 128K 的輸出 token。大容量並不代表可免去對檢索品質、延遲與成本的生產級測試。
從 Claude Fable 5 到 5.1 有哪些變化?
最大且實用的變化是更強的代理式研究與終端執行力、快取讀取價格從每 MTok $1 降至 $0.25、逐訊息的努力等級控制、進度更新,以及內容溯源。遷移也需要測試強制工具選擇、跨模型切換的思考區塊與被編輯的對話歷史。
Claude Fable 5.1 是否優於 Claude Opus 5?
不適用於所有工作負載。Fable 5.1 是面向高要求長程工作的更高能力選項,但較慢且更昂貴。Anthropic 建議多數工作負載先從 Claude Opus 5 開始,當高努力等級評估仍不足時再升至前沿模型。
我可以透過 CometAPI 使用 Claude Fable 5.1 嗎?
可以。CometAPI 目前將 Claude Fable 5.1 列為可用,模型 ID 為 claude-fable-5-1,並提供與 Anthropic 相容與 OpenAI 相容的端點。
Claude Fable 5.1 是否支援強制工具使用?
否。Anthropic 文件指出,tool_choice 設為 any 或指定工具將回傳 HTTP 400。請使用 auto 或 none,再透過指示與嚴格的輸入結構引導工具選擇。
