**TLDR:**Claude Opus 5,於 2026 年 7 月 24 日發佈,是 Anthropic 最強大的 Opus 級模型。它在程式編碼、代理型任務、知識工作與推理方面接近 Claude Fable 5 的表現,且定價與 Opus 4.8 相同(每百萬 tokens 輸入 $5 / 輸出 $25,為 Fable 5 的一半)。它具備 1M-token 的上下文視窗、128K 的最大輸出、2026 年 5 月的知識截止、預設啟用自適應思考、Fast 模式,以及顯著的效率提升。非常適合複雜的代理型編碼與企業工作,現已成為 Claude Max 的預設模型,並是 Pro 上的頂級模型。可透過官方 Claude API 或 CometAPI 等統一平台存取,簡化多模型整合
Claude Opus 5 一覽
| 功能 | 詳細資訊 |
|---|---|
| 發佈日期 | July 24, 2026 |
| API 模型 ID | claude-opus-5 |
| 定位 | 面向複雜代理型編碼與企業工作的日常高階模型 |
| 定價 | $5 / MTok 輸入,$25 / MTok 輸出(與 Opus 4.8 相同) |
| Fast 模式 | 約 2.5× 速度,$10 / $50 每 MTok(僅限 Claude API,研究預覽) |
| 上下文視窗 | 1M tokens(預設與最大值) |
| 最大輸出 | 128K tokens(透過 Message Batches API 測試版可達 300K) |
| 知識截止 | May 2026(最新的 Claude 模型) |
| 思考 | 預設開啟自適應思考 |
| 努力等級 | low / medium / high(預設)/ xhigh / max |
| 可用性 | Claude API、claude.ai、Bedrock、Vertex AI、Microsoft Foundry |
| 資料保留 | 支援零資料保留(不同於 Fable 5 的限制) |
來源: Anthropic Models Overview,
關鍵要點
- Claude Opus 5 是 Anthropic 面向公開使用者最先進的 Opus 模型,在 Frontier-Bench v0.1(43.3%)上達到 SOTA,並在 GDPval-AA 與 CursorBench 上取得強勁表現,成本僅為 Fable 5 的一半。
- 定價維持每百萬 tokens 輸入 $5 / 輸出 $25(標準);Fast 模式以兩倍價格換取約 2.5× 速度。
- What’s New in Claude Opus 5 報告稱,主要升級包括預設延展思考、努力刻度(low 至 max)、更好的代理持續性、對話中途工具變更(測試版)與自動安全回退。
- 適合複雜編碼、長視野代理、知識工作、生物/研究與需要高智能但不想承擔前沿定價的企業流程。
- 可在 Claude.ai(Max 預設、Pro 最強)、Claude API(
claude-opus-5)、Amazon Bedrock、Google Cloud、Microsoft Foundry,以及 CometAPI 等聚合平台上取得。
什麼是 Claude Opus 5?
Claude Opus 5 是 Anthropic 最新且最強大的 Opus 等級模型,於 2026 年 7 月 24 日發佈。Anthropic 將其描述為「一個深思熟慮且主動的模型,以半價接近 Claude Fable 5 的前沿智慧。」
它位於前沿的 Fable 5 / Mythos 5 等級之下(於 2026 年 6 月發佈),但相較 Claude Opus 4.8 帶來明顯躍升。該模型針對長時間運行代理、複雜軟體工程、專業知識工作、科學研究與多步推理進行優化。
不同於純粹的漸進升級,Opus 5 在編碼準確度、自我驗證、判斷、效率、一致性、視覺輸出品質與對齊方面都有更大幅度提升(參見 Anthropic announcement references via Reddit official post)。Anthropic 將其定位為大多數高端場景的務實日常主力——當你需要強勁智慧、又不想承擔 Fable 5 的完整成本或限制時的首選模型。
它成為 Claude Max 的新預設,並是 Claude Pro 訂閱中可用的最強模型。官方文件 建議在複雜代理型編碼與企業工作中優先嘗試 Claude Opus 5。
關鍵差異包括:
- 接近前沿的表現,價格為 Fable 5 的一半。
- 更高效率(以更少 tokens 與更低延遲達到相當或更高品質)。
- 更好的自我修正與自我驗證行為。
- 更佳的多代理協作與長視野任務完成能力。
- 迄今為止對齊度最高的 Claude 模型,減少欺騙行為。
效能基準
Anthropic 表示,Claude Opus 5 在其公開可用模型中於多項編碼與知識工作評估上樹立新標竿,常常能匹配或超越 Fable 5,同時使用更少資源或以更低的每任務成本達成。
部分結果(主要來自 Anthropic 的評估與第三方報告):
| 基準測試 | Claude Opus 5 | Claude Fable 5 | Claude Opus 4.8 | 備註 / 其他模型 |
|---|---|---|---|---|
| Frontier-Bench v0.1 | 43.3% | 33.7% | 18.7% | SOTA;較先前的 Opus 提升逾一倍 |
| GDPval-AA v2 (Elo) | 1,861 | 1,747 | 較低 | 強勁的知識工作表現 |
| CursorBench 3.2 (max effort) | 與 Fable 峰值相差不超過 0.5% | 峰值 | — | 每任務成本約為其一半 |
| ARC-AGI 3 | ~30.2%(為次佳的 3 倍) | — | ~1.5% | 新穎問題求解 |
| SWE-bench Verified | 96.0% | 95.0% | 88.6% | 高編碼表現 |
| SWE-bench Pro | 79.2% | 80.3% | 69.2% | 具競爭力 |
| Zapier AutomationBench | 約為次佳通過率的 1.5× | — | — | 端到端商務任務 |
| OSWorld 2.0 (computer use) | 強勁(部分報告顯示以約 1/3 成本優於 Fable 最佳) | — | — | 電腦使用任務 |
其他質性優勢包括:
- 更好的多檔案功能開發、大型重構與端到端功能實作,較少出現存根或不完整解。
- 在金融建模與科學任務(如蛋白質序列效應、分子結構推斷)上更高準確度;在部分內部評估中以更少輪次與更低延遲完成。
- 更強的圖示與生成式視覺輸出品質。
- 改善的多代理協調與更少衝突。
獨立評論(如 來自 Cursor)指出,其智慧水準接近 Fable,且具有 Opus 的速度與成本。效能會隨努力等級而變化——較高的努力可在最艱難任務上進一步縮小與 Fable 5 的差距。
這些結果顯示,Opus 5 特別適合真實世界中的軟體工程代理與專業知識工作,而非僅僅追求學術榜單。
Opus 5 與平台的新變化
Claude Opus 5 為在 Claude API 與 Claude 平台上構建的開發者帶來多項實用改進:
努力與思考控制
思考預設啟用。開發者可透過 effort 參數(low、medium、high、xhigh、max)控制深度。更高努力能在困難任務上提升表現,但會增加 tokens 與延遲;較低努力則優化速度與成本,同時往往仍優於先前模型。注意,在最高努力等級下禁用思考會受到限制。
對話過程中的工具變更(測試版)
開發者可在單次對話中新增或移除工具,而不會使提示快取失效。這提升了多階段代理工作流程的成本效率與安全性。
自動回退
當 Opus 5(或 Fable 5)上的安全分類器阻擋某個請求時,API 可自動路由至另一個合適模型,讓最終使用者獲得有幫助的回應,而非錯誤。
Fast 模式(研究預覽)
相較預設約 2.5× 的生成速度,價格為標準的兩倍。適合延遲敏感的應用。
上下文與輸出
完整的 1M-token 上下文視窗為預設(亦為最大)。同步最大輸出為 128K tokens;Message Batches 透過測試版標頭支援更高上限。在超大視窗下仍能保持良好的指令遵循與推理品質。
其他平台說明
現已可在 Claude API、Claude.ai(Max 計畫預設、Pro 最強)、Amazon Bedrock(於支援地區預設零資料保留)、Google Cloud、Microsoft Foundry 與各類第三方聚合器上使用。提示快取、批次 API 折扣與標準 Claude 工具依然適用。
這些變化使 Opus 5 更適合用於生產級的代理系統、長時間編碼會話與企業級整合。
Claude Opus 5 定價:價格-效能分析
標準 API 定價與 Opus 4.8 相同:
- 輸入:每百萬 tokens $5
- 輸出:每百萬 tokens $25
這約為 Claude Fable 5($10 / $50)的一半。提示快取(寫入費用較高、命中 $0.50/百萬)與批次 API(5 折)可進一步改善重複或非同步工作負載的有效成本。Fast 模式為 $10 / $50。
真正的價值主張在於「價格-效能」。由於 Opus 5 常能以更少的 tokens、更少輪次或更高成功率完成複雜任務(且與 Fable 5 具競爭力),每次成功工作的成本可顯著降低。有報告指出,在達到同等推理品質時 tokens 減少 26%,並在多步專業任務上帶來可觀的時間節省。
比較表:Claude 模型(約略標準定價)
| 模型 | Input $/M | Output $/M | 上下文 | 定位 | 最佳使用情境 |
|---|---|---|---|---|---|
| Claude Haiku 4.5 | ~$1 | ~$5 | 200K | 快速且便宜 | 高量簡單任務 |
| Claude Sonnet 5 | ~$2–3 | ~$10–15 | 1M | 均衡表現 | 多數日常進階工作 |
| Claude Opus 5 | $5 | $25 | 1M | 以 Opus 定價獲得近前沿能力 | 複雜編碼、代理、知識工作 |
| Claude Fable 5 | $10 | $50 | 1M | 前沿(公開的 Mythos 級) | 最具野心的長視野代理 |
| Claude Mythos 5 | 受限 | 受限 | 1M | 最高能力(受限存取) | 專門高風險研究 |
不同雲端供應商或聚合器的價格可能略有差異。對許多團隊而言,高能力、大上下文與 Opus 等級定價的組合,使 Opus 5 成為新的高端默認選擇。
誰應該使用 Claude Opus 5?
- 軟體工程師與代理開發者:在多檔案修改、重構、根因除錯與長時間運行的編碼代理上表現出色。非常適合 Cursor、Claude Code 與自訂代理框架等工具。
- 企業知識工作者與團隊:據報最強的知識工作表現;適用於研究綜整、財務建模、文件密集分析與多步商務流程自動化。
- 研究人員與領域專家(生物學、化學等):在科學推理任務上有進展;先前在較高等級模型上被阻擋的生物相關請求可能會路由至此。
- 打造 AI 功能的產品與平台團隊:在可靠智能、良好安全屬性、自動回退與面向生產的 API 功能之間取得平衡。
- 注重成本的前沿能力使用者:對曾預設使用 Opus 4.x 或考慮 Fable 5 但追求更佳日常經濟性的使用者而言,是理想選擇。
對於簡單聊天、高量低複雜度任務(請使用 Sonnet 或 Haiku),或最困難的資安 / 長視野代理研究問題(在可用且合適時考慮 Fable / Mythos),則未必必要。
如何取得 Claude Opus 5
- Claude.ai 網站與 App(Max 預設、Pro 最強)
- 官方 Claude API(claude-opus-5)
- Amazon Bedrock、Google Cloud Vertex AI / Gemini Enterprise Agent Platform、Microsoft Foundry
- 各類聚合器與閘道
若開發者想要單一與 OpenAI 相容的端點、統一計費、存取逾 500 個模型(Claude 系列 + GPT、Gemini、Grok 等),且常具競爭性的有效價格,CometAPI 是務實選擇。CometAPI 提供一個 claude 訊息 URL https://api.cometapi.com/v1/messages),因此現有 SDK 只需更改 base URL 與 API key。它同時支援 OpenAI 風格的聊天補全與 Anthropic Messages API 的 Claude 模型特性,包括適用時的 effort/思考控制。
在 CometAPI 上的典型流程:
- 註冊並取得 API 金鑰(新用戶通常可獲得免費點數)。
- 將客戶端指向 CometAPI 的 base URL。
- 使用模型 ID claude-opus-5(或以 CometAPI 模型面板上列示的精確字串為準)。
- 在單一儀表板中監控多供應商的使用量與成本。
此方式可降低供應商綁定、簡化多模型試驗(例如將簡單任務路由至更便宜的模型、困難任務路由至 Opus 5),並為已管理多家 AI 供應商的團隊減少營運開銷。請務必在 CometAPI 模型頁確認最新的模型可用性與定價,因為聚合器費率可能與標示價格不同。
若你需要最新的原生功能、特定區域的資料駐留,或不透過中介的零資料保留保證,直接使用 Anthropic 或雲端供應商仍較為合適。
結論
Claude Opus 5 代表了 Anthropic 面向公開使用陣容的一項重要實務性進步。它在開發者與企業最重視的編碼與知識工作上,提供接近 Fable 5 的智慧水準,同時保留 Opus 4.8 的定價,並加入有用的生產級功能,因此非常有望成為廣泛專業工作流程中的高能力默認模型。
無論你透過官方 Claude API、主要雲平台,或 CometAPI 等統一閘道存取,憑藉大上下文、強勁代理行為、努力控制與良好的價格-效能比,Claude Opus 5 已成為 2026 年中最具吸引力的選項之一。與所有前沿模型一樣,請在你的特定工作負載上進行評估、在不同努力設定下監控 token 使用,並持續關注 Anthropic 的系統卡與文件以獲取最新的安全與能力資訊。
