Claude Opus 5 API 概覽
Claude Opus 5 API 是 Anthropic 的 Opus 級模型,面向複雜的代理式程式設計、企業自動化、深度推理、長上下文分析與高價值知識工作。Anthropic 於 2026 年 7 月 24 日發布 Claude Opus 5,API 型號為 claude-opus-5,提供 1M-token 的上下文視窗、128k 的同步最大輸出、預設開啟的自適應思考(adaptive thinking),以及針對 effort、fallback、提示快取與工具變更的新控制項。
技術規格
| Item | Specification |
|---|---|
| Model name | Claude Opus 5 |
| API model ID | claude-opus-5 |
| Provider | Anthropic |
| Native CometAPI endpoint | POST /v1/messages |
| OpenAI-compatible CometAPI endpoint | POST /v1/chat/completions |
| Input types | Text and image input |
| Output type | Text output |
| Context window | 1M tokens |
| Maximum output tokens | 128k tokens on the synchronous Messages API; up to 300k output tokens on supported Message Batches API requests with Anthropic's output-300k-2026-03-24 beta header |
| Adaptive thinking | Yes; on by default |
| Effort control | low, medium, high, xhigh, and max; high is the default on the Claude API and Claude Code |
| Official Anthropic pricing | $5 per million input tokens and $25 per million output tokens |
| Prompt cache pricing | $6.25 per million 5-minute cache writes, $10 per million 1-hour cache writes, and $0.50 per million cache hits |
| CometAPI listed pricing | $4 per million input tokens and $20 per million output tokens, according to the CometAPI Claude Opus 5 model page checked on July 26, 2026 |
| Reliable knowledge cutoff | May 2026 |
什麼是 Claude Opus 5?有哪些新變化?
Claude Opus 5 是緊接 Claude Opus 4.8 之後的下一款 Opus 模型。Anthropic 將其定位為面向複雜代理式程式設計與企業工作的首選模型,而 Claude Fable 5 則在追求極致智能、對價格或延遲不那麼敏感的工作負載中具備更高能力。實際上的差異在於性價比:Anthropic 表示 Opus 5 以官方 Token 價格的一半接近 Fable 5 的能力,並在與 Opus 4.8 相同官方價格下有大幅提升。
對開發者而言,最大的改變不僅是更強的模型字串,其 API 行為也改變,會影響到生產整合。自適應思考預設啟用,而 effort 參數成為在深度、速度與 Token 使用之間進行權衡的主要方式。該模型也支援更低的提示快取最小值(512 tokens)、Beta 的對話中途工具變更、Beta 的伺服端回退行為,以及 Claude API 上的 Fast 模式。同時需要注意的是,在 xhigh 或 max 的 effort 下禁用 thinking 會返回 400 錯誤;如果應用程式必須禁用 thinking,應使用 high 或更低的 effort。
Claude Opus 5 的基準表現
Claude Opus 5 擁有來自 Anthropic、ARC Prize 與 Artificial Analysis 的強力基準支援。Anthropic 報告稱,Opus 5 在 Frontier-Bench v0.1 上的表現較 Claude Opus 4.8 提升超過兩倍,且每個任務的成本更低;在最大 effort 下,其 CursorBench 3.2 分數比 Claude Fable 5 的峰值僅低 0.5%,並在特定的知識工作與電腦使用成本效益比較中優於其他模型。
獨立基準供應者提供了更具體的數字。ARC Prize 報告顯示,Claude Opus 5 High 在 ARC-AGI-3 上取得 30.16%;Opus 5 Max 在 ARC-AGI-1 上取得 97.5%,在 ARC-AGI-2 Semi-Private 上取得 90.4%。Artificial Analysis 報告稱,Claude Opus 5 Max 的 Intelligence Index 得分為 61,在最大 effort 下的 Terminal-Bench v2.1 為 89%,GDPval-AA v2 為 1861 Elo,AA-Briefcase 為 1720 Elo。
| Benchmark or metric | Claude Opus 5 result |
|---|---|
| ARC-AGI-3 Public Demo, High effort | 30.16% |
| ARC-AGI-1, Max effort | 97.5% |
| ARC-AGI-2 Semi-Private, Max effort | 90.4% |
| Artificial Analysis Intelligence Index, Max effort | 61 |
| Terminal-Bench v2.1, Max effort | 89% |
| GDPval-AA v2, Max effort | 1861 Elo |
| AA-Briefcase, Max effort | 1720 Elo |
| Output speed, Max effort | 52.6 tokens per second |
| Time to first answer token, Max effort | 68.04 seconds |
這些結果表明,當工作流程偏好規劃、驗證、工具使用、多步完成與長上下文推理時,Claude Opus 5 的表現最強。同時也顯示在高推理設定下的延遲權衡,因此生產團隊應以每個成功任務的成本來評估,而非僅看基準排名。
Claude Opus 5 的功能與亮點
1M-Token 上下文,適配大型工作負載
Claude Opus 5 支援 1M-token 的上下文視窗,既是預設也是最大上下文大小。這使其適合倉庫規模的程式庫、長篇法律合約、多文件研究、財務工作簿、事故時間線、客服紀錄與企業知識庫分析。
預設啟用的自適應思考
不同於需要明確啟用自適應思考的 Claude Opus 4.8,Claude Opus 5 預設開啟。模型會自行決定每回合投入多少思考,而開發者則透過 effort 來調整行為。
用於成本與品質控制的 Effort 等級
Claude Opus 5 支援 low、medium、high、xhigh 與 max 的 effort 等級。Anthropic 建議從預設的 high 開始,當品質維持時再降低;對於最困難、長期跨度的程式設計或代理任務,則提升等級。
更強的代理式程式設計與驗證
Anthropic 表示,與 Opus 4.8 相比,Opus 5 在代理式程式設計、長期跨度任務、程式碼審查與找錯方面有躍升。在實務上,當 AI 代理需要檢視檔案、呼叫工具、執行檢查、修正錯誤,並完成多檔案工作而非只撰寫片段程式碼時,這是應該測試的模型類別。
更佳的短上下文提示快取經濟性
可快取提示的最小長度從 Claude Opus 4.8 的 1,024 tokens 降至 Claude Opus 5 的 512 tokens。對重複的代理工作階段、共享的系統提示、工具描述或長專案上下文而言,提示快取可降低重複輸入成本,因為快取命中價格低於新輸入 token。
對話中途工具變更
Claude Opus 5 支援 Beta 的對話中途工具變更。開發者可在回合間新增或移除可用工具,同時保留提示快取;當代理從研究轉向程式設計、從程式設計轉向測試,或從分析轉向部署時,這相當實用。
針對拒絕情況的伺服端回退
Anthropic 的 Beta fallbacks 參數可用於安全分類器拒絕類別的預設回退模式。這不是普遍可用或速率限制的重試系統;它專為 Anthropic 對某些拒絕類別有建議回退模型的情境而設計。
Claude Opus 5 vs Claude Sonnet 5 vs Opus 4.8 vs Fable 5
| Dimension | Claude Opus 5 | Claude Sonnet 5 | Claude Opus 4.8 | Claude Fable 5 |
|---|---|---|---|---|
| Best role | Complex agentic coding and enterprise work | Faster high-intelligence production work | Previous Opus baseline and migration fallback | Highest broadly released Claude capability |
| API model ID | claude-opus-5 | claude-sonnet-5 | claude-opus-4-8 | claude-fable-5 |
| Official Anthropic price | $5/M input, $25/M output | $2/M input and $10/M output through August 31, 2026; $3/M input and $15/M output starting September 1, 2026 | $5/M input, $25/M output | $10/M input, $50/M output |
| Comparative latency | Moderate | Fast | Not listed in the current latest-model comparison table; prior Opus tier baseline | Slower |
| Adaptive thinking | On by default | On by default | Available but not default for requests unless specified | Always on |
| Effort support | low, medium, high, xhigh, max | low, medium, high, xhigh, max | low, medium, high, xhigh, max | low, medium, high, xhigh, max |
| Knowledge cutoff | May 2026 | January 2026 | Not shown in Anthropic's current latest-model table | January 2026 |
| When to choose it | Use when Opus-level accuracy matters but Fable 5 is too expensive or slow | Use for high-volume coding, support, document, and agent workflows | Keep for pinned legacy behavior, fallback, or migration comparison | Use when the highest available Claude capability justifies the higher price |
此外,它們的最大輸入與上下文視窗相同。
在這組產品中,Claude Opus 5 是最均衡的高級選擇。Claude Sonnet 5 更適合對流量成本敏感的生產流量;Claude Opus 4.8 在 Opus 5 發布後主要作為舊版基線;而當成本是次要考量時,Claude Fable 5 是更高能力的選擇。
如何在 CometAPI 上使用 Claude Opus 5 API
步驟 1:建立 CometAPI 金鑰
登入 CometAPI,開啟 API 金鑰頁面,建立金鑰,並將其儲存在環境變數(例如 COMETAPI_KEY)中。請勿將生產環境 API 金鑰放入客戶端程式碼、公開儲存庫、螢幕截圖或技術支援工單。
步驟 2:呼叫原生的 Anthropic Messages 端點
當你需要 Claude 特有行為(例如自適應思考、effort 控制、提示快取、工具使用、網頁搜尋、串流與 Anthropic 風格的回應內容區塊)時,請使用原生的 /v1/messages 路由。
步驟 3:使用相容 OpenAI 的端點以實現可攜式路由
當你的應用已使用相容 OpenAI 的 SDK,或想在同一層路由下比較 Claude Opus 5 與 GPT、Gemini、DeepSeek、Kimi、Qwen 及其他模型時,請使用 /v1/chat/completions。
在生產環境中,請以真實提示同時測試兩個端點,記錄輸入 tokens、輸出 tokens、快取行為、effort 等級、延遲、拒絕行為,以及最終任務成功率。對於 Claude 特有參數,以 Anthropic 的官方文件為準;而 CometAPI 的文件則用於了解該請求結構如何被轉送。
Claude Opus 5 能做到什麼
Claude Opus 5 最適合重視正確性與執行到底,而非追求廉價一次性答案的應用。開發者可以打造倉庫規模的程式設計代理、遷移助理、錯誤調查工具、程式碼審查系統、長上下文研究助理、法律與財務文件分析器、科學文獻流程、自動升級的技術支援機器人、試算表與簡報生成工具,以及自主運營助理。
它也可作為多模型架構中的升級模型。產品可將一般支援或抽取流量導向 Claude Sonnet 5 或更低成本模型,並將模糊、有風險或高價值的回合升級至 Claude Opus 5。此模式可讓高階模型專注在更深層推理會改變結果的工作上。
在 CometAPI 上,請將 Claude Opus 5 API 用於困難的程式設計代理、根因調試、多檔案重構、程式碼審查、企業文件分析、財務建模、法律審閱、科學推理、長上下文研究、專業報告生成與營運自動化。最強的部署模式是選擇性升級:以 Claude Opus 5 對照 Claude Sonnet 5、Claude Fable 5 與非 Claude 的替代方案進行測試,然後依據每個被接受結果的成本(而非僅憑模型名聲)來路由每類工作負載。
為何在 CometAPI 上使用 Claude Opus 5?
當團隊希望使用單一 API 金鑰、統一計費、模型比較,並更容易在供應商間遷移時,CometAPI 對 Claude Opus 5 很有幫助。CometAPI 同時提供原生的 Anthropic Messages 端點與相容 OpenAI 的 Chat Completions 端點,因此團隊可以在進階工作流程中選擇 Claude 原生控制項,或維持可攜式的整合形態以進行多模型路由。
限制
Claude Opus 5 是高級推理模型,並非每個請求的預設選擇。在較高的 effort 設定下,它可能消耗更多 tokens,且首個 Token 的輸出延遲比輕量模型更高。Artificial Analysis 報告在最大 effort 測量下,首個回答 token 的時間為 68.04 秒,這使得路由與 effort 選擇對用戶端應用相當重要。
開發者也應避免假設不受支援的行為。Anthropic 未披露模型參數數量,且模型權重為專有。Fast 模式在 Claude API 上屬於研究預覽,並非所有雲端平台都可用。伺服端回退與對話中途工具變更為 Beta 功能。對於安全工作流程,Anthropic 表示 Opus 5 可支援有益的弱點發現用例,但對於像是基於二進位的弱點掃描、滲透測試與漏洞利用生成等高風險任務,會採取保護措施。