TLDR: Claude Opus 5 API 使用模型 ID claude-opus-5,並透過 CometAPI 同時支援 Anthropic 風格的 Messages 請求與與 OpenAI 相容的 chat completions。全新 Claude 原生應用建議使用 Messages 端點;既有 OpenAI SDK 應用可用 chat completions 端點。加入 effort 控制、快取、串流與路由,確保僅將需高階能力的工作交給高級模型處理。
重要摘要
- 於 2026 年 7 月 24 日發布;API ID 為 claude-opus-5。
- 以 Opus 價格提供近乎 Fable 5 的能力($5 input / $25 output 每 MTok)。
- 在 Frontier-Bench(較 Opus 4.8 提升超過 2 倍)、CursorBench(距 Fable 5 約 0.5%)、ARC-AGI-3(為次佳的 3 倍)、OSWorld 2.0(以約 1/3 成本超越 Fable 5)與知識工作基準上有明顯進步。
- 1M context,最大輸出 128K(透過 Batch API beta 可達 300K),預設開啟自適應思考,Fast 模式(約 2.5× 速度、2× 價格)。
- 新 API 功能:對話中變更工具(beta)、預設 fallback、較低的 prompt 快取門檻(512 tokens)。
- 最適合需要高能力、但不想承擔 Fable 5 成本或資料保留限制的開發者、企業與團隊。
- 可於 Claude API、claude.ai(Pro/Max/Team/Enterprise)、Amazon Bedrock、Google Cloud、Microsoft Foundry,以及 CometAPI 等統一閘道取得。
什麼是 Claude Opus 5?
Claude Opus 5 是 Anthropic 在 Claude 家族 Opus 等級的最新產品——此等級被定位為「最強能力」大小級別,針對高要求的專業與代理型工作負載。它承襲自 Claude Opus 4.8(2026 年 5 月 28 日發布),定位介於受限的 Mythos 級模型(Mythos 5 及其面向公眾的對應 Fable 5)之下,並高於 Sonnet 與 Haiku 等級。
Anthropic 將其描述為「一個深思熟慮且主動積極的模型,在以半價提供的情況下,能力接近 Claude Fable 5 的前沿智慧」。它被明確設計為日常的高智力模型,而非只保留給最極端的長期代理任務(在某些與網路安全相關的評估中,Fable 5 或 Mythos 5 仍具優勢)。
主要特點包括:
- 更強的代理行為:能自我檢查、謹慎迭代、找出根因而非頭痛醫頭,並能在多步任務中持續推進。
- 更高效率:在相同或更佳結果下,較以往 Opus 模型使用更少 tokens(例如在某些專業工作負載中約少 26%)。
- 更佳的安全與對齊:Anthropic 稱其為「至今最對齊的模型」,欺騙性行為率更低,且在合法的編碼與安全審查任務中更少出現不必要的安全干預(對許多開發者工作流程,分類器預期比在 Fable 5 上減少約 85% 的介入)。
- 廣泛的多模態輸入支援(文字 + 圖像/PDF),輸出為文字,與近期 Claude 模型一致。
- 原生支援工具、電腦操作與長上下文推理,在整個 1M tokens 視窗下以標準價格提供(無長上下文附加費)。
總之,Claude Opus 5 在保留讓 Opus 受青睞於生產環境的成本結構下,縮小了先前 Opus 世代與 Anthropic 真正前沿產品之間的大部分實務差距。
Claude Opus 5 一覽
| Feature | Details |
|---|---|
| Release Date | July 24, 2026 |
| API Model ID | claude-opus-5 |
| Positioning | 面向複雜代理型編碼與企業工作的日常高階模型 |
| Pricing | $5 / MTok input, $25 / MTok output(與 Opus 4.8 相同) |
| Fast Mode | 約 2.5× 速度,$10 / $50 每 MTok(僅 Claude API,研究預覽) |
| Context Window | 1M tokens(預設與最大) |
| Max Output | 128K tokens(透過 Message Batches API beta 可達 300K) |
| Knowledge Cutoff | May 2026(最當前的 Claude 模型) |
| Thinking | 預設開啟自適應思考 |
| Effort Levels | low / medium / high(預設)/ xhigh / max |
| Availability | Claude API、claude.ai、Bedrock、Vertex AI、Microsoft Foundry |
| Data Retention | 支援零資料保留(不同於 Fable 5 的限制) |
API 有哪些新內容?
Claude Opus 5 帶來多項實務 API 改進與行為變更,影響生產部署。
核心規格
- Model ID: claude-opus-5
- Context: 1M tokens(無較小變體)
- Max output: 128K tokens(同步);透過 Message Batches API,搭配 beta header output-300k-2026-03-24 可達 300K
- 預設啟用自適應思考
- Effort 參數影響更明顯(low → max)
新功能
- 對話中變更工具(beta) 可在回合之間新增或移除工具,同時保留 prompt 快取。使用 beta header mid-conversation-tool-changes-2026-07-01。這能降低成本並提升安全性,因為可在不再需要時關閉工具。
- 預設 fallback 模式(beta) 新的 fallbacks 參數在 beta 中支援「default」模式,搭配 server-side-fallback-2026-07-01 header。若安全分類器拒絕請求且 Anthropic 對該拒絕類別有建議的 fallback,API 會在 fallback 模型上重試並回傳單一回應。此機制僅適用於安全分類器拒絕,不適用於速率限制、過載或伺服器錯誤。
- 較低的 prompt 快取門檻 可快取的提示長度從 Opus 4.8 的 1,024 tokens 降至 512 tokens。
- Fast 模式(研究預覽) 僅於 Claude API 提供。大約以雙倍價格($10/$50 每 MTok)提供約 2.5× 的預設速度。
行為變更(遷移時重要)
- 在 xhigh 或 max 時不能停用思考。 這是破壞性行為變更。在 Opus 5 上,thinking: {"type": "disabled"} 僅在 high 或更低 effort 時被接受。若在 xhigh 或 max 停用思考,請求會回傳 400 錯誤。Anthropic 建議盡量維持思考啟用,並改以較低 effort 控制成本。
- 預設開啟思考: Opus 5 預設以自適應思考運作。模型會自行決定每回合隱性推理的投入量,主要由 effort 參數控制。由於 max_tokens 同時是思考與可見輸出的硬性上限,從 Opus 4.8 遷移至 Opus 5 時,生產應用應重新檢視 max_tokens。
- 模型在代理式會話中更常敘述進度、更容易委派子代理、更徹底地驗證自身工作,且預設回覆更長。
- 移除舊提示中的傳統驗證指令——它們可能導致過度驗證。
遷移相當直接:將模型 ID 由 claude-opus-4-8(或更早)改為 claude-opus-5,並檢視 effort/思考設定與 max_tokens(因為思考 tokens 現在也計入上限)。
來源:What’s New in Claude Opus 5、Models Overview。
逐步教學:如何透過 CometAPI 使用 Claude Opus 5 API
第一步:註冊並取得 API 金鑰
- 前往 https://www.cometapi.com/ 建立免費帳戶(測試額度無需信用卡)。
- 前往 API token / 控制台頁面。
- 產生新的 API 金鑰(通常以 sk- 開頭)。
- 將其安全地存為環境變數:export COMETAPI_KEY="your-key-here"
切勿將金鑰硬編碼在前端或公開倉庫。
第二步:選擇端點風格
- OpenAI 相容(/v1/chat/completions):最適合可攜性與多模型路由。
- 原生 Anthropic Messages(/v1/messages):可完整使用 Claude 特定參數(effort、思考控制、工具、對話中變更)。
兩者的 Base URL: https://api.cometapi.com/v1
第三步:安裝 SDK
Python(大多數範例建議):
Bash
pip install openai
或若大量使用原生 Messages 格式,可使用官方 Anthropic SDK。
JavaScript/TypeScript:
Bash
npm install openai
第四步:發出第一個呼叫
原生 Anthropic Messages 範例:
當你希望保留最貼近 Claude 原生行為、且需更佳 Claude 特定控制時,使用原生 Messages 路徑。
import os
import anthropic
client = anthropic.Anthropic(
base_url="https://api.cometapi.com",
api_key=os.environ["COMETAPI_KEY"],
)
message = client.messages.create(
model="claude-opus-5",
max_tokens=2000,
output_config={"effort": "high"},
messages=[
{
"role": "user",
"content": "Review this rollout plan and list the top three technical risks."
}
],
)
print(message.content[0].text)
為何這是良好預設:
- 保持最貼近 Claude 原生 API 的行為。
- 適合大量工具使用的工作流。
- 更容易推敲 effort 與輸出預算。
與 OpenAI 相容的 Chat Completions 範例:
若你的應用已使用 OpenAI SDK,此路徑能減少遷移成本。
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["COMETAPI_KEY"],
base_url="https://api.cometapi.com/v1",
)
response = client.chat.completions.create(
model="claude-opus-5",
messages=[
{
"role": "system",
"content": "You are a precise assistant. Be concise and verify claims."
},
{
"role": "user",
"content": "Summarize this incident and propose the next three actions."
}
],
max_tokens=1200,
)
print(response.choices[0].message.content)
當可攜性比 Claude 特定控制更重要時,使用此路徑。
若需完整的原生 Messages API 支援,請參考 CometAPI 文件與 Anthropic 的 Messages API 參考。Effort 可透過 output_config 或等效參數控制(low → max)。更高的 effort 會在困難任務上提升品質與 tokens 使用量。
第六步:串流回應
串流非常適合長答案、助理與編碼工具。
const response = await fetch("https://api.cometapi.com/v1/messages", {
method: "POST",
headers: {
Authorization: `Bearer ${process.env.COMETAPI_KEY}`,
"Content-Type": "application/json",
},
body: JSON.stringify({
model: "claude-opus-5",
max_tokens: 2500,
stream: true,
messages: [
{
role: "user",
content: "Draft a root-cause analysis from these incident notes.",
},
],
}),
});
if (!response.ok) {
throw new Error(await response.text());
}
在生產環境中,請將串流解析為事件而非原始區塊。加入取消、重試與部分回應處理。
第七步:工具使用與代理型工作流
Claude Opus 5 在工具呼叫、多步規劃、自我驗證與長期代理行為方面特別強。於請求中定義工具,讓模型自行決定何時呼叫,並在你的應用中實作執行循環。對話中變更工具(beta)允許在不失效 prompt 快取的情況下動態調整工具集。
第八步:提示快取與成本最佳化
- 快取 system 提示、工具定義與大型上下文(Opus 5 將可快取最小長度降至 512 tokens)。
- 對簡單任務使用較低 effort。
- 結合批次處理(若可用)以獲得更多折扣。
- 透過 CometAPI 儀表板監控使用情況。
進階功能與最佳實務
Effort 等級
從預設的 high 開始。若品質仍可接受,降至 medium 或 low。將 xhigh/max 保留給最困難的代理或研究任務。更高的 effort 能提升在複雜工作上的規劃、驗證與成功率,但會增加 tokens 與延遲。
Effort 是 Claude Opus 5 的主要控制旋鈕之一。
| Effort | 適用情境 | 取捨 |
|---|---|---|
| low | 擷取、路由、簡單摘要 | 成本最低、推理深度最低 |
| medium | 例行分析與編碼 | 平衡 |
| high | 複雜工作與高階預設用 | 高品質,成本適中 |
| xhigh | 困難代理循環與深度綜整 | 較慢且較昂貴 |
| max | 最困難的高階問題 | 最高品質潛力,但成本與延遲最高 |
若任務簡單,勿強制使用高階 effort。若任務困難,勿低估輸出 tokens 預算。
提示撰寫指引
Opus 5 受益於明確的任務範圍、清晰的成功標準,以及要求其驗證自身工作的指示。它比先前的 Opus 模型更主動、更細緻。請參考 Anthropic 的 Opus 5 提示指南以取得模型特定範式。
多模型路由建議(CometAPI 優勢)
將例行或高量流量路由至 Claude Sonnet 5(或更便宜的模型)。在複雜編碼、深度分析或高風險任務時升級至 Claude Opus 5。此模式能在重要處維持品質、同時最大化成本效率。
整合
CometAPI 可與 Claude Code、Cursor、n8n、Zapier、Dify、Open WebUI 與多種編碼代理相互運作。更新一次 base URL 與金鑰,即可存取完整的模型目錄。
限制與何時選擇替代方案
- 更高的 effort 會增加延遲與成本——不適合極低延遲對話。
- 依設計在某些雙重用途能力評估上仍落後 Mythos/Fable 級別。
- 在部分任務上可能較為冗長;明確的指示有助抑制。
- 對大量簡單任務而言,Sonnet 5 或更輕量模型更具經濟性。
務必在你的特定工作負載上進行評估,而非只依賴公開基準。
真實場景與支持數據
- 代理型編碼與除錯:在 Frontier-Bench 與 CursorBench 表現強勁;早期使用者回饋更佳的根因分析與多檔一致性。
- 企業自動化:在 Zapier AutomationBench 有高通過率。
- 科學與知識工作:在生物、化學與複雜分析上有改進表現。
- 長上下文分析:1M 全視窗可支援程式庫規模或多文件工作流,無需激進截斷。
- 電腦操作與代理:在 OSWorld 類評測上具備良好性價比。
Anthropic 客戶引述與獨立基準(Artificial Analysis、ARC Prize)一致顯示,相較 Opus 4.8 有顯著提升;Opus 5 在許多實務任務上接近 Fable 等級的結果,且成本減半。
常見錯誤
上下文不足
若只說「修這個 bug」,模型可能猜錯。請提供失敗行為、相關檔案與驗收標準。
上下文過多
將整個倉庫一股腦丟入每個提示會昂貴且雜訊多。請使用檢索、快取或目標式檔案選取。
輸出預算不足
過低的 max_tokens 設定會截斷思考或可見輸出。對困難任務請增加預算。
忽視 Effort
若不依任務類別調整 effort,可能對簡單工作付出過高成本,對困難任務則火力不足。
API 方法比較表
| Endpoint | 最適合的情境 | 優點 | 缺點 |
|---|---|---|---|
| 原生 Messages | Claude 原生工作流 | 最佳的 Claude 功能存取 | 整合工作量稍高 |
| 與 OpenAI 相容的 chat | 既有應用與路由器 | 遷移更容易 | 可能隱藏部分 Claude 特定調校 |
| 串流 | 互動式體驗 | 更快的體感延遲 | 客戶端複雜度更高 |
建議路由矩陣
| 工作負載 | 建議主要模型 | 升級模型 | 原因 |
|---|---|---|---|
| 例行對話與支援 | Claude Sonnet 5 或 Gemini Flash | Claude Opus 5 | 降低延遲與成本;在困難案例時升級 |
| 複雜編碼代理 | Claude Opus 5 | Claude Fable 5 | Opus 5 以半價提供強勁的編碼代理表現 |
| 大型程式碼庫分類 | Claude Sonnet 5 | Claude Opus 5 | Sonnet 負責廣泛掃描;Opus 處理根因與修補 |
| 法務或財務分析 | Claude Opus 5 | Claude Fable 5 | 更適合高精度長文件工作 |
| 離線批次文件處理 | Claude Opus 5 Batch API 或 CometAPI 批次流程 | 成本更低的 Claude Sonnet 5 | 批次與快取可帶來主要節省 |
| 即時 UI 助理 | Claude Sonnet 5、Haiku 或 fast 模型 | Opus 5 fast 模式 | 對簡單互動而言,Opus 5 在 max effort 下可能過慢 |
結論
對複雜的 Claude 工作流程,特別是你已使用 Opus 4.8 的情況下,Claude Opus 5 應視為新的高階預設。它提供最乾淨的升級路徑:相同官方價格、更強推理、更佳代理行為、1M tokens 上下文視窗,並具備更豐富的 effort、fallback、快取與速度控制。
建議下一步:
- 建立免費 CometAPI 帳戶並取得金鑰。
- 在 playground 上以現有模型為基準測試 Claude Opus 5。
- 以環境變數配置實作與 OpenAI 相容的客戶端。
- 加入 effort 控制與監控。
- 構建多模型路由以達到最佳成本/效能。
前往 CometAPI 立即開始開發。最新模型細節與定價請務必交叉查核 Anthropic 官方文件與 CometAPI 模型頁。
常見問答
Claude Opus 5 現已可用嗎?
是的。Anthropic 於 2026 年 7 月 24 日宣布 Claude Opus 5,並列為可在 Claude API、AWS、Google Cloud 與 Microsoft Foundry 使用。
Claude Opus 5 的價格是多少?
Anthropic 官方價格為每百萬輸入 tokens $5、每百萬輸出 tokens $25。Fast 模式為每百萬輸入 tokens $10、每百萬輸出 tokens $50。
Claude Opus 5 是否優於 Claude Opus 4.8?
對多數複雜工作而言,是的。它維持與 Opus 4.8 相同的官方 token 價格,但在基準表現、effort 擴展、預設開啟思考、更好的代理行為與 API 改進上有所提升。
我應該使用 Claude Opus 5 還是 Claude Sonnet 5?
複雜編碼、長期代理、企業級分析與高價值推理使用 Opus 5;高量生產工作、以速度與成本為重則使用 Sonnet 5。
我可以透過 CometAPI 使用 Claude Opus 5 嗎?
CometAPI 首頁列出支援 Claude Opus 5,並提供與 OpenAI 相容的 API base URL。上線前請於 CometAPI 儀表板確認即時模型可用性、端點與定價。
