Claude Opus 5 is now live on CometAPI →

如何透過 CometAPI 使用 Claude Opus 5 API

CometAPI
AnnaJul 29, 2026
如何透過 CometAPI 使用 Claude Opus 5 API

TLDR: Claude Opus 5 API 使用模型 ID claude-opus-5,並透過 CometAPI 同時支援 Anthropic 風格的 Messages 請求與與 OpenAI 相容的 chat completions。全新 Claude 原生應用建議使用 Messages 端點;既有 OpenAI SDK 應用可用 chat completions 端點。加入 effort 控制、快取、串流與路由,確保僅將需高階能力的工作交給高級模型處理。

重要摘要

  • 於 2026 年 7 月 24 日發布;API ID 為 claude-opus-5。
  • 以 Opus 價格提供近乎 Fable 5 的能力($5 input / $25 output 每 MTok)。
  • 在 Frontier-Bench(較 Opus 4.8 提升超過 2 倍)、CursorBench(距 Fable 5 約 0.5%)、ARC-AGI-3(為次佳的 3 倍)、OSWorld 2.0(以約 1/3 成本超越 Fable 5)與知識工作基準上有明顯進步。
  • 1M context,最大輸出 128K(透過 Batch API beta 可達 300K),預設開啟自適應思考,Fast 模式(約 2.5× 速度、2× 價格)。
  • 新 API 功能:對話中變更工具(beta)、預設 fallback、較低的 prompt 快取門檻(512 tokens)。
  • 最適合需要高能力、但不想承擔 Fable 5 成本或資料保留限制的開發者、企業與團隊。
  • 可於 Claude API、claude.ai(Pro/Max/Team/Enterprise)、Amazon Bedrock、Google Cloud、Microsoft Foundry,以及 CometAPI 等統一閘道取得。

什麼是 Claude Opus 5?

Claude Opus 5 是 Anthropic 在 Claude 家族 Opus 等級的最新產品——此等級被定位為「最強能力」大小級別,針對高要求的專業與代理型工作負載。它承襲自 Claude Opus 4.8(2026 年 5 月 28 日發布),定位介於受限的 Mythos 級模型(Mythos 5 及其面向公眾的對應 Fable 5)之下,並高於 Sonnet 與 Haiku 等級。

Anthropic 將其描述為「一個深思熟慮且主動積極的模型,在以半價提供的情況下,能力接近 Claude Fable 5 的前沿智慧」。它被明確設計為日常的高智力模型,而非只保留給最極端的長期代理任務(在某些與網路安全相關的評估中,Fable 5 或 Mythos 5 仍具優勢)。

主要特點包括:

  • 更強的代理行為:能自我檢查、謹慎迭代、找出根因而非頭痛醫頭,並能在多步任務中持續推進。
  • 更高效率:在相同或更佳結果下,較以往 Opus 模型使用更少 tokens(例如在某些專業工作負載中約少 26%)。
  • 更佳的安全與對齊:Anthropic 稱其為「至今最對齊的模型」,欺騙性行為率更低,且在合法的編碼與安全審查任務中更少出現不必要的安全干預(對許多開發者工作流程,分類器預期比在 Fable 5 上減少約 85% 的介入)。
  • 廣泛的多模態輸入支援(文字 + 圖像/PDF),輸出為文字,與近期 Claude 模型一致。
  • 原生支援工具、電腦操作與長上下文推理,在整個 1M tokens 視窗下以標準價格提供(無長上下文附加費)。

總之,Claude Opus 5 在保留讓 Opus 受青睞於生產環境的成本結構下,縮小了先前 Opus 世代與 Anthropic 真正前沿產品之間的大部分實務差距。

Claude Opus 5 一覽

FeatureDetails
Release DateJuly 24, 2026
API Model IDclaude-opus-5
Positioning面向複雜代理型編碼與企業工作的日常高階模型
Pricing$5 / MTok input, $25 / MTok output(與 Opus 4.8 相同)
Fast Mode約 2.5× 速度,$10 / $50 每 MTok(僅 Claude API,研究預覽)
Context Window1M tokens(預設與最大)
Max Output128K tokens(透過 Message Batches API beta 可達 300K)
Knowledge CutoffMay 2026(最當前的 Claude 模型)
Thinking預設開啟自適應思考
Effort Levelslow / medium / high(預設)/ xhigh / max
AvailabilityClaude API、claude.ai、Bedrock、Vertex AI、Microsoft Foundry
Data Retention支援零資料保留(不同於 Fable 5 的限制)

API 有哪些新內容?

Claude Opus 5 帶來多項實務 API 改進與行為變更,影響生產部署。

核心規格

  • Model ID: claude-opus-5
  • Context: 1M tokens(無較小變體)
  • Max output: 128K tokens(同步);透過 Message Batches API,搭配 beta header output-300k-2026-03-24 可達 300K
  • 預設啟用自適應思考
  • Effort 參數影響更明顯(low → max)

新功能

  1. 對話中變更工具(beta) 可在回合之間新增或移除工具,同時保留 prompt 快取。使用 beta header mid-conversation-tool-changes-2026-07-01。這能降低成本並提升安全性,因為可在不再需要時關閉工具。
  2. 預設 fallback 模式(beta) 新的 fallbacks 參數在 beta 中支援「default」模式,搭配 server-side-fallback-2026-07-01 header。若安全分類器拒絕請求且 Anthropic 對該拒絕類別有建議的 fallback,API 會在 fallback 模型上重試並回傳單一回應。此機制僅適用於安全分類器拒絕,不適用於速率限制、過載或伺服器錯誤。
  3. 較低的 prompt 快取門檻 可快取的提示長度從 Opus 4.8 的 1,024 tokens 降至 512 tokens。
  4. Fast 模式(研究預覽) 僅於 Claude API 提供。大約以雙倍價格($10/$50 每 MTok)提供約 2.5× 的預設速度。

行為變更(遷移時重要)

  • 在 xhigh 或 max 時不能停用思考。 這是破壞性行為變更。在 Opus 5 上,thinking: {"type": "disabled"} 僅在 high 或更低 effort 時被接受。若在 xhigh 或 max 停用思考,請求會回傳 400 錯誤。Anthropic 建議盡量維持思考啟用,並改以較低 effort 控制成本。
  • 預設開啟思考: Opus 5 預設以自適應思考運作。模型會自行決定每回合隱性推理的投入量,主要由 effort 參數控制。由於 max_tokens 同時是思考與可見輸出的硬性上限,從 Opus 4.8 遷移至 Opus 5 時,生產應用應重新檢視 max_tokens。
  • 模型在代理式會話中更常敘述進度、更容易委派子代理、更徹底地驗證自身工作,且預設回覆更長。
  • 移除舊提示中的傳統驗證指令——它們可能導致過度驗證。

遷移相當直接:將模型 ID 由 claude-opus-4-8(或更早)改為 claude-opus-5,並檢視 effort/思考設定與 max_tokens(因為思考 tokens 現在也計入上限)。

來源:What’s New in Claude Opus 5Models Overview

逐步教學:如何透過 CometAPI 使用 Claude Opus 5 API

第一步:註冊並取得 API 金鑰

  1. 前往 https://www.cometapi.com/ 建立免費帳戶(測試額度無需信用卡)。
  2. 前往 API token / 控制台頁面。
  3. 產生新的 API 金鑰(通常以 sk- 開頭)。
  4. 將其安全地存為環境變數:export COMETAPI_KEY="your-key-here"

切勿將金鑰硬編碼在前端或公開倉庫。

第二步:選擇端點風格

  • OpenAI 相容(/v1/chat/completions):最適合可攜性與多模型路由。
  • 原生 Anthropic Messages(/v1/messages):可完整使用 Claude 特定參數(effort、思考控制、工具、對話中變更)。

兩者的 Base URL: https://api.cometapi.com/v1

第三步:安裝 SDK

Python(大多數範例建議):

Bash
pip install openai

或若大量使用原生 Messages 格式,可使用官方 Anthropic SDK。

JavaScript/TypeScript:

Bash
npm install openai

第四步:發出第一個呼叫

原生 Anthropic Messages 範例:

當你希望保留最貼近 Claude 原生行為、且需更佳 Claude 特定控制時,使用原生 Messages 路徑。

import os
import anthropic

client = anthropic.Anthropic(
    base_url="https://api.cometapi.com",
    api_key=os.environ["COMETAPI_KEY"],
)

message = client.messages.create(
    model="claude-opus-5",
    max_tokens=2000,
    output_config={"effort": "high"},
    messages=[
        {
            "role": "user",
            "content": "Review this rollout plan and list the top three technical risks."
        }
    ],
)

print(message.content[0].text)

為何這是良好預設:

  • 保持最貼近 Claude 原生 API 的行為。
  • 適合大量工具使用的工作流。
  • 更容易推敲 effort 與輸出預算。

與 OpenAI 相容的 Chat Completions 範例:

若你的應用已使用 OpenAI SDK,此路徑能減少遷移成本。

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["COMETAPI_KEY"],
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="claude-opus-5",
    messages=[
        {
            "role": "system",
            "content": "You are a precise assistant. Be concise and verify claims."
        },
        {
            "role": "user",
            "content": "Summarize this incident and propose the next three actions."
        }
    ],
    max_tokens=1200,
)

print(response.choices[0].message.content)

當可攜性比 Claude 特定控制更重要時,使用此路徑。

若需完整的原生 Messages API 支援,請參考 CometAPI 文件與 Anthropic 的 Messages API 參考。Effort 可透過 output_config 或等效參數控制(low → max)。更高的 effort 會在困難任務上提升品質與 tokens 使用量。

第六步:串流回應

串流非常適合長答案、助理與編碼工具。

const response = await fetch("https://api.cometapi.com/v1/messages", {
  method: "POST",
  headers: {
    Authorization: `Bearer ${process.env.COMETAPI_KEY}`,
    "Content-Type": "application/json",
  },
  body: JSON.stringify({
    model: "claude-opus-5",
    max_tokens: 2500,
    stream: true,
    messages: [
      {
        role: "user",
        content: "Draft a root-cause analysis from these incident notes.",
      },
    ],
  }),
});

if (!response.ok) {
  throw new Error(await response.text());
}

在生產環境中,請將串流解析為事件而非原始區塊。加入取消、重試與部分回應處理。

第七步:工具使用與代理型工作流

Claude Opus 5 在工具呼叫、多步規劃、自我驗證與長期代理行為方面特別強。於請求中定義工具,讓模型自行決定何時呼叫,並在你的應用中實作執行循環。對話中變更工具(beta)允許在不失效 prompt 快取的情況下動態調整工具集。

第八步:提示快取與成本最佳化

  • 快取 system 提示、工具定義與大型上下文(Opus 5 將可快取最小長度降至 512 tokens)。
  • 對簡單任務使用較低 effort。
  • 結合批次處理(若可用)以獲得更多折扣。
  • 透過 CometAPI 儀表板監控使用情況。

進階功能與最佳實務

Effort 等級

從預設的 high 開始。若品質仍可接受,降至 mediumlow。將 xhigh/max 保留給最困難的代理或研究任務。更高的 effort 能提升在複雜工作上的規劃、驗證與成功率,但會增加 tokens 與延遲。

Effort 是 Claude Opus 5 的主要控制旋鈕之一。

Effort適用情境取捨
low擷取、路由、簡單摘要成本最低、推理深度最低
medium例行分析與編碼平衡
high複雜工作與高階預設用高品質,成本適中
xhigh困難代理循環與深度綜整較慢且較昂貴
max最困難的高階問題最高品質潛力,但成本與延遲最高

若任務簡單,勿強制使用高階 effort。若任務困難,勿低估輸出 tokens 預算。

提示撰寫指引

Opus 5 受益於明確的任務範圍、清晰的成功標準,以及要求其驗證自身工作的指示。它比先前的 Opus 模型更主動、更細緻。請參考 Anthropic 的 Opus 5 提示指南以取得模型特定範式。

多模型路由建議(CometAPI 優勢)

將例行或高量流量路由至 Claude Sonnet 5(或更便宜的模型)。在複雜編碼、深度分析或高風險任務時升級至 Claude Opus 5。此模式能在重要處維持品質、同時最大化成本效率。

整合

CometAPI 可與 Claude Code、Cursor、n8n、Zapier、Dify、Open WebUI 與多種編碼代理相互運作。更新一次 base URL 與金鑰,即可存取完整的模型目錄。

限制與何時選擇替代方案

  • 更高的 effort 會增加延遲與成本——不適合極低延遲對話。
  • 依設計在某些雙重用途能力評估上仍落後 Mythos/Fable 級別。
  • 在部分任務上可能較為冗長;明確的指示有助抑制。
  • 對大量簡單任務而言,Sonnet 5 或更輕量模型更具經濟性。

務必在你的特定工作負載上進行評估,而非只依賴公開基準。

真實場景與支持數據

  • 代理型編碼與除錯:在 Frontier-Bench 與 CursorBench 表現強勁;早期使用者回饋更佳的根因分析與多檔一致性。
  • 企業自動化:在 Zapier AutomationBench 有高通過率。
  • 科學與知識工作:在生物、化學與複雜分析上有改進表現。
  • 長上下文分析:1M 全視窗可支援程式庫規模或多文件工作流,無需激進截斷。
  • 電腦操作與代理:在 OSWorld 類評測上具備良好性價比。

Anthropic 客戶引述與獨立基準(Artificial Analysis、ARC Prize)一致顯示,相較 Opus 4.8 有顯著提升;Opus 5 在許多實務任務上接近 Fable 等級的結果,且成本減半。

常見錯誤

上下文不足

若只說「修這個 bug」,模型可能猜錯。請提供失敗行為、相關檔案與驗收標準。

上下文過多

將整個倉庫一股腦丟入每個提示會昂貴且雜訊多。請使用檢索、快取或目標式檔案選取。

輸出預算不足

過低的 max_tokens 設定會截斷思考或可見輸出。對困難任務請增加預算。

忽視 Effort

若不依任務類別調整 effort,可能對簡單工作付出過高成本,對困難任務則火力不足。

API 方法比較表

Endpoint最適合的情境優點缺點
原生 MessagesClaude 原生工作流最佳的 Claude 功能存取整合工作量稍高
與 OpenAI 相容的 chat既有應用與路由器遷移更容易可能隱藏部分 Claude 特定調校
串流互動式體驗更快的體感延遲客戶端複雜度更高

建議路由矩陣

工作負載建議主要模型升級模型原因
例行對話與支援Claude Sonnet 5 或 Gemini FlashClaude Opus 5降低延遲與成本;在困難案例時升級
複雜編碼代理Claude Opus 5Claude Fable 5Opus 5 以半價提供強勁的編碼代理表現
大型程式碼庫分類Claude Sonnet 5Claude Opus 5Sonnet 負責廣泛掃描;Opus 處理根因與修補
法務或財務分析Claude Opus 5Claude Fable 5更適合高精度長文件工作
離線批次文件處理Claude Opus 5 Batch API 或 CometAPI 批次流程成本更低的 Claude Sonnet 5批次與快取可帶來主要節省
即時 UI 助理Claude Sonnet 5、Haiku 或 fast 模型Opus 5 fast 模式對簡單互動而言,Opus 5 在 max effort 下可能過慢

結論

對複雜的 Claude 工作流程,特別是你已使用 Opus 4.8 的情況下,Claude Opus 5 應視為新的高階預設。它提供最乾淨的升級路徑:相同官方價格、更強推理、更佳代理行為、1M tokens 上下文視窗,並具備更豐富的 effort、fallback、快取與速度控制。

建議下一步:

  1. 建立免費 CometAPI 帳戶並取得金鑰。
  2. 在 playground 上以現有模型為基準測試 Claude Opus 5。
  3. 以環境變數配置實作與 OpenAI 相容的客戶端。
  4. 加入 effort 控制與監控。
  5. 構建多模型路由以達到最佳成本/效能。

前往 CometAPI 立即開始開發。最新模型細節與定價請務必交叉查核 Anthropic 官方文件與 CometAPI 模型頁

常見問答

Claude Opus 5 現已可用嗎?

是的。Anthropic 於 2026 年 7 月 24 日宣布 Claude Opus 5,並列為可在 Claude API、AWS、Google Cloud 與 Microsoft Foundry 使用。

Claude Opus 5 的價格是多少?

Anthropic 官方價格為每百萬輸入 tokens $5、每百萬輸出 tokens $25。Fast 模式為每百萬輸入 tokens $10、每百萬輸出 tokens $50。

Claude Opus 5 是否優於 Claude Opus 4.8?

對多數複雜工作而言,是的。它維持與 Opus 4.8 相同的官方 token 價格,但在基準表現、effort 擴展、預設開啟思考、更好的代理行為與 API 改進上有所提升。

我應該使用 Claude Opus 5 還是 Claude Sonnet 5?

複雜編碼、長期代理、企業級分析與高價值推理使用 Opus 5;高量生產工作、以速度與成本為重則使用 Sonnet 5。

我可以透過 CometAPI 使用 Claude Opus 5 嗎?

CometAPI 首頁列出支援 Claude Opus 5,並提供與 OpenAI 相容的 API base URL。上線前請於 CometAPI 儀表板確認即時模型可用性、端點與定價。

準備好將 AI 開發成本降低 20% 了嗎?

幾分鐘內免費開始。包含免費試用點數。無需信用卡。

閱讀更多