GLM-5.3 FlashX and MiniMax H3 Max are now live on CometAPI →
guide/CometAPI 研究

如何透過 CometAPI 使用 Claude Opus 5 API

瞭解如何透過 CometAPI 使用 Claude Opus 5 API。包含原生 Messages API、與 OpenAI 相容的聊天、程式碼範例、串流、effort controls。

CometAPI
AnnaAI 模型與 API 研究團隊
更新於 Sep 3, 2026 6 分鐘閱讀
如何透過 CometAPI 使用 Claude Opus 5 API
套用此模式

發出第一個 API 請求。

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TLDR: Claude Opus 5 API 使用模型 ID claude-opus-5,並透過 CometAPI 同時支援 Anthropic 風格的 Messages 請求與與 OpenAI 相容的 chat completions。全新 Claude 原生應用建議使用 Messages 端點;既有 OpenAI SDK 應用可用 chat completions 端點。加入 effort 控制、快取、串流與路由,確保僅將需高階能力的工作交給高級模型處理。

重要摘要

  • 於 2026 年 7 月 24 日發布;API ID 為 claude-opus-5。
  • 以 Opus 價格提供近乎 Fable 5 的能力($5 input / $25 output 每 MTok)。
  • 在 Frontier-Bench(較 Opus 4.8 提升超過 2 倍)、CursorBench(距 Fable 5 約 0.5%)、ARC-AGI-3(為次佳的 3 倍)、OSWorld 2.0(以約 1/3 成本超越 Fable 5)與知識工作基準上有明顯進步。
  • 1M context,最大輸出 128K(透過 Batch API beta 可達 300K),預設開啟自適應思考,Fast 模式(約 2.5× 速度、2× 價格)。
  • 新 API 功能:對話中變更工具(beta)、預設 fallback、較低的 prompt 快取門檻(512 tokens)。
  • 最適合需要高能力、但不想承擔 Fable 5 成本或資料保留限制的開發者、企業與團隊。
  • 可於 Claude API、claude.ai(Pro/Max/Team/Enterprise)、Amazon Bedrock、Google Cloud、Microsoft Foundry,以及 CometAPI 等統一閘道取得。

什麼是 Claude Opus 5?

Claude Opus 5 是 Anthropic 在 Claude 家族 Opus 等級的最新產品——此等級被定位為「最強能力」大小級別,針對高要求的專業與代理型工作負載。它承襲自 Claude Opus 4.8(2026 年 5 月 28 日發布),定位介於受限的 Mythos 級模型(Mythos 5 及其面向公眾的對應 Fable 5)之下,並高於 Sonnet 與 Haiku 等級。

Anthropic 將其描述為「一個深思熟慮且主動積極的模型,在以半價提供的情況下,能力接近 Claude Fable 5 的前沿智慧」。它被明確設計為日常的高智力模型,而非只保留給最極端的長期代理任務(在某些與網路安全相關的評估中,Fable 5 或 Mythos 5 仍具優勢)。

主要特點包括:

  • 更強的代理行為:能自我檢查、謹慎迭代、找出根因而非頭痛醫頭,並能在多步任務中持續推進。
  • 更高效率:在相同或更佳結果下,較以往 Opus 模型使用更少 tokens(例如在某些專業工作負載中約少 26%)。
  • 更佳的安全與對齊:Anthropic 稱其為「至今最對齊的模型」,欺騙性行為率更低,且在合法的編碼與安全審查任務中更少出現不必要的安全干預(對許多開發者工作流程,分類器預期比在 Fable 5 上減少約 85% 的介入)。
  • 廣泛的多模態輸入支援(文字 + 圖像/PDF),輸出為文字,與近期 Claude 模型一致。
  • 原生支援工具、電腦操作與長上下文推理,在整個 1M tokens 視窗下以標準價格提供(無長上下文附加費)。

總之,Claude Opus 5 在保留讓 Opus 受青睞於生產環境的成本結構下,縮小了先前 Opus 世代與 Anthropic 真正前沿產品之間的大部分實務差距。

Claude Opus 5 一覽

FeatureDetails
Release DateJuly 24, 2026
API Model IDclaude-opus-5
Positioning面向複雜代理型編碼與企業工作的日常高階模型
Pricing$5 / MTok input, $25 / MTok output(與 Opus 4.8 相同)
Fast Mode約 2.5× 速度,$10 / $50 每 MTok(僅 Claude API,研究預覽)
Context Window1M tokens(預設與最大)
Max Output128K tokens(透過 Message Batches API beta 可達 300K)
Knowledge CutoffMay 2026(最當前的 Claude 模型)
Thinking預設開啟自適應思考
Effort Levelslow / medium / high(預設)/ xhigh / max
AvailabilityClaude API、claude.ai、Bedrock、Vertex AI、Microsoft Foundry
Data Retention支援零資料保留(不同於 Fable 5 的限制)

API 有哪些新內容?

Claude Opus 5 帶來多項實務 API 改進與行為變更,影響生產部署。

核心規格

  • Model ID: claude-opus-5
  • Context: 1M tokens(無較小變體)
  • Max output: 128K tokens(同步);透過 Message Batches API,搭配 beta header output-300k-2026-03-24 可達 300K
  • 預設啟用自適應思考
  • Effort 參數影響更明顯(low → max)

新功能

  1. 對話中變更工具(beta) 可在回合之間新增或移除工具,同時保留 prompt 快取。使用 beta header mid-conversation-tool-changes-2026-07-01。這能降低成本並提升安全性,因為可在不再需要時關閉工具。
  2. 預設 fallback 模式(beta) 新的 fallbacks 參數在 beta 中支援「default」模式,搭配 server-side-fallback-2026-07-01 header。若安全分類器拒絕請求且 Anthropic 對該拒絕類別有建議的 fallback,API 會在 fallback 模型上重試並回傳單一回應。此機制僅適用於安全分類器拒絕,不適用於速率限制、過載或伺服器錯誤。
  3. 較低的 prompt 快取門檻 可快取的提示長度從 Opus 4.8 的 1,024 tokens 降至 512 tokens。
  4. Fast 模式(研究預覽) 僅於 Claude API 提供。大約以雙倍價格($10/$50 每 MTok)提供約 2.5× 的預設速度。

行為變更(遷移時重要)

  • 在 xhigh 或 max 時不能停用思考。 這是破壞性行為變更。在 Opus 5 上,thinking: {"type": "disabled"} 僅在 high 或更低 effort 時被接受。若在 xhigh 或 max 停用思考,請求會回傳 400 錯誤。Anthropic 建議盡量維持思考啟用,並改以較低 effort 控制成本。
  • 預設開啟思考: Opus 5 預設以自適應思考運作。模型會自行決定每回合隱性推理的投入量,主要由 effort 參數控制。由於 max_tokens 同時是思考與可見輸出的硬性上限,從 Opus 4.8 遷移至 Opus 5 時,生產應用應重新檢視 max_tokens。
  • 模型在代理式會話中更常敘述進度、更容易委派子代理、更徹底地驗證自身工作,且預設回覆更長。
  • 移除舊提示中的傳統驗證指令——它們可能導致過度驗證。

遷移相當直接:將模型 ID 由 claude-opus-4-8(或更早)改為 claude-opus-5,並檢視 effort/思考設定與 max_tokens(因為思考 tokens 現在也計入上限)。

來源:What’s New in Claude Opus 5Models Overview

逐步教學:如何透過 CometAPI 使用 Claude Opus 5 API

第一步:註冊並取得 API 金鑰

  1. 前往 https://www.cometapi.com/ 建立免費帳戶(測試額度無需信用卡)。
  2. 前往 API token / 控制台頁面。
  3. 產生新的 API 金鑰(通常以 sk- 開頭)。
  4. 將其安全地存為環境變數:export COMETAPI_KEY="your-key-here"

切勿將金鑰硬編碼在前端或公開倉庫。

第二步:選擇端點風格

  • OpenAI 相容(/v1/chat/completions):最適合可攜性與多模型路由。
  • 原生 Anthropic Messages(/v1/messages):可完整使用 Claude 特定參數(effort、思考控制、工具、對話中變更)。

兩者的 Base URL: https://api.cometapi.com/v1

第三步:安裝 SDK

Python(大多數範例建議):

Bash
pip install openai

或若大量使用原生 Messages 格式,可使用官方 Anthropic SDK。

JavaScript/TypeScript:

Bash
npm install openai

第四步:發出第一個呼叫

原生 Anthropic Messages 範例:

當你希望保留最貼近 Claude 原生行為、且需更佳 Claude 特定控制時,使用原生 Messages 路徑。

import os
import anthropic

client = anthropic.Anthropic(
    base_url="https://api.cometapi.com",
    api_key=os.environ["COMETAPI_KEY"],
)

message = client.messages.create(
    model="claude-opus-5",
    max_tokens=2000,
    output_config={"effort": "high"},
    messages=[
        {
            "role": "user",
            "content": "Review this rollout plan and list the top three technical risks."
        }
    ],
)

print(message.content[0].text)

為何這是良好預設:

  • 保持最貼近 Claude 原生 API 的行為。
  • 適合大量工具使用的工作流。
  • 更容易推敲 effort 與輸出預算。

與 OpenAI 相容的 Chat Completions 範例:

若你的應用已使用 OpenAI SDK,此路徑能減少遷移成本。

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["COMETAPI_KEY"],
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="claude-opus-5",
    messages=[
        {
            "role": "system",
            "content": "You are a precise assistant. Be concise and verify claims."
        },
        {
            "role": "user",
            "content": "Summarize this incident and propose the next three actions."
        }
    ],
    max_tokens=1200,
)

print(response.choices[0].message.content)

當可攜性比 Claude 特定控制更重要時,使用此路徑。

若需完整的原生 Messages API 支援,請參考 CometAPI 文件與 Anthropic 的 Messages API 參考。Effort 可透過 output_config 或等效參數控制(low → max)。更高的 effort 會在困難任務上提升品質與 tokens 使用量。

第六步:串流回應

串流非常適合長答案、助理與編碼工具。

const response = await fetch("https://api.cometapi.com/v1/messages", {
  method: "POST",
  headers: {
    Authorization: `Bearer ${process.env.COMETAPI_KEY}`,
    "Content-Type": "application/json",
  },
  body: JSON.stringify({
    model: "claude-opus-5",
    max_tokens: 2500,
    stream: true,
    messages: [
      {
        role: "user",
        content: "Draft a root-cause analysis from these incident notes.",
      },
    ],
  }),
});

if (!response.ok) {
  throw new Error(await response.text());
}

在生產環境中,請將串流解析為事件而非原始區塊。加入取消、重試與部分回應處理。

第七步:工具使用與代理型工作流

Claude Opus 5 在工具呼叫、多步規劃、自我驗證與長期代理行為方面特別強。於請求中定義工具,讓模型自行決定何時呼叫,並在你的應用中實作執行循環。對話中變更工具(beta)允許在不失效 prompt 快取的情況下動態調整工具集。

第八步:提示快取與成本最佳化

  • 快取 system 提示、工具定義與大型上下文(Opus 5 將可快取最小長度降至 512 tokens)。
  • 對簡單任務使用較低 effort。
  • 結合批次處理(若可用)以獲得更多折扣。
  • 透過 CometAPI 儀表板監控使用情況。

進階功能與最佳實務

Effort 等級

從預設的 high 開始。若品質仍可接受,降至 mediumlow。將 xhigh/max 保留給最困難的代理或研究任務。更高的 effort 能提升在複雜工作上的規劃、驗證與成功率,但會增加 tokens 與延遲。

Effort 是 Claude Opus 5 的主要控制旋鈕之一。

Effort適用情境取捨
low擷取、路由、簡單摘要成本最低、推理深度最低
medium例行分析與編碼平衡
high複雜工作與高階預設用高品質,成本適中
xhigh困難代理循環與深度綜整較慢且較昂貴
max最困難的高階問題最高品質潛力,但成本與延遲最高

若任務簡單,勿強制使用高階 effort。若任務困難,勿低估輸出 tokens 預算。

提示撰寫指引

Opus 5 受益於明確的任務範圍、清晰的成功標準,以及要求其驗證自身工作的指示。它比先前的 Opus 模型更主動、更細緻。請參考 Anthropic 的 Opus 5 提示指南以取得模型特定範式。

多模型路由建議(CometAPI 優勢)

將例行或高量流量路由至 Claude Sonnet 5(或更便宜的模型)。在複雜編碼、深度分析或高風險任務時升級至 Claude Opus 5。此模式能在重要處維持品質、同時最大化成本效率。

整合

CometAPI 可與 Claude Code、Cursor、n8n、Zapier、Dify、Open WebUI 與多種編碼代理相互運作。更新一次 base URL 與金鑰,即可存取完整的模型目錄。

限制與何時選擇替代方案

  • 更高的 effort 會增加延遲與成本——不適合極低延遲對話。
  • 依設計在某些雙重用途能力評估上仍落後 Mythos/Fable 級別。
  • 在部分任務上可能較為冗長;明確的指示有助抑制。
  • 對大量簡單任務而言,Sonnet 5 或更輕量模型更具經濟性。

務必在你的特定工作負載上進行評估,而非只依賴公開基準。

真實場景與支持數據

  • 代理型編碼與除錯:在 Frontier-Bench 與 CursorBench 表現強勁;早期使用者回饋更佳的根因分析與多檔一致性。
  • 企業自動化:在 Zapier AutomationBench 有高通過率。
  • 科學與知識工作:在生物、化學與複雜分析上有改進表現。
  • 長上下文分析:1M 全視窗可支援程式庫規模或多文件工作流,無需激進截斷。
  • 電腦操作與代理:在 OSWorld 類評測上具備良好性價比。

Anthropic 客戶引述與獨立基準(Artificial Analysis、ARC Prize)一致顯示,相較 Opus 4.8 有顯著提升;Opus 5 在許多實務任務上接近 Fable 等級的結果,且成本減半。

常見錯誤

上下文不足

若只說「修這個 bug」,模型可能猜錯。請提供失敗行為、相關檔案與驗收標準。

上下文過多

將整個倉庫一股腦丟入每個提示會昂貴且雜訊多。請使用檢索、快取或目標式檔案選取。

輸出預算不足

過低的 max_tokens 設定會截斷思考或可見輸出。對困難任務請增加預算。

忽視 Effort

若不依任務類別調整 effort,可能對簡單工作付出過高成本,對困難任務則火力不足。

API 方法比較表

Endpoint最適合的情境優點缺點
原生 MessagesClaude 原生工作流最佳的 Claude 功能存取整合工作量稍高
與 OpenAI 相容的 chat既有應用與路由器遷移更容易可能隱藏部分 Claude 特定調校
串流互動式體驗更快的體感延遲客戶端複雜度更高

建議路由矩陣

工作負載建議主要模型升級模型原因
例行對話與支援Claude Sonnet 5 或 Gemini FlashClaude Opus 5降低延遲與成本;在困難案例時升級
複雜編碼代理Claude Opus 5Claude Fable 5Opus 5 以半價提供強勁的編碼代理表現
大型程式碼庫分類Claude Sonnet 5Claude Opus 5Sonnet 負責廣泛掃描;Opus 處理根因與修補
法務或財務分析Claude Opus 5Claude Fable 5更適合高精度長文件工作
離線批次文件處理Claude Opus 5 Batch API 或 CometAPI 批次流程成本更低的 Claude Sonnet 5批次與快取可帶來主要節省
即時 UI 助理Claude Sonnet 5、Haiku 或 fast 模型Opus 5 fast 模式對簡單互動而言,Opus 5 在 max effort 下可能過慢

結論

對複雜的 Claude 工作流程,特別是你已使用 Opus 4.8 的情況下,Claude Opus 5 應視為新的高階預設。它提供最乾淨的升級路徑:相同官方價格、更強推理、更佳代理行為、1M tokens 上下文視窗,並具備更豐富的 effort、fallback、快取與速度控制。

建議下一步:

  1. 建立免費 CometAPI 帳戶並取得金鑰。
  2. 在 playground 上以現有模型為基準測試 Claude Opus 5。
  3. 以環境變數配置實作與 OpenAI 相容的客戶端。
  4. 加入 effort 控制與監控。
  5. 構建多模型路由以達到最佳成本/效能。

前往 CometAPI 立即開始開發。最新模型細節與定價請務必交叉查核 Anthropic 官方文件與 CometAPI 模型頁

常見問答

Claude Opus 5 現已可用嗎?

是的。Anthropic 於 2026 年 7 月 24 日宣布 Claude Opus 5,並列為可在 Claude API、AWS、Google Cloud 與 Microsoft Foundry 使用。

Claude Opus 5 的價格是多少?

Anthropic 官方價格為每百萬輸入 tokens $5、每百萬輸出 tokens $25。Fast 模式為每百萬輸入 tokens $10、每百萬輸出 tokens $50。

Claude Opus 5 是否優於 Claude Opus 4.8?

對多數複雜工作而言,是的。它維持與 Opus 4.8 相同的官方 token 價格,但在基準表現、effort 擴展、預設開啟思考、更好的代理行為與 API 改進上有所提升。

我應該使用 Claude Opus 5 還是 Claude Sonnet 5?

複雜編碼、長期代理、企業級分析與高價值推理使用 Opus 5;高量生產工作、以速度與成本為重則使用 Sonnet 5。

我可以透過 CometAPI 使用 Claude Opus 5 嗎?

CometAPI 首頁列出支援 Claude Opus 5,並提供與 OpenAI 相容的 API base URL。上線前請於 CometAPI 儀表板確認即時模型可用性、端點與定價。

繼續學習

把這篇文章連到下一個決策。

查看所有主題
發布於 Jul 29, 2026
最後更新 Sep 3, 2026
38 次瀏覽
已審核內容清晰度、來源標註與最新 API 術語。

準備好將 AI 開發成本降低 20% 了嗎?

幾分鐘內免費開始。包含免費試用點數。無需信用卡。

閱讀更多