GPT-6 Sol, GPT-6 Luna, and Claude Opus 5.5 are now live on CometAPI →
ai-model/CometAPI 研究

什麼是 Claude Sonnet 5.5?基準測試、定價與 API 存取

探索 Claude Sonnet 5.5 的規格、1M 上下文視窗、基準測試、定價、程式設計功能、比較與 API 存取。

CometAPI
Deon GoodwinAI 模型與 API 研究團隊
更新於 Sep 29, 2026 6 分鐘閱讀
什麼是 Claude Sonnet 5.5?基準測試、定價與 API 存取
套用此模式

發出第一個 API 請求。

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR

Claude Sonnet 5.5 是 Anthropic 最新的 Sonnet 級模型,於 2026 年 9 月 28 日發佈。其定位為 Claude Opus 5.5 的更快、成本更低的補充機型,面向程式設計、範圍明確的代理任務、文件產出、電腦操作與多模態分析。

該模型維持標準定價:每百萬輸入 token $2、每百萬輸出 token $10。Anthropic 稱其輸出生成速度較 Sonnet 5 快逾 30%,且由於常以更少的 token 與步驟完成任務,整體任務成本可降低至多 30%。

已公布成績包括 Terminal-Bench 4.0 的 70.6%、CursorBench 4.0 的 55.5%、GDPval-AA v2.1 的 1844,以及 OSWorld 2.1 的 80.1%。實務價值不在單一分數:Sonnet 5.5 在多項專業工作評測上逼近 Opus 5.5,同時保有較低的標準 token 價。

Key Takeaways

  • Claude Sonnet 5.5 是 Anthropic 的 Claude 5.5 家族中第二款機型,偏重快速生產型工作,而非最具歧義、開放式的任務。
  • 支援 1M-token 上下文視窗、最多 128K 輸出 token、文字與影像輸入、自適應思考、工具使用與結構化回應。
  • 標準 Claude API 定價為輸入 $2/M、輸出 $10/M、快取讀取 $0.20/M、五分鐘快取寫入 $2.50/M。
  • Anthropic 報告顯示:相較 Sonnet 5,輸出速度提升 30% 以上,並在程式設計、電腦操作、圖表理解與長期知識型工作上有明顯進步。
  • Claude API 模型 ID 為「claude-sonnet-5-5」;開發者也可透過 CometAPI 的 Claude Sonnet 5.5 API 存取。

What Is Claude Sonnet 5.5?

Claude Sonnet 5.5 是 Anthropic 最新的通用 Sonnet 模型,也是 Claude 5.5 家族在 Claude Opus 5.5 之後的第二次發佈。Anthropic 將其定位為 Opus 的更快、更低成本補充,而非旗艦的直接替代。

這一區分具實務意義:Opus 5.5 面向需要持續判斷的複雜、含糊工作;Sonnet 5.5 則針對範圍明確的任務、修補錯誤、快速迭代、程式設計、文件生產與高量專業工作流程進行優化。

What Are the Most Important Claude Sonnet 5.5 Features?

該模型結合了 1M-token 上下文視窗、最高 128K 輸出 token、文字與影像輸入、自適應思考、可調整的努力等級、工具使用、結構化輸出、提示快取、批次處理,並支援 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 與 Claude Platform on AWS。對生產團隊而言,關鍵不在單一功能,而是更快的生成、更少的任務級 token 使用量,以及在多項範圍明確的專業工作中逼近 Opus 的表現。

Claude Sonnet 5.5 benchmarks

Anthropic 報告在程式設計、長期專業工作、電腦操作與視覺理解方面皆有顯著提升。下表彙總該公司已發布的評測結果。

Benchmark and official sourceClaude Sonnet 5.5Claude Sonnet 5Claude Opus 5.5GPT-6 Sol
Terminal-Bench 4.070.6%10.3%66.4% at XhighNot publicly reported
FrontierCode 1.1 Main46.2% at Max42.4%54.4%49.3% / 52.1% at Xhigh
CursorBench 4.055.5%34.1%57.8%Not publicly reported
GDPval-AA v2.11844144918461487
AA-Briefcase v1.11811135918221483
Humanity's Last Exam64.5% with tools54.9%67.7%Not reported in the source table
OSWorld 2.180.1%57.0%81.8%Not reported in the source table
Chartography61.6%15.6%64.4%53.6%

Evaluation conditions and caveats: 分數並非皆在相同努力等級下測得。Opus 5.5 的 66.4% Terminal-Bench 成績是在 Xhigh 報告。Anthropic 指出,在 FrontierCode 上,Sonnet 5.5 於 Max 的分數可能低於 Xhigh,因為額外的審查步驟可能引發逾時或超出範圍的編輯。Artificial Analysis 在一個受結構化輸出錯誤影響的 Sonnet 5.5 預發布部署上執行了 GDPval-AA 與 AA-Briefcase,Anthropic 稱該問題已修復。跨供應商的 GPT-6 Sol 數據也應視為較早的觀察,因為 OpenAI 於 2026 年 9 月 25 日修正了一個影像編碼問題。

What the results mean: Sonnet 5.5 不僅僅是在單一指標上領先 Sonnet 5。它在程式設計、專業工作、電腦操作與圖表辨識方面更接近 Opus 5.5,同時保持 Sonnet 等級的定價。Anthropic 亦報告,於 Low 或 Medium 的努力等級下,Sonnet 5.5 能在多項評測中以約十分之一的任務成本超過 Sonnet 5 的最佳成績。此種能力、速度與任務級效率的組合,是其主要競爭優勢。

How Good Is Claude Sonnet 5.5?

Coding

進步也體現在操作層面。Anthropic 指出 Sonnet 5.5 對程式碼庫的理解更快、工具呼叫批次化更有效率、採用更少步驟,並降低每個完成任務的成本。FrontierCode 檢驗提議的程式變更是否可合併,而 CursorBench 取材自真實程式工作階段的多檔案且具歧義任務;因此,這些提升反映了在版本庫層級的執行與判斷,不僅是短程式生成。這些變化對修復錯誤、程式碼審查、測試執行與長時程的程式代理很重要。

什麼是 Claude Sonnet 5.5?基準測試、定價與 API 存取

Knowledge Work

改進並不限於程式領域。GDPval-AA 檢測 44 種職業與九大產業中的真實專業任務,因此 Sonnet 5.5 的 1844 分(對比 Sonnet 5 的 1449 與 Opus 5.5 的 1846)顯示,其提升轉化為實務分析、文件生產與決策支持,而非只停留在實驗室推理測試。

Anthropic 強調財務分析、文件綜整、簡報製作、試算表處理、圖表解讀、來源查核、資訊檢索與專業寫作等領域的提升。

早期測試者也回報了較難量化的改進:更清晰的協作、更自然的對話式判斷,以及更好的設計眼光。Anthropic 稱該模型可為使用者介面增添光澤,並能嚴格遵循簡報模板以產出幾乎不需編修的投影片;在一次內部營運審查測試中,兩位專家判定首版即可直接發送、無須修改。

更廣泛的含義是:Sonnet 5.5 應被理解為一款專業工作模型,而不僅是更便宜的程式模型。

Computer Use

Sonnet 5.5 在 OSWorld 2.1 上取得 80.1%,相較 Sonnet 5 的 57.0% 與 Opus 5.5 的 81.8%。OSWorld 評估操作圖形化電腦環境的能力,因此該結果顯示了大幅的世代躍升,並在涉及瀏覽器、桌面工具與多模態介面理解的工作流程中達到接近 Opus 的表現。Chartography 亦呈現相似趨勢於視覺圖表辨識:Sonnet 5.5 為 61.6%,Sonnet 5 為 15.6%。

Speed

Anthropic 指出 Sonnet 5.5 輸出生成比 Sonnet 5 快逾 30%,是發佈時最快的 Sonnet 模型。更快的輸出結合更少的工具呼叫與更低的 token 使用量,可縮短代理迴圈、減少迭代程式設計時的等待、並提升客服與其他高量工作流程的吞吐量。

How Much Does Claude Sonnet 5.5 Cost?

Pricing and official sourceClaude Sonnet 5.5CometAPI: Sonnet 5.5Claude Opus 5.5
Cache reads$0.20 / 1M$0.16 / 1M$0.20 / 1M
Five-minute cache writes$2.50 / 1M$2 / 1M$5 / 1M
Input tokens$2 / 1M$1.60/M$4 / 1M
Output tokens$10 / 1M$8.00/M$20 / 1M

以標準 token 費率計,Sonnet 5.5 的輸入與輸出成本均為 Opus 5.5 的一半。Anthropic 亦表示,新版 Sonnet 通常可用更少的 token 完成相同工作,進而降低每個完成任務的成本。

以上為標準 Claude API 價格。雲端供應商定價、區域處理、快取時長、批次折扣與長上下文規則,皆可能影響實際成本。

What Safety Changes Does Claude Sonnet 5.5 Introduce?

Anthropic 表示其自動化行為稽核涵蓋約 1,850 種情境,並在多數已測量的對齊度、抗濫用與誠實性指標上,相比 Sonnet 5 有所提升或持平。

Cybersecurity Safeguards

由於 Sonnet 5.5 的資安能力較前代更強,Anthropic 佈署了與更強模型類似的防護。常規軟體開發與一般錯誤修復仍受支援,而部分較高風險的資安任務則可能退回至較安全的模型路徑。

Biology Safeguards

該模型沿用 Sonnet 5 的生物安全防護,針對少數可能有害的請求進行限制,同時不影響多數研究、教育與臨床工作。

Anti-Distillation Protections

Anthropic 稱 Sonnet 5.5 是首個隨附安全分類器以防止透過產業級蒸餾攻擊進行推理萃取的 Sonnet 模型。它也擴展了保留思考,將思考內容綁定至產生它的帳號與對話,避免推理被任意分離並在其他處重播。多數開發者不會注意到此變更,但在不同帳號間移轉對話、或更改較早期系統訊息的系統,應檢視遷移指引。

上述為 Anthropic 的防護說明,並非對所有部署的獨立安全保證。團隊應依自身威脅模型、政策與高風險工作流程對模型進行評估。

Claude Sonnet 5.5 vs Claude Sonnet 5 vs Claude Opus 5.5 vs GPT-6 Sol

在這組模型中,Claude Sonnet 5.5 定位為快速、高效的生產機型。Anthropic 報告其輸出速度較 Claude Sonnet 5 快逾 30%,同時維持相同的標題 token 價格。Claude Opus 5.5 著重更困難且更具歧義的工作,而 GPT-6 Sol 則是 OpenAI 在長上下文程式與代理工作流程上的對應比較。

DimensionClaude Sonnet 5Claude Sonnet 5.5Claude Opus 5.5GPT-6 Sol
Positioning先前的 Sonnet 量產模型快速、高效的生產主力高階複雜推理複雜的程式與代理工作流程
Context window1M1M1M1.05M
Maximum output128K128K128K128K
Reasoning controls自適應努力自適應努力自適應思考,永遠啟用none、low、medium、high、xhigh、max
Multimodal input文字與影像文字與影像文字與影像文字與影像
API availabilityClaude API 與主要雲端平台Claude API 與主要雲端平台Claude API 與主要雲端平台Responses API 與 Chat Completions
Standard input / output price per 1M$2 / $10$2 / $10$4 / $20對於最長 272K 輸入 token 的提示為 $2 / $10
Speed基準比 Sonnet 5 快逾 30%為更困難、長時間的工作最佳化視推理努力而定
FrontierCode 1.142.4%46.2% at Max54.4%49.3% / 52.1% at Xhigh
GDPval-AA v2.11449184418461487
Best suited to現有的 Sonnet 工作負載高量程式與專業代理困難、模糊且長時間的任務OpenAI 原生的程式、代理、工具與長上下文工作流程

上述基準數據為跨供應商觀察,而非受控、永久的排名。結果取決於努力等級與部署條件。

How Do You Access and Call Claude Sonnet 5.5 Through CometAPI?

Claude Sonnet 5.5 可透過 Claude、Claude Platform、Amazon Web Services、Google Cloud 與 Microsoft Azure 使用。希望以單一與 OpenAI 相容介面存取多方供應商的開發者,可透過 CometAPI 的 Claude Sonnet 5.5 API 呼叫,模型識別碼為「claude-sonnet-5-5」。

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["COMETAPI_KEY"],
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="claude-sonnet-5-5",
    messages=[
        {
            "role": "user",
            "content": "Analyze this codebase and identify the three highest-impact bugs.",
        }
    ],
    max_tokens=2048,
)

print(response.choices[0].message.content)

用於生產時,請將 API 金鑰存於環境變數,並評估努力等級、快取、工具呼叫、重試策略與每個任務的 token 消耗。

What Is the Effort Setting in Claude Sonnet 5.5?

Claude Sonnet 5.5 支援可調整的努力等級,以速度與 token 使用量換取推理深度。Anthropic 在 Claude apps 與 Claude Code 中預設為 Medium,而 Claude Platform 預設為 High。

較低努力等級適合常規或高度結構化工作;較高等級則為更困難的程式、分析與代理任務提供更多推理與檢查。因此,生產預算應同時考量努力等級、工具使用與任務整體完成成本,而非僅關注 token 價格。

API: What’s new compared with Sonnet 5

五項變更可能破壞或改動既有的 Sonnet 5 整合:

  1. 關閉思考的遷移: 停用思考的整合應切換至 thinking: {"type": "between_tools"}。此設定關閉前置思考,同時保留工具之間的推理行為。
  2. 強制工具使用: 現在會對強制工具選擇回傳錯誤;在適當情況下請改用自動工具選擇並配合嚴格的綱要。
  3. 思考區塊保留: 思考區塊與模型及對話綁定。請原樣傳回,不要假設在變更較早的系統訊息、工具或帳號情境後仍可重播。
  4. 電腦操作工具版本: 在 Claude API 與 Google Cloud 上,較舊的 computer_20251124 工具不再被接受;請遷移至目前文件記載的 computer 工具集。
  5. Advisor 相容性: advisor 工具會拒絕 Claude Opus 4.8、Opus 4.7 與 Sonnet 5 作為 advisors。

另有一項回應結構變更可能悄然失敗:工具呼叫之間產生的文字,可能出現在思考區塊而非文字區塊。串流進度訊息的應用程式應按區塊型別處理回應,並設定合適的顯示模式。Sonnet 5.5 亦新增訊息級努力(測試中)、對話中途的系統訊息、對話中途工具變更(測試中)、512-token 的最小可快取提示長度、批次處理、Files API 支援、PDF 與視覺輸入,以及伺服端與客戶端工具。

What Does Claude Sonnet 5.5 Mean for the Claude 5.5 Family?

  • Claude Opus 5.5:複雜、高判斷、長期任務。
  • Claude Sonnet 5.5:高效率生產、程式、代理與專業工作。
  • Claude Haiku 5.5:已宣布為家族中的高吞吐、成本敏感成員。

更廣泛的轉變,是從單看原始 token 價或單一基準,轉向以每個成功任務的成本、推理速度與模型路由作為衡量。

Conclusion

Claude Sonnet 5.5 是針對生產效率而升級的 Anthropic 量產機型。它延續 Sonnet 5 的 $2/$10 標準 token 價,並加入 1M-token 上下文視窗、最多 128K 輸出 token、顯著更快的生成,以及在程式、電腦操作、視覺理解與知識型工作上的強勁提升。

其最強的訴求在於工作經濟性:完成任務的可靠與速度、所耗工具呼叫與 token 數量,以及工作流程需要升級至 Opus 5.5 的頻率。團隊應在自身任務上驗證這些因素,並將跨供應商基準視為時間點觀察,而非永久排名。

繼續學習

把這篇文章連到下一個決策。

查看所有主題
發布於 Sep 29, 2026
最後更新 Sep 29, 2026
0 次瀏覽
已審核內容清晰度、來源標註與最新 API 術語。

準備好將 AI 開發成本降低 20% 了嗎?

幾分鐘內免費開始。包含免費試用點數。無需信用卡。

閱讀更多