TL;DR
Claude Sonnet 5.5 是 Anthropic 最新的 Sonnet 級模型,於 2026 年 9 月 28 日發佈。其定位為 Claude Opus 5.5 的更快、成本更低的補充機型,面向程式設計、範圍明確的代理任務、文件產出、電腦操作與多模態分析。
該模型維持標準定價:每百萬輸入 token $2、每百萬輸出 token $10。Anthropic 稱其輸出生成速度較 Sonnet 5 快逾 30%,且由於常以更少的 token 與步驟完成任務,整體任務成本可降低至多 30%。
已公布成績包括 Terminal-Bench 4.0 的 70.6%、CursorBench 4.0 的 55.5%、GDPval-AA v2.1 的 1844,以及 OSWorld 2.1 的 80.1%。實務價值不在單一分數:Sonnet 5.5 在多項專業工作評測上逼近 Opus 5.5,同時保有較低的標準 token 價。
Key Takeaways
- Claude Sonnet 5.5 是 Anthropic 的 Claude 5.5 家族中第二款機型,偏重快速生產型工作,而非最具歧義、開放式的任務。
- 支援 1M-token 上下文視窗、最多 128K 輸出 token、文字與影像輸入、自適應思考、工具使用與結構化回應。
- 標準 Claude API 定價為輸入 $2/M、輸出 $10/M、快取讀取 $0.20/M、五分鐘快取寫入 $2.50/M。
- Anthropic 報告顯示:相較 Sonnet 5,輸出速度提升 30% 以上,並在程式設計、電腦操作、圖表理解與長期知識型工作上有明顯進步。
- Claude API 模型 ID 為「claude-sonnet-5-5」;開發者也可透過 CometAPI 的 Claude Sonnet 5.5 API 存取。
What Is Claude Sonnet 5.5?
Claude Sonnet 5.5 是 Anthropic 最新的通用 Sonnet 模型,也是 Claude 5.5 家族在 Claude Opus 5.5 之後的第二次發佈。Anthropic 將其定位為 Opus 的更快、更低成本補充,而非旗艦的直接替代。
這一區分具實務意義:Opus 5.5 面向需要持續判斷的複雜、含糊工作;Sonnet 5.5 則針對範圍明確的任務、修補錯誤、快速迭代、程式設計、文件生產與高量專業工作流程進行優化。
What Are the Most Important Claude Sonnet 5.5 Features?
該模型結合了 1M-token 上下文視窗、最高 128K 輸出 token、文字與影像輸入、自適應思考、可調整的努力等級、工具使用、結構化輸出、提示快取、批次處理,並支援 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 與 Claude Platform on AWS。對生產團隊而言,關鍵不在單一功能,而是更快的生成、更少的任務級 token 使用量,以及在多項範圍明確的專業工作中逼近 Opus 的表現。
Claude Sonnet 5.5 benchmarks
Anthropic 報告在程式設計、長期專業工作、電腦操作與視覺理解方面皆有顯著提升。下表彙總該公司已發布的評測結果。
| Benchmark and official source | Claude Sonnet 5.5 | Claude Sonnet 5 | Claude Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 | 70.6% | 10.3% | 66.4% at Xhigh | Not publicly reported |
| FrontierCode 1.1 Main | 46.2% at Max | 42.4% | 54.4% | 49.3% / 52.1% at Xhigh |
| CursorBench 4.0 | 55.5% | 34.1% | 57.8% | Not publicly reported |
| GDPval-AA v2.1 | 1844 | 1449 | 1846 | 1487 |
| AA-Briefcase v1.1 | 1811 | 1359 | 1822 | 1483 |
| Humanity's Last Exam | 64.5% with tools | 54.9% | 67.7% | Not reported in the source table |
| OSWorld 2.1 | 80.1% | 57.0% | 81.8% | Not reported in the source table |
| Chartography | 61.6% | 15.6% | 64.4% | 53.6% |
Evaluation conditions and caveats: 分數並非皆在相同努力等級下測得。Opus 5.5 的 66.4% Terminal-Bench 成績是在 Xhigh 報告。Anthropic 指出,在 FrontierCode 上,Sonnet 5.5 於 Max 的分數可能低於 Xhigh,因為額外的審查步驟可能引發逾時或超出範圍的編輯。Artificial Analysis 在一個受結構化輸出錯誤影響的 Sonnet 5.5 預發布部署上執行了 GDPval-AA 與 AA-Briefcase,Anthropic 稱該問題已修復。跨供應商的 GPT-6 Sol 數據也應視為較早的觀察,因為 OpenAI 於 2026 年 9 月 25 日修正了一個影像編碼問題。
What the results mean: Sonnet 5.5 不僅僅是在單一指標上領先 Sonnet 5。它在程式設計、專業工作、電腦操作與圖表辨識方面更接近 Opus 5.5,同時保持 Sonnet 等級的定價。Anthropic 亦報告,於 Low 或 Medium 的努力等級下,Sonnet 5.5 能在多項評測中以約十分之一的任務成本超過 Sonnet 5 的最佳成績。此種能力、速度與任務級效率的組合,是其主要競爭優勢。
How Good Is Claude Sonnet 5.5?
Coding
進步也體現在操作層面。Anthropic 指出 Sonnet 5.5 對程式碼庫的理解更快、工具呼叫批次化更有效率、採用更少步驟,並降低每個完成任務的成本。FrontierCode 檢驗提議的程式變更是否可合併,而 CursorBench 取材自真實程式工作階段的多檔案且具歧義任務;因此,這些提升反映了在版本庫層級的執行與判斷,不僅是短程式生成。這些變化對修復錯誤、程式碼審查、測試執行與長時程的程式代理很重要。

Knowledge Work
改進並不限於程式領域。GDPval-AA 檢測 44 種職業與九大產業中的真實專業任務,因此 Sonnet 5.5 的 1844 分(對比 Sonnet 5 的 1449 與 Opus 5.5 的 1846)顯示,其提升轉化為實務分析、文件生產與決策支持,而非只停留在實驗室推理測試。
Anthropic 強調財務分析、文件綜整、簡報製作、試算表處理、圖表解讀、來源查核、資訊檢索與專業寫作等領域的提升。
早期測試者也回報了較難量化的改進:更清晰的協作、更自然的對話式判斷,以及更好的設計眼光。Anthropic 稱該模型可為使用者介面增添光澤,並能嚴格遵循簡報模板以產出幾乎不需編修的投影片;在一次內部營運審查測試中,兩位專家判定首版即可直接發送、無須修改。
更廣泛的含義是:Sonnet 5.5 應被理解為一款專業工作模型,而不僅是更便宜的程式模型。
Computer Use
Sonnet 5.5 在 OSWorld 2.1 上取得 80.1%,相較 Sonnet 5 的 57.0% 與 Opus 5.5 的 81.8%。OSWorld 評估操作圖形化電腦環境的能力,因此該結果顯示了大幅的世代躍升,並在涉及瀏覽器、桌面工具與多模態介面理解的工作流程中達到接近 Opus 的表現。Chartography 亦呈現相似趨勢於視覺圖表辨識:Sonnet 5.5 為 61.6%,Sonnet 5 為 15.6%。
Speed
Anthropic 指出 Sonnet 5.5 輸出生成比 Sonnet 5 快逾 30%,是發佈時最快的 Sonnet 模型。更快的輸出結合更少的工具呼叫與更低的 token 使用量,可縮短代理迴圈、減少迭代程式設計時的等待、並提升客服與其他高量工作流程的吞吐量。
How Much Does Claude Sonnet 5.5 Cost?
| Pricing and official source | Claude Sonnet 5.5 | CometAPI: Sonnet 5.5 | Claude Opus 5.5 |
|---|---|---|---|
| Cache reads | $0.20 / 1M | $0.16 / 1M | $0.20 / 1M |
| Five-minute cache writes | $2.50 / 1M | $2 / 1M | $5 / 1M |
| Input tokens | $2 / 1M | $1.60/M | $4 / 1M |
| Output tokens | $10 / 1M | $8.00/M | $20 / 1M |
以標準 token 費率計,Sonnet 5.5 的輸入與輸出成本均為 Opus 5.5 的一半。Anthropic 亦表示,新版 Sonnet 通常可用更少的 token 完成相同工作,進而降低每個完成任務的成本。
以上為標準 Claude API 價格。雲端供應商定價、區域處理、快取時長、批次折扣與長上下文規則,皆可能影響實際成本。
What Safety Changes Does Claude Sonnet 5.5 Introduce?
Anthropic 表示其自動化行為稽核涵蓋約 1,850 種情境,並在多數已測量的對齊度、抗濫用與誠實性指標上,相比 Sonnet 5 有所提升或持平。
Cybersecurity Safeguards
由於 Sonnet 5.5 的資安能力較前代更強,Anthropic 佈署了與更強模型類似的防護。常規軟體開發與一般錯誤修復仍受支援,而部分較高風險的資安任務則可能退回至較安全的模型路徑。
Biology Safeguards
該模型沿用 Sonnet 5 的生物安全防護,針對少數可能有害的請求進行限制,同時不影響多數研究、教育與臨床工作。
Anti-Distillation Protections
Anthropic 稱 Sonnet 5.5 是首個隨附安全分類器以防止透過產業級蒸餾攻擊進行推理萃取的 Sonnet 模型。它也擴展了保留思考,將思考內容綁定至產生它的帳號與對話,避免推理被任意分離並在其他處重播。多數開發者不會注意到此變更,但在不同帳號間移轉對話、或更改較早期系統訊息的系統,應檢視遷移指引。
上述為 Anthropic 的防護說明,並非對所有部署的獨立安全保證。團隊應依自身威脅模型、政策與高風險工作流程對模型進行評估。
Claude Sonnet 5.5 vs Claude Sonnet 5 vs Claude Opus 5.5 vs GPT-6 Sol
在這組模型中,Claude Sonnet 5.5 定位為快速、高效的生產機型。Anthropic 報告其輸出速度較 Claude Sonnet 5 快逾 30%,同時維持相同的標題 token 價格。Claude Opus 5.5 著重更困難且更具歧義的工作,而 GPT-6 Sol 則是 OpenAI 在長上下文程式與代理工作流程上的對應比較。
| Dimension | Claude Sonnet 5 | Claude Sonnet 5.5 | Claude Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Positioning | 先前的 Sonnet 量產模型 | 快速、高效的生產主力 | 高階複雜推理 | 複雜的程式與代理工作流程 |
| Context window | 1M | 1M | 1M | 1.05M |
| Maximum output | 128K | 128K | 128K | 128K |
| Reasoning controls | 自適應努力 | 自適應努力 | 自適應思考,永遠啟用 | none、low、medium、high、xhigh、max |
| Multimodal input | 文字與影像 | 文字與影像 | 文字與影像 | 文字與影像 |
| API availability | Claude API 與主要雲端平台 | Claude API 與主要雲端平台 | Claude API 與主要雲端平台 | Responses API 與 Chat Completions |
| Standard input / output price per 1M | $2 / $10 | $2 / $10 | $4 / $20 | 對於最長 272K 輸入 token 的提示為 $2 / $10 |
| Speed | 基準 | 比 Sonnet 5 快逾 30% | 為更困難、長時間的工作最佳化 | 視推理努力而定 |
| FrontierCode 1.1 | 42.4% | 46.2% at Max | 54.4% | 49.3% / 52.1% at Xhigh |
| GDPval-AA v2.1 | 1449 | 1844 | 1846 | 1487 |
| Best suited to | 現有的 Sonnet 工作負載 | 高量程式與專業代理 | 困難、模糊且長時間的任務 | OpenAI 原生的程式、代理、工具與長上下文工作流程 |
上述基準數據為跨供應商觀察,而非受控、永久的排名。結果取決於努力等級與部署條件。
How Do You Access and Call Claude Sonnet 5.5 Through CometAPI?
Claude Sonnet 5.5 可透過 Claude、Claude Platform、Amazon Web Services、Google Cloud 與 Microsoft Azure 使用。希望以單一與 OpenAI 相容介面存取多方供應商的開發者,可透過 CometAPI 的 Claude Sonnet 5.5 API 呼叫,模型識別碼為「claude-sonnet-5-5」。
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["COMETAPI_KEY"],
base_url="https://api.cometapi.com/v1",
)
response = client.chat.completions.create(
model="claude-sonnet-5-5",
messages=[
{
"role": "user",
"content": "Analyze this codebase and identify the three highest-impact bugs.",
}
],
max_tokens=2048,
)
print(response.choices[0].message.content)
用於生產時,請將 API 金鑰存於環境變數,並評估努力等級、快取、工具呼叫、重試策略與每個任務的 token 消耗。
What Is the Effort Setting in Claude Sonnet 5.5?
Claude Sonnet 5.5 支援可調整的努力等級,以速度與 token 使用量換取推理深度。Anthropic 在 Claude apps 與 Claude Code 中預設為 Medium,而 Claude Platform 預設為 High。
較低努力等級適合常規或高度結構化工作;較高等級則為更困難的程式、分析與代理任務提供更多推理與檢查。因此,生產預算應同時考量努力等級、工具使用與任務整體完成成本,而非僅關注 token 價格。
API: What’s new compared with Sonnet 5
五項變更可能破壞或改動既有的 Sonnet 5 整合:
- 關閉思考的遷移: 停用思考的整合應切換至 thinking: {"type": "between_tools"}。此設定關閉前置思考,同時保留工具之間的推理行為。
- 強制工具使用: 現在會對強制工具選擇回傳錯誤;在適當情況下請改用自動工具選擇並配合嚴格的綱要。
- 思考區塊保留: 思考區塊與模型及對話綁定。請原樣傳回,不要假設在變更較早的系統訊息、工具或帳號情境後仍可重播。
- 電腦操作工具版本: 在 Claude API 與 Google Cloud 上,較舊的 computer_20251124 工具不再被接受;請遷移至目前文件記載的 computer 工具集。
- Advisor 相容性: advisor 工具會拒絕 Claude Opus 4.8、Opus 4.7 與 Sonnet 5 作為 advisors。
另有一項回應結構變更可能悄然失敗:工具呼叫之間產生的文字,可能出現在思考區塊而非文字區塊。串流進度訊息的應用程式應按區塊型別處理回應,並設定合適的顯示模式。Sonnet 5.5 亦新增訊息級努力(測試中)、對話中途的系統訊息、對話中途工具變更(測試中)、512-token 的最小可快取提示長度、批次處理、Files API 支援、PDF 與視覺輸入,以及伺服端與客戶端工具。
What Does Claude Sonnet 5.5 Mean for the Claude 5.5 Family?
- Claude Opus 5.5:複雜、高判斷、長期任務。
- Claude Sonnet 5.5:高效率生產、程式、代理與專業工作。
- Claude Haiku 5.5:已宣布為家族中的高吞吐、成本敏感成員。
更廣泛的轉變,是從單看原始 token 價或單一基準,轉向以每個成功任務的成本、推理速度與模型路由作為衡量。
Conclusion
Claude Sonnet 5.5 是針對生產效率而升級的 Anthropic 量產機型。它延續 Sonnet 5 的 $2/$10 標準 token 價,並加入 1M-token 上下文視窗、最多 128K 輸出 token、顯著更快的生成,以及在程式、電腦操作、視覺理解與知識型工作上的強勁提升。
其最強的訴求在於工作經濟性:完成任務的可靠與速度、所耗工具呼叫與 token 數量,以及工作流程需要升級至 Opus 5.5 的頻率。團隊應在自身任務上驗證這些因素,並將跨供應商基準視為時間點觀察,而非永久排名。
