TL;DR
Claude Sonnet 5.5 は Anthropic の最新の Sonnet クラスのモデルで、2026年9月28日にリリースされました。コード作成、明確にスコープされたエージェント型作業、ドキュメント生成、コンピュータ操作、マルチモーダル分析において、Claude Opus 5.5 を補完する高速・低コストの位置づけです。
標準価格は入力 1M トークンあたり $2、出力 1M トークンあたり $10 を維持。Anthropic は、Sonnet 5 と比較して出力生成が30%以上高速化し、新モデルはより少ないトークンとステップで作業を完了することが多いため、タスク単位のコストが最大30%低下し得ると報告しています。
公開結果は、Terminal-Bench 4.0 で 70.6%、CursorBench 4.0 で 55.5%、GDPval-AA v2.1 で 1844、OSWorld 2.1 で 80.1%。実用上の価値は単一スコアではなく、Sonnet 5.5 が複数のプロフェッショナル評価で Opus 5.5 に迫りつつ、標準トークン価格を低く保っている点にあります。
Key Takeaways
- Claude Sonnet 5.5 は Claude 5.5 ファミリーの2番目のモデルで、最も曖昧でオープンエンドな課題よりも、迅速なプロダクション作業に最適化されています。
- 1M トークンのコンテキストウィンドウ、最大 128K 出力トークン、テキストと画像入力、適応的思考、ツール使用、構造化レスポンスに対応。
- 標準の Claude API 価格は、入力 $2/M、出力 $10/M、キャッシュ読み取り $0.20/M、5分キャッシュ書き込み $2.50/M。
- Sonnet 5 比で 30%以上の出力高速化と、コーディング、コンピュータ操作、チャート理解、長期的な知識作業での大幅な強化を報告。
- Claude API のモデル ID は claude-sonnet-5-5。開発者は Claude Sonnet 5.5 API in CometAPI からもアクセス可能。
What Is Claude Sonnet 5.5?
Claude Sonnet 5.5 は Anthropic の最新の汎用 Sonnet モデルで、Claude Opus 5.5 に続く Claude 5.5 ファミリーの第2弾です。Anthropic は、本モデルをフラッグシップの代替ではなく、より高速・低コストな補完として位置づけています。
違いは実務面にあります。Opus 5.5 は持続的な判断を要する複雑で曖昧な作業を狙い、Sonnet 5.5 は明確なタスク、バグ修正、高速な反復、コーディング、ドキュメント生成、大量のプロフェッショナルワークフローに最適化されています。
What Are the Most Important Claude Sonnet 5.5 Features?
本モデルは、1M トークンのコンテキストウィンドウ、最大 128K 出力トークン、テキスト+画像入力、適応的思考、調整可能なエフォート、ツール使用、構造化出力、プロンプトキャッシュ、バッチ処理、そして Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry、AWS 上の Claude Platform 全体でのサポートを組み合わせています。プロダクションチームにとって決め手は単一機能ではなく、高速生成、タスク単位のトークン削減、そして明確なプロフェッショナルワークロードでの Opus 近似性能という組み合わせです。
Claude Sonnet 5.5 benchmarks
Anthropic は、コーディング、長期的なプロフェッショナル作業、コンピュータ操作、視覚理解での大幅な向上を報告しています。以下は同社が公開した評価結果の要約です。
| Benchmark and official source | Claude Sonnet 5.5 | Claude Sonnet 5 | Claude Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 | 70.6% | 10.3% | 66.4% at Xhigh | Not publicly reported |
| FrontierCode 1.1 Main | 46.2% at Max | 42.4% | 54.4% | 49.3% / 52.1% at Xhigh |
| CursorBench 4.0 | 55.5% | 34.1% | 57.8% | Not publicly reported |
| GDPval-AA v2.1 | 1844 | 1449 | 1846 | 1487 |
| AA-Briefcase v1.1 | 1811 | 1359 | 1822 | 1483 |
| Humanity's Last Exam | 64.5% with tools | 54.9% | 67.7% | Not reported in the source table |
| OSWorld 2.1 | 80.1% | 57.0% | 81.8% | Not reported in the source table |
| Chartography | 61.6% | 15.6% | 64.4% | 53.6% |
評価条件と注意事項: スコアはすべて同一のエフォート設定ではありません。Opus 5.5 の Terminal-Bench 66.4% は Xhigh での結果です。Anthropic は、追加のレビュー手順がタイムアウトや範囲外の編集を招く場合があるため、Sonnet 5.5 は FrontierCode において Max より Xhigh の方が高得点となる場合があると注記しています。Artificial Analysis は、構造化出力のバグ(後に Anthropic が修正と説明)に影響されたプレリリース版 Sonnet 5.5 で GDPval-AA と AA-Briefcase を実行しました。クロスベンダーの GPT-6 Sol 数値も、OpenAI が 2026年9月25日に画像エンコードの問題を修正したため、過去の観測として扱うべきです。
結果の意味: Sonnet 5.5 は孤立したスコアで単に Sonnet 5 を上回るだけではありません。コーディング、プロフェッショナル作業、コンピュータ操作、チャート認識で Opus 5.5 に大きく近づきつつ、Sonnet レベルの価格を維持しています。Anthropic はまた、Low や Medium のエフォートでは、Sonnet 5 の最良スコアを複数の評価で上回りつつ、タスクあたりのコストを約10分の1に抑え得ると報告。能力、速度、タスク単位の効率性の組み合わせこそが主な競争優位だとしています。
How Good Is Claude Sonnet 5.5?
Coding
向上は運用面にも及びます。Anthropic は、Sonnet 5.5 がコードベースの理解を高速化し、ツール呼び出しのバッチ化を効率化し、ステップを削減し、完了タスクあたりのコストを低減すると報告。FrontierCode は提案コード変更のマージ可否を測り、CursorBench は実際のコーディングセッションからの曖昧で多ファイルなタスクを用いるため、向上は短い生成だけでなく、リポジトリレベルの実行と判断に反映されます。これらの変化は、バグ修正、コードレビュー、テスト実行、長時間稼働のコーディングエージェントに重要です。

Knowledge Work
改善はプログラミング以外にも及びます。GDPval-AA は 44 の職種と 9 の主要産業にわたる実世界のプロフェッショナルタスクを評価します。Sonnet 5.5 の 1844(Sonnet 5 は 1449、Opus 5.5 は 1846)は、向上が実務的な分析、ドキュメント生成、意思決定支援に転移し、実験室的な推論テストにとどまらないことを示唆します。
Anthropic は、財務分析、ドキュメント統合、スライド作成、スプレッドシート作業、チャート解釈、ソース確認、情報取得、プロフェッショナルライティングを改善領域として挙げています。
初期テスターは、定量化が難しい改善として、より明瞭なコラボレーション、自然な会話上の判断、デザインに対する目の強化も報告。Anthropic は、同モデルがユーザーインターフェースに磨きをかけ、スライドテンプレートに忠実に従って、最小限の編集で済むデッキを作成できるとし、ある社内のオペレーティングレビューでは、専門家2名が初稿を無修正で送付可と判断したと述べています。
より広い含意として、Sonnet 5.5 は単なる安価なコーディングモデルではなく、プロフェッショナルワークモデルとして理解するのが適切です。
Computer Use
Sonnet 5.5 は OSWorld 2.1 で 80.1%(Sonnet 5 は 57.0%、Opus 5.5 は 81.8%)。OSWorld はグラフィカル環境の操作能力を評価するため、これはブラウザ、デスクトップツール、マルチモーダルなインターフェース理解を含むワークフローで大幅な世代改善と Opus に近い性能を示します。視覚チャート認識の Chartography でも同様の傾向で、Sonnet 5.5 は 61.6%(Sonnet 5 は 15.6%)。
Speed
Anthropic は、Sonnet 5.5 が Sonnet 5 より 30%以上高速に出力生成すると報告し、ローンチ時点で最速の Sonnet だとしています。高速出力は、ツール呼び出しの削減とトークン使用量の低減と相まって、エージェントのループを短縮し、反復的なコーディング中の待ち時間を減らし、サポートなど大量業務のスループットを向上させます。
How Much Does Claude Sonnet 5.5 Cost?
| Pricing and official source | Claude Sonnet 5.5 | CometAPI: Sonnet 5.5 | Claude Opus 5.5 |
|---|---|---|---|
| Cache reads | $0.20 / 1M | $0.16 / 1M | $0.20 / 1M |
| Five-minute cache writes | $2.50 / 1M | $2 / 1M | $5 / 1M |
| Input tokens | $2 / 1M | $1.60/M | $4 / 1M |
| Output tokens | $10 / 1M | $8.00/M | $20 / 1M |
標準のトークンレートでは、Sonnet 5.5 は入力・出力ともに Opus 5.5 の半額です。Anthropic はまた、新しい Sonnet は同一作業を完了するのに Sonnet 5 より少ないトークンで済むことが多く、完了タスクあたりのコストを下げると述べています。
これらは標準の Claude API 価格です。クラウドプロバイダの価格、地域処理、キャッシュの有効期間、バッチ割引、長文コンテキストのルールにより、実効コストは変動し得ます。
What Safety Changes Does Claude Sonnet 5.5 Introduce?
Anthropic は約 1,850 のシナリオを対象とした自動行動監査で、整合性、悪用耐性、誠実性の多くの測定で、Sonnet 5.5 が Sonnet 5 に対して改善または同等であることを確認したと述べています。
Cybersecurity Safeguards
Sonnet 5.5 は前モデルよりサイバー機能が強化されているため、Anthropic はより高性能なモデル向けと同様のセーフガードを導入しています。日常的なソフトウェア開発や一般的なバグ修正は引き続きサポートする一方で、リスクの高い一部のサイバーセキュリティ作業はより安全なモデル経路にフォールバックする場合があります。
Biology Safeguards
生物学に関するセーフガードは Sonnet 5 と同一で、潜在的に有害な依頼の狭い範囲を対象にしつつ、研究、教育、臨床の大半を影響しないよう設計されています。
Anti-Distillation Protections
Anthropic は、Sonnet 5.5 が産業規模の蒸留攻撃による推論抽出を防ぐためのセーフティ分類器を備えてローンチした初の Sonnet だと述べています。また、preserved thinking を拡張し、思考内容を作成したアカウントと会話に結び付け、推論が自由に切り離され他所で再生されないようにします。多くの開発者はこの変化に気づかないかもしれませんが、アカウント間で会話を移動したり、以前のシステムメッセージを変更するシステムは移行ガイダンスを確認すべきです。
これらは Anthropic の報告するセーフガードであり、あらゆる導入に対する独立した安全保証ではありません。各チームは、自身の脅威モデル、ポリシー、高リスクなワークフローに照らし合わせて評価してください。
Claude Sonnet 5.5 vs Claude Sonnet 5 vs Claude Opus 5.5 vs GPT-6 Sol
Claude Sonnet 5.5 は、このグループにおける高速・効率的なプロダクションモデルとして位置づけられます。Anthropic は、Claude Sonnet 5 と比べて 30%以上高速に出力を生成しつつ、見出しのトークン価格を据え置いたと報告。Claude Opus 5.5 はより難しく曖昧な作業を狙い、GPT-6 Sol は長文コンテキストのコーディングやエージェント型ワークフローでの OpenAI の最も近い比較対象です。
| Dimension | Claude Sonnet 5 | Claude Sonnet 5.5 | Claude Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Positioning | 既存の Sonnet プロダクションモデル | 高速・効率的なプロダクションの主力 | より高度な複雑推論 | 複雑なコーディングとエージェント型ワークフロー |
| Context window | 1M | 1M | 1M | 1.05M |
| Maximum output | 128K | 128K | 128K | 128K |
| Reasoning controls | Adaptive effort | Adaptive effort | Adaptive thinking, always on | none, low, medium, high, xhigh, and max |
| Multimodal input | テキストと画像 | テキストと画像 | テキストと画像 | テキストと画像 |
| API availability | Claude API と主要クラウド | Claude API と主要クラウド | Claude API と主要クラウド | Responses API と Chat Completions |
| Standard input / output price per 1M | $2 / $10 | $2 / $10 | $4 / $20 | $2 / $10 for prompts up to 272K input tokens |
| Speed | ベースライン | Sonnet 5 比で 30%以上高速 | より難しく長時間の作業に最適化 | 推論エフォートにより変動 |
| FrontierCode 1.1 | 42.4% | 46.2% at Max | 54.4% | 49.3% / 52.1% at Xhigh |
| GDPval-AA v2.1 | 1449 | 1844 | 1846 | 1487 |
| Best suited to | 既存の Sonnet ワークロード | 大量コーディングとプロフェッショナルエージェント | 難易度・曖昧性が高く長時間のタスク | OpenAI ネイティブのコーディング、エージェント、ツール、長文ワークフロー |
これらのベンチマーク数値は、恒常的なランキングではなくベンダー横断の観測結果です。結果はエフォート設定や導入条件に依存します。
How Do You Access and Call Claude Sonnet 5.5 Through CometAPI?
Claude Sonnet 5.5 は Claude、Claude Platform、Amazon Web Services、Google Cloud、Microsoft Azure で利用可能です。複数プロバイダに対して OpenAI 互換の単一インターフェースを求める開発者は、モデル識別子 claude-sonnet-5-5 で Claude Sonnet 5.5 API in CometAPI 経由でも呼び出せます。
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["COMETAPI_KEY"],
base_url="https://api.cometapi.com/v1",
)
response = client.chat.completions.create(
model="claude-sonnet-5-5",
messages=[
{
"role": "user",
"content": "Analyze this codebase and identify the three highest-impact bugs.",
}
],
max_tokens=2048,
)
print(response.choices[0].message.content)
本番運用では、API キーを環境変数に保存し、エフォート設定、キャッシュ、ツール呼び出し、リトライ動作、タスク単位のトークン消費を評価してください。
What Is the Effort Setting in Claude Sonnet 5.5?
Claude Sonnet 5.5 は、速度とトークン使用量を推論の深さとトレードオフする調整可能なエフォートレベルをサポートします。Anthropic は、Claude アプリと Claude Code ではデフォルトを Medium、Claude Platform では High に設定しています。
低いエフォート設定は日常的・高度に構造化された作業に適し、より高い設定は、より難しいコーディング、分析、エージェントタスクのために、より多くの推論とチェックを許容します。したがってプロダクションの予算策定では、エフォート、ツール使用、タスク完了総コストをトークン価格だけでなく考慮すべきです。
API: What’s new compared with Sonnet 5
既存の Sonnet 5 連携に影響し得る変更が5点あります。
- Thinking-off migrations: thinking を無効化していた連携は thinking: {"type": "between_tools"} に移行してください。この設定は初期思考をオフにしつつ、ツール間の推論動作を保持します。
- Forced tool use: ツールの強制指定はエラーを返すようになりました。厳格なスキーマが適切な場合は自動ツール選択を使用してください。
- Thinking-block preservation: thinking ブロックはモデルと会話に紐づきます。ブロックは変更せずに返却し、システムメッセージ、ツール、アカウントコンテキストを変更した後に再生できると仮定しないでください。
- Computer-use tool version: Claude API と Google Cloud では、旧 computer_20251124 ツールは受理されません。現在ドキュメント化されているコンピュータツール群に移行してください。
- Advisor compatibility: advisor ツールは、Claude Opus 4.8、Opus 4.7、Sonnet 5 をアドバイザとして拒否します。
もう一つのレスポンス形状の変更はサイレントに失敗する可能性があります。ツール呼び出し間に生成されたテキストが、テキストブロックではなく thinking ブロックに現れる場合があります。進捗メッセージをストリーミング表示するアプリケーションは、ブロックタイプでレスポンスを処理し、適切な表示モードを設定してください。Sonnet 5.5 はまた、メッセージごとのエフォート(ベータ)、会話途中のシステムメッセージ、会話途中のツール変更(ベータ)、キャッシュ可能プロンプトの最小 512 トークン、バッチ処理、Files API、PDF とビジョン入力、サーバーサイド/クライアントサイドツールも追加しています。
What Does Claude Sonnet 5.5 Mean for the Claude 5.5 Family?
- Claude Opus 5.5: 複雑で高判断・長期的な作業。
- Claude Sonnet 5.5: 効率的なプロダクション、コーディング、エージェント、プロフェッショナルワーク。
- Claude Haiku 5.5: 高スループット・コスト重視のメンバーとして今後発表予定。
より広い潮流として、原価のトークン価格や単一ベンチマークのみではなく、成功タスクあたりのコスト、推論速度、モデルルーティングを重視する方向に移行しています。
Conclusion
Claude Sonnet 5.5 は、Anthropic のプロダクション層に向けた効率重視のアップグレードです。Sonnet 5 の $2/$10 の標準トークン価格を維持しつつ、1M トークンのコンテキストウィンドウ、最大 128K の出力トークン、生成の大幅な高速化、コーディング、コンピュータ操作、視覚理解、知識作業全般での強化を加えています。
本モデルの最も強い主張はワークロード経済性です。すなわち、どれだけ確実かつ迅速にタスクを完了するか、ツール呼び出しとトークンをどれだけ消費するか、そしてどの程度の頻度でワークフローが Opus 5.5 へのエスカレーションを必要とするか。各チームは自分たちのタスクでこれらを検証し、クロスベンダーのベンチマークを恒久的な順位ではなく、時点の観測として扱うべきです。
