技術仕様 — Claude Sonnet 4.6
| 項目 | Claude Sonnet 4.6(公開サマリー) |
|---|---|
| 提供元 | Anthropic |
| モデルファミリー | Sonnet(Claude v4.x ファミリー)— Sonnet 4.6 バリアント |
| モデルID(正準) | claude-sonnet-4-6 |
| 入力タイプ | テキスト(主要)。構造化ツール/JSON I/O への限定的/セカンダリ対応。画像生成を主用途とするモデルではない。 |
| 出力タイプ | テキスト(自然言語、構造化 JSON、コード、ツールコールのペイロード) |
| コンテキストウィンドウ | ~200,000 トークン(概算)— 複数ドキュメントおよび長時間セッションの一貫性を想定 |
| 関数呼び出し/ツール利用 | はい — 構造化ツールの呼び出し、JSON 制約出力、エージェント型オーケストレーションに対応 |
| マルチモーダル性 | 限定的 — Sonnet はテキストと構造化ツール統合に注力しており、画像生成には最適化されていない。 |
| リリースノートのハイライト | 長コンテキスト推論の安定性/改善、速度–精度のトレードオフに調整された低レイテンシの Sonnet バリアント、指示遵守性の向上。 |
Claude Sonnet 4.6 とは
Claude Sonnet 4.6 は Anthropic の Sonnet モデルラインの最新進化版で、より手頃な価格帯で Opus に近い性能を提供します。先行の 4.5 から強化され、より強力な指示遵守、はるかに拡張されたコンテキスト対応、コーディングやコンピュータ操作能力の改善、そしてより広範な多段階推論能力を実現しながら、価格は Sonnet 4.5 と同水準を維持しています。
重厚なエージェント作業に最適化されたフラッグシップの Opus モデルとは異なり、Sonnet 4.6 はコスト効率と幅広い能力が重視される開発者や一般的な知識業務を対象としています。
Claude Sonnet 4.6 の主な機能
- 1M トークン コンテキストウィンドウ(ベータ): Sonnet 4.6 はベータで最大 1M トークン のコンテキストをサポートします。単一リクエストでコードベース全体、複数の法的契約書の束、あるいは複数の学術論文を取り込むのに十分なおおよその容量です。
- コーディング性能の向上: Sonnet 4.5 と比較して、実運用の開発タスクや SWE-Bench Verified(約 79.6% と報告)などのベンチマークで大幅な改善を示し、複雑なコーディングタスクに適しています。
- コンピュータ操作の強化: ソフトウェア操作(スプレッドシート、複数ステップの Web フォームワークフロー等)で新たなレベルの有能さを示し、OSWorld-Verified テストで人間レベルに迫る性能を達成。
- アダプティブシンキング: 強化された推論戦略を取り入れ、複雑な問題に段階的に取り組むために内部計算資源を動的に配分できます。
- より強力な指示遵守: 詳細な要求への一貫性と精度が向上し、ハルシネーションが減少、タスク完了精度が改善。
- 安全性とプロンプトインジェクション耐性: Sonnet 4.5 と比べて、プロンプトインジェクション攻撃などへの堅牢性が強化されています。
Claude Sonnet 4.6 のベンチマーク性能
| 評価 | Claude Sonnet 4.6(概算) | 注記 |
|---|---|---|
| SWE-Bench Verified | ~79.6% | Opus クラスに迫る強力なコーディング性能。 |
| OSWorld-Verified(Computer Use) | ~72.5% | 人間レベルに近いタスク性能。ワークフローに強力。 |
| ARC-AGI-2 | ~60.4% | 広範な推論能力を反映。 |
ミッドティアモデルとして、Sonnet 4.6 は Opus モデルとの性能差を大きく縮め、従来はフラッグシップ向けと見なされていた多くのタスクにも適用可能にしています。
Claude Sonnet 4.6 と他の Claude モデルの比較
| モデル | 得意分野 | 主な違い |
|---|---|---|
| Claude Sonnet 4.6 | バランスの取れたコーディング、推論、大規模文脈 | 巨大なコンテキストウィンドウ(ベータ)、コスト効率良好、ワークフロータスクに強い。 |
| Claude Sonnet 4.5 | ミッドティアの一般タスク | ベンチマークが低め、4.6 以前はコンテキストウィンドウがより小さい。 |
| Claude Opus 4.6 | 深い推論とエージェント的コーディング | より強力な生の推論力とエージェント能力を持つが、価格は高め。 |
Sonnet 4.5 と比べて 4.6 は文脈理解とオフィス系タスクでの性能が向上。Opus モデルと比べるとフラッグシップ級の推論力ではわずかに下回るものの、コーディングや一般タスクのベンチマークではしばしば近い性能を発揮します。
Claude Sonnet 4.6 の制限事項
- コンテキストウィンドウ(ベータ): 1M トークンのコンテキストは現在ベータであり、API の利用形態やプランにより採用状況や安定性が異なる可能性があります。
- レイテンシとコスト: 非常に大きなコンテキストを扱うと計算コストが増加し、小さなコンテキスト相対で API 呼び出しのレイテンシが高くなる場合があります。
- ベンチマークの細分性: 報告されたテストでは強力ですが、最も複雑な推論や学際的ベンチマークでは Opus にわずかに劣る可能性があります。
Claude Sonnet 4.6 の代表的なユースケース
- 大規模コードベース支援: ソフトウェアシステム全体の取り込み、リファクタリング、ファイル間依存関係の把握に最適。
- 文書・リサーチ統合: 一般的な上限を超える長文脈での長文書分析に有用。
- ワークフロー自動化: スプレッドシートやフォーム自動化などの複数ステップにわたるコンピュータタスクの遂行。
- 一般的な知識業務: フラッグシップモデルのコストなしに、信頼できる指示遵守と推論が求められる知的労働に適合。
Claude Sonnet 4.6 API の利用方法
ステップ 1: API キーの取得
cometapi.com にログインしてください。まだユーザーでない場合は、まず登録してください。CometAPI コンソール にサインインします。インターフェースのアクセス認証である API キーを取得します。パーソナルセンターの API トークンで「Add Token」をクリックし、トークンキー(sk-xxxxx)を取得して送信します。
ステップ 2: claude-sonnet-4-6 API にリクエストを送信
API リクエストを送信する際は「claude-opus-4-6」エンドポイントを選択し、リクエストボディを設定します。リクエストメソッドとリクエストボディは当社サイトの API ドキュメントから取得できます。当社サイトは利便性のため Apifox テストも提供しています。アカウントの実際の CometAPI キーで <YOUR_API_KEY> を置き換えてください。呼び出し先: Anthropic Messages 形式および Chat 形式。
content フィールドに質問やリクエストを挿入します—モデルはこの内容に応答します。API レスポンスを処理して生成された回答を取得します。
ステップ 3: 結果の取得と検証
API レスポンスを処理して生成結果を取得します。処理後、API はタスクステータスと出力データを返します。