Claude Opus 5.2 は Claude Code において、ひっそりとグレーテストに入りました。2026年9月14日以降、ユーザーは、ウェブ上の Opus 5 と比べて、応答が速く、出力がよりクリーンで、長時間のコーディングタスクでの持続性が強化されていると報告しています。
公開されている証拠はまだ初期段階で、多くの議論は同じ初期テストや少数のサイドバイサイド比較に遡ります。グレーテストの挙動は確認できるものの、Anthropic はまだ本番利用に必要な安定版エンドポイントと技術ドキュメントを公開していません。
Status:
Claude Code でグレーテスト中
Official API availability:
未発表
Public API model ID:
未公開
Public pricing and specifications:
未公開
Last checked:
September 15, 2026
Claude Opus 5.2 とは?
Claude Opus 5.2 は、Claude Code における選択的ルーティングを通じて現れ始めた、Anthropic の次の Opus チェックポイントです。Claude Code で「Opus 5」に対して行われた一部のリクエストが新しい 5.2 ルートに到達する一方で、ウェブ上の Claude および一部のサードパーティ環境では既存の Opus 5 モデルが提供され続けています。これにより、UI では同じモデル名が表示されていても、結果が劇的に異なるように見える理由が説明できます。
グレーテストではトラフィックが選択的に切り替えられるため、すべてのアカウントやセッションで同じモデルが受信されるとは限りません。システムプロンプト、ツール設定、推論努力の設定によっても差異が増幅され得ます。そのため最も有用なシグナルは、ルート情報と繰り返し再現可能な挙動変化の組み合わせです。
- Claude Code ルートでの生成がより高速
- 初回の実装がよりクリーンで完全
- 長いタスクで「続けて」と促さなくても作業を継続
- コーディングタスクでの反復的な改訂・テストを繰り返す
5.2 スラッグとルーティングのシグナル
一部のテスターは、Claude Code の表示ラベルは「Opus 5」のままでも、ステータスビューやリクエストのスラッグが 5.2 を指していると報告しています。
もし生のレスポンス、リクエスト記録、あるいは再現可能な /status の出力がその識別子を示し、独立に検証できれば、これははるかに強い証拠となるでしょう。現時点では、公開投稿の多くはこの主張を繰り返しているだけで、基になるアーティファクトは認証されていません。
Claude Opus 5.2 のグレーテストで見られる主な特徴
初期のテスターは、正式な仕様よりも挙動に一貫して注目しています。
応答が速い
ルーティングされたモデルは、初期のユーザーテストにおいて、文書化された Opus 5 の体験よりも明らかに高速です。最終的なレイテンシは、公開 API のアクセスが提供されてから測定する必要があります。というのも、努力設定、システム負荷、ルーティング基盤も速度に影響するためです。
出力がよりクリーンでより完全
コミュニティの比較では、新しいルートがより磨かれた SVG と、単一プロンプトからより完全な実装を生成すると主張されています。逸話的なコーディングテストでは、実用的な結果に到達するまでの往復が少なくて済むとされています。
「怠惰」な挙動が少ない
複数のテスターは、モデルが骨組みだけを返したり、ユーザーに「続けて」と促したり、複雑なタスクの完了前に停止したりする可能性が低いと述べています。代わりに、より長いシーケンスを通して作業し、自身の出力に対して追加のパスを行うと報告されています。
自律的なコーディングループが長い
広く繰り返し観察されている点として、モデルが「gauntlet loop」を開始したというものがあります。これは、繰り返しの指示がなくても、コードのテスト、改訂、改善を続けたという観察です。再現可能であれば、これはリポジトリ規模のコーディングエージェントや長期的なソフトウェアタスクにとって特に重要です。
より新しい知識
ユーザーは「Tibo テスト」を提案しました。ウェブ検索を無効にした状態で、モデルに「Tibo, the reset guy」を知っているか尋ねるものです。既存の Opus 5 ドキュメントは、2026年5月という信頼できる知識カットオフを示しているため、より後のオンライン参照を知っていれば、より新しいチェックポイントを示唆し得ます。
ただし、このテスト単独でモデルのバージョンを特定することはできません。正しい回答は、隠れたリトリーバル、会話メモリ、システムプロンプト、その他のコンテキストソースから生じる可能性もあります。これは知識のプローブであり、「Opus 5.2」という名前の証明ではありません。
Claude Opus 5.2 のベンチマーク性能
検証済みの Claude Opus 5.2 ベンチマーク結果はありません。Anthropic はシステムカードや評価表を公開していないためです。
報告されている CoBench v2 の 62.8% スコアは、Anthropic の内部モデル「Model 2」に属するもので、Mythos 5 を 12.5 ポイント上回り、社内のコーディングで広く使われているとされています。より高性能な RSI システムについても議論があります。
Claude Opus 5.2 vs Claude Opus 5 vs Claude Fable 5.1
この3つのモデルは隣接しつつも異なるニーズをターゲットにしています。Opus 5 は、複雑なコーディングやエンタープライズ業務向けの低コストなデフォルトです。Fable 5.1 は、最難関の推論や長期的なエージェントタスク向けの確立されたハイエンドの選択肢です。Opus 5.2 は、Claude Code で観測される新しいグレーテストのルートであり、Opus をその最前線に近づける(あるいは潜在的に超える)一方で、ユーザーが体験する速度と持続性を向上させているように見えます。
| カテゴリ | Claude Opus 5.2 | Claude Opus 5 | Claude Fable 5.1 |
|---|---|---|---|
| 現在のステータス | Claude Code でグレーテスト中 | 公開利用可能 | 公開利用可能 |
| Cometapi ID | claude-opus-5-2 | claude-opus-5 | claude-fable-5-1 |
| 最適用途 | 次世代のエージェント的コーディング、自律反復、磨かれたワンショット出力 | バランスの取れたコストでの一般的な複雑コーディングとエンタープライズ業務 | 最難関の推論、リサーチ、長期的なエージェント作業 |
| 観測された挙動 | より高速、よりクリーン、長いタスクの完了まで反復・やり切る傾向 | 有能で経済的だが、一部の長いタスクで遅さや持続性不足が報告されることも | 厳しいリサーチやエージェント系ベンチマークで公表済み Claude 最強の結果;冗長になり得る |
| コンテキストウィンドウ | 未公開 | 1M tokens | 1M tokens |
| 最大出力 | 未公開 | 128K tokens | 128K tokens |
| 信頼できる知識カットオフ | テストで新しい知識が観測;日付は未公開 | May 2026 | June 2026 |
| 公式入出力価格 | 未公開 | $5 / $25 per MTok | $10 / $50 per MTok |
| 独立系 AA Intelligence Index | 未テスト | 51 | 53 |
| 独立観測の出力速度 | 未テスト | 51.7 tokens/s | 65.1 tokens/s |
上記の独立系数値は、Artificial Analysis によるテスト済みの適応型推論バリアントからのものです。これらは、Fable 5.1 が Intelligence Index で Opus 5 を 2 ポイント上回り、測定された構成では出力生成が約 26% 高速であることを示しています。ただし、グレーテストのルートは独立ベンチマーク用の安定した公開エンドポイントを露出していないため、これらの結果には Opus 5.2 は含まれていません。
Opus 5.2 は実務上の比較を変えます。初期の Claude Code セッションは、Opus 5 より速く応答し、同じプロンプトからより完全な設計を提供し、後押しなしにコードのテストと洗練を続けるモデルを示唆しています。公開 API が利用可能になった後で最も重要な問いは、それらの改善が管理されたエージェント系ベンチマークで Fable 5.1 をも上回るのか、そしてその価格がどうなるのか、という点です。
Claude Opus 5.2 が得意な領域
既にグレーテストで見える挙動に基づくと、Claude Opus 5.2 は特に次の分野で有望です。
- リポジトリ規模のコーディングおよびコードベースのモダナイゼーション
- 多段にわたり計画・実行・テスト・改訂を行う長時間稼働のエージェント
- 複雑なデバッグと自律的な QA ループ
- 高品質なインターフェース、SVG、構造化アーティファクトの生成
- 大きなコンテキストにわたって持続的な注意を要する研究と分析
- 最低コストよりも完了品質が重視されるエンタープライズワークフロー
現時点の本番展開では、安定した公開エンドポイントを引き続き使用し、Opus 5.2 の API アクセスとサービス条件が公開されるまで、モデル層を置換可能な構成に保つべきです。
CometAPI はどのように Claude Opus 5.2 API へのアクセスを提供しますか?
Claude Opus 5.2 が CometAPI から正式に提供されるようになれば、開発者は他の対応 Anthropic モデルで使用しているのと同じ統一 API ワークフローを利用できます。
- CometAPI アカウントを作成し、API キーを生成する。
- アカウントにクレジットを追加するか、適切な課金オプションを選択する。
- CometAPI のモデルカタログで、正確な公開モデル ID と価格を確認する。
- 対応する Anthropic Messages または互換チャットエンドポイント経由でリクエストを送信する。
- 本番展開前に、小規模なテストワークロードで出力品質、レイテンシ、コストを検証する。
それまでの間、CometAPI はすでに最新の Claude Fable 5.1 モデルをサポートしています。開発者はネイティブな Claude API リクエスト形式で Claude モデルにアクセスでき、現在のモデルをテストし、リリース後に Opus 5.2 へ移行しやすくなっています。
なぜ Claude Opus 5.2 に CometAPI を選ぶのか?
モデルが正式にサポートされれば、CometAPI は既存の AI スタックに追加するための運用作業を削減できます。統一されたアカウントと API レイヤーにより、チームは各モデルごとに別個の統合や課金関係を維持することなく、複数のモデルプロバイダーを評価できます。
潜在的な利点には次が含まれます。
- 幅広いモデルカタログに対して 1 つの API キーと課金ワークフロー
- 代替のコーディング・推論モデルとのサイドバイサイドテストを迅速化
- モデルバージョンが変化しても一貫した統合パターン
- 単一プロバイダーに合わせたアプリケーション再設計なしの従量制アクセス
- 集中化されたドキュメントとモデル発見
実際の Opus 5.2 の価格、提供状況、スループット、割引情報は、CometAPI のライブカタログにモデルが登場した後にのみ記載すべきです。