GPT-5.6 Luna price down 80%, Terra down 20% →

2026年7月のモデルの波: GPT-5.6、Gemini 3.6 Flash、Grok 4.5、Kimi K3 など

CometAPI
AnnaAug 1, 2026
2026年7月のモデルの波: GPT-5.6、Gemini 3.6 Flash、Grok 4.5、Kimi K3 など

TL;DR: 2026年7月に約3週間のあいだに6つの主要モデルが相次いでリリースされた:OpenAI の三層構成 GPT-5.6 ファミリー(Sol/Terra/Luna)、Google の Gemini 3.6 Flash、xAI の Grok 4.5、Moonshot AI の Kimi K3、Anthropic の Claude Opus 5、そして智谱の GLM-5.2。万能の最有力候補は存在しない。実務での選択は、推論の深さ、コーディング性能、トークン当たりの費用、コンテキスト要件、オープンウェイトでのデプロイが重要かどうかに依存する。本比較は各社の現行公式情報と CometAPI の掲載内容に基づき、ベンチマークは単一の普遍的ランキングとしてではなく出典を明示して扱う。

要点:

  • GPT-5.6 は単一モデルではなく、価格帯の異なる3つ(Sol/Terra/Luna)で構成される。誤ったティアの選択は、ファミリー自体を選び違える以上にコスト面で大きなミスになりうる。
  • Gemini 3.6 Flash と GLM-5.2 はいずれも 1,000,000 トークンのコンテキストウィンドウを公表。Kimi K3 も同等で、コンテキストサイズはこの世代のリーダー間では差別化要因ではなくなった。
  • GLM-5.2 と Kimi K3 はいずれもオープンウェイトを提供するが、ライセンスは同一ではない。GLM-5.2 は MIT License、Kimi K3 は独自の Kimi K3 License で提供されており、自己ホスティングや MaaS 提供前に商用条件の確認が必要。
  • Claude Opus 5 は正式リリース済み。Anthropic は2026年7月24日に 1M トークンのコンテキスト、最大 128K の同期出力、公式価格 $5/百万入力トークン・$25/百万出力トークンを発表。CometAPI では現在 $4/$20 と掲載。

今月実際に出荷されたもの

2026年7月はフロンティア級および準フロンティア級モデルのリリースが異例の高密度で続いた。約3週間の間に、OpenAI が GPT-5.6 ファミリー(7月9日)、xAI が Grok 4.5(7月8日)、Moonshot AI が Kimi K3(7月16日)、Google が Gemini 3.6 Flash(7月21日)を出荷し、Anthropic は Claude Opus 5 を正式ローンチ(7月24日)した。智谱の GLM-5.2 はわずかに早い6月の到着だが、1M トークンのコンテキストと MIT ライセンスのオープンリリースにより、同様の導入・運用判断において関連性が高い。

モデルを基盤に構築する人にとって実務的な問いは「どれが抽象的に最良か」ではなく「確認済みの選択肢のうち、特定の作業に適合するのはどれか」だ。6つのモデルは、コスト、コンテキスト、コーディング挙動、ライセンス、デプロイの自由度で意味のある差がある。

価格と仕様の横並び比較

以下の価格はすべて百万トークンあたり。複数ティアがあるモデルは各ティアを個別に掲載。

モデル入力出力コンテキストウィンドウライセンスリリース
GPT-5.6 Sol$5.00$30.00非公開プロプライエタリ2026年7月9日
GPT-5.6 Terra$2.50$15.00非公開プロプライエタリ2026年7月9日
GPT-5.6 Luna$1.00$6.00非公開プロプライエタリ2026年7月9日
Grok 4.5$2.00$4.00非公開プロプライエタリ2026年7月8日
Kimi K3$3.00$15.001,048,576 トークンオープンウェイト(Kimi K3 License)2026年7月16日
Gemini 3.6 Flash$1.50$7.501,048,576 トークン(65,536 出力)プロプライエタリ2026年7月21日
GLM-5.2$1.40$4.411,000,000 トークンオープン(MIT License)2026年6月13日
Claude Opus 5$5.00$25.001,000,000 トークン(128K 出力)プロプライエタリ2026年7月24日

*上記は公式提供元の公称レート。統一 API による標準ディスカウントが適用される場合は各モデルの価格が一様に下がるが、表の狙いは特定ベンダーの精算価格ではなくモデル間の相対差である。

価格・仕様表からいくつかの点が際立つ。最上位ティアの Sol は、日常用途というよりフロンティア級の推論やエージェント的作業向けの価格設定である一方、Grok 4.5 はそのポジショニングに対して出力価格が比較的低い。GLM-5.2 はこのグループで最も低い出力価格を掲げ、かつ MIT License を採用。Kimi K3 も 1M トークンのコンテキストとダウンロード可能なウェイトを提供するが、MIT ではなく独自の Kimi K3 License である。Gemini 3.6 Flash、Kimi K3、GLM-5.2、Claude Opus 5 はいずれもおおむね 1M トークンのコンテキストを公表しており、コンテキスト容量だけでは選択の決め手にならない。CometAPI の掲載レートは概してプロバイダの公称価格より低いが、実際のワークロード評価はトークン価格の単独比較より有益である。

各モデルの実際の適性

GPT-5.6 Sol はフロンティア級の推論、エージェント的コーディング、長期スパンの技術的作業に向けて位置付けられている。"Max Reasoning Effort" モードや、サブエージェントを並列展開する "Ultra Mode" をサポート。価格差を踏まえると、日常タスクではなく難易度の高い多段階課題に適したティアである。

GPT-5.6 Terra はバランス型の中位ティアで、日常的な生産性、ドキュメント作成、コーディング支援、業務自動化に向く。Sol の推論深度を特段必要としない大半のアプリケーションバックエンドでは、Terra がより堅実なデフォルトとなる。

GPT-5.6 Luna は軽量かつ高スループット用途を狙い、分類、カスタマーサポートフロー、オンボーディング、反復的なコンテンツ生成に適する。$1.00/$6.00(統一ゲートウェイの割引前)という価格は、まさに高コールボリューム・低複雑性のワークロードを想定したもの。また標準の入力単価から90%割引となるキャッシュ済み入力の価格設定にも対応しており、反復性の高い高ボリューム用途では上位ティア以上に効いてくる。

Grok 4.5 は GPT-5.6 のように明示的な専門特化を公表していないが、価格はバジェットと中位の中間に位置する。価格だけでポジショニングを推測するより、Terra や Kimi K3 と直接ベンチマーク比較する価値がある。

Kimi K3 は 2.8 兆パラメータの Mixture-of-Experts(MoE)モデルで、1M トークンのコンテキスト内での長期スパンのコーディング、マルチモーダルな知識業務、大規模ドキュメントやリポジトリ解析に向けて構築されている。Moonshot AI はフルウェイトを公開しており自己ホスティングが可能だが、リリースは Kimi K3 License に基づき、MIT とは異なる商用条件を含む。

Gemini 3.6 Flash は Google の効率重視リリースで、3.5 Flash のコストとレイテンシを最適化した継続改良として明確に位置づけられる。コーディングやエージェント系ベンチマークの実利的な改善に加え、前世代より低い出力単価を提示。トークン効率やタスク完了あたりのコストが能力と同等に重要なエージェント型ワークロードの選択肢となる。

GLM-5.2 は本比較の中でより寛容なライセンスを採用したオープンな選択肢。Z.ai は MIT License の下で 1M トークンのコンテキストと、長期スパンのコーディング、ツール使用、思考労力の調整機能を強調して公開。API 経由での利用も公開ウェイトのローカル実行も可能であり、自身のインフラと評価要件に従って選べる。

コーディング能力の比較

6つのリリースは狙うエンジニアリングパターンが異なるため、コーディング能力は単一順位ではなくワークロード適合性で理解するのがよい。

  • Claude Opus 5 は、難度の高いデバッグ、根本原因分析、大規模リファクタ、長時間稼働のソフトウェアエージェントに最も適合。Anthropic は検証と反復の挙動強化を強調している。
  • GPT-5.6 Sol, Terra, and Luna は、複雑なコーディングと推論から、バランスのとれた開発業務、高ボリュームのコード支援へと段階的なパスを提供する。
  • Gemini 3.6 Flash は、レイテンシと反復あたりのコストが重要な高速なエージェント型コーディングループ向けにチューニングされている。
  • Kimi K3 は 1M トークンのコンテキストとダウンロード可能なウェイトを備え、非常に大規模なリポジトリにまたがる長期スパンのコーディングに向く。
  • GLM-5.2 は、長期スパンのコーディング、ツール使用、思考労力の調整、MIT ライセンスでのローカルデプロイを組み合わせる。
  • Grok 4.5 は、公式のポジショニングが GPT のティアのような明確なコーディング特化の内訳を提供していないため、他モデルと直接評価する候補として扱うのが妥当。

この頻度でモデルを比較(あるいは切り替え)する際のトレードオフ

これは新リリースのたびに追いかけるべきだという主張ではない。プロダクションのワークロードを新モデルに切り替えるには、プロンプトの再テスト、出力品質の再検証、合成ベンチマークではなく実際のトラフィックに対するタスク当たりコストの再確認といった実費が発生する。統一 API は評価作業そのものを省くわけではないが、比較実行に伴う個別アカウント・個別課金といったオーバーヘッドを取り除く。GPT-5.6 Terra、Gemini 3.6 Flash、Kimi K3、GLM-5.2 を同一のリクエスト形式と単一の請求で呼び出せるため、コミット前に複数候補を実際にテストしやすくなる。既存の鍵を持つプロバイダに惰性的に決めてしまう代わりに、である。

それは本物の利点だが、完全な解決策ではない。各モデルの実ドキュメントを読むことの代替にはならず、上述の切り替えコストをゼロにはしない。だが「特定のワークロードに本当に合うモデルはどれか」を見極めるコストを下げる効果はある。「このモデルがベスト」という主張とは異なる(そしてより誠実な)効能だ。

FAQ

2026年7月にリリースされた AI モデルの中で最良はどれ? 単一の正解はない。GPT-5.6 Sol と Claude Opus 5 は高度な推論とコーディングに狙いを定め、Gemini 3.6 Flash は効率的なエージェントループを重視。Kimi K3 は長コンテキストとオープンウェイトを組み合わせ、GLM-5.2 は長期スパン能力と MIT ライセンスを組み合わせる。最適解はワークロードとデプロイ制約次第。

GPT-5.6 は単一モデル?複数? 3つ。Sol(フラッグシップ、フロンティア推論)、Terra(バランス型・日常用途)、Luna(高速・低コストの高ボリュームタスク)で、それぞれ個別価格。Luna は百万トークンあたり $0.80/$4.80、Sol は $4.00/$24.00。

Claude Opus 5 は正式リリース済み? はい。Anthropic は2026年7月24日に Claude Opus 5 を発表。公式リリースは 1M トークンのコンテキストを記載し、複雑なエージェント的コーディングと知識業務向けに位置づける。公式 API 価格は百万入力トークン $5・百万出力トークン $25。

この中で大規模運用時に最も安いのは? 表のプロバイダ出力価格ベースでは GLM-5.2 が最安で、MIT License の下で提供される。Kimi K3 もオープンウェイトだが、独自の Kimi K3 License と非常に大きなモデル規模により、自己ホスティングの経済性は変わってくる。GPT-5.6 Luna は本稿で扱う範囲のプロプライエタリかつ API 専用の中では最安。

1つに決めてコミットすべき?複数を試すべき? コミット前に実際のプロンプトとトラフィックで複数を試す価値は一般に高い。統一 API(CometAPI など)は、比較のための個別アカウント運用のオーバーヘッドを取り除くため、特にその実行コストを下げる。ただし各モデルのドキュメント読解の代替にはならない。

結論

2026年7月のリリースラッシュは明確な一人勝ちを生んではいない。推論深度、コーディング性能、トークンコスト、コンテキスト、ライセンスのトレードオフが異なる6つの確かな選択肢を生んだ。GPT-5.6 Sol と Claude Opus 5 は最難度の推論とソフトウェア工学に狙いを定め、Gemini 3.6 Flash と GPT-5.6 Luna は効率性を重視。Kimi K3 は独自ライセンスの下でオープンウェイトと 1M トークンのマルチモーダルコンテキストを提供し、GLM-5.2 は 1M トークンかつ MIT ライセンスの代替肢を提示する。いずれも CometAPI で単一キーからアクセスでき、統制されたテストは容易になるが、モデル選定は最終的に実ワークロードのプロンプト、ツール、レイテンシ目標、成功基準に基づいて行うべきだ。

AI開発コストを20%削減する準備はできていますか?

数分で無料スタート。無料トライアルクレジット付き。クレジットカード不要。

もっと読む