GPT-5.6 Sol、Claude Sonnet 5、Gemini 3.7 Flash の料金はいくらか?
複数プロバイダ間で AI モデルの料金をどう比較すればよいでしょうか?まずは同じ入出力の比率、同じ通貨、そして「成功」の定義を揃えることから始めます。単一の「100万トークンあたりの価格」だけでは不十分です。なぜなら、入力トークンと出力トークンは異なる単価で課金され、長コンテキストのリクエストはより高いティアに入る可能性があり、再試行や却下された回答によって実効コストが大幅に増えることがあるからです。
2026年8月26日時点で、キャッシュなしの入力トークン 800,000 と出力トークン 200,000 を含むワークロードは、現在の CometAPI レートでは、GPT-5.6 Sol で $5.76、Claude Sonnet 5 で $2.88、Gemini 3.7 Flash で $1.08 程度の費用になります。これらのモデルは速度や能力のポジションが異なるため、これは請求の比較であり、同一品質を提供するという主張ではありません。
プロバイダ間で AI API 料金を比較する方法
本記事は、請求対象テキストトークン100万あたりの米ドルを用います。作業例は、多数のリクエストにまたがる 800,000 の入力トークンと 200,000 の出力トークンを持つ高ボリュームのサポート/ナレッジ系ワークフローを表します。各リクエストは GPT-5.6 Terra の 272,000 トークンという短コンテキスト料金のしきい値未満に収まります。
ベースラインは、プロンプトキャッシュ、バッチ割引、ツール料金、画像、音声、失敗または再実行された呼び出しを除外します。また、生成された回答が 1 回で受理されることを前提とします。計算式は次の通りです:
cost = (input tokens / 1M × input rate) + (output tokens / 1M × output rate)
文字数から推定するのではなく、各レスポンスで返される実際のトークン数を使用してください。トークナイザはモデルファミリごとに異なるため、同じテキストでも請求対象のトークン数は必ずしも一致しません。
GPT-5.6 Sol、Claude Sonnet 5、Gemini 3.7 Flash の API 価格
以下の 3 つのモデル ID とレートは、2026年8月26日に CometAPI のライブモデルディレクトリで再確認しました。CometAPI レートは本文の計算に用いた値です。公式列は参照用のベースラインとして含めています。
GPT-5.6 Sol の API 料金
GPT-5.6 Terra: CometAPI は 100万入力トークンあたり $1.60、100万出力トークンあたり $9.60 を掲載しています。公式の $2 / $12 と比較すると割安です。価格更新メモ: ライブレートは 20% の引き下げを反映しています。CometAPI の変更履歴には、2026年7月31日の Terra 値下げが記録されており、8月22日の価格レビュー後に数値を再確認しました。
検証済み更新(2026年8月26日): 上記のコメントノートはレビューの基点として残しています。本記事の計算では、GPT-5.6 Sol(100万入力トークンあたり $3.20、100万出力トークンあたり $16) を使用してください。公式は $4 / $20 です。CometAPI は 2026年8月24日にプロモーションを発表し、期間は 2026年11月21日までと記載されています。
Claude Sonnet 5 の API 料金
Claude Sonnet 5: 2026年8月26日時点で、CometAPI の掲載は 100万入力トークンあたり $1.60、100万出力トークンあたり $8 で、Anthropic の現在の $2 / $10 掲載価格と比較すると割安です。Anthropic は 2026年8月10日にローンチ投稿を更新し、$2 / $10 を恒久化しました。以前告知されていた 9月1日の $3 / $15 への引き上げは適用されなくなりました。
Gemini 3.7 Flash の API 料金
Gemini 3.7 Flash: 2026年8月26日時点で、CometAPI の掲載は 100万入力トークンあたり $0.60、100万出力トークンあたり $3 で、Google の 2026年12月31日までの導入価格 $0.75 / $3.75 と比較すると割安です。
| Model ID | CometAPI input / output | Official input / output | 800K 入力 + 200K 出力 |
|---|---|---|---|
| gpt-5.6-sol | $3.20 / $16 | $4 / $20 | $5.76 |
| claude-sonnet-5 | $1.60 / $8 | $2 / $10 | $2.88 |
| gemini-3.7-flash | $0.60 / $3 | $0.75 / $3.75 | $1.08 |
すべての価格は 100万トークンあたりの USD です。日付付きのモデルページは GPT-5.6、Claude Sonnet 5、Gemini 3.7 Flash、および CometAPI の料金ガイドをご覧ください。Claude Sonnet 5: CometAPI は 100万入力トークンあたり $1.60、100万出力トークンあたり $8 を掲載しており、Anthropic の現在の $2 / $10 掲載価格と比較できます。Anthropic は当初、2026年9月の標準価格 $3 / $15 を告知していましたが、2026年8月10日に価格を更新し、$2 / $10 を恒久化しました。GPT-5.6 Terra には長コンテキストの高単価ティアもあるため、公開されているしきい値を超えるリクエストに短コンテキストの数値を適用しないでください。
Gemini 3.7 Flash はこのシナリオで最も低いトークン料金を示し、効率重視の Flash モデルとして位置付けられています。Claude Sonnet 5 はバランスの取れたプロダクションモデルで、GPT-5.6 Sol は高度な推論やコーディング向けのフラグシップオプションです。重要なのは「どの行が最安か?」だけではなく、「最小の総トークン数、再試行、再実行で許容品質の結果を出すのはどのモデルか?」という点です。
GPT、Claude、Gemini で 100万トークンの費用はいくら?
800K 入力/200K 出力のベースラインでは計算は単純です。GPT-5.6 Sol は 0.8 × $3.20 + 0.2 × $16 = $5.76。Claude Sonnet 5 は 0.8 × $1.60 + 0.2 × $8 = $2.88。Gemini 3.7 Flash は 0.8 × $0.60 + 0.2 × $3 = $1.08 です。
この算術は予算策定に有用ですが、受理出力あたりのコストこそが本番でのより良い指標です。以下の表は、同じワークロードに一般的な運用上のオーバーヘッドが加わった場合を示します。
| Model | ベースライン | 5% 再試行 | 10% 再実行 | 40% 出力 |
|---|---|---|---|---|
| GPT-5.6 Sol | $5.76 | $6.05 | $6.34 | $8.32 |
| Claude Sonnet 5 | $2.88 | $3.02 | $3.17 | $4.16 |
| Gemini 3.7 Flash | $1.08 | $1.13 | $1.19 | $1.56 |
「5% 再試行」は、トークンワークロード全体の 5% が再送されると仮定します。「10% 再実行」は、10 件に 1 件の出力が品質チェックに失敗し、同じトークン構成で再生成されると仮定します。「40% 出力」は総計を 100万トークンに保ったまま、入力 600K/出力 400K に比率を変更します。出力トークンの単価が高いため、冗長な回答はトラフィック増よりも速く請求額を押し上げることがあります。
再試行と失敗出力はどれだけコストを増やす?
API の再試行と再実行はどれだけ費用がかかる?
再試行は請求対象の作業を重複させることがあります。 ベースラインでは、ワークロードの 5% を再試行すると GPT-5.6 Sol は $5.76 から約 $6.05 に、品質失敗後に 10% を再実行すると約 $6.34 に上がります。再試行は、転送やサービスの失敗後にリクエストを繰り返すことであり、再実行は配信済みの回答が却下された際に再生成することです。再試行はレートリミット、タイムアウト、一時的なサーバ障害のみに限定してください。CometAPI のエラーと再試行ガイドは、ジッタ付き指数バックオフを推奨し、不正なリクエストや認証エラーの自動再試行を禁止しています。プロバイダのインシデントで再試行ストームが発生しないよう、試行回数に上限を設定しましょう。
プロンプトキャッシュはどれだけ節約できる?
キャッシュの効果は再利用率に依存します。 GPT-5.6 Sol の短コンテキストに関する CometAPI レートでは、キャッシュ読み取りが $0.32/M、キャッシュ書き込みが $4/M と掲載されています。800K 入力の半分が再利用可能なキャッシュ済みプレフィックスである場合、初回は約 $6.08 で、400K のキャッシュトークンを書き込む分、通常入力より $0.32 のプレミアムが加算されます。後続のキャッシュヒット時の実行は約 $4.61 となり、$5.76 と比べて約 $1.15 の節約です。損益分岐点: 成功した再利用が 1 回でもあれば初回の書き込みプレミアムを回収でき、最初の 2 回の実行合計ではキャッシュ利用の方が約 $10.69 と、キャッシュなしの約 $11.52 より安くなります。他モデルはキャッシュの規則や最低要件が異なるため、予算化前に必ず確認してください。
出力長は AI API のコストにどう影響する?
長い回答は高くつきます。 3 行すべてで出力単価は入力単価の 5 倍です。タスクに見合った出力上限を設定し、簡潔な形式を求め、必要な構造が完成したら生成を停止しましょう。
失敗した AI 出力はどれだけ費用がかかる?
失敗したタスクでもトークンを消費することがあります。 利用できない回答が返ってきても、技術的には成功と見なされ、完全に課金対象となる場合があります。HTTP エラーとは別に、書式違反、幻覚、ツール失敗、人による却下を追跡しましょう。
トークン価格はエンジニアリングコストを測るものではありません。 プロバイダ固有の SDK、別々の請求書、重複するモニタリング、移行作業などが運用コストに上乗せされます。CometAPI を通じて 3 ファミリを比較する場合、OpenAI 互換のベース URL — https://api.cometapi.com/v1 — を共通にしつつ、モデル ID を変更しても、請求と可観測性のレイヤーを一元化できます。モデル固有の機能は別途テストが必要です。
GPT、Claude、Gemini の API コストを削減する方法
Batch と Flex はどれだけコストを下げられる?
Batch と Flex は処理モードであり、すべてのリクエストに自動割引が適用されるわけではありません。CometAPI の GPT-5.6 料金ガイドによると、対象となる Batch と Flex のトークン単価は Standard の約 50% 下とされています。一方、Anthropic はバッチ処理で最大 50% の節約を掲載しています。$5.76 の GPT-5.6 Sol ベースラインに 50% 感度を適用すると約 $2.88 になりますが、同一モードとレートが CometAPI アカウントに表示されるまではあくまで例示と捉えてください。Batch は非同期ジョブに、Flex は可変レイテンシが許容できる場合にのみ使いましょう。
GPT-5.6 Terra vs Claude Sonnet 5 vs Gemini 3.7 Flash: どれが最安?
2026年8月26日に確認した CometAPI レートで、同じ 800K 入力/200K 出力のワークロードを用いた場合、Gemini 3.7 Flash は $1.08、Claude Sonnet 5 は $2.88、GPT-5.6 Terra は $3.20 です。この比較では、純粋なトークン単価で Gemini が最安です。より困難なタスクでは、再試行や人手による修正の削減により GPT-5.6 Terra が最終的に経済的となる場合もあるため、採用前に受理出力あたりのコストを比較してください。
タスク難易度でルーティングする。 低コストモデルを分類・抽出・定型ドラフトに使い、曖昧または高価値のリクエストのみエスカレーションします。フォールバックは必要なモダリティ、ツール対応、出力フォーマットに一致させ、単に安いレートという理由だけで選ばないでください。
呼び出し前に出力を予算化する。 現実的な最大出力を設定し、レスポンスから実際の入力・出力・キャッシュトークンを記録します。CometAPI のコスト見積もりガイドでは、呼び出し前の見積もりを予算ガード、実測値を最終計測と位置付けています。
安定した内容をキャッシュし、変わる文脈はキャッシュしない。 繰り返し使うシステム指示、製品ポリシー、長い参照文書は良い候補です。キャッシュヒット率を測定し、キャッシュ書き込みコストも含めてください。さもないと、理論上は安く見えても本番でほとんど節約できないキャッシュになり得ます。
選択的に再試行する。 ジッタ付き指数バックオフと最大試行回数を設定します。モデル ID、ステータス、リクエスト ID、トークン、再試行か否かをログに残し、重複支出を可視化します。
受理出力あたりのコストを最適化する。 固定の評価セットを用意し、total API spend / accepted outputs を計算します。より高価なモデルでも、再試行が少なく、プロンプトが短く、人手の修正が少ないなら、総コストは低くなり得ます。
ローンチ前に再確認する。 モデルの提供状況、導入価格、ティアしきい値、割引は変わります。Models API をクエリするか、公開モデルディレクトリを、記事の公開や予算承認の当日に確認してください。
FAQ
“100万トークンあたりコスト”とは実際に何を意味する?
標準化されたレートであり、すべてのリクエストの価格ではありません。モデルの入力・出力単価に、実際に使ったトークン数を掛け合わせてください。キャッシュトークン、長コンテキストのティア、タスク課金は別に扱います。
最安はどれ:GPT、Claude、Gemini?
2026年8月26日に確認した特定モデルと 800K 入力/200K 出力のワークロードでは、CometAPI 経由で Gemini 3.7 Flash が $1.08 と最安、次いで Claude Sonnet 5 が $2.88、GPT-5.6 Sol が $5.76 でした。すべてのタスクで最適とは限りません。自分のプロンプトで品質、レイテンシ、受理出力あたりコストを比較してください。
公式価格とアグリゲータ価格のどちらを比較すべき?
実際に支払う価格を比較し、公式レートは参照として保持してください。すべての行で日付、通貨、トークン比率、ティア、割引の前提を揃えましょう。
再試行は常に課金される?
無料だと決めつけないでください。転送に失敗したリクエストは推論に到達しない場合がありますが、タイムアウトやアプリケーションレベルの却下はすでにモデルの作業を消費しているかもしれません。実際の使用量・請求記録を確認し、再試行不能なエラーの自動再試行を防止してください。
プロンプトキャッシュは常にコストを下げる?
いいえ。キャッシュ書き込みは通常入力より高い場合があり、節約効果は再読率に依存します。現在の書き込み・読み取りレートから損益分岐点を算出し、実際のキャッシュヒットを監視してください。
価格はどのくらいの頻度で確認すべき?
価格主張を公開する前、プロダクションモデルを変更する前、または予測を承認する前に確認します。モデル ID と検証日を計算とともに保存し、後から推定を再現できるようにしてください。
結論:あなたのワークロードで最安の AI API はどれ?
公正な GPT vs Claude vs Gemini の料金比較には、1 つの日付基準、1 つのトークン比率、1 つの成功定義を用います。トークン単価がベースラインを作り、キャッシュ、再試行、出力長、品質失敗が実際の請求額を決めます。CometAPI はエンドポイントと請求レイヤーを一貫させることでプロバイダ横断のテストを容易にしますが、最も安いモデルとは、最小の総作業で目標品質を満たすモデルのことです。
