TL;DR
価格更新: GPT-5.6 Standard の短コンテキスト料金は、1百万トークンあたり、Sol は入力 $5 / 出力 $30、Terra は $2 / $12、Luna は $0.20 / $1.20となりました。
2026年7月30日、OpenAI は GPT-5.6 の Terra を20%値下げ、Luna を80%値下げしました。Sol の料金は変更ありません。
隠れたコスト要因に注意: 汎用の gpt-5.6 エイリアスは Sol にルーティングされ、272K input tokens を超えるリクエストは長コンテキストの高率が適用され、3つのティアすべてで出力トークンは入力トークンより**6×**高価なままです。
レイテンシに敏感な Sol ワークロード向けに、OpenAI の新しいFast modeは、Standard 価格の2倍で最大2.5×の高速処理を提供します。
OpenAI API の料金概要
OpenAI API pricing を広く検索しているユーザーにとって、最初の疑問はたいていこうです: 実際に課金されている現行モデルはどれか? 以下の表は、GPT-5.6 を詳しく見る前に、いくつかの現行 OpenAI テキストモデルをコンパクトに示したものです。
(> Pricing update — July 30, 2026: OpenAI reduced GPT-5.6 Terra API prices by 20% and Luna prices by 80%. Terra now costs $2 per 1M input tokens and $12 per 1M output tokens, while Luna costs $0.20 input and $1.20 output. Sol pricing remains unchanged.)
| モデル | 入力 / 1M トークン | キャッシュ済み入力 | 出力 / 1M トークン |
|---|---|---|---|
| gpt-5.6-sol | $5.00 | $0.50 | $30.00 |
| gpt-5.6-terra | $2.00 | $0.20 | $12.00 |
| gpt-5.6-luna | $0.20 | $0.02 | $1.20 |
| gpt-5.5 | $5.00 | $0.50 | $30.00 |
| gpt-5.4 | $2.50 | $0.25 | $15.00 |
| gpt-5.4-mini | $0.75 | $0.075 | $4.50 |
| gpt-5.4-nano | $0.20 | $0.02 | $1.25 |
新価格では、Luna は GPT-5.4 nano の入力 $0.20 と同等で、出力は $1.25 に対して $1.20 とわずかに低くなります。
出典*:* OpenAI API pricing
最も重要なパターンは見落としがちです。GPT-5.6 の出力トークンは、Sol・Terra・Luna のいずれでも入力トークンの6倍の価格です。 そのため、長い回答、冗長なエージェント、推論量の多いワークフローは、プロンプト長の小さな変更よりもコストを速く押し上げる可能性があります。
GPT-5.6 ファミリーのより広範な概要(モデル機能、位置づけ、ベンチマーク、API アクセス、主要なローンチ機能など)については、OpenAI の GPT-5.6 announcement または CometAPI のGPT-5.6 guide. を参照してください。本記事は、料金、コスト計算、実際の API 請求に影響しうる要因に特化して焦点を当てます。
GPT-5.6 の料金: Sol vs Terra vs Luna
GPT-5.6 には3つの料金ティアがあります。OpenAI は Sol をフラッグシップ、Terra をバランス型、Luna を大量処理向けの低コストティアとして位置づけています。
各モデルの機能、GPT-5.6 API へのアクセス方法、ユースケースの詳細については、GPT-5.6 model も参照してください。
入力トークンが ≤272K のリクエストに対する GPT-5.6 Standard 料金
| モデル | 短い入力 | キャッシュ済み入力 | キャッシュ書き込み | 短い出力 | 長い入力 | 長いキャッシュ済み入力 | 長いキャッシュ書き込み | 長い出力 |
|---|---|---|---|---|---|---|---|---|
| gpt-5.6-sol | $5.00 | $0.50 | $6.25 | $30.00 | $10.00 | $1.00 | $12.50 | $45.00 |
| gpt-5.6-terra | $2.00 | $0.20 | $2.50 | $12.00 | $4.00 | $0.40 | $5.00 | $18.00 |
| gpt-5.6-luna | $0.20 | $0.02 | $0.25 | $1.20 | $0.40 | $0.04 | $0.50 | $1.80 |
出典*:* OpenAI API pricing
長コンテキストの料金: 272K input tokens を超えるリクエストには高いレートが適用されます。入力、キャッシュ済み入力、キャッシュ書き込みは標準の2×、出力は1.5×で課金されます。高いレートは、272K を超えた分だけでなくリクエスト全体に適用されます。
出発点として妥当なのは、単純で大量のタスクには Luna をテストし、アプリケーション向けのバランスの取れたワークロードには Terra、最も難しい/高インパクトのタスクには Sol を試すことです。これは普遍的な推奨ではありません。精度、リトライ、ツールの挙動、人手レビューが、価格差を上回る場合があります。
重要なエイリアスの注意点
OpenAI のmodel guidance によると、汎用の gpt-5.6 エイリアスは gpt-5.6-sol にルーティングされます。
つまり、gpt-5.6 に送ったリクエストは Sol の価格ティアで課金されます。ワークロードが Terra や Luna で十分に動作する場合は、汎用エイリアスに任せず、明示的なモデル ID を使用してください。
例 1: 典型的な API リクエスト
一般的なリクエスト形状から始めます:
- 1,000 入力トークン
- 500 出力トークン
| モデル | 月次入力コスト | 月次出力コスト | 合計 |
|---|---|---|---|
| gpt-5.6-sol | $10,000 | $15,000 | $25,000 |
| gpt-5.6-terra | $4,000 | $6,000 | $10,000 |
| gpt-5.6-luna | $400 | $600 | $1,000 |
このワークロードでは、Luna の新価格により想定月次トークン請求は $5,000 から $1,000 に、Terra は $12,500 から $10,000 に下がります。
Sol の計算:
(1,000 / 1,000,000 × $5) + (500 / 1,000,000 × $30) = $0.020
この例は、出力の長さが重要である理由も示しています。入力トークンが出力トークンの2倍含まれていても、出力が入力の6倍の価格であるため、Sol のトークンコストの 75% が出力に相当します。
チャット、エージェント、コード生成では、不要な冗長性を抑える方が、小さなシステムプロンプトの削減よりコスト削減につながる場合があります。
例 2: 大規模での月次コスト
アプリケーションが月に100万リクエストを処理し、平均で以下だとします:
- リクエストあたり 2,000 入力トークン
- リクエストあたり 500 出力トークン
これは月あたり 20 億の入力トークンと 5 億の出力トークンに相当します。
| モデル | 月次入力コスト | 月次出力コスト | 合計 |
|---|---|---|---|
| gpt-5.6-sol | $10,000 | $15,000 | $25,000 |
| gpt-5.6-terra | $5,000 | $7,500 | $12,500 |
| gpt-5.6-luna | $2,000 | $3,000 | $5,000 |
差はルーティングテストを正当化できるほど大きいですが、最下段が自動的に最良の本番選択とは限りません。より安いモデルがリトライ、失敗、手作業レビューを増やすと、ワークフロー全体のコストは高くなる可能性があります。
長コンテキスト料金: 272K トークンを超えると何が起きる?
GPT-5.6 モデルは 1.05M トークンのコンテキストウィンドウをサポートしますが、272,000 入力トークンを超えるリクエストにはより高いレートが適用されます。
これらの長コンテキスト・リクエストでは:
- 入力は**短コンテキストの2×**で課金
- キャッシュ済み入力とキャッシュ書き込みも**2×**で課金
- 出力は**1.5×**で課金
- 高いレートは、272K 超過分だけでなくリクエスト全体に適用
Sol の場合、入力は $5 から $10/1M トークン、出力は $30 から $45 に変わります。同じ倍率構造が Terra と Luna にも適用されます。
これは 272K 近辺に「コストの崖」を生みます。閾値に近いワークロードでは、重複した検索チャンク、古い会話履歴、不必要なリポジトリファイル、冗長なツール出力を減らしてからリクエストを送るようにしましょう。追加のトークン削減ガイダンスは OpenAI のコスト最適化ガイドを参照してください。
Standard、Batch、Flex、Priority の料金
対象となる GPT-5.6 のテキストワークロード向けに、OpenAI は複数の処理ティアを提供しています。
| ティア | Sol 入力/出力 | Terra 入力/出力 | Luna 入力/出力 | 典型的な用途 |
|---|---|---|---|---|
| Standard | $5 / $30 | $2 / $12 | $0.20 / $1.20 | 通常の同期トラフィック |
| Batch | $2.50 / $15 | $1 / $6 | $0.10 / $0.60 | オフラインの非同期ジョブ |
| Flex | $2.50 / $15 | $1 / $6 | $0.10 / $0.60 | 処理の遅さを許容できるコスト重視のワークロード |
| Fast mode | $10 / $60 | $4 / $24 | $0.40 / $2.40 | レイテンシに敏感な短コンテキストのトラフィック |
Batch と Flex は Standard に比べておおむね 50% 低価格のままです。Priority Processing は 2026年7月30日に Fast mode に改称されましたが、service_tier: "priority" を使う既存リクエストは引き続き互換性があります。
GPT-5.6 Sol では、Fast mode が Standard の 2× のトークン価格で最大 2.5× 高速な処理を提供し、モデルの知能は変わりません。ユーザー向けレイテンシがプレミアムに見合うケースに最適です。
プロンプトキャッシュ: GPT-5.6 でいつ節約になる?
GPT-5.6 では、キャッシュ書き込みは通常の入力料金の 1.25×、一致するキャッシュ読み取りは割引されたキャッシュ入力料金が適用されます。
Sol で再利用可能な100,000 トークンのプレフィックスを考えます:
| アクション | コスト |
|---|---|
| 一度だけ通常の非キャッシュ入力として処理 | $0.50 |
| プレフィックスを書き込み | $0.63 |
| 後でキャッシュ済みプレフィックスを読み取り | $0.05 |
非キャッシュで 2 回使うと**$1.00**。1 回のキャッシュ書き込み+一致するキャッシュ読み取り 1 回で**$0.675となり、この単純化した例では$0.325**の節約です。
この例の範囲: この試算は再利用可能なプレフィックスの入力コストのみを比較します。出力トークン、他の非キャッシュ入力、ツール、リトライは含みません。実際の節約は、プレフィックスがキャッシュ要件に一致するか、どの程度再利用されるかに依存します。
したがって、キャッシュは、繰り返し一致する長く安定したプロンプトのプレフィックスに最も有効です。再利用されないキャッシュ書き込みは、コスト削減ではなく増加につながります。
OpenAI のプロンプトキャッシュガイドには、キャッシュ書き込み料金、キャッシュ読み取り、明示的ブレークポイント、TTL の挙動が記載されています。
OpenAI の API 請求に影響しうるその他のコスト
Reasoning トークンと Pro モード
Reasoning トークンは、可視の応答テキストとして表示されない場合でも出力トークンとして課金されます。より高い推論設定は、合計の出力トークン使用量とレイテンシを増やす可能性があります。
利用できる場合、reasoning.mode = "pro" は、コスト削減や品質向上のデフォルト規則ではなく、ベンチマークすべき設定として扱うのがよいでしょう。OpenAI はこのモードに固定の Pro 追加料金を別途掲載していません。コスト影響は結果としてのトークン使用量から生じます。標準と Pro を代表的なタスクでテストして、タスク成功率、出力トークン総量、レイテンシ、リトライを比較するのが妥当なベースラインです。
ウェブ検索とその他のツール
OpenAI は、標準のウェブ検索を1,000 コールあたり $10、加えて検索コンテンツのトークンは選択したモデルのレートで課金と記載しています。小さな Luna リクエストでウェブ検索を 2 回行うと、モデルトークンのコストを上回る場合があります。
また、非推論モデル向けのウェブ検索プレビュー価格として1,000 コールあたり $25(検索コンテンツのトークンは無料)も記載されています。あらゆるエンドポイントに同じウェブ検索レートを当てはめず、公式の料金ページで正確なツールとモデルの組み合わせを確認してください。
リージョナル処理
2026年3月5日以降にリリースされたモデルについては、対象のリージョナル処理またはデータレジデンシのエンドポイントに10% の上乗せが適用されると、OpenAI の料金ページに記載されています。レジデンシ要件のあるエンタープライズチームは、予算見積もりにこの要因を含めてください。
OpenAI API コストの計算方法
基本的なリクエストでは:
トークンコスト =
(input tokens / 1M × input rate)
- (output tokens / 1M × output rate)
本番計画では、以下を含めて拡張します:
総ワークフローコスト =
未キャッシュ入力
- キャッシュ済み入力
- キャッシュ書き込み
- 出力および推論トークン
- ツール手数料
- サービスティア調整
- 適用される場合のリージョナル上乗せ
- リトライとフォールバックリクエスト
最も有用な KPI はしばしば次のとおりです:
成功タスクあたりコスト = 総ワークフローコスト / 成功タスク数
これにより、失敗やレビュー作業が増える場合に、安いトークンレートが見かけ上魅力的に見えるのを防げます。
過払いせずに最適なモデルを選ぶ方法
価格表を出発点にし、実タスクでテストしましょう。
- まずはタスクをこなせそうな最も低コストのモデルから始める。Luna は単純で大量の作業に対する最初のテストとして妥当ですが、あらゆる抽出や要約で最善だと決めつけないでください。
- 出力の長さを測定する。GPT-5.6 の出力トークンは入力トークンの 6× の価格なので、冗長な応答は要注意です。
- 272K の閾値に注意する。これを超えるとリクエスト全体に高いレートが適用されます。
- 対象となる非緊急作業には Batch または Flex を使う。本番トラフィックを移す前に運用制約をテストしてください。
- 再利用可能なプレフィックスのみをキャッシュする。長いプロンプトだからといってキャッシュすべきだと仮定せず、実際のキャッシュヒット率を測定しましょう。
- ツールとリトライを追跡する。これらは安いモデルによる節約を相殺しかねません。
プロバイダをまたいでルートを比較するチーム向けに、CometAPI pricing はライブのクロスモデルビューを提供します。CometAPI Quickstart と Cookbook を使えば、同一のテストセットを複数の OpenAI 互換ルートで実行できます。
FAQ
2026 年の GPT-5.6 の費用は?
モデルによって異なります。GPT-5.6 Standard の短コンテキスト料金は、Luna が 1M トークンあたり入力 $1 / 出力 $6 から、Sol が $5 / $30 までの範囲です。GPT-5.4 mini や nano などの低コストモデルも利用できます。最新の料金は OpenAI のライブ料金ページで確認してください。
ChatGPT API の料金は GPT-5.6 の料金と同じですか?
「ChatGPT API の料金」は、チャット対応モデルの OpenAI API 料金を意味する非公式な言い方として使われることがありますが、ChatGPT サブスクリプションと API 請求は別製品です。API の利用料金は、特定のモデルと利用タイプによって決まります。
最も安い GPT-5.6 モデルはどれですか?
gpt-5.6-luna が最も安価で、1M 入力トークンあたり $0.20、1M 出力トークンあたり $1.20 です。OpenAI は 7 月 30 日に両レートを 80% 引き下げ、大量のエージェント、分類、ドキュメント処理、定義済みツールのワークフローにおいて Luna を大幅に経済的にしました。
gpt-5.6 はどのモデルを使用しますか?
OpenAI のモデルガイダンスによれば、gpt-5.6 エイリアスは gpt-5.6-sol にルーティングされます。Terra や Luna のティアを使いたい場合は、明示的なモデル ID を使用してください。
GPT-5.6 の長コンテキスト料金はいつ適用されますか?
入力が272,000 トークンを超えると、GPT-5.6 はリクエスト全体に対して高い長コンテキスト料金を適用します。入力関連は 2×、出力は 1.5× です。
GPT-5.6 では Batch と Flex は Standard より安いですか?
対象の GPT-5.6 ワークロードでは、掲載されている Batch と Flex のトークンレートは Standard より約 50% 低くなっています。処理特性が異なるため、その制約にワークロードが耐えられるか確認してください。
GPT-5.6 ではキャッシュ書き込みに追加コストがかかりますか?
はい。GPT-5.6 のキャッシュ書き込みは通常の入力の 1.25×、一致するキャッシュ読み取りは割引されたキャッシュ入力レートで課金されます。節約効果は実際の再利用に依存します。
自分のワークロードで GPT-5.6 コストを比較する
料金表は出発点にすぎません。実際のコストは、プロンプト、出力長、キャッシュヒット率、ツール、リトライ、タスク成功に依存します。
CometAPI を使えば、同一のワークロードで、OpenAI 互換 API を通して GPT-5.6 の Sol、Terra、Luna その他のモデルをテストできます。
次のステップ: 現在のモデル料金を比較、CometAPI Quickstart に従う、または CometAPI Cookbook を使って再現可能なモデル評価を構築しましょう。
品質、レイテンシ、信頼性要件を満たしつつ、最も低コストのルートを選びましょう。
