TL;DR
Обновлённые цены: Стандартные ставки GPT-5.6 для короткого контекста теперь составляют $5 за ввод / $30 за вывод для Sol, $2 / $12 для Terra и $0.20 / $1.20 для Luna за 1 миллион токенов.
30 июля 2026 года OpenAI снизила цены GPT-5.6 Terra на 20% и Luna на 80%. Стоимость Sol не изменилась.
Следите за скрытыми драйверами затрат: общий алиас gpt-5.6 маршрутизируется на Sol, запросы с более чем 272K входных токенов используют повышенные ставки длинного контекста, а стоимость выходных токенов по‑прежнему в 6× выше, чем входных, для всех трёх уровней.
Для нагрузок на Sol, чувствительных к задержкам, новый Fast mode от OpenAI обеспечивает ускорение до 2.5× по сравнению со Standard при 2× цене Standard.
OpenAI API Pricing at a Glance
Для пользователей, которые в целом ищут информацию о ценах OpenAI API, первый вопрос обычно звучит так: за какую текущую модель я на самом деле плачу? Таблица ниже даёт компактный обзор нескольких текущих текстовых моделей OpenAI, прежде чем мы подробнее рассмотрим GPT-5.6.
(> Обновление цен — 30 июля 2026: OpenAI снизила цены GPT-5.6 Terra на 20% и Luna на 80%. Теперь Terra стоит $2 за 1M входных токенов и $12 за 1M выходных токенов, а Luna — $0.20 за ввод и $1.20 за вывод. Стоимость Sol не изменилась.)
| Model | Input / 1M tokens | Cached input | Output / 1M tokens |
|---|---|---|---|
| gpt-5.6-sol | $5.00 | $0.50 | $30.00 |
| gpt-5.6-terra | $2.00 | $0.20 | $12.00 |
| gpt-5.6-luna | $0.20 | $0.02 | $1.20 |
| gpt-5.5 | $5.00 | $0.50 | $30.00 |
| gpt-5.4 | $2.50 | $0.25 | $15.00 |
| gpt-5.4-mini | $0.75 | $0.075 | $4.50 |
| gpt-5.4-nano | $0.20 | $0.02 | $1.25 |
По новой цене Luna соответствует ставке ввода $0.20 у GPT-5.4 nano, предлагая при этом немного более низкую ставку вывода — $1.20 против $1.25.
Источник*:* OpenAI API pricing
Самая важная закономерность легко ускользает от внимания: выходные токены GPT-5.6 стоят в 6× дороже входных на уровнях Sol, Terra и Luna. Длинные ответы, многословные агенты и рабочие процессы с интенсивными рассуждениями могут повышать стоимость быстрее, чем небольшие изменения длины подсказки.
Для более общего обзора семейства GPT-5.6 — включая возможности модели, позиционирование, бенчмарки, доступ к API и ключевые особенности запуска — см. OpenAI's[ GPT-5.6 announcement ]или CometAPI's GPT-5.6 guide. Эта статья фокусируется исключительно на ценах, расчётах стоимости и факторах, которые могут влиять на ваш реальный счёт по API.
GPT-5.6 Pricing: Sol vs Terra vs Luna
GPT-5.6 предлагает три ценовых уровня. OpenAI позиционирует Sol как флагманский маршрут, Terra — как сбалансированный вариант, а Luna — как более доступный уровень для высоких объёмов.
Для более глубокого взгляда на возможности, доступ к GPT-5.6 API и сценарии использования каждой модели,details to see the here about GPT-5.6 model .
Стандартные цены GPT-5.6 для запросов с ≤272K входных токенов
| Model | Short input | Cached input | Cache write | Short output | Long input | Long cached input | Long cache write | Long output |
|---|---|---|---|---|---|---|---|---|
| gpt-5.6-sol | $5.00 | $0.50 | $6.25 | $30.00 | $10.00 | $1.00 | $12.50 | $45.00 |
| gpt-5.6-terra | $2.00 | $0.20 | $2.50 | $12.00 | $4.00 | $0.40 | $5.00 | $18.00 |
| gpt-5.6-luna | $0.20 | $0.02 | $0.25 | $1.20 | $0.40 | $0.04 | $0.50 | $1.80 |
Источник*:* OpenAI API pricing
Цены для длинного контекста: Запросы с более чем 272K входных токенов используют повышенные ставки. Ввод, кэшированный ввод и записи в кэш тарифицируются по 2× стандартной ставке, а вывод — по 1.5×. Повышенные ставки применяются ко всему запросу.
Разумная отправная точка — тестировать Luna для более простых, высокообъёмных задач, Terra — для сбалансированных приложений, и Sol — для самых сложных или критичных задач. Это не универсальные рекомендации: точность, повторы, поведение инструментов и ручная проверка могут перевесить разницу в прайс-листе.
Важная деталь об алиасе
Руководство по моделям OpenAI (OpenAI's model guidance) утверждает, что общий алиас gpt-5.6 маршрутизируется на gpt-5.6-sol.
Это значит, что запрос, отправленный на gpt-5.6, использует ценовой уровень Sol. Если ваша нагрузка хорошо работает на Terra или Luna, используйте явный идентификатор модели вместо предположения, что общий алиас выберет самый дешёвый подходящий уровень.
Example 1: A Typical API Request
Начнём с типичной формы запроса:
- 1,000 входных токенов
- 500 выходных токенов
| Model | Monthly input cost | Monthly output cost | Total |
|---|---|---|---|
| gpt-5.6-sol | $10,000 | $15,000 | $25,000 |
| gpt-5.6-terra | $4,000 | $6,000 | $10,000 |
| gpt-5.6-luna | $400 | $600 | $1,000 |
При такой нагрузке новая цена Luna снижает оценочный ежемесячный счёт за токены с $5,000 до $1,000, а Terra — с $12,500 до $10,000.
Расчёт для Sol:
(1,000 / 1,000,000 × $5) + (500 / 1,000,000 × $30) = $0.020
Этот пример также показывает, почему важна длина вывода. Хотя запрос содержит вдвое больше входных токенов, чем выходных, на 75% стоимости токенов Sol приходится вывод, потому что он оценивается в шесть раз дороже входа.
Для чатов, агентов и генерации кода контроль избыточной многословности иногда позволяет сэкономить больше, чем небольшая обрезка системной подсказки.
Example 2: Monthly Cost at Scale
Теперь предположим, что приложение обрабатывает 1 миллион запросов в месяц, в среднем:
- 2,000 входных токенов на запрос
- 500 выходных токенов на запрос
Это равно 2 миллиардам входных токенов и 500 миллионам выходных токенов в месяц.
| Model | Monthly input cost | Monthly output cost | Total |
|---|---|---|---|
| gpt-5.6-sol | $10,000 | $15,000 | $25,000 |
| gpt-5.6-terra | $5,000 | $7,500 | $12,500 |
| gpt-5.6-luna | $2,000 | $3,000 | $5,000 |
Разрыв достаточно велик, чтобы оправдать тестирование маршрутов, но самая нижняя строка не обязательно лучший выбор для продакшена. Если более дешёвая модель вызывает больше повторов, неудачных задач или ручной проверки, итоговая стоимость рабочего процесса может быть выше.
Long-Context Pricing: What Happens Above 272K Tokens?
Модели GPT-5.6 поддерживают контекстное окно в 1.05M токенов, но OpenAI применяет повышенные ставки, когда запрос содержит более 272,000 входных токенов.
Для таких запросов с длинным контекстом:
- ввод тарифицируется по 2× ставке короткого контекста
- кэшированный ввод и записи в кэш также тарифицируются по 2×
- вывод тарифицируется по 1.5×
- Повышенные ставки применяются к целому запросу, а не только к токенам сверх 272K
Для Sol это меняет ввод с $5 до $10 за 1M токенов, а вывод — с $30 до $45. Та же структура множителей применяется к Terra и Luna.
Это создаёт резкий скачок стоимости около 272K. Для нагрузок, находящихся близко к порогу, уменьшайте дублирующиеся фрагменты выдачи, устаревшую историю диалога, ненужные файлы репозитория или многословный вывод инструментов перед отправкой запроса. Дополнительные рекомендации по снижению токенов см. в руководстве по оптимизации стоимости OpenAI.
Standard, Batch, Flex, and Priority Pricing
Для соответствующих текстовых нагрузок GPT-5.6 OpenAI предлагает несколько уровней обработки.
| Tier | Sol input/output | Terra input/output | Luna input/output | Typical use |
|---|---|---|---|---|
| Standard | $5 / $30 | $2 / $12 | $0.20 / $1.20 | Обычный синхронный трафик |
| Batch | $2.50 / $15 | $1 / $6 | $0.10 / $0.60 | Оффлайн асинхронные задания |
| Flex | $2.50 / $15 | $1 / $6 | $0.10 / $0.60 | Чувствительные к стоимости нагрузки, допускающие более медленную обработку |
| Fast mode | $10 / $60 | $4 / $24 | $0.40 / $2.40 | Трафик с коротким контекстом, чувствительный к задержкам |
Batch и Flex остаются примерно на 50% дешевле Standard. Priority Processing было переименовано в Fast mode 30 июля 2026 года, хотя существующие запросы с service_tier: "priority" по‑прежнему совместимы.
Для GPT-5.6 Sol Fast mode обеспечивает ускорение обработки до 2.5× относительно Standard при 2× цене за токены, без изменения «интеллекта» модели. Он наиболее уместен, когда пользовательская задержка настолько важна, что оправдывает наценку.
Prompt Caching: When Does It Save Money for GPT-5.6 ?
Для GPT-5.6 запись в кэш стоит 1.25× от обычной ставки ввода, а чтения из кэша получают снижённую цену кэшированного ввода.
Рассмотрим повторно используемый префикс на 100,000 токенов на Sol:
| Action | Cost |
|---|---|
| Process once as normal uncached input | $0.50 |
| Write the prefix to cache | $0.63 |
| Read the cached prefix later | $0.05 |
Два не кэшированных использования стоят $1.00. Одна запись в кэш плюс одно соответствующее чтение из кэша стоят $0.675, экономя $0.325 в этом упрощённом примере.
Границы примера: Этот расчёт сравнивает только стоимость ввода для повторно используемого префикса. Он не включает выходные токены, другой не кэшированный ввод, инструменты или повторы. Реальная экономия зависит от соответствия префикса требованиям кэша и частоты его фактического повторного использования.
Таким образом, кэширование особенно полезно для длинных, стабильных префиксов подсказок, которые получают повторяющиеся совпадающие запросы. Запись в кэш, которая никогда не переиспользуется, увеличивает стоимость, а не снижает её.
В руководстве по кэшированию подсказок OpenAI документированы цены на запись в кэш, кэшированные чтения, явные точки разрыва и поведение TTL.
Other Costs That Can Change Your OpenAI API Bill
Reasoning tokens and Pro mode
Токены рассуждения тарифицируются как выходные токены, даже если они не показаны как видимый текст ответа. Более высокие настройки рассуждений могут, таким образом, увеличить общее использование выходных токенов и задержку.
Там, где поддерживается, reasoning.mode = "pro" лучше рассматривать как конфигурацию для бенчмаркинга, а не как правило экономии или качества по умолчанию. OpenAI не указывает отдельную фиксированную надбавку Pro для этого режима; влияние на стоимость связано с получившимся использованием токенов. Разумная база — протестировать Standard и Pro на репрезентативных задачах и сравнить успех задач, общее число выходных токенов, задержку и повторы.
Web search and other tools
OpenAI в настоящий момент указывает стандартный web search по цене $10 за 1,000 вызовов, плюс токены содержания поиска, тарифицируемые по ставке выбранной модели. Два веб‑поиска в небольшом запросе на Luna могут стоить дороже, чем модельные токены самого запроса.
OpenAI также указывает отдельную цену web search preview для моделей без рассуждений — $25 за 1,000 вызовов, при этом токены содержания поиска бесплатны. Проверяйте точную комбинацию инструмента и модели на официальной странице цен, а не применяйте одну ставку веб‑поиска ко всем эндпоинтам.
Regional processing
Соответствующие региональные эндпоинты обработки или хранения данных для моделей, выпущенных 5 марта 2026 года или позже, имеют наценку 10% согласно странице цен OpenAI. Командам Enterprise с требованиями к резидентству следует учитывать этот фактор в бюджетных оценках.
How to Calculate OpenAI API Cost
Для базового запроса:
Token cost =
(input tokens / 1M × input rate)
- (output tokens / 1M × output rate)
Для планирования продакшена расширьте формулу, включив:
Total workflow cost =
uncached input
- cached input
- cache writes
- output and reasoning tokens
- tool fees
- service-tier adjustments
- regional uplift, if applicable
- retries and fallback requests
Наиболее полезный KPI часто таков:
Cost per successful task = total workflow cost / successful tasks
Это предотвращает искусственное «удешевление» при более низкой цене токена, если оно сопровождается большим числом отказов или объёмом проверок.
How to Choose the Right Model Without Overpaying
Используйте таблицу цен как отправную точку, затем тестируйте на реальных задачах.
- Начинайте с самой дешёвой модели, которая, по‑видимому, справляется с задачей. Luna может быть разумным первым тестом для простых, высокообъёмных работ, но не предполагаете, что она будет лучше для каждой задачи извлечения или суммаризации.
- Измеряйте длину вывода. Выходные токены GPT-5.6 стоят в 6× дороже входных, поэтому многословные ответы заслуживают внимания.
- Следите за порогом 272K. Его пересечение меняет ставки для всего запроса.
- Используйте Batch или Flex для подходящих не срочных задач. Проверьте операционные ограничения, прежде чем переводить продакшен‑трафик.
- Кэшируйте только повторно используемые префиксы. Измеряйте фактические попадания в кэш, а не предполагаете, что длинную подсказку следует кэшировать.
- Отслеживайте инструменты и повторы. Они могут свести на нет экономию от более дешёвой модели.
Для команд, сравнивающих маршруты у разных провайдеров, CometAPI pricing предоставляет живой кросс‑модельный обзор. CometAPI Quickstart и Cookbook можно использовать, чтобы запускать один и тот же набор тестов через несколько совместимых с OpenAI маршрутов.
FAQ
How much does the GPT-5.6 cost in 2026?
Стоимость зависит от модели. Стандартные ставки GPT-5.6 для короткого контекста варьируются от $1 за ввод / $6 за вывод за 1M токенов для Luna до $5 / $30 для Sol. Доступны и более недорогие модели, такие как GPT-5.4 mini и nano. Проверьте конкретную модель на живой странице цен OpenAI.
Is ChatGPT API pricing the same as GPT-5.6 pricing?
«Цены ChatGPT API» часто неформально используют в значении цен OpenAI API для моделей с поддержкой чата, но подписки ChatGPT и биллинг API — отдельные продукты. Использование API тарифицируется по конкретной модели и типу использования.
Which GPT-5.6 model is cheapest?
gpt-5.6-luna — самая дешёвая модель GPT-5.6 с ценой $0.20 за 1M входных токенов и $1.20 за 1M выходных токенов. OpenAI снизила обе ставки на 80% 30 июля, что делает Luna существенно более экономичной для высокообъёмных агентов, классификации, обработки документов и чётко определённых рабочих процессов с инструментами.
What model does gpt-5.6 use?
Руководство OpenAI по моделям утверждает, что алиас gpt-5.6 маршрутизируется на gpt-5.6-sol. Используйте явные идентификаторы Terra или Luna, когда хотите эти уровни.
When does GPT-5.6 long-context pricing apply?
Когда вход превышает 272,000 токенов, GPT-5.6 применяет повышенные ставки длинного контекста ко всему запросу: 2× для ставок, связанных с вводом, и 1.5× для ставок вывода.
Are Batch and Flex cheaper than Standard for GPT-5.6?
Для подходящих нагрузок GPT-5.6 указанные ставки токенов Batch и Flex примерно на 50% ниже, чем у Standard. У них другие характеристики обработки, поэтому убедитесь, что нагрузка может их терпеть.
Do cache writes cost extra for GPT-5.6?
Да. Записи в кэш GPT-5.6 стоят 1.25× от обычной ставки ввода, а соответствующие кэшированные чтения используют скидочную цену кэшированного ввода. Экономия зависит от фактического повторного использования.
Compare GPT-5.6 Costs on Your Own Workload
Таблицы цен — это отправная точка. Ваша реальная стоимость зависит от подсказок, длины вывода, попаданий в кэш, инструментов, повторов и успешности задач.
С CometAPI вы можете тестировать Sol, Terra, Luna и другие модели GPT-5.6 через один совместимый с OpenAI API, используя одну и ту же нагрузку.
Next steps: compare current model pricing, следуйте CometAPI Quickstart, или используйте CometAPI Cookbook, чтобы построить воспроизводимые оценки моделей.
Выберите самый дешевый маршрут, который всё ещё соответствует вашим требованиям к качеству, задержке и надёжности.
