Claude Haiku 5.5 and Nano Banana 2.1 are now live on CometAPI →
ai-model/Исследования CometAPI

GPT-6.1 Sol Price: тарифы API, кэшированные токены, длинный контекст и стоимость CometAPI

Сравните цены API GPT-6.1 Sol, операции чтения и записи кэша, ставки для длинного контекста, уровни обработки, стоимость CometAPI и стоимость за принятое задание.

CometAPI
Deon GoodwinКоманда исследователей AI-моделей и API
Обновлено Oct 10, 2026 14 мин. чтения
GPT-6.1 Sol Price: тарифы API, кэшированные токены, длинный контекст и стоимость CometAPI
Использовать этот подход

Сделайте первый вызов API.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR

GPT-6.1 Sol — модель OpenAI для сложных задач рассуждения: продвинутое программирование, компьютерное использование и профессиональные рабочие процессы. Она сохраняет официальные ставки Standard для нового ввода и вывода на уровне $2/$10 за миллион токенов, снижая при этом стоимость чтений из кэша в коротком контексте с $0.20 до $0.10. Успешное повторное использование кэша может снизить стоимость при повторяющихся контекстах. Превышение 272K токенов ввода активирует более высокие ставки для всего запроса, поэтому оценивайте каждый запрос до агрегации счета. У CometAPI — отдельная тарифная сетка шлюза.

Key Takeaways

  • Разделяйте новый ввод, чтения из кэша, записи в кэш и тарифицируемый вывод; вывод включает токены рассуждения.
  • Используйте корректный диапазон контекста для каждого запроса. Вместимость контекста 1.05M не означает цены короткого контекста.
  • Сравнивайте OpenAI и CometAPI при одинаковом составе токенов и соответствующих условиях биллинга аккаунта.
  • Выбирайте режим обработки по латентности, доступности и поддержке маршрута.
  • Оценивайте экономику агента по полной стоимости на одну принятую задачу, включая неуспешные попытки.

What Is the GPT-6.1 Sol Price at a Glance?

Все цены ниже указаны в USD за миллион токенов. Официальная таблица цен на токены дает базовые ставки OpenAI; чтения и записи в кэш тарифицируются отдельно. Диапазоны контекста относятся к токенам ввода в рамках одного запроса.

OpenAI mode / input bandFresh inputCache readCache writeOutput
Standard: at most 272K$2.00$0.10$2.50$10.00
Standard: above 272K$4.00$0.20$5.00$15.00
Batch/Flex: at most 272K$1.00$0.05$1.25$5.00
Batch/Flex: above 272K$2.00$0.10$2.50$7.50
Fast: at most 272K$4.00$0.20$5.00$20.00
Fast: above 272K$8.00$0.40$10.00$30.00
Ultrafast: at most 272K$12.00$0.60$15.00$60.00
Ultrafast: above 272K$24.00$1.20$30.00$90.00

Ставки уровней обработки OpenAI проверены 9 октября 2026 года; сравнение с CometAPI сохраняет расписание шлюза из исходной статьи. Это ставки уровней обработки OpenAI; они не гарантируют, что каждый уровень доступен через ваш шлюз. Региональная обработка добавляет 10% при необходимости. Перед бюджетированием подтверждайте выбранный сервис и условия аккаунта.

Для разработчиков, обращающихся к GPT-6.1 Sol через CometAPI, ставка для стандартного контекста ниже, чем прямая цена OpenAI в Standard.

Token categoryCometAPIOpenAI StandardDifference
Input / 1M$1.60$2.00на 20% ниже
Cached input / 1M$0.08$0.10на 20% ниже
Cache write / 1M$2.00$2.50на 20% ниже
Output / 1M$8.00$10.00на 20% ниже

Для запросов с длинным контекстом API GPT-6.1 Sol в CometAPI использует:

Long-context tokensCometAPIOpenAI
Input / 1M$3.20$4.00
Cached input / 1M$0.16$0.20
Cache write / 1M$4.00$5.00
Output / 1M$12.00$15.00

Это сохраняет примерно 20% разницу по основным категориям токенов. Для бюджетирования это важно, поскольку в промышленной нагрузке редко бывают только токены нового ввода. Когда учитываются кэшированный контекст, генерация вывода и запросы длинного контекста, сравнение только заявленной ставки ввода может сильно занизить разницу между маршрутами.

Тарифная сетка токенов CometAPI дает ссылку по шлюзу. При 100K нового ввода и 10K тарифицируемого вывода OpenAI Standard стоит $0.30; соответствующее расписание CometAPI — $0.24. Для 10,000 идентичных запросов итог по токенам составит $3,000 и $2,400. Это сравнение исключает инструменты, записи в кэш, повторы и надбавки.

GPT-6.1 Sol позиционируется для сложного программирования, компьютерного использования и профессиональных рабочих процессов. Ее окно контекста 1,050,000 токенов и максимум вывода 128,000 токенов — это ограничения по емкости, а не гарантия тарифа короткого контекста: запросы свыше 272K токенов ввода используют более высокие ставки. Модель принимает текст и изображения и генерирует текст; для вызова инструментов используйте Responses API, а Chat Completions поддерживает запросы без инструментов. Отдельно проверяйте поддержку инструментов и уровней обработки у выбранного шлюза при выборе маршрута.

Additional GPT-6.1 Sol Agent Expenses

Бюджет агента также включает хостинг инструментов, среды выполнения, хранилище и внешние сервисные сборы. OpenAI указывает стоимость веб-поиска $10 за 1,000 вызовов. Полученный поиском контент тарифицируется по ставкам модели. Вызовы file-search стоят $2.50 за 1,000; хранение — $0.10 за ГБ в день после бесплатного лимита 1 ГБ.

Hosted Shell и Code Interpreter имеют отдельные тарифы на контейнеры по той же схеме OpenAI, указанной выше. Опубликованная ставка за 1 ГБ — $0.03 за 20-минутную сессию на контейнер; для подходящих сессий действует поминутная тарификация с минимальными пятью минутами. Используйте фактические условия инструментов и выполнения выбранного шлюза, а не предполагайте, что эти прямые тарифы применяются без изменений.

Reasoning Effort and Total GPT-6.1 Sol Spend

Интенсивность рассуждений не выделена отдельной строкой в таблице ставок, но может влиять на тарифицируемый вывод, использование инструментов, длину траектории и количество повторов. Сравнивайте поддерживаемые уровни усилий от low до max на одном наборе задач. Фиксируйте фактическое потребление, а не оценивайте стоимость рассуждений только по видимой длине ответа.

How Does the 272K Threshold Change GPT-6.1 Sol Cost?

Когда ввод превышает 272K токенов, OpenAI применяет ставки длинного контекста ко всему запросу: стоимость ввода и кэша удваивается, а вывод увеличивается на 50%. Порог по вводу применяется даже тогда, когда значительная часть ввода подана из кэша.

WorkloadFresh inputBilled outputOpenAI StandardCometAPI catalog
Small analysis20K2K$0.06$0.048
Document review100K10K$0.30$0.24
Below threshold270K10K$0.64$0.512
Above threshold280K10K$1.27$1.016
Repository analysis300K20K$1.50$1.20
270K input: 0.27 x $2 + 0.01 x $10 = $0.64
280K input: 0.28 x $4 + 0.01 x $15 = $1.27
Input grows about 3.7%; token cost grows about 98.4%.

Это независимые запросы без кэша, инструментов, повторов и дополнительных надбавок. Эффект порога — причина, по которой выбор диапазона контекста важен даже тогда, когда модель вмещает весь репозиторий.

How Does Prompt Caching Change GPT-6.1 Sol Input Costs?

Чтения из кэша в коротком контексте Standard стоят $0.10/M против $2/M для нового ввода. Успешное чтение, таким образом, на 95% дешевле для этой категории токенов. Запись в кэш стоит $2.50/M. Экономия зависит от успешного повторного использования кэшированного префикса, а не просто от повторения похожего текста.

Рассмотрим десять запросов, разделяющих один префикс длиной 100K токенов. Каждый остается в диапазоне короткого контекста. В контролируемом сценарии кэширования префикс записывается целиком один раз и успешно читается девять раз без дополнительных записей. Префикс в первом запросе тарифицируется только по ставке записи в кэш; те же токены не тарифицируются одновременно как новый ввод.

Repeated-prefix costNo cacheOne write + nine reads
Fresh prefix input10 x 0.1 x $2 = $2.00$0.00
Cache write$0.000.1 x $2.50 = $0.25
Cache reads$0.009 x 0.1 x $0.10 = $0.09
Prefix subtotal$2.00$0.34

Снижение на $1.66 — это 83% стоимости повторяющегося префикса. Это не означает 83% сокращения типового счета API. Если каждый запрос также генерирует 2K тарифицируемых токенов вывода, вывод добавит $0.20 по десяти запросам: итоги составят $2.20 и $0.54, снижение примерно на 75.5%. Новый ввод, промахи, дополнительные записи, инструменты и диапазоны длинного контекста меняют результат.

При этих упрощенных предположениях короткого контекста «одна запись плюс N-1 чтений» стоит 0.25 + 0.01(N-1) доллара для префикса 100K, против 0.20N без кэширования. Двух запросов достаточно, чтобы кэшированный сценарий оказался дешевле при условии, что второй запрос действительно попадает в кэш, и другие затраты не меняются.

How Does GPT-6.1 Sol Pricing Compare with GPT-6 Sol and GPT-6 Astra?

OpenAI документирует спецификации GPT-6 Sol. Снижение стоимости чтений из кэша — это сравнение ставок, а не доказательство меньшей совокупной стоимости задачи.

Official Standard short-context comparisonGPT-6.1 SolGPT-6 SolGPT-6 Astra
Fresh input / 1M tokens$2.00$2.00$10.00
Cache read / 1M tokens$0.10$0.20$1.00
Cache write / 1M tokens$2.50$2.50$12.50
Output / 1M tokens$10.00$10.00$50.00
Context window / maximum output1.05M / 128K1.05M / 128K1.05M / 128K

GPT-6.1 Sol вдвое снижает стоимость чтений из кэша в коротком контексте. Ставки для нового ввода, записей и вывода не изменились. Максимальная выгода зависит от доли вашего счета, приходящейся на успешные чтения из кэша. При миграции заново протестируйте уровни усилий, циклы с инструментами и результаты задач.

В сравнении с GPT-6 Sol, GPT-6.1 Sol сохраняет те же ставки нового ввода, записи в кэш и вывода, одновременно сокращая стоимость чтений из кэша на 50%. В сравнении с GPT-6 Astra используйте приведенные ставки вместе с измеренным качеством задач и общей стоимостью траектории.

Расписание ставок GPT-6 Astra помещает Astra в более высокий ценовой диапазон токенов.

GPT-6.1 Sol на 80% дешевле по новому вводу, записям в кэш и выводу, и на 90% дешевле по чтениям из кэша в этом диапазоне. Эти соотношения не доказывают эквивалентного качества. Astra может оправдывать премию, если лучшие принятые результаты компенсируют дополнительные траты; GPT-6.1 Sol предпочтительнее, когда достигает той же цели принятия по более низкой цене.

Сравнивайте патчи репозиториев, анализ документов и задачи компьютерного использования отдельно. Удерживайте неизменными подсказки, разрешения инструментов, уровни усилий, лимиты повторов и проверки принятия. Учитывайте нерешенные провалы наряду с успешными результатами; не выводите универсальные рейтинги программирования или исследований только из цен на токены.

What Does GPT-6.1 Sol Cost for Real API Workloads?

Рассчитывайте стоимость на запрос с его фактическим диапазоном и режимом обработки, затем суммируйте результаты. Новый ввод исключает кэшированные чтения; не тарифицируйте одни и те же токены ввода одновременно как новый ввод и как кэш. Используйте записи провайдера для различения записей в кэш от прочего ввода. В формуле ниже fresh_input исключает и cache_reads, и cache_writes. Токены, тарифицируемые по ставке записи в кэш, не должны одновременно учитываться как новый ввод. Рассматривайте все три величины как взаимно исключающие категории биллинга и сводите их с записями потребления провайдера.

request_token_cost =
  fresh_input / 1_000_000 * fresh_rate
+ cache_reads / 1_000_000 * read_rate
+ cache_writes / 1_000_000 * write_rate
+ billed_output / 1_000_000 * output_rate

period_total = sum(request_token_cost) + other_charges

Aggregate Usage Across Multiple Short Requests

Десять запросов, каждый с 100K нового ввода и 20K тарифицируемого вывода, в сумме дают 1M ввода и 200K вывода. Каждый отдельный запрос остается ниже 272K ввода и ниже лимита вывода 128K. Итого по OpenAI Standard — $4.00; по CometAPI — $3.20. Разница в 20% применяется только к этим моделированным категориям токенов. Это не один запрос с 1M ввода и 200K вывода.

A Cache-Heavy Period With Separately Billed Writes

Предположим, за период зафиксировано 1M нового ввода, 5M чтений из кэша, 500K тарифицируемого вывода и 500K записей в кэш. Все составляющие запросы остаются в коротком контексте Standard. Стоимость в OpenAI: $2.00 + $0.50 + $5.00 + $1.25 = $8.75. В CometAPI: $1.60 + $0.40 + $4.00 + $1.00 = $7.00. Эти категории — отдельные биллинговые величины; пример не предполагает, что весь повторяющийся ввод — это попадание в кэш.

One Long-Context Request

Запрос с 400K нового ввода и 100K тарифицируемого вывода использует ставки длинного контекста. Стоимость OpenAI Standard: 0.4 x $4 + 0.1 x $15 = $3.10. В CometAPI: 0.4 x $3.20 + 0.1 x $12 = $2.48. Обе оценки исключают новые записи в кэш и нетокенные сборы. Количество 100K вывода включает рассуждения и должно укладываться в бюджет вывода модели.

How Do Standard, Batch, Flex, Fast, and Ultrafast Change GPT-6.1 Sol Cost?

Для запроса с 300K нового ввода и 20K тарифицируемого вывода используйте диапазон длинного контекста.

OpenAI modeInput costOutput costToken subtotal
Batch/Flex$0.60$0.15$0.75
Standard$1.20$0.30$1.50
Fast$2.40$0.60$3.00
Ultrafast$7.20$1.80$9.00

Расчет для Ultrafast: 0.30M нового ввода x $24/M + 0.02M тарифицируемого вывода x $90/M = $7.20 + $1.80 = $9.00. Это использует диапазон длинного контекста и исключает кэш, инструменты и региональные надбавки.

Batch подходит для офлайн-оценок, обогащения, бэкфиллов и пакетной обработки документов. Flex предлагает более низкие ставки для подходящих рабочих нагрузок, терпящих переменную обработку и доступность. Standard — базовый вариант для интерактивных запросов. Fast удваивает применимые ставки токенов; выбирайте его, когда снижение ожидания имеет измеримую ценность.

Ultrafast приоритизирует низкую латентность по более высокой цене токенов. Для GPT-6.1 Sol установите service_tier в значение ultrafast в запросах Responses. OpenAI рекомендует WebSockets для быстрых циклов инструментов; перед маршрутизацией продакшен-трафика проверьте лимиты, специфичные для уровня, и поддержку шлюза. Ставки взяты из официальной таблицы цен OpenAI.

Эти ставки не доказывают, что каждый уровень включен для вашего аккаунта шлюза. Подтверждайте поддерживаемую маршрутизацию и региональные ограничения перед внедрением. Не закладывайте в бюджет необъявленную или недоступную опцию обработки, как будто она уже имеет ставку Standard.

Why Is Cost per Successful GPT-6.1 Sol Task the Better Metric?

Делите общие измеренные расходы модели, инструментов и выполнения по набору оценок на количество принятых результатов. Включайте неуспешные попытки в числитель. Отдельно указывайте время человеческой правки и нерешенные провалы, чтобы стоимость не «улучшалась» лишь за счет отказа от более сложных задач.

observed_cost_per_accepted_task =
  all_evaluation_model_tool_execution_cost / accepted_tasks

Для иллюстрации: попытка за $0.40 с вероятностью успеха 60% имеет ожидаемую стоимость $0.40 / 0.60 ≈ $0.67 до достижения успеха. Попытка за $0.55 с вероятностью 85% — около $0.65 при той же модели. Это гипотетические цифры, а не результаты бенчмарков или утверждения о конкретной модели.

Эта оценка предполагает независимые повторы с неизменными стоимостью и вероятностью успеха, продолжающиеся до успеха. Не добавляйте второй лимит повторов: деление уже учитывает повторы. Коррелированные сбои, ограниченные повторы, разная сложность задач, инструменты и участие человека могут сделать эту модель неприменимой. Используйте наблюдаемую стоимость принятой задачи для производственных решений.

How Can You Reduce GPT-6.1 Sol API Costs?

Максимизируйте повторно используемые префиксы подсказок. Помещайте стабильные системные инструкции, определения инструментов, схемы и фоновый контекст в повторно используемые префиксы. Цена $0.10/M на кэшированный ввод в GPT-6.1 Sol делает повторяющийся контекст значительно дешевле по сравнению с новым вводом.

Держите запросы ниже 272K, когда полный контекст не обязателен. Превышение 272K токенов ввода меняет ставки для всего запроса. Поиск, сжатие контекста и выборочная загрузка файлов могут снизить стоимость даже тогда, когда модель технически поддерживает окно контекста 1.05M.

Используйте Batch для асинхронных пакетных рабочих процессов. Офлайн-оценки, обогащение, бэкфиллы и пакетная обработка документов могут использовать Batch, когда не требуется немедленный возврат результатов.

Используйте Flex для низкоприоритетных запросов, терпящих задержки и эпизодическую недоступность ресурсов. Планируйте задержки и повторы; проверяйте подходящие рабочие нагрузки и поддержку маршрутов. Batch и Flex используют более низкие ставки, показанные выше, но обслуживают разные потребности обработки.

Измеряйте стоимость принятой задачи. Логируйте токены нового ввода, кэшированного ввода, записи в кэш, токены вывода, режим обработки, затраты на инструменты, повторы и успех задачи. Затем вычисляйте реальную стоимость успешного завершения.

Маршрутизируйте простые задачи на более дешевые модели. Не каждому запросу требуется уровень рассуждений Sol. Классификация, маршрутизация, простое извлечение и другие высокопроверяемые задачи могут подходить более дешевой модели, в то время как GPT-6.1 Sol обрабатывает задачи, где более сильные рассуждения существенно повышают завершение.

Это особенно важно для агентов, поскольку неудачный запуск за $0.50 с последующими двумя повторами может оказаться дороже, чем один успешный запуск за $1.00.

Используйте явные лимиты завершения, лимиты циклов инструментов и бюджеты повторов. Анализируйте записи использования по новому вводу, чтениям и записям в кэш, токенам рассуждений, уровню, диапазону контекста и затратам на инструменты. Сравнивайте экономию с качеством принятых задач после каждого изменения.

Conclusion

GPT-6.1 Sol привлекателен, когда рабочему процессу нужны сложные рассуждения по ставкам уровня Sol и возможна повторная эксплуатация стабильного контекста. Он сохраняет заглавные ставки Standard GPT-6 Sol в $2/$10, снижая чтения из кэша в коротком контексте до $0.10/M. У Astra выше ставки токенов, но выбор должен опираться на качество нагрузки и стоимость принятой задачи.

Начинайте с оценок по запросам, отделяйте записи в кэш от чтений и следите за границей 272K. Затем измеряйте полную траекторию агента и выбирайте уровень обработки, соответствующий латентности и доступности. CometAPI предоставляет отдельную ценовую сетку; подтверждайте фактические условия аккаунта и инструментов перед масштабированием.

FAQ

How Should GPT-6.1 Sol Budgets Handle Failed or Cancelled Requests?

Отслеживайте у провайдера использование по завершенным, незавершенным, неуспешным и отмененным запросам отдельно. Не предполагайте, что каждый неуспешный запрос бесплатен или что отмена на стороне клиента предотвращает работу на стороне сервера. Сверяйте идентификаторы запросов и учет использования с биллингом, затем включайте тарифицируемую неуспешную работу в расчет стоимости принятой задачи. Подтверждайте правила списаний и возвратов конкретного провайдера, а не выводите их из HTTP-статуса.

How Should Teams Forecast GPT-6.1 Sol Costs for Variable Traffic?

Сегментируйте трафик по диапазону ввода, уровню обработки, составу кэша и типу работы. Используйте измеренные распределения токенов и завершений, а не одну среднюю подсказку. Постройте базовый прогноз и сценарии для более низких попаданий в кэш, большего числа повторов и более длинных выводов; также мониторьте долю, пересекающую 272K. Обновляйте прогноз по мере изменения микса задач.

How Can Teams Reconcile GPT-6.1 Sol Forecasts With Invoices?

Выберите завершенный биллинговый период и сгруппируйте запросы по маршруту, уровню обработки и диапазону ввода. Сверьте записанное использование с категориями счета и кредитами, включая корректировки, затраты на инструменты и любые применимые налоги или конвертацию валюты. Разбирайте расхождения по идентификаторам запросов и временным меткам биллинга, а не применяйте необъяснимые корректирующие коэффициенты. Подтверждайте задержки отчетности и правила округления провайдера перед изменением прогноза.

Продолжить обучение

Свяжите эту статью со следующим решением.

Посмотреть все темы
Опубликовано Oct 10, 2026
Последнее обновление Oct 10, 2026
1 просмотров
Проверено на ясность, указание источников и актуальную терминологию API.

Читать далее