TL;DR
GPT-6.1 Sol — модель OpenAI для сложных задач рассуждения: продвинутое программирование, компьютерное использование и профессиональные рабочие процессы. Она сохраняет официальные ставки Standard для нового ввода и вывода на уровне $2/$10 за миллион токенов, снижая при этом стоимость чтений из кэша в коротком контексте с $0.20 до $0.10. Успешное повторное использование кэша может снизить стоимость при повторяющихся контекстах. Превышение 272K токенов ввода активирует более высокие ставки для всего запроса, поэтому оценивайте каждый запрос до агрегации счета. У CometAPI — отдельная тарифная сетка шлюза.
Key Takeaways
- Разделяйте новый ввод, чтения из кэша, записи в кэш и тарифицируемый вывод; вывод включает токены рассуждения.
- Используйте корректный диапазон контекста для каждого запроса. Вместимость контекста 1.05M не означает цены короткого контекста.
- Сравнивайте OpenAI и CometAPI при одинаковом составе токенов и соответствующих условиях биллинга аккаунта.
- Выбирайте режим обработки по латентности, доступности и поддержке маршрута.
- Оценивайте экономику агента по полной стоимости на одну принятую задачу, включая неуспешные попытки.
What Is the GPT-6.1 Sol Price at a Glance?
Все цены ниже указаны в USD за миллион токенов. Официальная таблица цен на токены дает базовые ставки OpenAI; чтения и записи в кэш тарифицируются отдельно. Диапазоны контекста относятся к токенам ввода в рамках одного запроса.
| OpenAI mode / input band | Fresh input | Cache read | Cache write | Output |
|---|---|---|---|---|
| Standard: at most 272K | $2.00 | $0.10 | $2.50 | $10.00 |
| Standard: above 272K | $4.00 | $0.20 | $5.00 | $15.00 |
| Batch/Flex: at most 272K | $1.00 | $0.05 | $1.25 | $5.00 |
| Batch/Flex: above 272K | $2.00 | $0.10 | $2.50 | $7.50 |
| Fast: at most 272K | $4.00 | $0.20 | $5.00 | $20.00 |
| Fast: above 272K | $8.00 | $0.40 | $10.00 | $30.00 |
| Ultrafast: at most 272K | $12.00 | $0.60 | $15.00 | $60.00 |
| Ultrafast: above 272K | $24.00 | $1.20 | $30.00 | $90.00 |
Ставки уровней обработки OpenAI проверены 9 октября 2026 года; сравнение с CometAPI сохраняет расписание шлюза из исходной статьи. Это ставки уровней обработки OpenAI; они не гарантируют, что каждый уровень доступен через ваш шлюз. Региональная обработка добавляет 10% при необходимости. Перед бюджетированием подтверждайте выбранный сервис и условия аккаунта.
Для разработчиков, обращающихся к GPT-6.1 Sol через CometAPI, ставка для стандартного контекста ниже, чем прямая цена OpenAI в Standard.
| Token category | CometAPI | OpenAI Standard | Difference |
|---|---|---|---|
| Input / 1M | $1.60 | $2.00 | на 20% ниже |
| Cached input / 1M | $0.08 | $0.10 | на 20% ниже |
| Cache write / 1M | $2.00 | $2.50 | на 20% ниже |
| Output / 1M | $8.00 | $10.00 | на 20% ниже |
Для запросов с длинным контекстом API GPT-6.1 Sol в CometAPI использует:
| Long-context tokens | CometAPI | OpenAI |
|---|---|---|
| Input / 1M | $3.20 | $4.00 |
| Cached input / 1M | $0.16 | $0.20 |
| Cache write / 1M | $4.00 | $5.00 |
| Output / 1M | $12.00 | $15.00 |
Это сохраняет примерно 20% разницу по основным категориям токенов. Для бюджетирования это важно, поскольку в промышленной нагрузке редко бывают только токены нового ввода. Когда учитываются кэшированный контекст, генерация вывода и запросы длинного контекста, сравнение только заявленной ставки ввода может сильно занизить разницу между маршрутами.
Тарифная сетка токенов CometAPI дает ссылку по шлюзу. При 100K нового ввода и 10K тарифицируемого вывода OpenAI Standard стоит $0.30; соответствующее расписание CometAPI — $0.24. Для 10,000 идентичных запросов итог по токенам составит $3,000 и $2,400. Это сравнение исключает инструменты, записи в кэш, повторы и надбавки.
GPT-6.1 Sol позиционируется для сложного программирования, компьютерного использования и профессиональных рабочих процессов. Ее окно контекста 1,050,000 токенов и максимум вывода 128,000 токенов — это ограничения по емкости, а не гарантия тарифа короткого контекста: запросы свыше 272K токенов ввода используют более высокие ставки. Модель принимает текст и изображения и генерирует текст; для вызова инструментов используйте Responses API, а Chat Completions поддерживает запросы без инструментов. Отдельно проверяйте поддержку инструментов и уровней обработки у выбранного шлюза при выборе маршрута.
Additional GPT-6.1 Sol Agent Expenses
Бюджет агента также включает хостинг инструментов, среды выполнения, хранилище и внешние сервисные сборы. OpenAI указывает стоимость веб-поиска $10 за 1,000 вызовов. Полученный поиском контент тарифицируется по ставкам модели. Вызовы file-search стоят $2.50 за 1,000; хранение — $0.10 за ГБ в день после бесплатного лимита 1 ГБ.
Hosted Shell и Code Interpreter имеют отдельные тарифы на контейнеры по той же схеме OpenAI, указанной выше. Опубликованная ставка за 1 ГБ — $0.03 за 20-минутную сессию на контейнер; для подходящих сессий действует поминутная тарификация с минимальными пятью минутами. Используйте фактические условия инструментов и выполнения выбранного шлюза, а не предполагайте, что эти прямые тарифы применяются без изменений.
Reasoning Effort and Total GPT-6.1 Sol Spend
Интенсивность рассуждений не выделена отдельной строкой в таблице ставок, но может влиять на тарифицируемый вывод, использование инструментов, длину траектории и количество повторов. Сравнивайте поддерживаемые уровни усилий от low до max на одном наборе задач. Фиксируйте фактическое потребление, а не оценивайте стоимость рассуждений только по видимой длине ответа.
How Does the 272K Threshold Change GPT-6.1 Sol Cost?
Когда ввод превышает 272K токенов, OpenAI применяет ставки длинного контекста ко всему запросу: стоимость ввода и кэша удваивается, а вывод увеличивается на 50%. Порог по вводу применяется даже тогда, когда значительная часть ввода подана из кэша.
| Workload | Fresh input | Billed output | OpenAI Standard | CometAPI catalog |
|---|---|---|---|---|
| Small analysis | 20K | 2K | $0.06 | $0.048 |
| Document review | 100K | 10K | $0.30 | $0.24 |
| Below threshold | 270K | 10K | $0.64 | $0.512 |
| Above threshold | 280K | 10K | $1.27 | $1.016 |
| Repository analysis | 300K | 20K | $1.50 | $1.20 |
270K input: 0.27 x $2 + 0.01 x $10 = $0.64
280K input: 0.28 x $4 + 0.01 x $15 = $1.27
Input grows about 3.7%; token cost grows about 98.4%.
Это независимые запросы без кэша, инструментов, повторов и дополнительных надбавок. Эффект порога — причина, по которой выбор диапазона контекста важен даже тогда, когда модель вмещает весь репозиторий.
How Does Prompt Caching Change GPT-6.1 Sol Input Costs?
Чтения из кэша в коротком контексте Standard стоят $0.10/M против $2/M для нового ввода. Успешное чтение, таким образом, на 95% дешевле для этой категории токенов. Запись в кэш стоит $2.50/M. Экономия зависит от успешного повторного использования кэшированного префикса, а не просто от повторения похожего текста.
Рассмотрим десять запросов, разделяющих один префикс длиной 100K токенов. Каждый остается в диапазоне короткого контекста. В контролируемом сценарии кэширования префикс записывается целиком один раз и успешно читается девять раз без дополнительных записей. Префикс в первом запросе тарифицируется только по ставке записи в кэш; те же токены не тарифицируются одновременно как новый ввод.
| Repeated-prefix cost | No cache | One write + nine reads |
|---|---|---|
| Fresh prefix input | 10 x 0.1 x $2 = $2.00 | $0.00 |
| Cache write | $0.00 | 0.1 x $2.50 = $0.25 |
| Cache reads | $0.00 | 9 x 0.1 x $0.10 = $0.09 |
| Prefix subtotal | $2.00 | $0.34 |
Снижение на $1.66 — это 83% стоимости повторяющегося префикса. Это не означает 83% сокращения типового счета API. Если каждый запрос также генерирует 2K тарифицируемых токенов вывода, вывод добавит $0.20 по десяти запросам: итоги составят $2.20 и $0.54, снижение примерно на 75.5%. Новый ввод, промахи, дополнительные записи, инструменты и диапазоны длинного контекста меняют результат.
При этих упрощенных предположениях короткого контекста «одна запись плюс N-1 чтений» стоит 0.25 + 0.01(N-1) доллара для префикса 100K, против 0.20N без кэширования. Двух запросов достаточно, чтобы кэшированный сценарий оказался дешевле при условии, что второй запрос действительно попадает в кэш, и другие затраты не меняются.
How Does GPT-6.1 Sol Pricing Compare with GPT-6 Sol and GPT-6 Astra?
OpenAI документирует спецификации GPT-6 Sol. Снижение стоимости чтений из кэша — это сравнение ставок, а не доказательство меньшей совокупной стоимости задачи.
| Official Standard short-context comparison | GPT-6.1 Sol | GPT-6 Sol | GPT-6 Astra |
|---|---|---|---|
| Fresh input / 1M tokens | $2.00 | $2.00 | $10.00 |
| Cache read / 1M tokens | $0.10 | $0.20 | $1.00 |
| Cache write / 1M tokens | $2.50 | $2.50 | $12.50 |
| Output / 1M tokens | $10.00 | $10.00 | $50.00 |
| Context window / maximum output | 1.05M / 128K | 1.05M / 128K | 1.05M / 128K |
GPT-6.1 Sol вдвое снижает стоимость чтений из кэша в коротком контексте. Ставки для нового ввода, записей и вывода не изменились. Максимальная выгода зависит от доли вашего счета, приходящейся на успешные чтения из кэша. При миграции заново протестируйте уровни усилий, циклы с инструментами и результаты задач.
В сравнении с GPT-6 Sol, GPT-6.1 Sol сохраняет те же ставки нового ввода, записи в кэш и вывода, одновременно сокращая стоимость чтений из кэша на 50%. В сравнении с GPT-6 Astra используйте приведенные ставки вместе с измеренным качеством задач и общей стоимостью траектории.
Расписание ставок GPT-6 Astra помещает Astra в более высокий ценовой диапазон токенов.
GPT-6.1 Sol на 80% дешевле по новому вводу, записям в кэш и выводу, и на 90% дешевле по чтениям из кэша в этом диапазоне. Эти соотношения не доказывают эквивалентного качества. Astra может оправдывать премию, если лучшие принятые результаты компенсируют дополнительные траты; GPT-6.1 Sol предпочтительнее, когда достигает той же цели принятия по более низкой цене.
Сравнивайте патчи репозиториев, анализ документов и задачи компьютерного использования отдельно. Удерживайте неизменными подсказки, разрешения инструментов, уровни усилий, лимиты повторов и проверки принятия. Учитывайте нерешенные провалы наряду с успешными результатами; не выводите универсальные рейтинги программирования или исследований только из цен на токены.
What Does GPT-6.1 Sol Cost for Real API Workloads?
Рассчитывайте стоимость на запрос с его фактическим диапазоном и режимом обработки, затем суммируйте результаты. Новый ввод исключает кэшированные чтения; не тарифицируйте одни и те же токены ввода одновременно как новый ввод и как кэш. Используйте записи провайдера для различения записей в кэш от прочего ввода. В формуле ниже fresh_input исключает и cache_reads, и cache_writes. Токены, тарифицируемые по ставке записи в кэш, не должны одновременно учитываться как новый ввод. Рассматривайте все три величины как взаимно исключающие категории биллинга и сводите их с записями потребления провайдера.
request_token_cost =
fresh_input / 1_000_000 * fresh_rate
+ cache_reads / 1_000_000 * read_rate
+ cache_writes / 1_000_000 * write_rate
+ billed_output / 1_000_000 * output_rate
period_total = sum(request_token_cost) + other_charges
Aggregate Usage Across Multiple Short Requests
Десять запросов, каждый с 100K нового ввода и 20K тарифицируемого вывода, в сумме дают 1M ввода и 200K вывода. Каждый отдельный запрос остается ниже 272K ввода и ниже лимита вывода 128K. Итого по OpenAI Standard — $4.00; по CometAPI — $3.20. Разница в 20% применяется только к этим моделированным категориям токенов. Это не один запрос с 1M ввода и 200K вывода.
A Cache-Heavy Period With Separately Billed Writes
Предположим, за период зафиксировано 1M нового ввода, 5M чтений из кэша, 500K тарифицируемого вывода и 500K записей в кэш. Все составляющие запросы остаются в коротком контексте Standard. Стоимость в OpenAI: $2.00 + $0.50 + $5.00 + $1.25 = $8.75. В CometAPI: $1.60 + $0.40 + $4.00 + $1.00 = $7.00. Эти категории — отдельные биллинговые величины; пример не предполагает, что весь повторяющийся ввод — это попадание в кэш.
One Long-Context Request
Запрос с 400K нового ввода и 100K тарифицируемого вывода использует ставки длинного контекста. Стоимость OpenAI Standard: 0.4 x $4 + 0.1 x $15 = $3.10. В CometAPI: 0.4 x $3.20 + 0.1 x $12 = $2.48. Обе оценки исключают новые записи в кэш и нетокенные сборы. Количество 100K вывода включает рассуждения и должно укладываться в бюджет вывода модели.
How Do Standard, Batch, Flex, Fast, and Ultrafast Change GPT-6.1 Sol Cost?
Для запроса с 300K нового ввода и 20K тарифицируемого вывода используйте диапазон длинного контекста.
| OpenAI mode | Input cost | Output cost | Token subtotal |
|---|---|---|---|
| Batch/Flex | $0.60 | $0.15 | $0.75 |
| Standard | $1.20 | $0.30 | $1.50 |
| Fast | $2.40 | $0.60 | $3.00 |
| Ultrafast | $7.20 | $1.80 | $9.00 |
Расчет для Ultrafast: 0.30M нового ввода x $24/M + 0.02M тарифицируемого вывода x $90/M = $7.20 + $1.80 = $9.00. Это использует диапазон длинного контекста и исключает кэш, инструменты и региональные надбавки.
Batch подходит для офлайн-оценок, обогащения, бэкфиллов и пакетной обработки документов. Flex предлагает более низкие ставки для подходящих рабочих нагрузок, терпящих переменную обработку и доступность. Standard — базовый вариант для интерактивных запросов. Fast удваивает применимые ставки токенов; выбирайте его, когда снижение ожидания имеет измеримую ценность.
Ultrafast приоритизирует низкую латентность по более высокой цене токенов. Для GPT-6.1 Sol установите service_tier в значение ultrafast в запросах Responses. OpenAI рекомендует WebSockets для быстрых циклов инструментов; перед маршрутизацией продакшен-трафика проверьте лимиты, специфичные для уровня, и поддержку шлюза. Ставки взяты из официальной таблицы цен OpenAI.
Эти ставки не доказывают, что каждый уровень включен для вашего аккаунта шлюза. Подтверждайте поддерживаемую маршрутизацию и региональные ограничения перед внедрением. Не закладывайте в бюджет необъявленную или недоступную опцию обработки, как будто она уже имеет ставку Standard.
Why Is Cost per Successful GPT-6.1 Sol Task the Better Metric?
Делите общие измеренные расходы модели, инструментов и выполнения по набору оценок на количество принятых результатов. Включайте неуспешные попытки в числитель. Отдельно указывайте время человеческой правки и нерешенные провалы, чтобы стоимость не «улучшалась» лишь за счет отказа от более сложных задач.
observed_cost_per_accepted_task =
all_evaluation_model_tool_execution_cost / accepted_tasks
Для иллюстрации: попытка за $0.40 с вероятностью успеха 60% имеет ожидаемую стоимость $0.40 / 0.60 ≈ $0.67 до достижения успеха. Попытка за $0.55 с вероятностью 85% — около $0.65 при той же модели. Это гипотетические цифры, а не результаты бенчмарков или утверждения о конкретной модели.
Эта оценка предполагает независимые повторы с неизменными стоимостью и вероятностью успеха, продолжающиеся до успеха. Не добавляйте второй лимит повторов: деление уже учитывает повторы. Коррелированные сбои, ограниченные повторы, разная сложность задач, инструменты и участие человека могут сделать эту модель неприменимой. Используйте наблюдаемую стоимость принятой задачи для производственных решений.
How Can You Reduce GPT-6.1 Sol API Costs?
Максимизируйте повторно используемые префиксы подсказок. Помещайте стабильные системные инструкции, определения инструментов, схемы и фоновый контекст в повторно используемые префиксы. Цена $0.10/M на кэшированный ввод в GPT-6.1 Sol делает повторяющийся контекст значительно дешевле по сравнению с новым вводом.
Держите запросы ниже 272K, когда полный контекст не обязателен. Превышение 272K токенов ввода меняет ставки для всего запроса. Поиск, сжатие контекста и выборочная загрузка файлов могут снизить стоимость даже тогда, когда модель технически поддерживает окно контекста 1.05M.
Используйте Batch для асинхронных пакетных рабочих процессов. Офлайн-оценки, обогащение, бэкфиллы и пакетная обработка документов могут использовать Batch, когда не требуется немедленный возврат результатов.
Используйте Flex для низкоприоритетных запросов, терпящих задержки и эпизодическую недоступность ресурсов. Планируйте задержки и повторы; проверяйте подходящие рабочие нагрузки и поддержку маршрутов. Batch и Flex используют более низкие ставки, показанные выше, но обслуживают разные потребности обработки.
Измеряйте стоимость принятой задачи. Логируйте токены нового ввода, кэшированного ввода, записи в кэш, токены вывода, режим обработки, затраты на инструменты, повторы и успех задачи. Затем вычисляйте реальную стоимость успешного завершения.
Маршрутизируйте простые задачи на более дешевые модели. Не каждому запросу требуется уровень рассуждений Sol. Классификация, маршрутизация, простое извлечение и другие высокопроверяемые задачи могут подходить более дешевой модели, в то время как GPT-6.1 Sol обрабатывает задачи, где более сильные рассуждения существенно повышают завершение.
Это особенно важно для агентов, поскольку неудачный запуск за $0.50 с последующими двумя повторами может оказаться дороже, чем один успешный запуск за $1.00.
Используйте явные лимиты завершения, лимиты циклов инструментов и бюджеты повторов. Анализируйте записи использования по новому вводу, чтениям и записям в кэш, токенам рассуждений, уровню, диапазону контекста и затратам на инструменты. Сравнивайте экономию с качеством принятых задач после каждого изменения.
Conclusion
GPT-6.1 Sol привлекателен, когда рабочему процессу нужны сложные рассуждения по ставкам уровня Sol и возможна повторная эксплуатация стабильного контекста. Он сохраняет заглавные ставки Standard GPT-6 Sol в $2/$10, снижая чтения из кэша в коротком контексте до $0.10/M. У Astra выше ставки токенов, но выбор должен опираться на качество нагрузки и стоимость принятой задачи.
Начинайте с оценок по запросам, отделяйте записи в кэш от чтений и следите за границей 272K. Затем измеряйте полную траекторию агента и выбирайте уровень обработки, соответствующий латентности и доступности. CometAPI предоставляет отдельную ценовую сетку; подтверждайте фактические условия аккаунта и инструментов перед масштабированием.
FAQ
How Should GPT-6.1 Sol Budgets Handle Failed or Cancelled Requests?
Отслеживайте у провайдера использование по завершенным, незавершенным, неуспешным и отмененным запросам отдельно. Не предполагайте, что каждый неуспешный запрос бесплатен или что отмена на стороне клиента предотвращает работу на стороне сервера. Сверяйте идентификаторы запросов и учет использования с биллингом, затем включайте тарифицируемую неуспешную работу в расчет стоимости принятой задачи. Подтверждайте правила списаний и возвратов конкретного провайдера, а не выводите их из HTTP-статуса.
How Should Teams Forecast GPT-6.1 Sol Costs for Variable Traffic?
Сегментируйте трафик по диапазону ввода, уровню обработки, составу кэша и типу работы. Используйте измеренные распределения токенов и завершений, а не одну среднюю подсказку. Постройте базовый прогноз и сценарии для более низких попаданий в кэш, большего числа повторов и более длинных выводов; также мониторьте долю, пересекающую 272K. Обновляйте прогноз по мере изменения микса задач.
How Can Teams Reconcile GPT-6.1 Sol Forecasts With Invoices?
Выберите завершенный биллинговый период и сгруппируйте запросы по маршруту, уровню обработки и диапазону ввода. Сверьте записанное использование с категориями счета и кредитами, включая корректировки, затраты на инструменты и любые применимые налоги или конвертацию валюты. Разбирайте расхождения по идентификаторам запросов и временным меткам биллинга, а не применяйте необъяснимые корректирующие коэффициенты. Подтверждайте задержки отчетности и правила округления провайдера перед изменением прогноза.
