Кратко Qwen3.8 Max Preview доступен для раннего тестирования через экосистему Alibaba Token Plan и поддерживаемые продукты Qoder, но стандартные тарифы API модели Model Studio по схеме pay‑as‑you‑go еще не опубликованы. Для продакшн‑нагрузок Qwen3.7 Max остается более безопасной базовой опцией, тогда как Qwen3.8 лучше подходит для контролируемой оценки.
Qwen3.8 Max Preview — последний флагманский превью‑релиз поколения Qwen3.8 от Alibaba. Разработчики уже могут тестировать его через поддерживаемые продукты, такие как Qwen Code и Qoder, тогда как ключевые продакшн‑детали — включая стандартные цены API, лимиты скорости, региональную доступность и стабильное версионирование — пока не завершены.
Для команд, уже использующих Qwen3.7 Max, ключевые вопросы просты: Готов ли API Qwen3.8 Max к продакшн‑использованию, сколько он стоит и стоит ли мигрировать?
Это руководство сфокусировано на этих решениях, включая текущие способы доступа, цены Credit в Qoder, подтвержденные спецификации и то, как оценивать Qwen3.8 Max Preview по сравнению с Qwen3.7 Max.
Официальный тизер Qwen по Qwen3.8 подчеркивает количество параметров 2,4T и планируемый релиз с открытыми весами. Хостинговая модель qwen3.8-max-preview уже доступна в отдельных продуктах, тогда как более широкий релиз с открытыми весами еще впереди.
Источник*:* Qwen в X
Цены API Qwen3.8 Max
По состоянию на 20 июля 2026 г. Alibaba не опубликовала стандартную цену за миллион входных или выходных токенов для Qwen3.8 Max.
Следовательно, разработчикам не следует предполагать, что Qwen3.8 унаследует цены Qwen3.7 Max, что Credits в Qoder равны прямой стоимости API‑токенов, или что идентификатор модели qwen3.8-max-preview останется неизменным после общего релиза.
Краткий обзор Qwen3.8 Max Preview
| Пункт | Статус на 20 июля 2026 г. |
|---|---|
| Model ID | qwen3.8-max-preview |
| Этап релиза | Preview |
| Заявленное общее число параметров | 2,4 трлн |
| Текущий доступ | Экосистема Alibaba Token Plan и поддерживаемые продукты Qoder |
| Стандартные цены Model Studio | Еще не опубликованы |
| Стандартная ставка Credits в Qoder | 0.5x |
| Промо‑ставка в Qoder | 0.05x в обычные часы; 0.01x в непиковые |
| Контекстное окно | 1 000 000 токенов по метаданным интеграции Qwen Code |
| Thinking mode | Включен в метаданных интеграции Qwen Code |
| Ввод изображений и видео | Включен в метаданных интеграции Qwen Code |
| Открытые веса | Объявлены как «скоро» |
| Оптимальное применение сегодня | Контролируемая оценка |
Ключевое различие — между Qwen3.8, недавно анонсированным поколением модели, и qwen3.8-max-preview, превью‑маршрутом, который сейчас появляется в поддерживаемых продуктах.
Официальный анонс Qwen описывает Qwen3.8 как модель с 2,4 трлн параметров и заявленным планом релиза открытых весов. Qwen Code отдельно добавил qwen3.8-max-preview в свою интеграцию Token Plan.
Что подтверждено о Qwen3.8 Max Preview?
Поскольку Qwen3.8 все еще находится в статусе превью, полезно отделять официальные анонсы от метаданных интеграций.
| Утверждение | Уровень доказательности | Текущий статус |
|---|---|---|
| 2,4T общее число параметров | Официальный анонс | Сообщено командой Qwen |
| Идентификатор модели qwen3.8-max-preview | Официальная интеграция | Добавлен в Qwen Code Token Plan |
| Контекст на 1 000 000 токенов | Метаданные интеграции | Сконфигурировано в Qwen Code |
| Thinking mode | Метаданные интеграции | Включен в Qwen Code |
| Ввод изображений и видео | Метаданные интеграции | Включен в Qwen Code |
| Релиз открытых весов | Официальное намерение | Объявлен как «скоро» |
| Стандартное ценообразование API по токенам | Неизвестно | Пока не опубликовано |
| Архитектура и активные параметры | Неизвестно | Пока не задокументировано |
| Консенсус независимых бенчмарков | Ограничен | Слишком рано для устойчивого вывода |
Конфигурация Qwen Code дает полезные подтверждения для контекстного окна 1M, Thinking mode и поддержки мультимодального ввода. Однако это остаются спецификации уровня интеграции до тех пор, пока Alibaba не опубликует полноценную карточку модели в Model Studio.
Что означает здесь "Thinking mode"? Qwen Code включает поведение thinking для
qwen3.8-max-preview. В более широкой экосистеме API модели с такой способностью часто описывают как reasoning models, где перед генерацией финального ответа может использоваться дополнительное вычисление. Окончательные правила учета и ценообразования для reasoning‑ или thinking‑токенов еще не задокументированы для стандартного API Qwen3.8 Max.
Как получить доступ к Qwen3.8 Max Preview
Подтвержденные пути доступа в настоящее время включают:
- Экосистему Alibaba Token Plan
- Qwen Code
- Qoder Desktop
- Плагин Qoder для JetBrains
- Qoder CLI
- Qoder Cloud Agents
- Веб‑ и мобильные продукты Qoder
Официальный репозиторий Qwen Code включает qwen3.8-max-preview в свою интеграцию Token Plan, в то время как документация запуска Qoder перечисляет модель среди поддерживаемых продуктов Qoder.
Разработчикам, строящим прямые API‑интеграции, следует подтвердить точный идентификатор модели, совместимость эндпоинтов, региональную доступность, лимиты скорости, ограничения по контексту и правила биллинга перед использованием превью в продакшн‑системах.
Цены Qoder на Qwen3.8: что означают 0.05x и 0.01x?
Qoder в настоящее время предлагает промо‑скидку для Qwen3.8 Max Preview.
| Период | Ставка Credits Qwen3.8 Max Preview | Скидка относительно стандартной 0.5x |
|---|---|---|
| Обычные часы | 0.05x | 90% off |
| Непиковые часы | 0.01x | 98% off |
Промо началось 19 июля 2026 г., дата окончания пока указана как TBD.
Qoder определяет непиковый период как 22:00–08:00 Singapore Time (UTC+8). Во время летнего времени в США в июле 2026 это примерно соответствует:
- 10:00–20:00 EDT
- 7:00–17:00 PDT
Qoder Credits — это не цены API по токенам
Qoder Credits — это ресурсная единица на уровне продукта. Потребление может меняться в зависимости от модели, использования токенов и числа вызовов, инициируемых агентными или субагентными рабочими процессами.
Этот расчет корректен:
discounted workflow credits =
base workflow credits × applicable Qoder multiplier
Но этот — нет:
Qwen3.8 API token price =
0.05 × an assumed price per million tokens
Для команд, оценивающих модель через Qoder, более полезная метрика:
credits per successful task =
total Credits consumed / successful tasks
Она отражает фактическую стоимость завершения рабочего процесса, не переводя неверно Credits в цены API по токенам.
Qwen3.8 Max Preview vs Qwen3.7 Max
Для разработчиков, уже использующих Qwen3.7 Max, практический вопрос — готово ли превью к замене.
| Измерение | Qwen3.7 Max | Qwen3.8 Max Preview |
|---|---|---|
| Статус релиза | Утвержденная продакшн‑модель | Preview |
| Стандартные pay‑as‑you‑go цены | Опубликованы | Еще не опубликованы |
| Региональное развертывание | Задокументировано | Пока не полностью описано |
| Версионированные model ID | Доступны | Для GA пока не задокументированы |
| Кэширование контекста | Задокументировано | Продакшн‑правила в ожидании |
| Пакетная обработка | Доступна на поддерживаемых маршрутах | Пока не задокументирована |
| Модель затрат | Предсказуемая | Ограниченная |
| Лучшее применение сегодня | Продакшн | Оценка |
Alibaba Cloud документирует цены Qwen3.7 Max для разных сценариев развертывания. Цены и акции могут различаться по регионам, поэтому разработчикам следует проверить официальную страницу цен Model Studio.
Для команд, использующих CometAPI, Qwen3.7 Max API обеспечивает практическую продакшн‑базу для оценки будущих нагрузок Qwen3.8.
Для более легких или чувствительных к стоимости сценариев Qwen3.7 Plus предоставляет еще одну точку сравнения.
Стоит ли пользователям Qwen3.7 Max обновляться до Qwen3.8 сейчас?
Практичный подход:
Тестируйте Qwen3.8 Max Preview уже сейчас, но мигрируйте лишь тогда, когда его прирост качества оправдывает операционные и стоимостные компромиссы.
Тестируйте Qwen3.8 Max Preview, если:
- Ваши нагрузки включают сложные задачи кодинга или агенты.
- Вы оцениваете сценарии с интенсивным рассуждением.
- Вам нужны длинный контекст или мультимодальные возможности.
- Вы можете терпимо относиться к изменениям поведения на стадии превью.
- У вас есть автотесты или рубрики ручной проверки.
Оставляйте Qwen3.7 Max в продакшне, если:
- Вам нужны предсказуемые расходы по токенам.
- Важна региональная доступность.
- Требуются стабильные model ID и версионирование.
- Ваша архитектура зависит от задокументированного кэширования или пакетной обработки.
- Текущая производительность Qwen3.7 Max уже удовлетворяет требованиям.
Заявленное число параметров 2,4T само по себе не должно определять миграцию.
Для продакшн‑систем ИИ обычно полезнее, чем общее число параметров: доля решенных задач, задержка, повторы, время человеческой коррекции и стоимость на успешную задачу.
Как оценивать Qwen3.8 Max Preview
Вместо того, чтобы полагаться на заявления при запуске или единственный бенчмарк, соберите небольшой набор оценочных заданий на основе ваших реальных нагрузок.
Практичная стартовая точка — 20–30 репрезентативных задач.
| Нагрузка | Примеры задач | Что измерять |
|---|---|---|
| Репозиторный кодинг | Многофайловые правки, рефакторинг, тесты | Долю успешных, повторы, вызовы тулов |
| Фуллстек‑разработка | Реализация фич | Качество завершения, время правок |
| Аналитика данных | CSV, таблицы, скрипты | Точность, рассуждение, качество артефактов |
| Офисные процессы | Документы и таблицы | Полнота, правки человеком |
| Длинный контекст | Крупные репозитории или документы | Реколл, согласованность |
| Задачи рассуждения | Многошаговые технические задачи | Точность, задержка |
| Рутинный кодинг | Простые правки | Добавляет ли ценность более крупная модель |
Для каждой задачи фиксируйте:
- Успех или провал
- Модель и вызовы инструментов
- Повторы
- Сквозную задержку
- Входные и выходные токены
- Токены рассуждения, где доступны
- Потребленные Qoder Credits
- Время человеческой коррекции
Для Qwen3.7 Max:
cost per successful task =
total API cost / successful tasks
Для Qwen3.8 Max Preview через Qoder:
credits per successful task =
total Credits consumed / successful tasks
Когда станут доступны стандартные цены API Qwen3.8, перезапустите ту же оценку и сравните:
качество × задержка × надежность × стоимость
Это даст более полезный сигнал к миграции, чем одни лишь бенчмарки.
Что разработчикам стоит отслеживать дальше
Самые важные обновления Qwen3.8:
- Официальная карточка модели в Model Studio.
- Цены на входные, выходные, кэшируемые входные и токены рассуждения.
- Региональная доступность API и лимиты скорости.
- Стабильные model ID и версионирование.
- Поддержка Context Cache и Batch.
- Репозиторий открытых весов и лицензия.
- Подробности по архитектуре и активным параметрам.
- Независимые бенчмарки по кодингу, агентам, мультимодальности, задержке и эффективности.
FAQ
Доступен ли API Qwen3.8 Max?
Qwen3.8 Max Preview доступен через экосистему Alibaba Token Plan и поддерживаемые продукты Qoder. Полноценное предложение API Model Studio уровня GA пока публично не задокументировано.
Сколько стоит API Qwen3.8 Max?
Стандартные цены за миллион токенов еще не опубликованы. Qoder в настоящее время предлагает промо‑ставки Credits 0.05x и 0.01x, но это именно Credits Qoder, а не общие API‑цены по токенам.
Есть ли у Qwen3.8 Max Preview контекстное окно на 1M?
Метаданные интеграции Token Plan в Qwen Code конфигурируют контекстное окно на 1 000 000 токенов для qwen3.8-max-preview. Конкретные производственные лимиты по эндпоинтам нужно будет подтвердить, когда Alibaba опубликует финальную документацию.
Могу ли я использовать Qwen3.8 Max через API, совместимый с OpenAI?
Широко задокументированный продакшн‑эндпоинт Qwen3.8 Max с финальным контрактом OpenAI‑совместимого API пока не опубликован. Разработчикам следует проверить точный превью‑эндпоинт и поддерживаемые параметры перед интеграцией.
Следует ли заменить Qwen3.7 Max на Qwen3.8 Max Preview?
Для большинства продакшн‑систем — пока нет. Используйте Qwen3.7 Max как стабильную базу и оценивайте Qwen3.8 Max Preview, пока его цены и продакшн‑поведение не будут лучше задокументированы.
Подготовьтесь к Qwen3.8 на CometAPI
Поддержка Qwen3.8 Max скоро появится в CometAPI. Когда она станет доступна, команды смогут тестировать модель через унифицированный API‑процесс CometAPI и напрямую сравнивать ее с существующими продакшн‑моделями.
В ожидании **Kimi K3 **может служить практичной альтернативой для продвинутого кодинга, рассуждений и агентных рабочих процессов. Команды могут начать строить базовую линию оценки с Kimi K3 уже сегодня, а затем перезапустить те же задачи на Qwen3.8 Max, когда он станет доступен.
Для команд, уже использующих семейство Qwen, Qwen3.7 Max API остается полезной точкой отсчета для измерения улучшений качества, задержки и стоимости между поколениями моделей.
Также вы можете просмотреть CometAPI Model Catalog для актуальной доступности моделей.
