TL;DR Qwen 3.8 Max QwenCloud-те кіріс үшін 1 млн токенге $2 және шығыс үшін 1 млн токенге $6 тұрады. Модельге тән кэш тарифтері: имплицитті кэштелген кіріс үшін $0.25/М, эксплицитті кэш құру үшін $2.50/М, және эксплицитті кэш оқу үшін $0.17/М.
Бірдей стандартты токен бағалары модель қолдайтын 1 млн токендік контекст терезесіне тең қолданылады. Үлкен промпттар қымбат тұрады, себебі оларда токен көп, ұзын контекст үшін бөлек жоғары баға деңгейіне өткені үшін емес.
Тізімдік бағамен Qwen 3.8 Max Qwen 3.7 Max-тан 20% арзан. Алайда, Qwen 3.7 Max қазіргі 50% акциясы белсенді тұрғанда арзанырақ. Ең жақсы өндірістік таңдау қабылданған тапсырмаға шаққандағы құнға байланысты, оған пайымдау, кэш-хиттер, құралдар, ретрайлар, кідіріс және адамдық тексеріс кіреді.
Qwen 3.8 Max API бағасы: қысқаша
| Элемент | Ағымдағы ресми мән |
|---|---|
| Өндірістік модель ID | qwen3.8-max |
| Ресми шығу күні | August 3, 2026 |
| Архитектура | 2.4T жалпы параметр; 95B белсенді параметр |
| Стандартты кіріс бағасы | $2 / 1M токен |
| Стандартты шығыс бағасы | $6 / 1M токен |
| Имплицитті кэш-хит | $0.25 / 1M токен |
| Эксплицитті кэш құру | $2.50 / 1M токен |
| Эксплицитті кэш оқу | $0.17 / 1M токен |
| Контекст терезесі | 1M токен |
| Ең жоғарғы кіріс | 991K пайымдаусыз; 983K пайымдаумен |
| Ең жоғарғы шығыс | 131K |
| Ең жоғарғы пайымдау | 262K |
| Кіріс модальділері | Мәтін, сурет және видео |
| Шығыс модальдігі | Мәтін |
| QwenCloud анықтамалық лимиттері | 2M TPM және 15K RPM |
QwenCloud модель беті — ағымдағы модель ID-і, баға, кэш тарифтері, контекст шектері және модальділердің ең тікелей дереккөзі. Аккаунт және өңірге тән квоталар әртүрлі болуы мүмкін, сондықтан өндірістегі бір уақытта орындалу санын баптағанда өз консоліңіздегі лимиттерді қолданыңыз.
Өндірістік релиз превью идентификаторын qwen3.8-max-қа алмастырады және толық модельге тән тариф картасын қосады. Qwen-нің таныстыру материалдары low, medium және xhigh пайымдау-күші баптауларын сипаттайды, бірақ өндірістік мінез-құлықты сіз пайдаланатын эндпоинт пен API анықтамасына қарсы тексеру қажет.
Уақытқа сезімтал ескерту: Qwen ашық салмақтар API релизінен кейін жарияланатынын хабарлады. August 4, 2026 жағдайы бойынша ресми чекпойнт пен лицензия шықпайынша Qwen 3.8 Max-ты жүктеп алуға болады немесе өзіңізде хосттай аласыз деп сипаттамаңыз.
Qwen 3.8 Max баға белгілеуі қалай жұмыс істейді
QwenCloud қазіргі уақытта Qwen 3.8 Max-тың 1 млн токендік контекст терезесі шегінде 1 млн кіріс токенге $2 және 1 млн шығыс токенге $6 тұрақты стандарттық тарифін көрсетеді. Төмендегі ресми баға сәттік көрінісі August 4, 2026 күні алынған; өндірістік бюджет шешімдерінен бұрын әрқашан тірі модель бетін тексеріңіз.

Дереккөз***:*** QwenCloud, “Qwen3.8-Max” official
| Төлем элементі | Баға (1M токенге) | Қашан қолданылады |
|---|---|---|
| Стандартты кіріс | $2.00 | Жаңа промпт мазмұны, құрал анықтамалары және кэшке түспеген контекст |
| Стандартты шығыс | $6.00 | Жасалған шығыс және есепке алынатын пайымдау қолданылуы |
| Имплицитті кэш-хит | $0.25 | Автоматты қайта пайдаланылған промпт префикстері; хит кепілдендірілмейді |
| Эксплицитті кэш құру | $2.50 | Белгіленген қайта пайдаланылатын промпт префиксін жасау |
| Эксплицитті кэш оқу | $0.17 | Жарамды эксплицитті кэш блогын қайта пайдалану |
Сондықтан 900K-токендік сұраным 100K-токендік сұранымнан қымбат тұрады, себебі ол тоғыз есе көп кіріс токенді өңдейді — жоғары баға деңгейіне өткендіктен емес.
Пайымдау шығыс құнын арттыра алады
Қысқа көрінетін жауап әрқашан төмен құнды жауап емес. Пайымдау қосылған шақырулар қосымша пайымдау токендерін жасай алады, сондықтан өндірістік бағалаулар көрінетін жауап ұзындығына емес, API қайтарған қолданылу өрістеріне сүйенуі керек.
Эндпоинтіңіз qwen3.8-max үшін пайымдауды басқаруды қолдаса, сол бірдей бағалау жиынтығында қолжетімді баптауларды салыстырыңыз. Превьюның әдепкілері GA модельге сол күйі көшеді деп болжамаңыз.
Кэштен үнем промпт тұрақтылығына байланысты
Qwen 3.8 Max модель беті модельге тән кэш тарифтерін жариялайды. Шығынды бағалағанда жалпы кэш қатынастарын емес, сол тарифтерді қолданыңыз.
Эксплицитті кэш жазбаларының жарамдылық мерзімі бес минут, және сәтті хит осы мерзімді қайта бастайды. Имплицитті кэшттеу автоматты, бірақ хит кепілдендірілмейді. Кэшттеу жүйелік промпттар, құрал анықтамалары, репозиторий контексті немесе үлкен құжаттар жиі қоңыраулар арасында тұрақты болғанда ең пайдалы.
Құрамдастырылған құралдар бөлек төлемдер туғызады
QwenCloud токен қолданылуына қосымша мына құрал төлемдерін көрсетеді:
| Құрамдастырылған құрал | Ағымдағы төлем |
|---|---|
| Web Search | $10 / 1K қоңырау |
| Image Search | $8 / 1K қоңырау |
| Web Extractor | Белгілі бір уақытқа тегін |
| Code Interpreter | Белгілі бір уақытқа тегін |
Function calling және MCP үшін бөлек құрал төлемдері жоқ, бірақ құрал сипаттамалары да кіріс токендері болып саналады. Тегін құрал промоакциялары өзгеруі мүмкін, сондықтан өндірістік бюджетті бекітуден бұрын QwenCloud баға нұсқаулығын тексеріңіз.
Мысалы, 20K кіріс токені, 2K шығыс токені және екі Web Search қоңырауы бар сұраным шамамен мынадай тұрады:
Input: 20,000 / 1,000,000 × $2 = $0.040
Output: 2,000 / 1,000,000 × $6 = $0.012
Web Search: 2 / 1,000 × $10 = $0.020
Total: $0.072
Бұл мысалда екі іздеу қоңырауы жалпы сұраным құнының шамамен 27.8% құрайды.
Qwen 3.8 Max нақты шығын мысалдары
Бұл мысалдар QwenCloud-тың модельге тән ағымдағы тарифтерін пайдаланады. Оларға салықтар, ретрайлар, фолбэктер және провайдердің үстеме бағасы кірмейді.
Мысал 1: Орташа агент сұранымы
Assume 50K input tokens and 5K output tokens:
Input: 50,000 / 1,000,000 × $2 = $0.10
Output: 5,000 / 1,000,000 × $6 = $0.03
Total: $0.13
Сәтті бірінші талпыныс шамамен $0.13 тұрады. Бір толық ретрай модель құнын шамамен $0.26-ға көтереді.
Мысал 2: Ұзақ құжатты талдау
Assume 800K input tokens and 20K output tokens:
Input: 800,000 / 1,000,000 × $2 = $1.60
Output: 20,000 / 1,000,000 × $6 = $0.12
Total: $1.72
Модель қазіргі тариф картасында бөлек ұзын контекст үстеме бағасын қолданбайды, бірақ үлкен промпттар абсолюттік шығынды айтарлықтай арттырады.
Мысал 3: Кэштелген агент сессиясы
Қайта пайдаланылатын 100K-токен префиксі, 10K жаңа кіріс токені, 5K шығыс токені және эксплицитті кэш жарамды болған уақытта 50 қоңырау деп алайық:
First call:
100K cache creation × $2.50/M = $0.250
10K new input × $2/M = $0.020
5K output × $6/M = $0.030
First-call total = $0.300
Each of the next 49 calls:
100K cache read × $0.17/M = $0.017
10K new input × $2/M = $0.020
5K output × $6/M = $0.030
Per-call total = $0.067
Cached session total = $3.583
Same 50 calls without cache = $12.500
Болжалды үнем = $8.917, немесе 71.3%
Болжалды үнем сәтті кэш-хиттерге және префикс тұрақтылығына байланысты. Ұзақ үзілістер немесе жүйелік промпттар мен құрал схемаларының жиі өзгеруі пайданы азайтады.
Qwen 3.8 Max vs Qwen 3.7 Max:Бақылау бағалары салыстыруы
Qwen 3.8 Max тізімдік бағамен Qwen 3.7 Max-тан 20% арзан, бірақ қазіргі 50% акциясы белсенді тұрғанда Qwen 3.7 Max 37.5% арзан.
| Модель және баға күйі | Кіріс / 1M | Шығыс / 1M | Контекст |
|---|---|---|---|
| qwen3.8-max стандартты баға | $2.00 | $6.00 | 1M |
| qwen3.7-max тізімдік баға | $2.50 | $7.50 | 1M |
| qwen3.7-max ағымдағы акция | $1.25 | $3.75 | 1M |
Жаңа модельді тестілеу кезінде балама ретінде CometAPI Qwen3.7 Max модель бетін қолда ұстаңыз.
Токен бағасы шешімнің бір бөлігі ғана. Егер Qwen 3.8 Max бірінші өтімдегі сәттілікті арттырса, құралдарды сенімдірек қолданса, ретрайларды азайтса немесе аз адамдық түзетуді қажет етсе, ол бәрібір үнемдірек болуы мүмкін.
Өндірістік метриканы пайдаланыңыз:
Қабылданған тапсырмаға шаққандағы шығын =
(модель токендері + құрал қоңыраулары + ретрайлар + фолбэк шығыны + тексеру құны)
÷ қабылданған шығыстар
Вендор хабарлаған бенчмарк өсімдері — күрделі кодтау және кәсіби жұмыс ағындарын қайта тестілеуге себеп, бірақ әр Qwen 3.7 жүктемесі көшуі керек деген дәлел емес.
Qwen 3.8 Max-қа қалай көшу керек
Модель жолын ауыстыру қажет, бірақ бұл толық өндірістік көшу емес.
1. Өндірістік модель ID-ін тестілеңіз
Тест ортасында превью идентификаторын qwen3.8-max-қа алмастырыңыз. Превью алиастары, әдепкілер, кідіріс немесе жауап мінез-құлқы өзгеріссіз қалады деп болжамаңыз.
Ең аз OpenAI-үйлесімді сұраным мынадай болуы мүмкін:
import os
from openai import OpenAI
client = OpenAI(
api_key=os.environ["DASHSCOPE_API_KEY"],
base_url="https://dashscope-intl.aliyuncs.com/compatible-mode/v1",
)
response = client.chat.completions.create(
model="qwen3.8-max",
messages=[
{
"role": "user",
"content": "Review this migration plan and identify production risks.",
}
],
)
print(response.choices[0].message.content)
Құжатталған минимум сұранымнан бастаңыз. Пайымдауды басқару параметрлерін тек эндпоинтіңіздегі ағымдағы API анықтамасы нақты қолдаса ғана қосыңыз.
2. Құн мен өнімділік телеметриясын қайта негіздеңіз
Кемінде мыналарды жазып отырыңыз:
- кіріс, шығыс және пайымдау токендері
- кэш-хиттер және кэш құру токендері
- бірінші токенге дейінгі уақыт және жалпы кідіріс
- құрал қоңыраулары, ретрайлар және фолбэктер
- қабылданған және қабылданбаған шығыстар
- адамдық түзету уақыты
3. Қолданбаңыз пайдаланатын интерфейсті қайта тестілеңіз
Стриминг оқиғалары, мультимодальды жүктемелер, құрал схемалары, құрылымдалған шығыс, аяқталу себептері, пайдалану өрістері, қате өңдеу және көп айналымды мінез-құлықты тексеріңіз. Өндірістік модель беті DashScope және OpenAI-үйлесімді қолжетімділікті құжаттайды; оған қосымша кез келген үйлесімділік қабатын сеніп пайдаланбас бұрын тексеріңіз.
4. Практикалық контекст шектеріне құрметпен қараңыз
1M контекст терезесі 1M-токендік пайдаланушы промптымен бірдей емес. QwenCloud максималды кірісті пайымдаусыз 991K және пайымдаумен 983K деп көрсетеді. Сұранымда шығыс пен пайымдауға орын қалуы үшін қауіпсіздік маржасын қосыңыз.
5. Qwen 3.7 және Qwen 3.8-ді қатар жүргізіңіз
Бірдей промпттар, құралдар, валидаторлар, ретрай ережелері және деректер жиынтықтарын қолданыңыз. Жеке жауаптарды көзбен бағалаудан гөрі қабылданған тапсырмаға шаққандағы шығын мен кідірісті салыстырыңыз.
Qwen 3.8 Max-ты бағалау және маршруттау
Жалпы бенчмарк орташа мәндеріне емес, нақты жүктемелерге сүйеніңіз.
| Жүктеме | Ұсынылатын тапсырмалар | Негізгі қабылдау сигналы |
|---|---|---|
| Репозиториймен кодтау | 4 | Тесттер адамдық патчсыз өтеді |
| Ұзақ құжатты талдау | 3 | Тұжырымдар берілген дәлелдермен расталған |
| Мультимодальды талдау | 2 | Сәйкес сурет/видео бөлшектері дұрыс қолданылған |
| Құрал қолданатын агенттер | 3 | Дұрыс құрал таңдау және жарамды аргументтер |
A practical routing policy is:
Simple, latency-sensitive task
→ Lower-cost Plus model
Existing workload that already meets quality targets
→ Qwen 3.7 Max while its promotion remains attractive
Hard coding, multimodal, or long-horizon task
→ Qwen 3.8 Max
Failed validation
→ One controlled retry, then a tested fallback
Qwen 3.8 Max-ты күрделі репозиторий жұмыстары, ұзақ ауқымды агенттер, мультимодальды талдау және Qwen 3.7 қабылдау тесттерінен өтпейтін жұмыс ағындары үшін пайдаланыңыз. Акция айтарлықтай құнды төмендетіп тұрса және қолданыстағы модель сапа мақсатына жетіп тұрса, Qwen 3.7 Max-ты сақтаңыз.
CometAPI баға бетін және тірі маршруттау ақпаратын шектерді бекітуден бұрын тексеріңіз, себебі провайдер қолжетімділігі мен маршрутталған бағалар QwenCloud-тың тікелей тізімдік бағасынан тәуелсіз өзгеруі мүмкін. CometAPI Cookbook қайталанатын сұранымдар мен тұрақты бағалау құралын құруға көмектеседі.
FAQ
Qwen 3.8 Max API қанша тұрады?
QwenCloud қазіргі уақытта Qwen 3.8 Max үшін 1 млн кіріс токенге $2 және 1 млн шығыс токенге $6 деп көрсетеді. Кэш қолданылуы мен құрамдастырылған құралдардың бөлек тарифтері бар.
128K токеннен жоғарыда Qwen 3.8 Max қымбаттай ма?
Ағымдағы модельге тән тариф картасында бөлек ұзын контекст деңгейі көрсетілмеген. Ұзын сұранымдар қымбат тұрады, себебі оларда токен көп, бөлек бірлік бағасына өткендіктен емес.
Qwen 3.8 Max пайымдау токендері есептеледі ме?
Пайымдау жасалатын қолданылуды және жалпы құнды арттыра алады. Көрінетін жауаптан болжам жасаудың орнына, эндпоинт қайтарған пайымдау және шығыс токендері өрістерін қолданыңыз.
Qwen 3.8 Max ашық па?
Qwen ашық салмақтар API релизінен кейін болатынын жариялады. Ресми чекпойнт пен лицензия шықпайынша модельді жүктеп алуға немесе өзіңізде хосттауға болады деп сипаттамаңыз.
Qwen 3.7 Max қолданушылары бірден көшуі керек пе?
Автоматты түрде емес. Qwen 3.8 Max тізімдік стандартты бағасы төмен, ал Qwen 3.7 Max ағымдағы акция кезінде арзанырақ. Өз сапа, кідіріс, кэш мінез-құлқы және қабылданған тапсырмаға шаққандағы шығын деректеріңіз көшуге қолдау көрсеткенде көшіңіз.
CometAPI арқылы Qwen 3.8 Max-ты тестілеңіз
OpenAI-үйлесімді клиентті баптау үшін CometAPI Quickstart пайдаланыңыз. Өндірістік трафик жібермес бұрын qwen3.8-max аккаунтыңызда тірі екенін растаңыз және онда көрсетілген маршрутталған бағаны тексеріңіз.
Qwen 3.7 базалық мәнімен бірдей промпттар, валидаторлар, ретрай саясаттары және телеметрияны қолданып салыстырыңыз. Бұл бағалауды тест құралындағы өзгерістерге емес, модельге бағыттайды.
