Қысқаша
Gemini 3.6 Flash бағасы $1.50/M енгізу және $7.50/M шығару, әрі Gemini 3.5 Flash-пен салыстырғанда шығару құны төмен және кодтау мен агент көрсеткіштері жақсарғаны хабарланды. Өндірісте күрделі пайымдау мен агенттер үшін 3.6 Flash қолданыңыз, ал қарапайым, үлкен көлемді тапсырмаларды арзанырақ Gemini 3.5 Flash-Lite-қа бағыттаңыз.
Gemini 3.6 Flash – жай ғана кезекті model-ID жаңартуы емес.
Егер сіз бұрыннан Gemini 3.5 Flash қолданып жүрсеңіз, ең үлкен өзгеріс – экономикада. Google енгізу бағасын $1.50/M деңгейінде қалдырып, шығару бағасын $9.00-ден $7.50-ге түсірді және бірнеше кодтау мен агенттік бенчмарктерде өнімділік жақсарғанын хабарлайды.
Практикалық сұрақ – бұл жақсартулар өндірістік жүктемелерді көшіруге жеткілікті ме?
Жауап жүктемеге байланысты. Кодтаушы агенттер, мультимодальды талдау және көпқадамды құрал қолдану қарапайым экстракция немесе классификацияға қарағанда көбірек пайда әкелуі мүмкін. Көшіру сонымен қатар тек модель атауын ауыстырумен шектелмейтін бірқатар API үйлесімділік тексерістерін талап етеді.
Бұл нұсқаулықта Gemini 3.6 Flash API бағалары, тегін деңгейге қолжетімділік, бенчмарк нәтижелері, көшіру өзгерістері, Python мысалдары және өндірістік трафикке ауыстырмас бұрын нені тексеру керектігі қамтылған.
Gemini 3.6 Flash деген не?
Gemini 3.6 Flash — кодтау, мультимодальды пайымдау және көпқадамды агент жұмыс процестері үшін Google-дың жаңа Flash моделі. 2026 жылғы 21 шілдеде шығарылған, ол Google-дың Flash деңгейінде қалдай отырып, күшті пайымдау мен агенттік өнімділік қажет өндірістік жүктемелерге арналған.
Негізгі сипаттамалары:
| Тармақ | Gemini 3.6 Flash |
|---|---|
| Model ID | gemini-3.6-flash |
| Стандартты енгізу бағасы | $1.50 / 1M tokens |
| Стандартты шығару бағасы | $7.50 / 1M tokens |
| Стандартты кэштелген енгізу | $0.15 / 1M tokens |
| Әдепкі ойлау деңгейі | medium |
| Енгізу контексті | 1,048,576 tokens |
| Ең көп шығару | 65,536 tokens |
| Енгізулер | Мәтін, сурет, бейне, аудио, PDF |
| Шығыс | Мәтін |
| Ең қолайлы | Код жазу, мультимодальды пайымдау, күрделі агенттер |
Google Gemini 3.6 Flash-ты кодтау, кеңістіктік және мультимодальды пайымдау, сондай-ақ көпқадамды агенттік тапсырмалар сияқты жүктемелер үшін ұсынады.
Модель сондай-ақ function calling, structured outputs, code execution, context caching, File Search, URL context, Google Search grounding және Google Maps grounding сияқты мүмкіндіктерді қолдайды.
Соңғы сипаттамалар мен көшіру жөніндегі нұсқаулықты Google-дың Gemini модельдерінің ең соңғы нұсқаулығынан қараңыз.
Алдыңғы буыннан өтетін әзірлеушілер үшін CometAPI Gemini 3.5 Flash API нұсқаулығы пайдалы интеграциялық негіз береді.
Gemini 3.6 Flash API қанша тұрады?
Gemini 3.6 Flash Google-дың Standard ақылы деңгейінде миллион енгізу токені үшін $1.50 және миллион шығару токені үшін $7.50 тұрады.
Gemini 3.5 Flash-пен салыстырғанда, енгізу бағасы өзгеріссіз қалды, ал шығару бағасы миллион токен үшін $9.00-ден $7.50-ге түсті — 16.7% төмендеу.
Google сондай-ақ Batch, Flex және Priority өңдеулерін ұсынады.
| Gemini 3.6 Flash Tier | Input / 1M | Cached Input / 1M | Output / 1M |
|---|---|---|---|
| Standard | $1.50 | $0.15 | $7.50 |
| Batch | $0.75 | $0.075 | $3.75 |
| Flex | $0.75 | $0.075 | $3.75 |
| Priority | $2.70 | $0.27 | $13.50 |
Маңызды:** Ойлау токендері шығару токендерінің тарифімен есептеледі. Сондықтан қысқа көрінетін жауаптың өзі соңғы жауап ұзындығы ұсынғаннан көбірек ақылы шығару токендерін жұмсауы мүмкін.
Контекстіні кэштеу бірдей үлкен system prompt-ты, репозиторий контекстін, құжаттар жиынын немесе әңгіме тарихын қайталап жіберетін қолданбалар үшін де елеулі әсер береді.
Standard ақылы деңгейінде Gemini 3.6 Flash үшін кэштелген енгізу құны миллион токен үшін $0.15, ал кәдімгі енгізу — $1.50.
Мысал: 15,000 енгізу токені + 8,000 шығару токені
15,000 енгізу токені және 8,000 шығару токені пайдаланылатын тапсырманы қарастырайық.
| Модель | Шамаланған құн |
|---|---|
| Gemini 3.5 Flash | $0.0945 |
| Сол токен көлемінде Gemini 3.6 Flash | $0.0825 |
| 17% аз шығару токенімен Gemini 3.6 Flash | $0.0723 |
| Сол токен көлемінде Gemini 3.5 Flash-Lite | $0.0245 |
Осы мысалда бірдей токен пайдаланғанда, Gemini 3.6 Flash Gemini 3.5 Flash-пен салыстырғанда шамамен 12.7% арзан.
Google Gemini 3.6 Flash-тың Artificial Analysis Index-те 17% аз шығару токендерін пайдаланғанын да хабарлайды. Егер өндірістік жүктеме осындай қысқартуды қайталаса, бұл мысалдағы есептелген үнем шамамен 23.5%-ға өседі.
Google бөлек түрде DeepSWE-де 65%-ға дейін шығару токендерінің қысқаруын хабарлайды. Бұл көрсеткіштер әртүрлі жүктемелерді өлшейді және бір-бірімен алмастырылмауы тиіс: 17% — Artificial Analysis Index үшін, ал 65% — нақты кодтау бенчмаркі үшін.
Негізгі токен-құн есебі:
Request cost =
(input tokens x input price + output tokens x output price) / 1,000,000
Агенттер үшін нақты құн кеңірек:
Total task cost =
initial model call
+ retries
+ fallback calls
+ paid tools
+ grounding or search costs
Сондықтан токен бойынша ең арзан модель әрдайым тапсырманы аяқтаудың ең арзан жолы бола бермейді.
Gemini 3.6 Flash тегін бе?
Иә. Google-дың ағымдағы Gemini Developer API бағалары Gemini 3.6 Flash үшін Standard қолданысы бар Тегін деңгейді көрсетеді.
Тегін деңгей шексіз өндірістік қуатты білдірмейді. API шектеулері жобаға және пайдалану деңгейіне байланысты, сондықтан әзірлеушілер үшінші тарап мақаласындағы минутына сұраным санына сүйенуден гөрі, өз жобасына қолданылатын rate limit-терді тексеруі керек.
Өндірістік жоспарлау үшін қуатты бағалағанда Google-дың ағымдағы Gemini API бағалары мен rate-limit құжаттамасын пайдаланыңыз.
Әзірлеушілер Gemini 3.6 Flash-қа Gemini API және Google AI Studio арқылы қол жеткізе алады. Біріктірілген мультимодельдік жұмыс процесін пайдаланатын топтар модельді CometAPI Gemini 3.6 Flash модель парағы арқылы да сынай алады.
Gemini 3.6 Flash пен Gemini 3.5 Flash қалай салыстырылады?
Google жариялаған нәтижелер кодтау, агенттік орындау, компьютермен жұмыс және білім жұмысы салаларында ең үлкен жақсартуларды көрсетеді.
| Бенчмарк | Gemini 3.6 Flash | Gemini 3.5 Flash | Өзгеріс |
|---|---|---|---|
| DeepSWE | 49.00% | 37.00% | +12.0 points |
| MLE-Bench | 63.90% | 49.70% | +14.2 points |
| OSWorld-Verified | 83.00% | 78.40% | +4.6 points |
| GDPval-AA v2 | 1,421 | 1,349 | 72 |
Google сондай-ақ Gemini 3.6 Flash-тың көпқадамды жұмыс процестерін Gemini 3.5 Flash-пен салыстырғанда аздау пайымдау қадамдарымен, диалог айналымдарымен және құрал шақыруларымен аяқтайтынын айтады.
Компанияның хабарлауынша:
- Artificial Analysis Index-те 17% аз шығару токендері.
- DeepSWE-де 65%-ға дейін аз шығару токендері.
- Артық қажетсіз код түзетулері мен орындалу циклдерінің азаюы.
- Мультимодальды және кеңістіктік пайымдаудың жақсаруы.
Бастапқы нәтижелерді Google-дың Gemini 3.6 Flash іске қосу туралы хабарландыруынан көруге болады.
Бұл бенчмарктер 3.6 Flash-ты бағалау үшін күшті кандидат етеді, әсіресе бір сұраным бірнеше раунд пайымдауға, құрал шақыруларына және түзетулерге айналатын жүктемелер үшін.
Дегенмен, олар сіздің қолданбаңыздағы тестілеуді алмастырмауы тиіс.
Google сондай-ақ 3.6 Flash код өзгерістерін жасамас бұрын бағдарламалық тұрғыда алдын ала көбірек талдау жасай алатынын атап өтеді. Үлкен репозиторийде бұл дәлдікті арттыра алады. Тар ауқымды frontend өзгерісінде бұл қажетсіз зерттеуді ғана қосуы мүмкін.
Анық файл шекаралары, қабылдау критерийлері және іске асыру нұсқаулары әлі де маңызды.
Gemini 3.6 Flash vs Gemini 3.5 Flash-Lite: Қайсын қолдану керек?
3.6 Flash-ты сынауға тұрарлық деп шешкен соң, келесі сұрақ — әрбір сұранымның шынымен соны қажет ету-етпеуі.
Көптеген өндірістік жүйелер үшін жауап — жоқ.
Gemini 3.5 Flash-Lite әлдеқайда арзан және болжамды, жоғары көлемдегі жүктемелер үшін жақсы әдепкі нұсқа болуы мүмкін.
| Тармақ | Gemini 3.6 Flash | Gemini 3.5 Flash-Lite |
|---|---|---|
| Стандартты енгізу бағасы | $1.50 / 1M tokens | $0.30 / 1M tokens |
| Стандартты шығару бағасы | $7.50 / 1M tokens | $2.50 / 1M tokens |
| Стандартты кэштелген енгізу | $0.15 / 1M tokens | $0.03 / 1M tokens |
| Әдепкі ойлау деңгейі | medium | minimal |
| Ең қолайлы | Күрделі пайымдау, кодтау, агенттер | Экстракция, маршрутизация, классификация |
Standard бағасында Flash-Lite енгізуде 5× арзан, ал шығаруда 3× арзан Gemini 3.6 Flash-қа қарағанда.
Мыналар үшін Gemini 3.5 Flash-Lite-тен бастаңыз:
- Классификация
- Сұранымдарды маршрутизациялау
- JSON және құрылымдалған экстракция
- Құжаттарды өңдеу
- Деректер түрлендіру
- Ауқымды аударма
- Жеңіл салмақты суб-агенттер
- Жоғары көлемді қайталанбалы тапсырмалар
Практикалық маршрутизация стратегиясы мынадай болуы мүмкін:
| Жүктеме | Бірінші бағыт | Эскалация |
|---|---|---|
| Классификация немесе маршрутизация | Gemini 3.5 Flash-Lite | Валидация сәтсіз болғаннан кейін 3.6 Flash |
| Құрылымдалған экстракция | Gemini 3.5 Flash-Lite | Күрделі құжаттар үшін 3.6 Flash |
| Жеңіл салмақты субагент | Gemini 3.5 Flash-Lite | Ойлау деңгейін көтеру немесе 3.6 Flash |
| Көп файлды кодтау | Gemini 3.6 Flash | Шешілмесе, күштірек фолбэк |
| Күрделі құрал жұмыс процесі | Gemini 3.6 Flash | Құрал немесе валидация сәтсіз болса фолбэк |
| Мультимодальды пайымдау | Gemini 3.6 Flash | Тапсырмаға тән фолбэк |
Аралас өндірістік трафик үшін пайдалырақ метрика:
Cost per successful task =
(model calls + retries + tools + fallbacks) / accepted tasks
Арзан алғашқы қоңырау бірнеше рет сәтсіздікке ұшырап, ақыры күшті модельді қажет етсе, тартымдылығын жоғалтады.
Кері жағдай да маңызды. Егер Flash-Lite қазірдің өзінде қажетті дәлдікті қамтамасыз етсе, миллиондаған болжамды классификация сұранымдарын Gemini 3.6 Flash-қа жіберудің мәні аз.
Мұндай маршрутизация қажет болатын қолданбалар үшін біздің OpenAI-үйлесімді base URL арқылы бірнеше AI модельдерін шақыру нұсқаулығын қараңыз.
Gemini 3.6 Flash-қа көшерде не өзгереді?
Gemini 3.5 Flash-тен Gemini 3.6 Flash-қа көшу тек модель ID-ін өзгерту емес.
Өндірістік трафикті ауыстырмас бұрын әзірлеушілер бес саланы қарап шығуы керек: ескірген іріктеу параметрлері, ойлауды басқару, candidate_count, алдын ала толтырылған модель кезектері және function calling күйі.
1. temperature, top_p және top_k алып тастаңыз
Google бұл іріктеу басқаруларын Gemini 3.6 Flash және Gemini 3.5 Flash-Lite үшін ескірген деп жариялады:
generation_config = {
"temperature": 0.7,
"top_p": 0.9,
"top_k": 40,
}
Жаңа модельдер бұл параметрлерді әзірге елемейді. Google болашақ Gemini модель ұрпақтары олар берілсе, HTTP 400 қатесін қайтаратын болуы мүмкін дейді.
Болжаулы шығару форматтары үшін айқынырақ system instruction-дарды және structured outputs пайдаланыңыз.
2. thinking_budget параметрін thinking_level параметрімен ауыстырыңыз
Gemini 3.6 Flash әдепкіде medium ойлауына бапталған.
Google-дың көшіру нұсқаулығы сандық thinking_budget конфигурацияларынан thinking_level-ге көшуді ұсынады.
Gemini 3.5 Flash-Lite әдепкіде minimal, бұл жоғары көлемдегі экстракция, классификация және маршрутизация жүктемелері үшін қолайлы.
Ойлау деңгейін көтеру көпқадамды пайымдау, код орындау немесе құрал қолдану қажет тапсырмаларда сыналып көрілуі тиіс.
3. candidate_count алып тастаңыз
Google candidate_count параметрін Gemini 3.x-та қолдау көрсетілмейді деп көрсетеді.
Бірнеше модель бірдей generation конфигурациясын бөліскенде бұл оңай көзден таса қалады. Өндірістік сұранымдарға көшерде алып тастаңыз.
4. Модель кезектерін алдын ала толтыруды тоқтатыңыз
Сұранымдар енді model рөлі бар бос емес айналыммен аяқталмауы тиіс.
Ескі қолданба келесіге ұқсас payload пайдалануы мүмкін:
{
"contents": [
{
"role": "user",
"parts": [{"text": "Translate 'Hello world' to Spanish."}]
},
{
"role": "model",
"parts": [{"text": "Translation:"}]
}
]
}
Енді бұл үлгі HTTP 400 қайтара алады.
Егер сіз бұрын форматты күштеп беруге prefilling пайдаланған болсаңыз, талапты system_instruction ішіне жылжытыңыз немесе structured outputs қолданыңыз.
5. Function calling және көп айналымды күйді қайта сынаңыз
Құрал қолданатын агенттер көшіру кезінде бөлек тестілеуді қажет етеді.
Google Interactions API-де сервер жағындағы көп айналымды күй үшін previous_interaction_id қолдануды ұсынады.
Функция нәтижесін қайтарғанда, функция атауын да, бастапқы шақыру ID-ін де сақтаңыз:
final_interaction = client.interactions.create(
model="gemini-3.6-flash",
previous_interaction_id=interaction.id,
tools=tools,
input=[
{
"type": "function_result",
"name": step.name,
"call_id": step.id,
"result": [
{
"type": "text",
"text": json.dumps(result),
}
],
}
],
)
generateContent пайдаланатын қолданбалар FunctionResponse payload-тарын да тексеріп, көшіруден кейін құрал шақыру қателерін бақылауы тиіс.
Ағымдағы іске асыру деректері үшін Google-дың соңғы модельге көшу нұсқаулығын және function calling құжаттамасын қараңыз.
Gemini 3.6 Flash-ты Python арқылы қалай шақырасыз?
Google-дың GenAI SDK-ын орнатыңыз немесе жаңартыңыз:
pip install -U google-genai
API кілтіңізді орнатыңыз:
export GEMINI_API_KEY="your-api-key"
Содан кейін Gemini 3.6 Flash-ты шақырыңыз:
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.6-flash",
input=(
"Review this migration plan and list the three "
"highest-risk compatibility issues."
),
)
print(interaction.output_text)
Көбірек пайымдауды қажет ететін тапсырма үшін ойлау деңгейін баптаңыз:
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Analyze this multi-step debugging problem.",
generation_config={
"thinking_level": "medium",
},
)
print(interaction.output_text)
Көшірудегі негізгі айырманы қысқаша түйіндеуге болады:
# Older shared configuration
old_config = {
"temperature": 0.2,
"top_p": 0.9,
"top_k": 40,
"candidate_count": 1,
"thinking_budget": 4096,
}
# Gemini 3.6 Flash
new_config = {
"thinking_level": "medium",
}
Жоғары ойлау деңгейі әрдайым жақсырақ деп ойламаңыз. Өз тапсырмаларыңызда кідіріс, токен тұтыну және аяқталу деңгейін өлшеңіз.
Өндіріс алдында Gemini 3.6 Flash-ты қалай тестілеу керек?
Gemini 3.6 Flash-тың өндірістік стегіңізге лайық екенін шешу үшін үлкен қоғамдық бенчмарк жиынтығы қажет емес.
Ең жақсы бастау нүктесі — сіздің нақты трафигіңізге ұқсас 30–50 соңғы тапсырма.
Аралас түрін қосыңыз:
- Кодтау және дебаг
- Көпқадамды құрал қолдану
- Мультимодальды құжаттар
- Деректер экстракциясы
- Классификация және маршрутизация
Сол енгізулерді мына арқылы өткізіңіз:
- Қазіргі өндірістік моделііңіз
- Gemini 3.6 Flash
- Gemini 3.5 Flash-Lite
Prompts, құралдар, валидаторлар және қабылдау критерийлерін өзгеріссіз қалдырыңыз.
Келесілерді қадағалаңыз:
- Енгізу токендері
- Шығару және ойлау токендері
- Кідіріс
- Құрал шақырулары
- Қайта әрекеттенулер
- Функция шақыру қателері
- Валидатордан өту үлесі
- Адамдық түзету уақыты
- Тапсырманың соңғы сәтті аяқталуы
Содан кейін қабылданған нәтижені шығару үшін қажет жалпы құнын салыстырыңыз.
Бірінші әрекеттен сәтті орындалатын $0.08 тұратын кодтау сұранымы, екі рет сәтсіз болып, ақыры эскалацияны қажет ететін $0.02 сұранымнан арзан болуы мүмкін.
Сонымен қатар, Flash-Lite сенімді орындайтын қарапайым классификация тапсырмасы үшін Gemini 3.6 Flash бағасын төлеудің мәні жоқ.
Мақсат — әрбір сұранымға бір модель табу емес. Қосымша қабілеті нәтижеге шын мәнінде әсер ететін жерлерде ғана күшті модельді пайдалану.
Әзірлеушілер CometAPI арқылы бірдей бағалау жиынтығымен ағымдағы Gemini 3.6 Flash және Gemini 3.5 Flash-Lite маршруттарын салыстыра алады.
Сұрақ-жауап (FAQ)
Gemini 3.6 Flash API қанша тұрады?
Google-дың Standard ақылы тарифі — миллион енгізу токені үшін $1.50 және миллион шығару токені үшін $7.50. Стандартты кэштелген енгізу $0.15/M. Batch және Flex — енгізу үшін $0.75/M және шығару үшін $3.75/M.
Gemini 3.6 Flash тегін бе?
Иә. Google-дың ағымдағы Gemini Developer API бағаларында Gemini 3.6 Flash үшін Standard қолданысына Тегін деңгей көрсетілген. Тегін қолжетімділік жоба және пайдалану деңгейі бойынша rate limit-терге бағынады.
Gemini 3.6 Flash жалпы қолжетімді ме?
Иә. Google gemini-3.6-flash моделін 2026 жылғы 21 шілдеде шығарды және оны Gemini API құжаттамасында өндірістік модель ретінде көрсетеді.
Gemini 3.6 Flash контекст терезесі қандай?
Gemini 3.6 Flash 1,048,576 енгізу токеніне және 65,536 шығару токеніне дейін қолдайды. Ол мәтін, сурет, бейне, аудио және PDF енгізулерін қабылдайды және мәтін шығарады.
Gemini 3.6 Flash Gemini 3.5 Flash-пен салыстырғанда арзан ба?
Шығару токендері бойынша — иә. Екі модель үшін де стандартты енгізу бағасы $1.50/M, ал Gemini 3.6 Flash шығару бағасын $9.00/M-ден $7.50/M-ге дейін төмендетеді.
Gemini 3.6 Flash пен Gemini 3.5 Flash-Lite—қайсысын қолдану керек?
Кодтау сапасы, мультимодальды пайымдау немесе күрделі агенттік орындау сәтсіздіктер мен қайта әрекеттенулерді азайта алатын жағдайда Gemini 3.6 Flash қолданыңыз. Жоғары көлемдегі экстракция, классификация, маршрутизация және басқа да болжамды жүктемелер үшін Flash-Lite-тен бастаңыз, мұнда төмен құн маңыздырақ.
Gemini 3.6 Flash-қа көшерде нені өзгерту керек?
temperature, top_p, top_k және candidate_count параметрлерін алып тастаңыз; thinking_budget-ті thinking_level-мен ауыстырыңыз; алдын ала толтырылған модель кезектерін алып тастаңыз; function calling және көп айналымды күйді қайта сынаңыз.
Қорытынды
Егер сіз қазірдің өзінде Gemini 3.5 Flash-ты кодтау, мультимодальды жұмыс немесе агенттік жұмыс процестері үшін қолдансаңыз, Gemini 3.6 Flash-ты бенчмарктен өткізуге тұрарлық.
Шығару бағасы төмен, әрі Google-дың бастапқы нәтижелері кей жүктемелерде токендер мен орындалу қадамдарының да азаюы мүмкін екенін ұсынады. Қайталап пайымдайтын, құралдарды шақыратын және сәтсіз әрекеттерді қайтаратын агенттер үшін бұл үнемдер айдардағы баға айырмасынан маңыздырақ болуы мүмкін.
Бірақ бұл әрбір сұранымды 3.6 Flash-қа көшіру керек дегенді білдірмейді.
Gemini 3.5 Flash-Lite едәуір арзан және экстракция, классификация, маршрутизация сияқты болжамды жұмыстар үшін жеткілікті болуы мүмкін.
Ең дұрыс өндірістік стратегия — әр модельді экономикалық тұрғыдан мәні бар жерде қолдану: қарапайым, жоғары көлемді тапсырмалар үшін Flash-Lite, ал дұрыс аяқталу ықтималдығын бірінші әрекеттен арттыра алатын жағдайда — 3.6 Flash.
Содан кейін шынымен маңызды нәтижені өлшеңіз — қабылданған жауапты алу үшін кеткен жалпы құнды.
Екі модельді бірдей жұмыс процесі арқылы салыстыру үшін CometAPI-дегі Gemini 3.6 Flash модель парағын және Gemini 3.5 Flash-Lite модель парағын қараңыз немесе ағымдағы модель маршруттарын CometAPI бағалар бетінде шолыңыз.
