Gemini 3.6 Flash and 3.5 Flash Lite are now live on CometAPI →

Что такое Gemini 3.6 Flash?

CometAPI
AnnaJul 23, 2026
Что такое Gemini 3.6 Flash?

TL;DR: Gemini 3.6 Flash — это июльская (2026) production‑модель Flash от Google для кодирования, знаний, мультимодального анализа и агентных рабочих процессов. Она сохраняет окно ввода 1 048 576 токенов и лимит вывода 65 536 токенов из Gemini 3.5 Flash, но, по данным Google, показывает лучшие результаты в кодировании, работе с компьютером, знаниевых задачах и эффективности по токенам при более низкой цене за выходные токены.

Gemini 3.6 Flash лучше рассматривать как новый модель по умолчанию в классе Flash для сложного кодинга, мультимодального рассуждения и многошаговых агентов. Оставляйте Gemini 3.5 Flash там, где важна непрерывность выходов или вы ещё не завершили миграционное тестирование. Используйте Gemini 3.5 Flash‑Lite для высокообъёмных задач извлечения, маршрутизации, классификации и прочих предсказуемых сценариев, где минимальная стоимость важнее максимальной глубины рассуждений.

Ключевые выводы

  • Gemini 3.6 Flash доступна как gemini-3.6-flash; в документации Gemini API от Google последним обновлением значится июль 2026 года.
  • Gemini 3.6 Flash нацелена на кодирование, знаниевую работу, мультимодальный анализ, задачи «computer use» и многошаговые агентные рабочие процессы.
  • Google сообщает о лучших результатах по сравнению с Gemini 3.5 Flash на DeepSWE, MLE Bench, OSWorld‑Verified и GDPval‑AA v2. По Artificial Analysis Index — на 17% меньше выходных токенов, а в оценках по кодированию, связанных с DeepSWE, — до 65% меньше выходных токенов.
  • Официальное стандартное ценообразование Gemini API: $1.50/М входных токенов и $7.50/М выходных токенов, против $1.50/М и $9.00/М у Gemini 3.5 Flash. Batch и Flex для Gemini 3.6 Flash — $0.75/М вход и $3.75/М выход; Priority — $2.70/М вход и $13.50/М выход. На странице модели Gemini 3.6 Flash у CometAPI указано $1.20/М вход и $6.00/М выход — на 20% ниже официальных стандартных цен Google на момент проверки.
  • Gemini 3.6 Flash может заменить Gemini 3.5 Flash во многих новых production‑нагрузках, но миграция должна включать тесты подсказок, вызова инструментов, параметров, задержки, стоимости и регрессии.
  • Gemini 3.5 Pro не входила в релиз; Google заявляет, что продолжает тестирование с партнёрами и выпустит её широко, когда будет готова.

Что такое Gemini 3.6 Flash?

Gemini 3.6 Flash — новая модель уровня Flash, которую стоит оценивать, если вы создаёте ИИ‑агентов, инструменты для кодирования, документные процессы, ассистентов с поисковым обоснованием или мультимодальную автоматизацию. Google выпустила её 21 июля 2026 года вместе с Gemini 3.5 Flash‑Lite и Gemini 3.5 Flash Cyber, акцентируя запуск на экономике production‑агентов: выше эффективность по токенам, ниже задержки, меньше инструментальных циклов и ниже стоимость за успешную задачу.

Главное изменение — не название модели. Улучшения — в качестве и экономике: Google утверждает, что Gemini 3.6 Flash использует на 17% меньше выходных токенов, чем Gemini 3.5 Flash, по Artificial Analysis Index и до 65% меньше выходных токенов на задачах в стиле DeepSWE, одновременно снижая стандартную стоимость вывода с $9.00/М до $7.50/М.

Основные возможности:

  • Мультимодальный ввод: текст, изображение, видео, аудио, PDF.
  • Контекстное окно: 1 млн входных токенов, 64k выходных токенов.
  • Использование инструментов: нативный function calling, поиск как инструмент и «computer use» для агентной автоматизации UI.
  • Лучшие сценарии: повседневные задачи, агентное кодирование, продвинутое рассуждение, понимание длинного контекста и генерация production‑кода.

В отличие от более крупных моделей «Pro», ориентированных на максимум интеллекта, варианты Flash делают упор на скорость, масштаб и экономичность, обеспечивая при этом передовой уровень в целевых областях. Gemini 3.6 Flash продвигает это дальше, снижая многословность вывода и повышая точность.

Knowledge Cutoff: обновлён до марта 2026 года (с января 2025 в предыдущих версиях), что даёт более свежие знания о реальном мире.

Model card добавляет важную архитектурную деталь: Gemini 3.6 Flash основана на Gemini 3.5 Flash. Это делает релиз ближе к таргетированному производственному апгрейду, а не к полностью новому семейству. Похоже, Google сосредоточилась на проблемах, с которыми сталкивались разработчики в реальных агентных сценариях: слишком много выходных токенов, лишние вызовы инструментов, нежелательные правки во время диагностики, циклы ревизий кода, интерпретация графиков, работа с документами и мультимодальное UI‑рассуждение.

Зачем Google выпустила Gemini 3.6 Flash сейчас?

Последние новости вокруг релиза

Объявление Google от 21 июля сделало три вещи одновременно:

  1. Запустило Gemini 3.6 Flash как более мощную рабочую модель.
  2. Запустило Gemini 3.5 Flash‑Lite как самую быструю и дешёвую модель класса 3.5 для высокопоточных сценариев.
  3. Представило Gemini 3.5 Flash Cyber в CodeMender для ограниченных кейсов защиты в кибербезопасности.

То же объявление прояснило статус Gemini 3.5 Pro: она всё ещё тестируется с партнёрами, и Google планирует сделать её доступной широко, когда будет готова. Google также сообщила о начале предобучения Gemini 4.

Контекст важен. Gemini 3.6 Flash — не замена Pro. Это ответ Google на другую производственную проблему: многие ИИ‑системы становятся слишком дорогими, многословными и ненадёжными, когда модели многократно вызывают инструменты, рассуждают на длинном контексте и повторяют попытки действий. Более быстрая и эффективная модель Flash может дать более немедленный эффект, чем отложенный флагман, если она сокращает число токенов, ходов и повторов, необходимых для завершения типичных задач.

Релиз о стоимости за успешную задачу

Команды ИИ часто сравнивают модели по цене за токен. Это полезно, но неполно. Агентные нагрузки вводят дополнительные переменные стоимости:

  • Сколько шагов рассуждений делает модель?
  • Сколько вызовов инструментов она совершает?
  • Как часто она делает ненужные правки?
  • Как часто она ошибается и требует повтора?
  • Сколько выходных токенов тратится на объяснение вместо решения?
  • Как часто трафик приходится эскалировать на более дорогую модель?

Gemini 3.6 Flash важна тем, что Google продвигает её через операционные метрики, а не только через заголовочные бенчмарки. Если модель сокращает выходные токены на 17%, избегает лишних циклов правок и чаще выдаёт корректный код с первой попытки, реальные выгоды могут быть больше, чем кажется по прайс‑листу.

Производительность и сравнение по бенчмаркам

Оценки Google и сторонние испытания выделяют сбалансированные улучшения 3.6 Flash. Она не возглавляет каждый лидерборд, но превосходит в эффективности с учётом практического применения.

Выбранные бенчмарки (Gemini 3.6 Flash vs. 3.5 Flash):

  • DeepSWE (Datacurve — многошаговая разработка ПО): 49% против 37% (существенный рост точности, меньше циклов/правок); снижение токенов до 65% в отдельных случаях (например, с 276k до 97k токенов).
  • MLE‑Bench (ML Research): 63.9% против 49.7%
  • OSWorld‑Verified (Computer Use): 83.0% против 78.4% (встроенный «computer use» теперь стандарт)
  • GDPval‑AA v2 (Knowledge Work): 1421 против 1349
  • Artificial Analysis Intelligence Index: около 50 (крепко, хотя отстаёт от некоторых лидеров, как варианты Claude, с ~60); примечательно по эффективности токенов.
  • Другое: улучшения на Terminal‑Bench, длинный контекст (например, GDM‑MRCR v2), SWE‑Bench Pro, а также мультимодальные задачи вроде парсинга документов и анализа диаграмм.

Сравнительная таблица: Gemini 3.6 Flash и ключевые конкуренты (приблизительно, по данным июля 2026)

Характеристика/МодельGemini 3.6 FlashGemini 3.5 FlashGPT-5.6 Luna (оцен.)Grok 4.5Claude Sonnet 5
Эффективность по выходным токенамОтличная (на 17% лучше)ХорошаяВысокаяСильнаяХорошая
Кодирование (DeepSWE)49%37%67%54%54%
Работа с компьютером (OSWorld)83%78.4%72.6%-81.2%
Знаниевая работа (Elo)14211349158415351607
Цена за вывод ($/1M)$7.50$9.00$6.00$6.00$10-15
Лучше всего подходитЭффективные агентыОбщие агентыВысокий интеллектРассуждениеКреатив

Дополнительные заметки:

  • SWE‑Bench Pro: 58.7% (против 55.1% у 3.5 Flash).
  • Terminal‑Bench 2.1: 78.0% (против 76.2%).
  • Модель выделяется в агентных и мультимодальных сценариях, сохраняя скорость уровня Flash.

Независимые тесты (например, Artificial Analysis, обсуждения на Reddit) отмечают высокую скорость и эффективность, хотя местами она может потреблять больше токенов, чем некоторые ультра‑оптимизированные конкуренты при определённых настройках. Отзывы из практики хвалят её за анализ документов, составление отчётов и мультимодальные задачи (например, от клиентов вроде Hebbia и Harvey).

Что такое Gemini 3.6 Flash?

Что нового по сравнению с Gemini 3.5 Flash?

1. Лучшая эффективность по токенам

Gemini 3.6 Flash разработана для использования меньшего числа выходных токенов по сравнению с Gemini 3.5 Flash. Google приводит сокращение на 17% выходных токенов по Artificial Analysis Index и до 65% на отдельных рабочих нагрузках по кодированию в стиле DeepSWE.

Это важно, потому что выходные токены обычно дороже входных. В официальном стандартном прайсинге Gemini API вход для Gemini 3.6 Flash остаётся $1.50/М, но вывод снижается до $7.50/М. У Gemini 3.5 Flash вывод — $9.00/М. Комбинация более низкой цены вывода и меньшего числа выходных токенов существенно снижает стоимость за завершённую задачу агента.

2. Более сильное кодирование и меньше нежелательных правок

Документация Google Cloud по Gemini Enterprise Agent Platform утверждает, что Gemini 3.6 Flash улучшает генерацию кода с меньшими показателями отказов компиляции и числа ревизий в сценариях сборки, прототипирования и IDE‑агентов. Также снижается «action bias», то есть модель лучше справляется с задачами диагностики в режиме «только чтение», не совершая непрошенных правок.

  • Улучшения рабочих процессов: меньше шагов рассуждений, диалоговых ходов, вызовов инструментов и меньше спирали циклов выполнения. Предпочитает предварительные диагностические скрипты перед правками, повышая точность.
  • Генерация кода: более качественный, готовый к продакшену код с меньшим числом нежелательных правок и отладочных циклов.
  • Computer Use: улучшение с 78.4% до 83.0% на OSWorld‑Verified; нативная поддержка клиентских инструментов.

3. Улучшение качества и скорости

Агентные улучшения: меньше шагов рассуждений/вызовов инструментов; встроенный «computer use»; лучшая поддержка многоагентной оркестрации и итеративных рабочих процессов.

Скорость и надёжность: оптимизированные задержки для высоких объёмов; интеграции с инструментами вроде Google Slides для создания редактируемых презентаций из документов/PDF.

Безопасность: улучшенные меры защиты против C

4. Более низкая цена за вывод

Google снизила официальную стандартную цену вывода с $9.00/М у Gemini 3.5 Flash до $7.50/М у Gemini 3.6 Flash. Цена входа осталась $1.50/М.

Это напрямую улучшает стоимость ещё до учёта выгод от эффективности по токенам.

5. Миграция и изменения параметров

Некоторое поведение может отличаться от более ранних моделей Gemini. Страница Agent Platform в Google Cloud отмечает потенциально ломающие изменения: нестандартные значения параметров, таких как temperature, top‑K и top‑P, не поддерживаются в этом интерфейсе; нестандартные значения frequency и presence penalty могут приводить к ошибкам; запросы, оканчивающиеся на роль модели, не поддерживаются в отдельных API.

Вывод по миграции прост: не ограничивайтесь заменой строки модели. Проверьте точный API‑интерфейс, который вы используете, удалите неподдерживаемые параметры генерации, протестируйте обработку состояния в многоходовых диалогах и проверьте поведение вызова инструментов.

Может ли Gemini 3.6 Flash заменить Gemini 3.5 Flash?

Да, для большинства production‑сценариев. Фактически Google позиционирует 3.6 Flash как новую рабочую модель по умолчанию, а 3.5 Flash во многих интерфейсах вероятно станет устаревшей или «legacy».

Причины перейти:

  • Экономия: более низкая стоимость за задачу благодаря цене + эффективности.
  • Лучшие результаты: улучшенные метрики качества для кодинга, агентов и знаниевых задач.
  • «На будущее»: новые возможности, такие как расширенный «computer use» и интеграции.

Когда остаться на 3.5 или рассмотреть альтернативы:

  • Экстремально чувствительные к задержкам высокообъёмные задачи (рассмотрите компаньона 3.5 Flash‑Lite с ещё меньшими затратами/задержками).
  • Нужен максимум «сырого» интеллекта (дождитесь 3.5 Pro или используйте более крупные модели).
  • Специфическая наследуемая совместимость.

Для большинства разработчиков, создающих агентов, приложения или автоматизацию на Cometapi, миграция на 3.6 Flash через прокси проста и рекомендована для немедленной окупаемости.

Как получить доступ к Gemini 3.6 Flash

  1. Google AI Studio / Gemini API: получите бесплатный API‑ключ на aistudio.google.com. Используйте модель gemini-3.6-flash. Быстрый старт через официальные SDK (Python, JS и др.).
  2. Vertex AI / Google Cloud: корпоративный уровень с более высокими квотами, grounding и безопасностью.
  3. Приложение Gemini и интеграции: доступно в Android Studio, GitHub Copilot (с переключателями), Google Slides и др.
  4. Через Cometapi (рекомендуется для удобства): Cometapi предоставляет унифицированный, совместимый с OpenAI прокси для Gemini 3.6 Flash и других моделей. Преимущества: более высокие лимиты, упрощённая аутентификация, переключение между провайдерами и меньше управленческих затрат. Подходит для масштабирования приложений без упора в лимиты отдельных провайдеров. Посетите Cometapi.com для гайдов по настройке и прайсинга, дополняющего тарифы Google.

Пример вызова на Python (официально или через прокси):

import google.generativeai as genai
genai.configure(api_key="YOUR_KEY")
model = genai.GenerativeModel('gemini-3.6-flash')
response = model.generate_content("Your prompt here")

Сначала протестируйте в AI Studio, затем интегрируйте. Кэширование и batch‑API дополнительно оптимизируют затраты.

Выводы и рекомендации

Gemini 3.6 Flash — прагматичное и выгодное обновление, которое совершенствует линейку Flash от Google под реальные задачи. Сочетание интеллекта, эффективности и доступности делает её одним из лучших выборов для разработки ИИ в 2026 году.

Рекомендация CometAPI: интегрируйте через Cometapi для максимально гладкого опыта — унифицированный API, лучшие квоты и простое A/B‑тестирование моделей. Независимо от того, строите ли вы агентов, обрабатываете документы или питаете приложения, начните экспериментировать с 3.6 Flash уже сегодня, чтобы снизить затраты и повысить производительность.

FAQ

Что такое Gemini 3.6 Flash?

Gemini 3.6 Flash — стабильная модель уровня Flash от Google (июль 2026) для кодинга, знаниевой работы, мультимодального рассуждения и агентных рабочих процессов. Основана на Gemini 3.5 Flash, но улучшает эффективность по токенам, поведение при кодировании, показатели «computer use» и бенчмарки по знаниевой работе.

Сколько стоит Gemini 3.6 Flash?

Официальные цены стандартного платного тарифа Gemini API от Google — $1.50 за миллион входных токенов и $7.50 за миллион выходных токенов. Batch и Flex — $0.75/М вход и $3.75/М выход. Priority — $2.70/М вход и $13.50/М выход. На странице модели CometAPI указано $1.20/М вход и $6.00/М выход на момент проверки.

Дешевле ли Gemini 3.6 Flash, чем Gemini 3.5 Flash?

Да для выходных токенов. Обе модели в стандартном платном тарифе Google стоят $1.50/М за вход, но у Gemini 3.6 Flash вывод — $7.50/М против $9.00/М у Gemini 3.5 Flash. Google также сообщает о меньшем числе выходных токенов во многих задачах, что ещё сильнее снижает итоговую стоимость.

Может ли Gemini 3.6 Flash заменить Gemini 3.5 Flash?

Для многих нагрузок — да. Это лучший кандидат по умолчанию для кодирующих агентов, мультимодального анализа и сложных инструментальных рабочих процессов. Однако производственным пользователям стоит провести бенчмарки перед заменой 3.5 Flash, особенно если они зависят от стабильного стиля вывода, точного форматирования JSON или наследуемых параметров генерации.

Каковы основные улучшения в бенчмарках?

Google сообщает, что Gemini 3.6 Flash превосходит Gemini 3.5 Flash на DeepSWE (49% против 37%), MLE Bench (63.9% против 49.7%), OSWorld‑Verified (83.0% против 78.4%) и GDPval‑AA v2 (1421 против 1349). Также сообщается о 17% меньшем количестве выходных токенов по Artificial Analysis Index.

Как получить доступ к Gemini 3.6 Flash через CometAPI?

Создайте ключ CometAPI, используйте https://api.cometapi.com/v1 для совместимых с OpenAI вызовов и установите модель gemini-3.6-flash, если она доступна в вашей панели. Для нативных возможностей Gemini используйте маршрут провайдера, описанный на странице модели Gemini 3.6 Flash у CometAPI.

Готовы сократить затраты на AI-разработку на 20%?

Начните бесплатно за несколько минут. Пробные кредиты включены. Карта не нужна.

Читать далее