Краткое резюме
Gemini 3.8 Flash — это производственное обновление класса Flash от Google для сложного кодинга, агентных сценариев и мультимодальной работы. Модель сохраняет контекст на 1M токенов из Gemini 3.7 Flash, уделяя больше внимания глубинному рассуждению, более устойчивому использованию инструментов и более высокой доле завершения задач с длинным горизонтом.
Ключевые выводы
• 1,048,576 входных токенов и 65,536 выходных токенов, поддержка ввода текста, изображений, видео, аудио и PDF.
• По данным Google, 73.7% на DeepSWE v1.1, против 65.3% у Gemini 3.7 Flash в том же сравнении.
• Вводный стандартный тариф — $0.75 за 1M входных токенов и $3.75 за 1M выходных токенов до 31 декабря 2026 года.
• Обновляйтесь, когда сложные задачи выигрывают от повторных попыток, верификации и многократного использования инструментов; сохраняйте 3.7 для короткого, предсказуемого, чувствительного к задержкам трафика.
Google выпустила Gemini 3.8 Flash 2 сентября 2026 года, через три недели после Gemini 3.7 Flash. Компания позиционирует её как самую интеллектуальную модель класса Flash для кодинга, агентов, мультимодального рассуждения и профессиональных рабочих процессов.
Релиз — это не просто расширение окна контекста. Построенная непосредственно на базе Gemini 3.7 Flash, новая модель тратит больше вычислительных ресурсов на сложные задачи, выполняет дополнительные шаги рассуждения и более устойчиво использует инструменты.
Этот дизайн создаёт практический компромисс: более высокая доля завершения на работах с длинным горизонтом, но потенциально больше токенов рассуждения и задержки на задачу. Это руководство фокусируется на дельте, специфичной для 3.8 — спецификациях, официальных результатах бенчмарков, ценах и решениях об обновлении — не повторяя общий обзор Gemini 3.7, уже опубликованный на CometAPI.
Official Google launch image - Gemini 3.8 Flash and 3.8 Flash Cyber
Что такое Gemini 3.8 Flash?
Gemini 3.8 Flash — производственная модель класса Flash от Google для программной инженерии с длинным горизонтом, автономных агентов, мультимодального анализа и профессиональной интеллектуальной работы. Её отличительная черта — устойчивость: она может инспектировать промежуточные результаты, многократно вызывать инструменты, исправлять неудачный шаг и продолжать движение к общей цели.
Модель доступна через Gemini API и Google AI Studio. В анонсе также указана доступность в приложении Gemini, на Gemini Enterprise Agent Platform, в AI Mode и Google Antigravity.
Характеристики Gemini 3.8 Flash
Техническая рамка знакома пользователям Gemini 3.7 Flash. Ниже суммированы наиболее полезные производственные спецификации; низкоприоритетный перечень всех неподдерживаемых режимов генерации исключён.
| Официальная спецификация | Gemini 3.8 Flash |
|---|---|
| Стабильный ID модели | gemini-3.8-flash |
| Статус релиза | Общая доступность |
| Максимальный ввод | 1,048,576 токенов |
| Максимальный вывод | 65,536 токенов |
| Модальности ввода | Текст, изображение, видео, аудио и PDF |
| Модальность вывода | Текст |
| Уровни размышления | Низкий, средний и высокий; по умолчанию — средний |
| Базовые инструменты | Вызов функций, выполнение кода, структурированный вывод, привязка к поиску, контекст URL и поиск по файлам |
| Использование компьютера | Поддерживается в предварительной версии |
| Срез знаний | Март 2026 года для некоторых доменов; часть знаний может оставаться на уровне января 2025 года |
Google подтверждает лимит на 1,048,576 токенов ввода и 65,536 токенов вывода. Поскольку 3.7 предлагает тот же объём контекста, размер контекста сам по себе не является причиной миграции; кейс обновления основан на качестве рассуждения и завершения задач.
Что нового в Gemini 3.8 Flash?
Gemini 3.8 Flash сохраняет ёмкость контекста прошлого поколения, но меняет то, как модель рассуждает, использует инструменты и завершает длинные рабочие процессы. Основные отличия — в четырёх операционных поведениях.
Более глубокое рассуждение
По словам Google, модель может выполнять дополнительные шаги рассуждения, когда задача усложняется. Агент по кодингу или исследованиям может изучать промежуточные доказательства, пересматривать подход и проверять результат вместо того, чтобы соглашаться с первым правдоподобным ответом.
Агентное исполнение
Gemini 3.8 Flash создана для устойчивого прохождения многошаговой работы с поиском, выполнением кода, вызовами функций, инспекцией ошибок и восстановлением. Это делает обновление особенно важным, когда успех зависит от завершения всего рабочего процесса с инструментами, а не от одного изолированного ответа.
Уровни размышления
Производственная модель предоставляет низкий, средний и высокий уровни размышления, по умолчанию — средний. Команды могут использовать низкий уровень для рутинных запросов и оставлять более высокий для задач, где качество завершения важнее задержки или расхода токенов.
Мультимодальные рабочие процессы
Модель может комбинировать текст, изображения, видео, аудио и PDF с вызовом функций, выполнением кода, привязкой к поиску, контекстом по URL и структурированным выводом. Улучшение — не новая медиамодель, а более устойчивая цепочка рассуждений по смешанным данным и инструментам. В том же релизе также представлена отдельная модель Gemini 3.8 Flash Cyber для одобренной оборонительной кибербезопасности.
Чем отличается от Gemini 3.7 Flash?
Для общих возможностей и контекста развёртывания предыдущей модели см. обзор Gemini 3.7 Flash на CometAPI. Изменения, специфичные для 3.8, уже́ более узкие и операционные.
Более устойчивая цепочка рассуждений
Google отмечает, что Gemini 3.8 Flash может выполнять дополнительные шаги рассуждения на сложных задачах. Агент в репозитории может изучать зависимости, редактировать несколько файлов, запускать тесты, диагностировать сбой, дорабатывать патч и снова проверять результат вместо остановки после первого правдоподобного ответа.
Более итеративное использование инструментов
Модель чаще вызывает инструменты повторно по мере изменения доказательств. Это важно для автоматизации браузера, исследований, кодинга и документных сценариев, где корректный следующий шаг зависит от результата предыдущего инструмента.
Более высокое качество на уровне задач, потенциально больший расход токенов
Google также предупреждает, что модель может потреблять больше токенов, особенно на более высоких уровнях размышления. Поэтому Gemini 3.7 Flash остаётся опцией с приоритетом эффективности для коротких предсказуемых потоков, тогда как 3.8 лучше подходит для задач, где повторные попытки и верификация повышают вероятность успешного завершения.
Без расширения окна контекста
Обе генерации сохраняют один и тот же класс: 1M токенов ввода и 64K токенов вывода. Обновление касается поведения, а не простого увеличения ёмкости промпта.
Gemini 3.8 Flash vs Gemini 3.7 Flash — сравнительная таблица — кому стоит обновиться
Поскольку у обоих поколений одинаковый класс контекста, решение об обновлении следует основывать на завершении задач, устойчивости в использовании инструментов, задержках и расходе токенов, а не только на размере промпта.
| Измерение сравнения | Gemini 3.8 Flash | Gemini 3.7 Flash | Влияние на решение |
|---|---|---|---|
| Позиционирование | Самая интеллектуальная производственная модель класса Flash | Предыдущее поколение Flash с приоритетом эффективности | 3.8 ориентирована на более сложную сквозную работу |
| Ёмкость контекста | 1,048,576 вход; 65,536 выходных токенов | Тот же класс: 1M вход / 64K выход | Миграция не требуется из‑за ёмкости |
| DeepSWE v1.1 | 73.7% | 65.3% | 3.8 имеет более сильный результат для кодирующих агентов |
| Рассуждение и инструменты | Больше шагов рассуждения и устойчивое многопрофильное использование | Лучше подходит для коротких предсказуемых потоков | 3.8 предпочтительнее, когда важны повторы и верификация |
| Профиль токенов и задержек | Может использовать больше токенов, особенно на высоких уровнях | В целом более лёгкая опция для рутинного трафика | Считайте стоимость за выполненную задачу, а не цену токена |
| Оптимальные нагрузки | Репозитории кода, исследования, мультимодальный анализ, мультиинструментные агенты | Классификация, извлечение, короткие черновики, стабильные автоматики | Маршрутизируйте по типу нагрузки вместо замены 3.7 везде |
Кому стоит обновиться?
Оценивайте Gemini 3.8 Flash уже сейчас, если вы запускаете кодинг на уровне репозиториев, мультиинструментальную автоматизацию, профессиональные исследования, мультимодальный анализ или рабочие процессы, которые часто эскалируют до премиальной модели. Сохраняйте Gemini 3.7 Flash для коротких, повторяющихся, чувствительных к задержкам задач, которые уже стабильно успешны.
Практичный маршрутизатор может отправлять сложные или неудавшиеся задачи в 3.8, оставляя трафик с приоритетом эффективности на 3.7. Измеряйте долю принятых задач, сквозную задержку, число вызовов инструментов и суммарные токены перед изменением модели по умолчанию.
Официальная производительность бенчмарков Gemini 3.8 Flash
Опубликованные оценки Google показывают наиболее явные улучшения в кодинге с длинным горизонтом, работе в терминале, профессиональных агентах, экспертном рассуждении и использовании компьютера.

Официальная графика оценки Gemini 3.8 Flash от Google DeepMind
Где Gemini 3.8 Flash лидирует
На DeepSWE v1.1, 73.7% против 65.3% — это прирост на 8.4 пункта по поколению и почти соответствие Claude Opus 5 с 74.0%. На Terminal-Bench 2.1 — 89.4%, немного выше показанного 89.1% у Opus 5. Vals Finance Agent v2 и бенчмарк юридического агента также в пользу 3.8 в сравнении от Google.
Где премиальная модель по‑прежнему лидирует
Результат не универсален. Claude Opus 5 достигает 51.8% на Terminal-Bench 4.0 против 19.1% у Gemini 3.8 Flash и 75.4% на OSWorld-2.0 против 59.0%. Данные подтверждают преимущество Gemini 3.8 Flash по соотношению цена/возможности, но не утверждают, что она заменяет каждую премиальную фронтирную модель.
Итог по бенчмаркам
Gemini 3.8 Flash сильнее всего, когда нагрузка напоминает кодинг с длинным горизонтом или специализированного профессионального агента. Для сложных сред использования компьютера и некоторых задач терминала Claude Opus 5 остаётся более сильным выбором. В проде команды должны валидировать по доле принятых задач, задержке и суммарному потреблению токенов, а не по одному среднему бенчмарку.
Ценообразование Gemini 3.8 Flash и стоимость за выполненную задачу
Gemini 3.8 Flash стартует по тому же вводному тарифу за токены, что и 3.7, однако идентичная цена за токен не гарантирует одинаковую стоимость задачи, поскольку 3.8 может дольше рассуждать.
| Режим ценообразования Google | Ввод / 1M токенов | Вывод / 1M токенов | Кэшированный ввод / 1M токенов |
|---|---|---|---|
| Стандарт до 31 дек. 2026 | $0.75 | $3.75 | $0.075 |
| Стандарт с 1 янв. 2027 | $1.50 | $7.50 | $0.15 |
| Batch до 31 дек. 2026 | $0.375 | $1.875 | $0.0375 |
| Flex до 31 дек. 2026 | $0.375 | $1.875 | $0.0375 |
На официальной странице цен указано, что цены за вывод включают токены размышления. Оценивайте стоимость за принятую задачу: дополнительное рассуждение может быть экономичным, если оно предотвращает неудавшийся запуск или переход к премиальной модели, но избыточным для классификации, извлечения или короткого чата.
| Маршрут | Ввод / 1M токенов | Вывод / 1M токенов |
|---|---|---|
| Вводная цена Google | $0.75 | $3.75 |
| Цена на CometAPI | $0.60 | $3.00 |
| Номинальная разница | На 20% ниже | На 20% ниже |
Страница Gemini 3.8 Flash на CometAPI содержит актуальные цены и доступность по маршруту. Поскольку цены провайдеров могут меняться, подтверждайте актуальность на странице модели перед бюджетированием продовой нагрузки.
Gemini 3.8 Flash vs Claude Opus 5 и Sonnet 5
| Измерение решения | Gemini 3.8 Flash | Gemini 3.7 Flash | Claude Opus 5 | Claude Sonnet 5 |
|---|---|---|---|---|
| Позиционирование | Flash с высоким интеллектом | Flash с приоритетом эффективности | Премиальное фронтирное рассуждение | Сбалансированный производственный агент |
| Класс контекста | 1M | 1M | 1M | 1M |
| Кодинг с длинным горизонтом | Почти как Opus 5 на DeepSWE | Сильный, но ниже | Наиболее сильный в целом | Ниже в таблице Google |
| Использование компьютера | Улучшено | Ниже | Явный лидер на OSWorld-2.0 | Ниже Gemini 3.8 в таблице Google |
| Поведение рассуждения | Устойчивое, более итеративное | Больше про эффективность | Глубокое премиальное рассуждение | Сбалансированные качество и скорость |
| Вероятно лучший выбор | Недорогие, но сложные агенты | Массовые предсказуемые задачи | Самые сложные задачи терминала/ПК при оправданной экономике | Общие производственные агенты |
Результат зависит от характера нагрузки. Выбирайте 3.8 для сложной работы, которая выигрывает от повторов; сохраняйте 3.7 для предсказуемого трафика с большим объёмом; используйте Opus 5, когда пик возможностей в терминале/ПК оправдывает премиальную экономику; тестируйте Sonnet 5 для предпочтительного сбалансированного деплоя Claude.
Сценарии использования Gemini 3.8 Flash: что умеет модель?
Ввод текста, изображений, видео, аудио и PDF можно комбинировать с вызовом функций, выполнением кода, привязкой к поиску, контекстом URL, поиском по файлам и структурированным выводом. Преимущество 3.8 — в том, насколько устойчиво модель связывает эти возможности в единый рабочий процесс.
Кодинг
Предоставьте исходники, архитектурные заметки, историю инцидентов и вывод тестов в одном рабочем контексте. Модель может изучать зависимости, редактировать несколько файлов, запускать тесты, диагностировать сбои, дорабатывать патч и проверять результат. Оценивайте число принятых исправлений за запуск, а не только первый сгенерированный патч.
Агенты
Используйте Gemini 3.8 Flash для процессов, которым нужно планировать, вызывать несколько инструментов, инспектировать изменившееся состояние и восстанавливаться после неудачных шагов. В проде у агентов должны быть права на инструменты, лимиты шагов, этапы одобрения и журналы аудита, чтобы устойчивость не превратилась в неконтролируемые действия.
Исследования
Комбинируйте PDF, документы с политиками, публичные URL и внутренние доказательства, затем используйте поиск по файлам и привязанный к источникам поиск, чтобы сравнить источники и вернуть проверяемую памятку или структурированную запись. Сохраняйте фрагменты источников и требуйте ручную проверку для юридических, финансовых и комплаенс-решений.
Мультимодальные рабочие процессы
Сервисная или операционная линия может сочетать скриншоты, записи звонков, видео, PDF и текст, извлекать релевантные данные, классифицировать кейс и готовить структурированную передачу. Порог уверенности и правила эскалации важны, если данные неполные или противоречивые.
Использование компьютера
В браузерных сценариях модель может интерпретировать страницу, выбрать следующее действие, вызвать инструмент, проинспектировать новое состояние и восстановиться при неудаче шага. Поскольку использование компьютера пока в предварительной версии, сохраняйте этапы одобрения для покупок, отправок, изменений в аккаунтах и других необратимых действий.
Ограничения
Большее рассуждение может увеличивать потребление токенов и задержку. Официальная карта модели также отмечает галлюцинации и периодическую медлительность или таймауты. Указанный срез знаний требует внимания: март 2026 года применяется к некоторым доменам, тогда как часть знаний может оставаться на уровне января 2025 года.
Модель генерирует текст, а не нативные изображения или аудио, и не поддерживает Live API. Автоматическая оценка безопасности Google также сообщает о регрессе на 5.4 пункта в Multilingual Safety, где меньше — лучше; это требует дополнительного мультиязычного тестирования перед продовым развёртыванием.
Часто задаваемые вопросы
Каков идентификатор модели Gemini 3.8 Flash?
Стабильный ID модели в API — gemini-3.8-flash.
Какой размер окна контекста?
Поддерживается до 1,048,576 входных токенов и 65,536 выходных токенов.
Является ли Gemini 3.8 Flash лучше, чем Gemini 3.7 Flash?
Модель сильнее на большинстве опубликованных Google бенчмарков для агентов и профессиональных задач, но 3.7 может быть более эффективной для простых задач.
Лучше ли Gemini 3.8 Flash, чем Claude Opus 5?
В сравнениях Google она почти соответствует или слегка лидирует над Opus 5 на некоторых результатах по кодингу, тогда как Opus 5 существенно лидирует на Terminal-Bench 4.0 и OSWorld-2.0.
Генерирует ли она изображения или аудио?
Нет. Модель принимает мультимодальный ввод, но возвращает текстовый вывод.
Выводы
Gemini 3.8 Flash — это обновление по рассуждению и устойчивости на базе 3.7, а не редизайн с большим контекстом. Наиболее убедительные результаты — в кодинге с длинным горизонтом и специализированных агентах; наиболее заметные пробелы — в сложных средах терминала и использования компьютера, где Claude Opus 5 может лидировать.
Для продовых команд решающая метрика — не цена за токен, а стоимость за принятую задачу. Протестируйте Gemini 3.8 Flash на CometAPI в сравнении с 3.7 и релевантной моделью Claude на ваших трассах перед изменением маршрутизации по умолчанию.
SEO-метаданные
Мета-заголовок: What Is Gemini 3.8 Flash? Specs, Benchmarks & Pricing
Мета-описание: Исследуйте цены Gemini 3.8 Flash API, спецификации, контекст на 1M токенов, бенчмарки, уровни размышления, мультимодальный ввод, инструменты, ограничения и сравнения с Gemini 3.7.
Ключевые слова: Gemini 3.8 Flash, Gemini 3.8 Flash API, Gemini 3.8, бенчмарки Gemini 3.8 Flash, цены Gemini 3.8 Flash, Gemini 3.8 Flash vs Gemini 3.7 Flash, Gemini Flash, Google Gemini API, модель кодинга Gemini, модель AI-агента
URL slug: what-is-gemini-3-8-flash
