GPT-6 Astra is now live on CometAPI →
technology/Исследования CometAPI

Что такое Gemini 3.8 Flash? Характеристики, бенчмарки, цены и что изменилось

Изучите ценообразование API Gemini 3.8 Flash, спецификации, контекст на 1M токенов, бенчмарки, уровни рассуждений, мультимодальный ввод, инструменты, ограничения, сравнение с Gemini 3.7.

CometAPI
Mia MarenКоманда исследователей AI-моделей и API
Обновлено Sep 6, 2026 13 мин. чтения
Что такое Gemini 3.8 Flash? Характеристики, бенчмарки, цены и что изменилось
Использовать этот подход

Сделайте первый вызов API.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

Краткое резюме

Gemini 3.8 Flash — это производственное обновление класса Flash от Google для сложного кодинга, агентных сценариев и мультимодальной работы. Модель сохраняет контекст на 1M токенов из Gemini 3.7 Flash, уделяя больше внимания глубинному рассуждению, более устойчивому использованию инструментов и более высокой доле завершения задач с длинным горизонтом.

Ключевые выводы

1,048,576 входных токенов и 65,536 выходных токенов, поддержка ввода текста, изображений, видео, аудио и PDF.

• По данным Google, 73.7% на DeepSWE v1.1, против 65.3% у Gemini 3.7 Flash в том же сравнении.

• Вводный стандартный тариф — $0.75 за 1M входных токенов и $3.75 за 1M выходных токенов до 31 декабря 2026 года.

• Обновляйтесь, когда сложные задачи выигрывают от повторных попыток, верификации и многократного использования инструментов; сохраняйте 3.7 для короткого, предсказуемого, чувствительного к задержкам трафика.

Google выпустила Gemini 3.8 Flash 2 сентября 2026 года, через три недели после Gemini 3.7 Flash. Компания позиционирует её как самую интеллектуальную модель класса Flash для кодинга, агентов, мультимодального рассуждения и профессиональных рабочих процессов.

Релиз — это не просто расширение окна контекста. Построенная непосредственно на базе Gemini 3.7 Flash, новая модель тратит больше вычислительных ресурсов на сложные задачи, выполняет дополнительные шаги рассуждения и более устойчиво использует инструменты.

Этот дизайн создаёт практический компромисс: более высокая доля завершения на работах с длинным горизонтом, но потенциально больше токенов рассуждения и задержки на задачу. Это руководство фокусируется на дельте, специфичной для 3.8 — спецификациях, официальных результатах бенчмарков, ценах и решениях об обновлении — не повторяя общий обзор Gemini 3.7, уже опубликованный на CometAPI.

Что такое Gemini 3.8 Flash? Характеристики, бенчмарки, цены и что изменилось

Official Google launch image - Gemini 3.8 Flash and 3.8 Flash Cyber

Что такое Gemini 3.8 Flash?

Gemini 3.8 Flash — производственная модель класса Flash от Google для программной инженерии с длинным горизонтом, автономных агентов, мультимодального анализа и профессиональной интеллектуальной работы. Её отличительная черта — устойчивость: она может инспектировать промежуточные результаты, многократно вызывать инструменты, исправлять неудачный шаг и продолжать движение к общей цели.

Модель доступна через Gemini API и Google AI Studio. В анонсе также указана доступность в приложении Gemini, на Gemini Enterprise Agent Platform, в AI Mode и Google Antigravity.

Характеристики Gemini 3.8 Flash

Техническая рамка знакома пользователям Gemini 3.7 Flash. Ниже суммированы наиболее полезные производственные спецификации; низкоприоритетный перечень всех неподдерживаемых режимов генерации исключён.

Официальная спецификацияGemini 3.8 Flash
Стабильный ID моделиgemini-3.8-flash
Статус релизаОбщая доступность
Максимальный ввод1,048,576 токенов
Максимальный вывод65,536 токенов
Модальности вводаТекст, изображение, видео, аудио и PDF
Модальность выводаТекст
Уровни размышленияНизкий, средний и высокий; по умолчанию — средний
Базовые инструментыВызов функций, выполнение кода, структурированный вывод, привязка к поиску, контекст URL и поиск по файлам
Использование компьютераПоддерживается в предварительной версии
Срез знанийМарт 2026 года для некоторых доменов; часть знаний может оставаться на уровне января 2025 года

Google подтверждает лимит на 1,048,576 токенов ввода и 65,536 токенов вывода. Поскольку 3.7 предлагает тот же объём контекста, размер контекста сам по себе не является причиной миграции; кейс обновления основан на качестве рассуждения и завершения задач.

Что нового в Gemini 3.8 Flash?

Gemini 3.8 Flash сохраняет ёмкость контекста прошлого поколения, но меняет то, как модель рассуждает, использует инструменты и завершает длинные рабочие процессы. Основные отличия — в четырёх операционных поведениях.

Более глубокое рассуждение

По словам Google, модель может выполнять дополнительные шаги рассуждения, когда задача усложняется. Агент по кодингу или исследованиям может изучать промежуточные доказательства, пересматривать подход и проверять результат вместо того, чтобы соглашаться с первым правдоподобным ответом.

Агентное исполнение

Gemini 3.8 Flash создана для устойчивого прохождения многошаговой работы с поиском, выполнением кода, вызовами функций, инспекцией ошибок и восстановлением. Это делает обновление особенно важным, когда успех зависит от завершения всего рабочего процесса с инструментами, а не от одного изолированного ответа.

Уровни размышления

Производственная модель предоставляет низкий, средний и высокий уровни размышления, по умолчанию — средний. Команды могут использовать низкий уровень для рутинных запросов и оставлять более высокий для задач, где качество завершения важнее задержки или расхода токенов.

Мультимодальные рабочие процессы

Модель может комбинировать текст, изображения, видео, аудио и PDF с вызовом функций, выполнением кода, привязкой к поиску, контекстом по URL и структурированным выводом. Улучшение — не новая медиамодель, а более устойчивая цепочка рассуждений по смешанным данным и инструментам. В том же релизе также представлена отдельная модель Gemini 3.8 Flash Cyber для одобренной оборонительной кибербезопасности.

Чем отличается от Gemini 3.7 Flash?

Для общих возможностей и контекста развёртывания предыдущей модели см. обзор Gemini 3.7 Flash на CometAPI. Изменения, специфичные для 3.8, уже́ более узкие и операционные.

Более устойчивая цепочка рассуждений

Google отмечает, что Gemini 3.8 Flash может выполнять дополнительные шаги рассуждения на сложных задачах. Агент в репозитории может изучать зависимости, редактировать несколько файлов, запускать тесты, диагностировать сбой, дорабатывать патч и снова проверять результат вместо остановки после первого правдоподобного ответа.

Более итеративное использование инструментов

Модель чаще вызывает инструменты повторно по мере изменения доказательств. Это важно для автоматизации браузера, исследований, кодинга и документных сценариев, где корректный следующий шаг зависит от результата предыдущего инструмента.

Более высокое качество на уровне задач, потенциально больший расход токенов

Google также предупреждает, что модель может потреблять больше токенов, особенно на более высоких уровнях размышления. Поэтому Gemini 3.7 Flash остаётся опцией с приоритетом эффективности для коротких предсказуемых потоков, тогда как 3.8 лучше подходит для задач, где повторные попытки и верификация повышают вероятность успешного завершения.

Без расширения окна контекста

Обе генерации сохраняют один и тот же класс: 1M токенов ввода и 64K токенов вывода. Обновление касается поведения, а не простого увеличения ёмкости промпта.

Gemini 3.8 Flash vs Gemini 3.7 Flash — сравнительная таблица — кому стоит обновиться

Поскольку у обоих поколений одинаковый класс контекста, решение об обновлении следует основывать на завершении задач, устойчивости в использовании инструментов, задержках и расходе токенов, а не только на размере промпта.

Измерение сравненияGemini 3.8 FlashGemini 3.7 FlashВлияние на решение
ПозиционированиеСамая интеллектуальная производственная модель класса FlashПредыдущее поколение Flash с приоритетом эффективности3.8 ориентирована на более сложную сквозную работу
Ёмкость контекста1,048,576 вход; 65,536 выходных токеновТот же класс: 1M вход / 64K выходМиграция не требуется из‑за ёмкости
DeepSWE v1.173.7%65.3%3.8 имеет более сильный результат для кодирующих агентов
Рассуждение и инструментыБольше шагов рассуждения и устойчивое многопрофильное использованиеЛучше подходит для коротких предсказуемых потоков3.8 предпочтительнее, когда важны повторы и верификация
Профиль токенов и задержекМожет использовать больше токенов, особенно на высоких уровняхВ целом более лёгкая опция для рутинного трафикаСчитайте стоимость за выполненную задачу, а не цену токена
Оптимальные нагрузкиРепозитории кода, исследования, мультимодальный анализ, мультиинструментные агентыКлассификация, извлечение, короткие черновики, стабильные автоматикиМаршрутизируйте по типу нагрузки вместо замены 3.7 везде

Кому стоит обновиться?

Оценивайте Gemini 3.8 Flash уже сейчас, если вы запускаете кодинг на уровне репозиториев, мультиинструментальную автоматизацию, профессиональные исследования, мультимодальный анализ или рабочие процессы, которые часто эскалируют до премиальной модели. Сохраняйте Gemini 3.7 Flash для коротких, повторяющихся, чувствительных к задержкам задач, которые уже стабильно успешны.

Практичный маршрутизатор может отправлять сложные или неудавшиеся задачи в 3.8, оставляя трафик с приоритетом эффективности на 3.7. Измеряйте долю принятых задач, сквозную задержку, число вызовов инструментов и суммарные токены перед изменением модели по умолчанию.

Официальная производительность бенчмарков Gemini 3.8 Flash

Опубликованные оценки Google показывают наиболее явные улучшения в кодинге с длинным горизонтом, работе в терминале, профессиональных агентах, экспертном рассуждении и использовании компьютера.

Что такое Gemini 3.8 Flash? Характеристики, бенчмарки, цены и что изменилось

Официальная графика оценки Gemini 3.8 Flash от Google DeepMind

Где Gemini 3.8 Flash лидирует

На DeepSWE v1.1, 73.7% против 65.3% — это прирост на 8.4 пункта по поколению и почти соответствие Claude Opus 5 с 74.0%. На Terminal-Bench 2.1 — 89.4%, немного выше показанного 89.1% у Opus 5. Vals Finance Agent v2 и бенчмарк юридического агента также в пользу 3.8 в сравнении от Google.

Где премиальная модель по‑прежнему лидирует

Результат не универсален. Claude Opus 5 достигает 51.8% на Terminal-Bench 4.0 против 19.1% у Gemini 3.8 Flash и 75.4% на OSWorld-2.0 против 59.0%. Данные подтверждают преимущество Gemini 3.8 Flash по соотношению цена/возможности, но не утверждают, что она заменяет каждую премиальную фронтирную модель.

Итог по бенчмаркам

Gemini 3.8 Flash сильнее всего, когда нагрузка напоминает кодинг с длинным горизонтом или специализированного профессионального агента. Для сложных сред использования компьютера и некоторых задач терминала Claude Opus 5 остаётся более сильным выбором. В проде команды должны валидировать по доле принятых задач, задержке и суммарному потреблению токенов, а не по одному среднему бенчмарку.

Ценообразование Gemini 3.8 Flash и стоимость за выполненную задачу

Gemini 3.8 Flash стартует по тому же вводному тарифу за токены, что и 3.7, однако идентичная цена за токен не гарантирует одинаковую стоимость задачи, поскольку 3.8 может дольше рассуждать.

Режим ценообразования GoogleВвод / 1M токеновВывод / 1M токеновКэшированный ввод / 1M токенов
Стандарт до 31 дек. 2026$0.75$3.75$0.075
Стандарт с 1 янв. 2027$1.50$7.50$0.15
Batch до 31 дек. 2026$0.375$1.875$0.0375
Flex до 31 дек. 2026$0.375$1.875$0.0375

На официальной странице цен указано, что цены за вывод включают токены размышления. Оценивайте стоимость за принятую задачу: дополнительное рассуждение может быть экономичным, если оно предотвращает неудавшийся запуск или переход к премиальной модели, но избыточным для классификации, извлечения или короткого чата.

МаршрутВвод / 1M токеновВывод / 1M токенов
Вводная цена Google$0.75$3.75
Цена на CometAPI$0.60$3.00
Номинальная разницаНа 20% нижеНа 20% ниже

Страница Gemini 3.8 Flash на CometAPI содержит актуальные цены и доступность по маршруту. Поскольку цены провайдеров могут меняться, подтверждайте актуальность на странице модели перед бюджетированием продовой нагрузки.

Gemini 3.8 Flash vs Claude Opus 5 и Sonnet 5

Измерение решенияGemini 3.8 FlashGemini 3.7 FlashClaude Opus 5Claude Sonnet 5
ПозиционированиеFlash с высоким интеллектомFlash с приоритетом эффективностиПремиальное фронтирное рассуждениеСбалансированный производственный агент
Класс контекста1M1M1M1M
Кодинг с длинным горизонтомПочти как Opus 5 на DeepSWEСильный, но нижеНаиболее сильный в целомНиже в таблице Google
Использование компьютераУлучшеноНижеЯвный лидер на OSWorld-2.0Ниже Gemini 3.8 в таблице Google
Поведение рассужденияУстойчивое, более итеративноеБольше про эффективностьГлубокое премиальное рассуждениеСбалансированные качество и скорость
Вероятно лучший выборНедорогие, но сложные агентыМассовые предсказуемые задачиСамые сложные задачи терминала/ПК при оправданной экономикеОбщие производственные агенты

Результат зависит от характера нагрузки. Выбирайте 3.8 для сложной работы, которая выигрывает от повторов; сохраняйте 3.7 для предсказуемого трафика с большим объёмом; используйте Opus 5, когда пик возможностей в терминале/ПК оправдывает премиальную экономику; тестируйте Sonnet 5 для предпочтительного сбалансированного деплоя Claude.

Сценарии использования Gemini 3.8 Flash: что умеет модель?

Ввод текста, изображений, видео, аудио и PDF можно комбинировать с вызовом функций, выполнением кода, привязкой к поиску, контекстом URL, поиском по файлам и структурированным выводом. Преимущество 3.8 — в том, насколько устойчиво модель связывает эти возможности в единый рабочий процесс.

Кодинг

Предоставьте исходники, архитектурные заметки, историю инцидентов и вывод тестов в одном рабочем контексте. Модель может изучать зависимости, редактировать несколько файлов, запускать тесты, диагностировать сбои, дорабатывать патч и проверять результат. Оценивайте число принятых исправлений за запуск, а не только первый сгенерированный патч.

Агенты

Используйте Gemini 3.8 Flash для процессов, которым нужно планировать, вызывать несколько инструментов, инспектировать изменившееся состояние и восстанавливаться после неудачных шагов. В проде у агентов должны быть права на инструменты, лимиты шагов, этапы одобрения и журналы аудита, чтобы устойчивость не превратилась в неконтролируемые действия.

Исследования

Комбинируйте PDF, документы с политиками, публичные URL и внутренние доказательства, затем используйте поиск по файлам и привязанный к источникам поиск, чтобы сравнить источники и вернуть проверяемую памятку или структурированную запись. Сохраняйте фрагменты источников и требуйте ручную проверку для юридических, финансовых и комплаенс-решений.

Мультимодальные рабочие процессы

Сервисная или операционная линия может сочетать скриншоты, записи звонков, видео, PDF и текст, извлекать релевантные данные, классифицировать кейс и готовить структурированную передачу. Порог уверенности и правила эскалации важны, если данные неполные или противоречивые.

Использование компьютера

В браузерных сценариях модель может интерпретировать страницу, выбрать следующее действие, вызвать инструмент, проинспектировать новое состояние и восстановиться при неудаче шага. Поскольку использование компьютера пока в предварительной версии, сохраняйте этапы одобрения для покупок, отправок, изменений в аккаунтах и других необратимых действий.

Ограничения

Большее рассуждение может увеличивать потребление токенов и задержку. Официальная карта модели также отмечает галлюцинации и периодическую медлительность или таймауты. Указанный срез знаний требует внимания: март 2026 года применяется к некоторым доменам, тогда как часть знаний может оставаться на уровне января 2025 года.

Модель генерирует текст, а не нативные изображения или аудио, и не поддерживает Live API. Автоматическая оценка безопасности Google также сообщает о регрессе на 5.4 пункта в Multilingual Safety, где меньше — лучше; это требует дополнительного мультиязычного тестирования перед продовым развёртыванием.

Часто задаваемые вопросы

Каков идентификатор модели Gemini 3.8 Flash?

Стабильный ID модели в API — gemini-3.8-flash.

Какой размер окна контекста?

Поддерживается до 1,048,576 входных токенов и 65,536 выходных токенов.

Является ли Gemini 3.8 Flash лучше, чем Gemini 3.7 Flash?

Модель сильнее на большинстве опубликованных Google бенчмарков для агентов и профессиональных задач, но 3.7 может быть более эффективной для простых задач.

Лучше ли Gemini 3.8 Flash, чем Claude Opus 5?

В сравнениях Google она почти соответствует или слегка лидирует над Opus 5 на некоторых результатах по кодингу, тогда как Opus 5 существенно лидирует на Terminal-Bench 4.0 и OSWorld-2.0.

Генерирует ли она изображения или аудио?

Нет. Модель принимает мультимодальный ввод, но возвращает текстовый вывод.

Выводы

Gemini 3.8 Flash — это обновление по рассуждению и устойчивости на базе 3.7, а не редизайн с большим контекстом. Наиболее убедительные результаты — в кодинге с длинным горизонтом и специализированных агентах; наиболее заметные пробелы — в сложных средах терминала и использования компьютера, где Claude Opus 5 может лидировать.

Для продовых команд решающая метрика — не цена за токен, а стоимость за принятую задачу. Протестируйте Gemini 3.8 Flash на CometAPI в сравнении с 3.7 и релевантной моделью Claude на ваших трассах перед изменением маршрутизации по умолчанию.

SEO-метаданные

Мета-заголовок: What Is Gemini 3.8 Flash? Specs, Benchmarks & Pricing

Мета-описание: Исследуйте цены Gemini 3.8 Flash API, спецификации, контекст на 1M токенов, бенчмарки, уровни размышления, мультимодальный ввод, инструменты, ограничения и сравнения с Gemini 3.7.

Ключевые слова: Gemini 3.8 Flash, Gemini 3.8 Flash API, Gemini 3.8, бенчмарки Gemini 3.8 Flash, цены Gemini 3.8 Flash, Gemini 3.8 Flash vs Gemini 3.7 Flash, Gemini Flash, Google Gemini API, модель кодинга Gemini, модель AI-агента

URL slug: what-is-gemini-3-8-flash

Продолжить обучение

Свяжите эту статью со следующим решением.

Посмотреть все темы
Опубликовано Sep 4, 2026
Последнее обновление Sep 6, 2026
20 просмотров
Проверено на ясность, указание источников и актуальную терминологию API.

Готовы сократить затраты на AI-разработку на 20%?

Начните бесплатно за несколько минут. Пробные кредиты включены. Карта не нужна.

Читать далее