Especificações Técnicas do Gemini 3.7 Flash
| Item | Gemini 3.7 Flash |
|---|---|
| ID do modelo | gemini-3.7-flash |
| Provedor | |
| Contexto | 1.048.576 tokens |
| Saída máxima | 65.536 tokens |
| Entrada | Texto / Imagem / Vídeo / Áudio / PDF |
| Raciocínio | Low / Medium / High |
| Chamadas de função | ✅ |
| Execução de código | ✅ |
| Ancoragem em Pesquisa | ✅ |
| Ancoragem no Google Maps | ✅ |
| Contexto de URL | ✅ |
| Pesquisa de arquivos | ✅ |
| Uso de computador | Prévia |
| Data de corte do conhecimento | Março de 2026 |
| Lançamento | 13 de agosto de 2026 |
O que é o Gemini 3.7 Flash?
O Gemini 3.7 Flash é a iteração de 13 de agosto de 2026 da linha Gemini 3 Flash do Google. O Google o posiciona como seu cavalo de batalha agentivo mais inteligente até agora para codificação e agentes de IA, com melhorias focadas em engenharia de software, desenvolvimento web, trabalho de conhecimento complexo e fluxos de trabalho de múltiplas etapas. Chegou três semanas após o Gemini 3.6 Flash e é descrito como o resultado do feedback de desenvolvedores e de inovações algorítmicas.
Principais recursos
- Contexto de 1M tokens: oferece suporte a repositórios grandes, documentos longos, conversas estendidas e históricos de agentes de múltiplas etapas.
- Raciocínio multimodal: aceita entradas de texto, imagens, vídeo, áudio e PDF.
- Raciocínio configurável: oferece suporte a LOW, MEDIUM e HIGH;
MINIMALnão é compatível. - Codificação agentiva: grandes avanços em depuração, resolução de problemas, precisão do código na primeira tentativa e engenharia de software de longo prazo.
- Desenvolvimento Web e de UI: maior fidelidade a capturas de tela, imagens e sistemas de design.
- Fluxos de trabalho orientados por ferramentas: chamadas de função, execução de código, ancoragem em pesquisa, ancoragem no Google Maps, contexto de URL, pesquisa de arquivos e uso de computador em prévia.
- Trabalho de conhecimento intensivo em documentos: desempenho aprimorado em finanças, direito, biociências, compreensão de PDFs e automação corporativa.
Desempenho em benchmarks
| Benchmark | Gemini 3.7 Flash | Gemini 3.6 Flash | Claude Sonnet 5 | GPT-5.6 Terra |
|---|---|---|---|---|
| Artificial Analysis Intelligence Index | 56 | 52 | 55 | 57 |
| FrontierCode 1.1 Main | 43.6% | 34.4% | 42.7% | 41.3% |
| DeepSWE v1.1 | 65.3% | 49.0% | — | — |
| GDM-MRCR v2 (8-needle, 128K) | 97.0% | 91.8% | 81.5% | 93.5% |
| OSWorld-2.0 | 47.9% | 33.8% | — | 50.2% |
| Agent's Last Exam | 26.3% | 24.2% | 33.3% | 28.0% |
| HLE-Verified | 53.6% | 51.2% | 31.0% | 51.1% |
| LABBench2 | 82.1% | 76.1% | 80.1% | 81.2% |
O Google também relata GDP.pdf em 34,0% versus 22,0%, AutomationBench em 30,4% versus 17,0% e WebDev Arena Elo em 1588 versus 1538 para o Gemini 3.6 Flash.
Gemini 3.7 Flash vs Gemini 3.6 Flash vs Claude Sonnet 5
| Modelo | Posicionamento | Contexto | Principais pontos fortes |
|---|---|---|---|
| Gemini 3.7 Flash | Cavalo de batalha agentivo eficiente | 1,05M | Codificação, desenvolvimento web, agentes multimodais, fluxos de trabalho de longo contexto |
| Gemini 3.6 Flash | Cavalo de batalha Flash anterior | 1M | Agente geral e cargas de trabalho multimodais |
| Claude Sonnet 5 | Raciocínio/codificação de nível superior | Varia | Codificação, trabalho de conhecimento, raciocínio |
O Gemini 3.7 Flash é particularmente atraente quando um aplicativo precisa de um equilíbrio entre capacidade de fronteira, processamento multimodal, contexto longo, uso de ferramentas e economia de inferência.
Limitações
- O modo de raciocínio
MINIMALnão está disponível. - Geração de imagens não é compatível; a saída é em texto.
- Gemini Live API não é compatível.
- A data de corte do conhecimento é março de 2026.
- O Google observa possíveis alucinações, lentidão ocasional e problemas de tempo limite.
- O uso de computador está atualmente em Prévia.
Casos de uso
- Agentes de codificação e engenharia de software em escala de repositório.
- Desenvolvimento web a partir de capturas de tela, imagens ou sistemas de design.
- Agentes corporativos de documentos e conhecimento.
- Automação de fluxos de trabalho multimodais.
- Agentes que usam ferramentas com busca, execução de código e chamadas de função.
- Análise de longo contexto de grandes bases de código e coleções de documentos.
- Automação corporativa estruturada.