Spécifications techniques de Gemini 3.7 Flash
| Élément | Gemini 3.7 Flash |
|---|---|
| ID du modèle | gemini-3.7-flash |
| Fournisseur | |
| Contexte | 1,048,576 jetons |
| Sortie maximale | 65,536 jetons |
| Entrée | Texte / Image / Vidéo / Audio / PDF |
| Réflexion | Low / Medium / High |
| Appel de fonction | ✅ |
| Exécution de code | ✅ |
| Ancrage par recherche | ✅ |
| Ancrage Google Maps | ✅ |
| Contexte URL | ✅ |
| Recherche de fichiers | ✅ |
| Utilisation de l’ordinateur | Preview |
| Date limite des connaissances | mars 2026 |
| Publication | 13 août 2026 |
Qu’est-ce que Gemini 3.7 Flash ?
Gemini 3.7 Flash est l’itération du 13 août 2026 de la gamme Gemini 3 Flash de Google. Google le présente comme son cheval de bataille Flash le plus intelligent à ce jour pour le codage et les agents IA, avec des améliorations axées sur l’ingénierie logicielle, le développement Web, les travaux de connaissance complexes et les workflows en plusieurs étapes. Il est arrivé trois semaines après Gemini 3.6 Flash et est décrit comme le résultat des retours des développeurs et d’innovations algorithmiques.
Principales fonctionnalités
- Contexte de 1M de jetons : Prend en charge de grands dépôts, de longs documents, des conversations étendues et des historiques d’agent multi-étapes.
- Raisonnement multimodal : Accepte des entrées texte, image, vidéo, audio et PDF.
- Réflexion configurable : Prend en charge les niveaux LOW, MEDIUM et HIGH ;
MINIMALn’est pas pris en charge. - Codage agentique : Gains majeurs en débogage, résolution de problèmes, précision du code au premier passage et ingénierie logicielle à long horizon.
- Développement Web et UI : Meilleure conformité aux captures d’écran, aux images et aux systèmes de design.
- Workflows pilotés par des outils : appels de fonction, exécution de code, ancrage par recherche, ancrage Google Maps, contexte URL, recherche de fichiers et utilisation de l’ordinateur en aperçu.
- Travaux de connaissance à forte composante documentaire : performances améliorées en finance, droit, biosciences, compréhension des PDF et automatisation d’entreprise.
Performances aux benchmarks
| Benchmark | Gemini 3.7 Flash | Gemini 3.6 Flash | Claude Sonnet 5 | GPT-5.6 Terra |
|---|---|---|---|---|
| Artificial Analysis Intelligence Index | 56 | 52 | 55 | 57 |
| FrontierCode 1.1 Main | 43.6% | 34.4% | 42.7% | 41.3% |
| DeepSWE v1.1 | 65.3% | 49.0% | — | — |
| GDM-MRCR v2 (8-needle, 128K) | 97.0% | 91.8% | 81.5% | 93.5% |
| OSWorld-2.0 | 47.9% | 33.8% | — | 50.2% |
| Agent's Last Exam | 26.3% | 24.2% | 33.3% | 28.0% |
| HLE-Verified | 53.6% | 51.2% | 31.0% | 51.1% |
| LABBench2 | 82.1% | 76.1% | 80.1% | 81.2% |
Google indique également GDP.pdf à 34.0% contre 22.0%, AutomationBench à 30.4% contre 17.0%, et WebDev Arena Elo à 1588 contre 1538 pour Gemini 3.6 Flash.
Gemini 3.7 Flash vs Gemini 3.6 Flash vs Claude Sonnet 5
| Modèle | Positionnement | Contexte | Atouts clés |
|---|---|---|---|
| Gemini 3.7 Flash | Cheval de bataille agentique efficace | 1.05M | Codage, développement Web, agents multimodaux, workflows à long contexte |
| Gemini 3.6 Flash | Ancien cheval de bataille Flash | 1M | Charges de travail générales pour agents et multimodales |
| Claude Sonnet 5 | Raisonnement/codage haut de gamme | Variable | Codage, travaux de connaissance, raisonnement |
Gemini 3.7 Flash est particulièrement attractif lorsqu’une application a besoin d’un équilibre entre capacités de pointe, traitement multimodal, long contexte, utilisation d’outils et économie d’inférence.
Limitations
- Le mode de réflexion
MINIMALn’est pas disponible. - La génération d’images n’est pas prise en charge ; la sortie est du texte.
- L’API Gemini Live n’est pas prise en charge.
- La date limite des connaissances est mars 2026.
- Google signale d’éventuelles hallucinations, des lenteurs occasionnelles et des problèmes de dépassement de délai.
- L’utilisation de l’ordinateur est actuellement une fonctionnalité en aperçu.
Cas d’usage
- Agents de codage et ingénierie logicielle à l’échelle du dépôt.
- Développement Web à partir de captures d’écran, d’images ou de systèmes de design.
- Agents de documents et de connaissances d’entreprise.
- Automatisation de workflows multimodaux.
- Agents utilisant des outils avec recherche, exécution de code et appels de fonction.
- Analyse à long contexte de vastes bases de code et collections de documents.
- Automatisation d’entreprise structurée.