Spécifications techniques de Gemini 3.5 Flash
| Élément | Gemini 3.5 Flash |
|---|---|
| Fournisseur | |
| Famille de modèles | Gemini 3.5 |
| ID de modèle officiel | gemini-3.5-flash |
| Types d'entrée | Texte, image, vidéo, audio, PDF |
| Types de sortie | Texte |
| Fenêtre de contexte | 1 million de jetons |
| Nombre max. de jetons de sortie | ~65K jetons de sortie |
| Atouts principaux | Workflows agentiques, codage, raisonnement multimodal |
| Prise en charge des outils | Appel de fonctions, exécution de code, ancrage par la recherche, sorties structurées, contexte d'URL, recherche de fichiers |
| Prise en charge de la réflexion | Niveaux de réflexion/raisonnement ajustables |
| Cadre de sécurité | Google Frontier Safety Framework |
Qu'est-ce que Gemini 3.5 Flash ?
Google Gemini 3.5 Flash est le modèle phare de Google pour le raisonnement multimodal haute vitesse, optimisé pour l'exécution agentique, le codage et les workflows de longue durée. Il étend la série Gemini Flash avec des capacités de raisonnement et d'ingénierie logicielle nettement renforcées tout en conservant des caractéristiques d'inférence à faible latence.
Contrairement aux modèles Flash précédents principalement axés sur une inférence légère, Gemini 3.5 Flash est conçu pour des agents IA persistants, des systèmes de codage multi‑étapes et des pipelines d'automatisation d'entreprise. Google le positionne comme son modèle Flash de niveau agentique le plus puissant à ce jour.
Principales fonctionnalités de Gemini 3.5 Flash
- Prise en charge d'un contexte long à 1 M de jetons : Gère des dépôts extrêmement volumineux, une documentation longue, des PDF, des transcriptions et des workflows multi‑sessions dans un seul contexte d'invite.
- Exécution agentique robuste : Optimisé pour des workflows autonomes multi‑étapes, l'orchestration d'outils, les tâches terminales et des agents IA de longue durée.
- Performances de codage avancées : Surpasse Gemini 3.1 Pro sur plusieurs benchmarks de codage et agentiques, notamment Terminal-Bench et MCP Atlas.
- Raisonnement multimodal natif : Accepte du texte, des images, de l'audio, de la vidéo et des PDF pour des tâches de raisonnement unifiées.
- Outillage de niveau production : Prend en charge les sorties structurées, l'appel de fonctions, l'exécution de code, l'ancrage avec Google Search et Maps, et la recherche de fichiers.
- Modes de raisonnement/réflexion configurables : Les développeurs peuvent ajuster la latence par rapport à la profondeur de raisonnement via des contrôles de niveau de réflexion.
Performances de référence de Gemini 3.5 Flash
Selon Google, les résultats aux benchmarks placent Gemini 3.5 Flash parmi les modèles Flash de niveau agentique les plus performants actuellement disponibles :
| Benchmark | Gemini 3.5 Flash |
|---|---|
| Terminal-Bench 2.1 | 76.2% |
| GDPval-AA | 1656 Elo |
| MCP Atlas | 83.6% |
| CharXiv Reasoning | 84.2% |
Ces scores indiquent des gains majeurs en exécution autonome, raisonnement multimodal et fiabilité en ingénierie logicielle par rapport aux précédentes variantes Gemini Flash.
Gemini 3.5 Flash comparé à d'autres modèles
| Capacité | Gemini 3.5 Flash | Gemini 3.1 Pro | Claude Sonnet 4 |
|---|---|---|---|
| Fenêtre de contexte | 1 M de jetons | Contexte étendu | Contexte étendu |
| Workflows agentiques | Excellent | Solide | Solide |
| Performances de codage | Très solides | Solides | Excellentes |
| Vitesse d'inférence | Latence Flash optimisée | Plus lente | Modérée |
| Entrées multimodales | Multimodal natif | Multimodal natif | Vision + texte |
| Écosystème d'outils | Outillage Google étendu | Étendu | Outillage API solide |
Principales différences
- vs Gemini 3.1 Pro : Gemini 3.5 Flash offre de meilleures performances en codage et en exécution autonome tout en conservant une inférence nettement plus rapide.
- vs Claude Sonnet 4 : Claude reste souvent plus performant en raisonnement long et nuancé ainsi qu'en qualité rédactionnelle, tandis que Gemini 3.5 Flash met l'accent sur la vitesse, l'exécution par agents et l'intégration à l'écosystème Google.
- vs les modèles de raisonnement de la série GPT : Gemini 3.5 Flash est particulièrement compétitif pour les workflows d'agents multimodaux et l'orchestration à grand contexte, en particulier pour les cas d'usage d'automatisation en entreprise.
Limitations connues de Gemini 3.5 Flash
- Ne prend actuellement pas en charge la génération native d'images ou d'audio en sortie.
- Les API conversationnelles en direct ne sont pas prises en charge sur ce niveau de modèle.
- Les benchmarks communautaires montrent des performances mitigées sur certaines tâches d'évaluation spécialisées, en particulier les workflows de niche fortement axés sur la vision.
Comment accéder à l'API Gemini 3.5 Flash
Étape 1 : Obtenir l'accès à l'API
Connectez-vous à CometAPI. Si vous n'êtes pas encore utilisateur, inscrivez-vous d'abord. Connectez-vous à votre console CometAPI. Récupérez la clé API d'accès à l'interface. Cliquez sur “Add Token” dans l'API token de l'espace personnel, obtenez la clé de jeton : sk-xxxxx, puis validez.

Étape 2 : Envoyer des requêtes à l'API Gemini 3.5 Flash
Sélectionnez l’“` gemini-3.5-flash” endpoint pour envoyer la requête API et définir le corps de la requête. La méthode et le corps de la requête sont disponibles dans la documentation API de notre site. Notre site fournit également un test Apifox pour votre commodité. Remplacez <YOUR_API_KEY> par votre véritable clé CometAPI de votre compte. L'URL de base est Génération de contenu Gemini
Insérez votre question ou votre requête dans le champ content — c'est à cela que le modèle répondra. Traitez la réponse de l'API pour obtenir la réponse générée.
Étape 3 : Traiter les réponses
L'API renvoie des réponses candidates structurées incluant le texte généré, des citations, des métadonnées de sécurité et, le cas échéant, des sorties d'outils.