Spécifications techniques de Gemini 3.6 Flash
| Élément | Gemini 3.6 Flash |
|---|---|
| Fournisseur | Google DeepMind |
| ID du modèle | gemini-3.6-flash |
| Famille de modèles | Gemini 3.x |
| Disponibilité | Disponibilité générale (GA) |
| Types d’entrée | Text, Image, Video, Audio, PDF |
| Types de sortie | Text |
| Fenêtre de contexte | 1,048,576 tokens |
| Sortie maximale | 65,536 tokens |
| Raisonnement | Pris en charge (moyen/élevé) |
| Appels de fonctions | Oui |
| Exécution de code | Oui |
| Recherche de fichiers | Oui |
| Contexte d’URL | Oui |
| Ancrage via recherche | Oui |
| Utilisation de l’ordinateur | Aperçu |
| Sortie structurée | Oui |
| Mise en cache | Pris en charge |
Source : documentation de l’API Google Gemini.
Qu'est-ce que Gemini 3.6 Flash ?
Gemini 3.6 Flash est le tout nouveau modèle Flash prêt pour la production de Google, conçu pour offrir une intelligence de pointe tout en conservant la faible latence et l’efficacité en termes de coûts qui font la réputation de la série Flash. Il est optimisé pour le codage, la compréhension multimodale, le raisonnement et les workflows agentiques.
Par rapport à Gemini 3.5 Flash, le modèle améliore la qualité de génération de code, la précision du raisonnement, l’usage des outils et l’efficacité des jetons, tout en prenant en charge une vaste fenêtre de contexte d’un million de jetons. Google le présente comme le modèle de travail par défaut pour les développeurs créant des agents IA et des systèmes d’automatisation complexes.
Principales fonctionnalités de Gemini 3.6 Flash
- Prend en charge un traitement de contexte long à 1M de jetons.
- Entrées multimodales natives, incluant texte, images, vidéo, audio et documents PDF.
- Améliorations significatives en génération de code et dans les tâches d’ingénierie logicielle.
- Prise en charge intégrée des appels de fonctions, de la recherche de fichiers, du contexte d’URL, de l’ancrage via recherche et de l’utilisation de l’ordinateur.
- Plus économe en jetons que Gemini 3.5 Flash, réduisant le coût d’inférence tout en maintenant une qualité supérieure.
- Conçu pour des agents IA multi-étapes et des workflows autonomes.
Performances de référence
Google indique que Gemini 3.6 Flash offre de meilleures performances en codage, raisonnement et multimodal que Gemini 3.5 Flash tout en utilisant nettement moins de jetons de sortie. L’entreprise met en avant des performances améliorées sur des benchmarks internes de codage et agentiques et précise que le modèle peut réduire l’utilisation de jetons de sortie jusqu’à 65 % sur certaines évaluations d’ingénierie logicielle telles que DeepSWE, diminuant ainsi les coûts d’inférence globaux. Google n’a pas publié de tableaux de benchmarks publics complets (p. ex., MMLU, GPQA, SWE-bench Verified) pour cette version.

Gemini 3.6 Flash vs Gemini 3.5 Flash vs Gemini 3.1 Pro
| Aspect | Gemini 3.6 Flash | Gemini 3.5 Flash | Gemini 3.1 Pro |
|---|---|---|---|
| Sortie | 21 juillet 2026 (GA) | Plus tôt en 2026 | ~févr. 2026 (Aperçu) |
| Positionnement | Pilier efficace pour agents, codage, multimodal | Ancien modèle Flash agentique | Raisonnement avancé de niveau Pro |
| Tarification (par 1M de jetons) | Entrée: $1.50Sortie: $7.50 | Entrée: $1.50Sortie: $9.00 | Plus élevé (p. ex., ~$2 entrée / $12 sortie) |
| Efficacité des jetons | 17 % de jetons de sortie en moins vs 3.5 Flash ; moins d’étapes/d’appels d’outils | Référence | Moins efficace dans les workflows agentiques |
| Vitesse | Élevée (famille Flash) | Élevée | Plus lente que les modèles Flash |
| Fenêtre de contexte | 1M tokens | 1M tokens | Probablement similaire |
| Points forts | Codage, travaux de connaissance, multimodal (graphiques/documents), utilisation de l’ordinateur, efficacité agentique | Bon équilibre agentique/codage | Raisonnement plus profond sur des problèmes complexes |
Résumé rapide
- 3.6 Flash → Meilleur choix global pour la plupart des utilisateurs actuellement : plus rapide, moins cher par tâche, plus efficace que 3.5 Flash, et surpasse 3.1 Pro sur de nombreux benchmarks pratiques/agentiques.
- 3.5 Flash → Solide prédécesseur ; toujours capable mais supplanté par 3.6 Flash (coût des jetons de sortie plus élevé, moins efficace).
- 3.1 Pro → Plus fort dans certains scénarios de raisonnement profond mais plus lent, plus coûteux et généralement à la traîne des modèles Flash plus récents en vitesse, efficacité et dans de nombreuses tâches réelles/agentiques.
Limitations
- La génération d’images n’est pas prise en charge directement.
- La génération audio n’est pas disponible.
- L’utilisation de l’ordinateur reste en Aperçu.
- Certains paramètres de génération hérités (
temperature,top_p,top_k) ont été supprimés de la nouvelle interface API. - Les meilleures performances sont obtenues via la dernière API Gemini Interactions.
Comment accéder à l’API Gemini 3.6 Flash
Étape 1 : Obtenir l’accès à l’API
Connectez-vous à cometAPI. Si vous n’êtes pas encore utilisateur chez nous, veuillez d’abord vous inscrire. Connectez-vous à votre console CometAPI. Récupérez la clé API d’identification d’accès de l’interface. Cliquez sur “Add Token” au niveau du jeton API dans le centre personnel, obtenez la clé de jeton : sk-xxxxx et soumettez.

Étape 2 : Envoyer des requêtes vers l’API Gemini 3.6 Flash
Sélectionnez l’endpoint “ gemini-3.6-flash" "gemini-3.6-flash-thinking” pour envoyer la requête API et définir le corps de la requête. La méthode et le corps de la requête sont obtenus depuis la documentation API de notre site Web. Notre site propose également des tests Apifox pour votre commodité. Remplacez <YOUR_API_KEY> par votre clé CometAPI réelle de votre compte. L’URL de base est Gemini Generating Content
Insérez votre question ou votre demande dans le champ content—c’est à cela que le modèle répondra . Traitez la réponse de l’API pour obtenir la réponse générée.
Étape 3 : Traiter les réponses
L’API renvoie des réponses candidates structurées incluant le texte généré, des citations, des métadonnées de sécurité et des sorties d’outils facultatives.