Spécifications techniques de Gemini 3.6 Flash
| Élément | Gemini 3.6 Flash |
|---|---|
| Fournisseur | Google DeepMind |
| ID du modèle | gemini-3.6-flash |
| Famille de modèles | Gemini 3.x |
| Disponibilité | Disponibilité générale (GA) |
| Types d’entrée | Texte, image, vidéo, audio, PDF |
| Types de sortie | Texte |
| Fenêtre de contexte | 1,048,576 jetons |
| Sortie maximale | 65,536 jetons |
| Raisonnement | Pris en charge (moyen / élevé) |
| Appels de fonctions | Oui |
| Exécution de code | Oui |
| Recherche de fichiers | Oui |
| Contexte d’URL | Oui |
| Ancrage de la recherche | Oui |
| Utilisation de l’ordinateur | Aperçu |
| Sortie structurée | Oui |
| Mise en cache | Pris en charge |
Source : documentation de l’API Google Gemini.
Qu’est-ce que Gemini 3.6 Flash ?
Gemini 3.6 Flash est le nouveau modèle Flash de Google, prêt pour la production, conçu pour offrir une intelligence de pointe tout en conservant la faible latence et l’efficacité en coûts qui font la réputation de la série Flash. Il est optimisé pour le codage, la compréhension multimodale, le raisonnement et les flux de travail à base d’agents.
Comparé à Gemini 3.5 Flash, le modèle améliore la qualité de génération de code, la précision du raisonnement, l’utilisation d’outils et l’efficacité en jetons, tout en prenant en charge une fenêtre de contexte massive de 1 million de jetons. Google le positionne comme le cheval de bataille par défaut pour les développeurs qui construisent des agents IA et des systèmes d’automatisation complexes.
Principales fonctionnalités de Gemini 3.6 Flash
- Prend en charge le traitement de contexte long à 1M de jetons.
- Entrées multimodales natives, y compris texte, images, vidéo, audio et documents PDF.
- Améliorations marquées en génération de code et sur les tâches d’ingénierie logicielle.
- Prise en charge intégrée de Function Calling, File Search, URL Context, Search Grounding et Computer Use.
- Plus économe en jetons que Gemini 3.5 Flash, réduisant le coût d’inférence tout en maintenant une qualité supérieure.
- Conçu pour des agents IA multi-étapes et des flux de travail autonomes.
Performances aux benchmarks
Google indique que Gemini 3.6 Flash offre de meilleures performances en codage, raisonnement et multimodalité que Gemini 3.5 Flash tout en utilisant nettement moins de jetons de sortie. L’entreprise met en avant des progrès sur des benchmarks internes de codage et d’agents et affirme que le modèle peut réduire l’usage de jetons de sortie jusqu’à 65% sur certaines évaluations d’ingénierie logicielle comme DeepSWE, diminuant ainsi les coûts d’inférence globaux. Google n’a pas publié de tableaux de benchmarks publics complets (p. ex., MMLU, GPQA, SWE-bench Verified) pour cette version.

Gemini 3.6 Flash vs Gemini 3.5 Flash vs Gemini 3.1 Pro
| Aspect | Gemini 3.6 Flash | Gemini 3.5 Flash | Gemini 3.1 Pro |
|---|---|---|---|
| Sortie | 21 juillet 2026 (GA) | Plus tôt en 2026 | ~février 2026 (Aperçu) |
| Positionnement | Cheval de bataille efficace pour les agents, le codage, le multimodal | Ancien modèle Flash orienté agents | Raisonnement avancé de niveau Pro |
| Tarification (par 1M de jetons) | Entrée: $1.50Sortie: $7.50 | Entrée: $1.50Sortie: $9.00 | Plus élevé (p. ex., ~$2 entrée / $12 sortie) |
| Efficacité en jetons | 17% de jetons de sortie en moins vs 3.5 Flash ; moins d’étapes/appels d’outils | Référence | Moins efficace dans les workflows d’agents |
| Vitesse | Élevée (famille Flash) | Élevée | Plus lente que les modèles Flash |
| Fenêtre de contexte | 1M de jetons | 1M de jetons | Probablement similaire |
| Forces | Codage, travail intellectuel, multimodal (graphiques/documents), utilisation de l’ordinateur, efficacité des agents | Bon équilibre agents/codage | Raisonnement plus profond sur des problèmes complexes |
Résumé rapide
- 3.6 Flash → Meilleur choix global pour la plupart des utilisateurs aujourd’hui : plus rapide, moins coûteux par tâche, plus efficace que 3.5 Flash, et surpasse 3.1 Pro sur de nombreux benchmarks pratiques/axés agents.
- 3.5 Flash → Solide prédécesseur ; toujours capable mais supplanté par 3.6 Flash (coût en jetons de sortie plus élevé, moins efficace).
- 3.1 Pro → Plus fort dans certains scénarios de raisonnement approfondi mais plus lent, plus cher et généralement à la traîne des nouveaux modèles Flash en vitesse, efficacité et de nombreuses tâches réelles/axées agents.
Limitations
- La génération d’images n’est pas prise en charge directement.
- La génération audio est indisponible.
- Computer Use reste en Aperçu.
- Certains paramètres de génération hérités (
temperature,top_p,top_k) ont été supprimés de la nouvelle interface API. - Les meilleures performances sont obtenues via la dernière API Gemini Interactions.
Comment accéder à l’API Gemini 3.6 Flash
Étape 1 : Obtenir l’accès à l’API
Connectez-vous à cometAPI. Si vous n’êtes pas encore utilisateur, veuillez d’abord vous inscrire. Connectez-vous à votre Console CometAPI. Obtenez la clé d’API d’accès de l’interface. Cliquez sur “Add Token” au niveau du jeton API dans le centre personnel, récupérez la clé du jeton : sk-xxxxx et soumettez.

Étape 2 : Envoyer des requêtes à l’API Gemini 3.6 Flash
Sélectionnez l’endpoint “ gemini-3.6-flash" "gemini-3.6-flash-thinking” pour envoyer la requête API et définissez le corps de la requête. La méthode et le corps de la requête sont obtenus depuis la documentation API de notre site. Notre site fournit également un test Apifox pour votre commodité. Remplacez <YOUR_API_KEY> par votre clé CometAPI réelle de votre compte. base url is Gemini Generating Content
Insérez votre question ou demande dans le champ content — c’est à cela que le modèle répondra. Traitez la réponse de l’API pour obtenir la réponse générée.
Étape 3 : Traiter les réponses
L’API renvoie des réponses candidates structurées, incluant le texte généré, des citations, des métadonnées de sécurité et des sorties d’outils optionnelles.