Spécifications techniques — Gemini 3.1 Pro
| Élément | gemini-3-pro (résumé public) |
|---|---|
| Fournisseur | |
| ID de modèle canonique | gemini-3-pro (aperçu public) |
| Types d'entrée | Texte, Image, Vidéo, Audio, PDF |
| Types de sortie | Texte (langage naturel, sorties structurées, charges utiles d'appels de fonctions) |
| Limite de jetons en entrée (contexte) | 1,048,576 jetons |
| Limite de jetons en sortie | 65,536 jetons |
| Appels de fonctions / utilisation d'outils | Pris en charge (appels de fonctions, sorties structurées, intégrations d'outils) |
| Multimodalité | Prise en charge multimodale complète (images, vidéo, audio, documents) |
| Exécution de code et flux agentiques | Pris en charge (mode agent, assistance au code, orchestration d'outils) |
| Date limite de connaissances | Janvier 2025 |
Qu'est-ce que Gemini 3.1 Pro ?
Gemini 3.1 Pro est le modèle phare public de Google dans la famille Gemini 3, positionné comme un modèle de raisonnement multimodal de pointe avec des outils avancés pour les agents et les développeurs. Le modèle met l’accent sur une gestion de contexte de très haute capacité (entrées de 1M de jetons), une large prise en charge des médias (images, vidéo, audio, PDF), et des intégrations poussées pour l’usage d’outils, les appels de fonctions et les workflows centrés sur le code (par ex. Gemini Code Assist et modes agent).
Gemini 3 Pro est présenté par Google comme optimisé à la fois pour des expériences développeur interactives (codage à faible latence et workflows d’agents) et pour une compréhension multimodale haute fidélité (interprétation et raisonnement sur des entrées médias mixtes).
Fonctionnalités principales de Gemini 3.1 Pro
Gemini-3.1 Pro (via son aperçu) introduit les fonctionnalités suivantes :
Intégration multimodale
Traite des entrées sur :
- Langage naturel
- Images
- Parole/audio
- Vidéo
avec une représentation unifiée des jetons pour le raisonnement intermodal.
Fenêtre de contexte étendue
Une capacité de contexte exceptionnellement grande allant jusqu’à ~1 million de jetons permet de gérer :
- Longs documents
- Synthèse multidocument
- Bases de code et transcriptions.
Cela dépasse de nombreux modèles concurrents qui prennent généralement en charge ~32 K–262 K jetons.
Mise à l’échelle Mixture-of-Experts parcimonieux (MoE)
Le routage MoE parcimonieux permet de faire évoluer la capacité interne du modèle sans coûts de calcul proportionnels, améliorant le raisonnement à l’échelle.
Raisonnement / planification avancés
Des innovations comme l’entraînement en chaîne de pensée, l’apprentissage par renforcement à partir de retours humains, et des benchmarks spécialisés le rendent performant sur des tâches logiques et mathématiques.
Benchmarks supposés :
AIME 2025 : 100 % (avec exécution de code)
SWE-Bench Verified : 83.9 %
ARC-AGI-2 : 71.8 %
LiveCodeBench Pro : 2844 Elo
Terminal-Bench 2.0 : 63.5 %
MMMLU : 93.6 %
Cas d’utilisation représentatifs en entreprise
- Pipelines média de bout en bout : Ingérer vidéo, transcription et images pour produire des résumés synchronisés, des métadonnées et des insights structurés à grande échelle.
- Génération et revue de code à grande échelle : Utiliser dans des IDE et des pipelines CI pour générer automatiquement du code, refactorer des projets multi-fichiers et proposer des tests sur de grandes bases de code.
- Automatisation agentique : Coordonner des agents multi-outils qui interagissent avec des services cloud, des systèmes d’orchestration et des API internes via des appels de fonctions structurés.
- Recherche et production de contenu : Rédiger des contenus longs (rapports, livres) combinant texte et multimédia intégré avec des renvois internes préservés.
Comment accéder à l’API Gemini 3.1 Pro
Étape 1 : Inscription pour la clé API
Connectez-vous à cometapi.com. Si vous n’êtes pas encore utilisateur, veuillez d’abord vous inscrire. Connectez-vous à votre Console CometAPI. Obtenez la clé API d’identification d’accès de l’interface. Cliquez sur « Add Token » au niveau du jeton API dans le centre personnel, obtenez la clé de jeton : sk-xxxxx et soumettez.
Étape 2 : Envoyer des requêtes à l’API Gemini 3.1 Pro
Sélectionnez le point de terminaison “gemini-3.1-pro” pour envoyer la requête API et définissez le corps de la requête. La méthode et le corps de la requête sont disponibles dans la documentation API de notre site web. Notre site propose également un test Apifox pour votre commodité. Remplacez <YOUR_API_KEY> par votre clé CometAPI réelle depuis votre compte. L’URL de base est Gemini Generating Content et Chat.
Insérez votre question ou votre demande dans le champ content — c’est à cela que le modèle répondra . Traitez la réponse de l’API pour obtenir la réponse générée.
Étape 3 : Récupérer et vérifier les résultats
Traitez la réponse de l’API pour obtenir la réponse générée. Après traitement, l’API renvoie l’état de la tâche et les données de sortie.
Voir aussi Gemini 3 Pro API