Spécifications techniques de Grok 4.6
| Élément | Grok 4.6 |
|---|---|
| Fournisseur | xAI |
| ID du modèle | grok-4.6 |
| Type de modèle | Modèle de raisonnement multimodal de pointe et agentique |
| Forces principales | Agents longue durée, codage, travail de la connaissance, création d’applications interactives/visuelles |
| Modalités d'entrée | Texte et images |
| Modalité de sortie | Texte |
| Fenêtre de contexte | 500,000 jetons |
| Coupure des connaissances | 1 février 2026 |
| Limite de sortie | Aucune limite de sortie de texte publiée par xAI |
| Raisonnement | low, medium, high (default), xhigh |
| API | Responses API, Chat Completions |
| Outils | Appels de fonctions, recherche Web, recherche X, exécution de code |
| Tarification de l'API | $2 / 1M jetons d'entrée; $6 / 1M jetons de sortie |
| Variante rapide | Disponible à 2× le prix standard |
| Publié | 12 août 2026 |
Qu'est-ce que Grok 4.6 ?
Grok 4.6 est le tout dernier modèle de pointe de xAI, axé sur l’agentic intelligence.
La différence avec un chatbot traditionnel est importante.
xAI met l’accent sur la capacité du modèle à rester plus longtemps sur des projets complexes, à travailler à travers des bases de code, à rechercher des sujets inconnus, à créer des applications et à vérifier son propre travail.
Cela rend Grok 4.6 particulièrement pertinent pour le marché des agents de codage IA et des agents autonomes en forte expansion.
Principales fonctionnalités de Grok 4.6
- Exécution d’agents de longue durée : Grok 4.6 est entraîné à soutenir un travail complexe sur de nombreuses étapes au lieu d’optimiser uniquement pour des réponses à un seul tour.
- Codage agentique : Il cible l’ingénierie logicielle au niveau du dépôt, la génération de code, le débogage, les tests itératifs et des environnements de codage spécifiques au domaine.
- Recherche pour le travail de la connaissance : Le modèle peut explorer des domaines inconnus, organiser l’information, raisonner face à des exigences complexes et transformer les résultats en un livrable concret.
- Création d’applications visuelles et interactives : xAI rapporte de meilleurs résultats au premier passage pour des projets visuels et interactifs, y compris la transformation d’une idée de produit en application fonctionnelle et son affinage via des boucles de rétroaction.
- Autotests et vérification : Sur des trajectoires longues, xAI a observé davantage de comportements où le modèle vérifie son propre travail avant de continuer.
- Utilisation native des outils : Grok 4.6 prend en charge les appels de fonctions, la recherche Web, la recherche X et l’exécution de code via l’API.
- Raisonnement configurable : Les développeurs peuvent choisir
low,medium,highouxhighcomme effort de raisonnement, rendant le modèle adaptable aux charges de travail sensibles à la latence et aux raisonnements approfondis.
Performances de référence de Grok 4.6
xAI indique que Grok 4.6 égale GPT-5.6 Sol sur l’Artificial Analysis Intelligence Index, un composite de neuf benchmarks. Ses meilleurs résultats publiés incluent :
| Benchmark | Grok 4.6 High | Grok 4.5 High | GPT-5.6 Sol Max | Claude Fable 5 Max |
|---|---|---|---|---|
| Artificial Analysis Intelligence Index | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69.9% | 66.7% | 67.2% | 70.5% |
| DeepSWE v1.1 | 65.9% | 54.0% | 73.0% | 70.0% |
| FrontierCode v1.1 (Extended) | 61.3% | 56.6% | 60.6% | 63.6% |
| APEX-Agents | 57.5% | 47.1% | 56.7% | 59.2% |
| Terminal-Bench v3.0 | 26.0% | 15.7% | 34.6% | 34.1% |
| APEX-SWE | 56.4% | 53.6% | — | 58.8% |
| AA-Briefcase | 1577 | 1313 | 1502 | 1574 |
| Harvey LAB (Vals) | 15.8% | 12.9% | 2.5% | 11.3% |
Ces chiffres proviennent de l’annonce de lancement du 12 août de xAI. xAI note que les chiffres tiers sont tirés des fiches système développeur ou des classements publics de benchmarks, de sorte que les résultats entre modèles doivent être interprétés à la lumière de la méthodologie d’évaluation et des paramètres du modèle.
Grok 4.6 vs Grok 4.5 vs GPT-5.6 Sol vs Claude Fable 5
| Modèle | Positionnement principal | Contexte | AA Intelligence | Profil de codage/agentique |
|---|---|---|---|---|
| Grok 4.6 | Agents longue durée, codage, travail de la connaissance | 500K | 61 | Codage agentique solide et flux de travail de projets interactifs |
| Grok 4.5 | Modèle généraliste et de codage de pointe, rapide | 500K | 56 | Base solide pour le codage et les flux de travail d’agents |
| GPT-5.6 Sol | Raisonnement général de pointe et travail agentique | Le contexte publié du concurrent varie selon le déploiement | 61 | Résultats solides sur DeepSWE et Terminal-Bench |
| Claude Fable 5 | Travail de la connaissance de pointe et codage | Le contexte publié du concurrent varie selon le déploiement | 62 | Très forts résultats sur CursorBench, FrontierCode, APEX-SWE |
Grok 4.6 est le plus convaincant lorsque la charge de travail exige une exécution soutenue plutôt qu’une seule réponse de haute qualité. Il est particulièrement attrayant pour les développeurs qui construisent des agents qui recherchent à répétition, appellent des outils, modifient du code, testent des résultats et poursuivent à partir du contexte accumulé. Claude Fable 5 conserve un avantage sur plusieurs benchmarks de codage et d’agents publiés, tandis que GPT-5.6 Sol devance Grok 4.6 sur DeepSWE et Terminal-Bench dans la comparaison de xAI.
Limites et considérations
- Les résultats de benchmark dépendent de la tâche : Grok 4.6 n’est pas uniformément le modèle ayant le score le plus élevé. Ses résultats publiés montrent des forces et des faiblesses claires selon les différentes évaluations agentiques.
- Les charges de travail de longue durée peuvent consommer beaucoup de jetons : Une grande fenêtre de contexte et l’utilisation itérative d’outils peuvent augmenter la consommation totale d’inférence, même lorsque le prix par jeton est compétitif.
- La configuration des outils est déterminante : La recherche Web, la recherche X, l’exécution de code et les appels de fonctions nécessitent une architecture d’application capable de gérer en toute sécurité les permissions d’outils et les données renvoyées.
- Coupure des connaissances : La coupure documentée est au 1 février 2026. Pour des informations plus récentes, les développeurs doivent utiliser des outils de récupération ou de recherche Web appropriés plutôt que de s’appuyer sur la connaissance statique du modèle.
- La mise en cache requiert une configuration délibérée : xAI recommande
prompt_cache_keypour la Responses API etx-grok-conv-idpour Chat Completions afin d’améliorer la fiabilité des hits de cache.
Cas d’utilisation de Grok 4.6
- Agents de codage autonomes — analyse de dépôt, implémentation, débogage, tests et correctifs itératifs.
- Prototypage produit — transformer des exigences produit larges en applications interactives fonctionnelles.
- Agents de recherche technique — rechercher des domaines techniques inconnus et produire des livrables structurés.
- Copilotes développeurs — génération de code, revue, débogage et flux de développement multi-étapes.
- Automatisation du travail de la connaissance — analyse de documents, synthèse d’information, planification et génération de sorties structurées.
- Assistants utilisant des outils — applications combinant le raisonnement du modèle avec la recherche Web, la recherche X, l’exécution de code et des appels de fonctions personnalisés.
Comment accéder à l’API Grok 4.6
Pour les applications utilisant déjà la couche d’API unifiée de CometAPI, utilisez l’ID de modèle Grok 4.6 exposé par CometAPI et suivez le point de terminaison/schéma actuel dans la documentation de l’API CometAPI. Cela peut réduire le travail d’intégration spécifique au fournisseur lorsqu’une application doit basculer entre des LLM de pointe.
Un flux de travail typique est :
- Créez ou connectez-vous à un compte CometAPI.
- Créez un jeton d’API dans la console CometAPI.
- Sélectionnez le point de terminaison du modèle
grok-4.6. - Envoyez des requêtes via le point de terminaison CometAPI en utilisant le schéma de requête documenté pour le modèle.
- Traitez dans votre application le texte renvoyé, les appels d’outils ou la sortie structurée.