Technische specificaties van Grok 4.6
| Item | Grok 4.6 |
|---|---|
| Provider | xAI |
| Model ID | grok-4.6 |
| Model type | Frontier multimodal reasoning and agentic model |
| Primary strengths | Langdurende agents, codering, kenniswerk, bouwen van interactieve/visuele applicaties |
| Input modalities | Tekst en afbeeldingen |
| Output modality | Tekst |
| Context window | 500,000 tokens |
| Knowledge cutoff | 1 februari 2026 |
| Output limit | Geen tekstuitvoerlimiet gepubliceerd door xAI |
| Reasoning | low, medium, high (default), xhigh |
| APIs | Responses API, Chat Completions |
| Tools | Function calling, web search, X search, code execution |
| API pricing | $2 / 1M input tokens; $6 / 1M output tokens |
| Fast variant | Beschikbaar tegen 2× de standaardprijs |
| Released | 12 augustus 2026 |
Wat is Grok 4.6?
Grok 4.6 is xAI's nieuwste frontier-model gericht op agentic intelligence.
Het verschil met een traditionele chatbot is belangrijk.
xAI benadrukt het vermogen van het model om langer aan complexe projecten te blijven werken, over codebases heen te opereren, onbekende onderwerpen te onderzoeken, applicaties te bouwen en zijn eigen werk te verifiëren.
Dit maakt Grok 4.6 bijzonder relevant voor de snelgroeiende markt voor AI-code-agents en autonome agents.
Belangrijkste functies van Grok 4.6
- Langdurige agentuitvoering: Grok 4.6 is getraind om complex werk over veel stappen vol te houden in plaats van alleen te optimaliseren voor antwoorden in één beurt.
- Agentische codering: Het richt zich op software-engineering op repository-niveau, codegeneratie, debuggen, iteratief testen en domeinspecifieke codeomgevingen.
- Onderzoek voor kenniswerk: Het model kan onbekende domeinen onderzoeken, informatie organiseren, door complexe eisen redeneren en bevindingen omzetten in een concreet resultaat.
- Visuele en interactieve applicatieontwikkeling: xAI meldt sterkere first-pass-resultaten voor visuele en interactieve projecten, inclusief het omzetten van een productidee in een werkende applicatie en het verfijnen ervan via feedbackloops.
- Zelftesten en verificatie: Bij langere trajecten zag xAI meer gedrag waarbij het model zijn eigen werk controleert voordat het doorgaat.
- Native toolgebruik: Grok 4.6 ondersteunt function calling, web search, X search en code execution via de API.
- Configureerbare redenering: Ontwikkelaars kunnen
low,medium,highofxhighredeneringsinspanning kiezen, waardoor het model kan worden aangepast aan latency-gevoelige en diep-redenerende workloads.
Benchmarkprestaties van Grok 4.6
xAI meldt dat Grok 4.6 gelijk staat aan GPT-5.6 Sol op de Artificial Analysis Intelligence Index, een composiet van negen benchmarks. De sterkste gepubliceerde resultaten zijn:
| Benchmark | Grok 4.6 High | Grok 4.5 High | GPT-5.6 Sol Max | Claude Fable 5 Max |
|---|---|---|---|---|
| Artificial Analysis Intelligence Index | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69.9% | 66.7% | 67.2% | 70.5% |
| DeepSWE v1.1 | 65.9% | 54.0% | 73.0% | 70.0% |
| FrontierCode v1.1 (Extended) | 61.3% | 56.6% | 60.6% | 63.6% |
| APEX-Agents | 57.5% | 47.1% | 56.7% | 59.2% |
| Terminal-Bench v3.0 | 26.0% | 15.7% | 34.6% | 34.1% |
| APEX-SWE | 56.4% | 53.6% | — | 58.8% |
| AA-Briefcase | 1577 | 1313 | 1502 | 1574 |
| Harvey LAB (Vals) | 15.8% | 12.9% | 2.5% | 11.3% |
Deze cijfers zijn afkomstig uit xAI's lanceraankondiging van 12 augustus. xAI merkt op dat cijfers van derden afkomstig zijn uit systeemkaarten van ontwikkelaars of openbare benchmarkleaderboards, dus resultaten tussen modellen moeten worden geïnterpreteerd met de evaluatiemethodologie en modelinstellingen in gedachten.
Grok 4.6 vs Grok 4.5 vs GPT-5.6 Sol vs Claude Fable 5
| Model | Primary positioning | Context | AA Intelligence | Coding/agentic profile |
|---|---|---|---|---|
| Grok 4.6 | Langdurende agents, codering, kenniswerk | 500K | 61 | Sterke agentische codering en interactieve projectworkflows |
| Grok 4.5 | Snel frontier-generalist en coderingsmodel | 500K | 56 | Sterke basis voor codering- en agent-workflows |
| GPT-5.6 Sol | Frontier algemeen redeneren en agentisch werk | Gepubliceerde context voor concurrent verschilt per implementatie | 61 | Sterke DeepSWE- en Terminal-Bench-resultaten |
| Claude Fable 5 | Frontier kenniswerk en codering | Gepubliceerde context voor concurrent verschilt per implementatie | 62 | Zeer sterke CursorBench, FrontierCode, APEX-SWE |
Grok 4.6 is het meest overtuigend wanneer de workload duurzame uitvoering vereist in plaats van één enkele respons van hoge kwaliteit. Het is vooral aantrekkelijk voor ontwikkelaars die agents bouwen die herhaaldelijk onderzoek doen, tools aanroepen, code bewerken, resultaten testen en doorgaan op basis van opgebouwde context. Claude Fable 5 behoudt een voordeel op verschillende gepubliceerde coderings- en agentbenchmarks, terwijl GPT-5.6 Sol Grok 4.6 overtreft op DeepSWE en Terminal-Bench in xAI's vergelijking.
Beperkingen en aandachtspunten
- Benchmarkresultaten zijn taakafhankelijk: Grok 4.6 is niet uniform het hoogst scorende model. De gepubliceerde resultaten tonen duidelijke sterkten en zwakten over verschillende agentische evaluaties.
- Langdurige workloads kunnen veel tokens verbruiken: Een groot contextvenster en iteratief toolgebruik kunnen het totale verbruik verhogen, zelfs wanneer de prijs per token concurrerend is.
- Toolconfiguratie is belangrijk: Web search, X search, code execution en function calling vereisen een applicatie-architectuur die tools permissies en geretourneerde data veilig kan afhandelen.
- Knowledge cutoff: De gedocumenteerde cutoff is 1 februari 2026. Voor recentere informatie moeten ontwikkelaars geschikte retrieval- of webzoektools gebruiken in plaats van te vertrouwen op de statische kennis van het model.
- Caching vereist bewuste configuratie: xAI raadt
prompt_cache_keyaan voor de Responses API enx-grok-conv-idvoor Chat Completions om de betrouwbaarheid van cache-treffers te verbeteren.
Gebruiksscenario's van Grok 4.6
- Autonome code-agents — repository-analyse, implementatie, debuggen, testen en iteratieve fixes.
- Productprototyping — brede productvereisten omzetten in functionele interactieve applicaties.
- Technische onderzoeksagents — onbekende technische domeinen onderzoeken en gestructureerde deliverables produceren.
- Developer copilots — codegeneratie, review, debuggen en meerstaps-ontwikkelworkflows.
- Automatisering van kenniswerk — documentanalyse, informatie-synthese, planning en gestructureerde outputgeneratie.
- Toolgebruikende assistenten — applicaties die modelredenering combineren met web search, X search, code execution en aangepaste function calls.
Hoe toegang te krijgen tot de Grok 4.6 API
Voor applicaties die al de uniforme API-laag van CometAPI gebruiken, gebruik de Grok 4.6 model-ID die door CometAPI wordt blootgesteld en volg het huidige endpoint/schema in de CometAPI API-documentatie. Dit kan providerspecifiek integratiewerk verminderen wanneer een applicatie tussen frontier-LLM's moet schakelen.
Een typische workflow is:
- Maak een CometAPI-account aan of meld u aan.
- Maak een API-token aan in de CometAPI-console.
- Selecteer het
grok-4.6model endpoint . - Verstuur verzoeken via het CometAPI-endpoint met het voor het model gedocumenteerde requestschema.
- Verwerk de geretourneerde tekst, toolcalls of gestructureerde output in uw applicatie.