DeepSeek Vision and Grok Imagine models are now live on CometAPI →
ai-model/CometAPI research

Grok 4.6 er her: benchmarkresultater på GPT-5.6-niveau og kodningsydeevne

xAI har lanceret Grok 4.6 med et kontekstvindue på 500,000 tokens, konfigurerbar ræsonnering, billedinput samt API-priser på $2 / $6 pr. 1M input-/output-tokens.

CometAPI
AnnaForskningshold for AI-modeller og API
Opdateret Aug 24, 2026 12 min. læsning
Grok 4.6 er her: benchmarkresultater på GPT-5.6-niveau og kodningsydeevne
Brug dette mønster

Lav det første API-kald.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL; DR xAI lancerede officielt Grok 4.6 den August 12, 2026 og gjorde den tilgængelig via xAI API, Cursor og Grok Build. Den har et kontekstvindue på 500,000 tokens, accepterer tekst og billeder, tilbyder fire niveauer for ræsonneringsindsats, og har en videnafskæring pr. February 1, 2026. Ifølge xAI’s officielle Grok 4.6-annoncering matcher den GPT-5.6 Sol på Artificial Analysis Intelligence Index, et sammensat mål af ni evalueringer.

API-priser starter ved $2 per million input tokens, $0.50 per million cached input tokens og $6 per million output tokens for prompts under 200,000 tokens. Når en prompt når 200,000 tokens, bliver hele anmodningen faktureret til long-context-satserne på $4 input, $1 cached input og $12 output per million tokens. For udviklere, der søger fleksibel multi-model-adgang, gør platforme som CometAPI det nemt at integrere Grok 4.6 sammen med andre frontier-modeller; API-prisen er 80% af xAI's pris.

Nøglepointer

  • xAI lancerede officielt Grok 4.6 den August 12, 2026; tidligere rapporter om lanceringsvinduer er nu forældede.
  • API-model-ID'et er , og modellen er også tilgængelig i Cursor og Grok Build.grok-4.6
  • Dens kontekstvindue er 500K tokens, med input i tekst og billeder og kun tekstoutput.
  • Standardpriser under 200K prompttokens er $2/M input, $0.50/M cachet input og $6/M output.
  • En prompt på 200K tokens eller derover udløser højere satser for alle tokens i den anmodning, ikke kun dem over tærsklen.
  • Ræsonneringsindsats kan sættes til low, medium, high eller xhigh; er den dokumenterede standard.
  • Grok 4.6 matcher GPT-5.6 Sol på Artificial Analysis Intelligence Index (score på 61) og viser store gevinster over Grok 4.5 inden for agentisk kodning, vidensarbejde og langsigtede opgaver.
  • Grok Imagine Image 2.0 er et separat billedegenererings-API. Grok 4.6 kan forstå billeder, men returnerer ikke selv genererede billeder.

Grok 4.6 – specifikationer og pris i et overblik

Følgende specifikationer er bekræftet i xAI’s modeldokumentation og release notes af August 12.

SpecifikationGrok 4.6
Officiel lanceringsdatoAugust 12, 2026
API-model-IDgrok-4.6
PositioneringFlagskibsmodel til kodning, agenter og generelle arbejdsbyrder
Kontekstvindue500,000 tokens
InputTekst og billeder
OutputTekst
Dokumenteret grænse for tekstoutputIngen grænse for tekstoutput angivet af xAI
Kontrol af ræsonneringLow, medium, high og xhigh
Standard for ræsonneringsindsatsHigh
VidensafskæringFebruary 1, 2026
Native API-adgangTilgængelig
Adgang til kodningsværktøjerCursor og Grok Build
Adgang til aktuelle begivenhederKræver Web Search eller X Search-værktøjer

Officielle xAI API-priser

xAI’s nuværende API-pristabel adskiller short-context og long-context-anmodninger.

PromptstørrelseInput pr. 1M tokensCachet input pr. 1M tokensOutput pr. 1M tokens
Under 200,000 tokens$2.00$0.50$6.00
200,000 tokens eller mere$4.00$1.00$12.00

Tærsklen er særligt vigtig for kodebase-agenter. Når prompten i en anmodning når 200,000 tokens, opkræver xAI long-context-satsen for alle tokens i den anmodning, ikke kun for den del, der overstiger tærsklen. En anmodning med 199,000 prompttokens kan derfor koste væsentligt mindre end en med 200,000, selv hvis deres størrelser er næsten identiske.

Ingen mængderabat er angivet for Grok 4.6 i den aktuelle xAI-prisdokumentation. Teams bør ikke antage, at offline-jobs får de rabatter, der er tilgængelige for visse andre xAI-modeller.

Hvad er Grok 4.6?

Grok 4.6 er SpaceXAI’s nyeste flagskibsstore sprogmodel, lanceret den August 12, 2026. Den bygger direkte videre på Grok 4.5 ved at anvende en længere supplerende træningskørsel med fokus på kuraterede modelgenererede data til avanceret ræsonnering og tekniske koncepter, høj-kvalitets ingeniørdatasæt, en forbedret optimizer og udvidet reinforcement learning til kodnings- og vidensarbejdsscenarier.

Modellen bevarer det samme underliggende 1.5-trillion-parameter fundament som sin forgænger; fremskridtene kommer primært fra eftertræning frem for en stigning i parameterstørrelse. Den er specifikt designet til at forblive effektiv over mange trin—uanset om det er at undersøge et emne, analysere store mængder information, navigere og redigere en ukendt kodebase eller omsætte en idé på højt niveau til en poleret applikation eller et arbejdsartefakt. SpaceXAI fremhæver forbedret selvkontroladfærd på langhorisontprojekter og stærkere præstation i interaktivt og visuelt arbejde.

Forskellen fra en traditionel chatbot er vigtig.

En konventionel LLM-arbejdsgang ser sådan ud:

Prompt → Generér svar

Grok 4.6 er designet til arbejdsgange tættere på:

Mål → Plan → Research → Brug værktøjer → Modificér kode → Test → Evaluer → Fortsæt

xAI's nuværende positionering fremhæver modellens evne til at holde sig på komplekse projekter i længere tid, arbejde på tværs af kodebaser, undersøge ukendte emner, bygge applikationer og verificere eget arbejde.

Dette gør Grok 4.6 særligt relevant for det hastigt voksende marked for AI-kodningsagenter og autonome agenter.

Hvad er de vigtigste funktioner i Grok 4.6?

Langvarig agentkapabilitet

Den vigtigste forbedring i Grok 4.6 er fokus på langvarige opgaver.

I stedet for kun at optimere for one-shot-svar er modellen designet til at opretholde fremdrift gennem flere faser af et projekt.

Typiske eksempler omfatter:

  • At bygge en applikation
  • At debugge et stort repository
  • At undersøge et ukendt emne
  • At modificere flere komponenter
  • At køre tests
  • At undersøge fejl
  • At revidere implementeringen
  • At tjekke det endelige resultat

Dette er et fundamentalt andet mål end traditionelle benchmarks for instruktionsfølgning.

Avanceret kodningspræstation

Kodning er et af de tydeligste forbedringsområder for Grok 4.6.

Aktuelle benchmarkrapporter angiver:

  • 65.9% på DeepSWE 1.1
  • 69.9% på CursorBench 3.2
  • 61.3% på FrontierCode 1.1 Extended

Disse evalueringer er særligt relevante, fordi de retter sig mod kodningsagent-adfærd snarere end simpel kodefuldførelse.

Forbedringen fra Grok 4.5 til Grok 4.6 på DeepSWE 1.1 er især bemærkelsesværdig, med en stigning fra cirka 54% til 65.9% i den rapporterede sammenligning.

Multimodalt input

Grok 4.6 understøtter input i tekst og billeder, hvilket gør det muligt for udviklere at kombinere visuel information med ræsonnering.

Potentielle anvendelser omfatter:

  • Screenshot-debugging
  • UI-analyse
  • Fortolkning af diagrammer
  • Dokumentforståelse
  • Visuel research
  • Billedbaserede kodningsopgaver

Dette gør Grok 4.6 mere fleksibel end en rent tekstbaseret kodningsmodel.

Groks adgang til søgning er en vigtig del af dets økosystem.

API'et understøtter:

  • Web search
  • X search
  • Funktionskald
  • Kodeeksekvering

xAI's nuværende Grok 4.5 API-dokumentation bekræfter disse værktøjskapabiliteter i Grok API-miljøet.

For forskningsagenter betyder dette, at modellen potentielt kan bevæge sig fra statisk fortrænet viden mod aktuel informationsindhentning plus ræsonnering.

Konfigurerbar ræsonnering

Grok’s API eksponerer konfigurerbar ræsonneringsindsats.

Dette lader udviklere balancere:

hastighed / omkostning ↔ ræsonneringsdybde

For simple opgaver kan lavere ræsonnering reducere unødvendig beregning.

For komplekse kodnings- eller forskningsopgaver kan højere ræsonnering give mere overlagt problemløsning.

Omkostningskonkurrencedygtig frontier-ydelse

Grok 4.6’s prisfastsættelse er uden tvivl en af dens stærkeste kommercielle fordele.

Den rapporterede standard-API-pris er:

  • $2 / 1M input tokens
  • $6 / 1M output tokens

Det er samme pris som rapporteret for Grok 4.5, på trods af de betydelige kapabilitetsforbedringer.

Dette skaber et usædvanligt aggressivt pris/ydelsesforhold for en frontier-model.


Hvordan klarer Grok 4.6 sig på benchmarks?

De mest nyttige aktuelle benchmarkdata er koncentreret omkring agentisk intelligens og kodning.

BenchmarkGrok 4.6Hvad den måler
Artificial Analysis Intelligence Index61Bred frontier-model intelligens
CursorBench 3.269.9%Kodningsagent-præstation
DeepSWE 1.165.9%Software engineering-agenter
FrontierCode 1.1 Extended61.3%Avanceret kodning
GDPVal-AA v21,753 EloVidensarbejdsopgave-præstation

Artificial Analysis Intelligence Index-scoren på 61 sætter angiveligt Grok 4.6 på samme niveau som GPT-5.6 Sol på det indeks.

GDPVal-AA v2-scoren på 1,753 Elo er også betydningsfuld, fordi GDPVal evaluerer professionelle vidensarbejdsopgaver snarere end blot akademisk spørgsmål-svar.

Den vigtige benchmarkpointe

Det stærkeste evidensgrundlag for Grok 4.6 er ikke en enkelt MMLU-lignende score.

Dens benchmarkprofil peger mod:

kodning + agenter + vidensarbejde + langvarig eksekvering

Det er præcis der, moderne AI-udvikling bevæger sig hen.

For et website som CometAPI er dette en vigtig distinktion at fastholde: Grok 4.6 bør markedsføres primært som en agentisk frontier-model, ikke blot endnu en generisk chatbot-model.

Hvordan sammenlignes Grok 4.6 med sin forgænger og konkurrenter?

Grok 4.6 vs Grok 4.5

FunktionGrok 4.5Grok 4.6
Primært fokusGenerel ræsonnering + agenterLangvarige agenter + kodning
Kontekst500K-klasse deployment500K
InputTekst + billedeTekst + billede
Web searchJaJa
X searchJaJa
KodeeksekveringJaJa
FunktionskaldJaJa
Inputpris$2/M$2/M
Outputpris$6/M$6/M
DeepSWE 1.1~54%65.9%
Intelligence Index~5661

Det vigtige punkt er, at Grok 4.6 ikke ser ud til blot at være en simpel prisniveau-erstatning for Grok 4.5. Det er en kapabilitetsopgradering, der er mere tungt rettet mod langhorisont-agentarbejdsgange.

xAI's nuværende Grok 4.5-dokumentation lister modellen til $2/$6 per million tokens, med konfigurerbar ræsonnering og værktøjsunderstøttelse.

Sammenligningstabel: Grok 4.6 vs nøglekonkurrenter

AspektGrok 4.6GPT-5.6 SolClaude Fable 5 / Opus 5Noter
AA Intelligence Index616162 / 63Sammensat score
Input / Output $/1M$2 / $6~$5 / $30~$5 / $25Grok langt billigere på output
Kontekstvindue500KOp til 1M+Ofte 1M
StyrkerAgenter, kodningseffektivitet, prisBred ræsonnering, kodningLanghorisont, sikkerhed
Cursor-integrationNative, stærkTilgængeligTilgængeligGrok optimeret til Cursor
Turn-effektivitetHøj (færre trin)KonkurrencedygtigHøjere trinrapporterVigtigt for agenter
TilgængelighedAPI + Cursor + partnereOfficiel + partnereOfficiel + partnereCometAPI samler adgangen

Data hentet fra SpaceXAI-annoncering, Artificial Analysis og offentlige modelkort per August 13, 2026.

Den aktuelle Artificial Analysis-sammenligning er særligt interessant.

Grok 4.6 scorer angiveligt 61 på Intelligence Index, hvilket matcher GPT-5.6 Sol. Men økonomien er meget anderledes.

De præcise priser for konkurrerende GPT-varianter bør tjekkes mod deres aktuelle udbyderpriser før publikation, men den centrale markedsobservation er klar: Grok 4.6 konkurrerer på frontier-niveau benchmarkpræstation, samtidig med at den fastholder en relativt aggressiv tokenpris.

Det gør Grok 4.6 særligt attraktiv for applikationer, hvor højvolumen agenteksekvering ellers ville gøre premium-frontier-modeller dyre.

Hvad er begrænsningerne ved Grok 4.6?

500K-kontekst er mindre end nogle konkurrenter med 1M-kontekst

Grok 4.6’s rapporterede 500K-kontekst er stor, men den er ikke den største kontekstvindue i frontier-markedet.

For meget store repositories eller enorme dokumentsamlinger kan en 1M-kontekstmodel have en fordel.

Proprietær model

I modsætning til MiMo-V2.5-Pro er Grok 4.6 ikke en open-weight-model.

Udviklere kan ikke downloade modellen og udrulle den selvstændigt.

Benchmark-sammenligninger kræver omtanke

Forskellige kodningsbenchmarks bruger forskellige harnesses, prompts, værktøjer og evalueringsprocedurer.

For eksempel er SWE-Bench Pro specifikt designet omkring realistiske langhorisont software engineering-problemer, og benchmarkresultater kan variere betydeligt afhængigt af agent-skelettet.

Derfor bør 69.9% CursorBench ikke fortolkes som "Grok 4.6 er 69.9% bedre end en anden model."

Den korrekte fortolkning er, at den opnåede den score under benchmarkets særlige evalueringsopsætning.

Agentomkostninger kan være højere end tokenpriser antyder

$2/$6-tokenprisen er attraktiv, men en autonom agent kan forbruge enorme mængder tokens gennem:

  • Værktøjskald
  • Gentagne søgninger
  • Kodeeksekvering
  • Mislykkede forsøg
  • Lang kontekst
  • Selv-verifikation

De reelle enhedsøkonomier afhænger derfor af omkostning per succesfuldt afsluttet opgave, ikke blot omkostning per million tokens.

Pris og adgang

Officielle priser (standardtier, under ~200K prompttokens):

  • Input: $2.00 per 1M tokens
  • Cachet input: approximately $0.50 per 1M tokens
  • Output: $6.00 per 1M tokens

En hurtigere variant er prissat til det dobbelte af disse satser. Satser kan fordobles for meget lange kontekster (≥200K). Promptcaching anbefales stærkt til agentløkker for at holde omkostningerne nede.

Tilgængelighed:

  • Cursor og Grok Build (2× inkluderet forbrug den første uge)
  • SpaceXAI API (grok-4.6)
  • Partnere: OpenRouter, Vercel, Cloudflare og andre
  • SuperGrok chat/apps (via modelvælger)

CometAPI-anbefaling: For udviklere, der allerede bruger (eller planlægger at bruge) flere frontier-modeller, giver CometAPI problemfri adgang til Grok 4.6 via et enkelt OpenAI-kompatibelt endpoint (https://api.cometapi.com/v1). Du får samlet fakturering, forbrugsanalyse, konkurrencedygtige effektive satser på tværs af 500+ modeller (inklusive GPT, Claude, Gemini, DeepSeek og Grok-varianter) og mulighed for at skifte modeller med en linjes ændring. Dette er særligt værdifuldt ved A/B-test af Grok 4.6 mod andre kode- eller agentmodeller eller ved opbygning af produktionssystemer, der drager fordel af modelruting og fallback. Tilmeld dig på cometapi.com for at få en gratis API-nøgle og udforske det live modelkatalog.

Bør du skifte til Grok 4.6?

Ja, hvis:

  • Du arbejder meget i Cursor eller bygger langvarige kode-/vidensagenter og ønsker stærk flerstegs-pålidelighed til en konkurrencedygtig pris.
  • Tokenøkonomi betyder noget—Grok 4.6 leverer næsten paritet i intelligens med GPT-5.6 Sol til cirka en femtedel af outputtokenprisen i de dyreste frontier-muligheder.
  • Du værdsætter turn-effektivitet (færre trin og tokens for at fuldføre komplekse opgaver).
  • Du ønsker øjeblikkelig adgang til en model, der eksplicit er trænet til de interaktive, visuelle og agentiske arbejdsgange, der er almindelige i moderne udvikling.

Overvej at blive ved eller blande andre modeller, hvis:

  • Din primære arbejdsbyrde er ren konkurrenceprogrammering eller specifikke lukkede modelstyrker (f.eks. visse Claude-lang-kontekst- eller sikkerhedstunede scenarier).
  • Du kræver de absolut højeste scorer på hver individuel software engineering-benchmark uanset omkostning.
  • Du har brug for større kontekstvinduer end 500K til enkeltkalds-arbejdsbyrder (nogle konkurrenter tilbyder 1M+).

De fleste teams vil have fordel af at evaluere Grok 4.6 side om side med deres nuværende stack. Fordi den er tilgængelig via aggregatorer som CometAPI, er omkostningen ved at skifte lav—ændr blot modelnavnet og mål real-world opgavefuldførelsesrater, latenstid og omkostning på dine egne arbejdsbyrder.

Konklusion

Grok 4.6 repræsenterer et væsentligt skridt fremad for SpaceXAI: frontier-niveau intelligens på centrale sammensatte og agentiske benchmarks, meningsfulde forbedringer i langvarig kodning og vidensarbejdspræstation, og fortsat aggressiv prisfastsættelse, der underbyder mange lukkede konkurrenter. Dens native tilgængelighed i Cursor, kombineret med stærk flerstegs-pålidelighed, gør den særligt attraktiv for udviklere, der bygger virkelige softwareagenter og interaktive applikationer.

Uanset om du tilgår den direkte, via Cursor/Grok Build eller gennem en samlet gateway som CometAPI, er Grok 4.6 klar til produktionsevaluering i dag. Besøg den officielle annoncering på x.ai/news/grok-4-6 for alle detaljer og modelkort, udforsk det live katalog på cometapi.com for at sammenligne den side om side med andre førende modeller, og begynd at bygge med de nye kapabiliteter med det samme.

Primære kilder

Verificer altid de seneste priser, ratelimitter og benchmarktal på de officielle sider, da AI-landskabet udvikler sig hurtigt.

Fortsæt læring

Knyt denne artikel til den næste beslutning.

Se alle emner
Udgivet den Aug 13, 2026
Sidst opdateret Aug 24, 2026
79 visninger
Gennemgået for klarhed, kildeangivelse og aktuel API-terminologi.

Klar til at skære AI-udviklingsomkostninger med 20%?

Kom gratis i gang på få minutter. Gratis prøvekreditter inkluderet. Intet kreditkort påkrævet.

Læs mere