Tekniske spesifikasjoner for Grok 4.6
| Element | Grok 4.6 |
|---|---|
| Leverandør | xAI |
| Modell-ID | grok-4.6 |
| Modeltype | Frontier‑modell for multimodal resonnering og agentisk atferd |
| Primære styrker | Langtidskjørende agenter, koding, kunnskapsarbeid, bygging av interaktive/visuelle applikasjoner |
| Inndatamodaliteter | Tekst og bilder |
| Utdata‑modalitet | Tekst |
| Kontekstvindu | 500,000 tokens |
| Kunnskapsavgrensning | 1. februar 2026 |
| Utdata‑grense | Ingen publisert grense for tekstutdata fra xAI |
| Resonnering | low, medium, high (standard), xhigh |
| API-er | Responses API, Chat Completions |
| Verktøy | Funksjonskalling, websøk, X‑søk, kodekjøring |
| API‑priser | $2 / 1M inndata‑tokens; $6 / 1M utdata‑tokens |
| Rask variant | Tilgjengelig til 2× standardpris |
| Lansert | 12. august 2026 |
Hva er Grok 4.6?
Grok 4.6 er xAIs nyeste frontier‑modell med fokus på agentisk intelligens.
Forskjellen fra en tradisjonell chatbot er viktig.
xAI vektlegger modellens evne til å holde seg på komplekse prosjekter over lengre tid, arbeide på tvers av kodebaser, undersøke ukjente temaer, bygge applikasjoner og verifisere eget arbeid.
Dette gjør Grok 4.6 særlig relevant for det raskt voksende markedet for AI‑kodeagenter og autonome agenter.
Hovedfunksjoner i Grok 4.6
- Langvarig agentutførelse: Grok 4.6 er trent til å opprettholde komplekst arbeid over mange steg i stedet for å optimalisere kun for svar i én enkelt tur.
- Agentisk koding: Den retter seg mot programvareutvikling på repositories‑nivå, kodegenerering, feilsøking, iterativ testing og domenespesifikke kodeomgivelser.
- Kunnskapsarbeid og forskning: Modellen kan undersøke ukjente domener, organisere informasjon, resonnere gjennom komplekse krav og gjøre funn om til et konkret leverbart.
- Bygging av visuelle og interaktive applikasjoner: xAI rapporterer sterkere førstegangsresultater for visuelle og interaktive prosjekter, inkludert å gjøre en produktidé om til en fungerende applikasjon og forbedre den gjennom tilbakemeldingssløyfer.
- Egen‑testing og verifisering: På lengre forløp observerte xAI mer atferd der modellen sjekker eget arbeid før den fortsetter.
- Naturlig verktøybruk: Grok 4.6 støtter funksjonskalling, websøk, X‑søk og kodekjøring via API‑et.
- Konfigurerbar resonnering: Utviklere kan velge
low,medium,highellerxhighresonnementinnsats, noe som gjør modellen tilpasningsdyktig for både latenstilfølsomme og dyptgående resonneringsarbeidslaster.
Benchmark‑ytelse for Grok 4.6
xAI rapporterer at Grok 4.6 matcher GPT-5.6 Sol på Artificial Analysis Intelligence Index, en sammensetning av ni benchmarks. De sterkeste publiserte resultatene inkluderer:
| Benchmark | Grok 4.6 High | Grok 4.5 High | GPT-5.6 Sol Max | Claude Fable 5 Max |
|---|---|---|---|---|
| Artificial Analysis Intelligence Index | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69.9% | 66.7% | 67.2% | 70.5% |
| DeepSWE v1.1 | 65.9% | 54.0% | 73.0% | 70.0% |
| FrontierCode v1.1 (Extended) | 61.3% | 56.6% | 60.6% | 63.6% |
| APEX-Agents | 57.5% | 47.1% | 56.7% | 59.2% |
| Terminal-Bench v3.0 | 26.0% | 15.7% | 34.6% | 34.1% |
| APEX-SWE | 56.4% | 53.6% | — | 58.8% |
| AA-Briefcase | 1577 | 1313 | 1502 | 1574 |
| Harvey LAB (Vals) | 15.8% | 12.9% | 2.5% | 11.3% |
Disse tallene kommer fra xAIs lanseringskunngjøring 12. august. xAI bemerker at tredjepartstall er hentet fra utvikleres systemkort eller offentlige benchmark‑ledertavler, så modellkryssende resultater bør tolkes med evalueringsmetodikk og modellinnstillinger i mente.
Grok 4.6 vs Grok 4.5 vs GPT-5.6 Sol vs Claude Fable 5
| Modell | Primær posisjonering | Kontekst | AA Intelligence | Kode-/agentprofil |
|---|---|---|---|---|
| Grok 4.6 | Langtidskjørende agenter, koding, kunnskapsarbeid | 500K | 61 | Sterk agentisk koding og interaktive prosjektarbeidsflyter |
| Grok 4.5 | Rask frontier‑generalist og kodemodell | 500K | 56 | Sterkt utgangspunkt for kode‑ og agentarbeidsflyter |
| GPT-5.6 Sol | Frontier‑generell resonnering og agentisk arbeid | Publisert konkurrent‑kontekst varierer per distribusjon | 61 | Sterke DeepSWE‑ og Terminal‑Bench‑resultater |
| Claude Fable 5 | Frontier‑kunnskapsarbeid og koding | Publisert konkurrent‑kontekst varierer per distribusjon | 62 | Svært sterke CursorBench, FrontierCode, APEX‑SWE |
Grok 4.6 er mest overbevisende når arbeidslasten krever vedvarende utførelse snarere enn ett enkelt svar av høy kvalitet. Den er spesielt attraktiv for utviklere som bygger agenter som gjentatte ganger undersøker, kaller verktøy, redigerer kode, tester resultater og fortsetter fra akkumulert kontekst. Claude Fable 5 beholder en fordel på flere publiserte kode‑ og agentbenchmarker, mens GPT-5.6 Sol leder Grok 4.6 på DeepSWE og Terminal‑Bench i xAIs sammenligning.
Begrensninger og hensyn
- Benchmark‑resultater er oppgaveavhengige: Grok 4.6 scorer ikke konsekvent høyest. De publiserte resultatene viser klare styrker og svakheter på tvers av ulike agentiske evalueringer.
- Langtidskjørende arbeidslaster kan bruke betydelige mengder tokens: Et stort kontekstvindu og iterativ verktøybruk kan øke total inferenskonsum selv når pris per token er konkurransedyktig.
- Verktøykonfigurasjon betyr mye: Websøk, X‑søk, kodekjøring og funksjonskalling krever en applikasjonsarkitektur som trygt kan håndtere verktøytillatelser og returnerte data.
- Kunnskapsavgrensning: Dokumentert cutoff er 1. februar 2026. For nyere informasjon bør utviklere bruke passende gjenfinning eller websøk i stedet for å stole på modellens statiske kunnskap.
- Mellomlagring krever bevisst konfigurasjon: xAI anbefaler
prompt_cache_keyfor Responses API ogx-grok-conv-idfor Chat Completions for å forbedre påliteligheten til cache‑treff.
Bruksområder for Grok 4.6
- Autonome kodeagenter — repository‑analyse, implementering, feilsøking, testing og iterative rettinger.
- Produktprototyping — gjøre brede produktkrav om til funksjonelle, interaktive applikasjoner.
- Tekniske forskningsagenter — undersøke ukjente tekniske domener og produsere strukturerte leveranser.
- Utvikler‑copiloter — kodegenerering, gjennomgang, feilsøking og flertrinns utviklingsarbeidsflyter.
- Automatisering av kunnskapsarbeid — dokumentanalyse, informasjonsyntese, planlegging og generering av strukturert output.
- Verktøybrukende assistenter — applikasjoner som kombinerer modellresonnering med websøk, X‑søk, kodekjøring og egendefinerte funksjonskall.
Slik får du tilgang til Grok 4.6 API
For applikasjoner som allerede bruker CometAPIs enhetlige API‑lag, bruk Grok 4.6‑modell‑ID‑en som eksponeres av CometAPI og følg gjeldende endepunkt/skjema i CometAPI‑dokumentasjonen. Dette kan redusere leverandørspesifikt integrasjonsarbeid når en applikasjon må bytte mellom frontier‑LLM‑er.
En typisk arbeidsflyt er:
- Opprett eller logg inn på en CometAPI‑konto.
- Opprett et API‑token i CometAPI‑konsollen.
- Velg
grok-4.6‑modellens endepunkt . - Send forespørsler gjennom CometAPI‑endepunktet ved å bruke forespørselsskjemaet som er dokumentert for modellen.
- Behandle returnert tekst, verktøykall eller strukturert output i applikasjonen din.