GPT Image 2.5 Sunburst and Flare are now live on CometAPI →
new/CometAPI research

Grok 4.5 uitgebracht: architectuur, releasedatum en wat we verder weten

Grok 4.5 is opgedoken via X-berichten, sporen in de web-UI van Grok, Cursor-gerelateerde signalen en beweringen over een privébèta.

CometAPI
AnnaOnderzoeksteam voor AI-modellen en API
Bijgewerkt Sep 3, 2026 11 min leestijd
Grok 4.5 uitgebracht: architectuur, releasedatum en wat we verder weten
Gebruik dit patroon

Doe de eerste API-aanroep.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TLDR Op 28 juni 2026 kondigde Elon Musk aan dat Grok 4.5 — gebouwd op xAI’s nieuwe V9-fundamentmodel met 1,5 biljoen parameters, met aanvullende trainingsdata van het Cursor AI-codingplatform — de private bèta is ingegaan bij SpaceX en Tesla. Interne evaluaties claimen prestaties “dicht bij, mogelijk beter dan” Claude Opus van Anthropic, met doorlopende RLHF- en Grok Build-verbeteringen.

Voor ontwikkelaars en bedrijven die vandaag frontier-modellen integreren, biedt CometAPI onmiddellijke, kostenefficiënte toegang tot Grok 4.3 (en andere xAI-modellen) via één OpenAI-compatibel endpoint naast 500+ modellen van Anthropic, OpenAI, Google en meer — vaak met 20%+ besparing ten opzichte van directe prijzen, zonder promptlogging voor privacygerichte workflows.

Belangrijkste punten

Releasedatum van Grok 4.5

Grok 4.5 ging op 28 juni 2026 in private bèta en staat gepland voor publieke release op 9 juli 2026 (morgen, per 8 juli).

Het bouwt voort op eerdere versies zoals Grok 4 (uitgebracht rond juli 2025) en Grok 4.3. Het zou kort na de aankondiging toegankelijk moeten worden voor in aanmerking komende gebruikers (bijv. SuperGrok/Premium+-abonnees). Voor API wordt CometAPI onmiddellijk na de release geïntegreerd met de grok 4.5-API en zal het een lagere aanschafprijs bieden.

Public Release: Today (July 8, 2026),[ Musk posted that], op basis van positieve beta-feedback, SpaceXAI / xAI Grok 4.5 morgen beschikbaar stelt voor het publiek (9 juli). Het wordt omschreven als een "Opus-klasse"-model dat sneller, token-efficiënter en goedkoper is dan vergelijkbare modellen.

Grok 4.5 uitgebracht: architectuur, releasedatum en wat we verder weten

Bron: @mark_k

Signalen uit de architectuur van grok 4.5: wat we hebben gezien

De primaire bron is Elon Musks eigen X-bericht van 28 juni 2026:

“Grok 4.5, gebaseerd op ons 1,5T V9-fundamentmodel, met Cursor-data toegevoegd in aanvullende training, is nu in private bèta bij SpaceX & Tesla. Vroege evaluaties tonen prestaties die dicht bij, wellicht voorbij Opus liggen. RL blijft het model significant verbeteren, en het Grok Build-harnas wordt elke dag beter…”

Dit werd versterkt door accounts zoals @testingcatalog en @ai_for_success, met architectuurdetails over de 1,5T V9 en Cursor-integratie: "Grok 4.5 is gebaseerd op 1,5T V9-fundamentmodel, met Cursor-data toegevoegd in aanvullende training."

Cursor-signaal: xAI/SpaceX’ beweging richting overname of diep partnerschap met Cursor (Anysphere) voor ~$60B biedt een rijke bron van echte ontwikkelaars-IDE-traces, agentische workflows en multi-file-bewerkingsdata. Deze aanvullende training (na pretraining) differentieert Grok 4.5 voor codingtaken, al merken experts op dat integratie tijdens de pretraining nog sterker zou zijn.

Grok 4.5 uitgebracht: architectuur, releasedatum en wat we verder weten

Bron: @mark_k

Het menu-statussignaal is smaller maar meer bewijsachtig. Volgens Mark Kretschmanns post van 28 juni werd het versienummer voor het Grok 1.5T / Cursor Composer 3-model in de ochtend van 28 juni uit xAI-menu’s verwijderd. Hij beschrijft dat als een patroon dat vooraf kan gaan aan xAI-releases. Dit is geen formele lancering, maar het is concreter dan een gereposte prestatieclaim omdat het is gekoppeld aan een screenshot.

Het latere kanariesignaal duwde het verhaal verder. TestingCatalog spotted een Grok-web-UI-string met de tekst "Unlock the full power of Chat with Grok 4.5." Dat soort trace duikt vaak op vóór een productwijziging, maar kan ook worden laten vallen, uitgesteld of verborgen achter een beperkte uitrol.

Wat we redelijkerwijs van Grok 4.5 kunnen verwachten

  1. Verbeterde coding- en agentische prestaties: Aanvullende Cursor-data zou SWE-Bench-achtige taken, redeneren over meerdere bestanden en echte ontwikkelaarsworkflows moeten verbeteren. Verwacht sterke punten in technische redenering, debuggen en engineering op productieschaal — gebieden die aansluiten bij SpaceX/Tesla-gebruiksscenario’s.
  2. Schaal en efficiëntie: Met 1,5T parameters op geoptimaliseerde V9 (Blackwell-era GPU’s via Colossus) balanceert het brute kracht met inference-haalbaarheid. RL-verbeteringen na bèta kunnen gaten in redenering dichten.
  3. Snelle iteratie: Musk noemde maandelijks nieuwe modellen vanaf scratch. Grok 4.5 fungeert als tussenstap, met een grotere 2T+-run die Cursor-data al vanaf pretraining incorporeert.
  4. Multimodaal en toolgebruik: Voortbouwend op eerdere Grok-capabilities (vision, search, Grok Build) mag je uitgebreide agentische features verwachten.
  5. Publieke uitroltijdlijn: UI-traces suggereren dagen tot weken voor bredere toegang. Historische patronen duiden op 1–2 weken van teaser tot preview.

Voor productiegebruik vandaag: Integreer in de tussentijd via de Grok-endpoints van CometAPI. Hun OpenAI-compatibele API ondersteunt naadloos schakelen en biedt kostenbesparingen (bijv. Grok 4 tegen gereduceerde tarieven), ideaal om apps te bouwen die eenvoudig upgraden naar Grok 4.5. Bekijk CometAPI Grok-aanbod voor details.

De harde feiten komen uit officiële docs, en de officiële docs zijn stil over Grok 4.5. xAI’s modelpagina vermeldt grok-build-0.1 als een codingmodel dat specifiek is getraind voor agentische codingworkflows, met een contextvenster van 256k en $1.00 / $2.00 per 1M input-/outputtokens in de xAI-prijsdocs. Het vermeldt grok-4.3 voor algemeen gebruik, met een contextvenster van 1M tokens en $1.25 / $2.50 per 1M input-/outputtokens. De xAI-paginamet ratelimieten bevat Grok 4.3 en Grok Build 0.1, en de xAI function-calling-docs leggen het huidige toolgebruik uit, maar geen van die pagina’s vermeldt Grok 4.5.

Die afwezigheid doet ertoe. Een model kan intern echt zijn en toch niet beschikbaar via de publieke API. Teams moeten “xAI test dit mogelijk” scheiden van “ontwikkelaars kunnen dit inzetten”.

Publieke discussie is nog steeds nuttig voor een smallere doelstelling: het vertelt ons wat bouwers als eerste moeten testen.

De vervolgvragen zijn nuttiger dan de hype:

  • Vermindert Cursor-stijl data mislukte patchpogingen?
  • Navigeert Grok 4.5 repositories beter dan Grok 4.3 of Grok Build?
  • Verslaat het Claude Opus 4.8 op echte multi-file-taken?
  • Heeft het minder retries, minder toolcalls of minder menselijke review nodig?
  • Blijft het concurrerend wanneer latentie en outputlengte worden gemeten?
  • Generaliseert het buiten Cursor-achtige workflows?

Behandel X-threads als signalen, niet als specificaties. De specificaties beginnen wanneer xAI zijn modeldocs of releasenotes bijwerkt.

Grok 4.5 vs Claude Opus: verwachte prestaties

De echte routeringsvraag is niet “Is Grok 4.5 spannend?” Het is: Moet een coding- of agent-workflow Grok 4.5 gebruiken in plaats van Claude Opus 4.8 zodra Grok 4.5 beschikbaar komt?

Claude Opus 4.8 is de schone baseline omdat Anthropic publieke documentatie en benchmarkdata heeft. Anthropics modeloverzicht vermeldt Claude Opus 4.8 met een contextvenster van 1M tokens en 128k max output. Anthropics Opus 4.8-aankondiging positioneert het rond complexe agentische taken, coding en enterprise-usecases, terwijl de prijspagina de officiële API-prijsbasis geeft.

De system card van Opus 4.8 geeft echte cijfers. In de evaluatiesamenvatting rapporteert Opus 4.8 88,6 op SWE-bench Verified, 69,2 op SWE-bench Pro, 74,6 op Terminal-Bench 2.1, 83,4 op OSWorld-Verified en 1890 op GDPval-AA.

Verwachte sterke punten van Grok 4.5:

  • Codingspecialisatie: Cursor-data biedt een uniek voordeel in echte ontwikkelaarstraces die door synthetische benchmarks worden ondergewaardeerd. Eerdere Grok-modellen waren al competitief op coding; dit kan het op agentische taken verder vooruit helpen.
  • Schaal & Snelheid: 1,5T parameters + Colossus-infrastructuur kan sterke throughput en long-context-verwerking opleveren.
  • Kosten/toegankelijkheid: xAI-modellen zijn vaak scherp geprijsd; CometAPI verlaagt de kosten verder (bijv. Grok 4-serie met aanzienlijke besparingen).

Sterke punten van Claude Opus (huidige vlaggenschip):

  • Bewezen benchmarks: Hoge SWE-Bench (~80%+ in recente versies), sterke redenering (GPQA, ARC-AGI), uitstekende instructievolging en safety.
  • Volwassen ecosysteem: Robuust toolgebruik, artifacts en enterprise-features.

Vergelijkingstabel (geprojecteerd/beredeneerd op basis van beschikbare data)

AspectGrok 4.5 (Verwacht)Claude Opus (Huidig)
Parameters1,5T (V9)Niet bekendgemaakt (dense/expert-mix)
Coderen (SWE-Bench, geschat)Competitief/leidend (Cursor-boost)~80%+ Verified
Algemene redenering (GPQA/MMLU)Dicht bij/boven OpusLeidend
ContextvensterGroot (geprojecteerd 200k+)200k+
Prijs (via API)Competitief (goedkoper via CometAPI)Premium
DataspecialisatieCursor-IDE-tracesBreed + gecureerd
BeschikbaarheidPrivate bèta → binnenkort?Publieke API
TrainingscadansMaandelijks vanaf scratchIteratief

Behandel de Opus-vergelijking als benchmarkdoel, niet als conclusie. Als Grok 4.5 werkelijk dicht bij of voorbij Opus ligt, zou dat zichtbaar moeten zijn in het aantal opgeloste taken, minder retries, minder reviewer-edits en betere herstelcapaciteit in tool-loops. Als het alleen demo’s wint, is dat niet genoeg voor productieroutering.

Drie technische schaduwzones

Het migratierisico is niet alleen de modelkwaliteit. Drie minder zichtbare details kunnen een Grok 4.5-uitrol duur of fragiel maken.

1. Verbeteringen afgestemd op Cursor vertalen mogelijk niet naar jouw coding-stack

Als het trainingssignaal afkomstig is van Cursor-workflows, is het model mogelijk het sterkst in Cursor-achtige bewerkpatronen. Jouw productiesysteem kan anders zijn: server-side agents, CI-repairbots, GitHub-issue-triage, interne repo-migratie of lokale developer-assistants.

Evaluatiechecklist:

  • Neem echte repositories op, geen speelgoedprompts.
  • Neem taken op die lezen vóór bewerken vereisen.
  • Neem herstel van mislukte tests op.
  • Scoor uiteindelijke patch-correctheid, niet alleen antwoordkwaliteit.
  • Vergelijk plain chat-modus met agentmodus.
  • Meet of Grok 4.5 retries verlaagt vergeleken met Opus 4.8 en Grok 4.3.

2. Prestaties in private bèta kunnen afhangen van interne frameworks

Een model dat binnen SpaceX of Tesla wordt getest kan voordeel hebben van interne tools, gecureerde prompts, private evaluatietaken of gespecialiseerde retrieval. Een publieke API-versie kan zich anders gedragen.

Evaluatiechecklist:

  • Leg de exacte model-ID en releasedatum vast.
  • Noteer toolbeschikbaarheid voor elke run.
  • Scheid modelkwaliteit van frameworkkwaliteit.
  • Volg p50- en p95-latentie.
  • Volg toolfouten en ongeldige toolaanroepen.
  • Vergelijk geen interne-agent-demo met een ruwe API-call.

3. Prijzen en contextlimieten kunnen benchmarkwinsten tenietdoen

Zelfs als Grok 4.5 sterker is, is het mogelijk niet goedkoper. Tokentarieven, contextvenster, outputlimiet, prompt-caching, ratelimieten en kosten van tool-calls doen er allemaal toe.

Gebruik deze routeringsmetriek:

Effectieve kosten per opgeloste taak = (primaire modelkosten + retry-kosten + fallback-kosten + kosten voor menselijke review) / succesvolle taken

Als Grok 4.5 meer taken oplost met minder retries, kan een hogere tokenprijs het waard zijn. Als het meer tokens gebruikt, langer loopt of meer review vereist, vertaalt de launch-hype zich niet naar lagere werkbelastingkosten.

Grok 4.5 zelf evalueren

Gebruik de lekperiode om de evaluatie voor te bereiden voordat het model verschijnt.

1. Stel een set van 20 taken voor code-agents samen

Neem echte taken op:

  • bugfix in je eigen repo
  • refactor over meerdere bestanden
  • dependency-migratie
  • herstel van falende test
  • codereview met subtiele regressie
  • documentatie-update gekoppeld aan code
  • UI-bug op basis van screenshot plus broncode
  • SQL- of datapijplijnprobleem
  • tool-calling-workflow
  • long-context vraag over een repository

2. Voer dezelfde taken uit op beschikbare baselines

Wacht niet op Grok 4.5 om te beginnen met meten. Voer dezelfde taken uit op:

  • Grok 4.3 voor huidige xAI algemene redenering
  • Grok Build 0.1 voor de officiële xAI-codingmodel-baseline waar beschikbaar
  • Claude Opus 4.8 voor hoogwaardige coding en agentisch werk
  • Claude Sonnet 5 voor lagere-kosten productieroutering
  • je huidige productiemodel

3. Meet de kosten per opgeloste taak

Houd bij:

  • invoertokens
  • uitvoertokens
  • toolcalls
  • retries
  • mislukte patches
  • test-passrate
  • latentie
  • reviewer-edits
  • uiteindelijke pass/fail-score
  • kosten per geaccepteerde patch

Vergelijk geen eenmalige outputs. Vergelijk dezelfde taken, dezelfde instructies, dezelfde tools en dezelfde beoordelingsrubriek.

4. Voeg Grok 4.5 pas toe na publieke beschikbaarheid

Wanneer xAI of CometAPI een stabiele Grok 4.5-model-ID beschikbaar stelt, voeg die dan toe aan dezelfde evaluatie. Herschrijf de evaluatie niet rond het nieuwe model. Het punt is juist een benchmark stabiel genoeg te houden dat de vergelijking betekenisvol is.

5. Beslis per werkbelastingklasse

Gebruik het winnende model per taaktype, niet per merk:

  • Gebruik het goedkopere model wanneer het taalsucces vergelijkbaar is.
  • Gebruik Opus 4.8 wanneer fouten duur zijn en Grok 4.5 geen pariteit heeft bewezen.
  • Gebruik Grok 4.5 alleen waar het je huidige baselines op je eigen taken verslaat.
  • Houd een fallback-route aan totdat foutpercentages, latentie en kosten stabiel zijn.

Wat we weten vs. wat we nog niet kunnen verifiëren

Bevestigd / sterk gesignaleerd:

  • 1,5T V9-fundament + Cursor-aanvullende training.
  • Private bèta bij SpaceX/Tesla (28 juni 2026).
  • Musk-toegeschreven claim “dicht bij/beter dan Opus”.
  • Maandelijkse nieuwe model-roadmap.
  • UI-kanarie-traces.

Ongeverifieerd / open vragen:

  • Exacte benchmarks (geen system card).
  • Publieke releasedatum en API-prijzen.
  • Volledig contextvenster, multimodale capaciteiten.
  • Precieze Cursor-datavolume, licentie en mixratio.
  • Prestaties vs. specifieke Opus-versie of andere frontiers (bijv. GPT-5.5, Gemini 3.x).
  • Grok 4.5 vs. geruchte grotere Grok 5-varianten.

Behandel claims als vendor-richtinggevend. De geschiedenis laat zien dat interne evaluaties kunnen verschillen van publieke; onafhankelijke verificatie is essentieel.

Waar op te letten de komende tijd

Let de komende weken op vijf zaken:

  1. xAI-modeldocs die een Grok 4.5-model-ID toevoegen.
  2. xAI-releasenotes die publieke of preview-beschikbaarheid bevestigen.
  3. Onafhankelijke coding-agent-benchmarks, vooral SWE-bench, Terminal-Bench en Cursor-stijl coding-agent-taken.
  4. Echte ontwikkelaarsrapporten over Cursor-achtige codingworkflows.
  5. CometAPI-catalogus of dashboardupdates voor Grok 4.5-beschikbaarheid.

Het eerste betrouwbare koopsignaal is geen virale X-post. Het is een model-ID plus herhaalbare evaluatieresultaten.

Toekomstperspectief: maandelijkse modellen en verder

Het tempo van xAI — maandelijks nieuwe fundamentmodellen — kan iteratiesnelheid herdefiniëren. Grok 4.5 is een incrementele sprong; Grok 5-varianten beloven meer. Verwacht aanhoudende nadruk op waarheidsvinding, humor en praktische bruikbaarheid in lijn met Musks visie.

Call to Action: Meld je vandaag nog aan bij CometAPI om krachtige Grok-modellen betaalbaar te gebruiken en voorop te blijven. Volg x.ai en X voor officiële Grok 4.5-updates. De AI-codingrevolutie versnelt — positioneer je workflows nu.

Verder leren

Koppel dit artikel aan de volgende beslissing.

Alle onderwerpen bekijken
Gepubliceerd op Jul 8, 2026
Laatst bijgewerkt Sep 3, 2026
203 weergaven
Gecontroleerd op duidelijkheid, bronvermelding en actuele API-terminologie.

Klaar om de AI-ontwikkelingskosten met 20% te verlagen?

Start gratis in enkele minuten. Gratis proeftegoeden inbegrepen. Geen creditcard vereist.

Lees Meer