DeepSeek Vision and Grok Imagine models are now live on CometAPI →
ai-comparisons/CometAPI research

De modelgolf van juli 2026: GPT-5.6, Gemini 3.6 Flash, Grok 4.5, Kimi K3 enz.

Gelieve de brontekst of het bestand te leveren dat u naar het Nederlands vertaald wilt hebben.

CometAPI
AnnaOnderzoeksteam voor AI-modellen en API
Bijgewerkt Aug 22, 2026 9 min leestijd
De modelgolf van juli 2026: GPT-5.6, Gemini 3.6 Flash, Grok 4.5, Kimi K3 enz.
Gebruik dit patroon

Doe de eerste API-aanroep.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR: Zes grote modelreleases verschenen binnen ongeveer drie weken van elkaar in juli 2026: OpenAI's drielaagse GPT-5.6-familie (Sol/Terra/Luna), Google's Gemini 3.6 Flash, xAI's Grok 4.5, Moonshot AI's Kimi K3, Anthropic's Claude Opus 5 en Zhipu's GLM-5.2. Geen ervan is universeel de beste keuze. De praktische keuze hangt af van redeneerdiepte, codeerprestaties, kosten per token, contextvereisten en de vraag of deployment met open gewichten belangrijk is. Deze vergelijking gebruikt actuele officiële informatie van providers en CometAPI-vermeldingen, met benchmarkclaims gelabeld per bron in plaats van als één universele ranglijst behandeld.

Belangrijkste punten:

  • GPT-5.6 is niet één model — het zijn er drie (Sol, Terra, Luna) met drie verschillende prijsniveaus, en de verkeerde laag kiezen is een grotere kostenfout dan de verkeerde modelfamilie kiezen.
  • Gemini 3.6 Flash en GLM-5.2 publiceren beide een contextvenster van 1,000,000 tokens; Kimi K3 haalt dat cijfer ook — de contextgrootte is niet langer een onderscheidende factor onder de toonaangevende modellen van deze generatie.
  • GLM-5.2 en Kimi K3 ondersteunen beide deployment met open gewichten, maar ze gebruiken niet dezelfde licentie. GLM-5.2 is uitgebracht onder de MIT-licentie; Kimi K3 gebruikt de aparte Kimi K3-licentie, waarvan de commerciële voorwaarden moeten worden beoordeeld vóór zelf-hosting of het aanbieden van model-as-a-service-toegang.
  • Claude Opus 5 is officieel uitgebracht. Anthropic kondigde het aan op 24 juli 2026 met een contextvenster van 1M tokens, tot 128K synchrone output, en officiële prijzen van $5 per miljoen invoertokens en $25 per miljoen uitvoertokens; CometAPI vermeldt het momenteel op $4/$20.

Wat er deze maand daadwerkelijk is geleverd

Juli 2026 was een uitzonderlijk drukke maand voor frontier- en near-frontier-modelreleases. In ongeveer drie weken bracht OpenAI de GPT-5.6-familie uit (9 jul), lanceerde xAI Grok 4.5 (8 jul), bracht Moonshot AI Kimi K3 uit (16 jul), bracht Google Gemini 3.6 Flash uit (21 jul), en lanceerde Anthropic officieel Claude Opus 5 (24 jul). Zhipu’s GLM-5.2 verscheen iets eerder in juni, maar de 1M-tokencontext en MIT-gelicentieerde open release maken het relevant voor dezelfde aankoop- en deploymentbeslissing.

De praktische vraag voor iedereen die op deze modellen bouwt is niet welk model in abstracto het beste is, maar welke bevestigde optie bij een specifieke taak past. De zes verschillen wezenlijk in kosten, context, codeergedrag, licenties en deployflexibiliteit.

Prijzen en specificaties, naast elkaar

Alle onderstaande prijzen zijn per miljoen tokens. Waar een model meerdere lagen heeft, wordt elke laag afzonderlijk vermeld.

ModelInputOutputContextvensterLicentieUitgebracht
GPT-5.6 Sol$5.00$30.00Niet openbaar gespecificeerdPropriëtairJul 9, 2026
GPT-5.6 Terra$2.50$15.00Niet openbaar gespecificeerdPropriëtairJul 9, 2026
GPT-5.6 Luna$1.00$6.00Niet openbaar gespecificeerdPropriëtairJul 9, 2026
Grok 4.5$2.00$4.00Niet openbaar gespecificeerdPropriëtairJul 8, 2026
Kimi K3$3.00$15.001,048,576 tokensOpen gewichten (Kimi K3-licentie)Jul 16, 2026
Gemini 3.6 Flash$1.50$7.501,048,576 tokens (65,536 uitvoer)PropriëtairJul 21, 2026
GLM-5.2$1.40$4.411,000,000 tokensOpen (MIT-licentie)Jun 13, 2026
Claude Opus 5$5.00$25.001,000,000 tokens (128K uitvoer)PropriëtairJul 24, 2026

*De bovenstaande officiële providerprijzen zijn getoond; een uniforme API die een standaardkorting toepast, zou elk hiervan evenredig verlagen — het punt van de tabel is het relatieve verschil tussen modellen, niet de afrekenprijs van een specifieke aanbieder.

Er springen een paar zaken uit de prijs- en specificatietabel. Sol, de hoogste GPT-5.6-laag, is geprijsd voor frontier-redenering en agentisch werk in plaats van alledaags gebruik, terwijl de outputprijs van Grok 4.5 relatief laag is voor zijn positionering. GLM-5.2 heeft de laagste vermelde outputprijs in deze groep en gebruikt de permissieve MIT-licentie. Kimi K3 levert ook downloadbare gewichten en een 1M-tokencontext, maar onder de aparte Kimi K3-licentie in plaats van MIT. Gemini 3.6 Flash, Kimi K3, GLM-5.2 en Claude Opus 5 publiceren allemaal grofweg 1M-tokencontextvensters, dus alleen op basis van contextcapaciteit is het niet langer mogelijk om hiertussen te kiezen. De door CometAPI vermelde tarieven zijn over het algemeen lager dan de lijstprijzen van providers, maar evaluatie op workloadniveau blijft nuttiger dan het geïsoleerd vergelijken van tokenprijzen.

Waar elk model daadwerkelijk op is afgestemd

GPT-5.6 Sol is gepositioneerd voor frontier-redenering, agentische coding en langetermijn technisch werk — het ondersteunt een "Max Reasoning Effort"-modus en een "Ultra Mode" die subagenten parallel inzet. Dit is de laag voor moeilijke, meerstapsproblemen, niet voor routinetaken, gezien het prijsverschil met Terra en Luna.

GPT-5.6 Terra is de gebalanceerde middencategorie — dagelijkse productiviteit, documentatie, codeerondersteuning en zakelijke automatisering. Voor de meeste applicatie-backends die Sols redeneerdiepte niet specifiek nodig hebben, is Terra de verdedigbaardere standaard.

GPT-5.6 Luna richt zich op lichtgewicht gebruik met hoog volume: classificatie, klantenondersteuningsflows, onboarding, herhaalde contentgeneratie. Met $1.00/$6.00 per miljoen tokens (vóór enige gatewaykorting) is het precies geprijsd voor dit soort hoge-call-volumes met lage complexiteit — en het ondersteunt ook tariefstelling voor geachete invoer met 90% korting op het standaard invoertarief, wat hier zwaarder weegt dan bij de hogere lagen, gezien hoe repetitief workloads met hoog volume neigen te zijn.

Grok 4.5 publiceert geen expliciete specialisatie zoals de GPT-5.6-lagen dat doen, maar de prijs plaatst het tussen een budget- en middensegmentoptie — de moeite waard voor een directe benchmarkvergelijking met Terra of Kimi K3 voor een specifieke workload, in plaats van de positionering uit de prijs af te leiden.

Kimi K3 is een Mixture-of-Experts-model met 2.8 biljoen parameters, gebouwd voor langetermijncodering, multimodaal kenniswerk en uitgebreide document- of repositoryanalyse binnen een 1M-tokencontext. Moonshot AI heeft de volledige gewichten vrijgegeven, zodat zelf hosten mogelijk is, maar de release gebruikt de Kimi K3-licentie, die commerciële voorwaarden bevat die afwijken van een standaard MIT-release.

Gemini 3.6 Flash is Google's efficiëntiegerichte release: het wordt expliciet neergezet als een incrementele, op kosten en latentie geoptimaliseerde opvolger van 3.5 Flash in plaats van een nieuw frontier-model, met echte winst op codeer- en agentische benchmarks, naast een lagere outputprijs per token dan zijn voorganger. Het is de keuze voor agentische workloads waar token-efficiëntie en kosten per voltooide taak net zo belangrijk zijn als ruwe capaciteit.

GLM-5.2 is de meer permissief gelicentieerde open optie in deze vergelijking. Z.ai bracht het uit onder de MIT-licentie met een 1M-tokencontext en expliciete nadruk op langetermijncodering, toolgebruik en instelbare denkinspanning. Teams kunnen er via een API toegang toe krijgen of de gepubliceerde gewichten lokaal draaien, afhankelijk van hun eigen infrastructuur en evaluatievereisten.

Vergelijking van codeercapaciteit

De zes releases richten zich op verschillende engineeringpatronen, dus codeervaardigheid laat zich het beste begrijpen als een workload-fit in plaats van een enkele rangorde.

  • Claude Opus 5 past hier het best bij moeilijke debugging, root-cause-analyse, grote refactors en langlopende softwareagents; Anthropic benadrukt sterker verificatie- en iteratiegedrag.
  • GPT-5.6 Sol, Terra en Luna bieden een getrapt pad van complexe codering en redenering naar gebalanceerd ontwikkelwerk en grootschalige codeerassistentie.
  • Gemini 3.6 Flash is afgestemd op snelle agentische coderingslussen waarbij latentie en kosten per iteratie tellen.
  • Kimi K3 is ontworpen voor langetermijncodering over zeer grote repositories, met een 1M-tokencontext en downloadbare gewichten.
  • GLM-5.2 combineert langetermijncodering, toolgebruik, instelbare denkinspanning en MIT-gelicentieerde lokale deployment.
  • Grok 4.5 kun je het best beschouwen als kandidaat voor directe evaluatie tegen de anderen, omdat de officiële positionering niet dezelfde uitsplitsing naar codeerspecialisatie biedt als de getrapte GPT-familie.

De afweging bij zo vaak modellen vergelijken (en ertussen wisselen)

Dit alles is geen pleidooi om elke nieuwe release na te jagen. Productieworkloads bij elke nieuwe release overschakelen brengt echte kosten met zich mee: prompts hertesten, outputkwaliteit hervalideren en de kosten-per-taak-berekening opnieuw checken op je daadwerkelijke verkeer, niet op een synthetische benchmark. Een geünificeerde API haalt die evaluatietaak niet weg, maar wel de overhead van aparte accounts en afzonderlijke facturatie om de vergelijking daadwerkelijk te draaien — de mogelijkheid om GPT-5.6 Terra, Gemini 3.6 Flash, Kimi K3 en GLM-5.2 via dezelfde request-structuur en één rekening aan te roepen maakt het realistisch om meer dan één kandidaat echt te testen voordat je je vastlegt, in plaats van te defaulten naar welke provider je al een key had.

Dat is een echt voordeel, geen volledige oplossing — het vervangt niet het lezen van de daadwerkelijke documentatie van elk model en het maakt een modelkeuze niet vrij van de hierboven beschreven wisselkosten. Wat het wel doet, is de kosten verlagen om erachter te komen welk model daadwerkelijk geschikt is voor een gegeven workload, wat een andere (en eerlijkere) claim is dan "dit model is het beste."

FAQ

Wat is het beste AI-model dat in juli 2026 is uitgebracht? Er is geen enkel beste antwoord. GPT-5.6 Sol en Claude Opus 5 zijn gericht op veeleisend redeneren en codeerwerk; Gemini 3.6 Flash legt de nadruk op efficiënte agentische lussen; Kimi K3 combineert lange context met open gewichten; en GLM-5.2 combineert langetermijncapaciteit met een MIT-licentie. De juiste keuze hangt af van de workload en deployconstraints.

Is GPT-5.6 één model of meerdere? Drie: Sol (flagship, frontier-redenering), Terra (gebalanceerd, dagelijks gebruik) en Luna (snel en goedkoop, taken met hoog volume) — elk afzonderlijk geprijsd, van $0.80/$4.80 per miljoen tokens voor Luna tot $4.00/$24.00 voor Sol.

Is Claude Opus 5 officieel uitgebracht? Ja. Anthropic kondigde Claude Opus 5 aan op 24 juli 2026. De officiële release beschrijft een contextvenster van 1M tokens en positioneert het model voor complexe agentische codering en kenniswerk; officiële API-prijzen zijn $5 per miljoen invoertokens en $25 per miljoen uitvoertokens.

Welk van deze modellen is het goedkoopst op schaal? Op de in de tabel vermelde provideroutputprijzen is GLM-5.2 de goedkoopste optie en beschikbaar onder de MIT-licentie. Kimi K3 heeft ook open gewichten, maar de aparte Kimi K3-licentie en de veel grotere modelfootprint veranderen de zelf-hosting-economie. GPT-5.6 Luna is de goedkoopste propriëtaire, alleen-API-optie die hier wordt behandeld.

Moet ik één model kiezen en me vastleggen, of kan ik meerdere testen? Meerdere modellen testen tegen je daadwerkelijke prompts en verkeer is doorgaans de moeite waard vóór je productieverkeer vastleggen — een geünificeerde API (CometAPI onder meer) maakt dat specifiek goedkoper, omdat het de overhead van aparte accounts voor de vergelijking wegneemt, al vervangt het niet het lezen van de eigen documentatie van elk model.

Conclusie

De releasegolf van juli 2026 leverde geen duidelijke winnaar op. Ze leverde zes bevestigde opties die verschillend afwegen op redeneerdiepte, codeerprestaties, tokenkosten, context en licenties. GPT-5.6 Sol en Claude Opus 5 richten zich op het zwaarste redeneer- en software-engineeringwerk; Gemini 3.6 Flash en GPT-5.6 Luna benadrukken efficiëntie; Kimi K3 brengt open gewichten en een 1M-token multimodale context onder een eigen licentie; en GLM-5.2 biedt een alternatief met 1M tokens en MIT-licentie. Ze zijn allemaal toegankelijk via CometAPI onder één key, wat gecontroleerd testen gemakkelijker maakt, maar de modelselectie moet nog steeds gebaseerd zijn op de prompts, tools, latentiedoelen en succescriteria van de daadwerkelijke workload.

Verder leren

Koppel dit artikel aan de volgende beslissing.

Alle onderwerpen bekijken
Gepubliceerd op Aug 1, 2026
Laatst bijgewerkt Aug 22, 2026
66 weergaven
Gecontroleerd op duidelijkheid, bronvermelding en actuele API-terminologie.

Klaar om de AI-ontwikkelingskosten met 20% te verlagen?

Start gratis in enkele minuten. Gratis proeftegoeden inbegrepen. Geen creditcard vereist.

Lees Meer