GPT-5.6 Luna price down 80%, Terra down 20% →

Modelbølgen i juli 2026: GPT-5.6, Gemini 3.6 Flash, Grok 4.5, Kimi K3 osv.

CometAPI
AnnaAug 1, 2026
Modelbølgen i juli 2026: GPT-5.6, Gemini 3.6 Flash, Grok 4.5, Kimi K3 osv.

TL;DR: Seks større modeludgivelser landede inden for cirka tre uger i juli 2026: OpenAIs tre-niveaus GPT-5.6-familie (Sol/Terra/Luna), Googles Gemini 3.6 Flash, xAIs Grok 4.5, Moonshot AIs Kimi K3, Anthropics Claude Opus 5 og Zhipus GLM-5.2. Ingen er et universelt bedste valg. Det praktiske valg afhænger af dybden af ræsonnering, kodeydelse, pris pr. token, kontekstkrav og om open-weight-udrulning er vigtig. Denne sammenligning bruger aktuelle officielle udbyderoplysninger og CometAPI-lister, hvor benchmark-påstande er mærket med kilde i stedet for at blive behandlet som en enkelt universel rangering.

Vigtigste pointer:

  • GPT-5.6 er ikke én model — det er tre (Sol/Terra/Luna) på tre forskellige prisniveauer, og at vælge det forkerte niveau er en større omkostningsfejl end at vælge den “forkerte” modelfamilie.
  • Gemini 3.6 Flash og GLM-5.2 udgiver begge et kontekstvindue på 1.000.000 tokens; Kimi K3 matcher også tallet — kontekststørrelse er ikke længere en differentieringsfaktor blandt denne generations førende modeller.
  • GLM-5.2 og Kimi K3 understøtter begge open-weight-udrulning, men de bruger ikke samme licens. GLM-5.2 er udgivet under MIT License; Kimi K3 bruger den separate Kimi K3 License, hvis kommercielle vilkår bør gennemgås før selvhosting eller tilbud om model-as-a-service-adgang.
  • Claude Opus 5 er officielt udgivet. Anthropic annoncerede den 24. juli 2026 med et kontekstvindue på 1M tokens, op til 128K synkront output og officiel prissætning på $5 pr. million input-tokens og $25 pr. million output-tokens; CometAPI viser i øjeblikket den til $4/$20.

Hvad der faktisk blev lanceret denne måned

Juli 2026 var usædvanligt tæt pakket med udgivelser af frontier- og near-frontier-modeller. Inden for cirka tre uger lancerede OpenAI GPT-5.6-familien (9. jul.), xAI udgav Grok 4.5 (8. jul.), Moonshot AI udgav Kimi K3 (16. jul.), Google udgav Gemini 3.6 Flash (21. jul.), og Anthropic lancerede officielt Claude Opus 5 (24. jul.). Zhipus GLM-5.2 kom lidt tidligere i juni, men dens kontekst på 1M tokens og MIT-licenserede åbne udgivelse gør den relevant for samme købs- og udrulningsbeslutning.

Det praktiske spørgsmål for alle, der bygger på disse modeller, er ikke, hvilken der er bedst i abstrakt forstand, men hvilken bekræftet mulighed der passer til en konkret opgave. De seks adskiller sig meningsfuldt i pris, kontekst, kodeadfærd, licensering og udrulningsfleksibilitet.

Priser og specifikationer, side om side

Alle priser nedenfor er pr. million tokens. Hvor en model har flere niveauer, er hvert niveau angivet separat.

ModelInputOutputKontekstvindueLicensUdgivet
GPT-5.6 Sol$5.00$30.00Ikke offentligt specificeretProprietærJul 9, 2026
GPT-5.6 Terra$2.50$15.00Ikke offentligt specificeretProprietærJul 9, 2026
GPT-5.6 Luna$1.00$6.00Ikke offentligt specificeretProprietærJul 9, 2026
Grok 4.5$2.00$4.00Ikke offentligt specificeretProprietærJul 8, 2026
Kimi K3$3.00$15.001,048,576 tokensÅbne vægte (Kimi K3 License)Jul 16, 2026
Gemini 3.6 Flash$1.50$7.501,048,576 tokens (65,536 output)ProprietærJul 21, 2026
GLM-5.2$1.40$4.411,000,000 tokensÅben (MIT License)Jun 13, 2026
Claude Opus 5$5.00$25.001,000,000 tokens (128K output)ProprietærJul 24, 2026

*Officielle udbyderpriser vist ovenfor; en samlet API, der anvender en standardrabat, vil sænke hver af disse proportionalt — pointen med tabellen er den relative afstand mellem modeller, ikke en specifik leverandørs pris ved checkout.

Et par ting springer i øjnene i pris- og specifikationstabellen. Sol, det øverste GPT-5.6-niveau, er prissat til frontier-ræsonnering og agentbaseret arbejde frem for daglig brug, mens Grok 4.5’s outputpris er relativt lav i forhold til dens positionering. GLM-5.2 har den laveste listede outputpris i denne gruppe og bruger den permissive MIT License. Kimi K3 leverer også downloadbare vægte og en 1M-token-kontekst, men under den separate Kimi K3 License frem for MIT. Gemini 3.6 Flash, Kimi K3, GLM-5.2 og Claude Opus 5 udgiver alle omtrent 1M-token-kontekstvinduer, så kontekstkapacitet alene er ikke længere nok til at vælge mellem dem. CometAPI’s listede priser er generelt lavere end udbydernes listepriser, men evaluering på arbejdsmængdeniveau er stadig mere nyttig end at sammenligne tokenpriser isoleret.

Hvad hver enkelt faktisk er tunet til

GPT-5.6 Sol er positioneret til frontier-ræsonnering, agentbaseret kodning og langvarigt teknisk arbejde — den understøtter en "Max Reasoning Effort"-tilstand og en "Ultra Mode", der kører sub-agenter parallelt. Dette er niveauet til svære, flertrins problemer, ikke rutineopgaver, givet prisforskellen til Terra og Luna.

GPT-5.6 Terra er det afbalancerede mellemtrin — daglig produktivitet, dokumentation, kodeassistance og forretningsautomatisering. For de fleste applikations-backends, der ikke specifikt behøver Sols ræsonneringsdybde, er Terra det mere forsvarlige standardvalg.

GPT-5.6 Luna retter sig mod letvægts-, højvolumenbrug: klassifikation, kundesupportflows, onboarding, gentagen indholdsgenerering. Til $1.00/$6.00 pr. million tokens (før eventuelle gateway-rabatter) er den prissat til netop den type højkaldsvolumen og lav kompleksitet — og den understøtter også cachet input-prissætning med 90 % rabat i forhold til standard input-satsen, hvilket betyder mere her end for de højere niveauer, givet hvor repetitive højvolumen-arbejdsbelastninger typisk er.

Grok 4.5 offentliggør ikke en udtalt specialisering som GPT-5.6-niveauerne gør, men dens pris placerer den mellem budget- og mellemklasse — værd at sammenligne direkte mod Terra eller Kimi K3 for en konkret arbejdsbelastning i stedet for at antage positionering ud fra pris alene.

Kimi K3 er en Mixture-of-Experts-model med 2,8 billioner parametre, bygget til langhorizon-kodning, multimodalt vidensarbejde og omfattende dokument- eller repository-analyse inden for en 1M-token-kontekst. Moonshot AI har udgivet de fulde vægte, så selvhosting er mulig, men udgivelsen bruger Kimi K3 License, som indeholder kommercielle vilkår, der adskiller sig fra en standard MIT-udgivelse.

Gemini 3.6 Flash er Googles effektivitetsfokuserede udgivelse: den er eksplicit indrammet som en inkrementel, omkostnings- og latenstidsoptimeret efterfølger til 3.5 Flash frem for en ny frontier-model, med reelle gevinster på kode- og agentbaserede benchmarks sammen med en lavere outputpris pr. token end forgængeren. Det er valget til agentbaserede arbejdsbelastninger, hvor tokeneffektivitet og omkostning pr. fuldført opgave betyder lige så meget som rå kapabilitet.

GLM-5.2 er den mere permissivt licenserede åbne mulighed i denne sammenligning. Z.ai udgav den under MIT License med en 1M-token-kontekst og eksplicit vægt på langhorizon-kodning, værktøjsbrug og justerbar tænkeindsats. Teams kan få adgang via en API eller køre de publicerede vægte lokalt, afhængigt af deres egen infrastruktur og evalueringskrav.

Sammenligning af kodeevner

De seks udgivelser sigter efter forskellige ingeniørmønstre, så kodeevne forstås bedst som arbejdsbelastningsmatch frem for en enkelt rang.

  • Claude Opus 5 passer bedst til svær debugging, rodårsagsanalyse, store refaktoreringer og langtidskørende softwareagenter; Anthropic fremhæver stærkere verifikation og iteration.
  • GPT-5.6 Sol, Terra og Luna giver en trinvis vej fra kompleks kodning og ræsonnering til balanceret udviklingsarbejde og højvolumen kodehjælp.
  • Gemini 3.6 Flash er tunet til hurtige agentbaserede kodningssløjfer, hvor latenstid og omkostning pr. iteration er vigtige.
  • Kimi K3 er designet til langhorizon-kodning over meget store repositorier, med en 1M-token-kontekst og downloadbare vægte.
  • GLM-5.2 kombinerer langhorizon-kodning, værktøjsbrug, justerbar tænkeindsats og MIT-licenseret lokal udrulning.
  • Grok 4.5 behandles bedst som en kandidat til direkte evaluering mod de andre, fordi dens officielle positionering ikke giver samme specialiseringsopdeling for kodning som den tierede GPT-familie.

Afvejningen ved at sammenligne (og skifte mellem) modeller så ofte

Intet af dette er et argument for at jage hver ny udgivelse. At skifte produktionsarbejdsbelastninger til en ny model hver gang en lanceres har reelle omkostninger: retest af prompts, revurdering af outputkvalitet og genberegning af omkostning pr. opgave mod din faktiske trafik, ikke et benchmarks syntetiske trafik. En samlet API fjerner ikke evalueringsarbejdet, men den fjerner den separate konto- og faktureringsoverhead ved faktisk at køre sammenligningen — at kunne kalde GPT-5.6 Terra, Gemini 3.6 Flash, Kimi K3 og GLM-5.2 gennem samme request-format og én faktura gør det realistisk at teste mere end én kandidat før man forpligter sig, i stedet for bare at vælge den udbyder, man allerede havde en nøgle til.

Det er en reel fordel, ikke en fuldstændig løsning — det erstatter ikke læsning af hver models faktiske dokumentation, og det gør ikke modelvalget gratis for de skifteomkostninger, der er beskrevet ovenfor. Det, det gør, er at sænke prisen for at finde ud af, hvilken model der faktisk er rigtig til en given arbejdsbelastning, hvilket er en anden (og mere ærlig) påstand end “denne model er den bedste.”

FAQ

Hvilken AI-model udgivet i juli 2026 er bedst? Der er ikke ét bedste svar. GPT-5.6 Sol og Claude Opus 5 er målrettet krævende ræsonnering og kodningsarbejde; Gemini 3.6 Flash lægger vægt på effektive agentbaserede sløjfer; Kimi K3 kombinerer lang kontekst med åbne vægte; og GLM-5.2 kombinerer langhorizon-kapabilitet med en MIT-licens. Det rigtige valg afhænger af arbejdsbelastningen og udrulningsbegrænsningerne.

Er GPT-5.6 én model eller flere? Tre: Sol (flagskib, frontier-ræsonnering), Terra (balanceret, daglig brug) og Luna (hurtig og lavpris, højvolumenopgaver) — hver prissat separat, fra $0.80/$4.80 pr. million tokens for Luna op til $4.00/$24.00 for Sol.

Er Claude Opus 5 officielt udgivet? Ja. Anthropic annoncerede Claude Opus 5 den 24. juli 2026. Den officielle udgivelse beskriver et kontekstvindue på 1M tokens og positionerer modellen til kompleks agentbaseret kodning og vidensarbejde; officiel API-pris er $5 pr. million input-tokens og $25 pr. million output-tokens.

Hvilken af disse modeller er billigst at køre i stor skala? På de listede udbyder-outputpriser i tabellen er GLM-5.2 den billigste mulighed og er tilgængelig under MIT License. Kimi K3 har også åbne vægte, men dens separate Kimi K3 License og meget større modelfodaftryk ændrer selvhostingsøkonomien. GPT-5.6 Luna er den billigste proprietære, kun-API mulighed, der er dækket her.

Skal jeg vælge én model og committe, eller kan jeg teste flere? At teste mere end én mod dine faktiske prompts og trafik er generelt indsatsen værd før du sender produktionstrafik — en samlet API (CometAPI blandt andre) gør det konkret billigere, da den fjerner konto-overhead ved at køre sammenligningen, men den erstatter ikke læsning af hver models egen dokumentation.

Konklusion

Udgivelsesbølgen i juli 2026 gav ikke én klar vinder. Den gav seks bekræftede muligheder, der afvejer forskelligt på ræsonneringsdybde, kodeydelse, tokenomkostning, kontekst og licensering. GPT-5.6 Sol og Claude Opus 5 sigter mod det hårdeste ræsonnerings- og softwareingeniørarbejde; Gemini 3.6 Flash og GPT-5.6 Luna lægger vægt på effektivitet; Kimi K3 bringer åbne vægte og en 1M-token multimodal kontekst under sin egen licens; og GLM-5.2 tilbyder et 1M-token, MIT-licenseret alternativ. Alle er tilgængelige via CometAPI under én nøgle, hvilket gør kontrolleret test nemmere, men modelvalg bør stadig baseres på prompts, værktøjer, latenstidsmål og succeskriterier for den faktiske arbejdsbelastning.

53 visninger
Gennemgået for klarhed, kildeangivelse og aktuel API-terminologi.

Klar til at skære AI-udviklingsomkostninger med 20%?

Kom gratis i gang på få minutter. Gratis prøvekreditter inkluderet. Intet kreditkort påkrævet.

Læs mere