TL;DR: Google heeft bevestigd dat Gemini 4 zijn “meest ambitieuze voortrainingsrun tot nu toe” is. Community-lekken medio september 2026 wijzen op een vroeg intern checkpoint van Gemini 4 Pro (codenaam “argon”) met naar verluidt een limiet van 256k uitvoertokens, mogelijk een context van meerdere miljoenen tokens en modi voor redeneren met hoge inspanning. Onofficiële tijdlijnen convergeren rond oktober 2026 na vertragingen in de voortraining. RSI-koppelingen (recursive self-improvement) blijven speculatief. Tot de officiële release kunnen ontwikkelaars huidige frontier-modellen—waaronder GPT-6 Astra, Gemini 3.8 Flash en Claude Fable 5.1—benaderen via uniforme, afgeprijsde API’s zoals CometAPI.
Belangrijkste punten
- Gemini 4 bestaat en wordt getraind. Google zei in juli 2026 dat het was begonnen aan zijn “meest ambitieuze voortrainingsrun tot nu toe” voor Gemini 4.
- Gemini 4 Pro is niet officieel aangekondigd. De naam, model-ID, prijs, API-beschikbaarheid, contextvenster en definitieve specificaties blijven onbevestigd. Uitgelekte screenshots en communityrapporten beschrijven een Gemini 4 Pro-checkpoint met een limiet van 256k uitvoertokens (vs. eerder ~64k), hoge denkinspanning en mogelijke 1.5M+ contextambities.
- Gemini 4.0 lijkt stilletjes te zijn opgedoken op Arena.ai (blijkbaar wordt Gemini 3.8 Flash binnen Arena gerouteerd naar de nieuwe Gemini Pro)
- De meest geloofwaardige onofficiële doelen wijzen nu op een publieke uitrol in oktober 2026 na verfijningen in de voortraining.
- Claims van sterke RSI voor Gemini 4 blijven niet-geverifieerd; gerelateerd onderzoek (Dream-RSI) verbetert verkenningsstrategieën zonder gewichtsupdates.
- Totdat Gemini 4 Pro officieel wordt uitgebracht, kunnen ontwikkelaars al experimenteren met huidige frontier-modellen via platforms zoals CometAPI, waaronder Gemini 3.8 Flash, GPT-6 Astra en Claude Fable 5.1.
Wat is Gemini 4 Pro?
Gemini 4 Pro is het geruchtenmakende vlaggenschipmodel in de “Pro”-tier van de volgende grote Gemini-generatie van Google DeepMind. Het zit boven de lichtere Flash-varianten en is gepositioneerd voor werk met hoge complexiteit: geavanceerd coderen, meertraps redeneren, agentische taken met lange horizon, multimodale interpretatie en analyse op ondernemingsschaal van documenten of codebases.
In tegenstelling tot de iteratieve 3.x Flash-releases die in 2026 zijn doorgegaan, wordt Gemini 4 door het Google-leiderschap beschreven als een traject dat aanzienlijk grotere basismodellen vereist om concurrerend te blijven aan de frontier. Sundar Pichai verklaarde tijdens de Alphabet Q2 2026 earnings call: “Voor de volgende generatie van de frontier heb je veel grotere basismodellen nodig. We trainen nu Gemini 4, en we zijn er zeer ambitieus mee.”
De “Pro”-aanduiding duidt historisch de publiekelijk hoogst presterende tier aan, geoptimaliseerd voor kwaliteit boven pure snelheid of kosten—vergelijkbaar met eerdere Gemini Pro- en 2.5 Pro-modellen die lange tijd de ranglijsten voor coderen en redeneren aanvoerden.
Wat we weten over Gemini 4 Pro (stand van 17 september)
Bevestigde officiële signalen
Google erkende Gemini 4 publiekelijk in juli 2026. In de launchpost voor Gemini 3.6 Flash (en gerelateerde Flash-varianten) stelde het team dat ze “al waren begonnen aan onze meest ambitieuze voortrainingsrun tot nu toe, voor Gemini 4.” Alphabet-CEO Sundar Pichai bevestigde dit in de Q2-earnings call, waarbij hij Gemini 4 omschreef als een model dat “veel grotere basismodellen” vereist om aan de frontier te blijven, met expliciete nadruk op coderen en autonome agents. Hij uitte interne enthousiasme over de voortgang en vertrouwen dat de resultaten externe gebruikers bij release zullen bevallen.
Er is geen officiële modelkaart, parameteraantal, contextvenster, benchmarks, prijsstelling of API-eindpunt voor Gemini 4 of Gemini 4 Pro gepubliceerd. De Flash-serie (inclusief de Gemini 3.8 Flash en 3.8 Live-varianten van september 2026) blijft frequent updates ontvangen terwijl het grotere Pro-tier-werk voortgaat.
Uitgelekt checkpoint en specificaties
Community-rapportage geeft aan dat Google een vroeg intern checkpoint van het aanstaande Pro-model heeft geproduceerd. één zero-shot ‘peacock’ svg-demo maakt de ronde. Eerder checkpoint was Argon 160 / Gemini 3.8 Flash op Arena. Gerapporteerde details omvatten:
- Een uitvoerlimiet van 256k tokens (een grote toename ten opzichte van de ~64k van eerdere Gemini-modellen).
- Generatie onder een instelling “High” voor denkinspanning die ongeveer 2.4 minuten duurde.
- Koppeling aan de Gemini 4 Pro-tier in plaats van weer een Flash-iteratie.
Kapitaaluitgaven en de RSI-verbinding
Begin augustus 2026 beschreef Jasjeet Sekhon (Chief Strategy Officer) van Google DeepMind publiekelijk de enorme kapitaaluitgaven in AI als een gok op recursive self-improvement (RSI)—systemen die zichzelf of de processen die de volgende generatie modellen produceren, kunnen verbeteren. Hij merkte op dat huidige inkomsten de schaal van de uitgaven nog niet rechtvaardigen en dat RSI een centraal onderdeel van de investeringshypothese wordt, terwijl hij erkende dat het nog niet is bereikt.
Afzonderlijk publiceerden Google-onderzoekers medio september 2026 de Dream-RSI-paper, waarin recursieve verbetering van de verkenningsstrategieën van een agent wordt gedemonstreerd (zonder modelgewichten te updaten) met Gemini 3.x-modellen. Dit is gerelateerd onderzoek maar geen bewijs dat Gemini 4 zelf sterke RSI in de gewichtsruimte toepast.
De RSI-kadering onderstreept de strategische schaal van de Gemini 4-inspanning: Google investeert op een niveau dat consistent is met een generatie-sprong in plaats van een incrementele upgrade.
Arena.ai-/LM Arena-vermeldingen en routeringsclaims
Arena.ai (het door de crowd gevoede platform voor menselijke voorkeuren, voorheen bekend als LMSYS Chatbot Arena / LMArena) is vaak een vroeg testplatform voor Google-modellen. Nieuwe anonieme of gelabelde Gemini-inzendingen verschijnen daar vaak vóór officiële aankondigingen, en de community ziet ze als signalen voor releases op korte termijn.
Gemini 4.0 is “stilletjes opgedoken” en verkeer met het label Gemini 3.8 Flash wordt soms gerouteerd naar een nieuw Gemini Pro-checkpoint binnen Arena-gevechten:
- http://Arena.ai lanceerde plotseling een nieuwe variant “gemini-3.8-flash” vanmorgen op 17 september
- Officiële 3.8 Flash werd uitgebracht op 2 september; het opnieuw verschijnen van dezelfde naam is uiterst ongebruikelijk.

Wat blijft onbevestigd
Per 17 september 2026 is er geen gezaghebbende Google-aankondiging die bevestigt:
| Gemini 4 Pro-attribuut | Huidige status |
|---|---|
| Gemini 4-training | Bevestigd |
| Naam Gemini 4 Pro | Onbevestigd |
| Eerste Pro-checkpoint | Lek/gerucht |
| Oktober-release | Lek/schatting |
| Release november–december | Externe schatting |
| 1.5M context | Onbevestigd lek |
| 10M context | Onbevestigde claim |
| Specifieke benchmarkscores | Onbevestigd |
| Vergelijking met GPT-6 Astra | Onbevestigd |
| Vergelijking met Claude Fable 5.1 | Onbevestigd |
| RSI-bereiking | Onbevestigd |
| API-model-ID | Niet aangekondigd |
| Officiële prijsstelling | Niet aangekondigd |
De relatie tussen Gemini 4 Pro en RSI
Recursive self-improvement (RSI)—systemen die hun eigen capaciteiten of de processen die de volgende generatie produceren betekenisvol kunnen verbeteren—wordt vaak gespeculeerd rond elke grote frontier-trainingsrun.
- De claim dat “Google RSI heeft bereikt, waardoor het nieuwe model krachtiger is” komt van posts op X, maar is nog niet bevestigd door tests of officiële rapporten.
- Afzonderlijk publiceerden Google-onderzoekers (met samenwerkingspartners) Dream-RSI in september 2026. Het systeem stelt een agent in staat zijn eigen verkennings- en zoekstrategieën recursief te verbeteren door alternatieve strategieën te “dromen” en de beste te behouden, zonder de onderliggende modelgewichten ooit te updaten. Experimenteel werden Gemini 3.1 Pro en Gemini 3.7 Flash gebruikt. Dit is meta-niveau verbetering van de orkestratielaag, niet volledige RSI in de gewichtsruimte die automatisch een sterkere Gemini 4 uit Gemini 3 zou produceren.
- Breder onderzoek uit 2026 (AIDE², diverse agent-loop-papers en economische analyses) toont begrensde of component-niveau zelfverbetering—betere prompts, skills, memory retrieval of evaluatiekaders—maar geen volledig gesloten-loop RSI op gewichtsniveau die opeenvolgend sterkere basismodellen zonder menselijke interventie produceert.
Kortom: Google investeert duidelijk in zelfverbeterende agentsystemen, en de Gemini 4-trainingsrun wordt beschreven als ongewoon ambitieus. Sterke claims dat het model zelf opgeloste RSI belichaamt, blijven onbewezen en moeten als gerucht worden behandeld.
Welke functies zijn bevestigd of verwacht voor Gemini 4 Pro?
Gebaseerd op het traject van Gemini 1.5 → 2.5 → 3.x en de gelekte argon-details zijn de volgende gebieden de meest plausibele plekken voor betekenisvolle vooruitgang. Elk is geformuleerd als een H3-niveau verwachting, gestoeld op lekdata of redelijke extrapolatie uit eerdere generaties.
Dramatisch vergrote uitvoercapaciteit
De gelekte limiet van 256k uitvoertokens zou het mogelijk maken hele multifile-codebases, lange onderzoeksrapporten of complexe gestructureerde documenten in één keer te genereren. Eerdere Gemini-modellen waren meer beperkt in uitvoerlengte en vereisten vaak iteratieve voortzetting. Deze verandering alleen al zou agentische codepijplijnen vereenvoudigen.
Langere contextvensters en betere retrieval
Meldingen van een mogelijke 1.5M–2M tokencontext (nog onbeslist) zouden Google’s traditionele kracht in long-contextverwerking uitbreiden. Gecombineerd met verbeterde retrieval en verminderde “lost-in-the-middle”-effecten is dit gunstig voor juridische, wetenschappelijke en grootschalige codebase-analyse.
Sterkere codeer- en agentische prestaties
Pichai noemde coderen en agentisch coderen expliciet als focusgebieden. Gemini 2.5 en 3.x leverden al grote sprongen op SWE-bench, LiveCodeBench en WebDev Arena. Verwacht wordt dat Gemini 4 Pro verder duwt op multifile refactoring, autonoom bugfixen, betrouwbare tool-ondersteuning en planning over lange horizon.
Dieper redeneren / adaptieve compute
De modus “High thinking effort” die 2.4 minuten verbruikte op het argon-checkpoint suggereert voortdurende investeringen in het opschalen van rekenwerk tijdens inferentie (vergelijkbaar met Deep Think of uitgebreide denkmodi in de 3.x-serie). Verwacht meer betrouwbare meerstapslogica, lagere hallucinatiegraden bij moeilijke problemen en configureerbare inspanningsniveaus.
Multimodale en native tool-verbeteringen
Gemini is al lang native multimodaal. Verdere winst in videobegrip, realtime visueel redeneren en naadloze tool-calls (achtergrondtools zonder de conversatiestroom te onderbreken) past bij de richting van 3.8 Live en gerelateerde releases.
Efficiëntie- en serving-optimalisaties
Zelfs met grotere basismodellen koppelt Google frontier Pro-modellen doorgaans aan efficiënte Flash-varianten en speculatieve decodering. Verwacht aanhoudende vooruitgang in tokens per seconde en kosten per kwaliteit.
Welke ondersteuning kan CometAPI bieden terwijl we wachten?
Totdat Gemini 4 Pro wordt verscheept, hebben ontwikkelaars al toegang tot state-of-the-art-modellen via het uniforme, OpenAI-compatibele eindpunt van CometAPI. Opmerkelijke opties zijn:
- GPT-6 Astra – OpenAI’s vlaggenschip voor complexe redenering, coderen, computergebruik en agentisch werk met lange horizon (1,050,000-token context, tot 128k uitvoer). Beschikbaar op CometAPI met een permanente korting ten opzichte van de lijstprijs.
Modelpagina: https://www.cometapi.com/models/openai/gpt-6-astra/
Gebruikersgids: https://www.cometapi.com/how-to-use-gpt-6-astra-api/ - Nieuwste Gemini 3.x Flash- en Pro-klasse modellen (inclusief 3.8-varianten) voor multimodale en agentische workloads.
- Naadloos schakelen tussen providers met één API-sleutel en OpenAI SDK-compatibiliteit.
- Documentatie voor Gemini CLI-integratie voor lokale agentische codewerkstromen.
De catalogus van CometAPI toont ook snel opkomende modellen, dus Gemini 4 Pro (zodra uitgebracht) zal naar verwachting naast het bestaande aanbod verschijnen onder hetzelfde eindpunt.
Hoe Gemini 4 Pro zich verhoudt (geprojecteerd vs. huidige frontier)
| Capaciteit | Gemini 3.x / 2.5 Pro (publiek) | GPT-6 Astra (publiek) | Gemini 4 Pro (uitgelekt / verwacht) |
|---|---|---|---|
| Contextvenster | Tot ~1–2M tokens | 1,050,000 tokens | Gegerucht 1.5M–2M |
| Max. uitvoertokens | ~64k | 128,000 | Uitgelekt 256k |
| Redeneren / denkmodi | Deep Think / Extended | lage → maximale inspanningsniveaus | Hoge inspanning (2.4 min waargenomen) |
| Focus op coderen / agentisch | Sterk (SWE-bench-verbeteringen) | Vlaggenschipsterkte | Expliciete prioriteit + lekclaims |
| Multimodaliteit | Native (tekst/beeld/video/audio) | Tekst + afbeeldinginvoer | Verwachte voortzetting + verbetering |
| Status | Productie | Productie (Sep 2026) | Intern checkpoint, niet uitgebracht |
Tabelnotities: Cijfers voor Gemini 4 Pro zijn ontleend aan het argon-lek en communityrapporten; het zijn geen officiële Google-specificaties. Specificaties voor GPT-6 Astra zijn afkomstig uit openbare documentatie.
Conclusie
Gemini 4 Pro vertegenwoordigt Google’s volgende stap aan de frontier: een grootschalige voortrainingsinspanning die expliciet is gericht op gelijke tred houden met—en idealiter voorbijsteken van—tijdgenoten van OpenAI, Anthropic en anderen. Het argon-checkpoint van september 2026 biedt de eerste concrete (zij het nog onofficiële) blik op uitgebreide uitvoercapaciteit en redeneren met hoge inspanning. De timing van de release lijkt samen te komen rond oktober 2026, al blijven post-training en evaluatie variabelen.
RSI blijft een actief onderzoeksgebied in plaats van een bevestigde eigenschap van het model. Ondertussen is het praktische pad voor ontwikkelaars duidelijk: blijf leveren met de sterkste beschikbare systemen—GPT-6 Astra, huidige Gemini 3.x-modellen en peers—terwijl je de officiële kanalen van Google in de gaten houdt voor de aankondiging van Gemini 4. Platformen zoals CometAPI bundelen deze modellen al onder één sleutel en één facturering, wat frictie vermindert zowel vandaag als wanneer Gemini 4 Pro uiteindelijk arriveert.
