Technische specificaties van Gemini 3.6 Flash
| Kenmerk | Gemini 3.6 Flash |
|---|---|
| Aanbieder | Google DeepMind |
| Model-ID | gemini-3.6-flash |
| Modelfamilie | Gemini 3.x |
| Beschikbaarheid | Algemene beschikbaarheid (GA) |
| Invoertypen | Tekst, afbeelding, video, audio, PDF |
| Uitvoertypen | Tekst |
| Contextvenster | 1,048,576 tokens |
| Maximale uitvoer | 65,536 tokens |
| Thinking | Ondersteund (medium / high) |
| Function calling | Yes |
| Code execution | Yes |
| File Search | Yes |
| URL Context | Yes |
| Search Grounding | Yes |
| Computer Use | Preview |
| Structured Output | Yes |
| Caching | Ondersteund |
Bron: Google Gemini API-documentatie.
Wat is Gemini 3.6 Flash?
Gemini 3.6 Flash is Google's nieuwste productieklare Flash-model, ontworpen om intelligentie op frontier-niveau te leveren met behoud van de lage latency en kostenefficiëntie waar de Flash-serie om bekendstaat. Het is geoptimaliseerd voor coderen, multimodale verwerking, redeneren en agent-gebaseerde workflows.
Vergeleken met Gemini 3.5 Flash verbetert het model de kwaliteit van codegeneratie, de nauwkeurigheid van redeneren, het gebruik van tools en de token-efficiëntie, terwijl het een enorme contextvenster van 1 miljoen tokens ondersteunt. Google positioneert het als het standaard werkpaardmodel voor ontwikkelaars die AI-agents en complexe automatiseringssystemen bouwen.
Belangrijkste functies van Gemini 3.6 Flash
- Ondersteunt 1M-token lange-contextverwerking.
- Native multimodale invoer, waaronder tekst, afbeeldingen, video, audio en PDF-documenten.
- Sterke verbeteringen in codegeneratie en software-engineeringtaken.
- Ingebouwde ondersteuning voor Function Calling, File Search, URL Context, Search Grounding en Computer Use.
- Token-efficiënter dan Gemini 3.5 Flash, waardoor de inferentiekosten dalen bij behoud van hogere kwaliteit.
- Ontworpen voor meerstaps AI-agents en autonome workflows.
Benchmarkprestaties
Google meldt dat Gemini 3.6 Flash sterkere codeer-, redeneer- en multimodale prestaties levert dan Gemini 3.5 Flash, terwijl het aanzienlijk minder outputtokens gebruikt. Het bedrijf benadrukt verbeterde prestaties op interne coding- en agent-gebaseerde benchmarks en stelt dat het model het gebruik van outputtokens met maximaal 65% kan verminderen bij bepaalde software-engineeringevaluaties zoals DeepSWE, waardoor de totale inferentiekosten dalen. Google heeft voor deze release geen uitgebreide openbare benchmarktabellen (bijv. MMLU, GPQA, SWE-bench Verified) gepubliceerd.

Gemini 3.6 Flash vs Gemini 3.5 Flash vs Gemini 3.1 Pro
| Aspect | Gemini 3.6 Flash | Gemini 3.5 Flash | Gemini 3.1 Pro |
|---|---|---|---|
| Release | 21 juli 2026 (GA) | Eerder in 2026 | ~feb. 2026 (Preview) |
| Positionering | Efficiënt werkpaard voor agents, coding, multimodaal | Vorig agentisch Flash-model | Geavanceerd Pro-tier redeneren |
| Prijzen (per 1M tokens) | Input: $1.50Output: $7.50 | Input: $1.50Output: $9.00 | Hoger (bijv. ~$2 input / $12 output) |
| Token-efficiëntie | 17% minder outputtokens t.o.v. 3.5 Flash; minder stappen/toolaanroepen | Basislijn | Minder efficiënt in agent-gebaseerde workflows |
| Snelheid | Hoog (Flash-familie) | Hoog | Langzamer dan Flash-modellen |
| Contextvenster | 1M tokens | 1M tokens | Waarschijnlijk vergelijkbaar |
| Sterke punten | Coderen, kenniswerk, multimodaal (grafieken/documenten), computer use, agent-efficiëntie | Goede balans agentisch/coding | Dieper redeneren bij complexe problemen |
Korte samenvatting
- 3.6 Flash → Beste algehele keuze voor de meeste gebruikers nu: sneller, goedkoper per taak, efficiënter dan 3.5 Flash en overtreft 3.1 Pro op veel praktische/agent-gebaseerde benchmarks.
- 3.5 Flash → Degelijke voorganger; nog steeds capabel maar wordt verdrongen door 3.6 Flash (hogere kosten per outputtoken, minder efficiënt).
- 3.1 Pro → Sterker in sommige deep reasoning-scenario's, maar langzamer, duurder en loopt doorgaans achter op de nieuwere Flash-modellen qua snelheid, efficiëntie en veel realistische/agent-gebaseerde taken.
Beperkingen
- Afbeeldingsgeneratie wordt niet rechtstreeks ondersteund.
- Audiogeneratie is niet beschikbaar.
- Computer Use blijft in Preview.
- Sommige legacy-generatieparameters (
temperature,top_p,top_k) zijn verwijderd uit de nieuwe API-interface. - Beste prestaties worden bereikt via de nieuwste Gemini Interactions API.
Hoe krijg je toegang tot de Gemini 3.6 Flash API
Stap 1: API-toegang verkrijgen
Log in bij cometAPI. Als u nog geen gebruiker bent, registreer u dan eerst. Meld u aan bij uw CometAPI-console. Haal de toegangscertificering API-sleutel van de interface op. Klik bij API token in het persoonlijke centrum op “Add Token”, verkrijg de tokensleutel: sk-xxxxx en dien in.

Stap 2: Verzoeken naar de Gemini 3.6 Flash API sturen
Selecteer het “ gemini-3.6-flash" "gemini-3.6-flash-thinking”-endpoint om het API-verzoek te sturen en stel de requestbody in. De requestmethode en requestbody vindt u in de API-documentatie op onze website. Onze website biedt ook een Apifox-test voor uw gemak. Vervang <YOUR_API_KEY> door uw daadwerkelijke CometAPI-sleutel uit uw account. basis url is Gemini Generating Content
Voeg uw vraag of verzoek in het content-veld in—hierop zal het model reageren. Verwerk de API-respons om het gegenereerde antwoord te verkrijgen.
Stap 3: Antwoorden verwerken
De API retourneert gestructureerde kandidaatantwoorden, inclusief gegenereerde tekst, citaten, veiligheidsmetadata en optionele tooluitvoer.