Technische specificaties van Gemini 3.5 Flash-Lite
| Kenmerk | Gemini 3.5 Flash-Lite |
|---|---|
| Provider | Google DeepMind |
| Model ID | gemini-3.5-flash-lite |
| Model family | Gemini 3.5 |
| Availability | Algemene beschikbaarheid (GA) |
| Input types | Tekst, Afbeelding, Video, Audio, PDF |
| Output types | Tekst |
| Context window | 1,048,576 tokens |
| Maximum output | 65,536 tokens |
| Thinking | Ondersteund (standaard: minimal; ook medium en high) |
| Function calling | Ja |
| Code execution | Ja |
| File Search | Ja |
| URL Context | Ja |
| Search Grounding | Ja |
| Structured Output | Ja |
| Computer Use | Niet ondersteund |
| Caching | Ondersteund |
| Primary focus | Inference met hoge doorvoer, lage latentie en lage kosten |
Wat is Gemini 3.5 Flash-Lite?
Gemini 3.5 Flash-Lite is het snelste en meest kostenefficiënte model van Google binnen de Gemini 3.5-familie. Het is geoptimaliseerd voor workloads waarbij latentie, doorvoer en API-kosten belangrijker zijn dan maximale redeneerprestatie. Typische toepassingen zijn onder meer documentanalyse, extractie van gestructureerde gegevens, routering, lichte codering en autonome sub-agents die op schaal opereren. Google positioneert het als het aanbevolen upgradepad vanaf Gemini 3.1 Flash-Lite en Gemini 2.5 Flash voor productie-implementaties.
Belangrijkste functies van Gemini 3.5 Flash-Lite
- Geoptimaliseerd voor hoge-volume, laag-kosten inference.
- Ondersteunt een contextvenster van 1 miljoen tokens voor lange documenten en repositories.
- Native multimodale invoer, waaronder tekst, afbeeldingen, video, audio en PDF.
- Ondersteunt Function Calling, Code Execution, File Search, URL Context, Search Grounding en Structured Outputs.
- Configureerbare redeneringsniveaus (
minimal,medium,high) om snelheid en redeneerkwaliteit in balans te brengen. - Verbetert coderen, redeneren en agent-gestuurde workflows aanzienlijk ten opzichte van Gemini 3.1 Flash-Lite, met behoud van zeer lage latentie.
Benchmarkprestaties van Gemini 3.5 Flash-Lite
Volgens Google overtreft Gemini 3.5 Flash-Lite eerdere Flash-Lite-generaties aanzienlijk op het gebied van coderen, documentbegrip en agent-gestuurde workflows, terwijl het het goedkoopste model binnen de Gemini 3.5-serie blijft. Gemini 3.5 Flash-Lite behaalde 54% in de Terminal-Bench 2.1-test, een significante verbetering ten opzichte van zijn voorganger met 31%.
De sterke punten liggen bij classificatie, extractie, chatantwoorden en eenvoudige retrieval-ondersteunde antwoorden. Dit zijn precies de gebieden waarin snelle, goedkope modellen kunnen uitblinken.
Gemini 3.5 Flash-Lite vs Gemini 3.6 Flash vs Gemini 3.5 Flash
| Aspect | Gemini 3.5 Flash-Lite | Gemini 3.6 Flash | Gemini 3.5 Flash |
|---|---|---|---|
| Positionering | Snelst en goedkoopst voor alledaagse taken met hoog volume (bijv. documentverwerking, zoeken) | Huidige vlaggenschip-Flash: beste balans tussen intelligentie, efficiëntie en agent-gestuurde prestaties | Sterk agent-/codeermodel (nu grotendeels vervangen door 3.6) |
| Beste voor | Workflows met hoge doorvoer en lage kosten | Coderen, multimodaal, complexe agents, kenniswerk | Algemene agent- en coderingstaken |
| Intelligentie / Prestaties | Goed (overtreft oudere Lite-versies; competitief op veel agent-gestuurde taken) | Hoogste van de drie (merkbare winst in coderen en agent-gestuurde taken) | Sterk (bijna topniveau binnen de Flash-serie) |
| Belangrijkste benchmarks | - Terminal-Bench: ~54%- Sterk bij document- en hoogvolumetaken | - DeepSWE: 49% (vs 37%)- MLE-Bench: 63.9% (vs 49.7%)- OSWorld: 83% (vs 78.4%) | - Terminal-Bench: 76.2%- Lager dan 3.6 op de meeste code-/agent-gestuurde taken |
| Snelheid | Snelst (~350 output tokens/sec) | Zeer snel (~280 t/s) | Snel |
| Efficiëntie | Uitstekend voor volume | Beste (gemiddeld 17% minder outputtokens; tot 65% bij coderen) | Goed |
| Multimodaal | Tekst + Afbeelding + Video + Audio | Tekst + Afbeelding + Video + Audio (sterkere redenering) | Tekst + Afbeelding + Video + Audio |
| Contextvenster | ~1M tokens | ~1M tokens | ~1M tokens |
| Max. uitvoertokens | ~64k | ~64k | ~64k |
| Prijzen (per 1M tokens) | Goedkoopst: ~$0.30 invoer / $2.50 uitvoer | $1.50 invoer / $7.50 uitvoer | $1.50 invoer / $9.00 uitvoer |
| Effectieve kosten | Laagst per taak voor eenvoudig werk | Lager dan 3.5 dankzij efficiëntiewinst | Hoger dan 3.6 |
Samenvattende aanbevelingen
- Kies 3.5 Flash-Lite — wanneer je maximale snelheid en minimale kosten nodig hebt voor taken met hoog volume of eenvoudige taken.
- Kies 3.6 Flash — voor de meeste gebruikers en ontwikkelaars (momenteel de beste algehele keuze).
- Kies 3.5 Flash — alleen als je bestaande workflows eraan gekoppeld hebt (plan om te upgraden naar 3.6).
Beperkingen van Gemini 3.5 Flash-Lite
- Geoptimaliseerd voor efficiëntie in plaats van redeneren op frontierniveau.
- Computer Use wordt niet ondersteund.
- Native beeld- en audiogeneratie zijn niet beschikbaar.
- Fine-tuning wordt momenteel niet ondersteund.
- Complexe redeneringstaken met meerdere stappen zijn over het algemeen beter geschikt voor Gemini 3.5 Flash of Gemini 3.6 Flash.