Technische specificaties van Gemini 3.5 Flash-Lite
| Item | Gemini 3.5 Flash-Lite |
|---|---|
| Aanbieder | Google DeepMind |
| Model-ID | gemini-3.5-flash-lite |
| Modelfamilie | Gemini 3.5 |
| Beschikbaarheid | Algemene beschikbaarheid (GA) |
| Invoertypen | Tekst, Afbeelding, Video, Audio, PDF |
| Uitvoertypen | Tekst |
| Contextvenster | 1,048,576 tokens |
| Maximale uitvoer | 65,536 tokens |
| Redeneren | Ondersteund (standaard: minimal; ook medium en high) |
| Function calling | Ja |
| Code execution | Ja |
| File Search | Ja |
| URL Context | Ja |
| Search Grounding | Ja |
| Structured Output | Ja |
| Computer Use | Niet ondersteund |
| Caching | Ondersteund |
| Primaire focus | Hoge doorvoer, lage latentie, inferentie met lage kosten |
Wat is Gemini 3.5 Flash-Lite?
Gemini 3.5 Flash-Lite is het snelste en meest kosteneffectieve model van Google binnen de Gemini 3.5-familie. Het is geoptimaliseerd voor workloads waarbij latentie, doorvoer en API-kosten belangrijker zijn dan maximale redeneerprestatie. Typische toepassingen zijn documentparsing, gestructureerde data-extractie, routing, lichtgewicht codering en autonome subagenten die op schaal opereren. Google positioneert het als het aanbevolen upgradepad vanaf Gemini 3.1 Flash-Lite en Gemini 2.5 Flash voor productie-implementaties.
Belangrijkste functies van Gemini 3.5 Flash-Lite
- Geoptimaliseerd voor inferentie met groot volume en lage kosten.
- Ondersteunt een contextvenster van 1 miljoen tokens voor lange documenten en repositories.
- Native multimodale invoer, waaronder tekst, afbeeldingen, video, audio en PDF.
- Ondersteunt Function Calling, Code Execution, File Search, URL Context, Search Grounding en Structured Outputs.
- Configureerbare denkniveaus (
minimal,medium,high) om snelheid en redeneerkwaliteit in balans te brengen. - Verbetert codering, redeneren en agent-workflows aanzienlijk ten opzichte van Gemini 3.1 Flash-Lite, met behoud van zeer lage latentie.
Benchmarkprestaties van Gemini 3.5 Flash-Lite
Volgens Google presteert Gemini 3.5 Flash-Lite aanzienlijk beter dan eerdere Flash-Lite-generaties op het gebied van codering, documentbegrip en agent-workflows, terwijl het het goedkoopste model in de Gemini 3.5-reeks blijft. Gemini 3.5 Flash-Lite behaalde 54% in de Terminal-Bench 2.1-test, een aanzienlijke verbetering ten opzichte van de 31% van zijn voorganger.
De sterke punten liggen bij classificatie, extractie, chatantwoorden en eenvoudige, door retrieval verbeterde antwoorden. Precies op deze gebieden kunnen snelle, goedkope modellen excelleren.
Gemini 3.5 Flash-Lite vs Gemini 3.6 Flash vs Gemini 3.5 Flash
| Aspect | Gemini 3.5 Flash-Lite | Gemini 3.6 Flash | Gemini 3.5 Flash |
|---|---|---|---|
| Positionering | Snelst en goedkoopst voor dagelijkse taken met hoog volume (bijv. documentverwerking, zoeken) | Huidige vlaggenschip-Flash: beste balans tussen intelligentie, efficiëntie en agent-prestaties | Sterk agent-/codeermodel (nu grotendeels vervangen door 3.6) |
| Beste voor | Workflows met hoge doorvoer en lage kosten | Codering, multimodaal, complexe agents, kenniswerk | Algemene agent- en coderingstaken |
| Intelligentie / prestaties | Goed (overtreft oudere Lite-modellen; competitief op veel agenttaken) | Hoogste van de drie (merkbare winst in codering en agenttaken) | Sterk (dicht bij de voorhoede binnen de Flash-serie) |
| Belangrijkste benchmarks | - Terminal-Bench: ~54%- Sterk in document- en hoogvolume-taken | - DeepSWE: 49% (vs 37%)- MLE-Bench: 63.9% (vs 49.7%)- OSWorld: 83% (vs 78.4%) | - Terminal-Bench: 76.2%- Lager dan 3.6 op de meeste codering-/agenttaken |
| Snelheid | Snelst (~350 outputtokens/sec) | Zeer snel (~280 t/s) | Snel |
| Efficiëntie | Uitstekend voor volume | Beste (gemiddeld 17% minder uitvoertokens; tot 65% bij codering) | Goed |
| Multimodaal | Tekst + Afbeelding + Video + Audio | Tekst + Afbeelding + Video + Audio (sterker redeneren) | Tekst + Afbeelding + Video + Audio |
| Contextvenster | ~1M tokens | ~1M tokens | ~1M tokens |
| Maximale uitvoertokens | ~64k | ~64k | ~64k |
| Prijzen (per 1M tokens) | Goedkoopst: ~$0.30 invoer / $2.50 uitvoer | $1.50 invoer / $7.50 uitvoer | $1.50 invoer / $9.00 uitvoer |
| Effectieve kosten | Laagst per taak voor eenvoudig werk | Lager dan 3.5 dankzij efficiëntiewinst | Hoger dan 3.6 |
Samenvattende aanbevelingen
- Kies 3.5 Flash-Lite — wanneer u maximale snelheid en minimale kosten nodig hebt voor taken met hoog volume of eenvoudige taken.
- Kies 3.6 Flash — voor de meeste gebruikers en ontwikkelaars (momenteel de beste algehele keuze).
- Kies 3.5 Flash — alleen als u bestaande workflows eraan hebt gekoppeld (plan om te upgraden naar 3.6).
Beperkingen van Gemini 3.5 Flash-Lite
- Geoptimaliseerd voor efficiëntie in plaats van state-of-the-art redeneren.
- Computer Use wordt niet ondersteund.
- Native beeld- en audiogeneratie is niet beschikbaar.
- Fine-tuning wordt momenteel niet ondersteund.
- Complexe meerstaps redeneringstaken zijn doorgaans beter geschikt voor Gemini 3.5 Flash of Gemini 3.6 Flash.