Tekniske specifikationer for Gemini 3.5 Flash-Lite
| Punkt | Gemini 3.5 Flash-Lite |
|---|---|
| Udbyder | Google DeepMind |
| Model-ID | gemini-3.5-flash-lite |
| Modelfamilie | Gemini 3.5 |
| Tilgængelighed | Generel tilgængelighed (GA) |
| Inputtyper | Tekst, billede, video, lyd, PDF |
| Outputtyper | Tekst |
| Kontekstvindue | 1,048,576 tokens |
| Maksimalt output | 65,536 tokens |
| Tænkning | Understøttet (standard: minimal; også medium og high) |
| Funktionskald | Ja |
| Kodeeksekvering | Ja |
| Filsøgning | Ja |
| URL-kontekst | Ja |
| Search Grounding | Ja |
| Struktureret output | Ja |
| Computer Use | Understøttes ikke |
| Caching | Understøttet |
| Primært fokus | Inferens med høj gennemstrømning, lav latenstid og lave omkostninger |
Hvad er Gemini 3.5 Flash-Lite?
Gemini 3.5 Flash-Lite er Googles hurtigste og mest omkostningseffektive model i Gemini 3.5-familien. Den er optimeret til arbejdsbelastninger, hvor latenstid, gennemstrømning og API-omkostninger er vigtigere end maksimal ræsonnementydelse. Typiske anvendelser omfatter dokumentparsing, udtræk af strukturerede data, routing, letvægtskodning og autonome underagenter i stor skala. Google positionerer den som den anbefalede opgraderingsvej fra Gemini 3.1 Flash-Lite og Gemini 2.5 Flash til produktionsimplementeringer.
Hovedfunktioner i Gemini 3.5 Flash-Lite
- Optimeret til høj-volumen, lavpris inferens.
- Understøtter et kontekstvindue på 1 million tokens til lange dokumenter og repositorier.
- Indbyggede multimodale input, inklusive tekst, billeder, video, lyd og PDF.
- Understøtter Function Calling, Code Execution, File Search, URL Context, Search Grounding og Structured Outputs.
- Konfigurerbare tænkeniveauer (
minimal,medium,high) for at balancere hastighed og ræsonnementskvalitet. - Forbedrer markant kodning, ræsonnement og agent-baserede arbejdsgange sammenlignet med Gemini 3.1 Flash-Lite, samtidig med at meget lav latenstid bevares.
Benchmark-ydelse for Gemini 3.5 Flash-Lite
Ifølge Google overgår Gemini 3.5 Flash-Lite væsentligt tidligere Flash-Lite-generationer inden for kodning, dokumentforståelse og agent-baserede arbejdsgange, samtidig med at den forbliver den billigste model i Gemini 3.5-serien. Gemini 3.5 Flash-Lite opnåede 54% i Terminal-Bench 2.1-testen, en markant forbedring i forhold til forgængerens 31%.
Dens styrker ligger i klassifikation, udtræk, chatsvar og simple svar, der er forbedret med retrieval. Det er netop her, hurtige, omkostningseffektive modeller kan udmærke sig.
Gemini 3.5 Flash-Lite vs Gemini 3.6 Flash vs Gemini 3.5 Flash
| Aspekt | Gemini 3.5 Flash-Lite | Gemini 3.6 Flash | Gemini 3.5 Flash |
|---|---|---|---|
| Positionering | Hurtigst og billigst til højvolumen-hverdagsopgaver (fx dokumentbehandling, søgning) | Nuværende flagskib i Flash: Bedste balance mellem intelligens, effektivitet og agent-ydelse | Stærk agent-/kodningsmodel (nu i vid udstrækning afløst af 3.6) |
| Bedst til | Arbejdsgange med høj gennemstrømning og lave omkostninger | Kodning, multimodalt, komplekse agenter, vidensarbejde | Generelle agent- og kodningsopgaver |
| Intelligens / ydeevne | God (overgår ældre Lite-modeller; konkurrencedygtig på mange agentopgaver) | Højeste blandt de tre (markante forbedringer i kodning og agent-ydelse) | Stærk (nær frontier for Flash-serien) |
| Nøglebenchmarks | - Terminal-Bench: ~54% - Stærk på dokument- og højvolumenopgaver | - DeepSWE: 49% (vs 37%)- MLE-Bench: 63.9% (vs 49.7%)- OSWorld: 83% (vs 78.4%) | - Terminal-Bench: 76.2% - Lavere end 3.6 på de fleste kodnings-/agentopgaver |
| Hastighed | Hurtigst (~350 output tokens/sec) | Meget hurtig (~280 t/s) | Hurtig |
| Effektivitet | Fremragende til volumen | Bedst (i gennemsnit 17% færre outputtokens; op til 65% ved kodning) | God |
| Multimodal | Tekst + billede + video + lyd | Tekst + billede + video + lyd (stærkere ræsonnement) | Tekst + billede + video + lyd |
| Kontekstvindue | ~1M tokens | ~1M tokens | ~1M tokens |
| Maks. outputtokens | ~64k | ~64k | ~64k |
| Pris (pr. 1M tokens) | Billigst: ~$0.30 input / $2.50 output | $1.50 input / $7.50 output | $1.50 input / $9.00 output |
| Effektiv omkostning | Lavest pr. opgave for simpelt arbejde | Lavere end 3.5 pga. effektivitetsgevinster | Højere end 3.6 |
Samlede anbefalinger
- Vælg 3.5 Flash-Lite — når du har brug for maksimal hastighed og minimale omkostninger til højvolumen- eller simple opgaver.
- Vælg 3.6 Flash — for de fleste brugere og udviklere (det bedste samlede valg lige nu).
- Vælg 3.5 Flash — kun hvis du har eksisterende arbejdsgange bundet til den (planlæg at opgradere til 3.6).
Begrænsninger i Gemini 3.5 Flash-Lite
- Optimeret til effektivitet frem for ræsonnement på frontier-niveau.
- Computer Use understøttes ikke.
- Indbygget generering af billeder og lyd er ikke tilgængelige.
- Finetuning understøttes ikke i øjeblikket.
- Komplekse flertrins-ræsonnementopgaver egner sig generelt bedre til Gemini 3.5 Flash eller Gemini 3.6 Flash.