Tekniske specifikationer for Gemini 3.5 Flash-Lite
| Punkt | Gemini 3.5 Flash-Lite |
|---|---|
| Udbyder | Google DeepMind |
| Model-ID | gemini-3.5-flash-lite |
| Modelfamilie | Gemini 3.5 |
| Tilgængelighed | Generel tilgængelighed (GA) |
| Inputtyper | Tekst, billede, video, lyd, PDF |
| Outputtyper | Tekst |
| Kontekstvindue | 1,048,576 tokens |
| Maksimalt output | 65,536 tokens |
| Tænkning | Understøttet (standard: minimal; også medium og high) |
| Funktionskald | Ja |
| Kodeeksekvering | Ja |
| Filsøgning | Ja |
| URL-kontekst | Ja |
| Search Grounding | Ja |
| Struktureret output | Ja |
| Computerbrug | Ikke understøttet |
| Caching | Understøttet |
| Primært fokus | Høj gennemløb, lav latenstid, lavomkostnings-inferens |
Hvad er Gemini 3.5 Flash-Lite?
Gemini 3.5 Flash-Lite er Googles hurtigste og mest omkostningseffektive model i Gemini 3.5-familien. Den er optimeret til workloads, hvor latenstid, gennemløb og API-omkostning er vigtigere end maksimal ræsonneringsydelse. Typiske anvendelser omfatter dokumentparsing, ekstraktion af strukturerede data, routing, letvægtskodning og autonome underagenter i stor skala. Google positionerer den som den anbefalede opgraderingsvej fra Gemini 3.1 Flash-Lite og Gemini 2.5 Flash til produktionsimplementeringer.
Hovedfunktioner i Gemini 3.5 Flash-Lite
- Optimeret til højvolumen, lavpris-inferens.
- Understøtter et kontekstvindue på 1 million tokens til lange dokumenter og repositories.
- Indbyggede multimodale input, herunder tekst, billeder, video, lyd og PDF.
- Understøtter Function Calling, Code Execution, File Search, URL Context, Search Grounding og strukturerede output.
- Konfigurerbare tænkeniveauer (
minimal,medium,high) for at balancere hastighed og ræsonneringskvalitet. - Forbedrer markant kodning, ræsonnering og agentbaserede arbejdsgange sammenlignet med Gemini 3.1 Flash-Lite, samtidig med at meget lav latenstid bevares.
Benchmark-ydelse for Gemini 3.5 Flash-Lite
Google angiver, at Gemini 3.5 Flash-Lite væsentligt overgår tidligere Flash-Lite-generationer i kodning, dokumentforståelse og agentbaserede arbejdsgange, samtidig med at den forbliver den billigste model i Gemini 3.5-serien. Gemini 3.5 Flash-Lite opnåede 54% i Terminal-Bench 2.1-testen, en markant forbedring i forhold til sin forgængers 31%.
Dens styrker ligger i klassifikation, ekstraktion, chat-svar og simple retrieval-forstærkede svar. Det er netop her, hurtige lavpris-modeller kan brillere.
Gemini 3.5 Flash-Lite vs Gemini 3.6 Flash vs Gemini 3.5 Flash
| Aspekt | Gemini 3.5 Flash-Lite | Gemini 3.6 Flash | Gemini 3.5 Flash |
|---|---|---|---|
| Positionering | Hurtigst og billigst til højvolumen-hverdagsopgaver (f.eks. dokumentbehandling, søgning) | Aktuelt flagskib i Flash-serien: Bedste balance mellem intelligens, effektivitet og agentisk ydeevne | Stærk agent-/kode-model (nu i vid udstrækning afløst af 3.6) |
| Bedst til | Arbejdsgange med højt gennemløb og lav omkostning | Kodning, multimodalt, komplekse agenter, vidensarbejde | Generelle agent- og kodningsopgaver |
| Intelligens / Ydeevne | God (overgår ældre Lite-modeller; konkurrencedygtig på mange agentopgaver) | Højest blandt de tre (mærkbare gevinster i kodning og agentiske) | Stærk (tæt på frontniveau for Flash-serien) |
| Nøglebenchmarks | - Terminal-Bench: ~54%- Stærk til dokument- og højvolumenopgaver | - DeepSWE: 49% (vs 37%)- MLE-Bench: 63.9% (vs 49.7%)- OSWorld: 83% (vs 78.4%) | - Terminal-Bench: 76.2%- Lavere end 3.6 på de fleste kode-/agentopgaver |
| Hastighed | Hurtigst (~350 output tokens/sec) | Meget hurtig (~280 t/s) | Hurtig |
| Effektivitet | Fremragende til volumen | Bedst (i gennemsnit 17% færre output tokens; op til 65% ved kodning) | God |
| Multimodal | Tekst + billede + video + lyd | Tekst + billede + video + lyd (stærkere ræsonnering) | Tekst + billede + video + lyd |
| Kontekstvindue | ~1M tokens | ~1M tokens | ~1M tokens |
| Maks. outputtokens | ~64k | ~64k | ~64k |
| Priser (per 1M tokens) | Billigst: ~$0.30 input / $2.50 output | $1.50 input / $7.50 output | $1.50 input / $9.00 output |
| Effektiv omkostning | Lavest pr. opgave for simple opgaver | Lavere end 3.5 på grund af effektivitetsgevinster | Højere end 3.6 |
Sammenfatning af anbefalinger
- Vælg 3.5 Flash-Lite — når du har brug for maksimal hastighed og minimale omkostninger til højvolumen- eller simple opgaver.
- Vælg 3.6 Flash — for de fleste brugere og udviklere (det bedste valg samlet set lige nu).
- Vælg 3.5 Flash — kun hvis du har eksisterende arbejdsgange bundet til den (planlæg at opgradere til 3.6).
Begrænsninger ved Gemini 3.5 Flash-Lite
- Optimeret til effektivitet frem for ræsonnering på absolut frontniveau.
- Computerbrug understøttes ikke.
- Indbygget billed- og lydgenerering er ikke tilgængelig.
- Fine-tuning er ikke understøttet i øjeblikket.
- Komplekse opgaver med flertrinsræsonnering er generelt bedre egnet til Gemini 3.5 Flash eller Gemini 3.6 Flash.