Specyfikacja techniczna Gemini 3.5 Flash-Lite
| Element | Gemini 3.5 Flash-Lite |
|---|---|
| Dostawca | Google DeepMind |
| Identyfikator modelu | gemini-3.5-flash-lite |
| Rodzina modelu | Gemini 3.5 |
| Dostępność | Ogólna dostępność (GA) |
| Typy danych wejściowych | Tekst, Obraz, Wideo, Audio, PDF |
| Typy danych wyjściowych | Tekst |
| Okno kontekstu | 1,048,576 tokenów |
| Maksymalna długość wyjścia | 65,536 tokenów |
| Rozumowanie | Obsługiwane (domyślnie: minimal; także medium i high) |
| Wywoływanie funkcji | Tak |
| Wykonywanie kodu | Tak |
| Wyszukiwanie plików | Tak |
| Kontekst URL | Tak |
| Oparcie na wyszukiwaniu | Tak |
| Strukturyzowane wyniki | Tak |
| Użycie komputera | Nieobsługiwane |
| Buforowanie | Obsługiwane |
| Główny nacisk | Wysoka przepustowość, niskie opóźnienia, niskie koszty wnioskowania |
Czym jest Gemini 3.5 Flash-Lite?
Gemini 3.5 Flash-Lite to najszybszy i najbardziej opłacalny kosztowo model Google z rodziny Gemini 3.5. Został zoptymalizowany pod kątem obciążeń, w których opóźnienie, przepustowość i koszt API są ważniejsze niż maksymalna wydajność rozumowania. Typowe zastosowania to parsowanie dokumentów, ekstrakcja danych strukturalnych, trasowanie, lekkie programowanie oraz autonomiczne subagenty działające na dużą skalę. Google pozycjonuje go jako zalecaną ścieżkę aktualizacji z Gemini 3.1 Flash-Lite i Gemini 2.5 Flash do wdrożeń produkcyjnych.
Główne funkcje Gemini 3.5 Flash-Lite
- Zoptymalizowany pod kątem wysokiego wolumenu i niskich kosztów wnioskowania.
- Obsługuje okno kontekstu o 1 milionie tokenów dla długich dokumentów i repozytoriów.
- Natywne wejścia multimodalne, w tym tekst, obrazy, wideo, audio i PDF.
- Obsługuje Wywoływanie funkcji, Wykonywanie kodu, Wyszukiwanie plików, Kontekst URL, Oparcie na wyszukiwaniu oraz Strukturyzowane wyniki.
- Konfigurowalne poziomy rozumowania (
minimal,medium,high) dla zbalansowania szybkości i jakości rozumowania. - Znacząco poprawia programowanie, rozumowanie i przepływy pracy agentowe względem Gemini 3.1 Flash-Lite, zachowując bardzo niskie opóźnienia.
Wydajność w benchmarkach Gemini 3.5 Flash-Lite
Google podaje, że Gemini 3.5 Flash-Lite znacząco przewyższa poprzednie generacje Flash-Lite w programowaniu, rozumieniu dokumentów i przepływach pracy agentowych, pozostając najtańszym modelem w linii Gemini 3.5. Gemini 3.5 Flash-Lite uzyskał wynik 54% w teście Terminal-Bench 2.1, co stanowi znaczną poprawę względem 31% u poprzednika.
Jego mocne strony to klasyfikacja, ekstrakcja, odpowiedzi czatowe oraz proste odpowiedzi wspierane wyszukiwaniem. To właśnie obszary, w których szybkie, niskokosztowe modele mogą się wyróżniać.
Gemini 3.5 Flash-Lite vs Gemini 3.6 Flash vs Gemini 3.5 Flash
| Aspekt | Gemini 3.5 Flash-Lite | Gemini 3.6 Flash | Gemini 3.5 Flash |
|---|---|---|---|
| Pozycjonowanie | Najszybszy i najtańszy do codziennych zadań o dużej skali (np. przetwarzanie dokumentów, wyszukiwanie) | Obecny flagowiec Flash: najlepszy balans inteligencji, efektywności i wydajności agentowej | Silny model agentowy/programistyczny (obecnie w dużej mierze zastąpiony przez 3.6) |
| Najlepszy do | Przepływy pracy o wysokiej przepustowości i niskim koszcie | Programowanie, multimodalność, złożone agenty, praca z wiedzą | Ogólne zadania agentowe i programistyczne |
| Inteligencja / Wydajność | Dobra (przewyższa starsze wersje Lite; konkurencyjna w wielu zadaniach agentowych) | Najwyższa spośród trzech (wyraźne wzrosty w programowaniu i zadaniach agentowych) | Silna (blisko czołówki w serii Flash) |
| Kluczowe benchmarki | - Terminal-Bench: ~54%- Mocny w pracy z dokumentami i zadaniach o dużej skali | - DeepSWE: 49% (vs 37%)- MLE-Bench: 63.9% (vs 49.7%)- OSWorld: 83% (vs 78.4%) | - Terminal-Bench: 76.2%- Niższy niż 3.6 w większości zadań programistycznych/agentowych |
| Szybkość | Najszybszy (~350 output tokens/sec) | Bardzo szybki (~280 t/s) | Szybki |
| Efektywność | Doskonała dla dużej skali | Najlepsza (średnio o 17% mniej tokenów wyjściowych; do 65% w programowaniu) | Dobra |
| Multimodalność | Tekst + Obraz + Wideo + Audio | Tekst + Obraz + Wideo + Audio (silniejsze rozumowanie) | Tekst + Obraz + Wideo + Audio |
| Okno kontekstu | ~1M tokenów | ~1M tokenów | ~1M tokenów |
| Maks. liczba tokenów wyjściowych | ~64k | ~64k | ~64k |
| Cennik (na 1M tokenów) | Najtaniej: ~$0.30 wejście / $2.50 wyjście | $1.50 wejście / $7.50 wyjście | $1.50 wejście / $9.00 wyjście |
| Koszt efektywny | Najniższy na zadanie w przypadku prostych prac | Niższy niż 3.5 dzięki zyskom efektywności | Wyższy niż 3.6 |
Podsumowanie rekomendacji
- Wybierz 3.5 Flash-Lite — gdy potrzebujesz maksymalnej szybkości i minimalnego kosztu dla zadań o dużej skali lub prostych.
- Wybierz 3.6 Flash — dla większości użytkowników i deweloperów (najlepszy ogólny wybór na teraz).
- Wybierz 3.5 Flash — tylko jeśli masz istniejące przepływy pracy z nim powiązane (zaplanuj aktualizację do 3.6).
Ograniczenia Gemini 3.5 Flash-Lite
- Zoptymalizowany pod kątem efektywności, a nie rozumowania na poziomie czołówki.
- Użycie komputera nie jest obsługiwane.
- Natywne generowanie obrazów i dźwięku jest niedostępne.
- Dostrajanie nie jest obecnie obsługiwane.
- Złożone, wieloetapowe zadania rozumowania są zazwyczaj lepiej obsługiwane przez Gemini 3.5 Flash lub Gemini 3.6 Flash.