Spesifikasi Teknikal Gemini 3.5 Flash-Lite
| Item | Gemini 3.5 Flash-Lite |
|---|---|
| Provider | Google DeepMind |
| Model ID | gemini-3.5-flash-lite |
| Model family | Keluarga Model |
| Availability | Ketersediaan Umum (GA) |
| Input types | Teks, Imej, Video, Audio, PDF |
| Output types | Teks |
| Context window | Tetingkap konteks 1,048,576 token |
| Maximum output | Output maksimum 65,536 token |
| Thinking | Disokong (lalai: minimum; juga sederhana dan tinggi) |
| Function calling | Ya |
| Code execution | Ya |
| File Search | Ya |
| URL Context | Ya |
| Search Grounding | Ya |
| Structured Output | Ya |
| Computer Use | Tidak disokong |
| Caching | Disokong |
| Primary focus | Inferens berkapasiti tinggi, latensi rendah, kos rendah |
Apakah Gemini 3.5 Flash-Lite?
Gemini 3.5 Flash-Lite ialah model terpantas dan paling menjimatkan kos Google dalam keluarga Gemini 3.5. Ia dioptimumkan untuk beban kerja di mana latensi, kadar pemprosesan dan kos API lebih penting daripada prestasi penaakulan maksimum. Aplikasi lazim termasuk penghuraian dokumen, pengekstrakan data berstruktur, penghalaan, pengkodan ringan dan sub-ejen autonomi pada skala besar. Google menempatkannya sebagai laluan naik taraf yang disyorkan daripada Gemini 3.1 Flash-Lite dan Gemini 2.5 Flash untuk penyebaran pengeluaran.
Ciri Utama Gemini 3.5 Flash-Lite
- Dioptimumkan untuk inferens volum tinggi dan kos rendah.
- Menyokong tetingkap konteks 1 juta token untuk dokumen dan repositori panjang.
- Input multimodal natif termasuk teks, imej, video, audio dan PDF.
- Menyokong Pemanggilan Fungsi, Pelaksanaan Kod, Carian Fail, Konteks URL, Grounding Carian dan Output Berstruktur.
- Tahap pemikiran boleh dikonfigurasi (
minimal,medium,high) untuk mengimbangi kelajuan dan kualiti penaakulan. - Meningkatkan pengkodan, penaakulan dan aliran kerja beragen dengan ketara berbanding Gemini 3.1 Flash-Lite sambil mengekalkan latensi yang sangat rendah.
Prestasi Penanda Aras Gemini 3.5 Flash-Lite
Google menyatakan bahawa Gemini 3.5 Flash-Lite jauh mengatasi generasi Flash-Lite terdahulu dalam pengkodan, pemahaman dokumen dan aliran kerja beragen sambil kekal sebagai model berkos paling rendah dalam barisan Gemini 3.5. Gemini 3.5 Flash-Lite memperoleh 54% dalam ujian Terminal-Bench 2.1, satu peningkatan ketara berbanding 31% pendahulunya.
Kekuatan utamanya terletak pada pengelasan, pengekstrakan, balasan sembang dan jawapan yang dipertingkat dengan pengambilan ringkas. Inilah tepatnya bidang di mana model pantas dan berkos rendah boleh cemerlang.
Gemini 3.5 Flash-Lite vs Gemini 3.6 Flash vs Gemini 3.5 Flash
| Aspek | Gemini 3.5 Flash-Lite | Gemini 3.6 Flash | Gemini 3.5 Flash |
|---|---|---|---|
| Positioning | Terpantas & termurah untuk tugas harian volum tinggi (cth., pemprosesan dokumen, carian) | Model Flash perdana semasa: Keseimbangan terbaik antara kecerdasan, kecekapan & prestasi beragen | Model beragen/pengkodan yang kukuh (kini sebahagian besarnya digantikan oleh 3.6) |
| Best For | Aliran kerja kadar pemprosesan tinggi, berkos rendah | Pengkodan, multimodal, ejen kompleks, kerja berasaskan pengetahuan | Tugas beragen & pengkodan umum |
| Intelligence / Performance | Baik (mengatasi Lite lama; kompetitif pada banyak tugas beragen) | Tertinggi antara tiga model (peningkatan ketara dalam pengkodan & tugas beragen) | Kukuh (hampir barisan hadapan bagi siri Flash) |
| Key Benchmarks | - Terminal-Bench: ~54%- Kukuh pada tugas dokumen & volum tinggi | - DeepSWE: 49% (vs 37%)- MLE-Bench: 63.9% (vs 49.7%)- OSWorld: 83% (vs 78.4%) | - Terminal-Bench: 76.2%- Lebih rendah daripada 3.6 pada kebanyakan pengkodan/beragen |
| Speed | Terpantas (~350 token output/saat) | Sangat pantas (~280 t/s) | Pantas |
| Efficiency | Cemerlang untuk volum | Terbaik (purata 17% kurang token output; sehingga 65% dalam pengkodan) | Baik |
| Multimodal | Teks + Imej + Video + Audio | Teks + Imej + Video + Audio (penaakulan lebih kukuh) | Teks + Imej + Video + Audio |
| Context Window | ~1M token | ~1M token | ~1M token |
| Max Output Tokens | ~64k | ~64k | ~64k |
| Pricing (per 1M tokens) | Paling murah: ~$0.30 input / $2.50 output | $1.50 input / $7.50 output | $1.50 input / $9.00 output |
| Effective Cost | Terendah per tugas untuk kerja ringkas | Lebih rendah daripada 3.5 kerana peningkatan kecekapan | Lebih tinggi daripada 3.6 |
Ringkasan Syor
- Pilih 3.5 Flash-Lite — apabila anda memerlukan kelajuan maksimum dan kos minimum untuk tugas volum tinggi atau mudah.
- Pilih 3.6 Flash — untuk kebanyakan pengguna dan pembangun (pilihan keseluruhan terbaik pada masa ini).
- Pilih 3.5 Flash — hanya jika anda mempunyai aliran kerja sedia ada yang bergantung padanya (rancang untuk naik taraf ke 3.6).
Had Gemini 3.5 Flash-Lite
- Dioptimumkan untuk kecekapan berbanding penaakulan pada tahap barisan hadapan.
- Penggunaan Komputer tidak disokong.
- Penjanaan imej dan audio natif tidak tersedia.
- Penalaan halus pada masa ini tidak disokong.
- Tugas penaakulan berbilang langkah yang kompleks umumnya lebih sesuai untuk Gemini 3.5 Flash atau Gemini 3.6 Flash.