Spesifikasi Teknis Gemini 3.5 Flash-Lite
| Item | Gemini 3.5 Flash-Lite |
|---|---|
| Provider | Google DeepMind |
| Model ID | gemini-3.5-flash-lite |
| Model family | Gemini 3.5 |
| Availability | Ketersediaan Umum (GA) |
| Input types | Teks, Gambar, Video, Audio, PDF |
| Output types | Teks |
| Context window | 1,048,576 token |
| Maximum output | 65,536 token |
| Thinking | Didukung (bawaan: minimal; juga sedang dan tinggi) |
| Function calling | Yes |
| Code execution | Yes |
| File Search | Yes |
| URL Context | Yes |
| Search Grounding | Yes |
| Structured Output | Yes |
| Computer Use | Tidak didukung |
| Caching | Didukung |
| Primary focus | Inferensi throughput tinggi, latensi rendah, biaya rendah |
Apa itu Gemini 3.5 Flash-Lite?
Gemini 3.5 Flash-Lite adalah model tercepat dan paling hemat biaya dari Google dalam keluarga Gemini 3.5. Model ini dioptimalkan untuk beban kerja yang memprioritaskan latensi, throughput, dan biaya API dibandingkan performa penalaran maksimum. Aplikasi umum mencakup parsing dokumen, ekstraksi data terstruktur, perutean, pengodean ringan, dan sub-agen otonom dalam skala besar. Google memposisikannya sebagai jalur peningkatan yang direkomendasikan dari Gemini 3.1 Flash-Lite dan Gemini 2.5 Flash untuk penerapan produksi.
Fitur Utama Gemini 3.5 Flash-Lite
- Dioptimalkan untuk inferensi ber-volume tinggi dan berbiaya rendah.
- Mendukung jendela konteks 1 juta token untuk dokumen dan repositori panjang.
- Input multimodal native termasuk teks, gambar, video, audio, dan PDF.
- Mendukung Function Calling, Code Execution, File Search, URL Context, Search Grounding, dan Structured Outputs.
- Tingkat penalaran yang dapat dikonfigurasi (
minimal,medium,high) untuk menyeimbangkan kecepatan dan kualitas penalaran. - Secara signifikan meningkatkan pengodean, penalaran, dan alur kerja agentik dibanding Gemini 3.1 Flash-Lite sambil mempertahankan latensi yang sangat rendah.
Kinerja Benchmark Gemini 3.5 Flash-Lite
Google menyatakan bahwa Gemini 3.5 Flash-Lite secara signifikan melampaui generasi Flash-Lite sebelumnya dalam pengodean, pemahaman dokumen, dan alur kerja agentik sekaligus tetap menjadi model berbiaya terendah di lini Gemini 3.5. Gemini 3.5 Flash-Lite meraih skor 54% pada uji Terminal-Bench 2.1, peningkatan signifikan dibanding skor 31% pendahulunya.
Kekuatan model ini terletak pada klasifikasi, ekstraksi, balasan chat, dan jawaban sederhana yang ditingkatkan dengan retrieval. Inilah area di mana model cepat dan berbiaya rendah dapat unggul.
Gemini 3.5 Flash-Lite vs Gemini 3.6 Flash vs Gemini 3.5 Flash
| Aspek | Gemini 3.5 Flash-Lite | Gemini 3.6 Flash | Gemini 3.5 Flash |
|---|---|---|---|
| Posisi | Tercepat & termurah untuk tugas sehari-hari ber-volume tinggi (mis. pemrosesan dokumen, pencarian) | Flash andalan saat ini: Keseimbangan terbaik antara kecerdasan, efisiensi & kinerja agentik | Model agentik/pengodean yang kuat (kini sebagian besar digantikan oleh 3.6) |
| Terbaik untuk | Alur kerja throughput tinggi dan berbiaya rendah | Pengodean, multimodal, agen kompleks, pekerjaan berbasis pengetahuan | Tugas agentik & pengodean umum |
| Kecerdasan / Performa | Baik (melampaui Lite lama; kompetitif pada banyak tugas agentik) | Tertinggi di antara ketiganya (peningkatan nyata pada pengodean & agentik) | Kuat (mendekati tingkat terdepan untuk seri Flash) |
| Benchmark Kunci | - Terminal-Bench: ~54%- Kuat pada tugas dokumen & volume tinggi | - DeepSWE: 49% (vs 37%)- MLE-Bench: 63.9% (vs 49.7%)- OSWorld: 83% (vs 78.4%) | - Terminal-Bench: 76.2%- Lebih rendah daripada 3.6 pada sebagian besar pengodean/agentik |
| Kecepatan | Tercepat (~350 token output/detik) | Sangat cepat (~280 t/s) | Cepat |
| Efisiensi | Sangat baik untuk volume | Terbaik (rata-rata 17% lebih sedikit token output; hingga 65% pada pengodean) | Baik |
| Multimodal | Teks + Gambar + Video + Audio | Teks + Gambar + Video + Audio (penalaran lebih kuat) | Teks + Gambar + Video + Audio |
| Jendela Konteks | ~1M token | ~1M token | ~1M token |
| Token Output Maksimum | ~64k | ~64k | ~64k |
| Harga (per 1M token) | Termurah: ~$0.30 input / $2.50 output | $1.50 input / $7.50 output | $1.50 input / $9.00 output |
| Biaya Efektif | Terendah per tugas untuk pekerjaan sederhana | Lebih rendah daripada 3.5 karena peningkatan efisiensi | Lebih tinggi daripada 3.6 |
Rekomendasi Ringkas
- Pilih 3.5 Flash-Lite — saat Anda membutuhkan kecepatan maksimum dan biaya minimum untuk tugas ber-volume tinggi atau sederhana.
- Pilih 3.6 Flash — untuk sebagian besar pengguna dan pengembang (pilihan keseluruhan terbaik saat ini).
- Pilih 3.5 Flash — hanya jika Anda memiliki alur kerja yang sudah terikat padanya (rencanakan peningkatan ke 3.6).
Keterbatasan Gemini 3.5 Flash-Lite
- Dioptimalkan untuk efisiensi alih-alih penalaran tingkat terdepan.
- Computer Use tidak didukung.
- Pembuatan gambar dan audio native tidak tersedia.
- Fine-tuning saat ini tidak didukung.
- Tugas penalaran multi-langkah yang kompleks umumnya lebih cocok untuk Gemini 3.5 Flash atau Gemini 3.6 Flash.