Spesifikasi Teknis Gemini 3.6 Flash
| Item | Gemini 3.6 Flash |
|---|---|
| Penyedia | Google DeepMind |
| ID Model | gemini-3.6-flash |
| Keluarga model | Gemini 3.x |
| Ketersediaan | General Availability (GA) |
| Tipe input | Teks, Gambar, Video, Audio, PDF |
| Tipe output | Teks |
| Jendela konteks | 1.048.576 token |
| Output maksimum | 65.536 token |
| Pemikiran | Didukung (menengah / tinggi) |
| Pemanggilan fungsi | Ya |
| Eksekusi kode | Ya |
| Pencarian File | Ya |
| Konteks URL | Ya |
| Grounding Pencarian | Ya |
| Penggunaan Komputer | Pratinjau |
| Output Terstruktur | Ya |
| Caching | Didukung |
Sumber: Dokumentasi Google Gemini API.
Apa itu Gemini 3.6 Flash?
Gemini 3.6 Flash adalah model Flash produksi terbaru dari Google, dirancang untuk menghadirkan kecerdasan tingkat terdepan sekaligus mempertahankan latensi rendah dan efisiensi biaya yang menjadi ciri seri Flash. Model ini dioptimalkan untuk pengkodean, pemahaman multimodal, penalaran, dan alur kerja agen.
Dibandingkan dengan Gemini 3.5 Flash, model ini meningkatkan kualitas pembuatan kode, akurasi penalaran, penggunaan alat, dan efisiensi token sambil mendukung jendela konteks 1 juta token yang masif. Google memposisikannya sebagai model andalan default bagi pengembang yang membangun agen AI dan sistem otomasi kompleks.
Fitur Utama Gemini 3.6 Flash
- Mendukung pemrosesan konteks panjang 1M-token.
- Input multimodal native termasuk teks, gambar, video, audio, dan dokumen PDF.
- Peningkatan kuat dalam pembuatan kode dan tugas rekayasa perangkat lunak.
- Dukungan bawaan untuk Function Calling, File Search, URL Context, Search Grounding, dan Computer Use.
- Lebih efisien dalam penggunaan token daripada Gemini 3.5 Flash, mengurangi biaya inferensi sambil mempertahankan kualitas lebih tinggi.
- Dirancang untuk agen AI multi-langkah dan alur kerja otonom.
Kinerja Benchmark
Google melaporkan bahwa Gemini 3.6 Flash menghadirkan kinerja pengkodean, penalaran, dan multimodal yang lebih kuat dibandingkan Gemini 3.5 Flash sambil menggunakan token output yang jauh lebih sedikit. Perusahaan menyoroti peningkatan performa pada tolok ukur internal pengkodean dan agen, serta menyatakan bahwa model ini dapat mengurangi penggunaan token output hingga 65% pada evaluasi rekayasa perangkat lunak tertentu seperti DeepSWE, sehingga menurunkan biaya inferensi secara keseluruhan. Google belum menerbitkan tabel tolok ukur publik yang komprehensif (mis., MMLU, GPQA, SWE-bench Verified) untuk rilis ini.

Gemini 3.6 Flash vs Gemini 3.5 Flash vs Gemini 3.1 Pro
| Aspek | Gemini 3.6 Flash | Gemini 3.5 Flash | Gemini 3.1 Pro |
|---|---|---|---|
| Rilis | 21 Juli 2026 (GA) | Awal 2026 | ~Feb 2026 (Pratinjau) |
| Pemosisian | Andalan efisien untuk agen, pengkodean, multimodal | Model Flash agen sebelumnya | Penalaran tingkat Pro yang lebih maju |
| Harga (per 1M token) | Input: $1.50Output: $7.50 | Input: $1.50Output: $9.00 | Lebih tinggi (mis., ~$2 input / $12 output) |
| Efisiensi token | 17% lebih sedikit token output vs 3.5 Flash; lebih sedikit langkah/panggilan alat | Baseline | Kurang efisien dalam alur kerja agen |
| Kecepatan | Tinggi (keluarga Flash) | Tinggi | Lebih lambat daripada model Flash |
| Jendela Konteks | 1M token | 1M token | Kemungkinan serupa |
| Kekuatan | Pengkodean, kerja pengetahuan, multimodal (bagan/dokumen), penggunaan komputer, efisiensi agen | Keseimbangan agen/pengkodean yang baik | Penalaran lebih dalam pada masalah kompleks |
Ringkasan Singkat
- 3.6 Flash → Pilihan terbaik secara keseluruhan untuk sebagian besar pengguna saat ini: lebih cepat, lebih murah per tugas, lebih efisien daripada 3.5 Flash, dan melampaui 3.1 Pro pada banyak tolok ukur praktis/agen.
- 3.5 Flash → Pendahulu yang solid; masih mumpuni namun digantikan oleh 3.6 Flash (biaya token output lebih tinggi, kurang efisien).
- 3.1 Pro → Lebih kuat dalam beberapa skenario penalaran mendalam tetapi lebih lambat, lebih mahal, dan umumnya tertinggal dari model Flash yang lebih baru dalam kecepatan, efisiensi, dan banyak tugas dunia nyata/agen.
Keterbatasan
- Pembuatan gambar tidak didukung secara langsung.
- Pembuatan audio tidak tersedia.
- Computer Use masih dalam tahap Pratinjau.
- Beberapa parameter pembuatan lama (
temperature,top_p,top_k) telah dihapus dari antarmuka API baru. - Kinerja terbaik dicapai melalui Gemini Interactions API terbaru.
Cara Mengakses Gemini 3.6 Flash API
Langkah 1: Dapatkan Akses API
Masuk ke cometAPI. Jika Anda belum menjadi pengguna kami, silakan daftar terlebih dahulu. Masuk ke konsol CometAPI. Dapatkan kredensial akses kunci API antarmuka. Klik “Add Token” pada token API di pusat personal, dapatkan kunci token: sk-xxxxx dan kirimkan.

Langkah 2: Kirim Permintaan ke Gemini 3.6 Flash API
Pilih endpoint “ gemini-3.6-flash" "gemini-3.6-flash-thinking” untuk mengirim permintaan API dan atur tubuh permintaan. Metode permintaan dan tubuh permintaan diperoleh dari dokumen API di situs web kami. Situs kami juga menyediakan pengujian Apifox untuk kenyamanan Anda. Ganti <YOUR_API_KEY> dengan kunci CometAPI Anda yang sebenarnya dari akun Anda. base url adalah Gemini Generating Content
Masukkan pertanyaan atau permintaan Anda ke dalam bidang content—ini adalah apa yang akan direspons oleh model. Proses respons API untuk mendapatkan jawaban yang dihasilkan.
Langkah 3: Proses Respons
API mengembalikan kandidat respons terstruktur termasuk teks yang dihasilkan, sitasi, metadata keselamatan, dan output alat opsional.