Spesifikasi Teknis Gemini 3.6 Flash
| Item | Gemini 3.6 Flash |
|---|---|
| Provider | Google DeepMind |
| Model ID | gemini-3.6-flash |
| Model family | Keluarga Gemini 3.x |
| Availability | Ketersediaan Umum (GA) |
| Input types | Teks, Gambar, Video, Audio, PDF |
| Output types | Teks |
| Context window | 1,048,576 token |
| Maximum output | 65,536 token |
| Thinking | Didukung (sedang / tinggi) |
| Function calling | Ya |
| Code execution | Ya |
| File Search | Ya |
| URL Context | Ya |
| Search Grounding | Ya |
| Computer Use | Pratinjau |
| Structured Output | Ya |
| Caching | Didukung |
Sumber: dokumentasi Google Gemini API.
Apa itu Gemini 3.6 Flash?
Gemini 3.6 Flash adalah model Flash terbaru dari Google yang siap produksi, dirancang untuk menghadirkan kecerdasan tingkat terdepan sekaligus mempertahankan latensi rendah dan efisiensi biaya yang menjadi ciri seri Flash. Model ini dioptimalkan untuk pengodean, pemahaman multimodal, penalaran, dan alur kerja agentic.
Dibandingkan dengan Gemini 3.5 Flash, model ini meningkatkan kualitas pembuatan kode, akurasi penalaran, penggunaan alat, dan efisiensi token sambil mendukung jendela konteks masif hingga 1 juta token. Google memposisikannya sebagai model andalan default bagi pengembang yang membangun agen AI dan sistem otomasi kompleks.
Fitur Utama Gemini 3.6 Flash
- Mendukung pemrosesan konteks panjang hingga 1M token.
- Input multimodal native termasuk teks, gambar, video, audio, dan dokumen PDF.
- Peningkatan kuat dalam pembuatan kode dan tugas rekayasa perangkat lunak.
- Dukungan bawaan untuk Function Calling, File Search, URL Context, Search Grounding, dan Computer Use.
- Lebih efisien dari Gemini 3.5 Flash dalam penggunaan token, mengurangi biaya inferensi sambil mempertahankan kualitas lebih tinggi.
- Dirancang untuk agen AI multi-langkah dan alur kerja otonom.
Performa Benchmark
Google melaporkan bahwa Gemini 3.6 Flash memberikan performa pengodean, penalaran, dan multimodal yang lebih kuat daripada Gemini 3.5 Flash sambil menggunakan token output yang jauh lebih sedikit. Perusahaan menyoroti peningkatan performa pada benchmark internal pengodean dan agentic serta menyatakan bahwa model ini dapat mengurangi penggunaan token output hingga 65% pada evaluasi rekayasa perangkat lunak tertentu seperti DeepSWE, sehingga menurunkan biaya inferensi keseluruhan. Google belum menerbitkan tabel benchmark publik yang komprehensif (misalnya, MMLU, GPQA, SWE-bench Verified) untuk rilis ini.

Gemini 3.6 Flash vs Gemini 3.5 Flash vs Gemini 3.1 Pro
| Aspek | Gemini 3.6 Flash | Gemini 3.5 Flash | Gemini 3.1 Pro |
|---|---|---|---|
| Release | 21 Juli 2026 (GA) | Awal 2026 | ~Feb 2026 (Pratinjau) |
| Positioning | Andalan efisien untuk agen, pengodean, multimodal | Model Flash agentic sebelumnya | Penalaran tingkat lanjut kelas Pro |
| Pricing (per 1M tokens) | Input: $1.50Output: $7.50 | Input: $1.50Output: $9.00 | Lebih tinggi (mis., ~$2 input / $12 output) |
| Token Efficiency | 17% token output lebih sedikit vs 3.5 Flash; lebih sedikit langkah/pemanggilan alat | Baseline | Kurang efisien dalam alur kerja agentic |
| Speed | Tinggi (keluarga Flash) | Tinggi | Lebih lambat daripada model Flash |
| Context Window | 1M token | 1M token | Kemungkinan serupa |
| Strengths | Pengodean, pekerjaan berbasis pengetahuan, multimodal (grafik/dokumen), computer use, efisiensi agentic | Keseimbangan agentic/pengodean yang baik | Penalaran lebih dalam pada masalah kompleks |
Ringkasan Cepat
- 3.6 Flash → Pilihan terbaik untuk sebagian besar pengguna saat ini: lebih cepat, lebih murah per tugas, lebih efisien daripada 3.5 Flash, dan melampaui 3.1 Pro pada banyak benchmark praktis/agentic.
- 3.5 Flash → Pendahulunya yang solid; masih mumpuni tetapi mulai tersisihkan oleh 3.6 Flash (biaya token output lebih tinggi, kurang efisien).
- 3.1 Pro → Lebih kuat pada sebagian skenario penalaran mendalam tetapi lebih lambat, lebih mahal, dan umumnya tertinggal dari model Flash terbaru dalam kecepatan, efisiensi, dan banyak tugas agentic/dunia nyata.
Batasan
- Pembuatan gambar tidak didukung secara langsung.
- Pembuatan audio tidak tersedia.
- Computer Use tetap dalam tahap Pratinjau.
- Beberapa parameter generasi lama (
temperature,top_p,top_k) telah dihapus dari antarmuka API baru. - Performa terbaik dicapai melalui Gemini Interactions API terbaru.
Cara Mengakses Gemini 3.6 Flash API
Langkah 1: Dapatkan Akses API
Masuk ke cometAPI. Jika Anda belum menjadi pengguna kami, silakan daftar terlebih dahulu. Masuk ke CometAPI console. Dapatkan kredensial kunci API untuk antarmuka tersebut. Klik “Add Token” pada token API di pusat personal, dapatkan kunci token: sk-xxxxx dan kirimkan.

Langkah 2: Kirim Permintaan ke Gemini 3.6 Flash API
Pilih endpoint “ gemini-3.6-flash" "gemini-3.6-flash-thinking” untuk mengirim permintaan API dan atur request body. Metode permintaan dan request body diperoleh dari dokumentasi API di situs kami. Situs kami juga menyediakan pengujian Apifox untuk kenyamanan Anda. Ganti <YOUR_API_KEY> dengan kunci CometAPI Anda yang sebenarnya dari akun Anda. base url adalah Gemini Generating Content
Masukkan pertanyaan atau permintaan Anda ke dalam kolom content—itulah yang akan direspons oleh model . Proses respons API untuk mendapatkan jawaban yang dihasilkan.
Langkah 3: Proses Respons
API mengembalikan respons kandidat terstruktur termasuk teks yang dihasilkan, sitasi, metadata keamanan, dan output alat opsional.