Gemini 3.6 Flash and 3.5 Flash Lite are now live on CometAPI โ†’

Cara Menggunakan Gemini 3.6 Flash API

CometAPI
AnnaJul 23, 2026
Cara Menggunakan Gemini 3.6 Flash API

TLDR: Gemini 3.6 Flash (gemini-3.6-flash) adalah model Flash stabil terbaru dari Google (GA per Juli 2026), unggul dalam alur kerja berbasis agen, pengkodean, tugas multimodal, dan efisiensi. Model ini menggunakan ~17% lebih sedikit token output dibanding 3.5 Flash sambil memberikan kinerja lebih kuat pada tolok ukur seperti DeepSWE (49% vs. 37%) dan OSWorld-Verified (83% vs. 78.4%). Harga: $1.50/M input, $7.50/M output.

Panduan ini mencakup penyiapan, parameter, fitur lanjutan, contoh langkah demi langkah, perbandingan, dan alasan mengapa pengalihan melalui CometAPI (satu key untuk 500+ model, sering lebih murah) ideal untuk produksi.

Key Takeaways:

  • Catatan Migrasi: Hapus temperature/top_p/top_k; gunakan Interactions API untuk hasil terbaik.
  • Peningkatan Efisiensi: Lebih sedikit token, langkah, dan panggilan alat yang mengurangi biaya nyata.
  • Dukungan Multimodal & Agen yang Kuat: Teks, gambar, video, audio, PDF; alat native seperti Computer Use dan pemanggilan fungsi.
  • Jendela Konteks 1M: Menangani dokumen/basis kode masif.
  • Tingkat Penalaran: Kendalikan kedalaman penalaran (minimal hingga tinggi).
  • Rekomendasi CometAPI: Akses terpadu kompatibel OpenAI, harga kompetitif, tanpa vendor lock-in.

Introduction to Gemini 3.6 Flash API

Gemini 3.6 Flash dari Google mewakili evolusi signifikan dalam seri Flash, dioptimalkan untuk era agen di mana kecepatan, efisiensi biaya, dan keandalan paling penting untuk AI skala produksi. Diluncurkan pada 21 Juli 2026, model ini dibangun di atas Gemini 3.5 Flash dengan peningkatan pengkodean, pekerjaan pengetahuan, kemampuan multimodal, dan perbaikan efisiensi token yang substansial.

Tolok ukur independen dan data Google menunjukkan model ini memangkas waktu tugas dalam beberapa skenario (mis., 1,3 menit), mencapai throughput tinggi, dan mengurangi biaya keseluruhan untuk alur kerja kompleks. Dengan jendela konteks 1 juta token dan dukungan untuk input teks, gambar, video, audio, dan PDF, model ini ideal bagi pengembang yang membangun agen terukur, chatbot, alat konten, dan otomasi.

Masukan pengguna awal memuji reliabilitasnya untuk alur kerja agen bertahap dengan lebih sedikit loop dan edit. Model ini juga mendukung alat bawaan seperti Computer Use.

Untuk pengumuman lengkap: Google Blog - Memperkenalkan Gemini 3.6 Flash.

What You Need Before You Start

1. Google API Key (Direct Access)

  • Kunjungi Google AI Studio dan buat kunci API gratis.
  • Untuk batas laju lebih tinggi, siapkan Cloud Billing (prabayar minimum ~$10).

CometAPI menyatukan akses ke 500+ model (termasuk Gemini 3.6 Flash) melalui satu endpoint yang kompatibel dengan OpenAI. Tidak perlu banyak key atau dasbor vendor.

  • Daftar di CometAPI.com โ€” tingkat gratis dengan kredit uji coba.
  • Dapatkan satu kunci API Anda.
  • Manfaat: penghematan biaya 20-40%, kompatibilitas SDK OpenAI, analitik penggunaan, mudah ganti model, uptime tinggi (99,9%), latensi rendah (<400ms rata-rata).

Catatan Harga CometAPI Gemini 3.6 Flash: Sering lebih rendah dari resmi (mis., sekitar $1.2/M input dalam contoh untuk seri Flash), bayar sesuai penggunaan. Periksa tarif saat ini di dasbor mereka.

3. Development Environment

  • Python: pip install -U google-genai (atau openai untuk kompatibilitas CometAPI/OpenAI).
  • Node.js: @google/genai atau pustaka OpenAI.
  • Familiar dasar dengan REST/JSON.

4. Tools & Quotas

Tinjau batas laju di AI Studio atau dokumentasi CometAPI. Mulai dengan pengujian prompt.

What You Need Before You Start

1. Google API Key (Direct Access)

  • Kunjungi Google AI Studio dan buat kunci API gratis.
  • Untuk batas laju lebih tinggi, siapkan Cloud Billing (prabayar minimum ~$10).

CometAPI menyatukan akses ke 500+ model (termasuk Gemini 3.6 Flash) melalui satu endpoint yang kompatibel dengan OpenAI. Tidak perlu banyak key atau dasbor vendor.

  • Daftar di CometAPI.com โ€” tingkat gratis dengan kredit uji coba.
  • Dapatkan satu kunci API Anda.
  • Manfaat: penghematan biaya 20-40%, kompatibilitas SDK OpenAI, analitik penggunaan, mudah ganti model, uptime tinggi (99,9%), latensi rendah (<400ms rata-rata).

Catatan Harga CometAPI Gemini 3.6 Flash: Sering lebih rendah dari resmi (mis., sekitar $1.2/M input dalam contoh untuk seri Flash), bayar sesuai penggunaan. Periksa tarif saat ini di dasbor mereka.

3. Development Environment

  • Python: pip install -U google-genai (atau openai untuk kompatibilitas CometAPI/OpenAI).
  • Node.js: @google/genai atau pustaka OpenAI.
  • Familiar dasar dengan REST/JSON.

4. Tools & Quotas

Tinjau batas laju di AI Studio atau dokumentasi CometAPI. Mulai dengan pengujian prompt.

API Parameters and Features of Gemini 3.6 Flash

Gemini 3.6 Flash mendukung Interactions API (direkomendasikan untuk fitur terbaru) dan endpoint generateContent tradisional.

Core Specs:

  • Konteks: 1M token (1.048.576).
  • Output Maks: ~64k token.
  • Input Multimodal: Teks, Gambar, Video, Audio, PDF.
  • Output: Teks (ditambah media pada beberapa varian).
  • Alat: Pemanggilan fungsi, Computer Use (native), grounding Pencarian, eksekusi kode, Files API.
  • Penalaran: Bawaan "medium"; tingkat: minimal, low, medium, high.
  • Lainnya: Output terstruktur, instruksi sistem, streaming, percakapan stateful.
  • Harga (Google langsung): $1.50/M input, $7.50/M output (lebih rendah dari output $9/M pada 3.5 Flash). Periksa CometAPI untuk tarif yang berpotensi lebih rendah.

Referensi lengkap: Dokumentasi Model API Gemini.

API Parameters & Generation Config

Parameter kunci dalam generation_config (atau setara):

  • thinking_level: "minimal" | "low" | "medium" | "high" (mengendalikan kedalaman penalaran vs. kecepatan/biaya).
  • System Instruction: Mengarahkan perilaku (mis., "You are a helpful coding assistant. Output only valid JSON.").
  • Structured Outputs: Mendefinisikan skema untuk JSON yang andal.
  • Tidak lagi direkomendasikan (deprecated): temperature, top_p, top_k โ€” hapus atau akan memicu error di masa depan.
  • temperature: Mengontrol kerandoman (0-2; lebih rendah untuk deterministik).
  • topP / topK: Nucleus/top-k sampling.
  • maxOutputTokens: Membatasi panjang respons (kontrol biaya/latensi).

Contoh Konfigurasi (Python SDK):

interaction = client.interactions.create(
    model="gemini-3.6-flash",
    input="Prompt Anda di sini",
    system_instruction="Ringkas dan akurat.",
    generation_config={
        "thinking_level": "medium"
    }
)

Referensi lengkap: Dokumentasi Model API Gemini.

Advanced Features:

  • Output Terstruktur
  • Penggunaan Alat Paralel
  • Pemahaman Konteks Panjang
  • Caching Konteks (implisit/eksplisit)
  • Input Multimodal (hingga batas pada file)
  • Filter Keamanan (ditingkatkan untuk 3.6)

How to Access Gemini 3.6 Flash API

Access Through Google

Google menyatakan Gemini 3.6 Flash tersedia melalui:

  • Gemini API via Google AI Studio.
  • Android Studio.
  • Google Antigravity.
  • Gemini Enterprise Agent Platform.
  • Aplikasi Gemini Enterprise.
  • Aplikasi Gemini untuk pengguna umum.

ID model API resmi adalah:

gemini-3.6-flash

Gunakan halaman model Google dan halaman harga untuk mengonfirmasi batas saat ini, alat yang didukung, batas laju, dan ketentuan penagihan sebelum penerapan.

Access Through CometAPI

CometAPI menyediakan halaman model Gemini 3.6 Flash dan mendukung panggilan kompatibel OpenAI melalui:

https://api.cometapi.com/v1

Langkah peluncuran CometAPI yang disarankan:

  1. Buat atau gunakan kembali kunci API CometAPI.
  2. Konfirmasi gemini-3.6-flash tersedia di direktori model CometAPI atau dasbor.
  3. Ganti base URL dengan https://api.cometapi.com/v1 untuk alur kerja chat yang kompatibel OpenAI.
  4. Jalankan set tolok ukur Anda terhadap Gemini 3.5 Flash, Gemini 3.6 Flash, dan Gemini 3.5 Flash-Lite.
  5. Bandingkan kualitas, latensi, token output, retry, dan biaya akhir.
  6. Rute hanya beban kerja di mana Gemini 3.6 Flash meningkatkan biaya per tugas sukses.

CometAPI Quick Start Example

Untuk alur kerja chat kompatibel OpenAI, dokumentasi CometAPI menggunakan base URL ini:

https://api.cometapi.com/v1

Contoh Python:

import os
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["COMETAPI_KEY"],
    base_url="https://api.cometapi.com/v1",
)

completion = client.chat.completions.create(
    model="gemini-3.6-flash",
    messages=[
        {
            "role": "user",
            "content": "Ringkas catatan rilis terlampir menjadi risiko migrasi dan item tindakan.",
        }
    ],
)

print(completion.choices[0].message.content)

Untuk fitur Gemini native penyedia, halaman model Gemini CometAPI juga mendokumentasikan rute generasi v1beta gaya Gemini. Gunakan format permintaan yang cocok dengan fitur yang dibutuhkan aplikasi Anda.

Step-by-Step: How to Use Gemini 3.6 Flash API

Step 1: Basic Text Generation

Lihat quickstarts di atas.

Step 2: Multimodal (Images/Audio/PDF)

Gunakan Files API untuk file besar.

Contoh (Python):

myfile = client.files.upload(file="path/to/document.pdf")
interaction = client.interactions.create(
    model="gemini-3.6-flash",
    input=[
        {"type": "text", "text": "Ringkas dokumen ini dan ekstrak data kunci."},
        {"type": "file", "uri": myfile.uri, "mime_type": myfile.mime_type}
    ]
)

Step 3: Function Calling & Tools

Definisikan alat; model memanggilnya secara otonom.

Step 4: Streaming Responses

Tambahkan stream=True untuk output real-time.

Gunakan previous_interaction_id untuk riwayat yang dikelola server.

Step 6: Agentic Workflows & Computer Use

Manfaatkan alat native untuk otomasi.

Tip CometAPI: Uji lintas model (mis., bandingkan dengan Claude atau GPT) dengan satu key.

Advanced Usage Examples & Best Practices

  • Agen Pengkodean: Prompt untuk migrasi kode atau debugging dengan penggunaan alat.
  • Analisis Dokumen: Berikan PDF + pertanyaan untuk ringkasan/ekstraksi.
  • Optimisasi Biaya: Gunakan tingkat penalaran lebih rendah, caching, dan batas token maksimum.
  • Penanganan Error: Pantau metadata penggunaan; terapkan retry.
  • Skala Produksi: Batch jika memungkinkan; pantau melalui dasbor CometAPI.

Sertakan instruksi sistem untuk keahlian domain (mis., "You are a senior Python engineer...").

Data Pendukung: Pada OSWorld, 3.6 Flash mencapai 83% vs. pendahulunya. Penghematan token langsung diterjemahkan ke tagihan lebih rendah dan iterasi lebih cepat.

Comparison Table: Gemini 3.6 Flash vs Alternatives

Fitur/ModelGemini 3.6 FlashGemini 3.5 FlashClaude Sonnet 5 (via CometAPI)GPT-5.6 (via CometAPI)
Jendela konteks1M token1M tokenBervariasiBervariasi
Harga Input/Output$1.50 / $7.50 (resmi)Output lebih tinggiKompetitif via CometAPI~$4/M
Efisiensi token+17% lebih sedikit token outputBaselinePenalaran kuatKualitas tinggi
Kekuatan pengkodeanSangat baik (kenaikan DeepSWE)BaikSangat kuatSangat baik
Kecepatan/ThroughputTinggi (dioptimalkan untuk Flash)TinggiSeimbangSeimbang
MultimodalNative (teks/gambar/video/dll)KuatKuatKuat
Akses CometAPIYa, terpadu & lebih murahYaYaYa

CometAPI membuat perbandingan lintas model menjadi mudah dengan satu endpoint.

How much does the Gemini 3.6 Flash API cost?

Official Google Gemini API Pricing

Tingkat Gemini 3.6 FlashInput / 1M tokenInput dalam cache / 1M tokenOutput / 1M tokenKecocokan terbaik
Standar$1.50$0.15$7.50Permintaan produksi normal
Batch$0.75$0.075$3.75Pekerjaan offline dengan latensi kurang penting
Flex$0.75$0.075$3.75Beban kerja berbiaya lebih rendah dengan kapasitas fleksibel
Prioritas$2.70$0.27$13.50Beban kerja sensitif terhadap latensi atau prioritas

Harga resmi Google juga mencantumkan biaya grounding pencarian dan Maps. Untuk model Gemini 3, halaman tersebut mencantumkan 5.000 prompt per bulan gratis untuk grounding dengan Google Search atau Google Maps, lalu $14 per 1.000 kueri pencarian pada tingkat berbayar yang relevan. Selalu verifikasi ketentuan grounding saat ini karena penggunaan alat dapat mengubah biaya nyata agen.

CometAPI Pricing Signal

Harga model Gemini 3.6 Flash di CometAPI:

RuteInput / 1M tokenOutput / 1M token
Harga Standar resmi Google$1.50$7.50
Harga tertera CometAPI$1.20$6.00
Diskon tertera20%20%

Periksa dasbor CometAPI sebelum memublikasikan harga untuk pelanggan atau meluncurkan trafik produksi. Halaman publik bisa tertinggal dari konfigurasi penagihan live.

Gemini 3.6 Flash vs Gemini 3.5 Flash Pricing

ModelStandar input / 1MStandar output / 1MContext caching / 1MPerubahan harga utama
Gemini 3.5 Flash$1.50$9.00$0.15Baseline
Gemini 3.6 Flash$1.50$7.50$0.15Harga input sama, harga output 16,7% lebih rendah
Gemini 3.5 Flash-Lite$0.30$2.50$0.03Jauh lebih murah untuk pekerjaan sederhana volume tinggi

Gemini 3.6 Flash lebih murah daripada Gemini 3.5 Flash pada token output, tetapi bukan model Gemini termurah. Untuk klasifikasi, ekstraksi, routing sederhana, atau tugas subagen volume tinggi, Gemini 3.5 Flash-Lite mungkin lebih baik sebagai model awal. Model 3.6 Flash yang lebih kuat paling menarik ketika akurasinya yang lebih tinggi mengurangi retry, loop alat, atau eskalasi.

Example Cost Scenario

Asumsikan sebuah permintaan menggunakan 15.000 token input dan 8.000 token output.

RuteBiaya estimasi
Gemini 3.5 Flash pada harga Standar resmi$0.0945
Gemini 3.6 Flash pada harga Standar resmi, volume token yang sama$0.0825
Gemini 3.6 Flash pada harga Standar resmi, dengan 17% lebih sedikit token output$0.0723
Gemini 3.6 Flash melalui CometAPI pada $1.20/M input dan $6.00/M output tertera, volume sama$0.0660
Gemini 3.6 Flash melalui CometAPI, dengan 17% lebih sedikit token output$0.0578

Contoh ini hanya model biaya, bukan jaminan. Penghematan nyata bergantung pada panjang prompt, token penalaran, output alat, tingkat hit cache, tingkat retry, dan apakah tugas Anda mereproduksi pengurangan token output yang dilaporkan Google.

Potential Limitations & Troubleshooting

  • Batas laju pada tingkat gratis.
  • Batas ukuran/durasi file untuk multimodal.
  • Knowledge cutoff (~Maret 2026).
  • Penolakan keamanan untuk topik sensitif.
  • Pantau token untuk kontrol biaya.

Perbaikan umum: Periksa kunci API, gunakan ID model yang benar, tangani event streaming dengan benar.

Final Recommendation

Gemini 3.6 Flash adalah salah satu rilis Gemini paling praktis bagi pengembang di 2026 karena meningkatkan ekonomi agen AI nyata. Ia menurunkan harga output, mengurangi penggunaan token output, meningkatkan beberapa tolok ukur pengkodean dan agen yang dilaporkan Google, dan mempertahankan permukaan long-context, multimodal, dan berkemampuan alat yang membuat Gemini 3.5 Flash berguna.

Untuk sistem produksi baru, mulai dengan membandingkan Gemini 3.6 Flash sebagai andalan untuk tugas kompleks. Pasangkan dengan Gemini 3.5 Flash-Lite untuk pekerjaan berbiaya rendah volume tinggi, pertahankan Gemini 3.5 Flash sebagai fallback sementara, dan gunakan CometAPI untuk membandingkan rute lintas keluarga model dengan satu kunci API.

Strategi model terbaik bukanlah "ganti semuanya dengan Gemini 3.6 Flash." Melainkan "kirim ke Gemini 3.6 Flash pekerjaan di mana kapabilitas tambahannya menurunkan biaya total kesuksesan."

Try It Yourself

FAQs

Apakah Gemini 3.6 Flash mendukung input multimodal?

Ya. Halaman Gemini API Google mencantumkan input teks, gambar, video, audio, dan PDF. Model mengembalikan output teks.

Apakah Gemini 3.6 Flash menghasilkan gambar atau audio?

Tidak. Halaman model Google mencantumkan pembuatan gambar dan pembuatan audio tidak didukung untuk Gemini 3.6 Flash.

Berapa jendela konteks untuk Gemini 3.6 Flash?

Gemini 3.6 Flash mendukung hingga 1.048.576 token input dan hingga 65.536 token output.

Haruskah saya menggunakan Gemini 3.6 Flash atau Gemini 3.5 Flash-Lite?

Gunakan Gemini 3.6 Flash untuk kualitas pengkodean, penalaran multimodal, agen kompleks, dan tugas berat alat. Gunakan Gemini 3.5 Flash-Lite untuk ekstraksi volume tinggi, routing, klasifikasi, penerjemahan, dan alur kerja pemrosesan data yang dapat diprediksi ketika biaya dan latensi lebih penting daripada kedalaman penalaran maksimum.

Apakah Gemini 3.6 Flash tersedia sekarang?

Ya. Google mencantumkan gemini-3.6-flash sebagai model Gemini API stabil dengan pembaruan Juli 2026. Google mengumumkan ketersediaan pada 21 Juli 2026 untuk pengembang, perusahaan, dan pengguna aplikasi Gemini umum.

Apa ID model Gemini 3.6 Flash?

ID resmi adalah gemini-3.6-flash. CometAPI juga mencantumkan gemini-3.6-flash pada halaman modelnya dan menyebutkan rute gemini-3.6-flash-thinking.

Siap memangkas biaya pengembangan AI hingga 20%?

Mulai gratis dalam beberapa menit. Kredit uji coba gratis disertakan. Tidak perlu kartu kredit.

Baca Selengkapnya