Gemini 3.6 Flash and 3.5 Flash Lite are now live on CometAPI โ†’

Apakah Gemini 3.6 Flash?

CometAPI
AnnaJul 23, 2026
Apakah Gemini 3.6 Flash?

TLDR: Gemini 3.6 Flash ialah model Flash produksi Google (Julai 2026) untuk pengaturcaraan, kerja pengetahuan, analisis multimodal dan aliran kerja berasaskan agen. Ia mengekalkan tetingkap input 1,048,576 token dan had output 65,536 token daripada Gemini 3.5 Flash, tetapi Google melaporkan prestasi yang lebih baik dalam pengaturcaraan, penggunaan komputer, kerja pengetahuan dan kecekapan token pada harga token output yang lebih rendah.

Gemini 3.6 Flash sebaiknya dianggap sebagai model Flash pilihan pertama baharu untuk pengaturcaraan kompleks, penaakulan multimodal dan agen berbilang langkah. Kekalkan Gemini 3.5 Flash hanya apabila anda memerlukan kesinambungan output atau belum menyelesaikan ujian migrasi. Gunakan Gemini 3.5 Flash-Lite untuk pengekstrakan volum tinggi, perutean, pengelasan dan tugas boleh dijangka lain apabila kos terendah lebih penting daripada kedalaman penaakulan maksimum.

Intipati Utama

  • Gemini 3.6 Flash tersedia umum sebagai gemini-3.6-flash; dokumentasi API Gemini Google menyenaraikan kemas kini terbaharu pada Julai 2026.
  • Gemini 3.6 Flash menyasarkan pengaturcaraan, kerja pengetahuan, analisis multimodal, tugas penggunaan komputer dan aliran kerja agen berbilang langkah.
  • Google melaporkan hasil yang lebih baik berbanding Gemini 3.5 Flash pada DeepSWE, MLE Bench, OSWorld-Verified dan GDPval-AA v2. Google melaporkan 17% lebih sedikit token output berbanding Gemini 3.5 Flash pada Artificial Analysis Index dan sehingga 65% lebih sedikit token output dalam penilaian pengaturcaraan berkaitan DeepSWE.
  • Harga Standard API Gemini rasmi ialah $1.50/M token input dan $7.50/M token output, berbanding $1.50/M dan $9.00/M untuk Gemini 3.5 Flash. Harga Batch dan Flex untuk Gemini 3.6 Flash ialah $0.75/M input dan $3.75/M output; harga Priority ialah $2.70/M input dan $13.50/M output. Halaman model Gemini 3.6 Flash CometAPI menyenaraikan $1.20/M input dan $6.00/M output, 20% di bawah harga Standard rasmi Google pada masa diperiksa.
  • Gemini 3.6 Flash boleh menggantikan Gemini 3.5 Flash untuk banyak beban kerja produksi baharu, tetapi migrasi harus merangkumi ujian prompt, pemanggilan alat, parameter, kependaman, kos dan regresi.
  • Gemini 3.5 Pro tidak termasuk dalam pelancaran ini; Google berkata ia masih diuji dengan rakan kongsi dan akan dikeluarkan secara meluas apabila sedia.

Apakah Gemini 3.6 Flash?

Gemini 3.6 Flash ialah model peringkat Flash lalai baharu untuk dievaluasi jika anda membina agen AI, alat pengaturcaraan, aliran kerja dokumen, pembantu berasaskan carian, atau automasi multimodal. Google melancarkannya pada 21 Julai 2026 bersama Gemini 3.5 Flash-Lite dan Gemini 3.5 Flash Cyber, membingkaikan pelancaran sekitar ekonomi agen produksi: kecekapan token lebih tinggi, kependaman lebih rendah, lebih sedikit gelung alat, dan kos per tugas berjaya yang lebih rendah.

Perubahan paling penting bukanlah nama model. Peningkatan ialah kualiti dan ekonomi: Google berkata Gemini 3.6 Flash menggunakan 17% lebih sedikit token output daripada Gemini 3.5 Flash pada Artificial Analysis Index dan sehingga 65% lebih sedikit token output pada kerja pengaturcaraan gaya DeepSWE, sambil menurunkan harga output Standard daripada $9.00/M kepada $7.50/M.

Keupayaan Teras:

  • Input Multimodal: Teks, imej, video, audio, PDF.
  • Tetingkap Konteks: 1 juta token input, 64k token output.
  • Penggunaan Alat: Pemanggilan fungsi asli, carian sebagai alat, dan penggunaan komputer untuk automasi UI berasaskan agen.
  • Sesuai Untuk: Tugas harian, pengaturcaraan berasaskan agen, penaakulan lanjutan, pemahaman konteks panjang dan penjanaan kod sedia produksi.

Tidak seperti model โ€œProโ€ yang lebih besar yang menumpukan pada kecerdasan maksimum, varian Flash menekankan kelajuan, skala dan keberkesanan kos sambil menyampaikan prestasi tahap termaju dalam bidang sasaran. Gemini 3.6 Flash memajukannya dengan mengurangkan kepanjangan output dan meningkatkan ketepatan.

Tarikh Pemotongan Pengetahuan: Dikemas kini ke Mac 2026 (daripada Januari 2025 dalam versi sebelumnya), memberikan pengetahuan dunia nyata yang lebih segar.

Kad model menambah butiran seni bina penting: Gemini 3.6 Flash berasaskan Gemini 3.5 Flash. Ini menjadikan keluaran tersebut lebih dekat kepada peningkatan terarah berfokus produksi berbanding keluarga baharu sepenuhnya. Google kelihatan menumpukan pada masalah yang ditemui pembangun dalam aliran kerja agen sebenar: terlalu banyak token output, terlalu banyak panggilan alat yang tidak perlu, suntingan tidak diingini semasa tugas diagnostik, gelung semakan kod, tafsiran carta, kerja dokumen dan penaakulan multimodal gaya UI.

Mengapa Google Melancarkan Gemini 3.6 Flash Sekarang?

Berita Terkini di Sebalik Pelancaran

Pengumuman Google pada 21 Julai melakukan tiga perkara serentak:

  1. Melancarkan Gemini 3.6 Flash sebagai model tenaga kerja yang lebih kukuh.
  2. Melancarkan Gemini 3.5 Flash-Lite sebagai model kelas 3.5 terpantas dan termurah untuk aliran kerja throughput tinggi.
  3. Memperkenalkan Gemini 3.5 Flash Cyber dalam CodeMender untuk kes penggunaan pertahanan keselamatan siber akses terhad.

Pengumuman sama turut memperjelas status Gemini 3.5 Pro: ia masih diuji dengan rakan kongsi dan Google merancang untuk membuatnya tersedia secara meluas apabila sedia. Google juga berkata pra-pelatihan Gemini 4 telah bermula.

Konteks itu penting. Gemini 3.6 Flash bukan pengganti Pro. Ia adalah jawapan Google kepada masalah produksi yang berbeza: banyak sistem AI menjadi terlalu mahal, terlalu bertele-tele dan terlalu tidak boleh dipercayai apabila model berulang kali memanggil alat, menaakul merentasi konteks panjang, dan mencuba semula tindakan. Model Flash yang lebih pantas dan lebih cekap boleh memberi impak segera yang lebih besar daripada model perdana yang ditangguhkan jika ia mengurangkan bilangan token, giliran dan percubaan semula yang diperlukan untuk menyelesaikan tugas biasa.

Fokus Pelancaran: Kos per Tugas Berjaya

Pasukan AI sering membandingkan model berdasarkan harga token. Itu berguna, tetapi tidak lengkap. Beban kerja berasaskan agen memperkenalkan pembolehubah kos tambahan:

  • Berapa banyak langkah penaakulan yang diambil model?
  • Berapa banyak panggilan alat yang dibuatnya?
  • Seberapa kerap ia membuat suntingan yang tidak perlu?
  • Seberapa kerap ia gagal dan memerlukan percubaan semula?
  • Berapa banyak token output yang dibelanjakan untuk menerangkan daripada menyelesaikan?
  • Seberapa kerap trafik mesti dieskalasi kepada model yang lebih mahal?

Gemini 3.6 Flash penting kerana Google memasarkan model ini sekitar pembolehubah operasi ini, bukan hanya skor penanda aras utama. Jika model mengurangkan token output sebanyak 17%, mengelakkan gelung suntingan yang tidak perlu, dan menghasilkan kod yang lebih betul pada percubaan pertama, penjimatan sebenar boleh lebih besar daripada yang disarankan jadual harga.

Prestasi Penanda Aras dan Perbandingan

Penilaian Google dan pihak ketiga menyerlahkan peningkatan seimbang 3.6 Flash. Ia tidak mendahului setiap papan pendahulu termaju tetapi cemerlang dalam prestasi diselaraskan kecekapan untuk kegunaan praktikal.

Penanda Aras Terpilih (Gemini 3.6 Flash vs. 3.5 Flash):

  • DeepSWE (Datacurve โ€“ kejuruteraan perisian berbilang langkah): 49% vs. 37% (peningkatan ketepatan ketara, lebih sedikit gelung/suntingan); penggunaan token dikurangkan sehingga 65% dalam sesetengah kes (cth., 276k ke 97k token).
  • MLE-Bench (Penyelidikan ML): 63.9% vs. 49.7%
  • OSWorld-Verified (Penggunaan Komputer): 83.0% vs. 78.4% (penggunaan komputer terbina dalam kini standard)
  • GDPval-AA v2 (Kerja Pengetahuan): 1421 vs. 1349
  • Artificial Analysis Intelligence Index: Sekitar 50 (kukuh, walaupun di belakang beberapa peneraju seperti varian Claude pada ~60); ketara untuk kecekapan token.
  • Lain-lain: Peningkatan dalam Terminal-Bench, konteks panjang (cth., GDM-MRCR v2), SWE-Bench Pro, dan tugas multimodal seperti penghuraian dokumen dan analisis carta.

Jadual Perbandingan: Gemini 3.6 Flash vs. Pesaing Utama (Anggaran, berdasarkan data Julai 2026)

Feature/ModelGemini 3.6 FlashGemini 3.5 FlashGPT-5.6 Luna (est.)Grok 4.5Claude Sonnet 5
Output Token EfficiencyCemerlang (17% lebih baik)BaikTinggiKukuhBaik
Coding (DeepSWE)49%37%67%54%54%
Computer Use (OSWorld)83%78.4%72.6%-81.2%
Knowledge Work (Elo)14211349158415351607
Output Price ($/1M)$7.50$9.00$6.00$6.00$10-15
Best ForAgen CekapAgen UmumKecerdasan TinggiPenaakulanKreatif

Nota Tambahan:

  • SWE-Bench Pro: 58.7% (vs. 55.1% untuk 3.5 Flash).
  • Terminal-Bench 2.1: 78.0% (vs. 76.2%).
  • Model ini cemerlang dalam senario agen dan multimodal sambil mengekalkan kelajuan peringkat Flash.

Ujian bebas (cth., Artificial Analysis, perbincangan Reddit) menyatakan kelajuan dan kecekapan yang kuat, walaupun ia mungkin menggunakan lebih banyak token daripada beberapa pesaing yang dioptimumkan secara ultra dalam seting tertentu. Maklum balas dunia nyata memuji kemampuannya untuk analisis dokumen, draf laporan dan tugas multimodal (cth., melalui pelanggan seperti Hebbia dan Harvey).

Apakah Gemini 3.6 Flash?

Apa Yang Baharu berbanding Gemini 3.5 Flash?

1. Kecekapan Token Lebih Baik

Gemini 3.6 Flash direka untuk menggunakan lebih sedikit token output berbanding Gemini 3.5 Flash. Google memetik pengurangan token output 17% pada Artificial Analysis Index dan sehingga 65% pada beberapa beban kerja pengaturcaraan DeepSWE.

Ini penting kerana token output biasanya lebih mahal daripada token input. Dalam harga Standard API Gemini rasmi, input Gemini 3.6 Flash kekal $1.50/M, tetapi output turun kepada $7.50/M. Output Gemini 3.5 Flash ialah $9.00/M. Apabila harga output lebih rendah dan token output lebih sedikit digabungkan, kos per tugas agen siap boleh jatuh dengan ketara.

2. Pengaturcaraan Lebih Kuat dan Suntingan Tidak Diingini Lebih Sedikit

Dokumentasi Google Cloud untuk Gemini Enterprise Agent Platform menyatakan Gemini 3.6 Flash memperbaiki penjanaan kod dengan kadar kegagalan kompilasi dan semakan yang lebih rendah merentasi persekitaran pembinaan, prototaip dan agen IDE. Ia juga mengurangkan "action bias", bermakna ia lebih baik dalam mengendalikan tugas diagnostik baca sahaja tanpa membuat suntingan tanpa diminta.

  • Peningkatan Aliran Kerja: Langkah penaakulan, giliran perbualan, panggilan alat lebih sedikit, dan pengurangan gelung pelaksanaan yang berlingkar. Ia mengutamakan skrip diagnostik terlebih dahulu sebelum suntingan, meningkatkan ketepatan.
  • Penjanaan Kod: Kod berkualiti lebih tinggi, sedia produksi dengan suntingan tidak diingini dan gelung nyahpepijat yang lebih sedikit.
  • Penggunaan Komputer: Peningkatan daripada 78.4% kepada 83.0% pada OSWorld-Verified; sokongan alat sisi klien asli.

3. Peningkatan Kualiti dan Kelajuan

Peningkatan Agen: Langkah penaakulan/panggilan alat lebih sedikit; penggunaan komputer terbina dalam; sokongan lebih kukuh untuk orkestrasi berbilang agen dan aliran kerja berulang.

Kelajuan & Kebolehpercayaan: Kependaman dioptimumkan untuk produksi volum tinggi; berintegrasi dengan alat seperti Google Slides untuk menjana pembentangan boleh sunting daripada dokumen/PDF.

Keselamatan: Perlindungan dipertingkat terhadap C

4. Harga Output Lebih Rendah

Google menurunkan harga output Standard rasmi daripada $9.00/M pada Gemini 3.5 Flash kepada $7.50/M pada Gemini 3.6 Flash. Harga input kekal pada $1.50/M.

Ini ialah penambahbaikan harga langsung walaupun sebelum mengambil kira keuntungan kecekapan token.

5. Perubahan Migrasi dan Parameter

Sebahagian tingkah laku mungkin berbeza daripada model Gemini terdahulu. Halaman Platform Agen Google Cloud menyenaraikan perubahan yang berpotensi memecahkan keserasian: nilai tersuai untuk parameter seperti temperature, top-K dan top-P tidak disokong dalam permukaan itu, nilai tersuai frequency dan presence penalty boleh menyebabkan ralat, dan permintaan yang berakhir dengan peranan model tidak disokong dalam sesetengah API.

Pengajaran migrasi adalah mudah: jangan hanya menukar rentetan model. Tinjau permukaan API tepat yang anda gunakan, buang parameter penjanaan yang tidak disokong, uji semula pengendalian keadaan berbilang giliran, dan semak tingkah laku pemanggilan alat.

Bolehkah Gemini 3.6 Flash Menggantikan Gemini 3.5 Flash?

Ya, untuk majoriti senario produksi. Google secara efektif meletakkan 3.6 Flash sebagai tenaga kerja lalai baharu, dengan 3.5 Flash berkemungkinan dinyahkan atau menjadi legasi dalam banyak antara muka.

Sebab untuk Beralih:

  • Penjimatan Kos: Perbelanjaan per tugas lebih rendah kerana harga + kecekapan.
  • Output Lebih Baik: Metrik kualiti bertambah baik merentasi pengaturcaraan, agen dan tugas pengetahuan.
  • Masa Depan Terjamin: Ciri baharu seperti penggunaan komputer dipertingkat dan integrasi.

Bila Patut Kekal dengan 3.5 atau Pertimbangkan Alternatif:

  • Tugas volum tinggi yang sangat sensitif kependaman (pertimbangkan model teman 3.5 Flash-Lite yang lebih murah/pantas).
  • Keperluan kecerdasan mentah maksimum (tunggu 3.5 Pro atau gunakan model lebih besar).
  • Keserasian legasi khusus.

Bagi kebanyakan pembangun yang membina agen, aplikasi atau automasi di Cometapi, migrasi ke 3.6 Flash melalui proksi adalah mudah dan disyorkan untuk pulangan segera.

Cara Mengakses Gemini 3.6 Flash

  1. Google AI Studio / Gemini API: Dapatkan kunci API percuma di aistudio.google.com. Gunakan model gemini-3.6-flash. Mulakan dengan SDK rasmi (Python, JS, dsb.).
  2. Vertex AI / Google Cloud: Gred perusahaan dengan kuota lebih tinggi, pendasaran, dan keselamatan.
  3. Aplikasi Gemini & Integrasi: Tersedia dalam Android Studio, GitHub Copilot (dengan togol), Google Slides, dsb.
  4. Melalui Cometapi (Disyorkan untuk Kemudahan): Cometapi menyediakan proksi bersatu yang serasi OpenAI untuk Gemini 3.6 Flash dan model lain. Faedah termasuk had kadar lebih tinggi, pengesahan dipermudah, pertukaran berbilang penyedia, dan pengurangan overhed pengurusan. Sesuai untuk menskalakan aplikasi tanpa menempuh had penyedia individu. Lawati Cometapi.com untuk panduan penyediaan dan harga yang melengkapi peringkat Google.

Contoh Panggilan Python (Rasmi atau melalui Proksi):

import google.generativeai as genai
genai.configure(api_key="YOUR_KEY")
model = genai.GenerativeModel('gemini-3.6-flash')
response = model.generate_content("Arahan anda di sini")

Uji dalam AI Studio terlebih dahulu, kemudian integrasikan. Caching dan API kelompok mengoptimumkan kos dengan lebih lanjut.

Kesimpulan & Syor

Gemini 3.6 Flash ialah peningkatan pragmatik bernilai tinggi yang memperhalus barisan Flash Google untuk tuntutan dunia nyata. Gabungan kecerdasan, kecekapan dan kebolehcapaian menjadikannya pilihan utama untuk pembangunan AI 2026.

CometAPI Syor: Integrasikan melalui Cometapi untuk pengalaman paling lancarโ€”API bersatu, kuota lebih baik dan ujian A/B mudah merentasi model. Sama ada anda membina agen, memproses dokumen atau menggerakkan aplikasi, mula bereksperimen dengan 3.6 Flash hari ini untuk mengurangkan kos dan meningkatkan prestasi.

Soalan Lazim

Apakah Gemini 3.6 Flash?

Gemini 3.6 Flash ialah model Flash stabil Google (Julai 2026) untuk pengaturcaraan, kerja pengetahuan, penaakulan multimodal dan aliran kerja berasaskan agen. Ia berasaskan Gemini 3.5 Flash tetapi menambah baik kecekapan token, tingkah laku pengaturcaraan, prestasi penggunaan komputer dan penanda aras kerja pengetahuan.

Berapakah kos Gemini 3.6 Flash?

Harga peringkat berbayar Standard API Gemini rasmi ialah $1.50 per sejuta token input dan $7.50 per sejuta token output. Batch dan Flex ialah $0.75/M input dan $3.75/M output. Priority ialah $2.70/M input dan $13.50/M output. Halaman model CometAPI menyenaraikan $1.20/M input dan $6.00/M output pada masa diperiksa.

Adakah Gemini 3.6 Flash lebih murah daripada Gemini 3.5 Flash?

Ya untuk token output. Kedua-dua model menyenaraikan $1.50/M token input pada peringkat berbayar Standard Google, tetapi output Gemini 3.6 Flash ialah $7.50/M berbanding $9.00/M untuk Gemini 3.5 Flash. Google juga melaporkan token output lebih sedikit pada banyak tugas, yang boleh mengurangkan kos keseluruhan lagi.

Bolehkah Gemini 3.6 Flash menggantikan Gemini 3.5 Flash?

Untuk banyak beban kerja, ya. Ia calon lalai yang lebih baik untuk agen pengaturcaraan, analisis multimodal dan aliran kerja alat yang kompleks. Walau bagaimanapun, pengguna produksi harus menanda aras sebelum menggantikan 3.5 Flash, terutamanya jika mereka bergantung pada gaya output stabil, pemformatan JSON yang tepat, atau parameter penjanaan legasi.

Apakah peningkatan penanda aras utama?

Google melaporkan Gemini 3.6 Flash mengatasi Gemini 3.5 Flash pada DeepSWE (49% vs 37%), MLE Bench (63.9% vs 49.7%), OSWorld-Verified (83.0% vs 78.4%), dan GDPval-AA v2 (1421 vs 1349). Google juga melaporkan 17% lebih sedikit token output pada Artificial Analysis Index.

Bagaimanakah saya mengakses Gemini 3.6 Flash melalui CometAPI?

Cipta kunci CometAPI, gunakan https://api.cometapi.com/v1 untuk panggilan serasi OpenAI, dan tetapkan model kepada gemini-3.6-flash jika ia tersedia dalam papan pemuka anda. Untuk ciri asli Gemini, gunakan laluan pembekal asli yang didokumenkan pada halaman model Gemini 3.6 Flash CometAPI.

Bersedia untuk mengurangkan kos pembangunan AI sebanyak 20%?

Mulakan secara percuma dalam beberapa minit. Kredit percubaan percuma disertakan. Tiada kad kredit diperlukan.

Baca Lagi