Claude Opus 5 is now live on CometAPI โ†’

Langkau Gemini 3.5 Pro? Google 3.6 Flash, 3.5 Flash-Lite & Flash Cyber Dijelaskan

CometAPI
AnnaJul 26, 2026
Langkau Gemini 3.5 Pro? Google 3.6 Flash, 3.5 Flash-Lite & Flash Cyber Dijelaskan

TLDR Keluaran Gemini terkini Google bukanlah Gemini 3.5 Pro yang dinanti-nantikan. Sebaliknya, Google melancarkan tiga model berfokus kecekapan: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite, dan Gemini 3.5 Flash Cyber. Mesej praktikalnya jelas: Google mengutamakan ekonomi ejen, kependaman, kecekapan token, dan automasi keselamatan khusus sementara model Pro utama masih diuji.

Bagi pembangun, langkah terbaik bukan menunggu secara pasif untuk Gemini 3.5 Pro. Gunakan Gemini 3.6 Flash sebagai calon naik taraf lalai untuk ejen kompleks dan aliran kerja pengaturcaraan, gunakan Gemini 3.5 Flash-Lite untuk pengekstrakan dan penghalaan volum tinggi, dan kekalkan strategi sandaran rentas model untuk tugasan penaakulan termaju. CometAPI menyediakan capaian bersatu kepada 500+ model melalui satu kunci API serasi OpenAI, jadi Gemini boleh diuji bersama GPT, Claude, DeepSeek, Kimi, Qwen, dan model lain tanpa membina semula integrasi anda.

Intipati Utama

  • Google mengumumkan Gemini 3.6 Flash, Gemini 3.5 Flash-Lite, dan Gemini 3.5 Flash Cyber pada 21 Julai 2026. Gemini 3.5 Pro tidak dikeluarkan dalam pelancaran ini. Google menyatakan ia sedang diuji dengan rakan kongsi dan akan tersedia secara meluas apabila bersedia.
  • Gemini 3.6 Flash tersedia umum dalam Gemini API, Google AI Studio, Gemini Enterprise Agent Platform, aplikasi Gemini, dan Google Antigravity. Gemini 3.5 Flash-Lite tersedia umum dalam Gemini API dan menyasar aliran kerja berkapasiti tinggi, berkos rendah.
  • Gemini 3.5 Flash Cyber adalah akses terhad, direka untuk pengesanan kelemahan, pengesahan, dan penampalan dalam CodeMender.
  • Google melaporkan Gemini 3.6 Flash menggunakan 17% lebih sedikit token keluaran berbanding 3.5 Flash pada Artificial Analysis dan sehingga 65% lebih sedikit token keluaran dalam ujian gaya DeepSWE.
  • Artificial Analysis melaporkan secara bebas Gemini 3.6 Flash dengan skor Intelligence Index 50, 251.3 token keluaran/s, dan pengurangan kos tugas purata daripada $0.59 kepada $0.50 berbanding Gemini 3.5 Flash.
  • DeepSWE menyenaraikan Gemini 3.6 Flash pada 49% pass@1 dengan kos purata $3.53 setiap tugas, berbanding Gemini 3.5 Flash pada 37% pass@1 dan kos purata $7.34 setiap tugas.
  • CometAPI kini menyenaraikan Gemini 3.6 Flash pada $1.20/M input dan $6.00/M output, dan Gemini 3.5 Flash-Lite pada $0.24/M input dan $2.016/M output. Semak papan pemuka langsung sebelum menerbitkan harga dalam UI produk.

Apa Yang Google Keluarkan?

Gemini 3.6 Flash

Gemini 3.6 Flash ialah model paling penting dalam keluaran ini untuk pembangun umum. Ia ialah model peringkat Flash yang stabil, dibina untuk ejen produksi, pengaturcaraan, aliran kerja multimodal, analisis dokumen, penaakulan konteks panjang, dan kerja berasaskan pengetahuan.

Google menerangkan Gemini 3.6 Flash sebagai model kerja lasak yang memberikan prestasi pengaturcaraan, kerja pengetahuan, dan multimodal lebih baik berbanding Gemini 3.5 Flash sambil meningkatkan kecekapan token. Halaman rasmi Gemini API menyatakan model ini direka untuk era berorientasikan ejen dan amat berkesan untuk pengaturcaraan pantas dan kitaran iterasi.

ID awam model ialah:

gemini-3.6-flash

Spesifikasi teras lihat halaman model Gemini 3.6 Flash.

Gemini 3.5 Flash-Lite

Gemini 3.5 Flash-Lite ialah model kecekapan dalam keluaran ini. Google meletakkannya sebagai model kelas 3.5 paling pantas dan paling menjimatkan, dioptimumkan untuk pelaksanaan berkapasiti tinggi, penghuraian dokumen, terjemahan, pengelasan, penghalaan, dan pengekstrakan data ringkas.

ID awam model ialah:

gemini-3.5-flash-lite

Spesifikasi teras lihat halaman model Gemini 3.5 Flash-Lite.

Perbezaan utama bukan pada tetingkap konteks. Flash-Lite mengekalkan profil input 1M dan output 64K yang sama seperti 3.6 Flash. Bezanya ialah tujuan penghalaan: Flash-Lite untuk kadar pemprosesan dan kawalan kos; 3.6 Flash untuk tugasan yang lebih sukar di mana kualiti dan kebolehpercayaan alat lebih penting.

Gemini 3.5 Flash Cyber

Gemini 3.5 Flash Cyber ialah model keselamatan siber khusus yang dibina di atas Gemini 3.5 Flash dan diperhalusi untuk penemuan kelemahan, pengesahan, dan penjanaan tampalan.

Ini bukan model API awam biasa. Google menyatakan ia akan tersedia kepada kerajaan dan rakan kongsi yang dipercayai melalui CodeMender sebagai sebahagian daripada program perintis akses terhad. Had ini penting untuk pembangun: jangan reka pelan hala tuju SaaS awam berdasarkan capaian terus ke Flash Cyber melainkan anda sebahagian daripada program perintis itu atau program keselamatan defensif yang ditapis.

Model ini masih penting kerana ia menunjukkan hala tuju Gemini oleh Google: model khusus yang cekap dikoordinasikan oleh infrastruktur ejen. Daripada menjadikan satu model termaju melakukan semua perkara, Google membina sistem khusus yang lebih kecil yang boleh menjalankan imbasan berulang, menggabungkan laporan, dan menampal kod pada kos lebih rendah.

Patutkah Anda Melangkau Gemini 3.5 Pro?

Jawapan Praktikal

Untuk kebanyakan pasukan produksi, ya: mula menilai Gemini 3.6 Flash dan Gemini 3.5 Flash-Lite sekarang daripada menunggu Gemini 3.5 Pro atau Gemini 4 Pro.

Itu tidak bermakna Gemini 3.5 Pro tidak penting. Ia bermakna model terkini yang tersedia sudah merangkumi sebahagian besar beban kerja AI volum tinggi: ejen pengaturcaraan, ejen pengambilan semula, aliran kerja dokumen, penghuraian multimodal, pengekstrakan data, penghalaan prompt, automasi UI, semakan konteks panjang, dan pelaksanaan sub-tugasan ejen.

Pengumuman Google sendiri menyatakan Gemini 3.5 Pro masih diuji dengan rakan kongsi dan akan dikeluarkan secara meluas apabila bersedia. Tiada halaman model API awam gemini-3.5-pro, jadual harga muktamad, atau kad model diperlukan untuk mula memperbaiki ekonomi produksi hari ini.

Bila Menunggu Gemini 3.5 Pro Masih Masuk Akal

Anda masih harus memantau Gemini 3.5 Pro atau Gemini 4 Pro jika beban kerja anda memerlukan penaakulan termaju lebih daripada kadar pemprosesan. Contohnya termasuk sintesis penyelidikan lanjutan, kejuruteraan berbilang fail yang sangat kompleks, matematik sukar, penaakulan saintifik, analisis perusahaan berisiko tinggi, dan tugas di mana model Flash masih gagal selepas reka bentuk prompt dan alat yang teliti.

Strategi model yang paling kukuh bukanlah "tunggu Pro" atau "gantikan semuanya dengan Flash." Ia ialah penghalaan bertingkat:

  1. Gunakan Gemini 3.5 Flash-Lite untuk sub-tugasan berkos rendah, volum tinggi.
  2. Gunakan Gemini 3.6 Flash untuk pengaturcaraan, analisis multimodal, semakan dokumen, sintesis konteks panjang, dan aliran kerja berorientasikan ejen.
  3. Halakan permintaan paling sukar atau berisiko tinggi kepada model penaakulan termaju melalui CometAPI.
  4. Tambah Gemini 3.5 Pro ke himpunan penanda aras apabila Google dan CometAPI menyediakannya.

Penanda Aras Gemini 3.6 Flash: Apa yang Bertambah Baik?

Jadual Penanda Aras Google DeepMind

Halaman Gemini 3.6 Flash Google DeepMind menyenaraikan perbandingan berikut terhadap Gemini 3.5 Flash:

Penanda ArasApa yang DiukurGemini 3.6 FlashGemini 3.5 FlashPerubahan
SWE-Bench ProPelbagai tugas pengaturcaraan ejen58.7%55.1%+3.6 mata
DeepSWE v1.1Kejuruteraan perisian jangka panjang49%37%+12 mata
Terminal-Bench 2.1Pengaturcaraan terminal berasaskan ejen78.0%76.2%+1.8 mata
MLE-BenchKejuruteraan pembelajaran mesin63.9%49.7%+14.2 mata
GDPval-AA v2Elo kerja pengetahuan14211349+72 Elo
OSWorld-VerifiedPenggunaan komputer berasaskan ejen83.0%78.4%+4.6 mata
Penakulan CharXiv, tanpa alatSintesis carta dan maklumat85.2%84.2%+1.0 mata
Penakulan CharXiv, dengan alatSintesis carta dan maklumat89.4%84.9%+4.5 mata
GDM-MRCR v2, purata 128KPengambilan konteks panjang91.8%77.3%+14.5 mata
GDM-MRCR v2, 1M titik demi titikPengambilan konteks panjang54.0%26.6%+27.4 mata

Peningkatan terbesar adalah tepat pada bidang yang penting untuk ejen: pengaturcaraan jangka panjang, kejuruteraan pembelajaran mesin, pengambilan konteks panjang, dan penggunaan komputer. Peningkatan lebih kecil dalam Terminal-Bench dan CharXiv menunjukkan bahawa ini bukan keluaran seragam "semuanya berganda." Ia ialah penambahbaikan yang disasarkan pada kebolehpercayaan, kecekapan token, dan pelaksanaan berbilang langkah yang sukar.

Data Bebas Dari Artificial Analysis

Artificial Analysis menyediakan imbangan berguna kepada jadual penanda aras vendor. Huraian Julai 2026 menyatakan Gemini 3.6 Flash mengekalkan skor Intelligence Index yang sama seperti Gemini 3.5 Flash: 50. Itu penting kerana ia mencadangkan Gemini 3.6 Flash bukan semestinya lonjakan kecerdasan mentah.

Peningkatan besar adalah kecekapan:

MetrikGemini 3.6 FlashGemini 3.5 Flash
Indeks Kecerdasan Artificial Analysis5050
Masa purata setiap tugasan1.3 minit2.7 minit
Kos purata setiap tugasan$0.50$0.59
Kelajuan keluaran251.3 token/sTidak dalam jadual ini
Masa ke token pertama14.00sTidak dalam jadual ini

Inilah sebabnya tajuk terbaik bukan "Gemini 3.6 Flash lebih pintar daripada segala-galanya." Tajuk yang lebih tepat ialah: Gemini 3.6 Flash menjadikan beban kerja ejen lebih murah dan lebih pantas tanpa mengorbankan tahap kecerdasan Gemini 3.5 Flash.

DeepSWE: Data Pengaturcaraan Jangka Panjang

DeepSWE oleh Datacurve amat relevan kerana ia memfokus pada tugasan kejuruteraan perisian original dan jangka panjang. Papan pendahuluannya menerangkan 113 tugasan merentasi 91 repositori dan 5 bahasa.

Pada papan pendahulu 21 Julai 2026:

ModelPass@1Kos PurataToken KeluaranLangkah Ejen
Gemini 3.6 Flash tinggi49% ยฑ5$3.5397K108
Gemini 3.5 Flash sederhana37% ยฑ2$7.34276K86

Nombor paling menarik bukan sekadar kenaikan 12 mata pass@1. Ia adalah penurunan token keluaran: 97K berbanding 276K. Itu kira-kira 65% lebih sedikit token keluaran, sepadan dengan dakwaan pelancaran Google. Bagi ejen pengaturcaraan, lebih sedikit token keluaran boleh bermakna kurang hanyutan, kurang gelung pembaikan bertele-tele, kurang pencemaran konteks, dan kos lebih rendah bagi isu yang diselesaikan.

Langkau Gemini 3.5 Pro? Google 3.6 Flash, 3.5 Flash-Lite & Flash Cyber Dijelaskan

Sumber: Gemini

Penanda Aras Gemini 3.5 Flash-Lite: Mengapa Ia Penting

Flash-Lite Ialah Model Kadar Pemprosesan

Gemini 3.5 Flash-Lite direka untuk pelaksanaan volum tinggi. Ia adalah model untuk diuji apabila sistem anda perlu memproses ribuan atau jutaan tugasan kecil atau sederhana:

  • pengekstrakan resit,
  • penghuraian katalog produk,
  • pelabelan cebisan dokumen,
  • terjemahan,
  • pengelasan,
  • sintesis hasil carian,
  • penulisan semula pertanyaan,
  • penghalaan panggilan alat,
  • tugasan pengaturcaraan ringan,
  • pelaksanaan sub-tugasan ejen,
  • pengekstrakan data multimodal.

Google menyatakan Flash-Lite mencapai 350 token keluaran sesaat menurut Artificial Analysis dan berharga $0.30/M token input dan $2.50/M token output pada peringkat standard Gemini API.

Flash-Lite Berbanding Gemini 3.1 Flash-Lite

Kad model Google DeepMind menunjukkan peningkatan besar berbanding Gemini 3.1 Flash-Lite:

Penanda ArasGemini 3.5 Flash-LiteGemini 3.1 Flash-LitePerubahan
SWE-Bench Pro54.2%38.3%+15.9 mata
Terminal-Bench 2.154.0%31.0%+23.0 mata
MLE-Bench39.2%22.0%+17.2 mata
GDPval-AA v21140642+498 Elo
OSWorld-Verified74.0%54.3%+19.7 mata
CharXiv, tanpa alat74.5%73.2%+1.3 mata
CharXiv, dengan alat76.5%75.6%+0.9 mata
GDM-MRCR v2, purata 128K72.2%60.1%+12.1 mata
GDM-MRCR v2, 1M titik demi titik21.3%12.3%+9.0 mata

Artificial Analysis juga melaporkan lonjakan Intelligence Index daripada 25 untuk Gemini 3.1 Flash-Lite kepada 36 untuk Gemini 3.5 Flash-Lite, manakala masa setiap tugas turun daripada 1.0 minit kepada 0.6 minit. Komprominya ialah kos setiap tugas meningkat daripada $0.04 kepada $0.09 dalam set penanda aras tersebut kerana model baharu ini berharga lebih tinggi daripada 3.1 Flash-Lite.

Langkau Gemini 3.5 Pro? Google 3.6 Flash, 3.5 Flash-Lite & Flash Cyber Dijelaskan

Sumber: Gemini

Kompromi itu boleh diterima jika kualiti yang dipertingkat mengurangkan percubaan semula hiliran, semakan manusia, atau peningkatan kepada model yang lebih mahal. Ia kurang menarik jika beban kerja anda sudah diselesaikan dengan sempurna oleh Gemini 3.1 Flash-Lite. Uji sebelum memindahkan semua trafik.

Kepentingan Keluaran Gemini

Ia Mengesahkan Peralihan Daripada "Model Terbesar" kepada "Model Kerja Lasak Terbaik"

Pasaran AI sering menumpukan pada model utama termaju. Gemini 3.6 Flash menunjuk arah berbeza: sistem AI produksi memerlukan model yang boleh dipercayai, pantas, dan menjimatkan kos yang boleh menyiapkan banyak tugas sebenar tanpa pembaziran.

Itulah sebabnya keluaran ini menekankan kecekapan token, lebih sedikit panggilan alat, kependaman lebih rendah, dan gelung semakan yang lebih sedikit. Bagi pembangun, ini bukan metrik sekunder. Metrik ini menentukan sama ada ejen AI boleh berjalan pada skala tanpa mengejutkan pasukan kewangan.

Ia Memberi Google Model Produksi Lebih Kuat Sementara Menunggu Gemini 3.5 Pro

Gemini 3.5 Pro masih dalam ujian rakan kongsi. Daripada menunggu Pro, Google mengeluarkan model Flash yang lebih kuat dan model Flash-Lite yang lebih murah. Itu memberi pembangun dua pilihan segera:

  • Gemini 3.6 Flash untuk kecerdasan kerja lasak yang lebih kuat.
  • Gemini 3.5 Flash-Lite untuk pelaksanaan volum tinggi yang lebih murah dan pantas.

Ini ialah strategi produk yang praktikal. Banyak perniagaan tidak memerlukan model paling mahal untuk setiap permintaan. Mereka memerlukan portfolio model dan logik penghalaan.

Ia Menjadikan Penghalaan Model Lebih Penting

Gemini 3.6 Flash tidak seharusnya digunakan di mana-mana. Flash-Lite juga tidak. Sistem AI 2026 terbaik akan menghala secara dinamik:

  • Mulakan dengan kos rendah apabila tugasan ringkas.
  • Gunakan Gemini 3.6 Flash apabila penaakulan, pemahaman multimodal, atau penggunaan alat penting.
  • Tingkatkan hanya apabila permintaan gagal ambang keyakinan.
  • Cache konteks panjang berulang.
  • Pantau kos per tugas berjaya, bukan hanya kos per token.

Ini ialah saranan CometAPI yang paling kukuh dalam artikel: jangan pilih satu model sebagai keseluruhan strategi AI anda. Bina penghala dan pastikan setiap model layak menerima trafiknya.

Soalan Lazim

Adakah Gemini 3.5 Pro tersedia sekarang?

Tidak sebagai model Gemini API yang tersedia umum pada masa penulisan pada Julai 2026. Google menyatakan Gemini 3.5 Pro sedang diuji dengan rakan kongsi dan akan dikeluarkan secara meluas apabila bersedia.

Adakah Gemini 3.6 Flash lebih baik daripada Gemini 3.5 Flash?

Untuk banyak aliran kerja ejen produksi dan pengaturcaraan, ya. Google melaporkan keputusan penanda aras yang lebih baik dan penggunaan token keluaran yang lebih rendah. Artificial Analysis melaporkan kualiti Indeks Kecerdasan yang serupa tetapi masa per tugas lebih rendah dan kos per tugas lebih rendah.

Apakah yang paling sesuai untuk Gemini 3.5 Flash-Lite?

Gemini 3.5 Flash-Lite paling sesuai untuk beban kerja volum tinggi, sensitif kependaman, dan sensitif kos seperti pengekstrakan, pengelasan, terjemahan, carian, penghalaan, dan pelaksanaan sub-ejen.

Bolehkah saya menggunakan Gemini 3.5 Flash Cyber melalui Gemini API awam?

Google menerangkan Gemini 3.5 Flash Cyber sebagai model akses terhad yang tersedia kepada kerajaan dan rakan kongsi yang dipercayai melalui CodeMender. Ia tidak diposisikan sebagai model API awam standard.

Berapakah kos Gemini 3.6 Flash?

Harga standard Gemini API Google menyenaraikan Gemini 3.6 Flash pada $1.50 per 1M token input dan $7.50 per 1M token output. CometAPI kini menyenaraikannya pada $1.20/M input dan $6.00/M output. Sentiasa sahkan harga langsung sebelum pelaksanaan produksi.

Berapakah kos Gemini 3.5 Flash-Lite?

Harga standard Gemini API Google menyenaraikan Gemini 3.5 Flash-Lite pada $0.30 per 1M token input dan $2.50 per 1M token output. CometAPI kini menyenaraikannya pada $0.24/M input dan $2.016/M output. Sentiasa sahkan harga langsung sebelum pelaksanaan produksi.

Patutkah pembangun menunggu Gemini 3.5 Pro?

Kebanyakan pasukan tidak perlu menunggu. Mulakan pengujian Gemini 3.6 Flash untuk aliran kerja kompleks dan Gemini 3.5 Flash-Lite untuk sub-tugasan volum tinggi sekarang. Tambah Gemini 3.5 Pro ke himpunan penanda aras anda apabila spesifikasi, harga, dan ketersediaan awam disahkan.

Keputusan Akhir

Keluaran Gemini Julai 2026 Google paling tepat difahami sebagai keluaran kecekapan, bukan keluaran Pro utama. Gemini 3.6 Flash tidak menafikan keperluan untuk Gemini 3.5 Pro pada masa hadapan, tetapi ia memberikan sesuatu yang terus berguna kepada pembangun: model yang tersedia umum dengan prestasi pengaturcaraan, multimodal, konteks panjang, dan berorientasikan ejen yang kukuh pada kos token keluaran yang lebih rendah daripada Gemini 3.5 Flash.

Gemini 3.5 Flash-Lite melengkapkan separuh lagi susun atur produksi. Ia adalah model murah dan pantas untuk sub-tugasan yang tidak memerlukan kedalaman penaakulan maksimum. Gemini 3.5 Flash Cyber menunjukkan masa depan ejen keselamatan defensif khusus, tetapi akses terhadnya menjadikannya lebih relevan sebagai isyarat strategik daripada alat pembangun umum hari ini.

Bersedia untuk mengurangkan kos pembangunan AI sebanyak 20%?

Mulakan secara percuma dalam beberapa minit. Kredit percubaan percuma disertakan. Tiada kad kredit diperlukan.

Baca Lagi