GPT-5.6 Luna price down 80%, Terra down 20% →

Gelombang Model Juli 2026: GPT-5.6, Gemini 3.6 Flash, Grok 4.5, Kimi K3 dll

CometAPI
AnnaAug 1, 2026
Gelombang Model Juli 2026: GPT-5.6, Gemini 3.6 Flash, Grok 4.5, Kimi K3 dll

TL;DR: Enam rilis model besar mendarat dalam sekitar tiga minggu pada Juli 2026: keluarga tiga tingkat GPT-5.6 dari OpenAI (Sol/Terra/Luna), Gemini 3.6 Flash dari Google, Grok 4.5 dari xAI, Kimi K3 dari Moonshot AI, Claude Opus 5 dari Anthropic, dan GLM-5.2 dari Zhipu. Tidak ada satu pilihan terbaik yang universal. Keputusan praktis bergantung pada kedalaman penalaran, performa pengodean, biaya per token, kebutuhan konteks, dan apakah penyebaran bobot terbuka penting. Perbandingan ini menggunakan informasi resmi penyedia saat ini dan listing CometAPI, dengan klaim tolok ukur diberi label menurut sumber alih-alih diperlakukan sebagai satu peringkat universal.

Intisari Utama:

  • GPT-5.6 bukan satu model — melainkan tiga (Sol, Terra, Luna) pada tiga titik harga berbeda, dan memilih tingkat yang salah adalah kesalahan biaya yang lebih besar daripada memilih keluarga model yang salah sama sekali.
  • Gemini 3.6 Flash dan GLM-5.2 sama-sama memublikasikan jendela konteks 1.000.000 token; Kimi K3 juga menyamai angka itu — ukuran konteks sudah berhenti menjadi pembeda di antara model-model unggulan generasi ini.
  • GLM-5.2 dan Kimi K3 sama-sama mendukung penyebaran bobot terbuka, tetapi tidak menggunakan lisensi yang sama. GLM-5.2 dirilis di bawah Lisensi MIT; Kimi K3 menggunakan Lisensi Kimi K3 terpisah, yang ketentuan komersialnya perlu ditinjau sebelum self-hosting atau menawarkan akses model-sebagai-layanan.
  • Claude Opus 5 resmi dirilis. Anthropic mengumumkannya pada 24 Juli 2026 dengan jendela konteks 1 juta token, hingga 128K keluaran sinkron, dan harga resmi $5 per satu juta token masukan dan $25 per satu juta token keluaran; CometAPI saat ini mencantumkannya pada $4/$20.

Apa yang Sebenarnya Dirilis Bulan Ini

Juli 2026 adalah bulan yang sangat padat untuk rilis model frontier dan near-frontier. Dalam kira-kira tiga minggu, OpenAI merilis keluarga GPT-5.6 (9 Jul), xAI merilis Grok 4.5 (8 Jul), Moonshot AI merilis Kimi K3 (16 Jul), Google merilis Gemini 3.6 Flash (21 Jul), dan Anthropic secara resmi meluncurkan Claude Opus 5 (24 Jul). GLM-5.2 dari Zhipu hadir sedikit lebih awal pada Juni, tetapi jendela konteks 1 juta token dan rilis terbuka berlisensi MIT membuatnya relevan untuk keputusan pembelian dan penyebaran yang sama.

Pertanyaan praktis bagi siapa pun yang membangun di atas model-model ini bukanlah mana yang terbaik secara abstrak, melainkan opsi terkonfirmasi mana yang cocok untuk pekerjaan spesifik. Keenamnya berbeda secara bermakna dalam biaya, konteks, perilaku pengodean, lisensi, dan fleksibilitas penyebaran.

Harga dan Spesifikasi, Berdampingan

Semua harga di bawah adalah per satu juta token. Jika sebuah model memiliki beberapa tingkat, masing-masing dicantumkan secara terpisah.

ModelMasukanKeluaranJendela KonteksLisensiDirilis
GPT-5.6 Sol$5.00$30.00Tidak dipublikasikanProprietary9 Jul 2026
GPT-5.6 Terra$2.50$15.00Tidak dipublikasikanProprietary9 Jul 2026
GPT-5.6 Luna$1.00$6.00Tidak dipublikasikanProprietary9 Jul 2026
Grok 4.5$2.00$4.00Tidak dipublikasikanProprietary8 Jul 2026
Kimi K3$3.00$15.001.048.576 tokenBobot terbuka (Lisensi Kimi K3)16 Jul 2026
Gemini 3.6 Flash$1.50$7.501.048.576 token (65.536 keluaran)Proprietary21 Jul 2026
GLM-5.2$1.40$4.411.000.000 tokenTerbuka (Lisensi MIT)13 Jun 2026
Claude Opus 5$5.00$25.001.000.000 token (128K keluaran)Proprietary24 Jul 2026

*Tarif resmi penyedia ditampilkan di atas; API terpadu yang menerapkan diskon standar akan menurunkan masing-masing secara proporsional — poin dari tabel ini adalah kesenjangan relatif antarmodel, bukan harga checkout penyedia tertentu.

Beberapa hal menonjol dari tabel harga dan spesifikasi. Sol, tingkat teratas GPT-5.6, ditetapkan untuk penalaran terdepan dan kerja agenik alih-alih penggunaan sehari-hari, sementara harga keluaran Grok 4.5 relatif rendah untuk posisinya. GLM-5.2 memiliki harga keluaran terendah yang tercantum dalam grup ini dan menggunakan Lisensi MIT yang permisif. Kimi K3 juga menyediakan bobot yang dapat diunduh dan konteks 1 juta token, tetapi di bawah Lisensi Kimi K3 terpisah alih-alih MIT. Gemini 3.6 Flash, Kimi K3, GLM-5.2, dan Claude Opus 5 semuanya memublikasikan jendela konteks sekitar 1 juta token, sehingga kapasitas konteks saja tidak lagi cukup untuk memilih di antara mereka. Tarif yang tercantum di CometAPI umumnya lebih rendah daripada harga daftar penyedia, tetapi evaluasi pada tingkat beban kerja tetap lebih berguna daripada membandingkan harga token secara terpisah.

Untuk Apa Masing-Masing Sebenarnya Dioptimalkan

GPT-5.6 Sol diposisikan untuk penalaran frontier, pengodean berbasis agen, dan pekerjaan teknis berjangka panjang — mendukung mode "Max Reasoning Effort" dan "Ultra Mode" yang menjalankan sub-agen secara paralel. Ini adalah tingkat yang diraih untuk masalah sulit multi-langkah, bukan tugas rutin, mengingat kesenjangan harga terhadap Terra dan Luna.

GPT-5.6 Terra adalah tingkat menengah yang seimbang — produktivitas sehari-hari, dokumentasi, dukungan pengodean, dan otomasi bisnis. Untuk sebagian besar backend aplikasi yang tidak secara spesifik membutuhkan kedalaman penalaran Sol, Terra adalah default yang lebih dapat dipertanggungjawabkan.

GPT-5.6 Luna menargetkan penggunaan ringan ber-volume tinggi: klasifikasi, alur dukungan pelanggan, onboarding, pembuatan konten berulang. Dengan harga $1.00/$6.00 per satu juta token (sebelum diskon gateway apa pun), model ini ditetapkan tepat untuk beban kerja ber-volume panggilan tinggi dan kompleksitas rendah — dan juga mendukung harga masukan cache dengan diskon 90% dari tarif masukan standar, yang lebih penting di sini daripada untuk tingkat yang lebih tinggi mengingat betapa repetitifnya beban kerja ber-volume tinggi.

Grok 4.5 tidak memublikasikan spesialisasi yang dinyatakan seperti halnya tingkat GPT-5.6, tetapi penetapan harganya menempatkannya di antara opsi hemat dan kelas menengah — layak untuk perbandingan tolok ukur langsung terhadap Terra atau Kimi K3 untuk beban kerja spesifik alih-alih mengasumsikan posisi dari harga semata.

Kimi K3 adalah model Mixture-of-Experts dengan 2,8 triliun parameter yang dibangun untuk pengodean jangka panjang, pekerjaan pengetahuan multimodal, dan analisis dokumen atau repositori yang ekstensif dalam konteks 1 juta token. Moonshot AI telah merilis bobot penuh, sehingga self-hosting dimungkinkan, tetapi rilisnya menggunakan Lisensi Kimi K3, yang mencakup ketentuan komersial yang berbeda dari rilis MIT standar.

Gemini 3.6 Flash adalah rilis berfokus efisiensi dari Google: secara eksplisit dibingkai sebagai kelanjutan inkremental yang dioptimalkan untuk biaya dan latensi dari 3.5 Flash alih-alih model frontier baru, dengan peningkatan nyata pada tolok ukur pengodean dan agenik serta harga per token keluaran yang lebih rendah daripada pendahulunya. Ini adalah pilihan untuk beban kerja berbasis agen di mana efisiensi token dan biaya per tugas yang diselesaikan sama pentingnya dengan kapabilitas mentah.

GLM-5.2 adalah opsi terbuka yang lebih permisif dalam perbandingan ini. Z.ai merilisnya di bawah Lisensi MIT dengan konteks 1 juta token dan penekanan eksplisit pada pengodean jangka panjang, penggunaan alat, dan upaya berpikir yang dapat disesuaikan. Tim dapat mengaksesnya melalui API atau menjalankan bobot yang dipublikasikan secara lokal, bergantung pada infrastruktur dan kebutuhan evaluasi mereka sendiri.

Perbandingan Kapabilitas Pengodean

Keenam rilis ini menargetkan pola rekayasa yang berbeda, sehingga kemampuan pengodean paling baik dipahami sebagai kecocokan beban kerja alih-alih satu peringkat tunggal.

  • Claude Opus 5 adalah kecocokan terkuat di sini untuk debugging sulit, analisis akar penyebab, refaktor besar, dan agen perangkat lunak yang berjalan lama; Anthropic menyoroti perilaku verifikasi dan iterasi yang lebih kuat.
  • GPT-5.6 Sol, Terra, dan Luna menyediakan jalur bertingkat dari pengodean dan penalaran yang kompleks ke pekerjaan pengembangan yang seimbang dan bantuan kode ber-volume tinggi.
  • Gemini 3.6 Flash dituning untuk loop pengodean agenik yang cepat di mana latensi dan biaya per iterasi penting.
  • Kimi K3 dirancang untuk pengodean jangka panjang pada repositori yang sangat besar, dengan konteks 1 juta token dan bobot yang dapat diunduh.
  • GLM-5.2 menggabungkan pengodean jangka panjang, penggunaan alat, upaya berpikir yang dapat disesuaikan, dan penyebaran lokal berlisensi MIT.
  • Grok 4.5 paling baik diperlakukan sebagai kandidat untuk evaluasi langsung terhadap yang lain karena posisi resmi tidak menyediakan rincian spesialisasi pengodean yang sama seperti keluarga GPT bertingkat.

Pertukaran (Trade-off) dalam Membandingkan (dan Sering Berpindah) Model

Semua ini bukan argumen untuk mengejar setiap rilis baru. Mengalihkan beban kerja produksi ke model baru setiap kali ada rilis memiliki biaya nyata: mengujikan kembali prompt, memvalidasi kembali kualitas keluaran, dan memeriksa ulang perhitungan biaya per tugas terhadap trafik Anda yang sebenarnya, bukan yang sintetis dalam tolok ukur. API terpadu tidak menghapus pekerjaan evaluasi tersebut, tetapi menghapus overhead akun terpisah dan penagihan terpisah untuk benar-benar menjalankan perbandingan — kemampuan memanggil GPT-5.6 Terra, Gemini 3.6 Flash, Kimi K3, dan GLM-5.2 melalui bentuk permintaan yang sama dan satu tagihan membuatnya realistis untuk benar-benar menguji lebih dari satu kandidat sebelum berkomitmen, alih-alih default ke penyedia yang sudah Anda miliki kuncinya.

Itu adalah keuntungan nyata, bukan solusi lengkap — tidak menggantikan membaca dokumentasi masing-masing model, dan tidak membuat pilihan model bebas dari biaya perpindahan yang dijelaskan di atas. Yang dilakukan adalah menurunkan biaya untuk mengetahui model mana yang sebenarnya tepat untuk beban kerja tertentu, yang merupakan klaim berbeda (dan lebih jujur) daripada "model ini adalah yang terbaik."

FAQ

Apa model AI terbaik yang dirilis pada Juli 2026? Tidak ada satu jawaban terbaik. GPT-5.6 Sol dan Claude Opus 5 ditujukan untuk pekerjaan penalaran dan pengodean yang menuntut; Gemini 3.6 Flash menekankan loop agenik yang efisien; Kimi K3 menggabungkan konteks panjang dengan bobot terbuka; dan GLM-5.2 menggabungkan kapabilitas jangka panjang dengan lisensi MIT. Pilihan yang tepat bergantung pada beban kerja dan kendala penyebaran.

GPT-5.6 itu satu model atau beberapa? Tiga: Sol (unggulan, penalaran frontier), Terra (seimbang, penggunaan sehari-hari), dan Luna (cepat dan murah, tugas ber-volume tinggi) — masing-masing diberi harga terpisah, dari $0.80/$4.80 per satu juta token untuk Luna hingga $4.00/$24.00 untuk Sol.

Apakah Claude Opus 5 resmi dirilis? Ya. Anthropic mengumumkan Claude Opus 5 pada 24 Juli 2026. Rilis resmi menggambarkan jendela konteks 1 juta token dan memosisikan model untuk pengodean agenik kompleks dan pekerjaan pengetahuan; harga API resmi adalah $5 per satu juta token masukan dan $25 per satu juta token keluaran.

Mana dari model-model ini yang paling murah dijalankan dalam skala besar? Pada harga keluaran penyedia yang tercantum di tabel, GLM-5.2 adalah opsi berbiaya terendah dan tersedia di bawah Lisensi MIT. Kimi K3 juga memiliki bobot terbuka, tetapi Lisensi Kimi K3 yang terpisah dan jejak model yang jauh lebih besar mengubah ekonomi self-hosting. GPT-5.6 Luna adalah opsi proprietary berbiaya terendah berbasis API yang dibahas di sini.

Apakah saya perlu memilih satu model dan berkomitmen, atau bisa menguji beberapa? Menguji lebih dari satu terhadap prompt dan trafik Anda yang sebenarnya umumnya layak dilakukan sebelum mengalihkan trafik produksi — API terpadu (CometAPI, dan lainnya) secara spesifik membuat hal itu lebih murah dilakukan, karena menghapus overhead akun terpisah dalam menjalankan perbandingan, meski tidak menggantikan membaca dokumentasi masing-masing model.

Kesimpulan

Gelombang rilis Juli 2026 tidak menghasilkan satu pemenang yang jelas. Ia menghasilkan enam opsi terkonfirmasi yang saling bertukar dalam hal kedalaman penalaran, performa pengodean, biaya token, konteks, dan lisensi. GPT-5.6 Sol dan Claude Opus 5 menargetkan pekerjaan penalaran dan rekayasa perangkat lunak yang paling sulit; Gemini 3.6 Flash dan GPT-5.6 Luna menekankan efisiensi; Kimi K3 menghadirkan bobot terbuka dan konteks multimodal 1 juta token di bawah lisensinya sendiri; dan GLM-5.2 menawarkan alternatif 1 juta token berlisensi MIT. Semua dapat diakses melalui CometAPI dengan satu kunci, yang membuat pengujian terkontrol lebih mudah, tetapi pemilihan model tetap harus didasarkan pada prompt, alat, target latensi, dan kriteria sukses dari beban kerja yang sebenarnya.

Siap memangkas biaya pengembangan AI hingga 20%?

Mulai gratis dalam beberapa menit. Kredit uji coba gratis disertakan. Tidak perlu kartu kredit.

Baca Selengkapnya