Ringkasan
Grok 4.7 kini memiliki sinyal pra-rilis paling jelas: hitung mundur sepuluh hari pada 2 September mengarah ke perkiraan rilis sekitar 12 September 2026. Pernyataan sebelumnya menggambarkan model dengan sekitar 2.1T parameter dan pelatihan tambahan menggunakan data perusahaan SpaceX dalam jumlah besar. Namun, xAI belum menerbitkan kartu model Grok 4.7, paket benchmark, pengenal API final, jendela konteks, atau harga resmi. Hingga detail tersebut muncul, Grok 4.6 yang dirilis tetap menjadi baseline produksi yang terukur.
Poin Penting
- Tanggal 12 September diperkirakan dari hitung mundur sepuluh hari Musk, bukan pengumuman kalender terpisah dari xAI.
- Klaim skala 2.1T dan data SpaceX adalah pernyataan pra-rilis; parameter aktif, perutean, arsitektur, dan metodologi pelatihan belum dipublikasikan.
- Grok 4.6 sudah menunjukkan hasil kuat untuk pekerjaan pengetahuan dan kemampuan agen, termasuk 61,3% pada FrontierCode v1.1 (Extended), tetapi tertinggal dari model pembanding terkuat pada beberapa evaluasi pengodean yang sulit.
- Grok 4.7 sebaiknya dinilai dari tingkat penerimaan tugas, keandalan jangka panjang, efisiensi token, latensi, dan biaya per hasil yang berhasil—bukan dari jumlah parameter saja.
- CometAPI akan mengintegrasikan Grok 4.7 segera setelah xAI resmi merilis model dan akses endpoint produksi tersedia; pengembang tetap harus memvalidasi ID model live, harga, dan perilaku respons sebelum migrasi.
Apa Itu Grok 4.7?
Grok 4.7 adalah penerus yang diumumkan untuk Grok 4.6 dan diperkirakan akan melanjutkan fokus xAI pada pengodean, rekayasa, agen jangka panjang, dan pekerjaan pengetahuan profesional. Bukti publik saat ini terdiri dari pernyataan pendiri dan hitung mundur rilis, bukan paket peluncuran teknis yang lengkap.
Pembedaan terpenting adalah antara tiga objek: model Grok 4.7 yang diumumkan, sinyal pra-rilis yang menggambarkan kemungkinan skala dan pelatihannya, dan baseline produksi Grok 4.6 yang live. Pengembang sebaiknya memperlakukan Grok 4.7 sebagai kandidat evaluasi yang akan datang hingga xAI menerbitkan dokumentasi final dan permintaan produksi berhasil pada endpoint yang dirilis.
Tanggal Rilis dan Linimasa Grok 4.7
Kapan Grok 4.7 diperkirakan akan dirilis?
Pernyataan Musk pada 2 September bahwa model akan hadir dalam sepuluh hari mengarah ke sekitar 12 September 2026
Sumber: Elon Musk di X, 2 September 2026
Linimasa Rilis Grok 4.7
| Tanggal | Sinyal publik | Interpretasi |
|---|---|---|
| Akhir Juli 2026 | Musk menggambarkan model sekitar 2.1T, efisiensi token yang ditingkatkan, dan penyajian yang agak lebih lambat. | Ekspektasi skala model dan efisiensi yang dinyatakan pendiri. |
| 12 Agustus 2026 | Pelatihan awal digambarkan telah selesai; pelatihan tambahan dilaporkan mencakup data perusahaan SpaceX dalam jumlah besar. | Pembaruan progres pelatihan, bukan konfirmasi rilis. |
| 2 September 2026 | “Grok 4.7 keluar dalam 10 hari.” | Hitung mundur rilis publik paling jelas sejauh ini. |
| 12 September 2026 | Tanggal kalender yang diturunkan dari hitung mundur. | Target yang diharapkan; ketersediaan final tetap memerlukan pemberitahuan rilis xAI dan endpoint yang berfungsi. |
Spesifikasi Grok 4.7: Informasi yang Dikonfirmasi vs Belum Dikonfirmasi
Cara paling berguna membaca informasi Grok 4.7 saat ini adalah memisahkan pernyataan langsung pendiri dari spesifikasi yang belum dipublikasikan oleh xAI. Post baru hanya mengonfirmasi nama model dan hitung mundur rilis; tidak menambahkan parameter teknis atau hasil benchmark.
| Spesifikasi | Status Grok 4.7 saat ini | Tingkat bukti |
|---|---|---|
| Waktu rilis | Sekitar 12 September, diturunkan dari hitung mundur sepuluh hari 2 September | Target yang diumumkan pendiri |
| Skala model | Sekitar 2.1T parameter | Pernyataan pendiri |
| Pelatihan awal | Digambarkan selesai per 12 Agustus | Pernyataan pendiri |
| Pelatihan tambahan | Mencakup data perusahaan SpaceX dalam jumlah besar | Pernyataan pendiri |
| Kualitas relatif | Diklaim jauh lebih baik daripada Grok 4.6 | Klaim belum terverifikasi |
| Efisiensi token | Diklaim meningkat dibanding Grok 4.6 | Klaim belum terverifikasi |
| Kecepatan penyajian | Diperkirakan agak lebih lambat | Pernyataan pendiri |
| Jendela konteks | Belum dipublikasikan oleh xAI | Tidak diketahui |
| Modalitas input/output | Belum dipublikasikan oleh xAI | Tidak diketahui |
| ID model API final | Belum dikonfirmasi dalam dokumentasi xAI | Tidak diketahui |
| Harga resmi | Belum dipublikasikan oleh xAI | Tidak diketahui |
| Benchmark resmi | Belum ada yang dipublikasikan untuk Grok 4.7 | Tidak diketahui |
Klaim sekitar 2.1T parameter tidak mengungkap parameter aktif, sparsitas, perutean pakar, biaya inferensi, atau komputasi pelatihan yang efektif. Jumlah parameter saja tidak dapat menetapkan kualitas produksi.
Mengapa Sinyal Pelatihan SpaceX Mungkin Lebih Penting daripada 2.1T
Pengungkapan yang lebih berdampak mungkin adalah tambahan data perusahaan SpaceX. Korpus rekayasa berkualitas tinggi dapat meningkatkan penalaran teknis, desain, debugging, optimisasi, dan pekerjaan agen jangka panjang, di mana distribusi tugas dan kualitas pascapelatihan sering lebih penting daripada skala mentah.
Arah ini konsisten dengan strategi model rilis xAI. Laporan pelatihan Grok 4.6 menggambarkan sesi pelatihan tambahan yang lebih panjang dengan data rekayasa berkualitas tinggi, diikuti fine-tuning terawasi dan pembelajaran penguatan di bidang pengodean, STEM, pengembangan web, optimisasi kernel, dan desain berbantuan komputer.
Hal itu membuat klaim Grok 4.7 secara teknis masuk akal, tetapi belum terbukti. Keunggulan nyata seharusnya terlihat setelah rilis dalam pengujian rekayasa yang dapat direproduksi, tingkat penyelesaian tugas, latensi, dan biaya per hasil yang berhasil.
Grok 4.7 vs Grok 4.6: Apa yang Ditunjukkan Baseline
Belum ada skor resmi Grok 4.7. Titik perbandingan yang bertanggung jawab adalah evaluasi Grok 4.6 yang dirilis xAI. Ikhtisar model lengkap muncul dalam ulasan mendalam Grok 4.6 di CometAPI; tabel di bawah hanya menyisakan baris benchmark paling relevan untuk pengambilan keputusan.
| Evaluasi resmi | Grok 4.6 High | Grok 4.5 High | GPT-5.6 Sol Max | Claude Fable 5 Max |
|---|---|---|---|---|
| AA Intelligence Index | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69.9% | 66.7% | 67.2% | 70.5% |
| DeepSWE v1.1 | 65.9% | 54.0% | 73.0% | 70.0% |
| FrontierCode v1.1 (Extended) | 61.3% | 56.6% | 60.6% | 63.6% |
| Terminal-Bench v3.0 | 26.0% | 15.7% | 34.6% | 34.1% |
Hasil baseline: Grok 4.6 menunjukkan keunggulan nyata atas Grok 4.5 di setiap baris yang ditampilkan. Ia menyamai GPT-5.6 Sol pada indeks kecerdasan keseluruhan, memimpin grup ini pada GDPVal-AA v2, dan sedikit unggul atas GPT-5.6 Sol pada FrontierCode. Kesenjangan utamanya yang dipublikasikan tetap pada DeepSWE dan Terminal-Bench.
Hasil ini menetapkan standar konkret bagi Grok 4.7. Jika model yang lebih besar dan pelatihan tambahan berorientasi rekayasa mentransfer ke produksi, terobosan yang diharapkan adalah pengodean tingkat repositori dan penyelesaian tugas terminal yang lebih kuat tanpa kehilangan kekuatan pekerjaan pengetahuan Grok 4.6. Sasaran ambisius yang kredibel adalah menjadi kompetitif dengan Claude Fable 5.1 yang dirilis pada alur kerja pengodean dan agen jangka panjang. Itu adalah perkiraan untuk diuji, bukan klaim benchmark saat ini.
Grok 4.7 vs Grok 4.6: Perkiraan Terobosan dan Panduan Upgrade
Sinyal bocoran dan pernyataan pendiri menyiratkan lima area yang mungkin meningkat pada Grok 4.7. Karena xAI belum menerbitkan data evaluasi final, setiap ekspektasi harus diubah menjadi uji penerimaan yang terukur.
Pengodean Tingkat Repositori
Grok 4.6 sudah kuat pada CursorBench dan FrontierCode, tetapi hasil DeepSWE dan Terminal-Bench masih menyisakan ruang perbaikan yang terlihat. Grok 4.7 harus menunjukkan penerimaan patch yang lebih tinggi, lebih sedikit regresi, dan pemulihan baris perintah yang lebih baik pada repositori yang sama sebelum menggantikan 4.6.
Keandalan Agen Jangka Panjang
Sinyal data SpaceX dan arah pelatihan agen xAI yang ada menyiratkan fokus pada pekerjaan rekayasa multi-tahap. Ukur alur kerja yang selesai, kegagalan pemanggilan alat, percobaan ulang, intervensi manusia, dan pemulihan setelah kesalahan—bukan hanya kualitas prosa akhir.
Pekerjaan Pengetahuan dan Penalaran Teknis
Grok 4.6 sudah memimpin set perbandingan pada GDPVal-AA v2. Grok 4.7 harus mempertahankan keunggulan itu sambil meningkatkan transfer ke tinjauan desain, sintesis riset, debugging, optimisasi, dan tugas teknis kompleks lainnya.
Efisiensi Token
Model yang lebih besar tetap bisa lebih murah per tugas sukses jika mencapai hasil benar dalam lebih sedikit langkah. Bandingkan total token input, input yang di-cache, token output, percobaan ulang, dan biaya untuk hasil yang diterima yang sama.
Trade-off Layanan
Jika Grok 4.7 lebih lambat, peningkatan kualitas harus melampaui latensi. Catat waktu ke token pertama, throughput berkelanjutan, waktu total penyelesaian tugas, tingkat kesalahan, dan biaya pada konkruensi realistis.
Benchmark Grok 4.7: 5 Uji untuk Memverifikasi Peningkatan Nyata atas Grok 4.6
- Keberhasilan rekayasa perangkat lunak: Ukur isu terselesaikan, pengujian lolos, tingkat regresi, dan penerimaan patch pada repositori representatif.
- Keandalan agen jangka panjang: Lacak alur kerja selesai, kegagalan pemanggilan alat, percobaan ulang, pemulihan, dan intervensi manusia di lintasan multi-langkah.
- Transfer rekayasa dunia nyata: Uji desain, debugging, optimisasi, penalaran ilmiah, dan tugas terkait CAD dengan kriteria penilaian yang diungkap.
- Efisiensi token per tugas berhasil: Bandingkan total token dan pengeluaran yang diperlukan untuk mencapai hasil diterima yang sama.
- Latensi dan biaya di bawah beban produksi: Evaluasi waktu ke token pertama, throughput, waktu total, tingkat kesalahan, dan biaya pada konkruensi realistis.
Yang Harus Dilakukan Pengembang sebelum 12 September—dan Peran CometAPI
Checklist Pengembang Pra-Peluncuran
- Bangun set evaluasi tetap dari alur kerja pengodean, riset, rekayasa, dan agen yang nyata.
- Jalankan terhadap Grok 4.6 dan catat tingkat keberhasilan, percobaan ulang, pemanggilan alat, latensi, token, dan total biaya.
- Jaga pemilihan model tetap dapat dikonfigurasi dan hindari hard-code pengenal Grok 4.7 sementara.
- Pantau catatan rilis xAI dan halaman model CometAPI untuk ketersediaan yang dikonfirmasi.
- Setelah peluncuran, verifikasi konteks, modalitas, kontrol penalaran, harga, batas laju, dan cakupan peluncuran.
- Jalankan ulang set evaluasi yang sama sebelum mengalihkan trafik produksi.
CometAPI menyediakan lapisan API terpadu untuk mengakses banyak penyedia model AI melalui satu akun dan pola integrasi. Halaman pelacakan Grok 4.7 sudah tersedia. CometAPI akan mengintegrasikan Grok 4.7 segera setelah xAI secara resmi merilisnya dan akses produksi tersedia.
Sampai saat itu, perlakukan pengenal, harga, atau kolom kapabilitas pra-rilis sebagai sementara. Sebelum mengirim trafik produksi, konfirmasikan bahwa rute aktif, permintaan nyata berhasil, model yang dikembalikan adalah versi yang dimaksud, dan harga saat ini terlihat di konsol.
Prospek Harga Grok 4.7 vs Grok 4.6
Tarif standar Grok 4.6 yang dipublikasikan adalah $2 per 1 million token input dan $6 per 1 million token output di bawah ambang konteks panjang. Catatan rilis xAI mencantumkan tarif lebih tinggi untuk permintaan di atas 200,000 token prompt. Harga Grok 4.7 belum diumumkan secara resmi.
| Dasar harga yang dipublikasikan | Input / 1M | Output / 1M | Status |
|---|---|---|---|
| Grok 4.6, prompt di bawah 200K | $2 | $6 | Dipublikasikan |
| Grok 4.6, prompt di atas 200K | $4 | $12 | Tier konteks panjang dipublikasikan |
| Grok 4.7 | Not announced | Not announced | Konfirmasi setelah peluncuran resmi |
Tiga arah harga tetap masuk akal: paritas dengan Grok 4.6 untuk mempercepat adopsi, tier premium jika biaya penyajian secara material lebih tinggi, atau tarif terpisah menurut panjang konteks dan kecepatan. Ini adalah skenario perencanaan, bukan prediksi xAI.
Checklist Pengembang Pra-Peluncuran
- Bangun set evaluasi tetap dari alur kerja pengodean, riset, rekayasa, dan agen yang nyata.
- Jalankan terhadap Grok 4.6 dan catat tingkat keberhasilan, percobaan ulang, pemanggilan alat, latensi, token, dan total biaya.
- Jaga pemilihan model tetap dapat dikonfigurasi dan hindari hard-code pengenal Grok 4.7 sementara.
- Pantau catatan rilis xAI dan halaman model CometAPI untuk ketersediaan yang dikonfirmasi.
- Setelah peluncuran, verifikasi konteks, modalitas, kontrol penalaran, harga, batas laju, dan cakupan peluncuran.
- Jalankan ulang set evaluasi yang sama sebelum mengalihkan trafik produksi.
Grok 4.7: Hal yang Perlu Diamati Selanjutnya
Empat peristiwa akan mengubah hitung mundur saat ini menjadi peluncuran produk yang dapat diverifikasi: pos rilis resmi xAI; dokumentasi model yang mencakup konteks, modalitas, dan kontrol penalaran; harga API final dan pengenal model; serta benchmark atau evaluasi produksi yang dapat direproduksi.
Pertanyaan peluncuran yang paling berguna bukanlah apakah 2.1T terdengar besar. Melainkan apakah Grok 4.7 menyelesaikan tugas rekayasa dan agen yang sulit dengan lebih andal—dan pada biaya per hasil yang berhasil yang lebih baik—dibanding baseline yang dirilis.
FAQ
Kapan Grok 4.7 diperkirakan rilis?
Hitung mundur sepuluh hari pada 2 September dari Musk mengarah ke sekitar 12 September 2026. Ini adalah target yang diturunkan, bukan tanggal kalender terpisah yang dipublikasikan oleh xAI.
Apakah Grok 4.7 sudah diluncurkan?
Grok 4.7 telah digoda/diumumkan secara publik tetapi belum menerima rilis dokumentasi API/model resmi yang lengkap.
Apakah Grok 4.7 model 2.1 triliun parameter?
Musk menggambarkannya sebagai sekitar 2.1T parameter. xAI belum menerbitkan dokumen arsitektur yang mengonfirmasi parameter aktif atau detail perutean.
Apakah Grok 4.7 akan lebih baik daripada Grok 4.6?
Musk mengklaim peningkatan substansial, tetapi belum ada tabel benchmark resmi Grok 4.7. Perlakukan klaim tersebut sebagai belum terverifikasi hingga hasil yang dapat direproduksi tersedia.
Apakah Grok 4.7 akan tersedia melalui CometAPI?
Halaman pelacakan CometAPI sudah ada, tetapi ketersediaan final, pengenal, harga, dan format yang didukung harus dikonfirmasi setelah peluncuran resmi.
Kesimpulan
Kisah Grok 4.7 telah bergeser dari perkiraan awal September yang luas menjadi hitung mundur konkret. Pernyataan terbaru Musk mengarah ke sekitar 12 September 2026, sementara posting sebelumnya menggambarkan model sekitar 2.1T dan pelatihan tambahan dengan data perusahaan SpaceX dalam jumlah besar.
Itu adalah sinyal pra-rilis yang tidak biasa spesifik, tetapi bukan kartu model, paket benchmark, atau kontrak API. Pengembang sebaiknya mempertahankan Grok 4.6 sebagai baseline terukur, menyiapkan evaluasi terkontrol sekarang, dan menunggu xAI serta CometAPI mengonfirmasi akses produksi sebelum membuat keputusan migrasi atau anggaran.
