Spesifikasi Teknis Grok 4.7
| Spesifikasi | Grok 4.7 |
|---|---|
| Penyedia | xAI / SpaceXAI |
| ID Model | grok-4.7 |
| Tanggal rilis | 21 September 2026 |
| Fokus utama | Coding, tugas agen, pekerjaan berbasis pengetahuan |
| Modalitas input | Teks, gambar |
| Modalitas output | Teks |
| Jendela konteks | 500,000 tokens |
| Batas keluaran | Tidak ada batas keluaran teks yang dinyatakan oleh xAI |
| Upaya penalaran | low, medium, high, xhigh; default adalah high |
| API | Responses API, Chat Completions |
| Alat | Function calling, web search, X search, code execution |
| Batas pengetahuan | May 2026 |
| Batch API | Tidak didukung |
Grok 4.7 adalah model terdepan dari xAI untuk coding, tugas agen, dan pekerjaan berbasis pengetahuan. ID model API resmi adalah grok-4.7. xAI mendokumentasikan jendela konteks 500K token, input teks dan gambar dengan output teks, upaya penalaran yang dapat dikonfigurasi, serta dukungan untuk Responses API dan Chat Completions.
Apa itu Grok 4.7?
Grok 4.7 adalah model xAI baru yang dirilis pada 21 September 2026, diposisikan untuk coding jangka panjang, alur kerja agen, dan pekerjaan profesional berbasis pengetahuan. xAI menyatakan model ini menggunakan model dasar yang lebih besar dibanding Grok 4.6 dan menjalani pelatihan reinforcement learning yang lebih panjang, berfokus pada tugas yang dapat memakan waktu berjam-jam. Model ini juga dilatih untuk memahami kerangka Grok Bot secara native, dengan penekanan pada pemeriksaan hasilnya sendiri dan pengelolaan konteks yang lebih panjang.
Bagi pengembang, perubahan penting bukan sekadar skor benchmark yang lebih tinggi. Grok 4.7 menggabungkan jendela konteks 500K, kontrol penalaran melalui reasoning_effort, dukungan alat, dan input multimodal dalam sebuah model yang ditujukan untuk loop agen yang berkepanjangan.
Fitur Utama Grok 4.7
- Konteks 500K token: Jendela konteks besar dirancang untuk repo panjang, sesi agen yang diperluas, dokumen teknis besar, dan tugas pekerjaan-pengetahuan multi-langkah.
- Penalaran yang dapat dikonfigurasi: Pengembang dapat memilih upaya penalaran
low,medium,high, atauxhigh, denganhighsebagai default. Ini memungkinkan alokasi komputasi disesuaikan dengan kompleksitas tugas. - Optimasi untuk coding dan agen: xAI secara khusus memosisikan Grok 4.7 untuk rekayasa perangkat lunak, tugas agen, dan alur kerja profesional jangka panjang.
- Input multimodal: API menerima input teks dan gambar serta menghasilkan output teks, memungkinkan penerapan untuk analisis tangkapan layar, debug visual, dan alur kerja pemahaman dokumen.
- Dukungan alat native: Kapabilitas terdokumentasi mencakup pemanggilan fungsi, penelusuran web, penelusuran X, dan eksekusi kode.
- Fokus keandalan jangka panjang: xAI melaporkan peningkatan pada verifikasi mandiri dan pengelolaan konteks yang lebih panjang dibanding Grok 4.6, mencerminkan penekanan pada tugas multi-jam. citeturn0search0
Performa Benchmark Grok 4.7
Evaluasi peluncuran xAI melaporkan hasil berikut. Ini adalah pengukuran benchmark yang dilaporkan penyedia, sehingga perlu ditafsirkan dalam konteks metodologi dan konfigurasi masing-masing benchmark, bukan sebagai peringkat universal.
| Benchmark | Grok 4.7 | Grok 4.6 | GPT-5.6 Sol | Fable 5.1 |
|---|---|---|---|---|
| CursorBench 4.0 | 46.3% | 40.4% | 41.7% | 51.8% |
| DeepSWE v1.1 | 71.0%* | 65.2% | 72.7% | 70.0% |
| AA Briefcase v1.1 | 1,657 | 1,546 | 1,487 | 1,678 |
| Terminal-Bench 4.0 | 38.0% | 20.3% | 37.3% | 57.9% |
| Harvey Legal Agent Benchmark | 19.6% | 15.8% | 2.5% | 6.7% |
| HealthBench Professional | 56.7% | 48.5% | 60.5% | 62.1% |
| EEBench | 64.0% | 53.0% | 39.4% | 56.4% |
*Hasil Grok 4.7 untuk DeepSWE yang dilaporkan menggunakan upaya tinggi. Tabel xAI melaporkan pengukuran ini sebagai bagian dari perbandingan peluncurannya.
Profil benchmark bergantung pada tugas. Grok 4.7 menunjukkan peningkatan signifikan dibanding Grok 4.6 pada evaluasi coding, terminal, legal, klinis, dan teknik elektro yang dilaporkan, sementara tabel yang sama menunjukkan model terdepan lainnya unggul pada benchmark tertentu. Hal ini membuat pemilihan benchmark menjadi penting ketika mengevaluasi Grok 4.7 untuk beban kerja tertentu.
Grok 4.7 vs Grok 4.6 vs GPT-5.6 Sol
| Aspek | Grok 4.7 | Grok 4.6 | GPT-5.6 Sol |
|---|---|---|---|
| Konteks | 500K | 500K | Lihat spesifikasi penyedia |
| Pemosisian inti | Coding, agen, pekerjaan berbasis pengetahuan | Coding, agen, pekerjaan berbasis pengetahuan | Penalaran frontier umum |
| Kontrol penalaran | Low / medium / high / xhigh | Low / medium / high / xhigh | Spesifik penyedia |
| Input | Teks + gambar | Teks + gambar | Spesifik penyedia |
| Dukungan alat | Function calling, web search, X search, code execution | Alur kerja berorientasi alat serupa | Spesifik penyedia |
| Benchmark coding dikutip xAI | 46.3% CursorBench 4.0 | 40.4% | 41.7% |
Grok 4.7 dan Grok 4.6 berbagi kelas konteks 500K dan opsi upaya penalaran yang sama, namun xAI melaporkan hasil yang lebih baik untuk Grok 4.7 pada rangkaian benchmark peluncurannya. Dibanding GPT-5.6 Sol, perbedaan praktis bergantung pada beban kerja: tabel yang dipublikasikan xAI menunjukkan kinerja relatif yang berbeda pada pekerjaan coding, kerja perkantoran, kerja terminal, pekerjaan legal, penalaran klinis, dan teknik elektro.
Batasan dan Pertimbangan Implementasi
Grok 4.7 memiliki jendela konteks yang besar, namun jendela yang lebih besar tidak menjamin hasil yang lebih baik untuk setiap dokumen panjang atau alur kerja agen. Aplikasi jangka panjang tetap harus mengelola konteks secara cermat, terutama ketika percakapan mengakumulasi output alat. xAI merekomendasikan prompt-cache routing dan kompaksi konteks untuk loop agen yang panjang.
Model ini juga tidak memiliki dukungan Batch API publik menurut dokumentasi model saat ini. Pengembang yang membangun beban kerja berbasis batch perlu menggunakan pola API sinkron yang didukung atau rute deployment lain.
Hasil benchmarknya dilaporkan oleh penyedia dan bervariasi berdasarkan konfigurasi benchmark serta upaya penalaran. Hasil tersebut harus diperlakukan sebagai bukti spesifik tugas, bukan sebagai satu ukuran universal kualitas model.
Kasus Penggunaan Representatif
- Pengembangan skala repositori: Menganalisis basis kode besar, menerapkan perubahan lintas banyak file, melakukan debug kegagalan, dan menalar sepanjang riwayat isu yang panjang.
- Rekayasa perangkat lunak berbasis agen: Menggabungkan penalaran dengan pemanggilan fungsi, eksekusi kode, dan alat eksternal untuk alur kerja rekayasa multi-langkah.
- Analisis dokumen teknis: Memproses spesifikasi panjang, dokumen arsitektur, materi riset, atau catatan proyek dalam konteks 500K token.
- Debug visual: Menganalisis tangkapan layar, diagram, dan input gambar lain bersama konteks rekayasa tekstual.
- Pekerjaan profesional berbasis pengetahuan: Menyusun, menganalisis, dan merevisi dokumen atau deliverable terstruktur yang memerlukan penalaran multi-langkah yang diperluas.
- Alur kerja riset dan informasi: Menggunakan alat penelusuran web dan X search ketika informasi eksternal terkini diperlukan dan izin alat aplikasi mengizinkan.
Cara Mengakses Grok 4.7 API Melalui CometAPI
CometAPI saat ini memiliki halaman model Grok 4.7 khusus dengan ID model grok-4.7 serta rute /v1/chat/completions dan /v1/responses yang terdokumentasi. Halaman CometAPI saat ini mengonfirmasi bahwa Grok 4.7 tersedia melalui lapisan API-nya.
Langkah 1: Dapatkan Kunci API CometAPI
Buat atau masuk ke akun CometAPI dan dapatkan kunci API dari konsol API. CometAPI menyediakan lapisan API terpadu untuk mengakses berbagai penyedia model melalui satu akun.
Langkah 2: Pilih grok-4.7
Gunakan grok-4.7 sebagai ID model dan pilih rute CometAPI yang didokumentasikan yang sesuai dengan aplikasi. Halaman model saat ini mencantumkan keduanya, /v1/chat/completions dan /v1/responses. citeturn1search2
Langkah 3: Kirim dan Proses Respons
Kirim prompt pengguna melalui endpoint yang dipilih, lalu proses respons yang dikembalikan dalam alur kerja aplikasi yang sama seperti model bahasa lain yang didukung CometAPI. Untuk deployment produksi, verifikasi katalog model CometAPI yang live dan dokumentasi rute sebelum menetapkan detail implementasi.