Spesifikasi Teknikal Grok 4.6
| Item | Grok 4.6 |
|---|---|
| Provider | xAI |
| Model ID | grok-4.6 |
| Model type | Model hadapan penaakulan berbilang modal dan berasaskan agen |
| Primary strengths | Ejen jangka panjang, pengaturcaraan, kerja pengetahuan, pembinaan aplikasi interaktif/visual |
| Input modalities | Teks dan imej |
| Output modality | Teks |
| Context window | 500,000 token |
| Knowledge cutoff | 1 Februari 2026 |
| Output limit | Tiada had output teks yang diterbitkan oleh xAI |
| Reasoning | low, medium, high (lalai), xhigh |
| APIs | Responses API, Chat Completions |
| Tools | Pemanggilan fungsi, carian web, X search, pelaksanaan kod |
| API pricing | $2 / 1M token input; $6 / 1M token output |
| Fast variant | Tersedia pada harga 2× standard |
| Released | 12 Ogos 2026 |
Apa Itu Grok 4.6?
Grok 4.6 ialah model hadapan terbaharu dari xAI yang memfokus pada kecerdasan berasaskan agen.
Perbezaannya daripada chatbot tradisional adalah penting.
xAI menekankan keupayaan model untuk kekal pada projek kompleks lebih lama, bekerja merentas pangkalan kod, menyelidik topik yang tidak dikenali, membina aplikasi, dan mengesahkan kerjanya sendiri.
Ini menjadikan Grok 4.6 amat relevan dengan pasaran ejen pengaturcaraan AI dan ejen autonomi yang berkembang pesat.
Ciri Utama Grok 4.6
- Pelaksanaan ejen jangka panjang: Grok 4.6 dilatih untuk mengekalkan kerja kompleks berbilang langkah, bukannya hanya mengoptimumkan jawapan satu pusingan.
- Pengaturcaraan berasaskan agen: Ia menyasarkan kejuruteraan perisian pada tahap repositori, penjanaan kod, penyahpepijatan, pengujian iteratif, dan persekitaran pengaturcaraan khusus domain.
- Penyelidikan kerja pengetahuan: Model ini boleh menyelidik domain yang tidak dikenali, mengatur maklumat, melakukan penaakulan terhadap keperluan kompleks, dan menukar penemuan kepada hasil nyata.
- Pembinaan aplikasi visual dan interaktif: xAI melaporkan hasil percubaan pertama yang lebih kukuh untuk projek visual dan interaktif, termasuk menukar idea produk menjadi aplikasi berfungsi dan memperhalusinya melalui kitaran maklum balas.
- Ujian kendiri dan pengesahan: Pada trajektori yang lebih panjang, xAI memerhati lebih banyak tingkah laku di mana model menyemak hasil kerjanya sendiri sebelum meneruskan.
- Penggunaan alat asli: Grok 4.6 menyokong pemanggilan fungsi, carian web, X search, dan pelaksanaan kod melalui API.
- Penaakulan boleh dikonfigurasi: Pembangun boleh memilih
low,medium,high, atauxhighusaha penaakulan, menjadikan model ini boleh menyesuaikan diri dengan beban kerja sensitif latensi dan penaakulan mendalam.
Prestasi Penanda Aras Grok 4.6
xAI melaporkan bahawa Grok 4.6 menyamai GPT-5.6 Sol pada Artificial Analysis Intelligence Index, gabungan sembilan penanda aras. Keputusan terkuat yang diterbitkan termasuk:
| Benchmark | Grok 4.6 High | Grok 4.5 High | GPT-5.6 Sol Max | Claude Fable 5 Max |
|---|---|---|---|---|
| Artificial Analysis Intelligence Index | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69.9% | 66.7% | 67.2% | 70.5% |
| DeepSWE v1.1 | 65.9% | 54.0% | 73.0% | 70.0% |
| FrontierCode v1.1 (Extended) | 61.3% | 56.6% | 60.6% | 63.6% |
| APEX-Agents | 57.5% | 47.1% | 56.7% | 59.2% |
| Terminal-Bench v3.0 | 26.0% | 15.7% | 34.6% | 34.1% |
| APEX-SWE | 56.4% | 53.6% | — | 58.8% |
| AA-Briefcase | 1577 | 1313 | 1502 | 1574 |
| Harvey LAB (Vals) | 15.8% | 12.9% | 2.5% | 11.3% |
Angka-angka ini berasal daripada pengumuman pelancaran xAI pada 12 Ogos. xAI menyatakan bahawa angka pihak ketiga diambil daripada kad sistem pembangun atau papan pendahulu penanda aras awam, jadi keputusan rentas model harus ditafsirkan dengan mengambil kira metodologi penilaian dan tetapan model.
Grok 4.6 vs Grok 4.5 vs GPT-5.6 Sol vs Claude Fable 5
| Model | Pemosisian utama | Konteks | AA Intelligence | Profil pengaturcaraan/agenik |
|---|---|---|---|---|
| Grok 4.6 | Ejen jangka panjang, pengaturcaraan, kerja pengetahuan | 500K | 61 | Pengaturcaraan berasaskan agen dan aliran kerja projek interaktif yang kukuh |
| Grok 4.5 | Model hadapan serba guna yang pantas dan pengaturcaraan | 500K | 56 | Asas kukuh untuk pengaturcaraan dan aliran kerja agen |
| GPT-5.6 Sol | Penaakulan umum hadapan dan kerja berasaskan agen | Konteks pesaing yang diterbitkan berbeza mengikut pelaksanaan | 61 | Keputusan DeepSWE dan Terminal-Bench yang kukuh |
| Claude Fable 5 | Kerja pengetahuan hadapan dan pengaturcaraan | Konteks pesaing yang diterbitkan berbeza mengikut pelaksanaan | 62 | CursorBench, FrontierCode, APEX-SWE yang sangat kukuh |
Grok 4.6 paling meyakinkan apabila beban kerja memerlukan pelaksanaan berterusan berbanding satu respons berkualiti tinggi. Ia amat menarik untuk pembangun yang membina ejen yang berulang kali menyelidik, memanggil alat, menyunting kod, menguji hasil, dan meneruskan daripada konteks yang terkumpul. Claude Fable 5 mengekalkan kelebihan pada beberapa penanda aras pengaturcaraan dan ejen yang diterbitkan, manakala GPT-5.6 Sol mendahului Grok 4.6 pada DeepSWE dan Terminal-Bench dalam perbandingan xAI.
Batasan dan Pertimbangan
- Keputusan penanda aras bergantung pada tugas: Grok 4.6 bukan sentiasa model dengan skor tertinggi. Keputusan yang diterbitkan menunjukkan kekuatan dan kelemahan yang jelas merentas penilaian agen yang berbeza.
- Beban kerja jangka panjang boleh menggunakan jumlah token yang besar: Tetingkap konteks yang besar dan penggunaan alat berulang boleh meningkatkan penggunaan inferens keseluruhan walaupun harga per token kompetitif.
- Konfigurasi alat adalah penting: Carian web, X search, pelaksanaan kod, dan pemanggilan fungsi memerlukan seni bina aplikasi yang boleh mengendalikan kebenaran alat dan data yang dipulangkan dengan selamat.
- Had pengetahuan: Had yang didokumenkan ialah 1 Februari 2026. Untuk maklumat yang lebih baharu, pembangun hendaklah menggunakan alat pengambilan atau carian web yang sesuai dan bukan bergantung pada pengetahuan statik model.
- Caching memerlukan konfigurasi yang teliti: xAI mengesyorkan
prompt_cache_keyuntuk Responses API danx-grok-conv-iduntuk Chat Completions bagi meningkatkan kebolehpercayaan hit cache.
Kegunaan Grok 4.6
- Ejen pengaturcaraan autonomi — analisis repositori, pelaksanaan, penyahpepijatan, pengujian, dan pembaikan iteratif.
- Prototip produk — menukar keperluan produk yang luas menjadi aplikasi interaktif yang berfungsi.
- Ejen penyelidikan teknikal — menyelidik domain teknikal yang tidak dikenali dan menghasilkan hasil terstruktur.
- Copilot pembangun — penjanaan kod, semakan, penyahpepijatan, dan aliran kerja pembangunan berbilang langkah.
- Automasi kerja pengetahuan — analisis dokumen, sintesis maklumat, perancangan, dan penjanaan output terstruktur.
- Pembantu menggunakan alat — aplikasi yang menggabungkan penaakulan model dengan carian web, X search, pelaksanaan kod, dan panggilan fungsi tersuai.
Cara Mengakses API Grok 4.6
Untuk aplikasi yang sudah menggunakan lapisan API bersatu CometAPI, gunakan ID model Grok 4.6 yang didedahkan oleh CometAPI dan ikut titik akhir/skema semasa dalam dokumentasi API CometAPI. Ini boleh mengurangkan kerja integrasi khusus penyedia apabila aplikasi perlu bertukar antara LLM hadapan.
Aliran kerja biasa ialah:
- Cipta atau log masuk ke akaun CometAPI.
- Cipta token API dalam konsol CometAPI.
- Pilih titik akhir model
grok-4.6. - Hantar permintaan melalui titik akhir CometAPI menggunakan skema permintaan yang didokumenkan untuk model tersebut.
- Proses teks yang dipulangkan, panggilan alat, atau output terstruktur dalam aplikasi anda.