TL; DR xAI secara rasmi melancarkan Grok 4.6 pada 12 Ogos 2026 dan menjadikannya tersedia melalui xAI API, Cursor, dan Grok Build. Ia mempunyai tetingkap konteks 500,000 token, menerima teks dan imej, menawarkan empat tahap usaha penaakulan, dan mempunyai tarikh pemotongan pengetahuan 1 Februari 2026. Menurut pengumuman rasmi Grok 4.6 oleh xAI, ia menyamai GPT-5.6 Sol pada Artificial Analysis Intelligence Index, gabungan sembilan penilaian.
Harga API bermula pada $2 bagi setiap sejuta token input, $0.50 bagi setiap sejuta token input cache dan $6 bagi setiap sejuta token output untuk prompt di bawah 200,000 token. Apabila prompt mencapai 200,000 token, keseluruhan permintaan akan dibilkan pada kadar konteks panjang iaitu $4 input, $1 input cache dan $12 output bagi setiap sejuta token. Bagi pembangun yang mencari akses multi-model yang fleksibel, platform seperti CometAPI memudahkan integrasi Grok 4.6 bersama model barisan hadapan lain, Harga API ialah 80% daripada harga xAI.
Inti Pati Utama
- xAI secara rasmi melancarkan Grok 4.6 pada 12 Ogos 2026; laporan tetingkap keluaran terdahulu kini tidak lagi terpakai.
- ID model API ialah , dan model ini juga tersedia dalam Cursor dan Grok Build.
grok-4.6 - Tetingkap konteksnya ialah 500K token, dengan input teks dan imej serta output teks sahaja.
- Harga standard di bawah 200K token prompt ialah $2/M input, $0.50/M input cache, dan $6/M output.
- Prompt 200K token atau lebih mencetuskan kadar lebih tinggi untuk semua token dalam permintaan itu, bukan hanya bahagian yang melepasi ambang.
- Usaha penaakulan boleh ditetapkan kepada
low,medium,high, atauxhigh; ialah lalai yang didokumenkan. - Grok 4.6 menyamai GPT-5.6 Sol pada Artificial Analysis Intelligence Index (skor 61) dan menunjukkan peningkatan besar berbanding Grok 4.5 merentasi pengkodan agen, kerja pengetahuan, dan tugasan jangka panjang.
- Grok Imagine Image 2.0 ialah API penjanaan imej yang berasingan. Grok 4.6 boleh memahami imej tetapi tidak mengembalikan imej terjana sendiri.
Spesifikasi dan Harga Grok 4.6 Sekilas Pandang
Spesifikasi berikut disahkan dalam dokumentasi model xAI dan nota keluaran 12 Ogos.
| Spesifikasi | Grok 4.6 |
|---|---|
| Tarikh keluaran rasmi | 12 Ogos 2026 |
| ID model API | grok-4.6 |
| Pemosisian | Model perdana untuk pengaturcaraan, agen dan beban kerja umum |
| Tetingkap konteks | 500,000 token |
| Input | Teks dan imej |
| Output | Teks |
| Had output teks didokumenkan | Tiada had output teks dinyatakan oleh xAI |
| Kawalan penaakulan | Low, medium, high and xhigh |
| Usaha penaakulan lalai | High |
| Tarikh pemotongan pengetahuan | 1 Februari 2026 |
| Akses API asli | Tersedia |
| Akses alat pengaturcaraan | Cursor dan Grok Build |
| Akses acara semasa | Memerlukan alat Web Search atau X Search |
Harga rasmi xAI API
Tab harga API xAI semasa memisahkan permintaan konteks pendek dan konteks panjang.
| Saiz prompt | Input per 1M token | Input cache per 1M token | Output per 1M token |
|---|---|---|---|
| Di bawah 200,000 token | $2.00 | $0.50 | $6.00 |
| 200,000 token atau lebih | $4.00 | $1.00 | $12.00 |
Ambang ini amat penting untuk agen kod. Apabila prompt permintaan mencapai 200,000 token, xAI mengenakan kadar konteks panjang untuk semua token dalam permintaan itu, bukan hanya bahagian yang melepasi ambang. Oleh itu, permintaan yang mengandungi 199,000 token prompt boleh jadi jauh lebih murah daripada yang mengandungi 200,000 token, walaupun saiznya hampir sama.
Tiada diskaun kelompok disenaraikan untuk Grok 4.6 dalam dokumentasi harga xAI semasa. Pasukan tidak seharusnya menganggap tugasan luar talian menerima diskaun yang tersedia untuk sesetengah model xAI lain.
Apakah Grok 4.6?
Grok 4.6 ialah model bahasa besar perdana terkini SpaceXAI, dikeluarkan pada 12 Ogos 2026. Ia dibina terus atas Grok 4.5 dengan menerapkan larian latihan tambahan yang lebih panjang berfokus pada data terjana model terkurasi untuk penaakulan lanjutan dan konsep teknikal, set data kejuruteraan berkualiti tinggi, pengoptimum yang diperbaiki, dan pembelajaran pengukuhan yang diperluas untuk senario pengaturcaraan dan kerja pengetahuan.
Model ini mengekalkan asas 1.5 trilion parameter yang sama seperti pendahulunya; peningkatan datang terutamanya daripada pasca latihan dan bukannya pertambahan skala parameter. Ia direka khusus untuk kekal berkesan merentas banyak langkah—sama ada menyelidik satu topik, menganalisis sejumlah besar maklumat, menavigasi serta mengedit pangkalan kod yang tidak dikenali, atau menukarkan idea aras tinggi kepada aplikasi atau artifak kerja yang rapi. SpaceXAI menekankan tingkah laku semakan kendiri yang dipertingkat untuk projek jangka panjang dan prestasi yang lebih kukuh pada kerja interaktif dan visual.
Perbezaan daripada chatbot tradisional adalah penting.
Aliran kerja LLM konvensional adalah seperti:
Prompt → Menjana jawapan
Grok 4.6 direka untuk aliran kerja yang lebih hampir kepada:
Matlamat → Rancang → Kaji → Guna alat → Ubah suai kod → Uji → Nilai → Teruskan
Penentuan kedudukan xAI semasa menekankan keupayaan model untuk bertahan lebih lama pada projek kompleks, bekerja merentasi pangkalan kod, mengkaji topik yang tidak dikenali, membina aplikasi, dan mengesahkan kerjanya sendiri.
Ini menjadikan Grok 4.6 sangat relevan kepada pasaran agen pengaturcaraan AI dan agen autonomi yang berkembang pesat.
Apakah Ciri Utama Grok 4.6?
Keupayaan Agen Jangka Panjang
Peningkatan terpenting Grok 4.6 ialah fokusnya pada tugasan jangka panjang.
Daripada mengoptimumkan hanya untuk respons satu-langkah, model ini direka untuk mengekalkan kemajuan melalui pelbagai tahap projek.
Contoh lazim termasuk:
- Membina aplikasi
- Menyahpepijat repositori besar
- Mengkaji subjek yang tidak dikenali
- Mengubah suai beberapa komponen
- Menjalankan ujian
- Menyiasat kegagalan
- Menyemak semula pelaksanaan
- Memeriksa hasil akhir
Ini adalah sasaran yang secara asasnya berbeza daripada penanda aras pematuhan arahan tradisional.
Prestasi Pengaturcaraan Lanjutan
Pengaturcaraan ialah salah satu bidang peningkatan yang paling jelas bagi Grok 4.6.
Laporan penanda aras semasa menunjukkan:
- 65.9% pada DeepSWE 1.1
- 69.9% pada CursorBench 3.2
- 61.3% pada FrontierCode 1.1 Extended
Penilaian ini sangat relevan kerana ia menyasarkan tingkah laku agen pengaturcaraan dan bukannya pelengkapan kod semata-mata.
Penambahbaikan daripada Grok 4.5 ke Grok 4.6 pada DeepSWE 1.1 sangat ketara, meningkat daripada kira-kira 54% kepada 65.9% dalam perbandingan yang dilaporkan.
Input Multimodal
Grok 4.6 menyokong input teks dan imej, membolehkan pembangun menggabungkan maklumat visual dengan penaakulan.
Aplikasi berpotensi termasuk:
- Nyahpepijat tangkap layar
- Analisis UI
- Tafsiran carta
- Kefahaman dokumen
- Kajian visual
- Tugasan pengaturcaraan berasaskan imej
Ini menjadikan Grok 4.6 lebih fleksibel daripada model pengaturcaraan yang berasaskan teks semata-mata.
Carian Web dan X Search
Akses Grok kepada carian merupakan bahagian penting dalam ekosistemnya.
API menyokong:
- Carian Web
- Carian X
- Panggilan fungsi
- Pelaksanaan kod
Dokumentasi API Grok 4.5 xAI semasa mengesahkan keupayaan alat ini dalam persekitaran Grok API.
Bagi agen penyelidikan, ini bermakna model berpotensi beralih daripada pengetahuan pralatih statik kepada pengambilan maklumat semasa ditambah penaakulan.
Penaakulan Boleh Dikonfigurasi
API Grok membolehkan usaha penaakulan dikonfigurasi.
Ini membolehkan pembangun membuat pertukaran antara:
kelajuan / kos ↔ kedalaman penaakulan
Untuk tugasan mudah, penaakulan lebih rendah boleh mengurangkan pengiraan yang tidak perlu.
Untuk tugasan pengaturcaraan atau penyelidikan yang kompleks, penaakulan lebih tinggi boleh memberikan penyelesaian masalah yang lebih teliti.
Prestasi Barisan Hadapan yang Kompetitif dari Segi Kos
Penetapan harga Grok 4.6 mungkin merupakan salah satu kelebihan komersial terkuatnya.
Harga API standard yang dilaporkan ialah:
- $2 / 1M token input
- $6 / 1M token output
Itu adalah harga yang sama yang dilaporkan untuk Grok 4.5, walaupun terdapat peningkatan keupayaan yang ketara.
Ini mewujudkan cadangan kos/prestasi yang luar biasa agresif bagi sebuah model barisan hadapan.
Bagaimanakah Grok 4.6 Berprestasi pada Penanda Aras?
Data penanda aras paling berguna ketika ini tertumpu pada kecerdasan agen dan pengaturcaraan.
| Penanda aras | Grok 4.6 | Apa yang Diukur |
|---|---|---|
| Artificial Analysis Intelligence Index | 61 | Kecerdasan model barisan hadapan yang luas |
| CursorBench 3.2 | 69.9% | Prestasi agen pengaturcaraan |
| DeepSWE 1.1 | 65.9% | Agen kejuruteraan perisian |
| FrontierCode 1.1 Extended | 61.3% | Pengaturcaraan lanjutan |
| GDPVal-AA v2 | 1,753 Elo | Prestasi tugas kerja pengetahuan |
Skor Artificial Analysis Intelligence Index sebanyak 61 dilaporkan meletakkan Grok 4.6 pada tahap yang sama dengan GPT-5.6 Sol pada indeks tersebut.
Skor GDPVal-AA v2 sebanyak 1,753 Elo juga signifikan kerana GDPVal menilai tugasan kerja pengetahuan profesional dan bukan sekadar soal jawab akademik.
Inti Pati Penting Penanda Aras
Bukti terkuat untuk Grok 4.6 bukanlah satu skor gaya MMLU.
Profil penanda arasnya menunjukkan ke arah:
pengaturcaraan + agen + kerja pengetahuan + pelaksanaan jangka panjang
Itulah tepatnya arah pembangunan AI moden bergerak.
Bagi laman seperti CometAPI, ini adalah perbezaan penting untuk dikekalkan: Grok 4.6 harus dipasarkan terutamanya sebagai model barisan hadapan berorientasikan agen, bukannya satu lagi model chatbot generik.
Bagaimanakah Grok 4.6 dibandingkan dengan pendahulu dan pesaingnya?
Grok 4.6 vs Grok 4.5
| Ciri | Grok 4.5 | Grok 4.6 |
|---|---|---|
| Fokus utama | Penaakulan umum + agen | Agen jangka panjang + pengaturcaraan |
| Konteks | Penyebaran kelas 500K | 500K |
| Input | Teks + imej | Teks + imej |
| Carian web | Ya | Ya |
| Carian X | Ya | Ya |
| Pelaksanaan kod | Ya | Ya |
| Panggilan fungsi | Ya | Ya |
| Harga input | $2/M | $2/M |
| Harga output | $6/M | $6/M |
| DeepSWE 1.1 | ~54% | 65.9% |
| Intelligence Index | ~56 | 61 |
Perkara penting ialah Grok 4.6 nampaknya bukan pengganti aras harga ringkas untuk Grok 4.5. Ia merupakan peningkatan keupayaan yang lebih tertumpu pada aliran kerja agen jangka panjang.
Dokumentasi Grok 4.5 xAI semasa menyenaraikan model pada $2/$6 bagi setiap sejuta token, dengan penaakulan boleh dikonfigurasi dan sokongan alat.
Jadual Perbandingan: Grok 4.6 vs Pesaing Utama
| Aspek | Grok 4.6 | GPT-5.6 Sol | Claude Fable 5 / Opus 5 | Nota |
|---|---|---|---|---|
| AA Intelligence Index | 61 | 61 | 62 / 63 | Skor komposit |
| Input / Output $/1M | $2 / $6 | ~$5 / $30 | ~$5 / $25 | Grok jauh lebih murah pada output |
| Tetingkap konteks | 500K | Sehingga 1M+ | Selalunya 1M | — |
| Kekuatan | Agen, kecekapan pengaturcaraan, kos | Penaakulan luas, pengaturcaraan | Jangka panjang, keselamatan | — |
| Integrasi Cursor | Asli, kukuh | Tersedia | Tersedia | Grok dioptimumkan untuk Cursor |
| Kecekapan pusingan | Tinggi (langkah lebih sedikit) | Berdaya saing | Kiraan langkah lebih tinggi dilaporkan | Penting untuk agen |
| Ketersediaan | API + Cursor + rakan kongsi | Rasmi + rakan kongsi | Rasmi + rakan kongsi | CometAPI menyatukan akses |
Data diperoleh daripada pengumuman SpaceXAI, Artificial Analysis, dan kad model awam setakat 13 Ogos 2026.
Perbandingan Artificial Analysis semasa amat menarik.
Grok 4.6 dilaporkan mencatat 61 pada Intelligence Index, menyamai GPT-5.6 Sol. Tetapi ekonominya sangat berbeza.
Harga tepat varian GPT pesaing harus disemak terhadap harga penyedia semasa sebelum penerbitan, tetapi pemerhatian pasaran utama adalah jelas: Grok 4.6 bersaing pada prestasi penanda aras peringkat barisan hadapan sambil mengekalkan harga token yang agak agresif.
Ini menjadikan Grok 4.6 sangat menarik untuk aplikasi di mana pelaksanaan agen volum tinggi sebaliknya akan menjadikan model barisan hadapan premium mahal.
Apakah Had Grok 4.6?
Konteks 500K Lebih Kecil daripada Sesetengah Pesaing 1M
Konteks 500K Grok 4.6 adalah besar, tetapi bukan tetingkap konteks terbesar yang tersedia di pasaran model barisan hadapan.
Untuk repositori yang sangat besar atau koleksi dokumen yang amat besar, model konteks 1M mungkin mempunyai kelebihan.
Model Proprietari
Tidak seperti MiMo-V2.5-Pro, Grok 4.6 bukan model open-weight.
Pembangun tidak boleh memuat turun model dan melancarkannya secara bebas.
Perbandingan Penanda Aras Perlu Berhati-hati
Penanda aras pengaturcaraan yang berbeza menggunakan rangka, prompt, alat, dan prosedur penilaian yang berbeza.
Sebagai contoh, SWE-Bench Pro direka khusus sekitar masalah kejuruteraan perisian jangka panjang yang realistik, dan hasil penanda aras boleh berbeza-beza dengan ketara bergantung pada kerangka agen.
Oleh itu, 69.9% CursorBench tidak harus ditafsirkan sebagai "Grok 4.6 adalah 69.9% lebih baik daripada model lain."
Tafsiran yang betul ialah model mencapai skor tersebut di bawah tetapan penilaian khusus penanda aras itu.
Kos Agen Boleh Lebih Tinggi daripada Yang Disiratkan oleh Harga Token
Harga token $2/$6 adalah menarik, tetapi agen autonomi boleh menggunakan sejumlah besar token melalui:
- Panggilan alat
- Carian berulang
- Pelaksanaan kod
- Percubaan gagal
- Konteks panjang
- Pengesahan kendiri
Oleh itu, ekonomi unit sebenar bergantung pada kos per tugas yang berjaya disiapkan, bukan sekadar kos per sejuta token.
Harga dan Akses
Harga Rasmi (peringkat standard, di bawah ~200K token prompt):
- Input: $2.00 bagi setiap 1M token
- Input cache: kira-kira $0.50 bagi setiap 1M token
- Output: $6.00 bagi setiap 1M token
Varian lebih pantas berharga dua kali ganda kadar ini. Kadar mungkin berganda untuk konteks yang sangat panjang (≥200K). Cache prompt amat disyorkan untuk gelung agen bagi mengekalkan kos rendah.
Ketersediaan:
- Cursor dan Grok Build (penggunaan 2× disertakan untuk minggu pertama)
- SpaceXAI API (grok-4.6)
- Rakan kongsi: OpenRouter, Vercel, Cloudflare, dan lain-lain
- SuperGrok chat/apps (melalui pemilih model)
Syor CometAPI: Untuk pembangun yang sudah menggunakan (atau merancang untuk menggunakan) pelbagai model barisan hadapan, CometAPI menyediakan akses lancar kepada Grok 4.6 melalui satu titik akhir serasi OpenAI (https://api.cometapi.com/v1). Anda mendapat pengebilan bersatu, analitik penggunaan, kadar efektif kompetitif merentasi 500+ model (termasuk GPT, Claude, Gemini, DeepSeek, dan varian Grok), dan keupayaan menukar model dengan perubahan satu baris. Ini sangat berharga apabila menjalankan A/B testing Grok 4.6 terhadap model pengaturcaraan atau agen lain atau apabila membina sistem produksi yang mendapat manfaat daripada perutean model dan fallback. Daftar di cometapi.com untuk mendapatkan kunci API percuma dan meneroka katalog model langsung.
Patutkah Anda Beralih ke Grok 4.6?
Ya, jika:
- Anda banyak bekerja dalam Cursor atau membina agen pengaturcaraan/kerja pengetahuan jangka panjang dan mahukan kebolehpercayaan berbilang langkah yang kukuh pada kos kompetitif.
- Ekonomi token penting—Grok 4.6 menyampaikan kecerdasan hampir setara dengan GPT-5.6 Sol pada kira-kira satu perlima harga token output pilihan barisan hadapan paling mahal.
- Anda menghargai kecekapan pusingan (langkah dan token yang lebih sedikit untuk menyiapkan tugasan kompleks).
- Anda mahukan akses segera kepada model yang telah dilatih secara khusus untuk aliran kerja interaktif, visual, dan berorientasikan agen yang lazim dalam pembangunan moden.
Pertimbangkan untuk kekal dengan atau mencampurkan model lain jika:
- Beban kerja utama anda ialah pengaturcaraan kompetitif tulen atau kekuatan model tertutup tertentu (contohnya, sesetengah senario konteks panjang atau ditala keselamatan oleh Claude).
- Anda memerlukan skor tertinggi mutlak pada setiap penanda aras kejuruteraan perisian individu tanpa mengira kos.
- Anda memerlukan tetingkap konteks yang lebih besar daripada 500K untuk beban kerja panggilan tunggal (sesetengah pesaing menawarkan 1M+).
Kebanyakan pasukan akan mendapat manfaat daripada menilai Grok 4.6 secara bersebelahan dengan susun atur semasa mereka. Memandangkan ia tersedia melalui pengagregator seperti CometAPI, kos pertukaran adalah rendah—hanya tukar nama model dan ukur kadar penyiapan tugasan dunia sebenar, kependaman, dan kos pada beban kerja anda sendiri.
Kesimpulan
Grok 4.6 mewakili lonjakan bermakna untuk SpaceXAI: kecerdasan peringkat barisan hadapan pada penanda aras komposit dan berorientasikan agen utama, peningkatan yang ketara dalam prestasi pengaturcaraan jangka panjang dan kerja pengetahuan, serta penetapan harga agresif yang berterusan yang mengatasi banyak pesaing sumber tertutup. Ketersediaannya secara asli dalam Cursor, digabungkan dengan kebolehpercayaan berbilang langkah yang kukuh, menjadikannya sangat menarik untuk pembangun yang membina agen perisian dunia sebenar dan aplikasi interaktif.
Sama ada anda mengaksesnya secara langsung, melalui Cursor/Grok Build, atau melalui gerbang bersatu seperti CometAPI, Grok 4.6 sedia untuk penilaian produksi hari ini. Lawati pengumuman rasmi di x.ai/news/grok-4-6 untuk butiran penuh dan kad model, terokai katalog langsung di cometapi.com untuk membandingkannya secara bersebelahan dengan model terkemuka lain, dan mula membina dengan keupayaan baharu ini serta-merta.
Sumber Utama
- Pengumuman rasmi: https://x.ai/news/grok-4-6
- Dokumen SpaceXAI: https://docs.x.ai/developers/models/grok-4-6
- Penilaian dan artikel Artificial Analysis
- Blog Cursor: https://cursor.com/blog/grok-4-6
- Liputan bebas daripada SiliconANGLE, 9to5Mac, VentureBeat, The Decoder, dan lain-lain (12–13 Ogos 2026)
Sentiasa sahkan harga terkini, had kadar, dan angka penanda aras pada halaman rasmi, kerana landskap AI berkembang dengan pantas.
