DeepSeek Vision and Grok Imagine models are now live on CometAPI →
ai-model/Penyelidikan CometAPI

Grok 4.6 Kini Hadir: Keputusan Penanda Aras Tahap GPT-5.6 & Prestasi Pengaturcaraan

xAI telah melancarkan Grok 4.6 dengan tetingkap konteks 500,000 token, penaakulan yang boleh dikonfigurasi, input imej serta harga API $2 / $6 bagi setiap 1M token input/output.

CometAPI
AnnaPasukan penyelidikan model AI dan API
Dikemas kini Aug 24, 2026 13 min baca
Grok 4.6 Kini Hadir: Keputusan Penanda Aras Tahap GPT-5.6 & Prestasi Pengaturcaraan
Guna corak ini

Buat panggilan API pertama.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL; DR xAI secara rasmi melancarkan Grok 4.6 pada 12 Ogos 2026 dan menjadikannya tersedia melalui xAI API, Cursor, dan Grok Build. Ia mempunyai tetingkap konteks 500,000 token, menerima teks dan imej, menawarkan empat tahap usaha penaakulan, dan mempunyai tarikh pemotongan pengetahuan 1 Februari 2026. Menurut pengumuman rasmi Grok 4.6 oleh xAI, ia menyamai GPT-5.6 Sol pada Artificial Analysis Intelligence Index, gabungan sembilan penilaian.

Harga API bermula pada $2 bagi setiap sejuta token input, $0.50 bagi setiap sejuta token input cache dan $6 bagi setiap sejuta token output untuk prompt di bawah 200,000 token. Apabila prompt mencapai 200,000 token, keseluruhan permintaan akan dibilkan pada kadar konteks panjang iaitu $4 input, $1 input cache dan $12 output bagi setiap sejuta token. Bagi pembangun yang mencari akses multi-model yang fleksibel, platform seperti CometAPI memudahkan integrasi Grok 4.6 bersama model barisan hadapan lain, Harga API ialah 80% daripada harga xAI.

Inti Pati Utama

  • xAI secara rasmi melancarkan Grok 4.6 pada 12 Ogos 2026; laporan tetingkap keluaran terdahulu kini tidak lagi terpakai.
  • ID model API ialah , dan model ini juga tersedia dalam Cursor dan Grok Build.grok-4.6
  • Tetingkap konteksnya ialah 500K token, dengan input teks dan imej serta output teks sahaja.
  • Harga standard di bawah 200K token prompt ialah $2/M input, $0.50/M input cache, dan $6/M output.
  • Prompt 200K token atau lebih mencetuskan kadar lebih tinggi untuk semua token dalam permintaan itu, bukan hanya bahagian yang melepasi ambang.
  • Usaha penaakulan boleh ditetapkan kepada low, medium, high, atau xhigh; ialah lalai yang didokumenkan.
  • Grok 4.6 menyamai GPT-5.6 Sol pada Artificial Analysis Intelligence Index (skor 61) dan menunjukkan peningkatan besar berbanding Grok 4.5 merentasi pengkodan agen, kerja pengetahuan, dan tugasan jangka panjang.
  • Grok Imagine Image 2.0 ialah API penjanaan imej yang berasingan. Grok 4.6 boleh memahami imej tetapi tidak mengembalikan imej terjana sendiri.

Spesifikasi dan Harga Grok 4.6 Sekilas Pandang

Spesifikasi berikut disahkan dalam dokumentasi model xAI dan nota keluaran 12 Ogos.

SpesifikasiGrok 4.6
Tarikh keluaran rasmi12 Ogos 2026
ID model APIgrok-4.6
PemosisianModel perdana untuk pengaturcaraan, agen dan beban kerja umum
Tetingkap konteks500,000 token
InputTeks dan imej
OutputTeks
Had output teks didokumenkanTiada had output teks dinyatakan oleh xAI
Kawalan penaakulanLow, medium, high and xhigh
Usaha penaakulan lalaiHigh
Tarikh pemotongan pengetahuan1 Februari 2026
Akses API asliTersedia
Akses alat pengaturcaraanCursor dan Grok Build
Akses acara semasaMemerlukan alat Web Search atau X Search

Harga rasmi xAI API

Tab harga API xAI semasa memisahkan permintaan konteks pendek dan konteks panjang.

Saiz promptInput per 1M tokenInput cache per 1M tokenOutput per 1M token
Di bawah 200,000 token$2.00$0.50$6.00
200,000 token atau lebih$4.00$1.00$12.00

Ambang ini amat penting untuk agen kod. Apabila prompt permintaan mencapai 200,000 token, xAI mengenakan kadar konteks panjang untuk semua token dalam permintaan itu, bukan hanya bahagian yang melepasi ambang. Oleh itu, permintaan yang mengandungi 199,000 token prompt boleh jadi jauh lebih murah daripada yang mengandungi 200,000 token, walaupun saiznya hampir sama.

Tiada diskaun kelompok disenaraikan untuk Grok 4.6 dalam dokumentasi harga xAI semasa. Pasukan tidak seharusnya menganggap tugasan luar talian menerima diskaun yang tersedia untuk sesetengah model xAI lain.

Apakah Grok 4.6?

Grok 4.6 ialah model bahasa besar perdana terkini SpaceXAI, dikeluarkan pada 12 Ogos 2026. Ia dibina terus atas Grok 4.5 dengan menerapkan larian latihan tambahan yang lebih panjang berfokus pada data terjana model terkurasi untuk penaakulan lanjutan dan konsep teknikal, set data kejuruteraan berkualiti tinggi, pengoptimum yang diperbaiki, dan pembelajaran pengukuhan yang diperluas untuk senario pengaturcaraan dan kerja pengetahuan.

Model ini mengekalkan asas 1.5 trilion parameter yang sama seperti pendahulunya; peningkatan datang terutamanya daripada pasca latihan dan bukannya pertambahan skala parameter. Ia direka khusus untuk kekal berkesan merentas banyak langkah—sama ada menyelidik satu topik, menganalisis sejumlah besar maklumat, menavigasi serta mengedit pangkalan kod yang tidak dikenali, atau menukarkan idea aras tinggi kepada aplikasi atau artifak kerja yang rapi. SpaceXAI menekankan tingkah laku semakan kendiri yang dipertingkat untuk projek jangka panjang dan prestasi yang lebih kukuh pada kerja interaktif dan visual.

Perbezaan daripada chatbot tradisional adalah penting.

Aliran kerja LLM konvensional adalah seperti:

Prompt → Menjana jawapan

Grok 4.6 direka untuk aliran kerja yang lebih hampir kepada:

Matlamat → Rancang → Kaji → Guna alat → Ubah suai kod → Uji → Nilai → Teruskan

Penentuan kedudukan xAI semasa menekankan keupayaan model untuk bertahan lebih lama pada projek kompleks, bekerja merentasi pangkalan kod, mengkaji topik yang tidak dikenali, membina aplikasi, dan mengesahkan kerjanya sendiri.

Ini menjadikan Grok 4.6 sangat relevan kepada pasaran agen pengaturcaraan AI dan agen autonomi yang berkembang pesat.

Apakah Ciri Utama Grok 4.6?

Keupayaan Agen Jangka Panjang

Peningkatan terpenting Grok 4.6 ialah fokusnya pada tugasan jangka panjang.

Daripada mengoptimumkan hanya untuk respons satu-langkah, model ini direka untuk mengekalkan kemajuan melalui pelbagai tahap projek.

Contoh lazim termasuk:

  • Membina aplikasi
  • Menyahpepijat repositori besar
  • Mengkaji subjek yang tidak dikenali
  • Mengubah suai beberapa komponen
  • Menjalankan ujian
  • Menyiasat kegagalan
  • Menyemak semula pelaksanaan
  • Memeriksa hasil akhir

Ini adalah sasaran yang secara asasnya berbeza daripada penanda aras pematuhan arahan tradisional.

Prestasi Pengaturcaraan Lanjutan

Pengaturcaraan ialah salah satu bidang peningkatan yang paling jelas bagi Grok 4.6.

Laporan penanda aras semasa menunjukkan:

  • 65.9% pada DeepSWE 1.1
  • 69.9% pada CursorBench 3.2
  • 61.3% pada FrontierCode 1.1 Extended

Penilaian ini sangat relevan kerana ia menyasarkan tingkah laku agen pengaturcaraan dan bukannya pelengkapan kod semata-mata.

Penambahbaikan daripada Grok 4.5 ke Grok 4.6 pada DeepSWE 1.1 sangat ketara, meningkat daripada kira-kira 54% kepada 65.9% dalam perbandingan yang dilaporkan.

Input Multimodal

Grok 4.6 menyokong input teks dan imej, membolehkan pembangun menggabungkan maklumat visual dengan penaakulan.

Aplikasi berpotensi termasuk:

  • Nyahpepijat tangkap layar
  • Analisis UI
  • Tafsiran carta
  • Kefahaman dokumen
  • Kajian visual
  • Tugasan pengaturcaraan berasaskan imej

Ini menjadikan Grok 4.6 lebih fleksibel daripada model pengaturcaraan yang berasaskan teks semata-mata.

Akses Grok kepada carian merupakan bahagian penting dalam ekosistemnya.

API menyokong:

  • Carian Web
  • Carian X
  • Panggilan fungsi
  • Pelaksanaan kod

Dokumentasi API Grok 4.5 xAI semasa mengesahkan keupayaan alat ini dalam persekitaran Grok API.

Bagi agen penyelidikan, ini bermakna model berpotensi beralih daripada pengetahuan pralatih statik kepada pengambilan maklumat semasa ditambah penaakulan.

Penaakulan Boleh Dikonfigurasi

API Grok membolehkan usaha penaakulan dikonfigurasi.

Ini membolehkan pembangun membuat pertukaran antara:

kelajuan / kos ↔ kedalaman penaakulan

Untuk tugasan mudah, penaakulan lebih rendah boleh mengurangkan pengiraan yang tidak perlu.

Untuk tugasan pengaturcaraan atau penyelidikan yang kompleks, penaakulan lebih tinggi boleh memberikan penyelesaian masalah yang lebih teliti.

Prestasi Barisan Hadapan yang Kompetitif dari Segi Kos

Penetapan harga Grok 4.6 mungkin merupakan salah satu kelebihan komersial terkuatnya.

Harga API standard yang dilaporkan ialah:

  • $2 / 1M token input
  • $6 / 1M token output

Itu adalah harga yang sama yang dilaporkan untuk Grok 4.5, walaupun terdapat peningkatan keupayaan yang ketara.

Ini mewujudkan cadangan kos/prestasi yang luar biasa agresif bagi sebuah model barisan hadapan.


Bagaimanakah Grok 4.6 Berprestasi pada Penanda Aras?

Data penanda aras paling berguna ketika ini tertumpu pada kecerdasan agen dan pengaturcaraan.

Penanda arasGrok 4.6Apa yang Diukur
Artificial Analysis Intelligence Index61Kecerdasan model barisan hadapan yang luas
CursorBench 3.269.9%Prestasi agen pengaturcaraan
DeepSWE 1.165.9%Agen kejuruteraan perisian
FrontierCode 1.1 Extended61.3%Pengaturcaraan lanjutan
GDPVal-AA v21,753 EloPrestasi tugas kerja pengetahuan

Skor Artificial Analysis Intelligence Index sebanyak 61 dilaporkan meletakkan Grok 4.6 pada tahap yang sama dengan GPT-5.6 Sol pada indeks tersebut.

Skor GDPVal-AA v2 sebanyak 1,753 Elo juga signifikan kerana GDPVal menilai tugasan kerja pengetahuan profesional dan bukan sekadar soal jawab akademik.

Inti Pati Penting Penanda Aras

Bukti terkuat untuk Grok 4.6 bukanlah satu skor gaya MMLU.

Profil penanda arasnya menunjukkan ke arah:

pengaturcaraan + agen + kerja pengetahuan + pelaksanaan jangka panjang

Itulah tepatnya arah pembangunan AI moden bergerak.

Bagi laman seperti CometAPI, ini adalah perbezaan penting untuk dikekalkan: Grok 4.6 harus dipasarkan terutamanya sebagai model barisan hadapan berorientasikan agen, bukannya satu lagi model chatbot generik.

Bagaimanakah Grok 4.6 dibandingkan dengan pendahulu dan pesaingnya?

Grok 4.6 vs Grok 4.5

CiriGrok 4.5Grok 4.6
Fokus utamaPenaakulan umum + agenAgen jangka panjang + pengaturcaraan
KonteksPenyebaran kelas 500K500K
InputTeks + imejTeks + imej
Carian webYaYa
Carian XYaYa
Pelaksanaan kodYaYa
Panggilan fungsiYaYa
Harga input$2/M$2/M
Harga output$6/M$6/M
DeepSWE 1.1~54%65.9%
Intelligence Index~5661

Perkara penting ialah Grok 4.6 nampaknya bukan pengganti aras harga ringkas untuk Grok 4.5. Ia merupakan peningkatan keupayaan yang lebih tertumpu pada aliran kerja agen jangka panjang.

Dokumentasi Grok 4.5 xAI semasa menyenaraikan model pada $2/$6 bagi setiap sejuta token, dengan penaakulan boleh dikonfigurasi dan sokongan alat.

Jadual Perbandingan: Grok 4.6 vs Pesaing Utama

AspekGrok 4.6GPT-5.6 SolClaude Fable 5 / Opus 5Nota
AA Intelligence Index616162 / 63Skor komposit
Input / Output $/1M$2 / $6~$5 / $30~$5 / $25Grok jauh lebih murah pada output
Tetingkap konteks500KSehingga 1M+Selalunya 1M
KekuatanAgen, kecekapan pengaturcaraan, kosPenaakulan luas, pengaturcaraanJangka panjang, keselamatan
Integrasi CursorAsli, kukuhTersediaTersediaGrok dioptimumkan untuk Cursor
Kecekapan pusinganTinggi (langkah lebih sedikit)Berdaya saingKiraan langkah lebih tinggi dilaporkanPenting untuk agen
KetersediaanAPI + Cursor + rakan kongsiRasmi + rakan kongsiRasmi + rakan kongsiCometAPI menyatukan akses

Data diperoleh daripada pengumuman SpaceXAI, Artificial Analysis, dan kad model awam setakat 13 Ogos 2026.

Perbandingan Artificial Analysis semasa amat menarik.

Grok 4.6 dilaporkan mencatat 61 pada Intelligence Index, menyamai GPT-5.6 Sol. Tetapi ekonominya sangat berbeza.

Harga tepat varian GPT pesaing harus disemak terhadap harga penyedia semasa sebelum penerbitan, tetapi pemerhatian pasaran utama adalah jelas: Grok 4.6 bersaing pada prestasi penanda aras peringkat barisan hadapan sambil mengekalkan harga token yang agak agresif.

Ini menjadikan Grok 4.6 sangat menarik untuk aplikasi di mana pelaksanaan agen volum tinggi sebaliknya akan menjadikan model barisan hadapan premium mahal.

Apakah Had Grok 4.6?

Konteks 500K Lebih Kecil daripada Sesetengah Pesaing 1M

Konteks 500K Grok 4.6 adalah besar, tetapi bukan tetingkap konteks terbesar yang tersedia di pasaran model barisan hadapan.

Untuk repositori yang sangat besar atau koleksi dokumen yang amat besar, model konteks 1M mungkin mempunyai kelebihan.

Model Proprietari

Tidak seperti MiMo-V2.5-Pro, Grok 4.6 bukan model open-weight.

Pembangun tidak boleh memuat turun model dan melancarkannya secara bebas.

Perbandingan Penanda Aras Perlu Berhati-hati

Penanda aras pengaturcaraan yang berbeza menggunakan rangka, prompt, alat, dan prosedur penilaian yang berbeza.

Sebagai contoh, SWE-Bench Pro direka khusus sekitar masalah kejuruteraan perisian jangka panjang yang realistik, dan hasil penanda aras boleh berbeza-beza dengan ketara bergantung pada kerangka agen.

Oleh itu, 69.9% CursorBench tidak harus ditafsirkan sebagai "Grok 4.6 adalah 69.9% lebih baik daripada model lain."

Tafsiran yang betul ialah model mencapai skor tersebut di bawah tetapan penilaian khusus penanda aras itu.

Kos Agen Boleh Lebih Tinggi daripada Yang Disiratkan oleh Harga Token

Harga token $2/$6 adalah menarik, tetapi agen autonomi boleh menggunakan sejumlah besar token melalui:

  • Panggilan alat
  • Carian berulang
  • Pelaksanaan kod
  • Percubaan gagal
  • Konteks panjang
  • Pengesahan kendiri

Oleh itu, ekonomi unit sebenar bergantung pada kos per tugas yang berjaya disiapkan, bukan sekadar kos per sejuta token.

Harga dan Akses

Harga Rasmi (peringkat standard, di bawah ~200K token prompt):

  • Input: $2.00 bagi setiap 1M token
  • Input cache: kira-kira $0.50 bagi setiap 1M token
  • Output: $6.00 bagi setiap 1M token

Varian lebih pantas berharga dua kali ganda kadar ini. Kadar mungkin berganda untuk konteks yang sangat panjang (≥200K). Cache prompt amat disyorkan untuk gelung agen bagi mengekalkan kos rendah.

Ketersediaan:

  • Cursor dan Grok Build (penggunaan 2× disertakan untuk minggu pertama)
  • SpaceXAI API (grok-4.6)
  • Rakan kongsi: OpenRouter, Vercel, Cloudflare, dan lain-lain
  • SuperGrok chat/apps (melalui pemilih model)

Syor CometAPI: Untuk pembangun yang sudah menggunakan (atau merancang untuk menggunakan) pelbagai model barisan hadapan, CometAPI menyediakan akses lancar kepada Grok 4.6 melalui satu titik akhir serasi OpenAI (https://api.cometapi.com/v1). Anda mendapat pengebilan bersatu, analitik penggunaan, kadar efektif kompetitif merentasi 500+ model (termasuk GPT, Claude, Gemini, DeepSeek, dan varian Grok), dan keupayaan menukar model dengan perubahan satu baris. Ini sangat berharga apabila menjalankan A/B testing Grok 4.6 terhadap model pengaturcaraan atau agen lain atau apabila membina sistem produksi yang mendapat manfaat daripada perutean model dan fallback. Daftar di cometapi.com untuk mendapatkan kunci API percuma dan meneroka katalog model langsung.

Patutkah Anda Beralih ke Grok 4.6?

Ya, jika:

  • Anda banyak bekerja dalam Cursor atau membina agen pengaturcaraan/kerja pengetahuan jangka panjang dan mahukan kebolehpercayaan berbilang langkah yang kukuh pada kos kompetitif.
  • Ekonomi token penting—Grok 4.6 menyampaikan kecerdasan hampir setara dengan GPT-5.6 Sol pada kira-kira satu perlima harga token output pilihan barisan hadapan paling mahal.
  • Anda menghargai kecekapan pusingan (langkah dan token yang lebih sedikit untuk menyiapkan tugasan kompleks).
  • Anda mahukan akses segera kepada model yang telah dilatih secara khusus untuk aliran kerja interaktif, visual, dan berorientasikan agen yang lazim dalam pembangunan moden.

Pertimbangkan untuk kekal dengan atau mencampurkan model lain jika:

  • Beban kerja utama anda ialah pengaturcaraan kompetitif tulen atau kekuatan model tertutup tertentu (contohnya, sesetengah senario konteks panjang atau ditala keselamatan oleh Claude).
  • Anda memerlukan skor tertinggi mutlak pada setiap penanda aras kejuruteraan perisian individu tanpa mengira kos.
  • Anda memerlukan tetingkap konteks yang lebih besar daripada 500K untuk beban kerja panggilan tunggal (sesetengah pesaing menawarkan 1M+).

Kebanyakan pasukan akan mendapat manfaat daripada menilai Grok 4.6 secara bersebelahan dengan susun atur semasa mereka. Memandangkan ia tersedia melalui pengagregator seperti CometAPI, kos pertukaran adalah rendah—hanya tukar nama model dan ukur kadar penyiapan tugasan dunia sebenar, kependaman, dan kos pada beban kerja anda sendiri.

Kesimpulan

Grok 4.6 mewakili lonjakan bermakna untuk SpaceXAI: kecerdasan peringkat barisan hadapan pada penanda aras komposit dan berorientasikan agen utama, peningkatan yang ketara dalam prestasi pengaturcaraan jangka panjang dan kerja pengetahuan, serta penetapan harga agresif yang berterusan yang mengatasi banyak pesaing sumber tertutup. Ketersediaannya secara asli dalam Cursor, digabungkan dengan kebolehpercayaan berbilang langkah yang kukuh, menjadikannya sangat menarik untuk pembangun yang membina agen perisian dunia sebenar dan aplikasi interaktif.

Sama ada anda mengaksesnya secara langsung, melalui Cursor/Grok Build, atau melalui gerbang bersatu seperti CometAPI, Grok 4.6 sedia untuk penilaian produksi hari ini. Lawati pengumuman rasmi di x.ai/news/grok-4-6 untuk butiran penuh dan kad model, terokai katalog langsung di cometapi.com untuk membandingkannya secara bersebelahan dengan model terkemuka lain, dan mula membina dengan keupayaan baharu ini serta-merta.

Sumber Utama

Sentiasa sahkan harga terkini, had kadar, dan angka penanda aras pada halaman rasmi, kerana landskap AI berkembang dengan pantas.

Terus belajar

Sambungkan artikel ini ke keputusan seterusnya.

Lihat semua topik
Diterbitkan pada Aug 13, 2026
Terakhir dikemas kini Aug 24, 2026
79 paparan
Disemak untuk kejelasan, atribusi sumber dan terminologi API semasa.

Bersedia untuk mengurangkan kos pembangunan AI sebanyak 20%?

Mulakan secara percuma dalam beberapa minit. Kredit percubaan percuma disertakan. Tiada kad kredit diperlukan.

Baca Lagi