DeepSeek V4 Pro 0813 is now live on CometAPI →

Grok 4.6 yayında: GPT-5.6 düzeyinde kıyaslama sonuçları & kodlama performansı

CometAPI
AnnaAug 13, 2026
Grok 4.6 yayında: GPT-5.6 düzeyinde kıyaslama sonuçları & kodlama performansı

Özet xAI, 12 Ağustos 2026'da Grok 4.6 sürümünü resmen yayımladı ve xAI API, Cursor ve Grok Build üzerinden kullanıma sundu. 500.000 belirteçlik bir bağlam penceresine sahip, metin ve görsel girdi kabul ediyor, dört düzeyde akıl yürütme çabası sunuyor ve 1 Şubat 2026 bilgi kesimine sahip. xAI’nin resmi Grok 4.6 duyurusuna göre, dokuz değerlendirmeden oluşan bir bileşik olan Artificial Analysis Intelligence Index’te GPT-5.6 Sol ile eşleşiyor.

API fiyatlandırması, 200.000 belirtecin altındaki istemler için milyon başına giriş belirteçlerinde $2, önbelleğe alınmış giriş belirteçlerinde $0,50 ve çıkış belirteçlerinde $6 seviyesinden başlar. Bir istem 200.000 belirtece ulaştığında, tüm istek milyon başına giriş $4, önbelleğe alınmış giriş $1 ve çıkış $12 olan uzun-bağlam oranlarından ücretlendirilir. Esnek çoklu model erişimi arayan geliştiriciler için CometAPI gibi platformlar, Grok 4.6’yı diğer sınır modellerinin yanında entegre etmeyi kolaylaştırır,API fiyatı xAI’nin fiyatının %80’idir.

Önemli Noktalar

  • xAI, 12 Ağustos 2026’da Grok 4.6’yı resmen yayımladı; önceki “sürüm penceresi” haberleri artık geçersizdir.
  • API model kimliği , ve model Cursor ve Grok Build’de de mevcuttur.grok-4.6
  • Bağlam penceresi 500K belirteçtir; metin ve görsel girişi, metin çıkışı destekler.
  • 200K belirtecin altındaki standart fiyatlandırma $2/M giriş, $0,50/M önbelleklenmiş giriş ve $6/M çıkış şeklindedir.
  • 200K belirteç veya üzerindeki bir istem, yalnızca eşiğin üzerindeki kısım değil, istekteki tüm belirteçler için daha yüksek oranları tetikler.
  • Akıl yürütme çabası low, medium, high veya xhigh olarak ayarlanabilir; belgelenen varsayılandır.
  • Grok 4.6, Artificial Analysis Intelligence Index’te (puan 61) GPT-5.6 Sol ile eşleşir ve ajan tabanlı kodlama, bilgi işleri ve uzun ufuk görevlerinde Grok 4.5’e göre büyük artışlar gösterir.
  • Grok Imagine Image 2.0 ayrı bir görsel üretim API’sidir. Grok 4.6 görselleri anlayabilir, ancak kendi başına üretilmiş görseller döndürmez.

Grok 4.6 Teknik Özellikleri ve Fiyat: Bir Bakışta

Aşağıdaki özellikler xAI’nin model dokümantasyonunda ve 12 Ağustos sürüm notlarında doğrulanmıştır.

ÖzellikGrok 4.6
Resmi çıkış tarihi12 Ağustos 2026
API model kimliğigrok-4.6
KonumlandırmaKodlama, ajanlar ve genel iş yükleri için amiral gemisi
Bağlam penceresi500.000 belirteç
GirdilerMetin ve görseller
ÇıktıMetin
Belgelenen metin çıktı sınırıxAI tarafından belirtilmiş bir metin çıktı sınırı yok
Akıl yürütme kontrolleriLow, medium, high ve xhigh
Varsayılan akıl yürütme çabasıHigh
Bilgi kesimi1 Şubat 2026
Yerel API erişimiMevcut
Kodlama aracı erişimiCursor ve Grok Build
Güncel olaylara erişimWeb Search veya X Search araçları gerekir

Resmi xAI API fiyatlandırması

xAI’nin güncel API fiyatlandırma tablosu, kısa bağlamlı ve uzun bağlamlı istekleri ayırır.

İstem boyutu1M belirteç başına giriş1M belirteç başına önbelleklenmiş giriş1M belirteç başına çıkış
200.000 belirtecin altı$2,00$0,50$6,00
200.000 belirteç veya üzeri$4,00$1,00$12,00

Eşik özellikle kod tabanlı ajanlar için önemlidir. İstek istemi 200.000 belirtece ulaştığında, xAI yalnızca eşiği aşan kısım değil, istekteki tüm belirteçler için uzun-bağlam oranını uygular. 199.000 istem belirteci içeren bir istek, boyutları neredeyse aynı olsa bile 200.000 belirteç içeren bir isteğe kıyasla maddi olarak daha az maliyetli olabilir.

Mevcut xAI fiyatlandırma dokümantasyonunda Grok 4.6 için toplu indirim listelenmemiştir. Ekipler, çevrimdışı işler için diğer bazı xAI modellerinde sunulan indirimlerin otomatik olarak geçerli olacağını varsaymamalıdır.

Grok 4.6 Nedir?

Grok 4.6, SpaceXAI’nin 12 Ağustos 2026’da yayımlanan en yeni amiral gemisi büyük dil modelidir. Gelişmiş akıl yürütme ve teknik kavramlar için seçilmiş model-üretimli veriye odaklanan daha uzun bir tamamlayıcı eğitim koşusu, yüksek kaliteli mühendislik veri kümeleri, iyileştirilmiş bir optimize edici ve kodlama ile bilgi-işi senaryoları için genişletilmiş pekiştirmeli öğrenim uygulayarak doğrudan Grok 4.5’in üzerine inşa edilir.

Model, selefiyle aynı 1,5 trilyon parametreli temel yapıyı korur; kazanımlar esas olarak parametre ölçeği artışından değil, eğitim sonrası aşamadan gelir. Bir konuyu araştırmak, büyük miktarda bilgiyi analiz etmek, tanıdık olmayan bir kod tabanında gezinmek ve düzenleme yapmak veya üst düzey bir fikri cilalı bir uygulamaya ya da iş çıktısına dönüştürmek gibi birçok adım boyunca etkili kalacak şekilde özel olarak tasarlanmıştır. SpaceXAI, uzun ufuklu projelerde iyileştirilmiş öz-kontrol davranışını ve etkileşimli ile görsel çalışmalarda daha güçlü performansı vurgular.

Geleneksel bir sohbet robotundan olan fark önemlidir.

Geleneksel bir LLM iş akışı şöyle görünür:

İstem → Yanıt üret

Grok 4.6 ise aşağıdakine daha yakın iş akışları için tasarlanmıştır:

Hedef → Plan → Araştır → Araçları kullan → Kodu değiştir → Test et → Değerlendir → Devam et

xAI’nin mevcut konumlandırması, modelin daha uzun süre karmaşık projelerde kalabilme, kod tabanları arasında çalışabilme, tanıdık olmayan konuları araştırabilme, uygulamalar oluşturabilme ve kendi işini doğrulayabilme yeteneğini vurgular.

Bu, Grok 4.6’yı hızla genişleyen YZ kodlama-ajanı ve otonom-ajan pazarı için özellikle ilgili kılar.

Grok 4.6’nın Başlıca Özellikleri Nelerdir?

Uzun Süreli Ajan Yeteneği

Grok 4.6’daki en önemli iyileştirme, uzun süreli görevler odaklı olmasıdır.

Model, sadece tek atımlık yanıtlar için optimize edilmek yerine, bir projenin birden fazla aşamasında ilerlemeyi sürdürmek üzere tasarlanmıştır.

Tipik örnekler şunları içerir:

  • Bir uygulama oluşturma
  • Büyük bir depo ayıklama
  • Tanıdık olmayan bir konuyu araştırma
  • Birden fazla bileşeni değiştirme
  • Testleri çalıştırma
  • Hataları araştırma
  • Uygulamayı yeniden gözden geçirme
  • Sonucu kontrol etme

Bu, geleneksel yönerge-izleme kıyaslarından temelde farklı bir hedeftir.

Gelişmiş Kodlama Performansı

Kodlama, Grok 4.6’nın en net iyileşme alanlarından biridir.

Mevcut kıyas raporları şu sonuçları verir:

  • DeepSWE 1.1’de %65,9
  • CursorBench 3.2’de %69,9
  • FrontierCode 1.1 Extended’da %61,3

Bu değerlendirmeler, yalnızca kod tamamlama yerine ajan davranışlarını hedefledikleri için özellikle önemlidir.

Grok 4.5’ten Grok 4.6’ya iyileşme özellikle DeepSWE 1.1’de dikkat çekicidir; bildirilen karşılaştırmada yaklaşık %54’ten %65,9’a yükselmiştir.

Multimodal Girdi

Grok 4.6, metin ve görsel girdileri destekler; geliştiricilerin görsel bilgileri akıl yürütmeyle birleştirmesine olanak tanır.

Olası uygulamalar şunları içerir:

  • Ekran görüntüsü ayıklama
  • UI analizi
  • Grafik yorumlama
  • Belge anlama
  • Görsel araştırma
  • Görsele dayalı kodlama görevleri

Bu, Grok 4.6’yı yalnızca metin tabanlı bir kodlama modelinden daha esnek kılar.

Web ve X Araması

Grok’un aramaya erişimi, ekosisteminin önemli bir parçasıdır.

API şunları destekler:

  • Web araması
  • X araması
  • Fonksiyon çağırma
  • Kod yürütme

xAI’nin mevcut Grok 4.5 API dokümantasyonu, Grok API ortamında bu araç yeteneklerini doğrular.

Araştırma ajanları için bu, modelin statik önceden eğitilmiş bilgiden güncel bilgi alma artı akıl yürütmeye geçebileceği anlamına gelir.

Yapılandırılabilir Akıl Yürütme

Grok’un API’si yapılandırılabilir akıl yürütme çabasını ortaya çıkarır.

Bu, geliştiricilerin şunlar arasında değiş tokuş yapmasına izin verir:

hız / maliyet ↔ akıl yürütme derinliği

Basit görevler için daha düşük akıl yürütme, gereksiz hesaplamayı azaltabilir.

Karmaşık kodlama veya araştırma görevleri için daha yüksek akıl yürütme, daha bilinçli problem çözme sağlayabilir.

Maliyet Rekabetçi Sınır Performansı

Grok 4.6’nın fiyatlandırması, muhtemelen en güçlü ticari avantajlarından biridir.

Bildirilmiş standart API fiyatı:

  • 1M giriş belirteci için $2
  • 1M çıkış belirteci için $6

Bu, Grok 4.5 için bildirilen fiyatlandırmayla aynıdır ve önemli yetenek iyileştirmelerine rağmen geçerlidir.

Bu, bir sınır model için olağan dışı derecede agresif bir maliyet/performans sunumu yaratır.


Grok 4.6 Kıyaslarda Nasıl Performans Gösteriyor?

Mevcut kıyas verilerinin en yararlı kısmı, ajan zekâsı ve kodlama etrafında yoğunlaşmıştır.

KıyasGrok 4.6Ne Ölçer
Artificial Analysis Intelligence Index61Geniş kapsamlı sınır-model zekâsı
CursorBench 3.2%69,9Kodlama-ajan performansı
DeepSWE 1.1%65,9Yazılım mühendisliği ajanları
FrontierCode 1.1 Extended%61,3İleri düzey kodlama
GDPVal-AA v21.753 EloBilgi-işi görev performansı

Artificial Analysis Intelligence Index puanı 61, Grok 4.6’yı bu endekste GPT-5.6 Sol ile aynı seviyeye yerleştirir.

1.753 Elo’luk GDPVal-AA v2 puanı da önemlidir çünkü GDPVal, yalnızca akademik soru-cevaplamadan ziyade profesyonel bilgi-işi görevlerini değerlendirir.

Kıyaslamalardan Önemli Çıkarım

Grok 4.6 için en güçlü kanıt, tek bir MMLU tarzı puan değil.

Kıyas profili şunlara işaret ediyor:

kodlama + ajanlar + bilgi işleri + uzun süreli yürütme

Bu, modern YZ geliştirmesinin tam olarak yöneldiği yerdir.

CometAPI gibi bir web sitesi için bu, korunması gereken önemli bir ayrımdır: Grok 4.6 öncelikle bir ajanik sınır modeli olarak pazarlanmalı, başka bir genel amaçlı sohbet robotu modeli olarak değil.

Grok 4.6, selefi ve rakipleriyle nasıl karşılaştırılır?

Grok 4.6 vs Grok 4.5

ÖzellikGrok 4.5Grok 4.6
Birincil odakGenel akıl yürütme + ajanlarUzun süreli ajanlar + kodlama
Bağlam500K-sınıfı dağıtım500K
GirdiMetin + görselMetin + görsel
Web aramasıEvetEvet
X aramasıEvetEvet
Kod yürütmeEvetEvet
Fonksiyon çağırmaEvetEvet
Giriş fiyatı$2/M$2/M
Çıkış fiyatı$6/M$6/M
DeepSWE 1.1~%54%65,9
Zekâ Endeksi~5661

Önemli nokta, Grok 4.6’nın basit bir fiyat katmanı ikamesi olarak görünmemesidir. Uzun ufuklu ajan iş akışlarını daha güçlü biçimde hedefleyen bir yetenek yükseltmesidir.

xAI’nin mevcut Grok 4.5 dokümantasyonu, modeli milyon belirteç başına $2/$6, yapılandırılabilir akıl yürütme ve araç desteğiyle listeler.

Karşılaştırma Tablosu: Grok 4.6 vs Önemli Rakipler

YönGrok 4.6GPT-5.6 SolClaude Fable 5 / Opus 5Notlar
AA Intelligence Index616162 / 63Bileşik puan
Girdi / Çıkış $/1M$2 / $6~$5 / $30~$5 / $25Grok, çıkışta çok daha ucuz
Bağlam Penceresi500K1M+’a kadarGenellikle 1M
Güçlü YanlarAjanlar, kodlama verimi, maliyetGeniş akıl yürütme, kodlamaUzun ufuk, güvenlik
Cursor EntegrasyonuYerel, güçlüMevcutMevcutGrok, Cursor için optimize
Tur VerimliliğiYüksek (daha az adım)RekabetçiDaha yüksek adım sayıları bildirildiAjanlar için önemli
ErişilebilirlikAPI + Cursor + partnerlerResmi + partnerlerResmi + partnerlerCometAPI erişimi birleştirir

Veriler, SpaceXAI duyurusu, Artificial Analysis ve 13 Ağustos 2026 itibarıyla kamuya açık model kartlarından derlenmiştir.

Mevcut Artificial Analysis karşılaştırması özellikle ilgi çekicidir.

Grok 4.6’nın Zekâ Endeksi’nde 61 puan aldığı ve GPT-5.6 Sol ile eşleştiği bildiriliyor. Ancak ekonomik koşullar çok farklı.

Rakip GPT varyantlarının kesin fiyatlandırması, yayımlamadan önce mevcut sağlayıcı fiyatlandırmasına karşı kontrol edilmelidir; ancak temel piyasa gözlemi açıktır: Grok 4.6, göreli olarak agresif belirteç fiyatını korurken sınır düzey kıyas performansında rekabet ediyor.

Bu, yüksek hacimli ajan yürütmesinin aksi halde birinci sınıf sınır modellerini pahalı hale getireceği uygulamalar için Grok 4.6’yı özellikle cazip kılar.

Grok 4.6’nın Sınırlamaları Nelerdir?

500K Bağlam, Bazı 1M Bağlamlı Rakiplerden Daha Küçük

Grok 4.6’nın bildirilen 500K bağlamı büyük olsa da, sınır-model pazarında mevcut en büyük bağlam penceresi değildir.

Çok büyük depolar veya muazzam belge koleksiyonları için 1M bağlamlı bir model avantajlı olabilir.

Mülkiyetli Model

MiMo-V2.5-Pro’nun aksine, Grok 4.6 açık ağırlıklı bir model değildir.

Geliştiriciler modeli indirip bağımsız olarak dağıtamaz.

Kıyas Karşılaştırmaları Özen Gerektirir

Farklı kodlama kıyasları farklı harness’lar, istemler, araçlar ve değerlendirme prosedürleri kullanır.

Örneğin, SWE-Bench Pro, özellikle gerçekçi uzun ufuklu yazılım mühendisliği problemleri etrafında tasarlanmıştır ve kıyas sonuçları, ajan iskeletine bağlı olarak önemli ölçüde değişebilir.

Bu nedenle, %69,9 CursorBench, “Grok 4.6 diğer bir modelden %69,9 daha iyi” şeklinde yorumlanmamalıdır.

Doğru yorum, o puanın kıyasın özel değerlendirme kurulumunda elde edildiğidir.

Ajan Maliyeti, Belirteç Fiyatlarının Önerdiğinden Daha Yüksek Olabilir

$2/$6 belirteç fiyatı caziptir, ancak otonom bir ajan aşağıdaki yollarla muazzam miktarda belirteç tüketebilir:

  • Araç çağrıları
  • Tekrarlanan aramalar
  • Kod yürütme
  • Başarısız denemeler
  • Uzun bağlam
  • Öz-doğrulama

Bu nedenle gerçek birim ekonomisi, yalnızca milyon belirteç başına maliyetten değil, başarıyla tamamlanan görev başına maliyetten bağımsız olamaz.

Fiyat ve Erişim

Resmi Fiyatlandırma (standart katman, ~200K istem belirtecinin altında):

  • Girdi: 1M belirteç başına $2,00
  • Önbelleğe alınmış girdi: yaklaşık 1M belirteç başına $0,50
  • Çıkış: 1M belirteç başına $6,00

Daha hızlı bir varyant, bu oranların iki katı fiyatlandırılır. Çok uzun bağlamlar için (≥200K) oranlar iki katına çıkabilir. Ajan döngülerinde maliyetleri düşük tutmak için istem önbellekleme şiddetle önerilir.

Erişilebilirlik:

  • Cursor ve Grok Build (ilk hafta için 2× dahil kullanım)
  • SpaceXAI API (grok-4.6)
  • Partnerler: OpenRouter, Vercel, Cloudflare ve diğerleri
  • SuperGrok sohbet/uygulamaları (model seçici üzerinden)

CometAPI Önerisi: Halihazırda birden fazla sınır modeli kullanan (veya kullanmayı planlayan) geliştiriciler için CometAPI, Grok 4.6’ya tek bir OpenAI-uyumlu uç nokta (https://api.cometapi.com/v1) üzerinden kesintisiz erişim sağlar. 500+ model (GPT, Claude, Gemini, DeepSeek ve Grok varyantları dahil) genelinde birleştirilmiş faturalama, kullanım analitiği, rekabetçi efektif oranlar ve tek satırla model değiştirme elde edersiniz. Bu, Grok 4.6’yı diğer kodlama veya ajan modelleriyle A/B test ederken ya da model yönlendirme ve geri dönüşten faydalanan üretim sistemleri kurarken özellikle değerlidir. Ücretsiz bir API anahtarı almak ve canlı model kataloğunu keşfetmek için cometapi.com adresine kaydolun.

Grok 4.6’ya Geçmeli misiniz?

Evet, eğer:

  • Cursor’da yoğun çalışıyor veya uzun süreli kodlama/bilgi ajanları inşa ediyor ve rekabetçi maliyetle güçlü çok adımlı güvenilirlik istiyorsanız.
  • Belirteç ekonomisi sizin için önemliyse—Grok 4.6, en pahalı sınır seçeneklerinin çıktı belirteci fiyatının yaklaşık beşte biriyle GPT-5.6 Sol’a yakın zekâ sunar.
  • Tur verimliliğine (karmaşık görevleri tamamlamak için daha az adım ve belirteç) değer veriyorsanız.
  • Modern geliştirmede yaygın olan etkileşimli, görsel ve ajanik iş akışları için özel olarak eğitilmiş bir modele anında erişim istiyorsanız.

Şu durumlarda diğer modellerde kalmayı veya karıştırmayı düşünün:

  • Birincil iş yükünüz saf rekabetçi programlama veya belirli kapalı model güçlü yönleriyse (ör. bazı Claude uzun-bağlam veya güvenlik odaklı senaryolar).
  • Maliyet ne olursa olsun her bir yazılım mühendisliği kıyasında mutlak en yüksek puanları istiyorsanız.
  • Tek çağrılı iş yükleri için 500K’dan daha büyük bağlam pencerelerine ihtiyaç duyuyorsanız (bazı rakipler 1M+ sunar).

Çoğu ekip, Grok 4.6’yı mevcut yığınlarıyla yan yana değerlendirmekten fayda görecektir. CometAPI gibi toplayıcılar üzerinden erişilebilir olduğu için geçiş maliyeti düşüktür—yalnızca model adını değiştirin ve kendi iş yüklerinizde gerçek dünya görev tamamlama oranlarını, gecikmeyi ve maliyeti ölçün.

Sonuç

Grok 4.6, SpaceXAI için anlamlı bir ilerlemeyi temsil eder: kilit bileşik ve ajanik kıyaslarda sınır düzey zekâ, uzun süreli kodlama ve bilgi-işi performansında kayda değer iyileştirmeler ve birçok kapalı kaynak rakibi alt eden agresif fiyatlandırmanın devamı. Cursor’daki yerel kullanılabilirliği, güçlü çok adımlı güvenilirlikle birleştiğinde, onu gerçek dünya yazılım ajanları ve etkileşimli uygulamalar geliştiren geliştiriciler için özellikle cazip kılar.

İster doğrudan, ister Cursor/Grok Build üzerinden, ister CometAPI gibi birleştirilmiş bir ağ geçidi aracılığıyla erişin, Grok 4.6 bugün üretim değerlendirmesine hazır. Tam ayrıntılar ve model kartı için x.ai/news/grok-4-6 adresindeki resmi duyuruyu ziyaret edin, diğer önde gelen modellerle yan yana karşılaştırmak için cometapi.com üzerindeki canlı kataloğu keşfedin ve yeni yeteneklerle derhal geliştirmeye başlayın.

Birincil Kaynaklar

YZ alanı hızla geliştiği için en güncel fiyatlandırmayı, hız sınırlarını ve kıyas numaralarını resmi sayfalarda her zaman doğrulayın.

0 görüntülenme
Netlik, kaynak ataması ve güncel API terminolojisi açısından gözden geçirildi.

Yapay zeka geliştirme maliyetlerinizi %20 azaltmaya hazır mısınız?

Dakikalar içinde ücretsiz başlayın. Ücretsiz deneme kredileri dahildir. Kredi kartı gerekmez.

Devamını Oku