GPT-5.6 Luna price down 80%, Terra down 20% →

Temmuz 2026 model dalgası: GPT-5.6, Gemini 3.6 Flash, Grok 4.5, Kimi K3 vb.

CometAPI
AnnaAug 1, 2026
Temmuz 2026 model dalgası: GPT-5.6, Gemini 3.6 Flash, Grok 4.5, Kimi K3 vb.

TL;DR: 2026 Temmuz’unda yaklaşık üç hafta içinde altı büyük model sürümü geldi: OpenAI’nin üç katmanlı GPT-5.6 ailesi (Sol/Terra/Luna), Google’ın Gemini 3.6 Flash’ı, xAI’nin Grok 4.5’i, Moonshot AI’nin Kimi K3’ü, Anthropic’in Claude Opus 5’i ve Zhipu’nun GLM-5.2’si. Evrensel anlamda tek bir en iyi seçenek yok. Pratik karar; akıl yürütme derinliği, kodlama performansı, token başına maliyet, bağlam gereksinimleri ve açık ağırlık dağıtımının önemli olup olmadığına bağlıdır. Bu karşılaştırma, mevcut resmi sağlayıcı bilgileri ve CometAPI listelerini kullanır; kıyaslama iddiaları tek bir evrensel sıralama olarak ele alınmak yerine kaynağıyla etiketlenir.

Öne Çıkanlar:

  • GPT-5.6 tek bir model değil — üç farklı fiyat noktasında üç modeldir (Sol, Terra, Luna) ve yanlış katmanı seçmek, tümden yanlış model ailesini seçmekten daha büyük bir maliyet hatasıdır.
  • Gemini 3.6 Flash ve GLM-5.2 her ikisi de 1,000,000 tokenlık bağlam penceresi yayımlıyor; Kimi K3 de aynı rakamı sunuyor — bu neslin önde gelen modelleri arasında bağlam boyutu artık ayırt edici bir unsur olmaktan çıktı.
  • GLM-5.2 ve Kimi K3 her ikisi de açık ağırlıkla dağıtımı destekler, ancak aynı lisansı kullanmaz. GLM-5.2 MIT License altında yayımlanmıştır; Kimi K3 ayrı Kimi K3 License kullanır; kendi barındırma ya da model-hizmet-olarak erişim sunmadan önce ticari koşullar gözden geçirilmelidir.
  • Claude Opus 5 resmen yayımlandı. Anthropic, 24 Temmuz 2026’da 1M token bağlam penceresi, 128K’ya kadar eşzamanlı çıktı ve resmi olarak milyon başına $5 giriş, milyon başına $25 çıkış fiyatlarıyla duyurdu; CometAPI şu anda $4/$20 listeliyor.

Bu Ay Gerçekte Neler Yayınlandı

Temmuz 2026, frontier ve frontier’a yakın model sürümleri açısından alışılmadık derecede yoğun geçti. Yaklaşık üç haftada, OpenAI GPT-5.6 ailesini (9 Tem), xAI Grok 4.5’i (8 Tem), Moonshot AI Kimi K3’ü (16 Tem), Google Gemini 3.6 Flash’ı (21 Tem) ve Anthropic de resmi olarak Claude Opus 5’i (24 Tem) yayımladı. Zhipu’nun GLM-5.2’si biraz daha erken, Haziran’da geldi; ancak 1M token bağlamı ve MIT lisanslı açık sürümüyle aynı satın alma ve dağıtım kararına ilgili kalıyor.

Bu modellerin üzerine bir şeyler inşa eden herkes için pratik soru, hangisinin soyut olarak en iyi olduğu değil, hangi onaylı seçeneğin belirli bir işe uyduğudur. Altısı da maliyet, bağlam, kodlama davranışı, lisanslama ve dağıtım esnekliğinde anlamlı biçimde farklılaşıyor.

Fiyatlandırma ve Özellikler, Yan Yana

Aşağıdaki tüm fiyatlar milyon token başınadır. Bir modelin birden fazla katmanı varsa, her biri ayrı listelenmiştir.

ModelInputOutputContext WindowLicenseReleased
GPT-5.6 Sol$5.00$30.00Not publicly specifiedProprietaryJul 9, 2026
GPT-5.6 Terra$2.50$15.00Not publicly specifiedProprietaryJul 9, 2026
GPT-5.6 Luna$1.00$6.00Not publicly specifiedProprietaryJul 9, 2026
Grok 4.5$2.00$4.00Not publicly specifiedProprietaryJul 8, 2026
Kimi K3$3.00$15.001,048,576 tokensOpen weights (Kimi K3 License)Jul 16, 2026
Gemini 3.6 Flash$1.50$7.501,048,576 tokens (65,536 output)ProprietaryJul 21, 2026
GLM-5.2$1.40$4.411,000,000 tokensOpen (MIT license)Jun 13, 2026
Claude Opus 5$5.00$25.001,000,000 tokens (128K output)ProprietaryJul 24, 2026

*Yukarıda resmi sağlayıcı tarifeleri gösterilmektedir; standart bir indirimi uygulayan birleşik bir API, her birini orantılı olarak aşağı çeker — tablonun amacı, belirli bir satıcının ödeme fiyatı değil, modeller arasındaki göreli farktır.

Fiyat ve özellik tablosundan birkaç şey öne çıkıyor. GPT-5.6’nın üst katmanı olan Sol, günlük kullanımdan ziyade frontier akıl yürütme ve ajanik işler için fiyatlanmıştır; buna karşılık Grok 4.5’in çıktı fiyatı konumlandırmasına göre nispeten düşüktür. GLM-5.2 bu grupta listelenen en düşük çıktı fiyatına sahiptir ve izin verici MIT License kullanır. Kimi K3 de indirilebilir ağırlıklar ve 1M token bağlam sunar, ancak MIT yerine ayrı Kimi K3 License ile. Gemini 3.6 Flash, Kimi K3, GLM-5.2 ve Claude Opus 5 yaklaşık 1M token bağlam pencereleri yayımlıyor; dolayısıyla bağlam kapasitesi tek başına aralarından seçim yapmak için yeterli değil. CometAPI’nin listelenen oranları genellikle sağlayıcı liste fiyatlarından düşüktür, ancak iş yükü düzeyinde değerlendirme, token fiyatlarını tek başına karşılaştırmaktan daha kullanışlı olmaya devam ediyor.

Her Birinin Gerçekte Ney(e) Yönelik Olduğu

GPT-5.6 Sol, frontier akıl yürütme, ajanik kodlama ve uzun ufuklu teknik çalışmalar için konumlandırılmıştır — "Max Reasoning Effort" modu ve paralel olarak alt ajanları devreye alan "Ultra Mode" destekler. Fiyat farkı göz önüne alındığında, bu katman, rutin görevlerden ziyade zor, çok adımlı problemler için tercih edilmelidir.

GPT-5.6 Terra dengeli orta katmandır — günlük üretkenlik, dokümantasyon, kodlama desteği ve iş otomasyonu. Sol’un akıl yürütme derinliğine özel ihtiyaç duymayan çoğu uygulama arka ucu için Terra, daha savunulabilir varsayılandır.

GPT-5.6 Luna, hafif, yüksek hacimli kullanımı hedefler: sınıflandırma, müşteri destek akışları, onboarding, tekrarlı içerik üretimi. Milyon token başına $1.00/$6.00 (herhangi bir ağ geçidi indirimi öncesi) ile tam da bu tür yüksek çağrı hacmi, düşük karmaşıklık iş yükü için fiyatlanmıştır — ayrıca standart girdi oranına göre %90 indirimli önbelleğe alınmış girdi fiyatlandırmasını destekler; bu, yüksek hacimli iş yüklerinin ne kadar tekrarlı olduğu düşünüldüğünde üst katmanlara kıyasla burada daha önemlidir.

Grok 4.5, GPT-5.6 katmanlarının yaptığı gibi belirtilmiş bir uzmanlık yayımlamaz, ancak fiyatlandırması onu bütçe ile orta katman arasında konumlandırır — sadece fiyata bakarak bir konum varsaymak yerine, belirli bir iş yüküsü için Terra veya Kimi K3 ile doğrudan kıyaslamaya değerdir.

Kimi K3, 2.8 trilyon parametreli bir Mixture-of-Experts modelidir; 1M token bağlam içinde uzun vadeli kodlama, çok modlu bilgi çalışması ve kapsamlı belge veya depo analizi için tasarlanmıştır. Moonshot AI tam ağırlıkları yayımladı, dolayısıyla kendi barındırma mümkündür; ancak sürüm, standart bir MIT sürümünden farklı ticari koşullar içeren Kimi K3 License kullanır.

Gemini 3.6 Flash, Google’ın verimlilik odaklı sürümüdür: yeni bir frontier model olmaktan ziyade 3.5 Flash’ın maliyet ve gecikmeye optimize edilmiş artımlı bir takipçisi olarak açıkça çerçevelenir; selefine kıyasla daha düşük token başına çıktı fiyatının yanı sıra kodlama ve ajanik kıyaslamalarda gerçek kazanımlar sunar. Ham kabiliyet kadar token verimliliği ve tamamlanan görev başına maliyetin de önemli olduğu ajanik iş yükü için seçenektir.

GLM-5.2, bu karşılaştırmada daha izin verici lisanslı açık seçenektir. Z.ai, 1M token bağlamla ve uzun ufuklu kodlama, araç kullanımı ve ayarlanabilir düşünme eforuna özel vurgu ile MIT License altında yayımladı. Ekipler API üzerinden erişebilir veya yayımlanan ağırlıkları kendi altyapılarında çalıştırabilir.

Kodlama Yeteneği Karşılaştırması

Altı sürüm farklı mühendislik kalıplarını hedefler, bu nedenle kodlama yeteneği tek bir sıralamadan ziyade iş yüküne uygunluk olarak anlaşılmalıdır.

  • Claude Opus 5, zor hata ayıklama, kök neden analizi, büyük refaktörler ve uzun süre çalışan yazılım ajanları için en güçlü uyumdur; Anthropic, daha güçlü doğrulama ve yineleme davranışını vurgular.
  • GPT-5.6 Sol, Terra ve Luna, karmaşık kodlama ve akıl yürütmeden dengeli geliştirme çalışmalarına ve yüksek hacimli kod yardımına uzanan katmanlı bir yol sunar.
  • Gemini 3.6 Flash, gecikme ve yineleme başına maliyetin önemli olduğu hızlı ajanik kodlama döngüleri için ayarlanmıştır.
  • Kimi K3, çok büyük depolar üzerinde 1M token bağlam ve indirilebilir ağırlıklarla uzun ufuklu kodlama için tasarlanmıştır.
  • GLM-5.2, uzun ufuklu kodlama, araç kullanımı, ayarlanabilir düşünme eforu ve MIT lisanslı yerel dağıtımı birleştirir.
  • Grok 4.5, resmi konumlandırması tier’lı GPT ailesindeki gibi bir kodlama uzmanlığı dökümü sunmadığından, diğerlerine karşı doğrudan değerlendirme adayı olarak ele alınmalıdır.

Bu Kadar Sık Modelleri Karşılaştırmanın (ve Aralarında Geçiş Yapmanın) Getirdiği Taviz

Bunların hiçbiri her yeni sürümü kovalamak için bir argüman değildir. Bir model her çıktığında üretim iş yüklerini ona geçirmek gerçek maliyetler doğurur: istemleri yeniden test etmek, çıktı kalitesini yeniden doğrulamak ve maliyet-başına-görev hesabını, sentetik bir kıyaslama yerine gerçek trafiğinize göre yeniden kontrol etmek. Birleşik bir API, bu değerlendirme işini ortadan kaldırmaz, ancak kıyaslamayı fiilen çalıştırmanın ayrı hesap ve faturalama yükünü kaldırır — GPT-5.6 Terra, Gemini 3.6 Flash, Kimi K3 ve GLM-5.2’yi aynı istek biçimi ve tek bir faturayla çağırabilmek, taahhüt etmeden önce birden fazla adayı gerçekten test etmeyi mümkün kılar; bu da zaten anahtarınız olan sağlayıcıya varsayılan yapmaktan iyidir.

Bu gerçek bir avantajdır, tam çözüm değil — her modelin belgelerini okumayı ikame etmez ve yukarıda açıklanan geçiş maliyetlerini sıfırlamaz. Yaptığı şey, belirli bir iş yüküsü için gerçekten hangi modelin doğru olduğunu bulmanın maliyetini düşürmektir; bu da “bu model en iyisidir” iddiasından farklı (ve daha dürüst) bir iddiadır.

SSS

2026 Temmuz’unda yayımlanan en iyi yapay zekâ modeli hangisi? Tek bir en iyi yanıt yok. GPT-5.6 Sol ve Claude Opus 5, talepkâr akıl yürütme ve kodlama işleri için hedeflenmiştir; Gemini 3.6 Flash verimli ajanik döngülere vurgu yapar; Kimi K3 uzun bağlamı açık ağırlıklarla birleştirir; GLM-5.2 ise uzun ufuklu kabiliyeti MIT lisansıyla birleştirir. Doğru seçim, iş yüküsüne ve dağıtım kısıtlarına bağlıdır.

GPT-5.6 tek bir model mi yoksa birkaç mı? Üç: Sol (amiral gemisi, frontier akıl yürütme), Terra (dengeli, günlük kullanım) ve Luna (hızlı ve düşük maliyetli, yüksek hacimli görevler) — her biri ayrı fiyatlandırılmıştır; Luna için milyon token başına $0.80/$4.80’den Sol için $4.00/$24.00’a kadar.

Claude Opus 5 resmen yayımlandı mı? Evet. Anthropic, 24 Temmuz 2026’da Claude Opus 5’i duyurdu. Resmi sürüm, 1M token bağlam penceresini tanımlar ve modeli karmaşık ajanik kodlama ve bilgi çalışması için konumlandırır; resmi API fiyatlandırması milyon başına $5 giriş ve milyon başına $25 çıkıştır.

Bunların hangisini ölçekli çalıştırmak en ucuz? Tablodaki listelenen sağlayıcı çıktı fiyatlarına göre GLM-5.2 en düşük maliyetli seçenektir ve MIT License altında mevcuttur. Kimi K3 de açık ağırlıklar sunar, ancak ayrı Kimi K3 License ve çok daha büyük model ayak izi, kendi barındırma ekonomisini değiştirir. GPT-5.6 Luna, burada ele alınan en düşük maliyetli tescilli, yalnızca API seçeneğidir.

Tek bir modeli seçip bağlı kalmam gerekir mi, yoksa birkaçını test edebilir miyim? Üretim trafiğine bağlanmadan önce, gerçek istemleriniz ve trafiğiniz üzerinde birden fazlasını test etmek genellikle kurulum maliyetine değerdir — birleşik bir API (CometAPI başta olmak üzere), karşılaştırmayı çalıştırmanın ayrı hesap yükünü kaldırdığı için bunu özellikle daha ucuza yapar; ancak bu, her modelin kendi belgelerini okumanın yerini almaz.

Sonuç

Temmuz 2026’daki sürüm dalgası net bir kazanan üretmedi. Akıl yürütme derinliği, kodlama performansı, token maliyeti, bağlam ve lisanslama açısından farklı tavizler sunan altı onaylı seçenek üretti. GPT-5.6 Sol ve Claude Opus 5, en zorlu akıl yürütme ve yazılım mühendisliği işlerini hedefler; Gemini 3.6 Flash ve GPT-5.6 Luna verimliliğe vurgu yapar; Kimi K3, kendi lisansı altında açık ağırlıklar ve 1M token çok modlu bağlam getirir; GLM-5.2 ise 1M token, MIT lisanslı bir alternatif sunar. Tümü, tek bir anahtar altında CometAPI üzerinden erişilebilir; bu da kontrollü testleri kolaylaştırır, ancak model seçimi yine de gerçek iş yüküsünün istemleri, araçları, gecikme hedefleri ve başarı ölçütlerine dayanmalıdır.

Yapay zeka geliştirme maliyetlerinizi %20 azaltmaya hazır mısınız?

Dakikalar içinde ücretsiz başlayın. Ücretsiz deneme kredileri dahildir. Kredi kartı gerekmez.

Devamını Oku