TLDR: Moonshot AI, 16 Temmuz 2026'da Kimi K3'ü yayımladı – yerel çok kipli yapı, 1 milyon token bağlam ve öncü performans sunan, 2,8 trilyon parametreli açık ağırlıklar modeli (3T sınıfındaki ilk) olup; kodlama, ajanslı görevler, frontend geliştirme ve bilgi işlerinde Claude Fable 5 ve GPT-5.6 Sol gibi en üst düzey kapalı modellerle rekabet ediyor veya onları geride bırakıyor.
Öne Çıkanlar
- Ölçek ve Yenilik: 2,8T parametre, 16/896 etkin uzmanlı MoE, Kimi Delta Attention (KDA), Attention Residuals – K2'ye göre ~2.5x ölçeklenme verimliliği, Kimi K3 - Kimi API Platform
- Performans: Artificial Analysis Intelligence Index ~57 (ilk 4, Claude Opus 4.8'in önünde), Frontend Code Arena'da lider, Terminal-Bench'te güçlü (%88,3), BrowseComp (%91,2), GPQA-Diamond (%93,5). Genel toplamda Fable 5/Sol'un gerisinde kalsa da çoğunu geçiyor; Arena.ai Frontend Code Arena'da #1 (1.679 Elo, Fable 5'i geçerek), Arena'nın X gönderisi ve Tom's Hardware haberi.
- Yetenekler: Yerel görsel/video, devasa depolar/kod tabanları için 1M bağlam, ajanslı kodlama, 3D akıl yürütme, video düzenleme, araştırma panoları.
- Erişim: Hemen kimi.com ve API (kimi-k3 modeli, erişim rehberi) üzerinden; açık ağırlıklar yakında. Moonshot, talep artışı nedeniyle yeni Kimi K3 aboneliklerini geçici olarak durdurdu. CometAPI ile kolay entegrasyon.
- Değer: Daha düşük görev başı maliyet (~$0.94 bazı değerlendirmelerde), daha az ret, kodlama/Görüş iş akışları için ideal.
Kimi K3 Tech Blog, Kimi K3'ü "Open Frontier Intelligence, Kimi K3 marks a pivotal moment in AI democratization. As Chinese AI labs like Moonshot push boundaries despite compute constraints, this open model challenges the dominance of closed U.S. frontiers and empowers developers worldwide." şeklinde tanımlıyor.
Kimi K3 Nedir? Moonshot AI'den Açık 3T Sınıfı Bir Model
Pekin merkezli bir girişim olan Moonshot AI, Kimi K3'ü 16 Temmuz 2026'da amiral gemisi modeli olarak piyasaya sürdü. Model, açıkça yaklaşık 3 trilyon parametre sınıfındaki ilk açık model olarak konumlanıyor; seyrek Mixture-of-Experts (MoE) mimarisinde toplam 2,8 trilyon parametreye sahip. Token başına yalnızca 896 uzmanın 16'sı etkinleşerek devasa ölçek ile verimlilik dengeleniyor.
Bu, kodlama ve çok kiplilikte zaten ilgi gören Kimi K2 serisinin (K2.5, K2.6 vb.) üzerine inşa ediliyor. K3, mimari yenilikler getiriyor: Kimi Delta Attention (KDA) ve Attention Residuals (AttnRes), ayrıca Stable LatentMoE ve nicelemeye duyarlı eğitim (SFT aşamasından itibaren MXFP4 ağırlıklar, MXFP8 aktivasyonlar). Bunlar, ~2.5x daha iyi ölçeklenme verimliliği ve seleflere kıyasla 6.3x'e kadar daha hızlı kod çözme sağlıyor.
Temel Özellikler (Kimi K3 Technical Specifications):
- Parametreler: Toplam 2,8T (seyrek MoE).
- Bağlam Penceresi: 1.048.576 token (~1M).
- Kipler: Yerel metin + görüntü + video anlama; metin çıktısı.
- Maksimum Çıktı: Varsayılan 131k token, bağlam sınırına kadar.
- Akıl Yürütme: Lansmanda varsayılan olarak maksimum çaba; daha düşük/yüksek modlar geliyor.
- Açık Ağırlıklar: 27 Temmuz 2026'ya kadar vaat edildi (K2 örneğine göre değiştirilmiş MIT stili).
K3, yalnızca hızlı cevaplar değil, görsel geri bildirimle ("Vision in the Loop") karmaşık mühendislik, araştırma veya ajan iş akışlarını tamamlama gibi uzun ufuklu görevleri hedefliyor. Demolar arasında özerk GPU derleyicisi oluşturma (Triton'a rakip), 45nm süreçte yonga tasarımı ve hızlı astrofizik araştırması yer alıyor.
Talep kapasiteyi şimdiden zorladı
Modelin erken dönem karşılanışı mevcut kapasite üzerinde baskı oluşturdu. Moonshot, X'te son 48 saatteki talebin mevcut GPU sınırlarına yaklaştığını, şirket kapasite eklerken yeni aboneliklerin geçici olarak durdurulacağını paylaştı. Business Insider da aynı kapasite duraklamasını bildirirken mevcut abonelerin etkilenmediğini belirtti.
Bu, üretim planlaması açısından önemlidir. Bir model mükemmel olabilir ve yine de talep bilişimi aştığında erişilebilirlik kısıtlarıyla karşılaşılabilir. Kimi K3'ü değerlendiren ekipler, tek sağlayıcıya bağımlılıktan kaçınmalı, gecikme ve hata oranlarını izlemeli ve mümkünse CometAPI gibi birleşik bir sağlayıcı üzerinden geri dönüşlü yönlendirme kullanmalıdır.
Kodlama Kıyaslamaları: Kimi K3'ün En Güçlü Göründüğü Alanlar
Kimi K3'ün kodlama profili, geliştiricilerin dikkat kesilmesinin temel sebebi. Terminal-Bench 2.1'de GPT-5.6 Sol ile neredeyse başa baş; Program Bench'te GPT-5.6 Sol ve Claude Fable 5'i az farkla geçiyor; FrontierSWE'de GPT-5.6 Sol'u anlamlı bir farkla önde bırakıyor. OpenLM tablosunda SWE Marathon'da karşılaştırılan modellerin üstünde.
Arena'daki frontend sonucu pratik bir sinyal daha ekliyor. Arena, Kimi K3'ü Frontend Code Arena'da 1679 puanla, Claude Fable 5'in önünde raporladı. Bu kıyaslama, frontend işinin çoğunlukla birim testlerinden ziyade insan tercihleriyle değerlendirildiği için önemlidir. Bir prompt'tan temiz, görsel olarak tutarlı bir UI üretebilen bir kodlama asistanı; ürün ekipleri, ajanslar, SaaS geliştiricileri ve dahili araçlar için değerlidir.
Genel Lider Tabloları
- Artificial Analysis AI Leaderboard: #3 olarak giriş yaptı. Intelligence Index puanları rekabetçi konumda (ör. bazı değerlendirmelerde ~57,1).
- Özel Uzun Ufuklu Bilgi İşi Değerlendirmesi: Elo 1547 (K2.6'ya göre +732), yalnızca Fable 5'in gerisinde.
Kodlama ve Ajanslı Kıyaslamalar (Kendi Bildirdikleri ve Bağımsız)
K3, ölçeğini ve mimarisini, sürdürülebilir ajanslı performans için burada parlatıyor.
- Frontend Code Arena (Arena.ai): 1.679 puanla #1, Fable 5 ve GPT-5.6 Sol'u geride bırakıyor. Web geliştirmede kör geliştirici tercihlerinde başarılı.
- DeepSWE: 67,3–67,5 (KimiCode harness ile güçlü).
- Program Bench: 77,8 ile #1.
- SWE Marathon: Bazı harness'lerde 42,0 ile #1.
- Terminal-Bench 2.1: Rekabetçi, GPT-5.6 Sol'a yakın.
Görüş ve Çok Kipli
Yerel eğitim (sonradan ekleme değil) sağlam sonuçlar veriyor:
- MMMU-Pro: %81,6
- MathVision: Bazı raporlarda rekabetçi/yüksek 90'lar.
- OmniDocBench: %91,1 (lider).
Ekran görüntüleri, diyagramlar, video desteği; UI iyileştirme veya oyun geliştirme gibi kapalı döngü görevler için kullanılabiliyor.
Karşılaştırma Tablosu: Kimi K3 vs. Önde Gelen Modeller (Yaklaşık/Derlenmiş Raporlardan; Not edilmedikçe Max Effort)
| Benchmark | Kimi K3 | Claude Fable 5 | GPT-5.6 Sol | Notlar/Kaynak |
|---|---|---|---|---|
| Frontend Code Arena | 1.679 (#1) | Daha düşük | Daha düşük | Arena.ai |
| DeepSWE | 67,3–67,5 | Rekabetçi | - | Moonshot/KimiCode |
| Program Bench | 77,8 (#1) | - | Yakın | Vals.ai |
| Intelligence Index (AA) | ~57,1 | ~59,9 | ~58,9 | Artificial Analysis |
| Long-Horizon Elo | 1547 | Daha yüksek | - | Internal Moonshot |
| Cost per Task (Evals) | ~$0.94 | Daha yüksek | Daha yüksek | Bağımsız |
Veriler Moonshot'ın teknik blogu, bağımsız lider tablolar ve analizlerden derlenmiştir. Sonuçlar harness/efora göre değişebilir; en güncelini doğrulayın.
K3, hassas konularda daha az geri çevirmeyle ve ajanslı akışlarda güçlü tutarlılıkla öne çıkıyor. Bağımsız testler (ör. YouTube değerlendirmeleri, Vals AI) gerçek dünya kodlaması için en güçlü açık modellerden biri olduğunu doğruluyor.
Kimi K3 Neler Yapabilir? Kodlama, Görüş ve Ötesinde Yetenekler
Kodlama ve Ajanslı Mühendislik
K3, minimum gözetimle uzun oturumları sürdürüyor: devasa depoları geziniyor, araçlar kullanıyor, ekran görüntüleriyle hata ayıklıyor ("vision in the loop").
Örnekler:
- Çekirdek Optimizasyonu ve Derleyici Geliştirme: Sıfırdan MiniTriton (Triton benzeri derleyici) oluşturdu, optimize edilmiş yığınlara rakip oldu. GPU çekirdeklerini Fable 5 ile rekabetçi biçimde optimize etti.
- Oyun Geliştirme: Kavramları/görüntüleri/videoları yinelemeli iyileştirmelerle oynanabilir 3D/çok oyunculu deneyimlere dönüştürüyor.
- Yonga Tasarımı: 48 saatlik özerk çalışmada nano-model bir yonga tasarladı.
- Frontend: Web uygulamaları ve tam yığın görevlerde lider tabloların zirvesinde.
Görüş ve Çok Kipli
Görüntü/video yerel anlama şunları mümkün kılıyor:
- Video düzenleme: 56 klipten kendi tanıtım videosunu düzenledi (seçim, kesimler, senkron, revizyonlar) – saatler sürecek işi dakikalara indirdi.
- 3D akıl yürütme, hareketli grafikler, interaktif panolar.
- Ekran görüntüleriyle kod yinelemesi için "vision in the loop".
Kimi API dokümanları, görüntü girdisini base64 veri URL'leriyle ve video girdisini ms:// ile referanslanan yüklenen dosyalarla gösteriyor. Ayrıca, görsel girdide herkese açık görüntü URL'lerinin desteklenmediği, bu nedenle geliştiricilerin base64 veya yüklenen dosya referansları göndermeleri ve mesaj içeriğini nesneler dizisi yapmaları gerektiği konusunda uyarıyor. Bu önemli bir uygulama detayıdır: karma görüntü ve metin mesajını tek bir düz string olarak serileştirmeyin.
Bilgi İşi ve Araştırma
İşletmeler için Kimi K3, normal bir sohbet botundan daha değerli olabilir. Model, bir planı sürdürebildiği, araç çağırabildiği, ara sonuçları işleyebildiği ve nihai bir eser üretebildiği "ajanslı" işler için tasarlandı. Örnekler; pazar araştırma raporları, veri temizleme asistanları, uyum özetleri, müşteri destek bilgi tabanı bakımı ve dahili mühendislik yardımcı pilotları.
- Danışmanlık seviyesinde raporlar, interaktif görselleştirmeler, panolar üretir (ör. binlerce kaynaktan 42 yıllık ASIC sektörü analizi).
- Bilimsel iş akışları: astrofizik ilişkilerini yeniden üretti, alt ajanlarla kütleçekim dalgalarını analiz etti.
- Kimi Work'te kalıcı, veri odaklı görünümler için widget'lar/panolar.
K3, literatürü yürütülebilir koda köprüleyerek yayın kalitesinde çıktıları verimli şekilde üretir.
Kimi K3 ve Diğer Frontier Modeller: Pratik Karşılaştırma
| Model | En uygun kullanım | Güçlü yönler | Dikkat edilmesi gerekenler | CometAPI önerisi |
|---|---|---|---|---|
| Kimi K3 | Uzun bağlamlı kodlama, bilgi işleri, ajanlar, görsel akıl | 2,8T MoE ölçeği, 1M bağlam, güçlü kodlama ve ajanslı kıyaslamalar, açık ağırlık rotası | Lansman haftasında kapasite baskısı, düşünme geçmişine duyarlılık, erişim yoluna göre görüş desteği değişebilir | Amiral kodlama ve uzun bağlam modeli olarak test edin |
| GPT-5.6 Sol | Zor akıl yürütme, kodlama, araştırma, geniş üretim görevleri | Çok güçlü genel kıyaslama profili ve olgun araçlar | Birçok rotada daha yüksek fiyat | Karşılaştırma ve eskalasyon modeli olarak kullanın |
| Claude Fable 5 | Yazım, kodlama, ajanslı iş akışları, insan tercihi ağırlıklı | Güçlü UX ve geniş frontier performansı | Daha yüksek maliyet ve bazı görevlerde olası politika geri dönüşleri | Kullanıcıya dönük ajanlar ve yazım ağırlıklı uygulamalar için karşılaştırın |
| Claude Opus 4.8 | Derin akıl yürütme ve güvenilir profesyonel iş | Stabil üst düzey asistan davranışı | En yeni amirallerden daha eski | Yedek veya kıyaslama tabanı olarak tutun |
| GLM-5.2 | Maliyet duyarlı açık model değerlendirmesi | Rekabetçi açık model alternatifi | K3 karşılaştırmalarının birçoğunda daha zayıf | Maliyet/performans yönlendirme testlerine dahil edin |
Kimi K3'e Nasıl Erişilir: Adım Adım Rehber
- Web/Uygulama: kimi.com'u ziyaret edin veya Kimi uygulamasını (iOS/Android) indirin. K3'ü (K3 Max veya Swarm Max) seçin.
- Kimi Code: Geliştiriciler için terminal/IDE odaklı. Kodlama ajanları için ideal.
- API Erişimi:
- Base URL: https://api.moonshot.ai/v1
- Model: kimi-k3
- API anahtarını platform.moonshot.ai/console adresinden alın.
- OpenAI uyumlu SDK örneği (Python):
Python
from openai import OpenAI
client = OpenAI(api_key="YOUR_KEY", base_url="https://api.moonshot.ai/v1")
response = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "Your prompt"}]
)
Araçlar, JSON modu, bağlam önbelleği desteklenir. Fiyatlandırma: M başına $3 giriş, $15 çıkış (önbellek $0.30).
- Toplayıcılar: CometAPI'yi (cometapi.com) kullanarak tek anahtarla Kimi K3 + 500+ modele birleşik erişim, daha düşük maliyet (yüzde 20-40 tasarruf) ve kolay geçiş sağlayın. Üretim için ideal — OpenAI uyumlu, düşük gecikme, drop-in.
- Kendi Sunucunda Barındırma: 27 Temmuz sonrası ağırlıklar Hugging Face'te. Yoğun donanım gereksinimi bekleyin (süper düğümler, 64+ hızlandırıcı önerilir). vLLM gibi topluluk araçları takip edecek.
CometAPI Önerisi: Birden çok anahtar/faturalamadan kaçınmak için Kimi K3'ü CometAPI üzerinden entegre edin. A/B için Claude/GPT ile birlikte test edin, maliyetleri optimize edin ve güvenilir ölçekleyin. Panoları, modeller arası kullanımı izler — K3 deneylerini izlemek için idealdir. cometapi.com'da ücretsiz krediler ve birleşik erişim için kaydolun.
Nihai Değerlendirme
Kimi K3, 2026'nın en önemli model lansmanlarından biri. Dev ölçek, ciddi bir açık ağırlık stratejisi, 1M token bağlam penceresi, yerel görsel anlama ve mevcut kodlama ile ajanslı AI sistemlerinin en üstüne yerleşen kıyaslama sonuçlarını birleştiriyor. GPT, Claude, Gemini, DeepSeek, Qwen veya diğer modellere duyulan ihtiyacı ortadan kaldırmıyor, ancak en zorlu uzun bağlamlı iş akışları için geliştiricilere güvenilir yeni bir seçenek sunuyor.
Bugün kimi.com üzerinden veya zahmetsiz entegrasyon için CometAPI ile başlayın. Kodlama ve görsel güçlü yanlarını deneyin — sonuçlar kendini gösteriyor.
