GPT-5.6 Luna price down 80%, Terra down 20% →

Qwen3.8 Max, Alibaba’nın Qwen (Tongyi Qianwen) ailesine ait, üst seviye bir büyük dil modelidir. “Max” varyantı, karmaşık akıl yürütme, uzun bağlam ve çok adımlı görevlerde daha güçlü performans sunacak şekilde optimize edilmiştir ve bazı platformlarda API üzerinden erişilebilir.

CometAPI
AnnaAug 4, 2026
Qwen3.8 Max, Alibaba’nın Qwen (Tongyi Qianwen) ailesine ait, üst seviye bir büyük dil modelidir. “Max” varyantı, karmaşık akıl yürütme, uzun bağlam ve çok adımlı görevlerde daha güçlü performans sunacak şekilde optimize edilmiştir ve bazı platformlarda API üzerinden erişilebilir.

TLDR Alibaba’nın Qwen ekibi 3 Ağustos 2026’da resmen Qwen3.8-Max’i yayımladı — toplam 2,4 trilyon parametreye (95 milyar aktif) sahip seyrek bir Mixture-of-Experts model, 1 milyon belirteçlik bağlam penceresi ve yerel çok modlu (metin + görsel + video) desteği ile.

Açık ağırlıklar için planlanan ilk Max sınıfı Qwen modeli (bir sonraki hafta bekleniyor). Girdi için 1 milyon belirteç başına $2 ve çıktı için 1 milyon belirteç başına $6 gibi agresif fiyatlandırmayla, uzun ufuklu ajan görevleri, otonom yazılım mühendisliği (belgelenmiş 16 günlük kendi kendini evrimleştiren kodlama projesi dâhil), araştırma yeniden üretimi ve çok modlu kıyaslarda güçlü sonuçlar veriyor. Kimi K3 gibi modellerle yakın rekabet ediyor ve yetenek açısından DeepSeek V4 Flash gibi daha hafif seçeneklerin üzerinde konumlanırken, çıktı ağırlıklı iş yüklerinde Batı’daki en üst düzey frontier modellere kıyasla çok daha maliyet etkin kalıyor. Geliştiriciler bugünden itibaren QwenCloud / Alibaba Cloud Model Studio ve CometAPI gibi birleştirilmiş platformlar üzerinden erişebiliyor.

Öne Çıkanlar

  • Ölçek ve verimlilik: 2,4T toplam / 95B aktif MoE mimarisi, Qwen 3.5 temelleri üzerinde, pratik çıkarım maliyetiyle frontier düzeyinde performans sağlar.
  • Uzun vadede güç: Çok günlük otonom kodlama (yaklaşık 16 günde 265 commit, 127 PR, sıfır insan müdahalesi), araştırma makalesi yeniden üretimi + iyileştirme ve bir yıllık simüle e-ticaret operasyonları.
  • Kıyas öne çıkanları: PaperBench 93.0 (lider), Terminal Bench 2.1 86.6, güçlü çok modlu ve doküman skorları; bazı saf kodlama ajan listelerinde Claude Fable 5 veya GPT-5.6 Sol’a karşı rekabetçi ancak her zaman baskın değil.
  • Fiyat avantajı: Tam 1M bağlam boyunca 1M belirteç başına düz $2 / $6 (önbellekli girdi yaklaşık $0,25), çıktı tarafında Kimi K3’ü ve birçok Batılı modeli geride bırakır.
  • Kullanılabilirlik: QwenCloud ve Alibaba Cloud Model Studio’da canlı (OpenAI ve Anthropic uyumlu API’ler); açık ağırlıklar planlandı; 500+ başka modelle birlikte birleşik erişim için CometAPI’de qwen3.8-max olarak listelendi. Açık ağırlıklar çok yakında geliyor; yerel/edge için pratik Qwen3.8-27B varyantı da planlandı.
  • Pratik üstünlük: Tek hamle cevaplardan ziyade uçtan uca teslimat üretiminde başarılı — kodlama ajanları, araştırma hatları, ofis iş akışları ve uzun süreli ajan döngüleri için ideal.

Qwen3.8-Max Nedir?

Qwen3.8-Max, Qwen serisinin en yeni ve en yetkin amiral gemisi modeli olup, 3 Ağustos 2026’da (Şanghay’daki Dünya Yapay Zekâ Konferansı’nda Temmuz ortası ön izlemesinin ardından) resmen yayımlandı. Model, asgari denetimle karmaşık, çok günlük görevleri uçtan uca tamamlayabilen ve sevkiyata hazır çıktılar üretebilen sistemlere doğru bilinçli bir kaymayı temsil eder.

Mimari olarak, belirteç başına yaklaşık 95 milyarı etkinleştirilen, 2,4 trilyon toplam parametreye ölçeklenen seyrek bir MoE modelidir. Qwen 3.5 temeli üzerine inşa edilen bu tasarım, muazzam kapasiteyle çıkarım verimliliğini dengeler. Model, 1 milyon belirteçlik bağlam penceresini (belgelenmiş maksimum girdi ~991K belirteç, maksimum çıktı ~131K belirteç), yerel çok modlu girdileri (metin, görseller ve video) ve metin çıktısını destekler. Akıl yürütme çabası kontrolleri (xhigh / medium / low) içerir ve hem OpenAI Chat Completions hem de Anthropic uyumlu protokolleri destekleyerek Claude Code, Codex, Qoder CLI, Qwen Code ve OpenClaw gibi popüler ajan çerçeveleriyle tak-çalıştır uyumludur.

Önceki Max sınıfı modellerin kapalı kalmasının aksine, Alibaba, Qwen3.8-Max’in (ve daha küçük Qwen3.8-27B varyantının) ağırlıklarını lansmandan sonraki hafta Hugging Face ve ModelScope üzerinden yayımlamayı taahhüt etti — ilk kez bir Max kademesi Qwen modeli açıkça kullanıma sunulacak.

Model; kodlama ajanları, gerçek dünya profesyonel işi (“cowork”), araştırma, uzun vadeli planlama ve çok modlu ajan döngüleri için konumlandırılmıştır. Resmî demolar kendini evrimleştiren davranışa vurgu yapar: Model, konular oluşturur, bunları kendine atar, kod yazar ve test eder, geri bildirim üzerinde yineler ve uzun süreler boyunca kendi araçlarını iyileştirir.

Kaynaklar: Resmî Qwen blogu ve Alibaba Cloud duyuruları (Ağustos 2026); Artificial Analysis model kartı; GA sürümünü özetleyen bağımsız incelemeler.

Qwen3.8-Max’te Neler Yeni?

Önceki Qwen3.7-Max ile karşılaştırıldığında 3.8 nesli, ajan tabanlı kodlama, uzun vadeli güvenilirlik, çok modlu muhakeme ve doküman/ofis performansında önemli kazanımlar sunar. Başlıca yenilikler:

Gerçek uzun vadeli özerklik:

Model, yüzlerce dönüş veya birçok gün boyunca kapalı döngü uyarlamalı öğrenmeyi sürdürebilir. Belgelenmiş örnekler arasında, tamamen sıfır insan müdahalesiyle 265 commit, 127 pull request ve 151 issue üreten 16 günlük otonom bir yazılım mühendisliği projesi (oh-my-cli adlı kendi kendini evrimleştiren bir CLI aracı); bir araştırma makalesinin metodolojisinin yeniden üretimi ve iyileştirilmesi (GPU eğitim döngüleri ve ölçülebilir kıyas artışları dâhil); ve temel metrikleri önemli ölçüde aşan tam bir yıllık simüle e-ticaret operasyonu bulunur.

Sürekli geri bildirime dayalı çok modluluk:

Görüş sadece bir girdi biçimi değildir. Model, planlama, yürütme izlemesi ve öz-düzeltme için görsel kavrayışı kullanır — ekran görüntüsünden koda yeniden üretim, etkileşimli oyun/animasyon üretimi ve 2D’den 3D’ye görselleştirme gibi görevleri mümkün kılar.

Model, yayın sonrası erken verilerde Text Arena’da (rapor edilen beşinci) ve Vision Arena’da (rapor edilen ikinci) üst sıralarda yer alır.

Qwen3.8 Max, Alibaba’nın Qwen (Tongyi Qianwen) ailesine ait, üst seviye bir büyük dil modelidir. “Max” varyantı, karmaşık akıl yürütme, uzun bağlam ve çok adımlı görevlerde daha güçlü performans sunacak şekilde optimize edilmiştir ve bazı platformlarda API üzerinden erişilebilir.

Qwen3.8 Max, Alibaba’nın Qwen (Tongyi Qianwen) ailesine ait, üst seviye bir büyük dil modelidir. “Max” varyantı, karmaşık akıl yürütme, uzun bağlam ve çok adımlı görevlerde daha güçlü performans sunacak şekilde optimize edilmiştir ve bazı platformlarda API üzerinden erişilebilir.

Uçtan uca teslimata odak:

Tekil cevaplardan ziyade yüzlerce meslekte üretim kalitesinde çıktılar üretmeye vurgu.

Düşünme ve Hızlı Çıkarım Modları

İki mod: düşünme modu ve hızlı çıkarım modu. Düşünme modu daha derin muhakeme ve karmaşık planlama içindir. Hızlı mod ise görev basitse daha düşük gecikmeli yanıtlar içindir. Alibaba Cloud’un OpenCode dokümanları, Qwen3.8 rotaları için thinking’in etkin olduğunu ve ön izleme rotası için xhigh, medium ve low dâhil akıl yürütme kontrollerini listeler.

Bu ayrım ürün tasarımı için değerlidir. Ekipler her istek için en ağır akıl yürütme modunu kullanmamalıdır. Bir destek botu basit bir talebi ucuza sınıflandırabilir, bir daha hızlı modelle özetleyebilir ve kullanıcı karmaşık bir politika kararı, kök neden analizi, sözleşme incelemesi veya kod taşıma planı istediğinde yalnızca Qwen3.8-Max düşünme moduna yükseltebilir.

Bu yetenekler, dahili uzun soluklu deneyler ve kodlama ajanları, genel ajanlar, çok modlu muhakeme, doküman anlama ve algılama/temellendirme görevlerini kapsayan kapsamlı bir kıyas takımıyla doğrulandı.

Kıyaslama: Veri kuantizasyon performansı

Alibaba, GA’da kapsamlı bir dahili kıyas takımı yayımladı. Bağımsız doğrulama (Artificial Analysis Intelligence Index, LMArena, vb.) sürümden sonraki ilk günlerde yetişme aşamasındaydı; erken Artificial Analysis verileri, Qwen3.8-Max’i 53 zekâ endeksiyle (izlenen sette ~16/186 sırada) konumlandırdı, yüksek söz kalabalığı ve nispeten düşük hız notlarıyla.

Seçilmiş resmî/rapor edilen skorlar (Qwen3.8-Max ve seçili akranlar):

BenchmarkQwen3.8-MaxClaude Fable 5 / Opus 4.8GPT-5.6 Sol (max)Qwen3.7-Max
Terminal-Bench 2.186.684.688.874.5
PaperBench93.088.8 / 80.390.564.8
SWE-bench Pro67.780.0 / 69.264.660.6
FrontierSWE73.588.840.7
DeepSWE 1.156.670.073.021.6
IFBench82.8~63.579.1
GPQA Diamond92.692.694.192.4
OmniDocBench 1.592.1
OSWorld-Verified86.1

Qwen3.8-Max, çok modlu muhakeme, doküman/ofis görevleri ve bazı ajan tabanlı kodlama/araştırma metriklerinde sıklıkla liderlik eder veya zirveye yakın olurken, bazı saf yazılım mühendisliği ajan setlerinde en güçlü kapalı modellerin gerisinde kalır. FrontierSWE ve DeepSWE’deki nesil sıçrayışı özellikle dikkat çekicidir. Tedarikçi rakamlarını yön gösterici olarak ele alın; bağımsız çalıştırmalar ve iş yüküne özel değerlendirme kritik önem taşır.

Qwen3.8-Max API Fiyatlandırması

Qwen3.8-Max için resmî Alibaba Cloud Model Studio / QwenCloud fiyatları (Ağustos 2026 başı GA oranları):

  • Girdi: 1 milyon belirteç başına $2,00
  • Çıktı: 1 milyon belirteç başına $6,00 (düşünme/akıl yürütme belirteçleri dâhil)
  • Önbellekli girdi: yaklaşık 1 milyon belirteç başına $0,25 (tekrarlanan uzun bağlamlarda ciddi tasarruf)

Fiyatlandırma, tüm 1M belirteçlik bağlam penceresi boyunca düzdür — uzun bağlamda ek ücret uygulayan birçok rakibe kıyasla kayda değer bir avantaj. Bölgeye ve plana bağlı olarak toplu ve diğer indirimler geçerli olabilir.

Karşılaştırma bağlamı (aynı döneme ait yaklaşık liste fiyatları):

  • Kimi K3: ~$3 / $15
  • Üst seviye Claude / GPT frontier modeller: genellikle $5+ / $15–25+
  • DeepSeek V4 Flash varyantları: önemli ölçüde daha düşük (birçok kullanım için toplamda sıklıkla $0,50’nin altında)

Zaten birden çok sağlayıcıyı kullanan ekipler için, CometAPI gibi birleşik ağ geçitleri, resmî oranlara kıyasla genelde ~%20 indirim, tek bir OpenAI uyumlu uç nokta, birleşik faturalama ve kolay model değiştirme veya yedek geçiş sunar. Bu, Qwen3.8-Max ile denemeleri (ve eşzamanlı olarak DeepSeek V4 Flash, Kimi modelleri veya diğerleriyle karşılaştırmaları) operasyonel olarak daha basit ve çoğu zaman daha ucuz kılar. Güncel etkili oranlar için CometAPI fiyatlandırma sayfalarını ve ücretsiz kredi tekliflerini kontrol edin.

Qwen3.8-Max, Kimi K3 ve DeepSeek V4 Flash ile Nasıl Kıyaslanır?

BoyutQwen3.8-MaxKimi K3DeepSeek V4 Flash
Toplam / Aktif parametre2,4T / ~95B~2,8T / ~104B284B / 13B
Bağlam1M1M1M
Çok modluMetin + Görsel + VideoMetin + Görsel + VideoYalnızca metin
Fiyatlandırma (girdi/çıktı)$2 / $6$3 / $15~$0,14 / $0,28 (çok daha ucuz)
Açık ağırlıklarPlanlandı (gelecek hafta)Zaten yayımlandıMIT, mevcut
Güçlü yönlerUzun vadeli özerklik, çok modlu, PaperBench, çıktı tarafında fiyatGüçlü bağımsız skorlar, frontend kodlama Arena liderliğiAşırı maliyet etkinliği, boyutuna göre sağlam ajan kodlama
Göreli konumBirçok ajan ve çok modlu kıyasta rekabetçi/öndeBazı denetimli zekâ indekslerinde hafif üstünlükMükemmel değer; daha düşük mutlak yetenek

Qwen3.8-Max, çıktı ağırlıklı işlerde ve çok modlu görevlerde maliyet etkinlik açısından genellikle Kimi K3’ü yakalar veya aşar; DeepSeek V4 Flash ise zirve yeteneğin ikincil olduğu yüksek hacimli metin iş yükleri için bütçe kralı olmayı sürdürür. Birçok ekip, basit trafiği Flash sınıfı modellere, karmaşık ajan oturumlarını ise Qwen3.8-Max veya Kimi K3’e yönlendirerek hepsini birleşik bir ağ geçidi üzerinden birlikte kullanacaktır.

Qwen3.8-Max, Kimi K3 ile başa baş mı?

Bazı açılardan evet. 1M bağlam kademesini eşleştirir, güçlü bir çok modlu konumlandırmaya sahiptir ve standart resmî girdi/çıktı fiyatlandırmasında daha ucuzdur. Kimi K3’ün 2,8T toplam parametre sayısını eşleştirmez ve Kimi’nin kamuya açık dokümantasyonu şu an için özellikle ayrıntılı araç, bağlam önbellekleme, yapılandırılmış çıktı ve görsel yönergeler sunar.

Qwen3.8-Max, DeepSeek V4 Flash ile başa baş mı?

1M bağlam ve MoE mimarisinde rekabet eder, ancak ürünler farklı işlere yöneliktir. DeepSeek V4 Flash ekonomik hızlı yoldur. Qwen3.8-Max ise çok modlu anlama, gelişmiş muhakeme ve kurumsal üretkenliğin en düşük belirteç fiyatından daha önemli olduğu işler için daha büyük ve daha yetkin hattır.

Qwen3.8-Max neler yapabilir?

Kodlama ve Yazılım Mühendisliği

Qwen3.8-Max, uçtan uca geliştirme, kod incelemesi, depo anlama, taşıma planlama, API tasarımı, hata ayıklama, test muhakemesi ve yazılım mimarisi için güçlü bir adaydır. Uzun bağlam, modelin birçok dosyayı, günlüğü ve gereksinimi bir arada tutması gerektiğinde yardımcı olur. Her otomatik tamamlama veya basit lint açıklaması için değil, zor kod görevleri için kullanın.

Ofis ve Bilgi İşleri

Modelin “Cowork” konumlandırması önemlidir. Kurumsal çalışanlar yalnızca sohbet soruları sormaz. PDF karşılaştırırlar, toplantıları özetler, slaytları gözden geçirir, e-tabloları yorumlar, sözleşmeleri kontrol eder, raporlar yazar ve dağınık kanıtlardan kararlar hazırlarlar. Qwen3.8-Max’in çok modlu ve uzun bağlam tasarımı, metin, belgeler, ekran görüntüleri ve yapılandırılmış verilerin birlikte muhakeme edilmesi gereken ofis iş akışları için uygundur.

Ajan tabanlı İş Akışları

Qwen3.8-Max, bir hedefi adımlara bölme, hangi aracı çağıracağına karar verme, sonuçları değerlendirme ve planı revize etme gibi ajan planlaması için kullanışlıdır. CometAPI’de, aynı uygulamanın basit adımları daha ucuz modellere yönlendirmesi ve planlama veya doğrulama için Qwen3.8-Max’i ayırması bunu daha pratik hâle getirir.

Başlangıç ve CometAPI Entegrasyon İpuçları

  1. Doğrudan erişim: qwen3.8-max model kimliğiyle QwenCloud veya Alibaba Cloud Model Studio kullanın. Hem OpenAI uyumlu hem de Anthropic uyumlu uç noktalar desteklenir.
  2. CometAPI ile birleşik erişim: CometAPI.com’a kaydolun, bir API anahtarı edinin, base_url’ü https://api.cometapi.com/v1 olarak ayarlayın ve model="qwen3.8-max" çağırın. Aynı anahtar DeepSeek V4 Flash, Kimi K3, Claude, GPT ve yüzlerce başka model için de çalışır — denemeler, maliyet kontrolü ve üretim yönlendirmesi için idealdir. CometAPI rekabetçi fiyatlar, düşük gecikme ve yeni modellerin hızlı eklenmesini vurgular (Qwen3.8-Max lansmandan kısa süre sonra listelendi).
  3. Ajan çerçeveleri: Doğrudan Claude Code, OpenClaw veya özel düzeneklere takın. Uzun vadeli karmaşık işler için daha yüksek akıl yürütme çabasını etkinleştirin.
  4. Açık ağırlıklar: Şirket içi veya ince ayarlı dağıtımlar gerekiyorsa, yakında yayımlanacak sürüm için Hugging Face / ModelScope’u takip edin.

Yapay zeka geliştirme maliyetlerinizi %20 azaltmaya hazır mısınız?

Dakikalar içinde ücretsiz başlayın. Ücretsiz deneme kredileri dahildir. Kredi kartı gerekmez.

Devamını Oku