Qwen3.8-Flash-Next Teknik Özellikler
| Özellik | Qwen3.8-Flash-Next |
|---|---|
| Geliştirici | Qwen Ekibi, Alibaba Group |
| Model türü | Görsel kodlayıcıya sahip çok modlu nedensel dil modeli; ultra-seyrek MoE |
| Ana model parametreleri | 125B |
| Etkinleştirilen parametreler | token başına 6B |
| N-gram gömme parametreleri | 51B ek |
| MTP parametreleri | 4B |
| Katmanlar | 48 |
| Hibrit dikkat deseni | 12 x [3 Gated DeltaNet katmanı + 1 Qwen Sparse Attention katmanı] |
| MoE uzmanları | Toplam 512; token başına 10 yönlendirilen + 1 paylaşılan |
| Gated Residual | 4 kol; bottleneck rank 320 |
| Yerel bağlam penceresi | 262,144 token |
| Genişletilmiş bağlam | YaRN ile 1,000,000 tokene kadar |
| Modaliteler | Metin, görsel, video girişi; metin çıkışı |
| Düşünme kontrolleri | Desteklenen API'lerde düşünme/düşünmeme ile akıl yürütme çabası kontrolleri |
| Dağıtım | Transformers, vLLM, SGLang, TokenSpeed ve diğer desteklenen çerçeveler |
| Açık ağırlıklar | Evet |
| CometAPI model kimliği | qwen3.8-flash-next |
Qwen3.8-Flash-Next Nedir?
Qwen3.8-Flash-Next, Alibaba'nın Qwen ekibinden yakında çıkacak açık ağırlıklı çok modlu bir MoE modelidir. Daha da önemlisi, yalnızca başka bir artımlı Qwen3.8 kontrol noktası olmaktan ziyade, gelecekteki Qwen4 model ailesini güçlendirmesi amaçlanan mimarinin erken bir ön gösterimi olarak konumlandırılmaktadır.
Qwen, daha geniş Qwen4 ailesi gelmeden önce açık kaynak ekosistemine yeni nesil mimari yönünü açığa çıkarmak için bu sürümü kullanıyor. Bu, çıkarım motoru geliştiricilerine, kuantizasyon projelerine, model sunum çerçevelerine ve uygulama geliştiricilerine mimari değişikliklere önceden hazırlanma fırsatı verir.
Halihazırda açıklanan mimari iki önemli bileşen tanıtıyor: bir GDN tabanlı hibrit mimari ve Qwen Sparse Attention (QSA). GDN, Qwen3-Next ile daha önce araştırılan hibrit-dikkat yönünü izleyen, DeltaNet tarzı kapılı doğrusal dikkat yaklaşımını ifade eder. QSA ise yeni bir seyrek dikkat mekanizması olarak sunuluyor; ancak tam teknik özellikleri henüz kamuya açık şekilde belgelendirilmedi.
Qwen3.8-Flash-Next'in Başlıca Özellikleri
- Qwen4 mimarisi ön izlemesi: Qwen3.8-Flash-Next, yaklaşmakta olan Qwen4 ailesini güçlendirecek mimari yönün erken bir uygulaması olarak açıkça konumlandırılmıştır.
- Çok modlu MoE tasarımı: Model, Qwen'in verimli seyrek model stratejisini yeni bir mimari nesle genişleten çok modlu bir Uzman Karışımı modeli olarak tanımlanır.
- GDN hibrit mimarisi: Model, Qwen3-Next ile tanıtılan hibrit dikkat araştırma yönünü sürdürerek, kesin geri çağrımın önemli olduğu yerlerde geleneksel dikkat ile verimli doğrusal dikkat mekanizmalarını birleştirir. Qwen3-Next, bu yaklaşımın uzun bağlam çıkarım verimliliğini önemli ölçüde artırabildiğini göstermiştir.
- Qwen Sparse Attention: QSA, Flash-Next için kamuoyuna açıklanan iki mimari değişiklikten biridir. Ayrıntılı uygulaması ve nicel faydaları Qwen tarafından belgelenmeyi beklemektedir.
- Açık ağırlık ekosistemi odaklı: Sürüm, açık kaynak topluluğuna mimari değişikliklere erken erişim vererek, Qwen4 gelmeden önce çıkarım çalışma zamanlarının ve aşağı akış araçlarının uyum sağlamasına olanak tanır.
- Qwen3.8-Flash-Next için Kodlama ve Aracı Performansı
| Kıyaslama | Qwen3.8-Flash-Next | Qwen3.8-27B | Qwen3.7-Plus | DeepSeek V4 Flash | Claude Opus 4.6 |
|---|---|---|---|---|---|
| DeepSWE 1.1 | 58.7 | 42.2 | 16.5 | 54.4 | -- |
| SWE-bench Pro | 62.5 | 61.7 | 55.8 | 56.0 | 53.4 |
| SWE-bench Multilingual | 81.0 | 73.8 | 75.8 | -- | 77.5 |
| NL2Repo-Bench | 48.1 | 42.3 | 41.1 | 54.2 | 47.6 |
| CoWorkBench | 73.9 | 70.7 | 65.1 | 45.1 | 68.2 |
| JobBench | 55.7 | 33.4 | 27.6 | 41.3 | 36.6 |
| Toolathlon Verified | 73.5 | 67.1 | 50.6 | 70.3 | -- |
| IFBench | 81.3 | 79.5 | 79.1 | 79.2 | 62.5 |
| GPQA Diamond | 91.7 | 89.2 | 90.3 | 90.8 | 91.3 |
| HLE | 35.9 | 30.8 | 34.7 | 33.8 | 40.0 |
| LiveCodeBench v6 | 91.9 | 90.3 | 89.6 | 90.6 | 88.8 |
Qwen3.8-Flash-Next ile Qwen3.8-Max ve Qwen3.8-27B
| Model | Konumlandırma | Mimari / Ölçek | Çok modlu | Mevcut durum |
|---|---|---|---|---|
| Qwen3.8-Flash-Next | Qwen4 mimarisi ön izlemesi / verimlilik odaklı açık model | Çok modlu MoE; tam teknik özellikler beklemede | Evet | Yakında |
| Qwen3.8-Max | Barındırılan amiral gemisi Qwen3.8 modeli | Büyük ölçekli MoE | Evet | Mevcut |
| Qwen3.8-27B | Açık ağırlıklı Qwen3.8 modeli | 27B yoğun model | Modele özgü yetenekler | Mevcut |
Qwen3.8-Max, Alibaba'nın bulut ekosistemi üzerinden hâlihazırda kullanılabilir ve ileri düzey akıl yürütme, görsel anlama, kodlama ve ajan iş yükleri için konumlandırılmıştır. Qwen'in mevcut belgeleri Qwen3.8-Max'i 1M-token bağlam penceresiyle listelerken, CometAPI zaten qwen3.8-max'i sunuyor.
Bu nedenle Flash-Next farklı görülmelidir: şu aşamadaki temel önemi kıyaslamaya dayalı olmaktan ziyade mimariseldir. Qwen4'ün teknik yönünü önceden gösterir ve açık kaynak ekosistemi için çalışma zamanı ve dağıtım optimizasyonuna daha erken bir hedef sunar.