TLDR: Alibabaโs Qwen3.8-Max (preview, 2.4 trillion parameters, multimodaal met beeld-/video-/documentinvoer) neemt het op tegen Moonshot AIโs Kimi K3 (2.8T parameters, open gewichten binnenkort, 1M context). Qwen3.8-Max excelleert in multimodale en productiviteitstaken met preview-prijzen van ~10% van de standaardtarieven, terwijl Kimi K3 op sommige open benchmarks en qua openheid voorligt.
Beide zijn frontiermodellen die vandaag via APIโs toegankelijk zijn. Voor betrouwbare, kostenefficiรซnte integratie biedt CometAPI naadloze Qwen-toegang met OpenAI-compatibele endpoints, concurrerende prijzen en eenvoudige opschaling voor ontwikkelaars en bedrijven.
Belangrijkste punten:
- Schaal & mogelijkheden: Volgens bericht op X brengt Qwen3.8-Max native multimodaal (afbeeldingen, video, documenten) naar een model met 2,4T parameters; Qwen3.7-Max blinkt uit in agent-gestuurd coderen en langetermijntaken.
- Prijzen & toegang: Qwen3.8-Max heeft concurrerende API-tarieven (~$2.50/$7.50 per 1M input/output, vaak met korting); preview van Qwen 3.8 tegen gereduceerde tarieven via Token Plan/Qoder.
- Vs. Kimi K3: Kimi K3 (2.8T, open gewichten 27 juli 2026) verslaat vaak benchmarks, maar Qwen biedt sterkere multimodale en ecosysteemintegratie; Qwen is in veel API-scenarioโs goedkoper.
- Toegang vandaag: Preview op Alibaba Cloud/Token Plan/Qoder met kortingen; compatibel met OpenAI/Anthropic API.
- Praktische voordelen: Superieur voor full-stack development, kantoorautomatisering, videoanalyse en agent-workflows.
Wat is Qwen 3.8 Max?
Qwen 3.8 Max, officieel gepreviewd als Qwen3.8-Max-Preview, is het nieuwste vlaggenschip-LLM van Alibabaโs Qwen-team. Aangekondigd op de World AI Conference in Shanghai rond 19 juli 2026, betekent het een enorme sprong in schaal ten opzichte van de Qwen 3.7-serie.
Kernspecificaties
- Parameters: 2,4 biljoen totaal โ een van de grootste publiek besproken modellen, op รฉรฉn na na Moonshot AIโs Kimi K3 met ~2.8T.
- Architectuur: Sparse Mixture-of-Experts (MoE). Slechts een subset van de parameters wordt per token geactiveerd, wat kracht en efficiรซntie balanceert (het exacte aantal actieve parameters is nog niet bekend โ een sleutel voor inferentiekosten).
- Multimodale mogelijkheden: Verwerkt tekst, afbeeldingen, videoโs en documenten native. Dit is Qwenโs eerste model met >1T parameters met sterke multimodale ondersteuning.
- Contextvenster: Tot 1 miljoen tokens, geรซrfd en verfijnd vanuit Qwen 3.7 Max.
- Varianten: Vlaggenschip 2.4T Max plus een kleinere ~27B-variant voor lichtere use-cases.
Hoe Qwen 3.8 Max werkt: innovaties en technisch voordeel
Qwen3.8-Max benut decennia aan schaalervaring van Alibaba:
- Enorme schaal met efficiรซntie: 2.4T parameters via MoE โ slechts een subset wordt per token geactiveerd, wat kracht en inferentiekosten balanceert (vergelijkbaar met eerdere Qwen-MoE zoals 235B-A22B).
- Hybride redeneren: Erft โThinking/Non-Thinkingโ-modi voor flexibele controle over diepte, snelheid en kosten. Perfect voor agent-gestuurde taken die meerstapsplanning vereisen.
- Multimodale integratie: Geรผnificeerde verwerking van tekst + visie + video. Maakt rijkere applicaties mogelijk zoals documentanalyse met afbeeldingen of videogerichte redenering.
- Lange context en agent-focus: Geoptimaliseerd voor langetermijntaken (bijv. volledige app-kloning, complexe workflows). Ondersteunt geavanceerde tool use, RAG en function calling.
- Trainingsverbeteringen: Gebouwd op omvangrijke meertalige data (119+ talen), verbeterde positionele embeddings en technieken die hallucinaties verminderen en STEM/coderen versterken.
Hoe werkt het in de praktijk:
- Input โ tokenizer + embeddings โ MoE-router selecteert experts โ transformer-lagen verwerken โ outputgeneratie.
- Ondersteunt agent-gestuurd coderen (bijv. full-stack projecten), data-analysepijplijnen en kantoorautomatisering.
Community Reddit-tests tonen veelbelovende ruwe kracht in coderen en complexe vragen, al melden sommigen incidentele denkloops in vroege preview.
Voor ontwikkelaars: combineer met tools zoals CometAPI voor betrouwbare, uniforme toegang over providers heen, met lagere latency en kosten, terwijl je Qwen naast Claude, GPT, enz. test.
Prijzen en toegang: wat je vandaag daadwerkelijk kunt gebruiken
Beschikbaarheid in preview (per juli 2026):
- Alibaba Token Plan: Kredietgebaseerd abonnement.
- Lite: $6 voor 2.500 credits/week.
- Pro: $68 voor 40.000 credits/week (ondersteunt 6โ8 gelijktijdige agents).
- Korting: 10% van de standaardprijs tijdens de preview.
- Platforms: Qwen Chat, Alibaba Cloud, Qoder (coderen), QoderWork (productiviteit).
- API: Compatibel met OpenAI/Anthropic. Nog geen afzonderlijke per-token tarieven gepubliceerd voor 3.8-Max (voorganger: ~$1.25/M input, $3.75/M output).
Open gewichten: โBinnenkortโ beloofd โ groot voor self-hosting/fine-tuning, al zijn de hardware-eisen extreem (~1,2TB bij 4-bit).
CometAPI-aanbeveling: Voor productie, sla directe vendormanagement over. CometAPI levert รฉรฉn API-sleutel voor 500+ modellen, inclusief de Qwen-serie. Geรผnificeerde facturatie, endpoints en betrouwbaarheid โ ideaal om Qwen 3.8 Max A/B te testen versus anderen zonder codewijzigingen. Perfect voor Cometapi.com-gebruikers die AI-apps bouwen. Meld je aan op cometapi.com voor naadloze integratie.
Dit maakt Qwen toegankelijk zonder verplichting aan Alibaba Cloud, ideaal voor startups en wereldwijde developers.
Verslaat Qwen3.8 Max Kimi K3?
Qua aantal parameters: nee
Als de vraag is โheeft Qwen3.8 Max meer parameters dan Kimi K3?โ, dan is het antwoord simpel: nee. Qwen3.8-Max-Preview wordt door Qoder gemeld als een model met 2.4T parameters. Kimi K3 wordt door Moonshot gedocumenteerd als een model met 2.8T parameters. Op totale parameters alleen is Kimi K3 400 miljard parameters groter.
Dat maakt Kimi K3 niet automatisch beter in elke taak. Het parameteraantal is op zichzelf geen scorebord. Trainingsdata, architectuur, expert-routering, actieve parameters per token, post-training, inferentiestack, toolharnassen en contextmanagement beรฏnvloeden de echte performance. Een kleiner model kan een groter model verslaan op sommige taken als het betere data, betere post-training, betere tools of betere inferentie-tijdredenering heeft.
Op basis van publieke bewijzen: Kimi K3 ligt nu voor
Kimi K3 heeft op dit moment het betere pakket aan publieke bewijzen. Moonshotโs Kimi K3-gids en technische blog onthullen architectuur, context, visie, expertactivatie, API-limieten en releaseplannen. OpenLMโs Kimi K3-pagina spiegelt een gedetailleerde benchmarktabel over coderen, agentisch werk, redeneren, kenniswerk en visie. Kimi K3โs Frontend Code Arena-score van 1,679 punten en de samenvatting van het 1M-contextvenster, 16/896 expertactivatie en prijsindicaties springen eruit.
Qwen3.8-Max-Preview is zeer belangrijk, maar de preview is minder gedocumenteerd. De sterkste huidige bronnen zijn Qoderโs launchpagina en Alibaba Cloud Model Studioโs OpenCode-configuratie. Die zijn waardevol, maar bieden nog niet hetzelfde niveau van benchmarkdetails, disclosure van actieve parameters, architectuuruitleg, licentievoorwaarden of CometAPI-productieroute als Kimi K3.
| Aspect | Qwen3.8-Max (preview) | Qwen3.7-Max | Kimi K3 (Moonshot) |
|---|---|---|---|
| Parameters | 2.4T | ~1T+ (eerder) | 2.8T |
| Multimodaal | Ja (img/video/docs) | Beperkt/tekstgericht | Ja (native vision/3D) |
| Contextvenster | Groot (multimodaal) | 262K+ | 1M tokens |
| Sterktes | Agentisch, coderen, productiviteit, multimodaal | Lange-horizon agents, redeneren | Open gewichten, code-arenas, redeneren |
| Benchmarks (voorbeelden) | Sterk op KingBench (~2e), intern top | GPQA 92.4, SWE-Pro 60.6 | Leidt er veel (Frontend Arena), over het geheel competitief |
| Prijzen (API ca.) | Preview ~10% standaard | Competitief (~$1โ5/M gemengd) | $3 in / $15 uit per 1M |
| Toegang | Alibaba-preview + CometAPI | Alibaba + CometAPI | API nu, open gewichten binnenkort |
| Beste voor | Multimodale enterprise-workflows | Agent-scaffolds, dev | Self-host, maatwerk |
Belangrijkste verschillen:
- Openheid: Kimi K3 wint met aanstaande volledige open gewichten voor self-hosting/fine-tuning. Qwen3.8-Max nu preview, open binnenkort.
- Multimodaal: Beide sterk; Qwen3.8 benadrukt video-/doc-integratie.
- Prestaties: Kimi K3 leidt vaak op ruwe benchmarks (bijv. GPQA, coding-arenas); Qwen competitief of superieur in agent-/productiviteitsscaffolds en specifieke taken zoals spreadsheets/kernel-opt. Qwen is goedkoper in API-gebruik (bijv. 3x in sommige vergelijkingen).
- Context & snelheid: Kimi 1M context; Qwen sterk in lange context (262K+ eerder). Qwen geeft vaak sneller output.
- Use-cases: Qwen voor geรฏntegreerd Alibaba-ecosysteem, kantoorautomatisering, multimodale enterprise. Kimi voor open-source-enthousiastelingen en maximale aanpasbaarheid.
Conclusie: moet je Qwen 3.8 Max adopteren?
Ja voor experimenten en code-/multimodale behoeften โ vooral via toegankelijke platforms zoals CometAPI. Het is nog geen volledige vervanging voor gesloten frontiermodellen, maar wel een krachtig, betaalbaar alternatief dat het ecosysteem vooruit stuwt. Blijf uitkijken naar benchmarks en de volledige release.
