Gemini 3.6 Flash and 3.5 Flash Lite are now live on CometAPI →

Kommer snart

Q

Qwen3.8-Max

Indtast:$60/M
Output:$240/M
Udgivet:Jul 19, 2026

Qwen3.8-Max-Preview er en forhåndsversion af Alibabas flagskibsstore sprogmodel, udgivet den 19. juli 2026. Den har 2.4T parametre, anvender MoE-arkitekturen, understøtter skift mellem tænkningstilstand og tilstand for hurtig inferens, kan håndtere forskellige indholdsformater og præsterer fremragende i scenarier som softwareudvikling, professionelt kontorarbejde og kompleks logisk ræsonnering, kun overgået af Anthropic Fable 5.

Ny
Kommersiel brug

Hvad er Qwen3.8 Max

Qwen3.8 Max er Alibabas nyeste flagskibs store sprogmodel (LLM). Den er designet til at konkurrere med de stærkeste førende modeller inden for kodning, ræsonnering, agent-arbejdsgange og multimodale opgaver (tekst, billeder, dokumenter og video).

Innovationer i forhold til tidligere Qwen:

  • Parameter-spring fra hundredvis af milliarder til billioner.
  • Stærkere fokus på professionelt “cowork” (kodning + kontorautomatisering).
  • Forpligtelse til åbne vægte for hele modellen (afvigelse fra noget Max-tier lukket kildekode-historik).

Funktioner og centrale innovationer i Qwen3.8-Max

  • 2.4 trillion total parameters (leverandør-rapporteret; aktive parametre/MoE-forhold endnu ikke fuldt offentliggjort).
  • Multimodale kapaciteter: Første Qwen-model med >1T parametre med indbygget understøttelse af tekst, billeder, video og dokumenter.
  • Målrettede styrker: Full-stack softwareudvikling, agentbaseret kodning, ræsonnering med lang kontekst, dataanalyse og kontorarbejdsgange. Den bygger videre på forgængernes succeser i benchmarks som SWE-Bench, GPQA og LiveCodeBench.
  • Forbedret ræsonnering og agentbaserede kapaciteter: Forbedringer i forståelse af lang kontekst, værktøjsbrug og flertrins-arbejdsgange. Stærk i professionelle opgaver ifølge Alibaba.
  • API-kompatibilitet: Understøttelse af OpenAI- og Anthropic-protokoller gør integrationen lettere — skift endepunkter med minimale kodeændringer.
  • Effektivitetsoptimeringer: Sparsom aktivering + Alibaba Cloud-infrastruktur for lavere latenstid/omkostning i skala.
AspektQwen3.8-Max (Forhåndsvisning)Qwen3.7-MaxKimi K3 (Moonshot)
Parametre2.4T~1T+ (tidligere)2.8T
MultimodalJa (billeder/video/dokumenter)Begrænset/TekstfokuseretJa (native vision/3D)
KontekstvindueStor (multimodal)262K+1M tokens
StyrkerAgentbaseret, kodning, produktivitet, multimodalLangt-horisont agenter, ræsonneringÅbne vægte, coding-arenaer, ræsonnering
Benchmarks (Eksempler)Stærk KingBench (~nr. 2), intern topGPQA 92.4, SWE-Pro 60.6Fører mange (Frontend Arena), konkurrencedygtig overordnet
Prissætning (API ca.)Forhåndsvisning ~10% af standardKonkurrencedygtig (~$1-5/M blandet)$3 ind / $15 ud pr. 1M
AdgangAlibaba-forhåndsvisning + CometAPIAlibaba + CometAPIAPI nu, åbne vægte snart
Bedst tilMultimodale arbejdsgange i virksomhederAgent-rammer, udviklingSelv-hosting, tilpasning

Qwen 3.8 Max-innovationer, der driver reel effekt og anvendelsestilfælde

  • Kodning og udvikling: Overlegen full-stack, fejlrettelser, forbedringer på Terminal-Bench.
  • Enterprise: Dataanalyse, kontorautomatisering via Qoder.
  • Multimodale apps: Billede-/videoforståelse til kreative formål/værktøjer.
  • Agenter: Lang kontekst muliggør komplekse, tilstandsbevarende agenter.

CometAPI-integrationstip: Brug CometAPI’s forenede endepunkt til at dirigere trafikken dynamisk — f.eks. fallback fra Qwen 3.8 til Qwen 3.7 eller Claude baseret på pris/ydeevne. Reducerer leverandørrisiko og optimerer forbruget.

Potentielle begrænsninger og overvejelser for Qwen 3.8 Max

Regulatoriske/geopolitiske faktorer (U.S.-kontroller). 3.8 til Qwen 3.7 eller Claude baseret på pris/ydeevne. Reducerer leverandørrisiko og optimerer forbruget.

Forhåndsvisningsfase: Ingen fulde uafhængige benchmarks.

Aktive parametre ikke oplyst → usikkerhed om omkostning/latenstid.

Selv-hosting er udfordrende i fuld skala.

Hvorfor bruge Qwen3.8 Max i CometAPI?

CometAPI er en samlet AI API platform/aggregator, der giver udviklere adgang til 500+ modeller (fra OpenAI, Anthropic, Google, Alibaba/Qwen, DeepSeek osv.) via ét OpenAI-kompatibelt endepunkt. Dette undgår håndtering af flere API-nøgler, faktureringskonti og integrationer.

Årsager til at vælge Qwen3.8 Max specifikt via CometAPI (eller lignende aggregatorer):

Bekvemmelighed og samlet adgang — Skift mellem Qwen3.8 Max og andre topmodeller (f.eks. Claude, GPT, Grok, Kimi) med én API-nøgle og et ensartet interface. Ideelt til test, A/B-sammenligninger eller produktionsapps, der har brug for fallback-modeller.

Konkurrencedygtig / rabatteret prissætning — Forhåndsvisningsadgang på Alibaba er allerede rabatteret (f.eks. 90% eller mere under kampagner). Aggregatorer som CometAPI tilbyder ofte attraktive priser, mængderabatter eller gratis niveauer sammenlignet med direkte leverandørpriser.

Udviklervenlig til produktion:

  • Nem integration i værktøjer som Cursor, Cline, Claude Code, agenter eller brugerdefinerede apps.
  • God til højtydende opgaver, hvor dens skala (ræsonnering, lang kontekst, multimodalitet, kodning) skinner.
  • Pålidelighed og oppetid fra aggregatorens infrastruktur.

Tidlig adgang til banebrydende model — Som en ny frontier-niveau udgivelse (særligt stærk i kodning/agentbaseret arbejde) giver den mulighed for at eksperimentere med state-of-the-art kapabiliteter uden direkte Alibaba Cloud-opsætning.

FAQ