Velg din plan

Hvordan distribuere Qwen 3.8 Max lokalt med Qwen3.8-2.4T-A95B åpne vekter, med GPU-krav, FP8/FP4, vLLM, SGLang, 1M kontekst, produksjonsoptimalisering.

Qwen 3.8 Max koster $2/M for inndata og $6/M for utdata. Sammenlign cache-gebyrer, verktøykostnader, konkrete eksempler, begrensninger og råd for migrering fra Qwen 3.7.

På månenyttårsaften (Feb 16–17, 2026) lanserte Alibaba Group sin neste generasjons modell, Qwen 3.5 — en multimodal, agentkapabel modell posisjonert for det selskapet kaller en "agentic AI"-æra. Bransjedekningen fremhevet påstander om store effektivitetsgevinster og kostnadsbesparelser, samt rask støtte fra maskinvare- og skyleverandører. CometAPI er et alternativ for utviklere som ønsker hostet API-tilgang eller en OpenAI-kompatibel integrasjon, mens AMD annonserte GPU-støtte fra dag 0 for modellen på sin Instinct-linje. ByteDance er en av de viktigste innenlandske konkurrentene som lanserte oppgraderinger i samme høytidsperiode. OpenAI forblir et referansepunkt for sammenligning i benchmarktester og integrasjonsstil.

Alibabas nye Qwen3.5 er et stort steg fremover — det lukker gapet til, og i noen agentbaserte / multimodale arbeidslaster hevder paritet eller fordel over, visse topp moderne proprietære modeller på en rekke offentlige referansetester og interne tester. Likevel avhenger «outperform» av arbeidslasten: på agentbasert verktøybruk, multimodal dokument-/videoforståelse og kostnad per inferens rapporteres Qwen3.5 å være svært konkurransedyktig (og i noen leverandørdiagrammer foran). Den praktiske konklusjonen: Qwen3.5 fremstår som en genuin frontier-kandidat tidlig i 2026 — for mange bedriftsrettede agentbaserte og multimodale brukstilfeller er den nå et viabelt primæralternativ.
Alibaba sin Qwen3-Max-Thinking — den «tenkende» varianten i den massive Qwen3-familien — har blitt en av årets store nyheter innen KI: et flaggskip med over en billion parametere, fininnstilt for dyp resonnering, forståelse av lange kontekster og agentbaserte arbeidsflyter. Kort sagt er dette leverandørens grep for å gi applikasjoner en langsommere, mer sporbar «System-2»-tenkemåte: modellen svarer ikke bare; den kan også vise (og bruke) steg, verktøy og mellomkontroller på en kontrollert måte.

Alibabas Qwen-team har lansert Qwen3-Max-Preview (Instruct) – selskapets største modell hittil, med mer enn 1 billion parametere – og gjort den ...

Qwen3-Max-Preview er Alibabas nyeste flaggskip-forhåndsvisningsmodell i Qwen3-familien – en modell i Mixture-of-Experts (MoE)-stil med over billioner parametere og et ultralangt kontekstvindu på 262 XNUMX tokener, utgitt i forhåndsvisning for bruk i bedrifter/skyen. Den fokuserer på *dyp resonnering, forståelse av lange dokumenter, koding og agentiske arbeidsflyter.

Alibabas nyeste fremskritt innen kunstig intelligens, Qwen3-Coder, markerer en betydelig milepæl i det raskt utviklende landskapet av AI-drevet programvare.