GPT-6 Sol, GPT-6 Luna, and Claude Opus 5.5 are now live on CometAPI →

Qwen Blogg

Slik kjører du Qwen 3.8 Max lokalt: maskinvare, vLLM, SGLang og kvantiseringsguide
Sep 25, 2026
qwen 3.8 Max
qwen3.8 max

Slik kjører du Qwen 3.8 Max lokalt: maskinvare, vLLM, SGLang og kvantiseringsguide

Hvordan distribuere Qwen 3.8 Max lokalt med Qwen3.8-2.4T-A95B åpne vekter, med GPU-krav, FP8/FP4, vLLM, SGLang, 1M kontekst, produksjonsoptimalisering.

Qwen4 kommer   snart: Hva Qwen3.8-Flash-Next avslører
Sep 6, 2026
Qwen4

Qwen4 kommer snart: Hva Qwen3.8-Flash-Next avslører

Utforsk hva Qwen3.8-Flash-Next avslører om Qwen4s arkitektur, forventede funksjoner, benchmarkstrategi og lanseringsutsikter

Hva er Qwen3.8-Flash? Spesifikasjoner, benchmark-resultater, arkitektur, priser og API-veiledning
Sep 6, 2026
Qwen3.8-Flash
Qwen

Hva er Qwen3.8-Flash? Spesifikasjoner, benchmark-resultater, arkitektur, priser og API-veiledning

Lær hva Qwen3.8-Flash er, inkludert 6B-aktiv MoE-arkitektur, 1M kontekst, benchmark-resultater, priser, sammenligninger og bruk av CometAPI.

Det finnes ikke en allment kjent modell som heter «Qwen3.8 Max». Mener du kanskje «Qwen 3.5 Max» (evt. «Qwen2.5 Max»)? Det er en toppmodell i Qwen‑familien fra Alibaba Cloud, der «Max» vanligvis betegner den kraftigste generelle språkmodellen i serien, brukt til avansert resonnering, kodehjelp og lengre samtaler via deres API. Hvis du sikter til noe annet, gi gjerne litt mer kontekst.
Sep 3, 2026
qwen3.8 max

Det finnes ikke en allment kjent modell som heter «Qwen3.8 Max». Mener du kanskje «Qwen 3.5 Max» (evt. «Qwen2.5 Max»)? Det er en toppmodell i Qwen‑familien fra Alibaba Cloud, der «Max» vanligvis betegner den kraftigste generelle språkmodellen i serien, brukt til avansert resonnering, kodehjelp og lengre samtaler via deres API. Hvis du sikter til noe annet, gi gjerne litt mer kontekst.

Qwen3.8-Max forklart: funksjoner, ytelsestester og sammenligning av Kimi K3 og DeepSeek V4 Flash

Qwen 3.8 Max API-priser: $2 inndata, $6 utdata, 1M kontekst
Sep 3, 2026
qwen 3.8 Max

Qwen 3.8 Max API-priser: $2 inndata, $6 utdata, 1M kontekst

Qwen 3.8 Max koster $2/M for inndata og $6/M for utdata. Sammenlign cache-gebyrer, verktøykostnader, konkrete eksempler, begrensninger og råd for migrering fra Qwen 3.7.

Qwen3.8 Max Preview API: Tilgang, tilgjengelighet og migreringsveiledning
Sep 3, 2026
Qwen‑TTS

Qwen3.8 Max Preview API: Tilgang, tilgjengelighet og migreringsveiledning

Kort svar – Jeg har ikke sanntids­tilgang til produktendringer etter okt. 2024. Jeg kan derfor ikke bekrefte om “Qwen3.8 Max” er lansert eller allment tilgjengelig nå. Sjekk offisielle kilder nedenfor for oppdatert status. Slik sjekker du tilgjengelighet og pris - DashScope (Alibaba Cloud 灵积) modellkatalog: dashscope.aliyun.com → Model/Marketplace → søk etter “Qwen3.8 Max”. - DashScope prisoversikt: dashscope.aliyun.com eller help.aliyun.com → Pricing/计费 → filtrer på Qwen-/Max-modeller og region. - Qwen offisiell side/kunngjøringer: qwen.ai og GitHub/Blog for modellnavn og endringslogg. - Konsoll/Project billing: Alibaba Cloud Console → DashScope/Usage & Billing for konkrete satser i din region/konto. Typisk prisstruktur (hva du bør lete etter) - Pris per 1K input‑tokens og per 1K output‑tokens, ofte høyere for “Max”. - Egen prislinje for OpenAI‑kompatibelt endepunkt vs. DashScope‑SDK. - Eventuelle gratiskvoter, prøvegrenser og overforbrukspriser. - Region‑ og valutavariasjon samt sats for multimodale kall (hvis støttet). Tilgangsmetoder (vanlig for Qwen‑serien) - DashScope native API/SDK: - Skaff en API‑nøkkel (Alibaba Cloud AccessKey → DashScope). - Kall via REST eller offisielle SDK-er (Python/Java/Go). Sett miljøvariabel for nøkkelen og bruk modellnavnet slik det vises i konsollen. - OpenAI‑kompatibelt grensesnitt: - Aktiver “OpenAI Compatible” i DashScope. - Bruk valgfri OpenAI‑klient ved å sette base_url til adressen oppgitt i konsollen og api_key til din DashScope‑nøkkel. - Angi modellnavn nøyaktig som listet i konsollen (ikke anta navn). - Enterprise/private deployment: - Dersom tilgjengelig, kontroller om 3.8 Max støttes i bedriftsinstans, regionkrav og nettverks‑allowlist. Nøkkelspesifikasjoner å verifisere før bruk - Kontekstvindu (maks tokens), støttede modaliteter (tekst/bilde/lyd), og maksimal output‑lengde. - Funksjonskall/verktøybruk, JSON‑modus/structured outputs, og streaming‑støtte. - Systemmeldingsstørrelse, rolleformat og kompatibilitet med OpenAI‑stilen (messages[]). - Hastighet/latens, gjennomstrømning, batch/parallel‑kall og rate limits. - Sikkerhet/innholdsfiltre og konfigurerbarhet. - Kjente bruddendringer i API‑responsformat (felt-/nøkkelnavn), tokenizer‑endringer og default‑verdier (temperature, top_p osv.). Bør du migrere fra Qwen3.7 Max? - Anbefaling: Gjør en målrettet A/B‑evaluering på dine egne promptsett. - Kvalitet: Sammenlign nøyaktighet, konsistens, format‑etterlevelse (spesielt ved JSON/structured output). - Kostnad: Beregn pris per oppgave (input+output tokens) og eventuelt høyere sats for “Max”. - Ytelse: Mål latens og gjennomstrømning under dine reelle lastmønstre. - Kompatibilitet: Bekreft at verktøy/func‑kall, systemmeldinger og sikkerhetskrav fungerer uten regresjoner. - Migrer hvis 3.8 Max dokumentert gir bedre kvalitet/kapabiliteter (f.eks. lengre kontekst, bedre verktøybruk, mer robust JSON‑modus) til akseptabel kost og uten kritiske brudd i arbeidsflyten. - Hold fallback til 3.7 Max i produksjon inntil 3.8 er verifisert. Minimal migreringssjekkliste - Oppdater modellnavn i alle kall (prod, batch, eval, agent/worker). - Valider responsfelter og parser (message.content, tool_calls/arguments, finish_reasons). - Re‑tune samplingparametere (temperature/top_p) for samme stil/format. - Test structured outputs/JSON‑modus og strenge schema‑valideringer. - Re‑beregn kost per oppgave og sett kvoter/alarmer i billing. - Kjør regressjonstester på sikkerhet, verktøybruk og longitudinale oppgaver. - Plan for gradvis utrulling og automatisk fallback. Konklusjon - Jeg kan ikke bekrefte her og nå om Qwen3.8 Max API er tilgjengelig eller hva gjeldende pris er. Sjekk DashScope‑konsollen, den offisielle prisoversikten og Qwen‑kunngjøringer. Bruk sjekklisten over for spesifikasjoner og en trygg migreringsbeslutning fra Qwen3.7 Max.

Qwen3.7 Plus API-priser 2026: Kostnader, Cache & Batch
Sep 3, 2026
Qwen

Qwen3.7 Plus API-priser 2026: Kostnader, Cache & Batch

Se hvordan kostnadene for Qwen3.7 Plus API varierer etter Alibaba-rute, kontekstlengde, cache-bruk og Batch jobs, med CometAPI-priser inkludert for sammenligning.

Hvordan koble Open WebUI til AI-modeller ved hjelp av CometAPI
Sep 3, 2026
GPT-5.5
Claude Opus 4.7
Qwen
deepseek

Hvordan koble Open WebUI til AI-modeller ved hjelp av CometAPI

Lær hvordan du kobler Open WebUI til 500+ AI-modeller ved hjelp av CometAPI. Konfigurer den OpenAI-kompatible gatewayen for å spare 20–40 % på API-kostnader i produksjon.