TLDR Den 27. september 2026 lancerede MiniMax stille, men officielt, M3.1-Flash-Preview i MiniMax Code (og via Token Plan). Det er en banebrydende multimodal kodningsmodel med et fuldt kontekstvindue på 1 million tokens, indbygget understøttelse af tekst-/billede-/video-input og en ny femtrins styring af resoneringsindsats (low → max). Modellen er eksplicit positioneret til hverdagens udviklingsarbejdsgange—fra fejlfiksning over implementering til test og levering—og prioriterer hastighed og omkostningseffektivitet, mens den altid holder thinking aktiveret.
Tilgængeligheden er for nu begrænset til Token Plan + MiniMax Code (med API-understøttelse via Subscription Key); fuld offentlig prissætning og åbne vægte er endnu ikke offentliggjort. CometAPI har allerede modellen (minimax-m3.1-flash-preview) til konkurrencedygtige priser, hvilket gør samlet adgang enkel.
Vigtige pointer
- 1M-token-kontekst + indbygget multimodalitet — Håndterer store kodebaser, lange agent-sessioner, dokumenter, billeder og video i ét vindue.
- Fem-niveaus resoneringsindsats (low / medium / high / xhigh / max, standard max) — Afvej latens og tokenforbrug mod dybere overvejelse efter behov. Thinking kan ikke deaktiveres.
- Fokus på daglig kodning — Eksplicit optimeret til den lukkede sløjfe buglokalisering → implementering → test → levering i MiniMax Code.
- Preview-begrænsninger — Bekræftet i MiniMax Code og Token Plan; API-kald kræver en Subscription Key. Ingen selvstændigt modelkort, offentlige benchmarks, åbne vægte eller frittstående pay-as-you-go-priser annonceret ved lancering.
- CometAPI-anbefaling — Adgang via et enkelt OpenAI-kompatibelt endepunkt (model ID: minimax-m3.1-flash-preview) med rabatpriser, ideelt for teams, der allerede bruger CometAPI’s katalog på 500+ modeller.
Hvad er MiniMax M3.1-Flash-Preview?
MiniMax M3.1-Flash-Preview er det nyeste medlem i MiniMax’s M-serie af store sprogmodeller. Den officielle dokumentation beskriver den som en “frontier multimodal kodningsmodel med 1M kontekstvindue og justerbar tænkningsdybde.” Den blev først opdaget af udviklere i MiniMax Code’s modelvælger og formelt bekræftet af den officielle @MiniMaxAgent-konto på X den 27. september 2026:
“MiniMax’s latest text model, M3.1-Flash-Preview, debuts today on MiniMax Code. Built for everyday development, it’s fast, reliable, and ready for real work, from quick bug fixes to full features.”
I modsætning til en generel chatmodel er den formålsbygget til software engineering og agent-baserede arbejdsgange. MiniMax’s produktbudskab fremhæver udvikleropgaver i den virkelige verden: hurtige fejlfiks, feature-implementering, håndtering af grænsetilfælde, regressionstest og verifikation af ændringer. “Flash”-betegnelsen signalerer fokus på hastighed og daglig praktikalitet i forhold til den tungere MiniMax-M3 flagskibsmodel, mens den stadig arver M3-familiens store kontekst og kodningsstyrker.
Modellen understøtter:
- Op til 1,000,000 tokens i kontekst — egnet til hele kodebaser, lange dokumenter og flertrins agent-sessioner.
- Indbygget multimodalt input (tekst, billeder og video).
- Agentisk ræsonnering, værktøjskald og struktureret opgaveudførelse.
- Altid-aktiv dyb tænkning, der kan justeres via en femtrins indsatsregulering.
Thinking-indhold returneres separat (som reasoning_content i OpenAI-kompatibel tilstand eller thinking-blokke i Anthropic-kompatibel tilstand), så den endelige besvarelse forbliver ren til visning eller downstream-brug.
1M-token-kontekst + kodeorientering
Den mest markante tekniske specifikation er det 1,000,000-token store kontekstvindue. Dette matcher MiniMax-M3 og er langt større end de fleste konkurrerende kodningsmodeller. Officiel dokumentation fremhæver egnetheden til:
- Hele koderepositorier
- Lange flertrins agent-sessioner
- Store dokumenter og vidensbaser
- Multimodalt input (tekst + billeder + video) i samme kontekst
Denne langkontekst-kapabilitet kombineret med indbygget multimodalitet muliggør arbejdsgange, der tidligere krævede tung kontekthåndtering eller eksterne retrieval-systemer. Udviklere kan holde store kodebaser, designmockups, fejlskærmbilleder og relateret dokumentation levende i én samtale.
Modellen er eksplicit optimeret til agent- og kodningsscenarier: værktøjskald, struktureret output og fleromgangs engineering-opgaver. Output-hastighedstal for beslægtede modeller (M3 ≈ 100+ TPS, M2.7-highspeed ≈ 100 TPS) antyder, at Flash-varianter sigter mod den højere ende af latens/gennemløbsspektret, om end præcise TPS-tal for M3.1-Flash-Preview endnu ikke er offentliggjort.
Fem-niveaus resoneringsindsats
En af de mest praktiske nye funktioner er den justerbare tænkningsdybde, styret af effort (Anthropic-kompatibel) eller reasoning_effort (OpenAI-kompatibel)-parameteren. De fem niveauer er:
| Level | Typical Use Case | Trade-off |
|---|---|---|
| low | Enkle syntaksrettelser, hurtige opslag | Laveste latens og tokenforbrug |
| medium | Rutinemæssige refaktoriseringer, små features | Afbalanceret |
| high | Kompleks logik, ændringer på tværs af flere filer | Dybere analyse |
| xhigh | Svær fejlfinding, arkitekturbeslutninger | Højere compute og latens |
| max | Højrisiko eller tvetydige problemer (standard) | Maksimal deliberation |
Thinking er altid aktiveret for M3.1-Flash-Preview; forsøg på at deaktivere den returnerer en 400-fejl. Højere indsatsniveauer genererer flere interne reasoning-tokens og øger latensen, hvilket giver udviklere finjusteret kontrol, som var mindre granulær på tidligere M-serie-modeller.
I MiniMax Code fremstår kontrollen som en simpel slider eller vælger; via API sendes den i request-body’en. Dette design afspejler den voksende branchetrend med at eksponere “reasoning budget”-knapper, så brugere kan matche modeladfærd til opgavens sværhedsgrad og omkostningsrammer.
Daglig udviklingsworkflow
MiniMax placerer M3.1-Flash-Preview solidt i den daglige udviklingssløjfe snarere end som en ren forsknings- eller langhorisont-agentmodel. Det officielle budskab og produktplaceringen understreger en lukket oplevelse i MiniMax Code: Bug Fixing → Implementering → Test → Levering:
- Buglokalisering — Indsæt stack traces, fejlskærmbilleder eller relevante kodestykker; modellen kan ræsonnere over stor kontekst for at identificere rodårsager.
- Implementering — Generér eller redigér kode på tværs af flere filer, mens projektsammenhængen bevares.
- Test og verifikation — Foreslå eller skriv tests, kør regressionstjek og analyser påvirkning.
- Levering — Producer rene diffs, commit-beskeder eller dokumentation klar til review.
Kombinationen af 1M kontekst, multimodalt input (fx skærmbilleder af fejlende UI’er) og justerbar indsats gør modellen særligt effektiv til de højfrekvente, latensfølsomme opgaver, der dominerer de fleste ingeniørdage. Lanceringen ledsages af tidsbegrænsede kampagner (dobbelte daglige check-in-kreditter 28. september–7. oktober UTC+8 og Token Plan-kvota-reset), som opmuntrer til afprøvning i praksis.
Aktuel tilgængelighed og Preview-begrænsninger
Bekræftet pr. slutningen af september 2026:
- Valgbar i MiniMax Code (modelvælger sammen med M3, M2.7 osv.).
- Tilgængelig via Token Plan / Subscription Key.
- Dokumenteret i de officielle MiniMax API-referencesider med OpenAI-kompatible og Anthropic-kompatible eksempler.
- Tænkningsdybde kan styres via
reasoning_efforteller tilsvarende felter. - Kampagner: Token Plan-kvoter nulstilles, og dobbelte check-in-point (28. september – 7. oktober) kan bruges på den nye model.
Bekræftet API-sti: Officiel dokumentation angiver modelnavnet MiniMax-M3.1-Flash-Preview og tilbyder både Anthropic-kompatible (https://api.minimax.io/anthropic) og OpenAI-kompatible (https://api.minimax.io/v1) endepunkter. En Subscription Key (Token Plan) kræves. Eksempelparametre inkluderer output_config.effort eller reasoning_effort. Thinking-indhold returneres separat (thinking-blokke eller reasoning_content).
Stadig begrænset eller ubekræftet:
- Fuldt selvstændigt offentligt benchmark-sæt og modelkort med parameterantal.
- Frittstående pay-as-you-go prisside med samme transparens som MiniMax-M3.
- Åbne vægte (ikke annonceret for dette Preview).
Preview-status betyder, at funktioner, kvoter og priser stadig kan ændre sig. Udviklere bør betragte nuværende ydeevne som vejledende snarere end endelig.
Sådan får du adgang til MiniMax M3.1-Flash-Preview
1. I MiniMax Code (lettest til interaktiv brug)
Download eller åbn MiniMax Code (desktopapps til macOS og Windows). Vælg M3.1-Flash-Preview i modelvælgeren og justér indsatsniveauet. Daglige check-in-kampagner kan fordoble gratis kreditter frem til primo oktober 2026.
2. Officiel MiniMax API (Token Plan)
- Hent en Subscription Key fra MiniMax-konsollen.
- Brug enten Anthropic- eller OpenAI-SDK ved at ændre
base_urlog sættemodel="MiniMax-M3.1-Flash-Preview". - Angiv det ønskede indsatsniveau.
3. Via CometAPI (anbefales til multi-model teams)
CometAPI har allerede minimax-m3.1-flash-preview i sit katalog (med 20% rabat synlig på skrivende tidspunkt). Fordi CometAPI udstiller et OpenAI-kompatibelt endepunkt (https://api.cometapi.com/v1), kræver eksisterende kodebaser kun en ændring af base_url og API-nøgle. Dette er særligt praktisk for teams, der allerede ruter GPT, Claude, Gemini, MiniMax-M3 og andre modeller gennem en enkelt nøgle og ønsker konsistent observability, fakturering og fallback-logik.
Eksempel (Python / OpenAI SDK via CometAPI):
from openai import OpenAI
client = OpenAI(
api_key="YOUR_COMETAPI_KEY",
base_url="https://api.cometapi.com/v1",
)
response = client.chat.completions.create(
model="minimax-m3.1-flash-preview",
messages=[{"role": "user", "content": "Refactor this function for clarity..."}],
# reasoning_effort or equivalent may be supported depending on gateway mapping
)
CometAPI’s samlede katalog inkluderer også MiniMax-M3, M2.7-serien og de nye H3-videomodeller, hvilket muliggør problemfrit skifte mellem tekst og multimodal generering under én faktureringsrelation.
