重點摘要 2026 年 9 月 27 日,MiniMax 低調但正式在 MiniMax Code(以及透過 Token Plan)內上線了 M3.1-Flash--Preview。這是一款前沿的多模態程式設計模型,提供完整的 1-million-token 上下文視窗,原生支援文字/圖片/影片輸入,並引入全新的五級推理投入控制(low → max)。其定位明確面向日常開發流程——從修 bug 到實作、測試與交付——在保持思考始終開啟的同時,優先考量速度與成本效率。
目前僅限 Token Plan + MiniMax Code 使用(透過 Subscription Key 支援 API);完整的公開定價與開放權重尚未公布。CometAPI 已以具競爭力的價格上架該模型(minimax-m3.1-flash-preview),便於透過統一介面快速接入。
重要重點
- 1M-token 上下文 + 原生多模態 — 在單一視窗中處理大型程式碼庫、長時代理會話、文件、圖片與影片。
- 五級推理投入(low / medium / high / xhigh / max,預設為 max)— 按需在延遲與代幣用量之間換取更深入的思考。思考不可停用。
- 日常開發聚焦 — 明確優化於 MiniMax Code 內的閉環流程:從定位 bug → 實作 → 測試 → 交付。
- 預覽版限制 — 已在 MiniMax Code 與 Token Plan 中確認;API 呼叫需 Subscription Key。發佈時尚未提供獨立模型卡、公開基準、開放權重或獨立隨用隨付定價。
- CometAPI 推薦 — 透過單一 OpenAI 相容端點存取(model ID: minimax-m3.1-flash-preview),並提供折扣價格,適合已使用 CometAPI 500+ 模型目錄的團隊。
什麼是 MiniMax M3.1-Flash-Preview?
MiniMax M3.1-Flash-Preview 是 MiniMax M 系列大型語言模型的最新成員。官方文件如此描述:「Frontier multimodal coding model with 1M context window and tunable thinking depth。」該模型最初被開發者在 MiniMax Code 的模型選擇器中發現,並於 2026 年 9 月 27 日由 官方 @MiniMaxAgent X 帳號正式確認:
「MiniMax’s latest text model, M3.1-Flash-Preview, debuts today on MiniMax Code. Built for everyday development, it’s fast, reliable, and ready for real work, from quick bug fixes to full features.」
不同於一般聊天模型,它是為軟體工程與代理式工作流程量身打造。MiniMax 的產品訊息強調真實開發者任務:快速修復、功能實作、邊界情況處理、回歸測試與變更驗證。「Flash」標識意味著相較於更重的 MiniMax-M3 旗艦,著重速度與日常實用性,同時延續 M3 系列的大上下文與程式能力。
該模型支援:
- 最多 1,000,000 tokens 的上下文——適用於整個程式碼庫、長文件與多步代理會話
- 原生多模態輸入(文字、圖片與影片)
- 代理式推理、工具調用與結構化任務執行
- 始終開啟的深度思考,可透過五級投入滑桿調整
思考內容會獨立返回(在 OpenAI 相容模式中為 reasoning_content,在 Anthropic 相容模式中為 thinking 區塊),以保持最終答案整潔,便於顯示或下游使用。
1M-Token 上下文 + 程式導向
最突出的技術規格是 1,000,000-token 的上下文視窗。這與 MiniMax-M3 相當,並顯著超越多數競品程式模型。官方文件強調其適用於:
- 整個程式碼倉庫
- 長時間多步代理會話
- 龐大文件與知識庫
- 在同一上下文內的多模態輸入(文字 + 圖片 + 影片)
長上下文結合原生多模態,讓以往需要繁複上下文管理或外部檢索系統的工作流程得以簡化。開發者可以在單一對話中保留大型程式碼庫、設計稿、錯誤截圖與相關文件。
該模型明確針對 Agent 與程式場景優化:工具調用、結構化輸出與多輪工程任務。相關型號的輸出速度數據(M3 ≈ 100+ TPS、M2.7-highspeed ≈ 100 TPS)暗示 Flash 款式瞄準更高的延遲/吞吐表現上限,但 M3.1-Flash-Preview 本身的精確 TPS 尚未公布。
五級推理投入
一項非常實用的新功能是透過 effort(Anthropic 相容)或 reasoning_effort(OpenAI 相容)參數控制的可調思考深度。五個等級為:
| Level | 典型使用場景 | 權衡 |
|---|---|---|
| low | 簡單語法修正、快速查詢 | 最低延遲與代幣用量 |
| medium | 例行重構、小型功能 | 取向平衡 |
| high | 複雜邏輯、多檔案變更 | 更深入的分析 |
| xhigh | 困難除錯、架構決策 | 更高計算與延遲 |
| max | 高風險或不明確問題(預設) | 最大程度的深思熟慮 |
M3.1-Flash-Preview 的思考功能始終開啟;嘗試停用會返回 400 錯誤。較高等級會產生更多內部推理代幣並增加延遲,讓開發者能更細緻地在難度與成本限制間調節,這比早期 M 系列提供更精細的控制。
在 MiniMax Code 中,該控制以簡單滑桿或選單呈現;透過 API 則在請求體中傳入。此設計呼應產業日漸普及的「推理預算」旋鈕趨勢,讓使用者可將模型行為對齊任務難度與成本考量。
日常開發工作流程
MiniMax 將 M3.1-Flash-Preview 明確定位於日常開發閉環,而非純研究或長期代理模型。官方訊息與產品位置emphasize 在 MiniMax Code 內的閉環體驗,Bug Fixing → Implementation → Testing → Delivery:
- Bug 定位 — 貼上堆疊追蹤、錯誤截圖或相關程式片段;模型可在大型上下文中推理並找出根因。
- 實作 — 在保留全域專案上下文的前提下,生成或編輯跨多檔案的程式碼。
- 測試與驗證 — 建議或撰寫測試、執行回歸檢查並分析影響面。
- 交付 — 產出乾淨的 diffs、提交訊息或可供審閱的文件。
1M 上下文、多模態輸入(例如失敗 UI 的截圖)與可調投入的組合,對日常高頻且對延遲敏感的工程任務尤為有效。伴隨上線的限時活動(9 月 28 日至 10 月 7 日 UTC+8 每日簽到雙倍點數與 Token Plan 額度重置)也鼓勵實際測試。
目前可用性與預覽版限制
截至 2026 年 9 月下旬已確認:
- 可在 MiniMax Code 選用(與 M3、M2.7 等並列)。
- 可透過 Token Plan / Subscription Key 使用。
- 已在官方 MiniMax API 參考頁中記載,並提供 OpenAI 相容與 Anthropic 相容的範例。
- 可透過
reasoning_effort或等效欄位調控思考深度。 - 推廣活動:Token Plan 額度重置與雙倍簽到點數(9 月 28 日 – 10 月 7 日),可用於新模型。
已確認 API 路徑:官方文件列出模型名稱 MiniMax-M3.1-Flash-Preview,並提供 Anthropic 相容(https://api.minimax.io/anthropic)與 OpenAI 相容(https://api.minimax.io/v1)端點。需使用 Subscription Key(Token Plan)。範例參數包括 output_config.effort 或 reasoning_effort。思考內容會獨立返回(thinking 區塊或 reasoning_content)。
仍受限或未確認:
- 獨立完整的公開基準測試與含參數規模的模型卡
- 與 MiniMax-M3 同等透明度的獨立隨用隨付定價頁
- 開放權重(預覽版未宣布)
預覽狀態意味著功能、額度與定價仍可能變動。開發者應將當前表現視為參考而非最終。
如何存取 MiniMax M3.1-Flash-Preview
1. 在 MiniMax Code 內(互動使用最簡便)
下載或開啟 MiniMax Code(提供 macOS 與 Windows 桌面應用)。自模型選擇器中選取 M3.1-Flash-Preview,並調整推理等級。每日簽到活動可在 2026 年 10 月上旬前提供雙倍免費點數。
2. 官方 MiniMax API(Token Plan)
- 從 MiniMax 主控台取得 Subscription Key。
- 使用 Anthropic 或 OpenAI SDK,調整
base_url並設定model="MiniMax-M3.1-Flash-Preview"。 - 傳入所需的投入等級。
3. 透過 CometAPI(推薦給多模型團隊)
CometAPI 已在其目錄中上架 minimax-m3.1-flash-preview(撰文時可見 20% 折扣)。由於 CometAPI 提供 OpenAI 相容端點(https://api.cometapi.com/v1),既有程式碼僅需更換 base_url 與 API key。對已透過單一金鑰路由 GPT、Claude、Gemini、MiniMax-M3 等模型並追求一致可觀測性、出帳與後備邏輯的團隊尤其便利。
範例(Python / OpenAI SDK 經由 CometAPI):
from openai import OpenAI
client = OpenAI(
api_key="YOUR_COMETAPI_KEY",
base_url="https://api.cometapi.com/v1",
)
response = client.chat.completions.create(
model="minimax-m3.1-flash-preview",
messages=[{"role": "user", "content": "Refactor this function for clarity..."}],
# reasoning_effort or equivalent may be supported depending on gateway mapping
)
CometAPI 的統一目錄同時包含 MiniMax-M3、M2.7 系列與全新 H3 視訊模型,讓你能在單一帳務關係下於文字與多模態生成之間無縫切換。
