GPT-6 Sol, GPT-6 Luna, and Claude Opus 5.5 are now live on CometAPI →
new/CometAPI 研究

什麼是 MiniMax M3.1-Flash-Preview?

MiniMax M3.1-Flash 是一款原生多模態、1M 上下文的 Frontier Coding 模型,具備可調整的思維深度。

CometAPI
AnnaAI 模型與 API 研究團隊
更新於 Sep 28, 2026 3 分鐘閱讀
什麼是 MiniMax M3.1-Flash-Preview?
套用此模式

發出第一個 API 請求。

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

重點摘要 2026 年 9 月 27 日,MiniMax 低調但正式在 MiniMax Code(以及透過 Token Plan)內上線了 M3.1-Flash--Preview。這是一款前沿的多模態程式設計模型,提供完整的 1-million-token 上下文視窗,原生支援文字/圖片/影片輸入,並引入全新的五級推理投入控制(low → max)。其定位明確面向日常開發流程——從修 bug 到實作、測試與交付——在保持思考始終開啟的同時,優先考量速度與成本效率。

目前僅限 Token Plan + MiniMax Code 使用(透過 Subscription Key 支援 API);完整的公開定價與開放權重尚未公布。CometAPI 已以具競爭力的價格上架該模型(minimax-m3.1-flash-preview),便於透過統一介面快速接入。

重要重點

  • 1M-token 上下文 + 原生多模態 — 在單一視窗中處理大型程式碼庫、長時代理會話、文件、圖片與影片。
  • 五級推理投入(low / medium / high / xhigh / max,預設為 max)— 按需在延遲與代幣用量之間換取更深入的思考。思考不可停用。
  • 日常開發聚焦 — 明確優化於 MiniMax Code 內的閉環流程:從定位 bug → 實作 → 測試 → 交付。
  • 預覽版限制 — 已在 MiniMax Code 與 Token Plan 中確認;API 呼叫需 Subscription Key。發佈時尚未提供獨立模型卡、公開基準、開放權重或獨立隨用隨付定價。
  • CometAPI 推薦 — 透過單一 OpenAI 相容端點存取(model ID: minimax-m3.1-flash-preview),並提供折扣價格,適合已使用 CometAPI 500+ 模型目錄的團隊。

什麼是 MiniMax M3.1-Flash-Preview?

MiniMax M3.1-Flash-Preview 是 MiniMax M 系列大型語言模型的最新成員。官方文件如此描述:「Frontier multimodal coding model with 1M context window and tunable thinking depth。」該模型最初被開發者在 MiniMax Code 的模型選擇器中發現,並於 2026 年 9 月 27 日由 官方 @MiniMaxAgent X 帳號正式確認:

「MiniMax’s latest text model, M3.1-Flash-Preview, debuts today on MiniMax Code. Built for everyday development, it’s fast, reliable, and ready for real work, from quick bug fixes to full features.」

不同於一般聊天模型,它是為軟體工程與代理式工作流程量身打造。MiniMax 的產品訊息強調真實開發者任務:快速修復、功能實作、邊界情況處理、回歸測試與變更驗證。「Flash」標識意味著相較於更重的 MiniMax-M3 旗艦,著重速度與日常實用性,同時延續 M3 系列的大上下文與程式能力。

該模型支援:

  • 最多 1,000,000 tokens 的上下文——適用於整個程式碼庫、長文件與多步代理會話
  • 原生多模態輸入(文字、圖片與影片)
  • 代理式推理、工具調用與結構化任務執行
  • 始終開啟的深度思考,可透過五級投入滑桿調整

思考內容會獨立返回(在 OpenAI 相容模式中為 reasoning_content,在 Anthropic 相容模式中為 thinking 區塊),以保持最終答案整潔,便於顯示或下游使用。

1M-Token 上下文 + 程式導向

最突出的技術規格是 1,000,000-token 的上下文視窗。這與 MiniMax-M3 相當,並顯著超越多數競品程式模型。官方文件強調其適用於:

  • 整個程式碼倉庫
  • 長時間多步代理會話
  • 龐大文件與知識庫
  • 在同一上下文內的多模態輸入(文字 + 圖片 + 影片)

長上下文結合原生多模態,讓以往需要繁複上下文管理或外部檢索系統的工作流程得以簡化。開發者可以在單一對話中保留大型程式碼庫、設計稿、錯誤截圖與相關文件。

該模型明確針對 Agent 與程式場景優化:工具調用、結構化輸出與多輪工程任務。相關型號的輸出速度數據(M3 ≈ 100+ TPS、M2.7-highspeed ≈ 100 TPS)暗示 Flash 款式瞄準更高的延遲/吞吐表現上限,但 M3.1-Flash-Preview 本身的精確 TPS 尚未公布。

五級推理投入

一項非常實用的新功能是透過 effort(Anthropic 相容)或 reasoning_effort(OpenAI 相容)參數控制的可調思考深度。五個等級為:

Level典型使用場景權衡
low簡單語法修正、快速查詢最低延遲與代幣用量
medium例行重構、小型功能取向平衡
high複雜邏輯、多檔案變更更深入的分析
xhigh困難除錯、架構決策更高計算與延遲
max高風險或不明確問題(預設)最大程度的深思熟慮

M3.1-Flash-Preview 的思考功能始終開啟;嘗試停用會返回 400 錯誤。較高等級會產生更多內部推理代幣並增加延遲,讓開發者能更細緻地在難度與成本限制間調節,這比早期 M 系列提供更精細的控制。

在 MiniMax Code 中,該控制以簡單滑桿或選單呈現;透過 API 則在請求體中傳入。此設計呼應產業日漸普及的「推理預算」旋鈕趨勢,讓使用者可將模型行為對齊任務難度與成本考量。

日常開發工作流程

MiniMax 將 M3.1-Flash-Preview 明確定位於日常開發閉環,而非純研究或長期代理模型。官方訊息與產品位置emphasize 在 MiniMax Code 內的閉環體驗,Bug Fixing → Implementation → Testing → Delivery:

  1. Bug 定位 — 貼上堆疊追蹤、錯誤截圖或相關程式片段;模型可在大型上下文中推理並找出根因。
  2. 實作 — 在保留全域專案上下文的前提下,生成或編輯跨多檔案的程式碼。
  3. 測試與驗證 — 建議或撰寫測試、執行回歸檢查並分析影響面。
  4. 交付 — 產出乾淨的 diffs、提交訊息或可供審閱的文件。

1M 上下文、多模態輸入(例如失敗 UI 的截圖)與可調投入的組合,對日常高頻且對延遲敏感的工程任務尤為有效。伴隨上線的限時活動(9 月 28 日至 10 月 7 日 UTC+8 每日簽到雙倍點數與 Token Plan 額度重置)也鼓勵實際測試。

目前可用性與預覽版限制

截至 2026 年 9 月下旬已確認:

  • 可在 MiniMax Code 選用(與 M3、M2.7 等並列)。
  • 可透過 Token Plan / Subscription Key 使用。
  • 已在官方 MiniMax API 參考頁中記載,並提供 OpenAI 相容與 Anthropic 相容的範例。
  • 可透過 reasoning_effort 或等效欄位調控思考深度。
  • 推廣活動:Token Plan 額度重置與雙倍簽到點數(9 月 28 日 – 10 月 7 日),可用於新模型。

已確認 API 路徑:官方文件列出模型名稱 MiniMax-M3.1-Flash-Preview,並提供 Anthropic 相容(https://api.minimax.io/anthropic)與 OpenAI 相容(https://api.minimax.io/v1)端點。需使用 Subscription Key(Token Plan)。範例參數包括 output_config.effort 或 reasoning_effort。思考內容會獨立返回(thinking 區塊或 reasoning_content)。

仍受限或未確認:

  • 獨立完整的公開基準測試與含參數規模的模型卡
  • 與 MiniMax-M3 同等透明度的獨立隨用隨付定價頁
  • 開放權重(預覽版未宣布)

預覽狀態意味著功能、額度與定價仍可能變動。開發者應將當前表現視為參考而非最終。

如何存取 MiniMax M3.1-Flash-Preview

1. 在 MiniMax Code 內(互動使用最簡便)

下載或開啟 MiniMax Code(提供 macOS 與 Windows 桌面應用)。自模型選擇器中選取 M3.1-Flash-Preview,並調整推理等級。每日簽到活動可在 2026 年 10 月上旬前提供雙倍免費點數。

2. 官方 MiniMax API(Token Plan)

  • 從 MiniMax 主控台取得 Subscription Key。
  • 使用 Anthropic 或 OpenAI SDK,調整 base_url 並設定 model="MiniMax-M3.1-Flash-Preview"。
  • 傳入所需的投入等級。

3. 透過 CometAPI(推薦給多模型團隊)

CometAPI 已在其目錄中上架 minimax-m3.1-flash-preview(撰文時可見 20% 折扣)。由於 CometAPI 提供 OpenAI 相容端點(https://api.cometapi.com/v1),既有程式碼僅需更換 base_url 與 API key。對已透過單一金鑰路由 GPT、Claude、Gemini、MiniMax-M3 等模型並追求一致可觀測性、出帳與後備邏輯的團隊尤其便利。

範例(Python / OpenAI SDK 經由 CometAPI):

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="minimax-m3.1-flash-preview",
    messages=[{"role": "user", "content": "Refactor this function for clarity..."}],
    # reasoning_effort or equivalent may be supported depending on gateway mapping
)

CometAPI 的統一目錄同時包含 MiniMax-M3、M2.7 系列與全新 H3 視訊模型,讓你能在單一帳務關係下於文字與多模態生成之間無縫切換。

繼續學習

把這篇文章連到下一個決策。

查看所有主題
發布於 Sep 28, 2026
最後更新 Sep 28, 2026
0 次瀏覽
已審核內容清晰度、來源標註與最新 API 術語。

準備好將 AI 開發成本降低 20% 了嗎?

幾分鐘內免費開始。包含免費試用點數。無需信用卡。

閱讀更多