MiMo-V2.6-Pro-UltraSpeed 的技術規格
| 規格 | MiMo-V2.6-Pro-UltraSpeed |
|---|---|
| 提供商 | Xiaomi MiMo |
| 模型 ID | mimo-v2.6-pro-ultraspeed |
| 模型家族 | MiMo V2.6 Pro |
| 發布 / 更新 | 2026 年 9 月 22 日 |
| 模型類型 | 高速推理 / 多模態模型 |
| 輸入模態 | 文字、圖片、影片、音訊 |
| 輸出模態 | 文字 |
| 上下文視窗 | 1,048,576 tokens (1M) |
| 最大輸出 | 131,072 tokens (128K) |
| 推理 | 深度思考 |
| 工具呼叫 | 支援 |
| 串流 | 支援 |
| 網路搜尋 | 支援 |
| 結構化輸出 | 支援 |
| 上下文快取 | 支援 |
| API 協定 | 相容 OpenAI、Anthropic |
| 原生 API 基底 URL | https://api.xiaomimimo.com/v1 |
Xiaomi 的官方模型頁面列出支援的輸入模態為文字、圖片、影片與音訊,輸出為文字。亦列出多模態理解、深度思考、工具呼叫、串流、網路搜尋、結構化輸出與上下文快取等能力。文件說明的上下文視窗為 1M tokens,最大輸出為 128K tokens。
什麼是 MiMo-V2.6-Pro-UltraSpeed?
MiMo-V2.6-Pro-UltraSpeed 是 MiMo-V2.6-Pro 的低延遲服務版本,適用於需要將 Pro 模型的推理能力與顯著更快的輸出生成相結合的應用場景。
Xiaomi 表示,UltraSpeed 在保留 V2.6-Pro 旗艦級能力的同時,提供相較標準 V2.6-Pro 服務模式「最高可達 20×」的輸出速度提升。Xiaomi 特別面向對回應延遲敏感的即時互動與生產工作負載。
因此,其差異主要在於推理速度與服務方式,而非全新能力家族。獨立的模型目錄亦將 UltraSpeed 描述為 MiMo-V2.6-Pro 家族中託管的高速變體,而非單獨釋出的開放權重檢查點。
MiMo-V2.6-Pro-UltraSpeed 的主要特性
- 超高速 Pro 推理: Xiaomi 聲稱,相較標準 MiMo-V2.6-Pro,輸出生成速度可達 20×,鎖定對延遲敏感的生產系統。
- 完整多模態輸入: 模型可接收文字、圖片、影片與音訊,並輸出文字回應。
- 1M-token 上下文: 1,048,576-token 的上下文視窗可支援大型程式庫、長文檔、多模態上下文與長時段代理會話。
- 深度推理: UltraSpeed 保留 MiMo-V2.6-Pro 家族的推理導向行為,並非降級為僅生成的輕量模型。Xiaomi 明確表示其保留 Pro 的表現。
- 代理與工具流程: 工具呼叫、結構化輸出、網路搜尋、串流與上下文快取等能力均列為支援項。
- OpenAI 與 Anthropic 協定相容: Xiaomi 提供兩種協定的整合範例,讓開發者可沿用既有 API 客戶端,而非從零開始建立專有整合。
MiMo-V2.6-Pro-UltraSpeed 與 MiMo-V2.6-Pro 與 MiMo-V2.6-Flash
| 模型 | 主要定位 | 上下文 | 最大輸出 | 主要差異 |
|---|---|---|---|---|
| MiMo-V2.6-Pro-UltraSpeed | 即時 / 對延遲敏感的 Pro 服務 | 1M | 128K | 相較 Pro 宣稱輸出速度最高可達 20× |
| MiMo-V2.6-Pro | 旗艦級推理模型 | 1M | 128K | 標準 Pro 推理 |
| MiMo-V2.6-Flash | 更注重效率的 V2.6 模型 | 1M | 128K | 為更輕量、成本敏感的工作負載所設計 |
Xiaomi 將 V2.6-Pro 描述為面向複雜專案、長期任務、高風險工作、資安與研究的旗艦推理模型,而 UltraSpeed 則專注於該 Pro 體驗的低延遲版本。
官方定價也顯示 UltraSpeed 為獨立的服務層級:目前 Xiaomi 將 UltraSpeed 的費率列為每百萬輸入 $4.35、每百萬輸出 $8.70;標準 V2.6-Pro 則為每百萬輸入 $0.435、每百萬輸出 $0.87。UltraSpeed 的快取命中輸入列為每百萬 $0.036。
MiMo-V2.6-Pro-UltraSpeed 的限制
- UltraSpeed 的速度數據為廠商聲稱: Xiaomi 表示「最高可達 20×」的輸出速度,但未找到針對此服務層級的標準化獨立測試結果。
- 僅文字輸出: 雖然模型接受文字、圖片、影片與音訊作為輸入,但文件記載的輸出模態為文字。
- 託管服務的區別: 在未加註說明的情況下,不應將 UltraSpeed 描述為單獨的開放權重檢查點。目前的資訊將標準開放的 MiMo-V2.6-Pro 模型與託管的 UltraSpeed 服務模式加以區分。
- Token 單價高於標準 Pro: Xiaomi 所列的 UltraSpeed 費率明顯高於標準 MiMo-V2.6-Pro。相關取捨因此更偏向延遲與 Token 成本,而非單純模型能力。
- 帳戶特定吞吐量: Xiaomi 對 UltraSpeed 的 RPM/TPM 以客製化服務提供,而非在模型頁面上公布通用限制。
推薦使用情境
即時程式碼輔助
Xiaomi 特別指出即時程式碼輔助為 UltraSpeed 的典型場景。更快的生成速度可降低程式補全、除錯與互動式開發時的延遲感。
即時風控
該模型同樣定位於對延遲敏感的風控流程,需要在短時間內完成推理。Xiaomi 以即時詐欺與風險評估為例。
量化與市場分析
Xiaomi 將量化交易列為另一目標場景,在快速處理新資訊並產出分析結果方面具有重要性。這是 Xiaomi 所記載的使用案例示例,並非證明該模型能獨立產出可靠的交易決策。
科學研究
官方模型頁面將即時假設生成與驗證列為潛在研究流程,尤其在降低模型回應延遲可改善互動式實驗的情境。
長上下文多模態代理
1M-token 上下文視窗、多模態輸入、推理、工具呼叫與串流的結合,使 UltraSpeed 適用於需要處理大量混合資訊、同時保持互動回應速度的長上下文代理系統。