MiMo-V2.6-Pro-UltraSpeed の技術仕様
| 仕様 | MiMo-V2.6-Pro-UltraSpeed |
|---|---|
| 提供元 | Xiaomi MiMo |
| モデルID | mimo-v2.6-pro-ultraspeed |
| モデルファミリー | MiMo V2.6 Pro |
| リリース / 更新 | 2026年9月22日 |
| モデルタイプ | 高速推論 / マルチモーダルモデル |
| 入力モダリティ | テキスト、画像、動画、音声 |
| 出力モダリティ | テキスト |
| コンテキストウィンドウ | 1,048,576トークン(1M) |
| 最大出力 | 131,072トークン(128K) |
| 推論 | 深い思考 |
| ツール呼び出し | 対応 |
| ストリーミング | 対応 |
| ウェブ検索 | 対応 |
| 構造化出力 | 対応 |
| コンテキストキャッシュ | 対応 |
| APIプロトコル | OpenAI互換、Anthropic互換 |
| ネイティブAPIベースURL | https://api.xiaomimimo.com/v1 |
Xiaomiの公式モデルページでは、対応する入力モダリティとしてテキスト、画像、動画、音声が挙げられており、出力はテキストです。さらに、マルチモーダル理解、深い思考、ツール呼び出し、ストリーミング、ウェブ検索、構造化出力、コンテキストキャッシュが記載されています。コンテキストウィンドウは1Mトークン、最大出力は128Kトークンと記載されています。
MiMo-V2.6-Pro-UltraSpeed とは?
MiMo-V2.6-Pro-UltraSpeedは、MiMo-V2.6-Proの低レイテンシ提供バージョンで、Proモデルの推論能力を大幅に高速な出力生成と組み合わせる必要があるアプリケーション向けに設計されています。
Xiaomiは、UltraSpeedがV2.6-Proのフラッグシップ級の能力を保持しつつ、標準のV2.6-Pro提供モードと比べて最大20倍の出力速度を実現すると述べています。特に、応答レイテンシに敏感なリアルタイム対話や本番ワークロードをターゲットとしています。
したがって、その違いは主に推論速度と提供形態に関するものであり、新たな能力ファミリーではありません。独立系のモデルカタログでも、UltraSpeedはMiMo-V2.6-Proファミリーのホスト型の高速バリアントとして記述されており、別個にリリースされたオープンウェイトのチェックポイントではないとされています。
MiMo-V2.6-Pro-UltraSpeed の主な特長
- 超高速なPro推論: 標準のMiMo-V2.6-Pro比で出力生成が最大20倍に達し得るとXiaomiは主張しており、レイテンシに敏感な本番システムをターゲットとしています。
- 完全なマルチモーダル入力: モデルはテキスト、画像、動画、音声を受け取り、テキストで応答を生成します。
- 1Mトークンのコンテキスト: 1,048,576トークンのコンテキストウィンドウにより、大規模リポジトリ、長文書、マルチモーダル文脈、拡張エージェントセッションをサポートします。
- 深い推論: UltraSpeedは、軽量な生成専用モデルに切り詰められるのではなく、MiMo-V2.6-Proファミリーの推論志向の挙動を維持します。XiaomiはPro性能を保持すると明言しています。
- エージェントとツールのワークフロー: ツール呼び出し、構造化出力、ウェブ検索、ストリーミング、コンテキストキャッシュが対応機能として列挙されています。
- OpenAIおよびAnthropicプロトコル互換性: 両プロトコル向けの統合例が提供されており、独自の統合を一から構築するのではなく既存のAPIクライアントを適応できます。
MiMo-V2.6-Pro-UltraSpeed と MiMo-V2.6-Pro と MiMo-V2.6-Flash の比較
| モデル | 主な位置付け | コンテキスト | 最大出力 | 主な違い |
|---|---|---|---|---|
| MiMo-V2.6-Pro-UltraSpeed | リアルタイム / レイテンシ敏感なPro提供 | 1M | 128K | Pro比で最大20倍の出力速度(公称) |
| MiMo-V2.6-Pro | フラッグシップ推論モデル | 1M | 128K | 標準のPro推論 |
| MiMo-V2.6-Flash | より効率重視のV2.6モデル | 1M | 128K | 軽量でコスト重視のワークロード向けに設計 |
Xiaomiは、V2.6-Proを複雑なプロジェクト、長期タスク、高リスクな業務、サイバーセキュリティ、研究向けの同社フラッグシップ推論モデルと説明しており、UltraSpeedはそのPro体験のレイテンシ敏感版に特化して最適化されています。
公式の料金体系からも、UltraSpeedが独立した提供ティアであることが示されています。現在、XiaomiはUltraSpeedの料金を入力 $4.35/M、出力 $8.70/M と掲示しており、標準のV2.6-Proは入力 $0.435/M、出力 $0.87/M です。UltraSpeedのキャッシュヒット時の入力は $0.036/M と記載されています。
MiMo-V2.6-Pro-UltraSpeed の制限事項
- UltraSpeedの速度数値はベンダーの主張: Xiaomiは「最大20倍」の高速出力と述べていますが、この提供ティアに特化した標準化された第三者測定は見つかりませんでした。
- 出力はテキストのみ: モデルはテキスト、画像、動画、音声の入力に対応しますが、文書化された出力モダリティはテキストです。
- ホスト提供である点の区別: UltraSpeedを但し書きなく独立したオープンウェイトのチェックポイントとして記述すべきではありません。現在の情報源は、標準のオープンなMiMo-V2.6-Proモデルと、ホスト提供のUltraSpeed提供モードを区別しています。
- 標準のProよりトークン単価が高い: XiaomiのUltraSpeedの料金は、標準のMiMo-V2.6-Proの料金より大幅に高く設定されています。関連するトレードオフは、単なるモデル能力ではなく、レイテンシとトークンコストの間のバランスです。
- アカウント別のスループット: Xiaomiは、モデルページで一律の制限を公開するのではなく、UltraSpeedのRPM/TPMをカスタマイズされたサービスとして提示しています。
推奨ユースケース
リアルタイムのコーディング支援
Xiaomiは、リアルタイムのコーディング支援をUltraSpeedのシナリオとして明確に挙げています。生成の高速化により、コード補完、デバッグ、インタラクティブな開発における体感遅延を軽減できます。
リアルタイムのリスクコントロール
推論が短い運用時間枠内で行われる必要がある、レイテンシに敏感なリスクコントロールのワークフロー向けにも位置付けられています。Xiaomiは、リアルタイムの不正検知やリスク評価を例として挙げています。
定量分析と市場分析
Xiaomiは、クオンツ(定量)取引を別のターゲットシナリオとして挙げており、新情報の迅速な処理と分析出力の生成が重要となり得ます。これはXiaomiが文書化したユースケース例であり、モデルが独自に信頼できる取引判断を生み出す証拠ではありません。
科学研究
公式モデルページでは、リアルタイムの仮説生成と検証を潜在的な研究ワークフローとして説明しており、特にモデル応答のレイテンシ低減がインタラクティブな実験を改善し得る場面を想定しています。
長コンテキストのマルチモーダルエージェント
1Mトークンのコンテキストウィンドウ、マルチモーダル入力、推論、ツール呼び出し、ストリーミングの組み合わせにより、インタラクティブな応答速度を維持しながら大量の混在情報を処理する必要がある長コンテキストのエージェントシステムにUltraSpeedは適しています。