TLDR 2026年9月27日、MiniMax は MiniMax Code 内(および Token Plan 経由)で M3.1-Flash-Preview を静かに、しかし正式にリリースしました。これは、完全な 1M トークンのコンテキストウィンドウ、テキスト/画像/動画入力のネイティブ対応、そして新しい 5 段階の推論努力コントロール(low → max)を備えたフロンティアなマルチモーダル・コーディングモデルです。日々の開発ワークフロー(バグ修正から実装、テスト、デリバリーまで)に明確に位置付けられており、思考を常時オンに保ちながら、速度とコスト効率を優先します。
提供は現在、Token Plan + MiniMax Code に限定(Subscription Key による API 対応あり)。パブリックな完全価格表やオープンウェイトは未公開です。CometAPI ではすでに当該モデル(minimax-m3.1-flash-preview)が競争力のある料金で掲載されており、統一アクセスが容易です。
重要なポイント
- 1Mトークンのコンテキスト + ネイティブなマルチモーダリティ — 大規模コードベース、長時間のエージェントセッション、ドキュメント、画像、動画を1つのウィンドウで処理。
- 5段階の推論努力(low / medium / high / xhigh / max、デフォルトは max)— 要求に応じてレイテンシとトークン使用量をトレードし、より深い熟考を実現。思考は無効化できません。
- 日常のコーディングに特化 — MiniMax Code 内でのバグ特定 → 実装 → テスト → デリバリーというクローズドループに明確に最適化。
- プレビュー版の制限 — MiniMax Code と Token Plan での提供は確認済み。API 呼び出しには Subscription Key が必要。独立したモデルカード、公開ベンチマーク、オープンウェイト、単体の従量課金プランはリリース時点で未発表。
- CometAPI 推奨 — 単一の OpenAI 互換エンドポイント(モデルID: minimax-m3.1-flash-preview)経由で割引価格にて利用可能。すでに CometAPI の 500+ モデルカタログを使うチームに最適。
MiniMax M3.1-Flash-Preview とは?
MiniMax M3.1-Flash-Preview は、MiniMax の M シリーズ大規模言語モデルの最新エントリです。公式ドキュメントでは「1M コンテキストウィンドウと調整可能な思考深度を備えたフロンティアなマルチモーダル・コーディングモデル」と説明されています。最初は開発者が MiniMax Code のモデルピッカーで発見し、2026年9月27日の X の公式 @MiniMaxAgent アカウントで正式に確認されました。
「MiniMax の最新テキストモデル、M3.1-Flash-Preview が本日 MiniMax Code に登場。日常の開発のために設計され、迅速で信頼でき、クイックなバグ修正から本格的な機能まで、実務に即応します。」
一般的なチャットモデルとは異なり、これはソフトウェアエンジニアリングとエージェント型ワークフローに特化しています。MiniMax のプロダクトメッセージは、実世界の開発者タスクを強調します:クイックなバグ修正、機能実装、境界ケース対応、回帰テスト、変更検証。「Flash」の名称は、より重い MiniMax-M3 フラッグシップに対して速度と日常的実用性を重視することを示しつつ、M3 ファミリーの大規模コンテキストとコーディング能力を継承していることを意味します。
このモデルは以下をサポートします:
- 最大 1,000,000 トークンのコンテキスト — リポジトリ全体、長文ドキュメント、マルチステップのエージェントセッションに最適。
- ネイティブなマルチモーダル入力(テキスト、画像、動画)。
- エージェント的推論、ツール呼び出し、構造化されたタスク実行。
- 5 段階の努力スライダーで調整可能な常時オンの深い思考。
思考コンテンツは別枠で返されます(OpenAI 互換モードでは reasoning_content、Anthropic 互換モードでは thinking ブロック)ため、最終回答は表示や後段での利用にクリーンです。
1Mトークンのコンテキスト + コーディング指向
目立つ技術仕様は、1,000,000 トークンのコンテキストウィンドウです。これは MiniMax-M3 に匹敵し、多くの競合するコーディングモデルよりはるかに大きいものです。公式ドキュメントでは以下の用途への適合性を強調しています:
- コードリポジトリ全体
- 長時間・多段のエージェントセッション
- 大規模ドキュメントとナレッジベース
- 同一コンテキスト内でのマルチモーダル入力(テキスト + 画像 + 動画)
この長大なコンテキスト能力とネイティブなマルチモーダリティの組み合わせにより、これまで重いコンテキスト管理や外部の検索システムを必要としていたワークフローが可能になります。開発者は大規模コードベース、デザインモック、エラーのスクリーンショット、関連ドキュメントを一つの会話に同居させられます。
モデルは明確にエージェントとコーディングのシナリオに最適化されています:ツール呼び出し、構造化出力、マルチターンのエンジニアリングタスク。関連モデルの出力速度(M3 ≈ 100+ TPS、M2.7-highspeed ≈ 100 TPS)から、Flash 系はレイテンシ/スループットの上限寄りを狙っていると示唆されますが、M3.1-Flash-Preview 自体の正確な TPS 数値は未公表です。
5段階の推論努力
実用的な新機能のひとつが、effort(Anthropic 互換)または reasoning_effort(OpenAI 互換)パラメータで制御する調整可能な思考深度です。5 つのレベルは以下のとおりです:
| Level | Typical Use Case | Trade-off |
|---|---|---|
| low | 簡単な構文修正、迅速な検索 | 最小のレイテンシとトークン消費 |
| medium | 通常のリファクタ、小規模機能 | バランス |
| high | 複雑なロジック、複数ファイルの変更 | より深い分析 |
| xhigh | 難易度の高いデバッグ、アーキテクチャ判断 | より高い計算負荷とレイテンシ |
| max | 重要度が高い/曖昧な問題(デフォルト) | 最大の熟考 |
M3.1-Flash-Preview では思考が常時オンであり、無効化しようとすると 400 エラーが返されます。高い effort レベルでは内部の推論トークンが増えレイテンシも上がりますが、以前の M シリーズより細かな粒度で、タスク難度とコスト制約にモデルの挙動を合わせられます。
MiniMax Code では、この制御はシンプルなスライダー/セレクタとして表示され、API ではリクエストボディで指定します。これは「推論予算」を露出させる業界の流れに沿う設計で、ユーザーが遅延・コストと熟考の深さを適切に一致させられます。
日常的な開発ワークフロー
MiniMax は M3.1-Flash-Preview を、研究や長期志向のエージェントモデルではなく、日々の開発ループの中心に位置付けています。公式メッセージと製品配置は、MiniMax Code 内のクローズドループ(Bug Fixing → Implementation → Testing → Delivery)を強調しています。
- バグ特定 — スタックトレース、エラーのスクリーンショット、関連コード断片を貼り付け、広いコンテキストで根本原因を特定。
- 実装 — プロジェクト全体の文脈を保ったまま、複数ファイルにまたがるコード生成や編集。
- テストと検証 — テストの提案/作成、回帰チェック、影響分析。
- デリバリー — クリーンな差分、コミットメッセージ、レビュー向けドキュメントを生成。
1M コンテキスト、マルチモーダル入力(例:失敗した UI のスクリーンショット)、調整可能な effort の組み合わせにより、日常のエンジニアリングで頻出かつレイテンシに敏感なタスクに特に有効です。ローンチに合わせた期間限定プロモーション(9月28日〜10月7日[UTC+8]のデイリーチェックイン・クレジット2倍や Token Plan のクオータリセット)も、実運用での試用を後押しします。
現在の提供状況とプレビューの制限
2026年9月下旬時点で確認済み:
- MiniMax Code 内で選択可能(M3、M2.7 などと並ぶモデルピッカー)。
- Token Plan / Subscription Key で利用可能。
- 公式の MiniMax API リファレンスに、OpenAI 互換/Anthropic 互換のサンプルとともに掲載。
- 推論深度は
reasoning_effort等のフィールドで制御可能。 - プロモーション:Token Plan のクオータリセット、および新モデルで利用可能なチェックインポイント2倍(9月28日〜10月7日)。
確認済み API 経路:公式ドキュメントにはモデル名 MiniMax-M3.1-Flash-Preview が記載され、Anthropic 互換(https://api.minimax.io/anthropic)と OpenAI 互換(https://api.minimax.io/v1)の両エンドポイントが提供されています。Subscription Key(Token Plan)が必要です。例示パラメータには output_config.effort や reasoning_effort が含まれます。思考コンテンツは別枠で返却されます(thinking ブロックまたは reasoning_content)。
依然として限定的または未確認:
- パラメータ数を含む独立した公開ベンチマークスイートとモデルカード
- MiniMax-M3 と同等の透明性を持つ単体の従量課金価格ページ
- オープンウェイト(このプレビューでは未発表)
プレビュー段階であるため、機能、クオータ、価格は変更される可能性があります。現時点の性能は最終版の指標ではなく、参考値として扱うべきです。
MiniMax M3.1-Flash-Preview の利用方法
1. MiniMax Code 内(インタラクティブ用途に最適)
MiniMax Code(macOS/Windows のデスクトップアプリあり)をダウンロードまたは起動。モデルピッカーで M3.1-Flash-Preview を選び、推論レベルを調整します。早期 10 月までのデイリーチェックイン施策で無料クレジットを倍増可能。
2. 公式 MiniMax API(Token Plan)
- MiniMax コンソールから Subscription Key を取得。
- Anthropic または OpenAI の SDK を利用し、
base_urlを変更してmodel="MiniMax-M3.1-Flash-Preview"を設定。 - 希望の effort レベルを指定。
3. CometAPI 経由(マルチモデル運用に推奨)
CometAPI はすでにカタログに minimax-m3.1-flash-preview を掲載(執筆時点で 20% 割引の料金表示)。CometAPI は OpenAI 互換エンドポイント(https://api.cometapi.com/v1)を提供するため、既存コードベースは base_url と API キーの変更のみで済みます。すでに GPT、Claude、Gemini、MiniMax-M3 などを単一キーでルーティングし、観測性・課金・フォールバックを統合したいチームに特に便利です。
例(Python / OpenAI SDK、CometAPI 経由):
from openai import OpenAI
client = OpenAI(
api_key="YOUR_COMETAPI_KEY",
base_url="https://api.cometapi.com/v1",
)
response = client.chat.completions.create(
model="minimax-m3.1-flash-preview",
messages=[{"role": "user", "content": "Refactor this function for clarity..."}],
# reasoning_effort or equivalent may be supported depending on gateway mapping
)
CometAPI の統合カタログには MiniMax-M3、M2.7 シリーズ、新しい H3 ビデオモデルも含まれており、1 つの課金関係の下でテキストとマルチモーダル生成をシームレスに切り替えられます。
