Spécifications techniques de MiMo-V2.6-Pro-UltraSpeed
| Spécification | MiMo-V2.6-Pro-UltraSpeed |
|---|---|
| Fournisseur | Xiaomi MiMo |
| ID du modèle | mimo-v2.6-pro-ultraspeed |
| Famille du modèle | MiMo V2.6 Pro |
| Publication / mise à jour | September 22, 2026 |
| Type de modèle | Modèle de raisonnement haute vitesse / multimodal |
| Modalités d’entrée | Texte, image, vidéo, audio |
| Modalité de sortie | Texte |
| Fenêtre de contexte | 1,048,576 tokens (1M) |
| Sortie maximale | 131,072 tokens (128K) |
| Raisonnement | Deep thinking |
| Appel d’outils | Pris en charge |
| Streaming | Pris en charge |
| Recherche Web | Pris en charge |
| Sortie structurée | Pris en charge |
| Mise en cache du contexte | Pris en charge |
| Protocoles API | Compatible OpenAI, compatible Anthropic |
| URL de base de l’API native | https://api.xiaomimimo.com/v1 |
La page officielle du modèle de Xiaomi indique que le texte, l’image, la vidéo et l’audio sont des modalités d’entrée prises en charge, avec une sortie textuelle. Elle mentionne également la compréhension multimodale, la réflexion approfondie, l’appel d’outils, le streaming, la recherche Web, la sortie structurée et la mise en cache du contexte. La fenêtre de contexte documentée est de 1M tokens et la sortie maximale est de 128K tokens.
Qu’est-ce que MiMo-V2.6-Pro-UltraSpeed ?
MiMo-V2.6-Pro-UltraSpeed est la version de service à faible latence de MiMo-V2.6-Pro de Xiaomi, conçue pour les applications où la capacité de raisonnement du modèle Pro doit être associée à une génération de sortie sensiblement plus rapide.
Xiaomi indique qu’UltraSpeed conserve les capacités de niveau phare de V2.6-Pro tout en offrant jusqu’à 20× plus de vitesse de génération que le mode de service V2.6-Pro standard. Xiaomi cible spécifiquement les interactions en temps réel et les charges de production sensibles à la latence de réponse.
La distinction porte donc principalement sur la vitesse d’inférence et le mode de service, et non sur une nouvelle famille de capacités. Des catalogues de modèles indépendants décrivent également UltraSpeed comme une variante hébergée à haute vitesse de la famille MiMo-V2.6-Pro plutôt qu’un point de contrôle open-weight publié séparément.
Principales fonctionnalités de MiMo-V2.6-Pro-UltraSpeed
- Inférence Pro ultra-rapide : Xiaomi affirme que la génération de sortie peut atteindre jusqu’à 20× la vitesse de MiMo-V2.6-Pro standard, ciblant les systèmes de production sensibles à la latence.
- Entrée multimodale complète : Le modèle accepte le texte, les images, la vidéo et l’audio, tout en générant des réponses textuelles.
- Contexte de 1M de tokens : La fenêtre de contexte de 1,048,576 tokens prend en charge de grands dépôts, des documents longs, du contexte multimodal et des sessions d’agent étendues.
- Raisonnement approfondi : UltraSpeed conserve le comportement orienté raisonnement de la famille MiMo-V2.6-Pro plutôt que d’être réduit à un modèle léger de génération uniquement. Xiaomi le décrit explicitement comme conservant les performances Pro.
- Flux d’agent et d’outils : L’appel d’outils, la sortie structurée, la recherche Web, le streaming et la mise en cache du contexte figurent parmi les capacités prises en charge.
- Compatibilité des protocoles OpenAI et Anthropic : Xiaomi fournit des exemples d’intégration pour les deux protocoles, permettant aux développeurs d’adapter des clients API existants plutôt que de créer une intégration propriétaire de zéro.
MiMo-V2.6-Pro-UltraSpeed vs MiMo-V2.6-Pro vs MiMo-V2.6-Flash
| Modèle | Positionnement principal | Contexte | Sortie max | Distinction clé |
|---|---|---|---|---|
| MiMo-V2.6-Pro-UltraSpeed | Service Pro en temps réel / sensible à la latence | 1M | 128K | Vitesse de sortie annoncée jusqu’à 20× vs Pro |
| MiMo-V2.6-Pro | Modèle de raisonnement phare | 1M | 128K | Inférence Pro standard |
| MiMo-V2.6-Flash | Modèle V2.6 davantage orienté efficacité | 1M | 128K | Conçu pour des charges plus légères et sensibles aux coûts |
Xiaomi décrit V2.6-Pro comme son modèle de raisonnement phare pour des projets complexes, des tâches de longue haleine, des travaux à forts enjeux, la cybersécurité et la recherche, tandis qu’UltraSpeed est spécifiquement optimisé pour la version sensible à la latence de cette expérience Pro.
La tarification officielle illustre également qu’UltraSpeed est un palier de service distinct : Xiaomi liste actuellement $4.35/M en entrée et $8.70/M en sortie pour UltraSpeed, contre $0.435/M en entrée et $0.87/M en sortie pour V2.6-Pro standard. L’entrée avec cache-hit est indiquée à $0.036/M pour UltraSpeed.
Limitations de MiMo-V2.6-Pro-UltraSpeed
- Les chiffres de vitesse d’UltraSpeed sont des déclarations du fournisseur : Xiaomi mentionne “jusqu’à 20×” plus rapide, mais aucune mesure standardisée indépendante pour ce palier de service spécifique n’a été trouvée.
- Sortie textuelle uniquement : Bien que le modèle accepte des entrées texte, image, vidéo et audio, la modalité de sortie documentée est le texte.
- Distinction de service hébergé : UltraSpeed ne doit pas être décrit comme un point de contrôle open-weight distinct sans qualification. Les sources actuelles distinguent le modèle MiMo-V2.6-Pro ouvert standard du mode de service UltraSpeed hébergé.
- Tarification des tokens plus élevée que le Pro standard : Les tarifs UltraSpeed listés par Xiaomi sont sensiblement plus élevés que ceux de MiMo-V2.6-Pro standard. Le compromis pertinent concerne donc la latence vs le coût par token plutôt que la simple capacité du modèle.
- Débit spécifique au compte : Xiaomi liste les RPM/TPM pour UltraSpeed comme un service personnalisé plutôt que de publier une limite universelle sur la page du modèle.
Cas d’utilisation recommandés
Assistance au codage en temps réel
Xiaomi identifie spécifiquement l’assistance au codage en temps réel comme un scénario UltraSpeed. Une génération plus rapide peut réduire le délai perçu lors de la complétion de code, du débogage et du développement interactif.
Contrôle des risques en temps réel
Le modèle est également positionné pour des flux de contrôle des risques sensibles à la latence où le raisonnement doit se produire dans une fenêtre opérationnelle courte. Xiaomi cite la lutte contre la fraude et l’évaluation des risques en temps réel comme exemple.
Analyse quantitative et de marché
Xiaomi liste le trading quantitatif comme un autre scénario cible, où le traitement rapide de nouvelles informations et la génération de sorties analytiques peuvent être importants. Il s’agit d’un exemple de cas d’usage documenté par Xiaomi, et non de la preuve que le modèle produit de manière autonome des décisions de trading fiables.
Recherche scientifique
La page officielle du modèle décrit la génération et la validation d’hypothèses en temps réel comme un flux de travail de recherche potentiel, en particulier lorsque la réduction de la latence de réponse du modèle peut améliorer l’expérimentation interactive.
Agents multimodaux à long contexte
La combinaison d’une fenêtre de contexte de 1M tokens, d’entrées multimodales, du raisonnement, de l’appel d’outils, du streaming et de la mise en cache du contexte rend UltraSpeed pertinent pour des systèmes d’agents à long contexte qui doivent traiter des quantités substantielles d’informations mixtes tout en maintenant une vitesse de réponse interactive.