
Xiaomi MiMo-V2.6-Pro vs MiniMax M3 : le meilleur score a la route la plus étroite
- OrcaNOUVEAUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 par million de tokens
- orcaNOUVEAUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens
- deepseekNOUVEAUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligence69Code
- grokSpaceXAI: Grok 4.62026-08-1244Intelligence77Code
- metaMeta: Muse Spark 1.22026-08-0540Intelligence72Code
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligence76Code
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligence69Code
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 par million de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Xiaomi MiMo-V2.6-Pro est entré en disponibilité générale le 22 septembre 2026 et a pris la première place des modèles à poids ouverts sur l’Artificial Analysis Intelligence Index, avec un score de 46 sur la v4.3.2. MiniMax M3 détient une version de ce titre depuis son lancement le 31 mai 2026, et sur le même indice aujourd’hui, il obtient 29 — soit dix-sept points de retard. Le score est l’aspect le moins intéressant de ce duo. MiniMax M3 sert à 168,9 jetons de sortie par seconde contre 134,3, répond en 0,92 seconde contre 2,15, coûte moins cher par jeton d’entrée et est accessible via quinze fournisseurs d’API contre un seul pour Xiaomi. Le modèle plus récent et mieux noté est celui qu’il est le plus difficile de réellement utiliser, et c’est cette inversion qui fait l’objet de cette comparaison.
Tous deux à poids ouverts, tous deux multimodaux, à quatorze semaines d'intervalle
Les deux modèles sont proches parents par l’intention de conception. Tous deux sont des modèles à mélange d’experts clairsemé issus de laboratoires chinois, tous deux disposent d’une fenêtre de contexte de 1 million de jetons, tous deux acceptent nativement les images et la vidéo plutôt que via un adaptateur ajouté après coup, et tous deux publient leurs poids. Quatorze semaines séparent leurs publications, et l’écart d’indice entre eux correspond à la distance parcourue par la frontière des modèles à poids ouverts pendant cette période.
• Paramètres totaux — Xiaomi MiMo-V2.6-Pro 1,02 T ; MiniMax M3 environ 427 B, tous deux des MoE clairsemés
• Actifs par token — Xiaomi MiMo-V2.6-Pro 42B ; MiniMax M3 environ 23–25B
• Contexte — 1 M de tokens chacun, avec MiniMax M3 garantissant un minimum de 512 K
• Modalités d'entrée — texte, image et vidéo pour les deux ; Xiaomi ajoute l'entrée audio
• Poids — licence MIT pour Xiaomi MiMo-V2.6-Pro ; MiniMax M3 est distribué sous la MiniMax Community Licence, qui n’est pas permissive et exige un accord distinct pour une utilisation commerciale
• Sortie — Xiaomi MiMo-V2.6-Pro les 21–22 septembre 2026 ; MiniMax M3 le 31 mai 2026
• Accessibilité — un fournisseur d'API comptabilisé pour Xiaomi MiMo-V2.6-Pro sur Artificial Analysis ; quinze pour MiniMax M3
Cette dernière ligne est celle qu'il faut garder en vue. Tout le reste sur la fiche favorise le modèle le plus récent. Cette ligne, elle, ne le fait pas, et c'est cette ligne qui détermine si un modèle peut prendre place dans un chemin de production.
Ce que l’indice mesure, et qui l’a mesuré
Artificial Analysis a exécuté elle-même les deux modèles sur v4.3.2 — un composite de dix évaluations couvrant le raisonnement, les connaissances, les mathématiques et le codage, notamment AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience et AA-LCR v1.1. Ni le 46 ni le 29 n'est un chiffre de fournisseur, ce qui importe ici, car les deux laboratoires ont aussi publié leurs propres résultats de benchmark, qui sont des chiffres de fournisseur, et les deux types ne doivent pas être mélangés.
Le score de 46 place Xiaomi MiMo-V2.6-Pro en tête du domaine des poids ouverts sur ce composite. Il ne le place pas en tête de l'indice : Claude Fable 5.1 et GPT-6 Astra se situent tous deux à 53, et Claude Opus 5 à 51. Le 29 de MiniMax M3 le place seizième sur 114 modèles mesurés, bien au-dessus de la médiane de sa catégorie de taille, mais loin de la frontière à laquelle il était comparé en juin.
MiniMax M3 a les preuves que Xiaomi n'a pas
C'est la partie de la comparaison que l'on saute, et c'est celle à laquelle un acheteur devrait accorder le plus de poids. MiniMax M3 figure sur le classement public DeepSWE v1.1 avec une entrée officielle : 20,4 % en Pass@1 et 48,7 % en Pass@4, publiée le 8 juin 2026 après qu'une mise à niveau de l'inférence MiniMax a corrigé une génération de tokens anormale et amélioré le comportement du cache en contexte long. Cette entrée était assortie d'un bilan d'efficacité, et ce bilan n'est pas flatteur : une médiane de 311 étapes d'agent, environ 91 000 tokens de sortie et environ 5,04 $ par tâche. Il réussit des tâches d'ingénierie à long horizon, et il le fait à grands frais.
Le chiffre de référence phare de Xiaomi pour son nouveau modèle est de 72,57 sur DeepSWE v1.1, contre une base de référence de 58,4, mesuré avec mini-swe-agent en moyenne sur trois exécutions sur le propre banc d’essai de Xiaomi. Il ne s’agit pas d’une entrée de classement et il n’a pas été soumis comme telle. Mettre 72,57 à côté du 20,4 de MiniMax et en déduire une victoire de 52 points relève d’une arithmétique entre deux mesures différentes : le classement publie un Pass@1 pour une configuration spécifique, avec un intervalle de confiance et un coût moyen par tâche qu’un tiers peut reproduire, tandis que le chiffre du fournisseur n’a rien de tout cela attaché à lui. Le 72,57 est peut-être tout à fait honnête. Ce n’est simplement pas le même type d’objet.
MiniMax a également publié ses propres chiffres de lancement, et la même mise en garde s’applique à chacun d’entre eux : SWE-Bench Pro à 59,0, BrowseComp à 83,5, SVG-Bench à 63,7 et Terminal-Bench 2.1 à 66,0, exécutés sur l’infrastructure propre de MiniMax avec son propre échafaudage. Considérez-les comme des affirmations concernant le modèle, et non comme des mesures de celui-ci.
Vitesse, latence, et les deux chiffres qui décident d'une facture
L'écart de débit va à l'opposé de l'écart de qualité, et il est suffisamment large pour compter. MiniMax M3 génère 168,9 tokens de sortie par seconde contre 134,3 pour Xiaomi MiMo-V2.6-Pro, et son délai de 0,92 seconde jusqu'au premier token est environ deux fois et demie plus rapide que les 2,15 de Xiaomi. Pour un produit interactif, la latence du premier token est le chiffre que l'utilisateur ressent ; pour un pipeline par lots, le débit est le chiffre qui détermine le temps d'horloge.
En termes de coût, les deux sont plus proches que ne le suggèrent les tarifs affichés, et le sens de l'écart dépend de votre trafic. MiniMax M3 est affiché à 0,30 $ par million de tokens en entrée et 1,20 $ par million en sortie ; Xiaomi MiMo-V2.6-Pro est affiché à 0,43 $ et 0,87 $. M3 coûte moins cher à alimenter, Xiaomi coûte moins cher à générer. Une fois les remises de cache appliquées — 80 % pour M3, 99 % pour Xiaomi — les tarifs mixtes s'établissent à 0,22 $ et 0,18 $ par million sur une répartition 7:2:1 hits de cache/entrée/sortie. Artificial Analysis enregistre également un coût de 0,13 $ par tâche de l'Intelligence Index pour Xiaomi MiMo-V2.6-Pro, mesuré de la même manière pour tous les modèles du classement, ce qui constitue le chiffre de coût unique le plus comparable disponible pour les deux.

Quinze routes contre une, et ce que vaut le basculement
Un avantage de dix-sept points sur l'indice ne vous aide pas si le point d'accès est hors service. Artificial Analysis ne comptait qu'un seul fournisseur d'API pour Xiaomi MiMo-V2.6-Pro au moment de la rédaction, et ce chiffre en dit plus sur le lancement que sur le modèle : un checkpoint publié il y a trois jours n'a pas eu le temps de se propager. MiniMax M3, vieux de quatre mois, est servi par quinze fournisseurs.
Cette différence, c'est précisément le rôle d'un routeur, et c'est là que les deux modèles divergent sur le plan commercial. MiniMax M3 est disponible sur OrcaRouter sous minimax/minimax-m3 : un point de terminaison compatible OpenAI, avec le prix catalogue du fournisseur répercuté tel quel et 0 % de marge, de sorte que les $0.30 et $1.20 ci-dessus sont les chiffres de MiniMax et non les nôtres, et qu'une modification des prix MiniMax est effective de notre côté le jour même. Ses quinze fournisseurs en amont sont ce qui donne tout son sens à une chaîne de bascule automatique — une requête qui se bloque chez un fournisseur est réessayée auprès d'un autre avant que la réponse ne commence, ce qui constitue une garantie différente de celle d'un modèle qui n'a qu'une seule destination. Xiaomi MiMo-V2.6-Pro n'est pas sur OrcaRouter ; aucun modèle Xiaomi ne l'est, et y accéder aujourd'hui suppose de passer par la plateforme de Xiaomi elle-même et par les catalogues tiers qui le référencent.
Si vous voulez les deux dans la même application, la forme pratique est une seule clé regroupant les modèles que vous avez déjà retenus, le nouveau venu étant évalué par rapport à eux plutôt qu’adopté sur la foi d’un score vieux de trois jours. C’est une décision de routage, et la propriété utile est qu’une voie de repli ne coûte rien jusqu’au jour où elle vous sauve.

Lequel choisir
Si vous avez besoin cette semaine, en production, d'un modèle multimodal à poids ouverts et à un million de jetons, la réponse est MiniMax M3, et il n'y a pas photo — quinze fournisseurs, un premier jeton en moins d'une seconde, une voie commerciale suffisamment permissive à condition d'avoir lu la licence communautaire, et une entrée officielle de benchmark à long horizon que vous pouvez consulter. L'avertissement sur l'efficacité est réel : prévoyez un budget pour les 91 000 jetons de sortie par tâche, pas seulement pour le tarif par jeton.
Si vous choisissez un modèle pour un travail que vous commencerez le mois prochain, Xiaomi MiMo-V2.6-Pro est le modèle le plus performant, avec une large marge mesurée, à un tarif mixte inférieur et avec une licence MIT qui élimine entièrement la conversation sur les licences. Ce qu'il n'a pas encore, c'est un second endroit où tourner. Ce qu'il faut surveiller, c'est le nombre de fournisseurs : quand il dépassera un, l'écart de dix-sept points cessera d'être un résultat de recherche et deviendra une décision de déploiement.
D’ici là, le résumé honnête est que le meilleur modèle est celui depuis lequel vous ne pouvez pas basculer, et le modèle le plus faible est celui que vous pouvez mettre devant les clients ce soir.

D'où viennent les chiffres dans ce texte ?
Les scores d'indice, le débit, la latence, les remises sur le cache et le nombre de fournisseurs pour les deux modèles sont des mesures d'Artificial Analysis sur l'Intelligence Index v4.3.2, relevées le 22 septembre 2026, et le 29 de MiniMax M3 repose sur la même version du composite que le 46 de Xiaomi MiMo-V2.6-Pro. Les chiffres DeepSWE v1.1 pour MiniMax M3 proviennent de l'entrée publique du classement du 8 juin 2026. L'évolution DeepSWE de 58,4 à 72,57, les dépenses d'apprentissage par renforcement d'environ 2,62 millions de dollars pour l'exécution Pro sur trente étapes, ainsi que les chiffres SWE-Bench Pro, BrowseComp, SVG-Bench et Terminal-Bench pour MiniMax M3 sont tous rapportés par les fournisseurs sur les harnais propres aux laboratoires respectifs et n'ont pas été reproduits de manière indépendante. Les tarifs par token correspondent aux prix catalogue des fournisseurs eux-mêmes.
