
Xiaomi MiMo-V3-Flash : le modèle rapide non publié tourne-t-il dans l'Omen Alpha d'OpenCode ?
- googleNOUVEAUGoogle: Gemini 3.8 Flash2026-09-0259Intelligence76Code
- qwenNOUVEAUQwen: Qwen3.8 Max (0902)2026-09-0258Intelligence72Code
- anthropicNOUVEAUAnthropic: Claude Fable 5.12026-09-0166Intelligence82Code
- AlibabaNOUVEAUQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens
- z-aiNOUVEAUZ.ai: GLM 5.3 Flash2026-08-2658Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 par million de tokens
- z-aiZ.ai: GLM 5.32026-08-1860Intelligence75Code
- obsidianQwen3.8 27B2026-08-1552Intelligence68Code
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligence69Code
- grokSpaceXAI: Grok 4.62026-08-1261Intelligence77Code
- metaMeta: Muse Spark 1.22026-08-0557Intelligence72Code
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligence72Code
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligence69Code
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 par million de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligence78Code
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligence69Code
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligence49Code
Xiaomi MiMo-V3-Flash n'a pas été annoncé par Xiaomi. Il n'y a ni fiche de modèle, ni poids Hugging Face, ni page de tarification, ni billet de lancement — ce nom ne circule que pour une seule raison : le 4 septembre 2026, teortaxesTex, analyste IA indépendant de premier plan, a déclaré publiquement croire qu'Omen Alpha — le « modèle furtif » anonyme qu'OpenCode a commencé à proposer à ses abonnés Go le matin même — est Xiaomi MiMo-V3-Flash. Son identification repose principalement sur ce qu'il interprète comme la chaîne de pensée d'un modèle de l'ère GA de DeepSeek V4 dans la trace de raisonnement visible d'Omen Alpha — ce qui, si cela se confirme, ferait de Xiaomi MiMo-V3-Flash un niveau rapide construit par Xiaomi et entraîné sur les poids ouverts V4 de DeepSeek. Rien dans cette identification n'est confirmé, et cet article la traite exactement pour ce qu'elle est : une hypothèse bien argumentée dans un jeu de devinettes actif.
Les règles de base pour ce qui suit : le lancement d’Omen Alpha est un fait confirmé, et l’affirmation de l’analyste est une affirmation étiquetée comme telle. L’existence de la génération V3 est appuyée par un aperçu de conférence et un benchmark divulgué, tous deux clairement indiqués comme non confirmés par Xiaomi. L’affirmation selon laquelle un modèle nommé Xiaomi MiMo-V3-Flash existe est une inférence fondée sur le comportement, et non une déclaration de Xiaomi — et puisque Xiaomi n’en a fait aucune, aucune n’est répétée ici comme un fait.
L'affirmation et les quatre raisons qui la sous-tendent
Le déclencheur a été un rapport de développeur. Un développeur testant Omen Alpha dans OpenCode, publiant sous le pseudonyme @SPAC89, a écrit que « Omen Alpha High » — le modèle dans son réglage de raisonnement élevé — avait terminé une tâche de codage substantielle en moins de dix minutes, et qu’une exécution beaucoup plus longue, de plusieurs heures, était en cours. En citant ce rapport, teortaxesTex a déclaré penser que le modèle est Xiaomi MiMo-V3-Flash et a donné quatre raisons, toutes comportementales plutôt que documentaires :
• La trace de raisonnement. La chaîne de pensée visible ressemble à du DeepSeek V4 GA CoT — ses tics sont « hmm », « fine » et les éléments de liste préfixés par ✓. La capture d'écran qu'il a jointe montre Omen Alpha en cours de construction avec le réglage « high » et une trace qui correspond au schéma.
• La vitesse. Le modèle est rapide — c'est l'observation à laquelle il répondait — et le niveau rapide de Xiaomi a historiquement porté le nom « Flash ».
• L'opérateur. DeepSeek ne mène pas de promotions cachées, donc même si le raisonnement provient à l'origine du DeepSeek V4 GA, celui qui est derrière Omen Alpha est un tiers qui s'est bâti sur DeepSeek, plutôt que DeepSeek lui-même.
• Le clustering. Les textes de sortie des modèles Xiaomi MiMo se regroupent avec ceux de DeepSeek — c'est son raccourci pour désigner deux générations dont les textes sont proches en distribution, ce à quoi ressemblerait un modèle entraîné sur DeepSeek. Il cite une alternative qui se regroupe également avec DeepSeek, le Step-4 de StepFun, et dit qu'il n'est pas sûr de la génération actuelle de StepFun.
Le messager vaut une clause, car le même fait joue dans les deux sens. teortaxesTex se présente comme un adepte de DeepSeek — son profil X le présente comme un fan de DeepSeek depuis 2023. C'est le profil de quelqu'un qui peut reconnaître un style de raisonnement DeepSeek V4 au premier coup d'œil, et aussi le profil de quelqu'un enclin à en voir un.
Où se situerait un MiMo-V3-Flash dans la gamme de Xiaomi.
Les modèles MiMo officiellement confirmés par Xiaomi aujourd'hui sont le MiMo-V2.5 et le MiMo-V2.5-Pro, tous deux publiés en open source sous licence MIT fin avril 2026. Le MiMo-V2.5-Pro est un modèle de mélange d'experts (MoE) à 1 020 milliards de paramètres, avec 42 milliards de paramètres actifs et une fenêtre contextuelle d'un million de jetons ; le MiMo-V2.5 est le petit frère polyvalent, avec 310 milliards de paramètres. Derrière eux, dans l'arbre généalogique, se trouvent le MiMo-V2-Flash (décembre 2025, un MoE open source à 309 milliards de paramètres) et le MiMo-V2-Pro (mars 2026) — et le MiMo-V2-Pro est important pour cette histoire parce qu'il a d'abord fait son apparition publique de façon anonyme sous le nom de code Hunter Alpha, avant que Xiaomi ne le revendique. Les tests anonymes sur le terrain ne sont pas une exception pour Xiaomi ; ils font partie intégrante de sa méthode de lancement.
La génération V3 marque le passage du produit livré au simple rapport. À l'ICML en juillet 2026, Luo Fuli, la chercheuse qui dirige l'équipe MiMo, a présenté un aperçu de l'architecture de V3. Le point central est un design que Xiaomi appelle High Sparse : un petit nombre de couches à attention complète agissent comme un « oracle » qui sélectionne les tokens auxquels les couches éparses environnantes doivent prêter attention, et ces couches éparses partagent le cache KV des couches à attention complète au lieu de conserver le leur. Xiaomi affirme que cela réduit la mémoire du cache KV d'environ dix fois et a validé un ratio épars/complet de 11:1 sur un modèle à l'échelle de 80 milliards de paramètres, égalant la qualité de l'attention complète tandis qu'un modèle de référence hybride à fenêtre glissante perdait environ sept points MMLU à la même éparsité. Ce sont les affirmations de l'équipe, présentées lors d'une conférence, et non des résultats indépendants. Puis, le 21 août, une prétendue capture d'écran de benchmarks pour un MiMo-V3-Pro a commencé à circuler, partagée par Max For AI : SWE-Bench Pro 72,8, contre 67,9 pour GLM 5.3, 65,8 pour Kimi K3, 74,6 pour Claude Opus 5 et 75,4 pour GPT-5.6 Sol Max, plus Terminal-Bench 2.0 70,6 et τ3-bench 76,4. Xiaomi n'a rien confirmé, et l'existence de V3 ainsi que le calendrier de sa sortie restent non annoncés. La conclusion à en tirer pour cet article est plus étroite : la génération V3 est manifestement en marche, mais aucun modèle V3 n'a été livré — ce qui explique précisément pourquoi un Xiaomi MiMo-V3-Flash non annoncé qui referait surface discrètement serait une nouvelle plutôt qu'un événement banal.
Pourquoi un Flash — et pourquoi OpenCode Go — conviendrait
Le niveau Flash est la façon dont Xiaomi distribue une capacité rapide et bon marché ; elle a fait de même avec MiMo-V2-Flash en décembre. Et OpenCode Go est un terrain d'essai plausible, car il exécute déjà le modèle open source actuel de Xiaomi : la même gamme Go qui répertorie Omen Alpha à 11 600 requêtes toutes les cinq heures liste également MiMo-V2.5 à 30 100, parmi les allocations les plus généreuses de la page. Une équipe de Xiaomi testant un V3-Flash aux côtés de son propre MiMo-V2.5 sur une seule plateforme obtiendrait une comparaison directe avec la génération précédente, à coût marketing nul, sur une plateforme qui a déjà accueilli une révélation anonyme ce mois-ci. C'est un argument en faveur de la plausibilité, pas une preuve d'identité.

La forme du produit pointe dans la même direction. Omen Alpha, avec son réglage de raisonnement « élevé » qui aboutit en moins de dix minutes, correspond au comportement attendu d’un palier de raisonnement rapide, et les chiffres de tiers qui circulent pour Omen Alpha — environ 0,20 dollar par million de jetons en entrée et 0,66 dollar par million en sortie, d’après des reproductions de presse plutôt qu’une grille tarifaire officielle — le placent dans le bas du marché, aux côtés de DeepSeek V4 Flash. Un modèle qui se comporte comme un raisonneur rapide et bon marché de la génération DeepSeek est exactement ce à quoi ressemblerait un palier « Flash » bâti sur DeepSeek V4. Rapporté et déduit, encore une fois, non confirmé.
Le lien avec DeepSeek est le point crucial — et la preuve la plus faible.
Pourquoi DeepSeek V4 GA compte vraiment : la gamme V4 de DeepSeek est passée de l’aperçu à la disponibilité générale en août 2026, lorsque DeepSeek V4 Pro a livré son build GA 0813 le 13 août, avec des poids ouverts sous licence MIT, aux côtés de son petit frère moins cher, DeepSeek V4 Flash. Des poids ouverts sous licence MIT signifient qu’un tiers peut légalement les utiliser comme base, et la façon habituelle qu’a la communauté de repérer un tel modèle est le style de raisonnement qu’il hérite : la chaîne de pensée de l’ère GA de DeepSeek présente des habitudes verbales reconnaissables, et ce sont précisément ces habitudes que teortaxesTex dit voir dans la trace d’Omen Alpha. S’il a raison sur le fait que la trace est bien DeepSeek V4 GA, et raison sur le fait que l’opérateur est Xiaomi, alors Xiaomi MiMo-V3-Flash serait la déclinaison rapide de Xiaomi construite sur les poids de raisonnement ouverts de DeepSeek — un choix légal mais stratégiquement notable, et qui expliquerait parfaitement pourquoi un modèle prétendument Xiaomi raisonne comme un DeepSeek.
Maintenant, la partie difficile. Une ressemblance de chaîne de pensée est la classe la plus faible d’empreinte de modèle, car elle relève du style plutôt que de la structure. L’identification du modèle anonyme qui a effectivement tenu ce mois-ci — Ox Alpha en tant que GLM-5.3-Flash — a été tranchée sur des preuves bien plus solides : la correspondance des tokeniseurs et l’analyse médico-légale de l’encodage vidéo. Aucune empreinte dure comparable n’a été publiée pour désigner Omen Alpha comme un produit Xiaomi. L’interprétation dominante de la communauté, de surcroît, pointe ailleurs : les développeurs rapportent que les requêtes backend d’Omen Alpha se résolvent dans un espace de noms « zhipu », certains testeurs décrivent le modèle comme s’identifiant lui-même comme étant basé sur GLM, et la lecture de presse du lancement est qu’Omen Alpha est la deuxième publication anonyme de Zhipu AI en neuf jours, après la sortie Ox Alpha qui avait été interprétée comme GLM-5.3-Flash. Si cette lecture est juste, le raisonnement à la saveur DeepSeek est soit une coïncidence stylistique, soit un signe que le modèle de Zhipu a lui-même été entraîné avec des traces de DeepSeek — mais ce n’est pas un produit Xiaomi. Les deux camps ne peuvent pas avoir raison à la fois, et aucun des deux camps ne dispose d’une déclaration du laboratoire qu’il nomme.

Qu'est-ce qui réglerait ça ?
• Une déclaration de Xiaomi — ou des poids. Xiaomi a publié ses modèles MiMo en open source depuis MiMo-V2-Flash, avec MiMo-V2.5 et MiMo-V2.5-Pro diffusés sous licence MIT ; un véritable Xiaomi MiMo-V3-Flash serait très probablement confirmé comme le fut GLM-5.3-Flash, avec des poids et une carte de modèle sur Hugging Face.
• Une empreinte fiable. La correspondance des tokenizers a été la preuve qui a identifié Ox Alpha ; aucun test de tokenizer rattachant Omen Alpha à Xiaomi n'a été publié.
• L'auto-description du modèle. Certains testeurs indiquent qu'Omen Alpha se décrit comme étant basé sur GLM. L'auto-description d'un modèle est une donnée, mais ce n'est pas une provenance.
• Benchmarks indépendants d'Omen Alpha. Des évaluations neutres du modèle anonyme permettraient à la communauté de le comparer aux chiffres de MiMo-V3-Pro qui ont fuité en août.
• La révélation après la fenêtre Go. Les modèles anonymes passés ont été revendiqués des jours à des semaines après leur lancement ; celui qui revendiquera Omen Alpha nommera le modèle exactement.
Que faire pendant que les suppositions continuent
La position pratique ne dépend pas de qui a raison. Omen Alpha est un modèle anonyme derrière un abonnement à 10 $ par mois, et Xiaomi MiMo-V3-Flash est un nom non confirmé qui lui est associé ; aucun des deux n'est un pari à faire sur une chaîne de production aujourd'hui. Lorsqu'un fabricant se manifeste et que le modèle sous-jacent atteint des API ordinaires, c'est le moment où une couche de routage gagne sa place : OrcaRouter transmet les prix catalogue des fournisseurs avec une marge de 0 %, de sorte qu'un tarif nouvellement publié est actif sur la même API le jour où le fournisseur le publie, et le basculement automatique vous permet d'envoyer une partie du trafic réel vers un nouveau venu non éprouvé, avec un repli sur un modèle auquel vous faites déjà confiance. Pendant ce temps, la chose à surveiller est simple : quelqu'un revendique-t-il Omen Alpha, et Xiaomi MiMo-V3-Flash apparaît-il un jour sur une fiche de modèle ? L'une de ces deux choses arrivera.

En date du 4 septembre 2026, Xiaomi MiMo-V3-Flash est un nom, une forme de produit plausible et une hypothèse d'analyste importante — pas un modèle publié. La génération V3 est suffisamment réelle pour avoir été présentée en avant-première en juillet et avoir fait l'objet de fuites en août. Que sa première apparition publique ait lieu en ce moment même sous le nom de code Omen Alpha est une question à laquelle seule Xiaomi peut répondre, et elle n'y a pas répondu.
Comparés dans cet article2
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
