Carte titre hero pour l'article « Xiaomi MiMo-V3-Flash », surmontée du surtitre « OrcaRouter · radar des modèles — fuite », avec le titre « Xiaomi MiMo-V3-Flash », le sous-titre « Un analyste affirme que l'Omen Alpha anonyme d'OpenCode est le modèle rapide non publié de Xiaomi. Personne chez Xiaomi ne l'a confirmé. », une carte de gauche intitulée « L'affirmation » indiquant « teortaxesTex, 4 sept. 2026 — citant un test de vitesse de première main de l'Omen Alpha » avec la ligne « Omen Alpha est Xiaomi MiMo-V3-Flash. », une carte de droite intitulée « Le statut » indiquant « Xiaomi n'a rien annoncé — ni poids, ni fiche modèle, ni page de tarifs » avec la ligne « Non confirmé · inférence uniquement », et quatre pastilles indiquant « Fabricant : non confirmé », « Le CoT ressemble à DeepSeek V4 GA », « Omen Alpha · OpenCode Go uniquement » et « Raisonnement avancé · rapide ». Le logo OrcaRouter est incrusté dans le coin inférieur droit.
Guides & Insights

Xiaomi MiMo-V3-Flash : le modèle rapide non publié tourne-t-il dans l'Omen Alpha d'OpenCode ?

Auteur

Gideon Frost

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Xiaomi MiMo-V3-Flash n'a pas été annoncé par Xiaomi. Il n'y a ni fiche de modèle, ni poids Hugging Face, ni page de tarification, ni billet de lancement — ce nom ne circule que pour une seule raison : le 4 septembre 2026, teortaxesTex, analyste IA indépendant de premier plan, a déclaré publiquement croire qu'Omen Alpha — le « modèle furtif » anonyme qu'OpenCode a commencé à proposer à ses abonnés Go le matin même — est Xiaomi MiMo-V3-Flash. Son identification repose principalement sur ce qu'il interprète comme la chaîne de pensée d'un modèle de l'ère GA de DeepSeek V4 dans la trace de raisonnement visible d'Omen Alpha — ce qui, si cela se confirme, ferait de Xiaomi MiMo-V3-Flash un niveau rapide construit par Xiaomi et entraîné sur les poids ouverts V4 de DeepSeek. Rien dans cette identification n'est confirmé, et cet article la traite exactement pour ce qu'elle est : une hypothèse bien argumentée dans un jeu de devinettes actif.

Les règles de base pour ce qui suit : le lancement d’Omen Alpha est un fait confirmé, et l’affirmation de l’analyste est une affirmation étiquetée comme telle. L’existence de la génération V3 est appuyée par un aperçu de conférence et un benchmark divulgué, tous deux clairement indiqués comme non confirmés par Xiaomi. L’affirmation selon laquelle un modèle nommé Xiaomi MiMo-V3-Flash existe est une inférence fondée sur le comportement, et non une déclaration de Xiaomi — et puisque Xiaomi n’en a fait aucune, aucune n’est répétée ici comme un fait.

L'affirmation et les quatre raisons qui la sous-tendent

Le déclencheur a été un rapport de développeur. Un développeur testant Omen Alpha dans OpenCode, publiant sous le pseudonyme @SPAC89, a écrit que « Omen Alpha High » — le modèle dans son réglage de raisonnement élevé — avait terminé une tâche de codage substantielle en moins de dix minutes, et qu’une exécution beaucoup plus longue, de plusieurs heures, était en cours. En citant ce rapport, teortaxesTex a déclaré penser que le modèle est Xiaomi MiMo-V3-Flash et a donné quatre raisons, toutes comportementales plutôt que documentaires :

• La trace de raisonnement. La chaîne de pensée visible ressemble à du DeepSeek V4 GA CoT — ses tics sont « hmm », « fine » et les éléments de liste préfixés par ✓. La capture d'écran qu'il a jointe montre Omen Alpha en cours de construction avec le réglage « high » et une trace qui correspond au schéma.

• La vitesse. Le modèle est rapide — c'est l'observation à laquelle il répondait — et le niveau rapide de Xiaomi a historiquement porté le nom « Flash ».

• L'opérateur. DeepSeek ne mène pas de promotions cachées, donc même si le raisonnement provient à l'origine du DeepSeek V4 GA, celui qui est derrière Omen Alpha est un tiers qui s'est bâti sur DeepSeek, plutôt que DeepSeek lui-même.

• Le clustering. Les textes de sortie des modèles Xiaomi MiMo se regroupent avec ceux de DeepSeek — c'est son raccourci pour désigner deux générations dont les textes sont proches en distribution, ce à quoi ressemblerait un modèle entraîné sur DeepSeek. Il cite une alternative qui se regroupe également avec DeepSeek, le Step-4 de StepFun, et dit qu'il n'est pas sûr de la génération actuelle de StepFun.

Le messager vaut une clause, car le même fait joue dans les deux sens. teortaxesTex se présente comme un adepte de DeepSeek — son profil X le présente comme un fan de DeepSeek depuis 2023. C'est le profil de quelqu'un qui peut reconnaître un style de raisonnement DeepSeek V4 au premier coup d'œil, et aussi le profil de quelqu'un enclin à en voir un.

Où se situerait un MiMo-V3-Flash dans la gamme de Xiaomi.

Les modèles MiMo officiellement confirmés par Xiaomi aujourd'hui sont le MiMo-V2.5 et le MiMo-V2.5-Pro, tous deux publiés en open source sous licence MIT fin avril 2026. Le MiMo-V2.5-Pro est un modèle de mélange d'experts (MoE) à 1 020 milliards de paramètres, avec 42 milliards de paramètres actifs et une fenêtre contextuelle d'un million de jetons ; le MiMo-V2.5 est le petit frère polyvalent, avec 310 milliards de paramètres. Derrière eux, dans l'arbre généalogique, se trouvent le MiMo-V2-Flash (décembre 2025, un MoE open source à 309 milliards de paramètres) et le MiMo-V2-Pro (mars 2026) — et le MiMo-V2-Pro est important pour cette histoire parce qu'il a d'abord fait son apparition publique de façon anonyme sous le nom de code Hunter Alpha, avant que Xiaomi ne le revendique. Les tests anonymes sur le terrain ne sont pas une exception pour Xiaomi ; ils font partie intégrante de sa méthode de lancement.

La génération V3 marque le passage du produit livré au simple rapport. À l'ICML en juillet 2026, Luo Fuli, la chercheuse qui dirige l'équipe MiMo, a présenté un aperçu de l'architecture de V3. Le point central est un design que Xiaomi appelle High Sparse : un petit nombre de couches à attention complète agissent comme un « oracle » qui sélectionne les tokens auxquels les couches éparses environnantes doivent prêter attention, et ces couches éparses partagent le cache KV des couches à attention complète au lieu de conserver le leur. Xiaomi affirme que cela réduit la mémoire du cache KV d'environ dix fois et a validé un ratio épars/complet de 11:1 sur un modèle à l'échelle de 80 milliards de paramètres, égalant la qualité de l'attention complète tandis qu'un modèle de référence hybride à fenêtre glissante perdait environ sept points MMLU à la même éparsité. Ce sont les affirmations de l'équipe, présentées lors d'une conférence, et non des résultats indépendants. Puis, le 21 août, une prétendue capture d'écran de benchmarks pour un MiMo-V3-Pro a commencé à circuler, partagée par Max For AI : SWE-Bench Pro 72,8, contre 67,9 pour GLM 5.3, 65,8 pour Kimi K3, 74,6 pour Claude Opus 5 et 75,4 pour GPT-5.6 Sol Max, plus Terminal-Bench 2.0 70,6 et τ3-bench 76,4. Xiaomi n'a rien confirmé, et l'existence de V3 ainsi que le calendrier de sa sortie restent non annoncés. La conclusion à en tirer pour cet article est plus étroite : la génération V3 est manifestement en marche, mais aucun modèle V3 n'a été livré — ce qui explique précisément pourquoi un Xiaomi MiMo-V3-Flash non annoncé qui referait surface discrètement serait une nouvelle plutôt qu'un événement banal.

Pourquoi un Flash — et pourquoi OpenCode Go — conviendrait

Le niveau Flash est la façon dont Xiaomi distribue une capacité rapide et bon marché ; elle a fait de même avec MiMo-V2-Flash en décembre. Et OpenCode Go est un terrain d'essai plausible, car il exécute déjà le modèle open source actuel de Xiaomi : la même gamme Go qui répertorie Omen Alpha à 11 600 requêtes toutes les cinq heures liste également MiMo-V2.5 à 30 100, parmi les allocations les plus généreuses de la page. Une équipe de Xiaomi testant un V3-Flash aux côtés de son propre MiMo-V2.5 sur une seule plateforme obtiendrait une comparaison directe avec la génération précédente, à coût marketing nul, sur une plateforme qui a déjà accueilli une révélation anonyme ce mois-ci. C'est un argument en faveur de la plausibilité, pas une preuve d'identité.

A screenshot of the official OpenCode Go page, showing a 'New' promo banner reading 'GLM-5.3-Flash gets 2x usage limits for a limited time', the heading 'Low cost coding models for everyone', a 'Subscribe to Go $10/month' button, and the model lineup of per-model request allowances per five hours, including 'Omen Alpha — 11,600' and 'MiMo-V2.5 — 30,100' together with GLM-5.3-Flash (1,580, under the 2x banner), DeepSeek V4 Flash, LongCat-2.0, Kimi K3 and Muse Spark 1.3 Contributor (45,300).

La forme du produit pointe dans la même direction. Omen Alpha, avec son réglage de raisonnement « élevé » qui aboutit en moins de dix minutes, correspond au comportement attendu d’un palier de raisonnement rapide, et les chiffres de tiers qui circulent pour Omen Alpha — environ 0,20 dollar par million de jetons en entrée et 0,66 dollar par million en sortie, d’après des reproductions de presse plutôt qu’une grille tarifaire officielle — le placent dans le bas du marché, aux côtés de DeepSeek V4 Flash. Un modèle qui se comporte comme un raisonneur rapide et bon marché de la génération DeepSeek est exactement ce à quoi ressemblerait un palier « Flash » bâti sur DeepSeek V4. Rapporté et déduit, encore une fois, non confirmé.

Le lien avec DeepSeek est le point crucial — et la preuve la plus faible.

Pourquoi DeepSeek V4 GA compte vraiment : la gamme V4 de DeepSeek est passée de l’aperçu à la disponibilité générale en août 2026, lorsque DeepSeek V4 Pro a livré son build GA 0813 le 13 août, avec des poids ouverts sous licence MIT, aux côtés de son petit frère moins cher, DeepSeek V4 Flash. Des poids ouverts sous licence MIT signifient qu’un tiers peut légalement les utiliser comme base, et la façon habituelle qu’a la communauté de repérer un tel modèle est le style de raisonnement qu’il hérite : la chaîne de pensée de l’ère GA de DeepSeek présente des habitudes verbales reconnaissables, et ce sont précisément ces habitudes que teortaxesTex dit voir dans la trace d’Omen Alpha. S’il a raison sur le fait que la trace est bien DeepSeek V4 GA, et raison sur le fait que l’opérateur est Xiaomi, alors Xiaomi MiMo-V3-Flash serait la déclinaison rapide de Xiaomi construite sur les poids de raisonnement ouverts de DeepSeek — un choix légal mais stratégiquement notable, et qui expliquerait parfaitement pourquoi un modèle prétendument Xiaomi raisonne comme un DeepSeek.

Maintenant, la partie difficile. Une ressemblance de chaîne de pensée est la classe la plus faible d’empreinte de modèle, car elle relève du style plutôt que de la structure. L’identification du modèle anonyme qui a effectivement tenu ce mois-ci — Ox Alpha en tant que GLM-5.3-Flash — a été tranchée sur des preuves bien plus solides : la correspondance des tokeniseurs et l’analyse médico-légale de l’encodage vidéo. Aucune empreinte dure comparable n’a été publiée pour désigner Omen Alpha comme un produit Xiaomi. L’interprétation dominante de la communauté, de surcroît, pointe ailleurs : les développeurs rapportent que les requêtes backend d’Omen Alpha se résolvent dans un espace de noms « zhipu », certains testeurs décrivent le modèle comme s’identifiant lui-même comme étant basé sur GLM, et la lecture de presse du lancement est qu’Omen Alpha est la deuxième publication anonyme de Zhipu AI en neuf jours, après la sortie Ox Alpha qui avait été interprétée comme GLM-5.3-Flash. Si cette lecture est juste, le raisonnement à la saveur DeepSeek est soit une coïncidence stylistique, soit un signe que le modèle de Zhipu a lui-même été entraîné avec des traces de DeepSeek — mais ce n’est pas un produit Xiaomi. Les deux camps ne peuvent pas avoir raison à la fois, et aucun des deux camps ne dispose d’une déclaration du laboratoire qu’il nomme.

A two-column infographic titled 'Is Omen Alpha Xiaomi MiMo-V3-Flash?' with the subtitle 'The evidence, as of September 4, 2026'. The left column, headed 'FOR — the analyst's case', reads 'CoT reads as DeepSeek V4 GA — "hmm", "fine", ✓ lists', 'Fast — a big coding task finished in under 10 minutes', 'DeepSeek itself doesn't run stealth promotions', 'MiMo output text clusters with DeepSeek', and 'Xiaomi already ran Hunter Alpha as MiMo-V2-Pro'. The right column, headed 'AGAINST — the community's leading read', reads 'CoT style is the weakest fingerprint class', 'No tokenizer or infra evidence points at Xiaomi', 'Backend "zhipu" namespace observed by developers', 'Model reportedly self-identifies as GLM-based', and 'Press reads Omen Alpha as Zhipu's 2nd anonymous model'. A footer reads 'No Xiaomi statement exists — both columns are inference, not fact.' The OrcaRouter logo is composited in the bottom-right corner.

Qu'est-ce qui réglerait ça ?

• Une déclaration de Xiaomi — ou des poids. Xiaomi a publié ses modèles MiMo en open source depuis MiMo-V2-Flash, avec MiMo-V2.5 et MiMo-V2.5-Pro diffusés sous licence MIT ; un véritable Xiaomi MiMo-V3-Flash serait très probablement confirmé comme le fut GLM-5.3-Flash, avec des poids et une carte de modèle sur Hugging Face.

• Une empreinte fiable. La correspondance des tokenizers a été la preuve qui a identifié Ox Alpha ; aucun test de tokenizer rattachant Omen Alpha à Xiaomi n'a été publié.

• L'auto-description du modèle. Certains testeurs indiquent qu'Omen Alpha se décrit comme étant basé sur GLM. L'auto-description d'un modèle est une donnée, mais ce n'est pas une provenance.

• Benchmarks indépendants d'Omen Alpha. Des évaluations neutres du modèle anonyme permettraient à la communauté de le comparer aux chiffres de MiMo-V3-Pro qui ont fuité en août.

• La révélation après la fenêtre Go. Les modèles anonymes passés ont été revendiqués des jours à des semaines après leur lancement ; celui qui revendiquera Omen Alpha nommera le modèle exactement.

Que faire pendant que les suppositions continuent

La position pratique ne dépend pas de qui a raison. Omen Alpha est un modèle anonyme derrière un abonnement à 10 $ par mois, et Xiaomi MiMo-V3-Flash est un nom non confirmé qui lui est associé ; aucun des deux n'est un pari à faire sur une chaîne de production aujourd'hui. Lorsqu'un fabricant se manifeste et que le modèle sous-jacent atteint des API ordinaires, c'est le moment où une couche de routage gagne sa place : OrcaRouter transmet les prix catalogue des fournisseurs avec une marge de 0 %, de sorte qu'un tarif nouvellement publié est actif sur la même API le jour où le fournisseur le publie, et le basculement automatique vous permet d'envoyer une partie du trafic réel vers un nouveau venu non éprouvé, avec un repli sur un modèle auquel vous faites déjà confiance. Pendant ce temps, la chose à surveiller est simple : quelqu'un revendique-t-il Omen Alpha, et Xiaomi MiMo-V3-Flash apparaît-il un jour sur une fiche de modèle ? L'une de ces deux choses arrivera.

A checklist infographic titled 'What would confirm the story' with four numbered rows reading '1. Xiaomi claims Omen Alpha — or ships MiMo-V3-Flash weights', '2. A tokenizer or infra fingerprint points at Xiaomi', '3. Neutral benchmarks of Omen Alpha appear', and '4. The reveal after the Go window names the maker'. A footer reads 'None has fired as of September 4, 2026.' The OrcaRouter logo is composited in the bottom-right corner.

En date du 4 septembre 2026, Xiaomi MiMo-V3-Flash est un nom, une forme de produit plausible et une hypothèse d'analyste importante — pas un modèle publié. La génération V3 est suffisamment réelle pour avoir été présentée en avant-première en juillet et avoir fait l'objet de fuites en août. Que sa première apparition publique ait lieu en ce moment même sous le nom de code Omen Alpha est une question à laquelle seule Xiaomi peut répondre, et elle n'y a pas répondu.

Comparés dans cet article2

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement

© 2026 OrcaRouter

Pour les fournisseurs

Vous exploitez une plateforme d'inférence ? Proposez vos modèles sur OrcaRouter.

providers@orcarouter.ai

Rejoignez notre communauté

Discordsupport@orcarouter.aiXGitHubYouTube