Hero-titelkaart voor het artikel 'Xiaomi MiMo-V3-Flash', met de kicker 'OrcaRouter · modelradar — lek', de titel 'Xiaomi MiMo-V3-Flash', de subtitel 'Een analist zegt dat de anonieme Omen Alpha van OpenCode het onuitgebrachte snelle model van Xiaomi is. Niemand bij Xiaomi heeft dit bevestigd.', een linkerkaart met de kop 'De bewering' en de tekst 'teortaxesTex, 4 sep 2026 — heeft een Omen Alpha-snelheidstest uit de eerste hand als quote gepost' met de regel 'Omen Alpha is Xiaomi MiMo-V3-Flash.', een rechterkaart met de kop 'De status' en de tekst 'Xiaomi heeft niets aangekondigd — geen gewichten, geen modelkaart, geen prijspagina' met de regel 'Onbevestigd · alleen inferentie', en vier chips met de teksten 'Maker: onbevestigd', 'CoT lijkt op DeepSeek V4 GA', 'Omen Alpha · alleen OpenCode Go' en 'Hoog redeneervermogen · snel'. Het OrcaRouter-logo is rechtsonder in de hoek geplaatst.
Guides & Insights

Xiaomi MiMo-V3-Flash: Draait het niet-uitgebrachte snelle model binnen de Omen Alpha van OpenCode?

Auteur

Gideon Frost

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Xiaomi MiMo-V3-Flash is niet door Xiaomi aangekondigd. Er is geen model card, geen gewichten op Hugging Face, geen prijspagina en geen lanceringsbericht — de naam is om slechts één reden in omloop: op 4 september 2026 zei teortaxesTex, een vooraanstaande onafhankelijke AI-analist, publiekelijk dat hij gelooft dat Omen Alpha, het anonieme 'stealthmodel' dat OpenCode diezelfde ochtend aan zijn Go-abonnees begon aan te bieden, Xiaomi MiMo-V3-Flash is. Zijn identificatie berust vooral op wat hij interpreteert als de chain-of-thought van een DeepSeek V4-model uit het GA-tijdperk binnen het zichtbare redeneerspoor van Omen Alpha — wat, als dat standhoudt, Xiaomi MiMo-V3-Flash tot een door Xiaomi gebouwde snelle variant zou maken die bovenop de open V4-gewichten van DeepSeek is getraind. Er is niets bevestigd over die identificatie, en dit artikel beschouwt het als precies wat het is: één goed beargumenteerde hypothese in een actief raadspel.

De spelregels voor wat volgt: de lancering van Omen Alpha is een bevestigd feit, en de bewering van de analist is een als zodanig gelabelde bewering. Het bestaan van de V3-generatie wordt ondersteund door een preview tijdens een conferentie en een gelekt benchmarkresultaat, die beide door Xiaomi duidelijk als onbevestigd zijn gemarkeerd. De bewering dat er überhaupt een model bestaat dat Xiaomi MiMo-V3-Flash heet, is een afleiding uit gedrag, geen verklaring van Xiaomi — en aangezien Xiaomi geen verklaring heeft afgelegd, wordt er hier ook geen als feit herhaald.

De claim, en de vier redenen erachter

De aanleiding was een rapport van een ontwikkelaar. Een builder die Omen Alpha in OpenCode testte, postend als @SPAC89, schreef dat "Omen Alpha High" — het model op de hoge redeneerinstelling — een substantiële codeertaak in minder dan tien minuten had afgerond, en dat een veel langere run van meerdere uren gaande was. Door dat rapport te quoten, zei teortaxesTex dat hij gelooft dat het model Xiaomi MiMo-V3-Flash is, en gaf vier redenen, allemaal gedragsmatig in plaats van documentair:

• De reasoning trace. De zichtbare chain-of-thought leest als DeepSeek V4 GA CoT — zijn vertellers zijn "hmm", "fine" en checklistitems met een ✓ ervoor. De screenshot die hij bijvoegde toont Omen Alpha halverwege de build op de instelling "high" met een trace die overeenkomt met het patroon.

• De snelheid. Het model is snel — dat is de observatie waarop hij reageerde — en Xiaomi's snelle variant heeft historisch gezien de naam "Flash" gedragen.

• De operator. DeepSeek voert geen geheime promoties uit, dus zelfs als de redenering oorspronkelijk van DeepSeek V4 GA is, is degene achter Omen Alpha een derde partij die op DeepSeek voortbouwt in plaats van DeepSeek zelf.

• De clustering. De outputtekst van Xiaomi MiMo-modellen clustert met die van DeepSeek — zijn verkorte aanduiding voor twee generaties waarvan de tekst qua verdeling dicht bij elkaar ligt, wat je zou verwachten van een model dat op DeepSeek is getraind. Hij noemt één alternatief dat ook met DeepSeek clustert, StepFun's Step-4, en zegt dat hij niet zeker is over StepFun's huidige generatie.

De boodschapper is een clausule waard, omdat hetzelfde feit twee kanten op werkt. teortaxesTex is een zelfverklaarde DeepSeek-aanhanger — op zijn X-profiel noemt hij zichzelf sinds 2023 een DeepSeek-fan. Dat is het profiel van iemand die een DeepSeek V4-redeneerstijl op het eerste gezicht herkent, en ook het profiel van iemand die geneigd is er een te zien.

Waar een MiMo-V3-Flash in de productlijn van Xiaomi zou passen

De vandaag door Xiaomi officieel bevestigde MiMo-modellen zijn MiMo-V2.5 en MiMo-V2.5-Pro, die beide eind april 2026 als open source onder de MIT-licentie worden uitgebracht. MiMo-V2.5-Pro is een mixture-of-experts-model met 1,02 biljoen parameters, waarvan er 42 miljard actief zijn, en een contextvenster van 1 miljoen tokens; MiMo-V2.5 is het kleinere zustermodel voor algemeen gebruik, met 310 miljard parameters. Verder terug in de stamboom staan MiMo-V2-Flash (december 2025, een open MoE met 309 miljard parameters) en MiMo-V2-Pro (maart 2026) — en MiMo-V2-Pro is voor dit verhaal van belang, omdat het aanvankelijk onder een anonieme codenaam, Hunter Alpha, het publiek bereikte, voordat Xiaomi het claimde. Anonieme veldtesten zijn bij Xiaomi geen uitzondering; ze maken deel uit van hoe Xiaomi lanceert.

Bij de V3-generatie verschuift het trackrecord van een uitgebracht product naar een rapport. Tijdens ICML in juli 2026 gaf Luo Fuli, de onderzoeker die het MiMo-team leidt, een voorproefje van de architectuur van V3. De grote onthulling is een ontwerp dat Xiaomi High Sparse noemt: een klein aantal volledige aandachtslagen fungeert als een 'orakel' dat selecteert op welke tokens de omringende sparse lagen zich moeten richten, en die sparse lagen delen de KV-cache van de volledige aandachtslagen in plaats van zelf een eigen cache bij te houden. Xiaomi zegt dat dit het KV-cachegeheugen met ongeveer een factor tien vermindert en valideerde een sparse-to-full-ratio van 11:1 op een model met 80 miljard parameters; dat evenaart de kwaliteit van volledige aandacht, terwijl een hybride sliding-window-basislijn bij dezelfde sparsity ongeveer zeven MMLU-punten verloor. Dat zijn de eigen beweringen van het team tijdens een conferentiepresentatie, geen onafhankelijke resultaten. Vervolgens circuleerde er op 21 augustus een zogenaamde benchmarkscreenshot van een MiMo-V3-Pro, gedeeld door Max For AI: SWE-Bench Pro 72,8, tegen 67,9 voor GLM 5.3, 65,8 voor Kimi K3, 74,6 voor Claude Opus 5 en 75,4 voor GPT-5.6 Sol Max, plus Terminal-Bench 2.0 70,6 en τ3-bench 76,4. Xiaomi heeft niets bevestigd, en zowel het bestaan van V3 als de releasedatum blijven onaangekondigd. Voor dit artikel is de conclusie echter beperkter: de V3-generatie is aantoonbaar in beweging, maar er is geen enkel V3-model uitgebracht — en dat is precies waarom een niet-aangekondigde Xiaomi MiMo-V3-Flash die in alle stilte opduikt, nieuws zou zijn in plaats van routine.

Waarom een Flash — en waarom OpenCode Go — zouden passen

De Flash-tier is hoe Xiaomi snelle, goedkope capaciteit zaait; in december deed het dat ook met MiMo-V2-Flash. En OpenCode Go is een aannemelijke proeftuin, omdat er al het huidige open model van Xiaomi op draait: hetzelfde Go-aanbod dat Omen Alpha op 11.600 verzoeken per vijf uur vermeldt, vermeldt MiMo-V2.5 op 30.100 — een van de royaalste limieten op de pagina. Een Xiaomi-team dat een V3-Flash naast zijn eigen MiMo-V2.5 op één platform test, zou zonder marketingkosten een directe vergelijking met de vorige generatie krijgen, op een platform dat deze maand al één anonieme onthulling heeft vertoond. Dat is een argument voor aannemelijkheid, geen bewijs van identiteit.

A screenshot of the official OpenCode Go page, showing a 'New' promo banner reading 'GLM-5.3-Flash gets 2x usage limits for a limited time', the heading 'Low cost coding models for everyone', a 'Subscribe to Go $10/month' button, and the model lineup of per-model request allowances per five hours, including 'Omen Alpha — 11,600' and 'MiMo-V2.5 — 30,100' together with GLM-5.3-Flash (1,580, under the 2x banner), DeepSeek V4 Flash, LongCat-2.0, Kimi K3 and Muse Spark 1.3 Contributor (45,300).

De productvorm wijst dezelfde kant op. Omen Alpha dat met de “high”-redeneringsinstelling in minder dan tien minuten klaar is, vertoont het gedrag dat je van een snelle redeneertier zou verwachten, en de door derden verspreide cijfers voor Omen Alpha — ruwweg $0,20 per miljoen invoertokens en $0,66 per miljoen uitvoertokens, volgens persweergaven in plaats van een officiële prijslijst — plaatsen het aan de goedkope kant van de markt, naast DeepSeek V4 Flash. Een model dat zich gedraagt als een snelle, goedkope redeneerder van de DeepSeek-generatie is precies hoe een op DeepSeek V4 gebouwde “Flash”-tier eruit zou zien. Gerapporteerd en afgeleid, nogmaals, niet bevestigd.

De DeepSeek-verbinding is de kern — en het zwakste bewijs.

Waarom DeepSeek V4 GA er eigenlijk toe doet: de V4-lijn van DeepSeek stapte in augustus 2026 over van preview naar algemene beschikbaarheid, toen DeepSeek V4 Pro op 13 augustus zijn GA-build 0813 uitbracht met open weights onder MIT-licentie, naast het goedkopere zustermodel DeepSeek V4 Flash. Open weights onder MIT-licentie betekenen dat een derde partij er legaal op kan voortbouwen, en de gebruikelijke manier waarop de community zo'n model herkent, is de redeneerstijl die het erft: de chain-of-thought van DeepSeek uit het GA-tijdperk heeft herkenbare verbale gewoonten, en die gewoonten zijn precies wat teortaxesTex zegt te zien in de trace van Omen Alpha. Als hij gelijk heeft dat de trace DeepSeek V4 GA is, en gelijk heeft dat Xiaomi de operator is, dan zou Xiaomi MiMo-V3-Flash de snelle variant van Xiaomi zijn, gebouwd op de open redeneergewichten van DeepSeek — een legale maar strategisch opmerkelijke keuze, en een die netjes zou verklaren waarom een ogenschijnlijk Xiaomi-model als een DeepSeek redeneert.

Nu het lastige deel. Een chain-of-thought-gelijkenis is de zwakste klasse van modelfingerprint, omdat het stijl is in plaats van structuur. De identificatie van het anonieme model die deze maand daadwerkelijk standhield — Ox Alpha als GLM-5.3-Flash — werd beslecht op veel hardere bewijzen: tokenizer-matching en forensisch onderzoek naar video-encoding. Er is geen vergelijkbare harde fingerprint gepubliceerd die Omen Alpha aan Xiaomi koppelt. De heersende lezing binnen de community wijst bovendien in een andere richting: ontwikkelaars melden dat de backendverzoeken van Omen Alpha uitkomen onder een 'zhipu'-namespace, sommige testers beschrijven het model als zichzelf identificerend als GLM-gebaseerd, en de pers duidt de lancering zo dat Omen Alpha de tweede anonieme release van Zhipu AI in negen dagen is, na de Ox Alpha-run die werd gelezen als GLM-5.3-Flash. Als die lezing klopt, is de DeepSeek-achtige redenering ofwel een stilistische toevalligheid, ofwel een teken dat het Zhipu-model zelf is getraind met DeepSeek-sporen — maar het is geen Xiaomi-product. De twee kampen kunnen niet allebei gelijk hebben, en geen van beide kampen heeft een verklaring van het lab dat het noemt.

A two-column infographic titled 'Is Omen Alpha Xiaomi MiMo-V3-Flash?' with the subtitle 'The evidence, as of September 4, 2026'. The left column, headed 'FOR — the analyst's case', reads 'CoT reads as DeepSeek V4 GA — "hmm", "fine", ✓ lists', 'Fast — a big coding task finished in under 10 minutes', 'DeepSeek itself doesn't run stealth promotions', 'MiMo output text clusters with DeepSeek', and 'Xiaomi already ran Hunter Alpha as MiMo-V2-Pro'. The right column, headed 'AGAINST — the community's leading read', reads 'CoT style is the weakest fingerprint class', 'No tokenizer or infra evidence points at Xiaomi', 'Backend "zhipu" namespace observed by developers', 'Model reportedly self-identifies as GLM-based', and 'Press reads Omen Alpha as Zhipu's 2nd anonymous model'. A footer reads 'No Xiaomi statement exists — both columns are inference, not fact.' The OrcaRouter logo is composited in the bottom-right corner.

Wat zou het beslechten?

• Een verklaring van Xiaomi — of gewichten. Xiaomi heeft zijn MiMo-modellen open-source gemaakt sinds MiMo-V2-Flash, waarbij MiMo-V2.5 en MiMo-V2.5-Pro onder MIT zijn uitgebracht; een echte Xiaomi MiMo-V3-Flash zou hoogstwaarschijnlijk worden bevestigd op de manier waarop GLM-5.3-Flash werd bevestigd, met gewichten en een modelkaart op Hugging Face.

• Een harde vingerafdruk. Tokenizer-matching was het bewijs waarmee Ox Alpha werd geïdentificeerd; een tokenizertest die Omen Alpha aan Xiaomi toeschrijft, is niet gepubliceerd.

• De eigen verklaring van het model. Sommige testers melden dat Omen Alpha zichzelf beschrijft als GLM-gebaseerd. De zelfrapportage van een model is data, maar het is geen provenance.

• Onafhankelijke benchmarks van Omen Alpha. Neutrale evaluaties van het anonieme model zouden de gemeenschap in staat stellen om het te vergelijken met de MiMo-V3-Pro-cijfers die in augustus zijn gelekt.

• De onthulling na het Go-venster. Eerdere anonieme modellen werden dagen tot weken na de lancering geclaimd; wie Omen Alpha claimt, zal het model exact benoemen.

Wat te doen terwijl het gissen doorgaat

Praktisch gezien hangt het niet af van wie gelijk heeft. Omen Alpha is een anoniem model achter een abonnement van $10 per maand, en Xiaomi MiMo-V3-Flash is een onbevestigde naam die daaraan is gekoppeld; geen van beide is iets waar je vandaag een productiepipeline op zou verwedden. Wanneer een maker zich daadwerkelijk meldt en het onderliggende model via gewone API's beschikbaar komt, is dat het moment waarop een routinglaag zijn bestaansrecht bewijst: OrcaRouter geeft de lijstprijzen van providers met 0% opslag door, zodat een nieuw gepubliceerd tarief via dezelfde API live is op de dag dat de leverancier het publiceert, en automatische failover stelt je in staat een deel van het echte verkeer naar een onbewezen nieuwkomer te sturen, met een fallback naar een model dat je al vertrouwt. Waar je intussen op moet letten is simpel: claimt iemand Omen Alpha, en verschijnt Xiaomi MiMo-V3-Flash ooit op een modelkaart? Een van die twee zal gebeuren.

A checklist infographic titled 'What would confirm the story' with four numbered rows reading '1. Xiaomi claims Omen Alpha — or ships MiMo-V3-Flash weights', '2. A tokenizer or infra fingerprint points at Xiaomi', '3. Neutral benchmarks of Omen Alpha appear', and '4. The reveal after the Go window names the maker'. A footer reads 'None has fired as of September 4, 2026.' The OrcaRouter logo is composited in the bottom-right corner.

Vanaf 4 september 2026 is Xiaomi MiMo-V3-Flash een naam, een plausibele productvorm en de hypothese van een prominente analist — geen uitgebracht model. De V3-generatie is reëel genoeg om in juli te previewen en in augustus te lekken. Of de eerste publieke waarneming op dit moment plaatsvindt onder de codenaam Omen Alpha, is een vraag die alleen Xiaomi kan beantwoorden, en die heeft het niet beantwoord.

Vergeleken in dit artikel1

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt

© 2026 OrcaRouter

Voor aanbieders

Beheer je een inferentieplatform? Zet je modellen op OrcaRouter.

providers@orcarouter.ai

Word lid van de community

Discordsupport@orcarouter.aiXGitHubYouTube