
Xiaomi MiMo-V3-Flash: Draait het niet-uitgebrachte snelle model binnen de Omen Alpha van OpenCode?
- googleNIEUWGoogle: Gemini 3.8 Flash2026-09-0259Intelligentie76Coderen
- qwenNIEUWQwen: Qwen3.8 Max (0902)2026-09-0258Intelligentie72Coderen
- anthropicNIEUWAnthropic: Claude Fable 5.12026-09-0166Intelligentie82Coderen
- AlibabaNIEUWQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiNIEUWZ.ai: GLM 5.3 Flash2026-08-2658Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1860Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1552Intelligentie68Coderen
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1261Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0557Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligentie72Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligentie78Coderen
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligentie69Coderen
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligentie49Coderen
Xiaomi MiMo-V3-Flash is niet door Xiaomi aangekondigd. Er is geen model card, geen gewichten op Hugging Face, geen prijspagina en geen lanceringsbericht — de naam is om slechts één reden in omloop: op 4 september 2026 zei teortaxesTex, een vooraanstaande onafhankelijke AI-analist, publiekelijk dat hij gelooft dat Omen Alpha, het anonieme 'stealthmodel' dat OpenCode diezelfde ochtend aan zijn Go-abonnees begon aan te bieden, Xiaomi MiMo-V3-Flash is. Zijn identificatie berust vooral op wat hij interpreteert als de chain-of-thought van een DeepSeek V4-model uit het GA-tijdperk binnen het zichtbare redeneerspoor van Omen Alpha — wat, als dat standhoudt, Xiaomi MiMo-V3-Flash tot een door Xiaomi gebouwde snelle variant zou maken die bovenop de open V4-gewichten van DeepSeek is getraind. Er is niets bevestigd over die identificatie, en dit artikel beschouwt het als precies wat het is: één goed beargumenteerde hypothese in een actief raadspel.
De spelregels voor wat volgt: de lancering van Omen Alpha is een bevestigd feit, en de bewering van de analist is een als zodanig gelabelde bewering. Het bestaan van de V3-generatie wordt ondersteund door een preview tijdens een conferentie en een gelekt benchmarkresultaat, die beide door Xiaomi duidelijk als onbevestigd zijn gemarkeerd. De bewering dat er überhaupt een model bestaat dat Xiaomi MiMo-V3-Flash heet, is een afleiding uit gedrag, geen verklaring van Xiaomi — en aangezien Xiaomi geen verklaring heeft afgelegd, wordt er hier ook geen als feit herhaald.
De claim, en de vier redenen erachter
De aanleiding was een rapport van een ontwikkelaar. Een builder die Omen Alpha in OpenCode testte, postend als @SPAC89, schreef dat "Omen Alpha High" — het model op de hoge redeneerinstelling — een substantiële codeertaak in minder dan tien minuten had afgerond, en dat een veel langere run van meerdere uren gaande was. Door dat rapport te quoten, zei teortaxesTex dat hij gelooft dat het model Xiaomi MiMo-V3-Flash is, en gaf vier redenen, allemaal gedragsmatig in plaats van documentair:
• De reasoning trace. De zichtbare chain-of-thought leest als DeepSeek V4 GA CoT — zijn vertellers zijn "hmm", "fine" en checklistitems met een ✓ ervoor. De screenshot die hij bijvoegde toont Omen Alpha halverwege de build op de instelling "high" met een trace die overeenkomt met het patroon.
• De snelheid. Het model is snel — dat is de observatie waarop hij reageerde — en Xiaomi's snelle variant heeft historisch gezien de naam "Flash" gedragen.
• De operator. DeepSeek voert geen geheime promoties uit, dus zelfs als de redenering oorspronkelijk van DeepSeek V4 GA is, is degene achter Omen Alpha een derde partij die op DeepSeek voortbouwt in plaats van DeepSeek zelf.
• De clustering. De outputtekst van Xiaomi MiMo-modellen clustert met die van DeepSeek — zijn verkorte aanduiding voor twee generaties waarvan de tekst qua verdeling dicht bij elkaar ligt, wat je zou verwachten van een model dat op DeepSeek is getraind. Hij noemt één alternatief dat ook met DeepSeek clustert, StepFun's Step-4, en zegt dat hij niet zeker is over StepFun's huidige generatie.
De boodschapper is een clausule waard, omdat hetzelfde feit twee kanten op werkt. teortaxesTex is een zelfverklaarde DeepSeek-aanhanger — op zijn X-profiel noemt hij zichzelf sinds 2023 een DeepSeek-fan. Dat is het profiel van iemand die een DeepSeek V4-redeneerstijl op het eerste gezicht herkent, en ook het profiel van iemand die geneigd is er een te zien.
Waar een MiMo-V3-Flash in de productlijn van Xiaomi zou passen
De vandaag door Xiaomi officieel bevestigde MiMo-modellen zijn MiMo-V2.5 en MiMo-V2.5-Pro, die beide eind april 2026 als open source onder de MIT-licentie worden uitgebracht. MiMo-V2.5-Pro is een mixture-of-experts-model met 1,02 biljoen parameters, waarvan er 42 miljard actief zijn, en een contextvenster van 1 miljoen tokens; MiMo-V2.5 is het kleinere zustermodel voor algemeen gebruik, met 310 miljard parameters. Verder terug in de stamboom staan MiMo-V2-Flash (december 2025, een open MoE met 309 miljard parameters) en MiMo-V2-Pro (maart 2026) — en MiMo-V2-Pro is voor dit verhaal van belang, omdat het aanvankelijk onder een anonieme codenaam, Hunter Alpha, het publiek bereikte, voordat Xiaomi het claimde. Anonieme veldtesten zijn bij Xiaomi geen uitzondering; ze maken deel uit van hoe Xiaomi lanceert.
Bij de V3-generatie verschuift het trackrecord van een uitgebracht product naar een rapport. Tijdens ICML in juli 2026 gaf Luo Fuli, de onderzoeker die het MiMo-team leidt, een voorproefje van de architectuur van V3. De grote onthulling is een ontwerp dat Xiaomi High Sparse noemt: een klein aantal volledige aandachtslagen fungeert als een 'orakel' dat selecteert op welke tokens de omringende sparse lagen zich moeten richten, en die sparse lagen delen de KV-cache van de volledige aandachtslagen in plaats van zelf een eigen cache bij te houden. Xiaomi zegt dat dit het KV-cachegeheugen met ongeveer een factor tien vermindert en valideerde een sparse-to-full-ratio van 11:1 op een model met 80 miljard parameters; dat evenaart de kwaliteit van volledige aandacht, terwijl een hybride sliding-window-basislijn bij dezelfde sparsity ongeveer zeven MMLU-punten verloor. Dat zijn de eigen beweringen van het team tijdens een conferentiepresentatie, geen onafhankelijke resultaten. Vervolgens circuleerde er op 21 augustus een zogenaamde benchmarkscreenshot van een MiMo-V3-Pro, gedeeld door Max For AI: SWE-Bench Pro 72,8, tegen 67,9 voor GLM 5.3, 65,8 voor Kimi K3, 74,6 voor Claude Opus 5 en 75,4 voor GPT-5.6 Sol Max, plus Terminal-Bench 2.0 70,6 en τ3-bench 76,4. Xiaomi heeft niets bevestigd, en zowel het bestaan van V3 als de releasedatum blijven onaangekondigd. Voor dit artikel is de conclusie echter beperkter: de V3-generatie is aantoonbaar in beweging, maar er is geen enkel V3-model uitgebracht — en dat is precies waarom een niet-aangekondigde Xiaomi MiMo-V3-Flash die in alle stilte opduikt, nieuws zou zijn in plaats van routine.
Waarom een Flash — en waarom OpenCode Go — zouden passen
De Flash-tier is hoe Xiaomi snelle, goedkope capaciteit zaait; in december deed het dat ook met MiMo-V2-Flash. En OpenCode Go is een aannemelijke proeftuin, omdat er al het huidige open model van Xiaomi op draait: hetzelfde Go-aanbod dat Omen Alpha op 11.600 verzoeken per vijf uur vermeldt, vermeldt MiMo-V2.5 op 30.100 — een van de royaalste limieten op de pagina. Een Xiaomi-team dat een V3-Flash naast zijn eigen MiMo-V2.5 op één platform test, zou zonder marketingkosten een directe vergelijking met de vorige generatie krijgen, op een platform dat deze maand al één anonieme onthulling heeft vertoond. Dat is een argument voor aannemelijkheid, geen bewijs van identiteit.

De productvorm wijst dezelfde kant op. Omen Alpha dat met de “high”-redeneringsinstelling in minder dan tien minuten klaar is, vertoont het gedrag dat je van een snelle redeneertier zou verwachten, en de door derden verspreide cijfers voor Omen Alpha — ruwweg $0,20 per miljoen invoertokens en $0,66 per miljoen uitvoertokens, volgens persweergaven in plaats van een officiële prijslijst — plaatsen het aan de goedkope kant van de markt, naast DeepSeek V4 Flash. Een model dat zich gedraagt als een snelle, goedkope redeneerder van de DeepSeek-generatie is precies hoe een op DeepSeek V4 gebouwde “Flash”-tier eruit zou zien. Gerapporteerd en afgeleid, nogmaals, niet bevestigd.
De DeepSeek-verbinding is de kern — en het zwakste bewijs.
Waarom DeepSeek V4 GA er eigenlijk toe doet: de V4-lijn van DeepSeek stapte in augustus 2026 over van preview naar algemene beschikbaarheid, toen DeepSeek V4 Pro op 13 augustus zijn GA-build 0813 uitbracht met open weights onder MIT-licentie, naast het goedkopere zustermodel DeepSeek V4 Flash. Open weights onder MIT-licentie betekenen dat een derde partij er legaal op kan voortbouwen, en de gebruikelijke manier waarop de community zo'n model herkent, is de redeneerstijl die het erft: de chain-of-thought van DeepSeek uit het GA-tijdperk heeft herkenbare verbale gewoonten, en die gewoonten zijn precies wat teortaxesTex zegt te zien in de trace van Omen Alpha. Als hij gelijk heeft dat de trace DeepSeek V4 GA is, en gelijk heeft dat Xiaomi de operator is, dan zou Xiaomi MiMo-V3-Flash de snelle variant van Xiaomi zijn, gebouwd op de open redeneergewichten van DeepSeek — een legale maar strategisch opmerkelijke keuze, en een die netjes zou verklaren waarom een ogenschijnlijk Xiaomi-model als een DeepSeek redeneert.
Nu het lastige deel. Een chain-of-thought-gelijkenis is de zwakste klasse van modelfingerprint, omdat het stijl is in plaats van structuur. De identificatie van het anonieme model die deze maand daadwerkelijk standhield — Ox Alpha als GLM-5.3-Flash — werd beslecht op veel hardere bewijzen: tokenizer-matching en forensisch onderzoek naar video-encoding. Er is geen vergelijkbare harde fingerprint gepubliceerd die Omen Alpha aan Xiaomi koppelt. De heersende lezing binnen de community wijst bovendien in een andere richting: ontwikkelaars melden dat de backendverzoeken van Omen Alpha uitkomen onder een 'zhipu'-namespace, sommige testers beschrijven het model als zichzelf identificerend als GLM-gebaseerd, en de pers duidt de lancering zo dat Omen Alpha de tweede anonieme release van Zhipu AI in negen dagen is, na de Ox Alpha-run die werd gelezen als GLM-5.3-Flash. Als die lezing klopt, is de DeepSeek-achtige redenering ofwel een stilistische toevalligheid, ofwel een teken dat het Zhipu-model zelf is getraind met DeepSeek-sporen — maar het is geen Xiaomi-product. De twee kampen kunnen niet allebei gelijk hebben, en geen van beide kampen heeft een verklaring van het lab dat het noemt.

Wat zou het beslechten?
• Een verklaring van Xiaomi — of gewichten. Xiaomi heeft zijn MiMo-modellen open-source gemaakt sinds MiMo-V2-Flash, waarbij MiMo-V2.5 en MiMo-V2.5-Pro onder MIT zijn uitgebracht; een echte Xiaomi MiMo-V3-Flash zou hoogstwaarschijnlijk worden bevestigd op de manier waarop GLM-5.3-Flash werd bevestigd, met gewichten en een modelkaart op Hugging Face.
• Een harde vingerafdruk. Tokenizer-matching was het bewijs waarmee Ox Alpha werd geïdentificeerd; een tokenizertest die Omen Alpha aan Xiaomi toeschrijft, is niet gepubliceerd.
• De eigen verklaring van het model. Sommige testers melden dat Omen Alpha zichzelf beschrijft als GLM-gebaseerd. De zelfrapportage van een model is data, maar het is geen provenance.
• Onafhankelijke benchmarks van Omen Alpha. Neutrale evaluaties van het anonieme model zouden de gemeenschap in staat stellen om het te vergelijken met de MiMo-V3-Pro-cijfers die in augustus zijn gelekt.
• De onthulling na het Go-venster. Eerdere anonieme modellen werden dagen tot weken na de lancering geclaimd; wie Omen Alpha claimt, zal het model exact benoemen.
Wat te doen terwijl het gissen doorgaat
Praktisch gezien hangt het niet af van wie gelijk heeft. Omen Alpha is een anoniem model achter een abonnement van $10 per maand, en Xiaomi MiMo-V3-Flash is een onbevestigde naam die daaraan is gekoppeld; geen van beide is iets waar je vandaag een productiepipeline op zou verwedden. Wanneer een maker zich daadwerkelijk meldt en het onderliggende model via gewone API's beschikbaar komt, is dat het moment waarop een routinglaag zijn bestaansrecht bewijst: OrcaRouter geeft de lijstprijzen van providers met 0% opslag door, zodat een nieuw gepubliceerd tarief via dezelfde API live is op de dag dat de leverancier het publiceert, en automatische failover stelt je in staat een deel van het echte verkeer naar een onbewezen nieuwkomer te sturen, met een fallback naar een model dat je al vertrouwt. Waar je intussen op moet letten is simpel: claimt iemand Omen Alpha, en verschijnt Xiaomi MiMo-V3-Flash ooit op een modelkaart? Een van die twee zal gebeuren.

Vanaf 4 september 2026 is Xiaomi MiMo-V3-Flash een naam, een plausibele productvorm en de hypothese van een prominente analist — geen uitgebracht model. De V3-generatie is reëel genoeg om in juli te previewen en in augustus te lekken. Of de eerste publieke waarneming op dit moment plaatsvindt onder de codenaam Omen Alpha, is een vraag die alleen Xiaomi kan beantwoorden, en die heeft het niet beantwoord.
Vergeleken in dit artikel1
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
