
MiMo-V2.6-Pro vs MiMo-V2.6-Flash: een 3x prijsverschil dat twee benchmarks niet verklaren
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligentie76Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
In Xiaomi's eigen evaluatietabellen verslaat MiMo-V2.6-Flash MiMo-V2.6-Pro. De rij is CyberGym, en de marge is 95,1 tegen 94,0. Het is één rij van de vijftien, en het is de reden om de rest van deze vergelijking zorgvuldig te lezen in plaats van aan te nemen dat het vlaggenschip altijd het antwoord is — want MiMo-V2.6-Flash kost ongeveer een derde van wat MiMo-V2.6-Pro kost, en in de meeste rijen liggen de twee binnen een paar punten van elkaar.
Beide modellen werden op 21 september 2026 gepubliceerd als Hugging Face-repositories, onder de MIT-licentie, achttien seconden na elkaar, als afzonderlijke trainingsruns in plaats van treden van één ladder. Xiaomi MiMo-V2.6-Pro is de biljoen-parameterklasse. MiMo-V2.6-Flash is de efficiëntieklasse. De vraag die deze pagina beantwoordt, is welke van de twee thuishoort op je productiepad, en het eerlijke antwoord hangt af van een getal dat in geen van beide releases voorkomt.
Wat elk is
• Parameters — Xiaomi MiMo-V2.6-Pro 1,02T totaal met 42B actief per token, tegenover Xiaomi MiMo-V2.6-Flash met ongeveer 309B totaal en 15B actief
• Architectuur — beide sparse mixture-of-experts met native omnimodale input; Flash is gedocumenteerd met 48 lagen, 39 sliding-window- en 9 volledige attentionlagen, verborgen grootte 4096, 256 gerouteerde experts met 8 actieve en geen gedeelde experts, naast een vision transformer van 681M, een audiotokenizer van 308M en een audio-patch-encoder van 127M
• Context — 1M tokens op beide, met tot 128.000 outputtokens op beide
• Licentie — MIT op beide, gewichten vrij toegankelijk op beide
• Prijs — $0,435 in en $0,87 uit per miljoen tokens voor Pro, tegenover $0,14 en $0,28 voor Flash: een gat van 3,1x aan beide zijden van de kaart
• Cache-hit-input — $0,0036 per miljoen op Pro, $0,0028 op Flash
• Trainingsuitgaven — Xiaomi rapporteert ongeveer $2,62M voor de Pro-RL-run en $854K voor Flash, elk voltooid in minder dan zes dagen over 30 reinforcement-learning-stappen en ongeveer 750.000 trajecten
• Onafhankelijke indexscore — 46 voor Xiaomi MiMo-V2.6-Pro op Artificial Analysis Intelligence Index v4.3.2; geen gepubliceerd voor MiMo-V2.6-Flash
Die laatste regel is de regel om te onthouden. Alles daarboven, behalve de Pro-score, is door Xiaomi opgegeven.
Waar je voor drie keer de prijs bijna niets krijgt
Tabel 3 van Xiaomi zet de twee naast elkaar over de harnesses waarop de serie is getraind, en bij langdurig agentisch werk zijn de marges klein:
• DeepSWE v1.1 — Pro 71.9, Flash 67.9
• MiMo Code Bench — Pro 63.2, Flash 61.2
• AutomationBench v1.0.6 — Pro 53.1, Flash 52.3
• Toolathlon-Verified — Pro 76.9, Flash 73.6
• Terminal Bench 2.1 — Pro 89.9, Flash 87.6
• OSWorld-Verified — Pro 82.0, Flash 80.8
• JobBench — Pro 62.0, Flash 61.2
• MiMo Visual Coding — Pro 72.3, Flash 71.5
• CyberGym — Pro 94.0, Flash 95.1
• MiMo Cyber Bench — Pro 80.2, Flash 77.2
Lees die kolom van boven naar beneden en de voorsprong van het vlaggenschip ligt meestal tussen één en vier punten, met één rij die het ronduit verliest. Op een workflow waarin het verschil tussen een 67,9 en een 71,9 het verschil is tussen een taak die wordt voltooid en een taak die mislukt, is drie keer de prijs goedkoop. Op een workflow waarin het het verschil is tussen twee acceptabele antwoorden, is dat niet zo. Leverancierstabellen met zulke decimalen nodigen uit tot schijnprecisie — niemand buiten Xiaomi heeft ze gedraaid, en een gat van twee punten op een intern beoordeelde harness valt ruim binnen het bereik dat een andere beoordelaar of een ander retrybeleid kan verschuiven.

Waar het veel koopt
Er is een cluster rijen waar de kloof ophoudt een afrondingsargument te zijn. Elk daarvan is beveiligingswerk:
• ExploitGym — Pro 17.8, Flash 6.0
• ExploitBench — Pro 47.9, Flash 25.3
• SEC Bench Pro — Pro 66.3, Flash 47.5
• Agents' Last Exam — Pro 31.6, Flash 27.6
• Terminal Bench 4.0 — Pro 34.9, Flash 28.8
Op ExploitGym is het vlaggenschip drie keer het goedkopere model, dezelfde factor als de prijs, en op SEC Bench Pro is het 1,4x. Dat patroon is wat je zou verwachten van een model met 42B actieve parameters tegenover een met 15B: een taak die een lange redeneerketen vereist zonder deelpunten is precies het soort taak waarin de extra capaciteit zich laat zien, en dat CyberGym de andere kant op uitvalt, is de uitzondering die bevestigt dat de twee runs verschillende dingen hebben geleerd in plaats van hetzelfde op verschillende groottes.
De tweedeling sluit dus aan bij een echte grens in de werklast, niet bij een marketinggrens. Grootschalig agentwerk met een tolerant succescriterium — retrieval, classificatie, routinematige aanpassingen, calls die een retry kan redden — is het domein van Flash. Werk waarbij een fout antwoord duur is en een gedeeltelijk antwoord waardeloos — exploitontwikkeling, beveiligingsreview, terminalsessies met status over meerdere stappen — is waar de Pro-tier zijn meerprijs verdient.
Het getal dat niet bestaat
MiMo-V2.6-Flash heeft geen modelpagina op Artificial Analysis. Het zustermodel wel. Die asymmetrie is het allerbelangrijkste op deze pagina, want het betekent dat het enige onafhankelijk gemeten cijfer in de hele MiMo-V2.6-serie de 46 naast Xiaomi MiMo-V2.6-Pro is. Elk Flash-cijfer hierboven — inclusief de CyberGym-rij die het wint — komt uit een Xiaomi-testomgeving, een Xiaomi-beoordelaar en een offline run van Xiaomi.
Er zijn goede argumenten om aan te nemen dat dit tijdelijk is: het model is op het moment van schrijven een dag oud en evaluatie door derden kost tijd. Er zijn ook goede argumenten om aan te nemen dat het structureel is, omdat Flash het volumemodel is en volumemodellen minder aandacht voor benchmarks trekken. Hoe dan ook, het praktische gevolg vandaag is dat je Flash niet met dezelfde zekerheid kunt vergelijken met iets buiten zijn eigen familie als waarmee je Pro kunt vergelijken. Als je op grond van prijs-kwaliteitverhouding kiest tussen Flash en een niet-Xiaomi-model, vergelijk je een leverancierscijfer met een door iemand anders gemeten cijfer.
Beide modelkaarten bevatten dezelfde tweede kanttekening. Geen van beide repositories wordt door een inferentie-aanbieder ingezet — Hugging Face zegt dit expliciet op elke pagina, en Artificial Analysis telde één API-provider voor Pro. Wij hosten geen van beide checkpoints, dus geen van beide is via ons routeerbaar. De route naar beide is het eigen platform van Xiaomi en de catalogi van derden die ze aanbieden.

De prijs die je betaalt in hardware, niet in tokens
Prijs per token is slechts de helft van wat een checkpoint je kost, en op schijf verschillen die twee veel scherper dan op de tariefkaart. MiMo-V2.6-Flash publiceert 172,9 GB aan FP8-gewichten verdeeld over 65 shards. Xiaomi MiMo-V2.6-Pro heeft ongeveer drie keer zoveel parameters, waardoor de ruwe download in het bereik van een halve terabyte valt voordat er ook maar enige kwantisatie plaatsvindt — en de eigen repository meldt een Safetensors-modelgrootte van 524B parameters, een cijfer dat noch met het totaal van 1,02T noch met het aantal actieve parameters van 42B te rijmen valt.
Dat verschil verandert de vorm van de beslissing. Flash met 172,9 GB is een model dat een klein team zelf kan hosten op gehuurde capaciteit en als een commodity kan behandelen. Pro, met ongeveer drie keer dat, is een clusterbeslissing — de berichtgeving rond de lancering schatte de twee trainingsruns op respectievelijk ongeveer 4.000 en 8.000 H200-equivalente GPU's. Als je reden om naar open weights te kijken is dat je de optie wilt hebben om te stoppen met betalen per token, dan bieden de twee checkpoints die optie op zeer verschillende schalen van inzet.
Kiezen tussen hen
De regel die de bovenstaande kanttekeningen overleeft, is om te kiezen op basis van workloadklasse in plaats van benchmarkgemiddelde. Flash voor alles wat je met een gerust hart opnieuw zou proberen; Pro voor alles waarbij een nieuwe poging je niet redt. Meet daarna, want geen van beide modellen heeft een onafhankelijke score op de benchmarks die er voor jou echt toe doen.
Twee checkpoints naast elkaar meten is waar een router iets doet wat een contract per model niet kan. Een goedkope laag op het grootste deel van je verkeer zetten en alleen de moeilijke gevallen naar de dure laag escaleren is dezelfde beslissing als deze pagina, uitgedrukt als configuratie in plaats van als een herschrijving — en die compositie is precies waarvoor de routeringslaag bestaat. Het is ook van belang voor de prijs zelf: we geven de lijstprijs van de provider door met 0% opslag, dus als Xiaomi het tarief voor een van beide checkpoints verlaagt, beweegt het cijfer aan onze kant dezelfde dag mee in plaats van bij de volgende contractverlenging. Dat geldt voor de modellen die wij aanbieden. Voor het MiMo-V2.6-paar specifiek koop je vandaag nog steeds rechtstreeks bij Xiaomi.
Wat zou het beslechten?
Twee dingen zouden dit van een kwestie van beoordeling in een kwestie van rekenwerk veranderen. Een Artificial Analysis-pagina voor MiMo-V2.6-Flash zou beide checkpoints op dezelfde kosten-per-taakas plaatsen waarop Pro momenteel op $0.133 per Intelligence Index-taak staat, en de vergelijking zou zichzelf oplossen. Een replicatie door een derde partij van het securitycluster — ExploitGym, ExploitBench, SEC Bench Pro — zou bevestigen of het 3x-verschil op die rijen een eigenschap van het model is of een eigenschap van de beoordelaar.
Tot dan is de verdedigbare positie dat Xiaomi MiMo-V2.6-Flash voor de meeste teams in de meeste gevallen de betere keuze is, en dat Xiaomi MiMo-V2.6-Pro de betere keuze is voor de smalle categorie werk waarbij falen de dure uitkomst is. De ene rij waarin Flash wint, weerlegt dat niet — maar het is een nuttige herinnering dat de meerprijs van het vlaggenschip een claim is over een workload, niet over een model.

