
Xiaomi MiMo-V2.6-Pro vs MiniMax M3: De betere score heeft de dunnere route
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligentie76Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Xiaomi MiMo-V2.6-Pro werd op 22 september 2026 algemeen beschikbaar en veroverde de toppositie in de categorie open gewichten op de Artificial Analysis Intelligence Index met 46 punten op v4.3.2. MiniMax M3 heeft sinds de release op 31 mei 2026 een variant van die titel in handen, en scoort vandaag op dezelfde index 29 — zeventien punten daarachter. De score is het minst interessante aan het tweetal. MiniMax M3 levert 168,9 outputtokens per seconde tegenover 134,3, antwoordt in 0,92 seconden tegenover 2,15, is goedkoper per inputtoken en is bereikbaar via vijftien API-aanbieders tegenover één bij Xiaomi. Het nieuwere, hoger scorende model is juist het lastigste om daadwerkelijk te kiezen, en die omkering is waar deze vergelijking over gaat.
Beide open gewichten, beide multimodaal, veertien weken uit elkaar
De twee modellen zijn nauw verwant qua ontwerpintentie. Beide zijn sparse mixture-of-experts-modellen uit Chinese labs, beide hebben een contextvenster van 1M tokens, beide accepteren afbeeldingen en video native in plaats van via een aangebouwde adapter, en beide publiceren hun gewichten. Tussen hun releases zitten veertien weken, en de indexkloof tussen hen is de afstand die de open-weights-frontier in dat venster heeft afgelegd.
• Totaal aantal parameters — Xiaomi MiMo-V2.6-Pro 1,02T; MiniMax M3 ongeveer 427B, beide sparse MoE
Actief per token — Xiaomi MiMo-V2.6-Pro 42B; MiniMax M3 ongeveer 23–25B
• Context — elk 1M tokens, waarbij MiniMax M3 een minimum van 512K garandeert
• Modaliteiten in — tekst, afbeelding en video voor beide; Xiaomi voegt audio-invoer toe
Gewichten — MIT-licentie op Xiaomi MiMo-V2.6-Pro; MiniMax M3 wordt uitgebracht onder de MiniMax Community Licence, die niet permissief is en een aparte overeenkomst voor commercieel gebruik vereist
• Uitgebracht — Xiaomi MiMo-V2.6-Pro 21–22 september 2026; MiniMax M3 31 mei 2026
• Bereikbaarheid — één API-provider geteld voor Xiaomi MiMo-V2.6-Pro op Artificial Analysis; vijftien voor MiniMax M3
Die laatste regel is degene die je in het oog moet houden. Al het andere op het blad pleit voor het nieuwere model. Die regel doet dat niet, en het is de regel die bepaalt of een model in een productiepad kan staan.
Wat de index meet, en wie hem heeft gemeten
Artificial Analysis heeft beide modellen zelf op v4.3.2 gedraaid — een samengestelde score op basis van tien evaluaties die redeneren, kennis, wiskunde en coderen omvat, waaronder AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience en AA-LCR v1.1. Noch de 46, noch de 29 is een leverancierscijfer, wat hier van belang is omdat beide labs ook eigen benchmarkcijfers hebben gepubliceerd die leverancierscijfers zijn, en de twee soorten mogen niet worden vermengd.
De 46 zet Xiaomi MiMo-V2.6-Pro aan kop van het open-weights-veld op die composiet. Daarmee staat het niet aan de top van de index: Claude Fable 5.1 en GPT-6 Astra staan beide op 53, en Claude Opus 5 op 51. De 29 van MiniMax M3 plaatst het op de zestiende plek van de 114 gemeten modellen, ruim boven de mediaan voor zijn grootteklasse, maar ver verwijderd van de frontier waarmee het in juni werd vergeleken.
MiniMax M3 heeft het bewijs dat Xiaomi niet heeft
Dit is het deel van de vergelijking dat wordt overgeslagen, en het is het deel dat een koper het zwaarst zou moeten laten meewegen. MiniMax M3 staat op de openbare DeepSWE v1.1-leaderboard met een officiële vermelding: 20,4% Pass@1 en 48,7% Pass@4, gepubliceerd op 8 juni 2026 nadat een MiniMax-inferentie-upgrade abnormale tokengeneratie verhielp en het gedrag van de long-contextcache verbeterde. Aan die vermelding hing een efficiëntieverantwoording vast, en die verantwoording is niet flatteus: een mediaan van 311 agentstappen, ongeveer 91.000 outputtokens en circa $ 5,04 per taak. Het slaagt voor engineeringtaken met een lange horizon, en het doet dat tegen hoge kosten.
Xiaomi's belangrijkste benchmarkcijfer voor zijn nieuwe model is 72,57 op DeepSWE v1.1, een stijging ten opzichte van een baseline van 58,4, gemeten met mini-swe-agent als gemiddelde van drie op Xiaomi's eigen harness. Het is geen leaderboardinzending en is ook niet als zodanig ingediend. 72,57 naast MiniMax' 20,4 zetten en daar een overwinning van 52 punten uit aflezen, is rekenwerk over twee verschillende metingen: het leaderboard publiceert Pass@1 voor een specifieke configuratie, met een betrouwbaarheidsinterval en een gemiddelde kosten per taak, wat een derde partij opnieuw kan uitvoeren, en aan het leverancierscijfer is niets daarvan verbonden. De 72,57 kan heel goed eerlijk zijn. Het is simpelweg niet hetzelfde soort object.
MiniMax publiceerde ook eigen lanceringscijfers, en voor elk daarvan geldt hetzelfde voorbehoud: SWE-Bench Pro op 59,0, BrowseComp op 83,5, SVG-Bench op 63,7 en Terminal-Bench 2.1 op 66,0, uitgevoerd op de eigen infrastructuur van MiniMax met eigen scaffolding. Beschouw ze als beweringen over het model, niet als metingen ervan.
Snelheid, latentie en de twee getallen die een rekening bepalen
Het doorvoerverschil loopt tegengesteld aan het kwaliteitsverschil, en het is groot genoeg om ertoe te doen. MiniMax M3 genereert 168,9 uitvoertokens per seconde tegenover 134,3 voor Xiaomi MiMo-V2.6-Pro, en de 0,92 seconde tot het eerste token is ongeveer tweeënhalf keer sneller dan Xiaomi's 2,15. Voor een interactief product is de latentie tot het eerste token het getal dat een gebruiker voelt; voor een batchpijplijn is doorvoer het getal dat de wandkloktijd bepaalt.
Qua kosten liggen de twee dichter bij elkaar dan de tarieven in de koppen doen vermoeden, en de richting hangt af van je verkeer. MiniMax M3 staat genoteerd tegen $0,30 per miljoen inputtokens en $1,20 per miljoen outputtokens; Xiaomi MiMo-V2.6-Pro staat genoteerd tegen $0,43 en $0,87. M3 is goedkoper voor input, Xiaomi is goedkoper voor output. Zodra cachekortingen worden toegepast — 80% voor M3, 99% voor Xiaomi — komen de gecombineerde tarieven uit op $0,22 en $0,18 per miljoen bij een 7:2:1-mix van cache-hit/input/output. Artificial Analysis noteert ook een kostenpost van $0,13 per Intelligence Index-taak voor Xiaomi MiMo-V2.6-Pro, op dezelfde manier gemeten bij elk model in het overzicht, wat het meest vergelijkbare individuele kostencijfer is dat voor de twee beschikbaar is.

Vijftien routes tegen één, en wat failover waard is
Een indexvoorsprong van zeventien punten helpt je niet als het endpoint down is. Artificial Analysis telde op het moment van schrijven één API-provider voor Xiaomi MiMo-V2.6-Pro, en dat aantal zegt iets over de release, niet over het model: een drie dagen geleden gepubliceerd checkpoint heeft geen tijd gehad om zich te verspreiden. MiniMax M3, vier maanden oud, wordt door vijftien providers aangeboden.
Dat verschil is waar een router voor dient, en het is waar de twee modellen commercieel uiteenlopen. MiniMax M3 staat op OrcaRouter als minimax/minimax-m3: één OpenAI-compatibel endpoint, de lijstprijs van de provider doorgegeven met 0% opslag, dus de $0,30 en $1,20 hierboven zijn MiniMax' eigen cijfers en niet de onze, en een prijswijziging van MiniMax is dezelfde dag live aan onze kant. De vijftien upstreams zijn wat een automatische failoverketen zinvol maakt — een verzoek dat bij één provider blijft hangen, probeert het opnieuw bij een andere voordat het antwoord begint, wat een andere garantie is dan een model dat maar één plek heeft om naartoe te gaan. Xiaomi MiMo-V2.6-Pro staat niet op OrcaRouter; geen enkel Xiaomi-model staat erop, en het vandaag bereiken betekent Xiaomi's eigen platform en de catalogi van derden die het vermelden.
Als je beide in dezelfde applicatie wilt, is de praktische vorm één sleutel die de modellen bevat waarop je al hebt besloten, waarbij de nieuwkomer tegen hen wordt afgewogen in plaats van te worden overgenomen op grond van een score van drie dagen oud. Dat is een routeringsbeslissing, en de nuttige eigenschap is dat een uitwijkroute niets kost tot de dag dat die je redt.

Welke moet je kiezen?
Als je deze week een open-weight, multimodaal model met een miljoen tokens in productie nodig hebt, is het antwoord MiniMax M3, en het is niet eens in de buurt — vijftien providers, een eerste token in minder dan een seconde, een voldoende permissieve commerciële route alleen als je de communitylicentie hebt gelezen, en een officiële long-horizon-benchmarkinzending die je kunt inspecteren. De efficiëntiewaarschuwing is terecht: houd rekening met de 91.000 outputtokens per taak, niet alleen met het tarief per token.
Als je een model kiest voor werk dat je volgende maand begint, is Xiaomi MiMo-V2.6-Pro het capabelere model met een ruime gemeten voorsprong, tegen een lager gecombineerd tarief en met een MIT-licentie die het gesprek over licenties volledig overbodig maakt. Wat het nog niet heeft, is een tweede plek om te draaien. Het punt om in de gaten te houden is het aantal aanbieders: zodra dat van één af gaat, is de kloof van zeventien punten niet langer een onderzoeksresultaat maar wordt het een uitrolbeslissing.
Tot die tijd is de eerlijke samenvatting dat het betere model het model is waarvan je niet kunt failoveren, en het zwakkere model is het model dat je vanavond voor klanten kunt zetten.

Waar de cijfers in dit stuk vandaan komen
Indexscores, doorvoer, latentie, cachekortingen en aantallen providers voor beide modellen zijn metingen van Artificial Analysis op Intelligence Index v4.3.2, afgelezen op 22 september 2026, en de 29 voor MiniMax M3 staat op dezelfde versie van de samengestelde index als de 46 voor Xiaomi MiMo-V2.6-Pro. De DeepSWE v1.1-cijfers voor MiniMax M3 komen uit de openbare leaderboardvermelding van 8 juni 2026. De DeepSWE-beweging van 58,4 naar 72,57, de uitgaven voor reinforcement learning van ongeveer $2,62 miljoen voor de Pro-run over dertig stappen, en de SWE-Bench Pro-, BrowseComp-, SVG-Bench- en Terminal-Bench-cijfers voor MiniMax M3 zijn allemaal door de leverancier gerapporteerd op de eigen harnesses van de respectievelijke labs en zijn niet onafhankelijk gereproduceerd. De tarieven per token zijn de eigen lijstprijzen van de leveranciers.
