Een titelkaart voor de vergelijking tussen Xiaomi MiMo-V2.6-Pro en MiniMax M3, met twee tegenover elkaar staande specificatiekaarten: Xiaomi MiMo-V2.6-Pro met Intelligence Index v4.3.2 46, uitvoersnelheid 134,3 tokens/seconde, gecombineerd $0,18 per 1M en 1 API-provider, tegenover MiniMax M3 met Index 29, 168,9 tokens/seconde, $0,22 en 15 API-providers.
Guides & Insights

Xiaomi MiMo-V2.6-Pro vs MiniMax M3: De betere score heeft de dunnere route

Auteur

Rowan Sterling

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Xiaomi MiMo-V2.6-Pro werd op 22 september 2026 algemeen beschikbaar en veroverde de toppositie in de categorie open gewichten op de Artificial Analysis Intelligence Index met 46 punten op v4.3.2. MiniMax M3 heeft sinds de release op 31 mei 2026 een variant van die titel in handen, en scoort vandaag op dezelfde index 29 — zeventien punten daarachter. De score is het minst interessante aan het tweetal. MiniMax M3 levert 168,9 outputtokens per seconde tegenover 134,3, antwoordt in 0,92 seconden tegenover 2,15, is goedkoper per inputtoken en is bereikbaar via vijftien API-aanbieders tegenover één bij Xiaomi. Het nieuwere, hoger scorende model is juist het lastigste om daadwerkelijk te kiezen, en die omkering is waar deze vergelijking over gaat.

Beide open gewichten, beide multimodaal, veertien weken uit elkaar

De twee modellen zijn nauw verwant qua ontwerpintentie. Beide zijn sparse mixture-of-experts-modellen uit Chinese labs, beide hebben een contextvenster van 1M tokens, beide accepteren afbeeldingen en video native in plaats van via een aangebouwde adapter, en beide publiceren hun gewichten. Tussen hun releases zitten veertien weken, en de indexkloof tussen hen is de afstand die de open-weights-frontier in dat venster heeft afgelegd.

• Totaal aantal parameters — Xiaomi MiMo-V2.6-Pro 1,02T; MiniMax M3 ongeveer 427B, beide sparse MoE

Actief per token — Xiaomi MiMo-V2.6-Pro 42B; MiniMax M3 ongeveer 23–25B

• Context — elk 1M tokens, waarbij MiniMax M3 een minimum van 512K garandeert

• Modaliteiten in — tekst, afbeelding en video voor beide; Xiaomi voegt audio-invoer toe

Gewichten — MIT-licentie op Xiaomi MiMo-V2.6-Pro; MiniMax M3 wordt uitgebracht onder de MiniMax Community Licence, die niet permissief is en een aparte overeenkomst voor commercieel gebruik vereist

• Uitgebracht — Xiaomi MiMo-V2.6-Pro 21–22 september 2026; MiniMax M3 31 mei 2026

• Bereikbaarheid — één API-provider geteld voor Xiaomi MiMo-V2.6-Pro op Artificial Analysis; vijftien voor MiniMax M3

Die laatste regel is degene die je in het oog moet houden. Al het andere op het blad pleit voor het nieuwere model. Die regel doet dat niet, en het is de regel die bepaalt of een model in een productiepad kan staan.

Wat de index meet, en wie hem heeft gemeten

Artificial Analysis heeft beide modellen zelf op v4.3.2 gedraaid — een samengestelde score op basis van tien evaluaties die redeneren, kennis, wiskunde en coderen omvat, waaronder AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience en AA-LCR v1.1. Noch de 46, noch de 29 is een leverancierscijfer, wat hier van belang is omdat beide labs ook eigen benchmarkcijfers hebben gepubliceerd die leverancierscijfers zijn, en de twee soorten mogen niet worden vermengd.

De 46 zet Xiaomi MiMo-V2.6-Pro aan kop van het open-weights-veld op die composiet. Daarmee staat het niet aan de top van de index: Claude Fable 5.1 en GPT-6 Astra staan beide op 53, en Claude Opus 5 op 51. De 29 van MiniMax M3 plaatst het op de zestiende plek van de 114 gemeten modellen, ruim boven de mediaan voor zijn grootteklasse, maar ver verwijderd van de frontier waarmee het in juni werd vergeleken.

MiniMax M3 heeft het bewijs dat Xiaomi niet heeft

Dit is het deel van de vergelijking dat wordt overgeslagen, en het is het deel dat een koper het zwaarst zou moeten laten meewegen. MiniMax M3 staat op de openbare DeepSWE v1.1-leaderboard met een officiële vermelding: 20,4% Pass@1 en 48,7% Pass@4, gepubliceerd op 8 juni 2026 nadat een MiniMax-inferentie-upgrade abnormale tokengeneratie verhielp en het gedrag van de long-contextcache verbeterde. Aan die vermelding hing een efficiëntieverantwoording vast, en die verantwoording is niet flatteus: een mediaan van 311 agentstappen, ongeveer 91.000 outputtokens en circa $ 5,04 per taak. Het slaagt voor engineeringtaken met een lange horizon, en het doet dat tegen hoge kosten.

Xiaomi's belangrijkste benchmarkcijfer voor zijn nieuwe model is 72,57 op DeepSWE v1.1, een stijging ten opzichte van een baseline van 58,4, gemeten met mini-swe-agent als gemiddelde van drie op Xiaomi's eigen harness. Het is geen leaderboardinzending en is ook niet als zodanig ingediend. 72,57 naast MiniMax' 20,4 zetten en daar een overwinning van 52 punten uit aflezen, is rekenwerk over twee verschillende metingen: het leaderboard publiceert Pass@1 voor een specifieke configuratie, met een betrouwbaarheidsinterval en een gemiddelde kosten per taak, wat een derde partij opnieuw kan uitvoeren, en aan het leverancierscijfer is niets daarvan verbonden. De 72,57 kan heel goed eerlijk zijn. Het is simpelweg niet hetzelfde soort object.

MiniMax publiceerde ook eigen lanceringscijfers, en voor elk daarvan geldt hetzelfde voorbehoud: SWE-Bench Pro op 59,0, BrowseComp op 83,5, SVG-Bench op 63,7 en Terminal-Bench 2.1 op 66,0, uitgevoerd op de eigen infrastructuur van MiniMax met eigen scaffolding. Beschouw ze als beweringen over het model, niet als metingen ervan.

Snelheid, latentie en de twee getallen die een rekening bepalen

Het doorvoerverschil loopt tegengesteld aan het kwaliteitsverschil, en het is groot genoeg om ertoe te doen. MiniMax M3 genereert 168,9 uitvoertokens per seconde tegenover 134,3 voor Xiaomi MiMo-V2.6-Pro, en de 0,92 seconde tot het eerste token is ongeveer tweeënhalf keer sneller dan Xiaomi's 2,15. Voor een interactief product is de latentie tot het eerste token het getal dat een gebruiker voelt; voor een batchpijplijn is doorvoer het getal dat de wandkloktijd bepaalt.

Qua kosten liggen de twee dichter bij elkaar dan de tarieven in de koppen doen vermoeden, en de richting hangt af van je verkeer. MiniMax M3 staat genoteerd tegen $0,30 per miljoen inputtokens en $1,20 per miljoen outputtokens; Xiaomi MiMo-V2.6-Pro staat genoteerd tegen $0,43 en $0,87. M3 is goedkoper voor input, Xiaomi is goedkoper voor output. Zodra cachekortingen worden toegepast — 80% voor M3, 99% voor Xiaomi — komen de gecombineerde tarieven uit op $0,22 en $0,18 per miljoen bij een 7:2:1-mix van cache-hit/input/output. Artificial Analysis noteert ook een kostenpost van $0,13 per Intelligence Index-taak voor Xiaomi MiMo-V2.6-Pro, op dezelfde manier gemeten bij elk model in het overzicht, wat het meest vergelijkbare individuele kostencijfer is dat voor de twee beschikbaar is.

A two-column comparison scoreboard for Xiaomi MiMo-V2.6-Pro and MiniMax M3 covering Intelligence Index v4.3.2 (46 vs 29), output speed (134.3 vs 168.9 tokens/second), time to first token (2.15s vs 0.92s), blended rate ($0.18 vs $0.22 per 1M), API providers (1 vs 15) and long-horizon evidence (vendor harness only vs public Pass@1 entry).

Vijftien routes tegen één, en wat failover waard is

Een indexvoorsprong van zeventien punten helpt je niet als het endpoint down is. Artificial Analysis telde op het moment van schrijven één API-provider voor Xiaomi MiMo-V2.6-Pro, en dat aantal zegt iets over de release, niet over het model: een drie dagen geleden gepubliceerd checkpoint heeft geen tijd gehad om zich te verspreiden. MiniMax M3, vier maanden oud, wordt door vijftien providers aangeboden.

Dat verschil is waar een router voor dient, en het is waar de twee modellen commercieel uiteenlopen. MiniMax M3 staat op OrcaRouter als minimax/minimax-m3: één OpenAI-compatibel endpoint, de lijstprijs van de provider doorgegeven met 0% opslag, dus de $0,30 en $1,20 hierboven zijn MiniMax' eigen cijfers en niet de onze, en een prijswijziging van MiniMax is dezelfde dag live aan onze kant. De vijftien upstreams zijn wat een automatische failoverketen zinvol maakt — een verzoek dat bij één provider blijft hangen, probeert het opnieuw bij een andere voordat het antwoord begint, wat een andere garantie is dan een model dat maar één plek heeft om naartoe te gaan. Xiaomi MiMo-V2.6-Pro staat niet op OrcaRouter; geen enkel Xiaomi-model staat erop, en het vandaag bereiken betekent Xiaomi's eigen platform en de catalogi van derden die het vermelden.

Als je beide in dezelfde applicatie wilt, is de praktische vorm één sleutel die de modellen bevat waarop je al hebt besloten, waarbij de nieuwkomer tegen hen wordt afgewogen in plaats van te worden overgenomen op grond van een score van drie dagen oud. Dat is een routeringsbeslissing, en de nuttige eigenschap is dat een uitwijkroute niets kost tot de dag dat die je redt.

The OrcaRouter model page for minimax/minimax-m3, showing MiniMax as the vendor, the 2026-05-31 release date, Vision, Tools, JSON and Reasoning capability tags, a 1M-token context window, 512K maximum output, $0.30 per 1M input and $1.20 per 1M output, and a p50 time to first token of 8.49 seconds.

Welke moet je kiezen?

Als je deze week een open-weight, multimodaal model met een miljoen tokens in productie nodig hebt, is het antwoord MiniMax M3, en het is niet eens in de buurt — vijftien providers, een eerste token in minder dan een seconde, een voldoende permissieve commerciële route alleen als je de communitylicentie hebt gelezen, en een officiële long-horizon-benchmarkinzending die je kunt inspecteren. De efficiëntiewaarschuwing is terecht: houd rekening met de 91.000 outputtokens per taak, niet alleen met het tarief per token.

Als je een model kiest voor werk dat je volgende maand begint, is Xiaomi MiMo-V2.6-Pro het capabelere model met een ruime gemeten voorsprong, tegen een lager gecombineerd tarief en met een MIT-licentie die het gesprek over licenties volledig overbodig maakt. Wat het nog niet heeft, is een tweede plek om te draaien. Het punt om in de gaten te houden is het aantal aanbieders: zodra dat van één af gaat, is de kloof van zeventien punten niet langer een onderzoeksresultaat maar wordt het een uitrolbeslissing.

Tot die tijd is de eerlijke samenvatting dat het betere model het model is waarvan je niet kunt failoveren, en het zwakkere model is het model dat je vanavond voor klanten kunt zetten.

The Artificial Analysis model page showing the Intelligence Index v4.3.2 scores, output speed, latency and per-task cost that both models in this comparison are measured on.

Waar de cijfers in dit stuk vandaan komen

Indexscores, doorvoer, latentie, cachekortingen en aantallen providers voor beide modellen zijn metingen van Artificial Analysis op Intelligence Index v4.3.2, afgelezen op 22 september 2026, en de 29 voor MiniMax M3 staat op dezelfde versie van de samengestelde index als de 46 voor Xiaomi MiMo-V2.6-Pro. De DeepSWE v1.1-cijfers voor MiniMax M3 komen uit de openbare leaderboardvermelding van 8 juni 2026. De DeepSWE-beweging van 58,4 naar 72,57, de uitgaven voor reinforcement learning van ongeveer $2,62 miljoen voor de Pro-run over dertig stappen, en de SWE-Bench Pro-, BrowseComp-, SVG-Bench- en Terminal-Bench-cijfers voor MiniMax M3 zijn allemaal door de leverancier gerapporteerd op de eigen harnesses van de respectievelijke labs en zijn niet onafhankelijk gereproduceerd. De tarieven per token zijn de eigen lijstprijzen van de leveranciers.