Een gegenereerde titelkaart met de tekst MiMo-V2.6-Pro vs Grok 4.7, met de ondertitel 29x goedkoper per taak, en daaronder langzamer aan beide kanten, en drie platte lijniconen boven de titel die vergeleken muntstapels, een snelheidsmeter en een open hangslot suggereren. Het OrcaRouter-logo is samengevoegd in de rechteronderhoek.
Guides & Insights

Xiaomi MiMo-V2.6-Pro vs Grok 4.7: 30× goedkoper per taak, en geen van beide is snel

Auteur

Elias Hawthorne

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Xiaomi MiMo-V2.6-Pro en Grok 4.7 kwamen beide uit op 21 september 2026, komen beide uit op 46 op de Artificial Analysis Intelligence Index v4.3.2, en worden beide traag genoemd door de pagina die ze heeft gemeten — 43,6 outputtokens per seconde voor MiMo-V2.6-Pro tegenover een mediaan van 67,1, 40 voor Grok 4.7 bij xhigh effort. Wat hen onderscheidt, is wat een antwoord kost. Het bedrag per taak van de evaluator is $0,13 voor het Chinese open checkpoint en $3,74 voor het Grok 4.7-model, een factor van ongeveer 29. Dat is geen snelheidsverschil, of niet alleen dat: het outputtarief van Grok 4.7 is $6,00 per miljoen tokens tegenover $0,87, wat een factor zeven is, en de rest van de factor komt voort uit hoeveel tokens elk model verbruikt om tot een antwoord te komen.

Twee modellen in dezelfde maand, op dezelfde index, met dezelfde score, geprijsd alsof ze tot verschillende decennia van de markt behoren. De interessante vraag is niet welke wint. Het is welk deel van die 29× je daadwerkelijk kunt omzeilen — want in deze combinatie is precies één van de twee een route die je vandaag kunt kopen, en het is de dure.

Dezelfde dag, dezelfde score, andere dieren

Grok 4.7 werd op 21 september 2026 uitgebracht voor $2,00 per miljoen inputtokens en $6,00 per miljoen outputtokens, met een contextvenster van 500.000 tokens, een kennisafsluitdatum van mei 2026, een cachekorting van 75% en tekst- en beeldinvoer tegenover tekstuitvoer. Het scoorde 46 op de index bij xhigh-inspanning, 56 op de Coding Agent Index in de Grok Build-harness en 1.657 Elo op AA-Briefcase — vierde op die ranglijst, achter drie Anthropic-inzendingen, tegen ongeveer de helft van de kosten per taak van Claude Opus 5.

Xiaomi MiMo-V2.6-Pro is een sparse mixture-of-experts-checkpoint, 1,02 biljoen totale parameters, waarvan 42 miljard actief, MIT-gelicentieerd, 1M-tokencontext, tekst-, beeld-, spraak- en video-invoer tegenover tekstuitvoer, $0,43 en $0,87 per miljoen tokens met een cachekorting van 99% die het effectieve invoertarief bij een warme prompt tot bijna niets terugbrengt. Artificial Analysis plaatst het op de index als eerste van 114 open-weightmodellen en als twaalfde van 114 op kosten. Het is bereikbaar via drie API-providers. Het staat niet op onze routes, en we vermelden een model niet voordat een provider het heeft geïntegreerd.

De enige regel die het beslist

• Kosten per indextaak — MiMo-V2.6-Pro $0,13; Grok 4.7 $3,74 — 29× • Uitvoertarief — MiMo-V2.6-Pro $0,87 / 1M; Grok 4.7 $6,00 / 1M — 6,9× • Outputtokens bij de indexrun — MiMo-V2.6-Pro 140M; Grok 4.7 240M, tegenover een mediaan van 88M • Uitvoersnelheid — MiMo-V2.6-Pro 43,6 t/s; Grok 4.7 40 t/s — beide onder de mediaan • Contextvenster — MiMo-V2.6-Pro 1M; Grok 4.7 500K • Gewichten — MiMo-V2.6-Pro MIT-gelicenseerd en downloadbaar; Grok 4.7 propriëtair, alleen API

Lees de eerste twee bullets samen en de vorm van de kloof wordt duidelijk. Tegen lijstprijs ontlopen de twee elkaar 6,9× qua output. In de indexrun ontlopen ze elkaar 29× qua wat een antwoord kost. De vermenigvuldigingsfactor daartussen is uitvoerigheid: Grok 4.7 genereerde 240 miljoen outputtokens tegen een mediaan van 88 miljoen voor zijn klasse, en MiMo-V2.6-Pro genereerde 140 miljoen. Dat is een tokenstraf van 1,71× bovenop de tariefstraf van 6,9×, en 1,71 × 6,9 is 11,8 — de rest van de afstand tot 29 komt van de inputkant, waar de 99%-cachekorting en het inputtarief van $0,43 van MiMo-V2.6-Pro het zware werk opknappen bij een workload met ook maar enige herhaalde prefix.

A two-column scoreboard titled MiMo-V2.6-Pro vs Grok 4.7 - the scoreboard, subtitled Same index score, same month, 29x apart per task. The left column, Xiaomi MiMo-V2.6-Pro, reads Intelligence Index v4.3.2 46; cost per index task $0.13; list price $0.43 / $0.87 per 1M; output speed 43.6 tokens per second; 140M output tokens on the index run; 1M context; weights downloadable, and carries a tag reading Open weights - MIT. The right column, Grok 4.7 (xhigh), reads Intelligence Index v4.3.2 46; cost per index task $3.74; list price $2.00 / $6.00 per 1M; output speed 40 tokens per second; 240M output tokens; 500K context; weights not released, and carries a tag reading Proprietary - API only. A footer line reads that index scores, per-task cost, speed and token counts are per Artificial Analysis Intelligence Index v4.3.2, read 25 September 2026, and that both models shipped 21 September 2026. The OrcaRouter logo is composited in the bottom-right corner.

Woordigheid is het getal dat mensen uit de schatting weglaten

Kostenmodellen worden meestal gebouwd op basis van een tariefkaart en een aangenomen tokenaantal. Beide helften daarvan kloppen hier niet. De tariefkaart klopt niet omdat de cachekorting geen voetnoot is — 99% tegenover 75% is het verschil tussen een systeemprompt die je bij elke aanroep geld kost en die je bijna niets kost. Het tokenaantal klopt niet omdat de twee modellen niet hetzelfde aantal tokens genereren voor hetzelfde werk, en de evaluator heeft het verschil gemeten: 240 miljoen tegenover 140 miljoen, een spreiding van 1,71× op een identieke benchmark.

Geen van beide is een proxy die je van een specificatieblad kunt aflezen. De rang voor breedsprakigheid van Grok 4.7 is #94 van de 210 modellen in zijn klasse; de kostenrang van MiMo-V2.6-Pro is #12 van de 114 in de zijne. Een team dat de tariefkaart van Grok 4.7 citeert en uitgaat van een tokenneutrale workload, voorspelt ruwweg een kwart van wat de index werkelijk per taak heeft besteed. De correctie is evenmin om de indexkosten als je schatting te gebruiken — die zijn een meting van de vorm van één benchmark. De correctie is om je eigen tokenaantallen aan beide kanten te meten voordat je je vastlegt, want de kloof tussen de twee modellen is 6,9× op papier en 29× in de praktijk, en slechts één van die getallen is echt voor jouw verkeer.

Screenshot of the Artificial Analysis model page for Grok 4.7 (xhigh), captured 25 September 2026. The header shows Intelligence rank 21 of 210, Speed 159 of 210, Cost 210 of 210, Verbosity 94 of 210, 46 on the Artificial Analysis Intelligence Index, $2.00 input and $6.00 output per 1M tokens with a 75% cache discount, $3.74 per task to evaluate on the Intelligence Index, and 500K context; the summary paragraph calls the model notably slow and very verbose, and the verbosity line shows 240M output tokens generated on the index run against a median of 88M.

Beide zijn traag, en dat is geen gelijkspel

Artificial Analysis heeft Grok 4.7 gemeten op 40 outputtokens per seconde en noemt het “een van de traagste”; MiMo-V2.6-Pro op 43,6 en noemt het “opvallend traag”. Die twee metingen liggen dicht genoeg bij elkaar dat snelheid niet de beslissende factor tussen deze twee zou moeten zijn. Maar de medianen daaronder zijn dat niet: 67,1 voor het open-weights-veld waarin MiMo-V2.6-Pro zich bevindt. Beide modellen zitten er ruim onder, en MiMo-V2.6-Pro heeft ook een tijd tot eerste token van 3,17 seconden tegenover een mediaan van 2,31 seconden, en dat is het getal dat pijn doet in een interactieve lus in plaats van in een batchlus.

Dus de eerlijke samenvatting van de latentiekant is dat 29× goedkoper je geen sneller product oplevert, maar een langzamer product dat minder kost — en als je gebruikers naar een cursor zitten te kijken, kan de wachttijd van 3,17 seconden meer kosten dan de bespaarde tokens. Voor batchwerk dat 's nachts draait, offline-evaluatie of elke pipeline waarin de klok in uren wordt gemeten, is de afweging eenvoudig en is de 29× bijna gratis.

Wat een router wel en niet kan met deze koppeling

Dit is de combinatie waarbij onze eigen catalogus echt eenzijdig is, en het is de moeite waard daar duidelijk over te zijn. Grok 4.7 is live op OrcaRouter als grok/grok-4.7 tegen het eigen tarief van de provider van $2,00 / $6,00 met een maximale output van 450K en een OpenAI-SDK-compatibel endpoint op https://api.orcarouter.ai/v1 — dus als de vergelijking je het xAI-model achter dezelfde sleutel als al het andere doet willen, die route bestaat vandaag. Xiaomi MiMo-V2.6-Pro staat niet op onze routes; voor die kant is de eigen API van de leverancier of welke van zijn drie vermelde providers je al gebruikt het antwoord, en we zullen niet doen alsof het anders is.

Waar een router in een vergelijking als deze zijn plaats verdient, is op de onderdelen die niet het model zijn. Eén sleutel voor 200+ modellen tegen de lijstprijs van elke aanbieder met 0% opslag betekent dat een prijsverlaging van een leverancier dezelfde dag op je factuur belandt in plaats van bij de volgende contractverlenging. Automatische failover betekent dat een 40 t/s-route die degradeert, je pipeline niet meeneemt. De routing-DSL maakt het mogelijk de verdeling te baseren op de gepubliceerde kosten per taak in plaats van op merktrouw — goedkoop model voor de hoge volumes, sterk model voor de moeilijke calls, per verzoek beslist. En voor de workloads waarin geen van beide modellen helemaal geschikt is, kan model fusion meerdere modellen achter één call draaien.

Screenshot of the OrcaRouter model page for Grok 4.7, captured 25 September 2026. The page shows the model id grok/grok-4.7, a maximum output of 450K, output text, public benchmarks by grok dated 2026-09-21, a price of $2.00 per 1M input and $6.00 per 1M output, and an OpenAI-SDK-compatible code sample whose base URL is https://api.orcarouter.ai/v1 and whose model field is grok/grok-4.7.

Vragen die deze vergelijking meestal oproept

Geldt de 29× ook voor mijn workload? Alleen als je tokenmix lijkt op die van de index-run. Als je outputs kort zijn en je prompts lang en gecacht, dan zakt de veelvoud richting het tariefverschil van 6,9× op output en wordt die groter aan de inputkant, waar de 99%-korting van MiMo-V2.6-Pro de beslissende term is. Als je outputs lange redeneersporen zijn, loopt die op tot boven 29×, omdat de penalty voor breedsprakigheid van Grok 4.7 evenredig is met de outputlengte.

Is de 46 aan elke kant dezelfde 46? Het is dezelfde index, dezelfde versie en dezelfde schaal — de onderliggende subscores waren 46,32 en 46,45, een verschil van 0,13 punt, en de index rondt beide af naar 46. Artificial Analysis publiceert voor geen van beide modellen uitsplitsingen per evaluatie, dus de samengestelde score is de fijnste korrel die beschikbaar is en een verschil van 0,13 punt moet niet worden gelezen als een rangschikking van capaciteiten.

Welke zou een nieuw project standaard moeten kiezen? Als de werklast batch, latentietolerant en kostengevoelig is, is MiMo-V2.6-Pro tegen $0.13 per token de standaard, en de open gewichten betekenen dat je niet blootstaat aan de prijsstelling van één aanbieder. Als je specifiek het xAI-model nodig hebt — de Grok Build-resultaten, de AA-swe, de 500K-context met een cutoff van mei 2026 — dan is Grok 4.7 vandaag een live route op OrcaRouter, en de meerprijs per taak is de prijs van die specifieke capaciteit. Er is geen model dat op beide fronten wint.

Vergeleken in dit artikel1

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt