
Xiaomi MiMo-V2.6-Pro vs Grok 4.7: 30× goedkoper per taak, en geen van beide is snel
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 36 tok/s
- openaiNIEUWOpenAI: GPT-6 Luna2026-09-2237Intelligentie
- openaiNIEUWOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- anthropicNIEUWAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- grokNIEUWGrok 4.72026-09-2146Intelligentie
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens · 181 tok/s
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 1277 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
Xiaomi MiMo-V2.6-Pro en Grok 4.7 kwamen beide uit op 21 september 2026, komen beide uit op 46 op de Artificial Analysis Intelligence Index v4.3.2, en worden beide traag genoemd door de pagina die ze heeft gemeten — 43,6 outputtokens per seconde voor MiMo-V2.6-Pro tegenover een mediaan van 67,1, 40 voor Grok 4.7 bij xhigh effort. Wat hen onderscheidt, is wat een antwoord kost. Het bedrag per taak van de evaluator is $0,13 voor het Chinese open checkpoint en $3,74 voor het Grok 4.7-model, een factor van ongeveer 29. Dat is geen snelheidsverschil, of niet alleen dat: het outputtarief van Grok 4.7 is $6,00 per miljoen tokens tegenover $0,87, wat een factor zeven is, en de rest van de factor komt voort uit hoeveel tokens elk model verbruikt om tot een antwoord te komen.
Twee modellen in dezelfde maand, op dezelfde index, met dezelfde score, geprijsd alsof ze tot verschillende decennia van de markt behoren. De interessante vraag is niet welke wint. Het is welk deel van die 29× je daadwerkelijk kunt omzeilen — want in deze combinatie is precies één van de twee een route die je vandaag kunt kopen, en het is de dure.
Dezelfde dag, dezelfde score, andere dieren
Grok 4.7 werd op 21 september 2026 uitgebracht voor $2,00 per miljoen inputtokens en $6,00 per miljoen outputtokens, met een contextvenster van 500.000 tokens, een kennisafsluitdatum van mei 2026, een cachekorting van 75% en tekst- en beeldinvoer tegenover tekstuitvoer. Het scoorde 46 op de index bij xhigh-inspanning, 56 op de Coding Agent Index in de Grok Build-harness en 1.657 Elo op AA-Briefcase — vierde op die ranglijst, achter drie Anthropic-inzendingen, tegen ongeveer de helft van de kosten per taak van Claude Opus 5.
Xiaomi MiMo-V2.6-Pro is een sparse mixture-of-experts-checkpoint, 1,02 biljoen totale parameters, waarvan 42 miljard actief, MIT-gelicentieerd, 1M-tokencontext, tekst-, beeld-, spraak- en video-invoer tegenover tekstuitvoer, $0,43 en $0,87 per miljoen tokens met een cachekorting van 99% die het effectieve invoertarief bij een warme prompt tot bijna niets terugbrengt. Artificial Analysis plaatst het op de index als eerste van 114 open-weightmodellen en als twaalfde van 114 op kosten. Het is bereikbaar via drie API-providers. Het staat niet op onze routes, en we vermelden een model niet voordat een provider het heeft geïntegreerd.
De enige regel die het beslist
• Kosten per indextaak — MiMo-V2.6-Pro $0,13; Grok 4.7 $3,74 — 29× • Uitvoertarief — MiMo-V2.6-Pro $0,87 / 1M; Grok 4.7 $6,00 / 1M — 6,9× • Outputtokens bij de indexrun — MiMo-V2.6-Pro 140M; Grok 4.7 240M, tegenover een mediaan van 88M • Uitvoersnelheid — MiMo-V2.6-Pro 43,6 t/s; Grok 4.7 40 t/s — beide onder de mediaan • Contextvenster — MiMo-V2.6-Pro 1M; Grok 4.7 500K • Gewichten — MiMo-V2.6-Pro MIT-gelicenseerd en downloadbaar; Grok 4.7 propriëtair, alleen API
Lees de eerste twee bullets samen en de vorm van de kloof wordt duidelijk. Tegen lijstprijs ontlopen de twee elkaar 6,9× qua output. In de indexrun ontlopen ze elkaar 29× qua wat een antwoord kost. De vermenigvuldigingsfactor daartussen is uitvoerigheid: Grok 4.7 genereerde 240 miljoen outputtokens tegen een mediaan van 88 miljoen voor zijn klasse, en MiMo-V2.6-Pro genereerde 140 miljoen. Dat is een tokenstraf van 1,71× bovenop de tariefstraf van 6,9×, en 1,71 × 6,9 is 11,8 — de rest van de afstand tot 29 komt van de inputkant, waar de 99%-cachekorting en het inputtarief van $0,43 van MiMo-V2.6-Pro het zware werk opknappen bij een workload met ook maar enige herhaalde prefix.

Woordigheid is het getal dat mensen uit de schatting weglaten
Kostenmodellen worden meestal gebouwd op basis van een tariefkaart en een aangenomen tokenaantal. Beide helften daarvan kloppen hier niet. De tariefkaart klopt niet omdat de cachekorting geen voetnoot is — 99% tegenover 75% is het verschil tussen een systeemprompt die je bij elke aanroep geld kost en die je bijna niets kost. Het tokenaantal klopt niet omdat de twee modellen niet hetzelfde aantal tokens genereren voor hetzelfde werk, en de evaluator heeft het verschil gemeten: 240 miljoen tegenover 140 miljoen, een spreiding van 1,71× op een identieke benchmark.
Geen van beide is een proxy die je van een specificatieblad kunt aflezen. De rang voor breedsprakigheid van Grok 4.7 is #94 van de 210 modellen in zijn klasse; de kostenrang van MiMo-V2.6-Pro is #12 van de 114 in de zijne. Een team dat de tariefkaart van Grok 4.7 citeert en uitgaat van een tokenneutrale workload, voorspelt ruwweg een kwart van wat de index werkelijk per taak heeft besteed. De correctie is evenmin om de indexkosten als je schatting te gebruiken — die zijn een meting van de vorm van één benchmark. De correctie is om je eigen tokenaantallen aan beide kanten te meten voordat je je vastlegt, want de kloof tussen de twee modellen is 6,9× op papier en 29× in de praktijk, en slechts één van die getallen is echt voor jouw verkeer.

Beide zijn traag, en dat is geen gelijkspel
Artificial Analysis heeft Grok 4.7 gemeten op 40 outputtokens per seconde en noemt het “een van de traagste”; MiMo-V2.6-Pro op 43,6 en noemt het “opvallend traag”. Die twee metingen liggen dicht genoeg bij elkaar dat snelheid niet de beslissende factor tussen deze twee zou moeten zijn. Maar de medianen daaronder zijn dat niet: 67,1 voor het open-weights-veld waarin MiMo-V2.6-Pro zich bevindt. Beide modellen zitten er ruim onder, en MiMo-V2.6-Pro heeft ook een tijd tot eerste token van 3,17 seconden tegenover een mediaan van 2,31 seconden, en dat is het getal dat pijn doet in een interactieve lus in plaats van in een batchlus.
Dus de eerlijke samenvatting van de latentiekant is dat 29× goedkoper je geen sneller product oplevert, maar een langzamer product dat minder kost — en als je gebruikers naar een cursor zitten te kijken, kan de wachttijd van 3,17 seconden meer kosten dan de bespaarde tokens. Voor batchwerk dat 's nachts draait, offline-evaluatie of elke pipeline waarin de klok in uren wordt gemeten, is de afweging eenvoudig en is de 29× bijna gratis.
Wat een router wel en niet kan met deze koppeling
Dit is de combinatie waarbij onze eigen catalogus echt eenzijdig is, en het is de moeite waard daar duidelijk over te zijn. Grok 4.7 is live op OrcaRouter als grok/grok-4.7 tegen het eigen tarief van de provider van $2,00 / $6,00 met een maximale output van 450K en een OpenAI-SDK-compatibel endpoint op https://api.orcarouter.ai/v1 — dus als de vergelijking je het xAI-model achter dezelfde sleutel als al het andere doet willen, die route bestaat vandaag. Xiaomi MiMo-V2.6-Pro staat niet op onze routes; voor die kant is de eigen API van de leverancier of welke van zijn drie vermelde providers je al gebruikt het antwoord, en we zullen niet doen alsof het anders is.
Waar een router in een vergelijking als deze zijn plaats verdient, is op de onderdelen die niet het model zijn. Eén sleutel voor 200+ modellen tegen de lijstprijs van elke aanbieder met 0% opslag betekent dat een prijsverlaging van een leverancier dezelfde dag op je factuur belandt in plaats van bij de volgende contractverlenging. Automatische failover betekent dat een 40 t/s-route die degradeert, je pipeline niet meeneemt. De routing-DSL maakt het mogelijk de verdeling te baseren op de gepubliceerde kosten per taak in plaats van op merktrouw — goedkoop model voor de hoge volumes, sterk model voor de moeilijke calls, per verzoek beslist. En voor de workloads waarin geen van beide modellen helemaal geschikt is, kan model fusion meerdere modellen achter één call draaien.

Vragen die deze vergelijking meestal oproept
Geldt de 29× ook voor mijn workload? Alleen als je tokenmix lijkt op die van de index-run. Als je outputs kort zijn en je prompts lang en gecacht, dan zakt de veelvoud richting het tariefverschil van 6,9× op output en wordt die groter aan de inputkant, waar de 99%-korting van MiMo-V2.6-Pro de beslissende term is. Als je outputs lange redeneersporen zijn, loopt die op tot boven 29×, omdat de penalty voor breedsprakigheid van Grok 4.7 evenredig is met de outputlengte.
Is de 46 aan elke kant dezelfde 46? Het is dezelfde index, dezelfde versie en dezelfde schaal — de onderliggende subscores waren 46,32 en 46,45, een verschil van 0,13 punt, en de index rondt beide af naar 46. Artificial Analysis publiceert voor geen van beide modellen uitsplitsingen per evaluatie, dus de samengestelde score is de fijnste korrel die beschikbaar is en een verschil van 0,13 punt moet niet worden gelezen als een rangschikking van capaciteiten.
Welke zou een nieuw project standaard moeten kiezen? Als de werklast batch, latentietolerant en kostengevoelig is, is MiMo-V2.6-Pro tegen $0.13 per token de standaard, en de open gewichten betekenen dat je niet blootstaat aan de prijsstelling van één aanbieder. Als je specifiek het xAI-model nodig hebt — de Grok Build-resultaten, de AA-swe, de 500K-context met een cutoff van mei 2026 — dan is Grok 4.7 vandaag een live route op OrcaRouter, en de meerprijs per taak is de prijs van die specifieke capaciteit. Er is geen model dat op beide fronten wint.
Vergeleken in dit artikel1
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
