Een gegenereerde titelkaart met de tekst MiMo-V2.6-Pro vs GPT-5.6 Sol, met daaronder de ondertitel 15x de kosten per taak voor één indexpunt, en drie platte lijniconen boven de titel die een kostenmeter, een scorekaart en een gedateerde mededeling suggereren. Het OrcaRouter-logo is in de rechteronderhoek samengesteld.
Guides & Insights

MiMo-V2.6-Pro vs GPT-5.6 Sol: Eén indexpunt kost vijftien keer meer per taak

Auteur

Elias Hawthorne

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Op de Artificial Analysis Intelligence Index v4.3.2, gelezen op 25 september 2026, scoort GPT-5.6 Sol op maximale inspanning 47 en Xiaomi's MiMo-V2.6-Pro scoort 46. Eén punt. Het getal dat hen daadwerkelijk onderscheidt, is niet de score en het is niet het tarief per token — het is de prijs van één enkele indextaak, die Artificial Analysis publiceert als $1,99 voor GPT-5.6 Sol en $0,13 voor MiMo-V2.6-Pro. Vijftien keer zoveel geld voor één punt. En op het moment van deze lezing bevat de eigen pagina van de evaluator voor dat model een deprecatiemelding, omdat GPT-6 Sol het heeft vervangen.

Xiaomi publiceerde op 21 september 2026 de gewichten en het technische rapport van MiMo-V2.6-Pro, vier dagen voor deze lezing; OpenAI bracht GPT-5.6 Sol uit op 9 juli 2026. Beide bovenstaande feiten zijn nieuw sinds deze combinatie voor het laatst werd beschreven, en ze trekken in tegengestelde richtingen. De deprecatiekennisgeving zegt dat de vergelijking tegen een model is dat OpenAI al voorbij is. Het getal per taak zegt dat wat op een afrondingsfout leek toen voor beide modellen de lijstprijs werd genoemd, op een echte workload de hele beslissing is. Welke van de twee van belang is, hangt ervan af of je een model koopt of er een vervangt.

Wat de twee pagina's nu zeggen

GPT-5.6 Sol werd op 9 juli 2026 uitgebracht als het vlaggenschip van de GPT-5.6-familie. De adviesprijs is $4,00 per miljoen inputtokens en $20,00 per miljoen output op de first-party-API van OpenAI, met een cachekorting van 90%, en de pagina registreert 90 miljoen gegenereerde outputtokens tijdens de indexrun, tegen een mediaan van 88 miljoen. Het mat 73 outputtokens per seconde, wat dezelfde pagina sneller dan gemiddeld noemt ten opzichte van een mediaan van 72 t/s. De indexvermelding staat op rang 19 van 210 modellen in zijn klasse.

Xiaomi MiMo-V2.6-Pro is een sparse mixture-of-experts-checkpoint met 1,02 biljoen totale parameters en 42 miljard actieve parameters, onder MIT-licentie, met een contextvenster van 1 miljoen tokens en tekst-, beeld-, spraak- en video-invoer en tekstuitvoer. Het staat geprijsd op $0,43 en $0,87 per miljoen tokens met 99% cachekorting — een tiende van het invoertarief van Sol en een drieëntwintigste van het uitvoertarief van Sol. Het genereerde 140 miljoen uitvoertokens tijdens de indexrun, en het behaalde 43,6 uitvoertokens per seconde, wat op zijn pagina wordt beschreven als opmerkelijk traag tegenover een mediaan van 67,1 t/s.

• Kosten van de indextaak — MiMo-V2.6-Pro $0,13; GPT-5.6 Sol $1,99 — het verschil is 15× • Lijstprijs — MiMo-V2.6-Pro $0,43 / $0,87 per 1M; GPT-5.6 Sol $4,00 / $20,00 • Cachekorting — MiMo-V2.6-Pro 99%; GPT-5.6 Sol 90% • Uitvoertokens tijdens de indexrun — MiMo-V2.6-Pro 140M; GPT-5.6 Sol 90M • Uitvoersnelheid — MiMo-V2.6-Pro 43,6 t/s, tegen een mediaan van 67,1; GPT-5.6 Sol 73 t/s, tegen een mediaan van 72 • Context en gewichten — MiMo-V2.6-Pro 1M en onder MIT-licentie; GPT-5.6 Sol 1M en propriëtair

A two-column scoreboard titled MiMo-V2.6-Pro vs GPT-5.6 Sol - the scoreboard, subtitled Fifteen times the cost per index task, for one index point. The left column, Xiaomi MiMo-V2.6-Pro, reads Intelligence Index v4.3.2 46; cost per index task $0.13; list price $0.43 / $0.87 per 1M; cache discount 99%; output speed 43.6 tokens per second; 140M output tokens on the index run; 1M context. The right column, GPT-5.6 Sol (max), reads Intelligence Index v4.3.2 47; cost per index task $1.99; list price $4.00 / $20.00 per 1M; cache discount 90%; output speed 73 tokens per second; 90M output tokens; 1M context, and carries a tag reading Proprietary - deprecated. A footer line reads Artificial Analysis Intelligence Index v4.3.2, read 25 September 2026, and a warning line below it notes that the evaluator's GPT-5.6 Sol page now carries a deprecation notice and that it is superseded by GPT-6 Sol (max). The OrcaRouter logo is composited in the bottom-right corner.

De afschaffingsmelding is de belangrijkere regel.

Artificial Analysis opent nu de GPT-5.6 Sol-pagina met een omkaderde mededeling: “Dit model is verouderd. We blijven alleen prestatiebenchmarks uitvoeren voor de standaardworkload van 10k inputtokens”, gevolgd door de zin dat OpenAI een nieuwer model heeft uitgebracht, GPT-6 Sol (max), en dat dat in plaats daarvan moet worden overwogen. De 47 op de index is daarom een meting van een model dat niet langer het model is om te kopen. Dat maakt de meting niet onjuist — die is gemeten op dezelfde index, op dezelfde dag, met dezelfde effort-instelling als de 46 — maar het verandert waarvoor de vergelijking dient. Het is niet langer “welke flagship moet ik gebruiken”. Het is “wat kost de top van het proprietary-board, op het moment dat die de top was”.

Die herkadering is belangrijker dan het klinkt, want deprecatiemeldingen op evaluatorpagina's zijn een van de weinige plekken waar de productcadans van een leverancier als data opduikt in plaats van als een persbericht. De score ligt vast; het model wordt niet aangeboden. Alles wat je tegen de 47 bouwt, bouw je tegen een momentopname.

Screenshot of the Artificial Analysis model page for Xiaomi MiMo-V2.6-Pro, captured 25 September 2026. The header shows an Openweights model badge with Released September 2026, 46 on the Artificial Analysis Intelligence Index, 43.6 output tokens per second, $0.43 input and $0.87 output per 1M tokens with a 99% cache discount, and $0.13 per task to evaluate on the Intelligence Index; the summary paragraph calls the model notably slow, and the verbosity line shows 140M output tokens generated on the index run against a median of 140M.

Waarom het per-taakgetal het referentiepunt is om tegen te modelleren.

Per-token tarieven flatteren goedkope modellen en misleiden bij workloads die niet token-neutraal zijn. De kosten per indextaak zijn een andere meting: het is wat de evaluator daadwerkelijk heeft uitgegeven om één antwoord uit elk model te krijgen, wat zowel het tarief als het aantal tokens dat het model ervoor koos te genereren omvat. MiMo-V2.6-Pro genereert meer tokens dan Sol tijdens de indexrun — 140 miljoen tegenover 90 miljoen, ongeveer 1,6 keer zoveel — en kost nog steeds $0,13 per taak tegenover $1,99. Het tariefvoordeel is ongeveer drieëntwintigvoudig op de output; de verboseheidsstraf is 1,6×; het product is het vijftienvoudige verschil per taak.

Dat is de rekenkunde waarop een kostenmodel gebouwd zou moeten worden, en het is de rekenkunde die onzichtbaar is als je $0,87 tegenover $20,00 zet en stopt. Het laat je ook zien wat de conclusie zou ontkrachten. Als je workload wordt gedomineerd door zeer korte outputs, krimpt Sols tokentelling naar die van jou en doet het drieëntwintigvoudige tariefverschil het meeste werk, waardoor de werkelijke factor naar het tariefverschil toe beweegt in plaats van ervan af. Als je workload wordt gedomineerd door lange redeneringssporen, stapelt de 1,6× breedsprakigheid van MiMo-V2.6-Pro zich op en wordt $0,13 het plafond in plaats van de schatting. Het gepubliceerde cijfer is een meting van de vorm van één benchmark, niet een prijsopgave die je aan de financiële afdeling kunt geven.

De latentielijn is het eerlijke tegenwicht.

Met 43,6 outputtokens per seconde is MiMo-V2.6-Pro langzamer dan GPT-5.6 Sol, die op dezelfde dag op 73 werd gemeten — en langzamer dan de modellen waarmee de eigen pagina het vergelijkt, met een mediaan van 67,1. Op die pagina staat het met zoveel woorden: “opvallend langzaam”. Voor een batchpijplijn is dit een doorvoerkostenpost die je kunt beprijzen. Voor een interactieve agent is het een productbeslissing, en vijftien keer goedkoper per taak maakt een langzaam model niet snel. Als je beperking een budget per beurt is in plaats van een maandelijkse rekening, is de verhouding die ertoe doet 43,6 tegen 73, en die verliest MiMo-V2.6-Pro.

Waar dit landt in een project

De nuttige vorm van deze combinatie is niet “kies er één”. Het is dat beide modellen dezelfde index beantwoorden en de evaluator per taak een kostprijs voor elk publiceert, zodat de verdeling kan worden gemaakt op basis van gemeten kosten in plaats van op basis van leveranciersniveaus. Op OrcaRouter loopt de catalogus tot 200+ modellen achter één sleutel tegen de lijstprijs van elke provider met 0% markup — een prijsverlaging van een leverancier bereikt je factuur dezelfde dag, zonder een tweede contract te moeten heronderhandelen — en de routing-DSL laat een workload de goedkope, hoogvolumeoproepen naar het ene model sturen en de moeilijke naar het andere, per taak in plaats van per merk. Automatische failover dekt het geval waarin de goedkopere route verslechterd is. Xiaomi MiMo-V2.6-Pro staat niet op onze routes — we vermelden een model niet voordat een provider het heeft geonboard — dus voor die kant van de vergelijking is het eerlijke antwoord de eigen API van de leverancier of welk gehost platform je al een relatie mee hebt.

Screenshot of the Artificial Analysis model page for GPT-5.6 Sol (max), captured 25 September 2026. A boxed banner at the top reads This model is deprecated, that benchmarking continues only for the default 10k input token workload, and that OpenAI has launched a newer model, GPT-6 Sol (max), which should be considered instead. Below it the header shows an OpenAI badge, Intelligence rank 19 of 210, Speed 83 of 210, Cost 67 of 210, Verbosity 50 of 210, 47 on the Intelligence Index, $4.00 input and $20.00 output per 1M tokens, a 90% cache discount, $1.99 per task to evaluate on the Intelligence Index, and a line reading At 73 tokens per second, GPT-5.6 Sol (max) is faster than average (72).

Wat te doen met dit voor volgende week

Twee dingen zijn veranderd op 25 september 2026 en slechts één ervan gaat over prijs. GPT-5.6 Sol heeft een deprecation-melding op de index waarop het op 47 werd gemeten, wat het als aankoopbeslissing buiten werking stelt en het als benchmarkreferentie achterlaat. MiMo-V2.6-Pro wordt gemeten op $0,13 per indextaak tegenover $1,99 voor Sol, wat vijftien keer het geld is voor één indexpunt — en het haalt 43,6 tokens per seconde, wat langzamer is dan het model waarmee het wordt vergeleken en langzamer dan de mediaan van zijn eigen klasse. Leg de twee cijfers naast je eigen verkeer voordat een van beide een beslissing wordt: de kosten per taak zijn een meting, geen tarief, en de latentie is een meting, geen mening. Als je uitvoer kort en niet-interactief is, is het pleidooi voor het open checkpoint sterker dan de indexkloof suggereert. Als je uitvoer lang is of je gebruikers wachten, dan koopt de vijftienvoudige besparing je een langzamer product, en dat is een ruil die alleen jouw werklast kan beprijzen.

Vergeleken in dit artikel1

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt