Een gegenereerde hero-titelkaart voor 'GPT-5.6 Sol Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed' met de overline 'Two speed tiers. One missing price.' en twee kaarten: links 'GPT-5.6 Sol Ultrafast' met Weights: same as Sol, Speed claim: up to 14x, Price: not published yet; rechts 'MiMo v2.6 Pro Ultraspeed' met Weights: same as Pro, Speed claim: 10x to 20x, Price: $4.35 / $8.70; footer 'Neither has been independently measured.' OrcaRouter-logo rechtsonder.
Guides & Insights

GPT-5.6 Sol Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed: Twee snelheidsniveaus, één ontbrekende prijs

Auteur

Rowan Sterling

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Twee leveranciers brachten hetzelfde productidee drie weken na elkaar uit, en het verschil tussen hen is de beste manier om te zien wat elk echt verkoopt. De Xiaomi-kant kwam uit op 22 september 2026: Xiaomi MiMo v2.6 Pro Ultraspeed is hetzelfde checkpoint met 1,02 biljoen parameters als MiMo-V2.6-Pro, sneller geserveerd, tegen $4,35 per miljoen invoertokens en $8,70 per miljoen uitvoertokens, tegenover $0,44 en $0,87 voor de standaard Pro-lane. De GPT-5.6 Sol Ultrafast van de leverancier is dezelfde manoeuvre toegepast op GPT-5.6 Sol: identieke gewichten, tot 750 uitvoertokens per seconde, tot 14× de standaardtier, draaiend op Cerebras wafer-scale hardware — en helemaal geen gepubliceerde prijs, zes weken nadat de modus op 13 augustus werd aangekondigd.

Zet de twee naast elkaar en de anomalie is onmiddellijk duidelijk. Xiaomi publiceerde een tariefkaart voordat het de meeste benchmarks publiceerde. OpenAI publiceerde de benchmarks, de hardwarepartner en de klantnamen — en heeft nog steeds geen getal gepubliceerd waarop je kunt budgetteren. Een van deze niveaus is vandaag te koop. Het andere is een waarde in een API-schema. Ze vergelijken gaat daarom minder over welke sneller is, en meer over wat een snelheidsniveau waard is wanneer de ene leverancier je de prijs heeft verteld en de andere niet.

Wat elk ervan eigenlijk is

Geen van beide is een nieuw model. Dat is de gedeelde premisse, en het is de moeite waard om die ronduit te stellen, want beide lanceringen kregen berichtgeving die een wijziging in de modelbediening behandelde als een release van nieuwe capaciteiten.

MiMo v2.6 Pro Ultraspeed is een serveerconfiguratie van Xiaomi's vlaggenschip: dezelfde sparse mixture-of-experts-checkpoint met 1,02 biljoen parameters en 42B geactiveerd per token, dezelfde context van 1M tokens, dezelfde native multimodaliteit voor tekst, afbeelding, video en audio, dezelfde MIT-gelicentieerde gewichten op de openbare repositories. Xiaomi's eigen materiaal claimt tot 20 keer de uitvoersnelheid van de standaard Pro-service bij dezelfde kwaliteit; catalogusvermeldingen van derden die hetzelfde model op dezelfde dag beschrijven, zeggen ongeveer 10 keer. Niemand heeft een meting gepubliceerd die de twee met elkaar verzoent.

GPT-5.6 Sol Ultrafast is een serveerconfiguratie van het vlaggenschip van OpenAI: dezelfde checkpoint, hetzelfde redeneergedrag, hetzelfde contextvenster van 1.050.000 tokens, dezelfde maximale output van 128K, dezelfde antwoorden. De versnelling is hardware in plaats van scheduling — de gewichten van het model bevinden zich in on-chip SRAM op Cerebras wafer-scale silicium in plaats van heen en weer te worden geschoven tussen GPU-geheugen en rekenkracht — en het is het eerste product van het OpenAI–Cerebras compute-partnerschap van januari 2026, naar verluidt ongeveer $10 miljard over drie jaar.

Dus de eerlijke vergelijkingsas is niet intelligentie. Het is wat de leverancier koos te veranderen, wat hij voor die verandering in rekening bracht, en hoeveel van die verandering hij je liet verifiëren.

A screenshot of the Hugging Face model card for XiaomiMiMo/MiMo-V2.6-Pro-RL, showing the TextGeneration / Transformers / Safetensors / English / Chinese / mimo_v2 / multimodal / conversational / custom_code / 3-bit precision fp8 tags, a License: mit badge, 53 likes, and the card opening 'MiMo-V2.6-Pro-RL — Scaling Reinforcement Learning Toward Self-Improvement' with the Technical Report link and the introduction describing native omnimodal input and a 1M-token context window.

De tariefkaarten, inclusief de blanco.

• MiMo v2.6 Pro Ultraspeed — $4,35 input / $8,70 output per miljoen tokens, gepubliceerd door Xiaomi.

• MiMo-V2.6-Pro standaard — $0,44 / $0,87, gepubliceerd in de commerciële catalogi van Xiaomi. Ongeveer 9,9× op input en precies 10× op output.

• GPT-5.6 Sol Ultrafast — geen gepubliceerde tariefkaart per 27 september 2026. De prijspagina van OpenAI heeft nog steeds vier tabbladen — Standard, Batch, Flex, Fast — en dit niveau staat daar niet tussen.

GPT-5.6 Sol standaard — $4,00 / $20,00 per miljoen, het huidige promotietarief van OpenAI, met gecachte invoer tegen $0,40 en een stap naar lange context van $8,00 / $30,00 na ongeveer 272K tokens aan invoer.

• De enige vergelijkbare premiumoptie die OpenAI ooit heeft geprijsd — Fast mode, voor $8,00 / $40,00, exact het dubbele van het standaardtarief voor een outputsnelheid tot ongeveer 2,5×.

Die laatste rij is de hele reden waarom het lege vak ertoe doet. Xiaomi's snelheidsniveau kost tien keer zoveel als het standaardtarief en claimt tien tot twintig keer de snelheid, wat op zijn minst intern coherent is als ruil: je betaalt evenredig meer voor evenredig minder wachten, en de inzet is dat de werkelijke tijd het product is. OpenAI's snelheidsniveau doet een groter beroep op schaarser silicium dan Fast mode, dus wat het uiteindelijk ook kost, het precedent zegt een premie in plaats van een korting. Maar "het precedent zegt een premie" is geen getal, en zolang dat getal niet bestaat, kan dat niveau qua prijs helemaal niet met UltraSpeed worden vergeleken — alleen op het feit dat Xiaomi bereid was zijn getal te noemen en OpenAI niet.

Waar de cijfers vandaan kwamen

De twee niveaus hebben tegenovergestelde bewijsproblemen, en het is de moeite waard om beide te benoemen in plaats van het verschil te verdelen.

Xiaomi's snelheidsclaim is vaag qua grootteorde, maar verankerd aan een gepubliceerde prijs. De 20× is een door de leverancier opgegeven plafond onder voorwaarden die Xiaomi niet heeft gespecificeerd, de 10× is wat een catalogusvermelding als typisch wilde beweren, en de werkelijke factor ligt ergens in een brede band die niemand in het openbaar heeft gemeten bij een opgegeven gelijktijdigheidsniveau. Daartegenover staat dat de prijs exact is, de gewichten downloadbaar zijn onder MIT, en het technische rapport en de trainingsomgeving voor reinforcement learning openbaar zijn — je kunt inspecteren wat Xiaomi heeft gedaan, je kunt alleen nog niet verifiëren hoe snel het draait.

De snelheidsclaim van OpenAI is specifiek in omvang, maar nergens aan een koopbaar product verankerd. Tot 750 outputtokens per seconde, tot 14× standaard, ronduit vermeld. Het is ook een doorvoercijfer voor outputtokens, geen vaste end-to-end-vermenigvuldigingsfactor: de verwerking van invoer en de eigen redenering van het model worden niet in die verhouding gecomprimeerd, en daarom noemt het bedrijf het een maximum. De ondersteunende benchmarks zijn door de leverancier gerapporteerd en in één geval cross-vendor — een Humanity's Last Exam-run met 2.500 vragen waarvan wordt gemeld dat die in 11 uur 11 minuten klaar was, tegenover 78 uur 27 minuten voor Claude Fable 5, met vergelijkbare nauwkeurigheid. Onafhankelijke berichtgeving over de lancering citeerde een nauwere, ruwweg 11× vergelijking van de generatiesnelheid op dezelfde run, terwijl Cerebras' eigen cijfers ongeveer 7× suggereren voor de totale testtijd. Drie partijen, drie fracties van één workload, geen enkele reproductie door derden van welke dan ook. Cerebras rapporteert afzonderlijk 5,6× end-to-end op GDP-Val zonder meetbaar kwaliteitsverlies, eveneens niet gereproduceerd.

Beide sets cijfers zijn door de leverancier opgegeven. Het verschil is dat de vaagheid van Xiaomi over snelheid gaat en die van OpenAI over kosten, en voor wie een budget opstelt, zijn kosten het moeilijkst te raden.

A generated two-column scoreboard titled 'GPT-5.6 Sol Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed — the scoreboard'. Left column 'GPT-5.6 Sol Ultrafast': Checkpoint same as Sol, Speed claim up to 14x, Output speed up to 750 tok/s, Price not published, Context 1.05M tokens, Access waitlisted preview. Right column 'MiMo v2.6 Pro Ultraspeed': Checkpoint same as Pro, Speed claim 10x to 20x, Output speed not published, Price $4.35 / $8.70, Context 1M tokens, Access purchasable today. Footer sourcing line noting neither speed claim is independently measured; OrcaRouter logo bottom-right.

Wat er deze week is gebeurd, en waarom het de kloof niet dicht.

De reden dat deze vergelijking überhaupt een nieuwshaakje heeft, is een commit en niet een aankondiging. De waarde ultrafast staat sinds 13 augustus 2026 in OpenAI's publieke openai-openapi-schema — dezelfde dag dat de modus werd aangekondigd — met de beschrijving die hem beperkt tot gpt-5.6-sol en hem toegangsgecontroleerd noemt. De commit die deze week werd doorgevoerd, is later en kleiner: op 25 september 2026 voegde fe4f7a1 ultrafast toe aan twee verdere enumeraties, de service-tier-parameter op verzoekniveau en het service-tier-beleidsveld van agents. Vóór die commit luidden die twee lijsten auto, default, flex, priority, fast. Daarna is er een vermelding met de beschrijving "Maakt gebruik van de ultrafast-servicetier."ultrafast toe aan de service_tier-enumeraties in de publieke openai-openapi-specificatie — het veld dat het schema omschrijft als "de servicetier die voor modelverzoeken wordt gebruikt", en het beleidsveld dat aan agents is gekoppeld. Vóór de wijziging luidde die lijst default, flex, priority, fast. Daarna is er een vermelding met de beschrijving "Maakt gebruik van de ultrafast-servicetier."

Het onderscheid is van belang voor iedereen die de berichtgeving leest. Dit is niet de tier die wordt gecreëerd; het is de tier die wordt gekoppeld aan het veld waarmee een agent is geconfigureerd, wat betekent dat er uiteindelijk een client tegen kan worden geschreven zonder enig nieuw endpoint. Berichtgeving de volgende dag beschrijft een Fast / Standard / Ultrafast-selector die naar de Responses API Playground komt, waarbij bredere toegang wordt verwacht na OpenAI's DevDay-conferentie. We hebben de selector niet gezien en OpenAI heeft geen uitrolbericht gepubliceerd, dus dat deel komt uit één bron. Wat controleerbaar is, zijn de toegevoegde schemavermeldingen en het aanhoudende ontbreken van een tariefkaart zes weken na de aankondiging.

Ondertussen is de tier van Xiaomi al vijf dagen verkrijgbaar en is het nog steeds de enige van de twee die je op een factuur kunt zetten. De eigen open vraag is anders: of een 10×-premie standhoudt, of dat het zich gedraagt als de meeste introductieprijzen voor een nieuwe premiumtier en afdrijft naar het standaardspoor zodra de berichtgeving over de lancering stopt. Standard Pro tegen $0,44 / $0,87 is het anker, en een tier die opent op tien keer zijn anker, eindigt daar zelden.

Kiezen tussen hen, aangezien je waarschijnlijk niet kunt

De ongemakkelijke praktische realiteit is dat dit voor de meeste lezers een vergelijking is tussen een niveau dat je niet kunt kopen en een dat je waarschijnlijk niet tegen de lijstprijs zou moeten kopen. GPT-5.6 Sol Ultrafast is een preview met wachtlijst voor geselecteerde klanten, die wordt uitgebreid naarmate de capaciteit groeit, zonder datum voor algemene beschikbaarheid en zonder prijs; MiMo v2.6 Pro Ultraspeed is beschikbaar, duur en gebouwd voor een specifiek soort koper.

De workloadtest is voor beide hetzelfde, en het gaat om de vorm van je requestgraaf, niet om de grootte van je prompt. Eén enkele lange generatie levert veel minder op dan de headline-multiplier, omdat inputverwerking en redenering niet in dezelfde verhouding versnellen. Een agentlus van veertig stappen achter één voor de gebruiker zichtbare actie levert iets op dat veel dichter bij het volledige getal ligt, omdat elke roundtrip latentie is waar iemand op zit te wachten. Als je verkeer op de tweede vorm lijkt, zijn beide tiers op jou gericht; als het op de eerste lijkt, was de standaardbaan op beide modellen altijd de juiste keuze, en de standaard MiMo-V2.6-Pro-baan voor $0.44 / $0.87 is een van de goedkoopste manieren om waar dan ook een model van de biljoen-parameterklasse aan te roepen.

Wat geen van beide niveaus verandert, is dat je latentie koopt, niet kwaliteit. Als je UltraSpeed of Ultrafast benchmarkt tegen de eigen standaardroute op identieke prompts en andere antwoorden krijgt, is dat een bevinding die het melden waard is, geen feature — niets in de beschrijving van een van beide leveranciers beweert dat de gewichten zijn veranderd.

Dit is ook het geval waarin een router zijn bestaansrecht verdient, en specifiek voor de tier die je niet kunt krijgen. GPT-5.6 Sol staat live op OrcaRouter als openai/gpt-5.6-sol tegen het eigen tarief van de provider met nul opslag op tokens via het OpenAI-compatibele endpoint op api.orcarouter.ai/v1, dus de standaardbaan waarop je zou terugvallen is één base-URL-wijziging verwijderd, en dezelfde sleutel ontsluit 200+ modellen. Dat is belangrijk, want het eerlijke antwoord op "moet ik Ultrafast gebruiken" is vandaag "dat kan niet, dus bepaal wat in de tussentijd het interactieve verkeer draagt" — en de manier om latentie te kopen zonder wachtlijst is de interactieve calls te routeren naar welk model in de catalogus dan ook je kwaliteitslat haalt met de laagste wall-clocktijd, en het nachtwerk op de goedkoopste baan te laten die slaagt. Wanneer de tier opengaat, is dat de schakelaar die je omzet. Vermeld duidelijk wat wij niet hosten: er staat geen Xiaomi-model op OrcaRouter, dus MiMo v2.6 Pro Ultraspeed komt van Xiaomi's eigen API en diverse third-party platformen, en deze pagina is geen route daarnaartoe.

A screenshot of the Artificial Analysis model page for MiMo-V2.6-Pro, labelled 'Openweights model, Released September 2026', showing the Intelligence, Performance & Price Analysis headings with an Intelligence Index figure, a Speed figure, a Cost figure of In $0.435 / Out $0.87 with a 99% cache discount, a $0.13 blended figure, a Verbosity rank of 20/115, and a Comparison Summary describing the model as among the leading open-weight models in intelligence and notably fast but somewhat verbose, with text, image, speech and video input and a 1M-token context window.

Wat zou het beslechten?

Drie metingen, waarvan er nog geen enkele bestaat. Een gepubliceerde Ultrafast-tariefkaart zou dit de vergelijking maken die het verdient, in plaats van een vergelijking met een gat erin. Een onafhankelijke latentieverdeling bij een opgegeven gelijktijdigheidsniveau zou je vertellen of Xiaomi's werkelijke vermenigvuldigingsfactor dichter bij 10× of 20× ligt, en of die onder belasting standhoudt in plaats van in een demonstratie met één stream. En een onafhankelijke reproductie van de benchmarksuite van een van beide leveranciers zou beide reeksen cijfers uit de kolom met beweringen halen.

Tot die tijd is de verdedigbare lezing beperkt. Xiaomi bracht een snelheidsniveau uit met een prijs en een vage snelheid; OpenAI bracht een snelheidsniveau uit met een specifieke snelheid en geen prijs; beide zijn hetzelfde model als het product waartegen ze zijn geprijsd, en geen van beide is onafhankelijk gemeten. Als je de latentie nu nodig hebt en de workload interactief is, is UltraSpeed echt, te koop en gericht geprijsd op precies de koper die het beoogt. Als je het nu nodig hebt en de workload is dat niet, zijn de standaardroutes op beide modellen goedkoper, beproefd en vandaag beschikbaar — en de categorie waar iedereen over discussieert, zal er nog steeds zijn wanneer iemand een getal publiceert.