Ett genererat hero-titelkort för 'GPT-5.6 Sol Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed' med överraden 'Två hastighetsnivåer. Ett saknat pris.' och två kort: till vänster 'GPT-5.6 Sol Ultrafast' med Vikter: samma som Sol, Hastighetsanspråk: upp till 14x, Pris: inte publicerat ännu; till höger 'MiMo v2.6 Pro Ultraspeed' med Vikter: samma som Pro, Hastighetsanspråk: 10x till 20x, Pris: $4.35 / $8.70; sidfot 'Ingen av dem har oberoende mätts.' OrcaRouter-logotyp nere till höger.
Guides & Insights

GPT-5.6 Sol Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed: Två hastighetsnivåer, ett saknat pris

Författare

Rowan Sterling

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller →
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Två leverantörer lanserade samma produktidé med tre veckors mellanrum, och skillnaden mellan dem är det bästa sättet att se vad var och en egentligen säljer. Xiaomi-sidan landade den 22 september 2026: Xiaomi MiMo v2.6 Pro Ultraspeed är samma checkpoint med 1,02 biljoner parametrar som MiMo-V2.6-Pro, som serveras snabbare, till $4,35 per miljon indatatokens och $8,70 per miljon utdatatokens, mot standard Pro-linjens $0,44 och $0,87. Leverantörens GPT-5.6 Sol Ultrafast är samma manöver tillämpad på GPT-5.6 Sol: identiska vikter, upp till 750 utdatatokens per sekund, upp till 14× standardnivån, som körs på Cerebras wafer-scale-hårdvara – och inget publicerat pris alls, sex veckor efter att läget tillkännagavs den 13 augusti.

Ställ de två sida vid sida och anomalin är omedelbar. Xiaomi publicerade en prislista innan den publicerade de flesta av benchmarksen. OpenAI publicerade benchmarksen, hårdvarupartnern och kundnamnen — och har fortfarande inte publicerat en siffra du kan budgetera mot. En av dessa nivåer kan köpas i dag. Den andra är ett värde i ett API-schema. Att jämföra dem handlar därför mindre om vilken som är snabbare och mer om vad en hastighetsnivå är värd när en leverantör har berättat priset för dig och den andra inte har gjort det.

Vad var och en faktiskt är

Ingendera är en ny modell. Det är den gemensamma premissen, och det är värt att säga rakt ut, eftersom båda lanseringarna lockade bevakning som behandlade en förändring i servingen som ett släpp av nya förmågor.

MiMo v2.6 Pro Ultraspeed är en serveringskonfiguration av Xiaomis flaggskepp: samma glesa mixture-of-experts-checkpoint med 1,02T parametrar och 42B aktiverade per token, samma 1M-tokenkontext, samma inbyggda multimodalitet för text, bild, video och ljud, samma MIT-licensierade vikter i de offentliga repositorierna. Xiaomis eget material hävdar upp till 20 gånger utdatahastigheten för standard-Pro-tjänsten vid samma kvalitet; listningar i tredjepartskataloger som beskriver samma modell samma dag anger ungefär 10 gånger. Ingen har publicerat en mätning som förenar de två.

GPT-5.6 Sol Ultrafast är en serveringskonfiguration av OpenAIs flaggskepp: samma checkpoint, samma resonemangsbeteende, samma kontextfönster på 1 050 000 token, samma maximala utdata på 128K, samma svar. Accelerationen är hårdvara snarare än schemaläggning – modellens vikter ligger i on-chip-SRAM på Cerebras wafer-scale-kisel i stället för att flyttas fram och tillbaka mellan GPU-minne och beräkning – och den är den första produkten från OpenAI–Cerebras beräkningspartnerskap i januari 2026, rapporterat till cirka 10 miljarder dollar över tre år.

Så den ärliga axeln för jämförelse är inte intelligens. Det är vad leverantören valde att ändra, vad den tog betalt för ändringen, och hur mycket av ändringen den lät dig verifiera.

A screenshot of the Hugging Face model card for XiaomiMiMo/MiMo-V2.6-Pro-RL, showing the TextGeneration / Transformers / Safetensors / English / Chinese / mimo_v2 / multimodal / conversational / custom_code / 3-bit precision fp8 tags, a License: mit badge, 53 likes, and the card opening 'MiMo-V2.6-Pro-RL — Scaling Reinforcement Learning Toward Self-Improvement' with the Technical Report link and the introduction describing native omnimodal input and a 1M-token context window.

Priskorten, inklusive det tomma.

• MiMo v2.6 Pro Ultraspeed — 4,35 USD för indata / 8,70 USD för utdata per miljon tokens, publicerat av Xiaomi.

• MiMo-V2.6-Pro standard — $0,44 / $0,87, publicerade av Xiaomis kommersiella kataloger. Ungefär 9,9× på input och exakt 10× på output.

• GPT-5.6 Sol Ultrafast — ingen publicerad prislista per den 27 september 2026. OpenAI:s prissida har fortfarande fyra flikar – Standard, Batch, Flex, Fast – och nivån finns inte bland dem.

• GPT-5.6 Sol standard — 4,00 $ / 20,00 $ per miljon, OpenAI:s nuvarande kampanjpris, med cachad indata på 0,40 $ och ett steg för lång kontext till 8,00 $ / 30,00 $ efter cirka 272 000 tokens indata.

• Det enda jämförbara premium som OpenAI någonsin har prissatt — Fast mode, till $8,00 / $40,00, exakt dubbelt så mycket som standardpriset för upp till cirka 2,5× utdatahastighet.

Den där sista raden är hela anledningen till att den tomma rutan spelar roll. Xiaomis hastighetsnivå kostar tio gånger så mycket som standardbanan och utlovar tio till tjugo gånger så hög hastighet, vilket åtminstone är internt sammanhängande som ett utbyte: du betalar proportionellt mer för proportionellt mindre väntan, och vadet är att väggklockstid är produkten. OpenAIs hastighetsnivå är ett större anspråk på knappare kisel än Fast mode, så vad den än till slut kostar, säger prejudikatet ett premium snarare än en rabatt. Men "prejudikatet säger ett premium" är inte en siffra, och tills en sådan finns kan nivån inte alls jämföras med UltraSpeed i pris — bara på det faktum att Xiaomi var beredd att säga sin siffra och OpenAI inte.

Var siffrorna kom ifrån

De två nivåerna har motsatta bevisproblem, och det är värt att namnge båda snarare än att kompromissa.

Xiaomis hastighetspåstående är vagt till storleken men förankrat i ett publicerat pris. 20× är ett leverantörstak under förhållanden som Xiaomi inte har specificerat, 10× är vad en katalogpost var villig att hävda som typiskt, och den verkliga multiplikatorn ligger någonstans i ett brett intervall som ingen har mätt offentligt vid en angiven samtidighetsnivå. Mot detta står att priset är exakt, vikterna är nedladdningsbara under MIT, och den tekniska rapporten och träningsmiljön för förstärkningsinlärning är offentliga – du kan granska vad Xiaomi gjorde, du kan bara ännu inte verifiera hur snabbt det körs.

OpenAI:s hastighetspåstående är specifikt till sin storlek men förankrat i ingenting som går att köpa. Upp till 750 utdatatokens per sekund, upp till 14× standard, sagt rakt ut. Det är också en genomströmningssiffra för utdatatokens, inte en enhetlig multiplikator för hela kedjan: inmatningsbearbetning och modellens eget resonerande komprimeras inte i den kvoten, vilket är varför företaget kallar det ett maximum. De underbyggande benchmarkarna är leverantörsrapporterade och i ett fall mellan leverantörer – en Humanity's Last Exam-körning med 2 500 frågor rapporterades slutföras på 11 timmar 11 minuter mot 78 timmar 27 minuter för Claude Fable 5, med jämförbar noggrannhet. Oberoende bevakning av lanseringen citerade en snävare jämförelse på ungefär 11× av genereringshastigheten för samma körning, medan Cerebras egna siffror antyder omkring 7× för den totala testtiden. Tre parter, tre bråkdelar av en och samma arbetsbelastning, ingen tredjepartsreproduktion av någon av dem. Cerebras rapporterar separat 5,6× end-to-end på GDP-Val utan mätbar kvalitetsförlust, också det utan att ha reproducerats.

Båda uppsättningarna siffror är leverantörens egna uppgifter. Skillnaden är att Xiaomis vaghet gäller hastighet medan OpenAIs gäller kostnad, och för den som skriver en budget är kostnaden den svårare att gissa.

A generated two-column scoreboard titled 'GPT-5.6 Sol Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed — the scoreboard'. Left column 'GPT-5.6 Sol Ultrafast': Checkpoint same as Sol, Speed claim up to 14x, Output speed up to 750 tok/s, Price not published, Context 1.05M tokens, Access waitlisted preview. Right column 'MiMo v2.6 Pro Ultraspeed': Checkpoint same as Pro, Speed claim 10x to 20x, Output speed not published, Price $4.35 / $8.70, Context 1M tokens, Access purchasable today. Footer sourcing line noting neither speed claim is independently measured; OrcaRouter logo bottom-right.

Vad som hände den här veckan, och varför det inte sluter gapet

Anledningen till att den här jämförelsen alls har en nyhetskrok är en commit snarare än ett tillkännagivande. Värdet ultrafast har funnits i OpenAIs offentliga openai-openapi-schema sedan den 13 augusti 2026 — samma dag som läget tillkännagavs — med en beskrivning som begränsar det till gpt-5.6-sol och kallar det åtkomstkontrollerat. Commiten som rörde sig den här veckan är senare och mindre: den 25 september 2026 lade fe4f7a1 till ultrafast i ytterligare två uppräkningar, parametern för servicenivå på förfrågningsnivå och agentens policyfält för servicenivå. Före den commiten löd de två listorna auto, default, flex, priority, fast. Efter den finns en post som beskrivs som "Använder servicenivån ultrafast."ultrafast till service_tier-uppräkningarna i dess offentliga openai-openapi-specifikation — fältet som schemat beskriver som "den servicenivå som används för modellförfrågningar", och policyfältet som är kopplat till agenter. Före ändringen löd listan default, flex, priority, fast. Efter den finns en post som beskrivs som "Använder servicenivån ultrafast."

Åtskillnaden spelar roll för alla som läser bevakningen. Detta är inte nivån som skapas; det är nivån som kopplas in i det fält som en agent konfigureras med, vilket innebär att en klient så småningom kan skrivas mot den utan någon ny endpoint. Rapporteringen dagen därpå beskriver en Fast / Standard / Ultrafast-väljare som kommer till Responses API Playground, med bredare åtkomst väntad efter OpenAIs DevDay-konferens. Vi har inte sett väljaren och OpenAI har inte publicerat någon utrullningsnotis, så den delen kommer från en enda källa. Det som går att kontrollera är de tillagda schemaposterna och den fortsatta avsaknaden av en prislista sex veckor efter tillkännagivandet.

Under tiden har Xiaomis nivå varit köpbar i fem dagar och är fortfarande den enda av de två som du kan lägga på en faktura. Dess egen öppna fråga är annorlunda: om en 10× premie håller, eller om den beter sig som de flesta lanseringspriser på en ny premiumnivå och glider mot standardnivån när lanseringsbevakningen upphör. Standard Pro på $0.44 / $0.87 är ankaret, och en nivå som öppnar på tio gånger sitt ankare slutar sällan där.

Att välja mellan dem, med tanke på att du förmodligen inte kan

Det obekväma praktiska faktum är att detta för de flesta läsare är en jämförelse mellan en nivå du inte kan köpa och en du antagligen inte bör köpa till listpris. GPT-5.6 Sol Ultrafast är en förhandsvisning med väntelista för utvalda kunder, som utökas i takt med att kapaciteten växer, utan datum för allmän tillgänglighet och utan pris; MiMo v2.6 Pro Ultraspeed är tillgänglig, dyr och byggd för en specifik typ av köpare.

Arbetsbelastningstestet är detsamma för båda, och det handlar om formen på din förfrågningsgraf snarare än storleken på din prompt. En enda lång generering vinner långt mindre än rubrikmultiplikatorn, eftersom indatabearbetning och resonemang inte snabbas upp i samma förhållande. En fyrtiostegs agentloop bakom en enda användarsynlig åtgärd vinner något mycket närmare det fulla talet, eftersom varje rundtur är latens som en person sitter igenom. Om din trafik ser ut som den andra formen är båda nivåerna riktade till dig; om den ser ut som den första var standardbanan på endera modellen alltid det korrekta valet och standardbanan för MiMo-V2.6-Pro till $0.44 / $0.87 är ett av de billigaste sätten att anropa en modell i biljonparametarklassen någonstans.

Det som ingen av nivåerna ändrar är att du köper latens, inte kvalitet. Om du benchmarkar UltraSpeed eller Ultrafast mot dess egen standardbana på identiska prompter och får olika svar, är det ett fynd värt att rapportera, inte en funktion — inget i någon av leverantörernas beskrivningar hävdar att vikterna har ändrats.

Detta är också fallet där en router förtjänar sin plats, och specifikt för den nivå du inte kan få. GPT-5.6 Sol finns live på OrcaRouter som openai/gpt-5.6-sol till leverantörens egen taxa med noll påslag på tokens över den OpenAI-kompatibla endpointen på api.orcarouter.ai/v1, så standardbanan du annars skulle falla tillbaka till är ett byte av bas-URL bort, och samma nyckel bär 200+ modeller. Det spelar roll eftersom det ärliga svaret på "bör jag använda Ultrafast" idag är "det kan du inte, så bestäm vad som bär den interaktiva trafiken under tiden" — och sättet att köpa latens utan väntelista är att dirigera de interaktiva anropen till den modell i katalogen som klarar din kvalitetsnivå med den lägsta väggklockstiden, och lämna nattarbetet på den billigaste bana som klarar kraven. När nivån öppnar är det den växeln du slår om. Notera tydligt vad vi inte hostar: ingen Xiaomi-modell finns på OrcaRouter, så MiMo v2.6 Pro Ultraspeed kommer från Xiaomis eget API och flera tredjepartsplattformar, och den här sidan är inte en väg till den.

A screenshot of the Artificial Analysis model page for MiMo-V2.6-Pro, labelled 'Openweights model, Released September 2026', showing the Intelligence, Performance & Price Analysis headings with an Intelligence Index figure, a Speed figure, a Cost figure of In $0.435 / Out $0.87 with a 99% cache discount, a $0.13 blended figure, a Verbosity rank of 20/115, and a Comparison Summary describing the model as among the leading open-weight models in intelligence and notably fast but somewhat verbose, with text, image, speech and video input and a 1M-token context window.

Vad skulle avgöra det?

Tre mätningar, varav ingen ännu finns. Ett publicerat Ultrafast-prisblad skulle göra detta till den jämförelse den förtjänar att vara, snarare än en jämförelse med ett hål i. En oberoende latensfördelning vid en angiven samtidighetsnivå skulle visa om Xiaomis verkliga multiplikator ligger närmare 10× eller 20×, och om den håller under belastning snarare än i en enkelströmsdemonstration. Och en oberoende reproduktion av endera leverantörens benchmark-svit skulle flytta båda uppsättningarna av siffror ur anspråkskolumnen.

Fram till dess är den försvarbara tolkningen snäv. Xiaomi lanserade en hastighetsnivå med ett pris och otydlig hastighet; OpenAI lanserade en hastighetsnivå med specifik hastighet och inget pris; båda är samma modell som den de prissätts mot, och ingen av dem har mätts oberoende. Om du behöver latensen nu och arbetsbelastningen är interaktiv är UltraSpeed verkligt, köpbart och prissatt för exakt den köpare det vill nå. Om du behöver den nu och arbetsbelastningen inte är det, är standardvägarna för båda modellerna billigare, beprövade och tillgängliga idag — och nivån som alla bråkar om kommer fortfarande att vara kvar när någon publicerar en siffra.