Ett genererat hero-kort med rubriken ”Två snabba spår, sexton dagar ifrån varandra” och underrubriken ”GPT-6.1 Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed”, en vänsterpanel med texten ”6x standard”, ”Stängt API” och ”Hastighetsmultipel lånad från GPT-6 Astra”, samt en högerpanel med texten ”Ungefär 10x standard”, ”MIT-vikter” och ”1,02T totalt / 42B aktiva”, över en sidfot med texten ”Leverantörs- och katalogsiffror, september–oktober 2026; inga oberoende mätningar av någon av nivåerna.”
Engineering & Research

GPT-6.1 Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed: Två snabba banor, en säger vad det kostade

Författare

Rowan Sterling

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller →
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

De två snabbaste sätten att köpa en frontier-modell lanserades med sexton dagars mellanrum, och bara ett av dem berättade hur snabbheten åstadkoms. GPT-6.1 Ultrafast — serveringsnivån ovanpå GPT-6.1 Sol, som OpenAI släppte den 29 september 2026 och som fick den här nivån den 8 oktober 2026 — är ett slutet flaggskepp som man når via ett API, prissatt till sex gånger Standard utan någon offentlig redogörelse för vad som händer mellan vikterna och din förfrågan. Xiaomi MiMo v2.6 Pro Ultraspeed, släppt den 22 september 2026, är en snabbhetsnivå ovanpå MiMo-V2.6-Pro, en MIT-licensierad checkpoint vars förstärkningsinlärningsmiljö Xiaomi också publicerade. Båda säljer latens till ett multipelpris. Bara Xiaomis multipel vilar på något som en kund kan granska, och den skillnaden är värd mer för beslutet än något av snabbhetspåståendena.

Priset för de två banorna är den enkla delen, och det tas upp nedan. Det svåra är att en hastighetsnivå är ett löfte om servering, och de två leverantörerna har gett det löftet med mycket olika grad av öppenhet – den ena lånade sin toppsiffra från en syskonmodell, den andra skickade med träningsreceptet tillsammans med prislistan. Om du står i begrepp att lägga en produktionsarbetsbelastning på en snabb bana är öppenhetsgapet den risk du faktiskt tar på dig.

Priserna, med båda sidorna på samma rad

Båda nivåerna säljs som en multipel av en standardbana, och multiplerna ligger så nära varandra att priset inte är det som skiljer dem åt.

• Standardspår — GPT-6.1 Sol till $2.00 för indata / $10.00 för utdata per miljon token, mot MiMo-V2.6-Pro till $0.44 / $0.87.

• Snabb bana — GPT-6.1 Ultrafast för $12.00 / $60.00, mot MiMo-V2.6-Pro-UltraSpeed för $4.35 / $8.70.

• Multipeln — exakt 6x på varje rad för OpenAI-nivån, ungefär 9,9x på indata och exakt 10x på utdata för Xiaomis.

• Cachad indata — GPT-6.1 Sol kostar $0.10 per miljon på Standard och $0.60 på Ultrafast; MiMo-prislistan vi kan läsa publicerar ingen separat rad för cachad indata för någon av banorna.

• Lång kontext — GPT-6.1 Sol omprissätter hela begäran med 2x priserna för input och cache samt 1,5x för output över 272 000 input-tokens, vilket ger Ultrafast $24.00 / $1.20 / $30.00 / $90.00. MiMo-V2.6-Pro har ett kontextfönster på 1M tokens utan motsvarande publicerad priskliffa.

• Absolut spridning — de två snabbspåren ligger 2,8 gånger isär i indata och 6,9 gånger isär i utdata, vilket är klyftan mellan en sluten modell i framkanten och en med öppna vikter som visar sig inom snabbnivån i stället för vid standardpriset.

En rads sammanfattning av det blocket: Xiaomi tar ut en större multipel för en mycket billigare modell, och OpenAI tar ut en mindre multipel för en mycket dyrare sådan. För utdatatokens betalar du $60.00 per miljon för OpenAI-spåret och $8.70 för Xiaomis. Ingen av leverantörerna erbjuder rabatt för hastighet; båda prissätter den som en separat produkt, vilket är det första tecknet på att standardspåret i båda fallen fortfarande är förvalt och snabbspåret är ett undantag man motiverar per arbetsbelastning.

Vad varje leverantör kommer att berätta för dig om hastigheten

Det är här de två utrullningarna slutar vara symmetriska, och det är det mest användbara på sidan.

O​penAI:s publicerade siffra för Ultrafast är att GPT-6 Astra Ultrafast genererar tokens upp till 8x snabbare än GPT-6 Astra i Standard-läge i Codex. Det är en mätning av en annan modell, i en annan klient, uttryckt som ett tak. Dokumentationen som täcker Ultrafast för GPT-6.1 Sol säger att nivån minskar tiden mellan genererade utdatatokens och hänvisar till en prislista; den sätter inte någon siffra på Sol-nivån alls. Så rubriksiffran som är kopplad till den här utrullningen är lånad från systermodellen som har varit på Ultrafast sedan den 29 september, och ingen oberoende part har publicerat en mätning av tokens per sekund för någon av dem. Den kan mycket väl hålla — samma serveringsstack, samma mekanism — men det är ett tak från leverantören som O​penAI själva inte har mätt för den här modellen.

Xiaomis upplysning är av ett annat slag, och skillnaden består inte i att den är mer precis. Xiaomis eget material hävdar att UltraSpeed når upp till 20 gånger utdatahastigheten för standardtjänsten Pro med samma kvalitet. Katalogposter från tredje part som beskriver samma modell samma dag anger ungefär 10 gånger. Båda siffrorna cirkulerar, de är inte samma siffra, och ingen har publicerat en mätning som förenar dem. Läser man det ärligt: "upp till 20x" är ett leverantörstak under förhållanden som Xiaomi inte har specificerat, "ungefär 10x" är vad en katalog var beredd att hävda som typiskt, och den verkliga multiplikatorn ligger någonstans i ett brett spann tills någon publicerar latensfördelningar per begäran vid en angiven samtidighetsnivå.

Så X​iaomi ger dig två oförenliga siffror, och O​penAI ger dig ett nummer som tillhör en annan modell. Ingen av dem är ett faktum du kan budgetera mot, och den praktiska konsekvensen är densamma för båda: mät nivån på dina egna prompter innan du binder en produktionsväg till den.

Asymmetrin som faktiskt spelar roll: vad de extra siffrorna köper

Bortsett från hastighetspåståenden är de två spåren kopplade till väldigt olika typer av produkter, och det är här valet upphör att vara en prisjämförelse.

MiMo-V2.6-Pro är en gles mixture-of-experts-design som Xiaomi har beskrivit offentligt: 1,02 biljoner parametrar totalt med 42 miljarder aktiverade per token, ett kontextfönster på 1 miljon tokens, inbyggd multimodalitet över text, bild, video och ljud, samt en MIT-licensmärkning på de släppta checkpointarna. Utgivningspaketet innehåller en teknisk rapport och driftsättningsanteckningar, och Xiaomi säger att man gör träningsmiljön för förstärkningsinlärning och dess kod till öppen källkod så att efterträningen kan granskas och reproduceras. RL-körningen är också dokumenterad – 30 steg och ungefär 750 000 trajektorier per modell, på under sex dagar, till en sammanlagd offentliggjord kostnad på omkring 3 474 715 dollar för Pro- och Flash-körningarna. På DeepSWE v1.1, Xiaomis eget testramverk med mini-swe-agent vid avg@3, rapporterar företaget att MiMo-V2.6-Flash går från 48,8 till 65,68 och MiMo-V2.6-Pro från 58,4 till 72,57 under den körningen. Dessa är leverantörsrapporterade och inte reproducerade; distinktionen mellan "Xiaomis testramverk säger 72,57" och "72,57 är poängen" är skillnaden mellan ett påstående och ett faktum.

GPT-6.1 Sol publicerar inget av det. Det finns inget parameterantal, ingen arkitekturanteckning, ingen uppgift om träningskostnader, ingen checkpoint och ingen licens att läsa – det finns ett modellkort, ett kontextfönster, en kunskapsgräns den 30 april 2026 och ett API. Det är det normala upplägget för ett labb i framkant, och det är inte en kritik. Men det har en konsekvens för ett köpbeslut som lanseringsbevakningen tenderar att hoppa över: i spåret med öppna vikter är en besvikande snabb nivå återställbar. Om UltraSpeed inte visar sig vara värt 10x din trafik går samma checkpoint att ladda ner och du kan hosta den själv eller via en annan leverantör, vilket begränsar din nedsida till kostnaden för migreringen. I det slutna spåret är en besvikande snabb nivå en räkning och en budget för anropsgränser som du justerar ned igen; du kan inte kringgå det genom att köra vikterna, eftersom det inte finns några vikter att köra.

En brasklapp om den där MIT-taggen, för den förenklas bort i rapporteringen om lanseringen. Licensen gäller de checkpoints som Xiaomi publicerade. UltraSpeed är en hostad tjänst, och hostade tjänster styrs av användarvillkor snarare än av en viktslicens. Att ha rätt att köra checkpointen på sin egen hårdvara och att ha rätt att sälja vidare någon annans accelererade serving av den är två olika rättigheter, och bara den första kommer från licensfilen.

A screenshot of the XiaomiMiMo MiMo-V2.6-Pro-RL model card on Hugging Face, showing the released reinforcement-learning checkpoints, the parameter and context figures, the licence tag and the model-card sections describing the MiMo-V2.6 family.A generated disclosure card headed 'What each vendor published', with an 'OpenAI — GPT-6.1 Ultrafast' column reading 'No speed multiple for this model', 'Headline 8x figure is GPT-6 Astra's', 'No checkpoint, no parameter count' and 'No licence to read', and a 'Xiaomi — MiMo-V2.6-Pro-UltraSpeed' column reading '1.02T total / 42B active', '1M-token context', 'MIT-licensed checkpoints', 'RL environment and spend published' and 'Speed: up to 20x or roughly 10x', footnoted that all figures are vendor-reported and unreproduced.

Två namngivningsfällor innan du kopierar någon av identifierarna

Inget av namnen i titeln på den här sidan är en kontrollpunkt, och båda leverantörernas dokumentation gör det lätt att upprepa misstaget.

• GPT-6.1 Ultrafast — inte en modell. Identifieraren i begäran förblir densamma som standardmodellens; nivån anges av ett begäransfält, och resultatet är samma checkpoint schemalagd på ett annat sätt.

• MiMo v2.6 Pro Ultraspeed – inte heller en separat uppsättning vikter. Det är MiMo-V2.6-Pro-checkpointen som serveras på en snabbare väg och prissätts som en egen rad.

• Vad det innebär för benchmarking — om du jämför de två banorna för endera modellen på identiska prompter är det förväntade resultatet samma svar i olika takt. Avvikande innehåll på samma indata är en defekt att rapportera, inte en förmåga du har köpt.

• Vad det innebär för licenskontrollen — för X​iaomi, läs modellkortet. För O​penAI finns det inget att läsa, eftersom vikterna inte distribueras.

Det finns också en mjukare aspekt som visar sig i hur varje nivå säljs. GPT-6.1 Sol stöder datahemvist i USA och EU samt global bearbetning, inklusive under Ultrafast, så en arbetsbelastning som är knuten till europeisk bearbetning har ett dokumenterat svar. MiMo-prislistan som vi kan läsa anger inte alls någon datahemvist — Xiaomi säljer en modell och en serveringsväg, inte en regelefterlevnadsprofil. För en reglerad köpare kan den enda raden avgöra jämförelsen innan priset ens beaktas.

Där varje bana faktiskt är anropbar

Båda snabbspåren är nåbara via respektive leverantörs eget API, och båda förekommer på tredjepartsplattformar. Ingen av dem finns på OrcaRouter, och det är värt att säga det rakt ut i stället för att låta en jämförelsesida antyda något annat.

Det som finns på OrcaRouter är standardkanalen för OpenAI-modellen: openai/gpt-6.1-sol till OpenAIs egna listpriser på 2,00 dollar per miljon indatatokens och 10,00 dollar per miljon utdatatokens, med 0 % påslag och leverantörens pris som skickas rakt igenom, så att en leverantörs prisändring landar hos oss samma dag. Ultrafast är en service-tier-flagga som faktureras på ditt eget OpenAI-konto, och ingen Xiaomi-modell hostas här överhuvudtaget. Vad en enda nyckel däremot ger dig är standardkanalen sida vid sida med över 200 andra modeller bakom en OpenAI-kompatibel endpoint, med automatisk failover mellan leverantörer — vilket är det användbara förhållningssättet när arbetsbelastningen du skyddar är den som skulle märka ett tak för hastighetsbegränsning klockan tre på natten.

A screenshot of the OrcaRouter model page for GPT-6.1 Sol, model id openai/gpt-6.1-sol, showing a 1,050,000-token context window, 128,000 maximum output tokens, text and image input with text output, input price $2.00 and output price $10.00 per 1M tokens, with the EN language toggle visible in the page header.

Vilken fil som ska testas, i ordning

Om din arbetsbelastning är interaktiv och genereringstiden hänger på en persons klocka är båda nivåerna värda att testa, och den avgörande faktorn kommer inte att vara priset – det blir utgångsdatumet på ditt förtroende. Spåret med öppna vikter låter dig verifiera och sedan lämna; det slutna spåret ber dig verifiera med den enda leverantör som kan serva den och stanna kvar. Den asymmetrin är verklig, men den är inte heller gratis: MiMo-V2.6-Pro-UltraSpeed är en hostad tjänst, så utträdet är en migrering snarare än en konfigurationsändring, och den checkpoint du skulle migrera till kanske inte matchar nivåns serveringsoptimeringar.

Om din arbetsbelastning är batch- eller schemalagd är båda fel köp, både vid 6x och vid 10x, och det ärliga draget är att köra den på standardbanan och lägga mellanskillnaden på utvärdering i stället.

Vad som skulle förändra den här sidan: en oberoende mätning av endera nivåns utdatahastighet vid en angiven samtidighetsnivå, ett publicerat uttalande om dataresidens från Xiaomi, eller ett hastighetsbegränsningstal från OpenAI för Sol-nivån som en köpare kan planera utifrån i stället för att begära. Så länge dessa inte finns är jämförelsen en prislista mot en prislista, där en av de två leverantörerna har publicerat betydligt mer om objektet som prissätts.

Jämförda i den här artikeln1

Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen