Wygenerowana karta hero z nagłówkiem „Dwie szybkie ścieżki, szesnaście dni od siebie” i podtytułem „GPT-6.1 Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed”, lewy panel z napisami „6x standard”, „Zamknięte API” i „Mnożnik szybkości zapożyczony od GPT-6 Astra”, oraz prawy panel z napisami „Około 10x standard”, „Wagi MIT” i „1,02T łącznie / 42B aktywnych”, nad stopką o treści „Dane dostawców i katalogów, wrzesień-październik 2026; brak niezależnych pomiarów dla żadnego z poziomów.”
Engineering & Research

GPT-6.1 Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed: Dwie szybkie ścieżki, jedna mówi, ile to kosztowało

Autor

Rowan Sterling

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Dwa najszybsze sposoby zakupu modelu frontierowego trafiły do sprzedaży w odstępie szesnastu dni i tylko jeden z nich powiedział, jak uzyskano tę szybkość. GPT-6.1 Ultrafast — warstwa usługowa ponad GPT-6.1 Sol, który OpenAI udostępniło 29 września 2026 r. i który 8 października 2026 r. zyskał tę warstwę — to zamknięty model flagowy dostępny przez API, w cenie sześciokrotnie wyższej niż Standard, bez publikowanego wyjaśnienia tego, co dzieje się między wagami a Twoim żądaniem. Xiaomi MiMo v2.6 Pro Ultraspeed, wydany 22 września 2026 r., to warstwa szybkościowa ponad MiMo-V2.6-Pro, checkpointem na licencji MIT, którego środowisko uczenia ze wzmocnieniem Xiaomi również opublikowało. Oba sprzedają opóźnienie za wielokrotność ceny. Tylko wielokrotność Xiaomi opiera się na czymś, co klient może sprawdzić, a ta różnica ma większe znaczenie dla decyzji niż którakolwiek z deklaracji szybkości.

Cena obu ścieżek to łatwa część i omówiono ją poniżej. Trudna część polega na tym, że poziom szybkości to obietnica dotycząca serwowania, a obaj dostawcy złożyli tę obietnicę na bardzo różnych poziomach ujawnienia — jeden zapożyczył swoją główną liczbę z modelu siostrzanego, drugi udostępnił przepis treningowy razem z cennikiem. Jeśli zamierzasz powierzyć obciążenie produkcyjne szybkiej ścieżce, luka w ujawnieniu informacji jest ryzykiem, które w rzeczywistości na siebie bierzesz.

Ceny, z obiema stronami w tym samym wierszu

Oba poziomy są sprzedawane jako wielokrotność standardowej linii, a te wielokrotności są na tyle zbliżone, że to nie cena je odróżnia.

• Ścieżka standardowa — GPT-6.1 Sol w cenie 2,00 USD za milion tokenów wejściowych / 10,00 USD za milion tokenów wyjściowych, wobec MiMo-V2.6-Pro po 0,44 USD / 0,87 USD.

• Szybka ścieżka — GPT-6.1 Ultrafast za 12,00 USD / 60,00 USD, w porównaniu z MiMo-V2.6-Pro-UltraSpeed za 4,35 USD / 8,70 USD.

• Krotność — dokładnie 6x w każdym wierszu w przypadku planu O​penAI, około 9,9x na wejściu i dokładnie 10x na wyjściu w przypadku X​iaomi.

• Wejście z pamięci podręcznej — GPT-6.1 Sol kosztuje 0,10 USD za milion w Standard i 0,60 USD w Ultrafast; cennik MiMo, który możemy odczytać, nie publikuje osobnej pozycji dotyczącej wejścia z pamięci podręcznej dla żadnego z tych trybów.

• Długi kontekst — GPT-6.1 Sol zmienia cenę całego żądania na 2x stawki za dane wejściowe i pamięć podręczną oraz 1,5x za dane wyjściowe powyżej 272 000 tokenów wejściowych, co daje Ultrafast $24.00 / $1.20 / $30.00 / $90.00. MiMo-V2.6-Pro ma okno kontekstowe 1 mln tokenów bez opublikowanego odpowiednika takiego progu.

• Spread bezwzględny — dwie szybkie ścieżki dzieli 2,8× na wejściu i 6,9× na wyjściu, co jest luką między zamkniętym modelem frontier a modelem z otwartymi wagami, ujawniającą się w obrębie poziomu szybkości, a nie przy standardowej stawce.

Podsumowanie tego bloku w jednym zdaniu: X​iaomi nalicza większy mnożnik za znacznie tańszy model, a O​penAI nalicza mniejszy mnożnik za znacznie droższy. W przypadku tokenów wyjściowych płacisz 60,00 USD za milion w ścieżce O​penAI i 8,70 USD w ścieżce X​iaomi. Żaden z dostawców nie oferuje zniżki za szybkość; obaj wyceniają ją jako osobny produkt, co jest pierwszą oznaką, że w obu przypadkach standardowa ścieżka jest nadal domyślna, a szybka ścieżka to wyjątek, który uzasadnia się osobno dla każdego obciążenia.

Co każdy dostawca powie Ci o szybkości

To tutaj dwa rollouty przestają być symetryczne, i to jest najbardziej użyteczna rzecz na tej stronie.

Opublikowana przez O​penAI liczba dla Ultrafast mówi, że GPT-6 Astra Ultrafast generuje tokeny nawet 8 razy szybciej niż GPT-6 Astra w trybie Standard w Codex. To pomiar innego modelu, w innym kliencie, ujęty jako górna granica. Dokumentacja obejmująca Ultrafast dla GPT-6.1 Sol mówi, że ten poziom skraca czas między generowanymi tokenami wyjściowymi i wskazuje na kartę stawek; nie podaje jednak żadnej liczby dla poziomu Sol. Zatem liczba z nagłówka przypisana do tego wdrożenia została zapożyczona od modelu bliźniaczego, który korzysta z Ultrafast od 29 września, a żadna niezależna strona nie opublikowała pomiaru liczby tokenów na sekundę dla żadnego z nich. Może się to jak najbardziej utrzymać — ten sam stos obsługi, ten sam mechanizm — ale jest to granica podana przez dostawcę, której sam O​penAI nie zmierzył dla tego modelu.

Ujawnienie X​iaomi ma inny charakter, a różnica nie polega na tym, że jest bardziej precyzyjne. W swoich własnych materiałach firma twierdzi, że UltraSpeed osiąga do 20 razy większą szybkość generowania niż standardowa usługa Pro przy tej samej jakości. Pozycje w katalogach podmiotów trzecich opisujące ten sam model tego samego dnia podają około 10-krotności. Obie liczby są w obiegu, nie są tą samą liczbą i nikt nie opublikował pomiaru, który by je uzgodnił. Czytając to uczciwie: „do 20x” to górna granica deklarowana przez dostawcę w warunkach, których X​iaomi nie określiło, „około 10x” to wartość, którą katalog był gotów podać jako typową, a rzeczywisty mnożnik mieści się gdzieś w szerokim przedziale, dopóki ktoś nie opublikuje rozkładów opóźnień dla poszczególnych żądań przy podanym poziomie współbieżności.

Więc Xiaomi daje ci dwie nieuzgodnione liczby, a OpenAI daje ci jedną liczbę, która należy do innego modelu. Żadna z nich nie jest faktem, na podstawie którego możesz zaplanować budżet, a praktyczna konsekwencja jest w obu przypadkach taka sama: zmierz ten poziom na własnych promptach, zanim wybierzesz dla niego ścieżkę produkcyjną.

Asymetria, która naprawdę ma znaczenie: co dają dodatkowe cyfry

Pomijając zapewnienia o szybkości, obie ścieżki są powiązane z zupełnie różnymi rodzajami produktów i właśnie w tym miejscu wybór przestaje być porównywaniem cen.

MiMo-V2.6-Pro to rzadka architektura mieszaniny ekspertów, którą X​iaomi opisało publicznie: 1,02 biliona parametrów łącznie, z 42 miliardami aktywowanymi na token, okno kontekstu 1 mln tokenów, natywna multimodalność obejmująca tekst, obraz, wideo i dźwięk oraz tag licencji MIT na udostępnionych checkpointach. Pakiet wydania zawiera raport techniczny i notatki wdrożeniowe, a X​iaomi twierdzi, że udostępnia jako open source środowisko treningowe uczenia ze wzmocnieniem i jego kod, aby można było zbadać i odtworzyć etap post-trainingu. Przebieg RL również udokumentowano — 30 kroków i około 750 000 trajektorii na model, w mniej niż sześć dni, przy łącznym opublikowanym koszcie około 3 474 715 dolarów w przypadku przebiegów Pro i Flash. W DeepSWE v1.1, własnym harnessie X​iaomi z mini-swe-agent przy avg@3, firma raportuje, że MiMo-V2.6-Flash poprawił się z 48,8 do 65,68, a MiMo-V2.6-Pro z 58,4 do 72,57 w tym przebiegu. Są to wartości raportowane przez dostawcę i nieodtworzone; różnica między „harness X​iaomi mówi 72,57” a „72,57 to wynik” to różnica między twierdzeniem a faktem.

GPT-6.1 Sol nie publikuje nic z tego. Nie ma liczby parametrów, noty o architekturze, danych o wydatkach na trening, checkpointu ani licencji do przeczytania — jest karta modelu, okno kontekstu, data odcięcia wiedzy 30 kwietnia 2026 r. i API. To normalny układ dla laboratorium frontier i nie jest to zarzut. Ma jednak konsekwencję dla decyzji zakupowej, którą relacje z premiery zwykle pomijają: w przypadku ścieżki open-weight rozczarowujący szybki poziom da się odratować. Jeśli UltraSpeed okaże się niewart 10x Twojego ruchu, ten sam checkpoint można pobrać i obsługiwać go samodzielnie lub przez innego dostawcę, co ogranicza Twoje ryzyko do kosztu migracji. W przypadku ścieżki zamkniętej rozczarowujący szybki poziom to rachunek i budżet limitów szybkości, który dostosowujesz z powrotem w dół; nie możesz tego obejść, uruchamiając wagi, bo nie ma wag do uruchomienia.

Jedno zastrzeżenie dotyczące tego tagu MIT, bo bywa on spłaszczany w relacjach z premiery. Licencja dotyczy checkpointów, które opublikowało Xiaomi. UltraSpeed to usługa hostowana, a usługi hostowane podlegają warunkom świadczenia usług, a nie licencji na wagi. Prawo do uruchamiania checkpointu na własnym sprzęcie i prawo do odsprzedaży czyjegoś przyspieszonego serwowania go to dwa różne prawa, a tylko to pierwsze wynika z pliku licencji.

A screenshot of the XiaomiMiMo MiMo-V2.6-Pro-RL model card on Hugging Face, showing the released reinforcement-learning checkpoints, the parameter and context figures, the licence tag and the model-card sections describing the MiMo-V2.6 family.A generated disclosure card headed 'What each vendor published', with an 'OpenAI — GPT-6.1 Ultrafast' column reading 'No speed multiple for this model', 'Headline 8x figure is GPT-6 Astra's', 'No checkpoint, no parameter count' and 'No licence to read', and a 'Xiaomi — MiMo-V2.6-Pro-UltraSpeed' column reading '1.02T total / 42B active', '1M-token context', 'MIT-licensed checkpoints', 'RL environment and spend published' and 'Speed: up to 20x or roughly 10x', footnoted that all figures are vendor-reported and unreproduced.

Dwie pułapki nazewnicze, zanim skopiujesz którykolwiek z identyfikatorów

Żadna z nazw w tytule tej strony nie jest checkpointem, a dokumentacja obu dostawców sprawia, że łatwo powtórzyć ten błąd.

• GPT-6.1 Ultrafast — to nie model. Identyfikator w żądaniu pozostaje taki sam jak w modelu standardowym; poziom jest ustawiany przez pole żądania, a wynik to ten sam checkpoint uruchamiany według innego harmonogramu.

• MiMo v2.6 Pro Ultraspeed — również nie jest odrębnym zestawem wag. To checkpoint MiMo-V2.6-Pro udostępniany na szybszej ścieżce i wyceniany jako osobna pozycja.

• Co to oznacza dla benchmarkingu — jeśli porównasz dwie ścieżki któregokolwiek z modeli na identycznych promptach, oczekiwanym wynikiem są te same odpowiedzi w różnym tempie. Rozbieżna treść przy tym samym wejściu to defekt, który należy zgłosić, a nie możliwość, którą kupiłeś.

• Co to oznacza dla sprawdzania licencji — w przypadku X​iaomi przeczytaj kartę modelu. W przypadku O​penAI nie ma nic do czytania, ponieważ wagi nie są rozpowszechniane.

Widać też łagodniejszą asymetrię w sposobie sprzedaży poszczególnych poziomów. GPT-6.1 Sol obsługuje rezydencję danych w USA i UE oraz przetwarzanie globalne, również w ramach Ultrafast, więc obciążenie przypięte do przetwarzania europejskiego ma udokumentowaną odpowiedź. W czytelnej dla nas karcie stawek MiMo rezydencja nie jest w ogóle określona — X​iaomi sprzedaje model i ścieżkę serwowania, a nie postawę zgodnościową. Dla regulowanego nabywcy ta jedna linijka może rozstrzygnąć porównanie, zanim w ogóle weźmie się pod uwagę cenę.

Gdzie każdy tor jest faktycznie wywoływalny

Obie szybkie ścieżki są dostępne przez własne API ich dostawców i obie pojawiają się na platformach zewnętrznych. Żadnej z nich nie ma w OrcaRouter i warto powiedzieć to wprost, zamiast pozwalać, by strona porównawcza sugerowała coś innego.

To, co jest dostępne w OrcaRouter, to standardowa ścieżka modelu OpenAI: openai/gpt-6.1-sol w cenniku własnym OpenAI na poziomie 2,00 USD za milion tokenów wejściowych i 10,00 USD za milion tokenów wyjściowych, z 0% marży i ceną dostawcy przekazywaną bezpośrednio dalej, więc zmiana cennika przez dostawcę trafia po naszej stronie tego samego dnia. Ultrafast to flaga poziomu usługi rozliczana na Twoim własnym koncie OpenAI, a żaden model Xiaomi nie jest tu w ogóle hostowany. To, co daje jeden klucz, to standardowa ścieżka obok ponad 200 innych modeli za jednym endpointem zgodnym z OpenAI, z automatycznym przełączaniem awaryjnym między dostawcami — co jest przydatną postawą, gdy obciążenie, które chronisz, jest tym, które zauważyłoby pułap limitu szybkości o trzeciej nad ranem.

A screenshot of the OrcaRouter model page for GPT-6.1 Sol, model id openai/gpt-6.1-sol, showing a 1,050,000-token context window, 128,000 maximum output tokens, text and image input with text output, input price $2.00 and output price $10.00 per 1M tokens, with the EN language toggle visible in the page header.

Który pas przetestować, w kolejności

Jeśli Twoje obciążenie jest interaktywne, a czas generowania odmierza się na czyimś zegarze, oba poziomy są warte wypróbowania, a decydującym czynnikiem nie będzie cena — będzie nim data ważności Twojego zaufania. Ścieżka otwartych wag pozwala zweryfikować, a potem odejść; ścieżka zamknięta wymaga, byś zweryfikował ją u jedynego dostawcy, który może ją obsłużyć, i został. Ta asymetria jest prawdziwa, ale też nie jest darmowa: MiMo-V2.6-Pro-UltraSpeed to usługa hostowana, więc wyjście jest migracją, a nie zmianą konfiguracji, a checkpoint, do którego byś migrował, może nie odpowiadać optymalizacjom serwowania tego poziomu.

Jeśli Twoje obciążenie jest wsadowe lub zaplanowane, oba zakupy są błędne — przy 6x i przy 10x — a uczciwym posunięciem jest uruchomienie go na standardowej ścieżce i przeznaczenie różnicy na ewaluację.

Co zmieniłoby tę stronę: niezależny pomiar szybkości wyjściowej któregokolwiek z poziomów przy podanym poziomie współbieżności, opublikowane oświadczenie o rezydencji danych od X​iaomi albo wartość limitu szybkości od O​penAI dla poziomu Sol, według której kupujący mógłby planować, zamiast o nią prosić. Dopóki ich nie ma, porównanie to cennik przeciw cennikowi, przy czym jeden z dwóch dostawców opublikował znacznie więcej o przedmiocie wyceny.

Porównane w tym artykule1

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie