
GPT-6.1 Ultrafast vs Xiaomi MiMo v2.6 Pro Ultraspeed: Dwie szybkie ścieżki, jedna mówi, ile to kosztowało
- openaiNOWOŚĆOpenAI: GPT-6.1 Sol2026-09-2952Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Sonnet 5.52026-09-2856Inteligencja
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Inteligencja
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- xAIGrok 4.72026-09-2146Inteligencja
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 za 1 mln tokenów · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 za 1 mln tokenów · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
Dwa najszybsze sposoby zakupu modelu frontierowego trafiły do sprzedaży w odstępie szesnastu dni i tylko jeden z nich powiedział, jak uzyskano tę szybkość. GPT-6.1 Ultrafast — warstwa usługowa ponad GPT-6.1 Sol, który OpenAI udostępniło 29 września 2026 r. i który 8 października 2026 r. zyskał tę warstwę — to zamknięty model flagowy dostępny przez API, w cenie sześciokrotnie wyższej niż Standard, bez publikowanego wyjaśnienia tego, co dzieje się między wagami a Twoim żądaniem. Xiaomi MiMo v2.6 Pro Ultraspeed, wydany 22 września 2026 r., to warstwa szybkościowa ponad MiMo-V2.6-Pro, checkpointem na licencji MIT, którego środowisko uczenia ze wzmocnieniem Xiaomi również opublikowało. Oba sprzedają opóźnienie za wielokrotność ceny. Tylko wielokrotność Xiaomi opiera się na czymś, co klient może sprawdzić, a ta różnica ma większe znaczenie dla decyzji niż którakolwiek z deklaracji szybkości.
Cena obu ścieżek to łatwa część i omówiono ją poniżej. Trudna część polega na tym, że poziom szybkości to obietnica dotycząca serwowania, a obaj dostawcy złożyli tę obietnicę na bardzo różnych poziomach ujawnienia — jeden zapożyczył swoją główną liczbę z modelu siostrzanego, drugi udostępnił przepis treningowy razem z cennikiem. Jeśli zamierzasz powierzyć obciążenie produkcyjne szybkiej ścieżce, luka w ujawnieniu informacji jest ryzykiem, które w rzeczywistości na siebie bierzesz.
Ceny, z obiema stronami w tym samym wierszu
Oba poziomy są sprzedawane jako wielokrotność standardowej linii, a te wielokrotności są na tyle zbliżone, że to nie cena je odróżnia.
• Ścieżka standardowa — GPT-6.1 Sol w cenie 2,00 USD za milion tokenów wejściowych / 10,00 USD za milion tokenów wyjściowych, wobec MiMo-V2.6-Pro po 0,44 USD / 0,87 USD.
• Szybka ścieżka — GPT-6.1 Ultrafast za 12,00 USD / 60,00 USD, w porównaniu z MiMo-V2.6-Pro-UltraSpeed za 4,35 USD / 8,70 USD.
• Krotność — dokładnie 6x w każdym wierszu w przypadku planu OpenAI, około 9,9x na wejściu i dokładnie 10x na wyjściu w przypadku Xiaomi.
• Wejście z pamięci podręcznej — GPT-6.1 Sol kosztuje 0,10 USD za milion w Standard i 0,60 USD w Ultrafast; cennik MiMo, który możemy odczytać, nie publikuje osobnej pozycji dotyczącej wejścia z pamięci podręcznej dla żadnego z tych trybów.
• Długi kontekst — GPT-6.1 Sol zmienia cenę całego żądania na 2x stawki za dane wejściowe i pamięć podręczną oraz 1,5x za dane wyjściowe powyżej 272 000 tokenów wejściowych, co daje Ultrafast $24.00 / $1.20 / $30.00 / $90.00. MiMo-V2.6-Pro ma okno kontekstowe 1 mln tokenów bez opublikowanego odpowiednika takiego progu.
• Spread bezwzględny — dwie szybkie ścieżki dzieli 2,8× na wejściu i 6,9× na wyjściu, co jest luką między zamkniętym modelem frontier a modelem z otwartymi wagami, ujawniającą się w obrębie poziomu szybkości, a nie przy standardowej stawce.
Podsumowanie tego bloku w jednym zdaniu: Xiaomi nalicza większy mnożnik za znacznie tańszy model, a OpenAI nalicza mniejszy mnożnik za znacznie droższy. W przypadku tokenów wyjściowych płacisz 60,00 USD za milion w ścieżce OpenAI i 8,70 USD w ścieżce Xiaomi. Żaden z dostawców nie oferuje zniżki za szybkość; obaj wyceniają ją jako osobny produkt, co jest pierwszą oznaką, że w obu przypadkach standardowa ścieżka jest nadal domyślna, a szybka ścieżka to wyjątek, który uzasadnia się osobno dla każdego obciążenia.
Co każdy dostawca powie Ci o szybkości
To tutaj dwa rollouty przestają być symetryczne, i to jest najbardziej użyteczna rzecz na tej stronie.
Opublikowana przez OpenAI liczba dla Ultrafast mówi, że GPT-6 Astra Ultrafast generuje tokeny nawet 8 razy szybciej niż GPT-6 Astra w trybie Standard w Codex. To pomiar innego modelu, w innym kliencie, ujęty jako górna granica. Dokumentacja obejmująca Ultrafast dla GPT-6.1 Sol mówi, że ten poziom skraca czas między generowanymi tokenami wyjściowymi i wskazuje na kartę stawek; nie podaje jednak żadnej liczby dla poziomu Sol. Zatem liczba z nagłówka przypisana do tego wdrożenia została zapożyczona od modelu bliźniaczego, który korzysta z Ultrafast od 29 września, a żadna niezależna strona nie opublikowała pomiaru liczby tokenów na sekundę dla żadnego z nich. Może się to jak najbardziej utrzymać — ten sam stos obsługi, ten sam mechanizm — ale jest to granica podana przez dostawcę, której sam OpenAI nie zmierzył dla tego modelu.
Ujawnienie Xiaomi ma inny charakter, a różnica nie polega na tym, że jest bardziej precyzyjne. W swoich własnych materiałach firma twierdzi, że UltraSpeed osiąga do 20 razy większą szybkość generowania niż standardowa usługa Pro przy tej samej jakości. Pozycje w katalogach podmiotów trzecich opisujące ten sam model tego samego dnia podają około 10-krotności. Obie liczby są w obiegu, nie są tą samą liczbą i nikt nie opublikował pomiaru, który by je uzgodnił. Czytając to uczciwie: „do 20x” to górna granica deklarowana przez dostawcę w warunkach, których Xiaomi nie określiło, „około 10x” to wartość, którą katalog był gotów podać jako typową, a rzeczywisty mnożnik mieści się gdzieś w szerokim przedziale, dopóki ktoś nie opublikuje rozkładów opóźnień dla poszczególnych żądań przy podanym poziomie współbieżności.
Więc Xiaomi daje ci dwie nieuzgodnione liczby, a OpenAI daje ci jedną liczbę, która należy do innego modelu. Żadna z nich nie jest faktem, na podstawie którego możesz zaplanować budżet, a praktyczna konsekwencja jest w obu przypadkach taka sama: zmierz ten poziom na własnych promptach, zanim wybierzesz dla niego ścieżkę produkcyjną.
Asymetria, która naprawdę ma znaczenie: co dają dodatkowe cyfry
Pomijając zapewnienia o szybkości, obie ścieżki są powiązane z zupełnie różnymi rodzajami produktów i właśnie w tym miejscu wybór przestaje być porównywaniem cen.
MiMo-V2.6-Pro to rzadka architektura mieszaniny ekspertów, którą Xiaomi opisało publicznie: 1,02 biliona parametrów łącznie, z 42 miliardami aktywowanymi na token, okno kontekstu 1 mln tokenów, natywna multimodalność obejmująca tekst, obraz, wideo i dźwięk oraz tag licencji MIT na udostępnionych checkpointach. Pakiet wydania zawiera raport techniczny i notatki wdrożeniowe, a Xiaomi twierdzi, że udostępnia jako open source środowisko treningowe uczenia ze wzmocnieniem i jego kod, aby można było zbadać i odtworzyć etap post-trainingu. Przebieg RL również udokumentowano — 30 kroków i około 750 000 trajektorii na model, w mniej niż sześć dni, przy łącznym opublikowanym koszcie około 3 474 715 dolarów w przypadku przebiegów Pro i Flash. W DeepSWE v1.1, własnym harnessie Xiaomi z mini-swe-agent przy avg@3, firma raportuje, że MiMo-V2.6-Flash poprawił się z 48,8 do 65,68, a MiMo-V2.6-Pro z 58,4 do 72,57 w tym przebiegu. Są to wartości raportowane przez dostawcę i nieodtworzone; różnica między „harness Xiaomi mówi 72,57” a „72,57 to wynik” to różnica między twierdzeniem a faktem.
GPT-6.1 Sol nie publikuje nic z tego. Nie ma liczby parametrów, noty o architekturze, danych o wydatkach na trening, checkpointu ani licencji do przeczytania — jest karta modelu, okno kontekstu, data odcięcia wiedzy 30 kwietnia 2026 r. i API. To normalny układ dla laboratorium frontier i nie jest to zarzut. Ma jednak konsekwencję dla decyzji zakupowej, którą relacje z premiery zwykle pomijają: w przypadku ścieżki open-weight rozczarowujący szybki poziom da się odratować. Jeśli UltraSpeed okaże się niewart 10x Twojego ruchu, ten sam checkpoint można pobrać i obsługiwać go samodzielnie lub przez innego dostawcę, co ogranicza Twoje ryzyko do kosztu migracji. W przypadku ścieżki zamkniętej rozczarowujący szybki poziom to rachunek i budżet limitów szybkości, który dostosowujesz z powrotem w dół; nie możesz tego obejść, uruchamiając wagi, bo nie ma wag do uruchomienia.
Jedno zastrzeżenie dotyczące tego tagu MIT, bo bywa on spłaszczany w relacjach z premiery. Licencja dotyczy checkpointów, które opublikowało Xiaomi. UltraSpeed to usługa hostowana, a usługi hostowane podlegają warunkom świadczenia usług, a nie licencji na wagi. Prawo do uruchamiania checkpointu na własnym sprzęcie i prawo do odsprzedaży czyjegoś przyspieszonego serwowania go to dwa różne prawa, a tylko to pierwsze wynika z pliku licencji.


Dwie pułapki nazewnicze, zanim skopiujesz którykolwiek z identyfikatorów
Żadna z nazw w tytule tej strony nie jest checkpointem, a dokumentacja obu dostawców sprawia, że łatwo powtórzyć ten błąd.
• GPT-6.1 Ultrafast — to nie model. Identyfikator w żądaniu pozostaje taki sam jak w modelu standardowym; poziom jest ustawiany przez pole żądania, a wynik to ten sam checkpoint uruchamiany według innego harmonogramu.
• MiMo v2.6 Pro Ultraspeed — również nie jest odrębnym zestawem wag. To checkpoint MiMo-V2.6-Pro udostępniany na szybszej ścieżce i wyceniany jako osobna pozycja.
• Co to oznacza dla benchmarkingu — jeśli porównasz dwie ścieżki któregokolwiek z modeli na identycznych promptach, oczekiwanym wynikiem są te same odpowiedzi w różnym tempie. Rozbieżna treść przy tym samym wejściu to defekt, który należy zgłosić, a nie możliwość, którą kupiłeś.
• Co to oznacza dla sprawdzania licencji — w przypadku Xiaomi przeczytaj kartę modelu. W przypadku OpenAI nie ma nic do czytania, ponieważ wagi nie są rozpowszechniane.
Widać też łagodniejszą asymetrię w sposobie sprzedaży poszczególnych poziomów. GPT-6.1 Sol obsługuje rezydencję danych w USA i UE oraz przetwarzanie globalne, również w ramach Ultrafast, więc obciążenie przypięte do przetwarzania europejskiego ma udokumentowaną odpowiedź. W czytelnej dla nas karcie stawek MiMo rezydencja nie jest w ogóle określona — Xiaomi sprzedaje model i ścieżkę serwowania, a nie postawę zgodnościową. Dla regulowanego nabywcy ta jedna linijka może rozstrzygnąć porównanie, zanim w ogóle weźmie się pod uwagę cenę.
Gdzie każdy tor jest faktycznie wywoływalny
Obie szybkie ścieżki są dostępne przez własne API ich dostawców i obie pojawiają się na platformach zewnętrznych. Żadnej z nich nie ma w OrcaRouter i warto powiedzieć to wprost, zamiast pozwalać, by strona porównawcza sugerowała coś innego.
To, co jest dostępne w OrcaRouter, to standardowa ścieżka modelu OpenAI: openai/gpt-6.1-sol w cenniku własnym OpenAI na poziomie 2,00 USD za milion tokenów wejściowych i 10,00 USD za milion tokenów wyjściowych, z 0% marży i ceną dostawcy przekazywaną bezpośrednio dalej, więc zmiana cennika przez dostawcę trafia po naszej stronie tego samego dnia. Ultrafast to flaga poziomu usługi rozliczana na Twoim własnym koncie OpenAI, a żaden model Xiaomi nie jest tu w ogóle hostowany. To, co daje jeden klucz, to standardowa ścieżka obok ponad 200 innych modeli za jednym endpointem zgodnym z OpenAI, z automatycznym przełączaniem awaryjnym między dostawcami — co jest przydatną postawą, gdy obciążenie, które chronisz, jest tym, które zauważyłoby pułap limitu szybkości o trzeciej nad ranem.

Który pas przetestować, w kolejności
Jeśli Twoje obciążenie jest interaktywne, a czas generowania odmierza się na czyimś zegarze, oba poziomy są warte wypróbowania, a decydującym czynnikiem nie będzie cena — będzie nim data ważności Twojego zaufania. Ścieżka otwartych wag pozwala zweryfikować, a potem odejść; ścieżka zamknięta wymaga, byś zweryfikował ją u jedynego dostawcy, który może ją obsłużyć, i został. Ta asymetria jest prawdziwa, ale też nie jest darmowa: MiMo-V2.6-Pro-UltraSpeed to usługa hostowana, więc wyjście jest migracją, a nie zmianą konfiguracji, a checkpoint, do którego byś migrował, może nie odpowiadać optymalizacjom serwowania tego poziomu.
Jeśli Twoje obciążenie jest wsadowe lub zaplanowane, oba zakupy są błędne — przy 6x i przy 10x — a uczciwym posunięciem jest uruchomienie go na standardowej ścieżce i przeznaczenie różnicy na ewaluację.
Co zmieniłoby tę stronę: niezależny pomiar szybkości wyjściowej któregokolwiek z poziomów przy podanym poziomie współbieżności, opublikowane oświadczenie o rezydencji danych od Xiaomi albo wartość limitu szybkości od OpenAI dla poziomu Sol, według której kupujący mógłby planować, zamiast o nią prosić. Dopóki ich nie ma, porównanie to cennik przeciw cennikowi, przy czym jeden z dwóch dostawców opublikował znacznie więcej o przedmiocie wyceny.
Porównane w tym artykule1
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
