
GPT-5.6 Sol Ultrafast kontra Xiaomi MiMo v2.6 Pro Ultraspeed: Dwa poziomy szybkości, jedna brakująca cena
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 610 tok/s
- openaiNOWOŚĆOpenAI: GPT-6 Luna2026-09-2237Inteligencja
- openaiNOWOŚĆOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- grokNOWOŚĆGrok 4.72026-09-2146Inteligencja
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów · 189 tok/s
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 1306 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
Dwóch dostawców wypuściło ten sam pomysł na produkt w odstępie trzech tygodni, a różnica między nimi to najlepszy sposób, aby zobaczyć, co tak naprawdę sprzedaje każdy z nich. Oferta Xiaomi pojawiła się 22 września 2026 r.: Xiaomi MiMo v2.6 Pro Ultraspeed to ten sam checkpoint o 1,02 biliona parametrów co MiMo-V2.6-Pro, udostępniany szybciej, w cenie 4,35 USD za milion tokenów wejściowych i 8,70 USD za milion tokenów wyjściowych wobec 0,44 USD i 0,87 USD w standardowej ścieżce Pro. GPT-5.6 Sol Ultrafast od tego dostawcy to ten sam manewr zastosowany do GPT-5.6 Sol: identyczne wagi, do 750 tokenów wyjściowych na sekundę, do 14× więcej niż standardowy poziom, działający na sprzęcie Cerebras w skali wafla — i zupełnie brak opublikowanej ceny, sześć tygodni po ogłoszeniu tego trybu 13 sierpnia.
Postaw oba obok siebie, a anomalia staje się natychmiast widoczna. Xiaomi opublikowało cennik, zanim opublikowało większość benchmarków. OpenAI opublikowało benchmarki, partnera sprzętowego i nazwy klientów — a wciąż nie opublikowało liczby, na której można oprzeć budżet. Jeden z tych poziomów można kupić już dziś. Drugi to wartość w schemacie API. Porównywanie ich jest więc mniej kwestią tego, który jest szybszy, a bardziej tego, ile wart jest poziom prędkości, gdy jeden dostawca podał ci cenę, a drugi nie.
Czym każdy z nich właściwie jest
Żadne z nich nie jest nowym modelem. To wspólne założenie i warto powiedzieć to wprost, ponieważ obie premiery przyciągnęły relacje medialne, które traktowały zmianę w sposobie serwowania jako premierę nowych możliwości.
MiMo v2.6 Pro Ultraspeed to konfiguracja obsługi flagowego modelu Xiaomi: ten sam rzadki mieszany model ekspertów z 1,02 bln parametrów i 42 mld aktywowanych na token, ten sam kontekst 1 mln tokenów, ta sama natywna multimodalność w zakresie tekstu, obrazu, wideo i dźwięku, te same wagi na licencji MIT w publicznych repozytoriach. Materiały samego Xiaomi twierdzą, że zapewnia do 20 razy większą prędkość generowania wyników niż standardowa usługa Pro przy tej samej jakości; oferty katalogowe podmiotów trzecich opisujące ten sam model tego samego dnia mówią o około 10 razy. Nikt nie opublikował pomiaru, który pogodziłby te dwie wartości.
GPT-5.6 Sol Ultrafast to konfiguracja serwowania flagowego modelu OpenAI: ten sam checkpoint, to samo zachowanie w zakresie rozumowania, to samo okno kontekstu wynoszące 1 050 000 tokenów, ten sam maksymalny rozmiar wyjścia 128 tys., te same odpowiedzi. Przyspieszenie wynika ze sprzętu, a nie z harmonogramowania — wagi modelu znajdują się w pamięci SRAM na chipie w krzemie wafer-scale firmy Cerebras, zamiast być przenoszone między pamięcią GPU a jednostkami obliczeniowymi — i jest to pierwszy produkt partnerstwa obliczeniowego OpenAI–Cerebras ze stycznia 2026 r., którego wartość szacuje się na około 10 miliardów dolarów na przestrzeni trzech lat.
Uczciwą osią porównania nie jest więc inteligencja. Jest nią to, co dostawca postanowił zmienić, ile za tę zmianę zażądał i jak dużą jej część pozwolił ci zweryfikować.

Karty stawek, w tym ta pusta
• MiMo v2.6 Pro Ultraspeed — 4,35 USD za milion tokenów wejściowych / 8,70 USD za milion tokenów wyjściowych, opublikowane przez Xiaomi.
• MiMo-V2.6-Pro standard — $0,44 / $0,87, opublikowane w katalogach handlowych Xiaomi. Około 9,9× na wejściu i dokładnie 10× na wyjściu.
• GPT-5.6 Sol Ultrafast — brak opublikowanego cennika na dzień 27 września 2026. Strona z cennikiem OpenAI nadal zawiera cztery zakładki — Standard, Batch, Flex, Fast — a tego poziomu nie ma wśród nich.
• GPT-5.6 Sol standard — 4,00 USD / 20,00 USD za milion, obecna stawka promocyjna OpenAI, z wejściem z pamięci podręcznej po 0,40 USD i progiem dla długiego kontekstu do 8,00 USD / 30,00 USD powyżej około 272 tys. tokenów wejściowych.
• Jedyny porównywalny wariant premium, jaki OpenAI kiedykolwiek wyceniło — tryb Fast, w cenie 8,00 USD / 40,00 USD, dokładnie dwukrotność stawki standardowej za nawet około 2,5× szybsze generowanie.
Ten ostatni wiersz jest całym powodem, dla którego puste pole ma znaczenie. Poziom szybkości Xiaomi kosztuje dziesięć razy więcej niż standardowa ścieżka i obiecuje dziesięć do dwudziestu razy większą szybkość, co przynajmniej jako transakcja jest wewnętrznie spójne: płacisz proporcjonalnie więcej za proporcjonalnie krótsze oczekiwanie, a zakład polega na tym, że produktem jest czas rzeczywisty. Poziom szybkości OpenAI to większe zapotrzebowanie na rzadszy krzem niż Fast mode, więc niezależnie od tego, ile ostatecznie będzie kosztować, precedens wskazuje na premię, a nie rabat. Ale „precedens wskazuje na premię” nie jest liczbą, a dopóki taka liczba nie istnieje, tego poziomu nie można w ogóle porównywać z UltraSpeed pod względem ceny — jedynie na podstawie tego, że Xiaomi było skłonne podać swoją liczbę, a OpenAI nie.
Skąd wzięły się liczby
Te dwa poziomy mają przeciwstawne problemy dowodowe i warto nazwać oba, zamiast szukać kompromisu.
Deklaracja Xiaomi dotycząca szybkości jest niejasna co do rzędu wielkości, ale opiera się na opublikowanej cenie. 20× to górna granica podana przez producenta w warunkach, których Xiaomi nie sprecyzowało; 10× to wartość, którą wpis w katalogu był gotów uznać za typową; a rzeczywisty mnożnik mieści się w szerokim przedziale, którego nikt publicznie nie zmierzył przy podanym poziomie współbieżności. Na tym tle cena jest dokładna, wagi można pobrać na licencji MIT, a raport techniczny i środowisko treningowe do uczenia ze wzmocnieniem są publiczne — możesz sprawdzić, co Xiaomi zrobiło, ale po prostu nie możesz jeszcze zweryfikować, jak szybko to działa.
Twierdzenie OpenAI o szybkości ma konkretną wartość liczbową, ale nie opiera się na niczym, co można kupić. Do 750 tokenów wyjściowych na sekundę, do 14× standardu, podane wprost. Jest to również wskaźnik przepustowości dla tokenów wyjściowych, a nie jednolity mnożnik end-to-end: przetwarzanie danych wejściowych i własne rozumowanie modelu nie kompresują się w tym stosunku, dlatego firma określa to jako maksimum. Wspierające benchmarki są raportowane przez dostawcę, a w jednym przypadku mają charakter międzydostawcowy — przebieg Humanity's Last Exam złożony z 2500 pytań, zgłoszony jako zakończony w 11 godzin 11 minut wobec 78 godzin 27 minut dla Claude Fable 5, przy porównywalnej dokładności. Niezależne relacje z premiery przytaczały węższe, wynoszące około 11× porównanie szybkości generowania w tym samym przebiegu, podczas gdy własne dane Cerebras sugerują około 7× w przypadku całkowitego czasu testu. Trzy podmioty, trzy ułamki jednego obciążenia, brak niezależnego odtworzenia któregokolwiek z nich. Cerebras osobno raportuje 5,6× end-to-end na GDP-Val bez mierzalnej utraty jakości — również bez niezależnego odtworzenia.
Oba zestawy liczb są podane przez dostawców. Różnica polega na tym, że niejasność Xiaomi dotyczy szybkości, a OpenAI – kosztu, a dla każdego, kto sporządza budżet, koszt jest tym trudniejszym do odgadnięcia.

Co się stało w tym tygodniu i dlaczego nie zamyka to luki
Powodem, dla którego to porównanie ma w ogóle jakiś punkt zaczepienia dla newsów, jest commit, a nie ogłoszenie. Wartość ultrafast figuruje w publicznym schemacie openai-openapi OpenAI od 13 sierpnia 2026 r. — tego samego dnia, w którym ogłoszono ten tryb — wraz z opisem, który ogranicza ją do gpt-5.6-sol i nazywa ją objętą kontrolą dostępu. Commit, który trafił tam w tym tygodniu, jest późniejszy i mniejszy: 25 września 2026 r. fe4f7a1 dodał ultrafast do dwóch kolejnych enumeracji — parametru service-tier na poziomie żądania i pola polityki service-tier agenta. Przed tym commitem obie te listy zawierały wartości auto, default, flex, priority, fast. Po nim pojawia się wpis opisany jako „Używa warstwy usług ultrafast.”ultrafast do service_tier — czyli do enumeracji w swojej publicznej openai-openapi specyfikacji — pola, które schemat opisuje jako „warstwa usług używana do żądań modelu”, oraz pola polityki powiązanego z agentami. Przed tą zmianą ta lista zawierała default, flex, priority, fast. Po niej pojawia się wpis opisany jako „Używa warstwy usług ultrafast.”
To rozróżnienie ma znaczenie dla każdego, kto czyta te doniesienia. To nie jest poziom, który dopiero powstaje; to poziom, który jest wpinany w pole, za pomocą którego konfiguruje się agenta, co oznacza, że klient może z czasem zostać napisany z myślą o nim bez żadnego nowego endpointu. Doniesienie z następnego dnia opisuje selektor Fast / Standard / Ultrafast mający pojawić się w Responses API Playground, a szerszego dostępu można spodziewać się po konferencji DevDay OpenAI. Nie widzieliśmy tego selektora, a OpenAI nie opublikowało noty o wdrożeniu, więc ta część opiera się na pojedynczym źródle. Sprawdzalne są dodane wpisy schematu i nadal utrzymujący się brak cennika sześć tygodni po ogłoszeniu.
Tymczasem poziom Xiaomi można kupić od pięciu dni i nadal jest jedynym z tych dwóch, który można wpisać na fakturę. Jego własne otwarte pytanie jest inne: czy dziesięciokrotna premia się utrzyma, czy też zachowa się jak większość cen premierowych w nowym segmencie premium i po zakończeniu kampanii premierowej przesunie się w stronę standardowej ścieżki. Standard Pro w cenie $0.44 / $0.87 jest punktem odniesienia, a poziom, który startuje z ceną dziesięć razy wyższą od punktu odniesienia, rzadko kończy w tym miejscu.
Wybierając między nimi, skoro prawdopodobnie nie możesz
Niewygodnym praktycznym faktem jest to, że dla większości czytelników jest to porównanie między jednym poziomem, którego nie można kupić, a drugim, którego prawdopodobnie nie należy kupować po cenie katalogowej. GPT-5.6 Sol Ultrafast to objęta listą oczekujących wersja zapoznawcza dla wybranych klientów, rozszerzana w miarę wzrostu dostępnych mocy, bez daty ogólnej dostępności i bez ceny; MiMo v2.6 Pro Ultraspeed jest dostępny, drogi i stworzony dla konkretnego typu nabywcy.
Test obciążenia jest taki sam dla obu i chodzi w nim o kształt grafu twoich żądań, a nie o rozmiar twojego promptu. Pojedyncze długie generowanie zyskuje znacznie mniej niż mnożnik z nagłówka, ponieważ przetwarzanie danych wejściowych i rozumowanie nie przyspieszają w tej samej proporcji. Czterdziestokrokowa pętla agenta stojąca za jedną widoczną dla użytkownika akcją zyskuje coś znacznie bliższego pełnej liczbie, ponieważ każda wymiana w obie strony to opóźnienie, na które człowiek czeka. Jeśli twój ruch wygląda jak ten drugi kształt, oba poziomy są wymierzone w ciebie; jeśli wygląda jak pierwszy, standardowa ścieżka w którymkolwiek z modeli zawsze była właściwym wyborem, a standardowa ścieżka MiMo-V2.6-Pro w cenie 0,44 USD / 0,87 USD to jeden z najtańszych sposobów wywołania modelu klasy biliona parametrów gdziekolwiek.
To, czego nie zmienia żaden z tych poziomów, to fakt, że kupujesz opóźnienie, a nie jakość. Jeśli porównasz UltraSpeed albo Ultrafast z jego własną standardową ścieżką na identycznych promptach i otrzymasz różne odpowiedzi, to jest odkrycie warte zgłoszenia, a nie funkcja — nic w opisie żadnego z dostawców nie twierdzi, że wagi się zmieniły.
To również przypadek, w którym router zasługuje na swoje miejsce, a konkretnie dla poziomu, którego nie możesz dostać. GPT-5.6 Sol jest dostępny w OrcaRouter jako openai/gpt-5.6-sol po własnej stawce dostawcy z zerową marżą na tokenach przez punkt końcowy zgodny z OpenAI pod adresem api.orcarouter.ai/v1, więc standardowa ścieżka, do której byś się wycofał, jest o jedną zmianę bazowego adresu URL stąd, a ten sam klucz obsługuje ponad 200 modeli. To ma znaczenie, ponieważ szczera odpowiedź na pytanie „czy powinienem używać Ultrafast” brzmi dziś „nie możesz, więc zdecyduj, co w międzyczasie obsługuje ruch interaktywny” — a sposobem na kupienie niskich opóźnień bez listy oczekujących jest kierowanie wywołań interaktywnych do tego modelu z katalogu, który spełnia twoją poprzeczkę jakościową przy najkrótszym czasie zegarowym, i pozostawienie pracy nocnej na najtańszej ścieżce, która przechodzi. Gdy poziom zostanie otwarty, to jest ten przełącznik, który przekładasz. Zaznaczmy wprost, czego nie hostujemy: żaden model Xiaomi nie znajduje się w OrcaRouter, więc MiMo v2.6 Pro Ultraspeed pochodzi z własnego API Xiaomi i kilku platform trzecich, a ta strona nie jest drogą do niego.

Co by to rozstrzygnęło
Trzy pomiary, z których żaden jeszcze nie istnieje. Opublikowany cennik Ultrafast uczyniłby z tego porównanie, na jakie zasługuje, a nie porównanie z luką. Niezależny rozkład opóźnień przy zadeklarowanym poziomie współbieżności pozwoliłby ci stwierdzić, czy rzeczywisty mnożnik Xiaomi plasuje się bliżej 10× czy 20×, oraz czy utrzymuje się pod obciążeniem, a nie jedynie w demonstracji pojedynczego strumienia. A niezależne odtworzenie zestawu testów porównawczych któregokolwiek z dostawców przeniosłoby oba zestawy liczb z kolumny deklaracji.
Do tego czasu możliwa do obrony interpretacja jest wąska. Xiaomi wypuściło poziom szybkości z ceną i niejasną szybkością; OpenAI wypuściło poziom szybkości z konkretną szybkością i bez ceny; oba są tym samym modelem co to, względem czego są wyceniane, i żaden nie został niezależnie zmierzony. Jeśli potrzebujesz opóźnienia teraz, a obciążenie jest interaktywne, UltraSpeed jest realny, można go kupić i jest wyceniony dokładnie pod nabywcę, którego chce. Jeśli potrzebujesz go teraz, a obciążenie nie jest interaktywne, standardowe ścieżki w obu modelach są tańsze, sprawdzone i dostępne już dziś — a poziom, o który wszyscy się spierają, nadal będzie tam, gdy ktoś opublikuje liczbę.
