
Xiaomi MiMo-V2.6-Pro vs Grok 4.7: 30× taniej na zadanie, a żaden z nich nie jest szybki
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 36 tok/s
- openaiNOWOŚĆOpenAI: GPT-6 Luna2026-09-2237Inteligencja
- openaiNOWOŚĆOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- grokNOWOŚĆGrok 4.72026-09-2146Inteligencja
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów · 181 tok/s
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 1277 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
Xiaomi MiMo-V2.6-Pro i Grok 4.7 zadebiutowały 21 września 2026 r., oba osiągają wynik 46 w Artificial Analysis Intelligence Index v4.3.2, a strona, która je zmierzyła, nazywa oba powolnymi — 43,6 tokena wyjściowego na sekundę dla MiMo-V2.6-Pro wobec mediany 67,1, 40 dla Grok 4.7 przy wysiłku xhigh. Co je odróżnia, to koszt odpowiedzi. Stawka oceniającego na zadanie to 0,13 USD dla chińskiego otwartego checkpointu i 3,74 USD dla modelu Grok 4.7, co daje współczynnik około 29. To nie jest różnica w stawce, a przynajmniej nie tylko ona: stawka Grok 4.7 za tokeny wyjściowe to 6,00 USD za milion tokenów wobec 0,87 USD, co daje siedmiokrotną różnicę, a pozostała część tej wielokrotności wynika z tego, ile tokenów każdy model zużywa, aby dojść do odpowiedzi.
Dwa modele w tym samym miesiącu, na tym samym indeksie, z tym samym wynikiem, wycenione tak, jakby należały do różnych dekad rynku. Ciekawe pytanie nie brzmi: który z nich wygrywa. Brzmi: którą część tego 29× możesz faktycznie ominąć — bo w tej parze dokładnie jeden z tych dwóch jest drogą, którą możesz kupić dziś, i to ten drogi.
Ten sam dzień, ten sam wynik, inne zwierzęta
Grok 4.7 został wydany 21 września 2026 r. w cenie 2,00 USD za milion tokenów wejściowych i 6,00 USD za milion tokenów wyjściowych, z oknem kontekstowym 500 000 tokenów, punktem odcięcia wiedzy na maj 2026 r., 75-procentowym rabatem na pamięć podręczną oraz wejściem tekstowym i obrazowym przy wyjściu tekstowym. Uzyskał 46 punktów w indeksie przy poziomie wysiłku xhigh, 56 w Coding Agent Index w środowisku testowym Grok Build i 1657 Elo w AA-Briefcase — czwarte miejsce na tej liście, za trzema pozycjami Anthropic, przy koszcie na zadanie wynoszącym około połowy kosztu Claude Opus 5.
Xiaomi MiMo-V2.6-Pro to rzadki checkpoint mieszaniny ekspertów, 1,02 biliona parametrów całkowitych, z czego 42 miliardy aktywne, na licencji MIT, kontekst 1 mln tokenów, wejście tekstowe, obrazowe, głosowe i wideo, a wyjście tekstowe, 0,43 USD i 0,87 USD za milion tokenów, z 99-procentową zniżką na cache, która przy rozgrzanym prompcie sprowadza efektywną stawkę za wejście niemal do zera. Artificial Analysis umieszcza go na pierwszym miejscu wśród 114 modeli z otwartymi wagami w indeksie i na dwunastym miejscu wśród 114 pod względem kosztu. Jest dostępny przez trzech dostawców API. Nie znajduje się na naszych trasach i nie umieszczamy modelu na liście, dopóki dostawca go nie zintegruje.
Jedyna linia, która o tym decyduje
• Koszt na zadanie indeksowania — MiMo-V2.6-Pro $0.13; Grok 4.7 $3.74 — 29× • Stawka za wyjście — MiMo-V2.6-Pro $0.87 / 1M; Grok 4.7 $6.00 / 1M — 6.9× • Tokeny wyjściowe w przebiegu indeksowania — MiMo-V2.6-Pro 140M; Grok 4.7 240M, wobec mediany 88M • Szybkość generowania — MiMo-V2.6-Pro 43.6 t/s; Grok 4.7 40 t/s — obie poniżej mediany • Okno kontekstowe — MiMo-V2.6-Pro 1M; Grok 4.7 500K • Wagi — MiMo-V2.6-Pro na licencji MIT i do pobrania; Grok 4.7 zastrzeżone, tylko przez API
Rozpatrz łącznie dwa pierwsze punkty, a kształt tej różnicy stanie się jasny. W cenie katalogowej oba różnią się 6,9× pod względem kosztu wyjścia. W przebiegu indeksowym różnią się 29× pod względem kosztu odpowiedzi. Czynnikiem mnożącym pomiędzy jest rozwlekłość: Grok 4.7 wygenerował 240 milionów tokenów wyjściowych wobec mediany 88 milionów dla swojej klasy, a MiMo-V2.6-Pro wygenerował 140 milionów. To kara 1,71× za tokeny nałożona na karę 6,9× za stawkę, a 1,71 × 6,9 to 11,8 — reszta dystansu do 29 pochodzi ze strony wejścia, gdzie 99% zniżki na pamięć podręczną i stawka wejściowa 0,43 USD po stronie MiMo-V2.6-Pro wykonują główną pracę w obciążeniu z choćby jakimkolwiek powtarzającym się prefiksem.

Rozwlekłość to liczba, którą ludzie pomijają w szacunkach
Modele kosztów są zwykle budowane na podstawie cennika i założonej liczby tokenów. Obie te części są tutaj błędne. Cennik jest błędny, ponieważ rabat za pamięć podręczną nie jest przypisem — 99% w porównaniu do 75% to różnica między tym, że prompt systemowy kosztuje cię pieniądze przy każdym wywołaniu, a tym, że kosztuje cię prawie nic. Liczba tokenów jest błędna, ponieważ dwa modele nie emitują tej samej liczby tokenów przy tej samej pracy, a ewaluator zmierzył różnicę: 240 milionów kontra 140 milionów, rozrzut 1,71× na identycznym benchmarku.
Żadna z nich nie jest wskaźnikiem zastępczym, który można odczytać z karty specyfikacji. Ranking gadatliwości Grok 4.7 to #94 spośród 210 modeli w swojej klasie; ranking kosztowy MiMo-V2.6-Pro to #12 spośród 114 w swojej klasie. Zespół, który powołuje się na cennik stawek Grok 4.7 i zakłada obciążenie neutralne pod względem tokenów, prognozuje około jednej czwartej tego, co indeks faktycznie wydał na zadanie. Korekta nie polega też na tym, żeby używać kosztu indeksu jako własnego szacunku — to pomiar kształtu jednego benchmarku. Polega ona na zmierzeniu własnych zliczeń tokenów po obu stronach przed podjęciem decyzji, ponieważ różnica między tymi dwoma modelami wynosi 6,9× na papierze i 29× w praktyce, a tylko jedna z tych liczb jest rzeczywista dla twojego ruchu.

Oba są wolne, a to nie jest remis
Artificial Analysis zmierzył Grok 4.7 na 40 tokenów wyjściowych na sekundę i nazywa go „jednym z najwolniejszych”; MiMo-V2.6-Pro na 43,6 i nazywa go „zauważalnie wolnym”. Te dwa odczyty są na tyle bliskie, że szybkość nie powinna rozstrzygać między nimi. Ale mediany leżące pod nimi już nie: 67,1 dla kategorii modeli z otwartymi wagami, do której należy MiMo-V2.6-Pro. Oba modele są znacznie poniżej niej, a MiMo-V2.6-Pro ma także 3,17 sekundy do pierwszego tokena wobec mediany 2,31 sekundy, co jest liczbą, która boli w pętli interaktywnej, a nie wsadowej.
Uczciwe podsumowanie kwestii opóźnień jest takie, że 29× taniej nie daje szybszego produktu, tylko wolniejszy, który kosztuje mniej — a jeśli użytkownicy patrzą na kursor, oczekiwanie 3,17 sekundy może kosztować więcej niż zaoszczędzone tokeny. W przypadku nocnej pracy wsadowej, oceny offline lub dowolnego potoku, w którym czas mierzy się w godzinach, ten kompromis jest prosty, a 29× jest niemal darmowe.
Co router może, a czego nie może zrobić przy tym parowaniu
To zestawienie, w którym nasz własny katalog jest naprawdę jednostronny, i warto powiedzieć to wprost. Grok 4.7 jest dostępny na OrcaRouter jako grok/grok-4.7 w cenie samego dostawcy $2.00 / $6.00, z maksymalnym wyjściem 450 tys. tokenów i punktem końcowym zgodnym z OpenAI SDK pod https://api.orcarouter.ai/v1 — więc jeśli po tym porównaniu chcesz mieć model xAI pod tym samym kluczem co wszystko inne, taka droga istnieje już dziś. Xiaomi MiMo-V2.6-Pro nie znajduje się na naszych trasach; w tym przypadku rozwiązaniem jest API samego producenta albo którykolwiek z trzech wymienionych przez niego dostawców, którego już używasz, i nie będziemy udawać inaczej.
To, gdzie router zasługuje na swoje miejsce w takim porównaniu, widać na częściach, które nie są modelem. Jeden klucz obejmujący 200+ modeli w cenie katalogowej każdego dostawcy z 0% marży oznacza, że obniżka ceny przez dostawcę trafia na Twoją fakturę tego samego dnia, a nie przy następnym odnowieniu umowy. Automatyczne przełączanie awaryjne sprawia, że degradacja trasy 40 t/s nie pociąga za sobą Twojego pipeline'u. routing DSL pozwala dokonać podziału na podstawie publikowanego kosztu na zadanie, a nie lojalności wobec marki — tani model do dużego wolumenu, trudny model do trudnych wywołań, decyzja podejmowana dla każdego żądania. A w przypadku obciążeń, w których żaden z modeli nie jest całkiem odpowiedni, fuzja modeli może uruchomić kilka z nich za jednym wywołaniem.

Pytania, które zwykle nasuwa to porównanie
Czy mnożnik 29× utrzymuje się w przypadku mojego obciążenia?Tylko jeśli mieszanka Twoich tokenów przypomina tę z przebiegu indeksowego. Jeśli Twoje dane wyjściowe są krótkie, a prompty długie i buforowane, mnożnik spada w stronę różnicy stawek 6,9× na wyjściu i rośnie na wejściu, gdzie decydującym składnikiem jest 99% zniżki MiMo-V2.6-Pro. Jeśli Twoje dane wyjściowe to długie ślady rozumowania, rośnie powyżej 29×, ponieważ kara Grok 4.7 za rozwlekłość jest proporcjonalna do długości wyjścia.
Czy 46 po każdej stronie to to samo 46? To ten sam indeks, ta sama wersja i ta sama skala — bazowe wyniki cząstkowe wynosiły 46,32 i 46,45, czyli różnica 0,13 punktu, a indeks zaokrągla oba do 46. Artificial Analysis nie publikuje szczegółowych wyników poszczególnych ewaluacji dla żadnego z tych modeli, więc wynik zbiorczy jest najdrobniejszym dostępnym ziarnem, a różnicy 0,13 punktu nie należy odczytywać jako rankingu możliwości.
Na co powinien domyślnie stawiać nowy projekt? Jeśli obciążenie ma charakter wsadowy, jest tolerancyjne na opóźnienia i wrażliwe na koszty, domyślnym wyborem jest MiMo-V2.6-Pro w cenie $0.13 za zadanie, a otwarte wagi sprawiają, że nie jesteś zdany na cennik jednego dostawcy. Jeśli potrzebujesz konkretnie modelu xAI — wyników harnessu Grok Build, pozycji w AA-Briefcase, kontekstu 500K z odcięciem na maj 2026 — Grok 4.7 jest dziś dostępny jako aktywna trasa w OrcaRouter, a dopłata za zadanie to cena tej konkretnej możliwości. Nie ma tu modelu, który wygrywa w obu tych przypadkach.
Porównane w tym artykule1
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
