Wygenerowana karta tytułowa z napisem MiMo-V2.6-Pro vs Grok 4.7, z podtytułem „29 razy tańszy na zadanie i wolniejszy po obu stronach” pod nią oraz trzema płaskimi ikonami liniowymi nad tytułem sugerującymi porównywane stosy monet, tarczę szybkości i otwartą kłódkę. Logo OrcaRouter jest nałożone w prawym dolnym rogu.
Guides & Insights

Xiaomi MiMo-V2.6-Pro vs Grok 4.7: 30× taniej na zadanie, a żaden z nich nie jest szybki

Autor

Elias Hawthorne

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Xiaomi MiMo-V2.6-Pro i Grok 4.7 zadebiutowały 21 września 2026 r., oba osiągają wynik 46 w Artificial Analysis Intelligence Index v4.3.2, a strona, która je zmierzyła, nazywa oba powolnymi — 43,6 tokena wyjściowego na sekundę dla MiMo-V2.6-Pro wobec mediany 67,1, 40 dla Grok 4.7 przy wysiłku xhigh. Co je odróżnia, to koszt odpowiedzi. Stawka oceniającego na zadanie to 0,13 USD dla chińskiego otwartego checkpointu i 3,74 USD dla modelu Grok 4.7, co daje współczynnik około 29. To nie jest różnica w stawce, a przynajmniej nie tylko ona: stawka Grok 4.7 za tokeny wyjściowe to 6,00 USD za milion tokenów wobec 0,87 USD, co daje siedmiokrotną różnicę, a pozostała część tej wielokrotności wynika z tego, ile tokenów każdy model zużywa, aby dojść do odpowiedzi.

Dwa modele w tym samym miesiącu, na tym samym indeksie, z tym samym wynikiem, wycenione tak, jakby należały do różnych dekad rynku. Ciekawe pytanie nie brzmi: który z nich wygrywa. Brzmi: którą część tego 29× możesz faktycznie ominąć — bo w tej parze dokładnie jeden z tych dwóch jest drogą, którą możesz kupić dziś, i to ten drogi.

Ten sam dzień, ten sam wynik, inne zwierzęta

Grok 4.7 został wydany 21 września 2026 r. w cenie 2,00 USD za milion tokenów wejściowych i 6,00 USD za milion tokenów wyjściowych, z oknem kontekstowym 500 000 tokenów, punktem odcięcia wiedzy na maj 2026 r., 75-procentowym rabatem na pamięć podręczną oraz wejściem tekstowym i obrazowym przy wyjściu tekstowym. Uzyskał 46 punktów w indeksie przy poziomie wysiłku xhigh, 56 w Coding Agent Index w środowisku testowym Grok Build i 1657 Elo w AA-Briefcase — czwarte miejsce na tej liście, za trzema pozycjami Anthropic, przy koszcie na zadanie wynoszącym około połowy kosztu Claude Opus 5.

Xiaomi MiMo-V2.6-Pro to rzadki checkpoint mieszaniny ekspertów, 1,02 biliona parametrów całkowitych, z czego 42 miliardy aktywne, na licencji MIT, kontekst 1 mln tokenów, wejście tekstowe, obrazowe, głosowe i wideo, a wyjście tekstowe, 0,43 USD i 0,87 USD za milion tokenów, z 99-procentową zniżką na cache, która przy rozgrzanym prompcie sprowadza efektywną stawkę za wejście niemal do zera. Artificial Analysis umieszcza go na pierwszym miejscu wśród 114 modeli z otwartymi wagami w indeksie i na dwunastym miejscu wśród 114 pod względem kosztu. Jest dostępny przez trzech dostawców API. Nie znajduje się na naszych trasach i nie umieszczamy modelu na liście, dopóki dostawca go nie zintegruje.

Jedyna linia, która o tym decyduje

• Koszt na zadanie indeksowania — MiMo-V2.6-Pro $0.13; Grok 4.7 $3.74 — 29× • Stawka za wyjście — MiMo-V2.6-Pro $0.87 / 1M; Grok 4.7 $6.00 / 1M — 6.9× • Tokeny wyjściowe w przebiegu indeksowania — MiMo-V2.6-Pro 140M; Grok 4.7 240M, wobec mediany 88M • Szybkość generowania — MiMo-V2.6-Pro 43.6 t/s; Grok 4.7 40 t/s — obie poniżej mediany • Okno kontekstowe — MiMo-V2.6-Pro 1M; Grok 4.7 500K • Wagi — MiMo-V2.6-Pro na licencji MIT i do pobrania; Grok 4.7 zastrzeżone, tylko przez API

Rozpatrz łącznie dwa pierwsze punkty, a kształt tej różnicy stanie się jasny. W cenie katalogowej oba różnią się 6,9× pod względem kosztu wyjścia. W przebiegu indeksowym różnią się 29× pod względem kosztu odpowiedzi. Czynnikiem mnożącym pomiędzy jest rozwlekłość: Grok 4.7 wygenerował 240 milionów tokenów wyjściowych wobec mediany 88 milionów dla swojej klasy, a MiMo-V2.6-Pro wygenerował 140 milionów. To kara 1,71× za tokeny nałożona na karę 6,9× za stawkę, a 1,71 × 6,9 to 11,8 — reszta dystansu do 29 pochodzi ze strony wejścia, gdzie 99% zniżki na pamięć podręczną i stawka wejściowa 0,43 USD po stronie MiMo-V2.6-Pro wykonują główną pracę w obciążeniu z choćby jakimkolwiek powtarzającym się prefiksem.

A two-column scoreboard titled MiMo-V2.6-Pro vs Grok 4.7 - the scoreboard, subtitled Same index score, same month, 29x apart per task. The left column, Xiaomi MiMo-V2.6-Pro, reads Intelligence Index v4.3.2 46; cost per index task $0.13; list price $0.43 / $0.87 per 1M; output speed 43.6 tokens per second; 140M output tokens on the index run; 1M context; weights downloadable, and carries a tag reading Open weights - MIT. The right column, Grok 4.7 (xhigh), reads Intelligence Index v4.3.2 46; cost per index task $3.74; list price $2.00 / $6.00 per 1M; output speed 40 tokens per second; 240M output tokens; 500K context; weights not released, and carries a tag reading Proprietary - API only. A footer line reads that index scores, per-task cost, speed and token counts are per Artificial Analysis Intelligence Index v4.3.2, read 25 September 2026, and that both models shipped 21 September 2026. The OrcaRouter logo is composited in the bottom-right corner.

Rozwlekłość to liczba, którą ludzie pomijają w szacunkach

Modele kosztów są zwykle budowane na podstawie cennika i założonej liczby tokenów. Obie te części są tutaj błędne. Cennik jest błędny, ponieważ rabat za pamięć podręczną nie jest przypisem — 99% w porównaniu do 75% to różnica między tym, że prompt systemowy kosztuje cię pieniądze przy każdym wywołaniu, a tym, że kosztuje cię prawie nic. Liczba tokenów jest błędna, ponieważ dwa modele nie emitują tej samej liczby tokenów przy tej samej pracy, a ewaluator zmierzył różnicę: 240 milionów kontra 140 milionów, rozrzut 1,71× na identycznym benchmarku.

Żadna z nich nie jest wskaźnikiem zastępczym, który można odczytać z karty specyfikacji. Ranking gadatliwości Grok 4.7 to #94 spośród 210 modeli w swojej klasie; ranking kosztowy MiMo-V2.6-Pro to #12 spośród 114 w swojej klasie. Zespół, który powołuje się na cennik stawek Grok 4.7 i zakłada obciążenie neutralne pod względem tokenów, prognozuje około jednej czwartej tego, co indeks faktycznie wydał na zadanie. Korekta nie polega też na tym, żeby używać kosztu indeksu jako własnego szacunku — to pomiar kształtu jednego benchmarku. Polega ona na zmierzeniu własnych zliczeń tokenów po obu stronach przed podjęciem decyzji, ponieważ różnica między tymi dwoma modelami wynosi 6,9× na papierze i 29× w praktyce, a tylko jedna z tych liczb jest rzeczywista dla twojego ruchu.

Screenshot of the Artificial Analysis model page for Grok 4.7 (xhigh), captured 25 September 2026. The header shows Intelligence rank 21 of 210, Speed 159 of 210, Cost 210 of 210, Verbosity 94 of 210, 46 on the Artificial Analysis Intelligence Index, $2.00 input and $6.00 output per 1M tokens with a 75% cache discount, $3.74 per task to evaluate on the Intelligence Index, and 500K context; the summary paragraph calls the model notably slow and very verbose, and the verbosity line shows 240M output tokens generated on the index run against a median of 88M.

Oba są wolne, a to nie jest remis

Artificial Analysis zmierzył Grok 4.7 na 40 tokenów wyjściowych na sekundę i nazywa go „jednym z najwolniejszych”; MiMo-V2.6-Pro na 43,6 i nazywa go „zauważalnie wolnym”. Te dwa odczyty są na tyle bliskie, że szybkość nie powinna rozstrzygać między nimi. Ale mediany leżące pod nimi już nie: 67,1 dla kategorii modeli z otwartymi wagami, do której należy MiMo-V2.6-Pro. Oba modele są znacznie poniżej niej, a MiMo-V2.6-Pro ma także 3,17 sekundy do pierwszego tokena wobec mediany 2,31 sekundy, co jest liczbą, która boli w pętli interaktywnej, a nie wsadowej.

Uczciwe podsumowanie kwestii opóźnień jest takie, że 29× taniej nie daje szybszego produktu, tylko wolniejszy, który kosztuje mniej — a jeśli użytkownicy patrzą na kursor, oczekiwanie 3,17 sekundy może kosztować więcej niż zaoszczędzone tokeny. W przypadku nocnej pracy wsadowej, oceny offline lub dowolnego potoku, w którym czas mierzy się w godzinach, ten kompromis jest prosty, a 29× jest niemal darmowe.

Co router może, a czego nie może zrobić przy tym parowaniu

To zestawienie, w którym nasz własny katalog jest naprawdę jednostronny, i warto powiedzieć to wprost. Grok 4.7 jest dostępny na OrcaRouter jako grok/grok-4.7 w cenie samego dostawcy $2.00 / $6.00, z maksymalnym wyjściem 450 tys. tokenów i punktem końcowym zgodnym z OpenAI SDK pod https://api.orcarouter.ai/v1 — więc jeśli po tym porównaniu chcesz mieć model xAI pod tym samym kluczem co wszystko inne, taka droga istnieje już dziś. Xiaomi MiMo-V2.6-Pro nie znajduje się na naszych trasach; w tym przypadku rozwiązaniem jest API samego producenta albo którykolwiek z trzech wymienionych przez niego dostawców, którego już używasz, i nie będziemy udawać inaczej.

To, gdzie router zasługuje na swoje miejsce w takim porównaniu, widać na częściach, które nie są modelem. Jeden klucz obejmujący 200+ modeli w cenie katalogowej każdego dostawcy z 0% marży oznacza, że obniżka ceny przez dostawcę trafia na Twoją fakturę tego samego dnia, a nie przy następnym odnowieniu umowy. Automatyczne przełączanie awaryjne sprawia, że degradacja trasy 40 t/s nie pociąga za sobą Twojego pipeline'u. routing DSL pozwala dokonać podziału na podstawie publikowanego kosztu na zadanie, a nie lojalności wobec marki — tani model do dużego wolumenu, trudny model do trudnych wywołań, decyzja podejmowana dla każdego żądania. A w przypadku obciążeń, w których żaden z modeli nie jest całkiem odpowiedni, fuzja modeli może uruchomić kilka z nich za jednym wywołaniem.

Screenshot of the OrcaRouter model page for Grok 4.7, captured 25 September 2026. The page shows the model id grok/grok-4.7, a maximum output of 450K, output text, public benchmarks by grok dated 2026-09-21, a price of $2.00 per 1M input and $6.00 per 1M output, and an OpenAI-SDK-compatible code sample whose base URL is https://api.orcarouter.ai/v1 and whose model field is grok/grok-4.7.

Pytania, które zwykle nasuwa to porównanie

Czy mnożnik 29× utrzymuje się w przypadku mojego obciążenia?Tylko jeśli mieszanka Twoich tokenów przypomina tę z przebiegu indeksowego. Jeśli Twoje dane wyjściowe są krótkie, a prompty długie i buforowane, mnożnik spada w stronę różnicy stawek 6,9× na wyjściu i rośnie na wejściu, gdzie decydującym składnikiem jest 99% zniżki MiMo-V2.6-Pro. Jeśli Twoje dane wyjściowe to długie ślady rozumowania, rośnie powyżej 29×, ponieważ kara Grok 4.7 za rozwlekłość jest proporcjonalna do długości wyjścia.

Czy 46 po każdej stronie to to samo 46? To ten sam indeks, ta sama wersja i ta sama skala — bazowe wyniki cząstkowe wynosiły 46,32 i 46,45, czyli różnica 0,13 punktu, a indeks zaokrągla oba do 46. Artificial Analysis nie publikuje szczegółowych wyników poszczególnych ewaluacji dla żadnego z tych modeli, więc wynik zbiorczy jest najdrobniejszym dostępnym ziarnem, a różnicy 0,13 punktu nie należy odczytywać jako rankingu możliwości.

Na co powinien domyślnie stawiać nowy projekt? Jeśli obciążenie ma charakter wsadowy, jest tolerancyjne na opóźnienia i wrażliwe na koszty, domyślnym wyborem jest MiMo-V2.6-Pro w cenie $0.13 za zadanie, a otwarte wagi sprawiają, że nie jesteś zdany na cennik jednego dostawcy. Jeśli potrzebujesz konkretnie modelu xAI — wyników harnessu Grok Build, pozycji w AA-Briefcase, kontekstu 500K z odcięciem na maj 2026 — Grok 4.7 jest dziś dostępny jako aktywna trasa w OrcaRouter, a dopłata za zadanie to cena tej konkretnej możliwości. Nie ma tu modelu, który wygrywa w obu tych przypadkach.

Porównane w tym artykule1

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie