Karta tytułowa porównania Xiaomi MiMo-V2.6-Pro z MiniMax M3, przedstawiająca dwie zwrócone do siebie karty specyfikacji: Xiaomi MiMo-V2.6-Pro z Intelligence Index v4.3.2 46, prędkością wyjściową 134,3 tokenów/s, blended 0,18 USD za 1 mln i 1 dostawcą API, w zestawieniu z MiniMax M3 z indeksem 29, 168,9 tokenów/s, 0,22 USD i 15 dostawcami API.
Guides & Insights

Xiaomi MiMo-V2.6-Pro kontra MiniMax M3: Lepszy wynik ma węższą ścieżkę

Autor

Rowan Sterling

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Xiaomi MiMo-V2.6-Pro stał się ogólnie dostępny 22 września 2026 roku i zajął najwyższą pozycję wśród modeli o otwartych wagach w Artificial Analysis Intelligence Index z wynikiem 46 w wersji v4.3.2. MiniMax M3 dzierży pewną wersję tego tytułu od premiery 31 maja 2026 roku, a w tym samym indeksie uzyskuje dziś wynik 29 — o siedemnaście punktów mniej. Wynik jest najmniej interesującą rzeczą w tej parze. MiniMax M3 obsługuje 168,9 tokena wyjściowego na sekundę w porównaniu ze 134,3, odpowiada w 0,92 sekundy w porównaniu z 2,15, jest tańszy za token wejściowy i jest dostępny przez piętnastu dostawców API w porównaniu z jednym u Xiaomi. Nowszy, wyżej oceniany model jest tym, który w praktyce trudniej wybrać, i to właśnie ta odwrotność jest tematem tego porównania.

Oba z otwartymi wagami, oba multimodalne, w odstępie czternastu tygodni.

Oba modele są bliskimi krewniakami pod względem zamysłu projektowego. Oba to rzadkie modele mieszanki ekspertów z chińskich laboratoriów, oba mają okno kontekstowe o długości 1 mln tokenów, oba natywnie przyjmują obrazy i wideo, a nie przez doklejony adapter, i oba publikują wagi. Ich premiery dzieli czternaście tygodni, a różnica w indeksie między nimi to dystans, jaki w tym okresie przebył front otwartych wag.

• Całkowita liczba parametrów — Xiaomi MiMo-V2.6-Pro 1,02T; MiniMax M3 około 427B, oba to rzadkie MoE

• Aktywne na token — Xiaomi MiMo-V2.6-Pro 42B; MiniMax M3 około 23–25B

• Kontekst — 1 mln tokenów każdy, a MiniMax M3 gwarantuje minimum 512 tys.

• Modalności wejściowe — tekst, obraz i wideo w obu przypadkach; Xiaomi dodaje wejście audio

• Wagi — licencja MIT dla Xiaomi MiMo-V2.6-Pro; MiniMax M3 jest udostępniany na licencji MiniMax Community Licence, która nie jest permisywna i wymaga oddzielnej umowy dotyczącej wykorzystania komercyjnego

• Wydano — Xiaomi MiMo-V2.6-Pro 21–22 września 2026; MiniMax M3 31 maja 2026

• Dostępność — jeden dostawca API zliczony dla Xiaomi MiMo-V2.6-Pro w Artificial Analysis; piętnaście dla MiniMax M3

Ta ostatnia linia jest tym, na co należy patrzeć. Wszystko inne na arkuszu przemawia za nowszym modelem. Ta linia nie, a to ona decyduje o tym, czy model może znaleźć się w ścieżce produkcyjnej.

Co mierzy wskaźnik i kto go zmierzył

Artificial Analysis samodzielnie przeprowadziło testy obu modeli w wersji v4.3.2 — kompozyt złożony z dziesięciu ewaluacji obejmujący rozumowanie, wiedzę, matematykę i kodowanie, w tym AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience oraz AA-LCR v1.1. Ani 46, ani 29 nie jest liczbą podaną przez dostawcę, co ma tu znaczenie, ponieważ oba laboratoria opublikowały również własne wyniki benchmarków, które były liczbami podanymi przez dostawców, a tych dwóch rodzajów nie wolno mieszać.

Wynik 46 plasuje Xiaomi MiMo-V2.6-Pro na czele stawki modeli z otwartymi wagami w tym zbiorczym wskaźniku. Nie stawia go jednak na czele indeksu: Claude Fable 5.1 i GPT-6 Astra mają po 53, a Claude Opus 5 – 51. Wynik 29 modelu MiniMax M3 daje mu szesnaste miejsce wśród 114 zmierzonych modeli — znacznie powyżej mediany dla swojej klasy rozmiarowej, ale daleko od czołówki, z którą porównywano go w czerwcu.

MiniMax M3 ma kwity, których Xiaomi nie ma

To jest ta część porównania, którą się pomija, a właśnie na nią kupujący powinien kłaść największy nacisk. MiniMax M3 znajduje się w publicznym rankingu DeepSWE v1.1 z oficjalnym wpisem: 20,4% Pass@1 i 48,7% Pass@4, opublikowanym 8 czerwca 2026 r., po tym jak aktualizacja inferencji MiniMax naprawiła nieprawidłowe generowanie tokenów i poprawiła działanie pamięci podręcznej długiego kontekstu. Do tego wpisu dołączono rozliczenie efektywności, a to rozliczenie nie jest pochlebne: mediana 311 kroków agenta, około 91 000 tokenów wyjściowych i około 5,04 USD na zadanie. Zalicza zadania inżynieryjne o długim horyzoncie i robi to kosztownie.

Główny wynik benchmarku nowego modelu Xiaomi to 72,57 w DeepSWE v1.1, wzrost z bazowego poziomu 58,4, mierzony za pomocą mini-swe-agent jako średnia z trzech na własnym harnessie Xiaomi. Nie jest wpisem na leaderboardzie i nie został zgłoszony jako taki. Zestawianie 72,57 z 20,4 MiniMaxa i odczytywanie z tego 52-punktowego zwycięstwa to arytmetyka na dwóch różnych pomiarach: leaderboard publikuje Pass@1 dla konkretnej konfiguracji, wraz z przedziałem ufności i średnim kosztem na zadanie, które to pomiary strona trzecia może odtworzyć, natomiast do wyniku dostawcy nic z tego nie jest dołączone. 72,57 może być jak najbardziej uczciwe. To po prostu nie jest ten sam rodzaj obiektu.

MiniMax również opublikował własne wyniki z premiery i to samo zastrzeżenie dotyczy każdego z nich: SWE-Bench Pro na poziomie 59,0, BrowseComp na poziomie 83,5, SVG-Bench na poziomie 63,7 i Terminal-Bench 2.1 na poziomie 66,0, przeprowadzone na własnej infrastrukturze MiniMax i przy użyciu własnego scaffoldingu. Traktuj je jako twierdzenia o modelu, a nie jako jego pomiary.

Szybkość, opóźnienie i dwie liczby, które decydują o rachunku

Luka w przepustowości ma odwrotny kierunek niż luka w jakości i jest wystarczająco szeroka, by mieć znaczenie. MiniMax M3 generuje 168,9 tokenów wyjściowych na sekundę w porównaniu ze 134,3 w przypadku Xiaomi MiMo-V2.6-Pro, a czas do pierwszego tokenu wynoszący 0,92 s jest około dwa i pół raza szybszy niż 2,15 s w Xiaomi. W produkcie interaktywnym opóźnienie pierwszego tokenu to liczba, którą użytkownik odczuwa; w potoku przetwarzania wsadowego przepustowość to liczba, która wyznacza czas zegarowy.

Pod względem kosztów oba są bliżej siebie, niż sugerują to stawki z nagłówków, a kierunek zależy od Twojego ruchu. MiniMax M3 ma w cenniku $0.30 za milion tokenów wejściowych i $1.20 za milion wyjściowych; Xiaomi MiMo-V2.6-Pro ma $0.43 i $0.87. M3 jest tańszy w karmieniu, Xiaomi jest tańszy w generowaniu. Po zastosowaniu zniżek za cache — 80% dla M3, 99% dla Xiaomi — stawki mieszane wynoszą $0.22 i $0.18 za milion przy mieszance 7:2:1 trafień cache/wejścia/wyjścia. Artificial Analysis odnotowuje również koszt $0.13 na zadanie Intelligence Index dla Xiaomi MiMo-V2.6-Pro, mierzony w ten sam sposób dla każdego modelu w zestawieniu, co jest najbardziej porównywalną pojedynczą wartością kosztu dostępną dla tych dwóch.

A two-column comparison scoreboard for Xiaomi MiMo-V2.6-Pro and MiniMax M3 covering Intelligence Index v4.3.2 (46 vs 29), output speed (134.3 vs 168.9 tokens/second), time to first token (2.15s vs 0.92s), blended rate ($0.18 vs $0.22 per 1M), API providers (1 vs 15) and long-horizon evidence (vendor harness only vs public Pass@1 entry).

Piętnaście tras przeciwko jednej, i ile warte jest przełączanie awaryjne

Siedemnastopunktowa przewaga w indeksie na nic się nie zda, jeśli endpoint nie działa. Artificial Analysis w momencie pisania tego tekstu odnotowało tylko jednego dostawcę API dla Xiaomi MiMo-V2.6-Pro, a ta liczba mówi o wydaniu, a nie o samym modelu: checkpoint opublikowany trzy dni temu nie miał czasu się rozprzestrzenić. MiniMax M3, mający cztery miesiące, jest obsługiwany przez piętnastu.

Ta różnica to właśnie zadanie dla routera i to tutaj oba modele rozchodzą się komercyjnie. MiniMax M3 jest dostępny w OrcaRouter jako minimax/minimax-m3: jeden punkt końcowy zgodny z OpenAI, cena katalogowa dostawcy przekazywana dalej z 0% marży, więc podane wyżej 0,30 USD i 1,20 USD to liczby samego MiniMax, a nie nasze, a zmiana ceny MiniMax jest u nas widoczna tego samego dnia. To piętnaście źródeł nadrzędnych sprawia, że automatyczny łańcuch przełączania awaryjnego ma sens — żądanie, które utknie u jednego dostawcy, jest ponawiane u innego, zanim zacznie się odpowiedź, co jest gwarancją inną niż w przypadku modelu, który ma tylko jedno miejsce docelowe. Xiaomi MiMo-V2.6-Pro nie ma w OrcaRouter; żaden model Xiaomi go nie ma, a dotarcie do niego dziś oznacza skorzystanie z własnej platformy Xiaomi oraz katalogów firm trzecich, które go wymieniają.

Jeśli chcesz mieć oba w tej samej aplikacji, praktycznym rozwiązaniem jest jeden klucz przechowujący modele, na które już się zdecydowałeś, a nowego ocenia się względem nich, zamiast przyjmować go na podstawie wyniku sprzed trzech dni. To decyzja dotycząca routingu, a jej przydatną właściwością jest to, że ścieżka zapasowa nic nie kosztuje aż do dnia, w którym cię uratuje.

The OrcaRouter model page for minimax/minimax-m3, showing MiniMax as the vendor, the 2026-05-31 release date, Vision, Tools, JSON and Reasoning capability tags, a 1M-token context window, 512K maximum output, $0.30 per 1M input and $1.20 per 1M output, and a p50 time to first token of 8.49 seconds.

Który wybrać

Jeśli potrzebujesz w tym tygodniu produkcyjnego modelu otwartych wag, multimodalnego, o milionie tokenów, odpowiedzią jest MiniMax M3 i nie ma tu nawet bliskiej konkurencji — piętnastu dostawców, pierwszy token w czasie poniżej sekundy, wystarczająco liberalna ścieżka komercyjna, ale tylko jeśli przeczytałeś licencję społecznościową, oraz oficjalny wpis w benchmarku długiego horyzontu, który możesz sprawdzić. Ostrzeżenie dotyczące wydajności jest prawdziwe: zaplanuj budżet na 91 000 tokenów wyjściowych na zadanie, a nie tylko stawkę za token.

Jeśli wybierasz model do pracy, którą rozpoczniesz w przyszłym miesiącu, Xiaomi MiMo-V2.6-Pro jest modelem o większych możliwościach, i to z dużą, zmierzoną przewagą, przy niższej stawce mieszanej i z licencją MIT, która całkowicie usuwa kwestię licencjonowania. Czego jeszcze mu brakuje, to drugiego miejsca do uruchomienia. Na co warto zwrócić uwagę, to liczba dostawców: gdy przestanie wynosić jeden, siedemnastopunktowa luka przestaje być wynikiem badań, a staje się decyzją o wdrożeniu.

Do tego czasu uczciwe podsumowanie jest takie, że lepszy model to ten, z którego nie da się awaryjnie przełączyć, a słabszy model to ten, który możesz dziś wieczorem postawić przed klientami.

The Artificial Analysis model page showing the Intelligence Index v4.3.2 scores, output speed, latency and per-task cost that both models in this comparison are measured on.

Skąd pochodzą liczby w tym tekście

Wyniki indeksu, przepustowość, opóźnienie, rabaty za pamięć podręczną i liczby dostawców dla obu modeli to pomiary Artificial Analysis na Intelligence Index v4.3.2, odczytane 22 września 2026 r., a wartość 29 dla MiniMax M3 pochodzi z tej samej wersji kompozytu co 46 dla Xiaomi MiMo-V2.6-Pro. Wartości DeepSWE v1.1 dla MiniMax M3 pochodzą z publicznego wpisu na tablicy wyników z 8 czerwca 2026 r. Przesunięcie DeepSWE z 58,4 na 72,57, wydatki na uczenie ze wzmocnieniem wynoszące około 2,62 mln USD na przebieg Pro przez trzydzieści kroków oraz liczby SWE-Bench Pro, BrowseComp, SVG-Bench i Terminal-Bench dla MiniMax M3 są zgłaszane przez dostawców na własnych środowiskach testowych poszczególnych laboratoriów i nie zostały niezależnie odtworzone. Stawki za token to własne ceny katalogowe dostawców.