Wygenerowana karta tytułowa porównująca Xiaomi MiMo-V2.6-Pro i GPT-5.6 Sol przy maksymalnym wysiłku. Lewa karta pokazuje Intelligence Index v4.3.2: 46, 0,18 USD w ujęciu mieszanym za 1 mln, 0,13 USD za zadanie indeksowe i 134,3 tokena na sekundę; prawa karta pokazuje Intelligence Index v4.3.2: 47, 3,08 USD w ujęciu mieszanym za 1 mln, 3464,84 USD za uruchomienie indeksu i 77,3 tokena na sekundę. W stopce napisano: Oba wyniki w Artificial Analysis Intelligence Index v4.3.2, odczyt z 22 września 2026 r. Logo OrcaRouter jest wkomponowane w prawym dolnym rogu.
Guides & Insights

MiMo-V2.6-Pro vs GPT-5.6 Sol: jeden punkt indeksu, dwadzieścia dwa razy wyższa stawka mieszana

Autor

Rowan Sterling

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

W indeksie Artificial Analysis Intelligence Index v4.3.2, odczytanym 22 września 2026 r., GPT-5.6 Sol dostawcy przy maksymalnym wysiłku uzyskuje 47 punktów, a MiMo-V2.6-Pro firmy Xiaomi — 46. Jeden punkt. Mieszane stawki, które Artificial Analysis publikuje dla tych dwóch — mieszanka 7:2:1 trafień w pamięć podręczną, danych wejściowych i danych wyjściowych — wynoszą 3,08 USD dla GPT-5.6 Sol i 0,18 USD dla MiMo-V2.6-Pro. Dwudziestodwukrotnie więcej pieniędzy za jeden punkt indeksu to cały kształt tego starcia, a ciekawe pytanie nie brzmi, czy ten punkt jest tego wart. Brzmi: w których konkretnie żądaniach ten punkt tkwi, ponieważ agregat ci tego nie powie.

To, co sprawia, że ta para w ogóle zasługuje na porównanie, to fakt, że nie należą one w oczywisty sposób do tej samej kategorii. GPT-5.6 Sol to zastrzeżony model frontier z trybem wieloagentowym i odpowiadającym mu cennikiem. Xiaomi MiMo-V2.6-Pro to objęty licencją MIT checkpoint z otwartymi wagami, który ukazał się 22 września 2026 r., a repozytoria uczenia ze wzmocnieniem trafiły dzień wcześniej; jego cena jest ustalona tak, jakby to był model średniej klasy. To, że otwarty model o bilionie parametrów plasuje się w granicach jednego punktu od flagowego modelu OpenAI, jest wiadomością. Co zrobisz z tym faktem, to osobna decyzja.

Te dwa modele, mówiąc wprost

GPT-5.6 Sol został wydany 9 lipca 2026 r. jako flagowy model rodziny GPT-5.6, obok modeli Terra i Luna, a OpenAI kieruje do niego sam gpt-5.6 jako alias. Jest to model własnościowy, przyjmuje dane wejściowe w postaci tekstu i obrazów, a zwraca tekst, obsługuje poziom wysiłku rozumowania od none do xhigh oraz tryb „ultra” z wieloma agentami, zarezerwowany wyłącznie dla Sol, a jego punkt odcięcia wiedzy przypada na luty 2026 r. Jego cena katalogowa to 4,00 USD za milion tokenów wejściowych i 20,00 USD za milion tokenów wyjściowych w oficjalnym API OpenAI, przy czym wejście z pamięci podręcznej kosztuje 0,50 USD, a okno kontekstu wynosi 1 mln tokenów. Artificial Analysis zmierzyło prędkość 77,3 tokena wyjściowego na sekundę i 127,21 sekundy do pierwszego tokenu, przy koszcie 3464,84 USD za uruchomienie pełnego indeksu.

Xiaomi MiMo-V2.6-Pro to rzadki model mieszaniny ekspertów o łącznej liczbie 1,02 biliona parametrów i 42 miliardach aktywowanych parametrów na token, z oknem kontekstowym o rozmiarze 1 mln tokenów i natywną multimodalnością w zakresie tekstu, obrazu, wideo i audio. Xiaomi utrzymało ceny z poprzedniej generacji, zamiast podnosić ceny dla nowego checkpointu, dlatego model tej wielkości jest wyceniany na 0,43 USD i 0,87 USD za milion tokenów, z 99% zniżką na pamięć podręczną. Artificial Analysis zmierzyło 134,3 tokenów wyjściowych na sekundę, 2,15 sekundy do pierwszego tokenu i 206,66 USD na uruchomienie indeksu — 0,13 USD na zadanie.

• Wagi — MiMo-V2.6-Pro na licencji MIT i dostępny do pobrania; GPT-5.6 Sol zastrzeżony, tylko przez API

• Parametry — MiMo-V2.6-Pro 1,02 bln łącznie / 42 mld aktywnych; GPT-5.6 Sol nieujawnione

• Kontekst — 1 mln tokenów w obu; GPT-5.6 Sol ogranicza wyjście do 128K

• Modalność — MiMo-V2.6-Pro przyjmuje tekst, obraz, wideo i dźwięk; opublikowany zakres danych wejściowych GPT-5.6 Sol to tekst i obraz

• Cena katalogowa — MiMo-V2.6-Pro 0,43 USD / 0,87 USD za 1 mln; GPT-5.6 Sol 4,00 USD / 20,00 USD, buforowane dane wejściowe 0,50 USD

• Stawka mieszana — MiMo-V2.6-Pro 0,18 USD za 1 mln; GPT-5.6 Sol 3,08 USD

• Zmierzony koszt na zadanie indeksowania — MiMo-V2.6-Pro 0,13 USD; GPT-5.6 Sol 3464,84 USD za pełny indeks

• Szybkość — MiMo-V2.6-Pro 134,3 tokenów wyjściowych na sekundę; GPT-5.6 Sol 77,3

• Czas do pierwszego tokenu — MiMo-V2.6-Pro 2,15 sekundy; GPT-5.6 Sol 127,21 sekundy

• Kontrola rozumowania — GPT-5.6 Sol udostępnia poziomy brak/niski/średni/wysoki/xwysoki/maksymalny oraz ultra tryb wieloagentowy; MiMo-V2.6-Pro nie publikuje równoważnej drabinki poziomów

A two-column scoreboard titled MiMo-V2.6-Pro vs GPT-5.6 Sol, subtitled One index point on the composite, twenty-two times the blended rate. The left column, Xiaomi MiMo-V2.6-Pro, reads Intelligence Index v4.3.2 46; list price $0.43 / $0.87 per 1M; blended rate per 1M $0.18; cost per index task $0.13; speed 134.3 tokens per second; time to first token 2.15 s. The right column, GPT-5.6 Sol (max), reads Intelligence Index v4.3.2 47; list price $4.00 / $20.00 per 1M; blended rate per 1M $3.08; cost to run the index $3,464.84; speed 77.3 tokens per second; time to first token 127.21 s. A footer notes both scores are Artificial Analysis Intelligence Index v4.3.2 read 22 September 2026. The OrcaRouter logo is composited in the bottom-right corner.

Gdzie tak naprawdę znajduje się ten jeden punkt

Różnica jednego punktu w kompozycie dziesięciu ewaluacji to błąd zaokrąglenia na poziomie agregatu i przepaść na poziomie komponentu. Zestaw obejmuje AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience i AA-LCR v1.1 — rozumowanie, wiedza, matematyka i kodowanie — i żaden z dostawców nie publikuje rozbicia na poszczególne ewaluacje dla tych dwóch modeli. Ten brak jest realnym ograniczeniem po obu stronach tej strony i warto o tym powiedzieć, zamiast maskować to kompozytem.

To, co jest oficjalnie udokumentowane, ma charakter kierunkowy i wskazuje na pracę agentową jako miejsce, w którym koncentruje się luka. Materiały premierowe GPT-5.6 Sol podają 53,6% w Agents' Last Exam, długotrwałej ewaluacji profesjonalnych przepływów pracy obejmującej 55 dziedzin, którą OpenAI określiło jako nowy rekord; 64,6% w SWE-Bench Pro; 88,8% w Terminal-Bench 2.1; oraz 62,6% w OSWorld 2.0 w zakresie obsługi komputera. Jego wynik w BrowseComp wynoszący 90,4% wzrasta do 92,2% w trybie ultra, który uruchamia cztery równoległe podagenty przy około czterokrotnym koszcie tokenów. To dane producenta uzyskane na narzędziach testowych producenta i do każdej z nich stosuje się zwykłe zastrzeżenie — ale to właśnie kategorie, w których jednopunktowa różnica w wyniku złożonym najprawdopodobniej nie rozkłada się równomiernie, a Xiaomi nie publikuje porównywalnego rozbicia wyników dla agentów dla MiMo-V2.6-Pro.

Przeciwwagą jest to, że własne liczby dostawcy MiMo-V2.6-Pro dotyczą zupełnie innej rodziny zadań. Xiaomi podaje, że w trakcie swojego przebiegu uczenia ze wzmocnieniem model przeszedł z 58,4 na 72,57 w DeepSWE v1.1, oceniany za pomocą mini-swe-agent metodą średniej z trzech na własnym narzędziu oceniającym Xiaomi i nigdy nie zgłoszony do publicznego rankingu. Zestawienie 72,57 z jakąkolwiek wartością Sol byłoby wymyślaniem porównania, które nie istnieje. Jedynymi liczbami, na których oba modele zostały faktycznie przetestowane przez tego samego ewaluatora, są 46 i 47.

Porównanie kosztów, zrobione jak należy

Arytmetyka kosztu na token zaniża tę lukę, ponieważ oba modele nie zużywają tej samej liczby tokenów do wykonania tej samej pracy. Uczciwą pojedynczą liczbą jest to, co Artificial Analysis zmierzyło, uruchamiając swój pełny indeks dla każdego z nich: 206,66 USD dla MiMo-V2.6-Pro i 3 464,84 USD dla GPT-5.6 Sol. Ten sam zestaw testów, to samo środowisko testowe, mierzone identycznie — 16,8-krotna różnica na kontrolowanym zestawie zadań, która już uwzględnia fakt, że Sol jest modelem rozumującym emitującym tokeny, aby myśleć.

Teraz pętla produkcyjna. Przebieg agenta w 30 krokach, odczytujący 200 000 tokenów kontekstu na krok i zapisujący 2000 tokenów na krok, to 6 milionów tokenów wejściowych i 60 000 tokenów wyjściowych na przebieg. W przypadku GPT-5.6 Sol według cennika daje to 24,00 USD za wejście i 1,20 USD za wyjście — 25,20 USD na przebieg przed buforowaniem. W przypadku MiMo-V2.6-Pro to 2,58 USD i 0,05 USD — 2,63 USD. Buforowanie zmienia oba przypadki: buforowane wejście Sol w cenie 0,50 USD w zestawieniu z 99% zniżką MiMo-V2.6-Pro wciąż sprawia, że drogi model jest o rząd wielkości droższy w pętli o dużym udziale kontekstu, a właśnie taką pętlę wykonuje agent.

Połowa porównania dotycząca opóźnienia jest bardziej wymowna niż połowa dotycząca ceny i poświęca się jej mniej uwagi. GPT-5.6 Sol zmierzono 127,21 sekundy do pierwszego tokenu. MiMo-V2.6-Pro zmierzono 2,15. To pięćdziesięciodziewięciokrotna różnica i to właśnie ta liczba decyduje, czy produkt interaktywny jest w ogóle możliwy. Sol przy maksymalnym wysiłku jest w praktyce modelem wsadowym — zgłaszasz zadanie, czekasz, wracasz. Jeśli twoja aplikacja blokuje się na pierwszym tokenie, wybór został już dokonany za ciebie, niezależnie od tego, co mówi indeks.

Screenshot of the Artificial Analysis model page for Xiaomi MiMo-V2.6-Pro, captured 22 September 2026. The header reads 46 Artificial Analysis Intelligence Index, ranked first of 114 in its class; 134.3 output tokens per second, ranked eleventh of 114; $0.435 input and $0.87 output per 1M tokens with a 99% cache discount; $0.13 cost per Intelligence Index task, ranked twelfth of 114; and 140M output tokens from the Intelligence Index. Technical specifications list reasoning Yes, input modality text, image, speech and video, output modality text, a 1M-token context window, 1.0T total parameters, 42B active parameters, an MIT licence and Hugging Face model weights, under a breadcrumb reading Xiaomi, Open weights model, Released September 2026. A comparison summary notes it cost $206.66 to evaluate MiMo-V2.6-Pro on the Intelligence Index.

Jeden klawisz, oba pasy

Oba modele są dostępne przez pojedynczy klucz OrcaRouter w cenie katalogowej dostawcy z 0% marży — GPT-5.6 Sol jako openai/gpt-5.6-sol, co jest naszą własną trasą do niego. Ponieważ przekazujemy cenę katalogową dostawcy bez marży, zmiana ceny po którejkolwiek ze stron jest widoczna po naszej stronie tego samego dnia, zamiast czekać na ponowną wycenę.

DSL routingu sprawia, że to zestawienie staje się interesujące, a nie tylko wygodne. Dwa modele różniące się o jeden punkt w indeksie, z których jeden kosztuje szesnaście razy więcej na zadanie, nie są alternatywami, między którymi trzeba wybierać — to konfiguracja dwupasmowa. Większość obciążenia kieruj na tani pas, a ogon kieruj na drogi na podstawie zdefiniowanego przez siebie predykatu: żądania, które nie przechodzą autokontroli, żądania spełniające regułę złożoności, żądania, których koszt awarii przewyższa koszt tokenów na tyle, że ten ruch jest tanim ubezpieczeniem. Przełączanie awaryjne to druga połowa tego rozwiązania. Sol jest szeroko obsługiwany; MiMo-V2.6-Pro zadebiutował w tym tygodniu i gdy Artificial Analysis go uchwyciło, był wymieniony tylko przez jednego dostawcę API, co stanowi wąską ścieżkę dla modelu, który umieściłbyś w ścieżce produkcyjnej. Router, który potrafi przełączyć się awaryjnie, sprawia, że tani pas jest bezpieczny do wdrożenia, a także sprawia, że drogi pas staje się opcjonalny, a nie obowiązkowy.

Screenshot of the OrcaRouter model page for GPT-5.6 Sol, captured 22 September 2026. The page lists the model id openai/gpt-5.6-sol, by OpenAI, dated 2026-07-09, marked FEATURED, with Vision, Tools, JSON and Reasoning badges, a 1M-token context window, a maximum output of 128K tokens, input of text, image and file with text output, $4.00 per 1M input tokens and $20.00 per 1M output tokens, 40.2M tokens of traffic over seven days, and a code sample calling the model through the OpenAI-compatible base URL api.orcarouter.ai/v1.

Który wybrać

Wybierz GPT-5.6 Sol, gdy koszt porażki w zadaniu przyćmiewa koszt tokenów — długoterminowa praca agentowa z realnymi skutkami ubocznymi, automatyzacja korzystania z komputera, użycie narzędzi, gdzie błędne wywołanie jest gorsze niż wolne, cokolwiek, gdzie już płacisz człowiekowi za sprawdzanie wyników. Przebieg indeksu za 3464,84 USD nie jest powodem, by tego unikać; to cena tego poziomu, a ten poziom istnieje nie bez powodu.

Wybierz MiMo-V2.6-Pro, gdy ograniczeniem jest wolumen, gdy obciążenie jest mocno kontekstowe i powtarzalne, gdy potrzebujesz opóźnienia pierwszego tokenu na tyle niskiego, by człowiek mógł poczekać, gdy chcesz mieć wagi we własnej infrastrukturze — licencja MIT pozwala na wdrożenie komercyjne, modyfikację i dalsze trenowanie — albo gdy ekonomika jednostkowa działa tylko przy jednej piątej centa za tysiąc tokenów. Jego 134,3 tokena na sekundę czyni go użytecznym interaktywnie w sposób, w jaki większość otwartych modeli o bilionie parametrów nie jest, i to jest możliwość, a nie zniżka.

Wybierz oba, jeśli masz router, bo szczera odpowiedź na pytanie „który jest lepszy” brzmi: jednopunktowa różnica w wyniku złożonym to nie wyrok — to pomiar tego, jak bardzo są podobne średnio i jak bardzo prawdopodobnie różnią się na ogonie rozkładu. Trybem awarii, którego należy unikać, jest standaryzacja na tanim modelu, bo stosunek wynosi 22x, odkrycie w trzecim miesiącu, że pewna klasa żądań wymaga tego drogiego, i brak ścieżki, by tam je skierować. Lustrzanym błędem jest płacenie stawek Sol za zadanie streszczania, które model o indeksie 46 kończy identycznie. Żaden z nich nie jest problemem modelu. Oba są konfiguracją, a konfiguracja to ta część, którą możesz zmienić w wtorkowe popołudnie.

OrcaRouter udostępnia ponad 200 modeli za jednym punktem końcowym zgodnym z OpenAI w cenie katalogowej dostawcy z 0% marży, więc zmiana ceny przez dostawcę jest widoczna tego samego dnia.