Wygenerowana karta tytułowa z napisem MiMo-V2.6-Pro vs GPT-5.6 Sol, z podtytułem „15-krotnie wyższy koszt na zadanie za jeden punkt indeksu” pod spodem oraz trzema płaskimi ikonami liniowymi nad tytułem sugerującymi licznik kosztów, kartę wyników i datowane powiadomienie. Logo OrcaRouter jest wkomponowane w prawym dolnym rogu.
Guides & Insights

MiMo-V2.6-Pro kontra GPT-5.6 Sol: Jeden punkt indeksu kosztuje piętnaście razy więcej na zadanie

Autor

Elias Hawthorne

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

W Artificial Analysis Intelligence Index v4.3.2, według odczytu z 25 września 2026 r., GPT-5.6 Sol przy maksymalnym wysiłku uzyskuje 47 punktów, a MiMo-V2.6-Pro firmy Xiaomi — 46. Jeden punkt. Liczbą, która faktycznie je dzieli, nie jest wynik ani stawka za token — jest to koszt pojedynczego zadania w indeksie, który Artificial Analysis podaje jako 1,99 USD dla GPT-5.6 Sol i 0,13 USD dla MiMo-V2.6-Pro. Piętnaście razy więcej pieniędzy za jeden punkt. A na moment tego odczytu własna strona ewaluatora poświęcona temu modelowi zawiera komunikat o wycofaniu, ponieważ zastąpił go GPT-6 Sol.

Xiaomi opublikowało wagi i raport techniczny MiMo-V2.6-Pro 21 września 2026, cztery dni przed tym opracowaniem; OpenAI udostępniło GPT-5.6 Sol 9 lipca 2026. Oba powyższe fakty pojawiły się od czasu, gdy ostatnio pisano o tym zestawieniu, i ciągną w przeciwnych kierunkach. Komunikat o wycofaniu mówi, że porównanie dotyczy modelu, od którego OpenAI już odeszło. Wskaźnik na zadanie mówi, że to, co wyglądało na błąd zaokrąglenia, gdy oba modele wyceniano według ceny katalogowej, przy rzeczywistym obciążeniu przesądza o całej decyzji. To, który z tych dwóch czynników ma znaczenie, zależy od tego, czy kupujesz model, czy go zastępujesz.

Co teraz mówią te dwie strony

GPT-5.6 Sol został wydany 9 lipca 2026 r. jako flagowy model rodziny GPT-5.6. Jego cena katalogowa to 4,00 USD za milion tokenów wejściowych i 20,00 USD za milion tokenów wyjściowych w API first-party OpenAI, z 90-procentową zniżką za pamięć podręczną, a strona odnotowuje 90 milionów tokenów wyjściowych wygenerowanych w ramach przebiegu indeksu wobec mediany 88 milionów. Osiągnął 73 tokeny wyjściowe na sekundę, co ta sama strona uznaje za szybsze od średniej wobec mediany 72 t/s. Jego wpis w indeksie znajduje się na 19. miejscu spośród 210 modeli w swojej klasie.

Xiaomi MiMo-V2.6-Pro to rzadki punkt kontrolny mieszaniny ekspertów przy 1,02 biliona parametrów łącznie, z czego 42 miliardy są aktywne, na licencji MIT, z oknem kontekstowym wynoszącym 1 mln tokenów oraz wejściem tekstowym, obrazowym, głosowym i wideo, a wyjściem tekstowym. Jego cena katalogowa to 0,43 USD i 0,87 USD za milion tokenów z 99-procentową zniżką na pamięć podręczną — jedną dziesiątą stawki wejściowej Sol i jedną dwudziestą trzecią jego stawki wyjściowej. Wygenerował 140 milionów tokenów wyjściowych podczas uruchomienia indeksu i odnotował 43,6 tokena wyjściowego na sekundę, co jego strona opisuje jako wyraźnie wolne na tle mediany 67,1 t/s.

• Koszt zadania indeksowania — MiMo-V2.6-Pro 0,13 USD; GPT-5.6 Sol 1,99 USD — różnica wynosi 15× • Cena katalogowa — MiMo-V2.6-Pro 0,43 USD / 0,87 USD za 1 mln; GPT-5.6 Sol 4,00 USD / 20,00 USD • Rabat za pamięć podręczną — MiMo-V2.6-Pro 99%; GPT-5.6 Sol 90% • Tokeny wyjściowe w przebiegu indeksowania — MiMo-V2.6-Pro 140 mln; GPT-5.6 Sol 90 mln • Prędkość generowania wyjścia — MiMo-V2.6-Pro 43,6 t/s, wobec mediany 67,1; GPT-5.6 Sol 73 t/s, wobec mediany 72 • Kontekst i wagi — MiMo-V2.6-Pro 1 mln i licencja MIT; GPT-5.6 Sol 1 mln i model własnościowy

A two-column scoreboard titled MiMo-V2.6-Pro vs GPT-5.6 Sol - the scoreboard, subtitled Fifteen times the cost per index task, for one index point. The left column, Xiaomi MiMo-V2.6-Pro, reads Intelligence Index v4.3.2 46; cost per index task $0.13; list price $0.43 / $0.87 per 1M; cache discount 99%; output speed 43.6 tokens per second; 140M output tokens on the index run; 1M context. The right column, GPT-5.6 Sol (max), reads Intelligence Index v4.3.2 47; cost per index task $1.99; list price $4.00 / $20.00 per 1M; cache discount 90%; output speed 73 tokens per second; 90M output tokens; 1M context, and carries a tag reading Proprietary - deprecated. A footer line reads Artificial Analysis Intelligence Index v4.3.2, read 25 September 2026, and a warning line below it notes that the evaluator's GPT-5.6 Sol page now carries a deprecation notice and that it is superseded by GPT-6 Sol (max). The OrcaRouter logo is composited in the bottom-right corner.

To ostrzeżenie o wycofaniu jest tą bardziej istotną linią.

Artificial Analysis otwiera teraz stronę GPT-5.6 Sol z komunikatem w ramce: „Ten model jest przestarzały. Kontynuujemy testy wydajności wyłącznie dla domyślnego obciążenia 10 tys. tokenów wejściowych”, po którym następuje zdanie, że OpenAI wprowadziło nowszy model, GPT-6 Sol (max), i że to jego należy rozważyć w zamian. Wartość 47 w indeksie jest więc odczytem modelu, który nie jest już tym, co należy kupować. To nie czyni odczytu błędnym — został zmierzony na tym samym indeksie, tego samego dnia, przy tym samym ustawieniu wysiłku co w przypadku 46 — ale zmienia to, czemu służy porównanie. To już nie jest pytanie „którego flagowca powinienem używać”. To pytanie „ile kosztuje szczyt rankingu modeli własnościowych, w momencie, gdy był na szczycie”.

To przeformułowanie ma większe znaczenie, niż się wydaje, ponieważ ostrzeżenia o wycofaniu na stronach ewaluatorów to jedno z niewielu miejsc, w których tempo rozwoju produktów dostawcy ujawnia się jako zmiana danych, a nie komunikat prasowy. Wynik jest zamrożony; model nie jest oferowany. Cokolwiek zbudujesz w oparciu o 47, zbudujesz w oparciu o migawkę.

Screenshot of the Artificial Analysis model page for Xiaomi MiMo-V2.6-Pro, captured 25 September 2026. The header shows an Openweights model badge with Released September 2026, 46 on the Artificial Analysis Intelligence Index, 43.6 output tokens per second, $0.43 input and $0.87 output per 1M tokens with a 99% cache discount, and $0.13 per task to evaluate on the Intelligence Index; the summary paragraph calls the model notably slow, and the verbosity line shows 140M output tokens generated on the index run against a median of 140M.

Dlaczego to liczba przypadająca na zadanie jest tą, względem której należy modelować

Stawki za token pochlebiają tanim modelom i wprowadzają w błąd w przypadku obciążeń, które nie są neutralne pod względem tokenów. Koszt zadania indeksowego to inny pomiar: to, ile ewaluator faktycznie wydał, aby uzyskać jedną odpowiedź z każdego modelu, co uwzględnia zarówno stawkę, jak i liczbę tokenów, które model zdecydował się wyemitować. MiMo-V2.6-Pro emituje więcej tokenów niż Sol w przebiegu indeksowym — 140 milionów wobec 90 milionów, około 1,6 razy więcej — a mimo to kosztuje 0,13 USD za zadanie wobec 1,99 USD. Przewaga stawki jest około dwudziestotrzykrotna na wyjściu; kara za rozwlekłość wynosi 1,6×; iloczyn to piętnastokrotna różnica kosztu na zadanie.

To jest arytmetyka, na której powinien opierać się model kosztów, i to jest arytmetyka, która staje się niewidoczna, jeśli porównasz 0,87 USD z 20,00 USD i na tym poprzestaniesz. Mówi też, co podważyłoby ten wniosek. Jeśli w Twoim obciążeniu dominują bardzo krótkie wyniki, liczba tokenów Sol spada w stronę Twojej, a dwudziestotrzykrotna różnica stawek wykonuje większość pracy, więc rzeczywisty mnożnik zbliża się do różnicy stawek, a nie oddala się od niej. Jeśli w Twoim obciążeniu dominują długie ślady rozumowania, 1,6× większa gadatliwość MiMo-V2.6-Pro kumuluje się i 0,13 USD staje się górnym ograniczeniem, a nie szacunkiem. Opublikowana liczba to pomiar kształtu jednego benchmarku, a nie oferta, którą można przekazać działowi finansowemu.

Linia opóźnienia jest uczciwą przeciwwagą

Przy wydajności 43,6 tokena wyjściowego na sekundę MiMo-V2.6-Pro jest wolniejszy niż GPT-5.6 Sol zmierzony tego samego dnia na poziomie 73 — i wolniejszy od modeli, z którymi zestawia go jego własna strona, których mediana wynosi 67,1. Jego strona mówi o tym wprost: „wyraźnie wolny”. Dla potoku wsadowego to koszt przepustowości, który można wycenić. Dla interaktywnego agenta to decyzja produktowa, a bycie piętnaście razy tańszym w przeliczeniu na zadanie nie czyni wolnego modelu szybkim. Jeśli twoim ograniczeniem jest budżet na turę, a nie miesięczny rachunek, znaczenie ma stosunek 43,6 do 73 — i MiMo-V2.6-Pro go przegrywa.

Gdzie to trafia na routerze

Sensowna forma tego zestawienia nie polega na „wybierz jedno”. Chodzi o to, że oba modele odpowiadają na ten sam indeks, a ewaluator publikuje koszt na zadanie dla każdego z nich, więc podział można oprzeć na zmierzonym koszcie, a nie na poziomach oferowanych przez dostawcę. W OrcaRouter katalog obejmuje ponad 200 modeli za jednym kluczem w cenie katalogowej każdego dostawcy z 0% marży — obniżka ceny przez dostawcę trafia na Twoją fakturę tego samego dnia, bez konieczności renegocjowania drugiej umowy — a DSL routingu pozwala obciążeniu kierować tanie, masowe wywołania do jednego modelu, a trudne do innego według zadania, a nie według marki. Automatyczne przełączanie awaryjne obejmuje przypadek, w którym tańsza trasa jest zdegradowana. Xiaomi MiMo-V2.6-Pro nie ma na naszych trasach — nie umieszczamy modelu na liście, zanim dostawca go wdroży — więc w przypadku tej strony porównania uczciwą odpowiedzią jest własne API dostawcy albo ta platforma hostowana, z którą już masz relację.

Screenshot of the Artificial Analysis model page for GPT-5.6 Sol (max), captured 25 September 2026. A boxed banner at the top reads This model is deprecated, that benchmarking continues only for the default 10k input token workload, and that OpenAI has launched a newer model, GPT-6 Sol (max), which should be considered instead. Below it the header shows an OpenAI badge, Intelligence rank 19 of 210, Speed 83 of 210, Cost 67 of 210, Verbosity 50 of 210, 47 on the Intelligence Index, $4.00 input and $20.00 output per 1M tokens, a 90% cache discount, $1.99 per task to evaluate on the Intelligence Index, and a line reading At 73 tokens per second, GPT-5.6 Sol (max) is faster than average (72).

Co zrobić z tym do przyszłego tygodnia

Dwie rzeczy zmieniły się 25 września 2026 i tylko jedna z nich dotyczy ceny. GPT-5.6 Sol ma adnotację o wycofaniu w indeksie, w którym zmierzono go na 47, co wycofuje go jako decyzję zakupową i pozostawia jako punkt odniesienia w benchmarku. MiMo-V2.6-Pro jest mierzony na 0,13 USD za zadanie indeksowe w porównaniu z 1,99 USD w przypadku Sol, co daje piętnaście razy więcej pieniędzy za jeden punkt indeksu — a przy tym osiąga 43,6 tokena na sekundę, co jest wolniejsze niż model, z którym jest porównywany, i wolniejsze niż mediana jego własnej klasy. Skonfrontuj obie liczby z własnym ruchem, zanim któraś z nich stanie się decyzją: koszt na zadanie to pomiar, a nie stawka, a opóźnienie to pomiar, a nie opinia. Jeśli Twoje wyniki są krótkie i nieinteraktywne, argument za otwartym checkpointem jest silniejszy, niż sugeruje różnica w indeksie. Jeśli Twoje wyniki są długie lub Twoi użytkownicy czekają, piętnastokrotna oszczędność kupuje Ci wolniejszy produkt, a to kompromis, który może wycenić tylko Twoje obciążenie.

Porównane w tym artykule1

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie