
MiMo-V2.6-Pro kontra GPT-5.6 Sol: Jeden punkt indeksu kosztuje piętnaście razy więcej na zadanie
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 36 tok/s
- openaiNOWOŚĆOpenAI: GPT-6 Luna2026-09-2237Inteligencja
- openaiNOWOŚĆOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- grokNOWOŚĆGrok 4.72026-09-2146Inteligencja
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów · 181 tok/s
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 1277 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
W Artificial Analysis Intelligence Index v4.3.2, według odczytu z 25 września 2026 r., GPT-5.6 Sol przy maksymalnym wysiłku uzyskuje 47 punktów, a MiMo-V2.6-Pro firmy Xiaomi — 46. Jeden punkt. Liczbą, która faktycznie je dzieli, nie jest wynik ani stawka za token — jest to koszt pojedynczego zadania w indeksie, który Artificial Analysis podaje jako 1,99 USD dla GPT-5.6 Sol i 0,13 USD dla MiMo-V2.6-Pro. Piętnaście razy więcej pieniędzy za jeden punkt. A na moment tego odczytu własna strona ewaluatora poświęcona temu modelowi zawiera komunikat o wycofaniu, ponieważ zastąpił go GPT-6 Sol.
Xiaomi opublikowało wagi i raport techniczny MiMo-V2.6-Pro 21 września 2026, cztery dni przed tym opracowaniem; OpenAI udostępniło GPT-5.6 Sol 9 lipca 2026. Oba powyższe fakty pojawiły się od czasu, gdy ostatnio pisano o tym zestawieniu, i ciągną w przeciwnych kierunkach. Komunikat o wycofaniu mówi, że porównanie dotyczy modelu, od którego OpenAI już odeszło. Wskaźnik na zadanie mówi, że to, co wyglądało na błąd zaokrąglenia, gdy oba modele wyceniano według ceny katalogowej, przy rzeczywistym obciążeniu przesądza o całej decyzji. To, który z tych dwóch czynników ma znaczenie, zależy od tego, czy kupujesz model, czy go zastępujesz.
Co teraz mówią te dwie strony
GPT-5.6 Sol został wydany 9 lipca 2026 r. jako flagowy model rodziny GPT-5.6. Jego cena katalogowa to 4,00 USD za milion tokenów wejściowych i 20,00 USD za milion tokenów wyjściowych w API first-party OpenAI, z 90-procentową zniżką za pamięć podręczną, a strona odnotowuje 90 milionów tokenów wyjściowych wygenerowanych w ramach przebiegu indeksu wobec mediany 88 milionów. Osiągnął 73 tokeny wyjściowe na sekundę, co ta sama strona uznaje za szybsze od średniej wobec mediany 72 t/s. Jego wpis w indeksie znajduje się na 19. miejscu spośród 210 modeli w swojej klasie.
Xiaomi MiMo-V2.6-Pro to rzadki punkt kontrolny mieszaniny ekspertów przy 1,02 biliona parametrów łącznie, z czego 42 miliardy są aktywne, na licencji MIT, z oknem kontekstowym wynoszącym 1 mln tokenów oraz wejściem tekstowym, obrazowym, głosowym i wideo, a wyjściem tekstowym. Jego cena katalogowa to 0,43 USD i 0,87 USD za milion tokenów z 99-procentową zniżką na pamięć podręczną — jedną dziesiątą stawki wejściowej Sol i jedną dwudziestą trzecią jego stawki wyjściowej. Wygenerował 140 milionów tokenów wyjściowych podczas uruchomienia indeksu i odnotował 43,6 tokena wyjściowego na sekundę, co jego strona opisuje jako wyraźnie wolne na tle mediany 67,1 t/s.
• Koszt zadania indeksowania — MiMo-V2.6-Pro 0,13 USD; GPT-5.6 Sol 1,99 USD — różnica wynosi 15× • Cena katalogowa — MiMo-V2.6-Pro 0,43 USD / 0,87 USD za 1 mln; GPT-5.6 Sol 4,00 USD / 20,00 USD • Rabat za pamięć podręczną — MiMo-V2.6-Pro 99%; GPT-5.6 Sol 90% • Tokeny wyjściowe w przebiegu indeksowania — MiMo-V2.6-Pro 140 mln; GPT-5.6 Sol 90 mln • Prędkość generowania wyjścia — MiMo-V2.6-Pro 43,6 t/s, wobec mediany 67,1; GPT-5.6 Sol 73 t/s, wobec mediany 72 • Kontekst i wagi — MiMo-V2.6-Pro 1 mln i licencja MIT; GPT-5.6 Sol 1 mln i model własnościowy

To ostrzeżenie o wycofaniu jest tą bardziej istotną linią.
Artificial Analysis otwiera teraz stronę GPT-5.6 Sol z komunikatem w ramce: „Ten model jest przestarzały. Kontynuujemy testy wydajności wyłącznie dla domyślnego obciążenia 10 tys. tokenów wejściowych”, po którym następuje zdanie, że OpenAI wprowadziło nowszy model, GPT-6 Sol (max), i że to jego należy rozważyć w zamian. Wartość 47 w indeksie jest więc odczytem modelu, który nie jest już tym, co należy kupować. To nie czyni odczytu błędnym — został zmierzony na tym samym indeksie, tego samego dnia, przy tym samym ustawieniu wysiłku co w przypadku 46 — ale zmienia to, czemu służy porównanie. To już nie jest pytanie „którego flagowca powinienem używać”. To pytanie „ile kosztuje szczyt rankingu modeli własnościowych, w momencie, gdy był na szczycie”.
To przeformułowanie ma większe znaczenie, niż się wydaje, ponieważ ostrzeżenia o wycofaniu na stronach ewaluatorów to jedno z niewielu miejsc, w których tempo rozwoju produktów dostawcy ujawnia się jako zmiana danych, a nie komunikat prasowy. Wynik jest zamrożony; model nie jest oferowany. Cokolwiek zbudujesz w oparciu o 47, zbudujesz w oparciu o migawkę.

Dlaczego to liczba przypadająca na zadanie jest tą, względem której należy modelować
Stawki za token pochlebiają tanim modelom i wprowadzają w błąd w przypadku obciążeń, które nie są neutralne pod względem tokenów. Koszt zadania indeksowego to inny pomiar: to, ile ewaluator faktycznie wydał, aby uzyskać jedną odpowiedź z każdego modelu, co uwzględnia zarówno stawkę, jak i liczbę tokenów, które model zdecydował się wyemitować. MiMo-V2.6-Pro emituje więcej tokenów niż Sol w przebiegu indeksowym — 140 milionów wobec 90 milionów, około 1,6 razy więcej — a mimo to kosztuje 0,13 USD za zadanie wobec 1,99 USD. Przewaga stawki jest około dwudziestotrzykrotna na wyjściu; kara za rozwlekłość wynosi 1,6×; iloczyn to piętnastokrotna różnica kosztu na zadanie.
To jest arytmetyka, na której powinien opierać się model kosztów, i to jest arytmetyka, która staje się niewidoczna, jeśli porównasz 0,87 USD z 20,00 USD i na tym poprzestaniesz. Mówi też, co podważyłoby ten wniosek. Jeśli w Twoim obciążeniu dominują bardzo krótkie wyniki, liczba tokenów Sol spada w stronę Twojej, a dwudziestotrzykrotna różnica stawek wykonuje większość pracy, więc rzeczywisty mnożnik zbliża się do różnicy stawek, a nie oddala się od niej. Jeśli w Twoim obciążeniu dominują długie ślady rozumowania, 1,6× większa gadatliwość MiMo-V2.6-Pro kumuluje się i 0,13 USD staje się górnym ograniczeniem, a nie szacunkiem. Opublikowana liczba to pomiar kształtu jednego benchmarku, a nie oferta, którą można przekazać działowi finansowemu.
Linia opóźnienia jest uczciwą przeciwwagą
Przy wydajności 43,6 tokena wyjściowego na sekundę MiMo-V2.6-Pro jest wolniejszy niż GPT-5.6 Sol zmierzony tego samego dnia na poziomie 73 — i wolniejszy od modeli, z którymi zestawia go jego własna strona, których mediana wynosi 67,1. Jego strona mówi o tym wprost: „wyraźnie wolny”. Dla potoku wsadowego to koszt przepustowości, który można wycenić. Dla interaktywnego agenta to decyzja produktowa, a bycie piętnaście razy tańszym w przeliczeniu na zadanie nie czyni wolnego modelu szybkim. Jeśli twoim ograniczeniem jest budżet na turę, a nie miesięczny rachunek, znaczenie ma stosunek 43,6 do 73 — i MiMo-V2.6-Pro go przegrywa.
Gdzie to trafia na routerze
Sensowna forma tego zestawienia nie polega na „wybierz jedno”. Chodzi o to, że oba modele odpowiadają na ten sam indeks, a ewaluator publikuje koszt na zadanie dla każdego z nich, więc podział można oprzeć na zmierzonym koszcie, a nie na poziomach oferowanych przez dostawcę. W OrcaRouter katalog obejmuje ponad 200 modeli za jednym kluczem w cenie katalogowej każdego dostawcy z 0% marży — obniżka ceny przez dostawcę trafia na Twoją fakturę tego samego dnia, bez konieczności renegocjowania drugiej umowy — a DSL routingu pozwala obciążeniu kierować tanie, masowe wywołania do jednego modelu, a trudne do innego według zadania, a nie według marki. Automatyczne przełączanie awaryjne obejmuje przypadek, w którym tańsza trasa jest zdegradowana. Xiaomi MiMo-V2.6-Pro nie ma na naszych trasach — nie umieszczamy modelu na liście, zanim dostawca go wdroży — więc w przypadku tej strony porównania uczciwą odpowiedzią jest własne API dostawcy albo ta platforma hostowana, z którą już masz relację.

Co zrobić z tym do przyszłego tygodnia
Dwie rzeczy zmieniły się 25 września 2026 i tylko jedna z nich dotyczy ceny. GPT-5.6 Sol ma adnotację o wycofaniu w indeksie, w którym zmierzono go na 47, co wycofuje go jako decyzję zakupową i pozostawia jako punkt odniesienia w benchmarku. MiMo-V2.6-Pro jest mierzony na 0,13 USD za zadanie indeksowe w porównaniu z 1,99 USD w przypadku Sol, co daje piętnaście razy więcej pieniędzy za jeden punkt indeksu — a przy tym osiąga 43,6 tokena na sekundę, co jest wolniejsze niż model, z którym jest porównywany, i wolniejsze niż mediana jego własnej klasy. Skonfrontuj obie liczby z własnym ruchem, zanim któraś z nich stanie się decyzją: koszt na zadanie to pomiar, a nie stawka, a opóźnienie to pomiar, a nie opinia. Jeśli Twoje wyniki są krótkie i nieinteraktywne, argument za otwartym checkpointem jest silniejszy, niż sugeruje różnica w indeksie. Jeśli Twoje wyniki są długie lub Twoi użytkownicy czekają, piętnastokrotna oszczędność kupuje Ci wolniejszy produkt, a to kompromis, który może wycenić tylko Twoje obciążenie.
Porównane w tym artykule1
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
