
Step 5 Preview vs MiniMax M3: Taniej za token, drożej za punkt
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów
- deepseekNOWOŚĆDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligencja76Kod
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Inteligencja69Kod
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 za 1 mln tokenów
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Cena jednostkowa zdecydowanie przemawia na korzyść MiniMax M3. Przy 0,30 USD za milion tokenów wejściowych i 1,20 USD za milion tokenów wyjściowych rzadki model dostawcy o 428 mld parametrów jest ponad dwukrotnie tańszy od Step 5 Preview, którego stawki wynoszą 1,00 USD i 2,70 USD — w obu przypadkach. Jednak cena jednostkowa to niewłaściwy mianownik w przypadku modelu używanego do odpowiadania na pytania, a gdy podzielisz przez to, co każdy model faktycznie dostarcza, ranking się odwraca. Step 5 Preview kosztuje 0,71 USD za zadanie w Intelligence Index przy wyniku 44. MiniMax M3 kosztuje 0,51 USD za zadanie w indeksie przy wyniku 29. W przeliczeniu na punkt zmierzonej zdolności model z wyższą ceną katalogową jest tańszy — a powodem jest piętnastopunktowa różnica w indeksie, której nie zniweluje żadna obniżka.
Dwa bardzo różne rodzaje „dostępny”
MiniMax M3 jest ogólnie dostępny od 1 czerwca 2026, kiedy MiniMax udostępnił go przez MiniMax Code, swój Token Plan i API — podczas premiery nigdzie nie pojawiła się etykieta „preview”. Wagi pojawiły się 12 czerwca, jedenaście dni później, zgodnie z obietnicą. Repozytorium MiniMaxAI/MiniMax-M3 zawiera około 428 miliardów łącznych parametrów, z około 23 miliardami aktywnymi na token, zbudowane na MiniMax Sparse Attention, wraz z oddzielnym wydaniem skwantyzowanym w MXFP8.
Step 5 Preview udostępnił swoje API 20 września 2026 r.. Jego wagi nie zostały opublikowane — repozytorium Hugging Face stepfun-ai/Step-5-Preview-BF16 to pusta skorupa — a StepFun zobowiązał się do daty 15 października 2026 r.. Praktyczna różnica polega więc na tym, że M3 to model, który można pobrać, hostować samodzielnie i przeanalizować, natomiast Step 5 Preview to hostowany endpoint z opublikowaną intencją.
Warto zaznaczyć: własna strona modelu MiniMax nadal podaje, że M3 „wkrótce zostanie w pełni udostępniony jako open source”, co stoi w sprzeczności z opublikowanym w czerwcu repozytorium. Traktuj to raczej jako nieaktualną stronę dostawcy niż dowód na brak wag.
Historia ceny to nie historia kosztu
Artificial Analysis oblicza koszt przypadający na zadanie indeksowe, przepuszczając ten sam zestaw ewaluacyjny przez każdy model i sumując koszt tokenów. To najbliższy odpowiednik całkowitego kosztu posiadania dla ustalonej ilości pracy, jaki ma ta dziedzina, i uwzględnia dwa efekty, które ceny tokenów ukrywają: jak gadatliwy jest model oraz ile myślenia wykonuje.
Step 5 Preview wypada na poziomie $0,71 za zadanie indeksowe, przy łącznym koszcie przebiegu indeksowania wynoszącym $922,84. MiniMax M3 wypada na poziomie $0,51, przy łącznym koszcie przebiegu wynoszącym $537,98. Pod względem surowej przepustowości zadań M3 jest około 28% tańszy. Po podzieleniu przez wynik indeksu — 44 wobec 29 — Step 5 Preview wypada na poziomie około 1,6 centa za punkt indeksu wobec 1,8 centa w przypadku M3.
Zastrzeżenie należy się właśnie tutaj: to jeden przebieg indeksu na model, a przebieg indeksu to niewielka próba. Arytmetyka dla poszczególnych punktów jest sprawdzeniem poprawności wyniku na zadanie, a nie samodzielnym benchmarkiem. Kierunek jest jednak zgodny z liczbami na zadanie, a to są wartości, których nie mogą pokazać własne cenniki obu dostawców.
• Intelligence Index — Step 5 Preview 44 (#24 z 200) vs MiniMax M3 29 (#15 z 113), oba w bieżącej wersji indeksu
• Cena danych wejściowych — 1,00 USD za milion w porównaniu z 0,30 USD za milion
• Cena za dane wyjściowe — 2,70 USD za milion vs 1,20 USD za milion
• Koszt na zadanie indeksowania — 0,71 USD vs 0,51 USD
• Aktywne parametry — 27B vs 23B
• Okno kontekstu — 1 mln tokenów vs 1 mln tokenów
• Prędkość generowania — 99,8 tokenów/s vs 210,4 tokenów/s
• Wagi — obiecane na 15 października 2026 vs dostępne od 12 czerwca 2026

Pułapka z wersją indeksu, która sprawia, że jest to mylące
Istnieje realne ryzyko związane z czytaniem liczb M3 i warto poświęcić temu cały akapit, bo potyka się na tym niemal każda porównawcza strona firm trzecich. Artificial Analysis dokonało rekalibracji swojego Intelligence Index 7 września 2026 r., a rekalibracja ta ścisnęła wyniki w całym zakresie. W obecnej skali M3 osiąga 29. W skali sprzed września osiągał od 44 do 45 — a wiele narzędzi śledzących wciąż podaje dla niego 44,4 lub 45,4.
Ta kolizja ma tu większe znaczenie niż zwykle, ponieważ obecny wynik Step 5 Preview to również 44. Strona, która umieszcza nieaktualny wynik M3 obok obecnego wyniku Step 5 Preview, sprawia wrażenie, że dwa modele mają remis, podczas gdy obecna różnica wynosi piętnaście punktów. Obie liczby w tym artykule pochodzą z aktualnej wersji indeksu i można je ze sobą porównywać; wszystko opublikowane przed 7 września już nie.
Gdzie MiniMax M3 jest naprawdę nie do pobicia
W przypadku M3 dwie rzeczy nie są nawet blisko. Pierwsza to szybkość: 210,4 tokena wyjściowego na sekundę, czwarty najszybszy wynik spośród 113 modeli śledzonych przez Artificial Analysis, wobec mediany 76,3. Wynik Step 5 Preview na poziomie 99,8 tokena na sekundę jest przyzwoity, ale to mniej niż połowa tamtego. Czas do pierwszego tokena w M3 wynoszący 1,01 sekundy jest również szybszym wynikiem wobec 2,96 sekundy.
Druga to modalność wejściowa. M3 przyjmuje tekst, obraz i wideo oraz zwraca tekst, a MiniMax dokumentuje obsługę pulpitu i użytkowania komputera. Step 5 Preview przyjmuje tekst i obrazy. Jeśli twój potok przekazuje nagrania ekranu lub klatki wideo do modelu, to nie jest preferencja — to różnica w możliwościach.
Różnica w cenie wzmacnia jedno i drugie. Przy 0,30 USD i 1,20 USD z stałym 50% rabatem zastosowanym do stawek cennikowych 0,60 USD i 2,40 USD oraz 80% rabatem na pamięć podręczną, który obniża odczyty z pamięci podręcznej do 0,06 USD za milion, M3 jest jednym z najtańszych sposobów na przepuszczenie dużej liczby tokenów przez model o dużych możliwościach. Zwróć uwagę na podział na poziomy: dane wejściowe powyżej 512K tokenów podwajają koszt całego żądania, a priorytetowy poziom usługi kosztuje 1,5×.
Gdzie się to rozpada
Własny zestaw ewaluacyjny MiniMax dla M3 jest mocny i należy go odczytywać jako dane deklarowane przez dostawcę: SWE-bench Verified na poziomie 80,5%, SWE-bench Pro 59,0%, Terminal-Bench 2.1 66,0%, MCP Atlas 74,2%, BrowseComp 83,5 i OSWorld-Verified 70,06%. MiniMax przeprowadził te testy na własnej infrastrukturze, używając Claude Code jako szkieletu, uśredniając wyniki z czterech przebiegów, a metodyka punktacji nie jest publiczna — w obecnym stanie nie są więc one odtwarzalne przez strony trzecie.
Niezależnie zmierzony obraz jest znacznie surowszy dla pracy agentowej. Artificial Analysis odnotowało Terminal-Bench 4.0 z wynikiem 2% dla M3 — co stanowi inną wersję testu niż podana przez producenta wartość Terminal-Bench 2.1 i nie jest z nią porównywalne, ale i tak jest wymowne. SciCode uzyskał 47%, AutomationBench-AA 21%, a CritPt 4%. Najmocniejsze niezależne wyniki M3 dotyczą długiego kontekstu i pracy opartej na wiedzy: AA-LCR v1.1 na poziomie 83%, Humanity's Last Exam 39%.
Step 5 Preview odwraca ten profil. Terminal-Bench 4.0 osiąga 33,3% w tym samym środowisku testowym, w którym M3 osiąga 2%, a SciCode 59% wobec 47%. Jeśli praca ma charakter agentowy lub dotyczy kodu, nie jest to wyrównane porównanie, a przewaga cenowa tego nie rekompensuje.

Klauzula licencyjna, którą pomija większość porównań
MiniMax M3 ma otwarte wagi, ale nie jest open source w rozumieniu OSI, a warunki są surowsze, niż sugeruje sformułowanie „otwarte wagi”. Repozytorium jest objęte licencją MiniMax Community License: bezpłatną do użytku niekomercyjnego, a użycie komercyjne jest uzależnione od widocznego eksponowania napisu „Built with MiniMax M3” — i każdy produkt, którego roczny przychód przekracza 20 mln USD, wymaga uprzedniej pisemnej zgody MiniMax. To nie jest MIT, nie Apache i nie taka licencja, którą dział prawny przepuszcza bez zastrzeżeń.
Step 5 Preview nie można jeszcze w ogóle ocenić w tym aspekcie, ponieważ nie ma licencji, którą można by przeczytać. StepFun zobowiązał się do udostępnienia wag 15 października i nie opublikował warunków, które będą ją regulować. Każdy, kto planuje na nim budować, powinien traktować licencję jako kwestię otwartą, a nie zakładać, że będzie przypominać licencję Moonshot lub DeepSeek.
To szczera asymetria między nimi: warunki M3 są restrykcyjne, ale znane; warunki Step 5 Preview są nieznane. Restrykcyjna licencja, którą można uwzględnić przy planowaniu, bije nieogłoszoną, której nie można.
Dzwonienie do któregokolwiek z nich
MiniMax M3 znajduje się w naszym katalogu pod adresem /models/minimax/minimax-m3, dostępny przez ten sam klucz i przy takim samym kształcie zapytania jak pozostałe ponad 200 modeli, które obsługujemy, z ceną katalogową dostawcy przekazywaną bez marży (0%) — więc stała 50% zniżka zastosowana przez MiniMax to cena, którą widzisz, a zmienia się w dniu, w którym zmieni ją MiniMax. Automatyczne przełączanie awaryjne to druga połowa tego układu: M3 przy 210 tokenach na sekundę jest atrakcyjny przy pracy o dużej skali, a praca o dużej skali to dokładnie ten obszar, w którym pojedynczy zdegradowany endpoint boli najbardziej.
Step 5 Preview nie znajduje się w naszym katalogu. Modele tekstowe StepFun nie należą do tych, które obsługujemy, więc jest dostępny przez własne API StepFun oraz kilka platform zewnętrznych — a nie jest dostępny za pomocą klucza, którego użyłbyś w przypadku M3.

Werdykt
Weź MiniMax M3, gdy ograniczeniem jest wolumen, opóźnienie lub wejście wideo, gdy chcesz model, który możesz pobrać już dziś, oraz gdy możesz żyć w ramach licencji społecznościowej — w tym progu 20 milionów dolarów przychodu. Zaakceptuj, że niezależne wyniki w zakresie zadań agentowych stawiają go daleko w tyle i że jego benchmarki producenta nie zostały odtworzone poza własną infrastrukturą MiniMax.
Wybierz Step 5 Preview, gdy praca ma charakter agentowy lub w dużym stopniu dotyczy kodu, gdy chcesz mieć możliwości na dolara, a nie tokeny na dolara, oraz gdy nie przeszkadza ci bycie wczesnym klientem hostowanego punktu końcowego, którego wagi pojawią się w przyszłym miesiącu. Zaakceptuj, że nie możesz sprawdzić licencji, zanim zaczniesz budować, oraz że różnica 2% wobec 33,3% w Terminal-Bench 4.0 to luka, która przesądza o projekcie.
Rabat jest prawdziwy. Po prostu nie jest tym, co się kupuje.
MiniMax M3 to jeden z modeli, które kierujemy przy 0% marży z automatycznym przełączaniem awaryjnym, więc zmiana ceny dostawcy jest aktywna na tym samym kluczu już tego samego dnia.
