
Czym jest MiniMax M3? Flagowy model multimodalny MiniMax z kontekstem 1M
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów
- deepseekNOWOŚĆDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligencja76Kod
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Inteligencja69Kod
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 za 1 mln tokenów
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
MiniMax M3 to natywnie multimodalny model językowy o otwartych wagach od chińskiego laboratorium stojącego za modelami tekstowymi z serii M, modelami wideo Hailuo i serią Music. Laboratorium ogłosiło go 1 czerwca 2026 r.; model przejął najwyższą pozycję na firmowej liście modeli od MiniMax M2.7, przynosząc okno kontekstu o długości miliona tokenów, natywne wejście tekstowo-obrazowo-wideo oraz architekturę rzadkiej uwagi, którą laboratorium nazywa MSA.
Czternaście artykułów w archiwum tego bloga wspomina MiniMax M3. Jak dotąd żaden z nich nie był mu poświęcony. Model pojawia się jako przeciwnik w kolejnych porównaniach — punkt odniesienia open-weight, z którym mierzy się nowszy Gemini, Qwen, Grok lub GPT — a nie było tu strony, na którą czytelnik mógłby trafić, aby dowiedzieć się, czym właściwie jest MiniMax M3. To jest ta strona.
Arkusz specyfikacji
MiniMax M3 to model typu mixture-of-experts z około 428 miliardami parametrów łącznie i około 23 miliardami aktywowanymi na token, zgodnie z kartą modelu, którą MiniMax publikuje wraz z wagami. Jest natywnie multimodalny, a nie wyłącznie tekstowy z doklejoną wizją: karta opisuje trening na przeplatanych modalnościach od pierwszego kroku, a model przyjmuje na wejściu tekst, obraz i wideo, a zwraca tekst.
• Okno kontekstu: 1 048 576 tokenów, przy czym nasz własny wpis w katalogu podaje gwarantowane minimum 512 000 tokenów użytecznego kontekstu
• Maksymalna długość wyjścia: 512 000 tokenów na naszej stronie katalogowej; MiniMax nie podaje w swoich materiałach maksymalnej długości wyjścia, więc 512K należy traktować jako naszą wartość, a nie dostawcy
• Modalność: tekst, obraz i wideo na wejściu; tekst na wyjściu
• Parametry: ~428 mld łącznie, ~23 mld aktywnych na token
• Sterowanie rozumowaniem: parametr myślenia z trybami włączonym, adaptacyjnym i wyłączonym
• Zalecane próbkowanie: temperatura 1.0, top_p 0.95
• Architektura: MiniMax Sparse Attention (MSA), której poświęcony jest artykuł arXiv 2606.13392
• Postać endpointu: uzupełnienia czatu zgodne z OpenAI
Główna teza architektoniczna dotyczy kosztu uwagi przy długim kontekście. MiniMax twierdzi, że MSA zapewnia ponad 9 razy szybsze wstępne wypełnianie i ponad 15 razy szybsze dekodowanie niż M2 przy oknie miliona tokenów, zmniejszając obliczenia na token do około jednej dwudziestej poprzedniej generacji. To dane producenta i nie widzieliśmy, by zostały niezależnie odtworzone.
Gdzie MiniMax M3 plasuje się we własnej linii MiniMax
To szczyt linii językowej, ale warto doprecyzować, co ta linia zawiera, ponieważ MiniMax utrzymuje dłuższy ogon wciąż wymienianych modeli niż większość laboratoriów. Własna dokumentacja modeli dostawcy dzieli je na dwie części.
• Aktualne modele: MiniMax M3, MiniMax M2.7, MiniMax M2.7-highspeed
• Modele starszej generacji, wciąż wymieniane: MiniMax M2.5, MiniMax M2.5-highspeed, MiniMax M2.1, MiniMax M2.1-highspeed, MiniMax M2
• MiniMax M2, najstarszy z nich, ma kontekst 200 000 tokenów i maksymalną długość wyjściową 128 000 tokenów, obejmującą łańcuch myśli
• MiniMax nie publikuje limitów kontekstu ani długości wyjściowej dla M2.7 ani M2.1 w tym samym dokumencie
Luka pokoleniowa jest realna, ale nie ogromna w jedynym indeksie, w którym pojawiają się oba modele. Artificial Analysis przyznaje MiniMax M3 wynik 29 w Intelligence Index w wersji v4.3.2, a MiniMax M2.7 — 23 w tej samej wersji; 29 plasuje M3 na 16. miejscu spośród 114 modeli w tabeli tej wersji, a 23 plasuje M2.7 na 36. miejscu. M2.7 został wydany w marcu 2026 r. Ten skok to krok, a nie pokolenie, i warto odczytywać te dwie liczby z tej samej wersji: ten indeks został ponownie skalibrowany 7 września 2026 r., a wyniki sprzed tej daty nie są porównywalne z wynikami po niej.
Ile to kosztuje
MiniMax wycenia M3 na podstawie rozmiaru żądania w swoim cenniku rozliczeń typu pay-as-you-go, a publikowane stawki obejmują stały rabat 50% względem wyższej ceny katalogowej.
• Do 512 tys. tokenów wejściowych: $0,30 za milion tokenów wejściowych, $1,20 za milion tokenów wyjściowych, $0,06 za milion odczytów z pamięci podręcznej — wobec cen katalogowych $0,60 / $2,40 / $0,12
• Powyżej 512 tys. tokenów wejściowych: $0,60 za milion tokenów wejściowych, $2,40 za milion tokenów wyjściowych, $0,12 za milion odczytów z pamięci podręcznej — wobec cen katalogowych $1,20 / $4,80 / $0,24
• Warstwa usługi priorytetowej: 1,5× stawki standardowej, czyli $0,45 / $1,80 / $0,09 w warstwie małych żądań, wybierana przez ustawienie service_tier na „priority”
• Brak publikacji: MiniMax nie podaje ceny zapisu do pamięci podręcznej dla M3, tylko cenę odczytu z pamięci podręcznej
OrcaRouter oferuje MiniMax M3 w tej samej cenie — 0,30 USD za wejście, 1,20 USD za wyjście — bez marży doliczanej do stawki dostawcy. To wyróżniony model w naszym katalogu, a ruch nie jest trywialny: 153,7 mln tokenów skierowanych w ciągu ostatnich siedmiu dni w chwili pisania, przy p50 czasu do pierwszego tokenu wynoszącym 4,26 sekundy i p95 wynoszącym 10,00 sekundy.

W czym MiniMax M3 jest mierzalnie dobry
Zacznijmy od liczb, które MiniMax podaje o sobie — wszystkie pochodzą od samego dostawcy i żadnej z nich nie widzieliśmy odtworzonej przez stronę trzecią.
• SWE-Bench Pro: 59,0%
• Terminal-Bench 2.1: 66,0%
• SWE-fficiency: 34,8%
• MCP Atlas: 74,2%
• BrowseComp: 83,5, wartość, którą dostawca eksponuje w wyszukiwaniu agentowym
• Video-MME: 84,6 przy 512 klatkach, podczas gdy zewnętrzne API ogranicza liczbę klatek do 640
• KernelBench Hard: 28,8%
• OSWorld-Verified: 68,70% przy 100 maksymalnych krokach, rosnąc do 70,06% przy 200
Niezależny obraz potwierdza kierunek. Artificial Analysis umieszcza MiniMax M3 z Intelligence Index na poziomie 29 w wersji v4.3.2, na 16. miejscu spośród 114 modeli, przy koszcie 0,51 USD za uruchomienie indeksu na model — 21. miejsce spośród 114 pod względem tej miary kosztu. Prędkość generowania wynosi 106,4 tokena na sekundę wobec mediany 67,1, a czas do pierwszego tokenu to 1,25 sekundy wobec mediany 2,33 sekundy. Oba te wyniki są lepsze niż typowe dla tej klasy, a cena jest znacznie poniżej niej.
Ponowna publikacja tej samej rodziny indeksów przez strony trzecie uzupełnia wyniki cząstkowe: SWE-bench Verified na poziomie 80,5%, tau-squared-bench na poziomie 88,9%, AA-GPQA Diamond na poziomie 92,9%, AA-LCR na poziomie 83,0%, AA-IFBench na poziomie 82,9%, OmniDocBench 1.5 na poziomie 91,6% oraz USAMO 2026 na poziomie 85,7%. Rozumienie dokumentów i podążanie za instrukcjami wyglądają na autentyczne mocne strony, a wynik rozumowania w długim kontekście jest spójny z narracją architektoniczną.

W czym jest wymiernie zły
Szczere słabości skupiają się w dwóch miejscach i obie są widoczne w publikowanych liczbach.
• Największa jest luka w zakresie agentowości: w tym samym przedruku przez podmiot zewnętrzny MiniMax M3 uzyskuje 58,6 w AA Coding Index, ale tylko 30,8 w AA Agentic Index. Znacznie lepiej pisze kod, niż samodzielnie prowadzi długie, wieloetapowe zadanie.
• Wiedza i halucynacje: AA-Omniscience Index na poziomie 1,4, dokładność 16,7% i wskaźnik halucynacji 18,4%. To model, który z pewnością siebie odpowiada o rzeczach, których nie zna.
• OSWorld 2.0: 4,6%
• CritPt: 3,7%, najsłabszy opublikowany wynik dla M3, jaki gdziekolwiek znaleźliśmy
• ResearchClawBench: 19,8%
• Gadatliwość: 120 milionów tokenów wyjściowych do ukończenia Intelligence Index, 11. miejsce na 114 — to gadatliwy model, a przy promptach wymagających intensywnego rozumowania odbija się to na rachunku
• Dolna granica wyniku złożonego: jeden agregator zewnętrzny daje mu 55,28 na 100, 60. miejsce na 505, choć przy częściowym pokryciu 50 z 481 benchmarków, więc ten wynik złożony to dolna granica, a nie werdykt
Niektórych rzeczy po prostu się nie mierzy i wolimy to powiedzieć, niż wypełniać lukę. Nikt poza MiniMax nie odtworzył powyższej tabeli wyników dostawcy. Artificial Analysis nie publikuje samodzielnie wartości Coding Index ani Agentic Index dla M3 — para 58,6 i 30,8 pochodzi od strony trzeciej, która przedrukowuje tę samą rodzinę indeksów. Artificial Analysis wymienia AA-Omniscience jako składnik swojego indeksu, ale nie publikuje żadnego liczbowego wyniku Omniscience dla M3. MiniMax nie publikuje wartości maksymalnego wyjścia, więc 512K na naszej własnej stronie modelu jest nasze. A w cenniku dostawcy nie ma w ogóle ceny zapisu do pamięci podręcznej.
Kto powinien wybrać MiniMax M3, a kto powinien wybrać coś innego?
Wybierz MiniMax M3, gdy zadanie jest jednocześnie długokontekstowe i multimodalne. Milion tokenów z wejściem wideo, otwarte wagi, które możesz sam pobrać i uruchomić, oraz cena wejścia 0,30 USD za milion tokenów to kombinacja, której nic innego w obszarze otwartych wag nie dorównuje w równie czysty sposób. Analiza długich dokumentów, rozumienie wideo, czytanie kodu na skalę repozytorium i pipeline'y ekstrakcji dokumentów to obszary, w których tkwią zmierzone mocne strony — 91,6% w OmniDocBench i 83,0% w AA-LCR to liczby, które za nim przemawiają.
Wybierz coś innego w trzech przypadkach. Jeśli nie potrzebujesz okna kontekstowego ani wejścia wizyjnego, MiniMax M2.7 kosztuje tyle samo — $0,30/$1,20 — uzyskuje 23 punkty wobec 29 punktów M3 w bieżącej wersji indeksu i jest mniejszym rozwiązaniem w obsłudze — przewaga M3 nie jest darmowa, po prostu ma tę samą cenę katalogową. Jeśli twoim obciążeniem są agenci autonomiczni, a nie programowanie, luka w zakresie agentowości jest powodem, by rozejrzeć się gdzie indziej, a własna tabela porównawcza MiniMax wskazuje to samo miejsce: w PostTrainBench dostawca podaje 0,37 dla M3 wobec 0,42 dla Opus 4.7 i 0,39 dla GPT-5.5 — to jedyny opublikowany benchmark, w którym M3 przegrywa z oboma. A jeśli potrzebujesz licencji bez haczyków, przeczytaj następny akapit, zanim się zobowiążesz.
Licencja to haczyk, który wiele omówień pomija. MiniMax M3 jest udostępniany na licencji MiniMax Community License, a nie Apache czy MIT. Użytkowanie niekomercyjne jest bezpłatne. Użytkowanie komercyjne jest dozwolone, ale musisz w widoczny sposób wyświetlać „Built with MiniMax M3”. Przy rocznym przychodzie poniżej 20 milionów dolarów składasz jednorazowe zgłoszenie; powyżej tego progu potrzebujesz uprzedniej pisemnej autoryzacji od MiniMax, o którą należy poprosić e-mailem z tematem „M3 licensing - authorization request”. Licencja zawiera także załącznik z zabronionymi zastosowaniami. Jeśli wprowadzasz produkt na rynek, to nie formalność, lecz przegląd prawny.
Praktyczne podsumowanie
MiniMax M3 to obecny flagowy model linii językowej MiniMax: model typu mixture-of-experts o ok. 428 mld parametrów, z ok. 23 mld aktywnymi na token, kontekstem miliona tokenów, natywnym wejściem wideo i obrazu oraz rzadką uwagą (sparse attention), której dostawca przypisuje 20-krotną redukcję obliczeń na token przy pełnym kontekście. Został ogłoszony 1 czerwca 2026 r., więc to model ugruntowany, a nie nowy — ciekawe pytanie we wrześniu 2026 r. nie brzmi, czy jest dobry, lecz dla której połowy Twojego obciążenia jest dobry.
Wyważona odpowiedź brzmi: jest mocny w kodzie i dokumentach, przeciętny w wiedzy, a słaby w autonomicznej pracy agentowej. Jak na to, co potrafi, jest tani — i jest rzadkim modelem open-weight, w którym twierdzenie o długim kontekście wytrzymuje niezależne spojrzenie. Licencja to część, którą większość zespołów będzie musiała wynegocjować sama ze sobą.
MiniMax M3 działa na OrcaRouter według stawki dostawcy, bez marży, przez ten sam endpoint zgodny z OpenAI, co wszystko inne tutaj: jeden klucz API zapewnia dostęp do ponad 200 modeli, z automatycznym przełączaniem awaryjnym, jeśli endpoint przestanie działać, oraz DSL routingu, gdy chcesz przypiąć lub mieszać. Jeśli chcesz porównać go z resztą katalogu, zanim się zdecydujesz, strona modelu zawiera aktualny cennik, percentyle czasu do pierwszego tokenu i ruch.

Porównane w tym artykule1
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
