
MiniMax M3.1 Flash Preview jest już dostępny w Token Plan: Co tak naprawdę odblokowuje Twoja subskrypcja
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 468 tok/s
- openaiNOWOŚĆOpenAI: GPT-6 Luna2026-09-2237Inteligencja
- openaiNOWOŚĆOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- grokNOWOŚĆGrok 4.72026-09-2146Inteligencja
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów · 192 tok/s
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 1329 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 118 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
MiniMax-M3.1-Flash-Preview został udostępniony 27 września 2026 r. i to, w jaki sposób został udostępniony, jest historią. To nie jest model typu pay-as-you-go. Dostawca umieścił swój najnowszy model tekstowy za tym samym Token Plan Subscription Key, który już obejmuje MiniMax-M3, MiniMax M2.7 i wariant M2.7-highspeed, więc jeśli posiadasz miejsce, nie ma nowego klucza do utworzenia ani drugiej umowy do podpisania. Czego również nie ma, na dzień dzisiejszy, to ceny za token, karty modelu, opublikowanego benchmarku ani żadnego sposobu wyłączenia myślenia modelu.
Ta kombinacja — beztarciowy dostęp w połączeniu z całkowicie niepublikowanymi warunkami ekonomicznymi — jest wystarczająco nietypowa, by warto było ją przeanalizować, zanim ktokolwiek podłączy do niej produkcyjny potok. Reszta tego tekstu to to, co faktycznie mówi dokumentacja samego dostawcy, czego wymownie nie mówi, oraz ta jedna linia kodu, która w ciągu minuty powie ci, czy ten model pasuje do sposobu, w jaki pracujesz.
Co tak naprawdę wylądowało 27 września?
Dokumentacja dla deweloperów MiniMax zawiera teraz stałą notatkę, powtarzaną na każdej stronie poświęconej modelom tekstowym: MiniMax-M3.1-Flash-Preview jest na razie dostępny wyłącznie w ramach Token Plan i MiniMax Code. Model pojawia się jako pierwszy w tabeli modeli dostawcy, powyżej MiniMax-M3, i jest opisany jako najnowocześniejszy multimodalny model do kodowania z oknem kontekstu 1M oraz regulowaną głębokością myślenia.
• Okno kontekstu — 1 000 000 tokenów, ten sam limit, jaki ma MiniMax-M3
• Modalności wejściowe — tekst, obraz i wideo, zwracające tekst
• Głębokość myślenia — wysiłkowe ustawienie akceptujące niski, średni, wysoki, bardzo wysoki i maksymalny, domyślnie maksymalny, gdy pominięto
• Obsługa protokołów — ten sam identyfikator modelu działa przez punkt końcowy MiniMax zgodny z Anthropic, jego punkt końcowy zgodny z OpenAI oraz jego punkt końcowy OpenAI Responses
• Dostępność — tylko Token Plan i MiniMax Code; niedostępny w modelu pay-as-you-go
• Cena — nigdzie nie opublikowano stawki za token
• Wagi — brak; dwa najnowsze publiczne repozytoria organizacji MiniMaxAI pozostają MiniMax-Music3 i MiniMax-H3
• Niezależne benchmarki — brak; model nie ma wpisu w indeksie modeli Artificial Analysis
Firma ogłosiła to tego samego dnia na swoim koncie MiniMaxAgent, przedstawiając je jako narzędzie do codziennego tworzenia oprogramowania, a nie do prac na granicy możliwości: szybkie i niezawodne, od szybkich poprawek błędów po pełne wdrożenia funkcji. To zadanie dla modelu z poziomu Flash, a nie flagowca. Zewnętrzne doniesienia agencyjne od PANews i KuCoin opisywały go w tych samych słowach i zauważyły, że programiści wypatrzyli model w selektorze MiniMax Code, zanim firma go potwierdziła.

To, którego klawisza używasz, ma większe znaczenie niż zwykle.
To jest część, która zaskakuje ludzi. MiniMax obsługuje dwa osobne typy poświadczeń, a M3.1-Flash-Preview odpowiada tylko na jeden z nich. Token Plan Subscription Key pochodzi z Billing > Token Plan i obejmuje użycie subskrypcji oraz zakupione Credits. Klucz API pay-as-you-go obejmuje modele rozliczane za token. Dokumentacja dostawcy wyraźnie mówi, że te dwa nie są wymienne oraz że Subscription Key może istnieć, zanim zostanie do niego przypisany jakikolwiek płatny zasób — w takim przypadku jest to ważny klucz, za którym nic nie stoi.
Zatem praktycznym testem nie jest „czy mam klucz API MiniMax”, lecz „czy mam miejsce w Token Plan”. Istniejące miejsca są objęte. Dokumentacja zauważa, że Subscription Key staje się użyteczny, gdy przypisane zostanie miejsce lub dostęp do Credits, oraz że nadwyżka Credits jest pobierana automatycznie, gdy limit subskrypcji zostanie wyczerpany.
Jest też niespójność w dokumentacji, o której warto wiedzieć, bo wprawi w zakłopotanie każdego, kto najpierw czyta stronę z cennikiem. Przypis o zakresie objęcia na stronie cennika Token Plan nadal podaje jako kwalifikującą się linię modeli M3, M2.7, modele obrazu i mowy, z wyłączeniem H3 — nie zaktualizowano go, aby wymieniał M3.1-Flash-Preview. Strony modeli mówią coś odwrotnego: że M3.1-Flash-Preview jest dostępny w Token Plan i nigdzie indziej. Obie strony są na dziś aktywnymi stronami dostawcy. Tylko klucz w twojej ręce to rozstrzyga.
Kod 400, który mówi, jakiego rodzaju jest to model.
Każdy model MiniMax z serii M myśli, zanim odpowie, ale M3.1-Preview jest pierwszym, który nie chce przestać. Wyślij thinking: {"type": "disabled"} lub reasoning_effort: "none" a API zwraca HTTP 400 z komunikatem:
model "MiniMax-M3.1-Flash-Preview" wymaga myślenia adaptacyjnego; thinking.type="disabled" (w tym reasoning.effort=none) jest niedozwolone (2013)
Wskazówki samego dostawcy mówią, aby obniżyć effort zamiast próbować wyłączyć myślenie, a drabina to dźwignia opóźnienia: rutynowa edycja przy low i zmiana w całym repozytorium przy xhigh to ten sam model dokonujący różnych kompromisów. Dwa dalsze szczegóły są specyficzne dla tego modelu. Parametr reasoning_effort jest udokumentowany jako skuteczny tylko dla MiniMax-M3.1-Flash-Preview — nie jest to ogólna kontrola z serii M. A przełącznik wyjściowy reasoning_split, który oddziela myślenie do pola reasoning_content, nie może obecnie być ustawiony na false w tym modelu.
Gdzie trafia tekst myślenia, zależy od protokołu: punkt końcowy zgodny z Anthropic zwraca go jako thinking — blok treści, a punkt końcowy zgodny z OpenAI zwraca go w reasoning_content, a punkt końcowy Responses zwraca go jako element wyjściowy rozumowania. Jeśli parsowałeś <think> tagi z danych wyjściowych MiniMax-M3, ta praca nie jest już konieczna w nowszym modelu — a w przypadku przeplatanych rozmów z użyciem narzędzi pełna odpowiedź, w tym blok myślenia, musi zostać dołączona z powrotem do historii wiadomości, w przeciwnym razie łańcuch rozumowania zostanie przerwany.
Promocja trwająca teraz
MiniMax Code prowadzi promocję check-in od 28 września do 7 października w UTC+8, podwajając darmowe kredyty przyznawane za codzienne logowania i otwierając ją zarówno dla nowych, jak i istniejących użytkowników. Zgłoszone kredyty obowiązują we wszystkich obsługiwanych modelach, a jako przykłady podano M3.1-Flash-Preview i modele wideo H3. Osobno firma poinformowała, że limity Token Plan resetują się dla wszystkich użytkowników w momencie uruchomienia i że w trakcie wydarzenia planowane są kolejne resety, a kwalifikowalność jest pokazywana w aplikacji.
Traktuj te dwie pozycje jako oświadczenia dostawcy przekazane przez relację z premiery — to warunki promocyjne z przypisanymi datami, a nie zachowanie produktu, a ta sama relacja zauważa, że ogłoszenie nie określiło liczby kredytów za pojedyncze zameldowanie ani dokładnych zasad dotyczących opuszczonych dni. Ekonomię w stanie ustalonym łatwiej przedstawić: Token Plan jest wyceniony na 22 USD miesięcznie w przypadku Plus, 55 USD w przypadku Max i 132 USD w przypadku Ultra, z 5-godzinnymi kroczącymi oraz tygodniowymi oknami limitów, których wielkość dostawca szacuje odpowiednio na około trzy do czterech, cztery do pięciu i sześć do siedmiu równoczesnych agentów. Zakupione kredyty działają w przeliczeniu 1000 kredytów na dolara i są odejmowane według ceny katalogowej rozliczenia za użycie dla każdego modelu.
Cztery rzeczy, których ten model wciąż nie ma
Żadne z poniższych nie jest krytyką modelu; każde z nich to luka, wokół której zespół musi zaplanować swoje działania, a wszystkie cztery można zweryfikować już dziś.
• Brak ceny. Na żadnej stronie MiniMax nie ma stawki za token dla M3.1-Flash-Preview, więc nie można go porównać — pod względem kosztu za token — ani z M3, którego stawki to $0.30 za milion tokenów wejściowych i $1.20 za milion tokenów wyjściowych, ani z czymkolwiek innym.
• Brak benchmarków. MiniMax nie opublikował żadnej tabeli ewaluacyjnej wraz z tym wydaniem. Nikt inny też nie opublikował: model nie występuje w indeksie Artificial Analysis, więc jego kolumna jest naprawdę pusta, a nie tylko jeszcze przedwczesna.
• Brak wag. MiniMax-M3 został udostępniony jako open-weight; M3.1-Flash-Preview nie ma repozytorium ani checkpointu do pobrania.
• Brak niezależnych pomiarów. Żadnych danych dotyczących szybkości wyjściowej, opóźnienia czy współczynnika błędów od jakiejkolwiek strony trzeciej, ani od naszej własnej telemetrii routingu, ponieważ modelu nie ma w naszym katalogu.
W porównaniu z premierą M3 w czerwcu 2026 r., która już pierwszego dnia przyszła z notatką architektoniczną, arkuszem benchmarków i cennikiem, to celowo cicha premiera. Prawdopodobna interpretacja — a jest to interpretacja, nie ogłoszony plan — jest taka, że MiniMax chce realnego użycia we własnym produkcie, zanim zdecyduje, ile kosztuje model i czy go udostępni.

Co przeciekła notatka z podglądem miała rację
Cztery dni przed premierą w publicznym repozytorium partnera krążył przepisany dokument z zapowiedzią, opisujący MiniMax M3.1 ze sparse attention, kwantyzacją uwagi Q8KV4, routowanymi ekspertami NVFP4, głowicą spekulatywnego dekodowania DSpark oraz nowym reasoning_effort polem przyjmującym wartości od max aż do low. W tamtym czasie opisaliśmy to jako niezweryfikowane, bo tak było: nie istniały żadne wagi, karta modelu, strona z cennikiem ani identyfikator modelu w API.
Jedno z tych pięciu twierdzeń zostało teraz potwierdzone przez własną dokumentację dostawcy i jest to reasoning_effort pole — w tym drabina od maksymalnego do niskiego, która dokładnie odpowiada wartościom z wydania. Pozostałe cztery pozostają niepotwierdzone. Opublikowany przez MiniMax opis M3.1-Flash-Preview mówi jedynie, że jest to frontierowy multimodalny model do kodowania z oknem kontekstowym 1M i regulowaną głębokością myślenia; nie opisuje schematu uwagi, kwantyzacji ani głowicy dekodującej. Każdy, kto powtarza twierdzenia o rzadkiej uwadze i NVFP4 jako ustaloną specyfikację, powtarza transkrypcję strony trzeciej, co jest dokładnie tym, czego wydanie nie potwierdziło.
Jeśli chcesz tego spróbować bez stawiania całego pipeline'u
Kłopotliwe w wersji zapoznawczej dostępnej wyłącznie w Token-Plan jest to, że naturalny sposób oceny nowego modelu — wywołanie go z istniejącego stosu i zmierzenie — jest jedyną rzeczą, której nie można zrobić bezproblemowo. Nie ma stawki za token, względem której można by prowadzić modelowanie, nie ma opublikowanego profilu opóźnień ani przełączania awaryjnego w produkcie samego dostawcy, jeśli wersja zapoznawcza zacznie szwankować.
To sytuacja, dla której tworzy się warstwę routingu. Wszystko, co możesz dziś wywołać, kryje się za jednym endpointem zgodnym z OpenAI i jednym kluczem API, a modele sąsiadujące z tym już tam są: MiniMax-M3 w cenie dostawcy wynoszącej 0,30 USD za milion tokenów wejściowych i 1,20 USD za milion tokenów wyjściowych, MiniMax M2.7 w tej samej cenie z oknem 200 000 tokenów i otwartymi wagami oraz pakiety DeepSeek i Qwen Flash w tym samym przedziale cenowym. Ceny po naszej stronie to cena katalogowa dostawcy przekazana dalej z marżą 0%, więc gdy dostawca obniży stawkę, pojawia się ona tutaj tego samego dnia, a nie dopiero w kolejnym cyklu renegocjacji. Automatyczne przełączanie awaryjne oznacza, że zależność w wersji preview może stać obok ścieżki produkcyjnej, a nie pod nią, a gdy MiniMax opublikuje cennik i endpoint dla MiniMax-M3.1-Flash-Preview, kwestia stanie się wpisem w tabeli routingu, a nie projektem migracyjnym. Sam MiniMax-M3.1-Flash-Preview nie znajduje się w naszym katalogu, a sposobem, by dotrzeć do niego dziś, jest własny Token Plan dostawcy i jego produkt do kodowania.
Szczere podsumowanie dla zespołu, który czyta to w dniu premiery: model jest już dostępny, darmowy na poziomie kosztu krańcowego, jeśli już płacisz za miejsce w Token Plan, a przy tym całkowicie bez wyceny i bez pomiarów na własnych zasadach. Wypróbuj go w MiniMax Code, a pipeline, na którym polegasz, pozostaw na modelu z cennikiem i udokumentowanymi wynikami, i wypatruj dwóch rzeczy, które zmienią to z ciekawostki w decyzję — opublikowanej ceny i pierwszych niezależnych wyników.

