
MiniMax M3.1 Flash Preview vs DeepSeek V4 Flash: dwa tanie bilety do kontekstu 1M, jedna wielka gwiazdka
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 468 tok/s
- openaiNOWOŚĆOpenAI: GPT-6 Luna2026-09-2237Inteligencja
- openaiNOWOŚĆOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- grokNOWOŚĆGrok 4.72026-09-2146Inteligencja
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów · 192 tok/s
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 1329 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 118 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
Jeśli szukasz okna kontekstu mieszczącego milion tokenów w niskiej cenie za token, MiniMax-M3.1-Flash-Preview i DeepSeek V4 Flash to dwie nazwy, które ciągle się pojawiają — i nie są to tak naprawdę produkty tego samego rodzaju. DeepSeek V4 Flash to wycofany model, którego identyfikator nadal odpowiada, żyjący w cenniku dostawcy, który możesz odczytać co do centa. MiniMax-M3.1-Flash-Preview to aktywna wersja zapoznawcza bez żadnej opublikowanej stawki. Poniższe porównanie jest więc częściowo porównaniem specyfikacji, a częściowo demonstracją, jak odmiennie ci dwaj dostawcy wybierają sprzedaż tej samej półki.
Obie strony tego warto przedstawić precyzyjnie, ponieważ liczby, które o tym decydują, są rozproszone po stronie cennika dostawcy, drzewie dokumentacji dostawcy i w naszym własnym katalogu, a jedno z najczęściej powtarzanych twierdzeń o DeepSeek V4 Flash — jego cena — zostało od tego czasu przez DeepSeek zmienione.
W czym obie karty specyfikacji faktycznie się zgadzają
Główne parametry są na tyle zbliżone, że nie są czynnikiem decydującym, z jednym wyjątkiem, którego nikt nie reklamuje.
• Okno kontekstowe — 1 000 000 tokenów dla MiniMax-M3.1-Flash-Preview w porównaniu z 1 048 576 dla DeepSeek V4 Flash: nominalnie identyczne, różnica 48 576 tokenów
• Maksymalna długość wyjścia — niepublikowana dla MiniMax-M3.1-Flash-Preview; 384 000 tokenów dla DeepSeek V4 Flash, co jest nietypowe w tej cenie i jest liczbą, która powinna rozstrzygać o wielu decyzjach zakupowych
• Modalności wejściowe — tekst, obraz i wideo dla MiniMax-M3.1-Flash-Preview; tylko tekst dla DeepSeek V4 Flash
• Kontrola myślenia — poziom wysiłku — drabinka od niskiego do maksymalnego, myślenie stale włączone, dla MiniMax-M3.1-Flash-Preview; myślenie lub brak myślenia w DeepSeek V4 Flash, przy czym brak myślenia jest realną opcją
• Obsługa protokołów — punkty końcowe zgodne z Anthropic, zgodne z OpenAI oraz OpenAI Responses dla MiniMax-M3.1-Flash-Preview; te same trzy plus uzupełnianie prefiksu czatu w DeepSeek V4 Flash
• Wagi — brak dla MiniMax-M3.1-Flash-Preview; wagi DeepSeek V4 Flash zostały opublikowane, choć sam model został już zastąpiony
• Cena — niepublikowana dla MiniMax-M3.1-Flash-Preview; opublikowana i niska dla DeepSeek V4 Flash
Przeczytaj tę listę dwa razy, ponieważ to limit wyjściowy jest tym cichym. Milion tokenów kontekstu i 384 000 tokenów wyjścia to naprawdę długie okno generowania jednoprzebiegowego. Milion tokenów kontekstu z nieujawnionym limitem wyjściowym to obietnica dotycząca czytania, a nie pisania. Jeśli twoje obciążenie to „przeczytaj repozytorium, wygeneruj plan migracji”, to druga liczba jest tą, która decyduje, czy zadanie zmieści się w jednym wywołaniu.
Co jest mierzone w przypadku każdego z nich
To najmniej komfortowa część porównania i jest krótka.
DeepSeek V4 Flash ma wynik benchmarkowy i jest on niezależny. Artificial Analysis przyznaje mu 34,3 w Intelligence Index — 42. miejsce spośród 145 modeli w tym indeksie — oraz 69,1 w Coding Index i 90,8% w GPQA Diamond. Wynik 95,0 w τ²-Bench, od którego zaczyna się nasz własny wpis w katalogu, to ta sama liczba, którą podały materiały premierowe DeepSeek, więc jest to liczba dostawcy w niezależnym gronie, a nie liczba audytowana. Jego odtwarzanie długiego kontekstu wynosi 79,7%, a wynik terminal-bench to 78,7% na harnessie v2.1. To rzeczywiste, porównywalne pomiary znanego modelu.
MiniMax-M3.1-Flash-Preview nie ma żadnej. MiniMax nie opublikował wraz z premierą żadnej tabeli oceny, a żadna strona trzecia również jej nie ma — model w ogóle nie pojawia się w indeksie Artificial Analysis. To nie luka w naszym badaniu; to obecny stan publicznego zapisu, a to oznacza, że każde twierdzenie o jakości nowszego modelu jest w tej chwili przymiotnikiem od dostawcy. Ktokolwiek wręczy ci dziś tabelę wyników MiniMax-M3.1-Flash-Preview, albo cytuje starszy MiniMax-M3, albo ją wymyśla.

DeepSeek V4 Flash nie jest sprzedawany w cenie, którą pamiętasz
Oto pułapka. Powszechnie cytowana stawka dla DeepSeek V4 Flash — 0,14 USD za milion tokenów wejściowych i 0,28 USD za milion tokenów wyjściowych — była cennikiem obowiązującym dla modelu przed 10 września 2026 r. W tym dniu DeepSeek udostępnił DeepSeek-V4.1-Flash, wycofał zarówno V4 Flash, jak i eksperyment V4-Flash-Vision-Exp, oraz obniżył ceny. deepseek-v4-flash to identyfikator, który nadal działa, ale dokumentacja DeepSeek podaje, że jest tymczasowo kierowany do V4.1 Flash i rozliczany według ceny Flash. Innymi słowy, nadal możesz wpisać nazwę starego modelu; nie wywołujesz starego modelu.
Więc prawdziwą kartą, z którą trzeba porównywać, jest obecna — w przeliczeniu na 1 mln tokenów — a poza szczytem to jej tańsza połowa:
• Wejście bez trafienia w pamięć podręczną — 0,15 USD poza szczytem, 0,30 USD w szczycie
• Wejście z trafieniem w pamięć podręczną — 0,003 USD poza szczytem, 0,006 USD w szczycie
• Dane wyjściowe — 0,60 USD poza szczytem, 1,20 USD w szczycie
• Okna szczytu — 01:00–04:00 i 06:00–10:00 UTC, od poniedziałku do piątku, z wyłączeniem chińskich świąt publicznych; wszystko inne, w tym całe weekendy, jest poza szczytem
W przeciwieństwie do tego, MiniMax-M3.1-Flash-Preview nie ma żadnej stawki za token. Jego koszt to kwota, jaką kosztuje Twoje miejsce w Token Plan — $22, $55 lub $132 miesięcznie dla Plus, Max i Ultra — zużywana poprzez wspólną pulę limitów według ceny katalogowej pay-as-you-go każdego modelu, przy czym dostawca zastrzega sobie prawo do zmiany składu tej puli. W przypadku stałego miesięcznego budżetu o przewidywalnym wolumenie może to być doskonała wartość. Dla projektu, który musi przypisywać koszt do poszczególnych wywołań, jest to nieprzejrzystość przebrana za subskrypcję.
Powód, dla którego po stronie DeepSeek ma to większe znaczenie niż zwykle, to mnożnik szczytu. Zespół w Europie lub Azji, pracujący w ciągu swojego dnia roboczego, przez znaczącą część swojego ruchu znajduje się w oknie szczytu i płaci podwójnie za ten przywilej, co zamienia podawaną w nagłówkach stawkę wejściową 0,15 USD w 0,30 USD dokładnie w godzinach, w których większość produktów ma największy ruch. Budżet planuj na podstawie kolumny szczytowej, chyba że Twój ruch rzeczywiście odbywa się nocą w UTC.
Gdzie MiniMax M3.1 Flash Preview jest złym wyborem
Trzy przypadki, a pierwsze dwa łatwo przeoczyć, ponieważ są udokumentowane, a nie odejmowane.
Górny limit wyjścia jest nieznany. Jeśli twoje zadanie kończy się długim generowaniem — pełną specyfikacją, przepisaniem transkrypcji, raportem z adnotacjami — wybierasz budżet wyjściowy, którego nie widzisz. DeepSeek V4 Flash podaje 384 000. Ta asymetria sprzyja starszemu modelowi w przypadku wszystkiego, co dużo pisze.
Myślenia nie można wyłączyć. Wyślij thinking: {"type": "disabled"} do MiniMax-M3.1-Flash-Preview, a otrzymasz HTTP 400: model wymaga adaptacyjnego myślenia. W DeepSeek V4 Flash istnieje tryb bez myślenia i jest obsługiwanym przełącznikiem. W przypadku klasyfikacji, routingu lub krótkiej ekstrakcji strukturalnej o wysokiej przepustowości model, który zawsze najpierw rozumuje, ponosi opóźnienie i zużywa tokeny, o które nie prosiłeś — a jedyną dźwignią, jaką masz, jest obniżenie effort do low, a nie usunięcie rozumowania.
Nie można jej wywołać w modelu pay-as-you-go. Dokumentacja dostawcy jednoznacznie stwierdza, że MiniMax-M3.1-Flash-Preview jest obecnie dostępny wyłącznie przez Token Plan i MiniMax Code, a Subscription Key nie jest wymienny z kluczem API w modelu pay-as-you-go. Jeśli masz już przydzielone miejsce, to zmiana jednej linii. Jeśli nie, ocena tego modelu oznacza wykupienie subskrypcji.
Gdzie liczba DeepSeek to zły wybór
Sytuacja odwrotna jest taka, że DeepSeek V4 Flash obsługuje wyłącznie tekst i został już zastąpiony. Nigdy nie przyjmował obrazów — do tego potrzebny był osobny eksperymentalny build, który został już wycofany razem z nim — a identyfikator modelu wskazuje teraz na inne wagi, niż sugeruje nazwa. Potok przypięty do deepseek-v4-flash w celu zapewnienia powtarzalności opiera się na przekierowaniu, które DeepSeek określa jako tymczasowe.
MiniMax-M3.1-Flash-Preview natywnie przyjmuje tekst, obrazy i wideo, a przy tym jest to obecnie najwyżej plasowany model tekstowy w ofercie dostawcy. Obsługa wideo w cenie modelu Flash nie należy w tym segmencie do częstych.
Oba te zastrzeżenia prowadzą do tego samego wniosku dla każdego, kto obsługuje ruch produkcyjny: identyfikator na fakturze i model, który odpowiedział, nie mają gwarancji, że na zawsze pozostaną tym samym, a warstwa routingu jest miejscem, w którym się to obsługuje, a nie odkrywa.

Jak to rozstrzygnąć w jedno popołudnie
Zacznij od końca zadania, a nie od początku.
Jeśli zadanie polega na generowaniu długich tekstów — czymś, co kończy się zapisaniem dziesiątek tysięcy tokenów — DeepSeek V4 Flash jest jedynym z tych dwóch, który publikuje pułap na tyle wysoki, by móc to obiecać, a jego cennik jest na tyle niski, że mnożnik szczytowy da się przetrwać. Koszt modeluj dla szczytu, a nie poza szczytem, a wycofany identyfikator traktuj jako migrację, której jeszcze nie przeprowadziłeś, a nie jako stabilny kontrakt.
Jeśli zadanie polega na czytaniu i wnioskowaniu na podstawie multimodalnych danych wejściowych w ramach stałego miesięcznego budżetu — nagrania ekranu, zeskanowane dokumenty, przegląd wideo — MiniMax-M3.1-Flash-Preview jest zdolniejszym wariantem, a w ramach stanowiska w Token Plan to najtańszy sposób na uzyskanie wejścia wideo przy tej długości kontekstu. Przyjmij do wiadomości, że kupujesz niezmierzony model, i ogranicz promień rażenia: najważniejsze obciążenie trzymaj na czymś z opublikowanym cennikiem stawek, a połowę eksploracyjną pozwól obsłużyć wersji preview.
Jeśli oba opisy pasują do Twojego pipeline'u, to problem routingu, a nie problem wyboru modelu — i to jest właśnie przypadek, dla którego istniejemy. DeepSeek V4 Flash w OrcaRouterjest dostępny w cenie dostawcy z 0% narzutu — jego pozycja w katalogu pokazuje $0,22 za milion tokenów wejściowych i $0,66 za milion wyjściowych, co odpowiada szczytowej kolumnie aktualnej karty Flash, przekazanej wprost — obok MiniMax-M3 i MiniMax M2.7 w tym samym przedziale cenowym na tym samym kluczu. Jeden endpoint daje dostęp do ponad 200 modeli z automatycznym przełączaniem awaryjnym w tle, dzięki czemu obciążenie może przechodzić między przedziałami cenowymi bez drugiej integracji. MiniMax-M3.1-Flash-Preview nie ma w naszym katalogu; aby do niego dotrzeć, potrzebny jest Token Plan dostawcy i jego produkt do kodowania.
Wersja w jednej linijce: DeepSeek V4 Flash to znana wielkość z opublikowanym pułapem wyjściowym, czytelnym cennikiem stawek i następcą, który po cichu odpowiada na tę samą nazwę; MiniMax-M3.1-Flash-Preview to nowszy, multimodalny, niezmierzony model, którego wypróbowanie kosztuje subskrypcję. Żadne z nich nie jest powodem, by wybrać to drugie — to po prostu fakty, których nie dałoby się uzyskać z porównania ceny za token, przytaczającego cennik, który DeepSeek wycofał we wrześniu.

Porównane w tym artykule1
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
