Wygenerowana karta hero zatytułowana MiniMax M3.1 Flash Preview vs DeepSeek V4 Flash, z podtytułem „To samo okno 1 mln tokenów, dwie bardzo różne propozycje sprzedażowe”. Lewa karta głosi: „MiniMax M3.1 Flash Preview: kontekst 1M, cena niepublikowana, tylko Token Plan, myślenie nie może zostać wyłączone”; prawa karta głosi: „DeepSeek V4 Flash: kontekst 1M, $0.15/$0.60 poza szczytem, tylko tekst, zastąpiony przez V4.1 Flash”. Stopka głosi: „Dane MiniMax według platform.minimax.io; dane DeepSeek według opublikowanego cennika DeepSeek”.
Engineering & Research

MiniMax M3.1 Flash Preview vs DeepSeek V4 Flash: dwa tanie bilety do kontekstu 1M, jedna wielka gwiazdka

Autor

Gideon Frost

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Jeśli szukasz okna kontekstu mieszczącego milion tokenów w niskiej cenie za token, MiniMax-M3.1-Flash-Preview i DeepSeek V4 Flash to dwie nazwy, które ciągle się pojawiają — i nie są to tak naprawdę produkty tego samego rodzaju. DeepSeek V4 Flash to wycofany model, którego identyfikator nadal odpowiada, żyjący w cenniku dostawcy, który możesz odczytać co do centa. MiniMax-M3.1-Flash-Preview to aktywna wersja zapoznawcza bez żadnej opublikowanej stawki. Poniższe porównanie jest więc częściowo porównaniem specyfikacji, a częściowo demonstracją, jak odmiennie ci dwaj dostawcy wybierają sprzedaż tej samej półki.

Obie strony tego warto przedstawić precyzyjnie, ponieważ liczby, które o tym decydują, są rozproszone po stronie cennika dostawcy, drzewie dokumentacji dostawcy i w naszym własnym katalogu, a jedno z najczęściej powtarzanych twierdzeń o DeepSeek V4 Flash — jego cena — zostało od tego czasu przez DeepSeek zmienione.

W czym obie karty specyfikacji faktycznie się zgadzają

Główne parametry są na tyle zbliżone, że nie są czynnikiem decydującym, z jednym wyjątkiem, którego nikt nie reklamuje.

• Okno kontekstowe — 1 000 000 tokenów dla MiniMax-M3.1-Flash-Preview w porównaniu z 1 048 576 dla DeepSeek V4 Flash: nominalnie identyczne, różnica 48 576 tokenów
• Maksymalna długość wyjścia — niepublikowana dla MiniMax-M3.1-Flash-Preview; 384 000 tokenów dla DeepSeek V4 Flash, co jest nietypowe w tej cenie i jest liczbą, która powinna rozstrzygać o wielu decyzjach zakupowych
• Modalności wejściowe — tekst, obraz i wideo dla MiniMax-M3.1-Flash-Preview; tylko tekst dla DeepSeek V4 Flash
• Kontrola myślenia — poziom wysiłku — drabinka od niskiego do maksymalnego, myślenie stale włączone, dla MiniMax-M3.1-Flash-Preview; myślenie lub brak myślenia w DeepSeek V4 Flash, przy czym brak myślenia jest realną opcją
• Obsługa protokołów — punkty końcowe zgodne z Anthropic, zgodne z OpenAI oraz OpenAI Responses dla MiniMax-M3.1-Flash-Preview; te same trzy plus uzupełnianie prefiksu czatu w DeepSeek V4 Flash
• Wagi — brak dla MiniMax-M3.1-Flash-Preview; wagi DeepSeek V4 Flash zostały opublikowane, choć sam model został już zastąpiony
• Cena — niepublikowana dla MiniMax-M3.1-Flash-Preview; opublikowana i niska dla DeepSeek V4 Flash

Przeczytaj tę listę dwa razy, ponieważ to limit wyjściowy jest tym cichym. Milion tokenów kontekstu i 384 000 tokenów wyjścia to naprawdę długie okno generowania jednoprzebiegowego. Milion tokenów kontekstu z nieujawnionym limitem wyjściowym to obietnica dotycząca czytania, a nie pisania. Jeśli twoje obciążenie to „przeczytaj repozytorium, wygeneruj plan migracji”, to druga liczba jest tą, która decyduje, czy zadanie zmieści się w jednym wywołaniu.

Co jest mierzone w przypadku każdego z nich

To najmniej komfortowa część porównania i jest krótka.

DeepSeek V4 Flash ma wynik benchmarkowy i jest on niezależny. Artificial Analysis przyznaje mu 34,3 w Intelligence Index — 42. miejsce spośród 145 modeli w tym indeksie — oraz 69,1 w Coding Index i 90,8% w GPQA Diamond. Wynik 95,0 w τ²-Bench, od którego zaczyna się nasz własny wpis w katalogu, to ta sama liczba, którą podały materiały premierowe DeepSeek, więc jest to liczba dostawcy w niezależnym gronie, a nie liczba audytowana. Jego odtwarzanie długiego kontekstu wynosi 79,7%, a wynik terminal-bench to 78,7% na harnessie v2.1. To rzeczywiste, porównywalne pomiary znanego modelu.

MiniMax-M3.1-Flash-Preview nie ma żadnej. MiniMax nie opublikował wraz z premierą żadnej tabeli oceny, a żadna strona trzecia również jej nie ma — model w ogóle nie pojawia się w indeksie Artificial Analysis. To nie luka w naszym badaniu; to obecny stan publicznego zapisu, a to oznacza, że każde twierdzenie o jakości nowszego modelu jest w tej chwili przymiotnikiem od dostawcy. Ktokolwiek wręczy ci dziś tabelę wyników MiniMax-M3.1-Flash-Preview, albo cytuje starszy MiniMax-M3, albo ją wymyśla.

A generated two-column scoreboard titled 'MiniMax M3.1 Flash Preview vs DeepSeek V4 Flash — the scoreboard'. The left column, MiniMax M3.1 Flash Preview, reads 'AA Intelligence: none published', 'Coding score: none published', 'Context window: 1M', 'Max output: not published', 'Weights: none', 'Price: not published'. The right column, DeepSeek V4 Flash, reads 'AA Intelligence: 34.3', 'Coding score: 69.1', 'Context window: 1,048,576', 'Max output: 384,000', 'Weights: published', 'Price: $0.15 / $0.60 off-peak'. A footer reads 'MiniMax figures per platform.minimax.io documentation, 27 September 2026; DeepSeek figures per DeepSeek's published rate card and Artificial Analysis. The MiniMax column is empty because nothing has been published, not because a result is pending.'

DeepSeek V4 Flash nie jest sprzedawany w cenie, którą pamiętasz

Oto pułapka. Powszechnie cytowana stawka dla DeepSeek V4 Flash — 0,14 USD za milion tokenów wejściowych i 0,28 USD za milion tokenów wyjściowych — była cennikiem obowiązującym dla modelu przed 10 września 2026 r. W tym dniu DeepSeek udostępnił DeepSeek-V4.1-Flash, wycofał zarówno V4 Flash, jak i eksperyment V4-Flash-Vision-Exp, oraz obniżył ceny. deepseek-v4-flash to identyfikator, który nadal działa, ale dokumentacja DeepSeek podaje, że jest tymczasowo kierowany do V4.1 Flash i rozliczany według ceny Flash. Innymi słowy, nadal możesz wpisać nazwę starego modelu; nie wywołujesz starego modelu.

Więc prawdziwą kartą, z którą trzeba porównywać, jest obecna — w przeliczeniu na 1 mln tokenów — a poza szczytem to jej tańsza połowa:

• Wejście bez trafienia w pamięć podręczną — 0,15 USD poza szczytem, 0,30 USD w szczycie
• Wejście z trafieniem w pamięć podręczną — 0,003 USD poza szczytem, 0,006 USD w szczycie
• Dane wyjściowe — 0,60 USD poza szczytem, 1,20 USD w szczycie
• Okna szczytu — 01:00–04:00 i 06:00–10:00 UTC, od poniedziałku do piątku, z wyłączeniem chińskich świąt publicznych; wszystko inne, w tym całe weekendy, jest poza szczytem

W przeciwieństwie do tego, MiniMax-M3.1-Flash-Preview nie ma żadnej stawki za token. Jego koszt to kwota, jaką kosztuje Twoje miejsce w Token Plan — $22, $55 lub $132 miesięcznie dla Plus, Max i Ultra — zużywana poprzez wspólną pulę limitów według ceny katalogowej pay-as-you-go każdego modelu, przy czym dostawca zastrzega sobie prawo do zmiany składu tej puli. W przypadku stałego miesięcznego budżetu o przewidywalnym wolumenie może to być doskonała wartość. Dla projektu, który musi przypisywać koszt do poszczególnych wywołań, jest to nieprzejrzystość przebrana za subskrypcję.

Powód, dla którego po stronie DeepSeek ma to większe znaczenie niż zwykle, to mnożnik szczytu. Zespół w Europie lub Azji, pracujący w ciągu swojego dnia roboczego, przez znaczącą część swojego ruchu znajduje się w oknie szczytu i płaci podwójnie za ten przywilej, co zamienia podawaną w nagłówkach stawkę wejściową 0,15 USD w 0,30 USD dokładnie w godzinach, w których większość produktów ma największy ruch. Budżet planuj na podstawie kolumny szczytowej, chyba że Twój ruch rzeczywiście odbywa się nocą w UTC.

Gdzie MiniMax M3.1 Flash Preview jest złym wyborem

Trzy przypadki, a pierwsze dwa łatwo przeoczyć, ponieważ są udokumentowane, a nie odejmowane.

Górny limit wyjścia jest nieznany. Jeśli twoje zadanie kończy się długim generowaniem — pełną specyfikacją, przepisaniem transkrypcji, raportem z adnotacjami — wybierasz budżet wyjściowy, którego nie widzisz. DeepSeek V4 Flash podaje 384 000. Ta asymetria sprzyja starszemu modelowi w przypadku wszystkiego, co dużo pisze.

Myślenia nie można wyłączyć. Wyślij thinking: {"type": "disabled"} do MiniMax-M3.1-Flash-Preview, a otrzymasz HTTP 400: model wymaga adaptacyjnego myślenia. W DeepSeek V4 Flash istnieje tryb bez myślenia i jest obsługiwanym przełącznikiem. W przypadku klasyfikacji, routingu lub krótkiej ekstrakcji strukturalnej o wysokiej przepustowości model, który zawsze najpierw rozumuje, ponosi opóźnienie i zużywa tokeny, o które nie prosiłeś — a jedyną dźwignią, jaką masz, jest obniżenie effort do low, a nie usunięcie rozumowania.

Nie można jej wywołać w modelu pay-as-you-go. Dokumentacja dostawcy jednoznacznie stwierdza, że MiniMax-M3.1-Flash-Preview jest obecnie dostępny wyłącznie przez Token Plan i MiniMax Code, a Subscription Key nie jest wymienny z kluczem API w modelu pay-as-you-go. Jeśli masz już przydzielone miejsce, to zmiana jednej linii. Jeśli nie, ocena tego modelu oznacza wykupienie subskrypcji.

Gdzie liczba DeepSeek to zły wybór

Sytuacja odwrotna jest taka, że DeepSeek V4 Flash obsługuje wyłącznie tekst i został już zastąpiony. Nigdy nie przyjmował obrazów — do tego potrzebny był osobny eksperymentalny build, który został już wycofany razem z nim — a identyfikator modelu wskazuje teraz na inne wagi, niż sugeruje nazwa. Potok przypięty do deepseek-v4-flash w celu zapewnienia powtarzalności opiera się na przekierowaniu, które DeepSeek określa jako tymczasowe.

MiniMax-M3.1-Flash-Preview natywnie przyjmuje tekst, obrazy i wideo, a przy tym jest to obecnie najwyżej plasowany model tekstowy w ofercie dostawcy. Obsługa wideo w cenie modelu Flash nie należy w tym segmencie do częstych.

Oba te zastrzeżenia prowadzą do tego samego wniosku dla każdego, kto obsługuje ruch produkcyjny: identyfikator na fakturze i model, który odpowiedział, nie mają gwarancji, że na zawsze pozostaną tym samym, a warstwa routingu jest miejscem, w którym się to obsługuje, a nie odkrywa.

A generated infographic titled 'The two Flash brackets, side by side' listing six paired rows: 'Sales motion — subscription seat vs per-token rate card', 'Effective input rate — Token Plan quota vs $0.15 off-peak / $0.30 peak', 'Peak surcharge — not applicable vs doubles 01:00-04:00 and 06:00-10:00 UTC', 'Cost attribution — pooled quota vs metered per call', 'Failure mode — no published output ceiling vs identifier now serves a successor', and 'Best fit — fixed-budget teams vs metered pipelines'. A footer reads 'Both models carry a 1M-token context window; neither figure is a quality claim.'

Jak to rozstrzygnąć w jedno popołudnie

Zacznij od końca zadania, a nie od początku.

Jeśli zadanie polega na generowaniu długich tekstów — czymś, co kończy się zapisaniem dziesiątek tysięcy tokenów — DeepSeek V4 Flash jest jedynym z tych dwóch, który publikuje pułap na tyle wysoki, by móc to obiecać, a jego cennik jest na tyle niski, że mnożnik szczytowy da się przetrwać. Koszt modeluj dla szczytu, a nie poza szczytem, a wycofany identyfikator traktuj jako migrację, której jeszcze nie przeprowadziłeś, a nie jako stabilny kontrakt.

Jeśli zadanie polega na czytaniu i wnioskowaniu na podstawie multimodalnych danych wejściowych w ramach stałego miesięcznego budżetu — nagrania ekranu, zeskanowane dokumenty, przegląd wideo — MiniMax-M3.1-Flash-Preview jest zdolniejszym wariantem, a w ramach stanowiska w Token Plan to najtańszy sposób na uzyskanie wejścia wideo przy tej długości kontekstu. Przyjmij do wiadomości, że kupujesz niezmierzony model, i ogranicz promień rażenia: najważniejsze obciążenie trzymaj na czymś z opublikowanym cennikiem stawek, a połowę eksploracyjną pozwól obsłużyć wersji preview.

Jeśli oba opisy pasują do Twojego pipeline'u, to problem routingu, a nie problem wyboru modelu — i to jest właśnie przypadek, dla którego istniejemy. DeepSeek V4 Flash w OrcaRouterjest dostępny w cenie dostawcy z 0% narzutu — jego pozycja w katalogu pokazuje $0,22 za milion tokenów wejściowych i $0,66 za milion wyjściowych, co odpowiada szczytowej kolumnie aktualnej karty Flash, przekazanej wprost — obok MiniMax-M3 i MiniMax M2.7 w tym samym przedziale cenowym na tym samym kluczu. Jeden endpoint daje dostęp do ponad 200 modeli z automatycznym przełączaniem awaryjnym w tle, dzięki czemu obciążenie może przechodzić między przedziałami cenowymi bez drugiej integracji. MiniMax-M3.1-Flash-Preview nie ma w naszym katalogu; aby do niego dotrzeć, potrzebny jest Token Plan dostawcy i jego produkt do kodowania.

Wersja w jednej linijce: DeepSeek V4 Flash to znana wielkość z opublikowanym pułapem wyjściowym, czytelnym cennikiem stawek i następcą, który po cichu odpowiada na tę samą nazwę; MiniMax-M3.1-Flash-Preview to nowszy, multimodalny, niezmierzony model, którego wypróbowanie kosztuje subskrypcję. Żadne z nich nie jest powodem, by wybrać to drugie — to po prostu fakty, których nie dałoby się uzyskać z porównania ceny za token, przytaczającego cennik, który DeepSeek wycofał we wrześniu.

A headless Chromium screenshot of the OrcaRouter model page for deepseek/deepseek-v4-flash, showing the model title 'DeepSeek: DeepSeek V4 Flash', a pricing row reading 0.22 US dollars per million input tokens and 0.66 per million output tokens, a context window of 1,048,576 tokens, and a maximum output of 384,000 tokens, captured 28 September 2026.

Porównane w tym artykule1

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie