
MiniMax M3.1 Flash Preview vs DeepSeek V4 Flash: Två billiga biljetter med 1M-kontext, en enorm asterisk
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 468 tok/s
- openaiNYOpenAI: GPT-6 Luna2026-09-2237Intelligens
- openaiNYOpenAI: GPT-6 Sol2026-09-2248Intelligens
- anthropicNYAnthropic: Claude Opus 5.52026-09-2258Intelligens
- grokNYGrok 4.72026-09-2146Intelligens
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens · 192 tok/s
- orcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 1329 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 118 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0540Intelligens72Kodning
Om du letar efter ett kontextfönster på en miljon tokens till ett lågt pris per token är MiniMax-M3.1-Flash-Preview och DeepSeek V4 Flash de två namn som ständigt dyker upp – och de är egentligen inte samma typ av produkt. DeepSeek V4 Flash är en pensionerad modell vars identifierare fortfarande svarar, och som lever kvar i en leverantörs prislista som du kan läsa på öret. MiniMax-M3.1-Flash-Preview är en liveförhandsvisning utan publicerad taxa över huvud taget. Jämförelsen nedan är därför delvis en specifikationsjämförelse och delvis en demonstration av hur olika dessa två leverantörer väljer att sälja samma segment.
Båda sidorna av det är värda att ange exakt, eftersom siffrorna som avgör saken är utspridda över en leverantörs prissida, en leverantörs dokumentationsträd och vår egen katalog, och ett av de mest upprepade påståendena om DeepSeek V4 Flash – dess pris – är ett som DeepSeek sedan dess har ersatt.
Vad de två specifikationsbladen faktiskt matchar på
De viktigaste specifikationerna är så pass lika att de inte är avgörande, med ett undantag som ingen gör reklam för.
• Kontextfönster — 1 000 000 tokens för MiniMax-M3.1-Flash-Preview mot 1 048 576 för DeepSeek V4 Flash: nominellt identiska, en skillnad på 48 576 tokens
• Maximalt utdata — inte publicerat för MiniMax-M3.1-Flash-Preview; 384 000 tokens för DeepSeek V4 Flash, vilket är ovanligt till detta pris och är siffran som borde avgöra en hel del inköp
• Indatamodaliteter — text, bild och video för MiniMax-M3.1-Flash-Preview; endast text för DeepSeek V4 Flash
• Tankestyrning — en ansträngningsstege från låg till max, tänkande permanent påslaget, för MiniMax-M3.1-Flash-Preview; tänkande eller icke-tänkande på DeepSeek V4 Flash, med icke-tänkande som ett verkligt alternativ
• Protokollstöd — Anthropic-kompatibla, OpenAI-kompatibla och OpenAI Responses-slutpunkter för MiniMax-M3.1-Flash-Preview; samma tre plus chattprefixkomplettering på DeepSeek V4 Flash
• Vikter — inga för MiniMax-M3.1-Flash-Preview; DeepSeeks vikter för V4 Flash publicerades, även om modellen själv har ersatts
• Pris — opublicerat för MiniMax-M3.1-Flash-Preview; publicerat och lågt för DeepSeek V4 Flash
Läs den listan två gånger, för det är taket för utdata som är det tysta. En miljon tokens i kontext med 384 000 tokens i utdata är ett verkligt långt genereringsfönster för ett enda pass. En miljon tokens i kontext med ett ej angivet tak för utdata är ett löfte om läsning, inte om skrivning. Om din arbetsbelastning är "läs ett kodförråd, ta fram en migreringsplan", är det andra numret det som avgör om uppgiften ryms i ett anrop.
Vad var och en mäts vid
Det här är den minst bekväma delen av jämförelsen, och den är kort.
DeepSeek V4 Flash har ett benchmarkresultat, och det är oberoende. Artificial Analysis ger den 34,3 på Intelligence Index – 42:a av 145 modeller på det indexet – med 69,1 på Coding Index och 90,8 % på GPQA Diamond. Den 95,0 på τ²-Bench som vår egen katalogpost inleder med är samma siffra som DeepSeeks lanseringsmaterial angav, så det är en leverantörssiffra i sällskap med oberoende mätningar snarare än en granskad sådan. Dess långkontextsåterkallelse är 79,7 % och dess terminal-bench-siffra är 78,7 % på v2.1-testramverket. Dessa är verkliga, jämförbara mätningar av en känd modell.
MiniMax-M3.1-Flash-Preview har ingen. MiniMax publicerade ingen utvärderingstabell i samband med lanseringen, och ingen tredje part har en heller – modellen finns inte alls med i indexet från Artificial Analysis. Det är inte en lucka i vår undersökning; det är det nuvarande offentliga kunskapsläget, och det betyder att varje kvalitetsanspråk om den nyare modellen för närvarande är ett adjektiv från leverantören. Den som i dag ger dig en benchmarktabell för MiniMax-M3.1-Flash-Preview citerar antingen den äldre MiniMax-M3 eller hittar på den.

DeepSeek V4 Flash säljs inte till priset du minns.
Här är fällan. Siffran som ofta citeras för DeepSeek V4 Flash – 0,14 USD per miljon indata-tokens och 0,28 USD per miljon utdata-tokens – var den prislapp modellen hade före den 10 september 2026. Det datumet släppte DeepSeek DeepSeek-V4.1-Flash, tog både V4 Flash och experimentet V4-Flash-Vision-Exp ur bruk och sänkte priserna. deepseek-v4-flash fungerar fortfarande som identifierare, men DeepSeeks dokumentation anger att den tillfälligt dirigeras till V4.1 Flash och faktureras enligt Flash-priset. Med andra ord kan du fortfarande skriva det gamla modellnamnet; du anropar inte den gamla modellen.
Så det riktiga kortet att jämföra mot är det nuvarande, per 1 miljon tokens — och off-peak är den billigare hälften av det:
• Indata vid cachemiss — $0.15 utanför högtrafik, $0.30 vid högtrafik
• Indata vid cacheträff — $0.003 utanför högtrafik, $0.006 vid högtrafik
• Utdata — $0.60 utanför högtrafik, $1.20 vid högtrafik
• Högtrafikfönster — 01:00–04:00 och 06:00–10:00 UTC, måndag till fredag, exklusive kinesiska allmänna helgdagar; allt annat, inklusive hela helger, är utanför högtrafik
Som kontrast har MiniMax-M3.1-Flash-Preview ingen taxa per token av något slag. Dess kostnad är vad din Token Plan-plats kostar — 22, 55 eller 132 dollar per månad för Plus, Max och Ultra — som förbrukas via en delad kvotpool till varje modells listpris för betalning per användning, medan leverantören förbehåller sig rätten att ändra sammansättningen av den poolen. För en fast månadsbudget med förutsägbar volym kan det vara ett utmärkt värde. För ett projekt som behöver hänföra kostnad per anrop är det ogenomskinlighet utklädd till en prenumeration.
Anledningen till att detta spelar större roll än vanligt på DeepSeek-sidan är peak-multiplikatorn. Ett team i Europa eller Asien som kör sin arbetsdag ligger inom ett peak-fönster för en betydande del av sin trafik och betalar dubbelt för det, vilket förvandlar ett annonserat indatapris på $0.15 till $0.30 under precis de timmar då de flesta produkter är som mest belastade. Budgetera utifrån peak-kolumnen om inte din trafik verkligen går nattetid i UTC.
Där MiniMax M3.1 Flash Preview är fel val
Tre fall, och de två första är lätta att missa eftersom de är dokumenterade snarare än subtraherade.
Utdatataket är okänt. Om din uppgift slutar i en lång generering – en fullständig specifikation, en omskrivning av en transkription, en annoterad rapport – väljer du en utdatabudget som du inte kan se. DeepSeek V4 Flash publicerar 384 000. Den asymmetrin gynnar den äldre modellen för allt som skriver mycket.
Tänkande kan inte stängas av. Skicka thinking: {"type": "disabled"} till MiniMax-M3.1-Flash-Preview och du får HTTP 400: modellen kräver adaptivt tänkande. På DeepSeek V4 Flash finns ett icke-tänkande läge och det är en växel som stöds. För klassificering, routning eller kort strukturerad extrahering med hög genomströmning betalar en modell som alltid resonerar först med latens och tokens som du inte bad om — och den enda hävstången du har är att sänka effort till low, inte att ta bort resonemanget.
Det går inte att anropa den med pay-as-you-go. Leverantörens dokumentation är entydig: MiniMax-M3.1-Flash-Preview är för närvarande endast tillgänglig via Token Plan och MiniMax Code, och Subscription Key är inte utbytbar mot en API-nyckel för pay-as-you-go. Om du redan har en plats är det en ändring på en rad. Om inte innebär en utvärdering av den här modellen att du köper en prenumeration.
Där DeepSeek-siffran är fel val
Det omvända förhållandet är att DeepSeek V4 Flash endast hanterar text och redan har ersatts. Den tog aldrig emot bilder – det arbetet krävde det separata experimentella bygget, som nu har avvecklats tillsammans med den – och modellidentifieraren tillhandahåller nu andra vikter än vad namnet antyder. En pipeline som är låst till deepseek-v4-flash för reproducerbarhet förlitar sig på en omdirigering som DeepSeek beskriver som tillfällig.
MiniMax-M3.1-Flash-Preview tar text, bild och video nativt, och det är leverantörens nuvarande bästa textmodell. Videoinmatning till Flash-pris är inte vanligt i den här klassen.
Båda förbehållen pekar åt samma håll för alla som kör produktionstrafik: identifieraren på fakturan och modellen som svarade är inte garanterat samma sak i all oändlighet, och ett routningslager är där det hanteras i stället för att upptäckas.

Hur man avgör detta på en eftermiddag
Börja från slutet av uppgiften snarare än från början.
Om jobbet är långformsgenerering – allt som avslutas med att skriva tiotusentals tokens – är DeepSeek V4 Flash den enda av de två som publicerar ett tak som är tillräckligt högt för att kunna lova det, och dess prislista är tillräckligt låg för att toppmultiplikatorn ska gå att överleva. Modellera kostnaden vid topp, inte utanför topp, och behandla den pensionerade identifieraren som en migrering du ännu inte har gjort snarare än ett stabilt kontrakt.
Om jobbet går ut på att läsa och resonera över multimodala indata inom en fast månadsbudget – skärminspelningar, skannade dokument, videogranskning – är MiniMax-M3.1-Flash-Preview den mer kapabla formen, och inom en Token Plan-plats är den det billigaste sättet att få videoindata vid den här kontextlängden. Acceptera att du köper en icke uppmätt modell, och begränsa sprängradien: håll arbetsbelastningen som spelar roll på något med en publicerad prislista, och låt förhandsversionen hantera den utforskande halvan.
Om båda beskrivningarna passar din pipeline är det ett routingproblem snarare än ett modellvalsproblem, och det är just det fallet vi finns till för. DeepSeek V4 Flash på OrcaRouter ligger på leverantörens pris med 0 % påslag — dess katalogpost visar $0,22 per miljon indata-tokens och $0,66 per miljon utdata, vilket är den högsta kolumnen i det aktuella Flash-kortet, direkt vidarebefordrat — tillsammans med MiniMax-M3 och MiniMax M2.7 i samma prisklass på samma nyckel. En slutpunkt når 200+ modeller med automatisk redundansväxling bakom sig, så att en arbetsbelastning kan flytta sig mellan prisklasser utan en andra integration. MiniMax-M3.1-Flash-Preview finns inte i vår katalog; att nå den innebär leverantörens Token Plan och dess kodningsprodukt.
Enradsversionen: DeepSeek V4 Flash är den kända storheten med det publicerade taket för utdata, den läsbara prislistan och en efterträdare som i tysthet svarar på sitt namn; MiniMax-M3.1-Flash-Preview är den nyare, multimodala, ouppmätta som kräver en prenumeration för att testa. Inget av detta är ett skäl att välja det ena framför det andra – de är bara fakta du inte skulle få från en jämförelse av pris per token som citerar en prislista som DeepSeek pensionerade i september.

Jämförda i den här artikeln1
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
