
MiniMax M3.1 Flash Preview vs DeepSeek V4 Flash: twee goedkope tickets voor 1M-context, één groot sterretje
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 468 tok/s
- openaiNIEUWOpenAI: GPT-6 Luna2026-09-2237Intelligentie
- openaiNIEUWOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- anthropicNIEUWAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- grokNIEUWGrok 4.72026-09-2146Intelligentie
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens · 192 tok/s
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 1329 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 118 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
Als je op zoek bent naar een contextvenster van een miljoen tokens tegen een lage prijs per token, zijn MiniMax-M3.1-Flash-Preview en DeepSeek V4 Flash de twee namen die steeds terugkomen — en het zijn niet echt hetzelfde soort product. DeepSeek V4 Flash is een uitgefaseerd model waarvan de identifier nog steeds antwoordt, en dat voortleeft in een tariefkaart van de leverancier die je tot op de cent kunt lezen. MiniMax-M3.1-Flash-Preview is een live preview zonder enig gepubliceerd tarief. De onderstaande vergelijking is daarom deels een specificatievergelijking en deels een demonstratie van hoe verschillend deze twee leveranciers ervoor kiezen om hetzelfde segment te verkopen.
Beide kanten ervan verdienen het om precies te worden verwoord, omdat de cijfers die de doorslag geven verspreid zijn over een prijspagina van een leverancier, een documentatiestructuur van een leverancier en onze eigen catalogus, en een van de meest herhaalde beweringen over DeepSeek V4 Flash — de prijs — is er een die DeepSeek sindsdien heeft vervangen.
Waarop de twee specificatiebladen daadwerkelijk overeenkomen
De belangrijkste specificaties liggen dicht genoeg bij elkaar om niet de beslissende factor te zijn, met één uitzondering waar niemand reclame voor maakt.
• Contextvenster — 1.000.000 tokens voor MiniMax-M3.1-Flash-Preview tegenover 1.048.576 voor DeepSeek V4 Flash: nominaal identiek, een verschil van 48.576 tokens
• Maximale output — niet gepubliceerd voor MiniMax-M3.1-Flash-Preview; 384.000 tokens voor DeepSeek V4 Flash, wat ongewoon is bij deze prijs en het getal is dat een groot deel van de aankoopbeslissing zou moeten bepalen
• Invoermodaliteiten — tekst, afbeelding en video voor MiniMax-M3.1-Flash-Preview; alleen tekst voor DeepSeek V4 Flash
• Denkbesturing — een inspanning-ladder van laag tot max, denken permanent aan, voor MiniMax-M3.1-Flash-Preview; denken of niet-denken bij DeepSeek V4 Flash, met niet-denken als een echte optie
• Protocolondersteuning — Anthropic-compatibele, OpenAI-compatibele en OpenAI Responses-endpoints voor MiniMax-M3.1-Flash-Preview; dezelfde drie plus chat-prefixvoltooiing bij DeepSeek V4 Flash
• Gewichten — geen voor MiniMax-M3.1-Flash-Preview; de gewichten van DeepSeek V4 Flash werden gepubliceerd, hoewel het model zelf is opgevolgd
• Prijs — niet gepubliceerd voor MiniMax-M3.1-Flash-Preview; gepubliceerd en laag voor DeepSeek V4 Flash
Lees die lijst twee keer, want het uitvoerplafond is het stille gegeven. Een miljoen tokens context met 384.000 tokens uitvoer is een werkelijk lang venster voor generatie in één doorgang. Een miljoen tokens context met een niet-bekendgemaakt uitvoerplafond is een belofte over lezen, niet over schrijven. Als je werklast 'een repository lezen, een migratieplan genereren' is, dan is het tweede getal bepalend of de taak in één aanroep past.
Waarop elk wordt gemeten
Dit is het minst comfortabele deel van de vergelijking, en het is kort.
DeepSeek V4 Flash heeft een benchmarktrackrecord, en dat is onafhankelijk. Artificial Analysis geeft het 34,3 op de Intelligence Index — 42e van 145 modellen op die index — met 69,1 op de Coding Index en 90,8% op GPQA Diamond. De 95,0 op τ²-Bench waarmee onze eigen catalogusvermelding begint, is hetzelfde cijfer dat DeepSeek in het lanceermateriaal noemde, dus het is een leverancierscijfer in onafhankelijk gezelschap, geen geauditeerd cijfer. De long-context recall is 79,7% en de terminal-benchscore is 78,7% op de v2.1-harness. Dat zijn echte, vergelijkbare metingen van een bekend model.
MiniMax-M3.1-Flash-Preview heeft er geen. MiniMax heeft bij de release geen evaluatietabel gepubliceerd, en ook geen enkele derde partij heeft er een — het model komt helemaal niet voor in de index van Artificial Analysis. Dat is geen leemte in ons onderzoek; het is de huidige stand van het openbare record, en het betekent dat elke kwaliteitsclaim over het nieuwere model op dit moment een adjectief van de leverancier is. Iedereen die je vandaag een benchmarktabel voor MiniMax-M3.1-Flash-Preview overhandigt, citeert ofwel de oudere MiniMax-M3 of verzint hem.

DeepSeek V4 Flash wordt niet verkocht voor de prijs die je je herinnert.
Hier is de valkuil. Het bedrag dat veelvuldig wordt aangehaald voor DeepSeek V4 Flash — $0,14 per miljoen inputtokens en $0,28 per miljoen outputtokens — was het tarief dat voor het model gold vóór 10 september 2026. Op die datum bracht DeepSeek DeepSeek-V4.1-Flash uit, stopte het zowel V4 Flash als het V4-Flash-Vision-Exp-experiment, en verlaagde het de prijzen. De deepseek-v4-flash identifier werkt nog steeds, maar in de documentatie van DeepSeek staat dat deze tijdelijk naar V4.1 Flash wordt gerouteerd en tegen de Flash-prijs wordt gefactureerd. Met andere woorden: je kunt nog steeds de oude modelnaam typen; je roept niet het oude model aan.
Dus de echte tariefkaart om mee te vergelijken is de huidige, per 1 miljoen tokens — en buiten de piek is de goedkopere helft ervan:
• Cache-miss-invoer — $0,15 buiten piek, $0,30 tijdens piek
• Cache-hit-invoer — $0,003 buiten piek, $0,006 tijdens piek
• Uitvoer — $0,60 buiten piek, $1,20 tijdens piek
• Piekvensters — 01:00–04:00 en 06:00–10:00 UTC, maandag tot vrijdag, met uitzondering van Chinese feestdagen; al het overige, inclusief volledige weekends, valt buiten de piek
Daarentegen heeft MiniMax-M3.1-Flash-Preview helemaal geen tarief per token. De kosten zijn wat je Token Plan-seat kost — $22, $55 of $132 per maand voor Plus, Max en Ultra — opgebruikt via een gedeelde quotapool tegen de pay-as-you-go-adviesprijs van elk model, waarbij de leverancier zich het recht voorbehoudt de samenstelling van die pool te wijzigen. Voor een vast maandelijks budget met voorspelbaar volume kan dat uitstekende waar voor je geld zijn. Voor een project dat kosten per aanroep moet toewijzen, is het ondoorzichtigheid verkleed als een abonnement.
De reden dat dit aan de DeepSeek-kant meer dan gewoonlijk uitmaakt, is de piekvermenigvuldiger. Een team in Europa of Azië dat gedurende zijn werkdag actief is, valt voor een aanzienlijk deel van zijn verkeer binnen een piekvenster en betaalt daarvoor het dubbele, waardoor een genoemd inputtarief van $0,15 precies in de uren dat de meeste producten het drukst zijn $0,30 wordt. Baseer je budget op de piekkolom, tenzij je verkeer echt 's nachts in UTC draait.
Waar MiniMax M3.1 Flash Preview de verkeerde keuze is
Drie gevallen, en de eerste twee zijn gemakkelijk te missen omdat ze gedocumenteerd zijn in plaats van afgetrokken.
Het outputplafond is onbekend. Als je taak uitmondt in een lange generatie — een volledige specificatie, een herschreven transcript, een geannoteerd rapport — kies je een outputbudget dat je niet kunt zien. DeepSeek V4 Flash publiceert 384.000. Die asymmetrie bevoordeelt het oudere model voor alles wat veel tekst produceert.
Denken kan niet worden uitgeschakeld. Stuur thinking: {"type": "disabled"} naar MiniMax-M3.1-Flash-Preview en je krijgt een HTTP 400: het model vereist adaptief denken. Op DeepSeek V4 Flash bestaat een niet-denkmodus en die is een ondersteunde schakelaar. Voor classificatie met hoge doorvoer, routering of korte gestructureerde extractie kost een model dat altijd eerst redeneert je latentie en tokens die je niet hebt gevraagd — en de enige hendel die je hebt, is het verlagen van inspanning naar laag, niet het verwijderen van het redeneren.
Het kan niet worden aangeroepen via pay-as-you-go. De documentatie van de leverancier is ondubbelzinnig: MiniMax-M3.1-Flash-Preview is op dit moment alleen beschikbaar via Token Plan en MiniMax Code, en de Subscription Key is niet uitwisselbaar met een pay-as-you-go API-sleutel. Als je al een seat hebt, is het een wijziging van één regel. Als je er geen hebt, betekent het evalueren van dit model dat je een abonnement koopt.
Waar het DeepSeek-getal de verkeerde keuze is
Het spiegelbeeld is dat DeepSeek V4 Flash alleen tekst ondersteunt en al achterhaald is. Het accepteerde nooit afbeeldingen — dat werk vereiste de aparte experimentele build, die nu samen daarmee is stopgezet — en de model-ID verwijst nu naar andere gewichten dan de naam suggereert. Een pipeline die aan deepseek-v4-flash is vastgezet voor reproduceerbaarheid, vertrouwt op een redirect die DeepSeek als tijdelijk omschrijft.
MiniMax-M3.1-Flash-Preview verwerkt tekst, afbeeldingen en video native, en het is het huidige topmodel voor tekst van de leverancier. Video-invoer tegen een Flash-prijs is niet gebruikelijk in dit segment.
Beide kanttekeningen wijzen in dezelfde richting voor iedereen die productieverkeer draait: de identificatie op de factuur en het model dat antwoordde, zijn niet gegarandeerd voor onbepaalde tijd hetzelfde, en een routeringslaag is de plek waar dat wordt afgehandeld in plaats van ontdekt.

Hoe je dit in één middag beslist
Begin bij het einde van de taak in plaats van bij het begin.
Als de taak het genereren van lange teksten is — alles wat eindigt met het schrijven van tienduizenden tokens — dan is DeepSeek V4 Flash de enige van de twee die een plafond publiceert dat groot genoeg is om het te beloven, en zijn tariefkaart is klein genoeg dat de piekvermenigvuldiging te overleven is. Modelleer de kosten op piekmomenten, niet buiten de piek, en behandel de buiten gebruik gestelde identifier als een migratie die je nog niet hebt uitgevoerd, in plaats van als een stabiel contract.
Als de taak bestaat uit het lezen en redeneren over multimodale input binnen een vast maandbudget — schermopnames, gescande documenten, videobeoordeling — dan is MiniMax-M3.1-Flash-Preview de capabelere vorm, en binnen een Token Plan-seat is het de goedkoopste manier om video-input op deze contextlengte te krijgen. Accepteer dat je een ongemeten model koopt, en beperk de schade: houd de workload die ertoe doet op iets met een gepubliceerde tariefkaart, en laat de preview de verkennende helft voor zijn rekening nemen.
Als beide beschrijvingen bij je pipeline passen, is dat een routeringsprobleem en niet een modelselectieprobleem, en dat is precies het geval waarvoor wij bestaan. DeepSeek V4 Flash op OrcaRouter zit op het tarief van de provider met 0% opslag — de catalogusvermelding toont $0,22 per miljoen inputtokens en $0,66 per miljoen output, wat de piek-kolom van de huidige Flash-kaart is, rechtstreeks doorgegeven — naast MiniMax-M3 en MiniMax M2.7 in dezelfde prijsklasse op dezelfde sleutel. Eén endpoint bereikt 200+ modellen met automatische failover erachter, zodat een workload tussen prijsklassen kan bewegen zonder een tweede integratie. MiniMax-M3.1-Flash-Preview staat niet in onze catalogus; om er te komen heb je het Token Plan van de leverancier en het codingproduct nodig.
De samenvatting in één regel: DeepSeek V4 Flash is de bekende grootheid met het gepubliceerde outputplafond, de leesbare tariefkaart en een opvolger die stilletjes dezelfde naam draagt; MiniMax-M3.1-Flash-Preview is de nieuwere, multimodale, nog niet doorgemeten variant waarvoor je een abonnement nodig hebt om hem te proberen. Geen van beide is een reden om voor de andere te kiezen — het zijn simpelweg de feiten die je niet zou krijgen uit een prijs-per-tokenvergelijking die een tariefkaart aanhaalt die DeepSeek in september buiten gebruik heeft gesteld.

Vergeleken in dit artikel1
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
