
DeepSeek V4 Pro vs MiniMax M3: Hetzelfde open-weights-spel voor vijf keer de prijs
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiNIEUWOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleNIEUWGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenNIEUWQwen: Qwen3.8 Max (0902)2026-09-0240Intelligentie72Coderen
- anthropicNIEUWAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0340Intelligentie72Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Intelligentie78Coderen
- googleGoogle: Gemini 3.6 Flash2026-07-2134Intelligentie69Coderen
DeepSeek V4 Pro and MiniMax M3 are both open-weights reasoning models with a million-token context, and they are both cheap enough that the word "budget" no longer means "weak." But their launches could not look more different: MiniMax M3 (MiniMax's 428B-parameter model, released June 2026) went out with a community license and a $0.30/$1.20 per million token price that undercut the entire field, while DeepSeek V4 Pro (released August 13, 2026, at $0.66/$1.98 off-peak, $1.32/$3.96 peak) arrived six weeks later with MIT-licensed weights and a slightly higher price. The twist is what happened to the more expensive one: between September 8 and 11, DeepSeek first scheduled V4 Pro for retirement, then delayed it, then cancelled the retirement entirely, committing to keep serving it at unchanged billing. So the matchup that a month ago looked like "cheap and cheaper" now has a durability story on the one side that no one expected — and that makes it worth re-reading the whole thing.
Onafhankelijke metingen hieronder zijn afkomstig van Artificial Analysis. Door leveranciers gerapporteerde cijfers zijn als zodanig aangeduid.
Twee budget open-weights vlaggenschepen, één indexpunt uit elkaar
Op de Artificial Analysis Intelligence Index scoort MiniMax M3 30 en staat op #16 in zijn klasse, en DeepSeek V4 Pro scoort 36 en staat op #7. Een verschil van zes punten tussen modellen die per token bijna hetzelfde kosten. Dat is de kop: het duurdere model is ook het meetbaar slimmere — maar slechts met zes punten, en alleen op de as met alleen tekst, waar V4 Pro zich bevindt. MiniMax M3 accepteert tekst-, beeld- en video-invoer; V4 Pro ondersteunt alleen tekst. Als multimodale invoer een vereiste is, houdt de vergelijking daar op — MiniMax M3 is de enige van de twee die video leest.
• Intelligentie-index — V4 Pro 36 (#7/113) vs MiniMax M3 30 (#16/113)
• Prijs — MiniMax M3 $0,30/$1,20 per 1 mln. vs. V4 Pro $0,66/$1,98 buiten piekuren ($1,32/$3,96 in piekuren)
• Snelheid — MiniMax M3 ~103 tokens/sec vs V4 Pro ~81 tokens/sec
• Context — beide 1M tokens
• Parameters — MiniMax M3 428B totaal / 23B actief vs V4 Pro 1,6T totaal / 49B actief
• Invoer — MiniMax M3 tekst/afbeelding/video vs V4 Pro alleen tekst
• License — MiniMax Community License vs V4 Pro MIT
De prijzenrace is heviger dan de sticker doet vermoeden.
Naast elkaar gezet is MiniMax M3 2,2x goedkoper op input en 1,65x goedkoper op output dan het dalurentarief van V4 Pro. Maar de stickerprijzen verbergen de cache- en piekmechanismen. Het dalurenvenster van V4 Pro halveert zijn toch al lage prijzen, en de korting op cache-leesbewerkingen loopt op tot ongeveer 97% — ongeveer $0,02 per miljoen gecachte tokens in de daluren. De cacheprijsstelling van MiniMax M3 is minder agressief. Voor een workload die een grote prefix hergebruikt — een grote systeemprompt, een lang document, een retrievalcorpus — kunnen de effectieve kosten per token van V4 Pro in zijn daluren-cachevenster onder de hoofdpijs van MiniMax M3 duiken, wat een verrassende omkering van de stickerranking is. Bij workloads met verse tokens is MiniMax M3 goedkoper; bij cache-intensieve workloads kan V4 Pro winnen.
Snelheid vertelt een vergelijkbaar verhaal, maar dan in omgekeerde richting. MiniMax M3 levert ongeveer 103 tokens per seconde, tegenover 81 van V4 Pro — het snelste van alle modellen in zijn prijsklasse, en sneller dan verschillende modellen die vijf keer zoveel kosten. Het snelheidsvoordeel is reëel maar niet enorm; het prijsvoordeel weegt zwaarder, en het is afhankelijk van de workload.
Licentie en duurzaamheid: waar september het antwoord veranderde
Both models are open weights, but the licenses differ. MiniMax M3 ships under the MINIMAX COMMUNITY LICENSE — permissive in spirit, but with its own terms. V4 Pro is MIT — about as unrestricted as an open-weights model gets, covering commercial use, fine-tuning, redistribution, and closed modifications. For enterprise adoption the MIT license is the cleaner story, and the gap shows up the moment your legal team reads the terms.
The durability question, which was a real one a month ago, is the September news. DeepSeek spent the first half of September announcing V4 Pro's retirement for September 14, delaying it, and then — on the 11th — cancelling it, with a public commitment to keep serving the model at unchanged billing and to give notice if that changes. MiniMax M3 has no such drama because none was expected: it is a young flagship with no retirement in view. But the effect is the same: both sides of this matchup now have a clear roadmap, which is more than could be said for one of them two weeks ago.

Wie moet welke kiezen
Als je workload beeld- of video-invoer bevat, is de beslissing genomen: MiniMax M3 is de enige van de twee die ze leest, tegen de laagste prijs in zijn klasse. Als je workload alleen tekst is en cache-intensief — agents met grote systeemprompts, RAG voor lange documenten, samenvatting van grote corpora — maken het daluren-cachevenster en de MIT-licentie van V4 Pro het de betere keuze qua kosten per antwoord, vooral omdat het nu gegarandeerd blijft. Als je workload alleen tekst is en latentiegevoelig, maken MiniMax M3's 103 tokens/sec en $0,30/$1,20 het de snelste goedkope optie in het aanbod.
Beide modellen zijn beschikbaar via OrcaRouter met één sleutel, waarbij de lijstprijzen van providers zonder markup worden doorgegeven — dus de cijfers hierboven zijn de cijfers die je betaalt — en automatische failover tussen providers is het praktische antwoord op het enige dat deze vergelijking niet vooraf kan beslechten: welke provider van welk model standhoudt onder je werkelijke belasting. Het routeren van het multimodale verkeer naar MiniMax M3 en het lang-context tekstwerk naar DeepSeek V4 Pro is een wijziging van twee regels in de routing-DSL, en de failover betekent dat een providerhapering aan weerszijden een retry is, geen incident.


Het vonnis
Dit is de meest gelijkwaardige confrontatie binnen de DeepSeek V4 Pro-line-up, omdat beide modellen goedkoop zijn, beide open weights hebben en beide snel zijn. MiniMax M3 wint op pure prijs, snelheid en multimodale invoer. DeepSeek V4 Pro wint op intelligentie, licentiezuiverheid en — sinds 11 september — zekerheid over duurzaamheid. Het antwoord in één regel: multimodale of latentiekritische tekst gaat naar MiniMax M3; cache-intensieve, alleen-tekst- of juridisch gevoelige workloads gaan naar DeepSeek V4 Pro.
Routeer het multimodale verkeer naar MiniMax M3 en het tekstwerk met lange context naar DeepSeek V4 Pro: MiniMax M3 een wijziging van twee regels in de routing-DSL.
Vergeleken in dit artikel1
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
