Een gegenereerde hero-kaart met de titel 'DeepSeek V4 Pro vs MiniMax M3', met een slank wallet-pictogram aan de linkerkant met het label 'MiniMax M3' en de badge '$0.30/$1.20 · tekst+afbeelding+video', en een iets groter wallet-pictogram aan de rechterkant met het label 'DeepSeek V4 Pro' en de badge '$0.66/$1.98 off-peak · MIT', met een klein balanspictogram ertussen en de voettekst 'Hetzelfde open-weights-spel tegen vijf keer de prijs'.
Guides & Insights

DeepSeek V4 Pro vs MiniMax M3: Hetzelfde open-weights-spel voor vijf keer de prijs

Auteur

Elias Hawthorne

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

DeepSeek V4 Pro and MiniMax M3 are both open-weights reasoning models with a million-token context, and they are both cheap enough that the word "budget" no longer means "weak." But their launches could not look more different: MiniMax M3 (Mini​Max's 428B-parameter model, released June 2026) went out with a community license and a $0.30/$1.20 per million token price that undercut the entire field, while DeepSeek V4 Pro (released August 13, 2026, at $0.66/$1.98 off-peak, $1.32/$3.96 peak) arrived six weeks later with MIT-licensed weights and a slightly higher price. The twist is what happened to the more expensive one: between September 8 and 11, Deep​Seek first scheduled V4 Pro for retirement, then delayed it, then cancelled the retirement entirely, committing to keep serving it at unchanged billing. So the matchup that a month ago looked like "cheap and cheaper" now has a durability story on the one side that no one expected — and that makes it worth re-reading the whole thing.

Onafhankelijke metingen hieronder zijn afkomstig van Artificial Analysis. Door leveranciers gerapporteerde cijfers zijn als zodanig aangeduid.

Twee budget open-weights vlaggenschepen, één indexpunt uit elkaar

Op de Artificial Analysis Intelligence Index scoort MiniMax M3 30 en staat op #16 in zijn klasse, en DeepSeek V4 Pro scoort 36 en staat op #7. Een verschil van zes punten tussen modellen die per token bijna hetzelfde kosten. Dat is de kop: het duurdere model is ook het meetbaar slimmere — maar slechts met zes punten, en alleen op de as met alleen tekst, waar V4 Pro zich bevindt. MiniMax M3 accepteert tekst-, beeld- en video-invoer; V4 Pro ondersteunt alleen tekst. Als multimodale invoer een vereiste is, houdt de vergelijking daar op — MiniMax M3 is de enige van de twee die video leest.

• Intelligentie-index — V4 Pro 36 (#7/113) vs MiniMax M3 30 (#16/113)

• Prijs — MiniMax M3 $0,30/$1,20 per 1 mln. vs. V4 Pro $0,66/$1,98 buiten piekuren ($1,32/$3,96 in piekuren)

• Snelheid — MiniMax M3 ~103 tokens/sec vs V4 Pro ~81 tokens/sec

• Context — beide 1M tokens

• Parameters — MiniMax M3 428B totaal / 23B actief vs V4 Pro 1,6T totaal / 49B actief

• Invoer — MiniMax M3 tekst/afbeelding/video vs V4 Pro alleen tekst

• License — Mini​Max Community License vs V4 Pro MIT

De prijzenrace is heviger dan de sticker doet vermoeden.

Naast elkaar gezet is MiniMax M3 2,2x goedkoper op input en 1,65x goedkoper op output dan het dalurentarief van V4 Pro. Maar de stickerprijzen verbergen de cache- en piekmechanismen. Het dalurenvenster van V4 Pro halveert zijn toch al lage prijzen, en de korting op cache-leesbewerkingen loopt op tot ongeveer 97% — ongeveer $0,02 per miljoen gecachte tokens in de daluren. De cacheprijsstelling van MiniMax M3 is minder agressief. Voor een workload die een grote prefix hergebruikt — een grote systeemprompt, een lang document, een retrievalcorpus — kunnen de effectieve kosten per token van V4 Pro in zijn daluren-cachevenster onder de hoofdpijs van MiniMax M3 duiken, wat een verrassende omkering van de stickerranking is. Bij workloads met verse tokens is MiniMax M3 goedkoper; bij cache-intensieve workloads kan V4 Pro winnen.

Snelheid vertelt een vergelijkbaar verhaal, maar dan in omgekeerde richting. MiniMax M3 levert ongeveer 103 tokens per seconde, tegenover 81 van V4 Pro — het snelste van alle modellen in zijn prijsklasse, en sneller dan verschillende modellen die vijf keer zoveel kosten. Het snelheidsvoordeel is reëel maar niet enorm; het prijsvoordeel weegt zwaarder, en het is afhankelijk van de workload.

Licentie en duurzaamheid: waar september het antwoord veranderde

Both models are open weights, but the licenses differ. MiniMax M3 ships under the MINI​MAX COMMUNITY LICENSE — permissive in spirit, but with its own terms. V4 Pro is MIT — about as unrestricted as an open-weights model gets, covering commercial use, fine-tuning, redistribution, and closed modifications. For enterprise adoption the MIT license is the cleaner story, and the gap shows up the moment your legal team reads the terms.

The durability question, which was a real one a month ago, is the September news. Deep​Seek spent the first half of September announcing V4 Pro's retirement for September 14, delaying it, and then — on the 11th — cancelling it, with a public commitment to keep serving the model at unchanged billing and to give notice if that changes. MiniMax M3 has no such drama because none was expected: it is a young flagship with no retirement in view. But the effect is the same: both sides of this matchup now have a clear roadmap, which is more than could be said for one of them two weeks ago.

A screenshot of the DeepSeek API docs Models & Pricing page, captured September 15, 2026, showing the English-language pricing table for deepseek-v4-pro (DeepSeek-V4-Pro-0813) at $1.32 input and $3.96 output per million tokens at peak, and the footnote announcing that DeepSeek V4 Pro API service continues after September 14, 2026 with unchanged billing.

Wie moet welke kiezen

Als je workload beeld- of video-invoer bevat, is de beslissing genomen: MiniMax M3 is de enige van de twee die ze leest, tegen de laagste prijs in zijn klasse. Als je workload alleen tekst is en cache-intensief — agents met grote systeemprompts, RAG voor lange documenten, samenvatting van grote corpora — maken het daluren-cachevenster en de MIT-licentie van V4 Pro het de betere keuze qua kosten per antwoord, vooral omdat het nu gegarandeerd blijft. Als je workload alleen tekst is en latentiegevoelig, maken MiniMax M3's 103 tokens/sec en $0,30/$1,20 het de snelste goedkope optie in het aanbod.

Beide modellen zijn beschikbaar via OrcaRouter met één sleutel, waarbij de lijstprijzen van providers zonder markup worden doorgegeven — dus de cijfers hierboven zijn de cijfers die je betaalt — en automatische failover tussen providers is het praktische antwoord op het enige dat deze vergelijking niet vooraf kan beslechten: welke provider van welk model standhoudt onder je werkelijke belasting. Het routeren van het multimodale verkeer naar MiniMax M3 en het lang-context tekstwerk naar DeepSeek V4 Pro is een wijziging van twee regels in de routing-DSL, en de failover betekent dat een providerhapering aan weerszijden een retry is, geen incident.

A screenshot of the OrcaRouter model page for deepseek/deepseek-v4-pro, captured September 15, 2026, showing the 1M token context window, 384K max output, a reasoning-mode toggle, the input price of $0.66 and output price of $1.98 per million tokens, and the model description reading 'DeepSeek V4 Pro flagship MoE — 1.6T total / 49B active params, 1M context'.A generated scoreboard titled 'DeepSeek V4 Pro vs MiniMax M3 — the scoreboard': left column DeepSeek V4 Pro rows AA Index 36 (#7/113), Price $0.66/$1.98 off-peak, Speed ~81 tok/s, Context 1M, Input text, Weights MIT; right column MiniMax M3 rows AA Index 30 (#16/113), Price $0.30/$1.20, Speed ~103 tok/s, Context 1M, Input text+image+video, Weights Community License; footer 'AA figures independent; DeepSeek price is vendor list off-peak.'

Het vonnis

Dit is de meest gelijkwaardige confrontatie binnen de DeepSeek V4 Pro-line-up, omdat beide modellen goedkoop zijn, beide open weights hebben en beide snel zijn. MiniMax M3 wint op pure prijs, snelheid en multimodale invoer. DeepSeek V4 Pro wint op intelligentie, licentiezuiverheid en — sinds 11 september — zekerheid over duurzaamheid. Het antwoord in één regel: multimodale of latentiekritische tekst gaat naar MiniMax M3; cache-intensieve, alleen-tekst- of juridisch gevoelige workloads gaan naar DeepSeek V4 Pro.

Routeer het multimodale verkeer naar MiniMax M3 en het tekstwerk met lange context naar DeepSeek V4 Pro: MiniMax M3 een wijziging van twee regels in de routing-DSL.

Vergeleken in dit artikel1

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt