
DeepSeek V4 Pro vs MiniMax M3: Samma spel med öppna vikter till fem gånger priset
- deepseekNYDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiNYOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleNYGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenNYQwen: Qwen3.8 Max (0902)2026-09-0240Intelligens72Kodning
- anthropicNYAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0540Intelligens72Kodning
- qwenQwen: Qwen3.8 Max2026-08-0340Intelligens72Kodning
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligens69Kodning
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Intelligens78Kodning
- googleGoogle: Gemini 3.6 Flash2026-07-2134Intelligens69Kodning
DeepSeek V4 Pro and MiniMax M3 are both open-weights reasoning models with a million-token context, and they are both cheap enough that the word "budget" no longer means "weak." But their launches could not look more different: MiniMax M3 (MiniMax's 428B-parameter model, released June 2026) went out with a community license and a $0.30/$1.20 per million token price that undercut the entire field, while DeepSeek V4 Pro (released August 13, 2026, at $0.66/$1.98 off-peak, $1.32/$3.96 peak) arrived six weeks later with MIT-licensed weights and a slightly higher price. The twist is what happened to the more expensive one: between September 8 and 11, DeepSeek first scheduled V4 Pro for retirement, then delayed it, then cancelled the retirement entirely, committing to keep serving it at unchanged billing. So the matchup that a month ago looked like "cheap and cheaper" now has a durability story on the one side that no one expected — and that makes it worth re-reading the whole thing.
Oberoende mätningar nedan kommer från Artificial Analysis. Leverantörsrapporterade siffror är märkta som sådana.
Två budgetflaggskepp med öppna vikter, en indexpunkt från varandra
På Artificial Analysis Intelligence Index får MiniMax M3 30 poäng och rankas som #16 i sin klass, medan DeepSeek V4 Pro får 36 poäng och rankas som #7. En sexpoängs skillnad mellan modeller som kostar nästan lika mycket per token. Det är rubriken: den dyrare modellen är också mätbart smartare – men bara med sex poäng, och bara på den textbaserade axeln där V4 Pro befinner sig. MiniMax M3 tar text-, bild- och videoinmatning; V4 Pro är endast text. Om multimodalinmatning är ett krav slutar jämförelsen där – MiniMax M3 är den enda av de två som läser video.
• Intelligence Index — V4 Pro 36 (#7/113) mot MiniMax M3 30 (#16/113)
• Pris — MiniMax M3 $0.30/$1.20 per 1M vs V4 Pro $0.66/$1.98 lågtrafik ($1.32/$3.96 högtrafik)
• Hastighet — MiniMax M3 ~103 tokens/sek vs V4 Pro ~81 tokens/sek
• Kontext – båda 1M tokens
• Parametrar — MiniMax M3 428B totalt / 23B aktiva vs V4 Pro 1,6T totalt / 49B aktiva
• Input — MiniMax M3 text/bild/video vs V4 Pro endast text
• License — MiniMax Community License vs V4 Pro MIT
Prisracet är jämnare än vad prislappen antyder
Vid en direkt jämförelse är MiniMax M3 2,2 gånger billigare på input och 1,65 gånger billigare på output än V4 Pros off-peak-taxa. Men priserna på pappret döljer cache- och peak-mekanismerna. V4 Pros off-peak-fönster halverar dess redan låga priser, och dess cache-läsningsrabatt uppgår till omkring 97 % – cirka 0,02 USD per miljon cachade tokens under off-peak. MiniMax M3:s cache-prissättning är mindre aggressiv. För en arbetsbelastning som återanvänder ett stort prefix – en stor systemprompt, ett långt dokument, en sökkorpus – kan den effektiva kostnaden per token för V4 Pro i dess off-peak-cachefönster understiga MiniMax M3:s listpris, vilket är en överraskande omkastning av listprisrankningen. Vid arbetsbelastningar med nya tokens är MiniMax M3 billigare; vid cache-tunga arbetsbelastningar kan V4 Pro vinna.
Hastigheten berättar en liknande historia, fast omvänt. MiniMax M3 producerar cirka 103 tokens per sekund jämfört med V4 Pro:s 81 — snabbast av alla modeller i sin prisklass, och snabbare än flera modeller som kostar fem gånger så mycket. Hastighetsfördelen är verklig men inte enorm; prisfördelen spelar större roll, och den beror på arbetsbelastningen.
Licens och hållbarhet: där september ändrade svaret
Both models are open weights, but the licenses differ. MiniMax M3 ships under the MINIMAX COMMUNITY LICENSE — permissive in spirit, but with its own terms. V4 Pro is MIT — about as unrestricted as an open-weights model gets, covering commercial use, fine-tuning, redistribution, and closed modifications. For enterprise adoption the MIT license is the cleaner story, and the gap shows up the moment your legal team reads the terms.
Livslängdsfrågan, som var en verklig fråga för en månad sedan, är septembernyheten. DeepSeek ägnade första halvan av september åt att meddela att V4 Pro skulle avvecklas den 14 september, senarelägga avvecklingen och sedan – den 11:e – ställa in den, med ett offentligt åtagande att fortsätta tillhandahålla modellen med oförändrad fakturering och att avisera om det ändras. MiniMax M3 har inget sådant drama eftersom inget sådant förväntades: den är en ung flaggskeppsmodell utan avveckling i sikte. Men effekten är densamma: båda sidorna i den här matchen har nu en tydlig färdplan, vilket är mer än vad som kunde sägas om en av dem för två veckor sedan.

Vem ska välja vilken
Om din arbetsbelastning omfattar bild- eller videoinmatning är saken klar: MiniMax M3 är den enda av de två som läser dem, till det lägsta priset i sin klass. Om din arbetsbelastning är enbart text och cache-tung – agenter med stora systempromptar, RAG för långa dokument, sammanfattning av stora korpusar – gör V4 Pros cachefönster utanför högtrafik och MIT-licens den till det bättre valet för kostnad per svar, särskilt eftersom den nu är garanterad att finnas kvar. Om din arbetsbelastning är enbart text och latenskänslig gör MiniMax M3:s 103 tokens/sek och $0.30/$1.20 den till det snabbaste billiga alternativet på planen.
Båda modellerna är tillgängliga via OrcaRouter med en enda nyckel, där leverantörernas listpriser förs vidare utan påslag — så siffrorna ovan är siffrorna du betalar — och automatisk failover mellan leverantörer är det praktiska svaret på det enda som den här matchningen inte kan avgöra i förväg: vilken modells leverantör som håller för din faktiska belastning. Att dirigera den multimodala trafiken till MiniMax M3 och textarbetet med lång kontext till DeepSeek V4 Pro är en tvåradig ändring i routing-DSL:en, och failover innebär att en tillfällig störning hos en leverantör på endera sidan är ett nytt försök, inte en incident.


Domen
Detta är den jämnaste matchen i DeepSeek V4 Pro-serien, eftersom båda modellerna är billiga, båda har öppna vikter och båda är snabba. MiniMax M3 vinner på rent pris, hastighet och multimodala indata. DeepSeek V4 Pro vinner på intelligens, licensmässig renhet och – sedan den 11 september – säkerhet i fråga om hållbarhet. Svaret i en rad: multimodala eller latenskritiska texter går till MiniMax M3; cache-tunga, enbart textbaserade eller juridiskt känsliga arbetsbelastningar går till DeepSeek V4 Pro.
Dirigera den multimodala trafiken till MiniMax M3 och textarbetet med lång kontext till DeepSeek V4 Pro: MiniMax M3 en tvåradig ändring av routing-DSL:en.
Jämförda i den här artikeln1
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
