
DeepSeek V4 Pro vs MiniMax M3 : le même jeu de poids ouverts à cinq fois le prix
- deepseekNOUVEAUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- openaiNOUVEAUOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- googleNOUVEAUGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- qwenNOUVEAUQwen: Qwen3.8 Max (0902)2026-09-0240Intelligence72Code
- anthropicNOUVEAUAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligence69Code
- grokSpaceXAI: Grok 4.62026-08-1244Intelligence77Code
- metaMeta: Muse Spark 1.22026-08-0540Intelligence72Code
- qwenQwen: Qwen3.8 Max2026-08-0340Intelligence72Code
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligence69Code
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 par million de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Intelligence78Code
- googleGoogle: Gemini 3.6 Flash2026-07-2134Intelligence69Code
DeepSeek V4 Pro et MiniMax M3 sont tous deux des modèles de raisonnement à poids ouverts avec un contexte d'un million de tokens, et ils sont tous deux assez bon marché pour que le mot « budget » ne signifie plus « faible ». Mais leurs lancements n'auraient pas pu être plus différents : MiniMax M3 (le modèle à 428 milliards de paramètres de MiniMax, sorti en juin 2026) est sorti avec une licence communautaire et un prix de 0,30 $/1,20 $ par million de tokens qui battait tous les prix du secteur, tandis que DeepSeek V4 Pro (sorti le 13 août 2026, à 0,66 $/1,98 $ hors pointe, 1,32 $/3,96 $ aux heures de pointe) est arrivé six semaines plus tard avec des poids sous licence MIT et un prix légèrement plus élevé. Le twist, c'est ce qui est arrivé au plus cher : entre le 8 et le 11 septembre, DeepSeek a d'abord programmé le retrait de V4 Pro, puis l'a retardé, avant d'annuler complètement le retrait, s'engageant à continuer de le servir à facturation inchangée. Ainsi, la confrontation qui, il y a un mois, ressemblait à « bon marché et encore moins cher » a désormais un récit de pérennité d'un côté que personne n'attendait — et cela vaut la peine de relire toute l'affaire.
Les mesures indépendantes ci-dessous proviennent d'Artificial Analysis. Les chiffres rapportés par les fournisseurs sont signalés comme tels.
Deux fleurons à poids ouverts et à petit budget, séparés d'un point d'indice
Sur l'Artificial Analysis Intelligence Index, MiniMax M3 obtient un score de 30, classé n° 16 dans sa catégorie, et DeepSeek V4 Pro obtient 36, classé n° 7. Un écart de six points entre des modèles qui coûtent presque la même chose par token. C'est le point principal : le modèle le plus cher est aussi le plus intelligent de manière mesurable — mais seulement de six points, et uniquement sur l'axe texte seul où se situe V4 Pro. MiniMax M3 accepte les entrées texte, image et vidéo ; V4 Pro est uniquement textuel. Si l'entrée multimodale est une exigence, la comparaison s'arrête là — MiniMax M3 est le seul des deux qui lit la vidéo.
• Indice d'intelligence — V4 Pro 36 (n° 7/113) vs MiniMax M3 30 (n° 16/113)
• Prix — MiniMax M3 0,30 $/1,20 $ par million contre V4 Pro 0,66 $/1,98 $ hors pointe (1,32 $/3,96 $ en pointe)
• Vitesse — MiniMax M3 ~103 jetons/s vs V4 Pro ~81 jetons/s
• Contexte — les deux à 1M de tokens
• Paramètres — MiniMax M3 428B au total / 23B actifs contre V4 Pro 1,6T au total / 49B actifs
• Entrée — MiniMax M3 texte/image/vidéo vs V4 Pro texte uniquement
• License — MiniMax Community License vs V4 Pro MIT
La course aux prix est plus serrée qu'il n'y paraît
En comparaison directe, MiniMax M3 est 2,2 fois moins cher en entrée et 1,65 fois moins cher en sortie que le tarif hors pointe de V4 Pro. Mais les prix affichés cachent les mécanismes de cache et de pointe. La fenêtre hors pointe de V4 Pro divise par deux ses prix déjà bas, et sa remise sur la lecture du cache atteint environ 97 % — environ 0,02 $ par million de tokens mis en cache hors pointe. La tarification du cache de MiniMax M3 est moins agressive. Pour une charge de travail qui réutilise un grand préfixe — un gros prompt système, un long document, un corpus de récupération —, le coût effectif par token de V4 Pro dans sa fenêtre de cache hors pointe peut être inférieur au prix affiché de MiniMax M3, ce qui constitue une inversion surprenante du classement des prix affichés. Sur les charges de travail avec des tokens frais, MiniMax M3 est moins cher ; sur les charges de travail gourmandes en cache, V4 Pro peut l’emporter.
La vitesse raconte une histoire similaire, mais inversée. MiniMax M3 produit environ 103 tokens par seconde, contre 81 pour V4 Pro — le modèle le plus rapide de sa catégorie de prix, et plus rapide que plusieurs modèles qui coûtent cinq fois plus cher. L’avantage en vitesse est réel, mais pas énorme ; l’avantage en prix compte davantage, et il dépend de la charge de travail.
Licence et pérennité : là où septembre a changé la réponse
Both models are open weights, but the licenses differ. MiniMax M3 ships under the MINIMAX COMMUNITY LICENSE — permissive in spirit, but with its own terms. V4 Pro is MIT — about as unrestricted as an open-weights model gets, covering commercial use, fine-tuning, redistribution, and closed modifications. For enterprise adoption the MIT license is the cleaner story, and the gap shows up the moment your legal team reads the terms.
La question de la pérennité, qui était bien réelle il y a un mois, fait l’actualité de septembre. DeepSeek a passé la première moitié de septembre à annoncer le retrait de V4 Pro pour le 14 septembre, à le reporter, puis — le 11 — à l’annuler, avec un engagement public à continuer de servir le modèle à une facturation inchangée et à prévenir si cela change. MiniMax M3 n’a pas ce genre de rebondissements, car on n’en attendait aucun : c’est un jeune modèle phare sans retrait en vue. Mais l’effet est le même : les deux camps de cette confrontation disposent désormais d’une feuille de route claire, ce qui est plus qu’on ne pouvait en dire de l’un d’eux il y a deux semaines.

Qui devrait choisir quoi
Si votre charge de travail inclut des entrées d'images ou de vidéos, la décision est prise : MiniMax M3 est le seul des deux à les lire, au prix le plus bas de sa catégorie. Si votre charge de travail est uniquement textuelle et gourmande en cache — agents avec de longs prompts système, RAG sur documents longs, summarisation de grands corpus — la fenêtre de cache en heures creuses et la licence MIT de V4 Pro en font le meilleur choix en coût par réponse, d'autant plus que sa pérennité est désormais garantie. Si votre charge de travail est uniquement textuelle et sensible à la latence, les 103 jetons/seconde et les 0,30 $/1,20 $ de MiniMax M3 en font l'option économique la plus rapide du tableau.
Les deux modèles sont disponibles via OrcaRouter avec une seule clé, avec les prix catalogue des fournisseurs répercutés sans marge — donc les chiffres ci-dessus sont ceux que vous payez — et le basculement automatique entre fournisseurs est la réponse pratique à la seule chose que cette confrontation ne peut pas trancher à l'avance : quel fournisseur de modèle tiendra sous votre charge réelle. Router le trafic multimodal vers MiniMax M3 et le travail textuel à long contexte vers DeepSeek V4 Pro ne demande qu'une modification de deux lignes en routing-DSL, et le basculement signifie qu'un hoquet d'un fournisseur d'un côté ou de l'autre est une nouvelle tentative, pas un incident.


Le verdict
C'est l'affrontement le plus serré de la gamme DeepSeek V4 Pro, car les deux modèles sont bon marché, tous deux à poids ouverts et tous deux rapides. MiniMax M3 l'emporte sur le prix brut, la vitesse et l'entrée multimodale. DeepSeek V4 Pro l'emporte sur l'intelligence, la propreté de la licence et — depuis le 11 septembre — la certitude de la durabilité. La réponse en une ligne : le multimodal ou le texte critique en latence va à MiniMax M3 ; les charges de travail à forte utilisation de cache, uniquement textuelles ou juridiquement sensibles vont à DeepSeek V4 Pro.
Acheminez le trafic multimodal vers MiniMax M3 et le travail de texte à long contexte vers DeepSeek V4 Pro : MiniMax M3 un changement de deux lignes du DSL de routage.
Comparés dans cet article1
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
