
DeepSeek V4 Pro vs Kimi K3 : vitesse et prix face à un plafond de raisonnement de 44 points
- deepseekNOUVEAUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- openaiNOUVEAUOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- googleNOUVEAUGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- qwenNOUVEAUQwen: Qwen3.8 Max (0902)2026-09-0240Intelligence72Code
- anthropicNOUVEAUAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligence69Code
- grokSpaceXAI: Grok 4.62026-08-1244Intelligence77Code
- metaMeta: Muse Spark 1.22026-08-0540Intelligence72Code
- qwenQwen: Qwen3.8 Max2026-08-0340Intelligence72Code
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligence69Code
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 par million de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Intelligence78Code
- googleGoogle: Gemini 3.6 Flash2026-07-2134Intelligence69Code
DeepSeek V4 Pro et Kimi K3 sont les deux fleurons du raisonnement à poids ouverts dotés d'une fenêtre d'un million de tokens, et leur rivalité a pris une forme stable il y a un mois : Kimi K3 (le modèle à 2 800 milliards de paramètres de Moonshot AI, publié le 16 juillet 2026) est le leader en intelligence, et DeepSeek V4 Pro (publié le 13 août 2026) est le leader en vitesse et en prix. Ce qui est nouveau, c'est que la moitié bon marché de ce duo a failli disparaître dans la première moitié de septembre — DeepSeek a placé V4 Pro sur une trajectoire de retrait au 14 septembre le 8, a reporté cette échéance, puis, le 11, a purement et simplement annulé le retrait, s'engageant à continuer de servir le modèle avec une facturation inchangée. Cela compte davantage pour cette confrontation que pour la plupart des autres, car « bon marché, rapide, contexte de 1 M, poids ouverts » est une combinaison difficile à remplacer quand l'alternative coûte cinq fois plus cher.
Les chiffres indépendants sont des mesures d'Artificial Analysis. Les benchmarks de lancement de DeepSeek et de Moonshot sont eux qualifiés de déclarations de fournisseurs, car ni l'un ni l'autre n'a été reproduit de manière indépendante.
Kimi K3 remporte l'indice ; V4 Pro remporte la facture
Le tableau de bord indépendant ne laisse aucune ambiguïté sur qui est le plus intelligent. Kimi K3, à effort maximal, obtient 44 sur l'Artificial Analysis Intelligence Index, classé n°2 parmi les modèles comparables. DeepSeek V4 Pro obtient 36, classé n°7 dans sa catégorie. Cet écart de neuf points est la raison même pour laquelle on paie les tarifs de Kimi K3. Et les prix sont la raison pour laquelle la confrontation n'est pas tranchée par le seul indice : Kimi K3 affiche 3,00 $ par million de jetons d'entrée et 15,00 $ par million de jetons de sortie, tandis que V4 Pro affiche 0,66 $/1,98 $ hors pointe (1,32 $/3,96 $ en pointe). En sortie, cela représente environ 7,5 fois — avant la remise de cache. Les lectures de cache de V4 Pro coûtent environ 0,02 $ par million de jetons hors pointe, soit une remise de 97 % ; la remise de cache de 90 % de Kimi K3 part d'une base bien plus élevée. Pour une charge de travail gourmande en jetons, l'écart effectif se creuse jusqu'à atteindre près de dix fois.
• Intelligence Index — Kimi K3 44 (n° 2/113) vs V4 Pro 36 (n° 7/113)
• Prix — Kimi K3 3,00 $/15,00 $ par million vs V4 Pro 0,66 $/1,98 $ en heures creuses (1,32 $/3,96 $ en heures pleines)
• Vitesse — V4 Pro ~81 jetons/sec contre Kimi K3 ~35 jetons/sec
• Contexte — les deux à 1M de tokens
• Paramètres — Kimi K3 2,8 T au total / 104 B actifs vs V4 Pro 1,6 T au total / 49 B actifs
• Poids — tous les deux ouverts (poids ouverts de Kimi K3, V4 Pro MIT)
• Entrée — Kimi K3 texte et image vs V4 Pro texte uniquement
La vitesse est l'élément que tout le monde sous-estime.
L'écart dont personne ne parle, c'est le débit. Le V4 Pro produit environ 81 tokens par seconde selon des mesures indépendantes ; le Kimi K3 en produit environ 35. Dans une boucle d'agent où le modèle écrit plusieurs milliers de tokens par étape, c'est la différence entre une tâche qui se termine en quelques minutes et une autre qui s'étire sur tout un après-midi — et l'écart de coût aggrave le tout, puisque vous payez 15 $ par million de tokens de sortie à environ la moitié de la vitesse. Pour les assistants de codage interactifs, le traitement de documents en masse et toute charge de travail où le temps horloge est un poste budgétaire, la combinaison proposée par le V4 Pro — une vitesse 2,3 fois supérieure pour un septième du prix de sortie — s'impose comme la réponse dominante.
Quand les neuf points en valent la peine
L’argument honnête en faveur de Kimi K3, c’est son plafond de raisonnement. Son coût d’évaluation sur l’Intelligence Index était d’environ 3 658 $ pour l’exécution — le reflet de chaînes de raisonnement véritablement longues et coûteuses, et non d’une particularité de tarification. Si votre charge de travail relève du raisonnement difficile — démonstration mathématique approfondie, planification à long horizon, tâches agentiques de plusieurs heures où neuf points d’indice supplémentaires se traduisent par moins d’échecs —, Kimi K3 justifie son prix premium. L’argument honnête contre lui, c’est tout le reste : le débit, l’économie du cache, le prix par token à lui seul.
L'autre raison pour laquelle le revirement de septembre compte ici : il y a un mois, le conseil raisonnable était « si vous comptez standardiser sur le modèle ouvert, rapide et bon marché, couvrez-vous — il pourrait être retiré. » Depuis le 15 septembre, cette protection est obsolète. DeepSeek s'est engagé publiquement, avec la promesse d'un préavis en cas de changement, à maintenir V4 Pro sur l'API, et la licence MIT signifie que le modèle reste déployable sur votre propre matériel, quoi que DeepSeek fasse de son API. Les poids ouverts de Kimi K3 offrent la même liberté de l'autre côté, ce qui fait de cette comparaison une véritable comparaison entre deux modèles à poids ouverts plutôt qu'un affrontement entre un service et un produit.

Les deux modèles sont sur OrcaRouter — DeepSeek V4 Pro et Kimi K3 passent tous deux par la plateforme avec une seule clé, les prix catalogue des fournisseurs étant répercutés sans marge — et le DSL de routage est la façon naturelle de départager cette confrontation : acheminez les tâches de raisonnement à long horizon vers Kimi K3, là où les neuf points rapportent, et acheminez le travail de débit gourmand en tokens vers DeepSeek V4 Pro, là où l'écart de prix de 7,5x et l'écart de vitesse de 2,3x font le travail pour vous. Les deux sont complémentaires aussi souvent que concurrents, et la plateforme fait d'exécuter les deux la même quantité de travail que d'en exécuter un seul.


En résumé
Kimi K3 est le modèle à poids ouverts le plus intelligent, avec neuf points d'indice d'avance, et son supplément de prix — 7,5× sur les jetons de sortie, environ la moitié de la vitesse — est un coût bien réel, pas un arrondi. DeepSeek V4 Pro est la bête de somme rapide, bon marché et durable, et depuis le 11 septembre, il ne présente plus de risque de défection. La réponse pratique est celle que désignent les deux colonnes de prix : si vos tâches relèvent du raisonnement difficile, achetez Kimi K3 ; si elles sont gourmandes en jetons et urgentes, achetez DeepSeek V4 Pro ; et si vous avez les deux types, faites tourner les deux et aiguillez en fonction de la tâche.
Comparés dans cet article1
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
