Kimi K3 vs DeepSeek V4 : Les deux titans à poids ouvert, comparés
Guides & Insights

Kimi K3 vs DeepSeek V4 : Les deux titans à poids ouvert, comparés

Auteur

Fengya Tian

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Voici le match phare des poids ouverts de 2026. Kimi K3 et DeepSeek V4 sont tous deux de grands modèles mixture-of-experts avec des poids ouverts, un contexte d'environ 1 million de tokens, et des prix agressifs, et tous deux proviennent de laboratoires chinois. Si vous avez décidé que vous voulez un modèle de classe frontière ouvert et auto-hébergeable, ce sont vos deux finalistes.

Les différences sont réelles mais spécifiques : DeepSeek V4 est uniquement textuel et proposé au prix le plus bas (avec un supplément aux heures de pointe que la plupart des gens oublient) ; Kimi ajoute une vision native et, sur des indices indépendants, devance DeepSeek en matière d'intelligence globale. Les licences diffèrent également : DeepSeek est entièrement sous licence MIT, Kimi est sous licence MIT modifiée. Voici comment choisir.

Une note d'honnêteté d'abord : au 15 juillet 2026, Moonshot n'a publié aucune spécification officielle ni benchmark pour le K3. La fuite de la promo de lancement est réelle, mais les chiffres ne sont pas confirmés. Ainsi, lorsque nous comparons les capacités, nous utilisons la gamme actuelle de Kimi, K2.6 et K2.7 Code, comme plancher sur lequel le K3 est censé s'appuyer, et nous le précisons à chaque fois. Considérez chaque chiffre concernant le K3 comme une rumeur jusqu'à ce que la fiche modèle soit en ligne.

Verdict rapide

- Ouverture : les deux sont open-weight et auto-hébergables. DeepSeek V4 est entièrement sous licence MIT ; Kimi est sous licence MIT modifiée (ajoute des exigences de marque à très grande échelle). DeepSeek est la licence la plus permissive.

- Prix : DeepSeek V4-Pro est le moins cher, à environ 0,435 $ en entrée / 0,87 $ en sortie par million en heures creuses, mais les heures de pointe ajoutent environ un supplément de 2x. La gamme Kimi est d'environ 0,60 $ - 0,95 $ / 2,80 $ - 4,00 $. DeepSeek remporte le prix brut ; surveillez sa tarification de pointe.

- Intelligence (indépendant) : Kimi K2.6 mène les poids ouverts sur l'Artificial Analysis Intelligence Index (54) juste devant DeepSeek V4-Pro (52).

Modalité : Kimi dispose d'une vision native ; DeepSeek V4 est uniquement textuel. Si vous avez besoin d'une entrée d'image dans un modèle ouvert, Kimi l'emporte.

- Codage : très proche, DeepSeek V4-Pro rapporte SWE-Bench Verified 80,6 et LiveCodeBench 93,5 ; Kimi K2.6 rapporte SWE-Bench Verified 80,2 et SWE-Bench Pro 58,6, leader open-source (contre 55,4 pour DeepSeek).

- Verdict : choisissez DeepSeek V4 pour le coût texte seul le plus bas et la licence la plus permissive ; choisissez Kimi K3 pour la vision native, un léger avantage en intelligence indépendante et (soi-disant) un contexte plus long. De nombreuses équipes devraient conserver les deux et router.

En un coup d'œil

- Kimi K3 (attendu, basé sur K2.6/K2.7) : MoE à poids ouverts, licence MIT modifiée ; rumeur de 2,5T à 4T de paramètres ; rumeur de contexte de 1M ; vision native ; prix non annoncé (fourchette ~0,60-0,95 $ / 2,80-4,00 $).

- DeepSeek V4-Pro : MoE open-weight, MIT ; 1,6T total / 49B actif ; 1M de contexte / jusqu'à 384K de sortie ; texte uniquement ; ~0,435 $ entrée / 0,87 $ sortie hors pointe (cache-hit ~0,0036 $), environ 2x aux heures de pointe ; sorti le 24 avril 2026. (Une version plus légère V4-Flash, 284B/13B, coûte ~0,14 $/0,28 $.)

- Remarque : Les noms d'API hérités de DeepSeek (deepseek-chat / deepseek-reasoner) sont obsolètes à partir du 24 juillet 2026, planifiez la migration si vous les utilisez.

Prix et la prise en heure de pointe

Sur le papier, DeepSeek V4-Pro est le modèle ouvert capable le moins cher disponible, avec environ 0,435 $ en entrée et 0,87 $ en sortie par million de tokens, avec des hits de cache presque gratuits. La gamme de Kimi est un peu plus élevée, avec 0,60 à 0,95 $ en entrée et 2,80 à 4,00 $ en sortie. Pour le volume de texte pur, DeepSeek remporte la guerre des étiquettes.

Le piège que les concurrents mentionnent rarement : DeepSeek a transformé son ancienne réduction hors pointe en une surtaxe de pointe, donc pendant les heures de travail chinoises (environ 09h00-12h00 et 14h00-18h00), les prix sont environ le double. Si votre trafic est irrégulier et aligné sur la journée chinoise, votre véritable facture DeepSeek peut se rapprocher de celle de Kimi plutôt que ce que suggère le titre. C'est exactement le genre de détail de coût total qui n'apparaît que lorsque vous mesurez les dépenses par heure, et non par jeton.

Benchmarks : un véritable coude à coude

Ces deux-là sont plus proches que toute autre paire de cette série. En codage, DeepSeek V4-Pro annonce SWE-Bench Verified 80,6, LiveCodeBench 93,5 et un remarquable score Codeforces de 3206 ; Kimi K2.6 annonce SWE-Bench Verified 80,2, LiveCodeBench v6 89,6, et un SWE-Bench Pro de 58,6 (leader open-source) contre 55,4 pour DeepSeek. En sciences et en mathématiques, ils échangent des coups (GPQA Diamond ~90 chacun ; AIME 2026 Kimi 96,4 contre DeepSeek 94,3).

Les critères de départage sont indépendants et structurels. Sur l'Artificial Analysis Intelligence Index, Kimi K2.6 (54) devance DeepSeek V4-Pro (52) en tant que meilleur modèle open-weight. Mais DeepSeek est text-only, tandis que la vision native de Kimi et son contexte supposé plus long Kimi K3 élargissent ce qu'il peut faire. Les chiffres de codage propriétaires des deux fournisseurs méritent votre propre vérification.

Licences, modalité et auto-hébergement

Si vous choisissez un modèle ouvert, trois points pratiques le déterminent. Licence : le MIT simple de DeepSeek est le plus permissif, le MIT modifié de Kimi ajoute des exigences de marque visible uniquement à très grande échelle (100M+ d'utilisateurs ou 20M+ $/mois de revenus), sans importance pour la plupart des équipes mais à noter. Modalité : Kimi gère les images nativement ; DeepSeek est uniquement textuel. Auto-hébergement : les deux sont lourds, DeepSeek V4-Pro et Kimi en pleine qualité nécessitent chacun environ 8x GPU haut de gamme, donc de nombreuses équipes les feront tourner via des hébergeurs de juridiction neutre (OpenRouter, DeepInfra) plutôt que sur site. Les deux API propriétaires relèvent de la juridiction chinoise, donc acheminez en conséquence si la résidence des données importe.

Lequel devriez-vous utiliser ?

Choisissez DeepSeek V4 lorsque vous voulez le coût texte uniquement le plus bas possible et la licence la plus permissive, et que votre trafic n'est pas concentré aux heures de pointe en Chine. Choisissez Kimi K3 lorsque vous avez besoin de vision native, voulez le léger avantage d'intelligence indépendante, ou prévoyez d'utiliser le contexte plus long dont on parle. Pour beaucoup d'équipes, la bonne réponse est les deux, ils sont assez peu coûteux pour les garder comme options redondantes à poids ouvert.

Cette redondance est une fonctionnalité lorsque les deux se trouvent derrière un seul point de terminaison OrcaRouter. Vous pouvez acheminer le texte en masse vers celui qui est le moins cher à l'heure actuelle (en évitant automatiquement le supplément de pointe de DeepSeek), envoyer des tâches d'image à Kimi, et basculer entre eux si l'un des fournisseurs limite le débit, le tout avec le coût par modèle et la latence dans un seul tableau de bord. Deux modèles ouverts, une intégration, et le moins cher toujours en tête.

FAQ

Lequel est moins cher, Kimi K3 ou DeepSeek V4 ?

DeepSeek V4-Pro est moins cher sur le papier (~$0.435/$0.87 hors pointe contre ~$0.60-$0.95/$2.80-$4.00 pour Kimi), mais sa surcharge d'environ 2x en heures de pointe peut combler l'écart pour le trafic aligné sur la journée en Chine.

Lequel est le plus capable ?

Très proche. Kimi K2.6 devance DeepSeek V4-Pro sur l'Artificial Analysis Intelligence Index indépendant (54 contre 52) et sur SWE-Bench Pro ; DeepSeek mène sur le classement Codeforces et LiveCodeBench. Le K3 devrait améliorer les chiffres de Kimi, à vérifier au lancement.

Est-ce que les deux prennent en charge les images ?

Non. Kimi dispose d'une vision native ; DeepSeek V4 est uniquement textuel. Si vous avez besoin d'une entrée d'image dans un modèle ouvert, choisissez Kimi.

Puis-je exécuter les deux et basculer automatiquement ?

Oui, c'est un modèle solide. Une passerelle comme OrcaRouter peut router vers le modèle ouvert le moins cher ou le mieux adapté par tâche et basculer entre eux derrière un seul point d'accès.

Kimi K3 n'a pas encore de benchmarks officiels, puis-je faire confiance à cette comparaison ?

Question légitime. Au 15 juillet 2026, le K3 n'est pas confirmé, donc cette comparaison utilise la gamme K2.6/K2.7 expédiée par Kimi comme référence et qualifie chaque chiffre du K3 de rumeur. Le consensus de la communauté est « excité, mais attendez les vrais chiffres », et les classements indépendants mettent généralement trois à six semaines à être publiés après une sortie. La décision à faible risque : considérer le verdict comme indicatif, mettre en place un routage basé sur les tâches maintenant, et ré-évaluer le jour où les chiffres officiels du K3 de Moonshot arrivent.

En résumé

Kimi K3 et DeepSeek V4 sont les deux meilleurs modèles à poids ouverts de 2026, et ils sont suffisamment proches pour que vous puissiez raisonnablement exécuter les deux. Choisissez DeepSeek pour un coût textuel ultra-bas et une licence plus propre, choisissez Kimi pour la vision native et un léger avantage en capacités, et si vous n'êtes pas sûr, acheminez les requêtes entre eux et laissez le modèle le moins cher et le mieux adapté gagner chaque demande.




© 2026 OrcaRouter

Pour les fournisseurs

Vous exploitez une plateforme d'inférence ? Proposez vos modèles sur OrcaRouter.

Contactez-nous

Rejoignez notre communauté

DiscordEmailXGitHubYouTube