
Step 5 Preview vs DeepSeek V4 Pro : l'un est une promesse, l'autre est une licence MIT
- OrcaNOUVEAUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 par million de tokens
- orcaNOUVEAUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens
- deepseekNOUVEAUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligence69Code
- grokSpaceXAI: Grok 4.62026-08-1244Intelligence77Code
- metaMeta: Muse Spark 1.22026-08-0540Intelligence72Code
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligence76Code
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligence69Code
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 par million de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Tout, dans cette confrontation, repose sur une question qui n'a rien à voir avec les benchmarks : que pouvez-vous réellement télécharger ? DeepSeek V4 Pro — la version que l'éditeur a livrée sous le nom DeepSeek-V4-Pro-0813 le 13 août 2026 — est un modèle à mélange d'experts de 1 600 milliards de paramètres sous licence MIT, dont les poids sont d'ores et déjà hébergés sur Hugging Face. Step 5 Preview, que StepFun a annoncé le 20 septembre 2026, est un MoE parcimonieux de 600 milliards de paramètres qui obtient huit points de plus sur le même classement indépendant et dont le dépôt Hugging Face ne contient qu'un seul fichier, .gitattributes. StepFun indique que le checkpoint BF16 arrivera le 15 octobre. La véritable teneur de cette comparaison n'est donc pas « quel modèle est le meilleur ». Elle est : « lequel de ces deux modèles pouvez-vous exploiter ce trimestre, et lequel êtes-vous en train d'attendre ? »
Ce cadrage est moins palpitant qu’un duel de benchmarks et bien plus utile, car l’écart de huit points et l’attente de vingt-cinq jours ne sont pas du même type de fait. L’un des deux, vous pouvez dès aujourd’hui le prendre en compte dans vos plans.
Huit points, et les quatre qui comptent
Artificial Analysis fait passer les deux modèles par l’Intelligence Index v4.3.2 — dix évaluations — qui est le seul endroit où ces deux ont été mesurés par la même main.
• Indice d'intelligence — Step 5 Preview 44 vs DeepSeek V4 Pro 36
• Classement sur ce tableau — Step 5 Preview 24e sur 200 vs DeepSeek V4 Pro 7e sur 113 dans sa catégorie
• Terminal-Bench 4.0 — Step 5 Preview 33,3 % ; DeepSeek V4 Pro n'est pas listé sur le même tableau, il n'existe donc pas de ligne agentique comparable à citer
Vitesse de sortie — Step 5 Preview 99,8 jetons/s vs DeepSeek V4 Pro 88,8 jetons/s
• Temps jusqu’au premier token — Step 5 Preview 2,96 s contre DeepSeek V4 Pro 1,69 s
• Prix pour 1 M de tokens — Step 5 Preview : 1,00 $ en entrée / 2,70 $ en sortie, contre DeepSeek V4 Pro : 1,32 $ en entrée / 3,96 $ en sortie au tarif de pointe de DeepSeek, divisé par deux à 0,66 $ / 1,98 $ en heures creuses
• Remise de cache — Step 5 Preview 95 % vs DeepSeek V4 Pro 97 %
• Contexte — 1 M de tokens pour les deux ; DeepSeek publie un plafond de sortie de 384 000 tokens, StepFun n’en a pas publié.
• Poids — Step 5 Preview fermé, checkpoint BF16 prévu le 15 octobre ; DeepSeek V4 Pro MIT, téléchargeable dès maintenant
Deux lignes contredisent le titre. DeepSeek V4 Pro produit son premier token en 1,69 seconde, contre 2,96 pour Step 5 Preview — une avance de 43 % à chaque appel qui, sur une longue boucle d'agent, se cumule en un temps d'horloge bien réel. Et sa remise sur le cache est meilleure de deux points, ce qui compte le plus pour exactement la charge de travail pour laquelle ces deux modèles sont vendus : un agent qui renvoie le même prompt système et le même contexte de dépôt à chaque tour se situe presque entièrement dans cette remise.
L'écart agrégé de huit points est réel, et il est aussi plus étroit que huit points ne le laissent penser. Un indice est un composite de dix évaluations, et c'est dans la composition que les deux modèles se distinguent. Les 33,3 % de Step 5 Preview sur Terminal-Bench 4.0 constituent un véritable résultat agentique ; la force phare de DeepSeek V4 Pro réside, elle, dans le raisonnement à long horizon, à un prix qu'aucun autre modèle de la catégorie open-weights n'égale. Aucun des deux tableaux ne publie de ligne où les deux s'opposent directement, ce qui est la raison honnête pour laquelle cette comparaison ne peut être tranchée par un seul chiffre.

Ce que « open » vous apporte quand le fournisseur change d’avis
Voici l'aspect de ce comparatif qu'une fiche technique ne peut pas retransmettre, et il vaut la peine de le préciser avec les dates exactes, car cela a eu lieu onze jours avant l'annonce de Step 5 Preview.
DeepSeek a annoncé aux utilisateurs qu'il retirait V4 Pro. Le 9 septembre, l'entreprise a indiqué que les requêtes seraient acheminées vers le plus récent DeepSeek V4.1 Flash ; le 10 septembre, elle a confirmé la date : le 14 septembre à 12 h 00, heure de Pékin. Le 11 septembre, elle est revenue sur sa décision — le service API V4 Pro se poursuit au-delà du 14 septembre, la facturation reste inchangée, selon les termes mêmes de DeepSeek. La chaîne de modèle, la fenêtre de contexte de 1 M de jetons et le plafond de 500 requêtes simultanées sont tous restés ce qu'ils étaient, et la page Models & Pricing de DeepSeek signale ce revirement par une note de bas de page sur ladeepseek-v4-pro ligne.
Voyez cela comme une démonstration de ce dont les poids ouverts vous protègent réellement, et de ce dont ils ne vous protègent pas. L’API a presque été retirée par une décision de planification. Les poids, eux, ne pouvaient pas l’être. Un checkpoint sous licence MIT sur votre propre matériel n’a aucun fournisseur qui puisse annoncer son retrait, et c’est une garantie d’une autre nature qu’une promesse de prix — ce n’est pas une promesse du tout.
C'est précisément l'écart dans lequel se trouve Step 5 Preview. StepFun s'est engagé à livrer le checkpoint BF16 le 15 octobre, et le nom de dépôt qu'il a déjà réservé — stepfun-ai/Step-5-Preview-BF16 — est le format à partir duquel vous affinez et quantifiez, nommé à la création et rempli plus tard. C'est un signal de planification, pas un artefact. Tant que le dépôt ne contient rien d'autre qu'un .gitattributes, Step 5 Preview est un modèle que vous louez, selon les conditions d'un seul fournisseur, sans licence pour le lire et sans solution de repli si les conditions changent.
Les deux façons d’être l’option la moins chère
Ces deux modèles cassent les prix de la frontière fermée avec une marge importante, et les mécanismes ne sont pas les mêmes, ce qui importe pour la durabilité du prix.
DeepSeek V4 Pro est bon marché parce qu’un laboratoire a publié les poids et qu’un marché concurrentiel de la mise à disposition a fait disparaître les marges. C’est un plancher structurel : n’importe qui peut héberger le checkpoint, donc le prix est déterminé par le coût d’une heure-GPU plutôt que par la stratégie tarifaire d’une entreprise. L’API de DeepSeek elle-même le tarife selon deux fenêtres — 1,32 $ et 3,96 $ pendant les heures de pointe, moitié moins en dehors de celles-ci — et la pointe est étroite, quelques heures les matins en semaine en UTC, donc la majeure partie du trafic tombe sur le tarif le moins cher et les week-ends ne voient jamais le tarif le plus élevé.
Step 5 Preview est bon marché parce que StepFun a décidé de le tarifer ainsi. Il n’y a qu’un seul point de terminaison, une seule grille tarifaire et aucune seconde source. Ce n’est pas une accusation — un modèle sparse de 600B/27B coûte réellement moins cher à servir que ne le suggère son nombre de paramètres, et c’est le ratio de paramètres activés qui en est la raison. C’est simplement un autre genre de prix, et la différence apparaît le jour où StepFun décide que la preview a fait son travail.
L’écart de prix entre les deux est suffisamment faible pour ne pas être décisif : 1,00 $ et 2,70 $ contre 1,32 $ et 3,96 $ représentent une différence de 24 % en entrée et de 32 % en sortie, bien dans la fourchette qu’une remise de cache, une différence de longueur de sortie ou un taux de nouvelle tentative peuvent effacer. Sur la question de la verbosité, les deux sont proches — Step 5 Preview a généré 160 M de tokens de sortie lors de l’exécution sur l’indice, contre une médiane de 92 M, et l’exécution propre de DeepSeek V4 Pro se situe dans la même bande. Ni l’un ni l’autre n’est un modèle frugal, et tous deux sont vendus comme étant bon marché par token plutôt que bon marché par tâche.

Où chacun a sa place dans une pile réelle
Si vous avez besoin d’un modèle que vous pouvez affiner, quantiser, héberger dans votre propre VPC, ou confier à une équipe juridique avec un fichier de licence qu’elle peut lire, ce n’est pas un choix difficile et il ne s’agit pas de benchmarks. DeepSeek V4 Pro est disponible sous licence MIT dès aujourd’hui. Step 5 Preview n’a ni licence, ni configuration, ni fichier de paramètres, et la première échéance sur laquelle vous pouvez planifier est la mi-octobre. L’écart de huit points dans l’indice ne change pas ce calcul, car un modèle que vous ne pouvez pas télécharger ne peut pas être déployé.
Si ce que vous voulez, c’est le meilleur résultat agentique disponible pour un dollar par million de jetons d’entrée, Step 5 Preview est en tête sur le seul classement qui a mesuré les deux, et c’est le choix par défaut le plus judicieux pour le travail par essais-erreurs qui remplit la majeure partie d’une boucle d’agent — extraction, classification, échafaudage de tests, les appels routiniers entre les deux qui comptent. Ses 99,8 jetons par seconde terminent également la sortie plus vite que les 88,8 de DeepSeek V4 Pro, ce qui raccourcit la boucle elle-même plutôt que seulement la facture.
Le cas embarrassant est celui dans lequel se trouvent en réalité la plupart des équipes : vous voulez le chiffre de Step 5 Preview, mais vous ne pouvez pas faire passer par un chemin de production un point de terminaison de préversion ouvert le jour du lancement, sans plafond de sortie publié. C'est un problème de routage, et c'est celui sur lequel se termine cette comparaison. DeepSeek V4 Pro est accessible via OrcaRouter à 0,66 $ et 1,98 $ par million de jetons, soit la moitié hors pointe de la grille tarifaire de DeepSeek à 1,32 $ et 3,96 $, et les modèles textuels environnants avec lui — derrière une seule clé pour plus de 200 modèles avec 0 % de marge, de sorte qu'une révision tarifaire de DeepSeek se répercute sur votre facture le jour même plutôt qu'au renouvellement. Dirigez la tranche exploratoire du trafic vers la préversion et maintenez le chemin de production sur le modèle adossé à une licence, avec un basculement automatique entre fournisseurs qui effectue le travail que la courbe de capacité d'un point de terminaison de préversion rend nécessaire.

Qu'est-ce qui réglerait ça ?
Trois choses, et toutes les trois sont vérifiables plutôt que contestables.
La première, c’est la licence. Lorsque le checkpoint BF16 sera disponible, qu’indique le dépôt qu’une entreprise est autorisée à en faire ? Une licence permissive comble à elle seule la majeure partie de cet écart, parce qu’elle transforme l’avance de huit points en quelque chose que vous pouvez posséder plutôt que louer. Une licence restrictive fait de DeepSeek V4 Pro le seul modèle du duo sur lequel vous pouvez réellement construire un produit.
Le deuxième est le plafond de sortie. DeepSeek publie 384 000 tokens. L’annonce de StepFun mentionne un contexte de 1 M et ne fait état d’aucun plafond de sortie, et une configuration tierce distincte qui a circulé pendant la fuite indiquait un contexte de 350 000 avec un maximum de sortie de 64 000. Pour le travail agentique à long horizon pour lequel les deux modèles sont vendus, ce chiffre n’est pas un détail.
Le troisième point est de savoir si le prix tient une fois que le suffixe Preview est retiré. Un prix de preview est un chiffre d’acquisition client ; un prix de mise sur le marché est un modèle économique. Le plancher de DeepSeek V4 Pro est fixé par un marché concurrentiel du serving et ne peut guère bouger. Celui de Step 5 Preview peut bouger un mardi.
Tant que les deux premières n’ont pas reçu de réponse, l’interprétation pratique est que DeepSeek V4 Pro est le modèle que vous déployez et que Step 5 Preview est le modèle auquel vous vous comparez — avec cette réserve qu’un point de terminaison de préversion vieux de quelques jours, se situant huit points au-dessus d’un modèle phare mature sous licence MIT, est un résultat bien réel, et la raison pour laquelle le 15 octobre mérite une entrée au calendrier plutôt qu’un haussement d’épaules.
Comparés dans cet article2
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
