
GPT-6 Sol Pro vs DeepSeek V4 Pro : un tarif forfaitaire face à un calendrier
- openaiNOUVEAUOpenAI: GPT-6 Luna2026-09-2237Intelligence
- openaiNOUVEAUOpenAI: GPT-6 Sol2026-09-2248Intelligence
- anthropicNOUVEAUAnthropic: Claude Opus 5.52026-09-2258Intelligence
- grokNOUVEAUGrok 4.72026-09-2146Intelligence
- OrcaNOUVEAUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 par million de tokens
- orcaNOUVEAUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens
- deepseekNOUVEAUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligence69Code
- grokSpaceXAI: Grok 4.62026-08-1244Intelligence77Code
- metaMeta: Muse Spark 1.22026-08-0540Intelligence72Code
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligence76Code
GPT-6 Sol Pro et DeepSeek V4 Pro sont actuellement les deux moyens crédibles les moins chers d’exécuter une charge de travail de raisonnement sérieuse via une API, et leur tarification repose sur des principes complètement différents. GPT-6 Sol — le modèle du fournisseur exécuté par la configuration gpt-6-sol-pro, en disponibilité générale depuis le 22 septembre 2026 — coûte 2,00 $ par million de tokens d’entrée et 10,00 $ par million de tokens de sortie, à toute heure de la journée et tous les jours. DeepSeek V4 Pro, le modèle phare à poids ouverts dont le checkpoint 0813 a atteint la disponibilité générale le 13 août 2026, coûte 0,66 $ et 1,98 $ pendant la majeure partie de la semaine, et exactement le double pour deux courtes fenêtres le matin en semaine. Toute comparaison qui cite un seul tarif ne cite que la moitié d’un prix.
Le calendrier est l'histoire. Tout le reste dans cette confrontation — les scores d'index, les fenêtres de contexte, les conditions de licence — découle du fait que l'un de ces deux fournisseurs a décidé que son prix catalogue est fonction de l'horloge.
Ce qu’est réellement chaque ligne de prix
La grille tarifaire de GPT-6 Sol tient sur une seule ligne. Entrée 2,00 $, entrée mise en cache 0,20 $, écriture de cache 2,50 $, sortie 10,00 $ par million de tokens, avec une revalorisation tarifaire pour contexte long au-delà d’un seuil d’entrée qui s’applique à l’ensemble de la requête une fois ce seuil franchi. Il n’y a pas de dimension temporelle ni de fenêtre promotionnelle. OpenAI a ramené le modèle prédécesseur à ces chiffres le 22 septembre et les a qualifiés de permanents.
La grille tarifaire de DeepSeek est un tableau. Comme on peut le lire sur la page de tarification du fournisseur lui-même :
• Entrée en heures creuses — 0,66 $ par million de tokens, échec de cache ; 0,022 $ par million de tokens, succès de cache
• Sortie en heures creuses — 1,98 $ par million de tokens
• Entrée en période de pointe — 1,32 $ par million de jetons, défaut de cache ; 0,044 $ par million de jetons, succès de cache
• Sortie maximale — 3,96 $ par million de tokens
• Créneaux de pointe — 01:00–04:00 et 06:00–10:00 UTC, du lundi au vendredi, à l’exclusion des jours fériés chinois
• Tout le reste — heures creuses, y compris tout le week-end, une règle entrée en vigueur à minuit, heure de Pékin, le 23 août 2026
Sept heures de pointe sur une semaine de 168 heures, cinq jours sur sept, représentent environ 21 % du calendrier au tarif supérieur et 79 % au tarif inférieur. Ainsi, le résumé honnête en un seul chiffre de DeepSeek V4 Pro n'est ni 0,66 $ ni 1,32 $ — il se situe quelque part entre les deux, et sa position dépend de la forme de votre trafic, non de la générosité du fournisseur.
Le repricing dont ce tableau est issu
Il est utile de savoir à quel point cette structure est récente, car presque toutes les pages de comparaison citent encore le chiffre qu’elle a remplacé. Le 22 mai 2026, DeepSeek a transformé une remise à durée limitée sur V4 Pro en prix permanent — une baisse d’environ 75 %, à environ 0,435 $ en entrée et 0,87 $ en sortie par million de tokens.
Le 17 août 2026 à minuit, heure de Pékin, la tendance s'est inversée, et bien au-delà. Le système heures pleines/heures creuses est entré en vigueur avec une augmentation moyenne sur les lignes concernées d'environ 3,5 fois et un maximum de 12 fois — le facteur 12 tombant précisément sur le tarif des entrées en cas de succès du cache, qui est passé de 0,025 ¥ à 0,30 ¥ par million de jetons aux heures pleines. Les entrées en cas d'échec du cache ont augmenté d'environ 200 % et les sorties d'environ 350 %. Six jours plus tard, l'exception pour le week-end a été ajoutée, ce qui en a récupéré une partie pour quiconque pouvait déplacer ses tâches par lots.
Deux conséquences en découlent. Premièrement, toute page vous affirmant que DeepSeek V4 Pro est un modèle à moins d'un dollar cite une grille tarifaire qui a été remplacée deux fois. Deuxièmement, la forme de l'augmentation est un signal de ce sur quoi DeepSeek optimise : la plus forte hausse proportionnelle concerne les hits de cache, qui est le tarif qui compte le plus pour précisément la charge de travail — de longues boucles d'agents renvoyant un préfixe stable — qui a rendu le modèle attractif au départ.

Le numéro d’index que tout le monde cite est retiré.
Artificial Analysis est le banc d'essai neutre pour cette comparaison, et il a changé plusieurs fois la version de son Intelligence Index au cours de 2026. Sur le tableau actuel, GPT-6 Sol obtient un score de 48 à effort maximal pour 1,06 $ par tâche de l'index. DeepSeek V4 Pro, sur le checkpoint 0813 à effort maximal, obtient un score de 36 pour 0,67 $ par tâche de l'index.
Le chiffre qui circule pour DeepSeek est 53. Ce nombre est réel et il a été publié — dans une révision antérieure de l'indice, avant un changement de version qui a déplacé les scores de la plupart des modèles. Comparer un 53 tiré d'un article antérieur à la v4.3 avec un 48 actuel, c'est comparer une mesure retirée du service avec une mesure en vigueur, et cela produit l'erreur la plus répandue dans cette confrontation : l'affirmation selon laquelle les deux modèles se tiennent à un point d'écart. Sur l'indice actuel, ils sont séparés de douze points, et l'écart de prix par tâche accomplie n'est pas le 3× que suggèrent les tarifs affichés, mais plutôt de l'ordre de 1,6×, car DeepSeek dépense plus de tokens pour parvenir à sa réponse.
Deux autres points de données indépendants doivent figurer à côté de ceux-là, tous deux étiquetés pour ce qu’ils sont. Vals AI, qui utilise un harnais isolé, place DeepSeek V4 Pro à 96,40 % sur SWE-bench Verified à 0,103 $ par test — deuxième de ce classement derrière les 97,00 % de Claude Opus 5, et avec un coût par test nettement inférieur. Le classement des agents de codage d’Artificial Analysis affiche 14 % sur Terminal-Bench 4.0, contre 44 % pour GPT-6 Sol. Le premier chiffre indique que DeepSeek est compétitif sur une tâche de codage étroite et bien définie. Le second indique qu’il n’est pas compétitif sur le travail agentique en terminal. Les deux sont vrais et ils mesurent des choses différentes.
Là où les deux modèles sont structurellement différents, et non simplement à des prix différents
• Licence — GPT-6 Sol est une API fermée sans poids ; DeepSeek V4 Pro est sous licence MIT avec des checkpoints publics sur Hugging Face, y compris des variantes de base pour le pré-entraînement continu.
• Sortie maximale — GPT-6 Sol 128 000 tokens contre DeepSeek V4 Pro 384 000 tokens, soit trois fois le plafond pour un cinquième du tarif de sortie
• Fenêtre de contexte — GPT-6 Sol 1 050 000 tokens vs DeepSeek V4 Pro 1 048 576 tokens, pratiquement identiques
• Modalités — à la fois texte en entrée et texte en sortie ; aucune des deux n’accepte d’images via l’API
• Tarification des contextes longs — GPT-6 Sol applique un nouveau tarif à toute la requête au-delà de son seuil d'entrée ; la grille heures pleines/heures creuses de DeepSeek V4 Pro est la seule structure tarifaire dont il dispose
• Échelle — DeepSeek V4 Pro est un modèle de mélange d'experts de 1,6 billion de paramètres avec 49 milliards de paramètres actifs par token ; OpenAI ne publie pas de chiffre comparable pour GPT-6 Sol
Une remarque sur ce nombre de paramètres, car c’est une source fréquente de confusion : le chiffre de 1 700 milliards qui apparaît dans certaines fiches correspond à la taille du paquet Hugging Face avec le module optionnel de décodage spéculatif DSpark inclus, et non à un modèle cible plus large. L’architecture publiée totalise 1 600 milliards. Soustraire les badges arrondis pour en déduire la taille du module draft n’est pas un calcul valide, pas plus que d’interpréter le nombre plus élevé comme une preuve que le modèle a grossi.

Le retrait qui constitue le véritable argument en faveur des poids ouverts
Le 9 septembre 2026, DeepSeek a annoncé qu’il retirait progressivement V4 Pro, et qu’à partir de 04:00 UTC le 14 septembre, chaque requête adressée à la chaîne de modèle deepseek-v4-pro serait acheminée vers DeepSeek V4.1 Flash et facturée aux tarifs de Flash, et ce jusqu’à la sortie d’un modèle V4.1 Pro. La chaîne de modèle répondrait toujours. Le modèle qui se trouverait derrière ne serait pas celui sur lequel quiconque avait réalisé des benchmarks.
Les développeurs ont protesté, et la redirection a été retirée. Le journal des modifications de DeepSeek indique désormais que le service API V4 Pro se poursuit au-delà du 14 septembre, avec une facturation inchangée, et le tableau des tarifs répertorie toujours deepseek-v4-pro comme une ligne active, avec ses propres tarifs et sans étiquette de retrait. La page d’annonce initiale contient encore le langage de routage, si bien que les deux documents sont en désaccord — et c’est la page tarifaire active qui décrit ce qui se passe réellement lorsque vous l’appelez.
Cet épisode est l’argument le plus fort de toute cette confrontation, et ce n’est pas un argument de prix. Un modèle fermé peut être re-tarifé, redirigé ou retiré selon le calendrier d’un fournisseur, et le seul recours est de migrer. Un modèle dont les poids sont sous licence MIT dans un dépôt public peut être servi depuis votre propre infrastructure, ce qui signifie que le checkpoint que vous avez évalué est celui que vous continuez de servir, quoi que la feuille de route du fournisseur dise six semaines plus tard. DeepSeek a démontré le risque et fourni la mesure d’atténuation dans la même quinzaine.
Le contrepoids honnête est que l’auto-hébergement d’un modèle de 1 600 milliards de paramètres n’est pas une décision que la plupart des équipes prennent à la légère. C’est une véritable option avec un coût fixe réel, pas une couverture gratuite.
Là où une couche de routage change l'arithmétique
DeepSeek V4 Pro figure au catalogue d'OrcaRouter. Le checkpoint actuel comme l'identifiant du modèle de base se résolvent tous deux — deepseek/deepseek-v4-pro-0813 et deepseek/deepseek-v4-pro — aux tarifs catalogue hors pointe, avec le multiplicateur de pointe appliqué selon le même calendrier UTC, une fenêtre de contexte de 1 048 576 jetons, un plafond de sortie de 384 000 jetons, et un temps jusqu'au premier jeton (p50) de 3,56 secondes mesuré sur notre propre page de modèle. Les tarifs catalogue du fournisseur sont répercutés sans marge ajoutée, ce qui, en l'espèce, signifie que la frontière pointe/hors pointe apparaît sur votre facture au moment même où elle apparaît sur celle de DeepSeek.
GPT-6 Sol ne fait pas partie de nos itinéraires, donc rien ici ne constitue une affirmation sur son prix via nous.

C'est la planification qui rend un point de terminaison unique intéressant ici précisément. Une charge de travail qui peut être décalée vaut deux fois plus qu'une qui ne peut pas l'être, et la décaler est une décision de routage, et non une migration — la même clé, la même forme de requête, une heure différente ou un modèle différent derrière. Associer DeepSeek V4 Pro à DeepSeek V4.1 Flash sur un seul point de terminaison est la version la plus affûtée de cela : le modèle Flash est 4,4× moins cher en entrée et 3,3× moins cher en sortie que le tarif hors pointe de V4 Pro, sur la même fenêtre de contexte et les mêmes fenêtres de pointe, ce qui en fait la destination naturelle pour le trafic qui n'a pas du tout besoin du modèle plus grand. Le basculement automatique compte pour la même raison que toujours — le palier économique sur lequel votre pipeline est bâti ne devrait pas être un point de défaillance unique.
La règle de décision
• Travail par lots et hors ligne pouvant être planifié — DeepSeek V4 Pro, et planifiez-le. Quatre-vingt-quinze pour cent du calendrier à 0,66 $ et 1,98 $, avec les week-ends entièrement en heures creuses, est le tarif crédible le moins cher de ce tableau, d’un facteur de trois en entrée et de cinq en sortie.
• Trafic interactif sensible à la latence qui tombe dans les fenêtres de pointe — GPT-6 Sol. Un tarif fixe de 2,00 $ et 10,00 $ est plus cher que le tarif hors pointe de DeepSeek et moins cher que rien, mais il est connu à l’avance, et pendant deux heures par jour, c’est le moins cher des deux en sortie.
• Boucles d'agents avec un grand préfixe stable — faites le calcul des succès de cache avant de choisir. L'entrée avec succès de cache de DeepSeek est à 0,022 $ hors heures de pointe, soit un neuvième des 0,20 $ de GPT-6 Sol, mais c'est aussi la ligne que DeepSeek a multipliée par douze aux heures de pointe. L'avantage est réel et il dépend de l'heure.
• Tout ce qui est réglementé, ou toute chose que vous ne pouvez pas vous permettre de voir reroutée — DeepSeek V4 Pro, auto-hébergé à partir du checkpoint MIT. Le retrait de septembre est l'étude de cas, et c'est une meilleure raison d'accepter le coût fixe que n'importe quelle comparaison par token.
• Tout ce qui exige le haut de la gamme agentique — GPT-6 Sol. Douze points d’indice et trente points sur Terminal-Bench ne relèvent pas d’un écart d’arrondi, et les chiffres communiqués par DeepSeek en tant que fournisseur ne permettent pas de les combler.
Le forfait et le barème horaire sont tous deux des modèles de tarification honnêtes. Ils répondent simplement à des questions différentes : l’un vous indique combien coûte un jeton, l’autre vous indique combien coûte un jeton quand vous en avez besoin.
Comparés dans cet article3
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
