
Claude Haiku 5.5 vs DeepSeek V4 Flash : Anthropic vient de casser le plancher tarifaire
- openaiNOUVEAUOpenAI: GPT-6.1 Sol2026-09-2952Intelligence
- anthropicNOUVEAUAnthropic: Claude Sonnet 5.52026-09-2856Intelligence
- typesafeNOUVEAUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 par million de tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligence
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligence
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligence
- xAIGrok 4.72026-09-2146Intelligence
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 par million de tokens · 67 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 par million de tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
Pendant deux ans, l'entrée de gamme du marché avait une forme que tout le monde connaissait : les laboratoires américains facturaient plus cher et les laboratoires chinois facturaient moins cher, et chacun choisissait son camp en conséquence. Claude Haiku 5.5a brisé cela le 7 octobre 2026, en étant lancé à 0,10 $ par million de jetons d'entrée et 0,50 $ par million de jetons de sortie — ce qui est inférieur au tarif publié de DeepSeek V4 Flash, le modèle qui fait référence en matière de prix bas depuis l'été.
C'est une victoire plus étroite qu'elle n'en a l'air, et les raisons valent plus que le titre. Le tarif Anthropic ne s'applique qu'aux prompts allant jusqu'à 100 000 tokens. Au-delà, il passe à 0,50 $ et 2,50 $, soit plusieurs fois le prix de DeepSeek. Et la grille tarifaire de DeepSeek elle-même a une forme que personne ne copie : elle double pendant deux créneaux en semaine. Deux fournisseurs, deux idées complètement différentes de ce que signifie « bon marché ».
Ce que chaque fournisseur publie réellement
Par million de tokens, en dollars américains. Les chiffres d'Anthropic proviennent de la documentation tarifaire d'Anthropic ; les chiffres de DeepSeek proviennent de la page Models & Pricing propre à DeepSeek, qui constitue la carte tarifaire de référence pour le modèle.

• Entrée — Claude Haiku 5.5 0,10 $ jusqu'à 100 000 tokens, 0,50 $ au-delà. DeepSeek V4 Flash 0,15 $ en heures creuses, 0,30 $ pendant les fenêtres de pointe.
• Sortie — Claude Haiku 5.5 : 0,50 $ jusqu'à 100 000 tokens, 2,50 $ au-delà. DeepSeek V4 Flash : 0,60 $ en heures creuses, 1,20 $ en heures pleines.
• Entrée mise en cache — Claude Haiku 5.5 0,01 $ jusqu'à 100 000 tokens et 0,05 $ au-delà. DeepSeek V4 Flash 0,003 $ en heures creuses et 0,006 $ en heures pleines, soit plus de trois fois moins cher.
• Fenêtres de pointe — Anthropic n’en a aucune ; le tarif varie uniquement selon la longueur du prompt. DeepSeek double le tarif entre 01:00 et 04:00, puis de nouveau entre 06:00 et 10:00 UTC, du lundi au vendredi, hors jours fériés chinois.
• Contexte et sortie — 1 M de tokens et 128 000 de sortie maximale pour Claude Haiku 5.5 ; 1 M de tokens et 384 000 de sortie maximale pour DeepSeek V4 Flash.
• Modalité — Claude Haiku 5.5 prend en charge le texte et les images ; DeepSeek V4 Flash est uniquement textuel, et la vision repose sur le modèle frère plutôt que sur celui-ci.
• Score indépendant — l'Artificial Analysis Intelligence Index v4.3.2 place Claude Haiku 5.5 (Max) à 43,40, deuxième sur 182 modèles, et DeepSeek V4 Flash 0731 (Max) à 34,33, dixième sur 117.
• Vitesse — la même source mesure 241,9 jetons de sortie par seconde pour Claude Haiku 5.5 et 222,0 pour DeepSeek V4 Flash, deuxième plus rapide de son propre classement.
Le crossover, c'est toute l'histoire.
Alignez les deux cartes sur une même requête et la comparaison s'inverse deux fois.
Sous 100 000 tokens, Anthropic est moins cher sur les deux compteurs et sur le prix affiché qui compte : 0,10 $ contre 0,15 $ en entrée, 0,50 $ contre 0,60 $ en sortie. C’est la première fois qu’un petit modèle Anthropic passe sous un tarif DeepSeek Flash à conditions équivalentes, et c’est le fait que l’article de lancement met en avant.
Au-delà de 100 000 tokens, la tendance s'inverse nettement. L'entrée à 0,50 $ d'Anthropic représente plus de trois fois le tarif hors pointe de DeepSeek, et la sortie à 2,50 $ plus de quatre fois celui-ci. Un pipeline de recherche documentaire ou de longs documents qui assemble régulièrement des prompts de 150 000 tokens n'est pas du tout un client pour Claude Haiku 5.5 ; c'est un client pour le modèle qu'il utilisait déjà.
Et dans les deux fenêtres en semaine de DeepSeek, la deuxième comparaison se resserre dans l'autre sens, car le tarif de DeepSeek lui-même double tandis que celui d'Anthropic ne bouge pas. La structure d'aucun des deux fournisseurs n'est meilleure dans l'abstrait. L'un facture selon la quantité que vous envoyez, l'autre facture selon le moment où vous l'envoyez, et un seul de ces critères est sous votre contrôle au moment de la requête.
Ce que coûte une tâche terminée, qui est le seul montant juste.
Les tarifs affichés sont par token, et les deux modèles n’émettent pas le même nombre de tokens pour le même travail. C’est là que l’arithmétique du lancement devient inconfortable pour Anthropic.
Artificial Analysis évalue Claude Haiku 5.5 (Max) à 0,21 $ par tâche de l’Intelligence Index et DeepSeek V4 Flash 0731 (Max) à 0,22 $ par tâche. Un dixième du tarif d’entrée, une fenêtre plus large et un écart de 26 points sur l’Intelligence Index — 43,40 contre 34,33 — et le coût mesuré pour accomplir une tâche tombe à un centime près de celui du modèle qu’il était censé battre sur le prix.
La raison se trouve sur la même page. En évaluant l’Index, Claude Haiku 5.5 a généré 440 millions de tokens de sortie contre une médiane de 100 millions, et l’évaluateur le qualifie de très verbeux. DeepSeek V4 Flash a généré 240 millions contre une médiane de 140 millions et se fait lui aussi qualifier de très verbeux. Les deux modèles réfléchissent longuement, tous deux facturent la réflexion comme de la sortie, et la sortie est le compteur qui détermine la facture. La réduction de 90 % sur les entrées est bien réelle, et elle est facturée sur la moitié la plus petite de la facture.
Il existe un second effet, plus discret. La documentation d’Anthropic elle-même indique que Claude Haiku 5.5 utilise le tokeniseur plus récent partagé avec Claude 4.7 et les versions ultérieures, de sorte que le même texte compte environ 30 % de tokens en plus qu’avec Claude Haiku 4.5. Le tarif a été divisé par dix ; le nombre de tokens n’a pas diminué du tout, et, sur le même texte, il a augmenté.

Le modèle derrière le nom DeepSeek a aussi changé
Quiconque compare ces deux-là en se fondant sur un tableau de benchmarks vieux de plusieurs mois devrait savoir ceci avant de s'y lancer.
La page de tarification de DeepSeek indique désormais deepseek-flash comme nom de modèle, adossé à DeepSeek-V4.1-Flash, et précise que l'ancien identifiant deepseek-v4-flash reste accepté, mais que « les modèles correspondants ont été retirés » — les requêtes effectuées sous l'ancien nom sont traitées par le modèle plus récent et facturées au tarif Flash. Autrement dit, l'identifiant a conservé son nom, son prix et sa place dans la gamme, tandis que les poids qui le sous-tendent ont changé.
Ce n’est pas une critique ; c’est un avertissement sur ce à quoi correspond la date d’un tableau de benchmark. L’entrée Artificial Analysis citée dans cet article concerne la version 0731 de DeepSeek V4 Flash dans sa configuration Max, qui est le modèle mesuré par le tableau, et elle ne constitue pas automatiquement une déclaration sur tout ce qui répond à cet identifiant aujourd’hui. Claude Haiku 5.5 d’Anthropic, en revanche, est un identifiant fixe sans suffixe de date ni alias, et son placement dans l’Index est daté de sa propre semaine de lancement.
Deux modèles, un seul endpoint
La raison pour laquelle cette comparaison est facile à trancher soi-même plutôt que sur une fiche technique, c’est que les deux côtés sont appelables depuis le même endroit — à une exception près qui mérite d’être mentionnée.
DeepSeek V4 Flash figure au catalogue d'OrcaRouter dès aujourd'hui, et le basculement automatique se situe en dessous, de sorte que le volet DeepSeek de cette comparaison peut être appelé de notre côté ce matin plutôt que simplement lu. Une mise en garde qu'il vaut mieux énoncer que vous laisser la découvrir : notre propre tarif affiché pour ce modèle est de 0,22 $ en entrée et 0,66 $ en sortie par million de jetons, ce qui se situe au-dessus de la grille hors pointe de DeepSeek et en dessous de sa grille en pointe. Considérez la page de DeepSeek, et non la nôtre, comme la référence pour la structure pointe/hors pointe, et la nôtre comme un chiffre unique lissé à partir duquel lancer une exécution comptabilisée. Claude Sonnet 5.5 et Claude Opus 5.5 figurent également au catalogue. Ainsi, un A/B entre un volet DeepSeek Flash et un volet Claude, c'est une seule clé et un seul SDK, et le DSL de routage les composera en un seul appel si la logique d'escalade appartient à la route plutôt qu'à l'application.
Claude Haiku 5.5 n'est pas encore au catalogue. Ce n'est pas une précaution de langage — cela signifie que le côté Anthropic de cette comparaison doit actuellement être obtenu directement auprès d'Anthropic, alors que ce n'est pas le cas du côté DeepSeek. Si vous voulez l'offre économique de la gamme DeepSeek sur la même clé que le reste de votre stack dès aujourd'hui, cette partie est déjà en ligne.

Lequel choisir
Si vos appels sont courts — classification, extraction, routage, résumé, tours de sous-agent — et qu'ils tiennent sous 100 000 tokens, Claude Haiku 5.5 est désormais le modèle le moins cher sur les deux compteurs et le plus performant sur le classement indépendant, et le choix est simple. C'est aussi le seul des deux à accepter une image.
Si vos appels sont longs, si vous renvoyez un grand préfixe partagé, ou si vous pouvez planifier, l’arithmétique penche dans l’autre sens, et de loin : l’entrée mise en cache de DeepSeek à 0,003 $ en heures creuses est d’un ordre de grandeur inférieure aux 0,01 $ d’Anthropic, son plafond de sortie est trois fois plus élevé, et sa remise en heures creuses relève d’un problème d’ordonnancement plutôt que d’une limitation du produit.
Ce que le lancement a réellement tranché est plus étroit que « Anthropic est bon marché maintenant ». Il a tranché que les laboratoires américains pratiqueront des tarifs inférieurs à ceux des laboratoires chinois dans le cas des prompts courts, et que le cas des prompts courts est celui où se trouve la majeure partie du trafic de production. Tout ce qui dépasse 100 000 tokens reste encore le marché de l'autre modèle.
