Une carte hero générée pour « Le petit modèle américain est désormais le moins cher », avec le badge « PLANCHER DE PRIX », le surtitre « 7 OCTOBRE 2026 » et le sous-titre « Claude Haiku 5.5 à 0,10 $ et 0,50 $ face à DeepSeek V4 Flash - jusqu'à 100 000 tokens. » Quatre puces indiquent « 0,10 $ vs 0,15 $ en entrée », « 0,50 $ vs 0,60 $ en sortie », « palier de 100 K » et « fenêtres de pointe ». Deux cartes en dessous sont intitulées « MOINS DE 100 000 TOKENS » (« Anthropic est moins cher sur les deux compteurs ») et « AU-DESSUS » (« DeepSeek est trois à quatre fois moins cher »). Un pied de page indique « Les tarifs de liste publiés par Vendors, relevés le 8 octobre 2026. » Le logo OrcaRouter est intégré dans le coin inférieur droit.
Guides & Insights

Claude Haiku 5.5 vs DeepSeek V4 Flash : Anthropic vient de casser le plancher tarifaire

Auteur

Rowan Sterling

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Pendant deux ans, l'entrée de gamme du marché avait une forme que tout le monde connaissait : les laboratoires américains facturaient plus cher et les laboratoires chinois facturaient moins cher, et chacun choisissait son camp en conséquence. Claude Haiku 5.5a brisé cela le 7 octobre 2026, en étant lancé à 0,10 $ par million de jetons d'entrée et 0,50 $ par million de jetons de sortie — ce qui est inférieur au tarif publié de DeepSeek V4 Flash, le modèle qui fait référence en matière de prix bas depuis l'été.

C'est une victoire plus étroite qu'elle n'en a l'air, et les raisons valent plus que le titre. Le tarif Ant​hropic ne s'applique qu'aux prompts allant jusqu'à 100 000 tokens. Au-delà, il passe à 0,50 $ et 2,50 $, soit plusieurs fois le prix de Dee​pSeek. Et la grille tarifaire de Dee​pSeek elle-même a une forme que personne ne copie : elle double pendant deux créneaux en semaine. Deux fournisseurs, deux idées complètement différentes de ce que signifie « bon marché ».

Ce que chaque fournisseur publie réellement

Par million de tokens, en dollars américains. Les chiffres d'Ant​hropic proviennent de la documentation tarifaire d'Ant​hropic ; les chiffres de Dee​pSeek proviennent de la page Models & Pricing propre à Dee​pSeek, qui constitue la carte tarifaire de référence pour le modèle.

A generated scoreboard titled 'What each vendor actually publishes'. Claude Haiku 5.5 reads input $0.10 under 100K and $0.50 above, output $0.50 and $2.50, cached input $0.01 and $0.05, maximum output 128,000 tokens, modality text and images, peak windows none. DeepSeek V4 Flash reads input $0.15 off-peak and $0.30 peak, output $0.60 and $1.20, cached input $0.003 and $0.006, maximum output 384,000 tokens, modality text only, peak windows two weekday UTC ranges. A footer reads 'Vendors' published list rates; DeepSeek's peak windows are weekday UTC ranges.'

• Entrée — Claude Haiku 5.5 0,10 $ jusqu'à 100 000 tokens, 0,50 $ au-delà. DeepSeek V4 Flash 0,15 $ en heures creuses, 0,30 $ pendant les fenêtres de pointe.

• Sortie — Claude Haiku 5.5 : 0,50 $ jusqu'à 100 000 tokens, 2,50 $ au-delà. DeepSeek V4 Flash : 0,60 $ en heures creuses, 1,20 $ en heures pleines.

• Entrée mise en cache — Claude Haiku 5.5 0,01 $ jusqu'à 100 000 tokens et 0,05 $ au-delà. DeepSeek V4 Flash 0,003 $ en heures creuses et 0,006 $ en heures pleines, soit plus de trois fois moins cher.

• Fenêtres de pointe — Ant​hropic n’en a aucune ; le tarif varie uniquement selon la longueur du prompt. Dee​pSeek double le tarif entre 01:00 et 04:00, puis de nouveau entre 06:00 et 10:00 UTC, du lundi au vendredi, hors jours fériés chinois.

• Contexte et sortie — 1 M de tokens et 128 000 de sortie maximale pour Claude Haiku 5.5 ; 1 M de tokens et 384 000 de sortie maximale pour DeepSeek V4 Flash.

• Modalité — Claude Haiku 5.5 prend en charge le texte et les images ; DeepSeek V4 Flash est uniquement textuel, et la vision repose sur le modèle frère plutôt que sur celui-ci.

• Score indépendant — l'Artificial Analysis Intelligence Index v4.3.2 place Claude Haiku 5.5 (Max) à 43,40, deuxième sur 182 modèles, et DeepSeek V4 Flash 0731 (Max) à 34,33, dixième sur 117.

• Vitesse — la même source mesure 241,9 jetons de sortie par seconde pour Claude Haiku 5.5 et 222,0 pour DeepSeek V4 Flash, deuxième plus rapide de son propre classement.

Le crossover, c'est toute l'histoire.

Alignez les deux cartes sur une même requête et la comparaison s'inverse deux fois.

Sous 100 000 tokens, Ant​hropic est moins cher sur les deux compteurs et sur le prix affiché qui compte : 0,10 $ contre 0,15 $ en entrée, 0,50 $ contre 0,60 $ en sortie. C’est la première fois qu’un petit modèle Ant​hropic passe sous un tarif Dee​pSeek Flash à conditions équivalentes, et c’est le fait que l’article de lancement met en avant.

Au-delà de 100 000 tokens, la tendance s'inverse nettement. L'entrée à 0,50 $ d'Ant​hropic représente plus de trois fois le tarif hors pointe de Dee​pSeek, et la sortie à 2,50 $ plus de quatre fois celui-ci. Un pipeline de recherche documentaire ou de longs documents qui assemble régulièrement des prompts de 150 000 tokens n'est pas du tout un client pour Claude Haiku 5.5 ; c'est un client pour le modèle qu'il utilisait déjà.

Et dans les deux fenêtres en semaine de Dee​pSeek, la deuxième comparaison se resserre dans l'autre sens, car le tarif de Dee​pSeek lui-même double tandis que celui d'Ant​hropic ne bouge pas. La structure d'aucun des deux fournisseurs n'est meilleure dans l'abstrait. L'un facture selon la quantité que vous envoyez, l'autre facture selon le moment où vous l'envoyez, et un seul de ces critères est sous votre contrôle au moment de la requête.

Ce que coûte une tâche terminée, qui est le seul montant juste.

Les tarifs affichés sont par token, et les deux modèles n’émettent pas le même nombre de tokens pour le même travail. C’est là que l’arithmétique du lancement devient inconfortable pour Ant​hropic.

Artificial Analysis évalue Claude Haiku 5.5 (Max) à 0,21 $ par tâche de l’Intelligence Index et DeepSeek V4 Flash 0731 (Max) à 0,22 $ par tâche. Un dixième du tarif d’entrée, une fenêtre plus large et un écart de 26 points sur l’Intelligence Index — 43,40 contre 34,33 — et le coût mesuré pour accomplir une tâche tombe à un centime près de celui du modèle qu’il était censé battre sur le prix.

La raison se trouve sur la même page. En évaluant l’Index, Claude Haiku 5.5 a généré 440 millions de tokens de sortie contre une médiane de 100 millions, et l’évaluateur le qualifie de très verbeux. DeepSeek V4 Flash a généré 240 millions contre une médiane de 140 millions et se fait lui aussi qualifier de très verbeux. Les deux modèles réfléchissent longuement, tous deux facturent la réflexion comme de la sortie, et la sortie est le compteur qui détermine la facture. La réduction de 90 % sur les entrées est bien réelle, et elle est facturée sur la moitié la plus petite de la facture.

Il existe un second effet, plus discret. La documentation d’Anthropic elle-même indique que Claude Haiku 5.5 utilise le tokeniseur plus récent partagé avec Claude 4.7 et les versions ultérieures, de sorte que le même texte compte environ 30 % de tokens en plus qu’avec Claude Haiku 4.5. Le tarif a été divisé par dix ; le nombre de tokens n’a pas diminué du tout, et, sur le même texte, il a augmenté.

A screenshot of Anthropic's model documentation showing the Claude Haiku 5.5 specifications and pricing rows, listing the context window, maximum output and thinking behaviour beside the published per-million-token input, output and cache rates with their prompt-length thresholds.

Le modèle derrière le nom Dee​pSeek a aussi changé

Quiconque compare ces deux-là en se fondant sur un tableau de benchmarks vieux de plusieurs mois devrait savoir ceci avant de s'y lancer.

La page de tarification de Dee​pSeek indique désormais deepseek-flash comme nom de modèle, adossé à Dee​pSeek-V4.1-Flash, et précise que l'ancien identifiant deepseek-v4-flash reste accepté, mais que « les modèles correspondants ont été retirés » — les requêtes effectuées sous l'ancien nom sont traitées par le modèle plus récent et facturées au tarif Flash. Autrement dit, l'identifiant a conservé son nom, son prix et sa place dans la gamme, tandis que les poids qui le sous-tendent ont changé.

Ce n’est pas une critique ; c’est un avertissement sur ce à quoi correspond la date d’un tableau de benchmark. L’entrée Artificial Analysis citée dans cet article concerne la version 0731 de DeepSeek V4 Flash dans sa configuration Max, qui est le modèle mesuré par le tableau, et elle ne constitue pas automatiquement une déclaration sur tout ce qui répond à cet identifiant aujourd’hui. Claude Haiku 5.5 d’Anthropic, en revanche, est un identifiant fixe sans suffixe de date ni alias, et son placement dans l’Index est daté de sa propre semaine de lancement.

Deux modèles, un seul endpoint

La raison pour laquelle cette comparaison est facile à trancher soi-même plutôt que sur une fiche technique, c’est que les deux côtés sont appelables depuis le même endroit — à une exception près qui mérite d’être mentionnée.

DeepSeek V4 Flash figure au catalogue d'OrcaRouter dès aujourd'hui, et le basculement automatique se situe en dessous, de sorte que le volet DeepSeek de cette comparaison peut être appelé de notre côté ce matin plutôt que simplement lu. Une mise en garde qu'il vaut mieux énoncer que vous laisser la découvrir : notre propre tarif affiché pour ce modèle est de 0,22 $ en entrée et 0,66 $ en sortie par million de jetons, ce qui se situe au-dessus de la grille hors pointe de DeepSeek et en dessous de sa grille en pointe. Considérez la page de DeepSeek, et non la nôtre, comme la référence pour la structure pointe/hors pointe, et la nôtre comme un chiffre unique lissé à partir duquel lancer une exécution comptabilisée. Claude Sonnet 5.5 et Claude Opus 5.5 figurent également au catalogue. Ainsi, un A/B entre un volet DeepSeek Flash et un volet Claude, c'est une seule clé et un seul SDK, et le DSL de routage les composera en un seul appel si la logique d'escalade appartient à la route plutôt qu'à l'application.

Claude Haiku 5.5 n'est pas encore au catalogue. Ce n'est pas une précaution de langage — cela signifie que le côté Ant​hropic de cette comparaison doit actuellement être obtenu directement auprès d'Ant​hropic, alors que ce n'est pas le cas du côté Dee​pSeek. Si vous voulez l'offre économique de la gamme Dee​pSeek sur la même clé que le reste de votre stack dès aujourd'hui, cette partie est déjà en ligne.

A screenshot of the OrcaRouter catalogue page for DeepSeek V4 Flash, showing the model identifier in provider-slash-model form, the provider DeepSeek, the model description and a stat strip carrying the per-million-token input and output rates alongside the context window and maximum output.

Lequel choisir

Si vos appels sont courts — classification, extraction, routage, résumé, tours de sous-agent — et qu'ils tiennent sous 100 000 tokens, Claude Haiku 5.5 est désormais le modèle le moins cher sur les deux compteurs et le plus performant sur le classement indépendant, et le choix est simple. C'est aussi le seul des deux à accepter une image.

Si vos appels sont longs, si vous renvoyez un grand préfixe partagé, ou si vous pouvez planifier, l’arithmétique penche dans l’autre sens, et de loin : l’entrée mise en cache de Dee​pSeek à 0,003 $ en heures creuses est d’un ordre de grandeur inférieure aux 0,01 $ d’Ant​hropic, son plafond de sortie est trois fois plus élevé, et sa remise en heures creuses relève d’un problème d’ordonnancement plutôt que d’une limitation du produit.

Ce que le lancement a réellement tranché est plus étroit que « Anthropic est bon marché maintenant ». Il a tranché que les laboratoires américains pratiqueront des tarifs inférieurs à ceux des laboratoires chinois dans le cas des prompts courts, et que le cas des prompts courts est celui où se trouve la majeure partie du trafic de production. Tout ce qui dépasse 100 000 tokens reste encore le marché de l'autre modèle.