Carte de titre hero générée pour Claude Sonnet 5.5 vs Claude Sonnet 5, sous-titrée « Des prix identiques, des factures différentes », affichant $2.00 et $10.00 par million de tokens des deux côtés, avec en dessous un chiffre divergent de coût par tâche, et le logo OrcaRouter intégré dans le coin inférieur droit.
Guides & Insights

Claude Sonnet 5.5 vs Claude Sonnet 5 : prix identiques, factures différentes

Auteur

Elias Hawthorne

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Deux modèles du même fournisseur, du même niveau, du même nom et — à chaque ligne du tarif publié — au même prix. Claude Sonnet 5 est sorti le 30 juin 2026 à 2,00 $ par million de jetons d'entrée et 10,00 $ par million de jetons de sortie. Claude Sonnet 5.5 a atteint la disponibilité générale le 28 septembre 2026 à 2,00 $ et 10,00 $, avec les lectures de cache à 0,20 $ et les écritures de cache de cinq minutes à 2,50 $ pour les deux. Rien n'a changé côté prix. Ce qui a changé, c'est tout ce qu'une grille tarifaire ne mesure pas, et il en résulte que l'un de ces deux modèles coûte nettement moins cher à exploiter que l'autre, bien qu'il coûte exactement le même prix par jeton. Le titre d'Anthropic pour cette sortie le dit à demi-mot : jusqu'à 30 % de coûts en moins pour la plupart des tâches, sur une grille tarifaire inchangée. Pour que les deux phrases soient vraies, il faut que le modèle le plus récent accomplisse le même travail avec moins de jetons, ce que montrent les benchmarks et ce que confirment les chiffres indépendants par tâche.

Claude Sonnet 5.5 est-il plus cher que Claude Sonnet 5 ?

Non — et la question mérite de toute façon d’être prise au sérieux, car un très grand nombre de migrations ont mal tourné en traitant une grille tarifaire forfaitaire comme une facture forfaitaire.

Par token, les deux modèles sont identiques : 2,00 $ en entrée, 10,00 $ en sortie, 0,20 $ pour lire un token mis en cache, 2,50 $ pour en écrire un. Il n'y a ni palier tarifaire ni surcoût pour le contexte long. Quel que soit le modèle le plus récent, il ne s'agit pas d'une hausse de prix déguisée en nouvelle génération.

Pour chaque tâche terminée, le tableau s'inverse selon la charge de travail que vous décrivez. Artificial Analysis rapporte un coût de 5,09 $ par tâche pour Claude Sonnet 5 et de 7,60 $ par tâche pour Claude Sonnet 5.5 sur la même suite Intelligence Index v4.3 — le modèle plus récent coûte 49 % de plus pour terminer une tâche, à tarif identique. Le même rapport note que Sonnet 5.5 a émis 410 millions de tokens sur l'ensemble de la suite, contre 370 millions pour Sonnet 5, tous deux face à une médiane de 88 millions pour le champ suivi. Sur les prompts ouverts de l'évaluateur, le modèle plus récent écrit simplement davantage, et à prix égaux, plus de tokens représente une facture plus élevée.

L'affirmation d'Anthropic selon laquelle c'est 30 % moins cher est une affirmation de fournisseur portant sur ses propres charges de travail, qu'elle a choisies. Le 7,60 $ contre 5,09 $ établi par un tiers est une mesure réalisée sur un ensemble différent. Ni l'une ni l'autre n'est fausse ; ce désaccord, c'est toute l'histoire, et le facteur décisif est de savoir si vos tâches bornent leur propre sortie.

Qu'est-ce qui a réellement changé entre les deux générations ?

La grille tarifaire est statique ; le modèle ne l’est pas. Présentés sous forme d’une liste unique, les écarts sont importants et majoritairement unidirectionnels.

• Terminal-Bench 4.0 — 70,6 % pour Claude Sonnet 5.5 contre 10,3 % pour Claude Sonnet 5, le plus grand bond entre deux générations qu’Anthropic ait publié sur ce test

• CursorBench 4.0 — 55,5 % contre 34,1 %

• Chartography, sans outils — 61,6 % contre 15,6 %

• GDPval-AA v2.1 — 1844 contre 1449

• AA-Briefcase v1.1 — 1811 contre 1359

• Humanity's Last Exam, avec outils — 64,5 % contre 54,9 %

• OSWorld 2.1, achèvement partiel — 80,1 % contre 57,0 %

• Indice d'intelligence Artificial Analysis v4.3 — 56 contre 38, un écart de dix-huit points sur une échelle tierce mesurée dans la même configuration « Adaptive Reasoning, Max Effort »

La forme de cette liste n'est pas un progrès uniforme. Chartography passant de 15,6 % à 61,6 % et Terminal-Bench de 10,3 % à 70,6 % ressemblent à des capacités qui étaient absentes et qui sont désormais présentes, et non à des capacités qui se sont améliorées. Humanity's Last Exam gagnant dix points et OSWorld vingt-trois points à un prix inchangé, c'est le schéma d'une génération qui a comblé des lacunes précises plutôt que d'une génération devenue généralement plus intelligente. L'écart de dix-huit points de l'indice est la moyenne arithmétique de tout cela : réel, important et concentré dans l'utilisation d'outils, l'exécution de code et le travail visuel.

Une note de bas de page importe pour quiconque lit attentivement le tableau du fournisseur. Anthropic déclare que, sur FrontierCode, la configuration d'effort Max obtient un score inférieur à Xhigh, et elle signale que les exécutions GDPval-AA et AA-Briefcase ont été réalisées sur un déploiement de préversion comportant un bug de sorties structurées. Les chiffres ci-dessus restent les meilleurs disponibles, mais considérez-les comme un instantané issu d'un seul déploiement plutôt que comme une propriété permanente du modèle.

Pourquoi le prix est égal et l'addition ne l'est pas

Trois mécanismes, par ordre décroissant de leur impact sur une facture réelle.

Le premier point est la discipline en matière de longueur de sortie. Sonnet 5.5 est un agent plus capable, ce qui signifie qu'il en fait davantage avant de répondre, et sur une suite sans contrainte de longueur, il écrit environ 11 % de plus que Sonnet 5 tout en coûtant le même prix par token. Sur une charge de travail qui plafonne la sortie — extraction dans un schéma fixe, classification, résumés bornés —, ces 11 % ne se matérialisent jamais et l'affirmation des 30 % devient crédible, car le gain consiste à arriver à la réponse en moins de tours plutôt qu'en moins de tokens par tour.

Le second est le comportement du cache, et c’est la raison pour laquelle un prix de lecture du cache inchangé ne signifie pas un coût de cache inchangé. Les lectures et écritures de cache sont facturées de manière identique sur les deux modèles, de sorte que toute variation du volume de tokens mis en cache se répercute directement sur la facture. Un modèle qui nécessite moins de tours pour terminer une tâche agentique lit son préfixe moins souvent. Il s’agit d’une économie sans aucun changement de tarif derrière, et elle est invisible dans tous les tableaux comparatifs qui ne listent que les lignes du barème tarifaire.

Le troisième est celui que la plupart des équipes ratent le jour de la migration : la valeur par défaut de l'effort. Claude Sonnet 5.5 configure le raisonnement via un paramètre d'effort avec les réglages low, medium, high, xhigh et max, la valeur par défaut étant high sur la Claude Platform et medium dans les applications Claude. Si vous avez migré depuis un déploiement Sonnet 5 où vous aviez fixé un budget de raisonnement, la nouvelle valeur par défaut peut correspondre à une profondeur différente de celle que vous payiez. Mesurez avant de supposer une économie ou une augmentation.

Il convient également de signaler une conséquence comportementale avant le déploiement plutôt qu’après. Anthropic indique que Claude Sonnet 5.5 est le premier Sonnet à être lancé avec des protections et des solutions de repli en matière de cybersécurité au même niveau que ses modèles haut de gamme, de sorte que les demandes de cybersécurité à risque élevé reviennent visiblement au Sonnet précédent. Vos journaux afficheront un modèle que vous n’avez pas demandé. De même, si vous exécutez Sonnet avec la réflexion désactivée, vous devez passer à un comportement entre outils — un changement de code, pas un simple flag.

Sur OrcaRouter, anthropic/claude-sonnet-5 est routable dès aujourd'hui avec un seul identifiant, au prix catalogue du fournisseur et avec 0 % de marge, aux côtés de Claude Opus 5.5, Claude Opus 5, DeepSeek V4 Pro et Gemini 3.1 Pro Preview. Claude Sonnet 5.5 n'est lui-même pas encore une route sur notre plateforme, donc la forme concrète de cette comparaison aujourd'hui, c'est qu'une équipe qui fait déjà tourner Sonnet 5 peut mesurer l'écart le jour où il sera référencé sans toucher à une clé API, et peut basculer entre les niveaux en attendant en changeant une chaîne.

Questions que les gens posent avant de changer

Puis-je exécuter les deux en même temps et comparer sur mon propre trafic ? Pas encore via un seul identifiant OrcaRouter, car Claude Sonnet 5.5 n’est pas une route répertoriée. La solution de contournement consiste à exécuter le modèle le plus récent sur l’API d’Anthropic et le plus ancien via nous, puis à comparer les jetons par tâche terminée plutôt que le coût par jeton, car c’est sur ce chiffre que les deux modèles diffèrent réellement.

Le prix inchangé signifie-t-il qu'Anthropic ne facture pas cette nouvelle capacité ? Cela signifie que le prix catalogue est maintenu stable pendant que le modèle s'améliore, ce qui suit le même schéma que les deux générations précédentes de Sonnet. La question de savoir si cela perdurera est d'ordre commercial, et non technique, et la fenêtre de retrait publiée — pas avant septembre 2027 — est le seul engagement associé.

À quel chiffre devrais-je me fier, les 30 % d’Anthropic ou les 49 % d’un tiers ? Ni l’un ni l’autre comme affirmation générale. Le chiffre d’Anthropic décrit des charges de travail où le modèle parvient à une réponse en moins de tours ; le chiffre d’Artificial Analysis décrit une suite d’indices non contrainte où la verbosité peut croître librement. Choisissez celui qui ressemble à votre ensemble d’invites, et si vous ne pouvez pas déterminer lequel c’est, cette ambiguïté est elle-même la réponse — mesurez-la.

L'essentiel

Claude Sonnet 5.5 n'est pas une hausse de prix, mais ce n'est pas non plus automatiquement une économie. Anthropic a maintenu chaque ligne de la grille tarifaire au même niveau et a fait glisser le modèle en dessous, ce qui signifie que tout l'argument économique repose sur les tokens par tâche accomplie — un chiffre 30 % meilleur sur les charges de travail choisies par le fournisseur et 49 % pire sur la suite choisie par un évaluateur indépendant. Si vos tâches bornent elles-mêmes leur sortie, changez et empochez la victoire. Si ce n'est pas le cas, le prix inchangé n'est pas une raison de faire l'économie de la mesure, car vous pouvez payer une fois et demie plus cher par tâche pour un modèle qui est incontestablement meilleur dans ce travail.

A two-column scoreboard for Claude Sonnet 5.5 and Claude Sonnet 5 across eight rows. Both columns carry the identical rate card: input $2.00, output $10.00, cache read $0.20, cache write $2.50, 1M context with 128K max output. The rows that differ are AA Intelligence Index v4.3 score 56 for Claude Sonnet 5.5 against 38 for Claude Sonnet 5, $7.60 per task on the index run against $5.09, and Terminal-Bench 4.0 (vendor) 70.6% against 10.3%. The card heading reads "Identical rate cards, different bills: Claude Sonnet 5.5 against Claude Sonnet 5", and a footer line reads "Prices per the OrcaRouter catalogue; index and per-task figures per Artificial Analysis, Intelligence Index v4.3. Every price line is a tie by design: the two models share one rate card and differ only in what they emit to finish the same task."Screenshot of the OrcaRouter model page for Anthropic Claude Sonnet 5 (anthropic/claude-sonnet-5), showing the model header, a 1M-token context window with 128K maximum output, text, image and file input, the Vision, Tools, JSON and Reasoning capability tags, a 5.24-second p50 time to first token, a "Public benchmarks by Anthropic · 2026-06-30" line, and the $2.00 input and $10.00 output prices per million tokens.Screenshot of Anthropic's newsroom page for Claude Sonnet 5.5, showing the site navigation bar, the publication date September 28, 2026, the model heading "Claude Sonnet 5.5", and an image-led marketing hero beneath it that carries no machine-readable specification figures.