Carte de titre principale générée pour Claude Sonnet 5.5 vs Claude Opus 5, sous-titrée « Une baisse de prix de 60 % et un écart de cinq points », affichant 2,00 $ et 10,00 $ par million de tokens contre 5,00 $ et 25,00 $, avec le logo OrcaRouter incrusté dans le coin inférieur droit.
Guides & Insights

Claude Sonnet 5.5 vs Claude Opus 5 : moins cher sur chaque ligne, et en tête sur l’indice

Auteur

Rowan Sterling

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Claude Opus 5 est sorti le 24 juillet 2026 à 5,00 $ par million de jetons d'entrée et 25,00 $ par million de jetons de sortie. Claude Sonnet 5.5 a atteint sa disponibilité générale le 28 septembre 2026, à 2,00 $ et 10,00 $. Soit une réduction de 60 % sur l'entrée et de 60 % sur la sortie pour un modèle deux générations plus récent — et, sur le harnais qu'Artificial Analysis exécute pour les deux, un modèle qui atteint 56 sur l'Intelligence Index v4.3, contre 51 pour Claude Opus 5. C'est une comparaison rare, où le modèle plus récent et moins cher est aussi celui qui obtient le meilleur score sur un index tiers, et où le principal argument restant en faveur du modèle en place n'est pas son rang dans les benchmarks, mais une catégorie de travail précise. Les deux modèles acceptent 1 M de jetons de contexte, émettent jusqu'à 128 K de jetons, lisent du texte, des images et des fichiers, et configurent le raisonnement via un paramètre d'effort plutôt qu'un budget de jetons de réflexion. Comme les surfaces sont identiques, choisir entre les deux revient uniquement à déterminer ce que coûte une tâche menée à bien et quelles tâches échouent.

Deux versions, une interface

Commencez par le peu de choses qui changent, car c’est plus que dans la plupart des sauts de génération.

• Fenêtre de contexte — 1 000 000 de jetons sur les deux

• Sortie maximale — 128 000 jetons sur les deux

• Modalité d'entrée — texte, image et fichier sur les deux ; ni audio ni vidéo sur aucun des deux

• Raisonnement — pensée adaptative avec effort configurable sur les deux, de sorte que la profondeur soit un paramètre de requête plutôt qu’une chaîne de modèle distincte

• Capacités — vision, outils, JSON et raisonnement sur les deux, d'après les entrées du catalogue OrcaRouter pour anthropic/claude-opus-5 et la gamme Sonnet

La conséquence pratique est qu’une invite écrite pour Claude Opus 5 n’a pas besoin d’être réécrite pour s’exécuter sur Claude Sonnet 5.5, et qu’une boucle d’agent calibrée autour d’un plafond de sortie de 128K n’a pas besoin d’un nouveau palier. La migration se résume à un remplacement de chaîne de modèle et à une revérification du paramètre d’effort que vous aviez épinglé — rien de plus. Pour les équipes qui ont vécu les transitions multimodales et multiparamètres des deux dernières années, c’est là le gros titre, pas le benchmark.

La seule chose qui change vraiment, c’est le prix, et il change à chaque ligne plutôt que seulement pour les deux de la diapositive marketing.

• Entrée — 2,00 $ par million contre 5,00 $, soit une réduction de 60 %

• Sortie — 10,00 $ par million contre 25,00 $, une réduction de 60 %

• Lecture du cache — 0,20 $ par million contre 0,50 $, une baisse de 60 %

• Écriture dans le cache — 2,50 $ par million contre 10,00 $ pour la fenêtre de cinq minutes, une réduction de 75 %

Si vous exécutez un agent qui relit un long préfixe à chaque tour, c'est la ligne de lecture du cache qui paie la migration. À 0,20 $ contre 0,50 $, chaque token mis en cache dans une longue session revient à 40 % de son ancien coût, et les lectures de cache constituent l'essentiel du nombre de tokens dans la plupart des boucles agentiques. L'économie se cumule d'une manière que le chiffre phare par token ne capte pas.

D'où viennent les cinq points

Artificial Analysis attribue à Claude Sonnet 5.5 un score de 56 et à Claude Opus 5 un score de 51 sur l’Intelligence Index v4.3, tous deux mesurés dans la configuration « Adaptive Reasoning, Max Effort ». Cinq points ne constituent pas une erreur d’arrondi à cette échelle — pour situer les choses, le même évaluateur place Sonnet 5 à 38 et Gemini 3.1 Pro Preview à 30, si bien que l’écart entre Claude Opus 5 et Claude Sonnet 5.5 représente un tiers de l’écart entre Claude Opus 5 et la génération Sonnet précédente.

Les propres chiffres de lancement d’Anthropic pour Claude Sonnet 5.5 pointent dans la même direction avec un instrument différent. L’entreprise rapporte 70,6 % sur Terminal-Bench 4.0 — le même test sur lequel Claude Opus 5 est documenté à 89,1 % dans un tableau Anthropic antérieur, un chiffre qui utilisait une révision de harnais différente et ne doit pas être soustrait du plus récent. C’est la mise en garde la plus importante de cet article en matière de sources : Terminal-Bench est passé à la version 4.0 en cours d’année 2026, l’index qui le contient a été révisé en v4.3 pour s’aligner, et les comparaisons entre versions de ce benchmark ne relèvent pas de l’arithmétique. Lorsqu’un nombre est associé à une version, citez la version.

Ce qui peut être comparé proprement, c’est la progression du côté Sonnet du fournisseur lui-même — de 10,3 % sur Terminal-Bench 4.0 pour Sonnet 5 à 70,6 % pour Sonnet 5.5 — ainsi que la lecture de l’indice tiers, où les deux chiffres proviennent du même harnais le même jour. Sur cette base, le successeur a véritablement dépassé le modèle phare de juillet en matière de raisonnement général, ce qui constitue une affirmation plus forte que celle que fait n’importe quelle diapositive du fournisseur.

Le piège de la longueur de sortie

C'est ici que l'arithmétique cesse d'être indulgente envers le modèle plus récent.

Artificial Analysis rapporte que l'évaluation de Claude Sonnet 5.5 sur sa suite d'indices coûte 7,60 $ par tâche. Claude Opus 5 coûte 5,86 $ par tâche sur la même suite. Le modèle plus récent, avec 60 % de réduction sur chaque ligne de la grille tarifaire, revient environ 30 % plus cher pour terminer une tâche. La raison figure dans le même rapport : Sonnet 5.5 a émis 410 millions de tokens sur l'ensemble de la suite, contre une médiane de 88 millions pour les modèles suivis, ce que l'évaluateur qualifie de « très verbeux ». Claude Opus 5 a émis 140 millions sur la même suite.

Faites la division et le mécanisme est simple. Sonnet 5.5 produit environ trois fois plus de tokens de sortie que Claude Opus 5 pour un travail identique, à 40 % du prix des tokens de sortie. Trois fois 0,4 font 1,2 — une pénalité de 20 % avant les effets de cache, ce qui est proche du résultat de 7,60 $ contre 5,86 $. Le prix par token n’est pas faux ; ce n’est simplement pas le chiffre qui détermine la facture.

Cela ne fait pas du modèle plus récent un moins bon achat. Cela fait dépendre la décision d'un élément que la plupart des comparaisons omettent : la question de savoir si votre charge de travail vous permet de borner la sortie. Une tâche de résumé avec une consigne de longueur, un pipeline d'extraction structurée produisant du JSON, un classifieur renvoyant une étiquette — dans tous ces cas, la verbosité n'entre jamais en jeu, et la réduction de 60 % du tarif représente de l'argent réel. Un agent ouvert, à qui l'on demande de « réparer le dépôt » sans discipline de sortie, donne à Sonnet 5.5 trois fois plus de corde.

Paramètres d’effort et la migration pour laquelle personne ne prévoit de budget

Les deux modèles exposent la profondeur de raisonnement via un paramètre d’effort à plusieurs niveaux, et tous deux proposent une valeur par défaut plutôt qu’une valeur fixe — élevée sur Claude Platform, moyenne dans les applications Claude. Lors d’une migration, la tentation est de laisser ce paramètre tel qu’il était sur l’ancien modèle et de considérer que le travail est terminé.

C’est une erreur pour une raison mesurable. La note de bas de page d’Anthropic pour Claude Sonnet 5.5 indique elle-même que la configuration d’effort Max obtient un score inférieur à Xhigh sur FrontierCode, ce qui signifie que l’effort n’est pas un réglage monotone et que le paramètre le plus élevé n’est pas une mise à niveau gratuite. Définissez l’effort en mesurant votre tâche, et non en choisissant l’option la plus coûteuse disponible.

Il existe aussi une différence comportementale marquée du côté de Sonnet, qu’il vaut la peine de connaître avant un déploiement. Anthropic indique que Claude Sonnet 5.5 est le premier Sonnet à être livré avec des garde-fous et des mécanismes de repli en matière de cybersécurité équivalents à ceux de ses modèles les plus avancés, si bien que les demandes de sécurité à risque plus élevé basculent visiblement vers le Sonnet précédent plutôt que d’être traitées par le modèle que vous avez nommé. Si votre charge de travail relève de ce domaine, vos journaux afficheront un modèle que vous n’avez pas demandé. Claude Opus 5 est antérieur à cet arrangement sur la gamme Sonnet, bien que la même classe de routage existe dans l’ensemble des produits Anthropic pour les travaux de biologie et de cybersécurité sur les niveaux phares.

Sur OrcaRouter, les deux points de terminaison sont déjà actifs aujourd'hui — anthropic/claude-opus-5 et anthropic/claude-sonnet-5figurent dans le même catalogue que tout le reste, facturés au tarif du fournisseur, avec 0 % de marge — et Claude Sonnet 5.5 sera accessible avec ces mêmes identifiants dès qu'il sera référencé. En attendant, la fonctionnalité pertinente est le basculement automatique : si un niveau d'Anthropic subit une limitation de débit ou renvoie des erreurs, la requête peut être redirigée vers l'autre sans modification du code, ce qui constitue la couverture la moins coûteuse possible contre une erreur dans cette comparaison.

La décision, énoncée sous forme de règle

Si votre travail est délimité — vous contrôlez la forme de la sortie, les prompts sont structurés et le nombre de tokens par tâche est prévisible — passez à Claude Sonnet 5.5 et profitez de la réduction de 60 %. L’indice est d’accord, la grille tarifaire est d’accord, et il ne reste plus aucun argument de capacité de l’autre côté.

Si votre travail est ouvert et agentique, réalisez l’expérience avant de croire l’une ou l’autre grille tarifaire. Mesurez les jetons par tâche terminée sur votre propre trafic pendant une semaine pour chaque modèle ; le résultat tiers de 7,60 $ contre 5,86 $ est un avertissement précis que la grille tarifaire la moins chère peut produire la facture la plus élevée. Claude Opus 5 reste la valeur par défaut plus sûre pour le travail autonome à long horizon tant que vous n’avez pas ce chiffre.

Le verdict honnête : c'est la première génération de Sonnet où l'argument en faveur du modèle phare repose sur la forme des tâches plutôt que sur la capacité brute, et quiconque prend encore la décision sur le seul nom du modèle laisse désormais 60 % sur la table ou paie 30 % de plus par tâche terminée, en fonction uniquement du sens dans lequel il devine.

A two-column scoreboard for Claude Sonnet 5.5 and Claude Opus 5 across eight rows. Left column Claude Sonnet 5.5: input $2.00, output $10.00, cache read $0.20, cache write $2.50, 1M context with 128K max output, AA Intelligence Index v4.3 score 56, $7.60 per task on the index run, 410M output tokens on the index suite. Right column Claude Opus 5: input $5.00, output $25.00, cache read $0.50, cache write $10.00, 1M context with 128K max output, AA Intelligence Index v4.3 score 51, $5.86 per task on the index run, 140M output tokens on the index suite. A footer line reads "Prices per the OrcaRouter catalogue; index and per-task figures per Artificial Analysis, Intelligence Index v4.3. Sonnet 5.5 is 60% cheaper on input, output and cache reads and 75% cheaper on cache writes, and still costs about 30% more per finished task."Screenshot of the OrcaRouter model page for Anthropic Claude Opus 5 (anthropic/claude-opus-5), showing the model header, a 1M-token context window with 128K maximum output, text, image and file input, the Vision, Tools, JSON and Reasoning capability tags, a 5.19-second p50 time to first token, a "Public benchmarks by Anthropic · 2026-07-24" line, and the $5.00 input and $25.00 output prices per million tokens.Screenshot of Artificial Analysis's model page for Claude Sonnet 5.5, named in full as "Claude Sonnet 5.5 (Adaptive Reasoning, Max Effort, Default Fallback)" and marked released September 2026, showing the In $2.00 and Out $10.00 rates, the Intelligence Index score of 56, the $7.60 average cost per task, and the 410M output tokens described as very verbose against a median of 88M.

Comparés dans cet article1

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement