Une carte de titre pour Claude Sonnet 5.5 dans Claude Code intitulée « Claude Sonnet 5.5 dans Claude Code », avec le sous-titre « Même modèle, deux fournisseurs, deux valeurs par défaut » et la ligne de légende « Effort par défaut : élevé sur l'API Claude, moyen dans Claude Code. », avec trois cartes affichant v2.1.284, 28 sept. 2026, 2 $ / 10 $ par million de tokens et « l'alias sonnet a été déplacé sur un fournisseur ».
Guides & Insights

Claude Sonnet 5.5 dans Claude Code : l'alias a changé sur un fournisseur, et la valeur par défaut a reculé

Auteur

Rowan Sterling

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Le briefing tiers qui a remis Claude Sonnet 5.5 sur le radar cette semaine disait qu'il est « disponible partout, y compris la Platform et Claude Code ». La première partie correspond à la déclaration du fournisseur lui-même, datée du 28 septembre, et elle se vérifie : Claude Sonnet 5.5 a été déployé sur la Claude API, Amazon Bedrock, Claude Platform on AWS, Google Cloud et Microsoft Foundry à 2 $ et 10 $ par million de tokens, sans changement par rapport à Claude Sonnet 5. La seconde partie n'est vraie que si « Claude Code » désigne un seul fournisseur. La version de Claude Code sortie le même après-midi, v2.1.284, fait pointer l'alias sonnet vers Claude Sonnet 5.5 sur l'API Anthropic — et le laisse pointer vers Claude Sonnet 4.6 sur Claude Platform on AWS et Claude Sonnet 4.5 sur Amazon Bedrock et Google Cloud. Exécutez /model sonnet sur un déploiement Bedrock et vous n'obtenez pas le nouveau modèle. Il y a une seconde chose qui a changé, et presque personne ne l'a notée : sur la Claude API Claude Sonnet 5.5 démarre avec un niveau d'effort élevé ; dans Claude Code, il démarre avec un niveau d'effort moyen. Les deux faits sont documentés, les deux sont déterminants pour quiconque se demande s'il faut basculer cette semaine, et les deux se trouvent sous la même phrase affirmant que le modèle est disponible partout.

Ce que la v2.1.284 a réellement changé

L'entrée du changelog de Claude Code tient sur une seule ligne et la moitié importante est une précision : « Ajout de Claude Sonnet 5.5 (claude-sonnet-5-5), désormais le modèle Sonnet par défaut sur l'API Anthropic — contexte de 1 M, 2 $/10 $ par Mtok avec des lectures de cache à 0,20 $/Mtok. » Ce build a été publié sur npm le 28 septembre à 17:11 UTC, ce qui correspond à la date de publication avec un horodatage plutôt qu'à un numéro de version. La documentation de configuration des modèles comporte le tableau de résolution que le changelog ne contient pas.

• sonnet — alias Claude Sonnet 5.5 sur l'API Ant​hropic ; Claude Sonnet 4.6 sur Claude Platform sur AWS ; Claude Sonnet 4.5 sur Amazon Bedrock et l'Agent Platform de Goo​gle Cloud ; Claude Sonnet 4.5 sur Microsoft Foundry.

• opus alias — Claude Opus 5.5 sur l'API Anthropic, Claude Platform sur AWS, Amazon Bedrock et Google Cloud ; Claude Opus 4.6 sur Microsoft Foundry.

• Modèle par défaut — Claude Opus 5.5 sur Pro, Max, Team, Enterprise et l'API Ant​hropic, et Claude Sonnet 4.5 sur Microsoft Foundry. Il s'agit d'Opus 5.5 depuis la v2.1.280 le 22 septembre ; auparavant, il s'agissait de Claude Sonnet 5 sur Pro et Team Standard.

• sonnet[1m] — sans effet lorsque sonnetrenvoie déjà à Claude Sonnet 5.5 ou Claude Sonnet 5, car les deux disposent d'une fenêtre native de 1 M de tokens. Ce n'est pas ce suffixe qui vous donne un contexte long sur ce modèle ; le modèle en dispose déjà.

Lisez la première et la troisième ligne ensemble, et la conséquence pratique est étroite mais nette. Sur l'API Anthropic, mettre à niveau Claude Code constitue toute la migration — sonnet bascule pour vous. Sur Bedrock, Google Cloud et Claude Platform sur AWS, le modèle est servi mais l'alias n'est pas déplacé, et la documentation est explicite quant à la solution de contournement : lorsqu'un alias correspond à un modèle plus ancien, les modèles plus récents sont accessibles en les nommant en entier ou en définissant ANTHROPIC_DEFAULT_SONNET_MODEL. Donc « Sonnet 5.5 est disponible dans Claude Code » est une phrase qui porte sur une valeur par défaut, et les valeurs par défaut dépendent du fournisseur.

L'effort par défaut est un échelon sur chaque surface.

C'est la partie qui modifie votre facture plutôt que votre chaîne de modèle, et elle est répartie sur deux pages qui ne se référencent pas mutuellement. La documentation sur l'effort de l'API Claude indique que Claude Sonnet 5.5 prend en charge les cinq niveaux et que high y est la valeur par défaut. La page de configuration des modèles de Claude Code indique l'ordre de résolution pour une session — un choix explicite (la variable CLAUDE_CODE_EFFORT_LEVEL, --effort, ou /effort), puis vos paramètres enregistrés, puis la valeur par défaut du modèle lui-même — et donne ensuite cette valeur par défaut du modèle comme suit : « high sur chaque modèle qui prend en charge l'effort, sauf qu'Opus 5.5 et Sonnet 5.5 sont par défaut sur medium, et qu'Opus 4.7 est par défaut sur xhigh. »

Deux valeurs par défaut, un même modèle, à un cran d'écart. Sur l'indice indépendant, ce cran vaut environ six points d'intelligence et à peu près 84 % de dépense en plus par tâche accomplie. Les propres recommandations d'Anthropic pour Claude Sonnet 5.5 — commencez à highsauf si la charge de travail est agentique ou sensible à la latence, et commencez à mediumpour le codage agentique et l'usage d'outils en plusieurs étapes — sont écrites pour la surface API, où highest ce que vous obtenez en ne faisant rien. Claude Code a déjà fait ce choix pour vous, dans l'autre sens.

Si le fait qu'il ait pris la bonne décision est vraiment délicat, et l'argument du fournisseur pour medium est défendable : les niveaux d'effort du modèle sont explicitement recalibrés par rapport à Claude Sonnet 4, et la note de migration indique de refaire un balayage des efforts plutôt que de reporter un réglage. Mais « recalibré » est à double tranchant, et c'est dans la section suivante que cela se manifeste.

The Claude Code model-configuration documentation page, showing the per-provider resolution table: the sonnet alias resolves to Claude Sonnet 5.5 on the Anthropic API, Claude Sonnet 4.6 on Claude Platform on AWS, and Claude Sonnet 4.5 on Amazon Bedrock and Google Cloud's Agent Platform; the opus alias resolves to Claude Opus 5.5 on the first four providers and Claude Opus 4.6 on Microsoft Foundry.

Ce que coûte l’échelle, mesuré

Artificial Analysis a mesuré Claude Sonnet 5.5 à chaque échelon de l'Intelligence Index v4.3.2, qui est une suite de dix évaluations, et le coût par échelon est le nombre que la grille tarifaire d'un fournisseur ne montre pas. Tous les chiffres ci-dessous sont ceux de cet évaluateur, lus à partir des données propres à la page du modèle le 30 septembre 2026 ; les tarifs du fournisseur sont ceux d'Anthropic.

• Faible — indice 35,84 à 0,41 $ par tâche ; premier segment en 1,04 seconde.

• Moyen, la valeur par défaut de Claude Code — 40,74 à 0,59 $ ; premier segment en 1,34 seconde.

• High, la valeur par défaut de l'API Claude — 46,74 à 1,08 $ ; premier segment en 16,6 secondes.

• Xhigh — 51,85 à 2,74 $ ; premier segment en 39,7 secondes.

• Max — 55,98 à 7,60 $ ; premier bloc en 378,8 secondes.

Maintenant, placez l'échelle de Claude Sonnet 5 à côté, car c'est le modèle à partir duquel la plupart des lecteurs migreraient. Ses échelons affichent 24,26, 28,05, 31,66, 34,38 et 38,16, coûtant 0,51 $, 1,00 $, 1,79 $, 2,87 $ et 5,09 $ par tâche. Claude Sonnet 5.5 au niveau par défaut de Claude Code, moyen obtient 40,74 — au-dessus du meilleur résultat de Claude Sonnet 5 à n'importe quel niveau d'effort — pour 0,59 $ contre 5,09 $. C'est 8,7 fois moins cher par tâche complétée sur la même suite, et c'est la version indépendante de l'affirmation d'Ant​hropic selon laquelle le coût est « inférieur à un dixième », que le fournisseur fait sur Terminal-Bench au niveau d'effort moyen. Même direction, facteur légèrement plus petit, et c'est un résultat mesuré plutôt qu'un tableau de fournisseur. Passez à faible à la place et l'ordre s'inverse : 35,84 est en dessous du plafond de Claude Sonnet 5, qui est le plancher honnête de l'économie.

L'échelon qui n'est bon marché sur aucun des deux modèles est celui du haut. À effort maximal Claude Sonnet 5.5coûte 7,60 $ par tâche d'index contre Claude Sonnet 5, à 5,09 $ — environ 49 % de plus, et non de moins. Ce n'est pas une contradiction du chiffre du fournisseur. C'est la même courbe lue à l'autre extrémité, et c'est là qu'aboutit une migration si le réglage d'effort est reporté plutôt que balayé.

Il se peut que votre réglage d’effort enregistré ne vous suive pas

Un troisième réglage entre en jeu, et c'est celui qui a le plus de chances d'être erroné en silence. Claude Code enregistre le niveau d'effort par modèle, sous modelSettings dans vos paramètres utilisateur, de sorte que chacun conserve son propre niveau. L'ancienne forme — une seule clé de premier niveau effortLevel, ce que /effort écrivait avant que l'enregistrement par modèle n'existe — est traitée différemment pour les modèles récents. La documentation indique que cette clé « continue de s'appliquer là où elle s'appliquait auparavant, sur Opus 4.5, Fable 5.1 et les modèles antérieurs, tandis qu'Opus 5.5 et les modèles sortis après lui démarrent à leur propre valeur par défaut jusqu'à ce que vous choisissiez un niveau pour eux. »

Claude Sonnet 5.5 a été publié après Claude Opus 5.5 — le 28 septembre contre le 22 septembre — il appartient donc à ce second groupe. Une équipe qui a défini un effortLevel: "high" global il y a un an pour garder Claude Sonnet 5 précis n'obtient pas high sur le nouveau modèle. Elle obtient medium, qui est la valeur par défaut de Claude Code, et rien dans la session ne le signale. La même page indique que max ne s'applique qu'à la session en cours, sauf s'il est défini via la variable d'environnement, et que les clés effortLevel de projet, locales ou gérées, ou celle transmise avec --settings, s'appliquent à tous les modèles. Si vous voulez une politique d'effort qui survive à la sortie d'un modèle, c'est sous cette forme qu'il faut l'écrire.

Un changement adjacent mérite d'être mentionné parce qu'il partage le même numéro de version : le bouton Ultracode dans le curseur d'effort est un paramètre de Claude Code plutôt qu'un niveau d'effort du modèle, et le laisser activé à des niveaux autres que xhigh, ou le désactiver avec /effort ultracode off, nécessite la v2.1.284 — la même build qui embarquait le nouveau Sonnet. Ultracode n'est pas un niveau d'effort et ne doit pas être interprété comme tel, mais si vous avez scripté autour de l'ancien comportement, c'est la version où celui-ci a changé.

L'attente est le budget de réflexion, pas le taux de tokens

Les chiffres de latence ci-dessus sont l'élément le plus utile sur le plan opérationnel de la page, car ils inversent l'intuition habituelle. La vitesse de sortie sur Claude Sonnet 5.5 ne diminue pas à mesure que l'effort augmente ; elle augmente avec lui, de 85 jetons par seconde à faible effort à 137 au maximum. Ce qui explose, c'est l'attente avant que le premier jeton n'existe tout court — 1,0 seconde à faible, 1,3 à moyen, 16,6 à élevé, 39,7 à très élevé, 378,8 au maximum. Le modèle n'est pas plus lent par jeton en haut de l'échelle. Il réfléchit plus longtemps avant de commencer, et au barreau supérieur, cela représente plus de six minutes de silence avant chaque tâche.

Cela recadre la raison d’être de ce réglage. Le niveau moyen n’est pas tant un compromis de qualité que le seul échelon où le modèle se comporte comme un outil conversationnel ; le niveau max est une opération par lots déguisée en interface interactive. Un client de streaming qui masque l’écart fait que le niveau élevé semble correct dans une démo et donne l’impression d’être cassé dans un terminal. La répartition pratique que la plupart des équipes adopteront est un échelon bas pour tout ce qu’un humain regarde et un échelon haut pour le travail qui s’exécute sans surveillance — ce qui est proche du conseil du fournisseur lui-même, formulé du point de vue de la latence plutôt que du coût.

La comparaison qui est réellement routable aujourd'hui

Si l'idée de l'échelle est que le niveau moyen est là où se trouve la valeur, la question intéressante est de savoir ce qui d'autre se situe près de lui. Claude Opus 5.5 à son propre réglage par défaut dans Claude Code, moyen, obtient 51,24 à 1,34 $ par tâche sur la même suite. Claude Sonnet 5.5 au niveau élevé obtient 46 à 1,08 $. Quatre points et demi d'indice les séparent pour environ un quart de plus par tâche, et Claude Opus 5.5 est également en tête à chaque échelon au-dessus de son réglage par défaut.

Une note de disponibilité, énoncée plutôt que sous-entendue : Claude Sonnet 5.5 ne figure pas au catalogue d'OrcaRouter. Il est absent de la liste publique des modèles et chaque orthographe du slug renvoie un « introuvable », donc rien ici ne doit être lu comme une route vers ce modèle. Ce qui est routable, c'est le modèle depuis lequel vous migreriez et celui qui se situe au-dessus. anthropic/claude-sonnet-5 est présent sur la plateforme depuis le 30 juin 2026 aux tarifs propres d'Anthropic, soit 2,00 $ et 10,00 $ par million de tokens, avec les lectures de cache à 0,20 $ et une écriture de cache à 2,50 $, servi via /v1/messages, /v1/chat/completions et /v1/responses. anthropic/claude-opus-5.5 y est disponible depuis le 22 septembre à 4,00 $ et 20,00 $, via les endpoints compatibles Anthropic et chat-completions.

C'est cette combinaison qui rend un balayage d'effort peu coûteux à exécuter. Les deux côtés de la comparaison — le modèle en place à son ancien réglage et le grand frère à l'échelon par rapport auquel le réglage par défaut du nouveau modèle est évalué — répondent avec un seul identifiant, sans second contrat et sans modification de code au-delà de la chaîne de modèle, et le catalogue répercute le prix catalogue du fournisseur sans ajouter de marge. La seule chose qu'il ne fera pas, c'est de vous servir Claude Sonnet 5.5 lui-même, et tant que cela n'aura pas changé, la version honnête du conseil de cet article est d'évaluer l'échelon sur l'API propre d'Anthropic et d'évaluer les alternatives là où elles sont déjà accessibles.

The OrcaRouter model page for anthropic/claude-sonnet-5, showing a 1M-token context window, up to 128K output tokens, input at $2.00 and output at $10.00 per 1M tokens with a $0.20 cache read and $2.50 cache write, a listing dated Jun 30, 2026, and tiles reading AA Coding 71.5 and AA Intelligence 38.2.The Artificial Analysis model page for Claude Sonnet 5.5, labelled Adaptive Reasoning, Max Effort, Default Fallback, released September 2026. It shows an Intelligence Index of 56, class ranks of #3 of 216 on intelligence and #98 of 216 on cost, $2.00 input and $10.00 output per 1M tokens with a 90% cache discount, a $7.60 average cost per Intelligence Index task, 410M tokens generated against a median of 88M, 137 tokens per second, 1M-token context window, and text and image input.

Que faire cette semaine

Trois choses, dans l'ordre où elles vous coûteront de l'argent si vous les négligez. Vérifiez sur quel fournisseur votre session Claude Code s'exécute réellement avant de supposer que la mise à niveau a bien eu lieu, car sur Bedrock, Google Cloud et Claude Platform on AWS l'alias sonnet pointe encore vers Claude Sonnet 4.5 ou Claude Sonnet 4.6 et le modèle doit être nommé en toutes lettres. Vérifiez si votre effort enregistré est une entrée modelSettings par modèle ou l'ancienne clé de premier niveau, car seule la première vous suit sur un modèle publié après Claude Opus 5.5. Et lorsque vous relancez le balayage demandé par le fournisseur, balayez vers le haut comme vers le bas : au niveau par défaut de Claude Code, Claude Sonnet 5.5bat Claude Sonnet 5 pour moins d'un neuvième du coût, ce qui signifie que la question intéressante n'est plus de savoir s'il faut descendre, mais jusqu'où vous pouvez vous permettre de monter.

La question qui reste ouverte, c'est Claude Haiku 5.5, dont Ant​hropic affirme qu'il rejoindra la famille dans les semaines à venir et qu'il se situera en dessous de ce modèle. Si le schéma de Claude Opus 5.5 se vérifie, il arrivera d'abord sur l'API Ant​hropic, puis gagnera les autres fournisseurs avec un décalage mesuré en versions de Claude Code plutôt qu'en jours. C'est ce décalage qu'il faut surveiller, car tout ce qui précède au sujet des alias et des valeurs par défaut en découle en réalité.

Comparés dans cet article3

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement