Carte hero générée intitulée « Claude Sonnet 5.5 est déployé », sous-titrée « cinq changements majeurs pour le code déjà sur Claude Sonnet 5 », avec des pastilles indiquant « 2 $ / 10 $ par million, inchangé », « Indice d’intelligence 56 contre 38 » et « Sorti le 2026-09-28 », et un pied de page citant Artificial Analysis v4.3.2 pour l’Indice et Anthropic pour la tarification et le cycle de vie.
Guides & Insights

Claude Sonnet 5.5 est déployé sur Claude et l’API — avec cinq changements qui cassent le code existant

Auteur

Magnus Corvin

Date de publication

Derniers modèles · 20Voir tous les modèles →
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Claude Sonnet 5.5 est en ligne. L'annonce du fournisseur est datée du 28 septembre 2026, la page des modèles de Claude Platform le répertorie comme « Latest », et l'identifiant est claude-sonnet-5-5sur l'API Claude, Amazon Bedrock, les consoles cloud, Microsoft Foundry et Claude Platform sur AWS. Le déploiement vers Claude lui-même et vers l'API est la partie qui a lieu cette semaine. La partie qui vous coûtera une journée se trouve ailleurs dans la même documentation : cinq changements incompatibles affectent du code déjà en cours d'exécution sur Claude Sonnet 5, et un sixième modifie la forme de la réponse sans faire échouer une seule requête.

Telle est la physionomie de cette version. La grille tarifaire n'a pas bougé : Claude Sonnet 5.5 coûte 2 $ par million de jetons d'entrée et 10 $ par million de jetons de sortie, exactement ce que coûte Claude Sonnet 5, avec des lectures de cache à 0,20 $ et une écriture de cache de cinq minutes à 2,50 $. Les capacités, elles, ont fait un grand bond. Dans la révision actuelle d'Artificial Analysis, le nouveau modèle se situe 18 points au-dessus de celui qu'il remplace, soit l'écart le plus large entre deux modèles Sonnet consécutifs dans ce classement. Le coût de migration est logiquement le plus élevé lui aussi. Rien de tout cela n'est une plainte — un modèle qui s'améliore sans devenir plus cher, c'est le bon scénario — mais les deux faits arrivent ensemble, et les notes de version sont la moitié qui détermine si votre semaine se passe bien.

Qu'est-ce qui a réellement été livré le 28 septembre ?

Anthropic's Claude Platform documentation page for Claude Sonnet 5.5, headed 'The best combination of speed and intelligence', showing the model ID claude-sonnet-5-5, a 1M-token context window, 128K max output, input pricing of $2 per million tokens and output pricing of $10 per million tokens, and the five breaking changes listed in the overview.

La spécification est un prolongement direct du niveau plutôt qu’une nouvelle forme :

• ID de modèle — claude-sonnet-5-5 sur l'API Claude, Claude Platform sur AWS et Microsoft Foundry ; anthropic.claude-sonnet-5-5 sur Amazon Bedrock

• Prix — 2 $ / MTok en entrée, 10 $ / MTok en sortie, 2,50 $ pour une écriture de cache de cinq minutes, 4 $ pour une écriture de cache d'une heure, 0,20 $ pour une lecture de cache

• Lot — 50 % de réduction dans les deux sens, soit 1 $ / 5 $ par MTok

• Contexte et sortie — 1 M de tokens en entrée, 128 K de tokens en sortie de manière synchrone, 300 K en sortie sur l'API Message Batches derrière output-300k-2026-03-24l'en-tête bêta

• Réflexion — adaptative, avec un effort par défaut de niveau élevé ; les dates de coupure des connaissances et de l’entraînement sont toutes deux en juin 2026

• Cycle de vie — zéro conservation de données dès le lancement, et un plancher de retrait publié, pas avant le 28 septembre 2027

Deux détails sont faciles à manquer et pourtant importants. Premièrement, il n’y a pas de supplément pour le contexte long : Anthropic facture la fenêtre complète de 1 M de jetons au tarif standard, si bien qu’une requête de 900 000 jetons coûte le même prix par jeton qu’une requête de 9 000 jetons. Deuxièmement, le tarif de 2 $ / 10 $ du modèle précédent était à l’origine un prix de lancement, avec une augmentation prévue à 3 $ / 15 $ le 1er septembre 2026 ; la page tarifaire d’Anthropic indique désormais que cette augmentation n’aura pas lieu, ce qui fait du prix actuel du niveau Sonnet un engagement durable plutôt qu’une promotion. Ces deux points sont des déclarations du fournisseur, et non des constatations indépendantes.

La liste des migrations, dans l’ordre où elles se feront sentir

L'aperçu de Sonnet 5.5 d'Anthropic est d'une franchise inhabituelle à ce sujet : cinq changements de rupture touchent du code déjà en cours d'exécution sur Claude Sonnet 5. Ils ne sont pas stylistiques. Chacun renvoie une erreur ou modifie silencieusement le comportement.

• L'utilisation forcée d'un outil est refusée. Un tool_choice de "any", ou d'un outil nommé, renvoie désormais une erreur plutôt que de contraindre le modèle. Si votre boucle d'agent épingle un outil pour garantir un appel structuré, cette boucle cesse de fonctionner dès la première requête. La solution consiste à laisser le modèle choisir et valider le résultat, ou à déplacer la garantie dans les sorties structurées.

• thinking: {"type": "disabled"} est refusé. Désactiver complètement la réflexion n'est plus un paramètre pris en charge. Le remplacement est between_tools, qui désactive la réflexion en amont et fonctionne à un niveau d'effort high ou inférieur. Il s'agit du paramètre de réflexion le plus bas du modèle, et non d'un interrupteur d'arrêt.

• Les blocs de réflexion sont liés au modèle et à la conversation. Le raisonnement produit par un tour précédent se transmet de Claude Sonnet 5 à Claude Sonnet 5.5, mais pas vers une autre famille, ni entre comptes. Les applications qui rejouent une transcription à travers les versions du modèle verront les blocs de réflexion rejetés là où ils étaient auparavant acceptés.

• computer_20251124 n'est pas accepté sur l'API Claude ou Google Cloud. Le code qui déclarait la version antérieure de l'outil computer-use doit migrer vers l'ensemble d'outils actuel.

• L'outil advisor rejette sa propre famille. Claude Opus 4.8, Claude Opus 4.7 et Claude Sonnet 5 sont refusés comme advisors, donc tout pipeline qui utilisait un modèle Claude plus petit comme vérificateur face à un plus grand doit être réapparié.

Ensuite, il y a le changement qui ne fait échouer aucun test. Le texte que le modèle émet entre les appels d'outils arrive désormais à l'intérieur de thinking blocs plutôt que comme une sortie ordinaire. Une application qui diffuse du texte à un utilisateur devient silencieuse entre les appels d'outils — aucune erreur, aucune exception, juste une interface qui semble se figer jusqu'à ce que vous définissiez une valeur display qui renvoie le texte, ou passiez à between_tools. C'est le mode de défaillance le plus susceptible d'atteindre la production, car rien dans une suite de tests ne lève d'exception.

Encore une, pour être complet : définir temperature, top_p ou top_k à toute valeur autre que la valeur par défaut renvoie une erreur 400. Si votre passerelle ou votre bibliothèque cliente définit une temperature par habitude plutôt que par intention, cette habitude est désormais une panne.

L'affirmation des 30 %, face au chiffre indépendant

Artificial Analysis model page for Claude Sonnet 5.5 (adaptive reasoning, max effort, default fallback), released September 2026, showing an Intelligence Index of 56 at rank 3 of 216 models, pricing of $2.00 per million input tokens and $10.00 per million output tokens, an average cost of $7.60 per Intelligence Index task, a measured output speed of 142 tokens per second, 410M output tokens generated during the Index evaluation against a median of 88M, and a 1M-token context window.

L’argument marketing d’Anthropic pour Claude Sonnet 5.5 est qu’il « coûte jusqu’à 30 % de moins par tâche que son prédécesseur », à tarifs par token identiques, et qu’il « génère des sorties au moins 30 % plus vite » que Claude Sonnet 5. Ces deux affirmations portent sur des tokens plutôt que sur des prix, et toutes deux sont rapportées par le fournisseur. Le mécanisme derrière la première est visible dans le tableau de benchmarks du fournisseur lui-même : à effort moyen sur Terminal-Bench, Anthropic affirme que Claude Sonnet 5.5 dépasse le meilleur score de Claude Sonnet 5 pour « moins d’un dixième du coût par tâche », et formule des affirmations similaires pour CursorBench à effort faible et AA-Briefcase à effort moyen.

Le tableau indépendant s'accorde sur la direction et diverge sur l'ampleur. Dans l'Intelligence Index v4.3.2 d'Artificial Analysis — dix évaluations, exécutées dans une configuration unique pour tous les modèles — Claude Sonnet 5.5 obtient 56, ce que la page classe à la 3e place sur 216. Claude Sonnet 5 obtient 38 sur le même classement. C'est un écart de 18 points entre deux modèles consécutifs de la même gamme au même prix, et c'est le plus grand écart qu'Anthropic ait creusé au sein de la gamme Sonnet cette année.

Le chiffre de coût est là où l’affirmation du fournisseur devient plus difficile à soutenir. Artificial Analysis mesure Claude Sonnet 5.5 à $7.60 par tâche terminée de l’Intelligence Index. Ce chiffre n’est inférieur de 30 % à quoi que ce soit dans sa catégorie, car le modèle est extrêmement verbeux : il a émis 410 millions de tokens de sortie pour terminer les évaluations de l’Index, contre une médiane de 88 millions pour les modèles comparables. L’efficacité par token et l’efficacité par tâche sont deux grandeurs différentes, et Claude Sonnet 5.5 est exceptionnellement bon pour la première et seulement dans la moyenne pour la seconde.

Tous les propres chiffres de référence d’Anthropic pour cette version sont rapportés par le fournisseur et non reproduits par des tiers, et deux d’entre eux comportent des notes de bas de page qui méritent d’être répétées : les chiffres de GDPval-AA v2.1 et d’AA-Briefcase v1.1 ont été produits par Artificial Analysis sur un déploiement de pré-version qui présentait un bug susceptible de sous-estimer les scores, et la note d’Anthropic sur son chiffre FrontierCode 1.1 explique pourquoi Claude Sonnet 5.5 obtient un score inférieur à Max effort qu’à Xhigh dans cette évaluation. Un tableau où un modèle bat son propre score avec un réglage d’effort inférieur est un tableau qui vous dit que sa configuration de benchmark n’est pas figée.

Comment le tester sans miser un chemin de production dessus ?

Il existe une raison bien précise pour exécuter Claude Sonnet 5.5 via un routeur plutôt que directement sur le point de terminaison du fournisseur lors d'une migration : vous n'avez pas à choisir entre l'ancien modèle et le nouveau le temps de vous faire une idée. Sur OrcaRouter, Claude Sonnet 5 est routable depuis le 30 juin, au tarif d'Anthropic de 2 $ / 10 $ sans aucune majoration ajoutée, l'un des plus de 200 modèles derrière un seul point de terminaison compatible OpenAI, et c'est toujours le modèle sur lequel passe la majorité du trafic de l'API Claude. Claude Sonnet 5.5 n'est pas encore dans notre catalogue, la voie pour y accéder aujourd'hui est donc l'API d'Anthropic elle-même.

Le schéma qui fonctionne en attendant consiste à envoyer une tranche de trafic vers le nouveau modèle et à laisser le basculement prendre en charge le reste — avec Claude Sonnet 5 comme solution de repli, de sorte qu'un 400 provenant de l'une des cinq ruptures de compatibilité se dégrade en une réponse plus lente plutôt qu'en une requête échouée. C'est aussi le moyen le moins coûteux de mesurer ce que l'allégation du fournisseur ne vous dit pas : vos propres jetons par tâche sur les deux modèles au même réglage d'effort. Le chiffre de 30 % est une moyenne sur les propres évaluations d'Anthropic ; votre trafic n'est pas cette moyenne.

Qu'est-ce qui arrive ensuite

L'annonce d'Anthropic indique que Claude Haiku 5.5 rejoint la famille « dans les semaines à venir », ce qui compléterait la génération 5.5 dans le segment des petits modèles. D'ici là, les deux décisions qui se présentent à une équipe exploitant Sonnet en production sont dissociables : la migration est un travail d'une journée que vous pouvez planifier, et le changement de modèle est une mesure que vous pouvez reporter. Les faire dans l'autre ordre — changer d'abord et découvrir l'erreur d'utilisation forcée des outils en production — est la version de ce déploiement qui coûte un week-end.

Single-column scoreboard for Claude Sonnet 5.5 with six rows: Released September 28 2026, Model ID claude-sonnet-5-5, Price $2.00 / $10.00 per 1M, Intelligence Index 56 at rank 3 of 216, Cost per Index task $7.60, and Output speed 142 tokens/sec, with a footer reading 'Index, cost per task and speed per Artificial Analysis v4.3.2; pricing and lifecycle per Anthropic.'