
Claude Sonnet 5.5 : Le choix par défaut de milieu de gamme, entièrement spécifié
- openaiNOUVEAUOpenAI: GPT-6.1 Sol2026-09-2952Intelligence
- anthropicNOUVEAUAnthropic: Claude Sonnet 5.52026-09-2856Intelligence
- typesafeNOUVEAUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 par million de tokens · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligence
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligence
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligence
- xAIGrok 4.72026-09-2146Intelligence
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 par million de tokens · 64 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 par million de tokens · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
Claude Sonnet 5.5 est le modèle de milieu de gamme de la famille Claude, sorti le 28 septembre 2026, et le tarif est à lui seul la raison pour laquelle il mérite une page : 2 $ par million de jetons d'entrée et 10 $ par million de jetons de sortie, contre 4 $ et 20 $ pour Claude Opus 5.5, le modèle phare lancé six jours plus tôt. C'est la moitié du prix de sortie pour 1,62 point de l'Artificial Analysis Intelligence Index — 56,00 pour le milieu de gamme contre 57,62 pour le modèle phare, deux chiffres mesurés par Artificial Analysis sur la révision v4.3.2 de l'indice, et non par nous ni par le fournisseur. Au-dessus des deux se trouve Claude Fable 5.1, à 10 $ / 50 $ et 53,35 sur la même révision : plus cher que le modèle phare, et derrière lui. Au même prix catalogue de 2 $ / 10 $ que Claude Sonnet 5.5 se trouve le GPT-6.1 Sol d'OpenAI, à 51,83 — 417 centièmes d'indice de l'autre côté de la ligne, ce qui est la comparaison qu'un lecteur qui soupèse le milieu de gamme doit réellement faire.
Cette page est une référence, et ce sont les dates qui en indiquent la raison, non la fraîcheur. Claude Sonnet 5.5 a dix jours au 2026-10-08, ce qui le place hors de la fenêtre de sept jours dans laquelle ce blog rapporte l’actualité. Ce qui se trouve dans cette fenêtre, c’est un événement vieux de six jours : deux publications sur X datées du 2026-10-02, affirmant qu’un modèle successeur de cette famille surpasse un rival que son propre fournisseur a achevé et retenu. Cette affirmation n’a, dans aucun registre accessible d’ici, ni identifiant de modèle, ni grille tarifaire, ni fenêtre de contexte, ni benchmark pour l’étayer, et elle ne constitue pas le sujet de cette page — la chaîne des sources, la vérification d’absence sur les surfaces du fournisseur et l’écart de l’indice à cinq modèles sont intégralement traités par l’article que ce blog a déjà publié sous le titre « Claude Fable 5.5 a battu GPT-6.1 Astra avant même qu’il n’existe — et c’est là que ça devient intéressant », daté du 2026-10-03. Ce que cette affirmation a bel et bien produit, c’est une file de lecteurs demandant quel modèle Claude commercialisé adopter comme standard en attendant, et cette question nécessite une page sur le modèle qui existe. C’est celle-ci.
Qu’est-ce qui est sorti le 28 septembre 2026 ?
La documentation du fournisseur donne directement la spécification, et il s'agit d'un prolongement du palier plutôt que d'une nouvelle forme. Tout ce qui suit a été lu dans la documentation de la Claude Platform d'Anthropic le 2026-10-08 ; il s'agit donc de la spécification d'Anthropic, et non d'un test indépendant de celle-ci.
• Publié — 28 septembre 2026. La page de documentation propre au modèle s'ouvre sur la ligne « Latest. Released September 28, 2026. »
• Positionnement — « La meilleure combinaison de vitesse et d'intelligence », avec une latence comparative indiquée comme Rapide, contre Modérée pour Claude Opus 5.5, Plus lente pour Claude Fable 5.1 et La plus rapide pour la petite gamme.
• ID de modèle — claude-sonnet-5-5 sur l'API Claude, Google Cloud, Microsoft Foundry et Claude Platform sur AWS ; anthropic.claude-sonnet-5-5 sur Amazon Bedrock. Chaque ID de modèle Claude est un instantané figé, de sorte que la chaîne n'est pas un pointeur susceptible de dériver sous vos pieds.
• Contexte et sortie — 1 000 000 de tokens de contexte et 128 000 tokens de sortie synchrone sur l'API Messages, jusqu'à 300 000 derrière l'en-tête bêtaoutput-300k-2026-03-24 sur l'API Message Batches.
• Réflexion — adaptative, toujours activée par défaut, avec un effort par défaut de high. Le réglage le plus bas est between_tools, qui désactive la réflexion initiale et est accepté à un effort high ou inférieur. Définir temperature, top_p ou top_k sur autre chose que sa valeur par défaut renvoie une erreur 400, de sorte qu'une requête migrée depuis un ancien modèle Claude avec une température ajustée échouera bruyamment plutôt que silencieusement.
• Date limite des connaissances — juin 2026, à la fois pour la limite fiable et pour celle des données d'entraînement.
• Cycle de vie — Actif (version la plus récente), avec un engagement de retrait au plus tôt le 28 septembre 2027 sur les plateformes exploitées par Anthropic. Amazon Bedrock et Google Cloud fixent leurs propres dates.
Le cadrage de lancement du fournisseur mérite d'être cité, car il s'agit d'une affirmation et non d'une mesure : l'annonce d'Anthropic décrit Claude Sonnet 5.5 comme « une nette amélioration par rapport à Sonnet 5, qui s'exécute 30 % plus rapidement et coûte jusqu'à 30 % de moins pour la plupart des tâches ». Cette phrase est celle du fournisseur, non reproduite par nous, et c'est le genre d'affirmation qui dépend entièrement du travail qu'on lui soumet. Il y a aussi un coût de migration associé à cette version, dont cette page n'est pas le lieu : cinq changements majeurs affectent le code déjà en cours d'exécution sur Claude Sonnet 5, et un sixième modifie la forme de la réponse sans faire échouer aucune requête. Cette comptabilité appartient à l'article de déploiement que ce blog a publié dans la semaine de la sortie, et c'est la première chose à lire si vous avez Sonnet 5 en production aujourd'hui.

Les 1,62 points, et le demi-tarif
Les scores indépendants pour ce modèle proviennent d'un seul endroit, et ils portent un chiffre qui tranche le débat. Artificial Analysis mesure Claude Sonnet 5.5 à 56,00 sur son Intelligence Index, révision v4.3.2, dans la configuration que la page nomme « Claude Sonnet 5.5 (Max, Default Fallback) ». Nous avons consulté cette page le 8 octobre 2026. Sur la même révision, le même jour :
• Claude Opus 5.5 — 57,62, publié le 2026-09-22, 4 $ / 20 $
• Claude Sonnet 5.5 — 56,00, sorti le 2026-09-28, 2 $ / 10 $
• Claude Fable 5.1 — 53,35, publié le 2026-09-01, 10 $ / 50 $
• GPT-6 Astra — 52,67, publié le 3 septembre 2026, 10 $ / 50 $, avec un palier de contexte long au-delà de 272 000 jetons d’invite à 20 $ / 75 $
• GPT-6.1 Sol — 51,83, publié le 2026-09-29, 2 $ / 10 $
Préciser de quelle révision il s'agit importe, car un score issu d'une version de l'indice n'est pas comparable à un score issu d'une autre : v4.3.2 intègre dix évaluations — AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience et AA-LCR v1.1 — et la composition de cet ensemble a changé au fil des révisions. Les cinq chiffres ci-dessus proviennent tous de la même révision, ce qui explique pourquoi ils peuvent être comparés entre eux, et pourquoi aucun d'entre eux ne peut être comparé à un nombre cité d'une version antérieure.
Le comparatif de prix est l'élément qui détermine le comportement. Le tarif de sortie de Claude Sonnet 5.5 représente la moitié de celui de Claude Opus 5.5, et son tarif d'entrée est lui aussi réduit de moitié ; sur la grille tarifaire officielle du fournisseur, la gamme intermédiaire coûte 2 $ / 10 $ là où le modèle phare coûte 4 $ / 20 $. Croisez les deux chiffres publiés et le rapport saute aux yeux : par dollar de tarif de sortie catalogue, Claude Sonnet 5.5 totalise 5,60 points d'indice et Claude Opus 5.5 en totalise 2,88 — près de deux fois plus d'indice par dollar de sortie, selon la grille tarifaire d'Anthropic elle-même et la mesure d'Artificial Analysis elle-même. Il s'agit là d'arithmétique sur deux chiffres publiés, et non de la mesure de quoi que ce soit, et c'est la forme honnête de l'argument en faveur de la gamme intermédiaire. Ce n'est pas non plus un verdict : un point d'indice n'est pas une unité d'exactitude, et tout le reste de cette page vise à montrer de quoi le 1,62 est fait — et de quoi il n'est pas fait.

La grille tarifaire, et les deux lignes qui varient le plus
Liste de prix complète d'Anthropic, consultée le 2026-10-08. Tous les chiffres de cette section proviennent du fournisseur.
• Entrée — 2,00 $ par million de tokens. Sortie — 10,00 $ par million, et les tokens de réflexion sont facturés comme des tokens de sortie, ce qui n'est pas désactivable ici car la réflexion adaptative est activée par défaut.
• Lecture du cache — 0,10 $ par million, ce qu'Anthropic documente comme 5 % du prix d'entrée de base. C'est la même remise proportionnelle que porte Claude Opus 5.5, donc la mise en cache ne change pas le classement entre les deux, et cela signifie bien qu'une longue exécution d'agent qui conserve un préfixe stable paie un dixième du tarif d'entrée sur tout ce qu'elle relit.
• Écriture de cache — 2,50 $ par million pour le cache de cinq minutes, 4,00 $ pour le cache d’une heure. La longueur minimale de prompt pouvant être mise en cache est de 512 jetons, donc les prompts courts ne peuvent pas du tout bénéficier de la réduction.
• Batch API — 50 % de réduction dans les deux sens, soit 1,00 $ en entrée et 5,00 $ en sortie pour les tâches qui peuvent attendre.
• Aucun supplément pour le contexte long — Anthropic facture l’intégralité de la fenêtre de 1 M de jetons au tarif standard par jeton sur ce modèle, donc une requête de 900 000 jetons coûte le même prix par jeton qu’une requête de 9 000 jetons. C’est une vraie différence avec GPT-6 Astra, dont le palier de contexte long au-delà de 272 000 jetons de prompt passe à 20 $ / 75 $ — cela vaut la peine d’être mentionné, car c’est le seul endroit où les chiffres phares des deux fournisseurs divergent nettement dès qu’un prompt s’allonge.
Deux lignes déterminent ensuite la plupart des factures, plutôt que le tarif affiché : la remise sur les lectures de cache tout au long d’une longue exécution d’agent, et la remise batch pour tout ce qui est asynchrone. Les $2 / $10 affichés sont ce que l’on compare sur un classement ; les lignes de cache et de batch sont ce sur quoi repose réellement une facture mensuelle.
Ce que l’écart signifie et ne signifie pas
L'Intelligence Index est un chiffre unique calculé sur un ensemble fixe de tâches, et cette seule caractéristique explique la majeure partie de la confusion qui l'entoure. Les dix évaluations derrière v4.3.2 comprennent le codage agentique et le travail sur terminal, le raisonnement scientifique de niveau master, un ensemble d'ingénierie logicielle, un ensemble d'automatisation agentique et un ensemble de récupération à contexte long, pondérés pour former un composite. Un modèle qui accuse 1,62 point de retard sur un autre accuse ce retard sur ce composite — et non sur votre charge de travail, qui peut pondérer ces dix évaluations dans une proportion complètement différente, et peut contenir des tâches qu'aucune d'entre elles ne représente.
Concrètement, cela signifie une séparation selon la forme du travail plutôt que selon le prestige du palier. Le sélecteur de modèle d’Anthropic lui-même opère explicitement cette distinction, et il vaut la peine de le lire parce qu’il ne flatte pas le palier intermédiaire : la documentation dit aux lecteurs de « commencer par Claude Opus 5.5 pour la plupart des charges de travail », et de se tourner vers Claude Fable 5.1 « pour le raisonnement exigeant et le travail agentique à long horizon, ou lorsque vos évaluations sur Claude Opus 5.5 à un effort plus élevé restent encore insuffisantes ». Claude Sonnet 5.5 n’est pas le modèle avec lequel cette phrase commence. C’est le modèle que la même documentation décrit comme la meilleure combinaison de vitesse et d’intelligence, avec la latence comparative la plus rapide en dehors du petit palier — ce qui est un argument différent, et plus étroit.
Donc, la lecture honnête est la suivante. Le milieu de gamme est généralement la bonne réponse pour un travail bien cadré et à volume : des fonctionnalités et des corrections de bugs sur une base de code connue, l'extraction et la classification avec un format de sortie défini, les boucles d'appel d'outils où la partie difficile est le harnais plutôt que le raisonnement, et tout ce où un premier token rapide et un faible coût par appel importent plus que les deux derniers pour cent de capacité. Le modèle phare mérite son tarif lorsque le travail est véritablement à long horizon — des exécutions d'agents de plusieurs heures, des refactorisations qui couvrent des fichiers que le prompt ne peut pas contenir en une fois, et des évaluations sur le milieu de gamme qui, de manière mesurable, sont insuffisantes à un effort plus élevé. Cette dernière condition est celle du fournisseur, et elle est testable : augmentez le niveau d'effort sur le milieu de gamme, exécutez votre propre évaluation, et voyez si cela comble l'écart. Si c'est le cas, le 1,62 n'était pas indispensable pour vous. Si ce n'est pas le cas, vous avez acheté votre réponse avec vos propres chiffres plutôt qu'avec le composite de quelqu'un d'autre.
Ce que l’écart ne signifie pas, c’est que 1,62 point n’est rien. C’est toute la marge entre deux modèles et, sur un harnais fixe avec une évaluation dans des conditions identiques, c’est un classement réel. Il s’agit simplement du classement d’un mélange de tâches spécifique, à effort maximal avec repli par défaut, et cela ne dit rien sur lequel des deux est le meilleur achat pour une charge de travail sur laquelle ni l’un ni l’autre n’a été benchmarké.
Le piège du nom : de quelle page de Claude Sonnet 5.5 il s'agit
Un lecteur qui recherche le nom de ce modèle tombe sur plusieurs pages de ce blog qui ressemblent à celle-ci, mais qui n'en sont pas. Celle datée du 2026-09-24 est la page d'anticipation : elle a été écrite avant la sortie du modèle, et son sujet était un unique post sur X revendiquant un test furtif, reconstruit à partir des chiffres du modèle qu'il remplacerait. Celle publiée pendant la semaine de sortie est l'article de déploiement : son sujet est les cinq changements majeurs qui affectent le code déjà exécuté sur Claude Sonnet 5, plus le sixième changement qui modifie la forme de la réponse sans générer d'erreur. Il y a aussi un éventail de pages de confrontation portant le nom de ce modèle face aux modèles d'autres fournisseurs, et une page appliquée sur ce que couvre la promotion de la sortie.
Aucune d'entre elles n'est la page du modèle, et c'est le vide que ce texte comble. Cette page est la référence que le lecteur atteint après avoir recherché le nom même du modèle : ce qu'il est, ce qu'il coûte, ce qu'il mesure, et à quels travaux il appartient. Les détails de migration de la page de déploiement et la critique des sources de la page d'anticipation restent là où ils sont ; si vous avez du code Sonnet 5 en production, la page de déploiement est votre premier clic, et cette page est ce qui vous dit si le modèle vers lequel vous migrez est celui que vous voulez.
Une habitude de nommage mérite d’être corrigée pendant que nous y sommes, car elle induit en erreur à elle seule. Un suffixe 5.5 indique une génération, pas un rang. Claude Sonnet 5.5 et Claude Opus 5.5 appartiennent à la même génération de la même famille, et le nombre avant le point correspond au niveau. Rien dans le suffixe ne vous dit lequel l’emporte sur un benchmark.
Disponibilité, datée
Claude Sonnet 5.5 est présent sur OrcaRouter depuis sa sortie, sous anthropic/claude-sonnet-5.5, au prix catalogue propre à Anthropic, sans majoration ajoutée : 2,00 $ en entrée et 10,00 $ en sortie par million de tokens, les deux chiffres étant relevés depuis notre propre point de terminaison de modèle le 2026-10-08 et correspondant ligne pour ligne à la grille tarifaire du fournisseur. Notre page dédiée indique la même fenêtre de contexte de 1 M de tokens et une sortie maximale de 128 K, répertorie texte, image et fichier comme types d’entrée acceptés et le texte comme seule sortie, indique qu’il est sorti le 2026-09-28 et non obsolète, et montre qu’il est accessible à la fois via le point de terminaison chat-completions compatible OpenAI et via le point de terminaison messages propre à Anthropic — ce qui en fait un changement transparent pour une intégration qui parle déjà l’un ou l’autre.
Tout le reste du même catalogue est accessible depuis la même clé : une seule API pour plus de 200 modèles, avec le prix catalogue du fournisseur répercuté à 0 % de marge afin qu'une baisse de prix d'un fournisseur parvienne à un client le jour même de son annonce, un basculement automatique lorsqu'un point de terminaison se dégrade, et un DSL de routage pour les cas où vous voulez épingler un modèle ou en composer plusieurs en une seule réponse. C'est cette combinaison qui fait que la question posée sur cette page est peu coûteuse à trancher plutôt qu'onéreuse. Les deux modèles de la comparaison ci-dessus sont derrière la même clé d'authentification, si bien que le prix auquel vous vous comparez est celui publié par le fournisseur lui-même et non celui d'un revendeur, et le test de version coûte une exécution d'évaluation plutôt qu'un projet de migration : dirigez une partie du trafic vers anthropic/claude-sonnet-5.5, gardez le reste sur le modèle phare, et laissez vos propres chiffres de coût par tâche accomplie décider lequel doit être la valeur par défaut.

La version courte
Claude Sonnet 5.5 est un modèle de milieu de gamme aux chiffres proches de ceux du modèle phare et à la moitié de son prix de sortie, et les trois faits qui déterminent s'il doit être votre choix par défaut sont les suivants. Il se situe à 1,62 point derrière Claude Opus 5.5 sur l'indice v4.3.2 d'Artificial Analysis, à 56,00 contre 57,62, les deux chiffres étant mesurés sur la même révision et dans la même configuration d'effort maximal avec repli par défaut. Il coûte 2 $ / 10 $ contre 4 $ / 20 $ pour le modèle phare, les remises sur le cache et sur le traitement par lots étant proportionnelles plutôt que différentes, de sorte que l'écart de prix survive à toutes les remises offertes par l'un ou l'autre modèle. Et il utilise par défaut l'effort élevé là où le modèle phare utilise par défaut l'effort moyen, ce qui signifie qu'un réglage repris du modèle phare s'exécute un niveau plus haut ici plutôt que plus bas, et c'est à vous d'en mesurer le coût plutôt que de le supposer.
Le sélecteur d'Anthropic lui-même commence encore par Claude Opus 5.5 pour la plupart des charges de travail, et cela vaut la peine de le savoir avant de vous standardiser sur quoi que ce soit. Mais pour la plupart des lecteurs qui arrivent sur cette page en recherchant le nom de ce modèle, le milieu de gamme est la valeur par défaut raisonnable et le modèle phare est l'exception que vous achetez lorsque vos propres évaluations l'exigent — du travail bien délimité en volume, une faible latence, une fenêtre d'un million de tokens sans surcoût de contexte long, et un tarif qui divise par deux la ligne de sortie. Les deux sont à une clé d'écart sur OrcaRouter, et l'évaluation qui permet de choisir entre eux coûte un après-midi plutôt qu'une migration.
Comparés dans cet article4
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
