
Claude Sonnet 5.5 : Une fuite de test furtif construite à partir de quatre nombres qui existent déjà
- typesafeNOUVEAUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 par million de tokens · 36 tok/s
- openaiNOUVEAUOpenAI: GPT-6 Luna2026-09-2237Intelligence
- openaiNOUVEAUOpenAI: GPT-6 Sol2026-09-2248Intelligence
- anthropicNOUVEAUAnthropic: Claude Opus 5.52026-09-2258Intelligence
- grokNOUVEAUGrok 4.72026-09-2146Intelligence
- OrcaNOUVEAUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 par million de tokens · 181 tok/s
- orcaNOUVEAUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens · 1277 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligence69Code
- grokSpaceXAI: Grok 4.62026-08-1244Intelligence77Code
- metaMeta: Muse Spark 1.22026-08-0540Intelligence72Code
Quatre chiffres ont été publiés sur X le 24 septembre comme preuve que Claude Sonnet 5.5 est « déjà en cours de test furtif » : une fenêtre de contexte d’1 M de tokens, une sortie maximale de 128 K tokens, 2 $ par million de tokens d’entrée et 10 $ par million de tokens de sortie. Tous les quatre figurent dès maintenant sur la propre grille tarifaire d’Anthropic, rattachés à Claude Sonnet 5 — le modèle qu’une version 5.5 remplacerait, en disponibilité générale depuis le 30 juin 2026. Le même tarif affiché de 2 $ / 10 $ appartient aussi à GPT-6 Sol, qu’OpenAI a lancé le 22 septembre, et c’est ce recoupement qui fait lire la publication comme une réponse à OpenAI plutôt qu’un simple renouvellement de gamme : « Pour moi, cela ressemble à une réponse directe à GPT-6-Sol. Même tarification et vraisemblablement une p[erformance] similaire. »
Rien de tout cela ne rend l’affirmation fausse. Cela la rend infalsifiable, ce qui est un problème différent, et plus utile à consigner par écrit. Une observation de test furtif ne vaut que par l’artefact qui la sous-tend, et l’artefact derrière celle-ci est une fiche technique impossible à distinguer du modèle qu’Anthropic sert depuis douze semaines.
Qu’est-ce qui a été effectivement publié ?
La source est une seule publication X du compte @kimmonismus, datée du 24 septembre 2026. Elle y indique la fenêtre de contexte, le plafond de sortie et les deux prix, compare la tarification à GPT-6 Sol et conclut que Sonnet 5.5 est en test. Il n’y a ni capture d’écran, ni chaîne de modèle, ni réponse API, ni listing console, ni description du comportement par des testeurs, et aucun second observateur n’y est associé. La publication est une affirmation contenant des chiffres, et ces chiffres sont les limites publiques du palier.
Cela vaut la peine de le distinguer de l'autre type d'article sur les préversions d'Anthropic, car 2026 a produit les deux et ils ne se ressemblent en rien. Les identifiants d'accès anticipé d'août claude-marshmallow-eap et claude-melon-eap étaient des chaînes qui existaient dans des requêtes — laides, sans éclat et vérifiables. L'histoire d'Opus 5.2 qui court tout au long de septembre est un rapport de routage : des développeurs remarquant que le backend derrière l'étiquette « Opus 5 » répondait différemment, et décrivant le comportement. Les deux sont des artefacts. « Déjà en cours de test furtif » sans artefact joint est un résumé de ce que le palier Sonnet vend déjà.
Il y a aussi un schéma à relever dans la source elle-même. Le même compte a publié le 20 septembre un récapitulatif qui s'ouvrait sur quatre modèles dont il disait qu'ils « faisaient déjà l'objet de tests » — Claude Sonnet 5.2, Claude Opus 5.2, Claude Fable 5.2 et Gemini 4 Pro. Parmi ces quatre noms, les entrées Opus et Fable s'appuient sur des informations distinctes et corroborées, et l'entrée Gemini a ses propres signalements. L'entrée Sonnet occupait une position dans une liste. Quatre jours plus tard, l'affirmation sur Sonnet s'est dotée d'une fiche technique, et cette fiche technique correspond au modèle qui existe déjà.
Les quatre nombres sont ceux de Claude Sonnet 5.
C'est la partie qui prend trente secondes à vérifier et que presque personne n'a vérifiée. La page de présentation des modèles d'Anthropic, consultée aujourd'hui, indique Claude Sonnet 5 avec une fenêtre de contexte de 1 M de tokens, une sortie maximale de 128 K et 2 $ / 10 $ par million de tokens. Comparez la fuite à cela :
• Fenêtre de contexte — 1 M de tokens annoncés pour Claude Sonnet 5.5 ; 1 M de tokens publiés pour Claude Sonnet 5
• Sortie maximale — 128K tokens revendiqués ; 128K tokens publiés
• Prix d'entrée — 2 $ par million déclaré ; 2 $ par million publié
• Prix de sortie — 10 $ par million déclaré ; 10 $ par million publié
• ID de modèle — rien de publié pour Claude Sonnet 5.5 ; claude-sonnet-5 pour Claude Sonnet 5
• Scores indépendants — aucun pour le modèle revendiqué ; Artificial Analysis place Claude Sonnet 5 à un Intelligence Index de 38, au rang 54 des 210 modèles qu’il mesure, en configuration raisonnement adaptatif, effort maximal

Il y a une deuxième couche à l’argument tarifaire que la fuite inverse. Lors du lancement de Claude Sonnet 5, un tarif de 2 $ / 10 $ a été annoncé comme tarif introductif en vigueur jusqu’au 31 août 2026, avec un passage programmé à 3 $ / 15 $ le 1er septembre. Ce passage n’a pas eu lieu. La page de tarification d’Anthropic comporte désormais une note de bas de page indiquant que 2 $ / 10 $ « est désormais le prix standard » et que « l’augmentation précédemment programmée à 3 $ / 15 $ par million de tokens d’entrée/sortie le 1er septembre 2026 n’aura pas lieu ». Ainsi, le prix que la fuite présente comme l’arme concurrentielle du nouveau modèle est le tarif permanent de l’offre en place — ce qui signifie qu’un Sonnet 5.5 lancé à 2 $ / 10 $ serait lancé sans aucune remise, dans une gamme déjà tarifée face à GPT-6 Sol.
La seule chose qu’Anthropic a réellement dite
Supprimez tout ce qui provient de fuiteurs non nommés, et une seule phrase de première main subsiste. Lorsqu’Anthropic a lancé Claude Opus 5.5 le 22 septembre 2026, l’entreprise a déclaré que Claude Sonnet 5.5 et Claude Haiku 5.5 suivraient « dans les prochaines semaines », apportant des gains comparables en performance, efficacité et sécurité. Cette phrase constitue l’intégralité du dossier confirmé. Elle ne comporte aucun identifiant de modèle, aucune fenêtre de contexte, aucun prix, aucun benchmark et aucune date — et en particulier, elle ne dit rien à propos d’un test furtif, d’une voie grise ou de quelque test que ce soit.
Le reste de la surface publique d'Anthropic confirme cette lecture. L'aperçu des modèles liste toujours quatre modèles — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5 et Claude Haiku 4.5 — sans cinquième ligne, sans entrée tarifaire et sans mention « à venir » pour un successeur de Sonnet. Si un checkpoint de niveau Sonnet était servi quelque part où un développeur pouvait y accéder, l'identifiant serait la première chose à faire surface, car un modèle servi doit avoir un nom dans une requête. Rien de tel n'est apparu.
Une chose que l'annonce de septembre a tranchée : elle contredisait la fuite antérieure affirmant que la gamme Haiku serait retirée et que la génération 5.5 restructurerait la gamme. Haiku 5.5 arrive, selon Anthropic, ce qui signifie que l'histoire de restructuration était fausse dans un sens où les leakers se trompent rarement — le segment bon marché reste.
La fuite d'août annonçait 2 millions de tokens. Celle-ci en annonce 1 million.
Six semaines avant la publication du 24 septembre, le 9 août, un autre compte X a publié une fiche technique « SONNET 5.5 LEAK » avec une affirmation bien plus audacieuse : une fenêtre de contexte de 2 millions de jetons, le double de celle de Sonnet 5, une inférence plus rapide, une meilleure utilisation des outils de navigateur et de terminal, des performances proches de Claude Fable 5, et une sortie « le mois prochain ». Cette fuite était accompagnée d’un graphique stylisé pour ressembler à une carte d’aperçu d’Anthropic. Elle comportait aussi un détail fatal sur lequel ses critiques se sont immédiatement focalisés : le nom de code qu’elle donnait, « Fennec », était celui déjà livré avec Claude Sonnet 5 le 30 juin. Un nom de code ne peut pas constituer une preuve récente de l’existence d’un successeur du modèle qui l’a utilisé.
Donc les deux vagues de fuites ne sont pas d’accord sur le nombre le plus cité. Août annonçait 2 M de contexte. Septembre dit 1 M. Les deux ne peuvent pas décrire la même version. L’interprétation la plus probable est la plus banale : le billet de septembre décrit les limites publiées du palier Sonnet, parce que c’est à cela que ressemble un modèle de ce palier vu de l’extérieur, et le billet d’août était une supposition sur ce qu’un rafraîchissement doublerait plausiblement. Notez dans quelle direction le chiffre a bougé — vers le bas, vers ce qui existe déjà.
Donc, la comparaison avec GPT-6 Sol est-elle correcte ?
En grande partie, et l’endroit où ça dérape est la partie intéressante. GPT-6 Sol est sorti le 22 septembre 2026, le même jour que Claude Opus 5.5, et son prix catalogue commence à 2 $ par million de tokens en entrée et 10 $ par million de tokens en sortie — exactement le tarif de Sonnet 5 et exactement ce que la fuite annonce pour Sonnet 5.5. Il propose une fenêtre de contexte de 1 050 000 tokens avec un plafond de sortie de 128 K, tous deux à un cheveu des chiffres de Claude Sonnet 5. Le petit frère moins cher, GPT-6 Luna, se situe à 0,10 $ / 0,50 $.
La rupture, c'est le contexte long. GPT-6 Sol facture selon deux paliers : 2 $ / 10 $ jusqu'à 272 000 jetons d'entrée, puis 4 $ / 15 $ au-delà. Anthropic ne procède pas ainsi sur la gamme Sonnet — Claude Sonnet 5 facture l'intégralité de la fenêtre de 1 M aux tarifs standard, si bien qu'une requête de 900 K jetons coûte autant par jeton qu'une requête de 9 K. Un vrai Sonnet 5.5 face à un vrai GPT-6 Sol, c'est donc une égalité tarifaire pour les prompts ordinaires et un écart d'un facteur deux pour les charges de travail sur documents longs et gros dépôts que les deux modèles mettent en avant. « Même tarification » est vrai dans le message d'accroche et faux pour les charges de travail où le palier entre en jeu.
Une seconde mise en garde sous-tend toute la comparaison. Claude Sonnet 5 utilise le tokenizer plus récent d’Anthropic, qui produit environ 30 % de tokens en plus pour un même texte que le précédent. Un tarif affiché n’est pas une facture ; la facture, ce sont les tokens par tâche, et c’est le chiffre qu’aucune fuite n’a jamais communiqué.
Qu'est-ce qui donnerait de l'importance à un Sonnet 5.5 ?
Mettons de côté la question de savoir s’il existe et demandons-nous ce qui changerait pour quelqu’un qui paie des jetons. Quatre choses, et aucune n’est une fiche technique.
Le premier est un prix inférieur à 2 $ / 10 $. L’augmentation du 1er septembre étant annulée, le tarif du modèle en place est désormais permanent — un successeur qui conserve le même tarif constitue donc un simple statu quo, et la seule nouvelle de niveau Sonnet qui fait bouger l’argent est une baisse.
Le second, c'est le contexte au-delà de 1M. C'était la véritable proposition de la fuite d'août, et c'est la seule lacune de capacités que la fuite peut nommer que l'acteur en place ne couvre pas déjà.
Le troisième est le nombre de tokens par tâche. La réflexion adaptative de Claude Sonnet 5 est activée par défaut, et une analyse indépendante a mesuré qu'il génère sensiblement plus de tokens de sortie par tâche que son prédécesseur. Une version qui conserverait le tarif de 2 $ / 10 $ et mettrait fin à cette inflation réduirait davantage les factures réelles qu'une baisse de prix affichée.
Le quatrième est un identifiant. Une chaîne de modèle d’API, une ligne de documentation, une entrée tarifaire, une fiche de modèle — l’un de ces éléments clôt le débat, et l’absence des quatre après une fuite aussi explicite est en soi le fait le plus révélateur de cette histoire.
Ce que vous pouvez appeler aujourd'hui.
Claude Sonnet 5 n'est pas un modèle provisoire le temps que le palier se clarifie. C'est le modèle sur lequel tourne déjà l'essentiel du trafic de l'API Claude, avec une fenêtre de 1 M de tokens, une sortie de 128 K et un tarif de 2 $ / 10 $ désormais standard plutôt que promotionnel.

Il est présent sur OrcaRouter depuis juin, aux propres tarifs d'Anthropic de 2 $ / 10 $, répercutés au prix catalogue du fournisseur, sans marge, de sorte qu'un changement de tarif du fournisseur sur la gamme Sonnet serait effectif ici le jour même plutôt qu'au cycle de facturation suivant. La même clé donne déjà accès à GPT-6 Sol à 2 $ / 10 $, ce qui compte plus que d'ordinaire dans un article comme celui-ci : la comparaison sur laquelle s'appuie la fuite est une comparaison que vous pouvez mener vous-même avec un seul identifiant plutôt que deux contrats.

C'est aussi la façon la moins coûteuse de répondre à la question que soulève la fuite. Si un Sonnet 5.5 finit par apparaître, il arrive dans le catalogue comme tout le reste, et vous dirigez une fraction du trafic vers lui avec un basculement automatique vers Claude Sonnet 5 — pas de seconde intégration, pas de renégociation, et aucun chemin de production ne repose sur un modèle que personne n'a évalué indépendamment. Essayer un niveau non éprouvé est une décision de routage, pas un projet de migration.
Quoi regarder au lieu du prochain post de fuite
Trois signaux, par ordre décroissant de ce qu’ils vous apprendraient. Un identifiant est décisif, car un modèle servi doit avoir un nom dans une requête, et c’est ainsi que toute histoire vérifiable de pré-lancement d’Anthropic en 2026 est devenue vérifiable. Une confirmation du fournisseur — une fiche de modèle, une ligne de documentation, une ligne tarifaire, ou le simple fait que le modèle apparaisse dans la propre liste d’Anthropic — y met fin définitivement ; la phrase « dans les semaines à venir » signifie que l’un de ces éléments est bel et bien dû. Un rapport de testeur décrivant un comportement plutôt que des spécifications est le plus faible des trois, et c’est encore plus que ce qui existe aujourd’hui.
Jusqu'à ce que l'un de ceux-là se concrétise, le résumé honnête est qu'Anthropic a promis une mise à jour de Sonnet dans les semaines à venir et qu'un observateur l'a décrite en utilisant les chiffres du modèle qu'elle remplacera. Si votre stack exécute déjà claude-sonnet-5, il n'y a rien à attendre et rien à anticiper. Si vous comparez Claude Sonnet 5 à GPT-6 Sol, les chiffres sur lesquels vous pouvez vous appuyer sont ceux déjà publiés — et ce sont les mêmes chiffres que la fuite essaie de vous vendre comme une nouveauté.
Comparés dans cet article2
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
