
Claude Sonnet 5.2 : une entrée de liste, zéro identifiant — ce que l'on sait réellement
- OrcaNOUVEAUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 par million de tokens
- orcaNOUVEAUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens
- deepseekNOUVEAUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligence69Code
- grokSpaceXAI: Grok 4.62026-08-1244Intelligence77Code
- metaMeta: Muse Spark 1.22026-08-0540Intelligence72Code
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligence76Code
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligence69Code
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 par million de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Claude Sonnet 5.2 est arrivé sur internet comme premier élément d'une liste. Le 20 septembre, le compte X @kimmonismus a publié un récapitulatif qui commençait par les modèles qu'il disait être « déjà en cours de test » — Claude Sonnet 5.2, Claude Opus 5.2, Claude Fable 5.2 et Gemini 4 Pro — puis passait aux sorties qu'il attendait ensuite. Tout ce qui vient après ce premier nom a quelque chose pour l'étayer. Claude Opus 5.2 a une semaine de reportages sur un canal de routage silencieux dans Claude Code. Claude Fable 5.2 a son propre fil de fuites. Gemini 4 Pro a des observations distinctes. Claude Sonnet 5.2 a une position dans une liste. C'est tout ce qui existe publiquement ce matin : un tweet, un titre sur un agrégateur à faible vérification, et aucun identifiant, prix, fenêtre de contexte ou benchmark nulle part. Claude Sonnet 5 — le modèle qu'une version 5.2 remplacerait — est disponible en général depuis le 30 juin à 2 $ par million de jetons d'entrée et 10 $ par million de jetons de sortie, et est le modèle par défaut sur chaque niveau d'abonnement Claude.
Cette asymétrie est l’histoire qui vaut la peine d’être consignée, car c’est ce qui se perd lorsqu’un tweet de récapitulation est lu comme un événement d’actualité. Un nom de modèle apparaissant dans une liste ne constitue pas le même type d’affirmation qu’un nom de modèle apparaissant à côté d’un identifiant de modèle, et la différence, c’est toute la différence entre « une mise à jour de Sonnet arrive » et « quelqu’un a regroupé le mot Sonnet avec le nombre 5.2 ».
Ce que dit réellement la publication du 20 septembre
Lisez attentivement le post et l'affirmation concernant Sonnet est encore plus ténue que ne le suggère le titre. La liste est divisée en deux moitiés, et Sonnet 5.2 se trouve dans la première — la moitié « déjà en test » — qui est la plus forte des deux affirmations. La seconde moitié est explicitement nuancée : « confirmation ou indices de sorties à venir », couvrant Grok 4.7, GPT-6-Sol et Kimi K3.1, avec la ligne GPT-6-Sol qui porte même sa propre réserve selon laquelle une grande sortie teasée pour mardi « pourrait être ça ».
Donc l’auteur est prudent dans une moitié de l’article et sans nuance dans l’autre, et Sonnet 5.2 se trouve dans la moitié sans nuance. Aucune capture d’écran, aucune réponse d’API, aucune chaîne de modèle, aucun rapport de testeur, aucun chronométrage. Un lecteur qui veut vérifier l’affirmation n’a rien à quoi la confronter.
Le seul autre endroit où ce nom apparaît publiquement est une publication d’agrégateur du 19 septembre, dont le titre est « Fuite de Fable 5.2, Opus 5.2, Sonnet 5.2 ». Ouvrez-la et Sonnet 5.2 apparaît dans le titre, puis ne réapparaît plus dans le corps, où les trois noms de Claude sont regroupés dans une seule phrase à propos de « progrès notables » sur l’ensemble de la plateforme. Cette publication n’apporte aucune preuve pour aucun des trois, et avertit explicitement que les faux benchmarks doivent être traités avec prudence. Deux apparitions, même configuration : un nom au sein d’un groupe, sans rien qui lui soit attaché individuellement.
Ce qui manque, c'est l'artefact précis et vérifiable qu'a produit chaque véritable fuite Anthropic en 2026. En août, l'affaire Marshmallow et Melon présentait un trafic API observable sur une chaîne appelée claude-marshmallow-ht-eap ainsi que des variantes plus propres après elle. L'affaire Opus 5.2 de ce mois-ci voit des développeurs rapporter que le slug backend derrière l'étiquette « Opus 5 » pointait vers un nouvel emplacement. Sonnet 5.2 n'a ni l'un ni l'autre. Si un checkpoint de niveau Sonnet était servi quelque part où un développeur pourrait l'atteindre, l'identifiant serait la première chose à fuiter, car c'est ce qui est le plus difficile à cacher — il doit exister dans une requête.
La partie de l’histoire de septembre qui est corroborée n’est pas un Sonnet
Voici le piège lorsqu'on lit ce récapitulatif. L'histoire corroborée du test gris d'Anthropic qui a couru tout au long de septembre est une affaire de niveau Opus. Plusieurs médias, en chinois et en anglais, ont rapporté qu'Anthropic acheminait discrètement une fraction des requêtes vers un point de contrôle non publié sous l'étiquette Opus 5 — un test gris silencieux que les développeurs ont remarqué via un comportement modifié plutôt que des noms modifiés. Des reportages dans la nuit du 17 septembre ont décrit la coupure du canal sans préavis et son rétablissement environ un jour plus tard, après quoi il aurait été élargi de Claude Code aux surfaces de chat et de cowork. Le nom associé à ce point de contrôle dans les reportages est Claude Opus 5.2.
Sonnet 5.2 hérite de la crédibilité de ce reportage sans hériter de la moindre de ses preuves. C’est un mode de défaillance précis et courant dans la couverture des fuites : un premier niveau est documenté, un second niveau est nommé dans la même phrase, et ce second nom circule ensuite comme s’il avait lui aussi été rapporté. Ce n’est pas le cas. Si vous cherchez un rapport de routage de niveau Sonnet, vous trouverez celui d’Opus et une liste.
Il y a un fil distinct, mieux sourcé, qui court sous tout cela — les reportages économiques selon lesquels Anthropic a repoussé son introduction en bourse à novembre et, d'après Reuters citant trois sources, envisage de lancer un nouveau modèle avant celle-ci pour répondre à GPT-6 Astra. Ces informations sont réelles et pertinentes. Elles sont aussi, fait notable, muettes sur la gamme à laquelle appartiendrait le modèle. Une mise à jour d'un modèle utilitaire et le lancement d'un modèle phare sont des mouvements très différents avant une introduction en bourse, et rien de ce qui a été publié jusqu'ici n'indique lequel est envisagé.
Le mois dernier, la communauté a baptisé un Sonnet qui n’est jamais sorti.
Le plus fort argument en faveur du scepticisme à l’égard de « Sonnet 5.2 » n’est pas que l’affirmation soit faible. C’est que ce schéma de nommage précis a échoué il y a un mois, publiquement, et que cet échec est documenté.
Fin août, deux identifiants d'accès anticipé ont circulé : claude-marshmallow-eap et claude-melon-eap. Aucune des deux chaînes ne contient les mots Opus, Sonnet, ni aucun numéro de version. Le 24 août, des publications sur les réseaux sociaux et des blogs de rumeurs leur ont attribué des noms de produits depuis l'extérieur — Marshmallow est devenu « Opus 5.1 », Melon est devenu « Sonnet 5.1 » — en se fondant sur les impressions de testeurs selon lesquelles Marshmallow semblait plus puissant que Melon et plus puissant que l'Opus 5 alors actuel. Un développeur qui a enquêté aurait découvert que les chaînes brutes ne produisaient aucun résultat vérifiable de première partie, laissant le trafic antérieur comme la seule preuve observable.
Aucun des deux noms n’a été livré. La sortie suivante d’Anthropic dans cette fenêtre a été Claude Fable 5.1, le 1er septembre — un tout autre palier, sous un nom que personne n’avait attribué à l’un ou l’autre identifiant. L’étiquette « Sonnet 5.1 » était une déduction de la communauté qui s’est transformée en rumeur, puis s’est évaporée.
Cet historique compte ici pour une raison qui dépasse la prudence générale. Cela signifie que le palier Sonnet a désormais été cité dans des fuites deux fois en deux mois, sans qu’un seul artefact propre au palier n’apparaisse à l’une ou l’autre de ces occasions. Cela signifie aussi que l’hypothèse a priori la plus forte — la cadence réelle d’Anthropic en 2026 — indique une configuration différente : Opus 5 fin juillet, Fable 5.1 début septembre, et un test gris d’Opus 5.2 à la mi-septembre. Le palier Sonnet n’a pas bougé depuis le 30 juin, ce qui explique précisément pourquoi une rumeur sur Sonnet est plausible et précisément pourquoi elle n’est pas vérifiée. Un long intervalle est une raison de s’attendre à quelque chose, pas la preuve qu’une chose précise existe.
Ce que vous pouvez réellement exécuter aujourd'hui
Claude Sonnet 5 n'est pas un bouche-trou en attendant mieux. C'est le modèle sur lequel tourne déjà la majorité du trafic Claude, et ses chiffres sont concrets d'une manière que rien dans la rumeur autour de la 5.2 n'égale.

• ID du modèle — claude-sonnet-5, appelable dès maintenant ; Claude Sonnet 5.2 ne dispose d'aucun identifiant publié de quelque nature que ce soit
• Prix — 2 $ par million de jetons d’entrée et 10 $ par million de jetons de sortie, rendus permanents le 10 août ; le tarif standard prévu de 3 $ / 15 $ ne s’applique plus. On ne sait rien de la tarification de 5.2, car il n’y a rien à savoir
• Contexte — fenêtre de 1 M de tokens avec une sortie maximale de 128 K. Le billet d’Anthropic lui-même n’indique pas la fenêtre sur la page de lancement ; le tokenizer révisé est le détail qu’il met effectivement en avant, et c’est plus important que cela n’en a l’air : une même entrée peut être convertie en environ 1,0 à 1,35 fois plus de tokens selon le type de contenu.
• Benchmarks rapportés par le fournisseur — SWE-bench Pro 63,2 %, Terminal-Bench 2.1 à 80,4–80,5 %, Humanity's Last Exam 43,2 % sans outils et 57,4 % avec, OSWorld-Verified 81,2 %, GDPval-AA v2 à 1 618. Ce sont les chiffres d'Anthropic, non reproduits ici.
• Indépendant — Artificial Analysis place Claude Sonnet 5 à un Intelligence Index de 32 dans sa configuration de raisonnement adaptatif à effort maximal, bien au-dessus de la médiane de 24 pour sa gamme de prix, et à 29 dans la configuration sans raisonnement à effort élevé.
• La mise en garde sur les coûts qui survit à tout numéro de version — les prix des tokens d’Anthropic n’ont pas bougé, mais une analyse indépendante de l’Intelligence Index a constaté que Sonnet 5 consommait environ 30 à 40 % de tokens de sortie en plus par tâche que son prédécesseur, car la réflexion adaptative est activée par défaut. Le prix affiché n’est pas la facture.
Ce dernier point est celui à retenir dans toute discussion sur la 5.2. Si une mise à jour de Sonnet voit le jour, le chiffre intéressant n’est pas le tarif par million. C’est le nombre de tokens par tâche, et la question de savoir si un nouveau niveau d’effort par défaut l’augmente discrètement à nouveau.
Ce qu’un Sonnet 5.2 devrait changer pour compter
Laissons de côté la question de savoir s'il existe. La question plus utile est de savoir ce qui justifierait d'y passer, car c'est ce qui détermine ce qu'il faut guetter — et rien de tout cela ne se résume à « une mise à jour de Sonnet livrée ».

Un Sonnet 5.2 digne de ce nom devrait faire bouger au moins une de quatre choses. La première est le nombre de tokens par tâche : une version qui maintient le tarif de 2 $ / 10 $ mais met fin à l’inflation de 30 à 40 % des tokens de sortie réduirait davantage les factures réelles qu’une baisse de prix annoncée. La deuxième est l’écart agentique avec l’échelon supérieur — Sonnet 5 était positionné comme ayant parcouru environ neuf dixièmes du chemin vers le précédent modèle phare sur les tâches agentiques, pour une fraction du coût, et c’est ce rapport qui en fait le choix par défaut. La troisième est le comportement en contexte long, que le tokenizer révisé a rendu plus difficile à appréhender. La quatrième, et celle qui a le moins de chances d’être annoncée, est de savoir si un 5.2 verra même le jour en tant que Sonnet — la dernière fois que la communauté a désigné avec assurance un successeur de Sonnet, le modèle livré était un Fable.
Ce qui ne serait pas une nouvelle : un checkpoint qui apparaît dans un harnais d’évaluation, un nom de code qui surgit dans un dépôt de framework, ou un tweet récapitulatif de plus. Aucun de ces éléments ne change ce que vous pouvez appeler, combien cela coûte, ni quel score cela obtient.
Comment se positionner sans parier dessus
Le problème pratique d’un renouvellement de palier non vérifié n’est pas que vous risquiez de le rater. C’est que s’y préparer implique généralement un travail que vous détesteriez faire deux fois — un second contrat fournisseur, une seconde intégration SDK, un second jeu de clés, de limites et de factures.
C'est la partie qu'il vaut mieux supprimer maintenant plutôt que plus tard. Claude Sonnet 5 est disponible sur OrcaRouter depuis juin aux tarifs d'Anthropic eux-mêmes, soit 2 $ / 10 $, répercutés au prix catalogue du fournisseur sans marge, de sorte qu'une modification tarifaire du fournisseur sur la gamme Sonnet serait effective ici le jour même, et non au cycle de facturation suivant.

La même clé donne déjà accès au reste de la gamme Claude actuelle et les plus de 200 autres modèles de la plateforme, ce qui signifie que l’arrivée d’une 5.2 ne déclenche pas un projet d’intégration — elle apparaît dans le catalogue, et vous dirigez une partie du trafic vers elle avec un repli vers Claude Sonnet 5 pendant que vous découvrez si le calcul des jetons par tâche fonctionne réellement dans votre charge de travail. Le basculement automatique est ce qui permet de le faire en toute sécurité avec un modèle que personne n’a encore évalué indépendamment.
Pour quiconque dont la stack est déjà sur claude-sonnet-5, la réponse honnête à « dois-je attendre Claude Sonnet 5.2 » est non — il n’y a rien à attendre, aucune date, et aucune raison de croire que le modèle actuel est sur le point de cesser d’être le choix par défaut. Ce qu’il faut faire, c’est rendre le changement peu coûteux, pas le faire trop tôt.
Qu'est-ce qui réglerait cela ?
Trois choses, par ordre décroissant de ce qu’elles vous apprendraient. Un identifiant d’API serait décisif, car un modèle qui est servi doit avoir un nom dans une requête, et c’est ainsi que l’histoire de Marshmallow et Melon est devenue vérifiable et que les rapports de routage d’Opus 5.2 sont devenus vérifiables. Une reconnaissance du fournisseur — une fiche modèle, une page de documentation, une ligne dans un journal des modifications — mettrait fin au débat d’emblée. Un rapport de testeur propre à un palier, avec une description du comportement plutôt qu’un nom, serait le plus faible des trois et serait encore plus que ce qui existe aujourd’hui.
Jusqu'à ce que l'un d'eux apparaisse, Claude Sonnet 5.2 est un nom dans une liste. Considérez-le comme une invitation à vérifier si votre stack peut absorber à peu de frais une mise à jour de Sonnet, et non comme une raison de planifier autour de celle-ci.
