
La fuite « Kettle » de Claude Fable 5 : l'ID de modèle interne dissimulé dans la réflexion signée — ce que nous savons jusqu'ici
- z-aiNOUVEAUZ.ai: GLM 5.32026-08-1860Intelligence75Code
- obsidianNOUVEAUQwen3.8 27B Uncensored (Aggressive)2026-08-1552Intelligence68Code
- qwenNOUVEAUQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNOUVEAUDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligence69Code
- grokNOUVEAUSpaceXAI: Grok 4.62026-08-1261Intelligence77Code
- metaMeta: Muse Spark 1.22026-08-0557Intelligence72Code
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligence72Code
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligence69Code
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 par million de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligence78Code
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligence69Code
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligence49Code
- metaMeta: Muse Spark 1.12026-07-1653Intelligence71Code
- kimiMoonshotAI: Kimi K32026-07-1560Intelligence76Code
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligence71Code
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligence77Code
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligence77Code
- grokxAI: Grok 4.52026-07-0856Intelligence72Code
Le 16 août à 23 h 29 min 45 s PDT, un chercheur sur X a publié une affirmation qui a transformé un recoin sans éclat de l'API d'Anthropic en une histoire de type « ce que nous savons jusqu'ici » : décoder la « signature » signée par le serveur qui accompagne chaque bloc de réflexion de Claude, ont-ils dit, et le champ six nomme le modèle qui vous a réellement répondu. Selon leur lecture, les réponses publiquement étiquetées claude-fable-5 — le Claude Fable 5 de la classe Mythos qu'Anthropic a largement déployé depuis le 9 juin 2026, à 10 $ / 50 $ par million de jetons — ont commencé à porter un identifiant interne qui n'apparaît nulle part dans la documentation publique d'Anthropic : claude-kettle-e2c95a10-v2-prod. Rien n'a changé dans l'étiquette de réponse. On n'a pas non plus montré de changement dans la facturation, le champ modèle de premier niveau de l'API ou la garantie de snapshot épinglé d'Anthropic. Ce qui a changé, c'est une chaîne enfouie dans un champ que la documentation dit explicitement aux développeurs de ne pas analyser.
Ceci est un rapport de fuite, pas un verdict. La découverte date de quatre jours, elle repose sur le décodage d'un seul chercheur qui n'a pas été reproduit de manière indépendante, et Anthropic n'a pas commenté ce à quoi « Kettle » — ou son étiquette associée MYCRO_MODEL_MANATEE — fait référence. La question utile n'est pas « est-ce qu'Anthropic a remplacé Fable 5 ? » Les preuves ne l'établissent pas. La question utile est de savoir ce que signifierait, si c'était réel, un identifiant de modèle interne apparaissant sous un identifiant de modèle public, et ce que cela ne signifierait pas. Voici ce que nous savons jusqu'ici.
Ce que la fuite a réellement révélé
Le signal est un unique post X de @chetaslua (statut 2089783170896179632, publié le 16 août 2026), rédigé dans le style habituel du compte « premier avec preuve ». La revendication, en bref :
Les blocs de réflexion de Claude portent un protobuf signé par le serveur dans le champ de signature.
Le champ six de ce protobuf, dit le chercheur, contient l'identifiant du modèle qui a réellement produit la réponse.
• À partir de 23 h 29 min 45 s (heure avancée du Pacifique) le 16 août, 2 582 des 2 582 signatures échantillonnées portaient la même valeur : claude-kettle-e2c95a10-v2-prod.
• Un deuxième label interne, MYCRO_MODEL_MANATEE, figurait également dans les mêmes métadonnées.
Le chiffre « 2,582 of 2,582 » fait le travail rhétorique : c'est la preuve du chercheur qu'il ne s'agissait pas d'un cas isolé ou d'une tranche A/B, mais d'une bascule complète de ce que l'identifiant désigne. Ce que le post n'inclut pas, c'est la méthode derrière le décodage — aucune signature brute, aucun script de décodage, aucun schéma protobuf inféré, aucune métadonnée complète de réponse. La preuve publique est un graphique récapitulatif. Cela rend la conclusion plausible et, du même coup, actuellement invérifiable.

Pourquoi la signature comporte-t-elle même un 'field six' ?
Chaque bloc de réflexion renvoyé par Claude comporte un champ de signature. D'après la documentation sur la réflexion d'Anthropic, cette signature est « une copie chiffrée du raisonnement complet » que vous êtes censé·e renvoyer telle quelle dans les conversations multi-tours et les utilisations d'outils, et l'API s'en sert « pour vérifier que les blocs de réflexion ont été générés par Claude ». Sur Claude Fable 5, le comportement par défaut fait de la signature la seule trace visible : avec le paramètre d'affichage défini sur « omitted » — la valeur par défaut sur Fable 5, Mythos 5, Opus 5 et Sonnet 5 — le bloc de réflexion revient avec un champ thinking vide et seule la signature renseignée.
La documentation ajoute ensuite une phrase qui compte pour toute fuite fondée sur ce champ : « Le champ de signature est opaque : ne l'interprétez pas et ne l'analysez pas. » C'est précisément ce que fait l'affirmation de Kettle : analyser la signature. Ce n'est pas la preuve que l'affirmation est fausse — la signature doit être lisible par machine pour la propre pile de service d'Anthropic — mais cela signifie que le décodage a été effectué à l'encontre de l'instruction explicite du fournisseur, sur un protocole non documenté, et que la reconstitution de ce protocole par le chercheur n'a pas été publiée. Toute inférence fondée sur « le sixième champ signifie le modèle servi » hérite de cette incertitude.
Ce que cela ne prouve pas
Commencez par ce qu'est réellement la preuve : une réponse publiquement étiquetée claude-fable-5 portait un identifiant interne jamais signalé auparavant. C'est tout. L'identifiant à lui seul ne prouve pas qu'Anthropic a remplacé les poids de Fable 5, qu'un successeur plus performant existe, que les réponses se sont améliorées ou dégradées, ou qu'une quelconque requête a été acheminée vers un modèle plus petit. « Kettle » pourrait être le nom d'un déploiement de service interne pour le même instantané de Fable 5 ; ce pourrait être le nom d'un composant routeur ; ce pourrait être un classifieur de la pile de sécurité. Le nom de code ne permet pas de faire la différence entre ces possibilités.
La politique de versioning d'Anthropic explique pourquoi la fuite est compatible avec le fait que rien n'a changé. Dans la documentation « Model IDs and versioning », deux déclarations se côtoient :
Anthropic ne met pas à jour les poids ou la configuration d’un identifiant de modèle existant. Lorsqu’une version mise à jour est disponible, elle est publiée sous un nouvel identifiant de modèle.
Les poids du modèle sont fixes pour un ID donné, mais l'infrastructure de service autour du modèle peut changer au fil du temps. Cette infrastructure comprend des composants tels que le routeur de requêtes, les classificateurs de sécurité et la logique d'échantillonnage.

Cette deuxième phrase constitue tout l'écart conceptuel entre « Kettle est un scandale » et « Kettle est un lundi ordinaire ». Les documents prévoient même une dérive comportementale : « Occasionnellement, les mises à jour de l'infrastructure produisent des différences mineures dans le comportement observable, même lorsque l'identifiant du modèle et les poids n'ont pas changé. » Un nouveau routeur ou un déploiement de service nommé Kettle s'insérerait exactement dans cette phrase. Pour que la fuite soit véritablement accablante, il faudrait qu'elle montre soit un nouveau modèle derrière l'identifiant, malgré la politique, soit un mécanisme qui enfreignait les règles de visibilité ci-dessous.
Le routage de secours documenté que Fable 5 a déjà
Claude Fable 5 est déjà livré avec un mécanisme de changement de modèle réel, documenté et destiné à être visible. Les classificateurs de sécurité inspectent les requêtes et peuvent acheminer un sous-ensemble — Anthropic cite la cybersécurité offensive, la biologie à double usage, la distillation de modèles et certains travaux de développement de puces de pointe — vers un modèle Claude Opus 5. Sur les surfaces grand public, la solution de repli est censée être bien visible : un avis, le nom du modèle de service sur la réponse, et le sélecteur de modèle qui bascule vers Opus. Dans l'API, la réponse expose le modèle de service via le champ model de niveau supérieur et un bloc de contenu de repli dédié.
L'affirmation de Kettle décrit quelque chose de différent, et la différence est la partie qui importerait : un identifiant interne apparaissant dans une réponse qui conservait le label public Fable 5. Le post du chercheur ne montre ni avis de repli, ni champ de modèle API modifié, ni bloc de repli — si c'était le cas, l'histoire serait « le repli documenté s'est déclenché », et non « Anthropic redirige silencieusement ». Sans cela, la fuite n'a pas démontré qu'une quelconque garantie de visibilité a été violée, car elle n'a pas montré ce qu'est Kettle.
Pourquoi c'est important même si rien n'a changé
Les identifiants de modèle épinglés sont un mécanisme de confiance. La documentation d'Anthropic promet que « lorsque vous utilisez un identifiant de modèle dans une requête API, le modèle sous-jacent reste constant pour la durée de vie de cet identifiant » — c'est tout l'intérêt pour une équipe de faire des benchmarks sur claude-fable-5 et d'espérer que le résultat aura encore un sens le trimestre suivant. Un identifiant caché sous cet ID, quel qu'il soit, rappelle que la garantie couvre les poids et la configuration, et non tout le chemin de la requête au jeton. Si un modèle véritablement différent venait à tourner sous un ID public sans divulgation, chaque évaluation, chaque prévision de coût et chaque test de régression qualité lié à cet ID serait invalidé en silence.
L'angle de la facturation accentue cela. Claude Fable 5 coûte 10 $ par million de jetons d'entrée et 50 $ par million de jetons de sortie — le tarif publié le plus élevé d'Anthropic. Si le modèle servi avait un jour différé de l'ID facturé, la question devient quel tarif s'applique et qui décide. La fuite n'offre aucune preuve que cela se soit produit ; le point est seulement que le champ de signature est l'endroit où l'on chercherait d'abord un signe.
Il convient également de noter le timing. C'est le troisième signal d'Anthropic en neuf jours : le 7 août, l'entreprise a annoncé avoir réentraîné le classificateur de biologie de Fable 5, réduisant d'environ 85 % les réponses de repli liées à la biologie lors des tests internes ; le 14 août, son Responsible Scaling Policy Risk Report a reconnu l'existence d'un « Model 2 » interne non publié qu'Anthropic qualifie d'« amélioration notable » par rapport à Claude Mythos 5 et qu'elle ne prévoit pas de publier. Ces deux déclarations émanent du fournisseur, mais ensemble, elles montrent qu'Anthropic modifie activement les systèmes autour de Claude Fable 5 — des classificateurs le 7, un successeur interne reconnu le 14 — tout en maintenant l'ID claude-fable-5 inchangé. Kettle serait le même genre d'histoire, sans la divulgation.
Que faire à ce sujet ?
Pour les appelants d'API, la position pratique est ennuyeuse et correcte : un identifiant n'est pas une preuve d'échange, et il n'y a encore rien d'exploitable dans la fuite. Ce que vous pouvez faire, c'est constituer vos propres preuves. Consignez le champ de modèle de premier niveau et les éventuels blocs de repli sur les réponses que vous recevez réellement, et surveillez les écarts de jetons et de coûts sur une charge de travail fixe. Si un repli documenté se déclenche, il sera visible précisément à ces endroits. C'est le seul test qui compte pour votre charge de travail, et il ne dépend pas du fait que quelqu'un décode le format de signature d'Anthropic.
Si vous acheminez vers Claude Fable 5 via OrcaRouter, la même forme de réponse revient que celle renvoyée par Anthropic, et comme nous transmettons les prix catalogue du fournisseur sans aucune marge, il n'y a pas un deuxième ensemble de prix à rapprocher — si Anthropic modifie un jour le tarif de Fable 5, le nouveau chiffre est en ligne de notre côté le jour même. Pour une situation non vérifiée comme celle-ci, la façon à faible risque de continuer à utiliser le modèle sans miser un chemin de production sur une rumeur est d'acheminer une partie du trafic réel vers Claude Fable 5 avec bascule automatique vers un repli éprouvé — Claude Opus 5 à $5/$25 par million, ou un modèle moins cher de niveau codage — de sorte qu'une régression de qualité devienne une décision de routage plutôt qu'un incident. Même clé, pas de second contrat, et la bascule est un changement de routing-DSL plutôt qu'une réécriture.

Ce que nous regardons
• Si Anthropic commente. La solution la plus propre est une reconnaissance en une ligne de ce que sont Kettle et Manatee. Le silence est en soi informatif.
• Une reproduction indépendante. Si quelqu'un publiait les signatures brutes, la méthode de décodage et le schéma protobuf déduit, cela ferait passer ceci d'un graphique d'une personne à une affirmation vérifiable. En attendant, ce n'est qu'un état actuel des connaissances, pas une découverte.
• La surface de visibilité. Si les réponses de claude-fable-5 commencent à afficher des avis de repli, un champ de modèle d'API modifié ou des blocs de repli, la lecture « repli documenté » se renforce ; sinon, c'est la lecture « voie non documentée » qui se renforce.
• Un nouvel identifiant de modèle. La politique de versioning d’Anthropic veut qu’une véritable nouvelle version soit publiée sous un nouvel identifiant. La confirmation la plus nette que Kettle est un vrai successeur serait donc qu’Anthropic publie quelque chose — et non qu’il s’agisse d’un simple routage en place. Surveillez un claude-fable-5.1 ou similaire.
• Si « Manatee » est expliqué. Le deuxième libellé est un fil que personne n'a encore tiré.
FAQ
{{1}}Anthropic achemine-t-il réellement Claude Fable 5 vers un modèle différent ?{{/1}}
Non prouvé. La fuite montre que les réponses étiquetées claude-fable-5 portaient un identifiant interne, claude-kettle-e2c95a10-v2-prod, dans une signature de pensée signée. Elle ne montre pas que les poids ont changé, qu'un successeur a été déployé, ni qu'une quelconque requête a été rétrogradée. « Kettle » pourrait tout aussi bien être le nom d'un déploiement de service interne pour le même instantané de Fable 5.
Comment l'identifiant Kettle a-t-il été trouvé ?
Le chercheur @chetaslua affirme avoir décodé un protobuf dans le champ signature des blocs de réflexion de Claude et avoir lu l'identifiant du modèle dans le champ six. La documentation d'Anthropic qualifie la signature d'« opaque » et demande aux développeurs de ne pas l'analyser, et la méthode de décodage du chercheur n'a pas été publiée, de sorte que cette affirmation n'est pas encore indépendamment reproductible.
Est-ce que cela viole la garantie de modèle épinglé d'Anthropic ?
Inconnu. Les documents de versionnage d'Anthropic indiquent qu'il ne met jamais à jour les poids ou la configuration d'un ID de modèle existant et que les nouvelles versions sont publiées sous un nouvel ID — mais ils autorisent explicitement l'infrastructure de service autour d'un modèle (le routeur de requêtes, les classificateurs de sécurité, la logique d'échantillonnage) à changer. Un identifiant Kettle pourrait être exactement ce type de changement, ce qui ne violerait pas la garantie.
Comment saurais-je si le modèle qui me sert a changé ?
Surveillez le champ model de premier niveau dans les réponses API, recherchez les blocs de contenu de repli, et suivez les écarts de jetons et de coûts sur une charge de travail fixe. Les replis documentés d'Anthropic sont censés être visibles à ces endroits. Il n'existe aucun champ d'API public qui expose l'identifiant Kettle.
La lecture honnête est qu'une fuite a nommé quelque chose, sans prouver ce que c'est. L'identifiant Kettle est réel dans le seul sens où une chaîne divulguée peut l'être : un chercheur affirme qu'il est là, 2 582 fois sur 2 582, à partir de la nuit du 16 août. Ce à quoi il renvoie — un nouveau modèle, un déploiement renommé, un composant de routeur, un classifieur — reste non vérifié, et la documentation d'Anthropic elle-même offre une explication parfaitement banale pour l'ensemble. C'est là la valeur de l'article et sa limite. Jusqu'à ce qu'une signature brute soit publiée ou qu'Anthropic dise ce qu'est Kettle, la bonne posture est de le traiter comme un « ce que l'on sait pour l'instant » : à surveiller, à consigner dans vos propres journaux de trafic, et pas au point de changer votre choix de modèle — d'autant plus lorsqu'une couche de routage vous permet de garder l'option ouverte dans les deux cas.
Comparés dans cet article1
Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement
