Carte de titre principale de l'article « Claude Fable 5 Kettle Route » avec un badge RAPPORT DE FUITE, le sous-titre « L'identifiant de modèle interne trouvé dans les signatures de pensée signées — ce que nous savons jusqu'à présent », trois puces indiquant « Non vérifié : @chetaslua », « 16 août 2026 » et « claude-kettle-e2c95a10-v2-prod », une carte « L'affirmation » indiquant que les réponses étiquetées claude-fable-5 portaient un identifiant interne Kettle, et une carte « L'avertissement » indiquant que les preuves ne prouvent pas un échange de modèle. Le logo OrcaRouter est incrusté dans le coin inférieur droit.
Guides & Insights

La fuite « Kettle » de Claude Fable 5 : l'ID de modèle interne dissimulé dans la réflexion signée — ce que nous savons jusqu'ici

Auteur

Elias Hawthorne

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Le 16 août à 23 h 29 min 45 s PDT, un chercheur sur X a publié une affirmation qui a transformé un recoin sans éclat de l'API d'An​thropic en une histoire de type « ce que nous savons jusqu'ici » : décoder la « signature » signée par le serveur qui accompagne chaque bloc de réflexion de Claude, ont-ils dit, et le champ six nomme le modèle qui vous a réellement répondu. Selon leur lecture, les réponses publiquement étiquetées claude-fable-5 — le Claude Fable 5 de la classe Mythos qu'An​thropic a largement déployé depuis le 9 juin 2026, à 10 $ / 50 $ par million de jetons — ont commencé à porter un identifiant interne qui n'apparaît nulle part dans la documentation publique d'An​thropic : claude-kettle-e2c95a10-v2-prod. Rien n'a changé dans l'étiquette de réponse. On n'a pas non plus montré de changement dans la facturation, le champ modèle de premier niveau de l'API ou la garantie de snapshot épinglé d'An​thropic. Ce qui a changé, c'est une chaîne enfouie dans un champ que la documentation dit explicitement aux développeurs de ne pas analyser.

Ceci est un rapport de fuite, pas un verdict. La découverte date de quatre jours, elle repose sur le décodage d'un seul chercheur qui n'a pas été reproduit de manière indépendante, et An​thropic n'a pas commenté ce à quoi « Kettle » — ou son étiquette associée MYCRO_MODEL_MANATEE — fait référence. La question utile n'est pas « est-ce qu'An​thropic a remplacé Fable 5 ? » Les preuves ne l'établissent pas. La question utile est de savoir ce que signifierait, si c'était réel, un identifiant de modèle interne apparaissant sous un identifiant de modèle public, et ce que cela ne signifierait pas. Voici ce que nous savons jusqu'ici.

Ce que la fuite a réellement révélé

Le signal est un unique post X de @chetaslua (statut 2089783170896179632, publié le 16 août 2026), rédigé dans le style habituel du compte « premier avec preuve ». La revendication, en bref :

Les blocs de réflexion de Claude portent un protobuf signé par le serveur dans le champ de signature.

Le champ six de ce protobuf, dit le chercheur, contient l'identifiant du modèle qui a réellement produit la réponse.

• À partir de 23 h 29 min 45 s (heure avancée du Pacifique) le 16 août, 2 582 des 2 582 signatures échantillonnées portaient la même valeur : claude-kettle-e2c95a10-v2-prod.

• Un deuxième label interne, MYCRO_MODEL_MANATEE, figurait également dans les mêmes métadonnées.

Le chiffre « 2,582 of 2,582 » fait le travail rhétorique : c'est la preuve du chercheur qu'il ne s'agissait pas d'un cas isolé ou d'une tranche A/B, mais d'une bascule complète de ce que l'identifiant désigne. Ce que le post n'inclut pas, c'est la méthode derrière le décodage — aucune signature brute, aucun script de décodage, aucun schéma protobuf inféré, aucune métadonnée complète de réponse. La preuve publique est un graphique récapitulatif. Cela rend la conclusion plausible et, du même coup, actuellement invérifiable.

A two-column infographic titled 'Claude Fable 5 Kettle — what we know / what we don't'. Left column 'What we know': 'Aug 16, 2026 — 2,582 of 2,582 signatures carry an internal Kettle identifier', 'Response label stayed claude-fable-5', 'Fable 5 GA since June 9, 2026 at $10/$50 per 1M'. Right column 'What we don't': 'Whether weights changed', 'Whether Kettle is a new model or a serving deployment', 'What MYCRO_MODEL_MANATEE refers to'. Footer: 'Single researcher signal; not independently reproduced; Anthropic has not commented.'

Pourquoi la signature comporte-t-elle même un 'field six' ?

Chaque bloc de réflexion renvoyé par Claude comporte un champ de signature. D'après la documentation sur la réflexion d'An​thropic, cette signature est « une copie chiffrée du raisonnement complet » que vous êtes censé·e renvoyer telle quelle dans les conversations multi-tours et les utilisations d'outils, et l'API s'en sert « pour vérifier que les blocs de réflexion ont été générés par Claude ». Sur Claude Fable 5, le comportement par défaut fait de la signature la seule trace visible : avec le paramètre d'affichage défini sur « omitted » — la valeur par défaut sur Fable 5, Mythos 5, Opus 5 et Sonnet 5 — le bloc de réflexion revient avec un champ thinking vide et seule la signature renseignée.

La documentation ajoute ensuite une phrase qui compte pour toute fuite fondée sur ce champ : « Le champ de signature est opaque : ne l'interprétez pas et ne l'analysez pas. » C'est précisément ce que fait l'affirmation de Kettle : analyser la signature. Ce n'est pas la preuve que l'affirmation est fausse — la signature doit être lisible par machine pour la propre pile de service d'An​thropic — mais cela signifie que le décodage a été effectué à l'encontre de l'instruction explicite du fournisseur, sur un protocole non documenté, et que la reconstitution de ce protocole par le chercheur n'a pas été publiée. Toute inférence fondée sur « le sixième champ signifie le modèle servi » hérite de cette incertitude.

Ce que cela ne prouve pas

Commencez par ce qu'est réellement la preuve : une réponse publiquement étiquetée claude-fable-5 portait un identifiant interne jamais signalé auparavant. C'est tout. L'identifiant à lui seul ne prouve pas qu'An​thropic a remplacé les poids de Fable 5, qu'un successeur plus performant existe, que les réponses se sont améliorées ou dégradées, ou qu'une quelconque requête a été acheminée vers un modèle plus petit. « Kettle » pourrait être le nom d'un déploiement de service interne pour le même instantané de Fable 5 ; ce pourrait être le nom d'un composant routeur ; ce pourrait être un classifieur de la pile de sécurité. Le nom de code ne permet pas de faire la différence entre ces possibilités.

La politique de versioning d'An​thropic explique pourquoi la fuite est compatible avec le fait que rien n'a changé. Dans la documentation « Model IDs and versioning », deux déclarations se côtoient :

Anthropic ne met pas à jour les poids ou la configuration d’un identifiant de modèle existant. Lorsqu’une version mise à jour est disponible, elle est publiée sous un nouvel identifiant de modèle.

Les poids du modèle sont fixes pour un ID donné, mais l'infrastructure de service autour du modèle peut changer au fil du temps. Cette infrastructure comprend des composants tels que le routeur de requêtes, les classificateurs de sécurité et la logique d'échantillonnage.

A screenshot of Anthropic's 'Model IDs and versioning' documentation page showing the statement that each Claude model ID identifies a pinned version of the model and that the underlying model remains constant for the lifetime of that ID, alongside the dateless model ID format examples such as claude-sonnet-5 and claude-opus-5.

Cette deuxième phrase constitue tout l'écart conceptuel entre « Kettle est un scandale » et « Kettle est un lundi ordinaire ». Les documents prévoient même une dérive comportementale : « Occasionnellement, les mises à jour de l'infrastructure produisent des différences mineures dans le comportement observable, même lorsque l'identifiant du modèle et les poids n'ont pas changé. » Un nouveau routeur ou un déploiement de service nommé Kettle s'insérerait exactement dans cette phrase. Pour que la fuite soit véritablement accablante, il faudrait qu'elle montre soit un nouveau modèle derrière l'identifiant, malgré la politique, soit un mécanisme qui enfreignait les règles de visibilité ci-dessous.

Le routage de secours documenté que Fable 5 a déjà

Claude Fable 5 est déjà livré avec un mécanisme de changement de modèle réel, documenté et destiné à être visible. Les classificateurs de sécurité inspectent les requêtes et peuvent acheminer un sous-ensemble — An​thropic cite la cybersécurité offensive, la biologie à double usage, la distillation de modèles et certains travaux de développement de puces de pointe — vers un modèle Claude Opus 5. Sur les surfaces grand public, la solution de repli est censée être bien visible : un avis, le nom du modèle de service sur la réponse, et le sélecteur de modèle qui bascule vers Opus. Dans l'API, la réponse expose le modèle de service via le champ model de niveau supérieur et un bloc de contenu de repli dédié.

L'affirmation de Kettle décrit quelque chose de différent, et la différence est la partie qui importerait : un identifiant interne apparaissant dans une réponse qui conservait le label public Fable 5. Le post du chercheur ne montre ni avis de repli, ni champ de modèle API modifié, ni bloc de repli — si c'était le cas, l'histoire serait « le repli documenté s'est déclenché », et non « An​thropic redirige silencieusement ». Sans cela, la fuite n'a pas démontré qu'une quelconque garantie de visibilité a été violée, car elle n'a pas montré ce qu'est Kettle.

Pourquoi c'est important même si rien n'a changé

Les identifiants de modèle épinglés sont un mécanisme de confiance. La documentation d'An​thropic promet que « lorsque vous utilisez un identifiant de modèle dans une requête API, le modèle sous-jacent reste constant pour la durée de vie de cet identifiant » — c'est tout l'intérêt pour une équipe de faire des benchmarks sur claude-fable-5 et d'espérer que le résultat aura encore un sens le trimestre suivant. Un identifiant caché sous cet ID, quel qu'il soit, rappelle que la garantie couvre les poids et la configuration, et non tout le chemin de la requête au jeton. Si un modèle véritablement différent venait à tourner sous un ID public sans divulgation, chaque évaluation, chaque prévision de coût et chaque test de régression qualité lié à cet ID serait invalidé en silence.

L'angle de la facturation accentue cela. Claude Fable 5 coûte 10 $ par million de jetons d'entrée et 50 $ par million de jetons de sortie — le tarif publié le plus élevé d'An​thropic. Si le modèle servi avait un jour différé de l'ID facturé, la question devient quel tarif s'applique et qui décide. La fuite n'offre aucune preuve que cela se soit produit ; le point est seulement que le champ de signature est l'endroit où l'on chercherait d'abord un signe.

Il convient également de noter le timing. C'est le troisième signal d'An​thropic en neuf jours : le 7 août, l'entreprise a annoncé avoir réentraîné le classificateur de biologie de Fable 5, réduisant d'environ 85 % les réponses de repli liées à la biologie lors des tests internes ; le 14 août, son Responsible Scaling Policy Risk Report a reconnu l'existence d'un « Model 2 » interne non publié qu'An​thropic qualifie d'« amélioration notable » par rapport à Claude Mythos 5 et qu'elle ne prévoit pas de publier. Ces deux déclarations émanent du fournisseur, mais ensemble, elles montrent qu'An​thropic modifie activement les systèmes autour de Claude Fable 5 — des classificateurs le 7, un successeur interne reconnu le 14 — tout en maintenant l'ID claude-fable-5 inchangé. Kettle serait le même genre d'histoire, sans la divulgation.

Que faire à ce sujet ?

Pour les appelants d'API, la position pratique est ennuyeuse et correcte : un identifiant n'est pas une preuve d'échange, et il n'y a encore rien d'exploitable dans la fuite. Ce que vous pouvez faire, c'est constituer vos propres preuves. Consignez le champ de modèle de premier niveau et les éventuels blocs de repli sur les réponses que vous recevez réellement, et surveillez les écarts de jetons et de coûts sur une charge de travail fixe. Si un repli documenté se déclenche, il sera visible précisément à ces endroits. C'est le seul test qui compte pour votre charge de travail, et il ne dépend pas du fait que quelqu'un décode le format de signature d'An​thropic.

Si vous acheminez vers Claude Fable 5 via OrcaRouter, la même forme de réponse revient que celle renvoyée par An​thropic, et comme nous transmettons les prix catalogue du fournisseur sans aucune marge, il n'y a pas un deuxième ensemble de prix à rapprocher — si An​thropic modifie un jour le tarif de Fable 5, le nouveau chiffre est en ligne de notre côté le jour même. Pour une situation non vérifiée comme celle-ci, la façon à faible risque de continuer à utiliser le modèle sans miser un chemin de production sur une rumeur est d'acheminer une partie du trafic réel vers Claude Fable 5 avec bascule automatique vers un repli éprouvé — Claude Opus 5 à $5/$25 par million, ou un modèle moins cher de niveau codage — de sorte qu'une régression de qualité devienne une décision de routage plutôt qu'un incident. Même clé, pas de second contrat, et la bascule est un changement de routing-DSL plutôt qu'une réécriture.

A screenshot of the OrcaRouter model page for Claude Fable 5 (anthropic/claude-fable-5) showing the model id, Vision, Tools, JSON and Reasoning capability chips, a 1M-token context window, a 128K max output, text, image and file input with text output, $10.00 per 1M input tokens and $50.00 per 1M output tokens, and a p50 time-to-first-token of 5.65 seconds.

Ce que nous regardons

• Si Anthropic commente. La solution la plus propre est une reconnaissance en une ligne de ce que sont Kettle et Manatee. Le silence est en soi informatif.

• Une reproduction indépendante. Si quelqu'un publiait les signatures brutes, la méthode de décodage et le schéma protobuf déduit, cela ferait passer ceci d'un graphique d'une personne à une affirmation vérifiable. En attendant, ce n'est qu'un état actuel des connaissances, pas une découverte.

• La surface de visibilité. Si les réponses de claude-fable-5 commencent à afficher des avis de repli, un champ de modèle d'API modifié ou des blocs de repli, la lecture « repli documenté » se renforce ; sinon, c'est la lecture « voie non documentée » qui se renforce.

• Un nouvel identifiant de modèle. La politique de versioning d’Anthropic veut qu’une véritable nouvelle version soit publiée sous un nouvel identifiant. La confirmation la plus nette que Kettle est un vrai successeur serait donc qu’Anthropic publie quelque chose — et non qu’il s’agisse d’un simple routage en place. Surveillez un claude-fable-5.1 ou similaire.

• Si « Manatee » est expliqué. Le deuxième libellé est un fil que personne n'a encore tiré.

FAQ

{{1}}An​thropic achemine-t-il réellement Claude Fable 5 vers un modèle différent ?{{/1}}

Non prouvé. La fuite montre que les réponses étiquetées claude-fable-5 portaient un identifiant interne, claude-kettle-e2c95a10-v2-prod, dans une signature de pensée signée. Elle ne montre pas que les poids ont changé, qu'un successeur a été déployé, ni qu'une quelconque requête a été rétrogradée. « Kettle » pourrait tout aussi bien être le nom d'un déploiement de service interne pour le même instantané de Fable 5.

Comment l'identifiant Kettle a-t-il été trouvé ?

Le chercheur @chetaslua affirme avoir décodé un protobuf dans le champ signature des blocs de réflexion de Claude et avoir lu l'identifiant du modèle dans le champ six. La documentation d'An​thropic qualifie la signature d'« opaque » et demande aux développeurs de ne pas l'analyser, et la méthode de décodage du chercheur n'a pas été publiée, de sorte que cette affirmation n'est pas encore indépendamment reproductible.

Est-ce que cela viole la garantie de modèle épinglé d'An​thropic ?

Inconnu. Les documents de versionnage d'An​thropic indiquent qu'il ne met jamais à jour les poids ou la configuration d'un ID de modèle existant et que les nouvelles versions sont publiées sous un nouvel ID — mais ils autorisent explicitement l'infrastructure de service autour d'un modèle (le routeur de requêtes, les classificateurs de sécurité, la logique d'échantillonnage) à changer. Un identifiant Kettle pourrait être exactement ce type de changement, ce qui ne violerait pas la garantie.

Comment saurais-je si le modèle qui me sert a changé ?

Surveillez le champ model de premier niveau dans les réponses API, recherchez les blocs de contenu de repli, et suivez les écarts de jetons et de coûts sur une charge de travail fixe. Les replis documentés d'An​thropic sont censés être visibles à ces endroits. Il n'existe aucun champ d'API public qui expose l'identifiant Kettle.

La lecture honnête est qu'une fuite a nommé quelque chose, sans prouver ce que c'est. L'identifiant Kettle est réel dans le seul sens où une chaîne divulguée peut l'être : un chercheur affirme qu'il est là, 2 582 fois sur 2 582, à partir de la nuit du 16 août. Ce à quoi il renvoie — un nouveau modèle, un déploiement renommé, un composant de routeur, un classifieur — reste non vérifié, et la documentation d'An​thropic elle-même offre une explication parfaitement banale pour l'ensemble. C'est là la valeur de l'article et sa limite. Jusqu'à ce qu'une signature brute soit publiée ou qu'An​thropic dise ce qu'est Kettle, la bonne posture est de le traiter comme un « ce que l'on sait pour l'instant » : à surveiller, à consigner dans vos propres journaux de trafic, et pas au point de changer votre choix de modèle — d'autant plus lorsqu'une couche de routage vous permet de garder l'option ouverte dans les deux cas.

Comparés dans cet article1

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement

© 2026 OrcaRouter

Pour les fournisseurs

Vous exploitez une plateforme d'inférence ? Proposez vos modèles sur OrcaRouter.

providers@orcarouter.ai

Rejoignez notre communauté

Discordsupport@orcarouter.aiXGitHubYouTube