Hero-titelkaart voor het artikel 'Claude Fable 5 Kettle Route' met een LEAK REPORT-badge, de subtitel 'De interne model-ID gevonden in ondertekende denkhandtekeningen — wat we tot nu toe weten', drie chips met 'Ongeverifieerd: @chetaslua', '16 aug 2026' en 'claude-kettle-e2c95a10-v2-prod', een 'De bewering'-kaart die vermeldt dat reacties met het label claude-fable-5 een interne Kettle-identificatie droegen, en een 'De kanttekening'-kaart die vermeldt dat het bewijs geen modelwissel bewijst. Het OrcaRouter-logo is samengesteld in de rechteronderhoek.
Guides & Insights

Claude Fable 5's "Kettle"-lek: de interne model-ID verborgen in ondertekend denken — wat we tot nu toe weten

Auteur

Elias Hawthorne

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Op 16 augustus om 23:29:45 uur PDT plaatste een onderzoeker op X een bewering die een onopvallende hoek van de API van An​thropic veranderde in een 'wat-we-tot-nu-toe-weten'-verhaal: decodeer de door de server ondertekende 'handtekening' die op elk Claude-denkblok zit, zeiden ze, en je komt uit op zes namen: het model dat je daadwerkelijk heeft geantwoord. Volgens hun lezing begonnen reacties die publiekelijk als claude-fable-5 zijn gelabeld — de Claude Fable 5 van de Mythos-klasse die An​thropic sinds 9 juni 2026 breed heeft uitgerold tegen $10/$50 per miljoen tokens — een interne identificatiecode te dragen die nergens in de openbare documentatie van An​thropic voorkomt: claude-kettle-e2c95a10-v2-prod. Er veranderde niets aan het reactielabel. Ook bleek er niets te veranderen aan de facturering, het top-levelmodelveld van de API of de pinned-snapshotgarantie van An​thropic. Wat veranderde, was een string verborgen in een veld waarvan de documentatie ontwikkelaars expliciet zegt dat ze het niet moeten parsen.

Dit is een lekrapport, geen oordeel. De bevinding is vier dagen oud, berust op de ontcijfering van één onderzoeker die niet onafhankelijk is gereproduceerd, en An​thropic heeft niet gereageerd op waar "Kettle" — of het bijbehorende label MYCRO_MODEL_MANATEE — naar verwijst. De nuttige vraag is niet "heeft An​thropic Fable 5 verwisseld?" Het bewijs toont dat niet aan. De nuttige vraag is wat een intern model-ID dat onder een publiek model-ID verschijnt zou betekenen als het echt was, en wat niet. Dit is wat we tot nu toe weten.

Wat het lek daadwerkelijk onthulde

Het signaal is een enkele X-post van @chetaslua (status 2089783170896179632, geplaatst op 16 augustus 2026), geschreven in de gebruikelijke "eerst met bewijs"-stijl van het account. De claim, in het kort:

Claude's denkblokken bevatten een server-ondertekende protobuf in het handtekeningveld.

Veld zes van die protobuf, zegt de onderzoeker, bevat de identificatie van het model dat daadwerkelijk de reactie heeft gegenereerd.

• Vanaf 11:29:45 p.m. PDT op 16 augustus hadden 2.582 van de 2.582 gesampelde handtekeningen dezelfde waarde: claude-kettle-e2c95a10-v2-prod.

• Een tweede intern label, MYCRO_MODEL_MANATEE, verscheen ook in dezelfde metadata.

Het cijfer "2,582 of 2,582" doet het retorische werk: het is het bewijs van de onderzoeker dat dit geen eenmalige gebeurtenis of een A/B-slice was, maar een volledige omschakeling van waar de identifier ook naar verwijst. Wat het bericht niet bevat, is de methode achter de decode — geen ruwe handtekeningen, geen decoderingsscript, geen afgeleid protobuf-schema, geen volledige responsmetadata. Het publieke bewijs is een samenvattende grafiek. Dat maakt de bevinding tegelijkertijd plausibel en momenteel onverifieerbaar.

A two-column infographic titled 'Claude Fable 5 Kettle — what we know / what we don't'. Left column 'What we know': 'Aug 16, 2026 — 2,582 of 2,582 signatures carry an internal Kettle identifier', 'Response label stayed claude-fable-5', 'Fable 5 GA since June 9, 2026 at $10/$50 per 1M'. Right column 'What we don't': 'Whether weights changed', 'Whether Kettle is a new model or a serving deployment', 'What MYCRO_MODEL_MANATEE refers to'. Footer: 'Single researcher signal; not independently reproduced; Anthropic has not commented.'

Waarom de handtekening zelfs een 'veld zes' heeft

Elk denkblok dat Claude teruggeeft, bevat een handtekeningveld. Volgens de denkdocumentatie van An​thropic is die handtekening 'een versleutelde kopie van de volledige redenering' die je in meerbeurts- en toolgebruiksgesprekken ongewijzigd moet doorgeven, en de API gebruikt deze 'om te verifiëren dat denkblokken door Claude zijn gegenereerd.' Bij Claude Fable 5 zorgt het standaardgedrag ervoor dat de handtekening het enige zichtbare spoor is: met display ingesteld op 'omitted' — de standaard op Fable 5, Mythos 5, Opus 5 en Sonnet 5 — komt het denkblok terug met een leeg denkveld en alleen de handtekening ingevuld.

De documentatie voegt vervolgens een zin toe die ertoe doet voor elk lek dat op dit veld is gebaseerd: "Het handtekeningveld is opaak: interpreteer of parse het niet." Het parseren hiervan is precies wat de claim van Kettle doet. Dat is geen bewijs dat de claim onjuist is — de handtekening moet machineleesbaar zijn voor de eigen serving-stack van An​thropic — maar het betekent dat de decodering werd uitgevoerd in weerwil van de expliciete instructie van de leverancier, op basis van een ongedocumenteerd protocol, en dat de reconstructie van dat protocol door de onderzoeker niet is gepubliceerd. Elke conclusie die voortbouwt op "veld zes betekent het serving-model" erft die onzekerheid.

Wat het niet bewijst

Begin met wat het bewijs werkelijk is: een antwoord dat publiekelijk als claude-fable-5 was gelabeld, bevatte een voorheen niet gerapporteerde interne identificatiecode. Dat is alles. De identificatiecode alleen bewijst niet dat An​thropic de gewichten van Fable 5 heeft vervangen, dat er een capabelere opvolger bestaat, dat antwoorden beter of slechter zijn geworden, of dat een verzoek naar een kleiner model is geleid. "Kettle" zou een interne servicenaam kunnen zijn voor exact dezelfde Fable 5-snapshot; het zou de naam van een routercomponent kunnen zijn; het zou een classificator in de safety-stack kunnen zijn. De codenaam kan daar geen onderscheid tussen maken.

An​thropic's eigen versiebeheerbeleid verklaart waarom het lek verenigbaar is met het feit dat er niets is veranderd. Uit de documentatie "Model IDs and versioning" staan twee uitspraken naast elkaar:

Anthropic werkt de gewichten of configuratie van een bestaand model-ID niet bij. Wanneer een bijgewerkte versie beschikbaar is, wordt deze onder een nieuw model-ID uitgebracht.

Modelgewichten zijn vast voor een bepaalde ID, maar de serving-infrastructuur rond het model kan in de loop der tijd veranderen. Deze infrastructuur omvat componenten zoals de requestrouter, veiligheidsclassificatoren en samplinglogica.

A screenshot of Anthropic's 'Model IDs and versioning' documentation page showing the statement that each Claude model ID identifies a pinned version of the model and that the underlying model remains constant for the lifetime of that ID, alongside the dateless model ID format examples such as claude-sonnet-5 and claude-opus-5.

Die tweede zin is de hele conceptuele kloof tussen "Kettle is een schandaal" en "Kettle is een routine-maandag." De documentatie voorziet zelfs gedragsafwijking: "Af en toe zorgen infrastructuurupdates voor kleine verschillen in waarneembaar gedrag, zelfs wanneer de model-ID en gewichten niet zijn veranderd." Een nieuwe router of serving-implementatie met de naam Kettle zou precies in die zin passen. Om het lek echt vernietigend te laten zijn, zou het moeten aantonen dat er ofwel een nieuw model achter de ID zit ondanks het beleid, ofwel een mechanisme dat de onderstaande zichtbaarheidsregels schond.

De gedocumenteerde fallback-routering die Fable 5 al heeft

Claude Fable 5 wordt al geleverd met een modelwisselmechanisme dat echt is, gedocumenteerd en bedoeld om zichtbaar te zijn. Veiligheidsclassificatoren inspecteren verzoeken en kunnen een subset routeren — An​thropic noemt offensieve cyberbeveiliging, dual-use biologie, modeldistillatie en wat werk aan frontier-chipontwikkeling — naar een Claude Opus 5-model. Op consumenteninterfaces hoort de fallback opvallend te zijn: een melding, de naam van het serverende model op het antwoord, en de modelkiezer die overschakelt naar Opus. In de API stelt de respons het serverende model bloot via het modelveld op topniveau en een speciaal fallback-inhoudsblok.

De Kettle-bewering beschrijft iets anders, en het verschil is het deel dat er wel toe doet: een interne identificatiecode die verschijnt in een response die het publieke Fable 5-label behield. De post van de onderzoeker toont geen fallback-melding, een gewijzigd API-modelveld of een fallback-blok — als dat wel zo was, zou het verhaal zijn "de gedocumenteerde fallback werd geactiveerd", niet "An​thropic stuurt stilletjes door". Zonder dat heeft de leak niet aangetoond dat enige zichtbaarheidsgarantie is geschonden, omdat niet is aangetoond wat Kettle is.

Waarom het ertoe doet, zelfs als er niets is veranderd

Vastgezette model-ID's zijn een vertrouwensmechanisme. De documentatie van Anthropic belooft dat {{1}}"wanneer je een model-ID gebruikt in een API-aanvraag, het onderliggende model constant blijft gedurende de levensduur van dat ID"{{/1}} — de hele reden waarom een team kan benchmarken tegen claude-fable-5 en kan verwachten dat het resultaat volgend kwartaal nog iets betekent. Een verborgen identifier onder dat ID, wat die ook is, herinnert eraan dat de garantie gewichten en configuratie dekt, niet het volledige pad van aanvraag tot token. Als er ooit een werkelijk ander model onder een openbaar ID zou draaien zonder dat dit wordt gemeld, zouden elke evaluatie, elke kostenprognose en elke kwaliteitsregressietest die aan dat ID zijn gekoppeld, geruisloos ongeldig worden.

Het facturatieaspect verscherpt het. Claude Fable 5 kost $10 per miljoen invoertokens en $50 per miljoen uitvoertokens — het hoogste gepubliceerde tarief van An​thropic. Als het serveermodel ooit afweek van de gefactureerde ID, wordt de vraag welk tarief van toepassing is en wie dat bepaalt. Het lek biedt geen bewijs dat dit is gebeurd; het punt is alleen dat het handtekeningveld de eerste plaats is waar je naar een teken daarvan zou zoeken.

De timing is ook vermeldenswaard. Dit is het derde signaal van An​thropic in negen dagen: op 7 augustus kondigde het bedrijf aan dat het de biologieclassificator van Fable 5 opnieuw had getraind, waardoor het aantal biologiegerelateerde fallbacks in interne tests met ongeveer 85% daalde; op 14 augustus erkende het Responsible Scaling Policy Risk Report een niet uitgebracht intern "Model 2" dat An​thropic "een merkbare verbetering" noemt ten opzichte van Claude Mythos 5 en dat het bedrijf niet van plan is uit te brengen. Beide zijn verklaringen van de leverancier, maar samen tonen ze dat An​thropic actief de systemen rond Claude Fable 5 verandert — classificatoren op de 7e, een erkende interne opvolger op de 14e — terwijl de claude-fable-5 ID vast blijft staan. Kettle zou hetzelfde soort verhaal zijn, zonder de openbaarmaking.

Wat eraan te doen

Voor API-aanroepers is het praktische standpunt saai en correct: één identifier is geen bewijs van een swap, en er valt nog niets bruikbaars uit het lek te halen. Wat je kunt doen, is je eigen bewijs verzamelen. Log het modelveld op het hoogste niveau en eventuele fallback-blokken op de antwoorden die je daadwerkelijk ontvangt, en houd de token- en kostendelta's in de gaten bij een vaste workload. Als een gedocumenteerde fallback wordt geactiveerd, is dat op precies die plaatsen zichtbaar. Dat is de enige test die er voor je workload toe doet, en die hangt niet af van iemand die An​thropic's handtekeningformaat decodeert.

Als je via OrcaRouter naar Claude Fable 5 routeert, krijg je dezelfde responsevorm terug die An​thropic retourneert, en omdat we de providerlijstprijzen zonder opslag doorgeven, is er geen tweede prijsset om af te stemmen — als An​thropic ooit het tarief van Fable 5 wijzigt, is het nieuwe getal dezelfde dag live aan onze kant. Voor een onbevestigde situatie als deze is de laag-risicomanier om het model te blijven gebruiken zonder een productiepad op een gerucht te zetten, het routeren van een deel van het echte verkeer naar Claude Fable 5 met automatische failover naar een bewezen fallback — Claude Opus 5 voor $5/$25 per miljoen, of een goedkoper coding-tier-model — zodat een kwaliteitsregressie een routeringsbeslissing wordt in plaats van een incident. Dezelfde sleutel, geen tweede contract, en de failover is een routing-DSL-wijziging in plaats van een herschrijving.

A screenshot of the OrcaRouter model page for Claude Fable 5 (anthropic/claude-fable-5) showing the model id, Vision, Tools, JSON and Reasoning capability chips, a 1M-token context window, a 128K max output, text, image and file input with text output, $10.00 per 1M input tokens and $50.00 per 1M output tokens, and a p50 time-to-first-token of 5.65 seconds.

Wat we kijken

• Of An​thropic commentaar levert. De meest nette oplossing is een eenregelige erkenning van wat Kettle en Manatee zijn. Stilte is op zichzelf informatief.

• Een onafhankelijke replicatie. Iemand die de ruwe handtekeningen, de decodeermethode en het afgeleide protobuf-schema publiceert, zou dit omzetten van een persoonlijke visualisatie naar een controleerbare bewering. Tot die tijd is het een 'wat we tot nu toe weten', geen bevinding.

• Het zichtbaarheidsoppervlak. Als claude-fable-5-reacties fallbackmeldingen, een gewijzigd API-modelveld of fallbackblokken gaan tonen, wordt de lezing 'gedocumenteerde fallback' sterker; zo niet, dan de lezing 'ongedocumenteerde route'.

• Een nieuw model-ID. An​thropic's versiebeleid zegt dat een werkelijk nieuwe versie onder een nieuw ID wordt uitgebracht. De duidelijkste bevestiging dat Kettle een echte opvolger is, zou daarom zijn dat An​thropic iets uitbrengt — niet dat er ter plekke wordt omgeleid. Kijk uit naar een claude-fable-5.1 of iets dergelijks.

• Of "Manatee" wordt uitgelegd. Het tweede label is een draad die nog niemand heeft opgepakt.

Veelgestelde vragen

Routeert Anthropic Claude Fable 5 daadwerkelijk naar een ander model?

Niet bewezen. Het lek laat zien dat antwoorden met het label claude-fable-5 een interne identificatie droegen, claude-kettle-e2c95a10-v2-prod, in een ondertekende denk-signatuur. Het toont niet aan dat de gewichten zijn veranderd, dat er een opvolger is uitgerold, of dat een verzoek is gedegradeerd. "Kettle" zou evengoed de naam kunnen zijn van een interne serverimplementatie voor dezelfde Fable 5-snapshot.

Hoe is de Kettle-identificatie gevonden?

Onderzoeker @chetaslua zegt dat ze een protobuf hebben gedecodeerd in het handtekeningveld van de denkblokken van Claude en de modelidentificatie uit veld zes hebben gelezen. De documentatie van An​thropic noemt de handtekening 'opaque' en vertelt ontwikkelaars deze niet te parseren, en de decodemethode van de onderzoeker is niet gepubliceerd, dus de bewering is nog niet onafhankelijk reproduceerbaar.

Schendt dit de garantie voor vastgepinde modellen van An​thropic?

Onbekend. An​thropic's versiebeheerdocumentatie zegt dat het nooit de gewichten of configuratie van een bestaand model-ID bijwerkt en dat nieuwe versies onder een nieuw ID worden uitgebracht — maar ze staan expliciet toe dat de serverinfrastructuur rond een model (de requestrouter, veiligheidsclassificatoren, samplinglogica) verandert. Een Kettle-identificatiecode zou precies zo'n wijziging kunnen zijn, die de garantie niet zou schenden.

Hoe zou ik weten of het model dat mij bedient is veranderd?

Let op het modelveld op het hoogste niveau in API-antwoorden, zoek naar fallback-contentblokken en volg token- en kostverschillen op een vaste werklast. De gedocumenteerde fallbacks van An​thropic zijn bedoeld om op die plaatsen zichtbaar te zijn. Er is geen openbaar API-veld dat de Kettle-identificatiecode blootlegt.

De eerlijke lezing is dat een lek iets een naam heeft gegeven, niet bewezen heeft wat het is. De Kettle-identifier is alleen echt in de zin waarin een gelekte string echt kan zijn: een onderzoeker zegt dat het er is, 2.582 van de 2.582 keer, vanaf de nacht van 16 augustus. Waar het naar verwijst — een nieuw model, een hernoemde deployment, een routercomponent, een classifier — blijft ongeverifieerd, en de eigen documentatie van An​thropic biedt een volkomen alledaagse verklaring voor het geheel. Dat is de waarde van het stuk en de beperking ervan. Totdat een ruwe handtekening wordt gepubliceerd of An​thropic zegt wat Kettle is, is de juiste houding om het te behandelen als een 'wat we tot nu toe weten': de moeite waard om te volgen, de moeite waard om je eigen verkeer voor te loggen, en niet de moeite waard om je modelkeuze voor te wijzigen — vooral wanneer een routeringslaag je de optie in beide gevallen open laat houden.

Vergeleken in dit artikel1

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt

© 2026 OrcaRouter

Voor aanbieders

Beheer je een inferentieplatform? Zet je modellen op OrcaRouter.

providers@orcarouter.ai

Word lid van de community

Discordsupport@orcarouter.aiXGitHubYouTube