Hero-titelkort för artikeln 'Claude Fable 5 Kettle Route' med en LÄCKAGERAPPORT-märkning, underrubriken 'Det interna modell-ID:t som hittats i signerade tankesignaturer — vad vi vet hittills', tre chips som läser 'Overifierad: @chetaslua', '16 aug 2026' och 'claude-kettle-e2c95a10-v2-prod', ett 'Påståendet'-kort som noterar att svar märkta claude-fable-5 bar en intern Kettle-identifierare, och ett 'Förbehållet'-kort som noterar att bevisen inte bevisar ett modellbyte. OrcaRouter-logotypen är kompositerad i nedre högra hörnet.
Guides & Insights

Claude Fable 5:s "Kettle"-läcka: Det interna modell-ID:t dolt i signerat tänkande — vad vi vet hittills

Författare

Elias Hawthorne

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Den 16 augusti klockan 23.29.45 PDT lade en forskare på X upp ett påstående som förvandlade ett föga glamouröst hörn av An​thropics API till en ”det vi vet hittills”-berättelse: avkoda den serversignerade ”signaturen” som följer med varje Claude-tänkandeblock, sade de, och få sex namn på den modell som faktiskt svarade dig. Enligt deras läsning började svar som offentligt märkts claude-fable-5 – Mythos-klassens Claude Fable 5, som An​thropic har levererat brett sedan 9 juni 2026 för 10/50 dollar per miljon tokens – bära en intern identifierare som inte förekommer någonstans i An​thropics offentliga dokumentation: claude-kettle-e2c95a10-v2-prod. Ingenting med svarsetiketten ändrades. Ingenting med faktureringen, API:ets toppnivåfält för modell eller An​thropics garanti för fasta ögonblicksbilder visades heller ändras. Det som ändrades var en sträng gömd i ett fält som dokumentationen uttryckligen uppmanar utvecklare att inte tolka.

Detta är en läckrapport, inte en dom. Rönet är fyra dagar gammalt, det vilar på en enda forskares avkodning som inte har oberoende reproducerats, och An​thropic har inte kommenterat vad "Kettle" — eller dess medföljande etikett MYCRO_MODEL_MANATEE — syftar på. Den användbara frågan är inte "bytte An​thropic ut Fable 5?" Bevisen fastställer inte det. Den användbara frågan är vad ett internt modell-ID som visas under ett offentligt modell-ID skulle betyda om det vore verkligt, och vad det inte skulle betyda. Här är vad vi vet hittills.

Vad läckan faktiskt fann

Signalen är ett enda X-inlägg från @chetaslua (status 2089783170896179632, publicerat 16 augusti 2026), skrivet i kontots vanliga "first with proof"-stil. Sammanfattningsvis är påståendet:

• Claudes tankeblock bär en serverundertecknad protobuf i signaturfältet.

• Fält sex i den protobuffern, enligt forskaren, innehåller identifieraren för den modell som faktiskt producerade svaret.

• Från och med klockan 23:29:45 PDT den 16 augusti bar 2 582 av 2 582 samplade signaturer samma värde: claude-kettle-e2c95a10-v2-prod.

• En andra intern etikett, MYCRO_MODEL_MANATEE, förekom också i samma metadata.

Siffran "2,582 av 2,582" gör det retoriska arbetet: det är forskarens bevis för att detta inte var en engångsföreteelse eller en A/B-del utan ett fullständigt byte av vad identifieraren pekar på. Vad inlägget inte innehåller är metoden bakom avkodningen – inga råa signaturer, inget avkodningsskript, inget härlett protobuf-schema, ingen fullständig svarsmetadata. Den offentliga bevisningen är en sammanfattande grafik. Det gör fyndet trovärdigt och samtidigt för närvarande overifierbart.

A two-column infographic titled 'Claude Fable 5 Kettle — what we know / what we don't'. Left column 'What we know': 'Aug 16, 2026 — 2,582 of 2,582 signatures carry an internal Kettle identifier', 'Response label stayed claude-fable-5', 'Fable 5 GA since June 9, 2026 at $10/$50 per 1M'. Right column 'What we don't': 'Whether weights changed', 'Whether Kettle is a new model or a serving deployment', 'What MYCRO_MODEL_MANATEE refers to'. Footer: 'Single researcher signal; not independently reproduced; Anthropic has not commented.'

Varför har signaturen ens ett "fält sex"

Varje tankeblock som Claude returnerar har ett signaturfält. Enligt An​thropics tankedokumentation är den signaturen ”en krypterad kopia av hela resonemanget” som du ska skicka tillbaka oförändrad i flervarvs- och verktygsanvändningskonversationer, och API:et använder den ”för att verifiera att tankeblocken genererades av Claude.” På Claude Fable 5 gör standardbeteendet signaturen till det enda synliga spåret: med display inställd på ”omitted” — standard på Fable 5, Mythos 5, Opus 5 och Sonnet 5 — kommer tankeblocket tillbaka med ett tomt tankefält och endast signaturen ifylld.

Dokumentationen lägger sedan till en mening som är relevant för alla läckor som bygger på detta fält: "Signaturfältet är ogenomskinligt: tolka eller pars:a det inte." Att pars:a det är precis vad Kettle-påståendet gör. Det är inte ett bevis för att påståendet är fel — signaturen måste vara maskinläsbar för An​thropics egen serveringsstack — men det innebär att avkodningen utfördes mot leverantörens uttryckliga instruktion, på ett odokumenterat protokoll, och forskarens rekonstruktion av detta protokoll har inte publicerats. Varje slutsats som bygger på "fält sex betyder serveringsmodellen" ärver den osäkerheten.

Vad det inte bevisar

Börja med vad bevisen faktiskt är: ett svar som offentligt märkts som claude-fable-5 bar en tidigare ej rapporterad intern identifierare. Det är allt. Identifieraren i sig fastställer inte att An​thropic ersatte Fable 5:s vikter, att en mer kapabel efterföljare finns, att svaren blev bättre eller sämre, eller att någon begäran dirigerades till en mindre modell. "Kettle" skulle kunna vara ett internt driftsättningsnamn för just samma Fable 5-ögonblicksbild; det skulle kunna vara namnet på en routerkomponent; det skulle kunna vara en klassificerare i säkerhetsstacken. Kodnamnet kan inte skilja mellan dessa.

Anthropics egen versionspolicy förklarar varför läckan är förenlig med att ingenting har ändrats. Från dokumentationen "Model IDs and versioning" finns två påståenden sida vid sida:

• "An​thropic uppdaterar inte vikterna eller konfigurationen för en befintlig modell-ID. När en uppdaterad version finns tillgänglig, levereras den under ett nytt modell-ID."

Modellvikterna är fasta för ett givet ID, men serveringsinfrastrukturen runt modellen kan förändras över tid. Denna infrastruktur inkluderar komponenter såsom begäranderouttern, säkerhetsklassificerare och samplingslogik.

A screenshot of Anthropic's 'Model IDs and versioning' documentation page showing the statement that each Claude model ID identifies a pinned version of the model and that the underlying model remains constant for the lifetime of that ID, alongside the dateless model ID format examples such as claude-sonnet-5 and claude-opus-5.

Den andra meningen är hela det konceptuella gapet mellan "Kettle är en skandal" och "Kettle är en vanlig måndag." Dokumentationen förutser till och med beteendedrift: "Ibland ger infrastrukturuppdateringar mindre skillnader i observerbart beteende även när modell-ID:t och vikterna inte har ändrats." En ny router eller serving-driftsättning med namnet Kettle skulle passa exakt in i den meningen. För att läckan ska vara genuint förödande skulle den behöva visa antingen en ny modell bakom ID:t trots policyn, eller en mekanism som bröt mot synlighetsreglerna nedan.

Den dokumenterade fallback-routningen Fable 5 har redan

Claude Fable 5 levereras redan med en modellväxlingsmekanism som är verklig, dokumenterad och avsedd att vara synlig. Säkerhetsklassificerare inspekterar förfrågningar och kan dirigera en delmängd — An​thropic nämner offensiv cybersäkerhet, dual-use-biologi, modelldestillering och visst frontlinjearbete med chiptillverkning — till en Claude Opus 5-modell. På konsumentytor ska fallbacken vara tydlig: ett meddelande, namnet på den serverande modellen i svaret, och modellväljaren som växlar till Opus. I API:et exponerar svaret den serverande modellen genom det övergripande modellfältet och ett dedikerat fallback-innehållsblock.

Kettle-påståendet beskriver något annat, och skillnaden är den del som skulle ha betydelse: en intern identifierare som visas under ett svar som behöll den offentliga etiketten Fable 5. Forskarens inlägg visar inte något fallback-meddelande, ett ändrat API-modellfält eller ett fallback-block — om det hade gjort det skulle historien vara ”den dokumenterade fallbacken utlöstes”, inte ”An​thropic dirigerar i tysthet”. Utan det har läckan inte visat att någon synlighetsgaranti har brutits, eftersom den inte har visat vad Kettle är.

Varför det spelar roll även om ingenting har förändrats

Pinnade modell-ID:n är en förtroendemekanism. An​thropics dokumentation lovar att "när du använder ett modell-ID i en API-begäran förblir den underliggande modellen konstant under det ID:ets livslängd" — hela anledningen till att ett team kan benchmarka mot claude-fable-5 och förvänta sig att resultatet betyder något nästa kvartal. En dold identifierare under det ID:et, vad den än är, är en påminnelse om att garantin täcker vikter och konfiguration, inte hela vägen från begäran till token. Om en genuint annorlunda modell någonsin kördes under ett offentligt ID utan avslöjande, skulle varje utvärdering, varje kostnadsprognos och varje kvalitetsregressionstest kopplat till det ID:et tyst vara ogiltiga.

Faktureringsvinkeln skärper det. Claude Fable 5 kostar 10 dollar per miljon inmatningstokens och 50 dollar per miljon utmatningstokens — An​thropics högsta publicerade pris. Om den serverande modellen någonsin skilde sig från det fakturerade ID:t, blir frågan vilken taxa som gäller och vem som bestämmer. Läckan ger inga bevis för att det hände; poängen är bara att signaturfältet är där man först skulle titta efter ett tecken på det.

Tajmingen är också värd att notera. Detta är den tredje signalen från An​thropic på nio dagar: den 7 augusti meddelade företaget att man hade tränat om Fable 5:s biologiklassificerare, vilket minskade biologirelaterade fallbacks med cirka 85 % i interna tester; den 14 augusti erkände dess Responsible Scaling Policy Risk Report en intern, ej utgiven "Model 2" som An​thropic kallar "en märkbar förbättring" jämfört med Claude Mythos 5 och som man inte planerar att släppa. Båda är leverantörsuttalanden, men tillsammans visar de hur An​thropic aktivt förändrar systemen kring Claude Fable 5 — klassificerare den 7:e, en erkänd intern efterträdare den 14:e — samtidigt som man håller claude-fable-5-ID:t oförändrat. Kettle skulle vara samma sorts historia, minus avslöjandet.

Vad man kan göra åt det

För API-anropare är den praktiska ståndpunkten tråkig och korrekt: en identifierare är inte bevis på ett modellbyte, och det finns inget åtgärdbart i läckan ännu. Det du kan göra är att skapa egna bevis. Logga det översta modellfältet och eventuella fallback-block på de svar du faktiskt får, och bevaka token- och kostnadsdifferenser på en fast arbetsbelastning. Om en dokumenterad fallback utlöses kommer den att synas på exakt de ställena. Det är det enda test som spelar roll för din arbetsbelastning, och det beror inte på att någon avkodar An​thropics signaturformat.

Om du dirigerar till Claude Fable 5 via OrcaRouter kommer samma svarsstruktur tillbaka som An​thropic returnerar, och eftersom vi förmedlar leverantörens listpriser utan påslag finns det ingen andra prisuppsättning att stämma av — om An​thropic någonsin ändrar Fable 5:s pris, är det nya priset live hos oss samma dag. För en overifierad situation som den här är det lågrisk sättet att fortsätta använda modellen utan att satsa en produktionsväg på ett rykte att dirigera en del av den verkliga trafiken till Claude Fable 5 med automatisk växling till en beprövad reserv — Claude Opus 5 för $5/$25 per miljon, eller en billigare kodningsnivåmodell — så att en kvalitetsförsämring blir ett dirigeringsbeslut istället för en incident. Samma nyckel, inget andra kontrakt, och växlingen är en ändring i routing-DSL snarare än en omskrivning.

A screenshot of the OrcaRouter model page for Claude Fable 5 (anthropic/claude-fable-5) showing the model id, Vision, Tools, JSON and Reasoning capability chips, a 1M-token context window, a 128K max output, text, image and file input with text output, $10.00 per 1M input tokens and $50.00 per 1M output tokens, and a p50 time-to-first-token of 5.65 seconds.

Vad vi tittar på

• Huruvida An​thropic kommenterar. Den renaste lösningen är en enradig bekräftelse av vad Kettle och Manatee är. Tystnaden är i sig informativ.

• En oberoende reproduktion. Om någon publicerar råa signaturer, avkodningsmetoden och det härledda protobuf-schemat skulle det förvandla detta från en persons grafik till ett verifierbart påstående. Tills dess är det ett vad-vi-vet-hittills, inte ett fynd.

• Synlighetsytan. Om claude-fable-5-svar börjar visa fallback-meddelanden, ett ändrat API-modellfält eller fallback-block, blir tolkningen "dokumenterad fallback" starkare; om inte, blir tolkningen "odokumenterad väg" starkare.

• Ett nytt modell-ID. An​thropics versionspolicy säger att en genuint ny version släpps under ett nytt ID. Den tydligaste bekräftelsen på att Kettle är en verklig efterföljare skulle därför vara att An​thropic släpper något — inte att de omdirigerar på plats. Håll utkik efter en claude-fable-5.1 eller liknande.

• Huruvida "Manatee" förklaras. Den andra etiketten är en tråd som ingen har dragit i än.

FAQ

Routar An​thropic faktiskt Claude Fable 5 till en annan modell?

Inte bevisat. Läckan visar att svar märkta med claude-fable-5 bar en intern identifierare, claude-kettle-e2c95a10-v2-prod, i en signerad tänkande-signatur. Den visar inte att vikterna ändrats, att en efterföljare distribuerats, eller att någon förfrågan nedgraderats. "Kettle" skulle lika gärna kunna vara namnet på en intern serveringsdistribution för samma Fable 5-ögonblicksbild.

Hur hittades Kettle-identifieraren?

Forskaren @chetaslua säger sig ha avkodat en protobuf i signaturfältet i Claudes tankeblock och utläst modellidentifieraren från fält sex. Anthropics dokumentation kallar signaturen "ogenomskinlig" och säger åt utvecklare att inte parsa den, och forskarens avkodningsmetod har inte publicerats, så påståendet är ännu inte oberoende reproducerbart.

Strider detta mot An​thropics garanti för fast modell?

Okänt. Anthropics versionsdokumentation säger att de aldrig uppdaterar vikterna eller konfigurationen för ett befintligt modell-ID och att nya versioner levereras under ett nytt ID — men de tillåter uttryckligen att serveringsinfrastrukturen kring en modell (request-routern, säkerhetsklassificerarna, samplingslogiken) ändras. En Kettle-identifierare skulle kunna vara exakt en sådan ändring, vilket inte skulle bryta mot garantin.

Hur skulle jag veta om modellen som betjänar mig har ändrats?

Bevaka modellfältet på toppnivå i API-svar, leta efter fallback-innehållsblock och spåra token- och kostnadsförändringar på en fast arbetsbelastning. An​thropics dokumenterade fallbacks är avsedda att vara synliga på dessa platser. Det finns inget offentligt API-fält som exponerar Kettle-identifieraren.

Den ärliga läsningen är att ett läckage har namngett något, inte bevisat vad det är. Kettle-identifieraren är verklig på det enda sätt en läckt sträng kan vara: en forskare säger att den finns där, 2 582 av 2 582 gånger, med början natten till den 16 augusti. Vad den pekar på — en ny modell, en omdöpt driftsättning, en routerkomponent, en klassificerare — förblir overifierat, och An​thropics egen dokumentation erbjuder en fullt vardaglig förklaring till det hela. Det är artikelns värde och dess begränsning. Tills en rå signatur publiceras eller An​thropic berättar vad Kettle är, är rätt hållning att behandla det som ett vad-vi-vet-hittills: värt att bevaka, värt att logga sin egen trafik för, och inte värt att ändra sitt modellval för — särskilt när ett routingskikt låter dig hålla alternativet öppet åt båda hållen.

Jämförda i den här artikeln1

Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen

© 2026 OrcaRouter

För leverantörer

Driver du en inferensplattform? Få dina modeller på OrcaRouter.

providers@orcarouter.ai

Gå med i vår community

Discordsupport@orcarouter.aiXGitHubYouTube