
Claude Fable 5:s "Kettle"-läcka: Det interna modell-ID:t dolt i signerat tänkande — vad vi vet hittills
- z-aiNYZ.ai: GLM 5.32026-08-1860Intelligens75Kodning
- obsidianNYQwen3.8 27B Uncensored (Aggressive)2026-08-1552Intelligens68Kodning
- qwenNYQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNYDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligens69Kodning
- grokNYSpaceXAI: Grok 4.62026-08-1261Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0557Intelligens72Kodning
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligens72Kodning
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligens69Kodning
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligens78Kodning
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligens69Kodning
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligens49Kodning
- metaMeta: Muse Spark 1.12026-07-1653Intelligens71Kodning
- kimiMoonshotAI: Kimi K32026-07-1560Intelligens76Kodning
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligens71Kodning
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligens77Kodning
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligens77Kodning
- grokxAI: Grok 4.52026-07-0856Intelligens72Kodning
Den 16 augusti klockan 23.29.45 PDT lade en forskare på X upp ett påstående som förvandlade ett föga glamouröst hörn av Anthropics API till en ”det vi vet hittills”-berättelse: avkoda den serversignerade ”signaturen” som följer med varje Claude-tänkandeblock, sade de, och få sex namn på den modell som faktiskt svarade dig. Enligt deras läsning började svar som offentligt märkts claude-fable-5 – Mythos-klassens Claude Fable 5, som Anthropic har levererat brett sedan 9 juni 2026 för 10/50 dollar per miljon tokens – bära en intern identifierare som inte förekommer någonstans i Anthropics offentliga dokumentation: claude-kettle-e2c95a10-v2-prod. Ingenting med svarsetiketten ändrades. Ingenting med faktureringen, API:ets toppnivåfält för modell eller Anthropics garanti för fasta ögonblicksbilder visades heller ändras. Det som ändrades var en sträng gömd i ett fält som dokumentationen uttryckligen uppmanar utvecklare att inte tolka.
Detta är en läckrapport, inte en dom. Rönet är fyra dagar gammalt, det vilar på en enda forskares avkodning som inte har oberoende reproducerats, och Anthropic har inte kommenterat vad "Kettle" — eller dess medföljande etikett MYCRO_MODEL_MANATEE — syftar på. Den användbara frågan är inte "bytte Anthropic ut Fable 5?" Bevisen fastställer inte det. Den användbara frågan är vad ett internt modell-ID som visas under ett offentligt modell-ID skulle betyda om det vore verkligt, och vad det inte skulle betyda. Här är vad vi vet hittills.
Vad läckan faktiskt fann
Signalen är ett enda X-inlägg från @chetaslua (status 2089783170896179632, publicerat 16 augusti 2026), skrivet i kontots vanliga "first with proof"-stil. Sammanfattningsvis är påståendet:
• Claudes tankeblock bär en serverundertecknad protobuf i signaturfältet.
• Fält sex i den protobuffern, enligt forskaren, innehåller identifieraren för den modell som faktiskt producerade svaret.
• Från och med klockan 23:29:45 PDT den 16 augusti bar 2 582 av 2 582 samplade signaturer samma värde: claude-kettle-e2c95a10-v2-prod.
• En andra intern etikett, MYCRO_MODEL_MANATEE, förekom också i samma metadata.
Siffran "2,582 av 2,582" gör det retoriska arbetet: det är forskarens bevis för att detta inte var en engångsföreteelse eller en A/B-del utan ett fullständigt byte av vad identifieraren pekar på. Vad inlägget inte innehåller är metoden bakom avkodningen – inga råa signaturer, inget avkodningsskript, inget härlett protobuf-schema, ingen fullständig svarsmetadata. Den offentliga bevisningen är en sammanfattande grafik. Det gör fyndet trovärdigt och samtidigt för närvarande overifierbart.

Varför har signaturen ens ett "fält sex"
Varje tankeblock som Claude returnerar har ett signaturfält. Enligt Anthropics tankedokumentation är den signaturen ”en krypterad kopia av hela resonemanget” som du ska skicka tillbaka oförändrad i flervarvs- och verktygsanvändningskonversationer, och API:et använder den ”för att verifiera att tankeblocken genererades av Claude.” På Claude Fable 5 gör standardbeteendet signaturen till det enda synliga spåret: med display inställd på ”omitted” — standard på Fable 5, Mythos 5, Opus 5 och Sonnet 5 — kommer tankeblocket tillbaka med ett tomt tankefält och endast signaturen ifylld.
Dokumentationen lägger sedan till en mening som är relevant för alla läckor som bygger på detta fält: "Signaturfältet är ogenomskinligt: tolka eller pars:a det inte." Att pars:a det är precis vad Kettle-påståendet gör. Det är inte ett bevis för att påståendet är fel — signaturen måste vara maskinläsbar för Anthropics egen serveringsstack — men det innebär att avkodningen utfördes mot leverantörens uttryckliga instruktion, på ett odokumenterat protokoll, och forskarens rekonstruktion av detta protokoll har inte publicerats. Varje slutsats som bygger på "fält sex betyder serveringsmodellen" ärver den osäkerheten.
Vad det inte bevisar
Börja med vad bevisen faktiskt är: ett svar som offentligt märkts som claude-fable-5 bar en tidigare ej rapporterad intern identifierare. Det är allt. Identifieraren i sig fastställer inte att Anthropic ersatte Fable 5:s vikter, att en mer kapabel efterföljare finns, att svaren blev bättre eller sämre, eller att någon begäran dirigerades till en mindre modell. "Kettle" skulle kunna vara ett internt driftsättningsnamn för just samma Fable 5-ögonblicksbild; det skulle kunna vara namnet på en routerkomponent; det skulle kunna vara en klassificerare i säkerhetsstacken. Kodnamnet kan inte skilja mellan dessa.
Anthropics egen versionspolicy förklarar varför läckan är förenlig med att ingenting har ändrats. Från dokumentationen "Model IDs and versioning" finns två påståenden sida vid sida:
• "Anthropic uppdaterar inte vikterna eller konfigurationen för en befintlig modell-ID. När en uppdaterad version finns tillgänglig, levereras den under ett nytt modell-ID."
Modellvikterna är fasta för ett givet ID, men serveringsinfrastrukturen runt modellen kan förändras över tid. Denna infrastruktur inkluderar komponenter såsom begäranderouttern, säkerhetsklassificerare och samplingslogik.

Den andra meningen är hela det konceptuella gapet mellan "Kettle är en skandal" och "Kettle är en vanlig måndag." Dokumentationen förutser till och med beteendedrift: "Ibland ger infrastrukturuppdateringar mindre skillnader i observerbart beteende även när modell-ID:t och vikterna inte har ändrats." En ny router eller serving-driftsättning med namnet Kettle skulle passa exakt in i den meningen. För att läckan ska vara genuint förödande skulle den behöva visa antingen en ny modell bakom ID:t trots policyn, eller en mekanism som bröt mot synlighetsreglerna nedan.
Den dokumenterade fallback-routningen Fable 5 har redan
Claude Fable 5 levereras redan med en modellväxlingsmekanism som är verklig, dokumenterad och avsedd att vara synlig. Säkerhetsklassificerare inspekterar förfrågningar och kan dirigera en delmängd — Anthropic nämner offensiv cybersäkerhet, dual-use-biologi, modelldestillering och visst frontlinjearbete med chiptillverkning — till en Claude Opus 5-modell. På konsumentytor ska fallbacken vara tydlig: ett meddelande, namnet på den serverande modellen i svaret, och modellväljaren som växlar till Opus. I API:et exponerar svaret den serverande modellen genom det övergripande modellfältet och ett dedikerat fallback-innehållsblock.
Kettle-påståendet beskriver något annat, och skillnaden är den del som skulle ha betydelse: en intern identifierare som visas under ett svar som behöll den offentliga etiketten Fable 5. Forskarens inlägg visar inte något fallback-meddelande, ett ändrat API-modellfält eller ett fallback-block — om det hade gjort det skulle historien vara ”den dokumenterade fallbacken utlöstes”, inte ”Anthropic dirigerar i tysthet”. Utan det har läckan inte visat att någon synlighetsgaranti har brutits, eftersom den inte har visat vad Kettle är.
Varför det spelar roll även om ingenting har förändrats
Pinnade modell-ID:n är en förtroendemekanism. Anthropics dokumentation lovar att "när du använder ett modell-ID i en API-begäran förblir den underliggande modellen konstant under det ID:ets livslängd" — hela anledningen till att ett team kan benchmarka mot claude-fable-5 och förvänta sig att resultatet betyder något nästa kvartal. En dold identifierare under det ID:et, vad den än är, är en påminnelse om att garantin täcker vikter och konfiguration, inte hela vägen från begäran till token. Om en genuint annorlunda modell någonsin kördes under ett offentligt ID utan avslöjande, skulle varje utvärdering, varje kostnadsprognos och varje kvalitetsregressionstest kopplat till det ID:et tyst vara ogiltiga.
Faktureringsvinkeln skärper det. Claude Fable 5 kostar 10 dollar per miljon inmatningstokens och 50 dollar per miljon utmatningstokens — Anthropics högsta publicerade pris. Om den serverande modellen någonsin skilde sig från det fakturerade ID:t, blir frågan vilken taxa som gäller och vem som bestämmer. Läckan ger inga bevis för att det hände; poängen är bara att signaturfältet är där man först skulle titta efter ett tecken på det.
Tajmingen är också värd att notera. Detta är den tredje signalen från Anthropic på nio dagar: den 7 augusti meddelade företaget att man hade tränat om Fable 5:s biologiklassificerare, vilket minskade biologirelaterade fallbacks med cirka 85 % i interna tester; den 14 augusti erkände dess Responsible Scaling Policy Risk Report en intern, ej utgiven "Model 2" som Anthropic kallar "en märkbar förbättring" jämfört med Claude Mythos 5 och som man inte planerar att släppa. Båda är leverantörsuttalanden, men tillsammans visar de hur Anthropic aktivt förändrar systemen kring Claude Fable 5 — klassificerare den 7:e, en erkänd intern efterträdare den 14:e — samtidigt som man håller claude-fable-5-ID:t oförändrat. Kettle skulle vara samma sorts historia, minus avslöjandet.
Vad man kan göra åt det
För API-anropare är den praktiska ståndpunkten tråkig och korrekt: en identifierare är inte bevis på ett modellbyte, och det finns inget åtgärdbart i läckan ännu. Det du kan göra är att skapa egna bevis. Logga det översta modellfältet och eventuella fallback-block på de svar du faktiskt får, och bevaka token- och kostnadsdifferenser på en fast arbetsbelastning. Om en dokumenterad fallback utlöses kommer den att synas på exakt de ställena. Det är det enda test som spelar roll för din arbetsbelastning, och det beror inte på att någon avkodar Anthropics signaturformat.
Om du dirigerar till Claude Fable 5 via OrcaRouter kommer samma svarsstruktur tillbaka som Anthropic returnerar, och eftersom vi förmedlar leverantörens listpriser utan påslag finns det ingen andra prisuppsättning att stämma av — om Anthropic någonsin ändrar Fable 5:s pris, är det nya priset live hos oss samma dag. För en overifierad situation som den här är det lågrisk sättet att fortsätta använda modellen utan att satsa en produktionsväg på ett rykte att dirigera en del av den verkliga trafiken till Claude Fable 5 med automatisk växling till en beprövad reserv — Claude Opus 5 för $5/$25 per miljon, eller en billigare kodningsnivåmodell — så att en kvalitetsförsämring blir ett dirigeringsbeslut istället för en incident. Samma nyckel, inget andra kontrakt, och växlingen är en ändring i routing-DSL snarare än en omskrivning.

Vad vi tittar på
• Huruvida Anthropic kommenterar. Den renaste lösningen är en enradig bekräftelse av vad Kettle och Manatee är. Tystnaden är i sig informativ.
• En oberoende reproduktion. Om någon publicerar råa signaturer, avkodningsmetoden och det härledda protobuf-schemat skulle det förvandla detta från en persons grafik till ett verifierbart påstående. Tills dess är det ett vad-vi-vet-hittills, inte ett fynd.
• Synlighetsytan. Om claude-fable-5-svar börjar visa fallback-meddelanden, ett ändrat API-modellfält eller fallback-block, blir tolkningen "dokumenterad fallback" starkare; om inte, blir tolkningen "odokumenterad väg" starkare.
• Ett nytt modell-ID. Anthropics versionspolicy säger att en genuint ny version släpps under ett nytt ID. Den tydligaste bekräftelsen på att Kettle är en verklig efterföljare skulle därför vara att Anthropic släpper något — inte att de omdirigerar på plats. Håll utkik efter en claude-fable-5.1 eller liknande.
• Huruvida "Manatee" förklaras. Den andra etiketten är en tråd som ingen har dragit i än.
FAQ
Routar Anthropic faktiskt Claude Fable 5 till en annan modell?
Inte bevisat. Läckan visar att svar märkta med claude-fable-5 bar en intern identifierare, claude-kettle-e2c95a10-v2-prod, i en signerad tänkande-signatur. Den visar inte att vikterna ändrats, att en efterföljare distribuerats, eller att någon förfrågan nedgraderats. "Kettle" skulle lika gärna kunna vara namnet på en intern serveringsdistribution för samma Fable 5-ögonblicksbild.
Hur hittades Kettle-identifieraren?
Forskaren @chetaslua säger sig ha avkodat en protobuf i signaturfältet i Claudes tankeblock och utläst modellidentifieraren från fält sex. Anthropics dokumentation kallar signaturen "ogenomskinlig" och säger åt utvecklare att inte parsa den, och forskarens avkodningsmetod har inte publicerats, så påståendet är ännu inte oberoende reproducerbart.
Strider detta mot Anthropics garanti för fast modell?
Okänt. Anthropics versionsdokumentation säger att de aldrig uppdaterar vikterna eller konfigurationen för ett befintligt modell-ID och att nya versioner levereras under ett nytt ID — men de tillåter uttryckligen att serveringsinfrastrukturen kring en modell (request-routern, säkerhetsklassificerarna, samplingslogiken) ändras. En Kettle-identifierare skulle kunna vara exakt en sådan ändring, vilket inte skulle bryta mot garantin.
Hur skulle jag veta om modellen som betjänar mig har ändrats?
Bevaka modellfältet på toppnivå i API-svar, leta efter fallback-innehållsblock och spåra token- och kostnadsförändringar på en fast arbetsbelastning. Anthropics dokumenterade fallbacks är avsedda att vara synliga på dessa platser. Det finns inget offentligt API-fält som exponerar Kettle-identifieraren.
Den ärliga läsningen är att ett läckage har namngett något, inte bevisat vad det är. Kettle-identifieraren är verklig på det enda sätt en läckt sträng kan vara: en forskare säger att den finns där, 2 582 av 2 582 gånger, med början natten till den 16 augusti. Vad den pekar på — en ny modell, en omdöpt driftsättning, en routerkomponent, en klassificerare — förblir overifierat, och Anthropics egen dokumentation erbjuder en fullt vardaglig förklaring till det hela. Det är artikelns värde och dess begränsning. Tills en rå signatur publiceras eller Anthropic berättar vad Kettle är, är rätt hållning att behandla det som ett vad-vi-vet-hittills: värt att bevaka, värt att logga sin egen trafik för, och inte värt att ändra sitt modellval för — särskilt när ett routingskikt låter dig hålla alternativet öppet åt båda hållen.
Jämförda i den här artikeln1
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
