Karta tytułowa hero dla artykułu 'Claude Fable 5 Kettle Route' z plakietką RAPORT WYCIEKU, podtytułem 'Wewnętrzny identyfikator modelu znaleziony w podpisanych sygnaturach myślenia — co wiemy do tej pory', trzema chipami z napisami 'Niezweryfikowano: @chetaslua', '16 sierpnia 2026' i 'claude-kettle-e2c95a10-v2-prod', kartą 'Twierdzenie' odnotowującą, że odpowiedzi oznaczone jako claude-fable-5 zawierały wewnętrzny identyfikator Kettle, oraz kartą 'Zastrzeżenie' odnotowującą, że dowody nie potwierdzają zmiany modelu. Logo OrcaRouter jest umieszczone w prawym dolnym rogu.
Guides & Insights

Przeciek "Kettle" dotyczący Claude Fable 5: Wewnętrzny identyfikator modelu ukryty w podpisanym myśleniu — co wiemy do tej pory

Autor

Elias Hawthorne

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

16 sierpnia o 23:29:45 czasu PDT na X pewien badacz opublikował twierdzenie, które zamieniło niepozorny zakątek API An​thropica w historię typu „co wiemy do tej pory”: odkoduj podpisaną przez serwer „sygnaturę”, która towarzyszy każdemu blokowi myślenia Claude’a, jak powiedzieli, a otrzymasz sześć nazw: model, który faktycznie ci odpowiedział. Według ich interpretacji odpowiedzi publicznie oznaczone jako claude-fable-5 — czyli Claude Fable 5 klasy Mythos, który An​thropic szeroko udostępnia od 9 czerwca 2026 roku w cenie 10/50 dolarów za milion tokenów — zaczęły przenosić wewnętrzny identyfikator, którego nie ma w publicznej dokumentacji An​thropica: claude-kettle-e2c95a10-v2-prod. Nic nie zmieniło się w etykiecie odpowiedzi. Nie wykazano również zmian w rozliczeniach, polu modelu najwyższego poziomu w API ani w gwarancji przypiętej migawki An​thropica. Zmienił się za to ciąg znaków ukryty w polu, którego — jak wprost stwierdza dokumentacja — deweloperzy nie powinni parsować.

To jest raport o wycieku, a nie werdykt. Ustalenie ma cztery dni, opiera się na dekodowaniu jednego badacza, które nie zostało niezależnie odtworzone, a An​thropic nie skomentował, do czego odnosi się „Kettle” — ani towarzysząca mu etykieta MYCRO_MODEL_MANATEE. Właściwe pytanie nie brzmi: „czy An​thropic podmienił Fable 5?” Dowody tego nie wykazują. Właściwe pytanie brzmi: co oznaczałoby, gdyby wewnętrzny identyfikator modelu pojawiający się pod publicznym identyfikatorem modelu był prawdziwy, a czego by nie oznaczał. Oto, co wiemy do tej pory.

Co faktycznie ujawnił przeciek

Sygnał to pojedynczy post na X od @chetaslua (status 2089783170896179632, opublikowany 16 sierpnia 2026), napisany w zwykłym dla tego konta stylu „first with proof". Twierdzenie w skrócie:

Bloki myślowe Claude'a przenoszą podpisany przez serwer protobuf w polu podpisu.

• Pole szóste tego protobufa, jak twierdzi badacz, zawiera identyfikator modelu, który faktycznie wygenerował odpowiedź.

• Począwszy od 16 sierpnia, godz. 23:29:45 czasu pacyficznego (PDT), 2 582 z 2 582 próbkowanych sygnatur miało tę samą wartość: claude-kettle-e2c95a10-v2-prod.

• Druga wewnętrzna etykieta, MYCRO_MODEL_MANATEE, również pojawiła się w tych samych metadanych.

„Liczba «2 582 z 2 582» pełni funkcję retoryczną: jest dowodem badacza, że nie był to jednorazowy przypadek ani wycinek testu A/B, lecz całkowite przełączenie tego, na co wskazuje identyfikator. Tego, czego we wpisie brakuje, to metoda stojąca za odkodowaniem — żadnych surowych podpisów, żadnego skryptu dekodującego, żadnego wywnioskowanego schematu protobuf ani pełnych metadanych odpowiedzi. Publiczny dowód to grafika podsumowująca. To sprawia, że ustalenie jest wiarygodne i jednocześnie na obecną chwilę niemożliwe do zweryfikowania.

A two-column infographic titled 'Claude Fable 5 Kettle — what we know / what we don't'. Left column 'What we know': 'Aug 16, 2026 — 2,582 of 2,582 signatures carry an internal Kettle identifier', 'Response label stayed claude-fable-5', 'Fable 5 GA since June 9, 2026 at $10/$50 per 1M'. Right column 'What we don't': 'Whether weights changed', 'Whether Kettle is a new model or a serving deployment', 'What MYCRO_MODEL_MANATEE refers to'. Footer: 'Single researcher signal; not independently reproduced; Anthropic has not commented.'

Dlaczego podpis w ogóle ma „pole szóste"?

Każdy blok myślenia zwracany przez Claude'a zawiera pole podpisu. Zgodnie z dokumentacją myślenia An​thropica podpis ten to „zaszyfrowana kopia pełnego rozumowania”, którą należy przekazywać bez zmian w rozmowach wieloturowych i z użyciem narzędzi, a API używa go „do weryfikacji, że bloki myślenia zostały wygenerowane przez Claude'a”. W modelu Claude Fable 5 domyślne zachowanie sprawia, że podpis jest jedynym widocznym śladem: gdy parametr display jest ustawiony na „omitted” — co jest ustawieniem domyślnym w modelach Fable 5, Mythos 5, Opus 5 i Sonnet 5 — blok myślenia wraca z pustym polem thinking i jedynie wypełnionym podpisem.

Dokumentacja dodaje następnie zdanie, które ma znaczenie dla każdego wycieku zbudowanego na tym polu: „Pole podpisu jest nieprzezroczyste: nie interpretuj go ani nie parsuj". Parsowanie to właśnie robi twierdzenie Kettle. Nie jest to dowód na to, że twierdzenie jest błędne — podpis musi być czytelny maszynowo dla własnego stosu serwującego An​thropic — ale oznacza to, że dekodowanie zostało przeprowadzone wbrew wyraźnej instrukcji dostawcy, w oparciu o nieudokumentowany protokół, a rekonstrukcja tego protokołu przez badacza nie została opublikowana. Każde wnioskowanie oparte na stwierdzeniu „szóste pole oznacza model serwujący" dziedziczy tę niepewność.

Czego to nie dowodzi

Zacznij od tego, czym faktycznie są dowody: odpowiedź publicznie oznaczona jako claude-fable-5 zawierała niezgłaszany wcześniej wewnętrzny identyfikator. To całość. Sam identyfikator nie dowodzi, że An​thropic zastąpiło wagi Fable 5, że istnieje bardziej zdolny następca, że odpowiedzi stały się lepsze lub gorsze, ani że jakiekolwiek żądanie zostało skierowane do mniejszego modelu. „Kettle” może być wewnętrzną nazwą środowiska serwującego dla tego samego snapshotu Fable 5; może być nazwą komponentu routera; może być klasyfikatorem w warstwie bezpieczeństwa. Kryptonim nie pozwala tego rozróżnić.

Własna polityka wersjonowania Anthropica wyjaśnia, dlaczego wyciek jest zgodny z tym, że nic się nie zmieniło. Z dokumentacji „Model IDs and versioning" dwa stwierdzenia stoją obok siebie:

Anthropic nie aktualizuje wag ani konfiguracji istniejącego identyfikatora modelu. Gdy dostępna jest zaktualizowana wersja, jest wydawana pod nowym identyfikatorem modelu.

Wagi modelu są ustalone dla danego ID, ale infrastruktura serwująca wokół modelu może zmieniać się w czasie. Ta infrastruktura obejmuje komponenty takie jak router żądań, klasyfikatory bezpieczeństwa i logikę próbkowania.

A screenshot of Anthropic's 'Model IDs and versioning' documentation page showing the statement that each Claude model ID identifies a pinned version of the model and that the underlying model remains constant for the lifetime of that ID, alongside the dateless model ID format examples such as claude-sonnet-5 and claude-opus-5.

To drugie zdanie stanowi całą koncepcyjną lukę między „Kettle to skandal” a „Kettle to zwykły poniedziałek”. Dokumentacja nawet przewiduje dryf behawioralny: „Od czasu do czasu aktualizacje infrastruktury powodują niewielkie różnice w obserwowalnym zachowaniu, nawet gdy identyfikator modelu i wagi nie uległy zmianie”. Nowy router lub wdrożenie serwujące o nazwie Kettle idealnie wpasowuje się w to zdanie. Aby przeciek był naprawdę obciążający, musiałby pokazywać albo nowy model za identyfikatorem mimo polityki, albo mechanizm naruszający poniższe zasady widoczności.

Udokumentowane routowanie zapasowe, które Fable 5 już ma

Claude Fable 5 już na starcie zawiera mechanizm przełączania modeli, który jest prawdziwy, udokumentowany i ma być widoczny. Klasyfikatory bezpieczeństwa sprawdzają zapytania i mogą kierować podzbiór — Anthropic wymienia ofensywne cyberbezpieczeństwo, biologię o podwójnym zastosowaniu, destylację modeli oraz część prac nad najbardziej zaawansowanymi chipami — do modelu Claude Opus 5. Na powierzchniach konsumenckich rozwiązanie zastępcze ma być wyraźnie widoczne: komunikat, nazwa obsługującego modelu przy odpowiedzi oraz przełączenie wybieraka modeli na Opus. W API odpowiedź ujawnia obsługujący model przez pole `model` na najwyższym poziomie oraz dedykowany blok treści fallback.

Twierdzenie o Kettle opisuje coś innego, a różnica jest właśnie tą częścią, która miałaby znaczenie: wewnętrzny identyfikator pojawiający się w odpowiedzi, która zachowała publiczną etykietę Fable 5. Post badacza nie pokazuje powiadomienia o mechanizmie awaryjnym, zmienionego pola modelu API ani bloku awaryjnego — gdyby to pokazywał, historia brzmiałaby „udokumentowany mechanizm awaryjny zadziałał”, a nie „An​thropic po cichu przekierowuje”. Bez tego przeciek nie wykazał, że jakakolwiek gwarancja widoczności została naruszona, ponieważ nie wykazał, czym jest Kettle.

Dlaczego to ma znaczenie, nawet jeśli nic się nie zmieniło

Przypięte identyfikatory modeli to mechanizm zaufania. Dokumentacja Anthropica obiecuje, że „gdy używasz identyfikatora modelu w żądaniu API, bazowy model pozostaje stały przez cały okres istnienia tego identyfikatora” — to właśnie powód, dla którego zespół może przeprowadzać benchmarki względem claude-fable-5 i oczekiwać, że wynik będzie coś znaczył w następnym kwartale. Ukryty identyfikator, który znajduje się pod tym ID — cokolwiek to jest — przypomina, że gwarancja obejmuje wagi i konfigurację, a nie całą ścieżkę od żądania do tokenu. Gdyby kiedykolwiek pod publicznym ID działał naprawdę inny model bez ujawnienia tego faktu, każdy eval, każda prognoza kosztów i każdy test regresji jakości powiązane z tym ID byłyby po cichu nieważne.

Aspekt rozliczeniowy wyostrza sprawę. Claude Fable 5 kosztuje 10 dolarów za milion tokenów wejściowych i 50 dolarów za milion tokenów wyjściowych — to najwyższa opublikowana stawka An​thropica. Gdyby model obsługujący żądanie kiedykolwiek różnił się od identyfikatora rozliczeniowego, pojawia się pytanie, która stawka ma zastosowanie i kto o tym decyduje. Przeciek nie dostarcza dowodów, że tak się stało; chodzi tylko o to, że pole podpisu to miejsce, w którym w pierwszej kolejności szukałbyś oznak takiej sytuacji.

Warto też zwrócić uwagę na terminy. To już trzeci sygnał od An​thropica w ciągu dziewięciu dni: 7 sierpnia firma ogłosiła, że ponownie wytrenowała klasyfikator biologii w Fable 5, ograniczając związane z biologią odpowiedzi zastępcze o około 85% w testach wewnętrznych; 14 sierpnia jej Responsible Scaling Policy Risk Report przyznał, że istnieje niewydany wewnętrzny „Model 2”, który An​thropic nazywa „znaczną poprawą” w stosunku do Claude Mythos 5, i którego nie planuje wydać. Oba to oświadczenia dostawcy, ale razem pokazują, że An​thropic aktywnie zmienia systemy wokół Claude Fable 5 — klasyfikatory 7 sierpnia, uznany wewnętrzny następca 14 sierpnia — utrzymując stały identyfikator claude-fable-5. Kettle byłby opowieścią o tym samym kształcie, minus ujawnienie.

Co z tym zrobić

Dla osób wywołujących API praktyczne stanowisko jest nudne i poprawne: jeden identyfikator nie jest dowodem podmiany, a w wycieku nie ma jeszcze niczego, co można by wykorzystać. Co możesz zrobić, to zebrać własne dowody. Rejestruj pole modelu najwyższego poziomu oraz wszelkie bloki awaryjne w odpowiedziach, które faktycznie otrzymujesz, i obserwuj różnice w tokenach i kosztach przy stałym obciążeniu. Jeśli udokumentowany mechanizm awaryjny zadziała, będzie to widoczne dokładnie w tych miejscach. To jedyny test, który ma znaczenie dla Twojego obciążenia, i nie zależy od tego, czy ktokolwiek dekoduje format podpisu An​thropic.

Jeśli kierujesz ruch do Claude Fable 5 przez OrcaRouter, otrzymujesz ten sam kształt odpowiedzi, który zwraca Anthropic, a ponieważ przekazujemy ceny katalogowe dostawcy bez żadnej marży, nie ma drugiego zestawu cen do uzgodnienia — jeśli Anthropic kiedykolwiek zmieni stawkę Fable 5, nowa liczba jest dostępna po naszej stronie tego samego dnia. W przypadku niezweryfikowanej sytuacji, takiej jak ta, niskoryzykownym sposobem na dalsze korzystanie z modelu bez stawiania ścieżki produkcyjnej na plotce jest skierowanie fragmentu rzeczywistego ruchu do Claude Fable 5 z automatycznym przełączeniem awaryjnym na sprawdzone rozwiązanie zastępcze — Claude Opus 5 w cenie 5/25 dolarów za milion, lub tańszy model z warstwy kodowania — tak aby regresja jakości stała się decyzją routingową, a nie incydentem. Ten sam klucz, bez drugiej umowy, a przełączenie awaryjne to zmiana w routing-DSL, a nie przepisanie.

A screenshot of the OrcaRouter model page for Claude Fable 5 (anthropic/claude-fable-5) showing the model id, Vision, Tools, JSON and Reasoning capability chips, a 1M-token context window, a 128K max output, text, image and file input with text output, $10.00 per 1M input tokens and $50.00 per 1M output tokens, and a p50 time-to-first-token of 5.65 seconds.

Co oglądamy

• Czy Anthropic skomentuje. Najczystszym rozwiązaniem jest jednowierszowe potwierdzenie tego, czym są Kettle i Manatee. Cisza sama w sobie jest informacyjna.

• Niezależna reprodukcja. Gdyby ktoś opublikował surowe podpisy, metodę dekodowania i wywnioskowany schemat protobuf, przeniosłoby to sprawę z czyjejś grafiki do weryfikowalnego twierdzenia. Do tego czasu jest to tylko stan obecnej wiedzy, a nie ustalenie.

• Powierzchnia widoczności. Jeśli odpowiedzi claude-fable-5 zaczną pokazywać powiadomienia o fallbacku, zmienione pole modelu API lub bloki fallbacku, interpretacja „udokumentowanego fallbacku” staje się silniejsza; jeśli nie – interpretacja „nieudokumentowanej trasy”.

• Nowy identyfikator modelu. Zasady wersjonowania An​thropica mówią, że prawdziwie nowa wersja jest wydawana pod nowym ID. Najbardziej jednoznacznym potwierdzeniem, że Kettle jest prawdziwym następcą, byłoby zatem wydanie czegoś przez An​thropica — a nie podmiana w miejscu. Należy wypatrywać claude-fable-5.1 lub podobnego.

• Czy „Manatee" zostanie wyjaśnione. Druga etykieta to wątek, którego nikt jeszcze nie pociągnął.

Często zadawane pytania

Czy Anthropic faktycznie kieruje Claude Fable 5 do innego modelu?

Niepotwierdzone. Wyciek pokazuje, że odpowiedzi oznaczone jako claude-fable-5 zawierały wewnętrzny identyfikator claude-kettle-e2c95a10-v2-prod w podpisanej sygnaturze myślenia. Nie pokazuje jednak, że zmieniono wagi, wdrożono następcę lub że jakiekolwiek żądanie zostało zdegradowane. „Kettle" może równie dobrze być nazwą wewnętrznego wdrożenia serwującego dla tego samego snapshotu Fable 5.

Jak znaleziono identyfikator Kettle?

Badacz @chetaslua twierdzi, że zdekodował protobuf w polu podpisu bloków myślowych Claude'a i odczytał identyfikator modelu z pola szóstego. Dokumentacja Anthropic nazywa podpis „nieprzezroczystym" i odradza programistom jego parsowanie, a metoda dekodowania badacza nie została opublikowana, więc twierdzenie to nie jest jeszcze niezależnie możliwe do odtworzenia.

Czy to narusza gwarancję przypiętego modelu An​thropic?

Nieznane. Dokumentacja wersjonowania firmy An​thropic mówi, że nigdy nie aktualizuje wag ani konfiguracji istniejącego ID modelu, a nowe wersje trafiają do obiegu pod nowym ID — ale wyraźnie pozwala na zmiany w infrastrukturze serwującej wokół modelu (router żądań, klasyfikatory bezpieczeństwa, logika próbkowania). Identyfikator Kettle mógłby być dokładnie taką zmianą, która nie naruszałaby gwarancji.

Skąd mam wiedzieć, czy model, który mnie obsługuje, się zmienił?

Obserwuj pole modelu najwyższego poziomu w odpowiedziach API, szukaj bloków treści zastępczej (fallback) i śledź różnice w tokenach i kosztach przy stałym obciążeniu. Udokumentowane mechanizmy fallback w Anthropic mają być widoczne w tych miejscach. Nie ma publicznego pola API, które ujawniałoby identyfikator Kettle.

Uczciwa ocena jest taka, że przeciek nadał czemuś nazwę, ale nie udowodnił, czym to jest. Identyfikator Kettle jest prawdziwy w jedynym sensie, w jakim może być prawdziwy przecieknięty ciąg znaków: badacz twierdzi, że tam jest, 2582 razy na 2582, począwszy od nocy 16 sierpnia. To, na co wskazuje — nowy model, przemianowane wdrożenie, komponent routera, klasyfikator — pozostaje niezweryfikowane, a własna dokumentacja An​thropic oferuje całkowicie przyziemne wyjaśnienie całej sprawy. To jest wartość tego tekstu i jego ograniczenie. Dopóki nie zostanie opublikowany surowy podpis lub An​thropic nie powie, czym jest Kettle, właściwą postawą jest traktowanie tego jako „stan wiedzy na dziś”: warto to obserwować, warto logować własny ruch, a nie warto zmieniać z tego powodu wyboru modelu — zwłaszcza gdy warstwa routingu pozwala zachować otwartą opcję w obie strony.

Porównane w tym artykule1

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie

© 2026 OrcaRouter

Dla dostawców

Prowadzisz platformę inferencyjną? Udostępnij swoje modele w OrcaRouter.

providers@orcarouter.ai

Dołącz do społeczności

Discordsupport@orcarouter.aiXGitHubYouTube