
Утечка «Kettle» в Claude Fable 5: внутренний идентификатор модели, скрытый в подписанном мышлении — что нам известно на данный момент
- z-aiНОВИНКАZ.ai: GLM 5.32026-08-1860Интеллект75Кодинг
- obsidianНОВИНКАQwen3.8 27B Uncensored (Aggressive)2026-08-1552Интеллект68Кодинг
- qwenНОВИНКАQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekНОВИНКАDeepSeek: DeepSeek V4 Pro 08132026-08-1253Интеллект69Кодинг
- grokНОВИНКАSpaceXAI: Grok 4.62026-08-1261Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0557Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0358Интеллект72Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Интеллект78Кодинг
- googleGoogle: Gemini 3.6 Flash2026-07-2152Интеллект69Кодинг
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Интеллект49Кодинг
- metaMeta: Muse Spark 1.12026-07-1653Интеллект71Кодинг
- kimiMoonshotAI: Kimi K32026-07-1560Интеллект76Кодинг
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Интеллект71Кодинг
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Интеллект77Кодинг
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Интеллект77Кодинг
- grokxAI: Grok 4.52026-07-0856Интеллект72Кодинг
16 августа в 23:29:45 по тихоокеанскому времени исследователь опубликовал на X заявление, превратившее неприметный уголок API Anthropic в очередную историю формата «что нам известно на данный момент»: по словам автора, если декодировать подписанную сервером «подпись», которая сопровождает каждый блок рассуждений Claude, можно вытащить шесть имён модели, которая на самом деле вам отвечала. В его интерпретации ответы, публично помеченные как claude-fable-5 — Mythos-класс Claude Fable 5, который Anthropic широко поставляет с 9 июня 2026 года по цене $10/$50 за миллион токенов, — начали нести внутренний идентификатор, отсутствующий в публичной документации Anthropic: claude-kettle-e2c95a10-v2-prod. Ничего в метке ответа не изменилось. Ничего не изменилось и в биллинге, в поле модели верхнего уровня API или в гарантии фиксированного снимка Anthropic. Изменилась лишь строка, запрятанная в поле, которое документация прямо запрещает разработчикам разбирать.
Это отчет об утечке, а не вердикт. Этой находке четыре дня, она опирается на расшифровку одного исследователя, которая не была независимо воспроизведена, и Anthropic не прокомментировала, на что указывает «Kettle» — или сопутствующая метка MYCRO_MODEL_MANATEE. Полезный вопрос не в том, «подменила ли Anthropic Fable 5?» Доказательства этого не устанавливают. Полезный вопрос в том, что означало бы появление внутреннего идентификатора модели под публичным идентификатором модели, если бы это было реально, и чего бы оно не означало. Вот что нам известно на данный момент.
Что на самом деле обнаружила утечка
Сигнал — это один пост в X от @chetaslua (status 2089783170896179632, опубликован 16 августа 2026 года), написанный в обычном для аккаунта стиле «first with proof». Суть утверждения, кратко:
Блоки размышлений Клода содержат подписанный сервером protobuf в поле подписи.
• Шестое поле этого протобуфа, по словам исследователя, содержит идентификатор модели, которая фактически сгенерировала ответ.
Начиная с 11:29:45 вечера PDT 16 августа, 2 582 из 2 582 отобранных подписей имели одно и то же значение: claude-kettle-e2c95a10-v2-prod.
• Вторая внутренняя метка, MYCRO_MODEL_MANATEE, также появилась в тех же метаданных.
Число «2,582 из 2,582» несёт риторическую нагрузку: для исследователя это доказательство того, что это была не разовая акция и не A/B-срез, а полномасштабная замена того, на что указывает идентификатор. Чего в посте нет — так это метода, стоящего за декодированием: ни сырых сигнатур, ни скрипта декодирования, ни восстановленной схемы protobuf, ни полных метаданных ответа. Публичным доказательством служит сводная графика. Это делает результат правдоподобным и одновременно на данный момент непроверяемым.

Почему в подписи вообще есть «поле шесть»?
Каждый возвращаемый Claude блок мышления содержит поле подписи. Согласно документации Anthropic по мышлению, эта подпись — «зашифрованная копия полного хода рассуждений», которую следует передавать обратно без изменений в многоходовых диалогах и при использовании инструментов; API использует её, «чтобы проверять, что блоки мышления были созданы Claude». В Claude Fable 5 поведение по умолчанию делает подпись единственным видимым следом: при display = «omitted» — значении по умолчанию на Fable 5, Mythos 5, Opus 5 и Sonnet 5 — блок мышления возвращается с пустым полем thinking и заполненной только подписью.
Затем в документации добавляется предложение, которое имеет значение для любой утечки, основанной на этом поле: «Поле подписи непрозрачно: не интерпретируйте и не разбирайте его». Именно это и делает утверждение Kettle — разбирает его. Это не доказывает, что утверждение неверно — подпись должна быть машиночитаемой для собственного serving-стека Anthropic, — но это означает, что декодирование выполнялось вопреки явной инструкции вендора, по недокументированному протоколу, а реконструкция этого протокола исследователем не была опубликована. Любой вывод, основанный на фразе «шестое поле означает обслуживающую модель», наследует эту неопределённость.
Что это не доказывает
Начнём с того, что доказательство на самом деле собой представляет: ответ, публично помеченный как claude-fable-5, содержал ранее не сообщавшийся внутренний идентификатор. Это всё. Сам по себе идентификатор не доказывает, что Anthropic заменила веса Fable 5, что существует более способный преемник, что ответы стали лучше или хуже, или что какой-либо запрос направлялся на меньшую модель. «Kettle» может быть внутренним именем развёртывания того же самого снимка Fable 5; это может быть название компонента маршрутизатора; это может быть классификатор в стеке безопасности. Кодовое имя не позволяет различить эти варианты.
Собственная политика версионирования Anthropic объясняет, почему утечка совместима с тем, что ничего не изменилось. В документации «Model IDs and versioning» два утверждения расположены рядом:
Anthropic не обновляет веса или конфигурацию существующего ID модели. Когда появляется обновленная версия, она выпускается под новым ID модели.
Веса модели фиксированы для данного идентификатора, но инфраструктура обслуживания вокруг модели может меняться со временем. Эта инфраструктура включает такие компоненты, как маршрутизатор запросов, классификаторы безопасности и логику сэмплирования.

Это второе предложение и есть весь концептуальный разрыв между «Kettle — это скандал» и «Kettle — это обычный понедельник». Документация даже предусматривает поведенческий дрейф: «Иногда обновления инфраструктуры приводят к небольшим различиям в наблюдаемом поведении, даже если идентификатор модели и веса не менялись». Новый маршрутизатор или серверное развёртывание под названием Kettle точно вписалось бы в это предложение. Чтобы утечка была по-настоящему разоблачительной, она должна была бы показать либо новую модель за этим идентификатором вопреки политике, либо механизм, нарушающий правила видимости, указанные ниже.
Документированная запасная маршрутизация Fable 5 уже имеет
Claude Fable 5 уже поставляется с реальным, документированным механизмом переключения моделей, который должен быть заметным. Классификаторы безопасности проверяют запросы и могут направлять подмножество — Anthropic называет наступательную кибербезопасность, биологию двойного назначения, дистилляцию моделей и некоторые работы по разработке передовых чипов — на модель Claude Opus 5. На потребительских поверхностях откат должен быть заметным: уведомление, имя обслуживающей модели в ответе и переключение выбора модели на Opus. В API ответ раскрывает обслуживающую модель через поле model верхнего уровня и специальный блок контента для отката.
Утверждение о Kettle описывает нечто иное, и это отличие — как раз то, что имело бы значение: внутренний идентификатор, появляющийся в ответе, который сохранил публичную метку Fable 5. В посте исследователя нет ни уведомления о запасном варианте, ни изменённого поля модели API, ни блока запасного варианта — если бы они были, история звучала бы как «сработал документированный запасной механизм», а не «Anthropic молча перенаправляет». Без этого утечка не показала, что какая-либо гарантия видимости была нарушена, поскольку она не показала, что такое Kettle.
Почему это важно, даже если ничего не изменилось
Зафиксированные идентификаторы моделей — это механизм доверия. В документации Anthropic обещают, что «когда вы используете идентификатор модели в API-запросе, базовая модель остаётся неизменной в течение всего срока жизни этого идентификатора» — и это единственная причина, по которой команда может проводить бенчмаркинг против claude-fable-5 и ожидать, что результат будет что-то значить в следующем квартале. Скрытый идентификатор, находящийся под этим ID, чем бы он ни был, напоминает, что гарантия покрывает веса и конфигурацию, а не весь путь от запроса до токена. Если бы под публичным ID когда-либо без раскрытия работала действительно другая модель, каждая оценка, каждый прогноз затрат и каждый тест регрессии качества, привязанный к этому ID, оказались бы незаметно недействительными.
Биллинговый аспект обостряет это. Claude Fable 5 стоит $10 за миллион входных токенов и $50 за миллион выходных токенов — самый высокий опубликованный тариф Anthropic. Если обслуживающая модель когда-либо отличалась от ID, указанного в счёте, возникает вопрос: какая ставка применяется и кто это решает. Утечка не даёт доказательств того, что это произошло; суть лишь в том, что поле подписи — первое место, где стоит искать признак такого расхождения.
Сроки также показательны. Это третий сигнал от Anthropic за девять дней: 7 августа компания объявила, что переобучила биологический классификатор Fable 5, сократив число срабатываний, связанных с биологией, примерно на 85% во внутренних тестах; 14 августа в её Отчете о рисках Политики ответственного масштабирования (Responsible Scaling Policy Risk Report) признало существование невыпущенной внутренней «Model 2», которую Anthropic называет «заметным улучшением» по сравнению с Claude Mythos 5 и не планирует выпускать. Оба заявления исходят от вендора, но вместе они показывают, что Anthropic активно меняет системы вокруг Claude Fable 5 — 7-го числа классификаторы, 14-го признанный внутренний преемник — при этом сохраняя идентификатор claude-fable-5 неизменным. Kettle был бы той же историей, только без раскрытия.
Что с этим делать?
Для тех, кто работает с API, практическая позиция скучна и правильна: один идентификатор не является доказательством подмены, и в утечке пока нет ничего, на что можно было бы реагировать. Что вы можете сделать — это собрать собственные доказательства. Логируйте поле model верхнего уровня и любые блоки fallback в ответах, которые вы действительно получаете, и следите за дельтами токенов и стоимости на фиксированной рабочей нагрузке. Если сработает документированный fallback, это будет видно именно в этих местах. Это единственный тест, который имеет значение для вашей рабочей нагрузки, и он не зависит от того, декодирует ли кто-то формат подписи Anthropic.
Если вы направляете трафик к Claude Fable 5 через OrcaRouter, ответ приходит в той же форме, что и от Anthropic, а поскольку мы передаём цены провайдера из прайс-листа без наценки, никакой второй набор цен сверять не нужно — если Anthropic когда-либо изменит тариф на Fable 5, новое число появится у нас в тот же день. Для непроверенной ситуации, подобной этой, низкорисковый способ продолжать использовать модель, не ставя производственный маршрут на кон из-за слуха, — это направить долю реального трафика на Claude Fable 5 с автоматическим переключением на проверенный запасной вариант — Claude Opus 5 по $5/$25 за миллион или более дешёвую модель для кодинга — так что регресс качества превращается в решение о маршрутизации, а не в инцидент. Тот же ключ, никакого второго контракта, а переключение — это изменение routing-DSL, а не переписывание.

Что мы смотрим
• Прокомментирует ли Anthropic. Самое чистое решение — одной строкой признать, чем являются Kettle и Manatee. Молчание само по себе информативно.
• Независимое воспроизведение. Если кто-то опубликует необработанные сигнатуры, метод декодирования и предполагаемую схему protobuf, это превратит данное утверждение из графического представления одного человека в проверяемое заявление. До тех пор это лишь то, что мы знаем на данный момент, а не результат исследования.
• Поверхность видимости. Если ответы claude-fable-5 начнут показывать уведомления об откате, изменённое поле модели API или блоки отката, то чтение «документированный fallback» становится более вероятным; если нет — чтение «недокументированный маршрут» становится более вероятным.
• Новый ID модели. Политика версионирования Anthropic гласит, что по-настоящему новая версия выпускается под новым ID. Поэтому самым чистым подтверждением того, что Kettle — настоящий преемник, был бы выпуск Anthropic чего-то нового, а не маршрутизация существующей модели. Следите за claude-fable-5.1 или чем-то подобным.
• Будет ли объяснено, что такое "Manatee". Вторая метка — это нить, которую ещё никто не потянул.
Часто задаваемые вопросы
Действительно ли Anthropic перенаправляет Claude Fable 5 на другую модель?
Не доказано. Утечка показывает, что ответы с пометкой claude-fable-5 содержали внутренний идентификатор claude-kettle-e2c95a10-v2-prod в подписанной сигнатуре размышлений. Она не показывает, что веса изменились, что было развёрнуто обновление или что какой-либо запрос был понижен в приоритете. «Kettle» с тем же успехом может быть названием внутреннего серверного развёртывания для того же снимка Fable 5.
Как был найден идентификатор Kettle?
Исследователь @chetaslua утверждает, что они декодировали protobuf внутри поля подписи блоков мышления Claude и прочитали идентификатор модели из шестого поля. Документация Anthropic называет подпись «непрозрачной» и говорит разработчикам не парсить её, а метод декодирования исследователя не был опубликован, поэтому это утверждение пока невозможно независимо воспроизвести.
Нарушает ли это гарантию фиксированной модели Anthropic?
Неизвестно. В документации Anthropic по версионированию говорится, что она никогда не обновляет веса или конфигурацию существующего идентификатора модели и что новые версии выпускаются под новым идентификатором — но при этом явно разрешается изменение инфраструктуры обслуживания вокруг модели (роутер запросов, классификаторы безопасности, логика сэмплирования). Идентификатор Kettle может быть именно таким изменением, которое не нарушает эту гарантию.
Как я узнаю, что модель, которая меня обслуживает, изменилась?
Следите за полем верхнего уровня model в ответах API, ищите блоки запасного контента и отслеживайте изменения токенов и стоимости на фиксированной нагрузке. Документированные запасные варианты Anthropic должны быть видны в этих местах. Не существует публичного поля API, которое раскрывает идентификатор Kettle.
Честное прочтение таково: утечка назвала нечто, но не доказала, чем оно является. Идентификатор Kettle реален настолько, насколько вообще может быть реальна утёкшая строка: исследователь говорит, что он там есть, 2 582 раза из 2 582, начиная с ночи 16 августа. То, на что он указывает, — новая модель, переименованное развёртывание, компонент маршрутизатора, классификатор — остаётся непроверенным, и собственная документация Anthropic предлагает вполне обыденное объяснение всему этому. В этом ценность материала и его ограничение. Пока не опубликована сырая сигнатура или Anthropic не скажет, что такое Kettle, правильная позиция — относиться к этому как к тому, что известно на данный момент: за этим стоит следить, стоит вести логи собственного трафика, но не стоит менять выбор модели — особенно когда слой маршрутизации позволяет оставить эту возможность открытой в любом случае.
Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
