
La filtración de "Kettle" de Claude Fable 5: el ID interno del modelo oculto en Signed Thinking — lo que sabemos hasta ahora
- z-aiNUEVOZ.ai: GLM 5.32026-08-1860Inteligencia75Código
- obsidianNUEVOQwen3.8 27B Uncensored (Aggressive)2026-08-1552Inteligencia68Código
- qwenNUEVOQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekNUEVODeepSeek: DeepSeek V4 Pro 08132026-08-1253Inteligencia69Código
- grokNUEVOSpaceXAI: Grok 4.62026-08-1261Inteligencia77Código
- metaMeta: Muse Spark 1.22026-08-0557Inteligencia72Código
- qwenQwen: Qwen3.8 Max2026-08-0358Inteligencia72Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Inteligencia69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Inteligencia78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2152Inteligencia69Código
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Inteligencia49Código
- metaMeta: Muse Spark 1.12026-07-1653Inteligencia71Código
- kimiMoonshotAI: Kimi K32026-07-1560Inteligencia76Código
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Inteligencia71Código
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Inteligencia77Código
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Inteligencia77Código
- grokxAI: Grok 4.52026-07-0856Inteligencia72Código
El 16 de agosto a las 11:29:45 p. m. PDT, un investigador en X publicó una afirmación que convirtió un rincón poco glamuroso de la API de Anthropic en una historia de «lo que sabemos hasta ahora»: decodifiquen la «firma» firmada por el servidor que viaja en cada bloque de pensamiento de Claude, dijeron, y obtengan seis nombres del modelo que realmente te respondió. Según su lectura, las respuestas etiquetadas públicamente como claude-fable-5 — el Claude Fable 5 de clase Mythos que Anthropic ha distribuido ampliamente desde el 9 de junio de 2026, a $10/$50 por millón de tokens — comenzaron a llevar un identificador interno que no aparece en ninguna parte de la documentación pública de Anthropic: claude-kettle-e2c95a10-v2-prod. Nada cambió en la etiqueta de la respuesta. Tampoco se demostró que cambiaran la facturación, el campo de modelo de nivel superior de la API ni la garantía de instantánea fijada de Anthropic. Lo que cambió fue una cadena oculta en un campo que la documentación dice explícitamente a los desarrolladores que no deben analizar.
Este es un informe de filtración, no un veredicto. El hallazgo tiene cuatro días de antigüedad, se basa en la decodificación de un único investigador que no ha sido reproducida de forma independiente, y Anthropic no ha comentado a qué se refiere "Kettle" — o su etiqueta asociada MYCRO_MODEL_MANATEE —. La pregunta útil no es "¿cambió Anthropic Fable 5?" La evidencia no establece eso. La pregunta útil es qué significaría, si fuera real, que un ID de modelo interno apareciera bajo un ID de modelo público, y qué no significaría. Esto es lo que sabemos hasta ahora.
Lo que realmente encontró la filtración
La señal es una única publicación en X de @chetaslua (estado 2089783170896179632, publicada el 16 de agosto de 2026), escrita en el estilo habitual de la cuenta de "primero con pruebas". La afirmación, en resumen:
Los bloques de pensamiento de Claude llevan un protobuf firmado por el servidor en el campo de firma.
El investigador dice que el campo seis de ese protobuf contiene el identificador del modelo que realmente generó la respuesta.
• A partir de las 11:29:45 p. m. PDT del 16 de agosto, 2,582 de 2,582 firmas muestreadas tenían el mismo valor: claude-kettle-e2c95a10-v2-prod.
• Una segunda etiqueta interna, MYCRO_MODEL_MANATEE, también apareció en los mismos metadatos.
La cifra "2,582 of 2,582" cumple una función retórica: es la evidencia del investigador de que no se trató de un caso aislado ni de una segmentación A/B, sino de un cambio total de aquello a lo que apunta el identificador. Lo que la publicación no incluye es el método detrás de la decodificación: ni firmas crudas, ni script de decodificación, ni esquema protobuf inferido, ni metadatos completos de la respuesta. La evidencia pública es un gráfico resumen. Eso hace que el hallazgo sea plausible y, a la vez, actualmente no verificable.

¿Por qué la firma incluso tiene un "campo seis"?
Cada bloque de pensamiento que devuelve Claude lleva un campo de firma. Según la documentación de pensamiento de Anthropic, esa firma es «una copia cifrada del razonamiento completo» que se supone que debes devolver sin cambios en conversaciones de varios turnos y de uso de herramientas, y la API la utiliza «para verificar que los bloques de pensamiento fueron generados por Claude». En Claude Fable 5, el comportamiento predeterminado hace que la firma sea el único rastro visible: con la visualización establecida en «omitted» — el valor predeterminado en Fable 5, Mythos 5, Opus 5 y Sonnet 5 — el bloque de pensamiento vuelve con un campo de pensamiento vacío y solo la firma rellenada.
La documentación añade luego una frase que importa para cualquier filtración construida sobre este campo: "El campo de firma es opaco: no lo interpretes ni lo analices". Analizarlo es precisamente lo que hace la afirmación de Kettle. Eso no es prueba de que la afirmación sea incorrecta — la firma tiene que ser legible por máquina para la propia pila de servicio de Anthropic — pero significa que la decodificación se realizó en contra de la instrucción explícita del proveedor, sobre un protocolo no documentado, y la reconstrucción de ese protocolo por parte del investigador no ha sido publicada. Cada inferencia construida sobre "el campo seis significa el modelo servido" hereda esa incertidumbre.
Lo que no prueba
Comience con lo que la evidencia realmente es: una respuesta públicamente etiquetada como claude-fable-5 llevaba un identificador interno no reportado previamente. Eso es todo. El identificador por sí solo no establece que Anthropic haya reemplazado los pesos de Fable 5, que exista un sucesor más capaz, que las respuestas hayan mejorado o empeorado, o que alguna solicitud haya sido enrutada a un modelo más pequeño. "Kettle" podría ser un nombre interno de despliegue de servicio para la mismísima instantánea de Fable 5; podría ser el nombre de un componente de enrutador; podría ser un clasificador en la pila de seguridad. El nombre en clave no puede distinguir entre esos.
La propia política de versionado de Anthropic explica por qué la filtración es compatible con que nada haya cambiado. En la documentación "Model IDs and versioning", dos afirmaciones aparecen una junto a la otra:
Anthropic no actualiza los pesos ni la configuración de un ID de modelo existente. Cuando hay una versión actualizada disponible, se lanza bajo un nuevo ID de modelo.
Los pesos del modelo son fijos para un ID determinado, pero la infraestructura de servicio que rodea al modelo puede cambiar con el tiempo. Esta infraestructura incluye componentes como el enrutador de solicitudes, los clasificadores de seguridad y la lógica de muestreo.

Esa segunda frase es toda la brecha conceptual entre "Kettle es un escándalo" y "Kettle es un lunes rutinario". Los documentos incluso anticipan la deriva de comportamiento: "Ocasionalmente, las actualizaciones de infraestructura producen diferencias menores en el comportamiento observable incluso cuando el ID del modelo y los pesos no han cambiado". Un nuevo router o despliegue de servicio llamado Kettle encajaría exactamente en esa frase. Para que la filtración fuera realmente condenatoria, tendría que mostrar o bien un modelo nuevo detrás del ID a pesar de la política, o bien un mecanismo que violara las reglas de visibilidad que se indican a continuación.
El enrutamiento de respaldo documentado que Fable 5 ya tiene
Claude Fable 5 ya incluye un mecanismo de cambio de modelo que es real, está documentado y está diseñado para ser visible. Los clasificadores de seguridad inspeccionan las solicitudes y pueden enrutar un subconjunto —Anthropic menciona ciberseguridad ofensiva, biología de doble uso, destilación de modelos y algunos trabajos de desarrollo de chips de vanguardia— a un modelo Claude Opus 5. En las superficies de consumo, el respaldo debe ser evidente: un aviso, el nombre del modelo que sirve la respuesta y el selector de modelos que cambia a Opus. En la API, la respuesta expone el modelo que la sirve a través del campo model de nivel superior y de un bloque de contenido de respaldo dedicado.
La afirmación sobre Kettle describe algo diferente, y la diferencia es la parte que importaría: un identificador interno que aparece bajo una respuesta que conservó la etiqueta pública de Fable 5. La publicación del investigador no muestra un aviso de respaldo, un campo modificado del modelo de API ni un bloque de respaldo; si lo hiciera, la historia sería «el respaldo documentado se disparó», no «Anthropic está enrutando silenciosamente». Sin eso, la filtración no ha demostrado que se haya violado ninguna garantía de visibilidad, porque no ha demostrado qué es Kettle.
Por qué importa aunque nada haya cambiado
Los IDs de modelo fijados son un mecanismo de confianza. La documentación de Anthropic promete que «cuando usas un ID de modelo en una solicitud de API, el modelo subyacente permanece constante durante toda la vida de ese ID» — toda la razón por la que un equipo puede hacer evaluaciones comparativas contra claude-fable-5 y esperar que el resultado signifique algo el próximo trimestre. Un identificador oculto debajo de ese ID, sea lo que sea, es un recordatorio de que la garantía cubre los pesos y la configuración, no todo el camino desde la solicitud hasta el token. Si un modelo genuinamente diferente llegara a ejecutarse bajo un ID público sin divulgación, cada evaluación, cada previsión de costos y cada prueba de regresión de calidad vinculada a ese ID quedaría silenciosamente invalidada.
El ángulo de facturación lo agudiza. Claude Fable 5 cuesta $10 por millón de tokens de entrada y $50 por millón de tokens de salida — la tarifa publicada más alta de Anthropic. Si el modelo servido alguna vez difiriera del ID facturado, la pregunta se convierte en qué tarifa se aplica y quién decide. La filtración no ofrece evidencia de que eso sucediera; el punto es solo que el campo de firma es donde uno buscaría primero una señal de ello.
El momento también es digno de mención. Esta es la tercera señal de Anthropic en nueve días: el 7 de agosto la empresa anunció que había reentrenado el clasificador biológico de Fable 5, reduciendo los retrocesos relacionados con biología en aproximadamente un 85% en pruebas internas; el 14 de agosto su Informe de Riesgo de la Política de Escalado Responsable reconoció un "Modelo 2" interno no publicado que Anthropic califica como "una mejora notable" sobre Claude Mythos 5 y que no planea lanzar. Ambas son declaraciones del proveedor, pero juntas muestran a Anthropic cambiando activamente los sistemas alrededor de Claude Fable 5 — clasificadores el día 7, un sucesor interno reconocido el día 14 — mientras mantiene fija la ID de claude-fable-5. Kettle sería la misma historia, salvo por la divulgación.
Qué hacer al respecto
Para quienes llaman a la API, la posición práctica es aburrida y correcta: un identificador no es evidencia de una sustitución, y todavía no hay nada accionable en la filtración. Lo que puedes hacer es generar tu propia evidencia. Registra el campo de modelo de nivel superior y cualquier bloque de respaldo en las respuestas que realmente recibas, y observa los deltas de tokens y costos en una carga de trabajo fija. Si se activa un respaldo documentado, será visible exactamente en esos lugares. Esa es la única prueba que importa para tu carga de trabajo, y no depende de que nadie decodifique el formato de firma de Anthropic.
Si estás enrutando a Claude Fable 5 a través de OrcaRouter, la misma forma de respuesta que devuelve Anthropic vuelve, y como pasamos los precios de lista del proveedor sin margen, no hay un segundo conjunto de precios que conciliar — si Anthropic alguna vez cambia la tarifa de Fable 5, el nuevo número está activo en nuestro lado el mismo día. Para una situación no verificada como esta, la forma de bajo riesgo de seguir usando el modelo sin apostar una ruta de producción a un rumor es enrutar una parte del tráfico real a Claude Fable 5 con conmutación por error automática a un respaldo probado — Claude Opus 5 a $5/$25 por millón, o un modelo más económico de nivel de programación — de modo que una regresión de calidad se convierta en una decisión de enrutamiento en lugar de un incidente. Misma clave, sin segundo contrato, y la conmutación por error es un cambio de DSL de enrutamiento en lugar de una reescritura.

Lo que estamos viendo
• Si Anthropic comenta. La solución más limpia es un reconocimiento en una sola línea de qué son Kettle y Manatee. El silencio es en sí mismo informativo.
• Una reproducción independiente. Que alguien publicara las firmas sin procesar, el método de decodificación y el esquema protobuf inferido movería esto de la gráfica de una persona a una afirmación comprobable. Hasta entonces es lo que sabemos hasta ahora, no un hallazgo.
• La superficie de visibilidad. Si las respuestas de claude-fable-5 comienzan a mostrar avisos de respaldo, un campo del modelo de API cambiado o bloques de respaldo, la lectura de "respaldo documentado" se fortalece; si no, lo hace la de "ruta no documentada".
Un nuevo ID de modelo. La política de versionado de Anthropic dice que una versión genuinamente nueva se publica con un ID nuevo. La confirmación más clara de que Kettle es un verdadero sucesor sería, por tanto, que Anthropic lanzara algo — no simplemente un enrutamiento con el mismo ID. Esté atento a un claude-fable-5.1 o similar.
• Si se explica "Manatee". La segunda etiqueta es un hilo del que nadie ha tirado todavía.
Preguntas frecuentes
¿Está Anthropic realmente enrutando Claude Fable 5 a un modelo diferente?
No está probado. La filtración muestra que las respuestas etiquetadas como claude-fable-5 llevaban un identificador interno, claude-kettle-e2c95a10-v2-prod, en una firma de pensamiento firmada. No demuestra que los pesos cambiaran, que se implementara un sucesor ni que ninguna solicitud fuera degradada. "Kettle" podría igualmente ser el nombre de un despliegue interno de servicio para la misma instantánea de Fable 5.
¿Cómo se encontró el identificador de Kettle?
El investigador @chetaslua dice que decodificó un protobuf dentro del campo de firma de los bloques de pensamiento de Claude y leyó el identificador del modelo desde el campo seis. La documentación de Anthropic llama a la firma "opaca" y dice a los desarrolladores que no la analicen, y el método de decodificación del investigador no ha sido publicado, por lo que la afirmación aún no es reproducible de forma independiente.
¿Esto viola la garantía de modelo fijo de Anthropic?
Desconocido. La documentación de versionado de Anthropic dice que nunca actualiza los pesos ni la configuración de un ID de modelo existente, y que las nuevas versiones se publican bajo un nuevo ID — pero permite explícitamente que la infraestructura de servicio alrededor de un modelo (el enrutador de solicitudes, los clasificadores de seguridad, la lógica de muestreo) cambie. Un identificador de Kettle podría ser exactamente ese tipo de cambio, lo que no violaría la garantía.
¿Cómo sabría si el modelo que me sirve ha cambiado?
Observe el campo de modelo de nivel superior en las respuestas de la API, busque bloques de contenido de respaldo y realice un seguimiento de los deltas de tokens y costos en una carga de trabajo fija. Los respaldos documentados por Anthropic están pensados para ser visibles en esos lugares. No existe un campo público de la API que exponga el identificador de Kettle.
La lectura honesta es que una filtración ha nombrado algo, no ha probado qué es. El identificador Kettle es real en el único sentido en que puede serlo una cadena filtrada: un investigador dice que está ahí, 2,582 de 2,582 veces, a partir de la noche del 16 de agosto. A lo que apunta —un modelo nuevo, un despliegue renombrado, un componente de enrutador, un clasificador— sigue sin verificarse, y la propia documentación de Anthropic ofrece una explicación perfectamente mundana para todo el asunto. Ese es el valor de la pieza y su límite. Hasta que se publique una firma sin procesar o Anthropic diga qué es Kettle, la postura correcta es tratarlo como un "lo que sabemos hasta ahora": vale la pena vigilarlo, vale la pena registrar tu propio tráfico, y no vale la pena cambiar tu elección de modelo por ello — especialmente cuando una capa de enrutamiento te permite mantener la opción abierta en cualquier caso.
Comparados en este artículo1
Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario
