Tarjeta de título principal para el artículo 'Claude Fable 5 Kettle Route' con una insignia de INFORME DE FILTRACIÓN, el subtítulo 'El ID de modelo interno encontrado en las firmas de pensamiento firmadas — lo que sabemos hasta ahora', tres chips que dicen 'No verificado: @chetaslua', '16 ago 2026' y 'claude-kettle-e2c95a10-v2-prod', una tarjeta 'La afirmación' que señala que las respuestas etiquetadas como claude-fable-5 llevaban un identificador interno de Kettle, y una tarjeta 'La advertencia' que señala que la evidencia no prueba un cambio de modelo. El logotipo de OrcaRouter está compuesto en la esquina inferior derecha.
Guides & Insights

La filtración de "Kettle" de Claude Fable 5: el ID interno del modelo oculto en Signed Thinking — lo que sabemos hasta ahora

Autor

Elias Hawthorne

Fecha de publicación

Últimos modelos · 20Ver todos los modelos
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

El 16 de agosto a las 11:29:45 p. m. PDT, un investigador en X publicó una afirmación que convirtió un rincón poco glamuroso de la API de An​thropic en una historia de «lo que sabemos hasta ahora»: decodifiquen la «firma» firmada por el servidor que viaja en cada bloque de pensamiento de Claude, dijeron, y obtengan seis nombres del modelo que realmente te respondió. Según su lectura, las respuestas etiquetadas públicamente como claude-fable-5 — el Claude Fable 5 de clase Mythos que An​thropic ha distribuido ampliamente desde el 9 de junio de 2026, a $10/$50 por millón de tokens — comenzaron a llevar un identificador interno que no aparece en ninguna parte de la documentación pública de An​thropic: claude-kettle-e2c95a10-v2-prod. Nada cambió en la etiqueta de la respuesta. Tampoco se demostró que cambiaran la facturación, el campo de modelo de nivel superior de la API ni la garantía de instantánea fijada de An​thropic. Lo que cambió fue una cadena oculta en un campo que la documentación dice explícitamente a los desarrolladores que no deben analizar.

Este es un informe de filtración, no un veredicto. El hallazgo tiene cuatro días de antigüedad, se basa en la decodificación de un único investigador que no ha sido reproducida de forma independiente, y An​thropic no ha comentado a qué se refiere "Kettle" — o su etiqueta asociada MYCRO_MODEL_MANATEE —. La pregunta útil no es "¿cambió An​thropic Fable 5?" La evidencia no establece eso. La pregunta útil es qué significaría, si fuera real, que un ID de modelo interno apareciera bajo un ID de modelo público, y qué no significaría. Esto es lo que sabemos hasta ahora.

Lo que realmente encontró la filtración

La señal es una única publicación en X de @chetaslua (estado 2089783170896179632, publicada el 16 de agosto de 2026), escrita en el estilo habitual de la cuenta de "primero con pruebas". La afirmación, en resumen:

Los bloques de pensamiento de Claude llevan un protobuf firmado por el servidor en el campo de firma.

El investigador dice que el campo seis de ese protobuf contiene el identificador del modelo que realmente generó la respuesta.

• A partir de las 11:29:45 p. m. PDT del 16 de agosto, 2,582 de 2,582 firmas muestreadas tenían el mismo valor: claude-kettle-e2c95a10-v2-prod.

• Una segunda etiqueta interna, MYCRO_MODEL_MANATEE, también apareció en los mismos metadatos.

La cifra "2,582 of 2,582" cumple una función retórica: es la evidencia del investigador de que no se trató de un caso aislado ni de una segmentación A/B, sino de un cambio total de aquello a lo que apunta el identificador. Lo que la publicación no incluye es el método detrás de la decodificación: ni firmas crudas, ni script de decodificación, ni esquema protobuf inferido, ni metadatos completos de la respuesta. La evidencia pública es un gráfico resumen. Eso hace que el hallazgo sea plausible y, a la vez, actualmente no verificable.

A two-column infographic titled 'Claude Fable 5 Kettle — what we know / what we don't'. Left column 'What we know': 'Aug 16, 2026 — 2,582 of 2,582 signatures carry an internal Kettle identifier', 'Response label stayed claude-fable-5', 'Fable 5 GA since June 9, 2026 at $10/$50 per 1M'. Right column 'What we don't': 'Whether weights changed', 'Whether Kettle is a new model or a serving deployment', 'What MYCRO_MODEL_MANATEE refers to'. Footer: 'Single researcher signal; not independently reproduced; Anthropic has not commented.'

¿Por qué la firma incluso tiene un "campo seis"?

Cada bloque de pensamiento que devuelve Claude lleva un campo de firma. Según la documentación de pensamiento de Anthropic, esa firma es «una copia cifrada del razonamiento completo» que se supone que debes devolver sin cambios en conversaciones de varios turnos y de uso de herramientas, y la API la utiliza «para verificar que los bloques de pensamiento fueron generados por Claude». En Claude Fable 5, el comportamiento predeterminado hace que la firma sea el único rastro visible: con la visualización establecida en «omitted» — el valor predeterminado en Fable 5, Mythos 5, Opus 5 y Sonnet 5 — el bloque de pensamiento vuelve con un campo de pensamiento vacío y solo la firma rellenada.

La documentación añade luego una frase que importa para cualquier filtración construida sobre este campo: "El campo de firma es opaco: no lo interpretes ni lo analices". Analizarlo es precisamente lo que hace la afirmación de Kettle. Eso no es prueba de que la afirmación sea incorrecta — la firma tiene que ser legible por máquina para la propia pila de servicio de An​thropic — pero significa que la decodificación se realizó en contra de la instrucción explícita del proveedor, sobre un protocolo no documentado, y la reconstrucción de ese protocolo por parte del investigador no ha sido publicada. Cada inferencia construida sobre "el campo seis significa el modelo servido" hereda esa incertidumbre.

Lo que no prueba

Comience con lo que la evidencia realmente es: una respuesta públicamente etiquetada como claude-fable-5 llevaba un identificador interno no reportado previamente. Eso es todo. El identificador por sí solo no establece que Anthropic haya reemplazado los pesos de Fable 5, que exista un sucesor más capaz, que las respuestas hayan mejorado o empeorado, o que alguna solicitud haya sido enrutada a un modelo más pequeño. "Kettle" podría ser un nombre interno de despliegue de servicio para la mismísima instantánea de Fable 5; podría ser el nombre de un componente de enrutador; podría ser un clasificador en la pila de seguridad. El nombre en clave no puede distinguir entre esos.

La propia política de versionado de An​thropic explica por qué la filtración es compatible con que nada haya cambiado. En la documentación "Model IDs and versioning", dos afirmaciones aparecen una junto a la otra:

Anthropic no actualiza los pesos ni la configuración de un ID de modelo existente. Cuando hay una versión actualizada disponible, se lanza bajo un nuevo ID de modelo.

Los pesos del modelo son fijos para un ID determinado, pero la infraestructura de servicio que rodea al modelo puede cambiar con el tiempo. Esta infraestructura incluye componentes como el enrutador de solicitudes, los clasificadores de seguridad y la lógica de muestreo.

A screenshot of Anthropic's 'Model IDs and versioning' documentation page showing the statement that each Claude model ID identifies a pinned version of the model and that the underlying model remains constant for the lifetime of that ID, alongside the dateless model ID format examples such as claude-sonnet-5 and claude-opus-5.

Esa segunda frase es toda la brecha conceptual entre "Kettle es un escándalo" y "Kettle es un lunes rutinario". Los documentos incluso anticipan la deriva de comportamiento: "Ocasionalmente, las actualizaciones de infraestructura producen diferencias menores en el comportamiento observable incluso cuando el ID del modelo y los pesos no han cambiado". Un nuevo router o despliegue de servicio llamado Kettle encajaría exactamente en esa frase. Para que la filtración fuera realmente condenatoria, tendría que mostrar o bien un modelo nuevo detrás del ID a pesar de la política, o bien un mecanismo que violara las reglas de visibilidad que se indican a continuación.

El enrutamiento de respaldo documentado que Fable 5 ya tiene

Claude Fable 5 ya incluye un mecanismo de cambio de modelo que es real, está documentado y está diseñado para ser visible. Los clasificadores de seguridad inspeccionan las solicitudes y pueden enrutar un subconjunto —An​thropic menciona ciberseguridad ofensiva, biología de doble uso, destilación de modelos y algunos trabajos de desarrollo de chips de vanguardia— a un modelo Claude Opus 5. En las superficies de consumo, el respaldo debe ser evidente: un aviso, el nombre del modelo que sirve la respuesta y el selector de modelos que cambia a Opus. En la API, la respuesta expone el modelo que la sirve a través del campo model de nivel superior y de un bloque de contenido de respaldo dedicado.

La afirmación sobre Kettle describe algo diferente, y la diferencia es la parte que importaría: un identificador interno que aparece bajo una respuesta que conservó la etiqueta pública de Fable 5. La publicación del investigador no muestra un aviso de respaldo, un campo modificado del modelo de API ni un bloque de respaldo; si lo hiciera, la historia sería «el respaldo documentado se disparó», no «An​thropic está enrutando silenciosamente». Sin eso, la filtración no ha demostrado que se haya violado ninguna garantía de visibilidad, porque no ha demostrado qué es Kettle.

Por qué importa aunque nada haya cambiado

Los IDs de modelo fijados son un mecanismo de confianza. La documentación de Anthropic promete que «cuando usas un ID de modelo en una solicitud de API, el modelo subyacente permanece constante durante toda la vida de ese ID» — toda la razón por la que un equipo puede hacer evaluaciones comparativas contra claude-fable-5 y esperar que el resultado signifique algo el próximo trimestre. Un identificador oculto debajo de ese ID, sea lo que sea, es un recordatorio de que la garantía cubre los pesos y la configuración, no todo el camino desde la solicitud hasta el token. Si un modelo genuinamente diferente llegara a ejecutarse bajo un ID público sin divulgación, cada evaluación, cada previsión de costos y cada prueba de regresión de calidad vinculada a ese ID quedaría silenciosamente invalidada.

El ángulo de facturación lo agudiza. Claude Fable 5 cuesta $10 por millón de tokens de entrada y $50 por millón de tokens de salida — la tarifa publicada más alta de An​thropic. Si el modelo servido alguna vez difiriera del ID facturado, la pregunta se convierte en qué tarifa se aplica y quién decide. La filtración no ofrece evidencia de que eso sucediera; el punto es solo que el campo de firma es donde uno buscaría primero una señal de ello.

El momento también es digno de mención. Esta es la tercera señal de Anthropic en nueve días: el 7 de agosto la empresa anunció que había reentrenado el clasificador biológico de Fable 5, reduciendo los retrocesos relacionados con biología en aproximadamente un 85% en pruebas internas; el 14 de agosto su Informe de Riesgo de la Política de Escalado Responsable reconoció un "Modelo 2" interno no publicado que Anthropic califica como "una mejora notable" sobre Claude Mythos 5 y que no planea lanzar. Ambas son declaraciones del proveedor, pero juntas muestran a Anthropic cambiando activamente los sistemas alrededor de Claude Fable 5 — clasificadores el día 7, un sucesor interno reconocido el día 14 — mientras mantiene fija la ID de claude-fable-5. Kettle sería la misma historia, salvo por la divulgación.

Qué hacer al respecto

Para quienes llaman a la API, la posición práctica es aburrida y correcta: un identificador no es evidencia de una sustitución, y todavía no hay nada accionable en la filtración. Lo que puedes hacer es generar tu propia evidencia. Registra el campo de modelo de nivel superior y cualquier bloque de respaldo en las respuestas que realmente recibas, y observa los deltas de tokens y costos en una carga de trabajo fija. Si se activa un respaldo documentado, será visible exactamente en esos lugares. Esa es la única prueba que importa para tu carga de trabajo, y no depende de que nadie decodifique el formato de firma de An​thropic.

Si estás enrutando a Claude Fable 5 a través de OrcaRouter, la misma forma de respuesta que devuelve An​thropic vuelve, y como pasamos los precios de lista del proveedor sin margen, no hay un segundo conjunto de precios que conciliar — si An​thropic alguna vez cambia la tarifa de Fable 5, el nuevo número está activo en nuestro lado el mismo día. Para una situación no verificada como esta, la forma de bajo riesgo de seguir usando el modelo sin apostar una ruta de producción a un rumor es enrutar una parte del tráfico real a Claude Fable 5 con conmutación por error automática a un respaldo probado — Claude Opus 5 a $5/$25 por millón, o un modelo más económico de nivel de programación — de modo que una regresión de calidad se convierta en una decisión de enrutamiento en lugar de un incidente. Misma clave, sin segundo contrato, y la conmutación por error es un cambio de DSL de enrutamiento en lugar de una reescritura.

A screenshot of the OrcaRouter model page for Claude Fable 5 (anthropic/claude-fable-5) showing the model id, Vision, Tools, JSON and Reasoning capability chips, a 1M-token context window, a 128K max output, text, image and file input with text output, $10.00 per 1M input tokens and $50.00 per 1M output tokens, and a p50 time-to-first-token of 5.65 seconds.

Lo que estamos viendo

• Si Anthropic comenta. La solución más limpia es un reconocimiento en una sola línea de qué son Kettle y Manatee. El silencio es en sí mismo informativo.

• Una reproducción independiente. Que alguien publicara las firmas sin procesar, el método de decodificación y el esquema protobuf inferido movería esto de la gráfica de una persona a una afirmación comprobable. Hasta entonces es lo que sabemos hasta ahora, no un hallazgo.

• La superficie de visibilidad. Si las respuestas de claude-fable-5 comienzan a mostrar avisos de respaldo, un campo del modelo de API cambiado o bloques de respaldo, la lectura de "respaldo documentado" se fortalece; si no, lo hace la de "ruta no documentada".

Un nuevo ID de modelo. La política de versionado de Anthropic dice que una versión genuinamente nueva se publica con un ID nuevo. La confirmación más clara de que Kettle es un verdadero sucesor sería, por tanto, que Anthropic lanzara algo — no simplemente un enrutamiento con el mismo ID. Esté atento a un claude-fable-5.1 o similar.

• Si se explica "Manatee". La segunda etiqueta es un hilo del que nadie ha tirado todavía.

Preguntas frecuentes

¿Está Anthropic realmente enrutando Claude Fable 5 a un modelo diferente?

No está probado. La filtración muestra que las respuestas etiquetadas como claude-fable-5 llevaban un identificador interno, claude-kettle-e2c95a10-v2-prod, en una firma de pensamiento firmada. No demuestra que los pesos cambiaran, que se implementara un sucesor ni que ninguna solicitud fuera degradada. "Kettle" podría igualmente ser el nombre de un despliegue interno de servicio para la misma instantánea de Fable 5.

¿Cómo se encontró el identificador de Kettle?

El investigador @chetaslua dice que decodificó un protobuf dentro del campo de firma de los bloques de pensamiento de Claude y leyó el identificador del modelo desde el campo seis. La documentación de An​thropic llama a la firma "opaca" y dice a los desarrolladores que no la analicen, y el método de decodificación del investigador no ha sido publicado, por lo que la afirmación aún no es reproducible de forma independiente.

¿Esto viola la garantía de modelo fijo de An​thropic?

Desconocido. La documentación de versionado de Anthropic dice que nunca actualiza los pesos ni la configuración de un ID de modelo existente, y que las nuevas versiones se publican bajo un nuevo ID — pero permite explícitamente que la infraestructura de servicio alrededor de un modelo (el enrutador de solicitudes, los clasificadores de seguridad, la lógica de muestreo) cambie. Un identificador de Kettle podría ser exactamente ese tipo de cambio, lo que no violaría la garantía.

¿Cómo sabría si el modelo que me sirve ha cambiado?

Observe el campo de modelo de nivel superior en las respuestas de la API, busque bloques de contenido de respaldo y realice un seguimiento de los deltas de tokens y costos en una carga de trabajo fija. Los respaldos documentados por An​thropic están pensados para ser visibles en esos lugares. No existe un campo público de la API que exponga el identificador de Kettle.

La lectura honesta es que una filtración ha nombrado algo, no ha probado qué es. El identificador Kettle es real en el único sentido en que puede serlo una cadena filtrada: un investigador dice que está ahí, 2,582 de 2,582 veces, a partir de la noche del 16 de agosto. A lo que apunta —un modelo nuevo, un despliegue renombrado, un componente de enrutador, un clasificador— sigue sin verificarse, y la propia documentación de An​thropic ofrece una explicación perfectamente mundana para todo el asunto. Ese es el valor de la pieza y su límite. Hasta que se publique una firma sin procesar o An​thropic diga qué es Kettle, la postura correcta es tratarlo como un "lo que sabemos hasta ahora": vale la pena vigilarlo, vale la pena registrar tu propio tráfico, y no vale la pena cambiar tu elección de modelo por ello — especialmente cuando una capa de enrutamiento te permite mantener la opción abierta en cualquier caso.

Comparados en este artículo1

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario

© 2026 OrcaRouter

Para proveedores

¿Operas una plataforma de inferencia? Publica tus modelos en OrcaRouter.

providers@orcarouter.ai

Únete a la comunidad

Discordsupport@orcarouter.aiXGitHubYouTube