Tarjeta de título principal encabezada por «Claude Opus 5.5 ejecuta, Claude Fable 5.1 asesora», con el subtítulo «Cómo se fija el precio del bucle de asesoramiento de Claude Code», un diagrama de izquierda a derecha que muestra a Fable 5.1 escribiendo el plan, a Opus 5.5 ejecutando el bucle y una flecha de retroalimentación curva etiquetada «asesora y verifica», además del logotipo de OrcaRouter en la esquina inferior derecha.
Guides & Insights

Claude Opus 5.5 ejecuta, Claude Fable 5.1 asesora: cómo se cobra el bucle de asesoramiento de Claude Code

Autor

Gideon Frost

Fecha de publicación

Últimos modelos · 20Ver todos los modelos
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Claude Fable 5.1 escribe el plan de diseño. Claude Opus 5.5 lo ejecuta en un bucle. Fable 5.1 vuelve como el asesor y acepta o rechaza el resultado. Ese es el patrón que X/@dotey publicó el 22 de septiembre de 2026 —el día en que el proveedor lanzó Claude Opus 5.5—, enmarcándolo como un arreglo para ahorrar tokens alcanzado bajo presión de costos: configura al asesor como Fable, ejecuta Opus y deja que el modelo caro hable solo en los puntos de decisión. Lo que están usando ya no es un truco de prompts ni una configuración de subagentes. Es la herramienta de asesor integrada de Claude Code, una función del lado del servidor que se factura a las tarifas del modelo asesor, además de todo lo que gasta el modelo principal. Y el consejo es la parte barata. Volver a leer la conversación para producirlo no lo es: el contexto del ejecutor se ha vuelto barato de releer, y el del asesor nunca lo fue. Esa única asimetría decide si vale la pena ejecutar el bucle, y es lo que el resto de este artículo calcula en términos de costos.

Qué es realmente el loop

La herramienta de asesor empareja tu modelo principal con un segundo modelo, normalmente más potente, que Claude consulta en momentos clave — antes de comprometerse con un enfoque, cuando un error se repite o antes de declarar una tarea terminada. El asesor recibe la conversación completa, incluidas todas las llamadas a herramientas y sus resultados, y devuelve orientación que el modelo principal luego aplica. Nunca llama a herramientas y nunca produce salida dirigida al usuario. Tú eliges qué modelo asesora; Claude decide cuándo llamarlo.

Esa última parte es lo que separa esto del patrón de orquestador y subagente que la comunidad de Claude Code estaba difundiendo en agosto. Los subagentes son delegación: un planificador descompone el trabajo y lo distribuye a los trabajadores, y configuras el modelo de cada carril explícitamente. El asesor es escalado: un modelo impulsa toda la tarea, y el modelo costoso se incorpora en pleno vuelo para una decisión que el conductor no puede tomar solo. No hay grupo de trabajadores, ni grafo de tareas, ni prompt de orquestación que mantener. El bucle práctico que describe @dotey —planificar, ejecutar, verificar, repetir— es lo que parece ese mecanismo cuando apuntas al asesor a Fable 5.1 y dejas que vigile la condición de salida del bucle.

El propio planteamiento que hace Anthropic de la estrategia no se anda con rodeos respecto a la forma que tiene la victoria: el asesor "solo puede transferir la capacidad de la que carece el ejecutor". Todo lo que sigue se deriva de cuánta capacidad falta en realidad y de con qué frecuencia el ejecutor lo admite.

Por qué Claude Opus 5.5 cambió la aritmética

A two-column scoreboard. Left column, Claude Opus 5.5 as executor: input $4.00 per million, output $20.00 per million, cache read $0.20 per million, role 'runs the loop', effort default medium, benchmarks vendor-reported. Right column, Claude Fable 5.1 as advisor: input $10.00 per million, output $50.00 per million, cache read $0.25 per million, role 'advises at decision points', each consult a full transcript and uncached, benchmarks vendor-reported. A footer notes the prices are from Anthropic's published rate card, September 2026, with no independent scores.

Tarjeta de tarifas publicada por Anthropic, por millón de tokens. Estas son cifras del proveedor, no estimaciones:

• Claude Opus 5.5 — $4 de entrada, $20 de salida, $0.20 por lectura de caché, $5 por escritura de caché de 5 minutos

Claude Opus 5 — $5 de entrada, $25 de salida, $0.50 por lectura de caché, $6.25 por una escritura de caché de 5 minutos

• Claude Fable 5.1 — $10 de entrada, $50 de salida, $0.25 por lectura de caché, $12.50 por una escritura de caché de 5 minutos

Dos detalles de esa lista importan más que los precios de titular. En primer lugar, las lecturas de caché en Opus 5.5 son el 5 % de la entrada base, según la propia nota al pie de Anthropic, mientras que la mayoría de los modelos Claude se sitúan en el 10 % y Fable 5.1 en el 2,5 %. Fable 5.1 tiene el mejor multiplicador y aun así pierde en dólares absolutos —0,20 $ frente a 0,25 $— porque su tarifa de entrada base es dos veces y media más alta.

Segundo, y este es el mecanismo en el que se apoya el bucle: alternar el asesor en Claude Code no invalida la caché de prompts del modelo principal, por lo que el contexto largo y reenviado una y otra vez del ejecutor se mantiene barato a 0,20 $ por millón. La lectura que hace el propio asesor de la conversación no se guarda en caché. Cada consulta procesa la transcripción completa desde cero, a la tarifa de entrada de Fable 5.1, de 10 $ por millón. Un ejecutor que relee un contexto de 500 000 tokens diez veces paga por lecturas de caché; un asesor consultado diez veces paga diez cargos de entrada nuevos por una transcripción que no deja de crecer. Cuanto más barato se vuelve el contexto de tu ejecutor, más destaca la lectura sin caché del asesor —y Opus 5.5 acaba de hacer que el contexto del ejecutor sea un 60 % más barato que el de Opus 5.

Configurándolo en Claude Code

El asesor es experimental y Anthropic lo dice en el banner de la sesión: «Advisor Tool (experimental) está activado y puede usar más tokens». El comportamiento, el precio y la disponibilidad pueden cambiar. Hecha esa salvedad, la mecánica está documentada:

Screenshot of Anthropic's Claude Code documentation page for the advisor tool, showing the table of contents (Advisor, Availability, How it works, Supported pairings, How the advisor sees your conversation, Using the advisor, Model selection, Advisor response, Consuming the advisor result, Usage, Pricing, Rate limits, Troubleshooting, Tool use errors, Silent fallback) and body text confirming the tool is experimental and server-side, is available on the Anthropic API only, pairs the main model with a second model that advises at key moments, and that the advisor sees the full conversation including tool calls and results.

• Actívalo con /advisor fable, o ejecuta /advisor sin argumento para abrir un selector. La elección se guarda en el ajuste advisorModel de tu configuración de usuario y se mantiene entre sesiones. /advisor off lo desactiva.

• Para una sola sesión sin cambiar el valor predeterminado guardado, inicia con claude --advisor fable. La opción no aparece en claude --help, y Claude Code se cierra al iniciar si la combinación no es válida en lugar de iniciarse con un asesor ignorado silenciosamente.

• Establece un valor predeterminado persistente en tu archivo de configuración con {"advisorModel": "fable"}.

• Para desactivarlo por completo, define CLAUDE_CODE_DISABLE_ADVISOR_TOOL=1 — el comando /advisor desaparece y se ignora cualquier advisorModel configurado.

• El emparejamiento debe ser al menos tan capaz como el modelo principal. Claude Opus 5.5 acepta Fable y Opus 5 o posterior como asesores. Claude Code rechaza a un asesor Opus 4.6 o Sonnet; un asesor Opus 4.7 u Opus 4.8 se adjunta y luego la API lo rechaza. Fable 5.1 como modelo principal solo acepta Fable 5.1.

• Versiones mínimas: la herramienta de asesor necesita Claude Code v2.1.98 o posterior; Fable, ya sea como modelo principal o como asesor, necesita v2.1.170 o posterior; Fable 5.1 necesita v2.1.257 o posterior. La forma de token de /advisor — la que funciona en -p, el Agent SDK, la aplicación de escritorio y Remote Control — necesita v2.1.260 o posterior.

• El asesor es exclusivo de la API de Anthropic. No está disponible en Amazon Bedrock, Claude Platform on AWS, Agent Platform de Google Cloud ni Microsoft Foundry, y depende de la obtención de feature flags, por lo que una sesión que tenga establecida una variable como DISABLE_TELEMETRY lo mantiene desactivado.

• En los planes en los que el uso de Fable se factura a créditos de uso, Fable como asesor se factura de la misma manera y requiere un consentimiento por única vez. Hasta que lo aceptes, /advisor fable no se guarda y claude --advisor fable se cierra al iniciarse y te remite a /model fable en su lugar.

Los subagentes heredan cualquier asesor que hayas configurado y vuelven a ejecutar la misma verificación de emparejamiento con su propio modelo. Esa es la única interacción entre este patrón y el patrón de subagentes: es posible que a un subagente que ejecuta un modelo más pequeño se le permita un asesor que su padre no tiene.

La forma del costo, desarrollada en detalle

Nada de lo que aparece a continuación es una medición. La forma de los tokens es inventada para hacer visible la aritmética; los precios son las tarifas publicadas de Anthropic. Supongamos una sesión de ejecutor que lee 1M de tokens de entrada nuevos y emite 500K de tokens de salida, y tres consultas de asesor, cada una releyendo una transcripción de 200K tokens y devolviendo unos 600 tokens de orientación — aproximadamente las dos o tres consultas por tarea que pide el propio prompt de sistema de Anthropic.

• Ejecutor en Claude Opus 5.5 — 1M de entrada a $4.00 más 500K de salida a $10.00 = $14.00

• Asesor sobre Claude Fable 5.1 — 600K de entrada a $6.00 más unos 1.800 tokens de salida a aproximadamente $0.09 = $6.09

• El bucle, total — unos $20.09

• El mismo perfil ejecutado de extremo a extremo en Fable 5.1 — $10.00 de entrada más $25.00 de salida = $35.00

• La misma forma solo en Opus 5.5 — $14.00

El bucle se sitúa entre esos dos, que es exactamente donde Anthropic lo coloca: alrededor de un 43 % más barato que ejecutar Fable 5.1 en todo el proceso, y alrededor de un 44 % más caro que el ejecutor por sí solo. Lea el segundo número como el honesto. El asesor no es un ahorro; es la compra de un criterio de la talla de Fable en tres decisiones, y solo compensa si esas tres decisiones cambian el resultado. Lleve la transcripción hasta la ventana de contexto de 1M y cada consulta cuesta $10 por sí sola. Deje que el ejecutor empiece a preguntar en la mayoría de las tareas en lugar de en unas pocas, y estará pagando tarifas de asesor en toda la carga de trabajo; en ese punto, como dice Anthropic, ejecutar el propio modelo del asesor es la vía más barata para obtener la misma puntuación.

Lo que dicen las propias mediciones de Anthropic

Anthropic ha publicado resultados medidos para este patrón, y están reportados por el proveedor: los ejecutó la empresa que vende ambos modelos, en su propio arnés de evaluación comparativa. Siguen siendo los únicos números de su tipo, e incluyen el caso en contra del patrón, por lo que vale la pena leerlos con atención.

• Opus 5 como ejecutor con Fable 5.1 como asesor obtuvo $7.69 por intento en el benchmark interno de codificación con agentes de Anthropic — la configuración más precisa que Anthropic midió. Eso es 3.5 puntos por encima de Opus 5 por sí solo en su configuración predeterminada por un poco menos de dinero, y alrededor de 2.5 puntos por encima de Fable 5.1 por sí solo por aproximadamente una vez y media el dinero. La brecha de 3.5 puntos se separó del ruido entre ejecuciones con cinco intentos por tarea.

• La misma combinación en lectura de gráficos igualó a Fable 5.1 por sí solo con esfuerzo medio dentro del margen de ruido —65,0 frente a 67,5— con un costo por tarea aproximadamente 2,6 veces mayor, porque se consultó al asesor en casi todas las tareas.

• En GPQA Diamond, la ganancia sigue la brecha de capacidad casi a la perfección: un ejecutor Haiku 4.5 ganó muchísimo, un ejecutor Sonnet 5 unos pocos puntos, y un ejecutor de frontera casi nada.

• La tasa de consulta es la variable frágil. Un ejecutor Sonnet 5 de bajo esfuerzo ganó 23 puntos en DeepSWE con un asesor, y luego dejó de preguntar por completo en SWE-bench Pro y no ganó nada.

• Latencia: aproximadamente dos llamadas adicionales a modelos de frontera por tarea, cada una en la ruta crítica.

Dos cosas sobre esa evidencia inciden directamente en el bucle tal como está esta semana. Las mediciones usaron Opus 5 como ejecutor, porque Opus 5.5 no existía cuando se realizaron. Y Anthropic informa que Opus 5.5 rinde al nivel de Fable 5.1 en la mayoría del trabajo, aunque cuesta un 40% menos ejecutarlo — ambas afirmaciones del proveedor, ninguna reproducida de forma independiente. Si la brecha entre ejecutor y asesor es lo que se le paga al asesor por cerrar, entonces una brecha más estrecha es una compra más pequeña. El patrón no empeoró cuando se lanzó Opus 5.5; lo que vende se volvió menos escaso.

Los modos de fallo con los que realmente te toparás

Estos son comportamientos documentados, no especulación, y el primero es la razón para leer esta sección antes de depurar cualquier cosa:

• Un asesor ausente en silencio. Si la API rechaza el emparejamiento del asesor, Claude Code lo adjunta, la API lo rechaza y Claude Code reenvía la solicitud sin el asesor. El resto de la conversación entonces se ejecuta sin asesor y sin ningún mensaje de error. Permanece desactivado hasta /clear o /compact, incluso después de que cambies a un modelo principal compatible.

• Una rechazada en silencio. En el caso de las combinaciones que Claude Code rechaza por sí mismo, el asesor simplemente nunca se adjunta a las solicitudes del modelo principal. La salida de /advisor y una notificación te lo indican, pero nada falla, así que puede que una sesión que creías que estaba siendo asesorada nunca lo haya estado.

• Consentimiento que usted no ha otorgado. Con Fable seleccionado como asesor en un plan que requiere consentimiento de créditos de uso, las solicitudes se envían sin el asesor hasta que usted lo acepte. Una sesión en segundo plano iniciada con --advisor fable se inicia sin un asesor en lugar de cerrarse.

• Una lista de permitidos que tú no controlas. Si la lista de permitidos availableModels de tu organización excluye el modelo de asesor, Claude Code no lo invocará, y tendrás que elegir un modelo permitido con /advisor.

• Dondequiera que no exista. Solo la API de Anthropic: no Bedrock, no Claude Platform on AWS, no Google Cloud Agent Platform, no Microsoft Foundry. A través de una puerta de enlace, la disponibilidad depende de si la puerta de enlace reenvía la solicitud intacta a la API de Anthropic —lo cual es una propiedad de la puerta de enlace, no algo que se pueda asumir.

Dónde encaja OrcaRouter

Ambos modelos de este bucle están hoy en OrcaRouter al precio de lista de Anthropic, con un 0 % de margen — el precio de lista del proveedor se traslada tal cual, así que la tarifa que ves es la tarifa que Anthropic publica. Claude Fable 5.1 se encuentra en anthropic/claude-fable-5.1 y Claude Opus 5 en anthropic/claude-opus-5, detrás de una sola clave de API. Claude Opus 5.5 todavía no es una de nuestras rutas; está disponible a través de la propia API de Anthropic y de las principales nubes, y lo diremos en lugar de dar a entender lo contrario.

Screenshot of the OrcaRouter model page for Claude Fable 5.1 (anthropic/claude-fable-5.1), showing the model header, capability tags and the model description.

Lo que le compra una clave aquí es la capacidad de cambiar de opinión a bajo costo. La economía del bucle depende de la relación de precios entre el ejecutor y el asesor, y esa relación cambió dos veces en siete semanas — Opus 5 a Opus 5.5 el 22 de septiembre, y Fable 5 a Fable 5.1 el 1 de septiembre, lo que redujo la lectura de caché de ese modelo de $1.00 a $0.25 por millón. Cada uno de esos movimientos cambia la respuesta a "¿vale la pena el asesor?", y probar esa respuesta no debería requerir un segundo contrato. La conmutación por error automática es la otra mitad: le permite dirigir una porción del tráfico a un modelo que aún no ha caracterizado, con un respaldo al que ya tiene, en lugar de apostar una ruta de producción a una tabla de lanzamiento. Y si está construyendo el patrón usted mismo en lugar de usar la herramienta integrada de Claude Code, el DSL de enrutamiento compone varios modelos en una sola llamada — un paso de plan en un modelo seguido de pasos de ejecución en otro, detrás de un único endpoint.

Una nota de honestidad sobre el alcance: la herramienta de asesoramiento en sí es una herramienta del lado del servidor que se ejecuta en la API de Anthropic, así que una capa de enrutamiento no la sustituye. Lo que sí podemos hacer es dejar los modelos a una tecla de distancia, a precio de lista, para que la decisión de conservar o descartar el asesor sea tuya, basada en tus propios números.

Cómo decidir según tu propia carga de trabajo

La propia guía de Anthropic es el punto de partida adecuado y es refrescantemente poco sentimental: ejecuta tu conjunto de evaluaciones contra tres configuraciones —el ejecutor en solitario, el ejecutor con un asesor, y el modelo del asesor por sí solo con esfuerzo bajo— y vuelve a comprobarlo en cada lanzamiento de modelo, porque los lanzamientos modifican tanto la brecha de capacidad como la relación de precios. La última de esas tres es la línea base que hay que superar. Si el modelo de tu asesor por sí solo con esfuerzo bajo obtiene la misma puntuación que el bucle por menos dinero, ya tienes tu respuesta.

Las dos variables que hay que vigilar son las que Anthropic nombra. La brecha de capacidad: una brecha amplia entre ejecutor y asesor es donde el asesor justifica su tarifa, y Opus 5.5 cerró esa brecha desde abajo. La tasa de consultas: las ganancias la siguen casi uno a uno, y es lo suficientemente sensible al prompt como para desplomarse — un ejecutor con esfuerzo bajo puede dejar de notar que está atascado, y un emparejamiento que consulta en la mayoría de las tareas con esfuerzo predeterminado puede caer a casi ninguna. El prompt de sistema proporcionado por Anthropic pide una llamada al asesor antes del trabajo sustantivo y una antes de terminar, lo que da lugar a dos o tres consultas por tarea; el emparejamiento de programación que produjo la ganancia de 3.5 puntos funcionaba con esa cadencia. Presupuesta para eso, ponle un límite y trata cada consulta por encima de eso como una señal de que tu ejecutor está mal configurado en lugar de que la tarea era difícil.

Para el bucle específico de este artículo, tres ajustes concretos hacen la mayor parte del trabajo. Mantén Claude Opus 5.5 en su esfuerzo medio predeterminado en lugar de optar por alto, porque el esfuerzo determina el costo directamente y los propios números de Opus 5.5 de Anthropic muestran que el medio sacrifica muy poco. Configura el asesor con /advisor fable y confirma que el banner realmente aparece — un banner ausente significa un asesor ausente de forma silenciosa. Y antes de escalar el patrón, mide tokens por tarea finalizada en lugar de precio por token, porque ese es el número que se supone que el bucle debe mover.

Preguntas frecuentes

¿El asesor consume la misma asignación de Fable que una sesión de Fable?

En la facturación de API, los tokens del advisor se facturan a las propias tarifas de entrada y salida de Fable 5.1, y los límites de velocidad del advisor se toman del mismo cupo por modelo que las llamadas directas a ese modelo —, por lo que una llamada al advisor limitada por velocidad aparece como un error dentro del resultado de la herramienta en lugar de hacer fallar tu solicitud. En los planes de suscripción, el uso del advisor cuenta para los límites de uso de tu plan, salvo que un advisor de Fable se factura a créditos de uso en los planes en los que el uso de Fable también lo hace. La consecuencia práctica es que el advisor no es un presupuesto aparte que puedas gastar libremente; compite con todo lo demás que hagas con ese modelo.

¿Qué es lo que el asesor realmente llega a ver?

La conversación completa, incluidas cada llamada a herramienta y cada resultado de herramienta —contenido de archivos, salida de comandos, mensajes de error, todo. Se ejecuta bajo su propio prompt de sistema proporcionado por Anthropic y devuelve un plan, una corrección o una señal de parada. De eso se derivan dos detalles. Primero, cada consulta vuelve a leer toda la transcripción, y por eso el costo aumenta con el bucle en lugar de mantenerse constante. Segundo, si tu sesión toca material que no enviarías a un segundo modelo al nivel de precio del asesor, el asesor es un segundo modelo que lo lee todo.

¿Qué cambiaría la respuesta?

Dos cosas, y ambas están más cerca de lo que parecen. Si evaluadores independientes publican una ejecución de esfuerzo equiparable de Opus 5.5 frente a Fable 5.1 y confirman el estrechamiento que afirma Anthropic, la ventaja restante del asesor en la mayoría de las tareas es escasa —y el bucle se convierte en una herramienta para la cola difícil en lugar de una opción predeterminada. Si, en cambio, la tasa de consulta se mantiene y la brecha de capacidad sigue siendo amplia en el trabajo agéntico prolongado, la aritmética anterior es aquello entre lo que estás eligiendo, y $6 de asesoramiento en una ejecución de $14 es una opción barata para no lanzar lo incorrecto.

Lo que no cambiará es la mecánica en la parte superior de este artículo. El contexto del ejecutor se almacena en caché y es barato; el contexto del asesor no es ni lo uno ni lo otro. Cualquier bucle que consulte un modelo más caro a mitad de tarea hereda esa asimetría, sin importar lo que diga la lista de precios el próximo mes.

Comparados en este artículo1

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario