
Claude Fable 5 como tu orquestador: el manual de subagentes que mantiene bajos los costos de tokens.
- OrcaNUEVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens
- orcaNUEVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens
- deepseekNUEVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencia69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencia77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligencia72Código
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligencia76Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Inteligencia69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
El 7 de agosto, Anthropic realizó el mayor cambio único en Claude Fable 5 desde que el modelo se lanzó el 9 de junio: redujo los 'fallbacks' relacionados con biología en aproximadamente un 85%, por lo que las preguntas cotidianas sobre salud y educación ahora reciben una respuesta directa en lugar de pasar silenciosamente a un modelo más débil. Sin embargo, la tendencia que realmente se está extendiendo por la comunidad de Claude Code esta semana no tiene nada que ver con biología. Los profesionales no dejan de publicar un flujo de trabajo en el que Claude Fable 5 ejecuta el bucle de orquestación —clarificación de requisitos, descomposición del plan, despacho de tareas, aceptación de resultados— mientras que la ejecución se entrega a subagentes de Claude Opus 5. El beneficio declarado: Fable 5 High se convierte en una opción predeterminada de sesión asequible, y la verbosidad de Claude Opus 5 deja de agotar la sesión.
El ejemplo más reciente es el de @dotey, publicado el 14 de agosto: una breve adición a ~/.claude/CLAUDE.md que le indica al agente abrir subagentes de Opus para la ejecución, dejando Claude Fable 5 con un esfuerzo de razonamiento alto como valor predeterminado de la sesión, y el autor informa que el consumo de tokens se mantiene razonable — además de una razón contundente para no ejecutar Claude Opus 5 como predeterminado: en sus manos era demasiado lento y quemaba una gran cantidad de tokens en el bucle principal. Ese es un hallazgo de la comunidad, no una orientación de Anthropic — y vale la pena entenderlo antes de copiarlo, porque sobre el papel parece al revés.
El patrón en un párrafo. En Claude Code, los subagentes heredan tu modelo de sesión por defecto, así que la manera de mantener un bucle rápido y barato es hacer que el modelo de sesión sea el planificador y apuntar explícitamente a los ejecutores a un modelo diferente. Claude Fable 5 — el modelo de clase Mythos de Anthropic, hecho seguro para uso general, lanzado el 9 de junio de 2026, a $10/$50 por millón de tokens — retiene los requisitos, descompone el trabajo, despacha tareas y acepta resultados. Claude Opus 5 — lanzado el 24 de julio de 2026, a $5/$25 por millón de tokens — ejecuta las implementaciones reales dentro de los subagentes. Inviertes criterio de nivel Fable en los pocos turnos de orquestación y ejecución de nivel Opus en los muchos turnos de ejecución, donde ya va la mayor parte de los tokens.
Por qué el modelo de bucle principal es el verdadero problema de costos
En los benchmarks, esto parece un problema resuelto — y la respuesta parece ser "optar por Opus 5." Las propias cifras de Anthropic (reportadas por el proveedor, no reproducidas) sitúan a Claude Opus 5 por delante de Claude Fable 5 en el benchmark de codificación agéntica Frontier-Bench v0.1 (43.3% vs 33.7%), en SWE-bench Verified (96.0% vs 95.5%), y en ARC-AGI-3 (30.2%, aproximadamente 4 veces el siguiente mejor modelo público). Anthropic posiciona a Opus 5 como acercándose a la inteligencia de frontera de Fable 5 a la mitad del precio. Si eliges un modelo predeterminado de sesión basándote únicamente en los benchmarks del proveedor y en el precio por token, Opus 5 es la opción obvia.
Los profesionales que realmente ejecutan sesiones largas están llegando al ajuste predeterminado opuesto, y la razón son los tokens por tarea, no el precio por token. El pensamiento de Opus 5 está activado por defecto y es adaptativo, y Anthropic afirma que verifica su propio trabajo sin que se le pida, lo que significa que, en la práctica, cada turno del bucle emite sustancialmente más tokens que el de Fable 5. Desactivar ese pensamiento está limitado a un esfuerzo alto, por lo que no se puede llevar hasta un modo totalmente reducido. En una sesión que dura horas, el bucle es lo que se acumula: el modelo que es más barato por token puede terminar siendo el más caro por sesión, y el modelo que menos habla mantiene el bucle rápido.
Eso coincide con lo que informa @dotey. La configuración invertida mantiene el consumo de tokens "no malo" precisamente porque Opus 5 — el verboso — está aislado en subagentes, donde su salida es el entregable en lugar del gasto general.
La arquitectura invertida: Fable 5 planifica, Opus ejecuta
La arquitectura es sencilla de explicar y un poco contraintuitiva de ejecutar:
• Modelo de sesión: Claude Fable 5 con un alto esfuerzo de razonamiento (la "High" en la abreviatura de la comunidad "Fable 5 High"). Es dueño de la conversación, del plan y de la definición de hecho.
• Los turnos de orquestación — aclaración de requisitos, descomposición del plan, despacho de tareas y aceptación de resultados — ocurren todos en Fable 5. Son pocos turnos y una pequeña parte del total de tokens.
• Turnos de ejecución: cada tarea se asigna a un subagente que ejecuta Claude Opus 5. Estos son los numerosos turnos y la mayor parte del gasto de tokens — y es en Opus 5 donde las puntuaciones agénticas reportadas por el proveedor son más altas.
La economía funciona porque las dos curvas de costos apuntan en direcciones diferentes. La fortaleza de Fable 5 es el juicio; lo usas con moderación. La fortaleza de Opus 5 es la ejecución; la usas intensamente pero en paralelo, aislada del bucle. El bucle se mantiene rápido y económico, y la capacidad costosa se gasta exactamente donde los tokens se están gastando de todos modos.
Este es uno de los dos patrones comunitarios en circulación, y son espejos el uno del otro. El patrón de "arquitecto" más recomendado (utilizado, por ejemplo, por el plugin fable-advisor) ejecuta Opus como arquitecto a tiempo completo y reserva Fable 5 para el carril de implementación de mayor complejidad y una revisión obligatoria al final del entregable. La diferencia es un objetivo de optimización: el patrón de arquitecto gasta tokens de nivel Opus en coordinación y usa Fable 5 como bisturí; el patrón invertido usa Fable 5 para coordinación y Opus 5 para volumen. Ambos son orientación comunitaria — Anthropic no documenta ninguno — y ambos son intentos de gastar tokens de frontera donde cambian el resultado.
Configurándolo en Claude Code
Claude Code no tiene un "modo orquestador" incorporado, por lo que el patrón se aplica de dos maneras: instrucciones en el prompt de la sesión y fijaciones explícitas de modelo en el lado de la ejecución.
La capa de instrucciones vive en ~/.claude/CLAUDE.md — el mismo archivo que editó @dotey. En cuanto a su estructura, el prompt le indica al agente principal que haga cuatro cosas antes de considerar cualquier tarea como terminada:
• Reformular el requisito y confirmar el alcance antes de escribir código.
• Descompón el trabajo en tareas que puedan ejecutarse en paralelo.
• Despachar cada tarea de ejecución a un subagente vinculado a Claude Opus 5.
Verifica cada resultado contra el plan antes de aceptarlo.
Esa forma merece expresarse como guía en lugar de como un fragmento para pegar: tus requisitos y tu pila tecnológica determinan qué debería incluir.
La capa de modelos importa más de lo que la mayoría de las configuraciones suponen. En Claude Code, el orden de resolución del modelo de subagente es: la variable de entorno CLAUDE_CODE_SUBAGENT_MODEL, después un parámetro de modelo por invocación, luego el frontmatter de la definición del agente y por último el modelo de la sesión. Los agentes sin un modelo establecido heredan el modelo de la sesión. Por lo tanto, si tu sesión se ejecuta en Fable 5 y dependes del argumento de modelo de la herramienta Agent, existe un riesgo documentado de que se ignore (GitHub issue #83920): los subagentes heredan el modelo de la sesión de todos modos, y pagas la tarifa de Fable 5 por una ejecución que pretendías que corriera en Opus 5.
Dos soluciones fiables: establece CLAUDE_CODE_SUBAGENT_MODEL=claude-opus-5 para la sesión, o fija el modelo en el frontmatter del subagente. Esa única variable es la diferencia entre que el patrón funcione como está diseñado y que toda la sesión se ejecute silenciosamente en el modelo caro.
La aritmética de tokens detrás de la división
Aquí están los dos modelos tal como se cotizan hoy (publicados por el proveedor y transmitidos a precio de lista en OrcaRouter):
• Claude Fable 5 — $10 por 1M de tokens de entrada, $50 por 1M de salida; contexto de 1M de tokens, salida de 128K.
• Claude Opus 5 — $5 por 1M de tokens de entrada, $25 por 1M de salida; contexto de 1M de tokens, salida de 128K.

La parte contraintuitiva es que Opus 5 cuesta la mitad por token y aun así puede perder la partida de los costes por sesión. La forma se ve fácilmente con números aproximados: si el bucle en Opus 5 emite dos o tres veces los tokens del bucle en Fable 5 — una cifra ilustrativa coherente con los informes de profesionales sobre el comportamiento de autoverificación de Opus 5, no una medida — entonces incluso a la mitad de la tarifa por token el bucle cuesta aproximadamente lo mismo, y si la brecha es mayor, Opus en el bucle cuesta más. Mientras tanto, los tokens de ejecución, el grueso de la sesión, se encuentran en Opus 5 en subagentes a la tarifa más barata en cualquier caso.
Ese es todo el argumento a favor del patrón invertido: poner el modelo cuyo precio por token es más alto pero cuyo bucle es más ágil en el bucle, y poner el modelo más barato por token en el volumen. Es una decisión de enrutamiento disfrazada de decisión de modelo.
Debido a que OrcaRouter transmite los precios de los proveedores con un margen de beneficio del 0%, los números anteriores son lo que realmente pagas aquí —sin cargo de plataforma adicional— y si Anthropic reduce cualquiera de los precios, el cambio aparece en la página del modelo el mismo día.
Cuándo el patrón invertido gana — y cuándo no
Copiar la configuración de @dotey sin verificar la forma de tu propia carga de trabajo es un error en ambas direcciones.
El patrón invertido gana cuando:
• Los requisitos son ambiguos o el plan tiene muchas partes móviles — el criterio de orquestación es el recurso escaso.
• La ejecución puede paralelizarse en subagentes — el volumen sale del bucle.
• Las sesiones son largas: la verbosidad de los bucles se traduce en un costo real.
El consejo estándar gana cuando:
• La mayor parte de tu sesión es trabajo mecánico y acotado — un planificador de nivel Fable es excesivo, y el precio más bajo de Opus 5 y sus puntuaciones más altas en benchmarks lo convierten en la opción predeterminada obvia. Por eso la documentación de Claude Code hace de Opus el predeterminado de sesión y reserva Fable 5 para selección explícita.
• No se pueden fijar de manera confiable los modelos de subagente — el error de herencia #83920 convierte el patrón invertido en "todo sobre los precios de Fable 5."
También existe una vía intermedia de ajuste. Opus 5 expone un parámetro de esfuerzo (de bajo a máximo, por defecto alto), de modo que puedes empujarlo hacia un comportamiento más ágil, pero no del todo, porque desactivar el razonamiento está restringido al esfuerzo alto. Si tu problema es la verbosidad de Opus 5, reducir el esfuerzo puede ser suficiente, y nunca necesitas invertir la arquitectura.
Qué significa el cambio de biología del 7 de agosto para esta configuración
La actualización del 7 de agosto de Anthropic reescribió y reentrenó el clasificador de biología de Claude Fable 5 — el sistema que decide si una consulta activa un "fallback" a un modelo menos capaz. Según los propios números de Anthropic (informados por el proveedor), los fallbacks relacionados con biología cayeron aproximadamente un 85% en todas las superficies de producto, con los fallbacks generales reduciéndose ~67% en Claude.ai, ~55% en Cowork, ~17% en Claude Code y ~7% en la Plataforma Claude.

Para una configuración de orquestación de Fable 5, el número de Claude Code es el que importa. Un respaldo es el sistema que cambia silenciosamente tu consulta a un modelo diferente — en este caso a Opus 5. En un chat sencillo, eso es fricción invisible; en una sesión agéntica, significa que parte de tu pipeline se ejecuta en un modelo que no elegiste, con un perfil de costos que no planificaste. La actualización no elimina eso: la virología, la toxicología y el diseño molecular siguen recurriendo al respaldo. Pero la biología cotidiana de salud y educación — leer un resultado de laboratorio, entender un síntoma, estudiar biología — ahora se mantiene en Fable 5.
Una nota a futuro, claramente etiquetada: informes no confirmados de finales de julio (36kr, WinCentral) apuntan a una posible actualización de Claude Fable 5.1 este mes a precios sin cambios. Anthropic no ha confirmado un nombre, una fecha ni un ID de modelo de API — trátelo como especulación hasta que se lance.
Pruébalo sin arriesgar tu flujo de trabajo.
Lo que hace que el patrón invertido valga la pena probar es que es reversible, y enrutar ambos modelos a través de un solo endpoint hace que la reversión sea barata.
En OrcaRouter, Claude Fable 5 (anthropic/claude-fable-5) y Claude Opus 5 (anthropic/claude-opus-5) están detrás de una misma clave de API. Puedes ejecutar la línea de ejecución de la sesión en cualquiera de los dos modelos sin un segundo contrato ni un cambio de código, que es exactamente lo que necesita un experimento como «Fable 5 como orquestador», porque el objetivo es medir tu propio costo por sesión antes de comprometerte.

Dos funciones de OrcaRouter se corresponden directamente con esta configuración. La conmutación automática por error permite definir una cadena de respaldo: si Fable 5 falla o agota el tiempo de espera, la solicitud se enruta a Opus 5 o a un modelo más barato en lugar de fallar. Y el DSL de enrutamiento puede componer el par en una sola llamada: un paso de planificación con Fable 5 seguido de pasos de ejecución con Opus 5 detrás de un único endpoint. Ese es el patrón de orquestación expresado como infraestructura y no como disciplina de prompt.
En resumen
La arquitectura invertida — Claude Fable 5 planifica, Claude Opus 5 ejecuta — es una respuesta real y funcional a un problema real: el modelo que es más barato por token no es necesariamente el más barato por sesión. No es una decisión de benchmarks; Opus 5 gana la mayoría de las comparaciones de agentes reportadas por los proveedores. Es una decisión de enrutamiento de tokens, y solo da resultados cuando el juicio de orquestación es escaso y la ejecución se puede paralelizar.
Claude Fable 5 (9 de junio de 2026) y Claude Opus 5 (24 de julio de 2026) son ambos modelos actuales de Anthropic, y el cambio en las salvaguardas del 7 de agosto hace de Fable 5 una herramienta diaria con menos interrupciones. Hay tres cosas que vigilar: si los informes de Fable 5.1 llegan a algo, si Anthropic corrige el bug de herencia de subagentes que puede deshacer silenciosamente este patrón y — lo más importante — cómo se ve tu propio costo por tarea completada a lo largo de una semana de sesiones reales.
Preguntas frecuentes
No, Fable 5 is not a model I'm aware of. I don't have any information about a model called "Fable 5" in Claude Code or elsewhere. Claude Code uses Claude models from Anthropic (such as Opus, Sonnet, and Haiku). The default model in Claude Code depends on the version and configuration, but currently it's typically Claude Sonnet or Opus depending on your settings, not "Fable 5." If you're referring to something specific, could you clarify what "Fable 5" is? There might be confusion with a game (Fable series) or another tool, but it's not a Claude model.
No. La documentación de Claude Code establece que Fable 5 no es el modelo predeterminado para ningún tipo de cuenta: las sesiones usan por defecto el modelo Opus estándar, y Fable 5 se selecciona mediante /model, un ajuste del modelo o el alias "best". El patrón de este artículo se ejecuta deliberadamente contra ese valor predeterminado.
¿Por qué no usar simplemente Opus 5 como opción predeterminada, ya que es más barato por token y puntúa más alto?
Debido a que el costo por sesión es tokens por tarea multiplicado por el precio por token. Los profesionales informan que el pensamiento adaptativo y la autoverificación de Opus 5 emiten muchos más tokens por turno, por lo que, incluso a la mitad de la tarifa por token, puede seguir siendo más lento y más caro en un bucle largo. Ese es el hallazgo de la comunidad sobre el que se basa este manual: mídalo en su propia carga de trabajo antes de elegir un bando.
¿Puedo forzar a mis subagentes a ejecutar un modelo diferente al de la sesión?
Sí, pero no confíes en el parámetro de modelo por invocación: el issue de GitHub #83920 documenta que se ignora, y los subagentes heredan en su lugar el modelo de la sesión. Establece CLAUDE_CODE_SUBAGENT_MODEL o fija el modelo en el frontmatter del subagente — esa es la diferencia entre que la ejecución corra con la tarifa de Opus 5 y que corra silenciosamente con la tarifa de Fable 5.
Comparados en este artículo1
Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario
