Carte de titre principale pour l'article 'Claude Fable 5 as Your Orchestrator' montrant un nœud central Claude Fable 5 se déployant en éventail vers quatre nœuds de travail sous-agents Opus 5 plus petits, avec le sous-titre 'A Claude Code subagent playbook for keeping token costs down' et le logo OrcaRouter incrusté dans le coin.
Guides & Insights

Claude Fable 5 comme votre orchestrateur : le guide des sous-agents qui maîtrise les coûts de jetons

Auteur

Rowan Sterling

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Le 7 août, Anthrop​ic a apporté le plus grand changement unique à Claude Fable 5 depuis le lancement du modèle le 9 juin : il a réduit les « fallbacks » liés à la biologie d'environ 85 %, de sorte que les questions de santé et d'éducation courantes reçoivent désormais une réponse directe au lieu de basculer silencieusement vers un modèle plus faible. La tendance qui se répand en réalité cette semaine dans la communauté Claude Code n'a cependant rien à voir avec la biologie. Les praticiens ne cessent de publier un flux de travail dans lequel Claude Fable 5 exécute la boucle d'orchestration — clarification des exigences, décomposition du plan, répartition des tâches, acceptation des résultats — tandis que l'exécution est déléguée à des sous-agents Claude Opus 5. Le bénéfice annoncé : Fable 5 High devient une option par défaut abordable pour les sessions, et la verbosité de Claude Opus 5 cesse d'épuiser la session.

L'exemple le plus récent est celui de @dotey, publié le 14 août : un ajout court à ~/.claude/CLAUDE.md qui dit à l'agent d'ouvrir des sous-agents Opus pour l'exécution, laissant Claude Fable 5 à un effort de raisonnement élevé comme valeur par défaut de la session, l'auteur indiquant que la consommation de jetons reste raisonnable — et une raison brutale pour ne pas exécuter Claude Opus 5 par défaut : entre ses mains, c'était trop lent et brûlait un énorme nombre de jetons dans la boucle principale. C'est une découverte de la communauté, pas une recommandation d'Anthrop​ic — et il vaut la peine de la comprendre avant de la copier, car sur le papier elle semble inversée.

Le modèle en un paragraphe. Dans Claude Code, les sous-agents héritent par défaut du modèle de votre session. Pour conserver une boucle rapide et économique, il faut donc faire du modèle de session le planificateur et orienter explicitement les exécuteurs vers un autre modèle. Claude Fable 5 — le modèle de classe Mythos d'Anthrop​ic, rendu sûr pour un usage général, publié le 9 juin 2026, à 10 $/50 $ par million de jetons — détient les exigences, décompose le travail, répartit les tâches et accepte les résultats. Claude Opus 5 — publié le 24 juillet 2026, à 5 $/25 $ par million de jetons — exécute les implémentations réelles dans les sous-agents. Vous dépensez un jugement de niveau Fable pour les quelques tours d'orchestration et une exécution de niveau Opus pour les nombreux tours d'exécution, où la majeure partie des jetons va déjà.

Pourquoi le modèle de boucle principale est le vrai problème de coût

Sur les benchmarks, cela ressemble à un problème résolu — et la réponse semble être « choisir Opus 5 par défaut ». Les propres chiffres d'Anthrop​ic (rapportés par le fournisseur, non reproduits) placent Claude Opus 5 devant Claude Fable 5 sur le benchmark de codage agentique Frontier-Bench v0.1 (43,3 % contre 33,7 %), sur SWE-bench Verified (96,0 % contre 95,5 %) et sur ARC-AGI-3 (30,2 %, soit environ 4 fois celui du meilleur modèle public suivant). Anthrop​ic positionne Opus 5 comme se rapprochant de l'intelligence de pointe de Fable 5 à moitié prix. Si vous choisissez un modèle par défaut pour la session uniquement sur la base des benchmarks du fournisseur et du prix par jeton, Opus 5 est le choix évident.

Les praticiens qui font réellement tourner de longues sessions arrivent au réglage par défaut opposé, et la raison réside dans les jetons par tâche, pas le prix par jeton. Le mode réflexion d'Opus 5 est activé par défaut et adaptatif, et Anthropic affirme qu'il vérifie son propre travail sans y être invité — ce qui signifie, en pratique, que chaque tour de boucle émet nettement plus de jetons que celui de Fable 5. Désactiver cette réflexion est plafonné à un effort élevé, donc vous ne pouvez pas la rendre complètement économe. Sur une session qui dure des heures, c'est la boucle qui a un effet cumulé : le modèle le moins cher par jeton peut se révéler le plus cher par session, et le modèle qui parle le moins maintient la boucle rapide.

Cela correspond à ce que rapporte @dotey. La configuration inversée maintient une consommation de tokens « pas mal » précisément parce qu'Opus 5 — le verbeux — est confiné aux sous-agents, où sa sortie est le livrable plutôt que la surcharge.

L'architecture inversée : Fable 5 planifie, Opus exécute

L'architecture est simple à énoncer et un peu contre-intuitive à exécuter :

• Modèle de session — Claude Fable 5 avec un effort de raisonnement élevé (le « High » dans l'abréviation communautaire « Fable 5 High »). Il possède la conversation, le plan et la définition de done.

• Les tours d'orchestration — clarification des exigences, décomposition du plan, répartition des tâches et acceptation des résultats — se déroulent tous sur Fable 5. Ces tours sont peu nombreux et représentent une petite part du total des jetons.

• Tours d’exécution — chaque tâche est confiée à un sous-agent exécutant Claude Opus 5. Ce sont les nombreux tours et l’essentiel de la dépense de jetons — et c’est sur Opus 5 que les scores agentiques rapportés par le fournisseur sont les plus élevés.

L'économie fonctionne parce que les deux courbes de coût pointent dans des directions différentes. La force de Fable 5 est le jugement ; on l'utilise avec parcimonie. La force d'Opus 5 est l'exécution ; on l'utilise intensivement, mais en parallèle, isolée de la boucle. La boucle reste rapide et peu coûteuse, et la capacité coûteuse est dépensée exactement là où les jetons sont de toute façon dépensés.

Ceci est l'un des deux modèles communautaires en circulation, et ils sont le miroir l'un de l'autre. Le « motif architecte », plus couramment recommandé (utilisé, par exemple, par le plugin fable-advisor), fait fonctionner Opus comme architecte à temps plein et réserve Fable 5 pour le couloir d'implémentation de plus haute complexité ainsi qu'une revue obligatoire en fin de livrable. La différence réside dans un objectif d'optimisation : le motif architecte dépense des jetons de niveau Opus en coordination et utilise Fable 5 comme un scalpel ; le motif inversé utilise Fable 5 pour la coordination et Opus 5 pour le volume. Les deux sont des recommandations communautaires — Anthrop​ic n'en documente aucun — et les deux sont des tentatives de dépenser des jetons de pointe là où ils changent le résultat.

Configurer dans Claude Code

Claude Code n'a pas de « mode orchestrateur » intégré ; le pattern est donc appliqué de deux façons : des instructions dans le prompt de session et des épinglages de modèle explicites du côté de l'exécution.

La couche d'instructions se trouve dans ~/.claude/CLAUDE.md — le même fichier que @dotey a modifié. Dans sa forme, le prompt demande à l'agent principal de faire quatre choses avant de considérer toute tâche comme accomplie :

• Reformuler l’exigence et confirmer le périmètre avant d’écrire le code.

• Décomposez le travail en tâches pouvant s’exécuter en parallèle.

• Répartissez chaque tâche d'exécution vers un sous-agent épinglé à Claude Opus 5.

Vérifiez chaque résultat par rapport au plan avant de l'accepter.

Cette forme mérite d'être énoncée comme une ligne directrice plutôt que comme un extrait à coller — vos exigences et votre pile technologique changent ce qui doit y figurer.

La couche de modèle est plus importante que ce que la plupart des configurations supposent. Dans Claude Code, l'ordre de résolution du modèle des sous-agents est : la variable d'environnement CLAUDE_CODE_SUBAGENT_MODEL, puis un paramètre de modèle par invocation, puis le frontmatter de la définition de l'agent, puis le modèle de session. Les agents sans modèle défini héritent du modèle de session. Ainsi, si votre session tourne sur Fable 5 et que vous comptez sur l'argument modèle de l'outil Agent, il existe un risque documenté qu'il soit ignoré (GitHub issue #83920) : les sous-agents héritent de toute façon du modèle de session, et vous payez le tarif Fable 5 pour une exécution que vous aviez prévu de lancer sur Opus 5.

Deux solutions fiables : définir CLAUDE_CODE_SUBAGENT_MODEL=claude-opus-5 pour la session, ou épingler le modèle dans le frontmatter du sous-agent. Cette seule variable est la différence entre le pattern fonctionnant comme prévu et l'exécution silencieuse de toute la session sur le modèle coûteux.

La logique mathématique des tokens derrière la scission.

Voici les deux modèles tels qu'ils sont tarifés aujourd'hui (prix publiés par le fournisseur, et répercutés au prix catalogue sur OrcaRouter) :

• Claude Fable 5 — 10 $ par 1M de jetons en entrée, 50 $ par 1M en sortie ; contexte de 1M de jetons, sortie de 128K.

• Claude Opus 5 — 5 $ par 1 M de jetons en entrée, 25 $ par 1 M en sortie ; contexte de 1 M de jetons, sortie de 128 K.

A comparison scoreboard for Claude Fable 5 and Claude Opus 5 contrasting price ($10/$50 vs $5/$25 per 1M tokens), context (both 1M in / 128K out), Frontier-Bench v0.1 (33.7% vs 43.3%), SWE-bench Verified (95.5% vs 96.0%), loop behaviour, and the role each plays in the orchestrator pattern, with a footer noting prices are vendor-published and benchmarks vendor-reported.

La partie contre-intuitive est qu'Opus 5 est moitié moins cher par token et peut pourtant perdre la bataille des coûts par session. La structure est facile à voir avec des ordres de grandeur : si la boucle sur Opus 5 émet deux à trois fois plus de tokens que la boucle sur Fable 5 — un chiffre illustratif conforme aux retours des praticiens sur le comportement d'auto-vérification d'Opus 5, pas une valeur mesurée — alors même à moitié prix par token, la boucle coûte à peu près la même chose, et si l'écart est plus grand, Opus dans la boucle coûte plus cher. Pendant ce temps, les tokens d'exécution, le gros de la session, restent sur Opus 5 dans les sous-agents au tarif réduit dans les deux cas.

Voilà tout l'argument du schéma inversé : placer sur la boucle le modèle dont le prix par jeton est plus élevé mais dont la boucle est plus légère, et placer le modèle moins cher par jeton sur le volume. C'est une décision de routage déguisée en décision de modèle.

Parce qu'OrcaRouter transmet les prix des fournisseurs avec une marge de 0 %, les chiffres ci-dessus sont exactement ce que vous payez ici — sans frais de plateforme supplémentaires — et si Anthrop​ic réduit l'un ou l'autre de ces prix, le changement apparaît sur la page du modèle le jour même.

Quand le motif inversé l'emporte — et quand ce n'est pas le cas.

Copier la configuration de @dotey sans vérifier la forme de votre propre charge de travail est une erreur dans les deux sens.

Le motif inversé gagne lorsque :

• Les exigences sont ambiguës ou le plan comporte de nombreuses parties mobiles — le jugement d'orchestration est la ressource rare.

• L'exécution peut être parallélisée en sous-agents — le volume sort de la boucle.

• Les sessions sont longues — la verbosité des boucles s'accumule en un coût réel.

Le conseil standard prévaut lorsque :

• La majeure partie de votre session est un travail circonscrit et mécanique — un planificateur de niveau Fable est excessif, et le prix plus bas d'Opus 5 ainsi que ses meilleurs scores aux benchmarks en font le choix par défaut évident. C'est pourquoi la documentation de Claude Code fait d'Opus le choix par défaut de session et réserve Fable 5 à une sélection explicite.

• Vous ne pouvez pas épingler de manière fiable les modèles de sous-agent — le bug d'héritage #83920 transforme le motif inversé en « tout sur la tarification de Fable 5 ».

Il existe aussi une voie médiane de réglage. Opus 5 expose un paramètre d'effort (de faible à maximal, élevé par défaut), afin de pouvoir le pousser vers un comportement plus sobre — mais pas jusqu'au bout, car la désactivation du raisonnement est plafonnée à un effort élevé. Si votre problème est la verbosité d'Opus 5, réduire l'effort peut suffire, et vous n'aurez jamais besoin d'inverser l'architecture.

Ce que le changement de biologie du 7 août signifie pour cette configuration

La mise à jour du 7 août d'Anthrop​ic a réécrit et ré-entraîné le classificateur de biologie de Claude Fable 5 — le système qui décide si une requête déclenche un « fallback » vers un modèle moins performant. Selon les propres chiffres d'Anthrop​ic (rapportés par le fournisseur), les fallbacks liés à la biologie ont chuté d'environ 85 % sur toutes les surfaces de produits, avec une baisse globale des fallbacks d'environ 67 % sur Claude.ai, ~55 % sur Cowork, ~17 % sur Claude Code et ~7 % sur la plateforme Claude.

Screenshot of Anthropic's 'Improving Fable 5's biology safeguards' announcement dated August 7, 2026, describing the roughly 85% reduction in biology-related fallbacks across product surfaces.

Pour une configuration d'orchestration Fable 5, le numéro Claude Code est celui qui compte. Un repli, c'est le système qui bascule silencieusement votre requête vers un autre modèle — en l'occurrence Opus 5. Dans un simple chat, c'est une friction invisible ; dans une session agentique, cela signifie qu'une partie de votre pipeline tourne sur un modèle que vous n'avez pas choisi, avec un profil de coût que vous n'aviez pas planifié. La mise à jour ne supprime pas cela : la virologie, la toxicologie et la conception moléculaire basculent toujours en repli. Mais la biologie courante de la santé et de l'éducation — lire un résultat de laboratoire, comprendre un symptôme, étudier la biologie — reste désormais sur Fable 5.

Une note préalable, clairement étiquetée : des rapports non confirmés de fin juillet (36kr, WinCentral) pointent vers une possible actualisation de Claude Fable 5.1 ce mois-ci, à prix inchangé. Anthrop​ic n'a confirmé ni un nom, ni une date, ni un identifiant de modèle API — à considérer comme une spéculation jusqu'à sa sortie.

L'essayer sans risquer votre workflow.

Ce qui rend le motif inversé intéressant à essayer, c'est qu'il est réversible, et le fait d'acheminer les deux modèles via un seul point de terminaison rend l'inversion peu coûteuse.

Sur OrcaRouter, Claude Fable 5 (anthropic/claude-fable-5) et Claude Opus 5 (anthropic/claude-opus-5) se trouvent derrière une seule clé API. Vous pouvez exécuter le canal d'exécution de la session sur l'un ou l'autre modèle sans second contrat ni modification de code — ce qui est exactement ce dont une expérience comme « Fable 5 comme orchestrateur » a besoin, car tout l'intérêt est de mesurer votre propre coût par session avant de vous engager.

Screenshot of the OrcaRouter model page for Claude Fable 5 showing the slug anthropic/claude-fable-5, $10 per 1 million input tokens and $50 per 1 million output tokens, a 1M-token context, and the /v1/messages and /v1/chat/completions endpoints.

Deux fonctionnalités d'OrcaRouter correspondent directement à cette configuration. Le basculement automatique vous permet de définir une chaîne de secours — si Fable 5 renvoie une erreur ou expire, la requête est dirigée vers Opus 5 ou un modèle moins cher au lieu d'échouer. Et le DSL de routage peut composer la paire en un seul appel : une étape de planification Fable 5 suivie d'étapes d'exécution Opus 5 derrière un seul point de terminaison. C'est le modèle d'orchestration exprimé comme infrastructure plutôt que comme discipline de prompt.

En résumé

L'architecture inversée — Claude Fable 5 planifie, Claude Opus 5 exécute — est une réponse réelle et fonctionnelle à un problème réel : le modèle le moins cher par jeton n'est pas nécessairement le moins cher par session. Ce n'est pas une décision de benchmark ; Opus 5 remporte la plupart des comparaisons agentiques rapportées par les fournisseurs. C'est une décision de routage de jetons, et elle ne s'avère rentable que lorsque le jugement d'orchestration est rare et que l'exécution peut être parallélisée.

Claude Fable 5 (9 juin 2026) et Claude Opus 5 (24 juillet 2026) sont tous deux des modèles Anthrop​ic actuels, et le changement de garde-fou du 7 août fait de Fable 5 un conducteur quotidien moins interrompu. Surveillez trois choses : si les rapports de Fable 5.1 donnent quelque chose, si Anthrop​ic corrige le bug d'héritage de sous-agent qui peut silencieusement défaire ce modèle, et — surtout — à quoi ressemble votre propre coût par tâche accomplie sur une semaine de sessions réelles.

FAQ

No, "Fable 5" is not the default model in Claude Code. There is no Anthropic model called "Fable" or "Fable 5." Claude Code's default model is typically **Claude Sonnet 4.5** (or in some contexts, Claude Sonnet 4), while developers can switch between available models like Claude Opus 4.1 or Claude Haiku 4.5 using commands like `/model`. You can check the currently selected model directly inside Claude Code via its status or settings menu. If you saw "Fable 5" mentioned somewhere, it might be a nickname, a hallucination, or a different product entirely — it's not an official Anthropic model name. Want me to help clarify how model selection works in Claude Code?

Non. La propre documentation de Claude Code indique que Fable 5 n'est le modèle par défaut pour aucun type de compte — les sessions utilisent par défaut le modèle Opus standard, et vous sélectionnez Fable 5 via /model, un paramètre de modèle, ou l'alias « best ». Le procédé décrit dans cet article va délibérément à l'encontre de ce comportement par défaut.

Pourquoi ne pas simplement utiliser Opus 5 comme option par défaut, puisque c'est moins cher par jeton et que ses scores sont plus élevés ?

Car le coût par session est égal au nombre de jetons par tâche multiplié par le prix par jeton. Les praticiens rapportent que la pensée adaptative et l'auto-vérification d'Opus 5 émettent bien plus de jetons par tour, si bien qu'à moitié prix par jeton, cela peut rester plus lent et plus coûteux dans une boucle longue. C'est la conclusion de la communauté sur laquelle repose ce playbook — mesurez-la sur votre propre charge de travail avant de choisir un camp.

Puis-je forcer mes sous-agents à utiliser un modèle différent de celui de la session ?

Oui, mais ne comptez pas sur le paramètre de modèle par invocation : le problème GitHub #83920 documente qu'il est ignoré, les sous-agents héritant plutôt du modèle de session. Définissez CLAUDE_CODE_SUBAGENT_MODEL ou épinglez le modèle dans le frontmatter du sous-agent — c'est la différence entre une exécution facturée au tarif Opus 5 et une exécution silencieusement facturée au tarif Fable 5.

Comparés dans cet article1

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement