Carte de titre principale intitulée « Claude Opus 5.5 exécute, Claude Fable 5.1 conseille » avec pour sous-titre « Tarification de la boucle de conseil de Claude Code », un diagramme de gauche à droite montrant Fable 5.1 rédigeant le plan, Opus 5.5 exécutant la boucle, et une flèche de rétroaction courbe étiquetée « conseille et vérifie », ainsi que le logo OrcaRouter dans le coin inférieur droit.
Guides & Insights

Claude Opus 5.5 exécute, Claude Fable 5.1 conseille : tarifer la boucle de conseiller de Claude Code

Auteur

Gideon Frost

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Claude Fable 5.1 écrit le plan de conception. Claude Opus 5.5 l'exécute en boucle. Fable 5.1 revient en tant que conseiller et accepte ou rejette le résultat. C'est le schéma que X/@dotey a publié le 22 septembre 2026 — le jour où le fournisseur a publié Claude Opus 5.5 — en le présentant comme un arrangement économe en tokens, adopté sous la pression des coûts : régler le conseiller sur Fable, exécuter Opus, et laisser le modèle coûteux ne s'exprimer qu'aux points de décision. Ce qu'ils utilisent n'est plus une astuce de prompt ni une configuration de sous-agent. C'est l'outil conseiller intégré de Claude Code, une fonctionnalité côté serveur facturée aux tarifs du modèle conseiller, en plus de tout ce que dépense le modèle principal. Et le conseil est la partie bon marché. Relire la conversation pour le produire ne l'est pas — le contexte de l'exécuteur est devenu bon marché à relire, et celui du conseiller ne l'a jamais été. Cette seule asymétrie décide si la boucle vaut la peine d'être lancée, et c'est ce que le reste de cet article chiffre.

Ce qu'est réellement la boucle

L'outil conseiller associe votre modèle principal à un second modèle, généralement plus puissant, que Claude consulte à des moments clés — avant de s'engager dans une approche, lorsqu'une erreur se répète, ou avant de déclarer une tâche terminée. Le conseiller reçoit la conversation complète, y compris chaque appel d'outil et son résultat, et renvoie des conseils que le modèle principal applique ensuite. Il n'appelle jamais d'outils et ne produit jamais de sortie destinée à l'utilisateur. Vous choisissez quel modèle conseille ; Claude décide quand l'appeler.

Cette dernière partie est ce qui distingue cela du schéma orchestrateur-et-sous-agents que la communauté Claude Code faisait circuler en août. Les sous-agents, c’est de la délégation : un planificateur décompose le travail et le répartit entre des workers, et vous configurez explicitement le modèle de chaque voie. L’advisor, c’est de l’escalade : un seul modèle pilote toute la tâche, et le modèle coûteux est sollicité en cours de route pour une décision que le pilote ne peut pas prendre seul. Il n’y a pas de pool de workers, pas de graphe de tâches, ni de prompt d’orchestration à maintenir. La boucle pratique que décrit @dotey — planifier, exécuter, vérifier, répéter — voilà à quoi ressemble ce mécanisme quand on dirige l’advisor vers Fable 5.1 et qu’on le laisse contrôler la condition de sortie de la boucle.

La façon dont Anthropic présente elle-même cette stratégie est sans détour quant à la forme du gain : le conseiller « ne peut transmettre que la capacité qui manque à l’exécutant ». Tout ce qui suit découle de l’ampleur de la capacité qui manque réellement, et de la fréquence à laquelle l’exécutant l’admet.

Pourquoi Claude Opus 5.5 a changé l’arithmétique

A two-column scoreboard. Left column, Claude Opus 5.5 as executor: input $4.00 per million, output $20.00 per million, cache read $0.20 per million, role 'runs the loop', effort default medium, benchmarks vendor-reported. Right column, Claude Fable 5.1 as advisor: input $10.00 per million, output $50.00 per million, cache read $0.25 per million, role 'advises at decision points', each consult a full transcript and uncached, benchmarks vendor-reported. A footer notes the prices are from Anthropic's published rate card, September 2026, with no independent scores.

Grille tarifaire publiée par Anthropic, par million de tokens. Ce sont des chiffres du fournisseur, et non des estimations :

• Claude Opus 5.5 — 4 $ en entrée, 20 $ en sortie, 0,20 $ pour la lecture du cache, 5 $ pour une écriture de cache de 5 minutes

Claude Opus 5 — 5 $ en entrée, 25 $ en sortie, 0,50 $ en lecture de cache, 6,25 $ pour une écriture de cache de 5 minutes

• Claude Fable 5.1 — 10 $ en entrée, 50 $ en sortie, 0,25 $ pour la lecture du cache, 12,50 $ pour l'écriture d'un cache de 5 minutes

Deux détails de cette liste importent davantage que les prix affichés. D’abord, les lectures de cache sur Opus 5.5 représentent 5 % de l’entrée de base, selon la propre note de bas de page d’Anthropic, alors que la plupart des modèles Claude se situent à 10 % et que Fable 5.1 se situe à 2,5 %. Fable 5.1 a le meilleur multiplicateur et perd tout de même en dollars absolus — 0,20 $ contre 0,25 $ — parce que son tarif d’entrée de base est deux fois et demie plus élevé.

Deuxièmement, et c'est là le mécanisme sur lequel repose toute la boucle : activer ou désactiver l'advisor dans Claude Code n'invalide pas le cache de prompt du modèle principal, de sorte que le long contexte de l'exécuteur, renvoyé à maintes reprises, reste bon marché, à 0,20 $ le million. La lecture de la conversation par l'advisor lui-même, elle, n'est pas mise en cache. Chaque consultation retraite l'intégralité de la transcription, au tarif d'entrée de Fable 5.1, soit 10 $ le million. Un exécuteur qui relit dix fois un contexte de 500 K tokens paie des lectures de cache ; un advisor consulté dix fois paie dix factures d'entrée fraîches sur une transcription qui ne cesse de grossir. Plus le contexte de votre exécuteur devient bon marché, plus la lecture non mise en cache de l'advisor ressort — et Opus 5.5 vient de rendre le contexte de l'exécuteur 60 % moins cher que celui d'Opus 5.

Configurer dans Claude Code

L'outil Advisor est expérimental et Anthropic le précise dans la bannière de session — « Advisor Tool (experimental) est activé et peut utiliser davantage de tokens. » Le comportement, la tarification et la disponibilité peuvent changer. Cette mise en garde étant faite, les mécanismes sont documentés :

Screenshot of Anthropic's Claude Code documentation page for the advisor tool, showing the table of contents (Advisor, Availability, How it works, Supported pairings, How the advisor sees your conversation, Using the advisor, Model selection, Advisor response, Consuming the advisor result, Usage, Pricing, Rate limits, Troubleshooting, Tool use errors, Silent fallback) and body text confirming the tool is experimental and server-side, is available on the Anthropic API only, pairs the main model with a second model that advises at key moments, and that the advisor sees the full conversation including tool calls and results.

• Activez-le avec /advisor fable, ou exécutez /advisor sans argument pour afficher un sélecteur. Le choix est enregistré dans le paramètre advisorModel de vos paramètres utilisateur et persiste entre les sessions. /advisor off le désactive.

• Pour une seule session, sans modifier la valeur par défaut enregistrée, lancez avec claude --advisor fable. L'option n'est pas répertoriée dans claude --help, et Claude Code s'arrête au lancement si l'association n'est pas valide, au lieu de démarrer avec un conseiller ignoré en silence.

• Définir une valeur par défaut persistante dans votre fichier de paramètres avec {"advisorModel": "fable"}.

• Pour le désactiver complètement, définissez CLAUDE_CODE_DISABLE_ADVISOR_TOOL=1 — la commande /advisor disparaît et tout advisorModel configuré est ignoré.

• L'appariement doit être au moins aussi performant que le modèle principal. Claude Opus 5.5 accepte Fable et Opus 5 ou version ultérieure comme conseillers. Un conseiller Opus 4.6 ou Sonnet est rejeté par Claude Code ; un conseiller Opus 4.7 ou Opus 4.8 est attaché, puis refusé par l'API. Fable 5.1 en tant que modèle principal n'accepte que Fable 5.1.

• Versions minimales : l’outil advisor nécessite Claude Code v2.1.98 ou version ultérieure ; Fable, comme modèle principal ou comme advisor, nécessite v2.1.170 ou version ultérieure ; Fable 5.1 nécessite v2.1.257 ou version ultérieure. La forme avec jeton de /advisor — celle qui fonctionne dans -p, l’Agent SDK, l’application de bureau et Remote Control — nécessite v2.1.260 ou version ultérieure.

• L'advisor n'est disponible que via l'API Anthropic. Il n'est pas disponible sur Amazon Bedrock, Claude Platform on AWS, Google Cloud's Agent Platform ou Microsoft Foundry, et il dépend de la récupération de feature flags : ainsi, une session dans laquelle une variable telle que DISABLE_TELEMETRY est définie le maintient désactivé.

• Sur les offres où l'utilisation de Fable est facturée en crédits d'utilisation, Fable en tant que conseiller est facturé de la même manière et nécessite un consentement unique. Tant que vous ne l'acceptez pas, /advisor fable n'est pas enregistré et claude --advisor fable se ferme au lancement en vous renvoyant plutôt vers /model fable.

Les sous-agents héritent de l'advisor que vous avez configuré, quel qu'il soit, et refont la même vérification d'appariement sur leur propre modèle. C'est la seule interaction entre ce pattern et le pattern des sous-agents : un sous-agent qui exécute un modèle plus petit peut avoir droit à un advisor que son parent n'a pas.

La structure des coûts, analysée en détail

Rien de ce qui suit n’est une mesure. La forme des tokens est inventée pour rendre l’arithmétique visible ; les prix sont les tarifs publiés d’Anthropic. Supposons une session d’exécuteur qui lit 1 M de tokens d’entrée frais et émet 500 K tokens de sortie, ainsi que trois consultations de conseiller, chacune relisant une transcription de 200 K tokens et renvoyant environ 600 tokens de conseils — soit à peu près les deux à trois consultations par tâche que demande le prompt système d’Anthropic lui-même.

• Exécuteur sur Claude Opus 5.5 — 1 M en entrée à 4,00 $ plus 500 k en sortie à 10,00 $ = 14,00 $

• Conseiller sur Claude Fable 5.1 — 600 K de jetons d'entrée à 6,00 $ plus environ 1 800 jetons de sortie à environ 0,09 $ = 6,09 $

• La boucle, total — environ 20,09 $

• La même forme exécutée de bout en bout sur Fable 5.1 — 10,00 $ en entrée plus 25,00 $ en sortie = 35,00 $

• La même forme sur Opus 5.5 seul — $14.00

La boucle se situe entre les deux, ce qui est exactement là où Anthropic la positionne : environ 43 % moins cher que d’utiliser Fable 5.1 tout du long, et environ 44 % plus cher que l’exécuteur seul. Considérez le second chiffre comme le plus honnête. Le conseiller n’est pas une économie ; c’est l’achat d’un jugement de qualité Fable sur trois décisions, et il n’est rentable que si ces trois décisions changent le résultat. Faites passer la transcription à la fenêtre de contexte de 1 M, et chaque consultation coûte 10 $ à elle seule. Laissez l’exécuteur commencer à demander sur la plupart des tâches plutôt que sur quelques-unes, et vous payez des tarifs de conseiller sur toute la charge de travail — auquel cas, comme le dit Anthropic, faire tourner le modèle du conseiller lui-même est la voie la moins chère pour obtenir le même score.

Ce que disent les propres mesures d’Anthropic

Anthropic a publié des résultats mesurés pour ce schéma, et ils sont rapportés par le fournisseur : exécutés par l’entreprise qui vend les deux modèles, sur son propre banc d’essai de référence. Ils restent les seuls chiffres de ce type, et ils incluent les arguments contre ce schéma, c’est pourquoi ils valent la peine d’être lus attentivement.

• Opus 5 comme exécuteur avec Fable 5.1 comme conseiller a obtenu 7,69 $ par tentative sur le benchmark interne de codage agentique d'Anthropic — la configuration la plus précise qu'Anthropic ait mesurée. C'est 3,5 points de plus qu'Opus 5 seul dans sa configuration par défaut, pour un coût légèrement inférieur, et environ 2,5 points de plus que Fable 5.1 seul, pour environ une fois et demie ce coût. L'écart de 3,5 points a été distingué du bruit d'une exécution à l'autre grâce à cinq tentatives par tâche.

• Le même appariement sur la lecture de graphiques a égalé Fable 5.1 seul à effort moyen, dans la marge d'erreur — 65,0 contre 67,5 — à environ 2,6 fois le coût par tâche, parce que le conseiller a été consulté pour presque toutes les tâches.

• Sur GPQA Diamond, le gain suit presque parfaitement l’écart de capacités : un exécuteur Haiku 4.5 a beaucoup gagné, un exécuteur Sonnet 5 quelques points, et un exécuteur de pointe presque rien.

• Le taux de consultation est la variable fragile. Un exécuteur Sonnet 5 à faible effort a gagné 23 points sur DeepSWE avec un conseiller, puis a complètement cessé de poser des questions sur SWE-bench Pro et n’a rien gagné.

• Latence : environ deux appels supplémentaires à des modèles de pointe par tâche, chacun sur le chemin critique.

Deux choses, dans ces éléments de preuve, concernent directement la boucle telle qu’elle se présente cette semaine. Les mesures utilisaient Opus 5 comme exécuteur, car Opus 5.5 n’existait pas encore lorsqu’elles ont été effectuées. Et Anthropic indique qu’Opus 5.5 atteint le niveau de Fable 5.1 sur la plupart des tâches tout en coûtant 40 % de moins à exécuter — deux affirmations du fournisseur, aucune n’ayant été reproduite indépendamment. Si l’écart entre l’exécuteur et le conseiller est ce que le conseiller est payé pour combler, alors un écart plus étroit représente un achat plus petit. Le schéma ne s’est pas aggravé lorsque Opus 5.5 est sorti ; ce qu’il vend est devenu moins rare.

Les modes de défaillance que vous rencontrerez réellement

Ce sont des comportements documentés, non des spéculations, et le premier est la raison de lire cette section avant de déboguer quoi que ce soit :

• Un conseiller silencieusement absent. Si l'API refuse l'appairage du conseiller, Claude Code le joint, l'API le refuse, puis Claude Code renvoie la requête sans le conseiller. Le reste de la conversation se déroule alors sans conseiller et sans message d'erreur. Il reste désactivé jusqu'à /clear ou /compact, même après être passé à un modèle principal compatible.

• Un rejet silencieux. Pour les associations que Claude Code lui-même rejette, l'advisor n'est tout simplement jamais attaché aux requêtes du modèle principal. La sortie de /advisor et une notification vous l'indiquent — mais rien n'échoue, si bien qu'une session dont vous pensiez qu'elle bénéficiait de l'advisor peut en réalité ne jamais l'avoir fait.

• Consentement non accordé. Lorsque Fable est sélectionné comme conseiller sur un plan qui nécessite le consentement à l’utilisation des crédits, les requêtes sont envoyées sans le conseiller jusqu’à ce que vous l’acceptiez. Une session en arrière-plan démarrée avec --advisor fable démarre sans conseiller plutôt que de se fermer.

• Une liste d'autorisation que vous ne contrôlez pas. Si la liste d'autorisation availableModels de votre organisation exclut le modèle conseiller, Claude Code ne l'invoquera pas, et vous devez choisir un modèle autorisé avec /advisor.

• Partout où il n’existe pas. API Anthropic uniquement : pas de Bedrock, pas de Claude Platform on AWS, pas de Google Cloud Agent Platform, pas de Microsoft Foundry. Via une passerelle, la disponibilité dépend de si la passerelle transmet la requête intacte à l’API d’Anthropic — ce qui est une propriété de la passerelle, et non quelque chose que vous pouvez supposer.

Où OrcaRouter s'intègre

Les deux modèles de cette boucle sont disponibles sur OrcaRouter dès aujourd'hui au prix catalogue d'Anthropic lui-même, avec 0 % de marge — le prix catalogue du fournisseur est répercuté tel quel, donc le tarif que vous voyez est celui qu'Anthropic publie. Claude Fable 5.1 se trouve à anthropic/claude-fable-5.1 et Claude Opus 5 à anthropic/claude-opus-5, derrière une seule clé API. Claude Opus 5.5 ne fait pas encore partie de nos routes ; il est disponible via l'API d'Anthropic elle-même et les principaux clouds, et nous préférons le dire plutôt que de laisser entendre le contraire.

Screenshot of the OrcaRouter model page for Claude Fable 5.1 (anthropic/claude-fable-5.1), showing the model header, capability tags and the model description.

Ce qu'une seule clé vous achète ici, c'est la possibilité de changer d'avis à moindre coût. L'économie de la boucle dépend du rapport de prix entre l'exécuteur et le conseiller, et ce rapport a bougé deux fois en sept semaines — d'Opus 5 à Opus 5.5 le 22 septembre, et de Fable 5 à Fable 5.1 le 1er septembre, ce qui a fait passer la lecture du cache de ce modèle de 1,00 $ à 0,25 $ par million. Chacun de ces mouvements change la réponse à « le conseiller en vaut-il la peine », et tester cette réponse ne devrait pas exiger un second contrat. Basculement automatique en est l'autre moitié : il vous permet de diriger une partie du trafic vers un modèle que vous n'avez pas encore caractérisé, avec un repli vers celui que vous avez, au lieu de parier un chemin de production sur un tableau de lancement. Et si vous mettez en place ce schéma vous-même plutôt que d'utiliser l'outil intégré de Claude Code, le DSL de routage compose plusieurs modèles en un seul appel — une étape de planification sur un modèle suivie d'étapes d'exécution sur un autre, derrière un seul point de terminaison.

Une précision en toute honnêteté sur le périmètre : l’outil advisor lui-même est un outil côté serveur qui s’exécute sur l’API d’Anthropic, donc une couche de routage ne le remplace pas. Ce que nous pouvons faire, c’est rendre les modèles accessibles à une clé près, au prix catalogue, afin que la décision de conserver ou d’abandonner l’advisor vous revienne, à partir de vos propres chiffres.

Comment décider pour votre propre charge de travail

Les recommandations d’Anthropic elles-mêmes constituent le bon point de départ, et elles sont d’un pragmatisme rafraîchissant : exécutez votre suite d’évaluation sur trois configurations — l’exécuteur seul, l’exécuteur avec un conseiller, et le modèle du conseiller seul en effort faible — et revérifiez à chaque sortie de modèle, car les sorties modifient à la fois l’écart de capacités et le rapport de prix. La dernière de ces trois est la référence à battre. Si le modèle de votre conseiller seul en effort faible obtient le même score que la boucle pour moins d’argent, vous avez votre réponse.

Les deux variables à surveiller sont celles qu'Anthropic nomme. L'écart de capacités : un écart important entre l'exécuteur et le conseiller est ce qui justifie les honoraires du conseiller, et Opus 5.5 a réduit cet écart par le bas. Le taux de consultation : les gains le suivent presque un pour un, et il est suffisamment sensible au prompt pour s'effondrer — un exécuteur à faible effort peut cesser de remarquer qu'il est bloqué, et un appariement qui consulte sur la plupart des tâches à l'effort par défaut peut tomber à presque rien. Le prompt système fourni par Anthropic demande un appel au conseiller avant le travail de fond et un autre avant de terminer, ce qui aboutit à deux ou trois consultations par tâche ; l'appariement de codage qui a produit le gain de 3,5 points fonctionnait à cette cadence. Prévoyez un budget pour cela, plafonnez-le, et traitez chaque consultation au-delà comme un signal que votre exécuteur est mal configuré plutôt que comme le signe que la tâche était difficile.

Pour la boucle spécifique décrite dans cet article, trois réglages concrets font l'essentiel du travail. Gardez Claude Opus 5.5 à son effort moyen par défaut plutôt que de passer à élevé, car l'effort influe directement sur le coût et les propres chiffres d'Anthropic pour Opus 5.5 montrent que le niveau moyen ne sacrifie que très peu. Configurez le conseiller avec /advisor fable et vérifiez que le bandeau apparaît bien — un bandeau absent signifie un conseiller silencieusement absent. Et avant de faire passer ce schéma à l'échelle, mesurez les jetons par tâche terminée plutôt que le prix par jeton, car c'est ce nombre que la boucle est censée faire évoluer.

FAQ

Le conseiller consomme-t-il le même quota Fable qu'une session Fable ?

En matière de facturation API, les tokens de l’advisor sont facturés aux tarifs d’entrée et de sortie propres à Fable 5.1, et les limites de débit de l’advisor proviennent du même compartiment par modèle que les appels directs à ce modèle — ainsi, un appel d’advisor soumis à une limite de débit se manifeste sous forme d’erreur dans le résultat de l’outil plutôt que de faire échouer votre requête. Dans le cadre des forfaits d’abonnement, l’utilisation de l’advisor est comptabilisée dans les limites d’utilisation de votre forfait, sauf qu’un advisor Fable est facturé en crédits d’utilisation sur les forfaits où l’utilisation de Fable l’est. La conséquence pratique est que l’advisor ne constitue pas un budget distinct que vous pouvez dépenser librement ; il entre en concurrence avec tout le reste de ce que vous faites sur ce modèle.

Que voit réellement le conseiller ?

L'intégralité de la conversation, y compris chaque appel d'outil et chaque résultat d'outil — contenu des fichiers, sortie de commande, messages d'erreur, tout le reste. Il fonctionne sous son propre prompt système fourni par Anthropic et renvoie un plan, une correction ou un signal d'arrêt. Deux détails en découlent. Premièrement, chaque consultation relit toute la transcription, ce qui explique pourquoi le coût augmente avec la boucle au lieu de rester constant. Deuxièmement, si votre session touche à des éléments que vous n'enverriez pas à un second modèle au palier tarifaire du conseiller, le conseiller est un second modèle qui lit tout.

Qu’est-ce qui changerait la réponse ?

Deux choses, et toutes deux sont plus proches qu’elles n’en ont l’air. Si des évaluateurs indépendants publient une exécution à effort égal d’Opus 5.5 face à Fable 5.1 et confirment le resserrement revendiqué par Anthropic, l’avantage restant du conseiller sur la plupart des tâches est mince — et la boucle devient un outil pour les cas les plus difficiles plutôt qu’un choix par défaut. Si, au contraire, le taux de consultation se maintient et que l’écart de capacités reste large sur les longs travaux agentiques, l’arithmétique ci-dessus, ce sont les termes entre lesquels vous arbitrez, et 6 $ de conseil sur une exécution à 14 $ est une option bon marché pour ne pas livrer la mauvaise chose.

Ce qui ne changera pas, c'est le mécanisme en tête de ce texte. Le contexte de l'exécuteur est mis en cache et peu coûteux ; celui du conseiller ne l'est ni l'un ni l'autre. Toute boucle qui consulte un modèle plus coûteux en cours de tâche hérite de cette asymétrie, quoi qu'en dise la grille tarifaire le mois prochain.

Comparés dans cet article1

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement