Титульная карточка с заголовком «Claude Opus 5.5 выполняет, Claude Fable 5.1 консультирует» и подзаголовком «Ценообразование цикла советника Claude Code», схема слева направо, показывающая, как Fable 5.1 пишет план, Opus 5.5 выполняет цикл, и изогнутая стрелка обратной связи с подписью «советует и проверяет», а также логотип OrcaRouter в правом нижнем углу.
Guides & Insights

Claude Opus 5.5 выполняет, Claude Fable 5.1 советует: расчёт стоимости цикла советника в Claude Code

Автор

Gideon Frost

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Claude Fable 5.1 пишет план дизайна. Claude Opus 5.5 выполняет его в цикле. Fable 5.1 возвращается в роли советника и принимает или отклоняет результат. Это тот паттерн, который X/@dotey опубликовал 22 сентября 2026 года — в день, когда вендор выпустил Claude Opus 5.5, — представив его как схему экономии токенов, сложившуюся под давлением затрат: назначить советником Fable, запустить Opus и позволить дорогой модели говорить только в точках принятия решений. То, что они используют, — уже не трюк с промптом и не конфигурация субагента. Это встроенный инструмент советника Claude Code, серверная функция, тарифицируемая по ставкам модели-советника, поверх всего, что тратит основная модель. И сам совет — дешёвая часть. А вот повторное чтение разговора, чтобы его выдать, — нет: контекст исполнителя стало дёшево перечитывать, а контекст советника — никогда. Именно эта асимметрия решает, стоит ли вообще запускать такой цикл, и именно её оценивает в цифрах остальная часть этой статьи.

Что на самом деле представляет собой цикл

Инструмент советника подключает к вашей основной модели вторую, обычно более сильную модель, с которой Claude советуется в ключевые моменты — прежде чем остановиться на каком-либо подходе, когда ошибка повторяется снова и снова или прежде чем объявить задачу выполненной. Советник получает полную историю переписки, включая каждый вызов инструмента и его результат, и возвращает рекомендации, которые основная модель затем применяет. Он никогда не вызывает инструменты и никогда не создаёт вывод, обращённый к пользователю. Вы выбираете, какая модель даёт советы; Claude решает, когда к ней обращаться.

Эта последняя часть — то, что отличает это от паттерна «оркестратор и субагенты», который циркулировал в сообществе Claude Code в августе. Субагенты — это делегирование: планировщик декомпозирует работу и распределяет её между воркерами, и вы явно настраиваете модель для каждой линии. Советник — это эскалация: одна модель ведёт всю задачу, а дорогая модель подключается по ходу выполнения для принятия решения, которое ведущая модель не может принять самостоятельно. Здесь нет пула воркеров, нет графа задач и нет промпта оркестрации, который нужно поддерживать. Практический цикл, который описывает @dotey — планирование, выполнение, проверка, повторение — это то, как выглядит этот механизм, когда вы нацеливаете советника на Fable 5.1 и позволяете ему контролировать условие выхода из цикла.

Собственная формулировка этой стратегии от Anthropic без обиняков говорит о том, в чём именно состоит выигрыш: советник «может передать лишь ту способность, которой у исполнителя нет». Всё дальнейшее следует из того, насколько этой способности в действительности не хватает и как часто исполнитель это признаёт.

Почему Claude Opus 5.5 изменил арифметику

A two-column scoreboard. Left column, Claude Opus 5.5 as executor: input $4.00 per million, output $20.00 per million, cache read $0.20 per million, role 'runs the loop', effort default medium, benchmarks vendor-reported. Right column, Claude Fable 5.1 as advisor: input $10.00 per million, output $50.00 per million, cache read $0.25 per million, role 'advises at decision points', each consult a full transcript and uncached, benchmarks vendor-reported. A footer notes the prices are from Anthropic's published rate card, September 2026, with no independent scores.

Опубликованный тарифный план Anthropic, за миллион токенов. Это данные вендора, а не оценки:

• Claude Opus 5.5 — 4 $ за ввод, 20 $ за вывод, 0,20 $ за чтение кэша, 5 $ за запись в кэш на 5 минут

Claude Opus 5 — $5 за вход, $25 за выход, $0,50 за чтение кэша, $6,25 за 5-минутную запись кэша

• Claude Fable 5.1 — $10 за ввод, $50 за вывод, $0,25 за чтение кэша, $12,50 за запись в кэш на 5 минут

Две детали в этом списке важнее, чем заявленные цены. Во-первых, чтения из кэша на Opus 5.5 составляют 5% от базовой цены ввода — согласно собственной сноске Anthropic, тогда как у большинства моделей Claude этот показатель равен 10%, а у Fable 5.1 — 2,5%. У Fable 5.1 множитель лучше, но в абсолютных долларах она всё равно проигрывает — $0,20 против $0,25 — потому что её базовая ставка ввода в два с половиной раза выше.

Во-вторых — и именно на этом механизме держится весь цикл: переключение советника в Claude Code не аннулирует кэш промптов основной модели, поэтому длинный, многократно переотправляемый контекст исполнителя остаётся дешёвым — $0,20 за миллион. Собственное прочтение советником разговора не кэшируется. Каждое обращение заново обрабатывает весь транскрипт по ставке Fable 5.1 — $10 за миллион входных токенов. Исполнитель, который десять раз перечитывает контекст в 500K токенов, платит за чтение из кэша; советник, к которому обратились десять раз, десять раз платит за свежий ввод по транскрипту, который всё это время растёт. Чем дешевле становится контекст вашего исполнителя, тем заметнее некешированное чтение советника, — а благодаря Opus 5.5 контекст исполнителя только что стал на 60% дешевле, чем у Opus 5.

Настройка в Claude Code

Инструмент Advisor экспериментальный, и Anthropic сообщает об этом в баннере сессии — «Advisor Tool (experimental) включён и может использовать больше токенов». Поведение, стоимость и доступность могут меняться. С учётом этой оговорки механика задокументирована:

Screenshot of Anthropic's Claude Code documentation page for the advisor tool, showing the table of contents (Advisor, Availability, How it works, Supported pairings, How the advisor sees your conversation, Using the advisor, Model selection, Advisor response, Consuming the advisor result, Usage, Pricing, Rate limits, Troubleshooting, Tool use errors, Silent fallback) and body text confirming the tool is experimental and server-side, is available on the Anthropic API only, pairs the main model with a second model that advises at key moments, and that the advisor sees the full conversation including tool calls and results.

• Включите его с помощью /advisor fable или запустите /advisor без аргумента, чтобы выбрать из списка. Выбор сохраняется в настройке advisorModel в ваших пользовательских настройках и сохраняется между сессиями. /advisor off отключает его.

• Для одной сессии без изменения сохранённого значения по умолчанию запустите с claude --advisor fable. Этот флаг не указан в claude --help, и Claude Code завершает работу при запуске, если такая пара недействительна, вместо того чтобы запуститься с молча проигнорированным советником.

• Задайте постоянное значение по умолчанию в файле настроек с помощью {"advisorModel": "fable"}.

• Чтобы полностью это отключить, задайте CLAUDE_CODE_DISABLE_ADVISOR_TOOL=1 — команда /advisor исчезает, а любой настроенный advisorModel игнорируется.

• Пара должна быть как минимум столь же мощной, как основная модель. Claude Opus 5.5 принимает в качестве советников Fable и Opus 5 или более поздние версии. Советник Opus 4.6 или Sonnet отклоняется Claude Code; советник Opus 4.7 или Opus 4.8 подключается, а затем отклоняется API. Fable 5.1 в роли основной модели принимает только Fable 5.1.

• Минимальные версии: инструменту-советнику требуется Claude Code v2.1.98 или новее; Fable в роли основной модели или советника требует v2.1.170 или новее; Fable 5.1 требует v2.1.257 или новее. Токенная форма /advisor — та, что работает в -p, Agent SDK, настольном приложении и Remote Control — требует v2.1.260 или новее.

• Советник доступен только через Anthropic-API. Он недоступен в Amazon Bedrock, Claude Platform on AWS, Agent Platform от Google Cloud и Microsoft Foundry, а также зависит от получения флагов функций, поэтому сессия с установленной переменной вроде DISABLE_TELEMETRY оставляет его отключённым.

• В планах, где использование Fable оплачивается из кредитов на использование, Fable в роли советника тарифицируется так же и требует однократного согласия. Пока вы его не примете, /advisor fable не сохраняется, и claude --advisor fable завершается при запуске, указывая вам на /model fable вместо этого.

Субагенты наследуют любого настроенного вами советника и повторно выполняют ту же проверку совместимости применительно к своей модели. Это единственное взаимодействие между этим паттерном и паттерном субагентов: субагенту, работающему на меньшей модели, может быть разрешён советник, не разрешённый его родителю.

Форма затрат: подробный разбор

Ничто из нижеследующего не является измерением. Форма токенов придумана, чтобы сделать арифметику наглядной; цены — это опубликованные тарифы Anthropic. Предположим одну сессию исполнителя, которая читает 1M свежих входных токенов и выдаёт 500K выходных токенов, и три консультации советника, каждая из которых перечитывает транскрипт на 200K токенов и возвращает около 600 токенов рекомендаций — примерно те две-три консультации на задачу, которые запрашивает собственный системный промпт Anthropic.

• Исполнитель на Claude Opus 5.5 — 1M ввода по $4.00 плюс 500K вывода по $10.00 = $14.00

• Советник по Claude Fable 5.1 — 600 тыс. входных токенов по $6.00 плюс около 1 800 выходных токенов примерно по $0.09 = $6.09

• Петля, итого — около $20.09

• Та же конфигурация, прогнанная от начала до конца на Fable 5.1 — $10.00 за ввод плюс $25.00 за вывод = $35.00

Та же конфигурация только на Opus 5.5 — $14.00

Цикл оказывается между ними — именно туда его помещает Anthropic: примерно на 43% дешевле, чем прогонять Fable 5.1 на всём протяжении, и примерно на 44% дороже, чем один исполнитель. Считайте честным второе число. Советник — это не экономия; это покупка суждения уровня Fable по трём решениям, и он окупается, только если эти три решения меняют результат. Загоните транскрипт в контекстное окно в 1M — и каждая консультация сама по себе будет стоить $10. Позвольте исполнителю начать спрашивать по большинству задач, а не по нескольким, — и вы платите по тарифам советника по всей рабочей нагрузке, а тогда, как выражается Anthropic, запуск самой модели советника — более дешёвый путь к тому же баллу.

Что говорят собственные измерения Anthropic

Anthropic опубликовала измеренные результаты для этого паттерна, и они предоставлены вендором: их получила компания, продающая обе модели, на собственном стенде для бенчмарков. Это по-прежнему единственные в своём роде числа, и они включают аргументы против этого паттерна, поэтому их стоит внимательно прочитать.

• Opus 5 в роли исполнителя с Fable 5.1 в роли советника обошлась в $7,69 за попытку на внутреннем бенчмарке Anthropic по агентному программированию — это самая точная конфигурация, которую измерила Anthropic. Это на 3,5 пункта выше, чем у одного Opus 5 с настройкой по умолчанию, при чуть меньших затратах, и примерно на 2,5 пункта выше, чем у одного Fable 5.1, при примерно в полтора раза больших затратах. Разрыв в 3,5 пункта был отделён от шума между запусками с помощью пяти попыток на задачу.

• Та же комбинация при чтении графиков в пределах погрешности сравнялась с одной только Fable 5.1 при среднем уровне усилий — 65,0 против 67,5 — при примерно в 2,6 раза большей стоимости за задачу, потому что к советнику обращались почти для каждой задачи.

• На GPQA Diamond прирост почти идеально соответствует разрыву в возможностях: исполнитель на Haiku 4.5 получил значительно больше, исполнитель на Sonnet 5 — несколько пунктов, а передовой исполнитель — почти ничего.

• Частота консультаций — это хрупкая переменная. Низкозатратный исполнитель Sonnet 5 прибавил 23 пункта на DeepSWE с советником, а затем на SWE-bench Pro полностью перестал спрашивать и не получил никакого прироста.

• Задержка: около двух дополнительных вызовов передовой модели на задачу, каждый из которых лежит на критическом пути.

Два обстоятельства, связанных с этими данными, имеют прямое отношение к циклу в его нынешнем виде на этой неделе. В измерениях в качестве исполнителя использовался Opus 5, потому что Opus 5.5 не существовал, когда их проводили. А Anthropic сообщает, что Opus 5.5 работает на уровне Fable 5.1 в большинстве задач, но обходится на 40% дешевле в эксплуатации — оба утверждения исходят от вендора, ни одно не воспроизведено независимо. Если советнику платят за закрытие разрыва между исполнителем и советником, то более узкий разрыв — это менее крупная покупка. Паттерн не ухудшился, когда вышел Opus 5.5; то, что он продаёт, стало менее дефицитным.

Режимы отказов, с которыми вы действительно столкнётесь

Это задокументированные варианты поведения, а не домыслы, и первый из них — причина прочитать этот раздел, прежде чем что-либо отлаживать:

• Молча отсутствующий советник. Если API отклоняет сопряжение с советником, Claude Code подключает его, API отклоняет его, и Claude Code повторно отправляет запрос без советника. Остальная часть разговора затем проходит без советника и без сообщения об ошибке. Он остаётся отключённым до /clear или /compact, даже после переключения на совместимую основную модель.

• Тихо отклонённый вариант. Для связок, которые сам Claude Code отклоняет, советник просто никогда не подключается к запросам основной модели. Вывод /advisor и уведомление сообщают вам об этом — но ничего не завершается ошибкой, так что сессия, которая, как вы предполагали, получала советы, могла никогда их и не получать.

• Согласие, которое вы не давали. Если в плане, требующем согласия на использование кредитов, в качестве советника выбран Fable, запросы отправляются без советника, пока вы не примете его. Фоновый сеанс, запущенный с --advisor fable запускается без советника, а не завершается.

• Список разрешённых, который вы не контролируете. Если список разрешённых availableModels вашей организации не включает модель advisor, Claude Code не вызовет её, и вам нужно выбрать разрешённую модель с помощью /advisor.

• Везде, где это отсутствует. Только Anthropic API: нет Bedrock, нет Claude Platform on AWS, нет Google Cloud Agent Platform, нет Microsoft Foundry. При работе через шлюз доступность зависит от того, будет ли запрос без изменений передан шлюзом в API Anthropic — а это свойство шлюза, а не то, что можно предполагать.

Где применяется OrcaRouter

Обе модели в этом цикле уже доступны на OrcaRouter по собственной прайс-листовой цене Anthropic с наценкой 0% — цена провайдера передаётся как есть, поэтому тариф, который вы видите, — это тариф, который публикует Anthropic. Claude Fable 5.1 находится по адресу anthropic/claude-fable-5.1, а Claude Opus 5 — по адресу anthropic/claude-opus-5, за одним API-ключом. Claude Opus 5.5 пока не входит в число наших маршрутов; он доступен через собственный API Anthropic и крупные облачные платформы, и мы скажем об этом прямо, а не будем намекать на обратное.

Screenshot of the OrcaRouter model page for Claude Fable 5.1 (anthropic/claude-fable-5.1), showing the model header, capability tags and the model description.

Что вам даёт здесь один ключ — так это возможность дёшево передумать. Экономика цикла зависит от соотношения цен исполнителя и советника, а это соотношение менялось дважды за семь недель — Opus 5 до Opus 5.5 22 сентября и Fable 5 до Fable 5.1 1 сентября, что снизило стоимость чтения кэша этой модели с $1.00 до $0.25 за миллион. Каждое из этих изменений меняет ответ на вопрос «стоит ли советник своих денег», а проверка этого ответа не должна требовать второго контракта. Автоматическое переключение при сбое — это вторая половина: оно позволяет направить часть трафика на модель, которую вы ещё не изучили, с откатом к той, что у вас есть, вместо того чтобы ставить производственный путь на таблицу запуска. А если вы строите этот паттерн сами, а не используете встроенный инструмент Claude Code, DSL маршрутизации объединяет несколько моделей в один вызов — шаг планирования на одной модели, за которым следуют шаги выполнения на другой, за одним эндпоинтом.

Одно честное замечание о границах: сам инструмент advisor — это серверный инструмент, работающий на API Anthropic, поэтому слой маршрутизации не является его заменой. Что мы можем сделать — так это обеспечить доступ к моделям в один ключ, по каталожной цене, чтобы решение оставить или убрать advisor вы принимали сами, исходя из собственных цифр.

Как выбрать вариант для своей рабочей нагрузки

Собственные рекомендации Anthropic — правильная отправная точка, и они освежающе трезвы: прогоните свой набор оценочных тестов на трёх конфигурациях — одиночный исполнитель, исполнитель с советником и модель советника отдельно при низком уровне усилий — и перепроверяйте при каждом релизе модели, потому что релизы меняют и разрыв в возможностях, и соотношение цен. Последняя из этих трёх — это базовая линия, которую нужно превзойти. Если модель вашего советника отдельно при низком уровне усилий показывает те же результаты, что и цикл, но за меньшие деньги, ответ у вас есть.

Две переменные, за которыми стоит следить, — это те, которые называет Anthropic. Разрыв в возможностях: широкий разрыв между исполнителем и советником — именно там советник оправдывает свою плату, и Opus 5.5 сократил этот разрыв снизу. Частота консультаций: прирост следует за ней почти один к одному, и она настолько чувствительна к промпту, что может обрушиться, — исполнитель при низких усилиях может перестать замечать, что застрял, а связка, которая консультируется по большинству задач при усилиях по умолчанию, может свести это почти к нулю. Системный промпт, предоставляемый Anthropic, требует одного вызова советника перед содержательной работой и одного перед завершением, что даёт два-три консультирования на задачу; связка для кодинга, которая дала прирост в 3,5 пункта, работала в таком ритме. Заложите это в бюджет, ограничьте это сверху и воспринимайте каждую консультацию сверх этого как сигнал, что ваш исполнитель настроен неправильно, а не что задача была сложной.

Для конкретного цикла, описанного в этой статье, основную работу выполняют три конкретные настройки. Оставьте Claude Opus 5.5 на среднем уровне усилий по умолчанию, а не тянитесь к высокому, потому что уровень усилий напрямую влияет на стоимость, а собственные данные Anthropic по Opus 5.5 показывают, что средний уровень теряет совсем немного. Настройте советника с помощью /advisor fable и убедитесь, что баннер действительно появляется — отсутствие баннера означает, что советник молча отсутствует. И прежде чем масштабировать этот шаблон, измеряйте токены на завершённую задачу, а не цену за токен, потому что именно этот показатель цикл и призван улучшать.

Часто задаваемые вопросы

Расходует ли советник тот же лимит Fable, что и сессия Fable?

При оплате через API токены советника тарифицируются по собственным ставкам Fable 5.1 на вход и выход, а ограничения скорости для советника берутся из того же лимита на модель, что и при прямых вызовах этой модели, — поэтому вызов советника, упёршийся в ограничение скорости, проявляется как ошибка внутри результата инструмента, а не как сбой вашего запроса. В подписочных планах использование советника учитывается в лимитах вашего плана, за тем исключением, что советник Fable тарифицируется за счёт кредитов на использование в тех планах, где использование Fable тарифицируется так же. Практическое следствие: советник — это не отдельный бюджет, которым можно свободно распоряжаться; он конкурирует со всем остальным, что вы делаете с этой моделью.

Что советник на самом деле может увидеть?

Весь разговор целиком, включая каждый вызов инструмента и каждый результат работы инструмента — содержимое файлов, вывод команд, сообщения об ошибках, всё это. Он работает под своим собственным системным запросом, предоставленным Anthropic, и возвращает план, исправление или сигнал остановки. Из этого следуют две детали. Во-первых, каждая консультация заново перечитывает всю стенограмму, поэтому стоимость растёт с циклом, а не остаётся неизменной. Во-вторых, если ваша сессия затрагивает материал, который вы не отправили бы второй модели по тарифу консультанта, то консультант — это вторая модель, читающая всё это.

Что изменило бы ответ?

Две вещи, и обе ближе, чем кажутся. Если независимые бенчмаркеры опубликуют прогон Opus 5.5 против Fable 5.1 с сопоставимыми усилиями и подтвердят сужение, о котором заявляет Anthropic, оставшееся преимущество советника на большинстве задач будет незначительным — и цикл станет инструментом для сложного хвоста, а не вариантом по умолчанию. Если же частота консультаций сохранится, а разрыв в возможностях останется широким на длительной агентной работе, то арифметика выше — это то, между чем вы выбираете, и $6 за совет при запуске стоимостью $14 — это дешёвый вариант страховки от выпуска неправильного продукта.

Неизменной останется механика в начале этой статьи. Контекст исполнителя кэшируется и дёшев; контекст советника — ни то, ни другое. Любой цикл, который обращается к более дорогой модели посреди задачи, наследует эту асимметрию, что бы ни говорил прайс-лист в следующем месяце.

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно