
Claude Opus 5.5 выполняет, Claude Fable 5.1 советует: расчёт стоимости цикла советника в Claude Code
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0345Интеллект76Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Claude Fable 5.1 пишет план дизайна. Claude Opus 5.5 выполняет его в цикле. Fable 5.1 возвращается в роли советника и принимает или отклоняет результат. Это тот паттерн, который X/@dotey опубликовал 22 сентября 2026 года — в день, когда вендор выпустил Claude Opus 5.5, — представив его как схему экономии токенов, сложившуюся под давлением затрат: назначить советником Fable, запустить Opus и позволить дорогой модели говорить только в точках принятия решений. То, что они используют, — уже не трюк с промптом и не конфигурация субагента. Это встроенный инструмент советника Claude Code, серверная функция, тарифицируемая по ставкам модели-советника, поверх всего, что тратит основная модель. И сам совет — дешёвая часть. А вот повторное чтение разговора, чтобы его выдать, — нет: контекст исполнителя стало дёшево перечитывать, а контекст советника — никогда. Именно эта асимметрия решает, стоит ли вообще запускать такой цикл, и именно её оценивает в цифрах остальная часть этой статьи.
Что на самом деле представляет собой цикл
Инструмент советника подключает к вашей основной модели вторую, обычно более сильную модель, с которой Claude советуется в ключевые моменты — прежде чем остановиться на каком-либо подходе, когда ошибка повторяется снова и снова или прежде чем объявить задачу выполненной. Советник получает полную историю переписки, включая каждый вызов инструмента и его результат, и возвращает рекомендации, которые основная модель затем применяет. Он никогда не вызывает инструменты и никогда не создаёт вывод, обращённый к пользователю. Вы выбираете, какая модель даёт советы; Claude решает, когда к ней обращаться.
Эта последняя часть — то, что отличает это от паттерна «оркестратор и субагенты», который циркулировал в сообществе Claude Code в августе. Субагенты — это делегирование: планировщик декомпозирует работу и распределяет её между воркерами, и вы явно настраиваете модель для каждой линии. Советник — это эскалация: одна модель ведёт всю задачу, а дорогая модель подключается по ходу выполнения для принятия решения, которое ведущая модель не может принять самостоятельно. Здесь нет пула воркеров, нет графа задач и нет промпта оркестрации, который нужно поддерживать. Практический цикл, который описывает @dotey — планирование, выполнение, проверка, повторение — это то, как выглядит этот механизм, когда вы нацеливаете советника на Fable 5.1 и позволяете ему контролировать условие выхода из цикла.
Собственная формулировка этой стратегии от Anthropic без обиняков говорит о том, в чём именно состоит выигрыш: советник «может передать лишь ту способность, которой у исполнителя нет». Всё дальнейшее следует из того, насколько этой способности в действительности не хватает и как часто исполнитель это признаёт.
Почему Claude Opus 5.5 изменил арифметику

Опубликованный тарифный план Anthropic, за миллион токенов. Это данные вендора, а не оценки:
• Claude Opus 5.5 — 4 $ за ввод, 20 $ за вывод, 0,20 $ за чтение кэша, 5 $ за запись в кэш на 5 минут
• Claude Opus 5 — $5 за вход, $25 за выход, $0,50 за чтение кэша, $6,25 за 5-минутную запись кэша
• Claude Fable 5.1 — $10 за ввод, $50 за вывод, $0,25 за чтение кэша, $12,50 за запись в кэш на 5 минут
Две детали в этом списке важнее, чем заявленные цены. Во-первых, чтения из кэша на Opus 5.5 составляют 5% от базовой цены ввода — согласно собственной сноске Anthropic, тогда как у большинства моделей Claude этот показатель равен 10%, а у Fable 5.1 — 2,5%. У Fable 5.1 множитель лучше, но в абсолютных долларах она всё равно проигрывает — $0,20 против $0,25 — потому что её базовая ставка ввода в два с половиной раза выше.
Во-вторых — и именно на этом механизме держится весь цикл: переключение советника в Claude Code не аннулирует кэш промптов основной модели, поэтому длинный, многократно переотправляемый контекст исполнителя остаётся дешёвым — $0,20 за миллион. Собственное прочтение советником разговора не кэшируется. Каждое обращение заново обрабатывает весь транскрипт по ставке Fable 5.1 — $10 за миллион входных токенов. Исполнитель, который десять раз перечитывает контекст в 500K токенов, платит за чтение из кэша; советник, к которому обратились десять раз, десять раз платит за свежий ввод по транскрипту, который всё это время растёт. Чем дешевле становится контекст вашего исполнителя, тем заметнее некешированное чтение советника, — а благодаря Opus 5.5 контекст исполнителя только что стал на 60% дешевле, чем у Opus 5.
Настройка в Claude Code
Инструмент Advisor экспериментальный, и Anthropic сообщает об этом в баннере сессии — «Advisor Tool (experimental) включён и может использовать больше токенов». Поведение, стоимость и доступность могут меняться. С учётом этой оговорки механика задокументирована:

• Включите его с помощью /advisor fable или запустите /advisor без аргумента, чтобы выбрать из списка. Выбор сохраняется в настройке advisorModel в ваших пользовательских настройках и сохраняется между сессиями. /advisor off отключает его.
• Для одной сессии без изменения сохранённого значения по умолчанию запустите с claude --advisor fable. Этот флаг не указан в claude --help, и Claude Code завершает работу при запуске, если такая пара недействительна, вместо того чтобы запуститься с молча проигнорированным советником.
• Задайте постоянное значение по умолчанию в файле настроек с помощью {"advisorModel": "fable"}.
• Чтобы полностью это отключить, задайте CLAUDE_CODE_DISABLE_ADVISOR_TOOL=1 — команда /advisor исчезает, а любой настроенный advisorModel игнорируется.
• Пара должна быть как минимум столь же мощной, как основная модель. Claude Opus 5.5 принимает в качестве советников Fable и Opus 5 или более поздние версии. Советник Opus 4.6 или Sonnet отклоняется Claude Code; советник Opus 4.7 или Opus 4.8 подключается, а затем отклоняется API. Fable 5.1 в роли основной модели принимает только Fable 5.1.
• Минимальные версии: инструменту-советнику требуется Claude Code v2.1.98 или новее; Fable в роли основной модели или советника требует v2.1.170 или новее; Fable 5.1 требует v2.1.257 или новее. Токенная форма /advisor — та, что работает в -p, Agent SDK, настольном приложении и Remote Control — требует v2.1.260 или новее.
• Советник доступен только через Anthropic-API. Он недоступен в Amazon Bedrock, Claude Platform on AWS, Agent Platform от Google Cloud и Microsoft Foundry, а также зависит от получения флагов функций, поэтому сессия с установленной переменной вроде DISABLE_TELEMETRY оставляет его отключённым.
• В планах, где использование Fable оплачивается из кредитов на использование, Fable в роли советника тарифицируется так же и требует однократного согласия. Пока вы его не примете, /advisor fable не сохраняется, и claude --advisor fable завершается при запуске, указывая вам на /model fable вместо этого.
Субагенты наследуют любого настроенного вами советника и повторно выполняют ту же проверку совместимости применительно к своей модели. Это единственное взаимодействие между этим паттерном и паттерном субагентов: субагенту, работающему на меньшей модели, может быть разрешён советник, не разрешённый его родителю.
Форма затрат: подробный разбор
Ничто из нижеследующего не является измерением. Форма токенов придумана, чтобы сделать арифметику наглядной; цены — это опубликованные тарифы Anthropic. Предположим одну сессию исполнителя, которая читает 1M свежих входных токенов и выдаёт 500K выходных токенов, и три консультации советника, каждая из которых перечитывает транскрипт на 200K токенов и возвращает около 600 токенов рекомендаций — примерно те две-три консультации на задачу, которые запрашивает собственный системный промпт Anthropic.
• Исполнитель на Claude Opus 5.5 — 1M ввода по $4.00 плюс 500K вывода по $10.00 = $14.00
• Советник по Claude Fable 5.1 — 600 тыс. входных токенов по $6.00 плюс около 1 800 выходных токенов примерно по $0.09 = $6.09
• Петля, итого — около $20.09
• Та же конфигурация, прогнанная от начала до конца на Fable 5.1 — $10.00 за ввод плюс $25.00 за вывод = $35.00
Та же конфигурация только на Opus 5.5 — $14.00
Цикл оказывается между ними — именно туда его помещает Anthropic: примерно на 43% дешевле, чем прогонять Fable 5.1 на всём протяжении, и примерно на 44% дороже, чем один исполнитель. Считайте честным второе число. Советник — это не экономия; это покупка суждения уровня Fable по трём решениям, и он окупается, только если эти три решения меняют результат. Загоните транскрипт в контекстное окно в 1M — и каждая консультация сама по себе будет стоить $10. Позвольте исполнителю начать спрашивать по большинству задач, а не по нескольким, — и вы платите по тарифам советника по всей рабочей нагрузке, а тогда, как выражается Anthropic, запуск самой модели советника — более дешёвый путь к тому же баллу.
Что говорят собственные измерения Anthropic
Anthropic опубликовала измеренные результаты для этого паттерна, и они предоставлены вендором: их получила компания, продающая обе модели, на собственном стенде для бенчмарков. Это по-прежнему единственные в своём роде числа, и они включают аргументы против этого паттерна, поэтому их стоит внимательно прочитать.
• Opus 5 в роли исполнителя с Fable 5.1 в роли советника обошлась в $7,69 за попытку на внутреннем бенчмарке Anthropic по агентному программированию — это самая точная конфигурация, которую измерила Anthropic. Это на 3,5 пункта выше, чем у одного Opus 5 с настройкой по умолчанию, при чуть меньших затратах, и примерно на 2,5 пункта выше, чем у одного Fable 5.1, при примерно в полтора раза больших затратах. Разрыв в 3,5 пункта был отделён от шума между запусками с помощью пяти попыток на задачу.
• Та же комбинация при чтении графиков в пределах погрешности сравнялась с одной только Fable 5.1 при среднем уровне усилий — 65,0 против 67,5 — при примерно в 2,6 раза большей стоимости за задачу, потому что к советнику обращались почти для каждой задачи.
• На GPQA Diamond прирост почти идеально соответствует разрыву в возможностях: исполнитель на Haiku 4.5 получил значительно больше, исполнитель на Sonnet 5 — несколько пунктов, а передовой исполнитель — почти ничего.
• Частота консультаций — это хрупкая переменная. Низкозатратный исполнитель Sonnet 5 прибавил 23 пункта на DeepSWE с советником, а затем на SWE-bench Pro полностью перестал спрашивать и не получил никакого прироста.
• Задержка: около двух дополнительных вызовов передовой модели на задачу, каждый из которых лежит на критическом пути.
Два обстоятельства, связанных с этими данными, имеют прямое отношение к циклу в его нынешнем виде на этой неделе. В измерениях в качестве исполнителя использовался Opus 5, потому что Opus 5.5 не существовал, когда их проводили. А Anthropic сообщает, что Opus 5.5 работает на уровне Fable 5.1 в большинстве задач, но обходится на 40% дешевле в эксплуатации — оба утверждения исходят от вендора, ни одно не воспроизведено независимо. Если советнику платят за закрытие разрыва между исполнителем и советником, то более узкий разрыв — это менее крупная покупка. Паттерн не ухудшился, когда вышел Opus 5.5; то, что он продаёт, стало менее дефицитным.
Режимы отказов, с которыми вы действительно столкнётесь
Это задокументированные варианты поведения, а не домыслы, и первый из них — причина прочитать этот раздел, прежде чем что-либо отлаживать:
• Молча отсутствующий советник. Если API отклоняет сопряжение с советником, Claude Code подключает его, API отклоняет его, и Claude Code повторно отправляет запрос без советника. Остальная часть разговора затем проходит без советника и без сообщения об ошибке. Он остаётся отключённым до /clear или /compact, даже после переключения на совместимую основную модель.
• Тихо отклонённый вариант. Для связок, которые сам Claude Code отклоняет, советник просто никогда не подключается к запросам основной модели. Вывод /advisor и уведомление сообщают вам об этом — но ничего не завершается ошибкой, так что сессия, которая, как вы предполагали, получала советы, могла никогда их и не получать.
• Согласие, которое вы не давали. Если в плане, требующем согласия на использование кредитов, в качестве советника выбран Fable, запросы отправляются без советника, пока вы не примете его. Фоновый сеанс, запущенный с --advisor fable запускается без советника, а не завершается.
• Список разрешённых, который вы не контролируете. Если список разрешённых availableModels вашей организации не включает модель advisor, Claude Code не вызовет её, и вам нужно выбрать разрешённую модель с помощью /advisor.
• Везде, где это отсутствует. Только Anthropic API: нет Bedrock, нет Claude Platform on AWS, нет Google Cloud Agent Platform, нет Microsoft Foundry. При работе через шлюз доступность зависит от того, будет ли запрос без изменений передан шлюзом в API Anthropic — а это свойство шлюза, а не то, что можно предполагать.
Где применяется OrcaRouter
Обе модели в этом цикле уже доступны на OrcaRouter по собственной прайс-листовой цене Anthropic с наценкой 0% — цена провайдера передаётся как есть, поэтому тариф, который вы видите, — это тариф, который публикует Anthropic. Claude Fable 5.1 находится по адресу anthropic/claude-fable-5.1, а Claude Opus 5 — по адресу anthropic/claude-opus-5, за одним API-ключом. Claude Opus 5.5 пока не входит в число наших маршрутов; он доступен через собственный API Anthropic и крупные облачные платформы, и мы скажем об этом прямо, а не будем намекать на обратное.

Что вам даёт здесь один ключ — так это возможность дёшево передумать. Экономика цикла зависит от соотношения цен исполнителя и советника, а это соотношение менялось дважды за семь недель — Opus 5 до Opus 5.5 22 сентября и Fable 5 до Fable 5.1 1 сентября, что снизило стоимость чтения кэша этой модели с $1.00 до $0.25 за миллион. Каждое из этих изменений меняет ответ на вопрос «стоит ли советник своих денег», а проверка этого ответа не должна требовать второго контракта. Автоматическое переключение при сбое — это вторая половина: оно позволяет направить часть трафика на модель, которую вы ещё не изучили, с откатом к той, что у вас есть, вместо того чтобы ставить производственный путь на таблицу запуска. А если вы строите этот паттерн сами, а не используете встроенный инструмент Claude Code, DSL маршрутизации объединяет несколько моделей в один вызов — шаг планирования на одной модели, за которым следуют шаги выполнения на другой, за одним эндпоинтом.
Одно честное замечание о границах: сам инструмент advisor — это серверный инструмент, работающий на API Anthropic, поэтому слой маршрутизации не является его заменой. Что мы можем сделать — так это обеспечить доступ к моделям в один ключ, по каталожной цене, чтобы решение оставить или убрать advisor вы принимали сами, исходя из собственных цифр.
Как выбрать вариант для своей рабочей нагрузки
Собственные рекомендации Anthropic — правильная отправная точка, и они освежающе трезвы: прогоните свой набор оценочных тестов на трёх конфигурациях — одиночный исполнитель, исполнитель с советником и модель советника отдельно при низком уровне усилий — и перепроверяйте при каждом релизе модели, потому что релизы меняют и разрыв в возможностях, и соотношение цен. Последняя из этих трёх — это базовая линия, которую нужно превзойти. Если модель вашего советника отдельно при низком уровне усилий показывает те же результаты, что и цикл, но за меньшие деньги, ответ у вас есть.
Две переменные, за которыми стоит следить, — это те, которые называет Anthropic. Разрыв в возможностях: широкий разрыв между исполнителем и советником — именно там советник оправдывает свою плату, и Opus 5.5 сократил этот разрыв снизу. Частота консультаций: прирост следует за ней почти один к одному, и она настолько чувствительна к промпту, что может обрушиться, — исполнитель при низких усилиях может перестать замечать, что застрял, а связка, которая консультируется по большинству задач при усилиях по умолчанию, может свести это почти к нулю. Системный промпт, предоставляемый Anthropic, требует одного вызова советника перед содержательной работой и одного перед завершением, что даёт два-три консультирования на задачу; связка для кодинга, которая дала прирост в 3,5 пункта, работала в таком ритме. Заложите это в бюджет, ограничьте это сверху и воспринимайте каждую консультацию сверх этого как сигнал, что ваш исполнитель настроен неправильно, а не что задача была сложной.
Для конкретного цикла, описанного в этой статье, основную работу выполняют три конкретные настройки. Оставьте Claude Opus 5.5 на среднем уровне усилий по умолчанию, а не тянитесь к высокому, потому что уровень усилий напрямую влияет на стоимость, а собственные данные Anthropic по Opus 5.5 показывают, что средний уровень теряет совсем немного. Настройте советника с помощью /advisor fable и убедитесь, что баннер действительно появляется — отсутствие баннера означает, что советник молча отсутствует. И прежде чем масштабировать этот шаблон, измеряйте токены на завершённую задачу, а не цену за токен, потому что именно этот показатель цикл и призван улучшать.
Часто задаваемые вопросы
Расходует ли советник тот же лимит Fable, что и сессия Fable?
При оплате через API токены советника тарифицируются по собственным ставкам Fable 5.1 на вход и выход, а ограничения скорости для советника берутся из того же лимита на модель, что и при прямых вызовах этой модели, — поэтому вызов советника, упёршийся в ограничение скорости, проявляется как ошибка внутри результата инструмента, а не как сбой вашего запроса. В подписочных планах использование советника учитывается в лимитах вашего плана, за тем исключением, что советник Fable тарифицируется за счёт кредитов на использование в тех планах, где использование Fable тарифицируется так же. Практическое следствие: советник — это не отдельный бюджет, которым можно свободно распоряжаться; он конкурирует со всем остальным, что вы делаете с этой моделью.
Что советник на самом деле может увидеть?
Весь разговор целиком, включая каждый вызов инструмента и каждый результат работы инструмента — содержимое файлов, вывод команд, сообщения об ошибках, всё это. Он работает под своим собственным системным запросом, предоставленным Anthropic, и возвращает план, исправление или сигнал остановки. Из этого следуют две детали. Во-первых, каждая консультация заново перечитывает всю стенограмму, поэтому стоимость растёт с циклом, а не остаётся неизменной. Во-вторых, если ваша сессия затрагивает материал, который вы не отправили бы второй модели по тарифу консультанта, то консультант — это вторая модель, читающая всё это.
Что изменило бы ответ?
Две вещи, и обе ближе, чем кажутся. Если независимые бенчмаркеры опубликуют прогон Opus 5.5 против Fable 5.1 с сопоставимыми усилиями и подтвердят сужение, о котором заявляет Anthropic, оставшееся преимущество советника на большинстве задач будет незначительным — и цикл станет инструментом для сложного хвоста, а не вариантом по умолчанию. Если же частота консультаций сохранится, а разрыв в возможностях останется широким на длительной агентной работе, то арифметика выше — это то, между чем вы выбираете, и $6 за совет при запуске стоимостью $14 — это дешёвый вариант страховки от выпуска неправильного продукта.
Неизменной останется механика в начале этой статьи. Контекст исполнителя кэшируется и дёшев; контекст советника — ни то, ни другое. Любой цикл, который обращается к более дорогой модели посреди задачи, наследует эту асимметрию, что бы ни говорил прайс-лист в следующем месяце.
Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
