
Claude Fable 5 как ваш оркестратор: плейбук субагентов, который сокращает расходы на токены
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0345Интеллект76Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
7 августа Anthropic внесла самое крупное единичное изменение в Claude Fable 5 с момента выхода модели 9 июня: она сократила связанные с биологией «запасные варианты» примерно на 85%, так что повседневные вопросы о здоровье и образовании теперь получают прямой ответ вместо того, чтобы незаметно переключаться на более слабую модель. Однако паттерн, который на этой неделе на самом деле распространяется в сообществе Claude Code, не имеет отношения к биологии. Практики продолжают публиковать рабочий процесс, в котором Claude Fable 5 выполняет цикл оркестрации — уточнение требований, декомпозицию плана, распределение задач, приём результатов, — а выполнение передаётся субагентам Claude Opus 5. Заявленный выигрыш: Fable 5 High становится доступным по цене сессионным стандартом, а многословие Claude Opus 5 перестаёт истощать сессию.
Самый свежий пример — публикация @dotey от 14 августа: короткое дополнение к ~/.claude/CLAUDE.md, которое поручает агенту открывать субагентов Opus для выполнения, оставляя Claude Fable 5 с высоким уровнем рассуждений в качестве стандартного режима сеанса. Автор сообщает, что расход токенов остаётся разумным — и приводит прямую причину, по которой не использует Claude Opus 5 по умолчанию: в его руках он был слишком медленным и сжигал огромное количество токенов в основном цикле. Это вывод сообщества, а не руководство Anthropic — и его стоит понять, прежде чем копировать, потому что на бумаге это выглядит наоборот.
Вся суть в одном абзаце. В Claude Code субагенты по умолчанию наследуют модель вашей сессии, поэтому чтобы сохранить быстрый и недорогой цикл, нужно сделать модель сессии планировщиком, а исполнителям явно указать другую модель. Claude Fable 5 — модель класса Mythos от Anthropic, безопасная для общего использования, выпущена 9 июня 2026 года по цене $10/$50 за миллион токенов — хранит требования, декомпозирует работу, распределяет задачи и принимает результаты. Claude Opus 5 — выпущен 24 июля 2026 года по цене $5/$25 за миллион токенов — выполняет саму реализацию внутри субагентов. Вы тратите суждения уровня Fable на немногочисленные оркестрационные ходы и исполнение уровня Opus на многочисленные исполнительные ходы, куда и так уходит основная масса токенов.
Почему модель главного цикла — это реальная проблема затрат.
На бенчмарках это выглядит как решённая проблема — и ответ выглядит как «по умолчанию использовать Opus 5». Собственные цифры Anthropic (предоставленные вендором, без независимого воспроизведения) показывают, что Claude Opus 5 опережает Claude Fable 5 на агентном бенчмарке для кода Frontier-Bench v0.1 (43,3% против 33,7%), на SWE-bench Verified (96,0% против 95,5%) и на ARC-AGI-3 (30,2%, примерно в 4 раза лучше следующей лучшей публичной модели). Anthropic позиционирует Opus 5 как приближающийся к передовому интеллекту Fable 5 при вдвое меньшей цене. Если вы выбираете модель по умолчанию для сеанса, полагаясь исключительно на вендорские бенчмарки и цену за токен, Opus 5 — очевидный выбор.
Практики, которые реально проводят длительные сессии, приходят к противоположному выводу по умолчанию: дело в токенах на задачу, а не в цене за токен. У Opus 5 мышление включено по умолчанию и адаптивно, а Anthropic утверждает, что модель без подсказок проверяет собственную работу — а значит, на практике каждый виток цикла генерирует существенно больше токенов, чем Fable 5. Отключить это мышление можно только при высокой нагрузке, так что полностью ужать её не получится. В сессии, длящейся часами, именно цикл накапливается: модель, которая дешевле за токен, в итоге может оказаться самой дорогой за сессию, а модель, которая говорит меньше всех, держит цикл быстрым.
Это соответствует тому, о чём сообщает @dotey. Инвертированная схема сохраняет потребление токенов «неплохим» именно потому, что Opus 5 — многословный — изолирован в субагентах, где его вывод является результатом, а не накладными расходами.
Инвертированная архитектура: Fable 5 планирует, Opus исполняет
Архитектуру просто сформулировать, но немного неинтуитивно запускать:
• Сессионная модель — Claude Fable 5 с высоким уровнем рассуждений (то самое «High» из принятого в сообществе сокращения «Fable 5 High»). Она владеет разговором, планом и определением готовности.
• Ходы оркестрации — уточнение требований, декомпозиция плана, отправка задач и приём результатов — всё происходит на Fable 5. Это немногочисленные ходы и небольшая доля от общего числа токенов.
• Исполнительные ходы — каждая задача поручается субагенту, работающему на Claude Opus 5. Это основные ходы и основная часть затрат токенов — и именно Opus 5 демонстрирует самые высокие агентные показатели, сообщаемые поставщиком.
Экономика работает, потому что две кривые затрат направлены в разные стороны. Сила Fable 5 — в рассудительности; вы используете её экономно. Сила Opus 5 — в исполнении; вы используете её интенсивно, но параллельно, изолированно от цикла. Цикл остаётся быстрым и дешёвым, а дорогостоящая возможность расходуется ровно там, где токены и так тратятся.
Это один из двух паттернов, распространённых в сообществе, и они зеркальны друг другу. Более часто рекомендуемый «архитектурный паттерн» (используемый, например, плагином fable-advisor) задействует Opus как архитектора на полную ставку и резервирует Fable 5 для трека реализации высочайшей сложности и обязательного итогового ревью результата. Разница — в цели оптимизации: архитектурный паттерн тратит токены уровня Opus на координацию и использует Fable 5 как скальпель; инвертированный паттерн использует Fable 5 для координации, а Opus 5 — для объёма. Оба являются рекомендациями сообщества — Anthropic не документирует ни один из них — и оба представляют собой попытки тратить передовые токены там, где они меняют результат.
Настройка в Claude Code
В Claude Code нет встроенного «режима оркестратора», поэтому этот паттерн обеспечивается двумя способами: инструкциями в промпте сессии и явными привязками моделей на стороне исполнения.
Слой инструкций находится в ~/.claude/CLAUDE.md — в том же файле, который редактировал @dotey. В целом, промпт предписывает основному агенту выполнять четыре действия, прежде чем считать задачу выполненной:
• Переформулируйте требование и подтвердите объём работ перед написанием кода.
Разбейте работу на задачи, которые можно выполнять параллельно.
• Отправляйте каждую задачу выполнения субагенту, привязанному к Claude Opus 5.
• Проверяйте каждый результат на соответствие плану, прежде чем принять его.
Эту форму стоит изложить как рекомендацию, а не как фрагмент для вставки — ваши требования и ваш стек определяют, что в неё входит.
Уровень модели важен больше, чем предполагает большинство конфигураций. В Claude Code порядок разрешения модели субагента следующий: переменная окружения CLAUDE_CODE_SUBAGENT_MODEL, затем параметр модели, передаваемый при вызове, затем frontmatter определения агента, затем модель сессии. Агенты без заданной модели наследуют модель сессии. Поэтому если ваша сессия работает на Fable 5, а вы полагаетесь на аргумент model инструмента Agent, существует задокументированный риск, что он будет проигнорирован (GitHub issue #83920): субагенты всё равно наследуют модель сессии, и вы платите по тарифу Fable 5 за выполнение, которое собирались запустить на Opus 5.
Два надежных исправления: задайте CLAUDE_CODE_SUBAGENT_MODEL=claude-opus-5 для сессии или закрепите модель в frontmatter субагента. Эта одна переменная — разница между работой паттерна как задумано и тихим прогоном всей сессии на дорогой модели.
Математика токенов, стоящая за разделением.
Вот две модели с их текущими ценами (цены опубликованы вендором и передаются по прейскуранту в OrcaRouter):
• Claude Fable 5 — $10 за 1M входных токенов, $50 за 1M выходных; контекст 1M токенов, вывод 128K.
• Claude Opus 5 — $5 за 1M входных токенов, $25 за 1M выходных; контекст — 1M токенов, выход — 128K.

Контринтуитивная часть в том, что Opus 5 стоит вдвое дешевле за токен и при этом всё равно может проигрывать по стоимости за сессию. Суть легко увидеть на грубых цифрах: если цикл на Opus 5 генерирует в два-три раза больше токенов, чем цикл на Fable 5 — иллюстративная оценка, согласующаяся с сообщениями практиков о самоопроверяющем поведении Opus 5, а не измеренная величина, — то даже при вдвое меньшей цене за токен цикл обходится примерно в ту же сумму, а если разрыв больше, Opus в цикле стоит дороже. Тем временем токены исполнения, составляющие основную часть сессии, в любом случае остаются на Opus 5 в субагентах по более дешёвой ставке.
В этом заключается весь смысл инвертированного шаблона: поместите модель с более высокой ценой за токен, но с более компактным циклом, на цикл, а модель с более низкой ценой за токен — на основной объём. Это решение о маршрутизации, замаскированное под решение о модели.
Поскольку OrcaRouter передаёт цены провайдера с наценкой 0%, приведённые выше цифры — это то, что вы действительно платите здесь, без какой-либо платформенной комиссии сверху, — и если Anthropic снизит любую из цен, изменение появится на странице модели в тот же день.
Когда инвертированный паттерн выигрывает — а когда нет.
Копировать настройку @dotey, не проверив характер своей собственной рабочей нагрузки, — это ошибка в обе стороны.
Инвертированный шаблон выигрывает, когда:
• Требования неоднозначны или в плане много движущихся частей — дефицитным ресурсом является способность к оркестрации.
• Выполнение может быть распараллелено на субагентов — объём покидает цикл.
• Сессии длинные — многословие циклов перерастает в реальные затраты.
Стандартный совет побеждает, когда:
• Большая часть вашего сеанса — ограниченная механическая работа: планировщик уровня Fable избыточен, а более низкая цена Opus 5 и более высокие показатели бенчмарков делают его очевидным выбором по умолчанию. Именно поэтому в собственной документации Claude Code Opus установлен как стандартный для сеанса, а Fable 5 зарезервирован для явного выбора.
• Вы не можете надежно привязать модели субагентов — ошибка наследования #83920 превращает инвертированный шаблон в «всё по ценам Fable 5».
Существует также промежуточный путь настройки. Opus 5 предоставляет параметр усилия (от низкого до максимального, по умолчанию высокий), так что вы можете сдвинуть его в сторону более экономного поведения — но не до конца, поскольку отключение мышления допускается только при высоком усилии. Если ваша проблема — многословность Opus 5, снижения усилия может быть достаточно, и вам вообще не нужно инвертировать архитектуру.
Что означает изменение в биологии от 7 августа для этой конфигурации
Обновление Anthropic от 7 августа переписало и переобучило биологический классификатор Claude Fable 5 — систему, которая определяет, вызывает ли запрос «откат» к менее мощной модели. По собственным данным Anthropic (заявленным вендором), число откатов, связанных с биологией, снизилось примерно на 85% во всех продуктах, при этом общее количество откатов уменьшилось примерно на 67% на Claude.ai, на 55% на Cowork, на 17% на Claude Code и на 7% на Claude Platform.

Для настройки оркестрации Fable 5 значение имеет именно номер Claude Code. Фолбэк — это когда система незаметно переключает ваш запрос на другую модель — в данном случае на Opus 5. В обычном чате это незаметное трение; в агентной сессии это означает, что часть вашего пайплайна работает на модели, которую вы не выбирали, и по ценовому профилю, который вы не планировали. Обновление этого не устраняет: вирусология, токсикология и молекулярный дизайн по-прежнему попадают в фолбэк. Но повседневная биология для здоровья и образования — чтение результатов анализов, понимание симптома, изучение биологии — теперь остаётся на Fable 5.
Одно предварительное примечание, четко обозначенное: неподтвержденные сообщения конца июля (36kr, WinCentral) указывают на возможное обновление Claude Fable 5.1 в этом месяце без изменения цен. Anthropic не подтвердила ни название, ни дату, ни идентификатор модели API — считайте это предположением, пока обновление не выйдет.
Попробовать это, не ставя на кон свой рабочий процесс.
Что делает инвертированный паттерн стоящим попытки, так это то, что он обратим, а маршрутизация обеих моделей через одну конечную точку делает обратное преобразование дешёвым.
На OrcaRouter модели Claude Fable 5 (anthropic/claude-fable-5) и Claude Opus 5 (anthropic/claude-opus-5) используют один API-ключ. Вы можете запустить канал исполнения сессии на любой из этих моделей без второго контракта или изменения кода — что как раз нужно для эксперимента вроде «Fable 5 как оркестратор», потому что весь смысл в том, чтобы измерить собственную стоимость за сессию до принятия обязательств.

Две функции OrcaRouter напрямую соответствуют этой настройке. Автоматическое переключение при сбое позволяет задать цепочку резервирования — если Fable 5 выдаёт ошибку или истекает время ожидания, запрос направляется к Opus 5 или более дешёвой модели, а не завершается сбоем. А DSL маршрутизации может объединить пару в один вызов: шаг планирования Fable 5 с последующими шагами выполнения Opus 5 за одной конечной точкой. Это паттерн оркестрации, выраженный как инфраструктура, а не как дисциплина промптов.
Итог
Перевёрнутая архитектура — Claude Fable 5 планирует, Claude Opus 5 выполняет — это реальный, работающий ответ на реальную проблему: модель, которая дешевле всего за токен, не обязательно самая дешёвая за сеанс. Это не решение по бенчмаркам; Opus 5 выигрывает большинство заявленных вендорами агентных сравнений. Это решение по маршрутизации токенов, и оно окупается только тогда, когда суждение об оркестрации дефицитно, а выполнение можно распараллелить.
Claude Fable 5 (9 июня 2026 года) и Claude Opus 5 (24 июля 2026 года) — обе являются текущими моделями Anthropic, и изменение защитных механизмов от 7 августа делает Fable 5 менее прерываемой в повседневном использовании. Следите за тремя вещами: выльются ли сообщения о Fable 5.1 во что-то реальное, исправит ли Anthropic ошибку наследования субагентов, которая может незаметно отменить эту схему, и — самое главное — какой будет ваша стоимость за выполненную задачу в течение недели реальных сессий.
Часто задаваемые вопросы
Является ли Fable 5 моделью по умолчанию в Claude Code?
Нет. В документации Claude Code указано, что Fable 5 не используется по умолчанию ни для одного типа учетной записи — сеансы по умолчанию используют стандартную модель Opus, а Fable 5 выбирается через /model, настройку модели или псевдоним «best». Описанный в этой статье шаблон намеренно работает вразрез с этим значением по умолчанию.
Почему бы просто не использовать Opus 5 по умолчанию, раз он дешевле за токен и показывает более высокие результаты?
Поскольку стоимость сессии равна количеству токенов на задачу, умноженному на цену за токен. Практики сообщают, что адаптивное мышление и самопроверка Opus 5 генерируют гораздо больше токенов за ход, поэтому при вдвое меньшей цене за токен модель всё равно может быть медленнее и дороже в длинном цикле. Именно на этом выводе сообщества основано данное руководство — измерьте это на своей рабочей нагрузке, прежде чем делать выбор.
Могу ли я заставить своих субагентов использовать другую модель, чем в сессии?
Да, но не полагайтесь на параметр модели, передаваемый при каждом вызове: в GitHub issue #83920 задокументировано, что он игнорируется, и субагенты вместо этого наследуют модель сессии. Задайте CLAUDE_CODE_SUBAGENT_MODEL или зафиксируйте модель в frontmatter субагента — именно это определяет разницу между выполнением по тарифу Opus 5 и незаметным выполнением по тарифу Fable 5.
Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
