Сгенерированная титульная карточка для Claude Opus 5.5 против Claude Fable 5.1 с подзаголовком «Более дешёвая модель победила в независимом индексе», с настоящим логотипом OrcaRouter, скомпонованным в правом нижнем углу, и строкой нижнего колонтитула: «Индекс по данным Artificial Analysis при максимальном усилии; цены — по данным Anthropic».
Guides & Insights

Claude Opus 5.5 против Claude Fable 5.1: более дешёвая модель победила в независимом индексе

Автор

Magnus Corvin

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Anthropic теперь продаёт две модели на вершине своей линейки, и та, что стоит в два с половиной раза дороже, — вовсе не та, что возглавляет таблицу. Claude Opus 5.5, выпущенная 22 сентября 2026 года по цене $4 за миллион входных и $20 за миллион выходных токенов, набирает 58 баллов в Индексе интеллекта Artificial Analysis. Claude Fable 5.1, удерживающая флагманскую позицию с 1 сентября при цене $10 на входе и $50 на выходе, набирает 53. Обе цифры получены от одного и того же оценщика, обе измерены в рамках одного семейства конфигураций, и разрыв идёт в сторону, противоположную ценникам. Именно с этого факта приходится начинать данное сравнение, потому что почти каждый обзор запуска за минувшую неделю подаёт Opus 5.5 как удешевлённую версию Fable 5.1 — более дешёвую модель, которая «не уступает» дорогой в большинстве задач. Независимая цифра говорит, что впереди как раз дешёвая модель.

Стоит ли из-за этого менять то, что вы развёртываете, — другой вопрос, и ответ зависит не столько от разрыва в пять пунктов, сколько от двух настроек, которые никто не выносит в заголовки: какой уровень усилий каждая модель использует по умолчанию и какую из них можно заставить работать быстро.

Независимые числа и то единственное, что их объединяет

A two-column scoreboard comparing Claude Opus 5.5 and Claude Fable 5.1 across six shared rows: Intelligence Index (58, ranked #1 of 210, against 53, ranked #4), price in and out ($4.00 / $20.00 per million against $10.00 / $50.00), context window (1M tokens on both), default effort (medium against high), knowledge cutoff (Jun 2026 on both) and fast mode (supported at $8.00 / $40.00 against not supported). The footer reads 'Index figures per Artificial Analysis at max effort; prices, effort defaults and fast-mode support per Anthropic.'

Artificial Analysis публикует по одной конфигурации на модель, и для обеих этих моделей она помечена как «Adaptive Reasoning, Max Effort, Default Fallback». Одна и та же метка, один и тот же оценщик, один и тот же запуск — что делает это самым чистым прямым сравнением, которое только было у любой из этих моделей:

• Индекс интеллекта — Claude Opus 5.5 58, занимает 1-е место из 210 против Claude Fable 5.1 53, занимает 4-е место

• Скорость вывода — Claude Fable 5.1 65,8 токенов/сек, ниже медианы по таблице в 71,0 против Claude Opus 5.5, ещё не опубликованного в таблице

• Время до первого токена — Claude Fable 5.1 274,43 с против медианы по таблице 3,83 с; Claude Opus 5.5 ещё не опубликован

• Многословность в индексе — Claude Opus 5.5 сгенерировала 260 млн выходных токенов при медианном значении 88 млн по всем категориям

• Цена — Claude Opus 5.5 $4,00 / $20,00 за миллион против Claude Fable 5.1 $10,00 / $50,00

Две из этих строк нужно читать, а не цитировать. Первая — это метка «Max Effort»: ни одна из оценок моделей не отражает их заводские настройки по умолчанию, и эти два значения по умолчанию не совпадают — подробнее об этом ниже. Вторая — это строка о многословности, которая идёт вразрез с тем, как продвигается Opus 5.5. История Anthropic об эффективности заключается в том, что модель приходит к тому же ответу, используя меньше токенов, и в материалах запуска приводятся слова партнёров, сообщающих о сокращении количества выходных токенов на треть или наполовину. В Индексе, при измерении, а не цитировании, Opus 5.5 сгенерировал 260 млн токенов против медианы по таблице в 88 млн — примерно в три раза более разговорчивый, чем типичная модель, с которой его сравнивают. Оба утверждения могут быть верны: модель может использовать меньше токенов, чем Claude Opus 5, но при этом оставаться многословной в абсолютных цифрах. Но если вы формировали бюджет исходя из фразы «меньше токенов», а не из собственного счёта, то проверять стоит именно независимое измерение.

Что дают дополнительные $6 за миллион

A screenshot of Anthropic's Claude Platform Docs page for Claude Opus 5.5 showing its 'How it compares' table: Claude Fable 5.1 and Claude Opus 5.5 both at 1M context and 128K max output with a Jun 2026 cutoff, Fable 5.1 at $10 / $50 with high default effort and slower latency against Opus 5.5 at $4 / $20 with medium default effort and moderate latency, with Claude Sonnet 5 at $2 / $10 and a Jan 2026 cutoff and Claude Haiku 4.5 below them. The Opus 5.5 pricing panel underneath lists $4 input, $20 output, $5 and $8 cache writes, $0.20 cache read and a 50% batch discount.

Уберите бенчмарки, и разница — это тарифная сетка. Всё здесь взято с опубликованной страницы цен Anthropic, которую можно проверить сегодня:

• Ввод — $4.00 за миллион в Opus 5.5 против $10.00 в Fable 5.1

• Вывод — $20.00 за миллион против $50.00

• Чтение кэша — $0.20 за миллион на Opus 5.5 против $0.25 на Fable 5.1

• Множитель кэша — Opus 5.5 тарифицирует попадания в кэш по 0,05× от базового ввода; Fable 5.1 — по 0,025×, лучший множитель при более высокой базе

• Запись в кэш — 5 $ за миллион за 5-минутное окно и 8 $ за час на Opus 5.5, против 12,50 $ и 20 $ на Fable 5.1

• Batch API — Opus 5.5 снижается вдвое до $2,00 / $10,00; Fable 5.1 снижается вдвое до $5,00 / $25,00

• Быстрый режим — Opus 5.5 поддерживает его за $8.00 / $40.00, обеспечивая примерно до 2,5-кратного увеличения скорости вывода; Fable 5.1 вообще не поддерживает быстрый режим

На строку с кэшем стоит взглянуть дважды, потому что две модели переворачивают обычную картину. У Fable 5.1 более агрессивный множитель — 2,5% от базового ввода против 5% у Opus 5.5 — но поскольку её база составляет $10, а не $4, чтение из кэша у неё всё равно остаётся более дорогим из двух в абсолютных долларах. Не существует конфигурации, в которой премиальная модель выигрывает на токене кэшированного контекста. И множитель — это не то, что можно перенести: агентный цикл, настроенный на поведение кэширования Fable 5.1, будет платить больше за каждое попадание в кэш на Opus 5.5 пропорционально, даже при том что за свежий токен он платит меньше.

Быстрый режим — это более резкая асимметрия. В документации Anthropic быстрый режим указан для Claude Opus 5.5, Claude Opus 5 и Claude Opus 4.8 — Fable 5.1 в этом списке отсутствует. Таким образом, у более дешёвой модели есть рычаг задержки, которого у дорогой попросту нет, при $8/$40, что всё ещё ниже стандартной ставки вывода Fable 5.1 в $10/$50. Если ваша рабочая нагрузка настолько интерактивна, что медленный первый токен становится проблемой продукта, учтите, что измеренное время до первого токена у Fable 5.1 составляет 274 секунды. Это число — артефакт рассуждений с максимальными усилиями, а не дефект, но именно его зафиксировал оценщик.

Значения по умолчанию не одинаковы, и в этом ловушка.

В собственной документации Anthropic по моделям эти две модели поставлены рядом, и строка, которая решает большинство реальных сравнений, — не цена. Это уровень усилий по умолчанию: средний для Claude Opus 5.5, высокий для Claude Fable 5.1. Обе используют адаптивное мышление, которое нельзя отключить; глубина управляется только параметром усилий, по шкале: низкий, средний, высокий, очень высокий, максимальный.

Вот почему фраза из анонса «Opus 5.5 соответствует Fable 5.1 в большинстве задач» и таблицы бенчмарков под ней выглядят так, будто противоречат друг другу. Строки прямого сравнения Anthropic для Opus 5.5 часто помечены настройкой усилий более высокой, чем значение по умолчанию: показатель Terminal-Bench 4.0 — 66,4% против 55,8% у Fable 5.1 — был получен при уровне усилий xhigh, а не medium. При этом собственные показатели Fable 5.1 были получены при его более высоком уровне по умолчанию. Две модели, которые сравниваются при разных настройках усилий, на самом деле вообще не сравниваются, и Anthropic говорит об этом же в своих собственных материалах к запуску, предупреждая, что разрывы в бенчмарках на этом уровне возможностей — менее надёжный ориентир для различий в реальном мире, чем подразумевают сами оценки.

На практике это превращает решение в упражнение по настройке, а не в выбор. Если вы переходите с Fable 5.1 на Opus 5.5 и переносите свою настройку effort без изменений, вы незаметно меняете то, сколько модель размышляет, и все показатели качества и стоимости, которые вы получите после этого, оказываются искажёнными. Рекомендация Anthropic — тестировать несколько уровней effort, а не переносить настройки старой модели. Это дёшево, и почти никто этого не делает, потому что для этого нужно дважды прогнать собственные оценки.

Единственное место, где это сочетание оправдывает себя

Паттерн, который оправдывает сохранение обеих моделей, — это цикл с советником: Opus 5.5 выполняет работу, Fable 5.1 привлекается для сложных решений. Anthropic измерила это, и точность действительно повышается — ценой более высокой стоимости и большей задержки; именно такой компромисс и ожидаешь, включая более медленную модель в цикл. Изменилась арифметика, стоящая за этим. Когда разрыв в возможностях был больше, платить $10/$50 за надзор за исполнителем стоимостью $5/$25 было очевидно оправданно. Теперь, когда исполнитель обходит советника в независимом индексе, вклад советника сужается до конкретных задач, где его собственные eval-показатели превосходят Opus 5.5, и эти задачи вам приходится выявлять самостоятельно. Цикл всё ещё имеет смысл для сложного подмножества; он перестаёт иметь смысл как универсальная конфигурация.

Оба находятся на расстоянии одной клавиши

Подвох при миграции, который здесь застаёт команды врасплох, — вовсе не в поверхности API: дело в том, что это модели одного и того же вендора, но с разными шкалами усилий, разными множителями кэша и разными настройками по умолчанию, и честно сравнить их можно, только прогнав обе на собственных промптах при согласованной конфигурации. Claude Opus 5.5 — на OrcaRouter по собственной цене Anthropic: $4.00 / $20.00, а Claude Fable 5.1 — на OrcaRouter за $10.00 / $50.00 — это цена из прайс-листа провайдера, переданная без наценки, 0%, так что обе цифры меняются в тот же день, когда их меняет Anthropic, и ни одна из них не тянет за собой второй контракт или второй SDK.

A screenshot of OrcaRouter's own model page for anthropic/claude-fable-5.1, headed 'Claude Fable 5.1' and credited to Anthropic, showing $10.00 input and $50.00 output per 1M tokens and a PERFORMANCE panel with 65.8 output tokens per second, a 274.43s time to first token, 88M output tokens over 7 days and a 0.00% error rate.

Именно это делает разделение практичным, а не теоретическим. Отправка основной части вашего трафика в Opus 5.5 и закрепление правила маршрутизации, которое эскалирует действительно сложные случаи в Fable 5.1, — это конфигурация на одной конечной точке, а не две интеграции — а составление вызова так, чтобы одна модель создавала черновик, а другая проверяла, — это строка на routing-DSL, а не конвейер, который нужно строить и поддерживать. Если путь эскалации окажется неподходящим для вашей рабочей нагрузки, автоматическое переключение при сбое обеспечит попадание запроса на модель, которую вы уже охарактеризовали, вместо полного отказа.

Что бы это уладило

Честная оценка этого сравнения такова: Anthropic опубликовала одну таблицу, в которой более дешёвая модель выигрывает в большинстве строк, Artificial Analysis опубликовала другую, в которой она выигрывает безоговорочно, и обе были проведены при таких настройках усилия, какие вы не поставляете. Ни то, ни другое не является контролируемым очным сравнением при согласованных настройках по умолчанию, и ни одна третья сторона такого не проводила. Разрыв, который сохраняется после всего этого — что Claude Opus 5.5 существенно дешевле по каждой строке тарифной сетки, поддерживает быстрый режим, которого нет у Fable 5.1, и не отстаёт по единственной независимой оценке, имеющейся у обеих моделей, — достаточно велик, чтобы бремя доказательства сместилось. Если вы по умолчанию работаете на Fable 5.1, вопрос уже не в том, достаточно ли хорош Opus 5.5; вопрос в том, какие конкретные задачи в вашей нагрузке проваливаются при среднем уровне усилия, потому что только за них вы и платите надбавку.

Сравнение в этой статье2

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно