Сгенерированная титульная карточка для Claude Sonnet 5.5 против Claude Fable 5.1 с подзаголовком «Дешёвая модель опережает на три пункта», где слева показаны $2.00 за вход и $10.00 за выход за миллион токенов, а справа — $10.00 и $50.00, с расположенными под ними показателями 56 и 53 индекса Artificial Analysis Intelligence Index v4.3, а логотип OrcaRouter совмещён в правом нижнем углу.
Guides & Insights

Claude Sonnet 5.5 против Claude Fable 5.1: дешёвая модель опережает на три пункта

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Claude Sonnet 5.5 появилась 28 сентября 2026 года по цене $2.00 за миллион входных токенов и $10.00 за миллион выходных токенов. Claude Fable 5.1 — модель класса Mythos, выпущенная вендором 1 сентября, — стоит $10.00 и $50.00 по тем же двум тарифным позициям. Соблазнительный вывод состоит в том, что Fable 5.1 — дорогая, а значит, лучшая, однако в Artificial Analysis Intelligence Index порядок обратный: Claude Sonnet 5.5 набирает 56 баллов, а Claude Fable 5.1 — 53. Это не артефакт округления, и это тоже не вся история, потому что тот же инструмент оценки показывает разницу между ними менее трёх центов на задачу на одном и том же наборе тестов — $7.60 против $7.63. Пятикратная разница в тарифной сетке почти исчезает к моменту завершения задачи. Что остаётся — это набор различий в профиле, а не в баллах, и выбор между этими двумя в основном сводится к тому, какой профиль у вашей рабочей нагрузки.

Две тарифные карты и та единственная строка, где разрыв не пятикратный.

Сравнение по токенам разительно и не требует интерпретации.

• Ввод — Claude Sonnet 5.5 по $2.00 за миллион токенов против Claude Fable 5.1 по $10.00 — разница в пять раз

• Вывод — $10.00 против $50.00 за миллион, снова ровно в пять раз

• Чтение кэша — $0,20 против $0,25 за миллион. Именно эта строка вытягивает длительные запуски агентов, а скидка обваливается с 5× до 20 %.

• Запись в кэш — $2,50 против $12,50 за миллион для стандартного пятиминутного окна, самый большой единичный разрыв на любой из карточек

• Batch — режим Batch у Anthropic применяется ни к одной из этих карточек так, как к карточкам Fable 5.1: Fable 5.1 вышел с пакетным ценообразованием, сниженным вдвое — $5.00 за ввод и $25.00 за вывод. Прежде чем предполагать, что это переносится на всё семейство, прочитайте строку о Batch на самой странице цен Anthropic.

• Контекст и потолок — 1 000 000 токенов контекста и 128 000 токенов максимального вывода у обоих. В Message Batches API Claude Sonnet 5.5 поддерживает до 300 000 выходных токенов при бета-заголовке output-300k-2026-03-24, и это реальная разница в потолке для массовой генерации, а не маркетинговая

Есть один скромный довод в пользу Claude Sonnet 5.5, который тарифная сетка недооценивает. Anthropic сообщает, что модели обычно требуется значительно меньше токенов для выполнения той же работы, чем её предшественнице, что, по её словам, означает снижение стоимости на задачу вплоть до 30%. Это заявление вендора о другом сравнении — Sonnet 5.5 против Sonnet 5 — и оно не является свидетельством в пользу этого противостояния. Однако именно этот механизм объясняет то, что обнаружило независимое измерение.

Куда уходит пятикратный разрыв в цене

Artificial Analysis прогнала обе модели 2026-09-29 в рамках единого харнесса и с одной меткой конфигурации — «Adaptive Reasoning, Max Effort, Default Fallback» — по Intelligence Index v4.3. Две главные цифры — 56 у Claude Sonnet 5.5 и 53 у Claude Fable 5.1: более дешёвая модель впереди примерно на три пункта по шкале, где тот же оценщик ставит медианную модель на 26. Обе обозначены как модели с именем вендора на одной и той же странице, так что это один инструмент и один снимок, а не два.

Затем — столбец стоимости, и причина, по которой эта пара интересна, а не очевидна. В одном и том же прогоне индекса Claude Sonnet 5.5 стоит $7.602633 на задачу, а Claude Fable 5.1 — $7.629706. Разница — двадцать семь тысячных доллара. Самое странное начинается при разложении: одна только входная часть Claude Fable 5.1 составляет $3.73 на задачу против существенно меньшей входной составляющей Sonnet 5.5, а одни только токены рассуждений стоят $2.36 на задачу. Модель, которая в пять раз дешевле за токен, вовсе не дешевле за завершённую задачу.

Причина — объём, и две модели терпят неудачу в противоположных направлениях.

• Выходные токены по всему индексному набору — Claude Sonnet 5.5 сгенерировал 410 577 501 против 188 465 663 у Claude Fable 5.1, при том что отслеживаемая медиана в этом наборе составляет 88 миллионов. Оба показателя значительно выше медианы; Sonnet 5.5 более чем вдвое превосходит Fable 5.1 и почти в пять раз — медиану

• Выходные токены на задачу — 192 838 для Sonnet 5.5 против 78 111 для Fable 5.1, при доле рассуждений 142 386 против 47 240. Sonnet 5.5 думает примерно в три раза дольше на задачу

• Входные токены по всему набору индексов — 18,5 млрд у Sonnet 5.5 против 5,6 млрд у Fable 5.1. Sonnet 5.5 прочитал в три раза больше, и это более скромная цифра в паре — та, что съедает более дешёвый тариф на входные токены

• Смешанная цена при соотношении ввода, чтения из кэша и вывода 7:2:1 — $1,54 для Sonnet 5.5 против $7,17 для Fable 5.1. Это та строка, которая соответствует тарифной сетке, и это та строка, которая описывает рабочую нагрузку с короткими, чётко ограниченными выходными данными

Сложите это вместе, и честное утверждение будет таким: разрыв в смешанной цене реален, а разрыв в расчёте на задачу — нет. Какое из этих двух чисел описывает ваш счёт, целиком зависит от того, завершаются ли ваши задачи или разрастаются, а набор индексов устроен так, чтобы позволять им разрастаться.

Лестница усилий — это и есть настоящее решение.

Обе модели предоставляют параметр усилия — low, medium, high, xhigh, max — и обе были измерены на каждой ступени 2026-09-29. Это та часть сравнения, которую не способна выразить ни одна тарифная сетка, потому что дешёвая модель на низкой ступени с большим отрывом превосходит дорогую модель на низкой ступени, и дорогая модель отрывается только ближе к верхним ступеням.

• Низкие усилия — Claude Sonnet 5.5 набирает 35.84 при $0.41 за задачу; Claude Fable 5.1 набирает 46.82 при $2.37. На нижней ступени дорогая модель опережает на одиннадцать пунктов, почти за шестикратную сумму

• Среднее усилие — 40,74 при $0,59 против 48,92 при $2,98. Fable 5.1 удерживает преимущество в восемь пунктов при пятикратной стоимости

• Высокое усилие — 46,74 при $1,08 против 51,15 при $3,91. Разрыв сокращается до четырёх с половиной пунктов; соотношение затрат остаётся на уровне около 3,6×

• Xhigh effort — 51,85 за $2,74 против 53,20 за $5,98. Разница — одна целая и одна треть балла, при 46% от цены.

• Максимальное усилие — 55.98 при $7.60 против 53.35 при $7.63. Порядок инвертируется, и стоимость сходится в пределах половины процента.

Прочитайте четвёртую и пятую строки вместе — и проступит контур этого противостояния. Claude Sonnet 5.5 на xhigh выдаёт 51.85 — в пределах полутора индексных пунктов от лучшего результата Claude Fable 5.1 при любом уровне усилий — за $2.74 за задачу против $7.63. Если вашей работе нужно быть рядом с передним краем, а не на нём самом, эта строка — исчерпывающий ответ, и она экономит 64% на каждую выполненную задачу. Разгоните Sonnet 5.5 до максимума — и вы покупаете ещё три пункта за 2,8-кратные деньги, что приводит вас к тому же счёту, что и максимум Fable 5.1, с чуть лучшим результатом и совершенно иным профилем рассуждений.

Эту последнюю фразу стоит уточнить, потому что она достаточно контринтуитивна, чтобы перепроверить её дважды. При одинаковом максимальном уровне усилий модель с прайс-листом в пять раз дешевле обходится в расчёте на задачу столько же, сколько модель с дорогим прайс-листом. Она достигает этого, выдавая в 2,5 раза больше выходных токенов, причём доля рассуждений среди них втрое больше. Собственная документация Anthropic объясняет часть механизма: токенизатор изменился, и один и тот же текст даёт примерно на 30% больше токенов в Claude Sonnet 5.5, чем в более ранних моделях. Это лишь один из нескольких факторов, и это полезное напоминание о том, что количество выходных токенов нельзя сравнивать между ревизиями токенизатора, не оговаривая это.

Латентность — вот где эти двое перестают походить друг на друга.

Совпадение оценок не распространяется на время. На одном и том же снимке от 2026-09-29 Artificial Analysis сообщает о времени до первого токена 254,41 секунды для Claude Fable 5.1 и 2,80 секунды для Claude Sonnet 5.5 на срезе длинных промптов, при медианной скорости вывода 67,9 и 49,4 токена в секунду соответственно. Это разница в два порядка в том, сколько вызывающему приходится ждать до поступления первого ответа, и это самое операционно значимое число в данном сравнении.

Обе цифры требуют чёткого указания своих уточнений. TTFT для Fable 5.1 измеряется на типе длинного промпта; срез по средним промптам у оценщика для той же модели в тот же день составляет 117,60 секунды, поэтому показатель в 254 секунды — это хвост, а не константа. Показатель Sonnet 5.5 в 2,80 секунды — это его общая медиана, при этом собственный диапазон разброса у оценщика простирается от 1,91 секунды на пятом процентиле до 4,23 на девяносто пятом. В документации платформы Anthropic сравнительная задержка Fable 5.1 описывается как более медленная, а Sonnet 5.5 — как быстрая, что согласуется по направлению, но не является измерением.

Наша собственная инфраструктура даёт третье показание, потому что мы маршрутизируем Claude Fable 5.1 и измеряем то, что отдаём. За семь дней, закончившихся 28 сентября, на собственном трафике OrcaRouter Claude Fable 5.1 показывает медианное время до первого токена 6 973 миллисекунды при 95-м процентиле 10,0 секунды, скорость вывода 65,8 токена в секунду и долю ошибок 0,349 %. Этот p50 более чем в сто раз быстрее, чем показатель оценщика для длинного промпта, и это не столько противоречие, сколько определение терминов: время до первого токена, с которым имеет дело разработчик, при коротком промпте и время до первого токена в бенчмарке при длинном — это измерения разных вещей. Любой, кто планирует, отталкиваясь от числа в таблице лидеров, должен понимать, что именно он покупает.

Screenshot of Anthropic's product page for Claude Sonnet 5.5 via the Claude Platform overview, showing the model comparison table across context window, maximum output, input price, output price, comparative latency, thinking mode and knowledge cutoff, with Claude Sonnet 5.5 marked as the model being viewed at $2.00 input and $10.00 output per million tokens alongside Claude Fable 5.1 and Claude Opus 5.5.

Честность в сорсинге, удержание и миграция, о которой никто не упоминает

Таблицы бенчмарков вендоров и независимые оценки — это разные инструменты, и их никогда не следует вычитать друг из друга. Собственная таблица запуска Anthropic для Claude Sonnet 5.5 сообщает о Terminal-Bench 4.0 на уровне 70.6%. Artificial Analysis, используя собственный тестовый стенд, сообщает о 63.6% для той же модели в оценке с тем же названием. Для Claude Fable 5.1 расхождение идёт в другую сторону: Anthropic сообщила о 55.8% при запуске, а независимый тестовый стенд показывает 52.0%. Ни одна из пар не является исправлением другой. Оценивайте каждую по её собственным критериям и отдавайте предпочтение независимой, когда решаете, куда направлять производственный трафик.

Режим хранения данных тоже различается, и это именно то различие, которое проявляется только в ходе закупочного аудита. Anthropic заявляет, что Claude Sonnet 5.5 доступен с нулевым хранением данных — такой же подход она применяла к Opus 5.5 и Sonnet 5. В материалах к запуску Claude Fable 5.1 описывается дополнительная политика использования данных, действующая параллельно с ним, и отдельное развёртывание в рамках Project Glasswing с установленным по умолчанию 30-дневным окном хранения для мониторинга безопасности, при этом режим нулевого хранения описывается как временное состояние. Если ваша команда подотчётна в рамках проверки обработки данных, это различие — реальная статья расходов, а не сноска, и стоит прочитать текущую страницу политики Anthropic, а не любое её резюме, включая это.

Затраты на миграцию асимметричны, и это редко попадает в материалы о запуске. Переход на Claude Sonnet 5.5 — не просто изменение строки модели. Руководство Anthropic по миграции указывает, что значения temperature, top_p и top_k, отличные от значений по умолчанию, теперь возвращают ошибку 400; что tool_choice со значением any или именованный инструмент отклоняется сразу; и что thinking: {"type": "disabled"} должен стать between_tools, если вы работали с отключённым предварительным thinking. Тип between_tools принимается при низком, среднем и высоком уровне усилий (low, medium и high) и возвращает 400 при xhigh или max. В Claude API и Google Cloud функция computer use поддерживается только через набор инструментов computer_toolset_20260801; более старый computer_20251124 отклоняется. Ничто из перечисленного не относится к переходу на Claude Fable 5.1 — это обновление в том же семействе, что и Fable 5, с тремя собственными ломающими изменениями. Если вы рассматриваете оба варианта как параллельные цели миграции, более дешёвая модель окажется более дорогой для внедрения.

A two-column scoreboard for Claude Sonnet 5.5 and Claude Fable 5.1. Left column Claude Sonnet 5.5: input $2.00, output $10.00, cache read $0.20, cache write $2.50, 1M context with 128K max output, AA Intelligence Index v4.3 score 56, best value rung xhigh at 51.85 and $2.74 per task, first token 2.80 seconds, 410M output tokens on the index suite. Right column Claude Fable 5.1: input $10.00, output $50.00, cache read $0.25, cache write $12.50, 1M context with 128K max output, AA Intelligence Index v4.3 score 53, best score max at 53.35 and $7.63 per task, first token 254.41 seconds on the long prompt slice, 188M output tokens on the index suite. The card heading reads 'Claude Sonnet 5.5 against Claude Fable 5.1: five-fold on the rate card, level on the finished task', and a footer line reads 'Per-token prices per the OrcaRouter catalogue; index, per-task, effort and latency figures per Artificial Analysis, Intelligence Index v4.3, 2026-09-29 snapshot.'

Что куда положить?

Решение, вытекающее из этих цифр, — это решение о том, какая часть вашего трафика имеет чёткие границы.

• Ограниченная, массовая, инструментально-ориентированная работа — Claude Sonnet 5.5, при уровне усилий xhigh, если вам нужно быть у переднего края. Он на полтора индексных пункта отстаёт от лучшего результата Fable 5.1 при на 64% меньшей стоимости за выполненную задачу, выдаёт первый токен примерно за три секунды, а его более дешёвая строка тарификации записи в кэш делает пересобранный префикс контекста доступным по цене.

• Долгосрочная, открытая работа, где неправильный ответ дорого обходится, — Claude Fable 5.1. Он достигает максимального результата Sonnet 5.5 при той же стоимости за задачу, но при этом тратит треть токенов рассуждения и четверть входных данных, что важно, когда задача действительно открытая, а структура набора оценочных тестов напоминает вашу проблему

• Интерактивные поверхности, ограниченные задержкой — Claude Sonnet 5.5, и это даже не близко. На собственном снапшоте оценщика разрыв по времени до первого токена составляет два порядка для длинных промптов, а замер на промптах средней длины сокращает его лишь примерно до 118 секунд. Чат-интерфейс нельзя строить на показателе Fable 5.1 без батчинга или стриминга в обход него.

• Массовая генерация с длинными выводами — Claude Sonnet 5.5, поскольку в Message Batches API доступен потолок вывода в 300 000 токенов при использовании заголовка output-300k-2026-03-24, тогда как во всех остальных случаях действует потолок в 128 000 токенов. Уточните стоимость пакетной обработки, прежде чем оформлять заказ; тариф для пакетной обработки не одинаков на двух карточках.

• Работа, которая должна охватывать несколько аккаунтов или передавать рассуждения между системами, — прежде чем браться за любое из этого, прочитайте документацию Anthropic о preserved thinking. Блоки рассуждений привязаны к модели и аккаунту, которые их создали, а Sonnet 5.5 — первый Sonnet, поставляемый с классификаторами, которые предотвращают извлечение рассуждений. Это одновременно функция соответствия требованиям и ограничение.

• Рабочие нагрузки, связанные с регулированием или чувствительные к срокам хранения данных — проверяйте текущую политику, а не материалы о запуске. Claude Sonnet 5.5 вышел с доступным режимом нулевого хранения данных; в материалах Fable 5.1 описана поэтапная политика с 30-дневным окном по умолчанию в одном развёртывании и нулевым хранением в качестве промежуточного состояния

Screenshot of the OrcaRouter model page for Anthropic Claude Fable 5.1 (anthropic/claude-fable-5.1), showing the model header, a 1M-token context window with 128K maximum output, the capability tags, the $10.00 input and $50.00 output prices per million tokens with a $0.25 cache read and $12.50 cache write, and the seven-day performance panel with a 65.836 token-per-second output speed and a 0.349% error rate.

На OrcaRouter Claude Fable 5.1 и Claude Sonnet 5 оба доступны с одними учётными данными по прайс-листовой цене провайдера с наценкой 0%, так что при переключении между ними на ваш счёт влияют только строка за чтение кэша и изменение токенизатора. Claude Sonnet 5.5 пока не является маршрутом на нашей платформе — модели всего один день — поэтому честно будет сказать, что сегодня до неё можно добраться через собственный API Anthropic. Любой, кто использует Fable 5.1 через нас, сможет рассчитать стоимость переключения в день его появления, не меняя ничего другого в своей интеграции, а тем временем автоматическое отказоустойчивое переключение между провайдерами — это то, что позволяет безопасно попробовать такую новую модель на пути, который должен оставаться рабочим.

Вердикт уже, чем предполагает разрыв в цене. Claude Sonnet 5.5 — лучший выбор по умолчанию почти для всего ограниченного: в независимом индексе он набирает на три балла больше, отвечает за секунды, а на уровне xhigh приближается к потолку Fable 5.1 на полтора балла, обходясь при этом заметно меньше чем в половину стоимости за задачу. У Claude Fable 5.1 остаётся один реальный аргумент, и его приводит сама сравнительная таблица Anthropic: когда работа открытая и цена ошибки превышает цену более долгих раздумий, пятикратная цена за входные данные покупает модель, которая достигает того же результата, не тратя втрое больше токенов рассуждений. Выбирайте по форме задачи, а не по размеру прайс-листа, потому что на верхней ступени лестницы усилий эти две модели выставят вам одинаковый счёт.

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно