Сгенерирована титульная hero-карточка для Claude Sonnet 5.5 против Claude Opus 5 с подзаголовком «снижение цены на 60% и разрыв в пять пунктов», показывающая $2.00 и $10.00 за миллион токенов против $5.00 и $25.00, с логотипом OrcaRouter, наложенным в правом нижнем углу.
Guides & Insights

Claude Sonnet 5.5 против Claude Opus 5: дешевле по всем пунктам и впереди по индексу

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Claude Opus 5 вышел 24 июля 2026 года по цене $5.00 за миллион входных токенов и $25.00 за миллион выходных токенов. Claude Sonnet 5.5 стал общедоступным 28 сентября 2026 года по цене $2.00 и $10.00. Это снижение на 60% на входе и на 60% на выходе для модели на два поколения новее — и, на тестовом стенде, который Artificial Analysis использует для обеих, модель, набирающая 56 баллов в Intelligence Index v4.3 против 51 у Claude Opus 5. Это редкое сравнение, когда более новая и дешёвая модель также набирает больше баллов в стороннем индексе и когда оставшийся аргумент в пользу предшественника — не место в рейтинге бенчмарков, а определённый класс задач. Обе модели принимают 1M токенов контекста, обе выдают до 128K токенов, обе читают текст, изображения и файлы, и обе настраивают рассуждения через параметр усилия, а не через бюджет токенов на размышления. Поскольку интерфейсы одинаковы, выбор между ними — это чисто вопрос о том, сколько стоит выполненная задача и какие задачи проваливаются.

Два релиза, один интерфейс

Начните с того, насколько мало меняется, потому что это больше, чем при большинстве скачков между поколениями.

• Контекстное окно — 1 000 000 токенов в обоих

• Максимальный вывод — 128 000 токенов в обоих случаях

• Входные данные — текст, изображение и файл в обоих; аудио и видео нет ни в одном

• Reasoning — адаптивное мышление с настраиваемым уровнем усилий в обоих, поэтому глубина задаётся параметром запроса, а не отдельной строкой модели

• Возможности — зрение, инструменты, JSON и рассуждения в обоих, согласно записям каталога OrcaRouter для anthropic/claude-opus-5 и линейки Sonnet

Практическое следствие таково: промпт, написанный для Claude Opus 5, не нужно переписывать, чтобы запустить его на Claude Sonnet 5.5, а агентный цикл, настроенный под потолок вывода в 128K, не требует нового уровня. Миграция — это замена строки модели плюс перепроверка того, какая настройка усилия у вас была зафиксирована, — и ничего больше. Для команд, переживших мультимодальные и многопараметрические переходы последних двух лет, это и есть главная новость, а не бенчмарк.

Единственное, что действительно меняется, — это цена, и она меняется в каждой строке, а не только в тех двух, что на маркетинговом слайде.

• Ввод — $2,00 за миллион против $5,00, снижение на 60%

• Вывод — $10.00 за миллион против $25.00, снижение на 60%

• Чтение кэша — $0.20 за миллион против $0.50, снижение на 60%

• Запись в кэш — $2,50 за миллион против $10,00 за пятиминутное окно, снижение на 75%

Если вы запускаете агента, который на каждом ходу заново перечитывает длинный префикс, именно строка чтения из кэша окупает миграцию. При $0,20 против $0,50 каждый кэшированный токен в длинной сессии обходится всего в 40% от прежней стоимости, а чтение из кэша составляет основную часть токенов в большинстве агентных циклов. Экономия накапливается так, как не способна отразить заголовочная цифра цены за токен.

Откуда взялись эти пять пунктов

Artificial Analysis присуждает Claude Sonnet 5.5 56 баллов, а Claude Opus 5 — 51 балл в Intelligence Index v4.3; оба результата измерены в конфигурации «Adaptive Reasoning, Max Effort». Пять баллов на такой шкале — не погрешность округления: для контекста, тот же оценщик ставит Sonnet 5 на 38, а Gemini 3.1 Pro Preview — на 30, так что разрыв между Claude Opus 5 и Claude Sonnet 5.5 составляет треть разрыва между Claude Opus 5 и предыдущим поколением Sonnet.

Собственные показатели запуска Anthropic для Claude Sonnet 5.5 указывают в том же направлении, но измерены другим инструментом. Компания сообщает о 70,6% на Terminal-Bench 4.0 — том же тесте, на котором Claude Opus 5 задокументирован на уровне 89,1% в более ранней таблице Anthropic; эта цифра использовала другую ревизию тестового стенда, и её не следует вычитать из более новой. Это самое важное предостережение об источниках в данной статье: Terminal-Bench перешёл на 4.0 в середине 2026 года, индекс, в который он входит, был пересмотрен до v4.3 в соответствии с этим, а межверсионные сравнения этого бенчмарка не являются простой арифметикой. Там, где с числом указана версия, приводите версию.

Что можно чисто сравнить — это собственный прогресс вендора по линии Sonnet — с 10,3% на Terminal-Bench 4.0 у Sonnet 5 до 70,6% у Sonnet 5.5 — и показатель стороннего индекса, где обе цифры получены на одном и том же тестовом стенде в один и тот же день. На основании этих данных преемник действительно превзошёл июльский флагман в общих рассуждениях, а это более сильное утверждение, чем любое заявление на слайде вендора.

Ловушка длины вывода

Вот здесь арифметика перестаёт быть благосклонной к более новой модели.

Artificial Analysis сообщает, что оценка Claude Sonnet 5.5 на его индексном наборе стоит $7,60 за задачу. Claude Opus 5 стоит $5,86 за задачу на том же наборе. Более новая модель, со скидкой 60% по каждой позиции прайс-листа, примерно на 30% дороже в расчёте на выполнение задачи. Причина указана в том же отчёте: Sonnet 5.5 выдала 410 млн токенов по всему набору против медианы в 88 млн среди отслеживаемых моделей, что оценщик называет «очень многословным». Claude Opus 5 выдала 140 млн на том же наборе.

Разделите это — и механизм прост. Sonnet 5.5 выдаёт примерно втрое больше выходных токенов, чем Claude Opus 5, на идентичной работе, при 40% цены за выход. Трижды 0,4 — это 1,2, то есть 20%-й штраф до эффектов кэша, что близко к результату $7.60 против $5.86. Цена за токен не ошибочна; просто это не то число, которое определяет счёт.

Это не делает более новую модель худшим вариантом покупки. Это делает решение зависимым от того, что большинство сравнений упускают: позволяет ли ваша рабочая нагрузка ограничить объём вывода. Задача суммаризации с указанием длины, конвейер структурированного извлечения данных, выдающий JSON, классификатор, возвращающий метку, — во всех этих случаях многословность так и не проявляется, а 60%-ное снижение по тарифной сетке — это реальные деньги. Агент с открытой задачей, которому поручено «починить репозиторий» без всякой дисциплины в отношении вывода, даёт Sonnet 5.5 втрое больше верёвки.

Настройки усилий и миграция, на которую никто не закладывает бюджет

Обе модели дают доступ к глубине рассуждений через параметр effort с несколькими уровнями, и обе поставляются со значением по умолчанию, а не с фиксированным значением — high на платформе Claude Platform, medium внутри приложений Claude. При миграции так и тянет оставить эту настройку такой, какой она была у старой модели, и на этом считать дело сделанным.

Это ошибка по измеримой причине. В собственной сноске Anthropic к Claude Sonnet 5.5 указано, что конфигурация с уровнем усилий Max набирает меньше баллов, чем Xhigh, в FrontierCode; это означает, что уровень усилий — не монотонный регулятор, а верхняя настройка не является бесплатным улучшением. Настраивайте уровень усилий, измеряя свою задачу, а не выбирая самый дорогой доступный вариант.

Есть также жёсткое различие в поведении на стороне Sonnet, о котором стоит знать до развёртывания. Anthropic заявляет, что Claude Sonnet 5.5 — первый Sonnet, выпускаемый с киберзащитными механизмами и резервными вариантами, соответствующими её моделям верхнего уровня, поэтому запросы по безопасности с повышенным риском заметно перенаправляются на более ранний Sonnet, а не обслуживаются указанной вами моделью. Если ваша рабочая нагрузка относится к этой области, в ваших логах будет отображаться модель, которую вы не запрашивали. Claude Opus 5 появился до появления такого механизма в линейке Sonnet, хотя аналогичный класс маршрутизации существует во всех продуктах Anthropic для работ по биологии и кибербезопасности на флагманских уровнях.

В OrcaRouter обе конечные точки уже работают сегодня — anthropic/claude-opus-5 и anthropic/claude-sonnet-5 находятся в том же каталоге, что и всё остальное, по цене из прайс-листа провайдера с наценкой 0 % — а Claude Sonnet 5.5 будет доступен по тем же учётным данным, как только появится в списке. А релевантная возможность тем временем — это автоматическое переключение при сбое: если один уровень Anthropic ограничен по скорости или возвращает ошибки, запрос можно перенаправить на другой без изменений в коде, что является самым дешёвым способом застраховаться от ошибки в этом сравнении.

Решение, сформулированное в виде правила

Если ваша работа ограничена по рамкам — вы контролируете форму вывода, промпты структурированы, а количество токенов на задачу предсказуемо — переходите на Claude Sonnet 5.5 и получите сокращение затрат на 60%. Индекс согласен, тарифная сетка согласна, и аргументов о возможностях в пользу другой стороны больше не осталось.

Если ваша работа открытая и агентная, проведите эксперимент, прежде чем верить любому из прайс-листов. Измеряйте токены на выполненную задачу на собственном трафике в течение недели на каждой модели; результат стороннего теста — $7,60 против $5,86 — это конкретное предупреждение о том, что более дешёвый тариф может привести к более крупному счёту. Claude Opus 5 остаётся более безопасным выбором по умолчанию для долгосрочной автономной работы, пока у вас нет этой цифры.

Честный вердикт: это первое поколение Sonnet, в котором выбор флагмана зависит от формы задачи, а не от чистой мощности, и любой, кто всё ещё принимает решение только по названию модели, теперь либо упускает 60% возможной отдачи, либо платит на 30% больше за каждую завершённую задачу — в зависимости лишь от того, в какую сторону он угадает.

A two-column scoreboard for Claude Sonnet 5.5 and Claude Opus 5 across eight rows. Left column Claude Sonnet 5.5: input $2.00, output $10.00, cache read $0.20, cache write $2.50, 1M context with 128K max output, AA Intelligence Index v4.3 score 56, $7.60 per task on the index run, 410M output tokens on the index suite. Right column Claude Opus 5: input $5.00, output $25.00, cache read $0.50, cache write $10.00, 1M context with 128K max output, AA Intelligence Index v4.3 score 51, $5.86 per task on the index run, 140M output tokens on the index suite. A footer line reads "Prices per the OrcaRouter catalogue; index and per-task figures per Artificial Analysis, Intelligence Index v4.3. Sonnet 5.5 is 60% cheaper on input, output and cache reads and 75% cheaper on cache writes, and still costs about 30% more per finished task."Screenshot of the OrcaRouter model page for Anthropic Claude Opus 5 (anthropic/claude-opus-5), showing the model header, a 1M-token context window with 128K maximum output, text, image and file input, the Vision, Tools, JSON and Reasoning capability tags, a 5.19-second p50 time to first token, a "Public benchmarks by Anthropic · 2026-07-24" line, and the $5.00 input and $25.00 output prices per million tokens.Screenshot of Artificial Analysis's model page for Claude Sonnet 5.5, named in full as "Claude Sonnet 5.5 (Adaptive Reasoning, Max Effort, Default Fallback)" and marked released September 2026, showing the In $2.00 and Out $10.00 rates, the Intelligence Index score of 56, the $7.60 average cost per task, and the 410M output tokens described as very verbose against a median of 88M.

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно