
Claude Sonnet 5.5 против Claude Opus 5: дешевле по всем пунктам и впереди по индексу
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 984 tok/s
- openaiНОВИНКАOpenAI: GPT-6 Luna2026-09-2237Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- anthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- grokНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов · 195 tok/s
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
Claude Opus 5 вышел 24 июля 2026 года по цене $5.00 за миллион входных токенов и $25.00 за миллион выходных токенов. Claude Sonnet 5.5 стал общедоступным 28 сентября 2026 года по цене $2.00 и $10.00. Это снижение на 60% на входе и на 60% на выходе для модели на два поколения новее — и, на тестовом стенде, который Artificial Analysis использует для обеих, модель, набирающая 56 баллов в Intelligence Index v4.3 против 51 у Claude Opus 5. Это редкое сравнение, когда более новая и дешёвая модель также набирает больше баллов в стороннем индексе и когда оставшийся аргумент в пользу предшественника — не место в рейтинге бенчмарков, а определённый класс задач. Обе модели принимают 1M токенов контекста, обе выдают до 128K токенов, обе читают текст, изображения и файлы, и обе настраивают рассуждения через параметр усилия, а не через бюджет токенов на размышления. Поскольку интерфейсы одинаковы, выбор между ними — это чисто вопрос о том, сколько стоит выполненная задача и какие задачи проваливаются.
Два релиза, один интерфейс
Начните с того, насколько мало меняется, потому что это больше, чем при большинстве скачков между поколениями.
• Контекстное окно — 1 000 000 токенов в обоих
• Максимальный вывод — 128 000 токенов в обоих случаях
• Входные данные — текст, изображение и файл в обоих; аудио и видео нет ни в одном
• Reasoning — адаптивное мышление с настраиваемым уровнем усилий в обоих, поэтому глубина задаётся параметром запроса, а не отдельной строкой модели
• Возможности — зрение, инструменты, JSON и рассуждения в обоих, согласно записям каталога OrcaRouter для anthropic/claude-opus-5 и линейки Sonnet
Практическое следствие таково: промпт, написанный для Claude Opus 5, не нужно переписывать, чтобы запустить его на Claude Sonnet 5.5, а агентный цикл, настроенный под потолок вывода в 128K, не требует нового уровня. Миграция — это замена строки модели плюс перепроверка того, какая настройка усилия у вас была зафиксирована, — и ничего больше. Для команд, переживших мультимодальные и многопараметрические переходы последних двух лет, это и есть главная новость, а не бенчмарк.
Единственное, что действительно меняется, — это цена, и она меняется в каждой строке, а не только в тех двух, что на маркетинговом слайде.
• Ввод — $2,00 за миллион против $5,00, снижение на 60%
• Вывод — $10.00 за миллион против $25.00, снижение на 60%
• Чтение кэша — $0.20 за миллион против $0.50, снижение на 60%
• Запись в кэш — $2,50 за миллион против $10,00 за пятиминутное окно, снижение на 75%
Если вы запускаете агента, который на каждом ходу заново перечитывает длинный префикс, именно строка чтения из кэша окупает миграцию. При $0,20 против $0,50 каждый кэшированный токен в длинной сессии обходится всего в 40% от прежней стоимости, а чтение из кэша составляет основную часть токенов в большинстве агентных циклов. Экономия накапливается так, как не способна отразить заголовочная цифра цены за токен.
Откуда взялись эти пять пунктов
Artificial Analysis присуждает Claude Sonnet 5.5 56 баллов, а Claude Opus 5 — 51 балл в Intelligence Index v4.3; оба результата измерены в конфигурации «Adaptive Reasoning, Max Effort». Пять баллов на такой шкале — не погрешность округления: для контекста, тот же оценщик ставит Sonnet 5 на 38, а Gemini 3.1 Pro Preview — на 30, так что разрыв между Claude Opus 5 и Claude Sonnet 5.5 составляет треть разрыва между Claude Opus 5 и предыдущим поколением Sonnet.
Собственные показатели запуска Anthropic для Claude Sonnet 5.5 указывают в том же направлении, но измерены другим инструментом. Компания сообщает о 70,6% на Terminal-Bench 4.0 — том же тесте, на котором Claude Opus 5 задокументирован на уровне 89,1% в более ранней таблице Anthropic; эта цифра использовала другую ревизию тестового стенда, и её не следует вычитать из более новой. Это самое важное предостережение об источниках в данной статье: Terminal-Bench перешёл на 4.0 в середине 2026 года, индекс, в который он входит, был пересмотрен до v4.3 в соответствии с этим, а межверсионные сравнения этого бенчмарка не являются простой арифметикой. Там, где с числом указана версия, приводите версию.
Что можно чисто сравнить — это собственный прогресс вендора по линии Sonnet — с 10,3% на Terminal-Bench 4.0 у Sonnet 5 до 70,6% у Sonnet 5.5 — и показатель стороннего индекса, где обе цифры получены на одном и том же тестовом стенде в один и тот же день. На основании этих данных преемник действительно превзошёл июльский флагман в общих рассуждениях, а это более сильное утверждение, чем любое заявление на слайде вендора.
Ловушка длины вывода
Вот здесь арифметика перестаёт быть благосклонной к более новой модели.
Artificial Analysis сообщает, что оценка Claude Sonnet 5.5 на его индексном наборе стоит $7,60 за задачу. Claude Opus 5 стоит $5,86 за задачу на том же наборе. Более новая модель, со скидкой 60% по каждой позиции прайс-листа, примерно на 30% дороже в расчёте на выполнение задачи. Причина указана в том же отчёте: Sonnet 5.5 выдала 410 млн токенов по всему набору против медианы в 88 млн среди отслеживаемых моделей, что оценщик называет «очень многословным». Claude Opus 5 выдала 140 млн на том же наборе.
Разделите это — и механизм прост. Sonnet 5.5 выдаёт примерно втрое больше выходных токенов, чем Claude Opus 5, на идентичной работе, при 40% цены за выход. Трижды 0,4 — это 1,2, то есть 20%-й штраф до эффектов кэша, что близко к результату $7.60 против $5.86. Цена за токен не ошибочна; просто это не то число, которое определяет счёт.
Это не делает более новую модель худшим вариантом покупки. Это делает решение зависимым от того, что большинство сравнений упускают: позволяет ли ваша рабочая нагрузка ограничить объём вывода. Задача суммаризации с указанием длины, конвейер структурированного извлечения данных, выдающий JSON, классификатор, возвращающий метку, — во всех этих случаях многословность так и не проявляется, а 60%-ное снижение по тарифной сетке — это реальные деньги. Агент с открытой задачей, которому поручено «починить репозиторий» без всякой дисциплины в отношении вывода, даёт Sonnet 5.5 втрое больше верёвки.
Настройки усилий и миграция, на которую никто не закладывает бюджет
Обе модели дают доступ к глубине рассуждений через параметр effort с несколькими уровнями, и обе поставляются со значением по умолчанию, а не с фиксированным значением — high на платформе Claude Platform, medium внутри приложений Claude. При миграции так и тянет оставить эту настройку такой, какой она была у старой модели, и на этом считать дело сделанным.
Это ошибка по измеримой причине. В собственной сноске Anthropic к Claude Sonnet 5.5 указано, что конфигурация с уровнем усилий Max набирает меньше баллов, чем Xhigh, в FrontierCode; это означает, что уровень усилий — не монотонный регулятор, а верхняя настройка не является бесплатным улучшением. Настраивайте уровень усилий, измеряя свою задачу, а не выбирая самый дорогой доступный вариант.
Есть также жёсткое различие в поведении на стороне Sonnet, о котором стоит знать до развёртывания. Anthropic заявляет, что Claude Sonnet 5.5 — первый Sonnet, выпускаемый с киберзащитными механизмами и резервными вариантами, соответствующими её моделям верхнего уровня, поэтому запросы по безопасности с повышенным риском заметно перенаправляются на более ранний Sonnet, а не обслуживаются указанной вами моделью. Если ваша рабочая нагрузка относится к этой области, в ваших логах будет отображаться модель, которую вы не запрашивали. Claude Opus 5 появился до появления такого механизма в линейке Sonnet, хотя аналогичный класс маршрутизации существует во всех продуктах Anthropic для работ по биологии и кибербезопасности на флагманских уровнях.
В OrcaRouter обе конечные точки уже работают сегодня — anthropic/claude-opus-5 и anthropic/claude-sonnet-5 находятся в том же каталоге, что и всё остальное, по цене из прайс-листа провайдера с наценкой 0 % — а Claude Sonnet 5.5 будет доступен по тем же учётным данным, как только появится в списке. А релевантная возможность тем временем — это автоматическое переключение при сбое: если один уровень Anthropic ограничен по скорости или возвращает ошибки, запрос можно перенаправить на другой без изменений в коде, что является самым дешёвым способом застраховаться от ошибки в этом сравнении.
Решение, сформулированное в виде правила
Если ваша работа ограничена по рамкам — вы контролируете форму вывода, промпты структурированы, а количество токенов на задачу предсказуемо — переходите на Claude Sonnet 5.5 и получите сокращение затрат на 60%. Индекс согласен, тарифная сетка согласна, и аргументов о возможностях в пользу другой стороны больше не осталось.
Если ваша работа открытая и агентная, проведите эксперимент, прежде чем верить любому из прайс-листов. Измеряйте токены на выполненную задачу на собственном трафике в течение недели на каждой модели; результат стороннего теста — $7,60 против $5,86 — это конкретное предупреждение о том, что более дешёвый тариф может привести к более крупному счёту. Claude Opus 5 остаётся более безопасным выбором по умолчанию для долгосрочной автономной работы, пока у вас нет этой цифры.
Честный вердикт: это первое поколение Sonnet, в котором выбор флагмана зависит от формы задачи, а не от чистой мощности, и любой, кто всё ещё принимает решение только по названию модели, теперь либо упускает 60% возможной отдачи, либо платит на 30% больше за каждую завершённую задачу — в зависимости лишь от того, в какую сторону он угадает.



Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
