Сгенерирована титульная карточка hero для Claude Sonnet 5.5 против Claude Sonnet 5 с подзаголовком «Идентичные цены, разные счета», показывающая $2.00 и $10.00 за миллион токенов с обеих сторон с расходящимся значением стоимости за задачу под ними, и логотип OrcaRouter, скомпонованный в правом нижнем углу.
Guides & Insights

Claude Sonnet 5.5 против Claude Sonnet 5: одинаковые цены, разные счета

Автор

Elias Hawthorne

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Две модели от одного вендора, одного класса, с одним и тем же названием и — по каждой строке опубликованного тарифного листа — с одной и той же ценой. Claude Sonnet 5 вышел 30 июня 2026 года по цене $2,00 за миллион входных токенов и $10,00 за миллион выходных. Claude Sonnet 5.5 стал общедоступным 28 сентября 2026 года по цене $2,00 и $10,00, при этом чтение из кэша в обеих моделях стоит $0,20, а запись в кэш с пятиминутным сроком хранения — $2,50. В цене не изменилось ничего. Изменилось всё то, что тарифная таблица не измеряет, и в результате одну из этих двух моделей эксплуатировать существенно дешевле, чем другую, несмотря на абсолютно одинаковую стоимость за токен. Заголовок самого Anthro​pic о релизе говорит об этом же, хоть и не вполне прямо: снижение затрат до 30% для большинства задач при неизменном тарифном листе. Оба утверждения могут быть верны только в том случае, если новая модель выполняет ту же работу меньшим числом токенов, — именно это показывают бенчмарки и подтверждают независимые данные по затратам на задачу.

Дороже ли Claude Sonnet 5.5, чем Claude Sonnet 5?

Нет — и всё же к этому вопросу стоит отнестись серьёзно, потому что очень многие миграции пошли не так из-за того, что прайс-лист с фиксированными тарифами принимали за счёт с фиксированной суммой.

За токен две модели идентичны: $2.00 за ввод, $10.00 за вывод, $0.20 за чтение кэшированного токена и $2.50 за запись. Здесь нет ступенчатых тарифов и доплаты за длинный контекст. Какой бы ни была более новая модель, это не повышение цены, замаскированное под новое поколение.

В расчёте на выполненную задачу картина переворачивается в зависимости от того, чью нагрузку вы описываете. Artificial Analysis сообщает о стоимости $5.09 за задачу для Claude Sonnet 5 и $7.60 за задачу для Claude Sonnet 5.5 в одном и том же наборе Intelligence Index v4.3 — новая модель на 49% дороже в расчёте на завершение задачи при одинаковом показателе. В том же отчёте отмечается, что Sonnet 5.5 израсходовала 410 млн токенов по всему набору против 370 млн у Sonnet 5, при этом обе модели сравниваются с медианой в 88 млн для отслеживаемого пула. На открытых вопросах оценщика новая модель просто пишет больше, а при равных ценах больше токенов — это больший счёт.

Заявление Anthropic о 30%-ной экономии — это заявление вендора о выбранных им самим рабочих нагрузках. Стороннее измерение — $7.60 против $5.09 — проведено на другом наборе. Ни то, ни другое не ошибочно; всё дело именно в расхождении, а решающий фактор — ограничивают ли ваши задачи объём собственного вывода.

Что на самом деле изменилось между двумя поколениями

Тарифная сетка статична — модель нет. Если выстроить всё в один список, различия окажутся большими и преимущественно однонаправленными.

• Terminal-Bench 4.0 — 70,6% у Claude Sonnet 5.5 против 10,3% у Claude Sonnet 5, самый крупный скачок за одно поколение, который Anthropic публиковала в этом тесте

• CursorBench 4.0 — 55,5% против 34,1%

• Картография, без инструментов — 61,6% против 15,6%

• GDPval-AA v2.1 — 1844 против 1449

• AA-Briefcase v1.1 — 1811 против 1359

• Humanity's Last Exam, с инструментами — 64,5% против 54,9%

• OSWorld 2.1, частичное выполнение — 80,1% против 57,0%

• Artificial Analysis Intelligence Index v4.3 — 56 против 38, разрыв в восемнадцать пунктов по сторонней шкале, измеренной в той же конфигурации «Adaptive Reasoning, Max Effort»

Форма этого списка — не равномерный прогресс. Рост Chartography с 15,6% до 61,6% и Terminal-Bench с 10,3% до 70,6% выглядит как возможности, которых раньше не было, а теперь они есть, а не как возможности, которые улучшились. Рост Humanity's Last Exam на десять пунктов и OSWorld на двадцать три пункта при неизменной цене — это паттерн поколения, которое закрыло конкретные пробелы, а не поколения, которое стало в целом умнее. Восемнадцатипунктовый разрыв в индексе — это среднее арифметическое этого: реальный, большой и сосредоточенный на использовании инструментов, исполнении кода и визуальной работе.

Одна сноска важна для всех, кто внимательно изучает таблицу поставщика. Anthropic заявляет, что на FrontierCode конфигурация с уровнем усилий Max показывает результат ниже, чем Xhigh, и отмечает, что прогоны GDPval-AA и AA-Briefcase были выполнены на предрелизном развёртывании с ошибкой структурированного вывода. Приведённые выше числа по-прежнему остаются лучшими из доступных, но рассматривайте их как снимок одного развёртывания, а не как постоянное свойство модели.

Почему цена одинаковая, а счёт — нет

Три механизма — в порядке убывания их влияния на реальный счёт.

Первое — это дисциплина длины вывода. Sonnet 5.5 — более способный агент, а значит, он делает больше до того, как ответить, и на наборе тестов без ограничения длины он пишет примерно на 11% больше, чем Sonnet 5, при той же стоимости за токен. На нагрузке, которая ограничивает вывод — извлечение данных в фиксированную схему, классификация, резюме ограниченной длины, — эти 11% никогда не проявляются, и утверждение о 30% становится правдоподобным, потому что выигрыш заключается в достижении ответа за меньшее число ходов, а не в меньшем числе токенов за ход.

Второе — это поведение кэша, и именно поэтому неизменная цена чтения из кэша не означает неизменную стоимость кэша. Чтение из кэша и запись в кэш оцениваются одинаково в обеих моделях, поэтому любое изменение объёма кэшированных токенов напрямую отражается на счёте. Модель, которой требуется меньше шагов, чтобы выполнить агентную задачу, читает свой префикс меньше раз. Это экономия, за которой вообще нет изменения цены, и она невидима в любой сравнительной таблице, где перечислены только строки тарифной сетки.

Третий — тот, в котором большинство команд ошибаются в день миграции: значение усилия по умолчанию. Claude Sonnet 5.5 настраивает рассуждения через параметр effort со значениями low, medium, high, xhigh и max; по умолчанию — high на Claude Platform и medium в приложениях Claude. Если вы мигрировали с развертывания Sonnet 5, где вы закрепили бюджет рассуждений, новое значение по умолчанию может иметь другую глубину, чем та, за которую вы платили. Измерьте, прежде чем предполагать экономию или увеличение.

Есть также поведенческое последствие, о котором стоит предупредить до развёртывания, а не после. Anthropic заявляет, что Claude Sonnet 5.5 — первый Sonnet, выпускаемый с киберзащитными механизмами и фолбэками наравне с моделями верхнего уровня, поэтому запросы по кибербезопасности повышенного риска явно перенаправляются на предыдущий Sonnet. В ваших логах будет отображаться модель, которую вы не запрашивали. В связи с этим, если вы запускаете Sonnet с отключённой функцией thinking, вам необходимо перейти на поведение между инструментами — это изменение кода, а не флаг.

На OrcaRouter anthropic/claude-sonnet-5 уже сегодня доступен для маршрутизации с использованием одних учётных данных по каталожной цене провайдера с наценкой 0%, наряду с Claude Opus 5.5, Claude Opus 5, DeepSeek V4 Pro и Gemini 3.1 Pro Preview. Сам Claude Sonnet 5.5 пока не является маршрутом на нашей платформе, поэтому практическая форма этого сравнения сейчас такова: команда, уже использующая Sonnet 5, может измерить разницу в тот день, когда он появится в списке, не трогая ключ API, и тем временем может переключаться между уровнями, изменив одну строку.

Вопросы, которые люди задают перед переходом

Можно ли запустить оба одновременно и сравнить на своём трафике? Пока нет — через один учётный данные OrcaRouter это невозможно, поскольку Claude Sonnet 5.5 отсутствует в списке маршрутов. Обходной путь — запустить более новую модель через собственный API Anthropic, а более старую — через нас, и затем сравнивать количество токенов на выполненную задачу, а не стоимость за токен, потому что именно по этому показателю две модели действительно различаются.

Означает ли неизменная цена, что Anthropic не взимает плату за новую возможность? Это означает, что цена из прайс-листа удерживается на неизменном уровне, пока модель улучшается, что повторяет схему двух предыдущих поколений Sonnet. Сохранится ли это — вопрос коммерческий, а не технический, и опубликованное окно вывода из эксплуатации — не раньше сентября 2027 года — единственное обязательство, которое с этим связано.

Какому числу мне доверять: 30% от Anthropic или 49% от третьей стороны?Ни одному — как обобщённому утверждению. Цифра Anthropic описывает рабочие нагрузки, в которых модель приходит к ответу за меньшее число шагов; цифра Artificial Analysis описывает неограниченный набор индексов, где многословность может свободно расти. Выберите ту, что ближе к вашему набору промптов, а если не можете определить, какая именно, — эта неопределённость и есть ответ: измерьте.

Итог

Claude Sonnet 5.5 — это не повышение цены, но и не автоматическая экономия. Anthropic сохранил каждую строку тарифной сетки без изменений и поместил модель под неё, а значит, вся экономическая аргументация держится на количестве токенов на выполненную задачу — показателе, который на 30% лучше на рабочих нагрузках, выбранных поставщиком, и на 49% хуже на наборе тестов, выбранном независимым оценщиком. Если ваши задачи сами ограничивают объём вывода, переходите и забирайте выигрыш. Если нет, неизменная цена — не повод пропускать измерение, потому что вы можете заплатить в полтора раза больше за задачу за модель, которая однозначно лучше справляется с работой.

A two-column scoreboard for Claude Sonnet 5.5 and Claude Sonnet 5 across eight rows. Both columns carry the identical rate card: input $2.00, output $10.00, cache read $0.20, cache write $2.50, 1M context with 128K max output. The rows that differ are AA Intelligence Index v4.3 score 56 for Claude Sonnet 5.5 against 38 for Claude Sonnet 5, $7.60 per task on the index run against $5.09, and Terminal-Bench 4.0 (vendor) 70.6% against 10.3%. The card heading reads "Identical rate cards, different bills: Claude Sonnet 5.5 against Claude Sonnet 5", and a footer line reads "Prices per the OrcaRouter catalogue; index and per-task figures per Artificial Analysis, Intelligence Index v4.3. Every price line is a tie by design: the two models share one rate card and differ only in what they emit to finish the same task."Screenshot of the OrcaRouter model page for Anthropic Claude Sonnet 5 (anthropic/claude-sonnet-5), showing the model header, a 1M-token context window with 128K maximum output, text, image and file input, the Vision, Tools, JSON and Reasoning capability tags, a 5.24-second p50 time to first token, a "Public benchmarks by Anthropic · 2026-06-30" line, and the $2.00 input and $10.00 output prices per million tokens.Screenshot of Anthropic's newsroom page for Claude Sonnet 5.5, showing the site navigation bar, the publication date September 28, 2026, the model heading "Claude Sonnet 5.5", and an image-led marketing hero beneath it that carries no machine-readable specification figures.