
Claude Sonnet 5.5 против Claude Sonnet 5: одинаковые цены, разные счета
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 984 tok/s
- openaiНОВИНКАOpenAI: GPT-6 Luna2026-09-2237Интеллект
- openaiНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- anthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- grokНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов · 195 tok/s
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 109 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
Две модели от одного вендора, одного класса, с одним и тем же названием и — по каждой строке опубликованного тарифного листа — с одной и той же ценой. Claude Sonnet 5 вышел 30 июня 2026 года по цене $2,00 за миллион входных токенов и $10,00 за миллион выходных. Claude Sonnet 5.5 стал общедоступным 28 сентября 2026 года по цене $2,00 и $10,00, при этом чтение из кэша в обеих моделях стоит $0,20, а запись в кэш с пятиминутным сроком хранения — $2,50. В цене не изменилось ничего. Изменилось всё то, что тарифная таблица не измеряет, и в результате одну из этих двух моделей эксплуатировать существенно дешевле, чем другую, несмотря на абсолютно одинаковую стоимость за токен. Заголовок самого Anthropic о релизе говорит об этом же, хоть и не вполне прямо: снижение затрат до 30% для большинства задач при неизменном тарифном листе. Оба утверждения могут быть верны только в том случае, если новая модель выполняет ту же работу меньшим числом токенов, — именно это показывают бенчмарки и подтверждают независимые данные по затратам на задачу.
Дороже ли Claude Sonnet 5.5, чем Claude Sonnet 5?
Нет — и всё же к этому вопросу стоит отнестись серьёзно, потому что очень многие миграции пошли не так из-за того, что прайс-лист с фиксированными тарифами принимали за счёт с фиксированной суммой.
За токен две модели идентичны: $2.00 за ввод, $10.00 за вывод, $0.20 за чтение кэшированного токена и $2.50 за запись. Здесь нет ступенчатых тарифов и доплаты за длинный контекст. Какой бы ни была более новая модель, это не повышение цены, замаскированное под новое поколение.
В расчёте на выполненную задачу картина переворачивается в зависимости от того, чью нагрузку вы описываете. Artificial Analysis сообщает о стоимости $5.09 за задачу для Claude Sonnet 5 и $7.60 за задачу для Claude Sonnet 5.5 в одном и том же наборе Intelligence Index v4.3 — новая модель на 49% дороже в расчёте на завершение задачи при одинаковом показателе. В том же отчёте отмечается, что Sonnet 5.5 израсходовала 410 млн токенов по всему набору против 370 млн у Sonnet 5, при этом обе модели сравниваются с медианой в 88 млн для отслеживаемого пула. На открытых вопросах оценщика новая модель просто пишет больше, а при равных ценах больше токенов — это больший счёт.
Заявление Anthropic о 30%-ной экономии — это заявление вендора о выбранных им самим рабочих нагрузках. Стороннее измерение — $7.60 против $5.09 — проведено на другом наборе. Ни то, ни другое не ошибочно; всё дело именно в расхождении, а решающий фактор — ограничивают ли ваши задачи объём собственного вывода.
Что на самом деле изменилось между двумя поколениями
Тарифная сетка статична — модель нет. Если выстроить всё в один список, различия окажутся большими и преимущественно однонаправленными.
• Terminal-Bench 4.0 — 70,6% у Claude Sonnet 5.5 против 10,3% у Claude Sonnet 5, самый крупный скачок за одно поколение, который Anthropic публиковала в этом тесте
• CursorBench 4.0 — 55,5% против 34,1%
• Картография, без инструментов — 61,6% против 15,6%
• GDPval-AA v2.1 — 1844 против 1449
• AA-Briefcase v1.1 — 1811 против 1359
• Humanity's Last Exam, с инструментами — 64,5% против 54,9%
• OSWorld 2.1, частичное выполнение — 80,1% против 57,0%
• Artificial Analysis Intelligence Index v4.3 — 56 против 38, разрыв в восемнадцать пунктов по сторонней шкале, измеренной в той же конфигурации «Adaptive Reasoning, Max Effort»
Форма этого списка — не равномерный прогресс. Рост Chartography с 15,6% до 61,6% и Terminal-Bench с 10,3% до 70,6% выглядит как возможности, которых раньше не было, а теперь они есть, а не как возможности, которые улучшились. Рост Humanity's Last Exam на десять пунктов и OSWorld на двадцать три пункта при неизменной цене — это паттерн поколения, которое закрыло конкретные пробелы, а не поколения, которое стало в целом умнее. Восемнадцатипунктовый разрыв в индексе — это среднее арифметическое этого: реальный, большой и сосредоточенный на использовании инструментов, исполнении кода и визуальной работе.
Одна сноска важна для всех, кто внимательно изучает таблицу поставщика. Anthropic заявляет, что на FrontierCode конфигурация с уровнем усилий Max показывает результат ниже, чем Xhigh, и отмечает, что прогоны GDPval-AA и AA-Briefcase были выполнены на предрелизном развёртывании с ошибкой структурированного вывода. Приведённые выше числа по-прежнему остаются лучшими из доступных, но рассматривайте их как снимок одного развёртывания, а не как постоянное свойство модели.
Почему цена одинаковая, а счёт — нет
Три механизма — в порядке убывания их влияния на реальный счёт.
Первое — это дисциплина длины вывода. Sonnet 5.5 — более способный агент, а значит, он делает больше до того, как ответить, и на наборе тестов без ограничения длины он пишет примерно на 11% больше, чем Sonnet 5, при той же стоимости за токен. На нагрузке, которая ограничивает вывод — извлечение данных в фиксированную схему, классификация, резюме ограниченной длины, — эти 11% никогда не проявляются, и утверждение о 30% становится правдоподобным, потому что выигрыш заключается в достижении ответа за меньшее число ходов, а не в меньшем числе токенов за ход.
Второе — это поведение кэша, и именно поэтому неизменная цена чтения из кэша не означает неизменную стоимость кэша. Чтение из кэша и запись в кэш оцениваются одинаково в обеих моделях, поэтому любое изменение объёма кэшированных токенов напрямую отражается на счёте. Модель, которой требуется меньше шагов, чтобы выполнить агентную задачу, читает свой префикс меньше раз. Это экономия, за которой вообще нет изменения цены, и она невидима в любой сравнительной таблице, где перечислены только строки тарифной сетки.
Третий — тот, в котором большинство команд ошибаются в день миграции: значение усилия по умолчанию. Claude Sonnet 5.5 настраивает рассуждения через параметр effort со значениями low, medium, high, xhigh и max; по умолчанию — high на Claude Platform и medium в приложениях Claude. Если вы мигрировали с развертывания Sonnet 5, где вы закрепили бюджет рассуждений, новое значение по умолчанию может иметь другую глубину, чем та, за которую вы платили. Измерьте, прежде чем предполагать экономию или увеличение.
Есть также поведенческое последствие, о котором стоит предупредить до развёртывания, а не после. Anthropic заявляет, что Claude Sonnet 5.5 — первый Sonnet, выпускаемый с киберзащитными механизмами и фолбэками наравне с моделями верхнего уровня, поэтому запросы по кибербезопасности повышенного риска явно перенаправляются на предыдущий Sonnet. В ваших логах будет отображаться модель, которую вы не запрашивали. В связи с этим, если вы запускаете Sonnet с отключённой функцией thinking, вам необходимо перейти на поведение между инструментами — это изменение кода, а не флаг.
На OrcaRouter anthropic/claude-sonnet-5 уже сегодня доступен для маршрутизации с использованием одних учётных данных по каталожной цене провайдера с наценкой 0%, наряду с Claude Opus 5.5, Claude Opus 5, DeepSeek V4 Pro и Gemini 3.1 Pro Preview. Сам Claude Sonnet 5.5 пока не является маршрутом на нашей платформе, поэтому практическая форма этого сравнения сейчас такова: команда, уже использующая Sonnet 5, может измерить разницу в тот день, когда он появится в списке, не трогая ключ API, и тем временем может переключаться между уровнями, изменив одну строку.
Вопросы, которые люди задают перед переходом
Можно ли запустить оба одновременно и сравнить на своём трафике? Пока нет — через один учётный данные OrcaRouter это невозможно, поскольку Claude Sonnet 5.5 отсутствует в списке маршрутов. Обходной путь — запустить более новую модель через собственный API Anthropic, а более старую — через нас, и затем сравнивать количество токенов на выполненную задачу, а не стоимость за токен, потому что именно по этому показателю две модели действительно различаются.
Означает ли неизменная цена, что Anthropic не взимает плату за новую возможность? Это означает, что цена из прайс-листа удерживается на неизменном уровне, пока модель улучшается, что повторяет схему двух предыдущих поколений Sonnet. Сохранится ли это — вопрос коммерческий, а не технический, и опубликованное окно вывода из эксплуатации — не раньше сентября 2027 года — единственное обязательство, которое с этим связано.
Какому числу мне доверять: 30% от Anthropic или 49% от третьей стороны?Ни одному — как обобщённому утверждению. Цифра Anthropic описывает рабочие нагрузки, в которых модель приходит к ответу за меньшее число шагов; цифра Artificial Analysis описывает неограниченный набор индексов, где многословность может свободно расти. Выберите ту, что ближе к вашему набору промптов, а если не можете определить, какая именно, — эта неопределённость и есть ответ: измерьте.
Итог
Claude Sonnet 5.5 — это не повышение цены, но и не автоматическая экономия. Anthropic сохранил каждую строку тарифной сетки без изменений и поместил модель под неё, а значит, вся экономическая аргументация держится на количестве токенов на выполненную задачу — показателе, который на 30% лучше на рабочих нагрузках, выбранных поставщиком, и на 49% хуже на наборе тестов, выбранном независимым оценщиком. Если ваши задачи сами ограничивают объём вывода, переходите и забирайте выигрыш. Если нет, неизменная цена — не повод пропускать измерение, потому что вы можете заплатить в полтора раза больше за задачу за модель, которая однозначно лучше справляется с работой.



