Главная карточка с заголовком «Claude Haiku 5.5 vs Claude Sonnet 5.5» и подзаголовком «Шесть дней и один уровень разницы». Две скруглённые карточки расположены рядом: слева с заголовком «Claude Haiku 5.5» и строками: Индекс 43, $0.21 за задачу и Выпущена 7 окт. 2026; справа с заголовком «Claude Sonnet 5.5» и строками: Индекс 56, $7.60 за задачу и Выпущена 28 сент. 2026. Между ними по центру значок с надписью «36x измеренный разрыв в стоимости». Строка внизу гласит: «Стоимость за задачу и Intelligence Index от Artificial Analysis; у обеих моделей контекст 1M».
Guides & Insights

Claude Haiku 5.5 против Claude Sonnet 5.5: тарифная карта с коэффициентом 20×, фактический счёт — с коэффициентом 36×

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Claude Haiku 5.5 и Claude Sonnet 5.5 разделяют шесть дней и один уровень в пределах одного семейства, имеют общее контекстное окно в один миллион токенов и отвечают через одну и ту же форму API. В опубликованном прайс-листе более дешёвая из них стоит пятую часть от более дорогой в том диапазоне, в который попадает большинство запросов. В независимом рейтинге Artificial Analysis разрыв ещё шире: $0,21 на выполнение одной задачи Intelligence Index у Claude Haiku 5.5 против $7,60 у Claude Sonnet 5.5, при Intelligence Index 43 против 56. Сигнал, с которого началась эта статья, описывал это так: Claude Haiku 5.5 «намного лучше GPT-6 Luna» и «ближе к Sonnet 5.5». Первая половина этого примерно соответствует тому, что показывает собственное сравнение вендора. Вторая половина — это то место, где измерения перестают совпадать с маркетингом, и стоит быть точными в том, в чём именно.

Две модели, разделённые шестью днями и одним уровнем

Claude Haiku 5.5 вышел 7 октября 2026 года под идентификатором модели claude-haiku-5-5. Он является прямой заменой Claude Haiku 4.5, принимает на вход текст и изображения, а возвращает текст, и это первая модель класса Haiku, для которой Anthropic предусмотрела настраиваемый параметр усилия — Low, Medium, High, Xhigh и Max, причём medium — значение по умолчанию в API. Anthropic называет её «самой дешёвой, самой быстрой и самой способной малой моделью из всех, что мы когда-либо выпускали», а в сноске уточняет, что это самая высокая скорость при стандартной скорости каждой модели, и она по-прежнему уступает моделям Opus, когда те работают в Fast Mode.

Claude Sonnet 5.5 вышел на шесть дней раньше, 28 сентября 2026 года, как claude-sonnet-5-5 — уровень, который Anthropic позиционирует как лучшее сочетание скорости и интеллекта и рекомендует для сложного агентного программирования. То же окно в один миллион токенов. В отличие от Claude Haiku 5.5, у него нет ценового диапазона в зависимости от длины промпта, и это, как выясняется, значит больше, чем шестидневная фора.

Обе модели уже доступны на всех платформах, включая Amazon Web Services, Google Cloud и Microsoft Azure, и обе имеют обязательство по выводу из эксплуатации не ранее чем через год после запуска — 7 октября 2027 года для Claude Haiku 5.5, 28 сентября 2027 года для Claude Sonnet 5.5. Anthropic сообщает, что Claude Sonnet 5.5 доступна с нулевым хранением данных, как и Claude Opus 5.5 и Claude Sonnet 5.

Тарифная карта, обе стороны, в одном месте

За миллион токенов, в долларах США, по опубликованным тарифам Anthropic:

• Ввод — Claude Haiku 5.5: $0.10 за промпты до 100 000 токенов, $0.50 выше этого порога; Claude Sonnet 5.5 — $2.00 фиксированно, без ступеней.

• Вывод — Claude Haiku 5.5: $0.50 до 100 000 токенов, $2.50 свыше этого; Claude Sonnet 5.5: $10.00 фиксированно.

• Чтения из кэша — Claude Haiku 5.5: $0,01 в нижнем диапазоне и $0,05 выше него; Claude Sonnet 5.5: $0,10. Anthropic вдвое снизила стоимость чтений из кэша для Claude Sonnet 5.5 с $0,20 одновременно с запуском Haiku и заявляет, что, поскольку чтения из кэша составляют большую долю использования токенов в агентных сценариях, Claude Sonnet 5.5 теперь обходится примерно на 20% дешевле в большинстве агентных задач.

• Записи в кэш — Claude Haiku 5.5 $0.125 за пятиминутную запись и $0.20 за часовую запись в нижнем диапазоне, $0.625 и $1.00 выше него; Claude Sonnet 5.5 $2.50 за пятиминутную запись и $4.00 за час.

• Batch — Batch API даёт скидку 50% как на вход, так и на выход. Таким образом, Claude Haiku 5.5 стоит $0,05 и $0,25 ниже порога в 100 000 токенов и $0,25 и $1,25 выше него, по сравнению с Claude Sonnet 5.5 — $1,00 и $5,00.

Если прочитать по этим строкам, картина согласуется: в нижнем диапазоне вы видите 20-кратный разрыв по входным данным и 20-кратный разрыв по выходным данным; выше линии — 4x и 4x. В заголовке Anthropic говорится: «примерно на 75% меньше затрат на выполнение» в среднем по сравнению с Claude Haiku 4.5, что уточняется в сноске: на 90% дешевле ниже 100 000 токенов и на 50% дешевле выше этого порога, при этом изменение токенизатора включено в это среднее значение.

Этап в 100 000 токенов — это тот момент, когда арифметика меняется.

Две вещи тянут в противоположные стороны, и только одна из них отражена в прайс-листе. Цены резко падают по сравнению с Claude Haiku 4.5. В то же время Claude Haiku 5.5 поставляется с обновлённым токенизатором, аналогичным тем, что используются в Claude Sonnet 5.5 и Claude Opus 5.5, который, по словам Anthropic, «использует немного больше токенов на задачу», — поэтому один и тот же промпт оборачивается большим количеством оплачиваемых токенов, чем в предыдущем поколении. Средний показатель 75% — это нетто-результат обоих факторов, и это цифра вендора.

Порог в 100 000 токенов — вот что застаёт людей врасплох. Anthropic устанавливает цены на Claude Haiku 5.5 в зависимости от длины промпта: запрос, промпт которого превышает 100 000 токенов, оплачивается по более высоким ценам целиком, а не только токены сверх порога. Длина промпта учитывает все входные токены, включая чтение из кэша и запись в кэш, и каждый запрос тарифицируется отдельно — длинный запрос оплачивается по более высокой ставке, даже если часть его промпта — это попадание в кэш, а более ранние запросы сохраняют цены, по которым их тарифицировали. Конвейер извлечения, спокойно укладывающийся в 90 000 токенов, платит $0,10 и $0,50. Сдвиньте окно всего на одну ступень — и весь запрос тарифицируется заново по $0,50 и $2,50. Claude Sonnet 5.5 так не делает, потому что всё окно в миллион токенов тарифицируется по стандартным ценам.

Отсюда следуют два вывода, указывающие в противоположных направлениях. Во-первых, ожидаемого переломного момента — когда длинный контекст делает дорогую модель более дешёвой — не происходит: Claude Haiku 5.5 выше этой линии по-прежнему стоит четверть от Claude Sonnet 5.5 по тарифной сетке. Во-вторых, разрыв, на который вы рассчитывали, сужается с 20x до 4x ровно тогда, когда ваша нагрузка становится тяжёлой, а именно тогда, когда абсолютные числа начинают иметь значение. Эта ступенька — причина, по которой конвейеру, чувствительному к затратам, нужна отдельная строка бюджета, а не ставка за токен.

Какие баллы, по сообщениям каждого поставщика, он набирает

Всё в этом разделе приведено со слов производителя и не воспроизведено независимой третьей стороной. Anthropic публикует тот же набор сравнений на своих страницах Claude Haiku 5.5 и Claude Sonnet 5.5, и там, где эти две страницы пересекаются, они согласуются:

• GDPval-AA v2.1, интеллектуальная работа — 1 620 у Claude Haiku 5.5 против 1 840 у Claude Sonnet 5.5, 735 у Claude Haiku 4.5 и 1 437 у GPT-6 Luna.

• AA-Briefcase v1.1 — 1 578 у Claude Haiku 5.5 против 1 824 у Claude Sonnet 5.5, 614 у Claude Haiku 4.5 и 1 336 у GPT-6 Luna.

• OSWorld 2.1, использование компьютера, офлайн-подмножество — 72,4% у Claude Haiku 5.5 против 83,9% у Claude Sonnet 5.5, 15,7% у Claude Haiku 4.5 и 48,9% у GPT-6 Luna.

• Terminal-Bench 4.0, агентное программирование — 39,2% у Claude Haiku 5.5 против 70,6% у Claude Sonnet 5.5, 0,0% у Claude Haiku 4.5 и 16,4% у GPT-6 Luna.

• FrontierCode 1.1, Main — 46,4% у Claude Haiku 5.5 против 52,1% у Claude Sonnet 5.5 при Xhigh effort, 42,4% у GPT-6 Luna. Anthropic также отмечает, что в этом тесте Claude Sonnet 5.5 показывает более низкий результат при Max effort, чем при Xhigh, и связывает это с более частым использованием навыка code-review, вызывающим тайм-ауты или правки вне области задачи.

• Chartography, визуальное рассуждение без инструментов — 46,4% у Claude Haiku 5.5 против 61,6% у Claude Sonnet 5.5, 6,4% у Claude Haiku 4.5 и 29,1% у GPT-6 Luna.

• Humanity's Last Exam — 45,9% без инструментов и 57,4% с ними у Claude Haiku 5.5; 64,5% с инструментами у Claude Sonnet 5.5, 18,7% у Claude Haiku 4.5 и 56,9% без инструментов у Claude Sonnet 5.5 на той же странице. Anthropic отмечает, что показатели семейства GPT-6 могут быть устаревшими, поскольку OpenAI исправила ошибку понимания изображений, а не все сторонние оценки были обновлены.

Две из этих строк стоит прочитать дважды. На FrontierCode две модели вообще близки — 46,4% против 52,1% — а на Chartography, где нет инструментов, за которыми можно спрятаться, разрыв составляет 15 пунктов. Terminal-Bench 4.0 — совсем не близко: 39,2% против 70,6% — это другой класс возможностей, поэтому на странице Claude Sonnet 5.5 от Anthropic по-прежнему указывают Claude Sonnet 5.5 и Claude Opus 5.5 для сложного агентного программирования, а Claude Haiku 5.5 позиционируют как модель для узких, высоконагруженных задач.

Что добавляет независимый совет директоров

Показатели Anthropic сравнивают её собственные модели друг с другом и с одним конкурентом. Независимый совет сопоставляет и то и другое со всеми остальными участниками, а показатель, который он приводит, но не приводят вендоры, — это стоимость в расчёте на завершённую задачу.

Artificial Analysis присваивает Claude Haiku 5.5 в режиме Max effort 43 балла по Intelligence Index — значительно выше медианы 13 среди сопоставимых моделей, — генерируя 440 млн выходных токенов по этому индексу против медианы в 100 млн (очень многословно) при цене $0.10 за входные и $0.50 за выходные токены за миллион и скорости 242 выходных токена в секунду. Его измеренная стоимость составляет $0.21 за задачу Intelligence Index.

Та же таблица присваивает Claude Sonnet 5.5 56 баллов против медианы 26, генерируя 410 млн выходных токенов против медианы 88 млн, при $2.00 за входные и $10.00 за выходные данные со скидкой 90% на кэш. Его измеренная стоимость — $7.60 за задачу Intelligence Index.

A headless capture of the Artificial Analysis model page for Claude Haiku 5.5 at Max effort, showing the header 'Claude Haiku 5.5 (Max)' with the Anthropic vendor label and release month October 2026, a rank strip reading Intelligence #2/182, Speed #8/182, Cost #46/182 and Verbosity #62/182, the price strip In $0.10, Out $0.50 and $0.21 per task, a Comparison Summary stating an Artificial Analysis Intelligence Index of 43 against a median of 13 with 440M output tokens generated, and an output-token speed of 242 tokens per second described as notably fast. A specification panel confirms a 1M-token context window, reasoning enabled, text and image input and text output.A headless capture of the Artificial Analysis model page for Claude Sonnet 5.5 (Adaptive Reasoning, Max Effort, Default Fallback), showing the Anthropic vendor label and release month September 2026, a rank strip reading Intelligence #3/216, Cost #98/216 and Verbosity #102/216, the price strip In $2.00, Out $10.00, a 90% cache discount and $7.60 per task, a Comparison Summary stating an Intelligence Index of 56 against a median of 26 with 410M output tokens generated against a median of 88M, and a specification panel showing a 1M-token context window and text and image input.

Поставьте эти две строки рядом — и вся суть в соотношении. $0.21 против $7.60 — это чуть больше 36x, и обе модели почти одинаковы по многословности — 440M выходных токенов против 410M, — так что этот множитель почти целиком объясняется тарифной сеткой, которая делает ровно то, что и должна. В собственной тарифной сетке поставщика то же сравнение даёт 20x. Дополнительная разница возникает из-за того, чего цена за токен показать не может: более дешёвая модель приходит к ответу за меньшее количество оплачиваемых токенов на задачу при этом уровне усилий, а чтения из кэша тарифицируются по одной десятой ставки Claude Sonnet 5.5. Тот же харнесс, те же задачи, независимые измерения.

A generated two-column comparison scoreboard titled 'Claude Haiku 5.5 vs Claude Sonnet 5.5 - the scoreboard'. The left column, headed Claude Haiku 5.5, reads AA Intelligence Index: 43; Cost per Index task: $0.21; Input / output per 1M: $0.10 / $0.50; Output speed: 242 tok/s; Context window: 1M; Terminal-Bench 4.0: 39.2%. The right column, headed Claude Sonnet 5.5, reads AA Intelligence Index: 56; Cost per Index task: $7.60; Input / output per 1M: $2.00 / $10.00; Output speed: not published; Context window: 1M; Terminal-Bench 4.0: 70.6%. A footer line reads 'Index, cost per task and speed per Artificial Analysis; Terminal-Bench vendor-reported.'

Где на самом деле заканчивается дешёвый тариф

Показатели клиентов, которые публикует Anthropic, чаще, чем бенчмарки, определяют, что выбрать, и все они указывают в одну сторону. Asana сообщает, что задержка при завершении задач снизилась более чем на 30 %, а инференс на каждый ход агента ускорился до 2,5 раза. Box сообщает о результате на 11 пунктов выше, чем у Claude Haiku 4.5, при примерно вдвое меньшей задержке. HubSpot сообщает о лучшем результате, который компания видела на собственном наборе тестов, — 92,8 % в среднем за три прогона, с самой высокой частотой попаданий и самой низкой частотой ложноположительных срабатываний. AlphaSense выполняет около 8 млн вызовов в неделю через «Ask in Document» и сообщает о статистически значимом улучшении по сравнению с Claude Haiku 4.5: 0,84 против 0,76. Cognition сообщает, что с Claude Haiku 5.5 в роли напарника её агент Fusion сохраняет показатель FrontierCode на уровне 66,2.

Ни один из них не является агентом с длинным горизонтом. Это точечные решения — один чётко определённый шаг, который становится быстрее и дешевле. Именно под такую форму создан Claude Haiku 5.5, и именно в такой форме 36-кратное преимущество в стоимости — это реальные деньги, а не погрешность округления. Преимущество растёт с объёмом вызовов и исчезает с глубиной вызовов: сто тысяч вызовов классификации в день при $0.10 на входе и $0.50 на выходе — это статья расходов, исчезновение которой вы заметите, тогда как сто ходов агента за сессию, каждый из которых перечитывает накопленный контекст, — это статья расходов, которая растёт сверхлинейно, потому что каждый ход после порога оплачивается по более высокому тарифу.

Claude Sonnet 5.5 — стоимость за попытку, а не за токен. Anthropic утверждает, что он работает более чем на 30% быстрее Claude Sonnet 5 и обходится до 30% дешевле для большинства задач, причём экономия достигается за счёт меньшего количества токенов, а не за счёт тарифов. Независимые тесты подтверждают это цифрами: Slack сообщает о примерно 14% меньшем количестве выходных токенов, Balusny — около 121 тыс. токенов на ответ вместо 497 тыс., Box — в 2,4 раза быстрее при 12% меньшем количестве токенов, Lovable — на треть меньше вызовов инструментов и примерно вдвое меньше затрат, Atlassian — до 30% быстрее Rovo Agents, а Base44 — 3,6 итерации на сборку против 7,7 у Claude Opus 5: тот, что попадает, бьёт четыре, которые делают.

Есть и третий фактор, действующий в противоположном направлении. В этом поколении Anthropic перевела усилия на регулятор уровня модели: параметр effort у Claude Haiku 5.5 задаётся один раз на запрос, а не подбирается как бюджет размышлений для каждого запроса, а старый режим budget_tokens объявлен устаревшим на моделях 4.6 и не принимается на более поздних. Для парка сервисов, вызывающих один ID модели из множества сервисов, это упрощение. Для всего, что само определяло объём своих рассуждений на каждый вызов, это переписывание.

Запуск обоих за одним эндпоинтом

Причина, по которой это решение стоит принять правильно, заключается в том, что исправление его ошибочной половины обходится дорого: переключение производственного пути с одного ID модели на другой означает необходимость затронуть каждое место вызова, которое рассчитывало на поведение старого. Более дешёвый способ выяснить, к какому уровню относится рабочая нагрузка, — запустить оба за одной конечной точкой и переключать трафик между ними с помощью конфигурации, а не рефакторинга.

Вот для чего нужен OrcaRouter. Claude Sonnet 5.5 присутствует в каталоге как anthropic/claude-sonnet-5.5, наряду с Claude Sonnet 5, Claude Opus 5.5 и Claude Haiku 4.5 — более старый уровень Haiku остаётся доступным как точка отсчёта, пока вы с него мигрируете. Платформа передаёт цену из прайс-листа провайдера без наценки, так что указанные выше $2.00 и $10.00 — это те тарифы, которые вы платите, и верно также обратное: когда вендор меняет цену, новая цена появляется здесь в тот же день — именно так до нас дошло снижение цены за чтение кэша Claude Sonnet 5.5. Для этого конкретного решения нужны две функции. Автоматическое переключение при сбое само по себе удерживает модель, которую вы всё ещё оцениваете, вне вашего критического пути, а DSL маршрутизации позволяет отправлять вызовы объёмом менее 100 000 токенов на дешёвый уровень, а вызовы с длинным контекстом или длинным горизонтом передавать более дорогому в том же потоке запросов, без второго контракта или второго SDK.

Чтобы быть точными насчёт того, что у нас хостится, а что нет: Claude Sonnet 5.5 уже сегодня маршрутизируется через нас. Claude Haiku 5.5 пока отсутствует в каталоге. До тех пор он живёт на собственном API Anthropic и трёх облачных платформах, перечисленных выше.

Как решить

Выбирайте Claude Haiku 5.5, когда задача узкая, массовая и проверяемая — классификация, извлечение, маршрутизация, суммаризация, работа на каждом шаге внутри агента, которого вы уже построили. Именно в 20-кратной разнице в цене здесь весь смысл, шага в 100 000 токенов можно избежать по архитектуре, а независимо измеренные $0,21 за задачу говорят, что выигрыш сохраняется и за пределами лаборатории самого вендора. Настраивайте уровень усилий отдельно для каждого класса задач, а не оставляйте его по умолчанию; на модели класса Haiku разница между Low и Max — это множитель стоимости, а не предпочтение по качеству.

Выбирайте Claude Sonnet 5.5, когда задача долгосрочная, агентная или непроверяемая — код, который должен компилироваться, компьютерное использование, которое должно оставлять экран в известном состоянии, всё, где неправильный ответ стоит дороже, чем вызов. Terminal-Bench 4.0 с 70,6% против 39,2% — это не нюанс, это другой класс возможностей, а фиксированная тарифная сетка означает, что длинный контекст не переоценивает весь запрос незаметно. Если ваша рабочая нагрузка действительно находится где-то посередине, честный ответ таков: ни у одной из моделей пока нет широкого корпуса сторонних воспроизведений, оценки индекса получены на одном стенде, а приведённые выше показатели вендора — это собственные данные вендора.

Что изменило бы этот ответ?

Есть три вещи, за которыми стоит следить, и ни одна из них не является выпуском бенчмарков. Первая — покажут ли независимые оценки Claude Haiku 5.5 при усилиях Low, High и Xhigh — не только Max — такое же соотношение стоимости на задачу, потому что регулятор усилий — это самый дешёвый рычаг в сравнении и наименее измеряемый. Вторая — сохранится ли шаг в 100 000 токенов; третий диапазон или его отсутствие в следующем поколении изменит арифметику для каждого конвейера извлечения на линии сильнее, чем любая отдельная оценка бенчмарка. Третье — токенизатор. Если более поздний чекпоинт токенизирует тот же текст с прежней скоростью, средний показатель Anthropic в 75% становится нижней границей, а не целью, и разрыв с Claude Sonnet 5.5 увеличивается, хотя ни одна из цен не меняется.

Сравнение в этой статье2

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно

© 2026 OrcaRouter

Провайдерам

Управляете инференс-платформой? Разместите свои модели на OrcaRouter.

providers@orcarouter.ai

Присоединяйтесь к сообществу

Discordsupport@orcarouter.aiXGitHubYouTube