Сгенерированная hero-карточка для «Десятая часть тарифа — не десятая часть счёта», с бейджем «GENERATION GAP», надзаголовком «ДВЕ МОДЕЛИ HAIKU, ОДИННАДЦАТЬ МЕСЯЦЕВ РАЗНИЦЫ» и подзаголовком «Claude Haiku 5.5 против Claude Haiku 4.5 по цене, токенам и новому шагу в 100 000 токенов». Четыре чипа гласят: «$0.10 / $0.50», «$1.00 / $5.00», «1M контекст» и «на 30% больше токенов». Две карточки ниже подписаны: «ЧТО ГОВОРИТ ТАРИФ» («на 90% ниже стоимость ввода и вывода при объёме до 100 000 токенов») и «ЧТО ГОВОРИТ СЧЁТ» («примерно на 75% меньше затрат на работу при примерно на 30% большем объёме токенов»). В подвале написано: «Документация по ценам поставщика, прочитана 8 октября 2026 года». Логотип OrcaRouter скомпонован в правом нижнем углу.
Guides & Insights

Claude Haiku 5.5 vs Claude Haiku 4.5: снижение цены на 90% — это не экономия 90%

Автор

Gideon Frost

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Claude Haiku 5.5 стоит $0,10 за миллион входных токенов и $0,50 за миллион выходных токенов для промптов объёмом до 100 000 токенов. Claude Haiku 4.5 стоит $1 и $5 — фиксированно — за всё окно в 200 000 токенов, которое у него всегда было. Ant​hropic оценивает разницу как «на 90% ниже» в одной сноске и «примерно на 75% дешевле в эксплуатации» в предложении над ней — а одиннадцатимесячный разрыв между двумя моделями — это ровно расстояние между этими двумя числами.

Это не маркетинговая уловка. Это честный облик поколения моделей, которое сменило свой токенизатор, свой режим размышления по умолчанию и своё контекстное окно одновременно с ценой, и это значит, что любой, кто меняет идентификатор модели и ожидает, что счёт упадёт в десять раз, будет разочарован арифметикой, а не продуктом.

Обе модели, в комплектации производителя

Все данные ниже приведены за миллион токенов в долларах США и взяты из собственной документации Ant​hropic по ценам и моделям от 2026-10-08, если не указано иное.

A generated scoreboard titled 'Claude Haiku 5.5 vs Claude Haiku 4.5 - as shipped'. Claude Haiku 5.5 reads input $0.10 under 100K and $0.50 above, output $0.50 and $2.50, cache read $0.01 and $0.05, context 1M tokens, maximum output 128,000 tokens, thinking adaptive with an effort dial. Claude Haiku 4.5 reads input $1.00 flat, output $5.00 flat, cache read $0.10, context 200,000 tokens, maximum output 64,000 tokens, thinking manual with no effort dial. A footer reads 'Vendors' published list rates and model documentation.'

• Ввод — Claude Haiku 5.5: $0,10 до 100 000 токенов, $0,50 свыше; Claude Haiku 4.5: $1,00 независимо от длины.

Вывод — Claude Haiku 5.5: $0.50 до 100 000 токенов, $2.50 свыше; Claude Haiku 4.5: $5.00 независимо от длины.

• Чтение кэша — Claude Haiku 5.5: $0.01 до 100 000 токенов и $0.05 свыше; Claude Haiku 4.5: $0.10. Запись в кэш — $0.125 и $0.625 против $1.25.

• Контекст — 1 млн токенов против 200 000. Максимальный вывод — 128 000 токенов против 64 000.

• Размышление — Claude Haiku 5.5 адаптивно и включено по умолчанию, с регулятором усилий, который по умолчанию установлен на средний уровень; Claude Haiku 4.5 использует более старую ручную форму и вообще не имеет параметра усилий.

• Независимая оценка — Artificial Analysis Intelligence Index v4.3.2 ставит Claude Haiku 5.5 (Max) на 43,40 балла, что соответствует второму месту среди 182 моделей, а Claude 4.5 Haiku — на 16,88, тридцатое место из 61, — при этом составитель оценки помечает результат версии 4.5 как расчётный.

• Скорость — по данным того же источника, Claude Haiku 5.5 выдаёт 242 выходных токена в секунду против 89,7 у поколения 4.5, и это единственное место, где старая модель всё ещё выглядит уверенно.

Где рушится история о десятой части цены

Три вещи сокращают долю, и только первая из них — собственное предупреждение Anthropic.

Токенизатор — вот главное. Claude Haiku 5.5 использует более новый токенизатор, появившийся в Claude 4.7, и документация Anthropic утверждает, что тот же текст «насчитывает примерно на 30% больше токенов, чем в Claude Haiku 4.5». Вы платите десятую часть ставки не за то же количество токенов; вы платите десятую часть ставки за количество токенов, примерно в 1,3 раза большее. Собственное руководство поставщика по миграции ставит этот пункт вторым в своём контрольном списке, прежде любых изменений кода: пересчитайте свои промпты, затем пересмотрите max_tokens и ваши оценки стоимости.

Токены рассуждений тарифицируются как выходные, а Claude Haiku 5.5 рассуждает по умолчанию. На странице запуска Ant​hropic прямо указано, что модель сама по себе «очень многословна» на графиках, и независимые измерения подтверждают это резче, чем сам вендор: при оценке Intelligence Index Artificial Analysis зафиксировала 440 млн выходных токенов от Claude Haiku 5.5 против медианы в 100 млн по всем моделям и отметила модель как очень многословную. Дешёвая цена за входные токены не помогает рабочей нагрузке, счёт за которую в основном формируют выходные токены.

Ступень в 100 000 токенов — третья. Выше неё тарифы — $0,50 и $2,50, вдвое меньше того, что Claude Haiku 4.5 брал за тот же запрос; это выгодное предложение, но не то предложение, о котором большинство читателей читали. Ant​hropic утверждает, что запросы ниже порога составили около 90% обращений к предыдущей модели Haiku, и именно это число делает такой порог приемлемым для заголовка; к тому же это собственная структура трафика вендора, а не ваша.

A screenshot of Anthropic's model documentation showing the Claude Haiku 5.5 row in the models table and the published rate card beneath it, with the input, output, cache read and cache write rates and the prompt-length thresholds set out per million tokens.

Во сколько обходится одна и та же работа двум моделям

Стоимость за завершённую задачу — это метрика, которая сохраняется при всех трёх вышеперечисленных эффектах, потому что она начисляет модели за всё, что она выдала, а не только за то, что вы ей отправили.

Artificial Analysis оценивает Claude Haiku 5.5 (Max) в $0,21 за задачу Intelligence Index — это показатель, который она публикует вместе с тарифом $0,10 за входные данные и $0,50 за выходные. Для поколения 4.5 она вообще не публикует показатель стоимости за задачу; в плитке отображается «неизвестно», потому что модель никогда не запускалась в Индексе в режиме рассуждений. А что страница действительно публикует, так это исходный ценник в $1,00 и $5,00 и другую, более низкую измеренную оценку.

Так что честное сравнение для покупателя — это не 10-кратная разница по токенам, а скорее вот что: одна десятая входной ставки при на 30% большем количестве токенов, половина выходной ставки после преодоления отметки 100K и модель, которая тратит больше выходных токенов на ответ, чем её предшественница, — на фоне скачка возможностей с 16,88 до 43,40 в том же независимом лидерборде. Цифра 75%, которую Anthropic приводит для средних рабочих нагрузок, — это разумный ориентир для планирования. Это также усреднённая оценка вендора по структуре трафика, которую вы не контролируете.

Миграция — это не замена model-id

Руководство Ant​hropic по миграции для тех, кто уходит с Claude Haiku 4.5, включает десять пунктов, и несколько из них — серьёзные сбои, а не рекомендации.

• Ручное мышление перестаёт работать — thinking: {"type": "enabled", "budget_tokens": N} возвращает ошибку. Адаптивное мышление заменяет его, и thinking.display нужно установить в "summarized", если вы вообще хотите видеть рассуждения.

• Параметры сэмплирования нарушаются — temperature, top_p и top_k все должны быть исключены из запроса.

• Предзаполнение ассистента ломается — диалог, заканчивающийся репликой ассистента, возвращает ошибку; завершайте его на реплике пользователя.

• Порядок блоков меняется — ответ может начинаться с блоков размышлений, поэтому код, который читает первый блок содержимого как ответ, должен выбирать по типу вместо этого.

• Отказы — это новое: модель запускает классификаторы безопасности и может вернуть stop_reason: "refusal", и на стороне сервера нет резервного варианта.

• Воспроизведение ограничено — блоки размышлений работают только в том аккаунте, который их создал, или в аккаунте, связанном с ним.

• Priority Tier не переносится — организациям, имеющим обязательство по Priority Tier на Claude Haiku 4.5, придётся планировать ресурсы отдельно, поскольку этот уровень не поддерживается в Claude Haiku 5.5.

Две из них заслуживают большего внимания, чем остальные. Причина остановки refusal — это изменение потока управления в любом цикле, который предполагал, что каждый ответ имеет содержимое, а привязанные к аккаунту блоки размышлений ломают любую очередь, которая хранит диалоги и воспроизводит их через пул учётных данных. Ни то, ни другое не проявляется до продакшена.

Запуск обоих уровней под одним ключом

Практический вопрос для большинства команд заключается не в том, какая из этих двух моделей лучше, потому что ответ полностью зависит от того, какой именно вызов вы делаете. Он в том, можно ли дешёвое звено каскада улучшить независимо от всего, что его окружает.

Claude Haiku 4.5 уже сегодня доступен в каталоге OrcaRouter по каталожной цене Anthropic с наценкой 0%, поэтому тариф провайдера передаётся напрямую, и любые изменения, которые Anthropic в него вносит, появляются у нас в тот же день. Claude Sonnet 5.5 и Claude Opus 5.5 там тоже есть — а значит, двухуровневый конвейер (небольшая модель для рутинного большинства, более крупная — для эскалации) можно построить уже сейчас, имея один ключ, один SDK и автоматическое переключение при сбое под капотом, а малое звено позже заменить на Claude Haiku 5.5 просто сменой model-id, а не переписыванием.

Claude Haiku 5.5 пока нет в каталоге, и об этом стоит сказать прямо, а не оставлять это подразумеваемым. Разрыв в день запуска между выпуском модели и возможностью маршрутизировать её — это нормально, и это не обещание относительно того, когда он закроется; модели, доступные для вызова у нас сегодня утром, — это те, что названы выше.

A screenshot of the OrcaRouter catalogue page for Claude Haiku 4.5, showing the model identifier, the provider Anthropic, the model description and a stat strip carrying the $1.00 per million input and $5.00 per million output rates alongside the context window and maximum output.

Кому стоит переключиться и какой звонок переключить первым

Если ваш трафик Haiku 4.5 — это классификация, извлечение, маршрутизация, уплотнение или суммирование с промптами менее 100 000 токенов, переходите — ставка в десять раз ниже, окно в пять раз шире, а регулятор усилий даёт рычаг управления стоимостью, которого у старой модели никогда не было. Закладывайте бюджет примерно на 75% ниже и сверьтесь с собственными подсчётами токенов через неделю.

Если ваши промпты регулярно превышают 100 000 токенов, вы получаете скидку 50%, а не 90%, а второй уровень меняет сравнение так, что стоит изучить предложения конкурентов: ставка за вывод свыше 100K в размере $2.50 выше того, что несколько конкурирующих небольших моделей берут за всё контекстное окно.

И если вы используете Haiku 4.5, потому что это был единственный дешёвый вариант, вмещавший документ на 200 000 токенов, обратите внимание, что изменилось. Окно теперь составляет миллион токенов — это уже другой продукт, и причина держаться за старую модель тихо исчезла вместе с причиной, по которой она была дешёвой.