
Claude Haiku 5.5 vs Claude Haiku 4.5: снижение цены на 90% — это не экономия 90%
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 67 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
Claude Haiku 5.5 стоит $0,10 за миллион входных токенов и $0,50 за миллион выходных токенов для промптов объёмом до 100 000 токенов. Claude Haiku 4.5 стоит $1 и $5 — фиксированно — за всё окно в 200 000 токенов, которое у него всегда было. Anthropic оценивает разницу как «на 90% ниже» в одной сноске и «примерно на 75% дешевле в эксплуатации» в предложении над ней — а одиннадцатимесячный разрыв между двумя моделями — это ровно расстояние между этими двумя числами.
Это не маркетинговая уловка. Это честный облик поколения моделей, которое сменило свой токенизатор, свой режим размышления по умолчанию и своё контекстное окно одновременно с ценой, и это значит, что любой, кто меняет идентификатор модели и ожидает, что счёт упадёт в десять раз, будет разочарован арифметикой, а не продуктом.
Обе модели, в комплектации производителя
Все данные ниже приведены за миллион токенов в долларах США и взяты из собственной документации Anthropic по ценам и моделям от 2026-10-08, если не указано иное.

• Ввод — Claude Haiku 5.5: $0,10 до 100 000 токенов, $0,50 свыше; Claude Haiku 4.5: $1,00 независимо от длины.
Вывод — Claude Haiku 5.5: $0.50 до 100 000 токенов, $2.50 свыше; Claude Haiku 4.5: $5.00 независимо от длины.
• Чтение кэша — Claude Haiku 5.5: $0.01 до 100 000 токенов и $0.05 свыше; Claude Haiku 4.5: $0.10. Запись в кэш — $0.125 и $0.625 против $1.25.
• Контекст — 1 млн токенов против 200 000. Максимальный вывод — 128 000 токенов против 64 000.
• Размышление — Claude Haiku 5.5 адаптивно и включено по умолчанию, с регулятором усилий, который по умолчанию установлен на средний уровень; Claude Haiku 4.5 использует более старую ручную форму и вообще не имеет параметра усилий.
• Независимая оценка — Artificial Analysis Intelligence Index v4.3.2 ставит Claude Haiku 5.5 (Max) на 43,40 балла, что соответствует второму месту среди 182 моделей, а Claude 4.5 Haiku — на 16,88, тридцатое место из 61, — при этом составитель оценки помечает результат версии 4.5 как расчётный.
• Скорость — по данным того же источника, Claude Haiku 5.5 выдаёт 242 выходных токена в секунду против 89,7 у поколения 4.5, и это единственное место, где старая модель всё ещё выглядит уверенно.
Где рушится история о десятой части цены
Три вещи сокращают долю, и только первая из них — собственное предупреждение Anthropic.
Токенизатор — вот главное. Claude Haiku 5.5 использует более новый токенизатор, появившийся в Claude 4.7, и документация Anthropic утверждает, что тот же текст «насчитывает примерно на 30% больше токенов, чем в Claude Haiku 4.5». Вы платите десятую часть ставки не за то же количество токенов; вы платите десятую часть ставки за количество токенов, примерно в 1,3 раза большее. Собственное руководство поставщика по миграции ставит этот пункт вторым в своём контрольном списке, прежде любых изменений кода: пересчитайте свои промпты, затем пересмотрите max_tokens и ваши оценки стоимости.
Токены рассуждений тарифицируются как выходные, а Claude Haiku 5.5 рассуждает по умолчанию. На странице запуска Anthropic прямо указано, что модель сама по себе «очень многословна» на графиках, и независимые измерения подтверждают это резче, чем сам вендор: при оценке Intelligence Index Artificial Analysis зафиксировала 440 млн выходных токенов от Claude Haiku 5.5 против медианы в 100 млн по всем моделям и отметила модель как очень многословную. Дешёвая цена за входные токены не помогает рабочей нагрузке, счёт за которую в основном формируют выходные токены.
Ступень в 100 000 токенов — третья. Выше неё тарифы — $0,50 и $2,50, вдвое меньше того, что Claude Haiku 4.5 брал за тот же запрос; это выгодное предложение, но не то предложение, о котором большинство читателей читали. Anthropic утверждает, что запросы ниже порога составили около 90% обращений к предыдущей модели Haiku, и именно это число делает такой порог приемлемым для заголовка; к тому же это собственная структура трафика вендора, а не ваша.

Во сколько обходится одна и та же работа двум моделям
Стоимость за завершённую задачу — это метрика, которая сохраняется при всех трёх вышеперечисленных эффектах, потому что она начисляет модели за всё, что она выдала, а не только за то, что вы ей отправили.
Artificial Analysis оценивает Claude Haiku 5.5 (Max) в $0,21 за задачу Intelligence Index — это показатель, который она публикует вместе с тарифом $0,10 за входные данные и $0,50 за выходные. Для поколения 4.5 она вообще не публикует показатель стоимости за задачу; в плитке отображается «неизвестно», потому что модель никогда не запускалась в Индексе в режиме рассуждений. А что страница действительно публикует, так это исходный ценник в $1,00 и $5,00 и другую, более низкую измеренную оценку.
Так что честное сравнение для покупателя — это не 10-кратная разница по токенам, а скорее вот что: одна десятая входной ставки при на 30% большем количестве токенов, половина выходной ставки после преодоления отметки 100K и модель, которая тратит больше выходных токенов на ответ, чем её предшественница, — на фоне скачка возможностей с 16,88 до 43,40 в том же независимом лидерборде. Цифра 75%, которую Anthropic приводит для средних рабочих нагрузок, — это разумный ориентир для планирования. Это также усреднённая оценка вендора по структуре трафика, которую вы не контролируете.
Миграция — это не замена model-id
Руководство Anthropic по миграции для тех, кто уходит с Claude Haiku 4.5, включает десять пунктов, и несколько из них — серьёзные сбои, а не рекомендации.
• Ручное мышление перестаёт работать — thinking: {"type": "enabled", "budget_tokens": N} возвращает ошибку. Адаптивное мышление заменяет его, и thinking.display нужно установить в "summarized", если вы вообще хотите видеть рассуждения.
• Параметры сэмплирования нарушаются — temperature, top_p и top_k все должны быть исключены из запроса.
• Предзаполнение ассистента ломается — диалог, заканчивающийся репликой ассистента, возвращает ошибку; завершайте его на реплике пользователя.
• Порядок блоков меняется — ответ может начинаться с блоков размышлений, поэтому код, который читает первый блок содержимого как ответ, должен выбирать по типу вместо этого.
• Отказы — это новое: модель запускает классификаторы безопасности и может вернуть stop_reason: "refusal", и на стороне сервера нет резервного варианта.
• Воспроизведение ограничено — блоки размышлений работают только в том аккаунте, который их создал, или в аккаунте, связанном с ним.
• Priority Tier не переносится — организациям, имеющим обязательство по Priority Tier на Claude Haiku 4.5, придётся планировать ресурсы отдельно, поскольку этот уровень не поддерживается в Claude Haiku 5.5.
Две из них заслуживают большего внимания, чем остальные. Причина остановки refusal — это изменение потока управления в любом цикле, который предполагал, что каждый ответ имеет содержимое, а привязанные к аккаунту блоки размышлений ломают любую очередь, которая хранит диалоги и воспроизводит их через пул учётных данных. Ни то, ни другое не проявляется до продакшена.
Запуск обоих уровней под одним ключом
Практический вопрос для большинства команд заключается не в том, какая из этих двух моделей лучше, потому что ответ полностью зависит от того, какой именно вызов вы делаете. Он в том, можно ли дешёвое звено каскада улучшить независимо от всего, что его окружает.
Claude Haiku 4.5 уже сегодня доступен в каталоге OrcaRouter по каталожной цене Anthropic с наценкой 0%, поэтому тариф провайдера передаётся напрямую, и любые изменения, которые Anthropic в него вносит, появляются у нас в тот же день. Claude Sonnet 5.5 и Claude Opus 5.5 там тоже есть — а значит, двухуровневый конвейер (небольшая модель для рутинного большинства, более крупная — для эскалации) можно построить уже сейчас, имея один ключ, один SDK и автоматическое переключение при сбое под капотом, а малое звено позже заменить на Claude Haiku 5.5 просто сменой model-id, а не переписыванием.
Claude Haiku 5.5 пока нет в каталоге, и об этом стоит сказать прямо, а не оставлять это подразумеваемым. Разрыв в день запуска между выпуском модели и возможностью маршрутизировать её — это нормально, и это не обещание относительно того, когда он закроется; модели, доступные для вызова у нас сегодня утром, — это те, что названы выше.

Кому стоит переключиться и какой звонок переключить первым
Если ваш трафик Haiku 4.5 — это классификация, извлечение, маршрутизация, уплотнение или суммирование с промптами менее 100 000 токенов, переходите — ставка в десять раз ниже, окно в пять раз шире, а регулятор усилий даёт рычаг управления стоимостью, которого у старой модели никогда не было. Закладывайте бюджет примерно на 75% ниже и сверьтесь с собственными подсчётами токенов через неделю.
Если ваши промпты регулярно превышают 100 000 токенов, вы получаете скидку 50%, а не 90%, а второй уровень меняет сравнение так, что стоит изучить предложения конкурентов: ставка за вывод свыше 100K в размере $2.50 выше того, что несколько конкурирующих небольших моделей берут за всё контекстное окно.
И если вы используете Haiku 4.5, потому что это был единственный дешёвый вариант, вмещавший документ на 200 000 токенов, обратите внимание, что изменилось. Окно теперь составляет миллион токенов — это уже другой продукт, и причина держаться за старую модель тихо исчезла вместе с причиной, по которой она была дешёвой.
