Сгенерированная hero-карточка для «Claude Haiku 5.5 стоит в десять раз дешевле», с бейджем «САМЫЙ ДЕШЁВЫЙ CLAUDE», с надзаголовком «ANTHROPIC, 7 ОКТЯБРЯ 2026» и подзаголовком «Снижение тарифов на 90%, токенизатор, который добавляет примерно на 30% больше токенов, и видео запуска, которое Anthropic не опубликовала». На четырёх чипах указано: «$0.10 за вход», «$0.50 за выход», «контекст 1M» и «75% реальной экономии». Две карточки ниже помечены «ЧТО СНИЗИЛОСЬ» («вход с $1.00 до $0.10, выход с $5.00 до $0.50 при объёме до 100 000 токенов») и «ЧТО ВЫРОСЛО» («тот же текст считается как примерно на 30% больше токенов, чем раньше»). В нижнем колонтитуле указано: «Документация по ценам поставщика, прочитана 8 октября 2026 г.» Логотип OrcaRouter наложен в правом нижнем углу.
Guides & Insights

Claude Haiku 5.5: снижение цены на 90%, новый токенизатор и видео, которое Anthropic не опубликовала

Автор

Rowan Sterling

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Кто-то ввёл одно предложение в Claude Haiku 5.5 — и получил на выходе готовый лонч-фильм. Промпт, опубликованный в X вечером 7 октября 2026 года, целиком звучит так: «сделай в 10 раз более убойное видео для своего запуска, которое показывает, насколько ты хорош как моушн-дизайнер». Подпись к посту — три слова: «Снял одним дублем» — и клип приложен как вложение. Никаких повторных попыток, ни раскадровки, ни монтажёра. Если это то, на что сейчас способна самая дешёвая модель в линейке Claude, то этот уровень перестал быть компромиссом.

Это интересная половина запуска. Другая половина — арифметика, и именно в ней заключается настоящая новость: Claude Haiku 5.5стоит $0,10 за миллион входных токенов и $0,50 за миллион выходных токенов для промптов объёмом до 100 000 токенов, против фиксированных $1 и $2 у Claude Haiku 4.5. В собственной сноске Anthropic называет это снижением на 90% в типичном случае — а затем, не переводя дыхания, говорит, что цифра, на которую покупателю стоит ориентироваться, ближе к 75%. Обе цифры верны, и разрыв между ними — самое важное в этом релизе.

Что Ant​hropic официально заявила 7 октября

Пост вендора о запуске и его документация по ценам согласуются в описании сути, и это более крупный шаг, чем обычно сопровождает снижение цены.

A generated scoreboard titled 'Claude Haiku 5.5 benchmark table - Anthropic's own harness' with two columns. Claude Haiku 5.5 reads GDPval-AA v2.1 1620, AA-Briefcase v1.1 1578, OSWorld 2.1 72.4%, Humanity's Last Exam 45.9%, Terminal-Bench 4.0 39.2% and Chartography 46.4%. Claude Haiku 4.5 reads 735, 614, 15.7%, 10.2%, 0.0% and 6.4%. A footer reads 'Vendor-reported evaluations published by Anthropic on October 7, 2026; not independently reproduced.'

• Цена — $0,10 за миллион входных токенов и $0,50 за миллион выходных токенов для запросов до 100 000 токенов. Выше этого порога тот же запрос тарифицируется по $0,50 и $2,50. Чтение из кэша стоит $0,01 за миллион до 100 тыс. и $0,05 выше; запись в кэш — $0,125 и $0,625.

• Контекст — 1M токенов при максимальном выводе в 128 000 токенов. Это то же самое окно и тот же потолок вывода, которые есть у Claude Fable 5.1, Claude Opus 5.5 и Claude Sonnet 5.5, воспроизведённые на самом дешёвом уровне.

• Thinking — мышление с параметром effort, по умолчанию — medium. Ant​hropic заявляет, что это первая модель класса Haiku с настройкой effort: один и тот же model id можно запускать дёшево или тщательно, не меняя больше ничего.

• Токенизатор — более новый токенизатор, который также используется в Claude 4.7 и более поздних версиях и «создаёт примерно на 30 % больше токенов для того же текста». В документации Anthropic говорится, что точное увеличение зависит от содержимого и характера рабочей нагрузки.

• Жизненный цикл — дата отсечки знаний: июнь 2026 года, а обязательство по выводу из эксплуатации — «не ранее 7 октября 2027 года».

• Доступность — Claude API, Amazon Web Services, Google Cloud, Microsoft Azure и Claude Platform on AWS — всё сразу в первый же день.

Наклейка 10x и реальность 75%

В десять раз дешевле — это число, которое разойдётся дальше всего, и именно оно с наибольшей вероятностью окажется не на своём месте в чьей-то бюджетной модели. Это относится к промптам объёмом до 100 000 токенов. Haiku 5.5 не удерживает этот тариф для всего окна.

• До 100 000 токенов — $0,10 за ввод и $0,50 за вывод, против $1 и $5 у Haiku 4.5. Это сокращение на 90%, и Ant​hropic говорит, что 90% запросов к предыдущей модели Haiku попадали в этот диапазон.

• Свыше 100 000 токенов — 0,50 $ за ввод и 2,50 $ за вывод. Всё ещё ровно половина того, что брал Haiku 4.5 за тот же запрос, и без потолка, в который можно упереться.

• Токенизатор — один и тот же текст даёт примерно на 30% больше токенов, чем на Haiku 4.5, поэтому снижение цены за токен не конвертируется один к одному в меньший счёт.

• Средний показатель самого вендора — Anthropic описывает комбинацию как «примерно на 75% дешевле в эксплуатации». Это его цифра, а не независимое измерение, и именно её следует закладывать в прогноз.

• Экономика кэша — чтения из кэша подешевели с $0,10 до $0,01 за миллион в обычном диапазоне, что важнее, чем тариф на входные данные, для любого пайплайна, который повторно отправляет длинный общий префикс.

Цифра 75% также объясняет то, что читатель иначе мог бы воспринять как противоречие. Два главных числа не противоречат друг другу: одно — это показатель для определённой формы запроса, другое — смешанная оценка по реальному распределению трафика, которое включает меньшинство запросов длиной более 100K и дополнительные токены токенизатора. Если вы моделируете расходы, используйте 75% и проверьте собственное распределение длин промптов, прежде чем верить в лучшее.

Что утверждает видео, а что — нет

Клип настоящий, промпт процитирован дословно выше, а метка времени — 19:49 UTC 7 октября, примерно в тот же день, когда модель была запущена, — поддаётся проверке. Атрибуция относится к отдельному пользователю, а не к Ant​hropic.

Это различие здесь важно, потому что на собственной странице продукта Anthropic для Claude Haiku 5.5 нет вообще никакого встроенного видео: ни плеера, ни медиафайла, только ссылка на YouTube-канал компании. Если презентационный фильм был сделан с помощью модели, производитель об этом не сообщал. Поэтому точное утверждение узкое: пользователь сообщает, что сгенерировал презентационное видео с первого раза с помощью Claude Haiku 5.5, и опубликовал промпт. Было ли это с первого раза, сколько это стоило и сколько от него осталось после монтажа, — всё это утверждения из одного источника. Относитесь к этому клипу как к демонстрации, а не как к бенчмарку.

Причина, по которой об этом всё же стоит упомянуть, заключается в том, что генерация видео не входит в спецификацию модели. Haiku 5.5 принимает текст и изображения и возвращает текст. Результат в области моушн-дизайна такого качества подразумевает, что модель управляла чем-то другим — трактом генерации кода, конвейером рендеринга, циклом вызова инструментов, — а не создавала кадры сама. Это утверждение об агентной оркестрации при стоимости ввода $0.10, и именно это по-настоящему удивительно.

Цифры, которые опубликовала Ant​hropic

Таблица запуска от вендора представляет собой сравнение «до и после» с Haiku 4.5, при этом GPT-6 Luna и Claude Sonnet 5.5 приведены в тех же столбцах для сравнения масштабов. Каждый показатель ниже — это собственный заявленный результат оценки Ant​hropic, полученный на стенде Ant​hropic, и он воспроизведён, но не проверен независимо.

A screenshot of Anthropic's Claude Haiku 5.5 launch page, dated October 7 2026 and headed with the model name, the identifier claude-haiku-5-5 and the launch standfirst, with the vendor's reported evaluation rows and pricing notes below.

• Работа со знаниями — GDPval-AA v2.1: 1620 против 735 у Haiku 4.5, 1437 у GPT-6 Luna и 1840 у Sonnet 5.5. AA-Briefcase v1.1: 1578 против 614, 1336 и 1824.

• Использование компьютера — OSWorld 2.1: 72,4% на офлайн-подмножестве против 15,7% у Haiku 4.5, 48,9% у GPT-6 Luna и 83,9% у Sonnet 5.5.

• Междисциплинарные рассуждения — Humanity's Last Exam: 45.0% без инструментов и 57.4% с ними, против 10.2% и 18.7% у Haiku 4.5.

• Агентное программирование — Terminal-Bench 4.0: 39,2% против 0,0%, 16,4% и 70,6%. FrontierCode 1.1 (Main): 46,4% против 42,4% у GPT-6 Luna и 52,1% у Sonnet 5.5.

• Визуальное рассуждение — Chartography на 46.4% без инструментов, против 6.4%, 29.1% и 61.6%.

Anthropic также необычно прямолинеен в том, где младший уровень не выигрывает. В своих комментариях к диаграмме Terminal-Bench она говорит, что Sonnet 5.5 и Opus 5.5 «остаются лучшим выбором для сложных задач агентного программирования», а Haiku 5.5 позиционирует для сжатия, суммирования и работы субагентов. Отзывы клиентов в посте указывают в том же направлении и содержат ту же оговорку — это партнёры по раннему доступу, описывающие свои собственные оценки, а не аудиты: Asana сообщает о более чем на 30% меньшей задержке при завершении задач и до 2,5 раз более быстром выводе на один ход агента; HubSpot сообщает о 92,8% в среднем за три прогона на наборе CRM-порталов; AlphaSense сообщает о 0,84 против 0,76 по 400 запросам на нагрузке, выполняющей около 8 млн вызовов в неделю; Box сообщает о на 11 пунктов большем показателе, чем у Haiku 4.5, при примерно вдвое меньшей задержке; Rogo описывает субагента Haiku 5.5, извлекающего строку выручки сегмента из формы 10-K; а Cognition сообщает, что Devin Fusion имеет оценку FrontierCode 66.2, а Haiku 5.5 выступает в качестве напарника.

Что говорит независимый совет

Таблицы вендоров принадлежат вендорам. Первое стороннее размещение — более полезное число для любого, кто решает, достаточно ли далеко продвинулся этот уровень, чтобы менять производственный конвейер.

A screenshot of the Artificial Analysis model page for Claude Haiku 5.5 in its Max configuration, showing an Intelligence Index v4.3.2 score of 43.40 ranked second of 182 models, an output speed of 242 tokens per second, a cost of $0.21 per Intelligence Index task, and the evaluator's note that the model generated 440 million output tokens against a 100 million median and is very verbose.

Artificial Analysis присваивает Claude Haiku 5.5 оценку 43 по Intelligence Index v4.3.2 в конфигурации Max этой модели, что ставит её на второе место среди 182 моделей в этом рейтинге и значительно выше медианы рейтинга, равной 13. На той же странице указано 242 выходных токена в секунду — девятое место из 182 — и стоимость $0.21 за задачу Intelligence Index.

Две вещи на той странице значат больше, чем заголовок. Первое — многословность: оценивая Index, Artificial Analysis зафиксировала 440 млн выходных токенов против медианы в 100 млн и описывает модель как «очень многословную». Цена в прайсе указана за токен, поэтому модель, которая размышляет долго, за это платит — именно поэтому стоимость выполнения задачи составляет $0,21, а не около нуля, и поэтому сокращение входных данных на 90% — не вся история. Второе — лестница усилий: на той же странице представлены конфигурации от Max до Low, а значение Anthropic по умолчанию — medium, а не max. Оценка 43 на табло — это верхняя ступень этой лестницы, а не настройка, которую вы получите, если ничего не делать.

Запуск уровня ниже того уровня, который вы уже можете вызвать

Claude Haiku 5.5 отсутствует в каталоге OrcaRouter, и об этом стоило бы сказать прямо, а не намекать на обратное: разрыв между появлением модели и возможностью маршрутизировать её в день запуска обычно составляет несколько дней, а иногда и больше.

В каталоге Anthropic сейчас Claude Haiku 4.5, Claude Sonnet 5.5 и Claude Opus 5.5, каждый по прайс-листу провайдера, пропущенному через нас с наценкой 0 %, так что любое снижение цены у Anthropic отражается на нашей стороне в тот же день, когда оно происходит у них. Это практичный мост для всех, кто хочет прямо сейчас протестировать субагента: каскад, который отправляет рутинные обращения к Haiku 4.5 и передаёт сложные наверх, работает уже сегодня под одним ключом и одним SDK, а замена малого звена на Haiku 5.5 позже — это смена model-id, а не миграция. Автоматическое переключение при сбое работает под выбранными вами звеньями, так что плохой день у одного провайдера не выведет из строя весь конвейер.

Если вы вообще не хотите ждать, ту же ценовую категорию ввода за $0.10 уже занимает GPT-6 Luna, к которой мы действительно маршрутизируем запросы, и которая удерживает этот тариф вплоть до 272 000 токенов, прежде чем повысить его.

Кому стоит переезжать, а кому — нет

Если ваша рабочая нагрузка — это классификация, извлечение, маршрутизация, компактизация или суммаризация в больших объёмах, а её объём не превышает 100 000 токенов, всё просто: стоимость составляет десятую часть прежней, окно в пять раз шире, а регулятор усилий позволяет сместить баланс в обратную сторону, когда этого требует запрос. Заложите в бюджет снижение на 75% — и вы удивитесь.

Если ваши промпты регулярно превышают 100 000 токенов, вы получаете скидку 50%, а не 90%, и сравнение вариантов для глубокого контекста всё ещё стоит потраченного времени — на рынке есть несколько моделей со ставкой на уровне или ниже, чем у этого тарифа для объёмов свыше 100K.

И если ваш eval по-прежнему проваливается на задачах в духе Terminal-Bench, то это не та модель, которая это исправит; Ant​hropic сама это признаёт, и 39,2% против 70,6% у Sonnet 5.5 — самое наглядное доказательство в этом посте. Честное резюме 7 октября таково: нижняя планка полезного интеллекта сильно упала, а верхняя не сдвинулась вообще.

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно