
Claude Haiku 5.5: снижение цены на 90%, новый токенизатор и видео, которое Anthropic не опубликовала
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 65 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
Кто-то ввёл одно предложение в Claude Haiku 5.5 — и получил на выходе готовый лонч-фильм. Промпт, опубликованный в X вечером 7 октября 2026 года, целиком звучит так: «сделай в 10 раз более убойное видео для своего запуска, которое показывает, насколько ты хорош как моушн-дизайнер». Подпись к посту — три слова: «Снял одним дублем» — и клип приложен как вложение. Никаких повторных попыток, ни раскадровки, ни монтажёра. Если это то, на что сейчас способна самая дешёвая модель в линейке Claude, то этот уровень перестал быть компромиссом.
Это интересная половина запуска. Другая половина — арифметика, и именно в ней заключается настоящая новость: Claude Haiku 5.5стоит $0,10 за миллион входных токенов и $0,50 за миллион выходных токенов для промптов объёмом до 100 000 токенов, против фиксированных $1 и $2 у Claude Haiku 4.5. В собственной сноске Anthropic называет это снижением на 90% в типичном случае — а затем, не переводя дыхания, говорит, что цифра, на которую покупателю стоит ориентироваться, ближе к 75%. Обе цифры верны, и разрыв между ними — самое важное в этом релизе.
Что Anthropic официально заявила 7 октября
Пост вендора о запуске и его документация по ценам согласуются в описании сути, и это более крупный шаг, чем обычно сопровождает снижение цены.

• Цена — $0,10 за миллион входных токенов и $0,50 за миллион выходных токенов для запросов до 100 000 токенов. Выше этого порога тот же запрос тарифицируется по $0,50 и $2,50. Чтение из кэша стоит $0,01 за миллион до 100 тыс. и $0,05 выше; запись в кэш — $0,125 и $0,625.
• Контекст — 1M токенов при максимальном выводе в 128 000 токенов. Это то же самое окно и тот же потолок вывода, которые есть у Claude Fable 5.1, Claude Opus 5.5 и Claude Sonnet 5.5, воспроизведённые на самом дешёвом уровне.
• Thinking — мышление с параметром effort, по умолчанию — medium. Anthropic заявляет, что это первая модель класса Haiku с настройкой effort: один и тот же model id можно запускать дёшево или тщательно, не меняя больше ничего.
• Токенизатор — более новый токенизатор, который также используется в Claude 4.7 и более поздних версиях и «создаёт примерно на 30 % больше токенов для того же текста». В документации Anthropic говорится, что точное увеличение зависит от содержимого и характера рабочей нагрузки.
• Жизненный цикл — дата отсечки знаний: июнь 2026 года, а обязательство по выводу из эксплуатации — «не ранее 7 октября 2027 года».
• Доступность — Claude API, Amazon Web Services, Google Cloud, Microsoft Azure и Claude Platform on AWS — всё сразу в первый же день.
Наклейка 10x и реальность 75%
В десять раз дешевле — это число, которое разойдётся дальше всего, и именно оно с наибольшей вероятностью окажется не на своём месте в чьей-то бюджетной модели. Это относится к промптам объёмом до 100 000 токенов. Haiku 5.5 не удерживает этот тариф для всего окна.
• До 100 000 токенов — $0,10 за ввод и $0,50 за вывод, против $1 и $5 у Haiku 4.5. Это сокращение на 90%, и Anthropic говорит, что 90% запросов к предыдущей модели Haiku попадали в этот диапазон.
• Свыше 100 000 токенов — 0,50 $ за ввод и 2,50 $ за вывод. Всё ещё ровно половина того, что брал Haiku 4.5 за тот же запрос, и без потолка, в который можно упереться.
• Токенизатор — один и тот же текст даёт примерно на 30% больше токенов, чем на Haiku 4.5, поэтому снижение цены за токен не конвертируется один к одному в меньший счёт.
• Средний показатель самого вендора — Anthropic описывает комбинацию как «примерно на 75% дешевле в эксплуатации». Это его цифра, а не независимое измерение, и именно её следует закладывать в прогноз.
• Экономика кэша — чтения из кэша подешевели с $0,10 до $0,01 за миллион в обычном диапазоне, что важнее, чем тариф на входные данные, для любого пайплайна, который повторно отправляет длинный общий префикс.
Цифра 75% также объясняет то, что читатель иначе мог бы воспринять как противоречие. Два главных числа не противоречат друг другу: одно — это показатель для определённой формы запроса, другое — смешанная оценка по реальному распределению трафика, которое включает меньшинство запросов длиной более 100K и дополнительные токены токенизатора. Если вы моделируете расходы, используйте 75% и проверьте собственное распределение длин промптов, прежде чем верить в лучшее.
Что утверждает видео, а что — нет
Клип настоящий, промпт процитирован дословно выше, а метка времени — 19:49 UTC 7 октября, примерно в тот же день, когда модель была запущена, — поддаётся проверке. Атрибуция относится к отдельному пользователю, а не к Anthropic.
Это различие здесь важно, потому что на собственной странице продукта Anthropic для Claude Haiku 5.5 нет вообще никакого встроенного видео: ни плеера, ни медиафайла, только ссылка на YouTube-канал компании. Если презентационный фильм был сделан с помощью модели, производитель об этом не сообщал. Поэтому точное утверждение узкое: пользователь сообщает, что сгенерировал презентационное видео с первого раза с помощью Claude Haiku 5.5, и опубликовал промпт. Было ли это с первого раза, сколько это стоило и сколько от него осталось после монтажа, — всё это утверждения из одного источника. Относитесь к этому клипу как к демонстрации, а не как к бенчмарку.
Причина, по которой об этом всё же стоит упомянуть, заключается в том, что генерация видео не входит в спецификацию модели. Haiku 5.5 принимает текст и изображения и возвращает текст. Результат в области моушн-дизайна такого качества подразумевает, что модель управляла чем-то другим — трактом генерации кода, конвейером рендеринга, циклом вызова инструментов, — а не создавала кадры сама. Это утверждение об агентной оркестрации при стоимости ввода $0.10, и именно это по-настоящему удивительно.
Цифры, которые опубликовала Anthropic
Таблица запуска от вендора представляет собой сравнение «до и после» с Haiku 4.5, при этом GPT-6 Luna и Claude Sonnet 5.5 приведены в тех же столбцах для сравнения масштабов. Каждый показатель ниже — это собственный заявленный результат оценки Anthropic, полученный на стенде Anthropic, и он воспроизведён, но не проверен независимо.

• Работа со знаниями — GDPval-AA v2.1: 1620 против 735 у Haiku 4.5, 1437 у GPT-6 Luna и 1840 у Sonnet 5.5. AA-Briefcase v1.1: 1578 против 614, 1336 и 1824.
• Использование компьютера — OSWorld 2.1: 72,4% на офлайн-подмножестве против 15,7% у Haiku 4.5, 48,9% у GPT-6 Luna и 83,9% у Sonnet 5.5.
• Междисциплинарные рассуждения — Humanity's Last Exam: 45.0% без инструментов и 57.4% с ними, против 10.2% и 18.7% у Haiku 4.5.
• Агентное программирование — Terminal-Bench 4.0: 39,2% против 0,0%, 16,4% и 70,6%. FrontierCode 1.1 (Main): 46,4% против 42,4% у GPT-6 Luna и 52,1% у Sonnet 5.5.
• Визуальное рассуждение — Chartography на 46.4% без инструментов, против 6.4%, 29.1% и 61.6%.
Anthropic также необычно прямолинеен в том, где младший уровень не выигрывает. В своих комментариях к диаграмме Terminal-Bench она говорит, что Sonnet 5.5 и Opus 5.5 «остаются лучшим выбором для сложных задач агентного программирования», а Haiku 5.5 позиционирует для сжатия, суммирования и работы субагентов. Отзывы клиентов в посте указывают в том же направлении и содержат ту же оговорку — это партнёры по раннему доступу, описывающие свои собственные оценки, а не аудиты: Asana сообщает о более чем на 30% меньшей задержке при завершении задач и до 2,5 раз более быстром выводе на один ход агента; HubSpot сообщает о 92,8% в среднем за три прогона на наборе CRM-порталов; AlphaSense сообщает о 0,84 против 0,76 по 400 запросам на нагрузке, выполняющей около 8 млн вызовов в неделю; Box сообщает о на 11 пунктов большем показателе, чем у Haiku 4.5, при примерно вдвое меньшей задержке; Rogo описывает субагента Haiku 5.5, извлекающего строку выручки сегмента из формы 10-K; а Cognition сообщает, что Devin Fusion имеет оценку FrontierCode 66.2, а Haiku 5.5 выступает в качестве напарника.
Что говорит независимый совет
Таблицы вендоров принадлежат вендорам. Первое стороннее размещение — более полезное число для любого, кто решает, достаточно ли далеко продвинулся этот уровень, чтобы менять производственный конвейер.

Artificial Analysis присваивает Claude Haiku 5.5 оценку 43 по Intelligence Index v4.3.2 в конфигурации Max этой модели, что ставит её на второе место среди 182 моделей в этом рейтинге и значительно выше медианы рейтинга, равной 13. На той же странице указано 242 выходных токена в секунду — девятое место из 182 — и стоимость $0.21 за задачу Intelligence Index.
Две вещи на той странице значат больше, чем заголовок. Первое — многословность: оценивая Index, Artificial Analysis зафиксировала 440 млн выходных токенов против медианы в 100 млн и описывает модель как «очень многословную». Цена в прайсе указана за токен, поэтому модель, которая размышляет долго, за это платит — именно поэтому стоимость выполнения задачи составляет $0,21, а не около нуля, и поэтому сокращение входных данных на 90% — не вся история. Второе — лестница усилий: на той же странице представлены конфигурации от Max до Low, а значение Anthropic по умолчанию — medium, а не max. Оценка 43 на табло — это верхняя ступень этой лестницы, а не настройка, которую вы получите, если ничего не делать.
Запуск уровня ниже того уровня, который вы уже можете вызвать
Claude Haiku 5.5 отсутствует в каталоге OrcaRouter, и об этом стоило бы сказать прямо, а не намекать на обратное: разрыв между появлением модели и возможностью маршрутизировать её в день запуска обычно составляет несколько дней, а иногда и больше.
В каталоге Anthropic сейчас Claude Haiku 4.5, Claude Sonnet 5.5 и Claude Opus 5.5, каждый по прайс-листу провайдера, пропущенному через нас с наценкой 0 %, так что любое снижение цены у Anthropic отражается на нашей стороне в тот же день, когда оно происходит у них. Это практичный мост для всех, кто хочет прямо сейчас протестировать субагента: каскад, который отправляет рутинные обращения к Haiku 4.5 и передаёт сложные наверх, работает уже сегодня под одним ключом и одним SDK, а замена малого звена на Haiku 5.5 позже — это смена model-id, а не миграция. Автоматическое переключение при сбое работает под выбранными вами звеньями, так что плохой день у одного провайдера не выведет из строя весь конвейер.
Если вы вообще не хотите ждать, ту же ценовую категорию ввода за $0.10 уже занимает GPT-6 Luna, к которой мы действительно маршрутизируем запросы, и которая удерживает этот тариф вплоть до 272 000 токенов, прежде чем повысить его.
Кому стоит переезжать, а кому — нет
Если ваша рабочая нагрузка — это классификация, извлечение, маршрутизация, компактизация или суммаризация в больших объёмах, а её объём не превышает 100 000 токенов, всё просто: стоимость составляет десятую часть прежней, окно в пять раз шире, а регулятор усилий позволяет сместить баланс в обратную сторону, когда этого требует запрос. Заложите в бюджет снижение на 75% — и вы удивитесь.
Если ваши промпты регулярно превышают 100 000 токенов, вы получаете скидку 50%, а не 90%, и сравнение вариантов для глубокого контекста всё ещё стоит потраченного времени — на рынке есть несколько моделей со ставкой на уровне или ниже, чем у этого тарифа для объёмов свыше 100K.
И если ваш eval по-прежнему проваливается на задачах в духе Terminal-Bench, то это не та модель, которая это исправит; Anthropic сама это признаёт, и 39,2% против 70,6% у Sonnet 5.5 — самое наглядное доказательство в этом посте. Честное резюме 7 октября таково: нижняя планка полезного интеллекта сильно упала, а верхняя не сдвинулась вообще.
Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
