Сгенерированная титульная карточка с надписью «Claude Haiku 5.5 уже вышел», значком релиза «GA 7 окт. 2026», двумя карточками с фактами — «Ввод: $0,10 за 1 млн при объёме до 100 тыс. токенов» и «Вывод: $0,50 за 1 млн при объёме до 100 тыс. токенов» — и строкой в нижнем колонтитуле: «Один заголовок сокращён, две сноски: 90 процентов ниже порога, 50 процентов выше него, при примерно на 30 процентов большем числе токенов». Настоящий логотип OrcaRouter скомпонован в правом нижнем углу.
Guides & Insights

Claude Haiku 5.5 уже доступен по цене $0.10 за миллион токенов: {{1}}заявление о 75%{{/1}} и {{2}}две сноски к нему{{/2}}

Автор

Alistair Wren

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Anthropic ввела Claude Haiku 5.5 в общий доступ 7 октября 2026 года по цене $0,10 за миллион входных токенов и $0,50 за миллион выходных — те же две цифры, которые OpenAI берёт за GPT-6 Luna, и пятая часть того, что Claude Haiku 4.5 стоит с 2025 года, когда она вышла по цене $1,00 и $5,00. Главное в посте Anthropic о запуске — то, что новая модель обходится «примерно на 75% дешевле в эксплуатации», чем её предшественница, в среднем, и именно эту цифру с тех пор повторяет каждый пересказ. Вместе с ней идут две сноски, которые большинство этих пересказов опустило: до 100 000 токенов снижение составляет 90%, выше — 50%, а Claude Haiku 5.5 использует более новый токенизатор, общий с Claude 4.7 и более поздними версиями, так что один и тот же текст насчитывает примерно на 30% больше токенов, чем на Claude Haiku 4.5. Так что 75% — это утверждение о счёте, а не о прайс-листе, и для всех, у кого запросы длинные, это разные вещи. В собственной сравнительной таблице вендора GPT-6 Luna и Claude Sonnet 5.5 тоже идут отдельными колонками рядом с ней, что делает документацию о запуске на удивление легко оспоримой.

Арифметика, стоящая за «на 75% меньше»

Сначала возьмите тарифную сетку, потому что она не фиксированная. Входные токены стоят $0.10 за миллион до 100 000 токенов и $0.50 за миллион свыше этого — в пять раз больше. Выходные токены — $0.50, а затем $2.50. Кэширование подчиняется той же ступенчатой схеме: запись в кэш на пять минут стоит $0.125 за миллион ниже порога и $0.625 выше него, часовая запись — $0.20 и $1.00, а чтение из кэша — $0.01 и $0.05. Message Batches API даёт скидку 50% по обоим тарифам, а при пакетной обработке модель поддерживает до 300 000 выходных токенов с output-300k-2026-03-24 бета-заголовком.

Теперь добавьте к этому токенизатор, потому что именно здесь главное утверждение становится интересным. Промпт, который на токенизаторе Claude Haiku 4.5 измерялся в 90 000 токенов, на новом измеряется примерно в 117 000. Его размер не изменился, но он пересёк отметку в 100 000 токенов, поэтому тарифицируется по $0.50 за миллион входных токенов вместо $0.10. В Claude Haiku 4.5 тот же контент стоил $0.09 за вход ($1.00 за миллион × 0.09 миллиона). В Claude Haiku 5.5 он стоит $0.0585. Это сокращение на 35% — реальное, и совсем не близко к 90%. Показатель 90% относится к запросам, которые остаются ниже этой отметки после того, как токенизатор их расширит, — а именно там находится значительная часть трафика коротких вызовов: запрос на классификацию в 20 000 токенов превращается в 26 000 токенов, остаётся в первом тарифном уровне, и там цена за вход действительно составляет десятую часть от прежней.

Из этого следуют три вещи, и их стоит разделить, а не усреднять:

• Короткие вызовы получают полную скидку. Извлечение, маршрутизация, классификация, суммаризация документа, укладывающегося в лимит, — для них действует показатель 90% на входе и выходе, за вычетом расширения токенизатора.

• Длинные вызовы получают скидку около трети, а не три четверти. Запрос, который после повторной токенизации превышает 100 000 токенов, оплачивается по $0,50 и $2,50 за миллион — это по-прежнему вдвое меньше ставок Claude Haiku 4.5, но тарифный уровень, в который он попадает, в пять раз выше того, что заявлено на ценнике.

• Показатель «в среднем на 75% меньше» — это взвешенное по трафику число, и оно принадлежит Anthropic. Это собственное описание вендором своего же ожидаемого распределения, и Anthropic прямо указывает, что промпт ниже порога составлял около 90% запросов к предыдущей Haiku. Если ваше распределение не похоже на то, то и ваше среднее не будет похоже на то среднее — а единственный способ выяснить это — подсчитать токены на собственном трафике с помощью нового токенизатора, прежде чем устанавливать бюджет.

A generated one-column scoreboard titled 'Claude Haiku 5.5 — the scoreboard' with six rows reading 'Input: $0.10 / 1M up to 100K, then $0.50', 'Output: $0.50 / 1M up to 100K, then $2.50', 'Context: 1,000,000 tokens', 'Independent score: 43 at Max effort, rank 2 of 182', 'Cost per task: $0.21', and 'Throughput: 241.9 tokens per second', with a footer reading 'Independent figures per Artificial Analysis; pricing per Anthropic.' The real OrcaRouter logo is composited bottom-right.

Что ещё вышло вместе с ним

Модель — это не только цена. Несколько деталей запуска меняют то, как вы пишете код для неё, и одна из них сломает существующий клиент.

• Адаптивное мышление включено по умолчанию, с регулятором усилий от низкого до максимального и уровнем по умолчанию — средний. Это первая модель класса Haiku с регулируемой настройкой усилий, и это главный рычаг, влияющий как на качество, так и на стоимость каждого ответа.

• Параметры сэмплирования отклоняются. Отправка нестандартных temperature, top_p или top_k возвращает 400. Любая миграция, перенёсшая эти аргументы, громко упадёт при первом запросе, а не тихо деградирует, что, по крайней мере, честный режим отказа.

• Контекст в 1 млн токенов и до 128 000 выходных токенов в синхронном Messages API, с датой отсечки знаний в июне 2026 года и обязательством по выводу из эксплуатации не ранее 7 октября 2027 года.

• Пять платформ в первый же день: Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry и Claude Platform on AWS. Это одновременный запуск, а не поэтапное развёртывание, которое часто происходит при подобных релизах.

• Инструментарий тоже не стоял на месте. SDK Anthropic для Python и TypeScript теперь поддерживают computer use и browser use в бета-версии, а компания добавила ежемесячные API-кредиты для подписчиков Max 5x ($100), Max 20x ($200) и Team (до $500 в общем пуле).

• Политика безопасности строже, чем можно предположить по цене. Anthropic заявляет, что киберограничения Claude Haiku 5.5 более строгие, чем у Claude Haiku 4.5, но менее строгие, чем у недавних фронтирных моделей — возможности защитного применения шире, чем допускает Claude Sonnet 5.5, при этом пентест по-прежнему заблокирован — и что биологические ограничения соответствуют Claude Sonnet 5, Claude Sonnet 5.5 и Claude Opus 5. Оценки выравнивания в целом улучшились по сравнению с предшественником в собственной тестовой среде Anthropic.

Что говорит таблица поставщика и что говорит независимый совет

Anthropic опубликовала таблицу бенчмарков с тремя колонками сравнения, и её стоит прочитать как документ о том, как спорят вендоры. Каждый показатель ниже приведён самим вендором, получен на тестовых стендах Anthropic, и ни один из них не был независимо воспроизведён; там, где появляется GPT-6 Luna, это Anthropic проводит собственные оценки против модели конкурента.

• Интеллектуальный труд — GDPval-AA v2.1 — 1620 у Claude Haiku 5.5 против 735 у Claude Haiku 4.5, 1437 у Claude 6 Luna и 1840 у Claude Sonnet 5.5. AA-Briefcase v1.1 — 1578, 614, 1336 и 1824.

• Computer use — OSWorld 2.1 в офлайн-режиме: 72,4% против 15,7%, 48,9% и 83,9%.

• Рассуждение — Humanity's Last Exam: 45,9% без инструментов и 57,4% с ними, против 10,2% и 18,7% у Claude Haiku 4.5 и 56,9% и 64,5% у Claude Sonnet 5.5.

• Агентное программирование — Terminal-Bench 4.0: 39,2% против 0,0%, 16,4% и 70,6%. FrontierCode 1.1 (Main): 46,4% против 42,4% у GPT-6 Luna и 52,1% у Claude Sonnet 5.5.

• Чтение графиков — Chartography на 46,4% без инструментов против 6,4%, 29,1% и 61,6%.

В той таблице Claude Haiku 5.5 выигрывает в каждой строке как у предыдущего Haiku, так и у GPT-6 Luna, и проигрывает большинство из них Claude Sonnet 5.5 — это честная картина младшего уровня: большой скачок между поколениями и всё ещё на уровень ниже средней модели в самой сложной работе. Anthropic говорит об этом же в посте, рекомендуя Claude Sonnet 5.5 и Claude Opus 5.5 для сложного агентного программирования, позиционируя Haiku для компактификации, суммаризации, классификации и ролей субагентов.

Независимая картина сложнее и требует больше внимания. Artificial Analysis измеряет Claude Haiku 5.5 на уровне усилий Max в 43 балла по своему Intelligence Index v4.3.2 — второе место среди 182 моделей — и 241,9 выходных токена в секунду, то есть быстро, как и обещано. Она же оценивает стоимость в 0,21 доллара за выполненную задачу индекса, потому что модель сгенерировала 440 миллионов выходных токенов, прогоняя набор, при медиане в 100 миллионов; оценщик описывает её как очень многословную. GPT-6 Luna при 38 по тому же индексу стоит 0,07 доллара за задачу. Та же цена в прайсе — втрое больший счёт. Это не противоречие заявлению о запуске — это тот же феномен, о котором говорит заявление о запуске, только с другого конца: тарифная сетка — это то, что вы платите за токен, а реально уплачиваемая сумма — это тариф, умноженный на токены, и Claude Haiku 5.5 тратит их на ответ больше, чем её конкуренты. Усилия — это рычаг; значение по умолчанию у модели — medium, а не Max, и команда, которая зафиксирует его ниже, увидит и меньший счёт, и меньший балл.

Вызов его из одного места

Вопрос о миграции, который порождает этот запуск, — не «лучше ли это», а «во сколько мне обходится на нём мой трафик», и ответ зависит от длины ваших промптов, частоты попаданий в кэш и выбранной вами настройки усилий. Чтобы до этого добраться, нужно прогнать собственный набор промптов через оба поколения — что дёшево сделать в рамках одного эндпоинта и утомительно — в рамках двух.

Сам Claude Haiku 5.5 пока отсутствует в каталоге OrcaRouter, и прямо сказать об этом полезнее, чем подразумевать обратное. Остальная линейка Anthropic: Claude Haiku 4.5, Claude Sonnet 5.5 и Claude Opus 5.5 — все они доступны у нас сегодня по прайс-листу провайдера с 0% наценки, переданной напрямую, так что этап «до» миграционного теста выполняется на том же ключе, который вы сохраните впоследствии, и снижение цены вендором на этом этапе становится доступным на нашей стороне в тот же день. Этап «после» — это API Anthropic, пока новая модель не появится в среде выполнения, которую мы маршрутизируем. Что даёт вам общий эндпоинт тем временем — это автоматический фейловер под вызовом, так что новая модель может обслуживать продакшн-трафик, не делая путь зависимым от неё, и DSL маршрутизации для случая, когда эскалация с Haiku на Sonnet должна находиться в маршруте, а не в коде вашего приложения.

A screenshot of OrcaRouter's model page for anthropic/claude-haiku-4.5, showing the model card and its list pricing of $1.00 per million input tokens and $5.00 per million output tokens, captured in English.

Два клиентских результата в рамках запуска стоит использовать как зацепки, а не как доказательства. Asana сообщает о снижении задержки более чем на 30% и ускорении инференса до 2,5 раза на один ход агента; HubSpot сообщает о 92,8% в среднем по трём прогонам на своём CRM-наборе; AlphaSense сообщает о 0,84 против 0,76 по 400 запросам. Это выбранные вендором клиентские показатели в собственном анонсе вендора, и их ценность в том, что они подсказывают, какие рабочие нагрузки тестировать первыми, а не в том, что они говорят, что вы получите.

Что бы изменило картину?

Цифра в 75% будет установлена так же, как устанавливается любое взвешенное по трафику заявление вендора: вашим собственным счётом. Что действительно остаётся открытым на независимой стороне — это показатель стоимости за задачу. Если он подтвердится по мере накопления прогонов, честная сводка этого запуска будет такой: Anthropic срезала прайс-лист на 80% и построила модель, которая тратит больше токенов на ответ, поэтому фактическая экономия реальна, велика, зависит от нагрузки и редко совпадает с числом на плакате. Если она снижается с настройками усилий и кэшированием, тариф выглядит ещё лучше. В любом случае цифра, которую нужно проверить перед переходом, — это ваши собственные токены на задачу при новом токенизаторе; именно эту цифру не может дать вам пост о запуске.

A screenshot of the Artificial Analysis model page for Claude Haiku 5.5 at maximum effort, showing an Intelligence Index of 43 on v4.3.2 at rank 2 of 182 models, a 1,000,000-token context window, 241.9 output tokens per second at rank 8 of 182, a cost of $0.21 per Intelligence Index task, and 440 million output tokens against a 100 million median.

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно