
Ежедневный AI-брифинг, 8 окт: Claude Haiku 5.5 выходит по цене $0.10, а стоимость чтения кэша Sonnet 5.5 снижается вдвое
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 56 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 347 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
Claude Haiku 5.5 вышел 7 октября 2026 года, и это самое дешёвое, что компания когда-либо предоставляла через API: $0.10 за миллион входных токенов и $0.50 за миллион выходных токенов для промптов объёмом до 100 000 токенов, с контекстным окном на 1 млн токенов и регулятором усилий от Low до Max. В тот же день, без отдельного поста о запуске, чтение из кэша промптов в Claude Sonnet 5.5 подешевело с $0.20 до $0.10 за миллион токенов. Одно из этого — продукт, а другое — строка в прайс-листе, и именно эта строка принесёт больше денег в этом квартале.
Сначала цена — потому что именно на неё можно повлиять уже сегодня. Потом усилие — то, что тихо определяет цену. А затем — сокращение кэша, о котором половина тех, кто платит за Sonnet 5.5, узнает только при получении следующего счёта.
Что такое Claude Haiku 5.5, в порядке значимости
Сам вендор описывает её так: «самая дешёвая, самая быстрая и самая способная малая модель из всех, что мы когда-либо выпускали», а дата выпуска — 7 октября 2026 года, за день до этого брифинга. Идентификатор модели — claude-haiku-5-5. На входе — текст и изображения, на выходе — текст. Окно контекста составляет 1 000 000 токенов против 200 000 у Claude Haiku 4.5, а максимальный объём вывода — 128 000 токенов; бета-заголовок в Batch API повышает этот лимит до 300 000. Дата отсечения обучающих данных — июнь 2026 года, и Anthropic обязуется не выводить модель из эксплуатации до 7 октября 2027 года.
Самое важное для тех, кто маршрутизирует трафик, — это не контекстное окно. А то, что это первая модель класса Haiku с настраиваемым уровнем усилий. Уровень усилий бывает Low, Medium, High, Xhigh и Max, по умолчанию — Medium, а адаптивное мышление включено по умолчанию — функция из Sonnet и Opus, спускающаяся на уровень ниже. В посте о запуске также есть две вещи, которые касаются покупки, а не создания: ежемесячные API-кредиты для тарифов Claude Max и Team — $100 на Max 5x и $200 на Max 20x с объединением до $500 для Team — и бета-поддержка computer-use и browser-use в SDK. Безопасность не отстаёт от этого уровня: меры киберзащиты строже, чем у Claude Haiku 4.5, запросы на пентестирование по-прежнему блокируются, а биологические меры защиты соответствуют тем, что действуют в Claude Sonnet 5, Claude Sonnet 5.5 и Claude Opus 5.

Цена, и обрыв в 100 000 токенов в её середине
Заявленная ставка составляет $0,10 за миллион входных токенов и $0,50 за миллион выходных токенов. Обратите внимание на звёздочку: это ставка для промптов объёмом до 100 000 токенов включительно. Свыше 100 000 оба числа умножаются на пять — до $0,50 за вход и $2,50 за выход. Запись в кэш стоит $0,125 за миллион на пятиминутном тарифе и $0,20 на часовом тарифе в пределах дешёвого диапазона, а чтение из кэша — $0,01 за миллион, то есть десятая часть ставки за вход; это самая глубокая скидка на кэш, которую Anthropic публиковала для любой модели. Batch снова уменьшает всё вдвое: $0,05 и $0,25 в дешёвом диапазоне, $0,25 и $1,25 выше него.
Сравните это с Claude Haiku 4.5, который всё ещё указан в прайс-листе по фиксированной цене $1.00 за входные данные и $5.00 за выходные, без тарификации в зависимости от контекста, с чтением кэша за $0.10 и окном в 200 000 токенов. Новая модель стоит в десять раз дешевле при той же структуре промпта и имеет в пять раз больший контекст. Здесь не нужно проводить миграционные расчёты; цифры несопоставимы.
Обрыв — это то, вокруг чего нужно строить архитектуру. Промпт на 99 000 токенов стоит 99 центов за тысячу вызовов по тарифу за вход. Промпт на 101 000 токенов стоит 5,05 доллара за тысячу. Разница в две тысячи токенов — это счет в 5 раз больше, поэтому всё, что вы строите в дешевом диапазоне, должно либо с запасом оставаться ниже 100 000 токенов, либо намеренно и стабильно превышать этот порог — худший исход — это конвейер, который балансирует на границе и платит высокий тариф за половину своего трафика.
Усилие теперь — параметр ценообразования, и вариант по умолчанию не самый дешёвый
Поскольку параметр effort по умолчанию установлен на Medium, а режим размышления включён по умолчанию, заявленная цена и реальная цена — это не одно и то же число. Токены рассуждений тарифицируются как выходные токены. В опубликованном самим Anthropic прогоне Artificial Analysis Intelligence Index — по данным вендора, не воспроизведённом нами — Claude Haiku 5.5 выдаёт примерно 162 000 токенов на задачу, из которых около 129 000 — это рассуждения. Медианная модель в этом индексе генерирует порядка 100 миллионов токенов по всему набору тестов; Haiku 5.5 расходует 440 миллионов. При цене $0.50 за миллион выходных токенов такая многословность по карману, и в этом-то и суть: при расценках Haiku 5.5 много думать всё равно дешевле, чем думать мало на модели, которая берёт $5.00 за выходные токены.
Установите уровень усилий на Low для классификации, извлечения данных и решений о маршрутизации, когда вам нужен быстрый ответ, а не взвешенный, и оставьте его на Medium для всего, что будет читать пользователь. Понижение до Low — также надёжный способ удержать многословного агента в пределах диапазона в 100 000 токенов, потому что оно сокращает токены рассуждений раньше, чем снижает качество ответа.
Более тихая строка: чтения из кэша Sonnet 5.5 сократились вдвое
Claude Sonnet 5.5 по состоянию на 7 октября читает кэшированный промпт по цене $0,10 за миллион токенов — снижено с $0,20. Цена входных данных Sonnet 5.5 составляет $2,00, а выходных — $10,00, поэтому множитель чтения из кэша 0,05x теперь равен тому же множителю, который есть у Haiku 5.5, применённому к в двадцать раз большей ставке за входные данные. По собственной оценке Anthropic, это снижает стоимость большинства агентных задач примерно на 20%; это утверждение о структуре рабочей нагрузки, а не о бенчмарке: оно справедливо только если большая доля ваших входных данных — это стабильный префикс, который вы заново отправляете на каждом ходу. Если ваши промпты уникальны при каждом вызове, это изменение ничего вам не будет стоить и ничего не сэкономит.
Стоит отметить, что подразумевает это снижение. Anthropic агрессивно устанавливает цены на долгоживущие префиксы для модели среднего уровня ровно в тот момент, когда выпускает очень дешёвую небольшую модель, что воспринимается как аргумент в пользу двухмодельной архитектуры: ветка Sonnet 5.5 с горячим кэшем для работы, требующей суждения, и ветка Haiku 5.5 для объёма, который этого не требует.
Что показывают независимые цифры спустя один день
Artificial Analysis присвоила Claude Haiku 5.5 оценку на следующий день после запуска. Его общий показатель Intelligence Index — 43, а для конфигурации Max-effort сообщается 43,40 — второе место среди 182 моделей в рейтинге. Стоимость одной задачи индекса — 0,21 доллара, сорок шестое место по дешевизне. Смешанная цена при соотношении входных данных, кэшированных входных данных и выходных данных 7:2:1 составляет 0,08 доллара за миллион — именно это число заставляет предыдущее сравнение уровней казаться несправедливым ко всему остальному. Скорость вывода — 243,4 токена в секунду, девятый результат по скорости в рейтинге, при заявленной задержке первого токена около 0,3 секунды и 90%-й скидке на кэш.
Эта цифра в 440 миллионов токенов на выходе — оговорка, привязанная к 43. Оценка реальна и получена независимо; как и многословность. Модель, которая размышляет так много, дешева в пересчёте на токен и не всегда дешева в пересчёте на задачу, и разрыв между этими двумя числами — это то место, где на самом деле живёт решение о маршрутизации.
Для сравнения, собственные опубликованные сравнения Anthropic показывают, что Claude Haiku 5.5 набирает 1620 в GDPval-AA v2.1 против 735 у Claude Haiku 4.5, 72,4% в OSWorld 2.1 против 15,7%, 45,9% в Humanity's Last Exam без инструментов против 10,2% и 39,2% в Terminal-Bench 4.0 против 0,0%. Эти показатели заявлены производителем и получены на выбранных им оценках, поэтому их следует воспринимать как ориентировочные, но направление очевидно — это не небольшое обновление небольшой модели.

Добраться до этих моделей без второго контракта
Claude Haiku 5.5 доступна через собственный API Anthropic, а оттуда — везде, где модели Anthropic перепродаются. В каталоге OrcaRouter линейка Anthropic сегодня выглядит так: anthropic/claude-haiku-4.5, anthropic/claude-sonnet-5.5, anthropic/claude-opus-5.5 и anthropic/claude-fable-5.1 — мы не размещаем Claude Haiku 5.5 у себя, и эта заметка не будет делать вид, что это не так. Что у нас действительно есть — так это уровень выше, и OrcaRouter передаёт цену из прайс-листа провайдера с наценкой 0%, поэтому снижение цены за чтение из кэша для Sonnet 5.5 появилось в наших ценах в тот же день, когда его ввела Anthropic, а не в рамках планового цикла пересмотра цен.
Практическая версия: если вы хотите попробовать Haiku 5.5 на этапе классификации, пока ваш этап суждения остаётся на Claude Sonnet 5.5, у вас на руках два ключа вместо одного, и именно на слое маршрутизации решается A/B. В этом весь аргумент в пользу шлюза вместо прямой интеграции — одна конечная точка, строки моделей и путь переключения при сбое, когда у провайдера перебои.

Что смотреть отсюда
Три вещи. Начнут ли сторонние провайдеры перепродавать Haiku 5.5 по смешанной ставке ниже $0,10 — это тот порог, на котором слой маршрутизации начинает оправдывать своё существование, а не просто упрощать закупки. Расширит ли Anthropic границу уровня в 100 000 токенов, поскольку обрыв ровно на 100 000 — странное место для модели с окном в 1 млн токенов. И снизится ли показатель многословности в 440 миллионов токенов в рамках точечного релиза, потому что именно это единственное число отделяет Haiku 5.5 от того, чтобы стать очевидным выбором по умолчанию для всей нижней половины продакшн-стека.
