
Claude Haiku 5.5 был нацелен на бюджетный сегмент Китая. Лишь половина этого утверждения выдерживает проверку.
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 60 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 356 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
Читатель, пишущий на китайском, на этой неделе привёл острый аргумент: Claude Haiku 5.5 выглядит созданным, чтобы завоевать средний сегмент китайского рынка, потому что он обходит DeepSeek V4.1 Flash и GLM 5.3 Flash по цене и набирает больше баллов, чем GLM 5.3 Flash, в Terminal Bench 4.0 и индексе Artificial Analysis Intelligence Index. Это более проницательное прочтение, чем большинство комментариев к запуску. Это также два утверждения под одним пальто, и они не содержат одинаковой доли правды.
Anthropic выпустила Claude Haiku 5.5 7 октября 2026 года — полноценный публичный запуск с датированным анонсом, системной картой и опубликованной тарифной сеткой. Это даёт утверждению то, что редко достаётся рыночным комментариям из вторых рук: цифры, которые можно проверить.
Приведённый ниже аудит обнаруживает, что одна половина сильнее, чем говорил читатель, а другая половина ошибается в конкретном бенчмарке, на который она ссылается. Оба вывода стоит знать, потому что они указывают в противоположных направлениях.
Утверждение, сформулированное точно
В разобранном виде аргумент состоит из трёх частей.
• Цена — Claude Haiku 5.5 дешевле, чем DeepSeek V4.1 Flash, и дешевле, чем GLM 5.3 Flash.
• Независимая оценка — она примерно на балл выше GLM 5.3 Flash в Artificial Analysis Intelligence Index.
• Бенчмарк по программированию — он также набирает на один балл больше, чем GLM 5.3 Flash, в Terminal Bench 4.0.
Два из них можно проверить по опубликованным таблицам, и они подтверждаются — с поправками. Третье можно проверить по той же таблице, и результат отличается от описанного.

Ценовая составляющая: верна, причём в одном направлении занижена, в другом — завышена.
Опубликованный тариф Anthropic для Claude Haiku 5.5 составляет $0,10 за миллион входных токенов и $0,50 за миллион выходных токенов при длине запроса до 100 000 токенов, а при превышении этого порога повышается до $0,50 и $2,50. Чтение кэшированного ввода — $0,01, запись — $0,125. Контекстное окно — один миллион токенов; максимальный объём вывода — 128 000.
GLM 5.3 Flash от Z.ai указан по цене $0.15 и $0.50, кэшированный ввод — $0.026. DeepSeek V4.1 Flash указан по цене $0.30 и $1.20, кэшированный ввод — $0.006.
Что касается заявленного тарифа, читатель прав. Ставка за вход $0,10 на треть ниже, чем у GLM 5.3 Flash, и на две трети ниже, чем у DeepSeek V4.1 Flash, а ставка за выход $0,50 в точности совпадает с GLM 5.3 Flash и при этом составляет значительно менее половины от ставки DeepSeek. Это выглядит как намеренная посадка: сравняться с более дешёвым конкурентом по выходу, обойти его по входу и позволить соотношению говорить самому за себя.
А вот где утверждение выглядит лучше — это измеренная стоимость за выполненную задачу. В Intelligence Index v4.3.2 от Artificial Analysis стоимость всей работы составляет $0,21 для Claude Haiku 5.5, $0,25 для GLM 5.3 Flash и $0,27 для DeepSeek V4.1 Flash. В тарифной сетке указано, что Claude Haiku 5.5 в 1,5 раза дешевле GLM 5.3 Flash по входу; измерение показывает, что выполненная задача обходится примерно на шестую часть дешевле. Всё ещё самый дешёвый из трёх — просто не с тем отрывом, который подразумевает ценник.
Именно эту причину упускает большинство сравнений цен. Claude Haiku 5.5 отличается многословностью. Artificial Analysis зафиксировала для неё 162 164 токена, тогда как Index — 68 000 для GLM 5. Flash и 88 574 для DeepSeek V4.1 Flash. Собственная документация Anthropic добавляет второй эффект: модель использует новый токенизатор, общий с Claude 4.7 и более поздними версиями, поэтому тот же текст даёт примерно на 30% больше токенов, чем на модели, которую она заменяет. Более дешёвая ставка, применённая к большему числу токенов, — это более дешёвая ставка, применённая к большему числу токенов.
Одна загвоздка, которая проявляется только в счёте при маршрутизации: в нашем собственном каталоге DeepSeek V4.1 Flash указан по цене $0.15 за вход и $0.60 за выход с множителем 2×, применяемым в течение двух ежедневных окон — 01:00–04:00 и 06:00–10:00 UTC. Восемнадцать часов в сутки это базовая ставка; шесть часов в сутки ставка за выход составляет $1.20. Пакетный трафик, который можно запланировать вне этих окон, получает существенно более выгодную цену DeepSeek, чем предполагает заявленная прайс-листовая ставка поставщика, а интерактивный трафик — нет. Если вы моделируете это сравнение всерьёз, календарь имеет не меньшее значение, чем тарифная сетка.

Половина счёта: «примерно одно очко» — 1,6.
В индексе Artificial Analysis Intelligence Index v4.3.2 Claude Haiku 5.5 в конфигурации Max оценивается в 43,40. GLM 5.3 Flash оценивается в 41,81. DeepSeek V4.1 Flash находится на отметке 39,46.
Итак, та половина утверждения, что касается индекса, по направлению верна и округляется вниз: разрыв составляет 1,59 пункта, а не один. Это реальное преимущество по индексу, который заходит в шестидесятые, и именно это число цитируется в каждом обзоре этого противостояния.
Но это не утверждение о лежащих в основе бенчмарках. Оба поставщика публикуют свои собственные наборы для оценки, и это не одни и те же наборы — Anthropic сообщает о GDPval-AA v2.1, OSWorld 2.1, Terminal-Bench 4.0 и FrontierCode для Claude Haiku 5.5; Z.ai сообщает о своем собственном наборе для GLM 5.3 Flash. Независимое табло — единственная доступная строка для сравнения «яблок с яблоками», именно поэтому на разрыв в индексе так сильно опираются и почему следующий раздел имеет значение.
Часть с программированием: здесь абсолютная ничья, а не победа.
Terminal Bench 4.0 по общему независимому измерению показывает 0,32828 для Claude Haiku 5.5 и 0,32828 для GLM 5.3 Flash. Идентично до пяти знаков после запятой.
Это самое цитируемое число в этом сравнении, и утверждение о нём неверно. Вероятный источник путаницы — соседняя строка: полноразмерный GLM-5.3, не-Flash-собрат, набирает 0.4192 в том же бенчмарке. Если вы видели «GLM» и «Terminal Bench» в одном предложении рядом с числом на один пункт выше Claude Haiku 5.5, то это собрат, а не Flash.
Остальные три строки, которые Artificial Analysis публикует для обеих моделей, интереснее, чем ничья, и они не указывают в одном направлении:
• SciCode — 0,5498 у Claude Haiku 5.5 против 0,5162 у GLM 5.3 Flash. Преимущество Anthropic — 3,4 пункта.
• Humanity's Last Exam — 0,4439 против 0,3985. Преимущество в 4,5 пункта у Anthropic.
• AutomationBench, частичный результат — 0,3541 против 0,6037. Преимущество в 25 пунктов у GLM 5.3 Flash, и это, безусловно, самый большой разрыв в наборе.
Эта последняя строка — именно та, которая будет важнее всего для команд закупок, потому что агентная автоматизация — это сфера, где модели среднего уровня действительно внедряются. По показателю того, способна ли модель довести многошаговую задачу до завершения, более дешёвая в эксплуатации модель с открытыми весами выигрывает с отрывом, который затмевает разницу в 1,6 пункта по индексу в другую сторону.
Скорость разделяет их так же, как и цена, только ещё заметнее. Artificial Analysis измерила 424,6 секунды на задачу Index для Claude Haiku 5.5 против 1035,4 секунды для GLM 5.3 Flash. Модель Anthropic достигает этого менее чем за половину реального времени, что для агента важнее, чем само число.
Что утверждение полностью упускает
Сравнение подаётся как история о цене и оценке, которая незаметно пропускает измерение, где эти две модели меньше всего похожи. GLM 5.3 Flash — это открытые веса, опубликованные под лицензией MIT, с 320 миллиардами общих параметров и 18 миллиардами активных. DeepSeek V4.1 Flash также имеет открытые веса: 552 миллиарда общих и 16 миллиардов активных. Claude Haiku 5.5 — проприетарная, доступна только через API, без опубликованного количества параметров и без репозитория.
Для многих покупателей это не сноска; это первая строка документа с требованиями. Команда, которой нужно запускать инференс в собственном тенанте, дообучать модель или годами удерживать её версию неизменной, вовсе не выбирает между этими тремя по баллам индексов — два из трёх отсеиваются ещё до того, как будет прочитана колонка с ценой. Формулировка читателя — это наблюдение о рыночном позиционировании, и оно справедливо; просто структурное различие идёт вразрез с моделью, которую эта формулировка защищает.
Самостоятельное выполнение сравнения
GLM 5.3 Flash и DeepSeek V4.1 Flash оба представлены в каталоге OrcaRouter по прейскурантной цене провайдера с наценкой 0%, что делает китайскую сторону этого сравнения тем, что можно вызвать уже сегодня, а не моделировать в электронной таблице. Поскольку тариф передаётся как есть, а не усредняется, изменение цены поставщиком отражается на нашей стороне в тот же день, когда происходит у них, — и описанное выше календарное окно DeepSeek видно в том же блоке цен, по которому вы бы маршрутизировали. Один ключ, один SDK, автоматическое переключение при сбое под капотом, а также DSL маршрутизации, если вы предпочитаете выразить потолок стоимости в маршруте, а не в коде приложения.
Claude Haiku 5.5 отсутствует в нашем каталоге. Он доступен через собственный API Anthropic, и лучше сказать об этом прямо, чем оставлять это подразумеваемым.

Что читатель понял правильно и что с этим делать
Инстинкт верен. Если вы хотели, чтобы волна дешёвых, но способных китайских моделей среднего уровня выглядела дорогой, это примерно та карта, которую вы бы разыграли: сравняться с более дешёвым конкурентом по тарифу за вывод, сделать тариф за ввод вдвое ниже, чем у него, оказаться на 1,6 индексного пункта впереди и позволить показателю цены за завершённую задачу стать решающим доводом. Claude Haiku 5.5 делает именно это — и делает это, будучи более чем вдвое быстрее на задачу, чем модель, на которую он нацелен.
То, в чём читатель ошибся, — это более узкий и более интересный вопрос. Terminal Bench 4.0 — это не победа; это ровно ничья. Ценовое преимущество, если считать оплату за всю работу, а не за токен, составляет примерно одну шестую, а не 1,5×, как предполагает тарифная сетка. А единственный бенчмарк, где две модели расходятся сильнее всего, — агентный: там GLM 5.3 Flash лидирует с отрывом в 25 пунктов.
Итак, честная версия этого утверждения такова: Claude Haiku 5.5 нацелена на китайский сегмент «flash», она выигрывает в этом сравнении по сводному индексу, по стоимости за завершённую задачу и по задержке, но не выигрывает по агентной автоматизации или по открытости, а того конкретного преимущества в кодинг-бенчмарках, которое делало этот аргумент столь убедительным, не существует.
Сравнение в этой статье3
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
