
Claude Haiku 5.5 против DeepSeek V4.1 Flash: более дешёвый ценник — не значит более дешёвая модель
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 58 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 350 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
По тарифной сетке это даже не рядом. Claude Haiku 5.5, которую вендор выпустил 7 октября 2026 года, указана по цене $0.10 за миллион входных токенов и $0.50 за миллион выходных токенов. DeepSeek V4.1 Flash, выпущенная 10 сентября 2026 года, указана по цене $0.30 и $1.20 на независимой площадке или $0.15 и $0.60 по собственной карте непиковых тарифов вендора. По обоим тарифам вендор в два–три раза дешевле, и это первый случай, когда модель класса Haiku оказалась дешевле тарифа DeepSeek Flash.
Тогда вы измеряете, сколько стоит завершённая задача, и разрыв схлопывается. В том же прогоне оценки одна задача Intelligence Index стоит $0,21 на Claude Haiku 5.5 и $0,27 на DeepSeek V4.1 Flash — преимущество в 20%, а не в 200%. Причина на той же странице: модель Claude Haiku 5.5 сгенерировала 162 164 выходных токенов на задачу против 88 574 у DeepSeek. Вы платите меньше за токен и покупаете почти вдвое больше токенов.
Эта инверсия и есть всё сравнение, а всё ниже — рассуждение о том, на какую её сторону попадёт ваша рабочая нагрузка.
Обе тарифные карты, как написано
В расчёте на миллион токенов в долларах США. Показатели Anthropic взяты из собственной документации Anthropic по ценам; показатели DeepSeek — со страницы Model & Pricing DeepSeek, которая является авторитетным источником для её структуры пиковых и непиковых тарифов. Независимые измерения — Artificial Analysis Intelligence Index v4.3.2, данные считаны 2026-10-10.

• Ввод — Claude Haiku 5.5: $0.10 до 100 000 токенов и $0.50 сверх этого. DeepSeek V4.1 Flash — $0.30 фиксированно на карточке табло или $0.15 в непиковые окна DeepSeek.
• Вывод — Claude Haiku 5.5: $0.50 до 100 000 токенов и $2.50 свыше. DeepSeek V4.1 Flash: $1.20 фиксированно, или $0.60 в непиковые часы.
• Кэшированный ввод — Claude Haiku 5.5: $0.01 ниже 100 000 токенов и $0.05 выше, скидка 90%. DeepSeek V4.1 Flash — $0.006, скидка 98%. Это единственный показатель, по которому карточка DeepSeek дешевле в абсолютном выражении, и она дешевле в большей мере, чем ожидают люди.
• Ценообразование в зависимости от времени суток — у Anthropic такого нет. DeepSeek удваивает оба тарифа в период с 01:00 до 04:00 и ещё раз с 06:00 до 10:00 UTC по будням, за исключением официальных праздников Китая. Все остальные часы, включая все выходные, относятся к непиковому периоду.
• Контекст и потолок вывода — по 1 млн токенов каждый. Claude Haiku 5.5 ограничивает один ответ до 128 000 токенов; DeepSeek V4.1 Flash — до 384 000 токенов.
• Веса — Claude Haiku 5.5 является проприетарной моделью, доступной только через API, id модели claude-haiku-5-5. DeepSeek V4.1 Flash имеет открытые веса под лицензией MIT, 552 млрд общих параметров при 16 млрд активных, доступна на Hugging Face.
• Модальность — обе принимают текст и изображения и возвращают текст. Ни одна из них не является видео-нативной.
• Независимая оценка — 43.40 у Claude Haiku 5.5 (Max) против 39.46 у DeepSeek V4.1 Flash (Max). Разрыв в 3.94 балла в таблице из 182 моделей.

Почему показатель на задачу лучше показателя на токен
Цены из прайс-листа указываются за токен, потому что именно токены тарифицируются. Они плохо показывают, во сколько обойдётся рабочая нагрузка, потому что модель рассуждений решает, сколько токенов нужно для задачи, а две модели здесь расходятся в 1,8 раза.
Claude Haiku 5.5 выдаёт 162 164 выходных токена на одну задачу Intelligence Index: 129 047 приходится на рассуждения и 33 118 — на ответ. DeepSeek V4.1 Flash выдаёт 88 574: 62 670 на рассуждения и 25 904 — на ответ. Обе модели тарифицируют размышления как выход. Так что модель с на 60% более низкой ставкой за выходные токены расходует почти вдвое больше дорогого счётчика, и арифметика сводит их с разницей в шесть центов.
Есть и второй эффект, действующий в ту же сторону. В прогоне по индексу преобладают как входные, так и выходные данные, потому что тестовый стенд повторно отправляет контекст: $0.2128 за задачу у Claude Haiku 5.5 раскладываются на $0.1317 входных данных и $0.0811 выходных, а внутри входных данных $0.0954 приходится на чтение кэша и $0.0337 — на запись в кэш, при всего лишь $0.0026 новых входных данных. $0.2652 у DeepSeek делятся на $0.1589 входных данных и $0.1063 выходных, причём $0.0966 из входных данных — это запись в кэш. Обе модели читают примерно одинаковый объём кэшированного контекста; DeepSeek платит больше за те же чтения и записи.
Собственный пост Anthropic о запуске начинается с похожего предостережения, но с другой стороны. В нём говорится, что Haiku 5.5 «особенно выгоден при использовании для задач с промптами до 100 000 токенов, которые составляют около 90 % запросов к нашей предыдущей модели Haiku». Эта оговорка действительно важна — см. обрыв ниже.
Обрыв на 100 000 токенов — вот настоящая развилка.
Anthropic не устанавливает единую цену на Claude Haiku 5.5. Тарифы $0,10 и $0,50 действуют для промптов объёмом до 100 000 токенов, а затем становятся $0,50 и $2,50 — пятикратный скачок на входе и пятикратный скачок на выходе, применяемый ко всему запросу, а не к превышению.
У DeepSeek структура совершенно другая. Тариф зависит от того, когда вы отправляете промпт, а не от его объёма. Стоимость одного токена для промпта на 150 000 токенов такая же, как для промпта на 500 токенов, но в двух временных окнах по будням цена удваивается.
Прогоните пайплайн с длинным промптом через обе — и сравнение резко перевернётся. При 150 000 входных токенов и 20 000 выходных Claude Haiku 5.5 выставляет $0,125 за вход и $0,05 за выход — $0,175 за вызов, — тогда как DeepSeek в непиковый период выставляет $0,0225 и $0,012, что меньше четырёх центов. То есть DeepSeek выигрывает примерно в 4,5 раза на тех же двух моделях, где в случае с коротким промптом Anthropic выигрывал в три раза.
В абстрактном смысле ни одна из этих структур не лучше другой. Одна рассчитывает цену по тому, сколько вы отправляете, другая — по тому, когда вы отправляете, а в момент запроса под вашим контролем находится только одна из этих двух переменных.
Другой рычаг DeepSeek, который никто не закладывает в цену
Строка кэша заслуживает отдельного рассмотрения, потому что это самый дешёвый счётчик во всём этом сравнении, и именно он растёт с объёмом производства, а не уменьшается.
У DeepSeek тариф за попадание в кэш составляет $0.006 за миллион токенов при заявленной скидке 98% — примерно шестая часть от $0.01 у Anthropic и лишь доля от стоимости свежего ввода с обеих сторон. Всё, что повторно отправляет стабильный префикс — длинный системный запрос, набор извлечённых документов, схема инструмента — платит по этому тарифу на каждом ходу после первого. Приведённый выше прогон индексации уже показывает, насколько велика эта доля: $0.0954 из стоимости ввода на задачу у Claude Haiku 5.5 приходится на чтение из кэша, при всего $0.0026 некешированного ввода.
Так что практическое разделение уже, чем «Anthropic дешевле». Если ваши запросы короткие, одноходовые и с прогретым кэшем, Claude Haiku 5.5 впереди по цене, впереди по возможностям на 3,94 пункта индекса и впереди по сводным агентным строкам. Если ваши запросы длинные, или с большим объёмом префиксов, или их можно планировать на непиковые окна DeepSeek, DeepSeek V4.1 Flash доминирует по стоимости — и с весьма заметным отрывом.
Что вы можете назвать сегодня
Обе модели достижимы, но не симметрично, и об этой асимметрии стоит сказать открыто, а не оставлять вам её обнаруживать.
DeepSeek V4.1 Flash уже в каталоге OrcaRouter, передаётся по прейскурантной цене провайдера с наценкой 0% — а это здесь важнее, чем обычно, потому что тариф DeepSeek имеет пиковую структуру. Мы указываем $0.15 на вход и $0.60 на выход, а также $0.003 за чтение из кэша, и два будних окна удвоения внесены в запись тарификации, поэтому запрос, направленный на плечо DeepSeek, тарифицируется так, как его тарифицирует DeepSeek, а не по усреднённой ставке. Под маршрутом работает автоматическое переключение при сбое, поэтому 429 в пиковом окне или просадка у провайдера переносит вызов, а не приводит к его отказу.
Claude Haiku 5.5 отсутствует в каталоге. Модель Anthropic доступна напрямую через Anthropic и через трёх её облачных партнёров — AWS, Google Cloud и Microsoft Azure, названных в публикации о запуске, — и это единственный честный способ сказать это. А что каталог действительно содержит из линейки Anthropic — так это Claude Sonnet 5.5 и Claude Opus 5.5, что превращает путь эскалации от дешёвого вызова классификации к агентному вызову среднего уровня в настройку маршрутизации, а не во вторую интеграцию.

Какой выбрать?
Если ваш трафик — это классификация, извлечение, решения о маршрутизации, резюмирование и ходы субагентов — короткие промпты, большой объём, среди которых есть изображения — Claude Haiku 5.5 является более подходящей моделью и, при объёме менее 100 000 токенов, более дешёвой. Её показатель на 3,94 пункта индекса выше, она поддерживает изображения, а Anthropic предлагает настраиваемый регулятор усилий, позволяющий пожертвовать частью возможностей ради снижения стоимости за вызов без смены модели.
Если ваш трафик связан с длинными документами, требует интенсивного поиска или вы можете планировать его, DeepSeek V4.1 Flash выигрывает по арифметике: в три-четыре раза дешевле за длинный вызов, ставка кэша в шесть раз ниже, чем у Anthropic, потолок ответа в 384 000 токенов и открытые веса, которые вы можете держать у себя, если модель с оплатой за токен когда-нибудь перестанет вам подходить.
То, что это сравнение на самом деле устанавливает, — это нечто более узкое, чем «Anthropic теперь дешёвый вариант». Оно устанавливает, что небольшая модель Anthropic может по ценнику оказаться дешевле тарифа DeepSeek Flash, а по счёту — в пределах 20% от него, и что разница между этими двумя фактами — это настройка многословности.
Один API для более чем 200 моделей, один ключ, автоматическое переключение при сбое под капотом — так что ошибка 429 в часы пик или просадка у провайдера перебрасывает вызов, а не роняет его.
Сравнение в этой статье1
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
