Сгенерированная hero-карточка под названием «Claude Haiku 5.5 против DeepSeek V4.1 Flash» с надзаголовком «ДВЕ МОДЕЛИ, ДВЕ ИДЕИ О ДЕШЕВИЗНЕ», показывающая Claude Haiku 5.5 со стоимостью ввода $0.10, стоимостью вывода $0.50 и индексом 43.40 против DeepSeek V4.1 Flash со стоимостью ввода $0.30, стоимостью вывода $1.20 и индексом 39.46, над полосой с надписью «Стоимость за завершённую задачу $0.21 против $0.27».
Engineering & Research

Claude Haiku 5.5 против DeepSeek V4.1 Flash: более дешёвый ценник — не значит более дешёвая модель

Автор

Gideon Frost

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

По тарифной сетке это даже не рядом. Claude Haiku 5.5, которую вендор выпустил 7 октября 2026 года, указана по цене $0.10 за миллион входных токенов и $0.50 за миллион выходных токенов. DeepSeek V4.1 Flash, выпущенная 10 сентября 2026 года, указана по цене $0.30 и $1.20 на независимой площадке или $0.15 и $0.60 по собственной карте непиковых тарифов вендора. По обоим тарифам вендор в два–три раза дешевле, и это первый случай, когда модель класса Haiku оказалась дешевле тарифа DeepSeek Flash.

Тогда вы измеряете, сколько стоит завершённая задача, и разрыв схлопывается. В том же прогоне оценки одна задача Intelligence Index стоит $0,21 на Claude Haiku 5.5 и $0,27 на DeepSeek V4.1 Flash — преимущество в 20%, а не в 200%. Причина на той же странице: модель Claude Haiku 5.5 сгенерировала 162 164 выходных токенов на задачу против 88 574 у DeepSeek. Вы платите меньше за токен и покупаете почти вдвое больше токенов.

Эта инверсия и есть всё сравнение, а всё ниже — рассуждение о том, на какую её сторону попадёт ваша рабочая нагрузка.

Обе тарифные карты, как написано

В расчёте на миллион токенов в долларах США. Показатели Anthropic взяты из собственной документации Anthropic по ценам; показатели DeepSeek — со страницы Model & Pricing DeepSeek, которая является авторитетным источником для её структуры пиковых и непиковых тарифов. Независимые измерения — Artificial Analysis Intelligence Index v4.3.2, данные считаны 2026-10-10.

A generated two-column scoreboard titled 'Claude Haiku 5.5 vs DeepSeek V4.1 Flash — the scoreboard' with rows Index v4.3.2 43.40 against 39.46, cost per task $0.21 against $0.27, output tokens per task 162,164 against 88,574, Terminal Bench 4.0 0.3283 against 0.2677, AutomationBench 0.3541 against 0.6889 and open weights 'no' against 'yes, MIT', footed 'All figures per Artificial Analysis Intelligence Index v4.3.2; prices per vendor documentation.'

• Ввод — Claude Haiku 5.5: $0.10 до 100 000 токенов и $0.50 сверх этого. DeepSeek V4.1 Flash — $0.30 фиксированно на карточке табло или $0.15 в непиковые окна DeepSeek.

• Вывод — Claude Haiku 5.5: $0.50 до 100 000 токенов и $2.50 свыше. DeepSeek V4.1 Flash: $1.20 фиксированно, или $0.60 в непиковые часы.

• Кэшированный ввод — Claude Haiku 5.5: $0.01 ниже 100 000 токенов и $0.05 выше, скидка 90%. DeepSeek V4.1 Flash — $0.006, скидка 98%. Это единственный показатель, по которому карточка DeepSeek дешевле в абсолютном выражении, и она дешевле в большей мере, чем ожидают люди.

• Ценообразование в зависимости от времени суток — у Anthropic такого нет. DeepSeek удваивает оба тарифа в период с 01:00 до 04:00 и ещё раз с 06:00 до 10:00 UTC по будням, за исключением официальных праздников Китая. Все остальные часы, включая все выходные, относятся к непиковому периоду.

• Контекст и потолок вывода — по 1 млн токенов каждый. Claude Haiku 5.5 ограничивает один ответ до 128 000 токенов; DeepSeek V4.1 Flash — до 384 000 токенов.

• Веса — Claude Haiku 5.5 является проприетарной моделью, доступной только через API, id модели claude-haiku-5-5. DeepSeek V4.1 Flash имеет открытые веса под лицензией MIT, 552 млрд общих параметров при 16 млрд активных, доступна на Hugging Face.

• Модальность — обе принимают текст и изображения и возвращают текст. Ни одна из них не является видео-нативной.

• Независимая оценка — 43.40 у Claude Haiku 5.5 (Max) против 39.46 у DeepSeek V4.1 Flash (Max). Разрыв в 3.94 балла в таблице из 182 моделей.

A capture of Anthropic's Claude Platform models documentation showing the Claude model comparison table — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5.5 and Claude Haiku 5.5 'This model', the latter reading 1M context, 128K max output, 'From $0.10/$0.50', latency 'Fastest', default effort medium — above the Claude Haiku 5.5 specifications block with model ids claude-haiku-5-5, the pricing lines $0.10/$0.50 up to 100,000 tokens and $0.50/$2.50 over it, and the release line 'Released October 7, 2026'.

Почему показатель на задачу лучше показателя на токен

Цены из прайс-листа указываются за токен, потому что именно токены тарифицируются. Они плохо показывают, во сколько обойдётся рабочая нагрузка, потому что модель рассуждений решает, сколько токенов нужно для задачи, а две модели здесь расходятся в 1,8 раза.

Claude Haiku 5.5 выдаёт 162 164 выходных токена на одну задачу Intelligence Index: 129 047 приходится на рассуждения и 33 118 — на ответ. DeepSeek V4.1 Flash выдаёт 88 574: 62 670 на рассуждения и 25 904 — на ответ. Обе модели тарифицируют размышления как выход. Так что модель с на 60% более низкой ставкой за выходные токены расходует почти вдвое больше дорогого счётчика, и арифметика сводит их с разницей в шесть центов.

Есть и второй эффект, действующий в ту же сторону. В прогоне по индексу преобладают как входные, так и выходные данные, потому что тестовый стенд повторно отправляет контекст: $0.2128 за задачу у Claude Haiku 5.5 раскладываются на $0.1317 входных данных и $0.0811 выходных, а внутри входных данных $0.0954 приходится на чтение кэша и $0.0337 — на запись в кэш, при всего лишь $0.0026 новых входных данных. $0.2652 у DeepSeek делятся на $0.1589 входных данных и $0.1063 выходных, причём $0.0966 из входных данных — это запись в кэш. Обе модели читают примерно одинаковый объём кэшированного контекста; DeepSeek платит больше за те же чтения и записи.

Собственный пост Anthropic о запуске начинается с похожего предостережения, но с другой стороны. В нём говорится, что Haiku 5.5 «особенно выгоден при использовании для задач с промптами до 100 000 токенов, которые составляют около 90 % запросов к нашей предыдущей модели Haiku». Эта оговорка действительно важна — см. обрыв ниже.

Обрыв на 100 000 токенов — вот настоящая развилка.

Anthropic не устанавливает единую цену на Claude Haiku 5.5. Тарифы $0,10 и $0,50 действуют для промптов объёмом до 100 000 токенов, а затем становятся $0,50 и $2,50 — пятикратный скачок на входе и пятикратный скачок на выходе, применяемый ко всему запросу, а не к превышению.

У DeepSeek структура совершенно другая. Тариф зависит от того, когда вы отправляете промпт, а не от его объёма. Стоимость одного токена для промпта на 150 000 токенов такая же, как для промпта на 500 токенов, но в двух временных окнах по будням цена удваивается.

Прогоните пайплайн с длинным промптом через обе — и сравнение резко перевернётся. При 150 000 входных токенов и 20 000 выходных Claude Haiku 5.5 выставляет $0,125 за вход и $0,05 за выход — $0,175 за вызов, — тогда как DeepSeek в непиковый период выставляет $0,0225 и $0,012, что меньше четырёх центов. То есть DeepSeek выигрывает примерно в 4,5 раза на тех же двух моделях, где в случае с коротким промптом Anthropic выигрывал в три раза.

В абстрактном смысле ни одна из этих структур не лучше другой. Одна рассчитывает цену по тому, сколько вы отправляете, другая — по тому, когда вы отправляете, а в момент запроса под вашим контролем находится только одна из этих двух переменных.

Другой рычаг DeepSeek, который никто не закладывает в цену

Строка кэша заслуживает отдельного рассмотрения, потому что это самый дешёвый счётчик во всём этом сравнении, и именно он растёт с объёмом производства, а не уменьшается.

У DeepSeek тариф за попадание в кэш составляет $0.006 за миллион токенов при заявленной скидке 98% — примерно шестая часть от $0.01 у Anthropic и лишь доля от стоимости свежего ввода с обеих сторон. Всё, что повторно отправляет стабильный префикс — длинный системный запрос, набор извлечённых документов, схема инструмента — платит по этому тарифу на каждом ходу после первого. Приведённый выше прогон индексации уже показывает, насколько велика эта доля: $0.0954 из стоимости ввода на задачу у Claude Haiku 5.5 приходится на чтение из кэша, при всего $0.0026 некешированного ввода.

Так что практическое разделение уже, чем «Anthropic дешевле». Если ваши запросы короткие, одноходовые и с прогретым кэшем, Claude Haiku 5.5 впереди по цене, впереди по возможностям на 3,94 пункта индекса и впереди по сводным агентным строкам. Если ваши запросы длинные, или с большим объёмом префиксов, или их можно планировать на непиковые окна DeepSeek, DeepSeek V4.1 Flash доминирует по стоимости — и с весьма заметным отрывом.

Что вы можете назвать сегодня

Обе модели достижимы, но не симметрично, и об этой асимметрии стоит сказать открыто, а не оставлять вам её обнаруживать.

DeepSeek V4.1 Flash уже в каталоге OrcaRouter, передаётся по прейскурантной цене провайдера с наценкой 0% — а это здесь важнее, чем обычно, потому что тариф DeepSeek имеет пиковую структуру. Мы указываем $0.15 на вход и $0.60 на выход, а также $0.003 за чтение из кэша, и два будних окна удвоения внесены в запись тарификации, поэтому запрос, направленный на плечо DeepSeek, тарифицируется так, как его тарифицирует DeepSeek, а не по усреднённой ставке. Под маршрутом работает автоматическое переключение при сбое, поэтому 429 в пиковом окне или просадка у провайдера переносит вызов, а не приводит к его отказу.

Claude Haiku 5.5 отсутствует в каталоге. Модель Anthropic доступна напрямую через Anthropic и через трёх её облачных партнёров — AWS, Google Cloud и Microsoft Azure, названных в публикации о запуске, — и это единственный честный способ сказать это. А что каталог действительно содержит из линейки Anthropic — так это Claude Sonnet 5.5 и Claude Opus 5.5, что превращает путь эскалации от дешёвого вызова классификации к агентному вызову среднего уровня в настройку маршрутизации, а не во вторую интеграцию.

A capture of the OrcaRouter model page for DeepSeek V4.1 Flash under deepseek/deepseek-v4.1-flash, showing a 1M-token context, a 384K maximum output, text and image input, public benchmarks dated 2026-09-10, a p50 time to first token of 1.74 seconds, and the page's own description of the model as the smallest in DeepSeek's new architecture family, released September 10, 2026.

Какой выбрать?

Если ваш трафик — это классификация, извлечение, решения о маршрутизации, резюмирование и ходы субагентов — короткие промпты, большой объём, среди которых есть изображения — Claude Haiku 5.5 является более подходящей моделью и, при объёме менее 100 000 токенов, более дешёвой. Её показатель на 3,94 пункта индекса выше, она поддерживает изображения, а Anthropic предлагает настраиваемый регулятор усилий, позволяющий пожертвовать частью возможностей ради снижения стоимости за вызов без смены модели.

Если ваш трафик связан с длинными документами, требует интенсивного поиска или вы можете планировать его, DeepSeek V4.1 Flash выигрывает по арифметике: в три-четыре раза дешевле за длинный вызов, ставка кэша в шесть раз ниже, чем у Anthropic, потолок ответа в 384 000 токенов и открытые веса, которые вы можете держать у себя, если модель с оплатой за токен когда-нибудь перестанет вам подходить.

То, что это сравнение на самом деле устанавливает, — это нечто более узкое, чем «Anthropic теперь дешёвый вариант». Оно устанавливает, что небольшая модель Anthropic может по ценнику оказаться дешевле тарифа DeepSeek Flash, а по счёту — в пределах 20% от него, и что разница между этими двумя фактами — это настройка многословности.

Один API для более чем 200 моделей, один ключ, автоматическое переключение при сбое под капотом — так что ошибка 429 в часы пик или просадка у провайдера перебрасывает вызов, а не роняет его.

Сравнение в этой статье1

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно