Сгенерирована титульная карточка hero для Claude Sonnet 5.5 против DeepSeek V4 Pro с подзаголовком «Двадцать индексных пунктов и чтение из кэша за $0.022», где показаны $2.00 и $10.00 за миллион токенов против $0.66 и $1.98, а логотип OrcaRouter скомпонован в правом нижнем углу.
Guides & Insights

Claude Sonnet 5.5 против DeepSeek V4 Pro: 20 индексных пунктов и чтение кэша за $0.022

Автор

Magnus Corvin

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Поставьте две тарифные карты рядом — и сравнение выглядит предрешённым ещё до начала. Claude Sonnet 5.5, общедоступный с 28 сентября 2026 года, стоит $2,00 за миллион входных токенов и $10,00 за миллион выходных токенов. DeepSeek V4 Pro, выпущенный 24 апреля 2026 года, стоит $0,66 и $1,98. В агентной работе решает строка выходных токенов, и $10,00 против $1,98 — это разрыв пять к одному: доллар против двадцати центов за сто тысяч токенов. Затем взгляните на сторону возможностей, где Artificial Analysis ставит Claude Sonnet 5.5 на 56 баллов по Intelligence Index v4.3, а DeepSeek V4 Pro — на 36: разрыв в двадцать пунктов на одном и том же тестовом стенде. В этом и заключается всё напряжение: модель DeepSeek находится на отметке в одну пятую от цены выходных токенов и примерно в две трети от измеренной способности, и эти два факта не складываются в одну рекомендацию, если не знать, что именно ваша рабочая нагрузка делает с токеном.

Что именно представляет собой каждая модель

Именование — первое, где это сравнение идёт не так, поэтому исправим это здесь. DeepSeek V4 Pro, как мы его указываем, — это deepseek/deepseek-v4-pro, выпущенная 24 апреля 2026 года модель с контекстом 1 048 576 токенов, максимальным выводом 384 000 токенов и вводом только текста. Artificial Analysis отслеживает снимок, который обозначает как DeepSeek V4 Pro 0813 — сборка от 13 августа, — и приведённые ниже цифры взяты из этой строки. На стороне Sonnet — anthropic/claude-sonnet-5.5 от Anthropic: ввод текста, изображений и файлов, контекст 1M, максимальный вывод 128K. Если вы сравниваете страницу поставщика со страницей оценщика и числа не сходятся, проверьте суффикс сборки, прежде чем делать вывод, что одно из них неверно.

DeepSeek V4 Pro поддерживает только текстовый ввод. Claude Sonnet 5.5 также принимает изображения и файлы. Это первое структурное различие, и оно вовсе не маргинальное: любой конвейер, который обрабатывает скриншоты, PDF или диаграммы, не может просто заменить одно на другое, потому что одно из них не способно видеть.

Тарифная карта, строка за строкой

• Ввод — $0,66 за миллион для DeepSeek V4 Pro против $2,00 за Claude Sonnet 5.5; DeepSeek дешевле на 67%

• Вывод — $1.98 за миллион против $10.00; DeepSeek дешевле на 80%, это самый большой единичный разрыв в этом сравнении

• Чтение кэша — $0,022 за миллион против $0,20; DeepSeek дешевле на 89% по строке, которая доминирует в длинных агентных циклах

• Запись в кэш — $2,50 за миллион для пятиминутного окна в Claude Sonnet 5.5; в строке каталога DeepSeek V4 Pro нет отдельной строки для записи в кэш

• Контекст — 1 048 576 токенов против 1 000 000; DeepSeek немного длиннее — различие, не имеющее практических последствий.

• Максимальный объём вывода — 384 000 токенов против 128 000; DeepSeek выигрывает в три раза по потолку, который ограничивает массовую генерацию

• Модальность ввода — только текст в сравнении с текстом, изображением и файлом

• Reasoning — оба используют настраиваемый уровень усилий для рассуждений, а не фиксированный бюджет размышлений, поэтому глубина является параметром запроса у каждого из них

На стороне DeepSeek есть деталь планирования, которую скроет сравнение тарифных карт. В нашей строке каталога указано окно тарифов по времени: с 01:00 до 04:00 UTC и снова с 06:00 до 10:00 UTC указанные тарифы умножаются на два. В эти часы V4 Pro стоит $1,32 за вход и $3,96 за выход — всё ещё дешевле Claude Sonnet 5.5, на 34% и 60% соответственно, но уже не с тем отрывом, который предполагают заголовочные цифры. Пакетные рабочие нагрузки, которые можно запланировать, стоит планировать, а те, которые нельзя, стоит оценивать по пиковому тарифу, а не по среднему. Это также из тех вещей, которые проявляются, только если читать каталог, а не маркетинговую страницу; и это аргумент за то, чтобы разместить все модели-кандидаты за одним эндпоинтом вместо трёх вендорских аккаунтов.

Два показателя возможностей, один из которых не является независимым

Что касается сторонних оценок, рейтинг однозначен. Artificial Analysis присваивает Claude Sonnet 5.5 56 баллов, а DeepSeek V4 Pro — 36 баллов в Intelligence Index v4.3, причём обе модели оценивались в конфигурации рассуждений с максимальными усилиями. Тот же оценщик ставит Claude Opus 5 на 51, а Gemini 3.1 Pro Preview — на 30, так что 36 баллов V4 Pro помещают его ниже предыдущего флагмана Anthropic и выше уровня Pro от Google — достойная позиция для модели, цена которой составляет пятую часть, и далеко не вершина.

Инверсия стоимости на задачу наблюдается и здесь, причём в этом сравнении она направлена в другую сторону, чем в предыдущем. Оценка DeepSeek V4 Pro на наборе индексов стоит $0,67. Claude Sonnet 5.5 — $7,60. Это не опечатка и не артефакт округления: новая модель Anthropic выдаёт 410 млн токенов по всему набору при медиане 88 млн, а многословность модели DeepSeek даже близко не позволяет закрыть ценовой разрыв такого масштаба. На неограниченных открытых задачах более дешёвая модель на практике обходится дешевле на порядок, а не только по прайс-листу.

К цифрам от вендоров нужно относиться более осторожно. DeepSeek публикует показатель τ²-Bench — 96,2 для V4 Pro; это сильная цифра, но она заявлена самим вендором, а τ²-Bench с тех пор был исключён из индекса Artificial Analysis в его редакции v4.3 — таким образом, эту цифру нельзя независимо поставить на ту же шкалу, что и что-либо публикуемое Anthropic. Собственная таблица запуска Anthropic для Claude Sonnet 5.5 тоже содержит свои оговорки, включая сноску о том, что настройка Max effort даёт более низкий результат, чем Xhigh, на FrontierCode, и примечание о том, что два из бенчмарков выполнялись на предрелизном развёртывании с багом структурированных выходов. Поставьте таблицы двух вендоров рядом — и у вас будут два маркетинговых документа, а не рейтинг. Единственные цифры в этой статье, которые принадлежат одной оси, — это два показателя индекса и две стоимости на задачу, потому что все четыре получил один оценщик.

Почему потолок вывода важнее цены

Число в этом сравнении, которое привлекает меньше всего внимания, — это то, которое меняет архитектуру: 384 000 выходных токенов против 128 000.

Потолок вывода — это не функция комфорта. Он решает, будет ли задача одним вызовом или цепочкой. Генерация большого исходного файла, создание полного документа, составление длинного структурированного отчёта, перевод главы книги — всё, где артефакт больше 128 000 токенов, — не может быть выполнено одним вызовом к Claude Sonnet 5.5 и должно быть разложено на последовательность с сохранением состояния между вызовами. Декомпозиция означает больше входных токенов, повторно отправляемых на каждом шаге, больше чтений кэша, больше кода оркестрации и новый класс отказов, где ошибки живут на стыках между фрагментами. Модель в пять раз дороже, которая устраняет целый слой оркестрации, может быть дешевле по инженерным часам, прежде чем станет дешевле по токенам, а с другой стороны, задача, укладывающаяся в один вызов, — это задача, где потолок вообще не входит в арифметику.

Итак, вопрос о потолке первичен по отношению к вопросу о цене. Если ваш самый длинный артефакт не превышает 128 000, пропустите этот раздел и сравнивайте по стоимости за завершённую задачу. Если нет, оценивайте стоимость пайплайна, который вам придётся построить, а не только токенов.

Издержки переключения и проблема запасного варианта

Миграция в любом направлении — это в основном вопрос промптов, а не кода, за одним исключением, на которое стоит заложить бюджет.

Обе модели настраивают рассуждения через параметр усилий, но это параметры разных поставщиков, с разными уровнями и разными значениями по умолчанию. Запрос, настроенный под настройку Anthropic с высоким уровнем усилий, не переносится на настройку усилий DeepSeek как равноценная замена; он переносится как повторное измерение. Ожидайте, что на каждую рабочую нагрузку уйдёт день на восстановление качества, прежде чем вы сможете доверять прогнозу затрат — по обе стороны перехода.

Исключение — зрение. Claude Sonnet 5.5 читает изображения и файлы; DeepSeek V4 Pro читает только текст. Любая часть вашего конвейера, которая передаёт модели скриншот, отсканированную страницу или отрисованный график, не имеет аналога в DeepSeek, поэтому полная миграция доступна только для текстового подмножества вашего трафика. Эту разделительную линию стоит провести на раннем этапе, потому что обычно это означает, что ответ — не одна модель, а разделение.

Оба уже маршрутизируются на OrcaRouter сегодня — deepseek/deepseek-v4-pro и anthropic/claude-sonnet-5 — обе являются действующими позициями каталога, по цене провайдера без наценки, на единых учётных данных. Это особенно важно именно в такого рода сравнении, где решающим фактором является не то, какая модель лучше в абстракции, а то, какому запросу к какой модели следует идти. Разделение, которое направляет объёмную работу только с текстом к дешёвой модели, а работу с визуальными данными — к дорогой, это правило маршрутизации, и его гораздо проще выразить, когда обе конечные точки отвечают на один и тот же ключ и подчиняются одной и той же политике отказоустойчивости. Сам Claude Sonnet 5.5 пока не является маршрутом на нашей платформе, поэтому сегодняшняя версия такого разделения ставит в пару модель Anthropic с DeepSeek V4 Pro, а не заменяет её.

Решение, сформулированное в виде правила

Отправляйте это в Claude Sonnet 5.5, когда задаче нужно видеть — изображения, PDF-файлы, скриншоты, отрендеренный результат — когда артефакт длиннее страницы прозы и вы хотите, чтобы его писала модель переднего края, или когда разрыв в двадцать пунктов по индексу — это разница между черновиком, который человеку приходится переписывать, и тем, который можно выпускать.

Отправляйте это в DeepSeek V4 Pro, когда рабочая нагрузка — текст на входе, текст на выходе, большие объёмы и допустим более низкий потолок качества рассуждений: классификация, извлечение, суммирование, массовая переработка текста, преобразование кода по чёткой спецификации и всё то, за что вы иначе платили бы десять долларов за миллион выходных токенов, чтобы просто переставлять слова. 89%-ная скидка на чтение из кэша делает длинноконтекстные агентные циклы на этой модели структурно дешёвыми так, как ничто другое в этом сравнении.

Честный вердикт: это не гонка за возможностями, которую проигрывает DeepSeek, а решение о распределении ресурсов, которое большинство команд принимает неверно — в сторону покупки возможностей, которыми они не пользуются. Если ваш трафик — текстовый, а ваша планка качества — «достаточно хорошо, чтобы проверить», а не «достаточно хорошо, чтобы отправить, не читая», то V4 Pro при 20% от цены за вывод и $0,022 за чтение из кэша — правильный выбор по умолчанию, а двадцать пунктов индекса — это налог, который вы сейчас добровольно платите.

A two-column scoreboard for Claude Sonnet 5.5 and DeepSeek V4 Pro across eight rows. Left column Claude Sonnet 5.5: input $2.00, output $10.00, cache read $0.20, cache write $2.50 for the five-minute window, 1M context with 128K max output, input modality text, image and file, AA Intelligence Index v4.3 score 56, $7.60 per task on the index run. Right column DeepSeek V4 Pro: input $0.66, output $1.98, cache read $0.022, no separate cache-write line, 1,048,576-token context with 384K max output, input modality text only, AA Intelligence Index v4.3 score 36, $0.67 per task on the index run. The card heading reads "Twenty index points against an 89% cache-read discount", and a footer line notes that a timed-pricing window multiplies the DeepSeek rates by two between 01:00-04:00 and 06:00-10:00 UTC.Screenshot of the OrcaRouter model page for DeepSeek V4 Pro (deepseek/deepseek-v4-pro), showing the model header, the 1,048,576-token context window with 384,000 maximum output tokens, text-only input, the Tools, JSON and Reasoning capability tags with no Vision tag, a 1.86-second p50 time to first token, a "Public benchmarks by DeepSeek · 2026-04-24" line, and the $0.66 input and $1.98 output prices per million tokens.Screenshot of Artificial Analysis's model page for "DeepSeek V4 Pro 0813 (Reasoning, Max Effort)", marked an open-weights model and released August 2026, showing In $1.32 and Out $3.96 with a 97% cache discount, the Intelligence Index score of 36, an output rate of 96.6 tokens per second, the $0.67 average cost per task, and 160M output tokens described as somewhat verbose against a median of 140M.

Сравнение в этой статье3

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно