Карточка героя статьи с надписью «OpenAI o3 против DeepSeek V4 Pro», бейджем «СРАВНЕНИЕ МОДЕЛЕЙ» и подзаголовком «Эпоха премиального мышления заканчивается там, где начинается ценовой разрыв», слева — иконка премиум-ярлыка, справа — иконка монет, внизу справа — логотип OrcaRouter.
Guides & Insights

OpenAI o3 против DeepSeek V4 Pro: Эра премиального мышления заканчивается там, где начинается ценовой разрыв

Автор

Magnus Corvin

Дата публикации

Новые модели · 20Все модели
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Противостояние Ope​nAI o3 и DeepSeek V4 Pro — это действительно столкновение двух чисел. Ope​nAI o3, выпущенная 16 апреля 2025 года, была эталоном премиального рассуждения — модель, за которую вы доплачивали, когда цена неверного ответа превышала стоимость токенов. DeepSeek V4 Pro, ставшая общедоступной (GA) в сборке 0813 13 августа 2026 года после тихого вечернего релиза и раскатки, включавшей отозванный анонс и перезалитые веса, — это модель, которая сделала эту премию похожей на категориальную ошибку: независимый индекс, стоящий выше, чем у o3, примерно за пятую часть цены, и вдобавок с открытыми весами. И у этого столкновения есть временная метка: Ope​nAI o3 покидает ChatGPT 26 августа 2026 года, её API-снимки последуют 11 декабря, и каждая неделя сравнения — в пользу модели, которая никуда не денется.

Две модели, выпущенные с разницей в год, отличаются по своей философии.

o3 — флагман чистого рассуждения: закрытая модель, обученная подолгу думать перед ответом, с окном контекста 200K токенов, выходом до 100K токенов и приёмом изображений, встроенным в цепочку рассуждений. По собственным данным OpenAI, она задала планку на 2025 год: 96,7% на AIME 2024, 87,7% на GPQA Diamond, 69,1% на SWE-bench Verified без скаффолдинга и 2727 Elo на Codeforces. Позже OpenAI снизила её цену с $10/$40 до $2/$8 за миллион токенов — на этом уровне она и остаётся. DeepSeek V4 Pro — это совершенно другая экономика: модель на основе смеси экспертов с 1,6 триллиона параметров, из которых на каждый токен активны около 49 миллиардов, окно контекста в 1 млн токенов, максимум 384K токенов на выходе, ввод только текста и — впервые в GA-сборке 0813 — пересобранный стек постобучения и нативная интеграция Responses-API и Codex, которая подняла её агентные показатели на DeepSWE с 12,8 в превью до 62,7. Кроме того, у неё открытые веса: чекпойнт DeepSeek-V4-Pro-0813 доступен для загрузки на Hugging Face под лицензией MIT — после хаотичных первых суток, когда сняли баннер релиза, веса ненадолго отдавали 404, а затем модель перевыложили с исправленной конфигурацией.

Разрыв в стоимости в реальных цифрах

Тарифные карты в основном сами говорят за себя:

• OpenAI o3 — $2,00 за миллион входных токенов, $8,00 за миллион выходных токенов, $0,50 за миллион кэшированных входных токенов. Токены рассуждений тарифицируются как выходные, поэтому сложный вопрос сжигает токены размышления до ответа.

• DeepSeek V4 Pro — $0.435 за миллион входных токенов (промах кэша), $0.003625 при попадании в кэш, $0.87 за миллион выходных токенов сегодня. Выход примерно в 4,6 раза дешевле, чем у o3, вход при попадании в кэш практически бесплатен.

• Оговорка с датой — запланированное DeepSeek повышение цен 17 августа поднимает стоимость вывода V4 Pro с 6 юаней до 27 юаней за миллион токенов в пиковые часы (13,5 в непиковые) и стоимость ввода при промахе кэша с 3 до 9 юаней. Даже по новой пиковой ставке вывод составляет небольшую долю от $8 у o3. Окно для создания с привязкой к сегодняшней ставке измеряется днями, что само по себе является частью миграционных расчётов.

{{1}}Экономика в расчёте на правильный ответ делает этот тезис ещё острее.{{/1}} {{2}}Скрытые токены рассуждений o3 означают, что реальная стоимость одного сложного ответа в несколько раз превышает его тариф на вывод.{{/2}} {{3}}DeepSeek V4 Pro тоже рассуждает, и его размышления также тарифицируются как вывод,{{/3}} {{4}}но при $0,87 абсолютные затраты — это погрешность округления в сравнении с сессией o3, которая размышляет полторы минуты.{{/4}} {{5}}Подход к оценке затрат на агентов, применённый DeepSeek при запуске, — разрыв в цене за задачу примерно в 45 раз по сравнению с закрытым фронтиром — преувеличивает разрыв именно применительно к o3,{{/5}} {{6}}но само направление не вызывает сомнений: разница в эффективной стоимости составляет 4–10× в зависимости от нагрузки.{{/6}}

Где на самом деле находится разрыв в качестве

Самый важный показатель — независимый. В индексе Intelligence Index от Artificial Analysis DeepSeek V4 Pro набирает 53 очка и занимает 2-е место из 104 моделей, которые этот индекс в настоящее время перечисляет; o3 находится около 30 — разрыв более чем в 20 пунктов на одном и том же стенде. Это самое краткое и наглядное резюме того, куда два года прогресса привели флагманскую модель премиум-класса для рассуждений: её больше не просто демпингуют по цене; её превосходят по независимому сводному показателю.

Картина по отдельным бенчмаркам более запутанная и требует честных ярлыков. Главные агентные показатели DeepSeek V4 Pro — Terminal-Bench 2.1 с результатом 87,9, CyberGym — 83,3, DeepSWE — 62,7, AutomationBench — впереди закрытого фронтира — это собственные заявленные данные DeepSeek с релиза 0813, которые на момент написания этого текста никем независимо не воспроизведены, а эпизод с неверной конфигурацией при развёртывании означает, что никто не может быть уверен, что API отдавал финальные исправленные веса, когда собирались ранние сторонние цифры. Бенчмарки o3 с момента запуска — тоже данные, заявленные вендором, но они были частично подтверждены независимыми повторными тестами ещё в 2025 году, когда o3 действительно возглавлял рейтинги по рассуждениям. В математике и чистых рассуждениях опубликованные результаты o3 по-прежнему выглядят лучше, чем у DeepSeek V4 Pro, — сильные стороны DeepSeek — это агентное использование инструментов, программирование и задачи с длинным горизонтом, то есть другой набор тестов по сравнению с математическими олимпиадами, в которых доминировал o3.

A two-column scoreboard for OpenAI o3 vs DeepSeek V4 Pro: left column o3 shows $2/$8 pricing, 200K context, closed weights, Artificial Analysis Index around 30, math-and-reasoning strength, retiring August 26 2026; right column DeepSeek V4 Pro shows $0.44/$0.87 pricing today, 1M context, MIT open weights, Artificial Analysis Index 53 (#2 of 104), agentic-and-coding strength, GA August 13 2026. Footer: o3 figures partly independent; DeepSeek agent benchmarks vendor-reported. OrcaRouter logo bottom-right.

Что o3 по-прежнему умеет лучше

Две вещи остаются неизменными при этом сравнении. {{1}}Во-первых, математика и тщательные рассуждения: результаты o3 — 96,7% на AIME и 87,7% на GPQA — остаются выше всего, что опубликовал DeepSeek V4 Pro, и если ваша задача — сложное доказательство или олимпиадная задача, o3, пока он ещё работает, — более безопасный выбор.{{/1}} {{2}}Во-вторых, рассуждения над изображениями: o3 может обдумывать скриншот или диаграмму внутри своей цепочки рассуждений, а DeepSeek V4 Pro — только текст; сборка 0813 не добавила визуальный энкодер, и если вашей задаче нужно, чтобы модель читала изображение, DeepSeek V4 Pro в этом отношении не заменит o3.{{/2}} Ни одно из этих преимуществ не является причиной оставаться на устаревающей модели, но оба — повод честно признать, что миграция — не чистое обновление.

Ещё одна вещь, которую стоит отметить, — это разница в открытых весах, что вообще не является бенчмарком. o3 был закрытым и сейчас постепенно выводится из эксплуатации; вы не сможете запускать его на собственном оборудовании. Контрольная точка 0813 DeepSeek V4 Pro — ваша навсегда, под лицензией MIT: те же веса, та же модель с 1,6 триллиона параметров, которую можно разместить у себя, если у вас есть около 1,5 терабайта оборудования для неё. Для команд, которые обожглись, полагаясь на закрытую модель, которую вендор может снять с эксплуатации, это структурный ответ на ту самую проблему, которую создаёт вывод o3 из эксплуатации.

Перенос рабочей нагрузки

Для команды API, переходящей с o3, DeepSeek V4 Pro — это самое дешёвое место для приземления, и на агентных и кодинг-задачах, которые на самом деле составляют большую часть использования API, это редко является ухудшением. Настоящие подводные камни — операционные, а не качественные: V4 Pro ограничен 500 одновременными запросами в официальном API, и этого потолка вы достигнете с парком агентов, а его цены изменятся 17 августа. Обе эти проблемы — именно то, для чего нужен слой маршрутизации.

На OrcaRouter DeepSeek V4 Pro доступен по цене провайдера с нулевой наценкой — поэтому сегодняшние $0,44/$0,87 доступны здесь в тот же день, что и в DeepSeek, а когда 17 августа вступит в силу график пиковых и непиковых цен, он тоже отразится здесь в тот же день. Один ключ также открывает доступ к остальной части этой когорты замены o3, а автоматическое переключение при сбое — это чистое решение ограничения в 500 одновременных запросов: направьте продакшн-маршрут на V4 Pro плюс вторую модель на том же ключе, и роутер поглотит потолок. Сам Ope​nAI o3 на этом ключе недоступен — он остаётся доступным через собственный API Ope​nAI и несколько сторонних платформ до прекращения поддержки снимка 11 декабря.

Screenshot of the Artificial Analysis model page for o3 showing its rank of #107/182 on the Intelligence Index, a score of 31 (below the median of 35), a 200K-token context window, $2.00 per 1M input and $8.00 per 1M output pricing, and a 118 tokens-per-second speed reading.

Кому математика благоволит

Для тех, чья нагрузка на o3 — это написание кода, агентные циклы или обработка длинного контекста, тут даже считать нечего: DeepSeek V4 Pro превосходит o3 по независимому индексу, стоит в разы дешевле, а его открытые веса означают, что эту зависимость не выдернут у вас из-под ног. Команды, у которых сейчас есть реальная причина сохранять o3, работают в узких нишах — сложные чисто математические рассуждения и всё, что построено на мышлении o3 по изображениям, — и даже им следует тестировать замены на реальных нагрузках до декабря, потому что дедлайну нет дела до вашего частного случая. Эпоха премиального мышления, которую определил o3, завершилась с объявлением о его выводе из эксплуатации; DeepSeek V4 Pro просто оказался самым дешёвым местом в следующей эпохе.

Screenshot of the OrcaRouter model page for deepseek/deepseek-v4-pro showing a 1M-token context window, 384K max output, $0.44 per 1M input and $0.88 per 1M output tokens, and Tools/JSON/Reasoning capability chips.

Сравнение в этой статье2

Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно

© 2026 OrcaRouter

Провайдерам

Управляете инференс-платформой? Разместите свои модели на OrcaRouter.

providers@orcarouter.ai

Присоединяйтесь к сообществу

Discordsupport@orcarouter.aiXGitHubYouTube