
OpenAI o3 против DeepSeek V4 Pro: Эра премиального мышления заканчивается там, где начинается ценовой разрыв
- DeepSeekНОВИНКАDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 за 1 млн токенов
- z-aiНОВИНКАZ.ai: GLM 5.32026-08-1860Интеллект75Кодинг
- obsidianНОВИНКАQwen3.8 27B2026-08-1552Интеллект68Кодинг
- qwenНОВИНКАQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekНОВИНКАDeepSeek: DeepSeek V4 Pro 08132026-08-1253Интеллект69Кодинг
- grokНОВИНКАSpaceXAI: Grok 4.62026-08-1261Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0557Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0358Интеллект72Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Интеллект78Кодинг
- googleGoogle: Gemini 3.6 Flash2026-07-2152Интеллект69Кодинг
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Интеллект49Кодинг
- metaMeta: Muse Spark 1.12026-07-1653Интеллект71Кодинг
- kimiMoonshotAI: Kimi K32026-07-1560Интеллект76Кодинг
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Интеллект71Кодинг
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Интеллект77Кодинг
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Интеллект77Кодинг
Противостояние OpenAI o3 и DeepSeek V4 Pro — это действительно столкновение двух чисел. OpenAI o3, выпущенная 16 апреля 2025 года, была эталоном премиального рассуждения — модель, за которую вы доплачивали, когда цена неверного ответа превышала стоимость токенов. DeepSeek V4 Pro, ставшая общедоступной (GA) в сборке 0813 13 августа 2026 года после тихого вечернего релиза и раскатки, включавшей отозванный анонс и перезалитые веса, — это модель, которая сделала эту премию похожей на категориальную ошибку: независимый индекс, стоящий выше, чем у o3, примерно за пятую часть цены, и вдобавок с открытыми весами. И у этого столкновения есть временная метка: OpenAI o3 покидает ChatGPT 26 августа 2026 года, её API-снимки последуют 11 декабря, и каждая неделя сравнения — в пользу модели, которая никуда не денется.
Две модели, выпущенные с разницей в год, отличаются по своей философии.
o3 — флагман чистого рассуждения: закрытая модель, обученная подолгу думать перед ответом, с окном контекста 200K токенов, выходом до 100K токенов и приёмом изображений, встроенным в цепочку рассуждений. По собственным данным OpenAI, она задала планку на 2025 год: 96,7% на AIME 2024, 87,7% на GPQA Diamond, 69,1% на SWE-bench Verified без скаффолдинга и 2727 Elo на Codeforces. Позже OpenAI снизила её цену с $10/$40 до $2/$8 за миллион токенов — на этом уровне она и остаётся. DeepSeek V4 Pro — это совершенно другая экономика: модель на основе смеси экспертов с 1,6 триллиона параметров, из которых на каждый токен активны около 49 миллиардов, окно контекста в 1 млн токенов, максимум 384K токенов на выходе, ввод только текста и — впервые в GA-сборке 0813 — пересобранный стек постобучения и нативная интеграция Responses-API и Codex, которая подняла её агентные показатели на DeepSWE с 12,8 в превью до 62,7. Кроме того, у неё открытые веса: чекпойнт DeepSeek-V4-Pro-0813 доступен для загрузки на Hugging Face под лицензией MIT — после хаотичных первых суток, когда сняли баннер релиза, веса ненадолго отдавали 404, а затем модель перевыложили с исправленной конфигурацией.
Разрыв в стоимости в реальных цифрах
Тарифные карты в основном сами говорят за себя:
• OpenAI o3 — $2,00 за миллион входных токенов, $8,00 за миллион выходных токенов, $0,50 за миллион кэшированных входных токенов. Токены рассуждений тарифицируются как выходные, поэтому сложный вопрос сжигает токены размышления до ответа.
• DeepSeek V4 Pro — $0.435 за миллион входных токенов (промах кэша), $0.003625 при попадании в кэш, $0.87 за миллион выходных токенов сегодня. Выход примерно в 4,6 раза дешевле, чем у o3, вход при попадании в кэш практически бесплатен.
• Оговорка с датой — запланированное DeepSeek повышение цен 17 августа поднимает стоимость вывода V4 Pro с 6 юаней до 27 юаней за миллион токенов в пиковые часы (13,5 в непиковые) и стоимость ввода при промахе кэша с 3 до 9 юаней. Даже по новой пиковой ставке вывод составляет небольшую долю от $8 у o3. Окно для создания с привязкой к сегодняшней ставке измеряется днями, что само по себе является частью миграционных расчётов.
{{1}}Экономика в расчёте на правильный ответ делает этот тезис ещё острее.{{/1}} {{2}}Скрытые токены рассуждений o3 означают, что реальная стоимость одного сложного ответа в несколько раз превышает его тариф на вывод.{{/2}} {{3}}DeepSeek V4 Pro тоже рассуждает, и его размышления также тарифицируются как вывод,{{/3}} {{4}}но при $0,87 абсолютные затраты — это погрешность округления в сравнении с сессией o3, которая размышляет полторы минуты.{{/4}} {{5}}Подход к оценке затрат на агентов, применённый DeepSeek при запуске, — разрыв в цене за задачу примерно в 45 раз по сравнению с закрытым фронтиром — преувеличивает разрыв именно применительно к o3,{{/5}} {{6}}но само направление не вызывает сомнений: разница в эффективной стоимости составляет 4–10× в зависимости от нагрузки.{{/6}}
Где на самом деле находится разрыв в качестве
Самый важный показатель — независимый. В индексе Intelligence Index от Artificial Analysis DeepSeek V4 Pro набирает 53 очка и занимает 2-е место из 104 моделей, которые этот индекс в настоящее время перечисляет; o3 находится около 30 — разрыв более чем в 20 пунктов на одном и том же стенде. Это самое краткое и наглядное резюме того, куда два года прогресса привели флагманскую модель премиум-класса для рассуждений: её больше не просто демпингуют по цене; её превосходят по независимому сводному показателю.
Картина по отдельным бенчмаркам более запутанная и требует честных ярлыков. Главные агентные показатели DeepSeek V4 Pro — Terminal-Bench 2.1 с результатом 87,9, CyberGym — 83,3, DeepSWE — 62,7, AutomationBench — впереди закрытого фронтира — это собственные заявленные данные DeepSeek с релиза 0813, которые на момент написания этого текста никем независимо не воспроизведены, а эпизод с неверной конфигурацией при развёртывании означает, что никто не может быть уверен, что API отдавал финальные исправленные веса, когда собирались ранние сторонние цифры. Бенчмарки o3 с момента запуска — тоже данные, заявленные вендором, но они были частично подтверждены независимыми повторными тестами ещё в 2025 году, когда o3 действительно возглавлял рейтинги по рассуждениям. В математике и чистых рассуждениях опубликованные результаты o3 по-прежнему выглядят лучше, чем у DeepSeek V4 Pro, — сильные стороны DeepSeek — это агентное использование инструментов, программирование и задачи с длинным горизонтом, то есть другой набор тестов по сравнению с математическими олимпиадами, в которых доминировал o3.

Что o3 по-прежнему умеет лучше
Две вещи остаются неизменными при этом сравнении. {{1}}Во-первых, математика и тщательные рассуждения: результаты o3 — 96,7% на AIME и 87,7% на GPQA — остаются выше всего, что опубликовал DeepSeek V4 Pro, и если ваша задача — сложное доказательство или олимпиадная задача, o3, пока он ещё работает, — более безопасный выбор.{{/1}} {{2}}Во-вторых, рассуждения над изображениями: o3 может обдумывать скриншот или диаграмму внутри своей цепочки рассуждений, а DeepSeek V4 Pro — только текст; сборка 0813 не добавила визуальный энкодер, и если вашей задаче нужно, чтобы модель читала изображение, DeepSeek V4 Pro в этом отношении не заменит o3.{{/2}} Ни одно из этих преимуществ не является причиной оставаться на устаревающей модели, но оба — повод честно признать, что миграция — не чистое обновление.
Ещё одна вещь, которую стоит отметить, — это разница в открытых весах, что вообще не является бенчмарком. o3 был закрытым и сейчас постепенно выводится из эксплуатации; вы не сможете запускать его на собственном оборудовании. Контрольная точка 0813 DeepSeek V4 Pro — ваша навсегда, под лицензией MIT: те же веса, та же модель с 1,6 триллиона параметров, которую можно разместить у себя, если у вас есть около 1,5 терабайта оборудования для неё. Для команд, которые обожглись, полагаясь на закрытую модель, которую вендор может снять с эксплуатации, это структурный ответ на ту самую проблему, которую создаёт вывод o3 из эксплуатации.
Перенос рабочей нагрузки
Для команды API, переходящей с o3, DeepSeek V4 Pro — это самое дешёвое место для приземления, и на агентных и кодинг-задачах, которые на самом деле составляют большую часть использования API, это редко является ухудшением. Настоящие подводные камни — операционные, а не качественные: V4 Pro ограничен 500 одновременными запросами в официальном API, и этого потолка вы достигнете с парком агентов, а его цены изменятся 17 августа. Обе эти проблемы — именно то, для чего нужен слой маршрутизации.
На OrcaRouter DeepSeek V4 Pro доступен по цене провайдера с нулевой наценкой — поэтому сегодняшние $0,44/$0,87 доступны здесь в тот же день, что и в DeepSeek, а когда 17 августа вступит в силу график пиковых и непиковых цен, он тоже отразится здесь в тот же день. Один ключ также открывает доступ к остальной части этой когорты замены o3, а автоматическое переключение при сбое — это чистое решение ограничения в 500 одновременных запросов: направьте продакшн-маршрут на V4 Pro плюс вторую модель на том же ключе, и роутер поглотит потолок. Сам OpenAI o3 на этом ключе недоступен — он остаётся доступным через собственный API OpenAI и несколько сторонних платформ до прекращения поддержки снимка 11 декабря.

Кому математика благоволит
Для тех, чья нагрузка на o3 — это написание кода, агентные циклы или обработка длинного контекста, тут даже считать нечего: DeepSeek V4 Pro превосходит o3 по независимому индексу, стоит в разы дешевле, а его открытые веса означают, что эту зависимость не выдернут у вас из-под ног. Команды, у которых сейчас есть реальная причина сохранять o3, работают в узких нишах — сложные чисто математические рассуждения и всё, что построено на мышлении o3 по изображениям, — и даже им следует тестировать замены на реальных нагрузках до декабря, потому что дедлайну нет дела до вашего частного случая. Эпоха премиального мышления, которую определил o3, завершилась с объявлением о его выводе из эксплуатации; DeepSeek V4 Pro просто оказался самым дешёвым местом в следующей эпохе.

Сравнение в этой статье2
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
