
Qwen 4 Max против DeepSeek V4 Pro: 95 миллиардов активных параметров против 49 миллиардов
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 за 1 млн токенов
- orcaНОВИНКАOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов
- deepseekНОВИНКАDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- openaiOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- googleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- anthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Интеллект69Кодинг
- grokSpaceXAI: Grok 4.62026-08-1244Интеллект77Кодинг
- metaMeta: Muse Spark 1.22026-08-0540Интеллект72Кодинг
- qwenQwen: Qwen3.8 Max2026-08-0345Интеллект76Кодинг
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Интеллект69Кодинг
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 за 1 млн токенов
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Анонс Qwen 4 Max на конференции Юньци 22 сентября 2026 года дал отрасли только название и структуру уровней — и ничего больше: ни весов, ни цены, ни контекстного окна, ни даты. DeepSeek V4 Pro числится с 24 апреля 2026 года как смесь экспертов на 1,6 триллиона параметров с 49 миллиардами активных параметров на токен, контекстом в 1 миллион токенов и ценой в непиковые часы $0,66 за миллион входных токенов и $1,98 за миллион выходных токенов. Число, которое стоит сопоставить, — это не общее количество параметров, а количество активных: последний опубликованный Qwen3.8-Max активирует 95 миллиардов параметров на токен, примерно вдвое больше 49 миллиардов активных параметров, которые использует DeepSeek V4 Pro, и эта одна цифра объясняет большую часть трёхкратного разрыва в цене между двумя лабораториями ещё до того, как будет рассмотрен хотя бы один бенчмарк.
Две разные ставки на разреженность
Обе лаборатории создают разреженные модели смеси экспертов. Они резко расходятся во мнениях о том, насколько разреженными должны быть. Qwen3.8-Max — поставляемый флагман Qwen и единственный конкретный ориентир для того, как будет выглядеть Qwen 4 Max — это модель с 2,4 триллиона параметров, которая активирует 95 миллиардов параметров на токен, что составляет примерно одну часть из двадцати пяти. DeepSeek V4 Pro — это модель с 1,6 триллиона параметров, которая активирует 49 миллиардов, что составляет примерно одну часть из тридцати трёх, и она хранит веса экспертов в FP4, оставляя слои внимания, маршрутизатора и нормализации в FP8, что ещё больше снижает вычисления на токен.
Это не различия в настройке. Это два разных ответа на один и тот же вопрос — сколько передовая модель должна тратить на токен:
• Всего параметров — флагман Qwen 3.8 на 2,4 трлн против DeepSeek V4 Pro на 1,6 трлн
• Активных на токен — флагман Qwen 3.8 95B против DeepSeek V4 Pro 49B
• Коэффициент активации — примерно 1 из 25 против примерно 1 из 33
• Цена ввода, вне пиковых часов — Qwen3.8-Max $2.00 за 1M против DeepSeek V4 Pro $0.66 за 1M
• Цена вывода, вне пиковых часов — Qwen3.8-Max $6.00 за 1 млн против DeepSeek V4 Pro $1.98 за 1 млн
• Флагманские веса — флагман Qwen 3.8 под специальной лицензией Qwen против DeepSeek V4 Pro, выпущенного под лицензией MIT
• Контекст — Qwen3.8-Max 1M токенов против DeepSeek V4 Pro 1M токенов
• Модальность — ввод текста, изображений и видео у Qwen3.8-Max против только текста у DeepSeek V4 Pro согласно его описанию
• Наблюдаемая задержка — p50 времени до первого токена у Qwen3.8-Max 3,29 с против 3,52 с у DeepSeek V4 Pro на том же каталоге
На этот раз разница в разреженности и разница в цене указывают в одном направлении, и это не то направление, на которое намекает общее число параметров. Qwen активирует примерно вдвое больше параметров на токен, чем DeepSeek, и взимает примерно втрое больше, а одна лишь разреженность этот разрыв не закрывает. Остальное закрывает модальность: флагман Qwen оснащён визуальными и видеоэнкодерами, за них платят при каждом запросе — есть в нём изображение или нет, — и именно поэтому ставка за ввод такая, какая она есть. DeepSeek V4 Pro принимает текст и возвращает текст, и цена у него как у модели, которая делает только это.
Одну оговорку следует добавить в столбец DeepSeek, прежде чем использовать его для чего-либо. DeepSeek устанавливает цены по схеме с пиковыми и непиковыми периодами: значения $0,66 и $1,98 — это непиковые ставки, а в пиковые окна — с 01:00 до 04:00 и с 06:00 до 10:00 UTC по будням, за исключением китайских государственных праздников, — та же модель тарифицируется по $1,32 за входные данные и $3,96 за выходные данные. Всё остальное, включая все выходные и праздники, относится к непиковому периоду. Таким образом, тариф, который вы платите, зависит от того, когда идёт ваш трафик, а модель затрат, построенная только на непиковом значении, будет неверной для любой рабочей нагрузки с компонентом, приходящимся на утро буднего дня.

Столбец Qwen 4 Max пуст, и это не временное состояние.
Заманчиво дополнить сравнение предположением, что Qwen 4 Max окажется близко к показателям Qwen 3.8 и будет стоить ниже них. Не поддавайтесь этому. Alibaba описала архитектуру Qwen 4 как новое поколение и заявила, что она находится в процессе обучения; единственный выпущенный артефакт, описывающий эту архитектуру, — это Qwen3.8-Flash-Next, открытый в конце августа 2026 года и помеченный в своей собственной карточке модели как предварительная версия дизайна Qwen 4. Это основная модель на 125 миллиардов параметров с 51 миллиардом параметров N-граммных эмбеддингов, из которых активируется около 6 миллиардов на каждом шаге, с разреженным вниманием QSA, стробированными остаточными связями и нативным контекстом в 262 000 токенов, расширяемым до 1 миллиона.
Если эта архитектура масштабируется до уровня Max, число активных параметров должно оставаться в пределах десятков миллиардов, а не приближаться к общему объёму DeepSeek — сохранение примерно постоянных вычислений на шаг при росте общего числа параметров и есть весь смысл QSA и N-граммных эмбеддингов, которые извлекаются по таблице, а не вычисляются плотно. Это направление, а не спецификация, и его не следует печатать как спецификацию.
Что известно на данный момент — это операционная асимметрия. Существующую модель можно измерить на вашей рабочей нагрузке; несуществующую модель нельзя измерить ни на чём. Qwen 4 Max будет доступен, когда выйдет, через собственный API производителя и несколько сторонних платформ — тот же путь, которым прошёл каждый флагман Alibaba. Сегодня его нет на OrcaRouter: в каталоге ноль записей для семейства Qwen 4. DeepSeek V4 Pro уже есть на OrcaRouter, как и его устаревший снимок.
Воспроизводимость — это аргумент, который никто не приводит.
DeepSeek выпускает датированные снэпшоты и сохраняет к ним адресуемый доступ. В каталоге есть как плавающий идентификатор DeepSeek V4 Pro, так и закреплённый вариант от 2026-08-13 — причём эта дата соответствует сборке, которую сама DeepSeek обозначила как релиз с общей доступностью. Это не выглядит эффектно, но для тех, кто запускает стенд для оценки или конвейер с контролем соответствия, это важнее разницы в бенчмарках: когда вы закрепляете снэпшот, ваш набор регрессионных тестов измеряет ваш код, а не график релизов вендора.
Поколение Qwen 3.8 поступило так же — в том же каталоге рядом с плавающим названием есть датированный снимок Qwen3.8-Max — и нет причин думать, что Alibaba остановится. Но это свойство выпущенных моделей, и стоит прямо сказать: в день анонса Qwen 4 Max не будет ни снимка, который можно закрепить, ни стабильного идентификатора для тестирования, ни способа провести сравнение «до и после» на собственных данных. Какое бы сравнение вы ни захотели сделать, делать его придётся позже.

Запуск обоих без запуска двух стеков
OrcaRouter маршрутизирует DeepSeek V4 Pro как deepseek/deepseek-v4-pro по цене $0,66 за вход и $1,98 за выход за миллион токенов, что является собственной ценой DeepSeek по прайс-листу в непиковые часы, передаваемой с наценкой 0%. Эта последняя деталь здесь значит больше, чем где-либо ещё в этой подборке, потому что $1,98 за выход уже близко к минимальному уровню для модели передового класса: даже десятипроцентная маржа платформы составила бы пятую часть разницы между этой моделью и альтернативой среднего уровня, а при наценке 0% тариф, который вы видите на странице, — это тариф, публикуемый DeepSeek, включая разделение на пиковые и непиковые часы, которое передаётся по тому же графику, а не усредняется в единый тариф.
Тот же эндпоинт обслуживает семейство Qwen 3.8 — Qwen3.8-Max, Qwen3.8-Flash и Qwen3.8-27B — рядом с DeepSeek V4 Pro в одном OpenAI-совместимом API с почти 200 моделями, с автоматическим переключением при сбое, когда маршрут провайдера деградирует, и DSL маршрутизации, позволяющим задавать выбор явно, а не жёстко прописывать его в коде. Если DeepSeek снизит тариф, изменение отразится на вашем ключе в тот же день, потому что нет слоя наценки, за которым снижение могло бы застрять. Когда выйдет уровень Qwen 4, он появится в том же каталоге.
Что это значит для вас
DeepSeek V4 Pro побеждает в этом сравнении из-за неявки соперника, и стоит точно объяснить почему, а не приукрашивать. Он дешевле по обеим осям примерно в три раза, активирует в пять раз больше параметров на токен, его контекстное окно совпадает, и у него есть датированный снапшот, который можно закрепить. У Qwen 4 Max есть название уровня и слот на конференции.
Сравнение, которое реально актуально сейчас, — это DeepSeek V4 Pro против Qwen3.8-Max, и это настоящий компромиссный выбор, а не разгром: DeepSeek — текстов-only модель примерно за треть цены, с весами, опубликованными под MIT, и более экономным профилем активации на токен, а флагман Qwen принимает изображения и видео по цене $2.00 и $6.00. Выбирайте по модальности и по измеренной стоимости за завершённую задачу, а не по числу параметров, и повторите сравнение, когда Alibaba опубликует карточку модели — и тогда интересный вопрос будет в том, будет ли Qwen 4 Max оценивать свои мультимодальные возможности выше текстового тарифа DeepSeek на меньшую величину, чем сегодня.

Сравнение в этой статье4
Определено по этой статье · Бенчмарки: Artificial Analysis · обновляется ежедневно
