「Qwen 4 Max vs DeepSeek V4 Pro」のヒーロータイトルカード。サブタイトルは「950億のアクティブパラメータ対490億」、3つのピル型バッジは「$2.00と$6.00」、「$0.66と$1.98」、「25分の1 対 33分の1」、フッター行は「Alibabaは2026年9月22日に発表、DeepSeekは2026年4月24日に上場」、右下隅にOrcaRouterのロゴ。
Engineering & Research

Qwen 4 Max 対 DeepSeek V4 Pro:950億のアクティブパラメータ 対 490億

著者

Gideon Frost

公開日

最新モデル · 20すべてのモデルを見る
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

2026年9月22日のYunqiカンファレンスでのQwen 4 Maxの発表は、業界に名前と階層構造だけを与え、それ以外は何も与えなかった——重みも、価格も、コンテキストウィンドウも、日付もない。DeepSeek V4 Proは2026年4月24日以降、1.6兆パラメータのMixture-of-Expertsとして、トークンあたり490億パラメータがアクティブ、100万トークンのコンテキスト、オフピーク価格が入力100万トークンあたり0.66ドル、出力100万トークンあたり1.98ドルとして掲載されている。並べて比較する価値があるのは、総パラメータ数ではなくアクティブ数だ。最後に公開されたQwen3.8-Maxはトークンあたり950億パラメータをアクティブ化し、これはDeepSeek V4 Proが実行する490億のアクティブパラメータの約2倍であり、ベンチマークを一つも参照する前に、その一つの数字だけで両ラボ間の3倍の価格差の大部分を説明できる。

スパース性に対する2つの異なる賭け

両ラボはスパースなMixture-of-Expertsモデルを構築している。どれほどスパースにすべきかについて、両者の意見は鋭く対立している。Qwen3.8-Max — 出荷中のQwenフラッグシップであり、Qwen 4 Maxがどのような姿になるかを知る唯一の具体的なベースライン — は、2.4兆パラメータのモデルで、トークンあたり950億パラメータを活性化する。比率はおよそ25分の1。DeepSeek V4 Proは1.6兆パラメータのモデルで、490億を活性化し、比率はおよそ33分の1であり、エキスパートの重みをFP4で保存し、アテンション、ルーター、ノルムの各層はFP8のままにしているため、トークンあたりの計算量はさらに下がる。

それらはチューニングの違いではない。同じ問いに対する2つの異なる答えだ——フロンティアモデルがトークンあたり何を費やすべきか:

• 総パラメータ数 — Qwen 3.8 フラッグシップ 2.4T 対 DeepSeek V4 Pro 1.6T

• トークンあたりのアクティブ — Qwen 3.8 flagship 95B 対 DeepSeek V4 Pro 49B

• アクティベーション率 — 約25分の1 対 約33分の1

• 入力価格、オフピーク時 — Qwen3.8-Max 1Mあたり$2.00 対 DeepSeek V4 Pro 1Mあたり$0.66

• 出力価格、オフピーク時 — Qwen3.8-Max 100万あたり$6.00 対 DeepSeek V4 Pro 100万あたり$1.98

• フラッグシップモデルの重み — カスタムQwenライセンスの下で提供されるQwen 3.8フラッグシップに対し、MITで公開されたDeepSeek V4 Pro

• コンテキスト — Qwen3.8-Max 100万トークン 対 DeepSeek V4 Pro 100万トークン

• モダリティ — Qwen3.8-Maxはテキスト、画像、動画入力に対し、DeepSeek V4 Proは掲載内容上テキストのみ

• 観測されたレイテンシ — 同一カタログにおいて、Qwen3.8-Max の p50 初回トークン到達時間は 3.29 秒、DeepSeek V4 Pro は 3.52 秒

今回、スパース性の差と価格の差は同じ方向を指しており、それは総パラメータ数が示唆する方向ではない。QwenはDeepSeekの約2倍のパラメータをトークンごとに活性化し、約3倍の料金を請求しており、スパース性だけではその差は埋まらない。残りを埋めるのはモダリティだ。Qwenのフラッグシップは視覚と動画のエンコーダを搭載しており、画像が含まれているかどうかに関わらず、すべてのリクエストでそのコストがかかる。だから入力単価がその水準になっている。DeepSeek V4 Proはテキストを受け取りテキストを返し、それだけを行うモデルのように価格設定されている。

DeepSeekの列には、何かに使う前に1つ但し書きを付けておく必要がある。DeepSeekはピーク・オフピーク制で価格を設定しており、$0.66と$1.98という数値はオフピーク料金で、ピーク時間帯 — 平日のUTC 01:00〜04:00および06:00〜10:00(中国の祝日を除く) — には、同じモデルが入力$1.32、出力$3.96で課金される。それ以外はすべて、週末と祝日を含めオフピークである。したがって支払う料金はトラフィックがいつ実行されるかによって決まり、オフピークの数値だけに基づいて作られたコストモデルは、平日朝の要素を含むあらゆるワークロードで誤りとなる。

A two-column scoreboard titled "Qwen 4 Max vs DeepSeek V4 Pro - the scoreboard". Left column Qwen 4 Max: Total parameters 2.4T, Active per token 95B, Input price off-peak $2.00 per 1M tokens, Output price off-peak $6.00 per 1M tokens, Context window 1M tokens, Modality text, image, video in. Right column DeepSeek V4 Pro: Total parameters 1.6T, Active per token 49B, Input price off-peak $0.66 per 1M tokens, Output price off-peak $1.98 per 1M tokens, Context window 1M tokens, Modality text-only. Footer reading "DeepSeek V4 Pro figures from its catalogue listing; Qwen figures from the Qwen3.8-Max model card, September 22 2026.", with the OrcaRouter logo bottom-right.

Qwen 4 Maxの欄は空欄であり、それは一時的な状態ではない

比較を、Qwen 4 Max は Qwen 3.8 の数値付近に着地し、価格はそれを下回るだろうという想定で埋めてしまいたくなる。だが、それに抗え。Alibaba は Qwen 4 アーキテクチャを新世代だと説明し、訓練中だと述べた。そのアーキテクチャを説明する唯一の公開成果物は、2026年8月下旬にオープンソース化され、自身のモデルカードで Qwen 4 設計のプレビューと記された Qwen3.8-Flash-Next である。これは1250億パラメータのメインモデルで、510億パラメータの N-gram 埋め込みを持ち、1ステップあたり約60億が活性化し、QSA スパースアテンション、ゲート付き残差、そして100万トークンに向けて拡張可能な262,000トークンのネイティブコンテキストを備える。

その設計がMaxティアまでスケールするなら、アクティブなパラメータ数は数百億の範囲にとどまるはずで、DeepSeekの総パラメータ数へ向かって増えていくべきではない——総パラメータが増えてもステップあたりの計算量をほぼ一定に保つことが、QSAと、密に計算されるのではなく参照されるN-gram埋め込みの狙いそのものである。これは仕様ではなく方向性であり、仕様として印刷されるべきではない。

いま分かっているのは、運用上の非対称性だ。存在するモデルはあなたのワークロードで測定できるが、存在しないモデルは何によっても測定できない。Qwen 4 Max は、出荷されれば、ベンダー自身の API と複数のサードパーティプラットフォームを通じて到達可能になる——Alibaba のすべてのフラッグシップがたどってきたのと同じ経路だ。現時点では OrcaRouter にはない。カタログには Qwen 4 ファミリーの項目がゼロ件しかない。DeepSeek V4 Pro は今 OrcaRouter にあり、その日付付きスナップショットも同様だ。

再現性は、誰も口にしない論点だ

DeepSeekは日付付きスナップショットを提供し、それらをアドレス可能な状態に保っている。カタログには、変動する DeepSeek V4 Pro 識別子と、固定された 2026-08-13 版の両方が含まれている——この日付は、DeepSeek 自身が一般提供リリースとして指定したビルドである。これは地味だが、評価ハーネスやコンプライアンス管理下のパイプラインを運用する誰かにとっては、ベンチマークの差分よりも重要だ。スナップショットを固定すれば、あなたの回帰テストスイートはベンダーのリリース頻度ではなく、あなたのコードを測定していることになる。

Qwen 3.8 世代も同じことをした — 同じカタログ上に、流動的な名前と並んで日付付きの Qwen3.8-Max スナップショットが存在する — そして Alibaba がやめると思う理由はない。しかしそれは出荷済みモデルの特性であり、はっきり言っておく価値がある。Qwen 4 Max が発表されるその日には、固定できるスナップショットも、テスト対象にできる安定した識別子も、自分のデータで前後比較を実行する方法も存在しない。どんな比較をしたいにせよ、それは後になってからすることになる。

A screenshot of the OrcaRouter model page for DeepSeek V4 Pro (deepseek/deepseek-v4-pro, English UI), showing the FLAGSHIP badge, the 1M token context badge, the model ID deepseek/deepseek-v4-pro, a 384K maximum output, text input, the Tools, JSON and Reasoning tags, the listing date 2026-04-24 credited to DeepSeek, a p50 time-to-first-token of 3.52s, the OpenAI-compatible code samples against api.orcarouter.ai/v1, and the opening of the model description describing a 1.6T total / 49B active flagship MoE with 1M context and top-tier reasoning and agentic tool use.

2つのスタックを動かさずに両方を動かす

OrcaRouterはDeepSeek V4 Proをdeepseek/deepseek-v4-proとしてルーティングします。100万トークンあたり入力$0.66、出力$1.98で、これはDeepSeek自身のオフピーク時の定価を0%のマークアップでそのまま通したものです。この最後の点は、このバッチの他のどこよりもここでこそ価値があります。というのも、出力$1.98はすでにフロンティアティアのモデルとしては下限に近く、たとえ10%のプラットフォームマージンであっても、このモデルとミッドティアの代替モデルとの差の5分の1に相当してしまうからです。そして0%のマークアップでは、ページに表示される料金はDeepSeekが公表している料金そのものです。ピーク時とオフピーク時の区分も含まれ、それは均一な料金に平均化されるのではなく、同じスケジュールでそのまま適用されます。

同じエンドポイントがQwen 3.8ファミリーを提供しています — Qwen3.8-Max、Qwen3.8-Flash、Qwen3.8-27B — が、DeepSeek V4 Proと並び、約200のモデルを擁する単一のOpenAI互換APIで利用できます。プロバイダーの経路が劣化した際の自動フェイルオーバー、そして選択をハードコーディングするのではなく明示的に行うためのルーティングDSLも備わっています。DeepSeekが料金を引き下げれば、その変更は当日中にあなたのキーに反映されます。値下げが途中でせき止められるようなマージン層が存在しないからです。Qwen 4のティアが登場したとき、それが現れるのも同じカタログです。

これがあなたをどういう立場に置くのか

DeepSeek V4 Proはこの比較で不戦勝し、それを取り繕うのではなく、なぜそうなのかを正確に述べる価値がある。コストは両方の軸で約3分の1で、1トークンあたり5倍のパラメータを活性化し、コンテキストウィンドウは同等で、固定できる日付付きスナップショットもある。Qwen 4 Maxにはティア名とカンファレンス枠があるだけだ。

実際に進行中の比較は、DeepSeek V4 Pro 対 Qwen3.8-Max であり、それは一方的な敗北ではなく、本当のトレードオフだ。DeepSeek はテキスト専用モデルで、価格はおよそ3分の1、重みは MIT のもとで公開され、トークンあたりのアクティベーション特性もより軽量であり、Qwen のフラッグシップは画像と動画の入力を受け付け、それぞれ2.00ドルと6.00ドルだ。判断すべきはモダリティと、完了したタスクあたりの実測コストであり、パラメータ数ではない。そしてアリババがモデルカードを公開したら、比較をやり直すべきだ。その時点で興味深い問いは、Qwen 4 Max がそのマルチモーダル能力を、DeepSeek のテキスト料金を上回る価格に、今日よりも小さい上乗せ幅で設定するかどうかだろう。

A screenshot of the OrcaRouter model page for Qwen3.8 Max (qwen/qwen3.8-max, English UI), showing the 1M token context badge, the model ID qwen/qwen3.8-max, text plus image plus video input with text output, the Vision, Tools, JSON, Reasoning and Thinking capability tags, the listing date 2026-08-03, a p50 time-to-first-token of 3.29s, and the model description naming Qwen3.8-Max Alibaba's newest flagship and highest-capability tier to date.

この記事で比較したモデル4

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新