ヒーロータイトルカード:DeepSeek V4.1 Flash vs DeepSeek V4 Pro — 同じベンダー、異なる世代
Guides & Insights

DeepSeek V4.1 Flash 対 DeepSeek V4 Pro:同じベンダー、異なる世代

著者

Magnus Corvin

公開日

最新モデル · 20すべてのモデルを見る
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

DeepSeek V4.1 FlashをDeepSeek V4 Proと比較するうえで興味深いのは、新しいモデルのほうが大きいわけではないという点だ。DeepSeek V4 Proは、490億パラメータがアクティブになる1.6兆パラメータのMixture-of-Expertsモデルであり、今も提供され続けている。DeepSeek V4.1 Flashは、入力時に80億、出力時に160億のパラメータがアクティブになる5520億パラメータのMoEであり、DeepSeekがV4 Proを置き換えるために開発したモデルだ。どちらも同じプロバイダーの料金表に載っており、どちらも100万トークンのコンテキストに対応し、どちらもMITライセンスで提供されている。この2つのどちらを選ぶかは、規模の話ではない。どのアーキテクチャにお金を払いたいかという話であり、その答えは2026年9月10日に変わった。

並べて比べると、実際に何が違うのか

• パラメータ — V4.1 Flash は総パラメータ数552B、入力側のアクティブ数8B、出力側16B。一方、V4 Pro は総パラメータ数1.6T、アクティブ数49B。V4 Pro は総パラメータ数が約3倍、入力側のアクティブ数が6倍です。

• アーキテクチャ — V4.1 FlashはCausal Encoder-Decoderであり、V4 Proの以前の設計とは異なる新しいベースアーキテクチャである。これが両者の本質的な違いであり、「.1」がポイントリリースではない理由である。

• 100万トークンあたりの価格 — V4.1 Flash はオフピーク時 $0.15(入力)/ $0.60(出力)、V4 Pro は $0.66(入力)/ $1.98(出力)(OrcaRouter の掲載価格による)。

• キャッシュ入力 — V4.1 Flash は100万トークンあたり$0.003、V4 Pro は100万トークンあたり$0.024。

• トークンあたりの KV キャッシュ — V4.1 Flash は 890 バイト、V4 Pro はそれより大きなフットプリント。100 万トークンのコンテキストでは、長いエージェントのトランスクリプトを常駐させ続けられるかどうかを決めるのは、まさにこの項目だ。

• コンテキストと出力 — 両方とも1Mコンテキスト、最大384K出力。レベル。

• 最初のトークンまでの実測レイテンシ — OrcaRouterの7日間テレメトリにおいて、V4.1 Flashがp50で2.63秒、V4 Proがp50で3.58秒、V4 Proのp95は10.00秒。

• 入力モダリティ — V4.1 Flash はテキストと画像を受け付けるのに対し、V4 Pro は同じリスティングでテキスト入力・テキスト出力のみです。新しい方のモデルは、入力面では2つの中でより広く、コストもより安いです。

ベンダー側の見方を外してこのリストを読むと、そのパターンは異例だ。後継はすべてのラインで安く、最初のトークンまでの速度が速く、入力でより広く、すべてのラインで小さい。これこそ、本物のアーキテクチャ変更が実現するときの姿であり、ここで「どちらが優れているか」に短い答えがあり、その下に長い答えがある理由でもある。

Two-column scoreboard: DeepSeek V4.1 Flash vs DeepSeek V4 Pro — total parameters 552B vs 1.6T, active parameters 8B input and 16B output vs 49B, architecture Causal Encoder-Decoder vs an earlier design, price per 1M tokens $0.15 input and $0.60 output vs $0.66 and $1.98, max output 384K tokens vs 384K tokens, and release date 2026-09-10 vs still served and not retired

V4 Proのタイムライン。まだそれを使い続けている人にとって重要なのだから

DeepSeek V4 Proは提供終了が予定されていた。APIは2026年9月14日12:00(北京時間)に停止され、トラフィックはV4.1 Flashに転送されることになっていた。しかし、そうはならなかった。9月11日、ベンダーは決定を覆し、次のように述べた。「ユーザーの要望に応え、2026年9月14日以降もDeepSeek V4 ProのAPIサービスを引き続き提供することを決定しました。課金方法は変更ありません。」

そこから二つのことが導かれる。そして、この状況は過剰な読み込みを招きやすいため、どちらについても正確を期す価値がある。

第一に、V4 Proは非推奨ではありません。価格も変わらないサポート対象のモデルであり、DeepSeek自身の通知が既存のV4 Proトラフィックを振り向ける先でもあります。本番の経路をこれに固定していても、何も失われてはいません。

第二に、DeepSeek V4.1 Pro は存在しない。廃止通知は、V4 Pro のトラフィックが V4.1 Flash によって「V4.1-Pro がローンチするまで」処理されることに言及しており、このことが、より大型の兄弟モデルについて一定の憶測を招いている。2026年9月22日時点で、V4.1 Pro の API は存在せず、モデルカードも重みもなく、発表もない。2026年9月21日の報道は、10月中旬から下旬に登場すると見込まれる2兆パラメータモデルを示唆していたが、これは未発表製品に関する単一情報源の主張であり、そのように扱うべきである。V4.1 Pro のローンチを前提にキャパシティを計画している人は、噂を前提に計画していることになる。

実際にどちらに電話すべきか

移行の判断は単純明快で、それはDeepSeek自身がV4 Proのトラフィックを新しいモデルへルーティングして行ったものです。上記の数値を見れば、V4.1 Flashはより安価で、初回トークンまでの時間が短く、定常状態でも速く、トークンあたりのKVキャッシュも小さくなっています。あなたのワークロードがV4 Proのワークロードであり、49Bのアクティブパラメータにしかできないことをしていないのであれば、新しいモデルのほうがコストとレイテンシの面で優れた手段であり、天秤にかけるべきトレードオフはありません。

V4 Pro を使い続けるべき根拠は、はるかに多いアクティブパラメータ数が難しい推論や長期的なエージェント作業でもたらすものにあります。そしてそれは、スペックシートではなく、自社の評価によって示さなければならない主張です。その理由は、この2つのモデルが、両者を切り分ける形で共通の公開ボード上で比較されているわけではないからです。DeepSeek V4.1 Flash は 2026年9月21日の Agents on Rails sweep に maximum effort で 17% として掲載されていますが、V4 Pro はそのボードに載っていません。直接対決の数字として指し示せるものはありません。あるのはアーキテクチャに基づくもっともらしい主張です。アクティブパラメータが6倍であるというのは、手放すにはあまりに大きな能力です。そしてそれは主張であり、測定値ではありません。

それらの間でトラフィックを移す人向けの実用的な注意点が2つあります。第一に、ピーク時間帯のスケジュールは両モデルに適用されるため、誤った時間帯にコスト比較を実行すると2倍の誤差が出ます。ピークは平日の01:00–04:00と06:00–10:00 UTCで、週末は完全にオフピークです。第二に、両モデルはコンテキストウィンドウと出力上限を共有しているため、移行してもプロンプトの予算は変わりません。これにより、アプリケーション側での切り替えは異例なほど低リスクになります。

両方を1つのエンドポイントで実行する

本当に両方が必要なのは移行期間であり、それは聞こえるほど珍しいことではない。V4.1 Flash に移行したいが、新アーキテクチャ上での挙動がまだ検証されていないパイプラインを1つ抱えているチームだ。別々のベンダーを通して両方を並行して動かすことは、モデルレベルでは1つのプロバイダーであるものに対して、2つの契約と2組のキーを意味する。

どちらもOrcaRouter上で単一のキーのもとにあり、それはルーティングの判断に集約されます。OrcaRouterはプロバイダの定価を0%のマークアップでそのまま通しているため、上記の数値は当社の料金ではなくDeepSeek自身の料金であり、DeepSeekのピーク・オフピークのスケジュールはDeepSeekが定義するとおりに正確に適用されます — 移行途中の価格変更も含めて、それは当社側でも同じ日に反映されます。トラフィックの一部を新しいモデルに送って出力を比較したり、タスクの種類別にルーティングしたりできます。さらに、新しいパスの後ろに自動フェイルオーバーを設定しておけば、V4.1 Flashがあなたのデータに対して予期しない動作をした場合でも、リクエストはエラーページではなくV4 Proに届きます。

ベンダーがこれらのモデルのうちどれが廃止されるかについて既に一度方針を変えていることを踏まえると、両方を一つの統合の背後で利用可能に保つのが、次にどのような方針転換が起きるかを予測する必要のない選択肢です。

Screenshot of the OrcaRouter model page for deepseek/deepseek-v4-pro, showing the model id with a flagship badge, 1M-token context, 384K max output, text input and text output, $0.66 input and $1.98 output per 1M tokens, a cache rate of $0.024, and observed time to first token of 3.58 s at p50 and 10.00 s at p95

何を見るべきか

• V4 Pro の価格または提供終了ステータスが再び変わるかどうか。9月の方向転換では、請求が変わらないことが明言されており、それがベンダーに守らせるべき約束だ。

• V4.1 Proが実現するかどうか。モデルカードか重みの公開があるまでは、2Tパラメータという話は情報源が一つだけの噂にすぎない。

• 両方のモデルを同じボード上で実行する独立した評価。それが存在するまでは、この2つを誠実に比較すると、測定可能なコスト、レイテンシ、アーキテクチャに加え、測定可能ではない能力に関する推論に基づく推測になる。

それらの3番目が登場するまでは、正確な要約はこうだ。DeepSeek V4.1 Flash は DeepSeek V4 Pro のより安価で高速な後継であり、V4 Pro は価格を変えずに引き続きサポートされており、新しいアーキテクチャが能力を犠牲にしているかという問いには、現在のところ公開ベンチマークはどれも答えていない。

Screenshot of DeepSeek's own release page for DeepSeek-V4.1-Flash dated 2026/09/10, showing the 552B-parameter MoE architecture with 8B active for input and 16B for output, a KV-cache memory-reduction graphic, and DeepSeek's own four-benchmark comparison chart

この記事で比較したモデル1

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新