生成されたヒーローカード。タイトルは「MiniMax M3.1 Flash Preview 対 DeepSeek V4 Flash」、サブタイトルは「同じ100万トークンのウィンドウ、まったく異なる2つの売り込み」。左のカードには「MiniMax M3.1 Flash Preview:100万コンテキスト、価格は非公開、Token Planのみ、thinkingは無効化できない」とあり、右のカードには「DeepSeek V4 Flash:100万コンテキスト、オフピーク時 $0.15/$0.60、テキストのみ、V4.1 Flashに取って代わられた」とある。フッターには「MiniMaxの数値はplatform.minimax.ioによるもの。DeepSeekの数値はDeepSeekが公開している料金表によるもの」とある。
Engineering & Research

{{1}}MiniMax M3.1 Flash Preview 対 DeepSeek V4 Flash:{{/1}}{{2}}安価な 100 万コンテキストのチケットが 2 枚、{{/2}}{{3}}ただし巨大なアスタリスクが 1 つ{{/3}}

著者

Gideon Frost

公開日

最新モデル · 20すべてのモデルを見る →
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

100万トークンのコンテキストウィンドウを、トークンあたりの低価格で探しているなら、MiniMax-M3.1-Flash-PreviewとDeepSeek V4 Flashという2つの名前が繰り返し挙がります。しかし、この2つは実際には同じ種類の製品ではありません。DeepSeek V4 Flashは廃止されたモデルで、その識別子は依然として応答しますが、1セント単位まで読めるベンダーの料金表の中に存在しています。MiniMax-M3.1-Flash-Previewは公開料金が一切ないライブプレビューです。したがって以下の比較は、一部は仕様比較であり、一部はこの2社が同じ価格帯をいかに異なる方法で売ろうとしているかの実例です。

その両側面は正確に述べておく価値がある。なぜなら、それを決める数字は、ベンダーの価格ページ、ベンダーのドキュメントツリー、そして当社自身のカタログに散らばっており、DeepSeek V4 Flash について最も頻繁に繰り返される主張の一つ——その価格——は、DeepSeek がその後置き換えたものだからだ。

2つの仕様書が実際に一致する点

主要スペックはどれも似通っていて決め手にはならないが、誰も宣伝していない例外がただ一つある。

• コンテキストウィンドウ — MiniMax-M3.1-Flash-Preview は 1,000,000 トークン、DeepSeek V4 Flash は 1,048,576 トークン。名目上は同じだが、48,576 トークンの差がある
• 最大出力 — MiniMax-M3.1-Flash-Preview では非公開。DeepSeek V4 Flash は 384,000 トークンで、この価格帯では異例であり、購入判断を大きく左右する数字だ
• 入力モダリティ — MiniMax-M3.1-Flash-Preview はテキスト、画像、動画。DeepSeek V4 Flash はテキストのみ
• 思考の制御 — effortのラダーがlowからmaxまで、MiniMax-M3.1-Flash-Preview では思考が常時オン。DeepSeek V4 Flash では思考/非思考を切り替え可能で、非思考も実際の選択肢となる
• プロトコル対応 — MiniMax-M3.1-Flash-Preview は Anthropic 互換、OpenAI 互換、OpenAI Responses の各エンドポイントに対応。DeepSeek V4 Flash は同じ 3 つに加えてチャットプレフィックス補完にも対応
• 重み — MiniMax-M3.1-Flash-Preview は非公開。DeepSeek の V4 Flash の重みは公開されたが、モデル自体はすでに取って代わられている
• 価格 — MiniMax-M3.1-Flash-Preview は非公開。DeepSeek V4 Flash は公開されており、安価

そのリストを二度読んでください。なぜなら、目立たないのは出力上限の方だからです。100万トークンのコンテキストと384,000トークンの出力は、真に長い単一パス生成ウィンドウです。100万トークンのコンテキストと非公開の出力上限は、読み取りについての約束であり、書き込みについての約束ではありません。あなたのワークロードが「リポジトリを読み、移行計画を出力する」というものなら、そのタスクが1回の呼び出しに収まるかどうかを決めるのは2番目の数字です。

それぞれが何で測定されるか

ここはこの比較の中で最も居心地の悪い部分であり、しかも短い。

DeepSeek V4 Flashにはベンチマーク上の記録があり、それは独立系によるものだ。Artificial AnalysisはIntelligence Indexで34.3点を付けている — 同インデックスの145モデル中42位 — そしてCoding Indexで69.1、GPQA Diamondで90.8%だ。当社自身のカタログ項目が先頭に掲げているτ²-Benchの95.0は、DeepSeekの発表資料が載せていた数値と同じであり、したがって監査済みの数値というより、独立系の数値に交じったベンダー公表値だ。その長文脈リコールは79.7%、terminal-benchの数値はv2.1ハーネスで78.7%だ。これらは既知のモデルについての、実際の比較可能な測定値だ。

MiniMax-M3.1-Flash-Previewには何もない。MiniMaxはリリース時に評価表を公開しておらず、第三者もそれを持っていない——このモデルはArtificial Analysisのインデックスにまったく登場しない。それは我々の調査の欠落ではなく、公開記録の現状であり、新しいモデルに関するあらゆる品質主張が現時点ではベンダーの形容詞にすぎないことを意味している。今日、MiniMax-M3.1-Flash-Previewのベンチマーク表を手渡してくる人がいれば、その人は古いMiniMax-M3を引用しているか、でっち上げているかのどちらかだ。

A generated two-column scoreboard titled 'MiniMax M3.1 Flash Preview vs DeepSeek V4 Flash — the scoreboard'. The left column, MiniMax M3.1 Flash Preview, reads 'AA Intelligence: none published', 'Coding score: none published', 'Context window: 1M', 'Max output: not published', 'Weights: none', 'Price: not published'. The right column, DeepSeek V4 Flash, reads 'AA Intelligence: 34.3', 'Coding score: 69.1', 'Context window: 1,048,576', 'Max output: 384,000', 'Weights: published', 'Price: $0.15 / $0.60 off-peak'. A footer reads 'MiniMax figures per platform.minimax.io documentation, 27 September 2026; DeepSeek figures per DeepSeek's published rate card and Artificial Analysis. The MiniMax column is empty because nothing has been published, not because a result is pending.'

DeepSeek V4 Flashは、あなたが覚えている価格では販売されていません。

ここに罠がある。DeepSeek V4 Flash について広く引用されている数字 — 100万入力トークンあたり$0.14、100万出力トークンあたり$0.28 — は、2026年9月10日より前にこのモデルが掲げていた料金表だった。その日、DeepSeekはDeepSeek-V4.1-Flashをリリースし、V4 FlashとV4-Flash-Vision-Exp実験の両方を廃止し、価格を引き下げた。そのdeepseek-v4-flash識別子はまだ機能しますが、DeepSeekのドキュメントによると、一時的にV4.1 Flashにルーティングされ、Flashの価格で請求されます。言い換えれば、古いモデル名を入力しても、古いモデルを呼び出しているわけではありません。

つまり、比較すべき本当の料金表は現行のもので、100万トークンあたり——そしてオフピークはその安い方の半分だ:

• キャッシュミス入力 — オフピーク $0.15、ピーク時 $0.30
• キャッシュヒット入力 — オフピーク $0.003、ピーク時 $0.006
• 出力 — オフピーク $0.60、ピーク時 $1.20
• ピーク時間帯 — 01:00~04:00 および 06:00~10:00 UTC、月曜日から金曜日、中国の祝日を除く。それ以外は、週末全体を含め、オフピークです

それに対して、MiniMax-M3.1-Flash-Previewにはトークン単位の料金が一切ない。そのコストは、Token Planのシート料金——Plus、Max、Ultraで月額22ドル、55ドル、132ドル——が、各モデルの従量課金の定価で共有クォータプールを通じて目減りしていく分であり、ベンダーはそのプールの構成を変更する権利を留保している。予測可能な利用量で月額予算が固定されているなら、それは優れた価値になり得る。呼び出しごとにコストを割り当てる必要があるプロジェクトにとっては、サブスクリプションの見せかけをまとった不透明さである。

DeepSeek側でこれがいつも以上に重要になるのは、ピーク倍率のためです。ヨーロッパやアジアのチームが勤務時間帯に稼働していると、トラフィックのかなりの割合がピーク時間帯に入り、その代償として2倍の料金を支払うことになります。その結果、見出し上の入力料金$0.15が、まさにほとんどの製品が混み合う時間帯には$0.30になります。UTCで本当に夜間にトラフィックが流れているのでなければ、ピーク列を基準に予算を組んでください。

MiniMax M3.1 Flash Preview が誤った選択となる場面

3つのケースがあり、最初の2つは見落としやすい。削除されるのではなく、文書化されているからだ。

出力上限は不明だ。タスクが長い生成で終わる場合——完全な仕様書、文字起こしの書き直し、注釈付きレポート——あなたは自分には見えない出力予算を選んでいることになる。DeepSeek V4 Flash は 384,000 を公表している。その非対称性は、大量に書くものにとっては、より古いモデルに有利に働く。

思考をオフにすることはできません。thinking: {"type": "disabled"} を MiniMax-M3.1-Flash-Preview に送信すると、HTTP 400 が返ります。モデルは適応型思考を必要とします。DeepSeek V4 Flash では、非思考モードが存在し、サポートされているスイッチです。高スループットの分類、ルーティング、または短い構造化抽出では、常に最初に推論するモデルは、あなたが要求していないレイテンシーとトークンを支払うことになります — そして、あなたが持つ唯一のレバーは effort を low に下げることであり、推論を削除することではありません。

従量課金では呼び出せません。ベンダーのドキュメントは明確で、MiniMax-M3.1-Flash-Preview は現在 Token Plan と MiniMax Code を通じてのみ利用可能であり、Subscription Key は従量課金の API キーと互換性がありません。すでにシートを保有しているなら、1 行の変更で済みます。そうでなければ、このモデルを評価するにはサブスクリプションを購入する必要があります。

DeepSeekの数字が誤った判断となる場合

逆の見方とは、DeepSeek V4 Flash がテキスト専用であり、すでに取って代わられている、というものだ。これは画像を一切受け付けなかった——その作業には別個の実験的ビルドが必要で、今ではそれとともに廃止されている——そして、モデル識別子は今や、名前が示唆するものとは異なる重みを提供している。固定先がdeepseek-v4-flashであるパイプラインは、再現性のために、DeepSeekが一時的と説明するリダイレクトに依存している。

MiniMax-M3.1-Flash-Previewはテキスト・画像・動画をネイティブに扱え、ベンダー現行の最上位テキストモデルです。Flashの価格帯で動画入力に対応しているのは、このクラスでは珍しいことです。

どちらの注意点も、本番トラフィックを流している人にとっては同じ方向を指し示している。請求書に記載された識別子と、実際に応答したモデルが、いつまでも同一であるとは保証されていない。そして、それが発見される場所ではなく対処される場所となるのがルーティング層だ。

A generated infographic titled 'The two Flash brackets, side by side' listing six paired rows: 'Sales motion — subscription seat vs per-token rate card', 'Effective input rate — Token Plan quota vs $0.15 off-peak / $0.30 peak', 'Peak surcharge — not applicable vs doubles 01:00-04:00 and 06:00-10:00 UTC', 'Cost attribution — pooled quota vs metered per call', 'Failure mode — no published output ceiling vs identifier now serves a successor', and 'Best fit — fixed-budget teams vs metered pipelines'. A footer reads 'Both models carry a 1M-token context window; neither figure is a quality claim.'

これを半日で決める方法

タスクの始まりではなく、終わりから始めてください。

ジョブが長文生成、つまり数万トークンを書き切って完了するようなものであるなら、DeepSeek V4 Flash は2つのうち、それを約束できるほど大きな上限を公開している唯一のものであり、その料金表はピーク時の倍率でも耐えられるほど小さい。コストはオフピークではなくピーク時でモデル化し、廃止された識別子は安定した契約ではなく、まだ済んでいない移行として扱え。

固定の月額予算のもとで、マルチモーダル入力(画面録画、スキャンした文書、動画レビュー)を読んで推論するのが仕事なら、MiniMax-M3.1-Flash-Preview のほうがより能力の高い形であり、Token Plan のシート内では、このコンテキスト長で動画入力を得るための最も安価な方法です。計測されていないモデルを買っていることを受け入れ、影響範囲を限定しましょう。重要なワークロードは公開された料金表のあるものに任せ、探索的な半分はプレビューに処理させてください。

もし両方の説明があなたのパイプラインに当てはまるなら、それはモデル選択の問題ではなくルーティングの問題であり、まさに私たちが存在する理由となるケースです。OrcaRouter 上の DeepSeek V4 はプロバイダーの料率で提供されます。マークアップ0です。そのカタログ掲載には100万入力トークンあたり $0.22、100万出力トークンあたり $0.66 と表示されており、これは現行 Flash の価格表のピーク欄をそのまま通したもので、同じキーで同じ価格帯にある MiniMax-M3 と MiniMax M2.7 と並んでいます。1つのエンドポイントで200以上に到達し、その背後には自動フェイルオーバーがあるため、ワークロードは2つ目の統合なしに価格帯間を移動できます。MiniMax-M3.1-Flash-Preview は当社のカタログにはありません。それを利用するにはベンダーの Token Plan とそのコーディング製品が必要です。

一行で言うと:DeepSeek V4 Flash は、公開された出力上限、読みやすい料金表、そして静かにその名を継ぐ後継モデルを備えた、評価の定まった存在だ。MiniMax-M3.1-Flash-Preview は、より新しく、マルチモーダルで、未測定の、試すにはサブスクリプションが必要なものだ。そのどちらも、もう一方を選ぶ理由にはならない — それらは、DeepSeek が9月に廃止した料金表を引用するトークン単価比較からは得られなかったはずの事実にすぎない。

A headless Chromium screenshot of the OrcaRouter model page for deepseek/deepseek-v4-flash, showing the model title 'DeepSeek: DeepSeek V4 Flash', a pricing row reading 0.22 US dollars per million input tokens and 0.66 per million output tokens, a context window of 1,048,576 tokens, and a maximum output of 384,000 tokens, captured 28 September 2026.

この記事で比較したモデル1

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新