
DeepSeek V4 Pro の発売日: すでに Kimi K3 より 14 倍安いが、まだ賢さは同等ではない
- metaNEWMeta: Muse Spark 1.22026-08-0557知能72コーディング
- qwenNEWQwen: Qwen3.8 Max2026-08-0358知能72コーディング
- deepseekNEWDeepSeek: DeepSeek V4 Flash 07312026-07-3152知能69コーディング
- minimaxNEWMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100万トークンあたり · 2110 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463知能78コーディング
- googleGoogle: Gemini 3.6 Flash2026-07-2152知能69コーディング
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137知能49コーディング
- metaMeta: Muse Spark 1.12026-07-1653知能71コーディング
- kimiMoonshotAI: Kimi K32026-07-1560知能76コーディング
- openaiOpenAI: GPT-5.6 Luna2026-07-0952知能71コーディング
- openaiOpenAI: GPT-5.6 Terra2026-07-0957知能77コーディング
- openaiOpenAI: GPT-5.6 Sol2026-07-0961知能77コーディング
- grokxAI: Grok 4.52026-07-0856知能72コーディング
- tencentTencent: Hy32026-07-0642知能59コーディング
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232知能42コーディング
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226知能39コーディング
- anthropicAnthropic: Claude Sonnet 52026-06-3055知能72コーディング
- klingKling: Kling 3.0 Turbo2026-06-1757知能52コーディング57数学
2026年7月31日、同社は、廉価モデルが高価モデルを打ち負かしたことを伝えるチェンジログエントリを公開した。そのエントリはDeepSeek V4 Flash、284B効率クラスに関するもので、見出しの主張は「エージェント機能が大幅に強化され、ベンチマーク結果がV4-Pro-Previewをはるかに上回った」というものだった。V4-Pro-PreviewとはDeepSeek V4 Pro、すなわち1.6兆パラメータのフラッグシップであり、トークンあたりのコストが3倍かかるモデルだ。同じエントリは、それについて「DeepSeek-V4-Proの正式リリースは間もなく行われます」という一文で締めくくられていた。これが、現在流布している予測の背景だ——本物のV4 Proが登場すればKimi K3レベルでありながら10倍安いだろうというものだ。その予測の半分はすでに測定可能で、しかもそれはほとんど誰も予想しない方向に外れている。
この記事が何であり、何でないかについての注記。ここには、リークされたシステムカードも、内部ベンチマークも、日付もない。現在流布している予測は、X上の@scaling01によるものだ——「DeepSeek-V4 ProはおそらくKimi-K3レベルだが10倍安く、傑作になるだろう」——これはフォロワーの多い実務家による予測であり、アクセス権を持つ誰かによる開示ではない。それをリークとして扱うからこそ、リリース日に関する質の悪い報道が書かれてしまうのだ。代わりに私たちができるのは、この主張の検証可能な2つの部分を取り出し、既に存在する数字と照合することだ。なぜなら、プレビュービルドは3ヶ月前から呼び出し可能であり、そのプレビュービルドとKimi K3の両方が独立したラボで実行されているからだ。以下はすべて、情報源別にラベル付けされている:{{1}}同社自身のドキュメント、Artificial Analysisの測定値、または私たち自身が行い提示する計算{{/1}}。
DeepSeekが実際に言ったこと、そして言っていないこと
確認された範囲は「未発表モデル」という枠組みが示唆するよりも広い。V4 Proは幻ではない——今すぐ呼び出せる。まだ実現していないのは、会社自身が公式と見なすリリースだけだ。
• アーキテクチャ — 1.6Tの総パラメータ数とトークンあたり49Bのアクティブパラメータを持つ混合エキスパート(Mixture-of-Experts)モデルであり、同社によって確認され、Artificial Analysisにも1600B/49Bとして同じように記載されています。
• コンテキストと出力 — 1Mトークンの入力ウィンドウ(1,048,576)と、最大384Kトークンの出力。テキスト入力、テキスト出力。画像、音声、ビデオ入力はありません。
• ライセンスとウェイト — MIT、ウェイトはHugging Faceで公開されています。これはオープンウェイトのフラッグシップであり、Kimi K3との比較が興味深い理由はまさにそこにあります。
• 定価 — キャッシュミス時は入力トークン100万個あたり0.435ドル、キャッシュヒット時は0.003625ドル、出力トークン100万個あたり0.87ドル(同社の料金ページより)。
• インターフェース — OpenAIスタイルのChatCompletionsおよびAnthropic形式のエンドポイントに加え、推論努力レベル、ツール呼び出し、構造化出力。
• これまでの経緯 — V4ファミリーは2026年4月24日にプレビューとして登場し、従来のdeepseek-chat と deepseek-reasonerというモデル名は2026年7月24日に廃止されました。Flashは2026年7月31日に公式ビルドを取得しましたが、Proはそうではありませんでした。
• 2026年8月6日 — DeepSeekは開発者に対し、DeepSeek APIサービスの全体的な料金を「近い将来、大幅な値上げが見込まれる」として引き上げる計画であると伝え、正式なV4 Proのリリースが続くと改めて表明した。新しい料金も発効日もまだ公表されていない。
そして、本当に未知のまま残っている部分、つまり人々が最も探し求めているものの大半は、以下の通りです:
• GA日はまだ発表されていない。「まもなく発表される」が同社の公式な約束のすべてである。未確認の報道は8月中旬の時期を示唆している——あるメディアは8月10〜20日を挙げ、再販業者の価格ページは8月3日に、歴史的にリリースに先立つパターンでV4 Proキャッシュの価格を変更した——しかし、そのどれもが同社の発言ではない。日付はまだ確定していない。
• GAビルドで変更される内容 — 未発表。同社は、正式版V4 Proが同一ウェイトの再ポストトレインなのか、新規のプリトレインなのか、それとも価格改定なのかを明らかにしていない。
• その価格がそれを乗り越えられるかどうか — 未解決のままであり、この点を懸念すべき具体的な理由は後述する。
この質問に関する検索結果は汚染されているため、明確に訂正しておくべき点が1つあります。V4ファミリーが2026年7月20日に一般提供を開始したと主張するページが見つかるでしょう。しかし、その11日後の同社自身のチェンジログによれば、公式のV4 Proリリースはまだ保留中であり、7月31日のアップデートは「DeepSeek-V4-Flash APIのみをアップグレードします。DeepSeek-V4-Pro APIとAPP/WEBモデルは変更されません」と付け加えています。第三者による要約とベンダーの一次チェンジログが食い違う場合、チェンジログが優先されます。

価格主張「10x cheaper」は控えめな解釈である。
Kimi K3 は、100万入力トークンあたり3.00ドル、100万出力トークンあたり15.00ドルで、キャッシュヒットは0.30ドルです。V4 Proは、0.435ドルと0.87ドルで、キャッシュヒットは0.003625ドルです。これらを比較すると、「10倍」は見出しではなく、範囲の下限にすぎないことがわかります。
• 入力トークン — $3.00 に対して $0.435、つまりV4 Proは6.9倍安い。これは主張が誇張されている唯一の側面です。
• 出力トークン — $15.00 対 $0.87、つまり 17.2倍 安い。出力は推論モデルがコストを費やす部分であり、これが最も重要な数値です。
• 70/30のインプット・アウトプット・ブレンド — 100万あたり$6.60、$0.5655に対して、すなわち11.7倍。
• Artificial Analysisの7:2:1キャッシュヒット/入力/出力ブレンド — $0.18に対して$2.31、つまり12.8倍。
• キャッシュ入力 — $0.30 対 $0.003625、およそ83倍。同社のキャッシュ読み取り価格は、Artificial Analysisが追跡する101モデル中4位で、自社のキャッシュミス率から99%割引されています。
仮想的なブレンドは議論の余地があるため、ここでは実測値を示します。Artificial Analysisは、各モデルに対して完全なIntelligence Indexを実行するのに実際に費やした金額を公開しています。同じ評価スイート、同じハーネス、想定された比率ではなく実際のトークン数です。Kimi K3の評価には2,437.41ドルかかりました。V4 Proは176.34ドルでした。これは、同一のワークロードで誰かが実際に支払ったドル額で、13.8倍です。
この数値が17.2倍の産出価格比率よりも低い理由を理解する価値はある。なぜなら、それがV4 Proの安さが部分的に自業自得である唯一の点だからだ。V4 Proは冗長で、インデックスを処理するのに1億8000万の出力トークンを消費したが、Kimi K3は1億3000万、同クラスの中央値は1億だった。つまり、V4 Proは自分の言いたいことを伝えるのに約38%多くのトークンを使うことになり、それがトークンあたりの優位性を損なっている。{{1}}13.8倍という数値にはそれがすでに織り込み済みだが、{{/1}}{{2}}17.2倍という数値には織り込まれていない。{{/2}}予算を組むなら、実測値を目安にすべきだ。
これは、この話の中でも、盲信するのではなく自分で簡単に検証できる部分でもあります。OrcaRouterがプロバイダーのリスト価格を0%のマークアップでそのまま通すため、当社のdeepseek/deepseek-v4-proおよびkimi/kimi-k3モデルページに表示されるトークン単価は、両ベンダー自身の価格です。K3は、当社のページでもMoonshotのページでも$3.00/$15.00と表示されており、スプレッドが隠された再販価格ではありません。つまり、上記の計算は1枚の請求書で再現でき、どちらかのベンダーが価格を変更した場合も、その変更は契約サイクル後ではなく、同じ日に当社側に反映されます。
知能に関する主張:13ポイント差、同等ではない
「Kimi K3レベル」は、現在の数値と接すると生き残れない予測の半分にあたります。2026年8月5日時点のArtificial AnalysisのIntelligence Indexでは、Kimi K3は57、DeepSeek V4 Pro(推論、最大努力)は44をスコアしており、101モデル中6位という確かに強い順位ながら、依然として13ポイント不足しています。両者は同じラボで同じ総合指標により、最大限の推論努力で、100万トークンのコンテキストに対して測定されています。
ベンダーのベンチマークは異なる、より好意的な物語を語っている。まさにそれゆえにラベル表示が必要なのだ。同社はV4 Pro-Previewについて、SWE-bench Verifiedで80.6%、GPQA Diamondで90.1%と報告している。MoonshotはKimi K3について、SWE-bench Verifiedで76.8%、GPQA Diamondで93.5%と報告している。額面どおりに受け取れば、V4 Proがコーディングベンチマークで完全に勝利する。どちらの結果も独立に再現されたものではなく、利害関係のあるチームによって異なるハーネスで生成されたものであり、第三者機関が両モデルを自ら実行した唯一の複合ベンチマークでは、順位が逆転する。これこそが、ベンダー間の単一ベンチマーク比較を信用しないことの根拠のすべてである。

インデックス番号については、それ自体に注意点が2つある。第一に、V4 Proを44ではなく52と記載している以前の記事を見つけても、それは間違いではない。Artificial Analysis自身の4月のローンチ記事でも、V4 Pro (Max)は52とされ、オープンウェイト推論モデルの第2位と呼ばれていた。{{1}}インデックスは改訂されるものであり、改訂されればすべてのモデルのスコアが変動する。実務上のルールとしては、同じスナップショット同士の比較だけが意味を持つ。4月の52と8月の57を同じ文脈で語るべきではない。{{/1}}第二に、{{2}}Artificial Analysisのページには「2026年4月リリース」との日付があり、プレビュービルドと将来の公式版を区別していない。つまり、その44は、いつテストされたかにかかわらず、エンドポイントが提供した結果の測定値なのである。{{/2}}
V4 ProがKimi K3を明確に上回るのは、知能以外の軸である。V4 Proは毎秒66.5トークンを生成するのに対し、K3は37.6トークンで、そのクラスの中央値は65.9である。つまりV4 Proはクラス平均程度で、Kimi K3は異常に遅い。最初のトークンまでの時間は1.61秒に対し2.85秒。インタラクティブなエージェントループでは、その差は毎ターン感じられ、現在のプレビュービルドを支持する最も強い根拠となっている。
Flashの公式ビルドがProについて教えてくれること
未発表モデルに関する真の証拠に最も近いものがこちらです。それは、すでにそのプロセスを経た兄弟モデルからもたらされたものです。
同社の7月31日付の変更ログには、「DeepSeek-V4-Flash-0731はDeepSeek-V4-Flash-Previewと同じモデルアーキテクチャとサイズを維持しており、再ポストトレーニングのみが行われた」と記載されている。重みの数もアーキテクチャも価格も同じ——ポストトレーニングのみだ。Artificial Analysisはこの結果を50点と評価した。従来のFlashビルドは40点だった。ポストトレーニングだけで総合スコアが10点上がり、トークンあたりの追加コストはゼロ。さらに、インデックス上での出力トークン消費量も約2億3,400万から約2億600万へと12%減少し、同じ定価のまま運用コストが下がった。
その前例をProに当てはめれば、算数は避けられない。44+10は54。Kimi K3は57だ。たとえ公式V4 Proが、同社が公に実証した中で最も成功したポストトレーニングのアップグレードを再現したとしても、「Kimi K3レベル」には約3ポイント及ばない。しかも、実行コストはおよそ14分の1だ。これは驚くべき結果であり、予測が示した結果ではない。
その外挿に関する率直な注意点は、これは算術的なものであって予測ではないが、284Bモデルでの+10の向上は1.6Tモデルで何が達成可能かについてほとんど示しておらず、その余地は大きいかもしれないし、はるかに小さいかもしれないということだ。同社はProビルドがポストトレーニングのみになるとは述べていない。また、そのインデックスは複合指標なので、3ポイントは1つのベンチマークに相当することもある。それでもその数値を出す理由は、それが存在する唯一の定量化され、ベンダーが確認した前例であり、予測が拠り所としているものよりはるかに強固だからだ。
その変更ログの中で、繰り返すのではなく強調すべき詳細がもう1つあります。Flashのエージェント的スコアは、max effort、topp=0.95、temperature=1.0で「同社のHarness最小モード(近日公開予定)」を使用して生成されました。この数値を生み出したハーネスは一般公開されておらず、8月初旬にクローズドベータに入ったばかりです。つまり、これらの数値は、間違っているからではなく、測定手段が利用できないがゆえに、今なお社外の誰にも原理的に再現できません。Proリリースにも同じアスタリスクが付いてくることでしょう。
安価モデル説を覆す可能性のある条項
同社の料金ドキュメントの奥深くには、V4ラインの価格についての報道ではほとんど触れられていないポリシーが埋め込まれている。同社の説明によれば、APIは「まもなく」スケジュールを採用する予定で、そのスケジュールの下では「ピーク時に、価格は通常の2倍となり、すべての請求項目に適用される」とのことだ。ピーク時間は、北京時間で毎日09:00〜12:00と14:00〜18:00、つまり1日7時間、毎日と定義されている。発効日は「公式発表による」とされ、本稿執筆時点ではこの追加料金はまだ適用されていない。
方向性に注意してください。同社は歴史的にオフピーク時の割引をV3とR1で提供してきました。これは標準料金に対するピーク時の追加料金です。記載された倍率で有効化された場合、V4 Proの日中料金は入力が$0.87、出力が$1.74となり、比較の構図が変わります。Kimi K3に対するブレンド優位性は11.7倍から5.8倍に低下し、実測の13.8倍も6.9倍に低下します。それでも安いことには変わりありません。ただし、「10倍安い」とは言えなくなり、欧州やアジアのチームが実際に作業している時間帯には安くなくなります。
8月6日、より大きな展開があった。DeepSeekは開発者プラットフォーム上で、DeepSeek APIサービスの全体的な価格を「近い将来」引き上げる計画であり、「大幅な値上げが見込まれる」と発表した。新しい料金も実施日も公表されておらず、同社はこの値上げがピーク時の料金スケジュールとは別に行われるのか、それとも同時に行われるのかも明らかにしていない。同社を取材する報道陣は、この発表を公式のV4 Proリリースが目前に迫ったシグナルと受け止めた。未発表のフラッグシップを、まもなく脱却するディスカウント体制のもとで積極的な価格設定にするはずがないからだ。現在V4 Proでコストモデルを構築している人は、両方のケースをモデル化すべきだ。また、「同社は14倍安い」という見出し——この記事も含めて——を読んでいる人は、それが発表済みの期限条件付きの価格表を説明していることを認識すべきだ。これが、予測の価格部分が成立しなくなる最も可能性の高い唯一の道であり、モデルそのものとは無関係である。
公式ビルドが公開されたことを知る方法
会社の出荷方法には、日付以上に重要な詳細があり、それは実際の運用上の危険をもたらします。
APIモデルIDは、deepseek-v4-proです。ではなくdeepseek-v4-pro-preview、日付付きビルド文字列でもありません。同社自身の変更ログが現在のビルドをV4-Pro-Previewと呼び、出荷されたFlashビルドをV4-Flash-0731と呼んでいるにもかかわらず、です。Flashが正式版になったときの指示は次の通りでした。「APIの呼び出し方法は変わりません。モデル名をdeepseek-v4-flashに設定するだけで最新版を使用できます。」言い換えれば、モデルIDを固定してもビルドは固定されません。同じ文字列が、いつの間にか別の重みセットを提供し始め、その挙動は実質的に異なり、インデックスポイントも10増えていました。
では、「V4 Pro はいつリリースされるのか」という問いへの実際的な答えは、もしあなたが deepseek-v4-pro を本番環境で呼び出しているなら、自分の出力が変わるのを観察することで分かるかもしれません。具体的に注目すべき点は、企業のAPI変更ログに新しい日付入りのエントリが現れること(これはFlashのリリースが最初に現れた場所です)、そして、次のようなビルドサフィックスV4-Pro-0731 が、そのエントリの文章に含まれる(呼び出し可能IDが裸のままでも)。また、Artificial Analysis の V4 Pro ページの再スコアリング(これは最初に得られる独立した確認です)。そして、発表された価格引き上げが実際の料金に反映されること(GAは、その料金改正とピーク時間帯のスケジュールの両方が導入される自然なタイミングです)。さらに、企業のResponses API(そのドキュメントには、deepseek-v4-proのサポートが8月初旬に予定されていると書かれており、モデルが「計画中」リストから消えて「サポート済み」リストに現れることが、企業が公開する公式リリースシグナルにほぼ匹敵します)。確認できないが知っておく価値のあるシグナルが2つあります。リセラーの価格ページが8月3日にV4 Proのキャッシュ価格を変更したこと(これは歴史的にリリースに先立つパターンです)、そして企業の社内評価ハーネスがクローズドベータであることです。つまり、それがリリースされれば、ベンダーのベンチマークがようやく検証可能になるかもしれません。さらに、次のような文字列deepseek-v4-pro-202606 も、リークされたビルド識別子として流通しています。私たちはそれを企業のいかなる資産とも照合できず、誰かが照合できるようになるまでは、重みを持つべきではありません。
今日プレビュー版で開発を進めるべきでしょうか?
このモデルを評価しているほとんどの人にとって、リリース日は的外れな質問だ。プレビューは呼び出し可能で、価格設定済み、MITライセンスであり、インテリジェンスでは第三者評価で101件中6位にランクされている。本当の問いは、現在構築している作業に対して、今後予定されているGAが何をもたらすかであり、それには2つの明確な答えがある。
V4 ProとKimi K3のどちらを選ぶかを性能面で判断する場合、現在のエビデンスによれば、Kimi K3は総合スコアで13ポイント勝っており、V4 Proは速度・レイテンシ・コストで大幅に勝っています。また、予定されているポストトレーニングのアップグレードによって知能の差は縮まるかもしれませんが、埋まることはないとされています。あなたの仕事が高度な推論の最前線にあるなら、その13ポイントがすべてであり、価格はノイズにすぎません。あなたの仕事が大量処理であり、単に難しいだけのものであれば、その14倍のコストを支払うのは正当化しにくいでしょう。
{{1}}すでにV4 Proを選択している場合、管理すべきリスクはリリース日ではなく、静かなすり替えです。そのモデルIDの背後にあるビルドは、まさにFlashのときと同じように、あなたの知らないうちに変更されます。そして、あなたのevalはそれを検出できるはずです。オンデマンドで再実行できるリグレッションセットを維持し、コード変更なしでアクセスできるセカンドモデルも維持してください。これが、私たちがフェイルオーバーをこのように構築した地味な理由です。V4 Pro、V4 Flash、Kimi K3はすべて、OpenAI互換エンドポイント上の1つのOrcaRouterキーの背後にあります。そのため、「3つすべてでevalを再実行してからトラフィックを移行する」ことは、調達作業ではなく設定変更であり、不良なGAビルドはインシデントではなくルーティングの決定です。未検証のフラッグシップを試すことは、その選択を元に戻すのにコストがかからない場合には、はるかに簡単です。{{/1}}

人々が実際に尋ねている質問
DeepSeek V4 Proはリリースされていますか?
両方です。何を意味するかによります。だから検索結果が矛盾しているのです。このモデルは2026年4月24日のV4プレビュー公開以降、公開APIとして呼び出し可能で、価格も公表され、MITライセンスのもとでオープンウェイトが提供され、独立したベンチマークでも評価されています。しかし、同社自身の2026年7月31日のチェンジログには、V4 Pro APIは「変更なし」であり、正式リリースは「間もなく行われる」と明記されています。さらに8月6日、DeepSeekは大幅なAPI価格引き上げを発表すると同時に、正式版をできるだけ早くリリースすると改めて述べました。つまり、利用可能ではあるが、まだ正式ではない、ということです。確定した日付はありません。未確認の報道では8月中旬とされており、そうなれば待ち時間は短そうです。
公式ビルドはKimi K3と同じくらい良くなるのでしょうか?
利用可能な唯一の定量化された前例に基づけば、おそらくそうとは言えない。Flashの公式ビルドは、ポストトレーニングのみでArtificial Analysisのインテリジェンス指数において10ポイント向上した。V4 Proは44、Kimi K3は57に位置しているため、同じ向上幅を適用すると54になる。その外挿はどちらの方向にも誤っている可能性がある——1.6Tモデルは284Bモデルとは異なる余裕を持つかもしれず、また同社はProリリースがポストトレーニングのみになると明言していない。しかし、今日対等性を主張する者は、発表されたいかなる測定値にも裏付けられない主張をしていることになる。
なぜDeepSeekの低価格モデルは現在、フラッグシップモデルよりも高いスコアを獲得しているのでしょうか?
リリースの順序によるものであって、Flashの方が優れたモデルだからではない。Flashは7月31日にポストトレーニングのアップグレードを受け、インデックス上で40から50へと上昇した。Proはそれに相当するアップグレードを受けておらず、4月のポストトレーニング時点のまま評価されている。同社自身もそのことを認めており、Flash-0731のエージェント的な結果は「V4-Pro-Previewをはるかに上回る」と説明している。この逆転は未完のロールアウトのある時点のスナップショットに過ぎず、保留中のProリリースこそがまさにそれに終止符を打つものだ。
$0.435 / $0.87という価格は、コストモデルを構築する基盤として安全ですか?
条件付きで、そして1週間前ほど安全ではありません。それは同社の現在公開されているリスト価格であり、すでにV4発売時の料金からの大幅な恒久的値下げを反映しています。しかし、8月6日にDeepSeekはAPI価格を全体的に引き上げる計画を発表しました。「大幅な値上げが見込まれる」と述べ、新しい料金や日付はまだ公開されていません。その上、発表されたものの未施行のピーク時ポリシーがあり、1日7時間、すべての課金項目が2倍になります。両方のシナリオをモデル化し、2倍になった場合でもKimi K3より約6倍安いことに注意してください。
正直な読み
事の発端となった予測は半分だけ当たっていた。しかも、当たっていたのは人々が最も信じがたいと感じる方の半分である。「10倍安い」では控えめすぎる。同じ測定評価ワークロードでは、DeepSeek V4 Proのプレビュービルドは176.34ドルだったのに対し、Kimi K3は2,437.41ドルだった。キャッシュ済み入力の場合、その差は10倍ではなくおよそ80倍だ。「Kimi K3レベル」という部分はまだ実現していない。独立したラボが両方に対して実施した唯一の複合ベンチマークでは44対57で、同社自身の最良の前例から楽観的に外挿しても54にしか届かない。
この見方を変える要素は具体的であり、注目に値する。公式のV4 Proビルドがポストトレーニングアップグレードとして登場し、Artificial Analysisがそれを57を超えるスコアに再評価したなら、この予測は完全に裏付けられ、本稿の中心的な数字は古くなる。それがピーク時間帯の追加料金や8月6日に発表された値上げと同時に登場した場合、価格面の論点は半減し、6倍の割引が13ポイントの差を埋めるのかという興味深い問いが浮上する。そして、同社が評価用ハーネス——すでにクローズドベータ版——を出荷すれば、現在コーディング分野でV4 Proに有利とされるベンダーベンチマークが初めて検証可能になる。そのいずれかが実現するまでは、DeepSeek V4 Proについての正確な要約は、ダウンロード可能なウェイトを備えた最もコストパフォーマンスに優れた本格的な推論モデルであり、最も賢いモデルではなく、そのベンダーが未完成であると明言しているモデルである、というものだ。
この記事で比較したモデル4
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
