DeepSeek V4 レビュー: AI の中で最も安価で本格的な 1M-Token モデル?

DeepSeek V4 レビュー: AI の中で最も安価で本格的な 1M-Token モデル?

著者

Fengya Tian

公開日

最新モデル · 20すべてのモデルを見る
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

DeepSeekは2026年4月24日にV4ファミリーをリリースしました。V4-ProとV4-Flashの2モデルで、API上で稼働し、初日からオープンソース化され、本格的なAI機能のコストの下限を静かに塗り替えました。両モデルともデフォルトで100万トークンのコンテキストウィンドウを備え、思考モードと非思考モードの両方を提供し、最上位モデルのV4-Proは出力トークン100万あたり0.87ドルが上限で、その価格は市場にあるあらゆる同等の100万コンテキストモデル(オープン・クローズド問わず)を下回ります。

そして7月は決断の月です。6月29日付けの通知で、DeepSeekはV4の正式版が2026年7月中旬にリリースされることを確認し、機能とパフォーマンスの向上を約束するとともに、北京のビジネス時間帯に料金が2倍になるピーク時価格を導入しました。その10日後の7月24日には、レガシーモデル名`deepseek-chat`と`deepseek-reasoner`が完全に廃止されます。このレビューでは、V4が実際に何であるか、現時点での料金と正式リリース後の料金、どこで優れているか、明らかに優れていない点、そして期限までに何をすべきかをカバーしています。

簡潔な評決

もし…なら、DeepSeek V4を検討してください

- 単価が実現可能性を左右する高ボリュームの本番ワークロードを実行 — V4の価格設定は別格です

- 長いコンテキストを低コストで必要とする場合: 標準で100万トークン、応答あたり最大384K出力トークン、アグレッシブなコンテキストキャッシュ割引あり

- ドロップイン統合を希望 — APIはOpenAI ChatCompletionsとAnthropicの両方のフォーマットに対応しているため、既存のツールはほとんどそのまま動作します

- オープンウェイトとセルフホスティングの選択肢、特に小型のV4-Flashを重視

あなたが…の場合は、保留する(または別の場所にルーティングする)

- 長期間にわたる自律エージェントを実行する — Z.aiの公開クロスモデル表では、V4-ProはマラソンスタイルのベンチマークにおいてGLM-5.2とクローズドフロンティアの両方に大きく劣っている

- 画像入力が必要: V4はテキストのみ

- 2026年7月中旬の正式リリース以降、終日定額料金制 — 北京のビジネス時間帯はピーク時の料金が2倍になります(オフピーク時は現在の料金のまま)

DeepSeek V4とは?

V4はDeepSeekの第4世代モデルファミリーで、2つの混合エキスパートモデルとして提供されています。DeepSeek-V4-Proはフラッグシップモデルで、総パラメータ数1.6兆、トークンあたりのアクティブパラメータ数は490億です。DeepSeek-V4-Flashは効率重視モデルで、総パラメータ数2840億、アクティブパラメータ数は130億です。どちらもDeepSeek公式サービス全体でデフォルトで100万トークンのコンテキストウィンドウを実行し、モデルID deepseek-v4-proおよび`deepseek-v4-flash`の下でデュアルモード(難しい問題向けの思考モードと速度重視の非思考モード)を提供します。

2つのポジショニングの詳細が重要です。まず、V4はプレビューとしてリリースされ、DeepSeekはこれを本番利用可能として扱っています。そして、同社の6月29日の通知によると、公式版は2026年7月中旬にリリースされ、「機能最適化とパフォーマンス改善」が行われます。第二に、V4はオープンソース化され、DeepSeekのウェイトを公開するパターンを継続しており、これによりセルフホスティングとファインチューニングが可能です。現実的には、284B Flashの方が1.6T Proよりもその恩恵を受けやすいです。

DeepSeek V4の新機能は?

デフォルトとして100万トークンのコンテキストを提供し、アップセルではありません。すべての公式DeepSeekサービスは、標準で完全な100万トークンウィンドウを実行します。別途の長文コンテキストSKUもプレミアム料金もありません。

圧倒的な出力余裕。両モデルは、1回の応答で最大384Kの出力トークンをサポートします。これは、ほとんどの1Mコンテキストの競合が許可する量の3倍であり、ファイル全体のコード生成、長い構造化抽出、およびレポート作成にとって重要です。

1つのエンドポイントでデュアルモード。難しい問題には思考モード、安価で高速な呼び出しには非思考モードを、モデル単位ではなくリクエスト単位で切り替え可能。

2つの階層を1つのAPI形状で実現。Proは能力向け、Flashはボリューム向け — 同じコンテキスト、同じモード、同じ統合。

デュアルAPI互換性。 V4は、OpenAI ChatCompletionsとAnthropic APIの両方のフォーマットをネイティブにサポートしているため、既存のほとんどのエージェントツールは書き換えなしで接続できます。

価格:実際のコスト

これがV4を有名にしているセクションです。V4-Proは入力トークン100万個あたり$0.435、出力トークン100万個あたり$0.87です。 V4-Flashは$0.14と$0.28です。繰り返しコンテキストでのキャッシュヒットは、100万トークンあたり1セント未満で記載されています。 — 同じプロジェクト状態を再読み込みするエージェントループにとっては実質的に無料です。

参考までに:夏のコスパ優良品として称賛されているGLM-5.2は、$1.40 / $4.40の価格です。Claude Sonnet 5は$3 / $15、Claude Opus 4.8は$5 / $25です。V4-Proの出力価格はGLM-5.2の5分の1、Opus 4.8の約3%です。たとえV4-Proが直接比較の品質でいくつかの対決に負けるとしても(実際負けていますが)、その経済性によって、そもそもモデルに問いかける価値のある質問が変わってくるのです。

正式リリースに伴い、1つの変更があります。DeepSeekの6月29日の通知によると、7月中旬から、ピーク時間帯(北京時間09:00~12:00および14:00~18:00)のトークン価格はすべて2倍になり、オフピーク時間帯は現在の料金が維持されます。2倍になっても、V4-Proのピーク出力価格(約100万トークンあたり1.74ドル)はGLM-5.2の標準料金を下回っていますが、均一料金の時代はプレビュー版で終了します。トラフィックが中国の営業時間中にピークを迎える場合は、変動をモデル化するか、スケジュールとルーティングで回避してください。

レビュースコア

以下のスコアは、DeepSeekの公式ドキュメントとZ.aiが公開したクロスモデルベンチマーク表に基づく編集部による評価です。クロスベンダーの数値はDeepSeek自身の主張ではなく、第三者による参考情報として扱ってください。

コーディング: 8/10 — 日常的なエンジニアリングに十分対応可能;オープンウェイトのリーダーではない

- エージェンティック / ツール使用: 7/10 — 確かなツールオーケストレーション、マラソン級の自律性は弱い

- 推論: 8/10 — 価格帯において数学と科学のスコアが高い

- 費用対効果: 10/10 — 比較できるものは他にありません

- コンテキストと長文書: 9/10 — 入力1M、出力384K、ほぼ無料のキャッシュヒット

- 速度:8/10 — アクティブパラメータ数を削減、さらに高速パス向けの非思考モード

総合評価: ~8.3/10 — 2026年中期のコスパ王、長期視点での但し書き付き。

長所

- カーブをリセットする価格設定:ファミリー全体で100万トークンあたり0.14~0.87ドル

- 1Mコンテキスト標準、384K出力 — 同クラス最大の出力上限

1つのエンドポイントで思考モードと非思考モードを、リクエストごとに切り替え可能

OpenAI と Anthropic の API 互換性は、移行の摩擦がほぼゼロであることを意味します。

- オープンソース化された重みは、セルフホスティングとファインチューニングの可能性を保持します。

短所

- 長期的なエージェント作業が明らかな弱点である — Z.aiの公開表によると、V4-ProはFrontierSWEで29.0を記録している一方、GLM-5.2は74.4、Claude Opus 4.8は75.1を記録している

- テキストのみ: V4 APIでは画像入力はありません

ピーク時間帯の料金制度は7月中旬の正式リリースとともに導入される。北京のビジネス時間帯には料金が2倍になるため、予算は一定ではなくなる。

7月中旬まではプレビュー版のため、正式版では動作が変更される可能性があります。

2026年7月24日のdeepseek-chatとdeepseek-reasonerの廃止により、レガシーユーザーはDeepSeekのスケジュールに従って移行することを余儀なくされます。

- 1.6TパラメータのProをセルフホスティングすることは、ほぼすべての人にとって非現実的です(284BのFlashが現実的なターゲットです)

DeepSeek V4の比較方法

V4-Pro vs V4-Flash。同じコンテキスト、同じモード、同じAPI — 違いは品質対スループットであり、価格差は3倍です。賢明なデフォルト設定:Flashは要約、抽出、分類、チャットに;Proはコード、分析、人間が確認するものすべてに。

vs GLM-5.2。この夏のオープンウェイト争いは、価値の面で本当に拮抗しています。GLM-5.2はより強力なコーダーであり、Z.aiが公開した表では、Terminal-Bench 2.1でV4-Proを81.0対64.0でリードし、長期的な作業では(FrontierSWEで74.4対29.0)圧倒しています。一方、V4は3〜5倍低い価格と3倍の出力上限で対抗しています。ボリュームパイプラインはV4に、コーディングエージェントはGLM-5.2に傾いています。

閉ざされたフロンティアに対して。Claude Opus 4.8とGPT-5.5は、依然として難しいベンチマークで明らかに強いモデルです。しかし、Opus 4.8との30–60倍の出力価格差では、V4はその戦いに勝とうとしているのではなく、トラフィックの90%を、他のどこかに送ることを正当化できないほど低コストにしようとしているのです。

7月24日の期限:レガシー名からの移行

あなたの統合がまだ `deepseek-chat` または `deepseek-reasoner` を呼び出している場合、これらの名前は2026年7月24日15:59 UTC以降動作しなくなります。現在、それらはV4-Flashにルーティングされているため、トラフィックはすでにV4のエコノミクスで動作していますが、カットオフ後はリクエストが完全に失敗します。移行自体は1行(`model: "deepseek-v4-pro"` または `"deepseek-v4-flash"`)で済むため、実際の作業はV4の動作に対してプロンプトを再テストし、エンドポイントごとに各ワークロードにどのティアが適しているかを判断すること、あるいはルーターを導入して次の非推奨がコード変更ではなく設定変更になるようにすることです。

DeepSeek V4は誰が使うべきですか?

ハイボリューム製品 — サポート、要約、抽出、分類 — において、V4価格設定が限界的な機能を収益性のあるものに変える。

毎日1Mトークンのウィンドウを埋め、事実上無料のキャッシュヒットから利益を得る、長文書およびRAGを多用するワークロード

長い出力を生成するチーム:コードベース、レポート、構造化データ — 384K出力はクラスの上限です

コスト意識が高く、有能なデフォルトを望み、難しい10%を他の場所に回すことに満足しているビルダー

他を探すべき人は誰ですか?

コアワークロードが長時間実行される自律エージェントであるチーム — GLM-5.2またはクローズドフラッグシップの方が安全な道です

ビジョン依存ワークフロー(V4は画像を取得しない)

今日、プレビューではなく、契約上の「安定」ラベルを必要とする人

DeepSeek V4は価値がありますか?

価格面から言えば、間違いなくイエスです——ただし宗教ではなく、ひとつのレーンとして。V4は最高のオープンウェイトコーダー(GLM-5.2)や最先端のフラッグシップモデルに品質で勝るわけではなく、長期エージェントの数値も本当に弱いです。しかし、V4が実現するのは、日常的なAI作業の膨大な領域——実際のトークン請求を支配する要約、抽出、下書き、チャットのターン——をほぼ無料にすることです。勝利のパターンは、V4をボリュームフロアとし、その上にエスカレーションレーンを置くことです。

最終評決

DeepSeek V4は、他のすべてのモデルが今や比較される価格性能比のベンチマークです — 私たちのスコアは約8.3/10。ボリュームが重要ならFlashを、品質が重要だが予算が現実的ならProを実行し、最高級の作業はより強力なモデルにルーティングしてください。7月中旬にピーク価格が導入されたら、コスト計算をやり直してください — 安いものは安いままですが、フラットではなくなります。そして、まだdeepseek-chatやdeepseek-reasonerを使っているなら、期限は7月24日までです。移行してください。

OrcaRouter経由でのDeepSeek V4の使用

「3レーン戦略——ボリューム向けのV4、難しいタスク向けのより強力なオープンまたはクローズドモデル、信頼性のためのフォールバック——これは手動で実行するのは面倒で、ゲートウェイの背後では簡単な設定です。OrcaRouterは、DeepSeek V4、GLM-5.2、Claude、GPT、Gemini、および200以上の他のモデルを、一つのOpenAI互換エンドポイントを通じて提供し、プロバイダーのリスト価格でトークンマークアップはゼロです。スマートルーティングはリクエストごとにレーンを選択し、自動フェイルオーバーはプレビュー時代の不具合をカバーし、モデルごとの可観測性により、各レーンが完了タスクごとに実際にいくらかかるかを示します。また、7月24日の名称廃止や7月中旬のピーク時料金など、プロバイダー側の変更を無効化します。モデル名が廃止されたり、価格ウィンドウが開いたりした場合、コードベースではなくルーティングルールを更新するだけです。」

よくある質問

DeepSeek V4 は現在利用可能ですか?

はい — V4-ProとV4-Flashは、2026年4月24日よりDeepSeek APIで公開されており、モデルIDはdeepseek-v4-proおよびdeepseek-v4-flashで、重みはオープンソース化されています。公式にはプレビュー版であり、DeepSeekの6月29日の通知によると、正式版は2026年7月中旬の予定です。

DeepSeekのピーク時料金とは何ですか?

公式リリースとして発表:2026年7月中旬以降、北京の営業時間帯(北京時間09:00-12:00および14:00-18:00)におけるすべてのトークン価格が2倍になり、オフピーク時間帯は現在の料金が維持されます。中国の営業時間外にピークを迎えるトラフィック(ほとんどの西側のワークロード)は、この追加料金をほとんど回避できます。

deepseek-chat と deepseek-reasoner はどうなりますか?

現在は自動的にV4-Flashにルーティングされていますが、2026年7月24日 (15:59 UTC) 以降は両方の名前が完全に廃止され、リクエストは失敗します。期限までに明示的にモデルパラメータを更新してください。

V4-ProとV4-Flashのどちらを使うべきですか?

Flashはボリューム作業用で、人間が行単位でレビューすることはありません — 要約、抽出、分類、チャット向け。Proはコード、分析、ドラフト作成用で、価格はFlashの約3倍ですが、それでも同等のモデルよりはるかに低価格です。

DeepSeek V4 は GLM-5.2 より優れていますか?

より安いが、より良いわけではない。Z.aiの公開テーブルでは、GLM-5.2がコーディングで明らかにリードし、長期的なエージェント作業で支配的だ。V4はそれに対抗して3~5倍低い価格、38万4千の出力上限、ほぼ無料のキャッシュヒットを提供する。多くのチームは両方を使用している:V4は大量処理に、GLM-5.2はコーディングエージェントに。

DeepSeek V4は画像を処理できますか?

いいえ — V4 APIはテキストのみです。代わりに、ビジョンタスク(スクリーンショット、ピクセルとしてのPDF、チャートなど)はClaudeやGeminiなどのマルチモーダルモデルにルーティングしてください。

DeepSeek V4をセルフホストできますか?

重みはオープンソース化されていますが、規模については現実的に考える必要があります。V4-Proは1.6TパラメータのMoEであり、データセンター向けの領域です。一方、284BのV4-Flashは、リソースの豊富なチームにとって実用的なセルフホスティングのターゲットです。

V4は既存のOpenAIやClaudeのツールで動作しますか?

概ねそうです — APIはネイティブでOpenAI ChatCompletionsとAnthropicの両方のフォーマットをサポートしているため、どちらかに向けて作られたエージェントフレームワークやSDKは通常、base-URLとmodel-nameの変更だけで接続できます。

DeepSeek V4をOrcaRouter経由で使用できますか?

はい — DeepSeekモデルはOrcaRouterでプロバイダーリスト価格(マークアップ無し)で利用可能であり、GLM、Claude、GPT、Geminiと並んで、一つのエンドポイントの背後でボリュームプラスエスカレーション分割を実行できます。

トークン料金を気にしなくて済む準備はできていますか?OrcaRouterアカウントを作成し、OpenAI互換のクライアントを1つのエンドポイントに向けて、より強力なモデルが山頂を処理する間、ボリュームをDeepSeek V4にルーティングします。トークンのマークアップはゼロ、July 24-proofな統合で。


© 2026 OrcaRouter

プロバイダー向け

推論プラットフォームを運営していますか?OrcaRouter にモデルを掲載しましょう。

お問い合わせ

コミュニティに参加

DiscordEmailXGitHubYouTube