モデル価格に関するテクノロジーブログのヒーロー画像のためのエディトリアル・フラットベクターイラスト:柔らかなシアンのグローを放つディープブルーの大きな角丸モデルチップ、その角にクリップ留めされた紙の値札、円形の価格ゲージに流れ込む3つのトークンストリーム、フレームにスライドインするスリムなカレンダーシート、そして柔らかなライトブルーの背景に下部3分の1はたっぷりとした余白。テキストなし。
Guides & Insights

DeepSeek V4 Pro APIの料金:オフピーク時は$0.73/$2.18、そして9月14日のシャットダウンが中止された理由

著者

Rowan Sterling

公開日

最新モデル · 20すべてのモデルを見る →
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

DeepSeek V4 Pro は廃止されません。2026年9月11日、DeepSeek は9月14日以降も API を通じて同モデルの提供を継続し、課金方法も変更しないと発表しました。これは、2日前に発表された、すべての deepseek-v4-pro リクエストをDeepSeek V4.1 Flashに転送し、Flash の料金で課金するという計画を撤回するものです。プロンプト、temperature 設定、ツール呼び出しのスキーマを V4 Pro に合わせて調整してきた人にとって、今週重要なのはこの事実です。つまり、自分が前提にしていたモデルはそのまま残り、月曜日に予定していたかもしれない移行を行う必要はありません。

料金はまた別の話で、このページはそれを1か月にわたって間違えて掲載していた。DeepSeek V4 Pro はもはや100万トークンあたり $0.44/$0.88 ではない。オフピーク時には OrcaRouter で入力 $0.726、出力 $2.178(100万トークンあたり)で課金され、ピーク時間帯には $1.452/$4.356 へと倍増し、キャッシュ読み取りは $0.024 となる。週末は完全にオフピークになった。そしてベンダー自身の料金表——DeepSeek の API ドキュメントにあるもの——は、同じ価格表の脚注として継続の告知を添えており、料金ページが一次情報源にこれ以上なく近づいたものと言える。

DeepSeekが実際に述べたこと、そしてそれが覆すもの

時系列が重要なのは、3つの発表のうち2つが互いを覆す内容で、しかも人々が覚えているのは真ん中のものだからだ。

• 9月9日 — DeepSeekはユーザーに対し、V4.1 Proがリリースされるまで、V4 ProへのリクエストはDeepSeek V4.1 Flashにルーティングされ、V4.1 Flashの料金で請求されると伝えた。

• 9月10日 — V4.1 Flash がリリースされ、DeepSeek は切り替えを固定の時点に設定した。2026年9月14日北京時間12:00で、その後 V4 Pro はオフラインになり、そのトラフィックは Flash によって処理されることになった。

• 9月11日 — DeepSeekが方針を撤回。その文言は現在、自社APIドキュメントのModels & Pricingページの脚注としてそのまま掲載されている:「ユーザーの需要にお応えするため、2026年9月14日以降もDeepSeek V4 ProのAPIサービスを引き続き提供することを決定しました。課金方法に変更はありません。変更がある場合は改めてお知らせいたします。」

これはベンダーが自社製品について語ったもので、ここで得られる最も信頼性の高い情報源です。ただし、何を確定し、何を確定していないかを読み取ってください。確定しているのは継続性と課金です。V4 Pro は現行の料金体系のまま存続します。しかし期間は約束されていません。 当社は追って通知します——これが約束のすべてであり、同じ一文が、このプランが復活する余地も残しています。数四半期にわたるコミットメントを行うのであれば、維持できるモデルではなく、乗り換えられるモデルを前提に計画してください。

その撤回を強いた反発は、理解する価値がある。なぜなら、それはあなた自身がまさにこれから下そうとしている判断に重なるからだ。開発者たちが反対したのは V4.1 Flash そのものに対してではない——DeepSeek によれば、V4.1 Flash は性能、価格、速度、総タスク時間のすべてで V4 Pro を上回る——そうではなく、自動的な置き換えに対してだった。安定したモデル ID の裏でモデルを差し替えれば、コードを変えないまま挙動が変わってしまう。チューニング済みのプロンプト、意図どおりに効く temperature、パースが通るツール呼び出しスキーマは、いずれも特定のチェックポイントに固有の性質だからだ。CLS(科创板日报)、36Kr、IT之家、ifeng、そして英語では TheBlockBeats の報道が、DeepSeek がまず先延ばしにし、その後計画を断念した経緯を伝えている。DeepSeek 自身のドキュメントはその対比を鮮やかに示している。旧来の deepseek-v4-flash という名前は廃止され、現在は V4.1 Flash を提供するようになっており、その切り替えは定着した。Pro の切り替えは定着しなかった。

本日の価格は、ベンダー自身の料金表と照合済み

Price card titled 'DeepSeek V4 Pro — price per 1M tokens', sourced 'OrcaRouter directory, checked 2026-08-15'. Three highlight cells read Input $0.442, Output $0.884 and Cache read $0.060 USD at zero markup. A row reads DeepSeek official rate (CNY, today): ¥3 in, ¥6 out, cache hit ¥0.025. Two columns show the August 17 change: off-peak input ¥4.5, output ¥13.5, cache hit ¥0.15; peak input ¥9, output ¥27, cache hit ¥0.30. Footer: peak output is 4.5x today's ¥6, off-peak is half of peak, peak windows Beijing weekdays 09:00-12:00 and 14:00-18:00.

重要なのは2つの数字であり、それらは同じ定価を2つの通貨で示したものである。

• オフピーク(以下のピーク時間帯以外のすべての時間)— キャッシュミス時の入力は100万トークンあたり $0.726(¥4.5)、出力は $2.178(¥13.5)、キャッシュヒット時の入力は $0.024(¥0.15)。

ピーク時 — ちょうど2倍。入力 $1.452 / ¥9、出力 $4.356 / ¥27、キャッシュヒット時の入力 $0.048 / ¥0.30。

• DeepSeek自身のドル換算 — ベンダーのドキュメントには、同じ人民元の料金リストが、オフピーク時は入力$0.66 / 出力$1.98、ピーク時は$1.32 / $3.96、キャッシュヒット時は$0.022と$0.044として記載されています。OrcaRouterのドル表示との差は、追加のトークン手数料ではなく、双方が換算に用いる為替レートです。OrcaRouterはプロバイダーのレートをマークアップなしでそのまま通すため、掲載されている数字がそのまま支払う数字です。

• V4 Proには無料枠がありません。ディレクトリには無料のFlash枠が用意されていますが、フラッグシップは有料のみです。

• 参考までに仕様表を挙げると — V4 Pro は MIT ライセンスのオープンウェイトモデルで、総パラメータ数 1.6T、トークンあたり 49B がアクティブ、コンテキストウィンドウは 1M トークン、最大出力トークン数は 384K、同時実行数の上限は 500。Artificial Analysis によれば、出力は毎秒 72.3 トークン。

このすべての背後にあるモデルバージョンはDeepSeek-V4-Pro-0813であり、8月13日の一般提供リリース以来変わっていない——まさにそこが要点だ。9月11日にチェックポイントそのものは何一つ動かなかった。動いたのは、その将来に関する決定だけである。

ピーク、オフピーク、そして計算を変える週末ルール

このページの以前の版で8月17日に導入されると説明されていたピーク/オフピーク制度は、今では導入から1か月が経過しており、その後一度改正されている。

• ピーク時間帯 — 01:00–04:00 と 06:00–10:00 UTC、月曜日から金曜日。北京時間では 09:00–12:00 と 14:00–18:00 で、DeepSeek自身の勤務時間帯にあたります。オフピーク料金はピーク時のちょうど半額で、ピーク時に上乗せされる割引帯ではありません。

• 週末は完全にオフピークです。2026年8月23日北京時間00:00より、DeepSeekは土曜日と日曜日にピーク料金を適用することをやめました。バッチ処理を移動できるなら、週末に移すだけで請求額が半分になります。また、アメリカ大陸のユーザーにサービスを提供しているチームにとっては、稼働日の大半がスケジュール調整をまったくしなくてもすでにオフピーク時間帯に当たります。

• 変更によって何がいくらになったか — 8月13日にモデルが提供開始されたときの¥3/¥6と比べると、現在のオフピーク出力は開始時の2.25倍、ピーク出力は4.5倍。ピーク時のキャッシュヒット入力は旧¥0.025の12倍。

ここには非対称性がある。それが、停止が取り消された後でも移行の話が繰り返し出てくる理由を説明している。V4 Proの価格は8月に上がった一方、その後継の価格は下がった。Deep​Seekは9月10日付でFlashシリーズAPIの価格を最大60%引き下げた。移行を促す圧力は、そもそも9月14日の通知が原因だったわけではない。その通知は、ただそれを緊急のものにしただけだ。

リクエストの実際のコスト

本日のオフピーク料金による試算例を3つ。いずれもピーク時間帯に入ると2倍になります。

• 100K入力 + 50K出力 — $0.0726 + $0.1089 ≈ $0.18

• 1M入力 + 1M出力 — $0.726 + $2.178 = $2.90。同じ呼び出しはピーク時に$5.81で、8月中旬には$1.32でした。

• エージェントセッション、500K入力 + 200K出力 — $0.363 + $0.4356 ≈ $0.80.

月次ビューはモデルページにあり、以前の見出しが今もあなたの請求額を正しく表しているかどうかを正直に検証するものです。月1,000万トークン、入力が70%の割合を占める場合、コスト計算機は$11.62、プロンプトキャッシュを有効にすると約$9.16になります。予算を$0.44を前提に組んでいたなら、それで賄えるのは請求額の約60%です。

キャッシュは誰もテーブルに載せないレバーだ

料金が上がったとき、プロンプトキャッシングは価値が下がるどころか、むしろ高まった——そしてその理由は2つの数値の向きにある。OrcaRouterでは、キャッシュ読み取りは現在、100万トークンあたり$0.024で、未キャッシュの$0.726に対して請求される。再送するあらゆる入力に対して96.7%の割引だ。このページの前バージョンでは、キャッシュ料金は$0.060で、入力価格$0.442に対して86%の割引だった。キャッシュ読み取り価格は半分以上下がった一方、未キャッシュ入力価格は64%上昇したため、キャッシュ済みトークンと未キャッシュトークンの実効的な差はかなり広がった。

毎ターン、大きなシステムプロンプトと長いコンテキストを再送信するエージェントにとって、キャッシュされた入力は、請求額が会話の長さに比例して増えるか、そうならないかを分ける違いです。実用的なルールは変わっておらず、繰り返す価値があります。安定したシステムプロンプトと参照資料を先頭に、変動するコンテンツを最後に置くことです。そうすれば、再送信するプレフィックスが実際にキャッシュにヒットします。このモデルでは、その単一の構造上の選択は、その下にあるどのルーティングやスケジューリングの決定よりも価値があります。

V4 Proの価格を競合他社と比較する

Comparison table card titled 'USD per 1M tokens — the field', sourced to the OrcaRouter directory checked 2026-08-15, with an input/output column pair per model: DeepSeek V4 Flash $0.15/$0.29; DeepSeek V4 Pro $0.44/$0.88 highlighted with a 'THIS PAGE' tag; MiniMax M3 $0.30/$1.20; Gemini 3.6 Flash $1.50/$7.50; Grok 4.5 $2.00/$6.00; Qwen 3.8 Max $2.00/$6.00; GPT-5.6 Terra $2.00/$12.00; Kimi K3 $3.00/$15.00; Claude Opus 5 $5.00/$25.00; GPT-5.6 Sol $5.00/$30.00; Claude Fable 5 $10.00/$50.00. Footer: V4 Pro is the cheapest 1M-context flagship, roughly 23x cheaper on input and 57x cheaper on output than Claude Fable 5.

ディレクトリの入力/出力のリスト価格(100万トークンあたり、2026-09-12時点で確認)を、V4 Proのオフピーク$0.726/$2.178と突き合わせたもの。このうち2つは本ページの初回公開以降に変動しており、そのうちの1つは結論を変えるものである。

• Claude Fable 5 — $10 / $50。V4 Proは入力で13.8倍、出力で23倍安価です。

• Claude Opus 5 — $5 / $25。6.9× / 11.5×。

• GPT-5.6 Sol — コンテキスト272Kまでは$4 / $20、それを超えると$8 / $30。短いティアでは5.5× / 9.2×、長いティアでは11× / 13.8×。

• Kimi K3 — $3 / $15。4.1× / 6.9×。

• Qwen3.8 Max — $2 / $6。2.8× / 2.8×。

• Grok 4.5 — $2 / $6。2.8× / 2.8×。

• Gemini 3.6 Flash — $0.75 / $3.75。入力は1.03×でほぼ同等、出力は1.7×。このページの執筆以降、価格は半額になっている。

• MiniMax M3 — $0.30 / $1.20。V4 Pro より安価、今や両方のラインで:V4 Pro は入力で 2.4 倍、出力で 1.8 倍のコストがかかり、1M トークンのウィンドウは同じです。

• DeepSeek V4 Flash — ディレクトリ上で $0.242 / $0.726。両ラインとも約3倍安く、1Mコンテキストは同じ。

正直なところ、前提が変わった。だからこのページも、昔の最上級の表現を引きずるのではなく、それをきちんと書くべきだ。DeepSeek V4 Pro はもはや、この一覧で最も安い100万トークン文脈のモデルではない。Gemini 3.6 Flash と MiniMax M3 のどちらもそれを下回っており、しかも MiniMax M3 は同じコンテキストウィンドウを備えたうえでそれを実現している。それでも V4 Pro が桁違いに依然として唯一の存在なのは、フロンティア層の中で最も安いという点だ。この一覧にある欧米のフラッグシップ級モデルはどれも、両方の指標でその何倍ものコストがかかる。「可能な限り最も安い100万トークン文脈の呼び出し」が問いなら、答えはもうこのモデルではない。「フロンティアモデルのように振る舞う中で最も安いモデル」が問いなら、今のところ依然としてこれだ。

V4 Proが不適切な選択である場合

• 北京の日中の時間帯にトラフィックが最も集中する場合。ピーク時間帯は料金が2倍になり、そのピーク時間帯はちょうど中国の勤務日に重なります。ユーザーが南北アメリカにいるなら、トラフィックの大半はすでにオフピーク帯に収まっており、これは実質的な構造上の優位性です。中国のユーザー向けに構築しているなら、契約する前にピーク請求額を明示的に試算し、週末ルールによって何かを移せるかどうかを確認してください。

• プロンプトが短い場合。コンテキストがおよそ10Kトークンを下回ると、フラッグシップティアは無駄な能力です。ディレクトリ上のDeepSeek V4 Flashは$0.242/$0.726で、同じ1Mコンテキストを約3分の1の価格で処理し、本当に短いタスクならより安価なモデルの方が依然として勝ります。

• ビジョンが必要な場合。V4 Pro はテキスト専用で、画像も音声も入力できません。また Artificial Analysis はその入力モダリティをテキストと記載しています。モダリティが要点なら、Gemini 3.6 Flash または Claude Fable 5 のほうが適しています。DeepSeek 自身の API もここで注目に値します。現在は従来の flash モデル名を V4.1 Flash で提供しており、こちらは画像を受け付けます。

• ベンチマークで最高水準の生スコアを、コンテキストあたりの価格よりも重視して選ぶなら。Artificial Analysisの現在の尺度では、V4 ProはIntelligence Indexで36(執筆時点で113モデル中8位)を記録し、OrcaRouterディレクトリに掲載されているCoding indexでは69だ。これは競争力はあるが、首位ではない。コーディングではClaude Fable 5、Claude Opus 5、GPT-5.6 SolがいずれもV4 Proを上回る。V4 Proの売りは、あらゆるチャートの頂点にあることではなく、トークンあたり価格の何分の一かでフロンティアに近い能力を提供することだ。

OrcaRouterでの呼び出し方

Screenshot of the OrcaRouter model page for DeepSeek V4 Pro (model ID deepseek/deepseek-v4-pro): FLAGSHIP FEATURED badge, '1M tokens' context and 384K max output, input and output price per 1M tokens (output shown at $0.88), /v1/chat/completions and /v1/responses endpoints, and an OpenAI SDK code sample pointing at api.orcarouter.ai/v1.

DeepSeek V4 ProはOrcaRouter上でモデルID deepseek/deepseek-v4-proとしてホストされており、api.orcarouter.ai/v1のOpen​AI互換エンドポイントを通じて、プロバイダー料金のままマークアップなしで提供されています。既存のOpen​AIクライアントからの移行は、ベースURLとモデルIDを変更するだけです。

この撤回は、それに対してあなたが取るべき対応を変える。カレンダーに9月14日の移行を入れていたなら——ProがなくなるためにV4 ProからDeepSeek V4.1 Flashへ向き先を変える——それをカレンダーから外せる。少なくとも、締め切りからテストへと格下げできる。両モデルは1つのOrcaRouterキーの背後にあるので、両者を比較するのは、2つ目の契約と2つ目のSDKではなく、リクエスト内のモデルIDの変更で済む。そして、V4.1 Flashを本番経路として賭けることなく実際のトラフィックで評価したいのであれば、自動フェイルオーバーが、V4 Proをフォールバックとして残したままV4.1 Flashに生きたリクエストを渡す低リスクな方法だ。これが9月11日の決定の実務的な形である——選択はあなたのままであり、そして可逆のままだ。

料金ページで重要な誠実さの注記:当社はモデルへルーティングするのであって、その価格を設定しているわけではありません。$0.726/$2.178 のオフピーク料金は Deep​Seek の料金をそのまま反映したもので、Deep​Seek が変更すればそれに伴って動きます — まさにそれが、このページに日付が付されている理由であり、あなたが読んでいる版が追記ではなく書き直された理由でもあります。

出典と日付

このページの価格と仕様は2026-09-12に再確認されました。DeepSeek V4 Proおよび比較対象の全モデルのドル金額はOrcaRouterのモデルディレクトリから読み取り、同日に確認しました。パラメータ数、ライセンス、コンテキストウィンドウ、モダリティ、速度の数値は、Artificial AnalysisのDeepSeek V4 Pro 0813のモデルページに基づきます。人民元レート、ピーク時間帯、9月11日の継続告知は、DeepSeek自身の「Models & Pricing」ドキュメントに基づいており、価格表の脚注としてその文言がそのまま掲載されています。3段階の告知の流れ — 9月9日のルーティング通知、9月10日の9月14日北京時間12:00への延期、9月11日の撤回 — は、CLS(科创板日报)、36Kr、IT之家、ifeng、そして英語ではTheBlockBeatsが報じています。8月23日の週末課金ルールと9月10日のFlash値下げは、IT之家、The Paper、21st Century Business Heraldが報じたDeepSeekの告知に基づきます。

信頼性について最後に一言。というのも、この特定の価格は1か月で3回動いている——8月13日の開始料金、8月17日のピーク/オフピーク、8月23日の週末改定だ。日付のない「V4 Pro pricing」ページは使えないものとして扱うこと。このページの以前の版では $0.44/$0.88 と Artificial Analysis Intelligence index 44.3 が示されていた。どちらも書かれた時点では正しかったが、どちらもその月のうちに通用しなくなった。

この記事で比較したモデル3

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新