DeepSeek V4 Flash 0731

deepseek/deepseek-v4-flash-0731
新着注目
ツールJSON推論
提供 DeepSeek · 2026-07-31

DeepSeek V4 Flash 0731 は、DeepSeek の効率的な V4 Flash 混合エキスパート(MoE)モデルの再ポストトレーニング版公式リリースです。総パラメータ数 284B / アクティブパラメータ 13B で、アーキテクチャとサイズは 4 月リリースの V4 Flash と同一ですが、ポストトレーニングはゼロから再実施されています。1M トークンのコンテキストウィンドウと最大 384K トークンの出力に対応し、思考モード(デフォルトでオン)と非思考モードの両方をサポート。さらに JSON 出力とツール呼び出しにも対応し、Responses API をネイティブにサポート、Codex スタイルのコーディングエージェント向けに特化した適応が施されています。 0731 リビジョンはエージェント能力において大幅な向上を遂げており、DeepSeek が公開したエージェントベンチマークでは DeepSeek V4 Pro Preview をも上回るスコアを記録しています。Terminal Bench 2.1 で 82.7、Cybergym で 76.7、Toolathlon Verified で 70.3、DeepSWE で 54.4、NL2Repo で 54.2 を達成。DeepSeek ファーストパーティ API では、このリビジョンが現在 deepseek-v4-flash モデル ID として提供されており、日付指定の識別子も同じリビジョンを参照します。コーディングエージェント、ターミナルおよびツール使用のワークロード、そしてフラッシュ層のコストで高スループットなエージェントパイプラインに最適な選択肢です。

コンテキスト1M トークン
最大出力384K
入力text
出力text
p50 TTFT791 ms
入力$0.15/ 100万 tokens
出力$0.29/ 100万 tokens
p50 TTFT791 ms7日
p95 TTFT1.42 s7日
トラフィック4.3Mtokens / 7日

DeepSeek V4 Flash 0731 は、プロバイダー deepseek が提供するテキスト専用の言語モデルであり、OrcaRouter を通じてモデル ID deepseek/deepseek-v4-flash-0731 で利用可能です。主要仕様は、1,048,576 トークンのコンテキストウィンドウ、最大 384,000 トークンの出力、および Terminal Bench 2.1…

DeepSeek V4 Flash 0731とは何ですか?

このモデルは誰向けですか?

このモデルは、OrcaRouter上のDeepSeekファミリー内のどこに位置しますか?

コードサンプル

あらゆる SDK から呼び出し

OpenAI 互換——今お使いの SDK のまま

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Anthropic SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-flash-0731",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

対応パラメータ

  • frequency_penalty
  • include_reasoning
  • logit_bias
  • logprobs
  • max_tokens
  • min_p
  • presence_penalty
  • reasoning
  • reasoning_effort
  • repetition_penalty
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

料金

入力 / 1M tokens$0.147
出力 / 1M tokens$0.295
キャッシュ読み取り / 1M$0.020
通貨USD

料金計算ツール

月間トークン数10MM
入力の割合70%%
月額見積もり $1.91 · プロンプトキャッシュ利用時 $1.47

表示価格に基づく概算

トークン・コスト見積もり

入力トークン: 8リクエストあたりのコスト: $0.000149

見積もりのみ — 実際のトークン数はプロバイダーのトークナイザーに依存します。

パフォーマンス

p50 TTFT
791 ms
出力速度
101 tok/s
p95 TTFT
1.42 s
エラー率
0%

公開ベンチマーク

69.1
AA Coding
比較対象モデルの 85% を上回る
124 中 18 位
49.9
AA Intelligence
比較対象モデルの 80% を上回る
126 中 24 位
Agent Last Exam
25.2
Automation Bench (Public)
25.1
Cybergym
76.7
DeepSWE
54.4
GPQA Diamond
90.8
Humanity's Last Exam
36.8
Long-Context Recall
65.7
NL2Repo
54.2
SciCode
49.9
tau_banking
31.1
Terminal Bench 2.1
82.7
terminalbench_v2_1
78.7
Toolathlon Verified
70.3
ソース: artificialanalysis.ai, api-docs.deepseek.com

コミュニティの話題

今週の開発者の声

Hacker News7 件の言及 · 7日間先週比 7 増加

比較

DeepSeek V4 Flash 0731DeepSeek V4 ProDeepSeek V4 FlashDeepSeek V3
入力 $/100万$0.15$0.44$0.15$0.15
出力 $/100万$0.29$0.88$0.29$0.29
コンテキスト1.0M1.0M1.0M1.0M
品質6/108/107/105/10
並べて比較並べて比較並べて比較並べて比較

よくある質問

DeepSeek V4 Flash 0731の料金はいくらですか?
入力トークン100万個あたり$0.15、出力トークン100万個あたり$0.29です。OrcaRouterはプロバイダー料金をそのまま請求し、マークアップは一切かかりませんので、お支払いいただく料金はこの金額となります。モデルカードには、キャッシュされた入力の価格設定やバッチ割引についての記載はありません。
コンテキストウィンドウと出力上限はどれくらいに対応していますか?
1,048,576トークンの入力コンテキストと、最大384,000トークンの出力に対応しています。入力モダリティはテキストのみです。モデルカードには、これらの2つの上限以外に、別途の合計トークン上限は記載されていません。
このモデルは何が一番得意ですか?
記載されている事実に基づくと、その強みはターミナルおよびコマンドラインでのタスク完了であり、Terminal Bench 2.1で82.7のスコアを達成していることからも明らかです。また、大規模なコンテキストと出力上限により、長文ドキュメントのテキスト処理や長文生成にも対応しています。他のベンチマークスコアは提供されていません。
他のモデルと比べてどうですか?
提供された事実はこのモデルのみを対象としています。OrcaRouterカタログ内の候補を、コンテキストウィンドウ、最大出力、モダリティ、および100万トークンあたりの価格で比較してください。このモデルはテキストのみに対応し、コンテキストは100万トークン、出力は384Kで、価格は100万トークンあたり$0.15/$0.29です。
このモデルをOrcaRouter経由で使用する場合、データはどのように扱われますか?
利用可能な事実には、このモデルのデータ保持、トレーニング利用、または保管に関する記述は含まれていません。データの取り扱いは、OrcaRouterの利用規約およびプロバイダーであるdeepseekのポリシーによって管理されます。機密データを送信する前に、OrcaRouterのドキュメントを確認してください。
このモデルを呼び出すにはどうすればいいですか?
OrcaRouterのOpenAI互換APIをベースURL https://api.orcarouter.ai/v1 で使用し、モデルID deepseek/deepseek-v4-flash-0731 を使用してください。OrcaRouter APIキーとテキストのみのメッセージを使用して、標準のチャット補完リクエストを送信してください。
ストリーミングまたは関数呼び出しをサポートしていますか?
利用可能な情報には、ストリーミングまたは関数呼び出しがサポートされているかどうかは記載されていません。APIはOpenAI互換なので、それらの機能に依存する前にテストしてください。max_tokensは384,000の出力上限内に設定してください。
これはマルチモーダルモデルですか?
いいえ。入力モダリティはテキストのみです。画像、音声、または動画の場合は、OrcaRouterのカタログにあるマルチモーダルモデルか、別個の前処理ステップが必要です。

このバッジを埋め込む

DeepSeek: DeepSeek V4 Flash 0731$0.15/M in791ms p50OrcaRouter 経由
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash-0731" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash-0731.svg" alt="OrcaRouter の DeepSeek: DeepSeek V4 Flash 0731" /> </a>
Markdown [![DeepSeek: DeepSeek V4 Flash 0731](https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash-0731.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash-0731)

モデルカードをデータで取得

GET /api/public/models/deepseek/deepseek-v4-flash-0731開く