DeepSeek V4 Flash 0731

deepseek/deepseek-v4-flash-0731
NeuEmpfohlen
ToolsJSONReasoning
von DeepSeek · 2026-07-31

DeepSeek V4 Flash 0731 ist die erneut nachtrainierte offizielle Version von DeepSeeks effizientem V4-Flash-Mixture-of-Experts-Modell – 284B Gesamt- / 13B aktive Parameter, architektonisch und in der Größe identisch mit dem V4-Flash-Release von April, wobei das Post-Training von Grund auf neu durchgeführt wurde. Es bietet ein 1M-Token-Kontextfenster mit bis zu 384K Ausgabe-Tokens, unterstützt sowohl Denk- als auch Nicht-Denk-Modi (Denken standardmäßig aktiviert) sowie JSON-Ausgabe und Tool-Aufrufe und spricht nativ die Responses API mit einer gezielten Anpassung für Codex-artige Coding-Agenten. Die Revision 0731 ist ein großer Schritt nach vorn bei der Agent-Fähigkeit und übertrifft in DeepSeeks veröffentlichten Agent-Benchmarks sogar DeepSeek V4 Pro Preview – 82,7 auf Terminal Bench 2.1, 76,7 auf Cybergym, 70,3 auf Toolathlon Verified, 54,4 auf DeepSWE und 54,2 auf NL2Repo. In der DeepSeek-Erstanbieter-API bedient diese Revision nun die Modell-ID deepseek-v4-flash; die datierte Kennung verweist für Aufrufer, die sie nach Datum referenzieren, auf dieselbe Revision. Sie ist eine starke Wahl für Coding-Agenten, Workloads für Terminal- und Tool-Nutzung sowie hochvolumige agentische Pipelines zu Flash-Tier-Kosten.

Ktx1M Tokens
Max. Ausgabe384K
Eingabetext
Ausgabetext
p50 TTFT791 ms
EINGABE$0.15/ 1M Tokens
AUSGABE$0.29/ 1M Tokens
p50 TTFT791 ms7 T
p95 TTFT1.42 s7 T
DATENVERKEHR4.3MTokens / 7 T

DeepSeek V4 Flash 0731 ist ein rein textbasiertes Sprachmodell des Anbieters DeepSeek, das über OrcaRouter unter der Modell-ID deepseek/deepseek-v4-flash-0731 verfügbar ist. Die wichtigsten…

Was ist DeepSeek V4 Flash 0731?

Für wen ist dieses Modell?

Wo steht dieses Modell in der DeepSeek-Familie auf OrcaRouter?

Code-Beispiele

Aus jedem SDK aufrufen

OpenAI-kompatibel — behalte dein bisheriges SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Anthropic SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-flash-0731",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Unterstützte Parameter

  • frequency_penalty
  • include_reasoning
  • logit_bias
  • logprobs
  • max_tokens
  • min_p
  • presence_penalty
  • reasoning
  • reasoning_effort
  • repetition_penalty
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Preise

Eingabe / 1M Tokens$0.147
Ausgabe / 1M Tokens$0.295
Cache-Lesen / 1M$0.020
WährungUSD

Kostenrechner

Tokens / Monat10MM
Eingabeanteil70%%
Geschätzt / Monat $1.91 · Mit Prompt-Caching $1.47

Schätzung auf Basis des Listenpreises

Token- und Kostenschätzer

Eingabe-Tokens: 27Kosten pro Anfrage: $0.000151

Nur eine Schätzung — die tatsächliche Token-Anzahl hängt vom Tokenizer des Anbieters ab.

Leistung

p50 TTFT
791 ms
Ausgabegeschwindigkeit
101 tok/s
p95 TTFT
1.42 s
Fehlerquote
0%

Öffentliche Benchmarks

69.1
AA Coding
Besser als 85 % der verglichenen Modelle
Nr. 18 von 124
49.9
AA Intelligence
Besser als 80 % der verglichenen Modelle
Nr. 24 von 126
Agent Last Exam
25.2
Automation Bench (Public)
25.1
Cybergym
76.7
DeepSWE
54.4
GPQA Diamond
90.8
Humanity's Last Exam
36.8
Long-Context Recall
65.7
NL2Repo
54.2
SciCode
49.9
tau_banking
31.1
Terminal Bench 2.1
82.7
terminalbench_v2_1
78.7
Toolathlon Verified
70.3
Quelle: artificialanalysis.ai, api-docs.deepseek.com

Community-Buzz

Worüber Entwickler diese Woche sprechen

Hacker News7 Erwähnungen · 7 T7 mehr als in der Vorwoche

Im Vergleich

DeepSeek V4 Flash 0731DeepSeek V4 ProDeepSeek V4 FlashDeepSeek V3
Eingabe $/M$0.15$0.44$0.15$0.15
Ausgabe $/M$0.29$0.88$0.29$0.29
Kontext1.0M1.0M1.0M1.0M
Qualität6/108/107/105/10
Nebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichen

FAQ

Was kostet DeepSeek V4 Flash 0731?
Es kostet 0,15 $ pro 1.000.000 Eingabetoken und 0,29 $ pro 1.000.000 Ausgabetoken. OrcaRouter berechnet den Anbieterpreis ohne Aufschlag, sodass Sie genau diese Preise zahlen. Die Modellkarte enthält keine Angaben zu Preisen für gecachte Eingaben oder Batch-Rabatte.
Welches Kontextfenster und Ausgabelimit unterstützt es?
Es unterstützt einen Eingabekontext von 1.048.576 Token und bis zu 384.000 Token Ausgabe. Die Eingabemodalität ist nur Text. Die Modellkarte gibt kein separates kombiniertes Token-Limit über diese beiden Obergrenzen hinaus an.
Worin ist das Modell am besten?
Basierend auf den vorliegenden Fakten liegt seine Stärke in der Erledigung von Terminal- und Befehlszeilenaufgaben, was durch eine Punktzahl von 82.7 auf Terminal Bench 2.1 belegt wird. Seine großen Kontext- und Ausgabelimits unterstützen außerdem die Verarbeitung langer Dokumente und die Generierung langer Texte. Es werden keine weiteren Benchmark-Ergebnisse angegeben.
Wie schneidet es im Vergleich zu anderen Modellen ab?
Die bereitgestellten Fakten decken nur dieses Modell ab. Vergleichen Sie Kandidaten im OrcaRouter-Katalog nach Kontextfenster, maximaler Ausgabe, Modalitäten und Preisen pro 1M Token. Dieses Modell ist rein textbasiert, verfügt über ein 1M-Token-Kontextfenster, eine 384K-Ausgabe und kostet 0,15 $/0,29 $ pro 1M Token.
Wie werden Daten bei der Verwendung dieses Modells über OrcaRouter verarbeitet?
Die verfügbaren Fakten beschreiben keine Datenaufbewahrung, Trainingsnutzung oder Speicherung für dieses Modell. Die Datenverarbeitung unterliegt den Bedingungen von OrcaRouter und den Richtlinien des Anbieters deepseek. Lesen Sie die Dokumentation von OrcaRouter, bevor Sie sensible Daten senden.
Wie rufe ich dieses Modell auf?
Verwenden Sie die OpenAI-kompatible API von OrcaRouter unter der Basis-URL https://api.orcarouter.ai/v1 mit der Modell-ID deepseek/deepseek-v4-flash-0731. Senden Sie standardmäßige Chat-Completion-Anfragen mit Ihrem OrcaRouter-API-Schlüssel und Nur-Text-Nachrichten.
Unterstützt es Streaming oder Funktionsaufrufe?
Die verfügbaren Fakten geben nicht an, ob Streaming oder Funktionsaufrufe unterstützt werden. Die API ist OpenAI-kompatibel, testen Sie diese Funktionen daher, bevor Sie sich auf sie verlassen. Setzen Sie max_tokens innerhalb des Ausgabelimits von 384.000.
Ist das ein multimodales Modell?
Nein. Die Eingabemodalität ist reiner Text. Für Bilder, Audio oder Video benötigen Sie ein multimodales Modell im OrcaRouter-Katalog oder einen separaten Vorverarbeitungsschritt.

Dieses Abzeichen einbetten

DeepSeek: DeepSeek V4 Flash 0731$0.15/M in791ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash-0731" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash-0731.svg" alt="DeepSeek: DeepSeek V4 Flash 0731 auf OrcaRouter" /> </a>
Markdown [![DeepSeek: DeepSeek V4 Flash 0731](https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash-0731.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash-0731)

Modellkarte als Daten

GET /api/public/models/deepseek/deepseek-v4-flash-0731Öffnen
Maschinenlesbar:/llms.txt/llms-full.txt