DeepSeek V4 Flash

deepseek/deepseek-v4-flash
ToolsJSONReasoning
von DeepSeek · 2026-04-24

DeepSeek V4 Flash effizientes MoE — 284B insgesamt / 13B aktive Parameter, 1M Kontext, optimiert für schnelle alltägliche Workloads.

Ktx1M Tokens
Max. Ausgabe384K
Eingabetext
p50 TTFT608 ms
EINGABE$0.15/ 1M Tokens
AUSGABE$0.29/ 1M Tokens
p50 TTFT608 ms7 T
p95 TTFT1.88 s7 T
DATENVERKEHR31437.8MTokens / 7 T

DeepSeek V4 Flash ist ein großes Sprachmodell des chinesischen KI-Unternehmens DeepSeek. Es verarbeitet ausschließlich Texteingaben und ist für Szenarien konzipiert, die ein großes Kontextfenster…

Was ist DeepSeek V4 Flash?

Wer sollte DeepSeek V4 Flash verwenden?

Welche Eingabemodalitäten unterstützt DeepSeek V4 Flash?

Code-Beispiele

Aus jedem SDK aufrufen

OpenAI-kompatibel — behalte dein bisheriges SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Unterstützte Parameter

  • include_reasoning
  • logprobs
  • max_tokens
  • reasoning
  • response_format
  • stop
  • stream
  • stream_options
  • temperature
  • thinking
  • tool_choice
  • tools
  • top_logprobs
  • top_p
  • user_id

Preise

Eingabe / 1M Tokens · Nebenzeiten$0.147
Ausgabe / 1M Tokens · Nebenzeiten$0.295
Cache-Lesen / 1M · Nebenzeiten$0.020
Spitzenzeiten01:00–04:00, 06:00–10:00 ×2 (UTC)
Eingabe / 1M Tokens · ×2$0.294
Ausgabe / 1M Tokens · ×2$0.590
Cache-Lesen / 1M · ×2$0.040
WährungUSD

Kostenrechner

Tokens / Monat10MM
Eingabeanteil70%%
Geschätzt / Monat $1.91 · Mit Prompt-Caching $1.47

Schätzung auf Basis des Listenpreises

Token- und Kostenschätzer

Eingabe-Tokens: 27Kosten pro Anfrage: $0.000151

Nur eine Schätzung — die tatsächliche Token-Anzahl hängt vom Tokenizer des Anbieters ab.

Leistung

p50 TTFT
608 ms
Ausgabegeschwindigkeit
117 tok/s
p95 TTFT
1.88 s
Fehlerquote
5.3%

Öffentliche Benchmarks

69.1
AA Coding
Besser als 82 % der verglichenen Modelle
Nr. 23 von 133
51.8
AA Intelligence
Besser als 76 % der verglichenen Modelle
Nr. 32 von 135
50.0
AA Math
Besser als 26 % der verglichenen Modelle
Nr. 61 von 82
GPQA Diamond
90.8
Humanity's Last Exam
38.6
IFBench
79.2
Long-Context Recall
74.3
MMLU-Pro
57.0 index
SciCode
49.9
tau_banking
39.4
TerminalBench Hard
35.6
terminalbench_v2_1
78.7
τ²-Bench
95.0
Quelle: artificialanalysis.ai

Community-Buzz

Worüber Entwickler diese Woche sprechen

Hacker News8 Erwähnungen · 7 T8 weniger als in der Vorwoche

Im Vergleich

DeepSeek V4 FlashDeepSeek V4 ProDeepSeek V4 Flash Vision (Exp)DeepSeek V4 Pro 0813
Eingabe $/M$0.15$0.44$0.15$0.44
Ausgabe $/M$0.29$0.88$0.29$0.88
Kontext1.0M1.0M1.0M1.0M
Qualität7/108/107/107/10
Nebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichen

FAQ

Wie viel kostet DeepSeek V4 Flash auf OrcaRouter?
Eingabe-Token kosten $0.14 pro 1 Million Token, und Ausgabe-Token kosten $0.28 pro 1 Million Token. OrcaRouter berechnet exakt den Anbieterpreis ohne Aufschlag.
Was ist das Kontextfenster von DeepSeek V4 Flash?
Das Kontextfenster umfasst 1.048.576 Token (1 Million Token). Die maximale Ausgabe pro Anfrage beträgt 384.000 Token.
Was sind die Hauptstärken von DeepSeek V4 Flash?
Seine Stärken sind der sehr große Kontextfenster und das hohe Ausgabe-Token-Limit, kombiniert mit einem niedrigen Preis und einem starken τ²-Bench-Score von 95,0, was auf gute Denk- und Werkzeugnutzungsfähigkeiten hinweist.
Wie schneidet DeepSeek V4 Flash im Vergleich zu GPT-4 oder Claude ab?
DeepSeek V4 Flash bietet einen viel größeren Kontext (1M vs 128k/200k) und eine viel größere Ausgabe (384k vs ~4k) zu einem Bruchteil der Kosten. Allerdings ist es nur Text und verfügt möglicherweise über weniger umfassendes Allgemeinwissen oder Sicherheitsoptimierung.
Schlägt OrcaRouter einen Aufschlag auf den Preis von DeepSeek V4 Flash?
Nein. OrcaRouter gibt den Anbieterpreis ohne Aufschlag weiter. Sie zahlen $0.14 pro 1M Input und $0.28 pro 1M Output, genau wie von DeepSeek berechnet.
Wie rufe ich DeepSeek V4 Flash über die OrcaRouter API auf?
Verwenden Sie die OpenAI-kompatible Basis-URL https://api.orcarouter.ai/v1, setzen Sie den Modellparameter auf "deepseek/deepseek-v4-flash" und fügen Sie Ihren OrcaRouter-API-Schlüssel in den Authorization-Header ein.
Welche Datenverarbeitungsrichtlinien gelten für DeepSeek V4 Flash?
Daten werden über OrcaRouter an die Server von DeepSeek in China weitergeleitet. Überprüfen Sie die Datenschutzrichtlinie von OrcaRouter und die Bedingungen von DeepSeek. Es werden keine zusätzlichen Datenschutzmaßnahmen explizit angeboten.
Ist DeepSeek V4 Flash multimodal?
Nein, es akzeptiert nur Texteingaben. Für Bilder, Audio oder Video müssten Sie diese in Text umwandeln oder ein anderes Modell verwenden.
Welche Parameter kann ich einstellen, wenn ich DeepSeek V4 Flash verwende?
Standard OpenAI chat completions Parameter: model, messages, max_tokens, temperature, top_p, frequency_penalty, presence_penalty, stop, stream, usw. Der max_tokens-Wert darf 384,000 nicht überschreiten.
Welche Anwendungsfälle eignen sich am besten für DeepSeek V4 Flash?
Langdokumentanalyse, Codegenerierung mit erweitertem Reasoning, mehrschrittige Konversationen, die tiefen Kontext benötigen, und Aufgaben, die große Ergebnisse wie detaillierte Berichte oder Pläne hervorbringen.

Dieses Abzeichen einbetten

DeepSeek: DeepSeek V4 Flash$0.15/M in608ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash.svg" alt="DeepSeek: DeepSeek V4 Flash auf OrcaRouter" /> </a>
Markdown [![DeepSeek: DeepSeek V4 Flash](https://www.orcarouter.ai/embed/deepseek/deepseek-v4-flash.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-v4-flash)

Modellkarte als Daten

GET /api/public/models/deepseek/deepseek-v4-flashÖffnen
Maschinenlesbar:/llms.txt/llms-full.txt