DeepSeek V4 Pro 0813

deepseek/deepseek-v4-pro-0813
NeuFlaggschiffEmpfohlen
ToolsJSONReasoning
von DeepSeek · 2026-08-12

DeepSeek V4 Pro 0813 ist die offizielle Veröffentlichung des Flaggschiff-Modells V4 Pro von DeepSeek, das die April-Vorschau ablöst und gleichzeitig in der App, im Web und über die API bereitgestellt wird. Es bietet ein Kontextfenster von 1M-Token mit bis zu 384K Ausgabe-Token, unterstützt Denk- und Nicht-Denk-Modi mit wählbarem niedrigem / hohem / maximalem Reasoning-Aufwand sowie JSON-Ausgabe und Tool-Aufrufe und spricht nativ die Responses API mit einer gezielten Anpassung für Codex-artige Coding-Agenten. Die Revision 0813 ist ein großer Schritt nach vorn bei den Agent-Fähigkeiten, wobei DeepSeek insbesondere starke Verbesserungen in Produktionsumgebungen auf seinen veröffentlichten Agent-Benchmarks meldet — 87.9 bei Terminal Bench 2.1, 83.3 bei Cybergym, 74.1 bei Toolathlon Verified, 62.7 bei DeepSWE, 61.5 bei NL2Repo und 42.7 / 60.0 bei HLE ohne / mit Tools. Bei der DeepSeek-eigenen API wird diese Revision jetzt unter der Modell-ID deepseek-v4-pro ausgeliefert; der datierte Bezeichner listet für Aufrufer, die nach Datum referenzieren, dieselbe Revision. Es ist eine starke Wahl für anspruchsvolle Coding-Agenten, Terminal- und Tool-Nutzungs-Workloads sowie komplexe agentische Pipelines.

Ktx1M Tokens
Max. Ausgabe384K
Eingabetext
Ausgabetext
p50 TTFT958 ms
EINGABE$0.44/ 1M Tokens
AUSGABE$0.88/ 1M Tokens
p50 TTFT958 ms7 T
p95 TTFT1.89 s7 T
DATENVERKEHR87.9MTokens / 7 T

Code-Beispiele

Aus jedem SDK aufrufen

OpenAI-kompatibel — behalte dein bisheriges SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Anthropic SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-pro-0813",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Unterstützte Parameter

  • frequency_penalty
  • include_reasoning
  • logit_bias
  • logprobs
  • max_tokens
  • min_p
  • presence_penalty
  • reasoning
  • reasoning_effort
  • repetition_penalty
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Preise

Eingabe / 1M Tokens$0.442
Ausgabe / 1M Tokens$0.884
Cache-Lesen / 1M$0.060
WährungUSD

Kostenrechner

Tokens / Monat10MM
Eingabeanteil70%%
Geschätzt / Monat $5.75 · Mit Prompt-Caching $4.41

Schätzung auf Basis des Listenpreises

Token- und Kostenschätzer

Eingabe-Tokens: 27Kosten pro Anfrage: $0.000454

Nur eine Schätzung — die tatsächliche Token-Anzahl hängt vom Tokenizer des Anbieters ab.

Leistung

p50 TTFT
958 ms
Ausgabegeschwindigkeit
65.0 tok/s
p95 TTFT
1.89 s
Fehlerquote
0%

Öffentliche Benchmarks

Agent Last Exam
25.7
Automation Bench (Public)
31.8
Cybergym
83.3
DeepSWE
62.7
HLE (no tools)
42.7
HLE (with tools)
60.0
NL2Repo
61.5
Terminal Bench 2.1
87.9
Toolathlon Verified
74.1
Quelle: api-docs.deepseek.com

Community-Buzz

Worüber Entwickler diese Woche sprechen

Hacker News9 Erwähnungen · 7 T9 mehr als in der Vorwoche

Im Vergleich

DeepSeek V4 Pro 0813DeepSeek V4 ProDeepSeek V4 FlashDeepSeek V4 Flash 0731
Eingabe $/M$0.44$0.44$0.15$0.15
Ausgabe $/M$0.88$0.88$0.29$0.29
Kontext1.0M1.0M1.0M1.0M
Qualität7/108/107/106/10
Nebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichen

FAQ

Wie viel kostet DeepSeek: DeepSeek V4 Pro 0813 auf OrcaRouter?
DeepSeek: DeepSeek V4 Pro 0813 kostet $0.44 pro 1M Eingabetokens und $0.88 pro 1M Ausgabetokens über OrcaRouter. Die Preise werden live von der Routing-Schicht abgerufen.
Was ist das Kontextfenster von DeepSeek: DeepSeek V4 Pro 0813?
DeepSeek: DeepSeek V4 Pro 0813 unterstützt ein Kontextfenster von 1M Token. Verwenden Sie Langkontextfunktionen (RAG, Zusammenfassung) bis zu diesem Limit.
Wie rufe ich DeepSeek: DeepSeek V4 Pro 0813 über das OpenAI SDK auf?
Setzen Sie die OpenAI base_url auf https://api.orcarouter.ai/v1, geben Sie Ihren OrcaRouter API-Schlüssel an und übergeben Sie model="deepseek/deepseek-v4-pro-0813" im Aufruf von chat.completions.create.
Rate-limitiert OrcaRouter DeepSeek: DeepSeek V4 Pro 0813?
Modellspezifische Ratenbegrenzungen richten sich nach Ihrem OrcaRouter-Plan. Kostenlose Tarife haben konservative Obergrenzen; kostenpflichtige Tarife heben diese an. Siehe /pricing für aktuelle Kontingente.

Dieses Abzeichen einbetten

DeepSeek: DeepSeek V4 Pro 0813$0.44/M in958ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-v4-pro-0813" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-v4-pro-0813.svg" alt="DeepSeek: DeepSeek V4 Pro 0813 auf OrcaRouter" /> </a>
Markdown [![DeepSeek: DeepSeek V4 Pro 0813](https://www.orcarouter.ai/embed/deepseek/deepseek-v4-pro-0813.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-v4-pro-0813)

Modellkarte als Daten

GET /api/public/models/deepseek/deepseek-v4-pro-0813Öffnen
Maschinenlesbar:/llms.txt/llms-full.txt