DeepSeek V4 Pro 0813

deepseek/deepseek-v4-pro-0813
FlaggschiffEmpfohlen
ToolsJSONReasoning
von DeepSeek · 2026-08-12

DeepSeek V4 Pro 0813 ist die offizielle Veröffentlichung des Flaggschiff-Modells V4 Pro von DeepSeek, das die April-Vorschau ablöst und gleichzeitig in der App, im Web und über die API bereitgestellt wird. Es bietet ein Kontextfenster von 1M-Token mit bis zu 384K Ausgabe-Token, unterstützt Denk- und Nicht-Denk-Modi mit wählbarem niedrigem / hohem / maximalem Reasoning-Aufwand sowie JSON-Ausgabe und Tool-Aufrufe und spricht nativ die Responses API mit einer gezielten Anpassung für Codex-artige Coding-Agenten. Die Revision 0813 ist ein großer Schritt nach vorn bei den Agent-Fähigkeiten, wobei DeepSeek insbesondere starke Verbesserungen in Produktionsumgebungen auf seinen veröffentlichten Agent-Benchmarks meldet — 87.9 bei Terminal Bench 2.1, 83.3 bei Cybergym, 74.1 bei Toolathlon Verified, 62.7 bei DeepSWE, 61.5 bei NL2Repo und 42.7 / 60.0 bei HLE ohne / mit Tools. Bei der DeepSeek-eigenen API wird diese Revision jetzt unter der Modell-ID deepseek-v4-pro ausgeliefert; der datierte Bezeichner listet für Aufrufer, die nach Datum referenzieren, dieselbe Revision. Es ist eine starke Wahl für anspruchsvolle Coding-Agenten, Terminal- und Tool-Nutzungs-Workloads sowie komplexe agentische Pipelines.

Ktx1M Tokens
Max. Ausgabe384K
Eingabetext
Ausgabetext
p50 TTFT2.21 s
EINGABE$0.66/ 1M Tokens
AUSGABE$1.98/ 1M Tokens
p50 TTFT2.21 s7 T
p95 TTFT6.52 s7 T
DATENVERKEHR263698.8MTokens / 7 T

Code-Beispiele

Aus jedem SDK aufrufen

OpenAI-kompatibel — behalte dein bisheriges SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
  • Anthropic SDKhttps://api.orcarouter.ai
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-pro-0813",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Unterstützte Parameter

  • frequency_penalty
  • include_reasoning
  • logit_bias
  • logprobs
  • max_tokens
  • min_p
  • presence_penalty
  • reasoning
  • reasoning_effort
  • repetition_penalty
  • response_format
  • seed
  • stop
  • structured_outputs
  • temperature
  • tool_choice
  • tools
  • top_k
  • top_logprobs
  • top_p

Preise

Preise
Eingabe / 1M Tokens · Nebenzeiten$0.660
Ausgabe / 1M Tokens · Nebenzeiten$1.98
Cache-Lesen / 1M · Nebenzeiten$0.022
Spitzenzeiten01:00–04:00, 06:00–10:00 ×2 (UTC)
Eingabe / 1M Tokens · ×2$1.32
Ausgabe / 1M Tokens · ×2$3.96
Cache-Lesen / 1M · ×2$0.044
WährungUSD

Kostenrechner

Tokens / Monat10MM
Eingabeanteil70%%
Geschätzt / Monat $10.56 · Mit Prompt-Caching $8.33

Schätzung auf Basis des Listenpreises

Token- und Kostenschätzer

Eingabe-Tokens: 27Kosten pro Anfrage: $0.001008

Nur eine Schätzung — die tatsächliche Token-Anzahl hängt vom Tokenizer des Anbieters ab.

Leistung

p50 TTFT
2.21 s
Ausgabegeschwindigkeit
78.4 tok/s
p95 TTFT
6.52 s
Fehlerquote
0.05%

Öffentliche Benchmarks

68.8
AA Coding
Besser als 75 % der verglichenen Modelle
Nr. 30 von 138
36.0
AA Intelligence
Besser als 72 % der verglichenen Modelle
Nr. 39 von 145
Agent Last Exam
25.7
Automation Bench (Public)
31.8
Cybergym
83.3
DeepSWE
62.7
GPQA Diamond
92.8
HLE (no tools)
42.7
HLE (with tools)
60.0
Humanity's Last Exam
41.0
Long-Context Recall
80.3
NL2Repo
61.5
SciCode
51.0
tau_banking
39.6
Terminal Bench 2.1
87.9
terminalbench_v2_1
78.7
Toolathlon Verified
74.1
Quelle: artificialanalysis.ai, api-docs.deepseek.com

Community-Buzz

Worüber Entwickler diese Woche sprechen

Hacker News0 Erwähnungen · 7 T

Im Vergleich

DeepSeek V4 Pro 0813DeepSeek V4 ProDeepSeek V4.1 FlashDeepSeek V4 Flash
Eingabe $/M$0.66$0.66$0.15$0.22
Ausgabe $/M$1.98$1.98$0.60$0.66
Kontext1.0M1.0M1.0M1.0M
Qualität7/108/108/107/10
Nebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichen

FAQ

Wie viel kostet DeepSeek: DeepSeek V4 Pro 0813 auf OrcaRouter?
DeepSeek: DeepSeek V4 Pro 0813 kostet $0.66 pro 1M Eingabetokens und $1.98 pro 1M Ausgabetokens über OrcaRouter. Die Preise werden live von der Routing-Schicht abgerufen.
Was ist das Kontextfenster von DeepSeek: DeepSeek V4 Pro 0813?
DeepSeek: DeepSeek V4 Pro 0813 unterstützt ein Kontextfenster von 1M Token. Verwenden Sie Langkontextfunktionen (RAG, Zusammenfassung) bis zu diesem Limit.
Wie rufe ich DeepSeek: DeepSeek V4 Pro 0813 über das OpenAI SDK auf?
Setzen Sie die OpenAI base_url auf https://api.orcarouter.ai/v1, geben Sie Ihren OrcaRouter API-Schlüssel an und übergeben Sie model="deepseek/deepseek-v4-pro-0813" im Aufruf von chat.completions.create.
Rate-limitiert OrcaRouter DeepSeek: DeepSeek V4 Pro 0813?
Modellspezifische Ratenbegrenzungen richten sich nach Ihrem OrcaRouter-Plan. Kostenlose Tarife haben konservative Obergrenzen; kostenpflichtige Tarife heben diese an. Siehe /pricing für aktuelle Kontingente.

Dieses Abzeichen einbetten

DeepSeek: DeepSeek V4 Pro 0813•$0.66/M in•2213ms p50•via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/deepseek/deepseek-v4-pro-0813" target="_blank"> <img src="https://www.orcarouter.ai/embed/deepseek/deepseek-v4-pro-0813.svg" alt="DeepSeek: DeepSeek V4 Pro 0813 auf OrcaRouter" /> </a>
Markdown [![DeepSeek: DeepSeek V4 Pro 0813](https://www.orcarouter.ai/embed/deepseek/deepseek-v4-pro-0813.svg)](https://www.orcarouter.ai/models/deepseek/deepseek-v4-pro-0813)

Modellkarte als Daten

GET /api/public/models/deepseek/deepseek-v4-pro-0813Öffnen
Maschinenlesbar:/llms.txt/llms-full.txt