
DeepSeek V4 Pro API-Preise: 0,73 $/2,18 $ in der Nebenzeit – und warum die Abschaltung am 14. September abgesagt wurde
- openaiNEUOpenAI: GPT-6.1 Sol2026-09-2952Intelligenz
- anthropicNEUAnthropic: Claude Sonnet 5.52026-09-2856Intelligenz
- typesafeNEUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 pro 1 Mio. Tokens · 223 tok/s
- OpenAINEUOpenAI: GPT-6 Luna2026-09-2238Intelligenz
- OpenAINEUOpenAI: GPT-6 Sol2026-09-2248Intelligenz
- AnthropicNEUAnthropic: Claude Opus 5.52026-09-2258Intelligenz
- xAINEUGrok 4.72026-09-2146Intelligenz
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 pro 1 Mio. Tokens · 126 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 pro 1 Mio. Tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenz
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenz77Coding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenz76Coding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenz76Coding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenz82Coding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 pro 1 Mio. Tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenz72Coding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 pro 1 Mio. Tokens · 213 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenz75Coding
- obsidianQwen3.8 27B2026-08-1534Intelligenz68Coding
DeepSeek V4 Pro wird nicht eingestellt. Am 11. September 2026 erklärte DeepSeek, dass das Modell nach dem 14. September weiterhin über seine API bereitgestellt wird, wobei die Abrechnungsmethode unverändert bleibt – eine Umkehr eines zwei Tage zuvor angekündigten Plans, nach dem jede deepseek-v4-pro-Anfrage umgeleitet worden wäre an DeepSeek V4.1 Flash und zu Flash-Tarifen abgerechnet worden wäre. Für alle, deren Prompts, Temperatureinstellungen und Tool-Call-Schemata auf V4 Pro abgestimmt sind, ist das die Tatsache, die diese Woche zählt: Das Modell, auf das Sie gebaut haben, bleibt, wo es ist, und die Migration, die Sie vielleicht für Montag geplant hatten, muss nicht stattfinden.
Beim Preis sieht die Sache anders aus, und diese Seite lag einen Monat lang falsch. DeepSeek V4 Pro kostet nicht mehr $0,44/$0,88 pro Million Token. Off-Peak berechnet DeepSeek V4 Pro auf OrcaRouter $0,726 für Input und $2,178 für Output pro 1 Mio. Token, was sich in den Peak-Zeitfenstern auf $1,452/$4,356 verdoppelt, wobei Cache-Lesevorgänge $0,024 kosten. Wochenenden gelten jetzt vollständig als Off-Peak. Und die eigene Preisliste des Anbieters – die in der API-Dokumentation von DeepSeek – führt den Fortsetzungshinweis als Fußnote zu derselben Preistabelle auf, was ungefähr so nah an eine Primärquelle herankommt, wie eine Preisseite nur kommen kann.
Was DeepSeek tatsächlich gesagt hat – und was es rückgängig macht
Die zeitliche Abfolge ist wichtig, denn zwei der drei Ankündigungen waren Umkehrungen voneinander, und die mittlere ist diejenige, an die sich die Leute erinnern.
• 9. September — DeepSeek teilte den Nutzern mit, dass bis zum Start von V4.1 Pro Anfragen an V4 Pro an DeepSeek V4.1 Flash weitergeleitet und zu den Preisen von V4.1 Flash abgerechnet würden.
• 10. September — V4.1 Flash wurde veröffentlicht, und DeepSeek verlegte den Wechsel auf einen festen Zeitpunkt: den 14. September 2026 um 12:00 Uhr Pekinger Zeit, wonach V4 Pro offline gehen und sein Datenverkehr von Flash bedient werden würde.
11. September — DeepSeek ruderte zurück. Sein Wortlaut wird nun wortwörtlich als Fußnote auf der Seite „Models & Pricing“ der eigenen API-Dokumentation angeführt: „Als Reaktion auf die Nutzernachfrage haben wir beschlossen, die API-Dienste für DeepSeek V4 Pro auch nach dem 14. September 2026 weiterhin anzubieten, wobei die Abrechnungsmethode unverändert bleibt. Sollten sich Änderungen ergeben, werden wir diesbezüglich weitere Informationen bereitstellen.“
Das ist der Anbieter, der über sein eigenes Produkt spricht, und es ist die belastbarste Quelle, die hier verfügbar ist – aber lesen Sie genau, was sie klärt und was nicht. Sie klärt Kontinuität und Abrechnung: V4 Pro bleibt, zu den bereits geltenden Sätzen. Einen Zeitrahmen verspricht sie nicht. Wir werden weitere Mitteilungen bereitstellen ist die gesamte Zusage, und derselbe Satz lässt die Tür offen, dass der Plan zurückkehrt. Wenn Sie sich über mehrere Quartale binden, planen Sie mit dem Modell, von dem Sie wegkommen können, statt mit dem, das Sie behalten können.
Der Gegenwind, der die Rücknahme erzwungen hat, ist es wert, verstanden zu werden, denn er lässt sich auf eine Entscheidung übertragen, die Sie vielleicht selbst gerade treffen werden. Entwickler protestierten nicht gegen V4.1 Flash – von dem DeepSeek sagt, dass es V4 Pro bei Leistung, Preis, Geschwindigkeit und Gesamtaufgabenzeit übertrifft –, sondern gegen die automatische Ersetzung. Das Austauschen des Modells hinter einer stabilen Modell-ID verändert das Verhalten, ohne den Code zu ändern: ein abgestimmter Prompt, eine funktionierende Temperatur, ein Tool-Call-Schema, das sich parsen lässt, sind alles Eigenschaften eines bestimmten Checkpoints. Die Berichterstattung in CLS (科创板日报), 36Kr, IT之家 und ifeng sowie auf Englisch bei TheBlockBeats beschreibt, dass DeepSeek zunächst zögerte und den Plan dann fallen ließ; DeepSeeks eigene Dokumentation zeigt den Kontrast deutlich, denn die alten deepseek-v4-flash-Namen wurden ausgemustert und verweisen jetzt auf V4.1 Flash, und dieser Wechsel blieb bestehen. Der Pro-Wechsel nicht.
Der heutige Preis, abgeglichen mit der eigenen Preisliste des Anbieters

Zwei Zahlen zählen, und sie sind derselbe Listenpreis in zwei Währungen.
• Off-Peak (jede Stunde außerhalb der unten aufgeführten Peak-Zeiten) — Eingabe $0,726 pro 1 Mio. bei einem Cache-Miss, oder ¥4,5; Ausgabe $2,178, oder ¥13,5; Eingabe bei Cache-Hit $0,024, oder ¥0,15.
• Spitze — genau das Doppelte. Eingabe $1.452 / ¥9, Ausgabe $4.356 / ¥27, Eingabe bei Cache-Treffer $0.048 / ¥0.30.
• DeepSeeks eigene Dollar-Umrechnung — die Dokumentation des Anbieters führt dieselbe Yuan-Liste mit 0,66 $ Eingabe / 1,98 $ Ausgabe außerhalb der Spitzenzeiten und 1,32 $ / 3,96 $ zu Spitzenzeiten auf, mit Cache-Treffern bei 0,022 $ und 0,044 $. Die Differenz zu OrcaRouters Dollar-Angaben ist der Wechselkurs, zu dem jede Seite umrechnet, nicht eine zusätzliche Token-Gebühr: OrcaRouter gibt den Anbietertarif ohne Aufschlag weiter, sodass die Zahl in der Auflistung die Zahl ist, die Sie zahlen.
• Kein kostenloser Tarif für V4 Pro. Im Verzeichnis gibt es einen kostenlosen Flash-Tarif, doch das Flaggschiff ist nur kostenpflichtig erhältlich.
• Das Datenblatt zur Einordnung – V4 Pro ist ein Open-Weights-Modell unter einer MIT-Lizenz, 1,6 Billionen Parameter insgesamt, davon 49 Mrd. aktiv pro Token, ein 1-Mio.-Token-Kontextfenster und bis zu 384.000 Ausgabe-Token, bei einem Parallelitätslimit von 500. Artificial Analysis gibt 72,3 Ausgabe-Token pro Sekunde an.
Die Modellversion hinter all dem ist DeepSeek-V4-Pro-0813, unverändert seit dem Release der allgemeinen Verfügbarkeit am 13. August – und genau darauf kommt es an. Am 11. September änderte sich nichts am Checkpoint; nur die Entscheidung über seine Zukunft.
Spitzenzeiten, Nebenzeiten und die Wochenendregel, die die Rechnung verändert
Das Peak-/Off-Peak-System, von dem die frühere Version dieser Seite schrieb, dass es am 17. August kommen würde, ist jetzt einen Monat alt und wurde seitdem einmal geändert.
• Spitzenzeiten — 01:00–04:00 und 06:00–10:00 UTC, Montag bis Freitag. In Pekinger Zeit entspricht das 09:00–12:00 und 14:00–18:00, DeepSeeks eigener Arbeitstag. Off-Peak-Tarife liegen genau bei der Hälfte der Peak-Tarife, nicht als zusätzliche Rabattstufe obendrauf.
• Wochenenden liegen vollständig außerhalb der Spitzenzeiten. Mit Wirkung zum 23. August 2026, 00:00 Uhr Pekinger Zeit, hat DeepSeek die Anwendung von Spitzentarifen an Samstagen und Sonntagen eingestellt. Wenn sich Ihre Batch-Arbeit verschieben lässt, halbiert eine Verlegung auf das Wochenende die Rechnung – und für Teams, die Nutzer in Nord- und Südamerika bedienen, fällt der größte Teil der Arbeitswoche bereits ganz ohne Zeitplanung in die Nebenzeit.
• Was die Änderung kostet – verglichen mit den ¥3/¥6, mit denen das Modell am 13. August startete – der heutige Off-Peak-Output ist das 2,25-Fache des Startpreises und der Peak-Output das 4,5-Fache; der Peak-Cache-Hit-Input ist das 12-Fache der alten ¥0,025.
Hier gibt es eine Asymmetrie, die erklärt, warum die Migrationsfrage immer wieder aufkommt, selbst nachdem die Abschaltung abgesagt wurde. Der Preis von V4 Pro stieg im August, während der seines Nachfolgers sank: DeepSeek senkte mit Wirkung zum 10. September die API-Preise der Flash-Serie um bis zu 60 %. Der Druck zu wechseln hatte nie wirklich mit der Mitteilung vom 14. September zu tun; die Mitteilung machte ihn nur dringend.
Was eine Anfrage tatsächlich kostet
Drei durchgerechnete Beispiele zu den heutigen Nebenzeittarifen. Jedes einzelne davon verdoppelt sich innerhalb eines Spitzenzeitfensters.
• 100K Eingabe + 50K Ausgabe — $0.0726 + $0.1089 ≈ $0.18.
• 1 Mio. Input + 1 Mio. Output — 0,726 $ + 2,178 $ = 2,90 $. Derselbe Aufruf kostet zu Spitzenzeiten 5,81 $ und lag Mitte August bei 1,32 $.
• Agentische Sitzung, 500K Input + 200K Output — 0,363 $ + 0,4356 $ ≈ 0,80 $.
Die Monatsansicht befindet sich auf der Modellseite und ist der ehrliche Test dafür, ob die alte Schlagzeile noch Ihre Rechnung beschreibt: Bei 10 Mio. Tokens pro Monat und einem Input-Anteil von 70 % kommt der Kostenrechner auf 11,62 $, bzw. etwa 9,16 $ bei aktiviertem Prompt-Caching. Wenn Ihr Budget auf 0,44 $ ausgelegt war, deckt es jetzt etwa 60 % der Rechnung ab.
Cache ist der Hebel, den niemand auf den Tisch legt.
Prompt-Caching wurde wertvoller, nicht weniger wertvoll, als die Preise stiegen – und die Richtung der beiden Zahlen ist der Grund dafür. Bei OrcaRouter wird ein Cache-Lesezugriff jetzt mit 0,024 $ pro 1 Mio. Token abgerechnet, gegenüber 0,726 $ ohne Cache, ein Rabatt von 96,7 % auf jede Eingabe, die Sie erneut senden. In der vorherigen Version dieser Seite betrug der Cache-Preis 0,060 $ gegenüber einem Eingabepreis von 0,442 $, ein Rabatt von 86 %. Der Preis für Cache-Lesezugriffe sank um mehr als die Hälfte, während der Eingabepreis ohne Cache um 64 % stieg, sodass sich die effektive Lücke zwischen einem gecachten und einem nicht gecachten Token erheblich vergrößerte.
Für einen Agenten, der bei jedem Turn einen großen System-Prompt und einen langen Kontext erneut sendet, ist gecachte Eingabe der Unterschied zwischen einer Rechnung, die mit der Gesprächslänge skaliert, und einer, die es nicht tut. Die praktische Regel ist unverändert und es lohnt sich, sie zu wiederholen: Setzen Sie den stabilen System-Prompt und Referenzmaterial an den Anfang und den veränderlichen Inhalt ans Ende, damit das Präfix, das Sie erneut senden, tatsächlich den Cache trifft. Bei diesem Modell ist diese eine strukturelle Entscheidung mehr wert als jede Routing- oder Scheduling-Entscheidung, die darunter liegt.
Wie die V4 Pro-Preise im Vergleich zur Konkurrenz abschneiden

Listenpreise im Verzeichnis für Input/Output pro 1 Mio. Token, geprüft am 2026-09-12, im Vergleich zu den Off-Peak-Preisen von V4 Pro in Höhe von 0,726 $/2,178 $. Zwei davon haben sich seit der Erstveröffentlichung dieser Seite verändert, und einer davon ändert das Fazit.
• Claude Fable 5 — 10 $ / 50 $. V4 Pro ist 13,8× günstiger bei der Eingabe und 23× bei der Ausgabe.
• Claude Opus 5 — 5 $ / 25 $. 6,9× / 11,5×.
• GPT-5.6 Sol — 4 $ / 20 $ bis zu 272K Kontext, 8 $ / 30 $ darüber hinaus. 5,5× / 9,2× in der kürzeren Stufe, 11× / 13,8× in der längeren.
• Kimi K3 — 3 $ / 15 $. 4,1× / 6,9×.
• Qwen3.8 Max — $2 / $6. 2,8× / 2,8×.
• Grok 4.5 — 2 $ / 6 $. 2,8× / 2,8×.
• Gemini 3.6 Flash — $0,75 / $3,75. Ungefähr Parität beim Input bei 1,03× und 1,7× beim Output. Sein Preis hat sich halbiert, seit diese Seite geschrieben wurde.
• MiniMax M3 — $0.30 / $1.20. Günstiger als V4 Pro bei beiden Linien jetzt: V4 Pro kostet 2,4× mehr beim Input und 1,8× mehr beim Output, bei gleichem 1M-Token-Fenster.
• DeepSeek V4 Flash — 0,242 $ / 0,726 $ im Verzeichnis. Etwa 3× günstiger in beiden Zeilen, gleicher 1M-Kontext.
Die ehrliche Einordnung hat sich geändert, und diese Seite sollte das sagen, statt am alten Superlativ festzuhalten. DeepSeek V4 Pro ist nicht mehr das günstigste 1M-Kontext-Modell im Feld: Gemini 3.6 Flash und MiniMax M3 unterbieten es beide, und MiniMax M3 schafft das, während es das Kontextfenster mithält. Was V4 Pro nach wie vor ist – um mehr als eine Größenordnung –, ist das Günstigste in der Frontier-Klasse: Jedes westliche Modell der Flaggschiffklasse auf dieser Liste kostet ein Vielfaches davon, und zwar in beiderlei Hinsicht. Wenn die Frage lautet „günstigstmöglicher 1M-Kontext-Aufruf“, ist die Antwort nicht mehr dieses Modell. Wenn die Frage lautet „günstigstes Modell, das sich wie ein Frontier-Modell verhält“, dann ist es vorerst noch dieses.
Wann V4 Pro die falsche Wahl ist
• Wenn Ihr Datenverkehr während der Pekinger Tageszeit am stärksten ist. Zu Spitzenzeiten verdoppelt sich der Tarif, und die Spitzenfenster fallen genau auf den chinesischen Arbeitstag. Wenn Ihre Nutzer in Amerika sind, fällt der Großteil Ihres Datenverkehrs bereits in die Nebenzeiten, was ein echter struktureller Vorteil ist. Wenn Sie für Nutzer in China entwickeln, modellieren Sie die Spitzenabrechnung explizit, bevor Sie sich festlegen — und prüfen Sie, ob die Wochenendregelung Ihnen hilft, etwas zu verschieben.
• Wenn Ihre Prompts kurz sind. Unter ungefähr 10K Tokens Kontext ist die Flaggschiff-Klasse verschwendete Kapazität. DeepSeek V4 Flash zu $0.242/$0.726 im Verzeichnis bewältigt denselben 1M-Kontext für etwa ein Drittel des Preises, und bei wirklich kurzen Aufgaben gewinnt ein günstigeres Modell weiterhin.
• Wenn Sie Bildverarbeitung benötigen: V4 Pro ist reiner Text — keine Bild- oder Audioeingabe — und Artificial Analysis führt seine Eingabemodalität als Text auf. Gemini 3.6 Flash oder Claude Fable 5 sind die bessere Wahl, wenn es auf die Modalität ankommt. Auch DeepSeeks eigene API ist hier erwähnenswert: Sie bedient jetzt ihre alten Flash-Modellnamen mit V4.1 Flash, das durchaus Bilder akzeptiert.
• Wenn Sie einen benchmarktoppenden Rohwert statt Preis pro Kontext kaufen. Auf der aktuellen Skala von Artificial Analysis erzielt V4 Pro 36 im Intelligence Index – zum Zeitpunkt des Verfassens Platz 8 von 113 Modellen – und 69 im Coding Index, wie im OrcaRouter-Verzeichnis geführt. Das ist konkurrenzfähig, nicht führend: Claude Fable 5, Claude Opus 5 und GPT-5.6 Sol übertreffen es beim Coding allesamt. Das Angebot von V4 Pro ist frontier-nahe Leistungsfähigkeit zu einem Bruchteil des Preises pro Token, nicht die Spitze jeder Rangliste.
Wie ruft man es in OrcaRouter auf?

DeepSeek V4 Pro wird auf OrcaRouter unter der Modell-ID deepseek/deepseek-v4-pro gehostet, bereitgestellt über den OpenAI-kompatiblen Endpunkt unter api.orcarouter.ai/v1 zum Anbieterpreis ohne Aufschlag. Die Migration von einem bestehenden OpenAI-Client ist eine Änderung der Basis-URL und der Modell-ID und sonst nichts.
Die Rücknahme ändert, was Sie daraufhin tun sollten. Wenn Sie für den 14. September eine Migration im Kalender hatten – eine Umstellung von V4 Pro auf DeepSeek V4.1 Flash, weil Pro eingestellt werden sollte –, können Sie sie vom Kalender nehmen oder sie zumindest von einer Frist zu einem Test herabstufen. Beide Modelle liegen hinter einem einzigen OrcaRouter-Schlüssel, sodass ein Vergleich zwischen ihnen eine Änderung der Modell-ID in einer Anfrage ist statt eines zweiten Vertrags und eines zweiten SDK; und wenn Sie V4.1 Flash tatsächlich mit echtem Traffic evaluieren möchten, ohne einen Produktionspfad darauf zu setzen, ist automatisches Failover der risikoarme Weg, ihm Live-Anfragen zu geben, während V4 Pro als Fallback bleibt. Das ist die praktische Gestalt der Entscheidung vom 11. September: Die Wahl bleibt bei Ihnen, und sie bleibt umkehrbar.
Der Ehrlichkeitshinweis, der bei einer Preisseite zählt: Wir leiten an das Modell weiter, wir legen seinen Preis nicht fest. Die Off-Peak-Werte von $0.726/$2.178 sind durchgereichte DeepSeek-Tarife, und sie ändern sich, wenn DeepSeek sie ändert – genau deshalb ist diese Seite datiert, und deshalb wurde die Version, die Sie gerade lesen, neu geschrieben statt ergänzt.
Quellen und Datum
Die Preise und Spezifikationen auf dieser Seite wurden am 12.09.2026 erneut verifiziert. Die Dollar-Beträge für DeepSeek V4 Pro und für jedes Modell im Vergleich stammen aus dem OrcaRouter-Modellverzeichnis, das am selben Tag geprüft wurde; die Angaben zu Parameterzahl, Lizenz, Kontextfenster, Modalität und Geschwindigkeit stammen von der Modellseite von Artificial Analysis für DeepSeek V4 Pro 0813. Die Yuan-Kurse, die Peak-Zeitfenster und der Hinweis zur Fortsetzung vom 11. September stammen aus DeepSeeks eigener Dokumentation „Models & Pricing“, die die Aussage wörtlich als Fußnote zur Preistabelle enthält. Die dreistufige Ankündigungsabfolge – der Routing-Hinweis vom 9. September, die Verschiebung am 10. September auf den 14. September um 12:00 Uhr Pekinger Zeit und die Umkehr am 11. September – wird von CLS (科创板日报), 36Kr, IT之家 und ifeng sowie auf Englisch von TheBlockBeats berichtet. Die Wochenend-Abrechnungsregel vom 23. August und die Flash-Preissenkung vom 10. September stammen aus DeepSeeks Ankündigungen, über die IT之家, The Paper und 21st Century Business Herald berichtet haben.
Zum Abschluss noch eine Anmerkung zur Vertrauenswürdigkeit, denn dieser spezielle Preis hat sich innerhalb eines Monats dreimal geändert – Startpreise am 13. August, Peak/Off-Peak am 17. August, die Wochenend-Anpassung am 23. August. Betrachten Sie jede „V4 Pro pricing“-Seite ohne Datum als unbrauchbar. Die frühere Version dieser Seite nannte 0,44 $/0,88 $ und einen Artificial Analysis Intelligence Index von 44,3; beide waren korrekt, als sie geschrieben wurden, und keine der beiden Angaben hat den Monat überlebt.
In diesem Artikel verglichen4
Aus diesem Artikel erkannt · Benchmarks: Artificial Analysis · täglich aktualisiert
