
DeepSeek V4 Pro API-prijzen: $0,73/$2,18 buiten piekuren, en waarom de shutdown van 14 september werd afgelast
- openaiNIEUWOpenAI: GPT-6.1 Sol2026-09-2952Intelligentie
- anthropicNIEUWAnthropic: Claude Sonnet 5.52026-09-2856Intelligentie
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 223 tok/s
- OpenAINIEUWOpenAI: GPT-6 Luna2026-09-2238Intelligentie
- OpenAINIEUWOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- AnthropicNIEUWAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- xAINIEUWGrok 4.72026-09-2146Intelligentie
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 mln tokens · 126 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 213 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
DeepSeek V4 Pro wordt niet stopgezet. Op 11 september 2026 liet DeepSeek weten het model na 14 september via zijn API te blijven aanbieden, met ongewijzigde factureringsmethode — waarmee een twee dagen eerder aangekondigd plan wordt teruggedraaid waarbij elk deepseek-v4-pro-verzoek zou worden omgeleid naar DeepSeek V4.1 Flash en tegen Flash-tarieven zou worden gefactureerd. Voor iedereen wiens prompts, temperatuurinstellingen en tool-call-schema's op V4 Pro zijn afgestemd, is dat het feit dat deze week ertoe doet: het model waarop je hebt gebouwd blijft waar het is, en de migratie die je misschien voor maandag had gepland, hoeft niet plaats te vinden.
De prijs is een ander verhaal, en deze pagina had het een maand lang verkeerd. DeepSeek V4 Pro kost niet langer $0,44/$0,88 per miljoen tokens. Buiten de piek factureert het $0,726 voor input en $2,178 voor output per 1 mln. tokens op OrcaRouter, wat binnen de piekvensters verdubbelt naar $1,452/$4,356, met cache-leesbewerkingen tegen $0,024. Weekends vallen nu volledig buiten de piek. En de eigen tariefkaart van de leverancier — die in de API-documentatie van DeepSeek — bevat de kennisgeving van voortzetting als voetnoot bij dezelfde prijstabel, wat ongeveer zo dicht bij een primaire bron komt als een prijspagina kan komen.
Wat DeepSeek werkelijk zei, en wat het tenietdoet
De tijdlijn is belangrijk, want twee van de drie aankondigingen waren elkaars omkering en de middelste is degene die mensen zich herinneren.
• 9 september — DeepSeek liet gebruikers weten dat aanvragen voor V4 Pro tot de lancering van V4.1 Pro zouden worden doorgestuurd naar DeepSeek V4.1 Flash en gefactureerd tegen V4.1 Flash-tarieven.
• 10 september — V4.1 Flash is uitgebracht, en DeepSeek heeft de omschakeling naar een vast moment verplaatst: 12:00 uur Pekingtijd op 14 september 2026, waarna V4 Pro offline zou gaan en het verkeer ervan door Flash zou worden afgehandeld.
• 11 september — DeepSeek draaide terug. De bewoording, nu woordelijk overgenomen als voetnoot op de Models & Pricing-pagina van zijn eigen API-documentatie: "In reactie op de vraag van gebruikers hebben we besloten om na 14 september 2026 API-diensten voor DeepSeek V4 Pro te blijven leveren, waarbij de factureringsmethode ongewijzigd blijft. We zullen nader bericht geven mochten er wijzigingen zijn."
Dat is de leverancier die over zijn eigen product spreekt, en het is de sterkste bron die hier beschikbaar is — maar lees wat het wel en niet regelt. Het regelt continuïteit en facturering: V4 Pro blijft, tegen de tarieven die al van kracht zijn. Het belooft geen termijn. We zullen nadere kennisgeving verstrekken is de volledige toezegging, en diezelfde zin laat de deur openstaan voor de terugkeer van het plan. Als je een toezegging voor meerdere kwartalen doet, houd dan rekening met het model waar je vanaf kunt stappen, niet met het model dat je kunt behouden.
De tegenreactie die de terugdraaiing afdwong, is het waard om te begrijpen, want ze sluit aan op een beslissing die je zelf misschien op het punt staat te nemen. Ontwikkelaars hadden niet zozeer bezwaar tegen V4.1 Flash — waarvan DeepSeek zegt dat het V4 Pro verslaat op het gebied van prestaties, prijs, snelheid en totale taaktijd — als wel tegen de automatische vervanging. Het verwisselen van het model achter een stabiele model-ID verandert het gedrag zonder de code te wijzigen: een afgestemde prompt, een werkende temperatuur, een tool-call-schema dat parseert: het zijn allemaal eigenschappen van een specifieke checkpoint. Berichtgeving in CLS (科创板日报), 36Kr, IT之家 en ifeng, en in het Engels bij TheBlockBeats, beschrijft dat DeepSeek het plan eerst uitstelde en vervolgens liet vallen; de eigen documentatie van DeepSeek laat het contrast mooi zien, want de legacy deepseek-v4-flash-namen werden uitgefaseerd en serveren nu V4.1 Flash, en die overstap bleef staan. De overstap naar Pro niet.
De prijs van vandaag, getoetst aan de eigen tariefkaart van de leverancier

Twee cijfers zijn belangrijk, en ze zijn dezelfde lijstprijs in twee valuta's.
• Buiten piekuren (elk uur buiten de onderstaande piekvensters) — invoer $0,726 per 1 mln. bij een cachemiss, of ¥4,5; uitvoer $2,178, of ¥13,5; invoer bij een cachehit $0,024, of ¥0,15.
• Piek — precies het dubbele. Invoer $1.452 / ¥9, uitvoer $4.356 / ¥27, invoer bij cache-hit $0.048 / ¥0.30.
• De eigen dollaromrekening van DeepSeek — de documentatie van de leverancier vermeldt dezelfde yuanlijst als $0,66 input / $1,98 output buiten piekuren en $1,32 / $3,96 tijdens piekuren, met cachehits tegen $0,022 en $0,044. Het verschil met de dollarcijfers van OrcaRouter is de wisselkoers waartegen elke partij omrekent, geen extra tokenvergoeding: OrcaRouter geeft het provider-tarief zonder opslag door, dus het bedrag op de listing is het bedrag dat je betaalt.
• Geen gratis tier voor V4 Pro. Er is wel een gratis Flash-tier op de directory, maar het vlaggenschip is uitsluitend betaald.
• Het specificatieblad, voor de context — V4 Pro is een open-weights-model onder een MIT-licentie, 1,6 biljoen totale parameters met 49 miljard actieve parameters per token, een contextvenster van 1 miljoen tokens en tot 384K uitvoertokens, bij een gelijktijdigheidslimiet van 500. Artificial Analysis vermeldt 72,3 uitvoertokens per seconde.
De modelversie achter dit alles is DeepSeek-V4-Pro-0813, ongewijzigd sinds de release voor algemene beschikbaarheid van 13 augustus — en dat is juist het punt. Niets aan de checkpoint veranderde op 11 september; alleen de beslissing over de toekomst ervan veranderde.
Piek, dal en de weekendregel die de berekening verandert
De piek-/dalregeling waarvan de eerdere versie van deze pagina zei dat die op 17 augustus zou ingaan, is nu een maand oud en is sindsdien eenmaal gewijzigd.
• Piekvensters — 01:00–04:00 en 06:00–10:00 UTC, van maandag tot en met vrijdag. In Beijingse tijd is dat 09:00–12:00 en 14:00–18:00, de eigen werkdag van DeepSeek. Off-peaktarieven zijn precies de helft van de piek, geen kortingsband bovenop die tarieven.
• Weekends vallen volledig buiten de piekuren. Sinds 00:00 uur Chinese tijd op 23 augustus 2026 rekent DeepSeek geen piektarieven meer op zaterdag en zondag. Als je batchwerk kunt verplaatsen, halveert verplaatsing naar het weekend de rekening — en voor teams die gebruikers in Noord- en Zuid-Amerika bedienen, valt het grootste deel van de werkweek al buiten de piekuren zonder enige planning.
• Wat de wijziging kost, tegenover de ¥3/¥6 waarmee het model op 13 augustus werd gelanceerd — de off-peakoutput van vandaag is 2,25× het lanceringstarief en de piekoutput is 4,5×; de piek-cache-hit-input is 12× de oude ¥0,025.
Er is hier sprake van een asymmetrie die verklaart waarom de migratiekwestie blijft opduiken, zelfs nadat de stopzetting was geannuleerd. De prijs van V4 Pro steeg in augustus, terwijl die van zijn opvolger daalde: DeepSeek verlaagde de API-prijzen van de Flash-serie met maximaal 60%, met ingang van 10 september. De druk om over te stappen ging nooit echt over de kennisgeving van 14 september; de kennisgeving maakte het alleen maar urgent.
Wat een verzoek eigenlijk kost
Drie uitgewerkte voorbeelden tegen de daltarieven van vandaag. Elk ervan verdubbelt binnen een piekvenster.
• 100K invoer + 50K uitvoer — $0,0726 + $0,1089 ≈ $0,18.
• 1 mln. input + 1 mln. output — $0,726 + $2,178 = $2,90. Diezelfde aanroep kost tijdens de piek $5,81, en medio augustus was dat $1,32.
• Agentische sessie, 500K invoer + 200K uitvoer — $0,363 + $0,4356 ≈ $0,80.
De maandweergave staat op de modelpagina en is de eerlijke test of de oude kop nog steeds je rekening beschrijft: bij 10 miljoen tokens per maand met een invoeraandeel van 70% komt de kostencalculator uit op $11,62, of ongeveer $9,16 met prompt-caching ingeschakeld. Als je budget was gebaseerd op $0,44, dekt het nu ongeveer 60% van de rekening.
Cache is de hefboom die niemand op tafel legt
Prompt-caching werd waardevoller, niet minder waard, toen de tarieven stegen — en de richting van de twee getallen is daar de reden voor. Op OrcaRouter kost het lezen uit de cache nu $0,024 per 1M tokens tegenover $0,726 zonder cache: een korting van 96,7% op elke invoer die je opnieuw verstuurt. In de vorige versie van deze pagina was het cachetarief $0,060 tegenover een invoerprijs van $0,442, een korting van 86%. De prijs voor het lezen uit de cache daalde met meer dan de helft, terwijl de niet-gecachte invoerprijs met 64% steeg, waardoor het effectieve verschil tussen een token met en een token zonder cache aanzienlijk groter werd.
Voor een agent die bij elke beurt een grote systeemprompt en een lange context opnieuw verzendt, is gecachte input het verschil tussen een rekening die meeschaalt met de gesprekslengte en een die dat niet doet. De praktische regel is onveranderd en het herhalen waard: zet de stabiele systeemprompt en referentiemateriaal vooraan en de vluchtige inhoud achteraan, zodat het voorvoegsel dat je opnieuw verzendt daadwerkelijk in de cache terechtkomt. Bij dit model is die ene structurele keuze meer waard dan welke routerings- of planningsbeslissing daaronder dan ook.
Hoe de V4 Pro-prijs zich verhoudt tot de concurrentie

Directorylijstprijzen voor input/output per 1 miljoen tokens, gecontroleerd op 2026-09-12, afgezet tegen V4 Pro's off-peakprijs van $0,726/$2,178. Twee van deze zijn gewijzigd sinds deze pagina voor het eerst werd gepubliceerd, en een ervan verandert de conclusie.
• Claude Fable 5 — $10 / $50. V4 Pro is 13,8× goedkoper op input en 23× op output.
• Claude Opus 5 — $5 / $25. 6,9× / 11,5×.
GPT-5.6 Sol — $4 / $20 tot 272K context, $8 / $30 daarbuiten. 5,5× / 9,2× op het kortere niveau, 11× / 13,8× op het langere.
• Kimi K3 — $3 / $15. 4,1× / 6,9×.
• Qwen3.8 Max — $2 / $6. 2,8× / 2,8×.
• Grok 4.5 — $2 / $6. 2,8× / 2,8×.
• Gemini 3.6 Flash — $0,75 / $3,75. Vrijwel gelijk bij input met 1,03×, en 1,7× bij output. De prijs is gehalveerd sinds deze pagina werd geschreven.
• MiniMax M3 — $0,30 / $1,20. Goedkoper dan V4 Pro op beide lijnen nu: V4 Pro kost 2,4× meer voor input en 1,8× meer voor output, met hetzelfde 1M-tokenvenster.
• DeepSeek V4 Flash — $0.242 / $0.726 in de directory. Ongeveer 3× goedkoper op beide lijnen, dezelfde 1M-context.
De eerlijke weergave is dus veranderd, en deze pagina zou dat moeten zeggen in plaats van vast te houden aan de oude superlatieve bewering. DeepSeek V4 Pro is niet langer het goedkoopste model met een contextvenster van 1M in het overzicht: Gemini 3.6 Flash en MiniMax M3 onderbieden het allebei, en MiniMax M3 doet dat terwijl het hetzelfde contextvenster biedt. Wat V4 Pro nog steeds is, met meer dan een orde van grootte verschil, is het goedkoopste in de frontier-klasse — elk Westers model uit de vlaggenschipklasse in die lijst kost een veelvoud daarvan op beide prijslijnen. Als de vraag is "de goedkoopst mogelijke aanroep met 1M-context", dan is het antwoord niet langer dit model. Als de vraag is "het goedkoopste model dat zich gedraagt als een frontier-model", dan is dat voorlopig nog steeds dit model.
Wanneer V4 Pro de verkeerde keuze is
• Als je verkeer het zwaarst is tijdens de dagtijd in Peking. De piekuren verdubbelen het tarief, en de piekvensters vallen precies op de Chinese werkdag. Als je gebruikers in de Amerika's zitten, valt het grootste deel van je verkeer al buiten de piek, wat een echt structureel voordeel is. Als je bouwt voor gebruikers in China, modelleer dan de piekfactuur expliciet voordat je je vastlegt — en controleer of je met de weekendregel iets kunt verschuiven.
• Als je prompts kort zijn. Onder ruwweg 10K tokens context is het flagship-tier verspilde capaciteit. DeepSeek V4 Flash voor $0,242/$0,726 in de directory verwerkt dezelfde 1M context voor ongeveer een derde van de prijs, en voor echt korte taken wint een goedkoper model nog steeds.
• Als je vision nodig hebt. V4 Pro is alleen tekst — geen beeld- of audio-invoer — en Artificial Analysis vermeldt de invoermodaliteit als tekst. Gemini 3.6 Flash of Claude Fable 5 zijn de betere keuze als de modaliteit juist het punt is. Ook DeepSeek's eigen API is hier het vermelden waard: die levert nu zijn legacy flash-modelnamen met V4.1 Flash, dat wél afbeeldingen accepteert.
• Als je een ruwe score koopt die de benchmark aanvoert in plaats van prijs-per-context. Op de huidige schaal van Artificial Analysis scoort V4 Pro 36 op de Intelligence Index — 8e van de 113 modellen op het moment van schrijven — en 69 op de Coding-index zoals vermeld in de OrcaRouter-directory. Dat is concurrerend, niet toonaangevend: Claude Fable 5, Claude Opus 5 en GPT-5.6 Sol scoren allemaal hoger op coderen. De propositie van V4 Pro is frontier-adjacente capaciteit tegen een fractie van de prijs per token, niet de top van elke grafiek.
Hoe noem je het in OrcaRouter

DeepSeek V4 Pro wordt gehost op OrcaRouter onder het model-ID deepseek/deepseek-v4-pro, geleverd via het OpenAI-compatibele endpoint op api.orcarouter.ai/v1 tegen het providertarief, zonder markup. Migratie vanaf een bestaande OpenAI-client is niets anders dan een wijziging van de basis-URL en het model-ID.
De terugdraaiing verandert wat je eraan moet doen. Als je een migratie op 14 september in de agenda had staan — het omleiden van V4 Pro naar DeepSeek V4.1 Flash omdat Pro zou verdwijnen — kun je die van de agenda halen, of op zijn minst terugbrengen van een deadline naar een test. Beide modellen zitten achter één OrcaRouter-sleutel, dus om ze te vergelijken is het een kwestie van de model-ID in een request wijzigen, in plaats van een tweede contract en een tweede SDK; en als je V4.1 Flash toch wilt laten evalueren op echt verkeer zonder er een productiepad aan te wagen, is automatische failover de minst risicovolle manier om het live requests te geven, terwijl V4 Pro als terugvaloptie blijft. Dat is de praktische vorm van de beslissing van 11 september: de keuze blijft aan jou, en ze blijft omkeerbaar.
De eerlijkheidsopmerking die ertoe doet voor een prijzenpagina: wij routeren naar het model, wij stellen de prijs ervan niet vast. De off-peakbedragen van $0.726/$2.178 zijn de doorgegeven tarieven van DeepSeek, en ze veranderen wanneer DeepSeek ze verandert — precies daarom heeft deze pagina een datumstempel, en daarom is de versie die je leest herschreven in plaats van aangevuld.
Bronnen en datum
Prijzen en specificaties op deze pagina zijn op 2026-09-12 opnieuw geverifieerd. Dollarbedragen voor DeepSeek V4 Pro en voor elk model in de vergelijking worden gelezen uit de OrcaRouter-modeldirectory, op dezelfde dag gecontroleerd; het aantal parameters, de licentie, het contextvenster, de modaliteit en de snelheidscijfers komen van de modelpagina van Artificial Analysis voor DeepSeek V4 Pro 0813. De yuan-tarieven, de piekvensters en het voortzettingsbericht van 11 september komen uit de eigen Models & Pricing-documentatie van DeepSeek, die de verklaring woordelijk als voetnoot bij de prijstabel bevat. De aankondigingsreeks in drie stappen — het routeringsbericht van 9 september, het uitstel van 10 september naar 12:00 Pekingtijd op 14 september, en de terugdraaiing van 11 september — wordt gemeld door CLS (科创板日报), 36Kr, IT之家 en ifeng, en in het Engels door TheBlockBeats. De weekendfactureringsregel van 23 augustus en de Flash-prijsverlaging van 10 september komen uit de aankondigingen van DeepSeek zoals gerapporteerd door IT之家, The Paper en 21st Century Business Herald.
Tot slot nog een opmerking over betrouwbaarheid, want deze specifieke prijs is in een maand drie keer gewijzigd — lanceringsprijzen op 13 augustus, piek-/daltarieven op 17 augustus, de weekendwijziging op 23 augustus. Beschouw elke pagina met "V4 Pro pricing" zonder datum erop als onbruikbaar. De eerdere versie hiervan vermeldde $0,44/$0,88 en een Artificial Analysis Intelligence index van 44,3; beide waren correct toen ze werden geschreven, en geen van beide overleefde de maand.
Vergeleken in dit artikel3
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
