
DeepSeek V4 Pro API-prissättning: $0,73/$2,18 i lågtrafik, och varför nedstängningen den 14 september avblåstes
- openaiNYOpenAI: GPT-6.1 Sol2026-09-2952Intelligens
- anthropicNYAnthropic: Claude Sonnet 5.52026-09-2856Intelligens
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 223 tok/s
- OpenAINYOpenAI: GPT-6 Luna2026-09-2238Intelligens
- OpenAINYOpenAI: GPT-6 Sol2026-09-2248Intelligens
- AnthropicNYAnthropic: Claude Opus 5.52026-09-2258Intelligens
- xAINYGrok 4.72026-09-2146Intelligens
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M tokens · 126 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 213 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
DeepSeek V4 Pro avvecklas inte. Den 11 september 2026 meddelade DeepSeek att man kommer att fortsätta tillhandahålla modellen via sitt API efter den 14 september, med oförändrad faktureringsmetod – man backar från en plan som tillkännagavs två dagar tidigare, enligt vilken varje deepseek-v4-pro-begäran skulle ha omdirigerats till DeepSeek V4.1 Flash och fakturerats enligt Flash-priser. För alla vars prompter, temperaturinställningar och scheman för verktygsanrop är anpassade till V4 Pro är det detta faktum som spelar roll den här veckan: modellen du byggde mot stannar där den är, och migreringen du kanske hade planerat till måndag behöver inte genomföras.
Priset är en annan historia, och den här sidan hade fel i en månad. DeepSeek V4 Pro kostar inte längre $0.44/$0.88 per miljon tokens. Utanför högtrafik debiteras det $0.726 för indata och $2.178 för utdata per 1M tokens på OrcaRouter, vilket fördubblas till $1.452/$4.356 under högtrafikfönstren, med cacheläsningar på $0.024. Helger är nu helt och hållet utanför högtrafik. Och leverantörens egen prislista – den i DeepSeeks API-dokumentation – har fortsättningsmeddelandet som en fotnot till samma pristabell, vilket är ungefär så nära en primärkälla en prissida kan komma.
Vad DeepSeek faktiskt sa, och vad det upphäver
Tidslinjen spelar roll, eftersom två av de tre tillkännagivandena var varandras motsatser och det mellersta är det som folk minns.
• 9 september — DeepSeek meddelade användarna att förfrågningar till V4 Pro fram till lanseringen av V4.1 Pro skulle dirigeras till DeepSeek V4.1 Flash och debiteras enligt V4.1 Flash-priser.
• 10 september — V4.1 Flash släpptes, och DeepSeek flyttade övergången till en fast tidpunkt: 12:00 Peking-tid den 14 september 2026, varefter V4 Pro skulle gå offline och dess trafik skulle betjänas av Flash.
• 11 september — DeepSeek gjorde en helomvändning. Formuleringen, som nu ordagrant återges som en fotnot på sidan Modeller och prissättning i dess egen API-dokumentation: "På grund av användarnas efterfrågan har vi beslutat att fortsätta tillhandahålla API-tjänster för DeepSeek V4 Pro efter den 14 september 2026, med oförändrad faktureringsmetod. Vi meddelar ytterligare om några ändringar sker."
Det är leverantören som talar om sin egen produkt, och det är den starkaste källan som finns här – men läs vad den fastställer och inte fastställer. Den fastställer kontinuitet och fakturering: V4 Pro blir kvar, till de priser som redan gäller. Den lovar ingen tidsram. Vi kommer att lämna ytterligare besked är hela åtagandet, och samma mening lämnar dörren öppen för att planen ska kunna återkomma. Om du gör ett åtagande över flera kvartal, planera för den modell du kan flytta bort från snarare än den du kan behålla.
Motreaktionen som tvingade fram vändningen är värd att förstå, eftersom den motsvarar ett beslut som du själv kan vara på väg att fatta. Utvecklare invände inte mot V4.1 Flash – som DeepSeek säger överträffar V4 Pro i prestanda, pris, hastighet och total uppgiftstid – utan mot den automatiska ersättningen. Att byta ut modellen bakom ett stabilt modell-ID ändrar beteendet utan att ändra koden: en justerad prompt, en fungerande temperatur, ett verktygsanropsschema som parsas är alla egenskaper hos en specifik checkpoint. Bevakning i CLS (科创板日报), 36Kr, IT之家 och ifeng, och på engelska hos TheBlockBeats, beskriver hur DeepSeek först sköt upp och sedan övergav planen; DeepSeeks egna dokument visar kontrasten tydligt, eftersom de äldre deepseek-v4-flash-namnen var pensionerade och servar nu V4.1 Flash, och den övergången blev bestående. Det gjorde inte Pro-övergången.
Dagens pris, kontrollerat mot leverantörens egen prislista

Två siffror spelar roll, och de är samma listpris i två valutor.
• Lågtrafik (varje timme utanför nedanstående högtrafikfönster) – indata $0,726 per 1 miljon vid cachemiss, eller ¥4,5; utdata $2,178, eller ¥13,5; indata vid cacheträff $0,024, eller ¥0,15.
Topp — exakt dubbelt. Indata $1,452 / ¥9, utdata $4,356 / ¥27, indata vid cacheträff $0,048 / ¥0,30.
• DeepSeeks egen dollarkonvertering – leverantörens dokument visar samma yuanlista som 0,66 USD för indata / 1,98 USD för utdata utanför högtrafik och 1,32 / 3,96 vid högtrafik, med cacheträffar på 0,022 USD och 0,044 USD. Skillnaden mot OrcaRouters dollarsiffror är växelkursen som respektive part använder vid omvandlingen, inte en tillagd tokenavgift: OrcaRouter för vidare leverantörens pris utan påslag, så siffran i listningen är siffran du betalar.
• Ingen gratistier för V4 Pro. En gratis Flash-tier finns i katalogen, men flaggskeppet är endast betalt.
• Specifikationsbladet, för sammanhanget — V4 Pro är en modell med öppna vikter under MIT-licens, 1,6T totala parametrar med 49B aktiva per token, ett kontextfönster på 1M tokens och upp till 384K utdatatokens, vid en samtidighetsgräns på 500. Artificial Analysis listar 72,3 utdatatokens per sekund.
Modellversionen bakom allt detta är DeepSeek-V4-Pro-0813, oförändrad sedan den allmänna tillgänglighetsversionen den 13 augusti – vilket är poängen. Ingenting med checkpointen förändrades den 11 september; bara beslutet om dess framtid gjorde det.
Högtrafik, lågtrafik och helgregeln som ändrar matematiken
Hög-/lågtrafiksystemet som den tidigare versionen av den här sidan angav skulle införas den 17 augusti är nu en månad gammalt, och det har ändrats en gång sedan dess.
• Toppfönster — 01:00–04:00 och 06:00–10:00 UTC, måndag till fredag. I Beijing-tid är det 09:00–12:00 och 14:00–18:00, DeepSeeks egen arbetsdag. Lågtaxorna är exakt hälften av högtaxorna, inte en rabattnivå ovanpå dem.
• Helger ligger helt utanför högtrafik. Från och med kl. 00:00 Beijing-tid den 23 augusti 2026 slutade DeepSeek att tillämpa högtrafikpriser på lördagar och söndagar. Om ert batcharbete kan flyttas halverar en flytt till helgen kostnaden – och för team som betjänar användare i Amerika infaller större delen av arbetsveckan redan utanför högtrafik helt utan schemaläggning.
• Vad ändringen kostade, jämfört med de ¥3/¥6 som modellen lanserades med den 13 augusti — dagens utdata under lågtrafik är 2,25× lanseringspriset och utdata under högtrafik är 4,5×; indata vid cacheträff under högtrafik är 12× det gamla ¥0,025.
Det finns en asymmetri här som förklarar varför migrationsfrågan fortsätter att dyka upp även efter att nedstängningen avblåstes. V4 Pros pris steg i augusti medan efterträdarens sjönk: DeepSeek sänkte API-priserna för Flash-serien med upp till 60 % från och med den 10 september. Pressen att migrera handlade egentligen aldrig om meddelandet den 14 september; meddelandet gjorde det bara brådskande.
Vad en förfrågan faktiskt kostar
Tre genomräknade exempel med dagens lågtaxa. Vart och ett av dem fördubblas inom ett högtaxfönster.
• 100K indata + 50K utdata — $0.0726 + $0.1089 ≈ $0.18.
• 1M indata + 1M utdata — $0,726 + $2,178 = $2,90. Samma anrop kostar $5,81 vid högbelastning, och i mitten av augusti var det $1,32.
• Agentisk session, 500K indata + 200K utdata — $0,363 + $0,4356 ≈ $0,80.
Månadsvyn finns på modellsidan och är det ärliga testet på om den gamla rubriken fortfarande beskriver din räkning: vid 10M tokens i månaden med en indataandel på 70 % hamnar kostnadskalkylatorn på $11.62, eller cirka $9.16 med prompt-cachning aktiverad. Om din budget byggdes mot $0.44 täcker den nu ungefär 60 % av räkningen.
Cache är hävstången som ingen lägger i tabellen.
Prompt-cachning blev mer värdefullt, inte mindre, när priserna steg — och riktningen på de två siffrorna är anledningen. På OrcaRouter debiteras en cacheläsning nu $0,024 per 1 miljon tokens mot $0,726 ocachat, en rabatt på 96,7 % på all input du skickar igen. I den tidigare versionen av den här sidan var cachepriset $0,060 mot ett inputpris på $0,442, en rabatt på 86 %. Priset för cacheläsning föll med mer än hälften samtidigt som det ocachade inputpriset steg med 64 %, så det effektiva gapet mellan en cachad och en ocachad token vidgades avsevärt.
För en agent som skickar ett stort systemprompt och en lång kontext varje tur är cachad indata skillnaden mellan en kostnad som skalar med konversationslängden och en som inte gör det. Den praktiska regeln är oförändrad och värd att upprepa: placera det stabila systempromptet och referensmaterialet först och det föränderliga innehållet sist, så att prefixet du skickar igen faktiskt träffar cachen. På den här modellen är det enskilda strukturella valet värt mer än något routing- eller schemaläggningsbeslut under det.
Hur V4 Pro-prissättningen jämför med konkurrenterna

Kataloglistpriser för indata/utdata per 1 miljon tokens, kontrollerade 2026-09-12, jämfört med V4 Pro:s lågtrafikpris på $0,726/$2,178. Två av dessa har ändrats sedan den här sidan först publicerades, och en av dem ändrar slutsatsen.
• Claude Fable 5 — $10 / $50. V4 Pro är 13,8× billigare för indata och 23× för utdata.
• Claude Opus 5 — $5 / $25. 6,9× / 11,5×.
• GPT-5.6 Sol — $4 / $20 upp till 272K i kontext, $8 / $30 därutöver. 5,5× / 9,2× på den kortare nivån, 11× / 13,8× på den längre.
• Kimi K3 — $3 / $15. 4,1× / 6,9×.
• Qwen3.8 Max — 2 $ / 6 $. 2,8× / 2,8×.
• Grok 4.5 — 2 $ / 6 $. 2,8× / 2,8×.
• Gemini 3.6 Flash — 0,75 $ / 3,75 $. Ungefär samma nivå för indata vid 1,03×, och 1,7× för utdata. Dess pris har halverats sedan den här sidan skrevs.
• MiniMax M3 — $0.30 / $1.20. Billigare än V4 Pro på båda raderna nu: V4 Pro kostar 2,4× mer för input och 1,8× mer för output, med samma fönster på 1M tokens.
• DeepSeek V4 Flash — $0.242 / $0.726 i katalogen. Ungefär 3× billigare på båda raderna, samma 1M-kontext.
Så den ärliga formuleringen har förändrats, och den här sidan bör säga det i stället för att behålla den gamla superlativformen. DeepSeek V4 Pro är inte längre den billigaste modellen med 1M-kontext på listan: både Gemini 3.6 Flash och MiniMax M3 ligger under den i pris, och MiniMax M3 gör det samtidigt som den matchar kontextfönstret. Vad V4 Pro fortfarande är, med mer än en tiopotens marginal, är det billigaste i frontier-klassen – varje västerländsk modell i flaggskeppsklass på den listan kostar mångdubbelt mer än den på båda raderna. Om frågan är "billigaste möjliga 1M-kontextanrop", är svaret inte längre den här modellen. Om frågan är "billigaste modell som beter sig som en frontiermodell", är det fortfarande den, för närvarande.
När V4 Pro är fel val
• Om din trafik är som störst under dagtid i Peking. Högtrafiktimmar fördubblar priset, och högtrafikfönstren infaller exakt under Kinas arbetsdag. Om dina användare finns i Amerika hamnar större delen av din trafik redan utanför högtrafik, vilket är en verklig strukturell fördel. Om du bygger för användare i Kina bör du modellera toppkostnaden uttryckligen innan du satsar – och kontrollera om helgregeln hjälper dig att flytta något.
• Om dina prompter är korta. Under ungefär 10K tokens kontext är flaggskeppsnivån bortkastad kapacitet. DeepSeek V4 Flash till $0.242/$0.726 i katalogen hanterar samma 1M kontext för ungefär en tredjedel av priset, och för genuint korta uppgifter vinner fortfarande en billigare modell.
• Om du behöver bildseende. V4 Pro är endast text — ingen bild- eller ljudinmatning — och Artificial Analysis listar dess indatamodalitet som text. Gemini 3.6 Flash eller Claude Fable 5 är ett bättre val om själva modaliteten är poängen. DeepSeek:s eget API är också värt att nämna här: det tillhandahåller nu sina äldre flash-modellnamn med V4.1 Flash, som faktiskt accepterar bilder.
• Om du köper råpoäng som toppar benchmarkar snarare än pris per kontext. På Artificial Analysis nuvarande skala får V4 Pro 36 på Intelligence Index – åttonde av 113 modeller när detta skrivs – och 69 på Coding-indexet såsom det anges i OrcaRouter-katalogen. Det är konkurrenskraftigt, inte ledande: Claude Fable 5, Claude Opus 5 och GPT-5.6 Sol får alla högre poäng än den i kodning. V4 Pros säljargument är kapacitet nära frontlinjen till en bråkdel av priset per token, inte högst upp i varje diagram.
Hur man anropar det på OrcaRouter

DeepSeek V4 Pro driftas hos OrcaRouter under modell-ID:t deepseek/deepseek-v4-pro, som serveras via den OpenAI-kompatibla slutpunkten på api.orcarouter.ai/v1 till leverantörens pris utan påslag. Att migrera från en befintlig OpenAI-klient är en ändring av bas-URL och modell-ID och inget annat.
Omkastningen ändrar vad du bör göra åt saken. Om du hade en migrering den 14 september i kalendern – en ompekning från V4 Pro till DeepSeek V4.1 Flash eftersom Pro skulle försvinna – kan du ta bort den från kalendern, eller åtminstone nedgradera den från en deadline till ett test. Båda modellerna ligger bakom en och samma OrcaRouter-nyckel, så att jämföra dem är ett byte av modell-ID i en begäran i stället för ett andra kontrakt och ett andra SDK; och om du faktiskt vill utvärdera V4.1 Flash på verklig trafik utan att satsa en produktionsväg på den, är automatisk failover det lågriskalternativ som ger den liveförfrågningar medan V4 Pro förblir reserven. Det är den praktiska formen av beslutet den 11 september: valet förblir ditt, och det förblir reversibelt.
Ärlighetsnoten som är viktig för en prissättningssida: vi dirigerar till modellen, vi sätter inte dess pris. Siffrorna $0.726/$2.178 för lågtrafik är DeepSeek-priser som förs vidare, och de ändras när DeepSeek ändrar dem — vilket är precis varför den här sidan är datumstämplad, och varför versionen du läser skrevs om i stället för att läggas till.
Källor och datum
Priser och specifikationer på den här sidan verifierades på nytt den 12 september 2026. Dollarsiffror för DeepSeek V4 Pro och för varje modell i jämförelsen hämtas från OrcaRouters modellkatalog, kontrollerad samma dag; antalet parametrar, licensen, kontextfönstret, modaliteten och hastighetssiffrorna kommer från Artificial Analysiss modellsida för DeepSeek V4 Pro 0813. Yuan-kurserna, högtidsfönstren och fortsättningsmeddelandet den 11 september kommer från DeepSeeks egen dokumentation Models & Pricing, som återger uttalandet ordagrant som en fotnot till pristabellen. Det trestegs meddelandeförloppet – routingmeddelandet den 9 september, förseningen den 10 september till kl. 12.00 pekingtid den 14 september och återkallandet den 11 september – rapporteras av CLS (科创板日报), 36Kr, IT之家 och ifeng, och på engelska av TheBlockBeats. Regeln om debitering under helger den 23 augusti och prissänkningen för Flash den 10 september kommer från DeepSeeks tillkännagivanden i bevakningen av IT之家, The Paper och 21st Century Business Herald.
En avslutande not om tillförlitlighet, eftersom just detta pris har ändrats tre gånger under en månad – lanseringspriser den 13 augusti, peak/off-peak den 17 augusti, helgändringen den 23 augusti. Betrakta alla "V4 Pro pricing"-sidor utan datum som oanvändbara. Den tidigare versionen av den här angav $0.44/$0.88 och ett Artificial Analysis Intelligence-index på 44.3; båda var korrekta när de skrevs, och ingen av dem överlevde månaden.
Jämförda i den här artikeln4
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
