
Cennik API DeepSeek V4 Pro: 0,73 USD/2,18 USD poza godzinami szczytu i dlaczego odwołano wyłączenie zaplanowane na 14 września
- openaiNOWOŚĆOpenAI: GPT-6.1 Sol2026-09-2952Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Sonnet 5.52026-09-2856Inteligencja
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 223 tok/s
- OpenAINOWOŚĆOpenAI: GPT-6 Luna2026-09-2238Inteligencja
- OpenAINOWOŚĆOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- AnthropicNOWOŚĆAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- xAINOWOŚĆGrok 4.72026-09-2146Inteligencja
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 za 1 mln tokenów · 126 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 za 1 mln tokenów · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 213 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
DeepSeek V4 Pro nie zostaje wycofany. 11 września 2026 r. DeepSeek poinformował, że po 14 września nadal będzie udostępniać ten model przez swoje API, a sposób rozliczania nie ulegnie zmianie — tym samym odwracając plan ogłoszony dwa dni wcześniej, zgodnie z którym każde żądanie do deepseek-v4-pro zostałoby przekierowane do DeepSeek V4.1 Flash i rozliczane według stawek Flash. Dla każdego, kto dostroił swoje prompty, ustawienia temperatury i schematy wywołań narzędzi pod V4 Pro, to właśnie ta informacja liczy się w tym tygodniu: model, pod który budowałeś swoje rozwiązania, pozostaje tam, gdzie jest, a migracja, którą być może zaplanowałeś na poniedziałek, nie musi się odbyć.
Cena to zupełnie inna historia, a ta strona przez miesiąc podawała ją błędnie. DeepSeek V4 Pro nie kosztuje już $0.44/$0.88 za milion tokenów. Poza godzinami szczytu na OrcaRouter rozlicza się po $0.726 za wejście i $2.178 za wyjście za 1 mln tokenów, a w oknach szczytu stawka podwaja się do $1.452/$4.356, przy czym odczyty z pamięci podręcznej kosztują $0.024. Weekendy są teraz w całości poza godzinami szczytu. A własna tabela stawek dostawcy — ta z dokumentacji API DeepSeek — zawiera informację o kontynuacji jako przypis do tej samej tabeli cen, co jest mniej więcej tak blisko źródła pierwotnego, jak to tylko możliwe w przypadku strony z cennikiem.
Co DeepSeek faktycznie powiedział i co to niweczy
Kolejność zdarzeń ma znaczenie, ponieważ dwa z trzech ogłoszeń były wzajemnymi odwróceniami, a to środkowe jest tym, które ludzie pamiętają.
• 9 września — DeepSeek poinformował użytkowników, że do czasu premiery V4.1 Pro żądania kierowane do V4 Pro będą przekierowywane do DeepSeek V4.1 Flash i rozliczane według stawek V4.1 Flash.
• 10 września — V4.1 Flash został wydany, a DeepSeek wyznaczył przełączenie na stały moment: 12:00 czasu pekińskiego 14 września 2026 r., po którym V4 Pro miałby zostać wyłączony, a jego ruch obsługiwałby Flash.
• 11 września — DeepSeek się wycofał. Jego treść, obecnie przytaczana dosłownie jako przypis na stronie Models & Pricing w dokumentacji własnego API: „W odpowiedzi na zapotrzebowanie użytkowników postanowiliśmy kontynuować świadczenie usług API dla DeepSeek V4 Pro po 14 września 2026 r., przy czym metoda rozliczeń pozostaje bez zmian. W przypadku jakichkolwiek zmian przekażemy dalsze informacje."
To dostawca mówi o własnym produkcie i jest to najmocniejsze dostępne tu źródło — ale zwróć uwagę, co rozstrzyga, a czego nie. Rozstrzyga kwestię ciągłości i rozliczeń: V4 Pro zostaje, na stawkach już obowiązujących. Nie obiecuje jednak żadnych ram czasowych. Będziemy przekazywać dalsze informacje to całość zobowiązania, a to samo zdanie pozostawia otwartą furtkę na powrót planu. Jeśli podejmujesz zobowiązanie na wiele kwartałów, planuj z myślą o modelu, z którego da się odejść, a nie o tym, który da się utrzymać.
Sprzeciw, który wymusił tę zmianę decyzji, wart jest zrozumienia, bo przekłada się na decyzję, którą być może i Ty wkrótce podejmiesz. Programiści nie protestowali przeciwko V4.1 Flash — który według DeepSeek bije V4 Pro pod względem wydajności, ceny, szybkości i całkowitego czasu realizacji zadania — lecz przeciwko automatycznemu podstawieniu. Zamiana modelu stojącego za stabilnym identyfikatorem modelu zmienia zachowanie bez zmiany kodu: dostrojony prompt, działająca temperatura, parsujący się schemat wywołań narzędzi — to wszystko właściwości konkretnego checkpointu. Relacje w CLS (科创板日报), 36Kr, IT之家 i ifeng oraz po angielsku w TheBlockBeats opisują, jak DeepSeek najpierw opóźnił, a potem porzucił ten plan; dokumentacja samego DeepSeek pokazuje tę różnicę wyraźnie, bo starsze nazwy deepseek-v4-flash zostały wycofane i teraz obsługują V4.1 Flash — i ta zmiana się utrzymała. Zmiana w przypadku Pro już nie.
Dzisiejsza cena, zweryfikowana na podstawie własnego cennika dostawcy.

Znaczenie mają dwie liczby i są one tą samą ceną katalogową w dwóch walutach.
• Poza godzinami szczytu (każda godzina poza poniższymi okresami szczytu) — dane wejściowe $0.726 za 1 mln przy braku trafienia w pamięć podręczną lub ¥4.5; dane wyjściowe $2.178 lub ¥13.5; dane wejściowe przy trafieniu w pamięć podręczną $0.024 lub ¥0.15.
• Szczyt — dokładnie dwukrotność. Wejście $1.452 / ¥9, wyjście $4.356 / ¥27, wejście z trafieniem w pamięć podręczną $0.048 / ¥0.30.
• Własna konwersja dolarowa samego DeepSeek — dokumentacja dostawcy podaje tę samą listę cen w juanach w przeliczeniu na 0,66 USD za wejście / 1,98 USD za wyjście poza szczytem oraz 1,32 / 3,96 USD w szczycie, a trafienia w pamięć podręczną po 0,022 i 0,044 USD. Różnica w stosunku do kwot w dolarach OrcaRouter to kurs wymiany stosowany przez każdą ze stron, a nie dodatkowa opłata za tokeny: OrcaRouter przekazuje stawkę dostawcy bez marży, więc liczba na liście to kwota, którą płacisz.
• Brak darmowego planu dla V4 Pro. W katalogu istnieje darmowy plan Flash, ale plan flagowy jest dostępny wyłącznie w wersji płatnej.
• Karta specyfikacji, dla kontekstu — V4 Pro to model z otwartymi wagami na licencji MIT, 1,6 bln parametrów łącznie przy 49 mld aktywnych na token, okno kontekstu 1 mln tokenów i do 384 tys. tokenów wyjściowych, przy limicie współbieżności 500. Artificial Analysis podaje 72,3 tokena wyjściowego na sekundę.
Wersją modelu stojącą za tym wszystkim jest DeepSeek-V4-Pro-0813, niezmieniona od wydania ogólnodostępnego z 13 sierpnia — i o to właśnie chodzi. 11 września nic w checkpointcie się nie zmieniło; zmieniła się jedynie decyzja o jego przyszłości.
Szczyt, poza szczytem i weekendowa zasada, która zmienia matematykę
System szczytowy/pozaszczytowy, który wcześniejsza wersja tej strony opisywała jako mający wejść w życie 17 sierpnia, ma teraz miesiąc i od tego czasu został raz zmieniony.
• Godziny szczytu — 01:00–04:00 i 06:00–10:00 UTC, od poniedziałku do piątku. W czasie pekińskim to 09:00–12:00 i 14:00–18:00, czyli własny dzień roboczy DeepSeek. Stawki poza godzinami szczytu wynoszą dokładnie połowę stawek szczytowych, a nie dodatkowe pasmo rabatowe nakładane na nie.
• Weekendy są w całości poza godzinami szczytu. Od 00:00 czasu pekińskiego 23 sierpnia 2026 r. DeepSeek przestał stosować stawki szczytowe w soboty i niedziele. Jeśli Twoje prace wsadowe można przesunąć, przeniesienie ich na weekend o połowę zmniejsza rachunek — a w przypadku zespołów obsługujących użytkowników w Amerykach większość tygodnia pracy już wypada poza godzinami szczytu bez żadnego planowania.
• Ile kosztowała ta zmiana w porównaniu z ¥3/¥6, z którymi model zadebiutował 13 sierpnia — dzisiejsze wyjście poza szczytem to 2,25× stawki z premiery, a w szczycie 4,5×; wejście w szczycie z trafieniem w pamięć podręczną to 12× starego ¥0,025.
Występuje tu asymetria, która wyjaśnia, dlaczego kwestia migracji wciąż powraca, nawet po anulowaniu wyłączenia. Cena V4 Pro wzrosła w sierpniu, a cena jego następcy spadła: DeepSeek obniżył ceny API serii Flash nawet o 60% od 10 września. Presja, by dokonać migracji, nigdy tak naprawdę nie brała się z powiadomienia z 14 września; powiadomienie tylko nadało jej pilny charakter.
Ile właściwie kosztuje zapytanie
Trzy przykłady obliczeń według dzisiejszych stawek poza godzinami szczytu. Każdy z nich podwaja się w oknie szczytu.
• 100 tys. wejścia + 50 tys. wyjścia — $0,0726 + $0,1089 ≈ $0,18.
• 1 mln na wejściu + 1 mln na wyjściu — 0,726 USD + 2,178 USD = 2,90 USD. To samo wywołanie kosztuje 5,81 USD w szczycie, a w połowie sierpnia kosztowało 1,32 USD.
• Sesja agentowa, 500K na wejściu + 200K na wyjściu — 0,363 USD + 0,4356 USD ≈ 0,80 USD.
Widok miesięczny znajduje się na stronie modelu i stanowi uczciwy test tego, czy stary nagłówek nadal opisuje Twój rachunek: przy 10 mln tokenów miesięcznie i 70% udziale danych wejściowych kalkulator kosztów wskazuje 11,62 USD, czyli około 9,16 USD przy włączonym buforowaniu promptów. Jeśli Twój budżet był opracowany przy założeniu 0,44 USD, pokrywa teraz około 60% rachunku.
Cache to dźwignia, której nikt nie kładzie na stole.
Buforowanie promptów stało się bardziej wartościowe, a nie mniej, gdy stawki wzrosły — i to kierunek zmian obu tych liczb jest tego powodem. W OrcaRouter odczyt z pamięci podręcznej kosztuje teraz 0,024 USD za 1 mln tokenów w porównaniu z 0,726 USD bez buforowania, co daje 96,7% zniżki na dowolne dane wejściowe wysyłane ponownie. W poprzedniej wersji tej strony stawka za pamięć podręczną wynosiła 0,060 USD w porównaniu z ceną danych wejściowych 0,442 USD, czyli 86% zniżki. Cena odczytu z pamięci podręcznej spadła o ponad połowę, podczas gdy cena danych wejściowych bez buforowania wzrosła o 64%, więc rzeczywista różnica między tokenem z pamięci podręcznej a tokenem bez buforowania znacznie się powiększyła.
Dla agenta, który przy każdej turze ponownie wysyła duży prompt systemowy i długi kontekst, buforowane dane wejściowe to różnica między rachunkiem, który rośnie wraz z długością rozmowy, a takim, który tego nie robi. Praktyczna zasada pozostaje niezmieniona i warto ją powtórzyć: umieść stabilny prompt systemowy i materiały referencyjne na początku, a treść zmienną na końcu, aby ponownie wysyłany prefiks faktycznie trafiał do pamięci podręcznej. W tym modelu ten pojedynczy wybór strukturalny jest wart więcej niż jakakolwiek decyzja dotycząca routingu lub szeregowania poniżej.
Jak ceny V4 Pro wypadają na tle konkurencji

Ceny katalogowe za wejście/wyjście na 1 mln tokenów, sprawdzone 12.09.2026, zestawione z cenami V4 Pro poza szczytem wynoszącymi 0,726 USD/2,178 USD. Dwie z tych pozycji zmieniły się od czasu pierwszego opublikowania tej strony, a jedna z nich zmienia wnioski.
• Claude Fable 5 — 10 / 50 USD. V4 Pro jest 13,8× tańszy na wejściu i 23× na wyjściu.
• Claude Opus 5 — 5 / 25 USD. 6,9× / 11,5×.
• GPT-5.6 Sol — 4 USD / 20 USD do 272 tys. kontekstu, 8 USD / 30 USD powyżej. 5,5× / 9,2× w krótszym progu, 11× / 13,8× w dłuższym.
• Kimi K3 — 3 USD / 15 USD. 4,1× / 6,9×.
• Qwen3.8 Max — 2 / 6 USD. 2,8× / 2,8×.
• Grok 4.5 — 2 $ / 6 $. 2,8× / 2,8×.
• Gemini 3.6 Flash — $0.75 / $3.75. W przybliżeniu parytet na wejściu przy 1,03×, a na wyjściu 1,7×. Jego cena spadła o połowę od czasu napisania tej strony.
• MiniMax M3 — $0,30 / $1,20. Tańszy niż V4 Pro na obu liniach teraz: V4 Pro kosztuje 2,4× więcej na wejściu i 1,8× więcej na wyjściu, przy tym samym oknie 1M tokenów.
• DeepSeek V4 Flash — 0,242 USD / 0,726 USD w katalogu. Około 3× taniej w obu pozycjach, ten sam kontekst 1M.
Uczciwe ujęcie sprawy się zmieniło i ta strona powinna to powiedzieć, zamiast trzymać się starego superlatywu. DeepSeek V4 Pro nie jest już najtańszym modelem z kontekstem 1M na liście: Gemini 3.6 Flash i MiniMax M3 są od niego tańsze, a MiniMax M3 robi to, dorównując jednocześnie rozmiarowi okna kontekstu. Czym V4 Pro wciąż pozostaje — i to o ponad rząd wielkości — jest najtańszą opcją w klasie frontier: każdy zachodni model klasy flagowej na tej liście kosztuje wielokrotność jego ceny w obu wierszach. Jeśli pytanie brzmi „najtańsze możliwe wywołanie z kontekstem 1M”, odpowiedź nie brzmi już: ten model. Jeśli pytanie brzmi „najtańszy model, który zachowuje się jak model frontier”, na razie wciąż nim jest.
Kiedy V4 Pro jest złym wyborem
• Jeśli Twój ruch jest największy w ciągu dnia w Pekinie. Godziny szczytu podwajają stawkę, a okna szczytu przypadają dokładnie na chiński dzień roboczy. Jeśli Twoi użytkownicy są w obu Amerykach, większość Twojego ruchu już trafia poza godziny szczytu, co jest prawdziwą przewagą strukturalną. Jeśli tworzysz dla użytkowników w Chinach, jawnie zamodeluj rachunek za godziny szczytu, zanim się zobowiążesz — i sprawdź, czy zasada weekendowa pomaga Ci cokolwiek przesunąć.
• Jeśli Twoje prompty są krótkie. Poniżej około 10 tys. tokenów kontekstu flagowa warstwa to marnowanie możliwości. DeepSeek V4 Flash w cenie $0.242/$0.726 w katalogu obsługuje ten sam kontekst 1M za około jedną trzecią ceny, a w przypadku naprawdę krótkich zadań tańszy model nadal wygrywa.
• Jeśli potrzebujesz obsługi obrazu. V4 Pro obsługuje wyłącznie tekst — brak wejścia obrazu i dźwięku — a Artificial Analysis podaje jego modalność wejściową jako tekst. Gemini 3.6 Flash lub Claude Fable 5 będą lepszym wyborem, jeśli modalność jest kluczowa. Warto tu również wspomnieć o własnym API DeepSeek: obecnie pod swoimi starszymi nazwami modeli flash udostępnia V4.1 Flash, który obsługuje obrazy.
• Jeśli kupujesz najwyższy surowy wynik w benchmarkach, a nie cenę za kontekst. W obecnej skali Artificial Analysis V4 Pro uzyskuje 36 w Intelligence Index — 8. z 113 modeli w momencie pisania — oraz 69 w indeksie Coding, tak jak podano w katalogu OrcaRouter. To wynik konkurencyjny, ale nie wiodący: Claude Fable 5, Claude Opus 5 i GPT-5.6 Sol mają wyższe wyniki w kodowaniu. Propozycja V4 Pro to możliwości bliskie czołówki za ułamek ceny za token, a nie szczyt każdego zestawienia.
Jak to wywołać w OrcaRouter

DeepSeek V4 Pro jest hostowany na OrcaRouter pod identyfikatorem modelu deepseek/deepseek-v4-pro, udostępnianym przez endpoint zgodny z OpenAI pod adresem api.orcarouter.ai/v1 w stawce dostawcy bez marży. Migracja z istniejącego klienta OpenAI to zmiana bazowego adresu URL i identyfikatora modelu i nic więcej.
Odwrócenie decyzji zmienia to, co powinieneś z tym zrobić. Jeśli miałeś w kalendarzu migrację na 14 września — przełączenie z V4 Pro na DeepSeek V4.1 Flash, ponieważ Pro miał zostać wycofany — możesz ją zdjąć z kalendarza, a przynajmniej zdegradować ją z terminu do testu. Oba modele działają za jednym kluczem OrcaRouter, więc porównanie ich to zmiana identyfikatora modelu w zapytaniu, a nie drugi kontrakt i drugie SDK; a jeśli naprawdę chcesz, aby V4.1 Flash został oceniony na prawdziwym ruchu bez stawiania na niego ścieżki produkcyjnej, automatyczne przełączanie awaryjne to niskiego ryzyka sposób na przekazanie mu żądań na żywo, podczas gdy V4 Pro pozostaje jako opcja zapasowa. Taki jest praktyczny kształt decyzji z 11 września: wybór pozostaje po twojej stronie i pozostaje odwracalny.
Notka o uczciwości, która ma znaczenie na stronie z cennikiem: kierujemy ruch do modelu, ale nie ustalamy jego ceny. Kwoty $0.726/$2.178 poza godzinami szczytu to stawki DeepSeek przekazywane dalej; zmieniają się, gdy DeepSeek je zmienia — i właśnie dlatego ta strona jest opatrzona datą oraz dlatego wersja, którą czytasz, została przepisana, a nie uzupełniona przez dopisanie.
Źródła i data
Ceny i specyfikacje na tej stronie zostały ponownie zweryfikowane 12.09.2026. Kwoty w dolarach dla DeepSeek V4 Pro oraz dla każdego modelu w porównaniu pochodzą z katalogu modeli OrcaRouter, sprawdzonego tego samego dnia; liczba parametrów, licencja, okno kontekstowe, modalność i dane dotyczące szybkości pochodzą ze strony modelu DeepSeek V4 Pro 0813 w Artificial Analysis. Stawki w juanach, okna szczytowe oraz ogłoszenie o kontynuacji z 11 września pochodzą z dokumentacji Models & Pricing samego DeepSeek, która zawiera to oświadczenie dosłownie jako przypis do tabeli cen. Trzyetapowa sekwencja ogłoszeń — komunikat o routingu z 9 września, opóźnienie z 10 września do godz. 12:00 czasu pekińskiego 14 września oraz odwrócenie z 11 września — jest relacjonowana przez CLS (科创板日报), 36Kr, IT之家 i ifeng, a po angielsku przez TheBlockBeats. Zasada rozliczania weekendowego z 23 sierpnia oraz obniżka ceny Flash z 10 września pochodzą z ogłoszeń DeepSeek, o których informowały IT之家, The Paper i 21st Century Business Herald.
Jedna uwaga na zakończenie o wiarygodności, bo ta konkretna cena zmieniła się trzy razy w ciągu miesiąca — stawki premierowe 13 sierpnia, szczytowe/poza szczytem 17 sierpnia, weekendowa nowelizacja 23 sierpnia. Każdą stronę „V4 Pro pricing” bez daty należy uznać za bezużyteczną. Wcześniejsza wersja tej strony podawała 0,44 USD/0,88 USD oraz indeks Artificial Analysis Intelligence wynoszący 44,3; obie wartości były poprawne, gdy je zapisano, i żadna nie przetrwała miesiąca.
Porównane w tym artykule3
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
