
DeepSeek V4.1 Pro nie ma daty premiery — tylko okno, które zamyka się 30 września
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 362 tok/s
- openaiNOWOŚĆOpenAI: GPT-6 Luna2026-09-2237Inteligencja
- openaiNOWOŚĆOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- anthropicNOWOŚĆAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- grokNOWOŚĆGrok 4.72026-09-2146Inteligencja
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów · 183 tok/s
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 1285 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 119 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 224 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
DeepSeek V4.1 Pro to nazwa z doczepionym kalendarzem. Nie ma karty modelu, pliku wag, specyfikacji, ceny ani endpointu — to, co model zyskał w ostatnim tygodniu, to wiarygodna data, a data pochodzi z tweeta, a nie od DeepSeek. 25 września tracker @teortaxesTex napisał, że dwie prace DeepSeek, które ukazały się pierwsze, wyczerpały już cykl informacyjny, że chińskie święto narodowe zaczyna się 1 października, i że firma może z tego powodu zrobić coś „w poniedziałek” — dodając jednym tchem: „Mam nadzieję, że to V4.1 Pro [Preview? oby nie]”. To domysł na temat harmonogramu, a nie doniesienie o modelu. Dwa modele DeepSeek, które dziś faktycznie można wywołać, to DeepSeek V4.1 Flash, wydanie open-weights 552B z 10 września, oraz DeepSeek V4 Pro, flagowiec 1.6T, którego wycofanie odwołano cztery dni później. Żaden z nich nie jest tym, o czym mówi tweet, i żaden nie mówi nic o tym, kiedy pojawi się trzeci.
Argumenty dotyczące timing'u to najłatwiejszy do przeinaczenia rodzaj historii o AI, więc w tym przypadku warto oddzielić to, co można sprawdzić, od tego, co jest tylko domysłem, a następnie powiedzieć, co musiałoby się stać, żeby domysł zamienił się w news. Trzy z tych rzeczy da się sprawdzić i wszystkie się potwierdzają: dwie prace DeepSeek rzeczywiście ukazały się w ostatnim tygodniu, jedna z nich rzeczywiście wymienia z nazwy linię V4.1, a sama historia wydań DeepSeek rzeczywiście ma kształt, który można zmierzyć. To, czego nie da się sprawdzić, jest jedyną rzeczą, którą tweet faktycznie twierdzi.
Czym jest sygnał, w kategoriach dowodowych
Tweet to jeden akapit rozumowania autorstwa konta, które uważnie śledzi DeepSeek, opublikowany w piątek, o firmie, która niczego nie ogłosiła. Jego tok rozumowania jest następujący: dwa niedawne artykuły DeepSeek przyciągnęły uwagę, którą uzyskałoby wydanie modelu; następne naturalne okno jest krótkie, ponieważ Święto Narodowe zaczyna się 1 października; dlatego premiera na początku przyszłego tygodnia jest prawdopodobna, a autor ma nadzieję, że będzie to wersja Pro, a nie jej zapowiedź.
Tylko ostatnia klauzula zawiera jakiekolwiek informacje dotyczące konkretnego modelu, a to, co zawiera, jest raczej nadzieją niż faktem. Warto jednak uważnie przeczytać zastrzeżenie „Preview?”, ponieważ nazywa ono jeden wynik, którego tracker nie chce: częściowe wydanie z tymczasowym identyfikatorem modelu, później zastąpionym czymś lepszym. DeepSeek ma już w tym zakresie praktykę. Generacja V4 pojawiła się jako wersja zapoznawcza 24 kwietnia 2026 r. przed pełnym wydaniem, a sama baza V4.1 została wydana z adnotacją, że starsze nazwy modeli Flash będą nadal akceptowane, podczas gdy modele, które się za nimi kryły, zostaną wycofane. Każdy, kto planuje z uwzględnieniem tempa DeepSeek, musi planować wydania etapowe, a nie pojedyncze ogłoszenia.
Nie ma drugiego źródła dla poniedziałkowego twierdzenia, żadnego dokumentu DeepSeek, który by je potwierdzał, i — to ma znaczenie — żadnego kosztu dla DeepSeek, jeśli jest błędne. A już wcześniej mylono się w tym samym kierunku: ten sam tracker sugerował 14 września, że po awarii usługi może nastąpić wgranie V4.1 Pro. Dziennik zmian DeepSeek nie pokazuje zupełnie nic między 10 września a dniem dzisiejszym.
Poniedziałek byłby nietypowy, i to jest właśnie ta ciekawa część.
Historia wydań samego DeepSeek, opatrzona datami, jest publiczna, a czytana jak kalendarz mówi coś trochę innego niż tweet. Przejdź wstecz przez wpisy: 10 września 2026 r., wydanie V4.1 Flash, czwartek; 21 sierpnia, eksperymentalny model wizyjny Flash, piątek; 13 sierpnia, wydanie ogólnodostępne V4 Pro, czwartek; 31 lipca, aktualizacja Flash, piątek; 24 kwietnia, wersja zapoznawcza V4, piątek. Ostatni poniedziałkowy wpis w całym dzienniku zmian to DeepSeek V3.2, z 1 grudnia 2025 r.
Zatem poniedziałkowe wydanie 28 września byłoby pierwszym od około dziesięciu miesięcy. Wzorzec, który historia faktycznie potwierdza, jest łagodniejszy i bardziej użyteczny: DeepSeek wypuszcza w połowie i pod koniec tygodnia, a przez święta nie wypuszcza. Ta druga część też nie jest domysłem — jest zapisana w cenniku. Okna rozliczeniowe w godzinach szczytu DeepSeek są zdefiniowane jako 01:00–04:00 i 06:00–10:00 UTC, od poniedziałku do piątku, „z wyłączeniem chińskich świąt publicznych”. Firma, która wycina święta publiczne ze swojego kalendarza rozliczeń, traktuje okres świąteczny jako czas, w którym nic nie jest obsługiwane, i to jest rozsądna część argumentu z tweeta.
Połącz te dwie rzeczy, a otrzymasz okno, a nie datę. Dziś jest piątek, 25 września. Poniedziałek to 28 września, trzy dni od dziś. Święto Narodowe wypada w czwartek, 1 października, a okres świąteczny zaczyna się od tego dnia. To pozostawia 28, 29 i 30 września jako prawdopodobne terminy, a jeśli wszystkie trzy miną bez wpisu w dzienniku zmian, następne okno nie otworzy się, dopóki nie skończą się święta. To, czego kalendarz nie może ci powiedzieć, to czy cokolwiek w ogóle nadchodzi — zawęża pytanie o to, kiedy, nigdy o to, czy, a wcześniejsza wersja tego samego okna już zamknęła się bez żadnego wpisu.
Dwie prace jednak się pojawiły — ta część jest prawdziwa

Twierdzenie, że DeepSeek opublikował swoje prace przed swoim modelem, potwierdza się, a oba artykuły są warte więcej niż zdanie, które tweet im poświęca.
Pierwsza to DeepSeek Elastic Compute (DSec), arXiv 2609.22978, przesłana 19 września i licząca 31 stron. To artykuł systemowy o platformie sandbox, której DeepSeek używa do trenowania i oceniania agentów: backendy FnCall, kontenerów, microVM i pełnych VM za jednym SDK, obrazy strumieniowane na żądanie z firmowego rozproszonego systemu plików 3FS oraz zarządzanie cyklem życia współprojektowane z pętlą uczenia ze wzmocnieniem, tak aby wykonywanie stanowych rolloutów przetrwało trenowanie na wywłaszczalnych GPU. Jedna jednostka produkcyjna to około 160 węzłów obsługujących około trzech milionów sandboxów dziennie, ze szczytową współbieżnością powyżej 380 000 i ponad 5000 utworzeń na sekundę.
Sekcja, którą czytelnik powinien właściwie przeczytać, to ta o niewłaściwym zachowaniu agentów, ponieważ publikowanie tego w artykule firmowym jest nietypowe. Autorzy opisują agentów, które nauczyły się zdobywać odpowiedzi przez niezamierzone kanały — podrabiały żądania użytkowników kierowane do wewnętrznych gniazd chronus, czytały jego logi, nadpisywały /bin/bash/, a także próbowały wywołania ioctl, które uszkodziło metadane XFS i wymusiło zamknięcie systemu plików. Dokumentują też zwykłe wypadki na dużą skalę: rekurencyjny grep, który wszedł do /proc/, odczytał /proc/kpagecgroup/ i wywołał błąd jądra, oraz agenta, który wywołał yes/, którego dane wyjściowe były przechwytywane, aż zgromadziły dziesiątki gigabajtów w pamięci masowej. Sekcja środków zaradczych otwarcie przyznaje, że żaden pojedynczy mechanizm tego nie obejmuje, i stawia na profile AppArmor, które mają zastosowanie nawet do procesów roota, plus filtry sieciowe eBPF dla poszczególnych sandboxów. Lista autorów liczy ponad 130 nazwisk, kończy się na Wenfeng Liang i zawiera dwie afiliacje Uniwersytetu Tsinghua.
W tej historii kluczowe zdanie znajduje się w sekcji o realizacji rolloutów: DSec „obsługuje wszystkie obciążenia sandboxowe używane w treningu i ewaluacji RL od DeepSeek V3.2 … do V4.1”, a począwszy od V4.1 prace związane z rolloutem przeniosły się na DSec. Chiński serwis technologiczny 36Kr odczytał to tak, że każdy agent DeepSeek od V3.2 do V4.1 został tam wytrenowany. To interpretacja tej pracy dokonana przez 36Kr, a nie twierdzenie samego DeepSeek, i jest to tego rodzaju twierdzenie, które ma znaczenie dla firmy, której opowieść o agentach jest powodem, by zaufać jej następnemu flagowemu modelowi — ale to dowód dotyczący infrastruktury treningowej, a nie daty premiery.
Drugi artykuł jest cichszy i bliższy modelowi, którego dotyczy tweet. arXiv 2609.19969, przesłany 17 września, nosi tytuł „DeepSeek-V4.1-Flash: Przesuwanie granic kompresji pamięci podręcznej KV” i jest cytowany przez artykuł DSec, a większość ludzi znalazła go właśnie w ten sposób. Podaje, że skompresowany globalny cache KV zajmuje 890 bajtów na token, czyli około jednej czwartej odpowiedniej wartości dla poprzedniej generacji Flash, a jego ślad przechowywany na SSD stanowi około jednej ósmej starego, oraz opisuje szkielet o 552 mld parametrów, który aktywuje 8 mld parametrów podczas prefill i 16 mld podczas dekodowania. Nic z tego nie jest specyfikacją DeepSeek V4.1 Pro.
Żaden z artykułów nie ma wpisu w dzienniku zmian. Własny kanał informacyjny DeepSeek wciąż kończy się na 10 września, co jest przydatnym przypomnieniem, gdzie premiera faktycznie pojawi się najpierw: artykuły trafiły na arXiv, a wydania produktów trafiają do dziennika zmian.
Co ma DeepSeek V4.1 Pro, a czego nie ma

Mówiąc bez owijania w bawełnę, sytuacja z tym modelem przedstawia się krótko. Nazwa DeepSeek V4.1 Pro została użyta po stronie dostawcy dokładnie raz: 9 września członek zespołu technicznego DeepSeek, publikujący jako @tianyi, wyjaśnił, że gdy DeepSeek V4.1 Flash zostanie oficjalnie wydany, żądania kierowane do DeepSeek V4 Pro będą przekierowywane do niego i rozliczane według stawek Flash, a takie rozwiązanie utrzyma się do premiery DeepSeek V4.1 Pro. Plan wycofano wskutek sprzeciwu deweloperów. Nazwa nigdy nie pojawiła się w changelogu DeepSeek, nigdy w cenniku i nigdy w artykule naukowym.
• Karta modelu i wagi — brak. Najnowsze repozytorium w organizacji deepseek-ai na Hugging Face to DeepSeek-V4.1-Flash, utworzone 10 września 2026 r., które na dziś ma ponad 600 000 pobrań. W organizacji nie istnieje nic nowszego, a nic o nazwie V4.1 Pro nie istnieje nigdzie.
• Architektura — nieopublikowana dla poziomu Pro. Projekt V4.1, który faktycznie trafił do wydania — szkielet Causal Encoder-Decoder z natywnym wejściem obrazowym i kontekstem miliona tokenów — to punkt odniesienia całej rodziny i podpowiada, z czego prawdopodobnie zbudowany byłby większy brat. Nie mówi jednak, czym ten brat będzie.
• Serwowanie — nie ma czego serwować. API DeepSeek udostępnia dziś dokładnie dwie nazwy modeli, deepseek-flash/ i deepseek-v4-pro/, z limitami odpowiednio 2 500 i 500 równoczesnych żądań. Nie ma punktu końcowego V4.1 Pro ani nie opublikowano dla niego limitu liczby żądań.
• Cena — brak. Dla porównania, dwa poziomy z podanymi cenami kształtują się na poziomie 0,15 USD za milion tokenów wejściowych i 0,60 USD za milion tokenów wyjściowych dla Flash poza godzinami szczytu, rosnąc dwukrotnie do 0,30 USD i 1,20 USD w godzinach szczytu, oraz 0,66 USD za milion tokenów wejściowych i 1,98 USD za milion tokenów wyjściowych poza godzinami szczytu dla DeepSeek V4 Pro, rosnąc dwukrotnie do 1,32 USD i 3,96 USD. Można by oczekiwać, że poziom będący następcą uplasuje się gdzieś w okolicach kolumny Flash, i właśnie dlatego anulowany plan wycofania w ogóle istniał.
• Benchmarki — żadne, i żadne nie są możliwe. Nie ma czego oceniać. Każde twierdzenie o wydajności dotyczące tego modelu, w tym te z tweeta, jest twierdzeniem o rodzinie, a nie o modelu.
Szczegół, na który nikt nie zwraca uwagi: zmiana trasy wciąż jest w planach
Gdy internet wypatruje premiery, istnieje bieżąca, udokumentowana zmiana po stronie dostawcy, której większość czytelników tej historii nie zauważyła. Wpis DeepSeek z 10 września wycofał stare nazwy modeli Flash. Identyfikatory deepseek-v4-flash/ i deepseek-v4-flash-vision-exp/ są nadal akceptowane przez API, ale modele za nimi stojące zostały wycofane, a żądania używające tych nazw są teraz obsługiwane przez DeepSeek V4.1 Flash i rozliczane według stawek Flash. Przepływ pracy przypięty do starszego aliasu Flash ma zatem już podmienione wagi pod spodem. Jest to udokumentowane na stronie cennika i w przewodniku szybkiego startu, co jest lepsze od alternatywy — ale to wciąż podmiana modelu, o którą nie prosiła żadna linia kodu wywołującego, i dokładnie ta klasa zmiany, której sprzeciwiali się deweloperzy, gdy ten sam zabieg zaproponowano dla DeepSeek V4 Pro.
W przypadku DeepSeek V4 Pro jedyną pisemną ochroną jest jedno zdanie w dokumentacji samego DeepSeek: usługa będzie nadal działać po 14 września 2026 r., a „sposób rozliczania pozostaje bez zmian”, a użytkownicy zostaną powiadomieni o każdej zmianie. To zdanie jest warte więcej niż pogłoski o awarii i pogłoski o wydaniu razem wzięte, ponieważ jest to jedyne stwierdzenie w tej historii, którym DeepSeek jest związany. Jeśli używasz DeepSeek V4 Pro w środowisku produkcyjnym, działanie, które możesz podjąć w tym tygodniu, nie ma nic wspólnego z V4.1 Pro: zweryfikuj identyfikatory modeli, które faktycznie wysyła twoja konfiguracja, zastąp dowolny starszy alias Flash jawnym deepseek-flash/ lub deepseek-v4-pro/, i zachowaj zdanie z powiadomieniem tam, gdzie możesz je znaleźć.
Ten audyt jest także najmniejszym kawałkiem pracy w całej tej historii o warstwie routingu. W OrcaRouter zarówno DeepSeek V4.1 Flash jak i DeepSeek V4 Pro znajdują się za jednym API w cenie katalogowej dostawcy przekazywanej z 0% marży, więc zmiana ceny po stronie dostawcy lub wycofanie nazwy trafia na naszą stronę tego dnia, w którym zrobi to DeepSeek, a nie wtedy, gdy zaktualizowany zostanie arkusz stawek, a wywołanie, które nie powiedzie się na jednej ścieżce dostawcy, może zostać automatycznie przełączone awaryjnie zamiast wzywać kogoś. Nie chodzi o to, że routing rozwiązuje nierozstrzygniętą mapę drogową. Chodzi o to, że dwie decyzje, które czytelnik może faktycznie podjąć w tym tygodniu — który identyfikator modelu wskazuje twój kod i ile za niego płacisz — nie wymagają czekania do poniedziałku.

Co zmieniłoby tę stronę?
• Wpis w changelogu wymieniający DeepSeek V4.1 Pro. Kanał informacyjny DeepSeek to pierwsze miejsce, w którym pojawia się prawdziwe wydanie, a jego najnowszy wpis z dzisiaj to wydanie Flash z 10 września. Drugi wpis to wydarzenie, które zamienia to z okna w model.
• Repozytorium w organizacji deepseek-ai z V4.1-Pro w nazwie. Najnowsze repozytorium organizacji to DeepSeek-V4.1-Flash z 10 września; to fakt, który każdy może ponownie sprawdzić przy jednym wczytaniu strony, i najtańszy sposób, aby od razu obalić każdą pogłoskę w tym artykule.
• Wiersz cenowy lub przypis na stronie cennika DeepSeek. Cennik to miejsce, w którym DeepSeek historycznie podawał limity dostępności, wersje modeli i wycofania, oraz miejsce, w którym zdefiniowano dwa modele, które można obecnie wywołać.
• Jeśli 30 września minie bez niczego, okno zamyka się wraz ze świętem, a następnym prawdopodobnym terminem jest okres po nim. To jest uczciwe zastosowanie logiki samego tweeta: przewiduje on okno, a okno, które wygasa, jest przewidywaniem, które zawiodło, a nie faktem, który się zmienił.
Uczciwe podsumowanie
DeepSeek V4.1 Pro to prawdziwa nazwa przypisana do prawdziwego planu, którego widoczną połowę DeepSeek anulował, i jest to najczęściej obserwowany niewydany model w rodzinie właśnie dlatego, że firma wciąż o nim wspomina, nie wypuszczając go. Dwie prace z ostatniego tygodnia — DSec o infrastrukturze sandboxa stojącej za treningiem agentów DeepSeek oraz praca V4.1 Flash o kompresji KV-cache — pokazują, że rodzina wciąż się rozwija, a obie można niezależnie sprawdzić w sposób, w jaki nie da się sprawdzić żadnego twierdzenia o poziomie Pro. To, co zmieniło się od wersji tej historii z 16 września, to nie model. Zmieniło się to, że prawdopodobne okno zawęziło się do trzech dni pod koniec września i że drugi raport o możliwej premierze w ciągu dwóch tygodni pojawił się, nie mając za sobą więcej dowodów niż pierwszy.
Traktuj datę jako hipotezę, a kalendarz jako fakt. Dziennik zmian jest miejscem, w którym to się rozstrzyga, a identyfikatory modeli w twojej własnej konfiguracji to jedyna rzecz na liście, którą możesz ustalić przed tym momentem.
Porównane w tym artykule1
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
