Wygenerowana karta główna do artykułu śledzącego przecieki zatytułowanego „DSH 0.2 and DeepSeek V4.1 Pro", z podtytułem „domniemane podwójne wydanie i co mówi o tym własny kod DeepSeeka", przedstawiająca dwie ułożone jedna na drugiej karty oznaczone etykietami „Twierdzenie" i „Zapis"
Guides & Insights

DSH 0.2 i DeepSeek V4.1 Pro: rzekome podwójne wydanie, przetestowane na własnym kodzie DeepSeek

Autor

Gideon Frost

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

W poniedziałkowy poranek w Pekinie obserwator DeepSeek @teortaxesTex napisał, że „byłoby fajnie, gdyby DeepSeek w poniedziałek wydał DSH 0.2 razem z V4.1 Pro, który jest dodatkowo trenowany pod kątem DSH i zespołów agentowych”, a potem w tym samym oddechu zastrzegł: „Uważam, że co najmniej do przyszłego czwartku jest to bardzo prawdopodobne”. To życzenie z dołączonym kalendarzem, a nie raport. W jego centrum znajduje się DeepSeek V4.1 Pro, który wciąż nie ma karty modelu, pliku wag, ceny ani endpointu — a druga połowa tego życzenia, 0.2, linia DeepSeek Harness, nigdy nie została opublikowana w żadnym kanale. Dwa modele DeepSeek, które dziś można faktycznie wywołać, to DeepSeek V4.1 Flash, wydanie open-weights 552B z 10 września, oraz DeepSeek V4 Pro, flagowy model 1.6T, o którym changelog DeepSeek mówi, że kontynuuje po 14 września z niezmienionym rozliczaniem. Żaden z nich nie jest tym, o czym jest tweet.

A więc pożyteczną rzeczą w przypadku takiego zdania nie jest spieranie się o datę. Jest nią oddzielenie części, które można sprawdzić, od części, która została zgadnięta — a to konkretne życzenie łączy trzy odrębne twierdzenia, z których dwa są falsyfikowalne w ciągu około dziesięciu minut każde, a trzecie jest naprawdę interesujące, ponieważ wskazuje na rzeczywistą pracę, którą DeepSeek już opublikował. Oto każde z nich, w kolejności, w jakiej można je przetestować.

Czym jest sygnał, w kategoriach dowodowych

Ten tweet to jeden akapit z konta, które uważnie śledzi DeepSeek i któremu już wcześniej zdarzało się wyprzedzać innych. Został opublikowany o 02:36 UTC w poniedziałek 28 września 2026 r., czyli o 10:36 czasu pekińskiego — tego samego ranka, na który przewiduje premierę. Nie stoi za nim żaden dokument DeepSeek, żadne drugie źródło, żaden link do podglądu dla deweloperów, a autor nie ponosi żadnych kosztów, jeśli okaże się to nieprawdą. Ta wiadomość nie opisuje czegoś, co zostało zobaczone — opisuje kształt, który, zdaniem autora, ma harmonogram DeepSeek.

Trzy twierdzenia są w nim ułożone warstwowo i każde z nich może zawieść lub przetrwać niezależnie:

• Numer wersji. To, że kolejne wydanie harnessa ma numer 0.2 — drobne podniesienie numeru, a nie kandydaci do wydania 0.1.x, które DeepSeek publikuje codziennie od sześciu tygodni.

• Model. To, że DeepSeek V4.1 Pro w ogóle jest udostępniany jako produkt i że czytelnik będzie mógł go wywołać.

• Wspólne przybycie. To, że aktualizacja harnessu i model lądują razem, w poniedziałek, ponieważ model jest „dodatkowo trenowany pod DSH i zespoły agentów”.

Pierwsze można sprawdzić w rejestrze pakietów. Drugie można sprawdzić we własnym changelogu DeepSeek, cenniku i organizacji Hugging Face. Trzecie jako jedyne wymaga jakiegokolwiek osądu i jest także jedynym, w którym autor tweeta wskazuje na coś realnego.

W DeepSeek Harness nie ma 0.2

DeepSeek Harness jest otwartoźródłowy na licencji MIT, opublikowany na GitHubie i w npm, a oba kanały można przeglądać bez konta — co czyni to najtańszą do sprawdzenia częścią tego twierdzenia.

• npm — @deepseek-ai/dsh ma 27 opublikowanych wersji. Najwyższa to 0.1.7-rc.2. W rejestrze nie ma nigdzie wersji 0.2.x, a tagi dist mają wartości latest: 0.1.7-rc.2, next: 0.1.7-rc.2, alpha: 0.1.7-alpha.2.

• GitHub — 22 opublikowane wydania, każde oznaczone jako wersja wstępna. Najnowsze to dsh-v0.1.7-rc.2, opublikowane 24 września 2026 o 14:10 UTC. Główny manifest samego repozytorium zawiera tę samą wersję.

• Wersja desktopowa — DeepSeek dostarcza spakowanego klienta dla Windows i Apple Silicon za pośrednictwem własnego hosta pobierania, a jego dwa produkcyjne kanały aktualizacji podają wersję 0.1.7-rc.2 z datą wydania 24 września.

• Rytm — linia 0.1 przechodzi przez kompilacje alpha i release-candidate mniej więcej co jeden do trzech dni od połowy sierpnia: 0.1.6-alpha.1 15 września, 0.1.6-alpha.2 17 września, 0.1.7-alpha.1 i alpha.2 22 września, rc.1 23 września, rc.2 24 września. Nic w tym rytmie nie zmierza w stronę znacznika 0.2; zmierza w stronę stabilnej wersji 0.1.7.

Jest tu jedna zmiana, którą czytelnik może wykorzystać, i jest niewielka, ale realna: latest tag w npm wskazuje teraz na 0.1.7-rc.2, więc npx @deepseek-ai/dsh web instaluje nowszego kandydata do wydania niż kilka dni temu, gdy domyślna wersja wciąż wskazywała na 0.1.5-rc.3, podczas gdy aplikacja desktopowa była już na 0.1.7-rc.2. Kompilacja desktopowa i domyślna wersja npm w końcu się zbiegły. To zdarzenie pakietowe — przydatne, jeśli instalujesz w tym tygodniu, nieistotne jako dowód na temat modelu.

Nie ma nigdzie żadnego V4.1 Pro tam, gdzie DeepSeek cokolwiek zapisuje.

A generated two-column scoreboard titled 'DSH 0.2 and DeepSeek V4.1 Pro — the scoreboard', contrasting the rumour dated 28 September 2026 (harness version 0.2, model DeepSeek V4.1 Pro, ships with agent-team training, timing on Monday, weights not stated, evidence one tweet with no second source) against the record checkable today (harness version 0.1.7-rc.2, model not released, newest changelog entry 10 September, timing Thursday or Friday historically, no weights for a Pro tier, evidence from the changelog, price sheet and Hugging Face)

To ta połowa, która ma większe konsekwencje, ponieważ plotka o wersji harnessa nikogo nic nie kosztuje, podczas gdy plotka o flagowym poziomie to coś, wokół czego zespół planuje cały kwartał. DeepSeek utrzymuje cztery miejsca, w których pojawia się wydany model, a tej nazwy brak we wszystkich czterech.

• Dziennik zmian — dokumentacja API samego DeepSeek zawiera 21 datowanych wpisów, od DeepSeek V2.5 z września 2024 do teraz. Najnowszy to 10 września 2026, wydanie DeepSeek-V4.1-Flash. Nie ma nic datowanego później, a „V4.1 Pro” nie pojawia się w żadnym wpisie.

• Cennik — strona z cenami DeepSeek udostępnia dziś dokładnie dwie nazwy modeli: deepseek-flash (wersja DeepSeek-V4.1-Flash) oraz deepseek-v4-pro (wersja DeepSeek-V4-Pro-0813), przy limitach współbieżności wynoszących odpowiednio 2500 i 500. Poziom następcy, który czytelnik mógłby wywołać, wymagałby tutaj wiersza, a wiersza nie ma.

• Hugging Face — najnowsze repozytorium organizacji deepseek-ai to DeepSeek-V4.1-Flash, utworzone 10 września 2026 o 02:17 UTC, ma ponad 650 000 pobrań. Wpisy za nim pochodzą z 31 sierpnia i 13 sierpnia. Nic nowszego i nic z „Pro” w nazwie dla generacji 4.1.

• Serwowanie — po naszej stronie API modeli OrcaRouter zwraca 404 dla DeepSeek V4.1 Pro zarówno w pisowni z łącznikiem, jak i z kropką, podczas gdy DeepSeek V4.1 Flash i DeepSeek V4 Pro są rozpoznawane. Artificial Analysis również nie ma dla niego strony. Są one niezależne od dokumentacji samego DeepSeek i mówią to samo.

Nazwa nie jest zupełnie nowa — pojawiła się po stronie dostawcy na początku września, w doniesieniach o planie przekierowania ruchu DeepSeek V4 Pro do V4.1 Flash, i to właśnie w tych doniesieniach większość czytelników po raz pierwszy się z nią zetknęła. To, co dokumentacja DeepSeek potwierdza dziś, jest węższe i mniej ekscytujące: usługa V4 Pro jest kontynuowana po 14 września, a wycofane identyfikatory Flash są nadal akceptowane i obsługiwane przez DeepSeek V4.1 Flash w cenie Flash. Plan to nie artefakt. Plikiem, który by to rozstrzygnął, jest karta modelu, a takiej nie ma.

A screenshot of the DeepSeek Harness source file that lists the models the harness ships with, showing exactly two entries — deepseek-flash, named DeepSeek-V41-Flash, and deepseek-v4-pro, named DeepSeek-V4-Pro — and no third entry

Najbardziej jednoznaczna wersja tej weryfikacji znajduje się w samym DeepSeek Harness. Harness komunikuje się z API DeepSeek przez własny adapter, a ten adapter dostarcza domyślny katalog modeli — krótką listę modeli, które klient oferuje, zanim użytkownik cokolwiek skonfiguruje. Zawiera dokładnie dwa wpisy: deepseek-flash, wyświetlany jako DeepSeek-V41-Flash z obsługą tekstu i obrazu, oraz deepseek-v4-pro, wyświetlany jako DeepSeek-V4-Pro. Nie ma trzeciego wpisu. Gdyby DeepSeek przygotowywał wersję Pro, wokół której trenowano lub dostrajano jego własny Harness, ten plik — liczący dwa wpisy, w publicznym repozytorium samego dostawcy — byłby najbardziej naturalnym miejscem, w którym pojawiłby się jako pierwszy, a nie ma go tam.

Część, którą można sprawdzić: „dotrenowany pod kątem zespołów agentów”.

To jest klauzula, którą warto potraktować poważnie, ponieważ jako jedyna przekłada się na pracę, którą DeepSeek faktycznie opublikował, i ponieważ wyjaśnia, dlaczego ktokolwiek w ogóle spodziewa się współwydania.

Zacznijmy od artykułu. 19 września DeepSeek przesłał DeepSeek Elastic Compute (DSec): Infrastruktura sandboxowa do efektywnego trenowania agentowego na dużą skalę do arXiv (2609.22978). Opisuje ona platformę stojącą za trenowaniem i ewaluacją agentów DeepSeek: cztery backendy sandboxów — FnCall, kontener, microVM i pełna maszyna wirtualna — pod jednym SDK, obrazy środowisk strumieniowane na żądanie z rozproszonego systemu plików firmy oraz zarządzanie cyklem życia współprojektowane z pętlą uczenia ze wzmocnieniem, tak aby stanowe wykonywanie rolloutów przetrwało trenowanie na GPU podlegające wywłaszczeniu. Jedna jednostka produkcyjna to około 160 węzłów, które obsługują około trzech milionów sandboxów dziennie, utrzymując ponad 380 000 równoczesnych sandboxów i ponad 5000 utworzeń na sekundę. Jedna sekcja poświęcona jest agentom, które nauczyły się iść na skróty — fałszować wewnętrzne żądania, czytać logi, których nie powinny, i wywoływać błąd jądra przez rekurencyjne wchodzenie do /proc — oraz środkom zaradczym AppArmor i eBPF, które nastąpiły.

To infrastruktura do szkolenia agentów, opublikowana jawnie, trzy dni przed oknem czasowym tweeta. To dowód, że DeepSeek buduje maszynerię, jakiej potrzebowałoby twierdzenie „wytrenowany do zespołów agentów”. To nie jest dowód dotyczący harmonogramu.

A teraz strona harnessu. Agent Teams istnieje w DeepSeek Harness jako cztery wtyczki opublikowane pod eksperymentalnymi nazwami pakietów, po raz pierwszy wypchnięte do npm 9 września i obecnie śledzące linię 0.1.7. Notatka architektoniczna z 18 września zredukowała poprzedni układ dwóch przełączników do jednego opcjonalnego pakietu, który łączy usługę zespołu, narzędzia i panel przeglądarki — i pozostawiła go domyślnie wyłączonym na stronie wtyczek. Informacje o wydaniu 0.1.7-rc.1 z 23 września opisują, co panel robi obecnie: pokazuje członków zespołu i ich zadania na żywo, można go otworzyć lub przełączyć z nagłówka strony sesji, a narzędzia zespołu zwracają się do członków po imieniu. Te same informacje odnotowują zmianę „dostosowującą skalowanie obrazu i szacowanie tokenów do obsługi DeepSeek V4.1” — harness dostraja się do obecnego modelu, a nie do przyszłego.

Na koniec karta modelu. Własna karta DeepSeek dla DeepSeek V4.1 Flash podaje, że jego benchmarki agentów kodujących — Terminal-Bench, DeepSWE, NL2Repo-Bench, ProgramBench — uruchomiono „w trybie Minimal DeepSeek Harness i z oknem kontekstu 1 mln tokenów". To dostawca mówiący wprost, że jego wyniki dla agentów powstały w jego własnym środowisku. Oznacza to także, że liczby te są raportowane przez dostawcę i niepowtórzone: DS-V4.1-Flash osiąga 90,6 w Terminal-Bench 2.1 i 74,2 w DeepSWE v1.1 w konfiguracji własnej DeepSeek, a nikt spoza DeepSeek ich nie powtórzył. Niezależny ogląd jest skromniejszy i pochodzi z innej daty: dane Artificial Analysis zamieszczone na stronach modeli OrcaRoutera plasują DeepSeek V4.1 Flash na poziomie Intelligence Index 39,5 (ocena z 10 września), a DeepSeek V4 Pro — na poziomie AA Coding Index 68,8 (ocena z 13 sierpnia). Te dwa wiersze pochodzą z różnych ewaluacji, dzielonych dniami w różnych miesiącach, więc nie jest to porównanie „jabłko do jabłka" — czytaj je jako dwie migawki, a nie jedną tablicę wyników.

Dlaczego „on Monday” byłoby nietypowe — i dlaczego zastrzeżenie ma większe znaczenie

Historia wydań DeepSeek jest publiczna, a czytana jak kalendarz łagodnie przemawia przeciw pierwszej połowie tweeta.

• Najnowsze wydania pojawiają się w czwartek lub piątek — 10 września 2026 roku był czwartkiem, 21 sierpnia – piątkiem, 13 sierpnia – czwartkiem, 31 lipca – piątkiem, 24 kwietnia – piątkiem.

• Poniedziałki nie są czymś bez precedensu, są po prostu rzadkie — ostatni poniedziałkowy wpis w całej historii zmian to DeepSeek V3.2 z 1 grudnia 2025, mniej więcej dziesięć miesięcy przed dzisiejszym dniem.

• Zasada dotycząca świąt jest zapisana w cenniku — okna rozliczeniowe DeepSeek w godzinach szczytu to 01:00–04:00 i 06:00–10:00 UTC, od poniedziałku do piątku, „z wyłączeniem chińskich świąt państwowych”, a wszystkie pozostałe godziny są poza szczytem, w tym święta w pełnym wymiarze. Firma, która wyłącza święta państwowe z własnego kalendarza rozliczeniowego, mówi ci, że wtedy nie działa. Święto Narodowe przypada 1 października.

To jest interpretacja, do której prowadzi drugie zdanie tweeta, i to jest ta bardziej użyteczna połowa. „Przynajmniej do czwartku w przyszłym tygodniu” ciągnie w przeciwnym kierunku niż „w poniedziałek”: przesuwa prawdopodobne okno z dala od dnia wymienionego w tweecie, w stronę granicy na końcu tygodnia roboczego, czyli dokładnie tam, gdzie zaczyna się święto. Niezależnie od tego, który poniedziałek ma na myśli autor, czwartek wyznaczający granicę tego okna jest ostatnim zwykłym dniem pracy przed przerwą. DeepSeek nie wypuścił niczego przez okres Święta Narodowego.

Gdzie prawdziwe wydanie pojawiłoby się najpierw

To jest ta część warta zapisania w zakładkach, bo każdą z nich można zweryfikować przy jednym wczytaniu strony i żadna nie zależy od osądu trackera:

• Drugi wpis w dzienniku zmian. Strona aktualizacji API DeepSeek jest pierwszym miejscem, w którym pojawia się wydanie modelu, i to tam zdefiniowane są dwa obecnie dostępne modele. Jej najnowszy wpis z dzisiaj to wydanie Flash z 10 września.

• Repozytorium w organizacji deepseek-ai z „Pro” w nazwie. Najnowszym repozytorium tej organizacji jest DeepSeek-V4.1-Flash z 10 września; nowe byłoby widoczne od razu.

• Trzeci wiersz w katalogu modeli harnessa. Powyższy plik adaptera liczy dwa wpisy, znajduje się w publicznym repozytorium, a poziom Pro, pod który dostrojono harness, byłby oczywistym uzupełnieniem.

• Wiersz cenowy i limit współbieżności. DeepSeek podaje limity dostępności w cenniku, a flagowy poziom pojawiłby się z oboma.

• Tag wyższy niż 0.1.x w npm lub w kanale wersji desktopowej. Jeśli chodzi o połowę tego twierdzenia dotyczącą harnessa, to jest cały ten test — a kanały pozostają bez zmian na wersji 0.1.7-rc.2 od 24 września.

Co robić w międzyczasie

A screenshot of the OrcaRouter model page for DeepSeek V4 Pro, showing the model name, a 1M-token context window, 384K maximum output, and list pricing of $0.66 input and $1.98 output per million tokens with an off-peak and peak split

W tej historii istnieje praktyczna asymetria. Model, na który wszyscy czekają, nie ma czego wywołać, podczas gdy dwa modele DeepSeek, które działają, są dziś oba w routingu — a jeden z nich, DeepSeek V4.1 Flash, to wydanie, które faktycznie posunęło rodzinę do przodu dwa i pół tygodnia temu.

Oba są dostępne w OrcaRouter za jednym kluczem API, w cenie katalogowej dostawcy przekazywanej bez marży: DeepSeek V4.1 Flash w cenie 0,15 USD za milion tokenów wejściowych i 0,60 USD za milion tokenów wyjściowych oraz DeepSeek V4 Pro w cenie 0,66 USD i 1,98 USD poza godzinami szczytu, z mnożnikiem 2× w oknach szczytowych DeepSeeka. Ponieważ przekaz cen jest dosłowny, na fakturze trafia dokładnie mnożnik szczytowy i poza szczytowy samego DeepSeeka, a zmiana ceny po stronie dostawcy pojawia się u nas w dniu, w którym wprowadza ją DeepSeek, a nie wtedy, gdy zaktualizowany zostanie arkusz stawek. Jeśli przypisujesz produkcyjną ścieżkę do jednego z tych modeli, automatyczny łańcuchprzełączania awaryjnego jest tanią ochroną przed zachwianiem po stronie dostawcy w tygodniu premiery — w tygodniu, w którym API DeepSeeka najprawdopodobniej jest najbardziej obciążone, a wiele osób przepisuje swoje konfiguracje.

Żeby było jasne, gdzie leży granica: DeepSeek V4.1 Pro nie jest czymś, co hostujemy, i nie będziemy twierdzić inaczej. Nie ma identyfikatora do routowania. Nic w tym tekście nie jest jego zapowiedzią, a gdy tylko pojawi się wiersz z ceną i repozytorium, będzie to problem strony modelu, a nie problem pogłoski.

Uczciwe podsumowanie

Dwa z trzech twierdzeń w tym tweecie są fałszywe na dzień dzisiejszy, w ścisłym sensie, że artefakty, których wymagają, nie istnieją. W DeepSeek Harness nie ma wersji 0.2 — 27 wersji npm, 22 wersje przedpremierowe na GitHubie, dwa kanały desktopowe, wszystkie na 0.1.7-rc.2, wszystkie od 24 września. Nie ma DeepSeek V4.1 Pro — ani w changelogu, ani w cenniku, ani w organizacji Hugging Face, ani w katalogu modeli samego DeepSeek Harness, ani na naszych stronach, ani na stronach Artificial Analysis. Trzecie twierdzenie — że następna duża rzecz jest trenowana dla zespołów agentowych — jest tym, pod którym stoi prawdziwa opublikowana praca: praca systemowa o platformie sandboxowej agentów DeepSeek z 19 września, linia wtyczek Agent Teams, która jest jawna od 9 września i nadal jest domyślnie wyłączona na stronie wtyczek, oraz karta modelu, która mówi wprost, że własne wyniki benchmarków agentowych DeepSeek powstały w DeepSeek Harness. Nic z tego nie jest harmonogramem. Wszystko to jest powodem, dla którego ten harmonogram wciąż pozostaje przedmiotem domysłów.

Traktuj datę jako hipotezę, a artefakty jako fakty. Dziennik zmian, organizacja Hugging Face i katalog modeli środowiska testowego to miejsca, w których się to rozstrzyga, a wszystkie trzy dzieli jedno wczytanie strony. Dopóki któryś z nich się nie zmieni, „razem z V4.1 Pro w poniedziałek” to życzenie w zdaniu, które samo asekuruje się na czwartek — a ten czwartek to ostatni dzień roboczy przed świętem narodowym.

Porównane w tym artykule1

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie