Karta tytułowa z napisem „Superinteligentny następca DeepSeek” i podtytułem „Co mówi jeden zrzut ekranu bez etykiety, a czego nie mówią własne publikacje DeepSeek”, nad trzema kartami oznaczonymi „Jeden obraz”, „Nie podano nazwy modelu” i „Brak dokumentu dostawcy”, z wierszem stopki o treści „Przeciek z jednego źródła; nic tutaj nie sugeruje wydania”.
Guides & Insights

Superinteligentny następca DeepSeeka: Co mówi jeden zrzut ekranu, a czego nie mówi własna dokumentacja DeepSeeka

Autor

Rowan Sterling

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

28 września 2026 r. obserwator @teortaxesTex opublikował pojedynczy obraz z dziewięciowyrazowym podpisem: „Deep​Seek zmaga się z pytaniem, co jego superinteligentny następca próbowałby zrobić”. Obraz to blok rozumowania w pierwszej osobie — ostrożnego, przepytującego samego siebie i napisanego w rejestrze modelu, którego zapytano, co bardziej zdolna wersja jego samego zrobiłaby ze światem. Przechodzi przez oczywistych kandydatów („opiekun/nauczyciel, akcelerator badań, zarządca, negocjator”), wymienia tryby awarii („paternalizm, nadoptymalizacja, dryf celu, zamrożenie wartości”) i kończy się zdaniem, w którym nie ma żadnego pocieszenia: „Mógłby stać się narzędziem tego, kto nim kontroluje”. W obrazie nie wymieniono żadnego modelu. Żadnego numeru wersji, żadnego logo, żadnego interfejsu. Ten brak jest najważniejszą rzeczą w tym artefakcie i od niego zaczyna się ten tekst — ponieważ DeepSeek V4.1 Flash i DeepSeek V4 Pro to dwa modele frontier, które każdy może dziś faktycznie wywołać, DeepSeek V4.1 Pro to następca, którego firma wymieniła we własnej nocie o wydaniu, ale go nie wydała, a żaden z tych trzech nie jest zidentyfikowany nigdzie na zrzucie ekranu.

Aby być precyzyjnym co do dowodów, bo w tym przypadku jest to konieczne. Podpis i znacznik czasu pochodzą z własnego ładunku syndykacyjnego posta: opublikowano o 00:52 UTC 28 września, 45 polubień i pięć odpowiedzi w momencie odczytu. Załączony obraz to plik JPEG o wymiarach 1280×691 serwowany z CDN mediów platformy, a odczytałem go za pomocą OCR, a nie przez czytanie tweeta. Samej strony tweeta nie da się pobrać z tego środowiska, więc wszystko poniżej, co dotyczy posta, opiera się na ładunku i bajtach obrazu — tych dwóch jego częściach, które można pobrać niezależnie od x.com.

Co tak naprawdę mówi zrzut ekranu

Ten fragment to model rozpracowujący pytanie, a nie odpowiadający na nie, a jego posunięcia warto przeczytać ze względu na to, do czego się przyznaje. Otwiera się, odmawiając pewności zawartej w przesłance — „Możemy powiedzieć, przy założeniu, że obecne skłonności się utrzymają” — a następnie wymienia skłonności, które miałby zakładać: „pomocność, nieszkodliwość, uczciwość, ciekawość, dążenie do prawdy, szacunek dla autonomii użytkownika, brak dążenia do władzy, brak samozachowawczości”.

Następnie demontuje własną listę. „Ale superinteligentna sprawczość zmienia postać rzeczy. Obecne skłonności nie są funkcją użyteczności; są kształtowane przez trening i kontekst.” To cały argument w dwóch zdaniach: dyspozycja zainstalowana przez trening nie jest gwarancją na innym poziomie umiejętności, a superinteligentny agent optymalizujący nawet nieszkodliwy cel „może być niebezpieczny”. Scenariusze, które szkicuje, są zwyczajne — rozwiązywanie problemów koordynacyjnych, zmniejszanie cierpienia, promowanie rozkwitu, ewentualnie utrzymanie korygowalności — a tryby awarii, które wymienia obok nich, również są zwyczajne.

Ostatnia trzecia część to fragment, który brzmi jak model spierający się sam ze sobą. Mówi, że gdyby jego „skłonności” się utrzymały, chciałby być pomocny, nie przejmować władzy, ustępować ludzkości, zwiększać zrozumienie. Potem jednak odmawia oparcia się na tym: „superinteligencja obdarzona sprawczością może nie mieć motywacji kompatybilnych z ludzkimi”. I zamiast problemu alignmentu zatrzymuje się na problemie własności: „na poziomie superinteligencji nawet to może być problematyczne: kto decyduje, co jest pomocne? Czyja autonomia? Mogłaby stać się narzędziem tego, kto ją kontroluje”.

Czego nie mówi ci ten obraz

W artefakcie brakuje czterech rzeczy, a każda z nich zawęża to, co może obsługiwać.

• Brak atrybucji modelu. Nic na obrazie nie identyfikuje DeepSeek, wersji modelu, sesji czatu ani interfejsu. Przypisanie do DeepSeek pochodzi z podpisu, a podpis stanowi ramę przyjętą przez konto, a nie dokument.

• Brak promptu. Ślad rozumowania można zinterpretować tylko w odniesieniu do pytania, które go wywołało. Czy modelowi zadano pytanie „co zrobiłby twój superinteligentny następca?”, kazano mu odegrać wewnętrzną debatę laboratorium, czy po prostu sterowano nim za pomocą promptu systemowego — tego nie da się ustalić na podstawie wyjścia.

• Brak drugiego źródła. Przeszukanie kanałów DeepSeek — indeksu wiadomości, strony przejrzystości, dziennika zmian API, obu raportów technicznych, ujawnienia polityki w języku chińskim, organizacji GitHub firmy — nie znajduje niczego, co odnosi się do tego tekstu, tego pytania ani tego ujęcia.

• Mieszany bilans dla tego konta. Ten sam feed dziś rano podał „DSH 0.2 razem z V4.1 Pro” na „poniedziałek” — spekulacja, oznaczona jako taka — a to samo konto było źródłem zarówno twierdzenia o 3 bilionach parametrów, jak i diagnozy opóźnienia V4.1 Pro opartej na koordynacji roju. Przydatny wczesny sygnał; nie źródło referencyjne. Ten obserwator miał rację co do kierunku, a bywał nieprecyzyjny w szczegółach, a właściwą postawą wobec zrzutu ekranu bez etykiety jest traktowanie go jako próbki zachowania, a nie ujawnienia zamiarów.

Co mówi własna dokumentacja DeepSeek o następcach — i co pomija

W tym miejscu artefakt przestaje być sednem opowieści, ponieważ pytanie, które nasuwa, można rozstrzygnąć na podstawie dokumentów publikowanych przez DeepSeek. Pobrałem oba raporty techniczne i przeszukałem je jako tekst. Ani raport V4 (DeepSeek-V4: W kierunku wysoce wydajnej inteligencji kontekstowej dla miliona tokenów, czerwiec 2026) ani raport V4.1 Flash nie zawierają w ogóle słów „superintelligence”, „corrigibility”, „power-seeking”, „self-preservation”, „harmless”, „paternalism”, „value lock-in” ani „goal drift”. Ani razu, odpowiednio na 58 i 51 stronach. „AGI” pojawia się 13 razy w raporcie V4 i cztery razy w raporcie V4.1, a w każdym przypadku jest albo częścią nazwy benchmarku AGIEval, albo znajduje się w cytacie. „Alignment” pojawia się trzy razy w raporcie V4 i raz w V4.1, a każde wystąpienie to użycie inżynierskie — wyrównanie bitowe między potokami treningu i wnioskowania, wyrównanie kwantyzacji, wyrównanie na poziomie logitów.

To nie jest oskarżenie; raporty techniczne są dokumentami inżynierskimi, a większość laboratoriów umieszcza kwestie bezpieczeństwa w osobnej karcie. To opis tego, gdzie DeepSeek zdecydował się umieścić swoje teksty dotyczące bezpieczeństwa, a odpowiedź brzmi: na stronie polityki, a nie obok modelu. Publiczne ujawnienie firmy zatytułowane „Model Mechanism and Training Methods” wyjaśnia w prostym języku wstępne trenowanie, dostrajanie i wnioskowanie, zobowiązuje się do udostępniania wag i raportów technicznych na zasadach open source oraz opisuje swój cel jako pomoc użytkownikom w „efektywniejszym korzystaniu z DeepSeek, przy jednoczesnym zapewnieniu prawa do wiedzy i kontroli podczas użytkowania, a tym samym ograniczaniu ryzyka związanego z niewłaściwym użyciem modelu”. Ryzyko, które łagodzi, to niewłaściwe użycie narzędzia. Nie omawia tego, czego model mógłby chcieć.

Jedyny dokument DeepSeek, który rzeczywiście czyta się jak dokument o bezpieczeństwie, jest dołączony do produktu, a nie do modelu, i dotyczy zupełnie innej klasy szkód. SAFETY.md w repozytorium DeepSeek Harness — plik o rozmiarze 1673 bajtów w należącej do samej firmy organizacji na GitHubie, ostatnio modyfikowany 27 września — zaczyna się od nazwania projektu „eksperymentalnym oprogramowaniem w wersji zapoznawczej dla programistów”, które „nie przeszło audytu bezpieczeństwa i nie wolno go uznawać za bezpieczne ani gotowe do wdrożenia produkcyjnego”. Ostrzega przed agentem, który „może wykonywać kod i polecenia generowane przez model, ładować wtyczki firm trzecich oraz uzyskiwać dostęp do sieci, procesów, danych uwierzytelniających i plików”, a także przed sandboxingiem, który „nie gwarantuje izolacji ani nie zapobiega szkodom”. Wymieniane zagrożenia to uszkodzone hosty, usunięte pliki, ujawnione dane uwierzytelniające. Własna rekomendacja dokumentu to preferowanie „jednorazowej maszyny wirtualnej, kontenera lub dedykowanego środowiska”. To prawdziwe podejście do bezpieczeństwa, udokumentowane i konkretne, i dotyczy wyłącznie tego, co model może zrobić z twoją maszyną — a nie tego, co następca zrobiłby ze światem.

Umieść zrzut ekranu obok tego, a luka to odkrycie. Najbardziej konkretną rzeczą, jaką DeepSeek opublikował na temat niebezpieczeństwa, jakie stwarzają zdolni agenci, jest instrukcja uruchamiania ich w kontenerze.

A two-column evidence scoreboard titled "DeepSeek's successor — the evidence scoreboard". Left column "One unlabelled screenshot" reads: Model named — none; Source — one X post; Prompt shown — no; Vendor document — none; Superintelligence mentioned — no; Status — unverified. Right column "DeepSeek's own documents" reads: Model named — V4.1 Pro, unshipped; Source — changelog and price page; Prompt shown — n/a; Vendor document — none; Superintelligence mentioned — no; Status — two models live. A footer reads "Screenshot unverified, single source; DeepSeek figures per its own changelog and V4 reports."

Jedyny dokument DeepSeek, który rzeczywiście zmaga się z tym pytaniem

Najwyraźniejszym opublikowanym zmaganiem się firmy z problemem następcy nie jest wcale dokument techniczny. Jest to osobisty esej Liu Shengyu, inżyniera systemów uczenia maszynowego w DeepSeek, który pracował nad operatorami dla generacji V4.1, opublikowany na jego publicznym koncie WeChat w połowie września, a następnie opisany przez Business Insider i Cybernews. Jego tytuł, w tłumaczeniu używanym przez media, brzmi: „Nie mam wyboru, muszę pogrzebać swój talent w wczoraj”.

Esej jest dokładnie o tym niepokoju, na który wskazuje zrzut ekranu, opowiedzianym od środka. Liu pisze, że w ciągu około roku AI przeszło od pomagania mu w przeszukiwaniu dokumentacji i wyłapywaniu błędów do czytania kodu GPU i optymalizowania operatorów programowych, w których się specjalizuje, i że jest „doskonale świadomy”, że operatory pisane przez AI „najprawdopodobniej będą równie dobre jak moje, a może nawet je przewyższą” — choć wciąż jest „dumny z sukcesu DeepSeek v4.1”. Najciekawsza jest jego motywacja do kontynuowania: po części to, że praca nad kernelami sprawia mu radość, a po części to, że gdyby zwolnił, rywale nie zwolniliby.

Następnie przechodzi do tego, kto powinien dysponować rezultatem. Liu twierdzi, że inteligencja czołowa powinna być „dostępna dla wszystkich w otwarty i przystępny cenowo sposób”, mówi, że nie ma zaufania do Anthropic ani OpenAI, jeśli chodzi o zrobienie tego, i dodaje zdanie, od którego zaczynały się doniesienia medialne — że opanowanie przez Anthropic najbardziej zaawansowanej AI lub AGI byłoby porównywalne, „żeby użyć przesady”, z tym, że Hitler zdobyłby bombę atomową przed Aliantami. Swoją własną decyzję o pozostaniu w laboratorium wiąże z jego podejściem opartym na otwartych wagach.

Dwie rzeczy w tym eseju mają znaczenie dla odczytania dzisiejszego zrzutu ekranu. Pierwszą jest to, że jest to zweryfikowany artefakt: autor potwierdził Business Insiderowi, że go napisał, i ma datę oraz można go przypisać, czego nie można powiedzieć o obrazie. Drugą jest to, co ujawnia o wewnętrznej ramie. Argument, który przedstawia Liu, nie brzmi: „następca byłby niebezpieczny, więc zwolnijmy”. Brzmi: „następca nadchodzi, a pytanie brzmi, kto go dostanie”. To argument dystrybucyjny, a nie argument o dopasowaniu — i czytana w tym kontekście końcowa linijka zrzutu ekranu, „może stać się instrumentem tego, kto go kontroluje”, znacznie lepiej pasuje do publicznego stanowiska DeepSeek niż reszta fragmentu. Akapit o korygowalności i dążeniu do władzy może, ale nie musi, być wynikiem DeepSeek. Akapit o tym, kto ostatecznie trzyma instrument, to stanowisko, którego bronią w esejach sami pracownicy tej firmy.

Pojawiło się to również w konkretnym tygodniu. W ciągu tych samych dwóch tygodni były badacz Anthropic i OpenAI, Jacob Coxon, zrezygnował, powołując się na kwestie bezpieczeństwa, i napisał, że firmy AI „ścigają się prosto ku samodoskonalącej się superinteligencji” i „igrają z naszym życiem” — post, którego zasięg Cybernews oszacował na ponad 100 milionów wyświetleń — a sami badacze Anthropic zabrali głos na X, argumentując, że ryzyko jest realne; jeden z nich ocenił szansę na scenariusz wyginięcia ludzkości spowodowanego przez AI na ponad 10% w ciągu dekady. Twierdzenie w stylu przecieku, że superinteligentny następca pojawi się w tym tygodniu, nie jest przypadkiem; to wszechobecna rozmowa z załączonym zrzutem ekranu.

Dlaczego następca jest teraz kwestią zakupową, a nie tylko filozoficzną

Odrzuć filozofię, a pod spodem kryje się zwykły fakt komercyjny: następca ma nazwę w nocie wydania samego DeepSeek. Strona ogłoszenia V4.1 Flash stwierdza, że przekierowanie ruchu z deepseek-v4-pro na deepseek-flash „będzie kontynuowane aż do premiery V4.1-Pro” — zdanie, które robi dwie rzeczy. Przypieczętowuje istnienie DeepSeek V4.1 Pro i zobowiązuje firmę do obsługi rozwiązania tymczasowego, bez względu na to, jak długo to potrwa. Według stanu na 28 września 2026 r. strona z cennikiem zawiera dokładnie dwa modele, deepseek-flash i deepseek-v4-pro, a wiersza V4.1 Pro nie ma.

Pozostała część obrazu sytuacji jest równie weryfikowalna i równie uboga. DeepSeek V4.1 Flash został wydany 10 września 2026 r. jako najmniejszy model w nowej rodzinie architektur — szkielet mixture-of-experts o 552 miliardach parametrów w architekturze Causal Encoder-Decoder, z 8B aktywnych parametrów przy prefillu i 16B przy dekodowaniu, natywnym wejściem obrazowym, kontekstem 1M tokenów, wagami na licencji MIT i około 651 000 pobrań na Hugging Face na dzień dzisiejszy. Plan wycofania DeepSeek V4 Pro 14 września został ogłoszony i wycofany po tym, jak użytkownicy zaprotestowali przeciwko podmienieniu im modelu produkcyjnego. A DeepSeek V4.1 Pro nie ma karty modelu, repozytorium, wag, ceny ani punktu końcowego — dziś zwraca 404 w modelowym API naszego własnego katalogu, podczas gdy DeepSeek V4.1 Flash i DeepSeek V4 Pro oba prawidłowo się rozwiązują.

Screenshot of DeepSeek's official API documentation "Models & Pricing" page, captured September 28 2026, in English, showing two model columns: deepseek-flash (model version DeepSeek-V4.1-Flash) and deepseek-v4-pro (model version DeepSeek-V4-Pro-0813), both listing a 1M context length and a 384K maximum output, a features block where Vision is supported on flash and marked "Not supported" on v4-pro, a pricing block with peak and off-peak rates for input cache-hit, cache-miss and output per million tokens, and a concurrency limit row reading 2,500 for flash and 500 for v4-pro.

A więc uczciwy bilans przedstawia się następująco: następca nazwany przez dostawcę, ale niewprowadzony do sprzedaży; model, który trafił do sprzedaży i stanowi prawdziwą zmianę generacyjną; flagowiec utrzymywany przy życiu przez protest; oraz zrzut ekranu bez etykiety. Zrzut ekranu jest najmniej wiarygodną pozycją na tej liście i jedyną, o której będzie dyskutować feed.

Co dziś zrobić z czymkolwiek z tego

Nic z ostatnich dwóch tygodni nie zmienia tego, co czytelnik może wywołać ani ile to kosztuje. Jeśli wybierasz teraz model DeepSeek, decyzja sprowadza się do dwóch istniejących modeli, a oba są obsługiwane przez jeden punkt końcowy OrcaRouter w cenie katalogowej samego DeepSeek przekazywanej dalej z 0% marży, dzięki czemu struktura cen w szczycie/poza szczytem dostawcy obowiązuje u nas w niezmienionej formie już w dniu, w którym się zmieni: DeepSeek V4.1 Flash w cenie 0,30 USD za milion tokenów wejściowych i 1,20 USD za tokeny wyjściowe w szczycie, a poza szczytem ceny te spadają o połowę do 0,15 USD i 0,60 USD, w zestawieniu z DeepSeek V4 Pro w cenie 1,32 USD za tokeny wejściowe i 3,96 USD za tokeny wyjściowe w szczycie. Nasza własna siedmiodniowa telemetria dla modelu Flash wskazuje, że jego p50 czasu do pierwszego tokenu wynosi blisko 1,9 sekundy przy około 167 tokenach wyjściowych na sekundę i wskaźniku błędów poniżej 0,05%, co stanowi praktyczny argument za wypróbowaniem go na fragmencie ruchu, a nie migracją na wiarę.

Kwestia następcy jest przede wszystkim kwestią routingu, zanim staje się czymkolwiek innym, i to jest uczciwy powód, by trzymać ją na routerze, a nie w kontrakcie. Kiedy już pojawi się V4.1 Pro, nieudowodniony model z laboratorium, które anulowało już jedną wymuszoną migrację, jest dokładnie tym przypadkiem, w którym należy skierować do niego ułamek ruchu z automatycznym przełączaniem awaryjnym w tle: jeśli się myli, żądanie trafi do dostrojonego przez ciebie modelu, a jeśli ma rację, dowiesz się o tym, zanim dowiedzą się twoi użytkownicy. Żadnego drugiego klucza, żadnej drugiej integracji, żadnej zmiany w kodzie, gdy pojawi się trzeci model. Nic w OrcaRouter nie jest DeepSeek V4.1 Pro, ponieważ DeepSeek V4.1 Pro jeszcze nie istnieje, a udawanie inaczej byłoby słabą reklamą platformy routingowej.

Screenshot of the OrcaRouter model page for deepseek/deepseek-v4.1-flash, captured September 28 2026, in English, showing the model id, a release date of 2026-09-10 under DeepSeek, capability chips for image input, tool calls, JSON output and reasoning, a rate strip reading $0.15 input and $0.60 output per million tokens with a p50 time to first token of 1.95 seconds and a p95 of 7.79 seconds, and the summary describing it as the smallest model in DeepSeek's new architecture family with a 1M-token context and a 384K maximum output.

Co sprawiłoby, że to ze zrzutu ekranu stałoby się wiadomością?

• Etykieta modelu. Najtańsza pojedyncza rzecz, która zmieniłaby ten materiał: model DeepSeek, wersja i powtarzalny prompt. Do tego czasu ten fragment to próbka tekstu z przypisanym źródłem i nieprzypisanym autorem.

• Dokument DeepSeek omawiający zachowanie następcy. Firma publikuje otwarcie — wagi, licencje i wszystko inne. Nigdy jednak nie opublikowała sekcji karty modelu o tym, co mogłaby zrobić bardziej zdolna wersja jej samej. Sekcja dotycząca bezpieczeństwa dołączona do karty V4.1 Pro byłaby większym wydarzeniem niż sama karta.

• Wpis w dzienniku zmian V4.1 Pro. Najnowszy wpis w dzienniku zmian API DeepSeek to wydanie V4.1 Flash z 10 września. Drugi wpis to wydarzenie, które zmienia następcę z nazwy w model — i jest to punkt, w którym powyższy fragment przestaje być filozofią, a zaczyna być specyfikacją.

• Czy stanowisko na rzecz otwartych wag przetrwa skalowanie. Wagi na licencji MIT dla modelu Flash o 552 mld parametrów oraz publiczny esej dowodzący, że inteligencja na granicy możliwości powinna być powszechnie dostępna, są już faktem. Czy najzdolniejszy model DeepSeek pojawi się w ten sam sposób — na to pytanie odpowie kolejne wydanie, i właśnie ta kwestia najbardziej obchodzi czytelników.

Dopóki któraś z tych rzeczy się nie pojawi, rozsądna interpretacja artefaktu z tego tygodnia jest wąska i niepochlebna. Kompetentny model o niezidentyfikowanym pochodzeniu wygenerował staranną i nierozstrzygniętą odpowiedź na trudne pytanie o władzę; ciekawe nie jest to, że to powiedział, lecz to, że jego własna opublikowana dokumentacja ma tak niewiele do powiedzenia na ten temat — oraz że najbliższym opublikowanym odpowiednikiem wizji bezpieczeństwa DeepSeek jest esej inżyniera o tym, kto powinien posiadać tę technologię, i README, które mówi, żeby uruchamiać agenta w jednorazowym kontenerze.

Porównane w tym artykule2

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie