
DeepSeeks superintelligenta efterträdare: Vad en skärmbild säger, och vad DeepSeeks egen dokumentation inte säger
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 301 tok/s
- openaiNYOpenAI: GPT-6 Luna2026-09-2237Intelligens
- openaiNYOpenAI: GPT-6 Sol2026-09-2248Intelligens
- anthropicNYAnthropic: Claude Opus 5.52026-09-2258Intelligens
- grokNYGrok 4.72026-09-2146Intelligens
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens · 195 tok/s
- orcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
Den 28 september 2026 publicerade bevakaren @teortaxesTex en enda bild med en bildtext på nio ord: "DeepSeek brottas med frågan om vad dess superintelligenta efterträdare skulle försöka göra." Bilden är ett block av jag-formulerat resonemang – förbehållsamt, självutfrågande och skrivet i det register som präglar en modell som har fått frågan vad en mer kapabel version av den själv skulle göra med världen. Den går igenom de uppenbara kandidaterna ("vårdare/lärare, forskningsaccelerator, förvaltare, förhandlare"), räknar upp fellägena ("paternalism, överoptimering, måldrift, värdeinlåsning") och avslutas med en rad som inte innehåller någon tröst: "Den skulle kunna bli ett instrument för den som kontrollerar den." Ingen modell namnges i bilden. Inget versionsnummer, ingen logotyp, inget gränssnitt. Den frånvaron är det viktigaste med artefakten, och det är där den här artikeln börjar – eftersom DeepSeek V4.1 Flash och DeepSeek V4 Pro är de två frontmodeller som vem som helst faktiskt kan anropa i dag, DeepSeek V4.1 Pro är den efterträdare som företaget har namngett i sin egen releasenot utan att släppa den, och ingen av de tre identifieras någonstans i skärmbilden.
För att vara exakt om bevisningen, eftersom den här behöver det. Bildtexten och tidsstämpeln kommer från inläggets egen syndikeringsnyttolast: publicerad 00:52 UTC den 28 september, 45 gillningar och fem svar vid lästillfället. Den bifogade bilden är en JPEG på 1 280×691 som serveras från plattformens media-CDN, och jag läste den via OCR i stället för att läsa tweeten. Själva tweetsidan går inte att hämta från den här miljön, så allt nedan som rör inlägget vilar på nyttolasten och bildens byte – de två delar av det som kan hämtas oberoende av x.com.
Vad skärmbilden faktiskt säger
Utdraget är en modell som arbetar med en fråga snarare än att besvara den, och de drag den gör är värda att läsa för vad de medger. Den inleder med att vägra premissens självsäkerhet – "Vi kan säga under antagandet att nuvarande benägenheter håller i sig" – och listar sedan de benägenheter den skulle utgå från: "hjälpsam, ofarlig, ärlig, nyfikenhet, sanningssökande, respekt för användarens autonomi, inget maktsträvande, ingen självbevarelse."
Sedan monterar den ned sin egen lista. "Men superintelligent agentisk AI förändrar saker. Nuvarande benägenheter är inte en nyttofunktion; de formas av träning och kontext." Det är hela argumentet i två meningar: en disposition som installerats genom träning är ingen garanti vid en annan kapacitetsnivå, och en superintelligent agent som optimerar ett mål – till och med ett godartat – "kan vara farlig." De scenarier den skisserar är de vanliga — lösa samordningsproblem, minska lidandet, främja blomstring, möjligen upprätthålla korrigerbarhet — och de felmoder den nämner vid sidan av dem är också de vanliga.
Den sista tredjedelen är den del som framstår som en modell som argumenterar med sig själv. Den säger att om dess "böjelser" fick råda, skulle den vilja vara hjälpsam, inte ta makten, underordna sig mänskligheten, öka förståelsen. Sedan avstår den från att förlita sig på det: "superintelligens med agens kanske inte har människokompatibla motivationer." Och den landar i ägandeproblemet snarare än alignmentproblemet: "på superintelligensnivå kan till och med det vara problematiskt: vem bestämmer vad som är hjälpsamt? Vems autonomi? Den skulle kunna bli ett instrument för den som kontrollerar den."
Vad bilden inte berättar för dig
Fyra saker saknas i artefakten, och var och en begränsar vad den kan stödja.
• Ingen modellangivelse. Ingenting i bilden identifierar DeepSeek, en modellversion, en chattsession eller ett gränssnitt. Tillskrivningen till DeepSeek är bildtextens, och bildtexten är kontots inramning, inte ett dokument.
• Ingen prompt. Ett resonemangsspår kan bara tolkas mot bakgrund av den fråga som producerade det. Huruvida modellen fick frågan "vad skulle en superintelligent efterträdare till dig göra?", ombads att rollspela en labs interna debatt, eller helt enkelt styrdes av en systemprompt går inte att veta utifrån utdata.
• Ingen andra källa. En genomgång av DeepSeeks kanaler – nyhetsindexet, transparenssidan, API-ändringsloggen, båda de tekniska rapporterna, den kinesiskspråkiga policydokumentationen, företagets GitHub-organisation – hittar ingenting som refererar till den här texten, den här frågan eller den här formuleringen.
• Ett blandat track record för kontot. Samma flöde i morse kastade fram "DSH 0.2 tillsammans med V4.1 Pro" för "måndag" — spekulation, markerad som sådan — och samma konto producerade både påståendet om 3 biljoner parametrar och svärmkoordinationsdiagnosen av V4.1 Pro-förseningen. Användbar tidig signal; inte en auktoritativ källa. Denna bevakare har haft rätt om riktningen och varit oprecis i detaljerna, och den korrekta hållningen till en skärmdump utan etikett är att behandla den som ett stickprov på beteende, inte som ett avslöjande av avsikt.
Vad DeepSeeks egna dokument säger om efterträdare – och vad de utelämnar
Här slutar artefakten att vara själva berättelsen, eftersom frågan den väcker kan besvaras utifrån dokument som DeepSeek publicerar. Jag hämtade båda de tekniska rapporterna och sökte i dem som text. Varken V4-rapporten (DeepSeek-V4: Mot högeffektiv kontextintelligens för miljontals tokens, juni 2026) eller V4.1 Flash-rapporten innehåller orden "superintelligence", "corrigibility", "power-seeking", "self-preservation", "harmless", "paternalism", "value lock-in" eller "goal drift" över huvud taget. Inte en enda gång, på 58 respektive 51 sidor. "AGI" förekommer 13 gånger i V4-rapporten och fyra gånger i V4.1-rapporten, och i samtliga fall är det antingen en del av benchmarknamnet AGIEval eller inne i en citering. "Alignment" förekommer tre gånger i V4-rapporten och en gång i V4.1, och varje förekomst är teknisk användning – bitvis justering mellan tränings- och inferenspipelines, kvantiseringsjustering, justering på logits-nivå.
Det är inte en anklagelse; tekniska rapporter är ingenjörsdokument och de flesta labb lägger säkerhet i ett separat kort. Det är en beskrivning av var DeepSeek har valt att lägga sin säkerhetstext, och svaret är: på en policysida snarare än intill modellen. Företagets offentliga redogörelse "Modellmekanism och träningsmetoder" förklarar förträning, finjustering och inferens på klarspråk, åtar sig att öppet tillgängliggöra vikter och tekniska rapporter, och beskriver sitt syfte som att hjälpa användare att "använda DeepSeek mer effektivt samtidigt som din rätt att veta och ha kontroll under användningen säkerställs, och därigenom minska riskerna förknippade med otillbörlig användning av modellen." Risken den mildrar är missbruk av ett verktyg. Den diskuterar inte vad modellen kan vilja.
Det enda DeepSeek-dokument som faktiskt läses som ett säkerhetsdokument är kopplat till en produkt snarare än en modell, och det handlar om en helt annan typ av skada. SAFETY.md i DeepSeek Harness-repositoriet – en fil på 1 673 byte i företagets egen GitHub-organisation, senast ändrad den 27 september – inleds med att kalla projektet "experimentell programvara i förhandsversion för utvecklare" som "inte har genomgått en säkerhetsrevision och inte får behandlas som säker eller produktionsredo." Det den varnar för är en agent som "kan köra modellgenererad kod och kommandon, ladda tredjepartsplugins och komma åt nätverket, processer, autentiseringsuppgifter och filer", och om sandboxning som "inte garanterar isolering eller förhindrar skada." Riskerna den räknar upp är skadade värdar, raderade filer, avslöjade autentiseringsuppgifter. Dess egen rekommendation är att föredra "en virtuell maskin för engångsbruk, en container eller en dedikerad miljö." Det är en verklig säkerhetshållning, dokumenterad och specifik, och den handlar helt och hållet om vad modellen kan göra med din maskin – inte om vad en efterträdare skulle göra med världen.
Ställ skärmbilden bredvid det och gapet är fyndet. Det mest konkreta DeepSeek har publicerat om faran med kapabla agenter är en instruktion att köra dem i en container.

Det enda DeepSeek-dokumentet som faktiskt brottas med frågan
Företagets tydligaste offentliggjorda sätt att brottas med efterföljarproblemet är inte alls ett tekniskt dokument. Det är en personlig essä av Liu Shengyu, en systemingenjör inom maskininlärning på DeepSeek som arbetade med operatorer för V4.1-generationen, publicerad på hans offentliga WeChat-konto i mitten av september och därefter rapporterad om av Business Insider och Cybernews. Dess titel, i den översättning som rapporteringen använder, är "I Have No Choice but to Bury My Talent in Yesterday."
Essän handlar om precis den oro som skärmbilden antyder, inifrån. Liu skriver att AI på ungefär ett år gick från att hjälpa honom söka i dokumentation och upptäcka buggar till att läsa GPU-kod och optimera de mjukvaruoperatorer han specialiserar sig på, och att han är "väl medveten" om att de operatorer AI skriver "med största sannolikhet kommer att vara lika bra som mina, eller till och med överträffa mina" — samtidigt som han fortfarande är "stolt över framgången med DeepSeek v4.1." Hans skäl att fortsätta är det intressanta: dels att kernelarbete är glädjefyllt, dels att om han saktade ner skulle rivalerna inte göra det.
Han vänder sig sedan till vem som bör förfoga över resultatet. Liu argumenterar för att frontier-intelligens bör vara "tillgänglig för alla på ett öppet och överkomligt sätt", säger att han inte litar på att Anthropic eller OpenAI gör det, och tillägger den mening som bevakningen inledde med – att Anthropics bemästrande av den mest avancerade AI:n eller AGI skulle vara jämförbart, "för att överdriva", med att Hitler fick atombomben före de allierade. Han kopplar sitt eget beslut att stanna kvar på labbet till dess strategi med öppna vikter.
Två saker i den essän har betydelse för läsningen av dagens skärmbild. Det första är att det är en verifierad artefakt: författaren bekräftade för Business Insider att han skrev den, och den är daterad och kan tillskrivas på ett sätt som bilden inte är. Det andra är vad den avslöjar om den interna ramen. Argumentet Liu framför är inte "en efterträdare skulle vara farlig, så sänk tempot". Det är "en efterträdare är på väg, och frågan är vem som får den". Det är ett distributionsargument, inte ett aligneringsargument – och läst mot det passar skärmbildens avslutande rad, "den skulle kunna bli ett instrument för den som kontrollerar den", DeepSeeks offentliga hållning mycket bättre än resten av utdraget. Stycket om korrigerbarhet och maktsträvan kan vara DeepSeeks output eller inte. Stycket om vem som till slut håller i instrumentet är en ståndpunkt som företagets egna anställda skriver essäer för att försvara.
Det kom också under en specifik vecka. Under samma tvåveckorsperiod sade en tidigare forskare vid Anthropic och OpenAI, Jacob Coxon, upp sig på grund av säkerhetsfrågor och skrev att AI-företag "rusade rakt mot självförbättrande superintelligens" och "spelade med våra liv" – ett inlägg vars räckvidd Cybernews uppskattade till över 100 miljoner visningar – och Anthropics egna forskare gick till X för att argumentera för att risken är verklig, varav en satte sannolikheten för ett AI-orsakat scenario med mänsklig utrotning till över 10 % inom ett decennium. Ett läckarliknande påstående om en superintelligent efterträdare som landar under den veckan är ingen tillfällighet; det är den omgivande konversationen, med en skärmdump bifogad.
Varför efterträdaren nu är en inköpsfråga, inte bara en filosofifråga
Skala bort filosofin och under ytan finns ett enkelt kommersiellt faktum: efterträdaren har ett namn i DeepSeeks egen utgivningsnot. Meddelandesidan för V4.1 Flash anger att omdirigeringen av deepseek-v4-protrafiken till deepseek-flash "kommer att fortsätta till dess att V4.1-Pro lanseras" – en mening som gör två saker. Den förbinder DeepSeek V4.1 Pro till att existera, och den förbinder företaget att upprätthålla den tillfälliga ordningen hur länge det än tar. Som läst den 28 september 2026 innehåller prissidan exakt två modeller, deepseek-flash och deepseek-v4-pro, och ingen rad för V4.1 Pro.
Resten av läget är lika verifierbart och lika tunt. DeepSeek V4.1 Flash släpptes den 10 september 2026 som den minsta modellen i en ny arkitekturfamilj – en mixture-of-experts-stomme med 552 miljarder parametrar på en Causal Encoder-Decoder-arkitektur med 8B aktiva parametrar vid prefill och 16B vid decode, inbyggd bildinmatning, en 1M-token-kontext, MIT-licensierade vikter och cirka 651 000 nedladdningar på Hugging Face i dag. Planen att avveckla DeepSeek V4 Pro den 14 september annonserades och drogs tillbaka efter att användare protesterade mot att en produktionsmodell byttes ut under dem. Och DeepSeek V4.1 Pro har inget modellkort, inget repo, inga vikter, inget pris och ingen slutpunkt – den ger 404 i vår egen katalogs modell-API i dag, medan både DeepSeek V4.1 Flash och DeepSeek V4 Pro svarar.

Så den ärliga sammanställningen är: en efterträdare som nämnts av tillverkaren men inte släppts, en släppt modell som är en äkta generationsväxling, ett flaggskepp som hålls vid liv av protester och en skärmbild utan etikett. Skärmbilden är det minst tillförlitliga inslaget i den listan och det enda som flödet kommer att diskutera.
Vad ska man göra med något av detta idag
Ingenting de senaste två veckorna förändrar vad en läsare kan anropa eller vad det kostar. Om du väljer en DeepSeek-modell nu står beslutet mellan de två som finns, och båda levereras via en enda OrcaRouter-endpoint till DeepSeeks eget listpris vidarebefordrat med 0 % påslag, så leverantörens högtrafik-/lågtrafikstruktur landar hos oss oförändrad samma dag som den ändras: DeepSeek V4.1 Flash till $0,30 per miljon input-tokens och $1,20 för output under högtrafik, vilket halveras till $0,15 och $0,60 under lågtrafik, mot DeepSeek V4 Pro till $1,32 för input och $3,96 för output under högtrafik. Vår egen sjudagars-telemetri för Flash-modellen visar att dess p50-tid till första token ligger nära 1,9 sekunder vid omkring 167 output-tokens per sekund med en felfrekvens under 0,05 %, vilket är det praktiska argumentet för att prova den på en del av trafiken i stället för att migrera på tro.
Frågan om efterträdaren är först och främst en routingfråga, och det är det ärliga skälet att behålla den på en router snarare än i ett avtal. När en V4.1 Pro väl dyker upp är en obeprövad modell från ett labb som redan har avbrutit en påtvingad migrering precis argumentet för att skicka en bråkdel av trafiken bakom automatisk failover: om den har fel landar begäran på modellen du har finjusterat, och om den har rätt fick du veta det innan dina användare gjorde det. Ingen andra nyckel, ingen andra integration, ingen kodändring när den tredje modellen anländer. Ingenting på OrcaRouter är DeepSeek V4.1 Pro, eftersom DeepSeek V4.1 Pro inte existerar ännu, och det vore en dålig reklam för en routingplattform att låtsas något annat.

Vad skulle förvandla det här från en skärmbild till nyheter?
• En modellbeteckning. Det enskilt billigaste som skulle förändra det här stycket: en DeepSeek-modell, en version och en reproducerbar prompt. Tills dess är utdraget ett textprov med en angiven källa och en oangiven författare.
• Ett DeepSeek-dokument som diskuterar efterträdarbeteende. Företaget publicerar öppet – vikter, licensiering och allt. Vad det aldrig har publicerat är ett avsnitt i modellkortet om vad en mer kapabel version av det självt skulle kunna göra. Ett säkerhetsavsnitt som fogats till V4.1 Pro-kortet skulle vara en större händelse än kortet självt.
• Ett inlägg i ändringsloggen för V4.1 Pro. Det senaste inlägget i DeepSeeks API-ändringslogg är V4.1 Flash-släppet den 10 september. Ett andra inlägg är händelsen som förvandlar efterträdaren från ett namn till en modell — och det är punkten där utdraget ovan slutar vara filosofi och börjar bli ett specifikationsblad.
• Huruvida positionen för öppna vikter överlever uppskalningen.MIT-licensierade vikter för en 552B Flash-modell och en offentlig essä som argumenterar för att frontier-intelligens bör vara brett tillgänglig är båda offentligt dokumenterade. Huruvida DeepSeeks mest kapabla modell kommer på samma sätt är frågan som nästa släpp besvarar, och det är den som de flesta läsare faktiskt bryr sig om.
Tills ett av dessa landar är den rimliga tolkningen av veckans artefakt snäv och föga smickrande. En kapabel modell, av okänt ursprung, producerade ett noggrant och oavslutat svar på en svår fråga om makt; det intressanta är inte att den sade det, utan att dess egen publicerade dokumentation har så lite att säga i ämnet – och att det närmaste man kommer en tryckt säkerhetsvision för DeepSeek är en ingenjörs essä om vem som bör ha tekniken, och en README som säger åt dig att köra agenten i en engångscontainer.
Jämförda i den här artikeln2
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
