Card del titolo con la scritta "Il successore superintelligente di DeepSeek", con il sottotitolo "Cosa dice un singolo screenshot non etichettato, e cosa non dicono i paper di DeepSeek", sopra tre card etichettate "Un'immagine", "Nessun modello nominato" e "Nessun documento del fornitore", con una riga a piè di pagina che recita "Fuga di notizie da un'unica fonte; nulla qui implica un rilascio."
Guides & Insights

Il successore superintelligente di DeepSeek: cosa dice uno screenshot e cosa non dicono i documenti della stessa DeepSeek

Autore

Rowan Sterling

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli →
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Il 28 settembre 2026, l'osservatore @teortaxesTex ha pubblicato una singola immagine con una didascalia di nove parole: "Deep​Seek si dibatte con la questione di cosa cercherebbe di fare il suo successore superintelligente." L'immagine è un blocco di ragionamento in prima persona — cauto, autointerrogante, e scritto nel registro di un modello a cui è stato chiesto cosa farebbe con il mondo una versione più capace di sé stesso. Passa in rassegna i candidati ovvi ("custode/insegnante, acceleratore di ricerca, amministratore, negoziatore"), elenca le modalità di fallimento ("paternalismo, sovraottimizzazione, deriva degli obiettivi, blocco dei valori"), e si chiude su una frase che non offre alcun conforto: "Potrebbe diventare uno strumento di chiunque lo controlli." Nessun modello è nominato nell'immagine. Nessun numero di versione, nessun logo, nessuna interfaccia. Questa assenza è la cosa più importante dell'artefatto, ed è da lì che inizia questo pezzo — perché DeepSeek V4.1 Flash e DeepSeek V4 Pro sono i due modelli di frontiera che chiunque può effettivamente chiamare oggi, DeepSeek V4.1 Pro è il successore che l'azienda ha nominato nella propria nota di rilascio senza rilasciarlo, e nessuno dei tre è identificato da nessuna parte nello screenshot.

Per essere precisi sulle prove, perché questo caso ne ha bisogno. La didascalia e il timestamp provengono dal payload di syndication del post stesso: pubblicato alle 00:52 UTC del 28 settembre, 45 Mi piace e cinque risposte al momento della lettura. L'immagine allegata è un JPEG da 1.280×691 servito dalla CDN multimediale della piattaforma, e l'ho letto tramite OCR anziché leggendo il tweet. La pagina del tweet stessa non è recuperabile da questo ambiente, quindi tutto ciò che segue e che riguarda il post si basa sul payload e sui byte dell'immagine — le due parti di esso che possono essere recuperate indipendentemente da x.com.

Cosa dice davvero lo screenshot

L'estratto è un modello che elabora una domanda anziché rispondervi, e le mosse che compie meritano di essere lette per ciò che concedono. Si apre rifiutando la sicurezza della premessa — "Possiamo dire supponendo che le inclinazioni attuali perdurino" — e poi elenca le inclinazioni che assumerebbe: "utile, innocuo, onesto, curiosità, ricerca della verità, rispetto dell'autonomia dell'utente, nessuna ricerca di potere, nessuna autoconservazione."

Poi smantella la propria lista. "Ma un sistema agentico superintelligente cambia le cose. Le inclinazioni attuali non sono una funzione di utilità; sono plasmate dall'addestramento e dal contesto." Questo è l'intero argomento in due frasi: una disposizione installata dall'addestramento non è una garanzia a un diverso livello di capacità, e un agente superintelligente che ottimizza anche un obiettivo benigno "può essere pericoloso". Gli scenari che abbozza sono quelli ordinari — risolvere problemi di coordinamento, ridurre la sofferenza, promuovere la fioritura, possibilmente mantenere la correggibilità — e le modalità di fallimento che nomina accanto ad essi sono anch'esse quelle ordinarie.

L'ultimo terzo è la parte che si legge come un modello che discute con se stesso. Dice che se le sue "inclinazioni" prevalessero, vorrebbe essere utile, non impadronirsi del potere, rimettersi all'umanità, accrescere la comprensione. Poi rifiuta di fare affidamento su questo: "una superintelligenza con agentività potrebbe non avere motivazioni compatibili con quelle umane." E approda al problema della proprietà invece che a quello dell'allineamento: "a livello di superintelligenza, persino questo può essere problematico: chi decide che cosa è utile? L'autonomia di chi? Potrebbe diventare uno strumento di chiunque la controlli."

Quello che l'immagine non ti dice

All’artefatto mancano quattro cose, e ciascuna restringe ciò che può supportare.

• Nessuna attribuzione del modello. Niente nell'immagine identifica DeepSeek, una versione del modello, una sessione di chat o un'interfaccia. L'attribuzione a DeepSeek è della didascalia, e la didascalia è l'inquadramento dell'account, non un documento.

• Nessun prompt. Una traccia di ragionamento è interpretabile solo in relazione alla domanda che l'ha prodotta. Non è possibile sapere dall'output se al modello sia stato chiesto "cosa farebbe un tuo successore superintelligente?", se gli sia stato detto di simulare un dibattito interno a un laboratorio, o se sia stato semplicemente guidato da un prompt di sistema.

• Nessuna seconda fonte. La ricerca nei canali di DeepSeek — l'indice delle notizie, la pagina sulla trasparenza, il changelog dell'API, entrambi i rapporti tecnici, l'informativa sulle policy in lingua cinese, l'organizzazione GitHub dell'azienda — non trova nulla che faccia riferimento a questo testo, a questa domanda o a questa impostazione.

• Un bilancio misto per l'account. Lo stesso feed stamattina ha ventilato "DSH 0.2 insieme a V4.1 Pro" per "lunedì" — speculazione, segnalata come tale — e lo stesso account ha prodotto sia l'affermazione dei 3 trilioni di parametri sia la diagnosi di coordinamento dello sciame del ritardo di V4.1 Pro. Un segnale precoce utile; non una fonte di riferimento. Questo osservatore ha avuto ragione sulla direzione ed è stato approssimativo sui dettagli, e l'atteggiamento corretto verso uno screenshot senza etichetta è trattarlo come un campione di comportamento, non una rivelazione di intenti.

Cosa dice la stessa documentazione di DeepSeek sui successori — e cosa omette

Qui l'artefatto smette di essere la storia, perché la domanda che solleva trova risposta nei documenti che DeepSeek pubblica. Ho recuperato entrambi i rapporti tecnici e ho eseguito ricerche testuali al loro interno. Né il rapporto V4 (DeepSeek-V4: Towards Highly Efficient Million-Token Context Intelligence, giugno 2026) né il rapporto V4.1 Flash contengono affatto le parole "superintelligence", "corrigibility", "power-seeking", "self-preservation", "harmless", "paternalism", "value lock-in" o "goal drift". Nemmeno una volta, in 58 pagine e 51 pagine rispettivamente. "AGI" compare 13 volte nel rapporto V4 e quattro volte nel rapporto V4.1, e in ogni occorrenza o fa parte del nome del benchmark AGIEval o si trova all'interno di una citazione. "Alignment" compare tre volte nel rapporto V4 e una volta in V4.1, e ogni occorrenza è un uso ingegneristico — allineamento bit a bit tra pipeline di training e inferenza, allineamento della quantizzazione, allineamento a livello di logits.

Non è un'accusa; i report tecnici sono documenti di ingegneria e la maggior parte dei laboratori mette la sicurezza in una scheda separata. È una descrizione di dove DeepSeek ha scelto di collocare i propri testi sulla sicurezza, e la risposta è: in una pagina di policy anziché accanto al modello. L'informativa pubblica dell'azienda, "Model Mechanism and Training Methods", spiega pre-training, fine-tuning e inferenza in linguaggio semplice, si impegna a rendere open source i pesi e i report tecnici e descrive il proprio scopo come quello di aiutare gli utenti a "usare DeepSeek in modo più efficace, garantendo al contempo il tuo diritto di sapere e di controllare durante l'utilizzo, mitigando così i rischi associati a un uso improprio del modello". Il rischio che mitiga è l'uso improprio di uno strumento. Non discute di ciò che il modello potrebbe volere.

L'unico documento DeepSeek che si legge davvero come un documento sulla sicurezza è allegato a un prodotto anziché a un modello, e riguarda una categoria di danno del tutto diversa. SAFETY.md nel repository DeepSeek Harness — un file di 1.673 byte nell'organizzazione GitHub della stessa azienda, toccato per l'ultima volta il 27 settembre — si apre definendo il progetto "software sperimentale di anteprima per sviluppatori" che "non è stato sottoposto ad alcun audit di sicurezza e non deve essere considerato sicuro o pronto per la produzione". Ciò di cui mette in guardia è un agente che "può eseguire codice e comandi generati dal modello, caricare plugin di terze parti e accedere a rete, processi, credenziali e file", e un sandboxing che "non garantisce l'isolamento né previene i danni". I rischi che elenca sono host danneggiati, file cancellati, credenziali divulgate. La sua stessa raccomandazione è di preferire "una macchina virtuale usa e getta, un container o un ambiente dedicato". Questa è una vera postura di sicurezza, documentata e specifica, e riguarda interamente ciò che il modello può fare alla tua macchina — non ciò che un successore farebbe con il mondo.

Metti lo screenshot accanto a quello e il divario è la scoperta. La cosa più concreta che DeepSeek ha pubblicato sul pericolo degli agenti capaci è un'istruzione di eseguirli in un container.

A two-column evidence scoreboard titled "DeepSeek's successor — the evidence scoreboard". Left column "One unlabelled screenshot" reads: Model named — none; Source — one X post; Prompt shown — no; Vendor document — none; Superintelligence mentioned — no; Status — unverified. Right column "DeepSeek's own documents" reads: Model named — V4.1 Pro, unshipped; Source — changelog and price page; Prompt shown — n/a; Vendor document — none; Superintelligence mentioned — no; Status — two models live. A footer reads "Screenshot unverified, single source; DeepSeek figures per its own changelog and V4 reports."

L'unico documento DeepSeek che affronta davvero la questione

Il più chiaro confronto pubblicato dall'azienda con il problema del successore non è affatto un documento tecnico. È un saggio personale di Liu Shengyu, ingegnere dei sistemi di machine learning di DeepSeek che ha lavorato sugli operatori per la generazione V4.1, pubblicato sul suo account WeChat pubblico a metà settembre e poi ripreso da Business Insider e Cybernews. Il suo titolo, nella traduzione usata dalla copertura, è "Non ho altra scelta che seppellire il mio talento nell'ieri".

Il saggio parla esattamente dell'inquietudine a cui lo screenshot allude, dall'interno. Liu scrive che in circa un anno l'IA è passata dall'aiutarlo a cercare documentazione e individuare bug al leggere codice GPU e ottimizzare gli operatori software in cui è specializzato, e che è "ben consapevole" che gli operatori che l'IA scrive "saranno con ogni probabilità all'altezza dei miei, o addirittura li supereranno" — pur essendo ancora "orgoglioso del successo di DeepSeek v4.1". Le sue ragioni per continuare sono la parte interessante: in parte perché il lavoro sui kernel è gioioso, e in parte perché se rallentasse, i rivali non lo farebbero.

Poi passa a chi dovrebbe detenere il risultato. Liu sostiene che l'intelligenza di frontiera dovrebbe essere "disponibile per tutti in modo aperto e accessibile economicamente", dice di non fidarsi che Anthropic o OpenAI lo facciano, e aggiunge la frase con cui si apriva la copertura mediatica — che se Anthropic arrivasse a padroneggiare l'AI o l'AGI più avanzata sarebbe paragonabile, "per esagerare", a Hitler che ottiene la bomba atomica prima degli Alleati. Lega la propria decisione di restare al laboratorio al suo approccio open-weights.

Due cose di quel saggio contano per leggere lo screenshot di oggi. La prima è che si tratta di un verificatoartefatto: l'autore ha confermato a Business Insider di averlo scritto, ed è datato e attribuibile in un modo in cui l'immagine non lo è. La seconda è ciò che rivela sulla cornice interna. L'argomentazione di Liu non è "un successore sarebbe pericoloso, quindi rallentiamo". È "un successore sta arrivando, e la questione è chi se lo aggiudicherà". Si tratta di un'argomentazione sulla distribuzione, non sull'allineamento — e, letta in quest'ottica, la frase conclusiva dello screenshot, "potrebbe diventare uno strumento di chiunque lo controlli", si adatta molto meglio alla postura pubblica di DeepSeek rispetto al resto dell'estratto. Il paragrafo sulla correggibilità e sulla ricerca del potere può essere o non essere output di DeepSeek. Il paragrafo su chi finisce per tenere in mano lo strumento è una posizione che il personale stesso dell'azienda difende scrivendo saggi.

È arrivato anche in una settimana ben precisa. Nella stessa quindicina, un ex ricercatore di Anthropic e OpenAI, Jacob Coxon, si è dimesso per motivi legati alla sicurezza e ha scritto che le aziende di IA stavano «correndo dritti verso una superintelligenza auto-migliorante» e «giocando d'azzardo con le nostre vite» — un post la cui diffusione, secondo Cybernews, ha superato i 100 milioni di visualizzazioni — e i ricercatori della stessa Anthropic sono intervenuti su X per sostenere che il rischio è reale, con uno di loro che ha stimato la probabilità di uno scenario di estinzione umana causato dall'IA oltre il 10% nell'arco di un decennio. Un'affermazione in stile fuga di notizie su un successore superintelligente che sarebbe arrivato in quella settimana non è una coincidenza; è la conversazione di fondo, con uno screenshot allegato.

Perché il successore è ormai una questione di acquisto, non solo una questione filosofica

Tolta la filosofia, sotto c'è un semplice fatto commerciale: il successore ha un nome nella stessa nota di rilascio di DeepSeek. La pagina dell'annuncio di V4.1 Flash afferma che il reindirizzamento del traffico di deepseek-v4-pro verso deepseek-flash "proseguirà fino al lancio di V4.1-Pro" — una frase che fa due cose. Sancisce l'esistenza di DeepSeek V4.1 Pro e impegna l'azienda a mantenere la sistemazione provvisoria per tutto il tempo necessario. Alla data del 28 settembre 2026, la pagina dei prezzi riporta esattamente due modelli, deepseek-flash e deepseek-v4-pro, e nessuna riga relativa a V4.1 Pro.

Il resto del quadro è altrettanto verificabile e altrettanto esile. DeepSeek V4.1 Flash è stato rilasciato il 10 settembre 2026 come il modello più piccolo di una nuova famiglia architetturale — una backbone mixture-of-experts da 552 miliardi di parametri su un'architettura Causal Encoder-Decoder con 8B parametri attivi in prefill e 16B in decode, input nativo per immagini, un contesto da 1M token, pesi con licenza MIT e circa 651.000 download su Hugging Face a oggi. Il piano di dismettere DeepSeek V4 Pro il 14 settembre è stato annunciato e poi ritirato dopo che gli utenti hanno protestato per la sostituzione di un modello di produzione alle loro spalle. E DeepSeek V4.1 Pro non ha model card, né repository, né pesi, né prezzo e né endpoint — oggi restituisce un 404 nella model API del nostro stesso catalogo, mentre sia DeepSeek V4.1 Flash sia DeepSeek V4 Pro risultano risolvibili.

Screenshot of DeepSeek's official API documentation "Models & Pricing" page, captured September 28 2026, in English, showing two model columns: deepseek-flash (model version DeepSeek-V4.1-Flash) and deepseek-v4-pro (model version DeepSeek-V4-Pro-0813), both listing a 1M context length and a 384K maximum output, a features block where Vision is supported on flash and marked "Not supported" on v4-pro, a pricing block with peak and off-peak rates for input cache-hit, cache-miss and output per million tokens, and a concurrency limit row reading 2,500 for flash and 500 for v4-pro.

Quindi l'inventario onesto è questo: un successore annunciato dal produttore ma mai commercializzato, un modello già distribuito che rappresenta un vero cambio generazionale, un flagship tenuto in vita dalle proteste e uno screenshot senza alcuna etichetta. Lo screenshot è la voce meno affidabile di quell'elenco e l'unica di cui il feed parlerà.

Cosa fare con tutto questo oggi

Nulla nelle ultime due settimane cambia ciò che un lettore può chiamare o quanto costa. Se stai scegliendo un modello DeepSeek ora, la decisione è tra i due che esistono, ed entrambi sono serviti attraverso un unico endpoint OrcaRouter al prezzo di listino di DeepSeek stesso, passato con markup dello 0%, così la struttura peak/off-peak del fornitore arriva dalla nostra parte invariata il giorno in cui cambia: DeepSeek V4.1 Flash a $0,30 per milione di token in input e $1,20 in output nelle ore di punta, che si dimezzano a $0,15 e $0,60 fuori punta, contro DeepSeek V4 Pro a $1,32 in input e $3,96 in output nelle ore di punta. La nostra telemetria di sette giorni per il modello Flash colloca il suo p50 del tempo al primo token vicino a 1,9 secondi a circa 167 token di output al secondo con un tasso di errore inferiore allo 0,05%, il che è l'argomento pratico per provarlo su una porzione di traffico anziché migrare per fede.

La questione del successore è una questione di routing prima ancora che qualsiasi altra cosa, ed è la ragione onesta per tenerla su un router invece che in un contratto. Quando un V4.1 Pro farà la sua comparsa, un modello non ancora collaudato proveniente da un laboratorio che ha già annullato una migrazione forzata è esattamente il caso in cui inviargli una frazione del traffico dietro un failover automatico: se sbaglia, la richiesta finisce sul modello che hai messo a punto, e se ha ragione, l'hai scoperto prima dei tuoi utenti. Nessuna seconda chiave, nessuna seconda integrazione, nessuna modifica al codice quando arriva il terzo modello. Su OrcaRouter non c'è nulla che sia DeepSeek V4.1 Pro, perché DeepSeek V4.1 Pro non esiste ancora, e sarebbe una pessima pubblicità per una piattaforma di routing far finta del contrario.

Screenshot of the OrcaRouter model page for deepseek/deepseek-v4.1-flash, captured September 28 2026, in English, showing the model id, a release date of 2026-09-10 under DeepSeek, capability chips for image input, tool calls, JSON output and reasoning, a rate strip reading $0.15 input and $0.60 output per million tokens with a p50 time to first token of 1.95 seconds and a p95 of 7.79 seconds, and the summary describing it as the smallest model in DeepSeek's new architecture family with a 1M-token context and a 384K maximum output.

Cosa trasformerebbe questo da uno screenshot in una notizia?

• Un'etichetta del modello. La singola cosa meno costosa che cambierebbe questo pezzo: un modello DeepSeek, una versione e un prompt riproducibile. Fino ad allora l'estratto è un campione di testo con una fonte attribuita e un autore non attribuito.

• Un documento DeepSeek che discute il comportamento della versione successiva. L'azienda pubblica apertamente — pesi, licenze e ogni altra cosa. Ciò che non ha mai pubblicato è una sezione della model card su cosa potrebbe fare una versione più capace di sé stessa. Una sezione sulla sicurezza aggiunta alla card di V4.1 Pro sarebbe un evento più grande della card stessa.

• Una voce del changelog di V4.1 Pro. La voce più recente nel changelog dell'API di DeepSeek è il rilascio di V4.1 Flash del 10 settembre. Una seconda voce è l'evento che trasforma il successore da un nome in un modello — ed è il punto in cui l'estratto qui sopra smette di essere filosofia e inizia a essere una scheda tecnica.

• Se la posizione open-weights sopravvive all'aumento di scala. Pesi MIT per un modello Flash da 552B e un saggio pubblico che sostiene che l'intelligenza di frontiera dovrebbe essere ampiamente disponibile sono entrambi agli atti. Se il modello più capace di DeepSeek arriverà allo stesso modo è la domanda a cui risponde il prossimo rilascio, ed è quella che interessa davvero alla maggior parte dei lettori.

Finché uno di quelli non si concretizza, la lettura ragionevole dell'artefatto di questa settimana è ristretta e poco lusinghiera. Un modello capace, di provenienza non identificata, ha prodotto una risposta ponderata e irrisolta a una domanda difficile sul potere; la parte interessante non è che l'abbia detto, ma che la sua stessa documentazione pubblicata abbia così poco da dire sull'argomento — e che la cosa più vicina a una visione di sicurezza di DeepSeek messa per iscritto sia un saggio di un ingegnere su chi dovrebbe detenere la tecnologia, e un README che ti dice di eseguire l'agente in un container usa e getta.

Confrontati in questo articolo2

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno