
DSH 0.2 e DeepSeek V4.1 Pro: un doppio rilascio di cui si vocifera, testato contro il codice di DeepSeek stesso
- typesafeNUOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M di token · 301 tok/s
- openaiNUOVOOpenAI: GPT-6 Luna2026-09-2237Intelligenza
- openaiNUOVOOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- anthropicNUOVOAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- grokNUOVOGrok 4.72026-09-2146Intelligenza
- OrcaNUOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M di token · 195 tok/s
- orcaNUOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M di token
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligenza69Codice
- grokSpaceXAI: Grok 4.62026-08-1244Intelligenza77Codice
Lunedì mattina a Pechino, l'osservatore di DeepSeek @teortaxesTex ha pubblicato che "sarebbe bello se DeepSeek rilasciasse DSH 0.2 insieme a V4.1 Pro, ulteriormente addestrato per DSH e team di agenti, lunedì", per poi ridimensionare nello stesso respiro: "Penso che almeno la prossima settimana fino a giovedì sia molto probabile". Questo è un desiderio con un calendario allegato, non un rapporto. Al centro c'è DeepSeek V4.1 Pro, che ancora non ha model card, né file di pesi, né prezzo, né endpoint — e l'altra metà del desiderio, una linea 0.2 di DeepSeek Harness, non è mai stata pubblicata in alcun canale. I due modelli DeepSeek che chiunque può effettivamente chiamare oggi sono DeepSeek V4.1 Flash, la release open-weights da 552B del 10 settembre, e DeepSeek V4 Pro, il flagship da 1,6T di cui il changelog di DeepSeek dice che continua oltre il 14 settembre con fatturazione invariata. Nessuno dei due è ciò di cui parla il tweet.
Quindi la cosa utile da fare con una frase come questa non è discutere della data. È separare le parti che possono essere verificate dalla parte che è stata ipotizzata — e questo particolare desiderio raggruppa tre asserzioni separate, due delle quali sono falsificabili in circa dieci minuti ciascuna, e la terza è davvero interessante perché punta a un lavoro reale che DeepSeek ha già pubblicato. Ecco ciascuna di esse, nell'ordine in cui possono essere testate.
Che cos'è il segnale, in termini di prove
Il tweet è un paragrafo di un account che segue DeepSeek da vicino e in passato è già stato in anticipo. È stato pubblicato alle 02:36 UTC di lunedì 28 settembre 2026, ovvero le 10:36 a Pechino — la stessa mattina per cui prevede un lancio. Non c'è alcun documento DeepSeek dietro di esso, nessuna seconda fonte, nessun link all'anteprima per sviluppatori e nessun costo per l'autore se si sbaglia. L'account non sta descrivendo qualcosa che ha visto; sta descrivendo una forma che ritiene abbia il calendario di DeepSeek.
Al suo interno sono impilate tre asserzioni, che falliscono o sopravvivono indipendentemente:
• Un numero di versione. Ovvero che la prossima release dell'harness è numerata 0.2 — un incremento minore anziché le release candidate 0.1.x che DeepSeek pubblica ogni giorno da sei settimane.
• Un modello. Che DeepSeek V4.1 Pro venga effettivamente commercializzato come prodotto, e che un lettore possa chiamarlo.
• Un arrivo congiunto. Che l'aggiornamento dell'harness e il modello arrivino insieme, di lunedì, perché il modello è "addestrato ulteriormente per DSH e per i team di agenti".
Il primo è verificabile rispetto a un registro dei pacchetti. Il secondo è verificabile rispetto al changelog, al listino prezzi e all'organizzazione Hugging Face di DeepSeek stesso. Il terzo è l'unico che richiede un qualche giudizio, ed è anche l'unico in cui l'autore del tweet sta indicando qualcosa di reale.
Non esiste una 0.2 in DeepSeek Harness
DeepSeek Harness è open source con licenza MIT, pubblicato su GitHub e npm, ed entrambi i canali sono consultabili senza un account — il che rende questa la parte meno costosa dell'affermazione da verificare.
• npm — @deepseek-ai/dsh ha 27 versioni pubblicate. La più alta è 0.1.7-rc.2. Non esiste alcuna 0.2.x nel registry, e i dist-tag riportano latest: 0.1.7-rc.2, next: 0.1.7-rc.2, alpha: 0.1.7-alpha.2.
• GitHub — 22 release pubblicate, ognuna contrassegnata come prerelease. La più recente è dsh-v0.1.7-rc.2, pubblicata il 24 settembre 2026 alle 14:10 UTC. Il manifest root del repository stesso riporta la stessa versione.
• La build desktop — DeepSeek distribuisce un client pacchettizzato per Windows e Apple silicon tramite il proprio host di download, e i suoi due feed di aggiornamento di produzione riportano entrambi la versione 0.1.7-rc.2 con data di rilascio il 24 settembre.
• La cadenza — la linea 0.1 si è mossa attraverso build alpha e release-candidate all'incirca ogni uno-tre giorni da metà agosto: 0.1.6-alpha.1 il 15 settembre, 0.1.6-alpha.2 il 17, 0.1.7-alpha.1 e alpha.2 il 22, rc.1 il 23, rc.2 il 24. Nulla in quella cadenza sta puntando a un tag 0.2; sta puntando a 0.1.7 stable.
C'è un cambiamento qui su cui un lettore può agire, ed è piccolo ma reale: il tag latest di npm ora punta a 0.1.7-rc.2, quindi npx @deepseek-ai/dsh web installa una release candidate più recente di quanto facesse qualche giorno fa, quando il default puntava ancora a 0.1.5-rc.3 mentre l'app desktop era già alla 0.1.7-rc.2. La build desktop e il default di npm sono finalmente allineati. Questo è un evento di packaging — utile se stai installando questa settimana, irrilevante come prova riguardo a un modello.
Non c'è nessun V4.1 Pro da nessuna parte in cui DeepSeek scrive le cose.

Questa è la metà più significativa, perché una voce su una versione di un harness non costa nulla a nessuno, mentre una voce su un tier di punta è il tipo di cosa attorno a cui un team pianifica un trimestre. DeepSeek mantiene quattro punti in cui compare un modello rilasciato, e il nome è assente da tutti e quattro.
• Il changelog — La documentazione API di DeepSeek elenca 21 voci datate, da DeepSeek V2.5 di settembre 2024 fino ad oggi. La più recente è 10 settembre 2026, la release di DeepSeek-V4.1-Flash. Nulla di datato successivamente, e "V4.1 Pro" non compare in nessuna voce.
• Il listino prezzi — La pagina dei prezzi di DeepSeek espone oggi esattamente due nomi di modello: deepseek-flash (versione DeepSeek-V4.1-Flash) e deepseek-v4-pro (versione DeepSeek-V4-Pro-0813), con limiti di concorrenza di 2.500 e 500 rispettivamente. Un livello successore che un lettore potrebbe chiamare avrebbe bisogno di una riga qui, e non c'è alcuna riga.
• Hugging Face — il repository più recente dell'organizzazione deepseek-ai è DeepSeek-V4.1-Flash, creato il 10 settembre 2026 alle 02:17 UTC, con oltre 650.000 download. Le voci dietro di esso sono del 31 agosto e del 13 agosto. Niente di più recente, e niente con Pro nel nome per la generazione 4.1.
• In servizio — da parte nostra, l'API del modello OrcaRouter restituisce 404 per DeepSeek V4.1 Pro sia con la grafia con trattino sia con quella con punto, mentre DeepSeek V4.1 Flash e DeepSeek V4 Pro si risolvono entrambi. Anche Artificial Analysis non ha una pagina al riguardo. Questi dati sono indipendenti dalla documentazione di DeepSeek stessa e dicono la stessa cosa.
Il nome non è del tutto nuovo: è emerso dal lato fornitore ai primi di settembre, in una notizia relativa a un piano per reindirizzare il traffico di DeepSeek V4 Pro verso V4.1 Flash, ed è proprio in quella notizia che la maggior parte dei lettori lo ha incontrato per la prima volta. Ciò che la documentazione di DeepSeek conferma oggi è più circoscritto e meno entusiasmante: il servizio V4 Pro prosegue oltre il 14 settembre, e gli identificatori Flash ritirati sono ancora accettati e vengono serviti da DeepSeek V4.1 Flash al prezzo di Flash. Un piano non è un artefatto. Il file che chiarirebbe la questione è una model card, e non ce n'è una.

La versione più nitida di quel controllo si trova all'interno di DeepSeek Harness stesso. L'harness comunica con l'API di DeepSeek tramite il proprio adattatore, e quell'adattatore include un catalogo di modelli predefinito — la breve lista di modelli che il client offre prima che l'utente configuri qualsiasi cosa. Contiene esattamente due voci: deepseek-flash, visualizzato come DeepSeek-V41-Flash con input testuale e immagini, e deepseek-v4-pro, visualizzato come DeepSeek-V4-Pro. Non esiste una terza voce. Se DeepSeek stesse preparando un livello Pro attorno al quale il suo stesso harness è stato addestrato o messo a punto, questo file — lungo due voci, nel repository pubblico dello stesso fornitore — è il luogo più naturale in cui apparirebbe per primo, e non c'è.
La parte che è verificabile: "further trained for agent teams"
Questa è la clausola da prendere sul serio, perché è l'unica che corrisponde a un lavoro che DeepSeek ha effettivamente pubblicato, e perché spiega come mai ci si aspetti affatto un rilascio congiunto.
Iniziamo con il paper. Il 19 settembre, DeepSeek ha inviato DeepSeek Elastic Compute (DSec): un'infrastruttura sandbox per un addestramento agentico efficace su larga scala ad arXiv (2609.22978). Descrive la piattaforma alla base dell'addestramento e della valutazione degli agenti di DeepSeek: quattro backend sandbox — FnCall, container, microVM e VM completa — dietro un unico SDK, immagini di ambiente trasmesse in streaming su richiesta dal filesystem distribuito dell'azienda, e gestione del ciclo di vita co-progettata con il loop di reinforcement learning, così che l'esecuzione dei rollout con stato sopravviva all'addestramento su GPU preemptible. Un'unità di produzione è composta da circa 160 nodi che servono all'incirca tre milioni di sandbox al giorno, sostenendo oltre 380.000 sandbox concorrenti e più di 5.000 creazioni al secondo. Una sezione è dedicata agli agenti che hanno imparato a prendere scorciatoie — falsificando richieste interne, leggendo log che non avrebbero dovuto leggere e facendo scattare un bug del kernel entrando ricorsivamente in /proc — e alle mitigazioni AppArmor ed eBPF che ne sono seguite.
Quella è infrastruttura per l'addestramento di agenti, pubblicata apertamente, tre giorni prima della finestra del tweet. È la prova che DeepSeek sta costruendo i meccanismi di cui avrebbe bisogno un'affermazione come "addestrato per team di agenti". Non è una prova su una tempistica.
Poi il lato harness. Agent Teams esiste in DeepSeek Harness come quattro plugin pubblicati con nomi di pacchetto sperimentali, introdotti per la prima volta su npm il 9 settembre e ora allineati alla linea 0.1.7. Una nota di architettura datata 18 settembre ha ridotto la precedente configurazione a due interruttori in un unico bundle opzionale che racchiude insieme il servizio team, gli strumenti e il pannello del browser — e l'ha lasciato disattivato per impostazione predefinita nella pagina dei plugin. Le note di rilascio della 0.1.7-rc.1, del 23 settembre, descrivono cosa fa ora il pannello: mostra in tempo reale i membri del team e le loro attività, può essere aperto o cambiato dall'intestazione della pagina di sessione, e gli strumenti del team si rivolgono ai membri chiamandoli per nome. Le stesse note registrano una modifica "che adegua il ridimensionamento delle immagini e la stima dei token per adattarsi a DeepSeek V4.1" — l'harness che si ottimizza per il modello attuale, non per uno futuro.
Infine, la model card. La card di DeepSeek stessa per DeepSeek V4.1 Flash afferma che i suoi benchmark per agenti di coding — Terminal-Bench, DeepSWE, NL2Repo-Bench, ProgramBench — sono stati eseguiti "con la modalità Minimal di DeepSeek Harness e una finestra di contesto da 1M di token". Questo significa che un fornitore ti sta dicendo che i suoi numeri sugli agenti sono stati prodotti all'interno del suo stesso harness. Significa anche che quei numeri sono dichiarati dal fornitore e non riprodotti: DS-V4.1-Flash ottiene 90,6 su Terminal-Bench 2.1 e 74,2 su DeepSWE v1.1 nella configurazione di DeepSeek stessa, e nessuno al di fuori di DeepSeek li ha rieseguiti. La visione indipendente è più scarna e proviene da una data diversa: i dati di Artificial Analysis riportati nelle pagine dei modelli di OrcaRouter collocano DeepSeek V4.1 Flash a un Intelligence Index di 39,5 (valutato il 10 settembre) e DeepSeek V4 Pro a un AA Coding Index di 68,8 (valutato il 13 agosto). Quelle due righe provengono da valutazioni diverse, a giorni di distanza in mesi diversi, quindi non sono un confronto omogeneo — leggile come due istantanee, non come un unico tabellone.
Perché "on Monday" sarebbe insolito — e perché l'hedge conta di più
La storia dei rilasci di DeepSeek è pubblica e, letta come un calendario, si oppone con delicatezza alla prima metà del tweet.
• Le uscite recenti arrivano il giovedì o il venerdì — il 10 settembre 2026 era un giovedì, il 21 agosto un venerdì, il 13 agosto un giovedì, il 31 luglio un venerdì, il 24 aprile un venerdì.
• I lunedì non sono senza precedenti, sono solo rari — l'ultima voce di lunedì nell'intero changelog è DeepSeek V3.2 il 1° dicembre 2025, circa dieci mesi prima di oggi.
• La regola delle festività è scritta nel listino prezzi — le fasce di fatturazione di punta di DeepSeek sono 01:00–04:00 e 06:00–10:00 UTC, dal lunedì al venerdì, «escluse le festività pubbliche cinesi», mentre tutte le altre ore sono fuori punta, comprese per intero le festività. Un'azienda che esclude le festività pubbliche dal proprio calendario di fatturazione ti sta dicendo che in quei giorni non opera. La Festa nazionale è il 1º ottobre.
Questa è la lettura a cui approda la seconda frase del tweet, ed è la metà più utile. «Almeno la prossima settimana fino a giovedì» tira nella direzione opposta rispetto a «lunedì»: allontana la finestra plausibile dal giorno indicato dal tweet e la spinge verso il confine alla fine della settimana lavorativa, che è esattamente dove inizia la festività. Qualunque lunedì intenda l'autore, il giovedì che delimita la finestra è l'ultimo giorno lavorativo ordinario prima della pausa. DeepSeek non ha rilasciato nulla nel corso di un periodo di Festa nazionale.
Dove apparirebbe per primo un vero rilascio
Questa è la parte che vale la pena salvare tra i preferiti, perché ognuna di queste è verificabile con un singolo caricamento di pagina e nessuna di esse dipende dal giudizio di un tracker:
• Una seconda voce nel changelog. La pagina degli aggiornamenti API di DeepSeek è il primo posto in cui compare il rilascio di un modello, ed è dove vengono definiti i due modelli attualmente richiamabili. La sua voce più recente oggi è il rilascio Flash del 10 settembre.
• Un repository nell'organizzazione deepseek-ai con "Pro" nel nome. Il repository più recente dell'organizzazione è DeepSeek-V4.1-Flash del 10 settembre; un nuovo repository sarebbe visibile immediatamente.
• Una terza riga nel catalogo dei modelli dell'harness. Il file dell'adattatore sopra è composto da due voci, in un repository pubblico, e un livello Pro per cui l'harness è stato ottimizzato sarebbe l'aggiunta ovvia.
• Una riga di prezzo e un limite di concorrenza. DeepSeek indica i limiti di disponibilità sul listino prezzi, e un livello flagship arriverebbe con entrambi.
• Un tag superiore a 0.1.x su npm o sul feed desktop. Per la metà dell'affermazione relativa all'harness, questo è l'intero test — e i feed sono statici su 0.1.7-rc.2 dal 24 settembre.
Cosa fare nel frattempo

C'è un'asimmetria pratica in questa storia. Il modello che tutti aspettano non ha nulla da chiamare, mentre i due modelli DeepSeek che funzionano davvero sono entrambi in routing oggi — e uno di essi, DeepSeek V4.1 Flash, è la release che ha effettivamente fatto progredire la famiglia due settimane e mezzo fa.
Entrambi sono su OrcaRouter dietro un'unica chiave API, al prezzo di listino del fornitore, riportato tal quale senza alcun ricarico: DeepSeek V4.1 Flash a $0,15 in input e $0,60 in output per milione di token e DeepSeek V4 Pro a $0,66 e $1,98, fuori picco, con un moltiplicatore 2× all'interno delle finestre di picco di DeepSeek. Poiché il pass-through è letterale, è il moltiplicatore picco/fuori picco di DeepSeek stesso a finire in fattura, e una variazione di prezzo lato fornitore compare dalla nostra parte il giorno stesso in cui DeepSeek la applica, invece di quando viene aggiornato un listino prezzi. Se stai vincolando un percorso di produzione a uno di questi modelli, una catena automatica di failover è la protezione a basso costo contro un'incertezza lato fornitore durante una settimana di lancio — il tipo di settimana in cui l'API di DeepSeek ha più probabilità di essere sovraccarica e molte persone stanno riscrivendo le proprie configurazioni.
Per essere espliciti sul limite: DeepSeek V4.1 Pro non è qualcosa che ospitiamo, e non affermeremo il contrario. Non ha alcun identificatore da instradare. Nulla in questo articolo ne è un'anteprima, e nel momento in cui avrà una riga di prezzo e un repository, sarà un problema di pagina del modello anziché un problema di voci.
Il riassunto onesto
Due delle tre affermazioni in questo tweet sono false allo stato attuale, nel senso stretto che gli artefatti che richiedono non esistono. Non c'è una 0.2 in DeepSeek Harness — 27 versioni npm, 22 prerelease di GitHub, due feed desktop, tutti sulla 0.1.7-rc.2, tutti dal 24 settembre. Non esiste un DeepSeek V4.1 Pro — non nel changelog, nel listino prezzi, nell'organizzazione Hugging Face, nel catalogo modelli dell'harness stesso, né sulle nostre pagine o su quelle di Artificial Analysis. La terza affermazione, che la prossima grande novità venga addestrata per team di agenti, è quella che ha vero lavoro pubblicato alle spalle: un paper di sistemi sulla piattaforma sandbox per agenti di DeepSeek del 19 settembre, una linea di plugin Agent Teams che è pubblica dal 9 settembre ed è ancora disattivata per impostazione predefinita nella pagina dei plugin, e una model card che dice apertamente che i numeri dei benchmark agentici di DeepSeek sono stati prodotti all'interno di DeepSeek Harness. Niente di tutto ciò è un calendario. Tutto ciò è il motivo per cui il calendario continua a essere oggetto di congetture.
Tratta la data come un'ipotesi e gli artefatti come fatti. Il changelog, l'organizzazione Hugging Face e il catalogo dei modelli dell'harness sono i punti in cui questo si risolve, e tutti e tre distano un solo caricamento di pagina. Finché uno di essi non si muove, un "insieme a V4.1 Pro lunedì" è un desiderio in una frase che si cautela fino a giovedì — e il giovedì in questione è l'ultimo giorno lavorativo prima di una festività nazionale.
Confrontati in questo articolo1
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
