Una hero title card per DeepSeek V4.1 Pro con il sottotitolo 'In lavorazione: cosa sappiamo finora da una fuga di due frasi', badge a pillola che riportano 'NON ANCORA RILASCIATO' e 'NOMINATO DAL TEAM DI DEEPSEEK', una riga a piè di pagina 'Nessuna model card - nessuna specifica - nessuna data di lancio', e il logo OrcaRouter composto nell'angolo in basso a destra.
Guides & Insights

DeepSeek V4.1 Pro è in lavorazione: una nota di instradamento, una promessa sull'architettura e ciò che ancora non si sa

Autore

Rowan Sterling

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

DeepSeek V4.1 Pro non è stato annunciato, elencato, sottoposto a benchmark né prezzato. Non appare in alcuna pagina di modelli, non ha una scheda e nessun endpoint risponde al suo nome — eppure il 9 settembre 2026 un membro del team tecnico di DeepSeek lo ha dichiarato pubblicamente, quasi di sfuggita, in una nota di due frasi su cosa accadrà nel frattempo al traffico di DeepSeek V4 Pro. Tianyi Cui, che pubblica con il nome @tianyi, ha scritto che una volta lanciato ufficialmente DeepSeek V4.1 Flash — previsto intorno al 10 settembre, ora di Pechino — tutte le richieste API rivolte a DeepSeek V4 Pro verranno reindirizzate a DeepSeek V4.1 Flash e fatturate alla tariffa inferiore di Flash, e che questo accordo resterà valido fino a quando DeepSeek V4.1 Pro stesso non andrà live.

Quella clausola conclusiva è la notizia. Fino ad ora, la serie V4.1 era emersa solo attraverso la beta della "versione intermedia" durata due giorni, che ha iniziato a servire l'8 settembre con l'ID modello deepseek-v4.1-flash-expires-on-0910, più un modulo di feedback che chiedeva ai tester se V4.1 Flash potesse sostituire DeepSeek V4 Pro in produzione. Nominare DeepSeek V4.1 Pro come endpoint della finestra di instradamento è la prima volta che il modello di punta viene riconosciuto dall'interno dell'azienda. L'osservatore pseudonimo di DeepSeek, teortaxesTex, che lo ha citato, lo ha letto allo stesso modo — e poi ha aggiunto un'affermazione più forte: che l'esistenza di DeepSeek V4.1 Pro è la conferma che DeepSeek ha "risolto i problemi architettonici della famiglia V4, come si erano impegnati a fare nel paper V4".

Una nota sulle fonti prima dei dettagli. Tutto quanto segue su DeepSeek V4.1 Pro si basa su due elementi: un singolo post social datato da parte di un membro del team tecnico di DeepSeek, corroborato entro poche ore da diverse testate cinesi, e l'interpretazione che ne ha dato un tracker. Non esiste alcun rapporto tecnico, nessun conteggio dei parametri, nessuna data di rilascio e nessun modo per provare il modello oggi. La notifica di routing è una dichiarazione; la lettura "architettura risolta" è un'inferenza. Questo articolo tiene separati i due aspetti, perché sono tipi diversi di evidenze.

Cosa diceva in realtà l'avviso del 9 settembre

Verso le 15:14 ora di Pechino del 9 settembre, Tianyi Cui ha scritto su X che continuare a vendere il vecchio DeepSeek V4 Pro a un prezzo premium non aveva più senso. Il suo ragionamento, in sostanza: i test interni ed esterni mostrano che il modello V4.1 Flash supera completamente DeepSeek V4 Pro in termini di prestazioni, costi, velocità e tempo di elaborazione complessivo, quindi far pagare agli utenti più denaro, velocità più lente e maggiore potenza di calcolo per un modello più debole sarebbe inappropriato. Pertanto, una volta che V4.1 Flash sarà ufficialmente disponibile e fino al lancio di V4.1 Pro, le richieste per il modello V4 Pro saranno instradate uniformemente a V4.1 Flash e fatturate secondo la tariffa Flash.

L'affermazione di "superamento completo" è riportata dal team di DeepSeek, non verificata in modo indipendente: nessuna tabella di benchmark accompagnava il post, e la beta V4.1 Flash non ha nemmeno una model card. Ciò che è verificabile è la forma del piano. DeepSeek sta trattando il suo attuale livello Pro come obsoleto nel momento in cui Flash diventa ufficiale, e sta dirottando il traffico Pro sul modello più economico finché non esisterà il prossimo Pro.

Cosa significa se chiami DeepSeek V4 Pro oggi

Per chiunque utilizzi l'attuale ammiraglia — DeepSeek V4 Pro, la MoE da 1,6 trilioni di parametri che ha raggiunto la GA a metà agosto — il cambiamento è automatico e lato server. Una volta che il reindirizzamento entra in vigore, una richiesta che specifica il modello V4 Pro viene gestita dalla build V4.1 Flash e fatturata secondo la tariffa Flash, senza alcuna modifica al codice dal lato del chiamante. Il cambio di fatturazione è l'aspetto più incisivo. I media cinesi che hanno coperto la notizia riportano un prezzo massimo per la nuova tariffa Flash di ¥8 per milione di token a partire dal 10 settembre, contro i ¥27 per milione del livello Pro che sostituisce — un taglio di circa il 70% per il traffico che utilizzava Pro, su un modello che il team di DeepSeek afferma essere più veloce. Come annuncio di aggiornamento e riduzione del prezzo simultanei, è aggressivo anche per gli standard di DeepSeek.

A screenshot of the DeepSeek API docs Models & Pricing page (captured September 9, 2026) showing the current public lineup — deepseek-v4-flash, deepseek-v4-pro and deepseek-v4-flash-vision-exp — in English, with no V4.1 entry visible in the model table.

Una precisazione sui tempi, perché l'inquadramento conta: se oggi disponi di una chiave DeepSeek V4 Pro, non cambia nulla finché V4.1 Flash non viene effettivamente lanciata, e la descrizione del reindirizzamento proviene dal post del team e dalla sua copertura — non ancora da una voce di changelog. Al momento dell'acquisizione del 9 settembre qui sopra, la pagina ufficiale dei modelli di DeepSeek elencava ancora la sola gamma V4 — DeepSeek V4 Flash, DeepSeek V4 Pro e DeepSeek-V4-Flash-Vision-Exp — senza alcuna voce V4.1 nella tabella.

Perché "the V4 paper" è la chiave della fuga di notizie

L'affermazione specifica di teortaxesTex è che il fatto che DeepSeek V4.1 Pro sia in lavorazione conferma che DeepSeek ha risolto i problemi architetturali della famiglia V4 "come si erano impegnati a fare nel paper V4." Quel riferimento è verificabile. Il report tecnico di DeepSeek V4 — DeepSeek-V4: Towards Highly Efficient Million-Token Context Intelligence — è insolitamente candido riguardo a ciò che il suo design non fa ancora bene, e su ciò che le iterazioni future avrebbero dovuto affrontare:

• Il report definisce la propria architettura "relativamente complessa" e si impegna affermando che "nelle iterazioni future, condurremo indagini più complete e rigorose per distillare l'architettura fino ai suoi elementi progettuali più essenziali."

• I suoi due meccanismi di stabilizzazione dell'addestramento — Anticipatory Routing e SwiGLU Clamping — hanno funzionato nella pratica, riferisce il rapporto, ma i loro principi sottostanti sono rimasti "insufficientemente compresi".

• Il recupero in contesti lunghi decade ancora oltre i 128K token. In un test di recupero a 8 aghi citato nel rapporto, V4-Pro-Max ottiene circa 0,92 a 128K e scende a circa 0,59 a 1M — il divario tra "caricare un milione di token" e "saperli effettivamente usare".

• E la linea V4 è stata rilasciata solo testo; la visione è arrivata successivamente come encoder sperimentale aggiunto a posteriori, DeepSeek-V4-Flash-Vision-Exp, piuttosto che come parte del modello base.

Se letta alla luce di quell'elenco, la vicenda della V4.1 si mette a fuoco. La descrizione che DeepSeek fa della beta di V4.1 Flash usa esattamente il linguaggio che quei problemi implicavano — una "nuova struttura del modello" e supporto multimodale nativo fin dall'inizio. Una V4.1 Pro costruita sulla stessa base risolta è il passo successivo naturale, ed è precisamente l'inferenza che teortaxesTex sta traendo. È un'inferenza, e va etichettata come tale: DeepSeek non ha pubblicato alcun report tecnico sulla V4.1, e "in lavorazione" non è confermato oltre al riferimento di un membro del team al lancio eventuale della Pro.

Il registro delle prove — cosa è confermato e cosa non lo è

Sovrapponendo il segnale del 9 settembre alla beta dell'8 settembre si ottiene un breve elenco di fatti confermati e un lungo elenco di questioni aperte.

A single-column scoreboard titled 'DeepSeek V4.1 Pro - what we know so far' listing Status: named by DeepSeek team - not released, First evidence: Sept 9 2026 routing notice, Claimed base: V4.1 new structure + native multimodal, Predecessor: DeepSeek V4 Pro 1.6T MoE (GA Aug 13), Specs: none published yet, Weights: none yet - family so far API-only, with a footer reading 'Vendor-team statement plus a tracker's reading - no independent benchmarks yet.'

• Dichiarazioni del fornitore (confermate da diverse testate cinesi nel giro di ore) — DeepSeek ha un modello V4.1 Flash che prevede di lanciare intorno al 10 settembre, ora di Pechino; il traffico API di DeepSeek V4 Pro sarà instradato verso di esso e fatturato alle tariffe Flash fino al lancio di V4.1 Pro; e il team di DeepSeek ritiene che la versione Flash superi l'attuale Pro in termini di costi, velocità e tempo complessivo.

• Plausibile ma non verificato — che DeepSeek V4.1 Pro sia attualmente in addestramento o comunque imminente. L'affermazione di teortaxesTex secondo cui sarebbe "in lavorazione" non riporta né una data né una fonte interna; l'unica conferma è la finestra di routing stessa, che presuppone che un Pro esisterà prima o poi.

• Interpretazione — che l'esistenza di Pro dimostra che le promesse architetturali del paper V4 sono state mantenute. Le affermazioni della beta V4.1 Flash su "nuova struttura, multimodale nativo" vanno nella stessa direzione, ma non è stata pubblicata alcuna architettura V4.1 per verificarle.

• Sconosciuto — Specifiche di V4.1 Pro, numero di parametri, finestra di contesto, prezzo, data di lancio e se venga distribuito con pesi aperti come hanno fatto DeepSeek V4 Flash e DeepSeek V4 Pro. L'attuale beta di V4.1 Flash è solo API ed è destinata a scadere, quindi la questione dei pesi aperti è realmente aperta, non solo senza risposta.

Cosa guardare

• 10 settembre, ora di Pechino — il lancio ufficiale di V4.1 Flash, il suo nuovo tariffario e l'avvio del reindirizzamento di V4 Pro. Se accadrà come descritto, l'ID del modello "DeepSeek V4 Pro" inizierà a restituire un'architettura V4.1 ai prezzi di Flash da quel giorno.

• Un report tecnico o una model card per V4.1 — la beta non ha né l'uno né l'altra, e la prima card è ciò che trasformerebbe le affermazioni sull'architettura in qualcosa che un revisore possa verificare.

• Primi benchmark indipendenti — se la base V4.1 risolve effettivamente le lacune note del rapporto V4: il recupero oltre 128K e il deficit di ragionamento che il rapporto stesso stimava in circa tre-sei mesi di ritardo rispetto ai modelli di frontiera.

• Denominazione e tempistiche di V4.1 Pro — se il modello che teortaxesTex chiama DeepSeek V4.1 Pro appare come una scheda distinta, e quanto rapidamente arriva dopo Flash.

Cosa fare nel frattempo

Non c'è ancora nulla da chiamare. DeepSeek V4.1 Pro non è su nessuna API, e collegare la produzione a un ID di modello beta di due giorni sarebbe di per sé un errore. La notizia del reindirizzamento cambia però un calcolo per gli attuali utenti di DeepSeek V4 Pro: il modello per cui stanno pagando tariffe di punta sta per essere ufficialmente dichiarato superato, il che sconsiglia di firmare ora un impegno a lungo termine con esso e favorisce invece l'osservazione del lancio di Flash prima della prossima decisione d'acquisto.

Quell'atteggiamento attendista è esattamente il punto in cui un livello di routing dimostra il suo valore. Su OrcaRouter, DeepSeek V4 Flash, DeepSeek V4 Pro e DeepSeek-V4-Flash-Vision-Exp sono raggiungibili tramite un'unica API al prezzo di listino di DeepSeek, trasferito senza alcun ricarico — quindi una modifica di prezzo o un reindirizzamento lato fornitore viene recepito dalla nostra parte lo stesso giorno in cui viene attivato, non quando viene aggiornato un listino. Quando V4.1 Flash diventerà ufficiale e, in seguito, se apparirà V4.1 Pro, la stessa configurazione è il modo a basso costo di cambio per adottarli: inviare una parte del traffico al nuovo modello, mantenere un modello stabile come failover automatico e lasciare che il DSL di routing decida quali chiamate meritano un modello non ancora collaudato e quali devono restare sul cavallo da lavoro.

A screenshot of the OrcaRouter model page for deepseek/deepseek-v4-pro (captured September 3, 2026) showing the Tools, JSON and Reasoning badges, a 1M-token context, 384K max output, text-only input, a p50 time-to-first-token of 635 ms, and the description 'DeepSeek V4 Pro flagship MoE — 1.6T total / 49B active params, 1M context, top-tier reasoning + agentic tool use.'

La sintesi di una tabella di marcia in due frasi.

Il modo più pulito di leggere il segnale del 9 settembre è che DeepSeek ha detto al mercato, nel modo più distaccato possibile, che la sua attuale ammiraglia è una soluzione tampone. V4.1 Flash è la prova del lancio, il cambio di rotta è l'ammissione che la DeepSeek V4 Pro così come viene venduta oggi è già superata, e la singola frase "fino al lancio di V4.1 Pro" è la tabella di marcia. Ciò che manca in quella frase è tutto ciò che trasformerebbe DeepSeek V4.1 Pro da una fuga di notizie in una decisione di prodotto: una data, una specifica, un prezzo, un benchmark e qualsiasi prova oltre alla lettura di un tracker che le promesse architettoniche nel paper V4 siano state effettivamente mantenute. Finchè DeepSeek non pubblica qualcosa, la posizione razionale è quella di teortaxesTex: considerare V4.1 Pro come reale, considerare ogni suo dettaglio come non confermato e considerare il lancio di Flash intorno al 10 settembre come la prima puntata verificabile dell'architettura V4.1.

Sebbene DeepSeek V4.1 Pro non abbia ancora nulla da offrire, l'attuale ammiraglia a cui puoi accedere oggi tramite un'unica API è DeepSeek V4 Pro on OrcaRouter — al prezzo di listino di DeepSeek, senza alcun ricarico.

E il modello a cui DeepSeek dice che il traffico V4 Pro verrà reindirizzato, se vuoi confrontarlo direttamente: DeepSeek V4 Flash su OrcaRouter.

Confrontati in questo articolo2

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno