
Prezzi dell'API DeepSeek V4 Pro: 0,73 $/2,18 $ fuori picco, e perché lo shutdown del 14 settembre è stato annullato
- openaiNUOVOOpenAI: GPT-6.1 Sol2026-09-2952Intelligenza
- anthropicNUOVOAnthropic: Claude Sonnet 5.52026-09-2856Intelligenza
- typesafeNUOVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M di token · 223 tok/s
- OpenAINUOVOOpenAI: GPT-6 Luna2026-09-2238Intelligenza
- OpenAINUOVOOpenAI: GPT-6 Sol2026-09-2248Intelligenza
- AnthropicNUOVOAnthropic: Claude Opus 5.52026-09-2258Intelligenza
- xAINUOVOGrok 4.72026-09-2146Intelligenza
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M di token · 126 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M di token · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligenza
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligenza77Codice
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligenza76Codice
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligenza76Codice
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligenza82Codice
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M di token · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligenza72Codice
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M di token · 213 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligenza75Codice
- obsidianQwen3.8 27B2026-08-1534Intelligenza68Codice
DeepSeek V4 Pro non verrà ritirato. L'11 settembre 2026, DeepSeek ha dichiarato che continuerà a servire il modello tramite la propria API dopo il 14 settembre, con il metodo di fatturazione invariato — invertendo un piano annunciato due giorni prima secondo cui ogni richiesta a deepseek-v4-pro sarebbe stata reindirizzata a DeepSeek V4.1 Flash e fatturata alle tariffe di Flash. Per chiunque abbia prompt, impostazioni della temperatura e schemi di tool-call messi a punto su V4 Pro, questo è il fatto che conta questa settimana: il modello su cui hai costruito resta dov'è, e la migrazione che potresti aver programmato per lunedì non deve avvenire.
Il prezzo è un'altra storia, e questa pagina lo riportava in modo errato da un mese. DeepSeek V4 Pro non costa più $0,44/$0,88 per milione di token. Fuori dalle ore di punta viene fatturato a $0,726 per l'input e $2,178 per l'output per 1 milione di token su OrcaRouter, raddoppiando a $1,452/$4,356 all'interno delle finestre di punta, con le letture della cache a $0,024. I fine settimana ora sono interamente fuori dalle ore di punta. E il listino prezzi del fornitore stesso — quello nella documentazione API di DeepSeek — riporta l'avviso di continuazione come nota a piè di pagina nella stessa tabella dei prezzi, il che è quanto di più vicino a una fonte primaria possa esserci per una pagina di prezzi.
Ciò che DeepSeek ha effettivamente detto, e ciò che annulla
L'ordine cronologico conta, perché due dei tre annunci erano l'uno l'opposto dell'altro, e quello centrale è quello che la gente ricorda.
• 9 settembre — DeepSeek ha comunicato agli utenti che, fino al lancio di V4.1 Pro, le richieste a V4 Pro sarebbero state indirizzate a DeepSeek V4.1 Flash e fatturate alle tariffe di V4.1 Flash.
• 10 settembre — V4.1 Flash è stato rilasciato, e DeepSeek ha spostato il passaggio a un momento fisso: 12:00 ora di Pechino del 14 settembre 2026, dopodiché V4 Pro sarebbe andato offline e il suo traffico sarebbe stato servito da Flash.
• 11 settembre — DeepSeek ha fatto marcia indietro. La sua formulazione, ora riportata testualmente come nota a piè di pagina nella pagina Modelli e prezzi della documentazione della propria API: "In risposta alla domanda degli utenti, abbiamo deciso di continuare a fornire i servizi API per DeepSeek V4 Pro dopo il 14 settembre 2026, con il metodo di fatturazione invariato. Forniremo ulteriori comunicazioni qualora dovessero esserci cambiamenti."
È il fornitore che parla del proprio prodotto, ed è la fonte più autorevole disponibile qui — ma leggete cosa risolve e cosa non risolve. Risolve la continuità e la fatturazione: V4 Pro resta, alle tariffe già in vigore. Non promette una tempistica. Comunicheremo ulteriore preavviso è tutto l'impegno, e la stessa frase lascia la porta aperta al ritorno del piano. Se state assumendo un impegno su più trimestri, pianificate per il modello da cui potete passare piuttosto che per quello che potete mantenere.
Il contraccolpo che ha costretto all'inversione di rotta merita di essere compreso, perché si sovrappone a una decisione che potresti essere tu stesso sul punto di prendere. Gli sviluppatori non si sono opposti a V4.1 Flash — che secondo DeepSeek batte V4 Pro in prestazioni, prezzo, velocità e tempo totale di esecuzione — ma alla sostituzione automatica. Cambiare il modello dietro un ID di modello stabile modifica il comportamento senza cambiare il codice: un prompt ottimizzato, una temperatura funzionante, uno schema di tool call che si analizza correttamente sono tutte proprietà di uno specifico checkpoint. La copertura su CLS (科创板日报), 36Kr, IT之家 e ifeng, e in inglese su TheBlockBeats, descrive DeepSeek che prima rimanda, poi abbandona il piano; la documentazione di DeepSeek stessa mostra bene il contrasto, perché i nomi legacy deepseek-v4-flash sono stati ritirati e ora servono V4.1 Flash, e quel cambio è rimasto. Quello di Pro no.
Il prezzo di oggi, verificato rispetto al listino prezzi del fornitore stesso

Due cifre contano, e sono lo stesso prezzo di listino in due valute.
• Fuori picco (ogni ora al di fuori delle fasce di picco sotto indicate) — input $0.726 per 1M in caso di cache miss, oppure ¥4.5; output $2.178, oppure ¥13.5; input con cache hit $0.024, oppure ¥0.15.
• Picco — esattamente il doppio. Input $1.452 / ¥9, output $4.356 / ¥27, input con cache hit $0.048 / ¥0.30.
• La conversione in dollari di DeepSeek stessa — la documentazione del fornitore riporta la stessa lista in yuan come $0,66 input / $1,98 output fuori picco e $1,32 / $3,96 in picco, con cache hit a $0,022 e $0,044. La differenza rispetto alle cifre in dollari di OrcaRouter è il tasso di cambio a cui converte ciascuna parte, non una tariffa token aggiuntiva: OrcaRouter passa la tariffa del provider senza ricarico, quindi il numero nella lista è il numero che paghi.
• Nessun piano gratuito per V4 Pro. Un piano Flash gratuito esiste sulla directory, ma il modello di punta è solo a pagamento.
• La scheda tecnica, per contesto — V4 Pro è un modello open-weights con licenza MIT, 1,6T di parametri totali con 49B attivi per token, una finestra di contesto da 1M di token e fino a 384K token di output, con un limite di concorrenza di 500. Artificial Analysis riporta 72,3 token di output al secondo.
La versione del modello dietro tutto questo è DeepSeek-V4-Pro-0813, invariata dal rilascio di disponibilità generale del 13 agosto — che è il punto. Nulla del checkpoint è cambiato l'11 settembre; è cambiata solo la decisione sul suo futuro.
Fascia di punta, fascia non di punta e la regola del fine settimana che cambia i calcoli
Lo schema di punta/fuori punta che la versione precedente di questa pagina descriveva come in arrivo il 17 agosto ha ormai un mese di vita ed è stato modificato una volta da allora.
• Fasce di punta — 01:00–04:00 e 06:00–10:00 UTC, dal lunedì al venerdì. In ora di Pechino corrispondono a 09:00–12:00 e 14:00–18:00, la giornata lavorativa di DeepSeek stessa. Le tariffe fuori punta sono esattamente la metà di quelle di punta, non una fascia di sconto aggiuntiva.
• I fine settimana sono completamente off-peak. A partire dalle 00:00 ora di Pechino del 23 agosto 2026, DeepSeek ha smesso di applicare le tariffe di punta il sabato e la domenica. Se il tuo lavoro in batch può essere spostato, spostarlo nel fine settimana dimezza la bolletta — e per i team che servono utenti nelle Americhe, gran parte della settimana lavorativa cade già fuori dalle ore di punta senza alcuna pianificazione.
• Quanto è costato il cambiamento, rispetto ai ¥3/¥6 con cui il modello è stato lanciato il 13 agosto — l'output off-peak odierno è 2,25× la tariffa di lancio e l'output di picco è 4,5×; l'input in picco con cache hit è 12× il vecchio ¥0,025.
C'è un'asimmetria, qui, che spiega perché la questione della migrazione continui a saltare fuori anche dopo che la chiusura è stata annullata. Il prezzo di V4 Pro è aumentato ad agosto, mentre quello del suo successore è diminuito: DeepSeek ha tagliato i prezzi delle API della serie Flash fino al 60% a partire dal 10 settembre. La pressione a migrare non è mai stata davvero legata all'avviso del 14 settembre; l'avviso l'ha solo resa urgente.
Quanto costa realmente una richiesta
Tre esempi svolti con le tariffe fuori punta di oggi. Ognuno di essi raddoppia all'interno di una fascia di punta.
• 100K di input + 50K di output — $0.0726 + $0.1089 ≈ $0.18.
• 1M di input + 1M di output — $0,726 + $2,178 = $2,90. Quella stessa chiamata costa $5,81 al picco, ed era $1,32 a metà agosto.
• Sessione agentica, 500K input + 200K output — $0,363 + $0,4356 ≈ $0,80.
La vista mensile si trova nella pagina del modello ed è la verifica onesta se il vecchio prezzo di riferimento descrive ancora la tua fattura: a 10M di token al mese con una quota di input del 70%, il calcolatore dei costi arriva a $11,62, oppure a circa $9,16 con il prompt caching attivato. Se il tuo budget era basato su $0,44, ora copre circa il 60% della fattura.
La cache è la leva che nessuno mette sul tavolo
Il caching dei prompt è diventato più prezioso, non meno, quando le tariffe sono aumentate — e la direzione dei due numeri è il motivo. Su OrcaRouter una lettura dalla cache ora viene fatturata a 0,024 $ per 1M di token contro 0,726 $ senza cache, uno sconto del 96,7% su qualsiasi input che reinvii. Nella versione precedente di questa pagina la tariffa della cache era di 0,060 $ contro un prezzo di input di 0,442 $, uno sconto dell'86%. Il prezzo di lettura dalla cache è diminuito di oltre la metà mentre il prezzo dell'input senza cache è aumentato del 64%, quindi il divario effettivo tra un token in cache e uno non in cache si è ampliato notevolmente.
Per un agente che rinvia un grande prompt di sistema e un lungo contesto a ogni turno, l'input in cache è la differenza tra una fattura che scala con la lunghezza della conversazione e una che non lo fa. La regola pratica è invariata e vale la pena ripeterla: mettere per primo il prompt di sistema stabile e il materiale di riferimento, e per ultimo il contenuto variabile, così che il prefisso che rinviate colpisca davvero la cache. Su questo modello, quella singola scelta strutturale vale più di qualsiasi decisione di routing o di pianificazione sottostante.
Come i prezzi di V4 Pro si confrontano con la concorrenza

Prezzi di listino della directory per input/output per 1 milione di token, verificati il 12/09/2026, messi a confronto con i $0,726/$2,178 fuori picco di V4 Pro. Due di questi sono cambiati da quando questa pagina è stata pubblicata per la prima volta, e uno di essi cambia la conclusione.
• Claude Fable 5 — $10 / $50. V4 Pro è 13,8× più economico sull'input e 23× sull'output.
• Claude Opus 5 — $5 / $25. 6,9× / 11,5×.
• GPT-5.6 Sol — 4 $ / 20 $ fino a 272K di contesto, 8 $ / 30 $ oltre. 5,5× / 9,2× sulla fascia più corta, 11× / 13,8× su quella più lunga.
• Kimi K3 — $3 / $15. 4,1× / 6,9×.
• Qwen3.8 Max — 2 $ / 6 $. 2,8× / 2,8×.
• Grok 4.5 — $2 / $6. 2,8× / 2,8×.
• Gemini 3.6 Flash — $0.75 / $3.75. Più o meno alla pari sull'input, a 1.03×, e 1.7× sull'output. Il suo prezzo si è dimezzato da quando questa pagina è stata scritta.
• MiniMax M3 — $0,30 / $1,20. Ora più economico di V4 Pro su entrambe le voci: V4 Pro costa 2,4× in più sull'input e 1,8× in più sull'output, con la stessa finestra da 1M di token.
• DeepSeek V4 Flash — $0.242 / $0.726 sulla directory. Circa 3× più economico su entrambe le voci, stesso contesto da 1M.
Quindi il modo onesto di inquadrare la questione è cambiato, e questa pagina dovrebbe dirlo invece di mantenere il vecchio superlativo. DeepSeek V4 Pro non è più il modello con contesto da 1M più economico in classifica: sia Gemini 3.6 Flash sia MiniMax M3 lo battono sul prezzo, e MiniMax M3 lo fa eguagliando la finestra di contesto. Ciò che V4 Pro resta, con un margine di oltre un ordine di grandezza, è la cosa più economica nella fascia frontier — ogni modello occidentale di classe flagship in quella lista costa diverse volte tanto su entrambe le voci. Se la domanda è "la chiamata con contesto da 1M più economica possibile", la risposta non è più questo modello. Se la domanda è "il modello più economico che si comporta come un modello frontier", per ora lo è ancora.
Quando V4 Pro è la scelta sbagliata
• Se il tuo traffico raggiunge il picco durante le ore diurne di Pechino. Le ore di punta raddoppiano la tariffa, e le finestre di picco coincidono esattamente con la giornata lavorativa cinese. Se i tuoi utenti sono nelle Americhe, la maggior parte del tuo traffico cade già fuori dalle ore di punta, il che è un vero vantaggio strutturale. Se stai sviluppando per utenti in Cina, calcola esplicitamente la bolletta delle ore di punta prima di impegnarti — e verifica se la regola del fine settimana ti aiuta a spostare qualcosa.
• Se i tuoi prompt sono brevi. Al di sotto di circa 10K token di contesto, il tier di punta è capacità sprecata. DeepSeek V4 Flash a $0,242/$0,726 sulla directory gestisce lo stesso contesto da 1M a circa un terzo del prezzo, e per compiti davvero brevi un modello più economico vince comunque.
• Se ti serve la visione. V4 Pro è solo testo — nessun input di immagini o audio — e Artificial Analysis indica la sua modalità di input come testo. Gemini 3.6 Flash o Claude Fable 5 sono più adatti se la modalità è il punto. Vale la pena notare anche l'API di DeepSeek: ora serve i nomi dei suoi modelli flash legacy con V4.1 Flash, che accetta le immagini.
• Se state comprando un punteggio grezzo ai vertici dei benchmark anziché il prezzo per contesto. Sulla scala attuale di Artificial Analysis, V4 Pro ottiene 36 sull'Intelligence Index — 8° su 113 modelli al momento della stesura — e 69 sul Coding index riportato nella directory OrcaRouter. È un risultato competitivo, non da leader: Claude Fable 5, Claude Opus 5 e GPT-5.6 Sol lo superano tutti nel coding. La proposta di V4 Pro è una capacità prossima alla frontiera a una frazione del prezzo per token, non la vetta di ogni classifica.
Come chiamarlo su OrcaRouter

DeepSeek V4 Pro è ospitato su OrcaRouter con l'ID modello deepseek/deepseek-v4-pro, erogato tramite l'endpoint compatibile con OpenAI all'indirizzo api.orcarouter.ai/v1 alla tariffa del provider senza alcun ricarico. La migrazione da un client OpenAI esistente è solo un cambio di base-URL e di ID modello, nient'altro.
L'inversione cambia ciò che dovresti fare al riguardo. Se avevi una migrazione del 14 settembre in calendario — per passare da V4 Pro a DeepSeek V4.1 Flash perché Pro stava per essere dismesso — puoi toglierla dal calendario, o almeno declassarla da scadenza a test. Entrambi i modelli stanno dietro un'unica chiave OrcaRouter, quindi confrontarli è un cambio di ID modello in una richiesta anziché un secondo contratto e un secondo SDK; e se vuoi che V4.1 Flash venga valutato su traffico reale senza puntare un percorso di produzione su di esso, il failover automatico è il modo a basso rischio per affidargli richieste live mentre V4 Pro resta come fallback. Questa è la forma pratica della decisione dell'11 settembre: la scelta resta tua, e resta reversibile.
La nota di trasparenza che conta per una pagina di prezzi: noi instradiamo verso il modello, non ne fissiamo il prezzo. Le cifre fuori picco di $0,726/$2,178 sono le tariffe di DeepSeek applicate così come sono, e cambiano quando DeepSeek le cambia — ed è esattamente per questo che questa pagina riporta la data, e che la versione che stai leggendo è stata riscritta anziché aggiunta in coda.
Fonti e data
I prezzi e le specifiche di questa pagina sono stati verificati nuovamente il 2026-09-12. Le cifre in dollari per DeepSeek V4 Pro e per ogni modello del confronto sono tratte da la directory dei modelli di OrcaRouter, verificata lo stesso giorno; il numero di parametri, la licenza, la finestra di contesto, la modalità e i dati sulla velocità provengono dalla pagina del modello di Artificial Analysis per DeepSeek V4 Pro 0813. Le tariffe in yuan, le finestre di picco e l'avviso di prosecuzione dell'11 settembre provengono dalla documentazione Models & Pricing di DeepSeek stessa, che riporta la dichiarazione testualmente come nota a piè di pagina della tabella dei prezzi. La sequenza di annunci in tre passaggi — l'avviso di routing del 9 settembre, il rinvio del 10 settembre alle 12:00 ora di Pechino del 14 settembre e l'inversione dell'11 settembre — è riportata da CLS (科创板日报), 36Kr, IT之家 e ifeng, e in inglese da TheBlockBeats. La regola di fatturazione del fine settimana del 23 agosto e il taglio del prezzo di Flash del 10 settembre provengono dagli annunci di DeepSeek come riportati da IT之家, The Paper e 21st Century Business Herald.
Una nota conclusiva sull'affidabilità, perché questo specifico prezzo è cambiato tre volte in un mese — tariffe di lancio il 13 agosto, peak/off-peak il 17 agosto, la modifica del fine settimana il 23 agosto. Considera inutilizzabile qualsiasi pagina "V4 Pro pricing" priva di una data. La versione precedente di questa riportava $0,44/$0,88 e un indice Artificial Analysis Intelligence di 44,3; entrambi erano corretti quando furono scritti, e nessuno dei due è sopravvissuto al mese.
Confrontati in questo articolo3
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
