Scheda del titolo hero con scritto 'GPT-6 Sol Pro vs DeepSeek V4 Pro', con il sottotitolo 'Una tariffa fissa contro un orario', una coppia di etichette 'GPT-6 Sol Pro' / 'DeepSeek V4 Pro', e una riga a piè di pagina con scritto 'Prezzi di listino dei fornitori; cifre secondo Artificial Analysis.', con il logo OrcaRouter reale in basso a destra.
Guides & Insights

GPT-6 Sol Pro vs DeepSeek V4 Pro: una tariffa fissa contro una tabella di marcia

Autore

Alistair Wren

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

GPT-6 Sol Pro e DeepSeek V4 Pro sono i due modi più economici e credibili per eseguire tramite un'API un serio carico di lavoro di ragionamento al momento, e il loro prezzo si basa su principi completamente diversi. GPT-6 Sol — il modello del fornitore eseguito dalla configurazione gpt-6-sol-pro, in disponibilità generale dal 22 settembre 2026 — costa $2,00 per milione di token di input e $10,00 per milione di token di output, a ogni ora di ogni giorno. DeepSeek V4 Pro, il modello di punta open-weights il cui checkpoint 0813 ha raggiunto la disponibilità generale il 13 agosto 2026, costa $0,66 e $1,98 per la maggior parte della settimana ed esattamente il doppio per due finestre ristrette nelle mattine dei giorni feriali. Qualsiasi confronto che citi una singola tariffa cita solo metà del prezzo.

La tempistica è la storia. Tutto il resto di questo confronto — i punteggi dell'indice, le finestre di contesto, i termini di licenza — è a valle del fatto che uno di questi due fornitori ha deciso che il suo prezzo di listino è una funzione dell'orologio.

Che cosa rappresenta realmente ciascuna riga di prezzo

Il listino prezzi di GPT-6 Sol è una sola riga. Input $2.00, input in cache $0.20, scrittura in cache $2.50, output $10.00 per milione di token, con una riprezzatura per contesto lungo al di sopra di una soglia di input che, una volta superata, si applica all'intera richiesta. Non c'è alcuna dimensione temporale né alcuna finestra promozionale. Il 22 settembre OpenAI ha ridotto il modello predecessore a questi numeri e li ha descritti come permanenti.

Il listino prezzi di DeepSeek è una tabella. Come si legge sulla pagina dei prezzi del fornitore stesso:

• Input fuori picco — 0,66 $ per milione di token, cache miss; 0,022 $ per milione di token, cache hit

• Output fuori picco — $1,98 per milione di token

• Input di picco — 1,32 $ per milione di token, cache miss; 0,044 $ per milione di token, cache hit

• Output di picco — 3,96 $ per milione di token

• Finestre di punta — 01:00–04:00 e 06:00–10:00 UTC, dal lunedì al venerdì, escluse le festività pubbliche cinesi

• Tutto il resto — fuori dalle ore di punta, incluso l'intero fine settimana, una regola entrata in vigore a mezzanotte, ora di Pechino, del 23 agosto 2026

Sette ore di picco su una settimana di 168 ore, cinque giorni su sette, equivalgono a circa il 21% del calendario alla tariffa più alta e al 79% a quella più bassa. Quindi l'onesta sintesi in un singolo numero di DeepSeek V4 Pro non è 0,66 $ e non è 1,32 $ — è da qualche parte nel mezzo, e dove dipende dalla forma del vostro traffico, non dalla generosità del fornitore.

Il riprezzamento da cui è nata questa tabella

Vale la pena sapere quanto sia recente questa struttura, perché quasi ogni pagina di confronto cita ancora il numero che ha sostituito. Il 22 maggio 2026, DeepSeek ha trasformato uno sconto a tempo limitato su V4 Pro in un prezzo permanente — una riduzione di circa il 75%, fino a circa 0,435 $ per l'input e 0,87 $ per l'output per milione di token.

Il 17 agosto 2026 a mezzanotte, ora di Pechino, la situazione si è capovolta, e non solo. Il sistema peak/off-peak è entrato in vigore con un aumento medio sulle righe interessate di circa 3,5 volte e un massimo di 12 volte — il 12× è caduto esattamente sulla tariffa di input con cache hit, che è passata da ¥0,025 a ¥0,30 per milione di token nelle ore di punta. L'input con cache miss è aumentato di circa il 200% e l'output di circa il 350%. Sei giorni dopo è stata aggiunta l'eccezione per il fine settimana, che ne ha recuperato una parte per chiunque potesse spostare i propri job batch.

Ne conseguono due conseguenze. In primo luogo, qualsiasi pagina che vi dica che DeepSeek V4 Pro è un modello sotto il dollaro sta citando un listino prezzi che è stato superato due volte. In secondo luogo, la forma dell'aumento è un segnale di ciò su cui DeepSeek sta ottimizzando: l'aumento proporzionale maggiore riguarda le cache hit, ovvero la tariffa che conta di più proprio per il carico di lavoro — lunghi cicli di agente che reinviano un prefisso stabile — che ha reso il modello attraente in primo luogo.

A two-column scoreboard card titled 'GPT-6 Sol vs DeepSeek V4 Pro - the scoreboard'. Left column 'GPT-6 Sol': AA Index, max 48; price in/out $2 / $10 flat; peak surcharge none; cost per index task $1.06; max output 128K; weights closed. Right column 'DeepSeek V4 Pro': AA Index, max 36; price in/out $0.66 / $1.98 off-peak; peak surcharge 2x, 7h a week; cost per index task $0.67; max output 384K; weights MIT, downloadable. A footer line reads 'Vendor list prices; index figures per Artificial Analysis.', with the real OrcaRouter logo bottom-right.

Il numero dell'indice che tutti citano è stato ritirato

Artificial Analysis è il banco di prova neutrale per questo confronto, e ha più volte ri-versionato il suo Intelligence Index nel corso del 2026. Nella classifica attuale, GPT-6 Sol ottiene 48 con sforzo massimo a 1,06 $ per compito indice. DeepSeek V4 Pro, sul checkpoint 0813 con sforzo massimo, ottiene 36 a 0,67 $ per compito indice.

Il valore che circola per DeepSeek è 53. Quel numero è reale ed è stato pubblicato — in una revisione precedente dell'indice, prima di un cambio di versione che ha spostato i punteggi della maggior parte dei modelli. Confrontare un 53 preso da un articolo precedente alla v4.3 con un 48 attuale significa confrontare una misurazione ritirata con una attiva, e produce l'errore più comune in assoluto in questo confronto: l'affermazione che i due modelli sono a un punto di distanza l'uno dall'altro. Sull'indice attuale sono separati da dodici punti, e il divario di prezzo per attività completata non è il 3× che le tariffe di listino suggeriscono, ma più vicino a 1,6×, perché DeepSeek consuma più token per arrivare alla sua risposta.

Altri due punti dati indipendenti si collocano accanto a quelli, entrambi etichettati per quello che sono. Vals AI, con un harness isolato, colloca DeepSeek V4 Pro al 96,40% su SWE-bench Verified a 0,103 $ per test — secondo in quella classifica dietro il 97,00% di Claude Opus 5, ed economico per test con un ampio margine. La board coding-agent di Artificial Analysis mostra il 14% su Terminal-Bench 4.0 contro il 44% di GPT-6 Sol. Il primo numero dice che DeepSeek è competitivo su un compito di coding ristretto e ben definito. Il secondo dice che non è competitivo nel lavoro agentico da terminale. Entrambi sono veri e misurano cose diverse.

Laddove i due modelli sono strutturalmente diversi, non solo con prezzi differenti

• Licenza — GPT-6 Sol è un'API chiusa senza pesi; DeepSeek V4 Pro è con licenza MIT con checkpoint pubblici su Hugging Face, incluse le varianti di base per il pretraining continuato

• Output massimo — GPT-6 Sol 128.000 token contro DeepSeek V4 Pro 384.000 token, un tetto tre volte più alto a un quinto della tariffa di output

• Finestra di contesto — GPT-6 Sol 1.050.000 token vs DeepSeek V4 Pro 1.048.576 token, praticamente identiche

• Modalità — sia testo in input sia testo in output; nessuna delle due accetta immagini tramite l'API

• Prezzi per contesto lungo — GPT-6 Sol riprezza l'intera richiesta al di sopra della sua soglia di input; il piano peak/off-peak di DeepSeek V4 Pro è l'unica struttura di prezzo di cui dispone

• Scala — DeepSeek V4 Pro è un modello mixture-of-experts da 1,6 trilioni di parametri con 49 miliardi di parametri attivi per token; OpenAI non pubblica un dato comparabile per GPT-6 Sol

Una nota su quel conteggio dei parametri, perché è una frequente fonte di confusione: la cifra di 1,7 trilioni che appare in alcuni elenchi è la dimensione del pacchetto Hugging Face con incluso il modulo opzionale DSpark di decodifica speculativa, non un modello target più ampio. L'architettura pubblicata è di 1,6T in totale. Sottrarre i badge arrotondati per dedurre la dimensione del modulo draft non è un calcolo valido, e nemmeno leggere il numero più grande come prova che il modello è cresciuto.

Screenshot of OpenAI's developer model page for GPT-6 Sol, captured 23 September 2026, showing the model id gpt-6-sol, a 1,050,000-token context window with 922,000 maximum input tokens and a 128,000-token output ceiling, an April 20, 2026 knowledge cutoff, text and image input with text output, reasoning effort values of none, low, medium, high, xhigh and max with medium as the default, and Standard pricing of $2.00 input, $0.20 cached input, $2.50 cache writes and $10.00 output per million tokens.

Il ritiro che è il vero argomento a favore dei pesi aperti

Il 9 settembre 2026, DeepSeek ha annunciato che stava dismettendo gradualmente V4 Pro e che, dalle 04:00 UTC del 14 settembre, ogni richiesta alla stringa del modello deepseek-v4-pro sarebbe stata indirizzata a DeepSeek V4.1 Flash e fatturata alle tariffe di Flash, proseguendo fino al rilascio di un modello V4.1 Pro. La stringa del modello avrebbe comunque risposto. Il modello che vi era dietro non sarebbe stato quello su cui chiunque aveva eseguito benchmark.

Gli sviluppatori hanno protestato, e il reindirizzamento è stato ritirato. Il changelog di DeepSeek ora afferma che il servizio API V4 Pro continua oltre il 14 settembre con fatturazione invariata, e la tabella dei prezzi elenca ancora deepseek-v4-pro come riga attiva, con le proprie tariffe e nessun tag di dismissione. La pagina dell'annuncio precedente contiene ancora il linguaggio sul routing, quindi i due documenti sono in disaccordo — e la pagina dei prezzi attiva è quella che descrive ciò che accade realmente quando lo chiami.

Quell'episodio è l'argomento più forte dell'intero confronto, e non è un argomento di prezzo. Un modello chiuso può essere riprezzato, reindirizzato o ritirato secondo i tempi di un fornitore, e l'unico ricorso è migrare. Un modello con pesi MIT su un repository pubblico può essere servito dalla propria infrastruttura, il che significa che il checkpoint che hai valutato è il checkpoint che continui a servire, indipendentemente da ciò che la roadmap del fornitore dirà sei settimane dopo. DeepSeek ha dimostrato il rischio e ha fornito la mitigazione nella stessa quindicina.

Il contrappeso onesto è che il self-hosting di un modello da 1,6 trilioni di parametri non è una decisione che la maggior parte dei team prende con leggerezza. È un'opzione concreta con un costo fisso concreto, non una copertura gratuita.

Dove un livello di routing cambia l'aritmetica

DeepSeek V4 Pro è nel catalogo di OrcaRouter. Sia il checkpoint attuale sia la stringa del modello base si risolvono — deepseek/deepseek-v4-pro-0813 e deepseek/deepseek-v4-pro — alle tariffe di listino fuori picco con il moltiplicatore di picco applicato secondo lo stesso orario UTC, una finestra di contesto di 1.048.576 token, un limite di output di 384.000 token e un tempo p50 al primo token di 3,56 secondi, come misurato sulla nostra pagina del modello. Il prezzo di listino del provider viene applicato con nessun ricarico aggiuntivo, il che in questo caso significa che il confine tra picco e fuori picco arriva sulla tua fattura nello stesso momento in cui arriva su quella di DeepSeek.

GPT-6 Sol non è una delle nostre tratte, quindi nulla di ciò che è qui costituisce un'affermazione sul suo prezzo tramite noi.

Screenshot of the OrcaRouter model page for DeepSeek V4 Pro (deepseek/deepseek-v4-pro), captured 23 September 2026, showing the model id, a 384K-token maximum output, a 1M-token context window, text-only input, Tools, JSON and Reasoning tags, an input price of $0.66 and an output price of $1.98 per million tokens, a p50 time to first token of 3.56 seconds, and both the /v1/chat/completions and /v1/responses endpoints.

La programmazione oraria è ciò che rende davvero utile avere un unico endpoint proprio in questo caso. Un carico di lavoro che può essere spostato vale il doppio di uno che non può esserlo, e spostarlo è una decisione di routing, non una migrazione — la stessa chiave, la stessa forma di richiesta, un'ora diversa o un modello diverso dietro di essa. Abbinare DeepSeek V4 Pro a DeepSeek V4.1 Flash su un unico endpoint è la versione più incisiva di quel concetto: il modello Flash è 4,4× più economico sull'input e 3,3× più economico sull'output rispetto alla tariffa off-peak di V4 Pro, sulla stessa finestra di contesto e nelle stesse finestre di picco, il che lo rende la destinazione naturale per il traffico che non ha affatto bisogno del modello più grande. Il failover automatico conta per lo stesso motivo di sempre — il tier economico su cui è costruita la vostra pipeline non dovrebbe essere un singolo punto di guasto.

La regola di decisione

• Lavoro batch e offline che può essere pianificato — DeepSeek V4 Pro, e pianificalo. Il 95% del calendario a $0,66 e $1,98, con i fine settimana completamente fuori picco, è la tariffa credibile più economica su questa bacheca di un fattore tre sull'input e cinque sull'output.

• Traffico interattivo sensibile alla latenza che ricade nelle finestre di picco — GPT-6 Sol. Una tariffa fissa di $2.00 e $10.00 è più costosa della tariffa fuori picco di DeepSeek e più economica di niente, ma è conoscibile in anticipo, e per due ore al giorno è la più economica delle due sull'output.

• I loop degli agenti con un prefisso ampio e stabile — fai i conti dei cache hit prima di scegliere. L'input con cache hit di DeepSeek è $0,022 fuori dalle ore di punta, cioè un nono di $0,20 di GPT-6 Sol, ma è anche la riga che DeepSeek ha aumentato di dodici volte nelle ore di punta. Il vantaggio è reale ed è condizionato all'orologio.

• Qualsiasi cosa regolamentata, o qualsiasi cosa di cui non puoi permetterti che venga reindirizzata — DeepSeek V4 Pro, self-hosted dal checkpoint MIT. Il ritiro di settembre è il caso di studio, ed è una ragione migliore per accettare il costo fisso rispetto a qualsiasi confronto per token.

• Qualsiasi cosa che richieda il top della gamma agentica — GPT-6 Sol. Dodici punti indice e trenta punti di Terminal-Bench non sono una differenza di arrotondamento, e i numeri dichiarati dal fornitore stesso di DeepSeek non colmano il divario.

La tariffa fissa e il listino orario sono entrambi modelli tariffari onesti. Rispondono semplicemente a domande diverse: uno ti dice quanto costa un token, l'altro ti dice quanto costa un token quando ti serve.

Confrontati in questo articolo3

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno