Una hero card generata intitolata 'DeepSeek V4 Pro vs Kimi K3' con un'icona tachimetro sulla sinistra etichettata 'DeepSeek V4 Pro' con badge '~81 tok/s · /bin/bash.66/.98' e un'icona cervello sulla destra etichettata 'Kimi K3' con badge 'Index 44 · .00/5.00', con un sottile divisore a pista da corsa tra di loro e il piè di pagina 'Velocità e prezzo rispetto a un limite di ragionamento'.
Guides & Insights

DeepSeek V4 Pro vs Kimi K3: velocità e prezzo contro un tetto di 44 punti nel ragionamento

Autore

Gideon Frost

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

DeepSeek V4 Pro e Kimi K3 sono le due ammiraglie del ragionamento a pesi aperti con una finestra da un milione di token, e la loro competizione si è assestata in una forma stabile ormai da un mese: Kimi K3 (il modello da 2,8T di parametri di Moonshot AI, rilasciato il 16 luglio 2026) è il leader in quanto a intelligenza, mentre DeepSeek V4 Pro (rilasciato il 13 agosto 2026) è il leader in velocità e prezzo. La novità è che la metà economica di quella coppia è stata quasi cancellata nella prima metà di settembre — Deep​Seek l'8 settembre ha avviato per V4 Pro un percorso di dismissione al 14 settembre, poi l'ha rinviato e infine, l'11, ha annullato del tutto la dismissione, impegnandosi a continuare a servire il modello con la stessa tariffazione. Questo, per questo confronto, conta più che per la maggior parte degli altri, perché "economico, veloce, contesto da 1M, pesi aperti" è una combinazione difficile da sostituire quando l'alternativa costa cinque volte tanto.

I dati indipendenti sono misurazioni di Artificial Analysis. I benchmark di lancio interni di DeepSeek e Moonshot sono etichettati come dichiarati dal fornitore, poiché nessuno dei due set è stato riprodotto in modo indipendente.

Kimi K3 vince l'indice; V4 Pro vince il conto

Il tabellone indipendente è inequivocabile su chi sia più intelligente. Kimi K3, al massimo sforzo, ottiene 44 sull'Artificial Analysis Intelligence Index, classificandosi #2 tra i modelli comparabili. DeepSeek V4 Pro ottiene 36, classificandosi #7 nella sua classe. Quel divario di nove punti è l'intera ragione per cui qualcuno paga i prezzi di Kimi K3. E i prezzi sono la ragione per cui il confronto non è deciso dall'indice da solo: Kimi K3 è listato a $3,00 per milione di token in input e $15,00 per milione di token in output, mentre V4 Pro è listato a $0,66/$1,98 fuori picco ($1,32/$3,96 in picco). Sull'output, si tratta di circa 7,5x — prima dello sconto cache. Le letture cache di V4 Pro costano circa $0,02 per milione di token fuori picco, uno sconto del 97%; lo sconto cache del 90% di Kimi K3 parte da una base molto più alta. Per un carico di lavoro ad alto consumo di token, il divario effettivo si allarga verso dieci volte.

• Indice di Intelligenza — Kimi K3 44 (#2/113) vs V4 Pro 36 (#7/113)

• Prezzo — Kimi K3 $3,00/$15,00 per 1M vs V4 Pro $0,66/$1,98 fuori picco ($1,32/$3,96 in picco)

• Velocità — V4 Pro ~81 token/sec vs Kimi K3 ~35 token/sec

• Contesto — entrambi 1M token

• Parametri — Kimi K3 2,8T totali / 104B attivi vs V4 Pro 1,6T totali / 49B attivi

• Pesi — entrambi aperti (Kimi K3 con pesi aperti, V4 Pro MIT)

• Input — Kimi K3 testo e immagine vs V4 Pro solo testo

La velocità è la parte che tutti sottovalutano.

Il divario di cui nessuno parla è il throughput. V4 Pro produce circa 81 token al secondo misurati indipendentemente; Kimi K3 arriva a circa 35. In un ciclo di esecuzione di un agente in cui il modello scrive diverse migliaia di token per step, questa è la differenza tra un'attività che termina in pochi minuti e una che si trascina per un intero pomeriggio — e la differenza di costo lo amplifica, perché paghi 15 $ per milione di token di output a circa la metà della velocità. Per assistenti di programmazione interattivi, l'elaborazione massiva di documenti e qualsiasi carico di lavoro in cui il tempo effettivo è una voce di budget, la combinazione di V4 Pro di una velocità 2,3 volte superiore a un settimo del prezzo di output è la risposta dominante.

Quando i nove punti valgono la pena

Il caso onesto a favore di Kimi K3 è il tetto del ragionamento. Il suo costo di valutazione sull'Intelligence Index è stato di circa $3.658 per l'esecuzione: il riflesso di catene di ragionamento davvero lunghe e costose, non una bizzarria del listino. Se il tuo carico di lavoro è il ragionamento complesso — dimostrazioni matematiche profonde, pianificazione a lungo termine, attività agentiche di più ore in cui nove punti indice in più si traducono in meno fallimenti — Kimi K3 vale il suo sovrapprezzo. Il caso onesto contro di esso è tutto il resto: il throughput, l'economia della cache, il puro e semplice prezzo per token.

L'altro motivo per cui l'inversione di settembre conta qui: un mese fa il consiglio sensato era «se intendi standardizzare sul modello aperto economico e veloce, prevedi un'alternativa: potrebbe essere ritirato». Dal 15 settembre quella copertura è obsoleta. DeepSeek si è impegnata pubblicamente, con la promessa di avvisare se qualcosa cambia, a mantenere V4 Pro sull'API, e la licenza MIT significa che il modello resta distribuibile sul tuo hardware indipendentemente da ciò che DeepSeek fa con la sua API. I pesi aperti di Kimi K3 offrono la stessa libertà dall'altra parte, ed è ciò che rende questo un vero confronto tra due modelli a pesi aperti invece che una lotta tra un servizio e un prodotto.

A screenshot of the DeepSeek API docs Models & Pricing page, captured September 15, 2026, showing the English-language pricing table for deepseek-v4-pro (DeepSeek-V4-Pro-0813) at .32 input and .96 output per million tokens at peak, and the footnote announcing that DeepSeek V4 Pro API service continues after September 14, 2026 with unchanged billing.

Entrambi i modelli sono su OrcaRouter — DeepSeek V4 Pro e Kimi K3 passano entrambi attraverso la piattaforma con un'unica chiave, con i prezzi di listino dei provider trasferiti senza alcun ricarico — e il DSL di routing è il modo naturale per dividere questa sfida: indirizza i compiti di ragionamento a lungo orizzonte a Kimi K3, dove i nove punti si ripagano, e indirizza il lavoro ad alto consumo di token a DeepSeek V4 Pro, dove il divario di prezzo di 7,5x e il divario di velocità di 2,3x fanno il lavoro per te. I due sono complementari tanto quanto sono concorrenti, e la piattaforma rende l'esecuzione di entrambi lo stesso lavoro dell'esecuzione di uno solo.

A screenshot of the OrcaRouter model page for deepseek/deepseek-v4-pro, captured September 15, 2026, showing the 1M token context window, 384K max output, a reasoning-mode toggle, the input price of /bin/bash.66 and output price of .98 per million tokens, and the model description reading 'DeepSeek V4 Pro flagship MoE — 1.6T total / 49B active params, 1M context'.A generated scoreboard titled 'DeepSeek V4 Pro vs Kimi K3 — the scoreboard': left column DeepSeek V4 Pro rows AA Index 36 (#7/113), Price /bin/bash.66/.98 off-peak, Speed ~81 tok/s, Context 1M, Active params 49B/1.6T, Weights MIT; right column Kimi K3 rows AA Index 44 (#2/113), Price .00/5.00, Speed ~35 tok/s, Context 1M, Active params 104B/2.8T, Weights open; footer 'AA figures independent; DeepSeek price is vendor list off-peak.'

La conclusione

Kimi K3 è il modello open-weights più intelligente, nove punti indice in vantaggio, e il suo sovrapprezzo — 7,5x sui token di output, circa la metà della velocità — è un costo reale, non un errore di arrotondamento. DeepSeek V4 Pro è il cavallo di battaglia veloce, economico e affidabile, e dopo l'11 settembre non è più un rischio di fuga. La risposta pratica è quella che indicano entrambe le colonne dei prezzi: se i tuoi compiti richiedono ragionamento complesso, acquista Kimi K3; se sono ad alto consumo di token e sensibili al tempo, acquista DeepSeek V4 Pro; e se ne hai di entrambi i tipi, usali entrambi e instrada in base al compito.

Confrontati in questo articolo1

Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno