
DeepSeek Harness vs Claude Code: il runtime per agenti open-source vs l'incumbent raffinato
- z-aiNUOVOZ.ai: GLM 5.32026-08-1860Intelligenza75Codice
- obsidianNUOVOQwen3.8 27B Uncensored (Aggressive)2026-08-1552Intelligenza68Codice
- qwenNUOVOQwen: Qwen3.8 27B (free)2026-08-1345 tok/s
- deepseekNUOVODeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligenza69Codice
- grokNUOVOSpaceXAI: Grok 4.62026-08-1261Intelligenza77Codice
- metaNUOVOMeta: Muse Spark 1.22026-08-0557Intelligenza72Codice
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligenza72Codice
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligenza69Codice
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M di token · 211 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligenza78Codice
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligenza69Codice
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligenza49Codice
- metaMeta: Muse Spark 1.12026-07-1653Intelligenza71Codice
- kimiMoonshotAI: Kimi K32026-07-1560Intelligenza76Codice
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligenza71Codice
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Intelligenza77Codice
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Intelligenza77Codice
- grokxAI: Grok 4.52026-07-0856Intelligenza72Codice
DeepSeek Harness non è un modello — è un runtime per agenti, e questa distinzione è il fulcro del confronto. Claude Code è l'agente di codifica rifinito e closed-source di Anthropic che funziona e basta nel tuo terminale. DeepSeek Harness (DSH) è un framework per agenti open-source (MIT) rilasciato da DeepSeek il 13 agosto 2026, e collega qualsiasi modello a strumenti, una sandbox terminale locale e un'interfaccia browser. Se vuoi un agente di codifica che puoi eseguire oggi senza pensarci, Claude Code vince. Se vuoi un runtime aperto e indipendente dal modello che puoi ricostruire, e puoi tollerare un'anteprima v0.1 grezza, DSH è la scommessa più interessante — e non richiede nemmeno i modelli DeepSeek.
I numeri del lancio dicono che la gente considera questa una vera rivalità: DSH ha raggiunto circa 50.000 stelle GitHub nelle prime 12 ore e circa 126.000 entro il 16 agosto (pagina del repository GitHub, consultata il 16 agosto 2026). È l'adozione più rapida mai registrata per un agent-runtime, ed è diretta proprio a Claude Code. Ma poiché DSH è un harness piuttosto che un modello, la domanda onesta non è "quale sia più intelligente" — è quale strato vuoi possedere: il prodotto già pronto, o la macchina che puoi smontare.
Che cos'è realmente DeepSeek Harness
La formula interna di DeepSeek, dichiarata pubblicamente, è Modello + Harness = Agente. Il modello è il cervello; l'harness è tutto ciò che lo fa funzionare come agente: gestione del contesto e della memoria, chiamata di strumenti, pianificazione delle attività, modifica di file, esecuzione da terminale, feedback sugli errori e valutazione di quando un'attività è completata. Claude Code abbina il modello di un unico fornitore con un'harness progettata su misura. DSH li scorpora — l'harness è un prodotto autonomo e il modello è un plugin sostituibile.
Quell'architettura è l'idea distintiva di DSH: "Tutto è un plugin." Costruito sul microkernel Cordis — di Cui Tianyi, autore dell'ecosistema chatbot Koishi ed ex ingegnere di Jane Street per nove anni — DSH tratta gli adapter dei modelli, gli strumenti, le skill, le sessioni, la sandbox, lo storage, le policy di approvazione, il loop dell'agente stesso e persino la propria UI come plugin sostituibili. Un'installazione predefinita carica oltre 100 plugin. Non esiste un core privilegiato da fare fork; si riconfigura invece.
DSH include quattro preset. Standard è l'agente di codifica completo. PTC (Programmatic Tool Calling) fa scrivere al modello TypeScript che raggruppa molte chiamate di strumenti in un unico programma deterministico, quindi i dati intermedi non passano mai attraverso il contesto del modello — un serio risparmio di token. Minimal espone solo una shell e un editor di file, per il benchmarking. Creation ti permette di creare i tuoi preset e plugin, in memoria, a runtime. Puoi avviare il tutto con code>npx @deepseek-ai/dsh web/code>, che apre una UI web locale su http://127.0.0.1:3080 — il browser è una shell; ogni sessione e log rimane sul tuo computer.
Tre funzionalità giustificano l'entusiasmo. In primo luogo, Trajectory: un registro di sessione append-only di tutto ciò che il modello ha visto — prompt di sistema, ragionamento, chiamate agli strumenti, pianificazione dei sub-agent — che puoi riprodurre, forkare e verificare come una scatola nera. In secondo luogo, supporto MCP sia lato client che lato server, quindi parla con lo stesso ecosistema di strumenti di Claude Code. In terzo luogo, oltre 40 provider di modelli, inclusi DeepSeek, Anthropic e OpenAI — puoi inserire i modelli Claude all'interno di DSH, oppure i modelli DeepSeek in strumenti compatibili con Claude Code, o qualsiasi altra cosa.
Funzionalità per funzionalità
La tabella seguente è l'istantanea onesta. I due strumenti concordano sugli aspetti principali (MCP, sub-agenti, cronologia delle sessioni, infrastruttura agnostica rispetto al modello a livello di protocollo) e differiscono sul livello che ti chiedono di gestire.

Le differenze che contano di più:
La questione del prezzo è cambiata il 16 agosto.
È sul costo che DSH avrebbe dovuto vincere a mani basse — e lo fa ancora per token, ma il divario si è appena ridotto. DeepSeek ha adottato per la sua API una tariffazione peak/off-peak, a partire dalle 16:00 UTC del 16 agosto 2026 (ore di punta 01:00–04:00 e 06:00–10:00 UTC; la fascia off-peak è la metà di quella di punta). Con la nuova tariffazione, l'output di DeepSeek V4 Flash costa $0,66 per milione di token in fascia off-peak e $1,32 in fascia di punta, in aumento rispetto ai precedenti $0,28; l'output di DeepSeek V4 Pro passa da $0,87 a $1,98 in off-peak e $3,96 in fascia di punta. La stessa documentazione API di DeepSeek elenca fianco a fianco le tariffe legacy e quelle nuove.

Rispetto alle tariffe API pubblicate da Anthropic — Claude Haiku 4.5 a $1 in / $5 out, Claude Sonnet 4.6 a $3 / $15, Claude Opus 4.8 a $5 / $25 per milione di token — DeepSeek V4 Pro è ancora circa 4–6 volte più economico per token anche al nuovo prezzo di picco in output, e DeepSeek V4 Flash è circa 10–20 volte più economico di Sonnet 4.6. L'input con cache-hit è quasi gratuito su entrambi i lati, il che è importante perché i loop degli agenti fanno un uso intensivo della cache. La direzione della guerra dei prezzi, però, si è invertita: DeepSeek ha aumentato i prezzi, mentre Anthropic ha tagliato o mantenuto le sue tariffe per agenti.
La contropartita è che Claude Code ha un prezzo basato su abbonamento. Pro costa 20 $ al mese, Max 5x costa 100 $ al mese, Max 20x costa 200 $ al mese, e l'uso interattivo nel terminale e nell'IDE è incluso in quell'abbonamento, invece della fatturazione API a gettone. Per un utente che lo usa intensamente ogni giorno, un abbonamento può costare meno del pagamento a token su qualsiasi modello — e DeepSeek Harness non ha abbonamento; è software gratuito, ma i token si pagano a consumo. L'efficienza dei token di DSH aiuta a colmare questo divario: un test pratico ha visto DSH ricostruire un sito web da una specifica e tracciare la propria crescita su GitHub per meno di tre yuan (~$0,40) di inferenza totale (DoNews, 14 agosto 2026), e la sua modalità PTC e la cache delle traiettorie sono esplicitamente progettate per ridurre il consumo di token per attività.
Com'è davvero correre, onestamente
La configurazione è davvero semplice una volta avviata: installa Node.js, esegui code>npx @deepseek-ai/dsh web/code>, inserisci una chiave API, scegli uno spazio di lavoro, scegli un preset — i recensori riferiscono di passare dall'installazione a un'attività completata in pochi minuti. L'ecosistema di plugin è reale, non una pagina del giorno del lancio: 288 repository di plugin sono comparsi sull'argomento dsh-plugin entro 24 ore, inclusi dsh-plan-execute (che instrada la pianificazione a un modello di ragionamento e l'esecuzione a uno più economico) e dsh-vision (aggiunge la visione ai modelli solo testuali).
Ora la parte che la copertura del giorno del lancio salta. DSH è grezzo in modi specifici e documentati:
Nessuna di queste è squalificante per uno smanettone con l'anteprima per sviluppatori. Sono squalificanti per un team di produzione.
Quando questa raccomandazione è sbagliata
La mia raccomandazione è: usa DSH oggi per valutazioni e progetti personali; non metterlo ancora davanti a un flusso di lavoro di produzione. Ed è qui che quel consiglio fallisce, e dovresti ignorarlo:
Come provare DSH oggi

DSH è gratuito da installare e l'intero loop richiede solo pochi minuti:
Poiché DSH accetta qualsiasi endpoint compatibile con OpenAI, puoi puntarlo alla singola API di OrcaRouter invece di gestire le chiavi dei vendor — DeepSeek V4 Flash 0731 e DeepSeek V4 Pro 0813 sono disponibili lì al prezzo di listino di DeepSeek senza alcun ricarico, e instradare V4 Flash per il volume e V4 Pro per i compiti complessi è un cambio di configurazione, non una migrazione. Questa è la configurazione che vale la pena testare: DSH davanti, un layer di routing dietro, e Claude Code mantenuto come fallback, così un intoppo della versione preview non ferma mai la tua giornata.
Il risultato finale
DeepSeek Harness è il primo serio sfidante open-source alla presa di Claude Code sul mercato degli agenti di coding — non perché sia un modello migliore (non è affatto un modello), ma perché cambia ciò che possiedi. Claude Code è un prodotto finito che noleggi; DSH è un kit di parti che ricostruisci. Oggi, questo significa che Claude Code è lo strumento giusto per la maggior parte delle persone, e DSH è quello da osservare, da smontare e da cui imparare. Tra tre mesi, se l'ecosistema dei plugin matura e la sandbox si irrobustisce, quel calcolo si ribalta. In questo momento la decisione è semplice: la fiducia per la produzione va a Claude Code; la curiosità e la proprietà vanno a DeepSeek Harness.
Confrontati in questo articolo1
Rilevato da questo articolo · Benchmark: Artificial Analysis · aggiornato ogni giorno
