Een titelkaart voor DSH (DeepSeek Code Harness) met daarop 'DSH - DeepSeek Code Harness' met de ondertitel 'De Claude Code-concurrent - openbare bèta gepland voor 13 augustus' en drie chips: Claude Code-concurrent, Plugin-ecosysteem, Native V4-harness.
Guides & Insights

DSH-releasedatum: DeepSeeks Claude Code-concurrent is live — wat dit betekent voor V4 Flash en V4 Pro

Auteur

Rowan Sterling

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Terwijl D​eepSeek V4 Flash en D​eepSeek V4 Pro nog steeds de twee meest recente dingen waren die D​eepSeek had uitgebracht, zette de meest gevolgde D​eepSeek-watcher op X een klok op de volgende. "Realistisch gezien verschijnt DSH over ≈7-9 uur," postte de pseudonieme AI-ontwikkelaar teortaxesTex, "Ik voorspel dat dit de laatste twee releases in een nieuwe context zal plaatsen. Genoeg oorlogsmist, we zullen zien hoe het native zou moeten presteren." De klok liep vanavond af. Een interne bètagroep vertelde het X-account op7418 dat de release "rond 20:25" Peking-tijd zou verschijnen; uiteindelijk ging de D​eepSeek Harness developer preview dezelfde avond live — IT之家 meldde het om 20:52, met verdere berichtgeving in het uur daarna. De harness van D​eepSeek, zijn eigen antwoord op Claude Code, is nu openbaar: v0.1, MIT-licentie, open op GitHub, en uitvoerbaar met één npm-commando.

Waarom de datum ertoe deed, is het interessante deel, en waarom de release meer waard is dan een korte vermelding bij de lancering. De officiële DeepSeek V4 Pro-build (DeepSeek-V4-Pro-0813) verscheen in hetzelfde tijdsvenster op de DeepSeek API, en DeepSeek V4 Flash werd twee weken eerder officieel. Beide leverden agentische benchmarkscores op die DeepSeek binnen zijn eigen harness genereerde — de V4 Flash API-documentatie zegt dat expliciet, tot en met de naam: "DeepSeek Harness minimal mode." DSH is de volledige versie van die harness die nu openbaar wordt, wat betekent dat de cijfers achter de laatste twee releases nu reproduceerbaar zijn voor iedereen die ze wil draaien. Geen van de lekken die hiernaartoe leidden, is door DeepSeek formeel als document bevestigd, maar het eindresultaat is geen lek meer: de developer preview is uit. Wat nog niet openbaar is, is een prijslijst — DeepSeek heeft niets gezegd over wat de harness zelf zal kosten.

De voorspelling die de klok gelijkzette.

teortaxesTex is geen medewerker van DeepSeek en beweert dat ook niet te zijn. De accountbio beschrijft een zelfbenoemde "DeepSeek-cheerleader sinds 2023," en het publieke beeld is geïnformeerde speculatie met een sterke reeks goed geplaatste gokken — voorspellingsmarktinzetten op de architectuur van DeepSeek V4, een vroege voorspelling dat DeepSeek-V4.1 meerdere keren meer reinforcement-learning-rekenkracht zou krijgen dan concurrenten, en een reeks release-analyses die de community op de voet volgt. Behandel de originele tweet als wat het was: een goed geïnformeerde voorspelling, geen bevestiging.

De voorspelling bestond uit twee delen. Het eerste was de timing: "valt over ≈7-9 uur", wat uitkwam op de nacht van 12–13 augustus Peking-tijd — hetzelfde venster waarin de DeepSeek-V4-Pro-0813-build in de DeepSeek API-documentatie verscheen. Die klopte. De inschatting "rond 20:25" van de interne bètagroep en de daadwerkelijke release (~20:52) vielen beide binnen dat venster; het lek zat er ongeveer een half uur naast, niet een dag. Het tweede deel was het beladen woord "recontextualiseren", dat alleen betekenis krijgt als je weet hoe DeepSeek zijn eigen laatste twee releases heeft gebenchmarkt. Dat deel van de weddenschap is nu testbaar, en dat is het hele punt van de release.

Wat DSH eigenlijk is

DeepSeek's interne formule, openlijk bevestigd door senioronderzoeker Chen Deli, is "{{1}}Model + Harnas = Agent{{/1}}". Het harnas is de volledige engineeringlaag buiten het model die een taalmodel verandert in iets dat werk gedaan krijgt: context- en geheugenbeheer, toolaanroepen, taakplanning, bestanden lezen en schrijven, terminaluitvoering, fouten terugvoeren in de lus, en beoordelen wanneer een taak daadwerkelijk is afgerond. DeepSeek's vacatures omschrijven het doel als het omzetten van "{{2}}frontiermodelcapaciteiten in toonaangevende agentproducten{{/2}}" — en het expliciete doelwit, in Chen Deli's eigen woorden, is Claude Code.

Het product is ook een antwoord op een communityproject. Een door fans gemaakte terminalagent genaamd DeepSeek-TUI, gebouwd in Rust en gekscherend tot 'DeepSeeks versie van Claude Code' gedoopt, ging eerder dit jaar viraal op GitHub; de officiële tool herovert dat terminaltoegangspunt.

Wat de leak-trail als gerucht omschreef, is nu in de release. De v0.1-ontwikkelaarspreview, open-source gemaakt onder de MIT-licentie op github.com/deepseek-ai/deepseek-harness, is een desktop- en CLI-agentruntime in de Node.js-pakketnaamruimte — "npx @deepseek-ai/dsh web" start een web-GUI op 127.0.0.1:3080 — gebouwd op het Cordis-meta-framework, met het vermelde ontwerpprincipe "alles is een plugin." Modellen, tools, vaardigheden, sessies, sandboxes, opslag, de agentloop, planning en de UI zijn allemaal vervangbare Cordis-plugins. Vier agent-presets worden meegeleverd: Standard, PTC (het model schrijft TypeScript-programma's om toolcalls te koppelen), Minimal (een shell-tool plus een bestandseditor, de modus waarop de V4-benchmarks draaiden) en Creation. De vermelde teamleider, Cui Tianyi — afgestudeerd aan de Zhejiang-universiteit en negen jaar engineer bij Jane Street — wordt in die rol bevestigd, nadat hij op 2 augustus de wereldwijde oproep voor interne testers had uitgevaardigd. DeepSeeks eigen kanttekening: dit is een ontwikkelaarspreview en snelle iteratie kan breaking changes met zich meebrengen.

Het lekspoor dat eindigde op 13 augustus

Niets van het onderstaande spoor is formeel door DeepSeek bevestigd, maar het verslag leest nu als een tijdlijn die op de verwachte datum uitmondde.

• 26 mei 2026 — er wordt een officiële DeepSeek GitHub-organisatie opgericht, volgens het gelekte groepsdossier.

• Mei–juni — DeepSeek plaatst twee Beijing Harness-functies (een productmanager voor agent-harness en een research engineer); Chen Deli bevestigt de missie op sociale media.

• 6–7 juli — een WeChat-account voor het "DeepSeek Harness team", met een zwarte walvis als beeldmerk, wordt onder de Beijing-entiteit van DeepSeek geregistreerd en gecertificeerd.

• 31 juli — De officiële API-release van DeepSeek V4 Flash. De documentatie onthult dat de CodeAgent-benchmarkresultaten zijn geproduceerd met "DeepSeek Harness minimal mode", met de kwalificatie "(binnenkort beschikbaar)".

• 1 augustus — werving voor interne tests gericht op ontwikkelaars van open-source agent-harness-projecten; rapporten tellen ongeveer 700–960 kandidaten en 700+ kandidaat-repositories.

• 11 augustus — de laatste interne testbuild wordt uitgebracht, zodat plug-inontwikkelaars het compatibiliteitswerk kunnen afronden, volgens de gelekte screenshot van de bètagroep.

• 13 augustus — teortaxesTex zet de aftelling in gang; de interne bètagroep vertelt op7418 "rond 20:25"; de ontwikkelaarsvoorvertoning v0.1 gaat die avond live, gemeld om ~20:52 Pekingtijd en MIT-gelicenseerd op GitHub.

Het plugin-ecosysteem was een opmerkelijk onderdeel van het lek, en het is echt. Plugin-repositories dragen een #dsh-topic-tag (de GitHub-repo documenteert "dsh-plugin" voor vindbaarheid), en de npm-quickstart betekent dat elke Node-ontwikkelaar al bij de eerste start het plugin-oppervlak kan bereiken — een open-marktgok dat het raamwerk, niet alleen het model, een platform wordt.

A leak scoreboard for DSH listing six rows: Product DeepSeek Code Harness, Public beta Aug 13 (leaked), Plugins #dsh ecosystem opening, Targets Claude Code and Codex, Pricing not announced, Official word none yet, with a footer reading 'All leak-level; nothing confirmed by DeepSeek.'

Waarom "de laatste twee releases hercontextualiseren" de uitdrukking is om in de gaten te houden

De laatste twee V4-releases zijn agent-first-modellen. De officiële build van DeepSeek V4 Flash is een MoE met 284 miljard parameters, waarvan 13 miljard actief, een context van 1M tokens en een headline-score van 82,7 op Terminal-Bench 2.1 — een cijfer dat DeepSeek rapporteerde en genereerde in "DeepSeek Harness minimal mode." De officiële build van DeepSeek V4 Pro is een MoE met 1,6 biljoen parameters, waarvan 49 miljard actief, en de agentic-scorecard (DeepSWE 62,7, Terminal-Bench 2.1 87,9, CyberGym 83,3) is eveneens door DeepSeek gerapporteerd en, op het moment van schrijven, nog niet door een onafhankelijk lab gereproduceerd.

DSH is de harness waarop die cijfers zijn geproduceerd, nu openbaar. Dat is wat 'we zullen zien hoe het native zou moeten presteren' betekende — niet via Claude Code, niet via een harness van een derde partij, niet via een benchmarkharness, maar via DeepSeek's eigen stack, end-to-end. De reproductietest is niet langer hypothetisch: iedereen kan de preview installeren en dezelfde agenttaken uitvoeren die de leverancier draaide. Als de native cijfers worden gereproduceerd, vormen de laatste twee releases een samenhangend verhaal — de goedkoopste serieuze agentmodellen plus een capabele first-party harness, verkocht als één systeem. Doen ze dat niet, dan wordt de kloof tussen leveranciersbenchmarks die sceptici bij de lancering van V4 Flash al signaleerden, concreet en meetbaar. Hoe dan ook verandert het beeld.

De onafhankelijke lezing is tot dusver niet hetzelfde verhaal. Artificial Analysis heeft de V4 Pro 0813-build al op zijn leaderboard geplaatst met een score van 53 op zijn Intelligence Index — boven de mediaan van 27, en een werkelijk onafhankelijk datapunt, maar mijlenver verwijderd van een kop als 'frontier op elk vlak'. De kloof tussen DeepSeeks zelfgerapporteerde agentcijfers en de evaluatie door derden is precies de kloof die DSH nu oplosbaar maakt.

The Artificial Analysis model page for DeepSeek V4 Pro 0813 (Reasoning, Max Effort) showing an Intelligence Index of 53 against a median of 27, input price $0.435 and output price $0.87 per 1M tokens, a $0.004 cache-hit price, a 1M-token context window, 1600B total / 49B active parameters, and open weights.

Er is ook een strategische reden waarom het harnas belangrijker is dan het model. Een volwassen harnas sluit de lus van startpunt tot voltooide taak en genereert daarbij taaktrajectgegevens die de volgende ronde modeltraining voeden — een analyse die CITIC Securities publiceerde toen de Harness-werving openbaar werd. DeepSeeks modellen zijn de goedkoopste serieuze agents op de markt; het harnas is waar de gracht en de prijsmacht zich bevinden. Een betaalde first-party agentstack is een heel ander bedrijf dan een open-weights API.

Je hebt nog steeds geen DSH nodig om de V4-modellen te draaien.

DSH is nu live, maar het is een first-party optie, geen vereiste. DeepSeek biedt al Anthropic-compatibele en OpenAI-compatibele endpoints voor zijn modellen, en daarom draaien DeepSeek V4 Flash en DeepSeek V4 Pro al binnen Claude Code en de rest van de huidige agent-tooling — zonder dat er een harness nodig is.

Beide modellen zijn ook beschikbaar op OrcaRouter tegen de eigen lijstprijs van DeepSeek — deepseek/deepseek-v4-flash-0731 voor ongeveer $0,15 per miljoen invoertokens en $0,29 per miljoen uitvoertokens, en deepseek/deepseek-v4-pro voor ongeveer $0,44/$0,88 — doorgegeven met 0% opslag. Dat is om twee redenen belangrijk. Ten eerste heeft DeepSeek begin augustus aangekondigd dat er een aanzienlijke prijsverhoging voor de hele V4-serie aankomt; omdat je de lijstprijs betaalt, is het nieuwe tarief bij ons op dezelfde dag actief als het uitkomt, zonder heronderhandeling. Ten tweede is het routeringsidee waar DSH om is gebouwd — werk heen en weer sturen tussen de goedkope V4 Flash en de vlaggenschip V4 Pro om kosten te beheersen — precies wat een routeringslaag over leveranciers heen met één sleutel doet, met automatische failover erbovenop, zodat je echt verkeer naar een nieuwe V4-build kunt sturen terwijl de testomgeving en de nog niet gereproduceerde benchmarks worden gevalideerd.

The OrcaRouter model page for deepseek/deepseek-v4-pro showing the Flagship badge, roughly $0.44 input / $0.88 output per 1M tokens, a 1M-token context window, 384K max output, and 1.6T total / 49B active parameters, with OpenAI-compatible code samples.

Wat moet je controleren nu DSH live is

Nu de preview is verschenen, zijn dit de vijf dingen die bepalen of DSH iets voor jou verandert:

• De reproductietest — installeer de preview en voer de agenttaken van V4 Flash en V4 Pro native uit, en vergelijk ze vervolgens met de door DeepSeek gepubliceerde cijfers van 82.7 / 87.9. Dit is de hele 'recontextualiseren'-gok, en die is nu uitvoerbaar.

• De overstapbeslissing — verslaat DSH het draaien van dezelfde modellen binnen Claude Code vandaag de dag? Een first-party harness moet op meer dan alleen prijs winnen om het verplaatsen van een werkende opzet te rechtvaardigen.

Het plug-in-ecosysteem — het npm- en GitHub-aanbod is reëel, maar of #dsh-getagde plug-ins daadwerkelijk probleemloos overzetten, en of derden iets leveren dat de moeite waard is om te installeren, blijft een open vraag.

• De prijsstelling — de harness draait op echte tokens, interne testers rapporteren tokenmeting per taak, en DeepSeek heeft nog steeds niets gezegd over wat het product kost. Verwachting: een betaald product; de prijslijst is de laatste grote onbekende.

• De changelog — de officiële README en release notes op GitHub zijn nu de bron die telt, samen met de aangekondigde V4-prijsverhoging.

Kortom

DSH is de meest ingrijpende productmove die DeepSeek heeft gedaan sinds de V4-lijn zelf, en het is nu uit. Voor lezers is het praktische antwoord ongewijzigd: DeepSeek V4 Flash en DeepSeek V4 Pro zijn vandaag bruikbaar, via de endpoints die je al hebt, tegen prijzen die nog steeds de goedkoopste serieuze agentopties zijn — op OrcaRouter tegen de lijstprijs, zonder opslag. De harness is het ding om in de gaten te houden, niet vanwege de lancering maar vanwege wat het meetbaar maakt: de laatste twee releases krijgen eindelijk een eerlijke native run, en de kloof tussen vendor en onafhankelijke benchmarks sluit of wordt de toegangsprijs. De lekkende klok had gelijk over de datum en ongeveer het uur; wat nog bewijs nodig heeft is prijsstelling, reproductie van native scores, en of het plug-in-ecosysteem benen heeft. Laat onafhankelijke cijfers — niet de aftelling — bepalen of je een productie-agentstack naar de native harness verplaatst.

Vergeleken in dit artikel2

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt

© 2026 OrcaRouter

Voor aanbieders

Beheer je een inferentieplatform? Zet je modellen op OrcaRouter.

Neem contact op

Word lid van de community

DiscordEmailXGitHubYouTube