Een gegenereerde hero-kaart met de titel 'DeepSeek V4 Pro vs Kimi K3', met links een snelheidsmeter-pictogram met het label 'DeepSeek V4 Pro' en de badge '~81 tok/s · /bin/bash.66/.98', en rechts een brein-pictogram met het label 'Kimi K3' en de badge 'Index 44 · .00/5.00', met daartussen een subtiele scheidingslijn in de vorm van een racecircuit en onderaan de voettekst 'Snelheid en prijs tegen een redeneerplafond'.
Guides & Insights

DeepSeek V4 Pro vs Kimi K3: snelheid en prijs tegenover een redeneerplafond van 44 punten

Auteur

Gideon Frost

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

DeepSeek V4 Pro en Kimi K3 zijn de twee open-weights-vlaggenschepen voor redeneren met een contextvenster van een miljoen tokens, en hun concurrentiestrijd kreeg een maand geleden een stabiele vorm: Kimi K3 (Moonshot AI's model met 2,8 biljoen parameters, uitgebracht op 16 juli 2026) is de intelligentieleider, en DeepSeek V4 Pro (uitgebracht op 13 augustus 2026) is de leider op het gebied van snelheid en prijs. Wat nieuw is, is dat de goedkope helft van dat duo in de eerste helft van september bijna werd geschrapt — DeepSeek zette V4 Pro op de 8e op een uitfaseringspad voor 14 september, stelde dat uit en annuleerde op de 11e de uitfasering ronduit, met de toezegging het model tegen ongewijzigde tarieven te blijven aanbieden. Dat is voor deze confrontatie belangrijker dan voor de meeste, want "goedkoop, snel, 1M context, open weights" is een combinatie die moeilijk te vervangen is wanneer het alternatief vijf keer zoveel kost.

Onafhankelijke cijfers zijn metingen van Artificial Analysis. De eigen launchbenchmarks van Deep​Seek en Moonshot worden aangeduid als door de leverancier gerapporteerd, omdat geen van beide onafhankelijk is gereproduceerd.

Kimi K3 wint de index; V4 Pro wint de rekening

Het onafhankelijke scorebord is ondubbelzinnig over wie slimmer is. Kimi K3 scoort 44 op de Artificial Analysis Intelligence Index bij maximale inspanning, gerangschikt als #2 onder vergelijkbare modellen. DeepSeek V4 Pro scoort 36, gerangschikt als #7 in zijn klasse. Dat verschil van negen punten is de hele reden dat men de prijzen van Kimi K3 betaalt. En de prijzen zijn de reden dat de wedstrijd niet alleen door de index wordt beslecht: Kimi K3 staat genoteerd tegen $3,00 per miljoen input- en $15,00 per miljoen outputtokens, terwijl V4 Pro genoteerd staat tegen $0,66/$1,98 buiten de piek ($1,32/$3,96 piek). Op output is dat ongeveer 7,5x — vóór de cachekorting. Het lezen van de cache van V4 Pro kost ongeveer $0,02 per miljoen tokens buiten de piek, een korting van 97%; de 90% cachekorting van Kimi K3 begint vanaf een veel hogere basis. Voor een tokenintensieve workload verbreedt het effectieve verschil zich richting tien keer.

• Intelligentie-index — Kimi K3 44 (#2/113) vs V4 Pro 36 (#7/113)

• Prijs — Kimi K3 $3,00/$15,00 per 1 mln. vs V4 Pro $0,66/$1,98 buiten de piek ($1,32/$3,96 piek)

• Snelheid — V4 Pro ~81 tokens/sec vs Kimi K3 ~35 tokens/sec

• Context — beide 1M tokens

• Parameters — Kimi K3 2,8T totaal / 104B actief vs V4 Pro 1,6T totaal / 49B actief

• Gewichten — beide open (Kimi K3 open gewichten, V4 Pro MIT)

• Invoer — Kimi K3 tekst en afbeelding versus V4 Pro alleen tekst

Snelheid is het onderdeel dat iedereen onderschat.

Het gat waar niemand over praat is doorvoer. V4 Pro genereert ongeveer 81 tokens per seconde, onafhankelijk gemeten; Kimi K3 haalt ongeveer 35. In een agent-lus waarin het model duizenden tokens per stap schrijft, is dat het verschil tussen een taak die binnen enkele minuten klaar is en een die zich over een middag voortsleept — en het kostenverschil versterkt dat, want je betaalt $15 per miljoen outputtokens tegen ongeveer de helft van de snelheid. Voor interactieve codeerassistenten, bulkdocumentverwerking en elke werklast waarbij kloktijd een budgetpost is, is de combinatie van V4 Pro van 2,3x snelheid tegen een zevende van de outputprijs het dominante antwoord.

Wanneer de negen punten het waard zijn

Het eerlijke argument voor Kimi K3 is het plafond van het redeneervermogen. De evaluatiekosten op de Intelligence Index bedroegen ongeveer $3.658 voor de run — een weerspiegeling van werkelijk lange en dure redeneerketens, niet een eigenaardigheid van de prijsstelling. Als je werklast zwaar redeneerwerk is — diepgaand wiskundig bewijs, planning op lange termijn, agentische taken van meerdere uren waarin negen extra indexpunten zich vertalen in minder fouten — dan verdient Kimi K3 zijn meerprijs. Het eerlijke argument ertegen is al het overige: de doorvoer, de cache-economie, de enorme prijs per token.

De andere reden waarom de ommekeer van september hier van belang is: een maand geleden was het verstandige advies "als je van plan bent te standaardiseren op het goedkope, snelle open model, dek je dan in — het kan worden uitgefaseerd." Sinds 15 september is die indekking achterhaald. Deep​Seek heeft publiekelijk toegezegd V4 Pro op de API te houden, met de belofte van een kennisgeving als er iets verandert, en de MIT-licentie betekent dat het model inzetbaar blijft op je eigen hardware, ongeacht wat Deep​Seek met zijn API doet. De open weights van Kimi K3 geven dezelfde vrijheid aan de andere kant, wat dit tot een echte vergelijking tussen twee modellen met open weights maakt in plaats van een strijd tussen een dienst en een product.

A screenshot of the DeepSeek API docs Models & Pricing page, captured September 15, 2026, showing the English-language pricing table for deepseek-v4-pro (DeepSeek-V4-Pro-0813) at .32 input and .96 output per million tokens at peak, and the footnote announcing that DeepSeek V4 Pro API service continues after September 14, 2026 with unchanged billing.

Beide modellen staan op OrcaRouter — DeepSeek V4 Pro en Kimi K3 routeren allebei via het platform met één sleutel, waarbij de lijstprijzen van de aanbieders zonder opslag worden doorgegeven — en de routing-DSL is de natuurlijke manier om deze confrontatie op te splitsen: routeer de langetermijnredeneertaken naar Kimi K3, waar die negen punten zich terugverdienen, en routeer het tokenintensieve doorvoerwerk naar DeepSeek V4 Pro, waar het prijsverschil van 7,5x en het snelheidsverschil van 2,3x het werk voor je doen. De twee zijn even vaak complementair als concurrerend, en het platform maakt het draaien van beide evenveel werk als het draaien van één.

A screenshot of the OrcaRouter model page for deepseek/deepseek-v4-pro, captured September 15, 2026, showing the 1M token context window, 384K max output, a reasoning-mode toggle, the input price of /bin/bash.66 and output price of .98 per million tokens, and the model description reading 'DeepSeek V4 Pro flagship MoE — 1.6T total / 49B active params, 1M context'.A generated scoreboard titled 'DeepSeek V4 Pro vs Kimi K3 — the scoreboard': left column DeepSeek V4 Pro rows AA Index 36 (#7/113), Price /bin/bash.66/.98 off-peak, Speed ~81 tok/s, Context 1M, Active params 49B/1.6T, Weights MIT; right column Kimi K3 rows AA Index 44 (#2/113), Price .00/5.00, Speed ~35 tok/s, Context 1M, Active params 104B/2.8T, Weights open; footer 'AA figures independent; DeepSeek price is vendor list off-peak.'

De bottom line

Kimi K3 is het slimmer open-weights-model, negen indexpunten voor, en de meerprijs — 7,5x op outputtokens, ongeveer de helft van de snelheid — is een echte kostenpost, geen afrondingsfout. DeepSeek V4 Pro is het snelle, goedkope, betrouwbare werkpaard, en na 11 september is het geen vluchtrisico meer. Het praktische antwoord is het antwoord waar beide prijskolommen op wijzen: als je taken zwaar redeneerwerk zijn, koop Kimi K3; als ze tokenintensief en tijdsgevoelig zijn, koop DeepSeek V4 Pro; en als je beide soorten hebt, draai ze allebei en routeer op taak.

Vergeleken in dit artikel1

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt