Hero-kaart van het artikel met de tekst 'OpenAI o3 vs DeepSeek V4 Pro', met de badge 'MODELVERGELIJKING' en de ondertitel 'Het tijdperk van premium-redeneren eindigt waar de prijskloof zich opent', met een premium-tagpictogram links en een muntenpictogram rechts, met het OrcaRouter-logo rechtsonder.
Guides & Insights

OpenAI o3 vs DeepSeek V4 Pro: Het premium-redeneertijdperk eindigt waar de prijskloof opengaat.

Auteur

Magnus Corvin

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

De confrontatie tussen Ope​nAI o3 en DeepSeek V4 Pro is eigenlijk een botsing van twee getallen. Ope​nAI o3, uitgebracht op 16 april 2025, was het referentiepunt voor premium redeneren — het model waarvoor je extra betaalde wanneer de kosten van een fout antwoord hoger waren dan de kosten van de tokens. DeepSeek V4 Pro, dat op 13 augustus 2026 als build 0813 algemeen beschikbaar kwam na een stille avondrelease en een uitrol met een ingetrokken aankondiging en opnieuw geüploade gewichten, is het model dat die premium als een categoriefout deed overkomen: een onafhankelijke index die boven die van o3 staat, tegen ruwweg een vijfde van de prijs, met open gewichten bovenop. En de botsing is voorzien van een tijdstempel, want Ope​nAI o3 verlaat ChatGPT op 26 augustus 2026, de API-snapshots volgen op 11 december, en elke week van de vergelijking is in het voordeel van het model dat nergens heen gaat.

Twee filosofische modellen die een jaar na elkaar werden uitgebracht.

o3 is het vlaggenschip voor pure redenering: een gesloten model dat is getraind om lang na te denken voordat het antwoordt, met een contextvenster van 200K, maximaal 100K output, en beeldinvoer die in de chain of thought is verwerkt. Volgens de eigen cijfers van Ope​nAI zette het de lat voor 2025 — 96,7% op AIME 2024, 87,7% op GPQA Diamond, 69,1% op SWE-bench Verified zonder scaffolding, een Codeforces-Elo van 2727 — en Ope​nAI verlaagde later de prijs van $10/$40 naar $2/$8 per miljoen tokens, en daar ligt die nog steeds. DeepSeek V4 Pro is qua economie een heel ander verhaal: een mixture-of-experts-model met 1,6 biljoen parameters en ruwweg 49 miljard actieve parameters per token, een contextvenster van 1 miljoen tokens, maximaal 384K output, uitsluitend tekstinvoer, en — nieuw in de 0813 GA-build — een herbouwde post-trainingstack plus native integratie van de Responses-API en Codex, waardoor de agentscores op DeepSWE opsprongen van 12,8 in de preview naar 62,7. Het is ook open-weights: de DeepSeek-V4-Pro-0813-checkpoint is onder de MIT-licentie te downloaden op Hugging Face, na een chaotische eerste 24 uur waarin de releasebanner werd verwijderd en de weights kortstondig een 404-fout gaven, voordat een gecorrigeerde config opnieuw werd vermeld.

Het kostenverschil in reële cijfers

De tariefkaarten pleiten grotendeels voor zichzelf:

OpenAI o3 — $2.00 per miljoen input, $8.00 per miljoen output, $0.50 gecachte input. Redeneertokens worden als output gefactureerd, dus een moeilijke vraag verbruikt denktokens voordat het antwoord verschijnt.

• DeepSeek V4 Pro — $0,435 per miljoen input (cache miss), $0,003625 cache hit, $0,87 per miljoen output vandaag. Output is ongeveer 4,6× goedkoper dan o3, cache-hit input is praktisch gratis.

• Het voorbehoud met een datum erop — DeepSeek's geplande prijsverhoging van 17 augustus verschuift V4 Pro-output van 6 yuan naar 27 yuan per miljoen tijdens piekuren (13,5 buiten piek) en cache-miss-input van 3 naar 9 yuan. Zelfs tegen het nieuwe piektarief komt de output uit op een klein deel van o3's $8. Het venster om tegen het huidige tarief te bouwen wordt gemeten in dagen, wat op zichzelf deel uitmaakt van de migratiecalculus.

De prijs-per-correct-antwoord-economie verscherpt het punt. De verborgen redeneringstokens van o3 betekenen dat de werkelijke kosten per moeilijk antwoord een veelvoud zijn van het outputtarief. DeepSeek V4 Pro redeneert ook, en het denken wordt eveneens als output gefactureerd, maar tegen $0,87 is de absolute uitgave een afrondingsfout vergeleken met een o3-sessie die anderhalve minuut denkt. De agentkosten-framing die DeepSeek bij de lancering gebruikte — ruwweg een 45× prijskloof per taak ten opzichte van de gesloten frontier — overdrijft specifiek ten opzichte van o3, maar de richting staat niet ter discussie: dit is een 4–10× kloof in effectieve kosten, afhankelijk van de workload.

Waar de kwaliteitskloof daadwerkelijk ligt

De score die er het meest toe doet, is de onafhankelijke. Op de Intelligentie-index van Artificial Analysis scoort DeepSeek V4 Pro 53 en staat op #2 van de 104 modellen die de index momenteel vermeldt; o3 zit rond de 30 — een kloof van meer dan twintig punten op dezelfde testomgeving. Dat is de meest heldere samenvatting van waar twee jaar vooruitgang het premium-redeneringsvlaggenschip heeft gebracht: het wordt niet langer alleen onderboden op prijs; het wordt verslagen op de onafhankelijke totaalscore.

Het beeld per benchmark is rommeliger en verdient eerlijke labels. De belangrijkste agentcijfers van DeepSeek V4 Pro — Terminal-Bench 2.1 op 87,9, CyberGym op 83,3, DeepSWE op 62,7, AutomationBench voor op de gesloten frontier — zijn DeepSeeks eigen beweringen uit de 0813-lancering, die op dit moment nog niet onafhankelijk zijn gereproduceerd, en de verkeerde-configuratie-episode tijdens de uitrol betekent dat niemand er zeker van kan zijn dat de API de uiteindelijke gecorrigeerde gewichten bediende toen de vroege cijfers van derden werden verzameld. o3's lanceringsbenchmarks zijn eveneens door de leverancier gerapporteerd, maar werden in 2025 gedeeltelijk gevalideerd door onafhankelijke hertests, toen het model daadwerkelijk bovenaan de reasoning-ranglijsten stond. Op het gebied van wiskunde en pure reasoning ziet o3's gepubliceerde staat van dienst er nog steeds beter uit dan die van DeepSeek V4 Pro — DeepSeeks sterke punten zijn agentisch toolgebruik, coderen en langetermijntaken, wat een andere testsuite is dan de wiskundeolympiades die o3 domineerde.

A two-column scoreboard for OpenAI o3 vs DeepSeek V4 Pro: left column o3 shows $2/$8 pricing, 200K context, closed weights, Artificial Analysis Index around 30, math-and-reasoning strength, retiring August 26 2026; right column DeepSeek V4 Pro shows $0.44/$0.87 pricing today, 1M context, MIT open weights, Artificial Analysis Index 53 (#2 of 104), agentic-and-coding strength, GA August 13 2026. Footer: o3 figures partly independent; DeepSeek agent benchmarks vendor-reported. OrcaRouter logo bottom-right.

Wat o3 nog steeds beter doet

Twee zaken blijven overeind bij deze vergelijking. Ten eerste wiskunde en zorgvuldig redeneren: de AIME 96,7% en GPQA 87,7% van o3 blijven boven alles liggen wat DeepSeek V4 Pro heeft gepubliceerd, en als je werklast een moeilijk bewijs of een wedstrijdprobleem is, is o3 — zolang het nog draait — het veiligere antwoord. Ten tweede beeldredenering: o3 kan binnen zijn gedachteketen nadenken over een screenshot of diagram, en DeepSeek V4 Pro is uitsluitend tekstueel; de 0813-build voegde geen vision-encoder toe, en als je taak vereist dat het model een afbeelding leest, is DeepSeek V4 Pro op dat vlak geen vervanging voor o3. Geen van beide voordelen is een reden om op een model te blijven dat wordt uitgefaseerd, maar beide zijn redenen om er eerlijk over te zijn dat de migratie geen pure upgrade is.

Het andere punt dat het vermelden waard is, is het verschil in open gewichten, wat helemaal geen benchmark is. o3 was gesloten en wordt nu uitgefaseerd totdat het verdwijnt; je kunt het niet op je eigen hardware blijven draaien. De 0813-checkpoint van DeepSeek V4 Pro is van jou, permanent, onder MIT-licentie — dezelfde gewichten, hetzelfde model met 1,6 biljoen parameters, zelf te hosten als je ongeveer 1,5 terabyte aan hardware ervoor hebt. Voor teams die zijn verbrand door afhankelijk te zijn van een gesloten model dat een leverancier kon pensioneren, is dat een structureel antwoord op het exacte probleem dat de pensionering van o3 stelt.

De workload migreren

Voor het API-team dat overstapt van o3, is DeepSeek V4 Pro de goedkoopste bestemming en voor het agentische en codeerwerk waar het meeste API-gebruik feitelijk uit bestaat, is het zelden een downgrade. De echte valkuilen zijn operationeel, niet kwalitatief: V4 Pro is beperkt tot 500 gelijktijdige verzoeken op de officiële API, een plafond dat je met een agentenvloot zult bereiken, en de prijzen veranderen op 17 augustus. Dat zijn precies de dingen waar een routinglaag voor is.

Op OrcaRouter wordt DeepSeek V4 Pro aangeboden tegen de lijstprijs van de provider, doorberekend met 0% opslag — dus de huidige $0.44/$0.87 is hier live op dezelfde dag dat hij bij DeepSeek live is, en wanneer het piek/dal-schema van 17 augustus ingaat, wordt dat hier ook dezelfde dag weerspiegeld. Eén sleutel bereikt ook de rest van dit o3-vervangende cohort, en automatische failover is het eenvoudige antwoord op de limiet van 500 gelijktijdige verbindingen: wijs een productiepad toe aan V4 Pro plus een tweede model op dezelfde sleutel, en laat de router het plafond opvangen. Open​AI o3 zelf zit niet op die sleutel — het blijft beschikbaar via Open​AI's eigen API en verschillende platforms van derden tot de afsluitdatum van de snapshot op 11 december.

Screenshot of the Artificial Analysis model page for o3 showing its rank of #107/182 on the Intelligence Index, a score of 31 (below the median of 35), a 200K-token context window, $2.00 per 1M input and $8.00 per 1M output pricing, and a 118 tokens-per-second speed reading.

Wie de wiskunde begunstigt

Voor iedereen wiens o3-werklast uit coderen, agentloops of langetermijncontextverwerking bestaat, is de rekensom niet eens in de buurt: DeepSeek V4 Pro verslaat o3 op de onafhankelijke index, kost een fractie van het geld, en de open gewichten betekenen dat deze specifieke afhankelijkheid niet onder je vandaan kan worden getrokken. De teams die een gegronde reden hebben om o3 voorlopig in leven te houden, zijn de niches — zuivere wiskunderedenering en alles dat is gebouwd op o3's beelddenken — en zelfs die zouden vóór december vervangers moeten testen tegen echte workloads, want de deadline geeft niets om jouw randgeval. Het premium-redeneringstijdperk dat o3 definieerde, eindigde met de aankondiging van zijn stopzetting; DeepSeek V4 Pro is toevallig precies de plek waar de goedkoopste zitplaats in het volgende tijdperk is.

Screenshot of the OrcaRouter model page for deepseek/deepseek-v4-pro showing a 1M-token context window, 384K max output, $0.44 per 1M input and $0.88 per 1M output tokens, and Tools/JSON/Reasoning capability chips.

Vergeleken in dit artikel1

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt

© 2026 OrcaRouter

Voor aanbieders

Beheer je een inferentieplatform? Zet je modellen op OrcaRouter.

providers@orcarouter.ai

Word lid van de community

Discordsupport@orcarouter.aiXGitHubYouTube