
Grok 4.7 vs DeepSeek V4 Pro: De ene is nieuw, de andere wordt onder je vandaan verwisseld
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligentie76Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Een notitie die op 10 september 2026 is gepubliceerd, verandert waar deze vergelijking over gaat. "We faseren V4-Pro uit," staat er, en vanaf 04:00 UTC op 14 september 2026 wordt elke aanvraag naar de modelstring deepseek-v4-pro doorgestuurd naar DeepSeek-V4.1-Flash tegen V4.1-Flash-tarieven — een situatie die volgens het bericht voortduurt "totdat V4.1-Pro wordt gelanceerd." De modelstring antwoordt nog steeds. Het model erachter is niet het model dat je hebt gebenchmarkt. Dat maakt een head-to-head met Grok 4.7 — op 21 september 2026 door de leverancier uitgebracht, een dag voordat dit werd geschreven — tot een vergelijking met een vervaldatum aan één kant. Op basis van de bestaande cijfers is Grok 4.7 het sterkere model en DeepSeek V4 Pro het goedkopere. Op de vraag die daadwerkelijk bepalend is voor een integratie, is slechts één ervan nog steeds wat het zegt te zijn.
Wat elk model is, vóór de scores
DeepSeek V4 Pro werd op 13 augustus 2026 algemeen beschikbaar als het DeepSeek-V4-Pro-0813-checkpoint, na een preview op 24 april. Het is open weights onder MIT — de licentie staat commercieel gebruik, wijziging en herdistributie toe zonder omzetdrempel of regionale uitzondering — met 1,7 biljoen totale parameters op de GA-modelkaart, een contextvenster van 1M tokens en een maximale uitvoer van 384K, het hoogste uitvoerplafond in deze vergelijking. Het is alleen tekst: DeepSeek's eigen prijzenpagina vermeldt dat vision niet wordt ondersteund op v4-pro, wat een echte beperking is voor wie er screenshots of pdf's in voert. Het biedt een instelbare reasoning-effort-regelaar op low, high en max, en het is beperkt tot 500 gelijktijdige verzoeken per account, met uitbreiding op aanvraag.
Grok 4.7 heeft gesloten gewichten en is een dag oud. Het heeft een context van 500k tokens — de helft van die van DeepSeek — accepteert tekst en afbeeldingen als invoer en heeft zijn eigen effort-regelaar. De catalogusprijs is $2,00 per miljoen inputtokens en $6,00 per miljoen outputtokens onder 200k prompttokens, en verdubbelt naar $4,00 en $12,00 op of boven die drempel, met gecachte reads tegen $0,50 en $1,00. xAI vermeldt ook een snellere variant met ongeveer tweemaal de outputsnelheid en tweemaal de prijs. Geen van beide leveranciers publiceert in de hier geraadpleegde documentatie een maximale outputwaarde voor Grok 4.7, dus beschouw die dimensie als onbekend in plaats van als gelijk.
Op de gedeelde index is de kloof scheef in één richting.
Beide modellen worden gescoord op de Artificial Analysis Intelligence Index v4.3.2, de revisie die op 19 september 2026 is gepubliceerd. De kolom van Grok 4.7 is gemeten bij xhigh effort; die van DeepSeek is het 0813-checkpoint bij max effort. Als je ze naast elkaar leest, onderschat het samengestelde verschil hoe verschillend deze twee modellen zijn opgebouwd.
• Samengesteld — Grok 4.7: 46 op de Artificial Analysis Intelligence Index v4.3.2. DeepSeek V4 Pro 0813: 36 op dezelfde revisie.
• Terminal-agents — Grok 4.7: Terminal-Bench 4.0 26. DeepSeek V4 Pro: 14. Bijna het dubbele, op de evaluatie die het dichtst bij autonoom softwarewerk komt.
• Automatisering — Grok 4.7: AutomationBench-AA 66%. DeepSeek V4 Pro: 57%. Beide geloofwaardig; Grok leidt met negen.
• Kennis en hallucinatie — Grok 4.7: AA-Omniscience 32. DeepSeek V4 Pro: 1. Dit is de uitschieter op het bord, en het is geen afrondingsartefact — de index meet zowel wat een model weet als hoe vaak het een antwoord verzint wanneer het dat niet weet.
• Lange context — Grok 4.7: AA-LCR v1.1 77%, venster 500k. DeepSeek V4 Pro: 80%, venster 1M. DeepSeeks enige duidelijke overwinning, en het is de as waarvoor zijn 1M-venster is gebouwd.
• Moeilijk redeneren — Grok 4.7: HLE 43, CritPt 18. DeepSeek V4 Pro: HLE 41, CritPt 18. Een gelijkspel op de natuurkundebenchmark en een voorsprong van twee punten voor Grok op HLE.
• Woordigheid — Grok 4.7: 240M outputtokens om de index te draaien, aangemerkt als ongewoon uitgebreid. DeepSeek V4 Pro: 163M. Beide zijn praatziek; Grok is nog praatzieker.

Het prijsverhaal is niet één getal, het is een schema
De prijsstelling van DeepSeek is het meest agressieve eraan, en het minst stabiel om te noemen. Het listtarief voor deepseek-v4-pro is $0,66 per miljoen inputtokens bij een cachemiss en $1,98 per miljoen outputtokens — tijdens daluren. Tijdens piekuren verdubbelen die naar $1,32 en $3,96. Piekuren zijn volgens DeepSeeks eigen documentatie 01:00–04:00 en 06:00–10:00 UTC van maandag tot en met vrijdag, met uitzondering van Chinese feestdagen; al het overige, inclusief volledige weekends, valt onder de daluren tegen exact de halve prijs. Het lezen van gecachte input is echt het paradepaardje: $0,022 tijdens daluren en $0,044 tijdens piekuren, dertig keer goedkoper dan een cachemiss, waardoor een goed gecachte DeepSeek-workload dramatisch veel goedkoper is dan het tarievenblad doet vermoeden.
Daartegenover lijken de $2,00 en $6,00 van Grok 4.7 duur — ongeveer 3x de input buiten piekuren van DeepSeek en 3x diens output buiten piekuren. Het verschil wordt kleiner op manieren die het weten waard zijn. De prijs van Grok 4.7 is vlak binnen zijn band in plaats van afhankelijk van de klok, dus een productiepiek om 09:00 UTC kost hetzelfde als een batch op zondagavond; die van DeepSeek niet. En boven 200k prompttokens verdubbelt Grok 4.7, waarmee het vier tot zes keer het tarief buiten piekuren van DeepSeek is in plaats van drie. Simpel gezegd: DeepSeek V4 Pro is op elk vlak het goedkopere model, en de grootte van de korting hangt ervan af wanneer je draait en hoe goed je cachet.
Wat 14 september veranderde
Dit is het deel dat het prijsargument moeilijker te verzilveren maakt. Vanaf 14 september 2026 stuurt DeepSeek verzoeken voor deepseek-v4-pro door naar DeepSeek-V4.1-Flash en factureert ze tegen Flash-tarieven — die nog lager zijn. De changelog en de prijzenpagina van DeepSeek vertellen een iets ander verhaal dan het nieuwsbericht van 10 september: de prijzentabel vermeldt deepseek-v4-pro nog steeds als een actieve regel met eigen tarieven en zonder beëindigingslabel, en de changelog-vermelding zegt dat de API-service voor V4 Pro na 14 september doorloopt met ongewijzigde facturering. Wat niet ter discussie staat, is de richting van de ontwikkeling. V4.1-Pro is bevestigd in ontwikkeling zonder aangekondigde datum, en V4.1-Flash — uitgebracht op 10 september — is volgens de eigen aankondiging van DeepSeek beter dan V4 Pro op "prestaties, kosten, snelheid en totale looptijd", een leveranciersclaim die niet onafhankelijk in die omvang is gereproduceerd.
Dus de praktische vraag is niet "Grok 4.7 of DeepSeek V4 Pro", maar "Grok 4.7 of welk DeepSeek-model die string volgend kwartaal ook blijkt te zijn." Als je V4 Pro in augustus hebt gebenchmarkt en je contextbudget hebt afgestemd op een venster van 1M met een uitvoerplafond van 384K, dan is het model dat je in november aanroept misschien niet het model dat je hebt gemeten — en de context- en uitvoerlimieten van de opvolger zijn niet de limieten waarop je je ontwerp hebt gebaseerd. Grok 4.7 heeft een tegengesteld risicoprofiel: een model van één dag oud waarvan de cijfers door de leverancier zijn gerapporteerd en grotendeels niet zijn gereproduceerd, maar waarvan de identiteit niet ter discussie staat.

Waar een router past, en waar niet
OrcaRouter biedt DeepSeek V4 Pro aan, en de modelpagina vermeldt het tegen het eigen tarief van de provider — $0,66 in en $1,98 uit met een contextvenster van 1M en een maximale output van 384k — omdat wij de lijstprijzen van providers doorgeven met 0% opslag. Dat is meer dan gebruikelijk van belang bij een leverancier wiens tarieven volgens een piek-/dalschema bewegen en wiens aankondiging van 10 september gepaard ging met een prijsverlaging: een prijswijziging van DeepSeek is dezelfde dag live op dezelfde sleutel, zonder vertraging bij het herprijzen en zonder tweede contract. Wanneer een leverancier een modelstring aan zijn kant omleidt, komt de wijziging binnen via hetzelfde endpoint in plaats van dat er aan jouw kant een herintegratie nodig is, en automatische failover voorkomt dat een rate limit of een capaciteitsincident aan de kant van de provider een storing wordt — handig wanneer één kant van je stack is beperkt tot 500 gelijktijdige verzoeken. Grok 4.7 staat op het moment van schrijven niet in de catalogus van OrcaRouter; om het aan te roepen, moet je via xAI's eigen API en de platformen van derden die het aanbieden.
De splitsing die dit suggereert is weinig glamoureus maar verdedigbaar: houd DeepSeek V4 Pro op de workloads waar cache-hit-prijzen en het venster van 1M het werk doen, en richt je verwachtingen op V4.1-Flash in plaats van op het augustus-checkpoint. Zet Grok 4.7 op de taken waar het model moet weten wat het niet weet — een AA-Omniscience-index van 1 is een luid signaal over de bereidheid van een model om met vertrouwen en onjuist te antwoorden, en geen enkel prijsvoordeel overleeft een downstreamconsument die een verzonnen antwoord vertrouwt.
De oproep
Grok 4.7 is hier het betere model, en dat is niet eens bijzonder nipt: een voorsprong van tien punten op de samengestelde score, het dubbele van de Terminal-Bench-score, een voorsprong op het gebied van automatisering, en een kloof in kenniseerlijkheid die breed genoeg is om een categorieverschil te vormen. DeepSeek V4 Pro is buiten de piekuren ongeveer 3x goedkoper en heeft een twee keer zo groot contextvenster, wat een echte en verdedigbare reden is om het te behouden — maar je koopt niet het model dat je hebt gebenchmarkt, je koopt een modelstring waarvan DeepSeek al heeft aangekondigd dat die opnieuw wordt gericht, tegen tarieven die per uur veranderen, onder een licentie en een set gewichten die zelfhosting tot een echte derde optie maken. Als de workload long-context, hoogvolume en cachebaar is, zijn de DeepSeek-economieën moeilijk te verslaan en moet je ontwerpen voor de opvolger in plaats van voor het checkpoint. Als het iets is waarbij fout zitten duur is, betaal dan de 3x en neem het model dat onzekerheid erkent.

Vergeleken in dit artikel2
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
