
GPT-6 Sol Pro vs DeepSeek V4 Pro: Een vast tarief tegenover een tijdschema
- openaiNIEUWOpenAI: GPT-6 Luna2026-09-2237Intelligentie
- openaiNIEUWOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- anthropicNIEUWAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- grokNIEUWGrok 4.72026-09-2146Intelligentie
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligentie76Coderen
GPT-6 Sol Pro en DeepSeek V4 Pro zijn op dit moment de twee goedkoopste geloofwaardige manieren om een serieuze reasoning-workload via een API te draaien, en ze zijn geprijsd volgens volledig verschillende principes. GPT-6 Sol — het model van de leverancier dat de configuratie gpt-6-sol-pro draait, algemeen beschikbaar sinds 22 september 2026 — kost $2,00 per miljoen inputtokens en $10,00 per miljoen outputtokens, op elk uur van elke dag. DeepSeek V4 Pro, het open-weights-vlaggenschip waarvan de 0813-checkpoint op 13 augustus 2026 algemeen beschikbaar kwam, kost $0,66 en $1,98 voor het grootste deel van de week en exact het dubbele daarvan voor twee smalle vensters op weekdagochtenden. Elke vergelijking die één tarief aanhaalt, citeert de helft van een prijs.
Het tijdschema is het verhaal. Al het andere aan deze match-up — de indexscores, de contextvensters, de licentievoorwaarden — vloeit voort uit het feit dat een van deze twee leveranciers heeft besloten dat zijn lijstprijs een functie van de klok is.
Wat elke prijsregel eigenlijk is
De tariefkaart van GPT-6 Sol bestaat uit één rij. Input $2,00, gecachte input $0,20, cache-write $2,50, output $10,00 per miljoen tokens, met een long-context herprijzing boven een inputdrempel die op het hele verzoek van toepassing is zodra deze wordt overschreden. Er is geen tijdsdimensie en geen promotievenster. OpenAI verlaagde de prijs van het voorgaande model op 22 september naar deze cijfers en noemde ze permanent.
De tariefkaart van DeepSeek is een tabel. Zoals te lezen op de eigen prijspagina van de leverancier:
• Invoer buiten piekuren — $ 0,66 per miljoen tokens, cachemiss; $ 0,022 per miljoen tokens, cachehit
• Uitvoer buiten piekuren — $1,98 per miljoen tokens
• Piek-invoer — $1,32 per miljoen tokens, cachemiss; $0,044 per miljoen tokens, cachehit
• Piekuitvoer — $3,96 per miljoen tokens
• Piekvensters — 01:00–04:00 en 06:00–10:00 UTC, maandag tot vrijdag, met uitzondering van Chinese officiële feestdagen
• Al het andere — daluren, inclusief het hele weekend, een regel die op 23 augustus 2026 om middernacht Pekingtijd van kracht werd
Zeven uur piek op een week van 168 uur, vijf van de zeven dagen, is ruwweg 21% van de kalender tegen het hogere tarief en 79% tegen het lagere. Dus de eerlijke samenvatting in één getal van DeepSeek V4 Pro is niet $0,66 en niet $1,32 — het ligt ergens daartussen, en waar dat ligt hangt af van de vorm van je verkeer, niet van de vrijgevigheid van de leverancier.
De prijsherziening waar deze tabel uit voortkwam
Het is de moeite waard om te weten hoe recent deze structuur is, want bijna elke vergelijkingspagina citeert nog steeds het getal dat deze verving. Op 22 mei 2026 zette DeepSeek een tijdelijke korting op V4 Pro om in een permanente prijs — een verlaging van ongeveer 75%, naar ongeveer $0,435 voor input en $0,87 voor output per miljoen tokens.
Op 17 augustus 2026 om middernacht Beijingtijd was dat teruggedraaid, en dan nog eens flink ook. Het piek-/dalsysteem ging van start met een gemiddelde stijging over de betrokken rijen van ongeveer 3,5 keer en een maximum van 12 keer — de 12× kwam precies uit op het inputtarief bij cache-hits, dat tijdens de piek van ¥0,025 naar ¥0,30 per miljoen tokens ging. Cache-miss-input steeg met ongeveer 200% en output met ongeveer 350%. Zes dagen later werd de weekenduitzondering toegevoegd, waardoor iedereen wiens batchtaken konden worden verplaatst een deel ervan terugkreeg.
Hieruit volgen twee consequenties. Ten eerste citeert elke pagina die je vertelt dat DeepSeek V4 Pro een model van minder dan een dollar is, een tariefkaart die al twee keer is achterhaald. Ten tweede is de vorm van de stijging een signaal over waarop DeepSeek optimaliseert: de grootste proportionele stijging zit bij cache-hits, en dat is precies het tarief dat het meest van belang is voor de workload — lange agent-loops die een stabiele prefix opnieuw verzenden — die het model in de eerste plaats aantrekkelijk maakte.

Het indexcijfer dat iedereen citeert, is buiten gebruik gesteld
Artificial Analysis is het neutrale testharnas voor deze vergelijking, en het heeft zijn Intelligence Index in de loop van 2026 meerdere keren van een nieuwe versie voorzien. Op de huidige ranglijst scoort GPT-6 Sol 48 bij maximale inspanning tegen $1,06 per indextaak. DeepSeek V4 Pro scoort, op checkpoint 0813 bij maximale inspanning, 36 tegen $0,67 per indextaak.
Het cijfer dat voor DeepSeek circuleert, is 53. Dat getal is echt en het is gepubliceerd — in een eerdere versie van de index, vóór een herversionering waardoor de scores van de meeste modellen verschoven. Een 53 uit een artikel van vóór v4.3 vergelijken met een huidige 48 is een buiten gebruik gestelde meting vergelijken met een actieve, en dat levert de meest voorkomende fout in deze confrontatie op: de bewering dat de twee modellen binnen één punt van elkaar liggen. Op de huidige index liggen ze twaalf punten uit elkaar, en het prijsverschil per voltooide taak is niet de 3× die de kopcijfers suggereren, maar dichter bij 1,6×, omdat DeepSeek meer tokens besteedt om tot zijn antwoord te komen.
Twee andere onafhankelijke datapunten horen daarnaast, beide gelabeld voor wat ze zijn. Vals AI, dat een geïsoleerde harness draait, plaatst DeepSeek V4 Pro op 96,40% op SWE-bench Verified tegen $0,103 per test — tweede op die ranglijst, na de 97,00% van Claude Opus 5, en per test met ruime marge goedkoop. De coding-agent-ranglijst van Artificial Analysis toont 14% op Terminal-Bench 4.0 tegenover 44% van GPT-6 Sol. Het eerste cijfer zegt dat DeepSeek concurrerend is voor één smalle, goed afgebakende coderingstaak. Het tweede zegt dat het niet concurrerend is op agentisch terminalwerk. Beide zijn waar en ze meten verschillende dingen.
Waar de twee modellen structureel van elkaar verschillen, niet alleen qua prijs.
• Licentie — GPT-6 Sol is een gesloten API zonder gewichten; DeepSeek V4 Pro is MIT-gelicenseerd met openbare checkpoints op Hugging Face, inclusief basisvarianten voor voortgezette pretraining.
Maximale output — GPT-6 Sol 128.000 tokens vs DeepSeek V4 Pro 384.000 tokens, drie keer het plafond tegen een vijfde van het outputtarief
• Contextvenster — GPT-6 Sol 1.050.000 tokens vs DeepSeek V4 Pro 1.048.576 tokens, vrijwel identiek
• Modaliteiten — zowel tekstinvoer als tekstuitvoer; geen van beide accepteert afbeeldingen in de API
• Prijsstelling voor lange context — GPT-6 Sol herprijst het hele verzoek zodra het zijn invoerdrempel overschrijdt; het piek-/daltariefschema van DeepSeek V4 Pro is de enige prijsstructuur die het heeft.
• Schaal — DeepSeek V4 Pro is een mixture-of-experts-model met 1,6 biljoen parameters en 49 miljard actieve parameters per token; OpenAI publiceert geen vergelijkbaar cijfer voor GPT-6 Sol
Eén opmerking over dat parameteraantal, want het is een veelvoorkomende bron van verwarring: het getal van 1,7 biljoen dat in sommige vermeldingen opduikt, is de Hugging Face-pakketgrootte met de optionele DSpark-module voor speculatieve decoding inbegrepen, niet een omvangrijker doelmodel. De gepubliceerde architectuur is in totaal 1,6T. Het aftrekken van de afgeronde badgewaarden om de grootte van de draft-module af te leiden is geen geldige berekening, en evenmin is het grotere getal te lezen als bewijs dat het model is gegroeid.

De terugtrekking die het echte argument voor open weights is
Op 9 september 2026 kondigde DeepSeek aan dat het V4 Pro aan het uitfaseren was, en dat vanaf 04:00 UTC op 14 september elk verzoek aan de modelstring deepseek-v4-pro zou worden doorgestuurd naar DeepSeek V4.1 Flash en gefactureerd tegen Flash-tarieven, en dat dit zou doorgaan totdat een V4.1 Pro-model werd uitgebracht. De modelstring zou nog steeds antwoorden. Het model erachter zou niet het model zijn dat iemand had gebenchmarkt.
Ontwikkelaars maakten bezwaar en de doorverwijzing werd ingetrokken. In het changelog van DeepSeek staat nu dat de V4 Pro API-dienst na 14 september wordt voortgezet met ongewijzigde facturering, en de prijstabel vermeldt deepseek-v4-pro nog steeds als een actieve rij met eigen tarieven en zonder uitfaseringslabel. De eerdere aankondigingspagina bevat nog steeds de routeringsformulering, dus de twee documenten spreken elkaar tegen — en de actieve prijspagina is degene die beschrijft wat er feitelijk gebeurt wanneer je het aanroept.
Dat voorval is het sterkste argument in deze hele confrontatie, en het is geen prijsargument. Een gesloten model kan op het schema van een leverancier opnieuw worden geprijsd, omgeleid of buiten gebruik worden gesteld, en het enige redmiddel is migreren. Een model met MIT-gewichten in een openbare repository kan vanaf je eigen infrastructuur worden geserveerd, wat betekent dat de checkpoint die je hebt geëvalueerd, de checkpoint is die je blijft serveren, ongeacht wat de roadmap van de leverancier zes weken later zegt. DeepSeek demonstreerde het risico en leverde de mitigatie in dezelfde twee weken.
Het eerlijke tegenwicht is dat het zelf hosten van een model met 1,6 biljoen parameters geen beslissing is die de meeste teams zomaar nemen. Het is een echte optie met reële vaste kosten, geen gratis hedge.
Waar een routeringslaag de rekening verandert
DeepSeek V4 Pro staat in de catalogus van OrcaRouter. Zowel de huidige checkpoint als de basismodel-string worden herkend — deepseek/deepseek-v4-pro-0813 en deepseek/deepseek-v4-pro — tegen de off-peak lijsttarieven, met de piekvermenigvuldiger toegepast volgens hetzelfde UTC-schema, een contextvenster van 1.048.576 tokens, een uitvoerlimiet van 384.000 tokens en een p50 time to first token van 3,56 seconden zoals gemeten op onze eigen modelpagina. De lijstprijsstelling van de provider wordt doorgegeven, zonder opslag bovenop, wat in dit geval betekent dat de piek-/off-peakgrens op hetzelfde moment op je factuur terechtkomt als bij DeepSeek.
GPT-6 Sol is geen van onze routes, dus niets hier is een bewering over de prijs ervan via ons.

Het schema is wat een enkel eindpunt hier specifiek de moeite waard maakt. Een werkbelasting die verschoven kan worden, is twee keer zoveel waard als een die dat niet kan, en het verschuiven ervan is een routeringsbeslissing, geen migratie — dezelfde sleutel, dezelfde aanvraagvorm, een ander uur of een ander model erachter. DeepSeek V4 Pro koppelen aan DeepSeek V4.1 Flash op één eindpunt is de scherpere versie daarvan: het Flash-model is 4,4× goedkoper op input en 3,3× goedkoper op output dan het off-peaktarief van V4 Pro, op hetzelfde contextvenster en dezelfde piekvensters, wat het de natuurlijke bestemming maakt voor het verkeer dat het grotere model helemaal niet nodig heeft. Automatische failover is om dezelfde reden belangrijk als altijd — de goedkope tier waarop je pipeline is gebouwd, mag geen single point of failure zijn.
De beslissingsregel
• Batch- en offlinewerk dat kan worden ingepland — DeepSeek V4 Pro, en plan het in. Vijfennegentig procent van de kalender tegen $0,66 en $1,98, waarbij weekends volledig in de daluren vallen, is met een factor drie op invoer en vijf op uitvoer het goedkoopste geloofwaardige tarief op dit overzicht.
• Latentiegevoelig interactief verkeer dat in de piekvensters terechtkomt — GPT-6 Sol. Een vast tarief van $2,00 en $10,00 is duurder dan het dalurentarief van DeepSeek en goedkoper dan niets, maar je kunt het vooraf weten, en gedurende twee uur per dag is het de goedkoopste van de twee wat output betreft.
• Agent-loops met een grote stabiele prefix — maak de rekensom van de cache-hits voordat je kiest. De cache-hit-input van DeepSeek kost $0,022 buiten de piek, een negende van de $0,20 van GPT-6 Sol, maar het is ook de regel die DeepSeek tijdens de piek twaalfvoudig verhoogde. Het voordeel is reëel en het hangt af van de klok.
• Alles wat onder regelgeving valt, of alles wat je je niet kunt veroorloven te laten omleiden — DeepSeek V4 Pro, zelf gehost vanaf het MIT-checkpoint. De terugtrekking in september is de casestudy, en het is een betere reden om de vaste kosten te accepteren dan welke vergelijking per token dan ook.
• Alles wat de top van het agentische bereik nodig heeft — GPT-6 Sol. Twaalf indexpunten en dertig punten op Terminal-Bench zijn geen afrondingsverschil, en de door DeepSeek zelf gerapporteerde cijfers dichten die niet.
Het vaste tarief en het tijdschema zijn beide eerlijke prijsmodellen. Ze beantwoorden gewoon verschillende vragen: de ene vertelt je wat een token kost, de andere vertelt je wat een token kost wanneer je het nodig hebt.
Vergeleken in dit artikel3
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
