
GPT-5.6 Sol API-prijzen: $4 / $20 per 1M tokens na de prijsverlaging
- openaiNIEUWOpenAI: GPT-6.1 Sol2026-09-2952Intelligentie
- anthropicNIEUWAnthropic: Claude Sonnet 5.52026-09-2856Intelligentie
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 150 tok/s
- OpenAINIEUWOpenAI: GPT-6 Luna2026-09-2238Intelligentie
- OpenAINIEUWOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- AnthropicNIEUWAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- xAIGrok 4.72026-09-2146Intelligentie
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 mln tokens · 127 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 1202 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens · 53 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 202 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 228 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
GPT-5.6 Sol kost $4,00 per miljoen invoertokens en $20,00 per miljoen uitvoertokens op de GPT-5.6 Sol API vanaf vandaag — hetzelfde doorberekeningstarief dat de vlaggenschip-tier op de OrcaRouter-directory heeft, gecontroleerd op 2026-08-25 zonder opslag. Op 24 augustus 2026 verlaagde OpenAI de API-prijs van Sol met 20% op invoer en ongeveer 33% op uitvoer, een tijdelijke promotie die ten minste tot 21 november 2026 duurt. Het is nog steeds de duurste tier in de GPT-5.6-familie, en het is de eerste tier waarvan de catalogusprijs is gewijzigd sinds de verlaging van 30 juli, die de vlaggenschip-tier oversloeg. De hefbomen zijn belangrijker dan de kop: hergebruikte invoer wordt via prompt-caching gefactureerd tegen $0,40 per miljoen, de batch-API daalt naar $2,00 / $10,00, en de snelle modus brengt een premie van 2x in rekening voor tot 2,5x snelheid. Deze pagina is de prijsreferentie specifiek voor Sol — de exacte tariefkaart, wat een verzoek werkelijk kost, hoe het vlaggenschip zich verhoudt tot de rest, wanneer het de verkeerde aankoop is, en hoe je het aanroept via één OpenAI-compatibel eindpunt met je eigen sleutel.
Prijzen zijn per miljoen tokens (invoer / uitvoer), per 2026-08-25. De prijsverlaging — 20% op invoer, ruwweg 33% op uitvoer, die ten minste tot 21 november 2026 loopt — is OpenAI's eigen aankondiging, tegen nominale waarde gerapporteerd; de dollarbedragen zijn afgelezen van OpenAI's gepubliceerde API-tarieven en geverifieerd aan de hand van de OrcaRouter-modelpagina voor GPT-5.6 Sol. Cache-, batch-, fast-mode- en long-context-tarieven zijn door OpenAI aangekondigd. Dit zijn promotietarieven, geen permanente reset — prijzen bewegen, en ze kunnen terug bewegen; verifieer voordat je bouwt.
De exacte prijs, vandaag geverifieerd
Hier is de volledige tariefkaart voor GPT-5.6 Sol, geverifieerd op 25-08-2026 tegen de promotietarieven. Dezelfde tarieven gelden voor verzoeken die gebruikmaken van het gpt-5.6-alias, en de prijsverlagingen worden uitgerold naar in aanmerking komende ChatGPT Work- en Codex-tegoedplannen; ChatGPT Pro-, Plus- en Business-abonnementen blijven ongewijzigd.

• Input — $4.00 per 1M tokens bij een cache miss (verlaagd van $5.00, 20% korting tot en met 21 november).
• Output — $20,00 per 1M tokens (verlaagd van $30,00, ~33% korting tot en met 21 november).
• Promptcache lezen — $0.40 per 1M tokens (was $0.50), een 90% korting op elke input die je opnieuw verzendt.
• Promptcache schrijven — $5,00 per 1M tokens (was $6,25).
• Long-context tier — inputs van meer dan ongeveer 272K tokens worden gefactureerd tegen $8.00 input / $30.00 output (was $10.00 / $45.00; dezelfde veelvouden van 2x voor input en 1,5x voor output zijn nu van toepassing op het lagere basistarief).
• Batch API — $2.00 invoer / $10.00 uitvoer, een vaste korting van 50% (was $2.50 / $15.00), asynchroon, doorgaans binnen ongeveer 24 uur klaar.
• Snelle modus — $8,00 invoer / $40,00 uitvoer (was $10,00 / $60,00), een 2x premie voor tot ongeveer 2,5x uitvoersnelheid zonder verandering in intelligentie.
• Contextvenster — ~1.05M tokens, tot 128K output.
OrcaRouter geeft het provider-tarief door zonder opslag, dus het bedrag op de directory is het bedrag dat u betaalt — en een prijsverlaging van de leverancier verschijnt op dezelfde dag op de vermelding waarop deze ingaat. Op de live-modelpagina toont de kaart $4,00 / $20,00 per 1M, cache-lezen $0,400, met Vision-, Tools-, JSON- en Reasoning-badges. Dit is de eerste keer dat de lijstprijs van Sol is gewijzigd sinds de verlaging van 30 juli, die GPT-5.6 Luna naar $0,20 / $1,20 bracht en GPT-5.6 Terra naar $2 / $12, terwijl het vlaggenschip standhield; de verlaging van 24 augustus is de beurt van het vlaggenschip.
De hefbomen die de effectieve prijs veranderen
Het basistarief is slechts het startpunt. Vier modificatoren bepalen wat Sol je daadwerkelijk kost:
• Prompt caching — hergebruikte context kost $0,40 per miljoen in plaats van $4 voor nieuwe context, en het wegschrijven naar de cache kost $5,00 per miljoen. Voor elke agent of chat die bij elke beurt een groot prefix opnieuw verzendt, is caching de grootste hefboom op de factuur. OpenAI koppelt de cache per project en API-sleutel, dus op één sleutel (één kanaal) blijven zorgt dat de cachetreffers blijven landen.
• Long-context-laag — een verzoek waarvan de invoer grofweg 272K tokens overschrijdt, gaat van het basistarief naar $8 / $30. Een paar enorme prompts kunnen stilletjes uw gemiddelde prijs verhogen, dus batch of truncate wanneer u de diepe context niet echt nodig heeft.
• Batch — OpenAI's batch-API draait taken asynchroon met een doorlooptijd van ongeveer 24 uur tegen exact de halve prijs: $2.00 / $10.00, met gecachte invoer voor $0.20 en cache-schrijfacties voor $2.50. Het is te combineren met prompt-caching en geschikt voor evals, bulkclassificatie en offline generatie waar latentie er niet toe doet.
• Snelle modus — $8 / $40 voor tot ~2,5x uitvoerdoorvoer, nuttig voor latentiegevoelig werk waarbij gebruikers wachten, zoals live codeerassistentie. Het factureert per token tegen 2x het standaardtarief, telt niet mee voor gekochte Scale Tier TPM-pakketten, en kan terugvallen op standaardverwerking als je boven de gedeelde snelheidslimiet uitkomt.
Wat een verzoek eigenlijk kost
Prijzen per token zijn abstract, dus hier zijn uitgewerkte voorbeelden tegen de huidige tarieven:
• Eén chatgesprek, 50K invoer + 20K uitvoer — $0.20 + $0.40 = $0.60 (was $0.85).
• 1M invoer + 1M uitvoer — $4 + $20 = $24 (was $35).
Agentische beurt, 200K gecachte context + 20K nieuwe invoer + 30K uitvoer — $0,08 + $0,08 + $0,60 = $0,76. Dezelfde beurt met een koude cache — 220K nieuwe invoer tegen $0,88 plus $0,60 uitvoer — komt in totaal op $1,48. Caching halveert het grofweg.
• Een maand van 10M tokens met een verdeling van 70% input / 30% output, waarbij 80% van de input uit de cache komt: 1,4M verse input ($5,60) + 5,6M gecached ($2,24) + 3M output ($60) ≈ $68. Zonder cache is dezelfde maand $88 — en dezelfde maand op GPT-5.6 Terra kost ongeveer $50, of ongeveer $5 op GPT-5.6 Luna. Dat ~14x verschil tussen Sol en Luna is de reden waarom tier-matching belangrijker is dan welk enkel tarief dan ook.
Twee kanttekeningen verhogen het effectieve tarief. Sol is een redeneermodel — interne redeneertokens worden gefactureerd als output tegen $20 per miljoen. Een moeilijke prompt met een hoge redeneerinspanning kan een groot deel van het outputbudget aan denken besteden, dus de effectieve outputkosten voor moeilijk werk liggen ruim boven een naïeve schatting. En OpenAI's tokenizer is bij sommige invoergegevens uitgebreider dan die van de vorige generatie, dus dezelfde tekst kan meer tokens kosten dan op GPT-5.5 het geval zou zijn. Stem de redeneerinspanning af op de taak, begrens de output waar je kunt, en meet het daadwerkelijke gebruik voordat je een factuur projecteert.
Hoe de prijsstelling van Sol zich verhoudt tot de rest van de markt

Afgezet tegen de gepubliceerde adviesprijzen op 2026-08-25 (Sol tegen het promotietarief). Persberichtgeving ziet de verlaging als een reactie op de prijsdruk van Anthropic en Chinese labs — dat is interpretatie van derden, geen verklaring van OpenAI.
• GPT-5.6 Terra — $2 / $12, de middelste laag na de prijsverlaging. Sol kost nu 2x meer op input en ~1,7x meer op output; Terra is de standaard wanneer je geen vlaggenschip-redenering nodig hebt.
• GPT-5.6 Luna — $0,20 / $1,20, de volumecategorie na de prijsverlaging. Een 20x invoerkloof met Sol; Luna is geprijsd voor het gemakkelijke merendeel van het verkeer.
• Claude Opus 5 — $5 / $25. Sol is nu op papier 20% goedkoper op zowel input als output, vergeleken met het evenaren van Opus 5 op input tegen de oude tarieven. De vergelijking was al gunstig voor Sol vóór de verlaging: deze blog mat eerder dat Sol ongeveer 34,5% minder tokens gebruikt dan een Anthropic-model op hetzelfde Engelse/gemengde sample, en een gepubliceerde token-economische analyse (TheBlockBeats) schatte dat Sol's totale rekening ongeveer 21% lager kan uitvallen dan Claude Opus 5 voor gelijkwaardig werk, zelfs toen Sol's outputtarief hoger was. Meet je eigen tokenizer, niet de stickerprijs.
• Claude Fable 5 — $10 / $50. Sol is nu 60% goedkoper op input en 60% goedkoper op output dan de topklasse van Anthropic (was 50% / 40% bij de oude tarieven).
• Claude Opus 4.8 — $5 / $25. Sol is nu 20% goedkoper op invoer en 20% goedkoper op uitvoer — het stickerprijsvoordeel ten opzichte van het vorige-generatie Anthropic-vlaggenschip is volledig omgedraaid.
• Grok 4.6 — $2 / $6. Het opvallendste getal op het bord: het evenaarde GPT-5.6 Sol op de Artificial Analysis-index (beide 61) tegen 2x goedkopere input en ~3,3x goedkopere output, gedaald van een 2,5x / 5x verschil bij de oude tarieven.
• DeepSeek V4 Pro — $0.44 / $0.88 buiten piek (piekperiodes verdubbelen het). Een totaal ander prijsuniversum, voor het goedkope open-gewichten-segment.
De eerlijke framing: Sol is nog steeds een premium vlaggenschip, maar de verlaging haalt het uit de hoogste prijsklasse — de output van $20 onderbiedt nu de $25 van Claude Opus 5 en de $25 van Claude Opus 4.8, waardoor de $50 van Claude Fable 5 het enige closed-flagship outputtarief is dat erboven ligt. Het wint op effectieve kosten per eenheid zwaar werk (zijn tokenizer, zijn redenering, zijn lange context) in plaats van op het absolute tarief, en de verlaging van 24 augustus scherpt dat argument aan. Als je verkeer uit korte prompts en eenvoudige taken bestaat, zijn een $2 Terra, een $0.20 Luna of een $2 / $6 Grok 4.6 nog steeds de goedkopere keuze — en op de index geeft Grok 4.6 op papier niets toe.
Wanneer Sol de verkeerde keuze is
Vier gevallen waarin deze prijs niet de prijs is die u wilt:
Korte, eenvoudige prompts. Onder ruwweg 20K tokens zonder diep redeneren, is het vlaggenschip-premium verspild. GPT-5.6 Terra voor $2 / $12 of GPT-5.6 Luna voor $0,20 / $1,20 handelt het volume-niveau af voor een fractie van de kosten, en een Grok 4.6 of DeepSeek-klasse model kost nog minder.
Redeneringsintensief volume. Omdat denktijd als output wordt gefactureerd, kan een moeilijke prompt bij hoge inspanning flink boven de nominale outputlijn uitkomen. Als uw workload uit veel moeilijke aanvragen bestaat, meet dan het werkelijke aantal outputtokens voordat u zich vastlegt — de effectieve prijs kan u verrassen.
Prijs per token als enige doelstelling. Grok 4.6 evenaarde Sol op de index tegen $2 / $6, en DeepSeek V4 Pro ligt op $0.44 / $0.88 buiten de piekuren. Als een frontier-benchmarkscore niet de harde vereiste is, leveren die modellen aanzienlijk lagere prijzen per token voor dezelfde categorie werk.
Strikte latentiebudgetten. Sol is een groot reasoningmodel, dus de time-to-first-token ligt ruim boven die van een Flash-model. Voor realtime chat waarbij een TTFT onder de seconde telt, levert fast mode voor $8 / $40 doorvoer op, geen lagere latentie van het eerste token — en een kleiner model blijft de goedkopere oplossing.
Hoe noem je het in OrcaRouter

GPT-5.6 Sol wordt gehost op OrcaRouter als model-ID openai/gpt-5.6-sol, geleverd via het OpenAI-compatibele endpoint op api.orcarouter.ai/v1 tegen het provider-tarief zonder enige opslag. Als je al een OpenAI-client hebt, hoef je voor de migratie alleen de base-URL en het model-ID te wijzigen — niets anders. Dezelfde sleutel en hetzelfde endpoint ondersteunen 200+ modellen, dus staat Sol naast GPT-5.6 Terra, GPT-5.6 Luna, Claude Opus 5, Claude Fable 5, Grok 4.6 en de open-weight-modellen waarmee je het zou willen vergelijken, en je kunt routeren op basis van moeilijkheid in plaats van elk model afzonderlijk opnieuw te integreren.
Twee OrcaRouter-specifieke punten die het vermelden waard zijn op een prijspagina. BYOK: neem je eigen OpenAI-sleutel mee en OpenAI factureert je rechtstreeks tegen de eigen tarieven — OrcaRouter rekent $0 per token en laat de rate limits en credits van je provider intact. Guardrails: de PII Shield en het contentbeleid draaien vóór de facturering, zodat een geblokkeerd verzoek een schone 400 retourneert en nooit in rekening wordt gebracht, en de Agent Firewall beoordeelt tool- en MCP-aanroepen voordat ze worden uitgevoerd.
De eerlijkheidsnotitie die van belang is voor een prijspagina: we routeren het model, we bepalen niet de prijs. Het bedrag van $4 / $20 is het promotietarief van OpenAI dat wordt doorberekend — en toen OpenAI het op 24 augustus wijzigde, werd de vermelding dezelfde dag bijgewerkt, wat precies verklaart waarom deze pagina een datumstempel heeft. Als je rechtstreeks OpenAI benadert, krijg je hetzelfde tarief; OrcaRouter bestaat voor de route met één sleutel en zonder opslag, als je één eindpunt wilt voor de hele modelreeks.
Bronnen en datum
Alle bovenstaande prijzen zijn geverifieerd op 2026-08-25. De GPT-5.6 Sol-cijfers zijn afkomstig van OpenAI's gepubliceerde API-prijzen, kruiselings gecontroleerd met de OrcaRouter-modelpagina voor GPT-5.6 Sol (dezelfde dag gecontroleerd) en persberichten over de verlaging van 24 augustus (Indian Express, Economic Times, The Star); batch-, fast-mode-, cache-write- en long-context-tarieven zijn door OpenAI aangekondigd. De Claude-, Grok- en DeepSeek-cijfers zijn de huidige vermeldingen in de OrcaRouter-directory, waarbij DeepSeek V4 Pro wordt getoond tegen het daltarief. Sol's catalogusprijs bleef ongewijzigd van de lancering op 9 juli tot de verlaging van 30 juli en veranderde voor het eerst op 24 augustus met deze promotie — dat is precies waarom de datum hier belangrijk is: de tarieven van $4 / $20 zijn tijdelijk en prijzen wijzigen; behandel elke eerdere of latere pagina 'GPT-5.6 Sol-prijzen' die je vindt met de datum waarop deze is gecontroleerd. De cijfers hier zijn actueel per vandaag.
Elke prijs hierboven is de live koers op de GPT-5.6 Sol on OrcaRouter — gecontroleerd op 2026-08-25 zonder opslag, klaar voor je eigen sleutel.
Vergeleken in dit artikel2
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
