Redactionele platte vectorillustratie voor de hero-sectie van een technologieblog over de prijsbepaling van vlaggenschipmodellen: een grote afgeronde modelchip in diepblauw met een zachte cyaan gloed op een lichte achtergrond, een papieren prijskaartje dat aan de hoek is bevestigd, drie tokenstromen die uit de chip stromen naar een cirkelvormige prijsmeter met kleine abstracte maatstreepjes, een klein stapeltje gecachte blokken naast de meter, en een slank kalenderblad dat van links naar binnen schuift. Witte achtergrond met zachte blauw-cyaan gradiëntaccenten en één subtiele warme highlight; minimale platte lijniconen; strakke moderne geometrische schreefloze typografie; geen leesbare tekst.
Guides & Insights

GPT-5.6 Sol API-prijzen: $5 / $30 per 1M tokens, cache op $0,50, en wat het echt kost

Auteur

Gideon Frost

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

GPT-5.6 Sol kost $5.00 per miljoen invoertokens en $30.00 per miljoen uitvoertokens op de GPT-5.6 Sol API — hetzelfde tarief dat het vlaggenschipniveau hanteert op de OrcaRouter-directory, gecontroleerd op 2026-08-18, zonder opslag. Het is het duurste niveau in de GPT-5.6-familie en het enige waarvan de catalogusprijs niet veranderde bij de verlaging van 30 juli, dus de tariefkaart op de live GPT-5.6 Sol-modelpagina is waar je budget op moet baseren. De hefbomen doen er meer toe dan de kop: hergebruikte invoer wordt gefactureerd tegen $0.50 per miljoen via prompt-caching, de batch-API zakt naar $2.50 / $15.00, en snelle modus ruilt een 2x premie voor tot 2.5x snelheid. Deze pagina is de prijsreferentie specifiek voor Sol — de exacte tariefkaart, wat een aanvraag daadwerkelijk kost, hoe het vlaggenschip zich verhoudt tot de rest, wanneer het de verkeerde keuze is, en hoe je het aanroept via één OpenAI-compatibel eindpunt met je eigen sleutel.

Prijzen zijn per miljoen tokens (invoer / uitvoer), per 2026-08-18. De dollarbedragen worden afgelezen van de door OpenAI gepubliceerde API-tarieven en gecontroleerd tegen de OrcaRouter-modelpagina voor GPT-5.6 Sol; cache-, batch-, fast-mode- en long-context-tarieven zijn door OpenAI aangekondigd. Prijzen wijzigen — controleer voordat je bouwt.

De exacte prijs, vandaag geverifieerd

Hier is de volledige tariefkaart voor GPT-5.6 Sol, geverifieerd op 2026-08-18:

Price card titled 'GPT-5.6 Sol — API price per 1M tokens', sourced to the OrcaRouter directory checked 2026-08-18 at zero markup. Three highlight cells read Input $5.00, Output $30.00 and Cache read $0.50. Rows below list cache write $6.25, long-context over 272K input $10.00 / $45.00, batch API $2.50 / $15.00, fast mode $10.00 / $60.00, context window 1.05M tokens and max output 128K. Footer: Sol's list price was not cut on July 30 — the cheaper tiers were.

Invoer — $5.00 per 1M tokens bij een cache-miss.

Uitvoer — $30,00 per 1M tokens.

Prompt cache read — $0,50 per 1M tokens, een 90% korting op elke input die u opnieuw verzendt.

Promptcache schrijven — $6,25 per 1M tokens.

Niveau voor lange context — inputs voorbij ruwweg 272K tokens worden gefactureerd tegen $10,00 invoer / $45,00 uitvoer (2x invoer, 1,5x uitvoer).

Batch API — $2.50 invoer / $15.00 uitvoer, een vaste korting van 50%, asynchroon, meestal binnen ongeveer 24 uur klaar.

Snelle modus — $10,00 invoer / $60,00 uitvoer, een 2x meerprijs voor tot ongeveer 2,5x uitvoersnelheid, zonder verandering in intelligentie.

Contextvenster — ~1.05M tokens, tot 128K output.

OrcaRouter rekent het providertarief door zonder opslag, dus het tarief in de directory is het tarief dat je betaalt. Op de live-modelpagina toont de kaart $5.00 / $30.00 per 1M, cache-lezen $0.500, met Vision-, Tools-, JSON- en Reasoning-badges. Sol's $5 / $30 is ook de prijs vóór de verlaging: OpenAI's verlaging van 30 juli is toegepast op GPT-5.6 Luna (nu $0.20 / $1.20) en GPT-5.6 Terra (nu $2 / $12), terwijl het vlaggenschip gelijk bleef.

De hefbomen die de effectieve prijs veranderen

Het basistarief is slechts het startpunt. Vier modificatoren bepalen wat Sol je daadwerkelijk kost:

Prompt caching — hergebruikte context wordt in rekening gebracht tegen $0,50 per miljoen in plaats van $5 voor nieuwe, en het schrijven naar de cache kost $6,25 per miljoen. Voor elke agent of chat die bij elke beurt een groot voorvoegsel opnieuw verzendt, is caching de grootste hefboom op de rekening. OpenAI slaat de cache op per project en API-sleutel, dus op één sleutel (één kanaal) blijven is wat zorgt dat de treffers blijven binnenkomen.

Niveau voor lange context — een verzoek waarvan de invoer ruwweg 272K tokens overschrijdt, gaat van het basistarief naar $10 / $45. Een paar enorme prompts kunnen uw gemiddelde prijs stilletjes verhogen, dus batch of truncate wanneer u de diepe context niet echt nodig hebt.

Batch — OpenAI's batch API voert taken asynchroon uit met een doorlooptijd van ongeveer 24 uur tegen exact de helft van de prijs: $2.50 / $15.00, met gecachte invoer voor $0.25 en cache-schrijfacties voor $3.13. Het stapelt met prompt-caching en is geschikt voor evals, bulkclassificatie en offline generatie waar latentie er niet toe doet.

Snelle modus — $10 / $60 voor tot ~2,5x uitvoerdoorvoer, nuttig voor latentiekritisch werk waarbij gebruikers wachten, zoals live codeerassistentie. Het factureert per token tegen 2x het standaardtarief, telt niet mee voor gekochte Scale Tier TPM-pakketten, en kan terugvallen op standaardverwerking als je de gedeelde snelheidslimiet overschrijdt.

Wat een verzoek eigenlijk kost

Prijzen per token zijn abstract, dus hier zijn uitgewerkte voorbeelden tegen de huidige tarieven:

Enkel chatgesprek, 50K input + 20K output — $0.25 + $0.60 = $0.85.

1M invoer + 1M uitvoer — $5 + $30 = $35.

Agentische beurt, 200K gecachte context + 20K nieuwe invoer + 30K uitvoer — $0.10 + $0.10 + $0.90 = $1.10. Dezelfde beurt met een koude cache — 220K nieuwe invoer voor $1.10 — bedraagt $2.00. Caching halveert het bijna.

Een maand van 10M tokens met een 70% input / 30% output-verdeling, met 80% van de input uit cache: 1.4M verse input ($7.00) + 5.6M gecachete input ($2.80) + 3M output ($90) ≈ $100. Zonder cache kost dezelfde maand $125 — en dezelfde maand kost ongeveer $50 op GPT-5.6 Terra, of ongeveer $5 op GPT-5.6 Luna. Dat 20x verschil tussen Sol en Luna is de reden waarom tier-matching belangrijker is dan welk enkel tarief dan ook.

Twee kanttekeningen verhogen het effectieve tarief. Sol is een redeneermodel — interne redeneertokens worden als output gefactureerd tegen $30 per miljoen. Een moeilijke prompt met een hoge redeneerinspanning kan een groot deel van het outputbudget aan denken besteden, waardoor de effectieve outputkosten bij moeilijk werk ruim boven een naïeve schatting uitkomen. En de tokenizer van OpenAI is bij sommige invoer uitgebreider dan die van de vorige generatie, dus dezelfde tekst kan meer tokens kosten dan op GPT-5.5 het geval zou zijn. Stem de redeneerinspanning af op de taak, beperk de output waar mogelijk, en meet het daadwerkelijke gebruik voordat u een kostenraming maakt.

Hoe de prijsstelling van Sol zich verhoudt tot de rest van de markt

Comparison table card titled 'USD per 1M tokens — published list prices, 2026-08-18'. Rows with an input/output column pair per model: GPT-5.6 Sol $5.00/$30.00 highlighted with a 'THIS PAGE' tag; GPT-5.6 Terra $2.00/$12.00; GPT-5.6 Luna $0.20/$1.20; Claude Opus 5 $5.00/$25.00; Claude Fable 5 $10.00/$50.00; Claude Opus 4.8 $5.00/$25.00; Grok 4.6 $2.00/$6.00; DeepSeek V4 Pro $0.44/$0.88 off-peak. Footer: Sol's $30 output is the highest of these flagships except Claude Fable 5, and Grok 4.6 matched Sol's index score at $2/$6.

Afgelezen tegen de gepubliceerde catalogusprijzen op 2026-08-18:

GPT-5.6 Terra — $2 / $12, de middencategorie na de prijsverlaging. Sol kost 2,5x meer voor input en output; Terra is de standaardkeuze als je geen reasoning van het vlaggenschip nodig hebt.

GPT-5.6 Luna — $0.20 / $1.20, de volumetier na de prijsverlaging. Een 25x inputverschil met Sol; Luna is geprijsd voor het overgrote deel van het eenvoudige verkeer.

Claude Opus 5 — $5 / $25. Zelfde input, op papier 20% goedkopere output. In de praktijk slaat de vergelijking voor sommige workloads om: deze blog mat eerder dat Sol ongeveer 34,5% minder tokens gebruikt dan een Anthropic-model op dezelfde Engelse/gemengde steekproef, en een gepubliceerde token-economische analyse (TheBlockBeats) schatte dat de totale rekening van Sol ongeveer 21% lager kan uitvallen dan Claude Opus 5 voor gelijkwaardig werk, ondanks het hogere outputtarief. Meet je eigen tokenizer, niet de stickerprijs.

Claude Fable 5 — $10 / $50. Sol is de helft van de inputprijs en 40% goedkoper op output dan Anthropic's topniveau.

Claude Opus 4.8 — $5 / $25. Zelfde invoer als Sol, goedkopere uitvoer — het Anthropic-vlaggenschip van de vorige generatie.

Grok 4.6 — $2 / $6. De scherpste prijs op de lijst: het evenaarde GPT-5.6 Sol op de Artificial Analysis-index (beide 61) tegen 2,5x goedkopere input en 5x goedkopere output.

DeepSeek V4 Pro — $0.44 / $0.88 buiten piek (piekperiodes verdubbelen het). Een totaal ander prijsuniversum, voor het goedkope open-gewichten-segment.

De eerlijke framing: Sol is een premium vlaggenschip met een premium outputsnelheid — de hoogste outputsnelheid van de gesloten vlaggenschepen onder Claude Fable 5. Het wint op effectieve kosten per eenheid hard werk (zijn tokenizer, zijn redenering, zijn lange context) in plaats van op de absolute snelheid. Als je verkeer bestaat uit korte prompts en simpele taken, zijn een $2 Terra, een $0,20 Luna of een $2 / $6 Grok 4.6 de goedkopere keuze — en op de index geeft Grok 4.6 op papier niets toe.

Wanneer Sol de verkeerde keuze is

Vier gevallen waarin deze prijs niet de prijs is die u wilt:

Korte, eenvoudige prompts. Onder ruwweg 20K tokens zonder diep redeneren, is het vlaggenschip-premium verspild. GPT-5.6 Terra voor $2 / $12 of GPT-5.6 Luna voor $0,20 / $1,20 handelt het volume-niveau af voor een fractie van de kosten, en een Grok 4.6 of DeepSeek-klasse model kost nog minder.

Redeneringsintensief volume. Omdat denktijd als output wordt gefactureerd, kan een moeilijke prompt bij hoge inspanning flink boven de nominale outputlijn uitkomen. Als uw workload uit veel moeilijke aanvragen bestaat, meet dan het werkelijke aantal outputtokens voordat u zich vastlegt — de effectieve prijs kan u verrassen.

Prijs per token als enige doelstelling. Grok 4.6 evenaarde Sol op de index tegen $2 / $6, en DeepSeek V4 Pro ligt op $0.44 / $0.88 buiten de piekuren. Als een frontier-benchmarkscore niet de harde vereiste is, leveren die modellen aanzienlijk lagere prijzen per token voor dezelfde categorie werk.

Strikte latentiebudgetten.Sol is een groot redeneermodel, dus de time-to-first-token ligt ruim boven die van een Flash-tier-model. Voor realtime chat waarbij sub-seconde TTFT belangrijk is, biedt de snelle modus voor $10 / $60 doorvoer, maar geen lagere eerste-token-latentie — en een kleiner model is nog steeds de goedkopere oplossing.

Hoe noem je het in OrcaRouter

The OrcaRouter model page for openai/gpt-5.6-sol, showing the $5.00 per million input and $30.00 per million output pricing, the ~1.05M-token context window, 128K max output, and the vision, tools and JSON badges.

GPT-5.6 Sol wordt gehost op OrcaRouter als model-ID openai/gpt-5.6-sol, geleverd via het OpenAI-compatibele endpoint op api.orcarouter.ai/v1 tegen het provider-tarief zonder enige opslag. Als je al een OpenAI-client hebt, hoef je voor de migratie alleen de base-URL en het model-ID te wijzigen — niets anders. Dezelfde sleutel en hetzelfde endpoint ondersteunen 200+ modellen, dus staat Sol naast GPT-5.6 Terra, GPT-5.6 Luna, Claude Opus 5, Claude Fable 5, Grok 4.6 en de open-weight-modellen waarmee je het zou willen vergelijken, en je kunt routeren op basis van moeilijkheid in plaats van elk model afzonderlijk opnieuw te integreren.

Twee OrcaRouter-specifieke punten die het vermelden waard zijn op een prijspagina. BYOK: neem je eigen OpenAI-sleutel mee en OpenAI factureert je rechtstreeks tegen de eigen tarieven — OrcaRouter rekent $0 per token en laat de rate limits en credits van je provider intact. Guardrails: de PII Shield en het contentbeleid draaien vóór de facturering, zodat een geblokkeerd verzoek een schone 400 retourneert en nooit in rekening wordt gebracht, en de Agent Firewall beoordeelt tool- en MCP-aanroepen voordat ze worden uitgevoerd.

De eerlijkheidsnoot die ertoe doet voor een prijspagina: we routeren het model, we bepalen de prijs niet. De $5 / $30 is het tarief van OpenAI dat wordt doorberekend, en wanneer OpenAI het wijzigt, volgt de vermelding — dat is precies waarom deze pagina van een datum is voorzien. Als je rechtstreeks OpenAI belt, krijg je hetzelfde tarief; OrcaRouter bestaat voor de single-key, zero-markup route als je één endpoint wilt voor de hele modellenlijn.

Bronnen en datum

Alle bovenstaande prijzen zijn geverifieerd op 2026-08-18. De GPT-5.6 Sol-cijfers zijn afkomstig van OpenAI's gepubliceerde API-prijzen en gecross-checkt tegen de OrcaRouter-modelpagina voor GPT-5.6 Sol (op dezelfde dag gecontroleerd) en onze eigen gepubliceerde GPT-5.6-prijspagina's. Batch-, fast-mode-, cache-write- en long-context-tarieven zijn door OpenAI aangekondigd. De Claude-, Grok- en DeepSeek-cijfers zijn de huidige OrcaRouter-directorylijsten, met DeepSeek V4 Pro weergegeven tegen het dalurentarief. OpenAI heeft de lijstprijs van Sol niet gewijzigd sinds de lancering op 9 juli 2026 — de prijsverlaging van 30 juli liet het vlaggenschip ongemoeid — maar prijzen veranderen; behandel elke eerdere "GPT-5.6 Sol pricing"-pagina die je vindt met de datum waarop deze is gecontroleerd. De cijfers hier zijn actueel per vandaag.

Elke prijs hierboven is de live-koers voor GPT-5.6 Sol on OrcaRouter — gecontroleerd op 2026-08-18 zonder opslag, klaar voor uw eigen sleutel.

Vergeleken in dit artikel3

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt

© 2026 OrcaRouter

Voor aanbieders

Beheer je een inferentieplatform? Zet je modellen op OrcaRouter.

providers@orcarouter.ai

Word lid van de community

Discordsupport@orcarouter.aiXGitHubYouTube