
GPT-5.6-prijzen na de verlaging: Luna vs Terra vs Sol, en welk niveau je moet gebruiken
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 546 tok/s
- openaiNIEUWOpenAI: GPT-6 Luna2026-09-2237Intelligentie
- openaiNIEUWOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- anthropicNIEUWAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- grokNIEUWGrok 4.72026-09-2146Intelligentie
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens · 182 tok/s
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 1312 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 114 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 225 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
Na de prijsverlaging van OpenAI op 30 juli 2026 is de GPT-5.6-familie — GPT-5.6 Luna, GPT-5.6 Terra en GPT-5.6 Sol — nog nooit zo goedkoop geweest om op schaal te draaien. Een week later, op 6 augustus, bracht OpenAI dezelfde lagen ook naar ChatGPT zelf: GPT-5.6 Luna wordt het standaardmodel voor gratis en Go-accounts met onbeperkt tekstchatten, terwijl GPT-5.6 Sol is bijgewerkt voor Plus en Pro. Op 19 augustus maakten OpenAI en Replit bekend dat de nieuwe Free Mode van Replit voor Core- en Pro-abonnees draait op GPT-5.6 Luna — de grootste gok van een externe partij tot nu toe op de volumelaag. Eind augustus begon OpenAI ook met een terugvaloptie voor zware consumentengebruikers: een “Luna Reserve”-toewijzing die geselecteerde ChatGPT Plus- en Pro-accounts beperkt GPT-5.6 Luna-gebruik geeft in Codex en ChatGPT Work zodra hun normale gebruikslimieten zijn uitgeput. Maar de drie lagen zijn zeer verschillend geprijsd, en de juiste kiezen (plus goed gebruik van caching, batch en routing) is de grootste hefboom voor je API-rekening. Deze gids schetst de volledige prijzen na de verlaging, uitgewerkte kostenvoorbeelden, hoe elke laag zich verhoudt tot concurrenten, en hoe je ertussen kunt routeren via één endpoint.
Prijzen zijn per miljoen tokens (input/output) en weerspiegelen de tariefkaart na de prijsverlaging, zoals gerapporteerd op de doorberekeningsmodelpagina's van OrcaRouter; gelaagde tarieven en cache-tarieven komen van de modelpagina's van OrcaRouter, en cijfers van concurrenten worden met bronvermelding vermeld. De details over de ChatGPT-uitrol in dit artikel zijn zoals OpenAI die op 6 augustus 2026 heeft vermeld, en de details over Replit Free Mode zijn zoals OpenAI en Replit die op 19 augustus 2026 hebben vermeld — door de leverancier gerapporteerd, niet onafhankelijk gemeten. De details over Luna Reserve zijn zoals OpenAI die documenteert in zijn helpcentrum en zoals OpenAI-medewerkers en vroege gebruikers die eind augustus 2026 hebben gerapporteerd — door de leverancier en community vermeld, niet onafhankelijk geverifieerd. Prijzen veranderen — controleer voordat je bouwt.
TL;DR
GPT-5.6 Luna ($0,20 / $1,20) is het werkpaard voor hoge volumes; Terra ($2 / $12) is het gebalanceerde midden; Sol ($5 / $30) is het vlaggenschip voor de moeilijkste redeneringen en agentische codering. Alle drie delen een context van ~1,05M tokens en een maximale output van 128K. Prompt-caching en de batchoptie verlagen de kosten verder, terwijl zeer lange inputs je naar een hogere categorie brengen. Aan de consumentenkant maakte OpenAI op 6 augustus bekend dat GPT-5.6 Luna de standaard wordt voor gratis en Go ChatGPT-accounts met onbeperkte tekstchat, en dat een bijgewerkte GPT-5.6 Sol wordt uitgerold naar Plus en Pro. Op 19 augustus lanceerde Replit Free Mode op GPT-5.6 Luna voor Core- en Pro-abonnees, die moeilijkere taken indien nodig doorstuurt naar GPT-5.6 Sol. Eind augustus begon OpenAI ook met de uitrol van een “Luna Reserve”-fallback die geselecteerde ChatGPT Plus- en Pro-accounts beperkt GPT-5.6 Luna-gebruik geeft in Codex en ChatGPT Work nadat hun reguliere limieten zijn verbruikt — zoals beschreven door OpenAI, waarbij gebruikers de uitrol naar geselecteerde accounts melden. Gebruik Luna voor de gemakkelijke meerderheid, Terra wanneer je meer nodig hebt, en Sol alleen waar het zijn kosten rechtvaardigt — en routeer op basis van moeilijkheid via één OpenAI-compatibel eindpunt om de uitgaven te minimaliseren.
Belangrijkste conclusies
• Luna: $0.20 / $1.20 per 1M tokens — snel, goedkoop, voor grootschalig, latentiegevoelig werk.
• Terra: $2 / $12 — de gebalanceerde middenklasse voor zwaardere taken die het vlaggenschip niet nodig hebben.
• Sol: $5 / $30 — het vlaggenschip voor diep redeneren, grootschalig coderen en agenten met een lange horizon.
• Caching en batch verlagen de kosten verder; lange inputs brengen je naar een duurdere long-context-tier.
• ChatGPT (volgens OpenAI, 6 aug.): Luna wordt de standaard voor het gratis/Go-abonnement met onbeperkte tekstchat; Sol krijgt een betrouwbaarheidsupdate voor Plus/Pro.
• Replit (aangekondigd op 19 aug): Free Mode voor Core/Pro draait op GPT-5.6 Luna — tot 30x meer gebruik per Replit, waarbij moeilijkere taken worden doorgestuurd naar GPT-5.6 Sol. Door Replit vermeld, niet onafhankelijk geverifieerd.
• Luna Reserve (eind aug., gedocumenteerd door OpenAI): een begrensde uitwijkreserve waarmee geselecteerde ChatGPT Plus- en Pro-accounts GPT-5.6 Luna kunnen blijven gebruiken in Codex en ChatGPT Work nadat de reguliere limieten zijn uitgeput — niet onbeperkt, en niet beschikbaar in Business- of Enterprise-werkruimten.
• Grootste besparingshefboom: routeer op basis van moeilijkheid — betaal geen Sol-tarieven voor werk dat Luna kan doen.
De nieuwe basisprijzen van GPT-5.6
Hier is de basisprijs na de verlaging per miljoen input/output-tokens: Luna $0,20 / $1,20 (verlaagd van $1 / $6), Terra $2 / $12 (verlaagd van $2,50 / $15), en Sol $5 / $30 (ongewijzigd). De twee goedkopere lagen zijn verlaagd op 30 juli 2026; de vlaggenschip-prijs bleef gehandhaafd. Simpel gezegd: de lage lagen zijn nu geprijsd voor schaal, terwijl het vlaggenschip premium blijft.

Getrapte, gecachte en batchprijzen
Het basistarief is slechts het uitgangspunt. De prijsstelling van GPT-5.6 kent drie modificatoren die uw effectieve kosten wezenlijk veranderen:
• Tiers voor lange context. Prijzen lopen op voor zeer lange inputs. Op de doorvoerpagina's van OrcaRouter kost Luna $0,20 / $1,20 tot aan een grote context-tier en $0,40 / $1,80 daarboven; Sol kost $5 / $30 op de basistier en $10 / $45 op de grootste. De tier wordt gekozen op basis van het aantal invoertokens van elk verzoek, dus een paar enorme prompts kunnen uw gemiddelde prijs stilletjes verhogen.
• Prompt-caching. Hergebruikte context wordt tegen een scherpe korting gefactureerd — de cache-read van Luna kost ongeveer $0,02 per miljoen tokens (tegenover $0,20 vers), met cache-writes rond de $0,25; de cache-read van Sol kost ongeveer $0,50 (tegenover $5 vers). Voor agents en chat met een stabiele system prompt is caching vaak de grootste besparing.
• Batch. Niet-dringende taken draaien asynchroon tegen een gereduceerd tarief — ideaal voor bulkclassificatie, evaluaties en offline generatie waarbij latentie er niet toe doet.
Uitgewerkte voorbeelden: wat het daadwerkelijk kost
Concrete cijfers maken de niveaus echt. Neem 10 miljoen tokens per maand met een verdeling van 70% input / 30% output (een typische chat/agent-mix):
• Luna: ongeveer $5 per maand (ruwweg $4,37 met prompt caching).
• Terra: ongeveer $50 per maand.
• Sol: ongeveer $125 per maand (ongeveer $109 met caching).
Dat is een spreiding van 25x tussen Luna en Sol voor hetzelfde volume — en dat is precies waarom het matchen van elke aanvraag aan de goedkoopste geschikte laag belangrijker is dan welk enkel tarief dan ook. (Deze komen overeen met de on-page kostencalculator van OrcaRouter, die op basis van de catalogusprijs schat; je werkelijke cijfers hangen af van caching en je invoer/uitvoer-mix.)
Waar elke tier eigenlijk voor is
GPT-5.6 Luna — het volumewerkpaard
{{1}}Luna is de snelle, kostenefficiënte tier, afgestemd op latentiegevoelige workloads met hoge volumes: chat, classificatie, extractie, routering en lichtgewicht agentische taken, met een p50 time-to-first-token van ongeveer 1,65 seconden.{{/1}} {{2}}Na de prijsverlaging is het geprijsd op $0,20 / $1,20 om direct te concurreren met goedkope open modellen — de standaard voor het overgrote deel van de eenvoudige aanroepen.{{/2}} {{3}}Het is ook de tier waar OpenAI consumenten-ChatGPT naartoe stuurt: volgens de aankondiging van 6 augustus wordt GPT-5.6 Luna het standaardmodel voor Free- en Go-accounts, worden chats met alleen tekst onbeperkt en komt de volgende week een nieuwe Think-knop voor hoger redeneervermogen bij moeilijkere vragen (de limieten voor bestanden, afbeeldingen en spraak blijven van kracht).{{/3}} {{4}}OpenAI zegt dat Luna 62% minder feitelijke fouten maakt dan de GPT-5.5 Instant die het vervangt — een door de leverancier gerapporteerd cijfer, maar een duidelijk signaal dat de volumetier de plek is waar het bedrijf het grootste deel van zijn verkeer naartoe stuurt.{{/4}}
Op 19 augustus 2026 maakte Replit GPT-5.6 Luna de engine van zijn nieuwe Free Mode — de standaardervaring voor Core- en Pro-abonnees. Dagelijkse chat, ideevorming en eenvoudige codeertaken draaien op Luna zonder het betaalde AI-tegoed van de gebruiker te verbruiken; Replit zegt dat Core-gebruikers nu tot 30x meer per maand kunnen creëren, inclusief tot 30 uur chat. Wanneer een taak meer redeneervermogen vereist, leidt de Agent van Replit het verzoek voor dat gedeelte naar een groter model — de Power/Max-modi of GPT-5.6 Sol — en valt daarna terug op Luna. Dit zijn door Replit en OpenAI vermelde details, niet onafhankelijk geverifieerd — maar de richting klopt met de prijsverlaging: een 80% goedkopere Luna maakt een altijd actief, standaard inbegrepen niveau haalbaar.
Er verscheen eind augustus 2026 nog een nieuwe wending aan de consumentenkant: Luna Reserve. Zoals OpenAI in zijn helpcentrum documenteert, kunnen geselecteerde ChatGPT Plus- en Pro-accounts een beperkte pool van GPT-5.6 Luna-gebruik krijgen in Codex en ChatGPT Work als terugvaloptie zodra hun reguliere gebruiksquotum is uitgeput — bij de limiet verschijnt een melding of een maanindicator, en je kunt op Luna blijven werken zolang de reserve duurt. Het is geen onbeperkte uitbreiding: de reserve staat los van het reguliere quotum en is zelf ook gemaximeerd, het biedt alleen GPT-5.6 Luna (nooit Terra of Sol), het is niet beschikbaar in Business- of Enterprise-werkruimten, en het bereiken van een reguliere limiet garandeert geen toegang. OpenAI-medewerkers bevestigden op 27 augustus het bestaan van de reserve, en vroege gebruikersrapporten beschrijven dat deze wordt uitgerold naar geselecteerde accounts — zoals gemeld door de leverancier en de community, niet onafhankelijk geverifieerd. Sommige vroege communityrapporten merken ook op dat de reserve de browser-light-kant van GPT-5.6 Luna draait, dus live webinspectietaken werken mogelijk niet tijdens de reserve.
GPT-5.6 Terra — het evenwichtige midden
Terra zit tussen volume en vlaggenschip in: capabeler dan Luna voor zwaardere redeneringen en codering, maar veel goedkoper dan Sol. Voor $2 / $12 is het een verstandige standaardkeuze wanneer Luna niet helemaal genoeg is, maar je het vlaggenschip niet nodig hebt — extractie van gemiddelde complexiteit, opstellen en meerstappentaken die nog steeds op schaal draaien.
GPT-5.6 Sol — het vlaggenschip
Sol is gebouwd voor het zwaarste werk: diepgaande meerstapsredenering, grootschalige software-engineering en agentische workflows met een lange horizon, en blijft coherent over een context van ~1,05M tokens en tot 128K output. Voor $5 / $30 (basis) is het een premiumkeuze — reserveer het voor taken die het echt nodig hebben, zoals complexe codering over meerdere bestanden of lange agentruns. Op 6 augustus heeft OpenAI ook GPT-5.6 Sol in ChatGPT bijgewerkt voor Plus- en Pro-gebruikers: het bedrijf zegt dat de chatversie betrouwbaarder is wat feiten betreft — 68% minder feitelijke fouten, volgens OpenAI — en meer gerichte antwoorden geeft, met een nieuwe schuifregelaar om te bepalen hoeveel redeneerinspanning deze toepast. De update betreft alleen de chatversie (de Sol achter Work en Codex is ongewijzigd), en het API-niveau blijft op $5 / $30.
De kanttekening over reasoning-tokens
GPT-5.6 zijn redeneringsmodellen, dus de effectieve outputkosten kunnen hoger uitvallen dan een naïeve schatting: wanneer redeneren is ingeschakeld, worden interne redeneringstokens als output gefactureerd. Bij moeilijke prompts met hoge redeneringsinspanning kan dat je rekening domineren. Stem de redeneringsinspanning af op de taak (laag of uit voor eenvoudige aanroepen), begrens outputtokens waar je kunt, en meet het werkelijke verbruik. Goedkopere tarieven per token helpen; minder tokens genereren helpt meer.
Hoe elk niveau zich verhoudt tot de concurrentie
De prijsverlaging herpositioneerde GPT-5.6 ten opzichte van het veld. Volgens rapportages onderbiedt Luna's $0.20 / $1.20 nu Claude Haiku 4.5 met ongeveer 5x op input en 4x op output, en Terra's $2 / $12 valt onder de standaardprijzen van Claude Sonnet 5 (gerapporteerd op $3 / $15). Vergeleken met open gewichten ligt Luna dicht bij de ondergrens die wordt bepaald door DeepSeek's V4-lijn en Zhipu's GLM-5.2 (ongeveer $1.20 / $4.10), met de Qwen- en Gemini Flash-niveaus in de buurt. De conclusie: voor kostengevoelig werk is Luna nu concurrerend met de goedkoopste capabele modellen in plaats van een premium alternatief daarvoor — terwijl Sol een echt premium niveau blijft voor capaciteiten die je niet goedkoop kunt krijgen.
De echte besparingshefboom: routeer op moeilijkheid
De goedkoopste rekening is geen enkele prijscategorie — het is het afstemmen van elke aanvraag op het minst dure model dat het kan. In de praktijk: stuur eenvoudige, hoogvolume-verzoeken naar Luna (of een goedkoop open model), stap over naar Terra voor moeilijkere taken, en gebruik Sol alleen voor de werkelijk moeilijke minderheid. Gecombineerd met caching en batch zorgt dit doorgaans voor veel grotere kostenbesparingen dan welke enkele prijswijziging dan ook. Het addertje onder het gras is operationeel: je wilt niet drie OpenAI-niveaus plus open-model-alternatieven afzonderlijk opnieuw integreren.
Toegang tot alle drie (en goedkopere concurrenten) via één endpoint
Hier komt een leveranciersonafhankelijke router van pas. OrcaRouter biedt GPT-5.6 Luna, Terra en Sol — tegen dezelfde prijzen na de korting, 0% opslag — via één OpenAI-compatibel eindpunt, naast goedkopere open modellen zoals DeepSeek V4 Pro, GLM-5.2 en Qwen. Het wisselen van niveaus (of A/B-testen van Luna tegen een open model) is een configuratiewijziging, geen herintegratie, en je kunt elke aanvraag routeren naar wat het goedkoopst is. Luna Reserve is de consumentenversie van datzelfde idee — een ingebouwde fallback die geselecteerde gebruikers op GPT-5.6 Luna houdt nadat hun reguliere tegoed is verbruikt — en het API-equivalent is automatische failover, die OrcaRouter afhandelt wanneer een provider een rate-limit oplegt of een foutmelding geeft bij een aanvraag.

De Luna-tarievenkaart na de prijsverlaging is zichtbaar op de eigen modelpagina van OrcaRouter tegen de adviesprijs — $0,20 / $1,20 per miljoen tokens — omdat de router de providerprijzen doorgeeft met een opslag van 0%, met een kostencalculator op de pagina voor een typische maandelijkse rekening. Er is ook een gratis laag en een pagina met aanbiedingen voor extra besparingen.

Veelgestelde vragen
Wat zijn de GPT-5.6-prijzen na de verlaging?
Luna $0,20 / $1,20, Terra $2 / $12 en Sol $5 / $30 per miljoen invoer-/uitvoertokens. Luna en Terra zijn op 30 juli 2026 verlaagd; Sol is ongewijzigd.
Welke GPT-5.6-tier moet ik gebruiken?
Luna voor latentiegevoelig werk met hoge volumes; Terra voor zwaardere taken die het vlaggenschip niet nodig hebben; Sol voor de moeilijkste redeneer- en agentische codeertaken. Routeer op moeilijkheidsgraad om de kosten te minimaliseren.
Is GPT-5.6 Luna gratis in ChatGPT?
OpenAI heeft op 6 augustus aangekondigd dat GPT-5.6 Luna het standaardmodel wordt voor gratis en Go ChatGPT-accounts, met onbeperkte tekst-only chats; er blijven limieten gelden voor bestandsuploads, afbeeldingen en spraakfunctionaliteiten, en een Think-knop voor hogere redenering wordt apart uitgerold. Dit zijn door OpenAI genoemde plannen, niet onafhankelijk geverifieerd.
Waarom gebruikt Replit GPT-5.6 Luna voor de gratis modus?
Replit's Free Mode, aangekondigd op 19 augustus 2026, draait dagelijkse chat, brainstormsessies en eenvoudige codering standaard op GPT-5.6 Luna voor Core- en Pro-abonnees, en stuurt moeilijkere taken door naar een groter model — de Power/Max-modi of GPT-5.6 Sol — indien nodig. Replit schrijft de economische haalbaarheid toe aan de prijsverlaging van de Luna API van 30 juli, van ongeveer 80%. Dit zijn door de leverancier vermelde plannen, niet onafhankelijk geverifieerd.
Wat is Luna Reserve?
Een terugvalquotum dat OpenAI documenteert voor Codex en ChatGPT Work: geselecteerde ChatGPT Plus- en Pro-accounts krijgen een beperkte pool GPT-5.6 Luna-gebruik zodra hun reguliere gebruikslimiet is uitgeput, zodat ze blijven werken in plaats van te worden afgesloten. Het levert uitsluitend GPT-5.6 Luna — nooit Terra of Sol — heeft een eigen limiet, staat los van het reguliere gebruik en is niet beschikbaar in Business- of Enterprise-werkruimten. Het bestaan is door OpenAI bevestigd (personeel bevestigde dit op 27 augustus); de uitrol naar geselecteerde accounts is door de community gemeld, niet onafhankelijk geverifieerd.
Hoeveel kost GPT-5.6 per maand?
Bij 10M tokens/maand (70% input): ongeveer $5 op Luna, $50 op Terra en $125 op Sol — een spreiding van 25x, vóór caching. Je werkelijke kosten hangen af van caching en je input/output-mix.
Hebben alle drie de niveaus hetzelfde contextvenster?
Ja — ongeveer een context van 1.05M tokens en tot 128K uitvoertokens, met ondersteuning voor vision, tools, JSON en redeneren.
Hoe beïnvloedt prompt-caching de kosten?
Caching verlaagt de kosten voor herhaalde context aanzienlijk — Luna's cache-uitlezing kost ongeveer $0,02 per miljoen tokens tegenover $0,20 voor verse tokens — dus hergebruik gecachte prompts waar mogelijk. Lange invoer kan je daarentegen naar een duurder long-context-niveau brengen.
Hoe verhouden de niveaus zich tot Anthropic of open modellen?
Volgens rapportages onderbiedt Luna Claude Haiku 4.5 (~5x input / 4x output) en ligt Terra onder Claude Sonnet 5 ($3 / $15). Luna zit ook dicht bij de goedkope ondergrens voor open modellen (DeepSeek, GLM-5.2 ~$1.20/$4.10).
Waar kan ik alle drie de lagen samen gebruiken?
Via het enkele OpenAI-compatibele eindpunt van OrcaRouter met 0% opslag, naast goedkopere open modellen voor routering op basis van moeilijkheidsgraad.
Kortom
Na de verlaging zijn GPT-5.6 Luna ($0,20 / $1,20) en Terra ($2 / $12) aantrekkelijk voor hoogvolume- en middenniveau-werk, terwijl Sol ($5 / $30) het premium-vlaggenschip blijft — een kostenverschil van 25x dat slimme routering beloont. De uitrol naar consumenten versterkt de tweedeling: OpenAI maakt Luna de gratis standaard terwijl de betrouwbaarheidsupdate van Sol voor betaalde abonnementen blijft, en de Free Mode van Replit op 19 augustus — gebouwd op GPT-5.6 Luna, met moeilijkere taken die doorsturen naar GPT-5.6 Sol — laat zien dat producten met veel verkeer op dezelfde laag uitkomen, en de Luna Reserve-fallback van eind augustus breidt dat patroon uit door geselecteerde Plus- en Pro-gebruikers op GPT-5.6 Luna te houden, zelfs nadat hun normale limieten op zijn. Voor API-bouwers is dat nog een reden om eenvoudig verkeer naar Luna te routeren. De grootste besparingen komen van routering op moeilijkheidsgraad, gebruik van caching en batch, en het beheersen van reasoning-tokens in plaats van standaard voor één laag te kiezen. Dat gaat het makkelijkst via een enkel endpoint met 0% opslag, zoals OrcaRouter, waar alle drie de lagen (tegen de nieuwe prijzen) naast de goedkopere open modellen staan waarmee je ze wilt vergelijken.
