
OpenAI verlaagt GPT-5.6 API-prijzen: wat er veranderd is, waarom, en hoe je het krijgt
- qwenNIEUWQwen: Qwen3.8 Max2026-08-03$2.00 / $6.00 per 1 mln tokens · 55 tok/s
- deepseekNIEUWDeepSeek: DeepSeek V4 Flash 07312026-07-3150Intelligentie69Coderen
- qwenNIEUWQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens · 206 tok/s
- orcaNIEUWOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicNIEUWAnthropic: Claude Opus 52026-07-2461Intelligentie78Coderen
- googleNIEUWGoogle: Gemini 3.6 Flash2026-07-2150Intelligentie69Coderen
- googleNIEUWGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligentie49Coderen
- metaMeta: Muse Spark 1.12026-07-1651Intelligentie71Coderen
- kimiMoonshotAI: Kimi K32026-07-1557Intelligentie76Coderen
- openaiOpenAI: GPT-5.6 Luna2026-07-0951Intelligentie71Coderen
- openaiOpenAI: GPT-5.6 Terra2026-07-0955Intelligentie77Coderen
- openaiOpenAI: GPT-5.6 Sol2026-07-0959Intelligentie77Coderen
- grokxAI: Grok 4.52026-07-0854Intelligentie72Coderen
- tencentTencent: Hy32026-07-0641Intelligentie59Coderen
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Intelligentie42Coderen
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Intelligentie39Coderen
- anthropicAnthropic: Claude Sonnet 52026-06-3053Intelligentie72Coderen
- klingKling: Kling 3.0 Turbo2026-06-1757Intelligentie52Coderen57Wiskunde
- z-aiZ.ai: GLM 5.22026-06-1651Intelligentie69Coderen60Wiskunde
- kimiMoonshotAI: Kimi K2.7 Code2026-06-1242Intelligentie61Coderen61Wiskunde
Op 30 juli 2026 verlaagde OpenAI de API-prijzen van zijn twee goedkopere GPT-5.6-modellen — het goedkoopste niveau werd fors verlaagd en het middensegment werd iets teruggebracht, terwijl het vlaggenschip onaangetast bleef. Het is een opmerkelijke zet in een steeds hevigere prijzenoorlog, en de nieuwe prijzen stonden onmiddellijk op de gepubliceerde prijslijst. Dit artikel legt precies uit wat er is veranderd, de techniek erachter, hoe de nieuwe prijzen zich verhouden tot die van concurrenten, de verborgen kosten om op te letten, hoe u uw rekening verder kunt verlagen — en hoe de lagere prijzen al live zijn op OrcaRouter met 0% opslag.
Elk cijfer hieronder is voorzien van een bronvermelding. De prijzen zijn per miljoen tokens (input/output) en weerspiegelen de tariefkaart van OpenAI van 30 juli 2026, zoals gerapporteerd door onder meer Unite.AI, plus de doorgeefmodelpagina's van OrcaRouter; cijfers van concurrenten worden met bron vermeld. Prijzen veranderen — verifieer voordat je bouwt.
TL;DR. OpenAI heeft GPT-5.6 Luna verlaagd naar $0.20 / $1.20 (van $1 / $6, ~80% korting) en GPT-5.6 Terra naar $2 / $12 (van $2.50 / $15, ~20% korting), terwijl GPT-5.6 Sol op $5 / $30 blijft. Twee efficiëntiewinsten hebben dat betaald: herschreven GPU-kernels (ongeveer 20% lagere servingkosten) en een herontworpen conceptmodel voor speculatieve decodering (15%+ snellere tokengeneratie). De prijsverlaging brengt Luna onder Anthropic's Haiku 4.5 en richting de goedkope ondergrens van open modellen die DeepSeek en GLM hebben gezet. Als je routeert via een vendor-neutraal endpoint met 0% opslag, zoals OrcaRouter, zijn de nieuwe tarieven al live — dezelfde prijs, één OpenAI-compatibele API, met elk concurrerend model ernaast om te vergelijken en ertussen te routeren.
Belangrijkste conclusies
• GPT-5.6 Luna: nu $0,20 / $1,20 per 1M tokens, verlaagd van $1 / $6 — ongeveer een korting van 80%.
• GPT-5.6 Terra: nu $2 / $12, verlaagd van $2,50 / $15 — een verlaging van ongeveer 20%.
• GPT-5.6 Sol (vlaggenschip): ongewijzigd op $5 / $30.
• Waarom: herschreven productie-GPU-kernels (~20% lagere servingkosten) plus een herontwerp van het draftmodel voor speculatieve decodering (15%+ token-generatie-efficiëntie), volgens de technische post van OpenAI van 29 juli.
• Hoe het te verkrijgen: de korting is al doorgevoerd op OrcaRouter (0% opslag) — Luna voor $0,20 / $1,20 — via één OpenAI-compatibel eindpunt.
Wat is er precies veranderd?
De GPT-5.6-familie van OpenAI functioneert als een niveauladder: Luna (snel, goedkoopst), Terra (midden) en Sol (vlaggenschip). De verlaging van 30 juli trof de twee goedkopere niveaus. Volgens de gerapporteerde prijslijst daalde GPT-5.6 Luna van $1 / $6 naar $0,20 / $1,20 per miljoen input-/output-tokens — een verlaging van ongeveer 80% op zowel input als output — en GPT-5.6 Terra daalde van $2,50 / $15 naar $2 / $12, ruwweg 20%. GPT-5.6 Sol, het vlaggenschip dat is gebouwd voor de moeilijkste redeneringen en agentische codering, bleef op $5 / $30. De volumeniveaus werden dramatisch goedkoper; het topniveau bleef onveranderd.
Het basistarief per token is niet het hele verhaal. GPT-5.6-prijzen kennen ook inputlengteniveaus (zeer lange contexten gaan naar een hoger tarief), een korting voor prompt-caching (gecachte input is veel goedkoper dan verse input) en een batchoptie (asynchrone taken met korting). Alle drie blijven van kracht na de verlaging, dus de effectieve prijs voor een workload met veel cache of batch kan nog lager uitvallen. Let in de andere richting op het lange-contextniveau: het invoeren van enorme prompts kan je naar een hoger niveau tillen.

De twee optimalisaties achter de cut
Dit was geen verlieslokker — OpenAI presenteerde het als een efficiëntiewinst. In een technische blogpost van 29 juli 2026 beschreven leden van OpenAI's technische staf optimalisaties op het gebied van inferentie en de agent-harness achter Codex en ChatGPT Work. Twee springen eruit. Ten eerste: herschrijvingen van GPU-kernels in de productie-infrastructuur — waarbij Sol, draaiend binnen Codex, werd ingezet om de eigen kernels van het bedrijf te herschrijven — die volgens OpenAI de kosten voor end-to-end serving met ongeveer 20% verlaagden. Ten tweede: een herontworpen draftmodel voor speculatieve decodering dat de efficiëntie van tokengeneratie naar verluidt met meer dan 15% verbeterde. De lagere servingkosten, doorgegeven aan klanten als lagere prijzen voor de hoog-volume-pakketten, zijn het verhaal — en het biedt een glimp van een feedbackloop waar de hele industrie achteraan jaagt: frontiermodellen gebruiken om juist de infrastructuur te optimaliseren die hen bedient.
Hoe de nieuwe prijzen zich verhouden
De prijsverlaging is duidelijk op de concurrentie gericht. Volgens de berichtgeving van Unite.AI onderbiedt Luna's nieuwe $0.20 / $1.20 Anthropic's Haiku 4.5 met ongeveer 5x op invoer en ongeveer 4x op uitvoer, en Terra's nieuwe $2 / $12 ligt onder de standaardprijzen van Claude Sonnet 5 (gerapporteerd op $3 / $15, ingaande na 31 augustus 2026). Ten opzichte van de open-gewichtmodellen bevindt Luna zich nu dicht bij de goedkope inferentie-ondergrens die is vastgesteld door DeepSeek's V4-lijn en Zhipu's GLM-5.2 (ongeveer $1.20 / $4.10), waarbij de niveaus van Alibaba's Qwen en Google's Gemini Flash in dezelfde buurt zitten. Met andere woorden, OpenAI heeft zijn volumetarieven verlaagd naar het niveau waar de goedkoopste capabele modellen al zitten — waardoor de prijsstraf voor het kiezen van een propriëtair model boven een open model wordt verkleind.
Inferentie wordt steeds goedkoper
Zoom uit en deze verlaging past in een meerjarige trend: de kosten van een bepaald niveau van capaciteit zijn scherp gedaald, generatie na generatie, doordat laboratoria meer doorvoer uit dezelfde hardware weten te halen. OpenAI's eigen oudere niveaus illustreren de neerwaartse tendens in de loop van de tijd, en elke efficiëntiedoorbraak — betere kernels, speculatieve decodering, goedkopere aandacht — vertaalt zich doorgaans binnen enkele maanden naar een prijsverlaging. Voor kopers is de praktische conclusie dat ze moeten ontwerpen voor een wereld waarin inferentie volgens een schema goedkoper wordt: ga geen te grote verplichtingen aan met de prijsstelling van één model en houd omschakelen goedkoop.
De verborgen kosten om op te letten: redeneertokens
GPT-5.6-modellen zijn redeneringsmodellen, en dat bepaalt de werkelijke uitgaven in de praktijk. Wanneer redeneren is ingeschakeld, genereert het model interne redeneringstokens die als output worden gefactureerd — dus uw effectieve outputkosten kunnen hoger zijn dan een naïeve schatting op basis van "woorden in het antwoord" suggereert, vooral bij moeilijke prompts met hoge redeneringsinspanning. De oplossing is om de redeneringsinspanning af te stemmen op de taak (laag of uit voor eenvoudige aanroepen), de output waar mogelijk te begrenzen, en het werkelijke tokenverbruik te meten in plaats van te veronderstellen. Een lager tarief per token helpt, maar controle over hoeveel tokens u genereert, helpt nog meer.
Wat het betekent voor ontwikkelaars
Als je GPT-5.6 Luna of Terra gebruikt voor werk met hoge volumes — classificatie, extractie, routering, lichtgewicht agents, chat — dan is je rekening zojuist gedaald, in sommige gevallen met het grootste deel van de waarde, zonder dat er code hoeft te worden gewijzigd. Dat maakt de volumeniveaus nog aantrekkelijker voor kostenbewuste workloads en verkleint het prijsverschil met goedkope open modellen. De rekensom voor het vlaggenschip blijft ongewijzigd: Sol voor $5 / $30 is nog steeds een premium keuze voor de moeilijkste taken. Het winnende patroon is om te routeren op basis van moeilijkheid — goedkope niveaus (of goedkope open modellen) voor de gemakkelijke 80%, het vlaggenschip alleen waar het zijn kosten verdient.
Hoe u uw rekening nog verder kunt verlagen
De prijsverlaging is een basis om op voort te bouwen, niet de eindstreep. De grootste extra hefbomen: prompt caching (hergebruik een stabiele system prompt of lange context en betaal het veel lagere tarief voor gecachte input); de batchoptie (voer niet-dringende taken asynchroon uit met korting); tier- en modelroutering (stuur elke aanvraag naar het goedkoopste model dat het aankan, inclusief open modellen); en redeneringscontrole (betaal niet voor diep redeneren bij triviale aanroepen). Gecombineerd besparen deze hefbomen doorgaans veel meer op de werkelijke rekening dan welke tariefwijziging dan ook. Als concreet anker: bij 10 miljoen tokens per maand met een invoeraandeel van 70%, komen de nieuwe tarieven van Luna neer op ruwweg $5 per maand (ongeveer $4,37 met caching); hetzelfde volume op Sol kost ongeveer $125 per maand — het duidelijkste argument voor routering op basis van moeilijkheidsgraad.
Hoe u de lagere prijzen onmiddellijk kunt vastleggen
Hier is het onderdeel dat alles met elkaar verbindt. a href="https://www.orcarouter.ai/">OrcaRouter/a> rekent 0% opslag en geeft providerprijzen rechtstreeks door, dus OpenAI's tarief is al live op OrcaRouter: GPT-5.6 Luna toont $0.20 / $1.20 en Terra $2 / $12 op de modelpagina's op dit moment — dezelfde tarieven als op OpenAI's eigen prijskaart, bereikbaar via één OpenAI-compatibele endpoint naast 185+ andere modellen. Je krijgt dat tarief zonder migratie, en je kunt de prijzen van Luna en Terra vergelijken met DeepSeek, GLM, Qwen, Gemini en Claude op één plek, en vervolgens elk verzoek routeren naar wat het goedkoopst is voor de taak. Er is ook een gratis laag en een Offers-pagina voor extra besparingen.

De prijsverlaging is al live op OrcaRouter: GPT-5.6 Luna voor $0,20 / $1,20 per 1M tokens, doorberekend zonder opslag.
Kies je route op moeilijkheidsgraad om nog meer te besparen.
De goedkoopste rekening is niet één model — het is het juiste model per aanvraag. Omdat OrcaRouter het hele veld via één endpoint beschikbaar stelt, kun je eenvoudige, hoogvolume-aanvragen naar Luna of een goedkoop open model sturen en Sol of een ander vlaggenschip reserveren voor de moeilijke, met een configuratiewijziging in plaats van een herintegratie. Een prijsverlaging op Luna maakt die route-op-moeilijkheid-strategie nog goedkoper, zonder dat je iets opnieuw hoeft aan te sluiten.

Veelgestelde vragen
Met hoeveel heeft OpenAI de prijzen van GPT-5.6 verlaagd?
GPT-5.6 Luna daalde van $1 / $6 naar $0,20 / $1,20 per miljoen tokens (ongeveer 80%), en GPT-5.6 Terra van $2,50 / $15 naar $2 / $12 (ongeveer 20%). GPT-5.6 Sol bleef op $5 / $30.
Wanneer ging de prijsverlaging in?
30 juli 2026, geregistreerd in OpenAI's API-changelog en live op de gepubliceerde tariefkaart.
Waarom heeft OpenAI de prijzen verlaagd?
OpenAI schrijft dit toe aan inferentie-optimalisaties — herschreven productie-GPU-kernels (ongeveer 20% lagere servingkosten) en een herontworpen draftmodel voor speculatieve decodering (15%+ tokengeneratie-efficiëntie) — volgens een technische blogpost van 29 juli 2026.
Is het vlaggenschip (Sol) goedkoper geworden?
Nee. GPT-5.6 Sol blijft $5 / $30 per miljoen tokens. Alleen de twee goedkopere lagen, Luna en Terra, zijn verlaagd.
Hoe verhouden de nieuwe prijzen zich tot Anthropic en open modellen?
Volgens berichten onderbiedt Luna Anthropic's Haiku 4.5 nu met ongeveer 5x input / 4x output, en Terra valt onder de standaardprijzen van Claude Sonnet 5 ($3 / $15). Luna ligt ook dicht bij de goedkope ondergrens voor open modellen die door DeepSeek en GLM-5.2 is vastgesteld.
Wat is het addertje onder het gras met reasoning tokens?
GPT-5.6 zijn redeneringsmodellen; interne redeneertokens worden als uitvoer gefactureerd, dus de effectieve uitvoerkosten kunnen een naïeve schatting overschrijden. Stem de redeneerinspanning af en begrens de uitvoer om dit te beheersen.
Hoe krijg ik de nieuwe lagere prijzen?
Ze zijn al live op de OpenAI-API en, met 0% opslag, op OrcaRouter — waar GPT-5.6 Luna $0,20 / $1,20 toont — via één OpenAI-compatibel endpoint, zonder code-aanpassingen.
Kortom
{{1}}De prijsverlaging van OpenAI op 30 juli maakt GPT-5.6 Luna en Terra drastisch goedkoper bij hoge volumes{{/1}} — {{2}}een efficiëntiedividend van kernel-herschrijvingen en winst uit speculatieve decodering{{/2}}, en {{3}}een duidelijk antwoord op een echte prijzenoorlog die nu onder de goedkopere lagen van Anthropic duikt en de ondergrens van open modellen benadert{{/3}}. {{4}}Het vlaggenschip Sol is ongewijzigd, dus routeer op moeilijkheidsgraad, vertrouw op caching en batchverwerking, en beheer redeneertokens om het meest te besparen{{/4}}. {{5}}En omdat OrcaRouter providerprijzen doorberekent met 0% opslag, zijn de lagere tarieven daar al live{{/5}} — {{6}}dezelfde prijs, één OpenAI-compatibel eindpunt, het hele modellenaanbod op één plek{{/6}}. {{7}}Profiteer van de verlaging zonder een regel code te wijzigen, en laat elke aanvraag het goedkoopste model kiezen dat de klus kan klaren{{/7}}.
