
GPT-6.1 Sol-prijzen: de tariefkaart, de ene meter die bewoog, en de 272K-klif
- openaiNIEUWOpenAI: GPT-6.1 Sol2026-09-2952Intelligentie
- anthropicNIEUWAnthropic: Claude Sonnet 5.52026-09-2856Intelligentie
- typesafeNIEUWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 mln tokens · 161 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligentie
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligentie
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligentie
- xAIGrok 4.72026-09-2146Intelligentie
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 mln tokens · 79 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 mln tokens · 53 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens · 301 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
Deze pagina is de tariefkaart. GPT-6.1 Solkost $2,00 per miljoen inputtokens, $0,10 per miljoen gecachete inputtokens, $2,50 per miljoen cache-schrijftokens en $10,00 per miljoen outputtokens op de standaardlaag van de leverancier, en GPT-6 Sol— de trede die dit model vervangt, en degene die onze catalogus bedient — bedraagt $2,00, $0,20, $2,50 en $10,00 voor dezelfde vier meters. Eén getal verschilt tussen de twee kaarten, de drempel waarboven beide worden herprijsd staat op dezelfde plek, en de kortingen onder de lijstprijs zijn vermenigvuldigers en niet een tweede prijslijst. Alles op deze pagina is overgenomen van de eigen prijzenpagina voor ontwikkelaars van de leverancier en zijn twee modelpagina's voor GPT-6.1 Sol en GPT-6 Sol, allemaal geraadpleegd op 7 oktober 2026, en van onze eigen modelkaarten waar een cijfer als het onze staat aangeduid. Er wordt hier geen lanceringsverhaal herhaald; als je wilt weten wat er is uitgeleverd, is dat een andere pagina.
De tariefkaart, met de vier meters van GPT-6 Sol direct eronder
OpenAI publiceert deze als prijzen per miljoen tokens op de standaardverwerkingslaag, voor een verzoek van maximaal 272.000 inputtokens. De twee rijen die ertoe doen, staan met opzet naast elkaar, want het hele betoog van de release is zichtbaar in dat paar: lees elke meter op zijn beurt van boven naar beneden en precies één ervan verandert.
• GPT-6.1 Sol-invoer — $2,00 per miljoen tokens, ongewijzigd ten opzichte van GPT-6 Sol.
• GPT-6.1 Sol-invoer uit cache — $0,10 per miljoen tokens, gehalveerd ten opzichte van de $0,20 van GPT-6 Sol.
• GPT-6.1 Sol cacheschrijven — $2,50 per miljoen tokens, ongewijzigd ten opzichte van GPT-6 Sol.
• GPT-6.1 Sol-uitvoer — $10,00 per miljoen tokens, ongewijzigd ten opzichte van GPT-6 Sol.
• Invoer van GPT-6 Sol — $2.00 per miljoen tokens.
• Gecachte invoer van GPT-6 Sol — $0.20 per miljoen tokens.
• Cache-schrijfactie van GPT-6 Sol — $2.50 per miljoen tokens.
• Uitvoer van GPT-6 Sol — $10.00 per miljoen tokens.
Drie van die acht regels zijn hetzelfde getal dat tweemaal is opgeschreven, en dat is juist het punt: dit is geen prijsherziening, het is één meter die op één model verschuift. Cache-schrijfacties zijn 1,25× het niet-gecachte invoertarief op beide kaarten, dus $2,50 is $2,00 × 1,25 op beide kaarten — de schrijftoeslag is een eigenschap van de familie, niet van de versie. Gecachte leesacties zijn de enige regel waarop de twee modellen uiteenlopen: op GPT-6.1 Sol is een gecachte leesactie 5% van het invoertarief, op GPT-6 Sol is dat 10%, en OpenAI vermeldt beide als fracties van het invoertarief in plaats van als zelfstandige prijzen.
Een opmerking over hoe deze pagina cijfers vermeldt. OpenAI publiceert de tariefkaart als een vaste lijstprijs per meter, zonder dat bij een van de acht regels hierboven een kwalificatie voor redeneerinspanning is toegevoegd, dus geen ervan wordt tegen een bepaald inspanningsniveau vermeld. Inspanning verandert hoeveel tokens een taak verbruikt, niet wat een token kost; daarom is de kaart inspanningsonafhankelijk, terwijl uw factuur dat niet is. Niets op deze pagina is een directe vergelijking met gelijke inspanning tegen een concurrerend model, en een dergelijke vergelijking wordt hieronder nergens gesuggereerd — waar een cijfer van de inspanning afhangt, vermeldt deze pagina het inspanningsniveau waarop het is geproduceerd.

De enige regel die veranderde: gecachede input, $0,20 naar $0,10
Een meter voor gecachte invoer berekent de prijs voor het deel van een verzoek dat niet is gewijzigd. Wanneer een lange, stabiele prefix — een systeemprompt, een set toolschema's, een opgehaald corpus, het verzamelde transcript van een lus — opzettelijk wordt opgeslagen zodat het volgende verzoek die opnieuw kan gebruiken, worden de hergebruikte tokens tegen het cachetarief in rekening gebracht in plaats van tegen het invoertarief, en de tokens die in de eerste plaats worden opgeslagen, worden tegen het cache-schrijftarief in rekening gebracht. Het is een korting op herhaling, en die bestaat omdat het alternatief voor de aanbieder is om dezelfde prefix bij elke aanroep vanaf nul opnieuw te berekenen.
Het halveren van die meter is niet hetzelfde soort nieuws als het halveren van de inputmeter, en het is de moeite waard om dat onderscheid precies te maken. Het inputtarief bepaalt wat elke niet-gecachte token in de familie kost, dus het halveren ervan zou een herprijzing van de hele cataloguslijn betekenen. Het cachetarief is een kortingsdiepte — hoe ver onder het inputtarief een hergebruikte token ligt — dus het aanpassen ervan verandert de beloning voor een specifiek gedrag, niet de basislijn. Het inputtarief van GPT-6.1 Sol is $2.00, precies wat GPT-6 Sol rekent, dus een verzoek zonder gecachte prefix wordt op de twee modellen identiek gefactureerd. Het halveren van de cachemeter brengt de korting op input van 90% naar 95%, en dat bereikt precies de workloads waarvan de prefixen lang genoeg zijn en vaak genoeg worden hergebruikt om überhaupt op de lijn te worden geregistreerd. Lees de verplaatste meter als "dezelfde taak kost minder als je cachet" in plaats van "het model is goedkoper geworden", en de kaart houdt op verrassend te zijn.
De rekensom volgt uit de twee rijen en niets anders. Eén miljoen gecachte invoertokens kost $0,10 op GPT-6.1 Sol en $0,20 op GPT-6 Sol, dus de release is tien cent per gecachte miljoen waard — een bedrag dat verwaarloosbaar is bij één aanroep en substantieel bij een lange run, omdat een gecachte prefix één keer per beurt wordt gelezen. Cache-schrijfacties blijven ongewijzigd op $2,50, dus het break-evenpunt om überhaupt te cachen blijft ongewijzigd door de release: de terugverdiening van een schrijfpremie komt voort uit het hergebruiken van de prefix, niet uit welk van de twee gecachte tarieven van toepassing is.
Boven 272.000 inputtokens wordt de hele aanvraag opnieuw geprijsd.
Beide kaarten hebben een long-contexttier, en de prijspagina van OpenAI vermeldt de regel voor beide op dezelfde manier: prompts met meer dan 272K inputtokens worden geprijsd tegen 2× de input- en cachetarieven en 1,5× de output voor de volledige aanvraag. De hele aanvraag wordt opnieuw geprijsd — niet alleen de tokens voorbij de grens. Die zin is de zin die je uit deze sectie moet meenemen, want hier houdt een tariefkaart op een opzoektabel te zijn: bij 272.001 inputtokens wordt de volledige aanvraag, inclusief het eerste token, gefactureerd volgens de kolommen voor lange context.
De herziene prijskaart voor GPT-6.1 Sol, boven 272.000 inputtokens:
• Invoer — $4,00 per miljoen tokens, 2× het tarief voor de korte context.
• Gecachte invoer — $0,20 per miljoen tokens, 2× het tarief voor de korte context.
• Schrijven naar cache — $5,00 per miljoen tokens, 2× het tarief voor de korte context.
• Uitvoer — $15,00 per miljoen tokens, 1,5× het tarief voor de korte context.
En dezelfde tier op GPT-6 Sol, zodat de twee rijen met elkaar vergeleken kunnen worden:
• Invoer — $4,00 per miljoen tokens.
• Gecachte invoer — $0,40 per miljoen tokens.
• Schrijven naar cache — $5,00 per miljoen tokens.
• Uitvoer — $15,00 per miljoen tokens.
Opnieuw wordt de hele aanvraag herprijst, niet het overschot, dus een prompt van 273.000 tokens wordt voor alle 273.000 tokens tegen $4,00 input gefactureerd in plaats van tegen $2,00 voor de eerste 272.000 en $4,00 voor de laatste duizend. Daardoor is het overschrijden van de drempel een stap in plaats van een helling, en daardoor ziet de wijziging in gecachte input er boven de lijn anders uit dan eronder. De $0,20 die GPT-6.1 Sol rekent voor een gecachte leesbewerking boven 272K is precies het tarief dat GPT-6 Sol eronder rekent, dus een gecachte workload met lange context op het nieuwere model betaalt het pre-releasetarief. De besparing blijft in relatieve termen boven de lijn behouden — $0,20 tegenover de $0,40 van GPT-6 Sol is nog steeds een halvering — maar de geadverteerde tien cent is niet van toepassing op de aanvraag die de drempel overschrijdt, omdat die aanvraag helemaal niet op de tariefkaart voor korte context wordt gefactureerd.

De kortingsstaffels, als vermenigvuldigingsfactoren
Alles onder de standaard lijstprijs is een vermenigvuldiger die op de kaart hierboven wordt toegepast, in plaats van een aparte prijslijst. Ze als vermenigvuldigers vermelden is wat ze overdraagbaar maakt: dezelfde drie factoren gelden voor alle vier meters op beide modellen, zodat een lezer die de standaardkaart heeft de volledige staffelstructuur heeft.
• Batch — 50% van standaard. De Batch-prijzen van OpenAI zijn exact de helft voor alle vier de meters op beide modellen: $1,00 input, $0,05 gecachte input, $1,25 cacheschrijven en $5,00 output per miljoen op GPT-6.1 Sol, en $1,00, $0,10, $1,25 en $5,00 op GPT-6 Sol.
• Flex — 50% van standaard, en identiek aan Batch op beide modellen, regel voor regel, dus de keuze tussen beide is een planningskeuze in plaats van een prijskeuze.
• Fast mode — 2× standaard voor alle vier de meters op beide kaarten, zonder enige uitzondering die op een van beide prijstabellen wordt vermeld. Fast mode is $4,00 input, $0,20 gecachte input, $5,00 cacheschrijven en $20,00 output per miljoen op GPT-6.1 Sol, tegenover $4,00, $0,40, $5,00 en $20,00 op GPT-6 Sol — de twee rijen verschillen alleen op de gecachte regel, en alleen met dezelfde factor 2× die het eigen standaardtarief voor gecachte input van elk model al heeft.
• Regionale verwerking — een opslag van 10% bovenop het geldende niveau, voor modellen die op of na 5 maart 2026 zijn uitgebracht, bij elke andere residentie dan de standaardresidentie.
Fast mode kent één beschikbaarheidsbeperking die je uit de prijs alleen niet kunt opmaken. Op de eigen modelpagina van OpenAI voor GPT-6.1 Sol staat dat Fast mode niet beschikbaar is bij EU-dataresidentie, en in de richtlijnen voor dataresidentie wordt GPT-6.1 Sol genoemd bij de modellen die EU-residentie ondersteunen met Standard-, Flex- en Batch-verwerking. Binnen de EU is de niveauladder dus twee treden korter, niet één: de niveaus tegen halve prijs bestaan wel, het verdubbelde niveau niet. Een lezer die een Europese deployment vergelijkt met een Amerikaanse, moet die met Standard vergelijken, want dat is het snelste niveau dat daarvoor beschikbaar is — het noemen van een Fast mode-cijfer voor een EU-workload beschrijft een configuratie die de leverancier niet aanbiedt.
Niets op deze kaart is promotioneel, en niets heeft een vervaldatum.
De GPT-6.1 Sol-rijen hierboven zijn het lijsttarief. De prijzenpagina van OpenAI voorziet ze niet van een promotionele aanduiding en ook niet van een einddatum, en op zowel de kaart voor korte context als die voor lange context is geen van de vier meters aangeduid als een tijdelijke prijs. Dat moet expliciet worden gezegd, want de familie heeft een tegenvoorbeeld op dezelfde pagina staan: de promotionele prijs van GPT-5.6 Sol heeft een voetnoot die deze ten minste tot en met 21 november 2026 vastlegt, wat betekent dat elke GPT-5.6 Sol-prijs die vandaag wordt genoemd, een prijs is waaraan een bekend beoordelingsmoment vastzit. Niets aan GPT-6.1 Sol heeft die vorm.
De praktische consequentie is dat deze pagina geen voorbehoud om de datum te controleren bij de cijfers zelf nodig heeft — die is nodig op de pagina die je nu leest, omdat een lijsttarief kan veranderen zonder dat een vervaldatum is afgegaan. Het betekent ook dat de GPT-6.1 Sol-kaart de juiste rij is om een kostenmodel op te bouwen als je tussen de twee Sol-niveaus kiest en wilt dat de vergelijking stabiel blijft: de cached meter van $0,20 van GPT-6 Sol is ook een gewoon lijsttarief zonder enige promotie, dus het verschil van tien cent tussen hen is een structureel verschil in de kaarten, niet een tijdelijke korting die het ene model tegenover het andere hanteert.
Hoe je de prijsclaim voor GPT-6.1 Sol van iemand anders leest
Twee vragen beslechten bijna elk meningsverschil over wat een Sol-class-model kost, en beide zijn te beantwoorden op basis van de kaart, niet op basis van de tekst eromheen.
• Welke meter wordt geciteerd? Input, gecachte input, cache-write en output zijn vier verschillende getallen bij dezelfde aanvraag, en één enkele kopprijs is bijna altijd de inputmeter, waarbij de andere drie impliciet blijven. Een bewering die leest als een totaalprijs is meestal een inputtarief vermenigvuldigd met een veronderstelde tokenmix, en in die veronderstelde mix zit het meningsverschil.
• Welke contexttier werd verondersteld? De kaarten voor korte en lange context verschillen met een factor 2 op input en cache en met een factor 1,5 op output, en de tier wordt bepaald door de hele aanvraag en niet door het overschot, dus een getal dat zonder tier wordt genoemd, is een getal dat verandert zodra de aanvraag de drempel van 272.000 inputtokens overschrijdt.
• Welke verwerkingslaag werd verondersteld? Standard, Batch, Flex en Fast verschillen met factoren van 2× en 50%, en een prijs die wordt genoemd zonder te zeggen welke, is een prijs met een factor vier aan ambiguïteit erin ingebouwd nog voordat er überhaupt een metervraag wordt gesteld.
• Welk inspanningsniveau werd verondersteld, als er een tokental in het spel is? Tarieven zijn onafhankelijk van de inspanning, maar tokentellingen niet, dus elk kostencijfer per taak erft de reasoning-inspanning waarmee het is gemeten — en een vergelijking tussen twee modellen bij verschillende inspanningsinstellingen is geen vergelijking van hun prijzen.
Beantwoord die vier, en een prijsclaim houdt stand of houdt geen stand. Wat een prijsclaim niet zou moeten doen, is vergeleken worden met de vier meters van deze pagina zonder dat eerst het niveau en de meter worden genoemd, omdat de twee kaarten precies naast elkaar staan, juist zodat de enige bewegende lijn zichtbaar is en niets anders ermee wordt verward.

Waar de GPT-6 Sol-trede wordt geserveerd
OrcaRouter levert het GPT-6-niveau tegen OpenAI's eigen lijsttarief, zonder iets extra's. De modelpagina op https://www.orcarouter.ai/models/openai/gpt-6-sol vermeldt GPT-6 Sol tegen $2,00 invoer en $10,00 uitvoer per miljoen tokens, regel voor regel overeenkomend met de kaart hierboven, tegen0% opslag, en de catalogus bevatmeer dan 200 modellen onder dezelfde voorwaarden. Onze kaart voor die route vermeldt dezelfde $0,20 voor gecachte invoer en $2,50 voor cache-schrijfacties die OpenAI publiceert, dus de cijfers komen meter voor meter overeen; beschouw elk gecachet cijfer op deze pagina als een herformulering van OpenAI's gepubliceerde tarief en niet als een zelfstandige offerte van ons. GPT-6.1 Sol staat eveneens in onze catalogus — de actuele kaart voor openai/gpt-6.1-sol vermeldt een releasedatum van 29 september 2026, waarbij beide prijsniveaus die van OpenAI spiegelen, en een tokentelling over zeven dagen in de honderden miljoenen — dus een lezer die het nieuwere niveau wil, kan beter de cijfers op die pagina zelf raadplegen dan deze pagina als het laatste woord daarover te beschouwen. Prijzen veranderen; de pagina is de offerte.
Vergeleken in dit artikel2
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
