Een gegenereerde titelkaart met de kop 'Ultrafast vs Standard' en de ondertitel 'Eén GPT-6.1 Sol-checkpoint, twee tariefkaarten', met chips met de tekst '$2.00 / $10.00 Standard' en '$12.00 / $60.00 Ultrafast', een '6x'-badge en de regel 'dezelfde tokens, zes keer de rekening', boven een voettekst die vermeldt dat de prijzen OpenAI's eigen lijsttarieven zijn voor aanvragen met een korte context.
Engineering & Research

GPT-6.1 Sol Ultrafast vs GPT-6.1 Sol: de snelle route kost meer dan het frontiermodel

Auteur

Magnus Corvin

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Het inschakelen van GPT-6.1 Sol Ultrafast maakt GPT-6.1 Sol de duurste manier in de GPT-6-familie om een token te genereren die niet door GPT-6 Astra wordt geproduceerd. Dat is de hele vergelijking in één zin, en het is het tegenovergestelde van wat "snelle optie op het goedkopere model" zou moeten betekenen. Ultrafast kost zes keer zoveel als Standard — $12,00 per miljoen inputtokens en $60,00 per miljoen outputtokens, tegenover $2,00 en $10,00 — waardoor een snelle GPT-6.1 Sol-aanroep boven GPT-6 Astra op normale snelheid uitkomt, boven GPT-5.6 Sol op normale snelheid, en binnen een afrondingsfout van niets anders op de tariefkaart.

Niets daarvan maakt van de tier een vergissing. Het maakt er een aankoop van latentie van, en de vraag die deze pagina beantwoordt, is wanneer de latentie die prijs waard is en wanneer niet. De twee producten die worden vergeleken, zijn hetzelfde checkpoint en dezelfde antwoorden; het hele verschil is een service-tier-flag en een rekening.

Hetzelfde model, en het is de moeite waard om precies te zeggen hoe hetzelfde.

Er is geen Ultrafast-checkpoint om te downloaden, geen aparte contextlimiet, geen andere kennisafsluitdatum. Je stuurt model: "gpt-6.1-sol" met service_tier: "ultrafast" en O​penAI plant het verzoek anders; stuur je het zonder de flag, dan krijg je Standard. Alles waartegen een ontwikkelaar daadwerkelijk codeert, is identiek:

• Model-id — gpt-6.1-sol voor beide, één standaardsnapshot, niets gedateerd om vast te pinnen

• Context — 1.050.000-tokenvenster, 922.000-token maximale invoer, 128.000-token maximale uitvoer, voor beide

• Kennisafsluiting — 30 april 2026, voor beide

• Redeneerladder — laag, gemiddeld (standaard), hoog, xhigh, max voor beide; geen en minimaal worden op beide niet ondersteund

• Modaliteiten — tekst en afbeelding als invoer, tekst als uitvoer, voor beide

• Beschikbare tools — dezelfde webzoekopdracht, bestandszoekopdracht, beeldgeneratie, code-interpreter, gehoste shell, patch toepassen, skills, computergebruik, MCP en toolzoekopdracht, via de Responses API, voor zowel

• Prijs — $2.00 / $0.10 gecached / $2.50 cache-schrijfactie / $10.00 output per miljoen tokens vs $12.00 / $0.60 / $15.00 / $60.00

• Lange prompts boven 272K invoertokens — de hele aanvraag wordt opnieuw geprijsd tegen 2x de invoer- en cachetarieven en 1,5x de uitvoer voor beide, dus Ultrafast long-context komt uit op $24,00 / $1,20 / $30,00 / $90,00

• Snelheid — Standard is Standard; Ultrafast is de top van de tierladder, en de enige gepubliceerde modelspecifieke multiplier in de OpenAI-documentatie is van GPT-6 Astra, niet van dit model

Die laatste regel is het eerlijke voorbehoud bij het hele artikel. De documentatie van OpenAI zegt dat GPT-6 Astra Ultrafast "tot 8x sneller tokens genereert dan GPT-6 Astra in Standard mode in Codex". De documentatie van GPT-6.1 Sol beschrijft de tier, somt de bijbehorende rate limits op en zegt dat het dataresidentie in de VS en de EU ondersteunt — er wordt geen vermenigvuldigingsfactor gepubliceerd. Als je dit koopt omdat je acht keer de snelheid verwacht, extrapoleer je vanuit een zustermodel, en voor geen van beide bestaat een onafhankelijke meting.

A screenshot of OpenAI's API pricing page with the Ultrafast tab selected, showing two rows: gpt-6-astra at $60.00 input, $6.00 cached input, $75.00 cache writes and $300.00 output per 1M tokens short-context stepping to $120.00 / $12.00 / $150.00 / $450.00 in long context, and gpt-6.1-sol at $12.00 / $0.60 / $15.00 / $60.00 short-context stepping to $24.00 / $1.20 / $30.00 / $90.00, with the page's note that short context means up to 272K input tokens.

Het uitgewerkte voorbeeld: wat een agent-turn op elke lane kost

Laat een coding agent een echte, onglamoureuze lus doorlopen: elke beurt herleest 40.000 tokens aan repositorycontext en genereert 6.000 tokens aan redenering en patch, en de taak duurt twaalf beurten. Ga ervan uit dat niets gecacht is, wat het pessimistische scenario is en het scenario waarin de tier op input het slechtst uit de verf komt; doe het dan nog eens met de context gecacht, want dat is wat een agent met prompt-caching in werkelijkheid doet.

• Standaard, zonder cache — 40.000 inputtokens kosten $0,08 en 6.000 outputtokens kosten $0,06, dus $0,14 per beurt en $1,68 voor de taak

• Razendsnel, niet-gecachet — $0,48 aan input en $0,36 aan output per beurt, $0,84 per beurt, $10,08 voor de taak

• Standaard, gecachte context — de 40.000 tokens dalen naar $0,10 per miljoen, dus de beurt is $0,064 en de taak is $0,77

• Ultrasnelle, gecachte context — gecachte invoer is $0,60 per miljoen op dit niveau, dus de beurt is $0,384 en de taak is $4,61

De vermenigvuldiger is zes in elke rij, en dat is nu juist het punt: caching beschermt je niet tegen de tier, maar schaalt ermee mee. Wat de cijfers opleveren, is een taak die in ongeveer een achtste van de wall-clocktijd klaar is, en de hele beoordeling is of het wegnemen van die wachttijd $2,40 tot $8,40 per taak waard is.

Dit is echter de vergelijking die voor de meeste teams de doorslag zou moeten geven. Reken dezelfde tokenaantallen op GPT-6 Astra bij Standard af — $0,40 aan input en $0,30 aan output per beurt, $8,40 voor de taak. Ultrafast op GPT-6.1 Sol is per token duurder dan het frontiermodel op normale snelheid. Dat is geen argument tegen de tier; het gaat erom op welke dimensie je optimaliseert. Is je probleem de kwaliteit van de antwoorden, dan is Astra bij Standard een beter gebruik van het geld. Is je probleem dat een mens naar een spinner zit te staren, dan helpen noch Astra noch Sol, maar de tier wel.

Eén voorbehoud voordat iemand op basis van deze cijfers een budget opstelt: het aantal tokens is niet constant tussen modellen voor dezelfde taak. Dit zijn vergelijkingen per token bij identieke veronderstelde tokenaantallen, en dat is de enige vergelijking die de tariefkaart ondersteunt. Meet je eigen traces.

A generated cost card headed 'One agent turn, four ways', comparing GPT-6.1 Sol Standard at $0.14 per turn and $1.68 over twelve turns uncached and $0.064 and $0.77 with prompt caching, GPT-6.1 Sol Ultrafast at $0.84 and $10.08 uncached and $0.384 and $4.61 cached, and GPT-6 Astra Standard at $0.70 and $8.40 on the same token counts, over a footer reading that these are OpenAI list rates per 1M tokens for short-context requests and that the per-turn and per-task figures are the article's arithmetic on those rates rather than vendor benchmarks.

De tier die je waarschijnlijk eigenlijk wilt, is Fast

Tussen Standard en Ultrafast ligt een middenweg, en voor GPT-6.1 Sol is dat degene die de meeste teams het eerst zouden moeten prijzen. Fast mode draait tegen Standard — $4,00 input en $20,00 output per miljoen tokens — voor dezelfde checkpoint, en O​penAI heeft Priority processing op 30 juli 2026 omgedoopt tot Fast mode, dus het is al maanden stabiel. Het is een derde van het tarief van Ultrafast voor een versnelling die de tierdocumentatie als het gewone ondersteunde geval beschouwt.

Ultrafast is het juiste antwoord wanneer de latentie het product is en het tokenvolume klein is: een interactieve agent die zijn volgende stap niet kan zetten voordat de vorige output binnenkomt, een ontwikkelaarslus waarin veertig korte beurten zich opstapelen, een demo waarin de pauze de faalmodus is. Fast is het juiste antwoord wanneer je een over het algemeen sneller model wilt en niet bereid bent het driedubbele te betalen voor de laatste toename. Batch en Flex blijven het juiste antwoord voor alles met een deadline die in uren wordt gemeten — ze kosten de helft van Standard, niet het dubbele.

Snelheid is ook niet de enige hefboom. Als de latentie die je probeert weg te nemen het nadenken van het model is in plaats van het typen van het model, doet de tier niets voor je: Ultrafast comprimeert de tokengeneratie, en de eigen beschrijving van OpenAI is dat het "de tijd tussen gegenereerde outputtokens verkort". Een verzoek dat het grootste deel van zijn kloktijd aan redeneren besteedt, zal maar met een fractie van wat de prijs suggereert eerder aankomen. Zet de redeneerinspanning een tandje lager en kijk wat dat met de rekening doet voordat je de tier zes stappen hoger zet.

Waar de standaardbaan leeft

Standaard GPT-6.1 Sol staat op OrcaRouter als openai/gpt-6.1-sol tegen het eigen tarief van de provider van $2,00 input en $10,00 output per miljoen tokens, geleverd met 0% markup — de lijstprijs van de leverancier wordt doorgegeven, zodat een tariefwijziging van OpenAI dezelfde dag nog in je verbruik terug te zien is in plaats van bij de volgende verlenging. Met dezelfde sleutel bereik je meer dan 200 modellen, zodat het verkeer op de standaardbaan dat je na het Ultrafast-experiment aanhoudt, achter één integratie kan zitten naast al het andere dat de taak nodig heeft, met automatische failover als een provider achteruitgaat en een routing-DSL om modellen in één enkele aanroep samen te stellen.

Ultrafast zelf is niet iets wat we je kunnen verkopen, en het zou oneerlijk zijn om het anders te formuleren. Het is een service-tier-flag die door OpenAI op je eigen account in rekening wordt gebracht, geen afzonderlijk routeerbaar model — wij hosten de checkpoint, niet de tier. Draai het tiered verkeer met je leverancierssleutel; routeer het volume via ons.

A screenshot of the OrcaRouter model page for GPT-6.1 Sol, model id openai/gpt-6.1-sol, showing a 1M-token context window, 128K maximum output, text, image and file input with text output, vision, tools, JSON and reasoning capabilities, public benchmarks attributed to OpenAI dated 2026-09-29, input price $2.00 and output price $10.00 per 1M tokens, p50 time to first token 6.14 s and 313.9M tokens of traffic, with the page's code snippet and EN language toggle visible in the header.

Wie moet het omschakelen

Laat het aan staan als een persoon of een geautomatiseerde consument bij elke reactie geblokkeerd is en het tokenvolume per taak klein genoeg is dat de absolute rekening in de lage dollars blijft — de berekening hierboven zet een agenttaak van twaalf beurten op ongeveer $10, wat een goedkope oplossing is als het twee minuten menselijk wachten vervangt en een dure als het helemaal niets vervangt.

Laat het uit als je workload gepland, gebatcht, in bulk geëvalueerd of 's nachts opnieuw uitgevoerd wordt. Uit is ook juist als hetgeen je najaagt kwaliteit is: zes keer de kosten leveren op dit model helemaal geen extra capaciteit op, en hetzelfde geld gericht op GPT-6 Astra bij Standard is een echte upgrade in plaats van een snellere spinner. Ultrafast verkoopt tijd, en tijd is alleen $60 per miljoen tokens waard voor de workflows die er daadwerkelijk op wachten.

Vergeleken in dit artikel1

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt