Een gegenereerde hero-kaart met de kop 'Drie posts diep' en de ondertitel 'GPT-6.1 Ultrafast is Pro $500 alleen in ChatGPT — open voor alle API-gebruikers', chips met de tekst 'Pro $500-abonnement', 'Enterprise en Edu komen in aanmerking' en 'alle API-gebruikers', en een voettekst met 'Beschikbaarheid volgens OpenAI-documentatie, 8 oktober 2026'.
Guides & Insights

GPT-6.1 Ultrafast is Pro, slechts $500, en dat detail stond pas drie berichten diep.

Auteur

Alistair Wren

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

GPT-6.1 Sol Ultrafast arrived on October 8, 2026 with the rarest thing a speed tier can ship with: a published price. $12.00 per million input tokens, $60.00 per million output tokens, exactly six times what GPT-6.1 Sol — the model O​penAI released on September 29, 2026 at its DevDay 2026 keynote — costs on the standard lane. What the announcement thread did not lead with is where a ChatGPT subscriber can actually switch it on, and the answer, three posts further down, is the $500 Pro plan. That ordering is worth more attention than it got, because the API half and the subscription half of this rollout are gated in opposite ways, and the difference decides whether Ultrafast is something you can try this week or something you have to buy a plan for.

Er is niets aan het model veranderd. GPT-6.1 Sol Ultrafast is hetzelfde checkpoint, hetzelfde contextvenster van 1.050.000 tokens, hetzelfde uitvoerplafond van 128.000 tokens, dezelfde kennisafsluitdatum van 30 april 2026 en dezelfde antwoorden als GPT-6.1 Sol. Ultrafast is een servicelaag — een planningsprioriteit die je aanvraagt — geen tweede model. Het hele product is latentie, verkocht tegen een veelvoud, en de enige twee vragen die ertoe doen, zijn hoeveel ervan je krijgt en wie het mag kopen.

Wat het record eigenlijk zegt, in de volgorde waarin het dat zegt

The grievance version of this story is that O​penAI buried the gate. The accurate version is more specific, and it is checkable line by line against O​penAI's own documentation.

De changelog voor ontwikkelaars bevat de vermelding van 8 oktober: toevoeging van Ultrafast-modus voor GPT-6.1 Sol in de Responses API, aangevraagd door het verzenden van model: "gpt-6.1-sol" met service_tier: "ultrafast", beschreven als het verminderen van de tijd tussen gegenereerde uitvoertokens, en vermeld als beschikbaar voor alle API-gebruikers onder voorbehoud van snelheidslimieten, met wereldwijde verwerking en gegevensresidentie in de VS en de EU. Op zichzelf gelezen is dat een onbeperkte lancering tegen een gepubliceerd tarief.

De tierdocumentatie zegt dat Ultrafast de snelste servicelaag in de API is, breed beschikbaar voor GPT-6 Astra en GPT-6.1 Sol met previewtoegang voor GPT-5.6 Sol, en raadt WebSockets hiervoor aan. Nog steeds geen vermelding van een abonnement.

A screenshot of OpenAI's Ultrafast mode documentation page inside the API production guide, headed 'Ultrafast mode' and described as the fastest API service tier for latency-sensitive work, stating it is broadly available for GPT-6 Astra and GPT-6.1 Sol with preview access for GPT-5.6 Sol.

Het abonnementsdetail staat op de snelheidspagina aan de ChatGPT-kant, en het zijn drie beperkingen opgestapeld in één alinea: Ultrafast is beschikbaar in Codex en ChatGPT Work, op Pro voor $500, en op in aanmerking komende Enterprise- en Edu-abonnementen. Enterprise-beheerders krijgen het standaard uitgeschakeld en moeten het per gebruiker of per workspace inschakelen. En het consumenten-Chat-oppervlak krijgt het niveau helemaal niet — GPT-6.1 Sol zelf leeft in Work en Codex, dus Chat viel nooit binnen de scope.

Put the three pages together and the shape is clear. An API key is a ticket. A ChatGPT subscription is a ticket only if it is the most expensive one O​penAI sells, or if an administrator has enabled it for you. Nobody reading the first post of the announcement would guess that.

Waarom de poort bestaat, en het is niet willekeurig

The obvious reading is that O​penAI is using the fast lane to sell $500 plans. The mechanism underneath is less cynical and more useful: Ultrafast is an expensive meter, and a $500 plan is the only consumer plan where an 8x meter fits inside the included usage.

Bij een abonnement wordt inbegrepen verbruik tegen acht keer het standaardtarief afgetrokken wanneer je Ultrafast gebruikt, dus één Ultrafast-beurt verbruikt evenveel tegoed als acht standaardbeurten. Dat is een gevolg van wat het niveau doet — het koopt kloktijd door serveercapaciteit te besteden, en een abonnement is een product met vaste capaciteit. Reken hetzelfde tegoed voor acht keer het capaciteitsverbruik en de economie van het abonnement breekt bij $20 per maand. Reken acht keer het tegoed en het niveau wordt simpelweg onaantrekkelijk op een klein abonnement. Hoe dan ook komt het niveau uit waar het tegoed groot genoeg is om het op te vangen.

The API has no such constraint, because it is metered. There, Ultrafast gets its own rate-limit budget, separate from the Standard and Fast budgets, and O​penAI describes those limits as set per organization rather than published on the tier page. That is a second thing to watch that the announcement did not headline: switching a workload to Ultrafast does not just multiply the bill, it moves the workload onto a different ceiling, and if you raise traffic beyond what the organization was granted, the tier's own limits become the failure mode.

De rekensom achter het op twee verschillende manieren kopen van snelheid

Hier is de beslissing in cijfers, en het is het deel dat het waard is om op je eigen tokenaantallen te doen in plaats van op de mijne. Neem een agentsessie die 30.000 invoertokens verstuurt en 1.500 uitvoertokens per beurt ontvangt, over 40 beurten.

• Total tokens per run — 1,200,000 input, 60,000 output, spread over 40 requests that each sit comfortably under the 272,000-token threshold where O​penAI reprices the whole request.

• Op standaard GPT-6.1 Sol — 1,2 miljoen tokens tegen $2,00 per miljoen is $2,40, plus 60.000 tegen $10,00 per miljoen is $0,60. Drie dollar per uitvoering.

• Op GPT-6.1 Sol Ultrafast — 1,2 miljoen tegen $12,00 is $14,40, plus 60.000 tegen $60,00 is $3,60. Achttien dollar per run.

• Het verschil — $15,00 per uitvoering om het grootste deel van de generatietijd weg te nemen bij een taak die verder niet verandert.

Dat bedrag van $15,00 per uitvoering is het getal dat je tegenover het abonnement moet afwegen. Als Ultrafast de enige reden is dat je het Pro plan overweegt, ligt het omslagpunt tussen de $500 van het plan en de per-tokenmeter van de API bij ongeveer 33 uitvoeringen per maand bij deze tokenaantallen — daaronder is de meter de goedkopere manier om dezelfde tier te kopen, en daarboven begint het plan te winnen. Je tokenaantallen zullen dat omslagpunt verschuiven, soms behoorlijk, dus reken je eigen cijfers door voordat je 33 als drempel beschouwt. Het is onze berekening op basis van een opgegeven werklast, geen gepubliceerd break-evenpunt.

A generated cost card headed 'The same 40-turn agent, two bills', showing two panels: GPT-6.1 Sol on the standard tier at $3.00 per run and GPT-6.1 Ultrafast at $18.00 per run, both for 1,200,000 input and 60,000 output tokens, with a footer reading that prices are OpenAI's own per-million list rates and the arithmetic is ours.

p>Twee structurele opmerkingen die elke tokentelling overleven.

De snelheidsclaim is geleend, en het is het enige dat je aandachtig moet lezen.

Ultrafast is sold on "up to 8x faster", and the only model-specific measurement O​penAI publishes behind that phrase belongs to a different model. The sentence in its documentation reads that GPT-6 Astra Ultrafast generates tokens up to 8x faster than GPT-6 Astra in Standard mode in Codex. That is an Astra figure, measured in Codex. The documentation for GPT-6.1 Sol's tier describes it as reducing inter-token time and points at a rate card; it does not put a number on it, and no independent party has published a tokens-per-second measurement for the Sol variant either.

Het kan heel goed standhouden. Beide modellen draaien op dezelfde servingstack en het tier-mechanisme is hetzelfde, dus een Astra-veelvoud is een redelijke prior voor Sol. Maar "tot 8x" is een leveranciersplafond, niet gereproduceerd, overgenomen van een zustermodel — en het "tot" doet in die zin het echte werk. Behandel het veelvoud als een hypothese die je op je eigen prompts test, want de eigen documentatie van de tier test het nooit voor je.

Hetzelfde voorbehoud is gemakkelijker te maken voor de oudere tiers. Ultrafast boven GPT-5.6 Sol werd op 13 augustus 2026 aangekondigd met "tot 14x sneller dan Standard processing" in beperkte preview, en drie maanden later zegt de documentatie nog steeds previewtoegang, terwijl de Ultrafast-tarieventabel precies twee rijen bevat — GPT-6 Astra en GPT-6.1 Sol. Een 14x-getal zonder gepubliceerde prijs en zonder algemene beschikbaarheid is een claim in plaats van een product, en het is een nuttige herinnering eraan hoeveel van deze tierladder nog toekomstmuziek is.

Als het $500-plan niet doorgaat

Voor iedereen die geen Pro van $500 gaat kopen om een latency-tier te testen, is de nuttige zet om de twee dingen die de aankondiging bundelde, te scheiden. De tier is op de API beschikbaar voor alle API-gebruikers, dus de snelle lane is te koop zonder abonnement — voor $12,00 en $60,00 per miljoen tokens, met een eigen rate-limitbudget, op een workload die klein genoeg is om te meten. Test het daar eerst, met je eigen prompts, tegen de standaard lane.

The standard lane is the one that exists without any of this. OrcaRouter serves GPT-6.1 Sol as openai/gpt-6.1-sol at O​penAI's own list rates — $2.00 per million input tokens and $10.00 per million output tokens — with 0% markup and the provider's price passed straight through, so a vendor repricing lands on our side the same day. Ultrafast is not something we sell: it is a service-tier flag billed on your own O​penAI account, and we would rather say that plainly than let a model page imply otherwise. What one key does buy is the ability to route the standard lane and the rest of the catalogue — more than 200 models behind one O​penAI-compatible endpoint — and to fail over automatically across providers when one is degraded, which is the cheapest insurance available if you are about to put a latency tier in front of a production path.

A generated availability card headed 'Where GPT-6.1 Ultrafast can be switched on', with an 'Included' column listing the API for all users subject to rate limits, Codex and ChatGPT Work on Pro $500, and eligible Enterprise and Edu with administrator opt-in, and a 'Not included' column listing ChatGPT Plus and Team plans and the consumer Chat surface, footnoted to OpenAI's API changelog dated 8 October 2026 and the ChatGPT speed page.

En als je op Plus of Team zit en het antwoord waar je naar zocht "kan ik dit gewoon aanzetten" was, dan is het antwoord nee, met een specifieke vorm. Codex en ChatGPT Work op Pro $500 of een in aanmerking komend Enterprise- of Edu-abonnement, indien van het enterprise-type ingeschakeld door een beheerder. Al het andere bereikt Ultrafast via de API en betaalt per token.

Wat nu te kijken

Drie dingen zouden dit van een afgeschermde uitrol in een gewone uitrol veranderen, en alle drie zijn ze waarneembaar. Een gepubliceerde Ultrafast-snelheidslimiet voor GPT-6.1 Sol zou een einde maken aan het giswerk of het eigen plafond van de tier bindt voordat de rekening dat doet. Een modelspecifieke snelheidsmeting — of een onafhankelijke — zou het geleende Astra-getal vervangen door iets waarop de Sol-tier kan worden beoordeeld. En als Ultrafast ChatGPT Plus zou bereiken, zou dat betekenen dat de capaciteitsrekensom is veranderd, wat het signaal is dat de gate eerder het gevolg was van lanceringsschaarste dan de permanente vorm van de tier.

Tot die tijd is de eerlijke samenvatting beperkt en controleerbaar. GPT-6.1 Sol is op 29 september 2026 uitgekomen en is ongewijzigd. Op 8 oktober 2026 kreeg het een snelle route met een echte prijs, open voor API-gebruikers en in ChatGPT achter het $500-abonnement afgeschermd — een detail dat de eerste post verdiende in plaats van de derde, en dat voor de meeste lezers bepaalt of dit een regelpost of een inkooporder is.

Vergeleken in dit artikel1

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt