
GPT-6.1 Sol Ultrafast rullas ut till API, Codex och ChatGPT Work
- openaiNYOpenAI: GPT-6.1 Sol2026-09-2952Intelligens
- anthropicNYAnthropic: Claude Sonnet 5.52026-09-2856Intelligens
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Intelligens
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Intelligens
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Intelligens
- xAIGrok 4.72026-09-2146Intelligens
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1M tokens · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
OpenAI rullar ut Ultrafast-läget för GPT-6.1 Sol – den snabbaste servicenivån den säljer, och första gången nivån nära Astra Sol har ett sådant. Draget placerar GPT-6.1 Sol i samma kategori som GPT-6 Astra Ultrafast i API:et, i Codex och i ChatGPT Work, och det kommer med en publicerad prislista i stället för en väntelista: 12,00 USD per miljon indatatokens och 60,00 USD per miljon utdatatokens, exakt sex gånger vad standard-GPT-6.1 Sol kostar. Hastighetspåståendet på burken är "upp till 8x". Det intressanta är vad den frasen mäter, och svaret är inte modellen du är på väg att betala för.
Utvecklarens ändringslogg innehåller posten daterad 8 oktober: "Lade till Ultrafast-läge för GPT-6.1 Sol i Responses API. Använd gpt-6.1-sol med service_tier: "ultrafast" för att minska tiden mellan genererade utdatatokens. Det är tillgängligt för alla API-användare, med förbehåll för frekvensbegränsningar, med global bearbetning och datahemvist i USA och EU." Dokumentationssidan för Ultrafast lyder nu "brett tillgängligt för GPT-6 Astra och GPT-6.1 Sol, med förhandsvisningsåtkomst för GPT-5.6 Sol", och ChatGPT-sidans hastighetssida bekräftar abonnemangsdelen: Ultrafast är tillgängligt i Codex och ChatGPT Work på Pro för 500 $ och på kvalificerade Enterprise- och Edu-abonnemang.
Ultrafast är en tjänstenivå, inte en andra modell.
Ingenting förändras med vikterna. Samma checkpoint, samma kontextfönster på 1 000 000 token, samma maximala indata på 922 000 token, samma tak på 128 000 token för utdata, samma kunskapsgräns den 30 april 2026, samma svar. Det du köper är en prioritering i schemaläggningen: modellen genererar tokens snabbare, och OpenAI:s egen formulering är avsiktligt snäv – nivån "minskar tiden mellan genererade utdatatokens". Den gör inte modellen smartare, och den gör inte tankefasen kortare.
Den skillnaden är hela beslutet. För en agentloop som gör fyrtio verktygsanrop i följd förstärks vinsten eftersom varje omgångs utdata kommer tidigare. För en enskild svår resonemangsförfrågan som tillbringar större delen av sin väggklockstid med att överlägga kan du betala sex gånger så mycket och ändå titta på samma snurra.
Nivåtrappan, en gång, i klarspråk:
• Batch and Flex — hälften av Standard, den billiga vägen för arbete som ingen väntar på
• Standard — $2,00 inmatning / $0,10 cachad / $2,50 cacheskrivning / $10,00 utmatning per miljon token
• Fast – dubbelt så mycket som Standard, eller 4,00 $ / 0,20 $ / 5,00 $ / 20,00 $; OpenAI bytte namn på Priority processing till Fast mode den 30 juli 2026
— Ultrasnabb — sex gånger Standard, eller $12.00 / $0.60 / $15.00 / $60.00
• Över 272K indatatoken — hela begäran omprissätts med 2x priser för indata och cache samt 1,5x för utdata; Ultrafast long-context är $24.00 / $1.20 / $30.00 / $90.00
Aritmetiken som ingen lägger upp på marknadsföringssidan
Sex gånger priset för åtta gånger hastigheten är ingen förlustaffär, och det är inte heller någon gratis lunch. Ultrafast debiteras per token, så ett jobb som kostar 1,00 $ i Standard kostar 6,00 $ i Ultrafast – och blir klart på ungefär en åttondel av tiden. Besparingen ligger inte i fakturan, den ligger i väggklockan. Du betalar fem extra dollar för att ta bort sju åttondelar av kötiden för det jobbet, och om det är billigt eller absurt beror helt och hållet på vad personen eller pipelinen som väntar i andra änden är värd per minut.
Två implikationer följer, och det är de som förbises:
• Interaktivt arbete är det enkla ja:et. En utvecklare som ser en diff landa, en agent som inte kan fortsätta förrän den har läst resultatet — det är de fall där latensen är produkten. Åtta gånger snabbare utdata i en slinga på fyrtio turer är inte en marginell förbättring av mänsklig perception; det är skillnaden mellan ett verktyg du använder och ett verktyg du kör i bakgrunden.
• Schemalagt arbete och batchjobb är det enkla nej:et. Om ett jobb ändå har till morgonen på sig är Ultrafast en 6x-faktura helt i onödan, och Batch-kön till halva priset finns ju bara där.
Cachad indata förtjänar en närmare titt eftersom den också rör sig: 0,60 $ per miljon på Ultrafast mot 0,10 $ på Standard, fortfarande 5 % av priset för ocachad indata. Prompt-cachade agenter som skickar om en stor systemprompt varje tur kommer att upptäcka att cacherabatten skalar med nivån snarare än skyddar dem från den.

Varifrån siffran "upp till 8x" kommer
Det här är delen du bör läsa noga, för det är här utrullningens rubrik och utrullningens dokumentation i tysthet beskriver olika saker.
Den enda modelspecifika hastighetsmätning som OpenAI publicerar är den här meningen: "GPT-6 Astra Ultrafast genererar token upp till 8x snabbare än GPT-6 Astra i Standard-läge i Codex." Det är en Astra-siffra, uppmätt i Codex. Det finns ingen motsvarande publicerad multipel för GPT-6.1 Sol. Dokumentet som täcker Ultrafast för den här modellen säger att den minskar tiden mellan genererade utdatatoken och hänvisar till en pristabell; det anger inget antal för det. ChatGPT-sidan om hastighet upprepar Astra-meningen och slutar där.
Så den ärliga tolkningen av ”upp till 8x snabbare” är: det är nivåns rubrik, hämtad från syskonmodellen som har varit på Ultrafast sedan 29 september, och det är ett leverantörspåstående som ingen oberoende part har reproducerat för någon av modellerna. Det kan mycket väl gälla för GPT-6.1 Sol – de två kör på samma serveringsstack och nivåns mekanism är densamma – men ingen utanför OpenAI har publicerat en mätning av token per sekund för Sol-varianten, och ”upp till” gör en verklig insats i den meningen.
Det är också värt att hålla nivåerna åtskilda per modell, eftersom den äldre fortfarande är en oavslutad historia. Ultrafast annonserades den 13 augusti 2026 för GPT-5.6 Sol med "upp till 14 gånger snabbare än standardbearbetning", i begränsad förhandsvisning för utvalda kunder. Tre månader senare säger dokumentationen fortfarande att GPT-5.6 Sol har "förhandsvisningsåtkomst", och Ultrafasts pristabell innehåller exakt två rader — GPT-6 Astra och GPT-6.1 Sol. En siffra på 14x som aldrig har nått allmän tillgänglighet och inte har något publicerat pris är ett påstående, inte en produkt.

Vem kan egentligen slå på det?
API-sidan är bred; prenumerationssidan är smal, och skillnaden överraskar folk.
• API — tillgängligt för alla API-användare på gpt-6.1-sol, med andra hastighetsgränser än Standard och Fast. Det innebär en andra budget att hålla koll på, inte bara ett andra pris.
• Ultrasnabba hastighetsgränser för GPT-6.1 Sol — 1 000 000 token per minut på Build, 4 000 000 på Launch, 40 000 000 på Grow. OpenAI förenklade sina användningsnivåer från fem till tre den 6 oktober, så dessa tre namn är den nuvarande nivåstegen, inte en äldre sådan.
• Datahemvist — GPT-6.1 Sol stöder datahemvist i USA och EU samt global bearbetning, även under Fast och Ultrafast. Astras Ultrafast får ingen EU-hemvist, så om din arbetsbelastning är EU-pinnad är detta den första Ultrafast-konfiguration du överhuvudtaget kan köpa.
• Codex och ChatGPT Work – Ultrafast finns tillgängligt i Pro-planen för 500 $ och i kvalificerade Enterprise- och Edu-planer. Enterprise-administratörer har det avstängt som standard och måste aktivera det per användare eller per arbetsyta.
• Chat — ingår inte. GPT-6.1 Sol själv finns i Work och Codex; Chat-ytan för konsumenter är inte en del av detta.
• Hur det faktureras vid en prenumeration — inkluderad användning förbrukas till 8 gånger Standard-priset, och köpta krediter eller Enterprise betala per användning faktureras till 6 gånger Standard-priset. Båda siffrorna är värda att känna till innan du låter den vara påslagen.
En implementationsdetalj avgör om du överhuvudtaget märker av snabbheten. OpenAIs vägledning är tydlig: använd WebSockets, "särskilt för agentiska applikationer som gör många verktygsanrop i snabb följd", eftersom "utan en beständig anslutning kan nätverksoverhead minska latensvinsterna". Om din klient öppnar en ny HTTP-anslutning per anrop kan overheaden per begäran äta upp hela fördelen med den nivå du just betalade 6x för. HTTP fungerar fortfarande. Det är bara det att det kanske inte är värt nivån.
Vad vi dirigerar, och vad vi inte dirigerar
GPT-6.1 Sol på standardnivå finns på OrcaRouter som openai/gpt-6.1-sol till leverantörens eget pris på 2,00 USD för indata och 10,00 USD för utdata per miljon tokens, med 0 % påslag — leverantörens listpris förs vidare oförändrat, så när OpenAI ändrar en taxa slår ändringen igenom på din faktura samma dag som den når prislistan, i stället för vid din nästa avtalsförnyelse. Samma nyckel och slutpunkt täcker fler än 200 modeller, så ett anrop till GPT-6.1 Sol och ett anrop till Claude eller Qwen ligger bakom en enda integration med automatisk redundansväxling och utan ett andra avtal, och routnings-DSL:en kan komponera modeller till ett enda anrop när en uppgift behöver mer än en åsikt.
Ultrafast är inte en av dessa modeller, och det vore vilseledande att antyda något annat. Det är en service-tier-flagga på ett OpenAI-konto – du skickar service_tier: "ultrafast" till gpt-6.1-sol och OpenAI fakturerar ditt eget konto enligt priserna ovan – så det ligger inom din direkta OpenAI-integration. Om du aktiverar det, håll den nivåindelade trafiken på din leverantörsnyckel och dirigera standardvolymstrafiken genom oss. Det är den ärliga uppdelningen, och det är också den billigare för allt som inte väntar på en människa.

Vad ska man göra med den idag?
Om du har en Codex- eller ChatGPT Work-plats på Pro $500 är reglaget redan där och testperioden kostar dig inget annat än användningsmultiplikatorn – kör samma uppgift på båda sätten och se om loopen du faktiskt kör har tillräckligt många turer för att åttafaldigheten ska synas. Om du är på API:et är experimentet som är värt att köra smalare än vad tillkännagivandet antyder: instrumentera hur mycket av din latens som är tokengenerering och hur mycket som är modellens tänkande, och rikta sedan Ultrafast mot den del som faktiskt kan komprimeras.
Och om du har ett val mellan Fast vid 2x och Ultrafast vid 6x för samma begäran, är Fast den nivå som kom hit först och den vars beteende du kan resonera kring enbart utifrån en prislista. Ultrafast är ny för den här modellen, oprissatt av någon oberoende mätning, och värd exakt lika mycket som ditt eget tidtagarur säger att den är värd.
Jämförda i den här artikeln2
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
