Ett genererat titelkort för GPT-6 Astra-prissättning, med tre statistikchips som lyder "Listpris: $10.00 in / $1.00 cachad / $50.00 ut per 1M", "Batch: $5.00 / $25.00 – Snabbläge: $20.00 / $100.00" och "Break-even mot GPT-5.6 Sol: 40 % av tokens", med fotnoten "Modellen släpptes 3 september 2026. Priserna hämtades från OpenAIs egen prissida 16 september 2026."
Guides & Insights

GPT-6 Astra-prissättning: Varför tre olika priser alla är korrekta, och vad en uppgift egentligen kostar

Författare

Alistair Wren

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Slutsatsen först: GPT-6 Astra kostar $10,00 per miljon indatatokens, $1,00 per miljon cachade indatatokens och $50,00 per miljon utdatatokens på Ope​nAI:s standardnivå. Det är Ope​nAI:s eget listpris, hämtat från Ope​nAI:s egen prissida den 16 september 2026 — och datumet spelar roll, eftersom modellen har prissatts olika vid olika tidpunkter och läsare fortsätter att hitta de andra siffrorna. GPT-6 Astra släpptes den 3 september 2026, tretton dagar före den här sidan. Det här är inte en lanseringsartikel och inte en tillkännagivandeartikel; det är referenssidan för en modell som nu är allmänt tillgänglig och, sedan den här veckan, allmänt distribuerad. GPT-5.6 Sol förekommer nedan som det prisbaslinje Astra säljs över, inte som ämnet.

Anledningen till att en prislista behöver en hel sida är att siffrorna som cirkulerar inte stämmer överens. Sök efter priset för den här modellen och du hittar $10/$50 från Ope​nAI, ett batchpris på $5/$25, Azure anger både $10/$50 och $11/$55, och minst en endpoint listad till $20/$100. Ingen av dem är en felskrivning, och ingen av dem är listpriset som tyst ändrats. De är olika servicenivåer och olika återförsäljare, och att skilja dem åt är skillnaden mellan en budget och en gissning.

Prislistan, med varje rad märkt och daterad

Allt i det här avsnittet är hämtat från OpenAI:s egen dokumentation om API-priser och modeller den 16 september 2026. När en siffra kommer från någon annan framgår det av meningen som innehåller den.

Standard, förfrågningar på eller under 272 000 indatatoken — 10,00 USD per 1 miljon indatatoken, 1,00 USD per 1 miljon cachade indatatoken, 12,50 USD per 1 miljon cacheskrivningar, 50,00 USD per 1 miljon utdatatoken (OpenAIs egen pristabell, läst 2026-09-16).

Raden för cacheskrivning är verklig och folk missar den — första gången du skickar ett prefix är det en skrivning till $12,50 per 1M, inte en läsning till $1,00. Cacheskrivningar debiteras med 1,25x standardpriset för indata.

Standard, förfrågningar över 272 000 indatatoken — 20,00 USD inmatning, 2,00 USD cachad inmatning, 25,00 USD cacheskrivningar, 75,00 USD utmatning per 1 miljon. Hela förfrågan får nytt pris, inte bara de token som ligger över gränsen (Ope​nAI:s egen pristabell, läst 2026-09-16).

Batch och Flex — hälften av standard: 5,00 $ input, 0,50 $ cachad input, 6,25 $ cache-skrivningar, 25,00 $ output per 1M (Ope​nAIs egen pristabell, läst 2026-09-16). Över 272K input är batchpriset 10,00 $ / 1,00 $ / 12,50 $ / 37,50 $.

Snabbläge — dubbla standardpriset: $20.00 input, $2.00 cachad input, $25.00 cache-skrivningar, $100.00 output per 1M (Ope​nAI:s egen pristabell, läst 2026-09-16).

Modellspecifikationer som avgör notan — kontextfönster 1 050 000 token, maximal indata 922 000, maximal utdata 128 000, kunskapsgräns 2026-04-30, stöd för resonemangstoken ja, värden för resonemangsansträngning low / medium / high / xhigh / max (OpenAI:s egen modelldokumentation, läst 2026-09-16).

Om du vill ha versionen med en enda mening: på standardnivån kostar en begäran som ligger under 272K input-tokens $10 per miljon in och $50 per miljon ut, cachade läsningar kostar en tiondel av in-priset, och allt annat i den här artikeln är antingen en rabatt för att acceptera långsammare bearbetning eller en tilläggsavgift för att passera en tröskel.

Varför du kommer att se ett annat nummer, och vilket som är vilket

Fem olika saker ger en offert som inte är $10/$50. Fyra av dem kan vi koppla till dokumentation; en kan vi inte, och det säger vi hellre än att gissa.

$5/$25 är batch-nivån, och det är Ope​nAI:s eget pris. Detta är ingen återförsäljarrabatt och ingen förhandlad företagstaxa. Ope​nAI:s prissida anger batchbearbetning till halva standardpriset, och Astras batchrad lyder $5.00 för indata och $25.00 för utdata. Om en källa uppger $5/$25 som om det gällde en annan modell, är det samma modell, samma vikter, i den långsammare kön. Batch är rätt svar för utvärderingskörningar över natten och fel svar för allt interaktivt.

$11/$55 är exakt en 10 % höjning av listpriset, och Ope​nAI dokumenterar en 10 % höjning för residensslutpunkter. Ope​nAI:s prissida anger att residensslutpunkter debiteras en 10 % höjning för modeller som släpps den 5 mars 2026 eller senare. GPT-6 Astra släpptes den 3 september 2026, så den kvalificerar sig. Multiplicera listpriset med 1,1 så får du $11,00 och $55,00 på öret. Det är en stark förklaring till varifrån den högre Azure-liknande offerten kommer — en residensbunden slutpunkt som går genom en dokumenterad höjning i stället för att en återförsäljare hittar på en marginal. Vi bör vara precisa om gränsen för det påståendet: höjningen är dokumenterad av Ope​nAI, och aritmetiken stämmer exakt, men den specifika Azure-listningen vi såg anger inte i sig att det är en residensslutpunkt. Betrakta det som den sannolika förklaringen, inte som en bekräftad sådan.

$20/$100 är OpenAI:s taxa för Fast-läget på den här modellen. Det här är den som mest liknar en falsk siffra och är minst falsk. Fast-läget fördubblar varje rad, och Astras standardrad för Fast-läget är $20,00 för indata och $100,00 för utdata per 1M. En slutpunkt som anger $20/$100 anger en annan servicenivå – prioriterad bearbetning – inte ett annat listpris och inte en annan modell. Om du ser den siffran bredvid Astras namn är frågan man bör ställa vilken bearbetningsnivå det gäller, inte vilken leverantör.

Priser under listpriset förekommer, och de är någon annans marginal. Tredjepartsgateways och återförsäljare annonserar Astra under listpris. En gateway listar offentligt cirka 20 % under OpenAI:s pris. Det är ett kommersiellt beslut av den operatören, inte en prisförändring från OpenAI — och det medför de villkor för datahantering och tillförlitlighet som operatören tillämpar. Vi kommer inte att namnge dem eller räkna deras rabatt som bevis om den här modellens pris, eftersom det är bevis om deras verksamhet, inte om OpenAI:s prislista.

Det vi inte kunde verifiera. Vi såg en routerlista som angav modellen som gpt-6-astra med en batch-nivå på $5/$25 och ett rörligt alias av formen ~openai/gpt-astra-latest. Batchsiffran stämmer med Ope​AI:s egen sida. Aliaset är en gateway-konstruktion: Ope​AI:s modelldokumentation listar exakt en post under snapshots, och den är enbart gpt-6-astra, utan daterad form och utan -latest-alias. Lägg inte in ett gateway-alias i en konfiguration som om leverantören hade publicerat det. Separat hittade vi ingen Ope​AI-dokumentation för någon separat prissatt nivå som "Astra Pro", "Astra-Medium" eller liknande. "Pro" förekommer i namngivningen av ChatGPT-planer, inte i API:ets prislista, och en routerlista är inte leverantörsdokumentation. Om du behöver få en nivå bekräftad, bekräfta den på Ope​AI:s egen sida.

A single-column rate-card graphic for GPT-6 Astra listing Input $10.00 per 1M, Cached input $1.00 per 1M, Cache writes $12.50 per 1M, Output $50.00 per 1M, Over 272K input $20.00 / $75.00 per 1M, and Batch tier $5.00 / $25.00 per 1M, footnoted 'OpenAI standard rates read September 16, 2026. Batch is half the standard rate.'

Astra bredvid resten av OpenAIs prislista

Ett pris är bara meningsfullt vid sidan av alternativen på samma kort. Dessa är alla Ope​nAI:s egna standardpriser, alla lästa den 16 september 2026, alla per miljon token, alla vid eller under 272K indata.

GPT-6 Astra — 10,00 $ inmatning / 1,00 $ cachad / 12,50 $ skrivning / 50,00 $ utmatning.

GPT-5.6 Sol — $4.00 inmatning / $0.40 cachad / $5.00 skrivning / $20.00 utmatning.

GPT-5.6 Terra – $2.00 inmatning / $0.20 cachad / $2.50 skrivning / $12.00 utmatning.

GPT-5.6 Luna — $0.20 indata / $0.02 cachad / $0.25 skrivning / $1.20 utdata.

Versionerna med lång kontext — Astra $20.00 / $2.00 / $25.00 / $75.00; Sol $8.00 / $0.80 / $10.00 / $30.00; Terra $4.00 / $0.40 / $5.00 / $18.00; Luna $0.40 / $0.04 / $0.50 / $1.80.

Det pågår en kampanj under den tabellen, och den avgör vilken multipel alla bråkar om. Ope​nAI:s prissida anger att kampanjpriset för GPT-5.6 Sol gäller åtminstone till och med den 21 november 2026. Jämfört med kampanjpriset som gäller i dag är Astra 2,5x Sol på varenda rad — 2,5x på input, 2,5x på cachad input, 2,5x på output. Jämfört med Sols ordinarie pris på 5,00 dollar för input och 30,00 dollar för output är Astra 2x på input och omkring 1,67x på output. Båda multiplerna är aritmetiskt korrekta och de beskriver samma två modeller samma dag. Skillnaden hänger helt och hållet på vilket Sol-pris du använder som nämnare, och det ärliga svaret på "är Astra 2,5x Sol?" är: ja, fram till den 21 november 2026, eller närhelst Ope​nAI avslutar kampanjen, beroende på vilket som inträffar först.

Vi framför denna poäng utförligt eftersom det är det vanligaste felet i bevakningen av den här modellen, inklusive på den här bloggen. En multipel per token som tyst väljer en Sol-kurs och inte namnger den är inte ett faktum om Astra. Det är ett faktum om när meningen skrevs.

A screenshot of OpenAI's own API pricing page, captured September 16, 2026, showing short-context and long-context rates per 1M tokens for gpt-6-astra ($10.00 input, $1.00 cached input, $12.50 cache writes, $50.00 output; long context $20.00 / $2.00 / $25.00 / $75.00) alongside gpt-5.6-sol, gpt-5.6-terra and gpt-5.6-luna, with the page's notes that data-residency endpoints carry a 10% uplift for models released on or after March 5, 2026 and that GPT-5.6 Sol's promotional pricing is available at least through November 21, 2026.

Kostnad per uppgift, inte kostnad per token

Ope​nAIs egen inramning är att det är fel jämförelse att jämföra tokenpriser för den här modellen, eftersom Astra är utformad för att slutföra långsiktigt arbete med färre tokens och färre återförsök. Det påståendet är värt att ta tillräckligt seriöst för att räkna på i stället för att bara upprepa det. Så här följer ett genomräknat exempel med antagandena angivna på förhand, så att du kan ändra dem så att de matchar din egen arbetsbelastning.

Arbetsbelastningen: en agentkörning med 200 anrop, formen av en nattlig migrering. Varje anrop bär 10 000 indatatoken, varav 8 000 är cacheläsningar och 2 000 är färska, och producerar 500 utdatatoken. Sett över hela körningen blir det 400 000 färska indatatoken, 1 600 000 cachade indatatoken och 100 000 utdatatoken, plus en enda cache-skrivning på 10 000 token för att seeda prefixet. Standardnivå, under 272K per begäran, så ingen långkontext-avgift tillämpas.

GPT-6 Astra — nya 0.4M x $10.00 = $4.00; cachade 1.6M x $1.00 = $1.60; skrivning 0.01M x $12.50 = $0.13; utdata 0.1M x $50.00 = $5.00. Totalt $10.73.

GPT-5.6 Sol till sitt kampanjpris — nya $1.60; cachade $0.64; skrivning $0.05; utdata $2.00. Totalt $4.29.

GPT-5.6 Sol till ordinarie pris — nya $2,00; cachade $0,80; skrivning $0,06; utdata $3,00. Totalt $5,86.

GPT-5.6 Terra — nya $0,80; cachade $0,32; skrivning $0,03; utdata $1,20. Totalt $2,35.

GPT-5.6 Luna — nya $0.08; cachade $0.03; skrivna $0.00; utdata $0.12. Totalt $0.23.

Vid identiska tokenantal är Astra alltså ungefär 46 gånger Luna och 4,6 gånger Terra. Ingen köper Luna för att göra ett jobb av Astra-storlek, och den fotnoten är hela anledningen till att jämförelser av kostnad per token mellan de två modellerna är teater. Jämförelsen med Sol är den som avgör något, så här är siffran som spelar roll.

Brytpunkten är 40 %. Eftersom Astra är exakt 2,5 gånger Sol på varje rad till Sols kampanjpris kan Astra göra av med upp till 40 % av Sols tokens på samma uppgift och ändå landa på samma faktura – och det gäller för vilken blandning som helst av ny indata, cachad indata och utdata, eftersom förhållandet är enhetligt. Om Astra använder en tredjedel av Sols tokens blir det billigare; om Astra använder hälften blir det dyrare. Mot Sols icke-kampanjpris lättar brytpunkten till omkring 55 % på denna cache-tunga blandning, eftersom Astras utdatamultipel sjunker till 1,67x medan dess indatamultipel sjunker till 2x.

Det där enskilda talet är det användbara, och det är där leverantörens påstående och den oberoende mätningen inte längre stämmer överens. OpenAI rapporterar Terminal-Bench 4.0 till 57,9 % för Astra mot 37,3 % för GPT-5.6 Sol, med cirka 9 % lägre uppskattad API-kostnad per uppgift — enligt leverantören. Artificial Analysis mätte, i en oberoende utvärdering publicerad den 9 september 2026, Astra med omkring en tredjedel av Sols tokens per uppgift i sitt Coding Agent Index, och fann ändå att Astra låg på 7,09 dollar per uppgift vid maximal ansträngning — cirka 15 % mer än Sol (max) — för en 7 poäng högre poäng. I sitt Intelligence Index placerade samma utvärdering Astra mellan 0,82 och 3,26 dollar per uppgift över olika ansträngningsnivåer, cirka 60 % dyrare än Sol vid maximal ansträngning.

Båda dessa kan vara sanna samtidigt, och gapet mellan dem är den ärliga rubriken. Tokenbesparingar är verkliga och stora – en tredjedel är precis den sorts siffra som tar sig över en brytpunkt på 40 % – men besparingar mätta i output-tokens krymper inte de rader för cache-läsning och nya indata som dominerar en lång agentsession. Huruvida Astra är billigare per uppgift än Sol beror på din mix, och riktningen växlar mellan arbetsbelastningar. Den som säger att det helt enkelt är billigare, eller helt enkelt 2,5 gånger dyrare, citerar en rad på räkningen som om den vore totalsumman.

Vad är det egentligen som avgör kostnaden för den här modellen?

Tre saker dominerar, och alla tre är specifika för hur Astra är tänkt att användas.

Resonemangstoken är utdatatoken. De debiteras med $50,00 per miljon, samma som synlig utdata. OpenAIs modellsida listar de effort-värden som stöds som low, medium, high, xhigh och max, och det finns ingen inaktiveringsinställning — lägstanivån är högre än den var på äldre modeller. I den oberoende mätningen Intelligence Index varierade spannet mellan effort-inställningarna low och max från $0,82 till $3,26 per uppgift, en faktor fyra för identiskt arbete. Effort-nivån är den enskilt största kostnadshävstången du kan styra, och det är värt att ställa in den per anrop i stället för globalt.

Återförsök multiplicerar allt. En agent som misslyckas och kör om betalar för hela prefixet igen. Detta är mekanismen bakom Ope​nAI:s påstående om färre återförsök, och det är också därför som tokenvis aritmetik vilseleder i båda riktningarna: en modell som kostar 2,5x per token men blir klar i ett enda pass kan slå en billigare modell som behöver tre. Om du utvärderar Astra mot vad som helst, mät slutförda uppgifter per dollar, inte tokens per dollar.

Lång kontext är det avsedda läget, och den är belagd med tilläggsavgift. Fönstret är 1 050 000 tokens. Överskrider du 272 000 indatatokens i en enda begäran omprissätts hela begäran till $20.00 för indata och $75.00 för utdata per miljon – inte bara överskottet. En begäran på 280 000 tokens kostar ungefär dubbelt så mycket som en begäran på 270 000 för cirka 4 % mer indata. För en modell byggd för långsiktigt arbete är detta det enskilt enklaste sättet att spränga en budget utan att märka det, och det är anledningen till att dela upp en långsiktig uppgift i begäranden under 272K vanligtvis är billigare än att skicka den i sin helhet, även om modellen klarar av att ta den i sin helhet.

Motvikten är cachning, och det är där långa agentsessioner faktiskt sparar pengar. Cachade läsningar kostar $1.00 mot $10.00 för färska, en minskning med 90 %, och en lång session skickar om samma prefix dussintals gånger. Cachskrivningen på $12.50 betalas en gång. I det genomräknade exemplet ovan, om varje anrop måste skicka om sitt prefix på 8 000 token ocachat, skulle Astras räkning stiga från $10.73 till omkring $25.00 – cachen gör mer för budgeten än någon annan enskild post.

Posten om multipeln

Flera sidor på den här bloggen, inklusive GPT-6 Astra vs GPT-5.6 Sol: är 2,5x priset värt det? och GPT-6 Astra-efterfrågan pausar nya registreringar för $200 ChatGPT Pro, anger att Astra listas till 2,5 gånger GPT-5.6 Sols tokenpris. Siffran beräknades mot Sols kampanjpris på 4,00 USD för indata och 20,00 USD för utdata, vilket är det pris som OpenAIs prissida anger i dag och beskriver som kampanjpris, tillgängligt åtminstone till och med den 21 november 2026.

Så multipeln har inte upphört att vara sann — den har fått ett utgångsdatum som de tidigare sidorna inte hade. Mot Sols icke-kampanjpris på 5,00 $ för indata och 30,00 $ för utdata är Astra 2x på indata och cirka 1,67x på utdata, inte 2,5x. Sidorna som säger 2,5x bör läsas som att de avser kampanjfönstret; jämförelsens riktning förändras inte, men storleken på gapet krymper med en femtedel till en tredjedel i samma stund som kampanjen upphör. Den som budgeterar bortom den 21 november 2026 bör använda 5,00 $ och 30,00 $ som Sol-nämnare och 2x / 1,67x som Astra-multipeln. Vi upprepar inte argumenten på dessa sidor — benchmark- och tillförlitlighetsresonemanget där står på egna ben — utan korrigerar bara nämnaren som de beräknades mot.

Den ”fria” frågan, besvarad utan förbehåll

Det finns ingen gratisnivå för den här modellen, och ingen gratis API-väg till den. Gratis- och Go-användare av ChatGPT får inte GPT-6 Astra alls. Plus-prenumeranter får det bara via ChatGPT Work och Codex, inte i vanlig chatt. API:et debiteras från första token med 10,00 USD per miljon indata, och det billigaste legitima sättet att minska den siffran är batch-nivån på 5,00 USD per miljon, vilket kostar dig latens snarare än kapacitet. Den som annonserar om gratis API-åtkomst till GPT-6 Astra säljer vidare något – vanligtvis en pool med provkrediter hos en tredjepartsgateway med egna datavillkor. Det är inte nödvändigtvis en dålig affär, men det är inte gratis, och det är inte OpenAI.

Värt att veta om du kapacitetsplanerar utifrån en prenumeration snarare än API:et: den 10 september 2026 pausade Ope​nAI nya registreringar och uppgraderingar till sin $200-nivå för ChatGPT Pro, med hänvisning till efterfrågan på Astra. $100-nivån, Plus, Go, API:et samt Business- och Enterprise-konton förblev öppna. Konsumenter ransonerades; API- och företagsåtkomst gjorde det inte. Om din plan är beroende av användningsutrymmet i en konsumentprenumeration är det risken som måste modelleras.

Att routa det, och vad en router inte fixar

Astra är en av modellerna som finns tillgängliga via OrcaRouter under openai/gpt-6-astra, till samma pris på 10,00 $ för indata och 50,00 $ för utdata som leverantören tar ut, med den nivåindelning över 272K som visas på vår modellsida. Vi för vidare leverantörens listpris med 0 % påslag, vilket spelar större roll för den här modellen än för de flesta: siffrorna i den här artikeln har redan ändrats en gång under modellens livstid, och ett genomfakturerat pris ändras samma dag som leverantören ändrar det, i stället för när någon kommer ihåg att uppdatera en tabell.

A screenshot of the OrcaRouter model page for GPT-6 Astra, model id openai/gpt-6-astra, captured September 16, 2026, showing $10.00 per 1M input tokens and $50.00 per 1M output tokens, a 1M-token context window, 128K maximum output, text, image and file input, p50 time to first token of 6.70 s and 181.0M tokens of traffic over 7 days.

Det ärliga argumentet för routing här är inte pris, för det finns ingen rabatt att sälja till dig – det är att kostnadskalkylen ovan är arbetsbelastningsberoende och du kommer inte att veta vilken sida av 40 %-brytpunkten du hamnar på förrän du kör den. Att placera Astra bakom en och samma endpoint tillsammans med Sol, Terra och Luna innebär att du kan mäta slutförda uppgifter per dollar på din egen trafik och byta modell utan ett andra avtal eller en kodändring. Routing-DSL:en låter dig komponera ett anrop över flera modeller i stället för att binda en produktionsväg till en, och automatisk failover täcker fallet som den här modellen redan har visat två gånger – att efterfrågan på den kan överstiga kapaciteten.

Avvägningarna är precis lika verkliga och förtjänar att nämnas. En router är ett hopp i förfrågningsvägen, och för en modell vars säljargument är långsiktigt autonomt arbete är det hoppet ytterligare en sak i feldomänen; om din tolerans för det är noll, kontakta leverantören direkt. Flera saker i den här artikeln existerar bara vid en direkt relation: alternativet Zero Data Retention som Ope​nAI erbjuder berättigade API-kunder på slutpunkter som stöds kräver Ope​nAI:s godkännande, och företagsaktivering – som är avstängd som standard vid lansering och slås på av administratörer enligt deras tillämpliga priskort – är ett avtal mellan dig och Ope​nAI, inte något som en router kan bevilja. Ope​nAI dokumenterar också att Fast mode för den här modellen inte är tillgängligt med EU-datahemvist, så om du behöver både datahemvist och hastighet följer den begränsningen modellen, inte rutten. Och en routers 0 % påslag är ingen rabatt: vi är inte billigare än att gå direkt, vi har samma pris med färre integrationer att underhålla.

Vad du ska titta på

Ett datum och en siffra. Datumet är den 21 november 2026, då Sols kampanjpris inte längre garanteras – om det upphör sjunker Astras multipel mot Sol från 2,5x till 2x på indata och 1,67x på utdata, och varje jämförelse av kostnad per uppgift som cirkulerar blir en femtedel till en tredjedel mer fördelaktig för Astra utan att något enda förändras hos Astra. Siffran är din egen brytpunkt: kör en representativ uppgift med lång horisont på båda modellerna, räkna slutförda uppgifter och totala dollarbelopp, och du kommer att ha ett svar som är mer användbart än något som publicerats, inklusive den här sidan.

Att placera Astra bakom en enda endpoint tillsammans med Sol, Terra och Luna innebär att du kan mäta slutförda uppgifter per dollar på din egen trafik och byta modell utan ett andra avtal eller en kodändring.

Jämförda i den här artikeln1

Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen