
GPT-6 Astra-prissättning: Varför tre olika priser alla är korrekta, och vad en uppgift egentligen kostar
- orcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens
- deepseekNYDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiNYOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0540Intelligens72Kodning
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligens76Kodning
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligens69Kodning
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Intelligens78Kodning
Slutsatsen först: GPT-6 Astra kostar $10,00 per miljon indatatokens, $1,00 per miljon cachade indatatokens och $50,00 per miljon utdatatokens på OpenAI:s standardnivå. Det är OpenAI:s eget listpris, hämtat från OpenAI:s egen prissida den 16 september 2026 — och datumet spelar roll, eftersom modellen har prissatts olika vid olika tidpunkter och läsare fortsätter att hitta de andra siffrorna. GPT-6 Astra släpptes den 3 september 2026, tretton dagar före den här sidan. Det här är inte en lanseringsartikel och inte en tillkännagivandeartikel; det är referenssidan för en modell som nu är allmänt tillgänglig och, sedan den här veckan, allmänt distribuerad. GPT-5.6 Sol förekommer nedan som det prisbaslinje Astra säljs över, inte som ämnet.
Anledningen till att en prislista behöver en hel sida är att siffrorna som cirkulerar inte stämmer överens. Sök efter priset för den här modellen och du hittar $10/$50 från OpenAI, ett batchpris på $5/$25, Azure anger både $10/$50 och $11/$55, och minst en endpoint listad till $20/$100. Ingen av dem är en felskrivning, och ingen av dem är listpriset som tyst ändrats. De är olika servicenivåer och olika återförsäljare, och att skilja dem åt är skillnaden mellan en budget och en gissning.
Prislistan, med varje rad märkt och daterad
Allt i det här avsnittet är hämtat från OpenAI:s egen dokumentation om API-priser och modeller den 16 september 2026. När en siffra kommer från någon annan framgår det av meningen som innehåller den.
• Standard, förfrågningar på eller under 272 000 indatatoken — 10,00 USD per 1 miljon indatatoken, 1,00 USD per 1 miljon cachade indatatoken, 12,50 USD per 1 miljon cacheskrivningar, 50,00 USD per 1 miljon utdatatoken (OpenAIs egen pristabell, läst 2026-09-16).
• Raden för cacheskrivning är verklig och folk missar den — första gången du skickar ett prefix är det en skrivning till $12,50 per 1M, inte en läsning till $1,00. Cacheskrivningar debiteras med 1,25x standardpriset för indata.
• Standard, förfrågningar över 272 000 indatatoken — 20,00 USD inmatning, 2,00 USD cachad inmatning, 25,00 USD cacheskrivningar, 75,00 USD utmatning per 1 miljon. Hela förfrågan får nytt pris, inte bara de token som ligger över gränsen (OpenAI:s egen pristabell, läst 2026-09-16).
• Batch och Flex — hälften av standard: 5,00 $ input, 0,50 $ cachad input, 6,25 $ cache-skrivningar, 25,00 $ output per 1M (OpenAIs egen pristabell, läst 2026-09-16). Över 272K input är batchpriset 10,00 $ / 1,00 $ / 12,50 $ / 37,50 $.
• Snabbläge — dubbla standardpriset: $20.00 input, $2.00 cachad input, $25.00 cache-skrivningar, $100.00 output per 1M (OpenAI:s egen pristabell, läst 2026-09-16).
• Modellspecifikationer som avgör notan — kontextfönster 1 050 000 token, maximal indata 922 000, maximal utdata 128 000, kunskapsgräns 2026-04-30, stöd för resonemangstoken ja, värden för resonemangsansträngning low / medium / high / xhigh / max (OpenAI:s egen modelldokumentation, läst 2026-09-16).
Om du vill ha versionen med en enda mening: på standardnivån kostar en begäran som ligger under 272K input-tokens $10 per miljon in och $50 per miljon ut, cachade läsningar kostar en tiondel av in-priset, och allt annat i den här artikeln är antingen en rabatt för att acceptera långsammare bearbetning eller en tilläggsavgift för att passera en tröskel.
Varför du kommer att se ett annat nummer, och vilket som är vilket
Fem olika saker ger en offert som inte är $10/$50. Fyra av dem kan vi koppla till dokumentation; en kan vi inte, och det säger vi hellre än att gissa.
$5/$25 är batch-nivån, och det är OpenAI:s eget pris. Detta är ingen återförsäljarrabatt och ingen förhandlad företagstaxa. OpenAI:s prissida anger batchbearbetning till halva standardpriset, och Astras batchrad lyder $5.00 för indata och $25.00 för utdata. Om en källa uppger $5/$25 som om det gällde en annan modell, är det samma modell, samma vikter, i den långsammare kön. Batch är rätt svar för utvärderingskörningar över natten och fel svar för allt interaktivt.
$11/$55 är exakt en 10 % höjning av listpriset, och OpenAI dokumenterar en 10 % höjning för residensslutpunkter. OpenAI:s prissida anger att residensslutpunkter debiteras en 10 % höjning för modeller som släpps den 5 mars 2026 eller senare. GPT-6 Astra släpptes den 3 september 2026, så den kvalificerar sig. Multiplicera listpriset med 1,1 så får du $11,00 och $55,00 på öret. Det är en stark förklaring till varifrån den högre Azure-liknande offerten kommer — en residensbunden slutpunkt som går genom en dokumenterad höjning i stället för att en återförsäljare hittar på en marginal. Vi bör vara precisa om gränsen för det påståendet: höjningen är dokumenterad av OpenAI, och aritmetiken stämmer exakt, men den specifika Azure-listningen vi såg anger inte i sig att det är en residensslutpunkt. Betrakta det som den sannolika förklaringen, inte som en bekräftad sådan.
$20/$100 är OpenAI:s taxa för Fast-läget på den här modellen. Det här är den som mest liknar en falsk siffra och är minst falsk. Fast-läget fördubblar varje rad, och Astras standardrad för Fast-läget är $20,00 för indata och $100,00 för utdata per 1M. En slutpunkt som anger $20/$100 anger en annan servicenivå – prioriterad bearbetning – inte ett annat listpris och inte en annan modell. Om du ser den siffran bredvid Astras namn är frågan man bör ställa vilken bearbetningsnivå det gäller, inte vilken leverantör.
Priser under listpriset förekommer, och de är någon annans marginal. Tredjepartsgateways och återförsäljare annonserar Astra under listpris. En gateway listar offentligt cirka 20 % under OpenAI:s pris. Det är ett kommersiellt beslut av den operatören, inte en prisförändring från OpenAI — och det medför de villkor för datahantering och tillförlitlighet som operatören tillämpar. Vi kommer inte att namnge dem eller räkna deras rabatt som bevis om den här modellens pris, eftersom det är bevis om deras verksamhet, inte om OpenAI:s prislista.
Det vi inte kunde verifiera. Vi såg en routerlista som angav modellen som gpt-6-astra med en batch-nivå på $5/$25 och ett rörligt alias av formen ~openai/gpt-astra-latest. Batchsiffran stämmer med OpeAI:s egen sida. Aliaset är en gateway-konstruktion: OpeAI:s modelldokumentation listar exakt en post under snapshots, och den är enbart gpt-6-astra, utan daterad form och utan -latest-alias. Lägg inte in ett gateway-alias i en konfiguration som om leverantören hade publicerat det. Separat hittade vi ingen OpeAI-dokumentation för någon separat prissatt nivå som "Astra Pro", "Astra-Medium" eller liknande. "Pro" förekommer i namngivningen av ChatGPT-planer, inte i API:ets prislista, och en routerlista är inte leverantörsdokumentation. Om du behöver få en nivå bekräftad, bekräfta den på OpeAI:s egen sida.

Astra bredvid resten av OpenAIs prislista
Ett pris är bara meningsfullt vid sidan av alternativen på samma kort. Dessa är alla OpenAI:s egna standardpriser, alla lästa den 16 september 2026, alla per miljon token, alla vid eller under 272K indata.
• GPT-6 Astra — 10,00 $ inmatning / 1,00 $ cachad / 12,50 $ skrivning / 50,00 $ utmatning.
• GPT-5.6 Sol — $4.00 inmatning / $0.40 cachad / $5.00 skrivning / $20.00 utmatning.
• GPT-5.6 Terra – $2.00 inmatning / $0.20 cachad / $2.50 skrivning / $12.00 utmatning.
• GPT-5.6 Luna — $0.20 indata / $0.02 cachad / $0.25 skrivning / $1.20 utdata.
• Versionerna med lång kontext — Astra $20.00 / $2.00 / $25.00 / $75.00; Sol $8.00 / $0.80 / $10.00 / $30.00; Terra $4.00 / $0.40 / $5.00 / $18.00; Luna $0.40 / $0.04 / $0.50 / $1.80.
Det pågår en kampanj under den tabellen, och den avgör vilken multipel alla bråkar om. OpenAI:s prissida anger att kampanjpriset för GPT-5.6 Sol gäller åtminstone till och med den 21 november 2026. Jämfört med kampanjpriset som gäller i dag är Astra 2,5x Sol på varenda rad — 2,5x på input, 2,5x på cachad input, 2,5x på output. Jämfört med Sols ordinarie pris på 5,00 dollar för input och 30,00 dollar för output är Astra 2x på input och omkring 1,67x på output. Båda multiplerna är aritmetiskt korrekta och de beskriver samma två modeller samma dag. Skillnaden hänger helt och hållet på vilket Sol-pris du använder som nämnare, och det ärliga svaret på "är Astra 2,5x Sol?" är: ja, fram till den 21 november 2026, eller närhelst OpenAI avslutar kampanjen, beroende på vilket som inträffar först.
Vi framför denna poäng utförligt eftersom det är det vanligaste felet i bevakningen av den här modellen, inklusive på den här bloggen. En multipel per token som tyst väljer en Sol-kurs och inte namnger den är inte ett faktum om Astra. Det är ett faktum om när meningen skrevs.

Kostnad per uppgift, inte kostnad per token
OpenAIs egen inramning är att det är fel jämförelse att jämföra tokenpriser för den här modellen, eftersom Astra är utformad för att slutföra långsiktigt arbete med färre tokens och färre återförsök. Det påståendet är värt att ta tillräckligt seriöst för att räkna på i stället för att bara upprepa det. Så här följer ett genomräknat exempel med antagandena angivna på förhand, så att du kan ändra dem så att de matchar din egen arbetsbelastning.
Arbetsbelastningen: en agentkörning med 200 anrop, formen av en nattlig migrering. Varje anrop bär 10 000 indatatoken, varav 8 000 är cacheläsningar och 2 000 är färska, och producerar 500 utdatatoken. Sett över hela körningen blir det 400 000 färska indatatoken, 1 600 000 cachade indatatoken och 100 000 utdatatoken, plus en enda cache-skrivning på 10 000 token för att seeda prefixet. Standardnivå, under 272K per begäran, så ingen långkontext-avgift tillämpas.
• GPT-6 Astra — nya 0.4M x $10.00 = $4.00; cachade 1.6M x $1.00 = $1.60; skrivning 0.01M x $12.50 = $0.13; utdata 0.1M x $50.00 = $5.00. Totalt $10.73.
• GPT-5.6 Sol till sitt kampanjpris — nya $1.60; cachade $0.64; skrivning $0.05; utdata $2.00. Totalt $4.29.
• GPT-5.6 Sol till ordinarie pris — nya $2,00; cachade $0,80; skrivning $0,06; utdata $3,00. Totalt $5,86.
• GPT-5.6 Terra — nya $0,80; cachade $0,32; skrivning $0,03; utdata $1,20. Totalt $2,35.
• GPT-5.6 Luna — nya $0.08; cachade $0.03; skrivna $0.00; utdata $0.12. Totalt $0.23.
Vid identiska tokenantal är Astra alltså ungefär 46 gånger Luna och 4,6 gånger Terra. Ingen köper Luna för att göra ett jobb av Astra-storlek, och den fotnoten är hela anledningen till att jämförelser av kostnad per token mellan de två modellerna är teater. Jämförelsen med Sol är den som avgör något, så här är siffran som spelar roll.
Brytpunkten är 40 %. Eftersom Astra är exakt 2,5 gånger Sol på varje rad till Sols kampanjpris kan Astra göra av med upp till 40 % av Sols tokens på samma uppgift och ändå landa på samma faktura – och det gäller för vilken blandning som helst av ny indata, cachad indata och utdata, eftersom förhållandet är enhetligt. Om Astra använder en tredjedel av Sols tokens blir det billigare; om Astra använder hälften blir det dyrare. Mot Sols icke-kampanjpris lättar brytpunkten till omkring 55 % på denna cache-tunga blandning, eftersom Astras utdatamultipel sjunker till 1,67x medan dess indatamultipel sjunker till 2x.
Det där enskilda talet är det användbara, och det är där leverantörens påstående och den oberoende mätningen inte längre stämmer överens. OpenAI rapporterar Terminal-Bench 4.0 till 57,9 % för Astra mot 37,3 % för GPT-5.6 Sol, med cirka 9 % lägre uppskattad API-kostnad per uppgift — enligt leverantören. Artificial Analysis mätte, i en oberoende utvärdering publicerad den 9 september 2026, Astra med omkring en tredjedel av Sols tokens per uppgift i sitt Coding Agent Index, och fann ändå att Astra låg på 7,09 dollar per uppgift vid maximal ansträngning — cirka 15 % mer än Sol (max) — för en 7 poäng högre poäng. I sitt Intelligence Index placerade samma utvärdering Astra mellan 0,82 och 3,26 dollar per uppgift över olika ansträngningsnivåer, cirka 60 % dyrare än Sol vid maximal ansträngning.
Båda dessa kan vara sanna samtidigt, och gapet mellan dem är den ärliga rubriken. Tokenbesparingar är verkliga och stora – en tredjedel är precis den sorts siffra som tar sig över en brytpunkt på 40 % – men besparingar mätta i output-tokens krymper inte de rader för cache-läsning och nya indata som dominerar en lång agentsession. Huruvida Astra är billigare per uppgift än Sol beror på din mix, och riktningen växlar mellan arbetsbelastningar. Den som säger att det helt enkelt är billigare, eller helt enkelt 2,5 gånger dyrare, citerar en rad på räkningen som om den vore totalsumman.
Vad är det egentligen som avgör kostnaden för den här modellen?
Tre saker dominerar, och alla tre är specifika för hur Astra är tänkt att användas.
Resonemangstoken är utdatatoken. De debiteras med $50,00 per miljon, samma som synlig utdata. OpenAIs modellsida listar de effort-värden som stöds som low, medium, high, xhigh och max, och det finns ingen inaktiveringsinställning — lägstanivån är högre än den var på äldre modeller. I den oberoende mätningen Intelligence Index varierade spannet mellan effort-inställningarna low och max från $0,82 till $3,26 per uppgift, en faktor fyra för identiskt arbete. Effort-nivån är den enskilt största kostnadshävstången du kan styra, och det är värt att ställa in den per anrop i stället för globalt.
Återförsök multiplicerar allt. En agent som misslyckas och kör om betalar för hela prefixet igen. Detta är mekanismen bakom OpenAI:s påstående om färre återförsök, och det är också därför som tokenvis aritmetik vilseleder i båda riktningarna: en modell som kostar 2,5x per token men blir klar i ett enda pass kan slå en billigare modell som behöver tre. Om du utvärderar Astra mot vad som helst, mät slutförda uppgifter per dollar, inte tokens per dollar.
Lång kontext är det avsedda läget, och den är belagd med tilläggsavgift. Fönstret är 1 050 000 tokens. Överskrider du 272 000 indatatokens i en enda begäran omprissätts hela begäran till $20.00 för indata och $75.00 för utdata per miljon – inte bara överskottet. En begäran på 280 000 tokens kostar ungefär dubbelt så mycket som en begäran på 270 000 för cirka 4 % mer indata. För en modell byggd för långsiktigt arbete är detta det enskilt enklaste sättet att spränga en budget utan att märka det, och det är anledningen till att dela upp en långsiktig uppgift i begäranden under 272K vanligtvis är billigare än att skicka den i sin helhet, även om modellen klarar av att ta den i sin helhet.
Motvikten är cachning, och det är där långa agentsessioner faktiskt sparar pengar. Cachade läsningar kostar $1.00 mot $10.00 för färska, en minskning med 90 %, och en lång session skickar om samma prefix dussintals gånger. Cachskrivningen på $12.50 betalas en gång. I det genomräknade exemplet ovan, om varje anrop måste skicka om sitt prefix på 8 000 token ocachat, skulle Astras räkning stiga från $10.73 till omkring $25.00 – cachen gör mer för budgeten än någon annan enskild post.
Posten om multipeln
Flera sidor på den här bloggen, inklusive GPT-6 Astra vs GPT-5.6 Sol: är 2,5x priset värt det? och GPT-6 Astra-efterfrågan pausar nya registreringar för $200 ChatGPT Pro, anger att Astra listas till 2,5 gånger GPT-5.6 Sols tokenpris. Siffran beräknades mot Sols kampanjpris på 4,00 USD för indata och 20,00 USD för utdata, vilket är det pris som OpenAIs prissida anger i dag och beskriver som kampanjpris, tillgängligt åtminstone till och med den 21 november 2026.
Så multipeln har inte upphört att vara sann — den har fått ett utgångsdatum som de tidigare sidorna inte hade. Mot Sols icke-kampanjpris på 5,00 $ för indata och 30,00 $ för utdata är Astra 2x på indata och cirka 1,67x på utdata, inte 2,5x. Sidorna som säger 2,5x bör läsas som att de avser kampanjfönstret; jämförelsens riktning förändras inte, men storleken på gapet krymper med en femtedel till en tredjedel i samma stund som kampanjen upphör. Den som budgeterar bortom den 21 november 2026 bör använda 5,00 $ och 30,00 $ som Sol-nämnare och 2x / 1,67x som Astra-multipeln. Vi upprepar inte argumenten på dessa sidor — benchmark- och tillförlitlighetsresonemanget där står på egna ben — utan korrigerar bara nämnaren som de beräknades mot.
Den ”fria” frågan, besvarad utan förbehåll
Det finns ingen gratisnivå för den här modellen, och ingen gratis API-väg till den. Gratis- och Go-användare av ChatGPT får inte GPT-6 Astra alls. Plus-prenumeranter får det bara via ChatGPT Work och Codex, inte i vanlig chatt. API:et debiteras från första token med 10,00 USD per miljon indata, och det billigaste legitima sättet att minska den siffran är batch-nivån på 5,00 USD per miljon, vilket kostar dig latens snarare än kapacitet. Den som annonserar om gratis API-åtkomst till GPT-6 Astra säljer vidare något – vanligtvis en pool med provkrediter hos en tredjepartsgateway med egna datavillkor. Det är inte nödvändigtvis en dålig affär, men det är inte gratis, och det är inte OpenAI.
Värt att veta om du kapacitetsplanerar utifrån en prenumeration snarare än API:et: den 10 september 2026 pausade OpenAI nya registreringar och uppgraderingar till sin $200-nivå för ChatGPT Pro, med hänvisning till efterfrågan på Astra. $100-nivån, Plus, Go, API:et samt Business- och Enterprise-konton förblev öppna. Konsumenter ransonerades; API- och företagsåtkomst gjorde det inte. Om din plan är beroende av användningsutrymmet i en konsumentprenumeration är det risken som måste modelleras.
Att routa det, och vad en router inte fixar
Astra är en av modellerna som finns tillgängliga via OrcaRouter under openai/gpt-6-astra, till samma pris på 10,00 $ för indata och 50,00 $ för utdata som leverantören tar ut, med den nivåindelning över 272K som visas på vår modellsida. Vi för vidare leverantörens listpris med 0 % påslag, vilket spelar större roll för den här modellen än för de flesta: siffrorna i den här artikeln har redan ändrats en gång under modellens livstid, och ett genomfakturerat pris ändras samma dag som leverantören ändrar det, i stället för när någon kommer ihåg att uppdatera en tabell.

Det ärliga argumentet för routing här är inte pris, för det finns ingen rabatt att sälja till dig – det är att kostnadskalkylen ovan är arbetsbelastningsberoende och du kommer inte att veta vilken sida av 40 %-brytpunkten du hamnar på förrän du kör den. Att placera Astra bakom en och samma endpoint tillsammans med Sol, Terra och Luna innebär att du kan mäta slutförda uppgifter per dollar på din egen trafik och byta modell utan ett andra avtal eller en kodändring. Routing-DSL:en låter dig komponera ett anrop över flera modeller i stället för att binda en produktionsväg till en, och automatisk failover täcker fallet som den här modellen redan har visat två gånger – att efterfrågan på den kan överstiga kapaciteten.
Avvägningarna är precis lika verkliga och förtjänar att nämnas. En router är ett hopp i förfrågningsvägen, och för en modell vars säljargument är långsiktigt autonomt arbete är det hoppet ytterligare en sak i feldomänen; om din tolerans för det är noll, kontakta leverantören direkt. Flera saker i den här artikeln existerar bara vid en direkt relation: alternativet Zero Data Retention som OpenAI erbjuder berättigade API-kunder på slutpunkter som stöds kräver OpenAI:s godkännande, och företagsaktivering – som är avstängd som standard vid lansering och slås på av administratörer enligt deras tillämpliga priskort – är ett avtal mellan dig och OpenAI, inte något som en router kan bevilja. OpenAI dokumenterar också att Fast mode för den här modellen inte är tillgängligt med EU-datahemvist, så om du behöver både datahemvist och hastighet följer den begränsningen modellen, inte rutten. Och en routers 0 % påslag är ingen rabatt: vi är inte billigare än att gå direkt, vi har samma pris med färre integrationer att underhålla.
Vad du ska titta på
Ett datum och en siffra. Datumet är den 21 november 2026, då Sols kampanjpris inte längre garanteras – om det upphör sjunker Astras multipel mot Sol från 2,5x till 2x på indata och 1,67x på utdata, och varje jämförelse av kostnad per uppgift som cirkulerar blir en femtedel till en tredjedel mer fördelaktig för Astra utan att något enda förändras hos Astra. Siffran är din egen brytpunkt: kör en representativ uppgift med lång horisont på båda modellerna, räkna slutförda uppgifter och totala dollarbelopp, och du kommer att ha ett svar som är mer användbart än något som publicerats, inklusive den här sidan.
Att placera Astra bakom en enda endpoint tillsammans med Sol, Terra och Luna innebär att du kan mäta slutförda uppgifter per dollar på din egen trafik och byta modell utan ett andra avtal eller en kodändring.
Jämförda i den här artikeln1
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
