Genererat titelkort med rubriken 'Step 5 Preview vs GPT-6 Astra — tio gånger priset' med två kolumner: Step 5 Preview vid AA Index 44, 600B totalt / 27B aktiva, pris $1,00 / $2,70, blandat $0,51 och 99,8 tokens/sek; GPT-6 Astra vid AA Index 53, pris $10,00 / $50,00, blandat $7,70 och 59,3 tokens/sek. En sidfot lyder 'Båda siffrorna enligt Artificial Analysis Intelligence Index; Astra-priset stiger till $20 / $75 över 272K indatatokens.'
Guides & Insights

Step 5 Preview vs GPT-6 Astra: Tio gånger indatapriset för nio indexpoäng

Författare

Gideon Frost

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Dessa två modeller annonserades med sjutton dagars mellanrum och prissattes för helt olika planeter. Step 5 Preview, StepFuns sparse mixture-of-experts-modell med 600 miljarder parametrar som annonserades den 20 september 2026, tar 1,00 USD per miljon indatatokens och 2,70 USD per miljon utdatatokens. GPT-6 Astra, leverantörens flaggskepp som släpptes den 3 september 2026, tar 10,00 och 50,00 USD för samma enheter under en tröskel på 272K indatatokens – och 20,00 och 75,00 USD över den. Det är tio gånger inputpriset och ungefär arton gånger outputpriset för en modell som får nio poäng högre på det oberoende Intelligence Index, 53 mot 44. Huruvida Astra är bättre är inte ifrågasatt. Huruvida gapet är värt trettio extra dollar per miljon utdatatokens för din arbetsbelastning är det, och svaret ändras två gånger under den här artikelns gång.

Vad varje modell är till för

Step 5 Preview är byggd och säljs för agentiskt arbete: AI-kodning, mjukvaruutveckling, professionellt kunskapsarbete, finans. Arkitekturen är optimerad för det – 600B parametrar totalt med ungefär 27B aktiva per token, en kontext på 1M tokens, text- och bildinmatning samt resonemang med utökat tänkande. StepFun hoppade över hela Step 4.x-serien för att komma hit och gick direkt från Step-3.7-Flash till Step 5.

GPT-6 Astra är OpenAI:s flaggskepp för allmänna ändamål: en kontext på 1M tokens, upp till 128K utdatatokens, indata i form av text, bilder och filer, utdata i form av text, en kunskapsgräns den 30 april 2026 och stöd för resonemang, kodning och agentiska arbetsflöden. Det är modellen ett företag tar till när svaret måste vara rätt och tokennotan inte är den begränsande faktorn.

• Intelligensindex — Step 5 Preview 44 vs GPT-6 Astra 53

• Parametrar — Step 5 Preview 600B totalt / 27B aktiva mot GPT-6 Astra, ej offentliggjord

• Kontext och utdatatak — båda har en kontext på 1M tokens; Astra anger ett fönster på 1 050 000 tokens och ett utdatatak på 128K, StepFun har inte publicerat något utdatatak

• Inmatningsmodalitet – text och bilder vs text, bilder och filer

• Utdatashastighet — Step 5 Preview 99,8 tokens/sek mot GPT-6 Astra 59,3 tokens/sek

• Pris per 1 miljon tokens — $1.00 in / $2.70 ut jämfört med $10.00 in / $50.00 ut under 272K input, stigande till $20.00 / $75.00 över det

• Cache — Step 5 Preview 95 % rabatt jämfört med GPT-6 Astra, en 90 % läsrabatt med en cache-skrivavgift på 12,50 USD per miljon

• Kostnad per uppgift i Intelligence Index — Step 5 Preview 0,71 $ vs GPT-6 Astra 3,26 $

Generated two-column comparison scoreboard titled 'Step 5 Preview vs GPT-6 Astra — the scoreboard'. The left column gives Step 5 Preview the rows AA Index 44, parameters 600B total / 27B active, price $1.00 / $2.70, cache discount 95%, cost per index task $0.71 and output speed 99.8 tokens/sec. The right column gives GPT-6 Astra the rows AA Index 53, parameters undisclosed, price $10.00 / $50.00, cache discount 90%, cost per index task $3.26 and output speed 59.3 tokens/sec. A footer reads 'Both figures per Artificial Analysis Intelligence Index; Astra pricing rises to $20 / $75 above 272K input tokens.'

Fakturan, rad för rad

Prissättningen för Step 5 Preview är enhetlig och billig: 1,00 USD in, 2,70 USD ut, med en cacherabatt på 95 % som lägger cachad indata nära 0,05 USD per miljon token. Vid en 7:2:1-mix av cacheträffar, indata och utdata – den konvention som den här bloggen använder för agenttrafik – landar den blandade kostnaden nära 0,51 USD per miljon token, och kostnaden per uppgift i Intelligence Index hamnar på 0,71 USD, 27:e av 200. Haken är ordrikedomen: modellen producerade 160 miljoner utdatatoken i det indexet mot en median på 92 miljoner, så de råa tokenantalen ligger över vad prislappen antyder.

GPT-6 Astras prissättning är nivåbaserad, och nivån är den del som är värd att läsa noga. Under 272K indatatoken per begäran är den $10.00 och $50.00; över det, $20.00 och $75.00. Nivån väljs utifrån varje begärans egen indatatokenantal, vilket spelar större roll än det låter för en modell som marknadsförs med 1M-tokenkontext — ett enda anrop med stor kontext passerar gränsen och fördubblar taxan för hela begäran. Cacheläsningar kostar $1.00 per miljon, en rabatt på 90%, och cacheskrivningar kostar $12.50 per miljon. Vid samma 7:2:1-mix hamnar den sammanvägda taxan nära $7.70 per miljon token, och kostnaden per Index-uppgift är $3.26, 71:a av 200.

Astra drar i motsatt riktning när det gäller mångordighet, och är den koncisa modellen här: 60M utdatatokens på Index mot Step 5 Previews 160M, 27:e av 200 i det måttet. Färre tokens till högre taxa minskar gapet på ett sätt som den råa multipeln överdriver. Den stänger det inte – siffran för kostnad per uppgift neutraliserar redan mångordighet, cachebeteende och prissättning tillsammans, och $3.26 mot $0.71 är fortfarande en 4,6-faldig skillnad.

Vad de nio indexpoängen köper

Astras rubriksiffror är OpenAIs egna och har inte reproducerats: 96,1 på GPQA Diamond, 72,6 % på OSWorld 2.0, 97,6 % på FrontierMath Tier 4, 57,2 % på Humanity's Last Exam med verktyg, och runt 57,9 % på Terminal-Bench 4.0. Siffran för ARC-AGI-3 är den man bör hantera varsamt – OpenAI rapporterar 99,9 % i sitt eget provider-adapter-testramverk och 62,7 % i det standardiserade testramverket, och en svängning på 37 punkter mellan testramverk säger minst lika mycket om testramverket som om modellen.

Step 5 Previews publicerade siffror ligger inom samma område på de agentiska uppgifter som den byggdes för, och har samma förbehåll: 33,3 % på Terminal-Bench 4.0, 80,5 på ProgramBench, 67,7 på DeepSWE v1.1 och 49,0 på StepCodeBench, alla från StepFun och ingen av dem har reproducerats oberoende. Olika leverantörer, olika testramverk, ingen gemensam körning – vilket är precis varför den oberoende uppmätta skillnaden på nio punkter är det mer användbara talet än något av dessa.

Den skillnaden är verklig och den är inte liten. På en resultattavla med 200 modeller ligger 53 och 44 på tredje respektive tjugofjärde plats, och avståndet visar sig som en annan typ av uppgift snarare än en annan poäng på samma uppgift: Astras publicerade segrar klustrar sig kring långsiktigt resonemang och datoranvändning, vilket är där toppen av resultattavlan drar ifrån. Om din arbetsbelastning finns där är de nio poängen värda mer än fakturan.

Ett förbehåll om Astras poäng. Artificial Analysis reviderar Intelligence Index, och siffror för samma modell varierar mellan ögonblicksbilder tagna med veckors mellanrum — 52,8, 53 och 54,7 förekommer alla i material som publicerats om den här modellen inom samma månad. 53:an på den aktuella modellsidan är den siffra som ska användas, och varje jämförelse som ställer en äldre Astra-ögonblicksbild bredvid en aktuell Step 5 Preview-siffra mäter med två olika måttstockar.

Screenshot of the Artificial Analysis model page for GPT-6 Astra, showing OpenAI as the creator with a September 2026 release date, an Intelligence Index of 53 at rank 3 of 200, output speed 59.3 tokens per second at rank 101 of 200, cost per Intelligence Index task $3.26 at rank 71 of 200, verbosity 60M output tokens at rank 27 of 200, pricing of $10.00 per million input tokens and $50.00 per million output tokens with a 90% cache discount, and technical specifications listing reasoning, text and image input, a 1M-token context window and an April 30, 2026 knowledge cutoff.

Hastighet och latens är två olika frågor

När det gäller genereringshastighet är den oberoende mätningen entydig: 99,8 uttoken per sekund för Step 5 Preview mot 59,3 för GPT-6 Astra, vilket också är långsammare än genomsnittet på 70 token per sekund bland de modeller som mättes. I en interaktiv kodningsloop är det skillnaden mellan ett förslag och en paus, och det ackumuleras under en session på samma sätt som en cacherabatt gör.

Latens är den mer komplicerade historien, och en enskild siffra ger en vilseledande bild av den. Astra dirigerar resonemang innan den sänder ut något, så tid till första token och tid till ett användbart svar är inte samma mätning, och publicerade siffror för den varierar kraftigt beroende på om resonemang räknas med. I vår egen trafik under de senaste sju dagarna är mediantiden till första token för GPT-6 Astra 6,72 sekunder med en 95:e percentil på 10,00 sekunder – den siffra en anropare faktiskt upplever via vår endpoint. Artificial Analysis anger tiden till första token för Step 5 Preview till 2,96 sekunder i sin egen testbänk, och de två siffrorna mäts inte på samma sätt, så de bör inte subtraheras från varandra.

Var cache-asymmetrin faktiskt hamnar

Båda modellerna ger kraftig rabatt på upprepade prefix och båda tar betalt för att skriva dem, och skillnaden mellan dem är 20-faldig vid läsning. Step 5 Previews 95-procentiga cacherabatt gör att cachad indata hamnar nära 0,05 USD per miljon token. GPT-6 Astra läser cache till 1,00 USD per miljon – en rabatt på 90 % från ett baspris som är tio gånger högre – och skriver den till 12,50 USD per miljon.

För en agentloop som skickar samma systemprompt och repository-kontext igen varje tur är det läspriset som ackumuleras, och den djupare rabatten på den billigare modellen är värd mer än den grundare rabatten på den dyra. Astras blandning hamnar fortfarande nära 7,70 dollar per miljon tokens mot Step 5 Previews 0,51 dollar vid samma 7:2:1-mix – en femtonfaldig skillnad som en lång session inte jämnar ut utan snarare ökar.

Köra båda från en tangent.

GPT-6 Astra är live på OrcaRouter under openai/gpt-6-astra till OpenAIs listpriser — 10,00 och 50,00 dollar per miljon under tröskeln på 272K, 20,00 och 75,00 dollar över den — vidarebefordrade utan påslag, så en ändring av leverantörens pris slår igenom hos oss samma dag i stället för vid nästa faktureringscykel. Vår egen telemetri över sju dygn på den endpointen visar den ovan angivna medianen på 6,72 sekunder och 95:e percentilen på 10,00 sekunder för tid till första token, tillsammans med 277,9 miljoner tokens trafik genom den under den senaste veckan.

Step 5 Preview finns inte i vår katalog och vi dirigerar inte den. Den körs på StepFuns eget API och Studio, och det är den enda platsen den körs på tills checkpointen den 15 oktober landar. Den asymmetrin är inte en brist i jämförelsen; den är jämförelsen. Den billiga halvan av den här matchen är den halva du måste gå någon annanstans för att anropa, och den halva du kan sätta i produktion idag finns bakom ett enda API för fler än 200 modeller: GPT-6 Astra till priserna ovan, GLM-5.3 för $1,26 och $3,96, DeepSeek V4 Pro, Claude Opus 5 och resten, med automatisk failover mellan leverantörer som håller en väg stabil när en leverantörs kapacitet förändras, och routnings-DSL:en som låter en uppgift börja billigt och eskalera bara när den måste. Den eskaleringsregeln är det verkliga svaret på en tiofaldig prisskillnad: större delen av en arbetsbelastning behöver inte toppen av listan, och ett routningslager är hur du slutar betala för den del som inte gör det.

Screenshot of the OrcaRouter model page for GPT-6 Astra at www.orcarouter.ai/models/openai/gpt-6-astra, showing the model id openai/gpt-6-astra with NEW, FLAGSHIP and FEATURED badges, a 1M-token context and 128K max output, text, image and file input with text output, best-for tags for reasoning, coding and agentic work, input pricing of $10.00 and output pricing of $50.00 per million tokens, a seven-day median time to first token of 6.72 seconds and a 95th percentile of 10.00 seconds, 277.9M tokens of seven-day traffic, and the chat-completions and responses endpoints behind the OrcaRouter API.

Vem ska välja vilken

Om din arbetsbelastning är en långsiktig agent som måste få en svår uppgift rätt — datoranvändning, forskning i flera steg, arbete där ett felaktigt svar kostar mer än tokens — är GPT-6 Astras niopoängsförsprång den billigaste delen av beslutet, och fakturan är vad förmågan kostar. Kör den som eskaleringsmål, inte som standard, och håll koll på 272K-tröskeln: en enda överdimensionerad begäran fördubblar taxan för allt i den.

Om din arbetsbelastning är högvolymig agentisk text – kodgenerering, refaktoreringar, strukturerad extraktion, den inre loopen i en kodassistent – ligger Step 5 Preview före på allt som fakturan och klockan bryr sig om, och nio indexpoäng överlever sannolikt inte kontakten med en uppgiftsdistribution som inte ligger i toppen av resultattavlan. Haken är inte prestandan: modellen är proprietär, utan publicerad licens, utan tillstånd för kommersiell användning och utan checkpoint förrän den 15 oktober. Du kan anropa den; du kan inte äga den, finjustera den eller släppa en derivatversion av den.

Om svaret inte är självklart är mönstret en nivåuppdelning snarare än ett val. Dirigera allmän trafik till en modell på mellannivå och reservera Astra för de förfrågningar som behöver toppen av listan — båda ändarna av den regeln ligger bakom en och samma nyckel på vår sida, så uppdelningen kostar en routingregel snarare än ett andra avtal. Att betala flaggskeppspriser för arbete som en modell på mellannivå utför korrekt är misstaget som den här jämförelsen egentligen handlar om.