Ett hero-titelkort för 'GPT-5.6 vs Grok 4.6' med överrubriken 'Index oavgjort vid 61 — pris och kontext skiljer sig åt': vänster rundat kort 'GPT-5.6 Sol' (OpenAI — släppt 9 juli 2026; $4.00 / $20.00 per 1M; ~1.05M kontext · 128K utdata; max ansträngning = 4 delagenter) och höger rundat kort 'Grok 4.6' (SpaceXAI — släppt 12 augusti 2026; $2.00 / $6.00 per 1M; 500K kontext · ingen utdatabegränsning; ansträngningsreglage från låg till extrahög), sidfot 'Independent AA Index: 61 = 61.', OrcaRouter-logotyp nederst till höger.
Guides & Insights

GPT-5.6 vs Grok 4.6: Jämna på index, skilda i kontext och pris

Författare

Rowan Sterling

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

På Artificial Analysis Intelligence Index-skalan, som båda mättes mot fram till början av september 2026, fick OpenAI:s GPT-5.6 – vars flaggskeppsnivå, GPT-5.6 Sol, är vad API-namnet gpt-5.6 dirigerar till – och SpaceXAI:s Grok 4.6 samma siffra: 61. Ett oberoende index som placerar två rivaliserande flaggskepp på samma nivå är den ovanligaste typen av resultat i en jämförelse av frontmodeller, och det är här som mötet blir intressant snarare än tar slut. De modeller som hamnade lika säljs väldigt olika. GPT-5.6 Sol, det flaggskepp som OpenAI släppte den 9 juli och ompositionerade som sin värdenivå när GPT-6 Astra lanserades den 3 september, listas till 4,00 dollar per miljon input-tokens och 20,00 dollar per miljon output-tokens efter en prissänkning den 24 augusti, och har en kontextlängd på upp till cirka 1,05 miljoner tokens. Grok 4.6, som xAI släppte den 12 augusti, listas till 2,00 / 6,00 dollar och toppar på 500 000 tokens. Samma poäng på det oberoende indexet – och sedan skiljer sig de två modellerna åt i hur långt du kan pressa ett enskilt anrop, och vad det kostar att pressa det.

Den här sidan finns nu av en konkret anledning: de två prislistorna och de två taken ändrades inom loppet av några veckor från varandra. Grok 4.6 släpptes den 12 augusti och blev den 28 augusti tillgänglig i vanliga Grok-chattar på webben och mobilen efter att ha varit begränsad till Grok Build och API:et under de första två veckorna. GPT-5.6 Sols introduktionspris landade den 24 augusti, och tio dagar senare nedgraderade GPT-6 Astras lansering tyst Sol från flaggskepp till prisvärt flaggskepp. Båda modellerna nedan är nu det du vänder dig till när du vill ha resonemang i närheten av frontlinjen utan att betala Astra-klassens priser — vilket är exakt varför oavgjordheten 61-mot-61 har blivit den levande beslutsfrågan snarare än en ren kunskapsfråga.

Vad "oavgjort vid 61" betyder, och vad det inte betyder.

Poängen behöver ett datum och en måttstock. Artificial Analysis mätte GPT-5.6 Sol till ~61 och Grok 4.6 till 61 på den indexskala som användes fram till början av september – den skala som den här bloggens andra GPT-5.6-matcher hänvisar till – med Grok rankad som 11:a av de 202 modeller som AA spårar och Sol inom ett par placeringar från det på samma poäng. AA kalibrerade sedan om indexet den 7 september (v4.3), en version som komprimerar poängen: GPT-5.6 Sol mäter 47 där, GPT-6 Astra och Claude Fable 5.1 mäter 53, och ingen totalpoäng för Grok 4.6 har ännu publicerats på den nya skalan. Oavgjordheten nedan är därför ett uttalande om september-skalan före omkalibreringen, och den bör läsas som relativ position: på det senaste index som poängsatte båda låg dessa två jämställda, och båda låg precis bakom klassen Claude Opus 5.

Ytterligare en invändning när det gäller oavgjordheten, och den har betydelse för hur du använder resultatet. De två poängen producerades med olika ansträngningsinställningar — GPT-5.6 Sol vid max resonerande, OpenAIs högsta reglageinställning (som kör fyra parallella delagenter för svåra förfrågningar), och Grok 4.6 vid hög, xAIs standardinställning på dess låg-till-xhigh-reglage. Båda är "ge allt"-konfigurationer, men de är inte samma konfiguration, och oavgjordheten gäller mellan dessa två specifika inställningar snarare än mellan alla inställningar som modellerna erbjuder. Vad den lika poängen faktiskt fastställer är att ingen av modellerna har en generell intelligensfördel som det andra lägret kan peka på i ett oberoende sammansatt index — så en köpare som väljer mellan dem måste se bortom indexet, till sammanhang, pris och de bevis som vardera sida faktiskt kan visa.

Två prislistor, två stup.

Båda leverantörerna fakturerar en lång prompt som en premiumhändelse, och båda fakturerar hela begäran på den högre nivån när ett tröskelvärde väl passerats – det är den gemensamma mekanismen som gör denna prisjämförelse begriplig. OpenAIs avgift för GPT-5.6 Sol är $4.00 / $20.00 per miljon med cachade läsningar på $0.40, och när en begäran passerar ungefär 272K inmatade token omprissätts hela begäran till $8.00 / $30.00 – den långa kontextstrukturen som Epoch AI dokumenterade den 8 september. xAIs avgift för Grok 4.6 är $2.00 / $6.00 med cachade läsningar på $0.50, och när en prompt passerar 200K token flyttas hela begäran till $4.00 / $12.00.

Släppt — GPT-5.6: 9 juli 2026 (offentligt API; gpt-5.6-aliaset når Sol-nivån). Grok 4.6: 12 augusti 2026.

Listpris per 1M (in / ut) — GPT-5.6 Sol: $4.00 / $20.00, cacheläsningar $0.40 (kampanj till och med minst 21 nov 2026). Grok 4.6: $2.00 / $6.00, cacheläsningar $0.50.

Nivå för långa prompter — GPT-5.6 Sol: hela förfrågan till $8.00 / $30.00 över ~272K indata. Grok 4.6: hela förfrågan till $4.00 / $12.00 vid 200K indata.

Kontext / utdatatak — GPT-5.6 Sol: ~1,05M in, 128K ut. Grok 4.6: 500K in, inget publicerat utdatatak.

Index (oberoende) — GPT-5.6 Sol (max) ~61 mot Grok 4.6 (high) 61, på septemberskalan före omkalibrering.

Modalitet — båda accepterar text- och bildinmatning och producerar text.

Kör de uträknade siffrorna och mönstret är entydigt: vid varje promptlängd som Grok 4.6 kan hantera är det det billigare valet, eftersom dess omprisade tak fortfarande hamnar på eller under standardpriset för GPT-5.6 Sol.

100K in / 8K utGPT-5.6 Sol: 0.10 × $4 + 0.008 × $20 = $0.56. Grok 4.6: 0.10 × $2 + 0.008 × $6 = $0.25. Grok är ungefär 55 % billigare för detta anrop.

400K in / 30K ut (båda omprissatta) — GPT-5.6 Sol: 0.40 × $8 + 0.03 × $30 = $4.10. Grok 4.6: 0.40 × $4 + 0.03 × $12 = $1.96. Grok är fortfarande ungefär hälften så dyrt även efter sitt eget prisfall.

600K in / 30K ut — GPT-5.6 Sol: 0.60 × $8 + 0.03 × $30 = $5.70. Grok 4.6: kan inte — 600K överskrider dess kontextfönster på 500K. Detta är bandet där Sol är det enda alternativet, och där dess pris inte längre verkar premium.

A two-column scoreboard titled 'GPT-5.6 vs Grok 4.6 — the scoreboard'. Left column 'GPT-5.6 Sol': Released Jul 9 2026; Price $4.00 / $20.00 per 1M, cache $0.40; Over 272K input whole request $8.00 / $30.00; Context / output ~1.05M / 128K; AA Intelligence Index ~61 (max); SWE-bench Verified ~96% (reported). Right column 'Grok 4.6': Released Aug 12 2026; Price $2.00 / $6.00 per 1M, cache $0.50; At 200K input whole request $4.00 / $12.00; Context / output 500K / no published cap; AA Intelligence Index 61 (high); GPQA Diamond 94.9% (reported). Footer: 'Independent index: tied at 61 — AA scale, pre-Sept-7 2026 recalibration.'; OrcaRouter logo bottom-right.

Prisstupets geometri skiljer sig på ett sätt som gynnar GPT-5.6 Sol: dess tröskel (272K) ligger högre än Groks (200K), så det finns ett band — ungefär 200K till 272K indata — där Grok redan har prissatt om och Sol inte har. Även där tenderar Grok att vinna i dollar, eftersom dess omprissatta utmatningspris på $12 fortfarande ligger 40 % under Sols standardpris på $20. Ekonomin vänder bara till Sols fördel bortom 500K tokens, vilket är precis den region som Groks kontextfönster inte kan nå. Om dina promptlängder håller sig under 200K — vilket gäller för det mesta av chat-, RAG- och code-assist-trafik — är Grok 4.6 i stor skala nästan dubbelt så billig räknat på sammanvägd kostnad, och hela-förfrågan-stupet innebär att du bör behandla 200K som en planeringsgräns snarare än som en mjuk rekommendation.

Vad Sols extra halv miljon token faktiskt är till för

Grok 4.6:s 500K-fönster rymmer fler verkliga arbetsbelastningar än specifikationen antyder – läsning av hela kodbaser, långa agenttranskript, stora hämtningskontexter – och avsaknaden av en publicerad utgångsgräns hjälper på generationssidan: för ett enda anrop som måste producera en mycket lång artefakt har Grok inget dokumenterat tak, medan GPT-5.6 Sol stannar vid 128K utdatatokens. GPT-5.6 Sol:s fördel ligger i bandet 500K till 1,05M, och de arbetsbelastningar som verkligen behöver det är smalare än vad marknadsföringen antyder: agenter som håller en hel repository plus en lång uppgiftshistorik i kontexten, mycket långa mötes- eller forskningstranskript som analyseras i ett svep, och hämtningsjobb över korpusar som är för stora för att dela upp i Grok-stora fönster. Om ingen av dina pipelines rör det bandet, är Sol:s extra kontext utrymme du betalar $4,00-ingångstaxan för att inte använda.

De två modellerna styr också resonerandet på olika sätt. GPT-5.6 Sol erbjuder en ratt med low / medium / high / max, där max kör fyra parallella underagenter som samordnar vid svåra uppgifter – i praktiken en liten agentsvärm per svår förfrågan, kraftfull men dyr i utdatatoken, och inställningen bakom det ungefärliga indexresultatet 61. Grok 4.6 kör en enda modell med en ratt från low till xhigh (förvald high) och serverbaserade verktyg för sökning och kodkörning, vilket gör dess beteende mer förutsägbart för budgeten: en begäran, en modell, en kostnad du kan uppskatta från prislistan. För en utvecklare som vill ha förutsägbara utgifter är Groks enmodellsdesign operativt enklare; för de svåraste långsiktiga uppgifterna är Sols max-ansträngningssvärm den mer kapabla konfigurationen – och anledningen till att dess bästa resultat och dess värsta fakturor kommer från samma inställning.

De bevis som varje sida faktiskt kan lägga fram.

Ingen av modellerna har ett oberoende försprång på kodningsresultattavlan, så de citerbara beläggen fördelar sig efter leverantör. OpenAI rapporterar GPT-5.6 Sol till cirka 96 % på SWE-bench Verified – den starkaste kodningshänvisning som någon av modellerna kan visa, men en rapporterad utvärdering som ännu inte har genomgått någon oberoende granskning – och Sols verkliga fördel är att den lever inuti Codex- och ChatGPT-verktygen. xAI rapporterar Grok 4.6 till 94,9 % på GPQA Diamond, vilket man presenterar som den högsta poäng som uppmätts på det benchmarket, och hänvisar till agentiska utvärderingar som i genomsnitt kostar cirka 0,84 USD i API-avgift per heltäckande uppgift; båda är leverantörssiffror. När det gäller hastighet ligger de två närmare varandra än prisskillnaden antyder: AA mätte Grok 4.6 till 64,9 utdatatokens per sekund och GPT-5.6 Sol till samma intervall kring 65 vid standardservering, medan OpenAIs separata Cerebras-drivna ”Ultrafast”-förhandsversion (upp till cirka 750 tokens per sekund) fortfarande är begränsad och utan prissättning. Läs hela evidensöversikten som: oavgjort index, kodningsbevis på båda sidor utan oberoende granskning på någon av dem och ingen hastighetsskillnad som förändrar beslutet.

Vilken standardinställning är rationell i september 2026?

Välj Grok 4.6 när din trafik ryms inom 200 000 tokens i indata – priset är nästan halverat vid varje längd den hanterar, det oberoende indexet säger att modellerna är jämnstarka, och ett enda modellreglage med serverbaserade verktyg håller fakturan förutsägbar. Välj GPT-5.6 Sol när du verkligen behöver kontextintervallet 500 000 till 1,05 miljoner tokens, när din teknikstack redan är Codex- eller ChatGPT-nativ och den rapporterade SWE-bench-siffran på cirka 96 % ger inköpsavdelningen ett kvitto på kodningsförmåga, eller när du vill ha möjligheten att använda konfigurationen med fyra subagenter och maximal ansträngning för de svåraste uppgifterna med lång tidshorisont. Och håll koll på två datum: GPT-5.6 Sols $4/$20-kampanj är garanterad åtminstone till och med den 21 november 2026, varefter den här jämförelsen förändras, och xAI har redan antytt att en Grok 4.7 är på väg – endera händelsen kan ändra prisbilden för det val du är på väg att göra till standard.

Att köra båda utan att ändra arkitekturen.

Eftersom det är oavgjort på indexet handlar valet om tak och pris snarare än om kvalitet. Det praktiska mönstret för de flesta team är att routa snarare än att välja. GPT-5.6 Sol och Grok 4.6 finns båda på OrcaRouter till sina leverantörers listpriser, utan påslag — OpenAI:s $4/$20 och xAI:s $2/$6 är siffrorna i listningen, och när någon av leverantörerna ändrar ett pris är det nya priset live på samma nyckel samma dag. Med en OpenAI-kompatibel slutpunkt kan du skicka sub-200K-trafik till Grok 4.6, eskalera prompts som behöver Sols längre kontext eller dess max-effort-konfiguration, och använda automatisk failover så att en rate limit på en leverantörsväg blir en routinghändelse snarare än ett avbrott.

A screenshot of the OrcaRouter model page for GPT-5.6 Sol (model id openai/gpt-5.6-sol), showing the header price of $4.00 in / $20.00 out per 1M tokens, tags including Vision, Tools, JSON and Reasoning, 'by OpenAI — 2026-07-09', a description of GPT-5.6 Sol as the flagship model in OpenAI's GPT-5.6 series covering deep multi-step reasoning, large-scale software engineering and long-horizon agentic work over a 1.05M-token context window with up to 128K output tokens, and the site's latest-model navigation.

Prisdelen av denna jämförelse är den del som rör sig — OpenAIs Sol-kampanj är endast garanterad till och med 21 november och xAI har en 4.7 på färdplanen — så referensen som denna blogg håller uppdaterad är dess GPT-5.6 Sol-prissättningssida, med datumstämpel och omverifierad närhelst prislistan ändras.

A screenshot of OrcaRouter's '$4 / $20 per 1M Tokens — After the Price Cut' pricing article on the GPT-5.6 Sol promotional rate, bylined Gideon Frost, shown alongside the site's LATEST MODELS rail.

Tvåradssvaret

Om dina prompts ryms inom 500K tokens — och de flesta gör det — levererar Grok 4.6 samma oberoende indexpoäng som GPT-5.6 Sol till nästan halva priset vid varje längd den kan betjäna, utan publicerad utgångsbegränsning och med en förutsägbar enmodellsreglage. GPT-5.6 Sol förtjänar sin premie i det band som Grok inte når: bortom 500K tokens kontext, och inom OpenAIs verktyg där dess rapporterade ~96% SWE-bench Verified och Terra- och Luna-nivåerna under den ger dig en familj snarare än en enskild modell. Oavgjort på indexet innebär att detta beslut handlar om tak och dollar, inte kapacitet — så mät dina längsta verkliga prompts innan du förbinder dig, för den enda siffran avgör vinnaren.

Jämförda i den här artikeln1

Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen