
Claude Sonnet 5.5 vs Grok 4.5: Två inputpriser på $2 och en väntan på sex minuter
- typesafeNYTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1M tokens · 931 tok/s
- OpenAINYOpenAI: GPT-6 Luna2026-09-2237Intelligens
- OpenAINYOpenAI: GPT-6 Sol2026-09-2248Intelligens
- AnthropicNYAnthropic: Claude Opus 5.52026-09-2258Intelligens
- xAINYGrok 4.72026-09-2146Intelligens
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens · 192 tok/s
- OrcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens · 1174 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1M tokens · 62 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens · 107 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- xAISpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
Claude Sonnet 5.5 och Grok 4.5 tar samma pris för input: 2,00 dollar per miljon tokens. Det är där överensstämmelsen slutar, och en siffra gör poängen bättre än någon specifikationstabell. I Artificial Analysiss Intelligence Index-revision v4.3.2 är mediantiden till första svars-token för Claude Sonnet 5.5 i inställningen Max Effort 370,8 sekunder. För Grok 4.5 är den 6,9 sekunder. Samma inputpris. Femtiotre gånger väntetiden innan något alls kommer tillbaka. Claude Sonnet 5.5, släppt den 28 september 2026, och Grok 4.5, släppt den 8 juli 2026 och sedan dess passerad två gånger inom sin egen familj, är de två billigaste sätten in i den främre halvan av frontiern på papperet — och papperet döljer beslutet som faktiskt spelar roll, nämligen vad du köper med väntetiden.
Den siffran behöver sitt förbehåll omedelbart, för en latenssiffra utan en konfiguration är meningslös: 370,8 sekunder är Anthropics standardläge för resonemang vid maximal ansträngning, som gör av med en mycket stor tänkbudget innan det avger en svars-token. En anropare som vill ha en snabb första token konfigurerar något annat. Men riktningen är verklig och det är inte en artefakt – Artificial Analysis mäter Claude Sonnet 5.5:s utdatahastighet till 138,7 tokens per sekund, endast överträffad av en handfull modeller, och Grok 4.5:s till 59,2. Modellen som väntar längst skriver också snabbast. Det du väljer mellan är en lång överläggning följd av ett snabbt svar, och en kort överläggning följd av ett långsammare svar.
Vad ändrades den 28 september?
Claude Sonnet 5.5 är en dag gammal. Anthropic släppte den 28 september 2026 under API-identifieraren claude-sonnet-5-5, tillsammans med Bedrock, Google Cloud och Microsoft Foundry, och beskriver den som 30 % snabbare än Claude Sonnet 5 och med upp till 30 % lägre kostnad per uppgift för de flesta typer av arbete. Det är leverantörens siffror och de har inte oberoende reproducerats; priset som den jämförs mot är verkligt, eftersom prislistan låg oförändrat på 2,00 USD per miljon indatatoken, 10,00 USD per miljon utdata, 0,20 USD för cacheläsningar och 2,50 USD för cacheskrivningar. Fönstret är 1 000 000 tokens med ett synkront utdatatak på 128 000 tokens, och 300 000 tokens i Message Batches API bakom output-300k-2026-03-24 headern. Kunskapsavgränsningen är juni 2026. Noll datalagring är tillgänglig från lansering, och Anthropic avvecklar inte modellen före den 28 september 2027.

Anthropics egen dokumentationssida är också ovanligt explicit om kostnaden för uppgraderingen: fem brytande ändringar skiljer Claude Sonnet 5.5 från den modell som större delen av Claude-trafiken för närvarande körs på, och de behandlas längre ner.
Grok 4.5 är det äldre alternativet och det mer komplicerade. SpaceXAI – företaget som fortfarande levererar under varumärket xAI på sina modellkort – släppte det den 8 juli 2026 som en mixture of experts-modell med 1,5 biljoner parametrar, tränad tillsammans med kodredigeraren Cursor, med ett fönster på 500 000 tokens, inmatning av text, bild och fil, och ett lanseringsbudskap som nästan helt byggde på tokenekonomi snarare än toppresultat. Det är inte längre flaggskeppet. Grok 4.6 och Grok 4.7 finns båda, båda har samma listpris på $2.00 / $6.00, och vår katalog listar alla tre. Den intressanta frågan i september 2026 är därför inte huruvida Grok 4.5 är bra; utan huruvida något fortfarande motiverar att välja det äldsta av de tre.
Fakturan är inte prislistan
Lägg de två sida vid sida på den oberoende tavlan, så träder handelns form fram.
• Intelligensindex, revision v4.3.2 — Claude Sonnet 5.5 56 vid Max Effort vs Grok 4.5 39
• Kostnad per Index-uppgift — Claude Sonnet 5.5 $7.60 vs Grok 4.5 $1.04, båda uppmätta, inte uppskattade
• Pris för utdata — Claude Sonnet 5.5 10,00 $ per miljon mot Grok 4.5 6,00 $ per miljon
• Utdatningshastighet — Claude Sonnet 5.5 138,7 tokens/sek mot Grok 4.5 59,2 tokens/sek
• Tid till första svarstoken, Max Effort — Claude Sonnet 5.5 370,8 s mot Grok 4.5 6,9 s
• Tokens genererade under hela Index-utvärderingen — Claude Sonnet 5.5 410M mot Grok 4.5 77M
• Kontext — Claude Sonnet 5.5 1 000 000 tokens vs Grok 4.5 500 000 tokens
Ordrikedomslinjen är mekanismen bakom gapet i kostnad per uppgift, och det är det enskilt mest användbara numret på den här sidan. En modell som avger 410 miljoner tokens under en utvärdering där dess rival avger 77 miljoner behöver inte en 67 % högre utmatningsfrekvens för att kosta sju gånger så mycket per uppgift — men den har en ändå, och båda effekterna driver i samma riktning. Anthropics egen formulering stämmer med tolkningen snarare än motsäger den: "upp till 30 % mindre per uppgift" är ett påstående om antalet tokens, inte om frekvenser, eftersom frekvenserna inte ändrades mellan Claude Sonnet 5 och Claude Sonnet 5.5. Artificial Analysis kommer fram till samma slutsats från andra hållet och beskriver modellen i klarspråk som anmärkningsvärt snabb men mycket ordrik. Mot en slimmad modell är den egenskapen Claude Sonnet 5.5:s största operativa risk.

Där Grok 4.5:s billiga taxa slutar vara billig
Raden $2,00 / $6,00 är en nivå, inte en taxa. I SpaceXAI:s egen utvecklardokumentation gäller det priset upp till 200 000 indatatoken och fördubblas till $4,00 för indata och $12,00 för utdata därutöver. Grok 4.5:s fönster är 500 000 token, så den andra halvan av fönstret som den annonserar kostar dubbelt så mycket som den första halvan. Att läsa in en prompt av repositoriestorlek i Grok 4.5 är inte en utdataoperation för $6; det är en utdataoperation för $12, och vid det laget är modellen med det "dyra" utdatapriset på $10 den billigare för varje begäran som också avger många token.
Claude Sonnet 5.5 har ingen motsvarande nivå. Priset på $2.00 / $10.00 gäller för hela fönstret på 1 000 000 token, och cacheläsningar debiteras med $0.20 – en tiondel av indatapriset – vilket är det som gör fallet med lång kontext genomförbart i praktiken och inte bara på papper.
Fönsterstorleken är den andra halvan av det argumentet och den pekar i samma riktning. Grok 4.5:s fönster är 500 000 tokens och var och en av dem faktureras enligt annonserad taxa. Claude Sonnet 5.5 har 1 000 000 tokens att arbeta med, och det är arbetsbelastningens utformning som gör att det spelar roll: ett kodförråd att resonera kring, ett långt agenttranskript, en hög med dokument som måste hållas kvar i vyn. Dubbelt så högt tak, ingen nivågräns vid hälften av det, och cacheläsningar till en tiondel av indatatakten är vad som förvandlar det att bära så mycket kontext över många anrop till en radpost i stället för en budget.
Den praktiska uppdelningen är inte subtil:
• Korta prompter med tät utdata — Grok 4.5 vinner på pris och vinner igen på tokenvanor
• Promptar över 200 000 indatatoken — Grok 4.5:s taxa fördubblas och Claude Sonnet 5.5:s gör det inte
• Latenskänsligt interaktivt arbete – Grok 4.5 svarar först, med stor marginal, vid standardinställningar
• Långsiktiga agentiska körningar — Claude Sonnet 5.5:s sammanvägda poäng och 128K utdatatak är vad du betalar den extra uppgiftskostnaden för, och 300K Batches-taket utökar det ytterligare
Migreringen är inte en modellsträng
Alla som migrerar från Claude Sonnet 5 till Claude Sonnet 5.5 bör läsa migrationsnoten från Anthropic innan de skriver kod, eftersom fem beteenden har ändrats och bara ett av dem misslyckas högljutt på en uppenbar plats.
• Icke-standardvärden för temperature, top_p eller top_k returnerar nu en 400 — en samplingsintensiv pipeline slutar fungera i stället för att degraderas
• thinking: {"type": "disabled"} returnerar en 400 och måste bli between_tools, där effort begränsas till low, medium eller high; xhigh och max avvisas
• Tvingad verktygsanvändning — tool_choice satt till "any" eller ett namngivet verktyg — avvisas direkt, så en loop som tvingar fram ett schemagiltigt anrop måste gå över till auto med strikt verktygsanvändning eller strukturerade utdata
• Det äldre computer_20251124 datoranvändningsverktyget avvisas på Claude API och på Google Cloud
• Tankeblock är bundna till den producerande modellen och kontot, så resonemang förs vidare från Claude Sonnet 5 men inte i sidled till en annan familj — och rådgivarverktyget accepterar inte längre Claude Opus 4.8, Claude Opus 4.7 eller Claude Sonnet 5 som rådgivare bakom en Sonnet 5.5-utförare
Det finns en sjätte ändring som inte får något att misslyckas alls, vilket gör den till den farliga: text mellan verktygsanrop returneras nu inuti tänkblock. En applikation som strömmar den texten till en användare blir tyst mellan verktygsanrop tills den antingen anger ett visningsvärde eller stänger av det inledande tänkandet helt. Inget fel uppstår. Utdata slutar helt enkelt att visas.
Grok 4.5 kräver inget av det. Det är en modell i OpenAI-format med samplingsytan intakt, och att gå över till den från Grok 4.5:s egna föregångare är en ändring av modellsträngen. Migreringskostnaden hamnar helt på Claude-sidan, och det är en dags arbete snarare än en eftermiddag.
Båda på en och samma autentiseringsuppgift, och den ärliga gränsen för det
Att hålla en jämförelse mellan två leverantörer i huvudet är lätt; att genomföra en är där kostnaden gömmer sig. OrcaRouter placerar över 200 modeller bakom en enda OpenAI-kompatibel endpoint med leverantörens listpris vidarebefordrat och inget påslag tillagt, så en prisändring på endera sidan är live här samma dag i stället för vid nästa avtalsförnyelse, med automatisk failover mellan uppströmsleverantörer och en routing-DSL för att komponera anrop. Hela Grok-serien finns i katalogen till SpaceXAI:s egna priser, och Grok 4.5 kan routas som grok/grok-4.5 till $2,00 för indata och $6,00 för utdata per miljon tokens över dess fönster på 500 000 tokens.
Claude Sonnet 5.5 finns inte i vår katalog, och den här sidan kommer inte att antyda något annat. Vägen dit i dag går via Anthropics eget API, eller Bedrock och Google Cloud om det är där din infrastruktur redan ligger. Claude Sonnet 5 har varit routbar här sedan den 30 juni till Anthropics 2,00 $ och 10,00 $ och är fortfarande den modell som merparten av Claude API-trafiken körs på, vilket gör den till det naturliga failover-målet medan Claude Sonnet 5.5 fortfarande bara är en dag gammal och ännu inte har några produktionsbevis.
Ett förbehåll hör till allt det där, och det är inte litet. Raden för Grok 4.5 ovan är leverantörens säljsnack så som vår katalog för närvarande återger den; trafikräknaren för den posten visar noll under de senaste sju dagarna och dess genomströmningssiffra mäts inte, med tiden till första token liggande på ett sekundgolv som en modell som knappt anropas tenderar att visa. En modell utan nyligen trafik här är inte bevis för att modellen är dålig — 4.6 och 4.7 är dit familjens anrop har tagit vägen — men det betyder att de operativa siffrorna på den sidan är tunna, och den latenssiffra som är värd att lita på är avläsningen av en aktiv rutt.

Vilken att välja
Grok 4.5 är rätt modell när prompten är kort, svaret är innehållstätt och integrationen redan talar OpenAI — och när förfrågan inte kommer att passera 200 000 indatatokener, eftersom matematiken byter händer bortom den gränsen. Det är också rätt val när en första token måste komma inom sekunder snarare än minuter. Vad den inte är är den nuvarande Grok-flaggskeppsmodellen; Grok 4.6 och Grok 4.7 ligger över den till samma listpris, och anledningen att välja 4.5 framför någon av dem måste vara en specifik sådan.
Claude Sonnet 5.5 är rätt modell när prompten är enorm, arbetet är tillräckligt agentiskt för att sjutton Index-poäng och ett utdatatak på 128K ska motivera en sju gånger högre kostnad per uppgift, eller när det sammanvägda resultatet helt enkelt är det som köps. Dess ordrikedom är ett designbeslut, inte en defekt, och det är siffran du bör mäta på din egen trafik innan du bestämmer dig — för $7.60 per Index-uppgift mot $1.04 är en proxy för en siffra som bara din arbetsbelastning kan producera.
