
Grok 4.7 vs Claude Opus 5: Prisskillnaden är verklig, pariteten är det inte
- OrcaNYOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1M tokens
- orcaNYOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1M tokens
- deepseekNYDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligens76Kodning
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0540Intelligens72Kodning
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligens76Kodning
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligens69Kodning
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Du kan anropa Grok 4.7 för 2,00 USD per miljon indatatoken och 6,00 USD per miljon utdatatoken. Du kan anropa Claude Opus 5 för 5,00 USD och 25,00 USD. Det är en skillnad på 4,2x för utdata – den typ av gap som vanligtvis avgör en jämförelse innan benchmarkarna ens har öppnats. Det avgör inte den här. I den version av Artificial Analysis Intelligence Index som båda modellerna för närvarande betygsätts mot – v4.3.2, den revision som publicerades den 19 september 2026 – ligger Claude Opus 5 på 51 och Grok 4.7, som leverantören släppte den 21 september 2026, ligger på 46. Fem poäng är ingen utklassning, men hur de fem poängen fördelar sig är: Opus 5 vinner åtta av de tio utvärderingarna i det indexet. Den billigare modellens argument är priset, kontexten går på ett ut, och den enda plats där Grok 4.7:s prisfördel skulle ha spelat störst roll är exakt där den försvinner.
Två flaggskepp, två väldigt olika prislappar
Claude Opus 5 har funnits på marknaden sedan den 24 juli 2026 och är Anthropics flaggskepp i Opus-klassen, placerad under Claude Fable 5.1 i företagets egen produktlinje. Den har ett kontextfönster på 1 M tokens till fast prissättning – Anthropic säger uttryckligen att en begäran på 900k tokens faktureras till samma tokenpris som en på 9k tokens, helt utan premium för lång kontext – och en maximal utdata på 128K, utökningsbar till 300K via Message Batches API. Tänkandet är adaptivt och på som standard, med en ansträngningsstege som sträcker sig över låg, medium, hög, xhigh och max, med hög som standard. Vikterna är stängda.
Grok 4.7 är en dag gammal. Den har en kontext på 500 000 token, tar emot text och bilder och returnerar text, och har ett eget reglage för resonemangsansträngning. Listpriset är 2,00 USD för indata och 6,00 USD för utdata per miljon token under 200 000 prompt-token, och stiger till 4,00 USD och 12,00 USD vid eller över den tröskeln; cachelagrade läsningar kostar 0,50 USD och 1,00 USD i samma två intervall. xAI listar också en snabbare variant som körs med ungefär dubbelt så hög utdatahastighet för ungefär dubbelt pris, även om den konfigurationen släpptes utan att någon publicerad hastighetsmätning bifogades. Vikterna är stängda även här, vilket tar bort "kör det själv"-flyktvägen från båda sidor i den här jämförelsen.
Den oberoende styrelsen är inte nära, och den är inte smickrande
Båda dessa modeller poängsätts i Artificial Analysis v4.3.2-index, som omfattar tio utvärderingar inom agenter, kodning, allmän kunskap och vetenskapligt resonemang. Att ställa de två kolumnerna sida vid sida får fempoängssiffran att framstå som generös mot den billigare modellen – ett enda fempoängsglapp i ett sammansatt mått kan dölja mycket, och här döljer det en nästan total utklassning.
• Sammansatt intelligens — Grok 4.7 (xhigh): 46 på Artificial Analysis Intelligence Index v4.3.2. Claude Opus 5 (adaptivt resonemang, maximal ansträngning): 51 på samma version.
• Krävande resonemang — Grok 4.7: Humanity's Last Exam 43, CritPt 18. Claude Opus 5: HLE 55, CritPt 29. En skillnad på tolv poäng och en på elva poäng, båda till Opus 5:s fördel.
• Agentiska terminaler — Grok 4.7: Terminal-Bench 4.0 26. Claude Opus 5: 49. Detta är det största enskilda gapet på resultattavlan, och det finns på det benchmark som ligger närmast verkligt autonomt arbete.
• Arbetsplatsautomatisering — Grok 4.7: AutomationBench-AA 66 %. Claude Opus 5: 57 %. Grok 4.7:s enda tydliga vinst, och en verklig sådan — nio procentenheter på den utvärdering som mäter huruvida en agent slutför ett arbetsflöde utan att snubbla på en skyddsräls.
• Kunskap och ärlighet — Grok 4.7: AA-Omniscience 32. Claude Opus 5: 37. Båda modellerna hallucinerar; Opus 5 gör det mindre i denna mätning.
• Lång kontext — Grok 4.7: AA-LCR v1.1 77 %, fönster 500k tokens. Claude Opus 5: 79 %, fönster 1M tokens.
• Kostnad för att köra indexet — Grok 4.7: 240M utdatatokens under hela utvärderingen, flaggad av Artificial Analysis som ovanligt mångordig. Claude Opus 5: 140M. Grok 4.7 använder 1,7x tokens för att nå en lägre poäng.

Där Grok 4.7:s prisfördel går i graven
Här är matematiken som prislistan döljer. Ta en realistisk agentisk förfrågan: 30k indatatoken, 8k utdata. Grok 4.7 debiterar $0,06 in och $0,048 ut – ungefär elva cent. Claude Opus 5 debiterar $0,15 in och $0,20 ut – ungefär trettiofem cent. Det är en äkta 3x-faktor, och vid den här storleken är Grok 4.7 det självklara valet enbart utifrån kostnad.
Ta nu den förfrågan som Grok 4.7:s egen marknadsföring är uppbyggd kring: en agentisk session med lång kontext. Tryck prompten förbi 200k tokens och Grok 4.7:s priser fördubblas till $4.00 in och $12.00 ut. Claude Opus 5 står stilla — dess 1M-fönster debiteras med en platt taxa på $5.00 och $25.00. Vid 250k indata och 8k utdata kostar Grok 4.7 $1.00 in och $0.096 ut, cirka $1.10. Opus 5 kostar $1.25 in och $0.20 ut, cirka $1.45. Gapet har kollapsat från 3x till ungefär 1.3x. Tryck vidare — 400k, 500k, toppen av Grok 4.7:s fönster — och Opus 5:s platta taxa fortsätter att hämta in medan dess fönster fortsätter upp till en miljon tokens. Grok 4.7 är den billiga modellen vid korta prompter och nästan jämbördig i pris vid de långa, vilket inverterar den intuition som prissidan är utformad för att skapa.
Två förbehåll håller detta hederligt. För det första är long-context-nivån en dokumenterad listprisstruktur från xAI:s egen modelldokumentation, inte en mätning – verkliga fakturor beror på cachning, och Grok 4.7:s cachade läspris på 0,50 USD är verkligen billigt. För det andra har Artificial Analysis ännu inte publicerat en hastighetsmätning för Grok 4.7, så "den är snabbare"-halvan av argumentet om billigt och snabbt är för närvarande obekräftad. Det som är mätt är Opus 5 med 59 tokens per sekund och 49 sekunders tid till första token – långsam, dyr och ligger före på nästan varje kvalitetsdimension.
Vad du faktiskt skulle routa
Det här är en jämförelse där det ärliga svaret skiljer sig åt beroende på arbetsbelastning, och en router är det billigaste sättet att agera på det. Claude Opus 5 finns tillgänglig på OrcaRouter, listad på sin egen modellsida med leverantörens pris vidarebefordrat med 0 % påslag – så Opus 5:s $5,00 och $25,00 i vår katalog är Anthropics listpris, inte en kopia med påslag, och om Anthropic ändrar det ändras siffran på samma nyckel samma dag. Grok 4.7 finns inte i OrcaRouter-katalogen i skrivande stund; för att anropa den i dag går du via xAI:s eget API och de tredjepartsplattformar som tillhandahåller den. Den asymmetrin är värd att känna till innan du bygger arkitekturen kring den.

Routningsmönstret som framgår av siffrorna är enkelt. Skicka långkontext-, resonemangstunga och terminalagentuppgifter till Opus 5 – den vinner Terminal-Bench 4.0 med 23 poäng och har dubbelt så stort fönster till fast pris, vilket är precis profilen för ett svårt, långt jobb. Skicka högvolymsautomatisering och arbetsflödesuppgifter till Grok 4.7: den vinner AutomationBench-AA med nio poäng och kostar en tredjedel så mycket vid korta prompter. Eftersom båda nås via en och samma slutpunkt när de finns i katalogen, är den uppdelningen en routningsregel snarare än ett andra leverantörsavtal, och automatisk failover innebär att en hastighetsbegränsning på en väg blir en routningshändelse i stället för ett avbrott. Där en arbetsbelastning verkligen behöver båda – en billig första genomgång och en dyr verifieringsgenomgång – komponerar routnings-DSL:en dem till ett enda anrop i stället för två integrationer.
Domen
Om du väljer utifrån bevis vinner Claude Opus 5 den här matchen, och det är inte ens nära: åtta av tio utvärderingar, de två största gapen, dubbelt så mycket kontext till oförändrat pris, och en tokenbudget väl under två tredjedelar av storleken för en högre poäng. Fempunktssammansättningen underskattar hur överlägset det leder. Grok 4.7:s argument är snävare än dess prislista antyder, men det är inte tomt — den är genuint billigare vid de promptstorlekar som de flesta applikationer faktiskt använder, den är den bättre automatiseringsmodellen, och den är en dag gammal med en leverantörens benchmarksvit som fortfarande reproduceras oberoende. Köp den för kostnadskänslig automatisering, håll koll på dess hastighetssiffror när Artificial Analysis publicerar dem, och behandla prisnivån för lång kontext som det som avgör om den billiga modellen förblir billig.

Jämförda i den här artikeln1
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
