Hero-rubrikkort för Grok 4.7-referenssidan: rubriken "Grok 4.7: Referenssidan" ovanför underrubriken "SpaceXAI:s flaggskeppsmodell för resonemang, lanserad 21 september 2026", sedan tre rundade kort med texten "Kontext: 500K tokens", "Pris per 1M: $2.00 in / $6.00 ut" och "AA Intelligence: 46", med en sidfotsrad som lyder "Specifikationer och pris enligt SpaceXAI-dokument; AA Index enligt Artificial Analysis v4.3.2." och OrcaRouter-logotypen i det nedre högra hörnet.
Guides & Insights

Vad är Grok 4.7? Specifikationer, pris, kontextfönster och benchmarks

Författare

Gideon Frost

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller →
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Grok 4.7 är SpaceXAI:s nuvarande flaggskeppsmodell: en resonemangsmodell som tar in text och bilder, returnerar text, har ett kontextfönster på 500 000 token och kostar $2.00 per miljon indata-token och $6.00 per miljon utdata-token med resonemangsansträngning valbar i fyra nivåer. Den efterträder Grok 4.6, matchar den på pris och kontext exakt, och är inriktad på det långsiktiga arbetet — flera timmars kodning, agentiska verktygsslingor, professionellt kunskapsarbete — som företaget nu säljer hela sin produktlinje kring. Den här sidan är referensposten för den: vad modellen är, var den står, vad den accepterar, vad den kostar, och sedan två saker som medvetet hålls åtskilda — vad SpaceXAI säger om sin egen modell, och vad en oberoende utvärderare mätte.

Varför detta är en referenssida och inte en lanseringsartikel. Grok 4.7 släpptes den 21 september 2026, och den lanseringen har redan behandlats på den här bloggen (se grok-4-7-release-date-artikeln för första dagens läsning av den), så datumet nedan används som ett faktum som daterar modellen, inte som en händelse som rapporteras igen. Läsaren som den här sidan finns till för är den som skriver in enbart modellens namn i en sökruta och vill ha modellen, inte nyheten: under de 28 dagarna fram till den 25 september 2026 registrerar våra egna Search Console-data 31 934 visningar på den exakta sökfrågan "grok 4.7" och 34 160 för alla stavningar som kan reduceras till det namnet, med en genomsnittlig position på 7,8 utan någon dedikerad sida att landa på. Det är en mätning av vad folk skriver — den säger inget om hur bra modellen är — och det är därför sidan börjar med den enklaste möjliga frågan. Varje uppgift i den här artikeln är märkt med var den kommer ifrån: leverantörsrapporterad för allt från SpaceXAI:s egna dokument, lanseringsinlägg eller prissida, oberoende för Artificial Analysis, och vår egen för det som vår katalog och våra sökdata visar.

Var Grok 4.7 placerar sig i Grok-serien

Leverantören skriver nu sitt namn som SpaceXAI på både utvecklardokumentationen och nyhetssidan, medan API:et fortfarande serveras från api.x.ai och modellidentifieraren fortfarande är en grok. Grok 4.7 är toppen av textlinjen och leverantörens egen standardrekommendation: på frågan vilken modell man ska välja svarar modellsidan att för allt utom ljud-, bild- och videouppgifter – "inklusive kod" – bör du använda Grok 4.7, eftersom "det är den mest kapabla modellen vi har byggt." Dess syskonmodeller, enligt leverantörens egna publicerade priser per miljon token, är:

• Grok 4.6 — 500K kontext, $2.00 indata / $0.50 cachad / $6.00 utdata, lanserades i augusti 2026. Den direkta föregångaren och modellen som 4.7 prissätts i förhållande till.

• Grok 4.5 — 500K kontext, $2.00 input / $0.30 cachad / $6.00 output, släpptes i juli 2026. Samma listpris som sina efterträdare men ett lägre cachepris, vilket nu är det enda konkreta skälet att fortfarande välja den.

• Grok 4.3 — 1M kontext, $1,25 indata / $0,20 cachad / $2,50 utdata. Halva priset mot det nuvarande flaggskeppet och dubbelt så stort kontextfönster.

• Grok 4.20 (resonemangs-, icke-resonemangs- och multiagentvarianter) — 1M kontext, $1,25 indata / $0,20 cachad / $2,50 utdata.

• Grok Build 0.1 — 256K kontext, $1.00 indata / $0.20 cachad / $2.00 utdata. En kodningsspecialist snarare än en allmän modell, och standardmodellen för Grok Build-agenten är Grok 4.7, inte den här.

Så formen på den nuvarande produktlinjen är en avvägning mellan kapacitet och fönster: flaggskeppet ger dig 500K i kontext för $2/$6, och 4.3/4.20-nivån ger dig en hel miljon tokens till ungefär halva indatapriset och mindre än halva utdatapriset. Inget i leverantörens dokumentation tyder på att Grok 4.7 är en annan arkitektur än Grok 4.6 – vad utgåvan beskriver är en större basmodell, en längre körning med förstärkningsinlärning viktad mot uppgifter som tar många timmar att slutföra, bättre självverifiering, bättre hantering av lång kontext och träning på Grok Bot-ramverket så att modellen beter sig bättre i samtal och allmänt kunskapsarbete. Ett förbättringspåstående, inte en ny design. SpaceXAI publicerar inget parameterantal för Grok 4.7 på vare sig sin modellsida eller sin pristabell, och den här sidan kommer inte att gissa något sådant.

När det lanserades, och vad som lanserades tillsammans med det

Lanseringsinlägget är daterat den 21 september 2026, och utvecklarmodellsidan har samma datum som sin senaste uppdatering, vilket är så exakt det blir — SpaceXAI publicerar ingen utgivningstidsstämpel utöver dagen. Det som släpptes den dagen var inte bara en modellidentifierare. Den grok-4.7-slugen lanserades på både Responses API och Chat Completions med ett kontextfönster på 500 000 token, en kunskapsgräns i maj 2026, fyra resonemangsnivåer inklusive en ny toppinställning, en Fast-variant begränsad till två förstapartsytor, en regional slutpunkt endast för USA och listpriser identiska med Grok 4.6:s. Den gjordes samtidigt till standardmodell för Grok Build-kodningsagenten och gjordes tillgänglig i Cursor på alla plan. Om du vill ha reaktionen på lanseringsdagen snarare än specifikationen, grok-4-7-release-date-artikeln täcker det; den här sidan utgår från samma datum som ett faktum om modellen och går vidare till vad den faktiskt kommer att göra för dig.

Kuvertet: vad du kan skicka, och hur mycket av det

Allt följande kommer från SpaceXAI:s egen modellsida och modelsida, läst den 28 september 2026, om inget annat anges.

Screenshot of SpaceXAI's developer documentation page for grok-4.7, showing the model identifier grok-4.7, the tagline describing it as SpaceXAI's frontier model built for coding, agentic tasks and knowledge work, an At a glance block with Context, Modalities, Training data and Pricing rows, an Important details section, a Fast variant note, and a Where it runs list, plus a Python code sample setting the model name to grok-4.7 in the xai_sdk client.

• Kontextfönster — 500 000 tokens. Samma som Grok 4.6, hälften av vad Grok 4.3 och 4.20-familjen erbjuder.

• Kunskapsavgränsning — maj 2026, tre månader senare än Grok 4.6:s. Allt nyare kräver att ett sökverktyg är påslaget; modellen har ingen realtidsmedvetenhet som standard.

• Indata — text och bild. Bilder kan vara JPG/JPEG eller PNG, upp till 20 MiB vardera, och leverantören dokumenterar ingen gräns för antalet bilder i en begäran; bild och text kan förekomma i valfri ordning.

• Utdata – endast text. Det finns ingen generering av bild, ljud eller video i den här modellen; de är separata modeller i SpaceXAI-serien.

• Utdatatak — leverantören uppger att det inte finns någon gräns för textutdata. Vårt eget OrcaRouter-modellkort för grok-4.7 anger en maximal utdata på 450 000 tokens, och de två siffrorna stämmer inte överens. Vi flaggar det i stället för att i tysthet välja en av dem: SpaceXAI:s dokumentation är auktoriteten för SpaceXAI:s modell, och den ärliga tolkningen är att leverantören inte publicerar något tak för textutdata.

• Resonemangskontroll — reasoning_effort accepterar low, medium, high (leverantörens standardvärde) eller xhigh. xhigh är nytt i den här generationen; Grok 4.6 erbjöd också fyra nivåer, och de benchmarkvärden som publicerats för 4.7 anges vid xhigh.

• Verktyg — funktionsanrop, webbsökning, X-sökning och kodexekvering, alla dokumenterade som serversidiga verktyg.

• Strukturerad utdata — leverantören dokumenterar en kapacitet för strukturerade utdata vid sidan av textgenerering; vår egen sida exponerar den som response_format och structured_outputs.

• Parametrar som vår sida accepterar — include_reasoning, logprobs, max_tokens, reasoning, reasoning_effort, response_format, seed, structured_outputs, temperature, tool_choice, tools, top_logprobs och top_p. En varning värd att känna till innan du bygger på logprobs: SpaceXAI:s modellsida anger att logprobs och top_logprobs inte stöds av grok-4.20 och nyare modeller och "kommer att tyst ignoreras om de anges", vilket omfattar Grok 4.7. Att vår sida listar dem är inte ett löfte om att uppströmstjänsten returnerar dem.

• Slutpunkter – det OpenAI-kompatibla API:et för chattkompletteringar och Responses-API:et.

• Prompt-cachning – leverantören rekommenderar att ställa in prompt_cache_key på Responses API (x-grok-conv-id-headern på Chat Completions) så att en konversations förfrågningar hamnar på samma server; utan den varnar dokumentationen för att du ofta betalar fullpris för indata på en cache-kall server. Cachad indata debiteras med $0,50 per miljon tokens under tröskeln på 200K.

• Krypterat resonemang – på Responses API returnerar Grok 4.7 alltid reasoning.encrypted_content, även när du inte ber om det, så anrop över flera turer behåller modellens resonemang utan extra konfiguration. Chat Completions är oförändrat.

Prislistan, i sin helhet

Prissättningen är nivåindelad efter promptstorlek, och tröskelvärdet gäller för hela begäran när det väl har passerats, inte bara för tokens ovanför gränsen. Varje siffra här är publicerad av leverantören, hämtad från SpaceXAI:s prissida den 28 september 2026:

Standard, promptar under 200 000 tokens – 2,00 USD inmatning / 0,50 USD cachad inmatning / 6,00 USD utmatning per miljon tokens.

• Lång kontext, promptar på eller över 200 000 tokens – 4,00 USD indata / 1,00 USD cachad indata / 12,00 USD utdata per miljon tokens.

• Grok 4.7 Fast – samma modell på snabbare infrastruktur till dubbla standardpriser: 4,00 $ / 1,00 $ / 12,00 $ under 200K, och 6,00 $ / 1,50 $ / 18,00 $ över det. Den är endast tillgänglig via Cursor och Grok Build, den finns inte alls i det publika API:et, och den kostnadsfria nivån hos Grok Build inkluderar den inte.

• US regional endpoint — https://us.api.x.ai/v1 keeps inference in the United States and bills at 1.1×, which works out to $2.20 / $0.55 / $6.60 per million below 200K and $4.40 / $1.10 / $13.20 above. Only grok-4.7 and grok-4.6 are served there today.

Jämfört med resten av marknaden är det intressanta inte rubrikpriset – $2 in och $6 ut är exakt vad Grok 4.6 tog och vad Grok 4.5 fortfarande tar – utan cacherebatten, som leverantören anger som 75 % rabatt på indata för upprepade promptprefix. För en lång agentloop som skickar samma systemprompt och filkontext varje tur är den rabatten skillnaden mellan listpriset och fakturan. Det är också den enda posten där Grok 4.7 är sämre än sitt äldre syskon: Grok 4.5 cachar för $0.30 per miljon jämfört med Grok 4.7:s $0.50.

Grok 4.7 finns på OrcaRouter som grok/grok-4.7 till SpaceXAI:s eget listpris med 0 % påslag – leverantörens pris vidarebefordrat, så en prisförändring från leverantören slår igenom här samma dag i stället för efter en omprissättning. Det spelar större roll än vanligt för en modell med en prompttröskel i två nivåer och en cacheavgift, eftersom båda dessa påverkar vad du faktiskt betalar. Det är en nyckel och en OpenAI-kompatibel endpoint för hela Grok-linjen, så att byta en arbetsbelastning från Grok 4.7 till Grok 4.5 eller 4.3 för att testa kostnadsskillnaden är en strängändring i stället för ett andra avtal.

Vad SpaceXAI hävdar om det

Allt i det här avsnittet är rapporterat av leverantören. Inget av det har oberoende reproducerats, och effort-inställningen spelar roll — tabellen i lanseringsinlägget anger Grok 4.7 vid xHigh, Grok 4.6 vid High, och de två jämförelsemodellerna vid Max, vilket inte är en matchad jämförelse.

• CursorBench 4.0 — 46,3 % för Grok 4.7 vid xHigh, mot 40,4 % för Grok 4.6 vid High. Lanseringsinläggets egen formulering är att det är här Grok 4.7 ligger "i framkant när det gäller pris-prestanda".

• Terminal-Bench 4.0 — 37,6 %, mot 20,3 % för Grok 4.6. Det största enskilda deltat i releasen, och det som matchar påståendet om "längre RL på svårare uppgifter".

• DeepSWE v1.1 — 71,0 %, vilket i leverantörens egen tabell är markerat som en poäng för hög ansträngning, mot 65,2 % för Grok 4.6.

• AA Briefcase v1.1 — 1 657, mot 1 546 för Grok 4.6. Notera namnkonflikten här: detta är leverantören som citerar ett benchmark som Artificial Analysis också kör, och det oberoende resultatet diskuteras i nästa avsnitt.

• EEBench – 64,0 %, mot 53,0 % för Grok 4.6.

• Harvey Legal Agent Benchmark — 19,6 %, mot 15,8 % för Grok 4.6.

• HealthBench Professional — 56,7 % jämfört med 48,5 % för Grok 4.6.

• GDPval — 1 695 Elo vid xhigh, mot 1 605 för Grok 4.6 vid high.

Säkerhetspåståendena är också leverantörsrapporterade och ovanligt specifika: SpaceXAI säger att Grok 4.7 byggdes på en ny skyddsstack, att den toppar LatchBios biosäkerhetsbenchmark på 62,4 %, och att den på sin egen HackerBench v0.3 släpper igenom endast 3,3 % av riskfyllda dual-use-promptar samtidigt som den sällan blockerar legitimt säkerhetsarbete. Företaget säger också att det har börjat ge utvalda cybersäkerhetspartners inbjudningsbaserad åtkomst till modellens red-team-förmågor. Betrakta allt detta som leverantörens egen testning av sin egen modell – det är en uppsättning påståenden som är tillräckligt specifik för att kunna kontrolleras senare, vilket inte är samma sak som att vara kontrollerad nu. Den enradiga positioneringen i lanseringsinlägget, "dubbelt så snabb, till halva priset jämfört med jämförbara modeller", är marknadsföring om konkurrenter snarare än en mätning av Grok 4.7, och den oberoende hastighetssiffran nedan stöder inte "dubbelt så snabb"-delen av den.

A single-column scoreboard card for Grok 4.7 titled "Grok 4.7 - the scoreboard" with six rows: Context window 500K tokens; Knowledge cutoff May 2026; Reasoning levels low / medium / high / xhigh; Price per 1M $2.00 in / $6.00 out; AA Intelligence Index 46, #21 of 211; Output speed 82.6 tokens/sec. Footer: "Rows 1-4 vendor-reported; AA Index and speed per Artificial Analysis v4.3.2, xhigh configuration."

Vad en oberoende utvärderare mätte

Artificial Analysis är den enda källan i den här historien som inte har något egenintresse i modellen, och dess Grok 4.7-sida är uttryckligen xhigh-konfigurationen. Läst den 28 september 2026:

• Intelligens — 46 på Artificial Analysis Intelligence Index, indexversion v4.3.2, vilket är 21:a av 211 modeller på den listan och långt över indexets median på 26. Det indexet är en sammansättning av tio utvärderingar: AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience och AA-LCR v1.1.

• Kostnad — $3.74 för att köra Intelligence Index en gång, med samma utvärderare som publicerar cacherabatten på 75 % och en taxa för in- och utdata som matchar leverantörens ($2.00 / $6.00). Dess egen kommentar är att modellen är "rimligt prissatt jämfört med andra modeller i liknande prisklass".

• Verbositet — 240M genererade utdatatokens över Intelligence Index, mot en median på 88M. Artificial Analysis kallar detta "very verbose", och det är den enskilt mest användbara siffran här för den som budgeterar: en modell som tänker i längre kedjor kostar mer per uppgift även vid en fast tokenkostnad.

• Hastighet – 82,6 utdatatoken per sekund, 83:e av 211 på den resultattavlan, vilket utvärderaren ändå betecknar som "långsammare än genomsnittet". Två förbehåll innan du för vidare den här siffran någonstans. Artificial Analysis ändrade sin standardarbetsbelastning för benchmark till en indata på 10 000 token för att bättre spegla produktionsanvändning, och dess publicerade hastighetsvärde för den här modellen har förändrats väsentligt mellan ögonblicksbilder, så behandla det som en ögonblicksbild av en arbetsbelastning snarare än en konstant. På API-leverantörssidan har samma utvärderare bara en leverantör listad för modellen – SpaceXAI själv – så dess uppmätta latens och sammanvägda pris är förstapartssiffror, inte en marknadsspridning.

Vår egen katalog innehåller ytterligare tre Artificial Analysis-resultat för Grok 4.7, utvärderade den 21 september 2026: 43,1 % på Humanity's Last Exam, 76,7 % på utvärderingen av långkontextåterkallelse och 57,4 % på SciCode. De är märkta som oberoende eftersom de kommer från Artificial Analysis, och de är värda att läsas vid sidan av leverantörens självverifieringspåståenden snarare än som en bekräftelse av dem.

Den ärliga jämförelsekommentaren: SpaceXAI:s siffror och siffrorna från Artificial Analysis togs fram med olika testramverk och olika inställningar för ansträngning, och de två har inte körts mot varandra i en matchad konfiguration. När samma benchmarknamn förekommer på båda sidor – AA Briefcase, Terminal-Bench 4.0 – är det ett delat namn, inte en delad körning. Den som citerar en leverantörssiffra bredvid en oberoende siffra som om de vore en enda mätning gör en beräkning som underlaget inte stöder.

Där du faktiskt kan kalla det

Grok 4.7 har kunnat anropas sedan lanseringsdagen via SpaceXAI:s eget API på api.x.ai, med Responses API eller Chat Completions, och via den regionala endpoint som endast finns i USA, med 10 % prispåslag. Den är standardmodell för kodagenten Grok Build och finns i Cursor i alla abonnemang, medan Fast-varianten – samma modell till dubbelt pris – är begränsad till dessa två ytor och saknas i det publika API:et. Utöver förstapartsåtkomst beskriver leverantören den som tillgänglig via tredjepartsverktyg för kodning, modellroutrar och molnplattformar.

Specifikt för vår del: grok/grok-4.7 finns idag i OrcaRouter-katalogen, prissatt enligt xAI:s egna listpriser med 0 % påslag och kan anropas på endera slutpunkten med samma nyckel som resten av Grok-serien. Om du utvärderar den mot Grok 4.6 – samma pris, samma fönster, en annan modell under huven – är det billigaste sättet att ta reda på vilken av dem din arbetsbelastning faktiskt föredrar: att routa båda via en och samma slutpunkt med en automatisk failover-kedja, i stället för att binda en produktionsväg till den nyare modellen enbart utifrån en leverantörstabell.

Screenshot of the OrcaRouter model page for grok/grok-4.7, showing the SpaceXAI provider label, the 500K-token context window and 450K maximum output, capability tags for Vision, Tools, JSON and Reasoning, the $2.00 per million input and $6.00 per million output rates, the Public benchmarks panel dated 2026-09-21 with an AA Intelligence figure of 46.4, and the /v1/chat/completions and /v1/responses endpoints.

Vad man bör hålla ögonen på, med tanke på hur tunt underlaget fortfarande är. SpaceXAI har inte publicerat något parameterantal, och frågan om utdatataket är fortfarande öppen – leverantörens "ingen gräns för textutdata" mot de 450K som vår egen sida visar är en avvikelse som ingen ännu har löst. Det finns ingen direkt jämförelse i matchad testrigg mot de modeller som den säljs i konkurrens med. Och hastighetsvärdet ovan är det tal som mest sannolikt kommer att ändras, eftersom det redan har gjort det. Det är de tre ställena där den här sidan kommer att ändras i takt med att underlaget fylls på, och det är bättre att säga det än att låtsas att specifikationen är fastställd.

Grok 4.7 går att routa via OrcaRouter redan idag, och detsamma gäller Grok 4.6, Grok 4.5, Grok 4.3 och Grok 4.20-familjen. OrcaRouter för vidare leverantörens listpris utan påslag, så SpaceXAI:s tröskelvärde med två nivåer för promptar och deras cache-pris slår igenom hos oss samma dag som de ändras hos dem, och att testa en arbetsbelastning mot de äldre, billigare Grok-modellerna är en strängändring i stället för ett andra avtal.

Jämförda i den här artikeln3

Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen