
Grok 4.6 Releasedatum: Den släpptes den 12 augusti för samma $2/$6
- deepseekNYDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligens
- openaiNYOpenAI: GPT-6 Astra2026-09-0453Intelligens77Kodning
- googleNYGoogle: Gemini 3.8 Flash2026-09-0241Intelligens76Kodning
- qwenNYQwen: Qwen3.8 Max (0902)2026-09-0240Intelligens72Kodning
- anthropicNYAnthropic: Claude Fable 5.12026-09-0153Intelligens82Kodning
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligens72Kodning
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1M tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligens75Kodning
- obsidianQwen3.8 27B2026-08-1534Intelligens68Kodning
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligens69Kodning
- grokSpaceXAI: Grok 4.62026-08-1244Intelligens77Kodning
- metaMeta: Muse Spark 1.22026-08-0540Intelligens72Kodning
- qwenQwen: Qwen3.8 Max2026-08-0340Intelligens72Kodning
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Intelligens69Kodning
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Intelligens78Kodning
- googleGoogle: Gemini 3.6 Flash2026-07-2134Intelligens69Kodning
Onsdagen den 12 augusti 2026 var frågan som den här sidan byggdes kring inte längre en fråga: Grok 4.6 lanserades. SpaceXAI — företaget som har drivit Grok sedan det förvärvade startupen i februari 2026 och bytte namn i juli — släppte den till samma pris på $2/$6 som Grok 4.5, på samma V9-grund, med samma kontextfönster på 500K tokens, och Musk kallade den "en succé" på X. Lanseringen avgjorde de två frågorna som den tidigare versionen av den här sidan bevakade: modellen finns, och den är en post-training-uppdatering i samma skala snarare än en uppskalning. Det enda den inte avgjorde är parameterantalet, som fortfarande är officiellt hemlighållet.
För en vecka sedan var den ärliga rubriken att modellen inte hade levererats: målet "runt den 7 augusti" som Musk satte den 27 juli hade halkat efter, och avläsningen på samma skala var fortfarande en förutsägelse. Denna sida argumenterade för att modellen bäst skulle läsas som en uppdatering på oförändrad skala, och att uppdateringar på oförändrad skala vanligtvis levereras utan prishöjning. Lanseringen bekräftade exakt den affärsmässiga halvan av det beskedet – $2/$6/$0,50 per miljon tokens, identiskt med Grok 4.5 – och de första oberoende mätningarna har nu kommit in. Nedan följer vad som levererades, vad siffrorna hittills säger och vad som fortfarande är leverantörsuppgifter.
Vad som släpptes den 12 augusti
Grok 4.6 är live på SpaceXAI API:t som modell-id grok-4.6, och i Grok Build, Cursor och Grok Bot-appen; användare av Cursor och Grok Build får dubbelt så mycket inkluderad användning under den första veckan. Det är en resonemangsmodell med utökad tankekedja, tar emot text- och bildinmatning och producerar text, och lägger till en ny xhigh reasoning-effort-inställning ovanför standardinställningen.
API:t behåller OpenAI-kompatibla slutpunkter och lägger till tre verktyg på serversidan: webbsökning, X-sökning och kodkörning. För den som redan pratar med Grok 4.5 via en OpenAI-kompatibel slutpunkt innebär det att bytet är en ändring av modellsträngen snarare än en omskrivning av klienten.
Vad den här sidan förutspådde — och vad som landade.
Den tidigare versionens argument var att Musks "1.5T-modellen med avsevärt förbättrad SFT & RL" pekade på en uppdatering i samma skala, och att priset skulle hålla i sig. Lanseringen bekräftade båda delarna av affärsbedömningen:
• Pris: $2 / $6 / $0,50 (cache-hit) per miljon tokens — identiskt med Grok 4.5. Förutsägelsen om "ingen prisändring" höll.
• Kontext: 500K tokens, identiska med Grok 4.5.
• Skala: fortfarande inte officiellt offentliggjord. Inget parameterantal anges i modellkortet, så förblir Musks 1.5T-siffra det bästa tillgängliga påståendet, inte en verifierad specifikation. 2T-siffran som cirkulerade i tidig rapportering var en felaktig tillskrivning av Grok 4.7:s 2.1T.

Det oberoende numret — 61 på Artificial Analysis Intelligence Index
Det första oberoende mätresultatet är här, och det är ett bra sådant. Artificial Analysis ger Grok 4.6 betyget 61 på sitt Intelligence Index — i nivå med GPT-5.6 Sols max-resonemangskonfiguration, en poäng bakom Claude Fable 5 (62), två bakom Claude Opus 5 (63) och före Kimi K3 (60). Det är ett hopp på fem poäng jämfört med Grok 4.5:s 56, vilket är en stor förbättring för en uppdatering efter träning.
Två förbehåll följer med siffran. Indexet är ett sammansatt mått, och de enskilda dimensionerna är mer blandade. Och Grok 4.6 är långsam att starta: 42 sekunder till första token jämfört med en median på ~2,9 sekunder för sin priskategori, och ungefär 68 utdatatokens per sekund, långsammare än genomsnittet i klassen. Det är brus för en långkörande agent och hela upplevelsen för interaktiv chatt.
På Pareto-fronten för intelligens kontra kostnad är bilden smickrande: ungefär 0,84 USD per uppgift, som slutför en typisk AA-Briefcase-arbetsbelastning på cirka 53 omgångar och ~0,5B inmatningstoken mot ~103 omgångar och ~2B för Claude Opus 5 Max. Det gör den till ett legitimt frontlinjefynd, inte bara ett billigt sådant.
Vad som fortfarande anges av leverantören
SpaceXAI:s lanseringspåståenden — "intelligens jämförbar med GPT-5.6 Sol och Claude Fable 5," förbättring jämfört med Grok 4.5 på varje listad utvärdering, tillskriven "en längre kompletterande träningskörning, starkare ingenjörsdata och utökad förstärkningsinlärning" — är leverantörsangivna och ännu inte oberoende verifierade. Lanseringsriktmärkestabellen (CursorBench, FrontierCode, APEX-Agents, Terminal-Bench och den marknadsförda 1 753 Elo på GDPval-AA v2) är xAI-rapporterad; ingen av dessa siffror har ännu reproducerats av ett labb som inte säljer modellen.
Den första tredjepartsavläsningen är inne (preliminär)
Det enda oberoende arenarezultatet hittills är preliminärt men verkligt. LMArena listar Grok 4.6 (som grok-4.6-high) på #43 på sin övergripande Text-ledartavla med 1 464 Elo på 2 448 röster — flaggat som preliminärt, och fyra poäng under Grok 4.5:s debut på 1 468. Urvalet är för litet för LMArenas spårade frontier-tabell, som kräver en ihållande poäng under två veckor.
Agent-topplistan för live-sessioner har ännu inte publicerats. När den väl publiceras blir det den första avläsningen som inte kan optimeras emot i förväg.

Prisberäkningen
Vid $2/$6 är Grok 4.6 den billigaste frontier-API:n i den nuvarande generationen med bred marginal. Jämfört med GPT-5.6 Sol på $5/$30 är input 60 % billigare och output 80 % billigare – och eftersom skillnaden är större på output underskattar "halva priset"-marknadsföringen besparingen för output-tunga kodningsarbetsbelastningar.
Det finstilta: förfrågningar över 200K inmatningstokens kliver upp till en $4 / $12 / $1-nivå, och en snabbare variant kostar dubbelt. För byte rör sig aritmetiken knappt — Grok 4.5 och Grok 4.6 delar pris och kontext, så att byta mellan dem är en konfigurationsändring, inte ett budgetbeslut.
Eftersom OrcaRouter skickar leverantörernas listpriser vidare direkt med 0 % påslag, är $2/$6 på en grok-4.6-endpoint SpaceXAI:s eget pris, inte ett återförsäljningspris — en prissänkning från leverantören skulle landa här samma dag, och failover till en andra leverantör är en routingregel snarare än en upphandlingsåtgärd.
Grok 4.7 och Grok 5 ligger fortfarande före.
Grok 4.7 är nästa steg, och Musks beskrivning är oförändrad: "2.1T-modellen", bättre än Grok 4.6 "på alla sätt, förutom något långsammare att servera." Den 5 augusti sa han att den var tre till fyra veckor bort, vilket landar i slutet av augusti eller början av september. Den tidslinjen är Musks egen, och den har skjutits framåt vid varje uttalande, så betrakta den som vägledande.
Grok 5 ligger vid årsskiftet, tränad — enligt resultatkonferensen den 4 augusti — på "i princip all data som SpaceX någonsin har genererat."
Vad du ska kontrollera härnäst
Fyra saker kommer att klargöra bilden, och var och en framstår för närvarande som öppen:
• LMArena Agent-topplistan, opublicerad per den 13 augusti.
• En tredjepartsreproduktion av kodnings- och agentiska siffrorna — DeepSWE, CursorBench, APEX-Agents från någon som inte säljer modellen.
• Den snabbare variantens verkliga pris och latens när den är allmänt tillgänglig.
• Huruvida Grok 4.7:s tidslinje i slutet av augusti håller, med tanke på att varje specifikt datum hittills har förskjutits några dagar senare.
Och den som faktiskt spelar roll för ett beslut: din egen arbetsbelastning. En leaderboardposition är en hypotes om din uppgift, inte ett resultat för den.
Vanliga frågor
När lanserades Grok 4.6 egentligen? Den 12 augusti 2026, på SpaceXAI API och i Grok Build, Cursor och Grok Bot-appen. Musks mål från den 27 juli om "runt den 7 augusti" försenades med fem dagar; formuleringen "nästa vecka" från resultatsamtalet den 4 augusti var det korrekta tidsfönstret.
Vad kostar Grok 4.6? $2 / $6 / $0,50 per miljon tokens — identiskt med Grok 4.5 och långt under GPT-5.6 Sols $5/$30. Över 200 000 inmatningstokens stiger det till $4 / $12 / $1, och en snabbare variant kostar dubbelt så mycket.
Är Grok 4.6 en 2T-modell? Ingen parameterantal har publicerats. Musks 1,5T-siffra är fortfarande det bästa tillgängliga (overifierade) påståendet; 2T-siffran som cirkulerade var Grok 4.7:s 2,1T som felaktigt tillskrevs 4.6.
Är Grok 4.6 lika bra som GPT-5.6 Sol? På Artificial Analysis Intelligence Index är de två lika med 61 (max-resonemangskonfiguration). Leverantören hävdar att den är jämförbar med GPT-5.6 Sol och Claude Fable 5. Den är markant långsammare vad gäller tid till första token och mycket billigare; de agentiska vinsterna väntar på oberoende verifiering.
Var detta lämnar dig
Det praktiska tillvägagångssättet är oförändrat från förhandsversionen av denna sida. Om din kod redan pratar med Grok 4.5 via en OpenAI-kompatibel slutpunkt, är Grok 4.6 en konfigurationsändring till samma pris — byt modellsträngen, behåll budgetraden och kör om dina utvärderingar eftersom bygget är nytt. Om det inte gör det, gör en enda slutpunkt med pass-through-prissättning det möjligt att växla till en ny frontlinjemodell utan att satsa en produktionsväg på dess första veckas riktmärken, vilket är precis vad de preliminära arenasiffrorna är.

Jämförda i den här artikeln2
Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen
