Grok 4.6 Releasedatum: Uitgebracht op 12 augustus voor dezelfde $2/$6
Guides & Insights

Grok 4.6 Releasedatum: Uitgebracht op 12 augustus voor dezelfde $2/$6

Auteur

Rowan Sterling

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Op woensdag 12 augustus 2026 was de vraag waar deze pagina om draaide geen vraag meer: Grok 4.6 werd uitgebracht. SpaceXAI — het bedrijf dat Grok heeft geëxploiteerd sinds het de startup in februari 2026 overnam en in juli een nieuwe naam aannam — bracht het uit voor dezelfde prijs van $2/$6 als Grok 4.5, op dezelfde V9-basis, met hetzelfde contextvenster van 500K tokens, en Musk noemde het "a banger" op X. De lancering beantwoordde de twee vragen die de vorige versie van deze pagina bijhield: het model bestaat, en het is een post-training refresh op dezelfde schaal in plaats van een opschaling. Het enige wat het niet beantwoordde, is het aantal parameters, dat officieel niet bekendgemaakt blijft.

Een week geleden was de eerlijke kop dat het model niet was uitgebracht: de doelstelling van 'rond 7 augustus' die Musk op 27 juli had gesteld, was verschoven, en dezelfde-schaal-interpretatie was nog steeds een voorspelling. Deze pagina betoogde dat het model het best kon worden gelezen als een vernieuwing op ongewijzigde schaal, en dat vernieuwingen op ongewijzigde schaal doorgaans zonder prijsverhoging uitkomen. Op de lanceringsdag werd de zakelijke helft van die bewering exact bevestigd — $2/$6/$0.50 per miljoen tokens, identiek aan Grok 4.5 — en de eerste onafhankelijke metingen zijn nu binnengekomen. Hieronder staat wat er is uitgebracht, wat de cijfers tot nu toe zeggen, en wat nog door de leverancier is vermeld.

Wat is er op 12 augustus uitgekomen?

Grok 4.6 is live op de SpaceXAI API als model-id grok-4.6, en in Grok Build, Cursor en de Grok Bot-app; Cursor- en Grok Build-gebruikers krijgen de eerste week het dubbele van hun inbegrepen gebruik. Het is een reasoningmodel met uitgebreide chain-of-thought, accepteert tekst- en afbeeldingsinvoer en produceert tekst, en voegt een nieuwe xhigh reasoning-effort-instelling toe boven de standaardinstelling.

De API behoudt OpenAI-compatibele endpoints en voegt aan de serverzijde drie tools toe: web zoeken, X zoeken en code-uitvoering. Voor wie al met Grok 4.5 communiceert via een OpenAI-compatibel endpoint, betekent dit dat de overstap een wijziging van de modelstring is in plaats van een herschrijving van de client.

Wat deze pagina voorspelde — en wat uitkwam

Het argument van de vorige versie was dat Musk's "the 1.5T model with significantly improved SFT & RL" wees op een vernieuwing op dezelfde schaal, en dat de prijs gelijk zou blijven. De lancering bevestigde beide helften van de zakelijke voorspelling:

Prijs: $2 / $6 / $0,50 (cache-hit) per miljoen tokens — identiek aan Grok 4.5. De voorspelling "geen prijswijziging" kwam uit.

Context: 500K tokens, identiek aan Grok 4.5.

Schaal: nog steeds officieel niet bekendgemaakt. Er staat geen parameteraantal in de modelkaart, dus het 1.5T-cijfer van Musk blijft de beste beschikbare claim, geen geverifieerde specificatie. Het 2T-getal dat in vroege berichtgeving circuleerde was een onjuiste toeschrijving van de 2.1T van Grok 4.7.

Het onafhankelijke getal — 61 op de Artificial Analysis Intelligence Index

De eerste meting door een derde partij is binnen, en het is een goede. Artificial Analysis geeft Grok 4.6 een score van 61 op zijn Intelligentie-Index — gelijk aan de max-reasoning-configuratie van GPT-5.6 Sol, één punt achter Claude Fable 5 (62), twee achter Claude Opus 5 (63), en vóór Kimi K3 (60). Dat is een sprong van vijf punten ten opzichte van de 56 van Grok 4.5, wat een grote vooruitgang is voor een post-training-refresh.

Er kleven twee kanttekeningen aan dit getal. De Index is een samengestelde graadmeter en de afzonderlijke dimensies zijn meer gemengd. En Grok 4.6 komt traag op gang: een tijd van 42 seconden tot het eerste token tegenover een mediaan van ~2,9 seconden voor zijn prijsklasse, en ruwweg 68 outputtokens per seconde, langzamer dan het klassegemiddelde. Dat is ruis voor een langlopende agent en de hele ervaring voor interactieve chat.

Op de Pareto-frontier van intelligentie versus kosten is het beeld vleiend: ruwweg $0,84 per taak, waarmee een typische AA-Briefcase-workload in ongeveer 53 beurten en ~0,5B invoertokens wordt voltooid, tegen ~103 beurten en ~2B voor Claude Opus 5 Max. Dat maakt het een legitieme frontierdeal, niet slechts een goedkope.

Wat is nog steeds door de leverancier vermeld?

SpaceXAI's lanceerclaims — "intelligentie vergelijkbaar met GPT-5.6 Sol en Claude Fable 5," verbetering ten opzichte van Grok 4.5 op elke genoemde evaluatie, toegeschreven aan "een langere aanvullende trainingsrun, sterkere engineeringdata en uitgebreide reinforcement learning" — zijn afkomstig van de leverancier en nog niet onafhankelijk geverifieerd. De lanceerbenchmarktabel (CursorBench, FrontierCode, APEX-Agents, Terminal-Bench en de gepromote 1.753 Elo op GDPval-AA v2) is door xAI gerapporteerd; geen van die cijfers is tot dusver gereproduceerd door een lab dat het model niet verkoopt.

De eerste meting van een derde partij is binnen (voorlopig)

Het enige onafhankelijke arena-resultaat tot nu toe is voorlopig maar reëel. LMArena plaatst Grok 4.6 (als grok-4.6-high) op #43 van zijn algemene Text-ranglijst met 1.464 Elo op 2.448 stemmen — gemarkeerd als voorlopig, en vier punten onder het 1.468-debuut van Grok 4.5. De steekproef is te klein voor de door LMArena bijgehouden frontier-tabel, die een aanhoudende score van twee weken nodig heeft.

De Agent leaderboard van live sessies is nog niet gepubliceerd. Wanneer dat gebeurt, zal het de eerste meting zijn die niet van tevoren kan worden geoptimaliseerd.

De prijsberekening

Bij $2/$6 is Grok 4.6 met grote marge de goedkoopste frontier-API van de huidige generatie. Vergeleken met GPT-5.6 Sol voor $5/$30 is de input 60% goedkoper en de output 80% goedkoper — en omdat het verschil bij output groter is, onderschat de marketingframe 'half zo duur' de besparing bij output-intensieve programmeerworkloads.

De kleine lettertjes: aanvragen boven de 200K invoertokens stappen over naar een $4 / $12 / $1-niveau, en een snellere variant kost het dubbele. Bij het wisselen verschuift de rekensom nauwelijks — Grok 4.5 en Grok 4.6 delen dezelfde prijs en context, dus overstappen daartussen is een configuratiewijziging, geen budgetbeslissing.

Omdat OrcaRouter de prijslijstprijzen van providers direct doorgeeft met een opslag van 0%, is de $2/$6 op een grok-4.6-endpoint SpaceXAI's eigen cijfer, geen doorverkooptarief — een prijsverlaging van de leverancier zou hier dezelfde dag aankomen, en failover naar een tweede provider is een routeringsregel in plaats van een inkoopexercitie.

Grok 4.7 en Grok 5 liggen nog steeds voor.

Grok 4.7 is de volgende stap, en de beschrijving van Musk is ongewijzigd: "het 2.1T-model," beter dan Grok 4.6 "in elk opzicht, behalve iets langzamer om te serveren." Op 5 augustus schatte hij het op drie tot vier weken, wat uitkomt op eind augustus of begin september. Die tijdlijn komt van Musk, en hij is bij elke mededeling verder opgeschoven, dus behandel het als richtinggevend.

Grok 5 staat gepland voor het einde van het jaar, getraind — volgens de earnings call van 4 augustus — op "in feite alle data die SpaceX ooit heeft gegenereerd."

Wat moet u hierna controleren?

Vier dingen zullen het beeld verduidelijken, en elk daarvan wordt momenteel als open aangemerkt.

• De LMArena Agent-ranglijst, niet gepubliceerd per 13 augustus.

• Een reproductie door een derde partij van de codeer- en agentische cijfers — DeepSWE, CursorBench, APEX-Agents — van iemand die het model niet verkoopt.

• De werkelijke prijs en latentie van de snellere variant zodra deze op grote schaal beschikbaar is.

• Of de tijdlijn van eind augustus voor Grok 4.7 standhoudt, aangezien elke specifieke datum tot nu toe een paar dagen later is verschoven.

En degene die er daadwerkelijk toe doet voor een beslissing: je eigen werklast. Een ranglijstpositie is een hypothese over je taak, geen resultaat ervoor.

Veelgestelde vragen

Wanneer werd Grok 4.6 daadwerkelijk gelanceerd? Op 12 augustus 2026, op de SpaceXAI API en in Grok Build, Cursor en de Grok Bot-app. Musk's doelwit van 27 juli, "rond 7 augustus", liep vijf dagen uit; de formulering "volgende week" tijdens de earnings call van 4 augustus bleek het nauwkeurige tijdsvenster te zijn.

Wat kost Grok 4.6? $2 / $6 / $0.50 per miljoen tokens — identiek aan Grok 4.5 en ver onder de $5/$30 van GPT-5.6 Sol. Boven de 200K invoertokens loopt het op tot $4 / $12 / $1, en een snellere variant kost het dubbele.

Is Grok 4.6 een 2T-model? Er is geen aantal parameters gepubliceerd. Het 1,5T-cijfer van Musk blijft de beste beschikbare (ongeverifieerde) claim; het 2T-getal dat circuleerde, was de 2,1T van Grok 4.7, ten onrechte toegeschreven aan 4.6.

Is Grok 4.6 net zo goed als GPT-5.6 Sol? Op de Artificial Analysis Intelligence Index staan de twee gelijk op 61 (configuratie met maximale redenering). De leverancier beweert dat het vergelijkbaar is met GPT-5.6 Sol en Claude Fable 5. Het is beduidend langzamer qua time-to-first-token en veel goedkoper; de agentische winsten wachten op onafhankelijke verificatie.

Wat dit voor jou betekent

De praktische aanpak is ongewijzigd ten opzichte van de pre-lanceerversie van deze pagina. Als je code al met Grok 4.5 communiceert via een OpenAI-compatibel endpoint, is Grok 4.6 een configuratiewijziging tegen dezelfde prijs — wijzig de modelstring, behoud de budgetlijn, en voer je evals opnieuw uit omdat de build nieuw is. Als dat niet het geval is, maakt een endpoint met doorberekeningsprijzen een nieuw frontiermodel schakelbaar zonder een productiepad te riskeren op de benchmarks van de eerste week, wat precies is wat die voorlopige arena-cijfers zijn.

Vergeleken in dit artikel2

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt