
Wat is Grok 4.5? Het V9-vlaggenschip dat tokeneconomie verkocht in plaats van topscores
- OrcaNIEUWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 mln tokens
- orcaNIEUWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 mln tokens
- deepseekNIEUWDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligentie
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligentie77Coderen
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligentie76Coderen
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligentie76Coderen
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligentie82Coderen
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1534Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1244Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0540Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligentie76Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Grok 4.5 is een redeneermodel met 1,5 biljoen parameters op basis van mixture-of-experts van de leverancier — het bedrijf dat nu levert en op de markt brengt onder het merk SpaceXAI — dat op 8 juli 2026 is uitgebracht. Het accepteert tekst en afbeeldingen als invoer, retourneert tekst, heeft een contextvenster van 500.000 tokens en is geprijsd op $2,00 per miljoen invoertokens en $6,00 per miljoen uitvoertokens. Het was het model dat "tokens per afgeronde taak" vooraan op een lanceringdia zette, en het is het model waarop het lab sindsdien twee nieuwere vlaggenschipmodellen heeft gebouwd.
Die laatste clausule is de hele reden dat deze pagina geschreven moet worden. Zoek je op "Grok 4.5", dan krijg je lanceringsberichtgeving uit juli: het Cursor-partnerschap, het citaat "Opus-class", de bewering van 80 tokens per seconde. Wat je niet krijgt, is een rechtstreeks antwoord op de vraag die een ontwikkelaar eind september daadwerkelijk heeft: of Grok 4.5 nog de moeite waard is om ergens in te integreren nu Grok 4.6 en Grok 4.7 bestaan tegen dezelfde lijstprijs. Deze pagina is dus een referentie-item, geen nieuwsbericht: wat het model is, waar het staat, wat het meetbaar goed doet, wat het meetbaar slecht doet, en wie iets anders zou moeten kiezen. Niets hier wordt als een lancering gepresenteerd, want dat is het niet.
Over de bronvermelding, omdat die op een pagina als deze meer dan gewoonlijk van belang is: elk cijfer hieronder is gelabeld met de herkomst. Cijfers die xAI over zijn eigen model heeft gepubliceerd, zijn gemarkeerd als door de leverancier gerapporteerd. Cijfers van Artificial Analysis zijn onafhankelijke metingen, rechtstreeks gelezen van de modelpagina op 23 september 2026. Waar een cijfer niet kon worden bevestigd via een primaire bron, vermeldt de pagina dat in plaats van te schatten.
Waar Grok 4.5 zich in zijn eigen familie bevindt — en het is niet de top
De meest voorkomende fout in de berichtgeving over Grok 4.5 is dat het als het vlaggenschip wordt behandeld. Dat was het, ongeveer vijf weken lang. Sindsdien heeft xAI Grok 4.6 uitgebracht op 12 augustus 2026 en Grok 4.7 begin september, die beide nog steeds geprijsd zijn op $2,00 en $6,00 per miljoen tokens. Grok 4.5 zit nu in het midden van de stapel: capabeler dan de goedkope tier, twee generaties achter op de voorhoede, en — dit is het deel dat ertoe doet — het enige model in de huidige Grok-lijn waarvan het tarief voor gecachte input goedkoper is dan dat van zijn opvolgers. Grok 4.5 cachet tegen $0,30 per miljoen tokens; Grok 4.6 en Grok 4.7 cachen beide tegen $0,50, volgens xAI's eigen prijstabel.
Hier is het aanbod zoals de prijsdocumentatie van de leverancier het momenteel vermeldt, alle cijfers per miljoen tokens en allemaal door de leverancier gepubliceerd:
• Grok 4.20 (drie varianten: multi-agent, redenerend, niet-redenerend) — 1M context, $1,25 input / $2,50 output, $0,20 gecachet, uitgebracht op 31 maart 2026
• Grok 4.3 — 1M context, $1,25 invoer / $2,50 uitvoer, $0,20 in de cache, plus een batchkorting; de goedkoopste manier om een miljoen tokens aan Grok-context te krijgen
• Grok 4.5 — 500K context, $2,00 invoer / $6,00 uitvoer, $0,30 gecacht, uitgebracht op 8 juli 2026
• Grok 4.6 — 500K context, $2,00 invoer / $6,00 uitvoer, $0,50 gecached, uitgebracht op 12 augustus 2026
• Grok 4.7 — 500K context, $2,00 invoer / $6,00 uitvoer, $0,50 gecachet, uitgebracht begin september 2026
• Grok Build 0.1 — 256K context, $1,00 input / $2,00 output, een specialist in programmeren in plaats van een algemeen model
Twee dingen volgen uit die lijst. Ten eerste: Grok 4.5 kreeg geen prijsverlaging toen het ophield het flagship te zijn — het behield de flagshipprijs, wat betekent dat Grok 4.6 nu strikt genomen een betere prijs-kwaliteitverhouding biedt voor hetzelfde geld, tenzij je specifiek het goedkopere cachetarief wilt of vastzit aan de 4.5-snapshot. Ten tweede: Grok 4.5 heeft de helft van de context van Grok 4.3 en de 4.20-familie, tegen het dubbele van de inputprijs. De V9-basis is de reden: 1,5 biljoen parameters, ongeveer drie keer zo groot als Grok 4.3, en een groter basismodel is wat de capaciteit opleverde ten koste van het venster.
Als wat je echt nodig hebt lange context met een beperkt budget is, dan is Grok 4.3 het eerlijke antwoord binnen deze familie, en Grok 4.5 niet. Die afweging — capaciteit tegenover venster — is de bepalende keuze in de Grok-lijn, en het is de moeite waard om die ronduit te benoemen in plaats van te doen alsof het nieuwere nummer overal beter in is.
Het specificatieblad

Dit zijn de specificaties die xAI op zijn eigen modelpagina publiceert, niet schattingen van derden:
• Modelidentificatie — grok-4.5, met de aliassen grok-4.5-latest en grok-build-latest
• Modaliteit — tekst en afbeelding in, tekst uit. Afbeeldingen worden als invoer geaccepteerd; het model genereert ze niet
• Contextvenster — 500.000 tokens, gedeeld tussen prompt en antwoord in plaats van 500K invoer plus een afzonderlijke uitvoertoewijzing
• Licentie — propriëtair. Er zijn geen open gewichten en geen downloadbaar checkpoint; je krijgt toegang tot Grok 4.5 via een API of via de eigen producten van de leverancier.
• Lijstprijs — $2,00 per miljoen invoertokens, $6,00 per miljoen uitvoertokens, $0,30 voor gecachte invoer
• Prijsstelling voor lange context — bij 200.000 prompttokens en hoger stijgt het tarief naar $4,00 input / $12,00 output / $0,60 gecached, en het hogere tarief geldt voor elke token in het verzoek, niet alleen de tokens voorbij de drempel. Dit is het duurste detail op de pagina om te missen
• Redeneerbeheer — vier niveaus, laag, gemiddeld, hoog en xhigh, standaard ingesteld op hoog. Redeneren kan niet volledig worden uitgeschakeld, en redeneertokens worden gefactureerd als uitvoertokens
• Ondersteuning voor tools en indelingen — functieaanroepen en gestructureerde uitvoer worden native ondersteund. Zoektools aan de serverzijde worden bovenop het tokenverbruik gefactureerd; we konden de actuele tarieven per aanroep op de modelpagina van de leverancier niet bevestigen, alleen dat ze bestaan
• Snelheidslimieten — 150 verzoeken per seconde en 50 miljoen tokens per minuut
• Batch API wordt niet ondersteund op Grok 4.5, in tegenstelling tot Grok 4.3
• Serverregio's — us-east-1 en us-west-2 bij de lancering. Europese beschikbaarheid was op dag één expliciet niet beschikbaar en werd door de leverancier omschreven als verwacht medio juli 2026; we hebben geen latere primaire bron gevonden die de exacte datum bevestigt waarop deze werd geopend, dus beschouw de EU-tijdlijn hier als onbevestigd
Eén discrepantie die het waard is om vast te leggen in plaats van weg te poetsen: de eigen catalogusvermelding van OrcaRouter voor grok/grok-4.5 toont een tarief voor cache-lezen van $0,50 per miljoen, wat overeenkomt met wat xAI voor Grok 4.6 en Grok 4.7 in rekening brengt, in plaats van de $0,30 die de prijstabel van de leverancier voor Grok 4.5 toont. De documentatie van de leverancier is de autoriteit wat de prijs betreft; onze pagina lijkt het cachetarief van de opvolger te bevatten, en het is gesignaleerd in plaats van hier stilzwijgend herhaald.
Waar Grok 4.5 meetbaar goed in is
De belangrijkste claim bij de lancering was token-economie, en het is de enige claim op de lanceringspagina die een mechanisme achter zich heeft in plaats van alleen een score. Op SWE-bench Pro rapporteert xAI dat Grok 4.5 gemiddeld 15.954 outputtokens per opgeloste taak gebruikt tegenover 67.020 voor Claude Opus 4.8 op maximale inspanning — ongeveer 4,2 keer minder tokens om hetzelfde werk te voltooien. Minder outputtokens per opgeloste taak is het verschil tussen een model dat goedkoper is en een model dat goedkoper en sneller is in termen van wandkloktijd, want outputtokens zijn waar je op wacht. Door de leverancier gerapporteerd, op de eigen testomgeving van de leverancier, en door niemand onafhankelijk gereproduceerd — maar het is een structurele claim, geen selectief gekozen percentage.
De benchmarktabel van de leverancier, die samen met het model is gepubliceerd en daarom volledig door de leverancier gerapporteerd is, ziet er ten opzichte van dezelfde modellen als volgt uit:
• DeepSWE 1.0 — Grok 4.5 62,0%, achter Claude Fable 5 met 66,1% en GPT-5.5 met 64,31%, voor Claude Opus 4.8 met 55,75%
• SWE Marathon, oplossingspercentage — Grok 4.5 29,0%, voor Claude Opus 4.8 met 26,0% en Claude Fable 5 met 24,0%. Dit is de enige codingbenchmark waarin Grok 4.5 het veld aanvoerde
• Terminal-Bench 2.1 — Grok 4.5 83,3%, vrijwel gelijk aan Claude Fable 5 met 84,3% en GPT-5.5 met 83,4%, beter dan Claude Opus 4.8 met 78,9%
• DeepSWE 1.1 — Grok 4.5 53%, achter Claude Fable 5 op 70% en GPT-5.5 op 67%
• SWE-bench Pro — Grok 4.5 64,7%, achter Claude Fable 5 met 80,4% en Claude Opus 4.8 met 69,2%
De eerlijke lezing is dat Grok 4.5 wint op het oplossen van taken met een lange horizon en op de economie van het afronden van een taak, en verliest op de moeilijkere single-shot-codebenchmarks. Het is een goed model voor agent-loops en een middelmatig model voor eenmalige moeilijke problemen — en dat onderscheid is precies wat het token-efficiëntiegetal voorspelt dat het zou moeten zijn.

Het onafhankelijke beeld is magerder, en dat is waar deze pagina voorzichtig moet zijn. Artificial Analysis vermeldt Grok 4.5 (high) momenteel met een Intelligence Index-score van 39, gerangschikt als #52 van de 212 modellen, op indexversie v4.3.2 — boven de mediaan van 25 voor vergelijkbare modellen, maar niet aan de top. Als u een score van 54 of 56 voor dit model in de berichtgeving van juli hebt gezien, vergelijk die dan niet met 39: Artificial Analysis heeft de index sinds de lancering herzien en de twee cijfers komen uit verschillende herzieningen. Dit is precies het soort vergelijking van verouderde cijfers dat benchmarktabellen onbetrouwbaar maakt, en daarom vermeldt deze pagina de indexversie naast de score.
Waar Grok 4.5 meetbaar slecht in is
Artificial Analysis meldt een outputsnelheid van 55,1 tokens per seconde, gerangschikt op #126 van 212 modellen en onder de mediaan van 74 — ver verwijderd van de 80 tokens per seconde die xAI bij de lancering noemde, en nog verder van de ~340 tokens per seconde die de snelste huidige modellen halen. Het meldt ook een tijd tot het eerste token van 10,94 seconden tegenover een mediaan van 3,86 seconden. Die twee getallen samen beschrijven de werkelijke prijs van een reasoning-model dat standaard op high staat en niet kan worden uitgeschakeld: je wacht, en dan praat het langzaam. Laat het reasoning-niveau op de standaardwaarde staan en Grok 4.5 zal aanvoelen als het langzaamste model dat je op je key hebt.
Nog drie afgewogen minpunten, in volgorde van de mate waarin ze een beslissing zouden moeten beïnvloeden:
• Artificial Analysis heeft Grok 4.5 als verouderd gemarkeerd en zegt dat het alleen de standaardworkload met 10.000 tokens invoer voor dit model blijft benchmarken. Dat is een derde partij die je vertelt dat ze het model dat je overweegt niet meer volledig meet, en die in plaats daarvan Grok 4.6 aanbeveelt. Verouderd op een leaderboard betekent niet onbeschikbaar via een API — het betekent dat de onafhankelijke bewijsbasis bevroren is.
• Het verliest de twee benchmarks die het meest lijken op harde, single-shot codeertaken: DeepSWE 1.1 en SWE-bench Pro, zowel aan Claude Fable 5 als aan GPT-5.5, volgens xAI's eigen tabel
• Het heeft de helft van de context van Grok 4.3 tegen het dubbele van de inputprijs, en helemaal geen batch-API. Als je workload het verwerken van lange documenten of offline batch-inference is, is Grok 4.5 het verkeerde model binnen zijn eigen familie
Over hallucinatie en calibratie kon deze pagina geen actueel onafhankelijk cijfer bevestigen. In de berichtgeving van juli circuleerde een hallucinatiepercentage van ongeveer 54%, maar we konden dat aantal niet verifiëren op de Artificial Analysis-modelpagina die we hebben gelezen, en het staat ook niet op de pagina van de leverancier. In plaats van een cijfer te herhalen waarvoor we geen bron kunnen vinden, registreren we het hier als niet gemeten.
Wie zou Grok 4.5 moeten kiezen, en wie zou iets anders moeten kiezen?
Kies Grok 4.5 als je agentische loops draait waarbij de kosten per voltooide taak meer uitmaken dan de kosten per token, en je al hebt gemeten dat het V9 token-economiegedrag standhoudt bij jouw werklast. Het is ook de juiste keuze als je een Grok-familie-snapshot nodig hebt met een tarief van $0,30 voor gecachte invoer op een grote, stabiele prefix die herhaaldelijk wordt geraakt — dat cachetarief is echt goedkoper dan wat Grok 4.6 en Grok 4.7 rekenen, en bij een cache-intensieve werklast kan dat verschil zwaarder wegen dan twee generaties aan capaciteiten.
Kies in plaats daarvan Grok 4.6 of Grok 4.7 voor bijna al het andere. Dezelfde catalogusprijs, hetzelfde 500K-venster, nieuwere training, betere onafhankelijke scores en de eigen aanbeveling van Artificial Analysis. Er is geen versie van "Ik wil de beste Grok" waarin het antwoord vandaag 4.5 is.
Kies Grok 4.3 als context de beperkende factor is: 1M tokens voor $1,25 en $2,50, met een batchkorting die Grok 4.5 niet biedt. RAG voor lange documenten en analyse van volledige repositories blijven zijn terrein.
Kies iets buiten de familie als je optimaliseert voor de hoogste score in plaats van prijs per taak — Claude Fable 5 voert elke codingbenchmark aan in xAI's eigen vergelijkingstabel, en GPT-5.5 staat voor op Grok 4.5 bij DeepSWE 1.0 en 1.1. Als je open weights wilt en een kleiner model kunt accepteren, is dat een heel andere aankoop, en geen enkel Grok-model concurreert daarvoor.
Grok 4.5 aanroepen zonder een tweede contract
Grok 4.5 is live op OrcaRouter tegen xAI's lijstprijs, waarbij het tarief van de aanbieder zonder opslag wordt doorgegeven — dus de $2,00 en $6,00 hierboven zijn wat je betaalt, en een prijswijziging van de leverancier komt bij ons op dezelfde dag aan als bij hen. Dat is voor dit specifieke model meer dan gewoonlijk van belang, want de keuze waar de meeste lezers voor staan is niet "Grok 4.5 of niets" maar "Grok 4.5 of Grok 4.6 of Grok 4.3", en drie modellen uit één familie vergelijken is precies wat één endpoint over meer dan 200 modellen goedkoop maakt. Eén sleutel, geen tweede contract, en een A/B-test die een stringwijziging is in plaats van een integratie.
Het failover-argument is hier ongewoon concreet. Grok 4.5 is nog steeds routeerbaar, maar wordt niet langer volledig gebenchmarkt door de onafhankelijke trackers en is niet langer het vlaggenschip van de leverancier — een model dat je misschien in een fallbackketen wilt hebben in plaats van als je enige pad. Automatische failover tussen providers is het mechanisme waarmee je het kunt behouden voor waar het goed in is, zonder een productieroute te verwedden op een snapshot waar het ecosysteem voorbij begint te gaan.
Wat deze pagina niet zal doen, is doen alsof de keuze voor de hand ligt. Grok 4.5 is een goed model met een specifieke sterkte, in een familie waarin hetzelfde geld nu een nieuwer model koopt. Als je vandaag helemaal opnieuw begint, is de eerlijke aanbeveling Grok 4.6. Als je Grok 4.5 al in een agent-loop draait en hij taken afrondt bij de tokenaantallen die je had begroot, is de eerlijke aanbeveling om niets te veranderen en over een kwartaal opnieuw te meten.

Grok 4.5 is vandaag routeerbaar op OrcaRouter, en dat geldt ook voor Grok 4.6, Grok 4.7 en Grok 4.3. OrcaRouter geeft de lijstprijs van de provider door zonder opslag, dus een prijswijziging van een leverancier komt bij ons binnen op dezelfde dag dat die bij hen binnenkomt, en het verplaatsen van een workload tussen twee Grok-modellen is een kwestie van een string wijzigen in plaats van een tweede contract.
Vergeleken in dit artikel4
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
