Gegenereerde hero-kaart met de titel Claude Sonnet 5.5 vs Grok 4.5, ondertitel twee inputtarieven van $2 en een wachttijd van zes minuten, met drie statistiekkaarten: eerste token 370,8s vs 6,9s, kosten per taak $7,60 vs $1,04, en Intelligence Index 56 vs 39, met een voettekst met Index, kosten per taak en latentie volgens Artificial Analysis v4.3.2; prijzen volgens de leveranciers.
Guides & Insights

Claude Sonnet 5.5 vs Grok 4.5: twee inputtarieven van $2 en een wachttijd van zes minuten

Auteur

Elias Hawthorne

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Claude Sonnet 5.5 en Grok 4.5 rekenen dezelfde prijs voor input: $2,00 per miljoen tokens. Daar houdt de overeenkomst op, en één getal maakt het punt beter duidelijk dan welke specificatietabel dan ook. In revisie v4.3.2 van de Intelligence Index van Artificial Analysis is de mediane tijd tot het eerste antwoordtoken voor Claude Sonnet 5.5 op de instelling Max Effort 370,8 seconden. Voor Grok 4.5 is dat 6,9 seconden. Hetzelfde tarief voor input. Drieënvijftig keer zo lang wachten voordat er überhaupt iets terugkomt. Claude Sonnet 5.5, uitgebracht op 28 september 2026, en Grok 4.5, uitgebracht op 8 juli 2026 en sindsdien tweemaal ingehaald binnen zijn eigen familie, zijn op papier de twee goedkoopste manieren om in de voorste helft van de frontier te komen — en het papier verbergt de beslissing die er echt toe doet, namelijk wat je met het wachten koopt.

Dat cijfer moet onmiddellijk van een voorbehoud worden voorzien, want een latentiegetal zonder configuratie is betekenisloos: 370,8 seconden is de standaard redeneermodus van Anthropic op maximale inspanning, waarbij een zeer groot denkbudget wordt besteed voordat er een antwoordtoken wordt geproduceerd. Een aanroeper die een snel eerste token wil, stelt iets anders in. Maar de richting is reëel en het is geen artefact — Artificial Analysis meet de outputsnelheid van Claude Sonnet 5.5 op 138,7 tokens per seconde — alleen een handvol modellen is sneller — en die van Grok 4.5 op 59,2. Het model dat het langst wacht, schrijft ook het snelst. Waar je tussen kiest, is een lang denkproces gevolgd door een snel antwoord, en een kort denkproces gevolgd door een langzamer antwoord.

Wat is er op 28 september veranderd?

Claude Sonnet 5.5 is één dag oud. Anthropic heeft het op 28 september 2026 uitgebracht onder de API-identifier claude-sonnet-5-5, samen met Bedrock, Google Cloud en Microsoft Foundry, en beschrijft het als 30% sneller dan Claude Sonnet 5 en tot 30% goedkoper per taak voor de meeste werkzaamheden. Dat zijn cijfers van de leverancier en ze zijn niet onafhankelijk gereproduceerd; de prijs die het als referentie aanhaalt, is reëel, omdat het tarievenblad ongewijzigd bleef op $2,00 per miljoen inputtokens, $10,00 per miljoen outputtokens, $0,20 voor cachelezingen en $2,50 voor cacheschrijfacties. Het contextvenster is 1.000.000 tokens met een synchroon uitvoerplafond van 128.000 tokens, en 300.000 tokens op de Message Batches API achter de output-300k-2026-03-24 header. De kennisafsluitdatum is juni 2026. Zero data retention is beschikbaar vanaf de lancering, en Anthropic zal het model niet uitfaseren vóór 28 september 2027.

Artificial Analysis model page for Claude Sonnet 5.5 in its Adaptive Reasoning, Max Effort, Default Fallback configuration, released September 2026, showing an Intelligence Index of 56, an output speed of 138.7 tokens per second, $2.00 per million input tokens and $10.00 per million output tokens, $7.60 per Intelligence Index task, 410M output tokens generated during the Index evaluation, and a 1M-token context window.

Ook de eigen documentatiepagina van Anthropic is ongewoon expliciet over de kosten van de upgrade: vijf breaking changes scheiden Claude Sonnet 5.5 van het model waarop het meeste Claude-verkeer momenteel draait, en deze worden verderop behandeld.

Grok 4.5 is het oudere aanbod en het ingewikkeldere. SpaceXAI — het bedrijf dat op zijn modelkaarten nog steeds onder het merk xAI opereert — bracht het op 8 juli 2026 uit als een mixture of experts met 1,5 biljoen parameters, getraind naast de Cursor-code-editor, met een contextvenster van 500.000 tokens, tekst-, afbeeldings- en bestandsinvoer, en een lanceerpitch die bijna volledig was gebouwd op tokeneconomie in plaats van topscores. Het is niet langer het vlaggenschip. Grok 4.6 en Grok 4.7 bestaan allebei, hebben allebei dezelfde listprijs van $2,00 / $6,00, en onze catalogus vermeldt alle drie. De interessante vraag in september 2026 is daarom niet of Grok 4.5 goed is; het is of er nog iets is dat rechtvaardigt dat je naar de oudste van de drie grijpt.

De factuur is niet de tariefkaart

Zet de twee naast elkaar op het onafhankelijke bord en het antwoord verschijnt.

• Intelligentie-index, revisie v4.3.2 — Claude Sonnet 5.5 56 bij Max Effort vs Grok 4.5 39

• Kosten per Index-taak — Claude Sonnet 5.5 $7,60 vs Grok 4.5 $1,04, beide gemeten, niet geschat

• Uitvoertarief — Claude Sonnet 5.5 $10,00 per miljoen vs Grok 4.5 $6,00 per miljoen

• Uitvoersnelheid — Claude Sonnet 5.5 138,7 tokens/sec vs Grok 4.5 59,2 tokens/sec

• Tijd tot het eerste antwoordtoken, Max Effort — Claude Sonnet 5.5 370,8 s vs Grok 4.5 6,9 s

• Tokens gegenereerd gedurende de volledige Index-evaluatie — Claude Sonnet 5.5 410M vs Grok 4.5 77M

• Context — Claude Sonnet 5.5 1.000.000 tokens vs Grok 4.5 500.000 tokens

De breedsprakigheidslijn is het mechanisme achter de kloof in kosten per taak, en het is het meest bruikbare getal op deze pagina. Een model dat in een evaluatie 410 miljoen tokens genereert, terwijl zijn rivaal 77 miljoen tokens genereert, heeft geen 67% hoger outputtarief nodig om zeven keer zoveel per taak te kosten — maar het heeft dat toch, en beide effecten werken dezelfde kant op. De eigen framing van Anthropic stemt overeen met de interpretatie in plaats van die tegen te spreken: "tot 30% minder per taak" is een bewering over tokenaantallen, niet over tarieven, omdat de tarieven niet veranderden tussen Claude Sonnet 5 en Claude Sonnet 5.5. Artificial Analysis komt vanaf de andere kant tot dezelfde conclusie en beschrijft het model in eenvoudige bewoordingen als opvallend snel maar zeer breedsprakig. Tegenover een zuinig model is diezelfde eigenschap het grootste operationele risico van Claude Sonnet 5.5.

Generated comparison scoreboard titled Claude Sonnet 5.5 vs Grok 4.5, the scoreboard, with six matched rows: input price $2.00 vs $2.00, output price $10.00 vs $6.00, Intelligence Index 56 vs 39, cost per task $7.60 vs $1.04, first token 370.8 s vs 6.9 s, and context window 1,000,000 vs 500,000 tokens, with a footer reading Index, cost per task and latency per Artificial Analysis v4.3.2; prices per the vendors.

Waar het goedkope tarief van Grok 4.5 ophoudt goedkoop te zijn

De regel $2,00 / $6,00 is een staffel, geen tarief. Volgens de eigen ontwikkelaarsdocumentatie van SpaceXAI geldt die prijs tot 200.000 inputtokens en verdubbelt daarboven naar $4,00 voor input en $12,00 voor output. Het venster van Grok 4.5 is 500.000 tokens, dus de tweede helft van het venster dat het adverteert, kost twee keer zoveel als de eerste helft. Het laden van een prompt op repositoryschaal in Grok 4.5 is geen operatie met $6,00 output; het is een operatie met $12,00 output, en op dat punt is het model met het "dure" outputtarief van $10,00 de goedkopere bij elke aanvraag die ook veel tokens genereert.

Claude Sonnet 5.5 heeft geen gelijkwaardig niveau. Het tarief van $2,00 / $10,00 geldt voor het hele venster van 1.000.000 tokens, en cache-leesbewerkingen worden gefactureerd tegen $0,20 — een tiende van het inputtarief — wat het scenario met een lange context in de praktijk werkbaar maakt in plaats van alleen op papier.

De venstergrootte is de andere helft van dat argument en wijst dezelfde kant op. Het venster van Grok 4.5 is 500.000 tokens en elke daarvan wordt gefactureerd tegen het geadverteerde tarief. Claude Sonnet 5.5 heeft 1.000.000 tokens om mee te werken, en de vorm van de werklast is wat dat belangrijk maakt: een repository om over te redeneren, een lang agenttranscript, een stapel documenten die in beeld moet blijven. Een twee keer zo hoog plafond, geen staffelgrens op de helft daarvan, en cache-leesbewerkingen tegen een tiende van het inputtarief zorgen ervoor dat het meedragen van zoveel context over vele calls een regelpost wordt in plaats van een budget.

De praktische tweedeling is niet subtiel:

Korte prompts met compacte output — Grok 4.5 wint op snelheid en wint opnieuw op tokengebruik

• Prompts van meer dan 200.000 invoertokens — het tarief van Grok 4.5 verdubbelt en dat van Claude Sonnet 5.5 niet

• Latentiegevoelig interactief werk — Grok 4.5 antwoordt als eerste, met een ruime marge, bij standaardinstellingen

• Langdurige agentische runs — de samengestelde score van Claude Sonnet 5.5 en het 128K-outputplafond zijn waar je de extra taakkosten voor betaalt, en het 300K Batches-plafond rekt dit verder op

De migratie is geen modelstring

Iedereen die overstapt van Claude Sonnet 5 naar Claude Sonnet 5.5 moet de migratienota van A​nthropic lezen voordat er code wordt geschreven, want er zijn vijf gedragingen gewijzigd en slechts één daarvan faalt luidruchtig op een voor de hand liggende plek.

• Niet-standaard temperatuur, top_p of top_k geeft nu een 400 — een sampling-intensieve pipeline stopt met werken in plaats van te degraderen

• thinking: {"type": "disabled"} retourneert een 400 en moet veranderen in between_tools, waarbij effort beperkt is tot low, medium of high; xhigh en max worden afgewezen

• Geforceerd gebruik van tools — tool_choice met "any" of een benoemde tool — wordt ronduit geweigerd, dus een lus die een schema-valide aanroep forceert, moet overstappen op auto met strikt toolgebruik of gestructureerde outputs

• De oudere computer_20251124 computer-use-tool wordt geweigerd op de Claude API en op Goo​gle Cloud

• Thinking-blokken zijn gebonden aan het producerende model en account, dus redeneringen worden doorgegeven vanuit Claude Sonnet 5, maar niet zijwaarts naar een andere familie — en de advisor-tool accepteert Claude Opus 4.8, Claude Opus 4.7 of Claude Sonnet 5 niet langer als adviseurs achter een Sonnet 5.5-executor

Er is een zesde wijziging die helemaal niets laat mislukken, waardoor ze juist gevaarlijk is: tekst tussen toolaanroepen wordt nu teruggegeven binnen thinking-blokken. Een applicatie die die tekst naar een gebruiker streamt, blijft stil tussen toolaanroepen totdat deze een weergavewaarde instelt of voorafgaand denken volledig uitschakelt. Er treden geen fouten op. De uitvoer verschijnt simpelweg niet meer.

Grok 4.5 vraagt niets van dat alles. Het is een model in OpenAI-formaat met het sampling-oppervlak intact, en overstappen erop vanaf Grok 4.5's eigen voorgangers is een wijziging van de model-string. De migratiekosten komen volledig aan de Claude-kant terecht, en het is een dag werk in plaats van een middag.

Beide op één inloggegeven, en de eerlijke beperking daarvan

Een vergelijking van twee leveranciers in je hoofd houden is gemakkelijk; het daadwerkelijk uitvoeren ervan is waar de kosten schuilgaan. OrcaRouter zet meer dan 200 modellen achter één OpenAI-compatibel endpoint, met de listprijs van de provider doorgegeven en zonder opslag erbovenop, zodat een tariefwijziging aan weerszijden hier dezelfde dag live is in plaats van bij de volgende contractverlenging, met automatische failover tussen upstreamproviders en een routerings-DSL voor het samenstellen van calls. De volledige Grok-lijn staat in de catalogus tegen SpaceXAI's eigen tarieven, en Grok 4.5 kan worden gerouteerd als grok/grok-4.5 tegen $2,00 voor input en $6,00 voor output per miljoen tokens over het venster van 500.000 tokens.

Claude Sonnet 5.5 staat niet in onze catalogus, en deze pagina zal niet suggereren dat dat anders is. De route ernaartoe loopt vandaag via de eigen API van Anthropic, of via Bedrock en Google Cloud als dat is waar je infrastructuur al draait. Claude Sonnet 5 is hier sinds 30 juni te routeren tegen de tarieven van Anthropic van $2,00 en $10,00 en blijft het model waarop het meeste Claude API-verkeer draait, wat het de natuurlijke failover-bestemming maakt zolang Claude Sonnet 5.5 nog maar een dag oud is en er bij niemand productiebewijs voor bestaat.

Bij dat alles hoort één kanttekening, en het is geen kleine. De Grok 4.5-rij hierboven is de pitch van de leverancier zoals onze catalogus die momenteel weergeeft; de verkeersteller bij dat item geeft nul aan over de afgelopen zeven dagen en het doorvoercijfer wordt niet gemeten, terwijl de tijd tot het eerste token op de ondergrens van één seconde blijft steken die een nauwelijks aangeroepen model doorgaans vertoont. Een model zonder recent verkeer hier is geen bewijs dat het model slecht is — 4.6 en 4.7 zijn waar de aanroepen van de familie naartoe zijn gegaan — maar het betekent wel dat de operationele cijfers op die pagina mager zijn, en de latentiewaarde die het vertrouwen waard is, is de uitlezing van een live route.

OrcaRouter model page for grok/grok-4.5, dated 2026-07-08, showing a 500K-token context window, text, image and file input, the pricing row of $2.00 input and $6.00 output per million tokens, a p50 time to first token of 1.00 s, a p95 of 4.0 s, and a traffic counter reading Collecting.

Welke moet je pakken?

Grok 4.5 is het juiste model wanneer de prompt kort is, het antwoord informatiedicht is en de integratie al OpenAI spreekt — en wanneer het verzoek niet boven de 200.000 inputtokens uitkomt, want voorbij die grens komt de rekensom in andere handen terecht. Het is ook de juiste keuze wanneer een eerste token binnen seconden in plaats van minuten moet aankomen. Wat het niet is, is het huidige Grok-vlaggenschip; Grok 4.6 en Grok 4.7 staan erboven tegen dezelfde lijstprijs, en de reden om 4.5 boven een van beide te kiezen, moet een specifieke zijn.

Claude Sonnet 5.5 is het juiste model wanneer de prompt enorm is, het werk agentisch genoeg is dat zeventien Index-punten en een 128K-uitvoerplafond een zevenvoudig hogere kosten per taak rechtvaardigen, of de samengestelde score simpelweg is wat gekocht wordt. De uitvoerigheid ervan is een ontwerpbeslissing, geen defect, en het is het getal dat je op je eigen verkeer moet meten voordat je je vastlegt — want $7,60 per Index-taak tegenover $1,04 is een proxy voor een cijfer dat alleen jouw workload kan produceren.