Hero-kaart getiteld Claude Sonnet 5.5 vs Grok 4.6, met als ondertitel: de tariefkaart zegt het ene, de tokenrekening het andere, met pills met de tekst output $10 vs $6, kosten per taak $7.60 vs $1.86, en Index 56 vs 44, en een voettekst met vermelding van Artificial Analysis v4.3.2 en leveranciersprijzen.
Guides & Insights

Claude Sonnet 5.5 vs Grok 4.6: De tariefkaart zegt het ene, de tokenrekening het andere

Auteur

Elias Hawthorne

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen →
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

De rekensom in de kop lijkt al beslecht voordat het artikel begint. Grok 4.6 kost $2 per miljoen inputtokens en $6 per miljoen outputtokens; Claude Sonnet 5.5 kost $2 en $10. Het model van Space​XAI is 40% goedkoper op output, even duur op input, en is sinds 12 augustus 2026 algemeen beschikbaar — lang genoeg dat de eigenaardigheden ervan gedocumenteerd zijn in plaats van dat er alleen geruchten over bestaan. Het model van Anthro​pic arriveerde op 28 september 2026, een dag voordat dit werd geschreven, en is met ruime marge het nieuwste in de categorie.

Dan kom je bij de onafhankelijke efficiëntiecijfers en slaat de rangorde om. Artificial Analysis meet modellen van het GPT- en Claude-niveau op basis van kosten per taak, naast zijn Intelligence Index, en in de v4.3.2-revisie kosten de twee modellen hier $1,86 per indextaak voor Grok 4.6 en $7,60 voor Claude Sonnet 5.5. Het model met de goedkoopste tariefkaart is het duurste om te draaien, met een factor vier. Uitzoeken waarom, en wanneer die omslag wel en niet opgaat, is de hele vergelijking.

Twee modellen, twee posities binnen hun eigen families

Grok 4.6 is het huidige vlaggenschip van de Grok-lijn — de eigen ontwikkelaarsdocumentatie van SpaceXAI vermeldt het als de nieuwste, en het volgde Grok 4.5 op met hetzelfde contextvenster van 500.000 tokens, hetzelfde invoeroppervlak voor tekst, afbeeldingen en bestanden, en dezelfde basisprijsstelling. Het ondersteunt configureerbare reasoning-inspanning, native tool calling, gestructureerde outputs en het volledige sampling-oppervlak, en als een first-class OpenAI Responses-model past het in bestaande agent-frameworks zonder een vertaallaag. Artificial Analysis plaatst het op een Intelligence Index van 44, op de 31e plaats van de 216 modellen die het meet, met een GPQA Diamond-score van 94,9%.

Two-column scoreboard for Claude Sonnet 5.5 and Grok 4.6 across six rows. Left column Claude Sonnet 5.5: input $2.00 per million, output $10.00 per million, 1M-token context, AA Intelligence Index 56, cost per Index task $7.60, verbosity 410M output tokens. Right column Grok 4.6: input $2.00 per million, output $6.00 per million, 500K-token context, AA Intelligence Index 44, cost per Index task $1.86, verbosity 94M output tokens. A footer line reads Index, cost per task and verbosity per Artificial Analysis v4.3.2; prices per the vendors.

Claude Sonnet 5.5 is het tweede model in de 5.5-generatie van Anthropic en het model dat het bedrijf heeft gepositioneerd als de beste combinatie van snelheid en intelligentie in zijn aanbod. Het is beschikbaar als claude-sonnet-5-5/ op de Claude API en de drie grote cloudplatforms, heeft een contextvenster van 1M tokens met een synchrone uitvoerlimiet van 128K, behoudt de tarieven van $2 / $10 van Claude Sonnet 5 voor invoer, uitvoer en caching, en is beschikbaar met zero data retention. In dezelfde indexrevisie behaalt het een score van 56 en staat het op de derde plaats van 216.

Dus de twee zitten niet echt in dezelfde markt. De ene is een frontiermodel met 500.000 tokens dat al zeven weken tegen een scherp tarief wordt aangeboden. De andere is een algemene categorie met 1M tokens die per token niets meer kost dan zijn voorganger en twaalf punten hoger scoort op de composite. De vergelijking is toch de moeite waard, want beide zijn $2-inputmodellen en dat is waar inkoopbeslissingen daadwerkelijk beginnen.

De vier keer zo grote kloof die niemand op een dia zet

Tarieflijsten prijzen tokens. Rekeningen luiden in taken, en het aantal tokens dat een model besteedt aan het bereiken van een antwoord is een ontwerpkeuze en geen constante. Dat is waar deze twee uiteenlopen, en de gemeten cijfers zijn onthutsend:

• Uitvoertarief — Claude Sonnet 5.5 $10 per miljoen vs Grok 4.6 $6 per miljoen

• Kosten per Intelligence Index-taak — Claude Sonnet 5.5 $7,60 vs Grok 4.6 $1,86

• Uitvoerigheid op de Index — Claude Sonnet 5.5 410M outputtokens vs Grok 4.6 94M

• Intelligentie-index — Claude Sonnet 5.5 56 vs Grok 4.6 44, beide op v4.3.2

• Outputsnelheid — Grok 4.6 gemeten op 67,7 tokens per seconde tegenover een mediaan van 82,7; Anthropic meldt dat Claude Sonnet 5.5 output genereert die 30%+ sneller is dan Claude Sonnet 5, dat Artificial Analysis klokte op 78,7 tokens per seconde

De breedsprakigheidslijn is het mechanisme. Een model dat vier keer zoveel tokens uitstoot, heeft geen 67% hogere output rate nodig om vier keer zoveel per taak te kosten — maar het helpt, en beide effecten wijzen hier dezelfde kant op. De eigen framing van Anthropic ondersteunt de interpretatie in plaats van die tegen te spreken: het lanceringsmateriaal beweert dat Claude Sonnet 5.5 "tot 30% minder per taak kost" dan Claude Sonnet 5 bij identieke prijzen per token, wat een bewering is over tokenaantallen, niet over tarieven. Tegenover een externe baseline die veel zuiniger is, wordt diezelfde eigenschap het grootste kostenrisico van het model.

Niets hiervan laat de indexkloof verdwijnen. Twaalf punten op de samengestelde score is een echt capaciteitsverschil, en een goedkopere taak die faalt is niet goedkoper. Het betekent wel dat de eerlijke vraag niet is "welk tarief lager is", maar "hoeveel tokens de moeilijkere taak kost", en dat getal bestaat pas als je je eigen workload draait.

Artificial Analysis model page for Claude Sonnet 5 (Adaptive Reasoning, Max Effort), released June 2026, showing an Intelligence Index of 38, an output speed of 78.7 tokens per second against an average of 83, a cost of $2.00 per million input tokens and $10.00 per million output tokens, $5.09 per Intelligence Index task, a verbosity of 370M output tokens, and a 1M-token context window.

Context, inspanning en de vorm van de integratie

De tweede divergentie is architecturaal, en die bepaalt welke van de twee je kunt overnemen zonder iets te herschrijven.

OrcaRouter model page for grok/grok-4.6, attributed to SpaceXAI and dated 2026-08-12, showing a 500K-token context window, text, image and file input, an input price of $2.00 and output price of $6.00 per million tokens, a p50 time to first token of 3.00 seconds, and OpenAI-compatible base URL https://api.orcarouter.ai/v1

Claude Sonnet 5.5 verandert zes gedragingen ten opzichte van Claude Sonnet 5, waarvan vijf breaking. Het verzenden van thinking: {"type": "disabled"}/ retourneert nu een 400 en moet worden vervangen door between_tools/. Geforceerd gebruik van tools — tool_choice/ van "any"/ of een benoemde tool — wordt direct afgewezen, dus een lus die een schema-valide aanroep forceert, moet overstappen naar auto/ met strikt toolgebruik of gestructureerde outputs. De oudere computer_20251124/ computer-use-tool wordt geweigerd op de Claude API en Google Cloud. Denkblokken zijn nu gebonden aan het model en het account die ze hebben geproduceerd, dus een gesprek kan zijn redenering meenemen vanuit Claude Sonnet 5, maar niet zijwaarts naar een andere modelfamilie. En de advisor-tool accepteert Claude Opus 4.8, Claude Opus 4.7 of Claude Sonnet 5 niet langer als adviseurs achter een Sonnet 5.5-executor.

Grok 4.6 vraagt niets van dat alles. Het is een model in OpenAI-formaat met het sampling-oppervlak intact, en de migratie van Grok 4.5 is een wijziging van de modelstring. De eigen kostenstructuur heeft echter een addertje onder het gras, en het is een spiegelbeeld van die van Anthropic: het tarief van $2 / $6 geldt tot 200.000 inputtokens, en alles daarboven wordt gefactureerd tegen $4 / $12. Claude Sonnet 5.5 rekent het standaardtarief over het volledige 1M-venster.

Zet de twee structuren naast elkaar en de keuze gaat niet meer over welke leverancier goedkoper is:

• Korte prompts, compacte output — de zuinigere tokengewoonte en lagere outputrate van Grok 4.6 winnen overtuigend

• Zeer lange inputs — het vaste 1M-tarief van Claude Sonnet 5.5 begint een verdubbelende tier ruim vóór de contextlimiet te verslaan

• Grote enkele outputs — de 128K-limiet van Sonnet 5.5 evenaart die van Grok 4.6, en het haalt 300K op de Message Batches API achter de output-300k-2026-03-24/ header

• Bestaande code in OpenAI-vorm — Grok 4.6 heeft geen wijzigingen nodig; Sonnet 5.5 heeft het hierboven genoemde werk aan toolgebruik en redeneren nodig

Beide op één inloggegeven krijgen

Een vergelijking tussen twee leveranciers in je hoofd houden is makkelijk. Het daadwerkelijk uitvoeren ervan is waar de kosten zich verbergen: twee accounts, twee sets limieten, twee facturatieoppervlakken, en een tokenaantal dat twee keer gemeten moet worden voordat het iets betekent.

OrcaRouter bundelt dat in één OpenAI-compatibel eindpunt dat meer dan 200 modellen dekt, met de lijstprijs van de provider doorgegeven en zonder opslag, zodat een tariefwijziging van de leverancier aan de Grok- of de Claude-kant hier dezelfde dag live is in plaats van bij de volgende contractverlenging. De hele Grok 4.x-lijn staat in de catalogus tegen de tarieven van de leverancier zelf, en Claude Sonnet 5 is sinds 30 juni routeerbaar tegen Anthropic's $2 / $10 — het model waarop het meeste Claude API-verkeer nog steeds draait, gemeten op 150 outputtokens per seconde met een p50-tijd tot de eerste token van ongeveer vijf seconden.

Claude Sonnet 5.5 zelf staat nog niet in onze catalogus. Totdat het zover is, loopt de route ernaartoe via de eigen API van de leverancier, en de manier om het te testen zonder een workload te verwedden op een model dat niemand onafhankelijk heeft gebenchmarkt verder dan één enkele samengestelde test, is om er een percentage van het verkeer naartoe te sturen achter automatische failover, waarbij Grok 4.6 of Claude Sonnet 5 opvangt wat het laat vallen. Een gloednieuwe tier uitproberen is een routeringsbeslissing, geen migratieproject.

Wat te doen met de nummers

Grok 4.6 is het betere model om naar te grijpen wanneer de klus kort is, de output compact is en de integratie al OpenAI spreekt. Het is meetbaar zuiniger per taak dan al het andere in deze prijsklasse, de sampling-instellingen zijn intact, en zeven weken beschikbaarheid betekent dat zijn faalmodi al door anderen zijn gevonden.

Claude Sonnet 5.5 is het betere model wanneer de input enorm is, wanneer de samengestelde score is wat je koopt, of wanneer het werk agentisch genoeg is dat een kloof van twaalf punten in de index en een outputplafond van 128K belangrijker zijn dan een viervoudig verschil in kosten per taak. De migratiechecklist is reëel, en het is een dag werk in plaats van een bewerking van een model-string.

Wat de knoop zou doorhakken, is een meting van tokens per taak op je eigen verkeer, uitgevoerd op beide. Elk getal in dit artikel dat de uitkomst bepaalt — $1,86 tegen $7,60, 94M tegen 410M — is een proxy voor dat ene cijfer, en het is het enige daarvan dat je zelf kunt produceren.

Vergeleken in dit artikel4

Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt