
Mercury 2.5 Preview vs Grok 4.6: Kan een Preview met 1.107 tokens/s de waardekampioen onderbieden?
- AlibabaNIEUWQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiNIEUWZ.ai: GLM 5.3 Flash2026-08-2658Intelligentie72Coderen
- DeepSeekNIEUWDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1860Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1552Intelligentie68Coderen
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1261Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0557Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligentie72Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligentie78Coderen
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligentie69Coderen
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligentie49Coderen
- metaMeta: Muse Spark 1.12026-07-1653Intelligentie71Coderen
- kimiMoonshotAI: Kimi K32026-07-1560Intelligentie76Coderen
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligentie71Coderen
Hier is het antwoord in één zin: Mercury 2.5 Preview is momenteel het goedkoopste geloofwaardige redeneermodel in productie, voor $0.04 / $0.15 per miljoen tokens, en Grok 4.6 is het goedkoopste model aan de intelligentiefrontier voor $2.00 / $6.00 — dus de praktische vraag tussen de twee is of een preview-diffusiemodel waarvan Inception slechts beweert dat het "vergelijkbaar is met" GPT-5.6 Luna (Low) en Claude Haiku 4.5, de taken kan uitvoeren waarvoor je anders de prijs van het frontier-niveau zou betalen. Mercury 2.5 Preview, uitgebracht op 31 augustus 2026, genereert tokens parallel en claimt 1.107 tokens per seconde op standaard-GPU's; Grok 4.6, het vlaggenschip van de frontier dat op 12 augustus 2026 is uitgebracht, scoort 61 op de Artificial Analysis Intelligence Index, goed voor een gedeelde derde plaats wereldwijd, en doet dat tegen een prijs die de frontier nog niet eerder heeft gezien. Die botsing — de snelste claim onderaan de prijscurve, die de beste waarde bovenaan ontmoet — is waar dit artikel over gaat.
Belangrijkste conclusies
• Grok 4.6 voor $2.00 / $6.00 met een AA Intelligence Index van 61 is de waardekampioen van de frontier tier; Mercury 2.5 Preview voor $0.04 / $0.15 is een gok dat goed-genoeg-kwaliteit voor 1/50e van de prijs beter is dan frontier-kwaliteit die je zelden nodig hebt.
• De snelheids- en kwaliteitsclaims van Mercury 2.5 Preview zijn volledig afkomstig van Inception; er waren op dag één geen onafhankelijke benchmarkresultaten.
• De 80% lanceringskorting op Mercury 2.5 Preview vervalt op 8 september 2026, waarna de catalogusprijs $0,20 / $0,75 is — nog steeds 10× goedkoper dan Grok 4.6 op input, maar een kleiner verhaal.
• Grok 4.6 wordt vandaag via OrcaRouter gerouteerd tegen de lijstprijs; Mercury 2.5 Preview is nog niet gerouteerd en wordt aangeboden via de eigen API van Inception en verschillende platforms van derden.
Het scorebord

• Intelligentie — Mercury 2.5 Preview: geen onafhankelijke index; Inception claimt pariteit met de kostenoptimalisatielaag. Grok 4.6: AA Intelligence Index 61, gedeeld #3 wereldwijd (volgens Artificial Analysis; de eigen cijfers van het lab zijn door de leverancier gerapporteerd).
• Prijs — Mercury 2.5 Preview: $0,04 / $0,15 per 1M (80% korting op $0,20 / $0,75, tot en met 8 september 2026). Grok 4.6: $2,00 / $6,00 per 1M, wat verdubbelt naar $4,00 / $12,00 voor prompts van 200K tokens of meer.
• Snelheid — Mercury 2.5 Preview: 1.107 tokens/sec geclaimd, volgens de leverancier. Grok 4.6: snelheid is niet de belangrijkste specificatie; het model is gebouwd voor lange agentische runs, niet voor snelle streams.
• Context — Mercury 2.5 Preview: 260K. Grok 4.6: 500K.
• Agentisch werk — Mercury 2.5 Preview: geen openbare scores, hoewel tool calls parallel worden ondersteund. Grok 4.6: APEX-Agents 57.5, DeepSWE v1.1 65.9, CursorBench v3.2 69.9 (door de leverancier gerapporteerd, grotendeels niet gereproduceerd).
• Gewichten — Mercury 2.5 Preview: gesloten, propriëtair. Grok 4.6: gesloten, propriëtair.
De waardekampioen en het overslaan van de prijs
De positie van Grok 4.6 is ongebruikelijk. Het staat op de #3-positie voor intelligentie op de Artificial Analysis-index — op gelijke hoogte met GPT-5.6 Sol Max — terwijl het goedkoper is dan elk model binnen tien punten van zijn score, en de berichtgeving rond de lancering benadrukte dat lange agentische runs in één door de leverancier uitgevoerde evaluatie gemiddeld op ongeveer $0,84 per taak uitkwamen. Dat is de definitie van een prijs-kwaliteitskampioen: capaciteit nabij het frontier-niveau, tegen een prijs die de kosten per taak in een spreadsheet zichtbaar maakt. Mercury 2.5 Preview probeert dat niet te zijn. Inception positioneert het tegenover modellen als GPT-5.6 Luna (Low), Gemini 3.5 Flash-Lite en Claude Haiku 4.5 — het kosten-geoptimaliseerde niveau, niet het frontier-niveau. Als Inception gelijk heeft, staat Mercury 2.5 Preview qua capaciteit een niveau onder Grok 4.6 en qua prijs verschillende niveaus eronder, wat een volkomen coherent product is: een prijsvoordeel voor workloads waarbij het frontier-niveau zonde van het geld is.
Wat parallelle decodering daadwerkelijk verandert
De architectuur is het onderdeel dat de moeite waard is om te begrijpen, omdat het verandert wat ‘snel’ betekent. Autoregressieve modellen genereren één token per stap, dus de doorvoer wordt beperkt door sequentiële latentie; een diffusie-LLM zoals Mercury 2.5 Preview genereert parallel een blok tokens en verfijnt deze via denoising-stappen, wat de doorvoer van het aantal geproduceerde tokens loskoppelt. Daarom kan Inception 1.107 tokens per seconde claimen op standaard GPU’s — geen speciale accelerators, geen batching-trucs — en daarom is de échte productclaim een time-to-first-token van minder dan 300 milliseconden voor interactieve workloads. Voor een voice-agent, een zoekpipeline of een codeer-subagent die het model bij elke beurt aanroept, is dat latentieverschil het product: het is het verschil tussen een voice-loop die live aanvoelt en een die pauzeert. Het addertje onder het gras is dat diffusietaalmodellen een jong onderzoeksgebied zijn, dat het cijfer 1.107 van Inception komt, en dat geen onafhankelijk lab de snelheid heeft gereproduceerd of de kwaliteitsdrift heeft gemeten die parallelle generatie bij lange of adversariële prompts introduceert, als die er al is.
Waar Grok 4.6 nog steeds de klus klaart
Niets aan Mercury 2.5 Preview raakt de delen van de markt waar Grok 4.6 daadwerkelijk wint. De winst van Grok ten opzichte van Grok 4.5 was geconcentreerd op agentische en codeerbenchmarks — DeepSWE steeg met 11,9 punten, APEX-Agents met 10,4, Terminal-Bench met 10,3 — en het contextvenster van 500K bestaat voor langetermijnagenten die de hele taak in hun context moeten houden. Mercury 2.5 Preview biedt parallelle toolcalls, maar een model zonder onafhankelijke agentische scores, een outputlimiet van 65.536 tokens en een context van 260K is niet het juiste instrument voor een software-engineeringrun van 50 stappen. De twee modellen overlappen qua gebruik nauwelijks: Grok 4.6 is de motor voor werk dat daadwerkelijk afgerond moet worden; Mercury 2.5 Preview is de motor voor werk dat direct moet aanvoelen en bijna niets per aanroep mag kosten.
Het venster met 80% korting.
De prijsstelling hier heeft een vervaldatum, en dat verandert de beslissing. Het tarief van $0,04 / $0,15 voor Mercury 2.5 Preview is een korting van 80% op de catalogusprijs van $0,20 / $0,75, en Inception heeft gezegd dat de promotie loopt tot en met 8 september 2026. De $2,00 / $6,00 van Grok 4.6 is een stabiele catalogusprijs met een heldere structuur — gecachte invoer voor $0,50, een prioriteitsniveau tegen 2×, en een opslag voor lange prompts vanaf 200K tokens die voor het volledige verzoek het hogere tarief in rekening brengt. Als je de cijfers van vandaag vergelijkt, is Mercury 50× goedkoper op invoer en 40× goedkoper op uitvoer; als de korting volgens plan vervalt, is het werkelijke verschil op de lange termijn 10× op invoer en 5× op uitvoer. Geen van beide frames is oneerlijk — het zijn gewoon verschillende tijdshorizonten, en een pipeline die op basis van de korting is geprijsd zonder een herbeoordelingsmoment is een pipeline die op 9 september voor een verrassing komt te staan. De $2,00 / $6,00 van Grok 4.6 is precies wat je betaalt op OrcaRouter, waar de catalogusprijs van de provider tegen 0% opslag wordt doorgegeven — wanneer de provider een getal wijzigt, is dat dezelfde dag live op dezelfde key, met automatische failover als een providerroute een rate-limit oplegt.
Het eindoordeel in één regel
Als de klus af moet en je topcapaciteit wilt tegen de beste prijs in de categorie, koop dan Grok 4.6 — het is een bewezen waardekampioen, vandaag live op OrcaRouter voor $2.00 / $6.00. Als het gaat om grootschalige, latentiegevoelige tekstredenering, waarbij antwoorden die goed genoeg zijn goedkoop te verifiëren zijn, dan is Mercury 2.5 Preview voor $0.04 / $0.15 een prijsvoordeel dat het testen waard is binnen het kortingsvenster — maar onthoud dat elke bewering aan de kant van Mercury van Inception is, en het bewijs staat nog steeds uit.


OrcaRouter geeft provider-lijstprijzen door tegen 0% opslag met automatische failover, zodat een prijswijziging van een leverancier dezelfde dag live is op dezelfde sleutel.
Vergeleken in dit artikel1
Herkend uit dit artikel · Benchmarks: Artificial Analysis · dagelijks bijgewerkt
