Ett hjältetitelkort för 'Mercury 2.5 Preview vs Grok 4.6' med undertexten 'Kan en förhandsversion på 1 107 tokens/sekund underbjuda värdechampion?', som visar ett blixtformat chip märkt '1,107 tok/s', ett vågformat chip märkt 'PRICE vs SPEED', ett troféformat chip märkt 'AA #3', och OrcaRouter-logotypen i nedre högra hörnet.
Guides & Insights

Mercury 2.5 Preview vs Grok 4.6: Kan en 1 107-token/s-preview slå värdemästaren?

Författare

Alistair Wren

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Här är svaret i en mening: Mercury 2.5 Preview är den billigaste trovärdiga resonemangsmodellen i produktion idag till $0,04 / $0,15 per miljon tokens, och Grok 4.6 är den billigaste modellen vid intelligensfronten till $2,00 / $6,00 — så den praktiska frågan dem emellan är huruvida en förhandsvisningsmodell för diffusion som Inception bara hävdar är "jämförbar med" GPT-5.6 Luna (Low) och Claude Haiku 4.5 kan utföra de jobb som du annars skulle betala för frontier-nivån. Mercury 2.5 Preview, som släpptes den 31 augusti 2026, genererar tokens parallellt och gör anspråk på 1 107 tokens per sekund på vanliga GPU:er; Grok 4.6, flaggskeppet vid fronten som släpptes den 12 augusti 2026, får 61 på Artificial Analysis Intelligence Index, delad global trea, och gör det till ett pris som fronten inte har sett tidigare. Den kollisionen — där det snabbaste anspråket i botten av priskurvan möter det bästa värdet i toppen av den — är vad den här artikeln handlar om.

Viktiga slutsatser

• Grok 4.6 för $2.00 / $6.00 med ett AA Intelligence Index på 61 är värdechampion på frontier-nivån; Mercury 2.5 Preview för $0.04 / $0.15 är en satsning på att tillräckligt bra kvalitet till 1/50 av priset slår frontier-kvalitet som du sällan behöver.

• Mercury 2.5 Previews hastighets- och kvalitetspåståenden kommer helt och hållet från Inception; inga oberoende benchmarkresultat fanns tillgängliga från dag ett.

• Lanseringsrabatten på 80% för Mercury 2.5 Preview upphör den 8 september 2026, varefter dess listpris är $0,20 / $0,75 — fortfarande 10× billigare än Grok 4.6 på indata, men en mindre historia.

• Grok 4.6 routas på OrcaRouter idag till listpris; Mercury 2.5 Preview är ännu inte routad och levereras via Inceptions eget API och flera tredjepartsplattformar.

Resultattavlan

A two-column scoreboard titled 'Mercury 2.5 Preview vs Grok 4.6 — the scoreboard': left column Mercury 2.5 Preview — Intelligence claimed cheap-tier parity, Price $0.04/$0.15 (80% off), Speed 1,107 tok/s (claimed), Context 260K, Agentic no public scores, Weights closed; right column Grok 4.6 — Intelligence AA Index 61 (#3), Price $2.00/$6.00, Speed not a headline spec, Context 500K, Agentic APEX-Agents 57.5, Weights closed; footer 'Mercury figures vendor-reported, unreproduced; Grok per xAI and Artificial Analysis'.

Intelligens — Mercury 2.5 Preview: inget oberoende index; Inception hävdar paritet med den kostnadsoptimerade nivån. Grok 4.6: AA Intelligence Index 61, delad 3:a globalt (enligt Artificial Analysis; labbets egna siffror är leverantörsrapporterade).

Pris — Mercury 2.5 Preview: $0.04 / $0.15 per 1M (80% rabatt på $0.20 / $0.75, t.o.m. 8 september 2026). Grok 4.6: $2.00 / $6.00 per 1M, fördubblas till $4.00 / $12.00 för prompts på eller över 200K tokens.

Hastighet — Mercury 2.5 Preview: 1 107 tokens/sek uppges, leverantörsrapporterat. Grok 4.6: hastighet är ingen huvudspecifikation; modellen är byggd för långa agentiska körningar, inte snabba strömmar.

Kontext — Mercury 2.5 Preview: 260K. Grok 4.6: 500K.

Agentiskt arbete — Mercury 2.5 Preview: inga offentliga resultat, men parallella verktygsanrop stöds. Grok 4.6: APEX-Agents 57.5, DeepSWE v1.1 65.9, CursorBench v3.2 69.9 (leverantörsrapporterat, till stor del ej återproducerat).

Vikter — Mercury 2.5 Preview: sluten, proprietär. Grok 4.6: sluten, proprietär.

Värdechampionen och prishoppet

Grok 4.6:s position är ovanlig. Den matchar tredjeplatsen i intelligens på Artificial Analysis-indexet — delad med GPT-5.6 Sol Max — samtidigt som den är billigare än varje modell inom tio poäng från den, och lanseringsbevakningen betonade långa agentiska körningar som i genomsnitt slutade på cirka 0,84 dollar per uppgift i en leverantörsdriven utvärdering. Det är definitionen av en värdechampion: frontier-liknande kapacitet till ett pris som gör kostnaderna per uppgift synliga i ett kalkylblad. Mercury 2.5 Preview försöker inte vara det. Inception positionerar den mot modeller som GPT-5.6 Luna (Low), Gemini 3.5 Flash-Lite och Claude Haiku 4.5 — den kostnadsoptimerade nivån, inte frontier. Om Inception har rätt är Mercury 2.5 Preview en nivå under Grok 4.6 i kapacitet och flera nivåer under i pris, vilket är en fullt sammanhängande produkt: ett prissprång för arbetsbelastningar där frontier-nivån är slöseri.

Vad parallell avkodning faktiskt ändrar

Arkitekturen är den del som är värd att förstå, eftersom den förändrar vad "snabb" betyder. Autoregressiva modeller avger en token per steg, så genomströmningen begränsas av sekventiell latens; en diffusions-LLM som Mercury 2.5 Preview genererar ett block av tokens parallellt och förfinar dem över denoising-steg, vilket frikopplar genomströmningen från antalet producerade tokens. Det är därför Inception kan hävda 1 107 tokens per sekund på vanliga GPU:er — utan speciella acceleratorer, utan batching-trick — och varför det verkliga produktlöftet är en tid-till-första-token på under 300 millisekunder för interaktiva arbetsbelastningar. För en röstagent, en sökpipeline eller en kodningssubagent som anropar modellen vid varje tur, är den latensskillnaden produkten: det är skillnaden mellan en röstloop som känns levande och en som pausar. Haken är att diffusionsspråkmodeller är ett ungt forskningsområde, att 1 107-siffran är Inceptions, och att inget oberoende labb har reproducerat hastigheten eller mätt den kvalitetsavvikelse, om någon, som parallell generering introducerar vid långa eller adversariella prompts.

Där Grok 4.6 fortfarande äger jobbet.

Ingenting med Mercury 2.5 Preview berör de delar av marknaden där Grok 4.6 faktiskt vinner. Grok 4.6:s vinster jämfört med Grok 4.5 var koncentrerade till agentiska och kodningsbenchmarks – DeepSWE upp 11,9 poäng, APEX-Agents upp 10,4, Terminal-Bench upp 10,3 – och dess kontextfönster på 500K finns till för långsiktiga agenter som måste hålla hela uppgiften i kontexten. Mercury 2.5 Preview erbjuder parallella verktygsanrop, men en modell utan oberoende agentiska poäng, ett utdatatak på 65 536 tokens och ett kontextfönster på 260K är inte rätt verktyg för en 50-stegs mjukvaruutvecklingskörning. De två modellerna överlappar knappt i användning: Grok 4.6 är motorn för arbete som faktiskt måste slutföras; Mercury 2.5 Preview är motorn för arbete som måste kännas omedelbart och kosta nästan ingenting per anrop.

80%-rabattfönstret

Prissättningen här har ett utgångsdatum, och det förändrar beslutet. Mercury 2.5 Preview:s $0.04 / $0.15-pris är 80 % billigare än listpriset på $0.20 / $0.75, och Inception har sagt att kampanjen löper till och med den 8 september 2026. Grok 4.6:s $2.00 / $6.00 är ett stabilt listpris med en ren struktur — cachad inmatning till $0.50, en prioritetsnivå till 2× och en upptrappning för långa prompts vid 200K tokens som debiterar hela anropet till den högre satsen. Om du jämför dagens siffror ser Mercury ut att vara 50× billigare på inmatning och 40× billigare på utmatning; om rabatten löper ut som planerat är den verkliga långsiktiga skillnaden 10× på inmatning och 5× på utmatning. Ingen av tolkningarna är oärlig — de är bara olika tidshorisonter, och en pipeline som prissätts utifrån rabatten utan en omvärderingspunkt är en pipeline som kommer att bli överraskad den 9 september. Grok 4.6:s $2.00 / $6.00 är exakt vad du betalar på OrcaRouter, där leverantörens listpris förs vidare med 0 % påslag — när leverantören ändrar en siffra är den live på samma nyckel samma dag, med automatisk failover om en leverantörsväg tillämpar hastighetsbegränsning.

Enradsdom

Om jobbet måste bli klart och du vill ha frontlinjekapacitet till bästa pris i klassen, köp Grok 4.6 — den är en bevisad värdechampion, live på OrcaRouter för $2.00 / $6.00 idag. Om jobbet är textresonemang med hög volym och låg latens, där tillräckligt bra svar är billiga att verifiera, är Mercury 2.5 Preview för $0.04 / $0.15 ett prissänkningsfynd värt att testa inom rabattfönstret — men kom ihåg att varje påstående på den sidan av tavlan är Inceptions, och bevisen är fortfarande utestående.

A screenshot of the Inception documentation page 'Models, Endpoints, and Pricing' (captured September 1, 2026), showing the Mercury family pricing table — Mercury 2 and Mercury Edit 2 both at $0.25 input / $0.025 cached / $0.75 output per 1M tokens — and a cURL chat-completions API example.A screenshot of the OrcaRouter model page for Grok 4.6 (grok/grok-4.6), showing the model header, the '$2.00' price badge, and the model description noting the August 12, 2026 release.

OrcaRouter förmedlar leverantörernas listpriser med 0 % påslag och automatisk redundans, så att en leverantörsprisändring är live på samma nyckel samma dag.

Jämförda i den här artikeln1

Identifierat från den här artikeln · Benchmarks: Artificial Analysis · uppdateras dagligen

© 2026 OrcaRouter

För leverantörer

Driver du en inferensplattform? Få dina modeller på OrcaRouter.

providers@orcarouter.ai

Gå med i vår community

Discordsupport@orcarouter.aiXGitHubYouTube