Ett hero-titelkort för 'Mercury 2.5 vs Mercury 2.5 Preview' med undertexten 'En diffusionsmodell, två lanseringsdatum — vad produktionsuppgraderingen faktiskt förändrar'. Tre chips visas nedanför: en kolumndelningsikon märkt 'SAMMA MOTOR', en blixtikon märkt '1 107 tok/s PÅSTÅENDE' och en klockikon märkt '31 AUG vs 8 SEP'. OrcaRouter-logotypen sitter i det nedre högra hörnet.
Guides & Insights

Mercury 2.5 vs Mercury 2.5 Preview: En diffusionsmodell, två lanseringsdatum

Författare

Alistair Wren

Publiceringsdatum

Senaste modellerna · 20Visa alla modeller
Benchmarks: Artificial Analysis · uppdateras dagligen
Tillbaka till alla inlägg

Här är en head-to-head-jämförelse där båda kandidaterna delar ett modellkort. Inceptions Mercury 2.5 Preview, släppt 31 augusti 2026, och Mercury 2.5, släppt 8 september 2026, är samma diffusionsspråkmodell med åtta dagars mellanrum: en förhandsvisningskanal som Inception öppnade för utvecklare, och den "enterprise-redo" produktionsversionen som lanserades en vecka senare. Inception har inte presenterat en annan checkpoint, en annan hastighetssiffra eller ett annat pris för Mercury 2.5 – och siffrorna som faktiskt ändrades mellan de två tillkännagivandena ser ut som en putsning, inte en ny modell. Kontextsiffran korrigerades från 256K på förhandsvisningssidan till 260K vid lanseringen, och intelligensökningen jämfört med Mercury 2 omformulerades från "mer än 10 poäng" (förhandsvisningsmaterial) till "40 procent" (lanseringsmaterial). Motorn, påståendet om 1 107 tokens per sekund och prisdokumentet är identiska. Så detta är inte den vanliga specifikationsstriden, och att fylla ut en av dem skulle vara ohederligt. Den jämförelse som betyder något mellan dessa två namn handlar om paketering och tajming: vad produktionslanseringen faktiskt ändrade, vad Preview-etiketten verkligen sa dig, och vilket namn dina API-anrop ska använda nu.

Varför en modell jämförs med sig själv

Leverantörer brukar förhandsvisa en modell och sedan tyst införliva den i huvudnamnet; förhandsvisningslistan försvinner och ingen skriver om jämförelsen. Inception körde istället de två namnen sida vid sida under en vecka, och förhandsvisningsidentiteten dras tillbaka först nu – vilket är precis anledningen till att denna jämförelse har substans. Förhandsvisningen var den snabba vägen som Inception använde för att få ut sin diffusionssatsning till utvecklare. Den dök upp den 31 augusti med specifikationsbladet som nu är Mercury 2.5:s specifikationsblad: en diffusion-LLM (dLLM) som genererar och förfinar block av token parallellt istället för att avge en token i taget; ett påstått 1 107 token per sekund på standard-GPU:er; ett påstående om under 300 ms tid till första token; ett kontextfönster på 260 000 token med 65 536 token i utdata; justerbara resonemangsnivåer; inbyggt stöd för verktygsanvändning, parallella verktygsanrop och strukturerad utdata. Var och en av dessa siffror är Inceptions egna, och inget oberoende labb hade mätt modellen när förhandsvisningen släpptes.

Den 8 september lanserade Inception Mercury 2.5 som "nästa intelligensnivå för diffusion-LLM:er" och sin snabbaste resonerande modell i produktion – företagsredo, riktad mot röstagenter, kodningssubagenter, företagssökning och supportbelastningar. Samma specifikationer, samma positionering, samma prislista. Lanseringen förhandsvisade också två syskonmodeller som klargör vart Inception är på väg: Mercury Voice, en dLLM anpassad för en första token på under 170 ms för röstagenter, och Mercury Router, som dirigerar prompter mellan modeller efter kvalitet, hastighet och kostnad. Mercury 2.5 är flaggskeppet i en familj byggd för latenskänsliga, agentiska arbetsbelastningar snarare än för frontierkvalitetsnivån.

Vad lanseringen den 8 september faktiskt förändrade

Jämför de två namnen rad för rad och skillnaden är inte motorn — det är allt som är inlindat runt motorn:

Status — Mercury 2.5 Preview: en stängd förhandsvisning som kan "ändra beteende eller tillgänglighet." Mercury 2.5: en produktionsmodell lanserad med ett företagsklart åtagande, en försäljningskanal och en daterad produktionslistning.

Identitet — Inceptions modellsida listar nu Mercury 2.5, Mercury Voice och Mercury Router, utan någon Preview i sikte, och dess supportfotnot anger Mercury 1, Mercury 2 och Mercury Edit 2 som de modeller som ”fortfarande stöds för befintliga kunder.” Preview förekommer inte i någon av listorna. Enligt leverantören har preview-etiketten uppgått i Mercury 2.5.

Slutpunkt — Inceptions utvecklarplattform serverar modellen som mercury-2.5, och produktionslistningen som gick live den 8 september är där ny trafik betjänas. I katalogen som först innehöll Preview i slutet av augusti, pekar Preview-namnet nu inte mot någon aktiv slutpunkt medan Mercury 2.5-listan som lades till den 8 september svarar. Alla som kodat mot Preview med namn bör omdirigera till Mercury 2.5 och bekräfta vad deras leverantör faktiskt debiterar — det ID:t du integrerade i vecka ett är det som håller på att fasas ut.

Pris — identisk lista och identisk rabatt. Båda kostar $0.20 per miljon inmatning och $0.75 per miljon utmatning, med cachad inmatning till $0.02, och båda lanserades med cirka 80% rabatt: $0.04 / $0.15, cachad $0.004. Previews rabatt var uttryckligen tidsbegränsad till 8 september; Mercury 2.5 lanserades med samma 80%-erbjudande, och det rabatterade priset är vad dess produktlistning fortfarande visar vid skrivande stund. Det är fällan, förklarad nedan.

Onboarding — produktionslanseringen lade till en gratis token-tilldelning för nya utvecklarkonton — lanseringsmaterialet anger 100 miljoner tokens — och öppnade en kontaktväg för företag som en förhandsversion aldrig hade.

Bevis — oförändrat. Inget av namnen har ett oberoende riktmärke, och leverantörens påståenden är samma påståenden med något annorlunda formuleringar: ett "mer än 10 poängs" intelligenshopp över Mercury 2 i förhandsmaterialet blir en "40-procentig" ökning i lanseringsmaterialet, tillsammans med samma angivna paritet med den kostnadsoptimerade frontier-nivån (GPT-5.6 Luna i lågansträngningsläge, Gemini 3.5 Flash-Lite, Claude Haiku 4.5) och samma leverantörsrapporterade 79% på GPQA Diamond och 77% på IFBench. Ett omformulerat påstående är inte ett verifierat påstående.

A two-column comparison card titled 'Mercury 2.5 Preview vs Mercury 2.5 — what actually changed'. Left column 'Mercury 2.5 Preview, released Aug 31, 2026': Release Aug 31, 2026; Status closed preview; Engine diffusion dLLM, 260K ctx; Serving preview id retired from the catalog; Price $0.20/$0.75 list, 80% off intro; Evidence none independent. Right column 'Mercury 2.5, released Sep 8, 2026': Release Sep 8, 2026; Status production, enterprise-ready; Engine same, no new checkpoint disclosed; Serving mercury-2.5 id live, serving traffic; Price $0.20/$0.75 list, 80% off launch; Evidence none independent. Footer reads 'Same engine under two labels — the delta is lifecycle, not spec. All figures vendor-reported.' The OrcaRouter logo is in the bottom-right corner.

Prisfällan i hjärtat av parningen

Eftersom de två namnen har samma listpris och samma 80-procentiga lockerbjudande är det lätt att anta att de alltid kostar lika mycket. Det behöver de inte. Previews rabatt hade ett hårt stopp den 8 september; Mercury 2.5:s introduktionsrabatt löper på en ny klocka. Under en vecka var det fullt möjligt att betala $0,20 / $0,75 för ett samtal till Preview medan samma motor svarade för $0,04 / $0,15 under sitt produktionsnamn — eller, mer sannolikt, att vara på ett preview-id som tyst hade slutat svara medan fakturan fortsatte att komma. En introduktionsrabatt som löper ut per slutpunkt är precis ett sådant finstilt villkor som förvandlar en historia om "samma modell, samma pris" till en verklig prisskillnad.

Det hållbara priset är listpriset, och den hållbara rekommendationen är att budgetera utifrån det: 0,20 $ / 0,75 $ per miljon, cachad input 0,02 $ – billigt för en resonemangsmodell med 260K kontext, bekvämt under flaggskeppsnivån, men inte de 0,04 $ / 0,15 $ som lanseringsbanderollerna annonserar. Betrakta det rabatterade priset som ett provkörningspris med begränsad livslängd, verifiera vad din leverantör fakturerar för exakt modell-id i din kod snarare än för namnet på marknadsföringssidan, och om du började på Preview, migrera till Mercury 2.5 innan ett utgångsdatum eller en pensionerad slutpunkt bestämmer åt dig.

Detta är också den typ av problem som ett routningslager finns för att eliminera. En modellrouter som förmedlar leverantörernas listpriser med 0% påslag visar priset som en leverantör faktiskt debiterar, uppdaterat samma dag som en lanseringsrabatt införs eller upphör, och automatisk failover håller samtalen igång när en endpoint tas ur drift under dig. Mercury 2.5 finns inte på OrcaRouter i skrivande stund — Inception erbjuder den via sitt eget API och flera tredjepartsplattformar — så för närvarande är leverantörens modellsida den auktoritativa källan för priset. Så snart en leverantör listar den, är det dessa vidarebefordringsmekanismer du får på en enda nyckel, och en prissänkning eller ett rabattslut dyker upp hos oss samma dag som det tillkännages.

Det bevisproblem som båda namnen delar.

Det ärliga resultatkortet för denna jämförelse är kort, eftersom de två kolumnerna är samma modell med samma frånvaro av bevis. Varken Mercury 2.5 eller Mercury 2.5 Preview har ett oberoende indexresultat, en reproducerad körning eller en arenaplacering per den 9 september 2026. Inceptions egna påståenden – intelligenshoppet jämfört med Mercury 2, pariteten med Haiku 4.5-nivån, 79% GPQA Diamond, 1 107 tokens per sekund – är företagets ord, och de är identiska för båda namnen eftersom modellen är identisk.

Det enda oberoende beviset i familjen pekar på hur hastighetspåståendet ska tolkas. Artificial Analysis mätte Mercury 2, föregångaren, till 684 tokens per sekund på produktionsändpunkten, vilket gav den 22 på Intelligence Index — verkligen snabb och ett bevis för att diffusionsansatsen inte är en hägring, men långt ifrån de cirka 1 000 tokens per sekund som Inception annonserar för modellen på Blackwell-hårdvara. Förvänta dig en liknande skillnad mellan Mercury 2.5:s siffra på 1 107 och vad en delad fleranvändarändpunkt faktiskt levererar under verklig belastning. Samma försiktighet gäller kvalitet: en helt ny diffusionsmodell som bara mätts av sin tillverkare ska inte tas på orden när det gäller att matcha Claude Haiku 4.5 förrän en tredje part har kört den.

A screenshot of the Artificial Analysis model page for Inception's Mercury 2, the predecessor Mercury 2.5 builds on, showing its Intelligence Index score of 22, its independently measured output speed of 684 tokens per second, its $0.25 input / $0.75 output pricing, and its 128K context window.

Tracker som börjat täcka releasen återspeglar exakt detta läge. En BenchLM-post för Mercury 2.5, publicerad den 8 september, ger modellen varken offentligt resultat eller offentlig rankning; den bär Inceptions 79% GPQA Diamond och 77% IFBench-siffror, uttryckligen märkta som leverantörsrapporterade, och noterar att oberoende körtidshastighet inte har uppmätts. Den första Artificial Analysis indexposten, en LMArena-placering eller en reproducerad GPQA-körning kommer att förvandla Mercury 2.5 från ett påstående till ett jämförbart objekt – och det kommer att gälla båda namnen samtidigt, eftersom det bara finns en modell att mäta.

A screenshot of the BenchLM model record for Mercury 2.5 (captured September 9, 2026), showing 'No public score yet' and 'No public rank', the model noted as released September 8, 2026 with a 260K context window, and the decision note that Inception reports 79% on GPQA Diamond and 77% on IFBench as provider-reported results with independent runtime speed not yet measured.

Vilket namn ska du kalla

Ny integration, utan legacy: anropa Mercury 2.5 och ignorera Preview. Produktionsnamnet har samma motor, samma rabatt för närvarande, företagsvillkoren och garantin att det är det id som leverantören faktiskt serverar. Preview tillför bara instabilitetsrisk och inget annat.

Redan integrerat Preview:Kontrollera idag vad din leverantör tillhandahåller under det namnet och vad den fakturerar för det. Peka om din klient mot Mercury 2.5 id och bekräfta priset. Att behålla namnet Preview i produktionskoden är nu ett vad om att en uttryckligen tidsbegränsad förhandsvisningskanal överlever sin egen pensionering.

Enterprise- eller produktionskritisk trafik:Mercury 2.5 via Inceptions enterpriseväg, inte en förhandsversion som saknar åtagande. Röst- och routingbehov pekar på Mercury Voice respektive Mercury Router, vilka fortfarande är förhandsversioner.

Alla som utvärderar diffusionsnivån: båda namnen är samma utvärderingsobjekt, så kör din utvärdering mot Mercury 2.5 en gång och behandla resultatet som gällande för modellinjen. Budgetera till listpris och väg leverantörens påståenden som hypoteser tills ett oberoende resultat landar.

Vad du ska titta på

Tre saker kommer att avgöra detta par under de kommande veckorna. För det första, det första oberoende riktmärket — en indexplacering eller en reproducerad GPQA- eller AIME-körning — som kommer att testa paritetspåståendet som är hela den kommersiella satsningen. För det andra, huruvida Preview-identiteten försvinner helt från modellekosystemet, vilket Inceptions egen modellsida redan antyder. För det tredje, vad som händer med lanseringsrabatten på 80 % nu när den 8 september-milstolpe som Preview var knuten till har passerats: en förlängning gör Mercury 2.5 strukturellt billig, medan en återgång till 0,20 $ / 0,75 $ gör den enbart konkurrenskraftig. Till dess är det korrekta svaret på "Mercury 2.5 eller Mercury 2.5 Preview?" att det är en enda modell, och du bör anropa den som fortfarande är en produkt.