'Titelkaart voor 'Mercury 2.5 vs Mercury 2.5 Preview' met de ondertitel 'Eén diffusiemodel, twee releasedatums — wat de productie-upgrade daadwerkelijk verandert'. Daaronder drie chips: een kolomsplitsing-pictogram gelabeld 'SELFDE ENGINE', een bliksemschicht-pictogram gelabeld '1.107 tok/s CLAIM', en een klok-pictogram gelabeld '31 AUG vs 8 SEP'. Het OrcaRouter-logo staat in de rechteronderhoek.'
Guides & Insights

Mercury 2.5 versus Mercury 2.5 Preview: Eén diffusiemodel, twee releasedata

Auteur

Alistair Wren

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Hier is een rechtstreekse vergelijking waarin beide kanshebbers dezelfde modelkaart delen. Inception's Mercury 2.5 Preview, uitgebracht op 31 augustus 2026, en Mercury 2.5, uitgebracht op 8 september 2026, zijn hetzelfde diffusietaalmodel met acht dagen verschil: een previewkanaal dat Inception voor ontwikkelaars opende, en de "enterprise-ready" productieversie die een week later werd gelanceerd. Inception heeft voor Mercury 2.5 geen ander checkpoint, geen andere snelheid en geen andere prijs bekendgemaakt — en de cijfers die wél verschilden tussen de twee aankondigingen lijken een opruiming, geen nieuw model. Het contextgetal werd gecorrigeerd van 256K op de previewpagina naar 260K bij de lancering, en de intelligentiewinst ten opzichte van Mercury 2 werd geherformuleerd van "meer dan 10 punten" (previewmateriaal) naar "40 procent" (lanceringsmateriaal). De engine, de claim van 1.107 tokens per seconde en de prijslijst zijn identiek. Dit is dus niet de gebruikelijke specs-vergelijking, en één daarvan opvullen zou oneerlijk zijn. De vergelijking die bij deze twee namen telt, gaat over verpakking en timing: wat de productielancering daadwerkelijk veranderde, wat het Preview-label je echt vertelde, en welke naam je API-aanroepen nu zouden moeten gebruiken.

Waarom een model met zichzelf wordt vergeleken

Leveranciers tonen meestal eerst een preview van een model en vouwen het daarna stil in de hoofdnaam; de preview-listing verdwijnt en niemand schrijft over de onderlinge vergelijking. Inception hield de twee namen daarentegen een week lang naast elkaar, en pas nu wordt de preview-identiteit uitgefaseerd — precies daarom heeft deze vergelijking inhoud. De Preview was het snelle pad dat Inception gebruikte om zijn diffusie-inzet onder de aandacht van ontwikkelaars te brengen. Hij verscheen op 31 augustus met de specificaties die nu die van Mercury 2.5 zijn: een diffusie-LLM (dLLM) die blokken tokens parallel genereert en verfijnt in plaats van één token tegelijk uit te voeren; een geclaimde 1.107 tokens per seconde op standaard-GPU's; een geclaimde tijd-tot-eerste-token van minder dan 300 ms; een contextvenster van 260K tokens met een output van 65.536 tokens; instelbare redeneerniveaus; native toolgebruik, parallelle toolcalls en gestructureerde output. Al die cijfers zijn afkomstig van Inception zelf, en geen onafhankelijk lab had het model gemeten toen de Preview uitkwam.

Op 8 september lanceerde Inception Mercury 2.5 als "de volgende laag van intelligentie voor diffusie-LLM's" en zijn snelste redeneermodel in productie — enterprise-ready, gericht op stemagenten, coderingssubagenten, enterprise search en supportworkloads. Dezelfde specs, dezelfde positionering, dezelfde prijslijst. De lancering gaf ook een voorproefje van twee zustermodellen die verduidelijken waar Inception naartoe gaat: Mercury Voice, een dLLM die is afgestemd op een eerste tokenrespons van minder dan 170 ms voor stemagenten, en Mercury Router, dat prompts over modellen routeert op basis van kwaliteit, snelheid en kosten. Mercury 2.5 is het vlaggenschip van een familie die is gebouwd voor latentiegevoelige, agentische workloads in plaats van voor de frontier-kwaliteitstier.

Wat de lancering van 8 september daadwerkelijk veranderde

Vergelijk de twee namen regel voor regel en het verschil is niet de motor — het is alles wat om de motor heen zit:

Status — Mercury 2.5 Preview: een gesloten preview die "gedrag of beschikbaarheid kan wijzigen." Mercury 2.5: een productiemodel gelanceerd met een enterprise-ready toewijding, een verkoopkanaal en een gedateerde productielijst.

Identiteit — De modellenpagina van Inception toont nu Mercury 2.5, Mercury Voice en Mercury Router, zonder Preview in zicht, en in de voetnoot over ondersteuning worden Mercury 1, Mercury 2 en Mercury Edit 2 genoemd als de modellen die "ondersteund blijven voor bestaande klanten". De Preview staat in geen van beide lijsten. Wat de leverancier betreft is het preview-label opgenomen in Mercury 2.5.

Endpoint — Het ontwikkelaarsplatform van Inception serveert het model als mercury-2.5, en de productievermelding die op 8 september live ging, is waar nieuw verkeer wordt bediend. In de catalogus die eind augustus als eerste de Preview bevatte, verwijst de naam Preview nu niet meer naar een actief endpoint, terwijl de Mercury 2.5-vermelding die op 8 september is toegevoegd wél verzoeken beantwoordt. Als je in je code de naam Preview hebt gebruikt, moet je overschakelen naar Mercury 2.5 en controleren wat je provider daadwerkelijk in rekening brengt — het id dat je in de eerste week hebt geïntegreerd, is het id dat wordt uitgefaseerd.

Prijs — identieke prijslijst en identieke korting. Beide kosten $0.20 per miljoen invoer en $0.75 per miljoen uitvoer, met cache-invoer op $0.02, en beide lanceerden met ongeveer 80% korting: $0.04 / $0.15, cache-invoer $0.004. De Preview-korting was expliciet in tijd beperkt tot 8 september; Mercury 2.5 lanceerde met dezelfde 80%-aanbieding, en het gereduceerde tarief is wat de productielijst op het moment van schrijven nog steeds toont. Dat is de valstrik, hieronder uit de doeken gedaan.

Onboarding — de productielancering voegde een gratis token-tegoed voor nieuwe ontwikkelaarsaccounts toe — het lanceermateriaal vermeldt 100 miljoen tokens — en opende een enterprise-contactpad dat een preview nooit had.

Bewijs — ongewijzigd. Geen van beide namen beschikt over een onafhankelijke benchmark, en de beweringen van de leverancier zijn dezelfde beweringen in een iets andere bewoording: een intelligentiesprong van “meer dan 10 punten” ten opzichte van Mercury 2 in het previewmateriaal wordt een toename van “40 procent” in het lanceringsmateriaal, naast dezelfde vermelde gelijkwaardigheid met het kosten-geoptimaliseerde frontier-niveau (GPT-5.6 Luna in low-effort-modus, Gemini 3.5 Flash-Lite, Claude Haiku 4.5) en dezelfde door de leverancier gerapporteerde 79% op GPQA Diamond en 77% op IFBench. Een bewering herhalen is niet hetzelfde als haar verifiëren.

A two-column comparison card titled 'Mercury 2.5 Preview vs Mercury 2.5 — what actually changed'. Left column 'Mercury 2.5 Preview, released Aug 31, 2026': Release Aug 31, 2026; Status closed preview; Engine diffusion dLLM, 260K ctx; Serving preview id retired from the catalog; Price $0.20/$0.75 list, 80% off intro; Evidence none independent. Right column 'Mercury 2.5, released Sep 8, 2026': Release Sep 8, 2026; Status production, enterprise-ready; Engine same, no new checkpoint disclosed; Serving mercury-2.5 id live, serving traffic; Price $0.20/$0.75 list, 80% off launch; Evidence none independent. Footer reads 'Same engine under two labels — the delta is lifecycle, not spec. All figures vendor-reported.' The OrcaRouter logo is in the bottom-right corner.

De prijsvalkuil in het hart van de koppeling

Omdat de twee namen dezelfde lijstprijs en dezelfde 80%-lokker hebben, is het verleidelijk om aan te nemen dat ze altijd evenveel kosten. Dat hoeft niet. De korting van de Preview had op 8 september een harde einddatum; voor de lanceerkorting van Mercury 2.5 is de klok opnieuw gestart. Een week lang was het heel goed mogelijk dat je voor een aanroep van de Preview $0.20 / $0.75 betaalde, terwijl het gebruik van dezelfde engine onder zijn productienaam $0.04 / $0.15 kostte — of, waarschijnlijker, dat je een preview-id gebruikte dat stilletjes was gestopt met het beantwoorden van verzoeken, terwijl de rekening gewoon bleef binnenkomen. Een lanceerkorting die per endpoint vervalt, is precies het soort kleine lettertjes dat een verhaal over "hetzelfde model, dezelfde prijs" omtovert tot een echt kostenverschil.

Het blijvende getal is de lijstprijs, en het blijvende advies is om daarop te budgetteren: $0,20 / $0,75 per miljoen, gecachende invoer $0,02 — goedkoop voor een redeneermodel met een 260K-context, ruim onder de topcategorie, maar niet de $0,04 / $0,15 waarmee de lanceringsbanners adverteren. Zie het gereduceerde tarief als een proefprijs met een beperkte houdbaarheid, verifieer wat jouw provider factureert voor de exacte model-id in jouw code in plaats van voor de naam op de marketingpagina, en als je via de Preview bent ingestapt, migreer dan naar Mercury 2.5 voordat een vervaldatum of een uitgefaseerd endpoint voor jou beslist.

Dit is ook het soort probleem dat een routinglaag hoort weg te nemen. Een modelrouter die de lijstprijzen van providers doorgeeft met 0% opslag, toont de prijs die een leverancier daadwerkelijk factureert, bijgewerkt op dezelfde dag dat een introductiekorting ingaat of afloopt, en automatische failover zorgt ervoor dat aanroepen blijven lopen wanneer een endpoint onder je wordt uitgefaseerd. Mercury 2.5 staat op het moment van schrijven niet op OrcaRouter — Inception levert het via een eigen API en verschillende platforms van derden — dus voorlopig is de modellenpagina van de leverancier de bron van waarheid voor het tarief. Zodra een provider het aanbiedt, krijg je met één sleutel die doorgeefmechanismen, en een prijsverlaging of het aflopen van een korting verschijnt bij ons op dezelfde dag als die wordt aangekondigd.

Het bewijsprobleem dat beide namen delen.

De eerlijke scorekaart voor deze combinatie is kort, omdat de twee kolommen hetzelfde model zijn met hetzelfde gebrek aan bewijs. Noch Mercury 2.5, noch Mercury 2.5 Preview heeft een onafhankelijke indexscore, een gereproduceerde run of een arena-plaatsing per 9 september 2026. Inceptions eigen beweringen — de intelligentiesprong ten opzichte van Mercury 2, de gelijkwaardigheid met het Haiku 4.5-niveau, de 79% GPQA Diamond, de 1.107 tokens per seconde — zijn het woord van het bedrijf, en ze zijn identiek voor beide namen omdat het model identiek is.

Het enige onafhankelijke bewijs in de familie wijst erop hoe de snelheidsclaim gelezen moet worden. Artificial Analysis mat Mercury 2, de voorganger, op 684 tokens per seconde op het productie-endpoint, met een score van 22 op de Intelligence Index — werkelijk snel en het bewijs dat de diffusieaanpak geen luchtspiegeling is, maar het blijft ver onder de ruwweg 1.000 tokens per seconde die Inception voor dat model op Blackwell-hardware adverteert. Verwacht een vergelijkbare kloof tussen het cijfer van 1.107 voor Mercury 2.5 en wat een gedeeld multi-tenant endpoint onder reële belasting daadwerkelijk levert. Dezelfde terughoudendheid geldt voor kwaliteit: een gloednieuw diffusiemodel dat alleen door de maker is gemeten, moet niet op zijn woord worden geloofd dat het Claude Haiku 4.5 evenaart, totdat een derde partij het heeft getest.

A screenshot of the Artificial Analysis model page for Inception's Mercury 2, the predecessor Mercury 2.5 builds on, showing its Intelligence Index score of 22, its independently measured output speed of 684 tokens per second, its $0.25 input / $0.75 output pricing, and its 128K context window.

De trackers die de release zijn gaan volgen, weerspiegelen precies die stand van zaken. Een BenchLM-record voor Mercury 2.5, gepost op 8 september, geeft het model geen openbare score en geen openbare rangschikking; het bevat de 79% GPQA Diamond- en 77% IFBench-cijfers van Inception, die expliciet als door de provider gerapporteerd zijn gelabeld, en merkt op dat de onafhankelijke runtime-snelheid niet is gemeten. De eerste Artificial Analysis-indexvermelding, een LMArena-plaatsing of een gereproduceerde GPQA-run zal Mercury 2.5 van een claim in een vergelijkbaar object veranderen — en dat zal tegelijk op beide namen van toepassing zijn, want er is maar één model om te meten.

A screenshot of the BenchLM model record for Mercury 2.5 (captured September 9, 2026), showing 'No public score yet' and 'No public rank', the model noted as released September 8, 2026 with a 260K context window, and the decision note that Inception reports 79% on GPQA Diamond and 77% on IFBench as provider-reported results with independent runtime speed not yet measured.

Welke naam zou je moeten noemen?

Nieuwe integratie, geen legacy: Roep Mercury 2.5 aan en negeer de Preview. De productienaam omvat dezelfde engine, voorlopig dezelfde korting, de enterprisevoorwaarden en de garantie dat het de id is die de leverancier daadwerkelijk serveert. De Preview voegt instabiliteitsrisico toe en niets anders.

Heb je de Preview al geïntegreerd? Controleer vandaag wat je provider onder die naam aanbiedt en wat hij daarvoor in rekening brengt. Wijs je client opnieuw naar de Mercury 2.5 id en bevestig het tarief. De naam Preview in productiecode laten staan is nu een gok dat een expliciet in de tijd beperkt previewkanaal zijn eigen uitfasering overleeft.

Enterprise- of productiekritiek verkeer:Mercury 2.5 via het enterprise-pad van Inception, niet via een preview-label zonder enige toezegging erachter. Spraak- en routeringsbehoeften worden respectievelijk bediend door Mercury Voice en Mercury Router, die zelf nog previews zijn.

Iedereen die de diffusietier evalueert: beide namen duiden hetzelfde evaluatiedoel aan, dus draai je eval één keer tegen Mercury 2.5 en behandel het resultaat als geldend voor de modellijn. Ga uit van de lijstprijs en weeg de beweringen van de leverancier als hypothesen totdat een onafhankelijke score binnenkomt.

Wat te kijken

Drie dingen zullen de komende weken de uitkomst van deze koppeling bepalen. Ten eerste: de eerste onafhankelijke benchmark — een plek op een index of een gereproduceerde GPQA- of AIME-run — die de pariteitsclaim toetst waarop de hele commerciële gok rust. Ten tweede: of de identiteit 'Preview' volledig uit het modelecosysteem verdwijnt, zoals de modellenpagina van Inception zelf al doet vermoeden. Ten derde: wat er gebeurt met de introductiekorting van 80% nu de mijlpaal van 8 september, waaraan de Preview was gekoppeld, is verstreken: een verlenging maakt Mercury 2.5 structureel goedkoop, terwijl een terugkeer naar $0,20 / $0,75 het slechts concurrerend maakt. Tot die tijd is het juiste antwoord op 'Mercury 2.5 of Mercury 2.5 Preview?' dat het één model is, en dat je degene moet aanroepen die nog steeds een product is.