Een hero-titelkaart voor 'Mercury 2.5 Preview vs Gemini 3.1 Pro' met de ondertitel 'Twee previews, zes maanden uit elkaar'. Het linkerpaneel, gelabeld 'Mercury 2.5 Preview', toont een bliksemschicht, een '256K context'-pill, een 'alleen tekst'-tag en een '$0.04 intro'-pill; het rechterpaneel, gelabeld 'Gemini 3.1 Pro', toont een multimodale glyphset (afbeelding, audio, video), een '1M context'-pill, een 'AA Index 57 bij lancering'-badge en een '$2.00 / $12.00'-pill. Een dunne 'vs'-badge zit ertussen. Het OrcaRouter-logo is rechtsonder gecomponeerd.
Guides & Insights

Mercury 2.5 Preview vs Gemini 3.1 Pro: Twee previews, zes maanden uit elkaar

Auteur

Rowan Sterling

Publicatiedatum

Nieuwste modellen · 20Bekijk alle modellen
Benchmarks: Artificial Analysis · dagelijks bijgewerkt
Terug naar alle berichten

Beide modellen in deze vergelijking dragen het woord 'preview' in hun namen, en daarmee houdt de gelijkenis op. Mercury 2.5 Preview en Gemini 3.1 Pro zijn beide redeneermodellen die je vandaag via een API kunt aanroepen, maar ze zijn previews aan tegenovergestelde uiteinden van hun levensduur. Gemini 3.1 Pro, het vlaggenschip-redeneermodel, is sinds 19 februari 2026 in preview — zes maanden aan onafhankelijke evaluaties, noteringen op openbare ranglijsten en productieverkeer achter de rug, met een Artificial Analysis Intelligence Index van 57 bij de lancering, multimodale invoer voor tekst, beeld, audio en video, een context van 1M tokens en een prijs van $2,00 / $12,00 per miljoen tokens. Mercury 2.5 Preview, de diffusie-LLM van Inception die op 31 augustus 2026 werd uitgebracht, is twee dagen oud: een tekst-only model met een context van 256K, een geclaimde 1.107 tokens per seconde, een adviesprijs van $0,20 / $0,75 (ongeveer $0,04 / $0,15 met korting tot en met 8 september), en geen enkele onafhankelijke benchmark. Ze allebei 'previews' noemen verbergt de werkelijke vraag, namelijk hoeveel een voorsprong van zes maanden aan bewijs waard is ten opzichte van een fundamenteel snellere manier om tekst te genereren.

Wat elk model daadwerkelijk is

Gemini 3.1 Pro is een gesloten, multimodaal vlaggenschip voor algemene redenering. Het leest tekst, afbeeldingen, audio en video, verwerkt een contextvenster van 1M tokens met een uitvoerplafond van 64K en past zijn redeneringsdiepte dynamisch aan — de leverancier beschrijft een redeneringsintensiteit met vier niveaus die meeschaalt met de taakcomplexiteit. De lanceringscijfers — ARC-AGI-2 op 77,1%, GPQA Diamond op 94,3%, SWE-bench Verified op 80,6%, Terminal-Bench 2.0 op 68,5% — zijn door de leverancier gerapporteerd, maar ze steunen op zes maanden onafhankelijke toetsing, waaronder een hermeting door Artificial Analysis op een strengere indexschaal waarop het model rond de 46,5 scoort. Die hermeting is precies wat een volwassen model verdient: het is zwaar genoeg getest om de index eromheen strenger te maken. Mercury 2.5 Preview is een diffusiemodel — het genereert en verfijnt tokens parallel in plaats van één voor één — met instelbare redenering, parallelle toolcalls en schema-uitgelijnde JSON, gebouwd voor de latentie-accumulerende workloads die Inception benoemt: zoekagenten, spraakpijplijnen, codeersubagenten. Elke kwaliteitsclaim die eraan wordt gekoppeld, waaronder een sprong van meer dan 10 punten ten opzichte van Mercury 2, is van de leverancier zelf, en geen enkele derde partij heeft het gemeten.

A screenshot of the Artificial Analysis model page for Inception's Mercury 2, the diffusion model Mercury 2.5 Preview builds on, showing its independently measured output speed of 684 tokens per second, its $0.25 / $0.75 per-1M pricing, its 128K context window, and its Intelligence Index score of 22.

Het specificatiecontrast

Prijs — Mercury 2.5 Preview: $0.20 / $0.75 per 1M in/out, ~$0.04 / $0.15 intro tot en met 8 september. Gemini 3.1 Pro: $2.00 / $12.00 per 1M, oplopend tot $4.00 / $18.00 bij meer dan 200K invoer.

Context / output — Mercury 2.5 Preview: 256K context. Gemini 3.1 Pro: 1M context, 64K maximale output.

Invoer — Mercury 2.5 Preview: alleen tekst. Gemini 3.1 Pro: tekst, afbeelding, audio, video, bestand.

Architectuur — Mercury 2.5 Preview: diffusie-LLM, parallelle tokengeneratie. Gemini 3.1 Pro: autoregressief, dynamische redeneerdiepte.

Snelheid — Mercury 2.5 Preview: claimt 1.107 tokens/sec. Gemini 3.1 Pro: geen vergelijkbare opvallende claim.

Bewijs — Mercury 2.5 Preview: alleen door leverancier gerapporteerd. Gemini 3.1 Pro: AA-index 57 bij lancering (46.5 nieuwere schaal) plus een uitgebreid onafhankelijk evaluatiedossier.

A two-column scoreboard titled 'Mercury 2.5 Preview vs Gemini 3.1 Pro — the scoreboard'. Left column 'Mercury 2.5 Preview': 'Price: $0.20 / $0.75 (intro $0.04 / $0.15)', 'Inputs: text only', 'Context: 256K', 'Speed: 1,107 tok/s (claimed)', 'Independent score: none yet', 'Preview since: Aug 31, 2026'. Right column 'Gemini 3.1 Pro': 'Price: $2.00 / $12.00', 'Inputs: text, image, audio, video', 'Context: 1M', 'Speed: autoregressive', 'Independent score: AA Index 57 at launch', 'Preview since: Feb 19, 2026'. A footer reads 'Gemini index per Artificial Analysis; Mercury figures vendor-reported.' The OrcaRouter logo is composited in the bottom-right corner.

De multimodaliteitskloof is het beslissende verschil.

Voor de meeste toepassingen wordt deze vergelijking al beslist voordat prijzen of benchmarks ter sprake komen, omdat Mercury 2.5 Preview niets kan zien. Gemini 3.1 Pro leest schermafbeeldingen, diagrammen, audio en video — het is het model waar je een pdf, een grafiek, een opname van een vergadering of een gebruikersinterface naartoe wijst als je een antwoord wilt over iets dat niet al tekst is. Mercury 2.5 Preview is bewust alleen-tekst; een diffusietaalmodel dat tekst parallel genereert, heeft helemaal geen invoerpad voor beeld of audio. Voor een toepassing die zwaar op documenten leunt, een visie-agent of elk multimodaal product is Gemini 3.1 Pro hier de enige kandidaat, punt uit. De alleen-tekst-beperking van Mercury 2.5 Preview is geen kleine lettertjes-voorbehoud; het is de grens die bepaalt voor welke workloads het model überhaupt in aanmerking komt.

Zes maanden testen versus twee dagen

Op basis van bewijs is dit geen wedstrijd, en het is belangrijk om duidelijk te zeggen waarom. Gemini 3.1 Pro wordt al zes maanden door onafhankelijke laboratoria uit elkaar gehaald; de score is vastgesteld, opnieuw gemeten en bediscussieerd, en dat is wat 'betrouwbaar' betekent voor een model. Mercury 2.5 Preview heeft één bron van informatie — de maker — en die bron claimt een intelligentiesprong van meer dan 10 punten ten opzichte van Mercury 2 en gelijkwaardigheid met de kostgeoptimaliseerde laag van de frontier. Beide uitspraken kunnen waar zijn. Geen van beide is bevestigd door iemand buiten Inception, en het model is te nieuw om iets anders te verwachten. De asymmetrie is niet dat de ene beter is; het is dat de ene kenbaar is en de andere nog niet.

Waar de snelheid van Mercurius daadwerkelijk wint

Het eerlijke pleidooi voor Mercury 2.5 Preview is smal, uitsluitend tekst en echt. Parallelle tokengeneratie verandert de latentie-rekensom op een manier die geen enkel autoregressief model — inclusief Gemini 3.1 Pro — kan volgen, omdat een autoregressief model per definitie serieel is. Voor een voice-pipeline is de ironie dat de invoer en uitvoer audio zijn, maar het denken daartussen is tekst: een snelle tekstredeneringslaag is precies wat een voice-agent responsief laat aanvoelen. Voor een zoekagent die herhaaldelijk toolaanroepen doet, en voor een codeer-subagent die per taak veel kleine completions afvuurt, stapelt de latentie per aanroep zich op tot waargenomen snelheid. Tegen de introductieprijs — $0,04 in, $0,15 uit — is Mercury 2.5 Preview ruwweg 80 keer goedkoper dan het standaarduitvoertarief van Gemini 3.1 Pro, waardoor het niet alleen sneller is, maar ook een andere kostenklasse vertegenwoordigt voor tekstredenering op grote schaal. De kanttekening die met elk van die zinnen moet meereizen: de snelheid wordt geclaimd, de kwaliteitspariteit wordt geclaimd, en er bestaat geen onafhankelijke meting.

Prijsstelling: Gemini's premium voor lange context versus Mercury's teaser

De prijslijst van Gemini 3.1 Pro bevat een detail dat de moeite waard is om te weten voordat je de kopcijfers vergelijkt: verzoeken die meer dan 200K invoertokens verwerken, gaan van $2.00 / $12.00 naar $4.00 / $18.00 per miljoen. Bij een model met een 1M-context is die long-context-premie geen randgeval — het is de prijs voor het daadwerkelijk gebruiken van het venster waar het model bekend om staat. Mercury 2.5 Preview kent zo'n stap niet, en de 256K-context zal waarschijnlijk niet vaak in het long-context-gebied terechtkomen. Maar Mercury's lage prijs is een lokkertje met een vervaldatum van 8 september, terwijl die van Gemini een stabiel gepubliceerd tarief is. Vergelijk bij het vergelijken Mercury's catalogusprijs van $0.20 / $0.75 met Gemini's standaardniveau, niet het kortingsbedrag — de korting is de stimulans om te testen, niet de prijs om mee te plannen.

De routeringsbeslissing

Beide modellen zijn vandaag routeerbaar, en dat verandert hoe je elk model zou moeten behandelen. Gemini 3.1 Pro staat op OrcaRouter als google/gemini-3.1-pro-preview, tegen de lijstprijs van de provider, doorberekend tegen 0% opslag, dus de standaard- en lange-context-tiers kosten exact wat de provider publiceert, naast 200+ andere modellen op één API-sleutel. Een preview-badge is precies het soort ding dat je moet omzeilen in plaats van erop te wedden — het foutpercentagepaneel van de modelpagina is er niet voor niets, en automatische failover betekent dat een verslechterde preview-reactie naar een tweede provider wordt gerouteerd zonder codeaanpassing. Mercury 2.5 Preview staat nog niet op OrcaRouter; Inception levert het via zijn eigen API en verschillende platforms van derden. Een model van twee dagen oud dat je nog niet achter failover kunt zetten, is een testkandidaat, geen productieafhankelijkheid. De dag dat een provider het vermeldt, geldt dezelfde doorberekening en verschijnt de introductiekorting dezelfde dag — dat is wanneer deze vergelijking een routeringsregel wordt in plaats van een beslissing.

Het eerlijke oordeel is dat deze twee previews verschillende vragen beantwoorden. Gemini 3.1 Pro beantwoordt "op welk model moet ik mijn product vandaag bouwen?" — het is multimodaal, heeft een lange context, is onafhankelijk getest en stabiel, tegen een prijs die dat allemaal weerspiegelt. Mercury 2.5 Preview beantwoordt "hoe snel kan tekstredenering fysiek gaan?" — en de snelheidsarchitectuur ervan is het interessantste aan het model, in afwachting van een onafhankelijk lab dat bevestigt of de kwaliteit die ermee gepaard gaat echt is. Als je workload multimodaal is of een lange context vereist, is de keuze al gemaakt. Als het alleen om tekst gaat, de latentie zich opstapelt en de prijs een gevoelige factor is, is Mercury 2.5 Preview de weddenschap om in de gaten te houden — en 8 september is de datum waartegen je hem kunt afzetten.

A screenshot of the OrcaRouter model page for Gemini 3.1 Pro Preview (google/gemini-3.1-pro-preview) showing the model header, the Home > Models > Google breadcrumb, the February 19, 2026 preview start date, and the description of Google's frontier reasoning model.
© 2026 OrcaRouter

Voor aanbieders

Beheer je een inferentieplatform? Zet je modellen op OrcaRouter.

providers@orcarouter.ai

Word lid van de community

Discordsupport@orcarouter.aiXGitHubYouTube