
Nex-N2.5 Pro vs Gemini 3.1 Pro: een één dag oud open model versus een zeven maanden oude preview
- openaiNIEUWOpenAI: GPT-6 Astra2026-09-0455Intelligentie77Coderen
- googleNIEUWGoogle: Gemini 3.8 Flash2026-09-0247Intelligentie76Coderen
- qwenNIEUWQwen: Qwen3.8 Max (0902)2026-09-0247Intelligentie72Coderen
- anthropicNIEUWAnthropic: Claude Fable 5.12026-09-0157Intelligentie82Coderen
- AlibabaNIEUWQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiNIEUWZ.ai: GLM 5.3 Flash2026-08-2646Intelligentie72Coderen
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 per 1 mln tokens
- z-aiZ.ai: GLM 5.32026-08-1849Intelligentie75Coderen
- obsidianQwen3.8 27B2026-08-1541Intelligentie68Coderen
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1242Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1251Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0547Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0347Intelligentie72Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3141Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2454Intelligentie78Coderen
- googleGoogle: Gemini 3.6 Flash2026-07-2140Intelligentie69Coderen
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2128Intelligentie49Coderen
The strangest symmetry in this matchup is that both models are officially unfinished, and each side proves it in a way the other cannot. Gemini 3.1 Pro Preview, Google's closed multimodal flagship, has been in preview since February 19, 2026 — seven months, an eternity for a frontier model — and its maker has still not declared general availability. Nex-N2.5 Pro, the 397-billion-parameter computer-use model from the Nex-AGI open-model alliance, is one day old as of this writing and already answering traffic from free hosted endpoints — yet its Apache-2.0 weights are marked "coming soon" on Hugging Face, which makes it a different kind of unfinished. One is a finished product in every way except the vendor's willingness to say so. The other is an unfinished product in every way except the vendor's willingness to ship it.
Die twee vormen van onvolledigheid veranderen hoe elk getal hieronder gelezen moet worden. Gemini 3.1 Pro is Googles huidige vlaggenschip-reasoningmodel — multimodaal voor tekst, beeld, audio, video en bestanden, met een context van 1M tokens, een uitvoerlimiet van 65K, en een prijs van $2,00 per miljoen invoertokens en $12,00 per miljoen uitvoertokens die opschaalt zodra een verzoek de 200K invoertokens overschrijdt. Nex-N2.5 Pro is een sparse mixture-of-experts-model van in totaal 397B met ruwweg 17B actief, tekst-en-beeld erin, tekst eruit, met een context van 262.144 tokens en een vision-loop die is gebouwd voor het bedienen van computers en browsers. Ze bevinden zich in dezelfde prijsgerelateerde buurt van "premium agentisch model", verschillen over vrijwel al het andere van mening, en geen van beide heeft een leverancier die het afgeklaard wil noemen.
Het specificatieblad: twee multimodale 1M-klasse modellen
Leg de enveloppen naast elkaar:
• Status — Nex-N2.5 Pro: aangekondigd op 8 september 2026; gehoste endpoints live, gewichten in afwachting. Gemini 3.1 Pro: sinds 19 februari 2026 in preview, nog steeds niet GA.
• Omvang — Nex-N2.5 Pro: 397B totaal / ~17B actieve MoE, verder getraind vanuit de Qwen3.5-lijn. Gemini 3.1 Pro: aantal parameters niet bekendgemaakt.
• Modaliteit — Nex-N2.5 Pro: tekst en beeld in, tekst uit; vision is het feedbackkanaal voor computergebruik. Gemini 3.1 Pro: tekst, beeld, audio, video en bestandsinvoer, tekstuitvoer.
• Context / uitvoer — Nex-N2.5 Pro: context van 262.144 tokens, de gedocumenteerde serveerlengte. Gemini 3.1 Pro: context van 1M tokens, uitvoerlimiet van 65K.
• Redeneercontrole — Nex-N2.5 Pro: geen / medium (adaptief, standaard) / hoog. Gemini 3.1 Pro: instelbaar denkbudget; geen gedoe over een publiek "max"-niveau.
• Gewichten — Nex-N2.5 Pro: Apache-2.0, binnenkort. Gemini 3.1 Pro: gesloten.
• Prijs per 1M tokens — Nex-N2.5 Pro: gratis gehoste tier, geen catalogusprijs gepubliceerd. Gemini 3.1 Pro: $2.00 / $12.00, oplopend naar $4.00 / $18.00 boven 200K invoertokens, $0.20 voor gecachte invoer.
De twee specificatiebladen zijn het over weinig eens, behalve over "lange context, multimodaal, duur om te bouwen." De verschillen die ertoe doen zijn de 200K input-toeslag aan de Gemini-kant, de gratis maar niet-verifieerbare economie aan de Nex-kant, en het feit dat alleen Nex-N2.5 Pro is ontworpen rond het lezen van een scherm.

Twee verschillende manieren om onvoltooid te zijn.
Google: zeven maanden preview als productbeslissing
De previewstatus van Gemini 3.1 Pro is niet cosmetisch; het wordt steeds meer het belangrijkste feit over het model. De pre-GA-voorwaarden van Google staan productiegebruik toe, terwijl Google zich het recht voorbehoudt om het gedrag te wijzigen of het endpoint verouderd te verklaren — een reëel risico voor een team dat een vlaggenschip op het kritieke pad zet. De koers van het model heeft dat risico niet weggenomen: het werd in februari gelanceerd als het hoogst scorende model op de markt, met destijds een score van 57 op de Artificial Analysis Intelligence Index, en is sindsdien op een strengere indexschaal opnieuw gemeten op ongeveer 48, terwijl de beoogde opvolger, Gemini 3.5 Pro, van een aankondiging in mei naar herhaalde vertragingen en berichten over mogelijke annulering afgleed. Ondertussen bracht Google in augustus Gemini 3.7 Flash uit voor $0,75 / $3,75 en begin september Gemini 3.8 Flash, en de goedkopere Flash-lijn heeft het Pro-vlaggenschap op de onafhankelijke index inmiddels voorbijgestreefd. Wie vandaag Gemini 3.1 Pro adopteert, adopteert een vlaggenschip dat de leverancier in preview houdt, terwijl zijn goedkopere zustermodellen het voorbijstreven en zijn opvolger in het ongewisse is.
Nex-AGI: een dag van 'binnenkort beschikbaar' als leveringsstatus

De onvolledigheid van Nex-N2.5 Pro loopt in de tegenovergestelde richting: alles wordt geleverd behalve dat wat het echt zou maken. De gehoste endpoints zijn live en gratis, de OpenAI-compatibele aanroepen werken, en de modelkaart staat vol met benchmarkcijfers — OSWorld-2 op 56,4, Terminal-Bench 2.1 op 82,7, SWE-Bench Pro op 61,2, allemaal gemeten via de eigen NexCUA-harness van de alliantie. Volgens de alliantie zal deze als open source beschikbaar worden gesteld, maar dat is niet gebeurd. De gewichten zijn echter niet te downloaden, er is geen releasedatum aan de banner gekoppeld, en geen onafhankelijk laboratorium heeft het model gedraaid, omdat geen enkele daarvan dat kan. Waar Gemini 3.1 Pro meetbaar-maar-niet-gecommitteerd is, is Nex-N2.5 Pro gecommitteerd-maar-onmeetbaar. Beide situaties zouden een productieteam om verschillende redenen aan het denken moeten zetten.
Waar het onafhankelijke bewijs leeft
Het onafhankelijke trackrecord in deze vergelijking ligt bijna geheel aan één kant. Gemini 3.1 Pro heeft zes maanden publieke tests achter de rug: onafhankelijke laboratoria hebben het gebenchmarkt, productieteams hebben het zwaar belast, en het heeft een actuele score van rond de 48 op de Artificial Analysis Intelligence Index — bescheiden voor een vlaggenschip en de reden dat Googles goedkopere Flash-modellen het hebben ingehaald, maar wel een daadwerkelijke meting die door iemand anders dan de leverancier is uitgevoerd. Nex-N2.5 Pro heeft geen dergelijke vermelding. De enige scores zijn die van Nex-AGI zelf, op een testomgeving die het publiek niet heeft gezien. De vergelijking die ertoe doet, is dan ook niet "48 tegen niets" — het is "een model waarvan de zwakke punten gedocumenteerd zijn" versus "een model waarvan de sterke punten worden beweerd." Voor een werklast waarbij een fout antwoord duur is, is die asymmetrie vaak doorslaggevend, ongeacht de cijfers.
Hoe het long-context-wetsvoorstel eruitziet
Beide modellen adverteren met een lange context, maar ze brengen er op manieren kosten voor in rekening die hun bedoeling onthullen. Het 1M-tokenvenster van Gemini 3.1 Pro heeft een tarief van $2.00 / $12.00 dat opschaalt naar $4.00 / $18.00 zodra een verzoek de 200K invoertokens overschrijdt — een ruwe invoerpremie van ongeveer 60% en uitvoerpremie van 50%, die precies wordt toegepast op de workloads waarvoor het 1M-venster bestaat. Voer het bij elke beurt van een agentsessie een repositorycontext van 500K tokens en die premie geldt voor elke afzonderlijke aanroep. De 262K-context van Nex-N2.5 Pro is bescheidener, maar de gehoste laag is gratis en Nex-AGI heeft helemaal geen betaald tarief gepubliceerd, dus er is geen premie voor lange context om te modelleren — er is ook geen prijssignaal voor wat het model waard is. Google vertelt je precies wat het venster kost, en de prijs is hoog; Nex-AGI vertelt je niets, en dat is niet hetzelfde als goedkoop.
Wat je vandaag kunt routeren

Hier scheiden de twee kanten zich duidelijk voor een werkend team. Gemini 3.1 Pro staat op OrcaRouter tegen Google's officiële prijs — dezelfde $2,00 / $12,00 met de stap boven 200K ongewijzigd doorgegeven — en de preview-status is precies het argument om eromheen te routeren in plaats van er een kritisch pad op te wedden: automatische failover betekent dat een hapering of deprecatie van een preview-model doorverwijst naar een fallback zonder codeaanpassing, en de routing-DSL laat je de verzoeken die Google's multimodaliteit nodig hebben naar Gemini sturen terwijl goedkopere modellen het routinematige verkeer opvangen. Nex-N2.5 Pro staat niet op OrcaRouter — geen enkel nex-agi-model staat in onze directory — omdat de enige live builds de gratis endpoints zijn die Nex-AGI vanaf zijn kaart linkt. De dag dat een provider het tegen een echte catalogusprijs aanbiedt, verschijnt het hier tegen die prijs zonder opslag, en wordt deze vergelijking uitvoerbaar in plaats van theoretisch.
Wie moet wat aanraken?
Het eerlijke antwoord wordt bepaald door welke vorm van risico je kunt absorberen. Als je vandaag multimodaal redeneren op schaal nodig hebt en een leverancier kunt tolereren die zijn vlaggenschip in preview houdt terwijl de roadmap verschuift, is Gemini 3.1 Pro de meetbare keuze — zes maanden onafhankelijk testen is een echte aanwinst, en de opkomst van de Flash-zustermodellen is een reden om ernaartoe te routeren in plaats van een reden om de familie te vermijden. Als je computer-use-agents bouwt op open gewichten en bereid bent te wachten op iets verifieerbaars, is Nex-N2.5 Pro de interessantere weddenschap op de lange termijn — maar het is nog geen weddenschap die je kunt aangaan, omdat je het niet kunt draaien, de scores niet kunt reproduceren of een contract kunt ondertekenen dat ervan afhangt. De teams die met beide beslissingen het gelukkigst zullen zijn, zijn degenen die beide modellen behandelen als wat ze zijn: een preview van zeven maanden die door iedereen is getest, en een preview van één dag oud die door niemand is getest.
