
Nex-N2.5 Pro vs Gemini 3.1 Pro : un modèle open âgé d’un jour face à un aperçu vieux de sept mois
- openaiNOUVEAUOpenAI: GPT-6 Astra2026-09-0455Intelligence77Code
- googleNOUVEAUGoogle: Gemini 3.8 Flash2026-09-0247Intelligence76Code
- qwenNOUVEAUQwen: Qwen3.8 Max (0902)2026-09-0247Intelligence72Code
- anthropicNOUVEAUAnthropic: Claude Fable 5.12026-09-0157Intelligence82Code
- AlibabaNOUVEAUQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens
- z-aiNOUVEAUZ.ai: GLM 5.3 Flash2026-08-2646Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 par million de tokens
- z-aiZ.ai: GLM 5.32026-08-1849Intelligence75Code
- obsidianQwen3.8 27B2026-08-1541Intelligence68Code
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1242Intelligence69Code
- grokSpaceXAI: Grok 4.62026-08-1251Intelligence77Code
- metaMeta: Muse Spark 1.22026-08-0547Intelligence72Code
- qwenQwen: Qwen3.8 Max2026-08-0347Intelligence72Code
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3141Intelligence69Code
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 par million de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2454Intelligence78Code
- googleGoogle: Gemini 3.6 Flash2026-07-2140Intelligence69Code
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2128Intelligence49Code
La symétrie la plus étrange de cette confrontation, c'est que les deux modèles sont officiellement inachevés, et que chaque camp le prouve d'une manière que l'autre ne peut pas. Gemini 3.1 Pro Preview, le fer de lance multimodal fermé de Google, est en aperçu depuis le 19 février 2026 — sept mois, une éternité pour un modèle de pointe — et son créateur n'a toujours pas annoncé sa disponibilité générale. Nex-N2.5 Pro, le modèle d'utilisation d'ordinateur à 397 milliards de paramètres de l'alliance Nex-AGI pour les modèles ouverts, a un jour d'existence au moment où ces lignes sont écrites et répond déjà au trafic des points de terminaison hébergés gratuits — pourtant, ses poids Apache-2.0 sont marqués « bientôt disponible » sur Hugging Face, ce qui en fait un inachèvement d'une autre nature. L'un est un produit fini à tous égards, sauf par la volonté du fournisseur de le reconnaître. L'autre est un produit inachevé à tous égards, sauf par la volonté du fournisseur de le livrer.
Ces deux variantes de l'incomplétude changent la manière de lire chacun des chiffres ci-dessous. Gemini 3.1 Pro est actuellement le modèle de raisonnement phare de Google — multimodal sur le texte, l'image, l'audio, la vidéo et les fichiers, avec un contexte d'un million de jetons, un plafond de sortie de 65 000 jetons et un prix de 2,00 $ par million de jetons d'entrée et de 12,00 $ par million de jetons de sortie, qui augmente dès qu'une requête dépasse les 200 000 jetons d'entrée. Nex-N2.5 Pro est un modèle sparse mixture-of-experts de 397 milliards de paramètres au total, dont environ 17 milliards actifs, avec du texte et des images en entrée et du texte en sortie, un contexte de 262 144 jetons et une boucle de vision conçue pour piloter des ordinateurs et des navigateurs. Ces deux modèles occupent le même créneau tarifaire, celui du « modèle agentique premium », divergent sur presque tout le reste, et aucun des deux n'a de fournisseur prêt à le déclarer terminé.
La fiche technique : deux modèles multimodaux de classe 1M
Placez les enveloppes côte à côte :
• Statut — Nex-N2.5 Pro : annoncé le 8 septembre 2026 ; points de terminaison hébergés en production, pondérations en attente. Gemini 3.1 Pro : en aperçu depuis le 19 février 2026, toujours pas en disponibilité générale.
• Échelle — Nex-N2.5 Pro : 397B au total / ~17B MoE actif, post-entraîné à partir de la lignée Qwen3.5. Gemini 3.1 Pro : nombre de paramètres non divulgué.
• Modalité — Nex-N2.5 Pro : texte et image en entrée, texte en sortie ; la vision est le canal de retour pour l’utilisation de l’ordinateur. Gemini 3.1 Pro : texte, image, audio, vidéo et fichier en entrée, texte en sortie.
• Contexte / sortie — Nex-N2.5 Pro : contexte de 262 144 jetons, longueur de service documentée. Gemini 3.1 Pro : contexte de 1M de jetons, plafond de sortie de 65K.
• Contrôle du raisonnement — Nex-N2.5 Pro : aucun / moyen (adaptatif, par défaut) / élevé. Gemini 3.1 Pro : budget de réflexion ajustable ; pas de drame public autour d’un palier « max ».
• Poids — Nex-N2.5 Pro : Apache-2.0, bientôt disponible. Gemini 3.1 Pro : fermé.
• Prix par 1M de tokens — Nex-N2.5 Pro : niveau hébergé gratuit, aucun prix de liste publié. Gemini 3.1 Pro : 2,00 $ / 12,00 $, passant à 4,00 $ / 18,00 $ au-delà de 200K tokens d’entrée, 0,20 $ pour l’entrée en cache.
Les deux fiches techniques ne s'accordent sur presque rien au-delà de « contexte long, multimodal, coûteux à construire ». Les différences qui comptent sont la surcharge d'entrée de 200K côté Gemini, le modèle économique gratuit mais invérifiable côté Nex, et le fait que seul le Nex-N2.5 Pro est architecturé autour de la lecture d'un écran.

Deux manières différentes d'être inachevé.
Google : sept mois d’aperçu comme décision produit
Le statut d'aperçu de Gemini 3.1 Pro n'est pas cosmétique, et c'est de plus en plus le fait le plus important concernant ce modèle. Les conditions pré-GA de Google autorisent une utilisation en production tout en se réservant le droit de modifier le comportement ou de déprécier le point de terminaison — un risque réel pour une équipe qui place un produit phare sur un chemin critique. La trajectoire du modèle n'a rien fait pour écarter ce risque : il a été lancé en février comme le modèle le mieux noté du marché, avec 57 sur l'indice Artificial Analysis Intelligence à l'époque, puis a été re-mesuré sur une échelle d'indice plus stricte à environ 48, tandis que son successeur prévu, Gemini 3.5 Pro, est passé d'une annonce de mai à des retards répétés et à des rumeurs d'annulation possible. Entre-temps, Google a publié Gemini 3.7 Flash en août à 0,75 $ / 3,75 $ et Gemini 3.8 Flash début septembre, et la gamme Flash moins chère a dépassé le produit phare Pro sur l'indice indépendant. Adopter Gemini 3.1 Pro aujourd'hui signifie adopter un produit phare dont le fournisseur le maintient en aperçu tandis que ses homologues moins chers le surpassent et que son successeur est dans les limbes.
Nex-AGI : une journée de « bientôt disponible » comme état de livraison.

L'incomplétude de Nex-N2.5 Pro va dans la direction opposée : tout est livré, sauf ce qui le rendrait réel. Les endpoints hébergés sont en ligne et gratuits, les appels compatibles OpenAI fonctionnent, et la fiche du modèle regorge de résultats de benchmarks — OSWorld-2 à 56.4, Terminal-Bench 2.1 à 82.7, SWE-Bench Pro à 61.2, tous mesurés via le harnais NexCUA de l'alliance, qu'elle affirme vouloir open-sourcer mais ne l'a pas fait. Mais les poids ne sont pas téléchargeables, aucune date de sortie n'est associée à la bannière, et aucun laboratoire indépendant n'a exécuté le modèle, car aucun ne le peut. Là où Gemini 3.1 Pro est mesurable mais non engagé, Nex-N2.5 Pro est engagé mais non mesurable. Ces deux états devraient faire réfléchir toute équipe de production, pour des raisons différentes.
Là où réside la preuve indépendante.
Le bilan indépendant de cette confrontation appartient presque entièrement à un seul camp. Gemini 3.1 Pro a derrière lui six mois de tests publics : des laboratoires indépendants l'ont évalué, des équipes de production l'ont mis à l'épreuve, et il affiche actuellement un indice Artificial Analysis Intelligence proche de 48 — modeste pour un modèle phare, et c'est la raison pour laquelle les modèles Flash moins chers de Google l'ont dépassé, mais il s'agit d'une mesure réelle produite par quelqu'un d'autre que le fournisseur. Nex-N2.5 Pro ne dispose d'aucune donnée de ce type. Ses seuls scores proviennent de Nex-AGI lui-même, sur un banc d'essai que le public n'a jamais vu. La comparaison qui compte n'est donc pas « 48 contre rien » — c'est « un modèle dont les faiblesses sont documentées » face à « un modèle dont les points forts sont affirmés ». Pour une charge de travail où une réponse erronée coûte cher, cette asymétrie est souvent décisive, quels que soient les chiffres.
À quoi ressemble la facture pour le long contexte
Les deux modèles annoncent un contexte long, mais ils le facturent d’une manière qui révèle leur intention. La fenêtre de 1 million de jetons de Gemini 3.1 Pro est proposée au tarif de 2,00 $ / 12,00 $, qui passe à 4,00 $ / 18,00 $ dès qu’une requête dépasse 200 000 jetons d’entrée — soit une majoration d’environ 60 % sur l’entrée et 50 % sur la sortie, appliquée précisément aux charges de travail pour lesquelles la fenêtre de 1M existe. Fournissez-lui un contexte de dépôt de 500 000 jetons à chaque tour d’une session d’agent, et cette majoration s’applique à chaque appel. Le contexte de 262 000 jetons de Nex-N2.5 Pro est plus modeste, mais son niveau hébergé est gratuit et Nex-AGI n’a publié aucun tarif payant, donc il n’y a pas de majoration pour contexte long à modéliser — il n’y a pas non plus de signal de prix indiquant ce que vaut le modèle. Google vous dit exactement ce que coûte sa fenêtre, et le prix est élevé ; Nex-AGI ne vous dit rien, ce qui n’est pas la même chose que d’être bon marché.
Ce que vous pouvez router aujourd'hui

Pour une équipe opérationnelle, les deux cas se séparent clairement. Gemini 3.1 Pro est sur OrcaRouter au prix public de Google — toujours 2,00 $ / 12,00 $, avec le palier au-delà de 200 000 jetons répercuté tel quel — et son statut d’aperçu est précisément l’argument pour router autour de lui plutôt que de parier un chemin critique sur ce modèle : le basculement automatique fait qu’un hoquet d’un modèle en aperçu, ou sa dépréciation, redirige vers un modèle de secours sans aucune modification de code, et le DSL de routage vous permet d’envoyer à Gemini les requêtes qui nécessitent la multimodalité de Google pendant que les modèles moins chers absorbent le trafic habituel. Nex-N2.5 Pro n’est pas sur OrcaRouter — aucun modèle nex-agi n’est répertorié dans notre annuaire — parce que ses seules versions actives sont les points de terminaison gratuits que Nex-AGI relie depuis sa fiche. Le jour où un fournisseur le proposera à un vrai prix public, il apparaîtra ici à ce prix, sans marge, et cette comparaison deviendra exécutable plutôt que théorique.
Qui doit toucher quoi
La réponse honnête dépend du type de risque que vous pouvez absorber. Si vous avez besoin aujourd'hui d'un raisonnement multimodal à grande échelle et pouvez tolérer un fournisseur qui garde son produit phare en preview alors que sa feuille de route change, Gemini 3.1 Pro est le choix mesurable — six mois de tests indépendants représentent un véritable atout, et l'essor des modèles Flash est une raison de router le trafic vers eux plutôt qu'une raison d'éviter la famille. Si vous développez des agents capables d'utiliser un ordinateur sur la base de poids ouverts et acceptez d'attendre quelque chose de vérifiable, Nex-N2.5 Pro est le pari à long terme le plus intéressant — mais c'est un pari que vous ne pouvez pas encore faire, car vous ne pouvez ni l'exécuter, ni reproduire ses scores, ni signer un contrat qui en dépend. Les équipes qui seront les plus satisfaites, quelle que soit leur décision, sont celles qui traitent les deux modèles pour ce qu'ils sont : une preview de sept mois que tout le monde a testée, et une preview d'un jour que personne n'a testée.
