Hero « Nex-N2.5 Pro vs DeepSeek V4 Pro » — une carte-titre générée affichant « Nex-N2.5 Pro vs DeepSeek V4 Pro », avec le sous-titre « Deux paris à poids ouverts — l’un téléchargeable dès aujourd’hui, l’autre marqué “à venir” », et un surtitre « Nex-AGI vs DeepSeek — septembre 2026 ».
Guides & Insights

Nex-N2.5 Pro vs DeepSeek V4 Pro : un seul de ces ensembles de poids ouverts est réellement ouvert

Auteur

Elias Hawthorne

Date de publication

Derniers modèles · 20Voir tous les modèles
Benchmarks : Artificial Analysis · mis à jour quotidiennement
Retour à tous les articles

Voici le secret de famille qui rend cette confrontation plus étrange qu’il n’y paraît : le Nex-N2.5 Max de Nex-AGI, le haut de gamme de la famille qui comprend aussi le Nex-N2.5 Pro, est lui-même post-entraîné à partir de DeepSeek-V4-Pro-Base. La couverture des notes de version du 8 septembre le dit ouvertement — Mini et Pro sont construits à partir de variantes de Qwen3.5, tandis que le Max 1.6T, uniquement textuel, repose sur la base ouverte que DeepSeek a publiée en août. Ainsi, lorsque le Nex-N2.5 Pro est comparé au DeepSeek V4 Pro, le lecteur assiste à un projet de modèle ouvert qui emprunte les fondations d’un autre pour son niveau phare, puis tente de surpasser le donateur dans le niveau inférieur. Ce n’est pas une insulte ; c’est ainsi que fonctionne l’économie des poids ouverts, et c’est le cadre le plus honnête possible pour une comparaison où les deux modèles sont sous licence ouverte et où un seul d’entre eux peut réellement être téléchargé aujourd’hui.

Toute l'histoire tient dans l'asymétrie. DeepSeek V4 Pro, la build 0813 passée en disponibilité générale le 13 août, a dès maintenant ses poids sous licence MIT disponibles sur Hugging Face : un grand modèle à mélange d'experts (MoE) d'environ 1 600 milliards de paramètres au total, dont environ 49 milliards d'actifs, une fenêtre de contexte d'un million de tokens, un plafond de sortie de 384 000 tokens, et une API officielle en soutien. Nex-N2.5 Pro, annoncé le 8 septembre, est un MoE sparse de 397 milliards de paramètres, dont environ 17 milliards d'actifs, multimodal là où DeepSeek est uniquement textuel, et conçu pour des agents capables d'utiliser un ordinateur plutôt que pour l'usage généraliste d'outils. Sa fiche Hugging Face arbore toujours une bannière annonçant que les poids seront bientôt disponibles sous licence Apache-2.0, sans aucune date, alors que seuls des endpoints hébergés gratuits le servent. Même engagement philosophique en faveur des poids ouverts. État de livraison complètement différent.

Deux licences, un seul ensemble de poids réellement publié

Le contraste de licences compte moins que le contraste de livraison, mais il fixe les termes du jeu. DeepSeek V4 Pro est sous licence MIT — vous pouvez télécharger les shards dès aujourd'hui, les servir vous-même, les affiner et bâtir une entreprise dessus sans demander la permission à personne ; et comme les poids sont publiés, aucun hôte unique ne contrôle le prix. Nex-N2.5 Pro est promis sous licence Apache-2.0, la licence tout aussi permissive choisie par l'alliance, mais le bandeau sur la fiche est sans équivoque : les poids ne sont pas téléchargeables, et aucune date n'y est associée. Pour une équipe dont l'exigence est « le modèle doit être à nous », ce duel n'est pas une compétition pour l'instant — DeepSeek V4 Pro est le seul candidat que vous pouvez réellement posséder. La réserve pratique est à double tranchant : auto-héberger un MoE de ~1,6 T relève d'une infrastructure sérieuse ; pour la plupart des équipes, la licence MIT importe donc moins comme plan d'hébergement que comme garantie contre l'enfermement propriétaire et comme prix plancher. Nex-N2.5 Pro, une fois ses shards publiés, sera la conception la plus auto-hébergeable — 17B de paramètres actifs sur un nœud de huit H100 représentent une machine bien plus petite que l'empreinte de référence de DeepSeek.

Les lignes où les deux diffèrent

Côte à côte, les deux modèles ne se recoupent guère dans leur fonction :

Publié — Nex-N2.5 Pro : 8 septembre 2026 (endpoints hébergés opérationnels, poids en attente). DeepSeek V4 Pro : 13 août 2026 (build GA 0813), poids disponibles.

Scale — Nex-N2.5 Pro : 397B au total / ~17B actifs. DeepSeek V4 Pro : ~1.6T au total / ~49B actifs.

Modalité — Nex-N2.5 Pro : saisie de texte et d'images, sortie de texte ; conçu pour une utilisation informatique par lecture d'écran. DeepSeek V4 Pro : texte uniquement dans son API publique — pas de vision native, ni d'entrée d'images ou d'audio.

Contexte / sortie — Nex-N2.5 Pro : contexte de 262 144 tokens. DeepSeek V4 Pro : contexte de 1M de tokens, jusqu'à 384K tokens de sortie.

Contrôle du raisonnement — Nex-N2.5 Pro : aucun / moyen (adaptatif, par défaut) / élevé. DeepSeek V4 Pro : effort de raisonnement faible / élevé / maximal sur la même chaîne de modèle.

Poids — Nex-N2.5 Pro : Apache-2.0, bientôt disponible. DeepSeek V4 Pro : MIT, téléchargeable dès maintenant.

Surface d'API — Nex-N2.5 Pro : appels de chat compatibles OpenAI sur des points de terminaison hébergés gratuits. DeepSeek V4 Pro : API Responses native d'OpenAI ainsi que des points de terminaison compatibles Anthropic, appels d'outils et sortie JSON.

Deux produits véritablement différents partagent le mot « open ». Nex-N2.5 Pro est conçu pour regarder un écran et le piloter ; DeepSeek V4 Pro est conçu pour réfléchir, écrire du code et appeler des outils — la différence entre un opérateur et un analyste.

A two-column scoreboard titled 'Nex-N2.5 Pro vs DeepSeek V4 Pro — the scoreboard'. Left column Nex-N2.5 Pro: Announced Sep 8 2026; Params 397B / ~17B active; Modality text + image; Context 262,144; Weights Apache-2.0 pending; Price free hosted / no list. Right column DeepSeek V4 Pro: GA Aug 13 2026 (0813); Params 1.6T / ~49B active; Modality text only; Context 1M / 384K output; Weights MIT live now; Price $0.44 / $0.88 flat route. Footer: 'Nex scores vendor-reported via NexCUA; DeepSeek price is the OrcaRouter-listed provider route.'

Ce qui est mesuré, et ce qui est emprunté.

Screenshot of the Nex-N2.5-Pro model card on Hugging Face showing the banner 'Nex-N2.5-Pro weights are coming soon' above the family introduction text.

Le tableau des benchmarks est aussi déséquilibré que celui de la distribution. DeepSeek V4 Pro dispose d'une empreinte mesurée et indépendante : une entrée à l'Artificial Analysis Intelligence Index, des semaines de couverture presse et de trafic de production depuis la GA du 0813, ainsi que des chiffres de codage du fournisseur — Terminal-Bench 2.1 à 87,9 et DeepSWE à 62,7 selon les propres rapports de DeepSeek — qui s'appuient au moins sur un modèle que n'importe qui peut télécharger et ré-exécuter. Nex-N2.5 Pro n'a rien de tout cela. Ses chiffres phares — OSWorld-2 à 56,4, Terminal-Bench 2.1 à 82,7, SWE-Bench Pro à 61,2, BrowseComp à 89,7 — proviennent tous de mesures propres à Nex-AGI via son harnais NexCUA, que l'alliance déclare vouloir ouvrir en open source, sans l'avoir encore fait. Au cours des 48 premières heures suivant le lancement, aucun laboratoire indépendant n'avait exécuté Nex-N2.5 Pro, car personne en dehors de l'alliance ne le peut.

Lisez les deux séries d’affirmations côte à côte et la conclusion honnête n’est pas « DeepSeek est plus intelligent ». C’est « Les chiffres de DeepSeek sont vérifiables, ceux de Nex-N2.5 Pro ne le sont pas ». Là où les deux fiches des fournisseurs se chevauchent — Terminal-Bench 2.1 — DeepSeek revendique 87,9 contre 82,7 pour Nex-N2.5 Pro, un écart de cinq points en faveur du modèle en place, exactement la direction à laquelle un lecteur prudent doit s’attendre : le modèle qui a été lancé obtient un score plus élevé sur la ligne commune que celui qui ne l’a pas été.

Le prix : un nombre réel, un nombre programmé et aucun nombre.

Le tarif de DeepSeek V4 Pro n'est pas un chiffre unique, et c'est en soi tout un récit. Lors de la GA 0813, l'API officielle affichait 0,435 $ par million de jetons en entrée et 0,87 $ par million en sortie ; le 16 août, DeepSeek a fait passer la famille V4 à un barème heures pleines/heures creuses. L'API officielle facture désormais 0,66 $ en entrée / 1,98 $ en sortie en heures creuses et 1,32 $ / 3,96 $ en heures pleines, avec une entrée en cache à 0,022 $ en heures creuses et 0,044 $ en heures pleines. Selon le moment où vous appelez DeepSeek directement, le même modèle coûte entre environ 50 % de plus et quatre fois et demie le tarif de lancement. Le routage compte aussi : la page modèle OrcaRouter pour DeepSeek V4 Pro affiche actuellement un tarif fixe de 0,44 $ en entrée / 0,88 $ en sortie par million — le tarif du fournisseur transmis sans marge — ce qui est même inférieur au barème officiel en heures creuses. Ce tarif fixe est la référence à battre si vous comparez le coût par jeton, et c'est le genre de chiffre qui n'existe que parce qu'une couche de routage vous montre le tarif réel du fournisseur plutôt qu'un tarif réajusté.

Screenshot of the OrcaRouter model page for DeepSeek V4 Pro (deepseek/deepseek-v4-pro) showing the header stats $0.44 input and $0.88 output per million tokens, a 1M-token context note, and the byline 'by DeepSeek - 2026-04-24'.

Nex-N2.5 Pro n'a pas de prix à mettre à côté de tout cela. Son niveau hébergé est gratuit, et Nex-AGI n'a publié aucun tarif payant par jeton pour la famille, donc l'économie du modèle est simplement inconnue — les points de terminaison gratuits prouvent que la construction fonctionne, rien de plus. Si les poids arrivent et qu'un fournisseur commence à servir Nex-N2.5 Pro à un prix catalogue, la comparaison honnête devient possible ; jusque-là, « gratuit » est un mécanisme d'aperçu, pas un signal de marché.

Deux types différents d'agent.

Choisir entre ces deux modèles, c'est choisir entre deux métiers, pas entre deux scores. Nex-N2.5 Pro est conçu pour l'agent qui opère un ordinateur : il lit un écran, déplace un curseur, édite un fichier, vérifie le résultat visuel et continue — la session de 468 actions démontrée dans Pokemon Platinum est l'incarnation de cette ambition. DeepSeek V4 Pro est conçu pour l'agent qui opère une API : il raisonne, écrit du code multi-fichiers, appelle des outils et produit de longues sorties structurées, le tout à travers le canal textuel que son plafond de sortie de 384K et son contexte de 1M existent pour servir. Une équipe qui développe de l'automatisation de navigateur devrait garder un œil sur Nex-N2.5 Pro. Une équipe qui développe un agent de codage ou de travail de la connaissance devrait comparer DeepSeek V4 Pro aux modèles propriétaires de pointe, et Nex-N2.5 Pro n'est pas encore un candidat pour cette tâche — il ne peut pas retirer l'image de la boucle, et ses promesses en matière de codage sont à la fois plus modestes et moins vérifiées que celles du modèle auquel on le compare.

Le verdict : attendre sur l'un, construire sur l'autre.

DeepSeek V4 Pro est la seule cible de développement rationnelle dans ce face-à-face aujourd'hui. Ses poids sont téléchargeables, son prix est connu — et moins cher via la route forfaitaire d'OrcaRouter que sur le tarif de pointe de DeepSeek — et ses affirmations peuvent être vérifiées par n'importe qui en un après-midi. C'est aussi le point de départ naturel pour mesurer ce que coûtera l'utilisation d'ordinateur en open source : acheminez le trafic de son agent de codage via OrcaRouter avec un basculement automatique contournant le plafond d'environ 500 connexions simultanées de l'API officielle, et vous obtenez une référence fonctionnelle à poids ouverts à un prix réel. Nex-N2.5 Pro est le pari à long terme le plus intéressant précisément parce qu'il s'agit d'une conception plus spécialisée — un opérateur multimodal à 17B de paramètres actifs qui pourrait sous-coter les leaders fermés de l'utilisation d'ordinateur comme DeepSeek a sous-coté les généralistes fermés — mais un point d'accès gratuit invérifiable n'est pas une fondation. Quand les fragments Apache-2.0 seront publiés et qu'un banc d'essai indépendant obtiendra ce score OSWorld-2, ce face-à-face changera du jour au lendemain. Jusque-là, c'est une comparaison entre un modèle que vous pouvez posséder et un modèle que vous ne pouvez que regarder.

Comparés dans cet article1

Détecté à partir de cet article · Benchmarks : Artificial Analysis · mis à jour quotidiennement