Nex-N2.5 Pro 对比 DeepSeek V4 Pro 主视觉——一张生成的标题卡片,上面写着“Nex-N2.5 Pro vs DeepSeek V4 Pro”,副标题为“两款开放权重押注——一款今日即可下载,一款标注为即将推出”,并带有眉题“Nex-AGI vs DeepSeek——2026年9月”。
Guides & Insights

Nex-N2.5 Pro 对比 DeepSeek V4 Pro:这些开放权重中只有一套是真正开放的

作者

Elias Hawthorne

发布日期

最新模型 · 20查看全部模型
基准测试:Artificial Analysis · 每日更新
返回全部文章

这个系列内部的秘密,让这场对决比表面看起来更耐人寻味:Nex-AGI 自家的 Nex-N2.5 Max——即包含 Nex-N2.5 Pro 的整个家族中的顶级型号——本身就是基于 DeepSeek-V4-Pro-Base 后训练而来的。对 9 月 8 日发布说明的报道毫不讳言:Mini 和 Pro 基于 Qwen3.5 的变体构建,而纯文本版的 1.6T Max 则立于 DeepSeek 于 8 月发布的开源基座之上。因此,当 Nex-N2.5 Pro 与 DeepSeek V4 Pro 被放在一起比较时,读者看到的其实是:一个开放模型项目借用了另一个项目的基础来打造自己的旗舰档位,然后试图在低一档的市场上反超那位“捐赠者”。这并非贬低;开放权重经济本就如此运作。而且,在双方均为开放许可、如今却只有其中一款真正能够下载的情况下,这也是最诚实的比较框架。

这种不对称性才是关键所在。DeepSeek V4 Pro——即8月13日正式发布(GA)的0813版本——其MIT许可的权重此刻就放在Hugging Face上:这是一个总参数约1.6万亿、激活参数约490亿的大型混合专家(MoE)模型,支持100万token上下文、384K输出上限,背后还有官方API。Nex-N2.5 Pro于9月8日发布,是一个3970亿参数的稀疏MoE,激活参数约170亿;它支持多模态,而DeepSeek仅限文本;它瞄准的是计算机使用代理(computer-use agents),而非通用工具调用。它的Hugging Face主页仍然醒目地标注着权重即将以Apache-2.0发布,却没有日期,目前只有免费的托管端点提供服务。两者对开放权重的理念承诺相同,交付状态却截然不同。

两个许可证,一套实际发布的权重

许可证层面的差异没有交付方式层面的差异重要,但它定下了基调。DeepSeek V4 Pro 采用 MIT 许可证——你今天就可以下载分片、自行部署、微调,并在其之上构建业务,无需征求任何人的许可;而且由于权重已经放出,没有任何单一托管方能够控制价格。Nex-N2.5 Pro 承诺采用 Apache-2.0——联盟选定的同样宽松的许可证——但其模型卡上的标注毫不含糊:权重不可下载,也没有附带任何日期。对于一个要求是“模型必须归我们所有”的团队来说,这场对决目前毫无悬念——DeepSeek V4 Pro 是唯一真正能够拥有的候选者。不过,实际操作层面的提醒是双向的:自托管一个约 1.6T 参数的 MoE 属于重型基础设施,因此对大多数团队而言,MIT 许可证与其说是一套托管方案,不如说是一种防止锁定的保障,以及对价格的托底。Nex-N2.5 Pro 一旦分片落地,反而会是更易于自托管的设计——17B 激活参数即可运行在八卡 H100 节点上,其部署规模远比 DeepSeek 的参考配置小得多。

两者不同的行

将两者并排对比,其用途几乎没有任何重叠:

已发布— Nex-N2.5 Pro:2026年9月8日(托管端点已上线,权重待发布)。DeepSeek V4 Pro:2026年8月13日(0813 GA 构建),权重已上线。

规模——Nex-N2.5 Pro:总参数量 397B / 激活约 17B。DeepSeek V4 Pro:总参数量约 1.6T / 激活约 49B。

模态 — Nex-N2.5 Pro:支持文本与图像输入、文本输出,专为屏幕阅读型计算机操作而设计。DeepSeek V4 Pro:其公开 API 仅支持文本——没有原生的视觉、图像或音频输入功能。

上下文 / 输出 — Nex-N2.5 Pro:262,144 token 上下文。DeepSeek V4 Pro:1M token 上下文,输出最多 384K token。

推理控制 — Nex-N2.5 Pro:无 / 中(自适应,默认)/ 高。DeepSeek V4 Pro:在同一模型字符串上支持低 / 高 / 最大推理强度。

权重 — Nex-N2.5 Pro:Apache-2.0,即将推出。DeepSeek V4 Pro:MIT,现已可下载。

API 接口—— Nex-N2.5 Pro:在免费托管端点上提供兼容 OpenAI 的聊天调用。DeepSeek V4 Pro:原生 OpenAI Responses API,外加兼容 Anthropic 的端点、工具调用和 JSON 输出。

两款真正不同的产品共享着"open"一词。Nex-N2.5 Pro 是为观看并驱动屏幕而生;DeepSeek V4 Pro 是为思考、编写代码和调用工具而生——这正是操作者与分析者之间的区别。

A two-column scoreboard titled 'Nex-N2.5 Pro vs DeepSeek V4 Pro — the scoreboard'. Left column Nex-N2.5 Pro: Announced Sep 8 2026; Params 397B / ~17B active; Modality text + image; Context 262,144; Weights Apache-2.0 pending; Price free hosted / no list. Right column DeepSeek V4 Pro: GA Aug 13 2026 (0813); Params 1.6T / ~49B active; Modality text only; Context 1M / 384K output; Weights MIT live now; Price $0.44 / $0.88 flat route. Footer: 'Nex scores vendor-reported via NexCUA; DeepSeek price is the OrcaRouter-listed provider route.'

衡量的是什么,借用的又是什么

Screenshot of the Nex-N2.5-Pro model card on Hugging Face showing the banner 'Nex-N2.5-Pro weights are coming soon' above the family introduction text.

基准测试的格局与交付的格局一样失衡。DeepSeek V4 Pro 的足迹是可衡量且独立的:在 Artificial Analysis Intelligence Index 上有一个条目,自 0813 GA 以来有数周的媒体报道和生产流量,以及供应商的编码数据——根据 DeepSeek 自己的报告,Terminal-Bench 2.1 为 87.9,DeepSWE 为 62.7——这些至少基于一个任何人都能下载并重新运行的模型。Nex-N2.5 Pro 却没有这些。其最抢眼的数字——OSWorld-2 为 56.4,Terminal-Bench 2.1 为 82.7,SWE-Bench Pro 为 61.2,BrowseComp 为 89.7——全部是 Nex-AGI 通过其 NexCUA 测试工具自行测得的;该联盟表示将开源这一工具,但迄今尚未开源。发布后的头 48 小时内,没有任何独立实验室运行过 Nex-N2.5 Pro,因为联盟之外无人能够运行它。

将两组说法并排阅读,诚实的结论不是“DeepSeek更聪明”,而是“DeepSeek的数字可查证,而Nex-N2.5 Pro的数字不可查证。”在两家厂商的表格确实重合之处——Terminal-Bench 2.1——DeepSeek声称87.9,而Nex-N2.5 Pro声称82.7,这一五分差距有利于在位者,其方向恰恰是谨慎读者应当预期的:已发布的模型在共同那行上的得分高于尚未发布的模型。

价格:一个实数、一个预定的数字,以及没有数字。

DeepSeek V4 Pro的定价并不是一个单一数字——这本身就是个值得关注的故事。8月13日GA(正式发布)时,官方API的标价是每百万输入token $0.435、每百万输出token $0.87;到了8月16日,DeepSeek把V4系列改成了峰谷分时计费:如今官方API在低谷时段每百万输入token收$0.66、输出收$1.98,高峰时段则收$1.32/$3.96,缓存输入在低谷和高峰分别为$0.022和$0.044。直接调用DeepSeek时,同一模型的价格取决于你调用的时段:最低约为发布价的1.5倍,最高可达4.5倍。路由方式也很关键:OrcaRouter上DeepSeek V4 Pro的模型页面目前挂的是一个统一的每百万$0.44输入/$0.88输出——DeepSeek的原价直接透传,没有任何加价——甚至比官方低谷时段还便宜。如果按单token成本来比,这条一口价路由就是需要被击败的标杆;而这样的报价之所以存在,只是因为路由层让你看到的是提供商真实的价格,而不是转手加价后的价格。

Screenshot of the OrcaRouter model page for DeepSeek V4 Pro (deepseek/deepseek-v4-pro) showing the header stats $0.44 input and $0.88 output per million tokens, a 1M-token context note, and the byline 'by DeepSeek - 2026-04-24'.

Nex-N2.5 Pro 没有价格可以与那些相提并论。它的托管层是免费的,而 Nex-AGI 尚未公布该系列的付费每 token 费率,因此该模型的经济性完全未知——免费端点只能证明构建可行,仅此而已。如果权重发布,并且有提供商开始以标价提供 Nex-N2.5 Pro,那么诚实的比较才成为可能;在那之前,“免费”只是一种预览机制,而非市场信号。

两种不同类型的代理

在这两者之间做选择,你选的其实是两份工作,而不是两个分数。Nex-N2.5 Pro 面向的是操作电脑的智能体:它要看屏幕、移动光标、编辑文件、检查视觉结果,然后继续推进——在 Pokemon Platinum 中演示过的 468 步操作会话,正是这种野心的形状。DeepSeek V4 Pro 面向的是操作 API 的智能体:它负责推理、编写多文件代码、调用工具、生成长篇结构化输出,而这一切都通过文本通道完成,它的 384K 输出上限和 1M 上下文正是为了服务这个通道。正在做浏览器自动化的团队,应该紧盯 Nex-N2.5 Pro。正在做编码或知识型工作智能体的团队,则应该把 DeepSeek V4 Pro 拿去和封闭前沿模型对比;而 Nex-N2.5 Pro 目前还不能胜任这份工作——它无法把图像从处理流程中拿掉,而且它的编码能力声明,无论是在水平上还是验证程度上,都比不上与之对比的那个模型。

结论:一个要等待,另一个要建设。

在当前的这场对决中,DeepSeek V4 Pro 是唯一理性的构建目标。它的权重可下载,价格公开透明——而且通过 OrcaRouter 的统一定价路由,比 DeepSeek 自家峰值时段的计费更便宜——其宣称的性能任何人都能在一个下午内加以验证。它也是衡量开放计算机使用(computer-use)成本的自然起点:将其编码代理流量经由 OrcaRouter 路由,并在官方 API 约 500 并发上限之外配置自动故障转移,你就能以真实价格获得一个可运行的开源权重基线。Nex-N2.5 Pro 是更有意思的长期押注,正因为它是一种更专业化的设计——一个 17B 激活参数的多模态操作模型,有望像 DeepSeek 以低价冲击封闭通用模型厂商那样,冲击封闭的计算机使用领域领导者——但一个无法验证的免费端点并不能作为基础。当 Apache-2.0 分片正式落地、独立测试框架跑出 OSWorld-2 的那个数字时,这场对决将在一夜之间彻底改变。在那之前,这只是一场「你可以拥有的模型」与「你只能旁观的模型」之间的比较。

本文中的对比1

根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新