
Nex-N2.5 Pro 對比 DeepSeek V4 Pro:這些開放權重中只有一套是真正開放的
- openai新OpenAI: GPT-6 Astra2026-09-0455智能77程式
- google新Google: Gemini 3.8 Flash2026-09-0247智能76程式
- qwen新Qwen: Qwen3.8 Max (0902)2026-09-0247智能72程式
- anthropic新Anthropic: Claude Fable 5.12026-09-0157智能82程式
- Alibaba新Qwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens
- z-ai新Z.ai: GLM 5.3 Flash2026-08-2646智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 每百萬 tokens
- z-aiZ.ai: GLM 5.32026-08-1849智能75程式
- obsidianQwen3.8 27B2026-08-1541智能68程式
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1242智能69程式
- grokSpaceXAI: Grok 4.62026-08-1251智能77程式
- metaMeta: Muse Spark 1.22026-08-0547智能72程式
- qwenQwen: Qwen3.8 Max2026-08-0347智能72程式
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3141智能69程式
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百萬 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2454智能78程式
- googleGoogle: Gemini 3.6 Flash2026-07-2140智能69程式
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2128智能49程式
這就是讓這場對決比表面上看起來更詭異的家族秘辛:Nex-AGI 自家的 Nex-N2.5 Max——也就是包含 Nex-N2.5 Pro 的這個家族中的頂級型號——本身也是從 DeepSeek-V4-Pro-Base 後訓練而來。9 月 8 日發布說明的相關報導公開寫道:Mini 與 Pro 是基於 Qwen3.5 的變體打造,而純文字的 1.6T Max 則立足於 DeepSeek 在 8 月釋出的開放基礎模型。因此,當 Nex-N2.5 Pro 與 DeepSeek V4 Pro 相比時,讀者看到的是一個開放模型計畫借用另一個計畫的基礎來打造自家旗艦型號,然後試圖在低一階的產品線上反過來壓過捐贈者。這不是貶損;開放權重經濟本來就是如此運作,而這也是這場比較中最誠實的框架——兩者皆為開放授權,但今天實際上只有其中一個能真正下載得到。
不對稱性就是整個故事的關鍵。DeepSeek V4 Pro,即8月13日正式發布(GA)的0813版本,其MIT授權的權重此刻就放在Hugging Face上——這是一個大型混合專家模型,總參數約1.6兆,活躍參數約490億,支援100萬token的上下文長度、384K的輸出上限,背後還有官方API。Nex-N2.5 Pro於9月8日發布,是參數達3970億的稀疏MoE模型,活躍參數約170億,具備多模態能力,而DeepSeek僅限文字;它鎖定的是電腦操作代理(computer-use agents)而非通用型工具使用。其Hugging Face頁面仍掛著橫幅,宣稱權重即將以Apache-2.0釋出,但未註明日期,目前僅有免費託管端點可供使用。兩者對開放權重的哲學承諾一致,交付狀態卻截然不同。
兩份授權,實際釋出的同一套權重
授權條款的差異雖然不如交付方式的差異關鍵,但它奠定了基本規則。DeepSeek V4 Pro 採用 MIT 授權——你今天就能下載分片、自行部署、加以微調,並在無需徵求任何人許可的情況下用它建立業務;而且因為權重已經公開,沒有任何單一托管方能控制價格。Nex-N2.5 Pro 則承諾採用 Apache-2.0,這是聯盟選擇的同樣寬鬆的授權,但規格卡上的標語說得很明確:權重不可下載,也沒有附上任何日期。對於一個要求是「模型必須是我們的」的團隊來說,目前這場較量根本毫無懸念——DeepSeek V4 Pro 是唯一一個你真正能擁有的選項。這個現實提醒是一體兩面的:自行托管約 1.6T 的 MoE 需要重大的基礎設施投入,因此對大多數團隊而言,MIT 授權與其說是一套托管方案,不如說是一種免於被鎖定的保障,以及價格的下限。Nex-N2.5 Pro 一旦分片發布,將是更適合自托管的設計——17B 活躍參數在八卡 H100 節點上就能運行,遠比 DeepSeek 的參考部署規模要小得多。
兩者不同的列
並排比較時,這兩個型號的用途幾乎沒有重疊:
• 已發布 — Nex-N2.5 Pro:2026年9月8日(託管端點已上線,權重待發布)。DeepSeek V4 Pro:2026年8月13日(0813 GA 版本),權重已上線。
• 規模 — Nex-N2.5 Pro:397B 總計 / ~17B 活躍。DeepSeek V4 Pro:~1.6T 總計 / ~49B 活躍。
• 模態 — Nex-N2.5 Pro:文字與影像輸入、文字輸出;專為讀取螢幕來操作電腦而打造。DeepSeek V4 Pro:其公開 API 僅提供純文字 — 不具備原生視覺、影像或音訊輸入。
• 上下文 / 輸出 — Nex-N2.5 Pro:262,144 token 上下文。DeepSeek V4 Pro:1M token 上下文,最多可輸出 384K token。
• 推理控制 — Nex-N2.5 Pro:無 / 中(自適應,預設)/ 高。DeepSeek V4 Pro:於同一模型字串上提供低 / 高 / 最大推理強度。
• 權重 — Nex-N2.5 Pro:Apache-2.0,即將推出。DeepSeek V4 Pro:MIT,現已可下載。
• API 介面 — Nex-N2.5 Pro:在免費代管端點上提供與 OpenAI 相容的聊天呼叫。DeepSeek V4 Pro:原生支援 OpenAI Responses API,並提供與 Anthropic 相容的端點、工具呼叫及 JSON 輸出。
兩個真正不同的產品共用「open」一詞。Nex-N2.5 Pro 旨在觀看螢幕並操作它;DeepSeek V4 Pro 旨在思考、編寫程式碼與呼叫工具——這正是操作者與分析師之間的差異。

衡量的是什麼,以及借用的是什麼

基準測試的失衡程度,與交付情況如出一轍。DeepSeek V4 Pro 擁有經實際量測、可獨立查證的足跡:列入 Artificial Analysis Intelligence Index、自 0813 GA 以來數週的新聞與生產環境流量,以及供應商公布的編碼數據——根據 DeepSeek 自身報告,Terminal-Bench 2.1 為 87.9、DeepSWE 為 62.7——這些至少是建立在一個任何人都能下載並重新執行的模型之上。Nex-N2.5 Pro 則完全沒有這些。其對外宣傳的數字——OSWorld-2 為 56.4、Terminal-Bench 2.1 為 82.7、SWE-Bench Pro 為 61.2、BrowseComp 為 89.7——全都是 Nex-AGI 透過其 NexCUA 測試框架自行量測的結果;該聯盟聲稱將開源此框架,但目前尚未釋出。在發表後的最初 48 小時內,沒有任何獨立實驗室執行過 Nex-N2.5 Pro,因為聯盟之外沒有人有辦法做到。
將兩組宣稱並排閱讀,誠實的結論並非「DeepSeek 更聰明」,而是「DeepSeek 的數字可以查核,Nex-N2.5 Pro 的則不然」。在兩家廠商規格表確實重疊的地方——Terminal-Bench 2.1——DeepSeek 宣稱 87.9,Nex-N2.5 Pro 則為 82.7,這五點差距有利於現有者,而這正是謹慎讀者應預期的方向:已出貨的模型在此共同項目上的得分,高於尚未出貨的那一個。
價格:一個實數、一個排程數,或沒有數字。
DeepSeek V4 Pro 的定價並非單一數字,而這本身就是一個故事。在 0813 GA 時,官方 API 列出的價格是每百萬輸入 tokens 美金 $0.435、每百萬輸出 tokens 美金 $0.87;到了 8 月 16 日,DeepSeek 將 V4 系列改為尖峰/離峰時段計費,因此官方 API 目前的收費是:離峰時段輸入 $0.66/輸出 $1.98,尖峰時段輸入 $1.32/輸出 $3.96,快取輸入則為離峰 $0.022、尖峰 $0.044。取決於你直接呼叫 DeepSeek 的時間點,同一個模型的成本約莫是上市費率的 1.5 倍到 4.5 倍之間。路由方式也很重要:OrcaRouter 上 DeepSeek V4 Pro 的模型頁面目前列出的是單一費率——每百萬輸入 $0.44/輸出 $0.88——也就是供應商原始費率直接轉傳、不加任何溢價,甚至比官方離峰方案還便宜。若要比對每個 token 的成本,這條固定費率路由正是值得挑戰的基準價格;而這種數字之所以存在,正是因為某個路由層向你顯示的是供應商的真實費率,而不是被重新定價後的價格。

Nex-N2.5 Pro 沒有可與上述任何項目相提並論的價格。其託管層級免費,而 Nex-AGI 也未公布該系列按 token 計費的付費費率,因此該模型的成本結構根本無從得知——免費端點只能證明其建置可行,僅此而已。若模型權重釋出,且有供應商開始以標價提供 Nex-N2.5 Pro 服務,才可能進行真正公允的比較;在那之前,「免費」只是一種預覽機制,而非市場信號。
兩種不同類型的代理
在這兩者之間做選擇,你選的是兩份工作,而不是兩個分數。Nex-N2.5 Pro 是給操作電腦的 agent 用的:它讀螢幕、移動游標、編輯檔案、檢查視覺結果,然後繼續前進——在《Pokemon Platinum》中實際展示的 468 步操作,正是那份野心的具體樣貌。DeepSeek V4 Pro 是給操作 API 的 agent 用的:它推理、撰寫多檔案程式碼、呼叫工具、產出長篇結構化輸出,這一切都要透過文字通道來完成,而它所服務的正是 384K 輸出上限與 1M 上下文。建立瀏覽器自動化的團隊,應該關注 Nex-N2.5 Pro。建立程式撰寫或知識工作 agent 的團隊,則應該拿 DeepSeek V4 Pro 去和封閉前沿模型比較;而 Nex-N2.5 Pro 還不夠格勝任那份工作——它無法把影像移出循環之外,而且它的程式能力宣稱,無論在水平或驗證程度上,都比不上它被拿來比較的那個模型。
結論:一個要等,另一個要建
DeepSeek V4 Pro 是這場對決中今日唯一理性的建置目標。它的權重可下載、價格公開——而且透過 flat OrcaRouter 路線,比 DeepSeek 自己的尖峰時段計價還便宜——它的宣稱也能讓任何人在一個下午內驗證。它同時也是衡量開放式電腦操作(open computer-use)成本的自然起點:將它的編碼代理流量路由至 OrcaRouter,並在官方 API 約 500 併發上限時自動容錯轉移,你就有了一條以真實價格運作的開放權重基準線。Nex-N2.5 Pro 之所以是更有趣的長期押注,正因為它是更專門化的設計——一個 17B 啟用參數的多模態操作模型,可能以 DeepSeek 擊敗封閉通用模型的方式,削價擊敗封閉式電腦操作領導者——但一個無法驗證的免費端點不能當作基礎。等到 Apache-2.0 的分片釋出、獨立測試平台跑出那個 OSWorld-2 數字時,這場對決會在一天之內改觀。在那之前,這只是在一台你能擁有的模型,與一台你只能旁觀的模型之間做比較。
本文中的比較1
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
