
Nex-N2.5 Pro vs DeepSeek V4 Pro: 이 오픈 웨이트 중 실제로 오픈된 것은 단 하나뿐
- openaiNEWOpenAI: GPT-6 Astra2026-09-0455지능77코딩
- googleNEWGoogle: Gemini 3.8 Flash2026-09-0247지능76코딩
- qwenNEWQwen: Qwen3.8 Max (0902)2026-09-0247지능72코딩
- anthropicNEWAnthropic: Claude Fable 5.12026-09-0157지능82코딩
- AlibabaNEWQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100만 토큰당
- z-aiNEWZ.ai: GLM 5.3 Flash2026-08-2646지능72코딩
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 100만 토큰당
- z-aiZ.ai: GLM 5.32026-08-1849지능75코딩
- obsidianQwen3.8 27B2026-08-1541지능68코딩
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1242지능69코딩
- grokSpaceXAI: Grok 4.62026-08-1251지능77코딩
- metaMeta: Muse Spark 1.22026-08-0547지능72코딩
- qwenQwen: Qwen3.8 Max2026-08-0347지능72코딩
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3141지능69코딩
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100만 토큰당
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2454지능78코딩
- googleGoogle: Gemini 3.6 Flash2026-07-2140지능69코딩
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2128지능49코딩
이 대결이 보기보다 더 낯설게 만드는 패밀리 비밀이 있습니다. Nex-N2.5 Pro를 포함한 패밀리의 최상위 티어인 Nex-AGI의 Nex-N2.5 Max는 그 자체로 DeepSeek-V4-Pro-Base를 기반으로 사후 학습된 모델입니다. 9월 8일 릴리스 노트를 다룬 보도는 이를 공개적으로 밝힙니다. Mini와 Pro는 Qwen3.5 변형 모델 기반이고, 텍스트 전용 1.6T Max는 DeepSeek가 8월에 공개한 오픈 베이스 위에 서 있습니다. 그러니 Nex-N2.5 Pro가 DeepSeek V4 Pro와 비교될 때, 독자는 한 오픈 모델 프로젝트가 다른 프로젝트의 기반을 자체 플래그십 티어에 차용한 뒤, 그 기반을 제공한 쪽을 한 단계 아래 티어에서 앞지르려는 모습을 지켜보는 셈입니다. 이는 모욕이 아닙니다. 오픈 가중치 경제가 작동하는 방식이 바로 이것이며, 두 모델 모두 오픈 라이선스이면서 실제로 오늘 다운로드할 수 있는 모델은 그중 하나뿐이라는 점을 고려할 때, 이는 가능한 한 가장 솔직한 비교 프레임이기도 합니다.
비대칭성이 전부다. DeepSeek V4 Pro는 8월 13일에 GA(일반 공개)된 0813 빌드로, MIT 라이선스의 가중치가 지금 Hugging Face에 올라와 있다. 총 파라미터 약 1조 6,000억 개에 활성 파라미터 약 490억 개, 100만 토큰 컨텍스트, 384K 출력 상한, 그리고 공식 API를 갖춘 대규모 혼합 전문가(MoE) 모델이다. 9월 8일 발표된 Nex-N2.5 Pro는 활성 파라미터 약 170억 개를 가진 3,970억 파라미터 희소 MoE로, DeepSeek가 텍스트 전용인 데 반해 멀티모달이며 일반적인 도구 사용보다는 컴퓨터 사용 에이전트를 겨냥한다. 이 모델의 Hugging Face 카드에는 여전히 Apache-2.0 조건으로 가중치가 곧 공개될 예정이라는 배너만 날짜 없이 걸려 있고, 서비스는 무료 호스팅 엔드포인트뿐이다. 오픈 가중치에 대한 철학적 헌신은 동일하다. 그러나 공개 상태는 완전히 다르다.
라이선스 두 개, 실제 공개된 가중치 세트 하나
라이선스 대비는 배포 방식의 대비보다 덜 중요하지만, 그 조건을 규정한다. DeepSeek V4 Pro는 MIT 라이선스다. 오늘 바로 샤드를 내려받아 직접 서빙하고, 파인튜닝하고, 누구의 허가도 없이 이를 기반으로 비즈니스를 구축할 수 있다. 가중치가 공개되어 있으므로 어떤 단일 호스트도 가격을 통제할 수 없다. Nex-N2.5 Pro는 얼라이언스가 선택한 동등하게 허용적인 라이선스인 Apache-2.0으로 약속되었지만, 카드에 걸린 배너는 명확하다. 가중치는 다운로드할 수 없고, 날짜도 명시되어 있지 않다. "모델은 우리 것이어야 한다"는 요건을 가진 팀에게 이번 대결은 현재로서는 경쟁 자체가 성립하지 않는다. DeepSeek V4 Pro만이 실제로 소유할 수 있는 유일한 후보다. 현실적인 주의점은 양방향으로 작용한다. 약 1.6T 규모의 MoE 자체 호스팅은 상당한 인프라를 요구하므로, 대부분의 팀에게 MIT 라이선스는 호스팅 방안이라기보다 락인 방지 보장이자 가격 하한선으로서 더 중요한 의미를 갖는다. Nex-N2.5 Pro는 샤드가 공개되면 자체 호스팅에 더 유리한 설계가 될 것이다. H100 8대 노드에서 17B 활성 매개변수를 구동하는 것은 DeepSeek의 레퍼런스 설치 규모보다 훨씬 작은 박스이기 때문이다.
둘이 다른 행
나란히 놓고 보면, 두 모델은 그 용도에서 거의 겹치지 않는다:
• 출시 — Nex-N2.5 Pro: 2026년 9월 8일 (호스팅 엔드포인트 사용 가능, 가중치 준비 중). DeepSeek V4 Pro: 2026년 8월 13일 (0813 GA 빌드), 가중치 사용 가능.
• 규모 — Nex-N2.5 Pro: 총 397B / 활성 ~17B. DeepSeek V4 Pro: 총 ~1.6T / 활성 ~49B.
• 모달리티 — Nex-N2.5 Pro: 텍스트 및 이미지 입력, 텍스트 출력 — 화면을 읽으며 컴퓨터를 사용하는 용도에 적합. DeepSeek V4 Pro: 공개 API에서는 텍스트 전용 — 기본 제공되는 비전(이미지) 또는 오디오 입력 없음.
• 컨텍스트 / 출력 — Nex-N2.5 Pro: 262,144 토큰 컨텍스트. DeepSeek V4 Pro: 1M 토큰 컨텍스트, 최대 384K 출력 토큰.
• 추론 제어 — Nex-N2.5 Pro: 없음 / 중간(적응형, 기본값) / 높음. DeepSeek V4 Pro: 동일한 모델 문자열에서 낮음 / 높음 / 최대 추론 노력.
• 가중치 — Nex-N2.5 Pro: Apache-2.0, 곧 출시 예정. DeepSeek V4 Pro: MIT, 지금 다운로드 가능.
• API 표면 — Nex-N2.5 Pro: 무료 호스팅 엔드포인트에서 OpenAI 호환 채팅 호출을 지원합니다. DeepSeek V4 Pro: OpenAI Responses API를 네이티브로 지원하며 Anthropic 호환 엔드포인트, 도구 호출 및 JSON 출력을 제공합니다.
진정으로 서로 다른 두 제품이 "open"이라는 단어를 공유합니다. Nex-N2.5 Pro는 화면을 보고 구동하도록 설계되었고, DeepSeek V4 Pro는 생각하고, 코드를 작성하고, 도구를 호출하도록 설계되었습니다 — 운영자와 분석가의 차이입니다.

무엇이 측정되고, 무엇이 차용되는가

벤치마크 지형은 공급 지형만큼이나 한쪽으로 치우쳐 있다. DeepSeek V4 Pro는 측정 가능하고 독립적인 족적을 남겼다. Artificial Analysis Intelligence Index 등재, 0813 GA 이후 수 주간 이어진 언론 보도와 프로덕션 트래픽, 그리고 DeepSeek 자체 발표 기준으로 Terminal-Bench 2.1 87.9, DeepSWE 62.7이라는 벤더 코딩 수치는, 최소한 누구나 내려받아 다시 실행할 수 있는 모델을 기반으로 한 수치다. Nex-N2.5 Pro에는 그런 것이 전혀 없다. 이 모델의 대표 수치인 OSWorld-2 56.4, Terminal-Bench 2.1 82.7, SWE-Bench Pro 61.2, BrowseComp 89.7은 모두 Nex-AGI가 자체 NexCUA 하네스를 통해 측정한 값이다. Nex-AGI 측은 이 하네스를 오픈소스로 공개하겠다고 밝혔지만 아직 공개하지 않았다. 출시 후 48시간 동안 어떤 독립 연구소도 Nex-N2.5 Pro를 실행하지 못했는데, 동맹 외부에서는 아무도 실행할 수 없기 때문이다.
두 업체의 주장을 나란히 읽으면, 정직한 결론은 "DeepSeek이 더 똑똑하다"가 아니라 "DeepSeek의 수치는 검증 가능하고 Nex-N2.5 Pro의 수치는 그렇지 않다"이다. 두 공급업체 시트가 겹치는 부분 — Terminal-Bench 2.1 — 에서 DeepSeek은 87.9를, Nex-N2.5 Pro는 82.7을 주장하는데, 이는 기존 업체에 유리한 5포인트 차이로, 신중한 독자가 기대할 바로 그 방향이다: 출시된 모델이 공유된 행에서 출시되지 않은 모델보다 더 높게 측정된다.
가격: 실수, 예정된 숫자, 그리고 숫자가 없음
DeepSeek V4 Pro의 가격은 단일 숫자가 아니며, 그 자체가 하나의 이야기입니다. 0813 GA 당시 공식 API는 입력 100만 토큰당 $0.435, 출력 100만 토큰당 $0.87을 책정했습니다. 8월 16일 DeepSeek는 V4 제품군을 피크/오프피크 요금제로 전환했고, 이제 공식 API는 오프피크에 입력 $0.66 / 출력 $1.98, 피크에 입력 $1.32 / 출력 $3.96을 청구하며, 캐시된 입력은 오프피크 $0.022, 피크 $0.044입니다. DeepSeek를 직접 호출하는 시점에 따라, 동일한 모델의 비용은 출시 요금 대비 약 50% 더 비싼 수준에서 4.5배에 이르기까지 달라집니다. 경로(라우팅)도 중요합니다. OrcaRouter의 DeepSeek V4 Pro 모델 페이지는 현재 입력 $0.44 / 출력 $0.88(100만 토큰당)이라는 고정 요금을 제시하는데, 이는 프로바이더의 요율을 마크업 없이 그대로 통과시킨 것으로, 공식 오프피크 요금표보다도 저렴합니다. 토큰당 비용을 비교한다면 이 고정 경로가 기준이 되는 가격이며, 이런 숫자는 라우팅 계층이 재책정된 요금이 아닌 프로바이더의 실제 요율을 보여주기 때문에만 존재할 수 있는 종류의 숫자입니다.

Nex-N2.5 Pro는 그 어느 것과 비교해 나란히 놓을 가격이 없습니다. 호스팅 티어는 무료이며, Nex-AGI는 해당 제품군에 대해 유료 토큰당 요금을 공개하지 않았습니다. 따라서 이 모델의 경제성은 단순히 알 수 없습니다. 무료 엔드포인트는 빌드가 작동한다는 것만 증명할 뿐입니다. 웨이트(가중치)가 공개되고 어떤 제공업체가 Nex-N2.5 Pro를 정가로 서비스하기 시작하면 정직한 비교가 가능해집니다. 그때까지 '무료'는 프리뷰 메커니즘이지 시장 신호가 아닙니다.
서로 다른 두 종류의 에이전트
이 둘 중 하나를 고르는 것은 두 점수 사이가 아니라 두 가지 작업 사이에서 고르는 일입니다. Nex-N2.5 Pro는 컴퓨터를 조작하는 에이전트를 위한 모델입니다. 화면을 읽고, 커서를 움직이고, 파일을 편집하고, 시각적 결과를 확인하면서 계속 나아갑니다. Pokemon Platinum에서 시연된 468-액션 세션이 바로 그 야망의 형태입니다. DeepSeek V4 Pro는 API를 조작하는 에이전트를 위한 모델입니다. 추론하고, 여러 파일에 걸친 코드를 작성하고, 도구를 호출하며, 긴 구조화된 출력을 만듭니다. 이 모든 과정은 전적으로 텍스트 채널을 통해 이뤄지며, 384K 출력 상한과 1M 컨텍스트는 바로 그 텍스트 채널을 뒷받침하기 위해 존재합니다. 브라우저 자동화를 구축하는 팀이라면 Nex-N2.5 Pro를 주시해야 합니다. 코딩 또는 지식 작업 에이전트를 구축하는 팀이라면 DeepSeek V4 Pro를 폐쇄형 프런티어 모델과 비교해야 하며, Nex-N2.5 Pro는 아직 그 작업의 후보가 아닙니다. 이미지를 루프에서 빼낼 수 없고, 코딩 역량에 대한 주장도 비교 대상 모델보다 낮을 뿐 아니라 검증도 덜 되어 있기 때문입니다.
결론: 하나는 기다리고, 다른 하나는 건설하라.
오늘 이 매치업에서 DeepSeek V4 Pro는 유일하게 합리적인 구축 대상이다. 가중치를 내려받을 수 있고, 가격도 공개되어 있다 — DeepSeek 자체 피크 요금제를 쓰는 것보다 정액제 OrcaRouter 경로가 더 저렴하다 — 그 주장은 누구나 오후 한나절이면 검증할 수 있다. 또한 오픈 컴퓨터 사용(computer-use)의 비용 측정을 시작하기에 자연스러운 출발점이기도 하다. 코딩 에이전트 트래픽을 OrcaRouter로 라우팅해 공식 API의 동시성 상한(약 500건)을 자동 장애 조치(failover)로 우회하면, 실제 가격에 작동하는 오픈-가중치 베이스라인을 확보하게 된다. Nex-N2.5 Pro는 더 전문화된 설계 — DeepSeek가 폐쇄형 범용 모델들을 가격으로 압도했던 것과 같은 방식으로 폐쇄형 컴퓨터 사용 선두 주자들을 가격으로 압도할 수 있는 17B-액티브 멀티모달 오퍼레이터 — 라는 점에서 더 흥미로운 장기 베팅이다. 그러나 검증할 수 없는 무료 엔드포인트는 기반이 될 수 없다. Apache-2.0 샤드들이 공개되고 독립적인 하네스가 그 OSWorld-2 수치를 돌리는 순간, 이 매치업은 하룻밤 사이에 바뀐다. 그때까지는 소유할 수 있는 모델과 지켜볼 수만 있는 모델 사이의 비교일 뿐이다.
이 글에서 비교한 모델1
이 글에서 자동 인식 · 벤치마크: Artificial Analysis · 매일 업데이트
