
Nex-N2.5 Pro vs DeepSeek V4 Pro: Solo uno de estos conjuntos de pesos abiertos es realmente abierto
- openaiNUEVOOpenAI: GPT-6 Astra2026-09-0455Inteligencia77Código
- googleNUEVOGoogle: Gemini 3.8 Flash2026-09-0247Inteligencia76Código
- qwenNUEVOQwen: Qwen3.8 Max (0902)2026-09-0247Inteligencia72Código
- anthropicNUEVOAnthropic: Claude Fable 5.12026-09-0157Inteligencia82Código
- AlibabaNUEVOQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiNUEVOZ.ai: GLM 5.3 Flash2026-08-2646Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1849Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1541Inteligencia68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1242Inteligencia69Código
- grokSpaceXAI: Grok 4.62026-08-1251Inteligencia77Código
- metaMeta: Muse Spark 1.22026-08-0547Inteligencia72Código
- qwenQwen: Qwen3.8 Max2026-08-0347Inteligencia72Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3141Inteligencia69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2454Inteligencia78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2140Inteligencia69Código
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2128Inteligencia49Código
Aquí está el secreto familiar que hace que este enfrentamiento sea más extraño de lo que parece: el propio Nex-N2.5 Max de Nex-AGI, el nivel superior de la familia que incluye al Nex-N2.5 Pro, está a su vez post-entrenado a partir de DeepSeek-V4-Pro-Base. La cobertura de las notas de la versión del 8 de septiembre lo dice abiertamente: Mini y Pro se construyen a partir de variantes de Qwen3.5, mientras que el Max de solo texto con 1,6T se apoya en la base abierta que DeepSeek publicó en agosto. Así que cuando se compara el Nex-N2.5 Pro con el DeepSeek V4 Pro, el lector está viendo cómo un proyecto de modelo abierto toma prestados los cimientos del otro para su nivel insignia y luego intenta superar al donante en el nivel inferior. Eso no es un insulto; es así como funciona la economía de pesos abiertos, y es el marco más honesto posible para una comparación en la que ambos modelos tienen licencia abierta y solo uno de ellos se puede descargar realmente hoy.
La asimetría es toda la historia. DeepSeek V4 Pro, la compilación 0813 que salió a disponibilidad general el 13 de agosto, tiene ahora mismo sus pesos con licencia MIT alojados en Hugging Face: un modelo grande de mezcla de expertos con aproximadamente 1,6 billones de parámetros en total, unos 49 mil millones activos, un contexto de 1M de tokens, un tope de salida de 384K y una API oficial detrás. Nex-N2.5 Pro, anunciado el 8 de septiembre, es un MoE disperso de 397 mil millones de parámetros con unos 17 mil millones activos, multimodal mientras que DeepSeek es solo de texto, y orientado a agentes de uso de computadora más que al uso generalista de herramientas. Su ficha en Hugging Face sigue mostrando el aviso de que los pesos estarán disponibles próximamente bajo Apache-2.0, sin fecha, mientras que solo endpoints alojados gratuitos lo sirven. El mismo compromiso filosófico con los pesos abiertos. Un estado de entrega completamente distinto.
Dos licencias, un conjunto de pesos realmente lanzado
La diferencia de licencia importa menos que la diferencia de entrega, pero establece las condiciones. DeepSeek V4 Pro tiene licencia MIT: hoy puedes descargar los fragmentos, servirlos tú mismo, afinarlos y montar un negocio con ellos sin pedir permiso a nadie, y como {{1}}los pesos están publicados, ningún proveedor controla el precio{{/1}}. Nex-N2.5 Pro se promete bajo Apache-2.0, la licencia igualmente permisiva que eligió la alianza, pero el aviso en la ficha es inequívoco: {{2}}los pesos no se pueden descargar y no se adjunta ninguna fecha{{/2}}. Para un equipo cuyo requisito es «el modelo debe ser nuestro», hoy no hay contienda: DeepSeek V4 Pro es el único candidato que realmente puedes poseer. La advertencia práctica es de doble filo: autoalojar un MoE de ~1,6T requiere una infraestructura seria, así que para la mayoría de los equipos la licencia MIT importa menos como plan de alojamiento que como garantía contra el bloqueo y como suelo para el precio. Nex-N2.5 Pro, cuando lleguen sus fragmentos, será el diseño más autoalojable: 17B de parámetros activos en un nodo con ocho H100 es una caja mucho más pequeña que la huella de referencia de DeepSeek.
Las filas donde los dos difieren
Lado a lado, los dos modelos apenas coinciden en cuanto a su propósito:
• Lanzado — Nex-N2.5 Pro: 8 de septiembre de 2026 (endpoints alojados activos, pesos pendientes). DeepSeek V4 Pro: 13 de agosto de 2026 (compilación GA 0813), pesos disponibles.
• Escala — Nex-N2.5 Pro: 397B en total / ~17B activos. DeepSeek V4 Pro: ~1.6T en total / ~49B activos.
• Modalidad — Nex-N2.5 Pro: entrada de texto e imágenes, salida de texto; diseñado para uso informático mediante lectura de pantalla. DeepSeek V4 Pro: solo texto en su API pública — sin visión nativa, ni entrada de imágenes ni audio.
• Contexto / salida — Nex-N2.5 Pro: contexto de 262 144 tokens. DeepSeek V4 Pro: contexto de 1M de tokens, hasta 384K tokens de salida.
• Control de razonamiento — Nex-N2.5 Pro: ninguno / medio (adaptativo, predeterminado) / alto. DeepSeek V4 Pro: esfuerzo de razonamiento bajo / alto / máximo en la misma cadena de modelo.
• Pesos — Nex-N2.5 Pro: Apache-2.0, próximamente. DeepSeek V4 Pro: MIT, descargable ahora.
• Superficie de API — Nex-N2.5 Pro: llamadas de chat compatibles con OpenAI en endpoints alojados gratuitos. DeepSeek V4 Pro: API nativa de OpenAI Responses, además de endpoints compatibles con Anthropic, llamadas a herramientas y salida JSON.
Dos productos genuinamente diferentes comparten la palabra "open". Nex-N2.5 Pro está diseñado para mirar una pantalla y manejarla; DeepSeek V4 Pro está diseñado para pensar, escribir código y llamar herramientas: la diferencia entre un operador y un analista.

¿Qué se mide y qué se toma prestado?

El panorama de los benchmarks es tan desigual como el de la disponibilidad. DeepSeek V4 Pro tiene una huella cuantificada e independiente: una entrada en el Artificial Analysis Intelligence Index, semanas de cobertura de prensa y tráfico de producción desde el GA 0813, y cifras de codificación del proveedor — Terminal-Bench 2.1 con 87,9 y DeepSWE con 62,7 según el propio DeepSeek — que, como mínimo, se asientan sobre un modelo que cualquiera puede descargar y volver a ejecutar. Nex-N2.5 Pro no tiene nada de eso. Sus cifras más destacadas — OSWorld-2 con 56,4, Terminal-Bench 2.1 con 82,7, SWE-Bench Pro con 61,2 y BrowseComp con 89,7 — son todas mediciones propias de Nex-AGI a través de su herramienta NexCUA, que la alianza dice que publicará como código abierto, pero que aún no ha publicado. En las primeras 48 horas posteriores al lanzamiento, ningún laboratorio independiente había ejecutado Nex-N2.5 Pro, porque nadie fuera de la alianza puede hacerlo.
Lee los dos conjuntos de afirmaciones uno al lado del otro y la conclusión honesta no es “DeepSeek es más inteligente”. Es “Las cifras de DeepSeek son verificables y las de Nex-N2.5 Pro no lo son”. Donde las dos fichas de los proveedores sí coinciden —Terminal-Bench 2.1—, DeepSeek afirma un 87,9 frente al 82,7 de Nex-N2.5 Pro, una ventaja de cinco puntos a favor del modelo ya lanzado, que es exactamente la dirección que un lector precavido debería esperar: el modelo que ya se ha lanzado obtiene una puntuación más alta en la fila compartida que el que no.
El precio: un número real, un número programado y ningún número.
El precio de DeepSeek V4 Pro no es un solo número, y eso ya es una historia en sí misma. En el GA del 13 de agosto, la API oficial listaba $0.435 por millón de entrada y $0.87 por millón de salida; el 16 de agosto, DeepSeek trasladó la familia V4 a un esquema de horas punta/valle, por lo que la API oficial ahora cobra $0.66 de entrada / $1.98 de salida en horas valle y $1.32 / $3.96 en horas punta, con entrada en caché a $0.022 en valle y $0.044 en punta. Dependiendo de cuándo llames directamente a DeepSeek, el mismo modelo cuesta entre aproximadamente un 50 % más y cuatro veces y media la tarifa de lanzamiento. La ruta también importa: la página del modelo OrcaRouter para DeepSeek V4 Pro muestra actualmente una tarifa plana de $0.44 de entrada / $0.88 de salida por millón —la tarifa del proveedor trasladada sin recargo—, que queda por debajo incluso del esquema oficial en horas valle. Esa tarifa plana es el precio a batir si comparas el coste por token, y es el tipo de cifra que solo existe porque una capa de enrutamiento te muestra la tarifa real del proveedor en lugar de una con recargo.

Nex-N2.5 Pro no tiene precio que poner junto a nada de eso. Su nivel alojado es gratuito, y Nex-AGI no ha publicado ninguna tarifa de pago por token para la familia, así que la economía del modelo es simplemente desconocida: los endpoints gratuitos demuestran que el sistema funciona, nada más. Si los pesos se publican y un proveedor empieza a servir Nex-N2.5 Pro a un precio de lista, la comparación honesta se vuelve posible; hasta entonces, "gratis" es un mecanismo de vista previa, no una señal de mercado.
Dos tipos diferentes de agente
Elegir entre estos dos es elegir entre dos trabajos, no entre dos puntuaciones. {{1}}Nex-N2.5 Pro es para el agente que opera una computadora: lee una pantalla, mueve un cursor, edita un archivo, comprueba el resultado visual y sigue adelante — la sesión demostrada de 468 acciones en Pokémon Platinum es la forma de esa ambición.{{/1}} {{2}}DeepSeek V4 Pro es para el agente que opera una API: razona, escribe código en múltiples archivos, llama a herramientas y produce salida estructurada extensa, todo a través del canal de texto que su techo de salida de 384K y su contexto de 1M existen para servir.{{/2}} Un equipo que construya automatización de navegador debería estar observando a Nex-N2.5 Pro. Un equipo que construya un agente de codificación o de trabajo de conocimiento debería estar comparando a DeepSeek V4 Pro contra la frontera cerrada, y Nex-N2.5 Pro aún no es candidato para ese trabajo — no puede sacar la imagen del circuito, y sus afirmaciones de codificación son tanto más bajas como menos verificadas que las del modelo con el que se le compara.
El veredicto: esperar en uno, construir en el otro.
{{1}}DeepSeek V4 Pro es el único objetivo de compilación racional en este enfrentamiento hoy en día. Sus pesos son descargables, su precio es conocido —y más barato a través de la ruta plana de OrcaRouter que en el propio programa de tarifas pico de DeepSeek— y sus afirmaciones pueden ser verificadas por cualquiera en una tarde. También es el lugar natural para empezar a medir cuánto costará el uso abierto de ordenadores: enruta su tráfico de agentes de codificación a través de OrcaRouter con conmutación por error automática alrededor del límite de ~500 concurrencias de la API oficial, y tienes una línea base de pesos abiertos funcional a un precio real.{{/1}} {{2}}Nex-N2.5 Pro es la apuesta a largo plazo más interesante precisamente porque es el diseño más especializado —un operador multimodal de 17B activos que podría socavar a los líderes cerrados de uso de ordenadores de la misma manera que DeepSeek socavó a los generalistas cerrados— pero un endpoint gratuito no verificable no es una base sólida.{{/2}} {{3}}Cuando los fragmentos Apache-2.0 lleguen y un arnés independiente ejecute ese número de OSWorld-2, este enfrentamiento cambia de la noche a la mañana.{{/3}} {{4}}Hasta entonces, es una comparación entre un modelo que puedes poseer y un modelo que solo puedes observar.{{/4}}
Comparados en este artículo1
Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario
