Nex-N2.5 Pro vs Gemini 3.1 Pro hero — una tarjeta de título generada que dice 'Nex-N2.5 Pro vs Gemini 3.1 Pro' con el subtítulo 'Dos buques insignia inacabados: uno lleva siete meses en vista previa, el otro tiene un día con los pesos pendientes' y un rótulo superior 'Google vs Nex-AGI: septiembre de 2026'.
Guides & Insights

Nex-N2.5 Pro vs Gemini 3.1 Pro: un modelo abierto de un día frente a una vista previa de siete meses

Autor

Elias Hawthorne

Fecha de publicación

Últimos modelos · 20Ver todos los modelos
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

La simetría más extraña de este enfrentamiento es que ambos modelos están oficialmente inacabados, y cada bando lo demuestra de una manera que el otro no puede. {{1}}Gemini 3.1 Pro Preview, el buque insignia multimodal cerrado de Google, lleva en vista previa desde el 19 de febrero de 2026 — siete meses, una eternidad para un modelo de frontera — y su creador aún no ha declarado la disponibilidad general. Nex-N2.5 Pro, el modelo de uso de computadoras con 397 mil millones de parámetros de la alianza de modelos abiertos Nex-AGI, tiene un día de vida al momento de escribir esto y ya está respondiendo al tráfico de endpoints alojados gratuitos — pero sus pesos Apache-2.0 están marcados como «próximamente» en Hugging Face, lo que lo convierte en un tipo diferente de inacabado.{{/1}} {{2}}Uno es un producto terminado en todos los sentidos, salvo por la disposición del proveedor a admitirlo. El otro es un producto inacabado en todos los sentidos, salvo por la disposición del proveedor a lanzarlo.{{/2}}

Esos dos tipos de incompletitud cambian cómo deben leerse los números que aparecen a continuación. Gemini 3.1 Pro es el actual modelo insignia de razonamiento de Google —multimodal en texto, imagen, audio, video y archivos, con un contexto de 1M de tokens, un tope de salida de 65K y un precio de $2.00 por millón de tokens de entrada y de $12.00 por millón de tokens de salida, que se incrementa cuando una solicitud supera los 200K tokens de entrada. Nex-N2.5 Pro es un modelo de mezcla dispersa de expertos de 397B en total, con unos 17B activos, entrada de texto e imagen y salida de texto, un contexto de 262 144 tokens y un bucle de visión diseñado para manejar computadoras y navegadores. Se sitúan en el mismo rango de precios, el del 'modelo agéntico premium', pero discrepan en casi todo lo demás y ninguno de los dos tiene un proveedor que lo dé por terminado.

La ficha técnica: dos modelos multimodales de clase 1M

Pon los sobres uno al lado del otro:

Estado — Nex-N2.5 Pro: anunciado el 8 de septiembre de 2026; endpoints alojados activos, pesos pendientes. Gemini 3.1 Pro: vista previa desde el 19 de febrero de 2026, aún sin disponibilidad general.

Scale — Nex-N2.5 Pro: 397B en total / ~17B activos MoE, post-entrenado a partir de la línea Qwen3.5. Gemini 3.1 Pro: número de parámetros no revelado.

Modalidad — Nex-N2.5 Pro: entrada de texto e imagen, salida de texto; la visión es el canal de retroalimentación para el uso de la computadora. Gemini 3.1 Pro: entrada de texto, imagen, audio, video y archivos, salida de texto.

Context / output — Nex-N2.5 Pro: 262,144-token context, documented serving length. Gemini 3.1 Pro: 1M-token context, 65K output ceiling.

Control de razonamiento — Nex-N2.5 Pro: ninguno / medio (adaptativo, predeterminado) / alto. Gemini 3.1 Pro: presupuesto de pensamiento ajustable; sin drama público del nivel "max".

Pesos — Nex-N2.5 Pro: Apache-2.0, próximamente. Gemini 3.1 Pro: cerrado.

Precio por 1M de tokens — Nex-N2.5 Pro: nivel alojado gratuito, sin precio de lista publicado. Gemini 3.1 Pro: $2.00 / $12.00, que suben a $4.00 / $18.00 por encima de 200K tokens de entrada, y $0.20 por entrada en caché.

Las dos fichas técnicas coinciden en muy poco más allá de "contexto largo, multimodal y costoso de construir". Las diferencias que importan son el recargo por entrada de 200K del lado de Gemini, la economía gratuita pero no verificable del lado de Nex, y el hecho de que solo Nex-N2.5 Pro está diseñado en torno a la lectura de una pantalla.

A two-column scoreboard titled 'Nex-N2.5 Pro vs Gemini 3.1 Pro — the scoreboard'. Left column Nex-N2.5 Pro: Status announced Sep 8 2026; Modality text + image; Context 262,144; Weights Apache-2.0 pending; AA Index no score yet; Price free hosted / no list. Right column Gemini 3.1 Pro: Status preview since Feb 19 2026; Modality text / image / audio / video; Context 1M / 65K output; Weights closed; AA Index ~48; Price $2.00 / $12.00 (200K step). Footer: 'Nex unmeasured independently; Gemini figures per Artificial Analysis.'

Dos maneras diferentes de estar sin terminar

Google: siete meses de vista previa como decisión de producto

El estado de vista previa de Gemini 3.1 Pro no es algo cosmético, y es cada vez más el dato más importante sobre el modelo. Los términos pre-GA de Google permiten el uso en producción, pero se reservan el derecho de cambiar el comportamiento o retirar el endpoint: un riesgo real para un equipo que coloca un buque insignia en una ruta crítica. La trayectoria del modelo no ha hecho nada para eliminar ese riesgo: se lanzó en febrero como el modelo con mayor puntuación del mercado, con 57 en el índice Artificial Analysis Intelligence en ese momento, y desde entonces se ha vuelto a medir con una escala de índice más estricta, rondando aproximadamente 48, mientras que su sucesor previsto, Gemini 3.5 Pro, pasó de un anuncio en mayo a repetidos retrasos e informes de posible cancelación. Mientras tanto, Google lanzó Gemini 3.7 Flash en agosto a $0.75 / $3.75 y Gemini 3.8 Flash a principios de septiembre, y la línea Flash, más económica, ha superado al buque insignia Pro en el índice independiente. Adoptar Gemini 3.1 Pro hoy significa adoptar un buque insignia cuyo proveedor lo mantiene en vista previa mientras sus hermanos más económicos lo superan en rango y su sucesor está en el limbo.

Nex-AGI: un día de «próximamente» como estado de entrega

Screenshot of the Nex-N2.5-Pro model card on Hugging Face showing the banner 'Nex-N2.5-Pro weights are coming soon' above the family introduction text.

El carácter incompleto de Nex-N2.5 Pro va en la dirección opuesta: se ha enviado todo excepto aquello que lo haría real. Los endpoints alojados están activos y son gratuitos, las llamadas compatibles con OpenAI funcionan, y la ficha del modelo está llena de cifras de benchmarks — OSWorld-2 con 56,4, Terminal-Bench 2.1 con 82,7, SWE-Bench Pro con 61,2, todo medido a través del propio banco de pruebas NexCUA de la alianza, que dice que publicará como código abierto pero no lo ha hecho. Pero los pesos no se pueden descargar, no hay fecha de lanzamiento adjunta al banner, y ningún laboratorio independiente ha ejecutado el modelo, porque ninguno puede. Donde Gemini 3.1 Pro es medible pero no comprometido, Nex-N2.5 Pro es comprometido pero no medible. Ambos estados deberían hacer reflexionar a un equipo de producción, por razones diferentes.

Dónde reside la evidencia independiente

El historial independiente en este enfrentamiento pertenece casi por completo a un solo lado. Gemini 3.1 Pro tiene seis meses de pruebas públicas a sus espaldas: laboratorios independientes lo han sometido a benchmarks, equipos de producción lo han golpeado sin piedad, y cuenta con una lectura actual del Artificial Analysis Intelligence Index cercana a 48 —modesta para un modelo insignia, y la razón por la que los modelos Flash más baratos de Google lo han superado, pero una medición real hecha por alguien que no es el proveedor—. Nex-N2.5 Pro no tiene nada semejante. Sus únicas puntuaciones son las del propio Nex-AGI, en un entorno de pruebas que el público no ha visto. Por tanto, la comparación que importa no es «48 contra nada»: es «un modelo cuyas debilidades están documentadas» frente a «un modelo cuyas fortalezas se afirman». Para una carga de trabajo en la que una respuesta equivocada resulta costosa, esa asimetría suele ser decisiva, independientemente de los números.

Cómo se ve el proyecto de ley de contexto largo

Ambos modelos promocionan un contexto largo, pero lo cobran de formas que revelan su intención. La ventana de 1M de tokens de Gemini 3.1 Pro tiene una tarifa de $2.00 / $12.00, que sube a $4.00 / $18.00 cuando una solicitud supera los 200K tokens de entrada: una prima de entrada de aproximadamente el 60% y una prima de salida del 50%, aplicadas precisamente a las cargas de trabajo para las que existe la ventana de 1M. Si le das un contexto de repositorio de 500K tokens en cada turno de una sesión de agente, esa prima se aplica en cada llamada. El contexto de 262K de Nex-N2.5 Pro es más modesto, pero su nivel alojado es gratuito y Nex-AGI no ha publicado ninguna tarifa de pago, así que no hay una prima de contexto largo que modelar — tampoco hay una señal de precio para saber cuánto vale el modelo. Google te dice exactamente cuánto cuesta su ventana, y el precio es alto; Nex-AGI no te dice nada, lo cual no es lo mismo que barato.

Lo que puedes enrutar hoy

Screenshot of the OrcaRouter model page for Gemini 3.1 Pro Preview (google/gemini-3.1-pro-preview) showing the header stats $2.00 input and $12.00 output per million tokens and the byline 'by Google - 2026-02-19'.

Aquí los dos lados se separan claramente para un equipo en funcionamiento. Gemini 3.1 Pro está en OrcaRouter al precio de lista de Google — los mismos $2.00 / $12.00 con el tramo de más de 200K transmitido sin cambios — y su estado de vista previa es exactamente el argumento para enrutar a su alrededor en lugar de apostar una ruta crítica en él: la conmutación por error automática significa que un fallo del modelo en vista previa o una desaprobación redirige a un respaldo sin cambiar código, y el DSL de enrutamiento te permite enviar las solicitudes que necesitan la multimodalidad de Google a Gemini mientras que los modelos más baratos absorben el tráfico rutinario. Nex-N2.5 Pro no está en OrcaRouter — ningún modelo nex-agi aparece en nuestro directorio — porque sus únicas versiones activas son los endpoints gratuitos que Nex-AGI enlaza desde su ficha. El día en que un proveedor lo ofrezca a un precio de lista real, aparecerá aquí a ese precio sin recargo, y esta comparación se vuelve ejecutable en lugar de teórica.

Quién debe tocar qué

La respuesta honesta está determinada por el tipo de riesgo que puedas absorber. Si necesitas razonamiento multimodal a escala hoy y puedes tolerar un proveedor que mantiene su buque insignia en vista previa mientras su hoja de ruta cambia, Gemini 3.1 Pro es la opción medible: seis meses de pruebas independientes son un activo real, y el ascenso de los hermanos Flash es una razón para enrutar, no para evitar la familia. Si estás construyendo agentes de uso de computadora con pesos abiertos y estás dispuesto a esperar por algo verificable, Nex-N2.5 Pro es la apuesta más interesante a largo plazo, pero aún no es una apuesta que puedas hacer, porque no puedes ejecutarlo, reproducir sus puntuaciones ni firmar un contrato que dependa de ello. Los equipos que estarán más contentos con cualquiera de las dos decisiones son aquellos que tratan a ambos modelos como lo que son: una vista previa de siete meses que ha sido probada por todos, y una vista previa de un día que no ha sido probada por nadie.