Hero 'Nex-N2.5 Pro vs GPT-5.6 Sol' — una tarjeta de título generada que dice 'Nex-N2.5 Pro vs GPT-5.6 Sol' con el subtítulo 'Un modelo abierto con un día de vida contra el récord de producción más profundo de la industria' y un antetítulo 'OpenAI vs Nex-AGI — septiembre de 2026'.
Guides & Insights

Nex-N2.5 Pro vs GPT-5.6 Sol: el número de proveedor del recién llegado va a la zaga del número independiente del actual.

Autor

Elias Hawthorne

Fecha de publicación

Últimos modelos · 20Ver todos los modelos
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Pongamos el único benchmark en el que ambos tienen una cifra lado a lado, y el orden de las operaciones está mal para un lanzamiento. La ficha de Nex-AGI otorga a Nex-N2.5 Pro un 56,4 en OSWorld-2, medido con el banco de pruebas NexCUA, propio de la alianza, que el público no ha visto. El ranking de OSWorld 2.0 de BenchLM, actualizado el 29 de agosto, sitúa a GPT-5.6 Sol en 62,6: una cifra independiente que supera con creces la cifra del fabricante del recién llegado. En el terreno de juego del modelo de un día — el uso de la computadora mediante lectura de pantalla, lo único para lo que está expresamente diseñado — el generalista maduro con el que se lo compara ni siquiera necesita un asterisco para quedar por delante. Nex-N2.5 Pro vs GPT-5.6 Sol no es un duelo reñido en ninguna dimensión medida por alguien que no sea el creador del recién llegado. Es un caso de estudio de lo que vale un historial en producción, y merece la pena leerlo solo por eso.

Los dos modelos apenas son rivales en intención. Nex-N2.5 Pro, anunciado el 8 de septiembre de 2026, es un modelo de mezcla dispersa de expertos de 397 mil millones de parámetros con aproximadamente 17 mil millones de parámetros activos, multimodal (entrada de texto e imagen, salida de texto), post-entrenado a partir de la línea Qwen3.5, y construido para operar computadoras y navegadores mediante un bucle de retroalimentación visual. Sus pesos bajo Apache-2.0 siguen marcados como «próximamente» en Hugging Face, y sus únicas versiones en vivo son los endpoints alojados gratuitos que Nex-AGI enlaza desde su ficha. GPT-5.6 Sol es el buque insignia de OpenAI para «el trabajo más difícil»: razonamiento profundo de múltiples pasos, ingeniería de software a gran escala y flujos de trabajo agénticos de largo horizonte, en la API desde el 9 de julio, con pesos cerrados, y ahora cargando con el peso de haber sido el punto de referencia de frontera hasta que OpenAI lanzó GPT-6 Astra el 3 de septiembre. Mientras que Nex-N2.5 Pro es un especialista que no ha publicado sus propios pesos, GPT-5.6 Sol es un generalista probado que ha estado disponible durante dos meses en el tráfico de producción más exigente de la industria.

GPT-5.6 Sol es el modelo con un archivo

Empieza con lo que Sol tiene y Nex-N2.5 Pro no: un historial. Desde el 9 de julio, GPT-5.6 Sol ha sido probado con bancos de pruebas independientes, sometido a pruebas exhaustivas por investigadores de seguridad, e incorporado a marcos de agentes y flujos de trabajo de Codex. Sus mediciones independientes son amplias y públicas: 61 en el Artificial Analysis Intelligence Index con razonamiento máximo, 88.0 en Terminal-Bench 2.1 y 73.0 en DeepSWE medidos por el mismo banco de pruebas independiente, y una velocidad de salida medida de alrededor de 71 tokens por segundo con un costo de aproximadamente $0.95 por tarea del Intelligence Index. Nada de eso lo hace imbatible —OpenAI ha posicionado desde entonces a GPT-6 Astra por encima—, pero cada uno de esos números es una medición producida por alguien que no es OpenAI. Nex-N2.5 Pro no tiene ninguna entrada independiente en ningún sitio, por una razón estructural: nadie fuera de la alianza puede ejecutarlo.

El único punto de referencia donde ambos tienen un número

La comparación de OSWorld es la lectura más limpia disponible, por lo que merece que se expongan sus advertencias antes de utilizarla. El 56.4 de Nex-N2.5 Pro es la medición propia de Nex-AGI en OSWorld-2 mediante su banco de pruebas NexCUA. El 62.6 de GPT-5.6 Sol proviene de la tabla de clasificación OSWorld 2.0 elaborada por BenchLM, una instantánea de terceros con fecha del 29 de agosto de 2026, que enumera quince modelos y sitúa a Claude Opus 5 primero con 70.6, a GPT-5.6 Sol segundo con 62.6 y a GPT-5.6 Terra tercero con 50.2. "OSWorld-2" y "OSWorld 2.0" son parientes cercanos, pero no se ha demostrado que sean idénticos, por lo que la diferencia exacta de cuatro a seis puntos debe interpretarse como direccional más que precisa. Lo que sobrevive a las advertencias es el orden: según la mejor cifra que cada parte puede presentar, una cifra independiente de Sol supera a una cifra de Nex medida por su propio proveedor en el benchmark que Nex eligió publicar. Un recién llegado cuya propia cifra es inferior a la cifra independiente del titular no ha presentado un argumento convincente para pasarse a él.

A two-column scoreboard titled 'Nex-N2.5 Pro vs GPT-5.6 Sol — the scoreboard'. Left column Nex-N2.5 Pro: Announced Sep 8 2026; Weights Apache-2.0 pending; OSWorld 2.0 56.4 vendor-reported; AA Index no score yet; Context 262,144; Price free hosted / no list. Right column GPT-5.6 Sol: Released Jul 9 2026; Weights closed; OSWorld 2.0 62.6 independent; AA Index 61 (max); Context ~1.05M; Price $4.00 / $20.00 per 1M. Footer: 'Nex figures vendor-reported via NexCUA harness; Sol OSWorld per BenchLM Aug 29 and Index per Artificial Analysis.'

Spec envelopes

El resto de la hoja de especificaciones sigue la misma dirección:

Lanzado — Nex-N2.5 Pro: 8 de septiembre de 2026 (endpoints alojados activos, pesos pendientes). GPT-5.6 Sol: 9 de julio de 2026, disponible de forma general.

Escala — Nex-N2.5 Pro: 397B en total / ~17B activos (MoE). GPT-5.6 Sol: número de parámetros no revelado.

Modalidad — Nex-N2.5 Pro: entrada de texto e imagen, salida de texto, bucle de visión para uso de computadora. GPT-5.6 Sol: entrada de texto, imagen y archivos, salida de texto, con llamada a herramientas y modo JSON.

Contexto / salida — Nex-N2.5 Pro: contexto de 262 144 tokens. GPT-5.6 Sol: contexto de ~1,05 M tokens, con tope de salida de 128 K.

Control de razonamiento — Nex-N2.5 Pro: ninguno / medio (adaptativo, predeterminado) / alto. GPT-5.6 Sol: esfuerzo de razonamiento hasta el máximo, más un nivel separado de procesamiento rápido.

Pesos — Nex-N2.5 Pro: Apache-2.0, próximamente. GPT-5.6 Sol: cerrado.

Precio por 1M de tokens — Nex-N2.5 Pro: nivel gratuito alojado, sin precio de lista. GPT-5.6 Sol: $4.00 / $20.00 como precio promocional de lista desde el 21 de agosto, $0.40 por entrada en caché, con reclasificación a $8.00 / $30.00 por encima de 272K tokens de entrada.

El contexto de ~1.05M tokens de Sol y su límite de salida de 128K empequeñecen la ventana de 262K de Nex-N2.5 Pro para trabajo de largo horizonte, y el precio de Sol, aunque dista mucho de ser barato, es una cifra establecida que un presupuesto puede modelar. El nivel gratuito de Nex-N2.5 Pro es el único número a su favor, y no es un precio.

Lo que vale una puntuación de un día

Screenshot of the Nex-N2.5-Pro model card on Hugging Face showing the banner 'Nex-N2.5-Pro weights are coming soon' above the family introduction text.

Toda afirmación de benchmark asociada a Nex-N2.5 Pro — OSWorld-2 con 56.4, Terminal-Bench 2.1 con 82.7, SWE-Bench Pro con 61.2, BrowseComp con 89.7 — comparte una propiedad: la produjo Nex-AGI, a través de un harness que la alianza afirma que liberará como código abierto, pero que aún no ha liberado. Ninguna de esas cifras ha sido reproducida de forma independiente, porque ninguna puede serlo: los pesos no se pueden descargar y el banner de «próximamente» no tiene ninguna fecha asociada. Eso importa más en este enfrentamiento que en la mayoría, porque el modelo con el que se compara a Nex-N2.5 Pro tiene el historial independiente más largo de la industria. Cuando toda la base de evidencia del retador es autoinformada y la del vigente no lo es, la carga de la prueba recae por completo sobre el retador, y un endpoint gratuito no lo exime de ella. En el momento en que los shards estén disponibles y un laboratorio independiente ejecute Nex-N2.5 Pro, las cifras de este artículo podrán comprobarse y la comparación se volverá real. Hasta entonces, «puntuación de un día» es la frase precisa: una puntuación que no puede inspeccionarse en un modelo que no puede ejecutarse.

Precio, ruta y la forma de la decisión.

El costo es donde las dos partes son menos comparables, porque solo una de ellas tiene un costo. La tarifa de $4.00 / $20.00 de GPT-5.6 Sol es el precio de lista promocional de OpenAI, en vigor desde el 21 de agosto y que, según lo anunciado, se mantendrá al menos hasta el 21 de noviembre, tras bajar desde $5.00 / $30.00 — un recorte que hizo que el modelo insignia fuera drásticamente más asequible para el trabajo agéntico de alto volumen, y que un enrutador de pase directo refleja el mismo día en que OpenAI lo aplica. Sol está en OrcaRouter a ese precio de lista, sin margen adicional, con la modalidad por lotes y la modalidad rápida disponibles bajo la misma clave de API que otros 200+ modelos, de modo que un equipo puede enrutar hacia Sol las solicitudes que necesitan la profundidad de OpenAI y hacia todo lo demás las que pueden resolverse con modelos más baratos. Nex-N2.5 Pro no tiene precio de lista, solo sus endpoints alojados gratuitos — lo cual es una buena manera de evaluar un modelo, pero una base pobre para un presupuesto de producción. No se puede planificar un gasto en torno a un número que no existe, ni se puede planificar una arquitectura en torno a pesos que no se han publicado.

Screenshot of the OrcaRouter model page for GPT-5.6 Sol (openai/gpt-5.6-sol), marked FEATURED, showing the header stats $4.00 input and $20.00 output per million tokens and the byline 'by OpenAI - 2026-07-09'.

La decisión que este enfrentamiento realmente obliga a tomar es una cuestión de riesgo, no de capacidad. Si necesitas un modelo que siga ahí el próximo trimestre, con un precio conocido, un perfil de fallas conocido y meses de pruebas adversariales a sus espaldas, GPT-5.6 Sol es la opción racional — y que OpenAI haya lanzado GPT-6 Astra por encima solo refuerza el argumento, porque Sol es ahora el caballo de batalla probado, con el recorte de precio apuntando directamente al volumen de producción. Si estás construyendo agentes de uso de computadora sobre pesos abiertos y puedes darte el lujo de esperar algo verificable, Nex-N2.5 Pro merece que lo observes — un especialista multimodal de 17B activos es exactamente el tipo de modelo que ha socavado repetidamente a la frontera cerrada en costo. Pero «observar» es la palabra clave. En todas las dimensiones medidas por cualquiera que no sea su creador, Nex-N2.5 Pro va por detrás del modelo que tiene el archivo, y hasta que no se publiquen los pesos, ahí termina la comparación.

Comparados en este artículo1

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario

© 2026 OrcaRouter

Para proveedores

¿Operas una plataforma de inferencia? Publica tus modelos en OrcaRouter.

providers@orcarouter.ai

Únete a la comunidad

Discordsupport@orcarouter.aiXGitHubYouTube