
Pareto 26.10 Preview vs Pareto: la misma cadena de modelo, dos modelos diferentes
- openaiNUEVOOpenAI: GPT-6.1 Sol2026-09-2952Inteligencia
- anthropicNUEVOAnthropic: Claude Sonnet 5.52026-09-2856Inteligencia
- typesafeNUEVOTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 por 1M de tokens · 221 tok/s
- OpenAINUEVOOpenAI: GPT-6 Luna2026-09-2238Inteligencia
- OpenAINUEVOOpenAI: GPT-6 Sol2026-09-2248Inteligencia
- AnthropicNUEVOAnthropic: Claude Opus 5.52026-09-2258Inteligencia
- xAINUEVOGrok 4.72026-09-2146Inteligencia
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 por 1M de tokens · 103 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencia
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencia77Código
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencia76Código
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencia76Código
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencia82Código
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 por 1M de tokens · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens · 104 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencia72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens · 214 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencia75Código
- obsidianQwen3.8 27B2026-08-1534Inteligencia68Código
Unbiased lanzó Pareto 26.10 Preview el 1 de octubre de 2026 y dejó la versión anterior, Pareto, listada junto a ella. Las dos no son variantes de una familia entre las que se elige con una bandera. Son dos lanzamientos bajo una misma marca, y la propia cadena de modelo del proveedor — pareto — ahora se resuelve a la más nueva, explícitamente inestable. Así que la pregunta de comparación no es realmente «cuál es mejor». Es: ¿a cuál llega realmente tu solicitud, y qué le pasa a la respuesta cuando eso cambia por debajo de ti?
El único lugar donde ambos se describen en la misma frase es la ficha técnica pública del modelo. La propia tarjeta de modelo, la página de precios y las preguntas frecuentes de Unbiased describen un único producto compuesto y nunca mencionan la división. Esa asimetría —un diff público detallado por un lado, silencio por el otro— es el punto de partida honesto para una comparación cara a cara, porque te dice de dónde proviene cada número a continuación.
Seis dimensiones, ambos lados
Todo lo que separa a las versiones está en estas seis líneas. El lado izquierdo es Pareto 26.10 Preview; el derecho es la versión de Pareto del 17 de septiembre, la que el texto del catálogo de la preview llama la opción estable.
• Ventana de contexto — 1,048,576 tokens frente a 262,144 tokens. Cuatro veces más espacio, sobre el papel, sin que ninguno de los dos ofrezca un nivel más pequeño.
• Salida máxima — 131,072 tokens frente a 131,072 tokens. Sin cambios. La ventana más grande no vino acompañada de una respuesta más grande.
• Precio de entrada, según enrutamiento — $0.80 por millón frente a $2.50 por millón. La vista previa cuesta aproximadamente un tercio del precio en ese listado.
• Precio de salida, según enrutamiento — $3.20 por millón frente a $7.50 por millón. Menos de la mitad.
• Entrada en caché, según enrutamiento — $0.03 por millón frente a $0.25 por millón. Las trayectorias de agente más largas son las que más se benefician aquí.
• Hoja de benchmarks publicada — cuatro puntuaciones, explícitamente «preliminares» y «pueden cambiar antes de la publicación final», frente a ninguna tabla de benchmarks publicada en absoluto.
Dos de esas filas son las que deciden el trabajo real. La ventana de contexto es el titular que el proveedor no declarará en su propio sitio —vive en el listado, no en la ficha del modelo—, y el precio de entrada en caché es el que cambia la factura de un agente, no su techo. Todo lo demás es o bien un diferencial de marketing o, en el caso de la puntuación de salida, una admisión: publicar las cifras de una vista previa con la etiqueta "preliminar" es más honesto que la alternativa, y también es una advertencia.

El precio que ves depende de dónde mires
Pon las dos tarjetas de tarifas una al lado de la otra y no cuadran, que es la parte de esta comparación que nadie ha explicado.
La propia plataforma de Unbiased, el día en que 26.10 Preview pasó a ser la versión actual, sigue indicando $2.50 por millón de entrada, $0.25 en caché y $7.50 de salida. Esos son los precios de septiembre, sin cambios, tanto en la página de precios como en la ficha del modelo. El conjunto inferior — $0.80, $0.03, $3.20 — aparece en el listado del catálogo enrutado para esa misma versión preliminar. Así que un cliente que llama a pareto directamente a través de la API del proveedor paga la tarifa antigua por el modelo nuevo, mientras que el listado enrutado anuncia aproximadamente un tercio de eso. Ambos están activos. El proveedor no ha publicado ninguna fecha de finalización promocional ni ninguna declaración que los concilie.
Eso es una cuestión de canal y, en una versión preliminar, también es una cuestión de tiempos: cualquiera que sea el número sobre el que modeles tus costos, el otro está a una nota de versión de volverse correcto. Un enrutador que traslada el precio de lista de un proveedor con un margen del 0 % elimina exactamente esta fricción —un cambio de precio del proveedor entra en vigor el mismo día en lugar de en la próxima revisión de contrato—, y esa es la única cosa estructural que vale la pena tomar de OrcaRouter aquí. Hoy no tenemos ninguna de las dos versiones de Unbiased, así que la respuesta directa a "¿dónde lo llamo?" es la propia API de Unbiased, sobre cualquiera de los dos conjuntos de precios que tenga el listado por el que compres. La razón para decirlo en voz alta es que la diferencia es de un factor de tres, y una vista previa no es el lugar para descubrir que le pusiste precio al equivocado.
Lo que te aporta la vista previa y lo que te cuesta
La propia descripción del catálogo de la versión preliminar fija los términos: «puede cambiar sin previo aviso», y a cualquiera que necesite un comportamiento predecible se le remite de nuevo a la versión de septiembre. Eso no es una fórmula estándar —es la definición del producto. Compare eso con la forma práctica de una sesión larga de agente y la disyuntiva se vuelve concreta.
Un agente que mantiene una conversación en curso acumula contexto, y las conversaciones largas son donde el almacenamiento en caché de prompts demuestra su valor. Un modelo cambiado detrás de un endpoint sin cambios es la forma clásica de perderlo: la caché se vincula al modelo que produjo los tokens, así que un cambio de versión silencioso a mitad de trayectoria puede invalidar lo que tenías en caché y volver a facturar trabajo que creías ya pagado. La propia documentación de Unbiased argumenta este punto en la dirección opuesta —posiciona su combinación como estable en caché, mientras que un router que cambia no lo es—, así que este es un riesgo que el proveedor entiende bien y simplemente acepta a cambio de lanzar una preview. Vale la pena nombrarlo porque el fallo es invisible en un panel: tus tokens se siguen facturando, tus respuestas se siguen devolviendo, y el número simplemente es mayor que la semana pasada.
La ventaja de la preview es real y refleja la desventaja. Cuatro veces el contexto, entrada en caché a una octava parte de la tarifa del lanzamiento estable en el listado enrutado, y hasta una hoja de benchmarks: el lanzamiento de septiembre nunca tuvo puntuaciones publicadas. Si tu carga de trabajo es de contexto largo y sensible al costo, la preview es la que quieres, y la forma de tomarla sin apostar todo el stack es fijarla deliberadamente: un endpoint con nombre para la preview, un endpoint con nombre para el lanzamiento estable, y un respaldo entre ellos configurado una vez. El DSL de enrutamiento existe exactamente para esta forma de problema: compón los dos como tramos separados, envía una porción de tráfico real por cada uno y deja que el registro de solicitudes te diga cuánto costó cada uno en realidad. Una preview debería ser una decisión que puedas revertir con una sola línea de configuración, no una propiedad de tu endpoint que descubres por la factura.

Un panorama de rendimiento que no es lo bastante estable como para confiar en él.
Todos los datos anteriores proceden del listado público, y el propio panel de rendimiento del listado, leído entre medias. Una lectura de la página de la versión preliminar 26.10 informó de una latencia media de 5,28 segundos y 35 tokens por segundo; una vista comparativa publicada el mismo día informó de 3,54 segundos y 21 tokens por segundo para la versión preliminar, y de 1,05 segundos y 45 tokens por segundo para la versión de septiembre. No son discrepancias pequeñas. Un modelo completamente nuevo servido por un único proveedor tiene una base de medición escasa, y una ventana móvil de horas se desplazará.
La posición honesta es que ninguna de las dos versiones tiene una cifra de rendimiento o latencia lo bastante estable como para planificar en función de ella, y en el caso de la preview eso es algo inherente al producto, no un problema de una instantánea. La versión de septiembre al menos ha tenido semanas de tráfico: su ficha muestra una disponibilidad de varios días en los noventa altos, con un historial completo de proveedor detrás. La preview tiene horas. Si tu razón para elegir entre ambas es la velocidad en lugar del precio o el contexto, la evidencia para decidir aún no existe, y lo responsable es medir con tus propios prompts en vez de leer un número de cualquiera de las dos páginas.

A cuál llamar, y cómo dejar de preocuparse
Invoca la vista previa si tu trabajo es de contexto largo, sensible al costo y evaluable —sesiones de agentes, procesamiento por lotes, cualquier cosa en la que cuatro veces la ventana y un tercio del precio de entrada compensen el riesgo de un cambio a mitad de semana. Trátala como una prueba con una línea de configuración debajo, y conserva tus propias cifras, porque las del proveedor cambiarán.
Llama al Pareto estable si tu carga de trabajo es de producción, sensible a la latencia o está cubierta por una revisión de cumplimiento que no quiere un modelo descrito como posiblemente cambiante sin previo aviso. Renuncias a la ventana de 1M, a la caché más barata y a las puntuaciones publicadas; conservas un endpoint con historial de resultados y un nombre que signifique lo mismo la próxima semana. Para muchos equipos, ese es todo el requisito.
El error es tratar esto como una bifurcación permanente. Unbiased diseñó la división para que fuera temporal —la preview existe para ser evaluada y luego absorbida—, y la decisión que importa no es cuál de las dos eliges, sino si cambiar entre ellas es un cambio de cinco minutos o un proyecto trimestral. En un único endpoint con una única cadena de modelo, actualmente no es ninguna de las dos cosas: es un anuncio que tienes que alcanzar a captar. Configura la elección como una decisión de enrutamiento y la versión que llamas se convierte en un ajuste, que es la única postura que una versión preliminar ha recompensado de verdad.
