Tarjeta de título generada titulada «Step 5 Preview vs GLM-5.5 — uno se lanza, el otro no» con dos columnas: Step 5 Preview en AA Index 44, 600B en total / 27B activos, precio $1.00 / $2.70, salida de 99.8 tokens/seg y una API en vivo desde el 20 de septiembre; GLM-5.5 con filas que indican sin ficha de modelo, sin identificador de API, sin precios y sin nombre confirmado. Un pie de página dice: «Las cifras de Step 5 Preview según Artificial Analysis; GLM-5.5 es un modelo no anunciado y no lanzado.»
Guides & Insights

Vista previa de Step 5 vs. GLM-5.5: un modelo se lanza hoy, el otro aún es solo un pronóstico

Autor

Gideon Frost

Fecha de publicación

Últimos modelos · 20Ver todos los modelos
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Step 5 Preview abrió su API el 20 de septiembre de 2026, el mismo día en que StepFun lo anunció, y puedes llamarla esta tarde desde un único endpoint a $1.00 por millón de tokens de entrada y $2.70 por millón de tokens de salida. GLM-5.5 no existe. No hay ficha del modelo, ni identificador de API, ni precio, ni checkpoint, ni archivo de licencia, y no hay ninguna página de Z.ai que use ese nombre, porque GLM-5.5 es una abreviatura de la comunidad que la empresa nunca ha adoptado. Esa asimetría es el artículo. Lo que sigue es lo que StepFun lanzó realmente, lo que está genuinamente establecido sobre el próximo buque insignia de Z.ai, y el cara a cara que puedes ejecutar hoy en lugar del que aparece en el título.

Qué es GLM-5.5 y qué no es

El nombre entró en circulación a mediados de 2026 vinculado a una ventana de lanzamiento, y esa ventana tiene un origen rastreable: un pronóstico de analista difundido el 25 de junio de 2026 que situaba el próximo buque insignia de Z.ai en agosto. Era una ventana de seguimiento, no un compromiso del proveedor, y agosto terminó sin que se materializara. Lo que Z.ai lanzó en su lugar fue GLM-5.3, anunciado el 14 de agosto, con su API activa alrededor del 18 de agosto y pesos abiertos el 28 de agosto, seguido de GLM-5.3-Flash el 26 de agosto. Ningún checkpoint de GLM-5.5 ha aparecido en la propia organización de Hugging Face del proveedor, donde los repositorios más recientes siguen llegando como máximo hasta la serie GLM-5.3.

La nomenclatura tampoco está resuelta. GLM-5.3, GLM-5.4, GLM-5.5 y GLM-6 se han barajado en la misma ventana, y Z.ai no ha confirmado ninguno de ellos. La única señal por parte de la empresa es el comentario de un cofundador sobre un lanzamiento "epic plus", que es más una impresión que una especificación. Los analistas que interpretan la cadencia del proveedor —aproximadamente un modelo insignia cada 54 a 70 días— ahora proyectan el próximo modelo en una ventana que abarca del 8 de octubre al 9 de noviembre de 2026, y esperan que se numere como GLM-5.4 en lugar de GLM-5.5.

Circulan tres afirmaciones como si estuvieran confirmadas, y conviene ser exactos respecto a las tres. El recuento de parámetros es el más débil: nada oficial respalda la cifra de «más de 1 billón», y publicaciones posteriores en redes sociales que la inflan por encima de los 3 billones no citan absolutamente nada. El contexto de 1 millón de tokens es la suposición más segura, porque tanto GLM-5.2 como GLM-5.3 lo incorporan. Los pesos abiertos son una expectativa más que una promesa: Z.ai ha publicado los pesos de sus últimos varios modelos insignia, lo cual es un patrón, no un compromiso.

Lo que Step 5 Preview realmente incluye

El modelo de StepFun es la mitad concreta de esta comparación, y la especificación es inusual. Es un modelo disperso de mezcla de expertos con 600 mil millones de parámetros totales y aproximadamente 27 mil millones activos por token —una proporción de activación cercana al 4,5 %—, construido sobre un transformer estrecho y profundo de 92 capas con atención de consultas agrupadas dispersa y fusión de tokens por bloques. La ventana de contexto es de 1 millón de tokens, la entrada es texto e imágenes, la salida es texto, y razona con pensamiento extendido. StepFun se saltó toda la línea Step 4.x para llegar aquí, pasando directamente de Step-3.7-Flash a Step 5.

• Índice de Inteligencia — 44 en Artificial Analysis, 24º de 200 modelos evaluados, frente a una mediana de 24

• Velocidad de salida — 99,8 tokens por segundo, 45.º de 200

• Tiempo hasta el primer token — 2,96 segundos en la misma ejecución independiente

• Precio — $1.00 por 1M de tokens de entrada, $2.70 por 1M de tokens de salida, con un 95% de descuento en caché

• Coste por tarea del Intelligence Index — 0,71 $, 27.º de 200

• Pesos — ninguno hoy; un checkpoint BF16 está programado para el 15 de octubre de 2026

• Licencia: no se ha publicado ninguna. El modelo es propietario y no se declara ninguna concesión de uso comercial, derecho de redistribución ni permiso de ajuste fino.

El precio es la fila que llama la atención, y también lo es una que favorece a StepFun menos de lo que parece a primera vista: 160M de tokens de salida en el Intelligence Index frente a una mediana de 92M, puesto 64 de 200 en esa medida. El modelo es verboso, y la verbosidad es un multiplicador de costes precisamente en las cargas de trabajo agénticas para las que se vende. La cifra de 0,71 $ de coste por tarea ya lo incluye, y por eso es el número más honesto de citar que el precio de lista.

Las evaluaciones propias de StepFun no se han reproducido y deberían leerse como material del proveedor hasta que alguien independiente las ejecute. Sitúan el modelo en 29,5 en ALE-CLI, 66,4 en FrontierFinance, 83,3 en DRACO, 80,5 en ProgramBench, 67,7 en DeepSWE v1.1 y 49,0 en StepCodeBench, con un 33,3 % en Terminal-Bench 4.0 y 1571 en GDPval-AA v2. StepFun también informa de un pico MLA de 508 TFLOPS en una tarea de optimización de kernels de GPU de 24 horas, frente a 493 de Claude Opus 5. Esos son los números de StepFun sobre un modelo que StepFun no ha abierto.

Screenshot of the Artificial Analysis model page for Step 5 Preview, showing StepFun as the creator with a September 2026 release date, an Intelligence Index of 44 at rank 24 of 200, output speed 99.8 tokens per second at rank 45 of 200, cost per Intelligence Index task $0.71 at rank 27 of 200, verbosity 160M output tokens against a 92M median, pricing of $1.00 per million input tokens and $2.70 per million output tokens with a 95% cache discount, and technical specifications listing reasoning support, text and image input, and a 1M-token context window.

La comparativa directa que puedes ejecutar en lugar de esta

Si quieres la comparación que promete el título, el sustituto honesto es Step 5 Preview frente a GLM-5.3 — el modelo que Z.ai realmente lanzó, que sigue siendo su actual buque insignia abierto, y el que cualquier GLM-5.5 reemplazaría. En la tabla independiente, a los dos les separa un punto. En casi todo lo demás, no lo están.

• Índice de Inteligencia — Vista previa del Paso 5 44 vs GLM-5.3 45

• Parámetros — 600B totales / 27B activos vs 753B totales / 40B activos

• Velocidad de salida — 99,8 tokens/seg vs 72,1 tokens/seg

• Tiempo hasta el primer token — 2,96 s frente a 2,99 s

• Precio por 1 millón de tokens — $1.00 de entrada / $2.70 de salida vs. $1.40 de entrada / $4.40 de salida

• Descuento de caché — 95% vs 81%

• Costo por tarea del Intelligence Index — $0,71 vs $2,01

• Modalidad de entrada — texto e imágenes frente a solo texto

• Licencia — ninguna publicada frente a una licencia personalizada de Z.ai que no es MIT

El patrón repite lo que el lanzamiento de Step 5 Preview estableció frente a todos los modelos en producción con los que se ha evaluado: una ventaja decisiva en eficiencia y un empate estadístico en capacidad. Genera tokens aproximadamente un 38% más rápido, cuesta alrededor de la mitad por millón de tokens en ambas direcciones y resulta 2,8 veces más barato por tarea de índice frente a GLM-5.3, mientras obtiene un punto menos. En la clasificación, ese 44 también lo coloca a la par de Kimi K3, algo que conviene saber antes de tratar a cualquiera de los dos como líder.

La única fila en la que Step 5 Preview está inequívocamente por detrás es la que no se puede medir con benchmarks. GLM-5.3 tiene un archivo de licencia y pesos descargables; Step 5 Preview tiene un repositorio de Hugging Face que contiene un único .gitattributes y una fecha indicada del 15 de octubre para el checkpoint BF16. Si el próximo buque insignia de Z.ai llega con pesos abiertos bajo los mismos términos personalizados que ha usado todo el año, aterriza en la única categoría en la que Step 5 Preview actualmente no tiene respuesta — que es la verdadera razón por la que vale la pena esperar una comparación con GLM-5.5 en lugar de hacerla.

Generated two-column comparison scoreboard titled 'Step 5 Preview vs GLM-5.5 — the scoreboard'. The left column gives Step 5 Preview the rows AA Index 44, parameters 600B total / 27B active, price $1.00 / $2.70, cache discount 95%, cost per index task $0.71, and API live since September 20. The right column gives GLM-5.5 the rows AA Index no model to score, parameters more than 1T rumored and unconfirmed, price none, cache discount none, cost per index task none, and availability not released. A footer reads 'Step 5 Preview figures per Artificial Analysis Intelligence Index; GLM-5.5 is an unannounced, unreleased model with no vendor or independent figures.'

Por qué esperar a GLM-5.5 es la opción costosa

El problema práctico con un modelo que ha estado a dos meses de distancia durante dos meses es que tu trabajo de evaluación no puede esperar por él. GLM-5.5 no tiene endpoint, así que no se le pueden hacer benchmarks, ni comparar precios, ni someter a pruebas de carga, ni poner detrás de una regla de respaldo. Cada semana que se dedica a planificar en torno a él es una semana de decisiones pospuestas con base en una previsión, y la previsión ya ha dejado pasar una ventana.

GLM-5.3, en cambio, está disponible en OrcaRouter bajo z-ai/glm-5.3 a $1.26 de entrada y $3.96 de salida frente a los $1.40 y $4.40 de las listas de Z.ai en su propia página. Eso se pasa sin margen, lo que significa que el número que ves es la tarifa actual del proveedor y no una que fijamos nosotros, y un cambio de precio del proveedor se refleja de nuestro lado el mismo día en lugar de en el siguiente ciclo de facturación.

Step 5 Preview no está en nuestro catálogo y no lo enrutamos. Se ejecuta en la API y el Studio propios de StepFun, y ese es el único lugar donde se ejecuta hasta que llegue el checkpoint del 15 de octubre. Lo que OrcaRouter te ofrece mientras tanto es todo lo que está al otro lado de esa comparación detrás de una sola API para más de 200 modelos: GLM-5.3 a la tarifa indicada arriba, GPT-6 Astra, DeepSeek V4 Pro, Claude Opus 5 y el resto, con conmutación automática por error entre proveedores que mantiene estable una ruta de producción mientras la curva de capacidad de una preview aún es desconocida, y el DSL de enrutamiento que compone varios de ellos en una sola llamada en lugar de una segunda integración. Compara la preview con un modelo de producción usando la misma clave; deja la ruta de producción donde está.

Screenshot of the OrcaRouter model page for GLM-5.3 at www.orcarouter.ai/models/z-ai/glm-5.3, showing the model id z-ai/glm-5.3, a 1M-token context and 131.1K max output, input pricing of $1.26 and output pricing of $3.96 per million tokens against the crossed-out list rates of $1.40 and $4.40, a seven-day median time to first token of 3.68 seconds and a 95th percentile of 10.00 seconds, seven-day traffic of 2296.2M tokens, and the endpoints and SDK snippets behind the OrcaRouter API.

¿Qué cambiaría la respuesta?

Dos fechas deciden esto. El 15 de octubre es cuando StepFun ha dicho que llega el checkpoint BF16 de Step 5 Preview, y la licencia que se distribuye junto a él es la incógnita más determinante de la comparación: una licencia permisiva haría que una ventaja de 2,8 veces en coste por tarea sea algo que posees en lugar de alquilar, y borraría el único eje en el que GLM-5.3 está claramente por delante. Una licencia restrictiva deja a GLM-5.3 como el único del par sobre el que puedes construir un producto, y convierte la diferencia de un punto en una trivialidad sobre dos modelos que usarías de forma diferente de todos modos.

El segundo es la ventana de analistas que abarca del 8 de octubre al 9 de noviembre para el próximo buque insignia de Z.ai, que puede o no llamarse GLM-5.5 y puede o no parecerse al rumor. Si llega a aparecer, lo hará como un modelo con una licencia y un checkpoint —las dos cosas que le faltan a Step 5 Preview—, y la comparación se vuelve real.

Hasta que ambas se resuelvan, la pregunta útil no es cuál de las dos es mejor, porque una de ellas no se puede ejecutar. Es sobre cuál de los modelos que existen deberías estar construyendo ahora, y si la respuesta cambia cuando aparezca el próximo checkpoint. Esa pregunta tiene una respuesta comprobable esta semana, y no requiere esperar a que un nombre se convierta en un modelo.

Comparados en este artículo3

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario