GLM 5.5: Fecha de lanzamiento, lo que se ha informado y lo que se espera
Guides & Insights

GLM 5.5: Fecha de lanzamiento, lo que se ha informado y lo que se espera

Autor

Rowan Sterling

Fecha de publicación

Últimos modelos · 20Ver todos los modelos
Benchmarks: Artificial Analysis · actualizado a diario
Volver a todas las publicaciones

Zhipu AI (ahora con la marca Z.ai) tiene una de las hojas de ruta de peso abierto más seguidas en IA, y el siguiente paso — ampliamente referido como GLM 5.5 — está generando una anticipación real. Pero hay una advertencia importante de antemano: a finales de julio de 2026, Z.ai no ha anunciado oficialmente GLM 5.5. No hay ficha del modelo, ni puntos de referencia, ni precios, ni siquiera un nombre confirmado. Lo que sí tenemos son informes creíbles sobre una ventana de lanzamiento en agosto de 2026 y una línea base muy sólida y bien documentada en GLM-5.2. Esta guía separa lo que realmente se ha informado de lo que es especulación, y utiliza GLM-5.2 para establecer expectativas fundamentadas.

Cada figura a continuación está etiquetada por fuente. GLM 5.5 no tiene especificaciones oficiales; los números concretos aquí pertenecen a GLM-5.2 (su predecesor) y son informados por el proveedor a menos que se indique lo contrario. Los informes sobre GLM 5.5 provienen de pronósticos de analistas y cobertura de prensa, no de Z.ai. Los detalles cambiarán — verifique en el lanzamiento.

TL;DR. Se espera que GLM 5.5 esté disponible alrededor de agosto de 2026, una ventana reportada por analistas de JPMorgan y difundida por Reuters y CGTN, no un compromiso de Z.ai. Las filtraciones apuntan a un modelo de pesos abiertos con más de un billón de parámetros, centrado en agentes de codificación, basado en el contexto de 1M tokens de GLM-5.2, pero nada de eso está confirmado (incluso el nombre podría terminar siendo GLM-5.3 o GLM-6). Lo sólido es GLM-5.2: un modelo MoE de 753B, con licencia MIT, contexto de 1M, que ya se sitúa entre los mejores sistemas de pesos abiertos para codificación. Usa GLM-5.2 hoy; adoptar GLM 5.5 después es trivial en un endpoint neutral al proveedor.

Conclusiones clave

• Aún no es oficial. Hasta finales de julio de 2026, Z.ai no ha publicado ninguna ficha técnica, especificaciones ni precios del modelo GLM 5.5 — y no ha confirmado el nombre.

• Ventana reportada: agosto de 2026. Atribuido a analistas de JPMorgan a través de Reuters y CGTN (finales de junio de 2026) — una "ventana de observación", no una fecha de proveedor.

• Especificaciones rumoreadas (no confirmadas): más de 1T de parámetros, contexto de 1M de tokens heredado de GLM-5.2, pesos abiertos y un enfoque en agentes de codificación de larga duración.

• La única señal directa: Tang Jie de Zhipu describió un próximo modelo como un "epic plus" en medios chinos — alentador, pero no una hoja de especificaciones.

• Base sólida: GLM-5.2 (753B MoE, 1M de contexto, licencia MIT) es un modelo de codificación open-weight de primer nivel que puedes usar ahora mismo.

¿Qué se reporta realmente (y por quién)?

La fecha de agosto de 2026 se remonta a una cadena de fuentes clara: según informes, analistas de JPMorgan pronostican otro modelo Z.ai para agosto de 2026, que Reuters cubrió y CGTN republicó a finales de junio de 2026. Eso es un reportaje creíble, pero es una previsión de analistas, no una nota de lanzamiento de Z.ai; así que trate agosto como una ventana de observación, no como una promesa. La única señal directa del lado de la empresa es un comentario del cofundador de Zhipu, Tang Jie, quien describió una próxima mejora como un "plus épico" en medios chinos. Eso insinúa que hay un trabajo significativo en marcha, pero no nombra el modelo, confirma el momento ni revela especificaciones.

Lo que se rumorea — y por qué tomarlo con pinzas

Filtraciones comunitarias que circularon a mediados de julio de 2026 describen un modelo con más de un billón de parámetros totales, una ventana de contexto de un millón de tokens heredada de GLM-5.2, pesos abiertos y un fuerte enfoque en agentes de codificación de larga duración. Esto es plausible dada la trayectoria de Zhipu, pero no está confirmado, y los propios analistas advierten que una cifra como "1T+ parámetros" aún no puede usarse para planificación de hardware, precios o afirmaciones de capacidad. Incluso la marca es incierta: los informes han mencionado GLM-5.3, GLM 5.5 y GLM-6 como posibles nombres. Cualquiera que cite benchmarks concretos de GLM 5.5 hoy está adivinando.

La verdadera línea base: lo que realmente es GLM-5.2

Debido a que GLM 5.5 se construirá directamente sobre él, GLM-5.2 es la mejor manera de establecer expectativas. Lanzado en junio de 2026 bajo una licencia MIT, GLM-5.2 es un modelo de mezcla de expertos con aproximadamente 753 mil millones de parámetros totales (unos 40 mil millones activos por token), una ventana de contexto de 1,000,000 de tokens y hasta 131,072 tokens de salida, que utiliza el diseño de atención dispersa "IndexShare" de Zhipu. Es completamente de peso abierto y autoalojable.

En evaluaciones reportadas por el proveedor, GLM-5.2 es sólido, especialmente en codificación: aproximadamente 62.1% en SWE-bench Pro, 81.0% en Terminal-Bench 2.1, 91.2% en GPQA Diamond, y un casi saturado 99.2% en AIME 2026, junto con un 77.8% en SWE-bench Verified (el mejor entre los modelos de código abierto). También es barato: aproximadamente $1.20 por millón de tokens de entrada y $4.10 por millón de salida, y Zhipu afirma que supera a GPT-5.5 en varios benchmarks de codificación de largo horizonte a una fracción del costo. El contrapunto honesto: los compuestos independientes tienden a puntuar por debajo de las cifras del proveedor, y en las tareas de razonamiento general más difíciles, GLM-5.2 queda por detrás de la frontera cerrada e incluso de algunos pares abiertos. Aun así, como caballo de batalla de codificación con pesos abiertos, es una opción genuina de primer nivel hoy en día.

Qué esperar razonablemente de GLM 5.5 (etiquetado como expectativa)

Con especificaciones no oficiales, cualquier expectativa es inferencia. Pero inferencias fundamentadas del arco GLM-5.1 → GLM-5.2 y las filtraciones: espere que GLM 5.5 avance más en codificación agente y de largo horizonte (la prioridad clara de Zhipu), probablemente mantenga el contexto de 1M de tokens, muy probablemente permanezca de peso abierto (GLM-5.2 era MIT, aunque la licencia de un sucesor nunca está garantizada), y probablemente escale los parámetros hacia arriba — quizás al rango de billones o más. Lo que debemos no asumir: puntuaciones de referencia específicas, precios confirmados, visión nativa, o incluso el nombre final. Trate "más grande, más agente, aún abierto, aún barato" como una hipótesis para verificar en el lanzamiento, no como un hecho.

Cómo prepararse — y qué usar hoy

No detengas un proyecto esperando un modelo que aún no ha salido. GLM-5.2 ya está disponible y es un excelente modelo de codificación de pesos abiertos; si desarrollas con un endpoint independiente del proveedor y compatible con OpenAI, adoptar GLM 5.5 cuando llegue será un cambio de configuración, no una reintegración.OrcaRouter expone GLM-5.2 hoy a través de un único endpoint compatible con OpenAI, junto con muchos otros modelos, para que puedas lanzar tu producto con GLM-5.2 ahora y hacer pruebas A/B de GLM 5.5 en cuanto esté disponible; luego deja que los benchmarks independientes y tus propias pruebas decidan si cambiar.

Cómo leer el lanzamiento cuando ocurra

Cuando llegue GLM 5.5 (o como se llame finalmente), hay algunas cosas que vale la pena observar en lugar de aceptarlas sin más. Revise la licencia primero: los pesos abiertos son fundamentales para el atractivo de GLM, y los términos de un sucesor no están garantizados. Observe independiente codificación y números agentivos (SWE-bench Pro/Verified, Terminal-Bench) en lugar de solo diapositivas de proveedores, ya que las cifras propias de Zhipu tienden a ser altas. Confirme la ventana de contexto y precios, ambos configuran el valor en el mundo real. Y, como siempre, ejecute sus propias tareas de codificación representativas: la posición en el ranking es una hipótesis inicial, no una garantía para su carga de trabajo.

Preguntas frecuentes

¿Cuándo sale GLM 5.5?

Según informes (analistas de JPMorgan a través de Reuters y CGTN, finales de junio de 2026) apuntan a una ventana en agosto de 2026, pero Z.ai no ha confirmado una fecha. Considérelo como una ventana de observación.

¿Existen especificaciones o benchmarks oficiales de GLM 5.5?

No. A finales de julio de 2026 no hay una tarjeta modelo oficial, punto de referencia, precio, ni siquiera un nombre confirmado. Las cifras concretas que circulan ahora son especulación.

¿Será GLM 5.5 de pesos abiertos?

Es probable, dado que GLM-5.2 se distribuyó bajo una licencia MIT, pero la licencia de un sucesor nunca se garantiza hasta su lanzamiento. Verifique los términos en el lanzamiento.

¿Cuántos parámetros tendrá GLM 5.5?

Filtraciones sugieren más de un billón de parámetros totales, frente a los ~753 mil millones de GLM-5.2, pero esta es una cifra no confirmada de analistas/comunidad.

¿Qué es GLM-5.2, el predecesor?

El buque insignia de pesos abiertos de Zhipu de junio de 2026: un MoE de ~753B (aproximadamente 40B activos), contexto de 1 millón de tokens, con licencia MIT, fuerte en codificación (por ejemplo, ~62.1% SWE-bench Pro, 81.0% Terminal-Bench 2.1, reportado por el proveedor) a aproximadamente $1.20/$4.10 por millón de tokens.

¿Puedo usar GLM 5.5 ahora?

Todavía no — no se ha lanzado. Usa GLM-5.2 hoy, incluso a través del endpoint compatible con OpenAI de OrcaRouter, y cambia cuando se lance GLM 5.5.

En resumen

GLM 5.5 es uno de los lanzamientos de peso abierto más esperados de 2026, pero aún no está aquí — la fecha de agosto de 2026 es reportada por analistas, las especificaciones de un billón de parámetros y contexto de 1M son filtraciones no confirmadas, e incluso el nombre no es definitivo. Lo que es sólido es la trayectoria y la base: GLM-5.2 ya es un modelo de codificación de peso abierto de primer nivel, con licencia MIT y económico, y se espera que GLM 5.9 impulse aún más la codificación agéntica. Construye sobre GLM-5.2 hoy a través de un endpoint neutral como OrcaRouter, mantente atento a la tarjeta oficial del modelo, y deja que los benchmarks independientes y tus propias pruebas decidan qué tan rápido adoptar GLM 5.5 una vez que sea real. Actualizaremos esta publicación cuando se lance.

Comparados en este artículo3

Detectado en este artículo · Benchmarks: Artificial Analysis · actualizado a diario

© 2026 OrcaRouter

Para proveedores

¿Operas una plataforma de inferencia? Publica tus modelos en OrcaRouter.

providers@orcarouter.ai

Únete a la comunidad

Discordsupport@orcarouter.aiXGitHubYouTube