GLM 5.2

z-ai/glm-5.2
En vedette
OutilsJSONRaisonnement
par Z.ai · 2026-06-16

GLM-5.2 est le modèle phare de Z.ai (Zhipu AI) pour l'ère des tâches à long horizon. Il associe une fenêtre de contexte véritablement utilisable d'1M tokens à une sortie allant jusqu'à 128K tokens, lui permettant de conserver le contexte d'ingénierie au niveau du projet, d'exécuter des tâches de longue durée de manière plus fiable, de suivre les normes d'ingénierie de manière plus cohérente, et de mener une tâche des exigences jusqu'au déploiement multi-plateforme en une seule exécution. Il s'agit d'un modèle texte-entrée / texte-sortie avec un raisonnement hybride contrôlé par reasoning_effort (high / max ; raisonnement profond par défaut) et un appel d'outils natif. Conçu en priorité pour le codage en tant que dernier né de la gamme GLM-5, GLM-5.2 a été lancé dans le cadre du GLM Coding Plan avec un accès API autonome et des poids ouverts sous licence MIT peu de temps après. Il cible le codage agentique à l'échelle du dépôt, les workflows d'ingénierie autonomes en plusieurs étapes, et la livraison complexe à long horizon.

Points de terminaison:/v1/chat/completions/v1/responses
ctx1M tokens
Sortie max128K
Entréetext
Sortietext
p50 TTFT5.20 s
ENTRÉE$1.40/ 1M tokens
SORTIE$4.40/ 1M tokens
p50 TTFT5.20 s7 j
TTFT p9510.00 s7 j
TRAFIC531.9Mtokens / 7 j

Z.ai : GLM 5.2 est un modèle de langage de grande taille uniquement textuel avec une fenêtre contextuelle de 1,000,000‑jetons et une sortie maximale de 128,000 jetons. Il est développé par Z.ai et…

Qu'est-ce que Z.ai: GLM 5.2?

À qui ce modèle est-il destiné ?

Quelles sont les spécifications clés ?

Exemples de code

Appelez depuis n'importe quel SDK

Compatible OpenAI — gardez votre SDK actuel

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="z-ai/glm-5.2",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Paramètres pris en charge

  • include_reasoning
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_p

Tarifs

Entrée / 1M tokens$1.40
Sortie / 1M tokens$4.40
Lecture cache / 1M$0.260
DeviseUSD

Calculateur de coût

Tokens / mois10MM
Part d'entrée70%%
Estimé / mois $23.00 · Avec cache de prompt $19.01

Estimation basée sur le tarif public

Estimateur de tokens et de coût

Tokens d'entrée: 17Coût par requête: $0.002224

Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.

Performances

p50 TTFT
5.20 s
Vitesse de sortie
62.6 tok/s
TTFT p95
10.00 s
Taux d'erreur
0.12%

Benchmarks publics

68.8
AA Coding
Meilleur que 85 % des modèles comparés
n°16 sur 120
51.1
AA Intelligence
Meilleur que 84 % des modèles comparés
n°19 sur 122
59.8
AA Math
Meilleur que 43 % des modèles comparés
n°46 sur 81
AIME 2026
99.2
CritPt
16.7
DeepSWE
46.2
FrontierSWE (Dominance)
74.4
GPQA Diamond
89.5
GPQA-Diamond
91.2
HLE
40.5
HLE (w/ Tools)
54.7
HMMT Feb. 2026
92.5
HMMT Nov. 2025
94.4
Humanity's Last Exam
40.1
IFBench
73.3
IMOAnswerBench
91.0
Long-Context Recall
71.3
MCP-Atlas (Public Set)
76.8
MMLU-Pro
62.8 index
NL2Repo
48.9
PostTrainBench
34.3
ProgramBench
63.7
SciCode
50.5
SWE-bench Pro
62.1
SWE-Marathon
13.0
tau_banking
26.8
Terminal Bench 2.1 (Best Reported)
82.7
Terminal Bench 2.1 (Terminus-2)
81.0
TerminalBench Hard
50.8
terminalbench_v2_1
77.9
Tool-Decathlon
48.2
τ²-Bench
99.1
Source: artificialanalysis.ai, zai-org

Comparatif

GLM 5.2GLM 5.1GLM 5GLM 4.5
Entrée $/M$1.40$1.40$1.00$0.60
Sortie $/M$4.40$4.40$3.20$2.20
Contexte1.0M200K200K128K
Qualité9/109/108/107/10
Comparer côte à côteComparer côte à côteComparer côte à côteComparer côte à côte

FAQ

Quel est le coût par jeton pour GLM 5.2 ?
Les jetons d'entrée coûtent 1,40 $ par million de jetons, et les jetons de sortie coûtent 4,40 $ par million de jetons. Il n'y a pas de majoration par OrcaRouter ; vous payez le tarif du fournisseur de Z.ai.
Quelle est la taille de la fenêtre de contexte du modèle ?
La fenêtre de contexte est de 1 000 000 tokens (entrée et sortie combinées). La sortie maximale est de 128 000 tokens par requête.
Quels sont les points forts du modèle ?
Sa principale force est la grande fenêtre de contexte (1M tokens) et la limite de sortie élevée (128k tokens), permettant de traiter de très longs documents ou conversations en un seul appel. Il est uniquement textuel.
Comment GLM 5.2 se compare-t-il à d'autres modèles avec des fenêtres de contexte plus petites ?
Il possède une fenêtre de contexte beaucoup plus grande, ce qui le rend adapté aux tâches qui nécessitent la lecture de livres entiers ou de grandes bases de code. Les modèles plus petits sont moins chers et plus rapides pour les tâches qui s'inscrivent dans leurs limites de contexte.
OrcaRouter met-il en cache des jetons ou offre-t-il des remises ?
Non, OrcaRouter ne fait pas la publicité de la mise en cache des jetons ni de remises sur volume pour ce modèle. Le prix est par jeton au tarif du fournisseur avec une marge nulle.
Comment appeler GLM 5.2 via OrcaRouter ?
Utilisez l'API compatible OpenAI à l'URL de base https://api.orcarouter.ai/v1, ID de modèle “z-ai/glm-5.2”. Envoyez une requête standard de complétion de chat avec votre clé API.
Quelles modalités d'entrée le modèle prend-il en charge ?
Z.ai : GLM 5.2 ne prend en charge que l’entrée de texte. Il ne peut pas traiter les images, l’audio ou d’autres contenus multimodaux.
Existe-t-il des scores de benchmark connus ?
Aucun score de benchmark pour GLM 5.2 n'est fourni dans les faits disponibles. Les utilisateurs devraient évaluer le modèle sur leurs propres ensembles de données.
Puis-je streamer la sortie ?
Oui, définissez `stream: true` dans votre appel API. La réponse sera envoyée sous forme d'événements envoyés par le serveur, identique au format de streaming d'OpenAI.
Que se passe-t-il si je dépasse la limite de 1M tokens ?
Vous recevrez une erreur. Assurez-vous que le nombre total de jetons dans vos messages plus max_tokens ne dépasse pas 1 000 000.

Intégrer ce badge

Z.ai: GLM 5.2$1.40/M in5202ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/z-ai/glm-5.2" target="_blank"> <img src="https://www.orcarouter.ai/embed/z-ai/glm-5.2.svg" alt="Z.ai: GLM 5.2 sur OrcaRouter" /> </a>
Markdown [![Z.ai: GLM 5.2](https://www.orcarouter.ai/embed/z-ai/glm-5.2.svg)](https://www.orcarouter.ai/models/z-ai/glm-5.2)

Fiche du modèle en données

GET /api/public/models/z-ai/glm-5.2Ouvrir
Lisible par machine:/llms.txt/llms-full.txt