GLM 5.3

z-ai/glm-5.3
NouveauEn vedette
OutilsJSONRaisonnement
par Z.ai · 2026-08-18

GLM-5.3 est le dernier modèle phare de Z.ai (Zhipu AI) pour l'ingénierie logicielle complexe et les tâches agentiques à long horizon. Il offre une amélioration d'environ 50 % de l'expérience de codage par rapport à GLM-5.2, égalant Mythos 5 sur certaines capacités de cybersécurité, et trouve un meilleur équilibre entre performance brute et efficacité des tokens. C'est un modèle à texte en entrée / texte en sortie conçu pour le codage à l'échelle d'un dépôt, l'ingénierie autonome en plusieurs étapes et les flux de travail d'agent qui doivent rester cohérents sur de longs horizons. GLM-5.3 utilise la même surface d'API que la gamme GLM-5, avec deux changements que les appelants doivent gérer : le mode thinking est toujours activé (thinking.type n'accepte que la valeur enabled ; passer disabled fait désormais échouer la requête), et la profondeur du raisonnement est contrôlée par reasoning_effort avec les valeurs low / high / max, par défaut max. Il prend en charge l'appel d'outils natif et la sortie JSON structurée, et utilise le format chat-completions compatible OpenAI.

Points de terminaison:/v1/chat/completions
ctx1M tokens
Sortie max128K
Entréetext
Sortietext
p50 TTFT2.00 s
ENTRÉE$1.40/ 1M tokens
SORTIE$4.40/ 1M tokens
p50 TTFT2.00 s7 j
TTFT p952.72 s7 j
TRAFIC332tokens / 7 j

GLM 5.3 est un grand modèle de langage répertorié sous le fournisseur z-ai et servi via OrcaRouter. L'entrée du catalogue le décrit comme étant uniquement textuel, avec un contexte d'entrée allant…

Qu'est-ce que Z.ai GLM 5.3 ?

Pour qui est GLM 5.3 ?

Quelles sont les principales spécifications ?

Quel ID de modèle et quel endpoint sont utilisés ?

Exemples de code

Appelez depuis n'importe quel SDK

Compatible OpenAI — gardez votre SDK actuel

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="z-ai/glm-5.3",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Paramètres pris en charge

  • include_reasoning
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_p

Tarifs

Entrée / 1M tokens$1.40
Sortie / 1M tokens$4.40
Lecture cache / 1M$0.260
DeviseUSD

Calculateur de coût

Tokens / mois10MM
Part d'entrée70%%
Estimé / mois $23.00 · Avec cache de prompt $19.01

Estimation basée sur le tarif public

Estimateur de tokens et de coût

Tokens d'entrée: 17Coût par requête: $0.002224

Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.

Performances

p50 TTFT
2.00 s
Vitesse de sortie
643 tok/s
TTFT p95
2.72 s
Taux d'erreur
0%

Benchmarks publics

Buzz communautaire

Ce dont parlent les développeurs cette semaine

Hacker News7 mentions · 7 jen hausse de 7 vs la semaine précédente

Comparatif

GLM 5.3GLM 5.1GLM 5.2GLM 5
Entrée $/M$1.40$1.40$1.40$1.00
Sortie $/M$4.40$4.40$4.40$3.20
Contexte1.0M200K1.0M200K
Qualité9/109/109/108/10
Comparer côte à côteComparer côte à côteComparer côte à côteComparer côte à côte

FAQ

Combien coûte Z.ai GLM 5.3 sur OrcaRouter ?
Le prix indiqué est de 1,40 $ pour 1 000 000 de jetons d'entrée et de 4,40 $ pour 1 000 000 de jetons de sortie. OrcaRouter facture au tarif du fournisseur avec une marge de zéro, donc le coût que vous voyez dans le catalogue est le tarif de base. Les jetons de contexte sont comptés comme entrée, et les jetons générés comme sortie.
Quelle fenêtre de contexte et quelle sortie maximale GLM 5.3 prend-il en charge ?
GLM 5.3 prend en charge une fenêtre de contexte de 1,000,000 de tokens et une sortie maximale de 128,000 tokens par génération. Cela signifie que le modèle peut accepter de très longs prompts et générer de très longues réponses en un seul appel API.
Quels types d'entrée GLM 5.3 peut-il accepter ?
Le catalogue indique que la modalité d'entrée est textuelle uniquement. GLM 5.3 n'accepte pas les images, l'audio, la vidéo ou d'autres contenus binaires. Pour les tâches multimodales, vous auriez besoin d'un modèle différent sur OrcaRouter.
Quels sont les points forts de GLM 5.3 ?
Les principaux atouts sont la grande fenêtre de contexte de 1,000,000 jetons et la limite de sortie de 128,000 jetons, toutes deux utiles pour les charges de travail à forte intensité de texte. Aucun score de référence n'est répertorié dans le catalogue, vous devez donc évaluer le modèle sur vos propres tâches pour comprendre sa qualité.
Comment GLM 5.3 se compare-t-il aux modèles avec des contextes plus petits ?
GLM 5.3 dispose d'une fenêtre de contexte beaucoup plus grande que de nombreux modèles courants. Si votre tâche s'inscrit dans un contexte plus petit, un modèle moins cher peut être plus rentable. Si vous devez traiter un document très long en une seule requête, la plus grande fenêtre de contexte de GLM 5.3 est un avantage pratique.
Comment appeler GLM 5.3 via OrcaRouter ?
Utilisez l'API compatible OpenAI d'OrcaRouter à l'adresse https://api.orcarouter.ai/v1. Définissez l'ID du modèle sur z-ai/glm-5.3 et envoyez une requête standard de complétions de chat avec votre clé API OrcaRouter. Le format de requête correspond à celui d'OpenAI, donc le code SDK OpenAI existant peut être migré en modifiant l'URL de base et le nom du modèle.
OrcaRouter ajoute-t-il un balisage à GLM 5.3 ?
Non. OrcaRouter facture GLM 5.3 au tarif du fournisseur sans aucune majoration. Le prix est exactement de 1,40 $ par million de jetons d'entrée et de 4,40 $ par million de jetons de sortie, comme indiqué dans le catalogue.
Quelles politiques de traitement des données s'appliquent à ce modèle ?
Le modèle est servi par Z.ai via OrcaRouter. Les détails du catalogue concernant le stockage, la conservation et l'utilisation pour l'entraînement ne sont pas fournis ici. Pour les conditions spécifiques de traitement des données, veuillez vous référer aux politiques de confidentialité et de traitement des données d'OrcaRouter et du fournisseur en amont, Z.ai.

Intégrer ce badge

Z.ai: GLM 5.3$1.40/M in2000ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/z-ai/glm-5.3" target="_blank"> <img src="https://www.orcarouter.ai/embed/z-ai/glm-5.3.svg" alt="Z.ai: GLM 5.3 sur OrcaRouter" /> </a>
Markdown [![Z.ai: GLM 5.3](https://www.orcarouter.ai/embed/z-ai/glm-5.3.svg)](https://www.orcarouter.ai/models/z-ai/glm-5.3)

Fiche du modèle en données

GET /api/public/models/z-ai/glm-5.3Ouvrir
Lisible par machine:/llms.txt/llms-full.txt