GLM 5.3 Flash

z-ai/glm-5.3-flash
Nouveau
VisionOutilsJSONRaisonnement
par Z.ai · 2026-08-26

GLM-5.3-Flash est un modèle multimodal natif de Z.ai. Il est adapté pour le codage efficace et les tâches d'agent à long horizon. Son architecture d'attention hybride sparse et linéaire maintient un comportement précis sur de longs contextes tout en réduisant fortement le coût de service. 320B de paramètres au total / 18B actifs, contexte de 1M de jetons, entrée texte + image + vidéo, sortie texte.

Points de terminaison:/v1/chat/completions
ctx1M tokens
Sortie max128K
Entréetext + image + video
Sortietext
p50 TTFT7.78 s
ENTRÉE$0.07/ 1M tokens
SORTIE$0.25/ 1M tokens
p50 TTFT7.78 s7 j
TTFT p9510.00 s7 j
TRAFIC799.8Mtokens / 7 j

Exemples de code

Appelez depuis n'importe quel SDK

Compatible OpenAI — gardez votre SDK actuel

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="z-ai/glm-5.3-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Paramètres pris en charge

  • include_reasoning
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_p

Tarifs

Entrée / 1M tokens$0.075
Sortie / 1M tokens$0.250
Lecture cache / 1M$0.017
DeviseUSD

Calculateur de coût

Tokens / mois10MM
Part d'entrée70%%
Estimé / mois $1.28 · Avec cache de prompt $1.07

Estimation basée sur le tarif public

Estimateur de tokens et de coût

Tokens d'entrée: 17Coût par requête: $0.000126

Estimation seulement — le nombre réel de tokens dépend du tokeniseur du fournisseur.

Performances

p50 TTFT
7.78 s
Vitesse de sortie
113 tok/s
TTFT p95
10.00 s
Taux d'erreur
7.5%

Benchmarks publics

71.5
AA Coding
Meilleur que 88 % des modèles comparés
n°15 sur 134
57.5
AA Intelligence
Meilleur que 92 % des modèles comparés
n°11 sur 136
Agents' Last Exam
26.3
AutomationBench v1.0.6
48.8
BabyVision
53.4
Chartography (with tools)
78.0
CharXiv Reasoning (with tools)
89.4
DeepSWE v1.1
63.4
GPQA Diamond
91.2
HLE (with tools)
55.3
Humanity's Last Exam
39.9
Long-Context Recall
78.0
MMVU
80.5
MVBench
77.8
NL2Repo
56.3
OfficeQA Pro
62.4
SciCode
46.1
tau_banking
47.2
Terminal-Bench 2.1
84.3
terminalbench_v2_1
84.3
Toolathlon Verified
78.4
Source: artificialanalysis.ai, z.ai

Buzz communautaire

Ce dont parlent les développeurs cette semaine

Hacker News10 mentions · 7 jen hausse de 8 vs la semaine précédente

Comparatif

GLM 5.3 FlashGLM 5.1GLM 5.2GLM 5.3
Entrée $/M$0.07$1.40$1.40$1.26
Sortie $/M$0.25$4.40$4.40$3.96
Contexte1.0M200K1.0M1.0M
Qualité8/109/109/109/10
Comparer côte à côteComparer côte à côteComparer côte à côteComparer côte à côte

FAQ

Combien coûte Z.ai: GLM 5.3 Flash sur OrcaRouter ?
Z.ai: GLM 5.3 Flash est facturé à $0.07 par 1M tokens d'entrée et $0.25 par 1M tokens de sortie via OrcaRouter. La tarification est extraite en direct de la couche de routage.
Quelle est la fenêtre de contexte de Z.ai: GLM 5.3 Flash ?
Z.ai: GLM 5.3 Flash prend en charge une fenêtre de contexte de 1M tokens. Utilisez les fonctionnalités de contexte long (RAG, résumé) jusqu’à cette limite.
Comment appeler Z.ai: GLM 5.3 Flash via le SDK OpenAI ?
Définissez base_url d'OpenAI sur https://api.orcarouter.ai/v1, fournissez votre clé API OrcaRouter et passez model="z-ai/glm-5.3-flash" dans l'appel chat.completions.create.
OrcaRouter limite-t-il le débit de Z.ai: GLM 5.3 Flash ?
Les limites de débit par modèle suivent votre forfait OrcaRouter. Les offres gratuites sont assorties de plafonds conservateurs ; les offres payantes les relèvent. Consultez /pricing pour connaître les quotas actuels.

Intégrer ce badge

Z.ai: GLM 5.3 Flash$0.07/M in7777ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/z-ai/glm-5.3-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/z-ai/glm-5.3-flash.svg" alt="Z.ai: GLM 5.3 Flash sur OrcaRouter" /> </a>
Markdown [![Z.ai: GLM 5.3 Flash](https://www.orcarouter.ai/embed/z-ai/glm-5.3-flash.svg)](https://www.orcarouter.ai/models/z-ai/glm-5.3-flash)

Fiche du modèle en données

GET /api/public/models/z-ai/glm-5.3-flashOuvrir
Lisible par machine:/llms.txt/llms-full.txt