GLM 5.3 Flash

z-ai/glm-5.3-flash
Nuovo
VisioneStrumentiJSONRagionamento
di Z.ai · 2026-08-26

GLM-5.3-Flash è un modello multimodale nativo di Z.ai. È adatto per coding efficiente e compiti degli agenti a lungo orizzonte. La sua architettura ibrida di attenzione sparsa e lineare mantiene un comportamento accurato in contesti lunghi, riducendo al contempo in modo significativo i costi di servizio. 320B parametri totali / 18B attivi, contesto di 1 milione di token, testo + immagine + video in ingresso, testo in uscita.

ctx1M token
Output max128K
Inputtext + image + video
Outputtext
p50 TTFT7.78 s
INGRESSO$0.07/ 1M token
USCITA$0.25/ 1M token
p50 TTFT7.78 s7 g
p95 TTFT10.00 s7 g
TRAFFICO797.5Mtoken / 7 g

Esempi di codice

Chiama da qualsiasi SDK

Compatibile con OpenAI: mantieni il tuo SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="z-ai/glm-5.3-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parametri supportati

  • include_reasoning
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_p

Prezzi

Input / 1M token$0.075
Output / 1M token$0.250
Lettura cache / 1M$0.017
ValutaUSD

Calcolatore dei costi

Token / mese10MM
Quota di input70%%
Stimato / mese $1.28 · Con cache dei prompt $1.07

Stima basata sul prezzo di listino

Stima di token e costo

Token di input: 17Costo per richiesta: $0.000126

Solo una stima — il numero effettivo di token dipende dal tokenizzatore del provider.

Prestazioni

p50 TTFT
7.78 s
Velocità di output
113 tok/s
p95 TTFT
10.00 s
Tasso di errore
7.4%

Benchmark pubblici

71.5
AA Coding
Migliore del 88% dei modelli confrontati
n. 15 su 134
57.5
AA Intelligence
Migliore del 92% dei modelli confrontati
n. 11 su 136
Agents' Last Exam
26.3
AutomationBench v1.0.6
48.8
BabyVision
53.4
Chartography (with tools)
78.0
CharXiv Reasoning (with tools)
89.4
DeepSWE v1.1
63.4
GPQA Diamond
91.2
HLE (with tools)
55.3
Humanity's Last Exam
39.9
Long-Context Recall
78.0
MMVU
80.5
MVBench
77.8
NL2Repo
56.3
OfficeQA Pro
62.4
SciCode
46.1
tau_banking
47.2
Terminal-Bench 2.1
84.3
terminalbench_v2_1
84.3
Toolathlon Verified
78.4
Fonte: artificialanalysis.ai, z.ai

Discussioni della community

Di cosa parlano gli sviluppatori questa settimana

Hacker News10 menzioni · 7 gg8 in più rispetto alla settimana scorsa

A confronto

GLM 5.3 FlashGLM 5.1GLM 5.2GLM 5.3
Input $/M$0.07$1.40$1.40$1.26
Output $/M$0.25$4.40$4.40$3.96
Contesto1.0M200K1.0M1.0M
Qualità8/109/109/109/10
Confronta affiancatiConfronta affiancatiConfronta affiancatiConfronta affiancati

FAQ

Quanto costa Z.ai: GLM 5.3 Flash su OrcaRouter?
Z.ai: GLM 5.3 Flash ha un prezzo di $0.07 per 1 milione di token in input e $0.25 per 1 milione di token in output tramite OrcaRouter. I prezzi vengono recuperati in tempo reale dal livello di routing.
Qual è la finestra di contesto di Z.ai: GLM 5.3 Flash?
Z.ai: GLM 5.3 Flash supporta una finestra di contesto di 1M token. Usa le funzionalità per contesti lunghi (RAG, summarisation) fino a tale limite.
Come posso chiamare Z.ai: GLM 5.3 Flash tramite l'SDK OpenAI?
Imposta base_url di OpenAI su https://api.orcarouter.ai/v1, fornisci la tua chiave API OrcaRouter e passa model=\"z-ai/glm-5.3-flash\" nella chiamata chat.completions.create.
OrcaRouter limita la velocità di Z.ai: GLM 5.3 Flash?
I limiti di velocità per modello seguono il tuo piano OrcaRouter. I piani gratuiti vengono forniti con limiti conservativi; i piani a pagamento li aumentano. Controlla /pricing per le quote attuali.

Incorpora questo badge

Z.ai: GLM 5.3 Flash$0.07/M in7777ms p50tramite OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/z-ai/glm-5.3-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/z-ai/glm-5.3-flash.svg" alt="Z.ai: GLM 5.3 Flash su OrcaRouter" /> </a>
Markdown [![Z.ai: GLM 5.3 Flash](https://www.orcarouter.ai/embed/z-ai/glm-5.3-flash.svg)](https://www.orcarouter.ai/models/z-ai/glm-5.3-flash)

Scheda del modello come dati

GET /api/public/models/z-ai/glm-5.3-flashApri
Leggibile dalle macchine:/llms.txt/llms-full.txt