GLM 5.3 Flash

z-ai/glm-5.3-flash
Neu
VisionToolsJSONReasoning
von Z.ai · 2026-08-26

GLM-5.3-Flash ist ein natives multimodales Modell von Z.ai. Es eignet sich für effizientes Codieren und Agentenaufgaben mit langem Zeithorizont. Seine hybride Sparse- und Linear-Attention-Architektur gewährleistet präzises Verhalten bei langen Kontexten und senkt gleichzeitig die Bereitstellungskosten erheblich. 320B Gesamtparameter / 18B aktive Parameter, 1M-Token-Kontext, Text + Bild + Video als Eingabe, Text als Ausgabe.

Ktx1M Tokens
Max. Ausgabe128K
Eingabetext + image + video
Ausgabetext
p50 TTFT7.78 s
EINGABE$0.07/ 1M Tokens
AUSGABE$0.25/ 1M Tokens
p50 TTFT7.78 s7 T
p95 TTFT10.00 s7 T
DATENVERKEHR797.5MTokens / 7 T

Code-Beispiele

Aus jedem SDK aufrufen

OpenAI-kompatibel — behalte dein bisheriges SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="z-ai/glm-5.3-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Unterstützte Parameter

  • include_reasoning
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_p

Preise

Eingabe / 1M Tokens$0.075
Ausgabe / 1M Tokens$0.250
Cache-Lesen / 1M$0.017
WährungUSD

Kostenrechner

Tokens / Monat10MM
Eingabeanteil70%%
Geschätzt / Monat $1.28 · Mit Prompt-Caching $1.07

Schätzung auf Basis des Listenpreises

Token- und Kostenschätzer

Eingabe-Tokens: 27Kosten pro Anfrage: $0.000127

Nur eine Schätzung — die tatsächliche Token-Anzahl hängt vom Tokenizer des Anbieters ab.

Leistung

p50 TTFT
7.78 s
Ausgabegeschwindigkeit
113 tok/s
p95 TTFT
10.00 s
Fehlerquote
7.4%

Öffentliche Benchmarks

71.5
AA Coding
Besser als 88 % der verglichenen Modelle
Nr. 15 von 134
57.5
AA Intelligence
Besser als 92 % der verglichenen Modelle
Nr. 11 von 136
Agents' Last Exam
26.3
AutomationBench v1.0.6
48.8
BabyVision
53.4
Chartography (with tools)
78.0
CharXiv Reasoning (with tools)
89.4
DeepSWE v1.1
63.4
GPQA Diamond
91.2
HLE (with tools)
55.3
Humanity's Last Exam
39.9
Long-Context Recall
78.0
MMVU
80.5
MVBench
77.8
NL2Repo
56.3
OfficeQA Pro
62.4
SciCode
46.1
tau_banking
47.2
Terminal-Bench 2.1
84.3
terminalbench_v2_1
84.3
Toolathlon Verified
78.4
Quelle: artificialanalysis.ai, z.ai

Community-Buzz

Worüber Entwickler diese Woche sprechen

Hacker News10 Erwähnungen · 7 T8 mehr als in der Vorwoche

Im Vergleich

GLM 5.3 FlashGLM 5.1GLM 5.2GLM 5.3
Eingabe $/M$0.07$1.40$1.40$1.26
Ausgabe $/M$0.25$4.40$4.40$3.96
Kontext1.0M200K1.0M1.0M
Qualität8/109/109/109/10
Nebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichenNebeneinander vergleichen

FAQ

Wie viel kostet Z.ai: GLM 5.3 Flash auf OrcaRouter?
Z.ai: GLM 5.3 Flash kostet $0.07 pro 1M Eingabetokens und $0.25 pro 1M Ausgabetokens über OrcaRouter. Die Preise werden live von der Routing-Schicht abgerufen.
Was ist das Kontextfenster von Z.ai: GLM 5.3 Flash?
Z.ai: GLM 5.3 Flash unterstützt ein Kontextfenster von 1M Token. Verwenden Sie Langkontextfunktionen (RAG, Zusammenfassung) bis zu diesem Limit.
Wie rufe ich Z.ai: GLM 5.3 Flash über das OpenAI SDK auf?
Setzen Sie die OpenAI base_url auf https://api.orcarouter.ai/v1, geben Sie Ihren OrcaRouter API-Schlüssel an und übergeben Sie model="z-ai/glm-5.3-flash" im Aufruf von chat.completions.create.
Rate-limitiert OrcaRouter Z.ai: GLM 5.3 Flash?
Modellspezifische Ratenbegrenzungen richten sich nach Ihrem OrcaRouter-Plan. Kostenlose Tarife haben konservative Obergrenzen; kostenpflichtige Tarife heben diese an. Siehe /pricing für aktuelle Kontingente.

Dieses Abzeichen einbetten

Z.ai: GLM 5.3 Flash$0.07/M in7777ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/z-ai/glm-5.3-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/z-ai/glm-5.3-flash.svg" alt="Z.ai: GLM 5.3 Flash auf OrcaRouter" /> </a>
Markdown [![Z.ai: GLM 5.3 Flash](https://www.orcarouter.ai/embed/z-ai/glm-5.3-flash.svg)](https://www.orcarouter.ai/models/z-ai/glm-5.3-flash)

Modellkarte als Daten

GET /api/public/models/z-ai/glm-5.3-flashÖffnen
Maschinenlesbar:/llms.txt/llms-full.txt