GLM 5.3 Flash

z-ai/glm-5.3-flash
Nieuw
VisieToolsJSONRedeneren
door Z.ai · 2026-08-26

GLM-5.3-Flash is een native multimodaal model van Z.ai. Het is geschikt voor efficiënt coderen en agenttaken met een lange horizon. De hybride sparse- en lineaire-aandachtsarchitectuur behoudt nauwkeurig gedrag bij lange context, terwijl de servicekosten sterk worden verlaagd. 320B totaal / 18B actieve parameters, 1M-token context, tekst + afbeelding + video invoer, tekst uitvoer.

ctx1M tokens
Max. uitvoer128K
Invoertext + image + video
Uitvoertext
p50 TTFT7.78 s
INPUT$0.07/ 1M tokens
OUTPUT$0.25/ 1M tokens
p50 TTFT7.78 s7d
p95 TTFT10.00 s7d
VERKEER799.8Mtokens / 7d

Codevoorbeelden

Aanroepen vanuit elke SDK

OpenAI-compatibel — behoud je huidige SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="z-ai/glm-5.3-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Ondersteunde parameters

  • include_reasoning
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_p

Prijzen

Invoer / 1M tokens$0.075
Uitvoer / 1M tokens$0.250
Cache lezen / 1M$0.017
ValutaUSD

Kostencalculator

Tokens / maand10MM
Invoeraandeel70%%
Geschat / maand $1.28 · Met prompt-caching $1.07

Schatting op basis van catalogusprijs

Token- en kostenschatter

Invoertokens: 20Kosten per verzoek: $0.000127

Alleen een schatting — het werkelijke aantal tokens hangt af van de tokenizer van de aanbieder.

Prestaties

p50 TTFT
7.78 s
Outputsnelheid
113 tok/s
p95 TTFT
10.00 s
Foutpercentage
7.5%

Openbare benchmarks

71.5
AA Coding
Beter dan 88% van de vergeleken modellen
#15 van 134
57.5
AA Intelligence
Beter dan 92% van de vergeleken modellen
#11 van 136
Agents' Last Exam
26.3
AutomationBench v1.0.6
48.8
BabyVision
53.4
Chartography (with tools)
78.0
CharXiv Reasoning (with tools)
89.4
DeepSWE v1.1
63.4
GPQA Diamond
91.2
HLE (with tools)
55.3
Humanity's Last Exam
39.9
Long-Context Recall
78.0
MMVU
80.5
MVBench
77.8
NL2Repo
56.3
OfficeQA Pro
62.4
SciCode
46.1
tau_banking
47.2
Terminal-Bench 2.1
84.3
terminalbench_v2_1
84.3
Toolathlon Verified
78.4
Bron: artificialanalysis.ai, z.ai

Community-buzz

Waar ontwikkelaars het deze week over hebben

Hacker News10 vermeldingen · 7 d8 meer dan vorige week

Vergelijking

GLM 5.3 FlashGLM 5.1GLM 5.2GLM 5.3
Invoer $/M$0.07$1.40$1.40$1.26
Uitvoer $/M$0.25$4.40$4.40$3.96
Context1.0M200K1.0M1.0M
Kwaliteit8/109/109/109/10
Naast elkaar vergelijkenNaast elkaar vergelijkenNaast elkaar vergelijkenNaast elkaar vergelijken

FAQ

Hoeveel kost Z.ai: GLM 5.3 Flash op OrcaRouter?
Z.ai: GLM 5.3 Flash is geprijsd op $0.07 per 1M invoertokens en $0.25 per 1M uitvoertokens via OrcaRouter. De prijzen worden live opgehaald van de routinglaag.
Wat is Z.ai: GLM 5.3 Flash's contextvenster?
Z.ai: GLM 5.3 Flash ondersteunt een contextvenster van 1M tokens. Gebruik lange-contextfuncties (RAG, samenvatting) tot die limiet.
Hoe roep ik Z.ai: GLM 5.3 Flash aan via de OpenAI SDK?
Stel OpenAI base_url in op https://api.orcarouter.ai/v1, lever uw OrcaRouter API-sleutel, en geef model="z-ai/glm-5.3-flash" mee in de chat.completions.create aanroep.
Past OrcaRouter een snelheidsbeperking toe op Z.ai: GLM 5.3 Flash?
Per-model snelheidslimieten volgen uw OrcaRouter-plan. Gratis abonnementen worden geleverd met conservatieve limieten; betaalde abonnementen verhogen deze. Controleer /pricing voor huidige quota's.

Sluit deze badge in

Z.ai: GLM 5.3 Flash$0.07/M in7777ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/z-ai/glm-5.3-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/z-ai/glm-5.3-flash.svg" alt="Z.ai: GLM 5.3 Flash op OrcaRouter" /> </a>
Markdown [![Z.ai: GLM 5.3 Flash](https://www.orcarouter.ai/embed/z-ai/glm-5.3-flash.svg)](https://www.orcarouter.ai/models/z-ai/glm-5.3-flash)

Modelkaart als data

GET /api/public/models/z-ai/glm-5.3-flashOpenen
Machineleesbaar:/llms.txt/llms-full.txt