GLM 5.3 Flash

z-ai/glm-5.3-flash
Baru
VisiAlatJSONPenalaran
oleh Z.ai · 2026-08-26

GLM-5.3-Flash adalah model multimodal native dari Z.ai. Model ini cocok untuk pengkodean yang efisien dan tugas agen jangka panjang. Arsitektur attention hibrida sparse dan linear-nya mempertahankan perilaku konteks panjang yang akurat sekaligus mengurangi biaya penyajian secara tajam. Total 320B / 18B parameter aktif, konteks 1M token, masukan teks + gambar + video, keluaran teks.

ctx1M token
Output maks128K
Masukantext + image + video
Keluarantext
p50 TTFT7.78 s
INPUT$0.07/ 1M token
OUTPUT$0.25/ 1M token
p50 TTFT7.78 s7h
p95 TTFT10.00 s7h
LALU LINTAS799.8Mtoken / 7h

Contoh kode

Panggil dari SDK apa pun

Kompatibel OpenAI — pakai SDK Anda yang sekarang

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="z-ai/glm-5.3-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

Parameter yang didukung

  • include_reasoning
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_p

Harga

Input / 1M token$0.075
Output / 1M token$0.250
Baca cache / 1M$0.017
Mata uangUSD

Kalkulator biaya

Token / bulan10MM
Porsi input70%%
Perkiraan / bulan $1.28 · Dengan cache prompt $1.07

Perkiraan berdasarkan harga daftar

Estimator token & biaya

Token masukan: 17Biaya per permintaan: $0.000126

Hanya perkiraan — jumlah token sebenarnya bergantung pada tokenizer penyedia.

Performa

p50 TTFT
7.78 s
Kecepatan output
113 tok/s
p95 TTFT
10.00 s
Tingkat kesalahan
7.5%

Benchmark publik

71.5
AA Coding
Lebih baik dari 88% model yang dibandingkan
#15 dari 134
57.5
AA Intelligence
Lebih baik dari 92% model yang dibandingkan
#11 dari 136
Agents' Last Exam
26.3
AutomationBench v1.0.6
48.8
BabyVision
53.4
Chartography (with tools)
78.0
CharXiv Reasoning (with tools)
89.4
DeepSWE v1.1
63.4
GPQA Diamond
91.2
HLE (with tools)
55.3
Humanity's Last Exam
39.9
Long-Context Recall
78.0
MMVU
80.5
MVBench
77.8
NL2Repo
56.3
OfficeQA Pro
62.4
SciCode
46.1
tau_banking
47.2
Terminal-Bench 2.1
84.3
terminalbench_v2_1
84.3
Toolathlon Verified
78.4
Sumber: artificialanalysis.ai, z.ai

Perbincangan komunitas

Yang dibicarakan developer minggu ini

Hacker News10 sebutan · 7 hrnaik 8 dari minggu lalu

Perbandingan

GLM 5.3 FlashGLM 5.1GLM 5.2GLM 5.3
Input $/M$0.07$1.40$1.40$1.26
Output $/M$0.25$4.40$4.40$3.96
Konteks1.0M200K1.0M1.0M
Kualitas8/109/109/109/10
Bandingkan berdampinganBandingkan berdampinganBandingkan berdampinganBandingkan berdampingan

FAQ

Berapa harga Z.ai: GLM 5.3 Flash di OrcaRouter?
Z.ai: GLM 5.3 Flash dihargai $0.07 per 1M token input dan $0.25 per 1M token output melalui OrcaRouter. Harga ditarik langsung dari lapisan perutean.
Apa jendela konteks dari Z.ai: GLM 5.3 Flash?
Z.ai: GLM 5.3 Flash mendukung jendela konteks 1M token. Gunakan fitur konteks panjang (RAG, peringkasan) hingga batas tersebut.
Bagaimana cara memanggil Z.ai: GLM 5.3 Flash melalui OpenAI SDK?
Atur base_url OpenAI menjadi https://api.orcarouter.ai/v1, berikan kunci API OrcaRouter Anda, dan teruskan model="z-ai/glm-5.3-flash" dalam panggilan chat.completions.create.
Apakah OrcaRouter membatasi laju Z.ai: GLM 5.3 Flash?
Batas kecepatan per model mengikuti paket OrcaRouter Anda. Tingkat gratis hadir dengan batas konservatif; tingkat berbayar menaikkannya. Periksa /pricing untuk kuota saat ini.

Sematkan lencana ini

Z.ai: GLM 5.3 Flash$0.07/M in7777ms p50via OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/z-ai/glm-5.3-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/z-ai/glm-5.3-flash.svg" alt="Z.ai: GLM 5.3 Flash di OrcaRouter" /> </a>
Markdown [![Z.ai: GLM 5.3 Flash](https://www.orcarouter.ai/embed/z-ai/glm-5.3-flash.svg)](https://www.orcarouter.ai/models/z-ai/glm-5.3-flash)

Kartu model sebagai data

GET /api/public/models/z-ai/glm-5.3-flashBuka