GLM 5.3 Flash

z-ai/glm-5.3-flash
جديد
رؤيةأدواتJSONاستدلال
بواسطة Z.ai · 2026-08-26

GLM-5.3-Flash هو نموذج متعدد الوسائط أصلي من Z.ai. وهو مناسب للبرمجة الفعّالة ومهام الوكلاء طويلة المدى. تحافظ بنيته الهجينة للانتباه المتفرق والخطي على سلوك دقيق في السياقات الطويلة مع تقليل تكلفة التشغيل بشكل حاد. 320B إجمالي / 18B معاملات نشطة، سياق 1M-token، إدخال نص + صورة + فيديو، وإخراج نص.

نقاط النهاية:/v1/chat/completions
سياق1M رمز
أقصى إخراج128K
الإدخالtext + image + video
الإخراجtext
p50 TTFT7.78 s
الإدخال$0.07/ مليون رمز
الإخراج$0.25/ مليون رمز
p50 TTFT7.78 s7 أيام
p95 TTFT10.00 s7 أيام
حركة المرور797.5Mرموز / 7 أيام

عينات الكود

استدعِ من أي SDK

متوافق مع OpenAI — أبقِ على SDK الحالي

  • OpenAI SDKhttps://api.orcarouter.ai/v1
import os

from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key=os.environ["ORCAROUTER_API_KEY"],
)

response = client.chat.completions.create(
    model="z-ai/glm-5.3-flash",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

المعلمات المدعومة

  • include_reasoning
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_p

الأسعار

الإدخال / 1M توكن$0.075
الإخراج / 1M توكن$0.250
قراءة الذاكرة المؤقتة / 1M$0.017
العملةUSD

حاسبة التكلفة

الرموز / الشهر10MM
نسبة الإدخال70%%
تقديري / الشهر $1.28 · مع تخزين المطالبات مؤقتًا $1.07

تقدير بناءً على السعر المُعلن

مقدّر الرموز والتكلفة

رموز الإدخال: 13التكلفة لكل طلب: $0.000126

تقدير فقط — يعتمد العدد الفعلي للرموز على مُجزّئ الرموز الخاص بالمزوّد.

الأداء

p50 TTFT
7.78 s
سرعة الإخراج
113 tok/s
p95 TTFT
10.00 s
معدل الخطأ
7.4%

المعايير العامة

71.5
AA Coding
أفضل من 88٪ من النماذج المقارنة
15 من 134
57.5
AA Intelligence
أفضل من 92٪ من النماذج المقارنة
11 من 136
Agents' Last Exam
26.3
AutomationBench v1.0.6
48.8
BabyVision
53.4
Chartography (with tools)
78.0
CharXiv Reasoning (with tools)
89.4
DeepSWE v1.1
63.4
GPQA Diamond
91.2
HLE (with tools)
55.3
Humanity's Last Exam
39.9
Long-Context Recall
78.0
MMVU
80.5
MVBench
77.8
NL2Repo
56.3
OfficeQA Pro
62.4
SciCode
46.1
tau_banking
47.2
Terminal-Bench 2.1
84.3
terminalbench_v2_1
84.3
Toolathlon Verified
78.4
المصدر: artificialanalysis.ai, z.ai

نشاط المجتمع

ما يتحدث عنه المطورون هذا الأسبوع

Hacker News10 إشارة · 7 أيامبزيادة 8 عن الأسبوع الماضي

المقارنة

GLM 5.3 FlashGLM 5.1GLM 5.2GLM 5.3
الإدخال $/مليون$0.07$1.40$1.40$1.26
الإخراج $/مليون$0.25$4.40$4.40$3.96
السياق1.0M200K1.0M1.0M
الجودة8/109/109/109/10
مقارنة جنبًا إلى جنبمقارنة جنبًا إلى جنبمقارنة جنبًا إلى جنبمقارنة جنبًا إلى جنب

المزيد من Z.ai

الأسئلة الشائعة

كم تكلفة Z.ai: GLM 5.3 Flash على OrcaRouter؟
Z.ai: GLM 5.3 Flash يتم تسعيره بمبلغ $0.07 لكل مليون رمز إدخال و $0.25 لكل مليون رمز إخراج عبر OrcaRouter. يتم سحب التسعير مباشرة من طبقة التوجيه.
ما هي نافذة سياق Z.ai: GLM 5.3 Flash؟
Z.ai: GLM 5.3 Flash يدعم نافذة سياقية مكونة من 1M رمزًا. استخدم ميزات السياق الطويل (RAG، التلخيص) حتى ذلك الحد.
كيف يمكنني استدعاء Z.ai: GLM 5.3 Flash عبر OpenAI SDK؟
قم بتعيين OpenAI base_url إلى https://api.orcarouter.ai/v1، وقدم مفتاح API الخاص بـ OrcaRouter، وقم بتمرير model="z-ai/glm-5.3-flash" في استدعاء chat.completions.create.
هل يحدد OrcaRouter معدل Z.ai: GLM 5.3 Flash؟
حدود المعدل لكل نموذج تتبع خطة OrcaRouter الخاصة بك. تأتي الطبقات المجانية مع حدود متحفظة؛ بينما ترفع الطبقات المدفوعة هذه الحدود. تفقد /pricing للحصول على الحصص الحالية.

تضمين هذه الشارة

Z.ai: GLM 5.3 Flash$0.07/M in7777ms p50عبر OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/z-ai/glm-5.3-flash" target="_blank"> <img src="https://www.orcarouter.ai/embed/z-ai/glm-5.3-flash.svg" alt="Z.ai: GLM 5.3 Flash على OrcaRouter" /> </a>
Markdown [![Z.ai: GLM 5.3 Flash](https://www.orcarouter.ai/embed/z-ai/glm-5.3-flash.svg)](https://www.orcarouter.ai/models/z-ai/glm-5.3-flash)

بطاقة النموذج كبيانات

GET /api/public/models/z-ai/glm-5.3-flashفتح
قابل للقراءة آليًا:/llms.txt/llms-full.txt