GLM 5.2

z-ai/glm-5.2
מומלץ
כליםJSONהיגיון
מאת Z.ai · 2026-06-16

GLM-5.2 הוא דגם הדגל של Z.ai (Zhipu AI) לעידן המשימות ארוכות הטווח. הוא מציע חלון הקשר של מיליון טוקנים שמיש באמת יחד עם עד 128K טוקני פלט, מה שמאפשר לו להחזיק הקשר הנדסי ברמת פרויקט, לבצע משימות ארוכות טווח באופן אמין יותר, לעקוב אחר תקנים הנדסיים בצורה עקבית יותר, ולהוביל משימה מהדרישות ועד לפריסה על פני פלטפורמות מרובות בריצה אחת. זהו מודל טקסט-נכנס/טקסט-יוצא עם חשיבה היברידית הנשלטת על ידי reasoning_effort (high / max; חשיבה עמוקה כברירת מחדל) וקריאת כלים מקורית. נבנה בגישת קוד-ראשון כחלק האחרון בקו GLM-5, GLM-5.2 הושק במסגרת GLM Coding Plan עם גישת API עצמאית ומשקלים פתוחים ברישיון MIT זמן קצר לאחר מכן. הוא מיועד לקידוד סוכני בקנה מידה של מאגר קוד, תהליכים הנדסיים אוטונומיים מרובי-שלבים, והעברת פרויקטים מורכבים ארוכי טווח.

הקשר1M tokens
מקסימום פלט128K
קלטtext
פלטtext
p50 TTFT6.51 s
קלט$1.40/ 1M טוקנים
פלט$4.40/ 1M טוקנים
p50 TTFT6.51 s7 ימים
p95 TTFT10.00 s7 ימים
תעבורה723.9Mטוקנים / 7 ימים

Z.ai: GLM 5.2 הוא מודל שפה גדול מבוסס טקסט בלבד עם חלון הקשר של 1,000,000 טוקנים ותפוקה מקסימלית של 128,000 טוקנים. הוא פותח על ידי Z.ai ומוצע דרך ה-API של OrcaRouter. המודל מעבד רק קלטים טקסטואליים,…

מה זה Z.ai: GLM 5.2?

למי מיועד המודל הזה?

מהן המפרטים העיקריים?

דוגמאות קוד

קריאה מכל SDK

תואם OpenAI — המשיכו להשתמש ב-SDK שכבר יש לכם

  • OpenAI SDKhttps://api.orcarouter.ai/v1
from openai import OpenAI

client = OpenAI(
    base_url="https://api.orcarouter.ai/v1",
    api_key="$ORCAROUTER_API_KEY",
)

response = client.chat.completions.create(
    model="z-ai/glm-5.2",
    messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)

פרמטרים נתמכים

  • include_reasoning
  • max_tokens
  • reasoning
  • reasoning_effort
  • response_format
  • stop
  • stream
  • temperature
  • tool_choice
  • tools
  • top_p

תמחור

קלט / 1M טוקנים$1.40
פלט / 1M tokens$4.40
קריאת מטמון / 1M$0.260
מטבעUSD

מחשבון עלות

טוקנים / חודש10MM
נתח קלט70%%
מוערך / חודש $23.00 · עם מטמון הנחיות $19.01

הערכה מבוססת מחיר מחירון

מחשבון טוקנים ועלות

טוקני קלט: 12עלות לבקשה: $0.002217

הערכה בלבד — ספירת הטוקנים בפועל תלויה בטוקנייזר של הספק.

ביצועים

p50 TTFT
6.51 s
מהירות פלט
78.6 tok/s
p95 TTFT
10.00 s
שיעור שגיאות
1.1%

מבחני ביצועים ציבוריים

68.8
AA Coding
טוב יותר מ-84% מהמודלים שהושוו
#18 מתוך 123
51.1
AA Intelligence
טוב יותר מ-84% מהמודלים שהושוו
#20 מתוך 125
59.8
AA Math
טוב יותר מ-43% מהמודלים שהושוו
#46 מתוך 81
AIME 2026
99.2
CritPt
16.7
DeepSWE
46.2
FrontierSWE (Dominance)
74.4
GPQA Diamond
89.5
GPQA-Diamond
91.2
HLE
40.5
HLE (w/ Tools)
54.7
HMMT Feb. 2026
92.5
HMMT Nov. 2025
94.4
Humanity's Last Exam
40.1
IFBench
73.3
IMOAnswerBench
91.0
Long-Context Recall
71.3
MCP-Atlas (Public Set)
76.8
MMLU-Pro
62.8 index
NL2Repo
48.9
PostTrainBench
34.3
ProgramBench
63.7
SciCode
50.5
SWE-bench Pro
62.1
SWE-Marathon
13.0
tau_banking
26.8
Terminal Bench 2.1 (Best Reported)
82.7
Terminal Bench 2.1 (Terminus-2)
81.0
TerminalBench Hard
50.8
terminalbench_v2_1
77.9
Tool-Decathlon
48.2
τ²-Bench
99.1
מקור: artificialanalysis.ai, zai-org

איך זה משתווה

GLM 5.2GLM 5.1GLM 5GLM 4.5
קלט $/מיליון$1.40$1.40$1.00$0.60
פלט $/מיליון$4.40$4.40$3.20$2.20
הקשר1.0M200K200K128K
איכות9/109/108/107/10
השוואה זו לצד זוהשוואה זו לצד זוהשוואה זו לצד זוהשוואה זו לצד זו

שאלות נפוצות

מהי העלות לטוקן עבור GLM 5.2?
עלות אסימוני קלט היא $1.40 למיליון אסימונים, ועלות אסימוני פלט היא $4.40 למיליון אסימונים. אין תוספת מחיר על ידי OrcaRouter; אתה משלם את תעריף הספק של Z.ai.
מה גודל חלון ההקשר של המודל?
חלון ההקשר הוא 1,000,000 טוקנים (קלט ופלט יחד). הפלט המרבי הוא 128,000 טוקנים לכל בקשה.
מהן חוזקות המודל?
יתרונו העיקרי הוא חלון ההקשר הגדול (1M טוקנים) ומגבלת הפלט הגבוהה (128k טוקנים), המאפשרים עיבוד של מסמכים או שיחות ארוכים מאוד בקריאה יחידה. הוא מבוסס טקסט בלבד.
איך GLM 5.2 משתווה למודלים אחרים עם חלונות הקשר קטנים יותר?
יש לו חלון הקשר גדול בהרבה, מה שהופך אותו למתאים למשימות הדורשות קריאת ספרים שלמים או מאגרי קוד גדולים. מודלים קטנים יותר זולים ומהירים יותר עבור משימות שמתאימות לגבולות ההקשר שלהם.
האם OrcaRouter שומר טוקנים במטמון או מציע הנחות?
לא, OrcaRouter אינו מפרסם שמירת אסימונים (token caching) או הנחות נפח למודל זה. התמחור הוא לפי אסימון בתעריף של הספק ללא תוספת מחיר.
כיצד אני יכול להתקשר ל-GLM 5.2 דרך OrcaRouter?
השתמש ב-API התואם ל-OpenAI בכתובת הבסיס https://api.orcarouter.ai/v1, מזהה המודל “z-ai/glm-5.2”. שלח בקשה סטנדרטית להשלמת צ'אט עם מפתח ה-API שלך.
באילו אופני קלט תומך המודל?
Z.ai: GLM 5.2 תומך רק בקלט טקסט. הוא לא יכול לעבד תמונות, אודיו, או מולטימודליויות אחרות.
האם יש ציוני benchmark ידועים?
אין ציוני בנצ'מרק עבור GLM 5.2 במידע הזמין. משתמשים צריכים להעריך את המודל על מערכי הנתונים שלהם.
האם ניתן להזרים את הפלט?
כן, הגדר `stream: true` בקריאת ה-API שלך. התגובה תישלח כאירועי server‑sent, זהים לפורמט הסטרימינג של OpenAI.
מה קורה אם אני עובר את מגבלת ה-1M טוקנים?
תתקבל שגיאה. ודא שמספר האסימונים הכולל בהודעות שלך בתוספת max_tokens אינו עולה על 1,000,000.

הטמעת התג הזה

Z.ai: GLM 5.2$1.40/M in6506ms p50דרך OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/z-ai/glm-5.2" target="_blank"> <img src="https://www.orcarouter.ai/embed/z-ai/glm-5.2.svg" alt="Z.ai: GLM 5.2 ב-OrcaRouter" /> </a>
Markdown [![Z.ai: GLM 5.2](https://www.orcarouter.ai/embed/z-ai/glm-5.2.svg)](https://www.orcarouter.ai/models/z-ai/glm-5.2)

כרטיס מודל כנתונים

GET /api/public/models/z-ai/glm-5.2פתיחה
קריא למכונה:/llms.txt/llms-full.txt