כרטיס הירו שנוצר שכותרתו 'Dots vs GLM-5.2' וכתובית המשנה שלו 'שני הקצוות של שרשרת האספקה של הסוכן'. קו אנכי מחלק אותו: הפאנל השמאלי, המסומן 'Dots', נושא אייקון מחשב ענן ו'משטח סוכן - כלול ב-Pro - הקצבה לא פורסמה'; הפאנל הימני, המסומן 'GLM-5.2', נושא אייקון הורדה ושרת ו'משקולות פתוחות - הקשר של 1M - $1.40 / $4.40 לכל 1M'. הלוגו של OrcaRouter מוטמע בפינה הימנית התחתונה.
Guides & Insights

Dots לעומת GLM-5.2: שני הקצוות של שרשרת האספקה של הסוכנים

מחבר

Rowan Sterling

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

Dots ו-GLM-5.2 יושבים בקצוות מנוגדים של אותה שרשרת אספקה, ואף אחד מהם אינו היריב של האחר. Dots הוא משטח הסוכן שהחברה הכריזה עליו ב-DevDay ב-29 בספטמבר 2026 — עובד שפעיל תמיד עם מחשב ענן ודפדפן משלו, חיבורים ליותר מ-4,000 אפליקציות, זמין ב-ChatGPT, Slack ו-Teams, מופעל על ידי GPT-6 Astra וכלול ב-Pro וב-Business Premium ללא עלות נוספת. GLM-5.2 הוא מודל הטקסט הדגל במשקולות פתוחות של Z.ai, שיצא ב-16 ביוני 2026, עם חלון הקשר של מיליון טוקנים, עד 128,000 טוקנים של פלט ותעריף מפורסם של $1.40 למיליון טוקני קלט ו-$4.40 למיליון טוקני פלט. אחד הוא השכבה שאתה שוכר ולא יכול לראות את תוכה; האחר הוא השכבה שאתה יכול להוריד, לבדוק ולתמחר לפי טוקן. אם אתה מחליט איך להפעיל סוכנים ברבעון הזה, זהו צמד ההחלטות העומד בפניך.

מהו כל אחד מהם, במעבר אחד

• מה זה — סוכן מתארח שפעיל תמיד ללא מזהה מודל משל עצמו (Dots) לעומת מודל טקסט להורדה עם משקולות שפורסמו (GLM-5.2)

• מי מייצר אותו — OpenAI, הוכרז ב-DevDay ב-2026-09-29, לעומת Z.ai (Zhipu AI), שיצא ב-2026-06-16

• היכן זה פועל — מחשב הענן והדפדפן של OpenAI, מבודדים מהמחשב שלך אלא אם תקשר ביניהם, לעומת כל מקום שבו תפרוס אותו: חומרה משלך, ענן לבחירתך, או נקודת הקצה שלנו

• המודל שמתחת — GPT-6 Astra, שנקרא על ידי OpenAI בחומרי ההשקה שלה (לפי הצהרת הספק), מול GLM-5.2 עצמו, מודל mixture-of-experts ש-Z.ai שחררה עם משקולות פתוחות

• מודאליות — הודעות, נתוני אפליקציה ודפדפן בקצה אחד, לעומת טקסט נכנס וטקסט יוצא בלבד, ללא קלט תמונה או אודיו

• קיבולת — מגבלות תגובה לא מתועדות עבור נקודה, לעומת 1,000,000 אסימונים של הקשר ו-128,000 אסימונים של פלט מקסימלי

• מחיר — הנקודה הראשונה כלולה עם Pro או Business Premium, המכסה לא פורסמה, לעומת $1.40 למיליון קלט ו-$4.40 למיליון פלט כפי שמפורט בקטלוג שלנו

• ראיות — הדגמות ספק, ללא מבחן ביצועים עצמאי עבור dots, לעומת מדד Artificial Analysis Intelligence Index של 33.7 ודיווח ספק של 99.1 ב-τ²-Bench, שניהם מובאים עם המקורות שלהם בקטלוג שלנו

החצי של המשקולות הפתוחות, והמלכודת כבר ביום הראשון

ההצעה של GLM-5.2 היא זו המוכרת של משקולות פתוחות, והיא חזקה מהרגיל כאן משום שהמודל זול בכל קנה מידה והמשקולות אומרות שהחלטת הפריסה היא שלך. התוצאות המפורסמות של Z.ai עצמה מובילות עם שימוש בכלי סוכן — 99.1 ב-τ²-Bench, 76.8 ב-MCP-Atlas ו-74.4 ב-FrontierSWE — ואלה נתוני ספק, וראוי לומר זאת בפשטות משום שאלה המספרים שגורמים למודל להיראות כמציאה. מדידה בלתי תלויה מאופקת יותר: מדד הבינה של Artificial Analysis של 33.7 מציב אותו באמצע השדה בלוח הזה, פלח τ-banking של 34.6 הוא צנוע, ו-78.3 באחזור הקשר ארוך נותר מאחורי המובילים הנוכחיים. הקטלוג שלנו נושא 123.2 מיליון טוקנים של תעבורה במודל הזה בשבעת הימים האחרונים, וזה האות הברור ביותר הזמין לכך שאנשים באמת מריצים אותו.

הנה המלכוד, וזו הסיבה שהמאמר הזה קיים ולא כהשוואת מפרטים ישירה. Artificial Analysis מסמנת את GLM-5.2 כמיושן לטובת גרסה חדשה יותר, GLM-5.3, והעמוד החי שלה אומר זאת בראשו: המודל עדיין ניתן לניתוב ועדיין זמין באופן כללי, אבל מפת הדרכים של הספק התקדמה הלאה, ונתוני המדד המשויכים ל-GLM-5.2 הם תמונת מצב ולא מדידה מתמשכת. גם שאר הנתונים הבלתי-תלויים שלה נשארים סטטיים מאותה סיבה — ההודעה של AA מסבירה שלאחר ההתיישנות היא ממשיכה למדוד רק את עומס העבודה המוגדר כברירת מחדל של המודל, והתוצאות עבור כל השאר הופכות להיסטוריות.

A screenshot of the Artificial Analysis page for GLM-5.2 in its maximum-reasoning configuration. A banner at the top states that the model is deprecated, that AA continues performance benchmarking only for the default 10k input-token workload, that results for other workloads are historical and no longer updated, and that Z.ai has launched a newer release, GLM-5.3, which the page suggests considering instead. Below it the page describes GLM-5.2 (max) as an open weights model priced at $1.40 input and $4.40 output per million tokens with an 81% cache discount, alongside an intelligence gauge and a comparison summary.

שני לקחים נובעים מכך, ושניהם תקפים הרבה מעבר למודל הזה. ראשית, מחיר ורישיון הם עובדות עמידות לגבי הפצה במשקלים פתוחים; מיקום בלוח דירוג הוא דבר משתנה, ומודל יכול להיות זול, ניתן להורדה, ובכל זאת להיות מוחלף. שנית, היורש כבר כאן: Z.ai שחררה את GLM-5.3 כדגל הספינה הנוכחי שלה, במחיר נמוך מ-GLM-5.2 — 1.26 דולר לקלט ו-3.96 דולר לפלט למיליון — עם מדד Intelligence Index עצמאי של 44.8 לעומת 33.7 של GLM-5.2. כל מי שבונה כעת צריך לתמחר קודם את המודל החדש יותר ולהתייחס ל-GLM-5.2 כרצפה הזולה שמתחתיו, ולא כחזית של המשפחה.

כמה עולה נקודה, ולמה אף אחד משניכם לא יכול להקצות לה תקציב

OpenAI פרסמה מחיר אחד עבור נקודות — הראשונה כלולה ב-Pro וב-Business Premium, עם מגבלות מורחבות בחודש הראשון ושיחות שאינן מנצלות את מגבלות השימוש של ChatGPT. אין נתון מכסה, אין מחיר לנקודה שנייה, אין תעריף למהירות או לקיבולת נוספות, אין עלות למשימה שהושלמה, ואין מחיר ארגוני לנקודות המומחות שנמצאות כעת בבדיקות פנימיות. בסיקור הנאום המרכזי של CNBC, מנהלת הכספים שרה פריאר מתמחרת את מסלול Pro 500 החדש ב-500 דולר כמכסת שימוש בתוספת מצב Ultrafast, ולא כתעריף לנקודה; גם התוכנית היקרה ביותר במחירון של OpenAI אינה מתורגמת לעלות ליחידת עבודת סוכן.

ל-GLM-5.2 יש הבעיה ההפוכה, שהיא הבעיה הטובה יותר: יותר מדי מספרים, וכולם ניתנים לבדיקה. המחירון הוא $1.40 ו-$4.40 למיליון טוקנים, עם קריאות ממטמון ב-$0.26, והמודל ניתן להורדה, כך שהעלות השולית של בקשה שאתה מריץ בעצמך היא חומרה וחשמל ולא חשבונית של ספק. זו העסקה במשפט אחד. נקודה נותנת לך עובד בלי מונה; GLM-5.2 נותן לך מונה בלי עובד.

A generated scoreboard titled 'Dots vs GLM-5.2 - licence, meter, evidence', with two columns. 'Dots' lists: Licence closed hosted service; Meter included with Pro, allowance unpublished; Model GPT-6 Astra (vendor-stated); Context not published; App connectors 4,000+; Independent benchmark none. 'GLM-5.2' lists: Licence open weights, released 2026-06-16; Price $1.40 in / $4.40 out per 1M; Cached reads $0.26 per 1M; Context 1,000,000 tokens; Max output 128,000 tokens; AA Intelligence Index 33.7, page marked deprecated. A footer reads 'Dots details vendor-stated from DevDay; GLM-5.2 figures as listed in the OrcaRouter catalogue and on Artificial Analysis.'

הצבת מודל מחויב לפי שימוש תחת סוכן שאתה שוכר

הדרך המועילה להחזיק את שניהם היא לתת לכל אחד מהם את החצי של העבודה שהוא עושה היטב. dot מטפל בתיאום: לנטר פרויקט, לרדוף אחרי האנשים והמערכות המעורבים, ולחזור עם משהו גמור. GLM-5.2 — או היורש שתמחרת מולו — מטפל בהיסק שאתה צריך להחזיק בעצמך: מעבר החילוץ על ארכיון של מיליון טוקנים, ההפקה הארוכה, תור הסיווג, החלק שבו תשובה שגויה עולה יותר מהטוקנים שחסכה.

הפיצול הזה מחייב שמחצית ההיסק תהיה ניידת, וזו בעיית ניתוב ולא בעיית מודל. OrcaRouter מגישה את GLM-5.2 בתור z-ai/glm-5.2 במחיר המחירון של הספק כפי שהוא, עם 0% תוספת — שום דבר לא נוסף על כך, כך שהורדת תעריפים של Z.ai מגיעה לחשבון שלך באותו יום — בתוך קטלוג של יותר מ-200 מודלים מאחורי מפתח יחיד, עם כלי ה-failover והניתוב שמאפשרים למשימה לעבור למודל חדש יותר או זול יותר בלי שינוי בקוד. מה שהיא לא מציעה הוא נקודה: אין נקודת קצה של dots, אין מזהה מודל עבור הסוכן, ואין דרך להחליף את הבינה שפועלת בתוכו. הגבול אמיתי, ולהעמיד פנים אחרת יהיה השקופית הלא-ישרה היחידה בהשוואה הזו.

ההמלצה, שנאמרה פעם אחת

אם אתם רוצים שהעבודה תתבצע בלי שאתם מפעילים אותה, קנו את ה-dot — זה לא עולה דבר מעבר למנוי שאולי כבר יש לכם, והמגבלה שלו היא שעדיין אינכם יכולים להוכיח מה הוא חסך לכם. אם אתם רוצים לדעת מה העלות של החשיבה שלכם ולהיות מסוגלים להעביר אותה אחר כך, הציבו את GLM-5.2 או את היורש שלו מאחורי נקודת קצה משלכם ומדדו אותו. הצוותים שעושים זאת נכון בשלהי 2026 עושים את שניהם, והמשמעת שמאפשרת לזה לעבוד היא הסירוב לתת לשכבה השכורה להחזיק במשהו שלא יוכלו להחליף.

A screenshot of the OrcaRouter model catalogue page headed 'Models', showing the line '206 models - 16 providers - one API key, one bill' above filter controls for input modalities, context length, input price, status and supported parameters, with a grid of model cards visible beneath.

השוואות במאמר הזה2

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית