כרטיס כותרת עם הכיתוב "Grok 4.7 vs GLM-5.2" וכותרת המשנה "הרישיון מאריך ימים יותר מהמודל", ושלושה כרטיסים: AA Index v4.3.2 46 מול 34, רישיון סגור מול MIT, ומחיר ל-1M $2/$6 מול $1.40/$4.40.
Guides & Insights

Grok 4.7 מול GLM-5.2: הרישיון שורד את המודל

מחבר

Elias Hawthorne

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

הדבר היקר ביותר ב-GLM-5.2 אינו ציון הבנצ'מרק שלו. אלה ארבע האותיות MIT. Z.ai שחררה את GLM-5.2 ב-16 ביוני 2026 תחת רישיון MIT סטנדרטי, בלי מגבלות אזוריות, בלי סף הכנסות ובלי תנאי שימוש מסחרי מעבר לשמירה על הודעת זכויות היוצרים — וכאשר Z.ai הוציאה את GLM-5.3 חודשיים לאחר מכן, היא לא עשתה זאת שוב. ליורש יש רישיון מותאם אישית בשם "GLM-5.3 License" שמוסיף חריג: מפעיל של מודל כשירות עם יותר מ-10 מיליארד דולר בהכנסות בכל תקופה של שנים עשר חודשים רצופים חייב לעבור סקירת אבטחה, כאשר היקף הסקירה "ייקבע באופן סביר על ידי Z.AI." GLM-5.2 הוא מודל הדגל הטקסטואלי האחרון ש-Z.ai שחררה בלי התנאי הזה. לעומת Grok 4.7 — ששוחרר על ידי הספק ב-21 בספטמבר 2026, בעל משקולות סגורות ובן יום — זה הופך את ההשוואה לזו שבין המודל החזק ביותר על הלוח לזה החופשי ביותר.

אחד מאלה אתה יכול להחזיק בבעלות מלאה

GLM-5.2 הוא מודל תערובת מומחים (mixture-of-experts) בעל 753 מיליארד פרמטרים, עם כ-40B פרמטרים פעילים לכל טוקן, שפורסם ב-BF16 וב-FP8 ב-Hugging Face תחת ארגון zai-org. יש לו חלון הקשר של 1M טוקנים ופלט מקסימלי של 128K. הוא טקסט נכנס, טקסט יוצא — ללא ראייה מקורית — עם קריאה לפונקציות, אינטגרציית MCP, פלט JSON מובנה ומטמון הקשר, ומצב חשיבה שדלוק כברירת מחדל עם הגדרת מאמץ חשיבה. ה-API של Z.ai כצד ראשון מפרט אותו במחיר של $1.40 למיליון טוקני קלט, $0.26 לקלט במטמון, ו-$4.40 למיליון טוקני פלט.

Grok 4.7 הוא מודל סגור. יש לו חלון הקשר של 500k טוקנים, הוא קולט טקסט ותמונות, ומתומחר ב-2.00 דולר לקלט ו-6.00 דולר לפלט למיליון טוקנים בפרומפט מתחת ל-200k טוקני פרומפט, ועולה ל-4.00 ול-12.00 דולר מעל הקו הזה, עם קריאות ממטמון ב-0.50 ו-1.00 דולר. אין הורדת משקלים, אין נתיב לאירוח עצמי, ואין דרך להמשיך לקרוא לו אם xAI תשנה את דעתה — אותה עמדה מבנית כמו זו של כל דגם דגל סגור. שני המודלים מסוגלים; רק אחד מהם הוא נכס שאפשר לשים על דיסק.

מה שהאינדקס אומר, ומה המשמעות של "deprecated" כאן

Artificial Analysis מעניקה ל-GLM-5.2 ציון 34 ב-Intelligence Index v4.3.2 — המהדורה שפורסמה ב-19 בספטמבר 2026 — ול-Grok 4.7 ציון 46 באותה מהדורה. הפער הזה של שתים עשרה נקודות הוא אמיתי, וצורתו חשובה יותר מגודלו. GLM-5.2 נושאת גם תווית "deprecated" בעמוד שלה ב-Artificial Analysis, עם הערה שקיים דגם חדש יותר, וש�רק עומס העבודה המוגדר כברירת מחדל של 10k טוקנים ממשיך לעבור בנצ'מרק. התווית הזו עוסקת בהחלפה, לא בהשבתה: Z.ai עדיין מספקת את glm-5.2 היום ועדיין מציגה אותו בטבלת התמחור שלה.

מורכב — Grok 4.7 (xhigh): 46 במדד הבינה של Artificial Analysis v4.3.2. GLM-5.2 (max): 34 באותה גרסה.

מסופים אג'נטיים — Grok 4.7: Terminal-Bench 4.0 26. GLM-5.2: 1. זהו הנתון הבודד הקיצוני ביותר במקבץ ההשוואות הזה, והוא מחייב את ההסתייגות הנלווית לו. כרטיס המודל של Z.ai עצמו מדווח על GLM-5.2 בציון 81.0 ב-Terminal-Bench 2.1, וההרנס הטוב ביותר 82.7. שני המספרים כנים; הם על גרסאות שונות של המדד, והאינדקס v4.3.2 הוציא את 2.1 משימוש לטובת 4.0. ציון ספק על מדד שהוצא משימוש אומר לך מה מודל יכול היה לעשות מול המבחן הישן, ולא מה הוא עושה כעת.

אוטומציה של זרימות עבודה — Grok 4.7: AutomationBench-AA 66%. GLM-5.2: 28%. שניהם נמדדו על v4.3.2, ולכן אין כאן צורך בהסתייגות לגבי גרסה.

יושר בידע — Grok 4.7: AA-Omniscience 32. GLM-5.2: 4. שוב אותה גרסה בשני הצדדים.

חשיבה והקשר ארוך — Grok 4.7: HLE 43, CritPt 18, AA-LCR v1.1 ‎77%, חלון 500k. GLM-5.2: HLE 41, CritPt 21, AA-LCR v1.1 ‎78%, חלון 1M. GLM-5.2 מנצח בשניים מארבעת אלה, ובחלון ההקשר פי שניים.

מהירות — Grok 4.7: טרם נמדד על ידי Artificial Analysis. GLM-5.2: 73 טוקנים לשנייה עם זמן של 5.98 שניות עד לטוקן הראשון דרך ה-API של Z.ai, ומתואר כאיטי מהממוצע לעומת מודלים דומים עם משקולות פתוחות.

מחיר — Grok 4.7: $2.00 / $6.00 ל-1M, וכפול ב-200 אלף אסימוני פרומפט. GLM-5.2: $1.40 / $4.40 ל-1M עם קריאות מהמטמון ב-$0.26, ללא שינוי מאז ההשקה.

OrcaRouter model page for GLM-5.2 showing the z-ai/glm-5.2 identifier, a 1M-token context window, a 128K maximum output, text-only input and output, list rates of $1.40 per 1M input and $4.40 per 1M output, and 24.7M tokens of traffic over seven days.

הכלכלה של אירוח עצמי היא הטיעון האמיתי.

לפי טוקן, GLM-5.2 זול יותר בכ-30% בקלט ובכ-27% בפלט מאשר Grok 4.7 בפרומפטים קצרים — הנחה צנועה שלא תכריע דבר בעצמה. הסיבה שזה חשוב היא שמחיר לפי טוקן הוא אופציונלי. המשקולות של GLM-5.2 ניתנות להורדה תחת רישיון המתיר שימוש מסחרי, שינוי, הפצה מחדש ורישוי משנה, מה שאומר שההשוואה הרלוונטית היא לא $1.40 מול $2.00 אלא $1.40 מול מה שעולה לך ה-GPU שלך למיליון טוקנים. מודל 753B עם 40B פעילים אינו עומס עבודה למחשב נייד; זהו פריסת הסקה רצינית, ונקודת ביקורת FP8 קיימת בדיוק לשם כך. אבל זו פריסה שאתה יכול להריץ, להגביל ולבקר — ולעומס עבודה בפיקוח או כזה שאינו מחובר לרשת, זו בכלל לא שאלה של עלות.

המשקל שכנגד הוא סיכון ההחלפה בכיוון ההפוך. GLM-5.2 מפגר בשתי גרסאות: GLM-5.3 יצא ב-18 באוגוסט ו-GLM-5.3-Flash ב-26 באוגוסט, ודגמי הדגל החדשים יותר מקבלים ציון גבוה יותר — GLM-5.3 עם 45 ב-v4.3.2, נקודה אחת מתחת ל-Grok 4.7. אז ההצגה הכנה היא ש-GLM-5.2 הוא החופשי, לא הטוב ביותר, ושהדגמים החדשים יותר של Z.ai עצמה גם חזקים יותר וגם בעלי רישיון מגביל יותר. אם רישוי מתירני הוא מה שאתה צריך, GLM-5.2 הוא נקודת הקצה שעליך להקפיא; אם יכולת גולמית על סט משקולות פתוח היא מה שאתה צריך, היורש הוא זה שכדאי להעריך, בעין של עורך דין על החרגת ההכנסות.

Two-column scoreboard titled “Grok 4.7 vs GLM-5.2 - the scoreboard”: AA Index 46 vs 34, Terminal-Bench 4.0 26 vs 1, context 500k vs 1M, price per 1M $2/$6 vs $1.40/$4.40, and licence “closed” vs “MIT”.

הרצת את שניהם בלי להריץ שני סטאקים

OrcaRouter כולל את GLM-5.2, הרשום בעמוד המודל שלו ב-1.40$ לקלט ו-4.40$ לפלט, עם חלון הקשר של 1M ופלט מרבי של 128K, מפני שאנחנו מעבירים הלאה את מחירי המחירון של הספקים בתוספת של 0%. עם מודל במשקלים פתוחים למעבר הזה יש שימוש שני: המחיר של הגרסה המאוחסנת (hosted) ואפשרות ההרצה העצמית הם שתי אפשרויות זמינות, ונתב מאפשר לך להעביר תעבורה ביניהם לפי בקשה במקום לפי חוזה. Z.ai שמרה על מחיר המחירון של GLM-5.2 קבוע מאז יוני בעוד שמארחי צד שלישי הזיזו את שלהם מעלה ומטה, כך שמעבר מחירים באותו היום הוא ההבדל בין להציע את התעריף של היום לבין להציע תעריף שהעתקת בחודש שעבר. מעבר אוטומטי בעת כשל (failover) מכסה את המקרה שבו פריסה בהרצה עצמית מגיעה לרוויה ונקודת הקצה המאוחסנת צריכה לספוג את העודף — ה-DSL של הניתוב מרכיב את השניים לקריאה אחת. Grok 4.7 אינו בקטלוג של OrcaRouter נכון לכתיבת שורות אלה; קריאה לו משמעה לעבור דרך ה-API של xAI עצמה והפלטפורמות של צד שלישי שמציעות אותו.

כלל ההחלטה שנובע מכל זה נקי באופן יוצא דופן. אם אתה צריך להחזיק במודל בבעלותך — on-premise, מבוקר, שניתן לרישוי ללא בדיקת הכנסות — GLM-5.2 הוא היחיד מבין השניים שמציע זאת, ופער שתים-עשרה הנקודות במדד הוא המחיר של החופש הזה. אם אתה צריך את המודל שמסיים עבודה סוכנית, הפער נע בכיוון ההפוך וזה לא עדין: 66 אחוזים מול 28 אחוזים באוטומציה של תהליכי עבודה, 26 מול 1 בסוכני טרמינל, 32 מול 4 ביושר ידע. שום דבר בשאלת הרישיון לא משנה את המספרים האלה.

השיחה

Grok 4.7 מנצח בהשוואת היכולות, והוא מנצח בה הודות להערכות שמנבאות אם סוכן משלים משימה. GLM-5.2 מנצח בשני הדברים שאף מבחן לא מודד: הוא זול יותר, והוא שלך. הפרט שהופך את זה למשהו ששווה לרשום הוא שהיתרון השני עומד לפוג — מוצרי הדגל החדשים יותר של Z.ai זנחו את רישיון MIT ללא הגבלות, כך שמודל ששוחרר ביוני 2026 בתנאים שלא דורשים ממך דבר הוא כעת פריט היסטורי ולא מדיניות. אם משקלים פתוחים מתירניים הם קריטיים למוצר שלך, זו סיבה לתקנן על GLM-5.2 בעוד הוא עדיין האפשרות המתארחת הזולה ועדיין אפשר להורידו. אם לא, קנה את שתים עשרה הנקודות.

Artificial Analysis page for Grok 4.7 at xhigh reasoning effort: an Artificial Analysis Intelligence Index score of 46, ranked #16 of 655; Speed and Cost both reported as N/A; 240M output tokens from the Intelligence Index run, ranked #140 of 655; a 500k-token context window with text and image input and text output; and comparison charts for intelligence, speed and cost per task.

השוואות במאמר הזה1

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית