כרטיס כותרת שנוצר שכותרתו 'Step 5 Preview מול GLM-5.5 — אחד משוחרר, אחד לא' עם שתי עמודות: Step 5 Preview במדד AA Index 44, 600B סה"כ / 27B פעילים, מחיר $1.00 / $2.70, פלט 99.8 טוקנים/שנייה ו-API חי מאז 20 בספטמבר; GLM-5.5 עם שורות שבהן כתוב: אין כרטיס דגם, אין מזהה API, אין תמחור ואין שם מאושר. בכותרת התחתונה נכתב: 'נתוני Step 5 Preview לפי Artificial Analysis; GLM-5.5 הוא דגם שלא הוכרז ולא שוחרר.'
Guides & Insights

Step 5 Preview לעומת GLM-5.5: מודל אחד יוצא היום, האחר הוא עדיין תחזית

מחבר

Gideon Frost

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

Step 5 Preview פתח את ה-API שלו ב-20 בספטמבר 2026, באותו יום שבו StepFun הכריזה עליו, ותוכלו לבצע קריאה אליו היום אחה״צ מנקודת קצה אחת בתעריף של $1.00 למיליון טוקני קלט ו-$2.70 למיליון טוקני פלט. GLM-5.5 אינו קיים. אין כרטיס מודל, אין מזהה API, אין מחיר, אין צ'קפוינט ואין קובץ רישיון, ואין בשום מקום דף של Z.ai שמשתמש בשם — כי GLM-5.5 הוא כינוי קהילתי שהחברה מעולם לא אימצה. חוסר הסימטריה הזה הוא המאמר. בהמשך מפורט מה ש-StepFun באמת השיקה, מה שידוע באמת על דגם הדגל הבא של Z.ai, וההשוואה הישירה שתוכלו להריץ היום במקום זו שבכותרת.

מה זה GLM-5.5, ומה הוא לא

השם נכנס למחזור באמצע 2026 כשהוא קשור לחלון השקה, ולחלון יש מקור שניתן להתחקות אחריו: תחזית אנליסטית שהועברה ב-25 ביוני 2026, שקבעה את הדגם המוביל הבא של Z.ai באוגוסט. זה היה חלון מעקב, לא התחייבות מצד הספק, ואוגוסט הסתיים בלעדיו. מה ש-Z.ai שחררה במקום זאת היה GLM-5.3, שהוכרז ב-14 באוגוסט, כשה-API שלו פעיל בסביבות 18 באוגוסט ומשקלים פתוחים ב-28 באוגוסט, ואחריו GLM-5.3-Flash ב-26 באוגוסט. שום צ'קפוינט של GLM-5.5 לא הופיע בארגון Hugging Face של הספק עצמו, שבו המאגרים החדשים ביותר עדיין מסתכמים בסדרת GLM-5.3.

גם מתן השמות אינו סגור. GLM-5.3, GLM-5.4, GLM-5.5 ו-GLM-6 כולם הועלו באותו חלון זמן, ו-Z.ai לא אישרה אף אחד מהם. האות היחיד מצד החברה הוא הערתו של מייסד שותף על מהדורת "epic plus", שהיא מצב רוח ולא מפרט. אנליסטים שקוראים את הקצב של הספק — בערך דגם דגל אחד כל 54 עד 70 יום — כעת משערים שהמודל הבא ייצא בחלון זמן שבין 8 באוקטובר ל-9 בנובמבר 2026, ומצפים שהוא ימוספר כ-GLM-5.4 ולא כ-GLM-5.5.

שלוש טענות מופצות כאילו אושרו, וכדאי להיות מדויקים לגבי שלושתן. מספר הפרמטרים הוא החלש מבין השלושה: שום מקור רשמי אינו תומך בנתון של "יותר מטריליון", ופוסטים ברשתות החברתיות שמנפחים אותו מעבר ל-3 טריליון לא מצטטים דבר כלל. חלון ההקשר של 1M טוקנים הוא ההנחה הבטוחה ביותר, משום שגם GLM-5.2 וגם GLM-5.3 כוללים אותו. משקלים פתוחים הם ציפייה ולא הבטחה — Z.ai פרסמה משקלים עבור כמה מדגלי הדגל האחרונים שלה, וזהו דפוס, לא התחייבות.

מה ש-Step 5 Preview באמת מספק

המודל של StepFun הוא החצי המוחשי של ההשוואה הזו, והמפרט אינו שגרתי. זהו מודל תערובת מומחים דלילה (sparse mixture-of-experts) עם 600B פרמטרים בסך הכול, כשכ-27B פעילים לכל טוקן — יחס הפעלה של קרוב ל-4.5% — הבנוי על טרנספורמר צר ועמוק בעל 92 שכבות, עם קשב מסוג grouped-query דליל ומיזוג טוקנים לפי בלוקים. חלון ההקשר הוא 1M טוקנים, הקלט הוא טקסט ותמונות, הפלט הוא טקסט, והוא מבצע היסק באמצעות חשיבה מורחבת. StepFun דילגה על כל סדרת Step 4.x כדי להגיע לכאן, ועברה ישירות מ-Step-3.7-Flash ל-Step 5.

• Intelligence Index — 44 ב-Artificial Analysis, המקום ה-24 מתוך 200 מודלים שדורגו, לעומת חציון של 24

• מהירות הפלט — 99.8 טוקנים לשנייה, ה-45 מתוך 200

• זמן עד לאסימון הראשון — 2.96 שניות באותה הרצה בלתי תלויה

• מחיר — $1.00 למיליון טוקני קלט, $2.70 למיליון טוקני פלט, עם הנחת מטמון של 95%

• עלות לכל משימת Intelligence Index — $0.71, המקום ה-27 מתוך 200

• משקלים — אין היום; צ׳קפוינט BF16 מתוכנן ל-15 באוקטובר 2026

• רישיון — לא פורסם. המודל הוא קנייני, ואין הצהרה על מתן זכות שימוש מסחרי, זכות הפצה או הרשאה לכוונון עדין.

המחיר הוא השורה המושכת את העין, וכך גם נתון אחד שמיטיב עם StepFun פחות מכפי שהוא נראה במבט ראשון: 160M אסימוני פלט ב-Intelligence Index לעומת חציון של 92M, מקום 64 מתוך 200 במדד הזה. המודל מפורט מדי, ופירוט יתר הוא מכפיל עלות בדיוק בעומסי העבודה האג'נטיים שעבורם הוא נמכר. נתון העלות למשימה של $0.71 כבר מגלם זאת, ולכן זה המספר היותר כן לצטט מאשר מחיר המחירון.

ההערכות של StepFun עצמה אינן משוחזרות ויש לקרוא אותן כחומר ספק עד שמישהו בלתי תלוי יריץ אותן. הן מציבות את המודל ב-29.5 ב-ALE-CLI, 66.4 ב-FrontierFinance, 83.3 ב-DRACO, 80.5 ב-ProgramBench, 67.7 ב-DeepSWE v1.1 ו-49.0 ב-StepCodeBench, עם 33.3% ב-Terminal-Bench 4.0 ו-1571 ב-GDPval-AA v2. StepFun גם מדווחת על שיא MLA של 508 TFLOPS במשימת אופטימיזציה של קרנל GPU בת 24 שעות לעומת 493 עבור Claude Opus 5. אלה המספרים של StepFun על מודל ש-StepFun לא פתחה.

Screenshot of the Artificial Analysis model page for Step 5 Preview, showing StepFun as the creator with a September 2026 release date, an Intelligence Index of 44 at rank 24 of 200, output speed 99.8 tokens per second at rank 45 of 200, cost per Intelligence Index task $0.71 at rank 27 of 200, verbosity 160M output tokens against a 92M median, pricing of $1.00 per million input tokens and $2.70 per million output tokens with a 95% cache discount, and technical specifications listing reasoning support, text and image input, and a 1M-token context window.

הראש בראש שאתה יכול להריץ במקום זה

אם אתם רוצים את ההשוואה שהכותרת מבטיחה, החלופה ההגונה היא Step 5 Preview מול GLM-5.3 — המודל ש-Z.ai למעשה השיקה, שעדיין הדגל הפתוח הנוכחי שלה, ושאותו כל GLM-5.5 יחליף. בלוח העצמאי השניים במרחק נקודה אחד זה מזה. ובכמעט כל דבר אחר הם לא.

• Intelligence Index — Step 5 Preview 44 מול GLM-5.3 45

• פרמטרים — 600B סה״כ / 27B פעילים לעומת 753B סה״כ / 40B פעילים

• מהירות פלט — 99.8 טוקנים/שנייה לעומת 72.1 טוקנים/שנייה

• זמן עד לטוקן הראשון — 2.96s לעומת 2.99s

• מחיר למיליון טוקנים — $1.00 בקלט / $2.70 בפלט לעומת $1.40 בקלט / $4.40 בפלט

• הנחת מטמון — 95% לעומת 81%

• עלות לכל משימת Intelligence Index — $0.71 לעומת $2.01

• מודאליות קלט — טקסט ותמונות לעומת טקסט בלבד

• רישיון — לא פורסם לעומת רישיון Z.ai מותאם אישית שאינו MIT

התבנית חוזרת על מה שהשקת ה-Preview בשלב 5 ביססה מול כל מודל שנמצא בשימוש אשר הוא נמדד מולו: יתרון יעילות מכריע ותיקו סטטיסטי ביכולות. הוא מייצר טוקנים מהר יותר בכ-38%, עולה בערך חצי מהעלות למיליון טוקנים בשני הכיוונים, ומסתכם בזול פי 2.8 לכל משימת אינדוקס מול GLM-5.3 — בעוד שהוא משיג נקודה אחת פחות. על הלוח, אותו 44 גם מציב אותו באותו קו עם Kimi K3, וזה שווה לדעת לפני שמתייחסים לאחד מהם כמוביל.

השורה היחידה שבה Step 5 Preview נמצא בבירור מאחור היא זו שאי אפשר להריץ עליה בנצ'מרק. ל-GLM-5.3 יש קובץ רישיון ומשקולות שניתנות להורדה; ל-Step 5 Preview יש מאגר Hugging Face המכיל .gitattributes בודד ותאריך מוצהר של 15 באוקטובר עבור צ'קפוינט ה-BF16. אם הדגל הבא של Z.ai יגיע עם משקולות פתוחות תחת אותם תנאים מותאמים אישית שבהם השתמשה כל השנה, הוא ינחת בקטגוריה היחידה שבה ל-Step 5 Preview אין כרגע תשובה — וזו הסיבה האמיתית לכך ששווה לחכות להשוואה עם GLM-5.5 במקום להריץ אותה.

Generated two-column comparison scoreboard titled 'Step 5 Preview vs GLM-5.5 — the scoreboard'. The left column gives Step 5 Preview the rows AA Index 44, parameters 600B total / 27B active, price $1.00 / $2.70, cache discount 95%, cost per index task $0.71, and API live since September 20. The right column gives GLM-5.5 the rows AA Index no model to score, parameters more than 1T rumored and unconfirmed, price none, cache discount none, cost per index task none, and availability not released. A footer reads 'Step 5 Preview figures per Artificial Analysis Intelligence Index; GLM-5.5 is an unannounced, unreleased model with no vendor or independent figures.'

למה ההמתנה ל-GLM-5.5 היא האפשרות היקרה

הבעיה המעשית עם מודל שכבר חודשיים נמצא במרחק של חודשיים היא שעבודת ההערכה שלך לא יכולה לחכות לו. ל-GLM-5.5 אין נקודת קצה, ולכן לא ניתן להריץ עליו בנצ'מרק, להשוות את מחירו, לבצע בדיקות עומס או להציב אותו מאחורי כלל גיבוי. כל שבוע שמבלים בתכנון סביבו הוא שבוע של החלטות שנדחות על סמך תחזית — והתחזית כבר החמיצה חלון אחד.

GLM-5.3, לעומת זאת, פעיל ב-OrcaRouter תחת z-ai/glm-5.3 במחיר של 1.26$ לקלט ו-3.96$ לפלט, לעומת 1.40$ ו-4.40$ ברשימות של Z.ai בעמוד שלה. המחיר מועבר הלאה ללא תוספת, כלומר המספר שאתם רואים הוא התעריף הנוכחי של הספק ולא כזה שאנחנו קבענו, ושינוי מחיר של ספק נכנס לתוקף אצלנו באותו יום ולא במחזור החיוב הבא.

Step 5 Preview אינו בקטלוג שלנו ואנחנו לא מנתבים אותו. הוא פועל על ה-API וה-Studio של StepFun עצמה, וזה המקום היחיד שבו הוא פועל עד שהצ'קפוינט של 15 באוקטובר נוחת. מה ש-OrcaRouter נותן לך בינתיים הוא כל מה שבצד השני של אותה השוואה מאחורי API אחד ליותר מ-200 מודלים: GLM-5.3 בתעריף שלמעלה, GPT-6 Astra, DeepSeek V4 Pro, Claude Opus 5 והשאר, עם failover אוטומטי בין ספקים ששומר על מסלול פרודקשן יציב בזמן שעקומת הקיבולת של תצוגה מקדימה עדיין אינה ידועה, וה-DSL של הניתוב שמרכיב כמה מהם לקריאה אחת במקום אינטגרציה שנייה. בצע בנצ'מרק ל-Preview מול מודל פרודקשן על אותו מפתח; השאר את מסלול הפרודקשן במקומו.

Screenshot of the OrcaRouter model page for GLM-5.3 at www.orcarouter.ai/models/z-ai/glm-5.3, showing the model id z-ai/glm-5.3, a 1M-token context and 131.1K max output, input pricing of $1.26 and output pricing of $3.96 per million tokens against the crossed-out list rates of $1.40 and $4.40, a seven-day median time to first token of 3.68 seconds and a 95th percentile of 10.00 seconds, seven-day traffic of 2296.2M tokens, and the endpoints and SDK snippets behind the OrcaRouter API.

מה ישנה את התשובה

שני תאריכים יכריעו את העניין. ה-15 באוקטובר הוא המועד שבו StepFun הודיעה שצ׳קפוינט BF16 של Step 5 Preview ישוחרר, והרישיון שמגיע לצדו הוא הבלתי־נודע המשמעותי ביותר בהשוואה — רישיון מתירני יהפוך יתרון של פי 2.8 בעלות־לכל־משימה למשהו שבבעלותכם ולא למשהו שאתם שוכרים, וימחק את הציר היחיד שבו GLM-5.3 מוביל בבירור. רישיון מגביל מותיר את GLM-5.3 כמודל היחיד מבין השניים שאפשר לבנות עליו מוצר, והופך את פער הנקודה האחת לזוטות בנוגע לשני מודלים שממילא הייתם משתמשים בהם באופן שונה.

השני הוא חלון האנליסטים הפועל בין ה-8 באוקטובר ל-9 בנובמבר עבור הדגל הבא של Z.ai, שאולי ייקרא GLM-5.5 ואולי לא, ושאולי יהיה דומה לשמועה ואולי לא. אם הוא בכלל יגיע, הוא יגיע כמודל עם רישיון וצ'קפוינט — שני הדברים שחסרים ל-Step 5 Preview — וההשוואה הופכת לאמיתית.

עד ששניהם ייפתרו, השאלה המועילה אינה איזה מהשניים טוב יותר, מפני שאחד מהם לא ניתן להריץ. היא איזה מהמודלים שקיימים כדאי לך לבנות עליו עכשיו, והאם התשובה משתנה כשהצ'קפוינט הבא מופיע. לשאלה הזאת יש תשובה ניתנת לבדיקה השבוע, והיא לא דורשת להמתין ששם יהפוך למודל.

השוואות במאמר הזה3

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית