כרטיס כותרת הירו עבור "Qwen 4 Max מול GLM-5.3" עם כותרת המשנה "משקלים פתוחים, רישיונות מותאמים אישית, והדרגה שבאמת יוצאת לשוק", שלושה תגי גלולה עם הכיתוב "$1.26 ו-$3.96", "טקסט בלבד מול מולטימודאלי" ו"ה-27B הוא זה שכדאי לעקוב אחריו", שורת כותרת תחתונה עם הכיתוב "Alibaba הכריזה ב-22 בספטמבר 2026; GLM-5.3 נרשמה ב-18 באוגוסט 2026", והלוגו של OrcaRouter בפינה הימנית התחתונה.
Engineering & Research

Qwen 4 Max לעומת GLM-5.3: משקלים פתוחים, רישיונות מותאמים, והדרגה שבאמת יוצאת לשוק

מחבר

Gideon Frost

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

Qwen 4 Max הוצג בתצוגה מקדימה בכנס Yunqi בהאנגג'ואו ב-22 בספטמבר 2026 כדגם הדגל של סדרה בת ארבעה דגמים הכוללת גם את Qwen 4 Flash, Qwen 4 Plus ודרג Qwen 4 27B במשקולות פתוחות. GLM-5.3 של Z.ai רשום מאז 18 באוגוסט 2026, טקסט בלבד, עם חלון הקשר של מיליון טוקנים ותקרת פלט של 128,000 טוקנים, במחיר של 1.26 דולר למיליון טוקני קלט ו-3.96 דולר למיליון טוקני פלט בקטלוג שלנו, לעומת תעריפי המחירון של 1.40 ו-4.40 דולר שמפרסמת Z.ai. שתי המעבדות צמחו ממסורת המשקולות הפתוחות ושתיהן מוכרות כעת דגמי דרג חזית דרך APIs מתארחים, כך שהמסגור הרגיל של סגור מול פתוח אינו חל כאן. הציר שכן חל הוא זה שאיש לא מכניס לטבלת השוואה: מה שהרישיון למעשה מתיר, ואיזה דרג בכל משפחה הוא זה שמותר לך לעשות איתו משהו מעניין.

שתי מעבדות, שתי תשובות לאותה שאלה

Alibaba ו-Z.ai הם שני המפרסמים העקביים ביותר של משקלים פתוחים מבין המעבדות הסמוכות לחזית, והם הגיעו לעמדות שונות בשאלה כמה מהפתיחות הזו נשמרת בדרג הדגל.

הדור Qwen 3.8 של Alibaba פרסם משקלים עבור המודל הגדול ביותר שלו — Qwen3.8-2.4T-A95B, ב-BF16 ו-FP8 — ב-12 באוגוסט 2026. הוא פרסם אותם תחת רישיון Qwen מותאם אישית, ולא תחת Apache 2.0. ההבחנה הזו היא כל העניין: המשקלים קיימים, מה שאומר שכיוונון עדין, קוונטיזציה ואירוח עצמי אפשריים באופן שלעולם לא יהיו במודל סגור, אבל התנאים הם של Alibaba עצמה והם אינם ברירת המחדל המתירנית שהביטוי "משקלים פתוחים" נוטה לרמוז עליה.

הקו GLM של Z.ai מגיע ממעבדה עם שושלת של משקלים פתוחים, והדגם המוביל כבר אינו יוצא דופן לכך. המשקלים של GLM-5.3 עצמו פורסמו ב-28 באוגוסט 2026 — דגם הדגל בן 743 מיליארד הפרמטרים, ב-141 שברי safetensors — תחת רישיון מותאם אישית ש-Z.ai כתבה עבורו ולא תחת MIT. התנאים הם בקירוב הענקה בסגנון MIT עם תנאי של סקירה ביטחונית המצורף לעסקי מודל-כשירות מעל לסף הכנסות גבוה. שימו לב למשמעות הדבר עבור המשפחה: GLM-5.2 ו-GLM-5.3-Flash נושאים רישיון MIT, ואילו דגם הדגל לא.

כמפורט, GLM-5.3 הוא מודל טקסטואלי בלבד עם חלון הקשר מפורסם, תקרת פלט מפורסמת, ושימוש מתועד בכלים, מצב JSON ויכולת הסקה.

הנח את השניים זה לצד זה, וההבדל המעשי הוא זה:

• משקלים דגליים — דגם הדגל Qwen 3.8 שפורסם תחת רישיון Qwen מותאם אישית לעומת משקלי GLM-5.3 שפורסמו ב-28 באוגוסט 2026 תחת רישיון Z.ai מותאם אישית

• מחיר קלט — Qwen3.8-Max ‏$2.00 ל-1M טוקנים לעומת GLM-5.3 ‏$1.26 ל-1M טוקנים בקטלוג שלנו, ו-$1.40 ברשימה של Z.ai עצמה

• מחיר הפלט — Qwen3.8-Max $6.00 למיליון טוקנים לעומת GLM-5.3 $3.96 למיליון טוקנים במחירון שלנו, ו-$4.40 ברשימה של Z.ai עצמה

• הקשר — Qwen3.8-Max מיליון טוקנים לעומת GLM-5.3 מיליון טוקנים

• תקרת פלט — Qwen3.8-Max ‏128K אסימונים לעומת GLM-5.3 ‏128K אסימונים

• מודאליות — קלט טקסט, תמונה ווידאו ב-Qwen3.8-Max לעומת טקסט בלבד ב-GLM-5.3, מתועד ככזה

• תגיות יכולות — ראייה, כלים, JSON והסקה ב-Qwen3.8-Max לעומת כלים, JSON והסקה ב-GLM-5.3

• Qwen 4 Max — הוכרז ב-22 בספטמבר 2026, בלי מחיר, בלי הקשר, בלי משקלים, בלי תאריך, לעומת GLM-5.3 ששוחרר ומשרת תעבורה

השורה המולטימודאלית היא זו שמשלמת את פער המחירים. דגם הדגל של Qwen מקבל קלט של תמונות ווידאו וגובה $2.00 על קלט ו-$6.00 על פלט; GLM-5.3 מקבל טקסט וגובה $1.26 על קלט ו-$3.96 על פלט. אם עומס העבודה שלך הוא טקסט, אתה משלם תוספת בעבור מקוד ראייה שאינך מפעיל כלל, וזו הסיבה הקונקרטית ביותר לכך שמתמחה בטקסט בלבד מנצח דגם דגל מולטימודאלי בעלויות בעבודות טקסט.

A two-column scoreboard titled "Qwen 4 Max vs GLM-5.3 - the scoreboard". Left column Qwen 4 Max: Status Max announced, no date; Input price $2.00 per 1M tokens; Output price $6.00 per 1M tokens; Modality text, image, video in; Flagship weights custom Qwen licence; Output ceiling 128K tokens. Right column GLM-5.3: Status shipping since Aug 18 2026; Input price $1.26 per 1M tokens; Output price $3.96 per 1M tokens; Modality text-only; Flagship weights custom Z.ai licence, Aug 28 2026; Output ceiling 128K tokens. Footer reads "GLM-5.3 pricing from its catalogue listing; Qwen3.8-Max figures from its published model card, September 22 2026.", with the OrcaRouter logo bottom-right.

דרג ה-27B הוא זה שמכריע בכך.

Qwen 4 Max הוא הכותרת הראשית, ושכבת ה-27B היא הסיפור האמיתי. כל דור של Qwen הוציא את שכבת המודלים הקטנים והפתוחים שלו בתנאים שמאפשרים לאנשים לעשות דברים, והעדויות במורד הזרם חד-משמעיות: בתוך ימים ספורים מנחיתת המשקלים של Qwen 3.8 27B, המערכת האקולוגית כבר יצרה המרות MLX, קוונטיזציות NVFP4 וכוונונים עדינים ללא צנזורה, שאף אחד מהם לא דרש אישור מאף אחד. זה מה ששחרור מתירני של מודל קטן קונה, וזו צורת הפצה שאף API מתארח לא יכול להשתוות אליה.

שכבת הדגל היא עניין אחר. מודל עם 2.4 טריליון פרמטרים שמפורסם תחת רישיון מותאם הוא פתוח במובן שהבתים ניתנים להורדה וסגור במובן שמה שמותר לך לעשות איתם מוגדר על ידי המפרסם. שני הדברים נכונים בעת ובעונה אחת, וההכרזה על Qwen 4 לא שינתה אף אחד מהם. אם רמת Qwen 4 27B תלך בעקבות התבנית של קודמיה, היא תהיה השחרור שחשוב למספר הגדול ביותר של אנשים, והיא גם השחרור עם תאריך ההפצה הצפוי ביותר, מפני שרמות פתוחות קטנות הן הדבר הקל ביותר להשלים במפת הדרכים.

מה שמחזיר את ההשוואה למשהו שמיש. GLM-5.3 הוא מודל מתארח במחיר מפורסם עם סט יכולות מתועד, והוא זמין כעת. Qwen 4 Max הוא שם של דרג. אם אתה רוצה שטיעון הפתיחות יהיה מוחשי ולא פילוסופי, המודל שכדאי לחכות לו הוא ה-27B, לא ה-Max.

שכבת הניתוב היא המקום שבו שאלת הרישיון מפסיקה להיות חשובה

יש גרסה של ההחלטה הזו שמתחמקת לחלוטין משאלת הרישיון, וכדאי להיות כנים שזו אפשרות ממשית ולא פשרה. אם הדרישה שלך היא לקרוא למודל ולא להחזיק מודל משלך, הרישיון על המשקולות אינו רלוונטי, והתנאים שחשובים הם המחיר, זמן התגובה והתנהגות בעת כשל.

OrcaRouter מציע את GLM-5.3 בתור z-ai/glm-5.3 במחיר של $1.26 לקלט ו-$3.96 לפלט למיליון טוקנים — מתחת ל-$1.40 ול-$4.40 שמפרסמת Z.ai, כשדף המודל מציג את מחירי המחירון האלה לצד המחיר שאנחנו מחייבים בו, ובלי תוספת רווח מעל מה שאנחנו משלמים לספק. אותה נקודת קצה תואמת-OpenAI מציעה גם את משפחת Qwen 3.8, Qwen3.8-Max, Qwen3.8-Flash ו-Qwen3.8-27B, לצד קרוב ל-200 מודלים אחרים, עם מעבר אוטומטי לגיבוי כשמסלול של ספק נחלש ו-DSL לניתוב שמאפשר לך לבטא את מדיניות ההחלפה במפורש במקום לערוך מחרוזת מודל בקוד האפליקציה. כשספק משנה את התעריף שלו, השינוי מגיע למפתח שלך עוד באותו יום, כי אין שכבת רווח שהוא יכול להיתקע מאחוריה.

מה ש-OrcaRouter לא מציע הוא Qwen 4 Max או כל דרג של Qwen 4. בקטלוג אין רשומה למשפחה, וזה המצב הנכון עבור מודל שהוכרז על במה ועדיין לא שוחרר. Qwen 4 Max יהיה נגיש, אם יהיה נגיש בכלל, דרך ה-API של הספק עצמו ומספר פלטפורמות צד שלישי. עד אז, מודל ה-Qwen בהשוואה הזו שאפשר לפנות אליו בפועל הוא Qwen3.8-Max, והוא נמצא באותו קטלוג כמו GLM-5.3 — מה שהופך את הגרסה החיה של העימות הזה להחלטת מדיניות ניתוב ולא להחלטת רכש.

A screenshot of the OrcaRouter model page for GLM 5.3 (z-ai/glm-5.3, English UI), showing the 1M token context badge, the model ID z-ai/glm-5.3, a 128K maximum output, text input, the Tools, JSON and Reasoning tags, the listing date 2026-08-18 credited to Z.ai, a p50 time-to-first-token of 4.41s, the OpenAI-compatible code samples against api.orcarouter.ai/v1, and the opening of the model description calling GLM-5.3 Z.ai's latest flagship for complex software engineering and long-horizon agentic tasks.

מה שלמעשה מכריעה שאלת הרישיון

GLM-5.3 זול יותר בשני הצירים, חלון ההקשר ותקרת הפלט שלו תואמים לאלה של דגם הדגל של Qwen, מגבלות המודאליות שלו מתועדות ולא נותרות להסקה, והוא משרת תעבורה היום. ל-Qwen 4 Max יש מקום בכנס ושם שכבה, והחלק היחיד במפת הדרכים של Qwen 4 שאספקתו צפויה הוא שכבת ה-27B.

ההחלטה שתשרוד את ההשקה היא לא איזה מודל טוב יותר. היא האם אתה צריך להחזיק בבעלות על הדבר. אם אתה צריך לארח בעצמך, לכוונן או לשנות, המשקולות המובילות משתי המעבדות מגיעות עם תנאים שכדאי לקרוא לפני שאתה בונה עליהן עסק, והשכבה הפתוחה הקטנה היא המקום שבו חיו היסטורית האפשרויות המתירניות. אם אתה צריך לקרוא למודל, GLM-5.3 הוא התשובה הזולה יותר היום לעבודת טקסט, Qwen3.8-Max הוא התשובה אם אתה צריך קלט של תמונה או וידאו, ושניהם במרחק של נקודת קצה אחת וחשבון אחד בלבד. חזור לשאלת הדגל כאשר Alibaba תפרסם כרטיס מודל, וקרא את הרישיון לפני טבלת הבנצ'מרקים.

A screenshot of the OrcaRouter model page for Qwen3.8 Max (qwen/qwen3.8-max, English UI), showing the 1M token context badge, the model ID qwen/qwen3.8-max, text plus image plus video input with text output, the Vision, Tools, JSON, Reasoning and Thinking capability tags, the listing date 2026-08-03, a p50 time-to-first-token of 3.29s, and the model description naming Qwen3.8-Max Alibaba's newest flagship and highest-capability tier to date.

השוואות במאמר הזה2

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית