כרטיס כותרת ראשי עם הכיתוב 'GPT-6 Sol Pro מול GLM 5.3' וכותרת משנה 'מה שרישיון open-weight באמת מקנה לך', צמד תוויות בשתי עמודות 'GPT-6 Sol Pro' / 'GLM 5.3', ושורת כותרת תחתונה עם הכיתוב 'מחירי מחירון ספקים; נתונים לפי Artificial Analysis.', עם הלוגו האמיתי של OrcaRouter בפינה הימנית התחתונה.
Guides & Insights

GPT-6 Sol Pro מול GLM 5.3: מה רישיון במשקלים פתוחים באמת נותן לך

מחבר

Gideon Frost

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

GPT-6 Sol Pro ו-GLM 5.3 הם שני החצאים של פיצול אמיתי באופן שבו קונים מודל חשיבה, והרישיון הוא המקום שבו נמצא הפיצול. GPT-6 Sol — המודל של הספק שאותו מריצה התצורה gpt-6-sol-pro, זמין באופן כללי מאז 22 בספטמבר 2026 במחיר של 2.00 דולר למיליון טוקני קלט ו-10.00 דולר למיליון טוקני פלט — הוא API סגור. אתם שוכרים אותו. GLM 5.3, הדגם המוביל של החברה, שהגיע ל-API ב-18 באוגוסט 2026 ופרסם את המשקלים שלו בתחילת ספטמבר, הוא 1.26 דולר לקלט ו-3.96 דולר לפלט למיליון טוקנים בעמוד המודל שלנו, ואפשר להוריד אותו.

המאמר הזה לא יטען שאחד מאלה נכון. הוא יהיה מדויק לגבי מה ההורדה בעצם נותנת לך, משום שהתשובה צרה יותר מכפי ששיח המשקלים הפתוחים בדרך כלל מרמז, והחלק שהוא בעל ערך אמיתי אינו החלק שאנשים בדרך כלל מציינים.

מה אומרת כל שורת מחיר

שתיהן רשימות ספקים — המספרים העצמיים של OpenAI ושל Z.ai, המועברים ללא שינוי על ידי הפלטפורמות שמארחות אותן.

• קלט — GPT-6 Sol $2.00 למיליון טוקנים לעומת GLM 5.3 $1.26 למיליון טוקנים

• פלט — GPT-6 Sol $10.00 למיליון טוקנים לעומת GLM 5.3 $3.96 למיליון טוקנים

• קלט שמור במטמון — GPT-6 Sol‏ $0.20 למיליון טוקנים לעומת GLM 5.3 בהנחה של 90% לעומת התעריף הלא־שמור במטמון שלו, שהיא אותו שבר של מספר קטן יותר

• כתיבת מטמון — GPT-6 Sol ‏$2.50 למיליון טוקנים ב-TTL בודד לעומת מדרגת כתיבת המטמון של GLM 5.3, וזה המקום שבו שני לוחות התעריפים מפסיקים להיות ברי השוואה ישירה, מפני שהספקים מודדים כתיבות באופן שונה

• תמחור הקשר ארוך — GPT-6 Sol מתמחר מחדש בקשה מעל סף הקלט שלה בתעריף גבוה יותר עבור הבקשה כולה; חלון 1M הטוקנים של GLM 5.3 מחויב לפי התעריפים הסטנדרטיים שלו לאורך כל הדרך

• חלון הקשר — GPT-6 Sol 1,050,000 טוקנים לעומת GLM 5.3 1,000,000 טוקנים

• פלט מרבי — GPT-6 Sol 128,000 טוקנים לעומת GLM 5.3 128,000 טוקנים

• מודאליות קלט — GPT-6 Sol טקסט ותמונה לעומת GLM 5.3 טקסט בלבד

• משקלים — GPT-6 Sol סגור, ללא הורדה לעומת GLM 5.3 שפורסם ב-Hugging Face תחת רישיון GLM-5.3 של Z.ai עצמה

לפי מחירי מחירון, GLM 5.3 זול בערך פי 1.6 בקלט ופי 2.5 בפלט. זהו פער אמיתי, והוא אינו מכריע. השורה שמשנה החלטות היא האחרונה.

A two-column scoreboard card titled 'GPT-6 Sol vs GLM 5.3 - the scoreboard'. Left column 'GPT-6 Sol': AA Index 48; price in/out $2 / $10; cost per index task $1.06; context window 1.05M; input modalities text + image; weights closed, no download. Right column 'GLM 5.3': AA Index 45; price in/out $1.26 / $3.96; cost per index task $2.01; context window 1M; input modalities text only; weights published on Hugging Face. A footer line reads 'Vendor list prices; index figures per Artificial Analysis.', with the real OrcaRouter logo bottom-right.

מה שהרישיון בעצם אומר, ומה שהוא לא אומר

כאן הדיון על משקלים פתוחים בדרך כלל משתבש. הטענה "אלה משקלים פתוחים, אז אתה מוגן מסיכון ספק" נכונה במובן מסוים אחד ושגויה באחר, וההבדל שווה לפרוט.

המשקולות של GLM 5.3 פורסמו. הרישיון הוא הרישיון של Z.ai עצמה, GLM-5.3 Licence, ולא MIT — הדור הקודם, GLM-5.2, היה MIT, והשינוי הוא כל הסיפור. הרישיון החדש מתיר שימוש מסחרי וכיוונון עדין. הוא מוסיף תנאי: ספק שירותי מודל-כשירות עם הכנסות של יותר מ-10 מיליארד דולר בכל תקופה של שנים-עשר חודשים חייב לעבור בדיקת אבטחה של Z.ai לפני שיציע את המודל כשירות.

התנאי הזה אומר לך למה נועד הרישיון. הוא אינו הגבלה שמכוונת אליך. הוא מכוון לקומץ ההיפרסקיילרים שיכלו אחרת למכור מחדש את העבודה של Z.ai כמוצר משלהם בלי לתרום לה. אם אתה מריץ את GLM 5.3 בתוך המוצר שלך, או מכוונן אותו על הנתונים שלך, או מגיש אותו למשתמשים שלך, הסעיף לא נוגע בך.

מה שזה כן אומר הוא שהרישיון הוא מסמך בשליטת הספק ולא הענקה בלתי חוזרת. לא ניתן לתקן את MIT. רישיון מותאם אישית יכול להיות מתוקן עבור גרסאות עתידיות, והתנאים שקיבלת עבור 5.3 אינם הבטחה לגבי מה ש-Z.ai תמנה בהמשך. זהו סיכון קטן יותר מ"הספק יכול להוציא את המודל משירות" — המשקלים שהורדת לא מפסיקים לעבוד — אבל זה לא כלום, ואף עמוד השוואה של משקלים פתוחים לא מזכיר זאת.

החלק בעל הערך האמיתי בהורדה הוא צר וקונקרטי יותר מהסלוגן: הוא בכך שהצ'קפוינט שהערכת הוא הצ'קפוינט שאתה מגיש, באופן קבוע, בלי קשר למה שמפת הדרכים או כרטיס התעריפים של הספק יעשו בהמשך. זו ערובה לשחזוריות, לא ערובה לעלות.

מה שהתיעוד העצמאי מראה

Artificial Analysis הוא ההרנס הנייטרלי ששני המודלים מופיעים בו, והוא ביצע בסיס-מחדש למדד שלו ב-7 בספטמבר 2026 — בהחלפת בנצ'מרק טרמינלי אחד באחר ושינוי משקולות של רכיב המשימות הפרטיות. הבסיס-מחדש הזה הוא הסיבה לכך שהנתון הנפוץ ביותר של GLM 5.3 שנמצא במחזור יוצא מכלל שימוש: המודל פורסם עם 60 במדד הקודם ומוצג כ-45 במדד הנוכחי, והמעבר הוא שינוי של הרנס ולא שינוי של מודל.

בלוח הנוכחי, GPT-6 Sol משיג 48 במאמץ מרבי בעלות של $1.06 למשימת אינדקס. GLM 5.3 משיג 45 ב-$2.01 למשימת אינדקס. הפרש של שלוש נקודות אינדקס הוא הסיכום הכנה, והוא מגיע עם קמט לא שגרתי: בזוג הזה, המודל הזול יותר הוא דווקא הסגור. GPT-6 Sol עולה בערך חצי מהעלות למשימה שהושלמה, וזה ההיפך מההנחה שרוב השוואות המשקלים הפתוחים יוצאות ממנה.

יש לצרף שתי הסתייגויות נוספות.

• דירוג המשקלים הפתוחים הוא תוצאה קטגורית, ולא כללית. מיקומו של GLM 5.3 הוא אמירה על תחום המודלים הניתנים להורדה לא פחות מאשר על GLM 5.3.

• רוב נתוני הבנצ'מרק שמסתובבים עבור GLM 5.3 הם של Z.ai עצמה. הנתונים הבלתי־תלויים הם ציון המדד והעלות לכל משימה; נתוני Terminal-Bench, DeepSWE ויכולות הסייבר בכרטיס הדגם הופקו על ידי הספק, ויש לתייג אותם ככאלה כשמצטטים אותם.

נקודה אחת לזכותו של GLM שנתון העלות למשימה ממעיט בערכה: האח הזול יותר. GLM 5.3 Flash הוא מודל עם 320 מיליארד פרמטרים ו-18 מיליארד פרמטרים פעילים, ברישיון MIT, במחיר של $0.15 לקלט ו-$0.50 לפלט למיליון טוקנים, והוא משיג 42 באותו מדד במחיר של $0.25 למשימה. זה רבע מהעלות למשימה של GPT-6 Sol עבור שש נקודות מדד, והוא המודל בהשוואה הזו שנמצא בפועל על גבול יעילות העלות של המדד.

Screenshot of OpenAI's developer model page for GPT-6 Sol, captured 23 September 2026, showing the model id gpt-6-sol, a 1,050,000-token context window with 922,000 maximum input tokens and a 128,000-token output ceiling, an April 20, 2026 knowledge cutoff, text and image input with text output, and Standard pricing of $2.00 input, $0.20 cached input, $2.50 cache writes and $10.00 output per million tokens.

הטיעון הכלכלי בעד אירוח עצמי חלש יותר מהטיעון הכלכלי נגדו.

מפתה למסגר את ההורדה כמהלך של חיסכון בעלויות. במחיר של $1.26 ו-$3.96 למיליון טוקנים, ה-API כבר זול מספיק כך שמודל תערובת מומחים (mixture-of-experts) עם 753 מיליארד פרמטרים אינו בהכרח זול יותר להרצה בעצמך — ו-GLM 5.3 הוא MoE עם 753B, שאינו פריסה על GPU בודד תחת כל סכמת קוונטיזציה ששומרת על התנהגותו. נקודת האיזון היא שאלת ניצולת, ועבור רוב הצוותים התשובה הכנה היא שהיא לעולם אינה מגיעה.

הסיבה לקחת את ההורדה היא זו שסעיף הרישיון מרמז עליה: שליטה על היכן שמתבצעת ההסקה. אירוח עצמי עונה על שאלת מיקום הנתונים לפי היכן שאתה מריץ את המודל ולא לפי מה שכתוב בחוזה של ספק, ועבור עומסי עבודה כפופים לרגולציה זו הגרסה היחידה של התשובה שמחזיקה מעמד. הוא גם מאפשר כיוונון עדין על נתונים קנייניים בלי ששום נתון יוצא מהתשתית שלך, דבר ש-API סגור לא מציע בשום מחיר.

אם אף אחד מאלה אינו חל עליכם, ה-API הוא הבחירה הנכונה והרישיון אינו רלוונטי. זו מסקנה לגיטימית, והיא זו שרוב הצוותים צריכים להגיע אליה.

כאשר שכבת ניתוב משנה את האריתמטיקה

GLM 5.3 נמצא בקטלוג של OrcaRouter במחיר 1.26$ לקלט ו-3.96$ לפלט למיליון טוקנים, עם חלון הקשר של 1,000,000 טוקנים, תקרת פלט של 128,000 טוקנים, וזמן p50 עד לטוקן הראשון של 3.99 שניות כפי שנמדד בעמוד המודל שלנו. תמחור המחירון של הספק עובר הלאה ללא תוספת מעל, כך ששינוי מחיר של Z.ai נכנס לתוקף אצלנו באותו היום שבו הוא נכנס לתוקף אצלם.

GPT-6 Sol אינו אחד מהמסלולים שלנו, ולכן אין כאן שום טענה לגבי המחיר שלו דרכנו.

Screenshot of the OrcaRouter model page for GLM 5.3 (z-ai/glm-5.3), captured 23 September 2026, showing 'by Z.ai - 2026-08-18', a 1M-token context window, a 128K-token maximum output, text-only input, Tools, JSON and Reasoning tags, an input price of $1.26 and an output price of $3.96 per million tokens, and a p50 time to first token of 3.99 seconds.

הסיבה שנקודת קצה אחת חשובה בהתמודדות הספציפית הזו היא ששני המודלים אינם כל כך תחליפים זה לזה אלא דרגות שונות. GLM 5.3 הוא טקסט בלבד; GPT-6 Sol מקבל תמונות. GLM 5.3 ניתן להורדה; GPT-6 Sol לא. אף אחד מאלה אינו החלטת מחיר, ואף אחד מהם לא נקבע על ידי מבחן ביצועים. מה שצוות באמת רוצה כאן הוא מפתח אחד שיכול להגיע למודל הטקסט הזול עבור הנפח, ולמודל אחר עבור הקריאות שזקוקות לראייה, בלי חוזה שני, בלי SDK שני ובלי סט שני של מגבלות קצב. זו בעיית ניתוב, והתנהגות ה-failover חשובה מאותה סיבה שהיא תמיד חשובה — הדרגה הזולה שצינור העבודה שלכם תלוי בה לא צריכה להיות הדרגה שמפילה את כל צינור העבודה.

כלל ההחלטה

• עבודת טקסט בנפח ברף איכות ידוע — GLM 5.3. שלוש נקודות מדד מתחת ל-GPT-6 Sol בקצב פלט של כ-40%, באותו חלון הקשר ואותה תקרת פלט.

• כל דבר שצריך לקרוא תמונה — GPT-6 Sol, או אף אחד מאלה. GLM 5.3 לא מקבל תמונות ב-API, ולשום יתרון מחיר אין קיום במודאליות שאי אפשר להשתמש בה.

• נתונים ברגולציה, או עומס עבודה שאתם חייבים להיות מסוגלים לשחזר בעוד שנתיים — GLM 5.3, באירוח עצמי מה-checkpoint שפורסם. לא מפני שזה זול יותר, אלא מפני שה-checkpoint קבוע ושאלת ריבונות הנתונים נענית על ידי התשתית שלכם עצמה.

• כיוונון עדין על נתונים קנייניים — GLM 5.3. API סגור לא מציע שווה ערך בשום מחיר.

• צוות ללא אילוץ תושבות וללא תוכנית כיוונון עדין — GPT-6 Sol, והתייחס לרישיון כאל לא-בעיה. זה באמת לא-בעיה עבורך, ולהעמיד פנים אחרת הוא האופן שבו טיעוני משקלים פתוחים מאבדים אמינות.

הרישיון אינו מנוף עלויות. הוא מנוף שליטה, והוא שווה בדיוק את מה ששווה לך השליטה — עבור צוותים מסוימים זה כל ההחלטה, ועבור אחרים זה לא כלום.

השוואות במאמר הזה3

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית