
GPT-6 Luna מול GLM-5.3: המודל במשקלים פתוחים שעדיין לא ניתן להוריד
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0345אינטליגנציה76כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
GLM-5.3 הוא המודל הטוב יותר. הוא משיג 45 במדד הבינה של Artificial Analysis במאמץ מרבי לעומת 37 של GPT-6 Luna, הוא משתווה ל-Mythos 5 בהערכות סייבר נבחרות לפי Z.ai, והוא מודל המשקולות הפתוחות המוביל בכמה מהלוחות המשולבים. כמו כן, נכון לרגע זה, זהו API שאתם שוכרים ולא מודל שבבעלותכם: Z.ai דחתה את שחרור המשקולות בכשבועיים לערך בגלל חששות בתחום הסייבר, וההורדה שאמורה להיות כל העניין של דגל משקולות פתוחות עדיין אינה שם.
העיכוב הזה הוא הסיפור של ההתמודדות הזאת, והוא משנה את החשבון בדרך שטבלאות המחירים מפספסות. GPT-6 Luna הגיע ב-22 בספטמבר 2026 במחיר 0.10 דולר למיליון טוקני קלט ו-0.50 דולר למיליון טוקני פלט, זמין באופן כללי, בלי הסתייגויות. GLM-5.3 הגיע ב-18 באוגוסט 2026 במחיר 1.40 ו-4.40 דולר — פי ארבעה עשר מתעריף הקלט של Luna וכמעט פי תשעה מתעריף הפלט שלה — כשהמשקולות שלו מוחזקות אצלו. אז ההשוואה היא לא פתוח מול סגור. זה מודל סגור שאפשר לפנות אליו היום בעשירית מהעלות מול מודל פתוח שאפשר רק לפנות אליו היום, מתומחר כאילו אתה קונה את הדבר שעדיין אין ביכולתך להשיג.
שני דגמים, בהפרש של חודש, שתי עסקאות שונות מאוד
GPT-6 Luna הוא השכבה הקטנה בדור GPT-6 של OpenAI, המשווק לצד GPT-6 Sol במחיר של $2.00/$10.00 ומתחת לדגם המוביל GPT-6 Astra במחיר $10.00/$50.00. הוא נושא חלון הקשר של 1,050,000 טוקנים, תקרת פלט של 128,000 טוקנים, קלט טקסט ותמונה, וסולם הסקה הנע מ-none דרך low, medium, high, xhigh ועד max — כאשר medium הוא ברירת המחדל. OpenAI מכנה אותו המודל היעיל ביותר במשפחה לעבודה ממוקדת בנפח גבוה, וכרטיס התעריפים מאשש זאת: קלט במטמון במחיר $0.01 למיליון הוא עשירית מתעריף לא-ממוטמון ממילא נמוך.
GLM-5.3 הוא ספינת הדגל הנוכחית של Z.ai להנדסת תוכנה מורכבת ולעבודה סוכנית ארוכת טווח, ושוחרר ב-18 באוגוסט 2026. הוא קלט טקסט ופלט טקסט, נושא חלון הקשר של 1M טוקנים עם תקרת פלט של 128,000 טוקנים, והחשיבה בו פועלת תמיד — אין מצב ללא חשיבה. Z.ai מתארת שיפור של כ-50% בחוויית הקידוד לעומת GLM-5.2 וממצבת אותו לקידוד בקנה מידה של מאגר קוד ולעבודת הנדסה אוטונומית רב-שלבית. המשקלים, כשיגיעו, יהיו התכונה המרכזית; כיום ה-API הוא מה שפעיל.
מה שני כרטיסי התעריפים באמת אומרים
שורה אחת לכל מימד, שני הצדדים בכל אחד:
• קלט לכל 1M — GPT-6 Luna $0.10 לעומת GLM-5.3 $1.40
• פלט לכל 1M — GPT-6 Luna $0.50 לעומת GLM-5.3 $4.40
• קלט במטמון — GPT-6 Luna $0.01 ל-1M לעומת GLM-5.3 $0.26 ל-1M, הנחה של 81% על תעריף הקלט של עצמה
• מדד הבינה של AA — GPT-6 Luna 37 במאמץ מקסימלי לעומת GLM-5.3 45 במאמץ מקסימלי
• ציון מאמץ ברירת־מחדל — GPT-6 Luna 29 במצב ברירת המחדל הבינוני שלה לעומת החשיבה הפעילה תמיד של GLM-5.3, נמדד במקסימום
אסימוני פלט בהרצת האינדקס — GPT-6 Luna 150M לעומת GLM-5.3 210M, מול חציון לוח של 140M
• עלות הרצת האינדקס — GPT-6 Luna $122.39 לעומת GLM-5.3 $2,503.48
• עלות לכל משימת אינדוקס — GPT-6 Luna בערך $0.07 לעומת GLM-5.3 בערך $0.68
• הקשר ופלט — GPT-6 Luna 1,050,000 קלט / 128,000 פלט לעומת GLM-5.3 1M קלט / 128,000 פלט
• סעיף הקשר ארוך — GPT-6 Luna פי 2 קלט ומטמון, פי 1.5 פלט מעל 272K קלט, בקשה שלמה לעומת GLM-5.3, אין סעיף מקביל בכרטיס המפורסם
• מתג כיבוי חשיבה — GPT-6 Luna מ-ללא עד מקסימום לעומת GLM-5.3 תמיד פעיל, אין מצב ללא חשיבה
• משקלים — GPT-6 Luna סגור, API בלבד לעומת GLM-5.3 פתוח מתוקף התחייבות, השחרור נדחה

מס המילוליות הוא המספר שמכריע בזה
פער האינדקס של שמונה נקודות הוא אמיתי, ופער המחירים גדול אף יותר, ואף אחד מהם אינו הנתון החשוב ביותר. זה שחשוב הוא אסימוני פלט לכל משימה שהושלמה, כי שם יתרון של שמונה נקודות ביכולות או שמצדיק את עצמו או שלא.
הרצת האינדקס של Artificial Analysis היא ההשוואה המבוקרת הנקייה ביותר שקיימת: אותה חבילת בדיקות, אותו הרנס, מורצת על שני המודלים. GLM-5.3 יצר 210 מיליון טוקני פלט כדי להשלים אותה. GPT-6 Luna יצר 150 מיליון. מול חציון של 140 מיליון בלוח, שניהם פטפטניים — GLM-5.3 פי אחד וחצי מהחציון, GPT-6 Luna בכעשירית בערך. אך כיוון ההבדל הזה מצטבר לרעת המודל של Z.ai במחיר: הוא פולט 40% יותר טוקנים וגובה פי 8.8 עבור כל אחד מהם.
אם מחברים את השניים, העלות לכל משימת אינדקס שהושלמה יוצאת בערך $0.68 עבור GLM-5.3 לעומת בערך $0.07 עבור GPT-6 Luna — פער של פי עשרה בערך, גדול מיחס המחירון הגולמי, משום שהמודל היקר יותר הוא גם המילולי יותר. זו הצורה הכנה של השילוב הזה. GLM-5.3 קונה לך שמונה נקודות אינדקס תמורת פי עשרה כסף לכל עבודה מוגמרת, והאם זו רכישה טובה תלוי לחלוטין בשאלה אם עומס העבודה שלך הוא כזה שבו שמונה נקודות הן ההבדל בין אם זה עובד לבין אם לא.
עבור הרבה מתעבורת הייצור זה לא כך. עבור סוכן קידוד שעובד על מאגר קוד בקצה היכולת של המודל, זה לעיתים קרובות כן, ואין כמות של יתרון במחיר שתסגור פער ביכולות במשימה שנכשלת.
מדוע המשקלים הפתוחים משנים את התשובה, ומדוע ההשהיה מחזירה אותה לקדמותה
הטיעון הסטנדרטי בעד דגם דגל עם משקולות פתוחות הוא שהמחיר לכל טוקן הוא זמני. אתה שוכר עד שההיקף שלך מצדיק רכישה, ואז אתה מוריד את המודל והעלות השולית של טוקן הופכת לעלות חשמל. לפי הטיעון הזה, 1.40$/4.40$ של GLM-5.3 אינו באמת פי ארבעה עשר מה-0.10$ של GPT-6 Luna — זהו מחיר גשר בדרך לאפס, והתעריף הזול יותר של המודל הסגור הוא שכירות ללא יציאה.
הטיעון הזה נכון, והוא מושהה כעת. Z.ai עיכבה את שחרור המשקלים בכ-שבועיים בשל ממצאי אבטחת סייבר, מה שאומר שרמפת היציאה שמצדיקה את הפרמיה עדיין לא קיימת. עד שזה יקרה, GLM-5.3 הוא API בתשלום לפי שימוש בעלות גבוהה פי עשרה לכל משימה מזו של מודל שמפגר אחריו בארבע נקודות מדד בלוח הכללי ובנקודה אחת בלוח הקידוד — והקונה משלם מחירי משקלים פתוחים עבור גישה למשקלים סגורים.
יש נקודה מסדר שני שראויה לציון. העיכוב אינו שערורייה; זה ספק שלוקח ברצינות ממצא בנוגע ליכולת, ומודל שמזהה חולשות היטב הוא בדיוק סוג המודל שמעבדה צריכה להיזהר מלשחרר כקובץ להורדה. אבל זה כן אומר שתאריך השחרור של המשקלות הוא כעת התאריך החשוב ביותר בהשוואה הזו, והוא אינו מפורסם. צוות שבוחר בין שני המודלים האלה באופק של שנים עשר חודשים בוחר בין מודל שהתנאים שלו יכולים להשתנות בחודש הבא לבין מודל שהתנאים שלו לא יכולים — ורק אחד מאלה מתומחר בהתאם.
משטח ההגירה קטן
שני המודלים חושפים ממשק השלמות צ'אט תואם OpenAI, לשניהם חלון הקשר בדרגת 1M, ושניהם מגבילים את הפלט ל-128,000 טוקנים, כך שמעבר ביניהם קרוב יותר לשינוי תצורה מאשר לכתיבה מחדש. ההבדלים שבאמת ינשכו הם התנהגותיים ולא מבניים.
סעיף ההקשר הארוך של GPT-6 Luna הוא היקר שבהם: בקשות מעל 272,000 אסימוני קלט מחויבות לפי פי שניים מתעריפי הקלט והמטמון ופי 1.5 מתעריף הפלט עבור הבקשה כולה, כך שקריאה בת 300,000 אסימונים עולה כפול ממה שעולה אותה עבודה כשהיא מפוצלת לשניים. הכרטיס המפורסם של GLM-5.3 אינו כולל סעיף מקביל, מה שבבקשות בודדות גדולות באמת מצמצם במידה ניכרת את פער המחירים ואף עלול להפוך אותו בעבודה עתירת פלט.
תצורת החשיבה פועלת בכיוון ההפוך. החשיבה ב-GLM-5.3 פעילה תמיד ואין לך דרך לכבות אותה, וזהו אילוץ קשיח לכל דבר רגיש לשהיה — מסווג או נתב לא יכול להשתמש בו. GPT-6 Luna מציע none, low, medium, high, xhigh ו-max, וברירת המחדל היא medium, שבה הוא מקבל 29 ולא 37. הפרמטר הבודד הזה הוא ההבדל בין מצב שבו GPT-6 Luna נמצא שמונה נקודות מדד מאחורי המודל של Z.ai לבין מצב שבו הוא נמצא שש-עשרה מאחור, וצוות שנודד בלי להגדיר אותו במפורש מריץ את התצורה השנייה בעודו מאמין שרכש את הראשונה.
GLM-5.3 נמצא ב-OrcaRouter במחיר המחירון של Z.ai, תחת תמחור pass-through שמעביר שינוי בתעריף הספק לצד שלנו באותו היום במקום להמתין שמפיץ ינהל משא ומתן מחדש — מה שחשוב יותר מהרגיל עבור מודל שהנתון המוביל שלו צפוי לזוז כשהמשקלים נוחתים. GPT-6 Luna אינו בקטלוג שלנו נכון לכתיבת שורות אלה, ואליו מגיעים דרך ה-API של OpenAI עצמה. צוות שמפעיל את שניהם, וזו התצורה הרציונלית כאן בהתחשב בכמה שונים השניים בקצוות, מריץ מפתח אחד ל-GLM-5.3 לצד מה שכבר בשימוש אצלו עבור OpenAI, ומעביר תעבורה בין מסווג של חמישה סנט לסוכן קידוד בקנה מידה של מאגר על ידי שינוי מסלול ולא פריסה.

השיחה
השתמש ב-GPT-6 Luna לכל דבר שנצרך על ידי תוכניות ובנפח גבוה. סיווג, חילוץ, ניתוב, סיכום בכמויות גדולות, הלולאה הפנימית של סוכן. במחיר $0.10/$0.50, עם קלט במטמון בסנט ו-Batch במחצית מהתעריף הרגיל, הוא זול בסדר גודל לכל משימה שהושלמה בהשוואה ל-GLM-5.3, ופער של שמונה נקודות במדד לא יהיה גלוי בהערכה שלך. הגדר את פרמטר המאמץ במפורש ושמור על הקריאות הארוכות שלך מתחת ל-272,000 טוקנים.
קח את GLM-5.3 כאשר המשימה היא הקשה והתשובה חשובה יותר מהחשבונית. הנדסת תוכנה בקנה מידה של מאגר קוד, עבודה אוטונומית רב-שלבית, כל דבר שבו שמונה נקודות מדד הן ההבדל בין השלמת משימה לכישלון שלה. הפירוט הרב הוא נטל אמיתי ועלות המשימה פי עשרה היא אמיתית, אבל מודל שמסיים זול יותר ממודל שצריך לנסות שוב.
ועקבו אחרי המשקולות. היום שבו Z.ai תפרסם את ההורדה של GLM-5.3 הוא היום שבו העובדה המרכזית של ההשוואה הזו משתנה, וזהו התאריך היחיד בעמוד הזה שעדיין לא נמצא בלוח השנה.

השוואות במאמר הזה2
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
