
GPT-6.1 Sol לעומת GLM-5.3: המשקלים שוחררו, והחשבון לא זז
- openaiחדשOpenAI: GPT-6.1 Sol2026-09-2952אינטליגנציה
- anthropicחדשAnthropic: Claude Sonnet 5.52026-09-2856אינטליגנציה
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 161 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238אינטליגנציה
- OpenAIOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIGrok 4.72026-09-2146אינטליגנציה
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 לכל 1M טוקנים · 79 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 53 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 301 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
OpenAI השיקה את GPT-6.1 Sol ב-29 בספטמבר 2026 בנאום DevDay המרכזי שלה, ו-Z.ai השיקה את GLM-5.3 שישה שבועות קודם לכן, ב-18 באוגוסט 2026, ואז החזיקה את הצ'קפוינט אצלה למשך שבוע. ההחזקה הזו הסתיימה: zai-org/GLM-5.3 נמצא ב-Hugging Face מאז 25 באוגוסט, צ'קפוינט BF16/FP8 עם כ-753 מיליארד פרמטרים, שמתוכם כ-40 מיליארד פעילים לכל טוקן, ומאז הוא חצה 1.4 מיליון הורדות. אז לשאלה שרוב ההשוואות שואלות מאז אוגוסט — האם זה מודל פתוח או השכרה? — יש תשובה, והתשובה לא שינתה את החשבון. בלוח העצמאי, GPT-6.1 Sol מקבל ציון 51.8 ועולה $0.72 לכל משימת אינדקס שהושלמה; GLM-5.3 מקבל ציון 44.8 ועולה $2.01. אפשר כעת להחזיק במודל הזול יותר לפי טוקן ועדיין לשלם כמעט פי שלושה יותר לכל עבודה גמורה.
מה כל מודל הוא בפועל
GPT-6.1 Sol הוא המודל GPT-6 בדרג הביניים של OpenAI, דרגה אחת מתחת ל-GPT-6 Astra, דגם הדגל, ומעל ל-GPT-6 Luna החסכוני. יש לו חלון הקשר של 1,050,000 טוקנים עם תקרת פלט של 128,000 טוקנים ותאריך חיתוך ידע של 30 באפריל 2026, והוא מקבל טקסט, תמונות וקבצים כקלט. החשיבה נעה בין low ל-max עם ברירת מחדל של medium; none ו-minimal הם הערכים ש-GPT-6 Sol קיבל ואשר כעת מחזירים שגיאה, שאליה מתייחסת הנחיית ההגירה של OpenAI עצמה בכך שהיא מורה למפתחים להחליף ב-low. זה עולה $2.00 למיליון טוקני קלט ו-$10.00 למיליון טוקני פלט, כאשר קלט במטמון עולה $0.10.
GLM-5.3 הוא דגם הדגל הנוכחי של Z.ai להנדסת תוכנה ולעבודה סוכנית לטווח ארוך, הבנוי על אותו בסיס של תערובת מומחים (mixture-of-experts) כמו GLM-5.2, כשהשיפורים מגיעים מ-post-training ולא ממודל גדול יותר. הוא טקסט נכנס וטקסט יוצא — בלי ראייה, בכל מחיר — עם חלון של 1M טוקנים, תקרת פלט של 128,000 טוקנים וחשיבה שדלוקה באופן קבוע. אין מצב לא-חשיבה, וזו מגבלה קשיחה לקריאה רגישה לשהיה. Z.ai מציינת אותו במחיר של $1.40 לקלט ו-$4.40 לפלט למיליון טוקנים, עם קלט שמור במטמון ב-$0.26; הקטלוג שלנו מציע אותו ב-$1.26 וב-$3.96 עם קריאת מטמון ב-$0.234, כך שכרטיס המחירים של הספק הוא המספר השמרני יותר וזה שעליו כדאי לבסס את הטיעון.
כרטיס התעריפים, והשורה שהופכת אותו
שורה אחת לכל מימד, שני הצדדים בכל אחד:
• קלט — GPT-6.1 Sol $2.00 לכל 1M לעומת GLM-5.3 $1.40 לכל 1M; GLM זול ב-30%
• פלט — GPT-6.1 Sol $10.00 לכל 1M לעומת GLM-5.3 $4.40 לכל 1M; GLM זול ב-56%
• קלט שמור במטמון — GPT-6.1 Sol $0.10 לכל 1M לעומת GLM-5.3 $0.26 לכל 1M; הסדר מתהפך, Sol זול פי 2.6
• סעיף הקשר ארוך — GPT-6.1 Sol מתמחר מחדש את כל הבקשה מעל 272,000 טוקני קלט במחיר כפול עבור קלט ומטמון ופי 1.5 עבור פלט, לעומת GLM-5.3 ללא סעיף מקביל בכרטיס המפורסם
• הקשר ופלט — 1,050,000 קלט / 128,000 פלט לעומת 1M קלט / 128,000 פלט; פער של 5%, לא מהותי
• מודאליות — טקסט, תמונה וקובץ כקלט, טקסט כפלט לעומת טקסט בלבד
• רצפת הסקה — GPT-6.1 Sol נמוך, בינוני (ברירת מחדל), גבוה, xhigh, מקסימום לעומת GLM-5.3 תמיד פעיל, ללא רצפה שאליה אפשר לרדת
• משקלים — סגור, API בלבד לעומת פתוח, ניתן להורדה, FP8
• ציון עצמאי, Artificial Analysis v4.3.2 במאמץ מקסימלי — 51.8 לעומת 44.8
• עלות עצמאית לכל משימת אינדקס — $0.72 לעומת $2.01
• טוקני פלט עבור הרצת האינדקס — 67 מיליון לעומת 210 מיליון
<img src="2.png" alt="לוח תוצאות השוואה דו-טורי שנוצר, שכותרתו 'GPT-6.1 Sol נגד GLM-5.3 - לוח התוצאות'. עמודה שמאלית 'GPT-6.1 Sol': שורות המציגות 'מדד אינטליגנציה: 51.8', 'עלות לכל משימת אינדקס: $0.72', 'מחיר קלט: $2.00 למיליון', 'מחיר פלט: $10.00 למיליון', 'אסימוני פלט בהרצת אינדקס: 67M', 'משקלים: סגור'. עמודה ימנית 'GLM-5.3': שורות המציגות 'מדד אינטליגנציה: 44.8', 'עלות לכל משימת אינדקס: $2.01', 'מחיר קלט: $1.40 למיליון', 'מחיר פלט: $4.40 למיליון', 'אסימוני פלט בהרצת אינדקס: 210M', 'משקלים: פתוח ב-Hugging Face'. כותרת תחתונה מציינת 'נתונים עצמאיים לפי Artificial Analysis v4.3.2 במאמץ מקסימלי; מחירי מחירון של הספק.' הלוגו של OrcaRouter נמצא בפינה הימנית התחתונה." /> הזוג האחרון הזה הוא המקום שבו ההתמודדות הזו מוכרעת, וזה לא אפקט עדין.

בעיית 210 מיליון הטוקנים
Artificial Analysis מריצה את אותו מערך של עשרה מבחנים מול כל מודל בלוח ומפרסמת את ספירות הטוקנים שמאחורי כל ציון. GLM-5.3 ייצר כ-210 מיליון טוקני פלט בהשלמת ההרצה. GPT-6.1 Sol ייצר 67 מיליון. כשקוראים זאת מול מחלקת ההשוואה של כל מודל בלוח, 210 המיליון של GLM-5.3 נמצאים מעל חציון מחלקתי של כ-140 מיליון, בעוד ש-67 המיליון של Sol נמצאים הרחק מתחת לחציון של כ-81 מיליון של מחלקת הדגל שבה הוא מדורג. מכיוון שפלט הוא הצד היקר בכל כרטיס תעריפים, ההנחה הכותרתית של 56% על שורת הפלט של GLM-5.3 לא שורדת מפגש עם המדידה: הוא פולט פי 3.1 טוקנים במחיר של פי 0.44, ו-3.1 × 0.44 שווה 1.37 — GLM-5.3 הוא המודל היקר יותר בעומס העבודה הזה, חרף כרטיס תעריפים זול באופן מהותי.
נתון העלות-למשימה של הדירקטוריון עצמו מאשר את הכיוון ואת סדר-הגודל המשוער. $2.01 לעומת $0.72 הם פי 2.8, רחב יותר מכפי שיחס הטוקנים לבדו מרמז, מכיוון ש-GLM-5.3 גם משלם יותר על סעיפי הקלט והמטמון לכל משימה. כדאי להיות מדויקים לגבי מה זה מוכיח ומה זה לא מוכיח: הרצת האינדקס היא עשר הערכות קבועות, והמילוליות בהן אינה זהה למילוליות בתעבורה שלך. אבל עבור קונה, הטוקנים הם מה שנכנס לחשבונית, וצורת ההבדל זהה בכל מערך משימות שבו המודל צריך להפיק תשובה ארוכה.
הקיזוז החלקי הוא שורת הקלט המטמון. קריאת המטמון של GLM-5.3 היא $0.26 מול בסיס של $1.40, ושל GPT-6.1 Sol היא $0.10 מול בסיס של $2.00 — Sol מנצחת בפקטור של 2.6 בתעריף שמכריע בכל עומס עבודה עם תחילית יציבה. אם התעבורה שלך היא קורפוס גדול וקבוע עם תשובה בת פסקה אחת, GLM-5.3 היא פשוט האפשרות הזולה יותר וכדאי לך לבחור בה. אם התעבורה שלך נראית כמו התעבורה שלשמה נבנו שני המודלים האלה — לולאות סוכנים, עריכות בקנה מידה של מאגר קוד, פלטים ארוכים — היתרון של הקלט המטמון מצטמצם לרעש לעומת יחס טוקנים של פי 3.
לאן נוחתים מספרי הספקים
נתוני ההשקה של Z.ai חזקים וכרגיל, לא משוחזרים. Terminal-Bench 2.1 ב-88.2, DeepSWE v1.1 ב-66.9, CyberGym ב-84.5, ExploitBench ב-54.4, AutomationBench ב-48.2, GDPval-AA v2 ב-1769 Elo. הנתון האחד ששווה לקרוא פעמיים הוא Terminal-Bench 3.0 ב-28.3 — המבחן היורש, והתיקון ל-88.2 במבחן הוותיק יותר. מודל יכול להיות מצוין במבחן שאליו כוון הפוסט-אימון שלו, ורגיל בדור הבא של אותו מבחן.
מספרי הההשקה של OpenAI עבור GPT-6.1 Sol ממוסגרים כולם סביב עלות לכל משימה שהושלמה ולא סביב ציון גולמי: DeepSWE v1.1 מכה את התוצאה הטובה ביותר של GPT-6 Sol ב-6.4 נקודות אחוז במאמץ חשיבה נמוך יותר, AutomationBench 1.0.6 ב-2.2 נקודות מעל Claude Opus 5.5 במאמץ בינוני, OSWorld 2.0 גבוה בשבע נקודות מ-GPT-6 Sol במאמץ מרבי, Terminal-Bench Science 0.1 יותר מהכפיל את GPT-6 Sol בפחות ממחצית העלות למשימה. שימו לב שאלה הם ההרנס של OpenAIבהגדרותשל OpenAIעלהסט הנבחר של OpenAI, וכי אף אחד מהם לא שוחזר באופן עצמאי.
החפיפה בין הסטים שפרסמו שני הספקים דלה, וההשוואה הישירה היחידה הזמינה היא על אותו בנצ'מרק: Z.ai מדווחת על 66.9 ב-DeepSWE v1.1, OpenAI מדווחת על 68.8 עבור GPT-6 Sol — המודל ש-6.1 מחליף — ושיפור של 6.4 נקודות של 6.1 Sol לעומת קודמו. פער של שתי נקודות בהשוואה שדווחה על ידי הספק, ופער של כשש נקודות בדלתא של OpenAI עצמה. זה קרוב להשוואה מבוקרת, והוא אומר את מה שהמועצה העצמאית אומרת: כמעט שוויון ביכולת, פער רחב במה שעולה לסיים את העבודה.
API אחד, או שני חוזים
שני המודלים נמצאים ב-OrcaRouter, וזה החלק יוצא הדופן בשילוב הזה. GPT-6.1 Sol נכנס לקטלוג במחיר המחירון של OpenAI עצמה ביום ההשקה — $2.00 ו-$10.00 למיליון טוקנים, קלט במטמון $0.10, כשהמדרגה של 272,000 טוקנים ל-$4.00 ול-$15.00 מועברת בדיוק כפי שהספק מפרט אותה — ו-GLM-5.3 יושב לצידו ב-$1.26 וב-$3.96 עם קריאת מטמון ב-$0.234. דבר לא מתווסף על גבי אף אחד מהם: הפלטפורמה מעבירה את מחיר המחירון של הספק ללא שינוי, וזו הסיבה שהורדת מחיר של ספק מופיעה אצלנו באותו היום ולא אחרי שמשווק מנהל משא ומתן מחדש.

זה חשוב יותר עבור הצמד הספציפי הזה מאשר עבור רוב. ההחלטה ביניהם אינה "מה טוב יותר" — היא סף על אורך הפלט שלך, והוא יזוז בפעם הראשונה ש-Z.ai מחדד את כרטיס התעריפים שלו או ש-OpenAI משנה את גבול השכבה של שכבה 6.1. החזקת שניהם מאחורי מפתח אחד, עם מעבר אוטומטי ביניהם וכלל ניתוב שאתה משנה בקונפיגורציה ולא בפריסה, היא מה שמאפשר לך לבדוק את הסף הזה על תנועה אמיתית במקום להתווכח עליו. אם שורת המטמון של Sol מנצחת את עומס העבודה שלך, נתב עליה; אם אורכי התשובות שלך נשארים קצרים והכרטיס השטוח של GLM-5.3 ללא מצוק הקשר מנצח את הפלח, נתב על זה במקום — אותו מפתח, בלי חוזה שני, בלי חשבון שני.

איזה מהם, אם אתה חייב לבחור היום
• פלטים ארוכים שנוצרים, לולאות סוכנים, עבודה עתירת פלט — GPT-6.1 Sol, והפער קרוב לפי שלושה לאחר החלת ספירת הטוקנים. כאן כרטיס התעריפים משקר והמדידה לא.
• קידומת יציבה, תשובה קצרה — GLM-5.3. תעריפי הקלט המטמון והקלט שלה טובים יותר באמת, ולאריכות אין הזדמנות להזיק.
• כל בקשה מעל 272,000 טוקני קלט — GLM-5.3, כי GPT-6.1 Sol מתמחרת מחדש את הבקשה כולה בגבול הזה, ולכרטיס של GLM-5.3 אין שלב מקביל.
• כל דבר עם תמונה או מסמך כקלט חזותי — GPT-6.1 Sol. GLM-5.3 היא טקסט בלבד וזה לא קרוב.
• הסקה בתוך הגבול שלך, או גידור מפני שינוי בתנאי ספק — GLM-5.3, ועכשיו ההורדה קיימת במקום להיות מובטחת. תקצבו לחומרה: נקודת הביקורת היא ארטיפקט FP8 גדול, ואירוח עצמי הוא החלטת הון, לא החלטת API.
• קריאות רגישות לזמן השהיה — אף אחת מהן בלי זהירות. ל-GLM-5.3 אין דרך לכבות את ההיסק; ל-GPT-6.1 Sol יש רצפה ב-low, וזמן ההגעה לטוקן הראשון שלה בלוח העצמאי נמדד ב-332 שניות מול חציון לוח של 3.7.
השוואות במאמר הזה3
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
