
אטריה דאון מול GLM 5.2: אותו בסיס, בשני כיוונים מנוגדים
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiחדשOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleחדשGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenחדשQwen: Qwen3.8 Max (0902)2026-09-0240אינטליגנציה72כתיבת קוד
- anthropicחדשAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0340אינטליגנציה72כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451אינטליגנציה78כתיבת קוד
- googleGoogle: Gemini 3.6 Flash2026-07-2134אינטליגנציה69כתיבת קוד
העובדה הבודדת השימושית ביותר לגבי ההשוואה הזו חבויה בדף המפרט של המודל הקטן יותר עצמו: Atria Dawn Preview, המודל הסוכני החדש בקוד פתוח של Shanghai AI Laboratory, שהוכרז בשידור חי ב-14 בספטמבר, בנוי על MoE בעל 744 מיליארד פרמטרים GLM 5.2 בסיס — המודל המדויק ש-Z.ai שלחה ביוני ומוכרת אותו כדגל בקוד פתוח במחיר של $1.40/$4.40 למיליון טוקנים. אז זה לא מקרה של שחקן חדש שמנסה לעקוף את השחקן הקיים; זה מקרה של אותו סיליקון, שעבר אימון-מחדש בשני כיוונים על ידי שתי מעבדות שונות, ואז תומחר כשני מוצרים שונים. לפני כל שורת בנצ'מרק, העובדה הזו כבר אומרת לך על מה ההשוואה באמת: כמה מהיכולת ההיסקית של GLM 5.2 אתה מוכן לוותר תמורת לולאה סוכנית — וכמה אתה משלם כדי לשמור על שניהם.
מקורות המידע כאן אינם מאוזנים באופן מהותי. התיעוד הבלתי־תלוי של GLM 5.2 דל — תקרת המשקולות הפתוחות שלו נקבעה על ידי GLM 5.3, שהחליף אותו ב־14 באוגוסט, ומדד ה-AA Intelligence Index, שמדד פעם את GLM 5.2 ב-53, עבר מאז חישוב מחדש ושינוי שם. כל מבחן שמעדיף את Atria Dawn Preview מדווח על ידי הספק מתוך כרטיס המודל שלו, ולא שוחזר על ידי שום מעבדה ניטרלית, ול-API הבינלאומי שלו בכתובת api.atria-asi.ai אין עדיין מחיר מפורסם. כאשר הכרטיס מציב את השניים זה לצד זה על אותה טבלה, Atria Dawn Preview מוביל בגילוי ובשימוש בכלים (BrowseComp 92.5, DeepSearchQA 96.0, BFCL v4 77.0) ומפגר אחרי השושלת של GLM 5.2 בשורות הקידוד הגולמיות — שאף אחד מהן לא אושר עדיין על ידי מעבדה חיצונית.
אותו בסיס, שני אימוני המשך
שני המודלים הם MoE עם 744B פרמטרים בסך הכול, עם אותו דפוס הפעלה של 8 מומחים לכל טוקן, מכיוון שהם ממש מתחילים מאותם משקלות. ההבדל הוא במה שכל מעבדה עשתה לאחר מכן. Z.ai לקחה את GLM 5.2 וכיוונה אותו כדגל ספינה כללי עם משקלות פתוחים: טקסט בלבד, חלון הקשר של 1M, פלט של 128K, רישיון MIT, עם פרופיל מחלקה של 40B פרמטרים פעילים שהפך אותו לאחד המודלים הזולים ביותר להרצה ברמת החזית — הדבר שעדיין זוכרים לו הוא היותו המודל עם המשקלות הפתוחים בעל הניקוד הגבוה ביותר במדד העצמאי, לפני ש-GLM 5.3 הגיע שבוע אחרי Intern-S2.

המעבדה Shanghai AI Laboratory לקחה את אותו בסיס וכיווננה אותו לסוכן של לולאת מחקר. ארבעת עמודי היכולת של Atria Dawn Preview — Discovery, Creation, Delivery, Cybersecurity — מתארים כולם את אותה לולאה: לנתח בעיה, לעצב פתרון, להשתמש בכלים, לכתוב ולהריץ קוד, לקרוא את התוצאה הניסויית, להתאושש מכשל, ולחזור על התהליך. המעבדה מבהירה במפורש שהתוצאה היא טקסט בלבד (קלט של תמונה ו-PDF מקבל 400), שחלון ההקשר הוא 256K ולא 1M, ושהמשקולות ברישיון MIT וניתנות להורדה כבר היום ב-BF16 (353 שברים) או FP8 (177 שברים). הבסיס הוא של GLM 5.2; המוצר אינו.
• בסיס — שניהם MoE בסך כולל של 744B על תשתית GLM-5.2, 8 מומחים פעילים לכל טוקן
• הקשר — Atria Dawn Preview 256K טקסט בלבד לעומת GLM 5.2 1M, פלט 128K
• רישיון — שניהם MIT; מקטעי Atria BF16 + FP8, GLM 5.2 ההורדה המוכרת בקטגוריית 1.5TB
• מחיר — Atria לא מפורסם (API בינלאומי) לעומת GLM 5.2 $1.40/$4.40 ל-1M
מה שהגריד שדווח על ידי הספק באמת מציג
כרטיס המודל משווה את Atria Dawn Preview לשדה שכולל את GLM 5.3 ולא את GLM 5.2 עצמו, וזו בחירה עריכתית קטנה שמחמיאה לטור המשקולות הפתוחות. מול אותו שדה, החוזקות המדווחות של Atria Dawn Preview הן גילוי ושימוש בכלים: AutomationBench 53.8, BrowseComp 92.5, DeepSearchQA 96.0, WideSearch 81.9, BFCL v4 77.0, CyberGym 86.5. החולשות המדווחות שלה הן שורות הקידוד שבהן ג'נרליסט מכוונן בדרך כלל מנצח: SWE-bench Pro 59.6, Terminal-Bench 2.1 78.3, JobBench 50.3. שום דבר כאן לא מאומת באופן בלתי תלוי, וכל שורה היא הרתמה של המעבדה עצמה על הפרומפטים של המעבדה עצמה — אבל הפיצול עקבי מספיק כדי להתפרש כבחירה עיצובית אמיתית ולא כרעש. GLM 5.2, מצדו, הוא המודל שתקרתו העצמאית מתקופת יוני (AA Index 53, הציון הגבוה ביותר במשקולות פתוחות אז) נעקפה על ידי GLM 5.3 חודש לפני ש-Atria הושק.
לאיזה אחד אתה צריך לנתב
אם אתה צריך ג'נרליסט בקוד פתוח עם מיליון טוקנים לעבודת קוד ועבודת ידע בהקשר ארוך, GLM 5.2 במחיר $1.40/$4.40 הוא סוס עבודה מוכח, ברישיון MIT, שאוחסן באופן עצמאי והוגש בייצור במשך רבעון — ובשער כמו OrcaRouter, מפתח API אחד וללא תוספת מחיר לבקשה מאוחר יותר, הוא זמין ברגע שתזדקק לו, עם מעבר אוטומטי לגיבוי אם נקודת הקצה של Z.ai תתערער אי פעם. אם המשימה שלך היא לולאת מחקר פתוחה — משימה שדורשת מהמודל להמשיך לקרוא, להריץ קוד ולבצע איטרציות עד שמשהו יהיה ניתן לאימות — הכיוונון של Atria Dawn Preview מכוון בדיוק לשם, אבל אתה מחליף את חלון ה-1M, מחיר ידוע ותיעוד בלתי תלוי בתצוגה מקדימה של 256K ללא תעריף מפורסם וללא ציונים ניטרליים.


פסיקה כנה היא צומת דרכים. צוותים שכבר מסתמכים על GLM 5.2 לעבודה פתוחה עם הקשר ארוך צריכים להישאר במקומם ולעקוב אחר מה שמעריכים בלתי תלויים מדווחים על Atria Dawn Preview לפני שהם מעבירים נתיב ייצור אליו. צוותים שצוואר הבקבוק שלהם הוא הלולאה עצמה — המודל עוצר לשאול במקום לבצע — יש להם סיבה אמיתית לנסות את החדש, באופן אידיאלי מאחורי מסלול גיבוי ל-GLM 5.2 כך שהניסוי לא עולה דבר אם התצוגה המקדימה נכשלת. אותו בסיס, שני מוצרים, ועבור רוב הקוראים העמודה המכרעת היא לא רשת המדדים אלא חלון ההקשר והמחיר שהרשת לעולם לא מציגה.
השוואות במאמר הזה1
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
