כרטיס הירו שנוצר שכותרתו 'Atria Dawn Preview נגד GLM 5.2' וכותרת המשנה שלו 'אותו בסיס, נדחף בכיוונים מנוגדים', ומציג שני תגי גלולה: 'Atria Dawn Preview' עם התג 'MIT open • לולאה סוכנית' ו'GLM 5.2' עם התג 'MIT open • הקשר של 1M'.
Guides & Insights

אטריה דאון מול GLM 5.2: אותו בסיס, בשני כיוונים מנוגדים

מחבר

Magnus Corvin

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

העובדה הבודדת השימושית ביותר לגבי ההשוואה הזו חבויה בדף המפרט של המודל הקטן יותר עצמו: Atria Dawn Preview, המודל הסוכני החדש בקוד פתוח של Shanghai AI Laboratory, שהוכרז בשידור חי ב-14 בספטמבר, בנוי על MoE בעל 744 מיליארד פרמטרים GLM 5.2 בסיס — המודל המדויק ש-Z.ai שלחה ביוני ומוכרת אותו כדגל בקוד פתוח במחיר של $1.40/$4.40 למיליון טוקנים. אז זה לא מקרה של שחקן חדש שמנסה לעקוף את השחקן הקיים; זה מקרה של אותו סיליקון, שעבר אימון-מחדש בשני כיוונים על ידי שתי מעבדות שונות, ואז תומחר כשני מוצרים שונים. לפני כל שורת בנצ'מרק, העובדה הזו כבר אומרת לך על מה ההשוואה באמת: כמה מהיכולת ההיסקית של GLM 5.2 אתה מוכן לוותר תמורת לולאה סוכנית — וכמה אתה משלם כדי לשמור על שניהם.

מקורות המידע כאן אינם מאוזנים באופן מהותי. התיעוד הבלתי־תלוי של GLM 5.2 דל — תקרת המשקולות הפתוחות שלו נקבעה על ידי GLM 5.3, שהחליף אותו ב־14 באוגוסט, ומדד ה-AA Intelligence Index, שמדד פעם את GLM 5.2 ב-53, עבר מאז חישוב מחדש ושינוי שם. כל מבחן שמעדיף את Atria Dawn Preview מדווח על ידי הספק מתוך כרטיס המודל שלו, ולא שוחזר על ידי שום מעבדה ניטרלית, ול-API הבינלאומי שלו בכתובת api.atria-asi.ai אין עדיין מחיר מפורסם. כאשר הכרטיס מציב את השניים זה לצד זה על אותה טבלה, Atria Dawn Preview מוביל בגילוי ובשימוש בכלים (BrowseComp 92.5, DeepSearchQA 96.0, BFCL v4 77.0) ומפגר אחרי השושלת של GLM 5.2 בשורות הקידוד הגולמיות — שאף אחד מהן לא אושר עדיין על ידי מעבדה חיצונית.

אותו בסיס, שני אימוני המשך

שני המודלים הם MoE עם 744B פרמטרים בסך הכול, עם אותו דפוס הפעלה של 8 מומחים לכל טוקן, מכיוון שהם ממש מתחילים מאותם משקלות. ההבדל הוא במה שכל מעבדה עשתה לאחר מכן. Z.ai לקחה את GLM 5.2 וכיוונה אותו כדגל ספינה כללי עם משקלות פתוחים: טקסט בלבד, חלון הקשר של 1M, פלט של 128K, רישיון MIT, עם פרופיל מחלקה של 40B פרמטרים פעילים שהפך אותו לאחד המודלים הזולים ביותר להרצה ברמת החזית — הדבר שעדיין זוכרים לו הוא היותו המודל עם המשקלות הפתוחים בעל הניקוד הגבוה ביותר במדד העצמאי, לפני ש-GLM 5.3 הגיע שבוע אחרי Intern-S2.

A screenshot of the Hugging Face model card for internlm/Atria-Dawn-Preview, captured September 15, 2026, showing the English card 'Atria Dawn Preview: From Research Questions To Verifiable Results', the '744B-parameter MoE GLM-5.2 foundation' description, 'Model size 753B params', 'License: MIT', and the SGLang/vLLM deployment links.

המעבדה Shanghai AI Laboratory לקחה את אותו בסיס וכיווננה אותו לסוכן של לולאת מחקר. ארבעת עמודי היכולת של Atria Dawn Preview — Discovery, Creation, Delivery, Cybersecurity — מתארים כולם את אותה לולאה: לנתח בעיה, לעצב פתרון, להשתמש בכלים, לכתוב ולהריץ קוד, לקרוא את התוצאה הניסויית, להתאושש מכשל, ולחזור על התהליך. המעבדה מבהירה במפורש שהתוצאה היא טקסט בלבד (קלט של תמונה ו-PDF מקבל 400), שחלון ההקשר הוא 256K ולא 1M, ושהמשקולות ברישיון MIT וניתנות להורדה כבר היום ב-BF16 (353 שברים) או FP8 (177 שברים). הבסיס הוא של GLM 5.2; המוצר אינו.

• בסיס — שניהם MoE בסך כולל של 744B על תשתית GLM-5.2, 8 מומחים פעילים לכל טוקן

• הקשר — Atria Dawn Preview 256K טקסט בלבד לעומת GLM 5.2 1M, פלט 128K

• רישיון — שניהם MIT; מקטעי Atria BF16 + FP8, GLM 5.2 ההורדה המוכרת בקטגוריית 1.5TB

• מחיר — Atria לא מפורסם (API בינלאומי) לעומת GLM 5.2 $1.40/$4.40 ל-1M

מה שהגריד שדווח על ידי הספק באמת מציג

כרטיס המודל משווה את Atria Dawn Preview לשדה שכולל את GLM 5.3 ולא את GLM 5.2 עצמו, וזו בחירה עריכתית קטנה שמחמיאה לטור המשקולות הפתוחות. מול אותו שדה, החוזקות המדווחות של Atria Dawn Preview הן גילוי ושימוש בכלים: AutomationBench 53.8, BrowseComp 92.5, DeepSearchQA 96.0, WideSearch 81.9, BFCL v4 77.0, CyberGym 86.5. החולשות המדווחות שלה הן שורות הקידוד שבהן ג'נרליסט מכוונן בדרך כלל מנצח: SWE-bench Pro 59.6, Terminal-Bench 2.1 78.3, JobBench 50.3. שום דבר כאן לא מאומת באופן בלתי תלוי, וכל שורה היא הרתמה של המעבדה עצמה על הפרומפטים של המעבדה עצמה — אבל הפיצול עקבי מספיק כדי להתפרש כבחירה עיצובית אמיתית ולא כרעש. GLM 5.2, מצדו, הוא המודל שתקרתו העצמאית מתקופת יוני (AA Index 53, הציון הגבוה ביותר במשקולות פתוחות אז) נעקפה על ידי GLM 5.3 חודש לפני ש-Atria הושק.

לאיזה אחד אתה צריך לנתב

אם אתה צריך ג'נרליסט בקוד פתוח עם מיליון טוקנים לעבודת קוד ועבודת ידע בהקשר ארוך, GLM 5.2 במחיר $1.40/$4.40 הוא סוס עבודה מוכח, ברישיון MIT, שאוחסן באופן עצמאי והוגש בייצור במשך רבעון — ובשער כמו OrcaRouter, מפתח API אחד וללא תוספת מחיר לבקשה מאוחר יותר, הוא זמין ברגע שתזדקק לו, עם מעבר אוטומטי לגיבוי אם נקודת הקצה של Z.ai תתערער אי פעם. אם המשימה שלך היא לולאת מחקר פתוחה — משימה שדורשת מהמודל להמשיך לקרוא, להריץ קוד ולבצע איטרציות עד שמשהו יהיה ניתן לאימות — הכיוונון של Atria Dawn Preview מכוון בדיוק לשם, אבל אתה מחליף את חלון ה-1M, מחיר ידוע ותיעוד בלתי תלוי בתצוגה מקדימה של 256K ללא תעריף מפורסם וללא ציונים ניטרליים.

A screenshot of the Atria ASI API documentation page, captured September 15, 2026, showing the English 'Get started' page with the model id 'Atria-Dawn-Preview', Chat Completions/Messages/Responses support, and API key authentication flow at api.atria-asi.ai.A generated scoreboard titled 'Atria Dawn Preview vs GLM 5.2 — the scoreboard': left column Atria Dawn Preview rows Architecture 744B MoE on GLM-5.2 base, Context 256K text-only, Price unpublished (API), Weights MIT open, Independent score none yet, Strengths discovery & tool use; right column GLM 5.2 rows Architecture 744B MoE (the same base), Context 1M / 128K out, Price $1.40 / $4.40 per 1M, Weights MIT open, Independent score AA 53 (superseded by 5.3), Strengths long-context generalist; footer 'Atria figures vendor-reported; GLM 5.2 figures per Artificial Analysis & Z.ai.'

פסיקה כנה היא צומת דרכים. צוותים שכבר מסתמכים על GLM 5.2 לעבודה פתוחה עם הקשר ארוך צריכים להישאר במקומם ולעקוב אחר מה שמעריכים בלתי תלויים מדווחים על Atria Dawn Preview לפני שהם מעבירים נתיב ייצור אליו. צוותים שצוואר הבקבוק שלהם הוא הלולאה עצמה — המודל עוצר לשאול במקום לבצע — יש להם סיבה אמיתית לנסות את החדש, באופן אידיאלי מאחורי מסלול גיבוי ל-GLM 5.2 כך שהניסוי לא עולה דבר אם התצוגה המקדימה נכשלת. אותו בסיס, שני מוצרים, ועבור רוב הקוראים העמודה המכרעת היא לא רשת המדדים אלא חלון ההקשר והמחיר שהרשת לעולם לא מציגה.

השוואות במאמר הזה1

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית