אינפוגרפיקה ראשית עבור Atria Dawn Preview המציגה את ארבעת תחומי היכולת הסוכניים (גילוי, יצירה, אספקה, אבטחת סייבר) ופס של 1M הקשר · רישיון MIT · משקלים פתוחים.
Engineering & Research

Atria Dawn Preview: InternLM משחררת בשקט מודל אג'נטי בעל 744 מיליארד פרמטרים — מה שהריפו באמת אומר

מחבר

Rowan Sterling

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

ארגון InternLM של Shanghai AI Laboratory פרסם בשקט את Atria Dawn Preview ב-Hugging Face השבוע — תצוגה מקדימה של מודל סוכני MoE עם 744 מיליארד פרמטרים, שמגיע עם משקלים ברישיון MIT, חלון הקשר של 1M טוקנים, וטבלת בנצ'מרקים שנמדדה מול DeepSeek V4 Pro, Kimi K3, Qwen3.8-Max, GLM-5.3, GPT-5.6 Sol ו-Claude Opus 5. המאגר עלה לאוויר ב-11 בספטמבר 2026 — שלושה ימים לפני הכתבה הזו — עם צ'קפוינט FP8 נלווה שהגיע ב-12 בספטמבר, והספק טרם הכריז על המודל בשום מקום: אין פוסט בבלוג, אין מאמר, אין תמחור, אין API. מה שקיים היום הוא כרטיס מודל מאוכלס במלואו וכ-1.5TB של משקלים פתוחים. זה הופך את Atria Dawn Preview לשחרור שיצא בשקט, והשאלות המעניינות הן מה הכרטיס מאפשר לך לאמת, מה הוא דורש ממך לקבל מתוך אמון, והאם זה הצעד הראשון לקראת משפחת Atria גדולה יותר מהמעבדה שבילתה את השנה בשחרור סדרות Intern-S2 ו-InternLumina.

הכרטיס הוא ההכרזה

מכיוון שאין הודעה רשמית, הכרטיס של Hugging Face עושה את כל העבודה. הוא מתאר את Atria Dawn Preview כ"גרסת תצוגה מקדימה של מודל אג'נטי מדור חדש" שפותח על ידי Shanghai AI Laboratory, שאומן על מודל בסיס MoE עם 744 מיליארד פרמטרים, ומיועד ל"תרחישי מחקר והנדסה הדורשים הבנה סביבתית מתמשכת, שימוש בכלים והשלמת משימות רב-שלביות." שורת המכירה — "משאלות מחקר לתוצאות ניתנות לאימות" — עוסקת בהובלת בעיות פתוחות לעבר תוצאות ברות-ביצוע, ניתנות לאימות וניתנות לשחזור, כאשר המודל משלב מטרות משימה ומשוב מהסביבה לאורך ניתוח בעיות, עיצוב פתרונות, שימוש בכלים, יישום קוד, ביצוע ניסויים, ניתוח תוצאות והתאוששות מכשלים.

הכרטיס מארגן את ההיקף האייג'נטי הזה לארבעה תחומי יכולת, שכל אחד מהם מכוון לאספקה מקצה לקצה ולא לצ'אט:

גילוי — אחזור וארגון ראיות, מחקר מעמיק, הפיכת שאלות מחקר לתוכניות ניסוי ברות ביצוע

יצירה — בניית תוכנה, יישומים אינטראקטיביים, משחקים, המחשות נתונים ומערכות למידת מכונה

אספקה — הפיכת מסמכים, נתונים ודרישות עיצוב לדוחות, מצגות ותוצרים מובנים אחרים

אבטחת סייבר — ניתוח בעיות אבטחה, אימות פגיעויות, יישום תיקונים ואימות מחדש בסביבות מורשות

גם על הכרטיס אך ללא הסבר: אתר אינטרנט (atria-asi.com), ארגון GitHub (atria-asi) שמשקף את ה-README, וחשבון X (@AtriaASI). הסיומת "ASI" היא הפרט היחיד שבאמת מוזר — שום דבר בכרטיס לא אומר מה המיתוג אמור לרמוז, ואנחנו לא נייחס לו יותר משמעות ממה שהמאגר עצמו עושה. מה שידוע הוא שזה שם קוד לקו מוצרים נפרד, נבדל מהשמות Intern-S2 ו-InternLumina שהמעבדה השתמשה בהם כל השנה.

Screenshot of the Hugging Face model card for internlm/Atria-Dawn-Preview showing the title, the Atria Dawn Preview branding, the architecture tag glm_moe_dsa, the MIT license, and the 'From Research Questions To Verifiable Results' description.

מה שהקונפיגורציה בעצם אומרת

המשקלים והתצורה זמינים להורדה היום, וזה הרגע שבו שחרור שקט מפסיק להיות שמועה. מחרוזת הארכיטקטורה היא GlmMoeDsaForCausalLM — אותה משפחת MoE דלילה בסגנון DSA שמשפחת GLM משתמשת בה, כאשר התצורה מנתבת 8 מתוך 256 מומחים מנותבים לכל טוקן על פני 78 שכבות (מספר הפרמטרים הפעילים אינו מפורסם בכרטיס; ב-MoE של 744B בצורה הזו הוא מגיע לעשרות מיליארדים). חלון ההקשר מוגדר ל-1,048,576 טוקנים — מיליון שלם, בהתאם למחלקת ההקשר הארוך שהמעבדה קידמה בשחרורים האחרונים האחרים שלה. הטוקנייזר נושא סמנים של תמונה, וידאו, אודיו ותמלול, אף שתבנית הצ'אט אומרת במפורש למודל שאין לו יכולת קלט מולטימודלית ושהוא צריך לומר זאת אם יועברו לו מדיה — אז התייחסו לתגיות המודאליות כאל תשתית בירושה, לא כאל טענה ליכולת ראייה או קלט אודיו.

המשקלים מספרים את הסיפור המעשי:

נקודות ביקורת — שתיים: מודל ה-instruct BF16/F32 ו-Atria-Dawn-Preview-FP8, מודל instruct שעבר כימות FP8

גודל — מהדורת BF16 היא כ-1.5TB על פני 353 שברי safetensors; מהדורת FP8 היא כ-756GB

רישיון — MIT, עבור גם הקוד וגם המשקולות, ללא סעיף הגבלה על הכרטיס — מתירני באופן יוצא דופן עבור פרסום של מעבדה בהיקף כזה

הפצה — Hugging Face ו-ModelScope, קובצי README באנגלית ובסינית, תבנית צ'אט ותצורת יצירה במאגר

אירוח — לא מפורטים בכרטיס ספקי הסקה, ואין אזכור ל-API בשום מקום

השורה האחרונה הזו חשובה למסגור: זהו שחרור משקלים, לא השקת שירות. כל מי שרוצה להריץ את Atria Dawn Preview היום חייב להוריד כ-756GB (FP8) או 1.5TB (BF16) ולהגיש אותו בעצמו — בלי נקודת קצה של ספק, בלי תמחור, בלי עמוד מכסה.

טבלת הבנצ'מארק, קרא בעיון

הכרטיס נושא טבלת בנצ'מרקים בת 16 שורות המשווה את Atria Dawn Preview מול DeepSeek V4 Pro, Kimi K3, Qwen3.8-Max, GLM-5.3, GPT-5.6 Sol ו-Claude Opus 5 על פני בנצ'מרקים של סוכנים, שימוש בכלים, קידוד ומחקר. כל מספר בה מדווח על ידי הספק — המעבדה הריצה או הזמינה את ההערכות, ואף אחת מהן לא שוחזרה באופן בלתי תלוי, מפני שאין עדיין הערכה בלתי תלויה של Atria Dawn Preview. Artificial Analysis לא מחזירה דף עבור המודל נכון להיום. לכן הקריאה הנכונה היא "הנה כיצד הספק אומר שהוא משתווה," ולא "הנה כיצד הוא משתווה."

A scoreboard infographic for Atria Dawn Preview listing the vendor-reported benchmark highlights: BrowseComp 92.5, CyberGym 86.5, DeepSearchQA 96.0, BFCL v4 77.0, SWE-bench Pro 59.6, JobBench 50.3, with a footer noting all figures are vendor-reported on the model card with no independent scores yet.

עם הסתייגות זו מבוססת היטב, עיקרי הדברים באמת מעניינים. Atria Dawn Preview מוביל את התחום המוצג ב-BrowseComp עם 92.5 (מול ה-92.2 של GPT-5.6 Sol וה-90.8 של Claude Opus 5), ב-CyberGym עם 86.5 (לפני ה-83.3 של DeepSeek V4 Pro, ה-84.5 של GLM-5.3, וה-83.6 של GPT-5.6 Sol), וב-DeepSearchQA עם 96.0. הוא גם משיג BFCL v4 חזק של 77.0 מול ה-71.4 של DeepSeek V4 Pro וה-69.1 של Kimi K3. הנקודות החלשות מלמדות באותה מידה:

Terminal-Bench 2.1 — 78.3, הרחק מאחורי 89.3 של Qwen3.8-Max ו-90.2 של Claude Opus 5, מה שמרמז שכישורי סוכן-הקוד עדיין אינם ברמת דגל

SWE-bench Pro — 59.6, לפני DeepSeek V4 Pro (58.3) אך הרחק מאחורי 74.7 של Claude Opus 5

MLE-bench Lite — ‏86.2, שמפגר אחרי GPT-5.6 Sol (88.9) ו-Claude Opus 5 (88.0) למרות המסר השיווקי של Discovery

JobBench — 50.3, הנמוך ביותר מבין המודלים המופיעים בכרטיס, ואחת מכמה שורות שבהן תצוגה מקדימה פתוחה של 744B מפגרת אחרי מודלי הדגל הסגורים שהיא מודפסת לצדם

הסיכום האמיתי: הכרטיס טוען לחוזקות אמיתיות באחזור מחקרי, במשימות מבוססות דפדפן ובאימות אבטחה, בעוד ששורות הקידוד הקלאסי ועבודת הידע נראות בינוניות. תצוגה מקדימה שלא מלקטת דובדבנים אמינה יותר מזו שמנצחת בהכל — אבל שום דבר מזה לא מאומת, ומודל בהיקף כזה עם משטח הערכה כה גדול ראוי לבחינה עצמאית לפני שמישהו מהמר עליו פייפליין.

היכן הוא ממוקם בהיצע של InternLM

Atria Dawn Preview נוחת בעיצומו של פרק עמוס במיוחד עבור המעבדה. ספינת הדגל של הראייה והמדע, Intern-S2-397B, הופיעה ב-13 בספטמבר, אותה משפחה שבני המשפחה הקטנים יותר שלה (Intern-S2, Intern-S2 Mobius) הושקו מאז אמצע השנה, ו-InternLumina-U2, שמתמקד בראייה, עלה בתחילת ספטמבר. Atria הוא שם קוד נפרד שמכוון לעבודה סוכנית כללית ולא להתמחות מדעית או מולטימודלית — ובניגוד ל-Intern-S2-397B, שנושא רישיון Apache-2.0 ואקוסיסטם הכרזות משלו, Atria Dawn Preview הגיע ללא טקס תחת רישיון MIT. טרם אושר אם Atria הוא תצוגה מקדימה חד-פעמית או החבר הראשון בסדרה חדשה; הסיומת „Preview” והמאגר החשוף, ללא טקסט של מפת דרכים בשום מקום, תומכים בקריאה הזהירה.

מה שעוד לא ידוע

ההרגל המועיל בעת הפצה שקטה הוא לפרט את מה שנשאר פתוח. ב-Atria Dawn Preview, הרשימה הזו ארוכה:

הכרזה — שום דבר מהמעבדה, מהאתר או מחשבון ה-X נכון ל-14 בספטמבר; המאגר הופיע ראשון, וכך התנהלו כמה שחרורים אחרונים של מעבדות סיניות, אבל "כפי שהם בדרך כלל מתנהלים" אינו אישור

מאמר או דוח טכני — אין קישור לאף אחד מהם; נתוני האימון, צינור ה-RL ומספר הפרמטרים הפעילים — כולם לא פורסמו

המיתוג של "Atria ASI" — הדומיין וה-handle קיימים והכרטיס מקשר ביניהם, אבל לא נאמר איזו ישות עומדת מאחוריהם ומה ראשי התיבות אמורים לייצג

ציונים בלתי תלויים — אין; אין רשומה ב-Artificial Analysis, אין נוכחות בזירה, אין דבר שכנגדו ניתן להצליב את הטבלה של הכרטיס

זמינות מתארחת — אין API של ספק, ואף שער הסקה מרכזי אינו משרת אותו עדיין; הדרך היחידה להריץ אותו היא להקים בעצמך בערך 756GB עד 1.5TB של משקולות

תמיכה ב-Serving — הארכיטקטורה היא שושלת DSA-MoE מוכרת, שזה סוג הדברים שנוטים לזכות במהירות בתמיכת runtime, אך לא הוכרזה תמיכת framework עבור הצ'קפוינט הספציפי הזה

מה בעצם אפשר לעשות עם זה

באופן מעשי, היום, שלושה דברים נכונים. ראשית, אתה יכול להוריד את Atria Dawn Preview — רישיון MIT מכסה את שני הצ'קפוינטים, ומהדורת FP8 הופכת את חישובי האחסון וההגשה לקלים משמעותית מאשר מקור BF16, אם כי כל אחת מהאפשרויות דורשת multi-GPU. שנית, אתה לא יכול לקרוא לה בשום מקום: אין נקודת קצה מתארחת, וזה בדיוק המצב שבו פלטפורמת ניתוב מוכיחה את ערכה. אנחנו עדיין לא מנתבים את Atria Dawn Preview — היא לא נמצאת ב-OrcaRouter, והדף הזה לא מעמיד פנים אחרת — אבל אותו מפתח שאין לו את Atria היום כבר מגיע ל-196 מודלים אחרים דרך API אחד, עם מחיר המחירון של הספק המועבר הלאה בתוספת של 0% ומעבר אוטומטי בין ספקים. כאשר Atria Dawn Preview תגיע לספק מנותב, היא תופיע במחיר מחירון באותו יום שבו מספרי הספק מתעדכנים, וזה מה שתמחור מעביר (pass-through) אומר בפועל. עד אז, המודל הוא פרויקט של הורדה והרצה, והדרך הבטוחה ביותר להעריך אותו היא על חומרה שאתה שולט בה, עם בנצ'מרק עצמאי משלך — לא על סמך הבטחת הכרטיס.

Screenshot of the OrcaRouter models page showing the model catalogue with 196 models across 15 providers, one API key and one bill, with input price, context length and provider filters.

מה לצפות בהמשך

ארבעה אותות קובעים אם השחרור השקט הזה הופך לסיפור שאתה פועל לפיו. הראשון הוא ההכרזה: פוסט השקה או מאמר ראויים היו עונים על הארכיטקטורה, מתכון האימון, ומה "Preview" הוא תצוגה מקדימה של. השני הוא הערכה בלתי תלויה — מודל בגודל כזה עם כרטיס כה בטוח צריך שטענות ה-BrowseComp וה-CyberGym שלו ייבדקו מול מערכת בדיקה ניטרלית, והיעדר כל רשומה של Artificial Analysis הוא הפער הבולט ביותר. השלישי הוא זמינות מתארחת: מודל 744B MoE פתוח עם משקולות MIT וחלון הקשר של 1M הוא בדיוק הפרופיל שנוטה להופיע אצל ספקי הסקה תוך שבועות, והראשון שיגיש אותו יקבע את המחיר המעשי של השימוש בו. הרביעי הוא שאלת המשפחה — האם Atria הוא חד-פעמי או סדרה, והאם המיתוג "ASI" מסמן לאן המעבדה מתכוונת לקחת את הקו בהמשך. שום דבר מזה אינו ידוע מהמאגר, וזו הנקודה: המאגר נתן לנו את המודל, ושבועיים הקרובים אמורים לתת לנו את השאר.

השוואות במאמר הזה3

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית