כרטיס עריכתי ראשי שנוצר שכותרתו "Ling-3.1-flash: הוכרז, לא פתוח" עם כותרת המשנה "~560B פרמטרים סה"כ · ~25B פעילים לכל טוקן · עד 1M הקשר". שלושה כרטיסים מתויגים מציגים "משקלים: טרם שוחררו", "בנצ'מרקים: דיווח ספק בלבד" ו"אין רישיון · אין כרטיס מודל · אין הורדה".
Guides & Insights

Ling-3.1-flash הוכרז, לא פתוח: ~560B פרמטרים, הקשר של 1M טוקנים, וגרף שהורץ רק על ידי Ant

מחבר

Alistair Wren

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

צוות Ling של Ant Group הציג נתונים על מודל ה-fast-tier הבא שלה ב-30 בספטמבר 2026, ובאותה נשימה אמר שאי אפשר עדיין לקבל אותו. Ling-3.1-flash הוא מודל תערובת מומחים (mixture-of-experts) בעל כ-560 מיליארד פרמטרים, שמפעיל כ-25 מיליארד פרמטרים לכל טוקן, ונושא חלון הקשר של עד מיליון טוקנים, לפי הודעת המודל שפרסמה Ant Group מחשבון ה-@AntLingAGI שלה. המשפט שמגדיר את ההשקה הזו הוא זה שאחרי המפרט: "אנחנו מתכננים להוציא את המודל בקוד פתוח בקרוב." נכון להיום אין מאגר של Ling-3.1-flash ב-Hugging Face, אין רישיון, אין קובץ משקולות להורדה, ואין הערכה מאף גורם מחוץ ל-Ant Group. מה שקיים הוא תרשים בנצ'מרק, משטח מוצר חי, והבטחה.

ההבחנה הזו היא כל הסיפור, וכדאי להיות בוטים לגביה, מפני שהמסגור שמגיע לרוב האנשים ראשון — שחרור בקוד פתוח מסין בדרג 500B שנוחת סמוך לחזית — מתאר משהו שלא קרה. Ling-3.1-flash אינו שחרור פתוח. הוא שחרור מוכרז בלבד. השניים אינם קרובים, והפער ביניהם הוא בדיוק המקום שבו קורא עלול להיכוות: אם אתם מתכננים קיבולת, מתקצבים פיילוט, או כותבים מסמך רכש סביב משקלים פתוחים שעדיין אינם קיימים, אתם מתכננים מול הודעה לעיתונות.

מה שההכרזה באמת מכילה

הפוסט קצר והמספרים בו ספציפיים. Ant מציינת מספר פרמטרים כולל של כ-560 מיליארד לעומת כ-25 מיליארד פעילים לכל טוקן, יחס של קרוב ל-1 ל-22, צפוף במעט יותר מדור Ling-3.0-flash שאותו היא מחליפה — המודל הזה מריץ 124B סה"כ לעומת 5.1B פעילים, בערך 1 ל-24, על גוף שקטן מרבע מהגודל. ההקשר מצוטט כ"עד 1M טוקנים", פי ארבעה מחלון 262,144 הטוקנים שמשפחת Ling-3.0-flash מספקת היום. שלושה ציונים בולטים מצורפים: 1,673 Elo ב-GDPVal-AA v2.1, 75.16 ב-FrontierSWE, ו-65.35 ב-HealthBench Professional.

כל אחד מהמספרים האלה מדווח על ידי הספק, ממקור ראשון, ואינו מפורסם בשום צורה שצד שלישי יכול להריץ מחדש. אין רתמת הערכה, אין סט פרומפטים, אין תצורת הרצה, ואין זרע — ומהותית יותר, אין משקולות שעליהן ניתן להריץ אותם. אם המספרים של Ant נכונים, המודל נמצא בצמרת השחרורים של מודלים פתוחים בסין; נכון להיום אין דרך לגלות אם הם נכונים.

התרשים, וההסתייגות הטמונה בו

Ant Group's own Ling-3.1-flash benchmark card, published from the @AntLingAGI account on 30 September 2026. Multi-panel bar charts compare Ling-3.1-flash against GPT-5.6 Sol, Claude Opus 5, Kimi K3, GLM 5.3 and GLM 5.3 Flash, and DeepSeek-V4.1-Flash across GDPval-AA v2.1 (1,673 Elo), tau-Banking, SkillsBench, Automationbench, Terminal-Bench 4.0, CyberGym, FrontierSWE (75.16), SWE Atlas Codebase QnA, Finance Agent v2, HealthBench Professional (65.35), DRACO and MultiChallenge. A footnote states that HealthBench Professional was evaluated in the AQ environment.

אנט פרסמה את Ling-3.1-flash לצד כרטיס בנצ'מרק רב-פאנלים שממקם אותו בשדה של מודלים בחזית הטכנולוגיה וסמוכים לחזית: GPT-5.6 Sol, Claude Opus 5, Kimi K3, שני מודלים ממשפחת GLM, ו-DeepSeek-V4.1-Flash. לאורך הפאנלים עמודת Ling ניצבת בראש או סמוך לראש במדדי הסוכנים והקידוד, ובאמצע הדירוג במדדים הרב-תוריים והתחומיים. קראו את זה כפי שזה — מבחר המשימות של הספק עצמו, הלקוח מתוך סט הכולל עבודת סוכנים כלל-תכליתית, קידוד, משימות בתחום הבנקאות ובריאות — וזהו כרטיס שנראה אמין.

עם זאת, הבט מי נמצא עליו, ודבר אחד בולט. עמיתי החזית שאנט בחר הם GPT-5.6 Sol ו-Claude Opus 5. שני המודלים האלה מפגרים כעת אחרי דור שלם. Opus 5.5 ו-GPT-6 Sol עלו לאוויר ב-22 בספטמבר 2026, באותו יום, ושניהם ניתנים לניתוב היום. המודלים החדשים ביותר שאנט לא הכניס לכרטיס הם בדיוק אלה שקורא היה רוצה למדוד אותו מולם, וזו אותה תלונה שעלתה בגל הראשון של התגובות על ההשקה — המשאלה שמודל שהגיע באוקטובר היה נמדד מול חזית אוקטובר ולא מול זו של יולי. זו אינה ביקורת על המודל, שעשוי בהחלט להחזיק מעמד. זו סיבה להתייחס לכרטיס כאל טענה כיוונית ולא כאל פסק דין, ולשים לב שההשוואה שאנט בחר מחמיאה לתוצאה פחות משהיא מיַשנת אותה.

היכן שאפשר לגעת בזה, והערת שוליים אחת בלתי מוסברת

יש בדיוק מקום אחד שבו Ling-3.1-flash פועל עבור משתמש כיום: המוצר של Ant עצמה. ממשק Ling Studio בכתובת ling.tbox.cn מפרט את Ling-3.1-flash בבורר המודלים שלו, והתיאור של האפליקציה עצמה את המודל רחב יותר מכרטיס הבנצ'מרק — היא מציגה אותו כ"סוכנים לשימוש כללי, חיפוש, עבודה משרדית שגרתית ופיתוח תוכנה/קוד", וזו העמדה המוכרת לשכבה הזו: לא מודל החשיבה העמוק ביותר במשפחה, אלא זה שנועד להיקרא ללא הרף ובזול.

המשטח הזה טומן בחובו גם את הפרט המביך ביותר של ההשקה. בהערת השוליים של כרטיס הבנצ'מרק עצמו נאמר ש-HealthBench Professional — הנתון 65.35, אחד משלושת המספרים בטקסט ההודעה — "הוערך בסביבת AQ", ומוסיפה�היכולות של Ling-3.1-flash בתחום הבריאות "ניתן לחוות כיום רק ב-AQ". שום דבר בכרטיס לא מסביר מהו AQ, ושום תיעוד ציבורי שיכולנו למצוא לא מגדיר אותו. ציון ראשי עם סייג סביבה מצורף, כשהסביבה אינה נקובה בשם, אינו תוצאה ניתנת לשחזור; זו הדגמת מוצר עם מספר לצידה.

מה ניתן לדעת, ומה לא

למיין את הפרסום הזה לשתי הקטגוריות האלה הוא הדבר השימושי ביותר שקורא יכול לעשות איתו היום.

מה שידוע כעת: הפרמטרים, מספר הפרמטרים הפעילים וחלון ההקשר כפי שמסר הספק; שלושת הבנצ'מרקים של הספק; קיומו של המודל במוצר של Ant עצמה; מערך ההשוואה ש-Ant בחרה; העובדה שלא פורסמו משקלים, רישיון או כרטיס מודל; והעובדה של-Artificial Analysis, שדירגה באופן בלתי תלוי את הדור הקודם, אין עמוד עבור Ling-3.1-flash. נכון לכתיבת שורות אלה, צינור הדירוג הבלתי תלוי שהפך את נתון 20 הנקודות של Ling-3.0-flash במדד Intelligence Index לקריא לא פרסם דבר על 3.1 בכלל.

לא ידוע כעת: האם המשקלים ייפתחו בפועל, ובאיזה רישיון; האם הארכיטקטורה היא גרסה מוגדלת של סטאק היברידי Ling-3.0 או משהו חדש; מה עלות המודל דרך ה-API של Ant, אם יש לו בכלל מחיר API; כיצד הוא מתנהג תחת הקשר ארוך בפועל, לעומת האופן שבו החלון מוגדר; והאם פערי הבנצ'מרק מחזיקים מעמד כאשר מישהו שאינו Ant מריץ את אותן משימות. כל אחד מאלה הוא שאלה שמודל ששוחרר עונה עליה ביום הראשון, ומודל שהוכרז עונה עליה ביום מאוחר יותר שטרם נקבע.

Generated two-column information card. Left column headed "Knowable today" lists five cards: "~560B total / ~25B active (vendor)", "up to 1M-token context (vendor)", "1,673 Elo GDPval-AA v2.1 (vendor)", "available in Ant's Ling Studio only" and "no independent score exists". Right column headed "Not knowable" lists five cards: "whether the weights will open", "the licence terms", "API price per million tokens", "long-context behaviour in practice" and "whether the benchmark gaps hold".

איך לקרוא יום כזה

הדפוס הזה נפוץ כעת מספיק כדי לתת לו שם. מעבדה סינית עם רקורד מוכח מפרסמת כרטיס מודל ותרשים בנצ'מרק, המספרים נוחתים סמוך לחזית, הקהילה מגיבה למספרים, והמשקלים מגיעים — או לא — שבועות לאחר מכן. Ling-3.0-flash שיחק בדיוק את המהלך הזה בקיץ, וכדאי לזכור כיצד זה הסתיים: Ant הכריזה עליו ב-24 ביולי 2026 כמודל API בלבד, בלי הצהרת רישיון ובלי בנצ'מרק עצמאי, והמשקלים תחת MIT לא הופיעו ב-Hugging Face עד 7 באוגוסט, שבועיים לאחר ההכרזה. Ling-3.1-flash נמצא בנקודה המקבילה בקשת הזו כבר ביום הראשון, עם ההבדל הנוסף שהפעם ההבטחה לקוד פתוח מפורשת בהכרזה ולא משתמעת.

אף אחד מהמודלים שאנט בחר כנקודות השוואה אינו נמצא בקטלוג שלנו כנושא הכתבה — Ling-3.1-flash, Ling-3.0-flash ו-Ling-3.0-flash-VL מחזירים כולם not-found בקטלוג OrcaRouter היום, ולא נעמיד פנים אחרת. אבל שלושה מהמודלים המקבילים בגרף הזה ניתנים לניתוב ממש עכשיו: Claude Opus 5, ‏GPT-5.6 Sol ו-DeepSeek-V4.1-Flash יושבים כולם מאחורי מפתח יחיד, במחיר המחירון של הספק וללא תוספת כלשהי, עם מעבר אוטומטי ביניהם. זה חשוב יותר ממה שזה נשמע בשבוע כמו זה, כי הדרך ההוגנת להעריך מודל שהוכרז היא להריץ את ההשוואה שאנט מזמין — מול המודלים שאפשר באמת לקרוא להם — בעוד נושא ההשוואה הוא עדיין בגדר גרף.

כשהמשקולות ינחתו, השאלה המועילה לא תהיה אם Ling-3.1-flash ניצח את Opus 5 בדירוג Elo אחד. היא תהיה אם MoE של ~560B עם ~25B פעילים יכול להחזיק הקשר של 1M טוקנים במחיר שמצדיק את הדלילות, והאם הרישיון מתירני מספיק כדי לארח אותו בעצמך. אלה שתי השאלות שההכרזה לא עונה עליהן, והן היחידות שיקבעו אם זה יהפוך למודל שאנשים בונים עליו או לשקופית במצגת הבאה של מישהו. בינתיים: השם אמיתי, המספרים הם של Ant בלבד, והמשקולות הן עדיין משפט.

Generated horizontal timeline with four milestone nodes. "Jul 24, 2026 — Ling-3.0-flash announced, API-only, no weights, no licence"; "Aug 7, 2026 — MIT weights land on Hugging Face, 14 days later"; "Sep 30, 2026 — Ling-3.1-flash announced: ~560B, ~25B active, 1M context"; and a dashed open node reading "Weights: not yet — 'we plan to open-source soon'", captioned "the same point in the same arc, on day one".