כרטיס hero עריכתי שנוצר בכותרת "Ling-3.1-flash מול Ling-3.0-flash" עם כותרת המשנה "אחד ניתן להורדה היום. האחר הוא משפט בהודעה לעיתונות." שתי עמודות השוואה: "Ling-3.1-flash (הוכרז)" מפרט "~560B סה״כ / ~25B פעילים", "הקשר של עד 1M טוקנים" ו"אין משקולות, אין רישיון"; "Ling-3.0-flash (שוחרר)" מפרט "124B סה״כ / 5.1B פעילים", "הקשר מוגש של 262,144 טוקנים" ו"משקולות MIT ב-Hugging Face".
Guides & Insights

Ling-3.1-flash לעומת Ling-3.0-flash: מה באמת משנים חלון של 1M טוקנים וכמות פרמטרים גדולה פי 4.5

מחבר

Gideon Frost

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

למשפחת Ling של Ant Group יש שכבה מהירה חדשה, והפעם היא בת משפט אחד בלבד. Ling-3.1-flash הוכרז ב-30 בספטמבר 2026 — כ-560 מיליארד פרמטרים בסך הכול, כ-25 מיליארד פעילים לכל טוקן, חלון הקשר שצוין כעד 1 מיליון טוקנים, ומשפט שגור מצורף: "אנחנו מתכננים לפתוח את הקוד של המודל בקרוב." המודל שהוא מחליף בראש הקו המהיר, Ling-3.0-flash, הוא חיה אחרת בכל מובן: 124 מיליארד פרמטרים בסך הכול, 5.1 מיליארד פעילים לכל טוקן, הקשר מוגש של 262,144 טוקנים, משקולות ברישיון MIT ב-Hugging Face מאז 7 באוגוסט, ומדד Artificial Analysis Intelligence Index עצמאי של 20. אחד מהמודלים האלה אפשר להוריד היום. על האחר אפשר לקרוא. השוואה ביניהם מועילה באמת, אבל רק אם ההשוואה מתחילה שם.

האריתמטיקה של הכותרת פשוטה ומטעה במקצת. Ling-3.1-flash הוא בערך פי 4.5 ממספר הפרמטרים הכולל של Ling-3.0-flash ובערך פי 4.9 ממספר הפרמטרים הפעילים — 25B לעומת 5.1B לכל טוקן. קריאה שטחית אומרת "מודל גדול בהרבה, ולכן חכם בהרבה". הקריאה הזהירה יותר היא ש-Ant שמרה בערך על יחס הדלילות בזמן שהגדילה את הגוף, ומה שזה קונה לך הוא קיבולת, לא בהכרח עומק חשיבה לכל טוקן: מודל שמנתב 25B מתוך 560B שלו דרך כל טוקן עושה יותר עבודה לכל טוקן ממודל שמנתב 5.1B, אבל הוא גם משלם בערך פי חמישה מחשוב לכל טוקן כדי לעשות זאת. היכן שהפשרה הזו נוחתת תלוי לחלוטין בשאלה אם הארכיטקטורה של Ant מטפלת בפרמטרים הנוספים ביעילות — וזו שאלה שההכרזה אינה עונה עליה.

שני הדגמים, זה לצד זה

הציבו זה לצד זה את העובדות שפורסמו, כך שהדורות ייפרדו בצורה נקייה. כל שורה למטה מציינת מה Ant או מעריך בלתי תלוי פרסם בפועל; כשמספר חסר, הוא חסר מפני שאיש לא פרסם אותו.

• סך כל הפרמטרים — Ling-3.1-flash: ~560B (ספק). Ling-3.0-flash: 124B (כרטיס דגם).

• פרמטרים פעילים לכל אסימון — Ling-3.1-flash: ~25B (ספק). Ling-3.0-flash: 5.1B (כרטיס המודל).

• חלון הקשר — Ling-3.1-flash: עד 1M אסימונים (ספק). Ling-3.0-flash: 256K מקורי, מוגש ב-262,144 (כרטיס המודל ומתכוני הסקה).

• משקלים ורישיון — Ling-3.1-flash: לא פורסם; אין מאגר, אין רישיון (נבדק ב-30 בספטמבר ושוב ב-1 באוקטובר 2026). Ling-3.0-flash: MIT, ב-Hugging Face כ-inclusionAI/Ling-3.0-flash וב-ModelScope מאז 7 באוגוסט 2026.

• פורמטי משקלים — Ling-3.1-flash: אין זמינים. Ling-3.0-flash: BF16 (~255GB) ו-FP8 (~128GB) מהמעבדה, בנוסף ל-quants קהילתיים.

• מקור הבנצ'מרק — Ling-3.1-flash: מדווח כולו על ידי הספק, אין ערכת בדיקה ציבורית, אין משקולות להריץ מחדש. Ling-3.0-flash: קיבל ציון באופן עצמאי על ידי Artificial Analysis במדד Intelligence Index של 20, כאשר מהירות פלט ונפח יצירת טוקנים מדודים פורסמו לצד זה.

• זמינות — Ling-3.1-flash: רק במוצר Ling Studio של Ant. Ling-3.0-flash: ניתן לאירוח עצמי, וכן ניתן לקרוא לו דרך ה-API למפתחים של Ant.

Headless capture of the Artificial Analysis model page for Ling 3.0 Flash. The page shows the model's stat strip with text input and text output, a 262k-token context window, 5.1B active parameters, and a written summary stating that Ling 3.0 Flash scores 20 on the Artificial Analysis Intelligence Index against a median of 8, generated 260M tokens during evaluation, is priced at $0.07 per 1M input tokens and $0.22 per 1M output tokens, and runs at 325 tokens per second.

למה כנראה מיועדת הקיבולת הנוספת

התיאור החד-שורתי של Ant עצמו את Ling-3.1-flash הוא הדבר האינפורמטיבי ביותר בשחרור. אפליקציית Ling Studio משווקת אותו כ"סוכנים לשימוש כללי, חיפוש, עבודת משרד שגרתית ופיתוח תוכנה/קוד" — מסגור של עבודת משרד וסוכנים, לא מסגור של בנצ'מרק חשיבה. זה מתיישב עם האופן שבו המשפחה מאורגנת: Ling הוא קו הטקסט והכלים לשימוש כללי, Ring הוא קו החשיבה, ו-Ming מטפל במולטימודאליות. Ling-3.0-flash תפס את אותה משבצת דור אחד קודם לכן, והוא היה במפורש הדרג המהיר והזול ולא הדגם המוביל.

קרא את ההרחבה באור הזה וזה הגיוני. עומסי עבודה סוכניים ושל קריאה לכלים הם ארוכים, חוזרניים וצמאי הקשר: לולאת סוכן בודדת יכולה לשרוף עשרות אלפי אסימונים של פלט כלים מצטבר לפני שהיא נוקטת בפעולה, כך שחלון של מיליון אסימונים הוא דרישה פונקציונלית ולא קישוט בדף מפרט. הגדלת סך מספר הפרמטרים תוך שמירה על חלק פעיל גדול היא הדרך להוסיף ידע עולם ועומק ביצוע הוראות למודל שעדיין צריך להיות מהיר מספיק כדי לשבת בתוך לולאה. Ant לא בונה כאן ספינת דגל איטית וחכמה יותר; היא בונה שכבה מהירה גדולה יותר.

הטיעון הנגדי הוא עלות, וזו אותה אריתמטיקה שמגיעה מהכיוון השני. הקיבולת הנוספת אינה בחינם בזמן הסקה — היא משולמת על כל טוקן, ו-Ant לא פרסמה שום מחיר עבור Ling-3.1-flash בכלל: אין מחירון API, אין הנחת מטמון, שום דבר דומה ל-$0.075/$0.22 למיליון טוקנים שהדור הקודם מפרט. זה המספר החסר שהיה מכריע את ההשוואה הזו, והוא חסר.

בנצ'מרקים, ומי הריץ אותם

Ling-3.1-flash מגיע עם שלושה ציונים שנראים חזקים בפני עצמם: 1,673 Elo ב-GDPVal-AA v2.1, 75.16 ב-FrontierSWE, ו-65.35 ב-HealthBench Professional. שלושתם של Ant עצמה, נלקחו מהכרזה, ואף אחד מהם לא שוחזר על ידי מעבדה חיצונית. המשמעות המעשית היא שניתן להשוות אותם למספרים של ספקים אחרים, אך לא למספרים בלתי־תלויים — ומדד ה-Intelligence Index של Artificial Analysis, בן 20 נקודות, עבור Ling-3.0-flash הוא מספר בלתי־תלוי בסקאלה שונה, כך שהצבתם זו לצד זו תהיה השוואה בין מדידה לטענה. נכון למועד כתיבת הדברים, אין דף של Ling-3.1-flash ב-Artificial Analysis.

הערת שוליים אחת בגרף של Ant ראויה לציון בזכות עצמה. בכרטיס נכתב שתוצאת HealthBench Professional הוערכה ב"סביבת AQ", וכי ניתן כיום לחוות את יכולות שירותי הבריאות של Ling-3.1-flash רק ב-AQ. שום תיעוד פומבי אינו מסביר מהו AQ. ציון ראשי הנושא הסתייגות של סביבה חסרת שם אינו משהו שצוות חיצוני יכול לשחזר, אפילו לאחר שהמשקלים יהיו קיימים.

באיזה אחד בעצם להשתמש השבוע?

השאלה לגבי הדור נפתרת באופן שונה בהתאם למה שאתם צריכים היום, ועבור כמעט כולם התשובה כרגע היא לא הדגם החדש יותר.

אם אתה צריך להריץ משהו השבוע, Ling-3.0-flash הוא היחיד מבין השניים שקיים בצורה שמישה: משקולות MIT שאתה יכול לארח בעצמך, FP8 אם אתה רוצה טביעת רגל קטנה יותר, תמחור API של צד ראשון שפורסם, וציון בלתי תלוי שאומר לך מה אתה מקבל. זהו מודל טוב באמת בדרג שלו — ההערכה הבלתי תלויה הציבה אותו על חזית פארטו של משקולות פתוחות מבחינת בינה מול סך הפרמטרים, ונתנה דירוג גבוה למהירותו, עם הסתייגות שהוא מפורט באופן יוצא דופן והפיק כ-260 מיליון טוקנים במהלך הערכתו, לעומת חציון קרוב ל-100 מיליון.

אם אתם מתכננים לחצי השנה הקרובה, Ling-3.1-flash הוא כיוון ההתפתחות, ועדיין לא רכיב. הדברים הספציפיים שכדאי לעקוב אחריהם לפני שהוא יהפוך לרכיב: האם המשקלים אכן ייפתחו ובאיזה רישיון, האם החלון המוגש הוא באמת 1M או הרחבה של הקשר מקורי קצר יותר, מה העלות למיליון טוקנים, והאם מעבדה עצמאית משחזרת את 75.16 ב-FrontierSWE. כל אחד מאלה שיתממש יהיה סיבה להריץ מחדש את ההשוואה. אף אחד מהם לא התממש.

Ant Group's own Ling-3.1-flash benchmark card, published 30 September 2026. Bar-chart panels cover GDPval-AA v2.1 (1,673 Elo for Ling-3.1-flash), tau-Banking, SkillsBench, Automationbench, Terminal-Bench 4.0, CyberGym, FrontierSWE (75.16), SWE Atlas Codebase QnA, Finance Agent v2, HealthBench Professional (65.35), DRACO and MultiChallenge, with GPT-5.6 Sol, Claude Opus 5, Kimi K3, GLM 5.3, GLM 5.3 Flash and DeepSeek-V4.1-Flash as the comparison set. A footnote states HealthBench Professional was evaluated in the AQ environment.

היכן זה משתלב בסטאק ניתוב

אף מודל Ling לא נמצא בקטלוג שלנו היום — Ling-3.0-flash, Ling-3.0-flash-VL ו-Ling-3.1-flash מחזירים כולם not-found מול ה-API של המודלים של OrcaRouter, כך שהתשובה הכנה ל"אפשר לקרוא לו דרככם" היא לא, לעת עתה. מה ששכבת ניתוב באמת טובה בו בשבוע כמו זה הוא החצי השני של הבעיה: המודלים שמולם היית משווה מועמד. Claude Opus 5, GPT-5.6 Sol ו-DeepSeek-V4.1-Flash הם כולם נתיבים חיים במחיר המחירון של הספק וללא תוספת, ונתב שמחזיק אותם מאחורי מפתח אחד עם מעבר אוטומטי בעת תקלה הוא הדרך לשמור על מערכת הערכה מכוונת למטרה נעה בלי לתחזק ארבע אינטגרציות. כשהמשקלים של Ling-3.1-flash ינחתו והרישיון יהיה קריא, זו גם הצורה של ההחלטה: להוסיף נקודת קצה אחת, לא לבנות מחדש את כל המחסנית.

הסיכום הדורי קצר. Ling-3.0-flash הוא מודל שהופץ, עם ניקוד עצמאי, ברישיון מתירני, שמתארח בעצמו היום. Ling-3.1-flash הוא הבטחה גדולה יותר, עם הקשר ארוך יותר, ויקרה יותר להרצה, ש-Ant טרם סיפקה בשום צורה שמפתח יכול להשתמש בה. התייחסות לשנייה כשדרוג של הראשונה היא הטעות שהשחרור הזה מזמין, והמספרים עדיין לא תומכים בכך.

Generated two-lane information card. Top lane headed "Independently measured" holds "Ling-3.0-flash — AA Intelligence Index 20 (v4.3)" and "Ling-3.0-flash — 325 tokens/sec, 260M tokens generated". Bottom lane headed "Vendor-reported only" holds "Ling-3.1-flash — 1,673 Elo GDPval-AA v2.1", "Ling-3.1-flash — 75.16 FrontierSWE" and "Ling-3.1-flash — 65.35 HealthBench Professional (AQ environment, undefined)".