
Ling-3.1-flash הוכרז, לא פתוח: ~560B פרמטרים, הקשר של 1M טוקנים, וגרף שהורץ רק על ידי Ant
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 262 tok/s
- OpenAIחדשOpenAI: GPT-6 Luna2026-09-2237אינטליגנציה
- OpenAIחדשOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicחדשAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIחדשGrok 4.72026-09-2146אינטליגנציה
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים · 114 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 969 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 104 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- xAISpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
צוות Ling של Ant Group הציג נתונים על מודל ה-fast-tier הבא שלה ב-30 בספטמבר 2026, ובאותה נשימה אמר שאי אפשר עדיין לקבל אותו. Ling-3.1-flash הוא מודל תערובת מומחים (mixture-of-experts) בעל כ-560 מיליארד פרמטרים, שמפעיל כ-25 מיליארד פרמטרים לכל טוקן, ונושא חלון הקשר של עד מיליון טוקנים, לפי הודעת המודל שפרסמה Ant Group מחשבון ה-@AntLingAGI שלה. המשפט שמגדיר את ההשקה הזו הוא זה שאחרי המפרט: "אנחנו מתכננים להוציא את המודל בקוד פתוח בקרוב." נכון להיום אין מאגר של Ling-3.1-flash ב-Hugging Face, אין רישיון, אין קובץ משקולות להורדה, ואין הערכה מאף גורם מחוץ ל-Ant Group. מה שקיים הוא תרשים בנצ'מרק, משטח מוצר חי, והבטחה.
ההבחנה הזו היא כל הסיפור, וכדאי להיות בוטים לגביה, מפני שהמסגור שמגיע לרוב האנשים ראשון — שחרור בקוד פתוח מסין בדרג 500B שנוחת סמוך לחזית — מתאר משהו שלא קרה. Ling-3.1-flash אינו שחרור פתוח. הוא שחרור מוכרז בלבד. השניים אינם קרובים, והפער ביניהם הוא בדיוק המקום שבו קורא עלול להיכוות: אם אתם מתכננים קיבולת, מתקצבים פיילוט, או כותבים מסמך רכש סביב משקלים פתוחים שעדיין אינם קיימים, אתם מתכננים מול הודעה לעיתונות.
מה שההכרזה באמת מכילה
הפוסט קצר והמספרים בו ספציפיים. Ant מציינת מספר פרמטרים כולל של כ-560 מיליארד לעומת כ-25 מיליארד פעילים לכל טוקן, יחס של קרוב ל-1 ל-22, צפוף במעט יותר מדור Ling-3.0-flash שאותו היא מחליפה — המודל הזה מריץ 124B סה"כ לעומת 5.1B פעילים, בערך 1 ל-24, על גוף שקטן מרבע מהגודל. ההקשר מצוטט כ"עד 1M טוקנים", פי ארבעה מחלון 262,144 הטוקנים שמשפחת Ling-3.0-flash מספקת היום. שלושה ציונים בולטים מצורפים: 1,673 Elo ב-GDPVal-AA v2.1, 75.16 ב-FrontierSWE, ו-65.35 ב-HealthBench Professional.
כל אחד מהמספרים האלה מדווח על ידי הספק, ממקור ראשון, ואינו מפורסם בשום צורה שצד שלישי יכול להריץ מחדש. אין רתמת הערכה, אין סט פרומפטים, אין תצורת הרצה, ואין זרע — ומהותית יותר, אין משקולות שעליהן ניתן להריץ אותם. אם המספרים של Ant נכונים, המודל נמצא בצמרת השחרורים של מודלים פתוחים בסין; נכון להיום אין דרך לגלות אם הם נכונים.
התרשים, וההסתייגות הטמונה בו

אנט פרסמה את Ling-3.1-flash לצד כרטיס בנצ'מרק רב-פאנלים שממקם אותו בשדה של מודלים בחזית הטכנולוגיה וסמוכים לחזית: GPT-5.6 Sol, Claude Opus 5, Kimi K3, שני מודלים ממשפחת GLM, ו-DeepSeek-V4.1-Flash. לאורך הפאנלים עמודת Ling ניצבת בראש או סמוך לראש במדדי הסוכנים והקידוד, ובאמצע הדירוג במדדים הרב-תוריים והתחומיים. קראו את זה כפי שזה — מבחר המשימות של הספק עצמו, הלקוח מתוך סט הכולל עבודת סוכנים כלל-תכליתית, קידוד, משימות בתחום הבנקאות ובריאות — וזהו כרטיס שנראה אמין.
עם זאת, הבט מי נמצא עליו, ודבר אחד בולט. עמיתי החזית שאנט בחר הם GPT-5.6 Sol ו-Claude Opus 5. שני המודלים האלה מפגרים כעת אחרי דור שלם. Opus 5.5 ו-GPT-6 Sol עלו לאוויר ב-22 בספטמבר 2026, באותו יום, ושניהם ניתנים לניתוב היום. המודלים החדשים ביותר שאנט לא הכניס לכרטיס הם בדיוק אלה שקורא היה רוצה למדוד אותו מולם, וזו אותה תלונה שעלתה בגל הראשון של התגובות על ההשקה — המשאלה שמודל שהגיע באוקטובר היה נמדד מול חזית אוקטובר ולא מול זו של יולי. זו אינה ביקורת על המודל, שעשוי בהחלט להחזיק מעמד. זו סיבה להתייחס לכרטיס כאל טענה כיוונית ולא כאל פסק דין, ולשים לב שההשוואה שאנט בחר מחמיאה לתוצאה פחות משהיא מיַשנת אותה.
היכן שאפשר לגעת בזה, והערת שוליים אחת בלתי מוסברת
יש בדיוק מקום אחד שבו Ling-3.1-flash פועל עבור משתמש כיום: המוצר של Ant עצמה. ממשק Ling Studio בכתובת ling.tbox.cn מפרט את Ling-3.1-flash בבורר המודלים שלו, והתיאור של האפליקציה עצמה את המודל רחב יותר מכרטיס הבנצ'מרק — היא מציגה אותו כ"סוכנים לשימוש כללי, חיפוש, עבודה משרדית שגרתית ופיתוח תוכנה/קוד", וזו העמדה המוכרת לשכבה הזו: לא מודל החשיבה העמוק ביותר במשפחה, אלא זה שנועד להיקרא ללא הרף ובזול.
המשטח הזה טומן בחובו גם את הפרט המביך ביותר של ההשקה. בהערת השוליים של כרטיס הבנצ'מרק עצמו נאמר ש-HealthBench Professional — הנתון 65.35, אחד משלושת המספרים בטקסט ההודעה — "הוערך בסביבת AQ", ומוסיפה�היכולות של Ling-3.1-flash בתחום הבריאות "ניתן לחוות כיום רק ב-AQ". שום דבר בכרטיס לא מסביר מהו AQ, ושום תיעוד ציבורי שיכולנו למצוא לא מגדיר אותו. ציון ראשי עם סייג סביבה מצורף, כשהסביבה אינה נקובה בשם, אינו תוצאה ניתנת לשחזור; זו הדגמת מוצר עם מספר לצידה.
מה ניתן לדעת, ומה לא
למיין את הפרסום הזה לשתי הקטגוריות האלה הוא הדבר השימושי ביותר שקורא יכול לעשות איתו היום.
מה שידוע כעת: הפרמטרים, מספר הפרמטרים הפעילים וחלון ההקשר כפי שמסר הספק; שלושת הבנצ'מרקים של הספק; קיומו של המודל במוצר של Ant עצמה; מערך ההשוואה ש-Ant בחרה; העובדה שלא פורסמו משקלים, רישיון או כרטיס מודל; והעובדה של-Artificial Analysis, שדירגה באופן בלתי תלוי את הדור הקודם, אין עמוד עבור Ling-3.1-flash. נכון לכתיבת שורות אלה, צינור הדירוג הבלתי תלוי שהפך את נתון 20 הנקודות של Ling-3.0-flash במדד Intelligence Index לקריא לא פרסם דבר על 3.1 בכלל.
לא ידוע כעת: האם המשקלים ייפתחו בפועל, ובאיזה רישיון; האם הארכיטקטורה היא גרסה מוגדלת של סטאק היברידי Ling-3.0 או משהו חדש; מה עלות המודל דרך ה-API של Ant, אם יש לו בכלל מחיר API; כיצד הוא מתנהג תחת הקשר ארוך בפועל, לעומת האופן שבו החלון מוגדר; והאם פערי הבנצ'מרק מחזיקים מעמד כאשר מישהו שאינו Ant מריץ את אותן משימות. כל אחד מאלה הוא שאלה שמודל ששוחרר עונה עליה ביום הראשון, ומודל שהוכרז עונה עליה ביום מאוחר יותר שטרם נקבע.

איך לקרוא יום כזה
הדפוס הזה נפוץ כעת מספיק כדי לתת לו שם. מעבדה סינית עם רקורד מוכח מפרסמת כרטיס מודל ותרשים בנצ'מרק, המספרים נוחתים סמוך לחזית, הקהילה מגיבה למספרים, והמשקלים מגיעים — או לא — שבועות לאחר מכן. Ling-3.0-flash שיחק בדיוק את המהלך הזה בקיץ, וכדאי לזכור כיצד זה הסתיים: Ant הכריזה עליו ב-24 ביולי 2026 כמודל API בלבד, בלי הצהרת רישיון ובלי בנצ'מרק עצמאי, והמשקלים תחת MIT לא הופיעו ב-Hugging Face עד 7 באוגוסט, שבועיים לאחר ההכרזה. Ling-3.1-flash נמצא בנקודה המקבילה בקשת הזו כבר ביום הראשון, עם ההבדל הנוסף שהפעם ההבטחה לקוד פתוח מפורשת בהכרזה ולא משתמעת.
אף אחד מהמודלים שאנט בחר כנקודות השוואה אינו נמצא בקטלוג שלנו כנושא הכתבה — Ling-3.1-flash, Ling-3.0-flash ו-Ling-3.0-flash-VL מחזירים כולם not-found בקטלוג OrcaRouter היום, ולא נעמיד פנים אחרת. אבל שלושה מהמודלים המקבילים בגרף הזה ניתנים לניתוב ממש עכשיו: Claude Opus 5, GPT-5.6 Sol ו-DeepSeek-V4.1-Flash יושבים כולם מאחורי מפתח יחיד, במחיר המחירון של הספק וללא תוספת כלשהי, עם מעבר אוטומטי ביניהם. זה חשוב יותר ממה שזה נשמע בשבוע כמו זה, כי הדרך ההוגנת להעריך מודל שהוכרז היא להריץ את ההשוואה שאנט מזמין — מול המודלים שאפשר באמת לקרוא להם — בעוד נושא ההשוואה הוא עדיין בגדר גרף.
כשהמשקולות ינחתו, השאלה המועילה לא תהיה אם Ling-3.1-flash ניצח את Opus 5 בדירוג Elo אחד. היא תהיה אם MoE של ~560B עם ~25B פעילים יכול להחזיק הקשר של 1M טוקנים במחיר שמצדיק את הדלילות, והאם הרישיון מתירני מספיק כדי לארח אותו בעצמך. אלה שתי השאלות שההכרזה לא עונה עליהן, והן היחידות שיקבעו אם זה יהפוך למודל שאנשים בונים עליו או לשקופית במצגת הבאה של מישהו. בינתיים: השם אמיתי, המספרים הם של Ant בלבד, והמשקולות הן עדיין משפט.

