כרטיס כותרת שנוצר שכותרתו 'Qwen 4.5 and Qwen 5: 5 to 10 trillion parameters' עם כותרת המשנה 'רצועת מפת דרכים, לא מפרט' ושלושה כרטיסים שעליהם כתוב 'יעד מפת דרכים / 5-10T פרמטרים', 'ספינת דגל בהפצה / Qwen3.8-Max 2.4T' ו'תאריך שחרור / לא הוכרז'. שורת כותרת תחתונה מציינת 'לפי הודעה לעיתונות של Alibaba מ-22 בספטמבר 2026; לא פורסם כרטיס דגם.' עיצוב עריכה וקטורי שטוח על רקע לבן עם שטיפת גרדיאנט מכחול לציאן ולוגו OrcaRouter משולב בפינה הימנית התחתונה.
Guides & Insights

Qwen 4.5 ו-Qwen 5 מכוונים ל-5 עד 10 טריליון פרמטרים: מה עליבאבא אמרה ומה היא לא אמרה

מחבר

Alistair Wren

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

בכנס אפסארה שלה בהאנגג'ואו ב-22 בספטמבר 2026, החברה העריכה את גודלו של הדור שאחרי הבא. Qwen 4.5 ו-Qwen 5 "צפויות להתרחב ל-5 עד 10 טריליון פרמטרים," בלשון ההודעה לעיתונות באנגלית של החברה עצמה — שורת מפת דרכים, לא מפרט. לאף אחד מהמודלים אין תאריך שחרור, כרטיס מודל, מזהה API, מחיר או ציון בנצ'מרק שפורסם, מה שאומר ששום דבר משניהם אינו ניתן להפעלה היום. דגם הדגל שאפשר למעשה לקנות הוא Qwen3.8-Max, זמין באופן כללי מאז 3 באוגוסט 2026, עם 2.4 טריליון פרמטרים. בימים שלאחר הכנס, משפט מפת הדרכים הזה צומצם בהרבה סיקורים לטענה שמודל עם 10 טריליון פרמטרים מגיע — טענה חזקה ופשוטה יותר מזו שהחברה הציגה. המרחק בין שני המשפטים האלה הוא כשנה של תכנון.

הטענה, והגרסה שלה שהתפשטה

שני דברים נאמרו על הבמה, וכדאי להפריד ביניהם משום שהם נושאים כמויות מידע שונות מאוד. הראשון הוא עדכון סטטוס: Qwen 4 נמצא באימון, על ארכיטקטורה חדשה. השני הוא מפת דרכים: סדרות Qwen 4.5 ו-Qwen 5 צפויות להגיע לטווח של 5 עד 10 טריליון פרמטרים.

ההודעה לעיתונות באנגלית של Alibaba מייחסת את שניהם לחברה ולא למנהל בכיר בשם. הסיקור מהכנס שמרחיק לכת מייחס את מפת הדרכים לליו דה ייהנג, שמנהל את פרויקט Qwen למודלי שפה גדולים ב-Alibaba Token Hub, ומדווח על המסגור שלו שלפיו סקיילינג הוא נתיב מפתח לעבר אינטליגנציה מלאכותית על-אנושית. המסגור הזה הוא ההקשר שבו נמסר מספר הפרמטרים, והוא מסביר מדוע המספר הוא טווח ולא יעד.

מה שהתגלגל אז היה הקצה העליון של הטווח. הכותרות באנגלית שבאו לאחר מכן כללו לפחות אחת שתיארה מודל של 10 טריליון פרמטרים שהוצג ברמז, וכמה שתיארו תוכנית למודל של 5 עד 10 טריליון פרמטרים. שתי אלו פרשנויות סבירות של שקופית. אף אחת מהן אינה מפרט, וההבדל חשוב לכל מי שצריך לתכנן בהתאם לכך.

5 טריליון הוא היעד של דור אחד, ו־10 טריליון הוא היעד של דור אחר

הדבר המועיל ביותר להבין נכון בהודעה הזו הוא ש-5 עד 10 טריליון הוא טווח שמשתרע על פני שני דורות, ולא מודל אחד עם סבילות רחבה. המשפט של אליבאבא עצמה מייחס את הטווח ל„סדרת הדגמים הקרובה Qwen 4.5 ו-Qwen 5” — הסדרות, בלשון רבים, יחד.

הדיווח בשפה הסינית מאותה ועידה הוא שוב מדויק בכיוון אחר, כאשר כותרות מתארות מודלים שלאחר Qwen 4.5 מתרחבים לטווח של 5 עד 10 טריליון. הקריאה הזו מציבה את קצה 10 הטריליון גם מעבר ל-Qwen 4.5. הקביעה היחידה שכל המקורות מסכימים עליה היא שהטווח מכסה את המרווח שבין Qwen 4.5 ל-Qwen 5. הייחוס של 10 טריליון דווקא ל-Qwen 5 הוא הסקה שהפכה לכותרת, לא ציטוט.

לצורך קנה מידה, ואלה המספרים היחידים בסיפור הזה שפורסמו ולא הוערכו:

• 5 עד 10 טריליון — טווח הפרמטרים שהודעה לעיתונות של אליבאבא מייחסת לסדרות Qwen 4.5 ו-Qwen 5

• 2.4 טריליון — סך הפרמטרים של Qwen3.8-Max, ספינת הדגל המשוחררת, לפי כרטיס המודל הרשמי שלו

• 95 מיליארד — מספר הפרמטרים הפעילים לכל טוקן ב-Qwen3.8-Max, הנתון שמכתיב את עלות ההגשה של טוקן

• 10 טריליון — הקצה העליון של הטווח, והחלק היחיד ממנו שהגיע לרוב הכותרות באנגלית

• 0 — מספר המפרטים שפורסמו, תאריכי השחרור, המחירים, חלונות ההקשר או ציוני הבנצ'מרק עבור Qwen 4.5 או Qwen 5

A generated scoreboard titled 'Shipped vs projected - the scoreboard'. Left column 'Qwen3.8-Max (shipping)' reads GA August 3, 2026; 2.4 trillion total parameters; 95 billion active parameters; 1,000,000-token context window; $2.00 in / $6.00 out; benchmarks vendor table plus AA Index 45. Right column 'Qwen 4.5 / Qwen 5 (roadmap)' reads release none given; 5 to 10 trillion series; active parameters not published; context window not published; price not published; benchmarks none published. Footer reads 'Qwen3.8-Max specs per its model card; AA Index per Artificial Analysis; Qwen 4.5 and Qwen 5 per Alibaba's September 22, 2026 roadmap.'

מספר הפרמטר שחשוב הוא זה שאף אחד לא פרסם

מספר הפרמטרים הכולל הוא המספר שמעבדה בוחרת להצהיר עליו. פרמטרים פעילים הם המספר שקונה צריך, ומפת הדרכים אינה כוללת אחד כזה.

Qwen3.8-Max הוא מודל תערובת מומחים עם 2.4 טריליון פרמטרים בסך הכול ו-95 מיליארד פעילים לכל טוקן. זהו יחס הפעלה של כ-4 אחוזים: המודל מחזיק ידע רב במשקלים שהוא אינו קורא עבור טוקן נתון, ומשלם מחשוב עבור פרוסה קטנה מהם. הפרמטרים הכוללים אומרים לך כמה זיכרון הדבר תופס וכמה גדול הארגז שנדרש. הפרמטרים הפעילים אומרים לך מה אתה משלם בכל פעם שהוא עונה.

אם ניקח את היחס הזה קדימה, צורת הבעיה נעשית גלויה. מודל עם 10 טריליון פרמטרים שנבנה באותה הפעלה של 4 אחוזים יפעיל בסדר גודל של 400 מיליארד פרמטרים לכל טוקן — יותר מפי ארבעה ממה ש-Qwen3.8-Max מפעיל כעת. זהו חשבון על בסיס הנחה מוצהרת, לא טענה על Qwen 5: הגבר את הדלילות ומספר הפרמטרים הפעילים יורד, הקטן אותה והוא עולה. אבל החשבון הזה הוא שקובע אם מודל עם 10 טריליון פרמטרים הוא מוצר מוגש או ארטיפקט מחקרי, וזהו החישוב שכותרת 5 עד 10 טריליון מזמינה ואז משאירה לא גמור.

זה גם המקום שבו כלכלת הניתוב מפסיקה להיות מופשטת. ב-OrcaRouter מחיר המחירון של הספק מועבר הלאה עם 0% תוספת מחיר, כך שהורדת מחיר מצד ספק בשכבת Qwen נכנסת לתוקף במפתח שלך באותו יום ולא בחידוש. דור שעלות ההגשה שלו באמת לא ודאית הוא בדיוק המקרה שבו העברה ישירה כזו שווה יותר מהנחה שנקבעה מראש מול מספר שאיש לא פרסם.

ההכרזה על השבב היא לוח הזמנים האמיתי

Alibaba הודיעה על מפת הדרכים של המודלים ועל מאיץ חדש באותה הודעה לעיתונות, והשניים קשורים זה לזה יותר ממה שההודעה אומרת.

מעבד ה-Zhenwu V900 של T-Head הוא מעבד לאימון ולהסקה עם 216 GB של זיכרון, רוחב פס בין-שבבי של 1,200 GB/s, תמיכה מובנית ב-FP8 וב-FP4, וביצועים שלטענת החברה הם פי שלושה מאלה של קודמו, ה-Zhenwu M890, שהושק במאי. ייצור המוני ושחרור מסחרי מתוכננים לרבעון הראשון של 2027. שרת סופרנוד נלווה תומך באשכולות של עד 500,000 כרטיסים, וחברת T-Head אומרת שסדרת Zhenwu שירתה יותר מ-650 לקוחות.

קראו את שתי ההודעות יחד והרצף קריא. אימון והגשה של מודל תערובת מומחים בקנה מידה של 10 טריליון הם בעיית חיבוריות לפני שהם בעיית מחשוב, משום שמקביליות מומחים פירושה העברת אקטיבציות בין שבבים כל העת, ורוחב פס בין-שבבי של 1,200 GB/s הוא המספר שמכריע אם זה בר-ביצוע. סיליקון בלוח זמנים כזה ממקם את החלון הסביר המוקדם ביותר לריצה בקנה מידה חזיתי מסוג זה עמוק לתוך 2027 — וגם אז, משלוח של שבב אינו אומר דבר על סיומה של ריצת אימון. Alibaba חיברה בין שני הנושאים בכך שהציבה אותם בפרסום אחד; החיבור עצמו הוא הפרשנות שלנו, והוא מסומן ככזה.

אופק הזמן של החברה עצמה עולה בקנה אחד עם זה. המנכ"ל אדי וו הציב יעד של יותר מ-20 גיגה-וואט של קיבולת מרכזי נתונים עולמית של Alibaba Cloud עד 2032 — יעד קיבולת, ולא קיבולת שנפרסה בפועל, ואופק של יותר מחמש שנים ולא של הרבעון הבא.

הטענות לשיפור עצמי שמחזיקות את מפת הדרכים

הסיבה שתוכנית של 5 עד 10 טריליון היא בכלל נתונה לוויכוח, ולא רק יקרה, היא שיפור עצמי רקורסיבי: אם צינור האימון משפר את עצמו, המחשוב הנדרש לכל דור יורד, והחזית מתקרבת לכך שתהיה בהישג יד. זו הטענה שעליה נשענת מפת הדרכים, והיא גם הדבר הפחות בר-אימות שאמרה Alibaba.

מה שהחברה דיווחה: Qwen3.8-Max השלימה 33 מחזורים איטרטיביים במהלך כחודש של עבודה אוטומטית לחלוטין, שכללה תכנון צינור עיבוד, אימות נתונים ואבחון שגיאות, והעלתה את ציון Artificial Analysis שלה מ-40 ל-45. בניסוי לתכנון שבבים, המודל השקיע יותר מ-60 שעות של שיפור עצמי לאורך מחזור חיים של תכנון, ביצע יותר מ-10,000 קריאות לכלי אוטומציה של תכנון אלקטרוני, והקטין את שטח השבב ב-42 אחוזים ללא פגיעה בביצועים. דיווח אחד מהכנס גם מציג שיפור של 96 אחוזים בתפוקת הסקה מכיוונון אוטונומי של T-Head GPU חדש.

אלה מדווחים על ידי הספק ולא שוחזרו באופן בלתי תלוי. זו אינה נקודה טכנית גרידא — לולאה אוטונומית שמדרגת את הניסויים של עצמה מודדת את עצמה מול המעריך שלה, ולעולם החיצון אין דרך לבדוק את המחוון. הסיקור של הכנס אמר זאת בדרך כלל, ועל הקוראים להניח זאת.

יש מלכודת שנייה באותה טענה, והיא עוסקת בתוויות ולא ביושר. Alibaba לא אמרה מול איזו גרסה של Artificial Analysis Intelligence Index נמדדת התנועה שלה מ-40 ל-45, והמדד הזה נבנה מחדש מאז שהמודל הזה הושק. העמוד הנוכחי של Artificial Analysis עבור Qwen3.8 Max (0902) מציג 45 — נתון בלתי תלוי, לפי הגרסה שבתוקף היום. הקריאה שנרשמה לאותו מודל באמצע אוגוסט, לפי הגרסה שהייתה אז בתוקף, הייתה 56. 45 ו-56 אינם אותה מדידה באותן יחידות, וחיסור האחד מהשני מפיק מספר שאינו אומר דבר. מה שהעמוד אינו מציג הוא ה-40 ש-Alibaba אומרת שממנו השתפרה: נקודת המוצא של אותה דלתא היא של החברה עצמה, ורק נקודת הסיום במקרה נמצאת במקום שבו נמצאת הקריאה הבלתי תלויה כעת. יש לקרוא את התנועה ככיוון, לא כמדידה.

A screenshot of the Artificial Analysis model page for Qwen3.8 Max (0902), captured September 23 2026, showing an Artificial Analysis Intelligence Index of 45 (ranked 24 of 212, badge 'Updated'), speed of 39.2 output tokens per second (159 of 212), $2.00 per 1M input and $6.00 per 1M output tokens with an 88% cache discount and $5.41 cost per Intelligence Index task (90 of 212), verbosity of 190M output tokens (88 of 212), and a technical specification listing a 984k context window with reasoning enabled.

מה Alibaba כן שחררה באותו כנס?

אם מוציאים את מפת הדרכים, הכנס עדיין הכיל השקות אמיתיות, כולן מולטימודליות:

• Qwen3.8-LiveTranslate — תרגום סימולטני, כשהשהיה (LAAL) קוצרה בכמעט 20 אחוז, מ-2.8 שניות ל-2.3 שניות

• Qwen-Audio-3.1-ASR, Qwen-Audio-3.1-TTS ו-Qwen-Audio-3.1-Realtime — חבילת דיבור מחודשת

• Qwen-Audio-3.1-TTS-Next — נופי צליל קולנועיים שמשלבים דיאלוג ואווירה מתוך תסריט טקסטואלי, מיועדים לספרי שמע, לקולנוע ולטלוויזיה, לפודקאסטים ולמשחקים

• Qwen-Image 3.1 — יצירת תמונות המותאמת לעיצוב יצירתי ולשיווק בתחום המסחר האלקטרוני, עתידה לצאת בהמשך השנה, עם יצירה מובנית של רקע שקוף

• Qwen Intelligence — פלטפורמה אג'נטית full-stack המיועדת ליצרניות סמארטפונים

כל פריט ברשימה הזו הוא מוצר עם חלון אספקה. הטענה ברמת החזית היא הפריט היחיד בסדר היום שאין לו תאריך, והניגוד אינו מקרי: השקת דרג המולטימודל היא שמממנת שנת מפת דרכים, ומפת הדרכים היא מה שהופך את סבב הגיוס הבא או את חוזה הענן הבא לסיפור ולא לגיליון אלקטרוני. שני הדברים אמיתיים. רק אחד מהם הוא משהו שאפשר לבצע קריאה אליו.

מה ניתן לקריאה היום, ומה צריך להשתנות כדי שזה ישתנה

דור Qwen 3.8 נותר כל הקו הניתן לרכישה. Qwen3.8-Max זמין באופן כללי מאז 3 באוגוסט 2026 במחיר של 2.00 דולר למיליון טוקני קלט ו-6.00 דולר למיליון טוקני פלט, אחיד לאורך כל חלון ההקשר של 1,000,000 טוקנים וללא תוספת תשלום על פרומפטים ארוכים. המשקלים שלו פורסמו ב-12 באוגוסט 2026 כ-Qwen3.8-2.4T-A95B ב-BF16 וב-FP8 תחת רישיון Qwen מותאם אישית. טבלת הבנצ'מרקים של הספק חזקה ולא מבוקרת — Terminal-Bench 2.1 בציון 86.6, GPQA Diamond בציון 92.6, OSWorld-Verified בציון 86.1, כולם נתונים של עליבאבא עצמה — התמונה הבלתי-תלויה פחות מחמיאה מזו של הספק: Artificial Analysis מציבה את Qwen3.8 Max ‏(0902) באינדקס אינטליגנציה של 45, במקום ה-24 מתוך 212 מודלים, בעלות נמדדת של 5.41 דולר למשימת Intelligence Index ובקצב של 39.2 טוקני פלט לשנייה — מקום 159 מתוך 212, סמוך לקצה האיטי של התחום. באותו עמוד מפורט חלון ההקשר כ-984k לעומת 1,000,000 בעמוד המודל שלנו, פער שכדאי להכיר לפני שמתכננים משימת הקשר ארוך. ציון ברמת החזית, מהירות בינונית: זהו הסיכום הכנה של דגל הדגל המשוחרר, וזו נקודת הבסיס שכל Qwen 4.5 יצטרך לעבור בשני הצירים בבת אחת.

A screenshot of the OrcaRouter model page for Qwen3.8 Max (qwen/qwen3.8-max), captured September 23 2026, showing the model id, 1M-token context, text image and video input with text output, vision tools JSON and reasoning badges, a dated snapshot label of 2026-08-03, input at $2.00 and output at $6.00 per 1M tokens, p50 TTFT 3.09s and p95 TTFT 10.00s, trailing-7-day traffic of 29.4M tokens, and a Python code sample posting to the OpenAI-compatible base_url https://api.orcarouter.ai/v1.

OrcaRouter מציעה את משפחת Qwen 3.8 — qwen/qwen3.8-max, qwen3.8-flash ו-qwen3.8-27b — בנקודת קצה אחת תואמת ל-OpenAI לצד יותר מ-200 מודלים אחרים, מה שאומר שדרגת Qwen 4.5 תהיה שינוי model-id במפתח קיים ולא חוזה ספק חדש, חיוב חדש ו-SDK חדש. כאשר אחד מהם ישוחרר, הקטלוג הזה הוא המקום שבו הוא יופיע. כיום, לא Qwen 4.5 ולא Qwen 5 נמצאים בו, מפני שאף אחד מהם לא שוחרר — ושום כמות של פרסום על מפת דרכים לא תשנה זאת.

השימוש המעשי במפת דרכים כמו זו הוא ההפך מתוכנית מיגרציה. אם רמת Qwen 4.5 תיראה בסופו של דבר סבירה לעומס העבודה שלך, הדרך הזולה לגלות זאת היא לנתב פרוסה מהתעבורה האמיתית אליה מאחורי מנגנון גיבוי אוטומטי, כך שמודל שמתברר כאיטי, יקר או גרוע מהמודל הקיים עולה לך באחוז מעומס עבודה אחד ולא ברבע. לשם כך נועד ה-failover, ומודל חזית לא מוכח בן ימים ספורים הוא המקרה הברור ביותר לשימוש בו.

מה לעקוב, ובמה עדיין לא להאמין

שורת מפת דרכים הופכת לשחרור כאשר מופיעה קבוצה קטנה של דברים קונקרטיים. כרטיס מודל הנושא ספירת פרמטרים כוללת, ספירת פרמטרים פעילים וחלון הקשר. מזהה API שניתן להעביר בבקשה. משקלים במרכז מודלים. רשומה בלוח דירוג עצמאי עם תאריך מצורף. מחיר. כל אחד מאלה הוא אות; רובם יחד מהווים השקה.

דברים שאינם שחרור, ויהיו טכניים ככל שייראו: אזכור בכנס; בקשת משיכה של מסגרת הגשה שמוסיפה ענף ארכיטקטורה לבנייה ניסיונית של Qwen, שהיא עבודת מנוע על מחסנית ההסקה של מישהו ולא מודל שאפשר לקרוא לו; מזהה תמונת מצב עם תאריך לדור שכבר שוחרר; ופוסט ברשתות חברתיות שמפרפרז הערה מהבמה. האות שהפיק את המאמר הזה היה האחרון שבהם, והסיבה שהיה שווה לכתוב עליו היא שהטענה הבסיסית ניתנת לבדיקה מול הודעה לעיתונות של Alibaba עצמה — שמשם מגיעים הטווח של 5 עד 10 טריליון, מעמד Qwen 4 ונתוני RSI. האות הצביע על הסיפור; הוא אינו הסיפור.

השאלה בטווח הקצר צרה יותר ממה שהכותרות מרמזות. עליבאבא אמרה ש-Qwen 4 נמצא באימון, מה שמציב את Qwen 4 לפני גם 4.5 וגם 5 ברצף — לכן הדבר הבא שכדאי לעקוב אחריו אינו מודל עם 10 טריליון פרמטרים, אלא האם Qwen 4 יגיע עם כרטיס מודל, מחיר ונקודת קצה, ומתי. עד שמשהו בשרשרת הזאת יתממש, העמדה הכנה לגבי טווח 5 עד 10 טריליון היא שזהו כיוון התפתחות, שנחשף באופן רשמי, בלי מפרט מצורף ובלי תאריך. היערכו ל-Qwen3.8-Max, עקבו אחר טווח 4.5 ו-5 כתזה של סקיילינג ולא כמוצר, והתייחסו לכל מספר פרמטרים שאתם רואים עבור מודל בלי כרטיס מודל כאל תחזית.

השוואות במאמר הזה1

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית