
Qwen 3.8 מול Claude Fable 5: build 0902 לוקח את ההובלה בקידוד
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiחדשOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0345אינטליגנציה76כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
כאשר אליבאבא הציגה את Qwen3.8-Max בשנחאי ב-19 ביולי 2026, היא השמיעה טענה אחת חזקה יותר מכל אחרת: המודל הזה עם 2.4 טריליון פרמטרים קרוב לרמת החזית ורק Claude Fable 5 נמצא מעליו. באותה עת אי אפשר היה להעריך זאת. לא היה כרטיס תעריף, לא טבלת בנצ'מרקים, ולא רישיון — רק הצהרת מיצוב.
ב-3 באוגוסט 2026, Qwen3.8-Max הפך זמין לציבור הרחב — כרטיס מחיר אמיתי ב-$2 / $6 למיליון טוקנים, טבלת מדדים עם מספרים, ונקודת קצה תואמת OpenAI ו-DashScope. ב-2 בספטמבר, עליבאבא שחררה את הצעד הבא מבלי לשנות את מספר הגרסה: Qwen3.8-Max-0902, רענון שלאחר אימון המכוון לקוד ולעבודה סוכנית, שהופיע לראשונה במקום הראשון בטבלת Code Arena: WebDev עם 1,691 Elo. Claude Fable 5, הדגם שעליבאבא בילתה את יולי במיצוב עצמה ישירות מאחוריו, יושב על 1,628 באותה טבלה. השאלה מיולי התחדדה: האם Qwen 3.8 הוא עדיין "שני רק ל-Fable 5", או שהציר של הקוד כבר התהפך?
הערה למפתחים — הדרך המהירה ביותר ליישב טענה מסוג זה היא להריץ את שני המודלים על הפרומפטים שלכם. OrcaRouter מעמיד 200+ מודלים מאחורי נקודת קצה אחת תואמת OpenAI, כך שתוכלו להעמיד את Qwen 3.8 Max מול Fable 5 על אותה משימה בלי להטמיע שתי SDK.
TL;DR: הכרעה.Qwen3.8-Max-0902 היא הגרסה החזקה ביותר עד כה של מודל הדגל 2.4T של עליבאבא, והחלק החדש בטיעון שלה אינו עוד דיווח עצמי: היא עשתה בכורה במקום הראשון בלוח Code Arena: WebDev העצמאי, עם 1,691 Elo, מעל Claude Fable 5 (1,628, #8) באותו לוח. המחיר נותר ללא שינוי ועדיין מכריע — בתעריף אחיד של $2/$6 למיליון טוקנים, Qwen נמוכה ממחירי Fable 5 ($10/$50) בערך פי 5 על קלט ופי 8 על פלט. מה שטרם נסגר הוא הפער ביכולות הכלליות: Artificial Analysis מעניקה ל-Qwen3.8-Max ציון 56 במדד האינטליגנציה שלה, לעומת 62 של Claude Fable 5; ולפי השבוע האחרון שפורסם בלוח ה-Arena הכללי (24–30 באוגוסט), Fable 5 נמצאת במקום הראשון (1,508 Elo), בעוד Qwen3.8-Max נמצאת במקום ה-20 (1,479). אז שתי הכרעות: בקידוד, גרסת ה-0902 של Qwen זוכה כעת לשופט חיצוני ולניצחון; בחשיבה רחבה ומבוקרת, Claude Fable 5 — ו-Claude Fable 5.1 החדשה יותר של Anthropic, שמובילה את מדד ה-AA עם 66 — עדיין שומרות על הבכורה.
נקודות עיקריות
• Qwen3.8-Max הגיע ל-GA ב-3 באוגוסט 2026, ורענון ה-0902 הגיע אחריו ב-2 בספטמבר — ללא שינוי גרסה, אותו תעריף של $2 / $6, ואותו קונטקסט של 1M טוקנים.
• פער המחירים עצום: Qwen ב-$2 / $6 למיליון לעומת Fable 5 ב-$10 / $50. זה בערך פי 5 בקלט ופי 8 בפלט, והתעריף של Qwen קבוע על פני כל ההקשר של 1M טוקנים ללא תוספת מחיר עבור פרומפט ארוך.
• לשני הצדדים יש כעת ציונים עצמאיים — והם מצביעים לכיוונים שונים. Qwen3.8-Max עומד על 56 במדד Artificial Analysis Intelligence Index (Claude Fable 5: 62), וגרסת ה-0902 שלו מובילה ב-Code Arena: WebDev עם 1,691 Elo לעומת 1,628 של Fable 5.
• טבלת המדדים של Qwen עצמו עדיין חזקה, והיא עדיין מופקת על-ידי הספק. GPQA Diamond 92.6, PaperBench 93.0, Terminal-Bench 2.1 86.6, OSWorld-Verified 86.1 — אבל העדכון של 2 בספטמבר הוא תוצאת Qwen הראשונה שזירה עצמאית דירגה במקום הראשון.
• פער הארכיטקטורה בגיליון המפרט סגור. Qwen3.8-2.4T-A95B הוא כ-95B פרמטרים פעילים מתוך 2.4T בסך הכול, על פני 512 מומחים — נחשף עם שחרור המשקלים הפתוחים ב-12 באוגוסט. הארכיטקטורה של Fable 5 נותרת בלתי חשופה.
• משקלים פתוחים יצאו, לא רק הובטחו. Qwen3.8-2.4T-A95B (BF16 ו-FP8) שוחרר ב-Hugging Face וב-ModelScope ב-12 באוגוסט תחת רישיון Qwen3.8-Max מותאם אישית, ואחריו Qwen3.8-27B ב-14 באוגוסט תחת Apache 2.0. Fable 5 הוא מודל סגור וזמין אך ורק דרך API, לצמיתות.
הערת דיוק: הנתונים מטבלת המדדים של עליבאבא עצמה נותרו דיווח ספק בלבד ולא שוכפלו. הנתונים הבלתי-תלויים כאן נושאים חותמת זמן ומגיעים מגורם שלישי: מדד האינטליגנציה של Artificial Analysis (Qwen3.8-Max 56, Claude Fable 5 62, Claude Fable 5.1 66), דירוג ה-Elo של Code Arena: WebDev, והלוח השבועי הכללי של Arena — ציוני ה-arena נעים ככל שמצטברות הצבעות, והמקום ה-#1 של ה-build 0902 הוא לפי הודעת עליבאבא בדבר רישום נקודתי בזמן. ציון ה-95.0% של Fable 5 ב-SWE-bench Verified הוא דיווח של Anthropic; התמחור של Qwen הוא מחירון ה-GA של Alibaba Model Studio.
המפרטים והמחיר, זה לצד זה
הנה הנתונים הקשים, כל נתון מיוחס למקורו.
• יצרן / סטטוס — Qwen3.8-Max: Alibaba; GA ב-3 באוגוסט 2026; רענון 0902 ב-2 בספטמבר 2026. Claude Fable 5: Anthropic; GA דגל
• אדריכלות — Qwen3.8-Max: 2.4T סה"כ / ~95B אקטיבי, MoE דליל, 512 מומחים (נחשף ב-12 באוגוסט); Fable 5: לא נחשף
• חלון הקשר — Qwen3.8-Max: 1M טוקנים (983,616 עם חשיבה; פלט מקסימלי 131,072); Fable 5: דגל הקשר הארוך
• AA Intelligence Index — Qwen3.8-Max: 56; Claude Fable 5: 62; Claude Fable 5.1 (1 בספטמבר): 66, מוביל
• SWE-bench Verified — Qwen3.8-Max: לא דווח (Alibaba מדווחת על FrontierSWE 73.5 במקום); Fable 5: 95.0% (Anthropic / buildfastwithai)
• חוזקות שדווחו באופן בלתי תלוי ועל ידי הספק — Qwen3.8-Max: Code Arena WebDev #1 בציון 1,691 (0902, בלתי תלוי); טבלת הספק: GPQA Diamond 92.6, PaperBench 93.0, Terminal-Bench 2.1 86.6. Claude Fable 5: AA 62; SWE-bench Verified 95.0%
• תמחור (קלט / פלט) — Qwen3.8-Max: $2.00 / $6.00 לכל 1M, שטוח על פני 1M הקשר; קלט במטמון $0.25; Fable 5: $10 / $50 לכל 1M
• משקלים פתוחים — Qwen3.8-Max: שוחרר ב-12 באוג׳ 2026 (רישיון מותאם אישית, לא Apache); Qwen3.8-27B תחת Apache 2.0 ב-14 באוג׳. Fable 5: לא — סגור / API בלבד
• ריבוי-מודאליות — Qwen3.8-Max: קלט טקסט, תמונה, וידאו → פלט טקסט; Fable 5: דגל מולטי-מודאלי
שני דברים ממסגרים את כל ההשוואה. הראשון השתנה ב-3 באוגוסט ועדיין תקף; השני השתנה שוב ב-2 בספטמבר.
ראשית, עמודת המחיר היא כעת הדבר הבולט ביותר בעמוד. ביולי, יתרון העלות של Qwen היה קופון הנחה — 90% הנחה על קרדיטים, זמני, ללא תעריף פר-טוקון שאפשר לתכנן לפיו. כעת זהו גיליון תעריפים, והפער הוא מבני ולא שיווקי. במחיר פלט של $6 לעומת $50 של Fable, אפשר להריץ בערך שמונה קריאות Qwen במחיר של קריאת Fable אחת. עבור כל עומס עבודה שבו משלמים על נפח ולא על התשובה הקשה ביותר, היחס הזה משנה את הארכיטקטורה של מה שבונים.
שנית, טור המדדים חדל להיות חד-צדדי. במשך רוב חודש אוגוסט הקריאה הכנה הייתה צרה: אליבאבא דיווחה על FrontierSWE 73.5 וטבלת תוצאות שהריצה בעצמה, אנתרופיק דיווחה על 95.0% מאומתים על ידי צד שלישי ב-SWE-bench Verified, ואף מעריך בלתי-תלוי לא דירג את Qwen כלל. בניית ה-0902 שמה לכך קץ. Code Arena: WebDev היא זירה עיוורת להצבעות אנושיות בין-זוגיות — הפרויקט שנודע בעבר בשם WebDev Arena, המנוהל על ידי אף אחד מאליבאבא — ו-Qwen3.8-Max-0902 נכנסה אליה במקום הראשון עם 1,691 אלו, מעל Claude Opus 5 (1,688), Kimi K3 (1,674) ו-Claude Fable 5 (1,628, מקום 8). שני סייגים שומרים על כך כנה: זו לוח אחד, הבודק פיתוח חזיתי סוכן-י ולא יכולת כללית, ו"הופעת בכורה במקום הראשון" היא הצהרת אליבאבא על רישום נקודתי בזמן. אבל הטענה של-Qwen אין שופט כלל אינה נכונה עוד, וזה משנה את ההשוואה יותר מכל מספר בודד על הלוח.

מה פער המחירים קונה לכם בפועל
הפשטות מרובות פחות שימושיות מדוגמה מעובדת, אז הנה אחת. קחו סוכן לסקירת קוד ששולח 150,000 טוקנים של הקשר ממאגר הקוד ומייצר 6,000 טוקנים של סקירה לכל קריאה.
• Qwen3.8-Max: 0.15M × $2 = $0.30, ועוד 0.006M × $6 = $0.036. ≈ $0.34 לכל קריאה.
• Claude Fable 5: 0.15M × $10 = $1.50, ועוד 0.006M × $50 = $0.30. ≈ $1.80 לשיחה.
• ב-2,000 שיחות ליום: Qwen ≈ $672 ליום; Fable ≈ $3,600 ליום. במשך חודש, זה בערך $20,000 לעומת $108,000.
• עם prompt caching בהקשר של מאגר יציב, הקלט המאוחסן של Qwen ב-$0.25/1M מוריד את צד הקלט מ-$0.30 לפחות מ-$0.04, מה שמביא את הקריאה ל-≈ $0.08 — זול בערך פי 22 מ-Fable לקריאה.
זה לא חיסכון שולי; זה ההבדל בין הפעלת בודק על כל pull request לבין הפעלתו רק על אלה המסוכנים. ותעריף הקונטקסט הקבוע של Qwen מחזק את ההשפעה ככל שהפרומפטים גדלים: מכיוון שאליבאבא לא גובה תוספת מחיר עבור פרומפטים ארוכים, העברת קונטקסט של 900,000 טוקנים עולה אותו דבר לטוקן כמו קונטקסט של 5,000 טוקנים.
המשקל הנגדי הכנה הוא שהמחיר לטוקן אינו המחיר למשימה שנפתרה. אם Fable 5 פותר בעיה במעבר אחד, בעוד שדגם זול יותר צריך שלושה ניסיונות בתוספת תיקון אנושי, הדגם הזול עשוי להיות יקר יותר במצטבר — ובעבודת ההיגיון הקשה ביותר, הדירוג המבוקר מס' 1 של Fable הוא הראיה הטובה ביותר הזמינה לכך שהוא אכן פותר יותר במעבר אחד. הטיעון הכלכלי בעד Qwen הוא החזק ביותר בעומסי עבודה בנפח גבוה וסובלניים לשגיאות, והחלש ביותר בעומסים בנפח נמוך וקריטיים.
השם 0902: היכולת זינקה, אך מספר הגרסה לא.
הדבר הבולט בנוגע ל-2 בספטמבר הוא מה ש-Alibaba לא עשתה: לא שחררה את Qwen 3.9. השיפור סופק כנקודת ביקורת מתוארכת תחת אותו שם מודל — Qwen3.8-Max-0902 — וה-API סיפק אותו תחת אותו שם ובאותו מחיר. זה הכיוון שאליו התעשייה נסחפת: כשקפיצת יכולת כבר לא מבטיחה מספר גרסה חדש, “באיזה מודל עליי להשתמש” הופך לשאלה על build ותאריכים, ולא רק על שמות של משפחות מודלים.
זה גם אומר שלציון בנצ'מרק שמוצמד ל־“Qwen3.8-Max” יש חיי מדף: ציון שנמדד מול גרסת יולי או אוגוסט עשוי שלא לתאר את המודל שה-API מחזיר היום. בדוק את מזהה הגרסה על נקודת הקצה שאתה קורא לה בפועל — המספר 0902 הוא ההבדל בין מודל שפיגר אחרי Claude Fable 5 למודל שמוביל עליו ב-Code Arena: WebDev.
הוכחה, ומדוע היא עדיין מכריעה את ההתמודדות הזו
העדות המעשית המצוטטת ביותר עבור Qwen3.8-Max מגיעה מסקירה מתקופת טרום-ההשקה (thomas-wiegold.com) שהעבירה את המודל דרך ארבע משימות בנייה אמיתיות. התוצאות היו מרשימות באמת: Qwen פתר בניסיון אחד סימולציית Go poker — רק המודל השלישי אי פעם שצלח את ההנחיה הזו בניסיון יחיד, לצד Fable 5 ו-Grok 4.5 — ובהנחיה של אתר קליית קפה הוא הפיק את הפלט הטוב ביותר שהמבקר ראה אי פעם במבחן זה, והוסיף, מתוך יסודיות צרופה, עגלת קניות שלא התבקשה, מדור סיטונאות ואינטגרציה של Instagram.
הקטע היה המהירות: 30+ דקות באתר ושעה ו-20 דקות בסימולציית הפוקר, מה שהפך אותו למודל האיטי ביותר שבו השתמש אותו מבקר. ממצא זה דורש הסתייגות שלא נדרשה ביולי. זה נמדד על תשתית תצוגה מקדימה, על ידי מבקר אחד, על ריצות agentic ארוכות במיוחד. הסרבינג של GA הוא מערכת שונה. אם זה שווה משהו, הטלמטריה של 7 הימים של OrcaRouter עצמו מראה כעת p50 זמן עד לטוקון הראשון של 1.64 שניות עבור Qwen3.8-Max — מדידה של צד ראשון, אם כי TTFT ותפוקה מקצה לקצה על בניות של שעה הם כמויות שונות. העמדה הכנה היא שממצא האיטיות בתצוגה המקדימה צריך להיבדק מחדש במקום לחזור עליו כעובדה עדכנית.
מה שנותר תקף לאחר עדכון 0902 הוא שהראיות החזקות ביותר בכל צד עדיין מגיעות ממקומות שונים. המקום הראשון של Qwen3.8-Max-0902 ב-Code Arena: WebDev הוא תוצאה של הצבעה עיוורת ועצמאית, אבל הוא מודד לוח אחד בלבד, וטבלת ה-benchmark של עליבאבא עצמה נותרה תוצר של הספק — מעבדות AI בוחרות אילו מדדים לפרסם, והנתון החלש ביותר שעליבאבא מדווחת (IFBench 82.8, מעקב אחר הוראות) עדיין מתיישב עם התלונה מתקופת ה-preview, שלפיה המודל עושה יותר מדי ומתעלם מההיקף שנקבע. הראיות לטובת Claude Fable 5 רחבות יותר ורובן מגיעות מגורמי צד שלישי: 62 ב-AA Intelligence Index, מקום 1 בלוח הכללי של Arena, 95.0% ב-SWE-bench Verified — והגרסה החדשה יותר של Anthropic עצמה, Claude Fable 5.1, מובילה את מדד ה-AA עם 66 מאז 1 בספטמבר. באשר לשאלה “איזה מודל יטפל בעבודה שאסור לי לטעות בה” — התשובה לשימוש כללי לא השתנתה. באשר לשאלה “איזה מודל מספק את הפרונט-אנד הטוב ביותר בעשירית מהמחיר” — התשובה התהפכה ב-2 בספטמבר.

פתיחות: הציר שבו Qwen כבר ניצח
Fable 5 לעולם לא יהיה ניתן לאירוח עצמי. Qwen3.8-Max כבר כן: ב-12 באוגוסט המשקלים של Qwen3.8-2.4T-A95B — BF16 וגרסת FP8 רשמית — נחתו ב-Hugging Face וב-ModelScope, מה שהופך אותו ל-Qwen הראשון ברמת Max שכל אחד יכול להוריד. שני הסתייגויות ראויות למשקל שווה.
הראשון חוקי. המהדורה מופצת תחת רישיון מותאם אישית בשם "Qwen3.8-Max", לא תחת Apache 2.0: ספקים שמפעילים עסקי מודל-כשירות או עוזרי עבודה מבוססי בינה מלאכותית עם הכנסות מצטברות של מעל 50 מיליון דולר ב-12 החודשים האחרונים חייבים לנהל משא ומתן על רישיון נפרד מול Qwen, וכל מוצר מסחרי שחוצה 100 מיליון משתמשים פעילים חודשיים או 20 מיליון דולר הכנסות חודשיות חייב להציג את שם המודל. לשימוש פנימי ולסטארטאפים, הספים האלה רק לעתים רחוקות מחייבים — אבל זה לא הפקר.
השני הוא פיזי. מודל MoE עם סך של 2.4T פרמטרים מגיע לכ-4.9TB ב-BF16 (כמחצית בצ'קפוינט הרשמי של FP8), לעומת כ-141GB של זיכרון לכל H200 — כלומר, אירוח עצמי של דגם הדגל מצריך מתלה של מאיצים לפני שניתן לשרת אפילו טוקן אחד. הפרמטרים הפעילים שנחשפו, כ-95B במספרם, לפחות מאפשרים להעריך מה אפשר להשיג עם מתלה כזה. עבור כמעט כל צוות, ה-API המתארח במחיר $2/$6 הוא הדרך המעשית.
זו הסיבה מדוע Qwen3.8-27B, שמשקלי ה-Apache-2.0 שלו פורסמו ב־14 באוגוסט ואשר לפי הדיווחים רץ בכ־17GB של VRAM, נותר המהדורה החשובה מבחינה מעשית לאירוח עצמי. אם הסיבה שלך להעדיף את Qwen על פני Fable 5 היא שייכות נתונים או שליטה על־פרמיסים ולא יכולת גולמית, ה־27B הוא המודל שבאמת מספק את זה — ובשני הצדדים השוואת הפתיחות אינה עוד תיאורטית.
שאלות נפוצות
האם Qwen 3.8 טוב יותר מ-Claude Fable 5?
כעת ההכרעה תלויה בציר, וזהו שינוי אמיתי לעומת אוגוסט. בקוד, Qwen3.8-Max-0902 מוביל: מקום #1 ב-Code Arena: WebDev עם 1,691 Elo לעומת 1,628 של Claude Fable 5, במחיר $2 / $6 לעומת $10 / $50 של Fable 5. באיכות רחבה ומבוקרת, Fable 5 עדיין מוביל: 62 במדד AA Intelligence Index לעומת 56 של Qwen, 95.0% ב-SWE-bench Verified, ומקום #1 בלוח ה-Arena הכללי. לעבודה שבה תשובה שגויה עולה ביוקר, Fable 5 הוא הבחירה המתועדת טוב יותר; לעבודת קוד בנפח גבוה ולעבודת web אוטונומית, ה-Qwen החדש ביותר הוא גם זול יותר וגם מדורג גבוה יותר ב-Arena.
האם הטענה "מגיע רק אחרי Fable 5" נכונה?
המיצוב של עליבאבא נקבע ללא מספרים בלתי תלויים, וגרסת ה-0902 שינתה מאז את פניה. Qwen3.8-Max-0902 מדורגת לפני Claude Fable 5 ב-Code Arena: WebDev (1,691 לעומת 1,628), אך מאחוריו במדד AA Intelligence Index (56 לעומת 62) ובלוח ה-Arena הכללי (Qwen במקום 20 עם Elo 1,479; Fable 5 במקום 1 עם 1,508). לכן, "שני רק ל-Fable 5" הפך ל"לפני Fable 5 בלוח הקידוד שהרענון הזה כיוון אליו, ומאחוריו בלוחות רחבי השימוש הכללי."
כמה זול יותר Qwen 3.8 מאשר Fable 5?
באופן משמעותי, וזה כעת תעריף אמיתי ולא הנחה. Qwen3.8-Max הוא $2 / $6 למיליון טוקנים לעומת $10 / $50 של Fable 5 — זול בערך פי 5 בקלט ופי 8 בפלט. התעריף של Qwen אחיד גם על פני כל הקונטקסט של 1M, וקלט במטמון ב-$0.25/1M הופך עומסי עבודה שבהם הקונטקסט חוזר לזולים עוד יותר.
האם Qwen 3.8 Max עזב את מצב התצוגה המקדימה?
כן. הוא הגיע לזמינות כללית ב-3 באוגוסט 2026 עם כרטיס תעריפים מפורסם ונקודת קצה תואמת OpenAI ו-DashScope. מסע הקרדיטים של Qoder והמסגור של תצוגה מקדימה בהנחה של 90% שהסתובבו ביולי כבר לא מתארים כיצד הדגם נמכר.
האם Qwen 3.8 עדיין המודל האיטי ביותר, כפי שנאמר בביקורות המוקדמות?
ממצא זה הגיע מסוקר אחד על תשתית תצוגה מקדימה שהריצה בניות סוכנות באורך שעה, ויש לבדוק אותו שוב מול שרת GA במקום להתייחס אליו כעובדה עדכנית. הטלמטריה של OrcaRouter ל-7 ימים מראה p50 של 1.64 שניות לזמן עד לטוקן ראשון, אם כי זה מודד חביון לטוקן ראשון ולא תפוקה על בניות ארוכות מאוד.
האם אני יכול לארח בעצמי את Qwen 3.8 במקום לשלם עבור Fable 5?
{{1}}כן לגבי Qwen, עם הסתייגויות.{{/1}} {{2}}Qwen3.8-2.4T-A95B זמין להורדה מאז ה-12 באוגוסט תחת רישיון מותאם אישית (לא Apache 2.0), ו-Qwen3.8-27B תחת Apache 2.0 מאז ה-14 באוגוסט.{{/2}} {{3}}המכשול המעשי הוא החומרה: מודל MoE בהיקף כולל של 2.4T פרמטרים דורש כ-4.9TB ב-BF16 — ראק שלם של מאיצים — כך שרוב הצוותים עדיין ישתמשו ב-API המתארח במחיר של $2 / $6 במקום לשרת את דגם הדגל.{{/3}} {{4}}Fable 5 סגור לצמיתות.{{/4}}
באיזה כדאי לי להשתמש היום?
לעבודה כללית שבה תשובה שגויה היא יקרה — חשיבה קשה, נתיבי ייצור בסיכון גבוה — Claude Fable 5 עדיין הבחירה המתועדת טוב יותר, ו־Anthropic’s Claude Fable 5.1 מרחיב את הפער הזה. לעבודה בנפח גבוה של קוד ולפיתוח ווב אייג'נטי, ל־Qwen3.8-Max-0902 יש כעת יתרון בזירה העצמאית ומחיר פלט נמוך בערך פי 8: סקירת קוד בכמות גדולה, יצירת פרונט־אנד, ניתוח מסמכים ארוכים. צוותים רבים צריכים להריץ את שניהם ולנתב לפי המשימה.
השורה התחתונה
ההשוואה בין Qwen 3.8 ל-Claude Fable 5 שונה מזו שהייתה לפני חודש, ושונה שוב מזו שהייתה לפני שבוע. Qwen3.8-Max הוא מודל זמין לציבור עם תעריף שנמוך מזה של Fable 5 פי 5 על קלט ופי 8 על פלט, קבוע על פני מיליון טוקנים — ומאז 2 בספטמבר אותו שם משמש את גרסת ה-0902, שזירת השוואה עצמאית מדרגת אותה כעת במקום הראשון לפיתוח web אייג'נטי, מעל Fable 5 בלוח זה.
אף מודל כבר לא מחזיק בהשוואה כולה. Claude Fable 5 — וקלוד פייבל 5.1 של Anthropic, שמוביל את מדד ה-AA Intelligence Index עם 66 מאז 1 בספטמבר — מחזיקים בתחום הרחב, המבוקר והכללי, וטבלת אמות המידה של עליבאבא עצמה נותרה תוצר ספק. אבל הסיבה לכך שהתמודדות זו הייתה חד-צדדית ביולי — שלקוון לא היה שופט בלתי תלוי כלל — פגה ב-2 בספטמבר: Qwen3.8-Max-0902 הוא המודל מספר 1 ב-Code Arena: WebDev. התשובה ההגיונית עדיין היא לפצל לפי גובה ההימור והמשימה — Fable 5 להיגיון כללי שבו טעות עולה ביוקר, Qwen3.8-Max לקידוד בהיקף גדול שבו פער המחיר והיתרון בזירה פועלים שניהם לטובתו — ולבחון את שניהם על ההנחיות שלכם.

השוואות במאמר הזה3
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
