
Qwen3.8-27B לעומת Meta Muse Glimmer: מרוץ הסוכנים המקומיים, צד אחד כבר כאן
- z-aiחדשZ.ai: GLM 5.32026-08-1860אינטליגנציה75כתיבת קוד
- obsidianחדשQwen3.8 27B2026-08-1552אינטליגנציה68כתיבת קוד
- qwenחדשQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekחדשDeepSeek: DeepSeek V4 Pro 08132026-08-1253אינטליגנציה69כתיבת קוד
- grokחדשSpaceXAI: Grok 4.62026-08-1261אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0557אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0358אינטליגנציה72כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463אינטליגנציה78כתיבת קוד
- googleGoogle: Gemini 3.6 Flash2026-07-2152אינטליגנציה69כתיבת קוד
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137אינטליגנציה49כתיבת קוד
- metaMeta: Muse Spark 1.12026-07-1653אינטליגנציה71כתיבת קוד
- kimiMoonshotAI: Kimi K32026-07-1560אינטליגנציה76כתיבת קוד
- openaiOpenAI: GPT-5.6 Luna2026-07-0952אינטליגנציה71כתיבת קוד
- openaiOpenAI: GPT-5.6 Terra2026-07-0957אינטליגנציה77כתיבת קוד
- openaiOpenAI: GPT-5.6 Sol2026-07-0961אינטליגנציה77כתיבת קוד
- grokxAI: Grok 4.52026-07-0856אינטליגנציה72כתיבת קוד
Meta Muse Glimmer שוחררה ב-10 באוגוסט 2026 — Apache 2.0, כ־30 מיליארד פרמטרים, מכוונת ישירות לעומסי עבודה מקומיים של סוכנים — והמודל שכמעט בוודאות יהיה המתחרה הקרוב ביותר שלה עדיין לא יצא. Alibaba הכריזה על Qwen3.8-27B ב־3 באוגוסט כמודל הניתן לאירוח עצמי בדור Qwen3.8, הבטיחה את המשקלים הפתוחים שלו לשבוע של 10 באוגוסט, ונכון לכתיבת שורות אלו המאגר הרשמי עדיין לא הופיע. זה הופך את ההשוואה לחד־צדדית במכוון: צד אחד אמיתי וניתן להורדה היום, והצד השני עדיין לא אומת. וזו בדיוק הסיבה שכדאי לכתוב על כך עכשיו — Meta בנתה את טבלת מדדי הביצועים של Glimmer מול קודמו של ה־27B, כך שהקרב כבר ממוסגר לפני שה־27B קיים.
המפגש במבט חטוף
שני הדגמים רודפים אחר אותו קונה: מי שרוצה יכולת סוכנות וקידוד כמעט ברמת דגל על חומרה שבבעלותו, לא על API. הממדים מסתדרים כך, כשהצד של Qwen מסומן כלא מאומת בכל מקום שבו המאגר טרם אישר זאת:
• סטטוס — Meta Muse Glimmer זמין כעת לעומת Qwen3.8-27B הוכרז, המשקלים בהמתנה.
• גודל — Glimmer הוא ~29.6B בסה"כ (27.9B מפענח טקסט + 1.9B מקודד ראייה) לעומת ~27B של ה-27B, הארכיטקטורה לא אושרה.
• רישיון — Apache 2.0, המכסה משקלים, קוונטיזציות, דראפטר ומקודד, לעומת רישיון שלא הוכרז, כשסעיף ה-100M-MAU של Tongyi Qianwen הוא אפשרות ממשית.
• הקשר — Glimmer תומך בחלון של 128K טוקנים לעומת ההקשר של 27B, לא אומת.
• מודאליות — Glimmer מקבל קלט טקסט ותמונה באמצעות מקודד תפיסה, בניגוד ל-27B, שככל הנראה הוא טקסט-ראשון, לא מאושר.
• טביעת רגל מקומית — Glimmer רץ בכ־17 GB בהגדרת ה־4-bit K-Quant-17GB שלו, לעומת כ־17 GB משוערים ב־Q4_K_M עבור ה־27B.
• טכנולוגיית מהירות — Glimmer מציעה פענוח ספקולטיבי DFlash (Meta מדווחת על 74.9 עד 233.4 tokens/s על RTX 5090, קפיצה של פי 3.1) לעומת ה-27B, שעדיין אין טענות כאלה לגביו.
למה Meta כיוונה לכאן
Muse Glimmer היא גרסה מזוקקת ומקוונטזת של דגם הדגל הסגור של Meta, Muse Spark 1.2, ששוחררה על ידי Meta Superintelligence Labs וכווננה במיוחד עבור סוכנים תמיד-פעילים על המכשיר: קריאה לכלים, חשיבה רב-שלבית, התאוששות מכישלון וניסיון חוזר, הבנה משולבת של טקסט ותמונה, ויותר מ-100 שפות. הנתונים של Meta עצמה מציבים אותו לפני משפחת Gemma 4 ולפני Qwen3.6-27B בכמה מבחנים אגנטיים — MCP Atlas 75.5, DeepSearch QA 74.6, SWE-Bench Pro 51.2 — וקצת מאחור בכמה אחרים. כל זה מבוסס על דיווחי יצרן ולא שוחזר באופן בלתי תלוי, וראוי לומר זאת במפורש: בבנצ'מרקים האגנטיים ש-Meta בחרה, Glimmer מקדים את דור ה-Qwen הקודם, ובאלה שלא בחרה, Qwen עדיין מוביל.
שני דברים הופכים את Glimmer לבולט מעבר לציונים. ראשית, הרישיון: Apache 2.0, ללא סעיף MAU, ללא סף דיון מסחרי — הדבר הגמיש ביותר שמטה שחררה מזה זמן רב, והמאמר הנלווה של צוקרברג הפך את ההימור האסטרטגי למפורש. שנית, ערכת הכלים מהיום הראשון: llama.cpp, Hugging Face Transformers, Ollama, LM Studio ו-SGLang כולם השיגו תמיכה בזמן ההשקה או בסמוך לו, וזה בדיוק מה שמודל מקומי צריך כדי להיות שמיש ולא רק ניתן להורדה.

Meta כבר בחרה את היריב.
העובדה השימושית ביותר במהדורה של Glimmer להשוואה זו היא מול מי Meta ערכה בנצ'מרק: Qwen3.6-27B, קודמו הישיר של Qwen3.8-27B. בטבלה של Meta עצמה, Glimmer גוברת במעט על Qwen 27B ב-SWE-Bench Pro (51.2 vs 50.2) ומפגרת אחריו ב-SWE-Bench Verified (76.0 vs 77.2), ו-Qwen מובילה ב-OSWorld-Verified, Terminal-Bench 2.1, וברוב המדדים המולטימודאליים. במילים אחרות, שתי המשפחות מחליפות מכות בקנה המידה המקומי של 27–30B, והדור ה-3.8 בצד של Qwen הוא ההמשך המדויק של המודל שבו Meta השתמשה כנקודת הייחוס. זו הכותרת האמיתית של ההתמודדות הזו: ה-27B אינו מתחרה היפותטי של Glimmer, אלא הגרסה הבאה של המובילה המכהנת, ו-Meta כבר אמרה לנו כמה קרובה נקודת הבסיס.
מה עדיין לא מאומת בצד של Qwen?
עד שהמאגר יתווסף, העמודה של Qwen3.8-27B מלאה ברובה בסימני שאלה: האם הוא דחוס או MoE, חלון ההקשר שלו, האם הוא מולטימודלי, ובאופן קריטי, הרישיון שלו. שאלת הרישיון היא זו שיכולה להכריע את ההשוואה הזו לבדה — מודל ברישיון Tongyi Qianwen הוא החלטת רכש שונה ממודל ברישיון Apache 2.0, במיוחד עבור מוצרים מסחריים שמעבר לסף ה-MAU. עדיין אין אף אחד מציוני ה-benchmark של ה-27B, והמספרים שדיווח היצרן עבור דור ה-3.8 הרחב שייכים ל-Max, לא ל-27B.

איזה אחד לבחור?
אם אתה צריך מודל סוכן מקומי שעובד היום, ההחלטה מתבקשת מאליה: Meta Muse Glimmer קיים, רץ על כרטיס של 24 GB, יש לו תמיכת ריצה מהיום הראשון, והוא Apache 2.0. Qwen3.8-27B הוא הבטחה. אם המערכת האקולוגית של Qwen היא כבר הסטנדרט שלך, או שהדרישה שלך היא אמת מידה ספציפית שהדור 3.8 צפוי לשפר, ה-27B שווה לחכות לו — אבל להמתנה יש עלות הזדמנות אמיתית, והרישיון יכול לשנות את התשובה שלך אחרי שהוא יוצא.
צוותים שלא רוצים לא להמתין ולא להינעל מוצאים נתיב ביניים. OrcaRouter מנתב יותר מ-200 מודלים דרך API אחד במחיר המחירון של הספק, ללא תוספת מחיר ועם מעבר אוטומטי לגיבוי — Qwen3.8 Max זמין בו היום ב-$2.00/$6.00 למיליון טוקנים, וקו Muse Spark הסגור של Meta עצמה נגיש דרך אותו מפתח. כשהמודל 27B יושק ויזכה לאמון במדדים בלתי תלויים, מעבר אוטומטי הוא הדרך לנסות אותו מול עומס ייצור בלי להמר את כל הנתיב על מודל לא מוכח: ניתבו אליו חלק מהתעבורה, השאירו את השאר על המודל הקיים, ותנו לשימוש אמיתי להכריע.

אף צד לא עבר ביקורת עצמאית עדיין — המספרים של Glimmer הם של Meta, ול-27B אין מספרים בכלל. הציון הכנה אחרי השבוע הראשון: Glimmer הוא המודל שאפשר באמת להריץ, ה-27B הוא זה שתשוו אליו בעוד חודש, וקובץ הרישיון, לא טבלת האמות מידה, הוא הדבר שסביר ביותר שיכריע את החלטת הצוות.
השוואות במאמר הזה1
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
