
Muse Code: מי מייצר אותו, כמה הוא עולה, ואיזו גרסה היא הנוכחית
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 316 tok/s
- openaiחדשOpenAI: GPT-6 Luna2026-09-2237אינטליגנציה
- openaiחדשOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- anthropicחדשAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- grokחדשGrok 4.72026-09-2146אינטליגנציה
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים · 196 tok/s
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
Muse Code הוא סוכן הקידוד של Meta למסוף ול-CI, שנבנה עבור משפחת המודלים Muse Spark, ושתי הגרסאות שחשובות לכל מי שמגיע לכאן הן Muse Spark 1.3 — הדור הנוכחי, מתאריך 2 בספטמבר 2026 — ו-Muse Spark 1.2, שהיא הגרסה שה-CLI עדיין בוחרת אלא אם תגידו לו אחרת. Muse Code מותקן כ-muse בינארי נייטיבי, פועל באופן אינטראקטיבי או ללא ממשק, ונמכר בשלוש דרכים: שלוש תוכניות חודשיות במחיר $5.00, $15.00 ו-$50.00, וחיוב לפי שימוש בטוקנים ב-Meta Model API בשיעור $1.25 למיליון טוקני קלט ו-$4.25 למיליון טוקני פלט במסלול Standard. עוד דור אחד אחורה, Muse Spark 1.1, עדיין מוצע באותו מסלול ובאותם תעריפים.
יש לקרוא את זה כדף עזר, לא כידיעה חדשותית. Muse Code עצמו אינו דבר חדש לדווח עליו: Meta הוציאה אותו בגרסת בטא ב-5 באוגוסט 2026 והוציאה אותו משלב הבטא ב-31 באוגוסט 2026, והדף הזה משתמש בתאריכים האלה כדי למקם את המודל בזמן, ולא כדי להכריז עליו. ההצדקה לדף היא ביקוש חיפוש מתמשך שמדדנו ממקור ראשון ב-28 בספטמבר 2026, כאשר השאילתה החשופה "muse code" הניבה 4,547 חשיפות ב-28 הימים שקדמו, עם אפס קליקים, והניסוח המסחרי של אותה כוונה — "muse code free", "muse code plan", "muse code plans", "muse code free tier", "muse code 1.3" — הניבו עוד 124 חשיפות, גם כן עם אפס קליקים. הקוראים שואלים ארבע שאלות ספציפיות. הדף הזה עונה עליהן לפי הסדר, מתוך התיעוד של Meta עצמה, ואומר בבירור מתי נתון מגיע מ-Meta ולא ממעריך עצמאי.
אם מה שאתם באמת צריכים הוא סקירה של התנהגות הסוכן, או השוואה ראש בראש מול רתמת קידוד אחרת, זה לא העמוד הזה. כאלה כבר קיימים בבלוג הזה, ואלה ששווים את זמנכם מקושרים בסוף.
מהו Muse Code, ומה יוצר אותו
הגדרת הספק היא משפט אחד: "Muse Code הוא סוכן הקידוד של Meta לטרמינל ול-CI, שנבנה עבור Muse Spark." זה לא ספרייה, לא ממשק צ'אט ולא מודל — זה הרנס. אתה מריץ אותו בתוך תיקיית פרויקט; הוא מתכנן, עורך קבצים ומריץ פקודות כדי להשלים משימה, עם אישורים וסנדבוקס של מערכת ההפעלה פעיל מההרצה הראשונה.
Meta מציגה את Muse Code ואת Meta Model API כשני נתיבים לאותו מודל בסיסי: קראו ל-API ישירות כשאתם בונים סוכן או אפליקציה משלכם, והריצו את Muse Code כשאתם רוצים סוכן קידוד מוכן מראש בשורת הפקודה או בתוך פייפליין. ההבחנה הזו חשובה לתמחור, כי המנוי קונה את ההרנס, ומפתח ה-API מחויב בנפרד לפי טוקן.
ההתקנה היא מתקין של שורה אחת, ושני משטחי הספק לא ממש מסכימים על המחרוזת:
• macOS ו-Linux — curl -fsSL https://dev.meta.ai/install.sh | sh בדף התיעוד, ואותה הפקודה המסתיימת ב-| bash בדף השיווק ובשני פוסטים בבלוג המחקר
• Windows — irm https://dev.meta.ai/install.ps1 | iex, פורסם בעמוד התיעוד בלבד
• אימות — muse --version, ואז muse בתיקיית פרויקט כדי להתחיל מפגש אינטראקטיבי
• הרצה ראשונה — אתה מתבקש לתת אמון בסביבת העבודה (שהיא מה שטוען את המיומנויות, הכללים וההוקים שלה) ולהזדהות, בין באמצעות התחברות בדפדפן ובין באמצעות מפתח API; ב-CI אתה מגדיר META_API_KEY במקום זאת
• שני משטחים — muse עבור ממשק המשתמש האינטראקטיבי בטרמינל, muse exec "<prompt>" עבור הרצה בודדת שאינה אינטראקטיבית עד להשלמה
• הפעל אותו מתוך התוכנית שלך — muse serve מריץ פרוטוקול סשן מגורסן, muse schema מדפיס את סכמת ה-JSON שלו, ו-npm install @muse-code/sdk מתקין את מעטפת ה-TypeScript
הנקודה האחרונה היא החלק שרוב התקצירים מחמיצים. Muse Code אינו רק CLI: פרוטוקול הסשן הוא ממשק מתועד ומנוהל גרסאות, וה-changelog מראה שהוא מורחב במכוון — ניתן לשנות שמות של סשנים דרך הפרוטוקול, לקוחות יכולים לקרוא סיכום diff מובנה עבור כל עריכה, ותוכנית מפעילה יכולה לקבוע ברירת מחדל של מאמץ הסקה ברמת הסשן.

כמה עולה Muse Code, והתשובה הפשוטה לשאלת המסלול החינמי
אין מסלול חינמי. כדאי לומר זאת במפורש, מפני שזו השאלה המסחרית הנפוצה ביותר בנתוני הביקוש, והתשובה חד-משמעית: עמוד המוצר של Muse Code, עמוד המנויים ויומן השינויים אינם מכילים יחד תוכנית חינמית, אין תקופת ניסיון, אין הקצאת קרדיטים חינמית ואין גישה חינמית מוגבלת בקצב.
אזהרה אחת בנוגע לבדיקה הזו. תיעוד התמחור של Meta אכן משתמש במילים "platform free-tier credits" פעם אחת — בהערה על Muse Voice Transcribe, שאומרת שתמלול ללא שמירת נתונים מתומחר בשוויון עם מסלול Standard ושקרדיטים של שכבת החינם בפלטפורמה חלים. Muse Voice Transcribe הוא מוצר נפרד ב-Meta Model API עם חיוב משלו לפי שעה; המשפט הזה לא אומר דבר על Muse Code. אם אתם מוצאים את השורה הזו מצוטטת כראיה למסלול חינם של Muse Code, היא נקראת מחוץ להקשר.
מה שמטא כן מפרסמת הוא שלוש רמות מנוי, כולן בחיוב חודשי, ובנוסף חיוב לפי שימוש בטוקנים עבור כל מה שמעבר למכסת הפרומפטים של המסלול:
• שימוש יומיומי — $5.00 לחודש; גישה לדגמי Muse העדכניים ביותר; 10–50 פרומפטים כל 5 שעות, כולל העלאות תמונות וסרטונים; מצב קולי; חיפוש באינטרנט
• שימוש גבוה — $15.00 לחודש; כל מה שיש בתוכנית Everyday; פי 5 יותר שימוש מ-Everyday; יותר פרומפטים; יותר קלטים מולטימודליים
• Power Usage — $50.00 לחודש; כל מה שבתוכנית High Usage; פי 20 ממכסת השימוש של Everyday; פרומפטים מורחבים; גישה מוקדמת לתכונות חדשות; העלאות קבצים גדולות יותר
• תעריפי טוקנים סטנדרטיים — $1.25 למיליון טוקני קלט, $4.25 למיליון טוקני פלט, $0.15 למיליון טוקני קלט במטמון, עבור muse-spark-1.3, muse-spark-1.2 וmuse-spark-1.1 כאחד
• תעריפי טוקנים של תורמים — $0.10 / $0.20 / $0.002 למיליון קלט, פלט וקלט שמור, עבור muse-spark-1.3-contributor וmuse-spark-1.2-contributor
רמות Standard ו-Contributor נבדלות בדיוק בדרך מהותית אחת, ו-Meta מציינת זאת גם בעמוד המודלים וגם במחירון: ב-Standard, הפרומפטים וההשלמות שלך אינם משמשים לאימון מודלים של Meta; ב-Contributor, הם משמשים. בעמוד המוצר, שורות Contributor מסומנות כ"משמשים לשיפור המוצרים שלנו" ושורות Standard מסומנות כ"לא משמשים לשיפור המוצרים שלנו". Contributor זול יותר בערך פי שנים עשר בקלט ופי עשרים ואחד בפלט, וזה פער גדול מספיק כדי שזו תהיה החלטת ממשל נתונים לפני שהיא החלטת תקציב.
שלושה פרטי תמחור קל לפספס, וכולם כדאי להכיר לפני שקובעים את גודלו של עומס עבודה:
• ללא תוספת מחיר עבור הקשר ארוך — לוח התעריפים של Meta אומר זאת במפורש: משלמים את אותו תעריף בין אם חלון ההקשר ריק ברובו ובין אם הוא כמעט מלא, דבר יוצא דופן שמשנה באופן מהותי את הכלכלה של הרצות סוכנים ארוכות
• עיגון חיפוש באינטרנט מחויב בנפרד — $2.50 לכל 1,000 שאילתות חיפוש בנוסף לעלות הטוקנים של הבקשה, והוא חל על מודלים טקסטואליים כגון Muse Spark
• מגבלות הקצב הן לפי צוות, לא לפי מפתח — 3,000 בקשות ו-4,000,000 אסימונים לדקה ב-Standard, 100 בקשות ו-3,000,000 אסימונים לדקה ב-Contributor; שימוש במספר מפתחות בתוך צוות אחד אינו מכפיל את המכסה
מנגנון המנויים מתועד בעמוד המנויים של Meta והוא מקובל: שדרוג מחושב באופן יחסי ונכנס לתוקף באופן מיידי, שנמוך נכנס לתוקף במחזור החיוב הבא, ביטול מחייב לפחות 24 שעות לפני תאריך החיוב, ואין החזרים כספיים עבור מנוי שבוטל אלא במקרים שבהם החוק מחייב בכך. המנויים מכסים באופן ספציפי את אישור הגישה של Muse Code CLI; מפתחות API נוספים מחויבים בתשלום לפי שימוש.

איזו גרסה היא הנוכחית: 1.2.1, Muse Spark 1.3, וברירת המחדל שאינה אף אחת מהן
זו השאלה שנתוני הביקוש מדברים עליה בקול הכי רם — השאילתה "muse code 1.3" בכלל קיימת — וזה באמת מבלבל, כי "הגרסה" יכולה להתכוון לשלושה דברים שונים, ו-Muse Code מפרסמת את שלושתם.
• גרסת ה-CLI — 1.2.1 היא הנוכחית. יומן השינויים של Meta מפרט את הגרסאות שלה כ-1.2.1, 1.1.1, 0.2.1 ו-0.1.0, כאשר האחרונה מסומנת כ"גרסת השקה"
• דור המודל — Muse Spark 1.3, שהוכרז ב-2 בספטמבר 2026 ותואר בעמוד המודלים של Meta כ"הגרסה האחרונה … מומלץ לעבודה חדשה"
• מודל ברירת המחדל של ה-CLI — muse-spark-1.2, כפי שמצוין בקטע ההרצה הראשונה בתיעוד ושוב תחת בחירת מודל בעמוד התצורה
אז התקנה חדשה של Muse Code 1.2.1 תריץ את Muse Spark 1.2 אלא אם תעביר --model muse-spark-1.3 או תחליף באמצע סשן עם /models. דפי ה-Quickstart של Meta עצמה משתמשים ב-muse-spark-1.3 בכל דוגמת API, מה שמקל לטעות בקריאת הפיצול יותר מכפי שצריך: דוגמאות ה-API וברירת המחדל של ה-CLI לא מצביעות על אותו מודל היום.
יומן השינויים של 1.2.1 מתאר מה השתנה בהארנס ולא במודל, והפריטים המרכזיים הם:
• קלט קולי מופעל כברירת מחדל ב-macOS, מוקצה ל-Option+V ומנוהל באמצעות /voice
• פקודת /rewind שמחזירה את השיחה לקלט מוקדם יותר, תוך שיתוף הבורר המשמש בלחיצה כפולה על double-Esc
• [תמונה #N] תוויות על תמונות שהודבקו או נגררו, כך שניתן לשאול את המודל על תמונה מסוימת לפי מספר, כאשר התוויות ונתיבי המקור נשמרים גם לאחר המשך, חזרה לאחור ופיצולים
• מיומנות migrate מצורפת שמייבאת הערות זיכרון והגדרות שרת MCP מ-Claude Code או Codex אל Muse Code
• /mcp לקבלת מלאי בזמן אמת של שרתי MCP מחוברים והכלים שלהם
• הפעלות חדשות נפתחות בפרופיל ההרשאות Auto-review, שמעניק את אותה גישה כמו "Ask me" אך מנתב בקשות אישור זכאיות לסוקר אוטומטי, ובמקרה שהסוקר אינו זמין — חוזר לשאול אותך
• תיקוני אבטחה, שלושה מהם התנהגותיים ולא קוסמטיים: פקודות שמופעלות דרך עטיפות כגון env ו-setsid נבדקות כעת כפקודה שהן מפעילות בפועל; שינוי מצב הרשאה באמצע סשן חל על כלים שכבר פועלים בפעולה הבאה שלהם; ופרופיל ההרשאה Unrestricted מתנהג כעת בדיוק כמו --yolo
בצד המודל, ההודעה מ-2 בספטמבר מבהירה במפורש ש-Muse Spark 1.3 אומן על פני מערך מגוון של הרנסים, ושהיה זה דרג החשיבה — "Muse Spark 1.3 עם חשיבה מקסימלית זמין כעת ב-Muse Code וב-Meta Model API" — ולא מודל הבסיס בלבד שמטה קידמה. פוסט ההשקה של Muse Spark 1.2 מ-5 באוגוסט מוסיף את החצי השני של הסיפור: Muse Spark 1.2 אומן במשותף עם Muse Code עצמו, תוך שימוש בטרייִקטוריות של הרנסים שנדגמו בשיטת rejection sampling, לצד עבודת מתכון על מטרות, קומפקציה וסוכני משנה, כאשר ערכת הכלים של Muse Code שולבה כדי למקסם את תאימות ההרנס. המודל וההרנס פותחו זה מול זה.
המעטפת: הקשר, מודאליות, פלטפורמות
Muse Spark 1.3, Muse Spark 1.2 ו-Muse Spark 1.1 חולקים כולם מעטפת אחת, ו-Meta מציינת זאת בשורת טבלה אחת: 1,048,576 אסימוני הקשר, עם טקסט, תמונה, וידאו, אודיו ו-PDF כקלטים וטקסט כפלט היחיד, בכל דרגה ובכל גרסה.
שוויון בין מודאליות, עם הסתייגות אחת שמפורסמת כהערת שוליים וכדאי לחזור עליה ולא לקבור אותה: תוכן אודיו ב-Muse Spark 1. אינו נתמך במלואו, ואיכות התגובות לבקשות שכוללות תוכן אודיו עשויה להיות; ההנחיה של Meta עצמה היא להשתמש ב-Muse Spark 1.2 לאודיו, או ב-Muse Voice Transcribe עבור דיבור-לטקסט ספציפי. בשורת הפקודה זה ישים — -- muse-spark 1 הוא דריסה מתועדת, וברירת המחדל כבר מפנה לשם.
מאמץ החשיבה הוא הגדרה ברמת ההרנס עם שמונה רמות, ועמוד התצורה של Meta מכנה אותן לפי הסדר: none, minimal, low, medium, high (ברירת המחדל), xhigh, max ו-ultra. שלושה פרטים ברשימה הזו הם קריטיים:
• max היא רמת החשיבה העמוקה ביותר, המתוארת כחשיבה מורחבת מעבר ל-xhigh, ו-Muse Code מציעה אותה הן במסלול Standard והן במסלול Contributor
• ultra הוא הגדרה בצד הלקוח ולא שכבת מודל: הוא ממופה לרמת החשיבה הגבוהה ביותר שכל ספק תומך בה, ויכול לגרום ל-Muse Code להאציל באופן אגרסיבי יותר, ובמקרים שבהם ספק אינו תומך בו, בקשה של ultra פועלת ב-xhigh
• ספק Meta אינו מקבל את האפשרות ללא, ולכן הרמה הנמוכה ביותר זמינה רק דרך ספקים אחרים המוגדרים בהארנס
תמיכת הפלטפורמות היא המקום שבו שני המשטחים של Meta חלוקים, והמחלוקת קטנה אך אמיתית. עמוד התיעוד אומר ש-Muse Code פועל על macOS, Linux ו-Windows מבסיס קוד אחד, ומפרט שלוש התנהגויות ייחודיות ל-Windows: PowerShell מחליף את Bash, כך שפקודות שמופעלות על ידי הסוכן משתמשות בתחביר של PowerShell ובכלי שורת הפקודה של Windows; ה-sandbox עשוי לבקש אישור מנהל, ו-Windows יכול להציג בקשת User Account Control בפעם הראשונה שה-sandbox מאותחל, אם כי שימוש רגיל אינו דורש הרצה כמנהל; ושתי יכולות אינן זמינות ב-Windows — קלט קולי והודעות סשן, ששתיהן פועלות ב-macOS וב-Linux. לעומת זאת, עמוד המוצר אומר רק "זמין עבור MacOS ו-Windows." שתי ההצהרות מגיעות מהאתר של Meta עצמו היום; כשקוראים אותן יחד, הן אומרות שיש תמיכה ב-Windows עם פערים מתועדים, ושיש תמיכה ב-Linux למרות שעמוד השיווק אינו מזכיר אותה.
עוד ניואנס זמינות מגיע מהמסמכים ולא מחומר השיווק: Workflows — תזמור הסוכנים המקביל והמדורג — מתאמים עבודה רק כאשר ה-build המותקן כולל את מנוע ה-workflow וה-rollout מופעל, ו-Meta אומרת בפשטות שהם "לא זמינים בכל build או פלטפורמה". אם תכונת workflow היא הסיבה לכך שאתה מתקין, בדוק שה-build שלך כולל אותה במקום להניח שהיא קיימת.
מה Meta טוענת, כשמצוינים ה-harness והמאמץ
Meta מפרסמת חומרי בנצ'מרק, ולכן הניסוח ההוגן כאן אינו "אין בנצ'מרקים של ספקים" — אלא "אלה בנצ'מרקים של ספקים, כאשר תנאי ההשוואה מפורטים במקום שבו Meta מציינת אותם."
הטענה הכמותית היחידה ש-Meta מציגה בפרוזה נמצאת בהכרזה על Muse Spark 1.3, והיא מיוחסת להשוואה פנימית ולא להערכה של צד שלישי: "בהשוואות שערכו מהנדסי Meta, הוא הוכח כמהיר ויעיל באופן משמעותי יותר, תוך שימוש בכ-20% פחות קריאות לכלים ובכ-25% פחות טוקנים." קו הבסיס מצוין — ביחס ל-Muse Spark 1.2 — ורמת המאמץ נמצאת בניסוח של ההכרזה עצמה, שכן הגרסה מכותרת סביב Muse Spark 1.3 עם חשיבה מקסימלית. מה שלא מצוין הוא מערך המשימות, מספר ההרצות, או תצורת ההרנס מעבר לעובדה שמדובר ב-Muse Code. התייחסו לשתי האחוזים ככיוון התקדמות שדווח על ידי הספק, ולא כתוצאת בנצ'מרק מדודה.
התוצאה האחרת שפורסמה היא מחקר מקרה ולא ציון, והיא המעניינת יותר מבין השתיים. Meta מדווחת על בדיקה של יכולתו של Muse Spark 1.2 לבצע אופטימיזציה איטרטיבית של קרנלי GPU לאורך יותר מ-1,000 קריאות כלי ועד 24 שעות, תוך שימוש בסביבת הקידוד האייג'נטית של Muse Code כדי לכתוב, לקמפל, לבצע פרופיילינג ולשפר בהדרגה את ביצועי הקרנלים ביחס לבסיס ייחוס שסופק. עומס העבודה נקוב בשם — קרנלי KDA ו-MLA על NVIDIA Hopper GPUs — וכך גם המגבלה: ספריות קרנלים של צד שלישי כגון FLA נאסרו, ובסיס הייחוס היה מימוש של Triton FLA KDA. ריצה בת 24 שעות עם אלף קריאות כלי היא סוג אחר של ראיות מאשר אחוז במדד ביצועים. היא מעידה משהו על סיבולת תחת מטרה ארוכת טווח ומעט מאוד על איכות השוואתית.
תרשימי ההשקה גם של Muse Spark 1.2 וגם של Muse Spark 1.3 משרטטים את המודלים האלה מול קבוצה קטנה של מתחרים נקובים בהערכות של סוכנים, קידוד, ביצוע הוראות והקשר ארוך — DeepSWE v1.1, SWE-Atlas-QnA, Terminal-Bench 2.1 ו-4.0, tau2-bench, GDPval, SciCode, IFBench, MultiChallenge ו-AA-LCR v1.1 מופיעים בין הצירים. תרשימים אלה הופקו על ידי הספק ושורטטו על ידי הספק, ותצורות המתחרים שבהם הן בחירה של Meta, ולא פאנל נייטרלי. איננו משחזרים כאן את ערכי העמודות מהסיבה הזו: תרשים ספק הנקרא כלוח מובילים הוא בדיוק מצב הכשל שהעמוד הזה נועד למנוע.
שני פערים כנים ראויים לציון במקום לטשטש:
• Meta אינה מפרסמת השוואה ראש בראש בין Muse Code ל-Muse Spark 1.2 במאמץ תואם על מערך משימות נקוב; הנתון של ~20%/~25% הוא הדבר הקרוב ביותר, והוא השוואה פנימית עם פערי יעילות מוצהרים ולא ציונים
• Meta אינה מפרסמת הערכת חביון בזמן אמת של ה-CLI, ואף אחד מהמספרים שפורסמו אינו מתאר איך מרגיש סשן תחת עומס עריכה אמיתי
מה ש-Artificial Analysis מודדת באופן עצמאי
Artificial Analysis היא המעריכה הבלתי תלויה שמפרסמת כיום מדד של סוכני קידוד המכסה את Muse Code, וזהו סוג אחר של מספר מכל מה שלמעלה: השורות הן זוגות של רתמה ומודל, שמוערכים על ידי AA ולא על ידי הספק.
ב-Artificial Analysis Coding Agent Index — הדף מזהה את עצמו בנתונים המובנים שלו כ-v1.5 — שורות Muse Code מציגות:
• Muse Code פועל עם Muse Spark 1.3 בהנמקה מקסימלית — 54.3
• Muse Code פועל עם Muse Spark 1.3 ברמת חשיבה xhigh — 48.3
• החלק העליון של אותו לוח — Claude Code מריץ את Claude Opus 5.5 ברמת חשיבה מקסימלית, ב-66.0
שני דברים בנוגע לנתונים האלה חשובים יותר מהנתונים עצמם. ראשית, הפער של 5.0 נקודות בין שורות ה-max ל-xhigh הוא אותו מודל באותה מערכת הרצה, כשהגדרה אחת שונתה, וזו תזכורת מועילה לכך ש"ציון Muse Code" אינו מוגדר דיו אלא אם כן מציינים את רמת המאמץ. שנית, הלוח הזה הוא מדידה שונה מזו שצוטטה בסיקור שלנו מספטמבר של Muse Spark 1.3: המאמר הקודם ציטט 68 עבור Muse Spark 1.3 ב-max, 64 ב-xhigh, ו-68 עבור Claude Opus 5 ב-xhigh. המספרים האלה כבר לא מופיעים בלוח החי — השורה העליונה הנוכחית היא Claude Opus 5.5 ב-max עם 66.0, ושורות Muse Code מציגות 54.3 ו-48.3. האינדקס שונה והרכב המשתתפים השתנה. אם אתם מחזיקים את הנתונים הישנים, הם הוחלפו, ואסור לצטט את שתי הקבוצות זו לצד זו כאילו היו אותה מדידה שנלקחה פעמיים.
עמוד המודל של AA עבור Muse Spark 1.3 הוא שוב משטח נפרד, והנתונים שלו עצמם נמדדים על ידי AA ולא מדווחים על ידי הספק: מדד Intelligence Index של 48.09, Terminal-Bench 2.1 עם 84.3%, GPQA Diamond עם 93.5%, HLE עם 48.7%, SciCode עם 58.8% וריקול בהקשר ארוך עם 83%, עם תאריך שחרור 2026-09-02, חלון הקשר של 1,000,000 טוקנים וסיווג כקנייני ובעל משקולות סגורות. שים לב שזהו עדכון מדד אחד בעמוד מודל אחד — AA מפרסמת מדדים לפי מודל שמתעדכנים לפי לוח זמנים משלהם, ולכן ערבוב נתון מהעמוד הזה עם נתון מעמוד של מודל אחר לא נותן לך השוואה באותה תמונת מצב.
מה ששום דבר מזה לא נותן לך הוא השוואה מותאמת. שורות הקידוד של AA חוצות הרנסים מעצם בנייתן — Muse Code מול Codex, מול Claude Code, מול Grok Build, מול Kimi Code CLI — כך שקריאה של שורה מול שורה משווה צמד הרנס-מודל לצמד הרנס-מודל אחר, ולא שני מודלים תחת הרנס אחד. במקום שבו Meta לא ביצעה את ההשוואה המותאמת וללוח של AA אין מבנה שמאפשר לענות עליה, העמדה הכנה היא שהעימות הישיר אינו קיים במאמץ ובהרנס תואמים, במקום לבנות אותו ממספרים סמוכים.
מה OrcaRouter מנתב, ומה הוא לא מנתב
OrcaRouter הוא נקודת קצה אחת המכסה למעלה מ-200 מודלים במחיר המחירון של כל ספק ללא תוספת, מה שאומר שתשובת הזמינות למשפחה הזו ניתנת לבדיקה ולא עניין של מדיניות. נבדק מול רשימת המודלים הציבורית החיה שלנו היום:
• meta/muse-code — אינו בקטלוג. Muse Code הוא רתמת הרצה, לא מודל שניתן לנתב, ואיננו מגישים אותו
• meta/muse-spark-1.3 — לא בקטלוג
• meta/muse-spark-1.2 — ניתן לניתוב, עם חלון הקשר של 1,048,576 טוקנים ותמחור של $1.25 למיליון טוקני קלט, $4.25 למיליון טוקני פלט ו-$0.15 למיליון קריאה מהמטמון, אותם תעריפים שמפרסמת Meta
• meta/muse-spark-1.1 — גם ניתן לניתוב, באותם שלושה תעריפים
אז הצורה המעשית של זה ב-OrcaRouter היא שאתה יכול להגיע לדורות Muse Spark ששוחררו דרך אותו endpoint שבו אתה משתמש לכל דבר אחר, ואתה לא יכול להגיע ל-Muse Code או לדור 1.3 הנוכחי דרכו. קרא את זה כתיאור של הקטלוג של היום ולא יותר מזה; הזמינות משתנה ורשימת המודלים היא המקום לבדוק אותה.

המקום שבו ראוטר מצדיק את עצמו עבור עומס עבודה כזה הוא בשני הדברים שמנוי לא יכול לספק לך. הראשון הוא שמפתח API יחיד הוא שכבת ניתוב שמעבירה בקשה אוטומטית לספק חלופי כאשר ספק מתדרדר, מה שחשוב כשהרצה של סוכן נמצאת בעומק של אלפי קריאות כלים ואתה מעדיף שלא לאבד אותה בגלל ספק במעלה הזרם אחד שחווה אחר צהריים רע. השני הוא שהבקשה מתוארת ולא מקודדת קשיח — אפשר להציב את Muse Spark 1.2 מאחורי אותו DSL ניתוב כמו כל מודל אחר ולשנות מה משרת אותה בלי לשנות את הלקוח שלך.
נשאל לעתים קרובות
האם מודל ברירת המחדל של ה-CLI הוא המודל הנוכחי? לא. ברירת המחדל של Muse Code היא muse-spark-1.2; הדור הנוכחי הוא Muse Spark 1.3, שהוכרז ב-2 בספטמבר 2026, ואפשר להגיע אליו עם --model muse-spark-1.3 או עם הפקודה /models.
איזה ניסוח נכון — "Muse Code 1.3" או "Muse Spark 1.3"? Muse Spark 1.3. גרסאות Muse Code הן מהדורות של ה-harness והגרסה הנוכחית היא 1.2.1; שתי סדרות המספור אינן קשורות זו לזו, וזו בדיוק הסיבה שהשאילתה "muse code 1.3" מחזירה תוצאות מבולבלות.
אם אני צריך רק קלט אודיו, איזה מודל עליי להגדיר? Muse Spark 1.2. בהערת שוליים של מטא עצמה נאמר שהבנת אודיו ב-1.3 אינה נתמכת במלואה ועשויה לפגוע באיכות התגובה, והיא מפנה עבודה עם אודיו ל-1.2 או ל-Muse Voice Transcribe.
האם מסלול Contributor הוא מסלול חינמי או ניסיוני? לא, וזו גם לא הנחה שמקבלים אוטומטית. זוהי גרסה במחיר נמוך יותר בכל גרסה של Muse Spark מ-1.2 ואילך, בתמורה להרשאה לאמן על הפרומפטים וההשלמות שלך; לדור 1.1 אין גרסת Contributor.
השורה התחתונה
Muse Code הוא סוכן הקידוד הטרמינלי וה-CI של Meta, שפותח על ידי Meta עבור מודלי Muse Spark שלה, ונמכר בשלוש תוכניות חודשיות ב-5.00$, 15.00$ ו-50.00$, ללא מסלול חינמי, בגיבוי תעריפי Standard בתשלום לפי שימוש של 1.25$ עבור קלט ו-4.25$ עבור פלט למיליון טוקנים, ותעריפי Contributor של 0.10$ ו-0.20$ עבור אותם טוקנים אם תאפשרו ל-Meta להתאמן עליהם. גרסת ה-CLI הנוכחית היא 1.2.1, דור המודל הנוכחי הוא Muse Spark 1.3, וה-CLI עדיין משתמש כברירת מחדל ב-Muse Spark 1.2 — ציינו את הגרסה ואת מאמץ החשיבה בכל פעם שאתם מצטטים ציון, כי הרצת Muse Code את Muse Spark 1.3 ב-max וב-xhigh אינה אותה מדידה, והטענה המרכזית של הספק בדבר יעילות היא השוואה פנימית ולא תוצאה בלתי תלויה.
למבט מעשי על ההרנס עצמו, ראו את הסיור שלנו בסוכן הקידוד הטרמינלי Muse Code.
השוואות במאמר הזה3
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
