כרטיס כותרת ראשי למאמר 'Claude Fable 5 כמתזמן שלך', המציג צומת מרכזי של Claude Fable 5 המתפצל לארבעה צמתי עובדים משניים קטנים יותר של Opus 5, עם כתובית המשנה 'מדריך תת-סוכנים של Claude Code להורדת עלויות טוקנים', ולוגו OrcaRouter המשולב בפינה.
Guides & Insights

Claude Fable 5 כמתזמר שלך: ספר המהלכים לתת-סוכנים ששומר על עלויות טוקנים נמוכות

מחבר

Rowan Sterling

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

ב-7 באוגוסט, Anthrop​ic ביצעה את השינוי הבודד הגדול ביותר ב-Claude Fable 5 מאז שהמודל הושק ב-9 ביוני: היא קיצצה בכ-85% את ה-fallbacks הקשורים לביולוגיה, כך ששאלות יומיומיות בנושאי בריאות וחינוך מקבלות כעת תשובה ישירה במקום לעבור בשקט למודל חלש יותר. עם זאת, לדפוס שבפועל מתפשט בקהילת Claude Code השבוע אין שום קשר לביולוגיה. אנשי מקצוע ממשיכים לפרסם זרימת עבודה שבה Claude Fable 5 מריץ את לולאת התזמור — הבהרת דרישות, פירוק תוכנית, שיגור משימות, קבלת תוצאות — בעוד שהביצוע מועבר לתתי-סוכנים של Claude Opus 5. התועלת המוצהרת: Fable 5 High הופך לברירת מחדל במחיר סביר לסשן, והארכנות של Claude Opus 5 מפסיקה לרוקן את הסשן.

הדוגמה האחרונה היא של @dotey, שפורסמה ב־14 באוגוסט: תוספת קצרה ל־~/.claude/CLAUDE.md שאומרת לסוכן לפתוח סוכני משנה של Opus לצורך ביצוע, ולהשאיר את Claude Fable 5 במאמץ חשיבה גבוה כברירת המחדל של הסשן, כשהכותב מדווח שצריכת הטוקנים נשארת סבירה — וסיבה בוטה לא להריץ את Claude Opus 5 כברירת מחדל: בידיים שלו הוא היה איטי מדי ושרף מספר עצום של טוקנים בלולאה הראשית. זה ממצא של הקהילה, לא הנחיה של Anthrop​ic — וכדאי להבין אותו לפני שמעתיקים, כי על הנייר זה נראה הפוך.

התבנית בפסקה אחת. ב-Claude Code, תת-סוכנים יורשים כברירת מחדל את מודל הסשן שלך, כך שהדרך לשמור על לולאה מהירה וזולה היא להפוך את מודל הסשן למתכנן ולכוון את המבצעים למודל אחר במפורש. Claude Fable 5 — המודל מסוג Mythos של Anthrop​ic שהופך לבטוח לשימוש כללי, שוחרר ב-9 ביוני 2026, במחיר של $10/$50 למיליון טוקנים — מחזיק בדרישות, מפרק את העבודה, שולח משימות ומקבל תוצאות. Claude Opus 5 — שוחרר ב-24 ביולי 2026, במחיר של $5/$25 למיליון טוקנים — מריץ את היישומים בפועל בתוך תת-סוכנים. אתה משקיע שיפוט ברמת Fable במעט תורות התיאום ורמת ביצוע ברמת Opus בתורות הביצוע הרבות, שבהן כבר הולך עיקר הטוקנים.

מדוע מודל הלולאה הראשית הוא בעיית העלות האמיתית

במדדים, זה נראה כמו בעיה פתורה — והתשובה נראית כמו "ברירת מחדל ל-Opus 5." המספרים של Anthrop​ic עצמו (מדווחי ספק, לא משוכפלים) מציבים את Claude Opus 5 לפני Claude Fable 5 במדד הקידוד הסוכני Frontier-Bench v0.1 (43.3% לעומת 33.7%), ב-SWE-bench Verified (96.0% לעומת 95.5%), וב-ARC-AGI-3 (30.2%, בערך פי 4 מהמודל הציבורי השני הטוב ביותר). Anthrop​ic ממקמת את Opus 5 כמתקרב לאינטליגנציית החוד החנית של Fable 5 בחצי המחיר. אם תבחר ברירת מחדל לסשן אך ורק לפי מדדי ספק ומחיר לכל טוקן, Opus 5 הוא הבחירה המובנת מאליה.

מתרגלים שמנהלים בפועל סשנים ארוכים מגיעים לברירת המחדל ההפוכה, והסיבה היא אסימונים למשימה, לא מחיר לאסימון. החשיבה של Opus 5 מופעלת כברירת מחדל והיא אדפטיבית, ו-Anthrop​ic מצהירה שהיא מאמתת את העבודה שלה ללא הנחיה — מה שבפועל אומר שכל סיבוב לולאה פולט הרבה יותר אסימונים משל Fable 5. השבתת החשיבה הזו מוגבלת למאמץ גבוה, כך שאי אפשר לדחוף אותה כל הדרך למצב הרזה. בסשן שנמשך שעות, הלולאה היא מה שמצטבר: המודל שהכי זול לאסימון יכול להתברר כיקר ביותר לסשן, והמודל שמדבר הכי פחות שומר על הלולאה מהירה.

זה תואם למה ש@dotey מדווח. ההתקנה ההפוכה שומרת על צריכת הטוקנים "לא רעה" דווקא משום ש-Opus 5 — זה שמרבה במילים — מבודד לתת-סוכנים, שם הפלט שלו הוא התוצר הסופי ולא התקורה.

הארכיטקטורה ההפוכה: Fable מתכנן, Opus מבצע

הארכיטקטורה פשוטה לתיאור וקצת לא־אינטואיטיבית להפעלה:

• מודל סשן — Claude Fable 5 במאמץ חשיבה גבוה (ה-"High" בקיצור הקהילתי "Fable 5 High"). הוא הבעלים של השיחה, התוכנית, וההגדרה של הסיום.

• פניות תזמור — הבהרת דרישות, פירוק תכנית, שיגור משימות וקבלת תוצאות — כולן מתרחשות על Fable 5. מדובר במספר קטן של פניות ובחלק קטן מסך הטוקנים.

• סבבי ביצוע — כל משימה נשלחת לסוכן-משנה שמריץ את Claude Opus 5. אלה הם הסבבים הרבים ועיקר צריכת הטוקנים — ו-Opus 5 הוא המקום שבו הציונים האג'נטיים המדווחים על ידי הספק הם הגבוהים ביותר.

הכלכלה עובדת כי שתי עקומות העלות מצביעות לכיוונים שונים. החוזקה של Fable 5 היא שיקול דעת; אתה משתמש בו במשורה. החוזקה של Opus 5 היא ביצוע; אתה משתמש בו רבות אבל במקביל, מבודד מהלולאה. הלולאה נשארת מהירה וזולה, והיכולת היקרה מנוצלת בדיוק במקום שבו האסימונים מנוצלים בכל מקרה.

זו אחת משתי תבניות קהילה שנמצאות במחזור, והן משקפות זו את זו. התבנית המומלצת יותר "architect pattern" (שמשמשת, לדוגמה, את התוסף fable-advisor) מפעילה את Opus כארכיטקט במשרה מלאה ושומרת את Fable 5 לנתיב יישום בעל מורכבות גבוהה ביותר ולבדיקת סיום מחייבת של תוצר. ההבדל הוא מטרת אופטימיזציה: תבנית הארכיטקט מוציאה טוקנים ברמת Opus על תיאום ומשתמשת ב-Fable 5 כאזמל; התבנית ההפוכה משתמשת ב-Fable 5 לתיאום וב-Opus 5 לנפח. שתיהן הן הנחיות קהילה — Anthrop​ic אינה מתעדת אף אחת מהן — ושתיהן ניסיונות להוציא טוקנים מתקדמים במקום שבו הם משנים את התוצאה.

הגדרתו ב-Claude Code

ל-Claude Code אין מצב Orchestrator מובנה, ולכן הדפוס נאכף בשתי דרכים: הוראות בפרומפט ההפעלה, והצמדות מפורשות של מודלים בצד הביצוע.

שכבת ההוראות נמצאת ב-~/.claude/CLAUDE.md — אותו קובץ ש-@dotey ערך. בצורתה, ההנחיה אומרת לסוכן הראשי לעשות ארבעה דברים לפני שהוא מחשיב כל משימה כמושלמת:

• נסח מחדש את הדרישה ואשר את ההיקף לפני כתיבת הקוד.

• פרק את העבודה למשימות שיכולות לרוץ במקביל.

• שלח כל משימת ביצוע לסוכן משנה המקושר ל-Claude Opus 5.

• אמת כל תוצאה מול התוכנית לפני קבלתה.

את הצורה הזו כדאי להציג כהנחיה, לא כקטע קוד להדבקה — הדרישות והסטאק שלך משנים מה שייך בה.

שכבת המודל חשובה יותר ממה שרוב התצורות מניחות. ב-Claude Code, סדר קביעת המודל של תת-הסוכן הוא: משתנה הסביבה CLAUDE_CODE_SUBAGENT_MODEL, לאחר מכן פרמטר מודל לכל קריאה, לאחר מכן ה-frontmatter של הגדרת הסוכן, ולבסוף מודל הסשן. סוכנים שלא הוגדר להם מודל יורשים את מודל הסשן. אז אם הסשן שלך רץ על Fable 5 ואתה מסתמך על ארגומנט המודל של כלי ה-Agent, קיים סיכון מתועד שהוא יוזנח (GitHub issue #83920): תת-הסוכנים יורשים את מודל הסשן בכל מקרה, ואתה משלם תמחור של Fable 5 עבור ביצוע שהתכוונת להריץ על Opus 5.

שני פתרונות אמינים: הגדר את CLAUDE_CODE_SUBAGENT_MODEL=claude-opus-5 עבור הסשן, או קבע את המודל ב-frontmatter של ה-subagent. המשתנה האחד הזה הוא ההבדל בין התבנית שפועלת כמתוכנן לבין הרצה שקטה של כל הסשן על המודל היקר.

מתמטיקת הטוקנים מאחורי הפיצול

הנה שני הדגמים כפי שהם מתומחרים היום (פרסום הספק, ומועבר במחיר המחירון ב-OrcaRouter):

• Claude Fable 5 — $10 ל-1M טוקני קלט, $50 ל-1M פלט; הקשר של 1M טוקנים, פלט של 128K.

• Claude Opus 5 — 5$ למיליון טוקני קלט, 25$ למיליון טוקני פלט; הקשר של מיליון טוקנים, פלט של 128K.

A comparison scoreboard for Claude Fable 5 and Claude Opus 5 contrasting price ($10/$50 vs $5/$25 per 1M tokens), context (both 1M in / 128K out), Frontier-Bench v0.1 (33.7% vs 43.3%), SWE-bench Verified (95.5% vs 96.0%), loop behaviour, and the role each plays in the orchestrator pattern, with a footer noting prices are vendor-published and benchmarks vendor-reported.

החלק המנוגד לאינטואיציה הוא שאופוס 5 עולה חצי מחיר לטוקן ובכל זאת יכול להפסיד במשחק העלות לסשן. קל לראות את התמונה עם מספרים גסים: אם הלולאה על אופוס 5 פולטת פי שניים עד פי שלושה טוקנים מהלולאה על פייבל 5 — נתון להמחשה העולה בקנה אחד עם דיווחי מתרגלים על התנהגות האימות העצמי של אופוס 5, ולא נתון שנמדד — אז אפילו בחצי התעריף לטוקן הלולאה עולה בערך אותו דבר, ואם הפער רחב יותר, אופוס בלולאה עולה יותר. בינתיים, טוקני הביצוע, עיקר הסשן, יושבים על אופוס 5 בתת-סוכנים בתעריף הזול יותר בכל מקרה.

זה כל הטיעון בעד התבנית ההפוכה: לשים על הלולאה את המודל שמחירו לכל טוקן גבוה יותר אבל שהלולאה שלו חסכונית יותר, ולשים על הנפח את המודל הזול יותר לכל טוקן. זו החלטת ניתוב שהתחפשה להחלטת מודל.

מכיוון ש-OrcaRouter מעביר את תמחור הספקים במרווח של 0%, המספרים שלמעלה הם מה שאתה בפועל משלם כאן — ללא עמלת פלטפורמה נוספת — ואם Anthrop​ic יוריד את אחד המחירים, השינוי יופיע בדף המודל באותו היום.

מתי התבנית ההפוכה מנצחת — ומתי לא

העתקת ההתקנה של @dotey בלי לבדוק את המבנה של עומס העבודה שלך היא טעות בשני הכיוונים.

התבנית ההפוכה מנצחת כאשר:

• הדרישות מעורפלות או שהתוכנית כוללת חלקים נעים רבים — שיקול הדעת בתיאום הוא המשאב הנדיר.

• ניתן לפצל את הביצוע במקביל לסוכני משנה — הנפח יוצא מהלולאה.

• הסשנים ארוכים — מילוליות בלולאה מצטברת לעלות אמיתית.

העצה הסטנדרטית מנצחת כאשר:

• רוב הסשן שלך הוא עבודה מוגבלת ומכנית — מתכנן ברמת Fable הוא מוגזם, והמחיר הנמוך יותר וציוני ה-benchmark הגבוהים יותר של Opus 5 הופכים אותו לברירת המחדל הברורה. זו הסיבה שהתיעוד של Claude Code עצמו הופך את Opus לברירת המחדל של הסשן ושומר את Fable 5 לבחירה מפורשת.

• לא ניתן להצמיד באופן אמין מודלים של סוכני משנה — באג ההורשה #83920 הופך את התבנית ההפוכה ל"הכל על תמחור Fable 5."

קיימת גם דרך ביניים של כוונון. Opus 5 חושף פרמטר מאמץ (נמוך עד מקסימום, ברירת מחדל גבוהה), כך שאפשר לדחוף אותו להתנהגות חסכונית יותר — אבל לא עד הסוף, כי השבתת החשיבה מוגבלת למאמץ גבוה. אם הכאב שלך הוא מילוליות יתר של Opus 5, הנמכת המאמץ עשויה להספיק, ולעולם לא תצטרך להפוך את הארכיטקטורה.

מה המשמעות של השינוי בביולוגיה מ-7 באוגוסט עבור ההתקנה הזו

העדכון של Anthrop​ic מ-7 באוגוסט כתב מחדש ואימן מחדש את מסווג הביולוגיה של Claude Fable 5 — המערכת שמחליטה אם שאילתה מפעילה 'fallback' למודל פחות מסוגל. לפי המספרים של Anthrop​ic עצמה (שדווחו על ידי הספק), מספר ה-fallbacks הקשורים לביולוגיה ירד בכ-85% בכל משטחי המוצר, כשסך הירידות עמד על ~67% ב-Claude.ai, ~55% ב-Cowork, ~17% ב-Claude Code, ו-~7% בפלטפורמת Claude.

Screenshot of Anthropic's 'Improving Fable 5's biology safeguards' announcement dated August 7, 2026, describing the roughly 85% reduction in biology-related fallbacks across product surfaces.

עבור הגדרת תזמור של Fable 5, המספר של Claude Code הוא זה שחשוב. fallback הוא המערכת שמעבירה בשקט את השאילתה שלך למודל אחר — במקרה זה ל-Opus 5. בצ'אט רגיל זה חיכוך בלתי נראה; בסשן סוכן זה אומר שחלק מהצנרת שלך רץ על מודל שלא בחרת, עם פרופיל עלות שלא תכננת. העדכון לא מסיר את זה: וירולוגיה, טוקסיקולוגיה ועיצוב מולקולרי עדיין נופלים למודל חלופי. אבל ביולוגיה של בריאות וחינוך ביום-יום — קריאת תוצאת מעבדה, הבנת סימפטום, לימוד ביולוגיה — כעת נשארת על Fable 5.

הערה מקדימה, המסומנת בבירור: דיווחים לא מאומתים מסוף יולי (36kr, WinCentral) מצביעים על אפשרות של עדכון Claude Fable 5.1 החודש במחירים ללא שינוי. Anthrop​ic לא אישרה שם, תאריך או מזהה מודל API — התייחסו לכך כספקולציה עד שיושק.

לנסות את זה בלי לסכן את זרימת העבודה שלך

מה שהופך את התבנית ההפוכה לכדאית הוא שהיא הפיכה, והניתוב של שני המודלים דרך נקודת קצה אחת הופך את ההפיכה לזולה.

ב-OrcaRouter, Claude Fable 5 (anthropic/claude-fable-5) ו-Claude Opus 5 (anthropic/claude-opus-5) נמצאים מאחורי מפתח API אחד. אתה יכול להריץ את נתיב הביצוע של הסשן על כל אחד מהמודלים ללא חוזה שני או שינוי קוד — וזה בדיוק מה שניסוי כמו "Fable 5 as orchestrator" צריך, כי כל העניין הוא למדוד את העלות שלך לכל סשן לפני שמתחייבים.

Screenshot of the OrcaRouter model page for Claude Fable 5 showing the slug anthropic/claude-fable-5, $10 per 1 million input tokens and $50 per 1 million output tokens, a 1M-token context, and the /v1/messages and /v1/chat/completions endpoints.

שתי תכונות של OrcaRouter מתמפות ישירות להגדרה הזו. מעבר אוטומטי למצב גיבוי (failover) מאפשר לך להגדיר שרשרת נפילה — אם Fable 5 מחזיר שגיאה או חורג מזמן הקצוב, הבקשה מנותבת ל-Opus 5 או למודל זול יותר במקום להיכשל. וה-DSL לניתוב יכול להרכיב את הצמד לקריאה אחת: שלב תכנון של Fable 5 ואחריו שלבי ביצוע של Opus 5 מאחורי נקודת קצה אחת. זהו דפוס התזמור המבוטא כתשתית ולא כמשמעת פרומפטים.

השורה התחתונה

הארכיטקטורה ההפוכה — Claude Fable 5 מתכנן, Claude Opus 5 מבצע — היא תשובה אמיתית ועובדת לבעיה אמיתית: המודל הזול ביותר לכל טוקן אינו בהכרח הזול ביותר לכל סשן. זו לא החלטת benchmark; Opus 5 מנצח ברוב ההשוואות הסוכניות המדווחות על ידי ספקים. זו החלטת ניתוב טוקנים, והיא משתלמת רק כששיקול הדעת של התזמור נדיר וניתן להקביל את הביצוע.

קלוד פייבל 5 (9 ביוני 2026) וקלוד אופוס 5 (24 ביולי 2026) הם שניהם מודלים עדכניים של Anthrop​ic, ושינוי אמצעי ההגנה מ-7 באוגוסט הופך את פייבל 5 לנהג יומיומי פחות מופרע. יש לשים לב לשלושה דברים: האם הדיווחים על פייבל 5.1 מביאים לתוצאה כלשהי, האם Anthrop​ic מתקנת את באג הירושה של תת-הסוכן שיכול לבטל בשקט את התבנית הזו, והכי חשוב — איך נראית העלות שלך לכל משימה שהושלמה במשך שבוע של סשנים אמיתיים.

שאלות נפוצות

האם Fable 5 הוא המודל המוגדר כברירת מחדל ב-Claude Code?

לא. התיעוד של Claude Code עצמו קובע ש-Fable 5 אינו ברירת המחדל לאף סוג חשבון — הפגישות נפתחות כברירת מחדל במודל Opus הסטנדרטי, ואתה בוחר את Fable 5 באמצעות /model, הגדרת מודל, או הכינוי "best". התבנית במאמר זה פועלת במודע בניגוד לברירת המחדל הזו.

למה לא פשוט להשתמש ב-Opus 5 כברירת מחדל, מאחר שהוא זול יותר לכל טוקן ומשיג ציונים גבוהים יותר?

מכיוון שעלות לכל סשן היא מספר האסימונים למשימה כפול המחיר לכל אסימון. מתרגלים מדווחים שהחשיבה ההסתגלותית והאימות העצמי של Opus 5 פולטים הרבה יותר אסימונים לכל תור, כך שבחצי מהתעריף לכל אסימון הוא עדיין יכול להיות איטי ויקר יותר בלולאה ארוכה. זה הממצא הקהילתי שעליו בנוי הפלייבוק הזה — מדדו אותו על עומס העבודה שלכם לפני שאתם בוחרים צד.

האם אני יכול לאלץ את תתי-הסוכנים שלי להריץ מודל שונה מזה של הסשן?

כן, אבל אל תסתמך על פרמטר המודל לכל קריאה: GitHub issue #83920 מתעד שמתעלמים ממנו, ותת-סוכנים יורשים במקום זאת את מודל הסשן. הגדר את CLAUDE_CODE_SUBAGENT_MODEL או קבע את המודל ב-frontmatter של תת-הסוכן — זה ההבדל בין הרצה שמתומחרת לפי Opus 5 לבין הרצה שפועלת בשקט לפי תמחור Fable 5.

השוואות במאמר הזה1

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית