
Claude Fable 5 כמתזמר שלך: ספר המהלכים לתת-סוכנים ששומר על עלויות טוקנים נמוכות
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0345אינטליגנציה76כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
ב-7 באוגוסט, Anthropic ביצעה את השינוי הבודד הגדול ביותר ב-Claude Fable 5 מאז שהמודל הושק ב-9 ביוני: היא קיצצה בכ-85% את ה-fallbacks הקשורים לביולוגיה, כך ששאלות יומיומיות בנושאי בריאות וחינוך מקבלות כעת תשובה ישירה במקום לעבור בשקט למודל חלש יותר. עם זאת, לדפוס שבפועל מתפשט בקהילת Claude Code השבוע אין שום קשר לביולוגיה. אנשי מקצוע ממשיכים לפרסם זרימת עבודה שבה Claude Fable 5 מריץ את לולאת התזמור — הבהרת דרישות, פירוק תוכנית, שיגור משימות, קבלת תוצאות — בעוד שהביצוע מועבר לתתי-סוכנים של Claude Opus 5. התועלת המוצהרת: Fable 5 High הופך לברירת מחדל במחיר סביר לסשן, והארכנות של Claude Opus 5 מפסיקה לרוקן את הסשן.
הדוגמה האחרונה היא של @dotey, שפורסמה ב־14 באוגוסט: תוספת קצרה ל־~/.claude/CLAUDE.md שאומרת לסוכן לפתוח סוכני משנה של Opus לצורך ביצוע, ולהשאיר את Claude Fable 5 במאמץ חשיבה גבוה כברירת המחדל של הסשן, כשהכותב מדווח שצריכת הטוקנים נשארת סבירה — וסיבה בוטה לא להריץ את Claude Opus 5 כברירת מחדל: בידיים שלו הוא היה איטי מדי ושרף מספר עצום של טוקנים בלולאה הראשית. זה ממצא של הקהילה, לא הנחיה של Anthropic — וכדאי להבין אותו לפני שמעתיקים, כי על הנייר זה נראה הפוך.
התבנית בפסקה אחת. ב-Claude Code, תת-סוכנים יורשים כברירת מחדל את מודל הסשן שלך, כך שהדרך לשמור על לולאה מהירה וזולה היא להפוך את מודל הסשן למתכנן ולכוון את המבצעים למודל אחר במפורש. Claude Fable 5 — המודל מסוג Mythos של Anthropic שהופך לבטוח לשימוש כללי, שוחרר ב-9 ביוני 2026, במחיר של $10/$50 למיליון טוקנים — מחזיק בדרישות, מפרק את העבודה, שולח משימות ומקבל תוצאות. Claude Opus 5 — שוחרר ב-24 ביולי 2026, במחיר של $5/$25 למיליון טוקנים — מריץ את היישומים בפועל בתוך תת-סוכנים. אתה משקיע שיפוט ברמת Fable במעט תורות התיאום ורמת ביצוע ברמת Opus בתורות הביצוע הרבות, שבהן כבר הולך עיקר הטוקנים.
מדוע מודל הלולאה הראשית הוא בעיית העלות האמיתית
במדדים, זה נראה כמו בעיה פתורה — והתשובה נראית כמו "ברירת מחדל ל-Opus 5." המספרים של Anthropic עצמו (מדווחי ספק, לא משוכפלים) מציבים את Claude Opus 5 לפני Claude Fable 5 במדד הקידוד הסוכני Frontier-Bench v0.1 (43.3% לעומת 33.7%), ב-SWE-bench Verified (96.0% לעומת 95.5%), וב-ARC-AGI-3 (30.2%, בערך פי 4 מהמודל הציבורי השני הטוב ביותר). Anthropic ממקמת את Opus 5 כמתקרב לאינטליגנציית החוד החנית של Fable 5 בחצי המחיר. אם תבחר ברירת מחדל לסשן אך ורק לפי מדדי ספק ומחיר לכל טוקן, Opus 5 הוא הבחירה המובנת מאליה.
מתרגלים שמנהלים בפועל סשנים ארוכים מגיעים לברירת המחדל ההפוכה, והסיבה היא אסימונים למשימה, לא מחיר לאסימון. החשיבה של Opus 5 מופעלת כברירת מחדל והיא אדפטיבית, ו-Anthropic מצהירה שהיא מאמתת את העבודה שלה ללא הנחיה — מה שבפועל אומר שכל סיבוב לולאה פולט הרבה יותר אסימונים משל Fable 5. השבתת החשיבה הזו מוגבלת למאמץ גבוה, כך שאי אפשר לדחוף אותה כל הדרך למצב הרזה. בסשן שנמשך שעות, הלולאה היא מה שמצטבר: המודל שהכי זול לאסימון יכול להתברר כיקר ביותר לסשן, והמודל שמדבר הכי פחות שומר על הלולאה מהירה.
זה תואם למה ש@dotey מדווח. ההתקנה ההפוכה שומרת על צריכת הטוקנים "לא רעה" דווקא משום ש-Opus 5 — זה שמרבה במילים — מבודד לתת-סוכנים, שם הפלט שלו הוא התוצר הסופי ולא התקורה.
הארכיטקטורה ההפוכה: Fable מתכנן, Opus מבצע
הארכיטקטורה פשוטה לתיאור וקצת לא־אינטואיטיבית להפעלה:
• מודל סשן — Claude Fable 5 במאמץ חשיבה גבוה (ה-"High" בקיצור הקהילתי "Fable 5 High"). הוא הבעלים של השיחה, התוכנית, וההגדרה של הסיום.
• פניות תזמור — הבהרת דרישות, פירוק תכנית, שיגור משימות וקבלת תוצאות — כולן מתרחשות על Fable 5. מדובר במספר קטן של פניות ובחלק קטן מסך הטוקנים.
• סבבי ביצוע — כל משימה נשלחת לסוכן-משנה שמריץ את Claude Opus 5. אלה הם הסבבים הרבים ועיקר צריכת הטוקנים — ו-Opus 5 הוא המקום שבו הציונים האג'נטיים המדווחים על ידי הספק הם הגבוהים ביותר.
הכלכלה עובדת כי שתי עקומות העלות מצביעות לכיוונים שונים. החוזקה של Fable 5 היא שיקול דעת; אתה משתמש בו במשורה. החוזקה של Opus 5 היא ביצוע; אתה משתמש בו רבות אבל במקביל, מבודד מהלולאה. הלולאה נשארת מהירה וזולה, והיכולת היקרה מנוצלת בדיוק במקום שבו האסימונים מנוצלים בכל מקרה.
זו אחת משתי תבניות קהילה שנמצאות במחזור, והן משקפות זו את זו. התבנית המומלצת יותר "architect pattern" (שמשמשת, לדוגמה, את התוסף fable-advisor) מפעילה את Opus כארכיטקט במשרה מלאה ושומרת את Fable 5 לנתיב יישום בעל מורכבות גבוהה ביותר ולבדיקת סיום מחייבת של תוצר. ההבדל הוא מטרת אופטימיזציה: תבנית הארכיטקט מוציאה טוקנים ברמת Opus על תיאום ומשתמשת ב-Fable 5 כאזמל; התבנית ההפוכה משתמשת ב-Fable 5 לתיאום וב-Opus 5 לנפח. שתיהן הן הנחיות קהילה — Anthropic אינה מתעדת אף אחת מהן — ושתיהן ניסיונות להוציא טוקנים מתקדמים במקום שבו הם משנים את התוצאה.
הגדרתו ב-Claude Code
ל-Claude Code אין מצב Orchestrator מובנה, ולכן הדפוס נאכף בשתי דרכים: הוראות בפרומפט ההפעלה, והצמדות מפורשות של מודלים בצד הביצוע.
שכבת ההוראות נמצאת ב-~/.claude/CLAUDE.md — אותו קובץ ש-@dotey ערך. בצורתה, ההנחיה אומרת לסוכן הראשי לעשות ארבעה דברים לפני שהוא מחשיב כל משימה כמושלמת:
• נסח מחדש את הדרישה ואשר את ההיקף לפני כתיבת הקוד.
• פרק את העבודה למשימות שיכולות לרוץ במקביל.
• שלח כל משימת ביצוע לסוכן משנה המקושר ל-Claude Opus 5.
• אמת כל תוצאה מול התוכנית לפני קבלתה.
את הצורה הזו כדאי להציג כהנחיה, לא כקטע קוד להדבקה — הדרישות והסטאק שלך משנים מה שייך בה.
שכבת המודל חשובה יותר ממה שרוב התצורות מניחות. ב-Claude Code, סדר קביעת המודל של תת-הסוכן הוא: משתנה הסביבה CLAUDE_CODE_SUBAGENT_MODEL, לאחר מכן פרמטר מודל לכל קריאה, לאחר מכן ה-frontmatter של הגדרת הסוכן, ולבסוף מודל הסשן. סוכנים שלא הוגדר להם מודל יורשים את מודל הסשן. אז אם הסשן שלך רץ על Fable 5 ואתה מסתמך על ארגומנט המודל של כלי ה-Agent, קיים סיכון מתועד שהוא יוזנח (GitHub issue #83920): תת-הסוכנים יורשים את מודל הסשן בכל מקרה, ואתה משלם תמחור של Fable 5 עבור ביצוע שהתכוונת להריץ על Opus 5.
שני פתרונות אמינים: הגדר את CLAUDE_CODE_SUBAGENT_MODEL=claude-opus-5 עבור הסשן, או קבע את המודל ב-frontmatter של ה-subagent. המשתנה האחד הזה הוא ההבדל בין התבנית שפועלת כמתוכנן לבין הרצה שקטה של כל הסשן על המודל היקר.
מתמטיקת הטוקנים מאחורי הפיצול
הנה שני הדגמים כפי שהם מתומחרים היום (פרסום הספק, ומועבר במחיר המחירון ב-OrcaRouter):
• Claude Fable 5 — $10 ל-1M טוקני קלט, $50 ל-1M פלט; הקשר של 1M טוקנים, פלט של 128K.
• Claude Opus 5 — 5$ למיליון טוקני קלט, 25$ למיליון טוקני פלט; הקשר של מיליון טוקנים, פלט של 128K.

החלק המנוגד לאינטואיציה הוא שאופוס 5 עולה חצי מחיר לטוקן ובכל זאת יכול להפסיד במשחק העלות לסשן. קל לראות את התמונה עם מספרים גסים: אם הלולאה על אופוס 5 פולטת פי שניים עד פי שלושה טוקנים מהלולאה על פייבל 5 — נתון להמחשה העולה בקנה אחד עם דיווחי מתרגלים על התנהגות האימות העצמי של אופוס 5, ולא נתון שנמדד — אז אפילו בחצי התעריף לטוקן הלולאה עולה בערך אותו דבר, ואם הפער רחב יותר, אופוס בלולאה עולה יותר. בינתיים, טוקני הביצוע, עיקר הסשן, יושבים על אופוס 5 בתת-סוכנים בתעריף הזול יותר בכל מקרה.
זה כל הטיעון בעד התבנית ההפוכה: לשים על הלולאה את המודל שמחירו לכל טוקן גבוה יותר אבל שהלולאה שלו חסכונית יותר, ולשים על הנפח את המודל הזול יותר לכל טוקן. זו החלטת ניתוב שהתחפשה להחלטת מודל.
מכיוון ש-OrcaRouter מעביר את תמחור הספקים במרווח של 0%, המספרים שלמעלה הם מה שאתה בפועל משלם כאן — ללא עמלת פלטפורמה נוספת — ואם Anthropic יוריד את אחד המחירים, השינוי יופיע בדף המודל באותו היום.
מתי התבנית ההפוכה מנצחת — ומתי לא
העתקת ההתקנה של @dotey בלי לבדוק את המבנה של עומס העבודה שלך היא טעות בשני הכיוונים.
התבנית ההפוכה מנצחת כאשר:
• הדרישות מעורפלות או שהתוכנית כוללת חלקים נעים רבים — שיקול הדעת בתיאום הוא המשאב הנדיר.
• ניתן לפצל את הביצוע במקביל לסוכני משנה — הנפח יוצא מהלולאה.
• הסשנים ארוכים — מילוליות בלולאה מצטברת לעלות אמיתית.
העצה הסטנדרטית מנצחת כאשר:
• רוב הסשן שלך הוא עבודה מוגבלת ומכנית — מתכנן ברמת Fable הוא מוגזם, והמחיר הנמוך יותר וציוני ה-benchmark הגבוהים יותר של Opus 5 הופכים אותו לברירת המחדל הברורה. זו הסיבה שהתיעוד של Claude Code עצמו הופך את Opus לברירת המחדל של הסשן ושומר את Fable 5 לבחירה מפורשת.
• לא ניתן להצמיד באופן אמין מודלים של סוכני משנה — באג ההורשה #83920 הופך את התבנית ההפוכה ל"הכל על תמחור Fable 5."
קיימת גם דרך ביניים של כוונון. Opus 5 חושף פרמטר מאמץ (נמוך עד מקסימום, ברירת מחדל גבוהה), כך שאפשר לדחוף אותו להתנהגות חסכונית יותר — אבל לא עד הסוף, כי השבתת החשיבה מוגבלת למאמץ גבוה. אם הכאב שלך הוא מילוליות יתר של Opus 5, הנמכת המאמץ עשויה להספיק, ולעולם לא תצטרך להפוך את הארכיטקטורה.
מה המשמעות של השינוי בביולוגיה מ-7 באוגוסט עבור ההתקנה הזו
העדכון של Anthropic מ-7 באוגוסט כתב מחדש ואימן מחדש את מסווג הביולוגיה של Claude Fable 5 — המערכת שמחליטה אם שאילתה מפעילה 'fallback' למודל פחות מסוגל. לפי המספרים של Anthropic עצמה (שדווחו על ידי הספק), מספר ה-fallbacks הקשורים לביולוגיה ירד בכ-85% בכל משטחי המוצר, כשסך הירידות עמד על ~67% ב-Claude.ai, ~55% ב-Cowork, ~17% ב-Claude Code, ו-~7% בפלטפורמת Claude.

עבור הגדרת תזמור של Fable 5, המספר של Claude Code הוא זה שחשוב. fallback הוא המערכת שמעבירה בשקט את השאילתה שלך למודל אחר — במקרה זה ל-Opus 5. בצ'אט רגיל זה חיכוך בלתי נראה; בסשן סוכן זה אומר שחלק מהצנרת שלך רץ על מודל שלא בחרת, עם פרופיל עלות שלא תכננת. העדכון לא מסיר את זה: וירולוגיה, טוקסיקולוגיה ועיצוב מולקולרי עדיין נופלים למודל חלופי. אבל ביולוגיה של בריאות וחינוך ביום-יום — קריאת תוצאת מעבדה, הבנת סימפטום, לימוד ביולוגיה — כעת נשארת על Fable 5.
הערה מקדימה, המסומנת בבירור: דיווחים לא מאומתים מסוף יולי (36kr, WinCentral) מצביעים על אפשרות של עדכון Claude Fable 5.1 החודש במחירים ללא שינוי. Anthropic לא אישרה שם, תאריך או מזהה מודל API — התייחסו לכך כספקולציה עד שיושק.
לנסות את זה בלי לסכן את זרימת העבודה שלך
מה שהופך את התבנית ההפוכה לכדאית הוא שהיא הפיכה, והניתוב של שני המודלים דרך נקודת קצה אחת הופך את ההפיכה לזולה.
ב-OrcaRouter, Claude Fable 5 (anthropic/claude-fable-5) ו-Claude Opus 5 (anthropic/claude-opus-5) נמצאים מאחורי מפתח API אחד. אתה יכול להריץ את נתיב הביצוע של הסשן על כל אחד מהמודלים ללא חוזה שני או שינוי קוד — וזה בדיוק מה שניסוי כמו "Fable 5 as orchestrator" צריך, כי כל העניין הוא למדוד את העלות שלך לכל סשן לפני שמתחייבים.

שתי תכונות של OrcaRouter מתמפות ישירות להגדרה הזו. מעבר אוטומטי למצב גיבוי (failover) מאפשר לך להגדיר שרשרת נפילה — אם Fable 5 מחזיר שגיאה או חורג מזמן הקצוב, הבקשה מנותבת ל-Opus 5 או למודל זול יותר במקום להיכשל. וה-DSL לניתוב יכול להרכיב את הצמד לקריאה אחת: שלב תכנון של Fable 5 ואחריו שלבי ביצוע של Opus 5 מאחורי נקודת קצה אחת. זהו דפוס התזמור המבוטא כתשתית ולא כמשמעת פרומפטים.
השורה התחתונה
הארכיטקטורה ההפוכה — Claude Fable 5 מתכנן, Claude Opus 5 מבצע — היא תשובה אמיתית ועובדת לבעיה אמיתית: המודל הזול ביותר לכל טוקן אינו בהכרח הזול ביותר לכל סשן. זו לא החלטת benchmark; Opus 5 מנצח ברוב ההשוואות הסוכניות המדווחות על ידי ספקים. זו החלטת ניתוב טוקנים, והיא משתלמת רק כששיקול הדעת של התזמור נדיר וניתן להקביל את הביצוע.
קלוד פייבל 5 (9 ביוני 2026) וקלוד אופוס 5 (24 ביולי 2026) הם שניהם מודלים עדכניים של Anthropic, ושינוי אמצעי ההגנה מ-7 באוגוסט הופך את פייבל 5 לנהג יומיומי פחות מופרע. יש לשים לב לשלושה דברים: האם הדיווחים על פייבל 5.1 מביאים לתוצאה כלשהי, האם Anthropic מתקנת את באג הירושה של תת-הסוכן שיכול לבטל בשקט את התבנית הזו, והכי חשוב — איך נראית העלות שלך לכל משימה שהושלמה במשך שבוע של סשנים אמיתיים.
שאלות נפוצות
האם Fable 5 הוא המודל המוגדר כברירת מחדל ב-Claude Code?
לא. התיעוד של Claude Code עצמו קובע ש-Fable 5 אינו ברירת המחדל לאף סוג חשבון — הפגישות נפתחות כברירת מחדל במודל Opus הסטנדרטי, ואתה בוחר את Fable 5 באמצעות /model, הגדרת מודל, או הכינוי "best". התבנית במאמר זה פועלת במודע בניגוד לברירת המחדל הזו.
למה לא פשוט להשתמש ב-Opus 5 כברירת מחדל, מאחר שהוא זול יותר לכל טוקן ומשיג ציונים גבוהים יותר?
מכיוון שעלות לכל סשן היא מספר האסימונים למשימה כפול המחיר לכל אסימון. מתרגלים מדווחים שהחשיבה ההסתגלותית והאימות העצמי של Opus 5 פולטים הרבה יותר אסימונים לכל תור, כך שבחצי מהתעריף לכל אסימון הוא עדיין יכול להיות איטי ויקר יותר בלולאה ארוכה. זה הממצא הקהילתי שעליו בנוי הפלייבוק הזה — מדדו אותו על עומס העבודה שלכם לפני שאתם בוחרים צד.
האם אני יכול לאלץ את תתי-הסוכנים שלי להריץ מודל שונה מזה של הסשן?
כן, אבל אל תסתמך על פרמטר המודל לכל קריאה: GitHub issue #83920 מתעד שמתעלמים ממנו, ותת-סוכנים יורשים במקום זאת את מודל הסשן. הגדר את CLAUDE_CODE_SUBAGENT_MODEL או קבע את המודל ב-frontmatter של תת-הסוכן — זה ההבדל בין הרצה שמתומחרת לפי Opus 5 לבין הרצה שפועלת בשקט לפי תמחור Fable 5.
השוואות במאמר הזה1
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
