נוצר כרטיס כותרת ראשי עבור Claude Sonnet 5.5 לעומת Claude Fable 5.1, עם כותרת משנה "המודל הזול מקדים בשלוש נקודות", המציג $2.00 קלט ו-$10.00 פלט למיליון טוקנים משמאל, לעומת $10.00 ו-$50.00 מימין, עם נתוני Artificial Analysis Intelligence Index v4.3 ‏56 ו-53 מתחתיהם, והלוגו של OrcaRouter משולב בפינה הימנית התחתונה.
Guides & Insights

Claude Sonnet 5.5 לעומת Claude Fable 5.1: המודל הזול מוביל בשלוש נקודות

מחבר

Rowan Sterling

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

Claude Sonnet 5.5 הגיע ב-28 בספטמבר 2026 במחיר של 2.00 דולר למיליון טוקני קלט ו-10.00 דולר למיליון טוקני פלט. Claude Fable 5.1, המודל מסדרת Mythos שהספק שחרר ב-1 בספטמבר, עומד על 10.00 ו-50.00 דולר באותן שתי שורות. הסיכום המפתה הוא ש-Fable 5.1 הוא היקר ולכן הטוב יותר, ובמדד ה-Artificial Analysis Intelligence Index הסדר הוא הפוך: Claude Sonnet 5.5 מקבל ציון 56 ו-Claude Fable 5.1 מקבל ציון 53. זה לא תוצר לוואי של עיגול מספרים, וזה גם לא כל הסיפור, כי אותו מעריך מציב את השניים בטווח של שלושה סנטים זה מזה לכל משימה באותה חבילת בדיקות — 7.60 דולר מול 7.63 דולר. הבדל של פי חמישה במחירון כמעט ונעלם עד לסיום המשימה. מה שנותר הוא סט של הבדלים בצורה ולא בציון, והבחירה בין השניים היא בעיקר שאלה של איזו צורה יש לעומס העבודה שלכם.

שני כרטיסי תעריפים, והשורה האחת שבה הפער אינו פי חמישה

ההשוואה לפי טוקן חדה ובולטת ואינה מצריכה פרשנות.

• קלט — Claude Sonnet 5.5 במחיר $2.00 למיליון טוקנים לעומת Claude Fable 5.1 במחיר $10.00, פער של פי חמישה

• פלט — $10.00 לעומת $50.00 למיליון, שוב בדיוק פי חמישה

• קריאת מטמון — $0.20 לעומת $0.25 למיליון. זה הקו שנושא ריצות סוכן ארוכות, וההנחה מתכווצת מ־5× ל־20%

• כתיבה למטמון — $2.50 לעומת $12.50 למיליון עבור חלון חמש הדקות הסטנדרטי, הפער הבודד הרחב ביותר בכל אחד מהכרטיסים

• אצווה — מצב האצווה של Anthropic אינו חל על אף אחד משני הכרטיסים האלה כפי שהוא חל על זה של Fable 5.1: Fable 5.1 הושק עם תמחור אצווה שנחתך בחצי ל־$5.00 לקלט ול־$25.00 לפלט. קראו את שורת האצווה מדף התמחור של Anthropic עצמה לפני שאתם מניחים שהיא חלה על כל המשפחה

• הקשר ותקרה — 1,000,000 טוקנים של הקשר ו-128,000 טוקנים של פלט מרבי בשניהם. ב-Message Batches API, Claude Sonnet 5.5 תומך בעד 300,000 טוקני פלט מאחורי כותרת הבטא output-300k-2026-03-24, וזהו הבדל תקרה אמיתי ליצירה בכמויות ולא הבדל שיווקי

יש נקודה צנועה לזכותו של Claude Sonnet 5.5 שמחירון התעריפים ממעיט בערכה. Anthropic מדווחת שהמודל בדרך כלל זקוק להרבה פחות טוקנים כדי לבצע את אותה עבודה מאשר קודמו, מה שלדבריה מתבטא בעד 30% פחות עלות לכל משימה. זוהי טענה של ספק לגבי השוואה אחרת — Sonnet 5.5 מול Sonnet 5 — והיא אינה ראיה לגבי ההתמודדות הזו. עם זאת, זהו המנגנון שמסביר את מה שמצאה המדידה הבלתי תלויה.

לאן הולך פער המחירים של פי חמישה

Artificial Analysis הרצה את שני המודלים ב-2026-09-29 תחת הרנס אחד ותווית תצורה אחת, "Adaptive Reasoning, Max Effort, Default Fallback", על Intelligence Index v4.3. שני הנתונים המרכזיים הם 56 עבור Claude Sonnet 5.5 ו-53 עבור Claude Fable 5.1 — המודל הזול מוביל בכשלוש נקודות בסולם שבו אותו מעריך ממקם את המודל החציוני ב-26. שניהם מסומנים כמודלים בשם ספק באותו עמוד, כך שמדובר במכשיר אחד ובתמונת מצב אחת, לא בשניים.

ואז עמודת העלות, והסיבה שהזיווג הזה מעניין ולא מובן מאליו. באותה הרצת אינדקס, Claude Sonnet 5.5 עולה $7.602633 לכל משימה ו-Claude Fable 5.1 עולה $7.629706. הפרש של עשרים ושבע אלפיות דולר. הפירוק הוא המקום שבו זה נהיה מוזר: צד הקלט לבדו של Claude Fable 5.1 הוא $3.73 לכל משימה לעומת רכיב הקלט הקטן בהרבה של Sonnet 5.5, וטוקני החשיבה שלו לבדם עולים $2.36 לכל משימה. המודל שזול פי חמישה לכל טוקן אינו זול יותר כלל לכל משימה שהושלמה.

הגורם הוא נפח, ושני המודלים נכשלים בכיוונים מנוגדים.

• אסימוני פלט ברחבי סוויטת האינדקס — Claude Sonnet 5.5 הפיק 410,577,501 לעומת 188,465,663 של Claude Fable 5.1, על סוויטה שבה החציון במעקב הוא 88 מיליון. שניהם הרבה מעל החציון; Sonnet 5.5 הוא יותר מפי שניים מ-Fable 5.1 וכמעט פי חמישה מהחציון

• אסימוני פלט לכל משימה — 192,838 עבור Sonnet 5.5 לעומת 78,111 עבור Fable 5.1, כאשר חלק החשיבה הוא 142,386 לעומת 47,240. Sonnet 5.5 חושב בערך פי שלושה זמן בכל משימה

• טוקני קלט בכל חבילת האינדקסים — 18.5 מיליארד עבור Sonnet 5.5 לעומת 5.6 מיליארד עבור Fable 5.1. ‏Sonnet 5.5 קרא פי שלושה יותר, וזהו המספר השקט יותר מבין השניים וזה שאוכל את תעריף הקלט הזול יותר

• מחיר משוקלל בתמהיל של 7:2:1 של קלט־קריאת מטמון־פלט — 1.54 $ עבור Sonnet 5.5 לעומת 7.17 $ עבור Fable 5.1. זו השורה שמתאימה לכרטיס התעריפים, וזו השורה שמתארת עומס עבודה עם פלטים קצרים ותחומים היטב

אם מחברים את אלה יחד, הקביעה הכנה היא זו: הפער במחיר המשוקלל הוא אמיתי, ואילו הפער לפי משימה לא. איזה משני המספרים מתאר את החשבון שלך תלוי לחלוטין בשאלה אם המשימות שלך מסתיימות או מתארכות, וחבילת האינדקס בנויה כדי לאפשר להן להתארך.

סולם המאמץ הוא ההחלטה האמיתית

שני המודלים חושפים פרמטר מאמץ — נמוך, בינוני, גבוה, גבוה במיוחד, מקסימלי — ושניהם נמדדו בכל דרגה ב-29 בספטמבר 2026. זה החלק בהשוואה שאף מחירון לא יכול לבטא, כי המודל הזול בדרגה נמוכה יותר מנצח את המודל היקר בדרגה נמוכה יותר בפער גדול, והמודל היקר מתבדל רק סמוך לצמרת.

• מאמץ נמוך — Claude Sonnet 5.5 משיג 35.84 בעלות של $0.41 למשימה; Claude Fable 5.1 משיג 46.82 בעלות של $2.37. בדרגה התחתונה המודל היקר מוביל באחת עשרה נקודות, תמורת כמעט פי שישה מהכסף

• מאמץ בינוני — 40.74 ב-$0.59 לעומת 48.92 ב-$2.98. Fable 5.1 מחזיק ביתרון של שמונה נקודות בעלות גבוהה פי חמישה

• מאמץ גבוה — 46.74 ב-$1.08 לעומת 51.15 ב-$3.91. הפער מצטמצם לארבע וחצי נקודות; יחס העלות נשמר בסביבות 3.6×

• מאמץ Xhigh — 51.85 ב-$2.74 לעומת 53.20 ב-$5.98. פער של נקודה ושליש, ב-46% מהמחיר

• מאמץ מקסימלי — 55.98 ב-$7.60 לעומת 53.35 ב-$7.63. הסדר מתהפך והעלות מתכנסת לפער של עד חצי אחוז.

קראו את השורה הרביעית והחמישית יחד וצורת ההתמודדות הזו מתגלה. Claude Sonnet 5.5 ב-xhigh מספק 51.85 — במרחק של נקודת אינדקס וחצי מהניקוד הטוב ביותר של Claude Fable 5.1 בכל מאמץ — תמורת $2.74 למשימה לעומת $7.63. אם העבודה שלכם צריכה להיות קרוב לחזית ולא בחזית עצמה, השורה הזו היא כל התשובה, והיא חוסכת 64% לכל משימה שהושלמה. דחפו את Sonnet 5.5 ל-max ואתם קונים שלוש נקודות נוספות תמורת פי 2.8 מהכסף, מה שמביא אתכם לאותו חשבון כמו ה-max של Fable 5.1 עם ניקוד טוב יותר במעט ופרופיל הסקה שונה מאוד.

המשפט האחרון הזה שווה לחדד, משום שהוא מנוגד לאינטואיציה מספיק כדי לבדוק אותו פעמיים. כאשר רמת המאמץ המקסימלית זהה, המודל בעל המחירון הזול פי חמישה עולה אותו דבר לכל משימה כמו המודל בעל המחירון היקר. הוא מגיע לשם בכך שהוא פולט פי 2.5 טוקני פלט, שחלק ההיסק בהם גדול פי שלושה. התיעוד של Anthropic עצמה מסביר חלק מהמנגנון: הטוקנייזר השתנה, ואותו טקסט מפיק כ-30% יותר טוקנים ב-Claude Sonnet 5.5 מאשר במודלים קודמים. זהו גורם תורם אחד מבין כמה, וזו תזכורת שימושית לכך שמספרי טוקני פלט אינם ברי השוואה בין גרסאות טוקנייזר מבלי לציין זאת.

השהיה היא הנקודה שבה השניים מפסיקים להידמות זה לזה.

התכנסות הציונים אינה חלה על זמן. באותה תמונת מצב מ-2026-09-29, Artificial Analysis מדווחת על זמן עד לטוקן הראשון של 254.41 שניות עבור Claude Fable 5.1 ו-2.80 שניות עבור Claude Sonnet 5.5 בפרוסת הפרומפט הארוך, עם מהירויות פלט חציוניות של 67.9 ו-49.4 טוקנים לשנייה, בהתאמה. מדובר בהפרש של שני סדרי גודל בזמן שהקורא ממתין לפני שמשהו מגיע, וזהו המספר היחיד בעל ההשלכות התפעוליות המשמעותיות ביותר בהשוואה הזו.

שני הנתונים מחייבים הצהרה מפורשת של המסתייגים שלהם. ה-TTFT של Fable 5.1 נמדד על סוג הפרומפט הארוך; הפרוסה של פרומפט בינוני של המעריך עבור אותו מודל באותו יום היא 117.60 שניות, כך שנתון 254 השניות הוא הזנב ולא קבוע. 2.80 השניות של Sonnet 5.5 הוא החציון הכולל שלה, כאשר טווח השונות של המעריך עצמו נע מ-1.91 שניות באחוזון החמישי ל-4.23 באחוזון התשעים וחמישה. התיעוד של פלטפורמת Anthropic מתאר את זמן האחזור היחסי של Fable 5.1 כאיטי ואת זה של Sonnet 5.5 כמהיר, וזה עקבי מבחינת הכיוון בלי להיות מדידה.

התשתית שלנו מספקת קריאה שלישית, מפני שאנחנו מנתבים את Claude Fable 5.1 ומודדים את מה שאנחנו מגישים. במהלך שבעת הימים עד 28 בספטמבר, בתעבורה של OrcaRouter עצמה, Claude Fable 5.1 רושם חציון של טוקן ראשון ב-6,973 מילישניות עם אחוזון 95 ב-10.0 שניות, מהירות פלט של 65.8 טוקנים לשנייה ושיעור שגיאות של 0.349%. ה-p50 הזה מהיר ביותר מפי מאה מהנתון של הנחיה ארוכה אצל המעריך, וזה לא כל כך סתירה אלא הגדרה של מונחים: טוקן ראשון מול מפתח על פני הנחיה קצרה וטוקן ראשון של מבחן על פני הנחיה ארוכה הם מדידות של דברים שונים. כל מי שמתכנן סביב המספר בלוח המובילים צריך לדעת איזה מהם הוא קונה.

Screenshot of Anthropic's product page for Claude Sonnet 5.5 via the Claude Platform overview, showing the model comparison table across context window, maximum output, input price, output price, comparative latency, thinking mode and knowledge cutoff, with Claude Sonnet 5.5 marked as the model being viewed at $2.00 input and $10.00 output per million tokens alongside Claude Fable 5.1 and Claude Opus 5.5.

כנות באיתור, שימור, וההגירה שאיש לא מזכיר

טבלאות בנצ'מרק של ספקים והערכות בלתי־תלויות הן כלים שונים, ולעולם אין לגרוע אחת מהשנייה. טבלת ההשקה של Anthropic עצמה עבור Claude Sonnet 5.5 מדווחת על Terminal-Bench 4.0 בשיעור 70.6%. Artificial Analysis, שמפעילה הרנס משלה, מדווחת על 63.6% עבור אותו מודל בהערכה באותו שם. עבור Claude Fable 5.1 הפער נע בכיוון ההפוך: Anthropic דיווחה על 55.8% בעת ההשקה, וההרנס הבלתי תלוי מצביע על 52.0%. אף אחד משני הזוגות אינו תיקון של משנהו. שפוט כל אחד לפי אמות המידה שלו, והעדף את הבלתי תלויה כשאתה מחליט לאן לנתב תעבורת ייצור.

גם עמדת השימור שונה, וזהו סוג ההבדל שמתגלה רק בסקירת רכש. Anthropic מצהירה ש-Claude Sonnet 5.5 זמין עם אפס שימור נתונים, אותה עמדה שנקטה עם Opus 5.5 ו-Sonnet 5. חומר ההשקה של Claude Fable 5.1 מתאר מדיניות שימוש בנתונים מצטברת שמתקיימת לצדה, ופריסה נפרדת תחת Project Glasswing הנושאת חלון שימור של 30 יום כברירת מחדל לניטור בטיחות, כאשר הסדר של אפס שימור מתואר כמצב ביניים. אם הצוות שלכם כפוף לסקירת עיבוד נתונים, ההבחנה הזו היא סעיף ממשי ולא הערת שוליים, וכדאי לקרוא את עמוד המדיניות הנוכחי של Anthropic ולא כל סיכום שלו, כולל זה.

עלות ההגירה א־סימטרית באופן שכמעט אינו מגיע לסיקור ההשקה. מעבר ל-Claude Sonnet 5.5 אינו שינוי של מחרוזת מודל. במדריך ההגירה של Anthropic נכתב כי ערכי temperature, top_p ו-top_k שאינם ברירת מחדל מחזירים כעת שגיאת 400, כי tool_choice של any או של כלי בעל שם נדחה על הסף, וכי thinking: {"type": "disabled"} חייב להפוך ל-between_tools אם הרצתם כשחשיבה מראש כבויה. הסוג between_tools מתקבל ברמות effort של low, medium ו-high ומחזיר 400 ב-xhigh או ב-max. ב-Claude API וב-Google Cloud, computer use נתמך רק דרך ערכת הכלים computer_toolset_20260801; computer_20251124 הישן יותר נדחה. אף אחד מאלה אינו חל על מעבר ל-Claude Fable 5.1, שהוא שדרוג באותה משפחה מ-Fable 5 עם שלושה שינויים שוברים משל עצמו. אם אתם שוקלים את השניים כיעדי הגירה מקבילים, המודל הזול יותר הוא היקר יותר לאמץ.

A two-column scoreboard for Claude Sonnet 5.5 and Claude Fable 5.1. Left column Claude Sonnet 5.5: input $2.00, output $10.00, cache read $0.20, cache write $2.50, 1M context with 128K max output, AA Intelligence Index v4.3 score 56, best value rung xhigh at 51.85 and $2.74 per task, first token 2.80 seconds, 410M output tokens on the index suite. Right column Claude Fable 5.1: input $10.00, output $50.00, cache read $0.25, cache write $12.50, 1M context with 128K max output, AA Intelligence Index v4.3 score 53, best score max at 53.35 and $7.63 per task, first token 254.41 seconds on the long prompt slice, 188M output tokens on the index suite. The card heading reads 'Claude Sonnet 5.5 against Claude Fable 5.1: five-fold on the rate card, level on the finished task', and a footer line reads 'Per-token prices per the OrcaRouter catalogue; index, per-task, effort and latency figures per Artificial Analysis, Intelligence Index v4.3, 2026-09-29 snapshot.'

איזה אחד לשים איפה

ההחלטה הנובעת מהמספרים היא החלטה לגבי כמה מהתנועה שלך מוגדרת היטב בהיקפה.

• עבודה תחומה, בנפח גבוה, מונחית-כלים — Claude Sonnet 5.5, במאמץ xhigh אם אתה צריך להיות קרוב לחזית. הוא מפגר בנקודת מדד וחצי אחרי הטוב ביותר של Fable 5.1, במחיר נמוך ב-64% לכל משימה שהושלמה, הוא מחזיר את הטוקן הראשון שלו תוך כשלוש שניות, ושורת כתיבת המטמון הזולה יותר שלו מאפשרת קידומת הקשר שנבנתה מחדש במחיר סביר.

• עבודה לטווח ארוך ופתוחה, שבה תשובה שגויה יקרה — Claude Fable 5.1. הוא משיג את הציון המקסימלי של Sonnet 5.5 באותה עלות לכל משימה, ובמקביל מגיע לשם עם שליש מאסימוני החשיבה ורבע מהקלט, מה שחשוב כשהמשימה היא באמת פתוחה וצורת מערך ההערכה דומה לבעיה שלך

• משטחים אינטראקטיביים המוגבלים על ידי השהיה — Claude Sonnet 5.5, וזה לא מתקרב. לפי תמונת המצב של המעריך עצמו, הפער בטוקן הראשון הוא שני סדרי גודל בסוג ההנחיה הארוכה, והקריאה בהנחיה הבינונית מצמצמת אותו רק לכ-118 שניות. אי אפשר לבנות משטח צ'אט על המספר של Fable 5.1 בלי באצ'ינג או סטרימינג סביבו

• יצירה בכמות גדולה עם פלטים ארוכים — Claude Sonnet 5.5, בגלל תקרת הפלט של 300,000 טוקנים הזמינה ב-Message Batches API מאחורי ה-header output-300k-2026-03-24, לעומת תקרה של 128,000 טוקנים בכל מקום אחר. ודאו את תמחור ה-batch שלכם לפני התחייבות; התעריף ב-batch אינו זהה בין שני הכרטיסים

• עבודה שחייבת להשתרע על פני חשבונות או להעביר חשיבה בין מערכות — קראו את התיעוד של Anthropic על חשיבה משומרת לפני כל אחד מהם. בלוקי חשיבה כבולים למודל ולחשבון שהפיקו אותם, ו-Sonnet 5.5 הוא ה-Sonnet הראשון שמגיע עם מסווגים שמונעים חילוץ חשיבה. זו תכונת ציות ואילוץ בעת ובעונה אחת

• עומסי עבודה בפיקוח רגולטורי או רגישים לשימור נתונים — בדקו את המדיניות העדכנית ולא את הסיקור בזמן ההשקה. Claude Sonnet 5.5 הושק עם אפשרות של אי-שימור נתונים; החומר של Fable 5.1 מתאר מדיניות הדרגתית עם חלון ברירת מחדל של 30 יום בפריסה אחת ואי-שימור נתונים כמצב ביניים

Screenshot of the OrcaRouter model page for Anthropic Claude Fable 5.1 (anthropic/claude-fable-5.1), showing the model header, a 1M-token context window with 128K maximum output, the capability tags, the $10.00 input and $50.00 output prices per million tokens with a $0.25 cache read and $12.50 cache write, and the seven-day performance panel with a 65.836 token-per-second output speed and a 0.349% error rate.

ב-OrcaRouter, Claude Fable 5.1 ו-Claude Sonnet 5 נמצאים שניהם מאחורי אישור גישה אחד במחיר מחיר המחירון של הספק עם 0% תוספת, כך ששורת קריאת המטמון והשינוי בטוקנייזר הם הדברים היחידים שמזיזים את החשבון שלכם כשאתם עוברים ביניהם. Claude Sonnet 5.5 אינו עדיין נתיב בפלטפורמה שלנו — המודל בן יום אחד בלבד — כך שהאמירה הכנה היא שהיום מגיעים אליו דרך ה-API של Anthropic עצמה. כל מי שמריץ Fable 5.1 דרכנו יכול לתמחר את המעבר ביום שבו הוא ינחת מבלי לשנות שום דבר אחר באינטגרציה שלו, ובינתיים מעבר אוטומטי בין ספקים בעת כשל הוא מה שהופך את זה לבטוח לנסות מודל חדש כל כך בנתיב שחייב להישאר פעיל.

הפסק דין צר יותר מכפי שפער המחירים מרמז. Claude Sonnet 5.5 הוא ברירת המחדל הטובה יותר כמעט לכל משימה תחומה — הוא משיג שלוש נקודות יותר במדד הבלתי־תלוי, הוא עונה בשניות, וב־xhigh הוא מגיע לפער של נקודה וחצי מתקרת היכולת של Fable 5.1 בעלות נמוכה בהרבה ממחצית העלות למשימה. ל־Claude Fable 5.1 נותר טיעון אחד ממשי, והוא זה שטבלת ההשוואה של Anthropic עצמה מציגה: כשהעבודה פתוחה וחסרת גבולות והעלות של טעות עולה על העלות של חשיבה ארוכה יותר, מחיר קלט גבוה פי חמישה קונה מודל שמגיע לאותו ציון בלי להוציא פי שלושה אסימוני חשיבה לשם כך. בחרו לפי צורת המשימה, לא לפי גודל כרטיס התעריפים, מפני שב�ראש סולם המאמץ שני המודלים האלה מחייבים אתכם אותו דבר.

השוואות במאמר הזה1

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית