Claude Fable 5 הוא דגם מסוג Mythos של Anthropic - רמת יכולת מעל מחלקת Opus - שהופך לבטוח לשימוש כללי. היכולות שלו עולות על כל דגם שאנתרופיק שחררה בעבר באופן נרחב, עם תוצאות מתקדמות בתחומי הנדסת תוכנה, עבודת ידע, ראייה ומחקר מדעי; ככל שהמשימה ארוכה ומורכבת יותר, כך היתרון גדול יותר. הוא מקבל קלט טקסט, תמונה וקבצים עם פלט טקסט, משרת חלון הקשר של 1M טוקנים עם עד 128K טוקני פלט, ותומך בחשיבה אדפטיבית ובפלטים מובנים. Fable 5 בנוי לעבודה אוטונומית לטווח ארוך: הוא נשאר קוהרנטי על פני מיליוני טוקנים, משפר את הפלטים שלו באמצעות זיכרון מבוסס קבצים, ומשלים משימות מורכבות מרובות-שלבים עם הרבה פחות תמיכה מאשר דגמים קודמים. זהו ה-state-of-the-art החדש למשימות כבדות בראייה - חילוץ ערכים מדויקים מאיורים מדעיים, בנייה מחדש של יישומים מצילומי מסך בלבד - ושינוי מדרגה עבור קידוד ופרוטוטייפינג אוטונומיים (agentic), טיפול בהעברות בסיס קוד ובמשימות הנדסה מתקדמות במספר סיבובים קטן יותר ויעיל יותר בטוקנים. זה הופך אותו לבחירת ברירת מחדל חזקה עבור עוזרי קידוד בינה מלאכותית, צינורות מחקר וניתוח עמוק, וסוכנים אוטונומיים ארוכי טווח שבהם קוהרנטיות מתמשכת ושיקול דעת הם החשובים ביותר.
Claude Fable 5 הוא מודל שפה גדול מ-Anthropic המדגיש הקשר מורחב וקלט מולטימודלי. חלון ההקשר של 1,000,000 טוקנים מאפשר לבקשה בודדת לכלול ספרים שלמים, בסיסי קוד נרחבים או היסטוריות שיחה ארוכות. המודל…
Claude Fable 5 מצטיינת במשימות הדורשות הבנה הקשרית עמוקה על פני טקסטים ארוכים או קלטים מולטימודליים. דוגמאות כוללות סיכום מסמכים משפטיים רבי-כרכים, ביצוע סקירת קוד על מאגרי ענק, שילוב מידע מתמונות ומטקסטים מרובים, ותכנון תהליכים מורכבים רב-שלביים שבהם צעדים מוקדמים משפיעים על צעדים מאוחרים יותר. הציון 85.0 של המודל ב-OSWorld-Verified מעיד על כך שהוא יכול לבצע בהצלחה משימות מחשב מציאותיות הכוללות גלישה, מניפולציה של קבצים ואינטראקציה עם תוכנה על פני שלבים רבים. הוא גם ביצועים טובים במבחני הבנה והפקת שפה סטנדרטיים, אם כי ציונים ספציפיים מעבר ל-OSWorld אינם מפורטים בפומבי. עבור משימות שאינן דורשות הקשר גדול או קלטים מולטימודליים, מודלים קטנים יותר כמו Claude 3 Haiku או GPT-4o mini יהיו חסכוניים יותר.
בהתחשב במחיר הפרימיום של $10/$50 למיליון טוקנים, Claude Fable 5 אינו אופטימלי עבור שאילתות קצרות בנפח גבוה כמו סיווג פשוט, תרגום משפטים בודדים, או תמיכת לקוחות שגרתית. אם המשימה שלך מתאימה לחלון הקשר של 8K-32K ואינה דורשת הבנת תמונות, מודלים קטנים יותר כמו Claude 3 Sonnet, GPT-4o, או הגרסאות הקלות העדכניות ביותר יספקו תגובות מהירות יותר בעלות נמוכה בהרבה. בנוסף, אם אתה מבצע כוונון עדין (fine-tuning) או זקוק לתפוקה גבוהה עבור בקשות בו-זמניות רבות, העלות והשהייה (latency) של Claude 5 עשויות להיות מונעות. שמור את המודל הזה למשימות שבהן הערך הייחודי של הקשר קיצוני, חשיבה מולטי-מודאלית, או ביצועים סוכניים (agentic) ברמה הגבוהה ביותר מצדיקים בבירור את ההוצאה. ה-API של OrcaRouter מאפשר לך להחליף מודלים באופן דינמי לכל בקשה, כך שתוכל להשתמש ב-Fable 5 רק עבור משימות מורכבות ולתעל משימות פשוטות יותר למקום אחר.
כן, המודל מתאים היטב לתהליכים סוכנותיים (agentic workflows) הדורשים שמירה על מצב לאורך צעדים רבים. חלון ההקשר שלו יכול להכיל יומן סוכן מלא, היסטוריית קריאות לכלים ותצפיות סביבתיות, ומאפשר קבלת החלטות קוהרנטית לאורך אינטראקציות מורחבות. ציון 85.0 במבחן OSWorld-Verified מודד ישירות ביצועים במשימות מחשב ריאליסטיות ורבות-שלבים – כמו כתיבת אימייל, עריכת גיליון אלקטרוני או ניווט בממשק אינטרנט – שהן ליבה של מערכות סוכנותיות. פלט מקסימלי של 128K מאפשר למודל לייצר רצפי פעולות ארוכים או דוחות מפורטים. עם זאת, מפתחים צריכים לקחת בחשבון חביון ועלות מוגברים לכל תור. עבור לולאות סוכנותיות פשוטות עם הקשרים קצרים, מודלים קטנים יותר יכולים להספיק. ממשק ה-API של OrcaRouter תומך בהזרמה (streaming) ובפרמטרים מותאמים אישית (למשל temperature, max_tokens) כדי לכוונן את ההתנהגות.
היתרונות כוללים את חלון ההקשר הגדול ביותר הזמין מסחרית (1M טוקנים), הבנה מולטי-מודאלית חזקה (טקסט, תמונה, קובץ), וציון גבוה ב-OSWorld-Verified (85.0), המשקף ביצועים חזקים במשימות בעולם האמיתי. המודל כולל גם מגבלת פלט נדיבה של 128K, המאפשרת יצירות ארוכות. המגבלות כוללות עלות גבוהה: במחיר של $10/$50 למיליון טוקנים, הוא יקר פי כמה ממודלים ברמה בינונית. בנוסף, ההשהייה עולה עם אורך ההקשר; עיבוד של כמעט מיליון טוקנים עשוי להימשך עשרות שניות או יותר. המודל חסר מודאליות כמו שמע או וידאו; הוא מקבל רק טקסט ותמונות. הוא גם אינו תומך בכיוונון עדין או באימון מותאם אישית – מדובר במודל קבוע, הזמין רק דרך API. עבור משימות שאינן מנצלות את היכולות הייחודיות שלו, העלות עשויה לעלות על התועלת.
OSWorld-Verified הוא מדד שמעריך סוכני AI במשימות מחשב מציאותיות ורב-שלביות על פני מערכות הפעלה. ציון של 85.0 מציין ש-Claude Fable 5 משלים בהצלחה 85% מהמשימות המוערכות ללא התערבות אנושית. זהו ציון גבוה, המצביע על כך שהמודל יכול להשתמש ביעילות בכלים, לגלוש בקבצים, לתמרן רכיבי ממשק משתמש, ולבצע היגיון על פני רצפים ארוכים. להקשר, מודלים רבים אחרים מקבלים ציון מתחת ל-50 במדדים דומים. הציון משקף הן את ההקשר הגדול של המודל (המאפשר לו לזכור שלבים קודמים) והן את יכולת ההיגיון שלו. עם זאת, OSWorld-Verified הוא רק מדד אחד; הוא אינו מודד עובדתיות, בטיחות או ידע ספציפי לתחום. על המשתמשים להעריך ביצועים במשימות שלהם. המדד בוצע על ידי Anthropic באמצעות מסגרת הערכה בלתי תלויה.
נתוני זמן ההשהיה המדויקים עבור Claude Fable 5 אינם מפורסמים באופן ציבורי על ידי Anthropic, אך ניתן להסיק ציפיות כלליות. עבור prompt קצר טיפוסי (למשל, כמה מאות tokens) המודל עשוי להגיב תוך שניות. ככל שאורך ההקשר מתקרב למגבלה של 1M, זמן ההשהיה עולה משמעותית—ועשוי לעלות על דקה גם בעיבוד וגם ביצירה. גם אורך הפלט משפיע על המהירות; יצירת 128K tokens יכולה לקחת זמן ניכר. ה-API של OrcaRouter תומך בתגובות Streaming, כך שמשתמשים יכולים לעבד תוצאות חלקיות בזמן שהן מגיעות. עבור יישומים בזמן אמת, שקול להשתמש במודל קטן יותר. העלות הגבוהה ($50/output MTok) מעודדת עוד יותר לייעל את אורך ה-prompt. Caching אינו זמין באופן טבעי, אך OrcaRouter עשוי להציע Caching אופציונלי עבור בקשות חוזרות—בדוק את התיעוד העדכני.
למרות חוזקותיו, לקלוד פייבל 5 יש מגבלות. ראשית, הוא אינו רב-משימתי כוללני; הוא מצטיין בהסקה בהקשר ארוך ורב-מודאלית אך עלול להיעקף על ידי מודלים מתמחים במשימות כמו מתמטיקה (למשל, GPT-4o) או יצירת קוד (למשל, Code Llama) אם אותם מודלים מכווננים היטב. שנית, מועד החיתוך של הידע של המודל אינו מוגדר; יש להניח שהוא עשוי לא להיות מעודכן באירועים עדכניים מאוד. שלישית, כמו כל מודלי השפה הגדולים, הוא יכול להזות או לייצר מידע לא מדויק, במיוחד כאשר דוחפים אותו מעבר להתפלגות האימון שלו. רביעית, הבנת תמונות היא חזקה אך לא מושלמת—פרטים עדינים בתמונות ברזולוציה נמוכה עלולים להחמיץ. לבסוף, העלות והשהייה הופכות אותו לבלתי מעשי עבור מערכות ייצור בתפוקה גבוהה. תמיד אמתו תפוקות באופן ביקורתי. הפלטפורמה של OrcaRouter מאפשרת לעבור למודלים חלופיים לפי הצורך.
מדד הבנצ'מרק OSWorld-Verified הוא חדש יחסית, ולכן השוואות ישירות עם מודלים רבים מוגבלות. עם זאת, תוצאות ידועות מטבלאות לידרבורד ציבוריות מצביעות על כך שציונים מעל 70 נחשבים לחזקים מאוד. לדוגמה, מודלים קודמים כמו GPT-4V ו-Claude 3 Opus דיווחו על ציונים מתחת ל-60 במבחנים אגנטיים דומים (למשל, OSWorld). הציון 85.0 של Claude Fable 5 מרמז שהוא אחד המודלים בעלי הביצועים הטובים ביותר למשימות אגנטיות. עם זאת, ציוני הבנצ'מרק אינם מבטיחים ביצועים בכל תרחיש; משימות בעולם האמיתי משתנות במורכבות ובתחום. המודל כנראה גם מקבל ציונים גבוהים במבחני הבנה שפתית כללית (למשל, MMLU, HellaSwag), אם כי מספרים ספציפיים לא סופקו. על המשתמשים לבצע הערכה עצמאית באמצעות דגימות מייצגות. ה-API של OrcaRouter מאפשר לך לבדוק מודלים זה לצד זה עם הנחיות זהות.
התמחור פשוט: $10.00 לכל מיליון טוקני קלט ו-$50.00 לכל מיליון טוקני פלט. אלו התעריפים המדויקים של הספק מ-Anthropic; OrcaRouter אינו מוסיף כל תוספת מחיר. טוקני קלט כוללים את כל הטקסט, התמונה ותוכן הקבצים שעובר עיבוד על ידי המודל. טוקני פלט סופרים כל טוקן שנוצר. לדוגמה, בקשה עם 10,000 טוקני קלט ו-2,000 טוקני פלט תעלה $0.10 + $0.10 = $0.20. אין דמי הסתרה או דרישות שימוש מינימליות. התשלום מתבצע דרך חשבון OrcaRouter שלך. אם אתה משתמש בהיקף גבוה, OrcaRouter עשוי להציע רמות הנחה - צור קשר עם התמיכה לפרטים. שים לב שבגלל שהמודל יקר, חשוב לעקוב אחר השימוש בטוקנים. OrcaRouter מספק יומני שימוש ופירוטי עלויות בלוח המחוונים.
הפשרה העיקרית היא בין יכולת לעלות. Claude Fable 5 הוא אחד המודלים היקרים ביותר הזמינים בשל ההקשר הגדול והמחיר הגבוה לכל טוקן. עבור משימות המשתמשות בפחות מ-32K טוקנים, תשלמו פרמיה מבלי לנצל את החוזק המרכזי של המודל. שקלו להשתמש במודל זול יותר (למשל, Claude 3 Haiku ב-$0.25/$1.25 למיליון טוקנים) עבור מקרים אלו. כמו כן, טוקני פלט יקרים פי חמישה מטוקני קלט, כך שאופטימיזציה של אורך היצירה – באמצעות שימוש בפרומפטים מובנים או הגדרות max_tokens נמוכות יותר – יכולה להפחית עלויות. בנוסף, הימנעו מהכללת הקשר מיותר; כל תמונה צורכת טוקנים משמעותיים (לעיתים אלפים). ה-API של OrcaRouter תומך בפרמטר `max_tokens` להגבלת הפלט. עבור עומסי עבודה עם פרומפטים חוזרים תכופים, שקלו אם שמירה במטמון או כוונון עדין מותאם אישית של מודל קטן יותר יכולים להיות חסכוניים יותר.
נכון לעכשיו, Anthropic אינה מציעה תכונת שמירה במטמון (caching) של prompt מובנית עבור Claude Fable 5, ו-OrcaRouter אינו שומר prompts במטמון באופן אוטומטי. עם זאת, ה-API של OrcaRouter עשוי לתמוך בשמירה אופציונלית במטמון של בקשות זהות ברמת התשתית — יש לעיין בתיעוד של OrcaRouter או לפנות לתמיכה לקבלת אפשרויות השמירה במטמון העדכניות. ללא שמירה במטמון, כל בקשה מחויבת במלואה לפי מספר ה-tokens. אם מקרה השימוש שלך כולל קידומות זהות רבות (למשל, system prompt משותף להודעות משתמש רבות), תוכל לארגן מחדש את הקריאות שלך כדי למזער עלויות חוזרות של tokens, אך המודל עדיין יעבד את כל הקלט בכל פעם. עבור יישומים בעלי נפח גבוה, כדאי לבחון כוונון עדין (fine-tuning) של מודל קטן יותר או שימוש במודל זול יותר עם הקשר קצר יותר. OrcaRouter מאפשר לך לעבור בין מודלים באופן תכנותי כדי לייעל את העלות.
לא, OrcaRouter אינו גובה עמלות נוספות מעל תעריף הספק. אתה משלם בדיוק $10.00 לכל 1M טוקנים בקלט ו-$50.00 לכל 1M טוקנים בפלט. אין חיובים לפי בקשה, אין מינימום מנוי, ואין עלויות נסתרות. עמלות חשבון סטנדרטיות של OrcaRouter (אם קיימות) חלות על כל שימוש ב-API אך נפרדות מהתמחור הספציפי לדגם. אם אתה משתמש בתכונות כמו ניתוב דגמים מותאם אישית, הזרמה (streaming) או שיחות מרובות-סיבובים, הן כלולות בתמחור הטוקנים. תמיד בדוק את דף התמחור של OrcaRouter לקבלת המידע העדכני ביותר. עבור לקוחות ארגוניים, OrcaRouter עשויה להציע הנחות בנפח או תמחור ייעודי - צור קשר עם המכירות לקבלת הצעת מחיר. לסיכום, העלות היא שקופה וניתנת לחיזוי על בסיס שימוש בטוקנים.
אתה ניגש ל-Claude Fable 5 דרך ה-API התואם ל-OpenAI של OrcaRouter. כתובת הבסיס היא https://api.orcarouter.ai/v1. השתמש במודל ID "anthropic/claude-fable-5" בבקשות שלך. ה-API מקבל פרמטרים סטנדרטיים של OpenAI להשלמת צ'אט: `messages`, `max_tokens`, `temperature`, `top_p`, `stop` וכו'. עבור קלטים מולטימודליים, כלול מערכים `content` עם רשומות מסוג "text", "image_url" או "file_url" (תלוי בגרסת ה-SDK שלך). אימות דורש מפתח API מ-OrcaRouter, המועבר בכותרת Authorization בתור "Bearer YOUR_API_KEY". דוגמה לפקודת curl: curl https://api.orcarouter.ai/v1/chat/completions -H "Content-Type: application/json" -H "Authorization: Bearer $ORCAROUTER_API_KEY" -d '{"model":"anthropic/claude-fable-5","messages":[{"role":"user","content":"Hello"}],"max_tokens":100}'. סטרימינג נתמך על ידי הגדרת `stream: true`.
Claude Fable 5 תומך בפרמטרים הסטנדרטיים של ה-API להשלמות צ'אט של OpenAI. החשובים ביותר הם: `max_tokens` (ברירת מחדל 128K מקסימום), `temperature` (טווח 0-2, מומלץ 0-1), `top_p` (חלופה ל-temperature), רצפי `stop`, `presence_penalty` ו-`frequency_penalty`. עבור בקשות מולטי-מודליות, השדה `content` יכול להכיל מערכים של אובייקטים עם `type` והנתונים המתאימים (לדוגמה, `{"type":"text","text":"Describe this chart"}` ו-`{"type":"image_url","image_url":{"url":"data:image/jpeg;base64,..."}}`). ניתן לבצע העלאות קבצים באמצעות URL או נתונים מקודדים ב-base64. קיים גם פרמטר `stream` לקבלת תשובות חלקיות. לא כל הפרמטרים נתמכים; לדוגמה, פונקציות/כלים אינם זמינים כרגע עבור מודל זה—בדוק בתיעוד של OrcaRouter לעדכונים. כל הפרמטרים מועברים בגוף הבקשה.
ההגירה פשוטה מכיוון שה-API של OrcaRouter תואם ל-OpenAI. התחל בקבלת מפתח API של OrcaRouter מלוח המחוונים של החשבון שלך. החלף את כתובת ה-URL הבסיסית הנוכחית שלך בכתובת https://api.orcarouter.ai/v1 ושנה את מזהה המודל ל-"anthropic/claude-fable-5". אם השתמשת בעבר ב-API המקורי של Anthropic, שים לב ש-OrcaRouter משתמש בפורמט ההודעות של OpenAI במקום בפורמט של Anthropic. תצטרך להתאים כל קוד שמבנה הודעות. עבור קלטים של תמונות, המר אותם לפורמט של OpenAI (למשל, base64 או URL). OrcaRouter מטפל בתרגום הבסיסי ל-API של Anthropic. בדוק עם בקשה בודדת לפני העברת עומסי ייצור. OrcaRouter עשוי גם להציע תכונות נוספות כמו הגבלת קצב, ניתוח שימוש, וגיבויי מודלים. עיין בתיעוד של OrcaRouter לפרטים על עיצוב הודעות ואימות.
Claude Fable 5 מציע חלון הקשר גדול יותר (1M לעומת 200K עבור Opus) וציון גבוה יותר ב-OSWorld-Verified (85.0 לעומת כ-55-60 משוער עבור Opus). הוא גם תומך בקלט תמונות וקבצים בדיוק כמו Opus. מגבלת אסימוני הפלט גבוהה יותר (128K לעומת 4,096 עבור Opus). עם זאת, Claude 3 Opus זול משמעותית: $15/$75 למיליון אסימונים עבור Opus (בעבר) או $8/$24 עבור Opus לאחר הפחתות מחיר? המחיר הנוכחי של Opus הוא $15/$75 למיליון אסימונים לעומת $10/$50 של Fable 5—רגע, Opus הוא בפועל $15/$75 קלט/פלט? (תעריף רגיל: Claude 3 Opus $15/$75 למיליון אסימונים). אז Fable 5 הוא למעשה זול יותר לאסימון מאשר Opus? למעשה $10/$50 לעומת $15/$75, כלומר Fable 5 זול ב-33%. זו נקודה מעניינת. אבל Opus עדיין מסוגל למשימות קצרות יותר. היתרון העיקרי של Fable 5 הוא אורך ההקשר וביצועים סוכניים. למשימות בטווח של 200K אסימונים, Opus עשוי להספיק בעלות נמוכה יותר. אם אתה צריך הקשר קיצוני או ציונים סוכניים גבוהים ביותר, Fable 5 טוב יותר.
GPT-4o (מ-OpenAI) כולל חלון הקשר של 128K, לעומת 1M של Fable 5. GPT-4o תומך גם בטקסט, תמונה וקלט שמע (Fable 5: טקסט ותמונה בלבד). מגבלת הפלט של GPT-4o היא 4,096 טוקנים, קטנה בהרבה מ-128K של Fable 5. במבדקי ביצועים, GPT-4o משיג כ-87.1 ב-MMLU אך אין לו ציון OSWorld-Verified מדווח פומבית. מבחינת תמחור, GPT-4o עולה $5/$15 למיליון טוקנים (קלט/פלט), זול יותר מ-$10/$50 של Fable 5. לכן GPT-4o מהיר וזול יותר למשימות קצרות, בעוד Fable 5 מצטיין בתרחישים עם הקשר ארוך ובמצבים אג'נטיים. עבור מולטימודליות עם שמע, GPT-4o הוא הבחירה הטובה יותר. שניהם נגישים דרך OrcaRouter, המאפשרת בחירה לפי בקשה.
בתוך OrcaRouter, תוכלו לבחור מתוך מגוון דגמי Anthropic (Claude 3.5 Sonnet, Claude 3 Haiku) ודגמי OpenAI (GPT-4o, GPT-4o mini, GPT-4 Turbo), כמו גם דגמי קוד פתוח. עבור רוב המשימות, Claude 3.5 Sonnet מציע איזון טוב בין יכולת ועלות (3$/$15 לכל MTok) עם קונטקסט של 200K. עבור קונטקסטים ארוכים במיוחד, Fable 5 הוא בלתי מתחרה. עבור סיווג או חילוץ בתפוקה גבוהה, Claude 3 Haiku (0.25$/$1.25 לכל MTok) זול ומהיר. עבור יצירת קוד, GPT-4o או Code Llama עשויים להיות מתמחים. OrcaRouter מאפשר להגדיר דגמי גיבוי: אם Fable 5 נכשל או חורג מזמן התגובה, תוכלו לנתב לדגם זול יותר. העריכו את הדרישות הספציפיות שלכם לאורך קונטקסט, אופן קלט וביצועי benchmark. הדגם הטוב ביותר תלוי במקרה השימוש שלכם, לא רק ב-benchmark הגבוה ביותר.
תואם OpenAI — המשיכו להשתמש ב-SDK שכבר יש לכם
https://api.orcarouter.ai/v1https://api.orcarouter.aifrom openai import OpenAI
client = OpenAI(
base_url="https://api.orcarouter.ai/v1",
api_key="$ORCAROUTER_API_KEY",
)
response = client.chat.completions.create(
model="anthropic/claude-fable-5",
messages=[{"role": "user", "content": "Hello"}],
)
print(response.choices[0].message.content)include_reasoningmax_tokensreasoningresponse_formatstopstructured_outputstool_choicetoolsverbosity| קלט / 1M טוקנים | $10.00 |
| פלט / 1M tokens | $50.00 |
| קריאת מטמון / 1M | $1.00 |
| כתיבה למטמון / 1M | $12.50 |
| מטבע | USD |
הערכה מבוססת מחיר מחירון
הערכה בלבד — ספירת הטוקנים בפועל תלויה בטוקנייזר של הספק.
GET /api/public/models/anthropic/claude-fable-5פתיחה @misc{orcarouter_claude_fable_5,
title = {Claude Fable 5 API},
author = {Anthropic},
year = {2026},
howpublished = {OrcaRouter},
url = {https://www.orcarouter.ai/models/anthropic/claude-fable-5}
}Anthropic. (2026). Claude Fable 5 API. OrcaRouter. https://www.orcarouter.ai/models/anthropic/claude-fable-5