
Claude Fable 5.1 לעומת GPT-5.6 Sol: החדש #1 מול חיתוך המחירים
- openaiחדשOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleחדשGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenחדשQwen: Qwen3.8 Max (0902)2026-09-0240אינטליגנציה72כתיבת קוד
- anthropicחדשAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 לכל 1M טוקנים
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0340אינטליגנציה72כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451אינטליגנציה78כתיבת קוד
- googleGoogle: Gemini 3.6 Flash2026-07-2134אינטליגנציה69כתיבת קוד
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2123אינטליגנציה49כתיבת קוד
קח כל סיקור על Claude Fable 5.1 ו-GPT-5.6 Sol מהשבוע הראשון של ספטמבר ותפגוש את אותו המשפט: ספינת הדגל החדשה של Anthropic, ששוחררה ב-1 בספטמבר 2026, ניצחה את GPT-5.6 Sol של OpenAI בעצם בכל מדד ש-Anthropic הריצה. המשפט הזה נכון, והוא גם החצי הקטן של הסיפור. החצי הגדול הוא ש-GPT-5.6 Sol, ספינת הדגל של OpenAI שנמצאת בייצור מאז 9 ביולי 2026, הוא זול בערך פי 2.5 במחיר המחירון, נמדד כמשתמש בכשליש פחות טוקנים על אותה עבודה, ו—נכון לניתוח התמחור מחדש של Epoch AI ב-8 בספטמבר—רק נראה אטרקטיבי יותר ככל שהפרומפטים שלך קצרים יותר. Claude Fable 5.1 הוא מספר 1 החדש במדד העצמאי, עם 66 לעומת 61 של GPT-5.6 Sol. כל הטיעון של דף זה הוא אם ההובלה של חמש הנקודות שווה את מה שהיא עולה.
לוח התוצאות, ומי דיווח על כל מספר
התחילו במספר האחד שאף ספק לא שולט בו. במדד האינטליגנציה של Artificial Analysis במאמץ מרבי, Claude Fable 5.1 משיג 66 — הגבוה ביותר ש-AA רשם אי פעם — לעומת 61 של GPT-5.6 Sol, אם כי עמוד המודל של AA עבור תצורת ברירת המחדל שאנתרופיק למעשה מגישה מציג 53, עדיין מקום ראשון מתוך 201. זו ההצהרה העצמאית הנקייה ביותר על ההתמודדות: הדגל של אנתרופיק הוא התקרה הנוכחית, והפער לזה של OpenAI הוא אמיתי אבל לא עצום.
מתחת לכך, מדדי הביצועים הרכיביים מתחלקים לפי מי שהריץ אותם, וזו הבחנה שכדאי לשמור עליה. Anthropic מדווחת כי Claude Fable 5.1 השיג 52.6% ב-Terminal-Bench-Science 0.1 לעומת 22.4% של GPT-5.6 Sol, 55.8% ב-Terminal-Bench 4.0 לעומת 37.3%, 73.4% ב-CursorBench 3.2.0 לעומת 67.2%, ו-1,853 ב-GDPval-AA v2 לעומת 1,711. OpenAI, מצדה, מדווחת כי GPT-5.6 Sol קיבל כ-96% ב-SWE-bench Verified — נתון הנדסת-תוכנה גבוה יותר מכל מה ש-Anthropic מפרסמת עבור Fable 5.1, משום ש-Anthropic אינה מדווחת על אותו בנצ'מרק כלל. קראו את הדפוס בכנות: כל ספק מוביל במדדים שהוא בוחר לפרסם, שתי החברות בקושי חולקות בנצ'מרק, ויש להתייחס למספרים הרכיביים כאינדיקציה מדווחת-ספק, לא כעובדה בין-ספקית. המדד וההערכות שלכם הם האותות היחידים להשוואה תפוח-לתפוח.
גיליון המפרט, זה לצד זה
• מחיר — Claude Fable 5.1 $10.00 / $50.00 למיליון, קבוע בכל אורכי הקלט, לעומת GPT-5.6 Sol $4.00 / $20.00 למיליון עד 272K קלט, ואז כל הבקשה מתומחרת מחדש ב-$8.00 / $30.00 (לפי הניתוח של Epoch AI מ-8 בספטמבר). קריאות מטמון $0.25 לעומת $0.40.
• קונטקסט / פלט מקסימלי — Claude Fable 5.1: 1M קלט / 128K פלט. GPT-5.6 Sol: ~1.05M קלט / 128K פלט.
• קלטים — שניהם מקבלים טקסט ותמונה.
• ציון עצמאי — Claude Fable 5.1 ב-66 במדד AA Intelligence Index (מקסימום) לעומת GPT-5.6 Sol ב-61.
• Tokenizer — OpenAI מדווחת שהטוקנייזר של GPT-5.6 Sol משתמש בכ-34% פחות טוקנים בטקסט טיפוסי, שזה קיצוץ מחיר שלעולם לא מופיע במחירון.
• סטטוס — Claude Fable 5.1 GA 2026-09-01; GPT-5.6 Sol GA 2026-07-09 עם תעריף קלט/פלט מבצעי בתוקף עד שלהי 2026.


פער המחירים, פער הטוקנים, והצוק
החשבון מתחיל במחיר המחירון ומשם נהיה מעניין יותר. במחיר של $4/$20 לעומת $10/$50, GPT-5.6 Sol זול פי 2.5 לכל טוקן. אם נוסיף את יעילות הטוקנייזר המדווחת של OpenAI — כ-34% פחות טוקנים על אותו טקסט — אותה משימה לוגית עולה על Sol הרבה פחות מכפי שמרמז יחס המחירון. זו הסיבה שהסיקור של Anthropic על ההשקה נשען דווקא על קריאות מטמון: תעריף קריאת המטמון של $0.25 של Claude Fable 5.1 הוא באמת זול, והוא זה שמציל הפעלות סוכן ארוכות עם קריאות חוזרות מהכותרת $10/$50. הקשר של 100K טוקנים שנקרא מחדש חמישים פעמים עולה $1.25 על Claude Fable 5.1 לעומת $2.00 על GPT-5.6 Sol בתעריף המטמון של $0.40.
ובכן, יש גם את הצוק, שחותך לכיוון השני. המסלול של GPT-5.6 Sol ב-$4 / $20 חל רק עד 272K אסימוני קלט; מעבר לכך, הניתוח של Epoch AI מה-8 בספטמבר מראה שכל הבקשה מתומחרת מחדש ב-$8 כניסה / $30 יציאה. ל-Claude Fable 5.1 אין צוק כזה — המחיר של $10 / $50 הוא קבוע בכל אורך, ובאורכי קלט גדולים מאוד התעריף הקבוע יכול לגבור לחלוטין על המסלול המתומחר מחדש של Sol. עבור צוותים שהפרומפטים שלהם חורגים באופן שגרתי מרבע מיליון אסימונים, המסגור של ״מודל OpenAI זול״ קורס; עבור כל השאר, יתרונות המחיר והטוקנייזר של Sol הם הכותרת.
מה חמשת נקודות המדד קונות
פער חמש הנקודות במדד מרוכז בדיוק בסוג העבודה שבו מודל שמוותר מוקדם מפסיד את כל הריצה. המרווחים המדווחים של אנתרופיק ב-Terminal-Bench-Science (52.6% עד 22.4%) וב-AutomationBench הם הגדולים ביותר בין כל שתי דגמי דגל עדכניים, ודף המודלים של Artificial Analysis עצמו מראה מה זה עולה בפועל: 7.63$ בהוצאות מודל ו-190 מיליון טוקני פלט כדי להריץ את המדד, לעומת חציון של 92 מיליון, מכיוון שהמודל החזק יותר כותב הרבה יותר לפני שהוא עוצר. אם העבודה שלך היא מחקר אוטונומי, סוכנים עם אופק ארוך, או משימות שבהן החלטה שגויה מוקדמת מצטברת, הפרמיה הזו קונה את התקרה הנוכחית. אם העבודה שלך היא הנדסת תוכנה שבה GPT-5.6 Sol כבר עובר את ההערכות שלך, חמש הנקודות הן מס.
הדרך הכנה לבחור
אין כאן מנצח יציב, והעמדת פנים שיש כזה היא הדרך שבה צוותים משלמים יותר מדי. העמדה המוצדקת היא להתייחס ל-Claude Fable 5.1 כתקרת היכולת ול-GPT-5.6 Sol כסטנדרט הערך, ואז למדוד את עומס העבודה שלך מול שניהם — וזה זול לעשות כי Claude Fable 5.1 ו-GPT-5.6 Sol נמצאים שניהם ב-OrcaRouter במחירי המחירון של הספקים שלהם ללא תוספת מחיר, מאחורי נקודת קצה אחת תואמת OpenAI. נתב את התעבורה ארוכת הטווח והסוכנותית אל Claude Fable 5.1, השאר את תעבורת הנדסת התוכנה עתירת הנפח על GPT-5.6 Sol, ותן ל-DSL של הניתוב להעלות או להוריד מודל ברגע שההערכות שלך — או כרטיסי המחירים — משתנים. תעריף הקידום של OpenAI מסתיים, מהדורות נקודתיות של Anthropic יוצאות, ויתרון הטוקנייזר בא לידי ביטוי בצורה שונה על כל קורפוס; המודלים ימשיכו להחליף מקומות, והתצורה שיכולה להתחלף איתם שווה יותר מכל אחד משני מודלי הדגל לבדו.

השוואות במאמר הזה1
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
