
קלוד האיקו 5.5 מול קלוד סונט 5.5: מחירון של פי 20, חשבון מדוד של פי 36
- openaiחדשOpenAI: GPT-6.1 Sol2026-09-2952אינטליגנציה
- anthropicחדשAnthropic: Claude Sonnet 5.52026-09-2856אינטליגנציה
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 112 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238אינטליגנציה
- OpenAIOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIGrok 4.72026-09-2146אינטליגנציה
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 לכל 1M טוקנים · 52 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 423 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 62 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 399 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
Claude Haiku 5.5 וClaude Sonnet 5.5 מרוחקים זה מזה שישה ימים ודרגה אחת באותה משפחה, חולקים חלון הקשר של מיליון טוקנים, ומגיבים לאותה צורת API. בכרטיס התעריפים המפורסם, הזול מבין השניים עולה חמישית מהיקר יותר בטווח שבו נופלות רוב הבקשות. בלוח העצמאי של Artificial Analysis הפער רחב עוד יותר: $0.21 להשלמת משימת Intelligence Index אחת ב-Claude Haiku 5.5 לעומת $7.60 ב-Claude Sonnet 5.5, עבור Intelligence Index של 43 מול 56. האות שהתחיל את הכתבה הזו ניסח זאת כך ש-Claude Haiku 5.5 הוא "הרבה יותר טוב מ-GPT-6 Luna" ו"קרוב (יותר) ל-Sonnet 5.5". המחצית הראשונה של זה היא בערך מה שמערך ההשוואה של הספק עצמו מציג. המחצית השנייה היא המקום שבו המדידות מפסיקות להסכים עם השיווק, וכדאי להיות מדויקים לגבי מה בדיוק.
שני דגמים, שישה ימים ודרגה אחת ביניהם
Claude Haiku 5.5 שוחרר ב-7 באוקטובר 2026 תחת מזהה הדגם claude-haiku-5-5. זהו התחליף הישיר ל-Claude Haiku 4.5, הוא מקבל טקסט ותמונות ומחזיר טקסט, והוא הדגם הראשון במחלקת Haiku ש-Anthropic העניקה לו הגדרת מאמץ מתכווננת — נמוך, בינוני, גבוה, Xhigh ומקס, עם בינוני כברירת מחדל של ה-API. Anthropic מכנה אותו "הדגם הקטן הזול, המהיר והמסוגל ביותר שאי פעם הוצאנו", והערת השוליים שלה מסייגת זאת כמהיר ביותר במהירות הסטנדרטית של כל דגם, עדיין מאחורי דגמי Opus כשהם פועלים במצב Fast Mode.
Claude Sonnet 5.5 נחת שישה ימים קודם לכן, ב-28 בספטמבר 2026, בתור claude-sonnet-5-5 — הדרגה שאנתרופיק מציבה כשילוב הטוב ביותר של מהירות ואינטליגנציה, וזו שהיא ממליצה עליה לקידוד סוכני מורכב. אותו חלון של מיליון טוקנים. שלא כמו Claude Haiku 5.5, אין לה טווח מחירים לפי אורך הפרומפט, ומסתבר שזה חשוב יותר מאשר יתרון ששת הימים.
שניהם זמינים כעת בכל הפלטפורמות, כולל Amazon Web Services, Google Cloud ו-Microsoft Azure, ושניהם נושאים התחייבות לפרישה שלא לפני שנה לאחר ההשקה — 7 באוקטובר 2027 עבור Claude Haiku 5.5, 28 בספטמבר 2027 עבור Claude Sonnet 5.5. Anthropic אומרת ש-Claude Sonnet 5.5 זמין עם אפס שמירת נתונים, בהתאמה ל-Claude Opus 5.5 ו-Claude Sonnet 5.
כרטיס התעריפים, שני הצדדים, במקום אחד
לכל מיליון טוקנים, בדולרים אמריקאיים, לפי התעריפים המפורסמים של Anthropic:
• קלט — Claude Haiku 5.5 $0.10 עבור פרומפטים של עד 100,000 טוקנים, $0.50 מעל לרף זה; Claude Sonnet 5.5 $2.00 אחיד, ללא מדרגות.
• פלט — Claude Haiku 5.5 $0.50 עד 100,000 טוקנים, $2.50 מעל זה; Claude Sonnet 5.5 $10.00 אחיד.
• קריאות מטמון — Claude Haiku 5.5 $0.01 ברצועה התחתונה ו-$0.05 מעליה; Claude Sonnet 5.5 $0.10. Anthropic הפחיתה בחצי את מחיר קריאות המטמון של Claude Sonnet 5.5 מ-$0.20 במקביל להשקת Haiku, ואומרת שמכיוון שקריאות מטמון מהוות חלק גדול משימוש באסימונים סוכניים, Claude Sonnet 5.5 עולה כעת כ-20% פחות ברוב המשימות הסוכניות.
• כתיבות מטמון — Claude Haiku 5.5 $0.125 עבור כתיבה של חמש דקות ו-$0.20 עבור כתיבה של שעה ברצועה התחתונה, $0.625 ו-$1.00 מעליה; Claude Sonnet 5.5 $2.50 עבור כתיבה של חמש דקות ו-$4.00 לשעה.
• Batch — ה-Batch API בהנחה של 50% גם על קלט וגם על פלט. כך Claude Haiku 5.5 עומד על $0.05 ו-$0.25 מתחת לרף 100,000 הטוקנים ועל $0.25 ו-$1.25 מעליו, לעומת Claude Sonnet 5.5 שעומד על $1.00 ו-$5.00.
קראו לרוחב השורות האלה והצורה עקבית: ברצועה התחתונה אתם רואים פער קלט של פי 20 ופער פלט של פי 20; מעל הקו, פי 4 ופי 4. הכותרת של Anthropic היא "כ-75% פחות להריץ" בממוצע לעומת Claude Haiku 4.5, ומעודנת בהערת שוליים ל-90% זול יותר מתחת ל-100,000 טוקנים ו-50% זול יותר מעל זה, כאשר שינוי הטוקנייזר מקופל לתוך הממוצע הזה.
השלב של 100,000 טוקנים הוא המקום שבו האריתמטיקה מתהפכת
שני דברים מושכים לכיוונים מנוגדים, ורק אחד מהם מופיע במחירון. המחירים צונחים בחדות לעומת Claude Haiku 4.5. במקביל, Claude Haiku 5.5 מגיע עם טוקנייזר מעודכן, בדומה לאלה שב-Claude Sonnet 5.5 וב-Claude Opus 5.5, שלדברי Anthropic "צורך מעט יותר טוקנים לכל משימה" — כך שאותו פרומפט בדיוק מגיע כמספר גדול יותר של טוקנים לחיוב מכפי שהיה בדור הקודם. הממוצע של 75% הוא התוצאה הנטו של שני אלה, והוא מספר של הספק.
קו 100,000 הטוקנים הוא החלק שתופס אנשים. Anthropic מתמחרת את Claude Haiku 5.5 לפי אורך הפרומפט: בקשה שהפרומפט שלה עולה על 100,000 טוקנים משלמת את המחירים הגבוהים על כל הבקשה, לא רק על הטוקנים שמעבר לסף. אורך הפרומפט סופר את כל טוקני הקלט, כולל קריאות מטמון וכתיבות מטמון, וכל בקשה מתומחרת בנפרד — בקשה ארוכה משלמת את המדרגה הגבוהה גם כשחלק ממנה הוא פגיעת מטמון, ובקשות קודמות שומרות על המחירים שבהם חויבו. צינור אחזור שיושב בנוחות על 90,000 טוקנים משלם $0.10 ו-$0.50. הזז את החלון צעד אחד והבקשה כולה מתומחרת מחדש ב-$0.50 ו-$2.50. Claude Sonnet 5.5 לא עושה זאת, מכיוון שחלון מיליון הטוקנים המלא מחויב בתמחור רגיל.
שתי השלכות נובעות מכך, המצביעות בכיוונים מנוגדים. ראשית, נקודת ההצטלבות שאנשים מצפים לה — הקשר ארוך שהופך את המודל היקר לזול יותר — לא מתרחשת: Claude Haiku 5.5 מעל הקו הוא עדיין רבע מ-Claude Sonnet 5.5 במחירון. שנית, הפער שחישבתם עליו מצטמצם מ-20x ל-4x בדיוק כשעומס העבודה שלכם מתגבר, וזה בדיוק כשהמספרים המוחלטים מתחילים להיות חשובים. השלב הוא הסיבה לכך שצינור עיבוד רגיש לעלויות זקוק לשורת תקציב משלו ולא לתעריף לפי טוקן.
מה כל ספק מדווח שהוא משיג
כל מה שמופיע בסעיף זה מדווח על ידי הספק ואינו משוחזר על ידי צד שלישי. Anthropic מפרסמת את אותו מערך השוואות בעמודי Claude Haiku 5.5 ו-Claude Sonnet 5.5 שלה, ובמקומות שבהם שני העמודים חופפים הם מסכימים:
• GDPval-AA v2.1, עבודת ידע — 1,620 עבור Claude Haiku 5.5, לעומת 1,840 עבור Claude Sonnet 5.5, 735 עבור Claude Haiku 4.5 ו-1,437 עבור GPT-6 Luna.
• AA-Briefcase v1.1 — 1,578 עבור Claude Haiku 5.5, לעומת 1,824 עבור Claude Sonnet 5.5, 614 עבור Claude Haiku 4.5 ו-1,336 עבור GPT-6 Luna.
• OSWorld 2.1, שימוש במחשב, תת-קבוצה לא מקוונת — 72.4% עבור Claude Haiku 5.5, לעומת 83.9% עבור Claude Sonnet 5.5, 15.7% עבור Claude Haiku 4.5 ו-48.9% עבור GPT-6 Luna.
• Terminal-Bench 4.0, קידוד סוכני — 39.2% עבור Claude Haiku 5.5, לעומת 70.6% עבור Claude Sonnet 5.5, 0.0% עבור Claude Haiku 4.5 ו-16.4% עבור GPT-6 Luna.
• FrontierCode 1.1, Main — 46.4% עבור Claude Haiku 5.5, לעומת 52.1% עבור Claude Sonnet 5.5 ברמת מאמץ Xhigh, 42.4% עבור GPT-6 Luna. Anthropic גם מציינת ש-Claude Sonnet 5.5 מקבל ציון נמוך יותר ברמת מאמץ Max מאשר ברמת מאמץ Xhigh במקרה הזה, מה שהיא מייחסת לשימוש תכוף יותר במיומנות סקירת קוד הגורם לפסקי זמן או לעריכות מחוץ לתחום.
• Chartography, חשיבה חזותית ללא כלים — 46.4% עבור Claude Haiku 5.5, לעומת 61.6% עבור Claude Sonnet 5.5, 6.4% עבור Claude Haiku 4.5 ו-29.1% עבור GPT-6 Luna.
• Humanity's Last Exam — 45.9% ללא כלים ו-57.4% איתם עבור Claude Haiku 5.5; 64.5% עם כלים עבור Claude Sonnet 5.5, 18.7% עבור Claude Haiku 4.5, ו-56.9% ללא כלים עבור Claude Sonnet 5.5 באותו עמוד. Anthropic מציינת כי ייתכן שהנתונים של משפחת GPT-6 מיושנים מכיוון ש-OpenAI תיקנה באג בהבנת תמונות וציוני צד שלישי לא כולם עודכנו.
שתיים מהשורות האלה שוות קריאה כפולה. ב-FrontierCode שני המודלים בכלל קרובים — 46.4% מול 52.1% — וב-Chartography, שבו אין כלים שאפשר להתחבא מאחוריהם, הפער הוא 15 נקודות. Terminal-Bench 4.0 ממש לא צמוד: 39.2% מול 70.6% הם סוג יכולת אחר, ולכן העמוד של Anthropic עבור Claude Sonnet 5.5 עדיין מפנה אל Claude Sonnet 5.5 ו-Claude Opus 5.5 לקידוד אג'נטי מורכב, ומציג את Claude Haiku 5.5 כמודל לעבודה ממוקדת ובהיקף גבוה.
מה שדירקטוריון עצמאי מוסיף
המספרים של Anthropic משווים את המודלים שלה זה לזה ולמתחרה אחד. לוח עצמאי מעמיד את שניהם מול כל התחום, והנתון שהוא מדווח והספקים אינם מדווחים הוא עלות לכל משימה שהושלמה.
Artificial Analysis מדרגת את Claude Haiku 5.5 במצב Max effort עם Intelligence Index של 43, הרבה מעל החציון של 13 בקרב מודלים דומים, כשהוא מייצר 440M אסימוני פלט ב-Intelligence Index לעומת חציון של 100M — מאוד מפורט — במחיר של $0.10 לקלט ו-$0.50 לפלט למיליון, ובקצב של 242 אסימוני פלט לשנייה. העלות הנמדדת שלו היא $0.21 לכל משימת Intelligence Index.
אותו לוח מעניק ל-Claude Sonnet 5.5 ציון 56, לעומת חציון של 26, כשהוא מייצר 410 מיליון טוקנים בפלט לעומת חציון של 88 מיליון, במחיר של $2.00 לקלט ו-$10.00 לפלט עם הנחת מטמון של 90%. העלות הנמדדת שלו היא $7.60 לכל Intelligence Index.


שימו את שתי השורות זו לצד זו, והיחס הוא כל הסיפור. $0.21 מול $7.60 זה קצת יותר מפי 36, ושתי המודלים כמעט שווים במילוליות — 440M טוקני פלט מול 410M — כך שהמכפיל הזה נובע כמעט כולו מכך שהמחירון עושה את מה שהמחירון אומר שהוא יעשה. במחירון של הספק עצמו אותה השוואה היא פי 20. התוספת מגיעה מהדברים שמחיר לפי טוקן לא יכול להראות: המודל הזול מגיע לתשובה שלו במספר קטן יותר של טוקנים מחויבים לכל משימה בהגדרת המאמץ הזו, וקריאות מטמון מחויבות בעשירית מהתעריף של Claude Sonnet 5.5. אותו הרנס, אותן משימות, נמדד באופן בלתי תלוי.

היכן שהדרגה הזולה באמת נגמרת
הנתונים של הלקוחות שאנתרופיק מפרסמת מכריעים את הכף לעתים קרובות יותר מאשר מדדי הבנצ'מרק, וכולם מצביעים לאותו כיוון. Asana מדווחת על השהיה נמוכה ביותר מ-30% בהשלמת משימות ועל הסקה מהירה עד פי 2.5 לכל תור של סוכן. Box מדווחת על ציון גבוה ב-11 נקודות מזה של Claude Haiku 4.5, בכמחצית מהשהיה. HubSpot מדווחת על הציון הטוב ביותר שראתה בסוויטה שלה, 92.8% בממוצע על פני שלוש הרצות, עם שיעור הפגיעות הגבוה ביותר ושיעור החיוביים-הכוזבים הנמוך ביותר. AlphaSense מריצה כ-8 מיליון קריאות בשבוע דרך "Ask in Document" ומדווחת על שיפור מובהק סטטיסטית לעומת Claude Haiku 4.5, 0.84 לעומת 0.76. Cognition מדווחת שעם Claude Haiku 5.5 כעוזר, סוכן ה-Fusion שלה מחזיק בציון FrontierCode של 66.2.
אף אחד מאלה אינו סוכן ארוך-טווח. הם פתרונות נקודתיים — צעד אחד מוגדר היטב, מהיר וזול יותר. זו הצורה שלשמה נבנה Claude Haiku 5.5, וזו גם הצורה שבה יתרון העלות של פי 36 הוא כסף אמיתי ולא שגיאת עיגול. היתרון מצטבר עם נפח הקריאות ומתנדף עם עומק הקריאה: מאה אלף קריאות סיווג ביום במחיר של $0.10 בקלט ו-$0.50 בפלט הוא סעיף שאתם שמים לב שהוא נעלם, ואילו מאה סבבי סוכן בסשן, שכל אחד מהם קורא מחדש את ההקשר המצטבר, הוא סעיף שגדל באופן סופר-ליניארי, מפני שכל סבב מעבר לסף משלם את המדרגה הגבוהה יותר.
הטיעון הנגדי של Claude Sonnet 5.5 הוא עלות לכל ניסיון ולא עלות לכל טוקן. Anthropic אומרת שהיא פועלת מהר יותר ב-30%+ מ-Claude Sonnet 5 ועולה עד 30% פחות עבור רוב העבודות, כשהחיסכון נובע מהצורך בפחות טוקנים ולא משיעורים נמוכים יותר. בודקים מצד שלישי נותנים לכך מספרים: Slack מדווחת על כ-14% פחות טוקני פלט, Balyasny בערך 121k טוקנים לתשובה לעומת 497k, Box מהירה פי 2.4 עם 12% פחות טוקנים, Lovable בערך שליש פחות קריאות לכלים ובערך חצי מהרצות ה-shell, אצל Atlassian סוכני Rovo מהירים עד 30% יותר, ו-Base44 3.6 איטרציות לכל בנייה לעומת 7.7 עבור Claude Opus 5. סבב אחד שמצליח עדיף על ארבעה שלא.
יש גורם שלישי שפועל בכיוון ההפוך. Anthropic העבירה את המאמץ להגדרה ברמת המודל בדור הזה — הגדרת המאמץ של Claude Haiku 5.5 נקבעת פעם אחת לכל בקשה, במקום להיות מתומחרת כתקציב חשיבה לכל בקשה, וbudget_tokens — המצב הישן — הוצא משימוש במודלים 4.6 ואינו מתקבל במודלים מאוחרים יותר. עבור צי של שירותים רבים שקוראים למזהה מודל אחד, זהו פישוט. עבור כל דבר שתִקצב את החשיבה שלו בנפרד לכל קריאה, זהו שכתוב.
הרצת שניהם מאחורי נקודת קצה אחת
הסיבה שכדאי להחליט נכון היא שטעות בחציו יקרה לביטול: חיווט מחדש של נתיב ייצור ממזהה מודל אחד לאחר פירושו לגעת בכל מקום קריאה שהניח את ההתנהגות של הישן. הדרך הזולה יותר לגלות לאיזו שכבה שייך עומס עבודה היא להריץ את שניהם מאחורי נקודת קצה אחת ולהעביר תעבורה ביניהם באמצעות קונפיגורציה ולא באמצעות ריפקטור.
לשם כך נועד OrcaRouter. Claude Sonnet 5.5 מופיע בקטלוג בתור anthropic/claude-sonnet-5.5, לצד Claude Sonnet 5, Claude Opus 5.5 ו-Claude Haiku 4.5 — שכבת ה-Haiku הוותיקה יותר נשארת זמינה כנקודת ייחוס בזמן שאתם נודדים ממנה. הפלטפורמה מעבירה הלאה את מחיר המחירון של הספק ללא כל תוספת, כך שה-$2.00 וה-$10.00 שלמעלה הם המחירים שאתם משלמים, והדבר נכון גם בכיוון ההפוך: כשספק מעדכן מחירים, המחיר החדש פעיל כאן עוד באותו יום, וכך גם הגיעה אלינו הפחתת מחיר קריאת המטמון של Claude Sonnet 5.5. שני מאפיינים עושים את העבודה שההחלטה המסוימת הזאת מצריכה. מעבר אוטומטי לגיבוי מרחיק מהמסלול הקריטי שלכם מודל שאתם עדיין בוחנים באופן עצמאי, וה-DSL של הניתוב מאפשר לכם לשלוח קריאות של פחות מ-100,000 טוקנים לשכבה הזולה, ולהעביר את אלה עם ההקשר הארוך או הטווח הארוך לזו היקרה יותר באותה זרימת בקשות, בלי חוזה נוסף או SDK נוסף.
כדי לדייק לגבי מה מתארח ומה לא: Claude Sonnet 5.5 ניתן לניתוב דרכנו היום. Claude Haiku 5.5 עדיין לא נמצא בקטלוג. עד שזה יקרה, הוא מתארח ב-API של Anthropic עצמה ובשלוש פלטפורמות הענן המפורטות לעיל.
איך להחליט
בחר Claude Haiku 5.5 כשהמשימה צרה, בנפח גבוה וניתנת לבדיקה — סיווג, חילוץ, ניתוב, תמצות, העבודה בכל תור בתוך סוכן שכבר בנית. פער התעריפים של פי 20 הוא כל הנקודה שם, שלב 100,000 הטוקנים ניתן להימנע ממנו מעצם התכנון, והמדידה הבלתי תלויה של $0.21 למשימה מלמדת שהיתרון שורד גם מחוץ למעבדה של הספק עצמו. כוונן את חוגת המאמץ לפי סוג המשימה במקום להשאיר אותה על ברירת המחדל; במודל בדרגת Haiku ההבדל בין Low ל-Max הוא מכפיל עלות, לא העדפת איכות.
בחרו ב-Claude Sonnet 5.5 כאשר המשימה היא ארוכת-טווח, סוכנית או בלתי ניתנת לאימות — קוד שחייב להתקמפל, שימוש במחשב שחייב להשאיר את המסך במצב ידוע, כל דבר שבו תשובה שגויה עולה יותר מהקריאה. Terminal-Bench 4.0 עם 70.6% מול 39.2% אינו ניואנס, זהו סוג יכולת שונה, ומחירון אחיד פירושו שהקשר ארוך אינו מתמחר מחדש בשקט את כל הבקשה. אם עומס העבודה שלכם הוא באמת באמצע, התשובה הכנה היא שלאף אחד מהמודלים אין עדיין גוף רחב של שחזור על ידי צד שלישי, ציוני המדד מגיעים מהרנס בודד, והנתונים מהספק המצוטטים לעיל הם של הספק עצמו.
מה היה משנה את התשובה הזו
יש שלושה דברים שכדאי לעקוב אחריהם, ואף אחד מהם אינו שחרור של בנצ'מרק. הראשון הוא האם הערכות בלתי תלויות של Claude Haiku 5.5 במאמץ Low, High ו-Xhigh — לא רק Max — מראות את אותו יחס עלות-למשימה, כי חוגת המאמץ היא המנוף הזול ביותר בהשוואה והפחות נמדד. השני הוא האם מדרגת 100,000 הטוקנים שורדת; פס שלישי, או ללא פס בכלל בדור הבא, ישנה את האריתמטיקה עבור כל צינור אחזור בשורה יותר מכל ציון בנצ'מרק בודד. השלישי הוא הטוקנייזר. אם נקודת ביקורת מאוחרת יותר תבצע טוקניזציה לאותו טקסט בקצב הישן, הממוצע של 75% של Anthropic יהפוך לרצפה במקום ליעד, והפער מול Claude Sonnet 5.5 יגדל מבלי שאף אחד מהמחירים זז.
השוואות במאמר הזה2
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
