כרטיס hero שנוצר עבור "Claude Haiku 5.5 עולה עשירית מהמחיר", עם תג "CLAUDE הזול ביותר", עם הקיקר "ANTHROPIC, 7 באוקטובר 2026" ותת-הכותרת "קיצוץ של 90% בתעריף, טוקנייזר שמוסיף כ-30% יותר טוקנים, וסרטון השקה ש-Anthropic לא פרסמה". ארבעה צ'יפים מציגים "$0.10 קלט", "$0.50 פלט", "הקשר 1M" ו-"75% חיסכון אמיתי". שני כרטיסים למטה מסומנים "מה ירד" ("קלט $1.00 ל-$0.10, פלט $5.00 ל-$0.50 מתחת ל-100,000 טוקנים") ו"מה עלה" ("אותו טקסט נספר ככ-30% יותר טוקנים מאשר לפני כן"). בתחתית כתוב "תיעוד תמחור של הספק נקרא ב-8 באוקטובר 2026". הלוגו של OrcaRouter משולב בפינה הימנית התחתונה.
Guides & Insights

Claude Haiku 5.5: הוזלה של 90%, טוקנייזר חדש, והסרטון ש-Anthropic לא פרסמה

מחבר

Rowan Sterling

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

מישהו הקליד משפט אחד לתוך Claude Haiku 5.5 וקיבל בחזרה סרט השקה מוגמר. הפרומפט, שפורסם ב-X בערב ה-7 באוקטובר 2026, נאמר במלואו: "צור סרטון פי 10 יותר פצצה להשקה שלך, שמראה כמה טוב אתה כמעצב מושן." הכיתוב של הפוסט הוא בן שלוש מילים — "עשיתי את הסרטון הזה במכה אחת" — והוא כולל את הקליפ כקובץ מצורף. בלי ניסיונות חוזרים, בלי סטוריבורד, בלי עורך. אם זה מה שהדגם הזול ביותר בקו של Claude עושה עכשיו, הדרגה הזאת הפסיקה להיות פשרה.

זהו החצי המעניין של ההשקה. החצי האחר הוא אריתמטיקה, ושם יושבות החדשות האמיתיות: Claude Haiku 5.5 עולה $0.10 למיליון טוקני קלט ו-$0.50 למיליון טוקני פלט עבור פרומפטים של עד 100,000 טוקנים, לעומת Claude Haiku 4.5 שעולה $1 ו-$5 בתעריף אחיד. ההערה השולית של Ant​hropic עצמה מכנה זאת 90% פחות במקרה הנפוץ — ואז אומרת, באותה נשימה, שהמספר שכדאי לקונה לתכנן לפיו קרוב יותר ל-75%. שני המספרים נכונים, והפער ביניהם הוא הדבר החשוב ביותר בהשקה הזאת.

מה שאנתרופיק הצהירה רשמית ב-7 באוקטובר

פוסט ההשקה של הספק ותיעוד התמחור שלו מסכימים על הצורה של הדבר, וזהו צעד גדול יותר ממה שהורדת מחיר בדרך כלל טומנת בחובה.

A generated scoreboard titled 'Claude Haiku 5.5 benchmark table - Anthropic's own harness' with two columns. Claude Haiku 5.5 reads GDPval-AA v2.1 1620, AA-Briefcase v1.1 1578, OSWorld 2.1 72.4%, Humanity's Last Exam 45.9%, Terminal-Bench 4.0 39.2% and Chartography 46.4%. Claude Haiku 4.5 reads 735, 614, 15.7%, 10.2%, 0.0% and 6.4%. A footer reads 'Vendor-reported evaluations published by Anthropic on October 7, 2026; not independently reproduced.'

• מחיר — $0.10 למיליון טוקני קלט ו-$0.50 למיליון טוקני פלט עבור פרומפטים של עד 100,000 טוקנים. מעל לסף זה, אותה בקשה מחויבת ב-$0.50 ו-$2.50. קריאות מטמון עולות $0.01 למיליון עד 100K ו-$0.05 מעל לכך; כתיבות מטמון הן $0.125 ו-$0.625.

• הקשר — מיליון טוקנים, עם פלט מרבי של 128,000 טוקנים. זהו אותו חלון ואותה תקרת פלט שיש ל-Claude Fable 5.1, Claude Opus 5.5 ו-Claude Sonnet 5.5, משוכפלים בדרג הזול ביותר.

• חשיבה — חשיבה אדפטיבית עם פרמטר effort, כשברירת המחדל היא medium. Anthropic מציינת שזהו המודל הראשון ברמת Haiku עם הגדרת effort מתכווננת, מה שאומר שניתן להריץ את אותו model id בזול או בזהירות בלי לשנות שום דבר אחר.

• טוקנייזר — הטוקנייזר החדש יותר שמשותף עם Claude 4.7 ואילך, אשר "מייצר כ-30% יותר טוקנים עבור אותו טקסט." בתיעוד של Anthropic נאמר שהעלייה המדויקת תלויה בתוכן ובצורת עומס העבודה.

• מחזור חיים — חיתוך ידע יוני 2026, והתחייבות לפרישה של "לא לפני 7 באוקטובר 2027."

• זמינות — Claude API, Amazon Web Services, Goo​gle Cloud, Microsoft Azure ו-Claude Platform on AWS, הכול בבת אחת כבר ביום הראשון.

מדבקת ה-10x ומציאות ה-75%

זול פי עשרה הוא המספר שיגיע הכי רחוק, והוא זה שסביר ביותר שיגיע למקום הלא נכון במודל התקציב של מישהו. זה חל על פרומפטים של עד 100,000 טוקנים. Haiku 5.5 לא מחזיק בתעריף הזה לכל אורך החלון.

• עד 100,000 טוקנים — $0.10 בקלט ו-$0.50 בפלט, לעומת $1 ו-$5 של Haiku 4.5. זו הפחתה של 90%, ו-Anth​ropic אומרת ש-90% מהבקשות למודל Haiku הקודם נפלו בטווח הזה.

• למעלה מ-100,000 טוקנים — $0.50 בקלט ו-$2.50 בפלט. עדיין בדיוק חצי ממה ש-Haiku 4.5 גבה, על אותה בקשה, בלי תקרה להיתקל בה.

• הטוקנייזר — אותו טקסט הופך לכ-30% יותר טוקנים מאשר ב-Haiku 4.5, כך שהקיצוץ לכל טוקן לא מתורגם אחד לאחד לחשבון קטן יותר.

• הממוצע של הספק עצמו — Anthropic מציגה את השילוב כ"כ-75% פחות להרצה". זה הנתון שלה, לא מדידה בלתי תלויה, והוא זה שצריך להכניס לתחזית.

• כלכלת המטמון — קריאות מטמון ירדו מ-$0.10 ל-$0.01 למיליון ברצועה הנפוצה, מה שחשוב יותר מתעריף הקלט עבור כל צינור עיבוד ששולח מחדש קידומת משותפת ארוכה.

הנתון של 75% גם מסביר משהו שקורא עלול אחרת לפרש כסתירה. שני מספרי הכותרת אינם בסתירה; האחד הוא שיעור עבור צורת בקשה, והאחר הוא אומדן משולב על פני תמהיל תנועה אמיתי שכולל את המיעוט שמעל 100K ואת הטוקנים הנוספים של הטוקנייזר. אם אתם מדמים הוצאות, השתמשו ב-75% ובדקו את התפלגות אורך הפרומפטים שלכם לפני שתאמינו במשהו טוב יותר.

מה שהסרטון טוען, ומה שהוא לא.

הקטע אמיתי, הפרומפט מצוטט מילה במילה לעיל, וחותמת הזמן — 19:49 UTC ב-7 באוקטובר, בערך באותו היום שבו המודל עלה לאוויר — ניתנת לבדיקה. הייחוס הוא למשתמש יחיד, ולא ל-Ant​hropic.

ההבחנה הזו חשובה כאן, משום שעמוד המוצר של Anthropic עצמה עבור Claude Haiku 5.5 אינו כולל וידאו מוטמע כלל: אין נגן, אין קובץ מדיה, רק קישור לערוץ היוטיוב של החברה. אם סרט השקה נוצר עם המודל, הספק לא אמר זאת. לכן ההצהרה המדויקת היא צרה: משתמש מדווח שיצר סרט השקה בניסיון אחד עם Claude Haiku 5.5, ופרסם את הפרומפט. אם זה היה בניסיון אחד, מה זה עלה, וכמה ממנו שרד את העריכה — כל אלה טענות ממקור אחד. התייחסו לקליפ כהדגמה, לא כמבחן ביצועים.

הסיבה שזה בכל זאת ראוי לציון היא שיצירת וידאו אינה במפרט של המודל. Haiku 5.5 קולט טקסט ותמונות ומחזיר טקסט. תוצאה של עיצוב תנועה באיכות כזו מרמזת שהמודל הפעיל משהו אחר — מסלול של יצירת קוד, צינור רינדור, לולאת כלים — ולא הפיק פריימים בעצמו. זו אמירה על תזמור סוכני בעלות קלט של $0.10, וזה החלק המפתיע באמת.

המספרים שאנתרופיק פרסמה

טבלת ההשקה של הספק היא השוואת לפני ואחרי מול Haiku 4.5, כאשר GPT-6 Luna ו-Claude Sonnet 5.5 מופיעים באותן עמודות לצורך קנה מידה. כל נתון להלן הוא תוצאת הערכה מדווחת של ‌Anthropic עצמה, שהורצה בהרנס של ‌Anthropic, ומובא כפי שהוא אך לא אומת באופן בלתי תלוי.

A screenshot of Anthropic's Claude Haiku 5.5 launch page, dated October 7 2026 and headed with the model name, the identifier claude-haiku-5-5 and the launch standfirst, with the vendor's reported evaluation rows and pricing notes below.

• עבודת ידע — GDPval-AA v2.1 ב-1620 לעומת 735 של Haiku 4.5, 1437 של GPT-6 Luna ו-1840 של Sonnet 5.5. AA-Briefcase v1.1 ב-1578 לעומת 614, 1336 ו-1824.

• שימוש במחשב — OSWorld 2.1 ב-72.4% בתת-הקבוצה הלא-מקוונת, לעומת 15.7% עבור Haiku 4.5, 48.9% עבור GPT-6 Luna ו-83.9% עבור Sonnet 5.5.

• חשיבה רב-תחומית — Humanity's Last Exam ב-45.9% ללא כלים וב-57.4% איתם, לעומת 10.2% ו-18.7% עבור Haiku 4.5.

• קידוד סוכני — Terminal-Bench 4.0 ב-39.2% לעומת 0.0%, 16.4% ו-70.6%. FrontierCode 1.1 (Main) ב-46.4% לעומת 42.4% עבור GPT-6 Luna ו-52.1% עבור Sonnet 5.5.

• חשיבה חזותית — Chartography ב-46.4% עם כלים, לעומת 6.4%, 29.1% ו-61.6%.

Ant​hropic גם ישירה באופן יוצא דופן לגבי היכן שדרגת המודלים הקטנה אינה מנצחת. הפרשנות שלה עצמה על התרשים של Terminal-Bench אומרת ש-Sonnet 5.5 ו-Opus 5.5 "נותרים בחירות טובות יותר למשימות קידוד אג'נטיות מורכבות", וממקמת את Haiku 5.5 לעבודת דחיסה, סיכום ותת-סוכנים במקום זאת. הציטוטים מהלקוחות בפוסט מצביעים לאותו כיוון ונושאים את אותה הסתייגות — אלה שותפי גישה מוקדמת המתארים את ההערכות שלהם עצמם, ולא ביקורות: Asana מדווחת על השהיה נמוכה ביותר מ-30% בהשלמת משימות ועד פי 2.5 הסקה מהירה יותר לכל סבב של סוכן; HubSpot מדווחת על 92.8% בממוצע על פני שלוש הרצות על חבילת פורטל CRM; AlphaSense מדווחת על 0.84 לעומת 0.76 על פני 400 שאילתות בעומס עבודה שמבצע כ-8 מיליון קריאות בשבוע; Box מדווחת על 11 נקודות יותר מ-Haiku 4.5 בכמחצית מההשהיה; Rogo מתארת תת-סוכן Haiku 5.5 שמחלץ שורת הכנסות של סגמנט מתוך דוח 10-K; ו-Cognition מדווחת ש-Devin Fusion מחזיק בציון FrontierCode של 66.2 עם Haiku 5.5 כעוזר הצמוד.

מה שהמועצה העצמאית אומרת

טבלאות הספק הן של הספק. המיקום החיצוני הראשון הוא המספר השימושי יותר לכל מי שמחליט אם השכבה זזה מספיק רחוק כדי לשנות צינור ייצור.

A screenshot of the Artificial Analysis model page for Claude Haiku 5.5 in its Max configuration, showing an Intelligence Index v4.3.2 score of 43.40 ranked second of 182 models, an output speed of 242 tokens per second, a cost of $0.21 per Intelligence Index task, and the evaluator's note that the model generated 440 million output tokens against a 100 million median and is very verbose.

Artificial Analysis מעניקה ל-Claude Haiku 5.5 ציון 43 במדד ה-Intelligence Index v4.3.2 שלה, בתצורת Max של המודל, במקום השני מבין 182 המודלים באותו לוח, והרחק מעל החציון של הלוח, 13. באותו עמוד נמדדים 242 אסימוני פלט בשנייה — המקום התשיעי מתוך 182 — ובעלות של 0.21 דולר לכל משימת Intelligence Index.

שני דברים בעמוד הזה שווים יותר מהכותרת. הראשון הוא מילוליות: בהערכת ה-Index, Artificial Analysis תיעדה 440 מיליון טוקני פלט, לעומת חציון של 100 מיליון, ומתארת את המודל כ"מילולי מאוד". תג מחיר נגבה לכל טוקן, לכן מודל שחושב באריכות משלם על כך — וזו בדיוק הסיבה לכך שנתון העלות למשימה עומד על $0.21 ולא על קרוב לאפס, ומדוע הקיצוץ של 90% בקלט אינו כל הסיפור. השני הוא סולם המאמץ: אותו עמוד חושף תצורות מ-Max ועד Low, וברירת המחדל של Ant​hropic היא medium, לא max. הציון 43 בלוח הוא הדרגה העליונה בסולם הזה, לא ההגדרה שמקבלים אם לא עושים כלום.

הרצת השכבה שמתחת לשכבה שאתה כבר יכול לקרוא לה

Claude Haiku 5.5 אינו מופיע בקטלוג של OrcaRouter, וכדאי לומר זאת בפשטות במקום לרמוז אחרת: הפער ביום ההשקה בין קיומו של מודל לבין היותו ניתן לניתוב הוא בדרך כלל ימים, ולפעמים יותר.

מה שנמצא בקטלוג של Ant​hropic היום הוא Claude Haiku 4.5, Claude Sonnet 5.5 ו-Claude Opus 5.5, כל אחד במחיר המחירון של הספק כפי שהוא מועבר הלאה עם 0% תוספת, כך שכל הורדת מחיר ש-Ant​hropic עושה נוחתת על הצד שלנו באותו יום שבו היא נוחתת על הצד שלהם. זה הגשר המעשי לכל מי שרוצה להתנסות בתבנית סוכני המשנה כבר עכשיו: מפל שמעביר את הפניות השגרתיות אל Haiku 4.5 ומסלים את הקשות כלפי מעלה עובד היום תחת מפתח אחד ו-SDK אחד, והחלפת הרגל הקטנה ל-Haiku 5.5 בהמשך היא שינוי של model-id ולא הגירה. מעבר אוטומטי לגיבוי נמצא מתחת לכל רגל שתבחרו, כך שאחר צהריים רע של ספק בודד לא מפיל איתו את הצינור.

אם אתם מעדיפים לא לחכות כלל, אותה רצועת קלט של $0.10 כבר תפוסה על ידי GPT-6 Luna, שאותה אנחנו כן מנתבים, ואשר שומרת על התעריף הזה עד 272,000 טוקנים לפני עליית מדרגה.

מי צריך לזוז, ומי לא

אם עומס העבודה שלכם הוא סיווג, חילוץ, ניתוב, דחיסה או תמצות בהיקף גדול, והפרומפטים שלכם נמצאים מתחת ל-100,000 טוקנים, המקרה פשוט: התעריף הוא עשירית ממה שהיה, החלון רחב פי חמישה, וחוגת המאמץ מאפשרת לכם לסחור בכיוון ההפוך כשבקשה צריכה זאת. תקצבו בסביבות 75% פחות ולא תופתעו.

אם הפרומפטים שלך עוברים באופן שגרתי את 100,000 הטוקנים, אתה קונה בהנחה של 50% ולא של 90%, והשוואת מחירים בהקשר עמוק עדיין שווה את אחר הצהריים — בתחום יש כמה מודלים במחיר השווה לתעריף של הרמה הזו מעל 100K או נמוך ממנו.

ואם ההערכה שלך עדיין נכשלת בעבודה בסגנון Terminal-Bench, זה לא המודל שמתקן את זה; Anthropic אומרת זאת בעצמה, וה-39.2% מול 70.6% של Sonnet 5.5 הוא הראיה הנקייה ביותר בפוסט. הסיכום הכנה של ה-7 באוקטובר הוא שרצפת הבינה השימושית ירדה רחוק מאוד והתקרה לא זזה כלל.

השוואות במאמר הזה1

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית