
Claude Haiku 5.5: הוזלה של 90%, טוקנייזר חדש, והסרטון ש-Anthropic לא פרסמה
- openaiחדשOpenAI: GPT-6.1 Sol2026-09-2952אינטליגנציה
- anthropicחדשAnthropic: Claude Sonnet 5.52026-09-2856אינטליגנציה
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238אינטליגנציה
- OpenAIOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIGrok 4.72026-09-2146אינטליגנציה
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 לכל 1M טוקנים · 65 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 360 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
מישהו הקליד משפט אחד לתוך Claude Haiku 5.5 וקיבל בחזרה סרט השקה מוגמר. הפרומפט, שפורסם ב-X בערב ה-7 באוקטובר 2026, נאמר במלואו: "צור סרטון פי 10 יותר פצצה להשקה שלך, שמראה כמה טוב אתה כמעצב מושן." הכיתוב של הפוסט הוא בן שלוש מילים — "עשיתי את הסרטון הזה במכה אחת" — והוא כולל את הקליפ כקובץ מצורף. בלי ניסיונות חוזרים, בלי סטוריבורד, בלי עורך. אם זה מה שהדגם הזול ביותר בקו של Claude עושה עכשיו, הדרגה הזאת הפסיקה להיות פשרה.
זהו החצי המעניין של ההשקה. החצי האחר הוא אריתמטיקה, ושם יושבות החדשות האמיתיות: Claude Haiku 5.5 עולה $0.10 למיליון טוקני קלט ו-$0.50 למיליון טוקני פלט עבור פרומפטים של עד 100,000 טוקנים, לעומת Claude Haiku 4.5 שעולה $1 ו-$5 בתעריף אחיד. ההערה השולית של Anthropic עצמה מכנה זאת 90% פחות במקרה הנפוץ — ואז אומרת, באותה נשימה, שהמספר שכדאי לקונה לתכנן לפיו קרוב יותר ל-75%. שני המספרים נכונים, והפער ביניהם הוא הדבר החשוב ביותר בהשקה הזאת.
מה שאנתרופיק הצהירה רשמית ב-7 באוקטובר
פוסט ההשקה של הספק ותיעוד התמחור שלו מסכימים על הצורה של הדבר, וזהו צעד גדול יותר ממה שהורדת מחיר בדרך כלל טומנת בחובה.

• מחיר — $0.10 למיליון טוקני קלט ו-$0.50 למיליון טוקני פלט עבור פרומפטים של עד 100,000 טוקנים. מעל לסף זה, אותה בקשה מחויבת ב-$0.50 ו-$2.50. קריאות מטמון עולות $0.01 למיליון עד 100K ו-$0.05 מעל לכך; כתיבות מטמון הן $0.125 ו-$0.625.
• הקשר — מיליון טוקנים, עם פלט מרבי של 128,000 טוקנים. זהו אותו חלון ואותה תקרת פלט שיש ל-Claude Fable 5.1, Claude Opus 5.5 ו-Claude Sonnet 5.5, משוכפלים בדרג הזול ביותר.
• חשיבה — חשיבה אדפטיבית עם פרמטר effort, כשברירת המחדל היא medium. Anthropic מציינת שזהו המודל הראשון ברמת Haiku עם הגדרת effort מתכווננת, מה שאומר שניתן להריץ את אותו model id בזול או בזהירות בלי לשנות שום דבר אחר.
• טוקנייזר — הטוקנייזר החדש יותר שמשותף עם Claude 4.7 ואילך, אשר "מייצר כ-30% יותר טוקנים עבור אותו טקסט." בתיעוד של Anthropic נאמר שהעלייה המדויקת תלויה בתוכן ובצורת עומס העבודה.
• מחזור חיים — חיתוך ידע יוני 2026, והתחייבות לפרישה של "לא לפני 7 באוקטובר 2027."
• זמינות — Claude API, Amazon Web Services, Google Cloud, Microsoft Azure ו-Claude Platform on AWS, הכול בבת אחת כבר ביום הראשון.
מדבקת ה-10x ומציאות ה-75%
זול פי עשרה הוא המספר שיגיע הכי רחוק, והוא זה שסביר ביותר שיגיע למקום הלא נכון במודל התקציב של מישהו. זה חל על פרומפטים של עד 100,000 טוקנים. Haiku 5.5 לא מחזיק בתעריף הזה לכל אורך החלון.
• עד 100,000 טוקנים — $0.10 בקלט ו-$0.50 בפלט, לעומת $1 ו-$5 של Haiku 4.5. זו הפחתה של 90%, ו-Anthropic אומרת ש-90% מהבקשות למודל Haiku הקודם נפלו בטווח הזה.
• למעלה מ-100,000 טוקנים — $0.50 בקלט ו-$2.50 בפלט. עדיין בדיוק חצי ממה ש-Haiku 4.5 גבה, על אותה בקשה, בלי תקרה להיתקל בה.
• הטוקנייזר — אותו טקסט הופך לכ-30% יותר טוקנים מאשר ב-Haiku 4.5, כך שהקיצוץ לכל טוקן לא מתורגם אחד לאחד לחשבון קטן יותר.
• הממוצע של הספק עצמו — Anthropic מציגה את השילוב כ"כ-75% פחות להרצה". זה הנתון שלה, לא מדידה בלתי תלויה, והוא זה שצריך להכניס לתחזית.
• כלכלת המטמון — קריאות מטמון ירדו מ-$0.10 ל-$0.01 למיליון ברצועה הנפוצה, מה שחשוב יותר מתעריף הקלט עבור כל צינור עיבוד ששולח מחדש קידומת משותפת ארוכה.
הנתון של 75% גם מסביר משהו שקורא עלול אחרת לפרש כסתירה. שני מספרי הכותרת אינם בסתירה; האחד הוא שיעור עבור צורת בקשה, והאחר הוא אומדן משולב על פני תמהיל תנועה אמיתי שכולל את המיעוט שמעל 100K ואת הטוקנים הנוספים של הטוקנייזר. אם אתם מדמים הוצאות, השתמשו ב-75% ובדקו את התפלגות אורך הפרומפטים שלכם לפני שתאמינו במשהו טוב יותר.
מה שהסרטון טוען, ומה שהוא לא.
הקטע אמיתי, הפרומפט מצוטט מילה במילה לעיל, וחותמת הזמן — 19:49 UTC ב-7 באוקטובר, בערך באותו היום שבו המודל עלה לאוויר — ניתנת לבדיקה. הייחוס הוא למשתמש יחיד, ולא ל-Anthropic.
ההבחנה הזו חשובה כאן, משום שעמוד המוצר של Anthropic עצמה עבור Claude Haiku 5.5 אינו כולל וידאו מוטמע כלל: אין נגן, אין קובץ מדיה, רק קישור לערוץ היוטיוב של החברה. אם סרט השקה נוצר עם המודל, הספק לא אמר זאת. לכן ההצהרה המדויקת היא צרה: משתמש מדווח שיצר סרט השקה בניסיון אחד עם Claude Haiku 5.5, ופרסם את הפרומפט. אם זה היה בניסיון אחד, מה זה עלה, וכמה ממנו שרד את העריכה — כל אלה טענות ממקור אחד. התייחסו לקליפ כהדגמה, לא כמבחן ביצועים.
הסיבה שזה בכל זאת ראוי לציון היא שיצירת וידאו אינה במפרט של המודל. Haiku 5.5 קולט טקסט ותמונות ומחזיר טקסט. תוצאה של עיצוב תנועה באיכות כזו מרמזת שהמודל הפעיל משהו אחר — מסלול של יצירת קוד, צינור רינדור, לולאת כלים — ולא הפיק פריימים בעצמו. זו אמירה על תזמור סוכני בעלות קלט של $0.10, וזה החלק המפתיע באמת.
המספרים שאנתרופיק פרסמה
טבלת ההשקה של הספק היא השוואת לפני ואחרי מול Haiku 4.5, כאשר GPT-6 Luna ו-Claude Sonnet 5.5 מופיעים באותן עמודות לצורך קנה מידה. כל נתון להלן הוא תוצאת הערכה מדווחת של Anthropic עצמה, שהורצה בהרנס של Anthropic, ומובא כפי שהוא אך לא אומת באופן בלתי תלוי.

• עבודת ידע — GDPval-AA v2.1 ב-1620 לעומת 735 של Haiku 4.5, 1437 של GPT-6 Luna ו-1840 של Sonnet 5.5. AA-Briefcase v1.1 ב-1578 לעומת 614, 1336 ו-1824.
• שימוש במחשב — OSWorld 2.1 ב-72.4% בתת-הקבוצה הלא-מקוונת, לעומת 15.7% עבור Haiku 4.5, 48.9% עבור GPT-6 Luna ו-83.9% עבור Sonnet 5.5.
• חשיבה רב-תחומית — Humanity's Last Exam ב-45.9% ללא כלים וב-57.4% איתם, לעומת 10.2% ו-18.7% עבור Haiku 4.5.
• קידוד סוכני — Terminal-Bench 4.0 ב-39.2% לעומת 0.0%, 16.4% ו-70.6%. FrontierCode 1.1 (Main) ב-46.4% לעומת 42.4% עבור GPT-6 Luna ו-52.1% עבור Sonnet 5.5.
• חשיבה חזותית — Chartography ב-46.4% עם כלים, לעומת 6.4%, 29.1% ו-61.6%.
Anthropic גם ישירה באופן יוצא דופן לגבי היכן שדרגת המודלים הקטנה אינה מנצחת. הפרשנות שלה עצמה על התרשים של Terminal-Bench אומרת ש-Sonnet 5.5 ו-Opus 5.5 "נותרים בחירות טובות יותר למשימות קידוד אג'נטיות מורכבות", וממקמת את Haiku 5.5 לעבודת דחיסה, סיכום ותת-סוכנים במקום זאת. הציטוטים מהלקוחות בפוסט מצביעים לאותו כיוון ונושאים את אותה הסתייגות — אלה שותפי גישה מוקדמת המתארים את ההערכות שלהם עצמם, ולא ביקורות: Asana מדווחת על השהיה נמוכה ביותר מ-30% בהשלמת משימות ועד פי 2.5 הסקה מהירה יותר לכל סבב של סוכן; HubSpot מדווחת על 92.8% בממוצע על פני שלוש הרצות על חבילת פורטל CRM; AlphaSense מדווחת על 0.84 לעומת 0.76 על פני 400 שאילתות בעומס עבודה שמבצע כ-8 מיליון קריאות בשבוע; Box מדווחת על 11 נקודות יותר מ-Haiku 4.5 בכמחצית מההשהיה; Rogo מתארת תת-סוכן Haiku 5.5 שמחלץ שורת הכנסות של סגמנט מתוך דוח 10-K; ו-Cognition מדווחת ש-Devin Fusion מחזיק בציון FrontierCode של 66.2 עם Haiku 5.5 כעוזר הצמוד.
מה שהמועצה העצמאית אומרת
טבלאות הספק הן של הספק. המיקום החיצוני הראשון הוא המספר השימושי יותר לכל מי שמחליט אם השכבה זזה מספיק רחוק כדי לשנות צינור ייצור.

Artificial Analysis מעניקה ל-Claude Haiku 5.5 ציון 43 במדד ה-Intelligence Index v4.3.2 שלה, בתצורת Max של המודל, במקום השני מבין 182 המודלים באותו לוח, והרחק מעל החציון של הלוח, 13. באותו עמוד נמדדים 242 אסימוני פלט בשנייה — המקום התשיעי מתוך 182 — ובעלות של 0.21 דולר לכל משימת Intelligence Index.
שני דברים בעמוד הזה שווים יותר מהכותרת. הראשון הוא מילוליות: בהערכת ה-Index, Artificial Analysis תיעדה 440 מיליון טוקני פלט, לעומת חציון של 100 מיליון, ומתארת את המודל כ"מילולי מאוד". תג מחיר נגבה לכל טוקן, לכן מודל שחושב באריכות משלם על כך — וזו בדיוק הסיבה לכך שנתון העלות למשימה עומד על $0.21 ולא על קרוב לאפס, ומדוע הקיצוץ של 90% בקלט אינו כל הסיפור. השני הוא סולם המאמץ: אותו עמוד חושף תצורות מ-Max ועד Low, וברירת המחדל של Anthropic היא medium, לא max. הציון 43 בלוח הוא הדרגה העליונה בסולם הזה, לא ההגדרה שמקבלים אם לא עושים כלום.
הרצת השכבה שמתחת לשכבה שאתה כבר יכול לקרוא לה
Claude Haiku 5.5 אינו מופיע בקטלוג של OrcaRouter, וכדאי לומר זאת בפשטות במקום לרמוז אחרת: הפער ביום ההשקה בין קיומו של מודל לבין היותו ניתן לניתוב הוא בדרך כלל ימים, ולפעמים יותר.
מה שנמצא בקטלוג של Anthropic היום הוא Claude Haiku 4.5, Claude Sonnet 5.5 ו-Claude Opus 5.5, כל אחד במחיר המחירון של הספק כפי שהוא מועבר הלאה עם 0% תוספת, כך שכל הורדת מחיר ש-Anthropic עושה נוחתת על הצד שלנו באותו יום שבו היא נוחתת על הצד שלהם. זה הגשר המעשי לכל מי שרוצה להתנסות בתבנית סוכני המשנה כבר עכשיו: מפל שמעביר את הפניות השגרתיות אל Haiku 4.5 ומסלים את הקשות כלפי מעלה עובד היום תחת מפתח אחד ו-SDK אחד, והחלפת הרגל הקטנה ל-Haiku 5.5 בהמשך היא שינוי של model-id ולא הגירה. מעבר אוטומטי לגיבוי נמצא מתחת לכל רגל שתבחרו, כך שאחר צהריים רע של ספק בודד לא מפיל איתו את הצינור.
אם אתם מעדיפים לא לחכות כלל, אותה רצועת קלט של $0.10 כבר תפוסה על ידי GPT-6 Luna, שאותה אנחנו כן מנתבים, ואשר שומרת על התעריף הזה עד 272,000 טוקנים לפני עליית מדרגה.
מי צריך לזוז, ומי לא
אם עומס העבודה שלכם הוא סיווג, חילוץ, ניתוב, דחיסה או תמצות בהיקף גדול, והפרומפטים שלכם נמצאים מתחת ל-100,000 טוקנים, המקרה פשוט: התעריף הוא עשירית ממה שהיה, החלון רחב פי חמישה, וחוגת המאמץ מאפשרת לכם לסחור בכיוון ההפוך כשבקשה צריכה זאת. תקצבו בסביבות 75% פחות ולא תופתעו.
אם הפרומפטים שלך עוברים באופן שגרתי את 100,000 הטוקנים, אתה קונה בהנחה של 50% ולא של 90%, והשוואת מחירים בהקשר עמוק עדיין שווה את אחר הצהריים — בתחום יש כמה מודלים במחיר השווה לתעריף של הרמה הזו מעל 100K או נמוך ממנו.
ואם ההערכה שלך עדיין נכשלת בעבודה בסגנון Terminal-Bench, זה לא המודל שמתקן את זה; Anthropic אומרת זאת בעצמה, וה-39.2% מול 70.6% של Sonnet 5.5 הוא הראיה הנקייה ביותר בפוסט. הסיכום הכנה של ה-7 באוקטובר הוא שרצפת הבינה השימושית ירדה רחוק מאוד והתקרה לא זזה כלל.
השוואות במאמר הזה1
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
