
Claude Haiku 5.5 זמין כעת במחיר 0.10 דולר למיליון טוקנים: טענת ה-75%, ושתי הערות השוליים שלה
- openaiחדשOpenAI: GPT-6.1 Sol2026-09-2952אינטליגנציה
- anthropicחדשAnthropic: Claude Sonnet 5.52026-09-2856אינטליגנציה
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238אינטליגנציה
- OpenAIOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIGrok 4.72026-09-2146אינטליגנציה
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 לכל 1M טוקנים · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
Anthropic השיקה את Claude Haiku 5.5 לזמינות כללית ב-7 באוקטובר 2026, במחיר של 0.10 דולר למיליון טוקני קלט ו-0.50 דולר למיליון טוקני פלט — אותם שני מספרים ש-OpenAI גובה עבור GPT-6 Luna, וחמישית ממה ש-Claude Haiku 4.5 עולה מאז 2025, כשהשיק במחיר 1.00 ו-5.00 דולר. הכותרת בפוסט ההשקה של Anthropic היא שהמודל החדש עולה "כ-75% פחות להפעלה" מקודמו בממוצע, וזה הנתון שכל סיכום מאז חזר עליו. הוא מגיע עם שתי הערות שוליים שרוב הסיכומים האלה השמיטו: מתחת ל-100,000 טוקנים הקיצוץ הוא 90%, ומעליו הקיצוץ הוא 50%, ו-Claude Haiku 5.5 משתמש בטוקנייזר החדש יותר שמשותף עם Claude 4.7 ואילך, כך שאותו טקסט נספר בכ-30% יותר טוקנים מאשר ב-Claude Haiku 4.5. אז 75% הוא אמירה על חשבון, לא על מחירון, ולמי שהפרומפטים שלו ארוכים אלה שני דברים שונים. טבלת ההשוואה של הספק עצמו מציגה גם GPT-6 Luna ו-Claude Sonnet 5.5 כעמודות לצידו, מה שהופך את תיעוד ההשקה לקל במיוחד להתווכח איתו.
החשבון שמאחורי "75% פחות"
קחו קודם את כרטיס התעריפים, כי הוא לא אחיד. הקלט הוא $0.10 למיליון עד 100,000 טוקנים ו-$0.50 למיליון מעל זה — פי חמישה. הפלט הוא $0.50 ואז $2.50. המטמון עוקב אחרי אותו מדרג: כתיבה למטמון של חמש דקות היא $0.125 למיליון מתחת לקו ו-$0.625 מעליו, כתיבה של שעה היא $0.20 ו-$1.00, וקריאה מהמטמון היא $0.01 ו-$0.05. ה-Message Batches API מוריד 50% משני המונים, ובמסלול האצווה המודל תומך בעד 300,000 טוקני פלט עם output-300k-2026-03-24 הדר בטא.
כעת הנח את הטוקנייזר על גבי זה, כי שם הטענה המרכזית נעשית מעניינת. פרומפט שנמדד ב-90,000 טוקנים בטוקנייזר של Claude Haiku 4.5 נמדד בכ-117,000 בחדש. גודלו לא השתנה, אבל הוא חצה את קו 100,000 הטוקנים, לכן הוא מחויב לפי $0.50 למיליון טוקני קלט במקום $0.10. ב-Claude Haiku 4.5 אותו תוכן עלה $0.09 של קלט ($1.00 למיליון × 0.09 מיליון). ב-Claude Haiku 5.5 זה עולה $0.0585. זהו קיצוץ של 35% — אמיתי, ורחוק מאוד מ-90%. הנתון של 90% חל על בקשות שנשארות מתחת לקו לאחר שהטוקנייזר מרחיב אותן, וזה המקום שבו נמצא חלק גדול מתעבורת הקריאות הקצרות: קריאת סיווג של 20,000 טוקנים הופכת ל-26,000 טוקנים, נשארת במדרגה הראשונה, ושם מחיר הקלט הוא באמת עשירית ממה שהיה.
שלושה דברים נובעים מכך, וכדאי להפריד ביניהם ולא לאחד אותם לממוצע:
• שיחות קצרות זוכות להנחה המלאה. חילוץ, ניתוב, סיווג ותמצות של מסמך שנכנס מתחת לקו — אלה מקבלים את נתון ה-90% בקלט ובפלט, פחות ההתרחבות של הטוקנייזר.
• קריאות ארוכות מקבלות הנחה של כשליש, לא של שלושה רבעים. בקשה שמגיעה ליותר מ-100,000 טוקנים לאחר טוקניזציה מחדש משלמת $0.50 ו-$2.50 למיליון — עדיין מחצית מהתעריפים של Claude Haiku 4.5, אבל המדרגה שהיא נמצאת בה היא פי חמישה מהמדרגה שעליה מכריזה המדבקה.
• הנתון "75% פחות בממוצע" הוא מספר משוקלל לפי תעבורה, והוא של Anthropic. זהו תיאורו של הספק עצמו את התמהיל הצפוי שלו, ו-Anthropic מבהירה במפורש שפרומפט מתחת לסף היווה כ-90% מהבקשות ל-Haiku הקודם. אם התמהיל שלך לא נראה כמו התמהיל הזה, הממוצע שלך לא ייראה כמו הממוצע הזה — והדרך היחידה לדעת מה נכון היא לספור טוקנים בתעבורה שלך, עם הטוקנייזר החדש, לפני שתקבע תקציב.

מה עוד נשלח איתו?
המודל הוא לא רק מחיר. כמה מפרטי ההשקה משנים את הדרך שבה כותבים קוד מולו, ואחד מהם ישבור לקוח קיים.
• חשיבה אדפטיבית פועלת כברירת מחדל, עם חוגת מאמץ מ'נמוך' עד 'מקסימום' וברירת מחדל של בינוני. זהו המודל הראשון מסוג Haiku עם הגדרת מאמץ ניתנת להתאמה, והוא המנוף העיקרי הן על האיכות והן על העלות לכל תשובה.
• פרמטרי דגימה נדחים. שליחת ערך שאינו ברירת מחדל של temperature, top_p או top_k מחזירה 400. כל מיגרציה שהעבירה את הארגומנטים האלה הלאה תיכשל בקול רם בבקשה הראשונה במקום להידרדר בשקט, וזה לפחות מצב כשל כן.
• הקשר של מיליון טוקנים ועד 128,000 טוקני פלט ב-API של Messages הסינכרוני, עם תאריך עדכון ידע של יוני 2026 ומחויבות לפרישה שלא לפני 7 באוקטובר 2027.
• חמש פלטפורמות ביום הראשון: Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry ו-Claude Platform on AWS. זו פריסה באותו היום ולא זמינות מדורגת, כפי שקורה לעיתים קרובות בהשקות כאלה.
• גם הכלים התקדמו.ערכות ה-SDK של Anthropic ל-Python ול-TypeScript תומכות כעת בשימוש במחשב ובשימוש בדפדפן בגרסת בטא, והחברה הוסיפה זיכויים חודשיים ל-API למנויי Max 5x ($100), Max 20x ($200) ו-Team (עד $500 במאגר משותף).
• מצב הבטיחות צר יותר ממה שהמחיר מרמז. Anthropic אומרת שאמצעי ההגנה הקיברנטיים ב-Claude Haiku 5.5 מגבילים יותר מאלה של Claude Haiku 4.5, אך פחות מגבילים ממודלי חזית אחרונים — שימוש הגנתי רחב יותר מזה ש-Claude Sonnet 5.5 מתיר, בעוד שבדיקות חדירה עדיין חסומות — ושאמצעי ההגנה הביולוגיים זהים לאלה של Claude Sonnet 5, Claude Sonnet 5.5 ו-Claude Opus 5. הערכות היישור השתפרו במידה נרחבת לעומת קודמו במערך הבדיקות של Anthropic עצמה.
מה אומרת טבלת הספק, ומה אומר הדירקטוריון העצמאי
Anthropic פרסמה טבלת בנצ'מרק עם שלוש עמודות השוואה, וכדאי לקרוא אותה כמסמך על האופן שבו ספקים מתווכחים. כל נתון להלן מדווח על ידי הספק, הופק בהרנסים של Anthropic, ואף חלק ממנו לא שוחזר באופן בלתי תלוי; במקום שבו GPT-6 Luna מופיע, מדובר ב-Anthropic שמריצה הערכות משלה מול המודל של מתחרה.
• עבודת ידע — GDPval-AA v2.1 ב-1620 עבור Claude Haiku 5.5, לעומת 735 עבור Claude Haiku 4.5, 1437 עבור GPT-6 Luna ו-1840 עבור Claude Sonnet 5.5. AA-Briefcase v1.1 ב-1578, 614, 1336 ו-1824.
• שימוש במחשב — OSWorld 2.1 לא מקוון ב-72.4% לעומת 15.7%, 48.9% ו-83.9%.
• חשיבה — Humanity's Last Exam ב-45.9% ללא כלים ו-57.4% איתם, לעומת 10.2% ו-18.7% עבור Claude Haiku 4.5 ו-56.9% ו-64.5% עבור Claude Sonnet 5.5.
• קידוד סוכני — Terminal-Bench 4.0 ב-39.2% לעומת 0.0%, 16.4% ו-70.6%. FrontierCode 1.1 (Main) ב-46.4% לעומת 42.4% של GPT-6 Luna ו-52.1% של Claude Sonnet 5.5.
• קריאת תרשימים — Chartography ב-46.4% ללא כלים לעומת 6.4%, 29.1% ו-61.6%.
בטבלה הזו Claude Haiku 5.5 מנצח בכל שורה הן מול ה-Haiku הקודם והן מול GPT-6 Luna, ומפסיד את רובן ל-Claude Sonnet 5.5 — וזו הצורה הכנה של דרגה קטנה: קפיצה דורית גדולה, ועדיין דרגה אחת מתחת למודל הביניים במשימות הקשות ביותר. Anthropic אומרת זאת בפוסט, וממליצה על Claude Sonnet 5.5 ו-Claude Opus 5.5 לקידוד סוכני מורכב, בעוד שהיא ממקמת את ה-Haiku בתפקידי דחיסה, סיכום, סיווג ותת-סוכנים.
התמונה הבלתי תלויה מורכבת יותר ודורשת תשומת לב רבה יותר. Artificial Analysis מודדת את Claude Haiku 5.5 במאמץ מקסימלי בציון 43 במדד ה-Intelligence Index v4.3.2 שלה, השני מתוך 182 מודלים, ו-241.9 טוקני פלט לשנייה — מהיר, כפי שפורסם. היא גם מודדת עלות של $0.21 לכל משימת Index שהושלמה, מכיוון שהמודל ייצר 440 מיליון טוקני פלט בהרצת החבילה לעומת חציון של 100 מיליון; המעריך מתאר אותו כרהוט מאוד. GPT-6 Luna, עם 38 באותו מדד, עולה $0.07 למשימה. אותו מחיר מחירון, פי שלושה בחשבון. זה לא סתירה לטענת ההשקה — זה אותה תופעה שטענת ההשקה עוסקת בה, מהקצה השני: מחירון התעריפים הוא מה שאתה משלם לכל טוקן, והמספר שאתה משלם בפועל הוא תעריף כפול טוקנים, ו-Claude Haiku 5.5 מוציא יותר מהם לכל תשובה מאשר מתחריו. המאמץ הוא הידית; ברירת המחדל של המודל היא בינוני, לא מקסימום, וצוות שמגדיר אותו נמוך יותר יראה גם חשבון קטן יותר וגם ציון נמוך יותר.
לקרוא לזה ממקום אחד
שאלת ההגירה שההשקה הזו יוצרת היא לא "האם זה טוב יותר" אלא "כמה עולה לי התעבורה שלי על זה", והתשובה לכך תלויה באורכי הפרומפטים שלך, בשיעור פגיעות המטמון שלך ובהגדרת המאמץ שתבחר. כדי להגיע לשם צריך להריץ את מערכת הפרומפטים שלך דרך שני הדורות — מה שזול לעשות מאחורי נקודת קצה אחת ומייגע לעשות על פני שתיים.
Claude Haiku 5.5 עצמו עדיין לא נמצא בקטלוג של OrcaRouter, ואמירה מפורשת על כך מועילה יותר מאשר רמז אחר. שאר דגמי Anthropic: Claude Haiku 4.5, Claude Sonnet 5.5 ו-Claude Opus 5.5 — כולם ניתנים לקריאה כבר היום במחיר המחירון של הספק עם 0% תוספת שמועברת הלאה, כך שהחלק ה"לפני" של מבחן מיגרציה רץ על אותו מפתח שהייתם שומרים אחר כך, והנחה מספק על אותו שלב נכנסת לתוקף אצלנו באותו יום. החלק ה"אחרי" הוא ה-API של Anthropic עד שהמודל החדש יגיע לריצה שאנחנו מנתבים אליה. מה שה-endpoint המשותף נותן לכם בינתיים הוא מעבר אוטומטי לגיבוי שמתחת לקריאה, כך שמודל חדש יכול לשאת תעבורת פרודקשן בלי שהנתיב יהיה תלוי בו, וה-DSL של הניתוב למקרה שבו ההסלמה מ-Haiku ל-Sonnet שייכת לנתיב ולא לקוד האפליקציה שלכם.

שתי תוצאות לקוחות בהשקה ראויות להילקח הלאה כרמזים ולא כהוכחה. Asana מדווחת על ירידה של למעלה מ-30% בהשהיה ועל הסקה מהירה עד פי 2.5 לכל תור של סוכן; HubSpot מדווחת על 92.8% בממוצע על פני שלוש ריצות בחבילת ה-CRM שלה; AlphaSense מדווחת על 0.84 לעומת 0.76 ב-400 שאילתות. אלה מספרי לקוחות שנבחרו על ידי הספק בהודעת הספק עצמו, וערכם הוא בכך שהם אומרים לך אילו עומסי עבודה לבדוק קודם, ולא בכך שהם אומרים לך מה תקבל.
מה היה משנה את התמונה
הנתון של 75% ייקבע באותה דרך שבה נקבעת כל טענת ספק המשוקללת לפי תעבורה: לפי החשבונית שלך. מה שבאמת פתוח בצד העצמאי הוא נתון העלות למשימה. אם זה מחזיק מעמד ככל שמצטברות יותר הרצות, הסיכום הכנה של השקה זו הוא ש-Anthropic חתכה את המחירון ב-80% ובנתה מודל שמוציא יותר טוקנים לכל תשובה, כך שהחיסכון האפקטיבי הוא אמיתי, גדול, תלוי בעומס העבודה, ולעיתים רחוקות המספר שעל הפוסטר. אם זה יורד עם הגדרות מאמץ ומטמון, השכבה נראית אפילו טוב יותר. כך או כך, המספר לבדוק לפני מעבר הוא הטוקנים שלך למשימה תחת הטוקנייזר החדש — זה הנתון היחיד שפוסט ההשקה לא יכול לתת לך.

השוואות במאמר הזה1
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
