כרטיס Hero מיוצר עבור 'עשירית מהתעריף היא לא עשירית מהחשבון', עם התג 'פער דורות', הקיקר 'שני מודלים של Haiku, בהפרש של אחד עשר חודשים' וכתובית המשנה 'Claude Haiku 5.5 מול Claude Haiku 4.5 במחיר, בטוקנים ובמדרגה החדשה של 100,000 טוקנים.' ארבעה צ'יפים מציגים '$0.10 / $0.50', '$1.00 / $5.00', 'הקשר של 1M' ו-'30% יותר טוקנים'. שני כרטיסים מתחת מסומנים 'מה אומר התעריף' ('קלט ופלט נמוכים ב-90% מתחת ל-100,000 טוקנים') ו'מה אומרת החשבונית' ('כ-75% פחות בעלות הרצה, על כ-30% יותר טוקנים'). בכותרת התחתונה נכתב 'תיעוד התמחור של הספק, נכון ל-8 באוקטובר 2026.' הלוגו של OrcaRouter מורכב בפינה הימנית התחתונה.
Guides & Insights

Claude Haiku 5.5 מול Claude Haiku 4.5: הורדת מחיר של 90% אינה חיסכון של 90%

מחבר

Gideon Frost

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

Claude Haiku 5.5 מתומחר ב-$0.10 למיליון טוקני קלט וב-$0.50 למיליון טוקני פלט עבור פרומפטים של עד 100,000 טוקנים. Claude Haiku 4.5 עולה $1 ו-$5, באופן קבוע, עבור כל חלון 200,000 הטוקנים שהיה לו תמיד. Anthropic מציגה את הפער כ"נמוך ב-90%" בהערת שוליים אחת וכ"כ-75% פחות להרצה" במשפט שמעליה — והפער של אחד-עשר חודשים בין שני המודלים הוא בדיוק המרחק בין שני המספרים הללו.

זו אינה תחבולה שיווקית. זהו הצורה הכנה של דור מודל ששינה את הטוקנייזר שלו, את ברירת המחדל של החשיבה שלו ואת חלון ההקשר שלו בו-זמנית עם המחיר שלו, וזה אומר שכל מי שמחליף את מזהה המודל ומצפה שהחיוב יירד פי עשרה יתאכזב מהאריתמטיקה ולא מהמוצר.

שני הדגמים, כפי שנשלחו

כל מה שלהלן הוא למיליון טוקנים, בדולרים אמריקאיים, ונלקח מתיעוד התמחור והמודלים של Ant​hropic עצמה מתאריך 2026-10-08, אלא אם צוין אחרת.

A generated scoreboard titled 'Claude Haiku 5.5 vs Claude Haiku 4.5 - as shipped'. Claude Haiku 5.5 reads input $0.10 under 100K and $0.50 above, output $0.50 and $2.50, cache read $0.01 and $0.05, context 1M tokens, maximum output 128,000 tokens, thinking adaptive with an effort dial. Claude Haiku 4.5 reads input $1.00 flat, output $5.00 flat, cache read $0.10, context 200,000 tokens, maximum output 64,000 tokens, thinking manual with no effort dial. A footer reads 'Vendors' published list rates and model documentation.'

• קלט — Claude Haiku 5.5 $0.10 עד 100,000 טוקנים, $0.50 מעל זה; Claude Haiku 4.5 $1.00 ללא קשר לאורך.

• פלט — Claude Haiku 5.5 $0.50 עד 100,000 טוקנים, $2.50 מעל זה; Claude Haiku 4.5 $5.00 ללא תלות באורך.

• קריאות מטמון — Claude Haiku 5.5 $0.01 עד 100,000 טוקנים ו-$0.05 ומעלה; Claude Haiku 4.5 $0.10. כתיבות מטמון — $0.125 ו-$0.625 לעומת $1.25.

• הקשר — 1M טוקנים לעומת 200,000. פלט מקסימלי — 128,000 טוקנים לעומת 64,000.

• חשיבה — Claude Haiku 5.5 הוא אדפטיבי ופעיל כברירת מחדל עם חוגת מאמץ שברירת המחדל שלה היא רמה בינונית; Claude Haiku 4.5 משתמש בצורה הידנית הישנה ואין לו פרמטר מאמץ כלל.

• ציון עצמאי — Artificial Analysis Intelligence Index v4.3.2 ממקם את Claude Haiku 5.5 (Max) ב-43.40, השני מתוך 182 מודלים, ואת Claude 4.5 Haiku ב-16.88, השלושים מתוך 61 — כאשר המעריך מסמן את הציון של 4.5 כמשוער.

• מהירות — אותו מקור מודד 242 אסימוני פלט בשנייה עבור Claude Haiku 5.5 לעומת 89.7 עבור הדור 4.5, וזה המקום היחיד שבו המודל הישן עדיין נראה בנוח.

היכן נשבר הסיפור של עשירית מהמחיר

שלושה דברים מכרסמים בקיצוץ, ורק הראשון מביניהם הוא האזהרה של Ant​hropic עצמה.

הטוקנייזר הוא הדבר הגדול. Claude Haiku 5.5 משתמש בטוקנייזר החדש יותר שהוצג עם Claude 4.7, והתיעוד של Anthropic אומר שאותו טקסט "נספר כ-30% יותר טוקנים מאשר ב-Claude Haiku 4.5". אתם לא משלמים עשירית מהתעריף על אותו מספר טוקנים; אתם משלמים עשירית מהתעריף על בערך פי 1.3 טוקנים. מדריך המיגרציה של הספק עצמו מציב את זה כפריט השני ברשימת הבדיקה שלו, לפני כל שינוי בקוד: ספרו מחדש את הפרומפטים שלכם, ואז בחנו מחדש את max_tokens ואת הערכות העלויות שלכם.

אסימוני חשיבה מחויבים כאסימוני פלט, ו-Claude Haiku 5.5 חושב כברירת מחדל. עמוד ההשקה של Anthropic מבהיר במפורש שהמודל "מאוד רברבני" כשלעצמו בגרפים, והמדידה העצמאית מגבה זאת בחריפות רבה יותר מאשר הספק עצמו: בהערכת Intelligence Index, רשמה Artificial Analysis 440 מיליון אסימוני פלט מ-Claude Haiku 5.5 לעומת חציון של 100 מיליון בכל התחומים, ותייגה את המודל כמאוד רברבני. תעריף קלט זול לא עוזר לעומס עבודה שעיקר החיוב שלו הוא פלט.

מדרגת 100,000 הטוקנים היא השלישית. מעליה התעריפים הם $0.50 ו-$2.50 — מחצית מהמחיר ש-Claude Haiku 4.5 גבה, עבור אותה בקשה, וזו עסקה טובה, וזו לא העסקה שמרבית הקוראים קראו עליה. Anthropic אומרת שפרומפטים מתחת לסף היוו כ-90% מהבקשות למודל Haiku הקודם, וזה המספר שהופך את הסף לנסבל ככותרת; זו גם תמהיל התעבורה של הספק עצמו, לא שלכם.

A screenshot of Anthropic's model documentation showing the Claude Haiku 5.5 row in the models table and the published rate card beneath it, with the input, output, cache read and cache write rates and the prompt-length thresholds set out per million tokens.

מה אותה עבודה עולה לשני המודלים

עלות לכל משימה שהושלמה היא המדד ששורד את כל שלוש ההשפעות שלעיל, מכיוון שהוא מחייב את המודל על כל מה שהוא פלט, ולא רק על מה ששלחת לו.

Artificial Analysis מציבה את Claude Haiku 5.5 (Max) על $0.21 לכל משימת Intelligence Index — הנתון שהיא מפרסמת לצד תעריף קלט של $0.10 ופלט של $0.50. היא אינה מפרסמת כלל נתון עלות-למשימה עבור הדור 4.5; באריח כתוב לא ידוע, מפני שהמודל מעולם לא הורץ ב-Index בתצורת חשיבה. מה שכן מפרסם העמוד הוא תעריף גולמי של $1.00 ו-$5.00 וציון נמדד שונה ונמוך יותר.

אז ההשוואה הכנה עבור קונה אינה פי 10 על טוקנים, אלא משהו קרוב יותר לזה: עשירית מתעריף הקלט על 30% יותר טוקנים, חצי מתעריף הפלט כשעוברים את 100K, ומודל שמוציא יותר טוקני פלט לכל תשובה מאשר קודמו — לעומת זינוק ביכולות מ-16.88 ל-43.40 באותו לוח עצמאי. נתון 75% ש-Ant​hropic מציינת עבור עומסי עבודה ממוצעים הוא מספר התכנון הסביר. זה גם אומדן ספק משוקלל על תמהיל תעבורה שאינך שולט בו.

ההגירה אינה החלפת מזהה מודל

מדריך ההגירה של Anthropic מגיע לעשרה פריטים לכל מי שעובר מ-Claude Haiku 4.5, וכמה מהם הם כשלים קשים ולא עצות.

• חשיבה ידנית נשברת — thinking: {"type": "enabled", "budget_tokens": N} מחזירה שגיאה. חשיבה אדפטיבית מחליפה אותה, ו-thinking.display חייב להיות מוגדר ל-"summarized" אם ברצונך לראות את תהליך החשיבה בכלל.

• פרמטרי דגימה נשברים — טמפרטורה, top_p ו-top_k כולם חייבים לצאת מהבקשה.

• Prefill של העוזר נשבר — שיחה שמסתיימת בתור של העוזר מחזירה שגיאה; יש לסיים אותה בתור של המשתמש.

• שינויי סדר הבלוקים — תגובה יכולה להתחיל בבלוקי חשיבה, כך שקוד שקורא את בלוק התוכן הראשון בתור התשובה חייב לבחור לפי type במקום.

• סירובים הם חדשים — המודל מריץ מסווגי בטיחות, יכול להחזיר stop_reason: "refusal", ואין גיבוי בצד השרת.

• הפעלה חוזרת מוגבלת — בלוקי חשיבה פועלים רק בחשבון שיצר אותם, או בחשבון המקושר אליו.

• Priority Tier לא עובר — ארגונים המחזיקים בהתחייבות Priority Tier ב-Claude Haiku 4.5 צריכים לתכנן קיבולת בנפרד, מכיוון ש-Priority Tier אינו נתמך ב-Claude Haiku 5.5.

שניים מאלה ראויים ליותר תשומת לב מהשאר. סיבת העצירה מסוג סירוב היא שינוי בזרימת הבקרה בכל לולאה שהניחה שלכל תגובה יש תוכן, ובלוקי חשיבה הכבולים לחשבון שוברים כל תור ששומר שיחות ומריץ אותן מחדש דרך מאגר של אישורים. אף אחד מהם לא מופיע עד לפרודקשן.

הרצת שתי השכבות תחת מפתח אחד

השאלה המעשית עבור רוב הצוותים אינה איזה משני המודלים האלה טוב יותר, מפני שהתשובה תלויה לחלוטין באיזו קריאה אתם מבצעים. היא האם ניתן לשדרג את השלב הזול של קסקדה באופן עצמאי מכל מה שסביבו.

Claude Haiku 4.5 נמצא היום בקטלוג של OrcaRouter במחיר המחירון של Anthropic עם 0% תוספת, כך שהתעריף של הספק מועבר ישירות ללא שינוי, וכל שינוי ש-Anthropic מבצעת בו מופיע אצלנו באותו היום. גם Claude Sonnet 5.5 ו-Claude Opus 5.5 נמצאים שם, מה שאומר שאפשר לבנות כעת צינור דו-שכבתי — מודל קטן עבור הרוב השגרתי, מודל גדול יותר עבור ההסלמה — עם מפתח אחד, SDK אחד ומעבר אוטומטי לגיבוי מתחת, ואת הרגל הקטנה להחליף בהמשך ל-Claude Haiku 5.5 כשינוי של מזהה מודל ולא ככתיבה מחדש.

Claude Haiku 5.5 עדיין לא בקטלוג, וראוי לומר זאת במפורש ולא להשאיר זאת משתמע. פער ביום ההשקה בין יציאתו של מודל לבין היותו ניתן לניתוב הוא דבר רגיל, והוא אינו הבטחה לגבי מתי הוא ייסגר; המודלים שניתן לקרוא להם דרכנו הבוקר הם אלה הנקובים לעיל.

A screenshot of the OrcaRouter catalogue page for Claude Haiku 4.5, showing the model identifier, the provider Anthropic, the model description and a stat strip carrying the $1.00 per million input and $5.00 per million output rates alongside the context window and maximum output.

מי צריך לעבור, ואיזו שיחה להעביר ראשונה

אם תעבורת ה-Haiku 4.5 שלך היא סיווג, חילוץ, ניתוב, דחיסה או תמצות עם פרומפטים באורך של פחות מ-100,000 טוקנים, עבור — התעריף הוא עשירית, החלון רחב פי חמישה, וחוגת המאמץ נותנת לך מנוף עלות שלא היה למודל הישן מעולם. תקצב כ-75% פחות ותעשה התאמה מול ספירות הטוקנים שלך אחרי שבוע.

אם הפרומפטים שלך חוצים באופן שגרתי 100,000 טוקנים, אתה קונה הנחה של 50% ולא של 90%, והשכבה השנייה משנה את ההשוואה באופן שמצדיק לבדוק מחירים אצל ספקים שונים: תעריף הפלט מעל 100K של $2.50 גבוה ממה שכמה מודלים קטנים מתחרים גובים עבור החלון כולו.

ואם אתם על Haiku 4.5 כי זו הייתה האפשרות הזולה היחידה שהתאימה למסמך של 200,000 טוקנים, שימו לב למה שהשתנה. החלון הוא כעת מיליון טוקנים, שזה מוצר אחר, והסיבה להחזיק במודל הישן נעלמה בשקט יחד עם הסיבה שהוא היה זול.