
תדריך AI יומי, 8 באוקטובר: Claude Haiku 5.5 משיק במחיר $0.10 וקריאות המטמון של Sonnet 5.5 מצטמצמות בחצי
- openaiחדשOpenAI: GPT-6.1 Sol2026-09-2952אינטליגנציה
- anthropicחדשAnthropic: Claude Sonnet 5.52026-09-2856אינטליגנציה
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238אינטליגנציה
- OpenAIOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- AnthropicAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- xAIGrok 4.72026-09-2146אינטליגנציה
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 לכל 1M טוקנים · 56 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- OpenAIOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- AnthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 לכל 1M טוקנים · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 347 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 230 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
Claude Haiku 5.5 יצא ב-7 באוקטובר 2026, והוא הדבר הזול ביותר שהחברה אי פעם הציבה מאחורי API: 0.10 דולר למיליון טוקני קלט ו-0.50 דולר למיליון טוקני פלט בפרומפטים של עד 100,000 טוקנים, עם חלון הקשר של מיליון טוקנים ומחוון מאמץ שנע מ-Low עד Max. באותו יום, בלי פוסט השקה משלו, קריאות מטמון פרומפט ב-Claude Sonnet 5.5 ירדו מ-0.20 דולר ל-0.10 דולר למיליון טוקנים. אחד מאלה הוא מוצר והשני הוא סעיף תקציבי, והסעיף התקציבי הוא זה שיזיז יותר כסף ברבעון הזה.
המחיר קודם, כי זה החלק שאפשר לפעול לפיו כבר היום. אחר כך המאמץ, שהוא הדבר שקובע בשקט את המחיר. אחר כך הקיצוץ במטמון, שמחצית מהאנשים שמשלמים עבור Sonnet 5.5 לא ישמעו עליו עד לחשבונית הבאה שלהם.
מה זה Claude Haiku 5.5, לפי סדר החשיבות
הניסוח של הספק עצמו הוא "המודל הקטן הזול, המהיר והמסוגל ביותר שהשקנו אי פעם", ותאריך ההשקה הוא 7 באוקטובר 2026 — יום אחד לפני תדריך זה. מזהה המודל הוא claude-haiku-5-5. הוא קולט טקסט ותמונות, ופולט טקסט. חלון ההקשר הוא 1,000,000 טוקנים, לעומת 200,000 ב-Claude Haiku 4.5, והפלט המרבי הוא 128,000 טוקנים, כאשר header בטא ב-Batch API מעלה זאת ל-300,000. נקודת החיתוך של האימון היא יוני 2026, ו-Anthropic מתחייבת שלא להוציא אותו משימוש לפני 7 באוקטובר 2027.
הדבר החשוב ביותר למי שמנתב תעבורה אינו חלון ההקשר. אלא שזהו המודל הראשון מסוג Haiku עם מאמץ מתכוונן. רמות המאמץ הן Low, Medium, High, Xhigh ו-Max, ברירת המחדל היא Medium, וחשיבה אדפטיבית פועלת כברירת מחדל — תכונה של Sonnet ו-Opus שמגיעה דרגה אחת למטה. פוסט ההשקה נושא גם שני דברים שקשורים לקנייה ולא לבנייה: זיכויי API חודשיים לתוכניות Claude Max ו-Team, $100 ב-Max 5x ו-$200 ב-Max 20x עם עד $500 במאגר משותף ל-Team, ותמיכת בטא ב-computer-use וב-browser-use ב-SDKs. הבטיחות עומדת בקצב הדרגה: אמצעי ההגנה הקיברנטיים מחמירים יותר מאלה של Claude Haiku 4.5, כשבקשות לבדיקות חדירה עדיין חסומות, ואמצעי ההגנה הביולוגיים תואמים לאלה של Claude Sonnet 5, Claude Sonnet 5.5 ו-Claude Opus 5.

המחיר, והצוק של 100,000 טוקנים שבאמצעו
התעריף המוצהר הוא $0.10 למיליון טוקני קלט ו-$0.50 למיליון טוקני פלט. קראו את הכוכבית: זהו התעריף עבור פרומפטים של 100,000 טוקנים או פחות. מעל 100,000, שני המספרים מוכפלים פי חמישה, ל-$0.50 קלט ו-$2.50 פלט. כתיבות מטמון עולות $0.125 למיליון ברמת חמש הדקות ו-$0.20 ברמת השעה בתוך הטווח הזול, וקריאות מטמון עולות $0.01 למיליון — עשירית מתעריף הקלט, שהוא ההנחה העמוקה ביותר על מטמון שאנתרופיק פרסמה על מודל כלשהו. אצווה מחציתה שוב את הכל: $0.05 ו-$0.25 בתוך הטווח הזול, $0.25 ו-$1.25 מעליו.
השוו זאת ל-Claude Haiku 4.5, שעדיין נמצא במחירון במחיר אחיד של 1.00 דולר לקלט ו-5.00 דולר לפלט, ללא מדרגות מבוססות הקשר, קריאה מהמטמון ב-0.10 דולר וחלון של 200,000 טוקנים. המודל החדש הוא עשירית מהמחיר באותו מבנה פרומפט, עם הקשר גדול פי חמישה. אין כאן חשבון הגירה שצריך להריץ; החשבון לא צמוד.
הצוק הוא החלק שצריך לתכנן סביבו. פרומפט של 99,000 טוקנים עולה 99 סנט לאלף קריאות בתעריף הקלט. פרומפט של 101,000 טוקנים עולה 5.05 דולר לאלף. הפרש של אלפיים טוקנים הוא חשבון גבוה פי 5, כך שכל דבר שאתם בונים ברצועה הזולה צריך או להישאר בנוחות מתחת ל-100,000 טוקנים או להיות בכוונה ובאופן עקבי מעל לרף הזה — התוצאה הגרועה ביותר היא פייפליין שחוצה את הקו ומשלם את התעריף הגבוה על מחצית מהתעבורה שלו.
מאמץ הוא כעת פרמטר תמחור, וברירת המחדל אינה הזולה ביותר
מכיוון שהמאמץ מוגדר כברירת מחדל ל-Medium והחשיבה מופעלת כברירת מחדל, המחיר הנקוב והמחיר האמיתי אינם אותו מספר. טוקני חשיבה מחויבים כטוקני פלט. בהרצה שפרסמה Anthropic בעצמה של Artificial Analysis Intelligence Index — דיווח ספק, שלא שוחזר על ידינו — Claude Haiku 5.5 פולט בערך 162,000 טוקנים לכל משימה, מתוכם כ-129,000 הם חשיבה. המודל החציוני במדד פולט בסדר גודל של 100 מיליון טוקנים בכל מערך המבחנים; Haiku 5.5 מוציא 440 מיליון. בתעריף של $0.50 למיליון טוקני פלט, השפע הזה משתלם, וזה בדיוק העניין: בתעריף של Haiku 5.5, לחשוב הרבה עדיין זול יותר מלחשוב מעט במודל שגובה $5.00 עבור פלט.
הגדירו את המאמץ ל-Low (נמוך) עבור סיווג, חילוץ והחלטות ניתוב שבהן אתם רוצים תשובה מהירה ולא תשובה מהורהרת, והשאירו אותו על Medium (בינוני) בכל דבר שמשתמש יקרא. הורדה ל-Low היא גם הדרך האמינה לשמור על סוכן מפורט בתוך טווח של 100,000 טוקנים, מפני שהיא מקצצת בטוקני החשיבה לפני שהיא פוגעת באיכות התשובה.
השורה השקטה יותר: קריאות המטמון של Sonnet 5.5 הופחתו בחצי
Claude Sonnet 5.5 קורא פרומפט שמור במטמון במחיר של $0.10 למיליון טוקנים נכון ל-7 באוקטובר, לעומת $0.20 קודם לכן. מחיר הקלט של Sonnet 5.5 הוא $2.00 והפלט שלו הוא $10.00, כך שמכפיל קריאה מהמטמון של 0.05x הוא כעת זהה לזה של Haiku 5.5, כשהוא מיושם על קלט גדול פי עשרים. לפי הערכת Anthropic, הדבר מוזיל את עלות עבודת הסוכנים בכ-20%, וזו טענה לגבי צורת עומס העבודה ולא מדד ביצועים: היא תקפה רק אם חלק גדול מהקלט שלך הוא קידומת יציבה שאתה שולח מחדש בכל תור. אם הפרומפטים שלך ייחודיים בכל תור, השינוי הזה לא עולה לך דבר וגם לא חוסך לך דבר.
שווה לציין למה הקיצוץ מרמז. Anthropic מתמחרת קידומות ארוכות-חיים באגרסיביות במודל שבדרג הביניים בדיוק ברגע שבו היא משיקה מודל קטן וזול במיוחד, מה שמצטייר כטיעון בעד ארכיטקטורה של שני מודלים: רגל Sonnet 5.5 עם מטמון חם לעבודה שדורשת שיקול דעת, ורגל Haiku 5.5 לנפח שלא דורש זאת.
מה שמראים המספרים העצמאיים, כעבור יום
Artificial Analysis דירגה את Claude Haiku 5.5 יום לאחר ההשקה. מדד האינטליגנציה שלו עומד על 43 בסך הכול, כאשר תצורת Max-effort דווחה כ-43.40, שני מבין 182 מודלים בלוח. העלות לכל משימת מדד היא $0.21, הזול ה-46. המחיר המשוקלל בתמהיל של 7:2:1 של קלט לקלט במטמון לפלט הוא $0.08 למיליון, וזה המספר שגורם להשוואת השכבות המוקדמת יותר להיראות לא הוגנת כלפי כל דבר אחר. מהירות הפלט היא 243.4 טוקנים בשנייה, התשיעית הכי מהירה בלוח, עם השהיית טוקן ראשון מדווחת של כ-0.3 שניות והנחת מטמון של 90%.
נתון הפלט של 440 מיליון טוקנים הוא ההסתייגות שמצורפת ל-43. הציון אמיתי ומורץ באופן עצמאי; כך גם אריכות הדברים. מודל שחושב כל כך הרבה הוא זול לכל טוקן, אבל לא תמיד זול לכל משימה, והפער בין שני המספרים האלה הוא המקום שבו החלטת ניתוב באמת שוכנת.
כדי להמחיש את קנה המידה, ההשוואות שפרסמה Anthropic בעצמה מעמידות את Claude Haiku 5.5 על 1620 ב-GDPval-AA v2.1 לעומת 735 עבור Claude Haiku 4.5, 72.4% ב-OSWorld 2.1 לעומת 15.7%, 45.9% ב-Humanity's Last Exam ללא כלים לעומת 10.2%, ו-39.2% ב-Terminal-Bench 4.0 לעומת 0.0%. אלה נתונים שמדווחים על ידי הספק בהערכות שהספק בחר, ויש לקרוא אותם כמצביעים על כיוון, אך הכיוון אינו עמום — זה אינו שדרוג קטן למודל קטן.

הגעה למודלים האלה בלי חוזה נוסף
Claude Haiku 5.5 זמין דרך ה-API של Anthropic עצמה, ומשם בכל מקום שבו הדגמים של Anthropic נמכרים מחדש. בקטלוג של OrcaRouter, סדרת Anthropic כוללת כיום anthropic/claude-haiku-4.5, anthropic/claude-sonnet-5.5, anthropic/claude-opus-5.5ו-anthropic/claude-fable-5.1 — איננו מארחים את Claude Haiku 5.5, והסקירה הזו לא תעמיד פנים אחרת. מה שכן יש לנו הוא הדרגה שמעליו, ו-OrcaRouter מעבירה הלאה את מחיר המחירון של הספק עם 0% תוספת מחיר, וזו הסיבה שהקיצוץ במחיר ה-cache-read של Sonnet 5.5 הופיע בתמחור שלנו באותו היום שבו Anthropic ביצעה אותו, ולא במסגרת מחזור תמחור מתוכנן.
הגרסה המעשית: אם אתם רוצים לנסות את Haiku 5.5 בזרוע הסיווג בזמן שזרוע שיקול הדעת שלכם נשארת על Claude Sonnet 5.5, אתם מחזיקים שני מפתחות במקום אחד, ושכבת הניתוב היא המקום שבו מוכרע ה-A/B. זה כל הטיעון בעד שער על פני אינטגרציה ישירה — נקודת קצה אחת, מחרוזות מודל, ונתיב failover כשספק מתערער.

מה לראות מכאן
שלושה דברים. האם ספקי צד שלישי יתחילו למכור מחדש את Haiku 5.5 בתעריף משוקלל נמוך מ-$0.10, וזו הנקודה שבה שכבת הניתוב מצדיקה את עצמה ולא רק מפשטת את הרכש. האם Anthropic מרחיבה את גבול מדרגת 100,000 הטוקנים, שכן צוק בדיוק ב-100,000 הוא מקום מוזר למודל עם חלון של 1M טוקנים. והאם נתון המילוליות של 440 מיליון טוקנים יירד במהדורת נקודה, מפני שהמספר הבודד הזה הוא מה שעומד בין Haiku 5.5 לבין היותו ברירת המחדל הברורה לכל החצי התחתון של סטאק ייצור.
