
מדריך API של Claude Opus 5.5: מזהה המודל, ארבעה שינויים שוברי תאימות, והחמישי השקט
- openaiחדשOpenAI: GPT-6 Luna2026-09-2237אינטליגנציה
- openaiחדשOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- anthropicחדשAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- grokחדשGrok 4.72026-09-2146אינטליגנציה
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים · 177 tok/s
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 1323 tok/s
- deepseekחדשDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 108 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0345אינטליגנציה76כתיבת קוד
שנו את מחרוזת המודל מ־claude-opus-5ל־claude-opus-5-5והקוד שלכם עדיין מתקמפל, עדיין עובר בדיקת טיפוסים, ועדיין עובר כל מה שנחשב לחבילת בדיקות. ואז זה מחזיר 400 בפרודקשן. ארבע צורות בקשה ש-Claude Opus 5 קיבל נדחות על הסף על ידי Claude Opus 5.5, ושינוי חמישי לא שובר דבר בכלל — וזו בדיוק הסיבה שהוא יהיה זה שיגיע למשתמשים שלכם. זהו מדריך האינטגרציה למודל: המזהה, המשטחים שמגישים אותו, חוזה הבקשה, ארבע השגיאות, החמישי השקט, וכיצד פרמטר ה-effort עובד כעת. במקום שבו ההתנהגות תואמת ל־Claude Fable 5.1, צוות שכבר היגר לשם השלים חלק מהעבודה, ולכן כל שינוי שלהלן מציין אם הוא חל גם על המודל הזה.
הכול כאן נקרא מתוך התיעוד של Anthropic עצמה על Claude מתאריך 2026-09-24, יומיים לאחר שהמודל שוחרר. טענות ספקים מתויגות כטענות ספקים, מספרים בלתי־תלויים — כבלתי־תלויים, והשניים לעולם אינם מוצגים באותה הגדרת מאמץ כאילו היו בני־השוואה.
מזהה המודל, והיכן הוא מוגש
המזהה הוא claude-opus-5-5 — מזהה מודל קבוע ללא סיומת תאריך, באותה סכימה כמו claude-opus-5. אין צורה נפרדת של תמונת מצב מוצמדת לאמץ, ואין כינוי שמתפרש למשהו אחר.
סקירת המודלים של Anthropic מפרטת חמישה משטחים, עם המחרוזות המדויקות האלה:
• Claude API — claude-opus-5-5, זמין לכל הלקוחות.
• Amazon Bedrock — anthropic.claude-opus-5-5 (המשטח היחיד שמוסיף את שם הספק כקידומת).
• פלטפורמת Claude ב-AWS — claude-opus-5-5, תוך שימוש במזהי Claude API ולא במזהים בסגנון Bedrock.
• Google Cloud — claude-opus-5-5.
• Microsoft Foundry — claude-opus-5-5; שם הפריסה הוא מה שאתה שולח, ו-Foundry עוקב אחר לוח הזמנים של מחזור החיים של Claude API.
שניים מבין החמישה האלה חשובים יותר משאר החלק הזה. Amazon Bedrock ו-Google Cloud קובעים תאריכי מחזור חיים ופרישה משלהם, וכ—כפי שהשינויים השוברים שלמטה מראים—Bedrock היא גם הפלטפורמה היחידה שבה כלי השימוש במחשב הישן עדיין עובד. אם אתם על Bedrock, אתם לא באותה הגירה כמו כולם.
מה שכל בקשה חייבת לעמוד בו כעת
מדריך ההגירה של Anthropic מציג את החוזה כרשימה, והרשימה קצרה מספיק כדי לבדוק את הלקוח שלכם מולה. לא משנה מאיזה מודל אתם מגיעים, בקשה אל claude-opus-5-5 חייבת:
• שלח בלי thinking כשדה, או thinking: {"type": "adaptive"} — השניים שקולים, כי חשיבה אדפטיבית תמיד פעילה.
• שלוט בעומק החשיבה באמצעות effort, הפרמטר היחיד בבקשה שעושה זאת; כל חמשת הרמות נתמכות, וברירת המחדל היא בינונית.
• השתמש ב־tool_choice של {"type": "auto"} (ברירת המחדל) או {"type": "none"}. אילוץ כלי נדחה.
• השמט את temperature, top_p ו-top_k, או השאר אותם בערכי ברירת המחדל שלהם. כל ערך אחר נדחה, במודל הזה כמו בכל דבר החל מ-Claude Opus 4.7 ואילך.
• אל תסיים הודעות עם תור עוזר ממולא מראש; זה כבר נדחה ב-Opus 4.6 ואילך.
• הצהר על שימוש במחשב כcomputer_toolset_20260801 — ערכת כלים ב-Claude API וב-Google Cloud.
• אל תשלח כותרת בטא של חלון הקשר. חלון ההקשר של 1M הוא ברירת המחדל, ולכותרת שנכתבה עבור מודל ישן אין השפעה.
כאשר המדריך אומר שהגדרה נדחית, ה-API מחזיר HTTP 400. זה כל מצב הכשל של מעבר למודל הזה: לא פלט ירוד, לא אזהרה ביומן — בקשה שלעולם אינה רצה.

ארבעת השינויים השוברים
1. לא ניתן להשבית את החשיבה
חשיבה אדפטיבית תמיד פעילה. thinking: {"type": "disabled"} מחזיר 400, וכך גם תקציב ידני — thinking: {"type": "enabled", "budget_tokens": N}. טקסט השגיאה מציין את הסוג ששלחת ואז מציין את התחליף:
• "thinking.type.disabled" אינו נתמך עבור מודל זה. יש להשתמש ב-"thinking.type.adaptive" וב-"output_config.effort" כדי לשלוט בהתנהגות החשיבה.
• "thinking.type.enabled" אינו נתמך עבור מודל זה. יש להשתמש ב-"thinking.type.adaptive" וב-"output_config.effort" כדי לשלוט בהתנהגות החשיבה.
התוצאה המעשית אינה השגיאה, אלא מה שקורה לאחר שמתקנים אותה. ב-Claude Opus 4.8 ומטה, בקשה בלי שדה thinking רצה בלי thinking. ב-Claude Opus 5.5 כל בקשה מבצעת thinking, וmax_tokens נשאר מגבלה קשיחה המכסה thinking יחד עם טקסט התגובה. אסימוני thinking מחויבים כאסימוני פלט גם כשטקסט ה-thinking לעולם לא מוחזר אליך. נקודת קצה שקודם לכן רצה ללא thinking יכולה אפוא להפיק יותר אסימוני פלט בכל בקשה לאחר ה"תיקון" מאשר לפני כן. ההנחיה של Anthropic היא להפחית effort במקום שבו נהגת להשבית thinking, וברמת effort xhigh או max — להתחיל את max_tokens מ-64k ולכוונן משם.
גם צורת התגובה משתנה. תגובה יכולה להתחיל בבלוק חשיבה אחד או יותר לפני בלוק הטקסט הראשון, כך שקוד שקורא את התשובה לפי מיקום — content[0].text, או מטפל בזרימה שמתייחס ל-content_block_start הראשון כאל טקסט — נשבר בתגובות האלה גם כשהבקשה הצליחה. יש לבחור בלוקים לפי שדה ה-type שלהם במקום זאת.
2. שימוש מאולץ בכלי מחזיר שגיאה
tool_choice עבור הסוגים any ו-tool מחזירים 400, ואותה ולידציה חלה על נקודת הקצה לספירת טוקנים, כך שספירה מקדימה נכשלת באותו אופן שבו הקריאה האמיתית נכשלת:
• tool_choice: סוגי "tool" ו-"any" אינם נתמכים במודל זה.
auto ו-none אינם מושפעים. ההחלפה המתועדת היא להשאיר את tool_choice: {"type": "auto"}, לסמן כלים עם strict: true כדי לקבל ארגומנטים תקפים לפי הסכימה, או להעביר את הסכימה ל-structured outputs — ולומר בפרומפט מתי הכלי רלוונטי, כיוון ש-auto אינו מבטיח קריאה. שימוש בכלים במצב strict מקבל תת-קבוצה של JSON Schema: כל אובייקט ב-input_schema של כלי חייב להגדיר additionalProperties: false, לכן בדקו כל סכימה לפני הפעלת הדגל. ושימו לב לפער שזה מותיר: אם הקוד שלכם הסתמך על כפיית קריאה ולא רק על התרתה, auto מחזיר את ההרשאה ולא את ההבטחה. בדקו שאכן חזר בלוק tool_use.
3. בלוקי חשיבה כרוכים במודל ובשיחה
כל בלוק חשיבה מתעד איזה מודל הפיק אותו, וכל מודל קורא את הבלוקים של עצמו בתוספת קבוצה מוגדרת של בלוקים של אחרים. הכללים פועלים בשני הכיוונים:
• Claude Opus 5.5 קורא בלוקי חשיבה מ-Claude Opus 5 ומדגמי Opus, Sonnet ו-Haiku מוקדמים יותר — אבל לא מדגמי Claude Fable או Claude Mythos.
• ב-Claude API, Claude Fable 5.1 ו-Claude Mythos 5.1 קוראים בלוקים של Claude Opus 5.5. שום מודל אחר לא עושה זאת.
• שיחה שעוברת מ-Claude Opus 5.5 לכל דבר אחר מלבד שני אלה מריצה את סבביה המאוחרים בלי החשיבה המוקדמת.
נתב או מנגנון גיבוי שמעביר שיחה הוא הדרך המובנת מאליה להיתקל בזה. החצי העדין יותר הוא שהבלוק גם קשור לקידומת השיחה — הנחיית המערכת, הכלים, וכל הודעה שלפניו. Anthropic אוכפת את בדיקת הקידומת כברירת מחדל עבור חשבונות שנוצרו בתאריך 2026-08-31 00:00 UTC ואילך, ב-Claude API ובפלטפורמות ענן: אם תשלחו בלוק מחדש לאחר עריכת הנחיית המערכת, רשימת הכלים או הודעה מוקדמת יותר, הבקשה תחזיר קוד 400. קיימות שתי דרכי מילוט. שלחו את thinking-binding-controls-2026-08-01 כותרת הבטא והגדירו את thinking.block_binding.prefix_mismatch_behavior ל־"drop_block" כדי להשמיט את הבלוקים המושפעים במקום שהבקשה תיכשל. או שמרו על השיחה במצב הוספה בלבד ושנו הנחיות באמצעות הודעת מערכת באמצע השיחה ולא באמצעות עריכה — וזה מה ש-Claude Code, claude.ai, Claude Managed Agents ו-Claude Agent SDK כבר עושים.
יש ידיעה טובה אחת שקל לפספס: כאשר בקשה מכילה בלוק שמודל היעד לא יכול לקרוא, ה-API מסיר אותו לפני שהמודל רואה אותו. הבקשה מצליחה, ובלוקים שהוסרו אינם מחויבים.
4. הכלי הישן יותר לשימוש במחשב נדחה ב-Claude API וב-Google Cloud
רשומת כלים מסוג computer_20251124 מחזירה שגיאת 400 ב-Claude API וב-Google Cloud. ההודעה מציינת את הסוג שנדחה ולאחר מכן מפרטת את הסוגים שהמודל כן מקבל:
• 'claude-opus-5-5' אינו תומך בסוגי כלים: computer_20251124.
ההחלפה היא computer_toolset_20260801 ערכת הכלים: יש להסיר את כותרת הבטא computer-use-2025-11-24, ולשלוח את רשומת הכלים ללא שם וללא ממדי תצוגה. זה לא רק שינוי בבקשה — גם לולאת הסוכן משתנה בהתאם. הפעולות מגיעות כבלוקי tool_use מסוג member ולא ככלי מחשב יחיד, יכולות להיות כמה מהן בתור אחד, הפעולה היא ה-name של הבלוק ולא input.action, וכל תוצאה חייבת להחזיר את toolset_name בחזרה. ב-Amazon Bedrock, computer_20251124 ממשיך לעבוד בדיוק כפי שהוא עובד ב-Claude Opus 5 ואין צורך בשינוי.
אילו מהארבעה חלים גם על Claude Fable 5.1
Anthropic מציינת ששלושת הראשונים חלים גם על Claude Fable 5.1 — חשיבה פעילה תמיד, ללא בחירת כלי כפויה, ובלוקי חשיבה המשויכים למודל ולשיחה. השינוי ב-computer-use לא: זה ספציפי למודל הזה ב-Claude API וב-Google Cloud. כך שצוות שכבר עבר ל-Claude Fable 5.1 פרש את נתיבי הקוד עם החשיבה המושבתת ואת בחירות הכלי הכפויות שלו, ויש לו תבנית שיחה שמוסיפה בלבד; מה שנותר הוא מזהה המודל ומערך כלי ה-computer-use. צוות שמגיע מ-Claude Opus 5מתמודד עם כל הארבעה בבת אחת. זו ההגירה ששווה לתכנן, והיא כרוכה בכמות עבודה שונה בהתאם לנקודת ההתחלה.
השינוי החמישי: שום דבר לא נכשל, ופיד ההתקדמות שלך נעשה שקט
ב-Claude Opus 5, ההערות הקצרות שהמודל כותב בין קריאות לכלים מוחזרות כבלוקי טקסט רגילים. ב-Claude Opus 5.5 — כמו ב-Claude Fable 5.1 — הקריינות הזו מוחזרת כבלוקי חשיבה של עדכון התקדמות, לכל היותר אחד לפני כל קריאה לכלי. ו-thinking.display מוגדר כברירת מחדל להיות "omitted", כך שהבלוקים האלה מגיעים עם שדה thinking ריק לצד החתימה שלהם.
שום בקשה לא נכשלת. שום שגיאה לא נרשמת. אפליקציה שמזרימה למשתמשים שלה את הטקסט שבין הכלים כמדד התקדמות פשוט מפסיקה להציג התקדמות בין קריאות לכלים ומתחילה לא להציג דבר. התסמין הנראה לעין הוא ממשק משתמש שנראה קפוא בדיוק בקטע העבודה שבו המשתמש הכי רוצה להיות רגוע, והוא ידווח כבעיית ביצועים, בעיית רשת או תקיעה — לא כבאג מיגרציה. זהו השינוי שנשלח לפרודקשן.
התיקון הוא הגדרת תצוגה, בתוספת קריאה שמתאימה לה:
• הגדר את thinking.displayל"updates" — בטא, מאחורי הthinking-display-updates-2026-08-18 כותרת — כדי להחזיר את עדכוני ההתקדמות בזמן שהחשיבה עצמה נשארת מוסתרת. זו ההגדרה שפיד התקדמות רוצה.
• או הגדר זאת ל"מסוכם" כדי לקבל עדכוני התקדמות וסיכומי חשיבה מעורבים יחד באותם בלוקים.
• לאחר מכן קרא את הטקסט מבלוקי חשיבה ולא מבלוקי טקסט, הצג כל בלוק חשיבה שאינו ריק לפני בלוק ה-tool_use שהוא בא לפניו, והחזר את הבלוקים ללא שינוי יחד עם שאר תור העוזר.
ההערה של Anthropic עצמה בנושא זה ראויה לציטוט ברוח הדברים: ממשק שמציג טקסט בין קריאות לכלים אמור להגדיר ערך תצוגה במקום להסתמך על ברירת המחדל. אם האינטגרציה שלך מתעלמת לחלוטין מבלוקי חשיבה היום, זה המקום היחיד שבו ברירת המחדל בטוחה.

מאמץ הוא משטח ה-API
כאשר לא ניתן להשבית את החשיבה, output_config.effort הופך לחוגה היחידה למידת ההסקה של המודל, ולכן לחוגה היחידה לעלות ולשהיה במשימה נתונה. ארבעה דברים שכדאי לדעת עליו לפני שמעתיקים הגדרה מהמודל הישן.
ברירת המחדל השתנתה. ברירת המחדל של Claude Opus 5.5 היא מאמץ בינוני, בעוד ש-Claude Opus 5 ודגמי Opus מוקדמים יותר השתמשו כברירת מחדל במאמץ גבוה. בקשה שמשמיטה את המאמץ פועלת כעת ברמה אחת נמוכה יותר מאשר לפני ההחלפה. Anthropic גם מתעדת שהמודל נוטה לחשוב יותר בכל תור בהגדרת מאמץ נתונה מאשר Claude Opus 5 עשה, ובעיקר ב-xhigh וב-max. שתי ההשפעות הללו פועלות בכיוונים מנוגדים, וזו בדיוק הסיבה שההנחיה של הספק היא להריץ סריקת מאמץ חדשה על ההערכות שלך במקום לתרגם הגדרה מאחד לשני.
הסקאלה היא low / medium / high / xhigh / max, וכל חמש הרמות נתמכות כאן. הרמה הנקובה אינה מלכתחילה תקציב טוקנים קבוע — Anthropic מתארת את המאמץ כאות התנהגותי, ולא כתקציב קפדני — והקצאת הטוקנים שמאחורי כל רמה השתנתה בין המודלים, כך ש"high" ב-Claude Opus 5.5 אינו "high" ב-Claude Opus 5. הגדרת המאמץ לברירת המחדל של המודל זהה להשמטתו.
שני פרטים תפעוליים, כי שניהם עולים כסף כשמפספסים אותם. ראשית, שינוי ערך ה-effort ברמה העליונה בין בקשות מבטל את מטמון הפרומפט: בחרו רמה והשאירו אותה קבועה בתוך שיחה שנשענת על פגיעות במטמון, והשתנו אותה בין עומסי עבודה שונים במקום. שנית, המודל הזה תומך בeffort לכל הודעה (כותרת בטא mid-conversation-output-config-2026-07-01), שמשנה את הרמה החל מתור מאוחר יותר בלי להפעיל מחדש את המטמון. המינימום של מטמון הפרומפט כאן הוא 512 טוקנים, לעומת 1,024 בדור הקודם, כך שפרומפטים שהיו קצרים מדי מכדי להישמר במטמון יכולים כעת ליצור רשומות בלי שינוי בקוד.
תקרות פלט: 128K סינכרוני, 300K ב-Batch
ה-API הסינכרוני של Messages מגביל את הפלט ל-128K טוקנים. ה-API של Message Batches מגיע ל-300K טוקני פלט מאחורי כותרת הבטא output-300k-2026-03-24 — המחרוזת המדויקת הזו. הקלט הוא חלון ההקשר המלא של 1M טוקנים כברירת מחדל, ללא צורך בכותרת.
הקריאה המעשית: תקרת ה-128K לא השתנתה מ-Claude Opus 5, כך ששום דבר באינטגרציה סינכרונית לא צריך תקצוב מחדש בציר הזה בלבד. מה שכן צריך תקצוב מחדש הוא החשיבה שבתוכה. מכיוון ש-max_tokens מכסה כעת חשיבה וגם טקסט בכל בקשה, ערך שהיה צמוד לטקסט תגובה ב-Claude Opus 5 הוא הדוק יותר כאן — וב-xhigh או max effort הספק ממליץ להתחיל מ-64k ולכוונן. אם משימה ארוכת טווח תוקצבה מול תקרת 128K הסינכרונית וכעת נחתכת, התקרה היא לא מה שזז.
ניתוב Safeguard הוא חלק מהמפרט.
זו עובדת אינטגרציה, לא הערת שוליים של מדיניות: בחלק מהפרומפטים, מחרוזת המודל שאתה שולח אינה מתארת את מה שהשיב.
Claude Opus 5.5 מגיע עם מסווגי בטיחות, ובקשה שנדחתה חוזרת כתשובת HTTP 200 עם stop_reason: "refusal" ואובייקט stop_details המציין את תחום המדיניות. המודל הזה מכסה יותר קטגוריות מ-Claude Opus 5 — צפו ל-bio, frontier_llm ו-reasoning_extraction לצד ה-cyber המוכר. סירוב ה-reasoning_extraction נחסם לחלוטין ולא מנוסה שוב: מנגנון הגיבוי בצד השרת של Anthropic אינו מנסה אותו שוב, והסירוב מוחזר אליכם.
עבור הקטגוריות שכן מפעילות ניסיון חוזר, המנגנון הוא פרמטר. יש להגדיר את fallbacks ל"default" עם כותרת server-side-fallback-2026-07-01 הבטא, וה-API מריץ מחדש בקשה שנדחתה על המודל שאנתרופיק ממליצה עליו עבור אותה קטגוריה, בתוך קריאה אחת, ומחזיר תשובה אחת. מרכז העזרה של אנתרופיק מפרט ישירות את הניתוב למודל הזה: בקשות מסומנות בתחום הסייבר מופנות חזרה אל Claude Opus 4.8, ומסווגי הביולוגיה שלה — הסט בסגנון Fable-5 — גורמים להפניה חזרה אל Claude Opus 5 עבור עבודה במדעי החיים לשימוש כפול. קבוצה מצומצמת של יכולות פיתוח frontier-LLM מנותבת גם היא אל Claude Opus 5. אנתרופיק גם מציינת שהבדיקות סוקרות את כל מה שהמודל קורא, לא רק את ההודעה האחרונה שלך, כך שזיכרון, תוכן מחברים, תוצאות חיפוש וקבצים יכולים להפעיל החלפה.
שלושה דברים נובעים מכך עבור האינטגרציה שלך. יש לקרוא בכל תגובה את השדה model שברמה העליונה, מכיוון שהוא מדווח על המודל שלמעשה הפיק את ההודעה, ובלוק תוכן מסוג fallback מסמן כל נקודת העברה. אמת את מגבלות הקצב של ה-fallback עצמו, מכיוון ש-fallback שנמצא תחת מגבלת קצב אינו מנוסה ובמקומו מוחזר הסירוב — תחת עומס, מנגנוני fallback מתדרדרים לסירובים. והתייחס לכל הרצת benchmark מפורסמת עם אמצעי הגנה מופעלים כאל מדידה של המערכת המנותבת ולא של Claude Opus 5.5 בלבד, וזה בדיוק מה ש-Anthropic אומרת על המספרים שלה בהמשך.
מנגנון הגיבוי (fallback) בצד השרת הוא בגרסת בטא ומיועד ל-Claude API בלבד: הוא אינו נתמך ב-Message Batches API, ואינו זמין ב-Amazon Bedrock, Google Cloud או Microsoft Foundry, שם ה-middleware של ה-SDK הוא הנתיב המתועד במקום זאת. בצד האימות, קיימים מסלולי גישה לשתי הקטגוריות — תוכנית האימות לסייבר (Cyber Verification Program) ותוכנית האימות למדעי החיים (Life Sciences Verification Program) — אך שימו לב לאסימטריה שמתועדת במרכז העזרה של Anthropic נכון למועד כתיבת שורות אלה: Claude Opus 5.5 אינו מופיע כעת בתוכנית האימות לסייבר, בעוד שתוכנית מדעי החיים מתוארת ככזו שמעניקה לארגונים מאומתים גישה למודלים המסוגלים ביותר.
הקשר, חיתוך, פרישה ומצב מהיר
שאר המעטפת, מעמוד המודל ומטבלת ההוצאות משימוש:
• חלון הקשר — 1M טוקנים, ברירת מחדל, ללא כותרת בטא.
• תאריך עדכון הידע — יוני 2026, שהוא גם תאריך הקטיעה של נתוני האימון.
• פרישה — לא לפני 2027-09-22 בפלטפורמות המופעלות על ידי Anthropic, עם הודעה מוקדמת של 60 ימים לפחות. Amazon Bedrock ו-Google Cloud קובעים תאריכים משלהם. Claude Opus 5 פעיל עד ל-2027-07-24 לפחות, כך שאין מעבר כפוי.
• מחירון — $4.00 לכל מיליון קלט, $20.00 לכל מיליון פלט, $5.00 לכל מיליון כתיבות מטמון של 5 דקות, $8.00 לכל מיליון כתיבות מטמון של שעה, $0.20 לכל מיליון קריאות מטמון. Batch הוא חצי מחיר בשני הכיוונים, $2.00 / $10.00.
• קריאות מטמון הן החריגה שראויה לתשומת לב: $0.20 הם 5% מקלט הבסיס, בעוד שרוב דגמי Claude עומדים על 10% ו-Claude Fable 5.1 על 2.5%. עומסי עבודה משולבים עם שימוש חוזר רב במטמון חשים בכך כהנחה ממשית.
• מצב מהיר — עדיין מתועד כתצוגה מקדימה מחקרית, Claude API בלבד, בתמחור נפרד של $8.00 קלט / $40.00 פלט למיליון. יש להפעיל עם speed: "fast" ואת כותרת ה-beta fast-mode-2026-02-01. הוא אינו זמין ב-Bedrock, ב-Claude Platform on AWS, ב-Google Cloud או ב-Microsoft Foundry, לא עם ה-Batch API, ולא עם התחייבות ל-Priority Tier. שימו לב ש-Claude Opus 5.5 אינו תומך ב-Priority Tier כלל.
מה אומרים הבנצ'מרקים, ובאיזו הגדרה
הגדרות המאמץ הן הסיבה לכך שלא ניתן להשוות טבלת ספק וטבלה עצמאית שורה אחר שורה, וזו הסיבה שכל מספר שלהלן נושא את ההגדרה שלו.
מדווח על ידי הספק, בהרנס של Anthropic עצמה. הערת ההשקה של Anthropic אומרת שאם לא צוין אחרת, כל תוצאות Claude Opus 5.5 משתמשות בחשיבה אדפטיבית ברמת מאמץ מקסימלי; היוצא מן הכלל הוא Terminal-Bench 4.0, המדווח ב-xhigh עבור Claude Opus 5.5 וב-high עבור GPT-6 Astra, מכיוון שאלה הציונים הגבוהים ביותר של כל דגם. על בסיס זה הספק מדווח על Terminal-Bench 4.0 ב-66.4%, FrontierCode v1.1 Main ב-54.4%, CursorBench 4.0 ב-57.8%, GDPval-AA v2.1 ב-1,846 Elo, AutomationBench ב-40.0%, Humanity's Last Exam עם כלים ב-67.7%, Terminal-Bench-Science 0.1 ב-58.7%, OSWorld 2.0 ב-81.8% חלקי, ו-Chartography עם כלים ב-89.0%. במאמץ הבינוני המוגדר כברירת מחדל של הדגם, הספק נותן ל-FrontierCode 54.6% ול-CursorBench 52.5%. שימו לב למה שאותה הערה חושפת: ההערכות הורצו עם אמצעי הגנה של סביבת ייצור מופעלים, וכאשר אלה הופעלו, משימות סייבר הושלמו על ידי Claude Opus 4.8 ומשימות ביולוגיה ופיתוח LLM חזיתי על ידי Claude Opus 5 — Anthropic אומרת שזה כנראה מפחית את הביצועים של Claude Opus 5.5 במדדים האלה. לפיכך, ציונים שפורסמו בהערכות המושפעות אינם מדידות נקיות של דגם זה.
בלתי־תלוי, Artificial Analysis. במדד Intelligence Index v4.3.2, Claude Opus 5.5 משיג 58 בתצורה ש-Artificial Analysis מכנה "Adaptive Reasoning, Max Effort, Default Fallback" — הציון הגבוה ביותר שנמדד לו, בפער של כמה נקודות, והוא מוביל בשש מתוך עשר ההערכות המרכיבות. באותו מדד ובאותה ערכת בדיקה, Claude Fable 5.1 משיג 53 ו-Claude Opus 5 משיג 51. Artificial Analysis מפרסמת את סולם המאמץ המלא, שהוא הפריט העצמאי השימושי ביותר כאן: max 58, xhigh 56, high 54, medium 51, low 42. המדידות שלה עצמה מציבות את Claude Opus 5.5 על כ-119,000 אסימוני פלט לכל משימת מדד במאמץ מקסימלי, לעומת כ-73,000 עבור Claude Opus 5, 78,000 עבור Claude Fable 5.1 ו-27,000 עבור GPT-6 Astra — אסימונים המחויבים כאסימוני פלט — והדף שלה מדווח על עלות של $5.98 לכל משימת מדד. היא גם מודדת את Terminal-Bench 4.0 על 59.6% ו-Humanity's Last Exam על 61.4%, לעומת 66.4% ו-67.7% של הספק במאמץ מקסימלי בערכת בדיקה שונה.
קִראו את שתי הפסקאות האלה זו מול זו, והמסקנה הכנה היא צרה. 66.4% של הספק ב-Terminal-Bench ו-59.6% העצמאיים הם אותו מבחן שהורץ בידי אנשים שונים בהגדרות שלא מובטח שיתאימו, ואף אחד מהם אינו ראיה לגבי עומס העבודה שלכם. סולם המאמץ הוא הממצא שניתן להעביר הלאה: במדד עצמאי, ההגדרות של המודל הזה עצמו משתרעות על פני שישה עשר נקודות, וזהו טווח רחב יותר מהפער בינו לבין קודמו. בחירת רמת מאמץ חשובה יותר מבחירה בין המודלים האלה, והסעיף "Default Fallback" בתווית ההיא הוא ניתוב הגנה המתואר לעיל, ולא תוצר לוואי של מבחן.
יעילות כפי שדווחה על ידי הספק, עם ייחוס. אנתרופיק אומרת ש-Claude Opus 5.5 פועל ברמה של Claude Fable 5.1 ברוב העבודות, בעלות הפעלה נמוכה בכ-40%, ושעומסי עבודה טיפוסיים עולים כ-40% פחות מאשר ב-Claude Opus 5, מול קיצוץ של 20% במחיר המחירון. התפוקה מהירה ביותר מ-30%. אלו תיאורי ספק של ממוצעים על פני עומסי עבודה שהספק בחר. הצהרות הלקוחות בזמן ההשקה הן אותו סוג של ראיות: Box מדווחת על שליש מהטוקנים ועל תשובות פחות מפורטות בכ-40%, Kiro על כמחצית מהטוקנים וכ-40% פחות קריאות, Factory על 20–25% פחות טוקני פלט, ו-GitHub על בין המעט טוקנים ושלבים שהיא מדדה. אנתרופיק מדווחת גם על מבחן בדיקת עובדות פנימי שבו 16 מתוך 18 דוחות שלה עברו רף איכות שאף לא Claude Fable 5.1 ולא Claude Opus 5 עברו באף ניסיון. כל זה מדווח על ידי הספק, ואף לא אחד ממנו מבוקר. המגבלה הנחשפת מנוסחת בכנות יוצאת דופן וראויה לציטוט: אנתרופיק אומרת ש-Claude Opus 5.5 "חושד לעיתים קרובות שנערכת עליו הערכה".
ולבסוף, מודלי האחים: Anthropic אומרת ש-Claude Sonnet 5.5 ו-Claude Haiku 5.5 יגיעו "בשבועות הקרובים". אף אחד מהם לא הופץ, אף אחד מהם לא תומחר, ואף אחד מהם אינו זמין בשום משטח היום.
בדיקת ארבעת השינויים ללא מעבר מלא
סיכון ההגירה כאן אינו איכות — אלא שנתיב קוד שמעולם לא הפעלת בסביבת הבדיקות הוא זה שמחזיר 400 בייצור. ארבעת השינויים השוברים הם כולם שינויים בצורת הבקשה, מה שאומר שהם נכשלים באופן דטרמיניסטי ומיידי, והדרך היחידה למצוא את הנתיבים שהחמצת היא להעביר דרכם תעבורה אמיתית.
Claude Opus 5.5 נמצא ב-OrcaRouter בתור anthropic/claude-opus-5.5במחיר המחירון של Anthropic עצמה עם 0% תוספת — מחיר המחירון של הספק מועבר כפי שהוא, כך ששינוי מחיר של ספק נכנס לתוקף כאן באותו היום.

זה מאפשר לך להפנות אחוז מתעבורת הייצור אל המודל בזמן שהשאר עדיין פועל על Claude Opus 5, לראות אילו בקשות נכשלות ולמה, ולתקן אותן אחת אחת. ארבע השגיאות מתארות את עצמן: כל אחת מציינת את הפרמטר שהיא דחתה, ובשלושה מתוך ארבעה מקרים, גם את התחליף. מעבר אוטומטי במקרה כשל מכסה את הפער בזמן שנתיב עדיין שבור — בקשה שנכשלת מול מודל שטרם אפיינת במלואו נופלת חזרה למודל שכבר אפיינת, במקום להציג את ה-400 למשתמש.
סדר עבודה מעשי: החלף תחילה את מזהה המודל והגדר effort במפורש, מכיוון שברירת המחדל עברה ל-medium; לאחר מכן הסר את מסלולי ה-thinking-disabled ובחירת הכלי הכפויה; ואז תקן את קורא ה-streaming — בחירת בלוקים לפי סוג והגדרת thinking.display — מפני שזה זה שנכשל בשקט ולא בקול; והשאר את העברת ערכת הכלים של computer-use לסוף אם אתה על Bedrock, מכיוון שזה זה שלא חל שם. כל השאר — מחיר, חלון הקשר, שיעורי מטמון וברירת המחדל של 1M טוקנים — כבר נמצא במקום שהשארת אותו.
נתבו חלק מהתעבורה החיה למודל החדש בלי מעבר מלא: Claude Opus 5.5 ב-OrcaRouter פועל במחיר המחירון של Anthropic, עם מעבר אוטומטי למודל שכבר אפיינתם.
השוואות במאמר הזה4
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
