כרטיס כותרת שנוצר ועליו הכיתוב 'Claude Sonnet 5.5', עם כותרת המשנה 'ברירת המחדל של הדרג הבינוני, מוגדרת במלואה', ושלושה תגים שעליהם הכיתוב 'שוחרר ב-2026-09-28', '$2 קלט / $10 פלט לכל מיליון טוקנים' ו'מדד האינטליגנציה 56.00 לעומת 57.62'. הלוגו של OrcaRouter מורכב בפינה הימנית התחתונה.
Guides & Insights

Claude Sonnet 5.5: ברירת המחדל בדרג הביניים, מפורטת במלואה

מחבר

Rowan Sterling

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

Claude Sonnet 5.5 הוא המודל בדרג הביניים של קו Claude, שיצא לאור ב-28 בספטמבר 2026, והתמחור הוא כל הסיבה שבגללה הוא ראוי לעמוד משלו: 2 דולר למיליון טוקנים בקלט ו-10 דולר למיליון טוקנים בפלט, לעומת 4 ו-20 דולר עבור Claude Opus 5.5, דגל האונייה שיצא שישה ימים קודם לכן. זהו חצי ממחיר הפלט תמורת 1.62 נקודות במדד הבינה של Artificial Analysis — 56.00 לדרג הביניים לעומת 57.62 לדגל האונייה, שני הנתונים נמדדו על ידי Artificial Analysis בגרסת המדד v4.3.2, לא על ידינו ולא על ידי הספק. מעל שניהם ניצב Claude Fable 5.1, במחיר 10 / 50 דולר וב-53.35 באותה גרסה: יקר יותר מדגל האונייה, וגם ממוקם אחריו. באותו מחיר מחירון של 2 / 10 דולר כמו Claude Sonnet 5.5 ניצב GPT-6.1 Sol של OpenAI, עם 51.83 — 417 מאיות מדד בצד השני של הקו, וזה ההשוואה שקורא השוקל את דרג הביניים פשוט חייב לערוך.

הדף הזה הוא עמוד עזר, והתאריכים אומרים את ה'למה' ולא את הטריות. Claude Sonnet 5.5 בן עשרה ימים ב-2026-10-08, מה שמציב אותו מחוץ לחלון שבעת הימים שבו הבלוג הזה מדווח חדשות. מה שכן נמצא בתוך החלון הזה הוא אירוע בן שישה ימים: שני פוסטים ב-X מתאריך 2026-10-02, הטוענים שמודל יורש במשפחה הזו מנצח מתחרה שהספק של עצמו סיים ולא שחרר. לטענה הזו אין מזהה מודל, אין כרטיס תעריפים, אין חלון הקשר ואין בנצ'מרק מאחוריה בשום מרשם נגיש מכאן, והיא אינה נושא הדף הזה — שרשרת המקורות, בדיקת ההיעדרות במשטח הספק ופריסת מדד חמשת המודלים — כולן שייכות במלואן לכתבה שהבלוג הזה כבר פרסם תחת הכותרת Claude Fable 5.5 ניצח את GPT-6.1 Astra לפני שהוא קיים — וזה החלק המעניין, אשר מתוארכת ל-2026-10-03. מה שהטענה הזו כן יצרה הוא תור של קוראים ששואלים איזה מודל Claude ששוחרר לאמץ כתקן בזמן שהם ממתינים, והשאלה הזו זקוקה לדף על המודל שקיים. זהו זה.

מה שוחרר ב-28 בספטמבר 2026?

התיעוד של הספק עצמו מספק את המפרט ישירות, והוא המשך של השכבה ולא צורה חדשה. כל מה שלהלן נקרא מתיעוד Claude Platform של Anthropic ב-2026-10-08, ולכן זהו המפרט של Anthropic, ולא בדיקה בלתי תלויה שלו.

• שוחרר — 28 בספטמבר 2026. עמוד התיעוד של המודל עצמו נפתח בשורה "האחרון. שוחרר ב-28 בספטמבר 2026."

• מיצוב — "השילוב הטוב ביותר של מהירות ותבונה", כאשר זמן השהיה השוואתי מוצג כ"מהיר" לעומת "בינוני" עבור Claude Opus 5.5, "איטי יותר" עבור Claude Fable 5.1 ו"המהיר ביותר" עבור השכבה הקטנה.

• מזהה מודל — claude-sonnet-5-5 ב-Claude API, Google Cloud, Microsoft Foundry ו-Claude Platform on AWS; anthropic.claude-sonnet-5-5 ב-Amazon Bedrock. כל מזהה מודל של Claude הוא תמונת מצב מקובעת, כך שהמחרוזת אינה מצביע שנסחף מתחתיך.

• הקשר ופלט — 1,000,000 טוקנים של הקשר ו-128,000 טוקנים של פלט סינכרוני ב-Messages API, בעלייה ל-300,000 מאחורי כותרת הבטא output-300k-2026-03-24 ב-Message Batches API.

• חשיבה — אדפטיבית, פעילה תמיד כברירת מחדל, עם מאמץ ברירת מחדל של high. ההגדרה הנמוכה ביותר היא between_tools, שמכבה חשיבה מוקדמת ומתקבלת במאמץ high או נמוך יותר. הגדרת temperature, top_p או top_k לערך כלשהו שאינו ברירת המחדל שלהם מחזירה שגיאת 400, כך שבקשה שהועברה ממודל Claude ישן יותר עם temperature מכוונן תיכשל בקול רם ולא בשקט.

• תאריך הפסקת הידע — יוני 2026, הן עבור תאריך ההפסקה המהימן והן עבור תאריך הפסקת נתוני האימון.

• מחזור חיים — פעיל (האחרון), עם התחייבות לפרישה שלא לפני 28 בספטמבר 2027 בפלטפורמות שאנתרופיק מפעילה. Amazon Bedrock ו-Google Cloud קובעים תאריכים משלהם.

הניסוח של הספק בעת ההשקה ראוי לציטוט משום שהוא טענה ולא מדידה: ההכרזה של Anthropic מתארת את Claude Sonnet 5.5 כ"שדרוג ברור לעומת Sonnet 5 שרץ 30% מהר יותר ועולה עד 30% פחות עבור רוב העבודות". המשפט הזה הוא של הספק, ולא שוחזר על ידינו, והוא מהסוג של טענות שתלויות לחלוטין באיזו עבודה תציבו לפניו. כמו כן, יש עלות הגירה הכרוכה בשחרור שהעמוד הזה אינו המקום לדון בה: חמישה שינויים שוברים משפיעים על קוד שכבר רץ על Claude Sonnet 5, והשישי משנה את מבנה התגובה בלי לגרום לאף בקשה להיכשל. החשבונאות הזו שייכת למאמר הפריסה שהבלוג הזה פרסם בשבוע ההשקה, והיא הדבר הראשון שכדאי לקרוא אם יש לכם Sonnet 5 בפרודקשן היום.

A screenshot of Anthropic's Claude Platform documentation page for Claude Sonnet 5.5, headed with the line 'Latest. Released September 28, 2026', showing the model ID claude-sonnet-5-5, pricing of $2 per input MTok and $10 per output MTok, a 1M-token context window, 128K max output, adaptive thinking with a default effort of high, a June 2026 knowledge cutoff and a retirement commitment of not sooner than September 28, 2027.

1.62 הנקודות, וחצי המחיר

ציונים בלתי תלויים עבור מודל זה מגיעים ממקום אחד, והם נושאים מספר אחד שמכריע את הוויכוח. Artificial Analysis מודדת את Claude Sonnet 5.5 ב-56.00 במדד האינטליגנציה שלה, גרסה v4.3.2, בתצורה שהדף מכנה "Claude Sonnet 5.5 (Max, Default Fallback)". קראנו את הדף הזה ב-2026-10-08. באותה גרסה, באותו יום:

• Claude Opus 5.5 — 57.62, שוחרר ב-2026-09-22, $4 / $20

• Claude Sonnet 5.5 — 56.00, שוחרר 2026-09-28, $2 / $10

• Claude Fable 5.1 — 53.35, שוחרר ב-2026-09-01, $10 / $50

• GPT-6 Astra — 52.67, שוחרר ב-2026-09-03, $10 / $50, עם שכבת הקשר ארוך מעל 272,000 טוקני פרומפט ב-$20 / $75

• GPT-6.1 Sol — 51.83, שוחרר ב-2026-09-29, $2 / $10

ציון באיזו גרסה מדובר חשוב, מפני שציון מגרסה אחת של המדד אינו בר־השוואה לציון מגרסה אחרת: v4.3.2 כולל עשר הערכות — AA-Briefcase v1.1, GDPval-AA v2.1, AutomationBench-AA, Terminal-Bench 4.0, SciCode, Humanity's Last Exam, GDP.pdf, CritPt, AA-Omniscience ו-AA-LCR v1.1 — וההרכב של אותה קבוצה השתנה בין הגרסאות. כל חמשת המספרים שלעיל מגיעים מאותה גרסה, ולכן אפשר להשוות אותם זה לזה, ולכן אין להשוות אף אחד מהם למספר שצוטט מגרסה קודמת.

השוואת המחירים היא החלק שקובע את ההתנהגות. תעריף הפלט של Claude Sonnet 5.5 הוא חצי מזה של Claude Opus 5.5, ותעריף הקלט שלו הוא חצי גם כן; במחירון של הספק עצמו, דרג הביניים עולה $2 / $10 בעוד שהדגם המוביל עולה $4 / $20. אם מחשבים יחד את שני המספרים שפורסמו, היחס חד במיוחד: לכל דולר של מחיר פלט לפי המחירון, Claude Sonnet 5.5 נושא 5.60 נקודות מדד ו-Claude Opus 5.5 נושא 2.88 — כמעט פי שניים מדד לכל דולר פלט, לפי כרטיס התעריפים של Anthropic עצמה ולפי המדידה של Artificial Analysis עצמה. זהו חשבון המבוסס על שני נתונים שפורסמו ולא מדידה של משהו, וזו הצורה הכנה של הטיעון בעד דרג הביניים. זה גם אינו פסק דין: נקודת מדד אינה יחידת נכונות, והמטרה של שאר העמוד הזה היא ממה מורכב 1.62 ומה לא.

A generated two-column scoreboard titled 'Claude Sonnet 5.5 vs Claude Opus 5.5 - the scoreboard'. The left column, Claude Sonnet 5.5, reads: Released September 28, 2026; Intelligence Index v4.3.2: 56.00; Price per 1M tokens: $2.00 / $10.00; Context window: 1M tokens; Max output: 128K tokens; Default effort: high. The right column, Claude Opus 5.5, reads: Released September 22, 2026; Intelligence Index v4.3.2: 57.62; Price per 1M tokens: $4.00 / $20.00; Context window: 1M tokens; Max output: 128K tokens; Default effort: medium. The footer reads 'Index figures per Artificial Analysis v4.3.2, read 2026-10-08; prices and specifications per Anthropic.' The OrcaRouter logo is composited in the bottom-right corner.

כרטיס התעריפים, ושתי השורות שזזות הכי הרבה

רשימת המחירים המלאה של Anthropic, נקראה ב-2026-10-08. כל נתון בסעיף זה הוא של הספק.

• קלט — $2.00 למיליון טוקנים. פלט — $10.00 למיליון, וטוקני חשיבה מחויבים כפלט, מה שלא ניתן להשתיק כאן מכיוון שחשיבה אדפטיבית פועלת כברירת מחדל.

• קריאת מטמון — $0.10 למיליון, ש-Anthropic מתעדת כ-5 אחוזים ממחיר הקלט הבסיסי. זו אותה הנחה פרופורציונלית שנושאת Claude Opus 5.5, כך שהמטמון לא משנה את הדירוג בין השניים, וזה אכן אומר שהרצת סוכן ארוכה ששומרת על קידומת יציבה משלמת עשירית מתעריף הקלט על כל מה שהיא קוראת מחדש.

• כתיבת מטמון — 2.50$ למיליון עבור המטמון של חמש דקות, 4.00$ עבור המטמון של שעה. האורך המינימלי של פרומפט שניתן לשמור במטמון הוא 512 טוקנים, כך שפרומפטים קצרים לא יכולים לקנות את ההנחה כלל.

• Batch API — 50 אחוז הנחה בשני הכיוונים, כלומר $1.00 לקלט ו-$5.00 לפלט עבור עבודה שיכולה לחכות.

• ללא תוספת תשלום עבור הקשר ארוך — Anthropic מחייבת את חלון מיליון הטוקנים המלא בתעריף הסטנדרטי לכל טוקן במודל הזה, כך שבקשה של 900,000 טוקנים עולה אותו סכום לכל טוקן כמו בקשה של 9,000 טוקנים. זהו הבדל ממשי מ-GPT-6 Astra, שדרגת ההקשר הארוך שלה מעל 272,000 טוקני פרומפט עולה ל-$20 / $75 — ראוי לציון משום שזה המקום היחיד שבו המספרים הכותרות של שני הספקים מתפצלים בחדות כאשר הפרומפט מתארך.

שתי שורות קובעות את רוב החשבונות ולא התעריף הכותרתי: הנחת הקריאה מהמטמון לאורך הרצת סוכן ארוכה, והנחת האצווה לכל דבר. ה-$2 / $10 הכותרתיים הם מה שמשווים על לוח מובילים; שורות המטמון והאצווה הן מה שמהן נבנית בפועל חשבונית חודשית.

מה המשמעות של הפער ומה אינה משמעותו

ה-Intelligence Index הוא מספר אחד על מערך משימות קבוע, והתכונה היחידה הזו מסבירה את רוב הבלבול סביבו. עשר ההערכות שמאחורי v4.3.2 כוללות קידוד אג'נטי ועבודה בטרמינל, הסקה מדעית ברמת תואר שני, מערך הנדסת תוכנה, מערך אוטומציה אג'נטית ומערך אחזור בהקשר ארוך, כשהן משוקללות לציון מורכב. מודל שנמצא 1.62 נקודות מאחורי אחר הוא מאחור בציון המורכב הזה — לא בעומס העבודה שלך, שעשוי לשקלל את עשרת אלה בפרופורציה שונה לחלוטין, ועשוי להכיל משימות שאף אחת מהן לא מייצגת.

מה שזה אומר בפועל הוא חלוקה לפי צורת העבודה ולא לפי היוקרה של הדרג. בורר המודלים של Anthropic עצמה מבצע את החלוקה במפורש, וכדאי לקרוא אותו, משום שהוא אינו מחמיא לדרג הבינוני: התיעוד אומר לקוראים "להתחיל עם Claude Opus 5.5 עבור רוב עומסי העבודה", ולפנות אל Claude Fable 5.1 "עבור הסקה תובענית ועבודה סוכנית באופק ארוך, או כאשר ההערכות שלכם על Claude Opus 5.5 במאמץ גבוה יותר עדיין נופלות קצרות". Claude Sonnet 5.5 אינו המודל שאיתו מתחיל המשפט הזה. הוא המודל שאותו תיעוד מתאר כשילוב הטוב ביותר של מהירות ותבונה, עם זמן השהיה השוואתי המהיר ביותר מחוץ לדרג הקטן — וזו טענה אחרת, וצרה יותר.

אז הקריאה הישרה היא זו. שכבת הביניים היא בדרך כלל התשובה הנכונה לעבודה בעלת היקף מוגדר היטב ובנפח גדול: פיצ'רים ותיקוני באגים מול בסיס קוד מוכר, חילוץ וסיווג עם צורת פלט מוגדרת, לולאות קריאה לכלים שבהן החלק הקשה הוא התשתית ולא ההיסק, וכל דבר שבו אסימון ראשון מהיר ועלות נמוכה לכל קריאה חשובים יותר משני האחוזים האחרונים של היכולת. דגם הדגל מצדיק את התעריף שלו כשהעבודה היא באמת באופק ארוך — הרצות סוכן של שעות רבות, ריפקטורים שמשתרעים על פני קבצים שהפרומפט לא יכול להכיל בבת אחת, והערכות על שכבת הביניים שנופלות במידה מדידה במאמץ גבוה יותר. התנאי האחרון הוא של הספק עצמו, והוא תנאי שניתן לבדיקה: העלו את רמת המאמץ בשכבת הביניים, הריצו הערכה משלכם, ובדקו אם היא סוגרת את הפער. אם כן, ה-1.62 לא היה גורם קריטי עבורכם. אם לא, קניתם את התשובה שלכם במספרים שלכם ולא בציון המשולב של מישהו אחר.

מה שהפער לא אומר הוא ש-1.62 נקודות אינן כלום. זהו כל הפער בין שני מודלים, וכאשר ההערכה נעשית על מערכת בדיקה קבועה בתנאים זהים, זהו דירוג אמיתי. זהו בסך הכול דירוג של תמהיל משימות מסוים, במאמץ מרבי עם גיבוי ברירת מחדל, והוא לא אומר דבר על איזה מבין השניים הוא הקנייה הטובה יותר עבור עומס עבודה שאף אחד מהשניים לא נבחן עליו.

מלכודת השם: באיזה עמוד של Claude Sonnet 5.5 מדובר

קורא שמחפש את שמו של המודל הזה נתקל בכמה עמודים בבלוג הזה שנראים כמו זה, אבל הם לא. זה שמתוארך ל-2026-09-24 הוא עמוד הציפייה: הוא נכתב לפני שהמודל יצא, והנושא שלו היה פוסט X בודד שטען לקיומה של בדיקה חשאית, ששוחזר אל מול המספרים של המודל שאותו הוא נועד להחליף. זה שפורסם בשבוע ההשקה הוא פוסט ההפצה: הנושא שלו הוא חמשת השינויים השוברים שמשפיעים על קוד שכבר רץ על Claude Sonnet 5, בתוספת השינוי השישי שמשנה את מבנה התגובה בלי להעלות שגיאה. יש גם סדרה של עמודי השוואה הנושאים את שמו של המודל הזה מול המודלים של ספקים אחרים, ועמוד יישומי על מה שהמבצע של ההשקה מכסה.

אף אחד מהם אינו עמוד המודל, וזה הפער שהקטע הזה ממלא. העמוד הזה הוא עמוד הייחוס שאליו מגיע קורא לאחר חיפוש שם המודל עצמו: מהו, כמה הוא עולה, מה הוא מודד, ואיזו עבודה שייכת לו. פרטי ההגירה של עמוד הפריסה והביקורת על המקורות של עמוד הציפייה נשארים במקומם; אם יש לך קוד Sonnet 5 בפרודקשן, עמוד הפריסה הוא הלחיצה הראשונה שלך, והעמוד הזה הוא מה שאומר לך אם המודל שאליו אתה מבצע הגירה הוא המודל שאתה רוצה.

הרגל שמות אחד שווה לתקן כל עוד אנחנו כאן, כי הוא מטעה בפני עצמו. סיומת 5.5 מסמנת דור, לא דירוג. Claude Sonnet 5.5 ו-Claude Opus 5.5 הם אותו דור של אותה משפחה, והמספר שלפני הנקודה הוא הדרג. שום דבר בסיומת לא אומר לך מי מנצח בבנצ'מרק.

זמינות, מתוארך

Claude Sonnet 5.5 נמצא ב-OrcaRouter מאז שיצא, בתור anthropic/claude-sonnet-5.5, במחיר המחירון של Anthropic עצמה וללא תוספת מעליו: $2.00 לקלט ו-$10.00 לפלט לכל מיליון טוקנים, שני הנתונים נקראו מנקודת הקצה של המודל שלנו בתאריך 2026-10-08 ומתאימים שורה בשורה לטבלת התעריפים של הספק. העמוד שלנו עבורו מציג את אותו חלון הקשר של 1M טוקנים ואת הפלט המרבי של 128K, מפרט טקסט, תמונה וקובץ כסוגי קלט מתקבלים וטקסט כפלט היחיד, מסמן אותו כשוחרר ב-2026-09-28 וככזה שאינו מיושן, ומראה שהוא נגיש גם דרך נקודת הקצה chat-completions התואמת ל-OpenAI וגם דרך נקודת הקצה messages של Anthropic עצמה — וזה מה שהופך אותו לשינוי drop-in עבור אינטגרציה שכבר מדברת באחת מהן.

כל השאר באותו קטלוג נגיש מאותו מפתח: API אחד ל-200+ מודלים, עם מחיר המחירון של הספק המועבר הלאה בתוספת של 0% כך שהורדת מחיר של ספק מגיעה ללקוח ביום שבו היא מוכרזת, מעבר אוטומטי לגיבוי כאשר נקודת קצה נפגעת, ו-DSL לניתוב במקרים שבהם תרצו לנעוץ מודל מסוים או להרכיב כמה מהם לתשובה אחת. השילוב הזה הוא מה שהופך את השאלה בעמוד הזה לזולה למענה במקום ליקרה. שני המודלים בהשוואה שלמעלה נמצאים מאחורי אותם פרטי התחברות, כך שהמחיר שאתם משווים אליו הוא המחיר המפורסם של הספק עצמו ולא של מפיץ מחדש, ומבחן הגרסה עולה הרצת הערכה אחת ולא פרויקט הגירה: כוונו פלח תעבורה אל anthropic/claude-sonnet-5.5, השאירו את השאר על המודל המוביל, ותנו למספרים שלכם של עלות למשימה שהושלמה להחליט מה צריך להיות ברירת המחדל.

A screenshot of the OrcaRouter model page for anthropic/claude-sonnet-5.5, attributed to Anthropic and dated 2026-09-28, showing a 1M-token context window, 128K maximum output, text image and file inputs with text output, an input price of $2.00 per million tokens and an output price of $10.00 per million tokens, the model id claude-sonnet-5-5, and an OrcaRouter performance panel.

הגרסה הקצרה

Claude Sonnet 5.5 הוא מודל בדרג הביניים עם מספרים הקרובים לדגם הדגל ובחצי ממחיר הפלט של דגם הדגל, ושלוש העובדות שמכריעות אם הוא ברירת המחדל שלך הן אלה. הוא נמצא 1.62 נקודות מאחורי Claude Opus 5.5 במדד v4.3.2 של Artificial Analysis, ב-56.00 לעומת 57.62, כאשר שני הנתונים נמדדו באותה גרסה ובאותה תצורת מאמץ מרבי עם גיבוי ברירת מחדל. הוא עולה $2 / $10 לעומת $4 / $20 של דגם הדגל, כאשר הנחות המטמון והאצווה פרופורציונליות ולא שונות, כך שפער המחירים שורד כל הנחה של כל אחד מהמודלים. וברירת המחדל שלו היא גבוהה ברמת מאמץ, בעוד שדגם הדגל כברירת מחדל מגיע לרמה בינונית, כלומר הגדרה שהועברה מדגם הדגל פועלת כאן ברמה אחת גבוהה יותר ולא נמוכה יותר, והעלות של זה היא עליך למדוד ולא להניח.

הבורר של Anthropic עצמה עדיין מתחיל ב-Claude Opus 5.5 עבור רוב עומסי העבודה, וכדאי לדעת זאת לפני שאתם קובעים תקן על משהו. אבל עבור רוב הקוראים שמגיעים לעמוד הזה דרך חיפוש שם המודל הזה, שכבת הביניים היא ברירת המחדל ההגיונית, והדגם המוביל הוא היוצא מן הכלל שאתם קונים כשההערכות שלכם דורשות אותו — עבודה ממוקדת היטב ובנפח גדול, השהיה מהירה, חלון של מיליון טוקנים בלי תוספת מחיר על הקשר ארוך, ותעריף שחותך בחצי את מחיר שורת הפלט. שניהם במרחק מפתח אחד זה מזה ב-OrcaRouter, וההערכה שמכריעה ביניהם עולה אחר צהריים אחד ולא מיגרציה.

השוואות במאמר הזה4

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית