
Claude Sonnet 5.5: הדלפת מבחן חמקני שנבנתה מארבעה מספרים שכבר קיימים
- typesafeחדשTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 לכל 1M טוקנים · 36 tok/s
- openaiחדשOpenAI: GPT-6 Luna2026-09-2237אינטליגנציה
- openaiחדשOpenAI: GPT-6 Sol2026-09-2248אינטליגנציה
- anthropicחדשAnthropic: Claude Opus 5.52026-09-2258אינטליגנציה
- grokחדשGrok 4.72026-09-2146אינטליגנציה
- OrcaחדשOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 לכל 1M טוקנים · 181 tok/s
- orcaחדשOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 לכל 1M טוקנים · 1277 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040אינטליגנציה
- openaiOpenAI: GPT-6 Astra2026-09-0453אינטליגנציה77כתיבת קוד
- googleGoogle: Gemini 3.8 Flash2026-09-0241אינטליגנציה76כתיבת קוד
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245אינטליגנציה76כתיבת קוד
- anthropicAnthropic: Claude Fable 5.12026-09-0153אינטליגנציה82כתיבת קוד
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 לכל 1M טוקנים · 110 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642אינטליגנציה72כתיבת קוד
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 לכל 1M טוקנים · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845אינטליגנציה75כתיבת קוד
- obsidianQwen3.8 27B2026-08-1534אינטליגנציה68כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236אינטליגנציה69כתיבת קוד
- grokSpaceXAI: Grok 4.62026-08-1244אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0540אינטליגנציה72כתיבת קוד
ארבעה מספרים פורסמו ב-X ב-24 בספטמבר כהוכחה לכך ש-Claude Sonnet 5.5 "כבר נבחן בחשאי": חלון הקשר של 1M טוקנים, פלט מרבי של 128K טוקנים, 2 דולר למיליון טוקני קלט ו-10 דולר למיליון טוקני פלט. כל הארבעה מופיעים כעת במחירון של Anthropic עצמה, ומשויכים ל-Claude Sonnet 5 — המודל ש-5.5 יחליף, שזמין באופן כללי מאז 30 ביוני 2026. אותה כותרת של 2 / 10 דולר שייכת גם ל-GPT-6 Sol, ש-OpenAI השיקה ב-22 בספטמבר, והחפיפה הזו היא מה שגורם לפוסט להיקרא כתשובה ל-OpenAI ולא כרענון שגרתי של דרג: "זה נקרא לי כתגובה ישירה ל-GPT-6-Sol. אותו תמחור, וככל הנראה גם ביצועים דומים."
שום דבר מזה לא הופך את הטענה לשגויה. זה הופך את הטענה לבלתי ניתנת להפרכה, וזו בעיה שונה, ושימושית יותר לרשום. תצפית בבדיקת חמקן טובה רק כמו הארטיפקט שמאחוריה, והארטיפקט שמאחורי זו הוא דף מפרט שאינו ניתן להבדיל מהמודל ש-Anthropic מגישה מזה שנים־עשר שבועות.
מה בעצם פורסם
המקור הוא פוסט בודד ב-X מהחשבון @kimmonismus, מתאריך 24 בספטמבר 2026. הוא מציין את חלון ההקשר, תקרת הפלט ושני המחירים, משווה את התמחור ל-GPT-6 Sol, ומסיק ש-Sonnet 5.5 נמצא בבדיקות. אין צילום מסך, אין מחרוזת מודל, אין תגובת API, אין רישום קונסול, אין תיאור של התנהגות מצד בוחנים, ואין צופה שני המשויך לכך. הפוסט הוא טענה שיש בה מספרים, והמספרים הם המגבלות הציבוריות של הדרג.
כדאי להפריד את זה מהסוג האחר של סיפור טרום־השקה של Anthropic, מפני ש־2026 ייצרה את שניהם והם לא דומים כלל זה לזה. מזהי הגישה המוקדמת של אוגוסט, claude-marshmallow-eap ו־claude-melon-eap, היו מחרוזות שהתקיימו בבקשות — מכוערות, לא זוהרות, וניתנות לבדיקה. הסיפור של Opus 5.2 שנמשך לאורך ספטמבר הוא דוח ניתוב: מפתחים ששמים לב שה־backend שמאחורי התווית "Opus 5" השיב אחרת, ומתארים את ההתנהגות. שניהם ארטפקטים. ״כבר נבדק בחשאי״ בלי שום ארטפקט מצורף הוא תמצית של מה שדרגת Sonnet כבר מוכרת.
קיים גם דפוס שראוי לציין במקור עצמו. אותו חשבון פרסם ב-20 בספטמבר סקירה שנפתחה עם ארבעה מודלים שלטענתו "כבר נצפו עבורם בדיקות" — Claude Sonnet 5.2, Claude Opus 5.2, Claude Fable 5.2 ו-Gemini 4 Pro. מבין ארבעת השמות האלה, לרשומות Opus ו-Fable יש מאחוריהן דיווחים נפרדים ומגובים, ולרשומת Gemini יש תצפיות משלה. לרשומת Sonnet היה מקום ברשימה. ארבעה ימים לאחר מכן, הטענה לגבי Sonnet צמחה לדף מפרט, ודף המפרט הוא המודל שכבר קיים.
ארבעת המספרים הם המספרים של Claude Sonnet 5
זה החלק שלוקח שלושים שניות לבדוק וכמעט אף אחד לא עשה זאת. עמוד סקירת המודלים של Anthropic, כפי שנקרא היום, מפרט את Claude Sonnet 5 עם חלון הקשר של 1M טוקנים, פלט מקסימלי של 128K ו-$2 / $10 למיליון טוקנים. השוו את ההדלפה מול זה:
• חלון הקשר — 1M טוקנים נטענו עבור Claude Sonnet 5.5; 1M טוקנים פורסמו עבור Claude Sonnet 5
• פלט מקסימלי — 128K טוקנים הוצהרו; 128K טוקנים פורסמו
• מחיר קלט — $2 למיליון כנטען; $2 למיליון כמפורסם
• מחיר פלט — $10 למיליון שנטען; $10 למיליון שפורסם
• מזהה מודל — לא פורסם דבר עבור Claude Sonnet 5.5; claude-sonnet-5 עבור Claude Sonnet 5
• ציונים בלתי־תלויים — אין כאלה עבור המודל הנטען; Artificial Analysis ממקמת את Claude Sonnet 5 במדד Intelligence Index של 38 בדירוג 54 מתוך 210 המודלים שהיא מודדת, בתצורת חשיבה אדפטיבית במאמץ מרבי

יש שכבה שנייה לנקודת התמחור שההדלפה מציגה הפוך. כשהמודל Claude Sonnet 5 הושק, המחיר $2 / $10 הוכרז כתמחור היכרות בתוקף עד 31 באוגוסט 2026, עם עלייה מתוכננת ל-$3 / $15 ב-1 בספטמבר. העלייה הזו לא קרתה. בעמוד התמחור של Anthropic מופיעה כעת הערת שוליים שלפיה $2 / $10 "הם כעת המחיר הסטנדרטי" ושההעלאה שתוכננה בעבר ל-$3 / $15 למיליון טוקני קלט/פלט ב-1 בספטמבר 2026 לא תתרחש. כך שהמחיר שההדלפה מציגה כנשק התחרותי של המודל החדש הוא התעריף הקבוע של המודל הקיים — מה שאומר ש-Sonnet 5.5 שיושק ב-$2 / $10 יושק ללא שום הנחה, אל תוך שכבה שכבר מתומחרת מול GPT-6 Sol.
הדבר האחד שאנתרופיק למעשה אמרה
סננו החוצה כל מה שמקורו במדליפים אנונימיים — ונותר משפט אחד בלבד, מצד ראשון. כאשר Anthropic השיקה את Claude Opus 5.5 ב-22 בספטמבר 2026, היא מסרה כי Claude Sonnet 5.5 ו-Claude Haiku 5.5 יגיעו אחריה "בשבועות הקרובים", ויביאו עימם שיפורים דומים בביצועים, ביעילות ובבטיחות. המשפט הזה הוא כל הרשומה המאושרת. אין בו מזהה דגם, אין בו חלון הקשר, אין בו מחיר, אין בו בנצ'מרק ואין בו תאריך — ובמיוחד, אין בו דבר על בדיקה חשאית, על מסלול אפור או על בדיקות מכל סוג שהוא.
שאר המשטח הציבורי של Anthropic תואם את הפרשנות הזו. סקירת המודלים עדיין מפרטת ארבעה מודלים — Claude Fable 5.1, Claude Opus 5.5, Claude Sonnet 5 ו-Claude Haiku 4.5 — בלי שורה חמישית, בלי רשומת תמחור ובלי סימן "בקרוב" ליורש של Sonnet. אם צ'קפוינט בדרג Sonnet היה מוגש במקום שמפתח יכול להגיע אליו, המזהה היה הדבר הראשון שיצוף, כי מודל שמוגש חייב להיות בעל שם בבקשה. דבר לא הופיע.
דבר אחד שההכרזה של ספטמבר כן הבהירה: היא סתרה את ההדלפה המוקדמת יותר, שטענה שקו Haiku יופסק ושדור 5.5 יארגן מחדש את מצבת המוצרים. Haiku 5.5 בדרך, לפי Anthropic, מה שאומר שסיפור הארגון מחדש היה שגוי בכיוון שמדליפים נדיר שהם טועים בו — השכבה הזולה נשארת.
ההדלפה מאוגוסט אמרה 2 מיליון טוקנים. זו אומרת 1 מיליון.
שישה שבועות לפני הפוסט מ-24 בספטמבר, ב-9 באוגוסט, חשבון X אחר פרסם דף מפרט של "SONNET 5.5 LEAK" עם טענה נועזת בהרבה: חלון הקשר של 2 מיליון טוקנים, כפול מזה של Sonnet 5, הסקה מהירה יותר, שימוש טוב יותר בכלי דפדפן ומסוף, ביצועים המתקרבים ל-Claude Fable 5, ושחרור "בחודש הבא". ההדלפה ההיא כללה גרפיקה שעוצבה להיראות כמו כרטיס תצוגה מקדימה של Anthropic. היא כללה גם פרט קטלני שמבקריה נאחזו בו מיד: שם הקוד שנתנה, "Fennec", היה שם הקוד שכבר שוחרר עם Claude Sonnet 5 ב-30 ביוני. שם קוד אינו יכול להוות ראיה חדשה ליורש של המודל שהשתמש בו.
אז שני גלי ההדלפות חלוקים לגבי המספר המצוטט ביותר. אוגוסט אמר חלון הקשר של 2M. ספטמבר אומר 1M. לא ייתכן ששניהם מתארים את אותה בנייה. הקריאה הסבירה ביותר היא המשעממת: הפוסט מספטמבר מתאר את המגבלות המפורסמות של דרגת Sonnet, כי כך נראה מודל בדרגת Sonnet מבחוץ, והפוסט מאוגוסט היה ניחוש לגבי מה שסביר שרענון יכפיל. שים לב לאיזה כיוון המספר זז — למטה, לעבר מה שכבר קיים.
אז האם ההשוואה ל-GPT-6 Sol נכונה?
בעיקר, והמקום שבו זה נשבר הוא החלק המעניין. GPT-6 Sol הושק ב-22 בספטמבר 2026, באותו יום שבו יצא Claude Opus 5.5, ומחירו הרשמי מתחיל ב-$2 למיליון טוקני קלט ו-$10 למיליון טוקני פלט — בדיוק התעריף של Sonnet 5 ובדיוק מה שההדלפה טוענת לגבי Sonnet 5.5. הוא מספק חלון הקשר של 1,050,000 טוקנים עם תקרת פלט של 128K, שניהם במרחק זעיר מהמספרים של Claude Sonnet 5. האח הזול יותר, GPT-6 Luna, עומד על $0.10 / $0.50.
נקודת ההכרעה היא הקשר ארוך. GPT-6 Sol מתמחר בשתי מדרגות: $2 / $10 עד 272,000 טוקני קלט, ואז $4 / $15 מעבר לכך. Anthropic לא עושה זאת בקו ה-Sonnet — Claude Sonnet 5 מחייב את חלון ה-1M המלא בתעריפים סטנדרטיים, כך שבקשת 900K טוקנים עולה לאותו מחיר לטוקן כמו בקשת 9K. לכן Sonnet 5.5 אמיתי מול GPT-6 Sol אמיתי הם שוויון מחיר עבור פרומפטים רגילים ופער של פי שניים עבור עומסי העבודה של מסמכים ארוכים ומאגרי קוד גדולים, שעליהם נמכרים שני המודלים. "אותו תמחור" נכון בשורת הכותרת ושגוי בעומסי העבודה שבהם נבחרת המדרגה.
הסתייגות שנייה עומדת בבסיס כל ההשוואה הזו. Claude Sonnet 5 משתמש בטוקנייזר החדש יותר של Anthropic, שמייצר כ-30% יותר טוקנים עבור אותו טקסט לעומת הקודם. תעריף כותרת אינו חשבון; החשבון הוא טוקנים לכל משימה, וזה המספר שאף הדלפה לא נשאה מעולם.
מה יגרום ל-Sonnet 5.5 להיות משמעותי
הניחו בצד אם זה קיים ושאלו מה היה משתנה עבור מי שמשלם עבור טוקנים. ארבעה דברים, ואף אחד מהם אינו דף מפרט.
הראשון הוא מחיר מתחת ל-$2 / $10. לאחר ביטול ההעלאה של ה-1 בספטמבר, התעריף של השחקן הקיים הוא כעת קבוע — לכן ממשיך שמחזיק באותו תעריף הוא מהלך אופקי, והחדשות היחידות ברמת Sonnet שמזיזות כסף הן הורדה.
השני הוא הקשר מעבר ל-1M. זו הייתה ההצעה הממשית של ההדלפה מאוגוסט, וזהו פער היכולות היחיד שההדלפה יכולה לנקוב בו, אשר השחקן המכהן עדיין אינו מכסה.
השלישי הוא אסימונים לכל משימה. החשיבה האדפטיבית של Claude Sonnet 5 פועלת כברירת מחדל, וניתוח בלתי תלוי מדד שהיא מייצרת באופן מהותי יותר אסימוני פלט לכל משימה מאשר קודמו. גרסה שתשמור על התעריף של $2 / $10 ותעצור את האינפלציה הזו תחתוך חשבונות בפועל יותר מהורדת מחיר בכותרות.
הרביעי הוא מזהה. מחרוזת מודל API, שורת תיעוד, רשומת תמחור, כרטיס מודל — כל אחד מאלה מסיים את הוויכוח, והיעדרם של כל הארבעה אחרי הדלפה כה מפורשת הוא בעצמו העובדה החושפנית ביותר בסיפור הזה.
מה שאתה יכול להתקשר אליו היום
Claude Sonnet 5 אינו ממלא מקום בזמן שהדרג מסתדר. זהו המודל שרוב התעבורה של Claude API כבר פועלת עליו, עם חלון של 1M טוקנים, פלט של 128K ותעריף של $2 / $10 שהוא כעת סטנדרטי ולא מבצעי.

זה נמצא ב-OrcaRouter מאז יוני במחיר של Anthropic עצמה, 2$ / 10$, הועבר במחיר המחירון של הספק ללא תוספת, כך ששינוי מחיר של ספק בקו ה-Sonnet יהיה פעיל באותו יום ולא במחזור החיוב הבא. אותו מפתח כבר מגיע ל-GPT-6 Sol ב-2$ / 10$, וזה חשוב יותר מהרגיל בטקסט כמו זה: ההשוואה שההדלפה נשענת עליה היא השוואה שאפשר להריץ בעצמך על הרשאה אחת במקום על שני חוזים.

זו גם הדרך הזולה ביותר לענות על השאלה שההדלפה מעלה. אם Sonnet 5.5 אכן יופיע, הוא יגיע לקטלוג כמו כל דבר אחר, ואתם מנתבים אליו חלק מהתעבורה מאחורי מעבר אוטומטי בעת כשל אל Claude Sonnet 5 — בלי אינטגרציה שנייה, בלי משא ומתן מחדש, ובלי נתיב ייצור שנשען על מודל שאיש לא בחן אותו באופן בלתי תלוי. ניסיון של שכבה לא מוכחת הוא החלטת ניתוב, לא פרויקט הגירה.
מה לצפות במקום פוסט ההדלפה הבא
שלושה אותות, בסדר יורד של כמות המידע שהם יספקו. מזהה הוא מכריע, מפני שלמודל שמוגש חייב להיות שם בבקשה, וכך כל סיפור אנתרופיק לפני־שחרור שניתן לבדיקה ב-2026 הפך לניתן לבדיקה. אישור ספק — כרטיס מודל, שורה בתיעוד, שורת תמחור, או שהמודל פשוט מופיע ברשימה של Anthropic עצמה — מסיים זאת outright; המשפט "בשבועות הקרובים" פירושו שאחד מאלה אכן מגיע. דיווח בודק המתאר התנהגות ולא מפרט הוא החלש מבין השלושה, ועדיין יותר ממה שקיים היום.
עד שאחד מאלה ינחת, הסיכום הכנה הוא ש-Anthropic הבטיחה רענון ל-Sonnet בשבועות הקרובים, ומשקיף אחד תיאר אותו תוך שימוש במספרים של המודל שהוא יחליף. אם הסטאק שלך כבר מריץ claude-sonnet-5, אין על מה לחכות ואין סביב מה לתכנן. אם אתה שוקל את Claude Sonnet 5 מול GPT-6 Sol, המספרים שאפשר לפעול לפיהם הם אלה שכבר פורסמו — ואלה אותם מספרים שההדלפה מנסה למכור לך כחדשות.
השוואות במאמר הזה2
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
