
הדלפת ה-"Kettle" של Claude Fable 5: מזהה המודל הפנימי החבוי ב-Signed Thinking — מה שאנחנו יודעים עד כה
- z-aiחדשZ.ai: GLM 5.32026-08-1860אינטליגנציה75כתיבת קוד
- obsidianחדשQwen3.8 27B Uncensored (Aggressive)2026-08-1552אינטליגנציה68כתיבת קוד
- qwenחדשQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekחדשDeepSeek: DeepSeek V4 Pro 08132026-08-1253אינטליגנציה69כתיבת קוד
- grokחדשSpaceXAI: Grok 4.62026-08-1261אינטליגנציה77כתיבת קוד
- metaMeta: Muse Spark 1.22026-08-0557אינטליגנציה72כתיבת קוד
- qwenQwen: Qwen3.8 Max2026-08-0358אינטליגנציה72כתיבת קוד
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152אינטליגנציה69כתיבת קוד
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 לכל 1M טוקנים
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463אינטליגנציה78כתיבת קוד
- googleGoogle: Gemini 3.6 Flash2026-07-2152אינטליגנציה69כתיבת קוד
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137אינטליגנציה49כתיבת קוד
- metaMeta: Muse Spark 1.12026-07-1653אינטליגנציה71כתיבת קוד
- kimiMoonshotAI: Kimi K32026-07-1560אינטליגנציה76כתיבת קוד
- openaiOpenAI: GPT-5.6 Luna2026-07-0952אינטליגנציה71כתיבת קוד
- openaiOpenAI: GPT-5.6 Terra2026-07-0957אינטליגנציה77כתיבת קוד
- openaiOpenAI: GPT-5.6 Sol2026-07-0961אינטליגנציה77כתיבת קוד
- grokxAI: Grok 4.52026-07-0856אינטליגנציה72כתיבת קוד
ב-16 באוגוסט בשעה 23:29:45 לפי שעון PDT, חוקר ב-X פרסם טענה שהפכה פינה לא זוהרת ב-API של Anthropic לסיפור „מה שידוע עד כה": פענחו את ה'חתימה' החתומה בשרת שנישאת על כל בלוק חשיבה של קלוד, אמר, והעלו שישה שמות, וביניהם המודל שענה לכם בפועל. לפי קריאתם, תגובות שכותרתן הפומבית claude-fable-5 — קלוד פייבל 5 ממחלקת Mythos ש-Anthropic שחררה לשוק בהרחבה מאז 9 ביוני 2026, במחיר של 10/50 דולר למיליון טוקנים — החלו לשאת מזהה פנימי שאינו מופיע באף תיעוד פומבי של Anthropic: claude-kettle-e2c95a10-v2-prod. שום דבר בכותרת התגובה לא השתנה. כמו כן, לא הוכח ששום דבר השתנה בחיוב, בשדה המודל ברמה העליונה של ה-API, או בהבטחת ה-pinned-snapshot של Anthropic. מה שהשתנה היה מחרוזת שקועה בשדה שהתיעוד מורה למפתחים במפורש לא לנתח.
זהו דוח דליפה, לא פסק דין. הממצא בן ארבעה ימים, הוא נשען על פענוח של חוקר יחיד שלא שוכפל באופן בלתי תלוי, ו-Anthropic לא הגיבה על מה ש"Kettle" — או התווית הנלווית MYCRO_MODEL_MANATEE — מתייחס אליו. השאלה השימושית אינה "האם Anthropic החליפה את Fable 5?" הראיות אינן מבססות זאת. השאלה השימושית היא מה משמעותו של מזהה מודל פנימי המופיע תחת מזהה מודל ציבורי, אם היה אמיתי, ומה לא. הנה מה שאנו יודעים עד כה.
מה שההדלפה מצאה בפועל
האות הוא פוסט X יחיד מ-@chetaslua (סטטוס 2089783170896179632, פורסם ב-16 באוגוסט 2026), הכתוב בסגנון הרגיל של החשבון, "ראשון עם הוכחה". הטענה, בקיצור:
• קוביות החשיבה של Claude נושאות פרוטובאף חתום על ידי השרת בשדה החתימה.
• שדה שישי של אותו protobuf, אומר החוקר, מכיל את המזהה של המודל שבפועל הפיק את התגובה.
• החל מהשעה 23:29:45 לפי שעון PDT ב-16 באוגוסט, 2,582 מתוך 2,582 חתימות שנדגמו נשאו את אותו ערך: claude-kettle-e2c95a10-v2-prod.
• תווית פנימית שנייה, MYCRO_MODEL_MANATEE, הופיעה גם היא באותם מטא-נתונים.
הנתון "2,582 מתוך 2,582" עושה את העבודה הרטורית: הוא הראיה של החוקר לכך שלא מדובר במקרה חד־פעמי או בפרוסת A/B, אלא במעבר מוחלט של כל מה שהמזהה מצביע עליו. מה שהפוסט אינו כולל הוא השיטה שמאחורי הפענוח — אין חתימות גולמיות, אין סקריפט פענוח, אין סכמת protobuf משוערת, אין מטא־דאטה מלא של התגובה. הראיה הציבורית היא גרפיקה מסכמת. זה הופך את הממצא לסביר ובלתי־ניתן לאימות באותו נשימה.

מדוע לחתימה יש בכלל "שדה שש"?
כל בלוק חשיבה ש-Claude מחזיר נושא שדה חתימה. לפי תיעוד החשיבה של Anthropic, החתימה הזו היא "עותק מוצפן של ההנמקה המלאה" שאתה אמור להעביר בחזרה ללא שינוי בשיחות מרובות-סיבובים ובשיחות עם שימוש בכלים, וה-API משתמש בה "כדי לוודא שבלוקי החשיבה נוצרו על ידי Claude." ב-Claude Fable 5 ההתנהגות ברירת המחדל הופכת את החתימה לעקבות הגלויים היחידים: עם display מוגדר ל"omitted" — ברירת המחדל ב-Fable 5, Mythos 5, Opus 5 ו-Sonnet 5 — בלוק החשיבה חוזר עם שדה חשיבה ריק ורק החתימה מאוכלסת.
התיעוד מוסיף לאחר מכן משפט שחשוב לכל דליפה המבוססת על שדה זה: "שדה החתימה הוא אטום: אל תפרש אותו ואל תנתח אותו." הניתוח שלו הוא בדיוק מה שטענת Kettle עושה. זו אינה הוכחה שהטענה שגויה — החתימה חייבת להיות קריאה-מכונה עבור תשתית השרתים של Anthropic עצמה — אבל זה אומר שהפענוח בוצע בניגוד להוראה המפורשת של הספק, בפרוטוקול לא מתועד, ושחזורו של החוקר את אותו פרוטוקול לא פורסם. כל מסקנה הנבנית על "שדה שישי פירושו מודל המשרת" יורשת את חוסר הוודאות הזה.
מה שזה לא מוכיח
נתחיל ממה שהראיות הן בפועל: תגובה שסומנה בפומבי כ-claude-fable-5 נשאה מזהה פנימי שלא דווח קודם לכן. זה כל הסיפור. המזהה בלבד אינו מוכיח שאנתרופיק החליפה את המשקלים של Fable 5, שקיים יורש בעל יכולות גבוהות יותר, שהתגובות השתפרו או החמירו, או שכל בקשה נותבה למודל קטן יותר. "Kettle" יכול להיות שם פריסת שרת פנימי עבור אותה תמונת Fable 5 בדיוק; זה יכול להיות שמו של רכיב נתב; זה יכול להיות מסווג במחסנית הבטיחות. שם הקוד אינו יכול להבחין בין האפשרויות הללו.
מדיניות ניהול הגרסאות של Anthropic עצמה מסבירה מדוע הדליפה מתיישבת עם כך ששום דבר לא השתנה. מתוך המסמכים של "Model IDs and versioning", שתי הצהרות מופיעות זו לצד זו:
Anthropic אינה מעדכנת את המשקלים או את התצורה של מזהה מודל קיים. כאשר גרסה מעודכנת זמינה, היא מופצת תחת מזהה מודל חדש.
משקלי המודל קבועים עבור מזהה נתון, אך תשתית ההגשה סביב המודל יכולה להשתנות לאורך זמן. תשתית זו כוללת רכיבים כגון נתב הבקשות, מסווגי הבטיחות ולוגיקת הדגימה.

המשפט השני הזה הוא הפער הרעיוני כולו בין "Kettle היא שערורייה" ל-"Kettle הוא יום שני שגרתי." המסמכים אפילו צופים סחיפה התנהגותית: "מדי פעם, עדכוני תשתית מייצרים הבדלים קלים בהתנהגות הנצפית גם כאשר מזהה המודל והמשקולות לא השתנו." נתב או פריסת שירות חדשים בשם Kettle היו מתאימים בדיוק בתוך המשפט הזה. כדי שהדליפה תהיה ממש מפלילה, היא תצטרך להראות או מודל חדש מאחורי המזהה בניגוד למדיניות, או מנגנון שהפר את כללי הנראות שלהלן.
ניתוב הגיבוי המתועד שכבר יש ל-Fable 5
Claude Fable 5 כבר מגיע עם מנגנון החלפת מודל שהוא אמיתי, מתועד, ונועד להיות גלוי. מסווגי בטיחות בוחנים בקשות ויכולים לנתב תת-קבוצה — Anthropic מצטטת סייבר התקפי, ביולוגיה דו-שימושית, זיקוק מודלים, וחלק מעבודות פיתוח שבבים מתקדמים — למודל Claude Opus 5. בממשקים לצרכן, מודל הגיבוי אמור להיות בולט: הודעה, שם המודל המשרת בתשובה, ובורר המודל שעובר ל-Opus. בממשק ה-API, התגובה חושפת את המודל המשרת דרך שדה המודל ברמה העליונה ובלוק תוכן ייעודי לגיבוי.
הטענה של Kettle מתארת משהו שונה, וההבדל הוא החלק שהיה משנה: מזהה פנימי המופיע מתחת לתגובה ששמרה על התווית הציבורית Fable 5. הפוסט של החוקר אינו מראה הודעת fallback, שדה מודל API שהשתנה, או בלוק fallback — אילו היה מראה, הסיפור היה "ה-fallback המתועד הופעל", לא "Anthropic מנתבת בשקט." ללא זה, ההדלפה לא הראתה שהבטחת נראות כלשהי הופרה, כי היא לא הראתה מה זה Kettle.
למה זה חשוב גם אם שום דבר לא השתנה
מזהי מודל מקובעים הם מנגנון אמון. התיעוד של Anthropic מבטיח ש"כשאתה משתמש במזהה מודל בבקשת API, המודל הבסיסי נשאר קבוע לאורך חייו של אותו מזהה" — זו כל הסיבה לכך שצוות יכול לבצע בדיקות ביצועים מול claude-fable-5 ולצפות שהתוצאה תמשיך להיות משמעותית ברבעון הבא. מזהה חבוי שיושב מתחת לאותו מזהה, יהיה אשר יהיה, הוא תזכורת לכך שההתחייבות מכסה את המשקלים והתצורה, ולא את כל הנתיב מהבקשה ועד הטוקן. אם אי פעם מודל שונה באמת רץ תחת מזהה ציבורי ללא גילוי, כל הערכה, כל תחזית עלות, וכל בדיקת רגרסיית איכות שמקשרת למזהה הזה תהיה פסולה בשקט.
זווית החיוב מחדדת את זה. Claude Fable 5 עולה $10 למיליון טוקנים בקלט ו-$50 למיליון טוקנים בפלט — התעריף הגבוה ביותר שפרסמה Anthropic. אם המודל המוגש אי פעם היה שונה מהמזהה שחויב, השאלה היא איזה תעריף חל ומי מחליט. ההדלפה אינה מציעה ראיה שזה קרה; הנקודה היא רק ששדה החתימה הוא המקום שבו תחפש קודם כל סימן לכך.
התזמון ראוי לציון גם כן. זהו האות השלישי של Anthropic בתשעה ימים: ב-7 באוגוסט הודיעה החברה כי הכשירה מחדש את המסווג הביולוגי של Fable 5, מה שצמצם בכ-85% את מקרי הגיבוי הקשורים לביולוגיה בבדיקות פנימיות; ב-14 באוגוסט הכיר דוח הסיכונים של מדיניות הסקיילינג האחראית (Responsible Scaling Policy Risk Report) ב"Model 2" פנימי שלא שוחרר, ש-Anthropic מכנה "שיפור ניכר" לעומת Claude Mythos 5, ושהיא אינה מתכננת לשחרר. שתי ההצהרות הן מטעם הספק, אבל יחד הן מראות ש-Anthropic משנה באופן פעיל את המערכות סביב Claude Fable 5 — מסווגים ב-7, יורש פנימי מוכר ב-14 — תוך שמירה על מזהה claude-fable-5 ללא שינוי. Kettle תהיה באותה מתכונת של סיפור, אך ללא החשיפה.
מה לעשות בנוגע לזה
למתקשרי API, העמדה המעשית היא משעממת ונכונה: מזהה אחד אינו ראיה להחלפה, ואין בהדלפה שום דבר שאפשר לפעול עליו עדיין. מה שאתם יכולים לעשות הוא לייצר ראיה משלכם. תעדו את שדה המודל ברמה העליונה ואת כל בלוקי ה-fallback בתגובות שאתם באמת מקבלים, ועקבו אחר הפרשים בטוקנים ובעלויות על עומס עבודה קבוע. אם fallback מתועד מופעל, הוא יהיה גלוי בדיוק במקומות האלה. זה המבחן היחיד שחשוב לעומס העבודה שלכם, והוא אינו תלוי בכך שמישהו יפענח את פורמט החתימה של Anthropic.
כאשר אתה מנתב ל-Claude Fable 5 דרך OrcaRouter, צורת התגובה שחוזרת היא אותה צורה ש-Anthropic מחזיר, ובגלל שאנחנו מעבירים את מחירי הרשימה של הספק ללא כל תוספת, אין סט שני של מחירים שצריך ליישב — אם Anthropic אי פעם תשנה את התעריף של Fable 5, המספר החדש חי בצד שלנו באותו היום. למצב לא מאומת כמו זה, הדרך בסיכון נמוך להמשיך להשתמש במודל בלי להמר מסלול ייצור על שמועה היא לנתב נתח של תעבורה אמיתית ל-Claude Fable 5 עם מעבר אוטומטי לגיבוי מוכח — Claude Opus 5 ב-$5/$25 למיליון, או מודל זול יותר ברמת קוד — כך שנסיגת איכות הופכת להחלטת ניתוב, לא לאירוע. אותו מפתח, אין חוזה שני, והמעבר הוא שינוי ב-routing-DSL במקום שכתוב מחדש.

מה אנחנו צופים
• האם Anthropic מגיב. הפתרון הנקי ביותר הוא הכרה בשורה אחת במה הם Kettle ו-Manatee. השתיקה עצמה אינפורמטיבית.
• שכפול עצמאי. אם מישהו יפרסם את החתימות הגולמיות, את שיטת הפענוח ואת סכמת הפרוטובוף המוסקת, זה יהפוך מגרפיקה של אדם אחד לטענה הניתנת לבדיקה. עד אז זהו "מה שידוע עד כה", ולא ממצא.
• משטח הראות. אם תגובות claude-fable-5 יתחילו להציג הודעות גיבוי, שדה מודל API שונה, או בלוקי גיבוי, הקריאה "גיבוי מתועד" מתחזקת; אם לא, הקריאה "מסלול לא מתועד" היא זו שמתחזקת.
• מזהה מודל חדש. מדיניות הגרסאות של Anthropic אומרת שגרסה חדשה באמת מופצת תחת מזהה חדש. האישור הנקי ביותר לכך ש-Kettle הוא יורש אמיתי יהיה אפוא ש-Anthropic תשחרר משהו — לא ניתוב במקום. חפשו את claude-fable-5.1 או דומה.
• האם "Manatee" יוסבר. התווית השנייה היא חוט שאף אחד עדיין לא משך בו.
שאלות נפוצות
האם Anthropic באמת מנתבת את Claude Fable 5 למודל אחר?
לא הוכח. ההדלפה מראה שתגובות שסומנו כ-claude-fable-5 נשאו מזהה פנימי, claude-kettle-e2c95a10-v2-prod, בחתימת חשיבה חתומה. היא אינה מראה שהמשקלים שונו, שהושק יורש, או שבוצעה הורדת דרגה לבקשה כלשהי. "Kettle" יכול באותה מידה להיות שמו של מערך שרתים פנימי המשרת את אותה תמונת Fable 5.
איך נמצא מזהה Kettle?
החוקר @chetaslua אומר כי פענח protobuf בתוך שדה החתימה של בלוקי החשיבה של Claude וקרא את מזהה המודל משדה שישי. המסמכים של Anthropic מכנים את החתימה "אטומה" ואומרים למפתחים לא לנתח אותה, ושיטת הפענוח של החוקר לא פורסמה, ולכן הטענה עדיין אינה ניתנת לשחזור עצמאי.
האם זה מפר את ההתחייבות למודל המקובע של Anthropic?
לא ידוע. תיעוד הגירסות של Anthropic אומר שהם אף פעם לא מעדכנים את המשקלים או התצורה של מזהה מודל קיים, ושגרסאות חדשות מושקות תחת מזהה חדש — אבל הם מאפשרים במפורש לשנות את תשתית ההגשה סביב המודל (נתב הבקשות, מסווגי הבטיחות, לוגיקת הדגימה). מזהה Kettle יכול להיות בדיוק שינוי כזה, שלא יפר את ההבטחה.
איך אוכל לדעת אם המודל שמשרת אותי השתנה?
צפה בשדה המודל ברמה העליונה בתגובות ה-API, חפש בלוקי תוכן חלופיים, ועקוב אחר השינויים באסימונים ובעלויות על עומס עבודה קבוע. מנגנוני ה-fallback המתועדים של Anthropic אמורים להיות נראים במקומות אלה. אין שדה API ציבורי שחושף את המזהה של Kettle.
הקריאה הכנה היא שדליפה נתנה שם למשהו, לא הוכיחה מה הוא. מזהה Kettle אמיתי במובן היחיד שבו מחרוזת דולפת יכולה להיות אמיתית: חוקר אומר שהוא שם, 2,582 מתוך 2,582 פעמים, החל בליל ה-16 באוגוסט. למה הוא מצביע — מודל חדש, פריסה ששמה שונה, רכיב נתב, מסווג — נותר בלתי מאומת, והתיעוד של Anthropic עצמה מציע הסבר שגרתי לחלוטין לכל העניין. זה הערך של הכתבה וגם גבולה. עד שתתפרסם חתימה גולמית או ש-Anthropic תגיד מה זה Kettle, הגישה הנכונה היא להתייחס לזה כאל „מה שאנחנו יודעים עד כה": שווה לעקוב, שווה לתעד את התעבורה שלך, ולא שווה לשנות בגללו את בחירת המודל — במיוחד כששכבת ניתוב מאפשרת לך להשאיר את האפשרות פתוחה בכל מקרה.
השוואות במאמר הזה1
זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית
