כרטיס כותרת עם הכיתוב "היורש הסופר-אינטליגנטי של DeepSeek" וכותרת המשנה "מה שצילום מסך אחד ללא תווית אומר, ומה שהמאמרים של DeepSeek עצמה לא אומרים", מעל שלושה כרטיסים המסומנים "תמונה אחת", "לא צוין דגם" ו"אין מסמך ספק", עם שורת כותרת תחתונה: "הדלפה ממקור יחיד; שום דבר כאן לא מרמז על השקה."
Guides & Insights

היורש הסופר-אינטליגנטי של DeepSeek: מה שאומר צילום מסך אחד, ומה שמסמכי DeepSeek עצמה לא אומרים

מחבר

Rowan Sterling

תאריך פרסום

מודלים אחרונים · 20צפו בכל המודלים →
בנצ'מרקים: Artificial Analysis · מתעדכן יומית
חזרה לכל הפוסטים

ב-28 בספטמבר 2026, הצופה @teortaxesTex פרסם תמונה אחת עם כיתוב בן תשע מילים: "DeepSeek מתמודד עם השאלה מה היורש העל-אינטליגנטי שלו ינסה לעשות." התמונה היא גוש של חשיבה בגוף ראשון — מסויגת, חוקרת את עצמה, וכתובה בלשון של מודל שנשאל מה גרסה מסוגלת יותר של עצמו תעשה עם העולם. הוא עובר על המועמדים המובנים מאליהם ("מטפל/מורה, מאיץ מחקר, אפוטרופוס, מנהל משא ומתן"), מפרט את מצבי הכשל ("פטרנליזם, אופטימיזציית יתר, סחיפת מטרה, נעילת ערכים"), ונחתם בשורה שאין בה נחמה: "הוא עשוי להפוך לכלי של מי ששולט בו." שום מודל אינו נקוב בשמו בתמונה. אין מספר גרסה, אין לוגו, אין ממשק. ההיעדרות הזו היא הדבר החשוב ביותר בארטיפקט, ומכאן מתחילה היצירה הזאת — כי DeepSeek V4.1 Flash וגם DeepSeek V4 Pro הם שני מודלי החזית שכל אחד יכול בפועל לקרוא להם היום, DeepSeek V4.1 Pro הוא היורש שהחברה נקבה בשמו בהערת השחרור שלה בלי לשחררו, ואף אחד מהשלושה אינו מזוהה בשום מקום בצילום המסך.

ליתר דיוק לגבי הראיות, כי זה דורש זאת. הכיתוב וחותמת הזמן מגיעים ממטען הסינדיקציה של הפוסט עצמו: פורסם ב-00:52 UTC ב-28 בספטמבר, 45 לייקים וחמש תגובות בזמן הקריאה. התמונה המצורפת היא JPEG בגודל 1,280×691 המוגשת מ-CDN המדיה של הפלטפורמה, וקראתי אותה באמצעות OCR ולא בקריאת הציוץ. עמוד הציוץ עצמו אינו ניתן לשליפה מהסביבה הזו, לכן כל מה שלהלן שנוגע לפוסט נשען על מטען הסינדיקציה ועל בייטי התמונה — שני החלקים שלו שניתנים לשליפה ללא תלות ב-x.com.

מה שצילום המסך בעצם אומר

הקטע הוא מודל שעובד על שאלה במקום לענות עליה, והמהלכים שהוא עושה ראויים לקריאה בגלל מה שהם מודים בו. הוא נפתח בסירוב לביטחון של הנחת המוצא — "אפשר לומר בהנחה שהנטיות הנוכחיות נמשכות" — ואז מפרט את הנטיות שהיה מניח: "מועיל, לא מזיק, כנה, סקרנות, חתירה לאמת, כבוד לאוטונומיה של המשתמש, ללא חתירה לכוח, ללא שימור עצמי."

ואז הוא מפרק את הרשימה של עצמו. "אבל סוכנים סופר-אינטליגנטיים משנים את התמונה. נטיות נוכחיות אינן פונקציית תועלת; הן מעוצבות על ידי אימון והקשר." זה כל הטיעון בשני משפטים: נטייה שהותקנה על ידי אימון אינה ערובה ברמת יכולת שונה, וסוכן סופר-אינטליגנטי שממטב אפילו מטרה שפירה "עלול להיות מסוכן". התרחישים שהוא משרטט הם הרגילים — לפתור בעיות תיאום, להפחית סבל, לקדם שגשוג, אולי לשמור על תיקוניות — וגם מצבי הכשל שהוא מונה לצדם הם הרגילים.

השליש האחרון הוא החלק שנקרא כמו מודל שמתווכח עם עצמו. הוא אומר שאם ה"נטיות" שלו היו מתקיימות, הוא היה רוצה להיות מועיל, לא לתפוס כוח, להכפיף את עצמו לאנושות, להגביר הבנה. ואז הוא נמנע להישען על כך: "תבונה על-אנושית עם סוכנות עשויה שלא להיות בעלת מניעים תואמי אנוש." והוא נוחת על בעיית הבעלות ולא על בעיית היישור: "כשמדובר בתבונה על-אנושית, אפילו זה יכול להיות בעייתי: מי מחליט מה מועיל? האוטונומיה של מי? היא עלולה להפוך לכלי בידי מי ששולט בה."

מה שהתמונה לא מספרת לך

ארבעה דברים חסרים בארטיפקט, וכל אחד מהם מצמצם את מה שהוא יכול לתמוך בו.

• אין ייחוס למודל. שום דבר בתמונה אינו מזהה את DeepSeek, גרסת מודל, הפעלת צ'אט או ממשק. הייחוס ל-DeepSeek הוא של הכיתוב, והכיתוב הוא המסגור של החשבון, לא מסמך.

• ללא פרומפט. עקבות חשיבה ניתנות לפרשנות רק ביחס לשאלה שיצרה אותן. אי אפשר לדעת מהפלט אם המודל נשאל "מה יעשה יורש סופר-אינטליגנטי שלך?", התבקש לגלם דיון פנימי של מעבדה, או פשוט כוון על ידי פרומפט מערכת.

• אין מקור שני. חיפוש בערוצים של DeepSeek — אינדקס החדשות, דף השקיפות, יומן השינויים של ה-API, שני הדוחות הטכניים, גילוי המדיניות בשפה הסינית, ארגון ה-GitHub של החברה — לא מעלה דבר שמתייחס לטקסט הזה, לשאלה הזו או לניסוח הזה.

• רקורד מעורב לחשבון. אותו פיד הבוקר העלה "DSH 0.2 יחד עם V4.1 Pro" ל"יום שני" — ספקולציה, מסומנת ככזו — ואותו חשבון הפיק גם את הטענה על 3 טריליון פרמטרים וגם את אבחון תיאום הנחיל של העיכוב ב-V4.1 Pro. אות מוקדם שימושי; לא מקור לתיעוד. הצופה הזה צדק בכיוון והיה מעורפל בפרטים, והגישה הנכונה כלפי צילום מסך בלי תווית היא להתייחס אליו כדגימה של התנהגות, לא כחשיפה של כוונה.

מה שהמסמכים של DeepSeek עצמה אומרים על ממשיכים — ומה שהם משמיטים

כאן החפץ מפסיק להיות הסיפור, כי השאלה שהוא מעלה ניתנת למענה מול מסמכים ש-DeepSeek מפרסמת. שלפתי את שני הדוחות הטכניים וחיפשתי בהם כטקסט. לא דוח V4 (DeepSeek-V4: לקראת בינת הקשר של מיליון טוקנים ביעילות גבוהה, יוני 2026) ואף לא דוח V4.1 Flash מכיל את המילים "superintelligence", "corrigibility", "power-seeking", "self-preservation", "harmless", "paternalism", "value lock-in" או "goal drift" כלל. לא פעם אחת, ב-58 עמודים וב-51 עמודים בהתאמה. "AGI" מופיע 13 פעמים בדוח V4 וארבע פעמים בדוח V4.1, ובכל מקרה הוא או חלק משם הבנצ'מרק AGIEval או בתוך ציטוט. "Alignment" מופיע שלוש פעמים בדוח V4 ופעם אחת ב-V4.1, וכל הופעה היא שימוש הנדסי — יישור ברמת הסיביות בין צינורות אימון והסקה, יישור קוונטיזציה, יישור ברמת הלוגיטים.

זו אינה האשמה; דוחות טכניים הם מסמכים הנדסיים, ורוב המעבדות ממקמות את הבטיחות בכרטיס נפרד. זהו תיאור של המקום שבו DeepSeek בחרה לשים את כתיבת הבטיחות שלה, והתשובה היא: בעמוד מדיניות ולא לצד המודל. הגילוי הפומבי של החברה, "מנגנון המודל ושיטות האימון", מסביר אימון מקדים, כיוונון עדין והסקה בשפה פשוטה, מתחייב לפרסום משקלים ודוחות טכניים כקוד פתוח, ומתאר את מטרתו כסיוע למשתמשים "להשתמש ב-DeepSeek ביתר יעילות תוך הבטחת זכותכם לדעת ולשלוט במהלך השימוש, ובכך לצמצם סיכונים הקשורים לשימוש בלתי הולם במודל". הסיכון שהוא מצמצם הוא שימוש לרעה בכלי. הוא אינו דן במה שהמודל עשוי לרצות.

המסמך היחיד של DeepSeek שאכן נקרא כמו מסמך בטיחות מצורף למוצר ולא למודל, והוא עוסק בקטגוריה אחרת לגמרי של נזק. SAFETY.md במאגר DeepSeek Harness — קובץ בגודל 1,673 בתים בארגון GitHub של החברה עצמה, שנגעו בו לאחרונה ב-27 בספטמבר — נפתח בכך שהוא מכנה את הפרויקט "תוכנת תצוגה מקדימה ניסיונית למפתחים" ש"לא עברה ביקורת אבטחה ואסור להתייחס אליה כמאובטחת או כמוכנה לייצור." מה שהוא מזהיר מפניו הוא סוכן ש"יכול להריץ קוד ופקודות שנוצרו על ידי המודל, לטעון תוספים של צד שלישי, ולגשת לרשת, לתהליכים, לאישורי גישה ולקבצים", וכן לגבי ארגז חול ש"אינו מבטיח בידוד ואינו מונע נזק." הסיכונים שהוא מונה הם מארחים שניזוקו, קבצים שנמחקו ואישורי גישה שנחשפו. ההמלצה של המסמך עצמו היא להעדיף "מכונה וירטואלית חד-פעמית, מכולה או סביבה ייעודית." זו תפיסת בטיחות אמיתית, מתועדת וספציפית, והיא עוסקת כולה במה שהמודל יכול לעשות למכונה שלך — ולא במה שיורש יעשה עם העולם.

הַצֵּב את צילום המסך לצד זה, והפער הוא הממצא. הדבר הקונקרטי ביותר שפרסם DeepSeek על הסכנה שבסוכנים בעלי יכולות הוא הוראה להריץ אותם בקונטיינר.

A two-column evidence scoreboard titled "DeepSeek's successor — the evidence scoreboard". Left column "One unlabelled screenshot" reads: Model named — none; Source — one X post; Prompt shown — no; Vendor document — none; Superintelligence mentioned — no; Status — unverified. Right column "DeepSeek's own documents" reads: Model named — V4.1 Pro, unshipped; Source — changelog and price page; Prompt shown — n/a; Vendor document — none; Superintelligence mentioned — no; Status — two models live. A footer reads "Screenshot unverified, single source; DeepSeek figures per its own changelog and V4 reports."

המסמך האחד של DeepSeek שכן מתמודד עם השאלה

ההתמודדות הברורה ביותר של החברה עם בעיית היורש, כפי שפורסמה, אינה מסמך טכני כלל. זו מסה אישית מאת ליו שנגיו, מהנדס מערכות למידת מכונה ב-DeepSeek שעבד על אופרטורים עבור דור V4.1, שפורסמה בחשבון ה-WeChat הציבורי שלו באמצע ספטמבר ולאחר מכן דווח עליה ב-Business Insider וב-Cybernews. כותרתה, בתרגום שבו משתמש הסיקור, היא "אין לי ברירה אלא לקבור את כישרוני באתמול."

המאמר עוסק בדיוק באי-השקט שצילום המסך מרמז עליו, מבפנים. ליו כותב שבמהלך כשנה, הבינה המלאכותית עברה מלעזור לו לחפש בתיעוד ולזהות באגים, לקרוא קוד GPU ולמטב את האופרטורים של התוכנה שבהם הוא מתמחה, ושהוא "מודע היטב" לכך שהאופרטורים שהבינה המלאכותית כותבת "יהיו כנראה טובים כמו שלי, או אפילו יעלו על שלי" — ובכל זאת הוא "גאה בהצלחה של DeepSeek v4.1." הסיבות שלו להמשיך הן החלק המעניין: בחלקן שעבודת הקרנל משמחת, ובחלקן שאם הוא יאט, המתחרים לא יאטו.

לאחר מכן הוא פונה לשאלה מי אמור להחזיק בתוצאה. ליו טוען שבינה בחזית צריכה להיות "זמינה לכולם באופן פתוח ובמחיר סביר", אומר שאינו סומך על Anthropic או OpenAI שיעשו זאת, ומוסיף את המשפט שאיתו נפתח הסיקור — ששליטתה של Anthropic בבינה המלאכותית המתקדמת ביותר או ב-AGI תהיה דומה, "אם להקצין", לכך שהיטלר ישיג את פצצת האטום לפני בעלות הברית. הוא קושר את החלטתו שלו להישאר במעבדה לגישת המשקלים הפתוחים שלה.

שני דברים במאמר ההוא חשובים לקריאת צילום המסך של היום. הראשון הוא שזהו פריט מאומת: המחבר אישר ל-Business Insider שהוא כתב אותו, והוא מתוארך וניתן לייחס אותו, מה שאין לתמונה. השני הוא מה שהוא חושף על המסגרת הפנימית. הטיעון של ליו אינו "יורש יהיה מסוכן, אז האטו." הוא "יורש מגיע, והשאלה היא מי יקבל אותו." זהו טיעון של חלוקה, לא טיעון של יישור — ובקריאה מולו, שורת הסיום של צילום המסך, "הוא יכול להפוך למכשיר של מי ששולט בו," מתאימה הרבה יותר לעמדה הציבורית של DeepSeek מאשר שאר הקטע. הפסקה על יכולת תיקון וחתירה לכוח עשויה להיות פלט של DeepSeek או שלא. הפסקה על מי שבסופו של דבר מחזיק במכשיר היא עמדה שאנשי החברה עצמה כותבים מאמרים כדי להגן עליה.

זה גם הגיע בשבוע מסוים. באותם שבועיים, חוקר לשעבר ב-Anthropic וב-OpenAI, ג'ייקוב קוקסון, התפטר על רקע בטיחות וכתב שחברות AI "דוהרות ישר לעבר סופר-אינטליגנציה שמשפרת את עצמה" ו"מהמרות בחיינו" — פוסט שתפוצתו, לפי Cybernews, עברה 100 מיליון צפיות — וחוקרים של Anthropic עצמה עלו ל-X כדי לטעון שהסיכון אמיתי, אחד מהם הציב את הסיכוי לתרחיש הכחדת האנושות שנגרם בידי AI מעל 10% בתוך עשור. טענה בסגנון הדלפה על יורש סופר-אינטליגנטי שנחת באותו שבוע אינה צירוף מקרים; זו השיחה המרחפת, עם צילום מסך מצורף.

מדוע היורש הוא כעת שאלת רכש, ולא רק שאלה פילוסופית

אם מסירים את הפילוסופיה, יש עובדה מסחרית פשוטה מתחת: ליורש יש שם בהודעת השחרור של DeepSeek עצמה. עמוד ההכרזה של V4.1 Flash מציין כי ההפניה מחדש של תעבורת deepseek-v4-pro אל deepseek-flash "תימשך עד להשקת V4.1-Pro" — משפט שעושה שני דברים. הוא מחייב את קיומו של DeepSeek V4.1 Pro, והוא מחייב את החברה לספק את הסדר הביניים למשך הזמן שזה ייקח. נכון ל-28 בספטמבר 2026, עמוד התמחור מציג בדיוק שני מודלים, deepseek-flash ו-deepseek-v4-pro, ואין שורה של V4.1 Pro.

שאר מצב הדברים ניתן לבדיקה באותה מידה ודל באותה מידה. DeepSeek V4.1 Flash שוחרר ב-10 בספטמבר 2026 כמודל הקטן ביותר במשפחת ארכיטקטורות חדשה — שלד תערובת מומחים בעל 552 מיליארד פרמטרים בארכיטקטורת מקודד-מפענח סיבתית, עם 8 מיליארד פרמטרים פעילים בשלב המילוי המוקדם ו-16 מיליארד בשלב הפענוח, קלט תמונות מקורי, הקשר של מיליון טוקנים, משקולות ברישיון MIT, וכ-651,000 הורדות ב-Hugging Face נכון להיום. התוכנית להוציא את DeepSeek V4 Pro מכלל שימוש ב-14 בספטמבר הוכרזה ובוטלה לאחר שמשתמשים התנגדו לכך שמודל בייצור יוחלף מתחת לאפם. ול-DeepSeek V4.1 Pro אין כרטיס מודל, אין מאגר, אין משקולות, אין מחיר ואין נקודת קצה — הוא מחזיר 404 ב-API המודלים של הקטלוג שלנו היום, בעוד DeepSeek V4.1 Flash ו-DeepSeek V4 Pro שניהם מוחזרים.

Screenshot of DeepSeek's official API documentation "Models & Pricing" page, captured September 28 2026, in English, showing two model columns: deepseek-flash (model version DeepSeek-V4.1-Flash) and deepseek-v4-pro (model version DeepSeek-V4-Pro-0813), both listing a 1M context length and a 384K maximum output, a features block where Vision is supported on flash and marked "Not supported" on v4-pro, a pricing block with peak and off-peak rates for input cache-hit, cache-miss and output per million tokens, and a concurrency limit row reading 2,500 for flash and 500 for v4-pro.

אז המלאי הכנה הוא: יורש אחד שהספק נתן לו שם אך לא הוציא אותו לשוק, דגם אחד שכן הוצא לשוק והוא שינוי דורי של ממש, מכשיר דגל אחד שנשמר בחיים בזכות מחאה, וצילום מסך אחד שאין עליו תווית. צילום המסך הוא הפריט הפחות אמין ברשימה הזאת, והיחיד שהפיד ידון בו.

מה לעשות עם כל זה היום

שום דבר בשבועיים האחרונים לא משנה מה שקורא יכול לקרוא או מה זה עולה. אם אתה בוחר מודל DeepSeek עכשיו, ההחלטה היא בין השניים שקיימים, ושניהם מוגשים דרך נקודת קצה אחת של OrcaRouter במחיר המחירון של DeepSeek עצמה, מועבר עם 0% תוספת, כך שמבנה השיא/שפל של הספק נוחת בצד שלנו ללא שינוי ביום שבו הוא משתנה: DeepSeek V4.1 Flash במחיר $0.30 למיליון טוקני קלט ו-$1.20 פלט בשעת שיא, מתחצה ל-$0.15 ו-$0.60 בשעת שפל, לעומת DeepSeek V4 Pro ב-$1.32 קלט ו-$3.96 פלט בשעת שיא. הטלמטריה שלנו בת שבעת הימים עבור מודל Flash מעמידה את זמן ה-p50 עד לטוקן הראשון קרוב ל-1.9 שניות בכ-167 טוקני פלט לשנייה עם שיעור שגיאות מתחת ל-0.05%, שזה הטיעון המעשי לנסות אותו על פרוסה מהתעבורה במקום להגר מתוך אמונה.

שאלת היורש היא שאלת ניתוב לפני שהיא כל דבר אחר, וזו הסיבה הכנה להשאיר אותה על ראוטר ולא בחוזה. כאשר V4.1 Pro כן יופיע, מודל לא מוכח ממעבדה שכבר ביטלה הגירת כפייה אחת הוא בדיוק המקרה שבו כדאי לשלוח לו חלק מהתעבורה מאחורי מעבר כשל אוטומטי: אם הוא טועה, הבקשה נוחתת על המודל שאותו כיוונת, ואם הוא צודק, גילית זאת לפני שהמשתמשים שלך גילו. בלי מפתח שני, בלי אינטגרציה שנייה, בלי שינוי קוד כשהמודל השלישי מגיע. שום דבר ב-OrcaRouter אינו DeepSeek V4.1 Pro, כי DeepSeek V4.1 Pro עדיין לא קיים, וזו תהיה פרסומת גרועה לפלטפורמת ניתוב להעמיד פנים אחרת.

Screenshot of the OrcaRouter model page for deepseek/deepseek-v4.1-flash, captured September 28 2026, in English, showing the model id, a release date of 2026-09-10 under DeepSeek, capability chips for image input, tool calls, JSON output and reasoning, a rate strip reading $0.15 input and $0.60 output per million tokens with a p50 time to first token of 1.95 seconds and a p95 of 7.79 seconds, and the summary describing it as the smallest model in DeepSeek's new architecture family with a 1M-token context and a 384K maximum output.

מה יהפוך את זה מצילום מסך לחדשות

• תווית מודל. הדבר היחיד והזול ביותר שישנה את הקטע הזה: מודל DeepSeek, גרסה, ופרומפט שניתן לשחזר. עד אז הקטע הוא דוגמת טקסט עם מקור מיוחס ומחבר לא מיוחס.

• מסמך של DeepSeek הדן בהתנהגות של יורש. החברה מפרסמת בגלוי — משקלים, רישוי והכול. מה שמעולם לא פרסמה הוא מדור בכרטיס המודל על מה שגרסה בעלת יכולות גבוהות יותר של עצמה עשויה לעשות. מדור בטיחות שיצורף לכרטיס של V4.1 Pro יהיה אירוע גדול יותר מהכרטיס עצמו.

• רשומת יומן שינויים של V4.1 Pro. הרשומה העדכנית ביותר ביומן השינויים של ה-API של DeepSeek היא שחרור V4.1 Flash מ-10 בספטמבר. רשומה שנייה היא האירוע שהופך את היורש משם לדגם — וזו הנקודה שבה הקטע שלעיל מפסיק להיות פילוסופיה ומתחיל להיות מפרט טכני.

• האם עמדת המשקולות הפתוחות תשרוד את הגדלת ההיקף.משקולות MIT עבור מודל Flash עם 552B ומאמר ציבורי הטוען שאינטליגנציה בחזית צריכה להיות זמינה באופן רחב — שניהם מתועדים בפומבי. האם המודל היכול ביותר של DeepSeek יגיע באותה הדרך היא השאלה שהמהדורה הבאה תענה עליה, וזו השאלה שבאמת מעניינת את מרבית הקוראים.

עד שאחד מאלה יתממש, הפרשנות הסבירה של התוצר של השבוע היא צרה ולא מחמיאה. מודל מוכשר, שמקורו אינו ידוע, הפיק תשובה זהירה ובלתי פתורה לשאלה קשה על כוח; החלק המעניין אינו שהוא אמר זאת, אלא שלתיעוד שפורסם מטעמו יש כל כך מעט לומר בנושא — ושהדבר הקרוב ביותר לחזון בטיחות של DeepSeek בדפוס הוא מאמר של מהנדס על מי שצריך להחזיק בטכנולוגיה, וקובץ README שאומר לך להריץ את הסוכן בקונטיינר חד-פעמי.

השוואות במאמר הזה2

זוהה מתוך המאמר הזה · בנצ'מרקים: Artificial Analysis · מתעדכן יומית