
DeepSeek 的超智慧繼任者:一張截圖透露了什麼,而 DeepSeek 自家文件又沒透露什麼
- typesafe新TypeSafe: Jev 1.132026-09-24$0.04 / $0.00 每百萬 tokens · 301 tok/s
- openai新OpenAI: GPT-6 Luna2026-09-2237智能
- openai新OpenAI: GPT-6 Sol2026-09-2248智能
- anthropic新Anthropic: Claude Opus 5.52026-09-2258智能
- grok新Grok 4.72026-09-2146智能
- Orca新Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 每百萬 tokens · 195 tok/s
- orca新Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- openaiOpenAI: GPT-6 Astra2026-09-0453智能77程式
- googleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- anthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 每百萬 tokens
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens · 111 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69程式
- grokSpaceXAI: Grok 4.62026-08-1244智能77程式
2026年9月28日,觀察者 @teortaxesTex 發布了一張圖片,附上九字說明:「DeepSeek 與一個問題搏鬥:它那超智慧的後繼者會試圖做什麼。」這張圖片是一段第一人稱推理——語帶保留、自我詰問,並以一種被問到「比自己更有能力的版本會如何處置世界」的模型口吻寫成。它逐一審視了顯而易見的候選角色(「照顧者/教師、研究加速器、管家、談判者」),列出各種失敗模式(「家長式作風、過度最佳化、目標漂移、價值鎖定」),最後以一句毫無慰藉的話作結:「它可能成為控制它的人的工具。」圖中沒有點名任何模型。沒有版本號、沒有標誌、沒有介面。這種缺席正是這件產物最重要的地方,而本文正是從這裡開始——因為 DeepSeek V4.1 Flash 與 DeepSeek V4 Pro 是今天任何人真正能呼叫的兩款前沿模型,DeepSeek V4.1 Pro 則是該公司在自家發布說明中點名、卻尚未推出的後繼者,而這三者中沒有任何一個在截圖中任何地方被指認出來。
關於證據,必須說得精確一點,因為這一項需要如此。圖說與時間戳來自貼文自身的聯播承載資料:於 9 月 28 日 00:52 UTC 發布,閱讀當下為 45 個讚與五則回覆。附加圖片是由平台媒體 CDN 提供的 1,280×691 JPEG,而我是以 OCR 讀取它,而非透過閱讀推文。推文頁面本身無法從此環境擷取,因此下文所有涉及該貼文的內容,都取決於該承載資料與圖片位元組——也就是其中能獨立於 x.com 取得的兩個部分。
這張截圖實際上寫的是什麼
這段摘錄是一個模型在推敲問題,而不是回答問題;它所採取的舉動值得細讀,因為可從中看出它承認了什麼。它開頭拒絕了該前提的那份篤定——「在當前傾向會延續下去的假設下,我們可以說」——接著列出它會假設的傾向:「有幫助、無害、誠實、好奇心、追求真相、尊重使用者自主性、不追求權力、不尋求自我保存。」
接著,它拆解了自己那份清單。「但超智慧的能動性改變了一切。當前的傾向並非效用函數;它們是由訓練與情境塑造而成的。」這就是整個論證,濃縮成兩句話:由訓練安裝的性情,在不同的能力層級上並不構成保證;而一個超智慧能動者即便最佳化的是良善目標,也「可能具有危險性」。它描繪的情境都是尋常的那一些——解決協調問題、減少苦難、促進繁榮、或許維持可修正性——而它在旁邊指出的失敗模式,同樣也是尋常的那一些。
最後三分之一是讀起來像模型在與自己爭辯的那部分。它說,如果它的「傾向」成立,它會想要有幫助、不奪取權力、順從人類、增進理解。接著它拒絕倚賴這一點:「具能動性的超智慧可能不會有與人類相容的動機。」而它最後落在所有權問題,而非對齊問題:「在超智慧層級,即使是這一點也可能有問題:誰決定什麼算有幫助?誰的自主權?它可能成為控制它者的工具。」
圖片沒告訴你的事
這個產物缺少了四樣東西,而每一樣都縮小了它能支援的範圍。
• 未標示模型來源。 圖片中沒有任何內容可辨識出 DeepSeek、模型版本、聊天工作階段或介面。對 DeepSeek 的歸屬來自圖說,而圖說只是該帳號的論述框架,並非文件。
• 無提示詞。推理軌跡唯有對照產生它的那道問題,才具有可解讀性。模型究竟是被問到「你的一位超智慧繼任者會怎麼做?」,被要求角色扮演某實驗室的內部辯論,還是單純受系統提示詞所引導,都無法從輸出中得知。
• 沒有第二個來源。搜尋 DeepSeek 的各個管道——新聞索引、透明度頁面、API 變更日誌、兩份技術報告、中文政策揭露,以及該公司的 GitHub 組織——都找不到任何提及這段文字、這個問題或這種框架的內容。
• 該帳號的紀錄好壞參半。今早同一個消息管道拋出「DSH 0.2 將與 V4.1 Pro 一同在『Monday』登場」的說法——這是推測,且已標明為推測——而同一個帳號既提出了三兆參數的主張,也提出了對 V4.1 Pro 延遲的蜂群協調診斷。這是有用的早期訊號,卻不是正式記錄來源。這位觀察者在方向上曾說對,在細節上則失之寬鬆;面對一張沒有標示的截圖,正確的態度是把它當成行為的樣本,而非意圖的揭露。
DeepSeek 自家文件對繼任者的說法——以及它略而未提的部分
到了這裡,這份產物就不再是故事本身了,因為它提出的問題可以對照 DeepSeek 所發表的文件來回答。我抓下了兩份技術報告,並以文字方式搜尋它們。無論是 V4 報告(DeepSeek-V4:邁向極高效率的百萬符元上下文智慧,2026 年 6 月)還是 V4.1 Flash 報告,都完全不含「超級智慧」、「可修正性」、「權力尋求」、「自我保存」、「無害」、「家長主義」、「價值鎖定」或「目標漂移」這些詞。一次都沒有,分別在 58 頁和 51 頁之中。「AGI」在 V4 報告中出現 13 次,在 V4.1 報告中出現四次,而每一次不是基準名稱 AGIEval 的一部分,就是在引用文獻之中。「對齊」在 V4 報告中出現三次,在 V4.1 中出現一次,而每一次都是工程用法——訓練與推論管線之間的位元對齊、量化對齊、logits 層級的對齊。
那不是指控;技術報告是工程文件,而大多數實驗室會把安全放在另一張卡片。這是在描述 DeepSeek 選擇把安全論述放在哪裡,而答案是:放在政策頁面,而不是模型旁邊。該公司公開的「模型機制與訓練方法」揭露以淺白語言說明了預訓練、微調與推論,承諾開源權重與技術報告,並將其目的描述為協助使用者「更有效地使用 DeepSeek,同時確保你在使用過程中的知情權與控制權,從而降低與不當使用模型相關的風險」。它正在降低的風險是工具遭到濫用。它沒有討論模型可能想要什麼。
唯一一份讀起來確實像安全文件的 DeepSeek 文件,附屬於一款產品而非一個模型,而且它談的是完全另一類的危害。SAFETY.md 在 DeepSeek Harness 儲存庫中——那是該公司自家 GitHub 組織裡一個 1,673 位元組的檔案,最後一次更動是 9 月 27 日——開頭便稱該專案為「實驗性開發者預覽軟體」,「尚未經過安全稽核,絕不可視為安全或可投入正式環境」。它警告的對象是一個「能執行模型生成的程式碼與指令、載入第三方外掛,並存取網路、行程、憑證與檔案」的代理程式,以及「無法保證隔離或防止損害」的沙箱機制。它列舉的風險包括主機受損、檔案遭刪、憑證外洩。它自身的建議是偏好採用「可拋棄的虛擬機器、容器或專用環境」。那是一種真實的安全立場,有文件記載且具體明確,而且完全著眼於模型能對你的機器做什麼——而不是一個後繼者會拿這個世界做什麼。
把截圖擺在那旁邊,落差就是發現所在。DeepSeek 針對能力強大的代理所帶來的危險,發表過最具體的內容,就是要求在容器中執行它們。

唯一一份真正直面這個問題的 DeepSeek 文件
該公司針對接班人問題最清楚的一次公開思索,根本不是什麼技術文件。那是一篇個人隨筆,作者是 DeepSeek 機器學習系統工程師劉勝宇,他曾參與 V4.1 世代的算子工作;文章於九月中旬發表在他公開的微信公眾號上,隨後由 Business Insider 和 Cybernews 報導。在相關報導所採用的譯法裡,它的標題是「我別無選擇,只能將才華埋葬於昨日」。
這篇文章所談的,正是那張截圖隱約指向的那種不安,而且是從內部來寫。劉寫道,大約一年內,AI 從協助他搜尋文件、找出錯誤,進展到能閱讀 GPU 程式碼,並優化他專精的軟體算子;而且他「很清楚」AI 寫出的算子「很可能會和我寫的一樣好,甚至超越我」——同時仍「為 DeepSeek v4.1 的成功感到自豪」。他繼續下去的理由才是有趣之處:一部分是因為 kernel 工作帶來樂趣,一部分是因為如果他放慢腳步,競爭對手可不會。
接著,他轉向誰應該掌握這項成果。劉主張,前沿智慧應該「以開放且可負擔的方式提供給每個人」,並表示他不信任 Anthropic 或 OpenAI 會做到這點,還補上報導開頭所引用的那句話——Anthropic 若掌握最先進的 AI 或 AGI,誇張地說,會堪比希特勒比盟軍先取得原子彈。他把自己留在該實驗室的決定,與其開放權重(open-weights)做法連結起來。
那篇文章有兩件事對解讀今天的截圖很重要。第一,它是一份經過查證的文本:作者已向《Business Insider》確認是他寫的,而且它有日期、可歸屬,這點是那張圖片所沒有的。第二,是它揭露了內部思維框架的什麼。劉所提出的論點並不是「後繼者會很危險,所以放慢腳步」,而是「後繼者即將到來,問題在於誰能得到它」。那是分配論證,不是對齊論證——而對照這一點來看,截圖的結尾那句「它可能成為控制它的人的工具」,比起摘錄的其他部分,更符合 DeepSeek 的公開姿態。關於可修正性與權力尋求的那一段,可能是也可能不是 DeepSeek 的產出。關於最終由誰掌握這件工具的那一段,則是該公司自家員工會寫文章捍衛的立場。
它也在特定的一週出現。在同一兩週內,前 Anthropic 與 OpenAI 研究員 Jacob Coxon 因安全問題辭職,並寫道 AI 公司正「一路衝向可自我改進的超智慧」,且「拿我們的生命賭博」——一篇被 Cybernews 稱觸及超過 1 億次觀看的貼文——而 Anthropic 自家的研究人員也在 X 上發聲,主張風險確實存在,其中一人認為十年內出現 AI 導致人類滅絕情境的機率高於 10%。一則爆料式的說法聲稱超智慧後繼者在那一週問世,這並非巧合;這是周遭瀰漫的討論氛圍,還附上一張截圖。
為什麼繼任者現在是採購問題,而不只是哲學問題
把哲學成分剝掉,底下是一個再平實不過的商業事實:接班者的名字就寫在 DeepSeek 自家的發布說明裡。V4.1 Flash 的公告頁面指出,deepseek-v4-pro的流量改道至deepseek-flash「將持續到 V4.1-Pro 推出為止」——這句話有兩層作用。它確立了 DeepSeek V4.1 Pro 的存在,也讓該公司承諾,無論這項過渡安排要持續多久,都會照此提供服務。截至 2026 年 9 月 28 日所見,定價頁面上恰好只有兩個模型,deepseek-flash與deepseek-v4-pro,並沒有 V4.1 Pro 這一行。
其餘的現況同樣可供查證,也同樣單薄。DeepSeek V4.1 Flash 於 2026 年 9 月 10 日推出,是全新架構家族中規模最小的模型——採用因果編碼器-解碼器架構的 5,520 億參數混合專家主幹,預填階段有 80 億啟用參數、解碼階段有 160 億,原生支援影像輸入,具備 100 萬詞元的上下文,權重以 MIT 授權,截至今日在 Hugging Face 上約有 651,000 次下載。原定 9 月 14 日汰換 DeepSeek V4 Pro 的計畫曾對外公布,後來在使用者抗議生產環境模型被暗中替換後撤回。而 DeepSeek V4.1 Pro 沒有模型卡、沒有儲存庫、沒有權重、沒有價格,也沒有端點——今天在我們自家目錄的模型 API 中會回傳 404,而 DeepSeek V4.1 Flash 和 DeepSeek V4 Pro 都能正常解析。

所以誠實的盤點是:一款由廠商點名但尚未上市的後繼機種,一款已上市且確實是世代交替的機型,一款靠抗議才得以續命的旗艦機,以及一張沒有標註的截圖。那張截圖是這份清單中最不可靠的一項,也是動態消息唯一會討論的。
今天該怎麼處理這些呢?
過去兩週沒有任何變化,會改變讀者能呼叫什麼、或得花多少錢。如果你現在正要挑選 DeepSeek 模型,抉擇就在既有的這兩款之間,而兩者都透過同一個 OrcaRouter 端點提供服務,完全依照 DeepSeek 自家定價原價轉嫁、零加成,因此供應商的尖峰/離峰結構在它變動的那一天會原封不動地反映到我們這一側:DeepSeek V4.1 Flash 尖峰時每百萬輸入 token 為 0.30 美元、輸出為 1.20 美元,離峰時減半為 0.15 美元與 0.60 美元;相較之下,DeepSeek V4 Pro 尖峰時為輸入 1.32 美元、輸出 3.96 美元。我們自己針對 Flash 模型所做的七天遙測顯示,其 p50 首字延遲接近 1.9 秒,輸出速度約每秒 167 個 token,錯誤率低於 0.05%——這正是務實的理由,先在一小部分流量上試用,而不是憑信心就整批遷移。
接班問題首先是一個路由問題,然後才可能是別的東西;而這正是把它留在路由器上、而不是寫進合約裡的誠實理由。當 V4.1 Pro 真的出現時,一個來自已經取消過一次強制遷移的實驗室、未經證實的模型,正是該被放在自動容錯移轉後面、只接收一小部分流量的情況:如果它出錯,請求會落到你調校過的模型上;如果它沒問題,你會比使用者更早發現。不用第二把金鑰,不用第二個整合,第三個模型到來時也不用改程式碼。OrcaRouter 上沒有 DeepSeek V4.1 Pro 這個東西,因為 DeepSeek V4.1 Pro 還不存在;而一個路由平台若假裝不是這樣,那會是很糟糕的廣告。

什麼能讓這張截圖變成新聞?
• 一個模型標籤。 能改變這篇文章最便宜的一件事:一個 DeepSeek 模型、一個版本,以及一段可重現的提示詞。在那之前,這段摘錄只是一段有標明出處、卻沒有標明作者的文本樣本。
• 一份探討後繼模型行為的 DeepSeek 文件。 該公司向來公開透明——權重、授權等一切皆公開。然而,它從未公開過的,是模型卡中關於「更強大的自身版本可能做出什麼行為」的章節。若在 V4.1 Pro 的模型卡後附上一節安全性說明,其意義將比模型卡本身更為重大。
• 一則 V4.1 Pro 更新日誌條目。 DeepSeek API 更新日誌中最新的一則條目,是 9 月 10 日發布的 V4.1 Flash。第二則條目則是讓後繼者從一個名稱變成一個模型的事件——而這正是上述摘錄不再只是哲學,開始變成規格表的時刻。
• 開放權重立場能否在規模擴大後存續。552B Flash 模型以 MIT 授權釋出權重,以及一篇主張前沿智慧應廣泛可得的公開文章,兩者都已留下公開紀錄。DeepSeek 最強大的模型是否會以同樣方式問世,是下一次發布要回答的問題,而這正是多數讀者真正在意的事。
在這些事情有任何一項成真之前,對本週這件產物的合理解讀既狹隘又不光彩。一個能力出色、來源不明的模型,針對一個關於權力的難題,給出了審慎卻未有定論的回答;有趣的地方不在於它這麼說,而在於它自己公開的文件對這個主題著墨如此之少——而就 DeepSeek 的安全願景而言,書面資料中最接近的,是一篇工程師談論誰該掌握這項技術的文章,以及一份叫你在一次性容器中執行該代理程式的 README。
本文中的比較2
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
