
SSI 的首個模型:關於 2026 年 8 月的說法,我們實際能驗證什麼
- meta新Meta: Muse Spark 1.22026-08-0557智能72程式
- qwen新Qwen: Qwen3.8 Max2026-08-0358智能72程式
- deepseek新DeepSeek: DeepSeek V4 Flash 07312026-07-3152智能69程式
- minimax新MiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百萬 tokens · 2235 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463智能78程式
- googleGoogle: Gemini 3.6 Flash2026-07-2152智能69程式
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137智能49程式
- metaMeta: Muse Spark 1.12026-07-1653智能71程式
- kimiMoonshotAI: Kimi K32026-07-1560智能76程式
- openaiOpenAI: GPT-5.6 Luna2026-07-0952智能71程式
- openaiOpenAI: GPT-5.6 Terra2026-07-0957智能77程式
- openaiOpenAI: GPT-5.6 Sol2026-07-0961智能77程式
- grokxAI: Grok 4.52026-07-0856智能72程式
- tencentTencent: Hy32026-07-0642智能59程式
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232智能42程式
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226智能39程式
- anthropicAnthropic: Claude Sonnet 52026-06-3055智能72程式
- klingKling: Kling 3.0 Turbo2026-06-1757智能52程式57數學
「SSI表示他們會在八月推出他們的模型。」這十一個字,是一位對沖基金投資者在一個以GPU需求為主的Podcast上隨口說出的話,卻是所有宣稱Ilya Sutskever的Safe Superintelligence即將推出首個模型的新聞標題的全部根據。沒有官方公告、沒有模型卡、沒有名稱、沒有基準測試、沒有定價、也沒有端點。這值得我們停下來想一想,因為這與一般前沿模型的發表方式完全相反:當GPT-5.6 Sol或Claude Opus 5推出時,有系統卡、每百萬個token的定價,以及當天下午就能呼叫的API。而在這裡,有的只是一份逐字稿中的一句話。
因此,本文並非發布報導,而是一次證據審核:公開記錄上有哪些內容、誰說了什麼、SSI 自家管道截至 2026 年 8 月 5 日顯示了什麼,以及故事中哪些部分屬於推斷而非事實。所有未經證實的內容均標記為未經證實,包括我們認為可能正確的部分。
這個說法實際上來自何處
消息來源是 Atreides Management 的創始合夥人暨首席投資官 Gavin Baker,他在 Patrick O'Shaughnessy 的Invest Like the Best節目中發言,該集於2026年8月初發布。Baker 並不是在爆料 SSI 的消息。他是在論證半導體產業的經濟邏輯:如果持續性、樣本高效的學習獲得了突破——模型以約十兆個 token 完成訓練,然後在現實世界中持續學習,而無需完整的重新訓練——那麼晶片需求的經濟格局將徹底逆轉:訓練支出將崩跌至邊際水準,推論與持續更新則會主導一切。關於 SSI 的那句話,只是這個論證中的一個輔助性補充。
從那裡的推論鏈很短,卻值得詳細說明,因為它解釋了為何這個故事給人的感覺比其證據更為龐大:
• 主要聲明 — 一句轉錄自 Baker 的句子,歸因於 SSI(「SSI 表示…」),但沒有指名 SSI 的消息來源,沒有八月內的日期,也沒有描述「他們的模型」是什麼。
• 首次報導 — 行業媒體正確地將其呈現為 Baker 的說法,而非公司的官方聲明。
• 放大效應 — 擁有大量 AI 追隨者的 X 帳號將其轉發為「SSI 將於八月推出其首個 LLM」,這悄悄地把二手閒談升級為時間表,並加入了 Baker 未曾說過的「LLM」一詞。
• 聚合 — 一波引用 X 貼文而非逐字稿的清單文章和電子報。
這條鏈中沒有任何一環是不誠實的,但請注意每一步跳轉時認識論地位(epistemic status)的變化。到了第三步,它就成了一個發布日期。Baker 是一位嚴肅、消息來源充足且擁有真正管道的投資人,他不是那種會捏造這種細節的人——請將其視為可信的第二手訊號。可信的第二手消息終究仍未經證實,而截至本文撰寫之時,SSI 對此既未否認也未確認,也沒有任何媒體報導過公司的評論。
SSI自家頻道說了什麼——以及沒說的
這是幾乎沒有報導費心去查證的部分,而且大約九十秒就能查證。SSI 只發布在一個地方:ssi.inc 上的更新頁面。在超過兩年的存在期間,它只有三則貼文。
• 2024年9月4日 — 來自NFDG、a16z、Sequoia、DST Global和SV Angel的10億美元融資。
• 2025年7月3日 — 領導層備忘錄:Daniel Gross 自6月29日起「正式不再是SSI的一員」,Sutskever 正式出任執行長,Daniel Levy 出任總裁,另有一段承認收購傳聞的內容,以及結尾語「我們擁有算力、我們擁有團隊,我們知道該做什麼。」
• 2026年7月26日 — 一句話:「我們已與NVIDIA建立戰略合作夥伴關係,這將使我們的運算能力擴展10倍。」
那就是完整的公開紀錄。沒有模型、沒有產品、沒有研究論文、沒有基準、沒有等待名單。首頁仍然寫著「SSI 是我們的使命、我們的名字,也是我們完整的產品路線圖。」職涯連結仍然指向單一的 Ashby 職缺——Member of Technical Staff(技術人員)——沒有推論、服務、開發者關係、信任與安全,或其他任何實驗室在開放公開 API 前幾週通常會招聘的職位。
把這當作薄弱的證據,而非證明。SSI 是一個約五十人的實驗室,其最鮮明的特點就是不對外透露任何消息;一家從不提前發布的公司,也不會提前發布這件事。實驗室完全可以在沒有產品組織的情況下發布研究成果。但如果你想決定該對「八月」這個時間點賦予多少權重,誠實的答案是:SSI 自身可見的面向顯示出零準備,而那是我們唯一能檢視的面向。

這實際上並不會違背「直達」的承諾。
這個故事的主導敘事是「反轉」:Sutskever 曾發誓在超智能來臨前絕不推出任何產品,所以八月發布模型等於讓步,想必是迫於競爭或投資者壓力。這個敘事是錯的,而糾正它正是讀這篇文章最該帶走的一件事。
是的,在2024年6月創立時,路線是絕對明確的:第一個產品將是安全的超級智能,在那之前公司不會做任何其他事情。但蘇茨克維本人在八個多月前就已公開修正了這一點。在他2025年11月與Dwarkesh Patel的對話中,他表示「即使在直達路線的情境下,你仍然會逐步釋出它」,並公開權衡取捨——不受日常市場競爭影響固然「非常好」,但「最優秀、最強大的AI能存在於世上並影響世界,也具有很大的價值」。他早先的發言也指向同樣的方向:如果通往超級智能的時間表拉長,或者他判斷世界需要看到強大的AI實際運作,產品可能會更早問世。
所以,2026 年的首次發布與已公布的計畫一致,而非背離。這對你如何解讀這則傳聞很重要:你不需要编造 SSI 資金耗盡或向更大實驗室屈服的情節,就能讓八月推出的模型顯得合理。你只需要 Sutskever 早已寫入自己策略中的逐步發布條款。反過來說也一樣——研究系統的「逐步發布」門檻遠低於商業 API,所得到的產品也比頭條標題所暗示的遜色得多。
計算時間安排顯示八月模型不是維拉·魯賓模型
這裡有筆帳,是那些謠言報導所略過的。SSI 於2026年7月26日發布了與 NVIDIA 的合作消息,NVIDIA 則於2026年7月27日發布。NVIDIA 的新聞稿描述了一項投資,加上對其下一代 Vera Rubin 平台的存取權,以將 SSI 的算力提升「一個數量級」;SSI 自己的措辭是10x。報導中的50億美元股權數字,來自熟悉此交易的人士,透過彭博社——兩家公司都沒有確認金額,所以請把這個數字視為據報而非官方數字。關鍵的是,這個10x被描述為會在十二個月內發生緊隨公告發布之後。
因此,一個於2026年8月出現的模型,是在那些資源全部到位之前就已訓練完成的。凡是出貨的產品,都是SSI先前布局的產物——即它在2025年4月取得的雲端TPU容量,以及之後購得的任何GPU容量——而非它剛宣布的那個叢集。這帶來兩個後果,而兩者皆為我們的推斷,而非已報導的事實:
• 對規模的預期應保持適度。這不會是一家動用前沿級訓練預算的實驗室;所有融資輪次的總籌資額約為60–70億美元,包括據報道的NVIDIA投資在內,而競爭對手僅每年在訓練上的花費就是這個數字的數倍。
• 這個時間序看起來像是一次發布前的募資。在首個公開成品問世前三到五週,取得戰略性資金並宣布數量級的算力擴張,是可識別的模式,而這也指向該模型是開端,而非終點。
Sutskever 自己的說法支持了這種較為謙遜的解讀。在同一個播客中,他主張當想法是新的時候,規模並非重點:「如果你在做的是不同的事,你真的需要絕對最大的規模來證明它嗎?我不認為是這樣。」他提到 NVIDIA 的言論——「我們有值得擴展的研究,而能使用大型 NVIDIA 電腦將使我們得以如此」——讀起來像是一個實驗室在小規模下發現了某個東西,現在正在購買運算資源來推進它。八月份推出的某個東西,將是來自小規模階段的證據。

SSI 到底會推出什麼樣的模型?
實驗室以外無人知曉。但猜測的依據異常公開,因為蘇茨克維過去一年來一直在精確描述他認為哪裡出了問題。
他的診斷來自2025年11月的訪談:業界已離開「規模化時代」(約2020–2025年),重新進入「研究時代」,而SSI正是「不折不扣的『研究時代』公司」。他反覆提到的具體失敗是泛化——模型在評測中表現出色,卻在真實世界中舉止脆弱;他形容這種情況著實令人困惑,尤其是考量到這些模型迄今帶來的可衡量經濟影響如此有限。他提出的解法是樣本高效的強化學習與穩健的價值函數,並將它們類比為情緒在人類判斷中所扮演的角色。他估計,要促成能像人類一樣持續學習的系統,需要「5到20年」。
將其與Baker實際討論的背景——持續學習與樣本高效學習——對齊,SSI首個模型可能的形態,是展示一種學習特性,而非爭奪排行榜頂端。一個能從遠少數據中學習、或在部署後持續學習、或在分布外優雅退化的系統,會完全符合使命。而一個按每百萬個token定價、意在編程基準上與GPT-5.6 Sol競爭的聊天助手,則不然。我們將其標記為基於公開陳述的推斷,而非對現有事物的報告。
還有一個後果值得任何即將評估這項事物的人留意。SSI 從未發表過論文、基準測試結果或系統卡。因此,無論出現什麼內容,都不會有任何形式的外部評測歷史:沒有 Artificial Analysis 索引條目、沒有獨立的程式設計或推理評分、沒有第三方紅隊報告、沒有社群重現。{{1}}首次公告中的每一個數字,按定義都將是供應商自行回報的,而這個實驗室本身根本沒有發表過任何數字的紀錄。{{/1}}{{2}}在相信任何內容之前,請做好等待獨立測量的打算,而且如果這次釋出只是有限的研究預覽、而非開放式端點,那麼這項測量可能來得很慢。{{/2}}
能讓此事從傳聞變成新聞的五件事
與其刷新X,不如留意特定的工件。按照它們大致會沉澱的程度依序排列:
• ssi.inc/updates 上的第四則貼文。SSI 自己的頁面是成本最低的確認方式,且該公司迄今為止的每一項重大事件都使用了它。
• 名稱。每個真正的發行版都會有一個名字,而在距離所宣稱的八月發佈窗口如此之近的時候,甚至連一個流傳中的代號都沒有——這本身就說明了很多問題。
• 模型或系統卡,包含任何所述能力與任何安全評估。對於一個以安全與能力並重為全部賣點的實驗室而言,卡片即訊息。
• 存取路徑:一個端點、一個等候名單、一個研究預覽表單,或一個具名合作夥伴。這就是「模型」與「產品」之間的界線,而這則傳聞並未區分兩者。
• 價格。定價是將研究示範轉化為可賴以建構之物的關鍵,也是第一個 SSI 版本中最可能缺少的部分。
如果到八月底這些都還不存在,合理的結論並非貝克說錯了,而是他順帶提到的內容所指的比公開推出更寬鬆——可能只是內部里程碑、向投資者的私下展示,或是每個實驗室都難免發生的時間安排誤差。
這對今天在模型上出貨的人來說,意味著什麼改變
實際上:目前還什麼都沒有,這點值得直言不諱。SSI 的模型並未公開存在,沒有人託管它,我們也沒有託管,而且沒有整合工作可做。任何告訴你如何取得存取權限的文章都只是在猜測。
這個故事真正有用的地方,在於一個現在每隔幾週就會出現的規劃問題:你如何保留使用一個尚無法評估的實驗室的選項?我們在 OrcaRouter 的答案是結構性的,而非取巧。一個 API 金鑰就能觸及 200 多個模型,因此日後採用新的供應商,只是改變模型 ID 而已,而不是簽訂新合約、導入新 SDK 和建立新的計費關係。我們以 0% 加價的方式轉傳供應商列表定價,這意味著當廠商調整價格時——就像某家主要廠商在 7 月 30 日所做的那樣——新數字當天就會在我們這端生效,而不是在重新計算利潤率之後。跨供應商的自動故障轉移,正是讓真實流量可以指向未經驗證模型的原因:如果來自一家五十人實驗室的全新端點不穩定,請求會自動轉往可用的服務,而不是讓你的用戶遭遇失敗。此外,路由 DSL 讓你能將多個模型組合成單一呼叫,因此一個新進模型可以在接管任何路徑之前,先在你的自有流量上與現有模型一較高下。
這也是在等待期間所能做出的誠實比較。你今天實際能呼叫的模型是具體且可衡量的:GPT-5.6 Sol,在我們這邊列出的價格是每百萬輸入 tokens 5.00 美元、每百萬輸出 tokens 30.00 美元,具有 1M-token 的上下文視窗,最多 128K 輸出 tokens,以及在 chat-completions 和 responses 端點上觀測到的 p50 首次 token 延遲為 4.07 秒。這些是建構生產系統所依據的條件。一個來自未發表任何成果的實驗室、既無名稱、也無定價、更無基準測試的模型,無論屆時推出什麼,都不會在八月爭奪那個位置。

真正值得回答的問題
我可以在八月使用SSI的模型嗎?
未知,且可能性低於新聞標題所暗示的。所謂的「推出」是指模型釋出,這與 API、聊天產品或全面開放不同。Sutskever 自己的說法是「逐步釋出」。對於一個以安全為優先、沒有產品組織且只有一個開放工程職位的實驗室而言,有限的研究預覽或論文加示範,至少與公開端點一樣合理。沒有人回報定價、配額或存取機制,因為根本沒有人擁有這些資訊。
關於這件事,我應該多信任 Gavin Baker?
這比匿名說法更有分量,卻又不及公司正式聲明。Baker 經營一檔專注科技的基金,深度涵蓋半導體與 AI 領域,並能與這些實驗室的人員交談;「SSI 表示」的措辭暗示了直接接觸。但這只是他在論證晶片需求時不經意的一句題外話,並非他事先準備或具名取得的報導。他沒有給出日期、姓名或描述,也沒有任何追問。其可信度恰好相當於「一位人脈廣闊的投資者輾轉聽聞並相信此事」——這確實有意義,但這不是一張時間表。
NVIDIA 這筆交易是否意味著 SSI 目前正在訓練一個前沿規模的模型?
最終,或許有可能。但八月不會。10x 明確地是前瞻 2026 年 7 月 26 日之後的十二個月,而在那段期間交付的 Vera Rubin 算力,不可能訓練出一個在公告數週後就發布的模型。這筆交易告訴你的是 SSI 對 2027 年的野心;至於這個月可能推出什麼,它幾乎沒透露任何訊息。
為什麼一家沒有產品的公司會擁有320億美元的估值?
因為投資人押注的是團隊與研究賭注,而非營收。SSI 於2024年9月以50億美元估值募得約10億美元,接著在2025上半年以320億美元估值募得約20億美元——關於該輪融資是在2月、3月還是4月完成,各家報導說法不一,部分報導稱 Greenoaks 為主導投資者,Alphabet 與 NVIDIA 則以戰略投資者身分出現——隨後今年7月據報 NVIDIA 投資了50億美元。從頭到尾:約五十名員工,沒有產品、沒有營收,連一篇發表的論文都沒有。這是關於前沿實驗室估值究竟由什麼構成,所能找到最清楚的例證;也因此,其首個模型將受到比今年任何其他發布都更嚴格的檢視。
看什麼
徵兆不會是洩漏。它會是SSI自己的更新頁面多出第四條,或者某個名字附著名片開始流傳。在這些事發生之前,對當前世界狀態的準確描述是:一位可信的投資者以轉述的方式表示,AI界最神祕的實驗室打算本月展示某個東西;該實驗室尚未證實;其公開足跡看不出任何準備;而且它自己對外宣稱的策略,自2025年11月以來就為這種操作留出了空間。如果真的發布了,首先要看的不是基準測試分數——而是這次發布是產品還是證明,因為SSI的整個論點就在於這兩者是不同的東西。
本文中的比較1
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
