
Kimi K3.1:洩漏所聲稱的——以及實際已確認的
- orca新OrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropic新Anthropic: Claude Opus 52026-07-2461智能78程式
- google新Google: Gemini 3.6 Flash2026-07-2150智能69程式
- google新Google: Gemini 3.5 Flash-Lite2026-07-2137智能49程式
- meta新Meta: Muse Spark 1.12026-07-1651智能71程式
- kimi新MoonshotAI: Kimi K32026-07-1557智能76程式
- openaiOpenAI: GPT-5.6 Luna2026-07-0951智能71程式
- openaiOpenAI: GPT-5.6 Terra2026-07-0955智能77程式
- openaiOpenAI: GPT-5.6 Sol2026-07-0959智能77程式
- grokxAI: Grok 4.52026-07-0854智能72程式
- tencentTencent: Hy32026-07-0641智能59程式
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232智能42程式
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226智能39程式
- anthropicAnthropic: Claude Sonnet 52026-06-3053智能72程式
- klingKling: Kling 3.0 Turbo2026-06-1757智能52程式57數學
- z-aiZ.ai: GLM 5.22026-06-1651智能69程式60數學
- kimiMoonshotAI: Kimi K2.7 Code2026-06-1242智能61程式61數學
- anthropicAnthropic: Claude Fable 52026-06-0960智能77程式
- qwenQwen: Qwen3.7 Plus2026-06-0139智能56程式59數學
- minimaxMiniMax: MiniMax M32026-05-3144智能59程式59數學
提醒:這是洩漏,不是官方公告。截至2026年7月27日,Moonshot AI 尚未正式發布或確認一個"Kimi K3.1." 所有關於K3.1的以下資訊均來自一篇未經證實的社交媒體貼文,在Moonshot發布權重或模型卡之前,應視為謠言。什麼 是得到確認的是Kimi K3——Moonshot於2026年7月16日發布的2.8兆參數開放權重模型。本文將兩者區分開來:洩漏聲稱的K3.1內容,以及我們目前所知的事實。
為什麼現在要寫出來?因為「Kimi K3.1」已經開始被搜尋了,而這個故事的真實版本——清楚標註謠言與事實——比炒作或沉默都更有用。如果Moonshot發佈任何官方消息,我們會更新這篇文章。
簡而言之。2026年7月26日在X平台(@Mr_Salio,標註為「Kimi K3.1 Leak」)的一篇貼文列出了K3.1更新傳聞中的功能集:效能縮小與GPT-5.6及Claude Fable的差距、更快/更低延遲的推論、長推理時更好的標記效率、更可靠的編碼與智能體工作流程、更少的浪費推理步驟、繼續保持對Claude Opus 5在某些編碼/智能體任務上的優勢,以及持續的開權重釋出。這些均未經證實,沒有基準測試數字,也沒有官方發布日期。已確認的基準是Kimi K3:2.8T參數、開權重、上線時前端程式碼競技場排名第一。
關鍵要點
• 此洩漏未經證實。僅有一則X平台貼文,無具體數據、無日期、無Moonshot官方確認。請視為謠言處理。
• K3.1 的傳聞主題是效率,而非新的尺寸。更快的推理、更低的延遲、更好的 token 效率、更少的推理步驟。
• 聲稱的定位:縮小與GPT-5.6 Sol和Claude Fable 5的差距,並在某些編碼/代理任務上保持對 Claude Opus 5 的優勢。
• Open-weight 声称将继续——與 K3 的修改版 MIT 許可一致。
• 今天真實存在的是 Kimi K3(2.8T,開放權重,於2026年7月16日發布),而不是 K3.1。
洩漏的真正內容
該來源是 @Mr_Salio 在 X 上的一則貼文,時間戳記為 2026 年 7 月 26 日,標題明確為「Kimi K3.1 Leak」。它列出一個傳聞中的要點集(經改寫,歸功於該貼文):
• 效能「縮小差距」與 GPT-5.6 和 Fable 之間的表現。
保持其报道中的顶级("Mythos-level")能力——這是帖子的原話;"Mythos"在洩露中未被定義。
• 更快的推理和更低的延遲。
• 在長推理任務上更好的代幣效率。
• 更可靠的編碼和代理工作流程。
• 減少不必要的推理步驟。
• 在關鍵編碼與代理任務上持續超越 Claude Opus 5。
• 保持開放權重,讓前沿級人工智慧可自由存取。
這就是洩漏的全部內容。值得注意的是,其中並未提及任何基準測試分數、參數數量、上下文長度、價格或發布日期。該貼文甚至以對讀者的開放性提問作結(「你認為它會擊敗 mythos 嗎?」),這強烈表明這僅是推測,而非事先溝通的正式公告。

這有多可信?
低至中等,以下是誠實的評價。一方面,傳聞中的方向是合理的:點發行(一個“.1”版本)幾乎總是專注於效率和可靠性——更快的推理、更好的token經濟、更少的浪費推理步驟——而不是全新的架構,而這正是這個列表所描述的。它也符合Moonshot的開放權重策略與K3。
另一方面,沒有什麼可以驗證的:它只是一個接近匿名的帳戶,沒有數字、沒有模型卡的截圖、沒有 Hugging Face 存儲庫,並且在撰寫本文時沒有任何其他地方有佐證報導。像「Mythos-level」這樣未定義的術語使得無法查證。除非 Moonshot 公佈權重、模型卡或基準測試表——或者有信譽良好的媒體佐證——否則這應該被歸類為謠言,而不是路線圖。
已確認的是:Kimi K3
實際出貨的模型是Kimi K3,於2026年7月16日發布——一個擁有2.8兆參數、開源權重的混合專家模型,專為長期編碼、推理和代理工作流而設計,具備原生多模態輸入和100萬token的上下文視窗。在發布時,它在獨立的Frontend Code Arena(報告約1,679 Elo)中躍升至第一名,領先於Claude Fable 5、GPT-5.6 Sol和GLM-5.2,並報告在GPQA Diamond上取得93.5%的成績,在BrowseComp上取得約91.2的成績。Moonshot承諾在修改版MIT許可證下發布完整權重。這些是需要錨定的數字——也是任何「K3.1」將建立的現實基線。
(K3 的資料來源:Moonshot 的發布資料與獨立排行榜,包括 Frontend Code Arena 和 Artificial Analysis;數據為發布時所報告,可能會有所變更。)
如果洩漏屬實,K3.1 意味著什麼?
以善意解讀傳聞清單,K3.1 將會是一個效率與可靠性的版本,而非能力的飛躍:大致為 K3 等級的品質,但每個任務更快、更便宜(更好的 token 效率),且在代理循環中更穩定(更少的浪費推理步驟、更可靠的工具使用)。對於已經運行 K3 的團隊來說,這是最有價值的更新類型——它降低了成本和延遲,而無需重新評估品質。所聲稱的「縮小與 GPT-5.6 和 Fable 的差距」以及「在某些編碼/代理任務上優於 Opus 5」,如果屬實,將使 K3.1 成為編碼代理最強大的開放權重選項。但再說一次——如果屬實。
你應該等它嗎?
不——不要圍繞謠言來建構。如果你今天需要一個頂級開放權重的編碼模型,Kimi K3 已經出貨、開放,並且在 Frontend Code Arena 上獨立排名第一。如果 K3.1 真正帶來效率提升,後續採用它很簡單(同系列、開放權重)。理性的做法是現在使用 K3,如果 K3.1 真的附帶模型卡和數據發佈,到時再重新測試。不要為未經確認的「.1」拖延專案。
今天如何試用Kimi K3
Kimi K3 是開源權重的模型,可透過託管服務提供者取得,包括在 OrcaRouter 上透過與 OpenAI 相容的端點(型號 Kimi K3)使用。供應商中立的團隊將 Kimi K3 與 GPT-5.6 Sol、Claude Fable 5 和 Claude Opus 5 一起路由到一個端點後方,這樣一來,如果 K3.1(或任何新模型)推出,切換只需一行程式碼變更,而非遷移。

這與目前的領導者相比如何
在已確認的情況中:Kimi K3 在推出時於所有模型中領先 Frontend Code Arena,且是迄今最強的開放權重版本,而封閉前沿模型如 Claude Fable 5(SWE-bench Verified 領導者)與 Claude Opus 5(Artificial Analysis Intelligence Index 排名第一)在其他方面仍保持領先。傳聞中能「縮小差距」的 K3.1 將使本就激烈的競爭更加白熱化——但該爆料未提供任何數據來定位它,因此我們不會憑空捏造。

常見問題
Kimi K3.1 發布了嗎?
否。截至2026年7月27日,Moonshot AI尚未正式推出Kimi K3.1。唯一来源是X平台上2026年7月26日一则未经證實的洩漏貼文。
這個洩漏可靠嗎?
把它當作謠言。這只是一則社群貼文,沒有基準數據、沒有模型卡、沒有發布日期,也沒有任何佐證。這個方向(一個專注於效率的點發布)是有可能的,但尚未確認。
如果洩漏屬實,K3.1 會有什麼變化?
传闻:更快的推理速度,更低的延迟,在长推理中更好的标记效率,更可靠的编码/代理工作流程,更少浪费的推理步骤——同时保持开放权重和大致K3级别的质量。
關於Kimi K3已確認了什麼?
K3 是一個真實的、已出貨的 2.8T 參數開放權重模型(2026 年 7 月 16 日),在推出時位居前端程式碼競技場第 1 名,擁有 100 萬 token 的上下文,報告的 GPQA Diamond 為 93.5%,BrowseComp 約為 91.2%。
什麼是「Mythos」?
該洩漏提到了「Mythos-level」的能力,並詢問 K3.1 是否會「beat mythos」,但並未定義該術語。我們無法驗證其所指,因此將其標記出來而非猜測。
我應該等到K3.1再選擇模型嗎?
不。现在使用Kimi K3(或其他当前型号);如果K3.1随官方规格发布,则重新评估。不要围绕传闻制定计划。
在哪裡可以執行Kimi K3?
通過託管提供商以及 OrcaRouter 的 OpenAI 相容 API,搭配其他前沿模型,以便輕鬆比較。
底線
「Kimi K3.1」目前為止只是一則傳聞——一篇7月26日在X上的貼文,描述了效率與可靠性的更新(更快、每項任務更便宜、更穩定的代理、仍是開放權重),但沒有數據、沒有模型卡、也沒有日期。這個說法看似合理但未經證實,因此我們將其視為謠言而非事實報導。已確認的現實是Kimi K3:一個2.8T開放權重模型,推出時在Frontend Code Arena排名第一,你現在就可以使用。如果Moonshot未來推出附帶真實基準測試的K3.1,我們會更新這篇文章——你也可以透過OrcaRouter的一個相容OpenAI的端點,在幾分鐘內進行測試。
