
Kimi K3.1:泄密内容声称的——以及实际已确认的
- orca新OrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropic新Anthropic: Claude Opus 52026-07-2461智能78代码
- google新Google: Gemini 3.6 Flash2026-07-2150智能69代码
- google新Google: Gemini 3.5 Flash-Lite2026-07-2137智能49代码
- meta新Meta: Muse Spark 1.12026-07-1651智能71代码
- kimi新MoonshotAI: Kimi K32026-07-1557智能76代码
- openaiOpenAI: GPT-5.6 Luna2026-07-0951智能71代码
- openaiOpenAI: GPT-5.6 Terra2026-07-0955智能77代码
- openaiOpenAI: GPT-5.6 Sol2026-07-0959智能77代码
- grokxAI: Grok 4.52026-07-0854智能72代码
- tencentTencent: Hy32026-07-0641智能59代码
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232智能42代码
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226智能39代码
- anthropicAnthropic: Claude Sonnet 52026-06-3053智能72代码
- klingKling: Kling 3.0 Turbo2026-06-1757智能52代码57数学
- z-aiZ.ai: GLM 5.22026-06-1651智能69代码60数学
- kimiMoonshotAI: Kimi K2.7 Code2026-06-1242智能61代码61数学
- anthropicAnthropic: Claude Fable 52026-06-0960智能77代码
- qwenQwen: Qwen3.7 Plus2026-06-0139智能56代码59数学
- minimaxMiniMax: MiniMax M32026-05-3144智能59代码59数学
提醒:这是泄露,不是官方公告。截至2026年7月27日,Moonshot AI尚未未正式发布或确认一款"Kimi K3.1。"以下关于K3.1的所有信息均来自一条未经证实的社交媒体帖子,在Moonshot发布权重或模型卡之前,应视为谣言。已确认的是Kimi K3——即Moonshot于2026年7月16日发布的具有2.8万亿参数的开源权重模型。本文将对两者加以区分:泄露中关于K3.1的说法,以及我们今天实际所知的内容。
为什么现在写出来?因为“Kimi K3.1”已经被搜索,而这个故事的真实版本——清楚标注传闻与事实——比炒作或沉默更有用。如果月之暗面发布任何官方信息,我们会更新这篇文章。
摘要。2026年7月26日,X上的一篇帖子(@Mr_Salio,标题为"Kimi K3.1 Leak")列出了K3.1更新的传闻功能集:性能缩小与GPT-5.6和Claude Fable的差距,更快/更低延迟的推理,更好的长推理令牌效率,更可靠的编码和智能体工作流,更少的浪费推理步骤,相对于克劳德的持续优势 Opus 5在某些编码/智能体任务上,以及持续的开源权重发布。这些均未得到确认,没有基准测试数据,也没有官方发布日期。已确认的基准是Kimi K3:2.8T参数,开源权重,发布时在Frontend Code Arena排名第一。
关键要点
• 该泄露未经证实。单一X帖子,无数据,无日期,无Moonshot确认。视为谣言。
• K3.1 传闻的主题是效率,而非新尺寸。更快的推理、更低的延迟、更好的 token 效率、更少的推理步骤。
• 声称的定位:缩小与GPT-5.6 Sol和Claude Fable 5的差距,并在某些编码/代理任务上保持对Claude Opus 5的优势。
• 开放权重声称将继续 — 与K3的修改版MIT许可证一致。
• 今天真正存在的是Kimi K3(2.8T,开放权重,2026年7月16日发布),而不是K3.1。
泄漏的实际内容是什么
该消息来自 @Mr_Salio 在 X 平台上的一个帖子,发布时间为 2026 年 7 月 26 日,标题明确为“Kimi K3.1 泄露”。帖子中列举了一组传闻中的要点(转述自该帖子):
• 与GPT-5.6和Fable“缩小差距”的性能
• 保持其声称的顶级("Mythos-level")能力——帖子中的措辞;泄露中未定义"Mythos"。
• 更快的推理速度和更低的延迟。
• 在长推理任务上更好的词元效率。
• 更可靠的编码和智能体工作流。
• 更少不必要的推理步骤。
• 在关键编码和智能体任务上持续优于 Claude Opus 5。
• 保持开放权重,使前沿AI免费可访问。
这就是这次泄露的全部内容。值得注意的是,其中缺少任何基准测试分数、参数规模、上下文长度、价格或发布日期。帖子最后甚至向读者抛出了一个开放式问题(“你认为它会击败 Mythos 吗?”),这强烈表明这只是猜测,而非正式发布的公告。

它有多可信?
低到中等,以下是诚实的解读。一方面,传闻的方向是合理的:点版本(即“.1”版本)几乎总是专注于效率和可靠性——更快的推理、更好的token经济、更少的浪费推理步骤——而不是全新的架构,而这正是此列表所描述的。这也符合Moonshot的开放权重策略与K3。
另一方面,没有什么可验证的:它只是一个近乎匿名的账号,没有数字,没有模型卡的截图,没有Hugging Face仓库,并且在撰写本文时也没有任何其他地方的证实报道。像“神话级别”这样的未定义术语使得无法核实。除非Moonshot公布权重、模型卡或基准表——或者有信誉的媒体证实——否则这应被视为谣言,而非路线图。
已经确认的是:Kimi K3
真实发布并交付的模型是Kimi K3,于2026年7月16日发布——这是一个2.8万亿参数的开源权重混合专家模型,专为长时程编码、推理和智能体工作流而设计,原生支持多模态输入,拥有100万token的上下文窗口。上线后立即在独立的Frontend Code Arena排行榜上跃居第一(Elo约1,679),超越了Claude Fable 5、GPT-5.6 Sol和GLM-5.2,并在GPQA Diamond上取得了93.5%的成绩,在BrowseComp上取得了约91.2的成绩。月之暗面承诺以修改版MIT许可发布完整权重。这些是值得锚定的数字——也是任何“K3.1”模型将要构建的现实基线。
(K3的来源:Moonshot的发布材料以及包括Frontend Code Arena和Artificial Analysis在内的独立排行榜;数据为发布时报告的数字,可能会发生变化。)
如果泄密消息属实,那么K3.1意味着什么?
善意地解读传闻列表,K3.1将是一个效率和可靠性的发布版本,而非能力跃升:大致K3级别的质量,但更快、每任务更便宜(更好的令牌效率),并且在智能体循环中更稳定(更少的浪费推理步骤,更可靠的工具使用)。对于已经在运行K3的团队来说,这是最有价值的更新——它降低了成本和延迟,而无需重新评估质量。据称"缩小了与GPT-5.6和Fable的差距"以及"在某些编码/智能体任务上优于Opus 5",如果属实,将使K3.1成为编码智能体最强的开放权重选项。但再次强调——如果属实。
你应该等它吗?
不——不要围绕一个谣言来构建方案。如果你今天需要一个顶级的开源权重编码模型,Kimi K3 已发布、开源,并且独立在 Frontend Code Arena 排名第一。如果 K3.1 确实带来了实际的效率提升,后续迁移非常容易(同一系列、开放权重)。理性的做法是现在就用 K3,等 K3.1 真正发布并附带模型卡和具体数据时再重新测试。不要因为一个未经确认的“.1.”而延迟项目。
今天如何试用Kimi K3
Kimi K3 为开放权重模型,可通过托管服务商获取,包括在 OrcaRouter(模型 Kimi K3)上通过兼容 OpenAI 的端点使用。供应商中立团队将 Kimi K3 与 GPT-5.6 Sol、Claude Fable 5 及 Claude Opus 5 路由至同一端点后端,这样一旦 K3.1(或任何新模型)发布,切换仅需更改一行代码,而无需进行迁移。

这与当前领导者相比如何
在已确认的图片中:Kimi K3 在发布时于前端代码竞技场(Frontend Code Arena)中领先所有模型,是迄今为止最强的开源权重发布,而封闭前沿模型如 Claude Fable 5(SWE-bench Verified 榜首)和 Claude Opus 5(人工智能分析智能指数排名第一)在其他维度上仍保持领先。传闻中一款“缩小差距”的 K3.1 将会让本就激烈的竞争更加白热化——但泄露信息未提供任何数据来定位它,因此我们不会凭空捏造。

常见问题
Kimi K3.1 发布了吗?
不。截至2026年7月27日,Moonshot AI尚未发布官方的Kimi K3.1。唯一来源是X平台上7月26日一条未经证实的泄露帖子。
这个泄露可靠吗?
将其视为传闻。这只是单个社交媒体帖子,没有基准数据、没有模型卡、没有发布日期,也没有任何佐证。方向(一个侧重效率的次要版本)看似合理但尚未证实。
如果泄露属实,K3.1 会有什么变化?
传闻:推理速度更快、延迟更低、长推理时token效率更高、编码/智能体工作流更可靠、浪费的推理步骤更少——同时保持开放权重且质量大致在K3级别。
关于Kimi K3,已确认了什么?
K3 是一个真实的、已发布的 2.8T 参数开源权重模型(2026年7月16日),在发布时登顶 Frontend Code Arena,拥有 100万token 上下文,报告显示 GPQA Diamond 达 93.5%,BrowseComp 约 91.2%。
什么是“Mythos”?
该泄露内容提及了“Mythos级”能力,并询问K3.1是否会“击败Mythos”,但未对该术语进行定义。我们无法证实其具体指代,因此仅作标注处理,而非进行猜测。
在选择模型之前,我是否应该等待K3.1?
不。现在使用Kimi K3(或其他当前型号);如果K3.1随官方规格发布,重新评估。不要根据谣言做规划。
我可以在哪里运行 Kimi K3?
通过托管提供商以及OrcaRouter的兼容OpenAI的API,与其他前沿模型一起方便比较。
底线
"Kimi K3.1"目前只是一则泄露消息——一条发布于7月26日的X平台帖子,描述了一次效率与可靠性的更新(更快、每任务成本更低、智能体更稳定、仍保持开放权重),没有具体数据、模型卡和发布日期。这听起来合理但未经证实,因此我们将其作为传闻而非事实报道。已确认的现实是Kimi K3:一个2.8T参数的开放权重模型,发布时在Frontend Code Arena排名第一,你现在即可使用。如果Moonshot在未来发布附带真实基准的K3.1,我们会更新此文——你也可以通过OrcaRouter的一个兼容OpenAI的端点,在几分钟内进行测试。
