Kimi K3.1:泄密内容声称的——以及实际已确认的
Guides & Insights

Kimi K3.1:泄密内容声称的——以及实际已确认的

作者

jinhao song

发布日期

最新模型 · 20查看全部模型
基准测试:Artificial Analysis · 每日更新
返回全部文章

提醒:这是泄露,不是官方公告。截至2026年7月27日,Moonshot AI尚未正式发布或确认一款"Kimi K3.1。"以下关于K3.1的所有信息均来自一条未经证实的社交媒体帖子,在Moonshot发布权重或模型卡之前,应视为谣言。确认的是Kimi K3——即Moonshot于2026年7月16日发布的具有2.8万亿参数的开源权重模型。本文将对两者加以区分:泄露中关于K3.1的说法,以及我们今天实际所知的内容。

为什么现在写出来?因为“Kimi K3.1”已经被搜索,而这个故事的真实版本——清楚标注传闻与事实——比炒作或沉默更有用。如果月之暗面发布任何官方信息,我们会更新这篇文章。

摘要。2026年7月26日,X上的一篇帖子(@Mr_Salio,标题为"Kimi K3.1 Leak")列出了K3.1更新的传闻功能集:性能缩小与GPT-5.6Claude Fable的差距,更快/更低延迟的推理,更好的长推理令牌效率,更可靠的编码和智能体工作流,更少的浪费推理步骤,相对于克劳德的持续优势 Opus 5在某些编码/智能体任务上,以及持续的开源权重发布。这些均未得到确认,没有基准测试数据,也没有官方发布日期。已确认的基准是Kimi K3:2.8T参数,开源权重,发布时在Frontend Code Arena排名第一。

关键要点

• 该泄露未经证实。单一X帖子,无数据,无日期,无Moonshot确认。视为谣言。

• K3.1 传闻的主题是效率,而非新尺寸。更快的推理、更低的延迟、更好的 token 效率、更少的推理步骤。

• 声称的定位:缩小与GPT-5.6 SolClaude Fable 5的差距,并在某些编码/代理任务上保持对Claude Opus 5的优势。

• 开放权重声称将继续 — 与K3的修改版MIT许可证一致。

• 今天真正存在的是Kimi K3(2.8T,开放权重,2026年7月16日发布),而不是K3.1。

泄漏的实际内容是什么

该消息来自 @Mr_Salio 在 X 平台上的一个帖子,发布时间为 2026 年 7 月 26 日,标题明确为“Kimi K3.1 泄露”。帖子中列举了一组传闻中的要点(转述自该帖子):

• 与GPT-5.6和Fable“缩小差距”的性能

• 保持其声称的顶级("Mythos-level")能力——帖子中的措辞;泄露中未定义"Mythos"。

• 更快的推理速度和更低的延迟。

• 在长推理任务上更好的词元效率。

• 更可靠的编码和智能体工作流。

• 更少不必要的推理步骤。

• 在关键编码和智能体任务上持续优于 Claude Opus 5。

• 保持开放权重,使前沿AI免费可访问。

这就是这次泄露的全部内容。值得注意的是,其中缺少任何基准测试分数、参数规模、上下文长度、价格或发布日期。帖子最后甚至向读者抛出了一个开放式问题(“你认为它会击败 Mythos 吗?”),这强烈表明这只是猜测,而非正式发布的公告。

它有多可信?

低到中等,以下是诚实的解读。一方面,传闻的方向是合理的:点版本(即“.1”版本)几乎总是专注于效率和可靠性——更快的推理、更好的token经济、更少的浪费推理步骤——而不是全新的架构,而这正是此列表所描述的。这也符合Moonshot的开放权重策略与K3。

另一方面,没有什么可验证的:它只是一个近乎匿名的账号,没有数字,没有模型卡的截图,没有Hugging Face仓库,并且在撰写本文时也没有任何其他地方的证实报道。像“神话级别”这样的未定义术语使得无法核实。除非Moonshot公布权重、模型卡或基准表——或者有信誉的媒体证实——否则这应被视为谣言,而非路线图。

已经确认的是:Kimi K3

真实发布并交付的模型是Kimi K3,于2026年7月16日发布——这是一个2.8万亿参数的开源权重混合专家模型,专为长时程编码、推理和智能体工作流而设计,原生支持多模态输入,拥有100万token的上下文窗口。上线后立即在独立的Frontend Code Arena排行榜上跃居第一(Elo约1,679),超越了Claude Fable 5、GPT-5.6 SolGLM-5.2,并在GPQA Diamond上取得了93.5%的成绩,在BrowseComp上取得了约91.2的成绩。月之暗面承诺以修改版MIT许可发布完整权重。这些是值得锚定的数字——也是任何“K3.1”模型将要构建的现实基线。

(K3的来源:Moonshot的发布材料以及包括Frontend Code Arena和Artificial Analysis在内的独立排行榜;数据为发布时报告的数字,可能会发生变化。)

如果泄密消息属实,那么K3.1意味着什么?

善意地解读传闻列表,K3.1将是一个效率和可靠性的发布版本,而非能力跃升:大致K3级别的质量,但更快、每任务更便宜(更好的令牌效率),并且在智能体循环中更稳定(更少的浪费推理步骤,更可靠的工具使用)。对于已经在运行K3的团队来说,这是最有价值的更新——它降低了成本和延迟,而无需重新评估质量。据称"缩小了与GPT-5.6和Fable的差距"以及"在某些编码/智能体任务上优于Opus 5",如果属实,将使K3.1成为编码智能体最强的开放权重选项。但再次强调——如果属实。

你应该等它吗?

不——不要围绕一个谣言来构建方案。如果你今天需要一个顶级的开源权重编码模型,Kimi K3 已发布、开源,并且独立在 Frontend Code Arena 排名第一。如果 K3.1 确实带来了实际的效率提升,后续迁移非常容易(同一系列、开放权重)。理性的做法是现在就用 K3,等 K3.1 真正发布并附带模型卡和具体数据时再重新测试。不要因为一个未经确认的“.1.”而延迟项目。

今天如何试用Kimi K3

Kimi K3 为开放权重模型,可通过托管服务商获取,包括在 OrcaRouter(模型 Kimi K3)上通过兼容 OpenAI 的端点使用。供应商中立团队将 Kimi K3 与 GPT-5.6 Sol、Claude Fable 5 及 Claude Opus 5 路由至同一端点后端,这样一旦 K3.1(或任何新模型)发布,切换仅需更改一行代码,而无需进行迁移。

这与当前领导者相比如何

在已确认的图片中:Kimi K3 在发布时于前端代码竞技场(Frontend Code Arena)中领先所有模型,是迄今为止最强的开源权重发布,而封闭前沿模型如 Claude Fable 5(SWE-bench Verified 榜首)和 Claude Opus 5(人工智能分析智能指数排名第一)在其他维度上仍保持领先。传闻中一款“缩小差距”的 K3.1 将会让本就激烈的竞争更加白热化——但泄露信息未提供任何数据来定位它,因此我们不会凭空捏造。

常见问题

Kimi K3.1 发布了吗?

不。截至2026年7月27日,Moonshot AI尚未发布官方的Kimi K3.1。唯一来源是X平台上7月26日一条未经证实的泄露帖子。

这个泄露可靠吗?

将其视为传闻。这只是单个社交媒体帖子,没有基准数据、没有模型卡、没有发布日期,也没有任何佐证。方向(一个侧重效率的次要版本)看似合理但尚未证实。

如果泄露属实,K3.1 会有什么变化?

传闻:推理速度更快、延迟更低、长推理时token效率更高、编码/智能体工作流更可靠、浪费的推理步骤更少——同时保持开放权重且质量大致在K3级别。

关于Kimi K3,已确认了什么?

K3 是一个真实的、已发布的 2.8T 参数开源权重模型(2026年7月16日),在发布时登顶 Frontend Code Arena,拥有 100万token 上下文,报告显示 GPQA Diamond 达 93.5%,BrowseComp 约 91.2%。

什么是“Mythos”?

该泄露内容提及了“Mythos级”能力,并询问K3.1是否会“击败Mythos”,但未对该术语进行定义。我们无法证实其具体指代,因此仅作标注处理,而非进行猜测。

在选择模型之前,我是否应该等待K3.1?

不。现在使用Kimi K3(或其他当前型号);如果K3.1随官方规格发布,重新评估。不要根据谣言做规划。

我可以在哪里运行 Kimi K3?

通过托管提供商以及OrcaRouter的兼容OpenAI的API,与其他前沿模型一起方便比较。

底线

"Kimi K3.1"目前只是一则泄露消息——一条发布于7月26日的X平台帖子,描述了一次效率与可靠性的更新(更快、每任务成本更低、智能体更稳定、仍保持开放权重),没有具体数据、模型卡和发布日期。这听起来合理但未经证实,因此我们将其作为传闻而非事实报道。已确认的现实是Kimi K3:一个2.8T参数的开放权重模型,发布时在Frontend Code Arena排名第一,你现在即可使用。如果Moonshot在未来发布附带真实基准的K3.1,我们会更新此文——你也可以通过OrcaRouter的一个兼容OpenAI的端点,在几分钟内进行测试。

© 2026 OrcaRouter

推理服务商

运营推理平台?让您的模型上线 OrcaRouter。

联系我们

加入我们的社区

DiscordEmailXGitHubYouTube