文章主视觉卡片,标题为"Kimi K3.1——目前我们所知",下方有三行堆叠信息:日历图标旁标注"订阅已于 2026 年 9 月 18 日重新开放",齿轮图标旁标注"据报后继模型正处于后训练阶段——计算机使用、多模态",问号图标旁标注"截至 2026 年 9 月 20 日,无模型卡、无权重、无 API id",上方页脚文字为"方向未经验证;Kimi K3 仍是该系列中唯一已发布的模型。",整体置于白色背景上,带有柔和的蓝青渐变点缀,右下角为 OrcaRouter 标志。
Guides & Insights

Kimi K3.1:订阅回归,据传继任者已进入后训练阶段

作者

Alistair Wren

发布日期

最新模型 · 20查看全部模型
基准测试:Artificial Analysis · 每日更新
返回全部文章

为订阅队列重新开放而兴奋,是一件奇怪的事。但 2026 年 9 月 19 日发布的那篇 Kimi 帖子同时在做两件事,而第二件才是有意思的:帖子称 Moonshot AI已经启动了一轮新的后训练,面向 Kimi K3 系列的下一个模型——发帖者称这轮训练更侧重于计算机使用,同时也在多模态体验方面投入工作——并且下一个模型,即帖子所称的下一个 Kimi K3.1,将在 10 月底之前到来。

后半部分内容一概未获证实。没有 Kimi K3.1 的模型卡,没有权重,没有 API id,没有价格,也没有日期。这个系列中目前唯一能调用的模型是 Kimi K3,即 Moonshot 于 2026 年 7 月 16 日发布的 2.8 万亿参数开放权重系统。所以,就把它当作它本来的样子:来自一位有真实过往记录的爆料者的早期信号,并且与一件真正可核实的事件出现在同一周。

那个可核实的事件,正是这件事值得写一篇帖子、而不是耸耸肩一带而过的原因。Kimi 的消费者订阅自 2026 年 7 月 20 日起便已关闭,当时 Moonshot 暂停了新用户注册,因为 K3 的需求已经超出了其集群所能承载的规模。两个月后,订阅重新开放,并重建了套餐层级结构。如果你一直在等着入手,那部分是真的,而且就发生在最近几天。

简版。订阅:回归,新增档位,Code 现在起步比之前高一级。下一款模型:正在进行后训练,目标是计算机使用和多模态,据称会在十月底之前推出——未经证实,来自单一账号,不应据此做规划。Kimi K3:现已可用,而且仍然是这篇报道里唯一真正能运行的东西。

帖子说了什么,以及它没有说什么

该信号是一条来自 @chetaslua、日期为 2026 年 9 月 19 日的 X 帖子。它包含四项主张,而这些主张并非同样有力:

订阅回来了。可验证,并且已验证——见下一节。

新一轮后训练已启动。这一点除 Moonshot 内部人员外无人能够核实。后训练是预训练之后的阶段,模型在这一阶段被调校为可用的产品;“新一轮已启动”只能让你大致了解继任模型处于研发流程中的哪个位置,对它何时落地则一无所知。

它更侧重于计算机使用,并改进了多模态体验。这是一个方向,而非一份规范。这也是文中最不令人意外的说法,原因值得在下面详细说明。

下一个模型将在十月底之前发布。一个日期。泄露消息中的日期是任何人所发布内容中最容易验证的东西,而这个账号此前给出的 Kimi 日期是错误的——关于这一点,时间线中会有更多说明。

真正缺失的,恰恰是你实际想要知道的内容:参数量、上下文长度、价格、许可证、基准测试分数,或者任何能表明这是一次 Kimi K3.1 式的点版本发布还是更大规模更新的迹象。这篇文章没有说,而此后发布的任何内容也没有填补这一空白。此外还存在命名问题。自 7 月以来,泄露消息一直放出“K3.1”,预测市场和灰度测试观察者都指向“下一款 K 系列模型”,而各种报道则分别指向 K3.1、K3.2 和 K4。这是三款不同的产品。这篇文章并未说明它描述的究竟是哪一个。

你可以查看的部分:订阅已重新开放

Moonshot于2026年7月20日暂停了新的消费者订阅,此时距K3发布仅过去四天。该公司表示,需求已接近其现有集群的承载极限,可用算力将转给已经付费的用户。随着容量增加,新名额将分批重新开放。这次暂停持续了约两个月。

订阅于2026年9月18日重新开放,各订阅层级已更名并重新定价,年度总价与旧版保持一致:

• Go — 468 元/年,约 39 元/月

• Plus — 948元/年,约合每月79元

• Pro — 每年 1,908 元,约合每月 159 元

• Max — 6,708 元/年,约 559 元/月

有两项变化比价格本身更重要,而价格并未变动。首先,单独售卖 Kimi Code 的方案在用户压力下基本被撤回——Plus、Pro 和 Max 仍然都包含它。其次,最便宜的档位不再包含,因此 Code 的入门价格实际上从每年 468 元涨到了 948 元。社区帖子还提到,每周限制已被取消,同时配额被削减,并且 100 万 token 的长上下文权益从原来的中档套餐上移到了 Max。最后两点属于用户评论,而非官方说明,而这类细节往往决定一个套餐是否值得购买——在包年之前,请结合自己的使用情况加以核实。

如果你身处中国以外,情况会有一个重要的不同:上述档位都是面向中国国内消费者的方案,你实际能购买什么、以什么价格购买,取决于所在地区。具体到 API 访问,这一切都不会限制你——Kimi API 是与消费者订阅分开的产品,从未属于那次暂停的一部分。

为什么“计算机使用和多模态”是帖子里最不令人意外的说法

Moonshot一年来一直朝着这个方向努力,这正是为何尽管时间线不可信,但方向却令人信服的原因。

Kimi Work 是 Moonshot 面向 macOS 和 Windows 推出的桌面智能体,随附一项 Computer Use 能力:它能读取屏幕,并完成点击、滚动和输入操作,而且在后台运行,不会接管你的鼠标。在底层,一个浏览器桥接通过 DevTools 协议驱动一个真实且已登录的 Chrome 或 Edge 会话,用于导航、点击和表单填写。围绕这些,公司还打造了可支持多达 300 个并行子智能体的 Agent Swarm、能围绕某个结果持续迭代数小时的目标模式,以及用于周期性任务的调度器。这是一个需要模型擅长看懂屏幕、决定动作并核验结果的产品界面。

K3 本身就已经朝着这个方向走了。它支持原生图像输入,而其发布材料着重强调了长时程的智能体工作——读取环境状态、调用工具、检查结果、纠正方向——这实质上就是计算机操作,只是没有明说。Moonshot 自己的技术报告描述了这样一些训练任务:它们可以运行至数千次工具调用,同时保留文件、应用程序和虚拟机状态。一个在后训练阶段明确向计算机操作倾斜的继任者,是顺理成章的下一步,而不是一次转型。

多模态也是同样的故事。K2.5 一代引入了“零视觉”微调阶段——仅用文本监督来保持视觉推理与工具调用能力不被破坏——随后是多模态强化学习。K3 保留了 MoonViT 系列的视觉编码器和原生图像理解。“提升多模态体验”,从外部看,就是对这一技术栈持续投入所呈现出的样子。

这一切都不能使该说法成立。它只是使其显得可信,而可信是另一回事,并且是一种弱得多的东西。可信的方向正是泄密最擅长之处;它们也是泄密最不擅长确定时间之处。

四个日期,其中三个是错的

阅读这篇文章最有用的方式,是把它看作一个系列中的第五篇,因为这个系列有实打实的过往记录:

2026年7月16日——Kimi K3 发布。本清单中唯一确认的一项。2.8万亿参数、混合专家架构、100万 token 上下文、原生图像输入、开放权重。

2026年7月26日——第一条K3.1爆料。一条X帖子列出了传闻中的改进:推理更快、长推理中的token效率更高、编码与智能体工作流更稳定、无效推理步骤更少,并且依旧是开放权重。没有具体数字,没有日期,结尾还询问读者是否认为它能胜出——这是猜测的形态,而非简报。

2026年8月18日——第一个日期。同一位爆料者的后续消息将下一款 Kimi 模型与顶级闭源系统相提并论,并称其预计会在8月内发布。然而8月结束,发布并未到来。这是整个故事中唯一一个曾被验证过的要素,而它落空了。

2026年9月18日——预告。 Moonshot 自己的账号发布了一长串数字,随后将其删除;社区将其解读为去掉开头“3.1”的 π 的十进制展开。来自供应商一方、二手且无法核实,因为该帖已不存在。

2026年9月19日——本篇帖子。 订阅已确认,有人宣称完成了一次训练后运行,新的截止日期:10月底之前。

这里有一种模式,值得点明。两个月来,这些泄密的走向一直很一致——效率、可靠性、智能体、计算机使用、多模态——而附着其上的每一个日期都已落空。一次泄密可以在“即将到来的是什么”上是对的,却在“何时到来”上出错,而到目前为止,这一次恰恰如此。9月18日的预告从另一个方向让情况变得更复杂:厂商预告自己的后继产品,比泄密者的要点清单是更强的信号,因为一家公司若预告某样东西,就说明它以某种形式已经拥有它。但那条预告同样没有给出日期,而这里紧随其后的帖子是泄密者的,不是 Moonshot 的。

什么是实际确认的,以及今天该运行什么

A generated single-column scoreboard titled 'Kimi K3 — the scoreboard' with six rows: Parameters 2.8T MoE, ~104B active; Context window 1,048,576 tokens; Input modalities text + image; Price $3.00 in / $15.00 out per M tokens; Frontend Code Arena #1 at launch, ~1,679 Elo; Open weights released July 2026. A footer reads 'Kimi K3 figures as reported by Moonshot at launch, July 2026; price per OrcaRouter.'

Kimi K3 才是这个故事中真正的模型。它于 2026 年 7 月 16 日发布,权重和技术报告随后于 7 月 27 日公布;它是一个 2.8 万亿参数的稀疏混合专家(Mixture-of-Experts)系统,拥有 896 个专家,每个 token 约有 1040 亿激活参数,基于 Kimi Delta Attention 和 Attention Residuals 构建,具备 100 万 token 上下文窗口和原生图像输入。发布时,它在独立的 Frontend Code Arena 上以据报道约 1,679 Elo 的成绩登顶,领先于 Claude Fable 5GPT-5.6 Sol,并在 GPQA Diamond 上取得了据报 93.5% 的成绩。请将这些标记为发布时的数据,而非已经确定的数字——自那以后,K3 周围的榜单和模型都已发生变化,而且这些分数来自 Moonshot 自己的发布材料。

Screenshot of the Artificial Analysis model page for Kimi K3 (max), tagged 'Open weights model' and 'Released July 2026', showing four highlight cards — Intelligence at rank 2 of 113 with an Artificial Analysis Intelligence Index of 44, Speed at rank 50 with 38.9 output tokens per second, Cost at rank 33 with In $3.00 and Out $15.00 per 1M tokens and a 90% cache discount, and Verbosity at rank 24 with 160M output tokens — plus a technical specifications panel listing a 1M context window, 2.8T total parameters, 104B active parameters and Hugging Face model weights, and a comparison summary that calls the model notably slow at 39 tokens per second and expensive against a $0.30 median input price.

没有改变的是,K3 在被泄露消息称为继任者正为之受训的那件事上确实很强。带视觉闭环的长时程智能体工作——模型审视自己的产出并加以修正——正是它被打造出来要去竞争的领域,也正是这一点,让 9 月 19 日那篇帖子中 "computer use" 的说法读起来像是延续,而非新闻。

Kimi K3 现已通过 OrcaRouter 提供,模型名为 kimi/kimi-k3,与 Kimi K2.5Kimi K2.6Kimi K2.7 Code 一起,位于同一个兼容 OpenAI 的端点上。当有泄露消息在流传时,这一点比平时更重要。OrcaRouter 以 0% 加价 原样传递供应商标价,因此,如果 Moonshot 下调 K3 的价格——对于任何已经基于它进行构建的人来说,这正是“继任者发布”事件的现实形态——新价格当天就会在我们这边生效,无需重新协商合同。而当一款你尚无法验证的模型真的到来时,故障转移就是你无需把生产路径押注在它身上也能试用它的方式:将一部分真实流量路由过去,保留已验证的模型作为回退,如果新模型表现异常,就让路由器把请求切回来。

Screenshot of the OrcaRouter model page for Kimi K3, showing the product id kimi/kimi-k3 with a FEATURED badge, a context window of 1M tokens, text and image input with text output, a p50 time to first token of 8.62 seconds, input pricing of $3.00 per 1M tokens and output pricing of $15.00 per 1M tokens, seven-day p50 and p95 TTFT of 8.62 s and 10.00 s, 1,790.3M tokens of traffic over seven days, the /v1/chat/completions and /v1/responses endpoints, and a Python code sample pointing at the base URL https://api.orcarouter.ai/v1.

如果这个部分错了会是什么样子

衡量一篇爆料文章是否诚实,标准在于它有没有点明那些足以证伪自身的要素。那么,具体来说,以下就是能一锤定音的东西——以及能让它彻底站不住脚的东西。

Hugging Face 仓库或模型卡来自 Moonshot,这是唯一确凿的证实。除此之外,这条流程中的其他任何内容,读者都无法核实。

Kimi API 自身模型列表中出现的新模型 ID甚至可以在权重发布之前就确认此次发布。

盲测竞技场中的匿名条目是一种很弱的判断依据,理应按此对待。今年早些时候,社区中许多人仅凭 Moonshot 以往版本的命名规律,就认定某个匿名的 Code Arena 代号正是处于灰度测试中的下一代 Kimi 模型;而随后的一份分词器指纹却把同一条目指向了一个完全不同的模型家族。竞技场上的标签只是对身份的猜测,而非身份的证据。

若整个十月保持沉默,这将成为同一账号连续第二次错过的日期,并将对后继机型的合理预期推迟到明年——而这并不等同于该机型不存在。

如果你这周要做决定,就根据订阅消息来做决定,那是真实的;也根据正在发布的 Kimi K3 来做决定。后继者只是一个方向,其截止日期是由某个不在 Moonshot 工作的人附加上去的,而围绕它做规划的正确数量是零。

人们真正在问的问题

Kimi K3.1 发布了吗?

不。截至2026年9月20日,任何名为Kimi K3.1的模型都没有模型卡、没有权重、没有API id,也没有价格。该系列中唯一已发布的模型是Kimi K3,发布于2026年7月16日。

我应该开始构建之前等它吗?

不——而订阅消息正是原因。如果你现在就需要 K3 级能力,它今天已经可用,而且价格没有上涨。如果你想抢先跟上后继版本,低成本的准备方式是针对一个能在新模型 ID 一出现就路由到它的端点来构建,而不是围绕一个尚未公布 API 接口的模型去重写集成。

重新开放的订阅是否包含 API 访问权限?

不。Go、Plus、Pro 和 Max 档位是面向 Kimi 网页、应用和智能体产品消费者的套餐,并且在最高的三个档位中也面向 Kimi Code。API 访问按 token 单独计费,从来不属于 7 月暂停的一部分。

“更侧重于计算机使用”在实践中意味着什么?

这意味着后训练更偏重屏幕读取和 GUI 操作——模型查看界面,决定点击或输入什么,并检查结果是否正确。Moonshot 已在 Kimi Work 中提供这一能力,并且已经在用保留应用程序和虚拟机状态的长工具调用运行来训练 K3,因此,一个在该方向上进一步调优的后继者才是预期的下一步,而不是一条新产品线。

下一个真正的数据点不会是又一篇帖子。而会是一个仓库、一张模型卡,或一个模型 ID。在其中任何一个出现之前,9 月 19 日那篇帖子里订阅线之后的一切,都只是附带了一个日期的说法——而这个日期正是这个账号已经弄错过一次的部分。