
Grok 4.7 发布日期:SpaceX 数据、推迟的时间表,以及 xAI 究竟说了什么
- z-ai新Z.ai: GLM 5.32026-08-1860智能75代码
- obsidian新Qwen3.8 27B Uncensored (Aggressive)2026-08-1552智能68代码
- qwen新Qwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseek新DeepSeek: DeepSeek V4 Pro 08132026-08-1253智能69代码
- grok新SpaceXAI: Grok 4.62026-08-1261智能77代码
- metaMeta: Muse Spark 1.22026-08-0557智能72代码
- qwenQwen: Qwen3.8 Max2026-08-0358智能72代码
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152智能69代码
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百万 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463智能78代码
- googleGoogle: Gemini 3.6 Flash2026-07-2152智能69代码
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137智能49代码
- metaMeta: Muse Spark 1.12026-07-1653智能71代码
- kimiMoonshotAI: Kimi K32026-07-1560智能76代码
- openaiOpenAI: GPT-5.6 Luna2026-07-0952智能71代码
- openaiOpenAI: GPT-5.6 Terra2026-07-0957智能77代码
- openaiOpenAI: GPT-5.6 Sol2026-07-0961智能77代码
- grokxAI: Grok 4.52026-07-0856智能72代码
昨天,Grok 4.7 的发布窗口有了一个新时间——而且更晚——而它推迟的原因,成为前沿人工智能领域最不寻常的训练数据故事。截至2026年8月13日,docs.x.ai 上的 xAI 模型列表仍然以 grok-4.6 为最高版本——也就是说,你实际上能调用的最新 Grok 是 Grok 4.6,也就是 xAI 在8月12日发布的旗舰模型。没有 grok-4.7 模型 ID,没有定价,没有上下文窗口,也没有基准测试卡。但同一天,埃隆·马斯克在他的 X 账户上证实,这款模型是真实存在的,而且其进度超过了 xAI 以往在任何模型发布前所透露的信息:初步训练已经完成,公司目前正在将“海量”的 SpaceX 工程数据投入到一次补充训练中。他将发布时间定在“3到4周”,也就是9月初——而这已经比他7月底提出的时间窗口有所推迟。
一句话回答,如果你只为这个而来:Grok 4.7 尚未发布,最接近官方日期的是马斯克在8月12日所说的“3到4周”,也就是大约9月2日至9日。他在7月25日给出的时间窗口指向大约8月22日;那个日期已经过去了。本文区分了关于 Grok 4.7 实际已确认的信息与马斯克的说法或社区传闻,梳理了使这次发布与众不同的 SpaceX 数据角度,最后说明如何第一时间知道模型真正发布。
关于 Grok 4.7 实际已知的情况是什么(这是一个简短的部分)
关于 Grok 4.7 的确凿信息三行就能说清,因为 xAI 自己的页面迄今对其只字未提。{{1}}第一,docs.x.ai 上的模型列表止步于 grok-4.6——没有 grok-4.7 条目,没有价格卡片,没有上下文窗口,没有发布说明。这一点已于 8 月 13 日重新核实。{{/1}} {{2}}第二,马斯克于 8 月 12 日表示:“初始训练已完成,现在我们正在补充训练中加入大量 SpaceX 公司数据。”这是关于该模型最有力的一条事实:它确实存在,而且正处于最终训练阶段,而非传闻阶段。{{/2}} {{3}}第三,他为这个语料库的预期收益定下了调子——“SpaceX 训练语料库非常棒且独一无二”——并表示“如果有任何模型在现实工程领域比 4.7 更强,他会感到震惊。”{{/3}}
其他所有带有数字的内容都是附有来源的说法,而来源之所以重要,是因为一篇关于发布日期的报道,其意义不在于把创始人的言论洗白成正式的规格说明。
一切带数字的内容都是主张——并已如此标注。
以下是关于 Grok 4.7 流传的信息,以及每项的如实标注。
• 一个约2.1万亿参数的设计——多家媒体报道并追溯至马斯克本人的言论,但从未出现在任何xAI规格表上。应将其视为一种说法,而非已确认的规格。作为参照,当前旗舰版Grok 4.6是1.5万亿参数的模型。
“在各方面都比 4.6 更好,除了提供服务的速度稍慢,但 token 效率甚至更高”——这是马斯克在 7 月底的描述。这是他的定位,目前没有可独立验证的依据:该模型尚未在任何地方运行。
• “Grok 4.7 将超越所有现有模型”——马斯克,8月12日。这是一项产品声明,而非基准测试。对于一个尚未发布的模型,不存在独立的评分。
"现实世界工程"至上——马斯克的框架,完全与SpaceX语料库绑定。"现实世界工程"在帖子中未被定义,且没有发布可重跑的工程评估,因此这一主张目前甚至无法在原则上得到验证。
• SpaceX语料库所包含的内容——科技媒体报道甚详:星链卫星遥测数据、火箭研发与测试数据,如猛禽发动机燃烧室压力日志和星舰再入遥测数据,另有内部工程产物,如Slack线程、Jira工单、GitHub仓库及ERP记录。这是社区对马斯克言论的报道,并非xAI的披露,预计不会包含受ITAR管制的硬件细节。

SpaceX的数据就是故事本身——也是悬而未决的问题。
无论发布日期是哪天,SpaceX训练语料库才是真正改变格局的部分。最接近的先例是上一代:Grok 4.5在后期训练中补充了Cursor IDE追踪数据——一种代码使用语料库。Grok 4.7在种类上更进一步——火箭遥测数据、制造记录、CAD和故障日志都不是代码。如果这些说法成立,xAI将赋予前沿模型一种竞争对手没有的东西:几十年的真实工程运营记录,包括失败案例,以及对纯文本语料库永远无法包含的物理和制造约束的直觉。
这是看涨情形,也是我们所知的诚实边界。任何细节都没有披露——没有词元数量,没有语料构成,没有许可证或出口管制过滤,没有工程评估。“如此惊人且独特”是一个断言,而断言需要实验室。当模型发布、独立评估者可以针对真实工程任务运行测试时,考验才会到来;在那之前,SpaceX 的故事是前沿 AI 领域中最有趣但无法证实的事情,而纪律就是如实将其称为如此。
时间线,以及你应该注意的模式
Grok 4.7 有过两个半官方的发布时间窗口,第二个比第一个更晚。7月25日,马斯克表示该模型大约还需四周推出,这意味着发布日期在8月22日前后。8月12日,他将其修正为"3到4周",这意味着9月2日至9日。这相当于两到三周的延期,而8月22日这个窗口已经没了。
这种模式才是真正值得内化的部分,因为 xAI 口头给出的发布时间有着可衡量的历史记录。马斯克在七月的表述指向 Grok 4.6 将于 8 月 7 日左右发布;而 Grok 4.6 实际上在 8 月 12 日才上线。xAI 给出的发布窗口是意图声明,而非承诺——对“3 到 4 周”的诚实解读是“Grok 4.7 真实存在且还在路上”,并且有很大的把握认为日期会偏向较晚的一端。
Grok 4.7 相对于 Grok 4.6 的位置
要思考 Grok 4.7 必须超越什么,应以 xAI 实际发布的模型为基准。Grok 4.6 于 8 月 12 日发布:输入每百万 token 2 美元,输出每百万 token 6 美元(输入低于 200K 时;高于该值则翻倍至 4 美元/12 美元),上下文窗口为 500,000 个 token,知识截止日期为 2026 年 2 月 1 日,Artificial Analysis Intelligence Index 为 61。Grok 4.5 于 7 月发布,以 56 分位居其下。
• 参数 — Grok 4.7 约为 2.1T(据报道,未经证实),而 Grok 4.6 为 1.5T。
• 状态 — 补充训练中 对比 2026年8月12日发布
• 每100万token的价格——未公布,对比输入$2/输出$6。
• 上下文窗口 — 未发布,对比 500K tokens。
• 服务速度——马斯克表示,与今天的上限相比,略慢于 Grok 4.6。
• Token 效率 — 马斯克表示,相比当前基准,优于 Grok 4.6。
• 独立评分 — 无,相较于 AA 智能指数 61。
而在同一个记分牌上,Grok 4.7所瞄准的对手阵容是:Claude Fable 5为62分,Claude Opus 5为63分,Kimi K3为60分——GPT-5.6 Sol则与Grok 4.6并列61分。马斯克并没有将此举定义为击败某个单一对手;在他声称Grok 4.7“将超越所有现有模型”的同一条帖子中,他也承认“Anthropic是一家伟大的公司,而且可能很快就会发布改进后的模型。”从竞争角度来看,这意味着xAI认为Claude Fable 5、Claude Opus 5和Kimi K3是它必须超越的模型。

这对今天调用 Grok 的团队意味着什么
对于开发者而言,API 的实际上限是 Grok 4.6——你调用到的模型就是它,而不是预告片中的那一款。在 OrcaRouter 的目录中,Grok 系列目前运行的是 Grok 4.6 和 Grok 4.5,按提供商的标价计费,0% 加价,所以你在成本模型里填的 2 美元/6 美元,就是发票上的 2 美元/6 美元。当 Grok 4.7 发布、提供商完成接入后,我们会以同样的方式按标价列出它——一把密钥,无需新集成,无需第二份合同——但那一天是模型列表发生变化的日子,不是今天。

当 Grok 4.7 真正落地时,同样的路由层是低风险的迁移方式,而 SpaceX 的故事让这种谨慎更加有针对性,而非减弱。一个全新模型的分数在独立实验室复现之前都只是供应商的说法——第一周的数据恰恰是最不值得信任的——而自动故障转移让你可以将流量指向它,而不必把生产路径押注在供应商的保证上。如果真实请求出现回归,下一个请求就会回退到仍然响应的提供商。这就是尝试未经证实的模型与把整个流水线押在它上面的区别。
如何抢先知道(比小道消息更靠谱)
以上所有内容都会在 xAI 拨动开关的那一天过时,所以这里有一种超越所有追踪器的检查方法:
关注模型列表,而不是推文。当 Grok 4.7 真正发布时,docs.x.ai/docs/models 会新增一个 grok-4.7 模型 ID,并附带上定价和上下文窗口。Grok 4.6 就是这样出现的——先是模型列表,然后才是公告。
• xAI 的发布说明及其 X 账号是供应商自己的渠道,但模型列表才是真正的产物,因为它是 API 实际提供的内容。文档页面上的模型 ID 是事实;而 X 上的提及只是一种说法。
• 关注 OrcaRouter 模型目录。orcarouter.ai 上出现 grok-4.7 模型页面,就是"今天即可调用"的信号——当提供商已接入该模型并且我们已将其列入目录时,即可通过一个 API 按标价进行路由。
• 在消费者端可见性方面,Grok 应用将模型作为入口点。API 可用性与应用可用性可能不一致,因此你关注哪个信号取决于你是在构建产品还是仅仅出于好奇。
当前形势
Grok 4.7 是一个真实存在的模型,正处于最终训练阶段,尚未发布,没有规格表,而且口头承诺的时间窗口已经跳票过一次。SpaceX 的工程语料确实让这次发布与竞争对手的任何尝试都截然不同——没有其他人把火箭遥测数据、制造记录和故障日志喂给前沿模型——但“太棒了 & 独一无二”这个说法,在独立实验室复现之前,只能算是一种宣称。如果你来这儿是想找发布日期,诚实的回答是“据马斯克称,九月初”,但根据 Grok 4.5 和 Grok 4.6 的实际发布情况,有很强的先验概率表明这个口头时间线在正式落地前还会再跳票。对于今天正在构建产品的人来说,制胜之举不是等待——而是在现有的 $2/$6 服务上继续开发,等模型列表一变就立刻切换。当 Grok 4.7 正式上线时,它应该出现在你的 API 密钥里,而不是你的日历上。
本文中的对比1
根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新
