Grok 4.6:发布日期(8月7日)、已确认信息和预期展望
Guides & Insights

Grok 4.6:发布日期(8月7日)、已确认信息和预期展望

作者

jinhao song

发布日期

最新模型 · 20查看全部模型
基准测试:Artificial Analysis · 每日更新
返回全部文章

xAI的下一款模型有了发布日期。2026年7月29日,Arena(Arena.ai / LMArena)宣布,Grok 4.6将于2026年8月7日发布,并将在接下来一周出现在Arena排行榜上。这使得这个“即将发布的模型”故事格外可靠:发布日期和评估场所已得到可信第三方的确认,尽管该模型的规格和基准测试尚未公开。本指南将关于Grok 4.6已确认的信息与仅能合理预期的信息区分开来,以记录详尽的a href="https://www.orcarouter.ai/models/grok/grok-4.5">Grok 4.5/a>为基准。

每个下方图示均标注了来源。Grok 4.6尚未公布规格或基准测试;此处数据为Grok 4.5的,来自独立来源。细节可能变化——发布时请核实。

TL;DR。Grok 4.6 已确认于 2026 年 8 月 7 日发布,并在发布后不久在 Arena 上进行基准测试。除此之外,尚无任何官方消息——没有规格、定价或独立评分。我们所知道的是它所基于的发展轨迹:Grok 4.5 是 xAI 真正的回归之作,在智能体任务和编程任务上表现强劲,定价有竞争力,并且在 Arena 排名中迅速攀升。如果 Grok 4.6 延续这一趋势,预计在智能体和编程方面会有进一步提升。在它正式推出之前,Grok 4.5 是你可以实际使用的模型——如果你保持在厂商无关的端点上,之后升级到 4.6 将非常简单。

关键要点

• 已确认:Grok 4.6将于2026年8月7日发布,并将在随后一周在Arena上进行评估(根据Arena.ai)。

• 尚不明确:Grok 4.6 的规格、架构、定价或基准测试 — 均未公开。

• 基线表现强劲:Grok 4.5 是一款顶级的代理/编码模型,价格具有竞争力,并且在 Arena 上排名上升。

• 合理的预期:进一步在代理能力与编码方面取得进展,延续4.3 → 4.5 → 4.6的发展轨迹。

• 现在要做什么:今天使用Grok 4.5;搭建一个供应商无关的端点,这样Grok 4.6在发布时只需更改配置。

实际上已经确认了什么

两件事,均来自Arena.ai于7月29日的公告。首先,日期:Grok 4.6 将于2026年8月7日发布。其次,地点:它将在发布后一周内出现在Arena的排行榜上,这意味着我们将相对快速地获得独立的实时对比数据,而不是等待供应商的幻灯片。就是这样——关于Grok 4.6的其他一切目前均未确认。任何在今天引用Grok 4.6的基准测试数据、参数数量或定价的人都是在猜测。

基线:Grok 4.5 实际上是什么

因为Grok 4.6是清晰发展轨迹上的一步,设定预期的最佳方式是看4.5达到了什么水平。Grok 4.5于2026年7月8日发布,是xAI真正的转折点:一个基于1.5万亿参数基础的混合专家模型,大量使用真实编程会话数据进行训练,针对智能体和软件工程工作进行了调优。独立和已报告的测试结果将其置于前沿:人工分析智能指数约54(总体排名约第4),智能体工具使用排名靠前,Terminal-Bench 2.1上约83.3%,SWE-Bench Pro上约64.7%。其定价也极具竞争力,每百万令牌约2美元/6美元——远低于几个竞争对手的旗舰模型。简而言之,4.5让Grok再次成为严肃的智能体编程竞争者。

为什么竞技场框架很重要

Arena的公告不仅仅是一个日期——它传递了关于Grok 4.6将如何被评判的信号。Arena较新的Agent Arena排行榜不再依赖静态基准测试,而是根据真实、实时的智能体会话对模型进行排名。在该榜单上,Grok 4.5首发即位列第13名,相较于Grok 4.3的第29名取得了大幅跃升,并在Bash Recovery等任务上表现显著提升。这一轨迹——智能体排名随着代际更迭而急剧攀升——正是4.6发布的背景。如果这一模式延续,Grok 4.6的头条故事将再次聚焦于其智能体能力,且衡量标准将是实时会话而非精心策划的测试。我们将在发布后约一周内知晓结果,这个速度令人耳目一新。

合理期望什么(明确标注为期望)

由于没有官方规格,任何预期都只是推断,而非事实。但基于实际情况的推断是:考虑到xAI的专注方向以及从4.3到4.5的演进轨迹,预计Grok 4.6将进一步推进智能体工具使用和编程能力,很可能继续维持有竞争力的定价,并专门针对智能体任务与当前前沿模型(Opus 5、GPT-5.6 SolGemini及其他模型)展开竞争。我们应假设的内容:具体分数、参数量,或认为它将登顶任何特定排行榜。应将"更强的智能体能力、更强的编程能力、依然廉价"视为一个假设,待8月7日验证,而非承诺。

如何准备——以及今天使用什么

不要因为等待一个尚未发布的模型而拖延项目。Grok 4.5现已推出,是一款优秀的代理/编码模型。如果你基于供应商中立且兼容OpenAI的端点进行构建,那么在8月7日采用Grok 4.6只需改动一行代码,而无需重新集成。OrcaRouter今天通过一个兼容OpenAI的单一端点提供了Grok 4.5,同时还有众多其他模型,因此你可以立即基于4.5发布产品,并在Grok 4.6上线的那一刻切换到(或进行A/B测试)——然后让Arena的独立结果和你的自有测试来决定是否迁移流量。

发射发生时如何读取

当Grok 4.6于8月7日发布时,有几件事值得关注,而非只信其表面。关注一下Arena Agent leaderboard的排名(实时会话,较难操纵),这比任何单个厂商的基准测试更值得参考。检查定价——Grok 4.5的一大魅力在于成本,而4.6是否能维持这一点至关重要。寻找独立的编码/代理性能数据(Terminal-Bench、SWE-Bench Pro),而非仅依赖xAI自己的数据。并且,和往常一样,运行你自己的代表性任务:排行榜位置只是一个起点假设,并不能保证你的实际工作负载表现。

常见问题

Grok 4.6 什么时候发布?

2026年8月7日,根据Arena.ai在7月29日的公告,Arena排行榜结果预计将在下周公布。

是否有 Grok 4.6 的基准测试或规格?

不。截至目前,Grok 4.6 尚无官方规格、定价或基准测试数据。任何流传的确切数字在发布前都只是推测。

什么是Grok 4.5,它的前身?

xAI 于2026年7月8日推出的模型——一个混合专家系统,专为代理和编码工作调优,具有约54的人工分析智能指数、约83.3%的Terminal-Bench 2.1、约64.7%的SWE-Bench Pro,以及每百万个令牌约2/6美元的价格。

我现在可以使用 Grok 4.6 吗?

还没有——它尚未发布。今天就用Grok 4.5,它现在已经可用,包括通过OrcaRouter的OpenAI兼容端点。

如何确保我在第一天就能使用 Grok 4.6?

针对一个供应商中立、兼容OpenAI的端点进行构建,这样采用新模型就只是配置变更,而不是重新集成。

Grok 4.6 将在哪里进行独立评估?

在Arena上,它对实时代理会话中的模型进行排名——预计在8月7日发布后大约一周内。

底线

Grok 4.6已确认将于2026年8月7日发布,独立的Arena结果将在不久后公布——但其规格、定价和基准测试仍全部未知。坚实的基础在于其发展轨迹:Grok 4.5将xAI打造成编码代理领域的严肃竞争者,定价具有竞争力,并在Arena排名中不断攀升,而4.6正是这一发展轨迹上的下一步。现在就开始使用Grok 4.5,通过一个兼容OpenAI的端点(如OrcaRouter)保持您的集成供应商中立,然后让Arena的实时结果以及您自己的测试来决定,一旦Grok 4.6正式发布,应以多快的速度采用它。我们将在其发布后更新此文章。

本文中的对比1

根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新

© 2026 OrcaRouter

推理服务商

运营推理平台?让您的模型上线 OrcaRouter。

联系我们

加入我们的社区

DiscordEmailXGitHubYouTube