
Grok Bot:SpaceXAI的AI同事获得专属电脑
- Orca新Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 每百万 tokens
- orca新Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百万 tokens
- deepseek新DeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- openaiOpenAI: GPT-6 Astra2026-09-0453智能77代码
- googleGoogle: Gemini 3.8 Flash2026-09-0241智能76代码
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245智能76代码
- anthropicAnthropic: Claude Fable 5.12026-09-0153智能82代码
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百万 tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72代码
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百万 tokens
- z-aiZ.ai: GLM 5.32026-08-1845智能75代码
- obsidianQwen3.8 27B2026-08-1534智能68代码
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69代码
- grokSpaceXAI: Grok 4.62026-08-1244智能77代码
- metaMeta: Muse Spark 1.22026-08-0540智能72代码
- qwenQwen: Qwen3.8 Max2026-08-0345智能76代码
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134智能69代码
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百万 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
2026年8月11日,SpaceXAI将Grok Bot投入早期测试版:这款AI代理产品基于这样一个理念——AI不应只是回答你的问题,而应为你分担工作。每个Bot在云端拥有自己专用的计算机,可登录你的团队已经在使用的Gmail、CRM和网页应用,并端到端地完成工作任务——仅在需要决策或审批时才回来找你。十天后,即8月21日,测试版从三个最昂贵的付费层级扩展到SuperGrok Plus、Cursor Pro+以及所有Cursor Teams计划,并为其他用户提供有限的免费试用。随后,在8月26日,SpaceXAI完全取消了层级限制:该公司在X上宣布,所有SuperGrok和Cursor Pro订阅用户——包括30美元/月的基础层级和20美元/月的Cursor Pro层级——现在都可使用Grok Bot,且所有用户的每周使用限额已重置。一周后,即9月2日,SpaceXAI将Grok Bot带到Android平台,在Google Play上架了该代理。底层模型是Grok 4.5,即xAI于2026年7月8日发布的500K上下文前沿模型,也是你今天可以通过API调用的同一模型。这种组合——一个拥有计算机的产品,加上一个进行思考的前沿模型——正是这次发布比又一款模型发布更有趣的原因。
这也是xAI与Cursor合并后推出的首款产品。SpaceX于2026年6月同意以600亿美元股票收购Cursor制造商Anysphere;Grok 4.5是首个利用Cursor开发者数据构建的模型,而Grok Bot则是合并后的SpaceXAI推出的首款联名产品。最初只是用于销售、营销、办公室运营和漏洞修复的内部原型,如今已成为该公司在AI代理构建方式上的公开押注。这一押注很具体:给每个代理一台电脑,让它像人一样使用你的工具,并在你合上笔记本电脑后继续工作。
Grok Bot 实际上是什么
「你可以把真正的工作交给它们的AI队友」是SpaceXAI自己的描述,但机制本身比口号更重要。每个Bot都在自己的云端计算机上运行,因此可以直接在实际工作的工具内部操作软件——浏览网站、输入信息、操作门户——使用与人类相同的界面。这正是它与大多数代理的架构差异;那些代理需要先有干净的API或MCP连接器,才能接入特定服务。Grok Bot只需要Web界面存在,仅此而已。发布帖说得很直白:「它们登录你的工具,像你一样使用这些工具,然后带着完成的工作回来。」
两项能力让它不再像聊天机器人,而更像一名员工。第一项是通过观察学习:你演示一次任务,Bot 将步骤保存为可复用的流程,而你的纠正会教会它下次如何处理类似工作。第二项是记忆——Bots 能跨对话保留上下文,了解你的偏好和工作方式,跟进沉寂的讨论串,使用越久就越主动。SpaceXAI 的定位是,你的角色从持续操作者转变为监督者。
所有这些都是供应商自行报告的,而且这是上线第一天的测试版,因此应将这些可靠性声明仅视为声明。在复杂的多步骤工作流中,该产品需要更广泛的测试,之后才能让人信任它可以无人值守运行。不过,方向已明确无误:智能体预计将在无需你参与的情况下运行。
底层模型:Grok 4.5
Grok Bot负责编排;Grok 4.5负责思考。Grok 4.5是SpaceXAI于2026年7月8日发布的旗舰模型——首个使用Cursor训练的模型,基于约1.5万亿参数的底层基础构建,并辅以数万亿token的真实开发者会话数据:调试轨迹、多文件编辑和修正。其独立评测数据经得起检验:人工智能分析智能指数(Artificial Analysis Intelligence Index)约为55.8,编码指数(Coding Index)为72.4,拥有50万token的上下文窗口,SWE-bench Verified达到86.6%,该数据由vals.ai独立报告。该模型定价为每百万输入token 2美元、每百万输出token 6美元,但有一个值得了解的长上下文变数:当提示词token超过20万时,xAI的分级定价会将上述费率翻倍至4美元/12美元——对于将整个代码仓库塞入上下文的代理运行来说,这是一个切实需要考虑的因素。

上面段落中的每一项要么是独立测量的结果,要么是已公布的价格。以下内容属于供应商自报且未经复现:埃隆·马斯克声称 Grok 4.5 是“一款 Opus 级模型,但速度更快、token 效率更高、成本更低”,以及 xAI 的效率数据——Grok 4.5 平均每个已解决的 SWE-bench Pro 任务消耗约 15,954 个输出 token,而 Claude Opus 4.8 为 67,020 个,即 4.2 倍的 token 效率优势;如果该优势成立,叠加更低的单位 token 价格,将形成巨大的单任务成本差距。请将其标注为一种说法。
Grok Bot 与其他代理工作区的对比情况
Grok Bot 正在进入一个已有众多强劲对手的领域:Anthropic 的 Claude Cowork、OpenAI 的 ChatGPT Agent、Perplexity 的 Computer,以及微软和谷歌一直在向自家技术栈中推广的助手产品。最直接的对比对象是 Claude Cowork,它同样将自己定位为 AI 同事,而两者在架构上做出了截然不同的押注。Cowork 运行在你本地机器的沙盒中——即 Mac 上的容器化 Linux 环境——处理你明确授权访问的文件,并通过连接器和 Chrome 扩展程序访问外部服务。Grok Bot 则运行在它自有的云端计算机上,通过你所使用的同一套 Web 界面来访问你的工具,无需针对每个服务进行单独集成。

这个权衡是真实存在的,值得直说。Cowork 的本地沙箱将你的文件保存在自己的硬件上,这是一个隐私优势,但当你的机器关机时它无法继续工作,而且它需要集成——连接器、扩展或脚本——才能接入每一个新服务。Grok Bot 的云端计算机全天候运行,可以触达任何 Web 应用,但它处理的数据存放在 SpaceXAI 的云端,而且整个模式就是“登录我的工具”——这使得提示注入防护成为首要的安全问题,而不是事后才想起来的补充。Anthropic 对 Cowork 面临的同类风险已经表达得很明确;而 Grok Bot 的架构则是刻意向这种风险倾斜。
定价,以及订阅实际能买到什么
Grok Bot 没有独立定价。其访问权限捆绑在 SuperGrok 与 Cursor 订阅中,支持桌面端(Mac、Windows、Linux)、iOS,现在也支持 Android——Android 应用已于 9 月 2 日上架 Google Play,与桌面端和 iOS 应用共用同一账户和每周配额,无需单独的移动订阅。在 8 月 11 日的测试版发布中,访问权限仅限最贵的三个档位:SuperGrok Heavy(每月 300 美元)、Cursor Ultra(每月 200 美元)和 Cursor Teams Premium(每席位每月 120 美元)。8 月 21 日,SpaceXAI 将测试范围扩大到 SuperGrok Plus(每月 100 美元)、Cursor Pro+(每月 60 美元)以及所有 Cursor Teams 套餐——从按月计费、每用户每月 40 美元的 Standard,一直到 Premium。五天后又再次扩大:根据该公司在 X 上的公告,所有 SuperGrok 与 Cursor Pro 订阅者现在都拥有 Bot 访问权限——包括每月 30 美元的基础 SuperGrok 档位和每月 20 美元的 Cursor Pro 档位——同时随着测试版测试人群的扩大,SpaceXAI 还重置了所有用户的每周使用上限。上述订阅之外的用户仍可享受限量免费试用——一笔七天内有效的用量额度,按智能体步数和令牌数消耗,而非按消息数计算。企业版仍显示为“即将推出”,候补名单开放中,此外仍然没有单独定价。
当你把产品与模型区分开来看时,定价就变得至关重要。订阅购买的是编排层——云计算机、多智能体协调、记忆与日常系统——而不仅仅是token。按Grok 4.5原始API每百万token $2/$6计量,即使是$60的Cursor Pro+席位也覆盖了大量的token;但API价格买到的是模型本身,而不是协作者、计算机或团队聊天。它们是定价方式不同的不同产品,你选择哪一个,取决于价值究竟在于编排层还是在于原始推理。
如果你想要的是这个模型,Grok 4.5 现已在 OrcaRouter 上提供,按 xAI 官方定价原价转售,不加任何加价——每百万 token 2 美元/6 美元,支持 500K 上下文窗口,并与 200 多个其他模型一样使用同一 OpenAI 兼容端点。由于价格是转售直通,xAI 一旦降价,你的账单当天就会体现。而它的价值主张不止于价格:你可以将 Grok 4.5 路由到智能体工作负载中廉价、高吞吐的调用,当请求看起来有风险或某个供应商出问题时自动故障转移到另一个模型,还可以使用路由 DSL 在单次调用中将 Grok 4.5 与第二个模型组合使用。如果你从这次发布中得到的信息是“我想要一个由 Grok 驱动的智能体”,那么你不需要订阅就能开始构建——它背后的引擎今天就可调用。

看什么
• 引擎按计划更新换代:Grok 4.6于2026年8月12日发布——正处于公司此前预告的8月10日至14日窗口期内。它延续了Grok 4.5每百万token 2美元/6美元的定价和50万token的上下文窗口,并且根据xAI的发布说明,新增了自我验证功能:在长时间智能体运行过程中检查自身的输出,而这正是Grok Bot所依赖的可靠性层面。该产品是否已经迁移到Grok 4.6上尚未得到确认。据称参数规模约2.1万亿的Grok 4.7预计将在几周后跟进发布。
• 这次上线推进得很快。Beta 最初只对三个最贵的套餐推出,十天后,访问范围扩大到 SuperGrok Plus、Cursor Pro+ 以及所有 Cursor Teams 套餐——收购于 8 月 14 日正式完成,而 Cursor 的订阅用户群体显然正在充当分发渠道。又过了五天,也就是 8 月 26 日,套餐门槛被完全移除:SpaceXAI 在 X 上宣布,所有 SuperGrok 和 Cursor Pro 订阅用户(包括基础套餐用户)现在都可以使用,并重置了每个人的每周用量限额。免费试用按 Agent 步数和 token 计量,有效期为七天,对非订阅者起到试用样品的作用;至于这次扩大范围的 Beta 能否转化为付费用户,是对需求最早的真正检验之一。目前仍然设有门槛的是免费套餐和企业版等待名单。
• 平台覆盖已几乎完成闭环。Grok Bot 于 8 月 11 日推出的测试版覆盖桌面端和 iOS;9 月 2 日,应用登陆 Android,在 Google Play 上架,支持 Android 9 及以上版本。此前曾在移动应用中发现隐藏 Grok-Bot 入口的 TestingCatalog 标记了这次上线,SpaceXAI 在 X 上的公告当天也予以确认。与发布时同步推出的 iOS 配套应用一样,Android 应用实际上就是 Bot 云计算机的遥控器:你可以给 Bot 发消息、观看任务运行,并在工作持续于云端执行的同时,在手机上批准需要人工介入的操作。Android 版既已推出,企业版便成了剩下的最后一道门槛——而一个严肃的企业客户会先观望数据驻留位置和管理员控制能力,然后才会信任一个需要登录公司 Gmail 的智能体。
• 云计算机方案能否经受真实安全要求的考验。会登录你工具的智能体是一个高价值目标。押注在于,给智能体配备它们自己的计算机——以及配套的监督工具——是让它们无人值守工作的正确方式。Beta版就是检验。
诚实的总结是:Grok Bot 是这一赌注的产品化版本——AI 智能体是拥有自己电脑的同事,而不是更聪明的聊天机器人。底层的模型 Grok 4.5 是真实的,经过独立基准测试,并且已经可以通过 API 调用。产品是否值得订阅——入门门槛现已从 SuperGrok Heavy 的 300 美元降至 20 美元的 Cursor Pro 或 30 美元的 SuperGrok 席位,或免费试用——是扩大后的测试版需要回答的问题;而模型是否值得使用,答案已经明了。
本文中的对比2
根据本文内容识别 · 基准测试:Artificial Analysis · 每日更新
