
Grok Bot:SpaceXAI 的 AI 同事獲得他們自己的電腦
- Orca新Orca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 每百萬 tokens
- orca新Orca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 每百萬 tokens
- deepseek新DeepSeek: DeepSeek V4.1 Flash2026-09-1040智能
- openaiOpenAI: GPT-6 Astra2026-09-0453智能77程式
- googleGoogle: Gemini 3.8 Flash2026-09-0241智能76程式
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245智能76程式
- anthropicAnthropic: Claude Fable 5.12026-09-0153智能82程式
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 每百萬 tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642智能72程式
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 每百萬 tokens
- z-aiZ.ai: GLM 5.32026-08-1845智能75程式
- obsidianQwen3.8 27B2026-08-1534智能68程式
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236智能69程式
- grokSpaceXAI: Grok 4.62026-08-1244智能77程式
- metaMeta: Muse Spark 1.22026-08-0540智能72程式
- qwenQwen: Qwen3.8 Max2026-08-0345智能76程式
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134智能69程式
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 每百萬 tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
2026年8月11日,SpaceXAI將Grok Bot推出為早期測試版:這是一款AI代理產品,核心理念是AI不應該只是回答你的問題,更應該替你分擔工作。每個Bot在雲端都有自己的專屬電腦,會登入你的團隊已經在使用的Gmail、CRM與網頁應用程式,並端到端地完成任務——只有在需要決策或核准時才會回來找你。十天後,也就是8月21日,測試版原本僅限於三個最昂貴的付費等級,如今擴大至SuperGrok Plus、Cursor Pro+,以及所有Cursor Teams方案,其他人也可獲得有限免費試用。接著,8月26日,SpaceXAI完全移除了等級門檻:公司於X上宣布,所有SuperGrok與Cursor Pro訂閱者——包括每月30美元的基礎等級與每月20美元的Cursor Pro等級——現在都能使用Grok Bot,且所有使用者的每週用量上限都已重置。一週後,也就是9月2日,SpaceXAI將Grok Bot帶到Android,並在Google Play上架這個代理。底層模型是Grok 4.5,也就是xAI於2026年7月8日推出的500K上下文前沿模型,也是你今天可以透過API呼叫的同一個模型。這樣的組合——產品擁有一台電腦,加上一個前沿模型負責思考——正是這次發布比單純推出另一個模型更有意思的原因。
這也是在xAI與Cursor合併後推出的首款產品。SpaceX於2026年6月同意以600億美元股票收購Cursor的開發商Anysphere;Grok 4.5是首款利用Cursor開發者資料打造的模型,而Grok Bot則是合併後的SpaceXAI推出的首款聯名產品。最初只是內部原型——涵蓋銷售、行銷、辦公室營運、程式除錯——如今已成為該公司對AI代理應如何建構的公開賭注。這個賭注非常明確:給每個代理一台電腦,讓它像人一樣使用你的工具,並讓它在你不使用時繼續工作。
Grok Bot 到底是什麼
「可以託付實際工作的 AI 隊友」是 SpaceXAI 自己的描述,而運作機制比口號更重要。每個 Bot 都運行在自己的雲端電腦上,這意味著它可以直接在實際執行工作的工具內部操作軟體——瀏覽網站、輸入資訊、操作入口網站——透過人類會使用的相同介面。這就是它與大多數 agent 在架構上的差異,後者需要先有乾淨的 API 或 MCP 連接器,才能接觸特定服務。Grok Bot 只需要網頁介面存在,僅此而已。發布文章說得很直白:「它們登入你的工具,像你一樣使用它們,然後帶著完成的工作回來。」
兩項能力讓它感覺不像聊天機器人,而更像一名員工。第一是透過觀看來學習:你示範一次任務,Bot 會將步驟儲存為可重複使用的例行程序,而你的修正則教會它下次如何處理類似的工作。第二是記憶力——Bot 能跨對話保留上下文,了解你的偏好與工作風格,追蹤沉寂的討論串,而且使用越久,它就會越主動。SpaceXAI 的觀點是,你的角色會從持續操作的執行者,轉變為監督者。
這些都是廠商通報的數據,而這是第一天推出的測試版,所以請把可靠性聲稱當作「聲稱」看待就好。在複雜的多步驟工作流程中,這個產品需要更廣泛的測試,別人才會放心讓它無人監督地運行。不過,方向已經很明確了:這個代理程式本來就預期要在沒有你介入的情況下運作。
底層模型:Grok 4.5
{{1}}Grok Bot 負責編排;Grok 4.5 負責思考。{{/1}} {{2}}Grok 4.5 是 SpaceXAI 於 2026 年 7 月 8 日發佈的旗艦模型{{/2}}——{{3}}這是首個使用 Cursor 訓練的模型,建立在約 1.5 兆參數的基礎架構之上,並輔以數兆 token 的真實開發者工作階段資料:除錯軌跡、多檔案編輯與修正。{{/3}} {{4}}其獨立數據經得起檢驗:Artificial Analysis 智能指數約 55.8、編碼指數 72.4、50 萬 token 的上下文視窗,以及經由 vals.ai 獨立報告的 SWE-bench Verified 86.6%。{{/4}} {{5}}該模型定價為每百萬輸入 token 2 美元、每百萬輸出 token 6 美元,但長上下文有一個值得注意的轉折:{{/5}} {{6}}當提示詞 token 超過 20 萬時,xAI 的階梯定價會將上述費率加倍至 4/12 美元{{/6}}——{{7}}對於將整個儲存庫塞入上下文的代理執行而言,這是實際需要考量的因素。{{/7}}

以上段落中的所有內容,不是獨立測量所得,就是已公開發布的價格。屬於供應商回報且未被再現驗證的,是馬斯克宣稱 Grok 4.5 為「Opus 級別的模型,但速度更快、token 效率更高且成本更低」,以及 xAI 的效率數據:Grok 4.5 在每個已解決的 SWE-bench Pro 任務上平均產生約 15,954 個輸出 token,而 Claude Opus 4.8 則為 67,020 個——這是一個 4.2 倍的 token 效率優勢,若屬實,將與更低的單位 token 價格疊加,形成巨大的每任務成本差距。請如實將其標記為未經證實的主張。
Grok Bot 與其他代理工作空間的比較
Grok Bot 正在進入一個已有強勁對手的領域:Anthropic 的 Claude Cowork、OpenAI 的 ChatGPT Agent、Perplexity 的 Computer,以及 Microsoft 和 Google 一直推入其產品組合中的助理功能。最直接的比較對象是 Claude Cowork,它也將自己定位為 AI 同事,兩者採取了相反的架構策略。Cowork 在你自己的機器上的沙盒中運行——也就是你 Mac 上的一個容器化 Linux 環境——並且只處理你明確授予存取權限的檔案,透過連接器和 Chrome 擴充功能來存取外部服務。Grok Bot 則運行在它擁有的雲端電腦上,並透過你日常使用的相同網頁介面來存取你的工具,無需逐一整合各項服務。

這個取捨是真實存在的,也值得明說。Cowork 的本地沙盒將你的檔案保存在你的硬體上,這是隱私上的優勢,但當你的機器關機時,它就無法繼續運作,而且每當要連接一項新服務,都需要某種整合——連接器、擴充套件或腳本。Grok Bot 的雲端電腦則全天候運作,可以觸及任何網路應用程式,但它所處理的資料存放在 SpaceXAI 的雲端,而且整個模式就是「登入我的工具」——這使得提示注入防護成為第一優先的安全問題,而不是事後才想到的附加項。Anthropic 已明確指出 Cowork 存在同樣的風險類型;Grok Bot 的架構則是打從設計之初就刻意迎向這種風險。
定價,以及訂閱實際能獲得的內容
Grok Bot 沒有獨立定價。其存取權隨 SuperGrok 與 Cursor 訂閱提供,適用於桌面(Mac、Windows、Linux)、iOS,現在也支援 Android——Android 應用程式於 9 月 2 日上架 Google Play,並與桌面版及 iOS 版共用相同的帳戶與每週配額,無需額外的手機訂閱。Beta 版於 8 月 11 日推出時,僅限三個最高價位方案使用:SuperGrok Heavy 每月 300 美元、Cursor Ultra 每月 200 美元,以及 Cursor Teams Premium 每個席位每月 120 美元。8 月 21 日,SpaceXAI 將 Beta 版擴大至 SuperGrok Plus(每月 100 美元)、Cursor Pro+(每月 60 美元),以及所有 Cursor Teams 方案——從按月計費、每個使用者每月 40 美元的 Standard,一直到 Premium。五天後再次擴大:根據該公司在 X 上的公告,所有 SuperGrok 與 Cursor Pro 訂閱者現在都能使用 Bot,包括每月 30 美元的基礎 SuperGrok 方案與每月 20 美元的 Cursor Pro 方案;同時 SpaceXAI 重置了所有使用者的每週使用限制,因為 Beta 版的測試者規模正在擴大。上述訂閱以外的使用者仍可享有有限用量的免費試用——七天有效期的用量額度,按代理步驟和 token 消耗扣減,而非按訊息數計算。企業版仍標示為「即將推出」,並開放等候名單,且依然沒有單獨購買的價格。
當你把產品與模型分開來看時,定價就顯得重要。訂閱買的是編排層——雲端運算、多機器人協調、記憶與例行程序系統——而不只是 token。透過 API 以每百萬個 token $2/$6 的價格計量原始 Grok 4.5,即使是 $60 的 Cursor Pro+ 席位也能涵蓋大量 token 用量;但 API 價格買的是模型,而不是協作夥伴、電腦或團隊聊天。它們是定價方式不同的不同產品,而你想要哪一個,取決於價值是在編排層還是在原始推理能力。
{{1}}如果您要的就是這個模型,Grok 4.5 現已在 OrcaRouter 上提供,以 xAI 的牌價轉售、零加價——每百萬 tokens 收費 $2/$6,具備 500K 上下文視窗,並與其他 200 多個模型一樣,在同一個 OpenAI 相容端點上提供。{{/1}}{{2}}由於價格是直接轉售,xAI 一降價,當天就會反映在您的帳單上。{{/2}}{{3}}而價值主張不止於價格:您可以將 Grok 4.5 路由到代理工作負載中低成本、高流量的環節,當請求看似有風險或供應商出狀況時,自動容錯切換到另一個模型,並使用路由 DSL 在單一呼叫中將 Grok 4.5 與第二個模型組合。{{/3}}如果您從這次發布中得到的結論是「我想要一個由 Grok 驅動的 agent」,您不需要訂閱就能開始建置——它背後的引擎今天就可以呼叫。

看什麼
• 引擎如期更新:Grok 4.6 於 2026 年 8 月 12 日推出——落在公司先前預告的 8 月 10 日至 14 日時間窗內。它維持 Grok 4.5 的每百萬 token 2 美元/6 美元定價與 500K 上下文長度,且根據 xAI 的發行說明,新增了自我驗證功能:在長時間的代理式運行中檢查自身輸出,這正是 Grok Bot 所依賴的可靠性層面。該產品是否已遷移至 Grok 4.6 尚未獲得證實。而號稱約 2.1 兆參數的 Grok 4.7,據稱將在幾週後接著推出。
此次發布推進迅速。在測試版最初僅限三個最高價位方案推出十天後,存取權擴大至 SuperGrok Plus、Cursor Pro+ 及所有 Cursor Teams 方案——該收購於8月14日正式完成,Cursor 的訂閱用戶群明顯成為發行通路。五天後的8月26日,方案門檻完全取消:SpaceXAI 在 X 上宣布,所有 SuperGrok 與 Cursor Pro 訂閱者(包含基本方案)現在都可使用,並為所有人重置了每週用量限制。免費試用以 agent 步驟和 token 計量,有效期限七天,為非訂閱者提供試用樣本;而擴大的測試版能否轉化為付費席位,是需求的首批真實考驗之一。目前仍受限的是免費方案與企業候補名單。
• 平台覆蓋已近乎完整。Grok Bot 的 8 月 11 日測試版在桌面與 iOS 上運行;9 月 2 日,該應用程式登上 Android,在 Google Play 上架,適用於 Android 9 及以上版本。TestingCatalog——先前曾在行動應用程式中發現隱藏的 Grok-Bot 條目——率先揭露了這次上架,SpaceXAI 在 X 上的公告也在同日證實此事。與上市時同步推出的 iOS 配套應用程式一樣,Android 應用程式實質上是 Bot 雲端電腦的遙控器:你可以傳訊息給 Bot、觀看任務執行,並在手機上核准需要真人介入的動作,同時工作持續在雲端執行。Android 版問世後,企業版成了最後一道門檻——而認真的企業客戶會先觀望資料落地與管理員控管功能,才會放心信任一個會登入公司 Gmail 的代理程式。
• 雲端電腦的做法能否經受真實安全要求的考驗。一個登入你工具的代理程式是極具吸引力的攻擊目標。押注在於:給代理程式專屬的電腦,以及配套的監督工具,是讓它們在無人看管下工作的正確方式。這個測試版就是考驗。
誠實的總結是這樣的:Grok Bot 是這個賭注的產品化版本——AI 代理是擁有自己電腦的同事,而不是更聰明的聊天機器人。底層模型 Grok 4.5 是真實的,經過獨立基準測試,並且已經可以透過 API 呼叫。這個產品是否值得訂閱——入門門檻現在已從 SuperGrok Heavy 的 300 美元降到 20 美元的 Cursor Pro 席次、30 美元的 SuperGrok 席次,或是免費試用——是擴大後的 Beta 測試必須回答的問題;至於模型是否值得使用,答案已經很清楚了。
本文中的比較2
根據本文內容識別 · 基準測試:Artificial Analysis · 每日更新
