
Grok Bot:SpaceXAIのAI同僚たちが専用コンピュータを手に入れる
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100万トークンあたり
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- openaiOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- googleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- anthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1244知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0540知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0345知能76コーディング
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134知能69コーディング
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100万トークンあたり
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
2026年8月11日、SpaceXAIはGrok Botを早期ベータ版として公開した。これは、「AIは単に答えを返すだけでなく、ユーザーの作業を肩代わりすべきだ」という考え方に基づいて構築されたAIエージェント製品である。各Botはクラウド上に専用のコンピューターを持ち、チームがすでに利用しているGmail、CRM、Webアプリにサインインして、仕事をエンドツーエンドで完了させる。判断や承認が必要なときにだけ、ユーザーのもとに戻ってくるのだ。 10日後の8月21日、ベータ版の対象は最も高額な3つのプレミアムプランから、SuperGrok Plus、Cursor Pro+、およびすべてのCursor Teamsプランに拡大され、その他のユーザーには期間限定の無料トライアルが提供された。さらに8月26日には、SpaceXAIはプランによる制限を完全に撤廃した。同社はX上で、すべてのSuperGrokおよびCursor Proサブスクライバー(月額30ドルの基本プランと月額20ドルのCursor Proプランを含む)がGrok Botを利用できるようになり、全ユーザーの週間利用制限がリセットされたと発表した。 その1週間後の9月2日、SpaceXAIはGrok BotをAndroid向けに提供し、Google Playにこのエージェントを掲載した。基盤となっているモデルはGrok 4.5で、xAIが2026年7月8日にリリースした50万トークンのコンテキストを備えたフロンティアモデルであり、現在API経由で呼び出せるモデルと同じものだ。コンピューターを備えた製品と、思考を担うフロンティアモデルというこの組み合わせこそ、今回のローンチが単なるモデルリリースよりも興味深い理由である。
また、これはxAI–Cursorの合併から生まれた最初の製品でもある。SpaceXは2026年6月、Cursorの開発元であるAnysphereを600億ドルの株式交換で買収することに合意した。Grok 4.5はCursorの開発者データを用いて構築された最初のモデルであり、Grok Botは統合後のSpaceXAIによる最初のコブランド製品である。営業、マーケティング、オフィス運営、バグ修正といった社内プロトタイプとして始まったものは、今やAIエージェントをどう構築すべきかという同社の公の賭けとなっている。その賭けは明確だ。各エージェントにコンピューターを与え、人間と同じようにツールを使わせ、ノートパソコンを閉じても動き続けさせることだ。
Grok Botの正体
「AIチームメイトに実際の仕事を任せられる」というのはSpaceXAI自身の説明であり、重要なのはそのスローガンよりも仕組みです。すべてのBotはそれぞれ独自のクラウドコンピューター上で動作します。つまり、仕事が実際に行われるツールの中で直接ソフトウェアを操作できるということです。ウェブサイトを操作したり、情報を入力したり、ポータルを扱ったりするのも、人間が使うのと同じインターフェースを通じて行います。これは、大半のエージェントとは構造上の違いです。それらのエージェントは、特定のサービスに触れる前に、クリーンなAPIやMCPコネクタが存在している必要があります。Grok BotはWeb UIさえ存在していればよく、それだけです。ローンチ投稿にはこう明確に書かれています。「彼らはあなたのツールにサインインし、あなたと同じようにそれを使い、完了した作業を持って戻ってきます。」
2つの能力により、それはチャットボットというより、むしろ従業員のように感じられます。1つ目は「見て学ぶ」ことです。タスクを一度デモンストレーションすれば、Botがその手順を再利用可能なルーチンとして保存し、あなたの修正によって次回以降、同様の作業をどう扱うかを学習します。2つ目は「記憶」です。Botは会話をまたいで文脈を保持し、あなたの好みや仕事のスタイルを把握し、途切れたスレッドをフォローアップし、使い込むほどに積極的になります。SpaceXAIは、あなたの役割が常時オペレーターから監督者へとシフトすると捉えています。
それらはすべてベンダーによる報告であり、これは初日ベータ版なので、信頼性に関する主張はあくまで主張として扱うべきだ。複雑で多段階のワークフローでは、誰も無人で信頼できるようになるまでには、より広範なテストが必要になるだろう。しかし、その方向性は間違いなく明確だ。エージェントはあなたなしで動作することが期待されている。
基盤となるモデル: Grok 4.5
Grok Botがオーケストレーションを担い、Grok 4.5が思考を担う。Grok 4.5は、SpaceXAIが2026年7月8日にリリースしたフラッグシップモデルである。Cursorでトレーニングされた最初のモデルであり、約1.5兆パラメータのベース基盤を基に、実開発者のセッションデータ(デバッグトレース、複数ファイル編集、修正)から得られた数兆トークンで補完されている。その独立した評価数値は実力を示している。Artificial Analysis Intelligence Indexは約55.8、Coding Indexは72.4、50万トークンのコンテキストウィンドウを備え、SWE-bench Verifiedは86.6%という結果がvals.aiを通じて独立に報告されている。このモデルの価格は、入力100万トークンあたり2ドル、出力100万トークンあたり6ドルである。なお、知っておくべき長文脈の注意点として、プロンプトトークンが20万を超えると、xAIのティア制により料金は4ドル/12ドルに倍増する。これはリポジトリ全体をコンテキストに詰め込むエージェント実行にとっては、実際に考慮すべき要素である。

上記の段落のすべては、独立に測定されたものか、公表された価格のいずれかです。ベンダーが報告しただけで未再現のものは次のとおりです:Grok 4.5は「Opusクラスのモデルだが、より高速で、トークン効率が高く、コストが低い」というイーロン・マスクの主張、およびGrok 4.5は解決済みのSWE-bench Proタスクあたり平均で約15,954出力トークンであり、Claude Opus 4.8の67,020トークンに対応するというxAIの効率数値——これは4.2倍のトークン効率の優位性であり、それが成立するなら、より安いトークン単価と相まって、タスクあたりのコストに大きな格差を生む。それを主張として明示してください。
Grok Botが他のエージェントワークスペースとどう比較されるか
{{1}}Grok Bot{{/1}} が参入しようとしている分野には、すでに有力な製品がひしめいている: {{2}}Anthropic の Claude Cowork、OpenAI の ChatGPT Agent、Perplexity の Computer、そして Microsoft と Google が自社のスタックに組み込んできたアシスタント群だ{{/2}}。最も直接的な比較対象は {{3}}Claude Cowork{{/3}} で、こちらも {{4}}AI コワーカー{{/4}}として売り出しているが、両者はアーキテクチャに関して正反対の賭けに出ている。{{5}}Cowork はユーザー自身のマシン上のサンドボックス(Mac 上のコンテナ化された Linux 環境)で動作し、明示的にアクセスを許可したファイルに対して作業を行い、コネクタと Chrome 拡張機能を通じて外部サービスにアクセスする{{/5}}。{{6}}Grok Bot は自社が所有するクラウドコンピュータ上で動作し、ユーザーが使うのと同じ Web UI を通じてツールにアクセスするため、サービスごとの統合は不要だ{{/6}}。

このトレードオフは現実のものであり、明確に述べる価値がある。Coworkのローカルサンドボックスはファイルを自分のハードウェア上に保持するため、プライバシー上の利点がある。しかし、マシンがオフの間は動作し続けることができず、新しいサービスに接続するたびに、コネクタ、拡張機能、スクリプトといった統合が必要になる。Grok Botのクラウドコンピューターは24時間体制で動作し、あらゆるWebアプリにアクセスできる。だが、そこで扱われるデータはSpaceXAIのクラウドに置かれ、モデル全体が「自分のツールにサインインする」という仕組みだ——つまり、プロンプトインジェクション対策は後付けではなく、最優先のセキュリティ問題になる。AnthropicはCoworkについて、同じリスク区分があることを明確に述べてきた。Grok Botのアーキテクチャは、設計上そのリスクへとあえて踏み込んでいる。
料金、そしてサブスクリプションで実際に得られるもの
Grok Botには単独の価格設定はありません。アクセスはSuperGrokおよびCursorのサブスクリプションにバンドルされており、デスクトップ(Mac、Windows、Linux)、iOS、そして現在はAndroidで利用できます。Androidアプリは9月2日にGoogle Playでリリースされ、デスクトップ版やiOS版と同じアカウントと週次クォータを使用するため、モバイル専用のサブスクリプションは不要です。8月11日のベータ版開始時点では、アクセスは最も高額な3つのプラン(月額300ドルのSuperGrok Heavy、月額200ドルのCursor Ultra、1シートあたり月額120ドルのCursor Teams Premium)に限定されていました。8月21日、SpaceXAIはベータ版の対象を、月額100ドルのSuperGrok Plus、月額60ドルのCursor Pro+、そして月額課金の場合1ユーザーあたり月額40ドルのStandardからPremiumまでの全Cursor Teamsプランに拡大しました。その5日後、さらに拡大されました。Xでの同社の発表によると、すべてのSuperGrokおよびCursor Proのサブスクライバー(月額30ドルの基本SuperGrokプランと月額20ドルのCursor Proプランを含む)がBotアクセスを利用できるようになり、SpaceXAIはベータ版のテスト参加者プールの拡大に伴い、全ユーザーの週次利用制限をリセットしました。これらのサブスクリプションに加入していないユーザーには、引き続き利用制限付きの無料トライアルが提供されます。これは、メッセージ数ではなくエージェントステップとトークンによって消費される、7日間の有効期限付きの利用クレジットです。エンタープライズ版はまだ「近日公開」とされており、ウェイトリストへの登録を受け付けています。単品での価格設定もまだありません。
製品をモデルから切り離して考えると、その価格設定が重要になります。サブスクリプションが購入しているのはオーケストレーション層、つまりクラウドコンピュータ、マルチボットの調整、メモリとルーチンのシステムであり、単なるトークンではありません。Grok 4.5 をAPI経由で生のまま計測すると、100万トークンあたり2ドル/6ドルになりますが、60ドルのCursor Pro+のシートでも大量のトークンをカバーできます。しかし、APIの価格が買うのはモデルであって、同僚やコンピュータ、チームチャットではありません。これらは異なる価格設定がされた異なる製品であり、どちらを望むかは、価値がオーケストレーションにあるのか、生の推論にあるのかによって決まります。
それがお望みのモデルなら、Grok 4.5はOrcaRouterで、xAIの定価をマークアップなしでそのままパススルーした価格で利用できます。500Kのコンテキストウィンドウでトークン100万件あたり2ドル/6ドル、200以上の他のモデルと同じOpenAI互換エンドポイント上で動作します。価格はパススルーなので、xAIの値下げは同じ日に請求へ反映されます。そして価値提案は価格だけにとどまりません。Grok 4.5をエージェントワークロードの安価で高ボリュームな処理にルーティングしたり、リクエストがリスクに見える場合やプロバイダーが失敗した場合に自動的に別のモデルへフェイルオーバーしたり、ルーティングDSLを使用してGrok 4.5を2番目のモデルと単一の呼び出しで構成したりできます。このローンチから「Grokを搭載したエージェントが欲しい」と思ったなら、サブスクリプションなしで構築を始められます。その背後にあるエンジンは今日から呼び出し可能です。

何を見るべきか
• エンジンは予定どおり新しくなった: Grok 4.6 は2026年8月12日にリリースされた — 同社が示していた8月10日〜14日の期間内だ。Grok 4.5 の100万トークンあたり2ドル/6ドルの料金と50万トークンのコンテキストを維持し、xAI のリリースノートによると、自己検証(長いエージェント実行中に自身の作業をチェックすること)が追加されている。これはまさに Grok Bot が依存する信頼性の面である。製品がすでに Grok 4.6 に移行されているかどうかは確認されていない。Grok 4.7 は、約2.1兆パラメータとされ、数週間後に続くとされている。
展開は急速に進んでいる。ベータ版が最も高額な3つのティアの背後で開始されてから10日後、アクセスはSuperGrok Plus、Cursor Pro+、およびすべてのCursor Teamsプランに拡大された。買収は正式に8月14日に完了し、Cursorのサブスクライバーベースが明らかに流通チャネルとして機能している。さらに5日後の8月26日には、ティアの壁は完全に撤廃された。SpaceXAIはX上で、すべてのSuperGrokおよびCursor Proサブスクライバー(基本ティアを含む)がアクセスできるようになり、全員の週次利用制限をリセットしたと発表した。エージェントのステップ数とトークンで計測され、7日間のウィンドウを持つ無料トライアルは、非サブスクライバー向けのサンプラーとして機能する。拡大されたベータ版が有料シートに転換するかどうかは、需要の最初の真の試練のひとつとなる。依然としてゲートされているのは、無料ティアとエンタープライズのウェイティングリストである。
プラットフォーム対応はほぼ完了した。Grok Botの8月11日ベータ版はデスクトップとiOSで提供され、9月2日にはAndroid対応となり、Google PlayでAndroid 9以降向けに公開された。以前からモバイルアプリ内に隠されたGrok-Botの項目を発見していたTestingCatalogがこの登場を報じ、同日にSpaceXAIがX上で発表して確認された。ローンチ時に提供されたiOSコンパニオンアプリと同様に、Androidアプリは実質的にBotのクラウドコンピュータ用リモコンである。ユーザーはBotにメッセージを送ったり、タスクの実行を監視したり、人間の承認が必要なアクションをスマートフォンから承認したりできる。その間も作業はクラウド上で実行され続ける。Androidに対応したことで、残る関門はエンタープライズ向けプランだ。そして本格的な企業顧客は、会社のGmailにログインするエージェントを信頼する前に、データの保存場所と管理者向け管理機能を確認するのを待つだろう。
{{1}}クラウドコンピュータ方式が実際のセキュリティ要件との接触に耐えられるかどうか。{{/1}}{{2}}あなたのツールにサインインするエージェントは格好の標的です。{{/2}}{{3}}賭けは、エージェントに専用のコンピュータを与え、それに付随する監視ツールを備えることが、{{/3}}{{4}}無人で作業させる正しい方法だということです。{{/4}}{{5}}ベータ版がその試金石です。{{/5}}
正直なまとめはこうだ:Grok Botは、AIエージェントはより賢いチャットボットではなく、それぞれ独自のコンピューターを持つ同僚であるという賭けを製品化したものだ。その基盤となるモデル——Grok 4.5——は本物であり、独立したベンチマークで評価され、すでにAPIで呼び出し可能だ。この製品がサブスクリプションの価値があるかどうか——参入ハードルはSuperGrok Heavyの300ドルから、20ドルのCursor Pro、30ドルのSuperGrokシート、あるいは無料トライアルに引き下げられた——は、拡大されたベータ版が答えを出すべき問いだ。モデルを使う価値があるかどうかは、すでに答えが出ている。
この記事で比較したモデル2
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
