エージェント支出が毎月のハード上限で頭打ちとなり、カードが拒否される様子を示すチャート
Guides & Insights

常時稼働は常時コストを意味する:Grokボットチームのコスト管理

著者

Alistair Wren

公開日

最新モデル · 20すべてのモデルを見る
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

ラップトップを閉じると動作を停止するエージェントには、自然な支出制限があります。それはあなたの注意です。あなたが就寝した後も動き続けるように設計されたエージェントには、そのような制限はありません。それがGrok Botがあなたに求めるトレードであり、コストの問題が料金ページを一目見ただけでは済まない理由です。正直な測定単位はシートあたりのドルではなく、無人で稼働するエージェント1日あたりのドルです。OrcaID事前登録はその答えの1つです。つまり、各エージェントに、あなたの分け前ではなく、独自の資金が入った上限付き残高を与えるのです。

SpaceXAIは2026年8月11日にGrok Botを発表し、アクセスは既存の有料サブスクリプション階層にバンドルされている — 同社の発表によれば、SuperGrok PlusおよびHeavy、Cursor Pro+およびUltra、Cursor Teams StandardおよびPremium — メーター制のエージェント時間として販売されるのではなく。このバンドルは便利だが、何かを隠している:サブスクリプションはボットを実行する権利を買うものであり、実行中にそれらのボットが消費するものに上限を設けるものではない。エージェントが真に常時稼働する瞬間、これら二つの数字は乖離する。

常時稼働エージェントの3つのコスト面

エージェントの価格設定に関する報道は、すべてをひとつの数字にまとめる傾向がある。実際には、無人稼働エージェントは3つの別々の面でコストが発生し、ベンダーの価格ページに表示されるのはそのうち最初の1つだけである。

サブスクリプション。アクセスに対する定額料金。予測可能だが、それ自体は情報量が乏しい。

推論。エージェントが行動するたびにトークンを消費する。常時稼働のコストが積み上がるのはまさにこの点だ。つまり、ポーリングやリトライ、自身のメモリの再読取、各行動前の推論を行うエージェントは、人間がプロンプトで指示するチャットに比べ、有用な作業あたりの推論量がはるかに多い。OpenClawは無料ソフトウェアであり、サブスクリプションがコストを隠していないからこそ、この点が明確に見える。第三者による見積もりでは、軽い利用で月額5〜20ドル、ヘビーな利用で100ドル以上、すべてモデル呼び出しにかかる費用とされている。Grok Botの推論はサブスクリプションに含まれているため、同じ変動は存在するものの、それを目にすることはできない。

現実の世界。これは誰も値付けしない表面だ。SpaceXAIは、従業員がGrok Botを営業アウトリーチ、マーケティングキャンペーン、オンボーディング、オフィス業務に使用したと述べている。アウトリーチとはメール送信件数を意味する。キャンペーンとは広告費を意味する。オフィス業務とは物を購入することを意味する。既に使用しているツールにサインインするエージェントは、それらのツールが既に持っている支払い方法を通じて支出も行う。

3つ目のサーフェスは、本当に不快な数字を生み出し得るものであり、最も弱い制御しか持たないものです。なぜなら、それは実際には「エージェント支出」ではないからです——それは、エージェントが関与していることを認識しないベンダーの請求システム内で、ソフトウェアによって使用される、あなたのカードなのです。

Grok Bot announcement describing a cloud computer of its own.

シート単位の価格設定とエージェント単位の支出がなぜ一致しないのか

サブスクリプションの料金プランは個人単位で価格設定されています。人は8時間働き、睡眠をとり、週末を休みます。価格モデルはその形を前提としています。

Grok Botは、その形を一度に2つの方向で明確に打ち破ります。縦方向には、ボットは24時間稼働します。SpaceXAIの捉え方では、ボットは人間の判断が必要な何かがあるときにだけあなたのもとに戻ってきます。つまり、デフォルトの状態は待機ではなく稼働です。横方向には、それはチームです。複数のボットが並行して動き、1つが他を管理し、さまざまなタスクを担当する専門ボットたちがグループチャットで調整しながら、互いに作業を受け渡ししていきます。

それらを掛け合わせてください。1つのシートが、それぞれ1日の大半を稼働する複数のエージェントに対応できるようになりました。サブスクリプションのコストがどうであれ、実際にリソースを消費しているものを追跡しているわけではありません。そして、複数のボットが1つの人間のアイデンティティを共有する場合、第三のサーフェスで発生した支出は、1枚のカード、1つの明細書にまとめて届き、どのエージェントがどの明細を発生させたのかを区別するものは何もありません。

この最後の点が、実務上の失敗です。総額が高いからではありません。それを分解できないからです。エージェントチームによる40件の請求がすべてあなたの名義で載っている毎月のカード明細は、支払うことはできても管理できない数字です。どの専門ボットが非効率なのか、どのタスクが採算に合わないのか、あるいは5つのうちの1つがループしているのかを、見分けることはできません。

「二度と晴れない」が実際に意味していること

orcaid.ai上に小さな活字のように読める一文があり、それはページ上で最もコストに関わるものです:資金は使われる前に確保され、何も二重に清算されることはありません

リトライは、自律エージェントが障害に対処するための手段である。あるステップがタイムアウトすると、エージェントは再試行する。これはページの読み取りにとっては正しい動作だが、支払いにとっては危険な動作である。「リクエストの失敗」と「レスポンスの喪失」を区別できない無人エージェントは再送信を行い、その前に冪等性レイヤーがないカードは、同じ購入を2回喜んで承認してしまう。エージェントにはそれに気づく監視者もいない。なぜなら、午前3時に誰も見ていないということが、この仕組みの要点だからである。

請求が確定する前に資金を確保することは標準的な修正策であり、それを設計上の特性として述べることは、エージェントアカウントに求めて当然のことです。これは測定結果というよりも、事前登録段階での設計上の主張として読まれるべきです(ウォレットはサイト上で「検証済み」と表示されています)。しかし、その主張は常時稼働の実際の特定の障害を対象としています。

The OrcaID wallet and card showing a held balance and cap enforcement.

エージェントが実際に失敗するやり方に適合する制御形態

OrcaIDが説明するコントロールは、3つのサーフェスにかなりきれいにマッピングされます。サイトには、ハードストップとして説明される月間上限、上限を超えた瞬間に拒否されるカード、ワンクリックで一時停止できるキルスイッチ、そして「トークン+ドル、1つの台帳」という記述が示されています。

緩やかなドリフト — 数週間にわたってわずかにコストがかかりすぎるボット。 これに対応する管理策: アラートではなく、ハードな月額上限。

午前3時のループ。 それに対処する制御: 上限に達すると拒否されるカードにより、ループの支払いが停止する。

リトライによる重複請求。 これに対処するための制御: 資金は使用前に確保され、二重に清算されることはありません。

どのエージェントがどの料金を引き起こしたのかを判別できません。 それに対処する制御: エージェントごとに1つのハンドルを用意し、各エージェントが独自の残高と記録を持ちます。

自分自身を締め出さずにそれを止めることはできません。 それに対処するコントロール: 認証情報ではなく、エージェントを対象としたキルスイッチ。

熟考する価値があるのは、台帳の最後の行のアイデアだ。トークンとドルが同じ明細に載ること。推論コストと現実世界での支出は、現在は別々のシステムにある——モデルの請求書はこちら、カード明細はあちら——つまり、エージェントタスクの本当のコストは、手作業で組み立てるしかない(もし組み立てるならだ)。両方を1つの明細項目に載せることで、「このエージェントを実行する価値があるか」が答えのある問いになる。

ステータスについて正確に言うと、orcaid.aiでは、ウォレット、カード、番号は「本人確認後」と表示され、受信箱は「ローンチ時」と表示されています。現在存在するのは予約のみで、無料であり、請求は開始されません。これはいずれもGrok Botの統合ではなく、そのような発表も行われていません。

これらがリリースされる前にできること

Grok Botは有料層でベータ版として提供されており、広範な展開の日程は未発表です。また、OrcaIDは事前登録中です。したがって、有用なアドバイスはアーキテクチャ的なものというより、運用的なものになります。

エージェント単位で測定するのであって、シート単位ではありません。ボットチームを運用している場合に必要な数値は、エージェント1日あたりのコストです。現在の設定でそれが算出できないなら、それがそのまま調査結果です。エージェントに渡す支払い手段は、自分用のものとは別にしましょう。大まかでも構いません。たとえば、低額制限付き仮想カードは、本当の上限の代わりとしては不十分ですが、無制限のエクスポージャーを制限付きに変換できます。リトライは信頼性の機能ではなく、支払い上の危険として扱い、エージェントの経路内で二重請求され得るものがないか確認してください。そして、モデル支出と実世界の支出を1つのビューで管理してください。たとえそれがスプレッドシートでも構いません。そうでなければ、どのタスクが元を取れているのかが分からないからです。

Diagram of the three cost surfaces of an always-on agent.

要点

Grok Botに関する興味深いコスト問題は、サブスクリプションの価格ではない。それは、「常時オン」がエージェントの支出を、監督された活動から監督されない活動へと、3つのサーフェスにわたって移行させる一方で、価格モデルは依然として眠る人間を想定していることだ。既存のティアへのアクセスをバンドルすることで、定額料金は予測可能になり、消費は不透明になる。

適切に制限するには、エージェントがそれ自体として支出主体である必要がある。つまり、厳格な上限のある資金入り残高、警告ではなく拒否するカード、再試行時の二重清算がないこと、そしてトークンとドルが同じ台帳に並ぶことだ。それがOrcaIDが向かって構築されている形であり、予約によってその席を確保できる形でもある。今日の時点で実行可能な部分はさらに狭い。すなわち、各エージェントが1日あたりどれだけのコストをかけているかを突き止め、エージェントが触れるものは何も二重に請求できないことを確認することだ。

情報源に関する注記:Grok Botの2026年8月11日提供開始、常時稼働の動作、社内ユースケース(営業アウトリーチ、マーケティングキャンペーン、オンボーディング、オフィス業務、バグ修正)、マルチボットチーム体制、および既存の有料サブスクリプション階層(SuperGrok Plus/Heavy、Cursor Pro+/Ultra、Cursor Teams Standard/Premium、デスクトップおよびiOS向け)へのバンドルは、いずれもSpaceXAI自身の主張である。広範な展開時期が公表されていない点は、独立系報道に基づく。OpenClawの月額LLMコスト(ライト利用で5〜20ドル、ヘビー利用で100ドル超)は第三者による報告値であり、ベンダー公表の数値ではない。ここでは常時稼働エージェントにおける推論コストのばらつきを示すためにのみ使用している。OrcaIDの月間上限、キルスイッチ、上限到達時のカード拒否動作、「資金は使用前に確保され、二重に清算されることはない」という仕組み、およびトークンとドルを一元管理する単一台帳は、orcaid.ai(2026年8月22日確認)に基づく。同サイトでは、ウォレット、カード、番号は「By verification(検証による)」、受信トレイは「At launch(提供開始時)」と表示されており、これらはすべて登録前の主張であり、測定結果ではない。OrcaIDとGrok Botの連携は発表されていない。

© 2026 OrcaRouter

プロバイダー向け

推論プラットフォームを運営していますか?OrcaRouter にモデルを掲載しましょう。

providers@orcarouter.ai

コミュニティに参加

Discordsupport@orcarouter.aiXGitHubYouTube