
Grok 4.7とは?仕様、価格、コンテキストウィンドウ、ベンチマーク
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 300 tok/s
- openaiNEWOpenAI: GPT-6 Luna2026-09-2237知能
- openaiNEWOpenAI: GPT-6 Sol2026-09-2248知能
- anthropicNEWAnthropic: Claude Opus 5.52026-09-2258知能
- grokNEWGrok 4.72026-09-2146知能
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100万トークンあたり · 195 tok/s
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 1327 tok/s
- deepseekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- openaiOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- googleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- anthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- tencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100万トークンあたり
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 112 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 221 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1244知能77コーディング
Grok 4.7は、SpaceXAIの現行フラッグシップモデルです。テキストと画像を入力として受け取り、テキストを返す推論モデルで、500,000トークンのコンテキストウィンドウを備え、価格は100万入力トークンあたり$2.00、100万出力トークンあたり$6.00、推論エフォートは4段階から選択できます。これは、次に挙げるモデルの後継です:Grok 4.6。価格とコンテキストは完全に一致し、長時間にわたる作業 — 数時間のコーディング、エージェント型のツールループ、専門的な知識業務 — を対象としており、同社は現在、製品ライン全体をまさにこの作業を中心に販売しています。このページはそのリファレンス項目です。モデルとは何か、どこに位置づけられるか、何を受け付けるか、いくらかかるか、そして意図的に分けて扱われている2つの事柄 — SpaceXAIが自社モデルについて述べていることと、独立した評価者が測定したこと — を扱います。
なぜこれがローンチ記事ではなくリファレンスページなのか。Grok 4.7 は 2026年9月21日に提供開始となり、そのローンチについてはすでに本ブログで取り上げています(初日の受け止めはgrok-4-7-release-dateの記事をご覧ください)。したがって、以下に示す日付は、モデルの年代を示す事実として用いたものであり、あらためて報じる出来事としてではありません。このページが存在する理由となる読者は、モデル名だけを検索ボックスに入力し、ニュースではなくモデルそのものを求めている人です。2026年9月25日までの28日間で、当社自身の Search Console データには、完全一致クエリ「grok 4.7」で31,934インプレッション、この名前に行き着くあらゆる表記を合わせて34,160インプレッションが記録され、平均掲載順位は7.8、着地先となる専用ページはありませんでした。これは人が何を入力するかの測定値であり、モデルの出来の良さを語るものではありません。そして、このページが最も平易な問いから始まっている理由でもあります。本記事のすべての数値には、その出所を示すラベルを付けています。ベンダー公表は SpaceXAI 自身のドキュメント、ローンチ投稿、価格ページに基づくもの、独立系は Artificial Analysis によるもの、そして当社調べは当社のカタログと検索データが示すものです。
Grok 4.7がGrokの中でどの位置を占めるか
ベンダーは現在、開発者ドキュメントとニュースページの両方で自社名をSpaceXAIと表記しているが、API自体はいまだにapi.x.aiから提供されており、モデル識別子も依然としてgrokのものだ。Grok 4.7はテキスト系の最上位であり、ベンダー自身のデフォルト推奨でもある。どのモデルを選ぶべきかと尋ねれば、モデルページは、音声・画像・動画の作業を除くすべて——「コードを含め」——についてGrok 4.7を使うべきだと答えている。なぜなら「それは当社がこれまでに構築した中で最も高性能なモデル」だからだ。その兄弟モデルは、ベンダー自身が公開している100万トークンあたりの料金では、次のとおりである:
• Grok 4.6 — 500Kコンテキスト、入力$2.00 / キャッシュ$0.50 / 出力$6.00、2026年8月リリース。直接の前身であり、4.7の価格設定の基準となるモデル。
• Grok 4.5 — コンテキスト500K、入力$2.00 / キャッシュ$0.30 / 出力$6.00、2026年7月提供開始。後継モデルと同じ定価でありながらキャッシュ料金が安く、今ではそれが、あえてこれを選ぶ唯一の具体的な理由になっている。
• Grok 4.3 — 1Mコンテキスト、$1.25入力 / $0.20キャッシュ / $2.50出力。現在のフラッグシップの半額で、コンテキストウィンドウは2倍。
• Grok 4.20(推論、非推論、マルチエージェント版)— 1M、入力 $1.25 / キャッシュ $0.20 / 出力 $2.50。
• Grok Build 0.1 — 256Kコンテキスト、入力$1.00/キャッシュ済み$0.20/出力$2.00。汎用モデルではなくコーディング特化モデルであり、Grok BuildエージェントのデフォルトモデルはこれではなくGrok 4.7です。
つまり、現在のラインナップの形は能力対ウィンドウのトレードオフだ。フラッグシップは500Kのコンテキストを$2/$6で提供し、4.3/4.20ティアは100万トークン全体を、入力価格はおよそ半分、出力価格は半分未満で提供する。ベンダーのドキュメントには、Grok 4.7がGrok 4.6とは異なるアーキテクチャであることを示唆するものは何もない。リリースが説明しているのは、より大規模なベースモデル、完了に何時間もかかるタスクに重みを置いたより長い強化学習の実行、より優れた自己検証、より優れた長文コンテキスト処理、そしてGrok Botハーネスでのトレーニングによって、モデルが会話や一般的なナレッジワークでより良く振る舞うようにすることだ。新設計ではなく、改善の主張である。SpaceXAIは、モデルページにも価格表にもGrok 4.7のパラメータ数を公表しておらず、このページでも推測はしない。
出荷された時期と、同梱されていたもの
ローンチ投稿の日付は2026年9月21日で、開発者向けモデルページも最終更新日として同じ日付を掲げている。これが得られる最も正確な情報だ — SpaceXAIは日付より細かいリリースタイムスタンプを公開していない。その日にリリースされたのは、単なるモデル識別子だけではなかった。そのgrok-4.7スラッグは、Responses APIとChat Completionsの両方で公開され、50万トークンのコンテキストウィンドウ、2026年5月の知識カットオフ、新しい最上位設定を含む4つの推論レベル、2つのファーストパーティサーフェスに限定されたFastバリアント、米国限定のリージョナルエンドポイント、そしてGrok 4.6と同じリスト価格を備えていた。同時に、Grok Buildコーディングエージェントのデフォルトモデルとなり、Cursorのすべてのプランで利用可能になった。仕様ではなく初日の反応を知りたいなら、そのgrok-4-7-release-dateの記事がその点を扱っている。このページでは、同じ日付をモデルに関する事実として扱い、それが実際にあなたにとって何をするのかに進む。
許容範囲:何を送信でき、その量はどれくらいか
以下はすべて、別段の表示がない限り、2026年9月28日に閲覧したSpaceXAI自身のモデルページおよびモデル一覧ページからのものです。

• コンテキストウィンドウ — 500,000トークン。Grok 4.6 と同じで、Grok 4.3 および 4.20 ファミリーが提供するものの半分です。
• 知識カットオフ — 2026年5月で、Grok 4.6より3か月後。それより新しい情報には検索ツールをオンにする必要があり、このモデルはデフォルトではリアルタイムの認識を持たない。
• 入力 — テキストと画像。画像は JPG/JPEG または PNG で、それぞれ最大 20 MiB まで可能で、ベンダーは 1 リクエスト内の画像数の上限を記載していません。画像とテキストは任意の順序で現れることができます。
• 出力 — テキストのみ。このモデルでは画像、音声、動画の生成は行いません。これらはSpaceXAIシリーズの別モデルです。
• 出力上限 — ベンダーはテキスト出力制限はないと述べている。当社の OrcaRouter モデルカード(grok-4.7 向け)には、最大出力 450,000 トークンと記載されており、この2つの数値は一致していません。私たちはどちらかを黙って選ぶのではなく、この点を指摘しています。SpaceXAI のドキュメントは SpaceXAI のモデルに関する権威ある情報源であり、正直に解釈すれば、ベンダーはテキスト出力の上限を公表していないということです。
• 推論の制御 — reasoning_effortは low、medium、high(ベンダーのデフォルト)または xhigh を受け付けます。xhigh はこの世代で新たに登場したもので、Grok 4.6 でも4つのレベルが用意されていましたが、4.7 向けに公開されたベンチマークの数値は xhigh で示されています。
• ツール — 関数呼び出し、ウェブ検索、X検索、コード実行。いずれもサーバーサイドツールとして文書化されています。
• 構造化出力 — ベンダーはテキスト生成と併せて構造化出力機能を文書化しています。当社のページではresponse_formatおよびstructured_outputsとして公開しています。
• 当ページが受け付けるパラメータ — include_reasoning、logprobs、max_tokens、reasoning、reasoning_effort、response_format、seed、structured_outputs、temperature、tool_choice、tools、top_logprobs、top_p。logprobs を基に何かを構築する前に知っておく価値のある注意点が1つあります。SpaceXAI の models ページには、logprobs と top_logprobs は grok-4.20 以降のモデルではサポートされておらず、「設定しても黙って無視されます」と記載されており、これは Grok 4.7 にも当てはまります。当ページにこれらが記載されているからといって、上流がそれらを返すことを約束するものではありません。
• エンドポイント — OpenAI互換のChat Completions APIとResponses API
• プロンプトキャッシュ — ベンダーは、prompt_cache_keyを Responses API で設定することを推奨しています(x-grok-conv-id ヘッダーを Chat Completions で使う)。これにより、1 つの会話のリクエストが同じサーバーに届くようになります。これがないと、ドキュメントでは、キャッシュが冷えたサーバーで入力の全額を支払うことがよくあると警告しています。キャッシュされた入力は、200K のしきい値を下回る場合、100 万トークンあたり $0.50 で課金されます。
• 暗号化された推論 — Responses API では、Grok 4.7 は要求しなくても常に reasoning.encrypted_content を返すため、マルチターンの呼び出しでは追加設定なしでモデルの推論が保持されます。Chat Completions は変更されていません。
料金表、その全容
料金はプロンプトサイズに応じた段階制で、一度しきい値を超えると、そのしきい値は境界を超えたトークンだけでなくリクエスト全体に適用されます。ここに示す数値はすべてベンダーが公表したもので、2026年9月28日にSpaceXAIの料金ページから読み取ったものです:
• 標準、200Kトークン未満のプロンプト — 100万トークンあたり入力$2.00 / キャッシュ入力$0.50 / 出力$6.00。
• 長いコンテキスト、200Kトークン以上のプロンプト — 100万トークンあたり入力$4.00 / キャッシュ入力$1.00 / 出力$12.00。
• Grok 4.7 Fast — 同じモデルをより高速なインフラで、標準料金の2倍で提供:200K以下は $4.00 / $1.00 / $12.00、200K超は $6.00 / $1.50 / $18.00。利用できるのは Cursor と Grok Build 経由のみで、パブリックAPIでは一切提供されておらず、Grok Build の無料枠にも含まれていません。
• US regional endpoint — https://us.api.x.ai/v1 keeps inference in the United States and bills at 1.1×, which works out to $2.20 / $0.55 / $6.60 per million below 200K and $4.40 / $1.10 / $13.20 above. Only grok-4.7 and grok-4.6 are served there today.
市場の他の動きと照らし合わせて読むと、興味深いのは見出しの料金ではない——入力$2、出力$6はGrok 4.6が課していた額とまったく同じで、Grok 4.5が今も課している額だ——キャッシュ割引の方だ。ベンダーは、繰り返されるプロンプト接頭辞に対して入力75%オフと公表している。同じシステムプロンプトとファイルコンテキストを毎ターン再送する長いエージェントループにとって、この割引は定価と請求額の差を生む。また、Grok 4.7が先代より劣る唯一の点でもある。Grok 4.5は100万トークンあたり$0.30でキャッシュするのに対し、Grok 4.7は$0.50だ。
Grok 4.7はOrcaRouter上でgrok/grok-4.7として、SpaceXAI自身の定価のままマークアップ0%で提供されています — プロバイダー価格がそのまま通されるため、ベンダーの価格変更は再価格設定を経た後ではなく、当日中にここへ反映されます。これは、二段階のプロンプト閾値とキャッシュ料金を備えたモデルではいつも以上に重要です。そのどちらも、実際に支払う金額を左右するからです。Grokシリーズ全体に対して1つのキーと1つのOpenAI互換エンドポイントなので、コスト差を試すためにワークロードをGrok 4.7からGrok 4.5や4.3へ切り替えるのは、2つ目の契約ではなく文字列の変更だけで済みます。
SpaceXAIがそれについて主張していること
このセクションの内容はすべてベンダーによる報告です。いずれも独立に再現されたものではなく、エフォート設定が重要です — ローンチ投稿の表では、Grok 4.7 は xHigh、Grok 4.6 は High、比較対象の2モデルは Max と記載されており、これは条件を揃えた比較ではありません。
• CursorBench 4.0 — Grok 4.7がxHighで46.3%であるのに対し、Grok 4.6はHighで40.4%。ローンチ投稿自身の位置づけでは、まさにここがGrok 4.7の「価格性能比における最前線」である。
• Terminal-Bench 4.0 — 37.6%、Grok 4.6 の 20.3% に対して。今回のリリースで最大の単一デルタであり、「より難しいタスクでのより長い RL」という主張に一致するものでもある。
• DeepSWE v1.1 — 71.0%。ベンダー自身の表では高努力スコアと記されており、Grok 4.6の65.2%と対比される。
• AA Briefcase v1.1 — 1,657、Grok 4.6 の 1,546 に対して。ここで名称の衝突に注意してください。これは、Artificial Analysis も実施しているベンチマークをベンダーが引用したものであり、独立した結果については次のセクションで説明します。
• EEBench — 64.0%、Grok 4.6の53.0%に対して。
• Harvey Legal Agent Benchmark — 19.6%、Grok 4.6 の 15.8% に対して
• HealthBench Professional — 56.7%、Grok 4.6 の 48.5% に対して。
• GDPval — xhighでElo 1,695、highでのGrok 4.6の1,605と対比。
安全性に関する主張もベンダーによる報告であり、しかも異例なほど具体的だ。SpaceXAIは、Grok 4.7が新しいセーフガードスタック上に構築されたと述べ、LatchBioのバイオセーフティベンチマークで62.4%と首位に立ち、独自のHackerBench v0.3ではリスクの高いデュアルユースのプロンプトのうち3.3%しか通さず、正規のセキュリティ業務をブロックすることはほとんどないとしている。同社はまた、選ばれたサイバーセキュリティパートナーに対し、このモデルのレッドチーム機能への招待制アクセスを提供し始めたとも述べている。これらはすべて、ベンダーが自社モデルを自らテストしたものとして扱うべきだ——後から検証できるほど具体的な主張の集合ではあるが、それは今すでに検証済みであることとは同じではない。ローンチ投稿の一行のポジショニング、「同種のモデルの2倍速く、半額で」は、Grok 4.7の測定値ではなく競合他社についてのマーケティングであり、下記の独立した速度の数値は、そのうち「2倍速く」という半分を裏付けていない。

独立した評価者が測定したもの
Artificial Analysis はこの話の中でモデルに対して何ら利害関係を持たない唯一の情報源であり、その Grok 4.7 のページは明示的に xhigh 構成です。2026年9月28日閲覧:
• 知能 — Artificial Analysis Intelligence Index で46、インデックスバージョン v4.3.2。これは同ボードで211モデル中21位であり、インデックスの中央値26を大きく上回っています。このインデックスは10個の評価を組み合わせたものです:AA-Briefcase v1.1、GDPval-AA v2.1、AutomationBench-AA、Terminal-Bench 4.0、SciCode、Humanity's Last Exam、GDP.pdf、CritPt、AA-Omniscience、AA-LCR v1.1。
• コスト — Intelligence Index を1回実行するのに $3.74。同じ評価者によるキャッシュ割引は75%で、入出力レートはベンダーのもの($2.00 / $6.00)と一致している。モデル自身のコメントは「同程度の価格の他のモデルと比較した場合、手頃な価格である」というものだ。
• 冗長性 — Intelligence Index 全体で生成された出力トークンは 2 億 4,000 万で、中央値は 8,800 万でした。Artificial Analysis はこれを「非常に冗長」と呼んでおり、予算を立てる人にとってここで最も有用な単一の数値です。より長い思考連鎖で考えるモデルは、トークン単価が固定でもタスクあたりのコストが高くなります。
• 速度 — 毎秒82.6出力トークン。そのボードでは211中83位だが、それでも評価者はこれを「平均より遅い」と評している。この数値をどこへ持ち出す前に、2つの注意点がある。Artificial Analysisは本番利用をよりよく反映するため、デフォルトのベンチマークワークロードを10,000トークン入力に変更しており、このモデルについて公表している速度値もスナップショット間で大きく変動している。したがって、定数ではなく、ある1つのワークロードのスナップショットとして扱うべきだ。APIプロバイダー側では、同じ評価者がこのモデルについて掲載しているプロバイダーは1社だけ — SpaceXAI自身 — なので、その測定されたレイテンシとブレンド価格はファーストパーティの数値であり、市場全体のスプレッドではない。
当社独自のカタログには、2026年9月21日に評価されたGrok 4.7に関するArtificial Analysisの結果がさらに3件掲載されています。Humanity's Last Examで43.1%、長コンテキスト想起評価で76.7%、SciCodeで57.4%です。これらはArtificial Analysisによるものなので「独立」と表示されており、ベンダーの自己検証主張を裏付けるものとしてではなく、それらと併せて読む価値があります。
正直な比較メモ:SpaceXAIの数値とArtificial Analysisの数値は、異なるハーネス、異なるエフォート設定で生成されたものであり、両者が条件を揃えた構成で直接比較されたことはない。同じベンチマーク名が双方に現れる場合——AA Briefcase、Terminal-Bench 4.0——それは名前が共通しているだけで、同じ実行ではない。ベンダーの数値と独立系の数値を、まるで一つの測定値であるかのように並べて引用する人は、証拠が支持しない計算をしている。
実際にそれを呼べる場所
Grok 4.7は、ローンチ当日からSpaceXAI自身のAPI(api.x.ai)を通じて、Responses APIまたはChat Completionsを使って呼び出すことができ、米国限定のリージョナルエンドポイントからは10%の割増料金で利用できます。これはGrok Buildコーディングエージェントのデフォルトモデルであり、Cursorではすべてのプランで利用可能です。Fastバリアント — 同じモデルを2倍の料金で提供 — はこれら2つのサーフェスに限定され、公開APIには存在しません。ファーストパーティのアクセス以外にも、ベンダーはサードパーティのコーディングハーネス、モデルルーター、クラウドプラットフォームを通じて利用可能だと説明しています。
当社側の具体的な状況としては:grok/grok-4.7 が本日 OrcaRouter のカタログで公開され、xAI の定価リストレートのままマークアップ 0% で提供され、Grok シリーズの他のモデルと同じキーでどちらのエンドポイントからも呼び出せます。Grok 4.6 と比較検討しているなら — 価格も同じ、コンテキストウィンドウも同じ、中身は別のモデル — 両方を自動フェイルオーバーチェーン付きで 1 つのエンドポイント経由にルーティングするのが、あなたのワークロードが実際にどちらを好むかを見極める安上がりな方法です。ベンダーの比較表を根拠に、新しいモデルへと本番パスをコミットしてしまうよりは。

記録がまだこれほど薄いことを踏まえると、注視すべき点は次の三つだ。SpaceXAIはパラメータ数を公表しておらず、出力上限の問題は本当に未解決のままだ——ベンダーの「テキスト出力制限なし」と、当ページが示す450Kとの食い違いは、まだ誰も解消していない。このモデルが競合として売り込まれている相手モデルとの、同一ハーネスによる直接比較も存在しない。そして上に示した速度の数値は、最も変わりやすい数字だ。なぜなら、すでに変わっているからだ。これらは、記録が埋まるにつれてこのページに編集が必要になる三つの箇所であり、仕様が固まっているふりをするより、そう明言するほうがよい。
Grok 4.7 は本日 OrcaRouter でルーティング可能で、Grok 4.6、Grok 4.5、Grok 4.3、そして Grok 4.20 ファミリーも同様です。OrcaRouter はプロバイダーの定価をゼロマークアップでパススルーするため、SpaceXAI の二段階プロンプトしきい値とそのキャッシュ料金は、先方が変更した当日に当社側にも反映され、旧型でより安価な Grok モデルに対してワークロードをテストするのは、2つ目の契約ではなく文字列の変更で済みます。
この記事で比較したモデル3
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
