
Grok 4.6のリリース日:8月12日に、同じ$2/$6で出荷されました
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- openaiNEWOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- googleNEWGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- qwenNEWQwen: Qwen3.8 Max (0902)2026-09-0240知能72コーディング
- anthropicNEWAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1244知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0540知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0340知能72コーディング
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135知能69コーディング
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100万トークンあたり
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451知能78コーディング
- googleGoogle: Gemini 3.6 Flash2026-07-2134知能69コーディング
2026年8月12日水曜日、このページが中心に据えていた問いは、もはや問いではなくなった:Grok 4.6がリリースされた。SpaceXAI — 2026年2月にスタートアップを買収し、7月にブランド名を変更した、Grokを運営してきた企業 — は、それをGrok 4.5と同額の$2/$6の価格でリリースした。同じV9基盤の上で、同じ500Kトークンのコンテキストウィンドウを備え、そしてマスクはX上でそれを「最高だ」と呼んだ。今回のリリースにより、このページの旧バージョンが追跡していた2つの問いは解決した。すなわち、モデルが存在し、それがスケールアップではなく同規模のポストトレーニングによるリフレッシュだということだ。解決されなかったのはパラメータ数だけであり、それは公式には未公開のままである。
一週間前、正直な見出しは、モデルがまだ出荷されていないというものだった。7月27日にマスクが設定した「8月7日頃」という目標は延期され、同規模での解釈は依然として予測の域を出なかった。このページでは、このモデルは規模を変えないリフレッシュとして捉えるのが最適であり、規模を変えないリフレッシュは通常、価格引き上げなしで出荷されると論じていた。発売日はその予想のビジネス面を正確に裏付け、100万トークンあたり2ドル/6ドル/0.50ドルで、Grok 4.5と同一だった。そして最初の独立した測定結果が今入ってきた。以下は、何がリリースされ、これまでの数値が何を示し、そして何がまだベンダーによる発表に過ぎないかである。
8月12日のリリース内容
Grok 4.6は、SpaceXAI APIでモデルID grok-4.6として、またGrok Build、Cursor、Grok Botアプリで利用可能になりました。CursorとGrok Buildのユーザーは、最初の1週間、利用枠が2倍になります。これは拡張されたチェーン・オブ・ソートを備えた推論モデルで、テキストと画像の入力を受け付け、テキストを生成します。また、デフォルトより高い新しいxhigh reasoning-effort設定が追加されます。
APIはOpenAI互換のエンドポイントを維持し、サーバー側にウェブ検索、X検索、コード実行の3つのツールを追加します。すでにOpenAI互換エンドポイント経由でGrok 4.5と通信している人にとって、これはクライアントの書き直しではなく、モデル文字列の変更で済むことを意味します。
このページが予測したこと — そして的中したこと
前バージョンの論点は、マスク氏の「大幅に改善されたSFT & RLを備えた1.5Tモデル」が同規模のリフレッシュを指しており、価格は維持されるというものだった。その発売により、このビジネス上の予測の両半分が確認された。
• 価格: 100万トークンあたり$2 / $6 / $0.50(キャッシュヒット)— Grok 4.5と同一。「価格変更なし」という予測が的中した。
• コンテキスト: 500Kトークン、Grok 4.5と同一。
• スケール:まだ公式には非公開である。モデルカードにはパラメータ数が記載されていないため、マスク氏の1.5Tという数字は検証された仕様ではなく、現時点で最も有力な主張にすぎない。初期の報道で流れた2Tという数字は、Grok 4.7の2.1Tからの誤った帰属だった。

独立スコア — Artificial Analysis Intelligence Index で 61
最初のサードパーティによる計測結果が届いたが、これは良い結果だ。Artificial AnalysisはGrok 4.6をそのIntelligence Indexで61と評価した。これはGPT-5.6 Solの最大推論構成と同点で、Claude Fable 5(62)に1ポイント、Claude Opus 5(63)に2ポイント及ばず、Kimi K3(60)を上回る。これはGrok 4.5の56から5ポイントの跳躍であり、ポストトレーニングのリフレッシュとしては大きな進歩だ。
この数字には2つの注意点がある。インデックスは複合指標であり、個々の次元では結果がよりまちまちだ。また、Grok 4.6 は立ち上がりが遅い。最初のトークンまでの時間は42秒で、価格帯の中央値である約2.9秒を大きく上回る。さらに、出力速度は毎秒約68トークンで、クラス平均を下回る。これは長時間実行するエージェントにとってはノイズに過ぎないが、インタラクティブなチャットでは体験全体を左右する。
知能対コストのパレートフロンティアでは、その結果は見栄えが良い。タスクあたりおよそ0.84ドルで、典型的なAA-Briefcaseワークロードを約53ターン、約0.5B入力トークンで完了する一方、Claude Opus 5 Maxは約103ターン、約2Bを要する。つまり、これは単なる安価な選択肢ではなく、本物のフロンティア・バーゲンなのだ。
まだベンダー記載のままのもの
SpaceXAIの発表上の主張 —「GPT-5.6 SolおよびClaude Fable 5に匹敵する知能」、記載されたすべての評価でGrok 4.5を上回る改善、そして「より長い追加トレーニング実行、より強力なエンジニアリングデータ、拡大された強化学習」に起因するとされる点 — はベンダーによる表明であり、まだ独立に検証されていない。発表されたベンチマーク表(CursorBench、FrontierCode、APEX-Agents、Terminal-Bench、および宣伝されたGDPval-AA v2でのElo 1,753)はxAIが報告したものであり、それらの数値のいずれも、モデルを販売していない研究所によって再現されたものはまだない。
最初の第三者による(暫定)読み取り結果が入りました。
今のところ、独立したアリーナでの結果は1件のみだが、暫定的ではあるが本物だ。LMArenaはGrok 4.6(grok-4.6-highとして)をテキスト総合リーダーボードの#43位に、2,448票による1,464 Eloとして掲載している——暫定としてフラグ付けされ、Grok 4.5のデビュー時の1,468より4ポイント低い。サンプルが小さすぎるため、LMArenaが追跡するフロンティア表には載らない。同表への掲載には2週間の継続スコアが必要だ。
ライブセッションのエージェントリーダーボードはまだ公開されていません。公開されたとき、それは事前に最適化できない最初の読み取りになるでしょう。

価格の計算
$2/$6では、Grok 4.6は現行世代のフロンティアAPIの中で群を抜いて最安です。$5/$30のGPT-5.6 Solと比較すると、入力は60%安く、出力は80%安くなります。出力の方が価格差が大きいため、「半額」というマーケティング表現は、出力中心のコーディングワークロードにおける節約効果を過小評価しています。
注意書き:200Kを超える入力トークンのリクエストは、$4 / $12 / $1のティアにステップアップし、より高速なバリアントは2倍のコストがかかります。切り替えに関しては、計算はほとんど変わりません。Grok 4.5とGrok 4.6は価格とコンテキストを共有しているため、それらの間の移動は予算の決定ではなく、設定変更です。
OrcaRouter がプロバイダーのリスト価格を 0% マークアップでそのまま通すため、grok-4.6 エンドポイントの $2/$6 は SpaceXAI 独自の価格であり、転売価格ではありません。ベンダーによる値下げは即日ここに反映され、セカンドプロバイダーへのフェイルオーバーは調達作業ではなくルーティングルールにすぎません。
Grok 4.7 と Grok 5 はまだ先行している
Grok 4.7 は次のステップであり、マスク氏の説明は変わっていない。「2.1Tモデル」であり、Grok 4.6 より「あらゆる点で優れているが、提供速度はわずかに遅い」という。8月5日、彼はこれを3〜4週間後と述べており、それは8月下旬か9月上旬に当たる。そのタイムラインはマスク氏が述べたものであり、語るたびに遅れているため、方向性を示すものとして扱うべきだ。
Grok 5は年末に登場予定で、8月4日の決算説明会によれば、「SpaceXがこれまでに生成した基本的にすべてのデータ」でトレーニングされている。
次に確認すべきこと
4つの点で状況が明確になりますが、それぞれ現時点では未確定です:
8月13日時点で未公開のLMArena Agentリーダーボード。
• モデルを販売していない第三者による、コーディングおよびエージェント指標(DeepSWE、CursorBench、APEX-Agents)の再現。
• より高速なバリアントが広く利用可能になった場合の実際の価格とレイテンシ。
• Grok 4.7の8月下旬という予定が守られるかどうか、これまでの各具体的な日付は数日ずつ遅れてきたことを踏まえると。
そして、決断に実際に重要となるもの——それは、あなた自身のワークロードです。リーダーボードでの順位は、あなたのタスクに関する仮説に過ぎず、タスクの結果ではありません。
よくある質問
Grok 4.6は実際にいつリリースされたのか?2026年8月12日、SpaceXAI APIとGrok Build、Cursor、Grok Botアプリでリリースされた。マスク氏が7月27日に示した「8月7日頃」という目標は5日遅れた。8月4日の決算説明会での「来週」という表現が正確な時期だった。
Grok 4.6の料金は?100万トークンあたり$2/$6/$0.50 — Grok 4.5と同じで、GPT-5.6 Solの$5/$30をはるかに下回ります。入力トークンが200Kを超えると$4/$12/$1に上がり、高速版は2倍の料金です。
Grok 4.6は2Tモデルですか?パラメータ数は公開されていません。Musk氏の1.5Tという数字が、現時点で最も有力な(未検証の)主張です。出回っていた2Tという数字は、Grok 4.7の2.1Tが4.6に誤って帰属されたものです。
Grok 4.6はGPT-5.6 Solと同じくらい優れているのか? Artificial Analysis Intelligence Indexでは、両者は61(最大推論構成)で同点である。ベンダーはGPT-5.6 SolやClaude Fable 5に匹敵すると主張している。ただし、time-to-first-tokenは著しく遅く、価格ははるかに安い。エージェント機能による向上については、独立した検証が待たれる。
これがあなたをどういう立場に置くのか
実用的な対応は、このページのプレローンチ版から変わりません。コードがすでにOpenAI互換エンドポイント経由でGrok 4.5と通信している場合、Grok 4.6は同価格の設定変更です。モデル文字列を切り替え、予算ラインはそのままにして、ビルドが新しいため評価(evals)を再実行してください。そうでない場合も、パススルー価格設定の単一エンドポイントがあれば、新しいフロンティアモデルを、初週のベンチマーク——つまり、まさにそれらの暫定アリーナ数値が示すもの——に本番パスを賭けることなく切り替えられます。

この記事で比較したモデル2
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
