
Mercury 2.5 Preview vs Grok 4.6:1,107トークン/秒のプレビューはコスパ王者を打ち破れるか?
- AlibabaNEWQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり
- z-aiNEWZ.ai: GLM 5.3 Flash2026-08-2658知能72コーディング
- DeepSeekNEWDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 100万トークンあたり
- z-aiZ.ai: GLM 5.32026-08-1860知能75コーディング
- obsidianQwen3.8 27B2026-08-1552知能68コーディング
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1261知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0557知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0358知能72コーディング
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152知能69コーディング
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 100万トークンあたり
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463知能78コーディング
- googleGoogle: Gemini 3.6 Flash2026-07-2152知能69コーディング
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137知能49コーディング
- metaMeta: Muse Spark 1.12026-07-1653知能71コーディング
- kimiMoonshotAI: Kimi K32026-07-1560知能76コーディング
- openaiOpenAI: GPT-5.6 Luna2026-07-0952知能71コーディング
答えを一文で述べると、以下のとおりです。Mercury 2.5 Preview は、現在本番稼働中の信頼できる推論モデルとしては最安で、100万トークンあたり $0.04 / $0.15 です。一方 Grok 4.6 は、インテリジェンスのフロンティア層では最安のモデルで、$2.00 / $6.00 です。つまり両者を選ぶうえでの実際的な論点は、Inception が GPT-5.6 Luna (Low) や Claude Haiku 4.5 に「匹敵する」とだけ述べているプレビュー版の拡散モデルが、そうでなければフロンティア層へ料金を払って任せるであろう仕事をこなせるのかどうか、ということです。2026年8月31日にリリースされた Mercury 2.5 Preview はトークンを並列生成し、標準的なGPUで毎秒1,107トークンを達成すると主張しています。一方、2026年8月12日にリリースされたフロンティアの旗艦モデル Grok 4.6 は、Artificial Analysis Intelligence Index で61点を獲得し、世界第3位に並んでいます。しかも、それをフロンティア層ではこれまで見たことのない価格で実現しています。価格曲線の最安値圏に位置する最速の主張と、その最高値圏に位置する最高のコストパフォーマンスが出会う——この衝突こそが本稿のテーマです。
重要なポイント
• Grok 4.6($2.00 / $6.00、AAインテリジェンス指数61)は、フロンティア層のコストパフォーマンス王者です。一方、Mercury 2.5 Preview($0.04 / $0.15)は、50分の1の価格で得られる十分な品質が、滅多に必要としないフロンティア品質に勝るという賭けです。
• Mercury 2.5 Previewの速度と品質に関する主張は、すべてInceptionによるものです。初日の時点では、独立したベンチマークスコアは存在しませんでした。
• Mercury 2.5 Preview の80%発売記念割引は2026年9月8日に終了します。それ以降の定価は$0.20 / $0.75で、入力についてはGrok 4.6より依然として10倍安いものの、その差は小さなものになります。
Grok 4.6は本日よりOrcaRouter上で定価にてルーティングされています。Mercury 2.5 Previewはまだルーティングされておらず、Inception独自のAPIおよび複数のサードパーティプラットフォームを通じて提供されています。
スコアボード

• 知能 — Mercury 2.5 Preview: 独立したインデックスなし。Inceptionはコスト最適化ティアと同等と主張。Grok 4.6: AA Intelligence Index 61、世界第3位タイ(Artificial Analysisによる。ラボ自身の数値はベンダー報告値)。
• 価格 — Mercury 2.5 Preview: 1Mあたり$0.04 / $0.15($0.20 / $0.75から80%オフ、2026年9月8日まで)。Grok 4.6: 1Mあたり$2.00 / $6.00、200Kトークン以上のプロンプトでは$4.00 / $12.00に倍増。
• 速度 — Mercury 2.5 Preview: 1,107 tokens/sec(ベンダー報告値)と主張。Grok 4.6: 速度は主要なスペックではない。このモデルは高速なストリーミング向けではなく、長時間のエージェント実行向けに構築されている。
• コンテキスト — Mercury 2.5 プレビュー: 260K。Grok 4.6: 500K.
• エージェント型作業 — Mercury 2.5 Preview: 公開スコアはないが、並列ツール呼び出しはサポートされている。Grok 4.6: APEX-Agents 57.5、DeepSWE v1.1 65.9、CursorBench v3.2 69.9(ベンダー報告によるもので、ほとんど再現されていない)。
• 重み — Mercury 2.5 Preview: クローズド、プロプライエタリ。Grok 4.6: クローズド、プロプライエタリ。
価値のチャンピオンと価格スキップ
Grok 4.6の立ち位置は異例だ。Artificial Analysisインデックスのインテリジェンス部門で第3位に位置し、GPT-5.6 Sol Maxと同点である一方で、スコアが10ポイント以内のすべてのモデルよりも安価だ。また、ローンチ時の報道では、あるベンダーが実施した評価において、長時間にわたるエージェント実行が1タスクあたり平均約0.84ドルで完了したことが強調されていた。これは、まさに「価値のチャンピオン」の定義である。フロンティアに近い性能を持ちながら、タスクごとのコストをスプレッドシート上で明確に確認できる価格を実現しているのだ。Mercury 2.5 Previewは、そのような製品になろうとはしていない。Inceptionはこれを、GPT-5.6 Luna (Low)、Gemini 3.5 Flash-Lite、Claude Haiku 4.5といったモデル、すなわちフロンティアではなくコスト最適化された層に対抗させている。Inceptionの見立てが正しければ、Mercury 2.5 Previewは性能面ではGrok 4.6より一段下、価格面では数段下に位置する。これは完全に筋の通った製品だ。フロンティア層が無駄になるワークロード向けに、価格帯をスキップする製品なのである。
並列デコードが実際に変えるもの
アーキテクチャこそ理解する価値のある部分です。なぜなら、それによって「速い」の意味が変わるからです。自己回帰モデルは1ステップにつき1トークンしか出力しないため、スループットは逐次のレイテンシに制約されます。一方、Mercury 2.5 Previewのような拡散型LLMは、トークンのブロックを並行生成し、それをノイズ除去ステップで洗練していくため、スループットは生成トークン数から切り離されます。だからこそInceptionは、標準GPU上で毎秒1,107トークンを達成できると主張できるのです。特別なアクセラレータも、バッチ処理の裏技もなしに。そして、実際の製品上の主張は、インタラクティブなワークロードで最初のトークンまで300ミリ秒未満という点にあります。音声エージェントや検索パイプライン、毎ターンでモデルを呼び出すコーディング用サブエージェントにとって、このレイテンシの違いこそが製品価値そのものです。それは、生きた感覚のある音声ループと、一瞬止まる音声ループの差です。ただし、落とし穴もあります。拡散言語モデルはまだ新しい研究分野であり、1,107という数字はInceptionの自社測定であり、独立した研究室がこの速度を再現したことも、並列生成が長文や敵対的プロンプトに対して引き起こす品質の劣化(もしあれば)を測定したこともない、という点です。
Grok 4.6 が今もなおその仕事をこなす領域
Mercury 2.5 Previewは、Grok 4.6が実際に勝っている市場の領域には、どこにも影響を及ぼさない。Grok 4.5と比べたGrokの向上は、エージェント型およびコーディングのベンチマークに集中しており、DeepSWEが11.9ポイント、APEX-Agentsが10.4ポイント、Terminal-Benchが10.3ポイント上昇した。また、その500Kのコンテキストウィンドウは、タスク全体をコンテキスト内に保持しなければならない長時間稼働エージェントのために存在する。Mercury 2.5 Previewは並列ツール呼び出しを提供するが、独自のエージェントスコアを持たず、出力上限が65,536トークン、コンテキストが260Kのこのモデルは、50ステップに及ぶソフトウェアエンジニアリング工程に適したツールではない。この2つのモデルの用途はほとんど重ならない。Grok 4.6は、実際に完了させなければならない作業のためのエンジンであり、Mercury 2.5 Previewは、即時の応答が求められ、1回の呼び出しあたりのコストがほぼゼロであるべき作業のためのエンジンである。
80%オフの期間
この価格設定には有効期限があり、それが意思決定を変えます。Mercury 2.5 Preview の $0.04 / $0.15 というレートは、$0.20 / $0.75 のリスト価格から 80% 割引されたものであり、Inception はこのプロモーションが 2026 年 9 月 8 日まで続くと言っています。Grok 4.6 の $2.00 / $6.00 は、すっきりとした構造の安定したリスト価格です。キャッシュ入力は $0.50、優先ティアは 2 倍、200K トークン以上の長いプロンプトではステップアップが適用され、リクエスト全体が高いレートで請求されます。今日の数値を比較するなら、Mercury は入力で 50 倍、出力で 40 倍安く見えます。割引が予定どおりに終了すれば、実際の長期的な差は入力で 10 倍、出力で 5 倍です。どちらの捉え方も不誠実ではありません。単に時間軸が異なるだけであり、割引を前提に価格設定され、再評価ポイントを持たないパイプラインは、9 月 9 日に驚くことになるでしょう。Grok 4.6 の $2.00 / $6.00 はまさに OrcaRouter で支払う金額であり、そこではプロバイダーのリスト価格が 0% マークアップでそのまま適用され、プロバイダーが数値を変更すると、同じキーで同日中に反映され、いずれかのプロバイダーパスがレート制限にかかった場合は自動フェイルオーバーが行われます。
一行の結論
もしジョブを完了させる必要があり、そのティアで最高の性能を最安値で手に入れたいなら、Grok 4.6を購入しよう——それは実証済みのコスパ王者であり、本日OrcaRouterで$2.00/$6.00にて稼働中だ。もしジョブが大量処理・レイテンシ重視のテキスト推論であり、十分な回答を低コストで検証できるなら、Mercury 2.5 Previewの$0.04/$0.15は、割引期間中に試す価値のある破格の価格だ——ただし、その陣営側のすべての主張はInceptionのものであり、証明はまだなされていないことを忘れないでほしい。


OrcaRouterはプロバイダーのリスト価格を0%マークアップで透過的に渡し、自動フェイルオーバーにより、ベンダーの価格変更は同じキーで同日中に反映されます。
この記事で比較したモデル1
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
