
GPT-6 Sol 対 Tencent HY4 Preview:より安価なモデルが600倍のトラフィックを担っている
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-2952知能
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-2856知能
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238知能
- OpenAIOpenAI: GPT-6 Sol2026-09-2248知能
- AnthropicAnthropic: Claude Opus 5.52026-09-2258知能
- xAIGrok 4.72026-09-2146知能
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100万トークンあたり · 58 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- AnthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100万トークンあたり · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 350 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
フロンティアモデルと安価なモデルの比較は通常、価格表で終わるが、今回の比較にはもっと良い結末が用意されている。Tencent HY4 PreviewとGPT-6 SolはどちらもOrcaRouterによってルーティングされている。つまり、同じテレメトリが両方をカバーしており、同じ過去7日間のローリングウィンドウでは、HY4 Previewモデルは約24億トークンを動かしたのに対し、GPT-6 Solは約390万トークンだった。これはベンチマークではなく、判断でもない。あるプラットフォームのトラフィックに関するローリングウィンドウであり、来週には違って見えるだろう。しかし、これは、強いオープンウェイトモデルがクローズドモデルの4分の1のコストで済むとき、実際に何かを作っている人々が何を選ぶかについての実際のシグナルであり、スペックシートでは生み出せない種類の数字である。
この2つのモデルは、ベンチマークが何を伝えられ、何を伝えられないかを示す好例でもある。GPT-6 Solは、2026年9月22日にOpenAIのGPT-6世代の中間ティアとしてリリースされ、独立したIntelligence Indexスコアを持つ。HY4 Previewは、2026年8月28日にTencentによってリリースされオープンソース化されたが、Artificial Analysisのモデルページも、第三者による指数も、独立したタスク別コスト数値も一切ない。その性能について公表されているすべては、Tencent自身の測定によるものだ。その非対称性は、HY4 Previewがより弱いモデルであることを意味しない。それは、より監査の少ないモデルであることを意味するのであり、両者は別の主張だ。
ほとんどのデプロイを決定づける2つを含む仕様
• 出力価格 — GPT-6 Sol 100万あたり$10.00 対 Tencent HY4 Preview 100万あたり$2.50
• 入力価格 — GPT-6 Sol 100万あたり$2.00 対 Tencent HY4 Preview 100万あたり$0.83
• キャッシュ入力 — GPT-6 Sol 100万あたり$0.20 対 Tencent HY4 Preview 100万あたり$0.04
• 重み — GPT-6 Sol 非公開、APIのみ 対 HY4 Preview Apache 2.0でオープンソース化
• 入力モダリティ — GPT-6 Sol テキスト、画像、ファイル 対 HY4 Preview テキストのみ
• コンテキストウィンドウ — GPT-6 Sol 1,050,000トークン 対 HY4 Preview 1,048,576トークン
• 最大出力 — GPT-6 Sol 128,000トークン 対 HY4 Preview 64,000トークン
• 長文リクエストの段階 — GPT-6 Sol は入力トークンが272,000を超えるとリクエスト全体を$4.00 / $15.00に再価格設定 対 HY4 Preview は料金表に段階なし
• アーキテクチャ — GPT-6 Sol 非公開 対 HY4 Preview 総パラメータ数770、アクティブ49B、78層、ルーティングエキスパート256+共有1、ネイティブのマルチトークン予測層
• 独立スコア — GPT-6 Sol 47.6 Intelligence Index 対 HY4 Preview 公表なし
• 計測された出力速度 — GPT-6 Sol 約244トークン/秒 対 HY4 Preview 約54、いずれも7日間の移動値
実際のデプロイの大半を左右する2行は、一番下にある。1つ目は、HY4 Previewが画像もファイルも入力として受け付けないことだ。これにより、何かを見る必要があるパイプラインからは除外される。2つ目は出力上限だ。64,000トークンはGPT-6 Solの128,000トークンの半分であり、コーディングエージェントと長いツール使用チェーンを公称目的とするモデルでは、チームが最初に突き当たる制約はそれだ——品質ではなく、生成されたファイルが1回の応答に収まらなくなる時点である。
それらと比べれば、出力価格の4分の1、キャッシュ入力価格の5分の1で、かなりの回数の再試行ができる。しかもHY4 Previewのアーキテクチャは、GPT-6 Solとは違って文書化されている。Tencentはパラメータ数、レイヤー数、エキスパート配置、投機的デコーディング層を公開しており、つまりサービング特性は少なくとも部分的には論文から予測可能で、APIを通じてしか観察できないわけではない。

HY4 Previewのベンチマーク表の実態とは
Tencentが公表した数値は強く、しかもそのすべてがベンダー自身によって実施されたものだ。Terminal-Bench 2.1ではこのモデルは85.4を記録し、DeepSWEでは64.3。203のエンジニアリングタスクにわたる社内ブラインド評価では、GLM-5.3の2.92、Kimi K3の2.94に対して平均2.99だった——Tencentが設計した調査における、10点満点中0.07ポイントのリードである。またWebDev Arenaのリーダーボードに初登場し、Tencentの報告によれば総合でおよそ5位、オープンウェイトモデルの中では3位につけた。アリーナの結果はベンダーによる採点ではなく群衆投票によるもので、この一連のデータの中で最も独立性の高い証拠だ。残りは主張であり、主張は、そうと明記されている限り、依然として読む価値がある。
重要なのは、これらの数値が甘く出ているかもしれないことではない——ベンダーのハーネスはたいていそうで、しかもどちらの方向にも甘く出る。重要なのは、それらを比較できる第二の測定値が存在しないことだ。Artificial Analysisのページがあるモデルは検証できるが、ないモデルは検証できない。そしてその差は数か月後に、見出しの数値が他の誰にも再現できないハーネスで測定されていたと誰かが気づいたときに表面化する。ここまでの内容は、HY4 Previewにそうしたことが起きたと示唆するものではない。ただ、85.4に基づく採用判断は、一つの情報源に依存しているというだけのことだ。
実用的に言い換えれば、HY4 Preview はベンチマーク表の上ではなく、自分自身のトラフィックで評価すべきであり、そのコスト構造はそれを安価に実行できるものにしている——GPT-6 Sol の出力単価の4分の1なら、実際のプロンプトに対して1週間シャドウトラフィックを流しても、API ティアのレビュー1回分より安く済む。これが、測定が不十分なモデルに対する適切なデューデリジェンスの形であり、そしてほとんど誰も実際にはやらない形である。
オープンウェイト問題、それこそが本当の分水嶺
HY4 Preview は Apache 2.0 の下でオープンソース化されており、ベースチェックポイントと並んで、寛容なライセンスの FP8 ビルドも提供されています。GPT-6 Sol はクローズドで、ライセンスするものが何もないため、ライセンスファイルもありません。この比較における他のすべてはトレードオフですが、これだけはカテゴリーの違いです。
それで得られるのは、主として安い請求額ではない——出力100万あたり2.50ドルで、ホスト型APIはすでに、7700億パラメータのモデルを動かす大多数のチームのコストを下回っており、コストが議論のすべてなら、寛容なライセンスなど的外れだろう。それで得られるのは、誰のエンドポイントにも依存しないデプロイだ。レート制限をかけられない重み、手持ちのハードウェアに収まるよう量子化できるチェックポイント、ファインチューニングできるモデル、そしてネットワーク境界の内側にとどめられるトラフィック。GPT-6 Solのこれら4つすべてに対する答えは、それらのどれも必要ないはずだ、というものだ。それは実在するチーム群にとっては真っ当な主張であり、実際にそれらを必要とするチームにとっては無関係な主張である。
モダリティの分割とライセンス条項は同じ方向を指しており、これは注目に値する。テキストだけを読み、Apache 2.0 で提供されるモデルは、コンポーネントとなるように作られている — 自分が管理するパイプラインの中に組み込み、すでに整合を取ったテキストを投入するものだ。テキスト、画像、ファイルを読み、API 経由でのみアクセスできるモデルは、エントリーポイントとなるように作られており、雑多な入力を直接引き受ける。これらは別の仕事であり、それらを一つの指標で順位付けする比較は、どちらのベンダーも尋ねていない問いに答えている。

それらをまとめて配信すること、そしてトラフィック数が何を意味するのか
両モデルは、他200以上とともに1つのOrcaRouterキーの背後にあり、この組み合わせが示唆するルーティングの形は、明白なものの逆である。HY4 Previewを先に配置する——出力では4分の1と安価なモデルであり、文書化されたアーキテクチャを持つものであり、私たちのルートでは負荷を担っているものである——そして、画像読み取りが必要なリクエスト、64,000トークンを超えて出力する必要があるリクエスト、または品質チェックに失敗するリクエストのために、GPT-6 Solをその後ろに置く。この構成はアプリケーションコードではなくルーティングDSLで表現されるため、両者の境界はデプロイなしで編集できるルールである。
速度の数値には一言注意を添えておくべきで、その後で結論に移る。当社のローリングウィンドウでは、HY4 Preview は毎秒約54出力トークン、GPT-6 Sol は約244と測定されている。どちらも制御されたベンチマークではなく、共有インフラ上での観測だ。特に Tencent の数値は、アクティブパラメータ数が非常に多いモデルを反映しており、トークンあたり490億がアクティブというのは、出力トークンあたりの演算量としてかなりのものになる。つまり、安いほうのモデルが大差で遅いということになる。これはまさに、バッチパイプラインなら喜んで受け入れるトレードオフであり、インタラクティブな用途なら受け入れないものだ。Tencent のホスト型ビルドも2026年9月7日に性能最適化を受けており、ベンダーによれば、同じタスク品質のまま推論ターンとタスクあたりのトークン消費量を削減するという。これもベンダー側の説明による数値だが、より速いストリームではなく、より低い請求額を予測させるものだ。
フェイルオーバーがあるからこそ、どちらの順序でもこのペアリングは安全になる。7700億パラメータのオープンウェイトモデルは複数のインフラプロバイダーによって提供されており、フォールバックできるルートがあれば、劣化したホストは障害ではなくリトライで済む。当社のカタログはプロバイダーの定価を上乗せなしでそのまま反映しており、これは通貨建てで示されたベンダー料率を待つ必要がないことも意味する。TencentはHY Previewを入力100万トークンあたり6元、出力100万トークンあたり18元で掲載しており、当社ページに表示されるドル額はその料率を換算したもので、再販業者のマージンではない。

このペアは実際に何のためなのか
Tencent HY4 Preview は、大量処理に、自分で管理するテキスト専用パイプラインに、自社ハードウェア上で実行する必要があるものに、そして誤った回答を検出して再試行できるあらゆるワークロードに使う。価格のおかげで、再試行は手元にある最も安価な品質向上レバーになる。GPT-6 Sol は、入力が画像またはファイルの場合に、1つの応答で64,000トークンを超える必要がある場合に、または回答を受け取った人が確認せずに行動に移す場合に使う。トラフィックにそれぞれが含まれているなら、両方を採用する。ほぼ確実に含まれているはずだ。
最後に2点、確認があります。HY4 Preview は今もプレビューと表示されており、当社のカタログで最新の Tencent モデルであり続けているので、その名前は古びているどころか正確です。ただし、プレビューは気づかないうちに中身が変わることがあり、寛容なライセンスのチェックポイントは、自身の最終リリースに予告なく取って代わられる可能性があります。そして GPT-6 Sol はすでに GPT-6.1 Sol に置き換わっており、短いコンテキストの料金は同じで、キャッシュされた入力は $0.20 から $0.10 に半減し、OpenAI 自身のモデルページも今や読者をそちらへ案内しています。Sol を Tencent モデルではなく検討している理由が8日前の統合にあるのなら、それは有効です。能力にあるのなら、価格を付けるべきなのは後継モデルのほうです。
この記事で比較したモデル2
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
