生成されたヒーロータイトルカードは「Solar Mini 4 vs Qwen3.8-Max」と表示し、サブタイトルは「直近20インデックスポイントに実際いくらかかったのか」、2つのバッジは「インデックス上で24.1 対 45.4」と「タスクあたり$0.36 対 $5.41」と表示している。
Guides & Insights

Solar Mini 4 対 Qwen3.8-Max:最後の20インデックスポイントに実際にいくらかかるのか

著者

Magnus Corvin

公開日

最新モデル · 20すべてのモデルを見る →
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

Solar Mini 4 の料金は、入力トークン100万あたり0.10ドル、出力トークン100万あたり0.40ドルです。Qwen3.8-Max は、多くの人が「Qwen 3.8」と入力して API を求めるときに指すモデルで、料金は2.00ドルと6.00ドルです。料金表の上では、入力価格に20倍の差があるように読めます。両モデルが今回受けた独立系評価では、正直な数字として、Qwen3.8-Max は Artificial Analysis Intelligence Index で45.4を記録し、Solar Mini 4 は24.1 — 測定された能力は約2倍 — 一方で、完了したタスクあたりのコストは約15倍です。この組み合わせについて知る価値のあることはすべて、これら2つの比率の差と、Upstage のモデルが毎秒204トークンで動作する一方、Alibaba のフラッグシップが毎秒39トークンで動作するという事実にあります。

数字の前に命名についての注意を一つ。それが購入するものを変えるからです。Qwen 3.8はモデルではなく世代です。ホスト型のフラッグシップはQwen3.8-Maxで、0902という日付付きスナップショットとして更新されており、同じ世代のダウンロード可能なものはQwen3.8-2.4T-A95B、Alibabaが2026年8月12日に公開した2.4兆パラメータの重みです。2026年9月22日にリリースされたSolar Mini 4は、Upstageの350億パラメータのスパースなMixture-of-Expertsで、トークンあたり約30億パラメータが活性化し、どの価格でもオープンウェイトはありません。

調達を決定づける次元における、その2つの列

• Intelligence Index — Qwen3.8-Max(0902)は45.4、Solar Mini 4は24.1(いずれもIntelligence Index v4.3.2)。

• 完了したタスクあたりのコスト — Qwen3.8-Max は5.41ドル、Solar Mini 4 は0.36ドル。およそ15対1で、しかも誰も口にしない比率だ。

• 料金表 — Qwen3.8-Max は100万トークンあたり $2.00 / $6.00、キャッシュ入力 $0.25 であるのに対し、Solar Mini 4 は $0.10 / $0.40、キャッシュ入力 $0.01。

• コンテキスト — どちらも1,000,000トークンで、これは安価なモデルが一切引けを取らない唯一の次元だ。Artificial AnalysisはQwen3.8-Maxを983,616、Solar Mini 4を1,048,576と記載しており、Upstage自身のドキュメントは512Kとしている。そのため、小さいモデルの上限のほうが、両者の中ではより不確かなものとなっている。

• ウェイト — Qwen3.8-Max はプロプライエタリなホステッド提供であり、そのオープンな兄弟モデルである Qwen3.8-2.4T-A95B はカスタムライセンスの下でダウンロード可能で、262,000トークンのコンテキストで同じ指標において39.9を記録しています。Solar Mini 4 はプロプライエタリで、オープンな兄弟モデルは存在しません。

• スループット — 同一ラボの測定によると、Solar Mini 4 は毎秒204出力トークン、Qwen3.8-Max は39.5。タスクあたりのコストが15分の1で済むモデルが、それを5倍の速さでこなしている。

21の指数ポイントで何が買えるか

A two-column comparison scoreboard titled 'Solar Mini 4 vs Qwen3.8-Max', subtitled 'Roughly twice the capability at about fifteen times the task cost'. Solar Mini 4: Intelligence Index 24.05; cost per index task $0.36; rate card per 1M $0.10 in / $0.40 out; cached input $0.01 per 1M; context 1.05M listed and 512K claimed; output speed 204 tokens per second; output per task 88,300 tokens; long-context reasoning 83.3% on AA-LCR v1.1. Qwen3.8-Max: Intelligence Index 45.42; cost per index task $5.41; rate card per 1M $2.00 in / $6.00 out; cached input $0.25 per 1M; context 983,616; output speed 39.5 tokens per second; output per task 107,700 tokens; long-context reasoning 80.3% on AA-LCR v1.1.

彼らは分布の難しい端を買っている。Humanity's Last Exam では、Qwen3.8-Max は 43.1% の項目に正答するのに対し、Solar Mini 4 は 25.8% だ。科学的コーディングでは 52.1% 対 47.6%。エージェント型ナレッジワークでは、その差は別次元のカテゴリへと広がる。Qwen3.8-Max は GDPval-AA で 1663 Elo に達し、Solar Mini 4 は 1072 にとどまる——600 近い Elo ポイントであり、これは丸め誤差ではなく、そのモデルに無人で任せて信頼できることの中身が変わることを意味する。

小型モデルが自らの立場を守るだけでなく勝利する唯一の評価項目は、長文脈推論です。Solar Mini 4 は AA-LCR v1.1 で83.3%を記録し、Qwen3.8-Max は80.3%です。これはこの比較全体において Solar Mini 4 を支持する最も強力な論拠です。「非常に長い文書を読み、その全体にわたって推論する」ことを試すために作られたベンチマークにおいて、タスクあたり15倍の価格は、3ポイント劣る結果を買っているにすぎません。

どちらのモデルも適切な道具ではない領域は、自律的なターミナル作業だ。Solar Mini 4 は Terminal-Bench 4.0 で 1% を記録し、Qwen3.8-Max は 38.9% を記録する。20 の難関ターミナルタスクのうち 8 つをクリアするモデルは、そこでは本当に使えるが、もう一方はそうではない。これは、この比較において、程度の差ではなく種類の差を示す最も明快な例である。

なぜフラッグシップモデルのタスクあたりの請求額は、そのトークン価格から想像されるよりもはるかに悪いのか

Qwen3.8-MaxはSolar Mini 4よりもタスクあたりの出力が多く、107,700トークン対88,300トークンであり、しかもそれを100万トークンあたり$0.40ではなく$6.00で出力する。キャッシュの挙動を考慮するまでもなく、それだけでギャップの大部分が説明できる。アリババは実際に$0.25のキャッシュ入力料金を提供しており、これは$2.00の入力価格に対する実質的な割引だ。また、このファミリーのオープンな兄弟モデルであるQwen3.8-2.4T-A95Bは、約950億パラメータが有効な2.4兆パラメータのスパースモデルであり、生成されるすべてのトークンはかなり大きなマシンによって生成されている。これはいずれも批判ではない。これがタスクあたり15倍の乗数が存在する理由であり、これら2つのモデル間のトークンあたり価格比較が双方向に誤解を招く理由である。

実用上の帰結:Solar Mini 4 は「低予算版 Qwen 3.8」ではない。たまたま安価で高速、そしてちょうど一つの軸――長文書――において強い専門特化型であり、誤ると最もコストがかかる軸、すなわちエージェント的信頼性において弱い。Qwen3.8-Max は汎用型であり、その優位性はまさに、誤った答えが高くつく場面で現れる。

両方を走らせる、どちらかを選ぶのではなく

これは Solar Mini 4 シリーズでは珍しいケースで、比較する両側とも当社が実際に販売できるルートです。Qwen3.8-Max とその日付入りの 0902 スナップショットは OrcaRouter 上にベンダー自身の $2.00 / $6.00 の定価で並んでおり、Qwen3.8-Flash が $0.15 / $0.47、Qwen3.8-27B が $0.33 / $2.40 — 同じ世代の3つの段階を、1つのキーで、2つ目の契約もなく、モデル文字列以外のコード変更もなしに使えます。2026年10月1日時点の当社独自のプレイグラウンド計測では、直近7日間で Qwen3.8-Max は p50 が 2.5 秒、出力は毎秒 87.7 トークンです。この期間はローリングで更新されるため、この一文ではなくライブのモデルカードを参照してください。Upstage のモデルは当社を通じては利用できず、Solar Mini 4 は Upstage 独自の API 経由でアクセスする必要があります。

A screenshot of the OrcaRouter model page for Qwen3.8-Max, showing the model id qwen/qwen3.8-max at $2.00 input and $6.00 output per million tokens, text, image and video input with text output, vision, tools, JSON and reasoning capability flags, a 2.5-second median time to first token from our own playground, and the description of Alibaba's newest flagship model in the Qwen line.

それが可能にするのは、この比較が提唱する分割だ。長文ドキュメント、韓国語、構造化抽出のトラフィックは安価な方へ送り、推論中心でツールを使うリクエストはフラッグシップへ回し、不調になったプロバイダーはフェイルオーバーに任せる。ここはまた、ルーティングDSLが真価を発揮する場面でもある——モデルを単一の呼び出しに組み合わせれば、安価な初回パスと高価な検証パスを、同期を取り続けなければならない2つの統合ではなく、1つのエンドポイントに対する1つのリクエストにできる。

短いバージョン

A screenshot of the Artificial Analysis model page headed 'Qwen3.8 Max (0902) Intelligence, Performance & Price Analysis', marked as an Alibaba proprietary model released September 2026, ranked 32nd of 223 on intelligence, 172nd on speed and 101st on cost, with $2.00 input, $6.00 output and cached pricing rows, 39.5 output tokens per second, a $5.41 cost figure and a verbosity readout.

ワークロードがロングコンテキストで、出力形式が固定されており、許容できるレイテンシ予算があるなら、Solar Mini 4 はロングコンテキストの結果の83%を、タスクコストの15分の1、スループット5倍で提供します。そして、不足している21のインデックスポイントがあなたのダッシュボードに現れることは決してありません。ワークロードがツール、マルチステップエージェント、または自信に満ちた誤答が無回答より悪い質問を伴うなら、不足しているポイントこそが製品のすべてであり、Qwen3.8-Max は15倍の価格に値します。上記で Artificial Analysis に帰属するすべての数値は、同組織による独立した測定値です。Qwen3.8 の名称とリリース日は Alibaba のものであり、OrcaRouter のサービング数値は、当社独自のプレイグラウンドによる直近7日間のローリングウィンドウでの測定値です。

この記事で比較したモデル1

この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新