
Solar Mini 4 対 Qwen3.8-Max:最後の20インデックスポイントに実際にいくらかかるのか
- openaiNEWOpenAI: GPT-6.1 Sol2026-09-29$2.00 / $10.00 100万トークンあたり
- anthropicNEWAnthropic: Claude Sonnet 5.52026-09-28$2.00 / $10.00 100万トークンあたり · 159 tok/s
- typesafeNEWTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 100万トークンあたり · 220 tok/s
- OpenAINEWOpenAI: GPT-6 Luna2026-09-2238知能
- OpenAINEWOpenAI: GPT-6 Sol2026-09-2248知能
- AnthropicNEWAnthropic: Claude Opus 5.52026-09-2258知能
- xAINEWGrok 4.72026-09-2146知能
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 100万トークンあたり · 118 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- OpenAIOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- AnthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 100万トークンあたり · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり · 217 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
Solar Mini 4 の料金は、入力トークン100万あたり0.10ドル、出力トークン100万あたり0.40ドルです。Qwen3.8-Max は、多くの人が「Qwen 3.8」と入力して API を求めるときに指すモデルで、料金は2.00ドルと6.00ドルです。料金表の上では、入力価格に20倍の差があるように読めます。両モデルが今回受けた独立系評価では、正直な数字として、Qwen3.8-Max は Artificial Analysis Intelligence Index で45.4を記録し、Solar Mini 4 は24.1 — 測定された能力は約2倍 — 一方で、完了したタスクあたりのコストは約15倍です。この組み合わせについて知る価値のあることはすべて、これら2つの比率の差と、Upstage のモデルが毎秒204トークンで動作する一方、Alibaba のフラッグシップが毎秒39トークンで動作するという事実にあります。
数字の前に命名についての注意を一つ。それが購入するものを変えるからです。Qwen 3.8はモデルではなく世代です。ホスト型のフラッグシップはQwen3.8-Maxで、0902という日付付きスナップショットとして更新されており、同じ世代のダウンロード可能なものはQwen3.8-2.4T-A95B、Alibabaが2026年8月12日に公開した2.4兆パラメータの重みです。2026年9月22日にリリースされたSolar Mini 4は、Upstageの350億パラメータのスパースなMixture-of-Expertsで、トークンあたり約30億パラメータが活性化し、どの価格でもオープンウェイトはありません。
調達を決定づける次元における、その2つの列
• Intelligence Index — Qwen3.8-Max(0902)は45.4、Solar Mini 4は24.1(いずれもIntelligence Index v4.3.2)。
• 完了したタスクあたりのコスト — Qwen3.8-Max は5.41ドル、Solar Mini 4 は0.36ドル。およそ15対1で、しかも誰も口にしない比率だ。
• 料金表 — Qwen3.8-Max は100万トークンあたり $2.00 / $6.00、キャッシュ入力 $0.25 であるのに対し、Solar Mini 4 は $0.10 / $0.40、キャッシュ入力 $0.01。
• コンテキスト — どちらも1,000,000トークンで、これは安価なモデルが一切引けを取らない唯一の次元だ。Artificial AnalysisはQwen3.8-Maxを983,616、Solar Mini 4を1,048,576と記載しており、Upstage自身のドキュメントは512Kとしている。そのため、小さいモデルの上限のほうが、両者の中ではより不確かなものとなっている。
• ウェイト — Qwen3.8-Max はプロプライエタリなホステッド提供であり、そのオープンな兄弟モデルである Qwen3.8-2.4T-A95B はカスタムライセンスの下でダウンロード可能で、262,000トークンのコンテキストで同じ指標において39.9を記録しています。Solar Mini 4 はプロプライエタリで、オープンな兄弟モデルは存在しません。
• スループット — 同一ラボの測定によると、Solar Mini 4 は毎秒204出力トークン、Qwen3.8-Max は39.5。タスクあたりのコストが15分の1で済むモデルが、それを5倍の速さでこなしている。
21の指数ポイントで何が買えるか

彼らは分布の難しい端を買っている。Humanity's Last Exam では、Qwen3.8-Max は 43.1% の項目に正答するのに対し、Solar Mini 4 は 25.8% だ。科学的コーディングでは 52.1% 対 47.6%。エージェント型ナレッジワークでは、その差は別次元のカテゴリへと広がる。Qwen3.8-Max は GDPval-AA で 1663 Elo に達し、Solar Mini 4 は 1072 にとどまる——600 近い Elo ポイントであり、これは丸め誤差ではなく、そのモデルに無人で任せて信頼できることの中身が変わることを意味する。
小型モデルが自らの立場を守るだけでなく勝利する唯一の評価項目は、長文脈推論です。Solar Mini 4 は AA-LCR v1.1 で83.3%を記録し、Qwen3.8-Max は80.3%です。これはこの比較全体において Solar Mini 4 を支持する最も強力な論拠です。「非常に長い文書を読み、その全体にわたって推論する」ことを試すために作られたベンチマークにおいて、タスクあたり15倍の価格は、3ポイント劣る結果を買っているにすぎません。
どちらのモデルも適切な道具ではない領域は、自律的なターミナル作業だ。Solar Mini 4 は Terminal-Bench 4.0 で 1% を記録し、Qwen3.8-Max は 38.9% を記録する。20 の難関ターミナルタスクのうち 8 つをクリアするモデルは、そこでは本当に使えるが、もう一方はそうではない。これは、この比較において、程度の差ではなく種類の差を示す最も明快な例である。
なぜフラッグシップモデルのタスクあたりの請求額は、そのトークン価格から想像されるよりもはるかに悪いのか
Qwen3.8-MaxはSolar Mini 4よりもタスクあたりの出力が多く、107,700トークン対88,300トークンであり、しかもそれを100万トークンあたり$0.40ではなく$6.00で出力する。キャッシュの挙動を考慮するまでもなく、それだけでギャップの大部分が説明できる。アリババは実際に$0.25のキャッシュ入力料金を提供しており、これは$2.00の入力価格に対する実質的な割引だ。また、このファミリーのオープンな兄弟モデルであるQwen3.8-2.4T-A95Bは、約950億パラメータが有効な2.4兆パラメータのスパースモデルであり、生成されるすべてのトークンはかなり大きなマシンによって生成されている。これはいずれも批判ではない。これがタスクあたり15倍の乗数が存在する理由であり、これら2つのモデル間のトークンあたり価格比較が双方向に誤解を招く理由である。
実用上の帰結:Solar Mini 4 は「低予算版 Qwen 3.8」ではない。たまたま安価で高速、そしてちょうど一つの軸――長文書――において強い専門特化型であり、誤ると最もコストがかかる軸、すなわちエージェント的信頼性において弱い。Qwen3.8-Max は汎用型であり、その優位性はまさに、誤った答えが高くつく場面で現れる。
両方を走らせる、どちらかを選ぶのではなく
これは Solar Mini 4 シリーズでは珍しいケースで、比較する両側とも当社が実際に販売できるルートです。Qwen3.8-Max とその日付入りの 0902 スナップショットは OrcaRouter 上にベンダー自身の $2.00 / $6.00 の定価で並んでおり、Qwen3.8-Flash が $0.15 / $0.47、Qwen3.8-27B が $0.33 / $2.40 — 同じ世代の3つの段階を、1つのキーで、2つ目の契約もなく、モデル文字列以外のコード変更もなしに使えます。2026年10月1日時点の当社独自のプレイグラウンド計測では、直近7日間で Qwen3.8-Max は p50 が 2.5 秒、出力は毎秒 87.7 トークンです。この期間はローリングで更新されるため、この一文ではなくライブのモデルカードを参照してください。Upstage のモデルは当社を通じては利用できず、Solar Mini 4 は Upstage 独自の API 経由でアクセスする必要があります。

それが可能にするのは、この比較が提唱する分割だ。長文ドキュメント、韓国語、構造化抽出のトラフィックは安価な方へ送り、推論中心でツールを使うリクエストはフラッグシップへ回し、不調になったプロバイダーはフェイルオーバーに任せる。ここはまた、ルーティングDSLが真価を発揮する場面でもある——モデルを単一の呼び出しに組み合わせれば、安価な初回パスと高価な検証パスを、同期を取り続けなければならない2つの統合ではなく、1つのエンドポイントに対する1つのリクエストにできる。
短いバージョン

ワークロードがロングコンテキストで、出力形式が固定されており、許容できるレイテンシ予算があるなら、Solar Mini 4 はロングコンテキストの結果の83%を、タスクコストの15分の1、スループット5倍で提供します。そして、不足している21のインデックスポイントがあなたのダッシュボードに現れることは決してありません。ワークロードがツール、マルチステップエージェント、または自信に満ちた誤答が無回答より悪い質問を伴うなら、不足しているポイントこそが製品のすべてであり、Qwen3.8-Max は15倍の価格に値します。上記で Artificial Analysis に帰属するすべての数値は、同組織による独立した測定値です。Qwen3.8 の名称とリリース日は Alibaba のものであり、OrcaRouter のサービング数値は、当社独自のプレイグラウンドによる直近7日間のローリングウィンドウでの測定値です。
この記事で比較したモデル1
この記事から検出 · ベンチマーク:Artificial Analysis · 毎日更新
