「Solar Mini 4 vs Solar Pro 4」と書かれたタイトルカード。サブタイトルは「同じコンテキストウィンドウで3倍の価格」で、青からティールへのグラデーションを背景に、右下にOrcaRouterのロゴが配置されている。
Guides & Insights

Solar Mini 4 vs Solar Pro 4:同じコンテキストウィンドウで3倍の価格

著者

Rowan Sterling

公開日

最新モデル · 20すべてのモデルを見る
ベンチマーク:Artificial Analysis · 毎日更新
すべての記事に戻る

Upstageの現行Solarモデル2つは、買い手が通常まず確認するあらゆる項目で同じスペックシートを共有している。2026年9月22日リリースのSolar Mini 4と、2026年8月6日リリースのSolar Pro 4は、どちらも512,000トークンのコンテキストを受け入れ、最大128,000の出力トークンを生成し、英語、韓国語、日本語に対応し、学習データはいずれも2026年2月で止まっている。違いは、Solar Pro 4の価格がSolar Mini 4の3倍に設定されていること――入力100万トークンあたり0.30ドル対0.10ドル――と、Solar Pro 4には公表された独立系ベンチマークスコアがある一方、リリースから1日のSolar Mini 4にはそれがまったくないことだ。つまり、この比較が答える問いは「どちらが優れているか」ではない。3倍の価格を払っているその対象が、あなたのワークロードに不足しているものなのかどうかである。

2つの割引時計が同時に作動中

能力の議論の前に、まず価格の議論を — なぜなら現時点で、この2つのモデルは異なるプロモーション期間にあり、その計算は定価から連想されるよりも奇妙だからだ。

Solar Mini 4は9月22日にリリースされ、2026年10月22日まで50%オフとなっており、これにより現在の料金は100万トークンあたり入力$0.05、キャッシュ入力$0.005、出力$0.20です。Upstageの料金ページでは、この構造化された期間を9月22日05:00 UTCから10月23日00:00 UTCと記載しています。

Solar Pro 4 のプロモーションは9月11日に変更され、Upstage が割引を90%から70%に削減しました — 端的に言えば値上げですが、このモデルは依然として定価を大きく下回っていました。そのプロモーションは2026年10月9日まで実施され、10月10日からは通常価格になります。その期間中、Solar Pro 4 は入力 $0.09、キャッシュ $0.018、出力 $0.36 です。

つまり、今から10月9日までのおよそ2週間は、両モデルの差は3倍ではなく1.8倍です。入力は$0.09対$0.05、出力は$0.36対$0.20です。10月9日以降、Solar Pro 4は$0.30と$1.20に戻りますが、Solar Mini 4は22日まで割引価格のままです。22日以降はどちらも定価となり、差は完全な3倍になります。

Screenshot of Upstage’s pricing page showing the Solar Mini 4 and Solar Pro 4 rate cards and their separate promotional windows.

そこから3つの結論が導き出される。2つを互いにベンチマーク比較するなら、10月9日より前に行うこと。その時点では、より安価なモデルの優位性が最も小さく、価格ではなく能力を測ることになるからだ。11月に始まる本番展開の予算を組むなら、定価を使うこと。どちらのプロモーションもその時点ではもう実施されていないからだ。そして、両者間の移行を計画しているなら、クロスオーバー点はワークロードではなく日付であることを知っておくべきだ。

二つのモデルが真に大きくかけ離れている唯一の点

独立した評価こそが、Solar Pro 4がそのティアにふさわしい実力を示す場であり、Solar Mini 4はまだその問いに答えられない。

Artificial Analysisは、自社のIntelligence IndexでSolar Pro 4を42と評価した。Solar Pro 3の14から27ポイントの上昇であり、その向上はフラッグシップが勝つべきまさにその領域に集中していた。Terminal-Bench v2.1は12%から57%に上昇した。長コンテキスト推論評価であるAA-LCRは31%から71%に上昇した。τ³-Bankingは9%から23%に上昇した。実世界のエージェントタスクを人間のEloベースライン1000に対して測定するGDPval-AA v2では、Solar Pro 3は498、Solar Pro 4は1277を記録した。これらはArtificial Analysisが公表した第三者による数値であり、ベンダーによる数値ではない。

Screenshot of Artificial Analysis’s write-up on Solar Pro 4, showing its Intelligence Index score and its benchmark results against Solar Pro 3.

同じ記事は、その改善の代償について正直に述べている。Solar Pro 4 が平均的な Intelligence Index タスクを完了するには 8.6 分かかるのに対し、Solar Pro 3 は 6.0 分だ。それにもかかわらず、出力トークンは約 17% 少ない — 1 タスクあたり 43,000 対 52,000 だ。トークン効率はより高いが、実時間ではより遅い。そして AA-Omniscience スコアは −53 から −1 に改善したが、それは主に回答を控えることによるものだった。解答を試みるのはわずか 41% の質問で、Pro 3 の 92% とは対照的だ。ハルシネーション率は 88% から 24% に下がった一方、正確性はほとんど変わらず、約 17% から 19% にとどまった。回答を拒むことで誠実さスコアを高めるモデルは、エージェント作業にとって真の改善だ — 自信満々の誤答は拒否よりも高くつく — しかしそれは、より多くを知っていることと同じではない。

Solar Mini 4 には相当するものがありません。Intelligence Index も、Agent Arena の順位も、第三者によるエージェント型評価も、Upstage によるベンチマーク表もありません。出回っている唯一の数値は、コミュニティ製ラッパーが自己申告した test400 の実行を別のモデルが判定したもので、Solar Mini 4 はそこでフィールド精度 98.4%、平均呼び出し時間 1.21 秒を記録しました。これはある開発者が自身の実装に対して用いたハーネスであり、早期の兆候としては有用でも、調達の判断材料としては役に立ちません。

3Bアクティブパラメータで得られるもの、得られないもの

パラメータの開示は、この組み合わせにおいて意図を示す最も明確な表明である。Solar Mini 4 は総パラメータ数が 35B で、トークンあたり 3B がアクティブになる。Solar Pro 4 のパラメータ数は非公開である。

3Bのアクティブ比率は、サービング経済性の判断であり、能力の主張ではありません。これは、モデルが35Bの重みを保存し、トークンごとに3B分の演算を行うことを意味しており、だからこそUpstageは512Kコンテキストのモデルを入力100万トークンあたり$0.10で価格設定できます。Solar Pro 4の$0.30という価格は、トークンあたりより多くの処理を行っていることを示しています。Upstageがその数値を公表していないことは、算術的に比較されたくないことを示しています。

公表されている証拠に基づけば、実際に両者を分けているのは、渡される文書のサイズではなく、モデルが完了を求められるタスクの難易度だ。Solar Mini 4は512Kコンテキストと最大128K出力で発表された——フラッグシップと同じ数値——なので、長文書のケースがティアの境界ではない。境界は多段階のエージェント作業にある。Terminal-Bench、τ³-Banking、GDPvalの数値こそがSolar Pro 4の価格で買っているものであり、これらは多くのターンにわたる計画、ツール呼び出し、誤りからの回復を必要とするタスクを測定している。

一言述べておく価値のある注意点がある。それはプロジェクトの途中で人を痛い目に遭わせる類のものだからだ。Upstageのモデル履歴では、Solar Pro 4は512Kコンテキスト、最大出力128Kと記載されている。Artificial Analysisによる同じモデルについての記事では、384Kのコンテキストウィンドウと256Kの最大出力が記載されている——上限と下限が入れ替わっている。どちらの情報源も信頼できるが、両者は食い違っている。限界付近でプロンプトのサイズを見積もっているなら、どちらの文書ではなくAPIレスポンスに照らして確認すべきだ。公表されている2つの数値は整合しないからである。

それぞれがパイプラインのどこに位置するか

これら2つのモデルを活かす方法は、二者択一としてではなくティアのペアとして捉えることだ。おおむねUpstageもそのように位置づけている。Solar Mini 4はデフォルトである。抽出、分類、長文書に対する構造化出力、そして百万回の安価な呼び出しがワークロードとなる高ボリュームのループだ。Solar Pro 4はエスカレーションである。計画を立て、ツールを使い、失敗したステップから回復し、それでも最後までやり遂げなければならないエージェント実行だ。

その分割の経済性は、安価なティアが正しい場合には常に、容赦なく安価なティアに有利に働く。プロモーション中の Solar Mini 4 は入力 $0.05、出力 $0.20 で、Solar Pro 4 のプロモーション料金より5~6倍安く、定価でも3倍安い。ボリュームの90%が抽出で10%がエージェント作業なら、その90%を1つ下のティアに流す方が、どんなプロンプト最適化よりも節約になる。失敗モードは誤ルーティングだ——エージェント作業を小型モデルに送り、二重に支払うことになる。1回は無駄な呼び出しで、もう1回は高価なモデルでのリトライで。

その誤ったルーティングのリスクこそが、これが価格設定の問題になる前に計測の問題である理由であり、ルーティング層がその存在意義を得る所以でもある。製品の境界について率直に言えば、OrcaRouter は Upstage のモデルを一切ルーティングしない。したがって Solar Mini 4 も Solar Pro 4 も当社を通じては利用できない。どちらも Upstage 自身の API および複数のサードパーティプラットフォームから提供されている。このプラットフォームが担うのは、この組み合わせが生み出すパターンだ。つまり、安価な階層と高価な階層、どのトラフィックをどこへ送るかのルール、そして自動フェイルオーバー——小さい方のモデルがエラーを返すか、あなたのパーサーが拒否するような応答を返したときに、呼び出しをより大きなモデルへ昇格させる仕組みだ。当社が実際にルーティングしている 190 余りのモデル全体において、その階層化は各呼び出し元に組み込むのではなく一度設定するだけで済む。両方の Solar 階層を運用しているなら、同等のロジックは Upstage 自身のコンソールにあり、注意深く読むべきなのは、いつエスカレーションするかを決める部分だ。

OrcaRouter scoreboard comparing Solar Mini 4 and Solar Pro 4 across release date, active parameters, context window, list price, promotional price and Artificial Analysis Intelligence Index.

それらをどうするか

今日どちらか一方を選ばなければならないなら、あなたの仕事がベンチマークの測る特定の意味でエージェント的である場合に限り、Solar Pro 4 を選んでください — 多段階で、ツールを使い、自己修正する、という意味です。3×分が対価を払っているのはまさにそれであり、公開された証拠が両者を明確に分けている唯一の軸です。それ以外のすべてについては、Solar Mini 4 は同じコンテキストウィンドウ、同じ出力上限、同じ3言語を提供し、価格はより低い。そして、それに対する正直な反論は、性能が弱いということではなく、Upstage の外部ではまだ誰もそれを測定していないということです。

その最後の点が判断のすべてであり、しかも期限が付いている。Solar Mini 4 のプロモーションは10月22日まで、Solar Pro 4 のプロモーションは10月9日までなので、両者を比較できる安価な期間はこの2週間しかない。どちらの期限が切れる前に、両方をプロモーション料金で、自分のトラフィックで、自分の受け入れ基準に従って動かしてみよう。Solar Mini 4 の独立系ベンチマークはいずれ出てくる。そして出てきたところで、それは誰か別の人のタスクでどう性能を発揮するかを教えてくれるだけであり、今月数ドルで買える答えとは別物で、役に立つ度合いも低い。