
Solar Mini 4 vs Gemma 4 12B:ダウンロードするチェックポイントと、呼び出して使うモデル
- OpenAINEWOpenAI: GPT-6 Luna2026-09-2237知能
- OpenAINEWOpenAI: GPT-6 Sol2026-09-2248知能
- OrcaNEWOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 100万トークンあたり
- orcaNEWOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 100万トークンあたり
- deepseekNEWDeepSeek: DeepSeek V4.1 Flash2026-09-1040知能
- openaiOpenAI: GPT-6 Astra2026-09-0453知能77コーディング
- googleGoogle: Gemini 3.8 Flash2026-09-0241知能76コーディング
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245知能76コーディング
- anthropicAnthropic: Claude Fable 5.12026-09-0153知能82コーディング
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 100万トークンあたり
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642知能72コーディング
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 100万トークンあたり
- z-aiZ.ai: GLM 5.32026-08-1845知能75コーディング
- obsidianQwen3.8 27B2026-08-1534知能68コーディング
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236知能69コーディング
- grokSpaceXAI: Grok 4.62026-08-1244知能77コーディング
- metaMeta: Muse Spark 1.22026-08-0540知能72コーディング
- qwenQwen: Qwen3.8 Max2026-08-0345知能76コーディング
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134知能69コーディング
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
Solar Mini 4 と Gemma 4 12B の最も短く正直な比較は、一方がファイルで、もう一方がエンドポイントだという点です。Upstage の Solar Mini 4 は、350億パラメータの Mixture-of-Experts モデルで、トークンあたり30億パラメータがアクティブになり、コンテキストウィンドウは512,000トークン、オープンウェイトはありません。利用するには Upstage Console、Playground、またはベンダーと調整するオンプレミス展開を通します。Gemma 4 12B は Apache 2.0 の下で提供される119.5億パラメータの dense チェックポイントで、今日ダウンロードでき、ラップトップ上の約16 GBのユニファイドメモリで動作します。どちらもエージェント的作業向けに作られ、どちらも長い文書を入力として受け取りますが、あなたのスタック内で同じ枠を争っているわけではありません。一方にはメモリの請求書があり、もう一方にはトークンの請求書があるからです。
その違いは見落とされてしまう。なぜなら、2つのモデルは機能一覧では似て見えるからだ。どちらも推論し、どちらもツールを呼び出し、どちらも構造化出力を生成し、どちらも英語、韓国語、日本語を扱う。問いを決める違いは別のところにある。午前3時にシステムがダウンしたとき何が起きるのか、データがどこにあるかについてコンプライアンスチームが何と言うか、そしてトークン単位で支払うのかGPU時間単位で支払うのか、である。
仕様の対比、次元ごとに
• アーキテクチャ — Solar Mini 4 はスパースです:総パラメータ数は 35B で、トークンあたり 3B がアクティブです。Gemma 4 12B はデンスで、その 11.95B のパラメータすべてがトークンごとに動作します。Solar は 10 倍の重みを保存し、その 4 分の 1 で計算します。Gemma は 4 分の 1 を保存し、そのすべてで計算します。
• 実行場所 — Solar Mini 4 は Upstage のインフラストラクチャ(Console、Playground)上、またはオンプレミス構成で自社環境内で動作します。Gemma 4 12B はお使いのハードウェア上で動作します。フル精度で約 16 GB の統合メモリ、4 ビットでは 8 GB 近くになり、単一のコンシューマー向け GPU または M シリーズのノートパソコンに収まります。
• 重み — Gemma 4 12B は Apache 2.0、つまり収益のしきい値なしで商用利用、改変、再配布が可能。Solar Mini 4 はクローズド。Upstage はこれまでにもオープンウェイトを公開してきたが、今回のリリースについて、同社がここでそうする予定であることを示すものは何もない。
コンテキスト — Solar Mini 4 は 512,000 トークンで、出力は最大 128,000 トークンです。Gemma 4 12B は 256,000 トークンで、Artificial Analysis のモデルページでは 260K と記載されています。両者では Solar のほうが長く、その差はわずかではありません。
• モダリティ — Gemma 4 12B はエンコーダ不要のマルチモーダルです。画像パッチと 16 kHz 音声は言語モデルの埋め込み空間に直接投影されるため、テキスト、画像、音声、動画を入力として受け取り、テキストを返します。Solar Mini 4 はテキスト入力、テキスト出力です。これは Gemma が完全に、しかも大差で勝利する唯一の次元です。
• 価格 — Solar Mini 4 は100万入力トークンあたり0.10ドル、100万出力トークンあたり0.40ドル、キャッシュ済み入力は0.01ドル。50%のローンチプロモーションは2026年10月22日まで実施される。Gemma 4 12B はダウンロードが無料で、Artificial Analysis は2026年9月22日にページを取得した時点で、ホスト型推論を100万トークンあたり入力0.10ドル、出力0.30ドルと掲載していた。
• 知識カットオフ — Solar Mini 4 は2026年2月、Gemma 4 12B は2026年6月3日にリリースされ、知識カットオフは2025年1月。どちらも十分に古いため、検索は必須である。
• 独立したスコア — Solar Mini 4 はリリースから1日経った時点でまだスコアがありません。Gemma 4 12B は Artificial Analysis Intelligence Index で14を記録し、同クラスで追跡されている142モデル中22位、出力は毎秒112.7トークンです。
Gemma 4 12Bは実際には何のためにあるのか

Gemma 4 12Bは、高性能なマルチモーダルモデルを、あなたが管理できる場所に置くために存在します。Googleがローンチ時に示した位置づけは、同社自身の26B mixture-of-expertsモデルに半分以下のメモリで迫り、前世代のGemma 3 27Bを推論、科学、文書タスクで上回るというものでした。その主張を支えるベンダー公表の数値は、このサイズとしては強力です。MMLU-Proで77.2%、GPQA Diamondで78.8%、DocVQAで94.9、InfoVQAで88.4。いずれもGoogle自身の数値であり、独立に再現されたものではありません。
興味深いエンジニアリング上の決断は、Gemma 4 12B には独立した視覚エンコーダーも音声エンコーダーもないことだ。画像パッチは単一の行列乗算によってモデルの埋め込み空間に射影され、生の音声も同じように入力される。これにより、言語モデルと並行して2つの追加タワーを走らせるためのメモリとレイテンシのコストがなくなり、マルチモーダルモデルが16 GBに収まる理由でもある。また、これは言語モデルがエンコーダーが担うはずだった仕事を吸収することを意味し、細かな視覚的ディテールにとっては実際のトレードオフになる。
エージェントの作業において、実用的な帰結は、これら2つのモデルのうち、ループの一部としてスクリーンショット、スキャンしたページ、または音声メモを読み取れるのは Gemma 4 12B だけだという点にある。あなたのエージェントの仕事に何かを見ることが含まれるなら、比較は始まる前に終わっている。
Solar Mini 4は実際には何のためのものか
Solar Mini 4は逆のケースを狙っています。つまり、入力がテキストで量が多く、高頻度でコストに敏感なワークロードです。Upstage自身の説明は「応答速度とコストが重要」であり、3Bのアクティブパラメータ数がその仕組みです。この比率のスパースモデルは提供コストが安く、だからこそUpstageは512Kウィンドウを持つものに対して100万入力トークンあたり$0.10を提示できるのです。
512Kのコンテキストは、より切れ味の鋭い武器だ。これはUpstageがフラッグシップのSolar Pro 4で提供しているのと同じ数値であり、つまりこのコンパクトモデルが文書容量の点で過小評価されているわけではないということだ——400ページの契約書、コードベース全体、1年分のサポートチケット。Gemma 4 12Bの256Kは、通常の基準からすれば十分に寛大であり、この基準で見ればSolarの半分にすぎない。
推論はMiniシリーズにとって新しいものです。前世代のsolar-miniモデルはreasoning_effortパラメータを完全に無視しますが、Solar Mini 4はこれを受け付け、サードパーティのエージェントツールも、それを拒否リストに入れるのではなく推論対応として扱うよう更新されています。Upstageは同日、Solar Jevもリリースしました。これはSolar Mini 4上で提供されるベータ版の意思決定エンドポイントで、一切の文章を伴わずに選択肢、スコア、または確率を返します — このモデルがどのようなワークロード向けだとUpstageが考えているかを示すシグナルです。
本稿執筆時点で、Solar Mini 4には単一の独立した数値が存在しない。Intelligence Indexもなく、Agent Arenaでの順位もなく、Upstageからのベンチマーク表もない——チェンジログの項目には仕様が記載されているだけで、スコアはない。出回っている唯一のサードパーティ的な数値は、コミュニティ製ラッパーが自己申告したtest400実行で、明記されたルーブリックの下で別のモデルによって判定されたものだ。そこではSolar Mini 4がreasoning_effort=noneで98.4%のフィールド精度を記録し、呼び出しあたり平均1.21秒だった。それは一人の開発者が自身のハーネスと比較したものにすぎず、本番判断を動かす理由にはならない。
決め手となる比較

GPUを持っていて、データを社内に保持する理由があるなら、Gemma 4 12BはSolar Mini 4とはまったく競合していません — 競合しているのは電気代です。一度ダウンロードすれば、永遠に実行でき、トークンごとに支払うものは何もなく、Solar Mini 4がどんな価格でも提供しないマルチモーダル入力が得られます。後から発生するコストは運用上のものです。誰かがサービングスタックを所有する必要があり、Googleが次をリリースしたときにアップグレードを処理する必要があり、スループットは購入したハードウェアによって上限が決まります。
GPUを持っていない場合、あるいは持っていてもワークロードの負荷変動が大きい場合、資本コストがかからないのはSolar Mini 4です。ローンチプロモーション中は入力トークン100万個あたり$0.05、その後は$0.10を支払うだけで、コンテキストウィンドウは2倍になり、オンコール当番の代わりにベンダーSLAが手に入ります。犠牲になるのは、重み、マルチモーダル入力、そして「自分のデータはどうなるのか」という問いに「この建物から一切出ない」と答えられる能力です。
価格比較は、見出しの数字が示すよりも差が小さく、慎重に検討する価値がある。定価ベースでは、Solar Mini 4 とホスト型の Gemma 4 12B は入力で同じコスト($0.10)で、Gemma は出力で安い($0.40 に対して $0.30)。Upstage のプロモーション期間中は、Solar は両方ともその半額になる。ワークロードが入力重視の場合——長い文書、短い回答——両者は定価では実質的に同等で、今日は Solar のほうが安い。出力重視の場合は、プロモーションが実施されていない限り Gemma のほうが安い。
スタックを再ビルドせずにどちらか一方を実行する
この決定の厄介な点は、明らかに可逆的ではないことだ。Gemma 4 12B をダウンロードすると、特定のサービングスタックに縛られる。Solar Mini 4 を採用すると、特定の API の形に縛られる。どちらを選んでも、6か月後に再評価するのを妨げるのは切り替えコストであり、ルーターを構成に残しておく正直な理由は、そのコストをほぼゼロに保つことにある。
正確を期すために一点述べておくと、OrcaRouter は Upstage のモデルを一切ルーティングしていないため、Solar Mini 4 はここでは利用できません — これは Upstage 自身の API といくつかのサードパーティプラットフォームから提供されています。Google のより大きな Gemma 4 サイズ、すなわち 26B-A4B と 31B はルーティングしていますが、本稿が扱う 12B チェックポイントは含まれていません。この文脈においてこのプラットフォームが実際に何のためのものかというと、この次の比較を行うためです。つまり「コンパクトなエージェントモデル、テキスト入力」と決めたら、興味深い問いはどれを選ぶかになり、それは3 つを 1 つのキーの背後に置くことで、別のスペックシートを読むのではなく自分のトラフィックで測定することによって答える問いです。複数のモデルを 1 つの呼び出しにまとめるルーティング DSL があれば、3 つの統合を書かずにそのテストを実行できます。

どちらを選ぶべきですか
ハードウェアがあるなら、エージェントが画像を見たり音声を聞いたりする必要があるなら、ファインチューニング用の重みが必要なら、あるいは「データはどこに行くのか」の答えが「どこにも行かない」でなければならないなら、Gemma 4 12Bを選びましょう。推論を実行したくないなら、入力が長いテキストで出力が短いなら、512Kウィンドウが重要なら、あるいはベンダー契約に裏打ちされた韓国語優先モデルが必要なら、Solar Mini 4を選びましょう。
迷っているなら、決め手はベンチマークではない。それは、Solar Mini 4についてまだ答えられない問いだ。Upstageの外でそれを測定した者はいない。Gemma 4 12BにはIntelligence Indexが14あり、公開ランキングもある。Solar Mini 4には仕様書、価格、そして10月22日に終了するプロモーションがある。その期間中に試すには数ドルで済む。それを本番経路として賭けると、数字が到着したときに芳しくなければ、書き直しを強いられる。
