Сгенерированная главная титульная карточка с надписью «Solar Mini 4 vs Granite 4.2 3B», подзаголовком «Модель, которую вы вызываете, и чекпоинт, который вы скачиваете», и двумя бейджами с надписями «Около 3 миллиардов активных параметров на токен у каждой» и «Одна тарифицируется за токен, другая — за ватт».
Guides & Insights

Solar Mini 4 vs Granite 4.2 3B: модель, которую вы вызываете, и чекпоинт, который вы скачиваете

Автор

Gideon Frost

Дата публикации

Новые модели · 20Все модели →
Бенчмарки: Artificial Analysis · обновляется ежедневно
Назад ко всем статьям

Поставьте Solar Mini 4 рядом с Granite 4.2 3B — и интересное число здесь не разрыв в бенчмарках. Дело в том, что Granite 4.2 3B, модель рассуждений IBM под лицензией Apache-2.0, выпущенная 25 августа 2026 года, будет работать на ноутбуке сегодня вечером бесплатно, тогда как Solar Mini 4, проприетарная модель Upstage, выпущенная 22 сентября 2026 года, не запустится ни на одном вашем устройстве и взимает $0.10 за миллион входных токенов и $0.40 за миллион выходных токенов за ответ на вопрос. Обе активируют примерно три миллиарда параметров вычислений на токен. Одна — это файл. Другая — это счётчик.

Эта разница определяет почти всё остальное в этом сравнении, включая то, какие бенчмарки вообще стоит ставить бок о бок. Granite 4.2 3B прошла независимую оценку задолго до Solar Mini 4 — Artificial Analysis оценивает её в 9 по Intelligence Index v4.3.2, из того же набора оценок и той же организации, которая оценивает Solar Mini 4 в 24. А это значит, что пятнадцатибалльный разрыв здесь имеет необычайно прочную основу: одна лаборатория, одна методология и две модели, которые никому не пришлось принимать на веру.

Спецификация — по тем параметрам, которые действительно их разделяют.

• Архитектура — Solar Mini 4 — это разреженная смесь экспертов: 35 млрд параметров всего, 3 млрд активных на токен, по данным Upstage. Granite 4.2 3B — плотная модель, около 3 млрд параметров, примерно 4 млрд в общей сложности с учётом эмбеддингов согласно метаданным safetensors. Один и тот же бюджет активации, два разных способа его расходовать.

• Веса — Solar Mini 4 является проприетарной и закрытой моделью. Granite 4.2 3B распространяется под лицензией Apache 2.0 с документированным рецептом обучения вплоть до пропорций данных.

• Контекст — Upstage документирует 512K токенов при выводе до 128K; Artificial Analysis указывает 1,0 млн для той же модели, поэтому считайте верхний предел неопределённым. Granite 4.2 3B нативно поддерживает 131 072 токена, а пятая фаза предварительного обучения расширяет этот объём до 512K.

• Цена — Solar Mini 4 по $0.10 / $0.01 за кэшированные токены / $0.40 за миллион токенов, сейчас скидка 50% до 22 октября 2026 года. У Granite 4.2 3B нет тарифной сетки от вендора, потому что арендовать нечего; размещённые эндпоинты, которые отслеживает Artificial Analysis, оценивают его примерно в $0.03 / $0.12, а самостоятельный хостинг стоит лишь электричества.

• Индекс интеллекта — 24 у Solar Mini 4, 9 у Granite 4.2 3B, оба от Artificial Analysis v4.3.2.

• Скорость — 204 выходных токена в секунду для Solar Mini 4 и 223 для Granite 4.2 3B, обе измерены одной и той же лабораторией, время до первого чанка — 1,5 с и 0,5 с соответственно. Плотная модель быстрее по обоим показателям.

Из чего на самом деле складывается разрыв в пятнадцать пунктов

A two-column comparison scoreboard titled 'Solar Mini 4 vs Granite 4.2 3B', subtitled 'Same activation budget, two different ways of spending it'. Solar Mini 4: parameters 35B total / 3B active; weights proprietary, no download; context 512K claimed and 1.05M listed; price per 1M $0.10 / $0.01 / $0.40; Intelligence Index 24.05; cost per index task $0.36; output per task 88,300 tokens at 204 tok/s; non-hallucination 64.2%. Granite 4.2 3B: parameters 3.66B dense; weights Apache 2.0 on Hugging Face; context 131,072 native; price per 1M about $0.03 / $0.12 hosted; Intelligence Index 9.06; cost per index task $0.006; output per task 18,600 tokens at 223 tok/s; non-hallucination 73.7%.

Отдельные оценки рисуют для Granite 4.2 3B менее лестную картину, чем заголовок, а для Solar Mini 4 — более сложную. В AA-LCR v1.1, бенчмарке рассуждений с длинным контекстом, Solar Mini 4 набирает 83%, а Granite 4.2 3B — 24%. Эта единственная оценка отвечает за огромную долю разницы в индексе, и это не случайность масштаба — именно это вы получаете вместе с 512K–1M токенов контекста и обучением их использованию. Окно Granite 4.2 3B изначально ограничено 131K; расширенная фаза до 512K существует, но модель не была настроена рассуждать на всём его протяжении так, как была настроена Solar Mini 4.

В области общих знаний разрыв сужается, а затем меняет свой характер на противоположный. Granite 4.2 3B набирает 55,9% на GPQA, а у Solar Mini 4 показателя по GPQA нет вообще; на Humanity's Last Exam у этих двух моделей 6,6% и 25,8% соответственно — это более прямое сравнение, и именно его предсказывает разница в размере. Чего Granite 4.2 3B не делает, по данным Artificial Analysis, так это выдумывать: его показатель отсутствия галлюцинаций AA-Omniscience составляет 73,7%, что выше 64,2% у Solar Mini 4. Меньшая модель с меньшей вероятностью выдумает ответ, которого у неё нет.

Агентное программирование — это то, где обе модели проваливаются, и где важно вчитываться в цифры. Solar Mini 4 набирает 1% на Terminal-Bench 4.0 и 22,3% на AutomationBench-AA. Granite 4.2 3B набирает 0% на Terminal-Bench 4.0, 13,9% на более старой Terminal-Bench 2.1 и 5,6% на τ³-Banking. Ни одна из моделей не является подходящим инструментом для автономной работы в терминале. Модели 8B и 30B из семейства Granite 4.2 получили агентное обучение с подкреплением от IBM и имеют результаты SWE-Bench и Terminal-Bench; 3B явно пропустила этот тренировочный блок, а модель Upstage позиционируется для извлечения, структурирования и применения политик, а не для управления командной оболочкой.

Где Granite 4.2 3B всё ещё остаётся правильным ответом

Семь с третью гигабайт весов в bfloat16, меньше четырёх гигабайт при практической квантизации и лицензия Apache 2.0, которая позволяет дообучать модель на собственных данных и выпускать результат, ни у кого не спрашивая разрешения. Студент с одной потребительской видеокартой, больница, которая не может передавать текст пациентов третьей стороне, продукт, которому нужно работать на борту самолёта или в подвале завода, команда, которая хочет владеть моделью, а не арендовать эндпоинт, — все эти случаи выбирают Granite 4.2 3B и больше не оглядываются. Движок работает через vLLM, SGLang, Transformers и GGUF, а Ollama предлагает сборку granite4.2:3b.

Его показатели, заявленные производителем, заслуживают обычной осторожности. Карточка IBM утверждает 78,33 балла на AIME 2025, 66,67 на HMMT February 2025 и 69,71 на LiveCodeBench v6 — ни один из них не был воспроизведён третьей стороной, а для плотной 3B-модели показатель AIME находится далеко за пределами исторического диапазона. Индекс Artificial Analysis, равный 9, оценивает модель как действительно полезную и совсем не близкую к фронтиру, и это более надёжный сигнал именно потому, что IBM его не публиковала.

Где Solar Mini 4 — правильный ответ

Всё, где работа — это длинный документ, повторяющееся структурированное извлечение или политика, которую нужно единообразно применять в больших объёмах, — и где допустима задержка в девяносто секунд. Профиль Solar Mini 4 — это профиль специалиста: 83% по рассуждениям на длинном контексте, 48% по научному программированию, 64% по отсутствию галлюцинаций и документированная склонность воздерживаться от ответа, а не угадывать. Solar Mini 4 также говорит на корейском как на полноценном языке наравне с английским и японским, а для развёртывания на корейском рынке это не второстепенная деталь.

Чего покупателям делать не следует, так это сравнивать две цены за токены и заключать, что Solar Mini 4 в три раза дороже. Artificial Analysis измерила Solar Mini 4 на уровне $0,36 за выполненную задачу Intelligence Index — и на том же наборе Granite 4.2 3B на уровне $0,006. Это шестидесятикратная разница, обусловленная тем же, что завышает показатели Solar Mini 4 по сравнению с GPT-6 Luna (max): 88 300 выходных токенов на задачу против 18 600 у Granite, и структурой затрат, в которой записи в кэш промптов составляют $0,30 из $0,36 у Solar Mini 4 против $0,0006 из $0,006 у Granite. Дешёвая цена вывода у многословной модели — это не дешёвая задача.

A screenshot of the Hugging Face model card for ibm-granite/granite-4.2-3b showing the model summary table: developer Granite Team at IBM, a decoder-only dense transformer, base model Granite-4.1-3B-Base, 3B parameters, context length natively 128K with long-context extension to 512K, bfloat16 precision, twelve tested languages including Korean, a built-in chain-of-thought thinking mode, and an Apache-2.0 licence, with the model tree showing three finetunes and the base model ibm-granite/granite-4.1-3b-base.

Ни одной из этих моделей нет на OrcaRouter — мы не маршрутизируем ни Granite, ни Upstage, — так что если вам нужна Granite 4.2 3B, её придётся брать с Hugging Face, а если вам нужна Solar Mini 4, она доступна через собственный API Upstage и сторонние платформы. Но та схема с двумя моделями, которую предполагает это сравнение, — как раз то, для чего созданы роутеры, и именно поэтому OrcaRouter даёт доступ к более чем 200 моделям через один ключ с наценкой 0% к прайс-листу провайдеров: выполняйте работу с длинными документами и корейским языком на той модели, которая действительно оправдывает свою стоимость, оставляйте детерминированные этапы извлечения данных на чём-то, что вы размещаете сами, и пусть маршрутизация и переключение при сбоях переводят запрос между ними на уровне отдельного вызова, а не контракта.

A screenshot of the Artificial Analysis comparison page headed 'Granite 4.2 3B Intelligence, Performance & Price Analysis', marked as an IBM open-weights model released August 2026, with an overall speed of 223.4 output tokens per second, a 131k-token context window, and the summary line that Granite 4.2 3B scores 9 on the Artificial Analysis Intelligence Index, placing it above average among comparable models with a median of 6.

Одно последнее замечание по приведённым выше числам. Каждый показатель Solar Mini 4, взятый из Artificial Analysis, — это независимое измерение; каждый показатель Granite 4.2 3B из карточки модели IBM — это заявление производителя, которое не воспроизвела ни одна третья сторона. Оценки индекса Artificial Analysis — 24 и 9 — единственные два числа здесь, полученные одной и той же лабораторией в одних и тех же условиях, — и именно по ним и следует принимать решение.

© 2026 OrcaRouter

Провайдерам

Управляете инференс-платформой? Разместите свои модели на OrcaRouter.

providers@orcarouter.ai

Присоединяйтесь к сообществу

Discordsupport@orcarouter.aiXGitHubYouTube