
Solar Mini 4 vs Granite 4.2 3B: модель, которую вы вызываете, и чекпоинт, который вы скачиваете
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-29$2.00 / $10.00 за 1 млн токенов
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-28$2.00 / $10.00 за 1 млн токенов · 159 tok/s
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 220 tok/s
- OpenAIНОВИНКАOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaНОВИНКАOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 118 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 217 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
Поставьте Solar Mini 4 рядом с Granite 4.2 3B — и интересное число здесь не разрыв в бенчмарках. Дело в том, что Granite 4.2 3B, модель рассуждений IBM под лицензией Apache-2.0, выпущенная 25 августа 2026 года, будет работать на ноутбуке сегодня вечером бесплатно, тогда как Solar Mini 4, проприетарная модель Upstage, выпущенная 22 сентября 2026 года, не запустится ни на одном вашем устройстве и взимает $0.10 за миллион входных токенов и $0.40 за миллион выходных токенов за ответ на вопрос. Обе активируют примерно три миллиарда параметров вычислений на токен. Одна — это файл. Другая — это счётчик.
Эта разница определяет почти всё остальное в этом сравнении, включая то, какие бенчмарки вообще стоит ставить бок о бок. Granite 4.2 3B прошла независимую оценку задолго до Solar Mini 4 — Artificial Analysis оценивает её в 9 по Intelligence Index v4.3.2, из того же набора оценок и той же организации, которая оценивает Solar Mini 4 в 24. А это значит, что пятнадцатибалльный разрыв здесь имеет необычайно прочную основу: одна лаборатория, одна методология и две модели, которые никому не пришлось принимать на веру.
Спецификация — по тем параметрам, которые действительно их разделяют.
• Архитектура — Solar Mini 4 — это разреженная смесь экспертов: 35 млрд параметров всего, 3 млрд активных на токен, по данным Upstage. Granite 4.2 3B — плотная модель, около 3 млрд параметров, примерно 4 млрд в общей сложности с учётом эмбеддингов согласно метаданным safetensors. Один и тот же бюджет активации, два разных способа его расходовать.
• Веса — Solar Mini 4 является проприетарной и закрытой моделью. Granite 4.2 3B распространяется под лицензией Apache 2.0 с документированным рецептом обучения вплоть до пропорций данных.
• Контекст — Upstage документирует 512K токенов при выводе до 128K; Artificial Analysis указывает 1,0 млн для той же модели, поэтому считайте верхний предел неопределённым. Granite 4.2 3B нативно поддерживает 131 072 токена, а пятая фаза предварительного обучения расширяет этот объём до 512K.
• Цена — Solar Mini 4 по $0.10 / $0.01 за кэшированные токены / $0.40 за миллион токенов, сейчас скидка 50% до 22 октября 2026 года. У Granite 4.2 3B нет тарифной сетки от вендора, потому что арендовать нечего; размещённые эндпоинты, которые отслеживает Artificial Analysis, оценивают его примерно в $0.03 / $0.12, а самостоятельный хостинг стоит лишь электричества.
• Индекс интеллекта — 24 у Solar Mini 4, 9 у Granite 4.2 3B, оба от Artificial Analysis v4.3.2.
• Скорость — 204 выходных токена в секунду для Solar Mini 4 и 223 для Granite 4.2 3B, обе измерены одной и той же лабораторией, время до первого чанка — 1,5 с и 0,5 с соответственно. Плотная модель быстрее по обоим показателям.
Из чего на самом деле складывается разрыв в пятнадцать пунктов

Отдельные оценки рисуют для Granite 4.2 3B менее лестную картину, чем заголовок, а для Solar Mini 4 — более сложную. В AA-LCR v1.1, бенчмарке рассуждений с длинным контекстом, Solar Mini 4 набирает 83%, а Granite 4.2 3B — 24%. Эта единственная оценка отвечает за огромную долю разницы в индексе, и это не случайность масштаба — именно это вы получаете вместе с 512K–1M токенов контекста и обучением их использованию. Окно Granite 4.2 3B изначально ограничено 131K; расширенная фаза до 512K существует, но модель не была настроена рассуждать на всём его протяжении так, как была настроена Solar Mini 4.
В области общих знаний разрыв сужается, а затем меняет свой характер на противоположный. Granite 4.2 3B набирает 55,9% на GPQA, а у Solar Mini 4 показателя по GPQA нет вообще; на Humanity's Last Exam у этих двух моделей 6,6% и 25,8% соответственно — это более прямое сравнение, и именно его предсказывает разница в размере. Чего Granite 4.2 3B не делает, по данным Artificial Analysis, так это выдумывать: его показатель отсутствия галлюцинаций AA-Omniscience составляет 73,7%, что выше 64,2% у Solar Mini 4. Меньшая модель с меньшей вероятностью выдумает ответ, которого у неё нет.
Агентное программирование — это то, где обе модели проваливаются, и где важно вчитываться в цифры. Solar Mini 4 набирает 1% на Terminal-Bench 4.0 и 22,3% на AutomationBench-AA. Granite 4.2 3B набирает 0% на Terminal-Bench 4.0, 13,9% на более старой Terminal-Bench 2.1 и 5,6% на τ³-Banking. Ни одна из моделей не является подходящим инструментом для автономной работы в терминале. Модели 8B и 30B из семейства Granite 4.2 получили агентное обучение с подкреплением от IBM и имеют результаты SWE-Bench и Terminal-Bench; 3B явно пропустила этот тренировочный блок, а модель Upstage позиционируется для извлечения, структурирования и применения политик, а не для управления командной оболочкой.
Где Granite 4.2 3B всё ещё остаётся правильным ответом
Семь с третью гигабайт весов в bfloat16, меньше четырёх гигабайт при практической квантизации и лицензия Apache 2.0, которая позволяет дообучать модель на собственных данных и выпускать результат, ни у кого не спрашивая разрешения. Студент с одной потребительской видеокартой, больница, которая не может передавать текст пациентов третьей стороне, продукт, которому нужно работать на борту самолёта или в подвале завода, команда, которая хочет владеть моделью, а не арендовать эндпоинт, — все эти случаи выбирают Granite 4.2 3B и больше не оглядываются. Движок работает через vLLM, SGLang, Transformers и GGUF, а Ollama предлагает сборку granite4.2:3b.
Его показатели, заявленные производителем, заслуживают обычной осторожности. Карточка IBM утверждает 78,33 балла на AIME 2025, 66,67 на HMMT February 2025 и 69,71 на LiveCodeBench v6 — ни один из них не был воспроизведён третьей стороной, а для плотной 3B-модели показатель AIME находится далеко за пределами исторического диапазона. Индекс Artificial Analysis, равный 9, оценивает модель как действительно полезную и совсем не близкую к фронтиру, и это более надёжный сигнал именно потому, что IBM его не публиковала.
Где Solar Mini 4 — правильный ответ
Всё, где работа — это длинный документ, повторяющееся структурированное извлечение или политика, которую нужно единообразно применять в больших объёмах, — и где допустима задержка в девяносто секунд. Профиль Solar Mini 4 — это профиль специалиста: 83% по рассуждениям на длинном контексте, 48% по научному программированию, 64% по отсутствию галлюцинаций и документированная склонность воздерживаться от ответа, а не угадывать. Solar Mini 4 также говорит на корейском как на полноценном языке наравне с английским и японским, а для развёртывания на корейском рынке это не второстепенная деталь.
Чего покупателям делать не следует, так это сравнивать две цены за токены и заключать, что Solar Mini 4 в три раза дороже. Artificial Analysis измерила Solar Mini 4 на уровне $0,36 за выполненную задачу Intelligence Index — и на том же наборе Granite 4.2 3B на уровне $0,006. Это шестидесятикратная разница, обусловленная тем же, что завышает показатели Solar Mini 4 по сравнению с GPT-6 Luna (max): 88 300 выходных токенов на задачу против 18 600 у Granite, и структурой затрат, в которой записи в кэш промптов составляют $0,30 из $0,36 у Solar Mini 4 против $0,0006 из $0,006 у Granite. Дешёвая цена вывода у многословной модели — это не дешёвая задача.

Ни одной из этих моделей нет на OrcaRouter — мы не маршрутизируем ни Granite, ни Upstage, — так что если вам нужна Granite 4.2 3B, её придётся брать с Hugging Face, а если вам нужна Solar Mini 4, она доступна через собственный API Upstage и сторонние платформы. Но та схема с двумя моделями, которую предполагает это сравнение, — как раз то, для чего созданы роутеры, и именно поэтому OrcaRouter даёт доступ к более чем 200 моделям через один ключ с наценкой 0% к прайс-листу провайдеров: выполняйте работу с длинными документами и корейским языком на той модели, которая действительно оправдывает свою стоимость, оставляйте детерминированные этапы извлечения данных на чём-то, что вы размещаете сами, и пусть маршрутизация и переключение при сбоях переводят запрос между ними на уровне отдельного вызова, а не контракта.

Одно последнее замечание по приведённым выше числам. Каждый показатель Solar Mini 4, взятый из Artificial Analysis, — это независимое измерение; каждый показатель Granite 4.2 3B из карточки модели IBM — это заявление производителя, которое не воспроизвела ни одна третья сторона. Оценки индекса Artificial Analysis — 24 и 9 — единственные два числа здесь, полученные одной и той же лабораторией в одних и тех же условиях, — и именно по ним и следует принимать решение.
