
Kolibri против Solar Mini 4: тот же бюджет в 3B активных параметров, две совершенно разные ставки
- openaiНОВИНКАOpenAI: GPT-6.1 Sol2026-09-2952Интеллект
- anthropicНОВИНКАAnthropic: Claude Sonnet 5.52026-09-2856Интеллект
- typesafeНОВИНКАTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 за 1 млн токенов · 217 tok/s
- OpenAIНОВИНКАOpenAI: GPT-6 Luna2026-09-2238Интеллект
- OpenAIНОВИНКАOpenAI: GPT-6 Sol2026-09-2248Интеллект
- AnthropicНОВИНКАAnthropic: Claude Opus 5.52026-09-2258Интеллект
- xAIНОВИНКАGrok 4.72026-09-2146Интеллект
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 за 1 млн токенов · 117 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 за 1 млн токенов · 969 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Интеллект
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Интеллект77Кодинг
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Интеллект76Кодинг
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Интеллект76Кодинг
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Интеллект82Кодинг
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 за 1 млн токенов · 52 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 за 1 млн токенов · 100 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Интеллект72Кодинг
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 за 1 млн токенов · 214 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Интеллект75Кодинг
- obsidianQwen3.8 27B2026-08-1534Интеллект68Кодинг
Две модели вышли с разницей в семнадцать дней, обе настроены расходовать примерно три миллиарда активных параметров на токен, и при этом для практического внедрения трудно представить более непохожие. Kolibri от Aleph Alpha — это 78,1 млрд параметров в виде весов под Apache-2.0, которые вы скачиваете и обслуживаете самостоятельно: хостируемого эндпоинта не существует, и на сегодняшний день нигде нет ни одной независимой оценки этой модели. Solar Mini 4 от Upstage — это 35 млрд параметров, которые вообще нельзя скачать: модель существует только как тарифицируемый эндпоинт и уже имеет Artificial Analysis Intelligence Index, равный 24,05. Число активных параметров говорит, во сколько обходится работа каждой из них. Больше ничто в этом числе не говорит, во сколько вам обойдётся начать.
Причина, по которой итоговые значения настолько расходятся — 78,1 млрд против 35 млрд при почти одинаковой активной части, — в том, что обе модели представляют собой разреженные смеси экспертов, а две лаборатории приняли противоположные решения о том, какой объём экспертной ёмкости держать в резерве. Kolibri содержит 384 эксперта и на каждый токен маршрутизирует к 1 общему плюс 6 из них. Solar Mini 4 раскрывает разделение 35B/3B и ничего о числе экспертов. Когда две модели рекламируются с одним и тем же активным показателем, именно общее число параметров, а не активный показатель, определяет ваш счёт за оборудование — и здесь разница составляет 2,2× при одном и том же заявленном вычислительном бюджете.
Что каждый из них на самом деле из себя представляет
• Общее число параметров — Kolibri 78.10B против Solar Mini 4 35B
• Активные параметры на токен — Kolibri 3.46B против Solar Mini 4 3B
• Веса — Kolibri Apache 2.0, полные веса на Hugging Face, тогда как Solar Mini 4 — закрытая; только API
• Контекст — Kolibri 1,048,576 токенов подтверждено против Solar Mini 4 512K согласно документации Upstage, 1,048,576 согласно карточке модели Artificial Analysis
• Макс. вывод — Kolibri не ограничен вендором, в отличие от Solar Mini 4 — 128 000 токенов
• Языки — Kolibri: немецкий и английский против Solar Mini 4: английский, корейский и японский
• Дата отсечки знаний — Kolibri 18 июня 2026 г. против Solar Mini 4 февраля 2026 г.
• Поставка — Kolibri с самостоятельным хостингом (vLLM) против Solar Mini 4, размещённой в Console и Playground от Upstage, а также на локальных серверах
• Независимая оценка — у Kolibri ничего не опубликовано, в отличие от Solar Mini 4: AA Intelligence Index 24.05
Kolibri: 78 миллиардов параметров, и никто за пределами лаборатории не оценивал её.
Aleph Alpha опубликовала Kolibri 3 октября 2026 года — намеренно в День немецкого единства — как первого представителя нового семейства и преемника Kolibri Origin. Карточка модели необычно откровенно рассказывает о том, что легло в её основу: 20 трлн токенов предварительного обучения, 3,44 трлн токенов промежуточного обучения и 201 млрд токенов обучения с длинным контекстом; обучение выполнялось на 768 GPU B200 за 21 день и потребовало примерно 6,4×10²³ FLOP и около 950 МВт·ч. Производитель также сам раскрывает число сбоев — 38 незапланированных прерываний, примерно одно на каждые 10 000 GPU-часов, — а такие цифры лаборатории обычно опускают.

Архитектура — это чистая история разреженной MoE. Пятьдесят слоёв с соотношением 4:1 между вниманием со скользящим окном (окна по 512 токенов) и глобальным вниманием, которое срабатывает только на каждом пятом слое. FP8-веса с блочным масштабированием 128×128 и KV-кэш в FP8. Kolibri Origin для сравнения использовала 128 экспертов с маршрутизацией по 8, скрытую размерность эксперта 768 и полное внимание на каждом слое — на английских данных с отсечкой в сентябре 2024 года. Kolibri переходит на 384 эксперта с маршрутизацией по 6 и скрытой размерностью 512, а также сдвигает обе языковые отсечки на 18 июня 2026 года.
Немецкий пайплайн — это та часть, которую по-настоящему трудно купить где-либо ещё. Aleph Alpha обучила собственный токенизатор UniBPE и сообщает, что немецкий текст занимает 4,90 байта на токен против 4,35 у GPT-5, 4,17 у Qwen3.5 и 4,13 у Gemini. Это токенизатор, который, по заявлению, обеспечивает лучшее сжатие немецкого языка, чем любая из передовых многоязычных моделей, и именно он является конкретным механизмом, стоящим за предложением о суверенном развёртывании: меньше токенов на немецкий документ означает меньше оплачиваемых токенов и более длинное эффективное окно на том же оборудовании.
Все показатели производительности, которые существуют для Kolibri, взяты из собственной карточки модели Aleph Alpha, и именно так их и следует читать. В таблице, опубликованной поставщиком, Kolibri имеет общий показатель 75,5 на англоязычных тестах и 70,8 на немецкоязычных, 84,3 в GPQA Diamond на английском против 81,3 на немецком, 21,5 в Humanity's Last Exam на английском против 15,9 на немецком, 66,4 в SWE-Bench Verified, 85,9 в LiveCodeBench v6 и 68,3 в AA-LCR. Это неаудированные числа. Для Kolibri нет страницы на Artificial Analysis — URL модели в трекере возвращает 404, — поэтому ничто в этой таблице не было независимо воспроизведено, и статья, которую вы читаете, не может сделать её более надёжной, чем она есть.
Что карта действительно делает надёжным, так это историю обслуживания. Нижняя планка по железу — два A100 80GB, либо два H100 SXM5, либо один H200, B200 или B300. Опубликованный рецепт vLLM запускает её с --kv-cache-dtype fp8 и выделенными парсерами рассуждений и вызовов инструментов, при temperature 1.0, top-p 0.97 и top-k 128, с регулятором reasoning_effort, охватывающим none, low, medium и high. Один B300, обслуживающий модель на 78B при проверенном контексте в 1M токенов, — это конкретная форма предложения: вы покупаете коробку, а дальше предельные издержки за каждый токен становятся вашими.
Solar Mini 4: вы арендуете активный срез 3B, а не покупаете его.
Solar Mini 4 вышел 22 сентября 2026 года — снапшот solar-mini4-260922, алиас solar-mini4 — как ориентированная на агентов малая модель Upstage: 35B всего, 3B активных, дата отсечки — февраль 2026 года, английский, корейский и японский, с режимами чата, рассуждений, структурированного вывода и вызова инструментов. Она доступна через Console и Playground от Upstage, а также для локального развёртывания, но нет ни скачивания весов, ни лицензии для ознакомления. В документации Upstage также указано «Data not collected» для неё — это строка о соответствии, которая важна, если вы ставите её перед реальным трафиком.

В отличие от Kolibri, Solar Mini 4 прошла через независимый тестовый стенд. Artificial Analysis оценивает её Intelligence Index в 24,05, с измеренными показателями 1,01% на Terminal-Bench 4.0, 47,6% на SciCode, 83,3% на AA-LCR и 25,8% на Humanity's Last Exam. В посте Upstage о запуске 24,1 подаётся как самый высокий Индекс среди моделей с 3B активными параметрами, опережая Qwen3.6 35B A3B с 18 и Nemotron 3.5 Lightning с 13 — формулировка, которая справедлива в своих пределах и, что стоит отметить, ровно настолько узка, насколько звучит, поскольку это утверждение о классе с 3B активными параметрами, а не о малых моделях в целом.
Показатель, на который стоит ориентироваться при планировании бюджета, — это не Index. Разбивка затрат по задачам от Artificial Analysis оценивает Solar Mini 4 примерно в $0,36 за задачу Intelligence Index, и около $0,30 из этой суммы — примерно 82% — приходится на записи в кэш промптов. Чтение из кэша стоит $0,03, а сгенерированный вывод — всего $0,035. Модель выдаёт около 88 300 выходных токенов на задачу, из которых примерно 71 600 — токены рассуждений. Иными словами, это дешёвая модель, чей счёт определяется в основном перезаписью длинного контекста, а не токенами, которые она выдаёт в ответ. Стоимость одного прогона eval варьируется от $1,63 для Terminal-Bench 4.0 до $0,95 для AA-Briefcase. Медианная скорость вывода — 198 токенов в секунду при времени до первого чанка 1,58 секунды.
Цена каждого пути
Solar Mini 4 сегодня продаётся не по прайсовой цене. На собственной странице цен Upstage для неё указана шкала с датами: $0,03 за миллион входных токенов, $0,003 за кэшированные и $0,12 за выходные — скидка 70% к запуску — до 10 октября 2026 года по UTC, затем $0,05 / $0,005 / $0,20 с 11 октября и, наконец, прайсовые $0,10 / $0,01 / $0,40 с 23 октября. В публикации Upstage о запуске скидка описана менее строго, чем в самом графике на странице цен; приведённая выше шкала — это версия с датами, и именно по ней стоит планировать. Обратите внимание, где находится самая крутая скидка: кэшированный ввод падает до десятой доли ставки за ввод, что вознаграждает ровно ту нагрузку с долго стабильным контекстом, за которую взимает плату описанный выше профиль стоимости записи в кэш.
Цена Kolibri — это заказ на покупку. Здесь нет ставки за миллион токенов для сравнения, потому что нет облачного счётчика: вы платите за GPU и электроэнергию, а единственный публичный сигнал о затратах у поставщика — это сам запуск обучения: около 950 МВт·ч на создание модели. Если у вас уже есть мощности для инференса, предельная стоимость токена у Kolibri приближается к стоимости электроэнергии; если нет, входной билет — это сервер с двумя A100 или мощнее. Это принципиально иная форма обязательств, чем у модели, которую можно вызывать миллионами токенов и завтра же перестать вызывать, и именно это и есть реальный выбор, который предлагают эти два варианта.
Где они пересекаются и где сравнение не работает
• Активные вычисления — почти идентичны: 3,46 млрд против 3 млрд на токен
• Всё, что из этого следует, — несопоставимо, потому что только у одного из двух есть какие-либо подтверждённые доказательства
• Лучший измеренный показатель — Solar Mini 4 имеет проверенный аудитом индекс 24,05; у Kolibri есть таблица от вендора и вообще нет проверенной аудитом оценки
• Немецкий — Kolibri — единственная из двух, обученная для него, при 4,90 байта на токен; Solar Mini 4 его не указывает.
• Корейский и японский — в Solar Mini 4 указаны оба; в Kolibri — ни один
• Длинный контекст — Kolibri валидирует полные 1 048 576 токенов; в собственной документации Solar Mini 4 указано 512K, а на карточке Artificial Analysis — 1M, поэтому верхний предел следует считать зависящим от вендора
• Время до первого токена — у Solar Mini 4 это минуты, потому что вы регистрируетесь; у Kolibri — дни, потому что вы ставите сервер в стойку
• Модель затрат — за токен, снижается по мере действия скидочной лестницы, в сопоставлении с капитальными затратами и электроэнергией
Честная сводка такова: это не то противостояние, которое решается в таблице лидеров. Таблица вендора Kolibri даже включает собственный набор для сравнения — GLM-4.7 Flash 30B-A3B с 64.7 по общему английскому, Nemotron 3 Nano 30B-A3B с 65.6, Qwen3.5 35B-A3B с 74.7, Qwen3.6 35B-A3B с 71.4, Gemma 4 26B-A4B IT с 71.9, и всё это против собственных 75.5 у Kolibri — и каждая из этих строк — собственный показатель Aleph Alpha, полученный той же лабораторией на её собственном стенде. Это полезная карта сегмента 3B-активных моделей. Это не независимый рейтинг.
Если вам сегодня нужен именно 3B-active MoE на ключе
Ни одна из моделей в этом сравнении не находится на OrcaRouter, и стоит точно объяснить, почему. У Kolibri пока нет хостингового инференса какого-либо рода — это веса и рецепт vLLM, так что маршрутизатору не на что указывать. Solar Mini 4 обслуживается Upstage и собственным локальным каналом Upstage; мы не маршрутизируем её и не маршрутизируем ни одну модель Upstage. Если вам нужна любая из них, вы получаете её у самих вендоров.
Маршрут What we do — это окружающий класс — сегмент разреженных малых MoE, внутри которого конкурируют обе эти модели. Gemma 4 26B-A4B IT представлена в каталоге по цене $0.06 за входящие и $0.33 за исходящие за миллион токенов с окном в 262,144 токена. Qwen3.5 35B-A3B — по $0.057 / $0.459, а Qwen3.6 35B-A3B — по $0.248 / $1.485 с окном в 262,144 токена и 65,536 токенов максимального вывода. Это тот же компромисс, на который идут две модели выше, — активный срез от 3B до 4B, покупаемый по цене небольшой модели, — доступен по одному ключу API при этом прайс-лист провайдера передаётся с наценкой 0%, так что изменение цены поставщиком отражается в вашем счёте в тот же день, когда оно объявлено, а не при следующем продлении договора. Автоматическое переключение при сбое здесь важнее, чем обычно: когда вы оцениваете непроверенную разреженную модель, второй маршрут за тем же ключом — это то, что не даёт плохому дню превратиться в простой.

Что делать и за чем следить
Выбирайте Kolibri, если ваша рабочая нагрузка связана с немецким или английским, если данные не могут покидать вашу собственную стойку, и если у вас есть — или вы готовы купить — GPU, чтобы обслуживать 78B при FP8. В такой конфигурации это единственная из этих двух моделей, которая вообще может рассматриваться как вариант, а валидированный контекст на 1M токенов с немецким токенизатором на 4,90 байта на токен — это реальное, пусть и измеренное производителем, преимущество. Выбирайте Solar Mini 4, если вы хотите выйти в продакшен на этой неделе, если корейский или японский есть в дорожной карте, и если ваша рабочая нагрузка — это длинный стабильный контекст, для которого выгодна скидка на кэш; закладывайте бюджет на записи в кэш, а не на выходные токены.
Открытый вопрос для обоих один и тот же, и это вопрос доказательств, а не возможностей. Цифры Kolibri — 75,5 и 84,3 — это собственные показатели Aleph Alpha на собственном тестовом стенде Aleph Alpha, и пока независимый трекер не прогонит его, любой, кто их цитирует, цитирует лабораторию. Показатель Solar Mini 4 — 24,05 — реален и воспроизведён, но Index — это снимок модели, которая всё ещё находится в середине скидочной лестницы, а цена по прайс-листу появится только 23 октября. Следите за первой независимой оценкой Kolibri и за тем, сколько Solar Mini 4 на самом деле будет стоить, когда скидочная лестница закончится, — потому что при $0,10 / $0,40 экономика аренды 3B-сегмента выглядит иначе, чем при $0,03 / $0,12, которые вам называют сегодня.
