
Solar Mini 4: model agentowy Upstage z 3 mld aktywnych parametrów oraz cichy model, z którym został wydany
- OpenAINOWOŚĆOpenAI: GPT-6 Luna2026-09-2237Inteligencja
- OpenAINOWOŚĆOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów
- deepseekNOWOŚĆDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligencja76Kod
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Inteligencja69Kod
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
Upstage wypuściło dwie rzeczy 22 września 2026 r., a druga z nich jest powodem, by nie kończyć lektury na pierwszej. Solar Mini 4 to model: checkpoint typu mixture-of-experts o 35 miliardach parametrów, z 3 miliardami parametrów aktywnych na token, oknem kontekstowym 512 000 tokenów, do 128 000 tokenów wyjściowych i ceną katalogową 0,10 USD za milion tokenów wejściowych oraz 0,40 USD za milion tokenów wyjściowych. Został udostępniony w Upstage Console, w Playground i jako wdrożenie on-premises, bez etykiety wersji zapoznawczej i bez listy oczekujących. To jest premiera — i to rozsądna. Drugą rzeczą, którą Upstage dostarczyło tego samego dnia, był Solar Jev — endpoint decyzyjny działający na bazie Solar Mini 4, który nie generuje żadnej prozy — zwraca wybór, wynik lub odpowiedź tak/nie z dołączonym prawdopodobieństwem, w jednym przebiegu w przód, a Upstage nalicza za jego tokeny wyjściowe stawkę zero. Jedna z tych dwóch zapowiedzi to premiera modelu. Druga to mały zakład, że pewna użyteczna klasa pracy agentów nie chce, aby model językowy mówił.
Co tak naprawdę wylądowało 22 września?
Wpis w dzienniku zmian dla Solar Mini 4 jest krótki i nie zawiera zastrzeżeń. Nowy model, już dostępny. Sam sposób, w jaki Upstage to ujmuje, to efektywność kosztowa w pracy agentowej „w której liczą się szybkość odpowiedzi i koszt” — co jest zdaniem, które laboratorium pisze, gdy chce, żebyś porównał go z czymś trzykrotnie droższym, a nie z czołówką.

Karta specyfikacji, zgodnie ze stroną historii modeli Upstage:
• Parametry — łącznie 35B, 3B aktywnych na token. Rzadka mieszanina ekspertów, więc płacisz za przechowywanie 35B, a obliczenia wykonujesz z 3B. Upstage nie ujawnia, ilu jest ekspertów ani jak są trasowani.
Kontekst — 512 000 tokenów, przy maksymalnie 128 000 tokenów wyjściowych. Obie wartości są identyczne jak w modelu flagowym, co jest najciekawszym wierszem w tabeli.
• Data odcięcia treningu — luty 2026. Siedem miesięcy nieaktualności w momencie wydania, co jest normalne dla modelu tej wielkości i warto o tym wiedzieć, zanim zapyta się go o cokolwiek niedawnego.
• Języki — angielski, koreański i japoński. Upstage opisuje go jako „płynny koreański z silnymi możliwościami w zakresie angielskiego i japońskiego”, co jest właściwą kolejnością dla koreańskiego laboratorium i prawdopodobnie właściwą kolejnością dla modelu.
• Możliwości — czat, rozumowanie, wyjścia strukturalne i wywoływanie narzędzi. Rozumowanie to zmiana względem poprzedniej generacji: starsze modele solar-mini całkowicie ignorują parametr reasoning_effort, a Solar Mini 4 nie.
• Identyfikatory modeli — solar-mini4 to alias, który obecnie wskazuje na datowaną migawkę solar-mini4-260922. Identyfikator solar-mini4-preview również krążył w narzędziach agentowych firm trzecich, co warto wiedzieć, jeśli piszesz konfigurację routingu pod ciąg preview, który może nie przetrwać.
• Dostępność — Upstage Console, Playground i wersja on-premises. Brak otwartych wag. Upstage już wcześniej publikował otwarte wagi (Solar Open 2 ukazał się w ramach wydania na Hugging Face, a jego udostępnianie przez API zakończyło się 12 sierpnia 2026 r.), ale nic w Solar Mini 4 nie wskazuje, że taki jest plan w tym przypadku.
Solar Jev to ta część, o której nikt nie będzie pisał.
Solar Jev jest w wersji beta na nowym punkcie końcowym POST /v1/systemone. Wysyłasz fragment stanu — dokument, wiersz logu, zgłoszenie do wsparcia — oraz listę typowanych pytań, a w zamian otrzymujesz wybór ze zbioru, który podałeś, ocenę według rubryki albo odpowiedź tak/nie, przy czym każde z nich niesie skalibrowane prawdopodobieństwo pobrane bezpośrednio z modelu, a nie zapisane jako tekst.
Konsekwencją projektową jest to, że nie ma prozy. Żadnego wyjaśnienia, żadnego łańcucha myśli, żadnego wstępu. Upstage mówi, że każda decyzja to pojedyncze przejście w przód, a tokeny wyjściowe są darmowe. Przy oknie kontekstu 512K cały stan — cały kontrakt, cała transkrypcja — może być danymi wejściowymi.
To produkt węższy, niż się początkowo wydaje, i właśnie ta wąskość jest tu sednem. Model, który nic nie pisze, nie może napisać czegoś błędnego. Jeśli Twój pipeline obecnie prosi model czatu o zwrócenie werdyktu w JSON-ie, a następnie go parsuje, i poświęciłeś choćby chwilę na bronienie się przed tym, że model opakowuje ten JSON w przyjazne zdanie, Solar Jev jest wymierzony dokładnie w Ciebie. Cena jest taka, że dostajesz prawdopodobieństwo, a nie ślad rozumowania, więc gdy model się myli, nie masz nic do przeczytania.
Warto mówić precyzyjnie o tym, czym Solar Jev nie jest: nie jest mniejszą wersją Solar Mini 4 i nie jest modelem dostrojonym, który można pobrać. To endpoint udostępniany na bazie Solar Mini 4, dostępny w Upstage Console w wersji beta. Słowo „beta” jest tu kluczowe.
Ile to kosztuje i zegar odliczający do zniżki
Cena katalogowa wynosi 0,10 USD za milion tokenów wejściowych, 0,01 USD za milion tokenów wejściowych z pamięci podręcznej i 0,40 USD za milion tokenów wyjściowych. Wszystkie kwoty nie zawierają 10% VAT.
Te ceny katalogowe nie są tym, ile zapłacisz dzisiaj. Upstage prowadzi 50-procentową zniżkę premierową, którą jego własna strona z cennikiem datuje na 22 października 2026 (UTC) — dane strukturalne leżące u podstaw tej strony podają okres od 22 września 05:00 UTC do 23 października 00:00 UTC, co jest tym samym wyrażonym na dwa sposoby. W tym okresie stawki wynoszą 0,05 USD za wejście, 0,005 USD za dane z pamięci podręcznej i 0,20 USD za wyjście.

Z tego wynikają dwie rzeczy. Po pierwsze, jeśli porównujesz koszt tego z czymkolwiek innym, kalkuluj go przy obu kwotach, bo 50% zniżki, która wygasa za miesiąc, to nie cena, tylko promocja. Po drugie, dla kontekstu, gdzie plasuje się cena katalogowa: poprzednia generacja Solar Mini ma cenę katalogową 0,15 USD za milion tokenów na wejściu i wyjściu, z oknem kontekstu 32 768 tokenów i zupełnie bez trybu rozumowania. Solar Mini 4 jest tańszy na wejściu, droższy na wyjściu i daje szesnastokrotnie większe okno kontekstu oraz tryb rozumowania. To nie jest odświeżenie. To inny produkt noszący tę samą nazwę.
Czego jeszcze nikt nie zmierzył
Solar Mini 4 ma jeden dzień i nie ma niezależnej oceny. Żadnego Artificial Analysis Intelligence Index, żadnego miejsca w Agent Arena, żadnego zewnętrznego benchmarku agentowego. Upstage również nie opublikował dla niego żadnej tabeli benchmarków — wpis w changelogu zawiera specyfikacje, a nie wyniki. Każdy, kto podaje ci jakąkolwiek liczbę dla tego modelu, cytuje coś innego.
W obiegu istnieje dokładnie jeden punkt danych poniekąd pochodzący od strony trzeciej i wymaga on ostrożnego oznaczenia etykietą, ponieważ nie jest żadną z dwóch rzeczy, na które wygląda. Repozytorium społecznościowe hunkim/solar-mini4-jev opakowuje Solar Mini 4 w kompatybilną formę dla decyzyjnego API TypeSafe Jev i publikuje własny przebieg test400, oceniony przez inny model według podanej rubryki. W tym przebiegu Solar Mini 4 przy reasoning_effort=none uzyskał 98,4% dokładności pól w porównaniu z 94,2% samego wrappera, pomijając 7 z 447 ocenianych pól wobec 26; przodował zarówno w koreańskim (98,8%), jak i angielskim (98,4%); a średnio zajmował 1,21 sekundy na wywołanie w porównaniu z 0,38 sekundy wrappera.
Potraktuj to jako to, czym jest. To nie jest benchmark dostawcy — Upstage go nie opublikował. To nie jest niezależna ocena — nie przeprowadził jej żaden neutralny podmiot, narzędzie testowe należy do konkurenta, a sędzią jest model. To porównanie hostowanego API z własnym wrapperem, zaraportowane przez samego programistę, a uczciwe podsumowanie jest takie, że to jedyny dostępny sygnał i nie powinien sam z siebie przesądzać o decyzji produkcyjnej. Sugeruje jednak dwie rzeczy warte samodzielnego przetestowania: że model jest wystarczająco szybki do użytku interaktywnego oraz że jego koreański jest co najmniej równie dobry jak angielski.
Jak tego spróbować, nie stawiając na to całego pipeline’u
Kłopot z modelem, który ma zaledwie jeden dzień i nie ma niezależnych ocen, polega na tym, że jedynym sposobem, by przekonać się, czy się nadaje, jest przepuszczenie przezeń rzeczywistego ruchu, a jedynym sposobem, by zrobić to bezpiecznie, jest mieć gdzieś, dokąd ten ruch może trafić, gdy się nie nadaje.
Przełączenie awaryjne to uczciwa odpowiedź w tym przypadku i właśnie do tego służy warstwa routingu. Umieszczasz Solar Mini 4 za punktem końcowym, zachowujesz model, który już uruchamiasz, jako rozwiązanie zapasowe, i pozwalasz routerowi przekierowywać ruch, gdy nowy model zwraca błąd, przekracza limit czasu albo zaczyna zwracać ustrukturyzowane dane wyjściowe, które twój parser odrzuca. Dzięki temu pierwszy tydzień nowego modelu to eksperyment z zabezpieczeniem, a nie premiera, której musisz bronić.
Jedna korekta warta powiedzenia wprost, bo łatwo dać do zrozumienia coś przeciwnego: OrcaRouter nie kieruje dziś żadnego modelu Upstage. Solar Mini 4, Solar Pro 4 i Solar Jev są dostępne przez własne API Upstage oraz kilka platform zewnętrznych, a jeśli zależy ci konkretnie na Solar Mini 4, to właśnie tam go znajdziesz. To, co oferujemy, to jeden klucz API obejmujący około 190 modeli, które obsługujemy, co jest przydatne, jeśli eksperyment, który naprawdę chcesz przeprowadzić, brzmi „czy kompaktowy model agentowy bije to, co mam”, a nie „czy ten konkretny koreański model bije to, co mam”. To są różne pytania i tylko na jedno z nich da się odpowiedzieć błędnie.

Otwarte pytanie
Upstage wypuścił teraz kompaktowy model i model flagowy w tej samej specyfikacji 512K/128K, z poziomami cenowymi oddalonymi o trzy tygodnie, i umieścił endpoint decyzyjny w małym modelu, a nie w dużym. Ta kolejność jest celowa: Solar Jev jest obsługiwany na Solar Mini 4, ponieważ decyzja, która nie generuje tekstu, nie potrzebuje rozumowania modelu flagowego, i ponieważ chcesz taniego modelu, gdy tworzysz ich milion.
Nie jest jeszcze jasne, czy 3B aktywnych parametrów wystarcza do rozumowania w pracy agentowej wykraczającej poza ekstrakcję. Marketing Upstage mówi o pracy agentowej. Benchmarki Upstage milczą. Dopóki niezależny podmiot nie przeprowadzi na nim testów — a biorąc pod uwagę datę premiery, to w najlepszym razie kwestia tygodni — właściwą postawą jest przetestować go na własnym zadaniu, w cenie promocyjnej, z skonfigurowanym mechanizmem awaryjnym, i traktować wszelkie twierdzenia o jego jakości agentowej, w tym twierdzenia dostawcy, jako hipotezę.
