
Solar Mini 4 vs Qwen3.8-Max: Ile tak naprawdę kosztuje ostatnie dwadzieścia punktów indeksu
- openaiNOWOŚĆOpenAI: GPT-6.1 Sol2026-09-29$2.00 / $10.00 za 1 mln tokenów
- anthropicNOWOŚĆAnthropic: Claude Sonnet 5.52026-09-28$2.00 / $10.00 za 1 mln tokenów · 159 tok/s
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 220 tok/s
- OpenAINOWOŚĆOpenAI: GPT-6 Luna2026-09-2238Inteligencja
- OpenAINOWOŚĆOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- AnthropicNOWOŚĆAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- xAINOWOŚĆGrok 4.72026-09-2146Inteligencja
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 za 1 mln tokenów · 118 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 za 1 mln tokenów · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 217 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
Solar Mini 4 kosztuje 0,10 USD za milion tokenów wejściowych i 0,40 USD za milion tokenów wyjściowych. Qwen3.8-Max, model, który większość ludzi ma na myśli, wpisując „Qwen 3.8” i prosząc o API, kosztuje 2,00 USD i 6,00 USD. W cenniku przekłada się to na dwudziestokrotną różnicę w cenie wejścia. W niezależnej ewaluacji, przez którą oba modele już przeszły, uczciwie rzecz biorąc, Qwen3.8-Max uzyskuje 45,4 w Artificial Analysis Intelligence Index wobec 24,1 Solar Mini 4 — około dwa razy większą zmierzoną zdolność — jednocześnie kosztując około piętnaście razy więcej na ukończone zadanie. Wszystko, co warto wiedzieć o tym zestawieniu, tkwi w różnicy między tymi dwoma stosunkami i w tym, że model Upstage'a działa z prędkością 204 tokenów na sekundę, podczas gdy flagowy model Alibaby osiąga 39.
Jedna uwaga dotycząca nazewnictwa przed liczbami, bo zmienia to, co kupujesz. Qwen 3.8 to generacja, a nie model: hostowanym flagowcem jest Qwen3.8-Max, odświeżony jako opatrzony datą snapshot 0902, a należącym do tej samej generacji członkiem do pobrania jest Qwen3.8-2.4T-A95B, wagi o 2,4 biliona parametrów, które Alibaba opublikowała 12 sierpnia 2026 r. Solar Mini 4, wydany 22 września 2026 r., to rzadki mixture-of-experts firmy Upstage o 35 miliardach parametrów, z około 3 miliardami parametrów aktywnych na token i bez otwartych wag za jakąkolwiek cenę.
Dwie kolumny, w zakresie wymiarów decydujących o zamówieniach
• Intelligence Index — 45,4 dla Qwen3.8-Max (0902) wobec 24,1 dla Solar Mini 4, oba według Intelligence Index v4.3.2.
• Koszt na ukończone zadanie — 5,41 USD za Qwen3.8-Max wobec 0,36 USD za Solar Mini 4. Mniej więcej piętnaście do jednego — i to stosunek, którego nikt nie przytacza.
• Cennik — 2,00 USD / 6,00 USD za milion tokenów, wejście z pamięci podręcznej 0,25 USD, dla Qwen3.8-Max wobec 0,10 USD / 0,40 USD, wejście z pamięci podręcznej 0,01 USD, dla Solar Mini 4.
• Kontekst — 1 000 000 tokenów w obu przypadkach, i to jedyny wymiar, w którym tani model niczego nie oddaje. Artificial Analysis podaje 983 616 dla Qwen3.8-Max i 1 048 576 dla Solar Mini 4; dokumentacja samego Upstage mówi o 512K, więc górna granica mniejszego modelu jest z tych dwóch mniej pewna.
• Wagi — Qwen3.8-Max to model zastrzeżony, hostowany; jego otwarty odpowiednik Qwen3.8-2.4T-A95B można pobrać na podstawie niestandardowej licencji, a przy 262 000 tokenów kontekstu uzyskuje on 39,9 w tym samym indeksie. Solar Mini 4 jest zastrzeżony i nie ma otwartego odpowiednika.
• Przepustowość — 204 tokeny wyjściowe na sekundę dla Solar Mini 4 w porównaniu z 39,5 dla Qwen3.8-Max, według pomiaru tego samego laboratorium. Model, którego koszt na zadanie jest piętnaście razy niższy, wykonuje je pięć razy szybciej.
Co można kupić za dwadzieścia jeden punktów indeksu

Kupują trudny koniec rozkładu. W Humanity's Last Exam Qwen3.8-Max odpowiada poprawnie na 43,1% pozycji, podczas gdy Solar Mini 4 osiąga 25,8%. W naukowym kodowaniu jest to 52,1% wobec 47,6%. W agentowej pracy z wiedzą luka rozszerza się do innej kategorii: Qwen3.8-Max osiąga 1663 Elo w GDPval-AA, gdzie Solar Mini 4 osiąga 1072 — prawie sześćset punktów Elo, co nie jest różnicą wynikającą z zaokrąglenia, lecz zmianą w tym, co można modelowi powierzyć do samodzielnego wykonania.
Jedynym testem, w którym mały model nie tylko utrzymuje pozycję, ale wręcz wygrywa, jest rozumowanie na długim kontekście. Solar Mini 4 uzyskuje 83,3% w AA-LCR v1.1, a Qwen3.8-Max uzyskuje 80,3%. To najsilniejszy argument za Solar Mini 4 w całym tym porównaniu: w benchmarku stworzonym, by testować „przeczytaj bardzo długi dokument i rozumuj na jego podstawie”, piętnaście razy wyższa cena za zadanie daje wynik o trzy punkty gorszy.
Obszarem, w którym żaden z modeli nie jest właściwym narzędziem, jest autonomiczna praca w terminalu. Solar Mini 4 uzyskuje 1% w Terminal-Bench 4.0; Qwen3.8-Max uzyskuje 38,9%. Model, który rozwiązuje osiem z dwudziestu trudnych zadań terminalowych, jest tam naprawdę użyteczny, a ten drugi już nie — co jest najwyraźniejszym w tym porównaniu przykładem różnicy rodzaju, a nie stopnia.
Dlaczego rachunek za zadanie flagowego modelu jest tak znacznie gorszy, niż sugeruje jego cena za token
Qwen3.8-Max generuje więcej wyników na zadanie niż Solar Mini 4 — 107 700 tokenów w porównaniu z 88 300 — i robi to w cenie 6,00 USD za milion, a nie 0,40 USD. To już większość tej różnicy, jeszcze zanim weźmie się pod uwagę zachowanie pamięci podręcznej. Alibaba rzeczywiście oferuje stawkę 0,25 USD za wejście z pamięci podręcznej, co stanowi realny rabat względem jej ceny wejścia wynoszącej 2,00 USD, a otwarty krewniak z tej rodziny, Qwen3.8-2.4T-A95B, to rzadki model o 2,4 biliona parametrów, z około 95 miliardami aktywnych parametrów, więc każdy generowany przez niego token powstaje w znacznie większej maszynie. Nic z tego nie jest krytyką. To właśnie powód, dla którego istnieje piętnastokrotny mnożnik na zadanie, i powód, dla którego porównywanie cen za token między tymi dwoma modelami jest mylące w obie strony.
Praktyczna konsekwencja: Solar Mini 4 nie jest „budżetowym Qwen 3.8”. To specjalista, który przypadkiem jest tani, szybki i mocny na dokładnie jednej osi — długich dokumentach — a słaby na osi, której pomyłka kosztuje najwięcej, czyli niezawodności agentowej. Qwen3.8-Max to generalista, którego przewaga ujawnia się dokładnie tam, gdzie błędna odpowiedź jest kosztowna.
Uruchamianie obu zamiast wybierania między nimi
To nietypowy przypadek w serii Solar Mini 4, w którym obie strony porównania to trasy, które faktycznie możemy Ci sprzedać. Qwen3.8-Max i jego datowany snapshot 0902 znajdują się w OrcaRouterw cenniku producenta wynoszącym 2,00 / 6,00 USD, obok Qwen3.8-Flash w cenie 0,15 / 0,47 USDoraz Qwen3.8-27B w cenie 0,33 / 2,40 USD — trzy szczeble tej samej generacji, jeden klucz, żadnej drugiej umowy i żadnej zmiany w kodzie poza ciągiem znaków nazwy modelu. Na dzień 1 października 2026 nasz własny pomiar w playgroundzie daje dla Qwen3.8-Max p50 na poziomie 2,5 sekundy przy 87,7 tokenów wyjściowych na sekundę w ciągu ostatnich siedmiu dni; to okno się przesuwa, więc lepiej sprawdzić aktualną kartę modelu niż to zdanie. Modele Upstage nie są dostępne za naszym pośrednictwem, a do Solar Mini 4 trzeba dotrzeć przez własne API Upstage.

To, co to umożliwia, to podział, za którym opowiada się to porównanie: ruch związany z długimi dokumentami, językiem koreańskim i ekstrakcją strukturalną kieruj tam, gdzie jest tanio, żądania wymagające rozumowania i korzystające z narzędzi kieruj do modelu flagowego, a przełączanie awaryjne niech obejmie dostawcę, który ma zły dzień. To także miejsce, w którym DSL routingu zasługuje na swoje miejsce — komponowanie modeli w jedno wywołanie sprawia, że tania pierwsza faza i droga faza weryfikacji mogą być jednym żądaniem skierowanym do jednego endpointu zamiast dwóch integracji, które trzeba utrzymywać w synchronizacji.
Krótka wersja

Jeśli Twoje obciążenie to długi kontekst, stały kształt danych wyjściowych i akceptowalny budżet opóźnień, Solar Mini 4 daje Ci 83% wyniku dla długiego kontekstu przy jednej piętnastej kosztu zadania i pięciokrotnie większej przepustowości, a brakujących dwudziestu jeden punktów indeksu nigdy nie zobaczysz na swoim dashboardzie. Jeśli Twoje obciążenie obejmuje narzędzia, wieloetapowych agentów lub pytania, w których pewna siebie błędna odpowiedź jest gorsza niż brak odpowiedzi, brakujące punkty to cały produkt i Qwen3.8-Max jest wart piętnastokrotności ceny. Każda liczba przypisana powyżej do Artificial Analysis jest niezależnym pomiarem tej organizacji; nazewnictwo i daty wydania Qwen3.8 należą do Alibaba, a liczby dotyczące serwowania OrcaRouter to nasz własny pomiar w playgroundzie z przesuwnym siedmiodniowym oknem.
Porównane w tym artykule1
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
