Wygenerowana karta tytułowa hero z napisem „Solar Mini 4 vs Qwen3.8-Max”, podtytułem „Ile faktycznie kosztowało ostatnie dwadzieścia punktów indeksu” i dwiema plakietkami o treści „24,1 wobec 45,4 w indeksie” oraz „0,36 USD wobec 5,41 USD za zadanie”.
Guides & Insights

Solar Mini 4 vs Qwen3.8-Max: Ile tak naprawdę kosztuje ostatnie dwadzieścia punktów indeksu

Autor

Magnus Corvin

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Solar Mini 4 kosztuje 0,10 USD za milion tokenów wejściowych i 0,40 USD za milion tokenów wyjściowych. Qwen3.8-Max, model, który większość ludzi ma na myśli, wpisując „Qwen 3.8” i prosząc o API, kosztuje 2,00 USD i 6,00 USD. W cenniku przekłada się to na dwudziestokrotną różnicę w cenie wejścia. W niezależnej ewaluacji, przez którą oba modele już przeszły, uczciwie rzecz biorąc, Qwen3.8-Max uzyskuje 45,4 w Artificial Analysis Intelligence Index wobec 24,1 Solar Mini 4 — około dwa razy większą zmierzoną zdolność — jednocześnie kosztując około piętnaście razy więcej na ukończone zadanie. Wszystko, co warto wiedzieć o tym zestawieniu, tkwi w różnicy między tymi dwoma stosunkami i w tym, że model Upstage'a działa z prędkością 204 tokenów na sekundę, podczas gdy flagowy model Alibaby osiąga 39.

Jedna uwaga dotycząca nazewnictwa przed liczbami, bo zmienia to, co kupujesz. Qwen 3.8 to generacja, a nie model: hostowanym flagowcem jest Qwen3.8-Max, odświeżony jako opatrzony datą snapshot 0902, a należącym do tej samej generacji członkiem do pobrania jest Qwen3.8-2.4T-A95B, wagi o 2,4 biliona parametrów, które Alibaba opublikowała 12 sierpnia 2026 r. Solar Mini 4, wydany 22 września 2026 r., to rzadki mixture-of-experts firmy Upstage o 35 miliardach parametrów, z około 3 miliardami parametrów aktywnych na token i bez otwartych wag za jakąkolwiek cenę.

Dwie kolumny, w zakresie wymiarów decydujących o zamówieniach

• Intelligence Index — 45,4 dla Qwen3.8-Max (0902) wobec 24,1 dla Solar Mini 4, oba według Intelligence Index v4.3.2.

• Koszt na ukończone zadanie — 5,41 USD za Qwen3.8-Max wobec 0,36 USD za Solar Mini 4. Mniej więcej piętnaście do jednego — i to stosunek, którego nikt nie przytacza.

• Cennik — 2,00 USD / 6,00 USD za milion tokenów, wejście z pamięci podręcznej 0,25 USD, dla Qwen3.8-Max wobec 0,10 USD / 0,40 USD, wejście z pamięci podręcznej 0,01 USD, dla Solar Mini 4.

• Kontekst — 1 000 000 tokenów w obu przypadkach, i to jedyny wymiar, w którym tani model niczego nie oddaje. Artificial Analysis podaje 983 616 dla Qwen3.8-Max i 1 048 576 dla Solar Mini 4; dokumentacja samego Upstage mówi o 512K, więc górna granica mniejszego modelu jest z tych dwóch mniej pewna.

• Wagi — Qwen3.8-Max to model zastrzeżony, hostowany; jego otwarty odpowiednik Qwen3.8-2.4T-A95B można pobrać na podstawie niestandardowej licencji, a przy 262 000 tokenów kontekstu uzyskuje on 39,9 w tym samym indeksie. Solar Mini 4 jest zastrzeżony i nie ma otwartego odpowiednika.

• Przepustowość — 204 tokeny wyjściowe na sekundę dla Solar Mini 4 w porównaniu z 39,5 dla Qwen3.8-Max, według pomiaru tego samego laboratorium. Model, którego koszt na zadanie jest piętnaście razy niższy, wykonuje je pięć razy szybciej.

Co można kupić za dwadzieścia jeden punktów indeksu

A two-column comparison scoreboard titled 'Solar Mini 4 vs Qwen3.8-Max', subtitled 'Roughly twice the capability at about fifteen times the task cost'. Solar Mini 4: Intelligence Index 24.05; cost per index task $0.36; rate card per 1M $0.10 in / $0.40 out; cached input $0.01 per 1M; context 1.05M listed and 512K claimed; output speed 204 tokens per second; output per task 88,300 tokens; long-context reasoning 83.3% on AA-LCR v1.1. Qwen3.8-Max: Intelligence Index 45.42; cost per index task $5.41; rate card per 1M $2.00 in / $6.00 out; cached input $0.25 per 1M; context 983,616; output speed 39.5 tokens per second; output per task 107,700 tokens; long-context reasoning 80.3% on AA-LCR v1.1.

Kupują trudny koniec rozkładu. W Humanity's Last Exam Qwen3.8-Max odpowiada poprawnie na 43,1% pozycji, podczas gdy Solar Mini 4 osiąga 25,8%. W naukowym kodowaniu jest to 52,1% wobec 47,6%. W agentowej pracy z wiedzą luka rozszerza się do innej kategorii: Qwen3.8-Max osiąga 1663 Elo w GDPval-AA, gdzie Solar Mini 4 osiąga 1072 — prawie sześćset punktów Elo, co nie jest różnicą wynikającą z zaokrąglenia, lecz zmianą w tym, co można modelowi powierzyć do samodzielnego wykonania.

Jedynym testem, w którym mały model nie tylko utrzymuje pozycję, ale wręcz wygrywa, jest rozumowanie na długim kontekście. Solar Mini 4 uzyskuje 83,3% w AA-LCR v1.1, a Qwen3.8-Max uzyskuje 80,3%. To najsilniejszy argument za Solar Mini 4 w całym tym porównaniu: w benchmarku stworzonym, by testować „przeczytaj bardzo długi dokument i rozumuj na jego podstawie”, piętnaście razy wyższa cena za zadanie daje wynik o trzy punkty gorszy.

Obszarem, w którym żaden z modeli nie jest właściwym narzędziem, jest autonomiczna praca w terminalu. Solar Mini 4 uzyskuje 1% w Terminal-Bench 4.0; Qwen3.8-Max uzyskuje 38,9%. Model, który rozwiązuje osiem z dwudziestu trudnych zadań terminalowych, jest tam naprawdę użyteczny, a ten drugi już nie — co jest najwyraźniejszym w tym porównaniu przykładem różnicy rodzaju, a nie stopnia.

Dlaczego rachunek za zadanie flagowego modelu jest tak znacznie gorszy, niż sugeruje jego cena za token

Qwen3.8-Max generuje więcej wyników na zadanie niż Solar Mini 4 — 107 700 tokenów w porównaniu z 88 300 — i robi to w cenie 6,00 USD za milion, a nie 0,40 USD. To już większość tej różnicy, jeszcze zanim weźmie się pod uwagę zachowanie pamięci podręcznej. Alibaba rzeczywiście oferuje stawkę 0,25 USD za wejście z pamięci podręcznej, co stanowi realny rabat względem jej ceny wejścia wynoszącej 2,00 USD, a otwarty krewniak z tej rodziny, Qwen3.8-2.4T-A95B, to rzadki model o 2,4 biliona parametrów, z około 95 miliardami aktywnych parametrów, więc każdy generowany przez niego token powstaje w znacznie większej maszynie. Nic z tego nie jest krytyką. To właśnie powód, dla którego istnieje piętnastokrotny mnożnik na zadanie, i powód, dla którego porównywanie cen za token między tymi dwoma modelami jest mylące w obie strony.

Praktyczna konsekwencja: Solar Mini 4 nie jest „budżetowym Qwen 3.8”. To specjalista, który przypadkiem jest tani, szybki i mocny na dokładnie jednej osi — długich dokumentach — a słaby na osi, której pomyłka kosztuje najwięcej, czyli niezawodności agentowej. Qwen3.8-Max to generalista, którego przewaga ujawnia się dokładnie tam, gdzie błędna odpowiedź jest kosztowna.

Uruchamianie obu zamiast wybierania między nimi

To nietypowy przypadek w serii Solar Mini 4, w którym obie strony porównania to trasy, które faktycznie możemy Ci sprzedać. Qwen3.8-Max i jego datowany snapshot 0902 znajdują się w OrcaRouterw cenniku producenta wynoszącym 2,00 / 6,00 USD, obok Qwen3.8-Flash w cenie 0,15 / 0,47 USDoraz Qwen3.8-27B w cenie 0,33 / 2,40 USD — trzy szczeble tej samej generacji, jeden klucz, żadnej drugiej umowy i żadnej zmiany w kodzie poza ciągiem znaków nazwy modelu. Na dzień 1 października 2026 nasz własny pomiar w playgroundzie daje dla Qwen3.8-Max p50 na poziomie 2,5 sekundy przy 87,7 tokenów wyjściowych na sekundę w ciągu ostatnich siedmiu dni; to okno się przesuwa, więc lepiej sprawdzić aktualną kartę modelu niż to zdanie. Modele Upstage nie są dostępne za naszym pośrednictwem, a do Solar Mini 4 trzeba dotrzeć przez własne API Upstage.

A screenshot of the OrcaRouter model page for Qwen3.8-Max, showing the model id qwen/qwen3.8-max at $2.00 input and $6.00 output per million tokens, text, image and video input with text output, vision, tools, JSON and reasoning capability flags, a 2.5-second median time to first token from our own playground, and the description of Alibaba's newest flagship model in the Qwen line.

To, co to umożliwia, to podział, za którym opowiada się to porównanie: ruch związany z długimi dokumentami, językiem koreańskim i ekstrakcją strukturalną kieruj tam, gdzie jest tanio, żądania wymagające rozumowania i korzystające z narzędzi kieruj do modelu flagowego, a przełączanie awaryjne niech obejmie dostawcę, który ma zły dzień. To także miejsce, w którym DSL routingu zasługuje na swoje miejsce — komponowanie modeli w jedno wywołanie sprawia, że tania pierwsza faza i droga faza weryfikacji mogą być jednym żądaniem skierowanym do jednego endpointu zamiast dwóch integracji, które trzeba utrzymywać w synchronizacji.

Krótka wersja

A screenshot of the Artificial Analysis model page headed 'Qwen3.8 Max (0902) Intelligence, Performance & Price Analysis', marked as an Alibaba proprietary model released September 2026, ranked 32nd of 223 on intelligence, 172nd on speed and 101st on cost, with $2.00 input, $6.00 output and cached pricing rows, 39.5 output tokens per second, a $5.41 cost figure and a verbosity readout.

Jeśli Twoje obciążenie to długi kontekst, stały kształt danych wyjściowych i akceptowalny budżet opóźnień, Solar Mini 4 daje Ci 83% wyniku dla długiego kontekstu przy jednej piętnastej kosztu zadania i pięciokrotnie większej przepustowości, a brakujących dwudziestu jeden punktów indeksu nigdy nie zobaczysz na swoim dashboardzie. Jeśli Twoje obciążenie obejmuje narzędzia, wieloetapowych agentów lub pytania, w których pewna siebie błędna odpowiedź jest gorsza niż brak odpowiedzi, brakujące punkty to cały produkt i Qwen3.8-Max jest wart piętnastokrotności ceny. Każda liczba przypisana powyżej do Artificial Analysis jest niezależnym pomiarem tej organizacji; nazewnictwo i daty wydania Qwen3.8 należą do Alibaba, a liczby dotyczące serwowania OrcaRouter to nasz własny pomiar w playgroundzie z przesuwnym siedmiodniowym oknem.

Porównane w tym artykule1

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie