Główna karta tytułowa artykułu porównującego GPT-6 Sol z Kimi K3, z napisem „GPT-6 Sol vs Kimi K3” i podtytułem „Trzy założenia dotyczące otwartych wag, skonfrontowane z jednym rachunkiem”, pokazująca GPT-6 Sol jako model zamknięty w cenie $2.00/$10.00 z Indeksem 48, a Kimi K3 jako model o otwartych wagach w cenie $3.00/$15.00 z Indeksem 44.
Guides & Insights

GPT-6 Sol kontra Kimi K3: Trzy założenia dotyczące otwartych wag, skonfrontowane z jednym rachunkiem

Autor

Rowan Sterling

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Kupno otwartych wag to zwykle zakład w trzech kwestiach: że będą tańsze, że dają kontrolę i że są ubezpieczeniem na wypadek zmiany zdania przez dostawcę. Kimi K3, model o 2,8 biliona parametrów, który Moonshot AI udostępnił na otwartych wagach 27 lipca 2026 r., oraz GPT-6 Sol, zamknięty model wydany 22 września 2026 r., stanowią czysty przypadek testowy dla wszystkich trzech, ponieważ oba modele są na tyle blisko siebie na neutralnej tablicy, że założenia muszą same udźwignąć ten argument.

Oto jak wypadają. K3 nie jest tańszy w przeliczeniu na zadanie — jest około dwa razy droższy: $3.00 i $15.00 za milion tokenów w porównaniu z $2.00 i $10.00 w przypadku Sol. Kontrola jest realna, ale ma sprzętowy próg minimalny, którego większość zespołów nie przekroczy. A ubezpieczenie to jedyne założenie, które całkowicie się broni, co czyni je jedynym, za które warto płacić. Poniżej znajduje się arytmetyka stojąca za każdym z nich.

Te dwa modele, w skrócie

Kimi K3 to rzadki model mieszaniny ekspertów z 2,8 biliona całkowitych parametrów i około 104 miliardami — około 3,7% — aktywnymi na token, opublikowany na licencji Modified MIT z oknem kontekstowym o długości 1 048 576 tokenów. Twierdzenia Moonshot dotyczące architektury są konkretne: Kimi Delta Attention, hybrydowy schemat liniowej uwagi, który według firmy jest do 6,3× szybszy przy dekodowaniu długiego kontekstu, plus Attention Residuals i framework Stable LatentMoE. Przyjmuje tekst i obrazy, a zwraca tekst. Model niepoddany destylacji przekracza 1 TB rozmiaru, a wdrożenie produkcyjne opisuje się w kategoriach dolnego progu 64 akceleratorów.

GPT-6 Sol jest zamknięty, ma jeden identyfikator i stałą cenę $2.00 i $10.00, z odczytem z pamięci podręcznej po $0.20 i zapisem do pamięci podręcznej po $2.50, przy czym całe żądanie powyżej 272 000 tokenów wejściowych jest wyceniane na $4.00 i $15.00. Obsługuje tekst i obrazy na wejściu oraz tekst na wyjściu, z oknem 1 050 000 tokenów, maksymalnym wejściem 922 000 tokenów, limitem wyjścia 128 000 tokenów i datą odcięcia wiedzy 20 kwietnia 2026 r.

Okna kontekstowe są, z praktycznego punktu widzenia, tą samą liczbą — różnica 0,1%. To usuwa najczęstszy powód, by preferować jedno z nich, i oznacza, że decyzja opiera się wyłącznie na trzech założeniach.

Założenie pierwsze: otwarte wagi są tańsze. Nie są.

• Wejście — GPT-6 Sol $2.00 za milion tokenów vs Kimi K3 $3.00 za milion tokenów

• Wyjście — GPT-6 Sol 10,00 USD za milion tokenów vs Kimi K3 15,00 USD za milion tokenów

• Dane wejściowe z pamięci podręcznej — GPT-6 Sol 0,20 USD za milion tokenów vs Kimi K3 0,30 USD za milion tokenów; obie stawki stanowią jedną dziesiątą stawki za dane wejściowe bez pamięci podręcznej

• Indeks Inteligencji, niezależny — GPT-6 Sol 48 przy maksymalnym wysiłku vs Kimi K3 44 przy maksymalnym wysiłku

• Koszt na zadanie Index, niezależny — GPT-6 Sol 1,06 USD vs Kimi K3 2,00 USD

• Tokeny wyjściowe dla uruchomienia indeksu — GPT-6 Sol 77M vs Kimi K3 160M

• Okno kontekstowe — GPT-6 Sol 1 050 000 tokenów vs Kimi K3 1 048 576 tokenów

• Wagi — GPT-6 Sol zamknięty vs Kimi K3 otwarty, do pobrania i samodzielnego hostowania

• Licencja — GPT-6 Sol: nie dotyczy vs Kimi K3 Modified MIT

• Łączna liczba parametrów — GPT-6 Sol: nieujawniona vs Kimi K3: 2,8 biliona, z czego 104 miliardy są aktywne na token

Sol jest tańszy w każdym wierszu cennika, a różnica jest największa dokładnie tam, gdzie obciążenia agentowe wydają swoje pieniądze. Niezależna rada zgadza się co do kierunku i z grubsza co do skali: Sol kosztuje około połowę mniej na ukończone zadanie, przy wyniku o cztery punkty indeksu wyższym. K3 wygenerował nieco ponad dwa razy więcej tokenów wyjściowych, aby uzyskać ten sam indeks.

Jeden niuans sprawia, że nie jest to pogrom. Moonshot twierdzi, że K3 emituje 21% mniej tokenów wyjściowych niż jego poprzednik, a prace architektoniczne — schemat uwagi, projekt resztkowy — są wymierzone wprost w koszt dekodowania długiego kontekstu. W przypadku obciążenia zdominowanego przez bardzo długie dane wejściowe, funkcje wydajnościowe K3 mogą zmniejszyć część luki, którą pokazuje przebieg indeksu. Nikt nie opublikował tego pomiaru na porównywalnym stanowisku testowym, więc traktuj to jako twierdzenie dostawcy z wiarygodnym mechanizmem, a nie jako wynik.

A six-row scoreboard card titled 'GPT-6 Sol vs Kimi K3 - the scoreboard', comparing the two models on input price, output price, Intelligence Index, cost per task, weight availability and context window. The left column lists GPT-6 Sol at $2.00 input and $10.00 output, an Index of 48, $1.06 per task, closed weights and a 1,050,000-token context; the right column lists Kimi K3 at $3.00 and $15.00, an Index of 44, $2.00 per task, open weights under Modified MIT and a 1,048,576-token context. A footer reads 'Vendor list prices; Index per Artificial Analysis.'Screenshot of the Artificial Analysis model page for Kimi K3 (max), captured 23 September 2026, showing an Intelligence Index score of 44 in the open-weights class, list pricing of $3.00 per million input tokens and $15.00 per million output tokens, a cost of $2.00 per Intelligence Index task, 160 million output tokens generated during the index run, a 1M-token context window, 2.8 trillion total parameters with 104 billion active, and open model weights under the Kimi K3 license.

Założenie drugie: otwarte wagi dają ci kontrolę. Do pewnego sprzętowego progu.

Kontrola jest autentyczna i warta precyzyjnego określenia, ponieważ „open weights” jest często używane w sposób nieścisły. Licencja Modified MIT na możliwym do pobrania checkpointcie oznacza, że możesz uruchomić model na własnym sprzęcie, dostroić go, przypiąć konkretną wersję i utrzymać wnioskowanie w granicach, które kontrolujesz. Nic z tego nie jest dostępne w GPT-6 Sol za żadną cenę.

Nie oznacza to, że self-hosting jest substytutem API pod względem kosztów. Opublikowane dane podają, że pełnoprecyzyjny checkpoint zajmuje około 4,9 TB, czyli około 397 GB przy kwantyzacji 1-bitowej, z minimalnym progiem wdrożeniowym w zakresie 410 GB łącznej pamięci, a wdrożenia produkcyjne opisuje się w kategoriach 64 akceleratorów. Zespół, który już prowadzi tego typu klaster, ma tutaj realną opcję. Zespół, który tego nie robi, porównuje rachunek za API z zakupem kapitałowym, a rachunek za API wygrywa z dużą przewagą.

Uczciwa wersja argumentu o kontroli jest węższa, niż zwykle się ją przedstawia: otwarte wagi dają możliwość odejścia, a nie możliwość taniego uruchamiania. To dwie różne rzeczy, a tylko jedna z nich jest dostępna dla większości zespołów.

Założenie trzecie: otwarte wagi to polisa ubezpieczeniowa. To jedno się broni.

Trzecie założenie broni się w obliczu każdej z powyższych liczb i to ono sprawia, że K3 w ogóle ma rynek. Moonshot może zostać przejęty, może zmienić licencję na przyszłe wersje, może uznać K3 za przestarzały, może podnieść cenę, może zawieszać subskrypcje — i faktycznie zawiesił nowe subskrypcje w ciągu 48 godzin od wydania, aby chronić jakość usług dla dotychczasowych płacących klientów, co jest żywym dowodem na to, że dostęp do API jest kwestią polityki, a nie właściwością.

Jeśli K3 zostanie wycofane, wagi, które pobrałeś, nadal działają. Jeśli Moonshot potroi cenę API, Twoje wdrożenie hostowane samodzielnie pozostaje bez zmian. Jeśli musisz udowodnić audytorowi, że Twój stos wnioskowania jest zamrożony na znanej wersji, checkpoint Ci to daje, a API nie. Nic z tego nie pojawia się w tabeli kosztu na zadanie, a wszystko to jest realne.

Pytanie brzmi, ile to jest warte. Według powyższych liczb płacisz około dwa razy więcej za każde ukończone zadanie za to ubezpieczenie, plus cztery punkty wskaźnika możliwości. W przypadku obciążenia, w którym wycofanie API oznacza przerwę w działalności, to jest tanie. W przypadku obciążenia, w którym po prostu przełączyłbyś modele, to premia za zabezpieczenie, którego nigdy nie wykorzystasz.

Oba są na jednym klawiszu, jeśli chcesz, żeby tak było.

Screenshot of OrcaRouter's model page for Kimi K3, captured 23 September 2026, showing the model id kimi/kimi-k3 from provider MoonshotAI, a 1,048,576-token context window, text and image input with text output, vision, tool, JSON and reasoning support, list pricing of $3.00 per million input tokens and $15.00 per million output tokens, a p50 time to first token of 8.11 seconds and an OpenAI-compatible API served over both /v1/chat/completions and /v1/responses.

Kimi K3 znajduje się w katalogu OrcaRouter w cenie z cennika Moonshot, w ramach modelu pass-through, który wprowadza zmianę stawek Moonshot po naszej stronie tego samego dnia,a nie dopiero wtedy, gdy reseller ponownie wynegocjuje warunki. GPT-6 Sol nie znajduje się w naszym katalogu w momencie pisania tego tekstu i jest dostępny przez własne API OpenAI.

Ta kombinacja jest warta więcej, niż to brzmi w przypadku tej konkretnej decyzji, ponieważ oba modele należą do różnych trybów awarii. Powód, by uruchamiać K3, nie polega na tym, że jest tańszy — nie jest — ale na tym, że stanowi zabezpieczenie, a zabezpieczenie, na które nie można szybko przełączyć, nie jest dużym zabezpieczeniem. Utrzymywanie K3 za tym samym punktem końcowym co wszystko inne, z automatycznym przełączaniem awaryjnym i regułą routingu, którą można zmienić w konfiguracji, sprawia, że „mamy rozwiązanie zapasowe z otwartymi wagami” przestaje być slajdem w prezentacji, a staje się czymś, co działa o 3 w nocy.

Do czego właściwie służy każdy z nich

• Jeśli zależy Ci na najniższym koszcie na ukończone zadanie w pracy ogólnej — GPT-6 Sol, a przewaga wynosi około 2×.

• Jeśli chcesz uzyskać najwyższą wydajność na neutralnej tablicy spośród tych dwóch — GPT-6 Sol o cztery punkty.

• Jeśli już eksploatujesz klaster w klasie pamięci 400 GB i więcej i potrzebujesz wnioskowania w obrębie własnej granicy — K3, a kalkulacja zmienia się całkowicie, ponieważ koszt krańcowy wag nie jest taki sam jak koszt sprzętu.

• Jeśli twoim prawdziwym wymaganiem jest to, że twój model nie może zostać ci odebrany — K3, i to jest jedyny argument w porównaniu, na który Sol nie może odpowiedzieć.

• Jeśli kierujesz się ceną za token, bo K3 wygląda na tańszy chiński model — najpierw sprawdź liczbę tokenów. Przy 160 milionach tokenów wyjściowych dla przebiegu indeksowania w porównaniu z 77 milionami w Sol, tańsza stawka oznacza kupowanie większej liczby tokenów, a nie mniejszy rachunek.

Porównane w tym artykule1

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie