Wygenerowana karta tytułowa z napisem „Boreal vs Kimi K3” i podtytułem „Żaden z nich nie działa na twoim sprzęcie”, płaskie ikony liniowe przedstawiające ramkę odtwarzacza wideo, stos serwerów typu blade i kłódkę, z logo OrcaRouter nałożonym w prawym dolnym rogu.
Guides & Insights

Boreal vs Kimi K3: Żaden z nich nie działa na Twoim sprzęcie

Autor

Magnus Corvin

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Dziewięćdziesiąt sześć shardów Safetensors. Oto, co daje ci pobranie Kimi K3 — modelu mieszaniny ekspertów o 2,8 biliona parametrów, z 104 miliardami parametrów aktywnych na token, opublikowanego 27 lipca 2026 r. na zmodyfikowanej licencji MIT, jedenaście dni po jego wydaniu przez Moonshot AI. Same wytyczne Moonshot dotyczące jego obsługi zalecają konfiguracje supernodów z co najmniej 64 akceleratorami. Boreal nie można w ogóle pobrać: model reklamowy wideo firmy Creatify, uruchomiony 15 września 2026 r., jest zamknięty i samoobsługowy, w cenie jednego centa za sekundę gotowego wideo klasy 720p. Jedno z nich wręcza ci wagi oraz rachunek za sprzęt. Drugie zatrzymuje wagi i nalicza opłatę za sekundę. Żadne z nich nie działa na twoim sprzęcie, a powody są przeciwne — i właśnie dlatego warto dokonać tego porównania.

Co tak naprawdę dostarczają ci „otwarte wagi”

Etykieta „open-weights” naprawdę coś wnosi w tym porównaniu — i wnosi mniej, niż to brzmi.

To, co naprawdę zyskujesz dzięki Kimi K3, to trwałość. Wagi istnieją jako pliki. Gdyby Moonshot AI zmieniło cennik, obniżyło priorytet modelu lub zniknęło, checkpoint nadal by istniał — i podobnie byłoby ze stosami serwującymi, które go obsługują, a vLLM, SGLang i TokenSpeed widnieją wśród obsługiwanych ścieżek. To nie jest twierdzenie marketingowe; to właściwość artefaktu. Dla organizacji, której rejestr ryzyk obejmuje koncentrację dostawców, jest to najcenniejsza rzecz w tym wydaniu.

Nie otrzymujesz wdrożenia, które możesz uruchomić. Rzadki model o 2,8 biliona parametrów i 896 ekspertach to nie jest rozwiązanie typu „skwantyzuj i uruchom”. Oficjalne zalecenie dotyczące ponad 64 akceleratorów nie jest konserwatywnym punktem odniesienia, który zdeterminowany zespół mógłby znacząco obniżyć — to opis klasy maszyn, dla których model został zaprojektowany. Zespoły, które uruchamiają Kimi K3 na skalę choćby zbliżoną do produkcyjnej, w praktyce wynajmują go od kogoś, kto obsługuje superwęzeł. Co oznacza, że kwestia praktycznej dostępności nie zmienia się wraz z upublicznieniem wag: nadal kupujesz wnioskowanie od strony trzeciej, a licencja to jedyna rzecz, która się zmieniła.

Szczegół licencji wart jest uważnego przeczytania, bo to część, którą większość podsumowań pomija. Zmodyfikowane warunki MIT uzależniają obowiązki dotyczące brandingu i atrybucji od przekroczenia 100 milionów miesięcznych aktywnych użytkowników lub 20 milionów dolarów miesięcznego przychodu, a także wymagają, aby firmy świadczące usługi model-as-a-service, których przychody licencjobiorcy i podmiotów powiązanych przekraczają 20 milionów dolarów w dowolnych dwunastu kolejnych miesiącach, zawarły odrębną umowę z Moonshot. Wykorzystanie wewnętrzne i dostrajanie są zasadniczo dozwolone. Odsprzedaż podlega ograniczeniom. To rozsądna licencja dla modelu frontier i jest to istotnie coś innego niż MIT — dla startupu planującego zbudować na nim produkt próg ten jest przyszłą negocjacją, a nie obecnym uprawnieniem.

Co Boreal wysyła ci zamiast tego

Boreal dokonuje odwrotnej transakcji i jest to bardziej celowe, niż się wydaje.

Creatify twierdzi, że posiada wagi i sam je udostępnia, a model bazowy, na którym przeprowadziła trening po wstępnym treningu, jest modelem open source, który generuje dźwięk i wideo łącznie. Te dwa fakty razem to cała strategia produktu. Pochodzenie open source mówi z grubsza, jaką klasę modelu się wywołuje i że dźwięk nie jest doklejany później. Fakt posiadania wag mówi, że nikt inny nie może go udostępniać, co właśnie w ogóle umożliwia cenę za sekundę.

To, co dostajesz, to nie trwałość — to przepustowość. Creatify podaje, że renderowanie odbywa się w przybliżeniu 1:1 względem czasu rzeczywistego: jedna sekunda gotowego wideo na sekundę czasu zegarowego. To wynik inżynierii wnioskowania, a nie wynik jakości modelu, i właśnie to przetrwałoby, gdyby wagi opublikowano jutro. Gdyby checkpoint pojawił się na Hugging Face w przyszłym tygodniu, możliwość wyrenderowania pięciosekundowego klipu w około pięć sekund za pięć centów nadal należałaby do tego, kto zbudował stos serwujący — a implementacja referencyjna, z już dostrojoną przepustowością odpowiadającą ponad 64 akceleratorom, nadal należałaby do Creatify.

A więc uczciwa symetria wygląda tak: Kimi K3 daje ci checkpoint, na którego serwowanie cię nie stać, a Boreal daje ci usługę, której nie możesz odebrać dostawcy. Żadnej z nich nie da się hostować samodzielnie. Tylko jedna z nich jest zabezpieczeniem przed ryzykiem dostawcy — i jest to ta, w której zabezpieczenie kosztuje więcej niż to, co zabezpiecza.

A generated two-column scoreboard for Boreal vs Kimi K3 sharing six dimension labels. Boreal reads output rendered video, weights closed and vendor-served, self-hosting not possible, meter $0.01 per second, context not published, independent score none yet. Kimi K3 reads output text only, weights open with 96 shards, self-hosting 64+ accelerators, meter $3 / $15 per 1M, context 1M at a flat rate, independent score 1679 Elo front-end. Footer reads "Boreal figures vendor-run and unreproduced; Kimi K3 per our catalogue and third-party evaluators."

Kontrast specyfikacji

• Dane wyjściowe — Boreal: wyrenderowane wideo, klasa 720p, text-to-video i image-to-video. Kimi K3: tylko tekst.

• Wagi — Boreal: zastrzeżone, należące do Creatify i udostępniane przez Creatify. Kimi K3: opublikowane 27 lipca 2026 r., 96 shardów Safetensors, zmodyfikowana licencja MIT z warunkami odsprzedaży uzależnionymi od przychodów.

• Samodzielne hostowanie — Boreal: niemożliwe. Kimi K3: możliwe w zasadzie, przy czym Moonshot zaleca co najmniej 64 akceleratory.

• Cena — Boreal: 0,01 USD za sekundę gotowego wideo. Kimi K3: 3,00 USD za 1 mln tokenów wejściowych / 15,00 USD za 1 mln tokenów wyjściowych, z odczytami z pamięci podręcznej po 0,30 USD za 1 mln i stałą stawką w całym oknie kontekstu.

• Kontekst — Boreal: nieopublikowany. Kimi K3: 1 048 576 tokenów, bez dopłaty za długi kontekst.

• Opóźnienie — Boreal: podawane w stosunku 1:1 do czasu rzeczywistego. Kimi K3: p50 czasu do pierwszego tokenu wynosi 10,00 sekundy na naszej tablicy — to górna granica, którą raportuje nasza aparatura pomiarowa, więc traktuj to raczej jako „wolno” niż jako precyzyjny pomiar.

• Dowody — Boreal: wyłącznie testy prowadzone przez dostawcę. Kimi K3: dane dostawcy, w tym 93,5 w GPQA Diamond i 88,3 w Terminal-Bench 2.1, pierwsze miejsce w Frontend Code Arena z wynikiem 1679 Elo oraz niezależne ustalenia obejmujące 36-procentowy wskaźnik niepowodzeń w problemach z ukrytymi niezmiennikami.

Ślad, którego nie możesz wyłączyć

Kimi K3 ma właściwość rozliczeniową, która jest nietypowa nawet wśród modeli rozumujących, i to ona stanowi najbardziej konkretną różnicę kosztową w tym porównaniu.

Trybu myślenia nie można wyłączyć, a domyślny wysiłek rozumowania jest ustawiony na maksimum. Każde żądanie generuje pełny ślad rozumowania, a każdy token tego śladu jest rozliczany po 15,00 USD za milion tokenów wyjściowych. W przypadku zadania, w którym odpowiedzią jest jedno słowo, nadal płacisz za namysł. Odczyty z pamięci podręcznej po 0,30 USD za milion znacznie łagodzą stronę wejściową, a jednolita cena w całym kontekście 1 mln jest naprawdę korzystniejsza niż warstwowe struktury stosowane przez konkurencję — ale strona wyjściowa nie ma taniego trybu.

Koszt Boreal nie ma równoważnej dźwigni, którą można by ustawić źle. Pięciosekundowy klip to pięć centów, niezależnie od tego, czy model pracował ciężko, czy trywialnie, ponieważ jednostką jest artefakt, a artefakt jest stały. To nie jest w oczywisty sposób lepsze — jest po prostu niewrażliwe na cokolwiek, co model robi wewnętrznie.

Kimi K3 znajduje się w naszym katalogu, i jest zdecydowanie najruchliwszym modelem na naszej tablicy: 3 150,6 mln tokenów w ciągu ostatnich siedmiu dni, ponad siedemnastokrotnie więcej niż ruch Grok 4.6 i trzynaście razy więcej niż GPT-5.6 Sol. Ten wolumen to obraz modelu frontierowego o otwartych wagach w produkcji — wielu wywołujących, wrażliwych na cenę, gotowych omijać tego, kto obsługuje go najgorzej. Znajduje się za tym samym kluczem co reszta katalogu po stawce z cennika dostawcy z 0% marży, co ma większe znaczenie w przypadku modelu o otwartych wagach niż zamkniętego: gdy checkpoint jest publiczny, cenę ustala ten dostawca, który go obsługuje, więc cena jest zmienną konkurencyjną i ulega zmianom.

Boreal nie znajduje się w naszym katalogu. OrcaRouter nie obsługuje modeli generowania wideo, a warstwa tekstowa procesu reklamowego — briefy, warianty hooków, etap zgodności — to miejsce, w którym jesteśmy względem niego.

A screenshot of Creatify's own launch post for Boreal, dated September 15 2026 and headed "Introducing Boreal: frontier-quality AI video at a cent a second", showing the Boreal by Creatify Labs logo card and the opening paragraph stating that Boreal generates text-to-video and image-to-video at one cent per second, about $0.05 for a five-second clip, and renders in realtime.

Który i co oglądać

Jeśli Twoim ograniczeniem jest koncentracja dostawców i masz dostęp do poważnych zasobów obliczeniowych, Kimi K3 jest jedynym z tych dwóch, który daje realną odpowiedź, a 36-procentowy wskaźnik niepowodzeń w problemach z ukrytymi niezmiennikami to liczba, którą należy rozważyć w zestawieniu z tym. To model klasy frontier z prawdziwym wyjściem awaryjnym w zestawie, a to wyjście awaryjne jest wystarczająco kosztowne, że większość zespołów nigdy z niego nie skorzysta.

Jeśli Twoim ograniczeniem jest koszt na gotowy materiał reklamowy, Boreal jest tańszą i znacznie bardziej przewidywalną opcją, a jego ograniczeniem jest jakość w jednym konkretnym formacie: klip z mówiącą jedną osobą uzyskał 60% we własnym teście dostawcy na 40 przypadkach, wobec 83% i 85% w scenach produktowych i scenach twórców. Przetestuj ten format, zanim przeznaczysz na niego kampanię.

Jedno zastrzeżenie co do dowodów, ponieważ dotyczy obu. Opublikowane wskaźniki inteligencji Kimi K3 zostały co najmniej raz skorygowane, a starszych liczb z zakresu 57–60 nie należy podawać obok obecnych pochodzących od tego samego ewaluatora — to przypomnienie, że wynik benchmarku jest datowaną obserwacją, a nie właściwością modelu. A każdy wskaźnik jakości przypisany do Boreal pochodzi z własnego wpisu Creatify o premierze. Pierwsza niezależna ocena Boreal, kiedykolwiek się pojawi, będzie warta więcej niż wszystko, co obecnie o nim opublikowano.

A screenshot of the OrcaRouter model page for kimi/kimi-k3, showing Kimi K3 by MoonshotAI dated 2026-07-15 marked Featured, a 1M-token context, text + image input with text output, a p50 time to first token of 10.00 seconds, input $3.00 and output $15.00 per 1M tokens, and 3150.6M tokens of traffic in the last 7 days.