
Dots vs MiniMax M3: Wynajmowanie Workera czy pobieranie Czytelnika
- typesafeNOWOŚĆTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 za 1 mln tokenów · 349 tok/s
- OpenAINOWOŚĆOpenAI: GPT-6 Luna2026-09-2237Inteligencja
- OpenAINOWOŚĆOpenAI: GPT-6 Sol2026-09-2248Inteligencja
- AnthropicNOWOŚĆAnthropic: Claude Opus 5.52026-09-2258Inteligencja
- xAINOWOŚĆGrok 4.72026-09-2146Inteligencja
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów · 210 tok/s
- OrcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 za 1 mln tokenów · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- xAISpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
Najtańszy model w tej partii jest także tym, który możesz zatrzymać, i ta kombinacja to całe porównanie. MiniMax M3, opublikowany 31 maja 2026 r., jest opisywany jako flagowy otwarty model bazowy MiniMax: tekst, obraz i wideo na wejściu, tekst na wyjściu, okno kontekstu o rozmiarze 1 048 576 tokenów, do 512 000 tokenów wyjściowych w pojedynczej odpowiedzi oraz cena katalogowa 0,30 USD za milion tokenów wejściowych i 1,20 USD za milion tokenów wyjściowych, przy odczytach z pamięci podręcznej po 0,06 USD — mniej więcej trzynasta część tego, co frontier pobiera za te same tokeny. Dots to nieustannie działający agent firmy, ogłoszony na DevDay 29 września 2026 r.: otrzymuje własny komputer w chmurze i przeglądarkę, działa w ponad 4000 połączonych aplikacji, opiera się na GPT-6 Astra i jest dołączony do planów Pro i Business Premium, przy czym nigdzie nie opublikowano wielkości limitu. Jeden to komponent, który możesz trzymać w ręku. Drugi to usługa, którą możesz jedynie subskrybować.
Cena nie jest interesującą liczbą
Trzydzieści centów za milion tokenów wejściowych to nagłówek, ale interesujące liczby to te dwie, które kształtują to, o co możesz prosić. Pierwsza to 512 000 tokenów maksymalnego wyjścia — sześć razy więcej, niż GPT-5.6 Sol wygeneruje w jednej odpowiedzi, i najwyższy limit wyjścia spośród wszystkich modeli w tym zestawieniu. Druga to 83 w zakresie przywoływania długiego kontekstu, co jest wystarczająco wysokie, że okno kontekstu jest użyteczną powierzchnią roboczą, a nie liczbą na karcie specyfikacji.
Połącz to ze sobą, a pewna konkretna klasa zadań staje się tania: generowanie długiego tekstu z długiego źródła. 400-stronicowy podręcznik techniczny przepisany dla innej grupy odbiorców. Przewodnik po migracji wygenerowany z całego repozytorium. Streszczenie badań, które samo w sobie ma długość raportu. Przy 0,30 i 1,20 dolara za milion zadanie, które w modelu klasy frontier byłoby czterocyfrową pozycją, tutaj jest błędem zaokrąglenia — a fakt, że pułap wyjściowy mierzy się w setkach tysięcy tokenów, a nie w dziesiątkach tysięcy, sprawia, że to jedno żądanie zamiast dwudziestu.
Warto wspomnieć o jednym zastrzeżeniu dotyczącym pomiaru. Panel opóźnień w naszym katalogu podaje medianę czasu do pierwszego tokenu wynoszącą 10,00 sekundy dla M3 w tym samym siedmiodniowym oknie, które pokazuje 18,35 miliona tokenów ruchu, a ta wartość znajduje się dokładnie na górnej granicy zakresu wyświetlanego przez panel. Należy to odczytywać jako artefakt okna, a nie charakterystykę modelu. To właśnie liczba ruchu mówi, że ludzie rzeczywiście z tego korzystają.

Wideo to dane wejściowe, których nikt nie planuje
Wizja to już podstawa, więc modalnością, która wciąż daje przewagę, jest wideo. M3 obsługuje je natywnie, obok tekstu i obrazów, a to zmienia kształt pipeline'u, a nie tylko dodaje kolejną możliwość do listy. Archiwum nagrań ekranu z działu wsparcia, zestaw klipów z wideorejestratora, semestr nagrań wykładów — to wszystko było wcześniej problemem przetwarzania wstępnego, w którym klatki próbkowano jednym narzędziem, a opisywano innym. Model, który odczytuje wideo bezpośrednio, scala dwa etapy w jedno wywołanie.
To także sprawia, że arytmetyka kosztów staje się mniej przewidywalna, ponieważ analizowanie wideo jest kosztowne w sposób, w jaki tekst nie jest, a największa pozycja na rachunku to zwykle dane wejściowe, których nikt nie uwzględnił w budżecie. Niska stawka za token sprawia, że można bezpiecznie eksperymentować: przy 0,30 USD za milion tokenów wejściowych sporadyczne przetworzenie pięciu godzin materiału jest wystarczająco przystępne, by tworzyć prototyp, zamiast spierać się o to na spotkaniu planistycznym.
Co tak naprawdę zmieniają otwarte wagi
MiniMax opisuje M3 jako model z otwartymi wagami, co oznacza, że wagi są publikowane, a nie tylko udostępniane jako usługa, i jest to inny rodzaj gwarancji niż subskrypcja. Gdyby MiniMax jutro przestał świadczyć usługę, zmienił cennik albo wycofał identyfikator, model nie zniknąłby — nadal działałby na sprzęcie, który już kupiłeś, w takiej kwantyzacji, jaka się zmieści. To nie sprawia, że samodzielne hostowanie jest tańsze w ogólnym przypadku; samodzielne udostępnianie dużego, rzadkiego mixture-of-experts to prawdziwy projekt inżynierski. Sprawia, że tę zależność da się przetrwać, co jest innym twierdzeniem — i tym, które ma znaczenie, gdy decydujesz, na czym budować.
Kropka oferuje odwrotną gwarancję. OpenAI posiada komputer, przeglądarkę, konektory i przydział, a twoim środkiem zaradczym, jeśli cokolwiek z tego się zmieni, jest zaprzestanie korzystania z tego. To uczciwy układ — wynajem to sposób, od którego powinna zacząć większość zespołów — ale to nie ten sam układ, a różnica staje się widoczna dopiero w dniu, w którym ma znaczenie.

Sześć różnic, które zmieniają decyzję
• Gwarancja — usługa, która może zmieniać warunki, w przeciwieństwie do wag, które możesz zachować (MiniMax M3 jest opisywany jako open-weight; kropki nie da się pobrać w żadnym sensie)
• Koszt na jednostkę pracy — niepublikowany dla kropki, w porównaniu z 0,30 USD i 1,20 USD za milion tokenów przy odczytach z pamięci podręcznej po 0,06 USD, najniższa stawka w tym zestawie porównawczym
• Górny limit pojedynczego żądania — nieudokumentowany dla kropki, wobec 1 048 576 tokenów wejściowych i 512 000 tokenów wyjściowych
• Modalności wejściowe — wiadomości i dane z połączonych aplikacji dla a dot, w porównaniu z tekstem, obrazem i wideo dla modelu
• Modalności poza zakresem — zmiany w innym oprogramowaniu, względem tekstu i tylko tekstu
• Niezależna pozycja — dla kropki nie istnieje żaden benchmark; M3 ma wskaźnik Artificial Analysis Intelligence Index wynoszący 29,2, co plasuje go na sześćdziesiątym miejscu spośród 145 zmierzonych modeli, czyli w środku stawki, i warto o tym wiedzieć, zanim założysz, że niska cena zapewnia rozumowanie na poziomie frontier. Nie zapewnia.
Gdzie każde z nich zasługuje na swoją pozycję na fakturze
Uczciwa interpretacja opublikowanego profilu M3 jest taka, że to model wolumenowy, a nie frontierowy: 92,9 w GPQA Diamond jest konkurencyjne, 59 w SWE Bench Pro jest przyzwoite, a środkowa pozycja w Intelligence Index mówi wszystko. Wygrywa pod względem kosztu na jednostkę pracy, pułapu generowania, wideo i łatwości wdrożenia — w tej kolejności. To dobry model, by umieścić go poniżej drogiej warstwy potoku — kroków streszczania, ekstrakcji, transkrypcji, generowania długiego tekstu i rozgałęziania na wiele prób — a zły, by umieścić go na jego szczycie.
OrcaRouter udostępnia go jako minimax/minimax-m3 w cenie katalogowej dostawcy MiniMax z 0% marży, w tym samym katalogu co ponad 200 modeli dostępnych za jednym kluczem, z automatycznym przełączaniem awaryjnym między dostawcami upstream oraz DSL routingu do kierowania pojedynczego żądania do modelu, który powinien je obsłużyć. To właśnie ten układ sprawia, że dwuwarstwowy podział jest praktyczny, a nie teoretyczny: ten sam klucz, który sięga po tani model do dużego wolumenu, sięga po model czołowy w przypadku wywołań, które muszą być poprawne, a nic nie przychodzi wewnątrz kropki, ponieważ kropek nie ma w ogóle w katalogu — żadnego endpointu, żadnego identyfikatora, żadnej zastępczej inteligencji.
Co robić w poniedziałek
Jeśli masz korpus audio lub wideo i nie masz taniego sposobu, by go przejrzeć, zacznij od tego: M3 to jedyny model w tym zestawie, który natywnie czyta wideo w tej cenie, a eksperyment kosztuje prawie nic. Jeśli masz kategorię pracy, która ciągle wypada, bo nikt jej nie ściga, dot to produkt stworzony właśnie do tego, a model rozliczany za użycie nie będzie udawał, że nim jest.
Te dwie rzeczy wchodzą w konflikt tylko wtedy, gdy założysz, że jedna musi wygrać. Subskrypcja goni; pobrany czytnik czyta. To drugie miej na własność, to pierwsze wynajmuj, i utrzymuj granicę między nimi na tyle wyraźną, byś mógł zastąpić którąkolwiek z nich bez przepisywania tej drugiej.

