Wygenerowana karta hero zatytułowana „Dots vs MiniMax M3", z podtytułem „Wynajmowanie pracownika czy pobieranie czytnika". Pionowa linia dzieli kartę: lewy panel, oznaczony „Dots", głosi „brak ceny za zadanie – brak opublikowanego pułapu"; prawy, oznaczony „MiniMax M3", głosi „otwarte wagi – tekst, obraz, wideo na wejściu – $0.30 / $1.20". Logo OrcaRouter jest złożone w prawym dolnym rogu.
Guides & Insights

Dots vs MiniMax M3: Wynajmowanie Workera czy pobieranie Czytelnika

Autor

Rowan Sterling

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele →
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Najtańszy model w tej partii jest także tym, który możesz zatrzymać, i ta kombinacja to całe porównanie. Mini​Max M3, opublikowany 31 maja 2026 r., jest opisywany jako flagowy otwarty model bazowy Mini​Max: tekst, obraz i wideo na wejściu, tekst na wyjściu, okno kontekstu o rozmiarze 1 048 576 tokenów, do 512 000 tokenów wyjściowych w pojedynczej odpowiedzi oraz cena katalogowa 0,30 USD za milion tokenów wejściowych i 1,20 USD za milion tokenów wyjściowych, przy odczytach z pamięci podręcznej po 0,06 USD — mniej więcej trzynasta część tego, co frontier pobiera za te same tokeny. Dots to nieustannie działający agent firmy, ogłoszony na DevDay 29 września 2026 r.: otrzymuje własny komputer w chmurze i przeglądarkę, działa w ponad 4000 połączonych aplikacji, opiera się na GPT-6 Astra i jest dołączony do planów Pro i Business Premium, przy czym nigdzie nie opublikowano wielkości limitu. Jeden to komponent, który możesz trzymać w ręku. Drugi to usługa, którą możesz jedynie subskrybować.

Cena nie jest interesującą liczbą

Trzydzieści centów za milion tokenów wejściowych to nagłówek, ale interesujące liczby to te dwie, które kształtują to, o co możesz prosić. Pierwsza to 512 000 tokenów maksymalnego wyjścia — sześć razy więcej, niż GPT-5.6 Sol wygeneruje w jednej odpowiedzi, i najwyższy limit wyjścia spośród wszystkich modeli w tym zestawieniu. Druga to 83 w zakresie przywoływania długiego kontekstu, co jest wystarczająco wysokie, że okno kontekstu jest użyteczną powierzchnią roboczą, a nie liczbą na karcie specyfikacji.

Połącz to ze sobą, a pewna konkretna klasa zadań staje się tania: generowanie długiego tekstu z długiego źródła. 400-stronicowy podręcznik techniczny przepisany dla innej grupy odbiorców. Przewodnik po migracji wygenerowany z całego repozytorium. Streszczenie badań, które samo w sobie ma długość raportu. Przy 0,30 i 1,20 dolara za milion zadanie, które w modelu klasy frontier byłoby czterocyfrową pozycją, tutaj jest błędem zaokrąglenia — a fakt, że pułap wyjściowy mierzy się w setkach tysięcy tokenów, a nie w dziesiątkach tysięcy, sprawia, że to jedno żądanie zamiast dwudziestu.

Warto wspomnieć o jednym zastrzeżeniu dotyczącym pomiaru. Panel opóźnień w naszym katalogu podaje medianę czasu do pierwszego tokenu wynoszącą 10,00 sekundy dla M3 w tym samym siedmiodniowym oknie, które pokazuje 18,35 miliona tokenów ruchu, a ta wartość znajduje się dokładnie na górnej granicy zakresu wyświetlanego przez panel. Należy to odczytywać jako artefakt okna, a nie charakterystykę modelu. To właśnie liczba ruchu mówi, że ludzie rzeczywiście z tego korzystają.

A screenshot of the OrcaRouter model page for MiniMax M3, showing the identifier 'minimax/minimax-m3' with Vision, Tools, JSON and Reasoning badges, a publication date of 2026-05-31, a description of it as MiniMax's flagship open-weight foundation model with MiniMax Sparse Attention and native multimodality, a side panel reading 1M tokens of context and 512K of maximum output over text, image and video input, and a price strip reading $0.30 and $1.20.

Wideo to dane wejściowe, których nikt nie planuje

Wizja to już podstawa, więc modalnością, która wciąż daje przewagę, jest wideo. M3 obsługuje je natywnie, obok tekstu i obrazów, a to zmienia kształt pipeline'u, a nie tylko dodaje kolejną możliwość do listy. Archiwum nagrań ekranu z działu wsparcia, zestaw klipów z wideorejestratora, semestr nagrań wykładów — to wszystko było wcześniej problemem przetwarzania wstępnego, w którym klatki próbkowano jednym narzędziem, a opisywano innym. Model, który odczytuje wideo bezpośrednio, scala dwa etapy w jedno wywołanie.

To także sprawia, że arytmetyka kosztów staje się mniej przewidywalna, ponieważ analizowanie wideo jest kosztowne w sposób, w jaki tekst nie jest, a największa pozycja na rachunku to zwykle dane wejściowe, których nikt nie uwzględnił w budżecie. Niska stawka za token sprawia, że można bezpiecznie eksperymentować: przy 0,30 USD za milion tokenów wejściowych sporadyczne przetworzenie pięciu godzin materiału jest wystarczająco przystępne, by tworzyć prototyp, zamiast spierać się o to na spotkaniu planistycznym.

Co tak naprawdę zmieniają otwarte wagi

MiniMax opisuje M3 jako model z otwartymi wagami, co oznacza, że wagi są publikowane, a nie tylko udostępniane jako usługa, i jest to inny rodzaj gwarancji niż subskrypcja. Gdyby MiniMax jutro przestał świadczyć usługę, zmienił cennik albo wycofał identyfikator, model nie zniknąłby — nadal działałby na sprzęcie, który już kupiłeś, w takiej kwantyzacji, jaka się zmieści. To nie sprawia, że samodzielne hostowanie jest tańsze w ogólnym przypadku; samodzielne udostępnianie dużego, rzadkiego mixture-of-experts to prawdziwy projekt inżynierski. Sprawia, że tę zależność da się przetrwać, co jest innym twierdzeniem — i tym, które ma znaczenie, gdy decydujesz, na czym budować.

Kropka oferuje odwrotną gwarancję. OpenAI posiada komputer, przeglądarkę, konektory i przydział, a twoim środkiem zaradczym, jeśli cokolwiek z tego się zmieni, jest zaprzestanie korzystania z tego. To uczciwy układ — wynajem to sposób, od którego powinna zacząć większość zespołów — ale to nie ten sam układ, a różnica staje się widoczna dopiero w dniu, w którym ma znaczenie.

A generated scoreboard titled 'Dots vs MiniMax M3 - capability and control', with two columns. The left column, 'Dots', lists: price included with Pro or Business Premium; allowance not published; cost per task not published; computer its own cloud computer and browser; connectors 4,000+ apps; independent benchmark none. The right column, 'MiniMax M3', lists: context 1,048,576 tokens; max output 512,000 tokens; input text, image, video; price $0.30 in / $1.20 out per 1M; cached reads $0.06 per 1M; weights downloadable. A footer reads 'Dots details vendor-stated from OpenAI's DevDay launch; MiniMax M3 figures as listed in the OrcaRouter catalogue.'

Sześć różnic, które zmieniają decyzję

• Gwarancja — usługa, która może zmieniać warunki, w przeciwieństwie do wag, które możesz zachować (MiniMax M3 jest opisywany jako open-weight; kropki nie da się pobrać w żadnym sensie)

• Koszt na jednostkę pracy — niepublikowany dla kropki, w porównaniu z 0,30 USD i 1,20 USD za milion tokenów przy odczytach z pamięci podręcznej po 0,06 USD, najniższa stawka w tym zestawie porównawczym

• Górny limit pojedynczego żądania — nieudokumentowany dla kropki, wobec 1 048 576 tokenów wejściowych i 512 000 tokenów wyjściowych

• Modalności wejściowe — wiadomości i dane z połączonych aplikacji dla a dot, w porównaniu z tekstem, obrazem i wideo dla modelu

• Modalności poza zakresem — zmiany w innym oprogramowaniu, względem tekstu i tylko tekstu

• Niezależna pozycja — dla kropki nie istnieje żaden benchmark; M3 ma wskaźnik Artificial Analysis Intelligence Index wynoszący 29,2, co plasuje go na sześćdziesiątym miejscu spośród 145 zmierzonych modeli, czyli w środku stawki, i warto o tym wiedzieć, zanim założysz, że niska cena zapewnia rozumowanie na poziomie frontier. Nie zapewnia.

Gdzie każde z nich zasługuje na swoją pozycję na fakturze

Uczciwa interpretacja opublikowanego profilu M3 jest taka, że to model wolumenowy, a nie frontierowy: 92,9 w GPQA Diamond jest konkurencyjne, 59 w SWE Bench Pro jest przyzwoite, a środkowa pozycja w Intelligence Index mówi wszystko. Wygrywa pod względem kosztu na jednostkę pracy, pułapu generowania, wideo i łatwości wdrożenia — w tej kolejności. To dobry model, by umieścić go poniżej drogiej warstwy potoku — kroków streszczania, ekstrakcji, transkrypcji, generowania długiego tekstu i rozgałęziania na wiele prób — a zły, by umieścić go na jego szczycie.

OrcaRouter udostępnia go jako minimax/minimax-m3 w cenie katalogowej dostawcy MiniMax z 0% marży, w tym samym katalogu co ponad 200 modeli dostępnych za jednym kluczem, z automatycznym przełączaniem awaryjnym między dostawcami upstream oraz DSL routingu do kierowania pojedynczego żądania do modelu, który powinien je obsłużyć. To właśnie ten układ sprawia, że dwuwarstwowy podział jest praktyczny, a nie teoretyczny: ten sam klucz, który sięga po tani model do dużego wolumenu, sięga po model czołowy w przypadku wywołań, które muszą być poprawne, a nic nie przychodzi wewnątrz kropki, ponieważ kropek nie ma w ogóle w katalogu — żadnego endpointu, żadnego identyfikatora, żadnej zastępczej inteligencji.

Co robić w poniedziałek

Jeśli masz korpus audio lub wideo i nie masz taniego sposobu, by go przejrzeć, zacznij od tego: M3 to jedyny model w tym zestawie, który natywnie czyta wideo w tej cenie, a eksperyment kosztuje prawie nic. Jeśli masz kategorię pracy, która ciągle wypada, bo nikt jej nie ściga, dot to produkt stworzony właśnie do tego, a model rozliczany za użycie nie będzie udawał, że nim jest.

Te dwie rzeczy wchodzą w konflikt tylko wtedy, gdy założysz, że jedna musi wygrać. Subskrypcja goni; pobrany czytnik czyta. To drugie miej na własność, to pierwsze wynajmuj, i utrzymuj granicę między nimi na tyle wyraźną, byś mógł zastąpić którąkolwiek z nich bez przepisywania tej drugiej.

A screenshot of the OrcaRouter model catalogue page headed 'Models', showing the line '206 models · 16 providers · one API key, one bill' above filter controls for input modalities, context length, input price, status and supported parameters, with a grid of model cards visible beneath.