Karta hero dla starcia Fugu Ultra v2 z MiniMax M3, pokazująca dużą różnicę cen między warstwą orkiestracji a niskokosztowym multimodalnym modelem z otwartymi wagami.
Guides & Insights

Fugu Ultra v2 vs MiniMax M3: dwudziestopięciokrotnie wyższa cena za wyjście

Autor

Elias Hawthorne

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Zestaw ze sobą obie stawki za tokeny wyjściowe, a liczba wygląda jak literówka. MiniMax M3 rozlicza 1,20 USD za milion tokenów wyjściowych. Fugu Ultra v2, ogłoszony przez Sakana AI 11 września 2026 r., według doniesień kosztuje 30,00 USD. To 25× — a na wejściu różnica wynosi 16,7×, 0,30 USD wobec podawanych 5,00 USD. MiniMax M3 jest także szybszy, natywnie obsługuje wideo i jest udostępniany jako otwarte wagi do pobrania. W obliczu takiej tabeli rozsądną pierwszą reakcją jest to, że warstwa orkiestracji nie może w żaden sposób uzasadniać swojej ceny. Ciekawsze pytanie brzmi, co musiałoby być prawdą, aby mogła to zrobić.

Luka, ujęta wprost

Wejście — MiniMax M3 0,30 USD za 1 mln vs Fugu Ultra v2, według doniesień 5,00 USD za 1 mln. Stawka M3 jest podawana przez MiniMax jako stała 50% zniżka, a nie promocja z terminem ważności.

Wyjście — MiniMax M3 1,20 USD za 1 mln vs Fugu Ultra v2, jak podano, 30,00 USD za 1 mln.

Wejście z pamięci podręcznej — MiniMax M3 0,06 USD za 1 mln w porównaniu z Fugu Ultra v2, wycenianym według doniesień na 0,50 USD za 1 mln. Odczyt z pamięci podręcznej w M3 to jedna piąta ceny jego własnego wejścia, co sprawia, że powtarzane pętle agenta na stabilnym prompcie są wyjątkowo tanie.

Powyżej 512K danych wejściowych — MiniMax M3 podwaja stawkę do $0.60 / $2.40 / $0.12. Zgłaszany próg Fugu Ultra v2 powyżej około 272K zmienia się na około $10.00 / $45.00 / $1.00. Oba przeliczają całe żądanie; M3 startuje później i kończy na ułamku tej stawki.

Kontekst — MiniMax M3: 1 048 576 tokenów, z gwarantowanym przez dostawcę minimum wynoszącym 512 tys. Kontekst Fugu Ultra v2 jest podawany jako 1 mln w zestawieniach firm trzecich; strona z ogłoszeniem Sakany nie podaje żadnej wartości.

Jedno zastrzeżenie dotyczące kolumny Fugu — i to niemałe: Sakana nie publikuje stawek za tokeny Fugu Ultra v2 na własnej stronie z ogłoszeniem. Liczby $5.00 / $0.50 / $30.00 pochodzą z katalogów modeli podmiotów trzecich i należy je uznawać za niepotwierdzone, dopóki nie sprawdzisz aktualnego cennika stawek. Kolumna M3 natomiast jest udokumentowana przez dostawcę. Ta różnica w pochodzeniu sama w sobie jest częścią porównania.

Two-column comparison scoreboard for Fugu Ultra v2 and MiniMax M3 covering type, release date, input price ($5.00 vs $0.30 per million tokens), output price ($30.00 vs $1.20), cached input ($0.50 vs $0.06) and input modes (text vs text, image and video).

Co M3 robi natywnie, a orkiestrator musi trasować

MiniMax M3 przyjmuje dane wejściowe w postaci tekstu, obrazu i wideo oraz zwraca tekst. Wideo jest tu najbardziej godne uwagi. Model był trenowany na mieszanych modalnościach od samego początku i opiera się na Min​iMax Sparse Attention, architekturze, która według producenta zapewnia nawet 9× szybsze wstępne wypełnianie i 15× szybsze dekodowanie przy kontekście 1M w porównaniu z poprzednikiem, przy około jednej dwudziestej obliczeń na token.

To ma znaczenie w tym starciu, ponieważ jest to zdolność, której Fugu Ultra v2 sobie nie przypisuje. Odpowiedzią orkiestratora na „obsłuż to wideo” jest skierowanie wideo do modelu, który potrafi je zobaczyć, co oznacza wywołanie podrzędne, a to oznacza więcej tokenów rozliczanych według stawki orkiestratora. Odpowiedzią M3 jest po prostu je odczytać. Przy koszcie wejścia 0,30 USD godzina analizy wideo to błąd zaokrąglenia; przy koszcie wejścia 5,00 USD plus koszt routingu, ilekolwiek by wynosił, to pozycja budżetowa.

Porównanie architektur jest też pod innym względem nierówne. MiniMax M3 ma łącznie około 428 mld parametrów, z czego około 23 mld aktywnych na token — projekt typu Mixture-of-Experts, w którym rzadkie trasowanie utrzymuje niski koszt obsługi. Fugu Ultra v2 nie ma opublikowanej liczby parametrów, ponieważ jego możliwości tkwią w polityce szeregowania nad modelami innych firm, a nie w wagach wytrenowanych przez Sakana. Jedno z nich jest modelem. Drugie to procedura decyzyjna.

Niewygodna implikacja

Oto kwestia, którą warto przemyśleć, zanim zapłacisz 25× za wynik.

MiniMax M3 ma otwarte wagi, jest tani, szybki, multimodalny i obsługuje długi kontekst. Na papierze to doskonały podagent. Gdybyś budował warstwę orkiestracji od zera — czym jest Fugu Ultra v2 — model taki jak M3 jest bliski idealnemu komponentowi: wystarczająco tani, by wywoływać go spekulatywnie, wystarczająco zdolny, by obsłużyć większość rozłożonych podzadań, i potrafi widzieć obrazy oraz wideo bez drugiego przeskoku.

Sakana nie publikuje puli modeli Fugu Ultra v2, więc nie możemy powiedzieć, czy M3 się w niej znajduje. Możemy natomiast powiedzieć, że ekonomicznie ma to sens tylko w jednym z dwóch scenariuszy. Albo Fugu Ultra v2 nie wywołuje modeli takich jak M3, w którym to przypadku marnuje najtańszą zdolną przepustowość, jaką ma do dyspozycji. Albo je wywołuje, w którym to przypadku znacząca część tokenów rozliczanych po $5.00 i $30.00 to tokeny M3, które u dostawcy kosztują $0.30 i $1.20, a premia to polityka orkiestracji plus marża.

Żadna z tych interpretacji nie jest zgubna dla produktu — dobry scheduler może być wart wielokrotnie więcej, a zapłacenie za niego pozwala uniknąć konieczności budowania go i utrzymywania. Oznacza to jednak, że pytanie, które należy zadać o Fugu Ultra v2, nie brzmi: „czy jest lepszy niż M3”. Brzmi: „czy planowanie jest warte więcej niż tokeny”. I na to pytanie mogą odpowiedzieć tylko pomiary własnych zadań.

Nie ma wspólnego benchmarku

W przeciwieństwie do niektórych innych porównań w tej serii, nie ma ani jednego benchmarku, w którym obaj dostawcy publikują wynik.

Opublikowany przez MiniMax zestaw wyników dla M3 jest szeroki i w większości odtwarzalny w swoim kształcie: SWE-bench Verified na poziomie 80,5%, SWE-bench Pro 59,0%, Terminal-Bench 2.0/2.1 – 66, BrowseComp – 83,5%, OSWorld-Verified – 70,1%, a PostTrainBench – 37,1 — trzecie miejsce, za Claude Opus 4.7 z 42,4 i GPT-5.5 z 39,3. Wszystkie raportowane przez dostawcę. Niezależnie Artificial Analysis przyznaje MiniMax M3 wynik 30 w swoim Intelligence Index v4.3, co daje mu 16. miejsce na 113, przy przepustowości 95,7 tokenów na sekundę i czasie do pierwszego tokena wynoszącym 1,95 sekundy — szybki i jeden z lepiej obsługiwanych modeli w swojej klasie. Jeśli widziałeś gdzieś M3 z wynikiem 44 lub 45, to sprzed przeformułowania indeksu.

Osiem benchmarków Sakany dla Fugu Ultra v2 — w tym GDP.pdf, Chartography, SWEFish, DeepSWE i Toolathon — z najlepszym lub ex aequo najlepszym wynikiem w pięciu i w czołowej dwójce w siedmiu, w ogóle nie pokrywa się z tą listą. Dwa z nich, SWEFish i Toolathon, to wewnętrzne testy Sakany. Główne twierdzenia — Chartography na poziomie 48,3 wobec 27,3 Opus 5 i 29,5 Fable 5 oraz DeepSWE na poziomie 74,3 — są raportowane przez dostawcę i zostały opublikowane dzisiaj. Nic na temat Fugu Ultra v2 nie zostało niezależnie zweryfikowane.

Tak więc porównanie, które każdy agregator utworzy w ciągu najbliższych dwóch tygodni — tabela wspólnych wyników — nie jest dostępne. Jedyną uczciwą rzeczą, jaką można powiedzieć o możliwościach, jest to, że MiniMax M3 ma zmierzoną, niezależną pozycję, a Fugu Ultra v2 ma twierdzenie.

Screenshot of the Sakana AI announcement page titled 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier', dated September 11 2026, showing the cost-versus-performance frontier chart, the Two Axes One Strategy section, and the Fugu Journey timeline.

Szybkość kontra konfiguracja

Liczby MiniMax M3 są znane: 95,7 tokena na sekundę, 1,95 sekundy do pierwszego tokena. To około dwa i pół raza większa przepustowość niż w Kimi K3; model należy też do najszybszych zmierzonych modeli zbliżonych do czołówki, co pasuje do konstrukcji wyraźnie zoptymalizowanej pod tanią obsługę długiego kontekstu.

Fugu Ultra v2 nie publikuje żadnych danych o opóźnieniu ani przepustowości. Podobnie jak w przypadku cennika, częściowo wynika to ze struktury — czas odpowiedzi orkiestratora zależy od tego, które modele wybierze i ile przebiegów wykonuje, więc pojedyncza liczba byłaby myląca. Oznacza to jednak, że koszt czasowy jego wdrożenia jest niezmierzony i nie da się go zmierzyć z zewnątrz. W przypadku poprzedniego Fugu Ultra testerzy publicznie raportowali przebiegi wydłużające się w stronę 30 minut; chodzi o model z czerwca 2026 r., a nie o v2, i nie stanowi to dowodu na temat nowego — ale jeśli wydajesz 25× więcej na wyniki, świadomość, jak długo się czeka, nie jest miłym dodatkiem.

Licencja i to, co mówi arabski fragment

Wagi MiniMax M3 można pobrać na licencji Min​iMax Community License, która jest licencją otwartych wag z dołączonymi warunkami komercyjnymi — w szczególności z progiem przychodów, powyżej którego wymagana jest pisemna zgoda. To nie jest licencja MIT, a każda strona, która twierdzi, że tak jest, nie przeczytała oznaczenia licencji. Fugu Ultra v2 nie daje nic do licencjonowania, ponieważ nie ma nic do pobrania.

Bardziej interesującym ostatnim wydarzeniem dla M3 jest to, co inni robią z tymi wagami. 3 września 2026 r. HUMAIN — wspierana przez saudyjski PIF firma AI — wydała arabski flagowy model zbudowany w drodze dotrenowania MiniMax M3 na ponad bilionie arabskich tokenów, przy 428 mld parametrów łącznie i 23 mld aktywnych, raportując równo ważony wynik 89,37% w siedmiu arabskich benchmarkach i plasując go przed GPT-5.6 Sol z 87,30 i Claude Opus 5 z 87,34. To podglądowa wersja badawcza, a to są własne liczby HUMAIN.

Kontrast z Fugu Ultra v2 nie mógłby być ostrzejszy jako stwierdzenie o tym, czym jest każdy z tych produktów. MiniMax M3 to fundament, na którym inne firmy budują suwerenne modele. Fugu Ultra v2 to brama, przez którą kierujesz wywołania, której składu nie widzisz i której wag nie możesz posiadać. Obie te pozycje są zasadne. Nie są nawet w przybliżeniu tym samym rodzajem rzeczy.

Screenshot of the OrcaRouter model page for MiniMax M3 showing the minimax/minimax-m3 identifier, a 1M token context window, 512K maximum output, and pricing of $0.30 per million input tokens and $1.20 per million output tokens.

Dzwonienie do któregokolwiek z nich

MiniMax M3 jest dostępny w OrcaRouter w cenie własnej MiniMax — 0,30 USD za milion tokenów wejściowych, 0,06 USD przy trafieniu w pamięć podręczną, 1,20 USD za milion tokenów wyjściowych — przekazywanej bez żadnej marży, więc jeśli MiniMax zmieni strukturę rabatów, trafi ona tutaj tego samego dnia, a nie w kolejnym cyklu migracji. Jest zgodny z OpenAI pod tym samym bazowym adresem URL co reszta katalogu, co oznacza, że możesz kierować do niego ruch według reguł, umieścić go za łańcuchem przełączania awaryjnego lub uwzględnić w panelu fuzji modeli bez drugiej umowy i zmian w kodzie. W przypadku modelu, którego całym argumentem jest cena, właśnie to przekazanie ma znaczenie: najtańsza trasa pozostaje najtańsza.

Fugu Ultra v2 nie jest przez nas routowany. Jest dostępny we własnym API Sakana AI zgodnym z OpenAI, a firma twierdzi, że istniejąca integracja Fugu przechodzi na niego po zmianie jednego parametru w jednej linii. Oba używają tego samego formatu żądań, więc umieszczenie ich za jednym przełącznikiem do ewaluacji sprowadza się do podmiany bazowego adresu URL.

Werdykt

W przypadku zdecydowanej większości obciążeń MiniMax M3wygrywa to porównanie już na samej arytmetyce. Jest 16,7× tańszy na wejściu i 25× tańszy na wyjściu, szybszy w każdym mierzonym wskaźniku, natywnie multimodalny, w tym w zakresie wideo, z otwartymi wagami na licencji, której pułapu większość firm nigdy nie osiągnie, i niezależnie oceniony na 30 w bieżącym indeksie Artificial Analysis. Jego słabości są realne, ale wąskie: jest gadatliwy, jego wynik w kategorii agentowej jest przeciętny na tle wyników w kodowaniu, a zestaw benchmarków dostawcy jest mocny w inżynierii oprogramowania i słabszy w zakresie długoterminowej autonomii.

Wybierz Fugu Ultra v2 tylko jeśli wierzysz w to, co Sakana faktycznie sprzedaje — poziom najwyższych możliwości, który rozkłada trudne zadania wieloetapowe na pulę, której nie kontroluje żaden czołowy dostawca, osiągając wyniki na poziomie czołowym bez polegania na czołowych modelach — oraz masz pomiary na poziomie zadań pokazujące, że dekompozycja bije pojedynczy tani model w twojej pracy. To propozycja zasadniczo różniąca się od wszystkiego, co oferuje Min​iMax, i to jest powód, dla którego istnieje 25×.

Ale pomiar wykonaj przed zakupem, a nie po nim. Jeśli model za 0,30 USD wykonuje twoje zadanie w dwóch próbach, a Fugu Ultra v2 wykonuje je w jednej, Fugu i tak jest droższy. Jedynym obciążeniem, w przypadku którego 25× się opłaca, jest takie, którego tani model nie jest w stanie w ogóle ukończyć — a to znacznie mniejszy zestaw zadań, niż sugeruje komunikat premierowy.

Porównane w tym artykule1

Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie