
Sakana Fugu Max: orkiestrator za $2/$6, który wybiera najtańszy działający model
- deepseekNOWOŚĆDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiNOWOŚĆOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleNOWOŚĆGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenNOWOŚĆQwen: Qwen3.8 Max (0902)2026-09-0240Inteligencja72Kod
- anthropicNOWOŚĆAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 za 1 mln tokenów
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0340Inteligencja72Kod
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Inteligencja69Kod
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 za 1 mln tokenów
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Inteligencja78Kod
- googleGoogle: Gemini 3.6 Flash2026-07-2134Inteligencja69Kod
Większość modeli rywalizuje o to, jak wiele potrafi zrobić. Sakana Fugu Max rywalizuje o to, jak niewiele może zrobić, nie ponosząc konsekwencji. Sakana AI wydała Sakana Fugu Max 11 września 2026 r., obok Sakana Fugu Ultra v2 — dwa warianty dostrojenia pojedynczej architektury orkiestracji, wymierzone w przeciwne końce krzywej kosztów i wydajności. Fugu Max nie odpowiada na twoje żądanie samodzielnie. Odczytuje zadanie, wybiera najtańszy model w swojej puli, który prawdopodobnie sobie z nim poradzi, kieruje je tam i zwraca jedną odpowiedź. Sakana wycenia go na 2 dolary za milion tokenów wejściowych i 6 dolarów za milion tokenów wyjściowych.
Najciekawsze jest to, z czym porównuje się tę cenę. Sakana twierdzi, że stawka za tokeny wyjściowe Fugu Max jest o 40–60% niższa niż w Claude Sonnet 5, GPT-5.6 Terra i Kimi K3. To twierdzenie da się sprawdzić i, co nietypowe jak na benchmark z dnia premiery, arytmetyka się zgadza: wobec obecnych cen katalogowych trzech wymienionych przez Sakanę modeli 6 dolarów za milion tokenów wyjściowych lokuje się niemal dokładnie w środku podanego przedziału. Znacznie trudniej zweryfikować stronę wydajnościową, ponieważ Sakana opublikowała wyniki Fugu Max jako wykresy rozrzutu, a nie liczby.
Czym właściwie jest Fugu Max
Fugu Max nie jest checkpointem. Nie ma pliku wag, liczby parametrów ani niczego do pobrania. Sakana opisuje go jako „architekturę, a nie pojedynczy model” — ten sam główny silnik orkiestracji co Fugu Ultra v2, dostrojony do innego pytania. Ultra v2 pyta, jaka jest najwyższa dostępna zdolność. Fugu Max pyta, jaki jest najlepszy wynik przy najniższym koszcie.
To rozróżnienie ma znaczenie operacyjne. Nie możesz dostrajać Fugu Max, hostować go samodzielnie ani sprawdzić, dlaczego wybrał jeden model zamiast innego. Nie możesz również zobaczyć pełnej listy modeli, przez które kieruje zapytania — Sakana twierdzi, że pula rozszerza się do „naszej największej puli otwartych i specjalistycznych modeli do tej pory” i wyraźnie wymienia rodzinę Nemotron firmy NVIDIA, dodaną w ramach partnerstwa z NVIDIA, które Sakana ogłosiła w sierpniu. Reszta puli nie została nazwana, a Sakana nie publikuje śladu routingu dla poszczególnych zapytań.
To, co widać, to kształt tego rozwiązania. Diagram samego dostawcy przedstawia Fugu Max na szczycie rozgałęzienia: jeden orkiestrator, za nim rząd wymiennych slotów modeli, a wśród celów znajdują się Sakana Namazu i sam Fugu Max. Pula jest określana jako wymienna z założenia, a deklarowana motywacja jest w równym stopniu polityczna, co ekonomiczna — Sakana przedstawia orkiestrację jako ochronę przed uzależnieniem od dostawcy, odbieraniem dostępu do API i kontrolą eksportu, argumentując, że system, który może wymieniać swoich dostawców, nie może zostać odcięty przez żadnego z nich.
Sakana Fugu samo w sobie nie jest nowe. Osiągnęło ogólną dostępność 22 czerwca 2026 r., a harmonogram samego dostawcy obejmuje kwiecień (beta), czerwiec (GA plus Fugu Ultra v1), lipiec (Fugu-Cyber i interfejs Claude Code), sierpień (Sakana Chat plus partnerstwo z NVIDIA), a teraz wrzesień. Fugu Max to piąty miesięczny krok, a nie debiut — a każdy, kto już korzysta z Fugu, aktualizuje do niego poprzez zmianę jednego parametru w tym samym endpointcie zgodnym z OpenAI, bez migracji.
Twierdzenie o cenach wytrzymuje konfrontację z cenami katalogowymi.
Kwota 2 USD za wejście / 6 USD za wyjście w przypadku Sakana jest wprost podana na stronie premiery. Dodatkowe relacje medialne podają jeszcze stawkę 0,25 USD za milion tokenów za wejście z pamięci podręcznej, której sama strona premiery nie podaje — tę wartość należy traktować jako zgłoszoną, a nie potwierdzoną. Dla porównania Fugu Ultra v2 to 5 USD za wejście, 30 USD za wyjście, przy 0,50 USD za wejście z pamięci podręcznej.
Teraz twierdzenie o 40–60%. Trzy wymienione punkty odniesienia obecnie wynoszą:
• GPT-5.6 Terra — $2 za wejście / $12 za wyjście, po tym jak obniżka OpenAI z 30 lipca ścięła cenę wyjścia z $15.
• Claude Sonnet 5 — $10 za output w promocyjnej stawce premierowej, $15 w stawce standardowej. Źródła nie są zgodne co do tego, czy zaplanowana na wrzesień podwyżka została anulowana, czy tylko opóźniona, dlatego zakres jest szeroki.
• Kimi K3 — $3 za wejście / $15 za wyjście, z wejściem z pamięci podręcznej po $0.30.
W porównaniu z nimi wyjście za 6 USD jest o 50% niższe niż Terra, o 40% niższe niż promocyjna stawka Sonnet 5, o 60% niższe niż standardowa stawka Sonnet 5 i o 60% niższe niż Kimi K3. To twierdzenie się zgadza i zgadza się z publikowanymi cenami katalogowymi, a nie z wewnętrznym modelem kosztów — czego nie można powiedzieć o każdym procencie podawanym w dniu premiery.
Jedna liczba w tej samej sekcji nie przechodzi tej samej próby. Sakana twierdzi również, że Fugu Max zapewnia „wydajność niewiele ustępującą modelom z najwyższej półki przy od dwóch do sześciu razy niższym koszcie”. W zestawieniu z trzema modelami, które wymienia dla wartości 40–60%, surowa różnica w cenie za wyjście jest bliższa 1,7× do 2,5×. Szerszy mnożnik jest przypuszczalnie mierzony w całym zakresie modeli frontier — w tym modeli kosztujących znacznie więcej niż $12 — a nie w odniesieniu do trzech wymienionych w zdaniu. To twierdzenie, którego można bronić w odniesieniu do krzywej Pareto, i takie, którego nie można bronić w odniesieniu do wymienionych rywali, a strona premiery nie rozróżnia jednego od drugiego.
To tutaj warstwa routingu zarabia na siebie po stronie cen. OrcaRouter przepuszcza ceny katalogowe dostawców bez marży, więc gdy dostawca zmienia cenę katalogową, liczba, którą widzisz, zmienia się tego samego dnia — istotne tutaj, ponieważ całe założenie Fugu Max polega na tym, że gdzieś w puli istnieje tańszy model i powinieneś do niego dotrzeć bez zastanowienia. Nie hostujemy Fugu Max; działa on na własnym API Sakany. Ale zasada przepuszczania cen jest tą samą, która sprawia, że stawka 6 USD za output jest warta sprawdzenia względem 12 USD u obecnego dostawcy, zamiast ufać którejkolwiek z tych liczb na wiarę.
Co Sakana twierdzi, że bije, i czego nie pokaże

Sekcja benchmarków dostawcy zawiera trzy konkretne twierdzenia dotyczące Fugu Max: najlepszy ogólny wynik w sześciu benchmarkach — Terminal Bench 2.1, GPQA-D, AA-LCR, GDP.pdf, AutomationBench i SWEFish — rozszerzenie granicy Pareto koszt-wydajność w siedmiu z dziesięciu benchmarków oraz wydajność „o krok od modeli klasy elitarnej” za ułamek nakładów na tokeny.
Trzy rzeczy dotyczące tych dowodów warto mieć w pamięci, zanim cokolwiek z nich zacytujesz.
Po pierwsze, Sakana nie opublikowała żadnych liczb. Wyniki Fugu Max są przedstawione jako dziesięć wykresów rozrzutu — wynik na osi pionowej, cena tokenów wyjściowych w dolarach za milion tokenów na osi poziomej — przy czym Fugu Max zaznaczono jako czerwony punkt na północny zachód od szarego pola. Widać, że znajduje się u góry i po lewej stronie. Nie da się z niego odczytać wyniku. Terminal Bench 2.1, GPQA-D i AA-LCR mają publiczne rankingi, w których liczba byłaby bezpośrednio porównywalna, a żadnej nie podano.
Po drugie, jeden z sześciu benchmarków jest własnym benchmarkiem Sakany. SWEFish opisano na stronie premiery jako „nasz wewnętrzny benchmark odzwierciedlający własne wyzwania programistyczne i przypadki użycia Sakana AI”. To uzasadniony sposób mierzenia dopasowania do własnego produktu, ale nie sposób na porównywanie się z konkurentem — wynik w benchmarku zaprojektowanym przez dostawcę, na zadaniach wybranych przez dostawcę, nie jest dowodem na temat modelu kogokolwiek innego.
Trzecia rzecz jest taka, że najmocniejsze liczby na stronie należą do drugiego modelu. Fugu Ultra v2 ma liczby tam, gdzie Fugu Max ma wykresy: Chartography 48,3 w zestawieniu z 27,3 dla Opus 5 i 29,5 dla Fable 5, DeepSWE 74,3, najlepszy lub ex aequo najlepszy w pięciu z ośmiu benchmarków i w pierwszej dwójce w siedmiu z ośmiu. Ultra v2 ma również podany cutoff treningowy na 2026-08-28 — nieco ponad dwa tygodnie przed premierą — oraz, co wymowne, wyraźną adnotację, że Fable 5, Fable 5.1 i GPT-6 Astra nie znajdują się w jej puli. Sakana twierdzi, że osiąga to bez wynajmowania tych konkretnych modeli, co jest całym argumentem o suwerenności w jednym przypisie.
Nic z tego nie czyni twierdzeń Fugu Max fałszywymi. Czyni je niezweryfikowanymi i sprawia, że nagłówek o sześciu testach porównawczych można bezpiecznie powtarzać tylko z dołączoną etykietą. Niezależna ocena całkowicie nowego punktu końcowego orkiestracji jest rzadkością, a jak dotąd nic nie opublikowano.
Fugu Max vs Fugu Ultra v2: który tak naprawdę chcesz

To nie są konkurujące ze sobą produkty, a wybór między nimi nie pozostawia wątpliwości, gdy zobaczysz liczby obok siebie. Fugu Max jest tym taniutkim: 2 USD za wejście, 6 USD za wyjście, stworzony, by kierować z dala od drogich modeli, gdy tylko tańszy model może wykonać zadanie. Fugu Ultra v2 jest tym mocnym: 5 USD za wejście, 30 USD za wyjście, 0,50 USD za dane z pamięci podręcznej, stworzony, by kierować w stronę większych możliwości przy złożonej, wieloetapowej pracy, nawet gdy kosztuje to więcej.
Praktyczny podział przebiega według kształtu zadania, a nie budżetu. Jeśli większość Twojego ruchu to wyszukiwania, ekstrakcja, klasyfikacja, krótkie generacje i proste wywołania narzędzi, cały zamysł Fugu Max polega na tym, żeby to wychwycić i wydawać jak najmniej — a twierdzenie Sakany, że przesuwa granicę w siedmiu z dziesięciu benchmarków, przynajmniej z grubsza o to chodzi. Jeśli Twój ruch obejmuje długie przebiegi agentowe, refaktoryzacje wielu plików lub zadania badawcze, które kosztownie zawodzą, gdy krok pójdzie źle, stawka 30 USD za wyjście w Ultra v2 kupuje coś realnego: miejsce w pierwszej dwójce w siedmiu z ośmiu benchmarków to część strony premiery, która najbardziej przypomina twierdzenie o możliwościach, a nie o kosztach.
Oba są dostępne w tym samym API kompatybilnym z OpenAI przez konsolę Sakana, a ścieżka aktualizacji z istniejącego Fugu to zmiana parametru. Obowiązują dwa zastrzeżenia dotyczące dostępności. Zgłaszano, że Fugu jest niedostępny w UE i EOG do czasu zakończenia prac nad RODO, co — jeśli nadal obowiązuje — ogranicza to, gdzie można wdrożyć którykolwiek z modeli. A oba są systemami zamkniętymi: kupujesz punkt końcowy, a dostawca wybiera, jakie modele za nim stoją — w tym, w przypadku Fugu Max, listę, której nie ujawnia w pełni.
Haczyk: orkiestrator, który wciąż wynajmuje swój frontier
Najostrzejsza krytyka Fugu to ta, do której Sakana zaprasza, przedstawiając Fugu jako infrastrukturę suwerenności. Warstwa orkiestracji, która kieruje ruch przez interfejsy API firm trzecich, nie powstrzymuje cofnięcia dostępu do tych API. Zamienia pojedynczy punkt awarii na zdywersyfikowany, co jest realną poprawą, ale modele bazowe wciąż należą do kogoś innego, wciąż są objęte tymi samymi kontrolami eksportowymi i wciąż podlegają tym samym nagłym odcięciom usług. Sierpniowe partnerstwo z NVIDIA i dodatki Nemotron to jak dotąd najbardziej konkretna odpowiedź na to — modele z otwartymi wagami w puli to modele, których nikt nie może wyłączyć — ale Sakana nie mówi, jaka część ruchu Fugu Max faktycznie trafia na te modele.
Istnieje drugi, cichszy kompromis. Decyzje dotyczące routingu zwiększają opóźnienia i znoszą determinizm. Żądanie, które dziś trafia do małego modelu, jutro może trafić do innego, jeśli pula lub wagi kosztów się zmienią, co sprawia, że zachowanie jest trudniejsze do przetestowania regresyjnie i trudniejsze do wyjaśnienia każdemu, kto audytuje system. Sakana odpowiada, że orkiestracja jest wewnętrzna, a API zachowuje się jak pojedynczy model. To prawda na poziomie interfejsu, ale nie pod spodem, a zespoły z rygorystycznymi wymaganiami dotyczącymi odtwarzalności powinny to starannie przetestować, zanim stanie się to elementem nośnym.
Jeśli chcesz zyskać na kosztach, nie czyniąc puli swoją jedyną zależnością, ten sam wzorzec możesz złożyć samodzielnie. Nasz DSL routingu pozwala zdefiniować panel modeli za jednym punktem końcowym i zdecydować, który z nich obsługuje jaką klasę żądań, a fuzja modeli uruchamia kilka modeli na tym samym prompcie i uzgadnia odpowiedzi tam, gdzie zgodność liczy się bardziej niż cena. Przełączanie awaryjne między dostawcami oznacza, że gdy dostawca ulegnie degradacji — lub zniknie — ruch przechodzi do modelu, któremu już ufasz, bez zmiany kodu. To bardziej zachowawcza wersja zakładu, który Sakana każe ci postawić w całości.

Warto być precyzyjnym co do tego, co oferujemy, a czego nie oferujemy w tym miejscu. Sakana Fugu Max nie znajduje się w naszym katalogu — nie jest u nas modelem dostępnym w routingu, działa na własnym API i konsoli Sakany. Nasz katalog to 196 modeli od 15 dostawców na jednym kluczu i jednym rachunku, ze stawkami za token widocznymi na każdej karcie i bez narzutu ponad nie. Istotna zbieżność z Fugu Max dotyczy idei, nie oferty: oba to argumenty, że właściwa odpowiedź na pytanie „który model powinien się tym zająć” zwykle nie jest ten największy.
Kto powinien się ruszyć, a kto powinien czekać
Fugu Max jest jednym z ciekawszych premier tego miesiąca właśnie dlatego, że nie jest modelem. Jeśli już korzystasz z Sakana Fugu, aktualizacja to zmiana jednej linijki w niższej cenie i nie ma powodu się zastanawiać. Jeśli obsługujesz ruch o dużej objętości i niskiej złożoności na modelu średniej klasy i płacisz za niego 10–15 USD za milion tokenów wyjściowych, arytmetyka, którą proponuje Sakana, jest warta własnego testu porównawczego — weź tydzień rzeczywistych żądań, przepuść je przez Fugu Max i porównaj jakość z obecnie używanym modelem, a nie z wykresami rozrzutu.
Jeśli potrzebujesz opublikowanych wyników benchmarków, zanim podejmiesz decyzję, poczekaj. Na temat Fugu Max nie ma jeszcze nic niezależnego, dowody samego dostawcy to wykres, a nie tabela, a jeden z sześciu głównych benchmarków należy do Sakany. To nie jest powód, by go odrzucać — to powód, by przetestować go na własnym ruchu, który jest jedynym benchmarkiem, jaki kiedykolwiek mógł przewidzieć twoje wyniki. A jeśli twoje obciążenie jest agentowe, długoterminowe i kosztowne w przypadku pomyłki, modelem, na który warto spojrzeć w tej parze, jest Fugu Ultra v2, a nie Fugu Max: to ten z dołączonymi liczbami.
Nasz routing DSL pozwala zdefiniować panel modeli za jednym punktem końcowym i zdecydować, który z nich obsługuje którą klasę żądań, a fuzja modeli uruchamia kilka modeli na tym samym prompcie i uzgadnia odpowiedzi tam, gdzie zgodność liczy się bardziej niż cena.
Porównane w tym artykule1
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
