
Fugu Max kontra Claude Opus 5: czterokrotnie taniej i liczba, której nikt nie opublikował
- OrcaNOWOŚĆOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 za 1 mln tokenów
- orcaNOWOŚĆOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 za 1 mln tokenów
- deepseekNOWOŚĆDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligencja76Kod
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 za 1 mln tokenów
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligencja76Kod
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Inteligencja69Kod
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 za 1 mln tokenów
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Fugu Max kosztuje 6,00 USD za wygenerowanie miliona tokenów wyjściowych. Claude Opus 5 kosztuje 25,00 USD. Sakana AI udostępniła Fugu Max 11 września 2026 r. jako koordynatora, który kieruje każde zadanie do najoszczędniejszego modelu w swojej puli, i wyceniła go tak agresywnie, że czterokrotna różnica w koszcie wyjścia względem flagowego modelu Anthropic jest głównym faktem premiery. To, czego jednak w tej premierze nie ma, to ani jednej liczby opisującej, jak dobrze Fugu Max faktycznie sobie radzi. Sakana twierdzi, że zdobywa „najlepszy ogólny wynik” w sześciu benchmarkach i rozszerza granicę efektywności kosztowej w siedmiu z dziesięciu — to stwierdzenia o pozycji na wykresie, a nie o wartościach na osi. Claude Opus 5 natomiast pojawia się z opublikowanym wynikiem dla niemal wszystkiego, co robi. Uczciwa wersja tego porównania to więc nie tani kontra drogi. To zmierzone kontra deklarowane, a to właśnie różnica w cenie sprawia, że warto się o ten wybór spierać.
Luka i porównanie, którego Sakana nie zdecydowała się przeprowadzić
Strona wydania Sakana uzasadnia stawkę Fugu Max za generowanie, porównując ją z innymi modelami. Trzy wymienione modele to Claude Sonnet 5, GPT-5.6 Terra i Kimi K3, a twierdzenie jest takie, że cena generowania Fugu Max jest o 40–60 procent niższa od nich. Zauważ, kogo brakuje. Claude Opus 5 nie ma na tej liście, a powód to arytmetyka: przy 6,00 USD wobec 25,00 USD Fugu Max nie jest o 40 procent tańszy od Opus 5, tylko o 76 procent tańszy. Wymienienie Opus 5 sprawiłoby, że twierdzenie wyglądałoby na niewiarygodne, a nie konkurencyjne, więc porównanie przeprowadzono z półką poniżej flagowca.
To nie jest zarzut wobec ceny, która jest naprawdę niska. To spostrzeżenie o tym, co robi zdanie, w którym to umieszczono. Sposób, w jaki sama Sakana to ujmuje — osiągi „o krok od modeli z czołówki przy koszcie od dwóch do sześciu razy niższym” — jest skalibrowany pod kątem modeli, które postanowiła wymienić. W porównaniu z Claude Opus 5 ta wielokrotność nie wynosi od dwóch do sześciu, lecz ponad cztery na wyjściu; czy Opus 5 nadal jest „modelem z czołówki” w świetle tego zdania, pozostaje niepowiedziane, co jest ciekawym przemilczeniem w wydaniu, którego cały przekaz to efektywność kosztowo-wydajnościowa na froncie.
• Cena tokenów wejściowych — Fugu Max 2,00 USD za 1 mln tokenów vs Claude Opus 5 5,00 USD za 1 mln tokenów
• Cena za dane wyjściowe — Fugu Max 6,00 USD za 1 mln tokenów vs Claude Opus 5 25,00 USD za 1 mln tokenów
• Buforowane dane wejściowe — Fugu Max 0,25 USD za 1 mln tokenów vs buforowanie Claude Opus 5 wyceniane jako zniżka do 90% na buforowane dane wejściowe
• Wyniki benchmarków — Fugu Max: nie opublikowano żadnych; sześć zwycięstw w benchmarkach zadeklarowano bez danych liczbowych, w porównaniu z Claude Opus 5, dla którego Anthropic raportuje 96,0% SWE-bench Verified, 79,2% SWE-bench Pro i około 30,2% w ARC-AGI 3
• Architektura — Fugu Max, wytrenowany koordynator działający na nieujawnionej puli, kontra Claude Opus 5, pojedynczy model możliwy do przypięcia według wersji
• Kontekst — Fugu Max nieopublikowany vs Claude Opus 5 1 mln tokenów, z limitem 128K na wyjściu
• Niezależna ocena — Fugu Max: brak dla jakiegokolwiek modelu Fugu w porównaniu z Claude Opus — 5 miesięcy obecności w rankingach podmiotów trzecich
Sześć zwycięstw bez wyników
Sześć benchmarków to Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench i SWEFish. Pięć z nich to rozpoznawalne publiczne ewaluacje. Szósty, SWEFish, to własny benchmark kodowania Sakany, co oznacza, że jedno z sześciu zwycięstw jest oceniane na podstawie testu, który dostawca napisał i nie opublikował.
W przypadku pozostałych pięciu komunikat podaje, że Fugu Max osiąga najlepszy wynik ogólny, nie mówiąc, jaki to wynik ani jakie wyniki uzyskali konkurenci. To nietypowy kształt ogłoszenia modelu. Producenci rutynowo przesadzają, ale zwykle przesadzają za pomocą liczb, bo to liczby rozchodzą się najszerzej. Komunikat, który ogłasza sześć zwycięstw, a nie podaje ani jednego, prosi o to, by przyjąć go na wiarę samego twierdzenia.
Istnieje życzliwa interpretacja i warto ją wyrazić wprost. Fugu Max to koordynator zoptymalizowany pod kątem kosztów, a nie próba maksymalizacji możliwości — Sakana wydała go tego samego dnia co Fugu Ultra v2, czyli wersję nastawioną na maksymalne możliwości przy 5,00 USD za wejście i 30,00 USD za wyjście. Zadaniem Maxa jest osiągnięcie akceptowalnej jakości przy 6,00 USD za wyjście, a główny wynik orkiestratora ma mniejsze znaczenie niż jego wynik w przeliczeniu na dolara, co dokładnie pokazuje wykres Pareto. Komunikacja wizualna Sakany przy tym wydaniu to wykresy Pareto. Jeśli argument brzmi: „patrz na krzywą, a nie na szczyt”, to surowy wynik benchmarku jest nieistotny.
Nieprzychylna interpretacja jest taka, że liczba zachęciłaby do porównania, którego dostawca wolałby uniknąć. Obie interpretacje są spójne z dowodami i nic w publicznym zapisie obecnie ich nie rozróżnia. Można powiedzieć, że żadna niezależna strona nie oceniła żadnego modelu Fugu i nie ma wpisu Artificial Analysis dotyczącego Fugu Max ani żadnego z jego pokrewnych modeli. Każda liczba w komunikacie, w tym sześć zwycięstw, pochodzi od Sakana.

Zakup, którego faktycznie dokonujesz
Gdy dostawca jednego modelu publikuje benchmark, kupujesz twierdzenie o modelu. Gdy publikuje go orkiestrator, kupujesz twierdzenie o puli — modelach, których dostawca nie trenował, działających pod nadzorem koordynatora, którego decyzje dotyczące routingu celowo nie są ujawniane. Opisywana tu pula jest największą, jakiej użył Fugu, poszerzoną o modele open-weights i modele specjalistyczne, w tym rodzinę NVIDIA Nemotron, dzięki współpracy z NVIDIA. Poza tym skład nie został ujawniony.
Praktyczną konsekwencją jest to, że zachowanie Fugu Max może się zmienić bez zmiany jego wersji. Wycofanie przez czołowe laboratorium, zmiana ceny albo wycofanie modelu z danego regionu zmieniają to, co koordynator może wywołać, a Sakana otwarcie mówi, że właśnie o tę odporność chodzi — sprzedaje ochronę przed uzależnieniem od dostawcy i cofnięciami API. To rzeczywista korzyść i nie jest darmowa. Jest to również powód, dla którego benchmark Fugu Max, gdyby został opublikowany, miałby datę ważności, jakiej benchmark Claude Opus 5 nie ma.
Propozycja wartości Claude Opus 5 jest odwrotna i łatwiej ją wycenić. To jeden model w jednej wersji, domyślnie uruchamiający adaptacyjne myślenie z jawną skalą wysiłku od niskiego do maksymalnego, mający okno kontekstowe 1 mln tokenów i limit wyjścia 128K, z obsługą wizji, korzystania z narzędzi i trybu JSON. Anthropic podaje 96,0% w SWE-bench Verified i 79,2% w SWE-bench Pro, a liczby te zmierzono na tym, co otrzymujesz, wywołując endpoint — a nie na ensemblu, którego skład może się zmienić pod tobą. W przypadku obciążenia działającego w produkcji i poddawanego przeglądowi ta stabilność jest cechą, za którą płacisz 19,00 USD za milion tokenów wyjściowych.
Koszt za ukończone zadanie, a nie za token
Stawka Fugu Max za tokeny wyjściowe wynosząca 6,00 USD jest naprawdę atrakcyjna, a sposobem na jej sprawdzenie jest przestać porównywać ceny tokenów. Orkiestrator uruchamia agentów; każdy z nich generuje tokeny rozumowania i tokeny wyjściowe; koordynator pisze syntezę. FAQ Sakany dotyczące cen dla linii Fugu zobowiązuje do jednej uśrednionej stawki opartej na modelu najwyższej klasy spośród uczestniczących, przy czym uruchomienia wieloagentowe nie kumulują rachunku — co eliminuje mnożenie fan-out w najgorszym przypadku, które sprawia, że naiwne systemy wieloagentowe są zbyt drogie. Nie usuwa to jednak wolumenu. Liczba tokenów wyjściowych, za które jesteś rozliczany, zależy od tego, ilu agentów uruchomiono, a przy 6,00 USD za milion ten wolumen jest zmienną, której strona z cennikiem nie może ci podać.
Kształt kosztów Claude Opus 5 to jedno wywołanie, jeden model, kontrolowany przez ciebie suwak wysiłku oraz przetwarzanie wsadowe w połowie stawki dla pracy, która może poczekać. Możesz go prognozować, zanim go uruchomisz. W ponad dziesięciu tysiącach wykonań przewidywalność jest warta znacznie więcej niż przewaga w benchmarku, której nikt nie opublikował.
W tym miejscu kwestia routingu oddziela się od kwestii modelu. Claude Opus 5 jest dostępny na OrcaRouter w cenie katalogowej Anthropic z 0% narzutu — stawka dostawcy przekazywana jest wprost, więc zmiana cennika Anthropic obowiązuje na tym samym kluczu tego samego dnia, z automatycznym przełączaniem awaryjnym między ścieżkami dostawców, gdy jedna z nich ma limit szybkości lub jest niedostępna. Fugu Max nie znajduje się w naszym katalogu; dociera do Ciebie przez własne API Sakana zgodne z OpenAI oraz kilka platform zewnętrznych, a przejście na niego z wcześniejszego Fugu to zmiana jednego parametru w jednej linii. Jeśli chcesz mieć bazę dowodową Opus 5 i rachunek, który da się przewidzieć, router jest krótszą drogą. Jeśli chcesz system, który sam organizuje własne rozgałęzianie zadań przy trudnych problemach, Fugu Max właśnie to robi — a jego pilotaż warto przeprowadzić z rozliczaniem tokenów włączonym od pierwszego żądania.

Gdzie Fugu Max jest prawdopodobnie właściwą odpowiedzią
Oddajmy projektowi, co mu należne. Jeśli Twoja praca ma duży wolumen i jest weryfikowalna, a zależy Ci na medianowym koszcie ukończonego zadania, a nie na szczytowych możliwościach pojedynczego wywołania, orkiestrator, który dla każdego żądania wybiera najtańszy wystarczający model, robi coś, czego stały model flagowy nie potrafi. Fugu Max jest wymierzony dokładnie w takie obciążenie, a stawka 2,00 USD za wejście i 0,25 USD za wejście z pamięci podręcznej jest skalkulowana pod długie, powtarzalne konteksty, które generują takie obciążenia. Współpraca z NVIDIA również znaczy więcej, niż się wydaje: modele Nemotron mają otwarte wagi, co oznacza, że najtańszy szczebel puli nie jest narażony na decyzje cenowe innego laboratorium.
To, czego to nie daje, to powód, by wierzyć, że Fugu Max dorówna modelowi Claude Opus 5 w zadaniach, w których opublikowane wyniki Opus 5 są najwyższe — takich jak inżynieria oprogramowania w skali repozytorium i trudne rozumowanie. To dokładnie te wiersze, w których tablica sześciu benchmarków Sakany nie podaje żadnej liczby. Jeśli twój problem należy do tych, w których bycie najlepszym liczy się bardziej niż bycie tanim, stawka $25.00 za wyjście kupuje to, czego naprawdę potrzebujesz.
Konkluzja
Claude Opus 5 to lepiej poparty dowodami zakup i bezpieczniejszy domyślny wybór produkcyjny: opublikowane benchmarki dostawcy, wersja, którą można przypiąć, okno kontekstu, które się nie zmienia, limit wyjściowy 128K, pokrętło wysiłku, które pozwala kupować rozumowanie tylko wtedy, gdy się to opłaca, oraz miesiące wyników od stron trzecich za nim. Fugu Max to bardziej interesujący zakład i naprawdę tańszy — około 60 procent mniej na wejściu i 76 procent mniej na wyjściu, ze stawką za cache o rząd wielkości niższą niż bazowa cena wejściowa Opus 5.
Jeśli wykonujesz weryfikowalną, powtarzalną pracę o dużym wolumenie i znajdujesz się poza UE/EOG, Fugu Max zasługuje na pilotaż o określonym zakresie z limitem tokenów wyjściowych ustawionym przed rozpoczęciem oraz pomiarem liczby tokenów na ukończone zadanie, a nie na wywołanie. Jeśli potrzebujesz decyzji produkcyjnej, którą w tym kwartale możesz obronić przed kimś innym, Claude Opus 5 pozostaje odpowiedzią — a jest dostępny w OrcaRouter w cenie katalogowej Anthropic, przy czym stawka dostawcy jest przekazywana bez zmian.

