
Fugu Max kontra GPT-5.6 Sol: twierdzenie o cenie było wymierzone w środek gamy
- deepseekNOWOŚĆDeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligencja
- openaiNOWOŚĆOpenAI: GPT-6 Astra2026-09-0453Inteligencja77Kod
- googleNOWOŚĆGoogle: Gemini 3.8 Flash2026-09-0241Inteligencja76Kod
- qwenNOWOŚĆQwen: Qwen3.8 Max (0902)2026-09-0240Inteligencja72Kod
- anthropicNOWOŚĆAnthropic: Claude Fable 5.12026-09-0153Inteligencja82Kod
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 za 1 mln tokenów
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligencja72Kod
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 za 1 mln tokenów
- z-aiZ.ai: GLM 5.32026-08-1845Inteligencja75Kod
- obsidianQwen3.8 27B2026-08-1534Inteligencja68Kod
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligencja69Kod
- grokSpaceXAI: Grok 4.62026-08-1244Inteligencja77Kod
- metaMeta: Muse Spark 1.22026-08-0540Inteligencja72Kod
- qwenQwen: Qwen3.8 Max2026-08-0340Inteligencja72Kod
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Inteligencja69Kod
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 za 1 mln tokenów
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Inteligencja78Kod
- googleGoogle: Gemini 3.6 Flash2026-07-2134Inteligencja69Kod
Uzasadnienie ceny Fugu Max wymienia model GPT-5.6 i nie jest to model flagowy. Sakana AI wydała Fugu Max 11 września 2026 r. w cenie 2,00 USD za milion tokenów wejściowych i 6,00 USD za milion tokenów wyjściowych, stwierdzając, że ceny jej tokenów wyjściowych są o 40 do 60 procent niższe niż w przypadku Claude Sonnet 5, GPT-5.6 Terra i Kimi K3. GPT-5.6 Sol — flagowy model tej samej rodziny OpenAI, wyceniony na 4,00 USD za tokeny wejściowe i 20,00 USD za tokeny wyjściowe za milion — nie pojawia się w tym zdaniu. To pominięcie nie jest przeoczeniem; to arytmetyka. Sol ma ponad trzykrotnie wyższą stawkę za tokeny wyjściowe niż Fugu Max, a ta różnica sprawiłaby, że otaczające sformułowanie „na wyciągnięcie ręki od modeli klasy elitarnej przy dwóch do sześciu razy niższym koszcie” czytałoby się jako twierdzenie zupełnie innego rodzaju. Dlatego to starcie warto rozegrać na warunkach Sol, a nie na warunkach wybranych przez dostawcę.
Sprawdzanie twierdzenia wobec rodziny, na którą ono wskazuje
Podana przez Sakanę liczba 40–60 procent jest weryfikowalna, ponieważ model, który wymienia, ma opublikowaną stawkę. GPT-5.6 Terra jest wyceniony na 2,00 USD za wejście i 12,00 USD za wyjście za milion tokenów. Fugu Max jest wyceniony na 2,00 USD za wejście i 6,00 USD za wyjście. Przeprowadź porównanie, a wynikną z niego dwie rzeczy. Na wyjściu 6,00 USD wobec 12,00 USD to obniżka dokładnie o 50 procent — w samym środku podanego przedziału 40–60, co świadczy o tym, że przedział został wyznaczony wokół tego porównania, a nie odkryty na jego podstawie. Na wejściu obie stawki są identyczne co do centa.
To dobrze skonstruowane twierdzenie, a dobre konstruowanie ich to właśnie zadanie strony premiery. Jest jednak skalibrowane na środek drabiny GPT-5.6. Terra to zrównoważony poziom w rodzinie trzech modeli — Sol powyżej niej do trudnej, złożonej pracy, Luna poniżej niej pod względem szybkości i kosztu. Nazwanie modelu Terra ustawia punkt odniesienia dla „modelu elitarnego” na środkowym szczeblu i pozwala Fugu Max uczciwie twierdzić, że jego cena za wyjście to połowa ceny Terry. Nazwanie modelu Sol wymagałoby innego zdania, ponieważ uczciwa wersja jest taka, że Fugu Max kosztuje o 70 procent mniej na wyjściu niż Sol i o 50 procent mniej na wejściu — znacznie większa różnica, która nasuwa oczywiste pytanie uzupełniające: z jakiej możliwości rezygnujesz w zamian.
• Cena wejściowa — Fugu Max 2,00 USD za 1 mln tokenów vs GPT-5.6 Sol 4,00 USD za 1 mln tokenów
• Cena wyjściowa — Fugu Max 6,00 USD za 1 mln tokenów vs GPT-5.6 Sol 20,00 USD za 1 mln tokenów
• Wejście z pamięci podręcznej — Fugu Max 0,25 USD za 1 mln tokenów vs GPT-5.6 Sol, gdzie buforowanie jest wyceniane jako rabat od podstawowej stawki za wejście
• Kontekst — Fugu Max nieopublikowany vs GPT-5.6 Sol 1 mln tokenów
• Limit tokenów wyjściowych — Fugu Max: nieopublikowany vs GPT-5.6 Sol: 128 tys. tokenów
• Modalność wejściowa — Fugu Max nieopublikowany vs GPT-5.6 Sol: tekst, obraz i plik
• Tagi możliwości — Fugu Max: brak opublikowanych vs GPT-5.6 Sol: obsługa obrazu, korzystanie z narzędzi, tryb JSON, rozumowanie
• Punkty końcowe — Fugu Max: jeden interfejs zgodny z OpenAI w porównaniu z chat completions GPT-5.6 Sol i responses API
• Wyniki benchmarków — sześć rzekomych zwycięstw Fugu Max bez podania wyników w porównaniu z opublikowanymi przez producenta wynikami GPT-5.6 Sol, w tym Terminal-Bench 2.0 na poziomie 91,9% i SWE-bench Pro na poziomie 64,6%
Dlaczego środkowy szczebel to właściwy szczebel, by go nazwać
Istnieje wersja wyboru Sakany, której można bronić, i zasługuje ona na przedstawienie przed krytyką. Orkiestrator, który kieruje każde zadanie do najoszczędniejszego modelu zdolnego je wykonać, nie konkuruje z modelem flagowym w pracach flagowych. Konkuruje z modelem średniej klasy w zadaniach średniej klasy i oferuje wykonanie ich podzbioru taniej. Jeśli propozycja brzmi: „większość twojego ruchu nie potrzebuje Sol”, to właściwym punktem odniesienia jest Terra, ponieważ to po Terrę większość zespołów faktycznie sięga, gdy nie chce płacić tyle, ile kosztuje Sol. Porównywanie z klasą, którą klient w przeciwnym razie by kupił, jest uczciwsze niż porównywanie z najdroższym dostępnym modelem.
Trudność polega na tym, że to samo zdanie zawiera też twierdzenie, że wydajność jest „o krok od modeli elitarnych”. Te dwie połowy przekazu ciągną w przeciwne strony. Jeśli Fugu Max jest zamiennikiem dla Terra, to kreowanie go na model elitarny wykonuje pracę marketingową, której nie da się obronić, ponieważ Terra nie jest wprost pozycjonowana jako elitarna — jest pozycjonowana jako poziom „wystarczająco dobry”. Jeśli Fugu Max naprawdę jest o krok od Sol, to porównanie cen należało przeprowadzić względem Sol, gdzie różnica jest największa i najkorzystniej się prezentuje. Komunikat, który w tym samym akapicie zawiera agresywne twierdzenie o możliwościach i zachowawcze porównanie cen, chce mieć ciastko i zjeść ciastko, a czytelnik nie ma sposobu, by stwierdzić, która połowa jest nośna.

Sześć benchmarków, żadnych liczb i jedna nazwa, która powinna nasunąć pytanie
Połowa prezentacji dotycząca możliwości opiera się na liście. Fugu Max „osiąga najlepszy wynik ogólny” w Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench i SWEFish. Dla żadnego z nich nie podano wyników. SWEFish to własny wewnętrzny benchmark programistyczny firmy Sakana, co oznacza, że jedno z sześciu zwycięstw zostało ocenione na podstawie testu, który napisał dostawca i którego nie udostępnił.
GPT-5.6 Sol podaje dane liczbowe. W danych porównawczych stron trzecich Sol widnieje z wynikiem 91,9% w Terminal-Bench 2.0 i 64,6% w SWE-bench Pro. Warto zwrócić uwagę na niezgodność wersji w przypadku benchmarku terminalowego: opublikowany wynik Sol dotyczy Terminal-Bench 2.0, a Sakana twierdzi, że wygrywa w 2.1, co jest inną ewaluacją i nie można jej zestawiać z tamtą. Warto to podkreślić, ponieważ oba twierdzenia wyglądają na sąsiadujące ze sobą w nagłówku, a w rzeczywistości nie są porównywalne.
Właściwym porównaniem dla tego starcia byłoby zestawienie Sol z modelem Fugu na wspólnej ewaluacji. Strony porównawcze firm trzecich rzeczywiście zawierają porównanie GPT-5.6 Sol z bazową generacją Sakana Fugu — Sol prowadzi w Terminal-Bench 2.0, osiągając 91,9% wobec 80,2%, oraz w SWE-bench Pro, osiągając 64,6% wobec 59% — ale to są wyniki dla wcześniejszej generacji, a nie Fugu Max, a te same źródła wyraźnie wstrzymują się od wskazania ogólnego zwycięzcy, ponieważ pokrycie wspólnymi benchmarkami jest zbyt wąskie. Nie istnieje żadne opublikowane porównanie Fugu Max z GPT-5.6 Sol. Każdy, kto twierdzi, że takie porównanie istnieje, dokonuje ekstrapolacji.
Żadna niezależna strona nie oceniła Fugu Max i nie istnieje żaden wpis w Artificial Analysis dotyczący jego ani żadnego modelu Fugu. Każda liczba w komunikacie, w tym sześć zwycięstw, pochodzi od dostawcy. Natomiast Sol jest ogólnie dostępny od 9 lipca 2026 r. i pojawia się w rankingach firm trzecich — poziom zewnętrznej weryfikacji, którego Fugu Max nie miał okazji doświadczyć.
Co tak naprawdę kupujesz po każdej ze stron
Konfigurowanie GPT-5.6 Sol to znana kwestia. Oferuje okno kontekstu 1 mln tokenów, limit wyjścia 128K, wejście tekstowe, obrazowe i plikowe, vision, korzystanie z narzędzi, tryb JSON i rozumowanie jako udokumentowane możliwości oraz dwa punkty końcowe — chat completions i responses API — dzięki czemu istniejąca integracja ma dokąd przejść. Wykazuje p50 czasu do pierwszego tokenu na poziomie 6,68 sekundy w obsługiwanym przez nas ruchu, co jest wolniejsze niż najszybsze modele w naszym katalogu i warto o tym wiedzieć, zanim zbudujesz na nim interaktywny produkt.
Konfigurowanie Fugu Max jest bliższe kupowaniu poziomu usługi niż modelu. Otrzymujesz jeden endpoint zgodny z OpenAI, zmianę jednego parametru w jednym wierszu, aby przejść na niego z wcześniejszego Fugu, oraz koordynatora, który decyduje, które modele wywołać. To, czego nie otrzymujesz ze strony wydania, to okno kontekstu, limit wyjściowy, lista modalności, wartość opóźnienia ani wynik benchmarku. Decyzje koordynatora dotyczące routingu nie są ujawniane z założenia. W tym wydaniu pula została rozszerzona o modele o otwartych wagach i modele specjalistyczne, przy czym rodzina NVIDIA Nemotron została wymieniona w ramach współpracy z NVIDIA, a poza tym pozostaje nieujawniona.
Deklarowane przez Sakana uzasadnienie tej nieprzejrzystości jest do obrony — niezależna od dostawcy pula, którą można wymieniać, to ochrona przed wycofywaniem, zmianami cen i wycofywaniem regionalnym. To prawdziwe zabezpieczenie, a stawka 0,25 USD za buforowane dane wejściowe sugeruje, że Sakana oczekuje obciążeń z długim kontekstem i dużą powtarzalnością, w których to zabezpieczenie miałoby największe znaczenie. Oznacza to jednak, że specyfikacja, którą kupujesz, jest obietnicą dotyczącą łańcucha dostaw, a nie opisem produktu.

Jak uruchomić test
Właściwym sposobem rozstrzygnięcia tego nie jest czytanie strony żadnego z dostawców. Weź próbkę własnego ruchu — kilkaset rzeczywistych żądań, najlepiej wraz z tymi, które twój zespół obecnie eskaluje — i przepuść je przez oba endpointy z włączonym rozliczaniem tokenów. Rozliczaj koszt w tokenach na ukończone zadanie, a nie w tokenach na wywołanie, ustaw budżet wyjściowy przed rozpoczęciem, żeby fan-out nie zaskoczył cię, a jakość mierz po tym, czy druga osoba zgodzi się, że odpowiedź była akceptowalna. Ten eksperyment odpowie na to pytanie w tydzień i niewiele kosztuje.
Problem w tym, że Fugu Max nie znajduje się w OrcaRouter. Dociera do Ciebie przez własne, zgodne z OpenAI API Sakany oraz kilka platform zewnętrznych, co oznacza drugą integrację, drugi zestaw poświadczeń i drugą fakturę. GPT-5.6 Sol jest w naszym katalogu w cenie katalogowej OpenAI z 0% marży — stawka dostawcy jest przekazywana bez narzutu, więc zmiana cennika OpenAI obowiązuje na Twoim istniejącym kluczu tego samego dnia, z automatycznym przełączaniem awaryjnym między ścieżkami dostawcy, gdy jedna z nich ma limit szybkości lub jest niedostępna. Działa za tym samym kluczem co ponad 200 innych modeli, więc gdy pilotaż się zakończy, zachowujesz integrację i zmieniasz jeden ciąg znaków.
Sedno sprawy
GPT-5.6 Sol wygrywa porównanie, którego Sakana odmówiła przeprowadzić. Kosztuje dwa razy więcej za wejście i ponad trzy razy więcej za wyjście, a w zamian otrzymujesz opublikowane okno kontekstowe, limit wyjścia 128K, udokumentowane wejście multimodalne, nazwane znaczniki możliwości, dwa punkty końcowe oraz benchmarki dostawcy, które strony trzecie miały miesiące na zbadanie. Jeśli twoja praca jest tego rodzaju, dla którego powstał Sol — głębokie wieloetapowe rozumowanie, inżynieria oprogramowania na dużą skalę, długoterminowe zadania agentowe — różnica w cenie jest kosztem kupienia czegoś, co możesz określić.
Fugu Max wygrywa w węższym i naprawdę interesującym zakładzie, a przy tym jest znacznie tańszy: o 50 procent tańszy pod względem outputu od GPT-5.6 Terra, o 70 procent od Sol, z najniższą stawką za pamięć podręczną w obu cennikach. Jeśli Twój ruch jest masowy, wyłącznie tekstowy, sprawdzalny i w większości nie wymaga rozumowania klasy flagowej, orkiestrator, który kieruje do najoszczędniejszego wystarczającego modelu, jest spójnym projektem, a stawka 6,00 USD za output jest tym, gdzie tkwi wartość. Przyjmij własną narrację wydania za dobrą monetę i przetestuj je w pilotażu jako substytut Terra, a nie Sol — a jeśli chcesz flagowca z ceną katalogową dostawcy przekazaną bez zmian, GPT-5.6 Sol jest dostępny za jednym kluczem na OrcaRouter.

Porównane w tym artykule1
Wykryto na podstawie tego artykułu · Benchmarki: Artificial Analysis · aktualizowane codziennie
