
Fugu Max vs GPT-5.6 Sol: klaim harga itu ditujukan pada segmen menengah dari keluarga produk
- deepseekBARUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- openaiBARUOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- googleBARUGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- qwenBARUQwen: Qwen3.8 Max (0902)2026-09-0240Kecerdasan72Koding
- anthropicBARUAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 per 1 juta token
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0540Kecerdasan72Koding
- qwenQwen: Qwen3.8 Max2026-08-0340Kecerdasan72Koding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Kecerdasan69Koding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 juta token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Kecerdasan78Koding
- googleGoogle: Gemini 3.6 Flash2026-07-2134Kecerdasan69Koding
Fugu Max's price justification names a GPT-5.6 model, and it is not the flagship. Sakana AI released Fugu Max on September 11, 2026 at $2.00 per million input tokens and $6.00 per million output tokens, and stated that its output pricing runs 40 to 60 percent below Claude Sonnet 5, GPT-5.6 Terra and Kimi K3. GPT-5.6 Sol — the flagship of the same OpenAI family, listed at $4.00 input and $20.00 output per million — does not appear in that sentence. That omission is not an oversight; it is the arithmetic. Sol is more than three times Fugu Max's output rate, a gap that would have made the surrounding "within striking distance of elite models at two to six times lower cost" framing read as a different kind of claim entirely. So this matchup is worth running on Sol's terms rather than the vendor's chosen ones.
Memeriksa klaim tersebut terhadap keluarga yang dituju
Angka 40-hingga-60-persen Sakana dapat diuji, karena model yang disebutkannya memiliki tarif yang dipublikasikan. GPT-5.6 Terra mencantumkan tarif $2,00 untuk input dan $12,00 untuk output per juta token. Fugu Max mencantumkan tarif $2,00 untuk input dan $6,00 untuk output. Jalankan perbandingannya dan dua hal pun terungkap. Pada output, $6,00 dibandingkan $12,00 adalah potongan tepat 50 persen — tepat di tengah-tengah rentang 40-hingga-60 yang dinyatakan, yang merupakan tanda bahwa rentang itu dibuat mengelilingi perbandingan ini alih-alih ditemukan darinya. Pada input, kedua tarif itu identik hingga ke sen.
That is a well-constructed claim, and constructing it well is what a release page is for. But it is calibrated to the middle of the GPT-5.6 ladder. Terra is the balanced tier of a three-model family — Sol above it for hard complex work, Luna below it for speed and cost. Naming Terra sets the "elite model" benchmark at the middle rung and lets Fugu Max claim half its output price honestly. Naming Sol would have required a different sentence, because the honest version is that Fugu Max costs 70 percent less on output than Sol, and 50 percent less on input — a much larger gap that raises the obvious follow-up question of what capability you are giving up for it.
• Harga input — Fugu Max $2,00 per 1 juta token vs GPT-5.6 Sol $4,00 per 1 juta token
• Harga output — Fugu Max $6,00 per 1 juta token vs GPT-5.6 Sol $20,00 per 1 juta token
• Input yang di-cache — Fugu Max $0,25 per 1 juta token vs caching GPT-5.6 Sol yang diberi harga sebagai diskon atas tarif input dasar
• Konteks — Fugu Max belum dipublikasikan vs GPT-5.6 Sol 1 juta token
• Batas keluaran — Fugu Max tidak dipublikasikan vs GPT-5.6 Sol 128K token
• Modalitas input — Fugu Max belum dipublikasikan vs teks, gambar, dan file GPT-5.6 Sol
• Tag kemampuan — Fugu Max tidak ada yang dipublikasikan vs GPT-5.6 Sol visi, penggunaan alat, mode JSON, penalaran
• Endpoint — Fugu Max satu permukaan yang kompatibel dengan OpenAI vs chat completions GPT-5.6 Sol dan API responses
• Angka benchmark — Fugu Max enam kemenangan diklaim tanpa skor vs angka vendor yang dipublikasikan GPT-5.6 Sol termasuk Terminal-Bench 2.0 pada 91,9% dan SWE-bench Pro pada 64,6%
Mengapa anak tangga tengah adalah anak tangga yang tepat untuk dinamai
Ada versi yang dapat dipertahankan dari pilihan Sakana, dan hal itu layak dikemukakan sebelum kritik. Orkestrator yang merutekan setiap tugas ke model paling ramping yang mampu bukanlah bersaing dengan model unggulan dalam pekerjaan kelas unggulan. Ia bersaing dengan model kelas menengah dalam pekerjaan kelas menengah, dan menawarkan untuk melakukan sebagian darinya dengan lebih murah. Jika tawarannya adalah "sebagian besar trafik Anda tidak membutuhkan Sol," maka Terra adalah pembanding yang tepat, karena Terra-lah yang sebenarnya dijangkau sebagian besar tim ketika mereka tidak ingin membayar harga Sol. Mengukur terhadap tingkatan yang seharusnya dibeli pelanggan Anda lebih jujur daripada mengukur terhadap model termahal yang tersedia.
Kesulitannya adalah kalimat yang sama juga mengklaim performa "nyaris menyamai model-model elit." Dua bagian dari pitch itu menarik ke arah yang berlawanan. Jika Fugu Max adalah pengganti Terra, maka pembingkaian model elit itu melakukan kerja pemasaran yang tidak dapat didukungnya, karena Terra secara eksplisit tidak diposisikan sebagai elit — ia diposisikan sebagai tingkat yang cukup memadai. Jika Fugu Max benar-benar nyaris menyamai Sol, maka perbandingan harga seharusnya dilakukan terhadap Sol, karena di sanalah selisihnya paling besar dan paling menguntungkan. Rilis yang membuat klaim kemampuan agresif dan perbandingan harga konservatif dalam paragraf yang sama sedang mencoba mendapatkan dua keuntungan sekaligus, dan pembaca tidak punya cara untuk mengetahui bagian mana yang menanggung beban.

Enam tolok ukur, tanpa angka, dan satu nama yang seharusnya menimbulkan pertanyaan
Separuh kapabilitas dari pitch ini bertumpu pada sebuah daftar. Fugu Max "mencapai skor keseluruhan terbaik" pada Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench, dan SWEFish. Tidak ada skor yang dicetak untuk satu pun dari semuanya. SWEFish adalah benchmark coding internal milik Sakana sendiri, yang berarti salah satu dari enam kemenangan itu dinilai pada tes yang ditulis vendor dan belum dirilis.
GPT-5.6 Sol melaporkan angka. Sol terdaftar pada 91,9% di Terminal-Bench 2.0 dan 64,6% di SWE-bench Pro dalam data perbandingan pihak ketiga. Perhatikan ketidaksesuaian versi pada benchmark terminal: angka yang dipublikasikan Sol adalah untuk Terminal-Bench 2.0 dan Sakana mengklaim kemenangan pada 2.1, yang merupakan evaluasi berbeda dan tidak dapat dibandingkan dengannya. Hal itu patut ditandai karena kedua klaim tersebut terlihat berdampingan dalam sebuah judul dan sebenarnya tidak sebanding.
Perbandingan yang relevan untuk adu ini adalah Sol melawan model Fugu dalam evaluasi yang sama. Halaman perbandingan pihak ketiga memang memuat GPT-5.6 Sol versus generasi dasar Sakana Fugu — Sol unggul pada Terminal-Bench 2.0 dengan 91,9% berbanding 80,2% dan pada SWE-bench Pro dengan 64,6% berbanding 59% — tetapi itu adalah angka untuk generasi yang lebih awal, bukan Fugu Max, dan sumber yang sama secara eksplisit menolak menyebut pemenang keseluruhan karena cakupan benchmark bersama terlalu tipis. Tidak ada perbandingan yang dipublikasikan dalam bentuk apa pun antara Fugu Max dan GPT-5.6 Sol. Siapa pun yang menyatakan ada sedang melakukan ekstrapolasi.
Tidak ada pihak independen yang mengevaluasi Fugu Max, dan tidak ada entri Artificial Analysis untuknya atau untuk model Fugu mana pun. Setiap angka dalam rilis, termasuk enam kemenangan, berasal dari vendor. Sebaliknya, Sol telah tersedia secara umum sejak 9 Juli 2026 dan muncul di papan peringkat pihak ketiga — tingkat pengawasan eksternal yang belum berkesempatan diterima Fugu Max.
Apa yang sebenarnya Anda beli di masing-masing sisi
Mengonfigurasi GPT-5.6 Sol adalah hal yang sudah dikenal. Model ini membawa jendela konteks 1M token, batas keluaran 128K, input teks, gambar, dan file, visi, penggunaan alat, mode JSON, dan penalaran sebagai kemampuan yang didokumentasikan, serta dua endpoint — chat completions dan API responses — sehingga integrasi yang sudah ada dapat diarahkan ke sana. Model ini menunjukkan p50 time-to-first-token 6,68 detik di seluruh lalu lintas yang kami layani, yang lebih lambat daripada model tercepat di katalog kami dan perlu diketahui sebelum Anda membangun produk interaktif di atasnya.
Mengonfigurasi Fugu Max lebih mirip membeli tingkat layanan daripada model. Anda mendapatkan satu endpoint yang kompatibel dengan OpenAI, perubahan parameter satu baris untuk beralih ke sana dari Fugu versi sebelumnya, dan koordinator yang memutuskan model mana yang akan dipanggil. Yang tidak Anda dapatkan, dari halaman rilis, adalah jendela konteks, batas keluaran, daftar modalitas, angka latensi, atau skor benchmark. Keputusan perutean koordinator memang sengaja tidak diungkapkan. Kumpulan model ini diperluas pada rilis ini untuk mencakup model dengan bobot terbuka dan model terspesialisasi, dengan keluarga NVIDIA Nemotron yang disebutkan melalui kolaborasi dengan NVIDIA, dan selebihnya tidak diungkapkan.
Alasan yang dinyatakan Sakana untuk ketidakjelasan itu dapat dipertahankan — kumpulan yang agnostik terhadap vendor dan dapat ditukar merupakan perlindungan terhadap penghentian dukungan, perubahan harga, dan penarikan regional. Ini adalah lindung nilai yang nyata, dan tarif input yang di-cache sebesar $0.25 menunjukkan bahwa Sakana mengharapkan beban kerja konteks panjang dengan repetisi tinggi yang paling membutuhkan lindung nilai tersebut. Namun, ini berarti spesifikasi yang Anda beli adalah janji tentang rantai pasok, bukan deskripsi produk.

Cara menjalankan tes
Cara yang tepat untuk menyelesaikan ini bukan dengan membaca halaman salah satu vendor. Ambil sampel dari lalu lintas Anda sendiri — beberapa ratus permintaan nyata, idealnya termasuk yang saat ini dieskalasi oleh tim Anda — dan jalankan terhadap kedua endpoint dengan penghitungan token aktif. Hitung biayanya berdasarkan token per tugas yang diselesaikan, bukan token per panggilan, tetapkan anggaran output sebelum Anda memulai agar fan-out tidak mengejutkan Anda, dan ukur kualitas berdasarkan apakah orang kedua setuju bahwa jawabannya dapat diterima. Eksperimen itu menjawab pertanyaan dalam seminggu dan biayanya sedikit.
The friction is that Fugu Max is not on OrcaRouter. It reaches you through Sakana's own OpenAI-compatible API and several third-party platforms, which means a second integration, a second credential set and a second invoice. GPT-5.6 Sol is on our catalogue at OpenAI's list price with 0% markup — the provider's rate passed through rather than marked up, so a change to OpenAI's pricing is live on your existing key the same day, with automatic failover across provider paths when one is rate-limited or unavailable. It sits behind the same key as more than 200 other models, so when the pilot ends you keep the integration and change one string.
Intinya
GPT-5.6 Sol memenangkan perbandingan yang menolak dibuat oleh Sakana. Biayanya dua kali lipat untuk input dan lebih dari tiga kali lipat untuk output, dan sebagai gantinya Anda mendapatkan jendela konteks yang dipublikasikan, batas output 128K, input multimodal yang terdokumentasi, tag kemampuan yang diberi nama, dua endpoint, serta tolok ukur vendor yang sudah bisa diperiksa pihak ketiga selama berbulan-bulan. Jika pekerjaan Anda adalah jenis yang menjadi alasan Sol dibangun — penalaran multi-langkah yang mendalam, rekayasa perangkat lunak skala besar, tugas agentic berjangka panjang — selisih harganya adalah biaya membeli sesuatu yang bisa Anda spesifikasikan.
Fugu Max memenangkan taruhan yang lebih sempit dan benar-benar menarik, dan ia adalah yang lebih murah dengan selisih yang lebar: 50 persen lebih rendah daripada GPT-5.6 Terra untuk output, 70 persen lebih rendah daripada Sol, dengan tarif cache terendah di kedua daftar harga. Jika trafik Anda bervolume tinggi, hanya teks, dapat diperiksa, dan sebagian besar tidak membutuhkan penalaran kelas unggulan, orkestrator yang merutekan ke model paling ramping yang memadai adalah desain yang koheren, dan tarif output $6,00 adalah tempat nilainya berada. Terima pembingkaian rilis itu sendiri apa adanya dan uji cobalah sebagai pengganti Terra, bukan Sol — dan jika Anda menginginkan model unggulan dengan harga daftar penyedia diteruskan tanpa diubah, GPT-5.6 Sol hanya berjarak satu kunci di OrcaRouter.

Dibandingkan dalam artikel ini1
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
