Kartu judul hero untuk "Fugu Max vs Claude Opus 5" dengan subjudul "Empat kali lebih murah, dan angka yang belum pernah dipublikasikan", tiga lencana berbentuk pil bertuliskan $6.00 vs $25.00 output", "Enam kemenangan, nol skor", "$2.00 vs $5.00 input, baris footer bertuliskan "Sakana AI vs Anthropic - September 2026", dan logo OrcaRouter di sudut kanan bawah.
Guides & Insights

Fugu Max vs Claude Opus 5: empat kali lebih murah, dan angka yang tidak pernah dipublikasikan siapa pun

Penulis

Rowan Sterling

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Fugu Max membutuhkan biaya $6,00 untuk menghasilkan satu juta token output. Claude Opus 5 membutuhkan biaya $25,00. Sakana AI merilis Fugu Max pada 11 September 2026 sebagai koordinator yang mengarahkan setiap tugas ke model paling hemat di kumpulannya, dan menetapkan harganya cukup agresif sehingga selisih output empat kali lipat dibandingkan produk unggulan Anthropic menjadi fakta utama dari rilis tersebut. Yang tidak ada dalam rilis itu adalah satu pun angka yang menggambarkan seberapa baik Fugu Max sebenarnya berperforma. Sakana mengatakan model ini meraih "skor keseluruhan terbaik" pada enam tolok ukur dan memperluas frontier biaya-kinerja pada tujuh dari sepuluh — pernyataan tentang posisi pada grafik, bukan nilai pada sumbu. Claude Opus 5, sebaliknya, hadir dengan skor yang dipublikasikan untuk hampir semua yang dilakukannya. Jadi versi jujur dari perbandingan ini bukan murah-versus-mahal. Ini soal yang terukur versus yang diklaim, dan selisih harga itulah yang membuat pertukaran itu layak diperdebatkan.

Kesenjangan itu, dan perbandingan yang Sakana pilih untuk tidak dilakukan

Halaman rilis Sakana membenarkan tarif output Fugu Max dengan membandingkannya dengan model lain. Tiga yang disebutkannya adalah Claude Sonnet 5, GPT-5.6 Terra, dan Kimi K3, dan klaimnya adalah bahwa harga output Fugu Max berada 40 hingga 60 persen di bawah mereka. Perhatikan siapa yang tidak disebut. Claude Opus 5 tidak ada dalam daftar itu, dan alasannya adalah aritmetika: pada $6,00 versus $25,00, Fugu Max bukan 40 persen lebih murah daripada Opus 5, melainkan 76 persen lebih murah. Menyebut Opus 5 akan membuat klaim itu tampak tidak masuk akal alih-alih kompetitif, jadi perbandingannya dibuat terhadap tingkat di bawah model unggulan.

Itu bukan kritik terhadap harga, yang memang benar-benar rendah. Itu catatan tentang apa yang sedang dilakukan kalimat di sekitarnya. Kerangka Sakana sendiri — performa "dalam jarak yang mendekati model-model elit dengan biaya dua hingga enam kali lebih rendah" — dikalibrasi terhadap model-model yang dipilihnya untuk disebutkan. Dibandingkan Claude Opus 5, kelipatannya bukan dua hingga enam, melainkan lebih dari empat pada output; apakah Opus 5 masih merupakan "model elit" menurut tolok ukur kalimat itu dibiarkan tidak dinyatakan, sebuah kelalaian yang mengherankan dalam sebuah rilis yang seluruh daya tariknya adalah efisiensi biaya-performa di garda terdepan.

• Harga input — Fugu Max $2.00 per 1 juta token vs Claude Opus 5 $5.00 per 1 juta token

• Harga output — Fugu Max $6.00 per 1 juta token vs Claude Opus 5 $25.00 per 1 juta token

• Input yang di-cache — Fugu Max $0.25 per 1 juta token vs caching Claude Opus 5 yang dihargai sebagai diskon hingga 90% untuk input yang di-cache

• Skor benchmark — Fugu Max tidak mempublikasikan apa pun, enam kemenangan benchmark diklaim tanpa angka, dibandingkan Claude Opus 5 yang menurut laporan Anthropic mencapai 96,0% SWE-bench Verified, 79,2% SWE-bench Pro, sekitar 30,2% pada ARC-AGI 3

• Arsitektur — Fugu Max koordinator terlatih atas kumpulan yang tidak diungkapkan vs Claude Opus 5 model tunggal yang dapat dipatok berdasarkan versi

• Konteks — Fugu Max belum dipublikasikan vs Claude Opus 5 1 juta token, dengan batas keluaran 128K

• Evaluasi independen — Tidak ada Fugu Max untuk model Fugu mana pun vs Claude Opus dengan 5 bulan penempatan di papan peringkat pihak ketiga

Enam kemenangan tanpa skor yang menyertainya

Enam tolok ukur tersebut adalah Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench, dan SWEFish. Lima di antaranya merupakan evaluasi publik yang dikenal. Yang keenam, SWEFish, adalah tolok ukur pengkodean milik Sakana sendiri, yang berarti salah satu dari enam kemenangan dinilai dengan tes yang ditulis vendor dan belum dipublikasikan.

Untuk lima lainnya, rilis tersebut menyatakan bahwa Fugu Max mencapai skor keseluruhan terbaik tanpa menyebutkan berapa skor itu, atau berapa skor yang diperoleh pesaing mana pun. Itu adalah bentuk yang tidak biasa untuk pengumuman sebuah model. Vendor rutin melebih-lebihkan, tetapi mereka biasanya melebih-lebihkan dengan angka, karena angka adalah hal yang menyebar. Rilis yang mengklaim enam kemenangan dan tidak mencetak satu pun dari kemenangan itu berarti meminta dipercaya hanya berdasarkan kekuatan klaimnya semata.

Ada pembacaan yang berbaik hati dan itu layak dinyatakan dengan gamblang. Fugu Max adalah koordinator yang dioptimalkan untuk biaya, bukan dorongan kemampuan — Sakana merilisnya pada hari yang sama dengan Fugu Ultra v2, yaitu versi yang ditujukan untuk kemampuan maksimal pada input $5.00 dan output $30.00. Tugas Max adalah mencapai kualitas yang dapat diterima pada output $6.00, dan skor utama seorang orkestrator kurang bermakna dibandingkan skor per dolar, yang persis ditunjukkan oleh plot Pareto. Komunikasi visual Sakana untuk rilis ini adalah plot Pareto. Jika argumennya adalah "lihat kurvanya, bukan puncaknya," maka angka benchmark mentah tidak relevan.

Tafsir yang tidak simpatik adalah bahwa sebuah angka akan mengundang perbandingan yang sebenarnya tidak ingin dihadapi vendor. Kedua tafsir itu konsisten dengan bukti, dan tidak ada apa pun dalam catatan publik saat ini yang membedakan keduanya. Yang bisa dikatakan adalah bahwa tidak ada pihak independen yang mengevaluasi model Fugu mana pun, dan tidak ada entri Artificial Analysis untuk Fugu Max atau model-model saudaranya. Setiap angka dalam rilis tersebut, termasuk enam kemenangan, berasal dari Sakana.

A two-column scoreboard titled "Fugu Max vs Claude Opus 5 - the scoreboard". Left column Fugu Max: Output price $6.00 / 1M, Input price $2.00 / 1M, Cached input $0.25 / 1M, Benchmarks six wins with no figures, Context not published, Evidence vendor-reported only. Right column Claude Opus 5: Output price $25.00 / 1M, Input price $5.00 / 1M, Cached input up to 90% discount, Benchmarks 96.0% SWE-bench Verified, Context 1M with a 128K output ceiling, Evidence independent evals. Footer reading "Fugu Max figures vendor-reported by Sakana AI; Opus 5 rows Anthropic-reported. No independent Fugu Max evaluation exists.", with the OrcaRouter logo bottom-right.

Pembelian yang sebenarnya Anda lakukan

Saat vendor model tunggal menerbitkan tolok ukur, yang Anda beli adalah klaim tentang sebuah model. Saat orkestrator menerbitkannya, yang Anda beli adalah klaim tentang kumpulan — model yang tidak dilatih oleh vendor, yang berjalan di bawah koordinator yang keputusan peruteannya sengaja tidak diungkapkan. Kumpulan di sini digambarkan sebagai yang terbesar yang pernah digunakan Fugu, diperluas dengan model berbobot terbuka dan terspesialisasi termasuk keluarga NVIDIA Nemotron melalui kolaborasi dengan NVIDIA. Anggota-anggotanya selebihnya tidak diungkapkan.

Konsekuensi praktisnya adalah perilaku Fugu Max dapat berubah tanpa versinya berubah. Penghentian dukungan dari lab terdepan, perubahan harga, atau ditariknya sebuah model dari suatu wilayah mengubah apa yang dapat dipanggil oleh koordinator, dan Sakana secara eksplisit menyatakan bahwa ketahanan inilah intinya — perusahaan ini menjual perlindungan terhadap keterikatan pada vendor dan pencabutan API. Itu adalah manfaat nyata dan tidak gratis. Itu juga alasan mengapa benchmark Fugu Max, jika dipublikasikan, akan membawa tanggal kedaluwarsa yang tidak dimiliki benchmark Claude Opus 5.

Proposisi nilai Claude Opus 5 adalah kebalikannya dan lebih mudah diberi harga. Ini adalah satu model pada satu versi, yang menjalankan pemikiran adaptif secara default dengan dial upaya eksplisit dari rendah hingga maks, membawa jendela konteks 1M token dan batas keluaran 128K, dengan visi, penggunaan alat, dan mode JSON. Anthropic melaporkan 96,0% pada SWE-bench Verified dan 79,2% pada SWE-bench Pro, dan angka-angka itu diukur pada hal yang Anda dapatkan saat memanggil endpoint — bukan pada ansambel yang komposisinya bisa berubah di bawah Anda. Untuk beban kerja yang berjalan di produksi dan ditinjau, stabilitas itu adalah fitur yang Anda bayar $19,00 per juta token keluaran untuk memilikinya.

Biaya per tugas yang diselesaikan, bukan per token

Tarif output Fugu Max sebesar $6.00 benar-benar menarik, dan cara mengujinya adalah berhenti membandingkan harga token. Sebuah orkestrator memunculkan agen; masing-masing menulis token penalaran dan output; koordinator menulis sintesis. FAQ harga Sakana untuk lini Fugu menetapkan tarif campuran tunggal berdasarkan model peserta tingkat teratas, dengan eksekusi multi-agen yang tidak menumpuk tagihan — yang menghilangkan perkalian fan-out skenario terburuk yang membuat sistem multi-agen naif menjadi tidak terjangkau. Hal itu tidak menghilangkan volumenya. Jumlah token output yang ditagihkan kepada Anda adalah fungsi dari berapa banyak agen yang berjalan, dan pada $6.00 per juta, volume itulah variabel yang tidak dapat diberitahukan oleh halaman harga kepada Anda.

Bentuk biaya Claude Opus 5 adalah satu panggilan, satu model, tombol upaya yang Anda kendalikan, dan pemrosesan batch dengan tarif setengah untuk pekerjaan yang bisa menunggu. Anda dapat memperkirakannya sebelum menjalankannya. Di lebih dari sepuluh ribu eksekusi, kemampuan memperkirakan jauh lebih bernilai daripada selisih benchmark yang belum dipublikasikan oleh siapa pun.

Di sinilah pertanyaan routing terpisah dari pertanyaan model. Claude Opus 5 tersedia di OrcaRouter dengan harga daftar Anth​ropic dan markup 0% — tarif penyedia diteruskan apa adanya, sehingga perubahan pada harga Anth​ropic langsung berlaku pada kunci yang sama di hari yang sama, dengan failover otomatis di antara jalur penyedia saat salah satunya dibatasi lajunya atau tidak tersedia. Fugu Max tidak ada di katalog kami; ia sampai kepada Anda melalui API milik Sakana sendiri yang kompatibel dengan OpenAI dan beberapa platform pihak ketiga, dan beralih ke sana dari Fugu versi sebelumnya cukup dengan mengubah satu parameter. Jika Anda menginginkan basis bukti Opus 5 dan tagihan yang bisa diprediksi, router adalah jalur yang lebih singkat. Jika Anda menginginkan sistem yang menyusun fan-out-nya sendiri untuk masalah-masalah sulit, Fugu Max adalah hal yang melakukannya — dan Anda sebaiknya melakukan uji coba dengan penghitungan token diaktifkan sejak permintaan pertama.

A screenshot of the Sakana AI release page at sakana.ai/fugu-max-release (captured September 11, 2026, English UI), showing the sakana.ai wordmark, the headline 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier' dated September 11, 2026, the opening copy arguing that the frontier which matters is two-dimensional with capability on one axis and cost on the other, a 'Try Sakana Fugu Max and Fugu Ultra v2' link, and a Pareto chart plotting performance against cost with a red 'Fugu Max' point at the low-cost end, a red 'Fugu Ultra' point at the top, a shaded 'Frontier formed by Fugu models' region and grey points labelled 'Frontier formed by single models'.

Di mana Fugu Max mungkin adalah jawaban yang tepat

Akui keunggulan desainnya. Jika pekerjaan Anda bervolume tinggi, dapat diperiksa, dan Anda peduli pada biaya median tugas yang diselesaikan alih-alih kemampuan puncak dari satu panggilan mana pun, orkestrator yang memilih model termurah yang memadai untuk setiap permintaan melakukan sesuatu yang tidak dapat dilakukan oleh model unggulan tetap. Fugu Max ditujukan tepat untuk beban kerja itu, dan tarif input $2.00 dengan input cache $0.25 dipatok untuk konteks panjang dan berulang yang dihasilkan oleh beban kerja tersebut. Kolaborasi NVIDIA juga lebih penting daripada yang terlihat: model Nemotron berbobot terbuka, yang berarti tingkat termurah dalam kumpulan model tidak terpapar pada keputusan penetapan harga lab lain.

Apa yang tidak diberikannya kepada Anda adalah alasan untuk percaya bahwa Fugu Max akan menyamai Claude Opus 5 pada tugas-tugas di mana angka-angka yang dipublikasikan Opus 5 paling kuat — rekayasa perangkat lunak berskala repositori dan penalaran yang sulit. Itulah tepatnya baris-baris di mana papan enam tolok ukur Sakana tidak menyediakan angka sama sekali. Jika masalah Anda adalah masalah di mana menjadi yang terbaik lebih penting daripada menjadi murah, tarif output $25.00 membeli hal yang sebenarnya Anda butuhkan.

Intinya

Claude Opus 5 adalah pembelian yang lebih didukung bukti dan default produksi yang lebih aman: benchmark vendor yang dipublikasikan, versi yang dapat Anda patok, jendela konteks yang tidak bergeser, batas keluaran 128K, pengatur effort yang memungkinkan Anda membeli penalaran hanya saat menguntungkan, dan hasil pihak ketiga selama berbulan-bulan di belakangnya. Fugu Max adalah taruhan yang lebih menarik dan benar-benar lebih murah — sekitar 60 persen lebih murah untuk input dan 76 persen lebih murah untuk output, dengan tarif cache satu orde besaran di bawah harga input dasar Opus 5.

Jika Anda menjalankan pekerjaan yang dapat diverifikasi, berulang, dan bervolume tinggi dan Anda berada di luar UE/EEA, Fugu Max layak mendapatkan pilot dengan cakupan yang jelas dengan batas token keluaran yang ditetapkan sebelum Anda memulai dan pengukuran token per tugas yang diselesaikan, bukan token per panggilan. Jika Anda membutuhkan keputusan produksi yang dapat Anda pertahankan kepada orang lain kuartal ini, Claude Opus 5 tetap menjadi jawabannya — dan tersedia di OrcaRouter dengan harga daftar Anthropic dengan tarif penyedia yang diteruskan tanpa perubahan.

A screenshot of the OrcaRouter model page for Claude Opus 5 (anthropic/claude-opus-5, captured September 11, 2026, English UI), showing the Featured badge, the anthropic/claude-opus-5 model ID, the Vision, Tools, JSON and Reasoning tags, the listing date 2026-07-24, the /v1/chat/completions and /v1/messages endpoints, the pricing tiles reading INPUT $5.00 and OUTPUT $25.00 per 1M tokens with p50 TTFT 4.94s and 195.4M tokens of 7-day traffic, the 1M token context with 128K max output and text + image + file input, and the OpenAI-compatible Python sample pointing at api.orcarouter.ai/v1.