Kartu judul hero bertuliskan 'Fugu Max vs Grok 4.6' dengan subjudul 'Kartu tarif identik, satu skor yang dipublikasikan', tiga lencana pil bertuliskan '$2.00 vs $2.00 input', '$6.00 vs $6.00 output', dan 'Enam kemenangan, nol angka', baris footer bertuliskan 'Sakana AI, September 2026 vs SpaceXAI, Agustus 2026', serta logo OrcaRouter di sudut kanan bawah.
Guides & Insights

Fugu Max vs Grok 4.6: Kartu Tarif Identik, Satu Skor yang Dipublikasikan

Penulis

Rowan Sterling

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Fugu Max dan Grok 4.6 berbiaya persis sama. Sakana AI merilis Fugu Max pada 11 September 2026, dengan harga $2,00 per juta token input dan $6,00 per juta token output — dan itu persis sama dengan daftar tarif yang dikenakan SpaceXAI untuk Grok 4.6 sejak diluncurkan pada 12 Agustus. Kebetulan ini adalah fakta paling berguna dalam pertarungan ini, karena menghapus harga dari perdebatan. Ketika dua produk menagih dengan tarif identik, satu-satunya pertanyaan yang tersisa adalah apa yang Anda dapatkan atas uang itu, dan di situlah keduanya benar-benar berbeda. Grok 4.6 adalah model tunggal yang dapat Anda patok berdasarkan versinya, dibaca tabel benchmark-nya, dan diperiksa terhadap indeks independen. Fugu Max adalah koordinator terlatih yang mengirim setiap tugas ke model termurah di kumpulannya, dan pengumuman Sakana mengklaimnya meraih skor keseluruhan terbaik pada enam benchmark tanpa mencantumkan satu angka pun dari salah satunya. Salah satu dari pembelian ini bisa diukur sebelum Anda melakukannya. Yang lain tidak.

Dua produk, satu kartu tarif

• Masukan — Fugu Max $2,00 per 1 juta token vs Grok 4.6 $2,00 per 1 juta token

• Keluaran — Fugu Max $6,00 per 1 juta token vs Grok 4.6 $6,00 per 1 juta token

• Input yang di-cache — Fugu Max $0.25 per 1 juta token vs Grok 4.6 $0.50 per 1 juta token, satu-satunya baris di mana kedua harga itu berbeda sama sekali

• Jendela konteks — Fugu Max tidak dipublikasikan oleh vendor vs Grok 4.6 500.000 token, tidak berubah dari Grok 4.5

• Penetapan harga ulang untuk prompt panjang — Fugu Max tidak menyebutkan tier apa pun dalam rilisnya, sedangkan Grok 4.6 berlipat ganda menjadi $4,00 / $12,00 begitu satu permintaan melewati 200.000 token, dan dikenakan pada keseluruhan permintaan, bukan hanya pada kelebihannya

• Kendali penalaran — Fugu Max tidak diekspos vs Grok 4.6 empat tingkat upaya, low hingga xhigh, default ke high dan tidak dapat dimatikan

• Arsitektur — Fugu Max adalah koordinator terlatih atas kumpulan yang tidak diungkapkan yang mencakup model open-weight dan model terspesialisasi, diperluas untuk Max dengan keluarga NVIDIA Nemotron melalui kolaborasi dengan NVIDIA vs Grok 4.6 satu model pada satu versi

• Evaluasi independen — Fugu Max tidak ada yang dipublikasikan, dan tidak ada halaman Artificial Analysis untuk model Fugu mana pun dibandingkan Grok 4.6 yang memiliki Artificial Analysis Intelligence Index live sebesar 44, berada di peringkat #20 dari 200

Kolom murah adalah yang tidak dapat diprediksi

Lihat di mana Fugu Max sebenarnya menang soal harga: pembacaan cache, setengah dari Grok 4.6. Itu keunggulan nyata dan justru tempat yang salah untuk membangun model biaya, karena penetapan harga cache hanya terbayar sebanding dengan tingkat hit cache Anda — dan Sakana tidak menerbitkannya untuk Fugu Max. Rilis ini juga tidak menyatakan jendela konteks, tidak pula tingkat konteks panjang, maupun batas atas keluaran. Jadi satu-satunya kolom tempat Fugu Max menawarkan harga lebih rendah daripada Grok 4.6 adalah diskon yang besarnya tidak diketahui yang diterapkan pada porsi token Anda yang tidak diketahui.

Kelemahan Grok 4.6 setidaknya terlihat. Ambang batas 200.000 token-nya agresif — ia menetapkan ulang harga untuk seluruh permintaan, sehingga prompt 250.000 token ditagih dengan tarif dua kali lipat sejak token pertama, bukan token ke-200.001. Namun Anda dapat melihat jurangnya, mengukur prompt Anda terhadapnya, dan memutuskan apakah akan memecahnya menjadi potongan-potongan. Inilah perbedaan jenisnya di sini: satu sistem menerbitkan jadwal harga dengan bentuk yang dapat Anda rencanakan, dan yang lain menerbitkan tarif utama tanpa jadwal yang menyertainya.

Enam kemenangan dan tidak satu skor pun

Tolok ukur yang disebutkan Sakana adalah Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench, dan SWEFish. Lima di antaranya adalah evaluasi publik yang diakui. Yang keenam, SWEFish, adalah tolok ukur pengodean milik Sakana sendiri, yang berarti salah satu dari enam klaim kemenangan dinilai dengan tes yang ditulis vendor dan belum dirilis. Untuk lima lainnya, rilis tersebut menyatakan Fugu Max mencapai skor keseluruhan terbaik dan berhenti di situ — tidak ada skor, tidak ada selisih, tidak ada angka pesaing untuk disandingkan.

Bandingkan itu dengan tabel yang diterbitkan SpaceXAI untuk Grok 4.6, yang seluruhnya dilaporkan vendor tetapi setidaknya merupakan tabel: GDPVal-AA v2 pada 1.753, AA-Briefcase pada 1.577, DeepSWE v1.1 pada 65,9%, CursorBench v3.2 pada 69,9% dan GPQA Diamond pada 94,9%. Materi peluncurannya juga melaporkan sekitar 53 putaran dan sekitar setengah miliar token masukan untuk menyelesaikan tugas berhorizon panjang pada AA-Briefcase, dibandingkan dengan sekitar 103 putaran dan dua miliar token untuk model frontier pesaing — sebuah argumen, sekali lagi dilaporkan vendor, bahwa Grok murah per pekerjaan yang diselesaikan bahkan pada tarif per token yang moderat.

Dua dari angka Grok tersebut perlu ditangani sebelum Anda mengutipnya. Yang pertama adalah skor utama GPQA Diamond-nya sebesar 94,9% berasal dari tolok ukur yang sejak itu telah dipensiunkan oleh Artificial Analysis karena sudah jenuh, sehingga tolok ukur itu tidak lagi membedakan model-model terdepan seperti dulu. Yang kedua adalah angka yang akan Anda lihat dalam liputan yang lebih lama: Indeks Kecerdasan Artificial Analysis sebesar 61 untuk Grok 4.6. Itu adalah skala sebelum penyajian ulang. Artificial Analysis mengalibrasi ulang indeks tersebut pada September 2026, dan angka terkini adalah 44 pada peringkat #20 dari 200, dengan biaya $1,86 per tugas Intelligence Index. Siapa pun yang memeringkat Grok 4.6 terhadap Claude Fable 5 atau GPT-5.6 Sol berdasarkan angka 61 sedang membandingkan pembacaan dari dua instrumen yang berbeda.

A two-column scoreboard titled 'Fugu Max vs Grok 4.6 - the scoreboard' contrasting six dimensions. Fugu Max: output price $6.00 per 1M, input price $2.00 per 1M, cached input $0.25 per 1M, context not published, benchmarks six wins with no figures, evidence vendor-reported only. Grok 4.6: output price $6.00 per 1M, input price $2.00 per 1M, cached input $0.50 per 1M, context 500K with a 200K repricing cliff, benchmarks GDPVal 1,753 and DeepSWE 65.9%, evidence Artificial Analysis Index 44 ranked #20 of 200. Footer reads 'Fugu Max figures vendor-reported by Sakana AI; Grok 4.6 rows SpaceXAI-reported and per Artificial Analysis. No independent Fugu Max evaluation exists.' OrcaRouter logo bottom-right.

Apa yang tidak termasuk dalam harga token orchestrator

Liputan Sakana sendiri atas rilis ini mengakui masalah strukturalnya. Karena Fugu Max beralih di antara model dalam satu tugas, ia "dapat mengurangi penggunaan ulang cache konteks dan juga menghasilkan token orkestrasi tambahan" — dan perusahaan tidak mengungkapkan tingkat cache hit yang dihasilkan atau total biaya token per tugas. Setiap agen yang dihasilkan koordinator menulis teks penalaran dan keluaran, dan semuanya ditagih sebesar $6.00 per juta. Tarifnya identik dengan Grok 4.6. Volumenya tidak, dan volume adalah variabel yang tidak dapat ditunjukkan halaman harga kepada Anda.

Kedua vendor mendorong Anda ke arah koreksi yang sama — berhenti membandingkan tarif, mulailah membandingkan biaya per pekerjaan yang selesai — tetapi hanya salah satu dari mereka yang memberi Anda angka untuk memulai. Grok 4.6 hadir dengan profil turns-and-tokens yang dipublikasikan. Fugu Max hadir dengan instruksi untuk mengukurnya sendiri.

Ada pembacaan yang adil atas keheningan Fugu Max dan itu layak dikemukakan. Max adalah tier yang dioptimalkan biaya dari lini Fugu, dirilis pada hari yang sama dengan Fugu Ultra v2, yakni dorongan kemampuan pada $5,00 input dan $30,00 output. Argumen visual Sakana untuk Max adalah plot Pareto — kemampuan versus biaya — dan pada plot Pareto, skor benchmark mentah tidak relevan; skor per dolar adalah keseluruhan klaimnya. Jika itu argumennya, mencetak enam skor unggul tanpa biayanya justru akan menjadi grafik yang menyesatkan, bukan grafik yang hilang. Yang masih harus diberikan oleh rilis ini kepada pembeli adalah penyebut, dan rilis ini tidak menyediakannya.

Di mana Grok 4.6 benar-benar terekspos

Pekerjaan terminal adalah sisi terlemah yang dipublikasikan Grok 4.6. Skor Terminal-Bench v3.0-nya berada di 26%, jauh tertinggal dari yang terdepan di bidang ini. Hati-hati dengan angka di sebelahnya: model yang sama mencatat 88,4% pada Terminal-Bench v2.1, dan keduanya adalah ujian yang berbeda. Anda akan melihat keduanya dicampur dalam liputan, dan pencampuran itu sangat menyanjung Grok.

Eksposur kedua adalah bahwa penalaran tidak dapat dimatikan. Token berpikir ditagih pada setiap permintaan, sehingga biaya keluaran efektif Grok 4.6 bergantung pada seberapa keras model memutuskan untuk berpikir tentang prompt Anda. Pengatur upaya memberi Anda kendali pada tingkat rendah, tetapi tidak ada setelan nol.

Sebaliknya, Grok 4.6 memiliki sesuatu yang saat ini tidak dapat ditawarkan Fugu Max dengan harga berapa pun: sebuah angka. Setiap baris di atas dapat diperiksa oleh pihak ketiga, dan entri Artificial Analysis berarti salah satunya sudah diperiksa. Enam kemenangan Fugu Max diterbitkan pada hari yang sama dengan modelnya, oleh perusahaan yang membuatnya, dan hingga saat penulisan ini belum ada siapa pun di luar Sakana yang menjalankannya.

Memanggil yang satu, mengemudikan yang lain

Grok 4.6 tersedia di OrcaRouter dengan harga daftar SpaceXAI — $2,00 per juta input, $0,50 saat cache hit, $6,00 per juta output — diteruskan apa adanya dengan markup 0%, sehingga perubahan harga dari vendor sampai ke gateway kami pada hari yang sama, bukan menurut jadwal migrasi. Model ini kompatibel dengan OpenAI pada base URL yang sama dengan katalog lainnya, yang berarti Anda dapat menempatkannya dalam rantai failover atau di balik aturan perutean bersyarat alih-alih meng-hard-code penyedia ke dalam jalur produksi, dan Anda dapat menguji A/B terhadap model lain tanpa kontrak kedua. Model ini memproses 46,6 juta token melalui gateway dalam tujuh hari terakhir.

Fugu Max tidak ada di katalog kami. Ia tersedia bagi Anda melalui API milik Sakana sendiri yang kompatibel dengan OpenAI dan beberapa platform pihak ketiga, dan perusahaan mengatakan integrasi Fugu yang ada dapat di-upgrade ke sana hanya dengan mengubah satu parameter. Karena keduanya menggunakan format permintaan yang sama, evaluasi yang menempatkan keduanya di balik satu flag hanyalah penggantian base-URL, bukan penulisan ulang — itulah cara yang tepat untuk menyelesaikan perdebatan khusus ini, karena perdebatannya adalah tentang token per tugas yang selesai dan hanya beban kerja Anda sendiri yang dapat menghasilkan angka itu.

A screenshot of the Sakana AI announcement page (English UI, captured September 11, 2026) headed 'Introducing Fugu Max and Fugu Ultra v2: Orchestrating the Pareto Frontier' and dated September 11, 2026, showing the introductory argument that a system deploying a multi-trillion-parameter model for a simple lookup is wasteful, and a cost-versus-performance chart placing Fugu Max on a frontier formed by Fugu models above the frontier formed by single models.

Yang mana yang harus dibeli

Grok 4.6 adalah default yang dapat dipertahankan. Dengan kartu tarif yang identik dengan milik Fugu Max, ini memberi Anda jendela konteks 500K yang dapat Anda jadikan acuan perencanaan, versi yang dapat Anda pin, empat tingkat kendali penalaran, penempatan indeks independen di peringkat 44 dengan angka biaya per tugas di sampingnya, dan pengukuran pihak ketiga selama berbulan-bulan. Biayanya spesifik dan diketahui: jurang penetapan harga ulang 200K, penalaran yang selalu ditagih, dan profil pekerjaan terminal yang tertinggal dari para pesaing.

Fugu Max adalah taruhan yang lebih menarik dan, berdasarkan bukti yang tersedia, yang lebih sulit diperiksa. Alasan desainnya masuk akal — jika koordinator secara andal memilih model termurah yang dapat menyelesaikan tugas Anda, biaya median per pekerjaan yang selesai akan turun bahkan ketika kartu tarif Anda tidak. Namun pada $2.00 / $6.00, tarif token bukanlah letak keunggulan Fugu Max; tarif itu persis sama dengan Grok 4.6. Keunggulannya harus berasal dari pengeluaran token yang lebih sedikit, dan Sakana belum menerbitkan pengukuran yang akan menunjukkan bahwa Fugu Max memang melakukannya.

Jadi jalankan perbandingannya dengan cara yang diminta kedua vendor kepada Anda. Tempatkan Grok 4.6 di gateway Anda, panggil Fugu Max di balik feature flag, dan hitung token keluaran per tugas yang diselesaikan pada pekerjaan yang mirip dengan pekerjaan Anda. Jika Fugu Max selesai dengan lebih sedikit token daripada satu model pada tarif yang sama, diskon cache dan koordinasinya adalah uang nyata dan peralihannya dibenarkan. Jika tidak, Anda membayar tarif yang identik untuk sistem yang komposisinya dapat berubah di bawah Anda tanpa nomor versinya berubah.

Untuk semua hal yang dapat Anda putuskan kuartal ini tanpa pengukuran itu, mulailah dengan model yang memiliki papan skor.

A screenshot of the OrcaRouter model page for Grok 4.6 (English UI, captured September 11, 2026), showing the NEW and Featured badges, the identifier grok/grok-4.6, by SpaceXAI dated 2026-08-12, vision, tools, JSON and reasoning capability tags, a 500K-token context window with text, image and file input, a p50 TTFT of 10.00 seconds, list pricing of $2.00 per 1M input tokens and $6.00 per 1M output tokens, traffic of 46.6 million tokens over 7 days, and an OpenAI-compatible base URL with Python and cURL code samples.

Dibandingkan dalam artikel ini1

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari