
Claude Haiku 5.5 vs Sakana Namazu: Keduanya Murah, Keduanya Cepat, Hampir Tidak Ada Kesamaan Lainnya
- OrcaBARUOrca: OrcaCyber Zero 1.52026-10-10$3.00 / $7.50 per 1 juta token · 72 tok/s
- openaiBARUOpenAI: GPT-6.1 Sol2026-09-2952Kecerdasan
- anthropicBARUAnthropic: Claude Sonnet 5.52026-09-2856Kecerdasan
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 116 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Kecerdasan
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- xAIGrok 4.72026-09-2146Kecerdasan
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 juta token · 48 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 478 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 juta token · 59 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 382 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
Di permukaan, keduanya tampak setara. Claude Haiku 5.5 adalah tier kecil dan cepat dari vendor tersebut, dirilis 7 Oktober 2026 dengan harga $0,10 per juta token input dan $0,50 per juta token output dengan jendela satu juta token, dirancang untuk klasifikasi, ekstraksi, perutean, dan pekerjaan subagen. Sakana Namazu adalah model API khusus bahasa Jepang dari Sakana AI, diluncurkan pada 3 Agustus 2026, ditagih $0,95 per juta token input dan $4,00 per juta token output dengan tarif input yang di-cache $0,15, disempurnakan di atas basis terbuka Kimi K2.6 dengan pasca-pelatihan milik Sakana sendiri, dan tersedia melalui endpoint yang kompatibel dengan OpenAI.
Keduanya diposisikan sebagai opsi terjangkau di jajaran produknya masing-masing, dan di situlah kemiripannya berhenti. Claude Haiku 5.5 adalah model Barat serbaguna yang akan Anda gunakan untuk merutekan lalu lintas; Sakana Namazu adalah model yang terspesialisasi untuk negara tertentu yang akan Anda gunakan ketika tugasnya dalam bahasa Jepang dan alternatifnya adalah model umum yang mengerjakannya dengan buruk. Pertanyaan yang menarik bukanlah mana yang lebih baik. Melainkan apa yang diberikan spesialis kepada Anda, di mana batas spesialisasi itu sebenarnya berada, dan berapa biaya untuk keluar darinya.
Apa yang sebenarnya dibangun Sakana AI
Sakana Namazu layak dipahami sebelum dibandingkan dengan apa pun, karena konstruksinya tidak biasa. Model ini tidak dilatih dari nol. Ini adalah penyempurnaan dari model open-weights yang sudah ada — Kimi K2.6 — yang dilatih lebih lanjut oleh Sakana, dan yang disajikannya sebagai API tertutup. Garis keturunannya penting: kemampuan penalaran umum dan pengodean model dasar diwarisi, dan yang ditambahkan Sakana adalah lapisan khusus Jepang.
Lapisan itu terdokumentasi, yang tidak bisa dikatakan untuk sebagian besar klaim lokalisasi. Sakana melaporkan bahwa Namazu mempertahankan performa model dasar pada evaluasi umum — AIME26, MMLU-Pro, LiveCodeBench v6 — sekaligus melampauinya di seluruh set bahasa Jepang dan khusus Jepang, dengan FairPoliticsQA naik dari 34,10% menjadi 56,30%. Ia menjalankan tolok ukur terjemahan bahasa Jepang internalnya sendiri, JFBench, dan melaporkan peningkatan di semua aspek di sana juga. Sebuah studi kasus terpisah, alat pencarian bukti untuk dokter, melaporkan 96,8% pada ujian medis nasional ke-119 dan 96,4% pada ujian ke-120.
Itu adalah angka-angka Sakana pada benchmark Sakana, dan JFBench bukanlah standar publik yang bisa direproduksi oleh orang lain. Klaim yang bertahan dari catatan itu sempit tetapi nyata: model tersebut adalah base model yang bernama plus langkah pasca-pelatihan yang terdokumentasi, dan delta yang dilaporkan diukur terhadap base-nya sendiri, bukan terhadap pemain lain di bidang ini.
API dan ketentuan komersial adalah bagian yang akan menentukan sebagian besar kasus bisnis. Namazu kompatibel dengan OpenAI — perubahan endpoint dan nama model sakana-namazuadalah satu-satunya perubahan kode, menurut dokumentasi Sakana sendiri. Layanan ini menagih dalam dolar AS dan menawarkan pembayaran yen pada paket Enterprise. Layanan ini juga membebankan biaya perkakas yang tidak akan pernah terlihat dalam perbandingan per token: $7,00 per seribu panggilan pencarian web dan $0,12 per jam eksekusi kode, yang dibundel Sakana ke dalam produk.
Ada dua batasan yang lebih penting daripada angka apa pun di kartu tarif. Namazu tidak tersedia di UE, EEA, Inggris, atau Swiss karena menunggu pekerjaan kepatuhan terkait GDPR, menurut halaman Sakana sendiri. Dan kebijakan penanganan data default menyatakan bahwa input dapat digunakan untuk melatih dan meningkatkan model Sakana, dengan opsi opt-out tersedia di pengaturan Console; perusahaan mengatakan bahwa saat ini pihaknya tidak dapat menjamin bahwa pemrosesan sepenuhnya tetap berada di Jepang. Bagi tim Eropa atau Inggris, yang pertama membuatnya tidak memenuhi syarat dan yang kedua adalah pertanyaan yang harus dijawab sebelum panggilan pertama.
Batasnya, dinyatakan dengan jujur
Ini adalah bagian di mana perbandingan lembar spesifikasi akan berbohong kepada Anda, jadi inilah yang sebenarnya dapat dibandingkan:
• Harga — Claude Haiku 5.5 $0,10 input dan $0,50 output per juta token hingga 100.000 token prompt, lalu $0,50 dan $2,50. Sakana Namazu $0,95 dan $4,00, dengan tarif input cache $0,15. Namazu kira-kira sembilan setengah kali lebih mahal pada input dan delapan kali pada output di tingkat pertama.
• Caching — pembacaan cache Claude Haiku 5.5 adalah $0,01 dan $0,05 per juta bergantung pada tier; milik Sakana Namazu sebesar $0,15 tetap. Angka absolutnya berdekatan di tier teratas dan terpaut dua puluh sembilan kali lipat di tier terbawah.
• Alat — keduanya bukan model teks murni dan keduanya tidak mengenakan biaya dengan cara yang sama. Claude Haiku 5.5 menyertakan pemikiran adaptif dengan pengatur upaya dari Rendah hingga Maks dan dukungan alat sisi server; Sakana Namazu membundel pencarian web seharga $7,00 per seribu panggilan dan eksekusi kode seharga $0,12 per jam.
• Konteks — satu juta token untuk Claude Haiku 5.5. Sakana tidak mempublikasikan jendela konteks untuk Namazu, dan angka apa pun yang Anda lihat dikutip untuknya adalah asumsi tentang basis Kimi K2.6, bukan spesifikasi.
• Penilaian independen — Claude Haiku 5.5 memiliki Artificial Analysis Intelligence Index sebesar 43, peringkat kedua dari 182 di kelasnya pada papan tersebut, dengan biaya $0.21 per tugas Intelligence Index. Sakana Namazu tidak memiliki entri Artificial Analysis dan tidak ada evaluasi pihak ketiga dalam bentuk apa pun yang dapat saya temukan. Angka-angka yang dipublikasikannya adalah miliknya sendiri.
• Ketersediaan — Claude Haiku 5.5 tersedia di Claude API, Amazon Bedrock, Vertex AI, Microsoft Foundry, dan Claude Platform on AWS, dengan komitmen penghentian yang dipublikasikan tidak lebih awal dari 7 Oktober 2027. Sakana Namazu tersedia di API milik Sakana sendiri, Sakana Chat, dan produk Sakana Translate, serta tidak tersedia di UE, Wilayah Ekonomi Eropa (EEA), Britania Raya, dan Swiss.
• Penanganan data — Ketentuan vendor sesuai standar enterprise, dan blok pemikiran model dibatasi pada akun yang menghasilkannya. Default Sakana Namazu adalah input dapat digunakan untuk pelatihan, dengan opsi opt-out.
• Modalitas — Claude Haiku 5.5 menerima teks dan gambar; cakupan modalitas Sakana Namazu tidak dipublikasikan selain posisinya yang mengutamakan teks.
• Lisensi dan silsilah — Claude Haiku 5.5 bersifat proprietary dan hanya tersedia melalui API. Sakana Namazu bersifat proprietary tetapi dibangun di atas bobot Kimi K2.6 yang terbuka, yang berarti basisnya dapat diperiksa, sedangkan model yang telah disetel tidak.
Masalah penskoran yang jujur
Baca daftar itu dan perhatikan apa yang hilang: baris apa pun yang menyatakan model mana yang menghasilkan keluaran bahasa Jepang lebih baik. Itu bukan kelalaian. Tidak ada tolok ukur bersama di antara keduanya yang dapat memutuskannya. Kemampuan bahasa Jepang Claude Haiku 5.5 yang kuat bukanlah sesuatu yang diiklankan vendor sebagai klaim utama, dan angka JFBench milik Sakana adalah instrumennya sendiri. Model kecil kelas terdepan yang bersifat umum dari vendor dengan kemampuan multibahasa yang kuat, yang dievaluasi terhadap model berbasis Kimi yang dilatih lanjut secara khusus untuk bahasa Jepang, adalah perbandingan yang belum pernah benar-benar dijalankan dan dipublikasikan oleh siapa pun.
Apa yang bisa dikatakan bersifat struktural, bukan empiris. Seluruh identitas komersial Namazu adalah klaim bahwa model umum tidak cukup baik untuk pekerjaan berbahasa Jepang — bahwa bahasa yang spesifik per negara, inferensi budaya, dan konteks domestik merupakan kemampuan tersendiri yang membenarkan model khusus dengan premi harga sembilan kali lipat. Jika Anda percaya klaim itu, Namazu adalah jawabannya dan harga itulah biaya dari jawaban tersebut. Jika tidak, model umum seharga $0,10 per juta token adalah yang Anda gunakan dan pertanyaannya adalah apakah Anda dapat mengukur perbedaannya pada trafik Anda sendiri.
Versi klaim yang dapat diukur adalah versi yang disediakan Sakana: FairPoliticsQA naik dari 34,10% menjadi 56,30% dibandingkan model dasar yang menjadi dasar penyetelannya. Itu adalah peningkatan nyata pada tolok ukur nyata, tetapi itu adalah perbandingan terhadap Kimi K2.6, bukan terhadap Claude Haiku 5.5 — dan itu memberi tahu Anda bahwa pasca-pelatihan untuk konteks politik khusus Jepang membuat perubahan berarti pada tugas itu, yang merupakan pernyataan yang lebih sempit dan lebih dapat dipertahankan daripada "lebih baik dalam bahasa Jepang".

Seperti apa kesenjangan biaya pada volume besar
Jalankan pipeline sederhana dengan 10 juta token input dan 2 juta token output per hari melalui keduanya.
• Biaya input, per hari — $1,00 pada Claude Haiku 5.5, $9,50 pada Sakana Namazu.
• Biaya output, per hari — $1.00 pada Claude Haiku 5.5, $8.00 pada Sakana Namazu.
• Total harian — $2,00 dibanding $17,50, sekitar $60 per bulan dibanding $525.
$525 itu sebelum satu panggilan pencarian web atau satu jam eksekusi kode. Tambahkan 500 panggilan pencarian sehari dan Namazu membutuhkan biaya tambahan $3,50 per hari, sehingga totalnya menjadi $21,00 berbanding $2,00 — rasio lebih dari sepuluh banding satu yang tidak dapat ditutup oleh efisiensi token sebesar apa pun.
Apakah jumlah itu besar sepenuhnya bergantung pada apa alternatifnya. Jika pilihan Anda adalah Namazu atau model umum yang menghasilkan keluaran bahasa Jepang biasa-biasa saja yang harus diperbaiki sendiri oleh peninjau Anda, $525 itu membeli kembali jam kerja peninjau, dan perbandingannya bukan token versus token, melainkan token versus gaji. Jika trafik bahasa Jepang Anda rutin dan sudah cukup baik dengan model umum, biaya tambahan itu tidak membeli apa pun yang terukur, dan dolar yang sama dapat membeli volume sepuluh kali lebih banyak di tempat lain.
Opsi ketiga adalah yang menarik untuk produk berbahasa Jepang: gunakan spesialis ketika klaim spesialis itu berlaku — terjemahan, konteks domestik, teks regulasi dan politik — dan model umum untuk pekerjaan bervolume di sekitarnya. Itu bukan kompromi. Itulah arsitektur yang sebenarnya tersirat dari penetapan harga, karena premi Namazu dibayar per token dan tidak ada alasan untuk membayarnya pada klasifikasi.

Kedua model itu tidak ada di katalog kami.
Kita harus berterus terang soal ini, karena ini jenis perbandingan yang mudah diselipi paragraf ketersediaan: OrcaRouter tidak menyediakan Claude Haiku 5.5 maupun Sakana Namazu. Namazu tersedia melalui API milik Sakana sendiri, dan Claude Haiku 5.5 melalui API vendor serta cloud-cloud besar. Tidak satu pun dari fakta itu mengubah perbandingan, yang berpijak pada tarif yang dipublikasikan, kemampuan yang dipublikasikan, dan batasan yang dipublikasikan.
Peran yang dimainkan satu endpoint dalam kasus seperti ini lebih sempit dan lebih jujur daripada sebuah plug. Ini adalah segmen model umum dari sebuah hibrida — tempat Anda akan merutekan lalu lintas klasifikasi dan ekstraksi non-Jepang yang tidak memerlukan spesialis, tanpa harus membangun hubungan vendor kedua untuk itu. Satu API untuk 200+ model, tarif daftar penyedia diteruskan dengan markup 0%, failover otomatis lintas penyedia, dan DSL perutean ketika bahasa permintaan yang harus menentukan rute alih-alih aplikasi. Jika Anda menjalankan produk Jepang bersama produk Inggris, itulah sambungan yang jika tidak ada, akan Anda bangun sendiri secara manual.
Yang mana, untuk siapa
Pilih Sakana Namazu ketika bahasa Jepang adalah produknya, bukan sekadar lokalitas — ketika peninjau Anda sedang mengoreksi keluaran, ketika domainnya adalah hukum domestik, kedokteran, politik, atau layanan pelanggan, ketika premi token sembilan kali lipat lebih kecil daripada biaya koreksi yang dihilangkannya, dan ketika pengguna Anda berada di luar UE, EEA, Inggris Raya, dan Swiss atau Anda memiliki penasihat hukum yang telah menyelesaikan pertanyaan penanganan data.
Pilih Claude Haiku 5.5 ketika pekerjaannya bersifat umum, volumenya tinggi, dan Anda menginginkan skor yang diukur secara independen alih-alih tolok ukur vendor — ketika $0.10 dan $0.50 per juta token sudah menghitungkannya untuk Anda, ketika Anda memerlukan jendela satu juta token pada dokumen panjang, atau ketika jawaban atas "mana yang lebih baik dalam bahasa Jepang" harus berasal dari evaluasi Anda sendiri alih-alih dari vendor mana pun.
Keduanya sebenarnya bukan rival. Yang satu adalah model serbaguna dengan harga yang dirancang untuk dipakai terus-menerus; yang lain adalah spesialis dengan harga yang dirancang untuk dipakai secara penuh pertimbangan. Kesalahannya adalah membeli spesialis untuk pekerjaan yang sudah dikerjakan dengan baik oleh model serbaguna, dan kesalahan sebaliknya — menganggap model umum menangani bahasa dan konteks negara tertentu sebaik sesuatu yang dilatih khusus untuk itu — adalah kesalahan yang menjadi landasan seluruh bisnis Sakana: bisnis yang dibangun dari orang-orang yang membuat kesalahan itu.

