Kartu hero yang dihasilkan untuk 'Model kecil Amerika kini jadi yang lebih murah', dengan lencana 'DASAR HARGA' serta kicker '7 OKTOBER 2026' dan subjudul 'Claude Haiku 5.5 pada $0.10 dan $0.50 dibandingkan DeepSeek V4 Flash - hingga 100.000 token.' Empat chip bertuliskan '$0.10 vs $0.15 masuk', '$0.50 vs $0.60 keluar', 'langkah 100K' dan 'periode puncak'. Dua kartu di bawahnya diberi label 'DI BAWAH 100.000 TOKEN' ('Anthropic lebih murah pada kedua meteran') dan 'DI ATASNYA' ('DeepSeek lebih murah tiga hingga empat kali'). Footer berbunyi 'Tarif daftar yang dipublikasikan vendor tercatat per 8 Oktober 2026.' Logo OrcaRouter dikompositkan di sudut kanan bawah.
Guides & Insights

Claude Haiku 5.5 vs DeepSeek V4 Flash: Anthropic Baru Saja Memangkas Batas Harga Terendah

Penulis

Rowan Sterling

Tanggal Terbit

Model terbaru · 20Lihat semua model →
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Selama dua tahun, lapisan murah di pasar ini punya bentuk yang semua orang tahu: lab-lab Amerika mengenakan biaya lebih tinggi dan lab-lab Tiongkok mengenakan biaya lebih rendah, dan Anda memilih pihak sesuai kecenderungan Anda. Claude Haiku 5.5 mematahkan pola itu pada 7 Oktober 2026, dengan meluncurkan pada $0,10 per juta token masukan dan $0,50 per juta token keluaran — yang berada di bawah tarif yang dipublikasikan untuk DeepSeek V4 Flash, model yang telah menjadi titik acuan untuk harga murah sejak musim panas.

Ini kemenangan yang lebih sempit daripada kedengarannya, dan alasannya lebih berharga daripada judul utamanya. Tarif Anth​ropic hanya berlaku untuk prompt hingga 100.000 token. Di atas itu, tarifnya menjadi $0,50 dan $2,50, yang beberapa kali lebih mahal daripada harga Dee​pSeek. Dan kartu milik Dee​pSeek sendiri memiliki bentuk yang tidak ditiru siapa pun: harganya berlipat ganda selama dua jendela hari kerja. Dua vendor, dua gagasan yang sepenuhnya berbeda tentang apa arti "murah".

Apa yang sebenarnya dipublikasikan oleh masing-masing vendor

Per juta token, dalam dolar AS. Angka Ant​hropic berasal dari dokumentasi Ant​hropic; angka Dee​pSeek berasal dari halaman Models & Pricing milik Dee​pSeek sendiri, yang merupakan acuan resmi untuk model tersebut.

A generated scoreboard titled 'What each vendor actually publishes'. Claude Haiku 5.5 reads input $0.10 under 100K and $0.50 above, output $0.50 and $2.50, cached input $0.01 and $0.05, maximum output 128,000 tokens, modality text and images, peak windows none. DeepSeek V4 Flash reads input $0.15 off-peak and $0.30 peak, output $0.60 and $1.20, cached input $0.003 and $0.006, maximum output 384,000 tokens, modality text only, peak windows two weekday UTC ranges. A footer reads 'Vendors' published list rates; DeepSeek's peak windows are weekday UTC ranges.'

• Masukan — Claude Haiku 5.5 $0.10 hingga 100.000 token, $0.50 di atasnya. DeepSeek V4 Flash $0.15 di luar jam sibuk, $0.30 pada rentang jam sibuk.

• Keluaran — Claude Haiku 5.5 $0.50 hingga 100.000 token, $2.50 di atasnya. DeepSeek V4 Flash $0.60 di luar jam sibuk, $1.20 pada jam sibuk.

• Input cache — Claude Haiku 5.5 $0.01 hingga 100.000 token dan $0.05 di atasnya. DeepSeek V4 Flash $0.003 di luar jam sibuk dan $0.006 pada jam sibuk, yang lebih murah lebih dari tiga kali lipat.

• Periode puncak — Ant​hropic tidak memilikinya; tarif berubah berdasarkan panjang prompt dan tidak ada faktor lain. Dee​pSeek menggandakan tarif antara pukul 01:00 dan 04:00 serta antara pukul 06:00 dan 10:00 UTC, Senin hingga Jumat, tidak termasuk hari libur publik Tiongkok.

• Konteks dan keluaran — 1 juta token dan 128.000 keluaran maksimum untuk Claude Haiku 5.5; 1 juta token dan 384.000 keluaran maksimum untuk DeepSeek V4 Flash.

• Modalitas — Claude Haiku 5.5 menerima teks dan gambar; DeepSeek V4 Flash hanya teks, dan visi berada pada model saudaranya, bukan pada model ini.

• Skor independen — Artificial Analysis Intelligence Index v4.3.2 menempatkan Claude Haiku 5.5 (Max) pada 43.40, peringkat kedua dari 182 model, dan DeepSeek V4 Flash 0731 (Max) pada 34.33, peringkat kesepuluh dari 117.

• Kecepatan — sumber yang sama mencatat 241,9 token output per detik untuk Claude Haiku 5.5 dan 222,0 untuk DeepSeek V4 Flash, tercepat kedua di papan peringkatnya sendiri.

Crossover adalah inti dari semuanya

Sejajarkan kedua kartu dalam satu permintaan dan perbandingannya berbalik dua kali.

Di bawah 100.000 token, Ant​hropic lebih murah pada kedua metrik dan pada label harga yang penting: $0,10 versus $0,15 untuk input, $0,50 versus $0,60 untuk output. Ini adalah pertama kalinya model kecil Ant​hropic berada di bawah tarif Dee​pSeek Flash dalam perbandingan setara, dan itulah fakta yang menjadi pembuka dalam postingan peluncuran.

Di atas 100.000 token, keadaan berbalik drastis. Input $0,50 Ant​hropic lebih dari tiga kali tarif di luar jam sibuk Dee​pSeek, dan output $2,50 lebih dari empat kali lipatnya. Pipeline retrieval atau dokumen panjang yang rutin menyusun prompt 150.000 token sama sekali bukan pelanggan untuk Claude Haiku 5.5; ia adalah pelanggan bagi model yang sudah digunakannya.

Dan dalam dua jendela hari kerja DeepSeek, perbandingan kedua menyempit dari arah yang berlawanan, karena tarif DeepSeek sendiri menjadi dua kali lipat sementara tarif Anthropic tidak berubah. Tidak ada struktur vendor yang lebih baik secara abstrak. Yang satu menetapkan harga berdasarkan seberapa banyak yang Anda kirim, yang lain menetapkan harga berdasarkan kapan Anda mengirimnya, dan hanya satu dari itu yang berada dalam kendali Anda pada saat permintaan.

Berapa biaya tugas yang telah selesai, yang merupakan satu-satunya angka yang adil.

Tarif yang tertera dihitung per token, dan kedua model tersebut tidak menghasilkan jumlah token yang sama untuk pekerjaan yang sama. Di situlah perhitungan peluncuran menjadi tidak nyaman bagi Anthropic.

Artificial Analysis menempatkan Claude Haiku 5.5 (Max) pada $0,21 per tugas Intelligence Index dan DeepSeek V4 Flash 0731 (Max) pada $0,22 per tugas. Tarif inputnya sepersepuluh, jendela lebih luas, dan selisih Intelligence Index 26 poin — 43,40 versus 34,33 — dan biaya terukur untuk menyelesaikan satu tugas hanya terpaut satu sen dari model yang seharusnya bisa dikalahkannya dari segi harga.

Alasannya ada di halaman yang sama. Saat mengevaluasi Index, Claude Haiku 5.5 menghasilkan 440 juta token keluaran dibandingkan median 100 juta, dan penilai menyebutnya sangat bertele-tele. DeepSeek V4 Flash menghasilkan 240 juta dibandingkan median 140 juta dan juga disebut sangat bertele-tele. Kedua model berpikir panjang lebar, keduanya menagihkan proses berpikir sebagai keluaran, dan keluaran adalah meteran yang menentukan tagihan. Pemotongan input sebesar sembilan puluh persen itu nyata dan dibebankan pada bagian tagihan yang lebih kecil.

Ada efek kedua yang lebih senyap. Dokumentasi Anthropic sendiri menyebutkan bahwa Claude Haiku 5.5 menggunakan tokenizer yang lebih baru yang dipakai bersama Claude 4.7 dan versi setelahnya, sehingga teks yang sama dihitung sekitar 30% lebih banyak token daripada saat di Claude Haiku 4.5. Tarifnya turun dengan faktor sepuluh; jumlah token tidak turun sama sekali, dan pada teks yang sama justru meningkat.

A screenshot of Anthropic's model documentation showing the Claude Haiku 5.5 specifications and pricing rows, listing the context window, maximum output and thinking behaviour beside the published per-million-token input, output and cache rates with their prompt-length thresholds.

Model di balik nama Dee​pSeek juga berubah

Siapa pun yang membandingkan keduanya berdasarkan tabel benchmark yang sudah berumur beberapa bulan sebaiknya mengetahui ini sebelum melakukannya.

Halaman harga Dee​pSeek kini mencantumkan deepseek-flash sebagai nama model, didukung oleh Dee​pSeek-V4.1-Flash, dan menyatakan bahwa id lama deepseek-v4-flash masih diterima tetapi bahwa "model yang bersangkutan telah dihentikan" — permintaan dengan nama lama dilayani oleh model yang lebih baru dan ditagih dengan harga Flash. Dengan kata lain, id tersebut mempertahankan namanya, harganya, dan posisinya dalam jajaran, dan bobot di baliknya berpindah.

Itu bukan kritik; itu peringatan tentang apa yang menjadi acuan tanggal sebuah tabel benchmark. Entri Artificial Analysis yang dikutip tulisan ini adalah untuk rilis 0731 DeepSeek V4 Flash dalam konfigurasi Max-nya, yaitu model yang diukur oleh papan tersebut, dan itu tidak otomatis merupakan pernyataan tentang apa pun yang saat ini menyandang id tersebut. Claude Haiku 5.5 milik Anthropic, sebaliknya, adalah id tetap tanpa akhiran tanggal dan tanpa alias, dan penempatannya di Index tanggalnya mengacu pada minggu peluncurannya sendiri.

Dua model, satu endpoint

Alasan perbandingan ini mudah diselesaikan sendiri alih-alih di lembar spesifikasi adalah karena kedua sisi dapat dipanggil dari tempat yang sama — dengan satu pengecualian yang perlu disebutkan.

DeepSeek V4 Flash sudah ada di katalog OrcaRouter hari ini, dan failover otomatis berada di bawahnya, jadi sisi DeepSeek dalam perbandingan ini dapat kami panggil pagi ini, bukan sekadar dibaca. Satu peringatan yang layak disebutkan daripada membiarkan Anda menemukannya sendiri: tarif yang kami cantumkan sendiri untuk model ini adalah $0.22 masuk dan $0.66 keluar per juta token, yang berada di atas kartu tarif off-peak DeepSeek dan di bawah kartu tarif peak-nya. Perlakukan halaman DeepSeek, bukan halaman kami, sebagai otoritas atas struktur peak dan off-peak, dan halaman kami sebagai satu angka campuran tunggal untuk memulai proses terukur. Claude Sonnet 5.5 dan Claude Opus 5.5 juga ada di katalog. Jadi A/B antara sisi DeepSeek Flash dan sisi Claude cukup dengan satu kunci dan satu SDK, dan DSL routing akan menyusunnya menjadi satu panggilan jika logika eskalasi memang berada di rute, bukan di aplikasi.

Claude Haiku 5.5 belum ada di katalog. Itu bukan pernyataan yang ambigu — artinya, sisi Anthropic dari perbandingan ini saat ini harus diakses langsung ke Anthropic, sedangkan sisi DeepSeek tidak. Jika Anda ingin tier murah dari lini DeepSeek pada key yang sama dengan seluruh stack Anda saat ini, bagian itu sudah aktif.

A screenshot of the OrcaRouter catalogue page for DeepSeek V4 Flash, showing the model identifier in provider-slash-model form, the provider DeepSeek, the model description and a stat strip carrying the per-million-token input and output rates alongside the context window and maximum output.

Mana yang harus dipilih

Jika panggilan Anda singkat — klasifikasi, ekstraksi, perutean, giliran agen untuk peringkasan — dan berada di bawah 100.000 token, Claude Haiku 5.5 kini menjadi yang lebih murah pada keduanya dan yang lebih kuat pada evaluasi independen, dan alasannya sudah jelas. Itulah satu-satunya di antara keduanya yang menerima gambar.

Jika panggilan Anda panjang, jika Anda mengirim ulang prefiks bersama yang besar, atau jika Anda bisa, perhitungannya justru sebaliknya dan selisihnya sangat jauh: harga cache DeeSeek di luar jam sibuk sebesar $0,003 berada satu orde magnitudo di bawah $0,01 milik Anthropic, batas atas keluarannya tiga kali lebih tinggi, dan diskon di luar jam sibuknya adalah masalah penjadwalan, bukan keterbatasan produk.

Apa yang sebenarnya ditetapkan oleh peluncuran itu lebih sempit daripada "Ant​hropic sekarang murah." Peluncuran itu menetapkan bahwa lab-lab Amerika akan memasang harga di bawah lab-lab Tiongkok untuk kasus prompt pendek, dan bahwa kasus prompt pendek adalah tempat sebagian besar trafik produksi berada. Segala sesuatu di atas 100.000 token masih menjadi pasar model lainnya.