
Harga API DeepSeek V4 Pro: $0,73/$2,18 di Luar Jam Sibuk, dan Mengapa Penutupan 14 September Dibatalkan
- openaiBARUOpenAI: GPT-6.1 Sol2026-09-2952Kecerdasan
- anthropicBARUAnthropic: Claude Sonnet 5.52026-09-2856Kecerdasan
- typesafeBARUTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 per 1 juta token · 223 tok/s
- OpenAIBARUOpenAI: GPT-6 Luna2026-09-2238Kecerdasan
- OpenAIBARUOpenAI: GPT-6 Sol2026-09-2248Kecerdasan
- AnthropicBARUAnthropic: Claude Opus 5.52026-09-2258Kecerdasan
- xAIBARUGrok 4.72026-09-2146Kecerdasan
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 per 1 juta token · 126 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 per 1 juta token · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token · 213 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
DeepSeek V4 Pro tidak akan dihentikan.Pada 11 September 2026, DeepSeek mengatakan akan tetap melayani model tersebut melalui API-nya setelah 14 September, dengan metode penagihan yang tidak berubah — membalikkan rencana yang diumumkan dua hari sebelumnya, di mana setiap permintaan deepseek-v4-pro akan dialihkan ke DeepSeek V4.1 Flash dan ditagih dengan tarif Flash. Bagi siapa pun yang prompt, pengaturan temperature, dan skema pemanggilan alatnya disesuaikan dengan V4 Pro, itulah fakta yang penting minggu ini: model yang Anda bangun di atasnya tetap berada di tempatnya, dan migrasi yang mungkin Anda jadwalkan untuk Senin tidak harus terjadi.
Harga adalah cerita yang berbeda, dan halaman ini salah menampilkannya selama sebulan. DeepSeek V4 Pro tidak lagi berbiaya $0,44/$0,88 per juta token. Di luar jam sibuk, tarifnya $0,726 untuk input dan $2,178 untuk output per 1 juta token di OrcaRouter, dan berlipat dua menjadi $1,452/$4,356 di dalam jendela jam sibuk, dengan pembacaan cache sebesar $0,024. Akhir pekan kini sepenuhnya di luar jam sibuk. Dan daftar tarif milik vendor sendiri — yang ada di dokumentasi API DeepSeek — memuat pemberitahuan lanjutan sebagai catatan kaki pada tabel harga yang sama, yang kira-kira sedekat mungkin dengan sumber primer yang bisa dimiliki sebuah halaman harga.
Apa yang sebenarnya dikatakan DeepSeek, dan apa yang dibatalkannya
Garis waktunya penting, karena dua dari tiga pengumuman itu saling bertolak belakang, dan yang di tengah adalah yang diingat orang.
• 9 September — DeepSeek memberi tahu pengguna bahwa hingga V4.1 Pro diluncurkan, permintaan ke V4 Pro akan dialihkan ke DeepSeek V4.1 Flash dan ditagih dengan tarif V4.1 Flash.
• 10 September — V4.1 Flash dirilis, dan DeepSeek memindahkan peralihan ke waktu tetap: pukul 12.00 waktu Beijing pada 14 September 2026, setelah itu V4 Pro akan offline dan trafiknya akan dilayani oleh Flash.
11 September — DeepSeek berbalik arah. Kata-katanya, kini dimuat secara verbatim sebagai catatan kaki di halaman Models & Pricing pada dokumentasi API-nya sendiri: "Menanggapi permintaan pengguna, kami telah memutuskan untuk terus menyediakan layanan API untuk DeepSeek V4 Pro setelah 14 September 2026, dengan metode penagihan tetap tidak berubah. Kami akan memberikan pemberitahuan lebih lanjut jika ada perubahan."
Itu adalah pernyataan vendor tentang produknya sendiri, dan inilah sumber terkuat yang tersedia di sini — tetapi cermatilah apa yang ditegaskan dan tidak ditegaskannya. Hal ini menegaskan keberlanjutan dan penagihan: V4 Pro tetap ada, dengan tarif yang sudah berlaku. Ini tidak menjanjikan jangka waktu. Kami akan memberikan pemberitahuan lebih lanjut adalah keseluruhan komitmennya, dan kalimat yang sama membuka peluang bagi paket tersebut untuk kembali. Jika Anda membuat komitmen lintas kuartal, rencanakan untuk model yang bisa Anda tinggalkan, bukan model yang bisa Anda pertahankan.
Reaksi keras yang memaksa pembalikan itu layak dipahami, karena hal itu berkaitan dengan keputusan yang mungkin akan segera Anda buat sendiri. Para pengembang tidak keberatan terhadap V4.1 Flash — yang menurut DeepSeek mengalahkan V4 Pro dalam hal performa, harga, kecepatan, dan total waktu tugas — melainkan terhadap penggantian otomatis. Mengganti model di balik ID model yang stabil mengubah perilaku tanpa mengubah kode: prompt yang telah disetel, temperature yang berfungsi, skema pemanggilan alat yang dapat diurai, semuanya adalah properti dari checkpoint tertentu. Liputan di CLS (科创板日报), 36Kr, IT之家 dan ifeng, serta dalam bahasa Inggris di TheBlockBeats, menggambarkan DeepSeek mula-mula menunda, lalu membatalkan rencana itu; dokumen DeepSeek sendiri menunjukkan kontrasnya dengan rapi, karena nama-nama deepseek-v4-flash lama telah dihentikan dan sekarang melayani V4.1 Flash, dan peralihan itu bertahan. Peralihan ke Pro tidak bertahan.
Harga hari ini, diperiksa terhadap daftar tarif milik vendor sendiri

Dua angka penting, dan keduanya adalah harga daftar yang sama dalam dua mata uang.
• Luar jam sibuk (setiap jam di luar periode puncak di bawah ini) — input $0,726 per 1 juta saat cache miss, atau ¥4,5; output $2,178, atau ¥13,5; input saat cache hit $0,024, atau ¥0,15.
• Puncak — tepat dua kali lipat. Input $1.452 / ¥9, output $4.356 / ¥27, input cache-hit $0.048 / ¥0.30.
• Konversi dolar DeepSeek sendiri — dokumen vendor mencetak daftar yuan yang sama, setara dengan input $0,66 / output $1,98 di luar jam sibuk dan $1,32 / $3,96 pada jam sibuk, dengan cache hit sebesar $0,022 dan $0,044. Selisih dengan angka dolar OrcaRouter adalah kurs valas yang dipakai masing-masing pihak untuk konversi, bukan biaya token tambahan: OrcaRouter meneruskan tarif penyedia apa adanya tanpa markup, jadi angka pada daftar adalah angka yang Anda bayar.
• Tidak ada tier gratis untuk V4 Pro. Tier Flash gratis tersedia di direktori, tetapi yang flagship hanya berbayar.
• Lembar spesifikasi, sebagai konteks — V4 Pro adalah model berbobot terbuka di bawah lisensi MIT, 1,6T parameter total dengan 49B aktif per token, jendela konteks 1M token dan hingga 384K token keluaran, pada batas konkurensi 500. Artificial Analysis mencatat 72,3 token keluaran per detik.
Versi model di balik semua ini adalah DeepSeek-V4-Pro-0813, tidak berubah sejak rilis ketersediaan umum 13 Agustus — itulah intinya. Tidak ada yang berubah dari checkpoint pada 11 September; hanya keputusan tentang masa depannya yang berubah.
Jam sibuk, luar jam sibuk, dan aturan akhir pekan yang mengubah perhitungan
Skema peak/off-peak yang dijelaskan versi sebelumnya dari halaman ini sebagai akan hadir pada 17 Agustus kini sudah berumur satu bulan, dan telah diubah satu kali sejak itu.
• Periode puncak — 01:00–04:00 dan 06:00–10:00 UTC, Senin sampai Jumat. Dalam waktu Beijing, itu berarti 09:00–12:00 dan 14:00–18:00, yaitu hari kerja DeepSeek sendiri. Tarif luar jam sibuk persis setengah dari tarif puncak, bukan potongan harga tambahan di atas tarif tersebut.
• Akhir pekan sepenuhnya di luar jam sibuk. Berlaku sejak 00:00 waktu Beijing pada 23 Agustus 2026, DeepSeek berhenti menerapkan tarif jam sibuk pada Sabtu dan Minggu. Jika pekerjaan batch Anda bisa digeser, memindahkannya ke akhir pekan memangkas tagihan hingga setengah — dan bagi tim yang melayani pengguna di Amerika, sebagian besar pekan kerja sudah jatuh di luar jam sibuk tanpa perlu penjadwalan sama sekali.
• Berapa biaya perubahan itu, dibandingkan dengan ¥3/¥6 yang digunakan model saat diluncurkan pada 13 Agustus — output di luar jam sibuk hari ini adalah 2,25× tarif peluncuran dan output pada jam sibuk adalah 4,5×; input cache-hit pada jam sibuk adalah 12× dari ¥0,025 yang lama.
Ada asimetri di sini yang menjelaskan mengapa pertanyaan tentang migrasi terus muncul bahkan setelah penonaktifan dibatalkan. Harga V4 Pro naik pada Agustus, sementara harga penerusnya turun: DeepSeek memangkas harga API seri Flash hingga 60% efektif 10 September. Tekanan untuk bermigrasi sebenarnya tidak pernah benar-benar tentang pemberitahuan 14 September; pemberitahuan itu hanya membuatnya menjadi mendesak.
Berapa biaya sebenarnya dari sebuah permintaan
Tiga contoh perhitungan dengan tarif di luar jam sibuk hari ini. Setiap satunya menjadi dua kali lipat di dalam periode puncak.
• 100K input + 50K output — $0,0726 + $0,1089 ≈ $0,18.
• 1M input + 1M output — $0.726 + $2.178 = $2.90. Panggilan yang sama $5.81 saat puncak, dan $1.32 pada pertengahan Agustus.
• Sesi agentik, masukan 500K + keluaran 200K — $0.363 + $0.4356 ≈ $0.80.
Tampilan bulanan ada di halaman model dan merupakan uji jujur apakah judul lama masih menggambarkan tagihan Anda: pada 10 juta token per bulan dengan porsi input 70%, kalkulator biaya menghasilkan $11,62, atau sekitar $9,16 dengan prompt caching diaktifkan. Jika anggaran Anda disusun berdasarkan $0,44, kini anggaran itu menutupi sekitar 60% tagihan.
Cache adalah tuas yang tidak diletakkan siapa pun di atas meja.
Caching prompt menjadi lebih bernilai, bukan sebaliknya, ketika tarif naik — dan arah dari kedua angka itulah alasannya. Di OrcaRouter, pembacaan cache sekarang ditagih sebesar $0,024 per 1 juta token dibandingkan $0,726 tanpa cache, diskon 96,7% untuk setiap input yang Anda kirim ulang. Pada versi sebelumnya halaman ini, tarif cache adalah $0,060 dibandingkan harga input $0,442, diskon 86%. Harga pembacaan cache turun lebih dari setengah sementara harga input tanpa cache naik 64%, sehingga selisih efektif antara token yang di-cache dan yang tidak di-cache melebar secara signifikan.
Bagi agen yang mengirim ulang prompt sistem berukuran besar dan konteks panjang pada setiap giliran, input yang di-cache adalah pembeda antara tagihan yang meningkat seiring panjang percakapan dan yang tidak. Aturan praktisnya tidak berubah dan layak diulang: letakkan prompt sistem yang stabil dan materi referensi di awal, serta konten yang mudah berubah di akhir, agar prefiks yang Anda kirim ulang benar-benar mengenai cache. Pada model ini, satu pilihan struktural tersebut bernilai lebih besar daripada keputusan perutean atau penjadwalan apa pun di bawahnya.
Bagaimana harga V4 Pro dibandingkan dengan produk lainnya

Harga daftar direktori untuk input/output per 1 juta token, diperiksa 2026-09-12, dibandingkan dengan tarif off-peak V4 Pro $0.726/$2.178. Dua di antaranya telah berubah sejak halaman ini pertama kali diterbitkan, dan salah satunya mengubah kesimpulan.
• Claude Fable 5 — $10 / $50. V4 Pro 13,8× lebih murah untuk input dan 23× untuk output.
• Claude Opus 5 — $5 / $25. 6.9× / 11.5×.
• GPT-5.6 Sol — $4 / $20 hingga 272K konteks, $8 / $30 di luar itu. 5,5× / 9,2× pada tier yang lebih pendek, 11× / 13,8× pada tier yang lebih panjang.
• Kimi K3 — $3 / $15. 4,1× / 6,9×.
• Qwen3.8 Max — $2 / $6. 2,8× / 2,8×.
• Grok 4.5 — $2 / $6. 2,8× / 2,8×.
• Gemini 3.6 Flash — $0.75 / $3.75. Kira-kira setara untuk input di 1,03×, dan 1,7× untuk output. Harganya telah turun setengah sejak halaman ini ditulis.
• MiniMax M3 — $0.30 / $1.20. Lebih murah daripada V4 Pro di kedua lini sekarang: V4 Pro berbiaya 2,4× lebih mahal untuk input dan 1,8× lebih mahal untuk output, dengan jendela 1M token yang sama.
• DeepSeek V4 Flash — $0.242 / $0.726 di direktori. Sekitar 3× lebih murah pada kedua lini, konteks 1M yang sama.
Jadi cara penyampaian yang jujur sudah berubah, dan halaman ini seharusnya menyatakannya, bukan mempertahankan superlatif lama. DeepSeek V4 Pro bukan lagi model konteks 1M termurah di daftar: Gemini 3.6 Flash dan MiniMax M3 sama-sama lebih murah darinya, dan MiniMax M3 melakukannya sambil menyamai jendela konteksnya. Yang masih dimiliki V4 Pro, dengan selisih lebih dari satu orde besaran, adalah menjadi yang termurah di tier frontier — setiap model kelas unggulan Barat di daftar itu berbiaya beberapa kali lipat darinya pada kedua lini. Jika pertanyaannya adalah "panggilan konteks 1M termurah yang mungkin", jawabannya bukan lagi model ini. Jika pertanyaannya adalah "model termurah yang berperilaku seperti model frontier", untuk saat ini jawabannya masih ini.
Ketika V4 Pro adalah pilihan yang salah
• Jika lalu lintas Anda paling padat pada siang hari waktu Beijing. Jam sibuk menggandakan tarif, dan jendela puncaknya tepat berada pada hari kerja Tiongkok. Jika pengguna Anda berada di Amerika, sebagian besar lalu lintas Anda sudah masuk di luar jam sibuk, yang merupakan keunggulan struktural nyata. Jika Anda membangun untuk pengguna di Tiongkok, modelkan tagihan puncak secara eksplisit sebelum Anda berkomitmen — dan periksa apakah aturan akhir pekan membantu Anda memindahkan apa pun.
• Jika prompt Anda pendek. Di bawah sekitar 10K token konteks, tier unggulan adalah kapasitas yang terbuang. DeepSeek V4 Flash dengan harga $0.242/$0.726 di direktori menangani konteks 1M yang sama dengan sekitar sepertiga harganya, dan untuk tugas yang benar-benar pendek, model yang lebih murah tetap menang.
• Jika Anda membutuhkan visi. V4 Pro hanya teks — tidak ada input gambar atau audio — dan Artificial Analysis mencantumkan modalitas inputnya sebagai teks. Gemini 3.6 Flash atau Claude Fable 5 lebih cocok jika modalitasnya menjadi intinya. API milik DeepSeek sendiri juga patut dicatat di sini: sekarang ia menyajikan nama model flash warisannya dengan V4.1 Flash, yang memang menerima gambar.
• Jika Anda membeli skor mentah yang memuncaki benchmark ketimbang harga per konteks. Pada skala Artificial Analysis saat ini, V4 Pro mencetak 36 pada Intelligence Index — peringkat ke-8 dari 113 model saat tulisan ini dibuat — dan 69 pada indeks Coding seperti yang tercantum dalam direktori OrcaRouter. Itu kompetitif, bukan yang memimpin: Claude Fable 5, Claude Opus 5, dan GPT-5.6 Sol semuanya memiliki skor lebih tinggi darinya dalam coding. Tawaran V4 Pro adalah kemampuan yang mendekati frontier dengan sebagian kecil dari harga per token, bukan puncak setiap grafik.
Cara memanggilnya di OrcaRouter

DeepSeek V4 Pro dihosting di OrcaRouter dengan ID model deepseek/deepseek-v4-pro, dilayani melalui endpoint yang kompatibel dengan OpenAI di api.orcarouter.ai/v1 dengan tarif penyedia tanpa markup. Migrasi dari klien OpenAI yang sudah ada hanyalah mengubah base-URL dan ID model, tidak ada hal lain.
Pembalikan itu mengubah apa yang harus Anda lakukan. Jika Anda memiliki migrasi 14 September di kalender — mengalihkan dari V4 Pro ke DeepSeek V4.1 Flash karena Pro akan dihentikan — Anda dapat menghapusnya dari kalender, atau setidaknya menurunkannya dari tenggat waktu menjadi uji coba. Kedua model berada di balik satu kunci OrcaRouter, jadi membandingkannya hanyalah perubahan ID model dalam permintaan, bukan kontrak kedua dan SDK kedua; dan jika Anda memang ingin V4.1 Flash dievaluasi pada lalu lintas nyata tanpa mempertaruhkan jalur produksi padanya, failover otomatis adalah cara berisiko rendah untuk memberinya permintaan live sementara V4 Pro tetap menjadi cadangan. Itulah bentuk praktis dari keputusan 11 September: pilihan tetap di tangan Anda, dan tetap dapat dibalik.
Catatan kejujuran yang penting untuk halaman harga: kami merutekan ke model, kami tidak menetapkan harganya. Angka $0.726/$2.178 di luar jam sibuk adalah tarif DeepSeek yang diteruskan, dan angka itu berubah ketika DeepSeek mengubahnya — itulah tepatnya mengapa halaman ini diberi stempel tanggal, dan mengapa versi yang Anda baca ditulis ulang, bukan ditambahkan pada versi sebelumnya.
Sumber dan tanggal
Harga dan spesifikasi di halaman ini diverifikasi ulang pada 2026-09-12. Angka dolar untuk DeepSeek V4 Pro dan untuk setiap model dalam perbandingan dibaca dari direktori model OrcaRouter, diperiksa pada hari yang sama; jumlah parameter, lisensi, jendela konteks, modalitas dan angka kecepatan berasal dari halaman model Artificial Analysis untuk DeepSeek V4 Pro 0813. Tarif yuan, jendela puncak dan pemberitahuan kelanjutan 11 September berasal dari dokumentasi Models & Pricing milik DeepSeek sendiri, yang memuat pernyataan itu secara verbatim sebagai catatan kaki pada tabel harga. Urutan pengumuman tiga langkah — pemberitahuan perutean 9 September, penundaan 10 September hingga 12:00 waktu Beijing pada 14 September, dan pembalikan 11 September — dilaporkan oleh CLS (科创板日报), 36Kr, IT之家 dan ifeng, dan dalam bahasa Inggris oleh TheBlockBeats. Aturan penagihan akhir pekan 23 Agustus dan pemotongan harga Flash 10 September berasal dari pengumuman DeepSeek sebagaimana diliput oleh IT之家, The Paper dan 21st Century Business Herald.
Satu catatan penutup tentang keterandalan, karena harga spesifik ini telah berubah tiga kali dalam sebulan — tarif peluncuran pada 13 Agustus, tarif puncak/non-puncak pada 17 Agustus, amandemen akhir pekan pada 23 Agustus. Anggap halaman "V4 Pro pricing" apa pun yang tidak mencantumkan tanggal sebagai tidak dapat digunakan. Versi sebelumnya dari halaman ini mencantumkan $0.44/$0.88 dan indeks Artificial Analysis Intelligence sebesar 44.3; keduanya benar saat ditulis, dan keduanya tidak bertahan hingga akhir bulan.
Dibandingkan dalam artikel ini3
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
