DeepSeek V4 Flash vs V4 Pro: Kelas Efisiensi vs Flagship, Dibandingkan
Guides & Insights

DeepSeek V4 Flash vs V4 Pro: Kelas Efisiensi vs Flagship, Dibandingkan

Penulis

Rowan Sterling

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Lini V4 DeepSeek adalah tangga dua tingkat: V4 Flash, model efisiensi yang murah dan cepat — kini dalam rilis resmi -0731 dengan agen yang jauh lebih kuat — dan V4 Pro, flagship besar untuk penalaran dan pemrograman tersulit, yang beralih ke build GA resmi (0813) pada 12 Agustus 2026. Hal yang menarik adalah betapa sedikit perbedaan keduanya dalam pekerjaan praktis, dan betapa jauh perbedaan harganya. Panduan ini membandingkan keduanya dalam hal kemampuan, biaya, kecepatan, dan kesesuaian, dengan setiap angka diberi label sumbernya.

Catatan akurasi: Skor agentic/pengkodean V4 Flash dilaporkan oleh DeepSeek (log perubahan resmi, 2026-07-31, kerangka pengujian DeepSeek); skor GA (0813) V4 Pro juga dilaporkan oleh DeepSeek pada kerangka pengujian yang sama, dan belum ada evaluasi independen terhadap build 0813 yang dipublikasikan. Harga berlaku per 12 Agustus 2026; penurunan harga GA diteruskan di OrcaRouter dengan markup 0%. Angka dari kerangka pengujian vendor cenderung optimistis — verifikasi pada tugas Anda sendiri.

TL;DR. V4 Flash adalah MoE aktif 284B / 13B dengan harga $0.08 / $0.18 per juta token; V4 Pro adalah flagship yang jauh lebih besar, kini dalam build GA resminya (0813) dengan harga $0.435 / $0.87 — sekitar lima kali lipat harga Flash, turun dari sekitar empat belas kali lipat sebelum pemotongan harga bulan Agustus. Pada pengodean praktis, Flash berada dalam beberapa poin dari Pro (mis., SWE-bench Verified ~79% vs ~80.6%, dilaporkan agregator), dan peningkatan pasca-pelatihan -0731 menjadikan Flash agen yang kuat dengan sendirinya. Gunakan Pro untuk penalaran terberat dan pengodean multi-file yang paling menuntut; gunakan Flash untuk mayoritas volume tinggi — dan arahkan berdasarkan tingkat kesulitan untuk mendapatkan sebagian besar kualitas Pro dengan kira-kira seperlima biayanya.

Poin-poin penting

• Ukuran dan harga: Flash adalah 284B / 13B-aktif dengan harga $0,08 / $0,18; Pro adalah unggulan yang jauh lebih besar dengan harga $0,435 / $0,87 — Flash kira-kira seperlima dari harga, dan pemotongan harga GA Pro mempersempit kesenjangan lama ~14x menjadi sekitar 5x.

Kesenjangan coding kecil: agregator SWE-bench Verified ~79% (Flash) vs ~80,6% (Pro, era pratinjau; build GA belum memiliki skor independen); pada harness DeepSeek, Pro GA mencatat Terminal-Bench 2.1 87,9 vs Flash 82,7.

• Keduanya berbagi konteks 1M token dan keluaran 384K; keduanya hanya teks, dengan penalaran, alat, dan JSON.

Flash lebih cepat dan lebih murah untuk disajikan (p50 TTFT ~394 ms, ~184 tok/s); Pro menukar kecepatan dengan kemampuan puncak.

• Praktik terbaik: arahkan berdasarkan tingkat kesulitan — Flash untuk volume, Pro untuk minoritas yang sulit.

Apa yang dimaksud dengan masing-masing model

V4 Flash adalah tier efisiensi: model mixture-of-experts dengan total 284B tetapi hanya ~13B parameter aktif, konteks 1M token, hingga output 384K, disetel untuk pekerjaan agentic bervolume tinggi dan latensi rendah. Rilis resminya -0731 (31 Juli 2026) adalah peningkatan pasca-pelatihan yang mempertajam agen, pengodean, dan penggunaan alat, serta menambahkan dukungan native Responses-API dan Codex. V4 Pro adalah andalan DeepSeek — model yang jauh lebih besar yang dibangun untuk penalaran dan pengodean tersulit, di mana kapabilitas maksimal lebih penting daripada biaya. Model ini berjalan sebagai pratinjau sejak April, lalu berpindah ke build GA resminya pada 12 Agustus 2026, dengan harga yang jauh lebih rendah. Keduanya berada dalam keluarga V4 yang sama dan berbagi konteks 1M, input teks saja, serta dukungan penalaran/alat/JSON.

Kapabilitas: seberapa dekat Flash dengan Pro?

{{1}}Lebih dekat daripada yang disarankan oleh selisih harga, setidaknya untuk pengodean praktis.{{/1}} {{2}}Evaluasi agregator menempatkan V4 Flash (Max) sekitar 79,0% pada SWE-bench Verified — menyelesaikan masalah GitHub nyata — dibandingkan sekitar 80,6% untuk V4 Pro yang diuji pada era pratinjaunya.{{/2}} {{3}}Build GA (0813) terlalu baru untuk skor independen — belum ada yang dipublikasikan — jadi perbandingan Pro terbaik yang tersedia adalah kerangka pengujian DeepSeek sendiri, di mana build GA mencatat Terminal-Bench 2.1 87,9 dan DeepSWE 62,7, dibandingkan angka Flash -0731 sebesar 82,7 dan 54,4 (semuanya dilaporkan DeepSeek).{{/3}} {{4}}Di mana Pro unggul adalah pada bagian yang paling sulit: penalaran multi-langkah yang paling kompleks, pengodean multi-file yang paling rumit, dan tugas-tugas di mana anggaran parameter aktif yang lebih besar benar-benar membantu.{{/4}} {{5}}Jika sebagian besar pekerjaan Anda "sulit tetapi bukan frontier," Flash dapat menanganinya; simpan Pro untuk sebagian kecil yang benar-benar frontier.{{/5}}

Harga dan kecepatan: keunggulan penentu Flash.

Inilah titik di mana keduanya paling berbeda — dan di mana matematikanya baru saja berubah. Flash adalah $0.08 / $0.18 per juta token input/output; build GA resmi V4 Pro (0813) adalah $0.435 / $0.87 — sekitar lima kali harga Flash. Itu masih merupakan premi yang nyata, tetapi hanya sebagian kecil dari selisih ~14x sebelum pemotongan harga: listing deepseek-v4-pro yang lama berada di $1.168 / $2.336, jadi build GA kira-kira 63% lebih murah. Pada bulan dengan 10 juta token dengan 70% input, Flash berjalan sekitar $1.10 dan Pro sekitar $5.66 — rasionya tetap berlaku saat Anda meningkatkan hingga miliaran token. Flash juga dirancang untuk throughput (p50 TTFT ~394 ms, ~184 tok/s), sehingga lebih cocok untuk agen bervolume tinggi yang sensitif terhadap latensi. Premi Pro membeli kemampuan puncak, bukan kecepatan atau penghematan — tetapi dengan selisih ~5x, bukan ~14x, harga ruang atas kelas atas itu telah turun jauh.

Pola yang tepat: rute berdasarkan tingkat kesulitan

Anda tidak harus memilih salah satunya. Pengaturan berkualitas tinggi termurah mengirim sebagian besar permintaan yang mudah hingga sedang ke Flash, dan hanya meningkatkan permintaan tersulit ke Pro. Karena keduanya berasal dari keluarga yang sama dengan konteks dan antarmuka yang sama, perutean tersebut berjalan mulus — dan peningkatan -0731 berarti Flash kini menangani lebih banyak tingkat menengah sebelum Anda perlu meningkatkan. Jika dilakukan dengan baik, perutean berdasarkan tingkat kesulitan memberikan sebagian besar kualitas Pro dengan biaya mendekati biaya Flash, dan pemotongan harga GA membuat eskalasi Pro yang sesekali terjadi jauh lebih murah daripada saat pratinjau.

Mana yang harus Anda pilih?

Pilih V4 Flash jika…

Anda menjalankan workload agenik, coding, atau dokumen panjang bervolume tinggi yang mementingkan biaya dan kecepatan, dan kualitas "near-flagship" sudah cukup — yang, setelah upgrade -0731, mencakup banyak hal.

Pilih V4 Pro jika…

Anda membutuhkan kapabilitas maksimal untuk penalaran tersulit dan pengodean multi-file yang paling menuntut, dan Anda bersedia membayar sekitar 5x harga Flash untuk ruang ekstra kelas atas itu — permintaan yang jauh lebih mudah daripada premi ~14x yang dibawa oleh harga era pratinjau.

Gunakan keduanya melalui satu endpoint.

Keduanya tersedia di OrcaRouter dengan markup 0% melalui satu endpoint yang kompatibel dengan OpenAI — Flash sebagai deepseek/deepseek-v4-flash-0731 dan Pro sebagai deepseek/deepseek-v4-pro-0813 build GA resmi — sehingga Anda dapat menerapkan rute berdasarkan tingkat kesulitan sebagai pilihan konfigurasi, melakukan benchmark terhadap keduanya pada tugas Anda sendiri, dan mengalihkan lalu lintas tanpa integrasi ulang. Itulah cara paling sederhana untuk meraih penghematan Flash sambil tetap menyediakan Pro untuk minoritas tugas yang sulit.

FAQ

Apakah V4 Flash sebagus V4 Pro?

Pada pengodean praktis, hampir — agregator SWE-bench Verified ~79% vs ~80.6% (era pratinjau untuk Pro; build GA belum memiliki skor independen). Pada penalaran tersulit dan pengodean paling kompleks, Pro memimpin. Untuk sebagian besar beban kerja, Flash sudah cukup setelah peningkatan -0731.

Berapa lebih murah V4 Flash?

Flash harganya sekitar seperlima dari harga Pro: $0,08 / $0,18 per juta token dibandingkan dengan GA Pro sebesar $0,435 / $0,87. Sebelum penurunan harga Pro pada bulan Agustus, selisihnya sekitar 14x; sekarang sekitar 5x.

Apakah mereka berbagi jendela konteks yang sama?

Ya — keduanya menawarkan konteks 1M-token (1,048,576) dan output hingga 384K.

Mana yang lebih cepat?

Flash, secara desain — p50 waktu-ke-token-pertama sekitar 394 ms dan ~184 token/detik, disetel untuk penggunaan volume tinggi dan latensi rendah.

Bisakah saya menggunakan keduanya bersama-sama?

Ya — rute berdasarkan kesulitan melalui satu endpoint OrcaRouter: Flash untuk volume, Pro untuk tugas-tugas tersulit.

Intinya

V4 Flash vs V4 Pro adalah efisiensi versus kemampuan puncak. Flash memberi Anda sebagian besar kemampuan coding praktis Pro, plus agen yang benar-benar kuat setelah pembaruan -0731, dengan harga sekitar seperlima dan kecepatan lebih tinggi; build GA resmi Pro adalah andalan untuk pekerjaan terberat, dan pemotongan harganya — turun menjadi $0,435 / $0,87, sekitar lima kali lipat Flash, bukan empat belas kali lipat seperti sebelumnya — membuat level tertinggi itu lebih terjangkau dari sebelumnya. Langkah cerdas bukanlah salah satu/atau — melainkan merutekan berdasarkan tingkat kesulitan melalui satu endpoint seperti OrcaRouter, sehingga volume berjalan murah di Flash dan hanya minoritas sulit yang membayar untuk Pro.

Dibandingkan dalam artikel ini1

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari

© 2026 OrcaRouter

Untuk Penyedia

Mengoperasikan platform inferensi? Hadirkan model Anda di OrcaRouter.

Hubungi kami

Gabung komunitas kami

DiscordEmailXGitHubYouTube