Kartu hero hasil generasi berjudul 'DeepSeek V4 Pro vs Qwen3.8 Max' dengan dua kartu membulat — kartu DeepSeek V4 Pro berlabel '$0.66 / $1.98 di luar jam sibuk · bobot terbuka MIT · konteks 1M' dan kartu Qwen3.8 Max berlabel '$2.00 / $6.00 · lisensi komersial · konteks 1M' — dipisahkan oleh ikon keseimbangan dan footer 'Tiga kali harganya, empat poin kecerdasan — mana yang bertahan saat bersentuhan dengan tagihan Anda?'
Guides & Insights

DeepSeek V4 Pro vs Qwen3.8 Max: Selisih Harga 3x, Dijalankan Ulang Setelah Penangguhan September

Penulis

Rowan Sterling

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

DeepSeek V4 Pro dan Qwen3.8 Max adalah dua flagship open-source atau murah paling penting dari generasi ini, dan peristiwa September di sisi DeepSeek mengubah pertarungan itu lebih dari yang diakui pemasaran kedua vendor. DeepSeek V4 Pro dirilis pada 13 Agustus 2026, sepuluh hari setelah Qwen3.8 Max dari Alibaba tersedia secara umum pada 3 Agustus, dan pasangan ini selalu tampak sebagai kontes sepihak: Qwen3.8 Max adalah all-rounder berparameter 2,4 triliun dengan harga $2 per juta token input dan $6 per juta token output, sedangkan DeepSeek V4 Pro adalah spesialis penalaran berparameter 1,6 triliun dengan harga sebagian kecil dari itu, berlisensi MIT, dengan bobot publik. Alasan perbandingan ini layak dijalankan ulang hari ini bukanlah angka-angka minggu peluncuran, melainkan apa yang terjadi sebulan kemudian — DeepSeek menghabiskan pekan 8 September untuk mencoba menghentikan V4 Pro, lalu berbalik pada 11 September dan berkomitmen untuk tetap menjalankannya secara online dengan penagihan yang tidak berubah. Pembalikan itu adalah fakta tunggal terpenting tentang pertarungan ini saat ini, karena hal itu menentukan apakah separuh yang murah merupakan taruhan yang aman atau jebakan migrasi.

Pengukuran independen dalam tulisan ini berasal dari Artificial Analysis, yang diambil hari ini. Tabel benchmark milik Aliba​ba dan Deep​Seek sendiri dilabeli sebagai laporan vendor di seluruh artikel ini — angka peluncuran dari kedua perusahaan belum sepenuhnya direproduksi oleh pihak ketiga, dan angka Deep​Seek kini sudah berusia empat minggu, berhadapan dengan papan skor yang terus bergerak.

Kelonggaran September adalah ceritanya, bukan peluncuran Agustus

Pada 8 September, DeepSeek mengumumkan bahwa setelah 14 September setiap permintaan ke deepseek-v4-pro akan dialihkan ke V4.1 Flash dan ditagih dengan harga Flash sampai V4.1 Pro dirilis. Siapa pun yang menjalankan Qwen3.8 Max versus DeepSeek V4 Pro sebagai perbandingan serius harus mulai merencanakan hilangnya opsi murah itu. Kemudian DeepSeek menunda batas waktu tersebut, dan pada 11 September membalikkannya sepenuhnya, menyatakan akan terus menyediakan layanan API untuk DeepSeek V4 Pro setelah 14 September dengan penagihan tidak berubah, dan akan memberi pemberitahuan jika hal itu pernah berubah. Pembalikan itu dilaporkan oleh media negara dan pers teknologi Tiongkok pada hari yang sama.

Dampaknya terhadap pertarungan ini adalah menghilangkan asimetri yang diam-diam mengarahkan keputusan. Sepanjang minggu pertama September, jawaban jujur untuk "haruskah saya membangun di atas model output $0.66 atau model output $6?" terus terkontaminasi oleh risiko kelangsungan hidup: pemimpin harga punya tanggal penghentian. Per 15 September, kontaminasi itu sudah hilang. Opsi murah itu tahan lama, dan perbandingannya akhirnya tentang hal yang memang selalu seharusnya menjadi fokus — kecerdasan, harga, dan kecepatan.

A generated scoreboard titled 'DeepSeek V4 Pro vs Qwen3.8 Max — the scoreboard': left column DeepSeek V4 Pro rows AA Index 36 (#7/113), Price $0.66/$1.98 off-peak, Speed ~81 tok/s, Context 1M, License MIT open weights, Input text; right column Qwen3.8 Max rows AA Index 40 (#30/200), Price $2.00/$6.00, Speed ~41 tok/s, Context 1M, License Commercial, Input text + image + video; footer 'AA figures independent (current scale); DeepSeek price is vendor list off-peak.'

Harga: game yang sama, dengan sebagian kecil dari biaya output

Pada papan skor independen saat ini, keduanya terpaut empat poin, dan selisih harga di antara keduanya adalah yang terbesar di tier open-weights. Qwen3.8 Max adalah $2,00 per juta token masukan dan $6,00 per juta token keluaran pada harga daftar Alibaba, dengan diskon cache 88%. DeepSeek V4 Pro adalah $0,66 per juta token masukan dan $1,98 per juta token keluaran di luar jam sibuk, berlipat ganda menjadi $1,32/$3,96 pada jam sibuk, dengan diskon cache 97%.

• Harga — DeepSeek V4 Pro $0.66/$1.98 per 1 juta di luar jam sibuk (jam sibuk $1.32/$3.96) vs Qwen3.8 Max $2.00/$6.00 tetap

• Indeks Kecerdasan — V4 Pro 36 (#7/113) vs Qwen3.8 Max 40 (#30/200)

• Kecepatan output — V4 Pro ~81 token/detik vs Qwen3.8 Max ~41 token/detik

• Biaya per tugas — V4 Pro $0,67 vs Qwen3.8 Max $2,67 (per tugas indeks AA)

• Konteks — keduanya 1 juta token

• Lisensi — V4 Pro dengan bobot terbuka MIT vs Qwen3.8 Max dengan bobot proprietary, lisensi komersial

Rasio harga output adalah inti dari seluruh argumen ini: Qwen3.8 Max berbiaya tiga kali lipat per token input dan sekitar tiga kali lipat per token output pada tarif puncak V4 Pro — dan selisih pada output melebar menjadi enam kali lipat ketika V4 Pro ditagih pada tarif luar puncaknya, yang mencakup sebagian besar hari dalam seminggu di luar jendela waktu yang sempit. Pada beban kerja yang berat penalaran, tempat token output mendominasi tagihan, selisih itu adalah pembeda antara model yang bisa Anda biarkan terus berjalan dan model yang harus Anda pantau di dasbor. Lini cache memperlebarnya lebih jauh: diskon 97% milik V4 Pro dibandingkan 88% milik Qwen berarti tugas konteks panjang dengan prefiks yang digunakan ulang hanya berbiaya sebagian kecil dari harga daftarnya di sisi DeepSeek.

Kecerdasan: terpaut empat poin, dan selisih itulah produk sesungguhnya

Papan skor independen membuat ini lebih dekat daripada yang disarankan oleh rasio harga. Pada Indeks Kecerdasan Artificial Analysis saat ini, Qwen3.8 Max mendapat skor 40 berbanding 36 milik DeepSeek V4 Pro — selisih empat poin yang muncul dalam pekerjaan yang berat penalaran tetapi menghilang dalam pekerjaan yang berat token. Keunggulan Qwen3.8 Max nyata dan konsisten: ia berada di peringkat #30 dari 200 secara keseluruhan, tepat di dalam garis depan, sementara V4 Pro berada di peringkat #7 dari 113 di kelas bobot terbukanya. Pada tabel tolok ukur Alibaba sendiri, Qwen3.8 Max mengklaim Terminal-Bench 2.1 sebesar 86,6, GPQA Diamond 92,6, dan FrontierSWE 73,5 yang hampir dua kali lipat dari 40,7 milik pendahulunya — semuanya dilaporkan vendor, tidak ada yang direproduksi secara independen. Kartu model DeepSeek mengklaim peringkat Codeforces sebesar 3.348 dan Terminal-Bench 2.1 sebesar 87,9 pada upaya penalaran maksimum — juga dilaporkan vendor dan belum diverifikasi oleh pihak ketiga.

Kerangka yang jujur adalah bahwa kedua perusahaan itu saling berdebat tanpa benar-benar bersinggungan. Tabel vendor Qwen3.8 Max dibangun untuk kebutuhan kerja perusahaan dan ilmiah — penyegaran 0902 yang dikirim Alibaba pada 2 September dilatih lanjut (post-training) pada Coding dan Cowork, yang menurut Qwen justru memperkuat profil tersebut. Klaim DeepSeek V4 Pro sendiri berpusat pada penalaran mendalam dan penggunaan alat agentic, di mana angka Codeforces dan Terminal-Bench-nya yang berumur empat minggu masih terlihat kuat. Tidak ada tabel vendor mana pun yang telah direproduksi oleh evaluator independen, dan pada satu-satunya papan skor yang independen, selisih empat poin itulah keseluruhan perbedaan antara kedua model.

Kecepatan adalah titik di mana Qwen3.8 Max diam-diam kehilangan keunggulan

Dimensi yang disembunyikan lembar spesifikasi adalah kecepatan keluaran. Artificial Analysis mengukur DeepSeek V4 Pro sekitar 81 token per detik berbanding Qwen3.8 Max yang kira-kira 41 — perbedaan dua kali lipat dalam seberapa cepat jawaban kembali. Pada beban kerja chat, itu jeda yang pengguna sadari; pada loop agen dengan banyak panggilan berurutan, hal itu menumpuk menjadi waktu nyata. Rasio harga sudah menguntungkan V4 Pro, dan selisih kecepatan membuat selisih biaya efektif per jawaban bahkan lebih lebar daripada yang disiratkan oleh perhitungan token.

Ada trade-off yang terkubur dalam angka itu, dan itu adalah verbositas Qwen3.8 Max. Artificial Analysis mencatat bahwa model tersebut "lambat secara mencolok dan sangat bertele-tele," dan biaya per tugasnya — $2.67 dibandingkan dengan $0.67 milik V4 Pro — mencerminkan tarif yang lebih tinggi sekaligus token keluaran tambahan. Model penalaran yang menulis lebih banyak per jawaban akan memakan biaya lebih besar per tugas bahkan sebelum Anda mengalikannya dengan rate card. Jika beban kerja Anda sensitif terhadap latensi atau loop agen Anda melakukan puluhan panggilan, itulah angka yang perlu Anda uji dengan eval Anda sendiri.

Bobot: MIT versus lisensi komersial

DeepSeek V4 Pro berlisensi MIT dengan bobot publik — Anda dapat mengunduhnya, menyajikannya sendiri, menyempurnakannya, dan tetap menutup modifikasi Anda. Qwen3.8 Max adalah Qwen kelas Max pertama yang dirilis dengan bobot terbuka (checkpoint 2.4T A95B hadir pada 12 Agustus), tetapi di bawah lisensi komersial dengan ketentuan tingkat skala, dan Alibaba belum menerbitkan tumpukan inferensi lengkap seperti yang dilakukan DeepSeek. Bagi perusahaan yang membandingkan keduanya, cerita penerapan adalah penentunya: V4 Pro dapat dihosting sendiri sebagai infrastruktur; Qwen3.8 Max pada dasarnya adalah layanan yang Anda sewa. Perbedaan bobot paling penting jika kekhawatiran Anda adalah keterikatan vendor atau jika Anda ingin sepenuhnya lepas dari harga API.

Siapa yang harus memilih yang mana

Jika beban kerja Anda berat dalam penalaran, didominasi token keluaran, atau sensitif terhadap latensi, DeepSeek V4 Pro adalah jawabannya pada hampir setiap sumbu yang muncul dalam tagihan: sekitar tiga hingga enam kali lebih murah untuk keluaran, sekitar dua kali lebih cepat, diskon cache yang lebih besar, dan bobot MIT sebagai jalan keluar. Kesenjangan kecerdasan empat poin itu nyata tetapi sempit, dan jarang bertahan saat bersentuhan dengan perbedaan harga pada lalu lintas produksi.

Jika beban kerja Anda berbentuk enterprise — analisis multi-langkah yang kompleks, penurunan logika yang mendalam, pekerjaan agentic yang menuntut, atau tugas apa pun yang kualitas jawaban marginalnya bernilai tiga hingga enam kali biaya token — empat poin tambahan Qwen3.8 Max pada indeks independen dan klaim benchmark enterprise-nya yang lebih kuat adalah alasan untuk membayar premi. Penyegaran 0902 semakin mempertajam profil tersebut. Dan jika Anda membutuhkan input gambar atau video, pilihannya tidak perlu diragukan lagi: Qwen3.8 Max menerima teks, gambar, dan video, sedangkan DeepSeek V4 Pro hanya teks.

Kedua model dapat dipanggil melalui OrcaRouter dengan satu kunci — DeepSeek V4 Pro dan Qwen3.8 Max keduanya dirutekan melalui platform — dan karena OrcaRouter meneruskan harga daftar penyedia tanpa markup, angka dalam artikel ini adalah angka yang benar-benar Anda bayar, dengan pemotongan harga vendor berlaku pada hari yang sama. DSL perutean memungkinkan Anda mengirim lalu lintas yang berat token atau sensitif latensi ke DeepSeek V4 Pro dan tugas multimodal atau penalaran dengan taruhan tertinggi ke Qwen3.8 Max dari integrasi yang sama — yang persisnya adalah cara sebagian besar tim akhirnya menggunakan pasangan ini: keduanya, untuk hal yang paling baik dilakukan masing-masing.

A screenshot of the Artificial Analysis page for Qwen3.8 Max, captured September 15, 2026, showing the Intelligence Index score of 40 at rank 30 of 200, output speed 40.6 tokens per second, an input price of $2.00 and output price of $6.00 per million tokens with an 88% cache discount, and a cost of $2.67 per Intelligence Index task.A screenshot of the OrcaRouter model page for Qwen3.8 Max at orcarouter.ai/models/qwen/qwen3.8-max, captured September 15, 2026, showing the model listing with its provider Qwen, 1M-token context window, text+image+video input, and $2.00/$6.00 per-million-token pricing alongside the surrounding catalogue.

Putusan

Penangguhan September menjawab pertanyaan yang selama ini menenggelamkan duel ini: opsi murah tidak lagi berisiko menghilang. DeepSeek V4 Pro adalah jawaban biaya-kinerja — tiga hingga enam kali lebih murah untuk output, dua kali lebih cepat, berlisensi MIT, dan kini berkomitmen untuk tetap online. Qwen3.8 Max adalah jawaban kemampuan — unggul empat poin indeks independen, klaim enterprise yang lebih kuat, input multimodal, dan lisensi komersial yang menghalanginya masuk ke stack Anda. Pilih empat poin itu ketika evaluasi Anda membuktikan bahwa itu penting; pilih harga ketika tagihan Anda adalah evaluasi yang benar-benar menentukan.

Kirim lalu lintas yang berat token atau sensitif terhadap latensi ke DeepSeek V4 Pro dan penalaran multimodal atau paling berisiko tinggi ke Qwen3.8 Max dari integrasi yang sama — yang persis seperti cara sebagian besar tim akhirnya menggunakan pasangan ini: keduanya, untuk hal yang paling dikuasai masing-masing.

Dibandingkan dalam artikel ini1

Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari