
DeepSeek V4 Pro vs Qwen3.8 Max: Spesialis Penalaran vs Serba Bisa Asal China
- AlibabaBARUQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token
- z-aiBARUZ.ai: GLM 5.3 Flash2026-08-2658Kecerdasan72Koding
- DeepSeekBARUDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 per 1 juta token
- z-aiZ.ai: GLM 5.32026-08-1860Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1552Kecerdasan68Koding
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1261Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0557Kecerdasan72Koding
- qwenQwen: Qwen3.8 Max2026-08-0358Kecerdasan72Koding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Kecerdasan69Koding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 juta token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Kecerdasan78Koding
- googleGoogle: Gemini 3.6 Flash2026-07-2152Kecerdasan69Koding
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Kecerdasan49Koding
- metaMeta: Muse Spark 1.12026-07-1653Kecerdasan71Koding
- kimiMoonshotAI: Kimi K32026-07-1560Kecerdasan76Koding
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Kecerdasan71Koding
Dalam rentang sepuluh hari, dua model yang paling banyak diperhatikan di Tiongkok diluncurkan: Alibaba merilis Qwen3.8 Max pada 3 Agustus 2026 — andalan sparse-MoE dengan 2,4 triliun parameter yang disebutnya serba bisa untuk agen, pekerjaan kantor, dan pemahaman multimodal — dan DeepSeek mengirimkan versi resmi dari DeepSeek V4 Pro pada 12 Agustus, spesialis penalaran dan pengodean dengan total 1,6 triliun parameter dan label harga yang kira-kira sepertujuh dari harga Qwen untuk token keluaran. Keduanya menyasar kantong pengembang yang sama, tetapi berbeda pandangan tentang tujuan sebuah model andalan. Qwen3.8 Max ingin menjadi satu model yang Anda gunakan untuk semua hal; DeepSeek V4 Pro ingin menjadi satu model yang Anda gunakan untuk hal-hal sulit.

Poin-poin penting
• Qwen3.8 Max adalah model dengan kapabilitas mentah yang lebih tinggi pada papan peringkat umum Tiongkok (SuperCLUE #1, Juli) dan paket multimodal/perusahaan yang lebih kuat — input video, alat bawaan, keluaran terstruktur, semuanya dalam satu API.
• DeepSeek V4 Pro jauh lebih murah secara drastis (~7× untuk output), sudah memiliki bobot yang terbuka, dan kini memegang klaim coding/agentic yang lebih tinggi — Terminal-Bench 2.1 dengan skor 87.9 berbanding 86.6 yang dilaporkan vendor Qwen.
• Perhatikan biaya verbositas: proses independen menunjukkan Qwen3.8 Max rata-rata ~64 putaran dan ~$1,14 per tugas agentik — masalah biaya efektif yang disembunyikan lembar spesifikasi.
• Judul yang jujur: Qwen3.8 Max adalah "perang kapabilitas" yang menyamai harga model tertutup AS; DeepSeek V4 Pro adalah bantahan dari segi harga-terhadap-kinerja.
Dua filosofi dalam satu tabel spesifikasi
• Total parameter — Qwen3.8 Max 2.4T (sparse MoE, ~95B aktif) vs DeepSeek V4 Pro 1.6T (MoE, ~49B aktif)
• Konteks / output maksimum — keduanya konteks 1M; Qwen mencapai maksimum sekitar 128–131K output vs 384K milik DeepSeek.
• Input — Qwen menerima teks, gambar, dan video; DeepSeek V4 Pro menerima teks dan gambar, dengan penalaran gambar native baru di build resmi
• Bobot terbuka — DeepSeek V4 Pro: dirilis (MIT); Qwen3.8 Max: dijanjikan untuk pekan 10 Agustus, Qwen kelas Max pertama yang pernah dirilis sebagai sumber terbuka.
• Ekstra API — Qwen menyediakan alat bawaan dan output terstruktur secara langsung; DeepSeek V4 Pro menyediakan toggle berpikir, JSON terstruktur, API Responses, dan kompatibilitas Codex
• Harga — Qwen3.8 Max $2.00 / $6.00 per juta token ($0.25 cache) vs DeepSeek V4 Pro ~$0.42 / $0.87 ($0.0035 cache)

Di mana Qwen3.8 Max unggul
Pada sumbu generalis, Qwen3.8 Max unggul dan data independen setuju. Artificial Analysis menempatkannya pada Indeks Intelijen 58, Indeks Pengodean 71.8, dan Indeks Agentik 58 — yang terdekat yang pernah dicapai laboratorium Tiongkok mana pun ke puncak papan peringkat agentik tersebut. Pada peringkat berbahasa Mandarin SuperCLUE edisi Juli, ia menempati #1 dengan skor 71.48 sementara DeepSeek-V4-Pro berada di #5 dengan 64.4. Demo peluncuran Alibaba — sesi pengodean otonom 16 hari, serta reproduksi makalah yang mengalahkan hasil AIME24 dari makalah asli — adalah bukti terkuat di seluruh siklus rilis bahwa ini adalah agen jangka panjang yang benar-benar mumpuni.
Bagi seorang pengembang, keunggulan praktisnya berbentuk integrasi: input video, pemanggilan alat bawaan, keluaran terstruktur tanpa konfigurasi, dan ekosistem (Model Studio, toolchain Qwen) yang tidak coba ditandingi oleh DeepSeek. Jika beban kerjanya berat pada dokumen, multimodal, atau membutuhkan cerita integrasi perusahaan, Qwen3.8 Max adalah model yang saat ini menjadi default pasar Tiongkok.
Di mana DeepSeek V4 Pro unggul
Dalam hal pengodean dan biaya, V4 Pro resmi menjadi sanggahannya. DeepSeek melaporkan build resmi pada 87.9 di Terminal-Bench 2.1 (naik dari 72.1 pada preview) dan 62.7 di DeepSWE — melawan 86.6 Terminal-Bench yang dilaporkan vendor Qwen. Preview tersebut sebelumnya sudah memiliki 80.6 SWE-bench Verified, 90.1 GPQA Diamond, dan 93.5 LiveCodeBench, skor pemrograman kompetitif model terbuka #1, dan perubahan pada build resmi justru terkonsentrasi tepat pada tugas-tugas agentic dan penalaran yang diukur oleh angka-angka tersebut.
Lalu ada soal harga. Dengan $0.42/$0.87 per juta token, DeepSeek V4 Pro sekitar 4.8× lebih murah untuk input dan 6.9× lebih murah untuk output dibandingkan $2/$6 milik Qwen3.8 Max. DeepSeek juga menyatakan pada 6 Agustus bahwa akan ada kenaikan harga, yang menjadikan tarif hari ini sebagai peluang, bukan janji — lebih lanjut di bawah ini.

Lakukan perhitungan pada tugas agen yang sesungguhnya.
Operasi agen independen adalah tempat harga label Qwen berhenti menjadi harga sebenarnya. Pada tugas agen Artificial Analysis, Qwen3.8 Max rata-rata ~64 giliran per tugas dan menghabiskan biaya ~$1,14 per tugas, dibandingkan ~$0,53 untuk generasi sebelumnya — modelnya bertele-tele dan banyak merencanakan. Jalankan bentuk tugas yang sama pada DeepSeek V4 Pro dengan $0,87 per juta output dan biaya per tugasnya menjadi sekitar satu orde magnitudo lebih rendah. Jika produk Anda adalah sebuah loop yang memanggil model seratus kali sehari per pengguna, selisih tersebut adalah margin Anda.
Peringatan keandalan di kedua sisi
Kejujuran sumber daya berlaku dua arah di sini. Pengujian independen menandai tingkat halusinasi Qwen3.8 Max yang naik dari 23% menjadi 40% dan skor AA-Omniscience turun sepuluh poin — model tersebut menjadi lebih cakap tetapi kurang dapat dipercaya dalam rilis yang sama. Pratinjau DeepSeek membawa tingkat jawaban-selalu 94% yang terdokumentasi pada AA-Omniscience, artinya model tersebut cenderung menghasilkan jawaban baik saat mengetahuinya maupun tidak. Kedua tanda ini penting untuk produksi; tidak ada yang mendiskualifikasi untuk beban kerja yang menjadi sasaran model-model ini.
Mengapa waktu open-weights mengubah perhitungan harga
Rilis open-weights Qwen3.8 Max, ketika diluncurkan, akan mengubah ekonomi pertarungan ini dalam seminggu — pengguna self-host mendapat flagship 2.4T, dan tekanan harga API akan terasa nyata. Ini adalah skenario yang tepat di mana model harga pass-through menjaga Anda tetap jujur. OrcaRouter meneruskan harga daftar penyedia tanpa markup, jadi begitu Alibaba atau DeepSeek mengubah harga — naik atau turun — perubahan itu langsung aktif pada satu kunci di hari yang sama, tanpa negosiasi ulang dan tanpa kontrak kedua untuk dibaca. Anda merutekan ke Qwen3.8 Max atau DeepSeek V4 Pro mana pun yang disukai evaluasi Anda saat ini, dan harganya tetap sesuai yang sebenarnya dibebankan vendor.
Yang mana untuk keputusan API builder Anda?
Pilih Qwen3.8 Max saat pekerjaan membutuhkan seluruh permukaan — input multimodal, output terstruktur, alat bawaan, kualitas bahasa Tionghoa di puncak peringkat saat ini — dan model biaya Anda toleran terhadap proses agen yang bertele-tele. Pilih DeepSeek V4 Pro saat tugasnya berat pada penalaran atau pengodean, volume token tinggi, bobot terbuka penting untuk kepatuhan atau hosting mandiri, atau garis anggaran menjadi kendala yang mengikat. Interpretasi paling lugas dari perbandingan ini adalah yang disinyalkan oleh kedua perusahaan itu sendiri: Qwen3.8 Max adalah andalan yang menjadi patokan segalanya, dan DeepSeek V4 Pro adalah yang membuat tolok ukur itu terlihat mahal.
Dibandingkan dalam artikel ini2
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
