Qwen 3.8 vs Kimi K3: Dua Raksasa Open-Weight China, Berhadapan Langsung
Guides & Insights

Qwen 3.8 vs Kimi K3: Dua Raksasa Open-Weight China, Berhadapan Langsung

Penulis

jinhao song

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Dari semua model yang dibandingkan dengan Qwen 3.8 Max, Kimi K3 dari Moonshot adalah rival yang paling alami: keduanya adalah model Mixture-of-Experts China yang sangat besar, keduanya berkelas bobot terbuka, keduanya terkenal verbose, teliti, dan lambat. Mereka sebenarnya adalah dua raksasa terbesar dari dunia bobot terbuka China — dan yang tidak biasa, kita tidak perlu menebak bagaimana mereka dibandingkan, karena seseorang menjalankan mereka secara berhadapan pada tugas yang sama. Hal itu menjadikan ini perbandingan terkaya dalam seri ini: bukan klaim vendor melawan angka yang diaudit, tetapi satu head-to-head yang asli.

Sebelum detailnya, catatan untuk para pembangun — cara jujur untuk menyelesaikan persaingan yang begitu ketat adalah dengan menjalankan keduanya pada beban kerja Anda sendiri dan mengamati pertukaran antara ketelitian dan kecepatan. OrcaRouter menyediakan lebih dari 200 model di belakang satu titik akhir yang kompatibel dengan OpenAI, sehingga Anda dapat mempertemukan Qwen 3.8 melawan Kimi K3 pada prompt yang sama tanpa perlu menyambungkan dua SDK.

TL;DR kesimpulan. Dalam satu perbandingan head-to-head langsung yang kami miliki (Trilogy AI, tugas pemahaman arsitektur), Kimi K3 mencetak 83/100 dan Qwen 3.8 Max 80/100 — selisih tipis 3 poin untuk Kimi. Namun Qwen adalah yang lebih *teliti*: 354 sitasi repositori vs 274, 22 permintaan gateway vs 53, dan nol panggilan alat yang gagal vs dua, dengan konsekuensi latensi yang lebih tinggi dan lebih banyak token. Keduanya mencapai cache hit 90% dan mencapai keputusan arsitektur inti yang sama. Saat ini Kimi K3 adalah pilihan bobot terbuka yang lebih aman — ia memiliki skor yang diaudit (57.1, #3 di Artificial Analysis), mahkota frontend Arena, dan bobot yang pada dasarnya sudah tersedia. Qwen 3.8 adalah yang perlu diperhatikan: lebih besar dalam ambisi, lebih mendalam dalam eksplorasi, tetapi tidak mendapat skor di papan publik dengan bobot yang hanya "coming soon."

Poin-poin penting

Qwen 3.8 Max adalah sebuah MoE dengan parameter 2.4T pratinjau; Kimi K3 adalah MoE 2.8T dengan konteks 1M dan visi native — yang berarti Qwen kira-kira lebih kecil 400B parameter, sebuah pengingat bahwa jumlah parameter yang lebih besar tidak berarti lebih baik.

•  Dalam satu-satunya pengujian langsung (Trilogy AI), Kimi K3 mengungguli Qwen 80 hingga 83 secara keseluruhan — tetapi Qwen membuat lebih banyak kutipan repositori (354 vs 274), lebih sedikit permintaan gateway (22 vs 53), dan memiliki nol panggilan alat yang gagal (vs dua).

•  Kimi K3 memiliki audited AA Intelligence Index sebesar 57.1 (#3) — di belakang Fable 5 dan GPT-5.6 Sol, di depan yang lainnya. Qwen 3.8 memiliki ketiadaan tolok ukur independen sama sekali.

•  Kimi K3 juga memegang posisi #1 frontend-code LMArena (1679); Qwen 3.8 belum mendapat skor di papan peringkat publik.

• Keterbukaan hampir setara tetapi waktunya berbeda: bobot Kimi K3 terbuka/dijanjikan dan pada dasarnya siap; Qwen 3.8 'segera hadir' tanpa tanggal, lisensi, atau repositori belum.

Angka-angka Qwen 3.8 adalah klaim vendor atau kesan langsung awal yang tidak terkendali — tidak diaudit secara independen. Angka indeks dan harga Kimi K3 diatribusikan ke Artificial Analysis dan mungkin berbeda dari laporan Moonshot sendiri. Perbandingan head-to-head Trilogy AI adalah satu tugas, bukan rangkaian tolok ukur lengkap. Harga pratinjau Qwen 3.8 adalah diskon sementara; verifikasi tarif sebelum menganggarkan.

Spesifikasi dan harga, berdampingan

Ini adalah data keras, setiap angka pesaing dikaitkan dengan sumbernya.

•  Pembuat / status — Qwen 3.8 Max: Alibaba; pratinjau (19 Juli 2026); Kimi K3: Moonshot; rilis open-weight

• Arsitektur — Qwen 3.8 Max: ~2.4T total, MoE jarang (parameter aktif tidak diungkapkan); Kimi K3: 2.8T MoE, visi asli (sumber: Artificial Analysis)

•  Jendela konteks — Qwen 3.8 Max: Dilaporkan ~1M token (belum dikonfirmasi secara resmi); Kimi K3: 1M token (sumber: Artificial Analysis)

•  AA Intelligence Index — Qwen 3.8 Max: Belum ada — belum dinilai; Kimi K3: 57.1 — #3 (Artificial Analysis)

• Arena / papan peringkat — Qwen 3.8 Max: Tidak dinilai secara publik; Kimi K3: Kode frontend #1, 1679 (LMArena)

• Harga (masuk/keluar) — Qwen 3.8 Max: Hanya pratinjau (diskon ~90%; API per token tidak dipublikasikan); Kimi K3: $3 / $15 per 1M (AA blended ~$2.31)

• Bobot terbuka — Qwen 3.8 Max: Dijanjikan "segera" (belum dirilis); Kimi K3: Bobot terbuka; bobot siap/dekat

•  Kecepatan — Qwen 3.8 Max: Model paling lambat yang diuji (langsung); Kimi K3: Bertele-tele dan lambat (~34s TTFT, per AA)

Dua hal membingkai seluruh perbandingan ini. Pertama, sel kosong "AA Intelligence Index" untuk Qwen 3.8 adalah ceritanya: skor 57.1 Kimi K3 adalah putusan wasit netral yang menempatkannya di peringkat #3 dunia, di belakang hanya Fable 5 dan GPT-5.6 Sol; posisi Qwen 3.8 bergantung pada pembingkaian vendor dan segelintir pengujian langsung. Kedua, perhatikan inversi ukuran — Qwen 3.8 (2.4T) sebenarnya sekitar 400B parameter lebih kecil dibandingkan Kimi K3 (2.8T). Model Alibaba adalah yang digambarkan orang sebagai "lebih besar dalam ambisi," tetapi berdasarkan jumlah parameter mentah, Kimi adalah raksasa yang lebih besar, dan dialah yang memiliki skor teraudit untuk mendukungnya. Keduanya terkenal verbose dan lambat, sehingga latensi tidak signifikan; pemisah yang sebenarnya adalah bukti dan ketersediaan bobot, dan hari ini keduanya menguntungkan Kimi.

Satu-satunya adu langsung yang sesungguhnya yang kita miliki

Ini adalah pertandingan langka di mana kita tidak perlu menyimpulkan. Trilogy AI menjalankan kedua model pada satu tugas pemahaman arsitektur — membaca dan menalar tentang basis kode nyata — dan menerbitkan perbandingan berdampingan. Kimi K3 menang pada skor utama, tetapi perilaku yang mendasarinya menceritakan kisah yang lebih menarik.

•  Skor keseluruhan — Qwen 3.8 Max: 80 / 100; Kimi K3: 83 / 100

• Kutipan repositori — Qwen 3.8 Max: 354; Kimi K3: 274

•  Permintaan gateway — Qwen 3.8 Max: 22; Kimi K3: 53

• Panggilan alat gagal — Qwen 3.8 Max: 0; Kimi K3: 2

•  Peringkat penggunaan alat — Qwen 3.8 Max: 9 / 10; Kimi K3: 8 / 10

• Tingkat cache hit — Qwen 3.8 Max: >90%; Kimi K3: >90%

Baca kolomnya, bukan hanya baris teratas. Kimi K3 memenangkan kemenangan 3 poin, tetapi Qwen 3.8 adalah pekerja yang lebih teliti: ia mengutip 80 tempat lagi di repositori (354 vs 274), mencapai kesimpulannya dalam jauh lebih sedikit permintaan gateway (22 vs 53), membuat nol panggilan alat yang gagal untuk dua milik Kimi, dan mengungguli Kimi dalam peringkat penggunaan alat (9 vs 8). Trade-off-nya persis seperti yang Anda harapkan dari karakter Qwen di tempat lain — ia menjelajah secara ekshaustif, yang mengakibatkan latensi lebih tinggi dan token total lebih banyak. Yang penting, kedua model mencapai keputusan arsitektur inti yang sama, jadi ini bukan satu yang benar dan satu yang salah; ini adalah Kimi yang mendapatkan jawaban dengan nilai sedikit lebih tinggi lebih cepat, dan Qwen yang sampai di sana dengan lebih banyak bukti dan disiplin alat yang lebih bersih. Jika pekerjaan Anda menghargai eksplorasi yang ekshaustif dan terkurasi dengan baik, profil Qwen menarik; jika Anda menginginkan opsi yang terbukti dan lebih cepat menuju jawaban, Kimi yang memenangkan ronde ini.

FAQ

Apakah Qwen 3.8 lebih baik daripada Kimi K3?

Bukan berdasarkan bukti yang ada saat ini. Dalam satu perbandingan langsung (Trilogy AI), Kimi K3 mendapat skor 83/100 dibandingkan Qwen 80/100, dan Kimi memiliki Artificial Analysis Index yang diaudit sebesar 57,1 (#3) ditambah mahkota frontend-code Arena, sementara Qwen 3.8 tidak memiliki skor independen sama sekali. Keunggulan Qwen adalah ketelitian — lebih banyak kutipan repositori (354 vs 274), lebih sedikit permintaan gateway, dan nol panggilan alat yang gagal — tetapi itu adalah keunggulan gaya, bukan keunggulan kemampuan yang terbukti.

Qwen 3.8 lebih besar — apakah itu membuatnya lebih baik?

Tidak, dan sebenarnya sebaliknya dalam hal ukuran: Qwen 3.8 memiliki ~2,4T parameter dibandingkan Kimi K3 yang ~2,8T, jadi Kimi adalah yang lebih besar dari keduanya sekitar 400B. Jumlah parameter yang lebih besar tidak berarti lebih baik — Kimi lebih besar dan mendapat skor lebih tinggi, yang merupakan pengingat yang jelas bahwa arsitektur, pelatihan, dan penyesuaian lebih penting daripada total parameter mentah.

Bagaimana perbandingan harga?

Kimi K3 adalah model yang dipublikasikan dan tahan lama $3 / $15 per 1M token (Artificial Analysis menggabungkannya menjadi sekitar $2,31). Pratinjau Qwen 3.8 mendapat diskon besar (~90% off) tetapi tidak memiliki harga API per token yang dipublikasikan dan diskon tersebut bersifat sementara, sehingga perbandingan harga yang stabil belum memungkinkan. Untuk penganggaran hari ini, Kimi adalah satu-satunya yang memiliki angka nyata.

Manakah pilihan open-weight yang lebih baik?

Keduanya adalah kelas bobot terbuka, tetapi waktu peluncurannya berbeda. Bobot Kimi K3 sudah terbuka dan pada dasarnya siap; bobot Qwen 3.8 dijanjikan "segera hadir" tanpa tanggal, lisensi, atau repositori yang dipublikasikan. Jika bobot terbuka adalah alasan Anda memilih salah satunya, Kimi adalah pilihan yang dapat Anda ambil sekarang.

Yang mana yang harus saya gunakan hari ini?

Kimi K3 adalah default yang lebih aman — ia mendapat skor (#3), bobotnya sudah siap, dan ia memenangkan head-to-head. Pilih Qwen 3.8 ketika Anda menghargai eksplorasi yang menyeluruh dan terkurasi dengan baik serta penggunaan alat yang bersih daripada kecepatan, dan anggap sebagai yang perlu diperhatikan ketika bobotnya dirilis dan skor independen tiba.

Intinya

Qwen 3.8 vs Kimi K3 adalah hal terdekat yang dimiliki seri ini dengan pertarungan yang adil: dua raksasa open-weight asal China, keduanya verbose, keduanya teliti, keduanya lambat. Kimi K3 memenangkan ronde hari ini karena ia memenangkan hal-hal yang menentukan adopsi — peringkat #3 yang diaudit, mahkota frontend Arena, harga yang dipublikasikan, dan bobot yang sudah siap — dan ia mengungguli Qwen 80 berbanding 83 dalam satu head-to-head yang nyata. Namun head-to-head itu juga menunjukkan mengapa Qwen 3.8 layak diperhatikan: ia adalah model yang lebih teliti, mengutip lebih banyak basis kode, menggunakan lebih sedikit permintaan, dan tidak melakukan panggilan alat yang gagal. Jika eksplorasi menyeluruh adalah yang dihargai oleh pekerjaan Anda, dan jika Alibaba mengirimkan bobot dan skor independen mencapai posisi atas, persaingan ini bisa berbalik. Sampai saat itu, Kimi K3 adalah pilihan open-weight yang lebih aman, dan Qwen 3.8 adalah penantang yang harus diuji dengan prompt Anda sendiri.


© 2026 OrcaRouter

Untuk Penyedia

Mengoperasikan platform inferensi? Hadirkan model Anda di OrcaRouter.

Hubungi kami

Gabung komunitas kami

DiscordEmailXGitHubYouTube