
Qwen 4 Max diumumkan di Apsara 2026: apa yang dikonfirmasi Alibaba, dan apa yang tidak
- OrcaBARUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 per 1 juta token
- orcaBARUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 per 1 juta token
- deepseekBARUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Kecerdasan
- openaiOpenAI: GPT-6 Astra2026-09-0453Kecerdasan77Koding
- googleGoogle: Gemini 3.8 Flash2026-09-0241Kecerdasan76Koding
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Kecerdasan76Koding
- anthropicAnthropic: Claude Fable 5.12026-09-0153Kecerdasan82Koding
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 juta token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Kecerdasan72Koding
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 per 1 juta token
- z-aiZ.ai: GLM 5.32026-08-1845Kecerdasan75Koding
- obsidianQwen3.8 27B2026-08-1534Kecerdasan68Koding
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Kecerdasan69Koding
- grokSpaceXAI: Grok 4.62026-08-1244Kecerdasan77Koding
- metaMeta: Muse Spark 1.22026-08-0540Kecerdasan72Koding
- qwenQwen: Qwen3.8 Max2026-08-0345Kecerdasan76Koding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Kecerdasan69Koding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 juta token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Konferensi Yunqi di Hangzhou — Apsara Conference — digunakan pada 22 September 2026 untuk memperlihatkan empat model yang belum dirilis. Kepala LLM laboratorium tersebut, Liu Da Yiheng, menampilkan pratinjau Qwen 4 Max, Qwen 4 Flash, Qwen 4 Plus, dan Qwen 4 27B di atas panggung, menggambarkan keluarga model itu sebagai sedang dilatih dengan arsitektur generasi baru, dan hanya mengatakan bahwa keluarga model tersebut akan segera hadir. Sampai tulisan ini dibuat, tidak ada kartu model untuk satu pun dari keempatnya, tidak ada bobot terbuka, tidak ada pengenal API, tidak ada jendela konteks, tidak ada harga, dan tidak ada skor benchmark. Flagship terbaru yang benar-benar dapat Anda panggil hari ini adalah Qwen3.8-Max, yang tersedia secara umum sejak 3 Agustus 2026, dan jarak antara pengumuman di atas panggung dan endpoint yang dapat dipanggil itulah bagian dari kisah ini yang layak dibaca dengan cermat.
Empat tingkatan, dan untuk apa masing-masing dimaksudkan
Lini Qwen milik Alibaba telah ditata ke dalam tingkatan kemampuan sejak generasi Qwen 3, dan pengumuman Qwen 4 mempertahankan bentuk itu alih-alih menggantinya. Yang ditampilkan di panggung adalah daftar nama, bukan lembar spesifikasi:
• Qwen 4 Max — tier flagship, dan yang diposisikan Alibaba untuk bersaing dengan model teratas dari setiap lab frontier lainnya
• Qwen 4 Flash — tingkat throughput tinggi, dirancang untuk pekerjaan yang sensitif terhadap latensi dan bervolume tinggi, bukan untuk penalaran puncak
• Qwen 4 Plus — tier menengah yang seimbang, yang secara historis memiliki jangkauan dukungan multimodal paling luas
• Qwen 4 27B — tier lokal berbobot terbuka, yang diunduh, di-fine-tune, dan dikuantisasi oleh orang-orang yang tidak pernah menyentuh API yang dihosting
• Arsitektur — digambarkan sebagai generasi baru, dan digambarkan sebagai sedang dilatih, yang tidak sama dengan sudah selesai
• Beban kerja utama — tugas agentic dan penggunaan alat, sesuai kerangka konferensi, bukan obrolan
• Ketersediaan — tidak ada. Tidak ada tier yang memiliki tanggal rilis, harga, jendela konteks, daftar modalitas, atau skor yang dipublikasikan
Tingkat 27B adalah yang perlu diperhatikan karena alasan yang sama sekali tidak ada hubungannya dengan tolok ukur. Ini adalah satu-satunya tingkat dalam keluarga ini yang secara historis dirilis dengan bobot terbuka, dan generasi Qwen 3.8 menunjukkan betapa banyak pekerjaan independen yang dibukanya: dalam hitungan hari setelah bobot 27B tersedia, komunitas telah menghasilkan konversi MLX, kuantisasi NVFP4, dan fine-tune tanpa sensor. 27B yang diumumkan adalah janji akan seluruh ekosistem hilir, dan ini adalah bagian dari peta jalan ini dengan pengiriman yang paling dapat diprediksi.
Angka parameter 5 hingga 10 triliun itu bukan milik Qwen 4
Liputan konferensi itu kurang cermat soal satu angka. Target "5 hingga 10 triliun parameter" yang beredar bersama berita Qwen 4 bukanlah spesifikasi Qwen 4 — itu pernyataan yang berorientasi ke depan tentang generasi setelahnya, yakni rentang waktu Qwen 4.5 dan Qwen 5. Alibaba tidak mencantumkan jumlah parameter apa pun pada Qwen 4 Max, dan berdasarkan bukti yang tersedia, akan menjadi kesalahan untuk menuliskan satu angka.
Ini penting karena jumlah parameter adalah angka yang dijadikan patokan pembaca dan angka yang menyebar. Klaim 5T parameter yang dilekatkan pada model tanpa arsitektur yang dipublikasikan tidak dapat difalsifikasi di kedua arah: tidak ada yang bisa mengonfirmasinya, dan tidak ada yang bisa mengoreksinya setelah angka itu diulang. Jika minggu ini Anda melihat Qwen 4 Max digambarkan sebagai model dengan parameter multi-triliun, angka itu telah dipinjam dari slide yang berbeda.
Yang dapat dikatakan secara jujur adalah bahwa model unggulan pendahulunya adalah mixture-of-experts berparameter 2,4 triliun dengan 95 miliar parameter aktif per token, yang dikonfirmasi pada kartu model resmi untuk Qwen3.8-Max dan pada rilis berbobot terbuka yang menyusul. Apa pun Qwen 4 Max nantinya, itulah tolok ukur yang harus dilampauinya, dan itu adalah angka yang dipublikasikan dan dapat diperiksa, bukan aspirasi peta jalan.

Arsitekturnya bukan rumor: pratinjaunya sudah dirilis
Hal yang paling berguna tentang pengumuman Qwen 4 adalah bahwa sebagian arsitekturnya sudah dirilis dengan nama lain. Qwen3.8-Flash-Next dirilis sebagai sumber terbuka pada akhir Agustus 2026, dan kartu modelnya dengan gamblang menyebutnya sebagai pratinjau arsitektur Qwen 4. Itu menjadikannya satu-satunya bukti konkret yang dimiliki siapa pun di luar Alibaba tentang bagaimana keluarga Qwen 4 dibangun.
Ini adalah model sparse dengan 125 miliar parameter utama plus 51 miliar parameter embedding N-gram, yang mengaktifkan sekitar 6 miliar per langkah inferensi. Model ini membawa konteks native 262.000 token yang menurut kartunya membentang menuju 1 juta, dan Alibaba melaporkan bahwa model ini dilatih dengan biaya sekitar 90 persen lebih rendah daripada Qwen3.7-Plus. Tiga teknik disebutkan pada kartu:
• QSA, skema sparse attention khusus Qwen, yang merupakan mekanisme di balik klaim pelatihan konteks panjang yang murah
• Koneksi residual bergerbang, ukuran stabilitas untuk jaringan sparse yang dalam
• Embedding N-gram, penyimpanan parameter terpisah berisi 51 miliar parameter yang dicari alih-alih dihitung secara dense
Jika tingkatan Qwen 4 mewarisi desain itu, konsekuensi menariknya bersifat ekonomi, bukan arsitektural. Keluarga yang dirancang untuk mencapai kualitas yang mendekati frontier dengan biaya pelatihan sekitar sepersepuluhnya adalah keluarga yang dapat diberi harga secara agresif, dan penetapan harga agresif dari Alibaba telah menjadi kekuatan paling andal dalam ekonomi model open-weight selama dua tahun. Itu adalah prediksi, bukan fakta, dan harus dilabeli sebagai prediksi — tetapi itulah alasan untuk mengikuti peta jalan ini alih-alih mengabaikannya.
Apa yang harus dijalankan selagi Anda menunggu
Tidak ada apa pun dalam pengumuman Qwen 4 yang mengubah apa yang tersedia minggu ini, dan jawaban jujur bagi siapa pun yang membangun hari ini adalah generasi Qwen 3.8. Qwen3.8-Max telah tersedia secara umum sejak 3 Agustus 2026 dengan harga $2,00 per juta token masukan dan $6,00 per juta token keluaran, tarifnya tetap untuk keseluruhan konteks 1 juta token tanpa biaya tambahan untuk prompt panjang, dan bobotnya dipublikasikan pada 12 Agustus 2026 sebagai Qwen3.8-2.4T-A95B dalam BF16 dan FP8 di bawah lisensi Qwen khusus. Model inilah yang akan menjadi tolok ukur bagi tingkatan Qwen 4, dan model ini melayani lalu lintas produksi saat ini.
Jika Anda ingin membandingkan generasi Qwen yang tersedia dengan model frontier lainnya tanpa mengelola akun, kunci, dan tagihan terpisah untuk setiap lab, OrcaRouter menghadirkan keluarga Qwen 3.8 — Qwen3.8-Max, Qwen3.8-Flash, dan Qwen3.8-27B — bersama Claude Opus 5, DeepSeek V4 Pro, Gemini 3.1 Pro Preview, dan GLM 5.3 pada satu endpoint yang kompatibel dengan OpenAI. Itu adalah satu API untuk hampir 200 model dengan markup 0%, yang berarti harga daftar penyedia diteruskan tanpa diubah, sehingga penurunan harga dari vendor langsung berlaku pada kunci Anda di hari yang sama, bukan pada siklus penagihan berikutnya. Ketika tier Qwen 4 benar-benar dirilis, katalog yang sama adalah tempatnya akan muncul; saat ini, tidak ada satu pun yang dirilis.

Intinya
Qwen 4 Max adalah pengumuman nyata dan bukan produk nyata, dan kedua bagian kalimat itu penting. Susunannya sudah dikonfirmasi: empat tier, arsitektur generasi baru, fokus agentik, dan tier 27B dengan bobot terbuka yang akan lebih penting bagi lebih banyak orang daripada flagship. Segala yang dibutuhkan untuk keputusan pembelian — harga, konteks, modalitas, bobot, skor, tanggal — masih hilang.
Anggap ini sebagai sinyal roadmap dengan jejak dokumentasi yang luar biasa baik, karena rilis Qwen3.8-Flash-Next memberi Anda pratinjau arsitektur secara gratis dan Qwen3.8-Max memberi Anda baseline incumbent dengan bobot yang dipublikasikan dan harga yang dipublikasikan. Pantau tier 27B untuk ekosistem yang akan diciptakannya dan tier Flash untuk ekonomi throughput. Jangan menerbitkan ulang angka 5 hingga 10 triliun parameter sebagai fakta Qwen 4, dan jangan merencanakan migrasi di sekitar model yang tidak memiliki tanggal rilis — rencanakan di sekitar Qwen3.8-Max, dan bergeraklah ketika sudah ada endpoint untuk dituju.

Dibandingkan dalam artikel ini2
Terdeteksi dari artikel ini · Benchmark: Artificial Analysis · diperbarui setiap hari
