Kartu judul untuk artikel 'Qwen3.8-27B Release Date' yang menampilkan kalender yang menandai minggu 10 Agustus 2026 sebagai jendela perilisan yang dijanjikan dengan lencana 'status: pending', subjudul yang mencatat pengumuman pada 3 Agustus 2026, dan grafik tumpukan lapisan model.
Guides & Insights

Qwen3.8-27B Tanggal Rilis: Semua yang Kita Ketahui Sejauh Ini

Penulis

Jim Song

Tanggal Terbit

Model terbaru · 20Lihat semua model
Benchmark: Artificial Analysis · diperbarui setiap hari
Kembali ke semua artikel

Alibaba menjanjikan bobot terbuka Qwen3.8-27B untuk pekan 10 Agustus 2026, dan jendela waktu itu telah lewat. Kini penundaan tersebut memiliki target yang konkret: halaman resmi Qwe​n di ModelScope menampilkan hitung mundur hingga tengah malam pada 15 Agustus 2026 — 00:00 JST, menurut laporan PC Watch pada 13 Agustus tentang teaser tersebut. Bobot tersebut hingga hari ini masih belum muncul di organisasi resmi Qwe​n di Hugging Face, tetapi pertanyaan tentang tanggal rilis kini telah terjawab untuk pertama kalinya sejak pengumuman 3 Agustus. Berikut ini yang sudah dikonfirmasi, yang masih belum terverifikasi, dan yang perlu diperhatikan.

Apa yang sudah dikonfirmasi

Alibaba mengumumkan generasi Qwe​n3.8 pada tanggal 3 Agustus 2026. Dua hal terjadi pada hari itu: Qwen3.8-Max, andalan mixture-of-experts dengan 2,4 triliun parameter, diluncurkan dengan API berbayar, dan Alibaba berkomitmen untuk membuka open weights untuk Max dan Qwen3.8-27B yang lebih kecil "dalam waktu sekitar satu minggu." Beberapa outlet independen (36Kr, TrendForce, C114) menyampaikan komitmen yang sama: Hugging Face dan ModelScope, pada minggu tanggal 10 Agustus.

27B adalah anggota generasi tersebut yang dapat di-host sendiri — Alibaba memposisikannya sebagai model yang dirancang untuk kerja GPU tunggal dan on-premise, penerus langsung dari Qwen3.6-27B yang banyak digunakan. Garis keturunan itu penting. Qwen3.6-27B menjadi salah satu model coding lokal paling populer di generasinya, dan versi 3.8 mewarisi basis pertanyaan yang sudah mapan: berapa biaya untuk menjalankannya, apakah lebih baik untuk agen, kapan saya bisa mengunduhnya.

Apa yang dapat diverifikasi secara independen saat ini adalah flagship-nya, dan itu kini mencakup bobot terbuka. Qwen3.8-Max sudah tersedia di API, dan repositori-repositorinya — Qwen3.8-2.4T-A95B (BF16 penuh) dan kuantisasi FP8 resmi — dipublikasikan di organisasi resmi Qwe​n di Hugging Face pada pekan 10 Agustus, pertama kalinya Alibaba meng-open-source flagship kelas Max. Model ini juga sudah diberi skor: Artificial Analysis menempatkan Intelligence Index-nya di angka 58, yang merupakan capaian terdekat sebuah laboratorium China ke puncak tabel tersebut, Coding Index-nya di 71,8, serta harganya di $2,00 per juta token input dan $6,00 per juta token output.

Artificial Analysis profile page for Qwen3.8-Max, showing an Intelligence Index of 58, an output speed of 48.4 tokens per second, $2.00/$6.00 per-million-token pricing, a 1M-token context window, and a summary describing it as leading in intelligence but slow and verbose.

Seperti apa sebenarnya 'rilis' untuk model open-weights

Pertanyaan tentang tanggal pada model tertutup itu sederhana — API-nya langsung aktif. Untuk model dengan bobot terbuka, "dirilis" memiliki beberapa lapisan, dan setiap lapisan muncul berselang beberapa hari:

• Bobot mentah tersedia sebagai repositori Hugging Face dan ModelScope, dengan kartu model dan file LICENSE.

Kerangka kerja inferensi menyusul — vLLM dan SGLang diperkirakan akan menambahkan dukungan dalam hitungan hari, yang merupakan sinyal bahwa sebuah model siap untuk dilayani, bukan sekadar diunduh.

• Kuantisasi komunitas (GGUF, AWQ) biasanya tertinggal satu hingga dua minggu, yaitu saat pengguna Ollama, LM Studio, dan llama.cpp benar-benar dapat menarik dan menjalankannya.

Jadi jika pertanyaannya adalah "kapan saya bisa mengunduh bobot," jawabannya adalah repositori yang muncul di organisasi Qwen resmi. Jika pertanyaannya adalah "kapan saya bisa menjalankannya dengan satu perintah," tambahkan satu hingga dua minggu. Janji 3 Agustus menargetkan hal yang pertama untuk pekan 10 Agustus — dan lapisan itu kini telah hadir untuk salah satu anggota generasi: Qwen3.8-2.4T-A95B dirilis di Hugging Face pada pekan tersebut. Untuk 27B secara spesifik, ia masih belum hadir di Hugging Face — tetapi hitung mundur ModelScope kini menyebutkan target: 15 Agustus 2026 pukul 00:00 JST.

Apa yang masih belum terverifikasi

Segala hal lain tentang 27B masih bersifat spekulatif hingga repositorinya dirilis. Jangan biarkan liputan yang meyakinkan mengubah proyeksi menjadi spesifikasi — tidak satu pun dari hal berikut terkonfirmasi saat tulisan ini dibuat:

• Arsitektur — dense atau mixture-of-experts, dan jumlah parameter aktif jika MoE.

• Jendela konteks, batas output, dan apakah hanya teks atau multimodal. Teaser ModelScope, menurut PC Watch, menggambarkan dukungan multimodal dan multibahasa asli untuk gambar dan video — pernyataan vendor di teaser, masih belum terverifikasi hingga bobotnya dirilis.

• Lisensi. Apache 2.0 bukan asumsi yang aman; rilis terbuka Qwe​n terbaru diluncurkan di bawah lisensi Tongyi Qianwen, yang memuat klausul 100 juta pengguna aktif bulanan yang memicu diskusi komersial di atas ambang batas tersebut.

• Skor benchmark apa pun. Setiap angka yang beredar untuk generasi 3.8 dilaporkan oleh vendor untuk Max; 27B tidak memiliki evaluasi publik sama sekali.

• Ukuran kuantisasi yang tepat. Angka VRAM yang beredar adalah proyeksi yang dibawa dari Qwen3.6-27B, bukan pengukuran dari model 3.8.

A two-column infographic for Qwen3.8-27B contrasting 'Confirmed' facts (announced Aug 3 2026, weights promised week of Aug 10, target platforms Hugging Face and ModelScope, ~27B params, successor to Qwen3.6-27B) with 'Unverified' items (architecture, context window, license, benchmarks, quantized VRAM), with a footer noting no official repository had appeared as of Aug 12, 2026.

Mengapa lisensi lebih penting daripada tanggal

Tanggal rilis menentukan kapan Anda dapat mulai menguji. Lisensi menentukan apakah Anda dapat mengirim rilis. Model Qwen di bawah lisensi Tongyi Qianwen gratis digunakan di bawah 100 juta pengguna aktif bulanan — setelah itu, Anda diharapkan untuk mendiskusikan persyaratan komersial. Untuk model lokal yang akan diintegrasikan tim ke dalam produk dan agen, ambang batas itu dapat tercapai lebih cepat daripada yang terdengar. File pertama yang dibuka di repositori adalah LICENSE, sebelum kartu model dan sebelum README.

Cara menangkap tetesan sebelum postingan blog melakukannya.

Organisasi resmi Qwen di Hugging Face adalah sumber kebenaran — ketika repositori bernama Qwen3.8-27B muncul di sana, atau di ModelScope, rilis telah terjadi. Mekanisme ini sudah terbukti minggu ini: Qwen3.8-2.4T-A95B dan saudara FP8-nya muncul di organisasi tersebut persis seperti itu, jadi repositori 27B akan sama jelasnya. Di ModelScope, halaman hitung mundur untuk Qwen3.8-27B sudah aktif, menunjuk ke tengah malam pada 15 Agustus — hal yang paling mendekati tanggal resmi sejauh ini. Tiga sinyal awal layak untuk diperhatikan:

• Sebuah pull request vLLM atau SGLang yang menamai Qwen3.8-27B. PR framework sering kali menjadi jejak publik pertama dari perilisan bobot, karena pekerjaan integrasi dimulai begitu repositori di-staging.

• Saluran milik tim Qwen sendiri (X, WeChat, blog qwen.ai), yang biasanya mengumumkan perilisan itu sendiri.

{{1}}•{{/1}} Kuantizer komunitas {{2}}—{{/2}} Unsloth dan lainnya biasanya memposting file kuant dan pengukuran VRAM nyata dalam hitungan hari, yang mengubah proyeksi di atas menjadi angka yang terukur.

Satu peringatan berlaku sepanjang waktu: sebelum organisasi resmi menerbitkan, "Qwen3.8-27B" apa pun yang dapat Anda unduh hanyalah placeholder atau unggahan pihak ketiga. Nama saja tidak menjamin keaslian.

Apa yang dapat Anda gunakan hari ini

27B adalah model yang patut ditunggu, bukan satu-satunya pilihan dari generasi ini. Qwen3.8-Max sudah live sekarang — dan juga bisa di-self-host karena bobotnya (weights) dapat diunduh — dan di OrcaRouter, pemakaiannya ditagih sesuai harga daftar penyedia, yaitu $2,00 per juta token input dan $6,00 per juta token output, tanpa markup sama sekali. Jadi, harga yang tertera di halaman harga vendor itulah yang Anda bayar. Satu kunci berlaku untuk semuanya, dan ketika 27B rilis serta berhasil mendapatkan kepercayaan pada benchmark publik, kunci yang sama juga akan mengarah ke sana. Bagi tim yang ingin membangun dengan generasi model ini hari ini sambil tetap menyimpan opsi untuk memakai 27B self-host di kemudian hari, itu adalah jalur dengan lock-in paling minimal.

OrcaRouter model page for Qwen3.8-Max (qwen/qwen3.8-max), showing the NEW FEATURED badge, Vision and Tools capabilities, $2.00 per million input tokens and $6.00 per million output tokens, a p50 time-to-first-token of 4.84 seconds, a 1M-token context window, and OpenAI-compatible API code samples.

Ringkasan langsungnya: jawaban tanggal rilis kini lebih jelas daripada seminggu lalu. Jendela waktu yang diberikan Alibaba — pekan 10 Agustus 2026 — telah berlalu. Yang dirilis: bobot model unggulannya, Qwen3.8-2.4T-A95B, beserta kuantisasi FP8 resminya kini tersedia di Hugging Face. Model 27B belum dirilis — tetapi penundaan ini kini punya target: hitung mundur di ModelScope berakhir pada tengah malam 15 Agustus 2026 (00:00 JST, menurut PC Watch). Pantau organisasi resmi Qwen di Hugging Face dan halaman Qwen di ModelScope, baca LICENSE begitu repositori 27B hadir, dan anggap semua spesifikasi serta angka VRAM yang beredar sebagai proyeksi hingga bobot modelnya membuat semua itu bisa diukur.

© 2026 OrcaRouter

Untuk Penyedia

Mengoperasikan platform inferensi? Hadirkan model Anda di OrcaRouter.

Hubungi kami

Gabung komunitas kami

DiscordEmailXGitHubYouTube