Thẻ tiêu đề cho bài viết 'Qwen3.8-27B Release Date' hiển thị lịch đánh dấu tuần từ ngày 10 tháng 8 năm 2026 làm cửa sổ phát hành đã được hứa hẹn, với huy hiệu 'trạng thái: đang chờ xử lý', phụ đề ghi chú về thông báo ngày 3 tháng 8 năm 2026 và đồ họa các lớp mô hình xếp chồng.
Guides & Insights

Qwen3.8-27B Ngày phát hành: Trọng số được công bố vào ngày 14 tháng 8

Tác giả

Rowan Sterling

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình →
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

Alibaba đã phát hành trọng số mở cho Qwen3.8-27B vào tối ngày 14 tháng 8 năm 2026, đưa kho lưu trữ lên Hugging Face và ModelScope theo giấy phép Apache 2.0. Điều này giải đáp câu hỏi về ngày phát hành mà bài viết này đã theo dõi kể từ thông báo ngày 3 tháng 8, đồng thời mang đến điểm dữ liệu đầu tiên về khả năng sẵn sàng API: mô hình đã xuất hiện trên một chợ API thương mại cùng ngày. Qwen3.8-27B là thành viên dense, có thể tự lưu trữ của thế hệ Qwen3.8 — người anh em mà Alibaba định vị đối đầu với mô hình hàng đầu Qwen3.8-Max 2,4 nghìn tỷ tham số, đồng thời là người kế nhiệm của Qwen3.6-27B được sử dụng rộng rãi.

Điều mà bản phát hành ngày 14 tháng 8 đã xác nhận

Thế hệ Qwen3.8 được công bố vào ngày 3 tháng 8 năm 2026. Ngày hôm đó, Qwen3.8-Max, mô hình chủ lực mixture-of-experts, đã chính thức ra mắt với API tính phí, và Alibaba cam kết mở mã nguồn cho cả Max lẫn Qwen3.8-27B nhỏ hơn "trong khoảng một tuần." Khoảng thời gian đó bị kéo dài, rồi trở thành một mục tiêu cụ thể khi một teaser của ModelScope chạy đếm ngược đến nửa đêm ngày 15 tháng 8 (00:00 JST). Đợt phát hành diễn ra đúng kế hoạch: tối ngày 14 tháng 8 theo giờ Bắc Kinh, trên cả Hugging Face lẫn ModelScope.

Bộ thông số kỹ thuật đã được xác nhận: {{1}}Qwen3.8-27B là mô hình dense với 27 tỷ tham số, đa phương thức tự nhiên (văn bản, hình ảnh, video, sơ đồ, tài liệu),{{/1}} có {{2}}cửa sổ ngữ cảnh gốc 262.000 token, có thể mở rộng lên 1 triệu token qua YaRN,{{/2}} và {{3}}chế độ reasoning_effort có thể cấu hình, giúp điều chỉnh độ sâu suy luận để tiết kiệm chi phí tính toán.{{/3}} Đây là các thông số kỹ thuật do nhà cung cấp công bố trong tài liệu phát hành — {{4}}giờ có thể kiểm chứng trực tiếp trong các trọng số công khai thay vì chỉ tin vào tuyên bố.{{/4}}

Trong các bài đánh giá của chính Alibaba, mô hình 27B vượt qua người tiền nhiệm và thậm chí cả Qwen3.7-Plus lớn hơn: SWE-bench Pro 61,7 (so với 53,5 của Qwen3.6-27B), lập trình terminal agentic 73,0 (so với 63,4) và JobBench 33,4 (so với 21,8). Đây là những con số do nhà cung cấp tự báo cáo — chưa có bài đánh giá độc lập nào công bố điểm số cho mô hình 27B, vì vậy hãy coi chúng là tuyên bố mà cộng đồng sẽ cố gắng tái tạo.

Artificial Analysis profile page for Qwen3.8-Max, showing an Intelligence Index of 58, an output speed of 48.4 tokens per second, $2.00/$6.00 per-million-token pricing, a 1M-token context window, and a summary describing it as leading in intelligence but slow and verbose.

Những lớp nào của một bản phát hành đã được hợp nhất?

Đối với một mô hình trọng số mở, "phát hành" có nhiều tầng lớp, và chúng cách nhau vài ngày. Trọng số thô là tầng đầu tiên — đã ra mắt vào ngày 14 tháng 8. Hỗ trợ từ inference-framework là tầng thứ hai: vLLM và SGLang thường bổ sung hỗ trợ trong vòng vài ngày sau khi trọng số được tung ra, và đó là tín hiệu cho thấy một mô hình đã sẵn sàng để phục vụ chứ không chỉ để tải về. Lượng tử hóa cộng đồng là tầng thứ ba — các bản dựng GGUF và AWQ, cùng với đó là đường dùng một lệnh của Ollama, LM Studio và llama.cpp, thường là một đến hai tuần sau đó.

Vậy nên câu hỏi "khi nào tôi có thể kéo các trọng số" đã có câu trả lời: ngay bây giờ. Còn "khi nào tôi có thể chạy nó bằng một lệnh" sẽ được trả lời bởi các lớp framework và quant, vốn vẫn đang được triển khai.

A two-column infographic for Qwen3.8-27B contrasting 'Confirmed' facts (announced Aug 3 2026, weights promised week of Aug 10, target platforms Hugging Face and ModelScope, ~27B params, successor to Qwen3.6-27B) with 'Unverified' items (architecture, context window, license, benchmarks, quantized VRAM), with a footer noting no official repository had appeared as of Aug 12, 2026.

Vấn đề giấy phép đã được giải quyết.

Giấy phép là câu hỏi mở quan trọng hơn cả ngày phát hành, và bản phát hành đã chốt vấn đề. Qwen3.8-27B được phát hành theo Apache 2.0 — một giấy phép permissive không giới hạn số người dùng và không có điều kiện kích hoạt đàm phán thương mại. Mối lo ngại trước đó rằng bản phát hành mở của Qwen sẽ thuộc giấy phép Tongyi Qianwen, với điều khoản 100 triệu MAU, đã không xảy ra đối với bản 27B. Điều đó loại bỏ rào cản pháp lý chính để tích hợp mô hình vào các sản phẩm và agent ngay từ ngày đầu.

Điểm dữ liệu đầu tiên về tính khả dụng của API

Bản phát hành cũng tạo ra điểm dữ liệu đầu tiên về tính khả dụng API cho mô hình 27B: chỉ trong vòng vài giờ sau khi công bố trọng số, mô hình đã xuất hiện trên một chợ API thương mại như một điểm cuối đang phục vụ trực tiếp. Thông tin niêm yết này có thể được xác minh độc lập — một mục trong danh mục của bên thứ ba, không phải lời tuyên bố của nhà cung cấp — và đây là bằng chứng đầu tiên cho thấy mô hình không chỉ có thể tải xuống mà còn có thể triển khai thông qua các API được quản lý.

Đó là nơi OrcaRouter phát huy tác dụng trong bài toán chi phí. Thành viên có thể định tuyến của thế hệ này hiện là Qwen3.8-Max, được phục vụ trên OrcaRouter ở mức giá niêm yết của nhà cung cấp — $2.00 cho mỗi triệu token đầu vào và $6.00 cho mỗi triệu token đầu ra, không thêm phí, vì vậy giá của nhà cung cấp chính là giá bạn phải trả. Một khóa API duy nhất bao gồm nó và hơn 200 mô hình trong danh mục, với khả năng chuyển đổi dự phòng tự động. Khi Qwen3.8-27B có được vị trí của mình trên bộ định tuyến, chính khóa đó sẽ định tuyến đến nó; cho đến lúc đó, các trọng số Apache 2.0 được tự do tự lưu trữ để đánh giá.

Cần xác minh gì tiếp theo

Sự sụt giảm trả lời câu hỏi về thời điểm; nhưng chưa trả lời câu hỏi về chất lượng. Có ba điều đáng theo dõi trong những tuần tới:

• Hỗ trợ inference-framework — các pull request của vLLM và SGLang đề cập đến Qwen3.8-27B, tín hiệu cho thấy mô hình đã sẵn sàng phục vụ ở quy mô lớn thay vì chỉ chạy từ repo.

• Lượng tử hóa từ cộng đồng với số đo VRAM thực tế — Unsloth và những người khác thường đăng các bản dựng GGUF và số liệu bộ nhớ đo được trong vòng vài ngày, chuyển các dự đoán trước khi phát hành thành những con số bạn có thể triển khai dựa trên đó.

• Các điểm chuẩn độc lập — điểm số Artificial Analysis và LMArena cho bản 27B, khi chúng được công bố, mới là điều nên thúc đẩy quyết định sản xuất, không phải các đánh giá nội bộ của Alibaba.

Những gì bạn có thể sử dụng hôm nay

Qwen3.8-27B hiện đã có thể tải về — đó chính là ý nghĩa của việc phát hành theo Apache 2.0. Đối với các đội ngũ muốn xây dựng dựa trên thế hệ này thông qua API được quản lý ngay hôm nay, Qwen3.8-Max đã hoạt động trên OrcaRouter với giá niêm yết của nhà cung cấp (2,00 USD cho mỗi triệu token đầu vào, 6,00 USD cho mỗi triệu token đầu ra, không tăng phí), kèm khả năng chuyển đổi dự phòng tự động và một khóa duy nhất trên toàn bộ danh mục. Cho đến khi các điểm chuẩn độc lập xác nhận số liệu của nhà cung cấp, tự lưu trữ các trọng số 27B để đánh giá là cách tiếp cận ít rủi ro.

OrcaRouter model page for Qwen3.8-Max (qwen/qwen3.8-max), showing the NEW FEATURED badge, Vision and Tools capabilities, $2.00 per million input tokens and $6.00 per million output tokens, a p50 time-to-first-token of 4.84 seconds, a 1M-token context window, and OpenAI-compatible API code samples.

Câu hỏi về ngày phát hành đã được khép lại: Qwen3.8-27B được ra mắt vào ngày 14 tháng 8 năm 2026, dưới giấy phép Apache 2.0, với cửa sổ ngữ cảnh gốc 262K và mốc dữ liệu về tính khả dụng của API trong cùng ngày. Những câu hỏi còn lại đều là những câu có thể đo lường được — cách nó phục vụ, cách nó lượng tử hóa, và liệu các đánh giá độc lập có tái tạo lại được điểm số của Alibaba hay không. Hãy đọc LICENSE, tải các trọng số, và chờ hỗ trợ từ framework cùng các bản dựng cộng đồng trước khi đặt cược một lộ trình sản xuất vào nó.