Một thẻ tiêu đề ghi 'Qwen3.8-27B' với phụ đề 'Trọng số mở sẽ ra mắt trong tuần này', dòng chữ phía trên 'Alibaba Qwen - Những gì chúng ta biết cho đến nay', và dòng ngày 'Tuần từ ngày 10 tháng 8 năm 2026' bên cạnh biểu tượng hộp mở và biểu tượng lịch.
Guides & Insights

Qwen3.8-27B Trọng số mở: Bản Max đã phát hành, bản 27B thì không — Những gì chúng ta biết hiện tại

Tác giả

Rowan Sterling

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình →
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

Vào ngày 13 tháng 8 năm 2026, tuần lễ phát hành trọng số mở mà Alibaba đã hứa cho thế hệ Qwe​n3.8 của mình đã tách làm hai. Trọng số của mô hình chủ lực dòng Max — Qwen3.8-2.4T-A95B, một mô hình hỗn hợp chuyên gia (mixture-of-experts) thưa với 2,4 nghìn tỷ tham số và là bản phát hành Q​wen cấp Max đầu tiên từ trước đến nay có thể tải xuống — thực sự đã được phát hành trên Hugging Face và ModelScope, được công bố vào đêm khuya hôm trước qua cộng đồng ModelScope. Mô hình nhỏ hơn mà trang này đề cập đến, Qwen3.8-27B, thì không: dù đã được cam kết phát hành vào cùng tuần của ngày 10 tháng 8, mô hình này vẫn chưa có kho lưu trữ chính thức, thẻ mô hình, tệp giấy phép hay điểm chuẩn riêng, và các bên theo dõi thứ ba hiện mô tả việc phát hành của nó là bị trì hoãn mà không đưa ra ngày mới. Câu hỏi mà trang “những gì đã biết cho tới nay” này được tạo ra để trả lời — “khi nào bản 27B thực sự ra mắt?” — giờ đã trở thành hai: tại sao trọng số của bản Max lại được phát hành trước, và điều gì đã xảy ra với bản 27B?

Đây vẫn là bài tổng hợp những gì đã biết cho đến nay, không phải bài đánh giá. Qwen3.8-Max, bản API chủ lực, đã hoạt động từ ngày 3 tháng 8 với giá $2/$6 mỗi triệu token; mô hình cơ sở open-weights bên dưới của nó, Qwen3.8-2.4T-A95B, đã có thể tải xuống từ ngày 13 tháng 8; còn các trọng số Qwen3.8-27B vẫn chưa được công bố. Mọi khẳng định bên dưới đều được gắn nhãn tương ứng là đã xác nhận, do nhà cung cấp báo cáo, hoặc do cộng đồng ước tính.

Tín hiệu, và những gì tuần thực sự mang lại

Tín hiệu ban đầu là một bài đăng trên X của @kimmonismus, người đã chỉ ra "tuần tới" là tuần đáng chú ý: "Q​wen-3.8 27b - Grok 4.6," với Astra vắng mặt một cách đáng chú ý khỏi danh sách. Nửa Grok của tuần đó đã được phát hành vào ngày 12 tháng 8. Nửa Q​wen đã tách làm đôi. Điều bài đăng nắm bắt được là tâm trạng của những người theo dõi các bản phát hành mô hình chuyên nghiệp — bản phát hành open-weights Qwe​n3.8 là sự kiện chính trong lịch, và tuần đó đến khi các chi tiết cụ thể vẫn chưa được chốt. Một tuần sau, các chi tiết cụ thể đã phần nào được giải quyết: một trong hai bản phát hành open-weights đã hứa đã ra mắt, và không phải là bản mà bài đăng đã nêu tên.

Điều gì đã được xác nhận

• Dòng mô hình này là có thật và đã được công bố chính thức. Alibaba đã ra mắt dòng mô hình cơ sở Qwe​n3.8 vào ngày 3 tháng 8 năm 2026, sau một bản xem trước vào giữa tháng 7.

• Qwen3.8-Max đã ra mắt cùng ngày. API chủ lực — mô hình mixture-of-experts với 2,4 nghìn tỷ tham số, khoảng 95B tham số hoạt động, cửa sổ ngữ cảnh 1 triệu token và hỗ trợ đầu vào văn bản, hình ảnh, video — đã chính thức được triển khai trên API Q​wen với giá $2/$6 mỗi triệu token. Nó cũng có sẵn qua OrcaRouter với cùng mức giá niêm yết, chuyển tiếp với mức tăng giá 0%.

• Các trọng số mở của Max đã được phát hành vào ngày 13 tháng 8. Qwen3.8-2.4T-A95B — mô hình nền tảng mà API Qwen3.8-Max được xây dựng dựa trên — đã có thể tải xuống từ Hugging Face và ModelScope, cùng với phiên bản lượng tử hóa FP8. Đây là bản phát hành trọng số mở cấp Max đầu tiên từ trước đến nay của Qwen. Mô hình tải xuống này chỉ hỗ trợ văn bản, với chế độ suy luận bắt buộc bật, có ngữ cảnh gốc 256K token, có thể mở rộng lên khoảng 1 triệu token, và triển khai trên SGLang, vLLM và TokenSpeed.

• Qwen3.8-27B là mô hình open-weight nhỏ hơn trong dòng sản phẩm — vẫn chưa được phát hành.Alibaba định vị nó là con đường thực tế để triển khai cục bộ và tại chỗ, đồng thời cam kết đưa trọng số của nó lên Hugging Face và ModelScope cùng với trọng số của bản Max. Tính đến ngày 13 tháng 8, vẫn chưa có kho lưu trữ chính thức nào cho Qwen3.8-27B. Cam kết là thật; nhưng việc bàn giao vẫn chưa diễn ra.

• Điểm đánh giá độc lập đầu tiên cho thế hệ này đã xuất hiện. Artificial Analysis xếp Qwen3.8-Max ở Chỉ số Thông minh 56 với chi phí khoảng $1.14 mỗi tác vụ — thực sự tốt, kèm theo những lưu ý mà bất kỳ flagship mới ra mắt vài ngày nào cũng phải mang theo.

Những gì chúng ta thực sự biết về 27B

Tóm tắt trung thực là "Qwen3.8-27B" vẫn chủ yếu chỉ là một cái tên và một con số tham số. Điều đã được xác nhận là: đây là một mô hình có khoảng 27 tỷ tham số, là phiên bản mã nguồn mở của thế hệ Qwe​n3.8, và được thiết kế để chạy trên một GPU đơn và triển khai tại chỗ thay vì một cụm nhiều trăm GPU. Daniel Han của Unsloth báo cáo rằng nó sẽ cần khoảng 17GB VRAM khi ra mắt — một card prosumer duy nhất.

Mọi thứ khác đều chưa được xác nhận. Alibaba chưa công bố liệu 27B là mô hình dense hay mixture-of-experts, cửa sổ ngữ cảnh của nó, những loại dữ liệu đầu vào mà nó hỗ trợ, hay bất kỳ điểm benchmark nào của riêng họ. Điều thay đổi trong tuần này là thời điểm: Max và 27B được hứa hẹn sẽ ra mắt trong cùng một tuần, nhưng chỉ có Max đến hẹn. Các nền tảng theo dõi bên thứ ba hiện báo cáo rằng 27B bị trễ hẹn mà không có ngày mới — đó là cách hiểu của cộng đồng, không phải tuyên bố chính thức từ Alibaba — và vẫn có thể repo sẽ được đăng tải trước khi tuần cam kết kết thúc hoàn toàn. Nhưng tính đến thời điểm viết bài này, tổ chức Q​wen chính thức trên Hugging Face không liệt kê bất kỳ Qwen3.8-27B nào, và một số ít kho lưu trữ "Qwen3.8-27B-FP8", "-GGUF" và "-MLX" xuất hiện trong kết quả tìm kiếm chỉ là các thẻ giữ chỗ của cộng đồng với số lượt tải ở mức một chữ số, không phải bản phát hành chính thức.

Điểm tham chiếu hữu ích vẫn là bản 27B của thế hệ trước: Qwen3.5-27B, một mô hình dense trọng số mở với cửa sổ ngữ cảnh 32K. Đây là cận dưới hợp lý mà Qwen3.8-27B cần phải vượt qua, đồng thời là lời nhắc rằng các mô hình lớp 27B của Q​wen từ trước đến nay vốn được xây dựng để chạy trên phần cứng mà nhà phát triển thực sự sở hữu.

Max là điểm tham chiếu để xác định những gì 27B có thể kế thừa.

A comparison scoreboard for Qwen3.8-Max and Qwen3.8-27B, contrasting the Max's 2.4T MoE total parameters, ~95B active params, 1M-token context, / pricing and AA Index 56 with the 27B's ~27B params, TBD context, TBD architecture, self-host and no independent score yet.

27B sẽ không đạt tới trần thô của Max, nhưng các con số của Max — nay đã được công bố trong một thẻ mô hình thực sự — đặt kỳ vọng về hình dạng cải tiến của thế hệ này. Trong các đánh giá của chính Alibaba đối với mô hình trọng số mở, Qwen3.8-2.4T-A95B đạt 93.0 trên PaperBench, 86.1 trên OSworld-Verified, 91.5 trên parametric CAD, 67.7 trên SWE-bench Pro, và 86.6 trên Terminal-Bench 2.1, với hãng tuyên bố tương đương với Claude Opus 4.8, Claude Fable 5, GPT-5.6 Sol, và Gemini 3.1 Pro. Đây là những con số do hãng công bố, được đăng trong tài liệu phát hành và chưa được phòng thí nghiệm độc lập xác nhận lại. Mức tăng agentic mà việc ra mắt API tuyên bố — FrontierSWE nhảy từ 40.7 lên 73.5 trong một thế hệ duy nhất — cũng được thể hiện trong cùng tài liệu phát hành. Nếu dù chỉ một phần cải tiến đó lan xuống bản 27B, nó sẽ định nghĩa lại ý nghĩa của 'mô hình mã hóa cục bộ tốt' trong phân khúc của nó.

Một sắc thái cần lưu ý: bản Max có thể tải xuống không giống hệt với Max trên API. Qwen3.8-2.4T-A95B chỉ hỗ trợ văn bản, với chế độ suy luận bị ép bật, trong khi đó API Qwen3.8-Max bổ sung đầu vào hình ảnh, chế độ không suy luận, và ngữ cảnh mặc định 1M token. Khoảng cách đó chính là loại điều mà một mô hình 27B có thể sẽ thừa hưởng — và đáng để ghi nhớ khi bạn đọc các tiêu đề benchmark "Qwen3.8" mà không kiểm tra xem chúng mô tả biến thể nào.

Giá cả là điểm mà Max phòng thủ tốt nhất: 2/6 đô la mỗi triệu token trên toàn bộ ngữ cảnh 1 triệu token trên API, không tính phụ phí cho prompt dài. Đây là mức giá mạnh cho một API tiên phong, và nó quan trọng cho bài toán định tuyến — ở mức giá đó, thế hệ 3.8 trở thành lựa chọn cho các khối lượng công việc trước đây thường dùng các dòng flagship đắt hơn.

Cái gì thực sự có thể chạy được nó

A hardware reality-check card for Qwen3.8-27B showing community-projected VRAM requirements: Q4_K_M ~16GB, Q3_K_M ~13GB, Q6_K ~21GB, FP8 ~27GB, full precision H100 80GB, with a footer noting these are community projections based on Qwen 3.6-27B quant sizes.

Đối với bản 27B, Alibaba vẫn chưa công bố yêu cầu phần cứng, vì vậy các con số đang lưu hành vẫn chỉ là dự đoán của cộng đồng dựa trên bảng định lượng {{1}}Q​wen 3.6-27B{{/1}} — ước tính, không phải thông số kỹ thuật. Các phạm vi hoạt động mà hầu hết mọi người đang dựa vào để lên kế hoạch vẫn không thay đổi:

• Q4_K_M quant, ~16GB VRAM — một RTX 4090 hoặc tương đương, điểm tối ưu mà hầu hết các nhà phát triển cục bộ sẽ nhắm tới.

• Lượng tử hóa Q3_K_M, ~13GB VRAM — vừa với card 12GB như RTX 3060 ở chất lượng giảm.

• Q6_K quant, ~21GB VRAM — gần như không mất dữ liệu trên các card 24GB.

• Phục vụ FP8, ~27GB VRAM — một L40S duy nhất, theo dự kiến trước đó, cho suy luận cấp sản xuất.

• Độ chính xác đầy đủ, H100 80GB — phương án đạt chất lượng benchmark, và không phải điều mà hầu hết các đội sẽ sử dụng.

Điểm mới ở đây là câu nói "bạn có thể tự lưu trữ (self-host) thế hệ Qwe​n3.8 ngay bây giờ" là sự thật, nhưng không phải cho model mà mọi người đang dựa vào để lên kế hoạch. Trọng số mở của Max thuộc một phân khúc phần cứng hoàn toàn khác: mô hình BF16 độ chính xác đầy đủ có dung lượng khoảng 4.9TB, và phương pháp lượng tử hóa chọn lọc theo lớp 1-bit của Unsloth đưa nó xuống còn khoảng 397GB — có thể chạy được, nhưng chỉ với tổng RAM và VRAM từ 410GB trở lên. Đó là hạ tầng thực thụ, không phải card prosumer. Đây chính xác là khoảng trống mà 27B được thiết kế để lấp đầy, và chính sự vắng mặt kéo dài của 27B là lý do khiến con đường chạy local trên một GPU đơn lẻ cho thế hệ này vẫn chưa tồn tại.

Câu hỏi về giấy phép: Max vừa lập tiền lệ

Câu hỏi về giấy phép cho 27B vẫn chưa được trả lời, nhưng {{1}}nó sẽ trông như thế nào{{/1}} không còn là phỏng đoán nữa. Trọng số mở của Max được phát hành theo giấy phép tùy chỉnh có tên {{2}}qwen3.8-max{{/2}} — không phải Apache 2.0. Theo báo cáo từ thẻ mô hình, nó thường miễn phí cho sử dụng thương mại và lưu trữ, nhưng sẽ kích hoạt các yêu cầu bổ sung ở quy mô lớn: sản phẩm có hơn 100 triệu người dùng hoạt động hằng tháng hoặc doanh thu hằng tháng vượt 20 triệu đô la phải hiển thị tên mô hình, và các công ty có doanh thu hằng năm trên 50 triệu đô la cung cấp dịch vụ model-as-a-service hoặc dịch vụ trợ lý làm việc AI cần giấy phép riêng. Tuyên bố lan truyền rằng giấy phép cấm sử dụng ở Mỹ, EU, Anh và Hàn Quốc là sai — giấy phép không chứa bất kỳ hạn chế lãnh thổ nào.

Riêng đối với bản 27B, vẫn chưa có giấy phép nào được nêu tên. Nhưng bản Max được phát hành theo giấy phép Q​wen tùy chỉnh thay vì Apache 2.0, điều này khiến cho việc giả định Apache 2.0 cho mô hình anh em cũng là không hợp lý. Giấy phép Tongyi Qianwen cũ — với điều khoản 100 triệu MAU — không phải là thứ mà bản Max nhận được; giấy phép của bản Max là một giấy phép mới, phân theo cấp độ quy mô. Hãy đọc tệp LICENSE trong kho lưu trữ thực tế trước khi lên kế hoạch dựa trên nó, và hãy mong đợi rằng giấy phép của bản 27B sẽ chỉ được quyết định khi kho lưu trữ của nó được phát hành.

Thời điểm của chuỗi công cụ: hỗ trợ ngay từ ngày đầu vừa được chứng minh.

Các engine phục vụ đã tiến triển nhanh như kỳ vọng — đối với mô hình đã ra mắt. Qwen3.8-2.4T-A95B được phát hành với hỗ trợ hoạt động tốt trên SGLang, vLLM và TokenSpeed, đó chính là điều mà "có thể phục vụ qua API gần như ngay lập tức" nghĩa là đối với một bản phát hành trọng số mở quy mô lớn. Với bản 27B, các engine tương tự gần như chắc chắn là những người đi đầu bất cứ khi nào kho lưu trữ của nó xuất hiện, và việc Max được hỗ trợ ngay từ ngày đầu khiến cho việc 27B kế thừa sự hỗ trợ đó là kỳ vọng hợp lý. Các bản lượng tử hóa GGUF và AWQ từ cộng đồng vẫn thường tụt lại sau một đến hai tuần, vì vậy trải nghiệm "kéo về và chạy" kiểu Ollama có lẽ vẫn sẽ không tồn tại vào ngày phát hành của bản 27B — việc thiết lập thủ công vLLM hoặc llama.cpp có thể là con đường cục bộ ban đầu.

Điều gì vẫn chưa được biết đến

Một bài rò rỉ trung thực dừng lại ở những gì thực sự công khai, và ranh giới hiện rộng hơn so với một tuần trước theo một hướng nhưng hẹp hơn theo hướng khác: các câu hỏi của Max đã được trả lời, còn của 27B thì không.

• Ngày ra mắt mới. "Tuần của ngày 10 tháng 8" là cam kết; tuần đó gần như đã kết thúc và repo vẫn chưa xuất hiện. Các công cụ theo dõi bên thứ ba báo cáo về một sự trì hoãn mà không có ngày mới, nhưng Alibaba chưa đưa ra tuyên bố chính thức nào.

• Kiến trúc. Dense hay MoE cho bản 27B, và nếu là MoE, số lượng tham số hoạt động.

• Bảng thông số kỹ thuật. Cửa sổ ngữ cảnh, phương thức, giới hạn đầu ra, chế độ suy luận.

• Điểm chuẩn. Bản 27B không có điểm số chính thức và không có đánh giá độc lập.

• Giấy phép. Chưa quyết định cho đến khi kho lưu trữ của 27B được phát hành; giấy phép tùy chỉnh của Max là tiền lệ cần theo dõi.

• Rủi ro bản sao. Vấn đề placeholder giờ đã xuất hiện công khai — các thẻ cộng đồng "Qwen3.8-27B-FP8", "-GGUF" và "-MLX" tồn tại mà không có bất kỳ tệp chính thức nào. Cho đến khi tổ chức Q​wen chính thức phát hành repo, chỉ tải xuống từ trang tổ chức chính thức.

Điều này có ý nghĩa gì đối với các nhà phát triển

Sự phân chia thực tế cho thế hệ Qwe​n3.8 giờ đây là ba chiều thay vì hai. Nếu bạn muốn sử dụng API tiên phong ngay hôm nay, Qwen3.8-Max đã hoạt động thông qua OrcaRouter với giá niêm yết $2/$6 của nhà cung cấp, được truyền trực tiếp với mức tăng 0% — mức giá bạn thấy chính là mức giá Alibaba đã đặt. Nếu bạn muốn tự lưu trữ mô hình hạng Max, các trọng số mở hiện có thể tải xuống, nhưng bạn cần phần cứng cho một mô hình có độ chính xác đầy đủ khoảng 4,9TB hoặc một mô hình lượng tử hóa khoảng 397GB. Và nếu bạn muốn triển khai cục bộ trên một GPU mà thế hệ này được kỳ vọng sẽ cung cấp, bạn vẫn đang chờ Qwen3.8-27B, vốn chưa được phát hành. Một khóa tương thích OpenAI bao phủ phía API ngay hôm nay, và khi dịch vụ lưu trữ của 27B được ổn định, cùng một khóa đó có thể định tuyến đến nó.

Screenshot of the OrcaRouter model page for Qwen3.8-Max, showing model id qwen/qwen3.8-max, .00/1M input token pricing, a 1M-token context window, and an OpenAI-compatible Python code sample.

Phần cuối cùng đó chính là điểm tổng quát hơn, và đó chính xác là thứ mà một bản phát hành open-weight chưa được kiểm chứng và bị trì hoãn dùng làm ca thử nghiệm. Một mô hình thậm chí còn chưa ra mắt thì không có thành tích, không có bộ benchmark độc lập, và không có lịch sử sự cố — và khi nó đến, nó sẽ hoàn toàn mới. Định tuyến là cách bạn dùng thử nó mà không đặt cược một đường vận hành hướng tới khách hàng vào nó: gửi cho nó lượng lưu lượng có thể chấp nhận bất ngờ, tự động chuyển sang một mô hình đã được kiểm chứng khi nó hoạt động sai, và chuyển toàn bộ khối lượng công việc khi nó đã giành được sự tin tưởng. Lớp định tuyến cũng chính là thứ làm cho phép tính giá trở nên minh bạch — khi Alibaba giảm giá một mô hình bạn gọi qua một endpoint, thay đổi sẽ có hiệu lực ngay trong ngày, vì giá niêm yết được truyền thẳng qua.

Xem gì

• Liệu repo của 27B có xuất hiện hay không. Một mục hiển thị trong tổ chức Q​wen chính thức trên Hugging Face hoặc ModelScope chính là sự kiện chấm dứt sự trì hoãn — và tuần của ngày 10 tháng 8 gần như đã trôi qua mà vẫn chưa có mục nào.

• Tệp giấy phép của 27B. Max đi kèm với một giấy phép phân tầng theo quy mô tùy chỉnh, không phải Apache 2.0. Liệu 27B có đi theo tiền lệ đó hay không chính là điểm hệ trọng nhất trong thông báo cuối cùng của nó.

• Kiến trúc và độ dài ngữ cảnh. Kiến trúc Dense-vs-MoE và cửa sổ ngữ cảnh quyết định mô hình 27B dùng để làm gì.

• Điểm chuẩn độc lập đầu tiên. Điểm 56 của Max trên Chỉ số Trí tuệ Artificial Analysis đã đặt ra chuẩn mực; đánh giá bên ngoài đầu tiên của 27B sẽ cho bạn biết bao nhiêu lợi ích của thế hệ này còn giữ được ở quy mô tiêu dùng.

• Phạm vi hỗ trợ của toolchain.Liệu 27B có kế thừa hỗ trợ SGLang/vLLM/TokenSpeed ngay từ ngày đầu ra mắt như Max hay không, và cộng đồng sẽ nhanh chóng cho ra mắt các bản lượng tử hóa tiếp theo đến mức nào.

FAQ

Qwen3.8-27B đã được phát hành chưa?

Không. Alibaba đã công bố điều đó vào ngày 3 tháng 8 năm 2026 và cam kết đăng tải trọng số lên Hugging Face và ModelScope trong tuần bắt đầu từ ngày 10 tháng 8, nhưng tính đến ngày 13 tháng 8 vẫn chưa có kho lưu trữ chính thức, thẻ mô hình hoặc giấy phép nào cho Qwen3.8-27B. Các trọng số nguồn mở của dòng Max — Qwen3.8-2.4T-A95B — đã được phát hành vào ngày 13 tháng 8; còn bản 27B thì không, và các công cụ theo dõi bên thứ ba báo cáo rằng bản này đã bị trì hoãn mà chưa ấn định ngày mới.

Tôi cần phần cứng gì để chạy Qwen3.8-27B?

Chưa được xác nhận, nhưng các ước tính từ cộng đồng dựa trên bảng lượng tử hóa Qwen 3.6-27B cho thấy bản lượng tử Q4_K_M cần khoảng 16GB VRAM (một chiếc RTX 4090), bản Q3_K_M cần khoảng 13GB (các card 12GB), bản Q6_K cần khoảng 21GB (các card 24GB), và bản phục vụ FP8 cần khoảng 27GB (một chiếc L40S). Daniel Han của Unsloth báo cáo khoảng 17GB khi phát hành. Hãy coi những con số này chỉ là ước tính cho đến khi thẻ mô hình chính thức công bố hướng dẫn phần cứng.

Qwen3.8-27B có sẵn qua OrcaRouter không?

Chưa. Qwen3.8-27B là mô hình mã nguồn mở, tự lưu trữ và hiện chưa có trên nền tảng. Mẫu chủ lực cùng dòng — Qwen3.8-Max — hiện đã có sẵn thông qua OrcaRouter với giá niêm yết của nhà cung cấp là $2/$6 mỗi triệu token, không cộng thêm phí, và khi dịch vụ lưu trữ cho 27B ổn định, nó có thể được thêm vào cùng một khóa tương thích OpenAI.

Tôi có nên đợi Qwen3.8-27B hay dùng Qwen3.8-Max hôm nay?

Điều đó phụ thuộc vào nơi khối lượng công việc chạy. Nếu bạn cần một API tiên phong ngay bây giờ, Qwen3.8-Max đã có mặt và có mức giá rất cạnh tranh ở $2/$6 mỗi triệu token. Nếu bạn muốn tự lưu trữ dòng Max ngay hôm nay, Qwen3.8-2.4T-A95B có thể tải xuống ngay bây giờ, nhưng nó cần phần cứng nghiêm túc — khoảng một mô hình full-precision 4.9TB, hoặc khoảng 397GB khi lượng tử hóa, với tổng RAM và VRAM trên 410GB. Nếu bạn cần một mô hình cục bộ hoặc tại chỗ trên một card đồ họa tiêu dùng duy nhất, Qwen3.8-27B vẫn là cái tên đáng chờ đợi — đây là con đường tự lưu trữ thực tế trong thế hệ này, và thời điểm ra mắt của nó hiện là câu hỏi mở thay vì một ngày cố định.

Tuần đã hứa gần như đã trôi qua, và một nửa những gì đã hứa vẫn chưa đến. Qwen3.8-2.4T-A95B có thể tải xuống, được cấp phép và phục vụ; Qwen3.8-27B được xác nhận tồn tại, vẫn cam kết mở trọng số, nhưng vẫn chưa có repo, giấy phép, điểm chuẩn, hay một mốc thời gian mới. Hãy để ý liệu repo của 27B có xuất hiện trước khi tuần đã hứa kết thúc hẳn không, tệp giấy phép của nó ghi gì bên cạnh bản Max, và các đánh giá độc lập đầu tiên chấm điểm nó ra sao. Ba tín hiệu đó sẽ cho bạn biết đây là một bản phát hành trọng số mở hai bước thông thường với mô hình nhỏ hơn sắp ra mắt, hay là một sự chậm trễ đáng để lên kế hoạch xoay quanh.

So sánh trong bài viết này2

Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày