
Qwen-Image-2.1 dẫn đầu cả hai đấu trường hình ảnh: Điều mà nhãn mã nguồn mở #1 che giấu
- OrcaMỚIOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 trên 1 triệu token
- orcaMỚIOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token
- deepseekMỚIDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- openaiOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- googleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- anthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- grokSpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
- metaMeta: Muse Spark 1.22026-08-0540Trí tuệ72Lập trình
- qwenQwen: Qwen3.8 Max2026-08-0345Trí tuệ76Lập trình
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Trí tuệ69Lập trình
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 trên 1 triệu token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Nhóm đứng sau Qwen-Image-2.1 đã cảm ơn Arena vì sự công nhận, và sự công nhận đó là có thật. Qwen-Image-2.1 là mô hình đạt điểm cao nhất trên cả hai bảng xếp hạng hình ảnh của Arena mà các bảng này không gắn nhãn Proprietary: 1.367 trên Image Edit và 1.228 trên Text-to-Image, trong ảnh chụp nhanh ngày 22 tháng 9 năm 2026. Mọi dòng xếp trên nó ở cả hai bảng đều mang thẻ Proprietary. Ba sự thật mà thông báo không nêu cũng dễ kiểm chứng như chính tuyên bố đó — thứ hạng tổng thể mà những điểm số ấy mang lại, cờ Preliminary mà cả hai dòng đều đi kèm, và một chuỗi giấy phép ghi qwen-research thay vì Apache 2.0 trên các mô hình hình ảnh trước đó của nó. Tuyên bố ấy vẫn đứng vững khi đối chiếu với các bảng xếp hạng. Chỉ có điều nó nói ít hơn những gì tiêu đề hàm ý.
Đọc hai bảng cạnh nhau
Điểm số Arena là các xếp hạng kiểu Elo được xây dựng từ những bình chọn cặp mù: một người nhìn thấy hai kết quả đầu ra, không biết mô hình nào tạo ra kết quả nào, rồi chọn. Đó là một lớp bằng chứng khác biệt về phạm trù so với benchmark của nhà cung cấp, đó là lý do một tuyên bố dựa trên nó đáng được kiểm chứng thay vì lặp lại. Cả hai bảng xếp hạng đều được ghi nhận vào ngày 22 tháng 9 năm 2026, và cả hai đều được đọc từng dòng một thay vì chỉ lướt qua từ đồ họa xếp hạng.

Bảng Image Edit liệt kê 56 mô hình và 29.902.508 phiếu bầu. Qwen-Image-2.1 đứng ở vị trí thứ 16 với điểm số 1.367, khoảng tin cậy ±9 và 4.841 phiếu bầu. Mười lăm hàng phía trên nó — từ gpt-image-2.5-sunburst ở 1.526 xuống gpt-image-1.5-high-fidelity ở 1.370 — đều là Độc quyền. Hai hàng ngay bên dưới nó cũng vậy, reve-2.0 ở 1.358 và uni-1.1-max ở 1.334.

Bảng xếp hạng Text-to-Image cùng ngày liệt kê 79 mô hình và 6.258.152 phiếu bầu. Qwen-Image-2.1 đứng thứ 17 ở mức 1.228 với khoảng tin cậy ±11 và 2.843 phiếu bầu. Cùng một mô thức: mười sáu hàng phía trên nó là Proprietary, và hàng không phải Proprietary đầu tiên bên dưới nó là ideogram-4.0-quality ở mức 1.204, được gắn nhãn Ideogram Open Model.
Có hai chi tiết từ những dòng đó đáng để rút ra, vì chúng đi ngược lại cách mà khẳng định này thường được lặp lại.
• Thứ hạng và điểm số kể hai câu chuyện khác nhau — 1.367 là con số phi-Proprietary tốt nhất trên bảng chỉnh sửa ảnh, đồng thời cũng là vị trí thứ mười sáu, kém người dẫn đầu 159 điểm và kém vị trí thứ mười lăm 3 điểm.
• Trên một bảng, mô hình đóng của chính Alibaba giành chiến thắng — qwen-image-3.0-pro, được gắn nhãn Proprietary, đứng ở 1.254 trên Text-to-Image, cao hơn 1.228 của qwen-image-2.1 hai mươi sáu điểm. Trên bảng chỉnh sửa, mô hình mở đánh bại qwen-image-2.0-pro-2026-06-22 độc quyền trước đó ở mức 1.304. Nhà vô địch nội bộ không phải là cùng một mô hình trên cả hai bảng.
• Khoảng cách tới mô hình mở tiếp theo thì rộng ở bảng này và hẹp ở bảng kia — trên Image Edit, hàng phi-Proprietary kế tiếp là hunyuan-image-3.0-instruct ở 1.302, kém 65 điểm; trên Text-to-Image, đó là ideogram-4.0-quality ở 1.204, kém 24 điểm.
Chuỗi giấy phép đang gánh nhiều việc hơn cả bảng xếp hạng.
Mỗi dòng trong Arena đều mang nhãn tổ chức và giấy phép. Dòng của Qwen-Image-2.1 ghiAlibaba · qwen-research trên cả hai bảng. Đó không phải nhãn Apache 2.0 trên các mô hình hình ảnh trước đó của Alibaba: qwen-image-edit ở 1.241 và qwen-image-edit-2511 ở 1.235 trên bảng chỉnh sửa đều được gắn thẻ Apache 2.0, tương tự như qwen-image-2512 ở 1.125 và qwen-image ở 1.057 trên Text-to-Image. Bài đăng blog của nhà cung cấp cũng khép lại vòng lặp đó, khi công bố trọng số theo Thỏa thuận Giấy phép Nghiên cứu Qwen ngày 20 tháng 9 năm 2026, vốn cho phép nghiên cứu và đánh giá chứ không cho phép sử dụng thương mại.
Vậy nên cách hiểu trung thực về “mô hình mã nguồn mở số 1” hẹp hơn vẻ ngoài của nó. Theo cách phân chia hai nhánh của chính bảng xếp hạng — Độc quyền, hay không — thì Qwen-Image-2.1 đứng đầu. Theo định nghĩa mã nguồn mở của OSI, vốn không chấp nhận hạn chế về lĩnh vực sử dụng, nó hoàn toàn không phải mã nguồn mở, và phần lớn các mô hình mà nó được đem ra so sánh cũng vậy: cùng những bảng xếp hạng ấy có những dòng được dán nhãn flux-non-commercial-license, tencent-hunyuan-community, krea-2-community-license và Ideogram Open Model. Bộ lọc “Open Source” của Arena là một công tắc thô để phân biệt độc quyền với không độc quyền. Đó là một công cụ hữu ích. Nhưng nó không phải là một cuộc rà soát giấy phép.
Sự khác biệt đó ở đây quan trọng hơn các biên độ hai điểm, vì đó là điều duy nhất không thể thay đổi dù có thêm một tuần bỏ phiếu nữa. Nếu bạn muốn một mô hình hình ảnh có giấy phép permissive từ dòng này ngay hôm nay, thì các dòng Apache 2.0 là qwen-image-edit và qwen-image-edit-2511 — cả hai đều cũ hơn, và cả hai đều thấp hơn trên một trăm hai mươi điểm trên cùng bảng chỉnh sửa (1.241 và 1.235 so với 1.367). Mô hình hình ảnh Qwen có nhãn mở đạt điểm cao nhất và mô hình hình ảnh Qwen dùng được cho thương mại không phải là cùng một bản tải xuống.
Sơ bộ nghĩa là con số vẫn có thể thay đổi.
Cả hai dòng của Qwen-Image-2.1 đều mang dấuSơ bộ của bảng xếp hạng, thứ mà Arena áp dụng khi một dòng chưa tích lũy đủ phiếu để điểm số được coi là đã chốt. Lý do nằm ở số phiếu: 4.841 phiếu so với tổng 29.902.508 phiếu của bảng trên Image Edit, và 2.843 so với 6.258.152 trên Text-to-Image. So sánh ra thì các dòng xung quanh có nhiều hơn hẳn — gpt-image-1.5-high-fidelity có 589.013 phiếu trên bảng chỉnh sửa, còn qwen-image-2.0-pro-2026-06-22 có 307.705 phiếu trên bảng Text-to-Image.
Khoảng tin cậy ±9 và ±11 trên một mô hình mới ba ngày tuổi không phải là dấu hiệu cảnh báo; đó chính là dáng vẻ của một bản phát hành mới. Nhưng điều đó quả thực có nghĩa là thứ tự cụ thể ở vị trí dẫn đầu của hạng mở có thể thay đổi khi số phiếu tích lũy, đặc biệt là ở Text-to-Image, nơi khoảng cách so với dòng mở kế tiếp là hai mươi tư điểm.
Model là gì, trên bảng thông số của chính nhà cung cấp
Bài viết của chính Alibaba mô tả một mô hình hợp nhất từ văn bản sang hình ảnh và chỉnh sửa, với thành phần tạo hình ảnh 7 tỷ tham số được xây dựng từ 32 lớp DiT Single-Stream, khả năng tạo và chỉnh sửa ảnh trong suốt gốc, hỗ trợ tối đa 10 ảnh tham chiếu, và giới hạn đầu ra gốc 2048×2048 — gói tải toàn bộ pipeline vào khoảng 33 GB. Khả năng hỗ trợ trong suốt là mục ít phổ biến nhất trong danh sách đó; bảng chỉnh sửa của Arena không rõ ràng là có đo lường điều đó, nên thứ hạng trên bảng không phải là bằng chứng theo hướng nào về khả năng cụ thể đó.
Benchmark chủ lực của nhà cung cấp là Qwen-Image-Bench, nơi mô hình được báo cáo đạt 60,28, dẫn trước Nano Banana 2.0 với 59,82 và GPT Image 1.5 với 59,65. Đó là một đánh giá do nhà cung cấp tự chạy, không có bên thứ ba tái lập, và các mức chênh lệch đều dưới một điểm — một khoảng cách sẽ khó đứng vững nếu thay đổi bộ prompt. Cần nói thẳng: các con số Arena ở trên là phiếu bầu của người khác, còn các con số Qwen-Image-Bench là của chính Alibaba. Chúng không phải cùng loại bằng chứng và không nên được lấy trung bình để tạo thành một ấn tượng duy nhất về mô hình.
Hỗ trợ triển khai đến cùng với bản phát hành chứ không phải sau đó: các tích hợp ngay từ ngày đầu cho mô hình đã có trong ComfyUI, SGLang, vLLM-Omni, LightX2V và thư viện Diffusers, nghĩa là câu hỏi thực tế đối với hầu hết các nhóm không phải là liệu mô hình có thể được phục vụ hay không mà là liệu chi phí phục vụ có phù hợp hay không.
Một tuyên bố như vậy sẽ được tiếp nhận thế nào nếu bạn cần một API hình ảnh trong tuần này
Việc nói chính xác về vị thế của chính chúng tôi là điều quan trọng ở đây. OrcaRouter không định tuyến Qwen-Image-2.1, cũng như bất kỳ mô hình Qwen-Image nào ở bất kỳ phiên bản nào. Nếu điểm số Arena là điều đã thuyết phục bạn, thì mô hình này có thể truy cập được thông qua API của chính nhà cung cấp và một số nền tảng bên thứ ba, hoặc dưới dạng bản tải về tự lưu trữ — chứ không phải thông qua chúng tôi. Chúng tôi không có tuyến Qwen-Image nào để bán cho bạn, và thứ hạng trên bảng xếp hạng không phải là lý do để giả vờ điều ngược lại.
Phần chúng tôi định tuyến là phần còn lại của tầng hình ảnh mà những bảng xếp hạng đó xếp hạng, và một số dòng phía trên Qwen-Image-2.1 đều nằm trong đó. GPT-Image-2, GPT-Image-1.5 và GPT-Image-1-mini của OpenAI đều có sẵn, cũng như các tầng Imagen 4 và các endpoint xem trước hình ảnh Gemini của Google, cùng endpoint hình ảnh Grok Imagine của xAI. Sự kết hợp đó là câu trả lời thực tế cho một tuyên bố như thế này. Nếu Arena đã đặt thẳng một mô hình mở lên vị trí đầu bảng, thì việc chuyển đổi sẽ chỉ là thay đổi mã một dòng trên một khóa duy nhất. Nó đã không làm vậy — vị trí đầu của cả hai bảng đều là độc quyền, và quyết định đáng quan tâm nằm giữa một bản tải xuống theo giấy phép nghiên cứu và một endpoint được lưu trữ mà bạn có thể gọi ngay hôm nay.
Ba đặc điểm của nền tảng có ý nghĩa cho quyết định đó. Định tuyến chạy trên một endpoint tương thích OpenAI duy nhất xuyên suốt hơn 200 mô hình, nên việc so sánh các dòng được host với nhau không đồng nghĩa với một hợp đồng thứ hai hay một SDK thứ hai. Giá niêm yết của nhà cung cấp được chuyển thẳng với mức markup bằng không, nghĩa là thay đổi giá từ nhà cung cấp sẽ đến hóa đơn của bạn ngay trong ngày được công bố thay vì vào kỳ gia hạn hợp đồng tiếp theo. Và khả năng chuyển đổi dự phòng tự động giữa các nhà cung cấp nghĩa là một mô hình mới, ít được bình chọn có thể nằm sau một mô hình đã được khẳng định trong chuỗi dự phòng, thay vì trở thành một điểm phụ thuộc trong production ngay từ ngày thứ ba — đại khái là vị trí hiện tại của Qwen-Image-2.1.
Tuyên bố đó là đúng, và mỏng hơn vẻ ngoài khi đọc.
Điều Alibaba đăng tải là có thể kiểm chứng: trên bản chụp ngày 22 tháng 9 năm 2026 của cả hai bảng xếp hạng hình ảnh Arena, Qwen-Image-2.1 là mô hình đạt điểm cao nhất không được gắn thẻ Proprietary. Điều mà bài đăng ấy lược bớt lại là mọi thứ hạn định nó — thứ mười sáu và thứ mười bảy trên tổng thể, một điểm số sơ bộ trên vài nghìn phiếu bầu, và một giấy phép nghiên cứu thay cho giấy phép mã nguồn mở mà cụm từ này gợi lên.

Không điều nào trong số này khiến kết quả trở nên nhỏ nhặt. Việc trở thành hàng không độc quyền đầu tiên trên cả hai bảng, chỉ ba ngày sau khi phát hành, là một thay đổi thực sự về vị trí của tầng mở — các mô hình hình ảnh Qwen được cấp phép theo kiểu permissive ra đời trước nó xếp sau với khoảng cách hơn một trăm hai mươi điểm trên cùng bảng chỉnh sửa. Chỉ là nó không phải cùng một tuyên bố như "mô hình hình ảnh mã nguồn mở tốt nhất", và sự khác biệt nằm ở một dòng giấy phép và một cột xếp hạng, những thứ chỉ mất khoảng một phút để kiểm tra.
