
Qwen 4 Max so với Claude Opus 5: bài kiểm chuẩn đã thay đổi ngay dưới chân cả hai
- OrcaMỚIOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 trên 1 triệu token
- orcaMỚIOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token
- deepseekMỚIDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- openaiOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- googleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- anthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- grokSpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
- metaMeta: Muse Spark 1.22026-08-0540Trí tuệ72Lập trình
- qwenQwen: Qwen3.8 Max2026-08-0345Trí tuệ76Lập trình
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Trí tuệ69Lập trình
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 trên 1 triệu token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Qwen 4 Max đã được giới thiệu trước tại hội nghị Yunqi ở Hàng Châu vào ngày 22 tháng 9 năm 2026 — phân khúc hàng đầu của dòng Qwen 4 gồm bốn mô hình đã được công bố và chưa phát hành, không có giá, không có cửa sổ ngữ cảnh và không có điểm số được công bố. Claude Opus 5 đã được cung cấp rộng rãi kể từ ngày 24 tháng 7 năm 2026 với mức 5,00 USD cho mỗi triệu token đầu vào và 25,00 USD cho mỗi triệu token đầu ra, và nó đã là mục tiêu mà mọi mô hình hàng đầu kể từ khi phát hành Qwen3.8-Max đều nhắm tới. Cách rõ ràng để viết so sánh này là một bảng thông số kỹ thuật với một cột để trống. Cách hữu ích là nhận ra rằng vào ngày 19 tháng 9 năm 2026, ba ngày trước thông báo, Artificial Analysis đã chấm lại Intelligence Index của mình và Claude Opus 5 không còn là mô hình đứng đầu chỉ số đó nữa. Thay đổi duy nhất đó định hình lại điều mà Qwen 4 Max phải vượt qua.
Điều gì đã thay đổi vào ngày 19 tháng 9?
Artificial Analysis đã công bố bản sửa đổi chỉ số v4.3.2 vào ngày 19 tháng 9 năm 2026. Trong bản sửa đổi hiện tại, Claude Opus 5 đạt 51 điểm trên Chỉ số Trí tuệ ở mức nỗ lực suy luận tối đa — 50 ở xhigh, 48 ở high, 45 ở medium và 39 ở low — và nó xếp sau Claude Fable 5.1 và GPT-6 Astra, cả hai đều đạt 53. Chi phí cho mỗi tác vụ trên chỉ số đó là 5,86 USD.
Nếu điều đó có vẻ như một sự hạ cấp, thì không phải vậy. Mô hình không thay đổi. Chỉ số đã thay đổi. Các bài đưa tin của chính chúng tôi trong tháng 7 và tháng 8 đã dẫn Claude Opus 5 ở mức 61 đến 63 và đứng đầu bảng, và những con số đó đúng theo các bản sửa đổi có hiệu lực vào thời điểm đó. Bất kỳ ai vẫn trích dẫn chúng mà không kèm ngày sửa đổi đang trích dẫn một con số đã bị ngừng áp dụng, và đây là lỗi phổ biến nhất trong các so sánh được viết trong tháng này. Hệ quả thực tế là một tuyên bố như "Claude Opus 5 là mô hình đạt điểm cao nhất hiện có" không còn đúng nữa, và một so sánh được xây dựng dựa trên đó sẽ sụp đổ.
Về phía Qwen, hệ quả còn rõ rệt hơn nữa. Một bậc chủ lực được công bố vào tháng 9 năm 2026 đang nhắm đến một mục tiêu đã được định nghĩa lại vào tháng 9 năm 2026. Bất cứ thứ gì Alibaba cuối cùng công bố cho Qwen 4 Max cũng sẽ được đối chiếu với một bảng xếp hạng nơi 53 là con số cần vượt qua, chứ không phải 63.

Sự so sánh, được nói một cách trung thực
Một bên của bảng này đã đầy đủ còn bên kia thì trống không, và giả vờ rằng không phải vậy sẽ chính là toàn bộ kiểu thất bại của bài viết này. Đây là những gì thực sự được biết:
• Trạng thái — Claude Opus 5 được phát hành rộng rãi kể từ ngày 24 tháng 7 năm 2026, so với Qwen 4 Max được công bố ngày 22 tháng 9 năm 2026 nhưng chưa có ngày phát hành
• Giá đầu vào — Claude Opus 5 5,00 USD mỗi 1 triệu token, so với Qwen 4 Max là không được công bố
• Giá đầu ra — Claude Opus 5 $25.00 mỗi 1 triệu token, so với Qwen 4 Max không được công bố
• Đầu vào được lưu trong bộ nhớ đệm — Claude Opus 5 $0.50 cho mỗi 1 triệu token khi đọc từ bộ nhớ đệm, so với Qwen 4 Max không được công bố
• Ngữ cảnh — Claude Opus 5 1M token ở mức mặc định và tối đa, so với Qwen 4 Max không được công bố
• Giới hạn đầu ra — Claude Opus 5 128K token ở chế độ đồng bộ và 300K trên Batches API với beta header, so với Qwen 4 Max thì không được công bố
• Phương thức — Claude Opus 5 nhập văn bản, hình ảnh và tệp với đầu ra văn bản, so với Qwen 4 Max không được công bố
• Giá theo ngữ cảnh dài — Claude Opus 5 không có phụ phí, nên một yêu cầu 900.000 token được tính cùng mức giá trên mỗi token như yêu cầu 9.000 token, trong khi Qwen 4 Max không được công bố
• Điểm độc lập — Claude Opus 5 đạt 51 trên Artificial Analysis Intelligence Index v4.3.2 ở mức nỗ lực tối đa, so với Qwen 4 Max thì không tồn tại đánh giá độc lập nào
• Điểm số do nhà cung cấp báo cáo — Claude Opus 5 SWE-bench Verified 96.0%, SWE-bench Pro 79.2%, OSWorld 2.0 70.6%, Terminal-Bench 2.1 ở mức giữa 80 tùy thuộc vào harness, so với Qwen 4 Max thì không có gì được báo cáo
• Kiểm soát suy luận — Claude Opus 5 bật mặc định chế độ suy nghĩ thích ứng với thang nỗ lực năm bậc, so với Qwen 4 Max không được công bố
Mười hàng “chưa công bố” không phải là một thủ pháp tu từ. Đó là thực trạng của bằng chứng, và kết luận trung thực rút ra từ đó là chưa ai có thể đưa ra bất kỳ so sánh năng lực nào giữa hai mô hình này.
Phần khoảng trống sẽ không thể khép lại
Giá cả và ngữ cảnh rồi sẽ được công bố. Một khác biệt sẽ vẫn còn sau khi phát hành, và đáng để quyết định ngay bây giờ hơn là vào tuần Qwen 4 Max ra mắt: hai mô hình được tạo ra để được mua theo những cách khác nhau.
Claude Opus 5 là một mô hình đóng duy nhất với một mức giá duy nhất từ một nhà cung cấp duy nhất, cùng cam kết ngừng hỗ trợ được công bố là không sớm hơn ngày 24 tháng 7 năm 2027. Đó là một mục tiêu ổn định cho việc lập kế hoạch năng lực. Qwen 4 Max là flagship của một dòng sản phẩm mà Alibaba đã liên tục phát hành trên một khoảng giá rộng hơn nhiều — thế hệ Qwen 3.8 bao gồm một flagship tiên phong với giá đầu vào $2.00 và một bậc Flash thấp hơn nhiều — và bậc flagship của dòng Qwen trong lịch sử là bậc có tuổi thọ hữu ích ngắn nhất trước khi một bậc rẻ hơn thu hẹp khoảng cách với nó.
Sự khác biệt còn lại là trọng số mở, và nó lại chỉ theo hướng ngược lại. Thế hệ Qwen 3.8 đã công bố trọng số cho mô hình lớn nhất của mình theo một giấy phép Qwen tùy chỉnh, chính điều này mới khiến việc tinh chỉnh, lượng tử hóa và tự vận hành trở nên khả thi. Claude Opus 5 không phát hành trọng số và sẽ không bao giờ có. Nếu khối lượng công việc của bạn cần một mô hình có thể chạy trong vành đai của riêng bạn, hoặc có thể sửa đổi, thì đó là một lợi thế cấu trúc mà không bản cập nhật chuẩn đánh giá nào có thể lấy đi khỏi Alibaba — và đó là lý do mạnh mẽ nhất để quan tâm đến so sánh cụ thể này thay vì coi nó như cuộc đối đầu giữa hai mô hình chủ lực.

Cách chạy so sánh này ngay hôm nay
Claude Opus 5 hiện đã có sẵn, và OrcaRouter định tuyến nó dưới dạng anthropic/claude-opus-5 theo giá niêm yết của Anthropic với mức tăng giá 0% — mức giá của nhà cung cấp được chuyển tiếp nguyên vẹn, vì vậy các con số $5.00 và $25.00 ở trên là mức bạn thực sự được tính phí, chứ không phải một mức tương đương đã bị đội giá. Điều đó còn quan trọng hơn bình thường đối với một mô hình trong phân khúc giá này: mức biên lợi nhuận nền tảng 10 phần trăm trên mức giá đầu ra $25.00 là $2.50 mỗi triệu token, điều này lớn hơn toàn bộ chi phí đầu vào của hầu hết các lựa chọn thay thế có trọng số mở. Bên cạnh đó, danh mục còn có gần 200 mô hình trên một endpoint tương thích với OpenAI, với tính năng chuyển đổi dự phòng tự động khi đường dẫn của nhà cung cấp bị suy giảm và một DSL định tuyến để biểu đạt chính sách một cách tường minh thay vì mã hóa cứng tên mô hình vào ứng dụng của bạn.
Điều mà OrcaRouter không cung cấp là Qwen 4 Max, hay bất kỳ một phiên bản Qwen 4 nào. Danh mục không có mục nào cho dòng sản phẩm này, đúng như những gì bạn có thể mong đợi ở một mô hình đã được công bố nhưng chưa phát hành. Khi các phiên bản đó thực sự ra mắt, chúng sẽ xuất hiện ở cùng vị trí, và cho đến lúc đó mô hình Qwen đáng để so sánh với Claude Opus 5 chính là mô hình bạn thực sự có thể gọi: Qwen3.8-Max, được cung cấp rộng rãi từ ngày 3 tháng 8 năm 2026 với giá 2,00 đô la cho đầu vào và 6,00 đô la cho đầu ra trên mỗi triệu token, với trọng số được công bố và điểm trí tuệ độc lập được ghi nhận là 56 với chi phí 1,14 đô la mỗi tác vụ — một con số được ghi nhận theo một phiên bản chỉ số trước đó, nên chỉ nên so sánh nó với con số 51 của Claude Opus 5 khi kèm theo lưu ý đó.
Cần làm gì với điều này trước khi có thẻ mô hình
Không có phán quyết nào để đưa ra ở đây, bởi vì một trong hai mô hình không tồn tại như một sản phẩm. Điều có thể nói là cuộc so sánh đã thay đổi cục diện vào ngày 19 tháng 9 năm 2026 mà không bên nhà cung cấp nào làm gì: Claude Opus 5 không còn là mô hình đạt điểm cao nhất trên chỉ số độc lập mà hầu hết các so sánh dựa vào, và hiện nó đứng sau hai mô hình khác hai điểm. Một màn ra mắt Qwen 4 Max sẽ rơi vào bảng đó, chứ không phải bảng từ tháng Bảy.
Vậy nên quyết định cho vài tháng tới không phải là Qwen 4 Max so với Claude Opus 5. Mà là Claude Opus 5 so với mô hình Qwen đã phát hành — một mẫu chủ lực với giá đầu vào bằng một phần năm, kèm trọng số được công bố — và sự so sánh đó đã có ngay bây giờ, với số liệu thực tế ở cả hai phía. Hãy xem xét lại khi Alibaba công bố thẻ mô hình, và coi mọi bảng benchmark Qwen 4 Max mà bạn thấy trước thời điểm đó là chưa được xác minh.

So sánh trong bài viết này2
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
