
Qwen 3.8 vs Claude Fable 5: Bản 0902 Dẫn Đầu Về Khả Năng Lập Trình
- OrcaMỚIOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 trên 1 triệu token
- orcaMỚIOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token
- deepseekMỚIDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- openaiMỚIOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- googleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- anthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- grokSpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
- metaMeta: Muse Spark 1.22026-08-0540Trí tuệ72Lập trình
- qwenQwen: Qwen3.8 Max2026-08-0345Trí tuệ76Lập trình
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Trí tuệ69Lập trình
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 trên 1 triệu token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Khi Alibaba giới thiệu Qwen3.8-Max tại Thượng Hải vào ngày 19 tháng 7 năm 2026, họ đã đưa ra một tuyên bố nổi bật hơn bất kỳ tuyên bố nào khác: mô hình 2,4 nghìn tỷ tham số này gần đạt trình độ tiên phong và chỉ xếp sau Claude Fable 5. Vào thời điểm đó, điều này không thể đánh giá được. Không có bảng giá, không có bảng benchmark, và không có giấy phép — chỉ là một tuyên bố định vị.
Vào ngày 3 tháng 8 năm 2026, Qwen3.8-Max chính thức ra mắt rộng rãi — với bảng giá minh bạch 2 đô la / 6 đô la mỗi triệu token, một bảng benchmark có số liệu cụ thể, và một endpoint tương thích với OpenAI lẫn DashScope. Đến ngày 2 tháng 9, Alibaba tung ra bước tiến tiếp theo mà không thay đổi số phiên bản: Qwen3.8-Max-0902, một bản cập nhật hậu huấn luyện nhắm vào mã hóa và các tác vụ agentic, ra mắt ở vị trí số 1 trên bảng xếp hạng Code Arena: WebDev với 1.691 Elo. Claude Fable 5 — mô hình mà Alibaba đã dành cả tháng 7 để định vị ngay phía sau — hiện đứng ở mức 1.628 trên cùng bảng đó. Câu hỏi từ tháng 7 càng trở nên nhức nhối: liệu Qwen 3.8 vẫn còn “chỉ đứng sau Fable 5,” hay cục diện về mã hóa đã đảo chiều?
Một lưu ý dành cho các nhà phát triển — cách nhanh nhất để giải quyết một tuyên bố như thế này là chạy cả hai mô hình trên các prompt của riêng bạn. OrcaRouter cung cấp hơn 200 mô hình thông qua một endpoint tương thích với OpenAI, vì vậy bạn có thể cho Qwen 3.8 Max đối đầu với Fable 5 trên cùng một tác vụ mà không cần tích hợp hai SDK riêng biệt.
Kết luận vắn tắt. Qwen3.8-Max-0902 là phiên bản mạnh nhất tính đến nay của mô hình flagship 2.4T của Alibaba, và điểm mới trong hồ sơ năng lực của nó không còn là lời tự công bố: mô hình này ra mắt ở vị trí #1 trên bảng xếp hạng Code Arena: WebDev độc lập với 1.691 Elo, cao hơn Claude Fable 5 (1.628, #8) trên chính bảng xếp hạng đó. Giá không đổi và vẫn là lợi thế quyết định — với mức giá cố định $2 / $6 cho mỗi 1 triệu token, Qwen rẻ hơn mức $10 / $50 của Fable 5 khoảng 5× về đầu vào và 8× về đầu ra. Điều chưa khép lại là khoảng cách về năng lực đa dụng: Artificial Analysis chấm Qwen3.8-Max 56 điểm trên Intelligence Index, so với mức 62 của Claude Fable 5; còn trên bảng Arena chung ở tuần công bố mới nhất (24–30/8), Fable 5 giữ #1 (1.508 Elo) trong khi Qwen3.8-Max đứng #20 (1.479). Vậy có hai kết luận: về coding, bản cập nhật 0902 của Qwen giờ đã có trọng tài xác nhận và một chiến thắng; còn về suy luận tổng quát đã được kiểm chứng độc lập, Claude Fable 5 — cùng Claude Fable 5.1 mới hơn của Anthropic, vốn dẫn đầu chỉ số AA ở mức 66 — vẫn giữ vững vị thế.
Những điểm chính rút ra
• Qwen3.8-Max đạt GA vào ngày 3 tháng 8 năm 2026 và bản cập nhật 0902 của nó ra mắt ngay sau đó vào ngày 2 tháng 9 — không tăng phiên bản, vẫn giữ nguyên bảng giá $2 / $6 và ngữ cảnh 1M token.
• Khoảng cách giá là rất lớn: Qwen ở mức $2 / $6 cho mỗi 1M so với Fable 5 ở mức $10 / $50. Đó là khoảng 5× cho đầu vào và khoảng 8× cho đầu ra, và mức giá của Qwen là cố định trên toàn bộ ngữ cảnh 1M token mà không có phụ phí cho prompt dài.
• Cả hai bên giờ đây đều có điểm số riêng biệt — và chúng chỉ ra các hướng khác nhau. Qwen3.8-Max đạt 56 trên chỉ số Artificial Analysis Intelligence Index (Claude Fable 5: 62), và bản dựng 0902 của nó đứng đầu Code Arena: WebDev với 1.691 Elo so với 1.628 của Fable 5.
• Bảng benchmark của riêng Qwen vẫn mạnh và vẫn do chính hãng tự công bố. GPQA Diamond 92.6, PaperBench 93.0, Terminal-Bench 2.1 86.6, OSWorld-Verified 86.1 — nhưng bản cập nhật ngày 2 tháng 9 là kết quả đầu tiên của Qwen được một đấu trường độc lập xếp hạng #1.
• Khoảng trống về mặt kiến trúc trong bảng thông số kỹ thuật đã được lấp đầy. Qwen3.8-2.4T-A95B có ~95B tham số hoạt động trong tổng số 2.4T tham số, trải trên 512 chuyên gia — được tiết lộ cùng bản phát hành trọng số mở ngày 12 tháng 8. Kiến trúc của Fable 5 vẫn chưa được tiết lộ.
• Trọng số mở đã có mặt, không chỉ là lời hứa. Qwen3.8-2.4T-A95B (BF16 và FP8) đã ra mắt trên Hugging Face và ModelScope vào ngày 12 tháng 8 dưới giấy phép tùy chỉnh Qwen3.8-Max, tiếp theo là Qwen3.8-27B vào ngày 14 tháng 8 theo giấy phép Apache 2.0. Fable 5 bị đóng kín và chỉ dùng qua API, vĩnh viễn.
Lưu ý về độ chính xác: các số liệu trong bảng benchmark của riêng Alibaba vẫn là {{1}}do nhà cung cấp tự báo cáo và chưa được tái lập{{/1}}. Các số liệu độc lập tại đây là {{2}}có dấu thời gian và đến từ bên thứ ba{{/2}}: Chỉ số Artificial Analysis Intelligence Index (Qwen3.8-Max 56, Claude Fable 5 62, Claude Fable 5.1 66), bảng xếp hạng Code Arena: WebDev Elo, cùng bảng xếp hạng tuần của Arena — điểm số arena thay đổi khi phiếu bầu tích lũy, và vị trí #1 của bản build 0902 là theo công bố của Alibaba về một bảng xếp hạng tại một thời điểm cụ thể. Mức 95,0% SWE-bench Verified của Fable 5 là do Anthropic báo cáo; giá của Qwen là biểu giá GA từ Alibaba Model Studio.
Thông số kỹ thuật và giá, đặt cạnh nhau
Đây là dữ liệu cứng, mỗi con số đều được ghi rõ nguồn gốc.
• Nhà sản xuất / trạng thái — Qwen3.8-Max: Alibaba; GA ngày 3 tháng 8 năm 2026; bản làm mới 0902 ngày 2 tháng 9 năm 2026. Claude Fable 5: Anthropic; GA dòng sản phẩm chủ lực.
• Kiến trúc — Qwen3.8-Max: 2,4T tổng / ~95B hoạt động, MoE thưa, 512 chuyên gia (công bố ngày 12/8); Fable 5: chưa được tiết lộ
• Cửa sổ ngữ cảnh — Qwen3.8-Max: 1 triệu token (983.616 khi bật suy luận; đầu ra tối đa 131.072); Fable 5: flagship ngữ cảnh dài
• AA Intelligence Index — Qwen3.8-Max: 56; Claude Fable 5: 62; Claude Fable 5.1 (1 tháng 9): 66, dẫn đầu
• SWE-bench Verified — Qwen3.8-Max: Không được báo cáo (Alibaba báo cáo FrontierSWE 73.5 thay vào đó); Fable 5: 95.0% (Anthropic / buildfastwithai)
• Điểm mạnh độc lập + do nhà cung cấp công bố — Qwen3.8-Max: Code Arena WebDev #1 đạt 1,691 (0902, độc lập); bảng của nhà cung cấp: GPQA Diamond 92.6, PaperBench 93.0, Terminal-Bench 2.1 86.6. Claude Fable 5: AA 62; SWE-bench Verified 95.0%
• Giá (đầu vào / đầu ra) — Qwen3.8-Max: $2.00 / $6.00 trên 1M, cố định trên ngữ cảnh 1M; đầu vào cache $0.25; Fable 5: $10 / $50 trên 1M
• Trọng số mở — Qwen3.8-Max: phát hành ngày 12 tháng 8 năm 2026 (giấy phép tùy chỉnh, không phải Apache); Qwen3.8-27B theo Apache 2.0 ngày 14 tháng 8. Fable 5: không — đóng / chỉ API
• Đa phương thức — Qwen3.8-Max: Văn bản, hình ảnh, video đầu vào → văn bản đầu ra; Fable 5: Sản phẩm chủ lực đa phương thức
Hai điều tạo nên khuôn khổ cho toàn bộ sự so sánh này. Điều thứ nhất thay đổi vào ngày 3 tháng 8 và vẫn còn nguyên giá trị; điều thứ hai lại thay đổi tiếp vào ngày 2 tháng 9.
Đầu tiên, cột giá bây giờ là thứ nổi bật nhất trên trang. Vào tháng Bảy, lợi thế chi phí của Qwen là một phiếu giảm giá — giảm 90% tín dụng, tạm thời, không có mức giá theo token nào để lập kế hoạch. Giờ đây nó là một bảng giá, và khoảng cách này mang tính cấu trúc chứ không phải khuyến mãi. Với giá đầu ra $6 so với $50 của Fable, bạn có thể thực hiện khoảng tám lần gọi Qwen với chi phí của một lần gọi Fable. Đối với bất kỳ khối lượng công việc nào mà bạn đang trả tiền cho khối lượng thay vì cho một câu trả lời khó nhất duy nhất, tỷ lệ đó sẽ thay đổi kiến trúc của những gì bạn xây dựng.
Thứ hai, cột benchmark không còn một chiều nữa. Trong phần lớn tháng 8, cách đọc trung thực vốn rất hẹp: Alibaba báo cáo FrontierSWE 73.5 và một bảng số liệu tự chạy, Anthropic báo cáo mức 95.0% SWE-bench Verified được bên thứ ba kiểm chứng, còn không một nhà đánh giá độc lập nào chấm điểm Qwen. Bản build 0902 đã chấm dứt điều đó. Code Arena: WebDev là một đấu trường bình chọn mù theo cặp do con người bỏ phiếu — dự án trước đây có tên WebDev Arena, không do ai tại Alibaba vận hành — và Qwen3.8-Max-0902 đã tham gia ở vị trí #1 với 1,691 Elo, trên Claude Opus 5 (1,688), Kimi K3 (1,674) và Claude Fable 5 (1,628, #8). Hai lưu ý giúp nhận định này trung thực: đây chỉ là một bảng, đo khả năng phát triển front-end dạng agentic thay vì năng lực tổng quát; và “ra mắt ở vị trí #1” chỉ là thông báo của Alibaba về một danh sách tại một thời điểm. Nhưng tuyên bố rằng Qwen không hề có trọng tài nào giờ không còn đúng nữa, và điều đó làm thay đổi cuộc so sánh nhiều hơn bất kỳ con số đơn lẻ nào trên bảng.

Chênh lệch giá thực sự mang lại cho bạn điều gì?
Nhiều ví dụ trừu tượng ít hữu ích hơn một ví dụ cụ thể, vì vậy đây là một ví dụ. Lấy một tác nhân đánh giá mã gửi 150,000 token ngữ cảnh kho lưu trữ và tạo ra 6,000 token đánh giá cho mỗi lần gọi.
• Qwen3.8-Max: 0.15M × $2 = $0.30, cộng với 0.006M × $6 = $0.036. ≈ $0.34 mỗi lần gọi.
• Claude Fable 5: 0,15M × $10 = $1,50, cộng với 0,006M × $50 = $0,30. ≈ $1,80 mỗi lần gọi.
• Ở mức 2,000 cuộc gọi/ngày: Qwen ≈ $672/ngày; Fable ≈ $3,600/ngày. Trong một tháng, khoảng $20,000 so với $108,000.
• Với bộ nhớ đệm prompt trên ngữ cảnh repo ổn định, đầu vào được lưu trong bộ nhớ đệm của Qwen ở mức $0,25/1M giảm phía đầu vào từ $0,30 xuống dưới $0,04, đưa mỗi lần gọi xuống còn ≈ $0,08 — rẻ hơn khoảng 22 lần so với Fable mỗi lần gọi.
Đó không phải là khoản tiết kiệm nhỏ nhặt; đó là sự khác biệt giữa việc chạy một trình đánh giá trên mọi pull request và chỉ chạy trên những pull request rủi ro. Và mức giá cố định theo context của Qwen khiến tác động này càng mạnh hơn khi prompt tăng lên: vì Alibaba không tính phụ phí cho prompt dài, việc đưa một context 900.000 token qua có chi phí mỗi token bằng với việc đưa một context 5.000 token.
Đối trọng trung thực là giá trên mỗi token không phải là giá trên mỗi nhiệm vụ đã giải quyết. Nếu Fable 5 giải quyết một vấn đề trong một lần xử lý trong khi một mô hình rẻ hơn cần ba lần thử cộng với hiệu chỉnh của con người, thì mô hình rẻ hơn có thể tốn kém hơn về tổng thể — và đối với những công việc suy luận khó nhất, thứ hạng #1 được kiểm toán của Fable là bằng chứng tốt nhất hiện có cho thấy nó thực sự giải quyết được nhiều hơn trong một lần xử lý. Lập luận về chi phí cho Qwen mạnh nhất với khối lượng công việc lớn, ít nhạy cảm với lỗi và yếu nhất với những khối lượng nhỏ, rủi ro cao.
Cách đặt tên 0902: năng lực đã nhảy vọt, nhưng số phiên bản thì không.
Điều đáng chú ý về ngày 2 tháng 9 là điều Alibaba đã không làm: phát hành Qwen 3.9. Bản cải tiến được phát hành dưới dạng một checkpoint gắn ngày trên cùng tên mô hình — Qwen3.8-Max-0902 — và API phục vụ nó với cùng tên gọi và cùng mức giá. Đây là hướng đi mà ngành công nghiệp đang dịch chuyển: khi một bước nhảy về năng lực không còn đảm bảo một số phiên bản mới, câu hỏi "tôi nên dùng mô hình nào" trở thành vấn đề về bản build và ngày tháng, không chỉ còn là tên dòng sản phẩm.
Điều đó cũng có nghĩa điểm benchmark gắn với “Qwen3.8-Max” chỉ có thời hạn sử dụng: điểm số đo trên bản dựng tháng Bảy hoặc tháng Tám có thể không mô tả đúng mô hình mà API trả về hôm nay. Hãy kiểm tra mã định danh bản dựng trên endpoint bạn thực sự gọi — con số 0902 chính là điểm khác biệt giữa một mô hình từng xếp sau Claude Fable 5 và một mô hình dẫn trước nó trên Code Arena: WebDev.
Bằng chứng, và lý do vì sao nó vẫn quyết định trận đấu này.
Bằng chứng thực hành được trích dẫn nhiều nhất về Qwen3.8-Max đến từ một bài đánh giá thời kỳ xem trước (thomas-wiegold.com) đã thử mô hình với bốn bản dựng thực tế. Kết quả thực sự ấn tượng: Qwen đã vượt qua mô phỏng Go poker ngay từ lần đầu — chỉ là mô hình thứ ba từng hoàn thành bài kiểm tra đó trong một lần duy nhất, cùng với Fable 5 và Grok 4.5 — và với một bài kiểm tra trang web máy rang cà phê, nó đã tạo ra đầu ra tốt nhất mà người đánh giá từng thấy từ bài kiểm tra đó, thêm giỏ hàng, mục bán buôn và tích hợp Instagram dù không được yêu cầu, chỉ vì sự kỹ lưỡng tuyệt đối.
Điểm trừ là tốc độ: hơn 30 phút trên trang web và 1 giờ 20 phút trên mô phỏng poker, khiến nó trở thành mô hình chậm nhất mà người đánh giá đó từng sử dụng. Phát hiện đó giờ đây cần một lưu ý mà hồi tháng Bảy nó không cần. Nó được đo trên hạ tầng của bản preview, bởi một người đánh giá, trên các lượt chạy agentic dài bất thường. Phục vụ GA là một hệ thống khác. Dù sao thì, dữ liệu telemetry 7 ngày của chính OrcaRouter hiện cho thấy thời gian đến token đầu tiên ở phân vị p50 là 1,64 giây cho Qwen3.8-Max — một phép đo nội bộ, mặc dù TTFT và thông lượng đầu-cuối trên các bản build kéo dài hàng giờ là những đại lượng khác nhau. Quan điểm trung thực là phát hiện về độ chậm của bản preview nên được kiểm tra lại thay vì được lặp lại như một sự thật hiện tại.
Điều còn lại sau bản cập nhật 0902 là những bằng chứng mạnh nhất của mỗi bên vẫn đến từ những nơi khác nhau. Việc Qwen3.8-Max-0902 đạt #1 trên Code Arena: WebDev là một kết quả bình chọn mù độc lập, nhưng nó chỉ đo trên một bảng, và bảng benchmark của chính Alibaba vẫn chỉ là một sản phẩm tự công bố — các phòng lab chọn benchmark nào để báo cáo, và con số yếu nhất mà Alibaba báo cáo (IFBench 82.8, chỉ số làm theo hướng dẫn) vẫn khớp với lời phàn nàn trước đó rằng mô hình làm quá mức và không tôn trọng phạm vi. Bằng chứng cho Claude Fable 5 rộng hơn và chủ yếu từ bên thứ ba: 62 trên AA Intelligence Index, #1 trên bảng tổng của Arena, 95.0% trên SWE-bench Verified — và bản mới hơn Claude Fable 5.1 của chính Anthropic đã dẫn đầu chỉ số AA với 66 kể từ ngày 1 tháng 9. Về “mô hình nào sẽ xử lý công việc mà tôi không thể để xảy ra sai lầm,” câu trả lời tổng quát vẫn không thay đổi. Về “mô hình nào cung cấp front-end tốt nhất với giá chỉ bằng một phần mười,” câu trả lời đã lật ngược vào ngày 2 tháng 9.

Sự cởi mở: trục Qwen đã giành chiến thắng
Fable 5 sẽ không bao giờ có thể tự lưu trữ. Qwen3.8-Max thì đã có thể: vào ngày 12 tháng 8, các bộ trọng số cho Qwen3.8-2.4T-A95B — bản BF16 và biến thể FP8 chính thức — đã được đăng tải lên Hugging Face và ModelScope, khiến nó trở thành Qwen cấp Max đầu tiên mà bất kỳ ai cũng có thể tải về. Hai điều cần lưu ý có trọng lượng ngang nhau.
Điều đầu tiên là hợp pháp. Bản phát hành được phân phối theo giấy phép tùy chỉnh “Qwen3.8-Max”, không phải Apache 2.0: các nhà cung cấp vận hành dịch vụ mô hình (model-as-a-service) hoặc các doanh nghiệp trợ lý AI có doanh thu trên 50 triệu USD trong 12 tháng gần nhất phải đàm phán một giấy phép riêng với Qwen, và các sản phẩm thương mại vượt 100 triệu người dùng hoạt động hằng tháng hoặc 20 triệu USD doanh thu hằng tháng phải hiển thị tên mô hình. Đối với mục đích sử dụng nội bộ và các công ty khởi nghiệp, các ngưỡng này hiếm khi đủ sức ràng buộc — nhưng đây không phải là một cuộc chơi không có luật lệ.
Thứ hai là vấn đề vật lý. Một MoE tổng 2,4 nghìn tỷ tham số chiếm khoảng 4,9TB ở định dạng BF16 (khoảng một nửa trong checkpoint FP8 chính thức) so với khoảng 141GB bộ nhớ trên mỗi H200 — vì vậy, tự lưu trữ mô hình hàng đầu đồng nghĩa với việc phải có cả một rack tăng tốc trước khi bạn phục vụ được một token. ~95B tham số hoạt động được công bố ít nhất giúp bạn ước lượng được rack đó mang lại những gì. Với gần như mọi đội ngũ, API được lưu trữ với giá $2 / $6 mới là con đường thực tế.
Đó là lý do vì sao Qwen3.8-27B — mô hình có bộ trọng số Apache-2.0 ra mắt vào ngày 14 tháng 8 và được cho là chạy được trong khoảng 17GB VRAM — vẫn là bản phát hành tự lưu trữ quan trọng trong thực tế. Nếu lý do bạn chọn Qwen thay vì Fable 5 là do yêu cầu về dữ liệu cư trú hoặc kiểm soát tại chỗ chứ không phải năng lực thô, thì bản 27B chính là mô hình thực sự đáp ứng nhu cầu đó — và xét trên cả hai phương diện, so sánh về độ mở không còn chỉ mang tính lý thuyết nữa.
Câu hỏi thường gặp
Qwen 3.8 có tốt hơn Claude Fable 5 không?
Giờ đây, điều này phụ thuộc vào tiêu chí đánh giá — một sự thay đổi thực sự so với tháng 8. Về coding, Qwen3.8-Max-0902 dẫn đầu: #1 trên Code Arena: WebDev với 1.691 Elo so với 1.628 của Claude Fable 5, với mức giá $2/$6 so với $10/$50 của Fable 5. Về chất lượng tổng thể đã được kiểm định, Fable 5 vẫn dẫn đầu: 62 trên AA Intelligence Index so với 56 của Qwen, 95,0% trên SWE-bench Verified và #1 trên bảng xếp hạng Arena chung. Với những công việc mà một câu trả lời sai sẽ rất tốn kém, Fable 5 là lựa chọn được kiểm chứng tốt hơn; còn với nhu cầu coding khối lượng lớn và công việc web agentic, Qwen mới nhất vừa rẻ hơn vừa được xếp hạng cao hơn trên Arena.
Liệu {{1}}behind only Fable 5{{/1}} có đúng không?
Vị thế của Alibaba được công bố khi chưa có số liệu độc lập, và bản dựng 0902 kể từ đó đã thay đổi diện mạo. Qwen3.8-Max-0902 xếp trên Claude Fable 5 tại Code Arena: WebDev (1.691 so với 1.628), nhưng xếp sau ở AA Intelligence Index (56 so với 62) và trên bảng xếp hạng Arena tổng quát (Qwen #20, Elo 1.479; Fable 5 #1, Elo 1.508). Vậy nên câu “chỉ đứng sau Fable 5” đã trở thành “vượt Fable 5 trên bảng coding mà đợt refresh này nhắm tới, nhưng xếp sau trên các bảng đa dụng tổng quát”.
Qwen 3.8 rẻ hơn Fable 5 bao nhiêu?
Đáng kể, và giờ đây nó là một mức giá thực sự chứ không phải chiết khấu. Qwen3.8-Max có giá $2 / $6 mỗi 1M token so với mức $10 / $50 của Fable 5 — rẻ hơn khoảng 5 lần cho đầu vào và 8 lần cho đầu ra. Mức giá của Qwen cũng không đổi trên toàn bộ ngữ cảnh 1M, và đầu vào được lưu cache ở mức $0.25/1M khiến các khối lượng công việc lặp lại ngữ cảnh còn rẻ hơn nữa.
Qwen 3.8 Max đã rời khỏi bản xem trước chưa?
Vâng. Mô hình đã được phát hành chính thức vào ngày 3 tháng 8 năm 2026 với bảng giá công khai và endpoint tương thích OpenAI và DashScope. Chiến dịch tín dụng Qoder và chương trình ưu đãi 90% cho bản xem trước lan truyền hồi tháng 7 không còn phản ánh đúng cách mô hình được bán.
Qwen 3.8 có còn là mô hình chậm nhất như các đánh giá ban đầu đã nói không?
Phát hiện đó đến từ một người đánh giá trên hạ tầng xem trước chạy các bản dựng tác nhân kéo dài một giờ, và nó cần được kiểm tra lại với dịch vụ GA thay vì được coi là dữ kiện hiện tại. Dữ liệu đo từ xa trong 7 ngày của OrcaRouter cho thấy thời gian đến token đầu tiên ở phân vị 50 là 1,64 giây, mặc dù điều đó đo độ trễ token đầu tiên chứ không phải thông lượng trên các bản dựng rất dài.
Tôi có thể tự lưu trữ Qwen 3.8 thay vì trả tiền cho Fable 5?
Có, đối với Qwen, nhưng có điều kiện. Qwen3.8-2.4T-A95B đã có thể tải xuống kể từ ngày 12 tháng 8 theo giấy phép tùy chỉnh (không phải Apache 2.0), còn Qwen3.8-27B được phát hành theo Apache 2.0 kể từ ngày 14 tháng 8. Rào cản thực tế nằm ở phần cứng: một mô hình MoE tổng dung lượng 2.4T cần khoảng 4,9TB ở định dạng BF16 — tức một rack các bộ tăng tốc — nên hầu hết các đội ngũ vẫn sẽ gọi API lưu trữ với giá $2/$6 thay vì tự vận hành mô hình chủ lực. Fable 5 đã đóng cửa vĩnh viễn.
Tôi nên dùng cái nào hôm nay?
Đối với công việc chung mà câu trả lời sai sẽ phải trả giá đắt — suy luận khó, các luồng sản xuất rủi ro cao — Claude Fable 5 vẫn là lựa chọn được tài liệu hóa tốt hơn, và Claude Fable 5.1 của Anthropic càng nới rộng khoảng cách đó. Với lập trình khối lượng lớn và phát triển web dựa trên tác nhân AI, Qwen3.8-Max-0902 hiện có lợi thế đấu trường độc lập với giá đầu ra thấp hơn khoảng 8×: rà soát mã hàng loạt, tạo front-end, phân tích tài liệu dài. Nhiều đội ngũ nên dùng cả hai và điều phối theo từng loại nhiệm vụ.
Kết luận
Qwen 3.8 so với Claude Fable 5 là một phép so sánh khác so với một tháng trước, và lại khác nữa so với một tuần trước. Qwen3.8-Max là một mô hình được phát hành rộng rãi với bảng giá thấp hơn Fable 5 tới 5 lần cho input và 8 lần cho output, áp dụng đồng đều cho một triệu token — và kể từ ngày 2 tháng 9, cùng một tên gọi phục vụ bản dựng 0902, bản dựng mà một bảng xếp hạng độc lập hiện xếp hạng #1 cho phát triển web tác nhân, vượt trên Fable 5 trên bảng xếp hạng đó.
Hiện không mô hình nào chiếm trọn thế thượng phong trong toàn bộ cuộc so sánh này. Claude Fable 5 — cùng với Claude Fable 5.1 của Anthropic, vốn dẫn đầu AA Intelligence Index ở mức 66 kể từ ngày 1 tháng 9 — đang nắm giữ mảng nền tảng tổng quát, được kiểm toán độc lập; còn bảng benchmark của riêng Alibaba vẫn chỉ là sản phẩm tự công bố của nhà cung cấp. Nhưng lý do khiến cuộc đối đầu này nghiêng hẳn về một phía vào tháng 7 — rằng Qwen không có bất kỳ trọng tài độc lập nào — đã hết hiệu lực vào ngày 2 tháng 9: Qwen3.8-Max-0902 là mô hình số 1 trên Code Arena: WebDev. Câu trả lời hợp lý vẫn là phân tách theo mức độ rủi ro và loại tác vụ — Fable 5 cho suy luận tổng quát, nơi sai lầm phải trả giá đắt; Qwen3.8-Max cho việc viết mã khối lượng lớn, nơi chênh lệch giá và lợi thế trên đấu trường đều nghiêng về nó — và hãy tự kiểm thử cả hai trên các prompt của riêng bạn.

So sánh trong bài viết này3
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
