
DeepSeek V4 Pro vs Qwen3.8 Max: Khoảng cách giá gấp 3 lần, chạy lại sau đợt tạm hoãn tháng 9
- deepseekMỚIDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- openaiMỚIOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- googleMỚIGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- qwenMỚIQwen: Qwen3.8 Max (0902)2026-09-0240Trí tuệ72Lập trình
- anthropicMỚIAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- grokSpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
- metaMeta: Muse Spark 1.22026-08-0540Trí tuệ72Lập trình
- qwenQwen: Qwen3.8 Max2026-08-0340Trí tuệ72Lập trình
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Trí tuệ69Lập trình
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 trên 1 triệu token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Trí tuệ78Lập trình
- googleGoogle: Gemini 3.6 Flash2026-07-2134Trí tuệ69Lập trình
DeepSeek V4 Pro and Qwen3.8 Max are the two most important open-or-cheap flagships of this generation, and the September events on the DeepSeek side changed the matchup more than either vendor's marketing has acknowledged. DeepSeek V4 Pro shipped on August 13, 2026, ten days after Alibaba's Qwen3.8 Max went generally available on August 3, and the pairing has always read as a one-sided contest: Qwen3.8 Max is the 2.4-trillion-parameter all-rounder at $2 per million input and $6 per million output tokens, while DeepSeek V4 Pro is the 1.6-trillion-parameter reasoning specialist at a fraction of that price, MIT-licensed, with public weights. The reason this comparison is worth re-running today is not the launch-week numbers but what happened a month later — DeepSeek spent the week of September 8 trying to retire V4 Pro, then reversed on September 11 and committed to keeping it online at unchanged billing. That reversal is the single most important fact about this matchup right now, because it decides whether the cheap half is a safe bet or a migration trap.
Independent measurements in this piece come from Artificial Analysis, captured today. Alibaba's and DeepSeek's own benchmark tables are labeled vendor-reported throughout — neither company's launch numbers have been fully reproduced by a third party, and DeepSeek's are now four weeks old against a moving scoreboard.
Sự hoãn lại vào tháng Chín mới là câu chuyện, chứ không phải đợt ra mắt vào tháng Tám
Vào ngày 8 tháng 9, DeepSeek thông báo rằng sau ngày 14 tháng 9, mọi yêu cầu gửi đến deepseek-v4-pro sẽ được định tuyến tới V4.1 Flash và tính phí theo mức giá của Flash cho đến khi V4.1 Pro được phát hành. Bất kỳ ai đang thực hiện một so sánh nghiêm túc giữa Qwen3.8 Max và DeepSeek V4 Pro đều phải bắt đầu tính đến việc phương án giá rẻ sẽ biến mất. Rồi DeepSeek đã hoãn thời hạn cắt, và đến ngày 11 tháng 9 thì đảo ngược hoàn toàn, tuyên bố sẽ tiếp tục cung cấp dịch vụ API cho DeepSeek V4 Pro sau ngày 14 tháng 9 với mức tính phí không đổi, và sẽ thông báo nếu điều đó có bao giờ thay đổi. Việc đảo ngược này đã được truyền thông nhà nước Trung Quốc và báo chí công nghệ đưa tin cùng ngày hôm đó.
Tác động của điều này lên cuộc so găng là loại bỏ sự bất đối xứng vốn đang âm thầm định hướng các quyết định. Suốt tuần đầu tiên của tháng Chín, câu trả lời trung thực cho câu hỏi "tôi nên xây dựng trên mô hình output $0.66 hay mô hình output $6?" đã bị pha nhiễu bởi rủi ro tồn vong: mô hình dẫn đầu về giá có một ngày dừng hoạt động. Kể từ ngày 15 tháng Chín, sự pha nhiễu đó đã biến mất. Lựa chọn rẻ là bền vững, và sự so sánh cuối cùng cũng xoay quanh đúng điều mà nó luôn đáng lẽ phải xoay quanh — trí tuệ, giá cả và tốc độ.

Giá: vẫn là trò chơi đó, với chi phí đầu ra chỉ bằng một phần nhỏ
Trên bảng điểm độc lập hiện tại, hai mô hình cách nhau bốn điểm, và khoảng cách giá giữa chúng là lớn nhất trong phân khúc trọng số mở. Qwen3.8 Max có giá $2.00 cho mỗi triệu token đầu vào và $6.00 cho mỗi triệu token đầu ra theo giá niêm yết của Alibaba, với mức chiết khấu bộ nhớ đệm 88%. DeepSeek V4 Pro có giá $0.66 cho mỗi triệu token đầu vào và $1.98 cho mỗi triệu token đầu ra vào giờ thấp điểm, tăng gấp đôi lên $1.32/$3.96 vào giờ cao điểm, với mức chiết khấu bộ nhớ đệm 97%.
• Giá — DeepSeek V4 Pro $0.66/$1.98 cho mỗi 1M ngoài giờ cao điểm (giờ cao điểm $1.32/$3.96) so với Qwen3.8 Max $2.00/$6.00 cố định
• Chỉ số Thông minh — V4 Pro 36 (#7/113) so với Qwen3.8 Max 40 (#30/200)
• Tốc độ xuất — V4 Pro ~81 token/giây so với Qwen3.8 Max ~41 token/giây
• Chi phí mỗi tác vụ — V4 Pro $0.67 so với Qwen3.8 Max $2.67 (theo mỗi tác vụ của chỉ số AA)
• Ngữ cảnh — cả hai đều 1M token
• Giấy phép — V4 Pro MIT trọng số mở so với Qwen3.8 Max trọng số độc quyền, giấy phép thương mại
The output-price ratio is the whole argument: Qwen3.8 Max costs three times as much per input token and roughly three times per output token at V4 Pro's peak rate — and the gap on output widens to six times when V4 Pro is billed at its off-peak rate, which covers most of the week outside a narrow window. On a reasoning-heavy workload, where output tokens dominate the bill, that gap is the difference between a model you can leave running and one you watch in the dashboard. The cache lines widen it further: V4 Pro's 97% discount against Qwen's 88% means a long-context task with a reused prefix costs a fraction of its list price on the DeepSeek side.
Trí tuệ: cách nhau bốn điểm, và khoảng cách đó mới chính là sản phẩm thực sự
The independent scoreboard makes this closer than the price ratio suggests. On the current Artificial Analysis Intelligence Index, Qwen3.8 Max scores 40 against DeepSeek V4 Pro's 36 — a four-point gap that shows up in reasoning-heavy work but disappears in token-heavy work. Qwen3.8 Max's edge is real and consistent: it ranks #30 of 200 overall, just inside the frontier, while V4 Pro ranks #7 of 113 in its open-weights class. On Alibaba's own benchmark table, Qwen3.8 Max claims a Terminal-Bench 2.1 of 86.6, GPQA Diamond 92.6, and a FrontierSWE 73.5 that nearly doubled its predecessor's 40.7 — all vendor-reported, none reproduced independently. DeepSeek's model card claims a Codeforces rating of 3,348 and a Terminal-Bench 2.1 of 87.9 at maximum reasoning effort — likewise vendor-reported and unverified by a third party.
The honest framing is that the two companies are arguing past each other. Qwen3.8 Max's vendor table is built around enterprise and scientific work — the 0902 refresh Alibaba shipped on September 2 was further post-trained on Coding and Cowork, which Qwen says strengthens exactly that profile. DeepSeek V4 Pro's own claims center on deep reasoning and agentic tool use, where its four-week-old Codeforces and Terminal-Bench numbers still look strong. Neither vendor's table has been reproduced by an independent evaluator, and on the one scoreboard that is independent, the four-point gap is the whole difference between the models.
Tốc độ chính là điểm mà Qwen3.8 Max âm thầm đánh mất lợi thế
Khía cạnh mà bảng thông số kỹ thuật che giấu chính là tốc độ đầu ra. Artificial Analysis đo được DeepSeek V4 Pro đạt khoảng 81 token mỗi giây, so với khoảng 41 của Qwen3.8 Max — mức chênh lệch gấp đôi về tốc độ trả lời. Trong khối lượng công việc trò chuyện, đó là một độ trễ mà người dùng nhận thấy; còn trong vòng lặp agent với nhiều lệnh gọi tuần tự, nó cộng dồn thành thời gian thực tế trên đồng hồ. Tỷ lệ giá vốn đã nghiêng về V4 Pro, và khoảng cách tốc độ khiến chênh lệch chi phí thực tế trên mỗi câu trả lời còn lớn hơn mức mà phép tính token gợi ra.
Có một sự đánh đổi ẩn trong con số đó, và đó chính là tính dài dòng của Qwen3.8 Max. Artificial Analysis lưu ý rằng mô hình này "chậm một cách đáng chú ý và rất dài dòng", và chi phí cho mỗi tác vụ của nó — 2,67 USD so với 0,67 USD của V4 Pro — phản ánh cả mức giá cao hơn lẫn số token đầu ra tăng thêm. Một mô hình suy luận viết nhiều hơn cho mỗi câu trả lời sẽ tốn nhiều hơn cho mỗi tác vụ, ngay cả trước khi bạn nhân với bảng giá. Nếu khối lượng công việc của bạn nhạy cảm với độ trễ hoặc vòng lặp agent của bạn thực hiện hàng chục lệnh gọi, thì đó chính là con số bạn nên dùng để tự chạy đánh giá của riêng mình.
Trọng số: MIT so với giấy phép thương mại
DeepSeek V4 Pro is MIT-licensed with public weights — you can download them, serve them yourself, fine-tune them, and keep your modifications closed. Qwen3.8 Max is the first Max-class Qwen ever to ship open weights (the 2.4T A95B checkpoint landed on August 12), but under a commercial license with scale-tier conditions, and Alibaba has not published the full inference stack the way DeepSeek has. For a company comparing the two, the deployment story is the tie-breaker: V4 Pro can be self-hosted as infrastructure; Qwen3.8 Max is primarily a service you rent. The weights difference matters most if your concern is vendor lock-in or if you want to escape the API price entirely.
Ai nên chọn cái nào
Nếu khối lượng công việc của bạn nặng về suy luận, bị chi phối bởi token đầu ra hoặc nhạy cảm với độ trễ, thì DeepSeek V4 Pro là câu trả lời trên gần như mọi khía cạnh xuất hiện trong hóa đơn: rẻ hơn khoảng ba đến sáu lần ở đầu ra, nhanh hơn khoảng gấp đôi, chiết khấu bộ nhớ đệm sâu hơn và trọng số MIT như một lối thoát. Khoảng cách trí tuệ bốn điểm là có thật nhưng hẹp, và nó hiếm khi trụ được trước chênh lệch giá trên lưu lượng sản xuất.
Nếu khối lượng công việc của bạn mang hình dạng doanh nghiệp — phân tích nhiều bước phức tạp, suy luận logic chuyên sâu, công việc tác tử đòi hỏi cao, hoặc bất kỳ tác vụ nào mà chất lượng câu trả lời cận biên đáng giá gấp ba đến sáu lần chi phí token — thì bốn điểm cộng thêm của Qwen3.8 Max trên chỉ số độc lập và những tuyên bố benchmark doanh nghiệp mạnh hơn của nó chính là lý do để trả mức giá cao cấp. Bản làm mới 0902 làm sắc nét thêm đặc điểm đó. Và nếu bạn cần đầu vào hình ảnh hoặc video, lựa chọn không hề cân sức: Qwen3.8 Max chấp nhận văn bản, hình ảnh và video, trong khi DeepSeek V4 Pro chỉ hỗ trợ văn bản.
Cả hai mô hình đều có thể được gọi qua OrcaRouter chỉ với một khóa duy nhất — DeepSeek V4 Pro và Qwen3.8 Max đều định tuyến qua nền tảng này — và vì OrcaRouter chuyển tiếp nguyên giá niêm yết của nhà cung cấp mà không cộng thêm phụ phí, những con số trong bài viết này chính là những con số bạn thực sự phải trả, với các đợt giảm giá của nhà cung cấp được áp dụng ngay trong cùng ngày. DSL định tuyến cho phép bạn gửi lưu lượng nặng về token hoặc nhạy cảm về độ trễ đến DeepSeek V4 Pro, và các tác vụ suy luận đa phương thức hoặc quan trọng nhất đến Qwen3.8 Max từ cùng một tích hợp — đó chính xác là cách hầu hết các đội nhóm sử dụng cặp đôi này: cả hai, cho những gì mỗi mô hình làm tốt nhất.


Bản án
Sự tạm hoãn hồi tháng Chín đã giải quyết dứt điểm câu hỏi đang nhấn chìm cuộc so tài này: phần rẻ hơn không còn là nguy cơ "bỏ chạy" nữa. DeepSeek V4 Pro là câu trả lời về hiệu năng trên chi phí — rẻ hơn ba đến sáu lần ở phần đầu ra, nhanh gấp đôi, giấy phép MIT, và giờ đã cam kết duy trì trực tuyến. Qwen3.8 Max là câu trả lời về năng lực — cao hơn bốn điểm chỉ số độc lập, những tuyên bố dành cho doanh nghiệp mạnh mẽ hơn, đầu vào đa phương thức, và giấy phép thương mại khiến nó không thể nằm trong stack của bạn. Hãy chọn bốn điểm đó khi các bài đánh giá của bạn chứng minh chúng thực sự quan trọng; hãy chọn mức giá khi hóa đơn chính là bài đánh giá thực sự đưa ra quyết định.
Gửi lưu lượng nặng token hoặc nhạy cảm với độ trễ đến DeepSeek V4 Pro và phần suy luận đa phương thức hoặc có tính quyết định cao nhất đến Qwen3.8 Max từ cùng một tích hợp — đúng như cách hầu hết các nhóm cuối cùng sử dụng cặp kết hợp này: cả hai, cho những gì mỗi bên làm tốt nhất.
So sánh trong bài viết này1
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
