Một thẻ hero được tạo có tiêu đề 'DeepSeek V4 Pro vs Qwen3.8 Max' với hai thẻ bo tròn — một thẻ DeepSeek V4 Pro mang nhãn '$0.66 / $1.98 ngoài giờ cao điểm · trọng số mở MIT · ngữ cảnh 1M' và một thẻ Qwen3.8 Max mang nhãn '$2.00 / $6.00 · giấy phép thương mại · ngữ cảnh 1M' — được phân tách bằng biểu tượng cân bằng và chân trang 'Gấp ba lần giá, bốn điểm thông minh — cái nào trụ nổi khi chạm trán hóa đơn của bạn?'
Guides & Insights

DeepSeek V4 Pro vs Qwen3.8 Max: Khoảng cách giá gấp 3 lần, chạy lại sau đợt tạm hoãn tháng 9

Tác giả

Rowan Sterling

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

DeepSeek V4 Pro and Qwen3.8 Max are the two most important open-or-cheap flagships of this generation, and the September events on the Deep​Seek side changed the matchup more than either vendor's marketing has acknowledged. DeepSeek V4 Pro shipped on August 13, 2026, ten days after Aliba​ba's Qwen3.8 Max went generally available on August 3, and the pairing has always read as a one-sided contest: Qwen3.8 Max is the 2.4-trillion-parameter all-rounder at $2 per million input and $6 per million output tokens, while DeepSeek V4 Pro is the 1.6-trillion-parameter reasoning specialist at a fraction of that price, MIT-licensed, with public weights. The reason this comparison is worth re-running today is not the launch-week numbers but what happened a month later — Deep​Seek spent the week of September 8 trying to retire V4 Pro, then reversed on September 11 and committed to keeping it online at unchanged billing. That reversal is the single most important fact about this matchup right now, because it decides whether the cheap half is a safe bet or a migration trap.

Independent measurements in this piece come from Artificial Analysis, captured today. Aliba​ba's and Deep​Seek's own benchmark tables are labeled vendor-reported throughout — neither company's launch numbers have been fully reproduced by a third party, and Deep​Seek's are now four weeks old against a moving scoreboard.

Sự hoãn lại vào tháng Chín mới là câu chuyện, chứ không phải đợt ra mắt vào tháng Tám

Vào ngày 8 tháng 9, Deep​Seek thông báo rằng sau ngày 14 tháng 9, mọi yêu cầu gửi đến deepseek-v4-pro sẽ được định tuyến tới V4.1 Flash và tính phí theo mức giá của Flash cho đến khi V4.1 Pro được phát hành. Bất kỳ ai đang thực hiện một so sánh nghiêm túc giữa Qwen3.8 Max và DeepSeek V4 Pro đều phải bắt đầu tính đến việc phương án giá rẻ sẽ biến mất. Rồi Deep​Seek đã hoãn thời hạn cắt, và đến ngày 11 tháng 9 thì đảo ngược hoàn toàn, tuyên bố sẽ tiếp tục cung cấp dịch vụ API cho DeepSeek V4 Pro sau ngày 14 tháng 9 với mức tính phí không đổi, và sẽ thông báo nếu điều đó có bao giờ thay đổi. Việc đảo ngược này đã được truyền thông nhà nước Trung Quốc và báo chí công nghệ đưa tin cùng ngày hôm đó.

Tác động của điều này lên cuộc so găng là loại bỏ sự bất đối xứng vốn đang âm thầm định hướng các quyết định. Suốt tuần đầu tiên của tháng Chín, câu trả lời trung thực cho câu hỏi "tôi nên xây dựng trên mô hình output $0.66 hay mô hình output $6?" đã bị pha nhiễu bởi rủi ro tồn vong: mô hình dẫn đầu về giá có một ngày dừng hoạt động. Kể từ ngày 15 tháng Chín, sự pha nhiễu đó đã biến mất. Lựa chọn rẻ là bền vững, và sự so sánh cuối cùng cũng xoay quanh đúng điều mà nó luôn đáng lẽ phải xoay quanh — trí tuệ, giá cả và tốc độ.

A generated scoreboard titled 'DeepSeek V4 Pro vs Qwen3.8 Max — the scoreboard': left column DeepSeek V4 Pro rows AA Index 36 (#7/113), Price $0.66/$1.98 off-peak, Speed ~81 tok/s, Context 1M, License MIT open weights, Input text; right column Qwen3.8 Max rows AA Index 40 (#30/200), Price $2.00/$6.00, Speed ~41 tok/s, Context 1M, License Commercial, Input text + image + video; footer 'AA figures independent (current scale); DeepSeek price is vendor list off-peak.'

Giá: vẫn là trò chơi đó, với chi phí đầu ra chỉ bằng một phần nhỏ

Trên bảng điểm độc lập hiện tại, hai mô hình cách nhau bốn điểm, và khoảng cách giá giữa chúng là lớn nhất trong phân khúc trọng số mở. Qwen3.8 Max có giá $2.00 cho mỗi triệu token đầu vào và $6.00 cho mỗi triệu token đầu ra theo giá niêm yết của Aliba​ba, với mức chiết khấu bộ nhớ đệm 88%. DeepSeek V4 Pro có giá $0.66 cho mỗi triệu token đầu vào và $1.98 cho mỗi triệu token đầu ra vào giờ thấp điểm, tăng gấp đôi lên $1.32/$3.96 vào giờ cao điểm, với mức chiết khấu bộ nhớ đệm 97%.

• Giá — DeepSeek V4 Pro $0.66/$1.98 cho mỗi 1M ngoài giờ cao điểm (giờ cao điểm $1.32/$3.96) so với Qwen3.8 Max $2.00/$6.00 cố định

• Chỉ số Thông minh — V4 Pro 36 (#7/113) so với Qwen3.8 Max 40 (#30/200)

• Tốc độ xuất — V4 Pro ~81 token/giây so với Qwen3.8 Max ~41 token/giây

• Chi phí mỗi tác vụ — V4 Pro $0.67 so với Qwen3.8 Max $2.67 (theo mỗi tác vụ của chỉ số AA)

• Ngữ cảnh — cả hai đều 1M token

• Giấy phép — V4 Pro MIT trọng số mở so với Qwen3.8 Max trọng số độc quyền, giấy phép thương mại

The output-price ratio is the whole argument: Qwen3.8 Max costs three times as much per input token and roughly three times per output token at V4 Pro's peak rate — and the gap on output widens to six times when V4 Pro is billed at its off-peak rate, which covers most of the week outside a narrow window. On a reasoning-heavy workload, where output tokens dominate the bill, that gap is the difference between a model you can leave running and one you watch in the dashboard. The cache lines widen it further: V4 Pro's 97% discount against Qw​en's 88% means a long-context task with a reused prefix costs a fraction of its list price on the Deep​Seek side.

Trí tuệ: cách nhau bốn điểm, và khoảng cách đó mới chính là sản phẩm thực sự

The independent scoreboard makes this closer than the price ratio suggests. On the current Artificial Analysis Intelligence Index, Qwen3.8 Max scores 40 against DeepSeek V4 Pro's 36 — a four-point gap that shows up in reasoning-heavy work but disappears in token-heavy work. Qwen3.8 Max's edge is real and consistent: it ranks #30 of 200 overall, just inside the frontier, while V4 Pro ranks #7 of 113 in its open-weights class. On Aliba​ba's own benchmark table, Qwen3.8 Max claims a Terminal-Bench 2.1 of 86.6, GPQA Diamond 92.6, and a FrontierSWE 73.5 that nearly doubled its predecessor's 40.7 — all vendor-reported, none reproduced independently. Deep​Seek's model card claims a Codeforces rating of 3,348 and a Terminal-Bench 2.1 of 87.9 at maximum reasoning effort — likewise vendor-reported and unverified by a third party.

The honest framing is that the two companies are arguing past each other. Qwen3.8 Max's vendor table is built around enterprise and scientific work — the 0902 refresh Aliba​ba shipped on September 2 was further post-trained on Coding and Cowork, which Qw​en says strengthens exactly that profile. DeepSeek V4 Pro's own claims center on deep reasoning and agentic tool use, where its four-week-old Codeforces and Terminal-Bench numbers still look strong. Neither vendor's table has been reproduced by an independent evaluator, and on the one scoreboard that is independent, the four-point gap is the whole difference between the models.

Tốc độ chính là điểm mà Qwen3.8 Max âm thầm đánh mất lợi thế

Khía cạnh mà bảng thông số kỹ thuật che giấu chính là tốc độ đầu ra. Artificial Analysis đo được DeepSeek V4 Pro đạt khoảng 81 token mỗi giây, so với khoảng 41 của Qwen3.8 Max — mức chênh lệch gấp đôi về tốc độ trả lời. Trong khối lượng công việc trò chuyện, đó là một độ trễ mà người dùng nhận thấy; còn trong vòng lặp agent với nhiều lệnh gọi tuần tự, nó cộng dồn thành thời gian thực tế trên đồng hồ. Tỷ lệ giá vốn đã nghiêng về V4 Pro, và khoảng cách tốc độ khiến chênh lệch chi phí thực tế trên mỗi câu trả lời còn lớn hơn mức mà phép tính token gợi ra.

Có một sự đánh đổi ẩn trong con số đó, và đó chính là tính dài dòng của Qwen3.8 Max. Artificial Analysis lưu ý rằng mô hình này "chậm một cách đáng chú ý và rất dài dòng", và chi phí cho mỗi tác vụ của nó — 2,67 USD so với 0,67 USD của V4 Pro — phản ánh cả mức giá cao hơn lẫn số token đầu ra tăng thêm. Một mô hình suy luận viết nhiều hơn cho mỗi câu trả lời sẽ tốn nhiều hơn cho mỗi tác vụ, ngay cả trước khi bạn nhân với bảng giá. Nếu khối lượng công việc của bạn nhạy cảm với độ trễ hoặc vòng lặp agent của bạn thực hiện hàng chục lệnh gọi, thì đó chính là con số bạn nên dùng để tự chạy đánh giá của riêng mình.

Trọng số: MIT so với giấy phép thương mại

DeepSeek V4 Pro is MIT-licensed with public weights — you can download them, serve them yourself, fine-tune them, and keep your modifications closed. Qwen3.8 Max is the first Max-class Qw​en ever to ship open weights (the 2.4T A95B checkpoint landed on August 12), but under a commercial license with scale-tier conditions, and Aliba​ba has not published the full inference stack the way Deep​Seek has. For a company comparing the two, the deployment story is the tie-breaker: V4 Pro can be self-hosted as infrastructure; Qwen3.8 Max is primarily a service you rent. The weights difference matters most if your concern is vendor lock-in or if you want to escape the API price entirely.

Ai nên chọn cái nào

Nếu khối lượng công việc của bạn nặng về suy luận, bị chi phối bởi token đầu ra hoặc nhạy cảm với độ trễ, thì DeepSeek V4 Pro là câu trả lời trên gần như mọi khía cạnh xuất hiện trong hóa đơn: rẻ hơn khoảng ba đến sáu lần ở đầu ra, nhanh hơn khoảng gấp đôi, chiết khấu bộ nhớ đệm sâu hơn và trọng số MIT như một lối thoát. Khoảng cách trí tuệ bốn điểm là có thật nhưng hẹp, và nó hiếm khi trụ được trước chênh lệch giá trên lưu lượng sản xuất.

Nếu khối lượng công việc của bạn mang hình dạng doanh nghiệp — phân tích nhiều bước phức tạp, suy luận logic chuyên sâu, công việc tác tử đòi hỏi cao, hoặc bất kỳ tác vụ nào mà chất lượng câu trả lời cận biên đáng giá gấp ba đến sáu lần chi phí token — thì bốn điểm cộng thêm của Qwen3.8 Max trên chỉ số độc lập và những tuyên bố benchmark doanh nghiệp mạnh hơn của nó chính là lý do để trả mức giá cao cấp. Bản làm mới 0902 làm sắc nét thêm đặc điểm đó. Và nếu bạn cần đầu vào hình ảnh hoặc video, lựa chọn không hề cân sức: Qwen3.8 Max chấp nhận văn bản, hình ảnh và video, trong khi DeepSeek V4 Pro chỉ hỗ trợ văn bản.

Cả hai mô hình đều có thể được gọi qua OrcaRouter chỉ với một khóa duy nhất — DeepSeek V4 Pro và Qwen3.8 Max đều định tuyến qua nền tảng này — và vì OrcaRouter chuyển tiếp nguyên giá niêm yết của nhà cung cấp mà không cộng thêm phụ phí, những con số trong bài viết này chính là những con số bạn thực sự phải trả, với các đợt giảm giá của nhà cung cấp được áp dụng ngay trong cùng ngày. DSL định tuyến cho phép bạn gửi lưu lượng nặng về token hoặc nhạy cảm về độ trễ đến DeepSeek V4 Pro, và các tác vụ suy luận đa phương thức hoặc quan trọng nhất đến Qwen3.8 Max từ cùng một tích hợp — đó chính xác là cách hầu hết các đội nhóm sử dụng cặp đôi này: cả hai, cho những gì mỗi mô hình làm tốt nhất.

A screenshot of the Artificial Analysis page for Qwen3.8 Max, captured September 15, 2026, showing the Intelligence Index score of 40 at rank 30 of 200, output speed 40.6 tokens per second, an input price of $2.00 and output price of $6.00 per million tokens with an 88% cache discount, and a cost of $2.67 per Intelligence Index task.A screenshot of the OrcaRouter model page for Qwen3.8 Max at orcarouter.ai/models/qwen/qwen3.8-max, captured September 15, 2026, showing the model listing with its provider Qwen, 1M-token context window, text+image+video input, and $2.00/$6.00 per-million-token pricing alongside the surrounding catalogue.

Bản án

Sự tạm hoãn hồi tháng Chín đã giải quyết dứt điểm câu hỏi đang nhấn chìm cuộc so tài này: phần rẻ hơn không còn là nguy cơ "bỏ chạy" nữa. DeepSeek V4 Pro là câu trả lời về hiệu năng trên chi phí — rẻ hơn ba đến sáu lần ở phần đầu ra, nhanh gấp đôi, giấy phép MIT, và giờ đã cam kết duy trì trực tuyến. Qwen3.8 Max là câu trả lời về năng lực — cao hơn bốn điểm chỉ số độc lập, những tuyên bố dành cho doanh nghiệp mạnh mẽ hơn, đầu vào đa phương thức, và giấy phép thương mại khiến nó không thể nằm trong stack của bạn. Hãy chọn bốn điểm đó khi các bài đánh giá của bạn chứng minh chúng thực sự quan trọng; hãy chọn mức giá khi hóa đơn chính là bài đánh giá thực sự đưa ra quyết định.

Gửi lưu lượng nặng token hoặc nhạy cảm với độ trễ đến DeepSeek V4 Pro và phần suy luận đa phương thức hoặc có tính quyết định cao nhất đến Qwen3.8 Max từ cùng một tích hợp — đúng như cách hầu hết các nhóm cuối cùng sử dụng cặp kết hợp này: cả hai, cho những gì mỗi bên làm tốt nhất.

So sánh trong bài viết này1

Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày