Một thẻ hero được tạo có tiêu đề 'DeepSeek V4 Pro vs MiniMax M3', với một biểu tượng ví mảnh ở bên trái được dán nhãn 'MiniMax M3' cùng huy hiệu '$0.30/$1.20 · text+image+video' và một biểu tượng ví lớn hơn một chút ở bên phải được dán nhãn 'DeepSeek V4 Pro' cùng huy hiệu '$0.66/$1.98 off-peak · MIT', với một biểu tượng số dư nhỏ ở giữa và dòng chân trang 'Cùng một cuộc chơi trọng số mở với mức giá gấp năm lần'.
Guides & Insights

DeepSeek V4 Pro vs MiniMax M3: Cùng một cuộc chơi trọng số mở với mức giá gấp năm lần

Tác giả

Elias Hawthorne

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

DeepSeek V4 Pro and MiniMax M3 are both open-weights reasoning models with a million-token context, and they are both cheap enough that the word "budget" no longer means "weak." But their launches could not look more different: MiniMax M3 (Mini​Max's 428B-parameter model, released June 2026) went out with a community license and a $0.30/$1.20 per million token price that undercut the entire field, while DeepSeek V4 Pro (released August 13, 2026, at $0.66/$1.98 off-peak, $1.32/$3.96 peak) arrived six weeks later with MIT-licensed weights and a slightly higher price. The twist is what happened to the more expensive one: between September 8 and 11, Deep​Seek first scheduled V4 Pro for retirement, then delayed it, then cancelled the retirement entirely, committing to keep serving it at unchanged billing. So the matchup that a month ago looked like "cheap and cheaper" now has a durability story on the one side that no one expected — and that makes it worth re-reading the whole thing.

Các phép đo độc lập dưới đây đến từ Artificial Analysis. Các số liệu do nhà cung cấp báo cáo được dán nhãn như vậy.

Hai mẫu flagship trọng số mở giá rẻ, cách nhau đúng một điểm chỉ số

Trên Artificial Analysis Intelligence Index, MiniMax M3 đạt 30 điểm, xếp hạng #16 trong phân khúc của mình, còn DeepSeek V4 Pro đạt 36 điểm, xếp hạng #7. Một khoảng cách sáu điểm giữa hai mô hình có chi phí gần như tương đương trên mỗi token. Đó chính là điểm đáng chú ý nhất: mô hình đắt hơn cũng là mô hình thông minh hơn một cách có thể đo lường được — nhưng chỉ hơn sáu điểm, và chỉ trên trục chỉ-văn-bản nơi V4 Pro tồn tại. MiniMax M3 nhận đầu vào văn bản, hình ảnh và video; V4 Pro chỉ nhận văn bản. Nếu đầu vào đa phương thức là một yêu cầu, thì so sánh dừng lại ở đó — MiniMax M3 là mô hình duy nhất trong hai mô hình đọc được video.

• Chỉ số Trí tuệ — V4 Pro 36 (#7/113) so với MiniMax M3 30 (#16/113)

• Giá — MiniMax M3 $0.30/$1.20 mỗi 1M so với V4 Pro $0.66/$1.98 ngoài giờ cao điểm ($1.32/$3.96 giờ cao điểm)

• Tốc độ — MiniMax M3 ~103 token/giây so với V4 Pro ~81 token/giây

• Ngữ cảnh — cả hai đều 1M token

• Tham số — MiniMax M3 tổng 428B / hoạt động 23B so với V4 Pro tổng 1.6T / hoạt động 49B

• Đầu vào — MiniMax M3 văn bản/hình ảnh/video so với V4 Pro chỉ văn bản

• License — Mini​Max Community License vs V4 Pro MIT

Cuộc đua giá gần nhau hơn những gì tấm nhãn dán giá thể hiện.

So sánh trực tiếp, MiniMax M3 rẻ hơn 2,2 lần ở đầu vào và rẻ hơn 1,65 lần ở đầu ra so với mức giá ngoài giờ cao điểm của V4 Pro. Nhưng giá niêm yết lại che giấu các cơ chế bộ nhớ đệm và giờ cao điểm. Khung giờ thấp điểm của V4 Pro cắt giảm một nửa mức giá vốn đã thấp của nó, và chiết khấu đọc bộ nhớ đệm của nó lên tới khoảng 97% — khoảng 0,02 USD cho mỗi triệu token được lưu trong bộ nhớ đệm ngoài giờ cao điểm. Cách định giá bộ nhớ đệm của MiniMax M3 ít mạnh tay hơn. Với một tác vụ tái sử dụng một tiền tố lớn — một prompt hệ thống lớn, một tài liệu dài, một kho ngữ liệu truy xuất — chi phí thực tế trên mỗi token của V4 Pro trong khung giá bộ nhớ đệm ngoài giờ cao điểm của nó có thể thấp hơn mức giá niêm yết của MiniMax M3, một sự đảo ngược đáng ngạc nhiên so với xếp hạng giá niêm yết. Với các tác vụ dùng token mới, MiniMax M3 rẻ hơn; với các tác vụ nặng về bộ nhớ đệm, V4 Pro có thể thắng.

Về tốc độ, câu chuyện cũng tương tự nhưng theo chiều ngược lại. MiniMax M3 tạo ra khoảng 103 token mỗi giây so với 81 của V4 Pro — nhanh nhất trong số các mô hình ở cùng phân khúc giá, và nhanh hơn một số mô hình có giá cao gấp năm lần. Lợi thế về tốc độ là có thật nhưng không quá lớn; lợi thế về giá mới quan trọng hơn, và nó phụ thuộc vào khối lượng công việc.

Giấy phép và độ bền: nơi tháng 9 thay đổi câu trả lời

Both models are open weights, but the licenses differ. MiniMax M3 ships under the MINI​MAX COMMUNITY LICENSE — permissive in spirit, but with its own terms. V4 Pro is MIT — about as unrestricted as an open-weights model gets, covering commercial use, fine-tuning, redistribution, and closed modifications. For enterprise adoption the MIT license is the cleaner story, and the gap shows up the moment your legal team reads the terms.

Câu hỏi về độ bền, vốn là một vấn đề thật sự cách đây một tháng, giờ lại là tin tức của tháng Chín. Deep​Seek đã dành nửa đầu tháng Chín để công bố việc V4 Pro sẽ ngừng hoạt động vào ngày 14 tháng Chín, hoãn lại, rồi — vào ngày 11 — hủy bỏ, kèm cam kết công khai sẽ tiếp tục phục vụ mô hình với mức tính phí không đổi và sẽ thông báo nếu điều đó thay đổi. MiniMax M3 không có kịch tính như vậy vì không ai kỳ vọng có: đây là một flagship trẻ, chưa có ý định ngừng hoạt động nào trong tầm ngắm. Nhưng hiệu quả thì vẫn như nhau: cả hai bên trong cuộc đối đầu này giờ đều có một lộ trình rõ ràng, điều mà cách đây hai tuần không thể nói được về một trong hai bên.

A screenshot of the DeepSeek API docs Models & Pricing page, captured September 15, 2026, showing the English-language pricing table for deepseek-v4-pro (DeepSeek-V4-Pro-0813) at $1.32 input and $3.96 output per million tokens at peak, and the footnote announcing that DeepSeek V4 Pro API service continues after September 14, 2026 with unchanged billing.

Ai nên chọn cái nào

Nếu khối lượng công việc của bạn bao gồm đầu vào hình ảnh hoặc video, quyết định đã rõ: MiniMax M3 là mẫu duy nhất trong hai mẫu đọc được chúng, với mức giá thấp nhất trong phân khúc của nó. Nếu khối lượng công việc của bạn chỉ có văn bản và nặng về bộ nhớ đệm — các tác nhân có lời nhắc hệ thống lớn, RAG tài liệu dài, tóm tắt các tập dữ liệu lớn — thì cửa sổ bộ nhớ đệm ngoài giờ cao điểm và giấy phép MIT của V4 Pro khiến nó trở thành lựa chọn có chi phí trên mỗi câu trả lời tốt hơn, đặc biệt là vì hiện nay nó được đảm bảo sẽ tiếp tục tồn tại. Nếu khối lượng công việc của bạn chỉ có văn bản và nhạy cảm với độ trễ, tốc độ 103 token/giây cùng mức giá $0.30/$1.20 của MiniMax M3 khiến nó trở thành lựa chọn rẻ và nhanh nhất trên thị trường.

Cả hai mô hình đều có sẵn thông qua OrcaRouter chỉ với một khóa, với giá niêm yết của nhà cung cấp được chuyển nguyên ở mức không cộng thêm phí — nên những con số ở trên chính là số tiền bạn phải trả — và tính năng chuyển đổi dự phòng tự động giữa các nhà cung cấp là câu trả lời thực tế cho điều duy nhất mà màn so tài này không thể xác định trước: nhà cung cấp của mô hình nào sẽ trụ vững dưới tải thực tế của bạn. Định tuyến lưu lượng đa phương thức đến MiniMax M3 và công việc văn bản ngữ cảnh dài đến DeepSeek V4 Pro chỉ là một thay đổi routing-DSL gồm hai dòng, và tính năng chuyển đổi dự phòng nghĩa là một trục trặc nhà cung cấp ở bất kỳ bên nào cũng chỉ là một lần thử lại, chứ không phải một sự cố.

A screenshot of the OrcaRouter model page for deepseek/deepseek-v4-pro, captured September 15, 2026, showing the 1M token context window, 384K max output, a reasoning-mode toggle, the input price of $0.66 and output price of $1.98 per million tokens, and the model description reading 'DeepSeek V4 Pro flagship MoE — 1.6T total / 49B active params, 1M context'.A generated scoreboard titled 'DeepSeek V4 Pro vs MiniMax M3 — the scoreboard': left column DeepSeek V4 Pro rows AA Index 36 (#7/113), Price $0.66/$1.98 off-peak, Speed ~81 tok/s, Context 1M, Input text, Weights MIT; right column MiniMax M3 rows AA Index 30 (#16/113), Price $0.30/$1.20, Speed ~103 tok/s, Context 1M, Input text+image+video, Weights Community License; footer 'AA figures independent; DeepSeek price is vendor list off-peak.'

Bản án

Đây là cuộc so tài sát nút nhất trong dòng DeepSeek V4 Pro, vì cả hai mô hình đều rẻ, đều có trọng số mở và đều nhanh. MiniMax M3 thắng về giá thuần, tốc độ và đầu vào đa phương thức. DeepSeek V4 Pro thắng về trí tuệ, giấy phép rõ ràng và — kể từ ngày 11 tháng 9 — độ chắc chắn về độ bền. Câu trả lời một dòng: tác vụ đa phương thức hoặc văn bản nhạy cảm với độ trễ thì dùng MiniMax M3; tác vụ nặng về bộ nhớ đệm, chỉ có văn bản hoặc nhạy cảm về pháp lý thì dùng DeepSeek V4 Pro.

Định tuyến lưu lượng đa phương thức đến MiniMax M3 và phần việc văn bản ngữ cảnh dài đến DeepSeek V4 Pro: MiniMax M3 một thay đổi DSL định tuyến chỉ hai dòng.

So sánh trong bài viết này1

Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày