Một thẻ hero được tạo có tiêu đề 'DeepSeek V4 Pro vs Kimi K3' với biểu tượng đồng hồ đo tốc độ ở bên trái được dán nhãn 'DeepSeek V4 Pro' và gắn huy hiệu '~81 tok/s · /bin/bash.66/.98', cùng biểu tượng bộ não ở bên phải được dán nhãn 'Kimi K3' và gắn huy hiệu 'Index 44 · .00/5.00', với một đường phân cách kiểu đường đua tinh tế ở giữa chúng và dòng chân trang 'Tốc độ và giá so với mức trần suy luận'.
Guides & Insights

DeepSeek V4 Pro so với Kimi K3: Tốc độ và giá cả trước mức trần suy luận 44 điểm

Tác giả

Gideon Frost

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

DeepSeek V4 ProKimi K3 là hai mẫu flagship suy luận trọng số mở với cửa sổ một triệu token, và cuộc cạnh tranh giữa chúng đã định hình ổn định từ một tháng trước: Kimi K3 (mô hình 2,8T tham số của Moonshot AI, phát hành ngày 16 tháng 7 năm 2026) là người dẫn đầu về trí tuệ, còn DeepSeek V4 Pro (phát hành ngày 13 tháng 8 năm 2026) là người dẫn đầu về tốc độ và giá. Điểm mới là nửa rẻ hơn trong cặp đôi đó suýt bị xóa sổ trong nửa đầu tháng Chín — DeepSeek đưa V4 Pro vào lộ trình ngừng phục vụ từ ngày 14 tháng 9 vào ngày mùng 8, rồi trì hoãn, và đến ngày 11 thì hủy hẳn việc ngừng phục vụ, cam kết tiếp tục cung cấp mô hình với mức tính phí không đổi. Điều đó còn quan trọng hơn với cặp đấu này so với hầu hết các cặp khác, bởi "rẻ, nhanh, ngữ cảnh 1M, trọng số mở" là tổ hợp khó thay thế khi phương án thay thế có giá đắt gấp năm lần.

Các số liệu độc lập là các đo lường của Artificial Analysis. Các benchmark ra mắt của chính DeepSeek và Moonshot được gắn nhãn do nhà cung cấp báo cáo, vì cả hai đều chưa được tái lập một cách độc lập.

Kimi K3 thắng về chỉ số; V4 Pro thắng về hóa đơn

Bảng điểm độc lập không hề mập mờ về việc ai thông minh hơn. Kimi K3 ở mức nỗ lực tối đa đạt 44 điểm trên Artificial Analysis Intelligence Index, xếp hạng #2 trong số các mô hình tương đương. DeepSeek V4 Pro đạt 36 điểm, xếp hạng #7 trong cùng phân khúc. Khoảng cách chín điểm đó chính là toàn bộ lý do người ta chấp nhận mức giá của Kimi K3. Và chính mức giá là lý do cuộc so tài không thể chỉ được phân định bằng chỉ số: Kimi K3 niêm yết ở mức $3.00 mỗi triệu token đầu vào và $15.00 mỗi triệu token đầu ra, trong khi V4 Pro niêm yết ở mức $0.66/$1.98 ngoài giờ cao điểm ($1.32/$3.96 giờ cao điểm). Về đầu ra, con số đó vào khoảng 7,5 lần — trước khi áp dụng chiết khấu bộ nhớ đệm. Giá đọc bộ nhớ đệm của V4 Pro vào khoảng $0.02 mỗi triệu token ngoài giờ cao điểm, tức chiết khấu 97%; mức chiết khấu bộ nhớ đệm 90% của Kimi K3 lại bắt đầu từ một mức giá gốc cao hơn nhiều. Với khối lượng công việc nặng về token, khoảng cách hiệu quả sẽ nới rộng tới khoảng mười lần.

• Chỉ số Thông minh — Kimi K3 44 (#2/113) so với V4 Pro 36 (#7/113)

• Giá — Kimi K3 $3.00/$15.00 mỗi 1M so với V4 Pro $0.66/$1.98 ngoài giờ cao điểm ($1.32/$3.96 giờ cao điểm)

• Tốc độ — V4 Pro ~81 token/giây so với Kimi K3 ~35 token/giây

• Ngữ cảnh — cả hai đều 1M token

• Thông số — Kimi K3 tổng 2.8T / 104B hoạt động so với V4 Pro tổng 1.6T / 49B hoạt động

• Trọng số — cả hai đều mở (Kimi K3 trọng số mở, V4 Pro MIT)

• Đầu vào — Kimi K3 văn bản và hình ảnh so với V4 Pro chỉ văn bản

Tốc độ là phần mà ai cũng xem nhẹ

Khoảng cách mà không ai nhắc đến chính là thông lượng. V4 Pro cho ra khoảng 81 token mỗi giây khi được đo độc lập; Kimi K3 đạt khoảng 35. Trong một vòng lặp agent, nơi mô hình viết vài nghìn token mỗi bước, đó là khác biệt giữa một tác vụ hoàn thành trong vài phút và một tác vụ kéo dài suốt cả buổi chiều — và chênh lệch chi phí còn khiến điều đó thêm phần nghiêm trọng, bởi vì bạn đang trả 15 đô la cho mỗi triệu token đầu ra với tốc độ chỉ bằng khoảng một nửa. Đối với các trợ lý lập trình tương tác, xử lý tài liệu hàng loạt, và bất kỳ khối lượng công việc nào mà thời gian thực tế là một khoản trong ngân sách, sự kết hợp của V4 Pro — tốc độ gấp 2,3 lần với mức giá đầu ra chỉ bằng một phần bảy — chính là câu trả lời vượt trội.

Khi chín điểm là xứng đáng

Lý lẽ trung thực ủng hộ Kimi K3 là trần suy luận. Chi phí đánh giá của nó trên Intelligence Index vào khoảng $3,658 cho lần chạy — phản ánh những chuỗi suy luận thực sự dài và tốn kém, chứ không phải một điểm bất thường trong cách định giá. Nếu khối lượng công việc của bạn là suy luận khó — chứng minh toán học sâu, lập kế hoạch tầm xa, các tác vụ agent kéo dài nhiều giờ, nơi thêm chín điểm chỉ số thể hiện thành ít lỗi hơn — thì Kimi K3 xứng đáng với mức giá cao của nó. Lý lẽ trung thực chống lại nó là mọi thứ khác: thông lượng, kinh tế cache, và mức giá trên mỗi token đơn thuần.

Lý do khác khiến sự đảo chiều tháng Chín trở nên quan trọng ở đây: cách đây một tháng, lời khuyên hợp lý là “nếu bạn định chuẩn hóa trên mô hình mở rẻ, nhanh, hãy phòng ngừa rủi ro — nó có thể bị khai tử.” Tính đến ngày 15 tháng Chín, biện pháp phòng ngừa đó đã lỗi thời. DeepSeek đã công khai cam kết, với việc hứa sẽ thông báo nếu có bất kỳ thay đổi nào, rằng sẽ giữ V4 Pro trên API, và giấy phép MIT nghĩa là mô hình vẫn có thể triển khai trên phần cứng của riêng bạn bất kể DeepSeek làm gì với API của mình. Trọng số mở của Kimi K3 mang lại sự tự do tương tự ở phía bên kia, và đó chính là điều khiến đây trở thành một so sánh thực sự giữa hai mô hình trọng số mở, thay vì một cuộc đối đầu giữa một dịch vụ và một sản phẩm.

A screenshot of the DeepSeek API docs Models & Pricing page, captured September 15, 2026, showing the English-language pricing table for deepseek-v4-pro (DeepSeek-V4-Pro-0813) at .32 input and .96 output per million tokens at peak, and the footnote announcing that DeepSeek V4 Pro API service continues after September 14, 2026 with unchanged billing.

Cả hai mô hình đều có trên OrcaRouter — DeepSeek V4 Pro và Kimi K3 đều định tuyến qua nền tảng chỉ với một khóa, giá niêm yết của nhà cung cấp được chuyển nguyên ở mức không tăng giá — và DSL định tuyến là cách tự nhiên để phân tách cặp so tài này: định tuyến các tác vụ suy luận tầm xa cho Kimi K3, nơi chín điểm ấy phát huy giá trị, và định tuyến công việc thông lượng nặng token cho DeepSeek V4 Pro, nơi khoảng cách giá 7,5 lần và khoảng cách tốc độ 2,3 lần tự làm thay bạn. Hai mô hình này bổ trợ cho nhau cũng thường xuyên như khi cạnh tranh, và nền tảng này khiến việc chạy cả hai tốn công sức đúng bằng chạy một.

A screenshot of the OrcaRouter model page for deepseek/deepseek-v4-pro, captured September 15, 2026, showing the 1M token context window, 384K max output, a reasoning-mode toggle, the input price of /bin/bash.66 and output price of .98 per million tokens, and the model description reading 'DeepSeek V4 Pro flagship MoE — 1.6T total / 49B active params, 1M context'.A generated scoreboard titled 'DeepSeek V4 Pro vs Kimi K3 — the scoreboard': left column DeepSeek V4 Pro rows AA Index 36 (#7/113), Price /bin/bash.66/.98 off-peak, Speed ~81 tok/s, Context 1M, Active params 49B/1.6T, Weights MIT; right column Kimi K3 rows AA Index 44 (#2/113), Price .00/5.00, Speed ~35 tok/s, Context 1M, Active params 104B/2.8T, Weights open; footer 'AA figures independent; DeepSeek price is vendor list off-peak.'

Điểm mấu chốt

Kimi K3 là mô hình trọng số mở thông minh hơn, dẫn trước chín điểm chỉ số, và phần phí cao hơn của nó — gấp 7,5 lần trên token đầu ra, tốc độ chỉ bằng khoảng một nửa — là một chi phí thực sự, không phải sai số làm tròn. DeepSeek V4 Pro là con ngựa thồ nhanh, rẻ, bền bỉ, và sau ngày 11 tháng 9, nó không còn là rủi ro biến mất nữa. Câu trả lời thực tế chính là điều mà cả hai cột giá đều chỉ ra: nếu tác vụ của bạn là suy luận khó, hãy mua Kimi K3; nếu chúng ngốn nhiều token và nhạy cảm về thời gian, hãy mua DeepSeek V4 Pro; và nếu bạn có cả hai loại, hãy chạy cả hai và định tuyến theo tác vụ.

So sánh trong bài viết này1

Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày