
Giá API DeepSeek V4 Pro: 0,73 USD/2,18 USD vào giờ thấp điểm, và vì sao việc ngừng hoạt động ngày 14 tháng 9 đã bị hủy bỏ
- openaiMỚIOpenAI: GPT-6.1 Sol2026-09-2952Trí tuệ
- anthropicMỚIAnthropic: Claude Sonnet 5.52026-09-2856Trí tuệ
- typesafeMỚITypeSafe: Jev 1.132026-09-24$0.04 / $0.00 trên 1 triệu token · 223 tok/s
- OpenAIMỚIOpenAI: GPT-6 Luna2026-09-2238Trí tuệ
- OpenAIMỚIOpenAI: GPT-6 Sol2026-09-2248Trí tuệ
- AnthropicMỚIAnthropic: Claude Opus 5.52026-09-2258Trí tuệ
- xAIMỚIGrok 4.72026-09-2146Trí tuệ
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 trên 1 triệu token · 126 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token · 1148 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 trên 1 triệu token · 48 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token · 103 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token · 213 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
DeepSeek V4 Pro không bị ngừng cung cấp. Vào ngày 11 tháng 9 năm 2026, DeepSeek cho biết họ sẽ tiếp tục phục vụ mô hình này thông qua API sau ngày 14 tháng 9, với phương thức tính phí không thay đổi — đảo ngược kế hoạch được công bố hai ngày trước đó, theo đó mọi yêu cầu deepseek-v4-pro sẽ được chuyển hướng sang DeepSeek V4.1 Flash và tính phí theo mức giá của Flash. Đối với bất kỳ ai có prompt, cài đặt temperature và schema gọi công cụ được tinh chỉnh cho V4 Pro, đó chính là sự thật quan trọng trong tuần này: mô hình mà bạn đã xây dựng dựa trên vẫn giữ nguyên vị trí, và việc di chuyển mà bạn có thể đã lên lịch cho thứ Hai không nhất thiết phải diễn ra.
Giá cả lại là câu chuyện khác, và trang này đã ghi sai suốt một tháng. DeepSeek V4 Pro không còn có giá $0.44/$0.88 cho mỗi triệu token nữa. Ngoài giờ cao điểm, nó tính $0.726 cho đầu vào và $2.178 cho đầu ra trên mỗi 1M token trên OrcaRouter, tăng gấp đôi lên $1.452/$4.356 trong các khung giờ cao điểm, với đọc cache ở mức $0.024. Cuối tuần giờ đây hoàn toàn là ngoài giờ cao điểm. Và bảng giá của chính nhà cung cấp — bảng nằm ở tài liệu API của DeepSeek — mang thông báo tiếp tục như một chú thích cho cùng bảng giá đó, điều gần với nguồn sơ cấp nhất mà một trang giá có thể có.
DeepSeek thực sự đã nói gì, và những gì nó hoàn tác
Thứ tự thời gian quan trọng, vì hai trong ba thông báo trái ngược nhau và cái ở giữa mới là cái người ta nhớ.
• Ngày 9 tháng 9 — DeepSeek thông báo với người dùng rằng cho đến khi V4.1 Pro ra mắt, các yêu cầu gửi đến V4 Pro sẽ được định tuyến đến DeepSeek V4.1 Flash và được tính phí theo mức giá của V4.1 Flash.
• Ngày 10 tháng 9 — V4.1 Flash đã ra mắt, và DeepSeek đã dời thời điểm chuyển đổi sang một mốc cố định: 12:00 giờ Bắc Kinh ngày 14 tháng 9 năm 2026, sau đó V4 Pro sẽ ngừng hoạt động và lưu lượng truy cập của nó sẽ do Flash đảm nhiệm.
• Ngày 11 tháng 9 — DeepSeek đã đảo ngược quyết định. Nguyên văn lời lẽ của họ, giờ được giữ nguyên xi như một chú thích trên trang Models & Pricing thuộc tài liệu API của chính họ: "Trước nhu cầu của người dùng, chúng tôi đã quyết định tiếp tục cung cấp dịch vụ API cho DeepSeek V4 Pro sau ngày 14 tháng 9 năm 2026, với phương thức tính phí giữ nguyên không đổi. Chúng tôi sẽ thông báo thêm nếu có bất kỳ thay đổi nào."
Đó là lời của nhà cung cấp nói về sản phẩm của chính họ, và đây là nguồn thông tin vững chắc nhất hiện có ở đây — nhưng hãy đọc kỹ điều nó giải quyết và điều nó không giải quyết. Nó giải quyết tính liên tục và việc thanh toán: V4 Pro vẫn được giữ, với mức giá đang có hiệu lực. Nó không hứa hẹn về khung thời gian.Chúng tôi sẽ thông báo thêm là toàn bộ cam kết, và chính câu đó để ngỏ khả năng gói dịch vụ quay trở lại. Nếu bạn đang cam kết cho nhiều quý, hãy lên kế hoạch dựa trên mô hình mà bạn có thể rời bỏ, thay vì mô hình mà bạn có thể giữ lại.
Phản ứng dữ dội buộc phải đảo ngược đáng để hiểu, vì nó ánh xạ vào một quyết định mà chính bạn có thể sắp đưa ra. Các nhà phát triển phản đối không phải V4.1 Flash — thứ mà DeepSeek nói vượt V4 Pro về hiệu năng, giá, tốc độ và tổng thời gian tác vụ — mà là việc tự động thay thế. Việc hoán đổi mô hình đằng sau một model ID ổn định làm thay đổi hành vi mà không đổi mã: một prompt đã tinh chỉnh, một temperature đang hoạt động, một schema gọi công cụ phân tích được đều là thuộc tính của một checkpoint cụ thể. Đưa tin trên CLS (科创板日报), 36Kr, IT之家 và ifeng, và bằng tiếng Anh tại TheBlockBeats, mô tả DeepSeek thoạt đầu trì hoãn, rồi từ bỏ kế hoạch; tài liệu của chính DeepSeek cho thấy sự tương phản rõ ràng, vì các tên deepseek-v4-flash cũ đã bị ngừng hỗ trợ và giờ phục vụ V4.1 Flash, và việc chuyển đổi đó vẫn giữ nguyên. Còn việc chuyển sang Pro thì không.
Giá hôm nay, được đối chiếu với bảng giá của chính nhà cung cấp

Hai con số quan trọng, và chúng là cùng một mức giá niêm yết tính bằng hai loại tiền tệ.
• Ngoài giờ cao điểm (mọi giờ nằm ngoài các khung giờ cao điểm bên dưới) — đầu vào $0,726 mỗi 1M khi cache miss, hoặc ¥4,5; đầu ra $2,178, hoặc ¥13,5; đầu vào khi cache hit $0,024, hoặc ¥0,15.
• Cao điểm — đúng gấp đôi. Đầu vào $1.452 / ¥9, đầu ra $4.356 / ¥27, đầu vào khi trúng bộ nhớ đệm $0.048 / ¥0.30.
• Quy đổi đô la của chính DeepSeek — tài liệu của nhà cung cấp in cùng danh sách giá nhân dân tệ tương ứng với $0.66 cho đầu vào / $1.98 cho đầu ra ngoài giờ cao điểm và $1.32 / $3.96 vào giờ cao điểm, với các lượt trúng bộ đệm ở mức $0.022 và $0.044. Khoảng cách so với các con số đô la của OrcaRouter nằm ở tỷ giá hối đoái mà mỗi bên quy đổi, chứ không phải một khoản phí token cộng thêm: OrcaRouter chuyển tiếp nguyên mức giá của nhà cung cấp mà không tăng giá, nên con số trên bảng niêm yết chính là con số bạn phải trả.
• Không có gói miễn phí cho V4 Pro. Có một gói Flash miễn phí trên danh mục, nhưng sản phẩm chủ lực chỉ dành cho người trả phí.
• Bảng thông số kỹ thuật, để làm bối cảnh — V4 Pro là một mô hình trọng số mở theo giấy phép MIT, tổng cộng 1,6T tham số với 49B hoạt động mỗi token, cửa sổ ngữ cảnh 1M token và tối đa 384K token đầu ra, ở giới hạn đồng thời 500. Artificial Analysis liệt kê 72,3 token đầu ra mỗi giây.
Phiên bản mô hình đằng sau tất cả những điều này là DeepSeek-V4-Pro-0813, không thay đổi kể từ bản phát hành chính thức ngày 13 tháng 8 — và đó chính là điểm mấu chốt. Không có gì về checkpoint thay đổi vào ngày 11 tháng 9; chỉ có quyết định về tương lai của nó là thay đổi.
Giờ cao điểm, giờ thấp điểm và quy tắc cuối tuần làm thay đổi cách tính
Chương trình cao điểm/ngoài cao điểm mà phiên bản trước của trang này mô tả là sẽ ra mắt vào ngày 17 tháng 8 nay đã ra mắt được một tháng, và đã được sửa đổi một lần kể từ đó.
• Các khung giờ cao điểm — 01:00–04:00 và 06:00–10:00 UTC, từ Thứ Hai đến Thứ Sáu. Theo giờ Bắc Kinh, tức là 09:00–12:00 và 14:00–18:00, ngày làm việc của chính DeepSeek. Giá ngoài giờ cao điểm đúng bằng một nửa giá cao điểm, chứ không phải là một mức giảm giá cộng thêm lên trên mức cao điểm.
• Cuối tuần hoàn toàn nằm ngoài giờ cao điểm. Kể từ 00:00 giờ Bắc Kinh ngày 23 tháng 8 năm 2026, DeepSeek đã ngừng áp dụng mức giá cao điểm vào thứ Bảy và Chủ nhật. Nếu công việc theo lô của bạn có thể dời thời gian, việc chuyển nó sang cuối tuần sẽ giảm một nửa hóa đơn — và với các nhóm phục vụ người dùng ở châu Mỹ, phần lớn tuần làm việc vốn đã rơi vào giờ thấp điểm mà không cần lên lịch gì cả.
• Thay đổi này tốn bao nhiêu, so với mức ¥3/¥6 mà mô hình ra mắt hồi ngày 13 tháng 8 — giá đầu ra ngoài giờ cao điểm hiện nay là 2,25× mức khi ra mắt và giá đầu ra giờ cao điểm là 4,5×; giá đầu vào trúng bộ nhớ đệm giờ cao điểm là 12× mức ¥0,025 cũ.
Có một sự bất đối xứng ở đây giải thích vì sao câu hỏi về việc chuyển đổi vẫn liên tục xuất hiện ngay cả sau khi việc dừng dịch vụ đã bị hủy. Giá của V4 Pro đã tăng vào tháng 8 trong khi giá của sản phẩm kế nhiệm lại giảm: DeepSeek đã cắt giảm giá API dòng Flash tới 60%, có hiệu lực từ ngày 10 tháng 9. Áp lực phải chuyển đổi thực ra chưa bao giờ thực sự đến từ thông báo ngày 14 tháng 9; thông báo chỉ khiến nó trở nên cấp bách.
Chi phí thực tế của một yêu cầu
Ba ví dụ đã tính theo mức giá ngoài giờ cao điểm của hôm nay. Cả ba đều tăng gấp đôi trong khung giờ cao điểm.
• 100K đầu vào + 50K đầu ra — $0.0726 + $0.1089 ≈ $0.18.
• 1M đầu vào + 1M đầu ra — $0.726 + $2.178 = $2.90. Cùng một lần gọi đó là $5.81 vào giờ cao điểm, và là $1.32 vào giữa tháng Tám.
• Phiên agentic, 500K đầu vào + 200K đầu ra — $0.363 + $0.4356 ≈ $0.80.
Chế độ xem theo tháng nằm trên trang mô hình và là phép thử trung thực để biết liệu tiêu đề cũ có còn mô tả đúng hóa đơn của bạn hay không: với 10M token mỗi tháng cùng tỷ lệ đầu vào 70%, công cụ tính chi phí cho ra $11.62, hoặc khoảng $9.16 khi bật prompt caching. Nếu ngân sách của bạn được lập dựa trên $0.44, thì nay nó chỉ còn chi trả được khoảng 60% hóa đơn.
Cache is the lever nobody puts in the table.
Bộ nhớ đệm prompt trở nên có giá trị hơn, chứ không phải kém đi, khi mức giá tăng lên — và chính hướng biến động của hai con số là lý do. Trên OrcaRouter, một lần đọc từ bộ nhớ đệm hiện được tính ở mức $0,024 cho mỗi 1M token, so với $0,726 khi không dùng bộ nhớ đệm, tức mức giảm giá 96,7% cho bất kỳ đầu vào nào bạn gửi lại. Ở phiên bản trước của trang này, mức giá bộ nhớ đệm là $0,060 so với giá đầu vào $0,442, tức mức giảm giá 86%. Giá đọc từ bộ nhớ đệm đã giảm hơn một nửa trong khi giá đầu vào không dùng bộ nhớ đệm tăng 64%, vì vậy khoảng cách thực tế giữa một token có bộ nhớ đệm và một token không có bộ nhớ đệm đã nới rộng đáng kể.
Đối với một agent gửi lại một system prompt lớn và ngữ cảnh dài mỗi lượt, đầu vào được lưu trong bộ nhớ đệm chính là sự khác biệt giữa một hóa đơn tăng theo độ dài cuộc hội thoại và một hóa đơn không tăng. Nguyên tắc thực tế vẫn không thay đổi và đáng được nhắc lại: hãy đặt system prompt ổn định và tài liệu tham chiếu lên trước, còn nội dung dễ thay đổi ở cuối, để tiền tố bạn gửi lại thực sự trúng bộ nhớ đệm. Trên mô hình này, lựa chọn cấu trúc duy nhất đó có giá trị hơn bất kỳ quyết định định tuyến hay lập lịch nào bên dưới nó.
Giá V4 Pro so với các đối thủ

Giá niêm yết trong danh mục cho đầu vào/đầu ra trên mỗi 1 triệu token, được kiểm tra ngày 2026-09-12, đối chiếu với mức giá ngoài giờ cao điểm của V4 Pro là $0.726/$2.178. Hai mục trong số này đã thay đổi kể từ khi trang này được xuất bản lần đầu, và một trong số đó làm thay đổi kết luận.
• Claude Fable 5 — $10 / $50. V4 Pro rẻ hơn 13,8 lần ở đầu vào và 23 lần ở đầu ra.
• Claude Opus 5 — 5 USD / 25 USD. 6,9× / 11,5×.
• GPT-5.6 Sol — 4 USD / 20 USD cho tối đa 272K ngữ cảnh, 8 USD / 30 USD khi vượt quá. 5,5× / 9,2× ở bậc ngắn hơn, 11× / 13,8× ở bậc dài hơn.
• Kimi K3 — $3 / $15. 4,1× / 6,9×.
• Qwen3.8 Max — 2 USD / 6 USD. 2,8× / 2,8×.
• Grok 4.5 — 2 đô la / 6 đô la. 2,8× / 2,8×.
• Gemini 3.6 Flash — $0,75 / $3,75. Gần như ngang giá về đầu vào ở mức 1,03×, và 1,7× về đầu ra. Giá của nó đã giảm một nửa kể từ khi trang này được viết.
• MiniMax M3 — 0,30 USD / 1,20 USD. Giờ đây rẻ hơn V4 Pro ở cả hai mức: V4 Pro tốn hơn 2,4 lần ở đầu vào và 1,8 lần ở đầu ra, với cùng cửa sổ 1 triệu token.
• DeepSeek V4 Flash — $0.242 / $0.726 trên danh mục. Rẻ hơn khoảng 3 lần ở cả hai mức, cùng ngữ cảnh 1M.
Vậy cách diễn đạt trung thực đã thay đổi, và trang này nên phản ánh điều đó thay vì giữ lại lời khen ngợi cũ. DeepSeek V4 Pro không còn là mô hình ngữ cảnh 1M rẻ nhất trên bảng: Gemini 3.6 Flash và MiniMax M3 đều có giá thấp hơn nó, và MiniMax M3 làm được điều đó trong khi vẫn đạt cùng cửa sổ ngữ cảnh. Điều mà V4 Pro vẫn là, với mức rẻ hơn hơn một bậc độ lớn, chính là thứ rẻ nhất trong phân khúc tiên phong — mọi mô hình đẳng cấp flagship phương Tây trong danh sách đó đều tốn gấp nhiều lần nó trên cả hai dòng. Nếu câu hỏi là “lời gọi ngữ cảnh 1M rẻ nhất có thể”, câu trả lời không còn là mô hình này nữa. Nếu câu hỏi là “mô hình rẻ nhất hành xử như một mô hình tiên phong”, thì hiện tại vẫn là nó.
Khi V4 Pro là lựa chọn sai
• Nếu lưu lượng truy cập của bạn cao nhất vào ban ngày theo giờ Bắc Kinh. Giờ cao điểm tính giá gấp đôi, và các khung giờ cao điểm trùng đúng với ngày làm việc của Trung Quốc. Nếu người dùng của bạn ở châu Mỹ, phần lớn lưu lượng truy cập của bạn vốn đã rơi vào giờ thấp điểm, đây là một lợi thế cấu trúc thực sự. Nếu bạn đang xây dựng cho người dùng ở Trung Quốc, hãy mô hình hóa hóa đơn giờ cao điểm một cách rõ ràng trước khi bạn cam kết — và kiểm tra xem quy tắc cuối tuần có giúp bạn dịch chuyển bất kỳ thứ gì không.
• Nếu prompt của bạn ngắn. Dưới khoảng 10K token ngữ cảnh, tầng flagship là sự lãng phí năng lực. DeepSeek V4 Flash ở mức $0.242/$0.726 trên danh mục xử lý cùng ngữ cảnh 1M với giá chỉ bằng khoảng một phần ba, và với những tác vụ thực sự ngắn thì một mô hình rẻ hơn vẫn thắng.
• Nếu bạn cần khả năng thị giác. V4 Pro chỉ hỗ trợ văn bản — không có đầu vào hình ảnh hay âm thanh — và Artificial Analysis liệt kê phương thức đầu vào của nó là văn bản. Gemini 3.6 Flash hoặc Claude Fable 5 là lựa chọn phù hợp hơn nếu phương thức đầu vào chính là điều bạn quan tâm. API riêng của DeepSeek cũng đáng lưu ý ở đây: hiện nó phục vụ các tên mô hình flash kế thừa của mình bằng V4.1 Flash, vốn có chấp nhận hình ảnh.
• Nếu bạn đang tìm mua điểm số thô đứng đầu bảng xếp hạng thay vì giá trên mỗi lượng ngữ cảnh. Trên thang đo hiện tại của Artificial Analysis, V4 Pro đạt 36 điểm trên Intelligence Index — xếp thứ 8 trong số 113 mô hình tại thời điểm viết bài — và 69 điểm trên chỉ số Coding như được ghi trong danh mục OrcaRouter. Đó là mức cạnh tranh, chứ không phải dẫn đầu: Claude Fable 5, Claude Opus 5 và GPT-5.6 Sol đều có điểm coding cao hơn nó. Điểm bán của V4 Pro là năng lực cận biên giới ở một phần nhỏ mức giá trên mỗi token, chứ không phải vị trí đứng đầu mọi bảng xếp hạng.
Cách gọi nó trên OrcaRouter

DeepSeek V4 Pro được lưu trữ trên OrcaRouter với mã mô hình deepseek/deepseek-v4-pro, được phục vụ qua endpoint tương thích OpenAI tại api.orcarouter.ai/v1 theo mức giá của nhà cung cấp, không tính thêm phí. Việc di chuyển từ một client OpenAI hiện có chỉ là thay đổi base-URL và mã mô hình, không gì khác.
Việc đảo ngược làm thay đổi điều bạn nên làm về nó. Nếu bạn đã có một cuộc di trú ngày 14 tháng 9 trên lịch — chuyển điểm trỏ từ V4 Pro sang DeepSeek V4.1 Flash vì Pro sắp bị gỡ bỏ — bạn có thể xóa nó khỏi lịch, hoặc ít nhất hạ nó từ hạn chót xuống thành một bài kiểm tra. Cả hai mô hình nằm sau một khóa OrcaRouter duy nhất, nên việc so sánh chúng chỉ là thay đổi model-ID trong một yêu cầu thay vì một hợp đồng thứ hai và một SDK thứ hai; và nếu bạn thực sự muốn V4.1 Flash được đánh giá trên lưu lượng thật mà không đặt cược một đường production vào nó, thì failover tự động là cách ít rủi ro để cho nó nhận các yêu cầu trực tiếp trong khi V4 Pro vẫn là phương án dự phòng. Đó là hình hài thực tế của quyết định ngày 11 tháng 9: lựa chọn vẫn thuộc về bạn, và nó vẫn có thể đảo ngược.
Lưu ý trung thực quan trọng đối với một trang giá: chúng tôi định tuyến đến mô hình, chúng tôi không đặt giá cho nó. Các con số $0.726/$2.178 cho giờ thấp điểm là mức giá của DeepSeek được chuyển tiếp nguyên vẹn, và chúng thay đổi khi DeepSeek thay đổi chúng — đó chính là lý do trang này được ghi ngày tháng, và lý do phiên bản bạn đang đọc đã được viết lại thay vì được nối thêm vào.
Nguồn và ngày tháng
Giá và thông số kỹ thuật trên trang này đã được xác minh lại vào ngày 12/09/2026. Các con số tính bằng đô la cho DeepSeek V4 Pro và cho mọi mô hình trong bảng so sánh đều được lấy từ danh mục mô hình của OrcaRouter, được kiểm tra cùng ngày; số lượng tham số, giấy phép, cửa sổ ngữ cảnh, phương thức và các chỉ số tốc độ đến từ trang mô hình của Artificial Analysis dành cho DeepSeek V4 Pro 0813. Tỷ giá nhân dân tệ, các khung giờ cao điểm và thông báo gia hạn ngày 11 tháng 9 đều lấy từ tài liệu Models & Pricing của chính DeepSeek, nơi tuyên bố này được ghi nguyên văn dưới dạng chú thích cho bảng giá. Chuỗi thông báo gồm ba bước — thông báo định tuyến ngày 9 tháng 9, việc hoãn đến 12:00 giờ Bắc Kinh ngày 14 tháng 9 vào ngày 10 tháng 9, và cú đảo ngược ngày 11 tháng 9 — được đưa tin bởi CLS (科创板日报), 36Kr, IT之家 và ifeng, và bằng tiếng Anh bởi TheBlockBeats. Quy tắc tính phí cuối tuần ngày 23 tháng 8 và đợt giảm giá Flash ngày 10 tháng 9 đều xuất phát từ các thông báo của DeepSeek, theo đưa tin của IT之家, The Paper và 21st Century Business Herald.
Một lưu ý cuối về độ đáng tin cậy, vì mức giá cụ thể này đã thay đổi ba lần trong một tháng — giá ra mắt ngày 13 tháng 8, cao điểm/ngoài cao điểm ngày 17 tháng 8, bản sửa đổi cuối tuần ngày 23 tháng 8. Hãy coi bất kỳ trang “V4 Pro pricing” nào không ghi ngày là không thể dùng được. Phiên bản trước của trang này đã ghi $0,44/$0,88 và chỉ số Intelligence của Artificial Analysis là 44,3; cả hai đều đúng khi chúng được viết ra, và cả hai đều không trụ được qua tháng.
So sánh trong bài viết này3
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
