
GPT-6 Sol Pro vs DeepSeek V4 Pro: Mức giá cố định đối đầu với lịch trình
- openaiMỚIOpenAI: GPT-6 Luna2026-09-2237Trí tuệ
- openaiMỚIOpenAI: GPT-6 Sol2026-09-2248Trí tuệ
- anthropicMỚIAnthropic: Claude Opus 5.52026-09-2258Trí tuệ
- grokMỚIGrok 4.72026-09-2146Trí tuệ
- OrcaMỚIOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 trên 1 triệu token
- orcaMỚIOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token
- deepseekMỚIDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- openaiOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- googleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- anthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- grokSpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
- metaMeta: Muse Spark 1.22026-08-0540Trí tuệ72Lập trình
- qwenQwen: Qwen3.8 Max2026-08-0345Trí tuệ76Lập trình
GPT-6 Sol Pro và DeepSeek V4 Pro hiện là hai cách đáng tin cậy rẻ nhất để chạy một khối lượng công việc suy luận nghiêm túc qua API, và chúng được định giá theo những nguyên tắc hoàn toàn khác nhau. GPT-6 Sol — mô hình của nhà cung cấp mà cấu hình gpt-6-sol-pro chạy, được cung cấp rộng rãi từ ngày 22 tháng 9 năm 2026 — có giá $2.00 cho mỗi triệu token đầu vào và $10.00 cho mỗi triệu token đầu ra, vào mọi giờ mỗi ngày. DeepSeek V4 Pro, mô hình chủ lực trọng số mở mà checkpoint 0813 đạt được cung cấp rộng rãi vào ngày 13 tháng 8 năm 2026, có giá $0.66 và $1.98 trong phần lớn tuần và đúng gấp đôi mức đó trong hai khung giờ hẹp vào buổi sáng các ngày trong tuần. Bất kỳ so sánh nào chỉ nêu một mức giá là đang nêu một nửa mức giá.
Lịch trình chính là câu chuyện. Mọi thứ khác về màn so găng này — điểm chỉ số, cửa sổ ngữ cảnh, điều khoản giấy phép — đều là hệ quả của việc một trong hai nhà cung cấp này đã quyết định rằng giá niêm yết của mình là một hàm của đồng hồ.
Mỗi dòng giá thực chất là gì
Bảng giá của GPT-6 Sol chỉ có một dòng. Đầu vào $2,00, đầu vào đã cache $0,20, ghi cache $2,50, đầu ra $10,00 mỗi triệu token, kèm mức định giá lại cho ngữ cảnh dài khi vượt một ngưỡng đầu vào, áp dụng cho toàn bộ yêu cầu một khi đã vượt ngưỡng. Không có yếu tố thời gian và không có cửa sổ khuyến mãi. OpenAI đã hạ mô hình tiền nhiệm xuống các con số này vào ngày 22 tháng 9 và mô tả chúng là vĩnh viễn.
Bảng giá của DeepSeek là một bảng. Đúng như đọc trên trang báo giá của chính nhà cung cấp:
• Đầu vào ngoài giờ cao điểm — $0,66 mỗi triệu token, trượt cache; $0,022 mỗi triệu token, trúng cache
• Đầu ra ngoài giờ cao điểm — $1,98 mỗi triệu token
• Đầu vào cao điểm — $1,32 mỗi triệu token, trượt bộ nhớ đệm; $0,044 mỗi triệu token, trúng bộ nhớ đệm
• Đầu ra cao nhất — $3.96 mỗi triệu token
• Khung giờ cao điểm — 01:00–04:00 và 06:00–10:00 UTC, Thứ Hai đến Thứ Sáu, không bao gồm các ngày lễ công cộng của Trung Quốc
• Mọi thứ còn lại — giờ thấp điểm, bao gồm cả toàn bộ cuối tuần, một quy định có hiệu lực từ nửa đêm theo giờ Bắc Kinh ngày 23 tháng 8 năm 2026
Bảy giờ cao điểm trong một tuần 168 giờ, năm ngày trong bảy ngày, tương đương khoảng 21% lịch ở mức giá cao hơn và 79% ở mức thấp hơn. Vậy nên bản tóm tắt trung thực bằng một con số duy nhất về DeepSeek V4 Pro không phải là $0.66 và cũng không phải $1.32 — nó nằm ở đâu đó ở giữa, và vị trí đó phụ thuộc vào hình dạng lưu lượng truy cập của bạn, không phải vào sự hào phóng của nhà cung cấp.
Việc định giá lại mà bảng này ra đời từ đó
Điều đáng biết là cấu trúc này mới ra đời gần đây đến mức nào, vì gần như mọi trang so sánh vẫn còn trích dẫn con số mà nó đã thay thế. Vào ngày 22 tháng 5 năm 2026, DeepSeek đã chuyển mức giảm giá có thời hạn trên V4 Pro thành mức giá vĩnh viễn — mức giảm khoảng 75%, xuống còn khoảng $0.435 cho đầu vào và $0.87 cho đầu ra trên mỗi triệu token.
Vào nửa đêm giờ Bắc Kinh ngày 17 tháng 8 năm 2026, điều đó đã bị đảo ngược và thậm chí còn hơn thế. Hệ thống cao điểm/thấp điểm đã đi vào hoạt động với mức tăng trung bình trên các dòng bị ảnh hưởng khoảng 3,5 lần và tối đa 12 lần — mức 12× rơi chính xác vào mức giá đầu vào cache-hit, vốn đã tăng từ ¥0,025 lên ¥0,30 mỗi triệu token vào giờ cao điểm. Đầu vào cache-miss tăng khoảng 200% và đầu ra tăng khoảng 350%. Sáu ngày sau, ưu đãi cuối tuần đã được bổ sung, giúp lấy lại một phần số đó cho bất kỳ ai có thể chuyển các tác vụ theo lô của mình.
Có hai hệ quả kéo theo. Thứ nhất, bất kỳ trang nào nói với bạn rằng DeepSeek V4 Pro là một mô hình dưới một đô-la đều đang trích dẫn một bảng giá đã bị thay thế hai lần. Thứ hai, hình dạng của mức tăng là một tín hiệu về điều mà DeepSeek đang tối ưu hóa: mức tăng theo tỷ lệ lớn nhất nằm ở cache hit, đây chính là mức giá có ý nghĩa nhất đối với đúng loại khối lượng công việc — những vòng lặp agent dài liên tục gửi lại một tiền tố ổn định — đã khiến mô hình này trở nên hấp dẫn ngay từ đầu.

Chỉ số mà mọi người đang trích dẫn đã bị ngừng sử dụng.
Artificial Analysis là bộ khung đánh giá trung lập cho so sánh này, và nó đã nhiều lần cập nhật phiên bản Chỉ số Thông minh của mình trong suốt năm 2026. Trên bảng hiện tại, GPT-6 Sol đạt 48 điểm ở mức nỗ lực tối đa với chi phí 1,06 USD cho mỗi tác vụ chỉ số. DeepSeek V4 Pro, trên checkpoint 0813 ở mức nỗ lực tối đa, đạt 36 điểm với chi phí 0,67 USD cho mỗi tác vụ chỉ số.
Con số được lan truyền cho DeepSeek là 53. Con số đó là thật và đã được công bố — trong một bản sửa đổi trước đó của chỉ số, trước một lần đổi phiên bản khiến điểm của hầu hết mô hình thay đổi. Việc so sánh con số 53 lấy từ một bài viết trước v4.3 với con số 48 hiện tại là so sánh một phép đo đã ngừng sử dụng với một phép đo còn hiệu lực, và nó tạo ra lỗi phổ biến nhất trong cuộc đối đầu này: khẳng định rằng hai mô hình chỉ cách nhau một điểm. Trên chỉ số hiện tại, chúng cách nhau mười hai điểm, và khoảng cách giá trên mỗi tác vụ hoàn thành không phải 3× như mức giá niêm yết gợi ý mà gần với 1,6×, vì DeepSeek dùng nhiều token hơn để đi đến câu trả lời.
Hai điểm dữ liệu độc lập khác nên được đặt bên cạnh những điểm đó, cả hai đều được dán nhãn đúng với bản chất của chúng. Vals AI, khi vận hành một harness biệt lập, xếp DeepSeek V4 Pro ở mức 96,40% trên SWE-bench Verified với chi phí 0,103 USD mỗi bài kiểm tra — đứng thứ hai trên bảng đó sau 97,00% của Claude Opus 5, và rẻ hơn đáng kể xét theo mỗi bài kiểm tra. Bảng coding-agent của Artificial Analysis cho thấy 14% trên Terminal-Bench 4.0, so với 44% của GPT-6 Sol. Con số thứ nhất cho thấy DeepSeek có sức cạnh tranh trên một tác vụ lập trình hẹp, được định nghĩa rõ ràng. Con số thứ hai cho thấy nó không cạnh tranh được trong công việc terminal mang tính tác tử. Cả hai đều đúng và chúng đang đo những thứ khác nhau.
Ở những điểm mà hai mô hình khác biệt về cấu trúc, chứ không chỉ khác nhau về giá
• Giấy phép — GPT-6 Sol là một API đóng và không có trọng số; DeepSeek V4 Pro được cấp phép theo MIT với các checkpoint công khai trên Hugging Face, bao gồm cả các biến thể base để tiếp tục tiền huấn luyện
• Đầu ra tối đa — GPT-6 Sol 128.000 token so với DeepSeek V4 Pro 384.000 token, gấp ba lần giới hạn tối đa với một phần năm tốc độ đầu ra
• Cửa sổ ngữ cảnh — GPT-6 Sol 1.050.000 token so với DeepSeek V4 Pro 1.048.576 token, thực tế là giống hệt nhau
• Các phương thức — cả văn bản đầu vào và văn bản đầu ra; cả hai đều không chấp nhận hình ảnh trên API
• Định giá theo ngữ cảnh dài — GPT-6 Sol định giá lại toàn bộ yêu cầu vượt trên ngưỡng đầu vào của nó; lịch trình cao điểm/ngoài cao điểm của DeepSeek V4 Pro là cấu trúc giá duy nhất mà nó có
• Quy mô — DeepSeek V4 Pro là mô hình mixture-of-experts 1,6 nghìn tỷ tham số với 49 tỷ tham số hoạt động trên mỗi token; OpenAI không công bố con số tương đương cho GPT-6 Sol
Một lưu ý về số lượng tham số đó, vì đây là nguồn gây nhầm lẫn thường gặp: con số 1,7 nghìn tỷ xuất hiện trong một số danh mục là kích thước gói Hugging Face khi bao gồm mô-đun giải mã suy đoán DSpark tùy chọn, chứ không phải một mô hình đích rộng hơn. Kiến trúc được công bố có tổng cộng 1,6T. Việc trừ các huy hiệu đã được làm tròn để suy ra kích thước của mô-đun nháp không phải là một phép tính hợp lệ, và việc đọc con số lớn hơn như bằng chứng rằng mô hình đã tăng kích thước cũng không hợp lệ.

Việc rút lại mới chính là lập luận thực sự cho trọng số mở.
Vào ngày 9 tháng 9 năm 2026, DeepSeek thông báo rằng họ đang loại bỏ dần V4 Pro, và rằng từ 04:00 UTC ngày 14 tháng 9, mọi yêu cầu tới chuỗi model deepseek-v4-pro sẽ được định tuyến tới DeepSeek V4.1 Flash và bị tính phí theo mức giá của Flash, tiếp tục như vậy cho đến khi một model V4.1 Pro được phát hành. Chuỗi model vẫn sẽ trả lời. Model đằng sau nó sẽ không phải là model mà bất kỳ ai đã benchmark.
Các nhà phát triển đã phản đối, và việc chuyển hướng đã bị rút lại. Nhật ký thay đổi của DeepSeek giờ đây nêu rằng dịch vụ V4 Pro API tiếp tục sau ngày 14 tháng 9 với việc tính phí không thay đổi, và bảng giá vẫn liệt kê deepseek-v4-pro như một dòng đang hoạt động với mức giá riêng và không có nhãn ngừng cung cấp. Trang thông báo trước đó vẫn chứa nội dung về định tuyến, nên hai tài liệu mâu thuẫn với nhau — và trang giá đang hoạt động là trang mô tả điều thực sự xảy ra khi bạn gọi nó.
Sự việc đó là lập luận mạnh nhất trong toàn bộ cuộc so tài này, và đó không phải là lập luận về giá. Một mô hình đóng có thể bị định giá lại, định tuyến lại hoặc ngừng cung cấp theo lịch trình của nhà cung cấp, và cách duy nhất để xử lý là di trú. Một mô hình có trọng số MIT trên kho lưu trữ công khai có thể được phục vụ từ hạ tầng của chính bạn, nghĩa là checkpoint bạn đã đánh giá chính là checkpoint bạn tiếp tục phục vụ, bất kể lộ trình của nhà cung cấp nói gì sáu tuần sau đó. DeepSeek đã chứng minh rủi ro và cung cấp biện pháp giảm thiểu trong cùng hai tuần.
Đối trọng trung thực là việc tự vận hành một mô hình 1,6 nghìn tỷ tham số không phải là quyết định mà hầu hết các nhóm đưa ra một cách tùy tiện. Đó là một lựa chọn thực sự với chi phí cố định thực sự, không phải một biện pháp phòng hộ miễn phí.
Nơi một lớp định tuyến thay đổi phép tính
DeepSeek V4 Pro có trong danh mục của OrcaRouter. Cả checkpoint hiện tại lẫn chuỗi model gốc đều phân giải được — deepseek/deepseek-v4-pro-0813 và deepseek/deepseek-v4-pro — theo mức giá niêm yết ngoài giờ cao điểm với hệ số nhân giờ cao điểm được áp dụng theo cùng lịch UTC, cửa sổ ngữ cảnh 1.048.576 token, giới hạn đầu ra 384.000 token, và thời gian đến token đầu tiên p50 là 3,56 giây theo đo lường trên chính trang model của chúng tôi. Giá niêm yết của nhà cung cấp được chuyển nguyên vẹn, không cộng thêm phụ phí, điều này trong trường hợp này có nghĩa là ranh giới cao điểm/ngoài giờ cao điểm xuất hiện trên hóa đơn của bạn đúng cùng thời điểm nó xuất hiện trên hóa đơn của DeepSeek.
GPT-6 Sol không phải là một trong những tuyến của chúng tôi, vì vậy không có nội dung nào ở đây là tuyên bố về giá của nó thông qua chúng tôi.

Lịch trình chính là điều khiến việc chỉ dùng một endpoint duy nhất trở nên đáng giá trong trường hợp cụ thể này. Một khối lượng công việc có thể dịch chuyển có giá trị gấp đôi so với một khối lượng công việc không thể dịch chuyển, và việc dịch chuyển nó là một quyết định định tuyến, chứ không phải một cuộc di trú — vẫn cùng một key, cùng một dạng request, chỉ khác giờ hoặc khác model đứng phía sau. Ghép DeepSeek V4 Pro với DeepSeek V4.1 Flash trên cùng một endpoint là phiên bản sắc nét hơn của ý tưởng đó: model Flash rẻ hơn 4,4× ở đầu vào và rẻ hơn 3,3× ở đầu ra so với mức giá ngoài giờ cao điểm của V4 Pro, trên cùng cửa sổ ngữ cảnh và cùng các khung giờ cao điểm, khiến nó trở thành đích đến tự nhiên cho lượng traffic vốn không cần đến model lớn hơn chút nào. Tự động chuyển đổi dự phòng quan trọng vì đúng lý do như mọi khi — tầng giá rẻ mà pipeline của bạn được xây dựng dựa trên đó không nên là một điểm lỗi đơn lẻ.
Quy tắc quyết định
• Công việc theo lô và ngoại tuyến có thể lên lịch — DeepSeek V4 Pro, và hãy lên lịch cho nó. Chín mươi lăm phần trăm lịch ở mức 0,66 đô la và 1,98 đô la, với toàn bộ cuối tuần đều là giờ thấp điểm, là mức giá đáng tin cậy rẻ nhất trên bảng này, rẻ hơn gấp ba lần ở đầu vào và gấp năm lần ở đầu ra.
• Lưu lượng tương tác nhạy cảm với độ trễ rơi vào các khung giờ cao điểm — GPT-6 Sol. Mức cố định $2.00 và $10.00 đắt hơn mức giá ngoài cao điểm của DeepSeek và rẻ hơn không có gì, nhưng có thể biết trước, và trong hai giờ mỗi ngày, nó là lựa chọn rẻ hơn trong hai lựa chọn về đầu ra.
• Vòng lặp agent với tiền tố ổn định lớn — hãy tính toán số học cache-hit trước khi chọn. Đầu vào cache-hit của DeepSeek là $0,022 ngoài giờ cao điểm, tức bằng một phần chín mức $0,20 của GPT-6 Sol, nhưng đó cũng là dòng mà DeepSeek đã tăng gấp mười hai lần vào giờ cao điểm. Lợi thế là có thật và nó phụ thuộc vào thời điểm.
• Bất cứ thứ gì chịu quy định, hoặc bất cứ thứ gì bạn không thể để bị định tuyến lại — DeepSeek V4 Pro, tự triển khai từ checkpoint MIT. Việc thu hồi vào tháng Chín là nghiên cứu điển hình, và đó là lý do tốt hơn để chấp nhận chi phí cố định so với bất kỳ so sánh theo token nào.
• Bất cứ thứ gì cần đến đỉnh cao nhất của dải năng lực agentic — GPT-6 Sol. Mười hai điểm chỉ số và ba mươi điểm Terminal-Bench không phải là khác biệt chỉ do làm tròn, và những con số do chính nhà cung cấp DeepSeek báo cáo cũng không thu hẹp được khoảng cách đó.
Giá cố định và bảng giá theo thời gian đều là những thiết kế định giá trung thực. Chúng chỉ trả lời những câu hỏi khác nhau: một bên cho bạn biết một token tốn bao nhiêu, bên kia cho bạn biết một token tốn bao nhiêu khi bạn cần đến nó.
So sánh trong bài viết này3
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
