
GPT-6 Sol so với DeepSeek V4 Pro: Khoảng cách chỉ số 12 điểm cho mức giá gấp bốn lần
- OrcaMỚIOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 trên 1 triệu token
- orcaMỚIOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token
- deepseekMỚIDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- openaiOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- googleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- anthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- grokSpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
- metaMeta: Muse Spark 1.22026-08-0540Trí tuệ72Lập trình
- qwenQwen: Qwen3.8 Max2026-08-0345Trí tuệ76Lập trình
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Trí tuệ69Lập trình
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 trên 1 triệu token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Here is the arithmetic nobody puts on a launch page. DeepSeek V4 Pro scores 36 on Artificial Analysis's Intelligence Index. GPT-6 Sol scores 48. GPT-6 Sol costs $2.00 per million input tokens and $10.00 per million output. DeepSeek V4 Pro costs $1.32 and $3.96 on the same board — and its own published rate card, converted, comes to roughly $0.42 and $0.87. So the twelve-point gap between GPT-6 Sol and DeepSeek V4 Pro is bought at somewhere between one and a half and four times the price depending on whose rate card you read, and the model on the cheaper side is the one you can download and run yourself.
Đó là toàn bộ quyết định, và nó thật sự sát sao hơn mức bảng điểm gợi ý. DeepSeek V4 Pro ra mắt vào ngày 13 tháng 8 năm 2026 dưới dạng mô hình mixture-of-experts được cấp phép MIT với tổng cộng 1,6 nghìn tỷ tham số và 49 tỷ tham số hoạt động mỗi token. GPT-6 Sol ra mắt vào ngày 22 tháng 9 năm 2026 dưới dạng mô hình tiên phong trọng số đóng với mức giá bằng một nửa so với chính phiên bản tiền nhiệm của nó. Một cái là món hàng hóa bạn có thể tự vận hành; cái còn lại là năng lực bạn thuê. Cả hai đều có cửa sổ ngữ cảnh một triệu token. Cả hai đều là mô hình suy luận. Không bên nào rõ ràng là lựa chọn mua sai.
Con số quyết định điều này
Bắt đầu với điểm mà cả hai nhà cung cấp đều đồng ý: ngữ cảnh. DeepSeek V4 Pro có cửa sổ ngữ cảnh 1M với đầu ra tối đa 384K. GPT-6 Sol được Artificial Analysis liệt kê ở mức 872.000 token so với mức trần 1,05M, với giới hạn đầu ra 128K ở nơi khác trong tài liệu của OpenAI. DeepSeek cho bạn không gian đầu ra gấp ba lần và cửa sổ đầu vào tương đương.
Vậy là điều mà chỉ một trong hai có: một ngưỡng tái định giá đột ngột theo ngữ cảnh dài. Mức 2 USD/10 USD của GPT-6 Sol giữ nguyên dưới 272.000 token đầu vào. Vượt qua mức đó, toàn bộ yêu cầu được tái định giá — đầu vào tăng gần gấp đôi lên 4 USD và đầu ra tăng thêm một nửa lên khoảng 15 USD. DeepSeek V4 Pro không có bậc tương đương; mức giá công bố của nó áp dụng xuyên suốt cửa sổ, với lịch cao điểm và thấp điểm được đưa ra vào ngày 17 tháng 8, thay đổi giá theo thời điểm trong ngày thay vì theo độ dài ngữ cảnh.
Ghép những điều đó lại, và ở phân khúc cao nhất, phép so sánh sẽ đảo ngược. Một yêu cầu DeepSeek V4 Pro mang 400K token ngữ cảnh chỉ tốn mức giá thông thường của nó. Cùng yêu cầu đó trên GPT-6 Sol tốn khoảng gấp đôi mức giá niêm yết. Nếu khối lượng công việc của bạn vốn mang tính ngữ cảnh dài — phân tích tài liệu, agent trên repo lớn, suy luận trên bản ghi kéo dài — thì khoảng cách giá thực tế giữa hai mô hình này rộng hơn nhiều so với mức $2 so với $1.32 gợi ra.

Nơi DeepSeek V4 Pro thực sự có sức cạnh tranh
Kết quả về tác nhân và lập trình của DeepSeek không phải là một sự thỏa hiệp về ngân sách. Dựa trên những con số mà nhà cung cấp đã công bố:
• Terminal-Bench 2.1 — DeepSeek V4 Pro 87.9
• Toolathlon-Verified — DeepSeek V4 Pro 74.1
• DeepSWE — DeepSeek V4 Pro 62.7
• SWE-bench Verified — DeepSeek V4 Pro 80.6
• AA Intelligence Index — DeepSeek V4 Pro 36, xếp thứ 8 trong số 114 mô hình được đo lường
• Tốc độ xuất — DeepSeek V4 Pro 67,8 tokens/giây
• Giấy phép — MIT, trọng số mở, có thể tự vận hành
Bảng xếp hạng Index đáng để xem xét lại. Ba mươi sáu điểm đưa DeepSeek V4 Pro lên vị trí thứ tám trong số 114 mô hình trên bảng, một vị trí mạnh đối với một mô hình có trọng số tải xuống được và giấy phép MIT. Khoảng cách với GPT-6 Sol là có thật, nhưng đó là khoảng cách giữa "rất tốt" và "tiên phong", không phải giữa "dùng được" và "không dùng được".
Giấy phép MIT là phần không có tương đương với GPT-6 Sol. Nếu ràng buộc của bạn là lưu trú dữ liệu, triển khai air-gapped, chi phí trên mỗi token giảm về 0 khi tận dụng cao, hay đơn giản là không muốn việc nhà cung cấp ngừng hỗ trợ trở thành một sự kiện phải di trú, thì DeepSeek V4 Pro là cái duy nhất trong hai cái này trả lời được câu hỏi đó. GPT-6 Sol chỉ có API và sẽ vẫn như vậy.
Nơi GPT-6 Sol vượt lên
Mười hai điểm Index là một khoảng cách lớn ở đầu này của bảng xếp hạng. GPT-6 Sol xếp thứ 18 trong số 212 mô hình được đo lường, so với vị trí thứ 8 trong số 114 của DeepSeek, và nó đạt được vị trí đó nhờ một bộ kết quả agentic do nhà cung cấp công bố mà DeepSeek không phản đối:
• AutomationBench — GPT-6 Sol đạt 33,2% với chi phí $0,27 mỗi tác vụ
• Bài kiểm tra cuối cùng của các Agent — GPT-6 Sol 56.4%
• DeepSWE v1.1 — GPT-6 Sol 68.8%
• OSWorld 2.0 — GPT-6 Sol 60,5%
• Tốc độ đầu ra — GPT-6 Sol 104,4 token/giây, so với 67,8 của DeepSeek V4 Pro
Những số liệu đó là do nhà cung cấp tự báo cáo và OpenAI đã chạy bộ khung đánh giá của riêng mình, nên hãy coi chúng là tuyên bố thay vì kết quả đo lường. Có hai lưu ý đáng để ghi nhớ. OpenAI đã dùng điểm số đối thủ đã công bố ở một số hàng thay vì chạy lại mô hình của đối thủ, và điểm trên biểu đồ Agents' Last Exam của nó cho Claude Fable 5.1 loại trừ các fallback sang Opus 5 vốn đã kích hoạt ở khoảng 40% nhiệm vụ. Không lưu ý nào trong hai lưu ý đó ảnh hưởng trực tiếp đến so sánh với DeepSeek, nhưng chúng là lý do để xem toàn bộ bảng một cách dè dặt.
Đánh giá độc lập tỏ ra chừng mực hơn so với đánh giá của cả hai nhà cung cấp. Artificial Analysis nhận thấy GPT-6 Sol gần như giảm một nửa chi phí mỗi tác vụ so với GPT-5.6 Sol, đồng thời tạo ra sự pha trộn giữa cải thiện và thoái bộ — bao gồm cả thoái bộ trên GDPval-AA v2.1. Một mô hình đánh đổi năng lực ở một số chỗ để có mức giảm chi phí lớn là mô hình thay đổi những gì bạn có thể chi trả để vận hành, chứ không phải mô hình nâng trần ở mọi nơi.
Và hồ sơ độ trễ của GPT-6 Sol thực sự là một điểm yếu. Thời gian đến token đầu tiên là 107,18 giây, so với trung vị của bảng xếp hạng là 3,87. Đó là token đầu tiên chậm nhất trên bảng với khoảng cách rất lớn. DeepSeek V4 Pro cũng không phải là một mô hình nhanh, nhưng nó không ở mức đó, và đối với bất kỳ giao diện tương tác nào, sự khác biệt này chỉ mang tính loại trừ theo một hướng duy nhất.
Trọng số mở so với biên giới cho thuê
Đây là phương diện mà hai mô hình không thực sự cạnh tranh với nhau. DeepSeek V4 Pro là một MoE 1,6T tham số với 49B tham số hoạt động, được cấp phép MIT, có thể tải xuống. Điều đó nghĩa là một chi phí cố định được khấu hao đến mức không đáng kể ở quy mô lớn, một triển khai do bạn kiểm soát, và một mô hình không thể bị ngừng hỗ trợ ngay dưới chân bạn. Điều đó cũng có nghĩa là bạn sở hữu ngăn xếp phục vụ, hóa đơn GPU và mọi hồi quy.
GPT-6 Sol là một giao dịch ngược lại. Bạn trả tiền theo token mãi mãi, bạn có được năng lực tiên phong mà không cần sở hữu phần cứng, và OpenAI có thể thay đổi mức giá, bảng giá, hoặc tính sẵn có chỉ bằng một bài blog — như đã làm vào ngày 22 tháng 9 khi họ giảm một nửa giá của chính mẫu flagship do mình phát triển. Không có phiên bản GPT-6 Sol nào mà bạn có thể ghim cố định.
Cách đúng đắn để nghĩ về điều này không phải là “cái nào tốt hơn” mà là “bạn thích rủi ro nào hơn”. Rủi ro nhà cung cấp so với rủi ro vận hành. Với một startup không có đội hạ tầng và lưu lượng thất thường, API rõ ràng là lựa chọn đúng. Với một tổ chức đã có năng lực GPU, một ranh giới tuân thủ, hoặc một khối lượng công việc mà việc tính giá theo từng token là vô lý, thì trọng số mở thắng chỉ nhờ kinh tế, và mười hai điểm Index là cái giá đáng trả.
Nếu bạn muốn ngừng lựa chọn
Có một phiên bản của quyết định này mà không đòi hỏi phải cam kết. DeepSeek V4 Pro có mặt trên OrcaRouter với đúng mức giá niêm yết của DeepSeek, theo mô hình chuyển tiếp, nghĩa là khi DeepSeek thay đổi mức giá — kể cả lịch giá cao điểm và thấp điểm — thì phía chúng tôi sẽ phản ánh ngay trong cùng ngày, thay vì phải chờ một nhà bán lại đàm phán lại. Tính đến thời điểm viết bài này, GPT-6 Sol chưa có trong danh mục của chúng tôi; mô hình này có thể truy cập qua API riêng của OpenAI, nên một lộ trình bao gồm cả hai sẽ cần một khóa cho DeepSeek V4 Pro và một tích hợp trực tiếp cho OpenAI.
Sự tách biệt đó đáng để duy trì vì một lý do cụ thể: hai mô hình này thất bại theo những cách khác nhau. Một triển khai trọng số mở thất bại khi phần cứng của bạn gặp sự cố; một API thất bại khi nhà cung cấp gặp sự cố. Chuyển đổi dự phòng tự động giữa các nhà cung cấp chính là thứ biến những sự cố đó thành một buổi chiều suy giảm hiệu năng thay vì một sự cố ngừng dịch vụ, và việc có thể di chuyển một tuyến giữa một mô hình rẻ, thông lượng cao và một mô hình đắt đỏ, cẩn trọng bằng cách sửa cấu hình thay vì sửa đường dẫn mã chính là điều cho phép bạn bám theo đường cong giá cả thay vì đặt cược vào nó.

Ai nên chọn cái nào
Hãy chọn DeepSeek V4 Pro nếu bạn có hạ tầng, một ranh giới tuân thủ hoặc một vấn đề về khối lượng. Nó được cấp phép MIT, đứng thứ tám trong số 114 trên chỉ số độc lập, có 384K dung lượng đầu ra và bảng giá không có vách giá theo ngữ cảnh. Đây là câu trả lời đúng cho bất kỳ ai có ràng buộc quyết định là chi phí ở quy mô lớn hoặc quyền kiểm soát triển khai, và khoảng cách mười hai điểm với GPT-6 Sol chính là cái giá của điều đó.
Chọn GPT-6 Sol nếu bạn cần đỉnh cao và ngữ cảnh của bạn vẫn dưới 272K token. Nó đạt 48 so với 36, tạo token nhanh hơn khoảng 50%, và với mức $2/$10, đây là mô hình hàng đầu có giá rẻ nhất mà OpenAI từng làm. Chỉ cần biết bạn đang mua gì: chờ một trăm giây cho token đầu tiên, một hạng ngữ cảnh dài nhân đôi mức giá, và một mô hình mà đánh giá độc lập là sự pha trộn giữa cải tiến và thụt lùi chứ không phải một bước tiến rõ ràng.
Và nếu câu trả lời là “cả hai, tùy theo yêu cầu”, thì đó không phải là sự do dự. Đó chính là kiến trúc đúng đắn cho một thị trường nơi hai nhà cung cấp đã giảm một nửa giá sản phẩm chủ lực của mình trong vòng sáu tuần kể từ nhau, và cả hai đều chưa dừng lại.

So sánh trong bài viết này3
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
