Một thẻ hero được tạo có tiêu đề 'GPT-6 Sol vs DeepSeek V4 Pro', dòng tít '12 điểm Index', với hai dòng đối chiếu 'API đóng ở mức $2.00/$10.00 mỗi 1M' với 'trọng số mở MIT ở mức $1.32/$3.96 mỗi 1M', và logo OrcaRouter ở góc dưới bên phải.
Guides & Insights

GPT-6 Sol so với DeepSeek V4 Pro: Khoảng cách chỉ số 12 điểm cho mức giá gấp bốn lần

Tác giả

Rowan Sterling

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

Here is the arithmetic nobody puts on a launch page. DeepSeek V4 Pro scores 36 on Artificial Analysis's Intelligence Index. GPT-6 Sol scores 48. GPT-6 Sol costs $2.00 per million input tokens and $10.00 per million output. DeepSeek V4 Pro costs $1.32 and $3.96 on the same board — and its own published rate card, converted, comes to roughly $0.42 and $0.87. So the twelve-point gap between GPT-6 Sol and DeepSeek V4 Pro is bought at somewhere between one and a half and four times the price depending on whose rate card you read, and the model on the cheaper side is the one you can download and run yourself.

Đó là toàn bộ quyết định, và nó thật sự sát sao hơn mức bảng điểm gợi ý. DeepSeek V4 Pro ra mắt vào ngày 13 tháng 8 năm 2026 dưới dạng mô hình mixture-of-experts được cấp phép MIT với tổng cộng 1,6 nghìn tỷ tham số và 49 tỷ tham số hoạt động mỗi token. GPT-6 Sol ra mắt vào ngày 22 tháng 9 năm 2026 dưới dạng mô hình tiên phong trọng số đóng với mức giá bằng một nửa so với chính phiên bản tiền nhiệm của nó. Một cái là món hàng hóa bạn có thể tự vận hành; cái còn lại là năng lực bạn thuê. Cả hai đều có cửa sổ ngữ cảnh một triệu token. Cả hai đều là mô hình suy luận. Không bên nào rõ ràng là lựa chọn mua sai.

Con số quyết định điều này

Bắt đầu với điểm mà cả hai nhà cung cấp đều đồng ý: ngữ cảnh. DeepSeek V4 Pro có cửa sổ ngữ cảnh 1M với đầu ra tối đa 384K. GPT-6 Sol được Artificial Analysis liệt kê ở mức 872.000 token so với mức trần 1,05M, với giới hạn đầu ra 128K ở nơi khác trong tài liệu của OpenAI. DeepSeek cho bạn không gian đầu ra gấp ba lần và cửa sổ đầu vào tương đương.

Vậy là điều mà chỉ một trong hai có: một ngưỡng tái định giá đột ngột theo ngữ cảnh dài. Mức 2 USD/10 USD của GPT-6 Sol giữ nguyên dưới 272.000 token đầu vào. Vượt qua mức đó, toàn bộ yêu cầu được tái định giá — đầu vào tăng gần gấp đôi lên 4 USD và đầu ra tăng thêm một nửa lên khoảng 15 USD. DeepSeek V4 Pro không có bậc tương đương; mức giá công bố của nó áp dụng xuyên suốt cửa sổ, với lịch cao điểm và thấp điểm được đưa ra vào ngày 17 tháng 8, thay đổi giá theo thời điểm trong ngày thay vì theo độ dài ngữ cảnh.

Ghép những điều đó lại, và ở phân khúc cao nhất, phép so sánh sẽ đảo ngược. Một yêu cầu DeepSeek V4 Pro mang 400K token ngữ cảnh chỉ tốn mức giá thông thường của nó. Cùng yêu cầu đó trên GPT-6 Sol tốn khoảng gấp đôi mức giá niêm yết. Nếu khối lượng công việc của bạn vốn mang tính ngữ cảnh dài — phân tích tài liệu, agent trên repo lớn, suy luận trên bản ghi kéo dài — thì khoảng cách giá thực tế giữa hai mô hình này rộng hơn nhiều so với mức $2 so với $1.32 gợi ra.

A generated two-column scoreboard titled 'GPT-6 Sol vs DeepSeek V4 Pro — the scoreboard'. Left column GPT-6 Sol: Price $2.00/$10.00, AA Index 48, Weights 'closed', Max output 128K, Terminal-Bench 2.1 'n/a', Context 872K. Right column DeepSeek V4 Pro: Price $1.32/$3.96, AA Index 36, Weights 'MIT', Max output 384K, Terminal-Bench 2.1 87.9, Context 1M. Footer: 'DeepSeek figures per DeepSeek and Artificial Analysis.'

Nơi DeepSeek V4 Pro thực sự có sức cạnh tranh

Kết quả về tác nhân và lập trình của DeepSeek không phải là một sự thỏa hiệp về ngân sách. Dựa trên những con số mà nhà cung cấp đã công bố:

• Terminal-Bench 2.1 — DeepSeek V4 Pro 87.9

• Toolathlon-Verified — DeepSeek V4 Pro 74.1

• DeepSWE — DeepSeek V4 Pro 62.7

• SWE-bench Verified — DeepSeek V4 Pro 80.6

• AA Intelligence Index — DeepSeek V4 Pro 36, xếp thứ 8 trong số 114 mô hình được đo lường

• Tốc độ xuất — DeepSeek V4 Pro 67,8 tokens/giây

• Giấy phép — MIT, trọng số mở, có thể tự vận hành

Bảng xếp hạng Index đáng để xem xét lại. Ba mươi sáu điểm đưa DeepSeek V4 Pro lên vị trí thứ tám trong số 114 mô hình trên bảng, một vị trí mạnh đối với một mô hình có trọng số tải xuống được và giấy phép MIT. Khoảng cách với GPT-6 Sol là có thật, nhưng đó là khoảng cách giữa "rất tốt" và "tiên phong", không phải giữa "dùng được" và "không dùng được".

Giấy phép MIT là phần không có tương đương với GPT-6 Sol. Nếu ràng buộc của bạn là lưu trú dữ liệu, triển khai air-gapped, chi phí trên mỗi token giảm về 0 khi tận dụng cao, hay đơn giản là không muốn việc nhà cung cấp ngừng hỗ trợ trở thành một sự kiện phải di trú, thì DeepSeek V4 Pro là cái duy nhất trong hai cái này trả lời được câu hỏi đó. GPT-6 Sol chỉ có API và sẽ vẫn như vậy.

Nơi GPT-6 Sol vượt lên

Mười hai điểm Index là một khoảng cách lớn ở đầu này của bảng xếp hạng. GPT-6 Sol xếp thứ 18 trong số 212 mô hình được đo lường, so với vị trí thứ 8 trong số 114 của DeepSeek, và nó đạt được vị trí đó nhờ một bộ kết quả agentic do nhà cung cấp công bố mà DeepSeek không phản đối:

• AutomationBench — GPT-6 Sol đạt 33,2% với chi phí $0,27 mỗi tác vụ

• Bài kiểm tra cuối cùng của các Agent — GPT-6 Sol 56.4%

• DeepSWE v1.1 — GPT-6 Sol 68.8%

• OSWorld 2.0 — GPT-6 Sol 60,5%

• Tốc độ đầu ra — GPT-6 Sol 104,4 token/giây, so với 67,8 của DeepSeek V4 Pro

Những số liệu đó là do nhà cung cấp tự báo cáo và OpenAI đã chạy bộ khung đánh giá của riêng mình, nên hãy coi chúng là tuyên bố thay vì kết quả đo lường. Có hai lưu ý đáng để ghi nhớ. OpenAI đã dùng điểm số đối thủ đã công bố ở một số hàng thay vì chạy lại mô hình của đối thủ, và điểm trên biểu đồ Agents' Last Exam của nó cho Claude Fable 5.1 loại trừ các fallback sang Opus 5 vốn đã kích hoạt ở khoảng 40% nhiệm vụ. Không lưu ý nào trong hai lưu ý đó ảnh hưởng trực tiếp đến so sánh với DeepSeek, nhưng chúng là lý do để xem toàn bộ bảng một cách dè dặt.

Đánh giá độc lập tỏ ra chừng mực hơn so với đánh giá của cả hai nhà cung cấp. Artificial Analysis nhận thấy GPT-6 Sol gần như giảm một nửa chi phí mỗi tác vụ so với GPT-5.6 Sol, đồng thời tạo ra sự pha trộn giữa cải thiện và thoái bộ — bao gồm cả thoái bộ trên GDPval-AA v2.1. Một mô hình đánh đổi năng lực ở một số chỗ để có mức giảm chi phí lớn là mô hình thay đổi những gì bạn có thể chi trả để vận hành, chứ không phải mô hình nâng trần ở mọi nơi.

Và hồ sơ độ trễ của GPT-6 Sol thực sự là một điểm yếu. Thời gian đến token đầu tiên là 107,18 giây, so với trung vị của bảng xếp hạng là 3,87. Đó là token đầu tiên chậm nhất trên bảng với khoảng cách rất lớn. DeepSeek V4 Pro cũng không phải là một mô hình nhanh, nhưng nó không ở mức đó, và đối với bất kỳ giao diện tương tác nào, sự khác biệt này chỉ mang tính loại trừ theo một hướng duy nhất.

Trọng số mở so với biên giới cho thuê

Đây là phương diện mà hai mô hình không thực sự cạnh tranh với nhau. DeepSeek V4 Pro là một MoE 1,6T tham số với 49B tham số hoạt động, được cấp phép MIT, có thể tải xuống. Điều đó nghĩa là một chi phí cố định được khấu hao đến mức không đáng kể ở quy mô lớn, một triển khai do bạn kiểm soát, và một mô hình không thể bị ngừng hỗ trợ ngay dưới chân bạn. Điều đó cũng có nghĩa là bạn sở hữu ngăn xếp phục vụ, hóa đơn GPU và mọi hồi quy.

GPT-6 Sol là một giao dịch ngược lại. Bạn trả tiền theo token mãi mãi, bạn có được năng lực tiên phong mà không cần sở hữu phần cứng, và OpenAI có thể thay đổi mức giá, bảng giá, hoặc tính sẵn có chỉ bằng một bài blog — như đã làm vào ngày 22 tháng 9 khi họ giảm một nửa giá của chính mẫu flagship do mình phát triển. Không có phiên bản GPT-6 Sol nào mà bạn có thể ghim cố định.

Cách đúng đắn để nghĩ về điều này không phải là “cái nào tốt hơn” mà là “bạn thích rủi ro nào hơn”. Rủi ro nhà cung cấp so với rủi ro vận hành. Với một startup không có đội hạ tầng và lưu lượng thất thường, API rõ ràng là lựa chọn đúng. Với một tổ chức đã có năng lực GPU, một ranh giới tuân thủ, hoặc một khối lượng công việc mà việc tính giá theo từng token là vô lý, thì trọng số mở thắng chỉ nhờ kinh tế, và mười hai điểm Index là cái giá đáng trả.

Nếu bạn muốn ngừng lựa chọn

Có một phiên bản của quyết định này mà không đòi hỏi phải cam kết. DeepSeek V4 Pro có mặt trên OrcaRouter với đúng mức giá niêm yết của DeepSeek, theo mô hình chuyển tiếp, nghĩa là khi DeepSeek thay đổi mức giá — kể cả lịch giá cao điểm và thấp điểm — thì phía chúng tôi sẽ phản ánh ngay trong cùng ngày, thay vì phải chờ một nhà bán lại đàm phán lại. Tính đến thời điểm viết bài này, GPT-6 Sol chưa có trong danh mục của chúng tôi; mô hình này có thể truy cập qua API riêng của OpenAI, nên một lộ trình bao gồm cả hai sẽ cần một khóa cho DeepSeek V4 Pro và một tích hợp trực tiếp cho OpenAI.

Sự tách biệt đó đáng để duy trì vì một lý do cụ thể: hai mô hình này thất bại theo những cách khác nhau. Một triển khai trọng số mở thất bại khi phần cứng của bạn gặp sự cố; một API thất bại khi nhà cung cấp gặp sự cố. Chuyển đổi dự phòng tự động giữa các nhà cung cấp chính là thứ biến những sự cố đó thành một buổi chiều suy giảm hiệu năng thay vì một sự cố ngừng dịch vụ, và việc có thể di chuyển một tuyến giữa một mô hình rẻ, thông lượng cao và một mô hình đắt đỏ, cẩn trọng bằng cách sửa cấu hình thay vì sửa đường dẫn mã chính là điều cho phép bạn bám theo đường cong giá cả thay vì đặt cược vào nó.

A screenshot of the Artificial Analysis page for GPT-6 Sol (max), showing an Intelligence rank of 18th of 212 models, a Cost rank of 49th and a Verbosity rank of 43rd, input pricing of $2.00 and output of $10.00 per 1M tokens with a 90% cache discount, a cost per Intelligence Index task of $1.06, an 872k-token context window, 77M tokens generated during the index run, and a total of $1,550.08 spent evaluating the model on the Intelligence Index.

Ai nên chọn cái nào

Hãy chọn DeepSeek V4 Pro nếu bạn có hạ tầng, một ranh giới tuân thủ hoặc một vấn đề về khối lượng. Nó được cấp phép MIT, đứng thứ tám trong số 114 trên chỉ số độc lập, có 384K dung lượng đầu ra và bảng giá không có vách giá theo ngữ cảnh. Đây là câu trả lời đúng cho bất kỳ ai có ràng buộc quyết định là chi phí ở quy mô lớn hoặc quyền kiểm soát triển khai, và khoảng cách mười hai điểm với GPT-6 Sol chính là cái giá của điều đó.

Chọn GPT-6 Sol nếu bạn cần đỉnh cao và ngữ cảnh của bạn vẫn dưới 272K token. Nó đạt 48 so với 36, tạo token nhanh hơn khoảng 50%, và với mức $2/$10, đây là mô hình hàng đầu có giá rẻ nhất mà OpenAI từng làm. Chỉ cần biết bạn đang mua gì: chờ một trăm giây cho token đầu tiên, một hạng ngữ cảnh dài nhân đôi mức giá, và một mô hình mà đánh giá độc lập là sự pha trộn giữa cải tiến và thụt lùi chứ không phải một bước tiến rõ ràng.

Và nếu câu trả lời là “cả hai, tùy theo yêu cầu”, thì đó không phải là sự do dự. Đó chính là kiến trúc đúng đắn cho một thị trường nơi hai nhà cung cấp đã giảm một nửa giá sản phẩm chủ lực của mình trong vòng sáu tuần kể từ nhau, và cả hai đều chưa dừng lại.

A screenshot of the OrcaRouter model page for DeepSeek V4 Pro (deepseek/deepseek-v4-pro), showing the Tools, JSON and Reasoning badges, a 1M-token context with 384K maximum output and text-only input, a 3.56s p50 time to first token, and the description of DeepSeek V4 Pro as a flagship MoE with 1.6T total / 49B active parameters built for top-tier reasoning and agentic tool use.

So sánh trong bài viết này3

Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày