
GPT-6.1 Sol Pro vs GPT-5.6 Sol Pro: Cách Nhau Một Thế Hệ, Giá Chỉ Bằng Một Nửa
- typesafeMỚITypeSafe: Jev 1.132026-09-24$0.04 / $0.00 trên 1 triệu token · 397 tok/s
- OpenAIMỚIOpenAI: GPT-6 Luna2026-09-2237Trí tuệ
- OpenAIMỚIOpenAI: GPT-6 Sol2026-09-2248Trí tuệ
- AnthropicMỚIAnthropic: Claude Opus 5.52026-09-2258Trí tuệ
- xAIMỚIGrok 4.72026-09-2146Trí tuệ
- OrcaMỚIOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 trên 1 triệu token · 195 tok/s
- OrcaMỚIOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token · 1141 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 trên 1 triệu token · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- xAISpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
Tạm gác tên sang một bên và nhìn vào thứ mà mỗi cái thực sự phân giải thành trong một yêu cầu, vì đó chính là nơi cuộc so tài này được định đoạt. GPT-6.1 Sol Pro chính là GPT-6.1 Sol — phát hành ngày 29 tháng 9 năm 2026 — chạy với reasoning.mode được đặt thành pro trong Responses API, và nó tính phí phần công việc thêm theo mức $2.00 đầu vào và $10.00 đầu ra trên mỗi triệu token của chính mô hình. GPT-5.6 Sol Pro cũng có cấu trúc tương tự nhưng sớm hơn một thế hệ: GPT-5.6 Sol, ra mắt ngày 9 tháng 7 năm 2026, chạy với reasoning.mode: pro, tính phí các token thêm ở mức $4.00 đầu vào và $20.00 đầu ra. Không nhà cung cấp nào công bố định danh -pro cho cả hai hạng, nên không có bảng giá pro nào để so sánh và không có phụ phí pro nào để cân nhắc. Thứ bạn thực sự đang so sánh là hai bảng giá cơ sở, cách nhau ba tháng, với giá niêm yết chênh nhau gấp đôi — và giá cache chênh nhau gấp bốn lần. Chế độ thì giống hệt nhau. Đồng hồ đo bên dưới nó thì không.
Tại sao chiếc Pro meter đời cũ vẫn còn trong bảng so sánh này vậy
Lý do GPT-5.6 Sol Pro cứ được nhắc đến như một sản phẩm ngang hàng chứ không phải một sản phẩm tiền nhiệm là vì OpenAI thực sự đã bán Pro như một sản phẩm trong kỷ nguyên GPT-5, và những định danh đó vẫn nằm trên bảng giá với các mức tính phí cao cấp riêng của chúng: gpt-5.4-pro và gpt-5.5-pro ở mức $30.00 cho đầu vào và $180.00 cho đầu ra mỗi triệu token trong ngữ cảnh ngắn, tăng lên $60.00 và $270.00 khi vượt qua 272.000 token đầu vào. Đó là những sản phẩm có thật, được định giá riêng, và chính chúng là lý do "Pro" được đọc như một từ đắt đỏ. Thế hệ GPT-5.6 đã thay đổi cơ chế mà không thay đổi từ vựng — pro trở thành một chế độ của flagship thay vì một mô hình cao cấp bên cạnh nó, được định giá theo chính mức giá của flagship. Vì vậy, tác dụng thực tế của việc chuyển từ cấu hình pro thời 5.6 sang cấu hình thời 6.1 không phải là "một mô hình pro rẻ hơn." Mà là cùng một cấu hình, trên một nền tảng rẻ hơn.
• Nó là gì, ở cả hai phía — một mô hình cộng với reasoning.mode: "pro", không phải là một triển khai được huấn luyện riêng hay định giá riêng
• Mã định danh bạn gửi — gpt-6.1-sol so với gpt-5.6-sol, với chế độ được mang trong đối tượng reasoning
• Giá đầu vào tiêu chuẩn — 2,00 đô la mỗi triệu token so với 4,00 đô la, vì vậy các token bổ sung của chế độ pro chỉ tốn một nửa chi phí ở hạng mới hơn
• Giá đầu ra tiêu chuẩn — $10.00 mỗi triệu token so với $20.00, mức giảm một nửa tương tự cũng được áp dụng cho phần hóa đơn mà chế độ pro làm phình lên
• Đầu vào được lưu đệm — 0,10 USD mỗi triệu trên 6.1 Sol so với 0,40 USD trên 5.6 Sol, mức chênh lệch gấp bốn lần đặc biệt quan trọng trong đúng những vòng lặp agent mà chế độ pro được xây dựng để phục vụ
• Ghi vào bộ nhớ đệm — $2.50 so với $5.00 mỗi triệu token, lại giảm một nửa
• Định giá lại cho prompt dài — cả hai đều định giá lại toàn bộ yêu cầu khi vượt quá 272.000 token đầu vào, với mức 2× cho giá đầu vào và giá cache cùng 1,5× cho đầu ra
Ngữ cảnh và giới hạn đầu ra — 1.050.000 token và tối đa 128.000 token đầu ra trên cả hai, với đầu vào tối đa 922.000 được ghi nhận trên mỗi mô hình
• Điểm cắt kiến thức — ngày 30 tháng 4 năm 2026 trên 6.1 Sol so với ngày 16 tháng 2 năm 2026 trên 5.6 Sol
• Mức độ suy luận — thấp, trung bình, cao, xhigh, tối đa với none và minimal không được hỗ trợ trên 6.1 Sol, so với cùng thang bậc cộng với none trên 5.6 Sol
• Tài liệu về chế độ Pro — được nêu đích danh trên gpt-6.1-sol trong hướng dẫn suy luận của OpenAI, trái ngược với một tuyên bố ở cấp độ dòng sản phẩm bao gồm GPT-5.6 và GPT-6 mà không có danh sách điều kiện áp dụng cho từng mô hình
Hai hàng trong danh sách đó đáng giá hơn tất cả những hàng còn lại cộng lại, và cả hai đều không phải là mức giá được nêu bật.
Dòng cache là ranh giới mà tại đó hai thế hệ không còn có thể so sánh với nhau.
Chi phí của chế độ Pro đến dưới dạng khối lượng, chứ không phải phụ phí: tài liệu của OpenAI nói rằng nó “tổng hợp khối lượng công việc mà mô hình đã thực hiện để tạo ra câu trả lời cuối cùng và tính phí những token đó theo mức giá token tiêu chuẩn của mô hình được chọn”, và nhà cung cấp không công bố hệ số nhân. Điều đó khiến chi phí của một cấu hình pro trở thành hàm của hai thứ bạn không thể tra cứu — chế độ này thực hiện thêm bao nhiêu công việc trên các tác vụ của bạn, và token của bạn tốn bao nhiêu — và chỉ thứ thứ hai được công bố. Trên trục đó, hạng 6.1 thắng mọi hàng với hệ số hai gọn gàng, và hàng đầu vào được lưu trong bộ đệm với hệ số bốn.
Hãy làm phép tính với một agent hỗ trợ khách hàng phát lại một tiền tố chỉ dẫn và lược đồ công cụ cố định trong mỗi lượt. Gửi 200 triệu token đầu vào mỗi tháng, 95% trong số đó là lượt trúng tiền tố, và phần được lưu đệm được tính phí ở mức $0.10 mỗi triệu trên 6.1 Sol so với $0.40 trên 5.6 Sol — $19 so với $76 cho cùng một tiền tố, trước khi tính đến một token chế độ pro nào. Giờ thêm chế độ pro lên trên và khoảng cách còn nới rộng chứ không thu hẹp, bởi vì phần suy luận bổ sung của chế độ này nằm ở phía đầu ra với mức $10.00 so với $20.00 mỗi triệu. Dòng duy nhất không giảm một nửa là quy tắc định giá lại cho prompt dài, vốn giống hệt nhau trên cả hai bậc và áp dụng cùng các hệ số nhân 2× và 1.5× — vì vậy một khối lượng công việc thường xuyên vượt qua 272,000 token đầu vào sẽ trả phụ phí ở cả hai phía của phép so sánh, chỉ là khoản nhỏ hơn ở bậc mới hơn.
Ngoài ra còn có một cái bẫy thuộc về chế độ chứ không phải thuộc về một trong hai mô hình, và nó sẽ cắn một công cụ ước tính chi phí ngây thơ. Đặt reasoning.effort thành none khi chế độ pro đang bật sẽ trả về lỗi thay vì âm thầm chuyển sang phương án dự phòng, và các token suy luận mà chế độ pro đốt cháy được báo cáo trong đối tượng usage dưới output_tokens_details.reasoning_tokens trong khi không bao giờ xuất hiện trong phần thân phản hồi. Bất kỳ client nào ước tính chi phí từ văn bản được trả về sẽ đếm thiếu một cấu hình pro trong mọi lần.
Nơi thế hệ cũ vẫn có lý

Rẻ hơn không đồng nghĩa với tốt hơn, và thế hệ 5.6 có ba lợi thế mà một bảng giá không thể hiện được. Thứ nhất là độ chín muồi: gpt-5.6-sol đã được cung cấp rộng rãi từ ngày 9 tháng 7 năm 2026, hành vi của nó đã ổn định, và đây là mô hình mà chính trang deprecations của OpenAI hướng đến khi họ ngừng các Pro meter cũ — nghĩa là lộ trình di chuyển khỏi những meter $180 mỗi triệu đó sẽ nằm ở bậc 5.6, chứ không phải bậc 6.1. Thứ hai là khuyến mãi: OpenAI nêu rõ rằng giá khuyến mãi của GPT-5.6 Sol có ít nhất đến hết ngày 21 tháng 11 năm 2026, nên cặp $4.00 / $20.00 là một mức sàn có kèm ngày chứ không phải giá niêm yết. Thứ ba là bằng chứng độc lập, và đây là điều quan trọng nhất nếu bạn không thể tự chạy đánh giá của riêng mình — Artificial Analysis có đánh giá đầy đủ về GPT-5.6 Sol và không có trang nào cả cho bậc 6.1.
Đánh giá độc lập đó là một câu chuyện về chi phí hơn là một câu chuyện về trí tuệ, và đó chính là phần hữu ích. Trên Intelligence Index của hội đồng trung lập, GPT-5.6 Sol đạt 47 ở mức nỗ lực suy luận tối đa, xếp thứ 13 trong mẫu 145 mô hình, với Coding Index là 77,4 ở hạng 3 và GPQA Diamond là 94,1%. Chi phí cho mỗi tác vụ chỉ số của nó ở mức gần 2,00 đô la so với 1,06 đô la của GPT-6 Sol ở cùng thiết lập — gần gấp đôi — và tỷ lệ đó chính là toàn bộ lập luận cho tầng mới hơn trong một con số. Thế hệ 6.1 không có con số tương đương nào được công bố tính đến ngày 30 tháng 9 năm 2026: trang mô hình của hội đồng cho slug 6.1 Sol trả về lỗi 404 và chuỗi đó không xuất hiện trong bảng xếp hạng trực tiếp. Vậy nên so sánh trung thực ngày hôm nay là một thế hệ 5.6 đã được đo lường so với một thế hệ 6.1 do nhà cung cấp mô tả, và dù có dựng bao nhiêu bảng biểu cũng không thể lấp đầy khoảng cách đó.
Chạy cả hai cấu hình từ một khóa
Đây là một phép so sánh hiếm hoi mà chi phí thiết lập thí nghiệm gần như bằng không, vì hai nhánh chỉ khác nhau ở một chuỗi model và một tham số. OrcaRouter định tuyến openai/gpt-5.6-sol ở đúng mức giá niêm yết của chính OpenAI mà không cộng thêm gì — 4,00 USD đầu vào, 0,40 USD cho phần cache, 20,00 USD đầu ra, với bậc prompt dài được niêm yết ở 8,00 USD và 30,00 USD — và định tuyến openai/gpt-6-sol ở mức 2,00 / 0,20 / 10,00 USD cùng bậc 272K riêng ở 4,00 và 15,00 USD. Vì mức markup bằng không và bảng giá của nhà cung cấp được chuyển nguyên văn, nên một thay đổi khuyến mãi hay một đợt giảm giá ở một trong hai bậc sẽ xuất hiện trên route ngay ngày OpenAI công bố, không cần hợp đồng thứ hai và không cần đăng ký lại từng model. Một endpoint tương thích OpenAI và một API key là đủ cho cả hai nhánh của phép thử, nên công việc duy nhất là chọn một bộ tác vụ và đọc đối tượng usage.

Chạy nó theo ba cách trên cùng một tập hợp các yêu cầu khó của chính bạn, giữ reasoning.effort cố định để chỉ một biến thay đổi: gpt-5.6-sol ở chế độ tiêu chuẩn, gpt-5.6-sol với chế độ pro được bật, và gpt-6.1-sol ở cùng mức effort. So sánh mức thành công của tác vụ, độ trễ đồng hồ thực và tổng token được tính phí, đọc trường reasoning-token thay vì phần thân phản hồi. Tổng token của lượt chạy pro so với bản tiêu chuẩn tương ứng là hệ số nhân của bạn trên lưu lượng của bạn — nó sẽ không khớp với của bất kỳ ai khác, vì chủ đích thiết kế là phần việc tăng thêm sẽ tăng theo độ khó của yêu cầu. Lượt chạy 6.1 dùng cùng một request body với chỉ một chuỗi bị thay đổi, nên giữ nó làm bài kiểm thử hồi quy sau khi ra quyết định thì không tốn gì.
Hai điều cần ghi nhớ trước khi bạn đưa ra kết luận. Nếu định danh 6.1 từ chối tham số pro thay vì trả về kết quả, thì bản thân điều đó đã là một phát hiện, và bạn đã biết được nó trước khi nó chạm tới bất cứ thứ gì hướng tới người dùng. Và nếu nhánh bạn đang so sánh là gpt-6-sol hiện có thể định tuyến thay vì một cấu hình 5.6, hãy nhớ rằng các bảng giá cơ sở là giống hệt nhau giữa 6.0 và 6.1 — khác biệt giữa hai phiên bản đó nằm ở dòng đầu vào được lưu đệm và kết quả tác vụ do nhà cung cấp báo cáo, trong khi khác biệt giữa 5.6 và 6.1 là toàn bộ bảng giá.
FAQ
GPT-5.6 Sol Pro có phải là một mô hình riêng với mức giá cao cấp riêng của nó không?Không — và đây chính là cái bẫy mà cái tên đó giăng ra. Bảng giá của OpenAI có những mức đo Pro cao cấp thực sự, nhưng chúng thuộc về các thế hệ trước, ở mức $30.00 cho đầu vào và $180.00 cho đầu ra trên mỗi triệu token, và cao hơn nữa. Đối với dòng GPT-5.6, nhà cung cấp bán mô hình chủ lực và để lộ pro dưới dạng một giá trị của reasoning.mode trong Responses API, được tính phí theo mức giá thông thường của mô hình chủ lực đó. Một mục niêm yết pro ghi ngày thuộc thế hệ 5.6 và báo giá $4.00 và $20.00 là đang ghi theo bảng giá của mô hình chủ lực, đó là cách bạn có thể nhận ra rằng không hề có mức đo thứ hai.
Tôi nên đặt khối lượng công việc khó, lưu lượng thấp lên cái nào trong hai cái?Không có câu trả lời nào miễn phí, nên quyết định phụ thuộc vào những gì bạn có thể đo được chứ không phải những gì bạn có thể đọc. Tầng mới hơn có giá bằng một nửa trên mọi dòng được công bố và rẻ hơn bốn lần đối với đầu vào được lưu đệm, nhưng chế độ pro của nó không có đánh giá độc lập nào chống lưng và trang mô hình của nó hoàn toàn không đề cập đến chế độ này. Tầng cũ hơn có lịch sử GA đã ổn định và được đánh giá đầy đủ bởi bên thứ ba, và tốn gấp đôi trên mỗi token. Nếu tập tác vụ của bạn chạy rẻ, câu trả lời là phương án nào thắng trên chính các yêu cầu của bạn ở cùng mức công sức; nếu không, tầng cũ hơn là cái mà bạn ít nhất có thể đối chiếu hành vi của nó với số liệu của người khác.
Chế độ pro có thay đổi những gì mô hình làm tốt không? Không. Nó thực hiện nhiều công việc của mô hình hơn trước khi trả về một câu trả lời cuối cùng duy nhất, điều này có thể cải thiện độ tin cậy đối với các tác vụ khó đồng thời làm tăng cả độ trễ lẫn mức sử dụng token — trọng số vẫn giữ nguyên dù theo cách nào. Nếu chỉ số mà bạn đang cố gắng cải thiện là số liệu về độ chính xác hay tỷ lệ ảo giác, thay vì tỷ lệ thành công tác vụ trên những bài toán thực sự khó, thì bằng chứng độc lập về dòng mô hình này chỉ ra rằng phiên bản mô hình và thiết lập mức nỗ lực mới là những đòn bẩy đáng tin cậy hơn, chứ không phải chế độ.

Bản ngắn gọn, và là bản đáng mang ra khỏi so sánh này: chế độ pro là hằng số còn bảng giá là biến số. Giữa hai cấu hình này, không có gì về cách chế độ hoạt động đã thay đổi — vẫn cùng cách tổng hợp công việc của mô hình, vẫn cùng tính phí theo mức giá tiêu chuẩn, vẫn cùng hệ số chưa được công bố, vẫn cùng lỗi nếu bạn thử ghép nó với effort: none. Điều đã thay đổi trong ba tháng là mọi dòng được công bố của đồng hồ đo bên dưới nó đều giảm một nửa, và dòng đầu vào được lưu đệm giảm còn một phần tư. Điều đó khiến bậc mới hơn trở thành lựa chọn mặc định về giá cho bất kỳ ai đang chạy cấu hình pro, và khiến bậc cũ hơn trở thành lựa chọn mặc định về bằng chứng cho bất kỳ ai cần một con số của bên thứ ba trước khi chuyển. Không điều nào trong số đó là lý do để coi những cái tên này như hai sản phẩm.
Cả hai nhánh của thử nghiệm đều chạy từ một endpoint tương thích OpenAI với bảng giá của nhà cung cấp được chuyển tiếp nguyên văn, không cộng thêm mức tăng giá, và chuyển đổi dự phòng tự động giữa các nhà cung cấp.
So sánh trong bài viết này1
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
