
Định giá GPT-6.1 Sol: Bảng giá, chỉ số duy nhất đã dịch chuyển, và vực thẳm 272K
- openaiMỚIOpenAI: GPT-6.1 Sol2026-09-2952Trí tuệ
- anthropicMỚIAnthropic: Claude Sonnet 5.52026-09-2856Trí tuệ
- typesafeMỚITypeSafe: Jev 1.132026-09-24$0.04 / $0.00 trên 1 triệu token · 161 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Trí tuệ
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Trí tuệ
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Trí tuệ
- xAIGrok 4.72026-09-2146Trí tuệ
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 trên 1 triệu token · 79 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 trên 1 triệu token · 53 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token · 301 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
Trang này là bảng giá. GPT-6.1 Sol có giá $2.00 cho mỗi triệu token đầu vào, $0.10 cho mỗi triệu token đầu vào được lưu trong bộ nhớ đệm, $2.50 cho mỗi triệu token ghi vào bộ nhớ đệm và $10.00 cho mỗi triệu token đầu ra ở gói tiêu chuẩn của nhà cung cấp, còn GPT-6 Sol — bậc mà mô hình này thay thế, và cũng là bậc mà danh mục của chúng tôi phục vụ — có mức giá $2.00, $0.20, $2.50 và $10.00 cho cùng bốn chỉ số. Chỉ một con số khác nhau giữa hai bảng giá, ngưỡng mà trên đó cả hai được định giá lại nằm ở cùng một chỗ, và các mức chiết khấu dưới giá niêm yết là các hệ số nhân chứ không phải một bảng giá thứ hai. Mọi thứ trên trang này được lấy từ trang định giá dành cho nhà phát triển của chính nhà cung cấp và hai trang mô hình của họ cho GPT-6.1 Sol và GPT-6 Sol, tất cả được đọc vào ngày 7 tháng 10 năm 2026, và từ thẻ mô hình của chính chúng tôi khi một số liệu được ghi là của chúng tôi. Không có câu chuyện ra mắt nào được nhắc lại ở đây; nếu bạn muốn biết những gì đã được phát hành, đó là một trang khác.
Bảng giá, với bốn thước đo của GPT-6 Sol nằm ngay bên dưới
OpenAI công bố những mức này dưới dạng giá trên mỗi triệu token ở hạng xử lý tiêu chuẩn, cho một yêu cầu có từ 272.000 token đầu vào trở xuống. Hai hàng thực sự quan trọng được đặt liền kề nhau một cách có chủ đích, vì toàn bộ lập luận của bản phát hành hiện rõ trong cặp hàng đó: đọc lần lượt xuống từng chỉ số, và đúng một trong số chúng thay đổi.
• Đầu vào GPT-6.1 Sol — $2.00 mỗi triệu token, không đổi so với GPT-6 Sol.
• Đầu vào được lưu trong bộ đệm của GPT-6.1 Sol — $0.10 mỗi triệu token, giảm một nửa so với mức $0.20 của GPT-6 Sol.
• Ghi vào bộ đệm GPT-6.1 Sol — $2.50 mỗi triệu token, không đổi so với GPT-6 Sol.
• Đầu ra GPT-6.1 Sol — $10.00 mỗi triệu token, không đổi so với GPT-6 Sol.
• Đầu vào GPT-6 Sol — 2,00 USD mỗi triệu token.
• Đầu vào GPT-6 Sol được lưu trong bộ nhớ đệm — 0,20 USD mỗi triệu token.
• Ghi bộ nhớ đệm GPT-6 Sol — 2,50 USD mỗi triệu token.
• Đầu ra GPT-6 Sol — 10,00 USD mỗi triệu token.
Ba trong số tám dòng đó là cùng một con số được viết hai lần, và đó chính là điểm mấu chốt: đây không phải là việc định giá lại, mà là một thước đo đang dịch chuyển trên một mô hình. Ghi vào bộ nhớ đệm bằng 1,25× giá đầu vào không dùng bộ nhớ đệm trên cả hai thẻ, nên $2,50 là $2,00 × 1,25 trên cả hai — phụ phí ghi là đặc tính của dòng sản phẩm, không phải của phiên bản. Đọc từ bộ nhớ đệm là dòng duy nhất mà hai mô hình tách biệt: trên GPT-6.1 Sol, một lần đọc từ bộ nhớ đệm bằng 5% giá đầu vào; trên GPT-6 Sol là 10%; và OpenAI nêu cả hai dưới dạng phân số của giá đầu vào thay vì là giá độc lập.
Một lưu ý về cách trang này trình bày các con số. OpenAI công bố bảng giá dưới dạng giá niêm yết cố định cho mỗi mét, không có bổ ngữ về mức nỗ lực suy luận nào gắn với bất kỳ dòng nào trong tám dòng ở trên, vì vậy không dòng nào trong số đó được báo giá ở một mức nỗ lực cụ thể. Mức nỗ lực thay đổi số lượng token mà một tác vụ tiêu tốn, chứ không thay đổi giá của một token, đó là lý do bảng giá độc lập với mức nỗ lực, còn hóa đơn của bạn thì không. Không có nội dung nào trên trang này là so sánh đối đầu trực tiếp ở cùng mức nỗ lực với một mô hình đối thủ, và không có so sánh nào như vậy được ngụ ý ở bất kỳ đâu ở phần dưới — khi một con số phụ thuộc vào mức nỗ lực, trang này ghi rõ mức nỗ lực mà con số đó được tạo ra.

Dòng duy nhất đã thay đổi: đầu vào được lưu đệm, từ $0,20 xuống $0,10
Bộ đếm đầu vào được lưu vào bộ nhớ đệm định giá phần của yêu cầu không thay đổi. Khi một tiền tố dài, ổn định — lời nhắc hệ thống, một tập lược đồ công cụ, một kho ngữ liệu được truy xuất, bản ghi tích lũy của một vòng lặp — được lưu trữ có chủ đích để yêu cầu tiếp theo có thể tái sử dụng nó, các token được tái sử dụng sẽ được tính phí theo mức giá đã lưu thay vì mức giá đầu vào, và các token được lưu trữ ngay từ đầu sẽ được tính phí theo mức giá ghi vào bộ nhớ đệm. Đó là một khoản chiết khấu cho việc lặp lại, và nó tồn tại vì giải pháp thay thế cho nhà cung cấp là tính toán lại cùng một tiền tố từ đầu trong mỗi lần gọi.
Giảm một nửa thang đo đó không phải cùng loại tin tức như giảm một nửa thang đo đầu vào, và sự khác biệt này đáng để nói cho thật chính xác. Mức giá đầu vào là mức mà mọi token chưa được cache trong dòng này phải trả, nên giảm một nửa nó sẽ là việc định giá lại toàn bộ dòng trong danh mục. Mức giá cho cache là độ sâu chiết khấu — một token được tái sử dụng nằm thấp hơn mức giá đầu vào bao xa — nên thay đổi nó là thay đổi phần thưởng cho một hành vi cụ thể, chứ không phải thay đổi mức cơ sở. Mức giá đầu vào của GPT-6.1 Sol là $2.00, đúng bằng mức GPT-6 Sol thu, nên một yêu cầu không có tiền tố được cache sẽ được tính phí giống hệt nhau trên hai mô hình. Giảm một nửa thang đo cho cache đưa mức chiết khấu từ giảm 90% so với giá đầu vào thành giảm 95% so với giá đầu vào, và điều đó tác động đúng đến những khối lượng công việc có tiền tố đủ dài và được tái sử dụng đủ thường xuyên để được ghi nhận trên dòng tính phí. Hãy đọc thang đo đã thay đổi là “cùng một tác vụ tốn ít hơn nếu bạn cache” thay vì “mô hình trở nên rẻ hơn”, và bảng giá sẽ không còn gây bất ngờ nữa.
Phép tính suy ra từ hai hàng dữ liệu và không gì khác. Một triệu token đầu vào được cache tốn $0.10 trên GPT-6.1 Sol và $0.20 trên GPT-6 Sol, vì vậy bản phát hành này đáng giá mười xu cho mỗi triệu token được cache — một con số không đáng kể trong một lần gọi đơn lẻ nhưng lại đáng kể trong một lượt chạy dài, bởi vì tiền tố được cache được đọc một lần mỗi lượt. Ghi cache không thay đổi ở mức $2.50, nên điểm hòa vốn để lưu cache nói chung không thay đổi bởi bản phát hành: khoản hoàn vốn cho phần phụ phí ghi đến từ việc tái sử dụng tiền tố, chứ không phải từ việc áp dụng mức giá nào trong hai mức giá cache.
Khi vượt quá 272.000 token đầu vào, toàn bộ yêu cầu sẽ được tính lại giá.
Cả hai thẻ đều có một bậc ngữ cảnh dài, và trang định giá của OpenAI nêu quy tắc giống hệt cho cả hai: các lời nhắc có hơn 272K token đầu vào được định giá gấp 2 lần mức đầu vào và mức bộ nhớ đệm, và gấp 1,5 lần mức đầu ra cho toàn bộ yêu cầu. Toàn bộ yêu cầu được định giá lại — chứ không chỉ các token vượt ngưỡng. Câu đó là điều cần ghi nhớ từ phần này, vì đó là nơi bảng giá không còn là một bảng tra cứu: ở 272.001 token đầu vào, toàn bộ yêu cầu, kể cả token đầu tiên, được tính phí theo các cột ngữ cảnh dài.
Bảng giá đã điều chỉnh cho GPT-6.1 Sol, trên 272.000 token đầu vào:
• Đầu vào — 4,00 USD mỗi triệu token, gấp 2 lần mức giá ngữ cảnh ngắn.
• Đầu vào được lưu trong bộ đệm — 0,20 USD mỗi triệu token, gấp 2 lần mức giá ngữ cảnh ngắn.
• Ghi bộ đệm — 5,00 USD mỗi triệu token, gấp 2 lần mức giá ngữ cảnh ngắn.
• Đầu ra — 15,00 USD mỗi triệu token, gấp 1,5 lần mức giá ngữ cảnh ngắn.
Và cùng hạng đó trên GPT-6 Sol, để hai hàng có thể đối chiếu với nhau:
• Đầu vào — $4.00 mỗi triệu token.
• Đầu vào được lưu trong bộ nhớ đệm — $0.40 mỗi triệu token.
• Ghi vào bộ nhớ đệm — $5.00 mỗi triệu token.
• Đầu ra — $15.00 mỗi triệu token.
Một lần nữa, toàn bộ yêu cầu được định giá lại, chứ không phải chỉ phần vượt, vì vậy một prompt 273.000 token được tính ở mức 4,00 đô la cho đầu vào cho toàn bộ 273.000 token, thay vì 2,00 đô la cho 272.000 token đầu tiên và 4,00 đô la cho một nghìn token cuối cùng. Điều đó khiến việc vượt ngưỡng trở thành một bước nhảy thay vì một độ dốc, và nó khiến thay đổi giá đầu vào được lưu đệm trông khác nhau ở trên mốc so với ở dưới mốc. Mức 0,20 đô la mà GPT-6.1 Sol tính cho một lần đọc từ bộ nhớ đệm trên 272K đúng bằng mức giá mà GPT-6 Sol tính ở dưới mốc đó, vì vậy một khối lượng công việc ngữ cảnh dài có lưu đệm trên mô hình mới hơn phải trả mức giá trước phát hành. Khoản tiết kiệm vẫn tồn tại về mặt tương đối ở trên mốc — 0,20 đô la so với 0,40 đô la của GPT-6 Sol vẫn là giảm một nửa — nhưng mức mười xu được nhấn mạnh không áp dụng cho yêu cầu vượt ngưỡng, bởi vì yêu cầu đó hoàn toàn không được tính theo bảng giá ngữ cảnh ngắn.

Các bậc chiết khấu, dưới dạng hệ số nhân.
Mọi thứ nằm dưới giá niêm yết tiêu chuẩn đều là một hệ số nhân được áp dụng cho bảng ở trên, chứ không phải một bảng giá riêng. Việc trình bày chúng dưới dạng hệ số nhân chính là điều khiến chúng có thể áp dụng linh hoạt: cùng ba hệ số nhân ấy áp dụng cho cả bốn loại đồng hồ trên cả hai mẫu, nên người đọc có bảng tiêu chuẩn là đã nắm được toàn bộ cấu trúc bậc.
• Batch — 50% so với mức tiêu chuẩn. Giá Batch của OpenAI đúng bằng một nửa trên cả bốn chỉ số ở cả hai mô hình: $1.00 cho đầu vào, $0.05 cho đầu vào đã cache, $1.25 cho ghi cache và $5.00 cho đầu ra trên mỗi triệu đối với GPT-6.1 Sol, và $1.00, $0.10, $1.25 cùng $5.00 trên GPT-6 Sol.
• Flex — 50% so với mức tiêu chuẩn, và giống hệt Batch trên cả hai mô hình đến từng dòng, nên việc chọn giữa hai lựa chọn này là vấn đề lập lịch chứ không phải vấn đề giá cả.
• Chế độ Fast — gấp 2× mức tiêu chuẩn trên cả bốn chỉ số ở cả hai thẻ, không có ngoại lệ nào được liệt kê trên bảng giá của bên nào. Chế độ Fast là $4.00 cho đầu vào, $0.20 cho đầu vào đã cache, $5.00 cho ghi cache và $20.00 cho đầu ra trên mỗi triệu đối với GPT-6.1 Sol, so với $4.00, $0.40, $5.00 và $20.00 trên GPT-6 Sol — hai dòng chỉ khác nhau ở dòng cached, và chỉ khác bởi đúng hệ số 2× mà mức giá cached tiêu chuẩn của mỗi mô hình vốn đã mang.
• Xử lý theo khu vực — mức tăng 10% cộng thêm lên bất kỳ hạng nào đang áp dụng, dành cho các mô hình phát hành từ ngày 5 tháng 3 năm 2026 trở đi, với bất kỳ vùng lưu trú nào khác ngoài mặc định.
Fast mode có một hạn chế về tính khả dụng mà chỉ riêng mức giá không cho bạn biết. Trang mô hình của chính OpenAI dành cho GPT-6.1 Sol nêu rằng Fast mode không khả dụng với lưu trú dữ liệu EU, và hướng dẫn về lưu trú dữ liệu của họ liệt kê GPT-6.1 Sol trong số các mô hình hỗ trợ lưu trú EU với xử lý Standard, Flex và Batch. Vì vậy, bên trong EU, thang bậc các gói ngắn hơn hai bậc, chứ không phải một: các bậc nửa giá vẫn có, còn bậc gấp đôi thì không. Người đọc so sánh một triển khai ở châu Âu với một triển khai ở Mỹ nên so nó với Standard, vì đó là bậc nhanh nhất mà nó có — việc dẫn một con số của Fast mode cho một khối lượng công việc ở EU mô tả một cấu hình mà nhà cung cấp không cung cấp.
Không có gì trên thẻ này mang tính khuyến mãi, và không có gì có ngày hết hạn.
Các dòng GPT-6.1 Sol ở trên là giá niêm yết. Trang giá của OpenAI không gắn kèm dấu hiệu khuyến mại nào và cũng không có ngày kết thúc cho chúng, và không có chỉ số nào trong bốn chỉ số trên thẻ ngữ cảnh ngắn hay dài được đánh dấu là con số có thời hạn. Điều đó đáng được nói rõ, bởi vì dòng sản phẩm này có một ví dụ phản chứng nằm ngay trên cùng trang: giá khuyến mại của GPT-5.6 Sol có một chú thích cam kết mức giá đó ít nhất đến hết ngày 21 tháng 11 năm 2026, nghĩa là bất kỳ mức giá GPT-5.6 Sol nào được báo hôm nay đều là mức giá gắn với một mốc xem xét đã biết. Không có gì ở GPT-6.1 Sol mang hình dạng đó.
Hệ quả thực tế là trang này không cần kèm cảnh báo kiểm tra ngày đối với chính các con số — mà cần một cảnh báo như vậy cho trang bạn đang đọc, bởi một mức giá niêm yết có thể thay đổi mà không cần ngày hết hiệu lực nào phải kích hoạt. Điều đó cũng có nghĩa thẻ GPT-6.1 Sol là dòng phù hợp để xây dựng mô hình chi phí nếu bạn đang chọn giữa hai bậc Sol và muốn phép so sánh giữ nguyên, không xê dịch: mức tính $0.20 cho bộ nhớ đệm của GPT-6 Sol cũng là một mức giá niêm yết thông thường, không gắn khuyến mãi, nên khoảng cách mười xu giữa chúng là khác biệt mang tính cấu trúc giữa các thẻ, chứ không phải một mức giảm giá tạm thời mà mô hình này đang chạy để chống lại mô hình kia.
Cách hiểu tuyên bố giá Sol GPT-6.1 của bất kỳ ai khác
Hai câu hỏi giải quyết gần như mọi bất đồng về việc một mô hình lớp Sol tốn bao nhiêu chi phí, và cả hai đều có thể được trả lời từ thẻ thay vì từ phần văn xuôi bao quanh nó.
• Đồng hồ đo nào đang được báo giá? Đầu vào, đầu vào được cache, ghi cache và đầu ra là bốn con số khác nhau trong cùng một yêu cầu, và một mức giá tiêu đề duy nhất hầu như luôn là đồng hồ đo đầu vào, còn ba con số kia bị bỏ ngỏ. Một tuyên bố đọc lên như thể là tổng chi phí thường thực ra là đơn giá đầu vào nhân với một tổ hợp token giả định, và chính tổ hợp giả định đó là nơi phát sinh bất đồng.
• Bậc ngữ cảnh nào đã được giả định? Bảng giá ngữ cảnh ngắn và ngữ cảnh dài chênh nhau 2× ở đầu vào và cache, và 1.5× ở đầu ra, và bậc được chọn dựa trên toàn bộ yêu cầu chứ không phải phần vượt trội, nên một con số được báo giá mà không nêu bậc là con số sẽ thay đổi ngay khi yêu cầu vượt qua 272.000 token đầu vào.
• Bậc xử lý nào đã được giả định? Standard, Batch, Flex và Fast chênh nhau theo các hệ số 2× và 50%, và một mức giá được báo mà không nói rõ là bậc nào thì đó là mức giá mang sẵn độ mơ hồ gấp bốn lần trước khi bất kỳ câu hỏi nào về đồng hồ đo được đặt ra.
• Mức nỗ lực nào đã được giả định, nếu có liên quan đến số lượng token? Đơn giá không phụ thuộc vào mức nỗ lực, nhưng số lượng token thì có, nên bất kỳ con số chi phí trên mỗi tác vụ nào cũng thừa hưởng mức nỗ lực suy luận mà tại đó nó được đo — và so sánh hai mô hình ở các thiết lập nỗ lực khác nhau không phải là so sánh giá của chúng.
Trả lời bốn điều đó thì một tuyên bố về giá hoặc đứng vững hoặc không. Điều nó không nên làm là bị đem so sánh với bốn thước đo của trang này khi chưa nêu tên hạng và thước đo trước, bởi vì hai thẻ nằm cạnh nhau chính xác là để dòng di chuyển duy nhất được nhìn thấy và không có gì khác bị nhầm với nó.

Nơi nấc GPT-6 Sol được phục vụ
OrcaRouter cung cấp bậc GPT-6 đúng theo mức giá niêm yết của chính OpenAI, không cộng thêm gì. Trang mô hình tại https://www.orcarouter.ai/models/openai/gpt-6-sol ghi GPT-6 Sol ở mức $2.00 cho đầu vào và $10.00 cho đầu ra mỗi triệu token, khớp với bảng trên từng dòng, với mức phụ phí 0%, và danh mục có hơn 200 mô hình theo cùng điều khoản. Bảng giá của chúng tôi cho tuyến đó mang đúng các con số $0.20 cho đầu vào được lưu đệm và $2.50 cho ghi đệm mà OpenAI công bố, nên các con số khớp nhau từng đồng hồ đo; hãy coi mọi con số lưu đệm trên trang này là sự nhắc lại mức giá đã công bố của OpenAI chứ không phải báo giá độc lập từ chúng tôi. GPT-6.1 Sol cũng được liệt kê trong danh mục của chúng tôi — bảng trực tiếp cho openai/gpt-6.1-sol ghi ngày phát hành là 29 tháng 9 năm 2026, cả hai bậc giá đều phản chiếu mức của OpenAI, và số token trong bảy ngày ở mức hàng trăm triệu — nên người đọc muốn bậc mới hơn nên đọc chính các con số trên trang đó thay vì coi trang này là lời cuối cùng về chúng. Giá thay đổi; trang này là báo giá.
So sánh trong bài viết này2
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
