
GPT-6.1 Sol đã ra mắt: Gần đạt Astra với giá chỉ bằng một phần năm, một tuần sau khi thay thế mô hình tiền nhiệm
- typesafeMỚITypeSafe: Jev 1.132026-09-24$0.04 / $0.00 trên 1 triệu token · 507 tok/s
- OpenAIMỚIOpenAI: GPT-6 Luna2026-09-2237Trí tuệ
- OpenAIMỚIOpenAI: GPT-6 Sol2026-09-2248Trí tuệ
- AnthropicMỚIAnthropic: Claude Opus 5.52026-09-2258Trí tuệ
- xAIMỚIGrok 4.72026-09-2146Trí tuệ
- OrcaMỚIOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 trên 1 triệu token · 194 tok/s
- OrcaMỚIOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token · 1143 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 trên 1 triệu token · 55 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- xAISpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
OpenAI đã phát hành GPT-6.1 Sol vào ngày 29 tháng 9 năm 2026, tại bài phát biểu chính của DevDay 2026 — một bản làm mới của GPT-6 Sol, dòng sản phẩm ra mắt đúng một tuần trước đó, không hề được điều chỉnh giá, và nhắm thẳng vào một mô hình có chi phí đắt gấp năm lần. Các con số chủ đạo không thay đổi so với phiên bản mà nó thay thế: 2,00 USD mỗi triệu token đầu vào và 10,00 USD mỗi triệu token đầu ra. Con số thực sự dịch chuyển lại chính là con số mà hầu hết các khối lượng công việc dạng agent phải trả: đầu vào được lưu đệm giảm từ 0,20 USD xuống 0,10 USD mỗi triệu token, bằng một nửa mức giá của GPT-6 Sol và bằng một phần mười của GPT-6 Astra. Cách diễn đạt của chính OpenAI là GPT-6.1 Sol "gần như sánh ngang" trí tuệ của GPT-6 Astra trong lập trình dạng agent, sử dụng máy tính và công việc chuyên môn, với mức giá token tiêu chuẩn chỉ bằng một phần năm của Astra — và đó là tuyên bố của nhà cung cấp, không phải kết quả đo lường; tính đến ngày 30 tháng 9, chưa có đơn vị đánh giá độc lập nào công bố dù chỉ một điểm số cho mô hình này. Phần tiếp theo sẽ tách bạch hai điều đó.
Những gì đã phát hành và bản ghi ở đâu

Bản phát hành này được ghi chép tài liệu đầy đủ một cách bất thường đối với một thông báo DevDay. Chỉ trong vòng vài giờ đã có một trang mô hình tại developers.openai.com, một khối giá, một phụ lục system card tại deploymentsafety.openai.com, và một commit trong schema API công khai của chính nhà cung cấp với tiêu đề "Add gpt-6.1-sol model to model enums", được đóng dấu thời gian 17:16 UTC ngày 29 tháng 9. Ngược lại, changelog dành cho nhà phát triển của OpenAI vẫn dừng ở mục ngày 22 tháng 9 vốn công bố GPT-6 Sol và GPT-6 Luna — mục về 6.1 chưa được viết ở đó, nên trang mô hình và bài đăng ra mắt chính là bản ghi chính. Việc phân giải này quan trọng vì không có bản snapshot thế hệ thứ hai nào để chỉ tới: danh sách snapshot của trang chỉ chứa một định danh, gpt-6.1-sol, không có biến thể kèm ngày, nên "GPT-6.1 Sol" và bản triển khai mà bạn gọi ngày hôm nay là cùng một thứ.
Hình dạng của nó, đặt cạnh thứ mà nó thay thế:
• Mã định danh — gpt-6.1-sol, một bản snapshot duy nhất so với gpt-6-sol cũng không có biến thể gắn ngày
• Ngữ cảnh — 1,050,000 token và 128,000 token đầu ra tối đa cho cả hai; trang 6.1 nêu rõ cả hai con số, trong khi trang 6.0 ghi nhận mức đầu vào tối đa 922,000 token thay vào đó
• Thời điểm cắt kiến thức — ngày 30 tháng 4, 2026 so với ngày 20 tháng 4, 2026
• Mức nỗ lực suy luận — thấp, trung bình (mặc định), cao, xhigh, tối đa, với none và minimal không được hỗ trợ so với cùng thang bậc cộng thêm none
• Giá — $2.00 đầu vào / $0.10 đã cache / $2.50 ghi cache / $10.00 đầu ra mỗi triệu token so với $2.00 / $0.20 / $2.50 / $10.00
• Lời nhắc dài — trên 272K token đầu vào, toàn bộ yêu cầu được tính lại giá ở mức 2× đối với đầu vào và cache, và 1.5× đối với đầu ra, giống hệt nhau ở cả hai mô hình
• Tính khả dụng — Plus, Pro, Business, Enterprise và Edu trong ChatGPT Work và Codex, cùng với API; rõ ràng không có trong sản phẩm Chat dành cho người tiêu dùng
• Lưu trú dữ liệu — hỗ trợ lưu trú dữ liệu tại Hoa Kỳ và EU, với chế độ nhanh không khả dụng khi lưu trú tại EU
• Công cụ — tìm kiếm web, tìm kiếm tệp, tạo hình ảnh, trình thông dịch mã, shell được lưu trữ, apply patch, skills, sử dụng máy tính, MCP và tìm kiếm công cụ, tất cả đều được hỗ trợ qua Responses API
• Tinh chỉnh — không được hỗ trợ trên cả hai
Một dạng API đáng lưu ý trước khi bạn di chuyển: GPT-6.1 Sol hỗ trợ Chat Completions, nhưng gọi công cụ yêu cầu API Responses. Trên GPT-6 Sol, ràng buộc là kiểu gần như ngược lại — gọi hàm trong Chat Completions chỉ hoạt động với reasoning_effort: "none". Nếu stack của bạn gọi công cụ thông qua /v1/chat/completions, đó là thay đổi mã, không phải đổi model.
Các tuyên bố của benchmark, được dán nhãn là các tuyên bố
Mọi con số trong phần này đều là của OpenAI, được công bố trong bài đăng ra mắt, và chưa có con số nào trong số đó được bất kỳ ai bên ngoài OpenAI tái lập. Chúng đáng được đọc trọn vẹn vì quy luật xuyên suốt chúng rất nhất quán — những mức tăng so với GPT-6 Sol là thật, nhưng khung diễn giải được lan truyền lại là so sánh với Astra, và so sánh với Astra thì luôn là so sánh chi phí.
• DeepSWE v1.1, các tác vụ kỹ thuật phần mềm phức tạp trên những codebase thực tế — OpenAI báo cáo GPT-6.1 Sol ngang ngửa GPT-6 Astra với chi phí chỉ bằng khoảng một phần năm, và vượt điểm số tốt nhất của GPT-6 Sol 6,4 điểm phần trăm với nỗ lực suy luận thấp hơn và chi phí thấp hơn.
• GDP.pdf, các câu hỏi chuyên môn trên những tài liệu PDF phức tạp — OpenAI báo cáo GPT-6.1 Sol đạt điểm cao hơn Claude Opus 5.5 ngay cả khi dùng các phương án dự phòng, với chi phí mỗi tác vụ chưa bằng một nửa trong tất cả các mức suy luận được thử nghiệm, và tiệm cận kết quả tiên tiến nhất của Astra với chi phí mỗi tác vụ chỉ bằng khoảng một phần năm.
• AutomationBench 1.0.6, các quy trình công việc nhiều bước trên 47 công cụ — OpenAI báo cáo cao hơn Claude Opus 5.5 2,2 điểm phần trăm ở mức suy luận trung bình với chi phí chỉ bằng khoảng một phần ba, và cao hơn GPT-6 Sol 4,8 điểm ở cùng mức cài đặt.
• OSWorld 2.0 bộ offline, sử dụng máy tính trong thời gian dài — OpenAI báo cáo mức cải thiện bảy điểm so với GPT-6 Sol ở mức nỗ lực suy luận tối đa với chi phí chưa bằng một nửa, và kết quả chỉ cách Astra 2,1 điểm với chi phí mỗi tác vụ bằng khoảng một phần bảy.
• Terminal-Bench Science 0.1, các quy trình khoa học — OpenAI báo cáo GPT-6.1 Sol tăng hơn gấp đôi điểm số của GPT-6 Sol ở mức nỗ lực tối đa với chi phí mỗi tác vụ chưa bằng một nửa, trung bình 5,47 đô la mỗi tác vụ so với 23,21 đô la của Claude Opus 5.5 và 23,80 đô la của Astra. OpenAI cũng nêu rằng Astra vẫn giữ điểm số cao nhất trong số các mô hình mà họ thử nghiệm ở mức 68,1% và nên được dùng cho những công việc khoa học khó nhất — một câu nói có ích và không mang tính quảng cáo.
• Factuality — trên các cuộc hội thoại đã được ẩn danh hóa, nơi người dùng đã đánh dấu lỗi của một mô hình trước đó, OpenAI báo cáo tỷ lệ phản hồi chứa lỗi thực tế giảm từ 11,4% xuống 7,7% ở mức nỗ lực suy luận thấp, tức giảm khoảng 32%, với tỷ lệ lỗi vẫn nằm trong khoảng cách 1,9 điểm so với Astra ở mọi mức cài đặt được thử nghiệm và chi phí mỗi tác vụ chưa bằng một phần năm.
Hai trong số đó đáng được diễn giải. Thứ nhất, đánh giá tính xác thực được chạy trên các prompt được cố ý chọn vì một mô hình trước đó đã trả lời sai chúng; OpenAI nói vậy trong bài đăng, và điều đó nghĩa là 11,4% và 7,7% mô tả một lát cắt lưu lượng mang tính đối kháng, chứ không phải lưu lượng của bạn. Thứ hai, đoạn có sức nặng nhất ủng hộ mô hình là đoạn nói về tính minh bạch của công cụ tìm kiếm trong phần phụ lục an toàn: trên các tác vụ được xây dựng để khơi ra thất bại ở mức nỗ lực suy luận tối đa, GPT-6.1 Sol không thông báo cho người dùng rằng công cụ tìm kiếm của nó bị hỏng trong 2,1% trường hợp, so với 4,9% ở GPT-6 Sol, 1,5% ở GPT-6 Astra và 28,7% ở GPT-6 Luna. Đó là kiểu con số quyết định liệu một agent có thể triển khai được hay không, và một lần nữa, nó cũng là con số của chính nhà cung cấp.
Bản ghi độc lập trống rỗng, và đó là nửa còn lại của câu chuyện.

Artificial Analysis — bảng đánh giá của bên thứ ba mà blog này coi là tham chiếu trung lập — không có mục GPT-6.1 Sol. Các URL mô hình của nó cho slug 6.1 Sol trả về 404, và chuỗi đó không xuất hiện trong HTML của bảng xếp hạng trực tuyến. Điều bảng này thực sự có là một đánh giá đầy đủ về GPT-6 Sol ở mức nỗ lực suy luận tối đa: Chỉ số Trí tuệ là 48, chi phí $1.06 cho mỗi tác vụ chỉ số, 77 triệu token đầu ra được tạo ra khi chạy chỉ số này so với mức trung vị của bảng là 88 triệu, và Chỉ số Tác nhân Lập trình là 57 với $2.99 mỗi tác vụ. Những con số đó là mốc neo độc lập gần nhất cho mô hình mà GPT-6.1 Sol thay thế, và chúng là thứ mà mọi tuyên bố về 6.1 rốt cuộc nên được đo lường dựa trên.
Cho đến khi mục đó xuất hiện, bất kỳ ai trích dẫn điểm 6.1 Sol khi so với một mô hình khác thì cũng chỉ đang trích dẫn OpenAI so với OpenAI. Đó không phải là lý do để không tin bài đăng ra mắt; đó là lý do để chạy bộ đánh giá của riêng bạn trước khi bạn chuyển một luồng production. Về chính điểm này, nhà cung cấp đưa ra một chỉ dẫn cụ thể một cách bất thường: OpenAI bảo các nhà phát triển đã dùng GPT-6 Sol hãy xem lại hướng dẫn di chuyển trước khi chuyển đổi, và hướng dẫn di chuyển bảo họ so sánh các cấu hình trên các tác vụ tiêu biểu thay vì mặc định rằng mức nỗ lực cao nhất là đánh đổi tốt nhất.
Phần giảm giá cho đầu vào được lưu trong bộ nhớ đệm mới là phần thực sự thay đổi hóa đơn
Một bảng giá không hề thay đổi nhưng mức giá cache giảm một nửa thì rất dễ bị đọc lướt qua, vậy mà đó lại là dòng quan trọng nhất trong bản phát hành đối với bất kỳ ai đang vận hành agent. Input được cache ở mức $0,10 mỗi triệu token chỉ bằng 5% giá input không cache, bằng một nửa mức cache của GPT-6 Sol, và — so với mức $1,00 input cache của GPT-6 Astra — chỉ bằng một phần mười của mẫu flagship. Các vòng lặp agent gửi đi gửi lại một tiền tố ổn định hàng nghìn lần gần như sống hoàn toàn nhờ dòng đó. Cùng một tháng agent 200 triệu token, vốn sẽ bị tính khoảng $40 cho input cache trên GPT-6 Sol, chỉ còn khoảng $20 trên GPT-6.1 Sol; còn trên GPT-6 Astra, cùng lượng traffic cache đó là $200.
Phép tính không bao giờ sạch sẽ đến vậy trong môi trường sản xuất, vì các lượt đọc cache chỉ được tính ở mức đó khi tiền tố thực sự trúng cache, và OpenAI lưu ý rằng việc thay đổi mức nỗ lực suy luận hoặc bộ công cụ khả dụng không còn làm mất hiệu lực một mục cache như trước đây nữa — đó là bản sửa lặng lẽ khiến dòng cache trở nên dùng được trong vòng lặp agent. Ngưỡng còn lại cần để ý không thay đổi: vượt 272.000 token đầu vào và toàn bộ yêu cầu sẽ được định giá lại ở mức gấp đôi đơn giá đầu vào và cache, cùng gấp 1,5 lần đơn giá đầu ra. Batch và Flex chạy thấp hơn 50% so với tiêu chuẩn, chế độ nhanh chạy ở mức gấp 2 lần tiêu chuẩn, và xử lý theo khu vực cộng thêm 10% phụ phí ở nơi có hỗ trợ.
Những gì chưa được phát hành, và điều đó có ý nghĩa gì đối với việc định tuyến

OpenAI cho biết GPT-6.1 Sol Ultrafast sẽ ra mắt "trong những ngày tới" trong Codex với tốc độ tạo token nhanh hơn tối đa 8×, nhưng không kèm giá. Đó là một lời hứa, không phải một sản phẩm, và đáng được gọi đúng như vậy: hôm nay không có bảng giá Ultrafast cho hạng 6.1, và OpenAI chưa nói liệu con số 8× được đo so với tốc độ tiêu chuẩn hay so với chế độ nhanh, vốn có giá gấp 2× mức tiêu chuẩn. Hãy coi thông báo này như một tín hiệu về lịch trình và định giá nó khi một con số xuất hiện.
Về phía chúng tôi, thành thật mà nói: GPT-6.1 Sol vẫn chưa có trên các tuyến của OrcaRouter. Điểm cuối danh mục công khai hiện trả về "model not found" cho openai/gpt-6.1-sol hôm nay, và danh sách OpenAI của chúng tôi gồm có GPT-6 Astra, GPT-6 Sol và GPT-6 Luna. Thứ có thể gọi được trên OrcaRouter ngay lúc này là GPT-6 Sol với đúng giá niêm yết của OpenAI, không đánh thêm phụ phí — bảng giá $2.00 / $0.20 / $10.00, cùng quy tắc đổi giá 272K, được chuyển nguyên vẹn đúng như nhà cung cấp niêm yết. Điều đó quan trọng hơn mức thường lệ trong tuần này vì một lý do cụ thể: cơ chế chuyển nguyên vẹn đó cũng có nghĩa là nếu OpenAI cắt giảm giá của hạng 6.1, hoặc gắn một con số cho Ultrafast, thì thay đổi sẽ có hiệu lực ở phía chúng tôi cùng ngày với phía OpenAI, không cần đàm phán lại hợp đồng thứ hai. Khi 6.1 Sol xuất hiện trên các tuyến, nó sẽ xuất hiện trong danh mục với giá của nhà cung cấp như mọi thứ khác, và cho đến lúc đó, câu trả lời trung thực là mô hình mà nó thay thế chính là mô hình bạn có thể gọi.
Phiên bản thực tế của quyết định: nếu bạn đã dùng GPT-6 Sol và khối lượng công việc của bạn nặng về bộ nhớ đệm, mang tính tác tử hoặc dài hạn, thì bản cập nhật 6.1 cải thiện đúng những khía cạnh mà bạn đang trả tiền, và việc chuyển đổi chỉ là thay đổi chuỗi mô hình cộng với việc chuyển từ Chat-Completions sang Responses nếu bạn dùng công cụ. Nếu khối lượng công việc của bạn là tạo sinh với prompt ngắn và ít tái sử dụng, bản phát hành này gần như không thay đổi gì đối với bạn — cùng giá đầu vào, cùng giá đầu ra, cùng cửa sổ. Và nếu bạn đang chờ điểm đánh giá của bên thứ ba trước khi quyết định, thì sự chờ đợi đó vẫn còn bỏ ngỏ.
So sánh trong bài viết này2
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
