
GPT-6.1 Sol: OpenAI ra mắt hiệu năng gần bằng Astra với mức giá của mô hình mà nó thay thế
- typesafeMỚITypeSafe: Jev 1.132026-09-24$0.04 / $0.00 trên 1 triệu token · 934 tok/s
- OpenAIMỚIOpenAI: GPT-6 Luna2026-09-2237Trí tuệ
- OpenAIMỚIOpenAI: GPT-6 Sol2026-09-2248Trí tuệ
- AnthropicMỚIAnthropic: Claude Opus 5.52026-09-2258Trí tuệ
- xAIMỚIGrok 4.72026-09-2146Trí tuệ
- OrcaMỚIOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 trên 1 triệu token · 194 tok/s
- OrcaMỚIOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token · 1167 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 trên 1 triệu token · 56 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- xAISpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
OpenAI đã ra mắt GPT-6.1 Sol vào ngày 29 tháng 9 năm 2026, tại bài phát biểu chính của DevDay 2026 — một bản làm mới của dòng GPT-6 Sol cao cấp vốn ra mắt chỉ một tuần trước đó, có mức giá hoàn toàn giống hệt: 2 đô la cho mỗi triệu token đầu vào và 10 đô la cho mỗi triệu token đầu ra, và được nhà cung cấp định vị là đang tiệm cận GPT-6 Astra, mẫu flagship giá 10/50 đô la, chỉ với khoảng một phần năm chi phí trên mỗi token của nó. Điểm bất thường không nằm ở giá. Mà là việc một bản làm mới giữ nguyên mức giá, ra đời sau đúng một tuần, lại tuyên bố có bước nhảy vọt về năng lực, và rằng tính đến thời điểm viết bài này, chưa có đơn vị đánh giá độc lập nào chấm điểm nó. Mọi con số về năng lực trong bài viết này mà đến từ OpenAI đều được ghi rõ nguồn gốc như vậy, bởi vì hiện chưa có gì khác để đối chiếu.
Những gì thực sự được phát hành, và khi nào

Bản phát hành này được ghi chép đầy đủ một cách bất thường đối với một thông báo DevDay, và điều đó tự nó đã đáng chú ý: chỉ trong vòng vài giờ đã có một trang mô hình, một bảng giá, một phụ lục system card, và một mục đã được commit trong schema API công khai của nhà cung cấp — một commit mang tiêu đề "Add gpt-6.1-sol model to model enums" vào lúc 17:16 UTC ngày 29 tháng 9, trong đó bản sửa đổi cha chứa chuỗi này không lần nào. Tuy nhiên, changelog của chính nhà cung cấp vẫn dừng ở bản phát hành ngày 22 tháng 9 của GPT-6 Sol và GPT-6 Luna; mục 6.1 Sol vẫn chưa được viết ở đó, vì vậy trang mô hình và bài đăng thông báo chính là bản ghi chép.
Hình dạng cụ thể của nó:
• Model ID: gpt-6.1-sol, một snapshot duy nhất, không có biến thể theo ngày — bạn luôn ở trên bản dựng hiện hành.
• Khả dụng: hiện đã dành cho người dùng Plus, Pro, Business, Enterprise và Edu trong ChatGPT Work và Codex, cùng qua API. Hoàn toàn không có trong sản phẩm Chat dành cho người tiêu dùng — điều mà OpenAI nói rõ chứ không để người ta tự suy ra.
• Ngữ cảnh: 1.050.000 token, đầu ra tối đa 128.000, kiến thức cắt đến ngày 30 tháng 4 năm 2026.
• Kiểm soát suy luận: low, medium (mặc định), high, xhigh và max — năm mức, không phải sáu. GPT-6.1 Sol và GPT-6 Astra không còn chấp nhận mức effort none mà GPT-6 Sol và GPT-6 Luna vẫn có.
• Phương thức: đầu vào văn bản và hình ảnh, đầu ra văn bản. Không hỗ trợ đầu vào âm thanh và video.
• Công cụ: web search, file search, image generation, code interpreter, hosted shell, apply patch, skills, computer use, MCP và tool search — tất cả đều qua Responses API. Chat Completions chỉ hoạt động khi không dùng công cụ.
• Không hỗ trợ: fine-tuning. Đây là mô hình để bạn ra lệnh, không phải mô hình để bạn huấn luyện.
• Đã công bố, chưa phát hành: một hạng Ultrafast. OpenAI cho biết sẽ cung cấp GPT-6.1 Sol Ultrafast "trong vài ngày tới", với tốc độ tạo token nhanh hơn tới 8 lần trong Codex, nhưng không kèm giá và không có ngày cụ thể.
Hai hàng đáng để đọc lại lần hai. Thang nỗ lực năm cấp độ nghĩa là một prompt đã dùng none như một lối thoát rẻ tiền sẽ không vượt qua kiểm tra hợp lệ trên 6.1 Sol, và nhà cung cấp công bố hướng dẫn di chuyển cho đúng bước chuyển này từ gpt-6-sol. Và dòng Ultrafast đáng để đọc kỹ: cùng bậc đó đã được cung cấp rộng rãi cho GPT-6 Astra và đang ở dạng xem trước cho GPT-5.6 Sol, nên 6.1 Sol đang được mô tả như một bổ sung sắp tới cho một bậc vốn đã tồn tại ở các mô hình khác — không phải là một bậc mới.
Giá cả, và chỗ nó thực sự gây đau
Mức giá được nêu bật không thay đổi so với GPT-6 Sol: 2,00 USD cho mỗi triệu token đầu vào và 10,00 USD cho mỗi triệu token đầu ra, với các lượt ghi bộ nhớ đệm ở mức 2,50 USD. Cách nhà cung cấp tự trình bày trong thông báo là so sánh với mô hình chủ lực của mình, trong đó mức 2/10 USD chỉ bằng một phần năm mức 10/50 USD của GPT-6 Astra — một khoảng cách thực sự, và cũng là con số ít thú vị nhất trên bảng, bởi vì GPT-6 Sol vốn đã có giá 2/10 USD.
Điều đã thay đổi chính là dòng đầu vào được lưu trong bộ nhớ đệm, và đây chính là thứ làm dịch chuyển ngân sách. GPT-6.1 Sol lưu bộ nhớ đệm ở mức $0,10 cho mỗi triệu token so với $0,20 của GPT-6 Sol — một nửa giá, và chỉ bằng 5% mức giá đầu vào không lưu bộ nhớ đệm. Với bất kỳ thứ gì tái sử dụng một tiền tố dài xuyên suốt các yêu cầu, chi phí đầu vào thực tế của tiền tố đó vừa giảm một nửa, cộng thêm việc mô hình trở nên tốt hơn, và đó chính là con số bạn cần mô hình hóa nếu bạn đang định giá một agent mang theo ngữ cảnh giữa các lượt.
Các hệ số nhân, từ trang định giá của nhà cung cấp:
• Tiêu chuẩn: $2,00 đầu vào / $0,10 đã cache / $2,50 ghi cache / $10,00 đầu ra.
• Chế độ Nhanh: đúng gấp 2 lần mức tiêu chuẩn — $4,00 / $0,20 / $5,00 / $20,00. Không khả dụng với lưu trú dữ liệu EU.
• Batch và Flex: 50% mức tiêu chuẩn — $1,00 / $0,05 / $1,25 / $5,00.
• Xử lý theo khu vực: phụ phí 10% ở nơi có hỗ trợ; cả lưu trú Hoa Kỳ và EU đều được hỗ trợ trên mô hình này.
• Prompt dài: mọi nội dung vượt quá 272.000 token đầu vào sẽ được định giá lại cho toàn bộ yêu cầu ở mức gấp 2 lần giá đầu vào và cache, và gấp 1,5 lần đầu ra — $4,00 / $0,20 với $15,00 đầu ra. Việc phía đầu ra tăng 1,5 lần thay vì gấp đôi là điểm nhẹ hơn ở bước ngữ cảnh dài của dòng mô hình này.
Dòng ngữ cảnh dài là dòng cần thiết kế xoay quanh. Cửa sổ ngữ cảnh là một triệu token, nhưng ngưỡng giảm giá nằm ở 272.000 — vì vậy mức trần thực tế cho một yêu cầu duy nhất là quyết định ngân sách, không phải quyết định cửa sổ, và một pipeline tài liệu vượt qua ngưỡng đó sẽ phải trả gấp đôi cho toàn bộ yêu cầu thay vì chỉ trả cho phần vượt.
Những gì OpenAI tuyên bố, và những gì chưa ai đo lường được
Mọi con số hiệu năng được công bố cho GPT-6.1 Sol cho đến nay đều do nhà cung cấp báo cáo và chưa được tái lập. Thông báo của OpenAI mô tả mức cải thiện trên năm bài đánh giá:
• DeepSWE v1.1 (kỹ thuật phần mềm phức tạp trong các codebase thực tế) — sánh ngang với GPT-6 Astra với chi phí chỉ khoảng một phần năm, và vượt điểm tốt nhất của GPT-6 Sol 6,4 điểm phần trăm ở mức nỗ lực suy luận thấp hơn.
• GDP.pdf (các câu hỏi chuyên môn trên các PDF phức tạp) — đạt điểm cao hơn Claude Opus 5.5 có dự phòng với chi phí mỗi tác vụ chưa bằng một nửa, và tiệm cận Astra với chi phí mỗi tác vụ khoảng một phần năm.
• AutomationBench 1.0.6 (47 công cụ, quy trình nghiệp vụ nhiều bước) — cao hơn Claude Opus 5.5 2,2 điểm phần trăm ở mức nỗ lực trung bình với chi phí khoảng một phần ba, và tăng 4,8 điểm so với GPT-6 Sol ở cùng thiết lập.
• OSWorld 2.0 offline set (sử dụng máy tính) — cao hơn GPT-6 Sol bảy điểm ở mức nỗ lực tối đa với chi phí chưa bằng một nửa, và chỉ kém Astra 2,1 điểm với chi phí mỗi tác vụ khoảng một phần bảy.
• Terminal-Bench Science 0.1 (phân tích dữ liệu, mô phỏng, chứng minh định lý) — cao hơn gấp đôi điểm của GPT-6 Sol ở mức nỗ lực tối đa; trung bình $5,47 mỗi tác vụ so với $23,21 cho Opus 5.5 và $23,80 cho Astra. OpenAI lưu ý Astra vẫn dẫn đầu nhóm ở mức 68,1%.
Hai con số ở đây không phải là điểm năng lực mới là những con số thú vị hơn, vì chúng là những tuyên bố về tỷ lệ thất bại chứ không phải tuyên bố trên bảng xếp hạng. Về tính xác thực, OpenAI báo cáo tỷ lệ phản hồi chứa ít nhất một lỗi thực tế giảm từ 11,4% xuống 7,7% ở mức nỗ lực suy luận thấp — mức giảm khoảng 32% — và cho biết tỷ lệ lỗi nằm trong phạm vi 1,9 điểm so với Astra trên các thiết lập đã thử nghiệm. Về độ tin cậy của công cụ, tỷ lệ trường hợp tác nhân không thông báo cho người dùng rằng công cụ tìm kiếm của nó bị hỏng giảm xuống 2,1%, so với 4,9% đối với GPT-6 Sol, 1,5% đối với GPT-6 Astra và 28,7% đối với GPT-6 Luna.
Cả hai đều đi kèm với những lưu ý riêng của nhà cung cấp, và chúng cụ thể một cách bất thường: bộ dữ liệu về tính xác thực gồm các cuộc trò chuyện đã được khử nhận dạng, trong đó người dùng đã đánh dấu lỗi của một mô hình trước đó, còn các tác vụ tiết lộ công cụ được chọn để làm bộc lộ các thất bại. Không cái nào trong hai là tuyên bố về cách sử dụng thông thường, và OpenAI cũng nói như vậy. Hãy coi chúng như mô tả của nhà cung cấp về công việc đảm bảo độ tin cậy của chính mình, chứ không phải các dữ kiện đã được đo lường.
Bức tranh độc lập mỏng hơn mức bạn kỳ vọng đối với một màn ra mắt cận cao cấp. Artificial Analysis — đơn vị đánh giá mà Chỉ số Thông minh của họ thường được dùng làm tham chiếu cho phần còn lại của dòng mô hình này — không có mục nào cho GPT-6.1 Sol: URL mô hình của nó trả về lỗi 404 và chuỗi đó không xuất hiện ở bất kỳ đâu trong dữ liệu bảng xếp hạng của họ, dù dữ liệu này có GPT-6 Sol, GPT-6 Astra và GPT-6 Luna ở các cấu hình suy luận khác nhau. Mốc so sánh gần nhất hiện có chính là mô hình mà mô hình này thay thế: Artificial Analysis chấm GPT-6 Sol đạt 48 trên Chỉ số Thông minh của họ ở cấu hình nỗ lực tối đa, với chi phí đánh giá 1,05 USD mỗi tác vụ, tạo ra 77 triệu token trong toàn bộ lần chạy, ở tốc độ 78 token mỗi giây. Cho đến khi 6.1 Sol có một dòng dữ liệu tương đương, tóm tắt trung thực nhất về tuyên bố năng lực là: OpenAI nói đây là một bước tiến lớn, và chưa ai công bố con số nào đồng tình hay phản đối.
Cái tên, và mô hình không bao giờ đến
Dòng GPT-6 được chia thành ba hạng — Astra ở trên cùng, Sol bên dưới, Luna ở dưới cùng — cộng thêm một bóng ma. Bóng ma đó chính là GPT-6.1 Astra, bản nâng cấp flagship theo kế hoạch mà Wall Street Journal đưa tin hôm 28 tháng 9 rằng đã bị hủy bỏ, với việc huấn luyện frontier bị tạm dừng. Chúng tôi đã đề cập quyết định đó trong một bài riêng thay vì mổ xẻ lại ở đây. Điều quan trọng khi đọc bản phát hành này là hình hài mà nó để lại: một bước tăng phiên bản 0.1 cho hạng tầm trung, mang theo những cải tiến lẽ ra sẽ thuộc về một flagship, cùng dòng định vị trên chính trang của mô hình nêu rõ ý định — hiệu năng gần bằng Astra cho các công việc phức tạp với chi phí thấp hơn. GPT-6.1 Sol không hẳn là một bước lặp lại của Sol tuần trước mà đúng hơn là sự thay thế cho một mô hình chưa từng được phát hành.
Thành thật mà nói, vị trí của điều này đối với chúng tôi
OrcaRouter chưa định tuyến GPT-6.1 Sol. Danh mục công khai không có mục nào cho nó, và chúng tôi sẽ không mô tả một mô hình mà mình không thể phục vụ như thể có thể. Thứ chúng tôi phục vụ là mô hình mà nó thay thế: GPT-6 Sol trên OrcaRouter có cùng mức giá niêm yết $2.00 đầu vào / $10.00 đầu ra với cả hai dòng bậc ngữ cảnh được công bố, cùng với GPT-6 Astra ở trên và GPT-6 Luna ở dưới.

Lý do quan trọng đối với việc làm mới cùng mức giá thay vì giảm giá: vì chúng tôi chuyển tiếp nguyên giá niêm yết của nhà cung cấp mà không cộng thêm markup, nên ngày GPT-6.1 Sol xuất hiện trong danh mục, nó sẽ có giá đúng bằng mức OpenAI thu cho nó, không có độ trễ định giá lại từ phía chúng tôi — và vì một API key truy cập được mọi nhà cung cấp mà chúng tôi phân phối, việc chuyển một workload sang nó chỉ là thay đổi model-ID, không phải một hợp đồng mới. Với một sự thay thế mà model hiện tại và model thay thế có chi phí hoàn toàn bằng nhau, đó là khác biệt giữa một chỉnh sửa một dòng và một dự án migration. Cho đến lúc đó, động thái hợp lý với một model chưa được chấm điểm là giữ nó ngoài luồng production và dùng failover sang một model anh em đã được kiểm chứng khi model chính gặp lỗi — đây cũng là cách rẻ nhất để tìm hiểu liệu những tuyên bố của nhà cung cấp có đúng với workload của bạn hay không.
Những gì cần theo dõi trong hai tuần tới
Ba điều sẽ giải quyết những câu hỏi mà bản phát hành này còn để ngỏ, và chưa có điều nào trong số đó xuất hiện. Thứ nhất, một điểm số độc lập — chỉ một dòng Artificial Analysis cho GPT-6.1 Sol sẽ biến tuyên bố lớn nhất trong thông báo thành thứ có thể kiểm chứng, và đây là con số có khả năng thay đổi quyết định mua sắm cao nhất. Thứ hai, giá của Ultrafast: OpenAI đã hứa cung cấp tier này "trong vài ngày tới" cho Codex với tốc độ tạo tối đa gấp 8 lần, nhưng một tier phục vụ được công bố mà không kèm con số nào chỉ là lời hứa, không phải sản phẩm, và mức 2x-standard của Fast mode là điểm neo duy nhất để đoán xem nó sẽ có giá bao nhiêu. Thứ ba, liệu mức cải thiện độ xác thực từ 11,4% đến 7,7% có trụ được khi đối mặt với một harness không phải của OpenAI hay không — bởi vì điều đó, cùng với tỷ lệ tiết lộ công cụ tìm kiếm, là hai tuyên bố có thể biện minh cho việc chuyển lưu lượng production thay vì một dòng trên bảng xếp hạng.

Tóm tắt trung thực là GPT-6.1 Sol là một bản phát hành thực sự với bảng giá thực sự, một bề mặt API được tài liệu hóa, và một loạt các con số từ nhà cung cấp lớn hơn mức mà một bản nâng cấp 0.1 thường mang lại. Lập luận về giá thì dễ: nó có cùng mức giá như mô hình mà nó thay thế, và đầu vào được lưu đệm của nó chỉ tốn một nửa. Lập luận về năng lực hoàn toàn thuộc về OpenAI cho đến khi ai đó khác đo lường nó — đó chính là lý do để đọc bảng thông số kỹ thuật ngay bây giờ và các benchmark trong một tuần.
GPT-6.1 Sol vẫn chưa có trên các tuyến của chúng tôi. Khi có, nó sẽ xuất hiện trong danh mục mô hình đầy đủ ở mức giá niêm yết của chính OpenAI, không cộng thêm phụ phí, bên cạnh hơn 200 mô hình vốn đã nằm sau một khóa API duy nhất.
So sánh trong bài viết này2
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
