
GPT-6.1 Ultrafast là bản Pro chỉ $500, và chi tiết đó nằm sâu tận ba bài đăng.
- openaiMỚIOpenAI: GPT-6.1 Sol2026-09-2952Trí tuệ
- anthropicMỚIAnthropic: Claude Sonnet 5.52026-09-2856Trí tuệ
- typesafeTypeSafe: Jev 1.132026-09-24$0.04 / $0.00 trên 1 triệu token · 111 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Trí tuệ
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Trí tuệ
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Trí tuệ
- xAIGrok 4.72026-09-2146Trí tuệ
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 trên 1 triệu token · 55 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token · 347 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 trên 1 triệu token · 60 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token · 377 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
GPT-6.1 Sol Ultrafastra mắt vào ngày 8 tháng 10 năm 2026 với thứ hiếm hoi nhất mà một bậc tốc độ có thể đi kèm: một mức giá được công bố. 12,00 USD cho mỗi triệu token đầu vào, 60,00 USD cho mỗi triệu token đầu ra, đúng sáu lần mứcGPT-6.1 Sol — mô hình mà OpenAI phát hành ngày 29 tháng 9 năm 2026 tại bài phát biểu chính DevDay 2026 — tốn trên làn tiêu chuẩn. Điều mà luồng thông báo không nêu ra ngay từ đầu là nơi một người đăng ký ChatGPT thực sự có thể bật nó lên, và câu trả lời, ở bài đăng thứ ba phía dưới, là gói Pro 500 USD. Thứ tự trình bày đó đáng được chú ý hơn mức nó nhận được, bởi vì nửa API và nửa đăng ký thuê bao của đợt ra mắt này được kiểm soát theo hai cách trái ngược nhau, và sự khác biệt ấy quyết định liệu Ultrafast là thứ bạn có thể dùng thử ngay tuần này hay là thứ bạn phải mua một gói để có được.
Không có gì về mô hình thay đổi. GPT-6.1 Sol Ultrafast vẫn là cùng một checkpoint, cùng cửa sổ ngữ cảnh 1,050,000 token, cùng mức trần đầu ra 128,000 token, cùng thời điểm cắt kiến thức 30 tháng 4, 2026 và cùng các câu trả lời như GPT-6.1 Sol. Ultrafast là một bậc dịch vụ — một mức ưu tiên lập lịch mà bạn yêu cầu — không phải một mô hình thứ hai. Toàn bộ sản phẩm chính là độ trễ, được bán với giá cao gấp nhiều lần, và chỉ có hai câu hỏi đáng quan tâm: bạn nhận được bao nhiêu trong số đó và ai được phép mua nó.
Điều mà hồ sơ thực sự nói, theo đúng thứ tự mà nó nói.
Phiên bản đầy oán trách của câu chuyện này cho rằng OpenAI đã chôn vùi cánh cổng. Phiên bản chính xác thì cụ thể hơn, và có thể kiểm chứng từng dòng một khi đối chiếu với tài liệu của chính OpenAI.
Nhật ký thay đổi dành cho nhà phát triển có mục đề ngày 8 tháng 10: bổ sung chế độ Ultrafast cho GPT-6.1 Sol trong Responses API, được yêu cầu bằng cách gửi model: "gpt-6.1-sol" với service_tier: "ultrafast", được mô tả là làm giảm thời gian giữa các token đầu ra được tạo, và được nêu là khả dụng cho tất cả người dùng API tùy thuộc vào giới hạn tốc độ, với xử lý toàn cầu và lưu trú dữ liệu tại Hoa Kỳ và EU. Đọc riêng nó, đó là một bản phát hành không hạn chế ở một mức giá đã công bố.
Tài liệu về các bậc dịch vụ cho biết Ultrafast là bậc dịch vụ nhanh nhất trong API, được cung cấp rộng rãi cho GPT-6 Astra và GPT-6.1 Sol, với quyền truy cập xem trước dành cho GPT-5.6 Sol, và khuyến nghị dùng WebSockets cho bậc này. Vẫn chưa có đề cập nào về một gói.

Chi tiết gói đăng ký nằm trên trang tốc độ phía ChatGPT, và đó là ba giới hạn xếp chồng trong một đoạn: Ultrafast có mặt trong Codex và ChatGPT Work, trên gói Pro $500, và trên các gói Enterprise và Edu đủ điều kiện. Quản trị viên Enterprise mặc định thấy nó bị tắt và phải bật cho từng người dùng hoặc từng workspace. Còn bề mặt Chat dành cho người tiêu dùng thì hoàn toàn không được cung cấp gói này — bản thân GPT-6.1 Sol nằm trong Work và Codex, nên Chat chưa từng thuộc phạm vi.
Ghép ba trang lại với nhau, bức tranh đã rõ. Một khóa API là một tấm vé. Gói đăng ký ChatGPT chỉ là một tấm vé nếu đó là gói đắt nhất mà OpenAI bán, hoặc nếu quản trị viên đã bật nó cho bạn. Không ai đọc bài đăng đầu tiên của thông báo mà có thể đoán ra điều đó.
Vì sao cánh cổng tồn tại, và đó không phải là điều tùy tiện.
Cách hiểu hiển nhiên là OpenAI đang dùng làn nhanh để bán các gói $500. Cơ chế bên dưới thì ít hoài nghi hơn và hữu ích hơn: Ultrafast là một đồng hồ đo đắt đỏ, và gói $500 là gói người tiêu dùng duy nhất mà một đồng hồ đo 8x nằm vừa trong hạn mức sử dụng đi kèm.
Trong một gói đăng ký, mức sử dụng được bao gồm sẽ bị tiêu thụ với tốc độ gấp tám lần mức tiêu chuẩn khi bạn dùng Ultrafast, vì vậy một lượt Ultrafast duy nhất rút bớt đúng bằng hạn mức của tám lượt tiêu chuẩn. Đó là hệ quả từ những gì gói này làm — nó mua thời gian thực bằng cách tiêu tốn năng lực phục vụ, và gói đăng ký là một sản phẩm có năng lực cố định. Tính cùng một hạn mức cho mức tiêu thụ năng lực gấp tám lần, và kinh tế của gói sẽ sụp đổ ở mức $20 một tháng. Tính hạn mức gấp tám lần, và gói này đơn giản trở nên kém hấp dẫn trên một gói nhỏ. Dù theo cách nào, gói này cũng phải nằm ở mức hạn mức đủ lớn để hấp thụ được nó.
API không có ràng buộc như vậy, vì nó được tính phí theo mức sử dụng. Ở đó, Ultrafast có ngân sách giới hạn tốc độ riêng, tách biệt với ngân sách của Standard và Fast, và OpenAI mô tả những giới hạn đó là được đặt theo từng tổ chức chứ không được công bố trên trang gói dịch vụ. Đó là điều thứ hai cần lưu ý mà thông báo đã không đưa lên tiêu đề: chuyển một khối lượng công việc sang Ultrafast không chỉ nhân hóa đơn lên, mà còn đẩy khối lượng công việc đó sang một trần khác, và nếu bạn tăng lưu lượng vượt quá mức mà tổ chức được cấp, thì chính các giới hạn của gói sẽ trở thành kiểu hỏng hóc.
Số học của việc mua tốc độ bằng hai cách khác nhau
Đây là quyết định được thể hiện bằng những con số, và đây là phần đáng để bạn tự tính dựa trên số token của chính bạn thay vì của tôi. Lấy một phiên agent gửi 30.000 token đầu vào và nhận 1.500 token đầu ra mỗi lượt, qua 40 lượt.
• Tổng số token mỗi lần chạy — 1.200.000 đầu vào, 60.000 đầu ra, trải đều trên 40 yêu cầu mà mỗi yêu cầu đều nằm thoải mái dưới ngưỡng 272.000 token, ngưỡng mà tại đó OpenAI định giá lại toàn bộ yêu cầu.
• Trên GPT-6.1 Sol tiêu chuẩn — 1,2 triệu token với $2.00 mỗi triệu là $2.40, cộng 60.000 với $10.00 mỗi triệu là $0.60. Ba đô la một lần chạy.
• Trên GPT-6.1 Sol Ultrafast — 1,2 triệu ở mức $12.00 là $14.40, cộng thêm 60.000 ở mức $60.00 là $3.60. Mười tám đô-la mỗi lần chạy.
• Sự khác biệt — $15,00 mỗi lần chạy để loại bỏ phần lớn thời gian tạo cho một tác vụ mà nếu không thì không có gì thay đổi.
Mức 15,00 USD mỗi lượt chạy đó là con số để đối chiếu với gói đăng ký. Nếu lý do duy nhất bạn cân nhắc gói Pro là Ultrafast, thì khoảng 33 lượt chạy mỗi tháng với số lượng token này là điểm mà mức 500 USD của gói và cách tính theo token của API giao nhau — dưới mức đó, tính theo token là cách rẻ hơn để mua cùng hạng, còn trên mức đó, gói bắt đầu có lợi. Số lượng token của bạn sẽ làm điểm giao nhau đó dịch chuyển, đôi khi rất nhiều, nên hãy tự tính toán con số của mình trước khi coi 33 là một ngưỡng. Đây là phép tính của chúng tôi trên một khối lượng công việc đã nêu, không phải điểm hòa vốn được công bố.

p>Hai ghi chú về cấu trúc vẫn đúng bất kể số lượng token.
Tuyên bố về tốc độ là vay mượn, và đó là điều duy nhất cần đọc thật kỹ
Ultrafast được quảng cáo dựa trên "nhanh hơn tới 8 lần", và phép đo duy nhất theo từng mô hình mà OpenAI công bố đằng sau cụm từ đó lại thuộc về một mô hình khác. Câu trong tài liệu của hãng viết rằng GPT-6 Astra Ultrafast tạo token nhanh hơn tới 8 lần so với GPT-6 Astra ở chế độ Standard trong Codex. Đó là một con số của Astra, được đo trong Codex. Tài liệu cho hạng GPT-6.1 Sol mô tả nó là giúp giảm thời gian giữa các token và chỉ tới một bảng giá; tài liệu không đưa ra con số cụ thể cho nó, và cũng chưa có bên độc lập nào công bố phép đo token mỗi giây cho biến thể Sol.
Điều đó hoàn toàn có thể đúng. Cả hai mô hình chạy trên cùng một ngăn xếp phục vụ và cơ chế tier là như nhau, nên bội số của Astra là một prior hợp lý cho Sol. Nhưng "tối đa 8x" là mức trần của nhà cung cấp, chưa được tái lập, lấy từ một mô hình anh em — và chữ "tối đa" đang thực sự gánh trọng trách trong câu đó. Hãy coi bội số đó như một giả thuyết mà bạn tự kiểm chứng trên các prompt của mình, vì tài liệu của chính tier đó không bao giờ kiểm chứng nó thay bạn.
Cùng lời cảnh báo đó thì nói ra cũng đỡ tốn kém hơn đối với các bậc cũ hơn. Ultrafast cho GPT-5.6 Sol được công bố vào ngày 13 tháng 8 năm 2026 với mức “nhanh hơn tới 14 lần so với Standard processing” trong bản xem trước giới hạn, và ba tháng sau, tài liệu vẫn ghi là quyền truy cập bản xem trước trong khi bảng giá Ultrafast chỉ có đúng hai hàng — GPT-6 Astra và GPT-6.1 Sol. Một con số 14x mà không có giá công bố và không có khả dụng chung là một lời tuyên bố hơn là một sản phẩm, và đó là lời nhắc hữu ích về việc còn bao nhiêu phần của thang bậc này vẫn chỉ là tham vọng.
Nếu gói $ không diễn ra
Với bất kỳ ai không định mua gói Pro $500 để thử một hạng độ trễ, động thái hữu ích là tách hai thứ mà thông báo đã gộp chung. Hạng này có sẵn trên API cho mọi người dùng API, nên làn nhanh có thể mua mà không cần đăng ký — ở mức $12.00 và $60.00 mỗi triệu token, với hạn mức rate-limit riêng, trên một khối lượng công việc đủ nhỏ để đo lường. Hãy thử nó ở đó trước, trên chính các prompt của bạn, so với làn tiêu chuẩn.
Làn tiêu chuẩn là làn tồn tại mà không cần bất kỳ thứ nào trong số này. OrcaRouter phục vụ GPT-6.1 Sol dưới dạng openai/gpt-6.1-sol theo đúng mức giá niêm yết của chính OpenAI — 2,00 USD cho mỗi triệu token đầu vào và 10,00 USD cho mỗi triệu token đầu ra — với mức chênh 0% và giá của nhà cung cấp được chuyển thẳng, nên khi nhà cung cấp đổi giá thì phía chúng tôi cập nhật ngay trong cùng ngày. Ultrafast không phải là thứ chúng tôi bán: đó là một cờ cấp dịch vụ được tính phí trên chính tài khoản OpenAI của bạn, và chúng tôi thà nói thẳng điều đó còn hơn để một trang mô hình ngụ ý điều khác. Điều mà một khóa duy nhất thực sự mang lại là khả năng định tuyến làn tiêu chuẩn và phần còn lại của danh mục — hơn 200 mô hình phía sau một điểm cuối tương thích với OpenAI — và tự động chuyển đổi dự phòng giữa các nhà cung cấp khi một nhà cung cấp bị suy giảm, đây là loại bảo hiểm rẻ nhất hiện có nếu bạn sắp đặt một tầng độ trễ trước một luồng sản xuất.

Và nếu bạn đang dùng Plus hoặc Team và câu trả lời bạn đang tìm là "tôi có thể chỉ cần bật cái này lên không", thì câu trả lời là không, với một dạng thức cụ thể. Codex và ChatGPT hoạt động trên gói Pro $500 hoặc một gói Enterprise hoặc Edu đủ điều kiện, được quản trị viên bật nếu đó là loại Enterprise. Mọi thứ khác đều tiếp cận Ultrafast thông qua API và trả phí theo token.
Xem gì tiếp theo
Ba điều sẽ biến việc này từ một đợt triển khai có rào chắn thành một đợt triển khai thông thường, và cả ba đều có thể quan sát được. Một giới hạn tốc độ Ultrafast được công bố cho GPT-6.1 Sol sẽ chấm dứt việc phỏng đoán liệu mức trần của chính hạng đó có trở thành ràng buộc trước khi hóa đơn phát sinh hay không. Một phép đo tốc độ riêng cho mô hình — hoặc một phép đo độc lập — sẽ thay thế con số Astra vay mượn bằng một thứ mà hạng Sol có thể được đánh giá dựa trên đó. Và việc Ultrafast tiếp cận ChatGPT Plus sẽ có nghĩa là bài toán dung lượng đã thay đổi, đó là dấu hiệu cho thấy rào chắn chỉ là sự khan hiếm khi ra mắt chứ không phải hình dạng thường trực của hạng này.
Cho đến khi đó, bản tóm tắt trung thực vẫn hẹp và có thể kiểm chứng. GPT-6.1 Sol đã ra mắt vào ngày 29 tháng 9 năm 2026 và vẫn không thay đổi. Vào ngày 8 tháng 10 năm 2026, nó có một kênh nhanh với mức giá thực tế, mở cho người dùng API và chỉ được mở trong ChatGPT khi dùng gói 500 đô-la — một chi tiết đáng lẽ phải có trong bài đăng đầu tiên chứ không phải bài thứ ba, và là chi tiết mà với phần lớn độc giả sẽ quyết định liệu đây là một mục hàng lẻ hay một đơn đặt hàng.
So sánh trong bài viết này1
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
