Một thẻ hero được tạo có tiêu đề 'Ba bài viết sâu' với phụ đề 'GPT-6.1 Ultrafast là Pro $500 chỉ trong ChatGPT — mở cho tất cả người dùng API', các chip ghi 'gói Pro $500', 'đủ điều kiện Enterprise và Edu' và 'tất cả người dùng API', và chân trang ghi 'Tình trạng khả dụng theo tài liệu OpenAI, 8 tháng 10 năm 2026'.
Guides & Insights

GPT-6.1 Ultrafast là bản Pro chỉ $500, và chi tiết đó nằm sâu tận ba bài đăng.

Tác giả

Alistair Wren

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình →
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

GPT-6.1 Sol Ultrafastra mắt vào ngày 8 tháng 10 năm 2026 với thứ hiếm hoi nhất mà một bậc tốc độ có thể đi kèm: một mức giá được công bố. 12,00 USD cho mỗi triệu token đầu vào, 60,00 USD cho mỗi triệu token đầu ra, đúng sáu lần mứcGPT-6.1 Sol — mô hình mà OpenAI phát hành ngày 29 tháng 9 năm 2026 tại bài phát biểu chính DevDay 2026 — tốn trên làn tiêu chuẩn. Điều mà luồng thông báo không nêu ra ngay từ đầu là nơi một người đăng ký ChatGPT thực sự có thể bật nó lên, và câu trả lời, ở bài đăng thứ ba phía dưới, là gói Pro 500 USD. Thứ tự trình bày đó đáng được chú ý hơn mức nó nhận được, bởi vì nửa API và nửa đăng ký thuê bao của đợt ra mắt này được kiểm soát theo hai cách trái ngược nhau, và sự khác biệt ấy quyết định liệu Ultrafast là thứ bạn có thể dùng thử ngay tuần này hay là thứ bạn phải mua một gói để có được.

Không có gì về mô hình thay đổi. GPT-6.1 Sol Ultrafast vẫn là cùng một checkpoint, cùng cửa sổ ngữ cảnh 1,050,000 token, cùng mức trần đầu ra 128,000 token, cùng thời điểm cắt kiến thức 30 tháng 4, 2026 và cùng các câu trả lời như GPT-6.1 Sol. Ultrafast là một bậc dịch vụ — một mức ưu tiên lập lịch mà bạn yêu cầu — không phải một mô hình thứ hai. Toàn bộ sản phẩm chính là độ trễ, được bán với giá cao gấp nhiều lần, và chỉ có hai câu hỏi đáng quan tâm: bạn nhận được bao nhiêu trong số đó và ai được phép mua nó.

Điều mà hồ sơ thực sự nói, theo đúng thứ tự mà nó nói.

Phiên bản đầy oán trách của câu chuyện này cho rằng OpenAI đã chôn vùi cánh cổng. Phiên bản chính xác thì cụ thể hơn, và có thể kiểm chứng từng dòng một khi đối chiếu với tài liệu của chính OpenAI.

Nhật ký thay đổi dành cho nhà phát triển có mục đề ngày 8 tháng 10: bổ sung chế độ Ultrafast cho GPT-6.1 Sol trong Responses API, được yêu cầu bằng cách gửi model: "gpt-6.1-sol" với service_tier: "ultrafast", được mô tả là làm giảm thời gian giữa các token đầu ra được tạo, và được nêu là khả dụng cho tất cả người dùng API tùy thuộc vào giới hạn tốc độ, với xử lý toàn cầu và lưu trú dữ liệu tại Hoa Kỳ và EU. Đọc riêng nó, đó là một bản phát hành không hạn chế ở một mức giá đã công bố.

Tài liệu về các bậc dịch vụ cho biết Ultrafast là bậc dịch vụ nhanh nhất trong API, được cung cấp rộng rãi cho GPT-6 Astra và GPT-6.1 Sol, với quyền truy cập xem trước dành cho GPT-5.6 Sol, và khuyến nghị dùng WebSockets cho bậc này. Vẫn chưa có đề cập nào về một gói.

A screenshot of OpenAI's Ultrafast mode documentation page inside the API production guide, headed 'Ultrafast mode' and described as the fastest API service tier for latency-sensitive work, stating it is broadly available for GPT-6 Astra and GPT-6.1 Sol with preview access for GPT-5.6 Sol.

Chi tiết gói đăng ký nằm trên trang tốc độ phía ChatGPT, và đó là ba giới hạn xếp chồng trong một đoạn: Ultrafast có mặt trong Codex và ChatGPT Work, trên gói Pro $500, và trên các gói Enterprise và Edu đủ điều kiện. Quản trị viên Enterprise mặc định thấy nó bị tắt và phải bật cho từng người dùng hoặc từng workspace. Còn bề mặt Chat dành cho người tiêu dùng thì hoàn toàn không được cung cấp gói này — bản thân GPT-6.1 Sol nằm trong Work và Codex, nên Chat chưa từng thuộc phạm vi.

Ghép ba trang lại với nhau, bức tranh đã rõ. Một khóa API là một tấm vé. Gói đăng ký ChatGPT chỉ là một tấm vé nếu đó là gói đắt nhất mà OpenAI bán, hoặc nếu quản trị viên đã bật nó cho bạn. Không ai đọc bài đăng đầu tiên của thông báo mà có thể đoán ra điều đó.

Vì sao cánh cổng tồn tại, và đó không phải là điều tùy tiện.

Cách hiểu hiển nhiên là O​penAI đang dùng làn nhanh để bán các gói $500. Cơ chế bên dưới thì ít hoài nghi hơn và hữu ích hơn: Ultrafast là một đồng hồ đo đắt đỏ, và gói $500 là gói người tiêu dùng duy nhất mà một đồng hồ đo 8x nằm vừa trong hạn mức sử dụng đi kèm.

Trong một gói đăng ký, mức sử dụng được bao gồm sẽ bị tiêu thụ với tốc độ gấp tám lần mức tiêu chuẩn khi bạn dùng Ultrafast, vì vậy một lượt Ultrafast duy nhất rút bớt đúng bằng hạn mức của tám lượt tiêu chuẩn. Đó là hệ quả từ những gì gói này làm — nó mua thời gian thực bằng cách tiêu tốn năng lực phục vụ, và gói đăng ký là một sản phẩm có năng lực cố định. Tính cùng một hạn mức cho mức tiêu thụ năng lực gấp tám lần, và kinh tế của gói sẽ sụp đổ ở mức $20 một tháng. Tính hạn mức gấp tám lần, và gói này đơn giản trở nên kém hấp dẫn trên một gói nhỏ. Dù theo cách nào, gói này cũng phải nằm ở mức hạn mức đủ lớn để hấp thụ được nó.

API không có ràng buộc như vậy, vì nó được tính phí theo mức sử dụng. Ở đó, Ultrafast có ngân sách giới hạn tốc độ riêng, tách biệt với ngân sách của Standard và Fast, và OpenAI mô tả những giới hạn đó là được đặt theo từng tổ chức chứ không được công bố trên trang gói dịch vụ. Đó là điều thứ hai cần lưu ý mà thông báo đã không đưa lên tiêu đề: chuyển một khối lượng công việc sang Ultrafast không chỉ nhân hóa đơn lên, mà còn đẩy khối lượng công việc đó sang một trần khác, và nếu bạn tăng lưu lượng vượt quá mức mà tổ chức được cấp, thì chính các giới hạn của gói sẽ trở thành kiểu hỏng hóc.

Số học của việc mua tốc độ bằng hai cách khác nhau

Đây là quyết định được thể hiện bằng những con số, và đây là phần đáng để bạn tự tính dựa trên số token của chính bạn thay vì của tôi. Lấy một phiên agent gửi 30.000 token đầu vào và nhận 1.500 token đầu ra mỗi lượt, qua 40 lượt.

• Tổng số token mỗi lần chạy — 1.200.000 đầu vào, 60.000 đầu ra, trải đều trên 40 yêu cầu mà mỗi yêu cầu đều nằm thoải mái dưới ngưỡng 272.000 token, ngưỡng mà tại đó OpenAI định giá lại toàn bộ yêu cầu.

• Trên GPT-6.1 Sol tiêu chuẩn — 1,2 triệu token với $2.00 mỗi triệu là $2.40, cộng 60.000 với $10.00 mỗi triệu là $0.60. Ba đô la một lần chạy.

• Trên GPT-6.1 Sol Ultrafast — 1,2 triệu ở mức $12.00 là $14.40, cộng thêm 60.000 ở mức $60.00 là $3.60. Mười tám đô-la mỗi lần chạy.

• Sự khác biệt — $15,00 mỗi lần chạy để loại bỏ phần lớn thời gian tạo cho một tác vụ mà nếu không thì không có gì thay đổi.

Mức 15,00 USD mỗi lượt chạy đó là con số để đối chiếu với gói đăng ký. Nếu lý do duy nhất bạn cân nhắc gói Pro là Ultrafast, thì khoảng 33 lượt chạy mỗi tháng với số lượng token này là điểm mà mức 500 USD của gói và cách tính theo token của API giao nhau — dưới mức đó, tính theo token là cách rẻ hơn để mua cùng hạng, còn trên mức đó, gói bắt đầu có lợi. Số lượng token của bạn sẽ làm điểm giao nhau đó dịch chuyển, đôi khi rất nhiều, nên hãy tự tính toán con số của mình trước khi coi 33 là một ngưỡng. Đây là phép tính của chúng tôi trên một khối lượng công việc đã nêu, không phải điểm hòa vốn được công bố.

A generated cost card headed 'The same 40-turn agent, two bills', showing two panels: GPT-6.1 Sol on the standard tier at $3.00 per run and GPT-6.1 Ultrafast at $18.00 per run, both for 1,200,000 input and 60,000 output tokens, with a footer reading that prices are OpenAI's own per-million list rates and the arithmetic is ours.

p>Hai ghi chú về cấu trúc vẫn đúng bất kể số lượng token.

Tuyên bố về tốc độ là vay mượn, và đó là điều duy nhất cần đọc thật kỹ

Ultrafast được quảng cáo dựa trên "nhanh hơn tới 8 lần", và phép đo duy nhất theo từng mô hình mà OpenAI công bố đằng sau cụm từ đó lại thuộc về một mô hình khác. Câu trong tài liệu của hãng viết rằng GPT-6 Astra Ultrafast tạo token nhanh hơn tới 8 lần so với GPT-6 Astra ở chế độ Standard trong Codex. Đó là một con số của Astra, được đo trong Codex. Tài liệu cho hạng GPT-6.1 Sol mô tả nó là giúp giảm thời gian giữa các token và chỉ tới một bảng giá; tài liệu không đưa ra con số cụ thể cho nó, và cũng chưa có bên độc lập nào công bố phép đo token mỗi giây cho biến thể Sol.

Điều đó hoàn toàn có thể đúng. Cả hai mô hình chạy trên cùng một ngăn xếp phục vụ và cơ chế tier là như nhau, nên bội số của Astra là một prior hợp lý cho Sol. Nhưng "tối đa 8x" là mức trần của nhà cung cấp, chưa được tái lập, lấy từ một mô hình anh em — và chữ "tối đa" đang thực sự gánh trọng trách trong câu đó. Hãy coi bội số đó như một giả thuyết mà bạn tự kiểm chứng trên các prompt của mình, vì tài liệu của chính tier đó không bao giờ kiểm chứng nó thay bạn.

Cùng lời cảnh báo đó thì nói ra cũng đỡ tốn kém hơn đối với các bậc cũ hơn. Ultrafast cho GPT-5.6 Sol được công bố vào ngày 13 tháng 8 năm 2026 với mức “nhanh hơn tới 14 lần so với Standard processing” trong bản xem trước giới hạn, và ba tháng sau, tài liệu vẫn ghi là quyền truy cập bản xem trước trong khi bảng giá Ultrafast chỉ có đúng hai hàng — GPT-6 Astra và GPT-6.1 Sol. Một con số 14x mà không có giá công bố và không có khả dụng chung là một lời tuyên bố hơn là một sản phẩm, và đó là lời nhắc hữu ích về việc còn bao nhiêu phần của thang bậc này vẫn chỉ là tham vọng.

Nếu gói $ không diễn ra

Với bất kỳ ai không định mua gói Pro $500 để thử một hạng độ trễ, động thái hữu ích là tách hai thứ mà thông báo đã gộp chung. Hạng này có sẵn trên API cho mọi người dùng API, nên làn nhanh có thể mua mà không cần đăng ký — ở mức $12.00 và $60.00 mỗi triệu token, với hạn mức rate-limit riêng, trên một khối lượng công việc đủ nhỏ để đo lường. Hãy thử nó ở đó trước, trên chính các prompt của bạn, so với làn tiêu chuẩn.

Làn tiêu chuẩn là làn tồn tại mà không cần bất kỳ thứ nào trong số này. OrcaRouter phục vụ GPT-6.1 Sol dưới dạng openai/gpt-6.1-sol theo đúng mức giá niêm yết của chính O​penAI — 2,00 USD cho mỗi triệu token đầu vào và 10,00 USD cho mỗi triệu token đầu ra — với mức chênh 0% và giá của nhà cung cấp được chuyển thẳng, nên khi nhà cung cấp đổi giá thì phía chúng tôi cập nhật ngay trong cùng ngày. Ultrafast không phải là thứ chúng tôi bán: đó là một cờ cấp dịch vụ được tính phí trên chính tài khoản O​penAI của bạn, và chúng tôi thà nói thẳng điều đó còn hơn để một trang mô hình ngụ ý điều khác. Điều mà một khóa duy nhất thực sự mang lại là khả năng định tuyến làn tiêu chuẩn và phần còn lại của danh mục — hơn 200 mô hình phía sau một điểm cuối tương thích với O​penAI — và tự động chuyển đổi dự phòng giữa các nhà cung cấp khi một nhà cung cấp bị suy giảm, đây là loại bảo hiểm rẻ nhất hiện có nếu bạn sắp đặt một tầng độ trễ trước một luồng sản xuất.

A generated availability card headed 'Where GPT-6.1 Ultrafast can be switched on', with an 'Included' column listing the API for all users subject to rate limits, Codex and ChatGPT Work on Pro $500, and eligible Enterprise and Edu with administrator opt-in, and a 'Not included' column listing ChatGPT Plus and Team plans and the consumer Chat surface, footnoted to OpenAI's API changelog dated 8 October 2026 and the ChatGPT speed page.

Và nếu bạn đang dùng Plus hoặc Team và câu trả lời bạn đang tìm là "tôi có thể chỉ cần bật cái này lên không", thì câu trả lời là không, với một dạng thức cụ thể. Codex và ChatGPT hoạt động trên gói Pro $500 hoặc một gói Enterprise hoặc Edu đủ điều kiện, được quản trị viên bật nếu đó là loại Enterprise. Mọi thứ khác đều tiếp cận Ultrafast thông qua API và trả phí theo token.

Xem gì tiếp theo

Ba điều sẽ biến việc này từ một đợt triển khai có rào chắn thành một đợt triển khai thông thường, và cả ba đều có thể quan sát được. Một giới hạn tốc độ Ultrafast được công bố cho GPT-6.1 Sol sẽ chấm dứt việc phỏng đoán liệu mức trần của chính hạng đó có trở thành ràng buộc trước khi hóa đơn phát sinh hay không. Một phép đo tốc độ riêng cho mô hình — hoặc một phép đo độc lập — sẽ thay thế con số Astra vay mượn bằng một thứ mà hạng Sol có thể được đánh giá dựa trên đó. Và việc Ultrafast tiếp cận ChatGPT Plus sẽ có nghĩa là bài toán dung lượng đã thay đổi, đó là dấu hiệu cho thấy rào chắn chỉ là sự khan hiếm khi ra mắt chứ không phải hình dạng thường trực của hạng này.

Cho đến khi đó, bản tóm tắt trung thực vẫn hẹp và có thể kiểm chứng. GPT-6.1 Sol đã ra mắt vào ngày 29 tháng 9 năm 2026 và vẫn không thay đổi. Vào ngày 8 tháng 10 năm 2026, nó có một kênh nhanh với mức giá thực tế, mở cho người dùng API và chỉ được mở trong ChatGPT khi dùng gói 500 đô-la — một chi tiết đáng lẽ phải có trong bài đăng đầu tiên chứ không phải bài thứ ba, và là chi tiết mà với phần lớn độc giả sẽ quyết định liệu đây là một mục hàng lẻ hay một đơn đặt hàng.

So sánh trong bài viết này1

Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày