Một thẻ hero được tạo có tiêu đề 'Một hạng, ba mô hình' với ba chip ghi 'GPT-6.1 Sol Ultrafast: khả dụng, $12.00 / $60.00', 'GPT-6 Astra Ultrafast: khả dụng, $60.00 / $300.00' và 'GPT-5.6 Sol Ultrafast: chỉ xem trước, chưa công bố mức giá', phía trên dòng chân trang ghi 'Theo như đọc từ tài liệu của OpenAI vào ngày 9 tháng 10 năm 2026'.
Guides & Insights

GPT-6.1 Sol Ultrafast so với GPT-5.6 Sol Ultrafast: Một hạng, ba mô hình, một trong số đó vẫn đang chờ

Tác giả

Alistair Wren

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình →
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

GPT-6.1 Sol Ultrafast và GPT-5.6 Sol Ultrafastlà cùng một bậc dịch vụ được áp dụng cho hai thế hệ Sol khác nhau, và sau ngày 8 tháng 10 năm 2026, chúng ở hai trạng thái trái ngược nhau. GPT-6.1 Solđã đi từ "sắp ra mắt" đến một bảng giá được công bố — 12,00 USD cho mỗi triệu token đầu vào, 60,00 USD cho mỗi triệu token đầu ra, gấp sáu lần mức Standard — có sẵn cho mọi người dùng API, và cho người dùng Codex cùng ChatGPT Work trên gói Pro 500 USD. GPT-5.6 Solvẫn ở đúng nơi Ultrafast khởi đầu: một bậc dịch vụ đã được công bố, trong chế độ xem trước giới hạn, hoàn toàn không có dòng nào trên trang giá. Cùng tên, cùng cơ chế, và chỉ một trong hai là thứ bạn có thể mua.

Đó là phiên bản ngắn gọn. Phiên bản dài hơn lại quan trọng vì những con số tốc độ nổi bật của hạng này được gắn với những mẫu khác nhau, được đo trên những bề mặt khác nhau, và trong một trường hợp thì đã cũ ba tháng.

Thực chất "Ultrafast" là gì trên từng mẫu máy

Ở cả hai mô hình, Ultrafast đều không phải là một checkpoint riêng. Bạn gửi cùng một model id và chuyển đổi một service tier — model: "gpt-6.1-sol" với service_tier: "ultrafast" trong Responses API — và OpenAI sẽ lên lịch yêu cầu của bạn trên đường dẫn có độ trễ thấp. Trọng số, câu trả lời và cửa sổ ngữ cảnh đều không thay đổi. Trên GPT-6.1 Sol, cửa sổ đó là 1,050,000 token với đầu vào tối đa 922,000 token và đầu ra tối đa 128,000; GPT-5.6 Sol có cửa sổ và giới hạn đầu ra y hệt, chỉ khác chủ yếu ở mốc kiến thức (16 tháng 2, 2026 so với 30 tháng 4, 2026) và ở thang suy luận, nơi GPT-5.6 Sol vẫn chấp nhận none còn GPT-6.1 Sol thì không.

Vậy nên, so sánh không phải là "mô hình nào suy nghĩ nhanh hơn". Mà là "thế hệ nào của cùng một hạng được mở cho bạn", và câu trả lời đã thay đổi cách đây bốn ngày.

A screenshot of OpenAI's Ultrafast mode documentation page, showing the sentence 'Ultrafast mode is the fastest service tier in the OpenAI API', the availability sentence naming broad availability for GPT-6 Astra and GPT-6.1 Sol with preview access for GPT-5.6 Sol, the WebSockets recommendation warning that network overhead can reduce the latency gains without a persistent connection, the note that Ultrafast has separate rate limits from Standard and Fast modes, the line that GPT-6.1 Sol supports US and EU data residency, and a code sample setting service_tier to 'ultrafast' with model 'gpt-6.1-sol'.

Các bội số đã công bố, và con số duy nhất vẫn giữ nguyên ở mức 14x

OpenAI đã công bố hai tuyên bố về tốc độ liên quan đến hạng này, trên hai mô hình, và cả hai đều không phải là tuyên bố chung về “Ultrafast”.

• GPT-6 Astra Ultrafast — "tạo token nhanh hơn tới 8 lần so với GPT-6 Astra ở chế độ Standard trong Codex". Đây là dòng tiêu đề hiện tại của gói này, được lặp lại trên tài liệu về tốc độ phía ChatGPT.

• GPT-5.6 Sol Ultrafast — được công bố vào ngày 13 tháng 8 năm 2026 với khả năng chạy "nhanh hơn tới 14 lần so với xử lý Standard", trong chế độ xem trước giới hạn dành cho một số khách hàng được chọn.

Hãy để ý xem thứ gì đang thiếu. Không có bội số tốc độ nào được công bố cho GPT-6.1 Sol Ultrafast. Trang tài liệu của nó mô tả hạng dịch vụ, đưa ra giới hạn tốc độ và lập trường về lưu trú dữ liệu, rồi trỏ tới bảng giá — nhưng bội số dành riêng cho từng mô hình duy nhất trong toàn bộ bộ tài liệu lại thuộc về Astra. Vị thế trung thực là "tối đa 8x" là phép đo của Astra, trên cùng một ngăn xếp phục vụ, và đó là con số mà đợt triển khai đang được bán dựa trên, dù chưa từng được tái lập cho Sol bởi bất kỳ ai, dù trong hay ngoài O​penAI.

Con số 14x đáng bị nghi ngờ hơn mức nó thường nhận, vì nó đã cũ như vậy. Được công bố vào giữa tháng 8 cho một hạng vẫn chưa đạt được trạng thái sẵn có chung, nó đã nằm nguyên không được chỉnh sửa suốt khoảng hai tháng trong khi bản thân hạng đó được xây dựng lại xoay quanh hai mô hình khác. Trong khoảng thời gian đó, điều hiển nhiên đáng kỳ vọng — rằng Ultrafast của 5.6 Sol sẽ thoát khỏi giai đoạn xem trước và được định giá — đã không hề xảy ra. Thay vào đó, GPT-6 Astra nhận được nó vào ngày 29 tháng 9 và GPT-6.1 Sol nhận được nó vào ngày 8 tháng 10. Một con số chỉ tồn tại trong một thông báo, gắn với một cấu hình không ai có thể mua, thì chỉ là nội dung tiếp thị cho đến khi nó xuất hiện trên bảng giá.

Đặt cạnh nhau: mỗi cái tốn bao nhiêu và ai có thể tiếp cận nó

• Mức giá tiêu chuẩn — GPT-6.1 Sol $2.00 đầu vào / $0.10 đã lưu vào bộ đệm / $2.50 ghi bộ đệm / $10.00 đầu ra mỗi 1 triệu token so với GPT-5.6 Sol $4.00 / $0.40 / $5.00 / $20.00

• Mức giá siêu nhanh — GPT-6.1 Sol $12.00 / $0.60 / $15.00 / $60.00, được công bố theo quy tắc 6x-Standard và có dòng riêng trong bảng giá Ultrafast so với GPT-5.6 Sol, không có mức giá nào được công bố

• Ngữ cảnh dài trên 272K token đầu vào — GPT-6.1 Sol được định giá lại ở mức gấp 2 lần đối với giá đầu vào và giá bộ nhớ đệm, và gấp 1,5 lần đối với đầu ra cho toàn bộ yêu cầu, tạo ra mức giá dòng ngữ cảnh dài Ultrafast là $24.00 / $1.20 / $30.00 / $90.00 so với mức tương đương Ultrafast của GPT-5.6 Sol, thứ mà chưa ai công bố

• Tính khả dụng của gói — GPT-6.1 Sol: tất cả người dùng API, tùy thuộc vào giới hạn tốc độ riêng, cùng Codex và ChatGPT Work trên gói Pro 500 USD và các gói Enterprise và Edu đủ điều kiện, so với GPT-5.6 Sol: bản xem trước giới hạn cho một số khách hàng API được chọn

• Giới hạn tốc độ khi ra mắt — GPT-6.1 Sol có hạn mức Ultrafast riêng, tách biệt với các giới hạn Standard và Fast, được đặt theo từng tổ chức và có thể tăng theo yêu cầu so với GPT-5.6 Sol, không được công bố

• Lưu trú dữ liệu — GPT-6.1 Sol hỗ trợ lưu trú tại Hoa Kỳ và EU cùng xử lý toàn cầu ở chế độ Fast và Ultrafast, so với GPT-5.6 Sol chỉ hỗ trợ lưu trú tại Hoa Kỳ và xử lý toàn cầu

• Bội số tốc độ — GPT-6.1 Sol, không có số liệu công bố so với GPT-5.6 Sol, "lên tới 14x" trong thông báo tháng 8, chưa được tái lập

• Ngữ cảnh và giới hạn đầu ra — 1,050,000 và 128,000 cho cả hai

Một điểm bất đối xứng trong danh sách đó đáng để tách ra làm rõ. GPT-6.1 Sol là cấu hình Ultrafast duy nhất có lưu trú dữ liệu tại EU: Ultrafast của Astra chỉ dành cho Hoa Kỳ, và 5.6 Sol thì hoàn toàn không mở. Nếu khối lượng công việc của bạn bị ràng buộc vào xử lý tại EU, ngày 8 tháng 10 là ngày đầu tiên mà hạng này khả dụng cho bạn dưới bất kỳ hình thức nào.

Với gói đăng ký, sự khác biệt nằm ở gói, không phải ở mô hình.

Trong cả Codex và ChatGPT Work, cả hai thế hệ đều hoạt động giống nhau về mặt cấu trúc — Ultrafast là một cài đặt tốc độ trên mô hình bạn đã có — nhưng rào chắn phía trước nó thì mới. Ultrafast khả dụng trên gói Pro $500 và trên các gói Enterprise và Edu đủ điều kiện, và mặc định nó tắt trong không gian làm việc Enterprise cho đến khi quản trị viên bật lên. Trong một gói đăng ký, mức sử dụng được bao gồm bị tiêu thụ ở mức 8x so với mức Standard, còn tín dụng đã mua hoặc hình thức trả theo mức sử dụng của Enterprise được tính phí ở mức 6x; trên API, hệ số nhân là 6x đồng nhất trên mọi dòng định giá.

Cụ thể là với GPT-5.6 Sol, chưa có điều nào trong số đó có thể tiếp cận được. Không có con đường đăng ký nào — tài liệu về tốc độ phía ChatGPT liệt kê Ultrafast là hỗ trợ GPT-6 Astra và GPT-6.1 Sol — và đường API vẫn bị chặn sau một nhóm xem trước. Dù con số 14x hứa hẹn điều gì, nó đang hứa điều đó với một tập hợp tài khoản chưa được mở rộng trong hai tháng.

A screenshot of OpenAI's API pricing page with the Ultrafast tab selected, showing exactly two rows: gpt-6-astra at $60.00 input, $6.00 cached input, $75.00 cache writes and $300.00 output per 1M tokens short-context, stepping to $120.00 / $12.00 / $150.00 / $450.00 above 272,000 input tokens, and gpt-6.1-sol at $12.00 / $0.60 / $15.00 / $60.00 short-context stepping to $24.00 / $1.20 / $30.00 / $90.00, with the page's note that short context means up to 272K input tokens.

Nên thực sự dùng cái nào, và khi nào nên chờ đợi

Nếu bạn bắt đầu ngay hôm nay, câu hỏi gần như tự trả lời: GPT-6.1 Sol Ultrafast có thể mua được, có giá niêm yết và có tài liệu, còn GPT-5.6 Sol Ultrafast thì không. Lý do để tìm đến mẫu cũ hơn hoàn toàn không nằm ở phân hạng — mà là vì GPT-5.6 Sol đã xuất hiện từ ngày 9 tháng 7 năm 2026, và nếu bạn đã xây dựng các bộ prompt, quy trình đánh giá cùng mô hình chi phí dựa trên nó, thì chi phí chuyển đổi sang một bản làm mới Sol với mốc kiến thức khác và thang suy luận hẹp hơn một cách rõ rệt là có thật, ngay cả khi giá giảm một nửa. Hãy thực hiện bước chuyển đó theo lịch trình của riêng bạn, chứ không phải vì một thiết lập tốc độ cuối cùng đã xuất hiện.

Quy tắc quyết định cho chính bậc này là quy tắc mà các con số của Astra ngụ ý và Sol xác thực: trả gấp sáu lần giá để cắt giảm độ trễ là một đánh đổi tốt khi một con người hoặc một agent đang bị chặn ở đầu ra, và là một đánh đổi tồi khi một công việc có thể đợi đến sáng. Không có gì về đợt triển khai GPT-6.1 Sol thay đổi phép tính đó; nó chỉ khiến điều này khả dụng trên một mô hình nền rẻ hơn, nơi hóa đơn tuyệt đối cho một lượt nhanh là nhỏ hơn.

Và nếu bạn muốn dùng gói Fast thay vào đó, bạn có thể chỉ cần suy luận từ bảng giá: gấp 2 lần Standard, và Fast đã là lựa chọn trung gian ổn định kể từ khi O​penAI đổi tên Priority processing vào ngày 30 tháng 7 năm 2026. Ultrafast vẫn là gói mà ở đó bạn đang mua một lời hứa chưa được định lượng, và ở phía GPT-5.6 Sol, là thứ bạn hoàn toàn không thể mua.

Gọi một trong hai cái đó từ một phím

GPT-5.6 Sol và GPT-6.1 Sol thuộc hạng tiêu chuẩn đều có trên OrcaRouter — openai/gpt-5.6-sol ở mức $4.00 cho đầu vào và $20.00 cho đầu ra mỗi triệu token, openai/gpt-6.1-sol ở mức $2.00 và $10.00 — được cung cấp với mức gia tăng 0%, với giá niêm yết của nhà cung cấp được chuyển tiếp nguyên vẹn, nên khi nhà cung cấp thay đổi giá, thay đổi đó đến hóa đơn của bạn cùng ngày nó đến bảng giá. Điều đó quan trọng hơn mức thông thường ở cặp này, vì mức $4.00 / $20.00 của GPT-5.6 Sol rõ ràng là giá khuyến mại và OpenAI tuyên bố nó có sẵn ít nhất đến ngày 21 tháng 11 năm 2026. Khi cửa sổ đó khép lại, khoảng cách giữa hai thế hệ sẽ thu hẹp, và một nền tảng chuyển tiếp nguyên giá nghĩa là bạn biết được điều đó qua số liệu sử dụng của mình thay vì qua email gia hạn.

Cùng một key và endpoint mang hơn 200 model, vì vậy việc so sánh hai thế hệ Sol trên lưu lượng của chính bạn không đòi hỏi hai tích hợp hay hai hợp đồng, và failover tự động giữ cho một đường production đứng vững nếu một nhà cung cấp suy giảm. Khi một câu trả lời duy nhất chưa đủ, DSL định tuyến kết hợp nhiều model thành một lời gọi và model fusion đặt một panel phía sau nó.

Thứ mà chúng tôi không cung cấp là Ultrafast. Trên cả hai mô hình, nó là một cờ ở tầng dịch vụ trên tài khoản O​penAI chứ không phải một mô hình có thể định tuyến riêng, nên nó vẫn nằm trong tích hợp O​penAI trực tiếp của bạn — và trên GPT-5.6 Sol thì nó thậm chí còn chưa được cung cấp rộng rãi ở đó. Chúng tôi nói thẳng như vậy vì lựa chọn còn lại là ngụ ý về một năng lực mà chúng tôi không có. Và đó không phải là câu chúng tôi muốn xuất hiện trên blog này.

A screenshot of the OrcaRouter model page for GPT-5.6 Sol, model id openai/gpt-5.6-sol, showing a 1,050,000-token context window, 128K maximum output, text and image input with text output, public benchmarks attributed to OpenAI dated 2026-07-09, input price $4.00 and output price $20.00 per 1M tokens, p50 time to first token 1.36 s, a 2.86 s figure and 85.0M tokens of traffic, with the page's code sample and EN language toggle visible in the header.

So sánh trong bài viết này1

Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày