
GPT-5.6 Sol Ultrafast: Ultrafast đã ra mắt với mức giá gấp 6 lần giá tiêu chuẩn, nhưng mô hình này vẫn chỉ là bản xem trước
- openaiMỚIOpenAI: GPT-6.1 Sol2026-09-2952Trí tuệ
- anthropicMỚIAnthropic: Claude Sonnet 5.52026-09-2856Trí tuệ
- typesafeMỚITypeSafe: Jev 1.132026-09-24$0.04 / $0.00 trên 1 triệu token · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Trí tuệ
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Trí tuệ
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Trí tuệ
- xAIGrok 4.72026-09-2146Trí tuệ
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 trên 1 triệu token · 68 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 trên 1 triệu token · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token · 362 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token · 233 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
Đã hết chờ đợi cho gói dịch vụ, nhưng chưa hết cho mô hình này. Tại DevDay ngày 29 tháng 9 năm 2026, nhà cung cấp đã biến Ultrafast thành thứ bạn có thể mua: gói ChatGPT Pro 500 mới với giá 500 USD một tháng đi kèm nó, API nay công bố bảng giá Ultrafast bằng sáu lần mức giá tiêu chuẩn — 60,00 USD đầu vào / 300,00 USD đầu ra cho mỗi triệu token trên GPT-6 Astra — và tài liệu Codex của nhà cung cấp xác nhận rằng các gói Pro hoàn toàn không có giới hạn sử dụng năm giờ, một khung thời gian chỉ áp dụng cho gói Plus. Tất cả những điều đó đều do nhà cung cấp công bố, nằm trên bài tổng kết DevDay, các trang trợ giúp và tài liệu dành cho nhà phát triển của chính nhà cung cấp. Điều chưa hề thay đổi là mô hình mà trang này đang nói tới. GPT-5.6 Sol Ultrafast, được công bố vào ngày 13 tháng 8 năm 2026 với tư cách là gói phục vụ được Cerebras tăng tốc dành cho GPT-5.6 Sol với thông lượng lên tới gấp 14 lần mức tiêu chuẩn và 750 token đầu ra mỗi giây, vẫn chỉ ở dạng truy cập xem trước — được sắp xếp thông qua đội ngũ phụ trách tài khoản của nhà cung cấp — và vẫn không có mức giá riêng nào được công bố. Gói dịch vụ đã ra mắt. Biến thể Sol thì vẫn đang chờ đợi.
Hai thay đổi về giá đã diễn ra kể từ khi chúng tôi lần đầu viết về vấn đề này, và chúng đi theo hai hướng ngược nhau. Mô hình bên dưới trở nên rẻ hơn: GPT-5.6 Sol tiêu chuẩn hiện được tính ở mức 4,00 USD cho mỗi triệu token đầu vào và 20,00 USD cho mỗi triệu token đầu ra — mức giá khuyến mãi của OpenAI, mà nhà cung cấp cho biết sẽ còn áp dụng ít nhất đến ngày 21 tháng 11 năm 2026 — chứ không phải mức 5,00 / 30,00 USD đang áp dụng vào tháng Tám. Bậc tốc độ cao hơn nằm trên nó lần đầu tiên có giá, và nó không hề rẻ: Ultrafast trên GPT-6 Astra được tính ở mức 60,00 / 300,00 USD cho mỗi triệu. Mọi số liệu trong bài viết này đã được kiểm tra lại dựa trên bảng giá công bố của OpenAI, tài liệu tham chiếu API và tài liệu về giá của Codex vào ngày 30 tháng 9 năm 2026.
Thực chất chế độ Ultrafast là gì
Ultrafast là một bậc dịch vụ, không phải một mô hình mới. OpenAI công bố nó vào ngày 13 tháng 8 năm 2026 như sản phẩm đầu tiên của quan hệ đối tác tính toán hồi tháng 1 năm 2026 với nhà sản xuất chip Cerebras — một thỏa thuận được báo cáo trị giá khoảng 10 tỷ USD trong ba năm. Trong khi suy luận GPT-5.6 Soltiêu chuẩn chạy trên các cụm GPU và dành phần lớn thời gian để di chuyển trọng số giữa bộ nhớ và đơn vị tính toán, Ultrafast nạp trọng số của mô hình vào 44 GB SRAM trên chip của các chip quy mô tấm wafer do Cerebras sản xuất; một mô hình cỡ Sol trải theo lớp trên nhiều tấm wafer, nên trọng số nằm ngay tại nơi có đơn vị tính toán. Kết quả là giới hạn thông lượng được quyết định bởi silicon thay vì băng thông bộ nhớ.
Câu chuyện phần cứng đã có bước tiến mới vào ngày 18/08/2026. Tại sự kiện Supernova, Cerebras đã trình làng CS-4, hệ thống quy mô rack thế hệ tiếp theo được xây dựng trên nền tảng Nexus — gồm ba chip Wafer-Scale Engine mỗi rack, tốc độ tạo token nhanh gấp 2 lần so với CS-3 trước đó, và theo Cerebras, hơn 1.000 token mỗi giây trên các mô hình có trên 10 nghìn tỷ tham số. Đó là những tuyên bố của Cerebras về một hệ thống đang trong giai đoạn truy cập sớm, chưa được phát hành rộng rãi. Kể từ khi trình làng, một bài đăng duy nhất trên X tuyên bố CS-4 đã phục vụ GPT-5.6 Sol với tốc độ khoảng 1.300 token mỗi giây — nhất quán về hướng với số liệu của chính Cerebras, nhưng cho đến nay chưa được ai xác nhận. Hãy coi đây là một tín hiệu ban đầu: hợp lý, chưa được kiểm chứng, và đáng để kiểm tra lại trước khi bạn lên kế hoạch công suất dựa trên nó.
Phần quan trọng đối với mã của bạn: ID mô hình, trọng số, hành vi suy luận và đầu ra đều giống hệt GPT-5.6 Sol tiêu chuẩn. OpenAI định vị Ultrafast là "nhiều công việc hữu ích hơn mỗi giây" thay vì một bậc chất lượng, và bản xem trước chạy toàn bộ flagship — tốc độ không đến từ việc thay bằng một mô hình rẻ hơn. Điều thay đổi là tốc độ tạo token.
Đừng nhầm lẫn Ultrafast với Fast mode. Fast mode là một gói riêng biệt, có thể mua trên phần cứng tiêu chuẩn: tốc độ đầu ra nhanh hơn tới khoảng 2,5× với mức phụ phí 2× mỗi token, mà không thay đổi chất lượng — nó được đổi tên từ Priority Processing vào ngày 30 tháng 7 năm 2026, và trên GPT-5.6 Sol, giá là 8,00 đô la cho đầu vào / 40,00 đô la cho đầu ra trên 1 triệu token. Ultrafast là một thứ khác — phần cứng Cerebras, nhanh hơn tới 14× trên GPT-5.6 Sol và tới 8× trên GPT-6 Astra, có giá gấp 6× mức tiêu chuẩn trên Astra và vẫn chưa có giá trên Sol. Hai cái tên này giờ nằm cạnh nhau trong cùng một trình chọn model, điều vẫn là thứ gây nhầm lẫn nhất trong bản phát hành này.
Nhanh đến mức nào — những con số quan trọng

Con số tiêu đề là 14×, và nó cần được định nghĩa. OpenAI cho biết Ultrafast tạo ra tối đa 750 token đầu ra mỗi giây so với xử lý GPT-5.6 Sol tiêu chuẩn. Đó là con số thông lượng cho token đầu ra, không phải tuyên bố chung chung "mọi thứ nhanh hơn 14×" — thời gian yêu cầu từ đầu đến cuối cũng bao gồm xử lý đầu vào và lý luận của chính mô hình, đó là lý do 14× được gắn nhãn là mức tối đa.
• Thông lượng đầu ra tối đa — lên tới 750 token đầu ra mỗi giây, theo thông báo của OpenAI (2026-08-13).
• So với xử lý tiêu chuẩn — nhanh hơn tới 14×, theo cùng thông báo; mức cải thiện thực tế thay đổi tùy theo độ dài đầu vào và loại tác vụ.
• Humanity's Last Exam, 2.500 câu hỏi — báo cáo của OpenAI/Cerebras cho thấy GPT-5.6 Sol Ultrafast hoàn thành trong 11 giờ 11 phút so với 78 giờ 27 phút của Claude Fable 5, với độ chính xác tương đương. Đây là thông tin do nhà cung cấp tự báo cáo, và phép so sánh còn trải trên các nền tảng phần cứng của hai nhà cung cấp — hãy xem đó là thông tin mang tính định hướng, không phải phán quyết cuối cùng.
• GDP-Val, từ đầu đến cuối — Cerebras báo cáo nhanh hơn tổng thể 5,6× mà không có suy giảm chất lượng nào có thể đo lường được. Cũng do nhà cung cấp báo cáo.
• So sánh chế độ Fast và Ultrafast — chế độ Fast đạt tối đa khoảng 2,5× tốc độ đầu ra với mức giá cao gấp 2 lần, bị giới hạn ở cùng ranh giới ~272K token như mức giá tiêu chuẩn. Ultrafast là bước nhảy lớn hơn: 14× trên GPT-5.6 Sol theo thông báo tháng 8, và lên tới 8× trên GPT-6 Astra trong Codex theo tài liệu hiện tại của OpenAI, với thông tin khi ra mắt cho thấy mức đó đạt tới 300 token đầu ra mỗi giây.
• {{1}}CS-4, phần cứng thế hệ tiếp theo{{/1}} — {{2}}Cerebras tuyên bố rack CS-4 cung cấp hơn 1.000 token mỗi giây cho các mô hình trên 10 nghìn tỷ tham số, gấp tới 2 lần tốc độ tạo token của CS-3{{/2}}. {{3}}Một báo cáo cộng đồng chưa được xác minh cho thấy GPT-5.6 Sol trên CS-4 đạt ~1.300 token mỗi giây{{/3}} — {{4}}cùng xu hướng, chưa được OpenAI hoặc Cerebras xác nhận{{/4}}.
Một lưu ý trước khi bạn trích dẫn con số 14×: đó là mức trần thông lượng đầu ra trên phần cứng của một nhà cung cấp, và các so sánh độc lập về đợt ra mắt tháng Tám dao động trong khoảng từ 7× đến 11× tùy vào phần nào của khối lượng công việc được đo. Kỷ luật tương tự cũng áp dụng cho tín hiệu tốc độ của CS-4 — con số ~1.300 token/s cho GPT-5.6 Sol trên CS-4 khởi đầu chỉ từ một bài đăng trên X, và cả OpenAI lẫn Cerebras đều chưa xác nhận điều đó. Hãy coi tất cả những điều này là tuyên bố của nhà cung cấp và cộng đồng, không phải kết luận đo lường chuẩn.
Ultrafast hiện có giá bao nhiêu — và vì sao điều đó vẫn không định giá Sol

Đây là tình trạng của câu hỏi về giá vào ngày 2026-09-30, được nói một cách rõ ràng. Ultrafast có một mức giá được công bố — dành cho GPT-6 Astra, và chỉ cho GPT-6 Astra. Trang giá của OpenAI hiện có một cột Ultrafast bên cạnh Standard, Batch, Flex và Fast: $60.00 đầu vào / $6.00 đầu vào được lưu cache / $75.00 ghi cache / $300.00 đầu ra mỗi triệu token trong ngữ cảnh ngắn, tăng gấp đôi lên $120.00 / $12.00 / $150.00 / $450.00 khi vượt quá khoảng 272K token. Đó là gấp sáu lần mức giá Astra tiêu chuẩn, trong khi chế độ fast chỉ gấp hai lần — và đây là con số cụ thể đầu tiên mà OpenAI đưa ra cho hạng này. Thẻ ở trên là bản chụp ngày 2026-08-18 của chính chúng tôi, và các con số đô la của nó đã bị thay thế hai lần, bởi đợt cắt giảm mức giá tiêu chuẩn và giờ đây bởi hàng Ultrafast này. Điều vẫn còn thiếu trong bảng đó là bất kỳ mức giá Ultrafast nào cho GPT-5.6 Sol: cột Ultrafast chỉ liệt kê đúng một mô hình, gpt-6-astra. Hạng này đã được định giá; mô hình này thì chưa.
Những gì bạn có thể định giá hôm nay, theo từng mẫu:
• Standard GPT-5.6 Sol — 4,00 USD đầu vào / 20,00 USD đầu ra cho mỗi 1 triệu token đối với prompt lên tới khoảng 272K token. OpenAI ghi đây là giá khuyến mại, có hiệu lực ít nhất đến hết ngày 21 tháng 11 năm 2026. Đây là mức cơ sở mà bạn có thể gọi ngay bây giờ.
• Chế độ nhanh — $8.00 / $40.00 cho ngữ cảnh ngắn trên GPT-5.6 Sol, tăng gấp đôi lên $16.00 / $60.00 sau khoảng 272K token. Gấp đôi mức giá tiêu chuẩn để có tốc độ đầu ra lên tới khoảng 2,5×, và trên Sol, đây vẫn là thứ nhanh nhất mà bạn thực sự có thể mua.
• Bộ nhớ đệm prompt — lượt đọc từ bộ nhớ đệm được tính $0.40 mỗi 1M (giảm 90% so với input mới); lượt ghi vào bộ nhớ đệm được tính $5.00 mỗi 1M.
• Gói ngữ cảnh dài — các đầu vào vượt khoảng 272K token sẽ được tính phí ở mức $8.00 / $30.00 theo xử lý tiêu chuẩn, nằm trong cửa sổ ~1.05M token của mô hình và giới hạn đầu ra tối đa 128K token.
• Batch API — $2.00 / $10.00 cho ngữ cảnh ngắn và $4.00 / $15.00 cho ngữ cảnh dài, giảm thẳng 50% với thời gian xử lý khoảng 24 giờ.
Đối với GPT-5.6 Sol, con số Astra là manh mối tốt nhất hiện có và không hơn thế. OpenAI định giá Ultrafast ở mức gấp 6× mức giá tiêu chuẩn của mô hình cơ sở; áp dụng hệ số nhân đó cho mức $4 / $20 của Sol, bạn sẽ ra $24 / $120 mỗi triệu. Đó là phép tính, không phải mức giá đã công bố — OpenAI chưa nói gì về mức giá Ultrafast của Sol, và các nhóm xem trước tháng Tám hoàn toàn không được tính phí theo mức giá bậc nào. Hãy lập kế hoạch dựa trên Sol tiêu chuẩn ở mức $4 / $20 hoặc chế độ nhanh ở mức $8 / $40 cho đến khi nhà cung cấp công bố dòng giá đó.
Cách sử dụng — có sẵn rộng rãi trên Astra, vẫn theo yêu cầu đối với Sol
Quyền truy cập đã tách thành hai vào ngày 29 tháng 9, và sự tách biệt này đi ngược lại mô hình mà trang này đề cập. Ultrafast hiện đã được cung cấp rộng rãi trên GPT-6 Astra: tài liệu API của OpenAI cho biết nó mở cho tất cả người dùng API với giới hạn tốc độ thấp — 500.000 token mỗi phút ở các bậc sử dụng 1–3, 1 triệu ở bậc 4, 5 triệu ở bậc 5 — và nó xuất hiện trong ChatGPT Work và Codex trên gói Pro 500 mới cùng các gói Enterprise và Edu đủ điều kiện, trong đó chủ sở hữu workspace phải bật nó lên, và không được hỗ trợ cho các workspace yêu cầu suy luận bên ngoài Hoa Kỳ. GPT-5.6 Sol Ultrafast thì không dịch chuyển cùng nó. Tài liệu tương tự vẫn mô tả nó là quyền truy cập xem trước thông qua đội ngũ tài khoản OpenAI, và mô tả của chính tham số trong lược đồ API vẫn ghi "hiện đang có sẵn cho gpt-5.6-sol" — một dòng giờ đây tụt lại phía sau phần còn lại của tài liệu thay vì dẫn dắt chúng. Nếu bạn muốn dùng bậc này ngay hôm nay, bạn cần nó trên Astra.
Câu hỏi về giao diện cũng đã được giải quyết. TestingCatalog đưa tin vào ngày 26-09-2026 rằng một bộ chọn tốc độ gồm Standard, Fast và Ultrafast đang nằm chưa được công bố trong Responses API Playground; ba ngày sau, OpenAI phát hành phiên bản dành cho người dùng đúng như vậy, với Ultrafast giờ là một tùy chọn trong trình chọn mô hình trong ChatGPT Work và Codex trên Pro 500. Chúng tôi đã đánh dấu thông tin nhìn thấy đó là cách diễn giải của một ấn phẩm về giao diện chưa phát hành và nói rằng OpenAI đã xác nhận không có điều nào trong số đó. Nó đúng về mặt xu hướng, và đợt triển khai mà nó chỉ tới đã đến ngay tại DevDay chứ không phải sau đó.
Các nhóm xem trước mà OpenAI công bố vào tháng 8 là lập trình, thương mại, nghiên cứu tài chính, hỗ trợ và các khối lượng công việc tương tác khác — những đội mà agent của họ thực hiện nhiều cuộc gọi mỗi yêu cầu và độ trễ phản hồi chính là nút thắt cổ chai. Jane Street, Rogo và Podium nằm trong số những đơn vị thử nghiệm sớm được nêu tên. Nếu khối lượng công việc của bạn là chat một lượt, tầng tốc độ ít quan trọng hơn nhiều so với vòng lặp agent 40 cuộc gọi. Câu trả lời thực tế giờ phụ thuộc vào việc bạn đang hỏi về mô hình nào: trên GPT-6 Astra, bạn có thể đặt service_tier: "ultrafast" ngay chiều nay, còn trên GPT-5.6 Sol thì bạn vẫn chưa thể.
Những gì bạn có thể làm hôm nay — câu trả lời thực tế

Trong khi GPT-5.6 Sol Ultrafast vẫn còn nằm sau cánh cửa bản xem trước, cả hai mô hình đầu bảng đều đã hoạt động trên OrcaRouter theo mức giá của nhà cung cấp với $0 phụ thu trên mỗi token — mã mô hình openai/gpt-5.6-sol thông qua điểm cuối tương thích OpenAI tại api.orcarouter.ai/v1, và GPT-6 Astra bên cạnh ở mức tiêu chuẩn $10.00 / $50.00, đây là mô hình mà OpenAI hiện đã đặt thêm một hạng Ultrafast lên trên và chúng tôi không định tuyến ở hạng đó. Ảnh chụp bên dưới là từ tháng 8 năm 2026 và vẫn hiển thị mức $5.00 / $30.00 lúc bấy giờ; mức giá Sol hiện tại là $4.00 / $20.00, đây là mức chúng tôi chuyển tiếp nguyên vẹn. Việc chuyển tiếp đó là lý do các thay đổi giá từ nhà cung cấp đến phía chúng tôi trong cùng ngày: $4.00 đầu vào / $20.00 đầu ra, đúng các con số OpenAI công bố, không cộng thêm phụ thu trên mỗi token. Nếu bạn đã có trình khách OpenAI, việc chuyển đổi chỉ là thay đổi URL cơ sở và mã mô hình; không gì khác. Cùng một khóa và điểm cuối mang hơn 200 mô hình, nên Sol nằm cạnh những người anh em của chính nó — GPT-5.6 Terra ở mức $2.00 / $12.00 và GPT-5.6 Luna ở mức $0.20 / $1.20 — cùng các mô hình trọng số mở mà bạn muốn so sánh, và bạn có thể định tuyến theo độ khó thay vì tích hợp lại từng mô hình.
Hai đặc điểm cụ thể của OrcaRouter đáng được nêu tên trên một trang tốc độ. BYOK: mang theo khóa OpenAI của riêng bạn và OpenAI tính phí bạn trực tiếp theo mức giá riêng của họ — OrcaRouter cộng thêm $0 cho mỗi token và giữ nguyên giới hạn tốc độ và tín dụng của nhà cung cấp. Guardrails: PII Shield và chính sách nội dung chạy trước khi tính phí, vì vậy một yêu cầu bị chặn sẽ trả về mã 400 sạch và không bao giờ bị tính phí, và Agent Firewall chấm điểm các cuộc gọi công cụ và MCP trước khi chúng thực thi. Bản thân Ultrafast được cung cấp rộng rãi trên GPT-6 Astra nhưng không theo các điều khoản có thể định tuyến và không dành cho Sol — nó là một hạng được kiểm soát truy cập, tính phí gấp 6 lần mức tiêu chuẩn và chúng tôi không phục vụ nó. Nếu OpenAI có bao giờ cung cấp nó theo điều khoản tiêu chuẩn, thì việc tích hợp nó vào cùng một endpoint chỉ là thay đổi model-id; thiết lập bạn xây dựng hôm nay vẫn giữ nguyên.
Ranh giới trung thực — khi Ultrafast không phải là câu trả lời
Năm điểm mà câu chuyện về tốc độ vẫn chưa đứng vững, giờ đây khi một nửa trong số đó đã ngã ngũ:
Có sẵn không đồng nghĩa với việc có sẵn cho bạn. Ultrafast đã mở cho tất cả người dùng API trên GPT-6 Astra, nhưng nó mở với giới hạn tốc độ thấp, nó vẫn được mô tả là kiểm soát truy cập trong schema của OpenAI, nó không hỗ trợ xử lý ở EU hay các khu vực ngoài Hoa Kỳ khác, và trong các workspace Enterprise thì nó ở trạng thái tắt cho đến khi một chủ sở hữu bật nó lên. Trên GPT-5.6 Sol thì không có gì được mở cả. Hãy kiểm tra quyền truy cập của chính bạn trước khi thiết kế kiến trúc dựa trên một trong hai.
14× là mức tối đa, không phải là sự bảo đảm. Đó là giới hạn trên về thông lượng đầu ra trên phần cứng Cerebras; độ trễ đầu-cuối vẫn bao gồm quá trình xử lý đầu vào, thời gian suy luận của mô hình và mạng lưới của chính bạn. Một câu lệnh nặng về suy luận có thể dành phần lớn thời gian thực để "suy nghĩ", khiến mức tăng tốc được quảng cáo trở nên nhỏ hơn.
Nó có giá cho một mô hình và không có giá cho mô hình kia. Mức giá Astra Ultrafast đã được công bố — gấp 6 lần mức tiêu chuẩn — và không có dòng Ultrafast nào dành cho GPT-5.6 Sol ở bất kỳ đâu. Hãy lập ngân sách dựa trên Sol tiêu chuẩn ở mức 4 USD / 20 USD hoặc chế độ nhanh ở mức 8 USD / 40 USD, và hãy coi mọi con số "chi phí GPT-5.6 Sol Ultrafast" mà bạn thấy, kể cả con số ngoại suy 24 USD / 120 USD ở trên, là kết quả tính toán số học chứ không phải bảng giá chính thức.
Các benchmark đều do nhà cung cấp báo cáo. Lần chạy HLE 11 giờ và con số GDP-Val 5,6× là số liệu của OpenAI/Cerebras từ công bố hồi tháng 8; các ước tính độc lập về mức tăng tốc nằm trong khoảng từ khoảng 7× đến 11× tùy theo thứ được đo. Thêm tín hiệu CS-4 vào danh sách đó: con số ~1.300 token/s cho GPT-5.6 Sol trên CS-4 đến từ một bài đăng X duy nhất và không có xác nhận độc lập. Các con số mới của Astra Ultrafast — 8× trong Codex, giá gấp 6 lần — cũng là của chính OpenAI.
Và đây là cái tốn tiền chứ không tốn thời gian: nó sẽ không khắc phục một điểm nghẽn mà bạn không hề có. Nếu các agent của bạn chậm vì chính cách orchestration của bạn, độ trễ của công cụ, hay những prompt nặng ở đầu vào, thì một đường ra nhanh hơn chỉ nhích được phần đuôi một chút. Quyết định khớp hạng — GPT-5.6 Sol ở mức $4 / $20 so với GPT-5.6 Terra ở mức $2 / $12 so với GPT-5.6 Luna ở mức $0.20 / $1.20 — vẫn làm hóa đơn của bạn thay đổi nhiều hơn bất kỳ hạng tốc độ nào.
Tóm lại. Ultrafast không còn là một bậc trong danh sách chờ mà bạn chỉ có thể đọc về nó. Tính đến ngày 29 tháng 9 năm 2026, OpenAI đã bán nó: được bao gồm trong gói ChatGPT Pro 500 giá $500 ở Work và Codex, mở cho mọi người dùng API trên GPT-6 Astra với giới hạn tốc độ thấp, và có giá gấp sáu lần mức tiêu chuẩn — $60 / $300 mỗi triệu token ngữ cảnh ngắn. GPT-5.6 Sol Ultrafast, bản xem trước tháng 8 mà trang này được xây dựng xoay quanh, vẫn không hề thay đổi: vẫn bị kiểm soát quyền truy cập, vẫn giới hạn ở gpt-5.6-sol trong schema API, vẫn chưa có giá, và con số ~1.300 token/giây được báo cáo cho Sol trên CS-4 của Cerebras vẫn chỉ là một bài đăng trên X chưa được xác minh. GPT-5.6 Sol tiêu chuẩn ở mức $4 / $20 là thứ bạn có thể gọi ngay hôm nay trên OrcaRouter với mức chênh lệch $0; GPT-6 Astra ở mức $10 / $50 là thứ bạn có thể gọi nếu bạn muốn mô hình đã có được dòng Ultrafast.
Ultrafast giờ đã tốn tiền thật trên GPT-6 Astra — gấp 6 lần mức tiêu chuẩn, hoặc được gộp vào gói Pro 500 giá 500 đô — trong khi GPT-5.6 Sol Ultrafast vẫn chỉ là bản xem trước. Bản GPT-5.6 Sol đầy đủ đã hoạt động trên OrcaRouter với mức giá 4 đô / 20 đô mỗi triệu token, không tính thêm phụ phí, sẵn sàng cho khóa riêng của bạn.
So sánh trong bài viết này2
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
