
Ngày phát hành, Tính năng, Giá cả & Hướng dẫn truy cập GPT-5.6
- deepseekMỚIDeepSeek: DeepSeek V4.1 Flash2026-09-10$0.15 / $0.60 trên 1 triệu token
- openaiMỚIOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- googleMỚIGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- qwenMỚIQwen: Qwen3.8 Max (0902)2026-09-0240Trí tuệ72Lập trình
- anthropicMỚIAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.24 / $0.73 trên 1 triệu token
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- grokSpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
- metaMeta: Muse Spark 1.22026-08-0540Trí tuệ72Lập trình
- qwenQwen: Qwen3.8 Max2026-08-0340Trí tuệ72Lập trình
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Trí tuệ69Lập trình
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 trên 1 triệu token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Trí tuệ78Lập trình
- googleGoogle: Gemini 3.6 Flash2026-07-2134Trí tuệ69Lập trình
GPT-5.6 Sol vừa có thêm hạng tốc độ Ultrafast — nhanh hơn tới 14 lần so với xử lý Standard, được xem trước trên API OpenAI trong tuần này — trong khi GPT-5.6 Terra và GPT-5.6 Luna tiếp tục triển khai dòng sản phẩm trên ChatGPT. Hai tháng sau khi API ra mắt, thế hệ GPT-5.6 vừa được phổ biến rộng rãi vừa vẫn đang bổ sung thêm khả năng: cùng một sản phẩm chủ lực vượt qua GPT-5.5 về suy luận giờ đây có thể được xem trước với tốc độ lên tới 750 token đầu ra mỗi giây. Cũng trong tuần này, OpenAI đã mở rộng chương trình an ninh mạng Daybreak thành Daybreak Blue cho các nhà phòng thủ và Daybreak Red, được hỗ trợ bởi mô hình GPT-5.6-Cyber mới được xây dựng trên Sol để nghiên cứu lỗ hổng được ủy quyền.
OpenAI đã ra mắt dòng mô hình GPT-5.6 vào ngày 9 tháng 7 năm 2026, và vào ngày 6 tháng 8, họ đã đưa mô hình chủ lực vào ChatGPT kèm bản cập nhật tập trung vào độ tin cậy và mở rộng quyền truy cập miễn phí. Đây không chỉ là một bản nâng cấp mô hình đơn lẻ. Đây là một dòng sản phẩm phân tầng được thiết kế để mang đến cho nhà phát triển những lựa chọn rõ ràng hơn về trí thông minh, tốc độ và chi phí — và hiện nó cũng là trải nghiệm mặc định cho người dùng ChatGPT miễn phí.
Điều hóc búa là “GPT-5.6” mang ý nghĩa khác nhau ở những nơi khác nhau.
API đã hoạt động từ ngày 9 tháng 7 với bảng giá công khai cho cả ba hạng. Việc triển khai ChatGPT theo nhiều giai đoạn: bản Sol cập nhật đã được triển khai cho người dùng Plus và Pro vào ngày 6 tháng 8, GPT-5.6 Luna trở thành lựa chọn mặc định cho các tài khoản Free và Go trong tuần này, và các cuộc trò chuyện chỉ văn bản trên các hạng đó trở nên không giới hạn trong tuần bắt đầu từ ngày 10 tháng 8. Sol đứng sau các giao diện Work và Codex của ChatGPT không bị thay đổi bởi bản cập nhật. Bản xem trước Ultrafast lại là một phần riêng biệt: một tầng tốc độ mới trong API, được công bố vào ngày 13 tháng 8, ban đầu chỉ giới hạn cho một nhóm khách hàng nhỏ.
Vậy là GPT-5.6 đã chính thức, đang được phát hành và có thể truy cập rộng rãi — và mô hình chủ lực của nó hiện là mô hình tiên phong nhanh nhất trên lý thuyết. Đối với các nhà phát triển, phần thú vị vẫn là quyết định định tuyến: Sol cho những tác vụ suy luận khó nhất, Terra cho các tác vụ sản xuất cân bằng, Luna cho khối lượng lớn — và, khi bản xem trước được mở ra, một hạng Ultrafast cho các tác vụ Sol nhạy cảm với độ trễ — với mức giá đã thay đổi cho hai trong ba hạng vào cuối tháng 7.
Hướng dẫn này giải thích GPT‑5.6 là gì, những gì đã được xác nhận chính thức, sự khác biệt giữa Sol, Terra và Luna, cách thức tính phí hoạt động ra sao, ý nghĩa của bản xem trước Ultrafast, và lý do GPT‑5.6 khiến việc định tuyến mô hình trở nên quan trọng hơn.
Trả lời nhanh
GPT-5.6 đã được phát hành chưa? Có. API đã ra mắt vào ngày 9 tháng 7 năm 2026, và quyền truy cập ChatGPT đang được triển khai dần — cập nhật Sol cho Plus/Pro kể từ ngày 6 tháng 8, Luna là mặc định cho bản miễn phí/Go trong tuần này.
Tôi có thể sử dụng GPT-5.6 trong ChatGPT không? Có. GPT-5.6 Sol hiện là mô hình mặc định mới được cập nhật trong trải nghiệm Chat Plus/Pro (với thanh trượt suy nghĩ mới), và GPT-5.6 Luna sẽ trở thành mô hình mặc định cho các tài khoản Free và Go trong tuần này.
Tôi có thể sử dụng GPT-5.6 thông qua API không? Vâng. Sol, Terra và Luna đều đã có mặt trên API công khai với bảng giá được công bố, và trên OrcaRouter với mức phụ phí 0%.
GPT-5.6 Sol Ultrafast mode là gì? Đây là một tầng tốc độ xem trước trên API, chạy GPT-5.6 Sol nhanh hơn đến 14 lần so với Standard processing, với tốc độ lên đến 750 token đầu ra mỗi giây. Ban đầu, tính năng này chỉ giới hạn cho một nhóm nhỏ khách hàng, và OpenAI vẫn chưa công bố giá cho nó.
Có danh sách chờ không? Đối với quyền truy cập cơ bản, không — API là công khai và quyền truy cập ChatGPT đang được triển khai trên tất cả các gói, vì vậy không có gì để đăng ký tham gia. Chế độ Ultrafast thì khác: đây là bản xem trước giới hạn, ban đầu chỉ mở cho một nhóm nhỏ khách hàng, có đăng ký để nhận thông báo khi dung lượng mở rộng.
Khi nào GPT-5.6 được phát hành rộng rãi? Nó đã có rồi, theo từng giai đoạn: API ra mắt ngày 9 tháng 7 năm 2026, Sol cập nhật có mặt trên Plus/Pro ChatGPT vào ngày 6 tháng 8, Luna trở thành mặc định miễn phí/Go trong tuần này, và các cuộc trò chuyện văn bản miễn phí không giới hạn sẽ đến trong tuần của ngày 10 tháng 8.
Bạn có nên chờ đợi GPT-5.6 không? Không, nếu bạn muốn sử dụng nó — nó đã hoạt động. Câu hỏi thực sự là nên định tuyến từng tác vụ đến tầng nào, và cho phép suy luận ở mức độ bao nhiêu, vì đó mới là điều quyết định chi phí cho mỗi tác vụ của bạn.
GPT-5.6 là gì?
GPT-5.6 là dòng mô hình mới nhất của OpenAI và là thế hệ kế nhiệm của GPT-5.5.
Từ khóa là gia đình.
Thay vì ra mắt một mô hình cho từng trường hợp sử dụng, OpenAI đang giới thiệu ba cấp:
- GPT-5.6 Sol là mô hình chủ lực cho những công việc khó khăn nhất: suy luận sâu, lập trình agentic, nghiên cứu, công việc tri thức chuyên nghiệp và các tác vụ phức tạp đòi hỏi nhiều công cụ.
- GPT-5.6 Terra là mô hình cân bằng cho công việc hàng ngày. Nó được thiết kế để cung cấp khả năng mạnh mẽ với chi phí thấp hơn, giúp nó phù hợp hơn cho các ứng dụng sản xuất không thể gửi mọi yêu cầu đến mô hình chủ lực.
- GPT-5.6 Luna là tầng nhanh nhất và tiết kiệm chi phí nhất. Nó dành cho các tác vụ khối lượng lớn, tự động hóa nhẹ, tóm tắt, phân loại, định tuyến và các khối lượng công việc khác mà tốc độ và chi phí quan trọng hơn độ sâu suy luận tối đa.
Điều này thay đổi câu hỏi chính mà các nhà phát triển cần đặt ra.
Câu hỏi không còn là: Tôi có nên sử dụng GPT-5.6?
Câu hỏi hay hơn là: Mô hình GPT-5.6 nào nên xử lý nhiệm vụ này?
Không phải mọi yêu cầu đều cần Sol. Một số tác vụ cần khả năng suy luận tối đa. Một số cần độ trễ thấp hơn. Một số cần mô hình đáng tin cậy với chi phí rẻ nhất. GPT-5.6 khiến sự đánh đổi đó trở nên rõ ràng.
Điều gì đã được chính thức xác nhận?

GPT-5.6 không nên được coi là một bản tổng hợp tin đồn. OpenAI đã chính thức xác nhận dòng mô hình và quyền truy cập bản xem trước.
Các điểm đã được xác nhận là:
GPT-5.6 là một dòng mô hình gồm Sol, Terra và Luna.
Nó đã được ra mắt trên API vào ngày 9 tháng 7 năm 2026, với cả ba hạng đều có mức giá công khai.
Quyền truy cập ChatGPT đang được triển khai: Sol cập nhật cho gói Plus/Pro (6 tháng 8), Luna là mặc định cho bản miễn phí/Go (tuần này), trò chuyện văn bản miễn phí không giới hạn (tuần từ 10 tháng 8).
OpenAI báo cáo rằng Sol cập nhật tạo ra ít hơn khoảng 68% lỗi thực tế so với GPT-5.5 Instant trong các đánh giá nội bộ về tài chính/y tế/pháp lý (do nhà cung cấp báo cáo; ~62% đối với Luna).
Người dùng Plus và Pro có thanh trượt suy nghĩ mới để kiểm soát mức độ suy luận mà mỗi phản hồi sử dụng.
Giá API được công khai — và Terra và Luna đã bị loại bỏ vào cuối tháng 7 năm 2026 (Sol không thay đổi).
GPT-5.6 giới thiệu cơ chế lưu vào bộ nhớ đệm prompt dễ dự đoán hơn.
- GPT-5.6 Sol bao gồm một nỗ lực suy luận tối đa mới.
GPT-5.6 giới thiệu chế độ ultra sử dụng các subagent cho các tác vụ phức tạp.
OpenAI đã giới thiệu bản xem trước chế độ {{1}}Ultrafast mode{{/1}} cho GPT-5.6 Sol trên API vào ngày 13 tháng 8 năm 2026 — nhanh hơn tới {{2}}14 lần{{/2}} so với xử lý Standard, đạt tốc độ lên tới 750 token đầu ra mỗi giây, ban đầu chỉ dành cho một nhóm khách hàng nhỏ. Các con số tốc độ này là do nhà cung cấp công bố và chưa được {{3}}kiểm chứng độc lập{{/3}}.
- OpenAI đã mở rộng Daybreak, chương trình an ninh mạng đã được kiểm định, thành hai cấp độ vào ngày 10 tháng 8 năm 2026: Daybreak Blue (GPT-5.6 Sol với các rào cản an ninh mạng đã bị gỡ bỏ, dành cho công việc phòng thủ) và Daybreak Red (GPT-5.6-Cyber, một mô hình dựa trên Sol được huấn luyện chuyên biệt cho nghiên cứu lỗ hổng được ủy quyền). Quyền truy cập bị giới hạn cho các khách hàng đã được kiểm định và các đối tác an ninh, không phải API công khai.
Những câu hỏi mở là khác nhau:
Sol được tinh chỉnh bằng ChatGPT sẽ so sánh như thế nào với Sol API trong các tác vụ thực tế?
- Nó sẽ nhanh đến mức nào trong các quy trình sản xuất thực tế? Bản xem trước Ultrafast là điểm dữ liệu thực tế đầu tiên và hiện vẫn chỉ dành cho người được mời.
- Các biện pháp bảo vệ sẽ gây thêm ma sát thường xuyên như thế nào?
- Sol, Terra và Luna sẽ so sánh như thế nào trên các tác vụ thực tế?
Bao nhiêu suy luận là đủ, và bạn định lượng thanh trượt suy nghĩ mới như thế nào?
Gói Ultrafast sẽ được định giá như thế nào, và Cerebras có thể đáp ứng nhu cầu về gói này nhanh đến mức nào?
Đó là lý do tại sao cách tiếp cận đúng đắn là chuẩn bị, không phải di cư mù quáng.
Ngày phát hành và quyền truy cập GPT-5.6

Câu trả lời đơn giản nhất: GPT-5.6 đã ra mắt trên API vào ngày 9 tháng 7 năm 2026, và quyền truy cập ChatGPT đang được triển khai theo từng giai đoạn cho đến hết tháng 8.
Quyền truy cập API hiện đã mở cho mọi nhà phát triển với bảng giá được công bố. Điều vẫn thay đổi là bề mặt: Sol được tinh chỉnh cho trải nghiệm Chat của ChatGPT không giống với mô hình API — OpenAI cho biết phiên bản hỗ trợ Work và Codex vẫn không đổi — nên hành vi có thể khác nhau giữa ứng dụng tiêu dùng và API.
Đối với người dùng ChatGPT, bức tranh tháng Sáu đã bị đảo ngược. Người dùng Plus và Pro nhận được Sol đã cập nhật với thanh trượt suy nghĩ mới trên web, thiết bị di động và máy tính để bàn, cho phép đánh đổi độ sâu phản hồi với độ trễ. Người dùng Free và Go sẽ có Luna làm mặc định trong tuần này, cùng với nút Think cho các câu hỏi khó hơn, và các cuộc trò chuyện chỉ văn bản không giới hạn sẽ ra mắt vào tuần của ngày 10 tháng 8.
Phần mới nhất của câu chuyện truy cập là bản xem trước Ultrafast. Được công bố vào ngày 13 tháng 8 năm 2026, đây là một bậc tốc độ mới trong API dành cho GPT-5.6 Sol — nhanh hơn tới 14 lần so với xử lý Standard (theo công bố của nhà cung cấp) — và nó bắt đầu với một nhóm khách hàng nhỏ thay vì ra mắt công khai. OpenAI cho biết họ đang thử nghiệm bậc này trong lập trình, thương mại, nghiên cứu tài chính, hỗ trợ khách hàng và các ứng dụng tương tác để tìm hiểu nơi tốc độ tạo ra giá trị thực trước khi mở rộng quyền truy cập. Các khách hàng khác có thể đăng ký để được thông báo khi năng lực phát triển.
Đối với các nhà phát triển, cách diễn đạt an toàn hiện nay là: {{1}}GPT-5.6 là một dòng API đã phát hành và có giá niêm yết.{{/1}} Sự không chắc chắn còn lại nằm ở hành vi — {{2}}mỗi tầng suy nghĩ bao nhiêu, mức độ dài dòng của nó ra sao, và chi phí cho mỗi tác vụ hoàn thành là bao nhiêu{{/2}} — chứ không phải ở việc bạn có thể truy cập hay không. {{3}}Tầng Ultrafast là nơi duy nhất mà quyền truy cập vẫn còn là câu hỏi.{{/3}}
Sự khác biệt đó rất quan trọng. Đừng lên kế hoạch ra mắt dựa trên ngày truy cập GPT-5.6; hãy lên kế hoạch dựa trên hành vi theo cấp độ và chi phí cho từng tác vụ. Xây dựng bộ đánh giá của bạn, đo lường nỗ lực suy luận, và giữ một lộ trình dự phòng.
Giải thích về GPT-5.6 Sol, Terra, và Luna

GPT-5.6 Sol
Sol là mẫu để thử nghiệm khi chất lượng quan trọng hơn chi phí.
Sử dụng nó cho:
- kỹ thuật phần mềm phức tạp
quy trình lập trình dựa trên tác nhân
- sử dụng công cụ trong thời gian dài
- khó gỡ lỗi
phân tích nghiên cứu
- suy luận doanh nghiệp có rủi ro cao
- phòng thủ an ninh mạng và nghiên cứu lỗ hổng
Sol là cấp bậc hàng đầu, nhưng điều đó không có nghĩa là nó nên xử lý mọi yêu cầu.
Vào ngày 6 tháng 8 năm 2026, OpenAI cũng đã tinh chỉnh Sol chạy trong trải nghiệm Chat của ChatGPT cho hội thoại hàng ngày — đáng tin cậy hơn về dữ kiện, câu trả lời trực tiếp hơn và giọng điệu nhất quán giữa Instant và Thinking. Đánh giá nội bộ của OpenAI, không phải phòng thí nghiệm độc lập, cho thấy lỗi dữ kiện thấp hơn khoảng 68% so với GPT-5.5 Instant trên các lời nhắc về tài chính, y tế và pháp lý. Việc tinh chỉnh ChatGPT tách biệt khỏi mô hình API; Sol đứng sau Work và Codex không thay đổi.
Sol cũng là tầng được dùng thử bản xem trước Ultrafast. Vào ngày 13 tháng 8 năm 2026, OpenAI đã giới thiệu chế độ Ultrafast cho Sol trên API, chạy cùng mô hình nhanh hơn tới 14 lần so với xử lý Standard (theo công bố của nhà cung cấp), nhắm đến các tác vụ nhạy cảm về độ trễ. Tính năng này chưa được phổ biến rộng rãi — bản xem trước bắt đầu với một nhóm khách hàng nhỏ — nhưng đây là dấu hiệu đầu tiên cho thấy chất lượng của Sol không nhất thiết phải đi kèm với độ trễ của tầng Standard.
Sol cũng là mô hình đứng sau chương trình Daybreak của OpenAI: Daybreak Blue cung cấp GPT-5.6 Sol với các biện pháp bảo vệ an ninh mạng đã được gỡ bỏ cho các nhà bảo vệ đã được thẩm định, và GPT-5.6-Cyber được huấn luyện chuyên dụng trên Sol để nghiên cứu lỗ hổng được ủy quyền. Cả hai tầng đều có quyền truy cập hạn chế và nằm ngoài API công khai.
GPT-5.6 Terra
Terra là lựa chọn cân bằng.
Sử dụng nó cho:
trợ lý AI hàng ngày
- viết và phân tích kinh doanh
- công cụ kiến thức nội bộ
quy trình hỗ trợ khách hàng
- trợ giúp mã hóa không cần suy luận tối đa
- xử lý tài liệu
- tự động hóa có độ phức tạp trung bình
Terra có thể trở thành mức GPT-5.6 thực dụng nhất cho nhiều ứng dụng sản xuất vì nó cân bằng giữa khả năng và giá cả.
GPT-5.6 Luna
Luna là tầng nhanh và giá cả phải chăng.
Sử dụng nó cho:
- yêu cầu khối lượng lớn
- phân loại
- định tuyến
- tóm tắt
- các phép biến đổi đơn giản
các bước agent nhẹ
- phản hồi dự phòng
- tạo bản nháp
Luna hữu ích khi nhiệm vụ đủ đơn giản đến mức việc trả tiền cho Sol sẽ là lãng phí.
Luna hiện cũng là mặc định cho người dùng phổ thông: OpenAI đã đưa GPT-5.6 Luna trở thành mô hình đứng sau các tài khoản ChatGPT Free và Go trong tuần từ ngày 3 tháng 8 năm 2026, thay thế GPT-5.5 Instant. Một nút Think mới cho phép những người dùng đó yêu cầu suy luận ở mức cao hơn, và các cuộc trò chuyện chỉ văn bản sẽ không còn giới hạn trong tuần từ ngày 10 tháng 8.
Định giá và bộ nhớ đệm của GPT-5.6
Giá của GPT-5.6 đã được công khai.
GPT-5.6 Sol
5 đô la mỗi 1 triệu token
- Đầu ra: $30 trên 1M token
- Tốt nhất cho lý luận hàng đầu, lập trình phức tạp và công việc tác nhân sâu
GPT-5.6 Terra
$2 cho mỗi 1 triệu token (giảm từ $2.50 vào cuối tháng 7 năm 2026)
- Đầu ra: $12 mỗi 1M token (giảm từ $15)
- Tốt nhất cho công việc hàng ngày cân bằng.
GPT-5.6 Luna
0,20 đô la mỗi 1 triệu token (giảm từ 1 đô la)
- Đầu ra: $1.20 trên 1M token (giảm từ $6)
- Tốt nhất cho khối lượng công việc nhanh, giá cả phải chăng, khối lượng lớn
OpenAI đã cắt giảm 20% cho Terra và 80% cho Luna vào cuối tháng 7/2026, với lý do đạt được hiệu suất suy luận tốt hơn; Sol vẫn giữ ở mức $5/$30. Vì OrcaRouter truyền thẳng giá nhà cung cấp với mức chênh lệch 0%, những mức giảm này sẽ xuất hiện trên các trang mô hình của chúng tôi ngay trong ngày chúng được áp dụng.
Bản xem trước Ultrafast chưa có giá công bố. Đây là bản xem trước giới hạn cho một nhóm nhỏ khách hàng, và OpenAI chưa nói rõ mức này sẽ được tính phí như thế nào — vì vậy đừng cho rằng mức giá $5/$30 Sol áp dụng cho nó. Điều đó đáng để theo dõi cùng với các số liệu về tốc độ: nếu một mức tốc độ cao cấp được định giá ở mức cao cấp, thì phép tính chi phí trên mỗi token cho các khối lượng công việc nhạy cảm với độ trễ sẽ thay đổi.
Mức giá cho thấy một điều rõ ràng: GPT-5.6 không được thiết kế để dùng làm mô hình mặc định duy nhất cho mọi tác vụ.
Một chiến lược định tuyến hợp lý có thể trông như thế này:
- sử dụng Luna cho các tác vụ đơn giản, khối lượng lớn;
- sử dụng Terra cho các công việc suy luận hàng ngày và quy trình làm việc kinh doanh;
- sử dụng Sol cho các nhiệm vụ coding, nghiên cứu hoặc tác vụ đại lý khó nhất;
- cache ngữ cảnh lặp lại một cách tích cực;
- tránh gửi mọi yêu cầu đến Sol theo mặc định.
GPT-5.6 cũng bổ sung tính năng prompt caching dễ dự đoán hơn, bao gồm các điểm ngắt bộ đệm (cache breakpoints) rõ ràng và thời gian tồn tại tối thiểu của bộ đệm là 30 phút. Với các quy trình chạy lâu dài, tác nhân lập trình và trợ lý doanh nghiệp, điều này thực sự tạo ra khác biệt lớn.
Bài học thực tế: Đo lường chi phí trên mỗi tác vụ hoàn thành, không chỉ chi phí trên mỗi token.
Một mô hình đắt tiền hơn có thể rẻ hơn nếu nó hoàn thành công việc với ít lần thử hơn. Một mô hình rẻ hơn có thể tốt hơn khi nhiệm vụ đơn giản và khối lượng lớn.
Có gì mới trong GPT-5.6?
GPT-5.6 không nên được mô tả chủ yếu qua các con số về độ dài cửa sổ ngữ cảnh được đồn đoán hoặc các bản ghi nội bộ bị rò rỉ.
Những thay đổi quan trọng là những thay đổi mà OpenAI đã xác nhận.
Một họ mô hình ba tầng
Sol, Terra và Luna giúp việc lựa chọn mô hình trở nên có cấu trúc hơn. Các nhà phát triển có thể định tuyến các tác vụ dựa trên độ khó, độ trễ và chi phí thay vì gửi mọi thứ đến một mô hình chủ lực.
Các quy trình làm việc về tác nhân và lập trình mạnh mẽ hơn
GPT-5.6 Sol được định vị xoay quanh mã hóa tác nhân, quy trình làm việc dòng lệnh, lập kế hoạch, lặp lại và phối hợp công cụ.
Điều đó quan trọng vì các tác nhân lập trình hiện đại không chỉ viết các đoạn mã. Chúng kiểm tra kho lưu trữ, chạy các lệnh, hiểu các lỗi kiểm thử, vá tệp, xác minh thay đổi và lặp lại cho đến khi nhiệm vụ hoàn thành.
Nỗ lực suy luận tối đa mới
Sol giới thiệu một nỗ lực suy luận tối đa mới cho các tác vụ khó hơn.
Điều này không nên được sử dụng ở mọi nơi. Suy luận cao hơn có thể làm tăng chi phí và độ trễ, vì vậy nó nên được dành riêng cho các công việc mà việc lập kế hoạch sâu hơn là đáng giá: gỡ lỗi phức tạp, di chuyển hệ thống, tổng hợp nghiên cứu, đánh giá bảo mật hoặc phân tích dữ liệu khó.
Ultra mode với subagents
GPT-5.6 giới thiệu chế độ ultra sử dụng các subagent cho các tác vụ phức tạp.
Điều này hướng tới một tương lai nơi các mô hình không chỉ trả lời các lời nhắc. Chúng phối hợp công việc qua nhiều bước hoặc các tác nhân chuyên biệt.
Chế độ siêu nhanh: GPT-5.6 Sol với tốc độ lên tới 14X
Vào ngày 13 tháng 8 năm 2026, OpenAI đã trình làng Ultrafast, một cấp dịch vụ mới trong API chạy GPT-5.6 Sol nhanh hơn tối đa 14 lần so với xử lý Standard, tạo ra tối đa 750 token đầu ra mỗi giây. OpenAI cho biết cấp dịch vụ này sở hữu trí thông minh tương đương với GPT-5.6 Sol Standard — tốc độ nhanh hơn nằm ở độ trễ, chứ không phải do mô hình nhỏ hơn hay yếu hơn. Những con số tốc độ này do nhà cung cấp công bố: OpenAI công bố chúng cùng với đối tác suy luận Cerebras, và chưa có phòng thí nghiệm độc lập nào tái lập được.
Tốc độ đến từ một ngăn xếp suy luận khác, không phải từ một mô hình khác. Ultrafast chạy trên kiến trúc Wafer-Scale Engine của Cerebras, giúp giữ trọng số mô hình ngay trên chip (44 GB SRAM trên mỗi chip kích thước wafer) và loại bỏ nút thắt băng thông bộ nhớ vốn giới hạn khả năng suy luận dựa trên GPU. Với phân khúc này, OpenAI đang sử dụng phần cứng của Cerebras thay vì phần cứng của chính mình.
Ultrafast ban đầu chỉ là bản xem trước giới hạn. Một nhóm nhỏ khách hàng được truy cập trước, và OpenAI cho biết họ đang thử nghiệm cấp độ này trong lĩnh vực lập trình, thương mại, nghiên cứu tài chính, hỗ trợ khách hàng và các ứng dụng tương tác để tìm hiểu nơi tốc độ tạo ra giá trị. Các khách hàng khác có thể đăng ký để được thông báo khi dung lượng được mở rộng. Vẫn chưa có giá công bố cũng như ngày phát hành chính thức.
OpenAI và Cerebras cũng công bố các con số so sánh, tất cả đều do nhà cung cấp báo cáo và dựa trên dữ liệu tốc độ đầu ra của Artificial Analysis: Ultrafast được cho là nhanh hơn 5 lần so với Claude Opus 4.8 ở chế độ Fast và nhanh hơn 11 lần so với Claude Fable 5; trên bộ 2.500 câu hỏi của Humanity’s Last Exam, nó được cho là hoàn thành trong chỉ hơn 11 giờ thay vì hơn ba ngày đối với Claude Fable 5, ở độ chính xác tương đương; và trên GDP-Val (bản ghi pháp lý, mô hình tài chính, báo cáo kỹ thuật), nó tuyên bố tăng tốc đầu cuối 5,6 lần mà không giảm chất lượng. Hãy coi đó là tuyên bố của OpenAI và Cerebras cho đến khi các lần chạy độc lập xác nhận chúng.
Cấp độ này cũng đặt ra hai câu hỏi mở. Thứ nhất, năng lực: nguồn cung wafer-scale của Cerebras là điểm hạn chế, và việc bản xem trước có tiếp tục chỉ dành cho khách mời sau cuối năm 2026 hay không sẽ cho thấy phần cứng có theo kịp nhu cầu hay không. Thứ hai, cấu trúc giá: một cấp độ tốc độ cao cấp có thể phân khúc giá API theo những cách quan trọng đối với các nhóm nhạy cảm về chi phí.
Biện pháp bảo vệ mạnh mẽ hơn
GPT-5.6 cũng đi kèm với các biện pháp bảo vệ mạnh mẽ hơn, đặc biệt là xung quanh các quy trình an ninh mạng và sinh học. Một số yêu cầu có thể mất nhiều thời gian hơn hoặc không trả về nội dung trong khi các kiểm tra an toàn bổ sung được chạy.
Đối với các nhóm phòng thủ hoặc nghiên cứu hợp pháp, điều này không khiến GPT-5.6 trở nên vô dụng. Nhưng điều đó có nghĩa là các quy trình làm việc trong lĩnh vực nhạy cảm cần được kiểm thử cẩn thận trước khi chuyển sang môi trường sản xuất.
Daybreak Xanh dương và Đỏ: GPT-5.6 với các biện pháp bảo vệ được nới lỏng cho các nhóm đã được xét duyệt
Mặt trái của các biện pháp bảo vệ mạnh mẽ hơn là OpenAI hiện cũng cung cấp quyền truy cập với ít rào cản an toàn hơn cho cùng một họ mô hình. Vào ngày 10 tháng 8 năm 2026, họ đã mở rộng Daybreak — chương trình an ninh mạng đã được kiểm định — thành hai cấp độ. Daybreak Blue cung cấp cho các nhà phòng thủ được phê duyệt GPT-5.6 Sol với các rào cản an ninh mạng cấp hệ thống đã được gỡ bỏ, phục vụ cho việc phát hiện lỗ hổng, đánh giá mã nguồn an toàn, phân tích phần mềm độc hại, kỹ thuật phát hiện, ứng phó sự cố và xác nhận bản vá. OpenAI mô tả đây là điểm khởi đầu được khuyến nghị cho hầu hết các nhà phòng thủ.
{{1}}Daybreak Red tiến xa hơn nữa.{{/1}} Nó cung cấp quyền truy cập vào GPT-5.6-Cyber, một mô hình được huấn luyện chuyên biệt dựa trên GPT-5.6 Sol nhằm phát hiện lỗ hổng zero-day và phát triển chuỗi khai thác. Quyền truy cập bị hạn chế và giám sát chặt chẽ — xác minh danh tính, hạn chế về mục đích sử dụng được phê duyệt và cam kết pháp lý — và OpenAI cho biết các tài khoản Daybreak cá nhân phải sử dụng khóa bảo mật phần cứng từ ngày 1 tháng 9 năm 2026.
Các số liệu về năng lực do nhà cung cấp báo cáo. Trong Tỷ lệ Hoàn thành An ninh mạng Nâng cao nội bộ của OpenAI, GPT-5.6-Cyber đã hoàn thành 95% các tác vụ nhạy cảm được giao, so với 57,3% của phiên bản tiền nhiệm GPT-5.5-Cyber — trong khi Sol thông qua Daybreak Blue hoàn thành 2,0% (1,5% với các biện pháp bảo vệ tiêu chuẩn). OpenAI mô tả sự thay đổi này như một sự chuyển dịch tỷ lệ từ chối hơn là một bước nhảy về trí thông minh: mô hình cơ bản trả lời thay vì từ chối. OpenAI cũng cho biết mô hình đã giúp phát hiện hai lỗ hổng chưa từng được biết đến trước đây trong công cụ V8 của Chrome, đã được tiết lộ cho Google và khắc phục dưới mã CVE-2026-15903.
Daybreak không phải là sản phẩm API công khai. Quyền truy cập được thực hiện thông qua chương trình của OpenAI và mạng lưới đối tác gồm các nhà cung cấp bảo mật, vì vậy hầu hết các nhóm sẽ gặp nó một cách gián tiếp — qua các công cụ phòng thủ tốt hơn, và qua tín hiệu rằng OpenAI hiện phát hành một mô hình có nhiệm vụ tấn công hệ thống thay mặt cho các nhà phòng thủ.
Sol trong ChatGPT: một bản tinh chỉnh độ tin cậy và một thanh trượt suy nghĩ
Thông báo ngày 6 tháng 8 năm 2026 nói về trải nghiệm người dùng. OpenAI đã tinh chỉnh Sol trong trải nghiệm Chat của ChatGPT để đáng tin cậy hơn về mặt sự kiện — ngày tháng, con số, nguồn, quy tắc và giả định — và trực tiếp hơn trong các câu trả lời hàng ngày, đồng thời đưa trải nghiệm Instant và Thinking đến gần nhau hơn. Những con số đằng sau "đáng tin cậy hơn" là đánh giá nội bộ của riêng OpenAI, không phải từ một phòng thí nghiệm độc lập: trong các câu hỏi về tài chính, y tế và pháp lý, các phản hồi có lỗi thực tế ít hơn khoảng 68% với Sol (và ít hơn 62% với Luna) so với GPT-5.5 Instant.
Người dùng Plus và Pro cũng có được một thanh trượt suy nghĩ mới trên web, di động và máy tính để bàn, chọn mức độ suy luận mà mỗi phản hồi sử dụng — từ câu trả lời nhanh cho các câu hỏi hàng ngày đến lập kế hoạch sâu hơn, nghiên cứu, viết lách, viết mã hoặc ra quyết định. OpenAI cho biết phiên bản Sol đằng sau Work và Codex không thay đổi; việc điều chỉnh áp dụng cho trải nghiệm Chat.
Free và Go: Luna mặc định, trò chuyện văn bản không giới hạn
OpenAI đã đưa GPT-5.6 Luna trở thành mô hình mặc định cho các tài khoản ChatGPT Free và Go trong tuần này, thay thế GPT-5.5 Instant. Bắt đầu từ tuần ngày 10 tháng 8, các cuộc trò chuyện chỉ văn bản trên các gói này là không giới hạn — không giới hạn tốc độ, tuân theo các rào chắn chống lạm dụng — trong khi vẫn áp dụng giới hạn đối với việc tải tệp, hình ảnh, tạo hình ảnh và giọng nói. Một nút Think mới cho phép người dùng Free và Go yêu cầu Luna suy luận kỹ hơn, cũng không giới hạn đối với các cuộc trò chuyện chỉ văn bản. OpenAI cũng bổ sung đào tạo an toàn cho người dùng dưới 18 tuổi, bao gồm các ranh giới xung quanh nhập vai lãng mạn và nội dung hạn chế độ tuổi.
GPT-5.6 so với GPT-5.5
So với GPT-5.5, GPT-5.6 quan trọng nhất ở sáu lĩnh vực:
- Lựa chọn mô hình: GPT-5.6 giới thiệu Sol, Terra và Luna thay vì một mô hình mặc định duy nhất.
- Công việc tác nhân: Sol được định vị mạnh mẽ hơn cho các tác nhân lập trình và quy trình làm việc nặng về công cụ.
- Kiểm soát suy luận: nỗ lực suy luận tối đa và chế độ cực đoan mang lại cho nhà phát triển nhiều tùy chọn hơn cho các tác vụ khó.
- Tính linh hoạt về chi phí: Terra và Luna giúp dễ dàng tránh việc sử dụng quá mức mẫu flagship.
- Tùy chọn tốc độ: GPT-5.6 Sol ra mắt bản xem trước mức Ultrafast với tốc độ lên tới 14 lần tốc độ Standard; GPT-5.5 được phát hành với một mức tốc độ duy nhất.
- Chiến lược triển khai: GPT‑5.6 ra mắt theo từng giai đoạn — API trước, sau đó đến ChatGPT — vì vậy các nhóm vẫn cần phương án dự phòng khi hành vi và giá cả thay đổi.
Điểm mấu chốt rất đơn giản: GPT-5.6 không chỉ là một mô hình tốt hơn. Đó là lý do để ngừng mã hóa cứng một mô hình vào ứng dụng của bạn.
Cách chuẩn bị cho GPT-5.6
Bạn có thể chuẩn bị với quyền truy cập bạn đã có: Luna là mặc định miễn phí của ChatGPT, Sol nằm trong trải nghiệm Plus/Pro, và API được công khai. Việc chuẩn bị nằm ở khâu định tuyến và đo lường, không phải chờ đợi.
Đầu tiên, hãy xây dựng một bộ đánh giá thực tế. Đừng chỉ kiểm thử GPT-5.6 bằng các lời nhắc đơn giản. Hãy sử dụng các vấn đề thực tế trong mã nguồn, phiếu hỗ trợ, tài liệu khách hàng, tác vụ nghiên cứu và các sự cố tự động hóa.
{{1}}Thứ hai, thiết kế cho việc định tuyến mô hình.{{/1}} {{2}}Luna có thể xử lý các bản tóm tắt đơn giản và phân loại.{{/2}} {{3}}Terra có thể xử lý các quy trình làm việc hướng tới người dùng hàng ngày.{{/3}} {{4}}Sol nên được dành riêng cho suy luận phức tạp, lập trình và nghiên cứu.{{/4}} {{5}}Nếu độ trễ là một yêu cầu trong lộ trình của bạn, hãy coi bản xem trước Ultrafast như một lý do để thiết kế lớp định tuyến nhạy cảm với tốc độ ngay bây giờ thay vì mã hóa cứng một tầng — tầng thắng về độ trễ hôm nay có thể vẫn đang trong giai đoạn xem trước, nhưng quyết định định tuyến mà nó ngụ ý đã rõ ràng.{{/5}}
Thứ ba, theo dõi chi phí cho mỗi tác vụ hoàn thành. Đối với các quy trình tác nhân, một yêu cầu của người dùng có thể kích hoạt nhiều lần gọi mô hình. Giá token rẻ nhất không phải lúc nào cũng là quy trình hoàn thành rẻ nhất.
Thứ tư, chuẩn bị cho việc lưu vào bộ nhớ đệm. Nếu ứng dụng của bạn liên tục gửi cùng một kho lưu trữ, tài liệu chính sách hoặc cơ sở tri thức, hãy cấu trúc các lời nhắc sao cho ngữ cảnh ổn định có thể được tái sử dụng.
Cuối cùng, hãy giữ một phương án dự phòng. Các mô hình suy luận thường dài dòng và giá cả luôn biến động — Terra và Luna đều đã giảm vào cuối tháng Bảy. Các hệ thống production nên có khả năng dự phòng bằng cách chuyển sang một tier GPT-5.6 khác, sang GPT-5.5, hoặc sang một nhà cung cấp khác khi độ trễ, chi phí hoặc hành vi thay đổi.
OrcaRouter phù hợp ở đâu

GPT-5.6 làm cho việc định tuyến mô hình trở nên quan trọng hơn.
OpenAI không còn giới thiệu thế hệ mới như một mô hình đơn lẻ. GPT‑5.6 ra mắt như một gia đình: Sol dành cho các tác vụ suy luận và tác nhân khó nhất, Terra dành cho khối lượng công việc hàng ngày cân bằng, và Luna dành cho các tác vụ nhanh, chi phí thấp.
Điều đó tạo ra một câu hỏi thực tế cho các nhà phát triển: Mô hình nào nên xử lý mỗi yêu cầu?
Không phải mọi tác vụ đều cần Sol. Một bản tóm tắt đơn giản có thể phù hợp hơn với Luna. Một quy trình kinh doanh thông thường có thể phù hợp với Terra. Một tác vụ agent mã hóa khó có thể cần đến Sol.
Và ngay cả khi truy cập mở, các ứng dụng production vẫn cần các phương án dự phòng khi độ trễ, giới hạn tốc độ hoặc chi phí theo tác vụ thay đổi — đợt giảm giá cuối tháng Bảy là lời nhắc rằng bảng giá là một mục tiêu luôn biến động, và bản xem trước Ultrafast là lời nhắc rằng các tùy chọn phục vụ cũng đang thay đổi theo.
Đây là nơi OrcaRouter phù hợp.
OrcaRouter cung cấp cho nhà phát triển một endpoint tương thích OpenAI để định tuyến qua nhiều mô hình, với định tuyến thông minh, tự động chuyển đổi dự phòng, khả năng quan sát và không tính thêm phí token. Thay vì phải xây dựng lại tích hợp của bạn mỗi khi có mô hình mới ra mắt, bạn có thể giữ một mẫu API duy nhất và định tuyến tác vụ dựa trên chất lượng, chi phí, độ trễ và tính khả dụng.
Đối với GPT-5.6, điều đó có nghĩa là bạn có thể xây dựng tầng mô hình ngay bây giờ thay vì chờ quyền truy cập ổn định.
{{1}}Cả ba gói tiêu chuẩn đều có trên OrcaRouter hôm nay: GPT-5.6 Sol ở mức $5/$30, GPT-5.6 Terra ở mức $2/$12 và GPT-5.6 Luna ở mức $0.20/$1.20{{/1}} — {{2}}được chuyển thẳng với mức chênh lệch 0%, nên các đợt giảm giá cuối tháng 7 đã có hiệu lực tại đây ngay ngày chúng được phát hành{{/2}}. {{3}}Gói Ultrafast chưa được phổ biến rộng rãi nên không nằm trong danh sách đó{{/3}} — {{4}}khi mở, nó sẽ trở thành một tầng phục vụ nữa để định tuyến, và chính endpoint đó là nơi thực hiện lựa chọn{{/4}}. {{5}}Daybreak Blue và Daybreak Red là một chương trình truy cập hạn chế riêng biệt chứ không phải các gói API công khai, nên chúng cũng không thể định tuyến qua OrcaRouter{{/5}} — các gói tiêu chuẩn chính là nơi đưa ra quyết định định tuyến.
Câu chuyện truy cập GPT-5.6 vẫn đang dần ổn định, nhưng chiến lược định tuyến của bạn không cần phải chờ đợi.
Sử dụng GPT-5.6 thông qua OrcaRouter

GPT-5.6 chính xác là loại gia đình mà các nhà phát triển muốn định tuyến qua.
Nhưng việc triển khai đã tạo ra một vấn đề thực tế: quyền truy cập được mở rộng theo giai đoạn, giá của hai gói đã thay đổi vào cuối tháng 7, bản tinh chỉnh ChatGPT khác với mô hình API, và hiện một gói tốc độ đang được xem trước. Các nhóm cần một lớp trung gian để hấp thụ những thay đổi đó.
OrcaRouter cung cấp cả ba cấp độ GPT-5.6 thông qua một endpoint tương thích OpenAI, cùng với hơn 200 mô hình khác — để bạn có thể thử nghiệm Sol, Terra và Luna so với GPT-5.5, Claude, Gemini và các mô hình còn lại ngay tại một nơi, mà không cần tích hợp lại.
Điều này hữu ích nếu bạn muốn:
- định tuyến mỗi yêu cầu đến bậc rẻ nhất có thể xử lý nó;
thử nghiệm Sol, Terra và Luna song song với stack hiện tại của bạn;
- định tuyến các tác vụ đơn giản đến các mô hình rẻ hơn;
- dành các mẫu flagship cho công việc khó hơn;
so sánh GPT-5.6 với production stack hiện tại của bạn;
- giữ các mô hình dự phòng sẵn sàng khi hành vi hoặc giá thay đổi.
GPT-5.6 hiện đã hoạt động trên OrcaRouter — Sol, Terra và Luna — với mức chênh lệch 0%, kèm chuyển đổi dự phòng tự động để một tầng dịch vụ mới ra mắt hoặc được định giá lại không bao giờ làm sập một đường dẫn sản xuất.
Gọi bất kỳ mức GPT-5.6 nào qua một API trên OrcaRouter và định tuyến qua phần còn lại của danh mục bằng cùng một khóa.
Phán quyết cuối cùng
GPT-5.6 là có thật, chính thức và quan trọng.
Nhưng nó không còn là bản xem trước mà bạn phải chờ đợi: API đã hoạt động từ ngày 9 tháng 7 và quyền truy cập ChatGPT đang được triển khai cho mọi gói trong tháng này.
Sự thay đổi lớn nhất không chỉ là trí tuệ tốt hơn. Đó là sự chuyển từ một mô hình mặc định sang một nhóm mô hình định tuyến: Sol, Terra và Luna.
Đối với các nhà phát triển, cơ hội không chỉ đơn thuần là nâng cấp lên GPT-5.6. Cơ hội là xây dựng một lớp mô hình thông minh hơn:
- Luna dành cho các tác vụ nhanh và rẻ;
- Terra dành cho khối lượng công việc sản xuất cân bằng;
- Sol cho các tác vụ suy luận và lập trình khó nhất;
- bộ nhớ đệm cho ngữ cảnh lặp lại;
- các mô hình dự phòng để đảm bảo độ tin cậy.
Nếu bạn đang ra mắt hôm nay, bạn không còn phải chờ đợi: Luna là lựa chọn mặc định miễn phí của ChatGPT, Sol nằm trong trải nghiệm Plus/Pro, và API đã được công khai.
Nếu bạn đang xây dựng agent mã hóa, copilot doanh nghiệp hay các quy trình AI chạy dài, việc chuẩn bị ngay bây giờ có nghĩa là định tuyến, kiểm soát mức suy luận và chi phí cho từng tác vụ — chứ không phải quyền truy cập. Và bản xem trước Ultrafast nhắc chúng ta rằng dòng sản phẩm này vẫn đang tiến hóa: mẫu flagship bạn đo chuẩn hôm nay có thể sẽ có một phiên bản nhanh hơn — hoặc, với Daybreak, một biến thể an ninh mạng được huấn luyện chuyên dụng — khi bạn kịp phát hành.
Câu hỏi thường gặp
GPT-5.6 đã được phát hành chưa?
Vâng. API đã ra mắt vào ngày 9 tháng 7 năm 2026 và quyền truy cập ChatGPT đang được triển khai — Sol đã được cập nhật cho Plus/Pro kể từ ngày 6 tháng 8, Luna là lựa chọn mặc định cho Free/Go trong tuần này.
Tôi có thể sử dụng GPT-5.6 trong ChatGPT không?
Vâng. GPT-5.6 Sol đã có mặt trong trải nghiệm Chat Plus/Pro với thanh trượt suy nghĩ mới, và GPT-5.6 Luna sẽ trở thành mặc định cho các tài khoản Free và Go trong tuần này, với các cuộc trò chuyện chỉ văn bản không giới hạn bắt đầu từ tuần ngày 10 tháng 8.
Tôi có thể sử dụng GPT-5.6 thông qua API không?
Vâng. Cả ba gói đều có trên API công khai với giá công bố — Sol $5/$30, Terra $2/$12, Luna $0.20/$1.20 — và thông qua OrcaRouter với mức chênh lệch 0%.
GPT-5.6 Sol Ultrafast mode là gì?
Đây là một bậc tốc độ được xem trước trong API OpenAI chạy GPT-5.6 Sol nhanh hơn tới 14 lần so với xử lý Standard, với tốc độ lên tới 750 token đầu ra mỗi giây, có cùng mức độ thông minh như mô hình tiêu chuẩn (theo công bố của nhà cung cấp). Ban đầu, nó chỉ giới hạn cho một nhóm nhỏ khách hàng, và OpenAI chưa công bố mức giá cho nó.
Có danh sách chờ công khai cho GPT-5.6 không?
Đối với các gói cơ bản, không — API được công khai và quyền truy cập ChatGPT đang được triển khai trên tất cả các gói, vì vậy không có gì để đăng ký tham gia. Bản xem trước Ultrafast là ngoại lệ: ban đầu nó chỉ giới hạn cho một nhóm nhỏ khách hàng, có đăng ký nhận thông báo khi dung lượng được mở rộng.
Khi nào GPT-5.6 sẽ được phát hành rộng rãi?
Nó đã như vậy rồi, theo từng giai đoạn. API đã đi vào hoạt động từ ngày 9 tháng 7 năm 2026; bản Sol cập nhật đã có mặt trên ChatGPT Plus/Pro vào ngày 6 tháng 8; Luna trở thành mặc định của Free/Go trong tuần này; các cuộc trò chuyện văn bản miễn phí không giới hạn sẽ có mặt trong tuần bắt đầu từ ngày 10 tháng 8.
GPT-5.6 Sol, Terra, và Luna là gì?
Sol là mẫu đầu bảng, Terra là mẫu cân bằng cho công việc hàng ngày, và Luna là mẫu nhanh và giá cả phải chăng.
GPT-5.6 có giá bao nhiêu?
GPT-5.6 Sol có giá 5 đô la cho mỗi 1 triệu token đầu vào và 30 đô la cho mỗi 1 triệu token đầu ra. GPT-5.6 Terra có giá 2 đô la cho mỗi 1 triệu token đầu vào và 12 đô la cho mỗi 1 triệu token đầu ra. GPT-5.6 Luna có giá 0,20 đô la cho mỗi 1 triệu token đầu vào và 1,20 đô la cho mỗi 1 triệu token đầu ra. Terra và Luna đã được giảm giá vào cuối tháng 7 năm 2026; Sol không thay đổi. Trên OrcaRouter, các mức giá này được chuyển qua với mức tăng giá 0%. Bản xem trước Ultrafast chưa có giá công bố.
Tôi có nên chuyển từ GPT-5.5 sang GPT-5.6 không?
Không phải một cách mù quáng. Hãy giữ một phương án dự phòng ổn định, nhưng cách tính toán đã thay đổi: giá của Luna khiến nó trở thành lựa chọn mặc định cho công việc xử lý văn bản khối lượng lớn, và việc tinh chỉnh ChatGPT đáng để thử nghiệm cho các trợ lý hàng ngày. Hãy tự benchmark trên các tác vụ của riêng bạn và định tuyến theo từng tầng.
Tôi có thể truy cập GPT-5.6 thông qua OrcaRouter không?
Vâng. GPT-5.6 Sol, Terra và Luna đều nằm trên OrcaRouter thông qua một endpoint tương thích OpenAI với mức phụ phí 0%, có chuyển đổi dự phòng tự động. Bạn có thể kiểm tra chúng so với GPT-5.5, Claude, Gemini và các mô hình khác mà không cần thay đổi tích hợp.
Daybreak Blue và Daybreak Red là gì?
Chúng là hai cấp độ của chương trình an ninh mạng đã được kiểm định của OpenAI, được mở rộng vào ngày 10 tháng 8 năm 2026. Daybreak Blue cung cấp cho các nhà phòng thủ được chấp thuận GPT-5.6 Sol với các rào cản an ninh mạng được gỡ bỏ, cho công việc phòng thủ như ứng phó sự cố, phân tích phần mềm độc hại và đánh giá mã an toàn. Daybreak Red cung cấp GPT-5.6-Cyber, một mô hình dựa trên Sol được huấn luyện chuyên biệt cho nghiên cứu lỗ hổng và khai thác được ủy quyền, cho các nhóm được kiểm định riêng biệt. Cả hai đều không phải là sản phẩm API công khai.
So sánh trong bài viết này4
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
