
GPT-6.1 Sol so với Thế hệ GPT-6: Một Thế hệ Đơn độc
- openaiMỚIOpenAI: GPT-6.1 Sol2026-09-2952Trí tuệ
- anthropicMỚIAnthropic: Claude Sonnet 5.52026-09-2856Trí tuệ
- typesafeMỚITypeSafe: Jev 1.132026-09-24$0.04 / $0.00 trên 1 triệu token · 161 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Trí tuệ
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Trí tuệ
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Trí tuệ
- xAIGrok 4.72026-09-2146Trí tuệ
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 trên 1 triệu token · 79 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 trên 1 triệu token · 53 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token · 301 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token · 232 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
Nhà cung cấp đã thêm tên thứ tư vào dòng mô hình của mình vào ngày 29 tháng 9 năm 2026 và gọi nó là một thế hệ, và phép tính của dòng sản phẩm là điều thú vị nhất về nó: GPT-6.1 Sol chính là toàn bộ thế hệ. GPT-6 Luna và GPT-6 Sol, cả hai đều ra mắt vào ngày 22 tháng 9 năm 2026, không thay đổi; GPT-6 Astra, ra mắt từ ngày 4 tháng 9 năm 2026, không thay đổi; bản làm mới 6.1 chỉ tác động đúng một hạng. Trong khi đó, GPT-6.1 Sol, với giá $2.00 cho đầu vào và $10.00 cho đầu ra mỗi triệu token, đạt 51.83 điểm trên Artificial Analysis Intelligence Index với $0.724 mỗi tác vụ — trong khoảng 0.84 điểm so với GPT-6 Astra, vốn tốn $3.2575 mỗi tác vụ ở mức $10.00/$50.00. Cùng một thế hệ trên nhãn, nhưng bên dưới là bốn nền kinh tế khác nhau.
Điều đó khiến "liệu tôi có nên dùng thế hệ GPT-6" trở thành câu hỏi sai. Dòng sản phẩm trải rộng trên phạm vi chi phí mỗi tác vụ gấp 48 lần và phạm vi 14,6 điểm về trí thông minh đo được, và câu trả lời hoàn toàn phụ thuộc vào việc bạn đang nói đến hạng nào. Đây là thang bậc, đã được đo lường.
Bốn bậc thang, như đã đo

• GPT-6 Luna — Chỉ số 38.12, $0.10 / $0.50 mỗi 1M, $0.01 cho bộ nhớ đệm, $0.0678 mỗi tác vụ, 50.012 token đầu ra, 100,1 giây đến token đầu tiên
• GPT-6 Sol — Chỉ số 47.63, $2.00 / $10.00, $0.20 cho bộ nhớ đệm, $1.045 mỗi tác vụ, 31.000 token đầu ra, 124,3 giây
• GPT-6.1 Sol — Chỉ số 51.83, $2.00 / $10.00, $0.10 cho bộ nhớ đệm, $0.724 mỗi tác vụ, 38.128 token đầu ra, 332,0 giây
• GPT-6 Astra — Chỉ số 52.67, $10.00 / $50.00, $1.00 cho bộ nhớ đệm, $3.2575 mỗi tác vụ, 27.206 token đầu ra, 400,4 giây
Mỗi cái trong số chúng đều có cùng cửa sổ ngữ cảnh 1.050.000 token và cùng đầu ra tối đa 128.000 token, và mỗi cái đều nhận đầu vào văn bản, hình ảnh và tệp. Các bậc không được phân biệt bằng cờ năng lực. Chúng được phân biệt bởi bạn sẵn sàng trả bao nhiêu cho việc suy nghĩ, và hai đầu của chiếc thang đó cách nhau 48 lần cho mỗi tác vụ.
Bản làm mới 6.1 thực sự đã thay đổi điều gì
Ba thứ, và chỉ một trong số đó là điểm số.
Điểm số đã thay đổi: từ 47.63 lên 51.83, tức tăng 4.2 điểm, chỉ trong một tuần. Tỷ lệ đầu vào được lưu trong bộ nhớ đệm đã giảm một nửa, từ $0.20 xuống $0.10 mỗi triệu, đó là lý do tại sao chi phí đo được cho mỗi tác vụ giảm từ $1.045 xuống $0.724 mặc dù giá niêm yết vẫn giống hệt nhau — cùng một bảng giá, nhưng hóa đơn khác nhau. Và số lượng token đầu ra đã tăng từ 31,000 lên 38,128 trong khi thời gian đồng hồ cho mỗi tác vụ tăng từ 321 giây lên 640 giây, đây là điểm duy nhất mà bản cập nhật đi lùi và cũng là điểm ít được chú ý nhất trên bất kỳ bảng thông số kỹ thuật nào.
So với Astra, đây mới là phép so sánh khiến người ta bất ngờ. GPT-6.1 Sol kém mô hình chủ lực 0,84 điểm chỉ số và rẻ hơn 4,5 lần cho mỗi tác vụ. Lợi thế còn lại của Astra không nằm ở điểm chỉ số; mà nằm ở tập hợp các đánh giá nơi chỉ mình nó được đo lường, và ở một năng lực mà OpenAI mô tả là duy nhất thuộc về nó — phát hiện các lỗ hổng bảo mật mới, đó là lý do mô hình này được xếp loại "critical" theo chính Preparedness Framework của nhà cung cấp và các thiết lập mạnh nhất của nó bị giới hạn cho những đối tác đã được thẩm định.
Thẻ OrcaRouter dành cho GPT-6 Astra là mức cao cấp nhất ở đầu trên của cùng một thang bậc: 10,00 USD / 50,00 USD, p50 1,64 giây cho token đầu tiên, 40,7 triệu token trong bảy ngày, và cùng cửa sổ ngữ cảnh 1.050.000 token mà mọi bậc đều chia sẻ.

So với Sol 6.0, bản làm mới gần như là một sự cải thiện thẳng — nhiều chỉ số hơn, ít tiền hơn — với lưu ý rằng mô hình 6.1 là một mô hình khác chứ không phải một checkpoint, và nó xuất lại phần lập luận của mình dài dòng hơn. So với Luna thì đây hoàn toàn không phải là một sự so sánh: chi phí gấp 10,7 lần để đổi lấy 13,7 điểm chỉ số, một sự đánh đổi tốt cho công việc khó và rất tệ cho công việc khối lượng lớn.
Điều mà dữ liệu định tuyến của chính chúng tôi cho thấy thị trường đã quyết định
Một điều mà so sánh này có mà bảng thông số không có là góc nhìn về mức sử dụng thực tế. Trong bảy ngày kết thúc vào ngày 7 tháng 10 năm 2026 trên lớp định tuyến của chính chúng tôi, GPT-6.1 Sol đã xử lý 284,2 triệu token và GPT-6 Sol mà nó thay thế đã xử lý 950 nghìn token — chênh lệch 300 lần đối với hai mô hình chỉ hơn kém nhau một tuần tuổi, và đó chính là hình ảnh của một cuộc thay thế tầng hạng khi nhìn từ bên trong. GPT-6 Luna, tầng giá rẻ, đã xử lý 641,6 triệu token, nhiều hơn cả hai mô hình Sol cộng lại. GPT-6 Astra đã xử lý 40,7 triệu token.
Hãy hiểu đó là ba hành vi riêng biệt. Công việc khối lượng lớn dồn về bậc giá rẻ với khối lượng lớn nhất. Công việc nghiêm túc hợp nhất về Sol mới nhất trong vòng một tuần kể từ khi ra mắt, bỏ rơi mô hình mà nó thay thế. Và mẫu flagship vẫn chỉ là một ngách: bậc mạnh nhất, được dùng ít nhất, bởi những đội mà vấn đề của họ là vấn đề chỉ nó giải quyết được. Dòng sản phẩm không phải là một cái thang để người ta leo; nó là một bộ công cụ để người ta chọn, và họ chọn theo bậc chứ không theo thế hệ.
Đó là lý do tại sao tier thuộc về request, chứ không phải trong kiến trúc
Vấn đề thực tiễn với một thế hệ gồm bốn tầng là câu trả lời đúng thay đổi theo từng tác vụ và từng tuần — như các số liệu lưu lượng ở trên cho thấy, thị trường đã quyết định lại trong vòng bảy ngày. Việc mã hóa cứng một tên mô hình vào một ứng dụng chính là điều biến một dòng sản phẩm thành một cam kết.
Cả bốn đều có thể truy cập qua một endpoint OrcaRouter duy nhất: một API duy nhất cho hơn 200 mô hình, với giá niêm yết của nhà cung cấp được chuyển nguyên qua ở mức cộng thêm 0%. Chi tiết cuối cùng đó đặc biệt có tính quyết định ở đây, bởi vì ba trong bốn bậc dùng chung một giá niêm yết hoặc một mức giá cache đã từng thay đổi một lần — mức giá cache của GPT-6.1 Sol đã giảm một nửa trong vòng một tuần sau khi ra mắt, và chính cơ chế tính giá chuyển tiếp nguyên giá là thứ đưa điều đó lên hóa đơn của bạn một cách tự động.

Hai tính năng của lớp định tuyến đáng được nhắc tên cho dòng sản phẩm cụ thể này. DSL định tuyến cho phép tier trở thành một tham số của yêu cầu thay vì gắn với khâu triển khai — tier rẻ cho lượt trích xuất, 6.1 Sol cho lượt suy luận, Astra chỉ cho những lời gọi cần đến thứ mà chỉ Astra làm được. Và model fusion cho phép một hội đồng gồm chúng cùng trả lời một câu hỏi, đó là cách trung thực để dùng một flagship mà bạn không thể kham nổi việc định tuyến mọi thứ tới nó: nó trở thành một tiếng nói trong hội đồng thay vì toàn bộ hóa đơn.
Làm gì với một thế hệ chỉ có một người
Đừng mua cả thế hệ. Hãy mua một nấc, và mua lại khi các nấc di chuyển.
Đối với các công việc khối lượng lớn và nhạy cảm với độ trễ, GPT-6 Luna với mức $0.0678 mỗi tác vụ và 100 giây để có token đầu tiên là bậc vốn đã gánh lưu lượng nhiều nhất, và mức giá thấp hơn một bậc độ lớn so với mọi thứ khác trên thang. Đối với suy luận tổng quát và lập trình, GPT-6.1 Sol giờ đây là mặc định mà mô hình 6.0 từng là — cùng giá niêm yết, chỉ số tốt hơn, chi phí bộ nhớ đệm bằng một nửa, và thời gian tác vụ 640 giây là điều duy nhất cần kiểm thử với khối lượng công việc của riêng bạn trước khi bạn cho rằng việc nâng cấp là miễn phí. Đối với những tác vụ cần đo lường tiên phong hoặc công việc bảo mật mà chỉ mô hình hàng đầu mới làm được, GPT-6 Astra vẫn là bậc duy nhất làm được chúng, với chi phí gấp 4,5 lần bậc bên dưới nó.
Điều cần để mắt tới là liệu bản làm mới 6.1 có chạm tới các hạng khác hay không. Nếu Luna hoặc Astra cũng được đối xử như vậy, hình dạng của chiếc thang sẽ thay đổi, và phép tính theo từng tác vụ trong bài này cũng thay đổi theo. Cho đến lúc đó, “GPT-6.1” chỉ định danh một mô hình, và coi nó như một họ mô hình chính là cách các nhóm rốt cuộc phải trả mức giá flagship cho tác vụ trích xuất.
