
GPT-6.1 Sol vs GPT-6 Astra: Một điểm chỉ số, bảng giá gấp năm lần
- typesafeMỚITypeSafe: Jev 1.132026-09-24$0.04 / $0.00 trên 1 triệu token · 397 tok/s
- OpenAIMỚIOpenAI: GPT-6 Luna2026-09-2237Trí tuệ
- OpenAIMỚIOpenAI: GPT-6 Sol2026-09-2248Trí tuệ
- AnthropicMỚIAnthropic: Claude Opus 5.52026-09-2258Trí tuệ
- xAIMỚIGrok 4.72026-09-2146Trí tuệ
- OrcaMỚIOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 trên 1 triệu token · 195 tok/s
- OrcaMỚIOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token · 1141 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 trên 1 triệu token · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token · 106 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- xAISpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
GPT-6.1 Sol và GPT-6 Astra là mẫu tầm trung và flagship của cùng một dòng sản phẩm, ra mắt cách nhau bốn tuần — Sol vào ngày 29 tháng 9 năm 2026, Astra vào ngày 3 tháng 9 năm 2026 — và cho đến tuần này, so sánh giữa chúng hoàn toàn dựa trên các số liệu của chính OpenAI. Điều đó không còn nữa. Artificial Analysis đã đánh giá cả hai ở mức nỗ lực suy luận tối đa trên cùng một phiên bản chỉ số, và kết quả là khoảng cách 0,84 điểm nghiêng về Astra, bên cạnh khoảng cách chi phí mỗi lần chạy đánh giá gấp 4,5 lần nghiêng về GPT-6.1 Sol. Trên bảng giá, tỷ lệ này thậm chí còn rõ hơn: Astra gấp 5 lần GPT-6.1 Sol về đầu vào và đầu ra, và gấp 10 lần về đầu vào được lưu đệm. Câu hỏi mà trang này trả lời là ở đâu khoản phụ trội đó mua được thứ bạn có thể chỉ ra, và ở đâu nó chỉ đơn thuần là cái giá của một cái tên.
Hai mô hình đó là gì và hội đồng đã đo lường những gì
Cả hai đều nhận đầu vào văn bản và hình ảnh, đầu ra văn bản, với cửa sổ ngữ cảnh 1.050.000 token và tối đa 128.000 token đầu ra, và cả hai đều có thang nỗ lực năm bậc — low, medium, high, xhigh và max — sau khi đã bỏ none, cài đặt mà GPT-6 Sol vẫn chấp nhận. Cả hai đều không hỗ trợ tinh chỉnh. Những khác biệt đáng kể là những gì bảng giá nêu rõ: Astra là hạng chủ lực, GPT-6.1 Sol là bản làm mới của hạng bên dưới, và dòng định vị của chính OpenAI cho mô hình mới hơn là "hiệu năng gần Astra cho công việc phức tạp với chi phí thấp hơn."
Artificial Analysis chấm điểm tuyên bố đó trên Intelligence Index của mình — mười đánh giá trong phiên bản v4.3.2, cùng một phiên bản cho cả hai mô hình — và ghi lại ngày phát hành mà nó lưu cho mỗi mô hình. Nó đánh giá cả hai ở cấu hình nỗ lực tối đa mà trang mô hình nêu trong tiêu đề. Phần sau là so sánh đó, cùng phép tính chi phí mà chỉ số không thực hiện thay bạn.
• GPT-6.1 Sol — phát hành ngày 29/09/2026, Chỉ số Thông minh 51,8 ở mức nỗ lực tối đa, $2.00 đầu vào / $0.10 cache / $2.50 ghi cache / $10.00 đầu ra cho mỗi triệu token.
• GPT-6 Astra — phát hành ngày 03/09/2026, Chỉ số Thông minh 52,7 ở mức nỗ lực tối đa, $10.00 đầu vào / $1.00 cache / $12.50 ghi cache / $50.00 đầu ra cho mỗi triệu token.
• Cả hai đều không — chấp nhận mức nỗ lực suy luận none; cả hai đều tính lại giá cho toàn bộ yêu cầu ở mức 2× giá đầu vào và giá cache cùng 1,5× giá đầu ra một khi đầu vào vượt 272.000 token. Gói ngữ cảnh dài của Astra là $20.00 vào / $2.00 cache / $75.00 ra; của GPT-6.1 Sol là $4.00 / $0.20 / $15.00.
• Cả hai — hỗ trợ tìm kiếm web, tìm kiếm tệp, tạo hình ảnh, trình thông dịch mã, shell được lưu trữ, apply patch, skills, computer use, MCP và tìm kiếm công cụ thông qua Responses API.
0,84 điểm chỉ số, gấp 4,5 lần hóa đơn đánh giá

Hai con số nằm cạnh nhau trên bảng và cùng nhau tạo nên toàn bộ lập luận. GPT-6 Astra ở mức nỗ lực tối đa đạt 52,7. GPT-6.1 Sol ở mức nỗ lực tối đa đạt 51,8. Bên cạnh mỗi điểm số, bảng công bố chi phí để chạy chỉ số đằng sau nó: 3,26 đô la mỗi tác vụ đối với Astra, 0,72 đô la đối với GPT-6.1 Sol. Đọc như một câu duy nhất — 0,84 điểm đổi lấy 4,5 lần số tiền — đó là con số liên quan nhất đến việc ra quyết định mà một trong hai công ty đã công bố về hai mô hình này.
Cả hai mô hình cũng công bố điểm cho từng mức trên thang nỗ lực, cho phép chạy so sánh ở cùng mức chi tiêu thay vì ở cùng thiết lập:
• nỗ lực tối đa — GPT-6.1 Sol 51.8 với $0.72 mỗi lần chạy so với GPT-6 Astra 52.7 với $3.26.
• rất cao — 51.0 với $0.39 so với 52.4 với $2.31.
• cao — 50.2 với $0.32 so với 50.9 với $1.73.
• trung bình — 47.8 với $0.21 so với 49.6 với $1.54.
• thấp — 42.1 với $0.13 so với 45.8 với $0.82.

Xếp các bậc lại với nhau giữa các mô hình và một sự thật lộ ra mà cả hai mô hình đều không quảng cáo: khoảng cách từ high đến max của chính Astra là 1.8 điểm chỉ số, gấp hơn hai lần khoảng cách giữa Astra ở max và GPT-6.1 Sol ở max. Nói cách khác, chọn Astra thay vì GPT-6.1 Sol mang lại cho bạn ít điểm hơn so với chọn mức max của Astra thay vì mức high của Astra — và lựa chọn thứ hai trong số đó chỉ tốn một phần nhỏ so với lựa chọn thứ nhất. Bất kỳ ai có khối lượng công việc thực sự nhạy cảm với 1.8 điểm đó nên kiểm tra cài đặt effort trước khi kiểm tra cột mô hình.
Nơi mà khoản chênh lệch giá của Astra vẫn mua được thứ gì đó
Điểm tổng hợp thì sát nhau; các điểm riêng lẻ thì không. Khi được chấm theo từng hàng với nỗ lực tối đa, GPT-6 Astra chiếm ưu thế ở sáu trong mười, và những hạng mục mà nó chiếm ưu thế là những hạng mục liên quan đến hành động thay vì trả lời.
• AutomationBench-AA, quy trình làm việc nhiều bước trên nhiều công cụ — 0,685 cho Astra so với 0,649 cho GPT-6.1 Sol. Astra hơn 3,6 điểm.
• Terminal-Bench 4.0, công việc terminal trong môi trường thực tế — 0,591 so với 0,561. Astra hơn 3,0 điểm.
• SciCode — 0,565 so với 0,542. Astra hơn 2,3 điểm.
• Humanity's Last Exam — 0,547 so với 0,529. Astra hơn 1,8 điểm.
• AA-Omniscience — 43,4 so với 41,5, và trên cùng tập hợp, tỷ lệ ảo giác của Astra là 0,513 so với 0,543 của GPT-6.1 Sol. Astra vừa chính xác hơn, vừa sẵn sàng nói rằng nó không biết hơn.
• AA-Briefcase v1.1, sản phẩm bàn giao chuyên nghiệp — Elo 1568,9 so với 1564,2. Astra hơn 4,7.
Khuôn mẫu này đủ nhất quán để có thể lập kế hoạch dựa theo: khi tác vụ đòi hỏi mô hình phải giữ cho một chuỗi hành động dài được mạch lạc — điều khiển terminal, chạy một quy trình nhiều công cụ, tạo ra sản phẩm có dạng tài liệu — thì lợi thế của Astra là có thật và có thể lặp lại trên các harness. Khi tác vụ là một câu hỏi kiến thức được trả lời trong một lượt, lợi thế ấy phần lớn biến mất.
Nơi mô hình rẻ hơn chiến thắng, bao gồm cả dòng cache
GPT-6.1 Sol không phải là một Astra yếu hơn một chút một cách đồng đều. Ở những bài đánh giá tưởng thưởng cho việc đọc và lập luận trên tài liệu dài, nó dẫn đầu, và trên bảng giá, nó dẫn đầu với một khoảng cách mà chỉ số kia không bao giờ thấy.
• GDPval-AA, công việc chuyên môn được chấm điểm dựa trên kết quả của chuyên gia — Elo 1575,1 cho GPT-6.1 Sol so với 1541,9 của Astra. Lợi thế 33 điểm cho mô hình chỉ tốn một phần năm chi phí, và là thắng lợi độc lập lớn nhất trong hàng này.
• AA-LCR v1.1, suy luận ngữ cảnh dài — 0,830 so với 0,807. GPT-6.1 Sol dẫn trước.
• GDP.pdf — hòa hoàn toàn ở mức 0,310, tương tự như CritPt ở mức 0,317.
• Đầu vào đã lưu đệm — 0,10 USD mỗi triệu token so với 1,00 USD của Astra. Đây là hàng quyết định tính kinh tế của agent và nó hoàn toàn không xuất hiện trong chỉ số.
• Tốc độ đầu ra — 66,8 token mỗi giây so với 56,95 trong cùng một lần đánh giá, với 67,2 triệu token đầu ra được dùng so với 60,0 triệu của Astra. Không mô hình nào nhanh; GPT-6.1 Sol là mô hình nhanh hơn trong hai.
Một tháng agent, được định giá theo cả hai bảng giá
Lấy một khối lượng công việc gửi lại một tiền tố ổn định: 40 triệu token đầu vào mỗi tháng với 85% trong số đó được phục vụ từ bộ nhớ đệm, cộng thêm 4 triệu token đầu ra. Theo bảng giá của GPT-6.1 Sol, con số đó là $3.40 cho các lượt đọc từ bộ nhớ đệm, $12.00 cho đầu vào không được lưu đệm và $40.00 cho đầu ra — $55.40 cho cả tháng. Theo bảng giá của GPT-6 Astra, cùng lưu lượng đó là $34.00 cho các lượt đọc từ bộ nhớ đệm, $60.00 cho đầu vào không được lưu đệm và $200.00 cho đầu ra — $294.00. Khối lượng công việc là hoàn toàn giống nhau; nhưng hóa đơn thì lớn hơn 5.3 lần.
Hai ngưỡng bẻ cong phép tính đó, và cả hai đều đáng được định giá trước khi đưa ra quyết định chuyển đổi chứ không phải sau đó. Ngưỡng thứ nhất là 272.000 token đầu vào trong một yêu cầu duy nhất: vượt qua nó và toàn bộ yêu cầu sẽ được tính lại giá gấp đôi ở mức đầu vào và mức cache cùng 1,5× mức đầu ra, khiến GPT-6.1 Sol thành $4,00 / $0,20 / $15,00 và Astra thành $20,00 / $2,00 / $75,00. Ngưỡng thứ hai chính là thang mức nỗ lực — hạ GPT-6.1 Sol từ max xuống xhigh cắt chi phí mỗi lần chạy chỉ số của nó từ $0,72 xuống $0,39 để đổi lấy 0,8 điểm, và hạ Astra từ max xuống high cắt $3,26 xuống $1,73 để đổi lấy 1,8. Trong một vòng lặp agent nặng về cache, thiết lập mức nỗ lực là đòn bẩy chi phí lớn hơn cả cột mô hình, điều này ngược lại với cách hai mô hình này thường được so sánh với nhau.
Nên chạy cái nào, và cái bạn thực sự có thể gọi
Dựa trên bằng chứng, sự phân chia này rõ ràng hơn những gì tiếp thị gợi ý. Hãy định tuyến công việc phải trụ vững qua một chuỗi hành động dài — các phiên terminal, tự động hóa nặng về công cụ, các sản phẩm tài liệu nơi một đoạn văn bị ảo giác gây tốn kém — sang GPT-6 Astra, và cân nhắc chạy nó ở mức high thay vì max trừ khi bạn đã đo được rằng 1,8 điểm tăng thêm thực sự rơi vào các tác vụ của bạn. Hãy định tuyến mọi thứ nặng về kiến thức, nặng về bộ nhớ đệm hoặc chủ yếu là đọc sang GPT-6.1 Sol: nó chấm điểm công việc chuyên nghiệp tốt hơn, suy luận ngữ cảnh dài tốt hơn, nhanh hơn, và rẻ hơn năm đến mười lần ở những dòng chiếm phần lớn một hóa đơn thực tế.

Điều bạn có thể gọi hôm nay mới là phần trung thực. OrcaRouter phục vụ GPT-6 Astra đúng theo giá niêm yết của chính OpenAI — mức đầu vào $10.00, đầu ra $50.00, đọc từ bộ nhớ đệm $1.00 và ghi vào bộ nhớ đệm $12.50, với quy tắc đổi giá 272K được truyền nguyên vẹn đúng như nhà cung cấp công bố — cùng với GPT-6 Sol và GPT-6 Luna. Nó không phục vụ GPT-6.1 Sol: danh mục công khai trả về "model not found" cho openai/gpt-6.1-sol, và chúng tôi sẽ không mô tả một mô hình mà chúng tôi không thể định tuyến. Vì giá niêm yết của nhà cung cấp được truyền qua mà không thêm phụ phí, vào ngày mô hình đó xuất hiện, nó sẽ có mức giá của OpenAI ở phía chúng tôi mà không cần bước đổi giá; hôm nay, nửa khả dụng của màn đối đầu này là mô hình hàng đầu, nằm sau một khóa API, với DSL định tuyến sẵn có nếu bạn muốn kết hợp một mô hình rẻ và một mô hình đắt vào một lệnh gọi duy nhất thay vì chọn giữa chúng theo từng yêu cầu.
Điều duy nhất cần lưu ý là hàng mà bảng so sánh này còn thiếu. Cả con số của nhà cung cấp lẫn chỉ số độc lập đều không cho bạn biết lưu lượng của chính bạn sẽ thể hiện thế nào trên hai nấc này, và cách rẻ nhất để tìm ra là chạy cùng một bộ tác vụ qua cả hai với failover đang nắm quyền chủ động. Đó là một thử nghiệm chỉ-một-nút khi cả hai nửa đều gọi được, và là một nửa thử nghiệm cho đến khi chúng gọi được.
