
GPT-6 Sol Pro so với GPT-6 Astra: Bội số giá mà ai cũng trích dẫn là sai
- openaiMỚIOpenAI: GPT-6 Luna2026-09-2237Trí tuệ
- openaiMỚIOpenAI: GPT-6 Sol2026-09-2248Trí tuệ
- anthropicMỚIAnthropic: Claude Opus 5.52026-09-2258Trí tuệ
- grokMỚIGrok 4.72026-09-2146Trí tuệ
- OrcaMỚIOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 trên 1 triệu token
- orcaMỚIOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token
- deepseekMỚIDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- openaiOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- googleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- anthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- grokSpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
- metaMeta: Muse Spark 1.22026-08-0540Trí tuệ72Lập trình
- qwenQwen: Qwen3.8 Max2026-08-0345Trí tuệ76Lập trình
GPT-6 Sol Pro và GPT-6 Astra lần lượt là bậc giá rẻ và mẫu chủ lực của cùng một nhà cung cấp, và bội số mà hầu hết các bài đưa tin gán cho khoảng cách đó là 2,5×. Nó không phải là 2,5×. GPT-6 Sol — mô hình của nhà cung cấp mà cấu hình gpt-6-sol-pro sử dụng, sẵn có rộng rãi từ ngày 22 tháng 9 năm 2026 với mức $2,00 mỗi triệu token đầu vào và $10,00 mỗi triệu token đầu ra — được định giá so với GPT-6 Astra, mẫu chủ lực đạt trạng thái sẵn có rộng rãi vào ngày 3 tháng 9 năm 2026, ở mức $10,00 và $50,00. Đó là gấp năm lần ở đầu vào và gấp năm lần ở đầu ra. Con số 2,5× thuộc về một phép so sánh khác: Astra đối chiếu với GPT-5.6 Sol, thế hệ trước, vốn có giá $4,00 và $20,00.
Sự nhầm lẫn này đáng được chỉnh sửa trước bất cứ điều gì khác, vì nó làm thay đổi quyết định. Mức phụ trội 2,5× cho mô hình flagship chỉ là một sai số làm tròn trong ngân sách dự án. Mức phụ trội 5× là khoản mục đơn lẻ lớn nhất trong hầu hết các kế hoạch suy luận, và đó chính là con số quyết định liệu flagship là mặc định hay là ngoại lệ.
Sai bội số đó đến từ đâu
Khi Astra ra mắt vào ngày 3 tháng 9, phép so sánh mà OpenAI và hầu hết các hãng truyền thông đưa ra là với GPT-5.6 Sol, dòng tầm trung đang được bán ra vào thời điểm đó. Astra có giá bằng 2,5 lần mẫu đó. Mười chín ngày sau, OpenAI phát hành GPT-6 Sol và giảm một nửa mức giá của dòng tầm trung, từ $4,00 và $20,00 xuống $2,00 và $10,00, đồng thời mô tả các mức giá mới là vĩnh viễn thay vì mang tính khuyến mại. Mọi trang "vs" trong các kết quả hàng đầu cho cặp so sánh này đều được viết trong khoảng mười chín ngày đó và so sánh Astra với mẫu không còn chiếm vị trí đó nữa.
Không có gì về Astra thay đổi. Bậc bên dưới nó đã dịch chuyển, và bội số đã tăng gấp đôi.
Hai bảng giá, từng dòng một
Cả hai đều là những con số do chính OpenAI công bố, được các nền tảng lưu trữ chúng truyền đi nguyên vẹn.
• Đầu vào — GPT-6 Sol $2.00 mỗi triệu token so với GPT-6 Astra $10.00 mỗi triệu token
• Đầu ra — GPT-6 Sol $10.00 mỗi triệu token so với GPT-6 Astra $50.00 mỗi triệu token
• Đầu vào đã cache — GPT-6 Sol $0,20 mỗi triệu token so với GPT-6 Astra $1,00 mỗi triệu token; cả hai đều cố định bằng 10% mức giá không cache
• Ghi bộ nhớ đệm — GPT-6 Sol 2,50 USD mỗi triệu token so với GPT-6 Astra 12,50 USD mỗi triệu token, cả hai đều bằng 1,25× mức giá đầu vào không lưu đệm
• Xử lý ngữ cảnh dài — GPT-6 Sol định giá lại một yêu cầu vượt ngưỡng đầu vào của nó ở mức gấp đôi giá đầu vào và bộ nhớ đệm, cùng gấp 1,5 lần giá đầu ra, cho toàn bộ yêu cầu; GPT-6 Astra cũng làm như vậy với trên 272.000 token đầu vào, ở mức $20.00, $2.00, $25.00 và $75.00
• Batch — GPT-6 Sol ở mức một nửa giá tiêu chuẩn so với GPT-6 Astra ở mức một nửa giá tiêu chuẩn của nó, $5.00 và $25.00, điều này bảo toàn chính xác tỷ lệ 5×
• Cửa sổ ngữ cảnh — 1.050.000 token cho cả hai
• Đầu ra tối đa — 128.000 token cho cả hai
• Phương thức đầu vào — văn bản và hình ảnh cho cả hai, với GPT-6 Astra cũng chấp nhận đầu vào tệp
• Thời điểm chốt kiến thức — GPT-6 Sol ngày 20 tháng 4 năm 2026 so với GPT-6 Astra ngày 30 tháng 4 năm 2026, cách nhau mười ngày
Hai thẻ không chỉ tương tự nhau về cấu trúc; chúng có cùng một cấu trúc với hệ số nhân gấp năm lần áp dụng cho mọi hàng, bao gồm cả bậc batch và bậc long-context. Đó là một thiết kế sản phẩm có chủ đích, và điều đó có nghĩa là lựa chọn giữa chúng thực sự là một quyết định về năng lực chứ không phải một quyết định về chiến lược định giá. Không có mức giảm giá nào có thể tìm thấy bằng cách thay đổi hình dạng yêu cầu của bạn.

Núm điều chỉnh nỗ lực là sự bất đối xứng mà không ai viết về
Cả hai mô hình đều có một tham số nỗ lực suy luận. Hai thang bậc này không giống nhau, và sự khác biệt này có những hệ quả đối với việc di trú.
Bộ giá trị được ghi nhận của GPT-6 Sol là none, low, medium, high, xhigh và max, với medium là mặc định. Còn của GPT-6 Astra là low, medium, high, xhigh và max — không có none. Bạn không thể tắt suy luận trên mô hình flagship. Nếu pipeline của bạn có một bước phân loại nhạy cảm với độ trễ hiện đang chạy ở mức effort none, thì bước đó không thể chuyển nguyên trạng sang Astra; nó phải được tinh chỉnh lại, chuyển sang một mô hình khác, hoặc chấp nhận với mức sàn độ trễ cao hơn.
Đây là một chi tiết nhỏ nhưng tiêu tốn thật sự nhiều thời gian kỹ thuật, và nó không xuất hiện trên bất kỳ trang so sánh nào về cặp đối đầu này vì những trang đó được viết từ các bảng giá thay vì từ tài liệu API.
Các con số độc lập, với phiên bản chỉ mục được đính kèm
Artificial Analysis đã nhiều lần tính lại Chỉ số Intelligence của mình trong năm 2026, và cuộc đối đầu này chính là nơi điều đó quan trọng nhất, bởi vì điểm số Astra được nhắc lại nhiều nhất nay đã bị loại bỏ.
Astra đạt 61 trên phiên bản chỉ số v4.1.1 khi ra mắt — ngang bằng với GPT-5.6 Sol, đó là lý do nhiều bài đưa tin ra mắt mô tả mẫu flagship này là một bước tiến khiêm tốn. Con số 61 đó là thật và nó đến từ một chỉ số không còn tồn tại. Trên bảng hiện tại, Astra ở mức nỗ lực tối đa đạt 53 với $3.26 mỗi tác vụ chỉ số, và ở mức nỗ lực cao đạt 51 với $1.73. GPT-6 Sol ở mức nỗ lực tối đa đạt 48 với $1.06 mỗi tác vụ chỉ số, và 43 ở mức nỗ lực cao với $0.37.
Đọc bốn dòng đó cùng nhau và hình hài của quyết định hiện ra.
• Lợi thế của Astra so với Sol ở đỉnh của cả hai thang đo là năm điểm chỉ số, với chi phí cho mỗi tác vụ hoàn thành cao gấp khoảng ba lần.
• Astra ở mức nỗ lực cao tốn $1.73 mỗi tác vụ. Sol ở mức nỗ lực tối đa tốn $1.06. Mẫu chủ lực chạy ở thiết lập nỗ lực mặc định đắt hơn hạng rẻ chạy hết công suất, và điểm chỉ số là 51 và 48.
• Khoảng cách chi phí trên mỗi tác vụ — khoảng 3 lần — nhỏ hơn mức chênh lệch đơn giá gấp 5 lần, bởi vì Sol là bên ngốn token hơn trong hai bên khi tính theo mỗi tác vụ. Đó là một điểm thực sự có lợi cho Astra và là phần duy nhất trong cách diễn đạt “2.5×” còn trụ được khi đối chiếu với dữ liệu.
Có hai lưu ý về tính trung thực cần được nêu kèm. Đây là những trang khác nhau trong cùng một họ chỉ mục, chứ không phải một lần chạy đối đầu duy nhất đã được công bố, và các số liệu độ trễ của chính Astra phụ thuộc vào mức nỗ lực đến mức khiến một con số duy nhất trở nên gây nhầm lẫn — cùng một mô hình báo cáo thời gian đến token đầu tiên được đo bằng hàng chục giây ở một mức nỗ lực và vài phút ở một mức khác. Không được trích dẫn một số liệu độ trễ của Astra mà không nêu rõ thiết lập.
Những gì chiếc flagship mua được ở mức 5×
Những khác biệt về năng lực là có thật và chúng tập trung vào công việc mang tính tác nhân và đa phương thức thay vì suy luận tổng quát.
• Chỉ số tác nhân lập trình — GPT-6 Astra đạt 62 trong bộ khung Codex, so với 57 của GPT-6 Sol, với chi phí lần lượt là 7,09 USD và 2,99 USD mỗi tác vụ. Mẫu chủ lực chỉ dùng khoảng một phần ba lượng token mỗi tác vụ, đó là lý do khoảng cách chi phí trên mỗi tác vụ nhỏ hơn khoảng cách về đơn giá.
• Terminal-Bench 4.0 — 59% cho Astra so với 43% cho Sol trên cùng một bảng đánh giá độc lập, khoảng cách mười sáu điểm, mức chênh lệch năng lực đơn lẻ lớn nhất giữa hai bên.
• Các hàng agentic do nhà cung cấp báo cáo — bảng công bố ra mắt của chính OpenAI cho thấy Astra dẫn đầu trên OSWorld 2.0, ScreenSpot-Pro, AutomationBench và Agents' Last Exam, tất cả đều do nhà cung cấp thực hiện và không có kết quả nào được tái lập độc lập. Bảng này cũng cho thấy Sol dẫn đầu trên FrontierMath T1–3 và BrowseComp, điều đáng lưu ý cho bất kỳ ai có xu hướng xem bảng của nhà cung cấp là một thắng lợi toàn diện.
• Tư thế an toàn — Astra là mô hình OpenAI đầu tiên được chỉ định ở cấp độ Critical về an ninh mạng theo Preparedness Framework của công ty, và các khả năng tấn công mạng tiên tiến của nó chỉ được mở khóa thông qua một chương trình truy cập riêng. Việc giới hạn truy cập đó có hệ quả trong môi trường vận hành vượt ra ngoài quyền truy cập: một trình giám sát sự mất căn chỉnh chạy trên các yêu cầu dùng công cụ, và trong API, một tác vụ bị gắn cờ sẽ dừng hẳn thay vì tạm dừng để xem xét như trong các ứng dụng khách tiêu dùng.

Nói ngắn gọn thì Astra giỏi hơn ở những việc khó thay thế — các vòng lặp agentic dài, công việc trên terminal, sử dụng máy tính — và gần như ngang bằng với Sol ở những việc dễ thay thế. Năm điểm chỉ số về suy luận tổng quát thì không đáng giá gấp 5 lần. Mười sáu điểm Terminal-Bench và khoảng cách năm điểm về coding-agent, trong những công việc mà một lần chạy thất bại khiến con người tốn một giờ để dọn dẹp, thì đôi khi lại đáng.
Nơi một lớp định tuyến thay đổi phép tính
GPT-6 Astra có trong danh mục của OrcaRouter với mức $10,00 cho đầu vào và $50,00 cho đầu ra mỗi triệu token dưới ngưỡng đầu vào 272.000 token, với bậc long-context ở mức $20,00 và $75,00 khi vượt ngưỡng đó, cửa sổ ngữ cảnh 1.050.000 token, giới hạn đầu ra 128.000 token và thời gian tới token đầu tiên (p50) là 7,82 giây theo đo lường trên trang mô hình của chúng tôi. Giá niêm yết của nhà cung cấp được chuyển thẳng, không cộng thêm phụ phí.
GPT-6 Sol không phải là một trong những tuyến của chúng tôi, vì vậy không có nội dung nào ở đây là tuyên bố về giá của nó thông qua chúng tôi.

Tỷ lệ giá 5× là trường hợp rõ ràng nhất để định tuyến thay vì lựa chọn. Câu trả lời đúng cho hầu hết các nhóm không phải là "mô hình hàng đầu" hay "gói rẻ" — mà là cả hai, với quyết định được đưa ra theo từng yêu cầu thay vì theo từng quý. Công việc cần đến Astra có thể nhận diện được ngay tại điểm gọi: đó là lượt chạy tác tử, tác vụ terminal, bước sử dụng máy tính. Còn công việc không cần thì là mọi thứ khác. Đặt cả hai phía sau một khóa với chuyển đổi dự phòng tự động biến điều đó thành một quy tắc định tuyến thay vì một cuộc di chuyển, và điều đó có nghĩa là mô hình đắt tiền chỉ được gọi đến khi nó chính là thứ đang được trả tiền.
Quy tắc quyết định
• Tạo văn bản khối lượng lớn, trích xuất, phân loại và tóm tắt — GPT-6 Sol. Rẻ hơn năm lần trên mỗi hàng, thua kém ba điểm chỉ số về suy luận tổng quát, và là mặc định đúng đắn.
• Lập trình agentic, làm việc trên terminal và sử dụng máy tính — GPT-6 Astra. Mười sáu điểm trên Terminal-Bench và năm điểm trên chỉ số coding-agent, ở những công việc mà một lần chạy thất bại được tính bằng giờ công của con người.
• Các pipeline hiện đang chạy một bước ở mức nỗ lực suy luận none — không bên nào, nếu không tinh chỉnh lại. Astra không có thiết lập none, và bước đó sẽ không thể chuyển nguyên trạng.
• Công việc cần đầu vào tệp cùng với hình ảnh — GPT-6 Astra, cái duy nhất trong hai cái chấp nhận tệp.
• Bất kỳ ai từng đọc rằng mẫu chủ lực có mức chênh lệch 2,5× — hãy tính lại phép toán ở mức 5×. Đó vẫn là cùng một mẫu với cùng một mức giá; phân khúc bên dưới nó đã thay đổi, và quyết định sẽ khác đi ở con số đã được chỉnh sửa.
So sánh trong bài viết này2
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
