
Giá GPT-6 Astra: Vì sao ba mức giá khác nhau đều đúng, và chi phí thực sự của một tác vụ là bao nhiêu
- orcaMỚIOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token
- deepseekMỚIDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- openaiMỚIOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- googleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- anthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- grokSpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
- metaMeta: Muse Spark 1.22026-08-0540Trí tuệ72Lập trình
- qwenQwen: Qwen3.8 Max2026-08-0345Trí tuệ76Lập trình
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3135Trí tuệ69Lập trình
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 trên 1 triệu token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2451Trí tuệ78Lập trình
Điểm mấu chốt trước tiên: GPT-6 Astra có giá $10.00 cho mỗi triệu token đầu vào, $1.00 cho mỗi triệu token đầu vào được lưu đệm, và $50.00 cho mỗi triệu token đầu ra trên gói tiêu chuẩn của OpenAI. Đó là giá niêm yết của chính OpenAI, đọc từ trang định giá của chính OpenAI vào ngày 16 tháng 9 năm 2026 — và ngày tháng rất quan trọng, vì mô hình đã từng có mức giá khác nhau ở những thời điểm khác nhau và độc giả cứ liên tục tìm thấy những con số khác đó. GPT-6 Astra được phát hành vào ngày 3 tháng 9 năm 2026, mười ba ngày trước trang này. Đây không phải là bài ra mắt và cũng không phải bài thông báo; đây là trang tham chiếu cho một mô hình hiện đã được cung cấp rộng rãi và, tính đến tuần này, đã được triển khai rộng rãi. GPT-5.6 Sol xuất hiện bên dưới với tư cách là mức giá cơ sở mà Astra được bán cao hơn, chứ không phải là chủ thể.
Lý do một bảng giá cần cả một trang là vì những con số đang lưu hành không thống nhất với nhau. Tìm kiếm giá của mô hình này và bạn sẽ thấy $10/$50 từ OpenAI, mức giá theo lô $5/$25, Azure báo giá cả $10/$50 và $11/$55, và ít nhất một endpoint được niêm yết ở mức $20/$100. Không có con số nào trong đó là lỗi đánh máy và không có con số nào là giá niêm yết bị âm thầm thay đổi. Chúng là các cấp độ dịch vụ khác nhau và các nhà bán lại khác nhau, và việc phân biệt chúng chính là sự khác biệt giữa một ngân sách và một phỏng đoán.
Bảng giá cước, với mỗi dòng đều được ghi nhãn và ghi ngày.
Mọi nội dung trong phần này đều được đọc từ tài liệu về định giá API và mô hình của chính OpenAI vào ngày 16 tháng 9 năm 2026. Chỗ nào số liệu đến từ bất kỳ nguồn nào khác, câu chứa số liệu đó sẽ nói rõ điều này.
• Tiêu chuẩn, các yêu cầu từ 272.000 token đầu vào trở xuống — 10,00 USD cho mỗi 1 triệu token đầu vào, 1,00 USD cho mỗi 1 triệu token đầu vào được lưu đệm, 12,50 USD cho mỗi 1 triệu lần ghi vào bộ đệm, 50,00 USD cho mỗi 1 triệu token đầu ra (bảng giá của chính OpenAI, đọc ngày 2026-09-16).
• Dòng ghi bộ nhớ đệm là có thật và người ta thường bỏ qua nó — lần đầu tiên bạn gửi một tiền tố, đó là một lần ghi với mức $12,50 mỗi 1M, chứ không phải một lần đọc với mức $1,00. Ghi bộ nhớ đệm được tính phí bằng 1,25 lần mức giá đầu vào tiêu chuẩn.
• Tiêu chuẩn, các yêu cầu trên 272.000 token đầu vào — 20,00 USD đầu vào, 2,00 USD đầu vào đã lưu trong bộ nhớ đệm, 25,00 USD ghi bộ nhớ đệm, 75,00 USD đầu ra cho mỗi 1 triệu. Toàn bộ yêu cầu đều được tính lại giá, không chỉ những token vượt ngưỡng (bảng giá của chính OpenAI, đọc ngày 16-09-2026).
• Batch và Flex — bằng một nửa mức tiêu chuẩn: $5.00 cho đầu vào, $0.50 cho đầu vào được lưu đệm, $6.25 cho ghi bộ đệm, $25.00 cho đầu ra trên mỗi 1M (bảng giá của chính OpenAI, đọc ngày 2026-09-16). Với đầu vào trên 272K, mức giá batch là $10.00 / $1.00 / $12.50 / $37.50.
• Chế độ nhanh — hai mức giá: 20,00 USD cho đầu vào, 2,00 USD cho đầu vào lưu đệm, 25,00 USD cho ghi bộ đệm, 100,00 USD cho đầu ra trên mỗi 1 triệu (bảng giá của chính OpenAI, đọc ngày 16/09/2026).
• Thông số mô hình quyết định hóa đơn — cửa sổ ngữ cảnh 1.050.000 token, đầu vào tối đa 922.000, đầu ra tối đa 128.000, thời điểm cắt kiến thức 2026-04-30, hỗ trợ token suy luận: có, các giá trị mức độ suy luận low / medium / high / xhigh / max (tài liệu mô hình của chính OpenAI, đọc ngày 2026-09-16).
Nếu bạn muốn phiên bản một câu: ở gói tiêu chuẩn, một yêu cầu nằm dưới 272K token đầu vào tốn 10 đô-la cho mỗi triệu token đầu vào và 50 đô-la cho mỗi triệu token đầu ra, lượt đọc từ bộ nhớ đệm bằng một phần mười mức giá đầu vào, và mọi thứ khác trong bài viết này hoặc là khoản giảm giá để chấp nhận xử lý chậm hơn, hoặc là khoản phụ phí khi vượt qua một ngưỡng.
Tại sao bạn sẽ thấy một con số khác, và cái nào là cái nào
Năm điều khác biệt tạo ra một báo giá không phải $10/$50. Bốn trong số đó chúng ta có thể gắn với tài liệu; một điều thì không, và chúng ta sẽ nói rõ như vậy thay vì đoán.
$5/$25 là mức giá theo lô (batch tier), và đây là mức giá của chính OpenAI. Đây không phải chiết khấu từ nhà bán lại hay mức giá doanh nghiệp đã thương lượng. Trang bảng giá của OpenAI niêm yết xử lý theo lô ở mức bằng một nửa giá tiêu chuẩn, và dòng batch của Astra ghi $5.00 cho đầu vào và $25.00 cho đầu ra. Nếu một nguồn nào đó báo cho bạn mức $5/$25 như thể đó là một mô hình khác, thì đó vẫn là cùng một mô hình, cùng trọng số, chỉ chạy trên hàng đợi chậm hơn. Batch là câu trả lời đúng cho các lượt chạy đánh giá qua đêm và là câu trả lời sai cho bất cứ thứ gì mang tính tương tác.
$11/$55 đúng là mức tăng 10% so với giá niêm yết, và OpenAI có tài liệu ghi rõ mức tăng 10% cho các endpoint lưu trú. Trang giá của OpenAI nêu rằng các endpoint lưu trú bị tính thêm 10% đối với các mô hình ra mắt từ ngày 5 tháng 3 năm 2026 trở đi. GPT-6 Astra ra mắt vào ngày 3 tháng 9 năm 2026, nên nó đủ điều kiện. Nhân giá niêm yết với 1,1 và bạn sẽ có $11,00 và $55,00 chính xác đến từng xu. Đó là một lời giải thích mạnh mẽ về nguồn gốc của báo giá kiểu Azure cao hơn — một endpoint gắn với lưu trú đi qua mức tăng đã được ghi nhận, thay vì một nhà bán lại tự tạo ra biên lợi nhuận. Chúng ta nên nói chính xác về giới hạn của tuyên bố đó: mức tăng được OpenAI ghi nhận, và phép tính khớp chính xác, nhưng bản niêm yết Azure cụ thể mà chúng ta thấy không tự nêu rằng đó là một endpoint lưu trú. Hãy coi đó là lời giải thích có khả năng đúng nhất, chứ không phải là một lời giải thích đã được xác nhận.
$20/$100 là mức giá chế độ Fast của OpenAI cho mô hình này. Đây là con số trông giống số giả mạo nhất nhưng lại ít giả mạo nhất. Chế độ Fast nhân đôi mọi dòng, và dòng Fast tiêu chuẩn của Astra là $20.00 cho đầu vào và $100.00 cho đầu ra trên 1M. Một endpoint báo giá $20/$100 là đang báo giá một cấp dịch vụ khác — xử lý ưu tiên — chứ không phải một mức giá niêm yết khác và cũng không phải một mô hình khác. Nếu bạn thấy con số đó bên cạnh tên Astra, câu hỏi cần đặt ra là cấp xử lý nào, chứ không phải nhà cung cấp nào.
Giá dưới mức niêm yết vẫn tồn tại, và đó là phần biên lợi nhuận của người khác. Các cổng kết nối và đại lý bên thứ ba quảng cáo Astra với giá dưới mức niêm yết. Một cổng công khai niêm yết mức thấp hơn khoảng 20% so với giá của OpenAI. Đó là quyết định thương mại của đơn vị vận hành đó, không phải là thay đổi giá của OpenAI — và nó đi kèm với bất kỳ điều khoản nào về xử lý dữ liệu và độ tin cậy mà đơn vị vận hành đó áp dụng. Chúng tôi sẽ không nêu tên họ hay coi mức chiết khấu của họ là bằng chứng về giá của mô hình này, bởi đó là bằng chứng về hoạt động kinh doanh của họ, chứ không phải về bảng giá của OpenAI.
Những gì chúng tôi không thể xác minh. Chúng tôi thấy một danh sách từ router ghi model là gpt-6-astra với mức giá theo lô là $5/$25 và một alias động có dạng ~openai/gpt-astra-latest. Con số theo lô khớp với trang của chính OpenAI. Còn alias là một cấu trúc của gateway: tài liệu model của OpenAI chỉ liệt kê đúng một mục trong phần snapshots và đó là gpt-6-astra trần, không có dạng kèm ngày và không có alias -latest. Đừng đưa một alias của gateway vào config như thể nhà cung cấp đã công bố nó. Riêng phần này, chúng tôi không tìm thấy tài liệu nào của OpenAI về bất kỳ hạng "Astra Pro", "Astra-Medium" hay tương tự nào có mức giá riêng. "Pro" xuất hiện trong cách đặt tên gói ChatGPT, không phải trong bảng giá API, và một danh sách từ router không phải là tài liệu của nhà cung cấp. Nếu bạn cần xác nhận một hạng, hãy xác nhận trên trang của chính OpenAI.

Astra bên cạnh phần còn lại của bảng giá OpenAI
Một mức giá chỉ có ý nghĩa khi được đặt cạnh các lựa chọn thay thế trên cùng một thẻ. Đây đều là mức giá tiêu chuẩn của chính OpenAI, tất cả được đọc vào ngày 16 tháng 9 năm 2026, tất cả tính trên mỗi triệu token, tất cả ở mức bằng hoặc dưới 272K đầu vào.
• GPT-6 Astra — $10.00 đầu vào / $1.00 lưu đệm / $12.50 ghi / $50.00 đầu ra.
• GPT-5.6 Sol — $4.00 đầu vào / $0.40 bộ nhớ đệm / $5.00 ghi / $20.00 đầu ra.
• GPT-5.6 Terra — $2.00 đầu vào / $0.20 đã lưu đệm / $2.50 ghi / $12.00 đầu ra.
• GPT-5.6 Luna — $0.20 đầu vào / $0.02 đã lưu cache / $0.25 ghi cache / $1.20 đầu ra.
• Các phiên bản ngữ cảnh dài — Astra $20.00 / $2.00 / $25.00 / $75.00; Sol $8.00 / $0.80 / $10.00 / $30.00; Terra $4.00 / $0.40 / $5.00 / $18.00; Luna $0.40 / $0.04 / $0.50 / $1.80.
Có một chương trình khuyến mãi đang chạy ngay bên dưới bảng đó, và chính nó quyết định con số bội mà ai cũng tranh cãi. Trang định giá của OpenAI ghi rằng mức giá khuyến mãi của GPT-5.6 Sol được áp dụng ít nhất đến ngày 21 tháng 11 năm 2026. So với mức giá khuyến mãi đang áp dụng hôm nay, Astra gấp 2,5 lần Sol ở mọi dòng — gấp 2,5 lần ở đầu vào, 2,5 lần ở đầu vào được lưu đệm, 2,5 lần ở đầu ra. So với mức giá không khuyến mãi của Sol là 5,00 đô la cho đầu vào và 30,00 đô la cho đầu ra, Astra gấp 2 lần ở đầu vào và khoảng 1,67 lần ở đầu ra. Cả hai con số bội đều đúng về mặt số học và chúng mô tả cùng hai mô hình trong cùng một ngày. Sự khác biệt hoàn toàn nằm ở việc bạn lấy mức giá Sol nào làm mẫu số, và câu trả lời trung thực cho câu hỏi "Astra có gấp 2,5 lần Sol không?" là: có, cho đến ngày 21 tháng 11 năm 2026, hoặc cho đến khi OpenAI kết thúc chương trình khuyến mãi, tùy điều kiện nào đến trước.
Chúng tôi nhấn mạnh điểm này rất kỹ vì đây là lỗi phổ biến nhất trong việc đưa tin về mô hình này, kể cả trên blog này. Một bội số trên mỗi token âm thầm chọn một tỷ lệ Sol và không nêu tên nó thì không phải là một sự thật về Astra. Đó là một sự thật về thời điểm câu đó được viết.

Chi phí cho mỗi tác vụ, không phải chi phí cho mỗi token
Cách diễn đạt của chính OpenAI là việc so sánh giá token cho mô hình này là so sánh sai, bởi vì Astra được thiết kế để hoàn thành công việc dài hạn với ít token hơn và ít lần thử lại hơn. Tuyên bố đó đáng được xem xét nghiêm túc đến mức làm phép tính thay vì chỉ lặp lại nó. Vậy đây là một ví dụ đã tính toán với các giả định được nêu rõ ngay từ đầu, để bạn có thể thay đổi chúng cho phù hợp với khối lượng công việc của riêng mình.
Khối lượng công việc: Một lượt chạy agent gồm 200 lệnh gọi, mang dáng dấp của một cuộc migration qua đêm. Mỗi lệnh gọi mang 10.000 token đầu vào, trong đó 8.000 là đọc từ cache và 2.000 là mới, và tạo ra 500 token đầu ra. Tính chung cả lượt chạy, đó là 400.000 token đầu vào mới, 1.600.000 token đầu vào được cache và 100.000 token đầu ra, cộng thêm một lần ghi cache 10.000 token duy nhất để khởi tạo tiền tố. Gói tiêu chuẩn, dưới 272K mỗi yêu cầu, nên không áp dụng phụ phí ngữ cảnh dài.
• GPT-6 Astra — mới 0,4M x $10,00 = $4,00; đã lưu cache 1,6M x $1,00 = $1,60; ghi 0,01M x $12,50 = $0,13; đầu ra 0,1M x $50,00 = $5,00. Tổng cộng $10,73.
• GPT-5.6 Sol với mức giá khuyến mãi — mới $1.60; đã lưu cache $0.64; ghi $0.05; đầu ra $2.00. Tổng cộng $4.29.
• GPT-5.6 Sol ở mức giá không khuyến mãi — mới $2.00; lưu đệm $0.80; ghi $0.06; đầu ra $3.00. Tổng cộng $5.86.
• GPT-5.6 Terra — mới $0.80; cache $0.32; ghi $0.03; xuất $1.20. Tổng $2.35.
• GPT-5.6 Luna — mới $0.08; đã lưu đệm $0.03; ghi $0.00; đầu ra $0.12. Tổng $0.23.
Vậy thì, ở cùng số lượng token, Astra gấp khoảng 46 lần Luna và 4.6 lần Terra. Không ai mua Luna để làm một công việc cỡ Astra, và chú thích đó chính là toàn bộ lý do khiến việc so sánh chi phí trên mỗi token giữa hai mô hình ấy chỉ là trò diễn. So sánh với Sol mới là cái quyết định điều gì đó, nên đây là con số thực sự quan trọng.
Điểm hòa vốn là 40%. Vì Astra chính xác gấp 2,5 lần Sol trên mọi hạng mục ở mức giá khuyến mãi của Sol, Astra có thể đốt tới 40% token của Sol cho cùng một tác vụ mà vẫn ra cùng hóa đơn — và điều đó đúng với mọi hỗn hợp đầu vào mới, đầu vào được cache và đầu ra, vì tỷ lệ là đồng nhất. Nếu Astra dùng một phần ba số token của Sol, chi phí sẽ thấp hơn; nếu dùng một nửa, chi phí sẽ cao hơn. So với mức giá không khuyến mãi của Sol, điểm hòa vốn nới lỏng lên khoảng 55% trên hỗn hợp thiên về cache này, vì hệ số đầu ra của Astra giảm xuống còn 1,67x trong khi hệ số đầu vào giảm xuống còn 2x.
Con số đơn lẻ đó mới là con số hữu ích, và đó cũng chính là chỗ mà tuyên bố của nhà cung cấp và phép đo độc lập bắt đầu không còn thống nhất với nhau. OpenAI báo cáo Terminal-Bench 4.0 đạt 57,9% đối với Astra so với 37,3% của GPT-5.6 Sol, với chi phí API ước tính thấp hơn khoảng 9% cho mỗi tác vụ — theo báo cáo của nhà cung cấp. Artificial Analysis, trong một đánh giá độc lập công bố ngày 9 tháng 9 năm 2026, đã đo Astra chỉ dùng khoảng một phần ba số token của Sol cho mỗi tác vụ trên Coding Agent Index của mình, mà vẫn thấy Astra tốn 7,09 đô la mỗi tác vụ ở mức nỗ lực tối đa — cao hơn khoảng 15% so với Sol (tối đa) — để đạt điểm cao hơn 7 điểm. Trên Intelligence Index của mình, cùng đánh giá đó xếp Astra ở mức từ 0,82 đến 3,26 đô la mỗi tác vụ tùy theo các mức nỗ lực, đắt hơn khoảng 60% so với Sol ở mức nỗ lực tối đa.
Cả hai điều đó đều có thể đúng cùng lúc, và khoảng cách giữa chúng mới là dòng tít trung thực. Khoản tiết kiệm token là thật và lớn — một phần ba đúng là kiểu con số vượt qua mức hòa vốn 40% — nhưng khoản tiết kiệm đo trên token đầu ra không làm giảm các dòng cache-read và đầu vào mới vốn chiếm phần lớn trong một phiên agent dài. Astra có rẻ hơn Sol tính theo mỗi tác vụ hay không còn tùy vào cách kết hợp của bạn, và hướng chênh lệch đảo chiều giữa các khối lượng công việc. Bất kỳ ai nói với bạn rằng nó đơn giản là rẻ hơn, hay đơn giản là đắt hơn 2,5 lần, đều đang trích một dòng trong hóa đơn như thể đó là tổng số tiền.
Điều gì thực sự quyết định hóa đơn trên mẫu này
Ba điều chiếm ưu thế, và cả ba đều đặc thù riêng cho cách Astra được dự định sử dụng.
Token suy luận là token đầu ra. Chúng được tính phí $50.00 mỗi triệu, giống như đầu ra hiển thị. Trang mô hình của OpenAI liệt kê các giá trị effort được hỗ trợ là low, medium, high, xhigh và max, và không có cài đặt vô hiệu hóa — mức sàn cao hơn so với các mô hình cũ hơn. Trên đo lường Intelligence Index độc lập, mức chênh lệch giữa effort low và max là $0.82 đến $3.26 mỗi tác vụ, gấp bốn lần cho cùng một công việc. Mức effort là đòn bẩy chi phí đơn lẻ lớn nhất mà bạn kiểm soát, và nên đặt theo từng lệnh gọi thay vì đặt toàn cục.
Việc thử lại làm mọi thứ tăng lên gấp bội. Một agent thất bại và chạy lại sẽ phải trả tiền cho toàn bộ tiền tố một lần nữa. Đây là cơ chế đằng sau tuyên bố ít lần thử lại hơn của OpenAI, và cũng là lý do phép tính theo token gây hiểu nhầm theo cả hai hướng: một mô hình tốn gấp 2,5 lần chi phí mỗi token nhưng hoàn thành trong một lượt có thể đánh bại một mô hình rẻ hơn cần đến ba lượt. Nếu bạn đang đánh giá Astra so với bất kỳ thứ gì, hãy đo số tác vụ hoàn thành trên mỗi đô la, chứ không phải số token trên mỗi đô la.
Ngữ cảnh dài là chế độ được thiết kế sẵn, và nó bị tính phụ phí. Cửa sổ là 1.050.000 token. Nếu vượt 272.000 token đầu vào trong một yêu cầu duy nhất, toàn bộ yêu cầu đó sẽ được tính lại giá ở mức 20,00 đô-la cho đầu vào và 75,00 đô-la cho đầu ra trên mỗi triệu token — chứ không chỉ phần vượt trội. Một yêu cầu ở mức 280.000 token tốn gần gấp đôi một yêu cầu ở mức 270.000 token cho khoảng 4% đầu vào nhiều hơn. Trên một mô hình được xây dựng cho công việc dài hạn, đây là cách dễ nhất để đốt sạch ngân sách mà không hề hay biết, và đó là lý do vì sao chia nhỏ một tác vụ dài hạn thành các yêu cầu dưới 272K thường rẻ hơn so với gửi nguyên khối, dù mô hình có khả năng xử lý trọn vẹn.
Đối trọng chính là bộ đệm, và đây là nơi các phiên tác nhân dài thực sự tiết kiệm tiền. Các lượt đọc từ bộ đệm có giá $1.00 so với $10.00 khi đọc mới, giảm 90%, và một phiên dài gửi lại cùng một tiền tố hàng chục lần. Khoản ghi bộ đệm $12.50 chỉ trả một lần. Trong ví dụ đã tính ở trên, nếu mọi lệnh gọi phải gửi lại tiền tố 8.000 token mà không dùng bộ đệm, hóa đơn của Astra sẽ tăng từ $10.73 lên khoảng $25.00 — bộ đệm đang làm nhiều việc cho ngân sách hơn bất kỳ dòng mục nào khác.
Bản ghi về bội số
Một số trang trên blog này, bao gồm GPT-6 Astra vs GPT-5.6 Sol: giá gấp 2,5 lần có đáng không? và Nhu cầu về GPT-6 Astra khiến ChatGPT Pro tạm dừng đăng ký mới gói 200 USD, nêu rõ rằng Astra có giá niêm yết bằng 2,5 lần giá token của GPT-5.6 Sol. Con số đó được tính dựa trên mức giá khuyến mãi của Sol là 4,00 USD cho đầu vào và 20,00 USD cho đầu ra, tức mức giá mà trang định giá của OpenAI đang áp dụng hiện nay và mô tả là giá khuyến mãi, có hiệu lực ít nhất đến ngày 21 tháng 11 năm 2026.
Vậy nên bội số đó vẫn đúng — nó đã có thêm ngày hết hạn mà các trang trước đó không có. So với mức giá không khuyến mãi của Sol là $5.00 cho đầu vào và $30.00 cho đầu ra, Astra là 2x ở đầu vào và khoảng 1.67x ở đầu ra, không phải 2.5x. Những trang ghi 2.5x nên được hiểu là đang nói về giai đoạn khuyến mãi; hướng so sánh không thay đổi, nhưng độ lớn của khoảng cách giảm đi từ một phần năm đến một phần ba ngay khi khuyến mãi kết thúc. Bất kỳ ai lập ngân sách sau ngày 21 tháng 11 năm 2026 nên dùng $5.00 và $30.00 làm mẫu số của Sol và 2x / 1.67x làm bội số của Astra. Chúng tôi không nhắc lại các lập luận trên những trang đó — lý luận về benchmark và độ tin cậy ở đó tự nó đứng vững — mà chỉ đính chính mẫu số mà chúng được tính toán dựa trên.
Câu hỏi "miễn phí", được trả lời không úp mở.
Không có gói miễn phí cho mô hình này và cũng không có đường API miễn phí nào để truy cập mô hình này. Người dùng ChatGPT Free và ChatGPT Go hoàn toàn không được dùng GPT-6 Astra. Người đăng ký Plus chỉ có được nó thông qua ChatGPT Work và Codex, chứ không phải trong chat thông thường. API được tính phí ngay từ token đầu tiên ở mức 10,00 USD cho mỗi triệu token đầu vào, và cách hợp pháp rẻ nhất để giảm con số đó là gói batch ở mức 5,00 USD cho mỗi triệu, cái giá phải trả là độ trễ chứ không phải năng lực. Bất kỳ ai quảng cáo quyền truy cập API GPT-6 Astra miễn phí đều đang bán lại thứ gì đó — thường là một pool tín dụng dùng thử trên một cổng kết nối của bên thứ ba với các điều khoản dữ liệu riêng. Đó không hẳn là một thỏa thuận tồi, nhưng nó không miễn phí, và nó không phải là OpenAI.
Điều đáng biết nếu bạn đang hoạch định năng lực dựa trên một gói đăng ký thay vì API: vào ngày 10 tháng 9 năm 2026, OpenAI đã tạm dừng đăng ký mới và nâng cấp lên gói ChatGPT Pro 200 USD, với lý do nhu cầu đối với Astra. Gói 100 USD, Plus, Go, API cùng các tài khoản Business và Enterprise vẫn mở. Người tiêu dùng bị hạn chế; quyền truy cập API và doanh nghiệp thì không. Nếu kế hoạch của bạn phụ thuộc vào hạn mức sử dụng của một gói đăng ký dành cho người tiêu dùng, đó chính là rủi ro cần mô hình hóa.
Định tuyến nó, và những gì bộ định tuyến không khắc phục được
Astra là một trong những model có sẵn thông qua OrcaRouter dưới mã openai/gpt-6-astra, với cùng mức 10,00 USD cho đầu vào và 50,00 USD cho đầu ra mà nhà cung cấp thu, cùng cách phân tầng trên 272K như thể hiện trên trang model của chúng tôi. Chúng tôi chuyển tiếp nguyên giá niêm yết của nhà cung cấp với mức markup 0%, điều này quan trọng hơn ở model này so với hầu hết các model khác: những con số trong bài viết này đã thay đổi một lần ngay trong vòng đời của model, và giá chuyển tiếp sẽ thay đổi vào đúng ngày nhà cung cấp thay đổi, thay vì chờ đến khi có ai đó nhớ ra mà cập nhật bảng biểu.

Lý lẽ trung thực cho việc định tuyến ở đây không nằm ở giá, bởi vì không có khoản giảm giá nào để chào bán cho bạn — mà là bài toán chi phí ở trên phụ thuộc vào khối lượng công việc, và bạn sẽ không biết mình rơi vào phía nào của ngưỡng hòa vốn 40% cho đến khi chạy thử. Việc đặt Astra sau một endpoint duy nhất cùng với Sol, Terra và Luna nghĩa là bạn có thể đo lường số tác vụ hoàn thành trên mỗi đô-la từ chính lưu lượng của mình và chuyển đổi mô hình mà không cần hợp đồng thứ hai hay thay đổi mã nguồn. DSL định tuyến cho phép bạn tổ hợp một lệnh gọi xuyên qua nhiều mô hình thay vì cam kết một đường dẫn sản xuất vào một mô hình duy nhất, và tính năng chuyển đổi dự phòng tự động bao phủ trường hợp mà mô hình này đã chứng minh hai lần — rằng nhu cầu dành cho nó có thể vượt quá năng lực đáp ứng.
Những đánh đổi cũng thực tế không kém và đáng được gọi tên. Một router là một chặng trong đường đi của yêu cầu, và trên một mô hình mà điểm bán chính là công việc tự chủ tầm dài hạn, chặng đó là thêm một thứ nữa nằm trong miền lỗi; nếu mức chịu đựng của bạn cho điều đó là bằng không, hãy gọi trực tiếp cho nhà cung cấp. Một số điều trong bài viết này chỉ tồn tại khi có quan hệ trực tiếp: tùy chọn Zero Data Retention mà OpenAI cung cấp cho các khách hàng API đủ điều kiện trên các endpoint được hỗ trợ phải được OpenAI chấp thuận, và việc bật tính năng dành cho doanh nghiệp — vốn mặc định tắt khi ra mắt và được quản trị viên bật theo bảng giá áp dụng của họ — là một thỏa thuận giữa bạn và OpenAI, không phải thứ mà một router có thể cấp. OpenAI cũng ghi rõ rằng chế độ Fast cho mô hình này không khả dụng khi dùng lưu trú dữ liệu EU, vì vậy nếu bạn cần cả lưu trú dữ liệu lẫn tốc độ, ràng buộc đó đi theo mô hình, chứ không phải theo tuyến. Và mức markup 0% của router không phải là giảm giá: chúng tôi không rẻ hơn so với đi trực tiếp, chúng tôi có cùng mức giá nhưng ít tích hợp phải bảo trì hơn.
Xem gì
Một ngày và một con số. Ngày đó là 21 tháng 11 năm 2026, khi giá khuyến mãi của Sol không còn được đảm bảo — nếu nó hết hạn, bội số của Astra so với Sol giảm từ 2,5x xuống 2x ở đầu vào và 1,67x ở đầu ra, và mọi so sánh chi phí mỗi tác vụ đang lưu hành đều trở nên thuận lợi hơn cho Astra từ một phần năm đến một phần ba mà không có bất cứ điều gì thay đổi ở Astra. Con số là điểm hòa vốn của chính bạn: chạy một tác vụ dài hạn tiêu biểu trên cả hai mô hình, đếm số tác vụ hoàn thành và tổng số đô la, và bạn sẽ có một câu trả lời hữu ích hơn bất cứ thứ gì được công bố, kể cả trang này.
Đặt Astra phía sau một endpoint cùng với Sol, Terra và Luna nghĩa là bạn có thể đo lường số tác vụ đã hoàn thành trên mỗi đô-la từ chính lưu lượng của mình và chuyển đổi mô hình mà không cần hợp đồng thứ hai hay thay đổi mã nguồn.
So sánh trong bài viết này1
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
