
Giá API GPT-5.6 Sol sau khi giảm giá: $4 / $20 cho mỗi 1M Token
- openaiMỚIOpenAI: GPT-6.1 Sol2026-09-2952Trí tuệ
- anthropicMỚIAnthropic: Claude Sonnet 5.52026-09-2856Trí tuệ
- typesafeMỚITypeSafe: Jev 1.132026-09-24$0.04 / $0.00 trên 1 triệu token · 150 tok/s
- OpenAIMỚIOpenAI: GPT-6 Luna2026-09-2238Trí tuệ
- OpenAIMỚIOpenAI: GPT-6 Sol2026-09-2248Trí tuệ
- AnthropicMỚIAnthropic: Claude Opus 5.52026-09-2258Trí tuệ
- xAIGrok 4.72026-09-2146Trí tuệ
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 trên 1 triệu token · 127 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token · 1202 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 trên 1 triệu token · 53 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token · 202 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token · 228 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
GPT-5.6 Sol có giá $4,00 cho mỗi triệu token đầu vào và $20,00 cho mỗi triệu token đầu ra trên API GPT-5.6 Sol tính đến hôm nay — cùng mức giá chuyển tiếp mà gói flagship đang áp dụng trên thư mục OrcaRouter, được kiểm tra vào ngày 25-08-2026 với mức phụ phí bằng không. Vào ngày 24 tháng 8 năm 2026, OpenAI đã giảm giá API của Sol 20% cho đầu vào và khoảng 33% cho đầu ra, một chương trình khuyến mãi tạm thời kéo dài ít nhất đến ngày 21 tháng 11 năm 2026. Đây vẫn là gói đắt nhất trong gia đình GPT-5.6 và là gói đầu tiên có giá niêm yết thay đổi kể từ đợt giảm giá ngày 30 tháng 7, đợt giảm giá đã bỏ qua gói flagship. Các đòn bẩy quan trọng hơn con số gây chú ý: đầu vào được tái sử dụng tính phí $0,40 mỗi triệu qua bộ nhớ đệm prompt, API batch giảm xuống $2,00 / $10,00, và chế độ nhanh đánh đổi phí cao hơn 2x để lấy tốc độ nhanh hơn tới 2,5x. Trang này là tài liệu tham khảo giá cho riêng Sol — bảng giá chính xác, một yêu cầu thực sự tốn bao nhiêu, gói flagship so với các gói khác ra sao, khi nào thì không nên mua, và cách gọi nó thông qua một điểm cuối tương thích OpenAI bằng chính khóa của bạn.
Giá được tính trên mỗi triệu token (đầu vào / đầu ra), tính đến ngày 25-08-2026. Mức giảm — 20% cho đầu vào, khoảng 33% cho đầu ra, có hiệu lực đến ít nhất ngày 21 tháng 11 năm 2026 — là thông báo của chính OpenAI, được ghi nhận theo giá trị công bố; các con số bằng đô la được đọc từ biểu giá API đã công bố của OpenAI và được đối chiếu chéo với trang mô hình OrcaRouter cho GPT-5.6 Sol. Mức giá cho cache, batch, chế độ nhanh và ngữ cảnh dài đều do OpenAI công bố. Đây là các mức giá khuyến mãi, không phải là sự tái lập vĩnh viễn — giá có thể thay đổi và có thể tăng trở lại; hãy kiểm chứng trước khi xây dựng.
Giá chính xác, đã được xác minh hôm nay
Đây là bảng giá đầy đủ cho GPT-5.6 Sol, được xác minh vào ngày 2026-08-25 theo mức giá khuyến mãi. Các mức giá tương tự áp dụng cho các yêu cầu sử dụng bí danh gpt-5.6, và các mức giảm đang được triển khai cho các gói tín dụng ChatGPT Work và Codex đủ điều kiện; các gói đăng ký ChatGPT Pro, Plus và Business không thay đổi.

• Đầu vào — 4,00 USD cho mỗi 1M token khi cache miss (giảm từ 5,00 USD, giảm 20% đến hết ngày 21 tháng 11).
• Đầu ra — $20.00 mỗi 1 triệu token (giảm từ $30.00, giảm ~33% đến hết ngày 21 tháng 11).
• Đọc bộ nhớ đệm Prompt — $0.40 cho 1M token (trước đây là $0.50), giảm 90% cho bất kỳ đầu vào nào bạn gửi lại.
• Ghi cache prompt — $5.00 mỗi 1M token (trước đây là $6.25).
• Mức ngữ cảnh dài — các đầu vào vượt quá khoảng 272K token được tính phí $8.00 cho đầu vào / $30.00 cho đầu ra (trước đây là $10.00 / $45.00; các hệ số 2x cho đầu vào, 1.5x cho đầu ra tương tự hiện được áp dụng dựa trên mức cơ sở thấp hơn).
• Batch API — $2.00 đầu vào / $10.00 đầu ra, giảm cố định 50% (giá cũ: $2.50 / $15.00), bất đồng bộ, thường sẵn sàng trong khoảng 24 giờ.
• Chế độ nhanh — $8.00 đầu vào / $40.00 đầu ra (trước đây là $10.00 / $60.00), mức phí cao gấp 2 lần cho tốc độ đầu ra tăng lên đến khoảng 2.5x mà không thay đổi trí thông minh.
• Cửa sổ ngữ cảnh — ~1,05M token, tối đa 128K đầu ra.
OrcaRouter chuyển thẳng giá của nhà cung cấp mà không cộng phí, nên con số trên danh bạ chính là số tiền bạn trả — và mức giảm từ nhà cung cấp sẽ xuất hiện trên danh sách ngay trong ngày có hiệu lực. Trên trang mô hình trực tiếp, thẻ hiển thị $4.00 / $20.00 cho mỗi 1M, đọc cache $0.400, kèm các huy hiệu Vision, Tools, JSON và Reasoning. Đây là lần đầu tiên giá niêm yết của Sol thay đổi kể từ đợt giảm giá ngày 30 tháng 7, khi GPT-5.6 Luna xuống còn $0.20 / $1.20 và GPT-5.6 Terra xuống còn $2 / $12 trong khi mô hình chủ lực giữ nguyên; đợt giảm ngày 24 tháng 8 đến lượt mô hình chủ lực.
Các đòn bẩy làm thay đổi giá hiệu dụng
Tỷ lệ cơ bản chỉ là điểm khởi đầu. Bốn yếu tố điều chỉnh thay đổi chi phí thực tế bạn phải trả cho Sol:
Bộ nhớ đệm lời nhắc — ngữ cảnh tái sử dụng được tính phí 0,40 USD mỗi triệu token thay vì 4 USD cho ngữ cảnh mới, và ghi vào bộ nhớ đệm có chi phí 5,00 USD mỗi triệu token. Đối với bất kỳ agent hoặc cuộc trò chuyện nào gửi lại một tiền tố lớn trong mỗi lượt, bộ nhớ đệm là đòn bẩy lớn nhất duy nhất trên hóa đơn. OpenAI khóa bộ nhớ đệm theo từng dự án và khóa API, vì vậy việc ở trên một khóa (một kênh) là điều giúp các lượt truy cập trúng đích.
• Tầng ngữ cảnh dài — một yêu cầu có đầu vào vượt qua khoảng 272K token sẽ chuyển từ mức giá cơ bản lên $8 / $30. Một vài prompt lớn có thể âm thầm tăng giá trung bình của bạn, vì vậy hãy gộp hoặc cắt bớt khi bạn không thực sự cần ngữ cảnh sâu.
• Batch — API batch của OpenAI chạy các tác vụ không đồng bộ với thời gian hoàn tất khoảng 24 giờ và mức giá đúng bằng một nửa: $2,00 / $10,00, với đầu vào được lưu cache ở mức $0,20 và ghi cache ở mức $2,50. Nó có thể kết hợp với prompt caching và phù hợp với các bài đánh giá (evals), phân loại hàng loạt và tạo sinh ngoại tuyến khi độ trễ không quan trọng.
Chế độ nhanh — $8 / $40 cho thông lượng đầu ra lên tới ~2,5x, hữu ích cho các tác vụ nhạy cảm với độ trễ mà người dùng đang chờ đợi như hỗ trợ lập trình trực tiếp. Nó tính phí theo token với mức giá gấp 2 lần giá tiêu chuẩn, không tính vào các gói TPM Scale Tier đã mua và có thể chuyển về xử lý tiêu chuẩn nếu bạn vượt quá giới hạn tốc độ dùng chung.
Chi phí thực tế của một yêu cầu
Giá mỗi token mang tính trừu tượng, vì vậy dưới đây là các ví dụ cụ thể theo tỷ giá hiện tại:
• Một lần gọi chat, 50K đầu vào + 20K đầu ra — $0.20 + $0.40 = $0.60 (trước đây là $0.85).
• 1M đầu vào + 1M đầu ra — $4 + $20 = $24 (trước đây là $35).
Một lượt xử lý agentic, 200K ngữ cảnh được lưu trong bộ nhớ đệm + 20K đầu vào mới + 30K đầu ra — $0,08 + $0,08 + $0,60 = $0,76. Cùng một lượt xử lý với bộ nhớ đệm trống — 220K đầu vào mới với giá $0,88 cộng với $0,60 đầu ra — tổng cộng $1,48. Bộ nhớ đệm giúp giảm chi phí khoảng một nửa.
• Một tháng 10M token với tỷ lệ 70% đầu vào / 30% đầu ra, với 80% đầu vào được phục vụ từ cache: 1.4M đầu vào mới ($5.60) + 5.6M từ cache ($2.24) + 3M đầu ra ($60) ≈ $68. Khi không lưu cache, cùng tháng đó là $88 — và cùng tháng đó trên GPT-5.6 Terra có chi phí khoảng $50, hoặc khoảng $5 trên GPT-5.6 Luna. Khoảng cách ~14 lần giữa Sol và Luna chính là lý do tại sao việc khớp tầng quan trọng hơn bất kỳ mức giá đơn lẻ nào.
Hai lưu ý sau đây làm tăng mức giá thực tế. Sol là mô hình suy luận — các token suy luận nội bộ được tính như token đầu ra với giá 20 USD mỗi triệu token. Một prompt khó với cài đặt mức suy luận cao có thể dành một phần lớn ngân sách đầu ra cho việc suy nghĩ, nên chi phí đầu ra thực tế cho các tác vụ khó vượt xa mức ước tính thông thường. Và tokenizer của OpenAI tạo ra nhiều token hơn so với thế hệ trước trên một số đầu vào, nên cùng một văn bản có thể tốn nhiều token hơn so với khi chạy trên GPT-5.5. Hãy điều chỉnh mức suy luận cho phù hợp với từng tác vụ, giới hạn đầu ra khi có thể, và đo lường mức sử dụng thực tế trước khi dự tính hóa đơn.
Cách định giá của Sol so với các đối thủ

Được đọc dựa trên giá niêm yết công bố vào ngày 2026-08-25 (Sol ở mức giá khuyến mãi). Truyền thông đưa tin việc giảm giá là phản ứng trước áp lực định giá từ Anthropic và các phòng thí nghiệm Trung Quốc — đó là diễn giải của bên thứ ba, không phải tuyên bố của OpenAI.
• GPT-5.6 Terra — $2 / $12, bậc trung sau khi cắt giảm giá. Sol hiện có chi phí đầu vào đắt gấp 2 lần và đầu ra đắt gấp ~1,7 lần; Terra là lựa chọn mặc định khi bạn không cần khả năng suy luận hàng đầu.
• GPT-5.6 Luna — $0,20 / $1,20, mức khối lượng sau khi cắt giảm. Chênh lệch đầu vào gấp 20 lần so với Sol; Luna được định giá cho phần lớn lượng truy cập thông thường.
• Claude Opus 5 — $5 / $25. Sol hiện rẻ hơn 20% cho cả đầu vào và đầu ra trên danh nghĩa, so với việc ngang bằng Opus 5 về giá đầu vào ở mức giá cũ. So sánh này vốn đã nghiêng về Sol ngay cả trước khi cắt giảm: blog này trước đây đã đo Sol sử dụng ít hơn khoảng 34,5% token so với mô hình Anthropic trên cùng mẫu tiếng Anh/hỗn hợp, và một phân tích kinh tế token được công bố (TheBlockBeats) ước tính tổng chi phí của Sol có thể thấp hơn khoảng 21% so với Claude Opus 5 cho cùng khối lượng công việc tương đương, ngay cả khi mức giá đầu ra của Sol cao hơn. Hãy tự đo tokenizer của bạn, đừng nhìn vào giá niêm yết.
• Claude Fable 5 — $10 / $50. Sol hiện rẻ hơn 60% về đầu vào và rẻ hơn 60% về đầu ra so với gói cao cấp nhất của Anthropic (trước đây là 50% / 40% ở mức giá cũ).
• Claude Opus 4.8 — $5 / $25. Sol hiện rẻ hơn 20% cho đầu vào và rẻ hơn 20% cho đầu ra — lợi thế về giá niêm yết so với flagship thế hệ trước của Anthropic đã hoàn toàn đảo ngược.
• Grok 4.6 — $2 / $6. Con số ấn tượng nhất trên bảng: nó đã ngang bằng với GPT-5.6 Sol trên chỉ số Artificial Analysis (cả hai đều 61) với chi phí đầu vào rẻ hơn 2 lần và đầu ra rẻ hơn khoảng 3.3 lần, giảm so với mức chênh lệch 2.5x / 5x ở mức giá cũ.
• DeepSeek V4 Pro — $0.44 / $0.88 giờ thấp điểm (khung giờ cao điểm tăng gấp đôi). Một vũ trụ giá hoàn toàn khác biệt, dành cho phân khúc open-weights giá rẻ.
Nói thẳng ra: {{1}}Sol vẫn là một flagship cao cấp, nhưng đợt giảm giá đã kéo nó ra khỏi phân khúc giá cao nhất{{/1}} — mức giá output $20 hiện nay rẻ hơn mức $25 của Claude Opus 5 và mức $25 của Claude Opus 4.8, khiến mức $50 của Claude Fable 5 trở thành mức giá output flagship đóng duy nhất cao hơn nó. Nó thắng nhờ chi phí hiệu quả trên mỗi đơn vị công việc khó (tokenizer, khả năng suy luận, ngữ cảnh dài của nó) chứ không phải ở mức giá tuyệt đối, và đợt giảm giá ngày 24 tháng 8 càng củng cố lập luận đó. {{2}}Nếu lưu lượng của bạn là các prompt ngắn và tác vụ đơn giản, Terra $2, Luna $0,20, hoặc Grok 4.6 giá $2 / $6 vẫn là lựa chọn rẻ hơn{{/2}} — và trên bảng chỉ số, Grok 4.6 không thua kém gì trên lý thuyết.
Khi Sol là lựa chọn sai
Bốn trường hợp mà mức giá này không phải là mức giá bạn muốn:
Lời nhắc ngắn, đơn giản. Với lời nhắc dưới khoảng 20K token và không cần suy luận sâu, mô hình cao cấp hàng đầu là lãng phí. GPT-5.6 Terra với giá $2 / $12 hoặc GPT-5.6 Luna với giá $0.20 / $1.20 đáp ứng phân khúc khối lượng với chi phí chỉ bằng một phần nhỏ, và mô hình Grok 4.6 hoặc loại DeepSeek lại còn rẻ hơn nữa.
Khối lượng thiên về suy luận. Vì suy nghĩ được tính phí như đầu ra, một prompt khó ở mức nỗ lực cao có thể tốn kém vượt xa mức đầu ra danh nghĩa. Nếu khối lượng công việc của bạn gồm nhiều lệnh gọi khó, hãy đo token đầu ra thực tế trước khi cam kết — mức giá thực tế có thể khiến bạn bất ngờ.
Giá mỗi token là mục tiêu duy nhất. Grok 4.6 hòa Sol trên chỉ số ở mức $2 / $6, còn DeepSeek V4 Pro ở mức $0.44 / $0.88 ngoài giờ cao điểm. Nếu điểm chuẩn tiên phong không phải là yêu cầu bắt buộc, các mô hình đó đem lại mức giá mỗi token thấp hơn nhiều cho cùng loại công việc.
Ngân sách độ trễ nghiêm ngặt. Sol là một mô hình lý luận lớn, do đó thời gian đến token đầu tiên chạy cao hơn hẳn so với mô hình hạng Flash. Đối với trò chuyện thời gian thực nơi TTFT dưới giây là yếu tố quan trọng, chế độ nhanh ở mức $8 / $40 mang lại thông lượng, không phải độ trễ token đầu tiên thấp hơn — và một mô hình nhỏ hơn vẫn là giải pháp rẻ hơn.
Cách gọi nó trên OrcaRouter

GPT-5.6 Sol được lưu trữ trên OrcaRouter với ID mô hình openai/gpt-5.6-sol, được phục vụ qua endpoint tương thích OpenAI tại api.orcarouter.ai/v1 theo mức giá của nhà cung cấp, không tăng giá. Nếu bạn đã có một client OpenAI, việc chuyển đổi chỉ là thay đổi URL gốc và ID mô hình — không gì khác. Cùng một khóa và endpoint hỗ trợ hơn 200 mô hình, nên Sol nằm cạnh GPT-5.6 Terra, GPT-5.6 Luna, Claude Opus 5, Claude Fable 5, Grok 4.6 và các mô hình open-weight mà bạn muốn so sánh với nó, đồng thời bạn có thể định tuyến theo độ khó thay vì phải tích hợp lại từng mô hình.
Hai điểm đặc thù của OrcaRouter đáng nêu trên trang giá. BYOK: tự mang khóa OpenAI của bạn và OpenAI lập hóa đơn trực tiếp cho bạn theo biểu phí riêng của họ — OrcaRouter thêm $0 mỗi token và giữ nguyên hạn mức tốc độ và tín dụng của nhà cung cấp. Guardrails: PII Shield và chính sách nội dung chạy trước khi lập hóa đơn, vì vậy yêu cầu bị chặn trả về mã 400 rõ ràng và không bao giờ bị tính phí, đồng thời Agent Firewall đánh giá các lời gọi công cụ và MCP trước khi chúng thực thi.
Lưu ý về sự trung thực quan trọng đối với trang giá: chúng tôi định tuyến mô hình, chúng tôi không đặt giá của nó. Con số $4 / $20 là mức giá khuyến mãi của OpenAI được chuyển tiếp — và khi OpenAI thay đổi nó vào ngày 24 tháng 8, danh sách cũng được cập nhật cùng ngày, chính vì vậy trang này được đóng dấu ngày. Nếu bạn gọi trực tiếp cho OpenAI, bạn sẽ nhận được mức giá tương tự; OrcaRouter tồn tại để cung cấp tuyến một khóa, không thêm phí nếu bạn muốn một endpoint duy nhất trên toàn bộ dòng mô hình.
Nguồn và ngày tháng
Tất cả mức giá nêu trên đã được xác minh vào ngày 2026-08-25. Các số liệu về GPT-5.6 Sol được lấy từ bảng giá API do OpenAI công bố, được đối chiếu chéo với trang mô hình OrcaRouter dành cho GPT-5.6 Sol (kiểm tra cùng ngày) và báo chí đưa tin về đợt giảm giá ngày 24 tháng 8 (Indian Express, Economic Times, The Star); các mức giá cho batch, fast-mode, cache-write và long-context đều do OpenAI công bố. Các số liệu về Claude, Grok và DeepSeek là danh mục hiện hành trên OrcaRouter, trong đó DeepSeek V4 Pro được hiển thị theo mức giá giờ thấp điểm. Giá niêm yết của Sol vẫn giữ nguyên từ khi ra mắt ngày 9 tháng 7 cho đến đợt giảm giá ngày 30 tháng 7 và lần đầu tiên thay đổi vào ngày 24 tháng 8 với chương trình khuyến mãi này — chính vì vậy mà ngày tháng rất quan trọng ở đây: các mức giá $4 / $20 chỉ là tạm thời và giá có thể thay đổi; hãy đối chiếu ngày tháng trên bất kỳ trang "GPT-5.6 Sol pricing" nào bạn tìm thấy, dù trước hay sau thời điểm này. Các con số tại đây là số liệu hiện hành tính đến hôm nay.
Mọi mức giá trên đây là tỷ giá thời gian thực trên GPT-5.6 Sol on OrcaRouter — được kiểm tra ngày 2026-08-25 với mức phụ phí bằng 0, sẵn sàng cho khóa riêng của bạn.
So sánh trong bài viết này2
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
