
Giá API GPT-5.6 Sol: $5 / $30 mỗi 1 triệu token, cache ở mức $0,50, và chi phí thực tế là bao nhiêu
- DeepSeekMỚIDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 trên 1 triệu token
- z-aiMỚIZ.ai: GLM 5.32026-08-1860Trí tuệ75Lập trình
- obsidianMỚIQwen3.8 27B2026-08-1552Trí tuệ68Lập trình
- qwenMỚIQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekMỚIDeepSeek: DeepSeek V4 Pro 08132026-08-1253Trí tuệ69Lập trình
- grokMỚISpaceXAI: Grok 4.62026-08-1261Trí tuệ77Lập trình
- metaMeta: Muse Spark 1.22026-08-0557Trí tuệ72Lập trình
- qwenQwen: Qwen3.8 Max2026-08-0358Trí tuệ72Lập trình
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Trí tuệ69Lập trình
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 trên 1 triệu token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Trí tuệ78Lập trình
- googleGoogle: Gemini 3.6 Flash2026-07-2152Trí tuệ69Lập trình
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Trí tuệ49Lập trình
- metaMeta: Muse Spark 1.12026-07-1653Trí tuệ71Lập trình
- kimiMoonshotAI: Kimi K32026-07-1560Trí tuệ76Lập trình
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Trí tuệ71Lập trình
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Trí tuệ77Lập trình
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Trí tuệ77Lập trình
GPT-5.6 Sol có giá 5,00 USD cho mỗi triệu token đầu vào và 30,00 USD cho mỗi triệu token đầu ra trên API GPT-5.6 Sol — cùng mức giá mà bậc cao cấp nhất (flagship) có trong danh mục OrcaRouter, được kiểm tra vào ngày 2026-08-18, không tính phí chênh lệch. Đây là bậc đắt nhất trong gia đình GPT-5.6 và là bậc duy nhất có giá niêm yết không thay đổi trong đợt cắt giảm ngày 30 tháng 7, vì vậy bảng giá trên trang mô hình GPT-5.6 Sol trực tiếp là tài liệu bạn nên dùng để dự toán. Các tùy chọn điều chỉnh quan trọng hơn con số chính: token đầu vào được tái sử dụng tính phí 0,50 USD mỗi triệu thông qua bộ nhớ đệm prompt, API batch giảm xuống còn 2,50 USD / 15,00 USD, và chế độ nhanh đánh đổi phí cộng thêm gấp 2 lần để có tốc độ nhanh hơn tới 2,5 lần. Trang này là tài liệu tham khảo giá dành riêng cho Sol — bảng giá chính xác, chi phí thực tế của một yêu cầu, bậc cao cấp nhất so với các lựa chọn khác, khi nào không nên mua, và cách gọi nó qua một điểm cuối tương thích OpenAI với chính khóa của bạn.
Giá được tính theo triệu token (đầu vào / đầu ra), tính đến ngày 2026-08-18. Các số liệu tính bằng đô la được lấy từ biểu giá API công bố của OpenAI và được đối chiếu chéo với trang mô hình OrcaRouter cho GPT-5.6 Sol; giá cho bộ nhớ đệm (cache), xử lý theo lô (batch), chế độ nhanh và ngữ cảnh dài là do OpenAI công bố. Giá có thể thay đổi — hãy kiểm tra trước khi xây dựng.
Giá chính xác, đã được xác minh hôm nay
Đây là bảng giá đầy đủ cho GPT-5.6 Sol, đã xác minh ngày 2026-08-18:

• Đầu vào — $5.00 cho mỗi 1M token khi cache miss.
• Đầu ra — $30.00 cho mỗi 1M token.
• Đọc bộ nhớ đệm prompt — $0.50 mỗi 1M token, giảm 90% cho bất kỳ dữ liệu đầu vào nào bạn gửi lại.
• Ghi cache prompt — $6,25 cho mỗi 1 triệu token.
• Gói ngữ cảnh dài — đầu vào vượt khoảng 272K token sẽ được tính phí $10.00 cho đầu vào / $45.00 cho đầu ra (gấp 2 lần đầu vào, 1.5 lần đầu ra).
• Batch API — $2.50 đầu vào / $15.00 đầu ra, giảm cố định 50%, bất đồng bộ, thường sẵn sàng trong khoảng 24 giờ.
• Chế độ nhanh — $10,00 đầu vào / $60,00 đầu ra, mức phí cao gấp 2 lần cho tốc độ đầu ra nhanh hơn tới khoảng 2,5 lần mà trí thông minh không đổi.
• Cửa sổ ngữ cảnh — ~1,05M token, tối đa 128K đầu ra.
OrcaRouter chuyển tiếp mức giá của nhà cung cấp mà không cộng thêm phí, vì vậy con số trên danh bạ chính là con số bạn phải trả. Trên trang mô hình trực tiếp, thẻ ghi $5.00 / $30.00 mỗi 1M, đọc cache $0.500, với các huy hiệu Vision, Tools, JSON và Reasoning. Mức giá $5 / $30 của Sol cũng là mức giá trước khi cắt giảm: mức giảm ngày 30 tháng 7 của OpenAI áp dụng cho GPT-5.6 Luna (nay là $0.20 / $1.20) và GPT-5.6 Terra (nay là $2 / $12), trong khi mô hình hàng đầu vẫn giữ nguyên.
Các đòn bẩy làm thay đổi giá hiệu dụng
Tỷ lệ cơ bản chỉ là điểm khởi đầu. Bốn yếu tố điều chỉnh thay đổi chi phí thực tế bạn phải trả cho Sol:
• Bộ nhớ đệm lời nhắc — ngữ cảnh tái sử dụng được tính phí 0,50 USD mỗi triệu thay vì 5 USD cho dữ liệu mới, và ghi vào bộ nhớ đệm có giá 6,25 USD mỗi triệu. Đối với bất kỳ tác nhân hoặc cuộc trò chuyện nào gửi lại một tiền tố lớn trong mỗi lượt, bộ nhớ đệm là đòn bẩy lớn nhất trên hóa đơn. OpenAI khóa bộ nhớ đệm theo từng dự án và khóa API, vì vậy giữ nguyên một khóa (một kênh) là điều giúp các lần trúng khớp liên tục.
• Mức ngữ cảnh dài — một yêu cầu có đầu vào vượt qua khoảng 272K token sẽ chuyển từ mức giá cơ bản lên $10 / $45. Một vài lời nhắc lớn có thể âm thầm làm tăng giá trung bình của bạn, vì vậy hãy gộp hoặc cắt ngắn khi bạn không thực sự cần ngữ cảnh sâu.
• Batch — API batch của OpenAI chạy các tác vụ không đồng bộ với thời gian xử lý khoảng 24 giờ, giá chỉ bằng đúng một nửa: $2.50 / $15.00, với input được lưu cache ở mức $0.25 và ghi cache ở mức $3.13. Nó kết hợp được với prompt caching và phù hợp với evals, phân loại hàng loạt và tạo nội dung ngoại tuyến khi độ trễ không quan trọng.
• Chế độ nhanh — $10 / $60 cho thông lượng đầu ra lên tới ~2.5x, hữu ích cho các tác vụ nhạy cảm với độ trễ, nơi người dùng phải chờ đợi như hỗ trợ lập trình trực tiếp. Tính phí theo token với mức gấp 2 lần giá tiêu chuẩn, không tính vào các gói TPM Scale Tier đã mua và có thể quay lại xử lý tiêu chuẩn nếu bạn vượt quá giới hạn tỷ lệ dùng chung.
Chi phí thực tế của một yêu cầu
Giá mỗi token mang tính trừu tượng, vì vậy dưới đây là các ví dụ cụ thể theo tỷ giá hiện tại:
• Cuộc gọi chat đơn, 50K đầu vào + 20K đầu ra — $0.25 + $0.60 = $0.85.
• 1 triệu đầu vào + 1 triệu đầu ra — $5 + $30 = $35.
• Lượt tác nhân, 200K ngữ cảnh được lưu trong bộ nhớ đệm + 20K đầu vào mới + 30K đầu ra — $0.10 + $0.10 + $0.90 = $1.10. Cùng lượt đó với bộ nhớ đệm lạnh — 220K đầu vào mới với giá $1.10 — tổng cộng là $2.00. Bộ nhớ đệm giúp giảm gần một nửa chi phí.
• Một tháng 10 triệu token với tỷ lệ 70% đầu vào / 30% đầu ra, với 80% đầu vào được phục vụ từ bộ nhớ đệm: 1,4 triệu token đầu vào mới ($7.00) + 5,6 triệu token từ bộ nhớ đệm ($2.80) + 3 triệu token đầu ra ($90) ≈ $100. Nếu không dùng bộ nhớ đệm, cùng tháng đó sẽ là $125 — còn cùng tháng đó trên GPT-5.6 Terra tốn khoảng $50, hoặc khoảng $5 trên GPT-5.6 Luna. Mức chênh lệch gấp 20 lần giữa Sol và Luna chính là lý do khiến việc khớp đúng tầng dịch vụ quan trọng hơn bất kỳ mức giá đơn lẻ nào.
Hai lưu ý làm tăng mức giá thực tế. Sol là một mô hình suy luận — các token suy luận nội bộ được tính phí như đầu ra với giá 30 đô la mỗi triệu. Một prompt khó ở mức nỗ lực suy luận cao có thể tiêu tốn phần lớn ngân sách đầu ra cho việc suy nghĩ, vì vậy chi phí đầu ra thực tế cho các tác vụ khó cao hơn hẳn so với ước tính đơn giản. Và bộ tokenizer của OpenAI dài dòng hơn so với thế hệ trước trên một số đầu vào, nên cùng một văn bản có thể tốn nhiều token hơn so với trên GPT-5.5. Hãy điều chỉnh mức nỗ lực suy luận theo tác vụ, giới hạn đầu ra nếu có thể, và đo lường mức sử dụng thực tế trước khi dự tính hóa đơn.
Cách định giá của Sol so với các đối thủ

Đối chiếu với giá niêm yết công bố vào ngày 2026-08-18:
• GPT-5.6 Terra — $2 / $12, phân khúc trung bình sau khi cắt giảm. Sol có chi phí cao gấp 2.5 lần cho cả đầu vào và đầu ra; Terra là lựa chọn mặc định khi bạn không cần khả năng suy luận cao cấp.
• GPT-5.6 Luna — 0,20 USD / 1,20 USD, mức giá theo khối lượng sau khi cắt giảm. Chênh lệch đầu vào gấp 25 lần so với Sol; Luna được định giá cho phần lớn lưu lượng truy cập thông thường.
• Claude Opus 5 — 5 đô la / 25 đô la. Cùng đầu vào, đầu ra rẻ hơn 20% trên giấy tờ. Trên thực tế, so sánh này đảo ngược đối với một số khối lượng công việc: blog này trước đây đã đo Sol dùng khoảng 34,5% ít token hơn so với mô hình Anthropic trên cùng mẫu tiếng Anh/hỗn hợp, và một phân tích kinh tế token đã công bố (TheBlockBeats) ước tính tổng hóa đơn của Sol có thể thấp hơn khoảng 21% so với Claude Opus 5 cho công việc tương đương dù tỷ lệ đầu ra cao hơn. Hãy đo tokenizer của riêng bạn, không phải giá niêm yết.
• Claude Fable 5 — $10 / $50. Sol có giá đầu vào bằng một nửa và giá đầu ra rẻ hơn 40% so với mức cao nhất của Anthropic.
• Claude Opus 4.8 — $5 / $25. Cùng đầu vào với Sol, đầu ra rẻ hơn — flagship thế hệ trước của Anthropic.
• Grok 4.6 — $2 / $6. Con số ấn tượng nhất trên bảng: nó sánh ngang với GPT-5.6 Sol trên chỉ số Artificial Analysis (cả hai đều đạt 61) với giá đầu vào rẻ hơn 2,5 lần và giá đầu ra rẻ hơn 5 lần.
• DeepSeek V4 Pro — $0.44 / $0.88 giờ thấp điểm (khung giờ cao điểm tăng gấp đôi). Một vũ trụ giá hoàn toàn khác biệt, dành cho phân khúc open-weights giá rẻ.
Cách diễn giải trung thực: Sol là một flagship cao cấp với tốc độ đầu ra cao cấp — cao nhất trong số các flagship đóng dưới Claude Fable 5. Nó thắng ở chi phí hiệu quả trên mỗi đơn vị công việc khó (tokenizer, khả năng suy luận, ngữ cảnh dài) thay vì tốc độ tuyệt đối. Nếu lưu lượng truy cập của bạn là các prompt ngắn và tác vụ đơn giản, một chiếc Terra giá $2, Luna giá $0.20, hoặc Grok 4.6 giá $2 / $6 là lựa chọn rẻ hơn — và trên bảng xếp hạng, Grok 4.6 không thua kém gì trên giấy tờ.
Khi Sol là lựa chọn sai
Bốn trường hợp mà mức giá này không phải là mức giá bạn muốn:
Lời nhắc ngắn, đơn giản. Với lời nhắc dưới khoảng 20K token và không cần suy luận sâu, mô hình cao cấp hàng đầu là lãng phí. GPT-5.6 Terra với giá $2 / $12 hoặc GPT-5.6 Luna với giá $0.20 / $1.20 đáp ứng phân khúc khối lượng với chi phí chỉ bằng một phần nhỏ, và mô hình Grok 4.6 hoặc loại DeepSeek lại còn rẻ hơn nữa.
Khối lượng thiên về suy luận. Vì suy nghĩ được tính phí như đầu ra, một prompt khó ở mức nỗ lực cao có thể tốn kém vượt xa mức đầu ra danh nghĩa. Nếu khối lượng công việc của bạn gồm nhiều lệnh gọi khó, hãy đo token đầu ra thực tế trước khi cam kết — mức giá thực tế có thể khiến bạn bất ngờ.
Giá mỗi token là mục tiêu duy nhất. Grok 4.6 hòa Sol trên chỉ số ở mức $2 / $6, còn DeepSeek V4 Pro ở mức $0.44 / $0.88 ngoài giờ cao điểm. Nếu điểm chuẩn tiên phong không phải là yêu cầu bắt buộc, các mô hình đó đem lại mức giá mỗi token thấp hơn nhiều cho cùng loại công việc.
Hạn mức độ trễ nghiêm ngặt.Sol là một mô hình suy luận lớn, vì vậy thời gian đến token đầu tiên (time-to-first-token) cao hơn hẳn so với mô hình hạng Flash. Đối với trò chuyện thời gian thực, nơi TTFT dưới một giây là yếu tố quan trọng, chế độ nhanh ở mức $10 / $60 mang lại thông lượng, chứ không giảm độ trễ của token đầu tiên — và một mô hình nhỏ hơn vẫn là giải pháp rẻ hơn.
Cách gọi nó trên OrcaRouter

GPT-5.6 Sol được lưu trữ trên OrcaRouter với ID mô hình openai/gpt-5.6-sol, được phục vụ qua endpoint tương thích OpenAI tại api.orcarouter.ai/v1 theo mức giá của nhà cung cấp, không tăng giá. Nếu bạn đã có một client OpenAI, việc chuyển đổi chỉ là thay đổi URL gốc và ID mô hình — không gì khác. Cùng một khóa và endpoint hỗ trợ hơn 200 mô hình, nên Sol nằm cạnh GPT-5.6 Terra, GPT-5.6 Luna, Claude Opus 5, Claude Fable 5, Grok 4.6 và các mô hình open-weight mà bạn muốn so sánh với nó, đồng thời bạn có thể định tuyến theo độ khó thay vì phải tích hợp lại từng mô hình.
Hai điểm đặc thù của OrcaRouter đáng nêu trên trang giá. BYOK: tự mang khóa OpenAI của bạn và OpenAI lập hóa đơn trực tiếp cho bạn theo biểu phí riêng của họ — OrcaRouter thêm $0 mỗi token và giữ nguyên hạn mức tốc độ và tín dụng của nhà cung cấp. Guardrails: PII Shield và chính sách nội dung chạy trước khi lập hóa đơn, vì vậy yêu cầu bị chặn trả về mã 400 rõ ràng và không bao giờ bị tính phí, đồng thời Agent Firewall đánh giá các lời gọi công cụ và MCP trước khi chúng thực thi.
Ghi chú trung thực quan trọng cho trang giá: chúng tôi định tuyến mô hình, chúng tôi không định giá cho nó. Mức $5 / $30 là giá của OpenAI được truyền thẳng, và khi OpenAI thay đổi, bảng giá cũng thay đổi theo — đây chính là lý do trang này được đóng dấu ngày. Nếu bạn gọi trực tiếp OpenAI, bạn sẽ nhận được mức giá tương tự; OrcaRouter tồn tại cho hướng một khóa, không tăng phí nếu bạn muốn một điểm cuối duy nhất cho toàn bộ dòng mô hình.
Nguồn và ngày tháng
Tất cả mức giá nêu trên đã được xác minh vào ngày 2026-08-18. Số liệu GPT-5.6 Sol được lấy từ bảng giá API do OpenAI công bố và được đối chiếu chéo với trang mô hình OrcaRouter dành cho GPT-5.6 Sol (kiểm tra cùng ngày) cũng như các trang giá GPT-5.6 do chúng tôi công bố. Các mức giá batch, fast-mode, cache-write và ngữ cảnh dài đều do OpenAI công bố. Số liệu Claude, Grok và DeepSeek là các mục trong danh bạ hiện hành của OrcaRouter, trong đó DeepSeek V4 Pro được hiển thị theo mức giá ngoài giờ cao điểm. OpenAI chưa thay đổi giá niêm yết của Sol kể từ khi ra mắt vào ngày 9 tháng 7 năm 2026 — đợt giảm giá ngày 30 tháng 7 không ảnh hưởng đến mẫu flagship — nhưng giá có thể biến động; khi gặp bất kỳ trang "GPT-5.6 Sol pricing" cũ nào, hãy kiểm tra ngày trên trang đó. Các con số ở đây là hiện hành tính đến hôm nay.
Mọi mức giá ở trên là tỷ giá trực tiếp trên GPT-5.6 Sol on OrcaRouter — được kiểm tra ngày 2026-08-18 với mức chênh lệch bằng không, sẵn sàng cho khóa riêng của bạn.
So sánh trong bài viết này3
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
