
GPT-5.6 Terra so với Sol: Bạn thực sự cần gói nào?
- z-aiMỚIZ.ai: GLM 5.32026-08-1860Trí tuệ75Lập trình
- obsidianMỚIQwen3.8 27B Uncensored (Aggressive)2026-08-1552Trí tuệ68Lập trình
- qwenMỚIQwen: Qwen3.8 27B (free)2026-08-1341 tok/s
- deepseekMỚIDeepSeek: DeepSeek V4 Pro 08132026-08-1253Trí tuệ69Lập trình
- grokMỚISpaceXAI: Grok 4.62026-08-1261Trí tuệ77Lập trình
- metaMỚIMeta: Muse Spark 1.22026-08-0557Trí tuệ72Lập trình
- qwenQwen: Qwen3.8 Max2026-08-0358Trí tuệ72Lập trình
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Trí tuệ69Lập trình
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 trên 1 triệu token · 237 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Trí tuệ78Lập trình
- googleGoogle: Gemini 3.6 Flash2026-07-2152Trí tuệ69Lập trình
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Trí tuệ49Lập trình
- metaMeta: Muse Spark 1.12026-07-1653Trí tuệ71Lập trình
- kimiMoonshotAI: Kimi K32026-07-1560Trí tuệ76Lập trình
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Trí tuệ71Lập trình
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Trí tuệ77Lập trình
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Trí tuệ77Lập trình
- grokxAI: Grok 4.52026-07-0856Trí tuệ72Lập trình
Đối với hầu hết khối lượng công việc API, câu trả lời là GPT-5.6 Terra: với mức giá $2 mỗi triệu token đầu vào và $12 mỗi triệu token đầu ra, nó xử lý 10 triệu token mỗi tháng điển hình với chi phí khoảng $50, nằm trong khoảng một đến hai điểm so với GPT-5.6 Sol trên các điểm chuẩn độc lập quan trọng nhất, và mức giá $2 / $12 của nó vẫn giữ nguyên khi đi sâu hơn gấp tám lần vào vùng ngữ cảnh dài. GPT-5.6 Sol — $5 / $30, phiên bản hàng đầu — là bậc bạn chỉ nên nâng cấp lên khi các bài đánh giá của riêng bạn cho thấy Terra thất bại trong các tác vụ khó và có giá trị cao. Cả hai bậc hiện đang khả dụng trên OrcaRouter ở mức giá niêm yết với $0 phụ phí mỗi token, và với hình thức mang khóa riêng (bring-your-own-key), yêu cầu sẽ được tính phí trực tiếp vào tài khoản hiện có của bạn.
Đây là hướng dẫn "cái nào tôi thực sự cần", không phải bảng giá — bảng giá chi tiết sau khi cắt giảm cho cả ba gói nằm trong bài viết đi kèm về giá của GPT-5.6 Luna, Terra và Sol. GPT-5.6 Sol và GPT-5.6 Terra đều phát hành ngày 9 tháng 7 năm 2026, có chung cửa sổ ngữ cảnh khoảng 1,05 triệu token và đầu ra tối đa 128K, và có mức giá chênh lệch đủ lớn để chọn sai là một khoản mục gấp 2,5 lần trên hóa đơn của bạn. Đây là quyết định kèm số liệu.
Thang ba tầng, vắn tắt
Dòng GPT-5.6 của OpenAI là một chiếc thang ba bậc, và biết rõ bậc nào là bậc nào giúp việc so sánh ở bậc giữa trở nên trung thực:
• GPT-5.6 Sol — phiên bản chủ lực. $5 / $30, được xây dựng cho các tác vụ suy luận khó nhất, kỹ thuật phần mềm quy mô lớn và công việc tác tử tầm xa.
• GPT-5.6 Terra — lựa chọn cân bằng ở giữa. $2 / $12, mức này mang lại khả năng tương đương GPT-5.5 với chi phí chỉ bằng một phần nhỏ so với giá của phiên bản flagship.
• GPT-5.6 Luna — mức khối lượng. $0.20 / $1.20, được định giá cho các cuộc gọi khối lượng lớn, nhạy cảm về độ trễ: trò chuyện, phân loại, trích xuất, định tuyến.
Cả ba đều là mô hình suy luận với ngữ cảnh ~1.05M token và đầu ra tối đa 128K, vì vậy sự lựa chọn xoay quanh chi phí và năng lực ở mức cận biên, chứ không phải về những gì các mô hình có thể đọc. Bậc Luna thì dễ chọn (vì nó là bản rẻ) và vai trò của Sol cũng đã rõ (vì nó là bản chủ lực) — quyết định thực sự cần phân tích là Terra so với Sol, bởi vì đó là hai bậc có sự chồng lấn.
Đối đầu trực tiếp: nơi hai bên thực sự khác biệt
Trên bảng xếp hạng Artificial Analysis độc lập (được đánh giá vào ngày 9 tháng 7 năm 2026, ngày ra mắt), hai phân khúc gần nhau hơn nhiều so với mức giá mà chúng gợi ý. Về lập trình — con số mà cộng đồng agent hay trích dẫn — AA Coding đạt 77.4 cho GPT-5.6 Sol (#2/132) so với 76.7 cho GPT-5.6 Terra (#4/132), còn trên Terminal-Bench 2.1 cả hai đều đạt chính xác 88.0. Trên benchmark agent đa lượt τ²-Bench, Terra thậm chí nhỉnh hơn Sol, 86.3 vs 85.1. Khoảng cách chỉ thực sự rõ rệt khi tác vụ thực sự khó: AA Intelligence Index 60.9 (Sol) vs 56.6 (Terra), và Humanity's Last Exam 49.5 vs 42.9 — một khoảng cách 6.6 điểm, chính xác là phần chênh lệch kiến thức sâu mà flagship đáng lẽ phải đạt được.

Cách đọc thực tế: đối với công việc thường nhật — chat, RAG, trích xuất, viết mã tiêu chuẩn — các tầng hầu như không thể phân biệt được, điều này khớp với kết luận từ nghiên cứu điển hình về thang tầng của chúng tôi, trong đó GPT-5.6 Terra đã hoàn thành 11/11 cuộc gọi thử nghiệm với độ trễ trung vị thấp hơn GPT-5.6 Sol. Sự khác biệt thể hiện rõ ở ranh giới, trong phân khúc nhiệm vụ khó nhất.
Chênh lệch giá thực sự mang lại cho bạn điều gì?
Phép tính giá niêm yết: GPT-5.6 Sol là $5 / $30 cho mỗi triệu token; GPT-5.6 Terra là $2 / $12 — gấp 2,5 lần ở cả hai chiều. Nhưng ranh giới bậc giá làm thay đổi bức tranh. Mức giá cơ bản $2 / $12 của Terra áp dụng cho đầu vào lên đến 272K token; mức giá cơ bản $5 / $30 của Sol chỉ áp dụng cho đầu vào lên đến 32K token đầu vào, trên mức đó, nó chuyển sang mức $10 / $45 trong khi Terra chuyển sang mức $4 / $18. Đối với một prompt 100K token — một tài liệu dài hoặc một ngữ cảnh tác tử lớn — Terra vẫn đang ở mức giá rẻ trong khi Sol đã chuyển sang bậc ngữ cảnh dài.

Bộ nhớ đệm prompt thu hẹp khoảng cách một chút: chi phí đọc bộ nhớ đệm của Sol là $0,50 mỗi triệu so với $5 cho dữ liệu mới, và của Terra là $0,20 so với $2 cho dữ liệu mới, với chi phí ghi bộ nhớ đệm lần lượt là $6,25 và $2,50. Ví dụ minh họa: một tháng sử dụng 10 triệu token với tỷ lệ đầu vào/đầu ra 70/30 tốn khoảng $125 trên Sol và $50 trên Terra — khớp với máy tính chi phí trên trang của OrcaRouter — và với 50 triệu đầu vào cộng 10 triệu đầu ra, hóa đơn là $550 trên Sol so với $220 trên Terra theo mức giá sau khi giảm.
Mặc định: chọn Terra và điều chỉnh mức độ suy luận.
Khuyến nghị của tôi: hãy đặt gpt-5.6-terra làm model id mặc định của bạn và tăng cấp theo khối lượng công việc, không theo stack. Lập luận mạnh nhất cho trường hợp này đến từ hướng dẫn apidog GPT-5.6: với các câu hỏi thông thường, người dùng không thể phân biệt Sol với Terra, và Terra với mức reasoning effort cao hơn sẽ thu hẹp phần lớn khoảng cách chất lượng so với Sol ở mức effort trung bình — với chi phí token chỉ bằng một nửa. Một điểm đánh đổi có thể đo lường được của Terra là thời gian đến token đầu tiên: trên các trang model, p50 TTFT của Terra là 3.66s trong khi của Sol là 2.44s, với Terra có tốc độ xuất 128 token/s so với 246 của Sol — phù hợp với hầu hết khối lượng công việc, đáng lưu ý cho các agent nhạy cảm về độ trễ.
Một cạm bẫy bí danh: chuỗi mô hình trần gpt-5.6 định tuyến đến Sol — bậc đắt nhất — nên hãy chỉ định rõ gpt-5.6-terra một cách tường minh trong mọi lời gọi, nếu không thì một mặc định ngầm sẽ khiến toàn bộ phân tích này trở nên vô nghĩa.
Khi Sol xứng đáng với mức giá cao hơn
Lý do để trả mức phí gấp 2,5 lần tuy hạn hẹp nhưng có thật. Hãy nâng cấp lên gpt-5.6-solkhi: đánh giá của riêng bạn cho thấy Terra thất bại trên một phần đáng kể các tác vụ khó — khoảng cách AA Intelligence (60,9 so với 56,6) và khoảng cách Humanity's Last Exam (49,5 so với 42,9) chính là nơi phần huấn luyện bổ sung của Sol thể hiện rõ; bạn vận hành các tác nhân đa bước phức tạp mà chỉ cần một bước thất bại là hậu quả cộng dồn, nên chi phí của một sai lầm vượt quá khoản chi suy luận tăng thêm; hoặc bạn cần khả năng suy luận tiên phong cho những công việc thực sự có giá trị cao nhưng tần suất thấp. Sol được xếp hạng #2 thế giới về lập trình trên Artificial Analysis và #4 về trí tuệ trong bài đánh giá tại thời điểm ra mắt — khi một tác vụ đủ khó, thứ hạng đó chính là thứ bạn đang trả tiền.
Khi khuyến nghị này sai
Ba ranh giới trung thực. Thứ nhất, "Terra là mặc định" giả định rằng Terra hiếm khi thất bại; nếu vòng lặp agent của bạn cho thấy dù chỉ vài phần trăm bước thất bại trên Terra nhưng thành công trên Sol, các lỗi sẽ cộng dồn và Sol có thể rẻ hơn về tổng thể — hãy chạy bản đánh giá, đừng giả định. Thứ hai, phép toán ngữ cảnh dài là dao hai lưỡi: bậc cơ bản rộng hơn của Terra khiến nó chiến thắng với prompt dài, nhưng với prompt ngắn thì khoảng cách giá niêm yết là toàn bộ câu chuyện, và một bậc "rẻ" nhưng suy luận nhiều có thể tiêu tốn nhiều hơn một flagship được chỉnh giảm xuống — token suy luận được tính phí như output. Thứ ba, ranh giới trung thực về những gì chúng tôi có thể hứa: OrcaRouter định tuyến và tính phí với mức đội giá $0, nhưng OpenAI vận hành các trọng số — các con số benchmark là các giá trị Artificial Analysis trên trang mô hình từ bản đánh giá ngày ra mắt, còn chất lượng suy luận và hành vi an toàn là của OpenAI, không phải của chúng tôi.
Một endpoint, cả ba cấp độ, $0 chênh lệch giá
Nếu bạn đang so sánh các hạng GPT-5.6, bạn đã có sẵn một tích hợp hoặc sắp viết một cái, và chi phí thực sự là duy trì nó. OrcaRouter đặt GPT-5.6 Sol, GPT-5.6 Terra, GPT-5.6 Luna, và 200+ mô hình khác đằng sau một endpoint tương thích OpenAI: cùng base URL, cùng client, và một model id cho mỗi hạng — gpt-5.6-sol hôm nay, gpt-5.6-terra khi khối lượng công việc đạt được mức tiết kiệm 2.5x, không cần thay đổi mã.

Kinh tế là phần trung thực: OrcaRouter thêm $0 mỗi token, vì vậy mức $5 / $30 và $2 / $12 trên các trang mô hình là giá của OpenAI được chuyển tiếp, và sự thay đổi giá của nhà cung cấp sẽ có hiệu lực trên phía chúng tôi ngay trong ngày nó được công bố. Tự mang khóa của bạn là một tùy chọn hạng nhất: hãy đưa khóa OpenAI hiện có của bạn và nhà cung cấp sẽ tính phí trực tiếp cho bạn. Các biện pháp bảo vệ — một lá chắn PII và một chính sách nội dung — được thực thi trước khi yêu cầu bị tính phí, không phải sau đó, và DSL định tuyến tạo ra khả năng chuyển đổi dự phòng để một tầng rẻ hơn phản hồi khi mô hình hàng đầu gặp lỗi hoặc khi hình dạng lưu lượng cho phép.
Kết luận
GPT-5.6 Terra là lựa chọn mặc định phù hợp cho gần như mọi thứ: chỉ chênh lệch một hoặc hai điểm so với GPT-5.6 Sol trên các benchmark lập trình, rẻ hơn 2,5 lần và thậm chí còn rẻ hơn nữa với prompt dài. GPT-5.6 Sol là bậc nâng cấp phù hợp khi các bài đánh giá của riêng bạn cho thấy khoảng cách rõ rệt trong những công việc khó và giá trị cao — và các benchmark cho thấy khoảng cách đó là có thật nhưng nằm ở vùng biên, không phải ở những tác vụ thường nhật. Bắt đầu với gpt-5.6-terra, chốt nó một cách rõ ràng, nâng cấp có chủ đích, và giữ cả hai tầng đằng sau một endpoint duy nhất, nơi việc chuyển đổi chỉ là thay đổi model-id, không phải tích hợp lại.
Cả hai gói đều có mặt trên OrcaRouter với giá niêm yết của OpenAI và không tính phí chênh lệch trên mỗi token — dùng khóa OpenAI hiện có của bạn và nhà cung cấp sẽ tính phí trực tiếp cho bạn. Bắt đầu với trang mô hình GPT-5.6 Sol — không cần thẻ tín dụng, hoạt động trong 60 giây.
So sánh trong bài viết này2
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
