
Solar Mini 4 vs Solar Pro 4: Cùng cửa sổ ngữ cảnh với mức giá gấp ba lần
- OpenAIMỚIOpenAI: GPT-6 Luna2026-09-2237Trí tuệ
- OpenAIMỚIOpenAI: GPT-6 Sol2026-09-2248Trí tuệ
- OrcaMỚIOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 trên 1 triệu token
- orcaMỚIOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token
- deepseekMỚIDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- openaiOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- googleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- anthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- grokSpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
- metaMeta: Muse Spark 1.22026-08-0540Trí tuệ72Lập trình
- qwenQwen: Qwen3.8 Max2026-08-0345Trí tuệ76Lập trình
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Trí tuệ69Lập trình
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
Hai mô hình Solar hiện tại của Upstage chia sẻ cùng một bảng thông số kỹ thuật ở mọi khía cạnh mà người mua thường kiểm tra đầu tiên. Solar Mini 4, phát hành ngày 22 tháng 9 năm 2026, và Solar Pro 4, phát hành ngày 6 tháng 8 năm 2026, đều chấp nhận 512.000 token ngữ cảnh, đều tạo ra tối đa 128.000 token đầu ra, đều hỗ trợ tiếng Anh, tiếng Hàn và tiếng Nhật, và cả hai đều dừng dữ liệu huấn luyện vào tháng 2 năm 2026. Sự khác biệt là Solar Pro 4 có giá gấp ba lần Solar Mini 4 — 0,30 đô la cho mỗi triệu token đầu vào so với 0,10 đô la — và Solar Pro 4 có điểm chuẩn độc lập được công bố trong khi Solar Mini 4, mới một ngày tuổi, không có điểm nào cả. Điều đó có nghĩa là câu hỏi mà so sánh này trả lời không phải là "cái nào tốt hơn". Mà là liệu thứ bạn đang trả gấp ba lần có phải là thứ mà khối lượng công việc của bạn đang thiếu hay không.
Hai đồng hồ giảm giá chạy cùng lúc
Trước lập luận về năng lực, hãy nói đến lập luận về giá — bởi vì hiện tại hai mô hình đang có lịch khuyến mãi khác nhau, và phép tính còn kỳ lạ hơn mức giá niêm yết gợi ý.
Solar Mini 4 ra mắt vào ngày 22 tháng 9 với mức giảm 50% đến hết ngày 22 tháng 10 năm 2026, đưa mức giá hiện tại của nó xuống 0,05 USD cho đầu vào, 0,005 USD cho đầu vào được lưu trong bộ nhớ đệm và 0,20 USD cho đầu ra trên mỗi triệu token. Trang định giá của chính Upstage ghi khung thời gian có cấu trúc là từ 05:00 UTC ngày 22 tháng 9 đến 00:00 UTC ngày 23 tháng 10.
Chương trình khuyến mãi của Solar Pro 4 đã thay đổi vào ngày 11 tháng 9, khi Upstage cắt giảm mức chiết khấu từ 90% xuống 70% — nói thẳng ra là tăng giá, dù mô hình vẫn thấp hơn nhiều so với giá niêm yết. Chương trình khuyến mãi đó kéo dài đến ngày 9 tháng 10 năm 2026, với mức giá tiêu chuẩn từ ngày 10 tháng 10. Trong thời gian đó, Solar Pro 4 ở mức $0.09 cho đầu vào, $0.018 cho phần lưu đệm và $0.36 cho đầu ra.
Vậy trong khoảng hai tuần từ giờ đến ngày 9 tháng 10, khoảng cách giữa hai mô hình là 1,8×, không phải 3×: $0,09 so với $0,05 ở đầu vào, $0,36 so với $0,20 ở đầu ra. Sau ngày 9 tháng 10, Solar Pro 4 trở về mức $0,30 và $1,20 trong khi Solar Mini 4 vẫn được giảm giá đến ngày 22. Sau ngày 22, cả hai đều ở mức niêm yết và khoảng cách là đủ 3×.

Ba kết luận rút ra từ đó. Nếu bạn đang đánh giá so sánh hai mô hình với nhau, hãy làm điều đó trước ngày 9 tháng 10, khi lợi thế của mô hình rẻ hơn là nhỏ nhất và bạn đang đo lường năng lực thay vì giá cả. Nếu bạn đang lập ngân sách cho một đợt triển khai production bắt đầu vào tháng 11, hãy dùng giá niêm yết, vì cả hai chương trình khuyến mãi sẽ không còn chạy nữa. Và nếu bạn đang lên kế hoạch chuyển đổi giữa hai mô hình, hãy biết rằng điểm giao nhau là một ngày, chứ không phải một khối lượng công việc.
Điểm duy nhất mà hai mô hình thực sự khác xa nhau
Đánh giá độc lập là nơi Solar Pro 4 khẳng định được phân hạng của mình, còn Solar Mini 4 thì vẫn chưa thể trả lời câu hỏi này.
Artificial Analysis đã cho Solar Pro 4 42 điểm trên Intelligence Index của mình, mức tăng 27 điểm so với mức 14 của Solar Pro 3, và những mức tăng này tập trung đúng vào nơi một mẫu flagship nên giành phần thắng. Terminal-Bench v2.1 tăng từ 12% lên 57%. AA-LCR, bài đánh giá suy luận theo ngữ cảnh dài, tăng từ 31% lên 71%. τ³-Banking tăng từ 9% lên 23%. Trên GDPval-AA v2, chỉ số đo lường các tác vụ agentic trong thế giới thực so với mốc cơ sở Elo của con người là 1000, Solar Pro 3 đạt 498 và Solar Pro 4 đạt 1277. Đó là những con số của bên thứ ba, do Artificial Analysis công bố, không phải số liệu từ nhà cung cấp.

Bài viết này cũng thẳng thắn về cái giá phải trả cho sự cải thiện đó. Solar Pro 4 mất 8,6 phút để hoàn thành một tác vụ Intelligence Index trung bình, so với 6,0 phút của Solar Pro 3, dù sử dụng ít hơn khoảng 17% token đầu ra — 43.000 token mỗi tác vụ so với 52.000. Nó tiết kiệm token hơn nhưng chậm hơn về thời gian thực. Và điểm AA-Omniscience của nó cải thiện từ −53 lên −1 chủ yếu nhờ việc từ chối trả lời: nó chỉ cố gắng trả lời 41% số câu hỏi so với 92% của Pro 3, và trong khi tỷ lệ ảo giác của nó giảm từ 88% xuống 24%, độ chính xác của nó gần như không thay đổi, từ khoảng 17% lên 19%. Một mô hình cải thiện điểm trung thực bằng cách từ chối trả lời là một cải thiện thực sự cho công việc tác tử — một câu trả lời sai đầy tự tin tốn kém hơn một lần từ chối — nhưng nó không giống với việc biết nhiều hơn.
Solar Mini 4 không có tương đương. Không có Intelligence Index, không có xếp hạng Agent Arena, không có đánh giá tác tử của bên thứ ba, và cũng không có bảng benchmark nào từ Upstage. Con số duy nhất đang lưu hành là một lần chạy test400 do một wrapper cộng đồng tự báo cáo và được đánh giá bởi một mô hình khác, trong đó Solar Mini 4 đạt độ chính xác thực địa 98.4% với thời gian gọi trung bình 1.21 giây. Đó là bộ khung thử nghiệm của một nhà phát triển đối với chính triển khai của họ, hữu ích như một tín hiệu khói và vô dụng như một đầu vào cho mua sắm.
3B tham số hoạt động mang lại được gì, và không mang lại được gì
Việc công bố tham số là tuyên bố rõ ràng nhất về ý định trong sự kết hợp này. Solar Mini 4 có tổng 35B với 3B được kích hoạt trên mỗi token. Số lượng tham số của Solar Pro 4 không được tiết lộ.
Tỷ lệ hoạt động 3B là một quyết định về kinh tế phục vụ, không phải là một tuyên bố về năng lực. Nó có nghĩa là mô hình lưu trữ 35B trọng số và thực hiện phép tính của 3B cho mỗi token, đó là lý do Upstage có thể định giá một mô hình có ngữ cảnh 512K ở mức $0.10 cho mỗi triệu token đầu vào. Solar Pro 4 ở mức $0.30 cho bạn biết nó đang thực hiện nhiều công việc hơn trên mỗi token; việc Upstage không công bố con số này cho bạn biết họ không muốn phép so sánh được thực hiện theo kiểu số học.
Điều thực sự phân tách chúng, dựa trên bằng chứng đã công bố, là độ khó của nhiệm vụ mà mô hình được yêu cầu hoàn thành, chứ không phải kích thước tài liệu được giao cho nó. Solar Mini 4 được công bố với ngữ cảnh 512K và đầu ra tối đa 128K — cùng các con số như mẫu flagship — nên trường hợp tài liệu dài không phải là nơi ranh giới phân hạng nằm. Ranh giới nằm ở công việc agentic nhiều bước: các con số Terminal-Bench, τ³-Banking và GDPval chính là những gì mức giá của Solar Pro 4 đang mua lấy, và chúng đo lường những nhiệm vụ đòi hỏi lập kế hoạch, gọi công cụ và phục hồi sau sai sót qua nhiều lượt.
Có một lưu ý đáng để nêu ra, vì đây là kiểu chuyện khiến người ta bị vấp giữa chừng dự án. Lịch sử mô hình của Upstage liệt kê Solar Pro 4 với ngữ cảnh 512K và đầu ra tối đa 128K. Bài viết của Artificial Analysis về cùng mô hình đó liệt kê cửa sổ ngữ cảnh 384K và đầu ra tối đa 256K — cùng một mức trần và mức sàn, nhưng bị hoán đổi cho nhau. Cả hai nguồn đều đáng tin cậy và chúng mâu thuẫn với nhau. Nếu bạn đang định cỡ một prompt gần giới hạn, hãy kiểm tra đối chiếu với phản hồi API thay vì dựa vào một trong hai tài liệu, bởi hai con số được công bố đó không thể dung hòa được.
Vị trí của từng cái trong một pipeline
Cách hữu ích để xem hai mô hình này là một cặp tầng thay vì những lựa chọn thay thế, gần đúng với cách Upstage đã định vị chúng. Solar Mini 4 là mặc định: trích xuất, phân loại, đầu ra có cấu trúc trên các tài liệu dài, vòng lặp khối lượng lớn nơi một triệu lệnh gọi rẻ là khối lượng công việc. Solar Pro 4 là bước nâng cấp: lượt chạy tác nhân phải lập kế hoạch, sử dụng công cụ, phục hồi sau một bước thất bại và vẫn hoàn thành.
Kinh tế học của sự phân chia đó rất khắt khe, luôn nghiêng về hạng rẻ hơn bất cứ khi nào hạng rẻ hơn là lựa chọn đúng. Solar Mini 4 với $0.05 đầu vào và $0.20 đầu ra trong thời gian khuyến mãi rẻ hơn 5 đến 6 lần so với mức giá khuyến mãi của Solar Pro 4 và rẻ hơn 3 lần so với giá niêm yết. Nếu 90% khối lượng của bạn là trích xuất và 10% là công việc tác tử, việc định tuyến 90% đó xuống một hạng thấp hơn tiết kiệm nhiều hơn bất kỳ tối ưu hóa prompt nào. Chế độ thất bại là định tuyến sai — gửi công việc tác tử đến mô hình nhỏ và trả giá gấp đôi, một lần cho cuộc gọi lãng phí và một lần cho lần thử lại trên mô hình đắt tiền.
Rủi ro định tuyến sai đó chính là lý do đây là một bài toán đo lường trước khi là một bài toán định giá, và đó là nơi một lớp định tuyến khẳng định được giá trị của mình. Nói thẳng về ranh giới sản phẩm: OrcaRouter không định tuyến bất kỳ mô hình Upstage nào, nên cả Solar Mini 4 lẫn Solar Pro 4 đều không có sẵn qua chúng tôi — cả hai đều đến từ API riêng của Upstage và một số nền tảng bên thứ ba. Mục đích của nền tảng này chính là khuôn mẫu mà sự kết hợp này tạo ra: một tầng rẻ và một tầng đắt, một quy tắc về việc lưu lượng nào đi đâu, và chuyển đổi dự phòng tự động giúp nâng một lệnh gọi lên mô hình lớn hơn khi mô hình nhỏ gặp lỗi hoặc trả về thứ mà trình phân tích cú pháp của bạn từ chối. Trong khoảng 190 mô hình mà chúng tôi thực sự định tuyến, việc phân tầng đó được cấu hình một lần thay vì phải gắn cứng vào từng bên gọi. Nếu bạn đang chạy cả hai tầng Solar, logic tương đương nằm trong bảng điều khiển của chính Upstage, và những phần bạn nên đọc kỹ chính là những phần quyết định khi nào cần leo thang.

Làm gì với chúng
Nếu hôm nay bạn phải chọn một mô hình, chỉ nên chọn Solar Pro 4 nếu công việc của bạn mang tính agentic theo đúng nghĩa mà các benchmark đo lường — nhiều bước, dùng công cụ, tự sửa lỗi. Đó là thứ mà mức 3× đang trả tiền cho, và đó là trục duy nhất mà bằng chứng đã công bố tách biệt rõ ràng hai mô hình. Với mọi thứ khác, Solar Mini 4 mang lại cùng cửa sổ ngữ cảnh, cùng giới hạn đầu ra, cùng ba ngôn ngữ và mức giá thấp hơn, và phản biện trung thực dành cho nó không phải là nó yếu, mà là chưa có ai ngoài Upstage đo lường nó.
Điểm cuối cùng đó chính là toàn bộ quyết định, và nó gắn với một hạn chót. Chương trình khuyến mãi của Solar Mini 4 kéo dài đến ngày 22 tháng 10 và của Solar Pro 4 đến ngày 9 tháng 10, vì vậy cửa sổ giá rẻ để so sánh chúng với nhau là hai tuần tới. Hãy chạy cả hai trên lưu lượng của chính bạn ở mức giá khuyến mãi, với tiêu chí nghiệm thu của riêng bạn, trước khi đồng hồ của bên nào hết hạn. Các benchmark độc lập cho Solar Mini 4 rồi sẽ đến, và khi chúng đến, chúng sẽ cho bạn biết nó hoạt động thế nào trên tác vụ của người khác, một câu trả lời khác và ít hữu ích hơn câu trả lời mà bạn có thể mua với vài đô-la trong tháng này.
