
Solar Pro 4 so với Qwen 3.8 Max: Tác nhân $0.03 đối đầu với canh bạc mở 2.4T của Alibaba
- metaMỚIMeta: Muse Spark 1.22026-08-0557Trí tuệ72Lập trình
- qwenMỚIQwen: Qwen3.8 Max2026-08-0358Trí tuệ72Lập trình
- deepseekMỚIDeepSeek: DeepSeek V4 Flash 07312026-07-3152Trí tuệ69Lập trình
- minimaxMỚIMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 trên 1 triệu token · 2147 tok/s
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Trí tuệ78Lập trình
- googleGoogle: Gemini 3.6 Flash2026-07-2152Trí tuệ69Lập trình
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Trí tuệ49Lập trình
- metaMeta: Muse Spark 1.12026-07-1653Trí tuệ71Lập trình
- kimiMoonshotAI: Kimi K32026-07-1560Trí tuệ76Lập trình
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Trí tuệ71Lập trình
- openaiOpenAI: GPT-5.6 Terra2026-07-0957Trí tuệ77Lập trình
- openaiOpenAI: GPT-5.6 Sol2026-07-0961Trí tuệ77Lập trình
- grokxAI: Grok 4.52026-07-0856Trí tuệ72Lập trình
- tencentTencent: Hy32026-07-0642Trí tuệ59Lập trình
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232Trí tuệ42Lập trình
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226Trí tuệ39Lập trình
- anthropicAnthropic: Claude Sonnet 52026-06-3055Trí tuệ72Lập trình
- klingKling: Kling 3.0 Turbo2026-06-1757Trí tuệ52Lập trình57Toán
Vào tuần ngày 3 tháng 8 năm 2026, Alibaba đã phát hànhQwen 3.8 Max, một mô hình MoE thưa với 2,4 nghìn tỷ tham số, xếp thứ 2 toàn cầu trên bảng xếp hạng Arena và thứ 12 trên Chỉ số mã hóa của Artificial Analysis, với giá $2.00 cho mỗi triệu token đầu vào và $6.00 cho mỗi triệu token đầu ra. Bảy ngày sau, Upstage đã phát hànhSolar Pro 4, một sản phẩm agent chủ lực có trọng số đóng với giá $0.03 và $0.12. Cả hai đều được tiếp thị là các mô hình "agentic" được xây dựng cho các tác vụ dài, nhiều bước. Một là mô hình mở trọng số mạnh nhất của mùa hè Trung Quốc, cái còn lại là nhãn "mô hình agent" thương mại rẻ nhất năm 2026. Chúng không thực sự cạnh tranh về khả năng — chúng cạnh tranh về điều mà một nhà phát triển được phép giả định về một mô hình trước khi token đầu tiên được tiêu tốn.
Hai lần ra mắt, hai giả định
Qwen 3.8 Max ra khỏi phòng thí nghiệm của Alibaba vào ngày 3 tháng 8 với đầy đủ dấu hiệu của một sự ra mắt tiên phong: 2,4T tổng tham số (khoảng 95B tham số hoạt động trên mỗi token), ngữ cảnh 1 triệu token, hỗ trợ đầu vào văn bản–hình ảnh–video gốc, thứ hạng #2 trên bảng xếp hạng Arena, và Chỉ số Trí tuệ Artificial Analysis đã được kiểm toán đạt 58. Dựa trên bằng chứng độc lập, đây là mô hình trọng số mở nằm trong nhóm hàng đầu toàn cầu. Alibaba đã xác nhận sẽ phát hành trọng số theo mô hình quen thuộc của Qwen, qua đó đây sẽ là dòng Qwen hạng Max mã nguồn mở đầu tiên. Không có điều nào trong số đó là rẻ theo chuẩn tiên phong — $2/$6 — nhưng vẫn rẻ so với các mô hình tiên phong độc quyền.
Solar Pro 4 ra mắt ngày 10 tháng 8 với một bộ giả định khác. Tài liệu phát hành của Upstage mô tả những cải tiến về suy luận tài liệu dài, sử dụng công cụ đa lượt và hiệu suất tác vụ đầu cuối so với Solar Pro 3, không công bố số tham số và không có điểm chuẩn độc lập. Điểm khác biệt hoàn toàn nằm ở giá: $0.03/$0.12 rẻ hơn khoảng 66 lần ở đầu vào và 50 lần ở đầu ra so với Qwen 3.8 Max. Trong khi Qwen 3.8 Max yêu cầu bạn tin vào một mô hình 2.4T với điểm số đã được kiểm toán, Solar Pro 4 yêu cầu bạn tin vào một mức giá.

Bảng điểm, được đọc một cách trung thực
• Chỉ số Thông minh — Qwen 3.8 Max: 58 (AA, đã được kiểm toán); Solar Pro 4: không có công bố
• Chỉ số Lập trình — Qwen 3.8 Max: 71.8 (#12/126, AA); Solar Pro 4: chưa được đo lường
• Ngữ cảnh — Qwen 3.8 Max: 1M token; Solar Pro 4: 524K
• Phương thức nhập liệu — Qwen 3.8 Max: văn bản, hình ảnh, video; Solar Pro 4: tập trung vào văn bản
Trọng số — Qwen 3.8 Max: hứa hẹn phát hành mở; Solar Pro 4: đóng
Giá — Qwen 3.8 Max: $2.00/$6.00 mỗi 1M; Solar Pro 4: $0.03/$0.12 mỗi 1M

Sự bất đối xứng là rõ ràng và đó không phải lỗi của Solar Pro 4. Qwen 3.8 Max có thể đo lường được từ ngày 3 tháng 8; Solar Pro 4 có thể đo lường được từ ngày 10 tháng 8. Một mô hình chưa được đo lường không phải là mô hình tồi — nó chỉ là một mô hình chưa được đo lường. Nhưng sự so sánh cụ thể này, ngay lúc này, là "bằng chứng đã kiểm toán" đối lập với "tuyên bố giá ra mắt", và cách trung thực để đọc bất kỳ cuộc đối đầu trực tiếp nào là phải nói rõ điều đó.
Khoảng cách 100× thực sự mang lại điều gì
Điều thú vị ở đây không phải là giá mỗi token; mà là giá mỗi token mở khóa điều gì về mặt kiến trúc. Với mức giá của Solar Pro 4, giữ toàn bộ bộ tài liệu 500K token trong ngữ cảnh cho mỗi lượt của một vòng lặp tác tử không còn là một quyết định về chi phí. Chạy cùng một prompt với ba mức nhiệt độ khác nhau và giữ lại kết quả tốt nhất — một thủ thuật kinh điển của mô hình rẻ — trở thành miễn phí. Đó thực sự là một tư thế phát triển khác biệt: bạn thiết kế như thể tài nguyên tính toán gần như miễn phí, giống như cách các nhóm từng làm với các mô hình rẻ cấp GPT-3.5 đầu tiên.
Cái giá phải trả là bạn đang đặt cược khối lượng công việc sản xuất vào một tuyên bố chất lượng chưa được kiểm chứng. Chỉ số Thông minh 58 của Qwen 3.8 Max và thứ hạng #2 trên Arena không phải là toàn bộ câu chuyện — bộ benchmark của chính Alibaba bao gồm các số liệu nội bộ cần được đọc với cùng nhãn do nhà cung cấp công bố — nhưng chúng vẫn có ý nghĩa. Solar Pro 4 vẫn chưa có gì thuộc loại đó. Nếu chất lượng của nó ngang ngửa Qwen, thì đây là món hời nhất hiện có. Nếu không, mức giá $0.03 sẽ cho thấy chính xác vì sao nó có giá $0.03.

Bản fork trọng số mở
Đây là điểm mà hai mô hình khác biệt về mặt cấu trúc, và đây cũng chính là yếu tố sẽ quyết định cuộc so tài này sáu tháng kể từ bây giờ. Việc phát hành mở của Qwen 3.8 Max, khi ra mắt, biến nó thành một tài sản có thể triển khai: tự lưu trữ, tinh chỉnh, phục vụ với chi phí biên, và giữ dữ liệu trên phần cứng của riêng bạn. Solar Pro 4 sẽ không bao giờ như vậy — đóng là đóng. Đối với một doanh nghiệp có yêu cầu về nơi cư trú dữ liệu hoặc đường cong chi phí dài hạn, "Qwen 3.8 Max cuối cùng có thể nằm trong cụm của riêng bạn" là một lựa chọn chiến lược mà không mức giá theo token nào có thể sánh được.
Đối với nhóm chỉ muốn gọi một mô hình ngay hôm nay, câu hỏi mở chỉ còn mang tính học thuật. Cả hai đều nằm phía sau các API tương thích OpenAI và đều có sẵn qua API của nhà cung cấp lẫn nhiều nền tảng bên thứ ba. Câu trả lời định tuyến — một API cho hơn 200 mô hình, giá niêm yết nhà cung cấp được chuyển thẳng mà không thêm phí, tự động chuyển đổi dự phòng — cho phép bạn coi đây là một biểu đồ chi phí thay vì quyết định lòng trung thành: lưu lượng lớn giá rẻ tới mô hình $0.03, suy luận rủi ro cao tới Qwen 3.8 Max, và routing DSL để chỉ định khối lượng công việc nào đi đâu.
Kết luận
{{1}}Qwen 3.8 Max là mô hình tốt hơn, mô hình có bằng chứng thuyết phục hơn, và là mô hình có một tương lai mà bạn có thể làm chủ.{{/1}} {{2}}Solar Pro 4 có mức giá tốt hơn hai bậc độ lớn, kèm theo dấu hoa thị trung thực rằng các tuyên bố về chất lượng của nó vẫn chưa được tái lập tính đến tuần này.{{/2}} {{3}}Nếu khối lượng công việc của bạn cần hiệu năng tiên phong đã được kiểm chứng, hãy trả tiền cho Qwen 3.8 Max.{{/3}} {{4}}Nếu khối lượng công việc của bạn bị ràng buộc bởi số lượng và chấp nhận được lỗi, agent giá $0.03 là lựa chọn hợp lý — hãy kiểm tra lại khi những con số độc lập đầu tiên của Solar Pro 4 được công bố, cũng là lúc so sánh này không còn là so sánh khập khiễng mà trở thành một lựa chọn thực sự.{{/4}}
