
GPT-6 Sol so với Qwen 4 Max: Giá đầu vào ngang nhau và gần như mọi thứ khác đều không thể so sánh được
- openaiMỚIOpenAI: GPT-6.1 Sol2026-09-2952Trí tuệ
- anthropicMỚIAnthropic: Claude Sonnet 5.52026-09-2856Trí tuệ
- typesafeMỚITypeSafe: Jev 1.132026-09-24$0.04 / $0.00 trên 1 triệu token · 128 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Trí tuệ
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Trí tuệ
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Trí tuệ
- xAIGrok 4.72026-09-2146Trí tuệ
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 trên 1 triệu token · 58 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 trên 1 triệu token · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token · 347 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token · 231 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
Đây là con số khiến cặp GPT-6 Sol và Qwen 4 Max đáng có một trang riêng: cả hai đều được niêm yết ở mức $2.00 cho mỗi triệu token đầu vào. Đó là nơi phần hữu ích của phép so sánh bắt đầu và, với Qwen 4 Max, gần như chính là nơi nó kết thúc. Công ty đã công bố hạng Qwen 4 Max vào ngày 22 tháng 9 năm 2026 tại hội nghị Apsara — cùng ngày GPT-6 Sol được phát hành — và tính đến thời điểm viết bài này, không có model card nào được công bố cho nó: không có giá, không có cửa sổ ngữ cảnh, không có tuyên bố về trọng số, và không có điểm số từ bất kỳ đơn vị đánh giá nào. Mô hình chủ lực Qwen thực sự có các phép đo, và bạn có thể gọi ngay hôm nay, là Qwen3.8 Max, phát hành ngày 3 tháng 8 năm 2026 với giá $2.00 / $6.00. Vậy câu hỏi thực tế không phải là Qwen 4 Max thể hiện thế nào trước GPT-6 Sol. Mà là hạng được công bố cho bạn biết điều gì về việc mô hình chủ lực của công ty đang đi về đâu, và Qwen mà bạn thực sự có thể định tuyến làm được gì trước mô hình GPT-6 ngày hôm nay.
Sự phân biệt đó không phải là chuyện bắt bẻ câu chữ. Một hạng đã được công bố nhưng chưa được nêu rõ có thể dung nạp bất kỳ giả định nào bạn muốn đưa ra về nó, và một bài viết âm thầm giả định rằng Qwen 4 Max đánh bại GPT-6 Sol — bởi vì số phiên bản cao hơn — đang đưa ra một lập luận mà nhà cung cấp chưa đưa ra và bằng chứng không ủng hộ.
Ba thứ có thể so sánh được ngay bây giờ
• Giá đầu vào — GPT-6 Sol 2,00 USD mỗi triệu so với Qwen3.8 Max 2,00 USD mỗi triệu, hòa hoàn toàn
• Giá đầu ra — GPT-6 Sol 10,00 USD mỗi triệu so với Qwen3.8 Max 6,00 USD mỗi triệu
• Đầu vào được lưu trong bộ nhớ đệm — GPT-6 Sol 0,20 USD mỗi triệu so với Qwen3.8 Max 0,25 USD mỗi triệu
• Cửa sổ ngữ cảnh — GPT-6 Sol 1.050.000 token so với Qwen3.8 Max 1.000.000 token
• Các phương thức đầu vào — cả hai đều nhận văn bản, hình ảnh và video hoặc tệp; GPT-6 Sol văn bản, hình ảnh và tệp, Qwen3.8 Max văn bản, hình ảnh và video
• Bước giá cho yêu cầu dài — GPT-6 Sol định giá lại toàn bộ yêu cầu trên 272.000 token đầu vào thành 4,00 USD / 15,00 USD so với Qwen3.8 Max không có bước nào trên bảng giá của mình
• Chỉ số trí tuệ — GPT-6 Sol 47,6 so với Qwen3.8 Max 45,4
• Chỉ số lập trình — GPT-6 Sol không được công bố trong bản sửa đổi này so với Qwen3.8 Max 76,2
• GPQA Diamond — GPT-6 Sol 96,1 so với Qwen3.8 Max 92,8
• Terminal-Bench 4.0 — GPT-6 Sol 43,9 so với Qwen3.8 Max 38,9
Hai trong số những dòng đó là những dòng đáng để suy ngẫm. Dòng về đầu vào được lưu đệm đi ngược lại quy luật — Qwen3.8 Max tính thêm năm xu mỗi triệu token cho việc đọc từ bộ đệm so với GPT-6 Sol, mà trong một vòng lặp agent nặng về lưu đệm thì đây chính là chiếc đồng hồ đo nhảy trước tiên. Và điều khoản về yêu cầu dài chính là nơi thế cân bằng về giá đầu vào vỡ hẳn: ở đúng mức $2.00 cho đầu vào, cả hai trông có thể thay thế cho nhau cho đến khi một prompt vượt qua 272.000 token, và tại thời điểm đó, toàn bộ yêu cầu của GPT-6 Sol được tính lại giá thành $4.00 / $15.00, trong khi bảng giá của Qwen3.8 Max không hề có bước tương đương nào. Với một prompt đầy đủ ngữ cảnh, mô hình của công ty không chỉ rẻ hơn về đầu ra. Nó là mô hình duy nhất trong hai mô hình mà mức giá công bố vẫn còn có thể dự đoán được từ con số trên tiêu đề.
Hai điều không thể so sánh với nhau, và vì sao sự khác biệt lại quan trọng
Đầu tiên là năng lực của Qwen 4 Max. Công ty đã giới thiệu nó như một hạng trong dòng sản phẩm hơn là một sản phẩm: không có bảng benchmark, không có số liệu ngữ cảnh, không có tuyên bố về trọng số, không có mức giá. Mọi thứ được viết về cách nó sẽ hoạt động đều là một dự phóng từ quỹ đạo của dòng Qwen, kể cả câu này. Điều duy nhất có thể nhận rõ là mục tiêu — hạng mà nó thay thế và mô hình mà bản kế nhiệm đang được xây dựng để vượt qua — và điều đó cho bạn biết hướng đi, chứ không phải đích đến.
Thứ hai là câu hỏi về trọng số mở, và đây là điều đáng lưu ý nhất trước khi bạn lập kế hoạch triển khai Qwen 4 Max. Công ty công bố trọng số cho một số thành viên trong gia đình Qwen và không công bố cho những thành viên khác. Qwen3.8 Max, mẫu chủ lực, được liệt kê là mô hình API đóng — không có tệp giấy phép, không có checkpoint tải xuống được — dù các mẫu anh em nhỏ hơn trong cùng thế hệ vẫn được công bố. Liệu mẫu chủ lực dòng 4 có đi theo các mẫu anh em nhỏ hơn hay vẫn đóng thì chưa có câu trả lời, và một nhóm xây dựng kế hoạch tự vận hành dựa trên kỳ vọng có trọng số mở sẽ là đang đặt cược vào một tiền lệ mà mẫu chủ lực hiện tại không thiết lập.
Cuộc so sánh thực sự diễn ra là GPT-6 Sol đối đầu với Qwen3.8 Max, và nó sát nút hơn những gì các con số thế hệ gợi ý: 47,6 so với 45,4 trên Intelligence Index, cả hai con số đều của bên thứ ba trên cùng một bản sửa đổi, và GPQA Diamond đạt 96,1 thực sự so với 92,8. Khoảng cách chỉ số 2,2 điểm ở mức giá bằng ba phần tư giá đầu ra là phiên bản sát sao nhất của cuộc đối đầu này hiện có, và đó là cơ sở để lập luận cho đến khi công ty công bố thông tin gì đó cho dòng 4-series.

Điều mà bản thân thông báo là bằng chứng cho
Một phân hạng đã được công bố nhưng chưa được nêu rõ không phải là tín hiệu rỗng. Nó cho bạn biết rằng công ty dự định sản phẩm chủ lực tiếp theo của mình sẽ đứng đầu dòng sản phẩm và rằng công ty sẵn sàng gọi tên nó công khai trước khi nó sẵn sàng, đây là sự thay đổi trong thói quen truyền thông chứ không phải một tuyên bố về năng lực. Nó cũng đặt ra một chiếc đồng hồ: một phân hạng được công bố vào tháng Chín tạo ra kỳ vọng về một thời điểm lên kệ, và khoảng cách giữa công bố và đặc tả chính là nơi việc định vị cạnh tranh thường diễn ra.
Đối với bất kỳ ai hiện đang chạy Qwen3.8 Max, hệ quả thực tế là việc chuyển đổi sẽ là một câu hỏi về năng lực chứ không phải câu hỏi về chi phí. Hạng mà Qwen 4 Max đang được xây dựng để thay thế đã ở mức $2.00 / $6.00, và sản phẩm kế nhiệm phải vượt qua một mô hình đạt 45.4 trong khi có chi phí đầu ra thấp hơn một phần ba so với GPT-6 Sol. Liệu nó có thu hẹp khoảng cách tới 47.6 hay không — và vào ngày nào — là điều duy nhất đáng theo dõi, và không có gì trong thông báo trả lời được điều đó.

Định tuyến một mô hình chưa tồn tại
Chỉ một trong hai mô hình Qwen trong cuộc trò chuyện này có trong danh mục của chúng tôi, và đó không phải là dòng 4. Qwen3.8 Max được định tuyến qua OrcaRouter dưới model id qwen/qwen3.8-max, trên cùng một key với GPT-6 Sol và hơn 200 mô hình khác, và sự kết hợp này đúng nghĩa như vậy: một thay đổi định tuyến chứ không phải một dự án tích hợp khi công ty công bố phiên bản kế nhiệm. Qwen 4 Max sẽ được thêm vào khi có thứ gì đó để định tuyến — một card, một mức giá, một endpoint — và không sớm hơn, bởi vì không có cách nào có trách nhiệm để bán một slot dựa trên một thông số kỹ thuật chưa được viết ra.
Trong khi đó, lý do để giữ cả hai cột mở là hai mô hình bất đồng về nơi chúng rẻ. Qwen3.8 Max không thua kém gì về giá đầu vào và rẻ hơn một phần ba so với giá đầu ra của GPT-6 Sol, đồng thời không có vực tụt dốc khi ngữ cảnh dài; GPT-6 Sol sở hữu chỉ số tốt hơn một chút và mức chiết khấu cho đầu vào được lưu đệm hậu hĩnh hơn nhiều, đổi lại là việc phải tính lại giá cho toàn bộ yêu cầu khi vượt 272.000 token. Một khối lượng công việc dài và nặng về đầu ra và một khối lượng công việc ngắn và thân thiện với bộ nhớ đệm cần những câu trả lời khác nhau, và cả hai chỉ là một quy tắc định tuyến chứ không phải hai cuộc trao đổi mua sắm.
Failover quan trọng ở đây vì một lý do đặc thù của cặp so tài này. Qwen3.8 Max là một mô hình lưu lượng lớn trên các tuyến của chúng tôi — hơn 110 triệu token trong cửa sổ bảy ngày — và chính lưu lượng là thứ phơi bày sự khác biệt giữa các endpoint. Một tuyến thứ hai được cấu hình phía sau nó nghĩa là tuyến chính bị suy giảm chỉ còn là một lần thử lại, và thay đổi giá trên bảng giá của công ty — đúng kiểu sự kiện mà một đợt bàn giao flagship tạo ra — sẽ có hiệu lực ở phía chúng tôi ngay trong ngày vì danh mục của chúng tôi truyền thẳng danh sách nhà cung cấp mà không thêm markup.

Làm gì với cái này, tháng này
Nếu bạn cần một mẫu flagship Qwen ngay lúc này, cái tên cần gọi là Qwen3.8 Max, và nó cạnh tranh được với GPT-6 Sol về suy luận với mức giá đầu ra thấp hơn đáng kể — đó là thực trạng trung thực của cuộc đối đầu ngày hôm nay. Nếu bạn cần kết quả được công bố mạnh nhất trên các benchmark suy luận trong cặp đôi này, con số 47,6 của GPT-6 Sol chính là đáp án, và mức chiết khấu cho input được cache của nó là rẻ nhất trong phép so sánh. Nếu bạn đang chờ Qwen 4 Max, hãy chờ một tấm card thay vì chờ một ngày cụ thể, bởi thông báo chỉ cho bạn biết hạng tier mà thôi, không có gì khác.
Và dù bạn chọn cái nào, hãy kiểm tra phía GPT-6 trước khi chốt. GPT-6 Sol đã bị GPT-6.1 Sol thay thế ở cùng mức $2.00 / $10.00, với đầu vào được cache giảm một nửa xuống $0.10, và trang mô hình của chính nó giờ chuyển hướng người đọc đến đó. So sánh với GPT-6 Sol là so sánh với một mô hình mà bản kế nhiệm của nó đang được bán, và lời cảnh báo tương tự cũng áp dụng cho bất kỳ con số Qwen nào bắt nguồn từ thông báo 4 Max: cả hai đều là những dạng tin tức, và chỉ một trong số đó là sản phẩm có thể mua ngay lúc này.
So sánh trong bài viết này1
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
