
Claude Sonnet 5.5 vs Qwen 4 Max: Một mô hình có Thẻ, mô hình kia có Tên
- typesafeMỚITypeSafe: Jev 1.132026-09-24$0.04 / $0.00 trên 1 triệu token · 931 tok/s
- OpenAIMỚIOpenAI: GPT-6 Luna2026-09-2237Trí tuệ
- OpenAIMỚIOpenAI: GPT-6 Sol2026-09-2248Trí tuệ
- AnthropicMỚIAnthropic: Claude Opus 5.52026-09-2258Trí tuệ
- xAIMỚIGrok 4.72026-09-2146Trí tuệ
- OrcaMỚIOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 trên 1 triệu token · 192 tok/s
- OrcaMỚIOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token · 1174 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 trên 1 triệu token · 62 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token · 107 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token · 220 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- xAISpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
Hai nửa của tiêu đề này không phải cùng một loại đối tượng, và đó là điều đầu tiên người đọc cần biết. Claude Sonnet 5.5đã ra mắt vào ngày 28 tháng 9 năm 2026: nó có mã định danh API, bảng giá, cửa sổ ngữ cảnh, mốc ngừng hỗ trợ được công bố và một dòng trên các bảng xếp hạng độc lập. Qwen 4 Maxđã được giới thiệu trước tại hội nghị Yunqi ở Hàng Châu vào ngày 22 tháng 9 năm 2026 với tư cách là mô hình chủ lực của dòng Qwen 4 gồm bốn mô hình đã được công bố — và tính đến hôm nay, nó không có giá, không có cửa sổ ngữ cảnh, không có điểm số được công bố, không có model card, và không có trang nào trên Artificial Analysis để mở. Đó không phải là một vụ bê bối; đó chỉ là cách một dòng mô hình được công bố. Nhưng nó thay đổi diện mạo của một phép so sánh hữu ích. Phép so sánh đáng làm là giữa Sonnet mới ra mắt gần đây nhất và mô hình Qwen mà bạn thực sự có thể gọi ngay hôm nay, tức Qwen3.8 Max — bởi vì mô hình đó có bảng giá, và bảng giá thì đáng để xem xét.
Điều Alibaba thực sự đưa ra
Qwen 4 Max xuất hiện như một cái tên trong một danh sách, chứ không phải như một sản phẩm. Bản xem trước tại hội nghị đã giới thiệu cấu trúc phân hạng của dòng Qwen 4, và kể từ đó chưa có thông tin nào về nó được chuyển thành đặc tả để một nhà phát triển có thể dựa vào mà lập kế hoạch: không có giá trên mỗi triệu token, không có kích thước cửa sổ, không có đầu ra tối đa, không có bảng benchmark, không có kho Hugging Face, không có mục nào trong danh sách model của chính nhà cung cấp. Việc nó được phát hành dưới dạng một hạng API đóng, dưới dạng trọng số mở, hay cả hai hình thức thì không được nêu ở bất kỳ đâu mà nhà cung cấp đã công bố. Khi một hạng còn ở giai đoạn sớm như vậy, điều trung thực duy nhất mà một bài viết có thể nói về thông số của nó là không có thông số nào — và bất kỳ trang nào hiện đang cung cấp bảng thông số Qwen 4 Max đều đang đưa ra một dự đoán.

Điều duy nhất mà thông báo thiết lập một cách hữu ích là định hướng. Mẫu flagship mới nhất đang được bán ra của Alibaba, Qwen3.8 Max, được chính nhà cung cấp định vị trong hướng dẫn di chuyển của mình là đối đầu trực tiếp với GPT-5.5, Claude Opus 4.7 và Gemini 3.1 Pro, đồng thời đây là phân khúc mà Qwen 4 Max đang được xây dựng để thay thế. Vì vậy, mục tiêu của bản kế nhiệm là rõ ràng ngay cả khi các con số của nó thì không, và mô hình mà nó sẽ phải đánh bại về giá chính là mô hình đã có mặt trên thị trường.
Qwen mà bạn có thể gọi ngay hôm nay, được định giá so với Sonnet mới
Qwen3.8 Max đã được cung cấp rộng rãi kể từ ngày 3 tháng 8 năm 2026. Đây là tầng năng lực cao nhất của Alibaba tính đến nay: đa phương thức gốc với đầu vào văn bản, hình ảnh và video cùng đầu ra văn bản, cửa sổ 1.000.000 token, chế độ suy nghĩ, gọi hàm, công cụ tích hợp sẵn và đầu ra có cấu trúc, được phục vụ qua các endpoint tương thích OpenAI, tương thích Anthropic và DashScope gốc. Alibaba định vị nó cho cùng loại công việc phân tích đa bước và tác vụ tác nhân đòi hỏi khắt khe mà nhà cung cấp kia định vị Claude Sonnet 5.5, và cả hai có mức giá niêm yết gần như giống hệt nhau — và đó chính là chỗ phép so sánh trở nên thú vị.
• Giá đầu vào — Claude Sonnet 5.5 $2.00 mỗi triệu so với Qwen3.8 Max $2.00 mỗi triệu, giống hệt nhau
• Giá đầu ra — Claude Sonnet 5.5 10,00 USD mỗi triệu so với Qwen3.8 Max 6,00 USD mỗi triệu
• Đọc bộ nhớ đệm — Claude Sonnet 5.5 $0,20 mỗi triệu so với Qwen3.8 Max $0,25 mỗi triệu
• Ghi cache — Claude Sonnet 5.5 2,50 USD mỗi triệu so với Qwen3.8 Max 2,50 USD mỗi triệu
• Bối cảnh — Claude Sonnet 5.5 1.000.000 token so với Qwen3.8 Max 1.000.000 token trên bảng thông số của nhà cung cấp; Artificial Analysis ghi lại bản chụp mà họ đo được ở mức 983.616
• Đầu ra tối đa — Claude Sonnet 5.5 128.000 đồng bộ, 300.000 trên Batches so với Qwen3.8 Max chưa được nhà cung cấp công bố
• Phương thức nhập liệu — Claude Sonnet 5.5 văn bản, hình ảnh và tệp so với Qwen3.8 Max văn bản, hình ảnh và video
Mức giá đầu vào tương đương và mức giá đầu ra rẻ hơn 40% thực sự là một vị thế giá rất mạnh, và đó chính là lý do Qwen3.8 Max liên tục xuất hiện trong các so sánh với những mô hình tiên tiến nhất. Nhưng rồi khi bạn nhìn vào các phép đo độc lập, lợi thế lại chuyển sang một nơi hoàn toàn khác.
Những con số độc lập nói gì về lợi thế giá
Cả hai mô hình đều nằm trên cùng một Artificial Analysis Intelligence Index, bản sửa đổi v4.3.2, và cả hai đều đã được đo lường chứ không phải ước tính.
• Chỉ số Trí tuệ — Claude Sonnet 5.5 đạt 56 ở Max Effort so với Qwen3.8 Max 45 trên bản chụp ngày 2 tháng 9
• Chi phí cho mỗi tác vụ Index — Claude Sonnet 5.5 $7.60 so với Qwen3.8 Max $5.41
• Tốc độ đầu ra — Claude Sonnet 5.5 138.7 token/giây so với Qwen3.8 Max 38.2 token/giây
• Thời gian đến chunk đầu tiên — Claude Sonnet 5.5 370,8 s ở Max Effort so với Qwen3.8 Max 3,0 s
• Token đầu ra được tạo trên toàn bộ Index — Claude Sonnet 5.5 410M so với Qwen3.8 Max 190M, mức mà hội đồng đánh dấu là cực kỳ dài dòng so với trung vị 88M
• GPQA Diamond — Claude Sonnet 5.5 không được công bố trên bảng điểm hiện tại so với Qwen3.8 Max 92,8%
• Humanity's Last Exam — Claude Sonnet 5.5 55,0% so với Qwen3.8 Max 43,1%
• Khả năng truy hồi ngữ cảnh dài — Claude Sonnet 5.5 đạt 82,7% so với 80,3% của Qwen3.8 Max
Có hai điều nổi bật, và không điều nào là giá cả. Điều thứ nhất là mức giá đầu ra rẻ hơn 40% thu lại thành một tác vụ rẻ hơn 30% khi bạn tính đến số lượng token — Qwen3.8 Max phát ra 190M token trong toàn bộ chỉ mục, so với 410M của Claude Sonnet 5.5, tức là gọn gàng hơn, nhưng không đủ gọn để giữ trọn khoảng cách về mức giá. Điều thứ hai là tốc độ, và ở đây hướng đảo ngược mạnh mẽ: Claude Sonnet 5.5 tạo đầu ra nhanh hơn Qwen3.8 Max 3,6 lần, 138,7 token mỗi giây so với 38,2. Trong một lần tạo dài, đó là sự khác biệt giữa một phút và vài phút, và không khoản giảm giá theo token nào có thể bù đắp được sự khác biệt đó.
Con số token đầu tiên lại cho thấy điều ngược lại và cần được nói rõ lưu ý đi kèm. 370,8 giây là Claude Sonnet 5.5 ở Max Effort với fallback mặc định, một cấu hình suy luận tiêu tốn ngân sách suy nghĩ rất lớn trước khi trả lời; người gọi cấu hình mức effort thấp hơn sẽ nhận token đầu tiên trong vài giây. 3,0 giây của Qwen3.8 Max được đo trên một mô hình có hành vi suy nghĩ khác. So sánh này là thật, nhưng đó là so sánh giữa các cấu hình, không phải giữa các nhà cung cấp.

Chi phí chuyển đổi Sonnet còn thiếu sẽ đổ xuống đâu
Một điểm khác biệt vận hành không xuất hiện trong bất kỳ hàng nào ở trên và quan trọng hơn khoảng cách giá đối với bất kỳ ai đang chạy code. Claude Sonnet 5.5 đã thay đổi sáu hành vi so với Claude Sonnet 5, và năm trong số đó phá vỡ các tích hợp hiện có: non-default temperature, top_p và top_k bây giờ trả về 400; thinking: {"type": "disabled"} trả về 400 và phải trở thành between_tools với effort được giới hạn ở low, medium hoặc high; lựa chọn công cụ bắt buộc là "any" hoặc một công cụ có tên bị từ chối, vì vậy các vòng lặp phải chuyển sang auto với strict tool use hoặc structured outputs; computer_20251124 công cụ computer-use bị từ chối trên Claude API và Google Cloud; và các khối thinking giờ đây bị ràng buộc với model và tài khoản tạo ra chúng, vì vậy suy luận được chuyển tiếp từ Sonnet 5 nhưng không ra được sang một họ khác. Thay đổi thứ sáu không làm hỏng gì cả và do đó là thay đổi dễ bị ship hỏng: văn bản giữa các lần gọi công cụ giờ đây trả về bên trong các khối thinking, vì vậy một ứng dụng streaming sẽ im lặng giữa các lần gọi cho đến khi nó đặt giá trị hiển thị hoặc vô hiệu hóa thinking trước.
Qwen3.8 Max không yêu cầu bất kỳ điều nào trong số đó từ một bên gọi Qwen — nó là một endpoint tương thích OpenAI với toàn bộ bề mặt lấy mẫu và cấu trúc gọi công cụ chuẩn — và endpoint tương thích Anthropic của nó tồn tại chính là để mã viết cho Claude có thể trỏ đến nó chỉ bằng một thay đổi base-URL. Đối với một nhóm đã dùng Sonnet 5, chuyển sang Sonnet 5.5 là một ngày công việc di trú với danh sách năm mục cần kiểm tra; chuyển sang Qwen3.8 Max là một thay đổi cấu hình với một tập hợp rủi ro khác, chủ yếu xoay quanh sự trôi dạt hành vi thay vì hình dạng API.
Đưa cái có thể tiếp cận được vào cùng một phím
Một pipeline thực tế vào cuối tháng 9 năm 2026 không chọn một trong số này. Nó chạy một mô hình Claude cho nhánh agentic và một mô hình Qwen ở những chỗ mà đầu vào video hoặc giá cả là yếu tố quan trọng, và chi phí của cách bố trí đó thường là hai hợp đồng, hai khóa, hai bề mặt giới hạn tốc độ và hai nơi mà một yêu cầu có thể thất bại. OrcaRouter gộp nó lại thành một endpoint tương thích OpenAI trên hơn 200 mô hình, với giá niêm yết của nhà cung cấp được chuyển tiếp nguyên vẹn và không cộng thêm markup, nên thay đổi mức giá từ nhà cung cấp ở một trong hai phía sẽ có hiệu lực tại đây ngay trong cùng ngày thay vì vào kỳ gia hạn tiếp theo, cùng với chuyển đổi dự phòng tự động giữa các nhà cung cấp thượng nguồn và một DSL định tuyến để tổ hợp các lệnh gọi từ nhiều mô hình.
Qwen3.8 Max hiện có thể định tuyến tại đây ngay hôm nay dưới dạng qwen/qwen3.8-max với mức giá 2,00 USD cho đầu vào và 6,00 USD cho đầu ra của Alibaba trên toàn bộ cửa sổ 1.000.000 token, và bản chụp ngày 2 tháng 9 mà Artificial Analysis đo lường có thể được truy cập dưới dạng qwen/qwen3.8-max-0902 khi bạn cần đúng bản sửa đổi mà điểm số được lấy trên đó. Cả Qwen 4 Max lẫn bất kỳ hạng Qwen 4 nào khác đều không có trong danh mục của chúng tôi, và sẽ không có hạng Qwen 4 nào cho đến khi Alibaba công bố thứ gì đó để định tuyến. Claude Sonnet 5.5 cũng không có trong danh mục — nó mới ra đời được một ngày, và con đường đến với nó là API riêng của Anthropic, với Claude Sonnet 5 có sẵn tại đây với mức giá 2,00 USD và 10,00 USD của Anthropic làm mục tiêu chuyển đổi dự phòng trong lúc đó. Qwen3.8 Max mang 52,0 triệu token lưu lượng mỗi tuần qua danh mục này và Claude Sonnet 5 mang 7,9 triệu, đây chính là phiên bản thực tế của lập luận trên: hạng Qwen không phải là phương án dự phòng chỉ trên danh nghĩa.

Quy tắc cho một hạng được công bố
Hãy coi một hạng đã được công bố là đầu vào cho việc lên lịch, chứ không phải một lựa chọn mua sắm. Qwen 4 Max đáng để theo dõi vì nó cho bạn biết mô hình chủ lực của Alibaba đang hướng tới đâu và vì cuối cùng nó sẽ thay thế Qwen3.8 Max ở vị trí đứng đầu dòng. Nó không đáng để lập kế hoạch dựa vào, bởi vì không có gì để lập kế hoạch dựa vào: không có mã định danh, không có giá, không có cửa sổ ngữ cảnh, không có trọng số, không có điểm số được đo lường. Bằng chứng sẽ khiến nó trở thành hiện thực rất cụ thể và dễ nhận ra — một mục trong danh sách mô hình của chính Alibaba, một dòng giá, một cửa sổ ngữ cảnh được công bố, một kho Hugging Face nếu trọng số được mở, và một trang trên Artificial Analysis, bởi vì một mô hình chưa ai đo lường không phải là mô hình bạn có thể so sánh.
Cho đến lúc đó, quyết định nằm giữa hai mô hình đều đang tồn tại. Nếu công việc của bạn mang tính agent, 17 điểm Index và tốc độ đầu ra gấp 3,6 lần chính là thứ bạn đang mua, và chi phí cao hơn trên mỗi tác vụ của Claude Sonnet 5.5 là cái giá phải trả cho những thứ đó. Nếu công việc của bạn nhận đầu vào video, cần một endpoint tương thích Anthropic gốc trên hóa đơn Qwen, hoặc đơn giản là không thể biện minh cho mức giá đầu ra 10 USD, thì Qwen3.8 Max hiện đang được bán với cùng mức giá đầu vào nhưng đầu ra rẻ hơn 40% và token đầu tiên đến trong vài giây — và điều cần lưu ý thành thật là nó sẽ có cảm giác chậm một khi quá trình sinh bắt đầu, đó chính là sự đánh đổi mà mức giá rẻ hơn mang lại.
So sánh trong bài viết này1
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
