
Dots vs Qwen 3.8 Max: Sự khác biệt nằm ở chỗ bạn được phép di chuyển nó
- typesafeMỚITypeSafe: Jev 1.132026-09-24$0.04 / $0.00 trên 1 triệu token · 349 tok/s
- OpenAIMỚIOpenAI: GPT-6 Luna2026-09-2237Trí tuệ
- OpenAIMỚIOpenAI: GPT-6 Sol2026-09-2248Trí tuệ
- AnthropicMỚIAnthropic: Claude Opus 5.52026-09-2258Trí tuệ
- xAIMỚIGrok 4.72026-09-2146Trí tuệ
- OrcaMỚIOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 trên 1 triệu token · 210 tok/s
- OrcaMỚIOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token · 680 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 trên 1 triệu token · 49 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token · 102 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token · 219 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- xAISpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
Qwen 3.8 Max được công bố vào ngày 3 tháng 8 năm 2026 và là cấp độ năng lực cao nhất của Alibaba cho đến nay: đa phương thức gốc, chấp nhận văn bản, hình ảnh và video và trả về văn bản, trên cửa sổ ngữ cảnh 1.000.000 token, được phục vụ thông qua ba định dạng truyền tải — tương thích với OpenAI, tương thích với Anthropic và DashScope gốc — từ Bắc Kinh, Singapore, Tokyo, Frankfurt và Virginia, với giá $2,00 cho mỗi triệu token đầu vào và $6,00 cho mỗi triệu token đầu ra, với đọc được lưu trong bộ nhớ đệm ở mức $0,25. Dots là tác nhân luôn hoạt động của công ty, được công bố tại DevDay vào ngày 29 tháng 9 năm 2026: nó có máy tính đám mây và trình duyệt riêng, tiếp cận hơn 4.000 ứng dụng, chạy trên GPT-6 Astra, và được bao gồm trong Pro và Business Premium. Đặt cạnh nhau, câu hỏi thú vị không phải là cái nào có năng lực hơn. Mà là mỗi cái được phép tồn tại ở bao nhiêu nơi, và ai quyết định.
Đó không phải là một sự phân biệt trừu tượng. Nó chính là điều quyết định liệu một công cụ có mặt trên thị trường của bạn hay không, liệu nó có thể được đội tuân thủ của bạn kiểm toán hay không, và liệu công việc bạn xây dựng dựa trên nó có trụ được qua một thay đổi về điều khoản hay không. Năng lực là phần dễ trong phép so sánh này; tính khả chuyển là phần chỉ được giải quyết muộn màng và tốn kém.
Ba cách để gọi một mô hình
Định dạng truyền tải nghe như một chi tiết kỹ thuật nhỏ, cho đến khi bạn phải chuyển một ứng dụng giữa các nhà cung cấp. Bề mặt tương thích OpenAI nghĩa là các thư viện máy khách hiện có hoạt động mà không cần lớp dịch. Bề mặt tương thích Anthropic nghĩa là một cơ sở mã được viết theo cấu trúc thông điệp của nhà cung cấp khác không phải viết lại. Giao diện DashScope gốc cung cấp toàn bộ tập tính năng, bao gồm cả nút bật/tắt thinking. Ba bề mặt cho một mô hình nghĩa là chi phí chuyển đổi chỉ là một URL cơ sở và một khóa, chứ không phải một cuộc tái cấu trúc.
Điều đó quan trọng nhất khi nó vắng mặt. Một dấu chấm chẳng cung cấp định dạng, URL hay khóa nào cả, bởi vì dấu chấm không phải thứ bạn gọi — nó là thứ bạn trò chuyện cùng bên trong giao diện của người khác. Việc di chuyển logic tác nhân của bạn sang nơi khác có nghĩa là phải xây dựng lại nó, rồi kết nối lại bốn nghìn trình kết nối mà nó đã phụ thuộc vào, rồi phát hiện ra cái nào trong số chúng đã hành xử theo những cách mà bạn chưa từng ghi lại.
• Điều bạn đang mua — một worker được host bên trong ChatGPT, Slack và Teams (Dots) so với một endpoint mô hình mà bạn có thể gọi từ bất kỳ đâu (Qwen 3.8 Max)
• Giao diện — không có công bố nào cho một dot, so với các bề mặt tương thích OpenAI, tương thích Anthropic và DashScope gốc (Qwen 3.8 Max)
• Nơi nó chạy — máy tính đám mây của OpenAI với trình duyệt riêng (Dots) so với năm khu vực được phục vụ trên khắp châu Á, châu Âu và Bắc Mỹ (Qwen 3.8 Max)
• Kiểm soát suy luận — không được hiển thị cho một dấu chấm, so với một công tắc enable_thinking, hoặc reasoning.effort trên Responses API (Qwen 3.8 Max)
• Chi phí trên mỗi đơn vị — dot đầu tiên được bao gồm trong Pro hoặc Business Premium, hạn mức chưa được công bố (Dots), so với $2.00 mỗi triệu input và $6.00 mỗi triệu output, đọc từ bộ nhớ đệm $0.25 (Qwen 3.8 Max)
• Bằng chứng độc lập — bản demo của nhà cung cấp và các tuyên bố về năng lực, không có lấy một benchmark, so với Chỉ số Trí tuệ Artificial Analysis là 45,4 ở vị trí thứ mười lăm trong số 145 mô hình được đo và 92,8 trên GPQA Diamond (Qwen 3.8 Max)
Mô hình đạt đến đâu, qua những con số bạn có thể kiểm chứng.
Hồ sơ được công bố của Qwen 3.8 Max là hồ sơ tiên phong tầm trung, và đáng được đọc một cách chính xác thay vì theo cảm nhận. Chỉ số AA Intelligence Index 45,4, xếp thứ mười lăm trong số 145 mô hình được đo, đưa nó vào top 10% nhưng không đưa nó lên vị trí dẫn đầu. Chỉ số AA Coding Index 76,2, xếp thứ chín trong 138, là mạnh hơn, và 88,8 trên Terminal-Bench 2.1 là một con số thực thi tác tử thực sự cao — cao hơn 88,0 của GPT-5.6 Sol trên cùng bảng xếp hạng. Ở những điểm yếu hơn tương đối, đó là khả năng truy hồi ngữ cảnh dài ở mức 80,3, thấp hơn 88,7 của Kimi K3 và 83 của MiniMax M3 dù kích thước cửa sổ tương đương, cùng SciCode ở mức 52,1.
Định vị của chính Alibaba, trong hướng dẫn chuyển đổi của mình, đặt mô hình này đối đầu trực tiếp với GPT-5.5, Claude Opus 4.7 và Gemini 3.1 Pro, và cách đọc trung thực các con số cho thấy đây là mô hình bạn tìm đến khi sự kết hợp giữa khả năng thực thi tác tử mạnh mẽ và đầu vào đa phương thức quan trọng hơn việc đứng đầu bảng xếp hạng trí tuệ. Tất cả những số liệu đó là các đo lường của bên thứ ba được ghi kèm nguồn trong danh mục của chúng tôi chứ không phải tuyên bố của nhà cung cấp — đó chính là lý do chúng đáng giá hơn một bản trình bày ra mắt.
Một con số đang thiếu và nên được nói thành tiếng thay vì được điền vào: danh mục của chúng tôi không liệt kê độ dài đầu ra tối đa cho mô hình này. Ngữ cảnh một triệu token đã được ghi trong tài liệu; còn giới hạn đầu ra cho mỗi phản hồi thì không.

Những điều Dots không nói với bạn, và tại sao đó là một lựa chọn thiết kế
OpenAI đã công bố một câu về việc một chấm tốn bao nhiêu, và trong đó không có con số nào: chấm đầu tiên được bao gồm trong gói Pro và Business Premium, với giới hạn mở rộng trong tháng đầu tiên và không tiêu hao giới hạn sử dụng ChatGPT cho các cuộc trò chuyện với nó. Ngoài điều đó ra, không có con số hạn mức, không có giá cho chấm thứ hai, không có mức phí cho dung lượng bổ sung và không có chi phí theo từng tác vụ. Gói Pro 500 giá 500 USD mỗi tháng là một hạn mức sử dụng cộng với chế độ Ultrafast, chứ không phải mức giá theo từng chấm, nên ngay cả gói đắt nhất cũng không quy đổi thành chi phí trên mỗi đơn vị công việc của agent.
Thật dễ dẫn đến cách hiểu đó như một lỗ hổng trong tài liệu. Chính xác hơn, nên hiểu đó là vấn đề thuộc về phạm trù: một sản phẩm tính giá theo chỗ ngồi không thể có mức giá theo đơn vị, bởi toàn bộ ý nghĩa của một chỗ ngồi nằm ở chỗ chi phí biên của việc sử dụng nó là vô hình. Điều đó thực sự thuận tiện cho công việc mang tính khám phá, và thực sự bất tiện cho bất cứ thứ gì bạn phải quy về một dự án, một khách hàng hay một dòng ngân sách.
Hãy để ý xem hai sản phẩm được tối ưu hóa cho điều gì. Qwen 3.8 Max được tối ưu hóa để có thể được gọi từ bất cứ đâu, bởi bất cứ thứ gì, ở bất kỳ định dạng nào mà bên gọi vốn đã dùng. A dot được tối ưu hóa để được dùng ở một nơi, bởi một giao diện, với phần hạ tầng ngầm được ẩn đi. Cả hai đều là những thiết kế mạch lạc; chúng chỉ trả lời những câu hỏi khác nhau, và một trong số chúng trả lời câu hỏi "liệu tôi có thể chuyển thứ này đi sau này không" bằng một chữ không.

Hai câu trả lời cho câu hỏi "nếu nhà cung cấp này thay đổi thì sao"
Câu hỏi về tính khả chuyển trở nên cụ thể ngay khi một nhà cung cấp thay đổi giá, ngừng hỗ trợ một định danh hoặc thay đổi nội dung mà một gói đăng ký bao gồm. Với một mô hình tính phí theo lượng sử dụng có ba định dạng truyền tải, cách xử lý chỉ là thao tác cơ học: trỏ client tới một URL cơ sở khác, hoặc thay đổi một chuỗi mô hình, và ứng dụng vẫn tiếp tục hoạt động. Không còn gì khác để chuyển đổi, vì mô hình xưa nay chẳng qua chỉ là một lời gọi.
Đối với một dot, phản ứng trước thay đổi điều khoản là dừng lại. Máy tính, trình duyệt, các trình kết nối và hạn mức đều thuộc về OpenAI, và không thứ nào trong số đó có thể được xuất ra. Đó không phải là lời chỉ trích sản phẩm; đó là mô tả trung thực về việc thuê. Nhưng điều đó có nghĩa là công việc bạn xây dựng hoàn toàn bên trong một dot có lộ trình di trú phải đi qua một lần viết lại, và đó là sự thật đáng để tính vào chi phí trước khi bạn xây dựng thứ mà bạn định phụ thuộc vào trong một năm.
OrcaRouter được xây dựng cho trường hợp đầu tiên. Qwen 3.8 Max được định tuyến dưới dạng qwen/qwen3.8-max theo giá niêm yết của nhà cung cấp Alibaba, được chuyển thẳng với mức chênh lệch 0%, trong cùng danh mục với hơn 200 mô hình khác đằng sau một khóa, với tự động chuyển đổi dự phòng giữa các nhà cung cấp thượng nguồn và một DSL định tuyến để kết hợp nhiều mô hình vào một yêu cầu duy nhất. Đó là điều giúp câu hỏi về ba khu vực có thể được trả lời ở phía bạn thay vì phía nhà cung cấp: cùng một mã định danh tiếp cận mô hình ở bất cứ nơi nào nó được phục vụ, và thay đổi giá từ Alibaba sẽ hiện trên hóa đơn của bạn ngay trong ngày thay vì vào kỳ gia hạn tiếp theo. Điều nó không tiếp cận được là bất cứ thứ gì nằm bên trong một dấu chấm — không có endpoint dành cho một cái như thế, không có mã định danh, và không có trí tuệ thay thế để hoán đổi vào.
Câu hỏi cần đặt ra trước khi bạn cam kết
Hãy hỏi điều gì sẽ xảy ra với công việc của bạn vào ngày nhà cung cấp thay đổi thứ gì đó mà bạn không thể kiểm soát. Nếu câu trả lời là "chúng tôi đổi một chuỗi rồi tiếp tục", thì bạn đang mua một mô hình, và bản tính phí theo mức sử dụng là lựa chọn tốt hơn. Nếu câu trả lời là "chúng tôi sẽ phải xây dựng lại nó", thì bạn đang mua một sản phẩm, và bạn nên mua nó một cách có chủ đích — biết rằng sự tiện lợi mà bạn đang trả tiền được đánh đổi bằng khả năng đảo ngược.
Cả hai câu trả lời đều không sai. Mua tính di động mà bạn sẽ không bao giờ dùng thì cũng lãng phí như mua sự tiện lợi mà bạn sẽ cần phải thoát khỏi. Sai lầm nằm ở chỗ không biết mình đã mua cái nào.

So sánh trong bài viết này2
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
