Thẻ hero có tiêu đề 'MiMo-V2.6-Pro vs MiMo-V2.6' với phụ đề 'Một cái là checkpoint. Một cái là nhãn.', cùng hai bảng: bảng bên trái có tiêu đề 'MiMo-V2.6-Pro' ghi 'Trọng số, giá, chỉ số 46,3' và 'Chi phí mỗi tác vụ $0.13', bảng bên phải có tiêu đề 'MiMo-V2.6' ghi 'Tên của dòng sản phẩm' và 'Bao gồm Pro và Flash', phía trên phần chân trang ghi 'Chênh lệch giá giữa hai checkpoint mà nó bao gồm: 3,1x'.
Guides & Insights

MiMo-V2.6-Pro vs MiMo-V2.6: Khi một cái tên mô hình không còn là một mô hình

Tác giả

Magnus Corvin

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

Artificial Analysis có một trang cho MiMo-V2.5. Nó không có trang nào cho MiMo-V2.6. Sự thiếu vắng đó chính là toàn bộ câu chuyện của màn đối đầu này: ở thế hệ trước, con số phiên bản trần trụi chỉ thẳng vào một checkpoint mà bạn có thể tải về và gọi. Ở thế hệ này thì không. Xiaomi MiMo-V2.6-Pro là một mô hình có trọng số, có giá và có điểm số được đo lường độc lập. "MiMo-V2.6" là một cái nhãn nằm phía trên nó, và hai thứ đó không thuộc cùng một loại sự vật — khiến đây trở thành phép so sánh giữa một checkpoint và một cái tên, chứ không phải giữa hai mô hình.

Điều đó đáng để nói chính xác, vì sự khác biệt có một cái giá đi kèm. Xiaomi MiMo-V2.6-Pro niêm yết ở mức $0.435 cho mỗi triệu token đầu vào và $0.87 cho mỗi triệu token đầu ra. Xiaomi MiMo-V2.6-Flash, checkpoint còn lại mà nhãn đó bao gồm, niêm yết ở mức $0.14 và $0.28. Nếu bạn chọn nhầm một trong số đó vì một danh mục, một tệp cấu hình hoặc một bảng thu mua chỉ ghi "MiMo-V2.6" và không hơn gì, thì bạn đã lệch gấp ba lần trước khi thực hiện dù chỉ một lệnh gọi.

"MiMo-V2.6" phân giải thành gì

Ba thứ khác nhau, tùy vào nơi bạn đọc.

Đầu tiên là dòng sản phẩm. Tài liệu công bố của chính Xiaomi mô tả thế hệ V2.6 gồm hai checkpoint đa phương thức gốc, Pro và Flash, được công bố dưới dạng các lần chạy huấn luyện riêng biệt. Bộ sưu tập Hugging Face chứa chúng được đặt tên đơn giản là MiMo-V2.6 — hiện tại nó liệt kê ba mục, tính cả tầng phục vụ Pro-UltraSpeed, và tên bộ sưu tập đó là nơi khả dĩ nhất để ai đó biết được con số phiên bản trơ trọi và tưởng rằng nó đặt tên cho một mô hình.

Cách thứ hai là cách gọi tắt để chỉ mẫu chủ lực. Trong hầu hết các bài đưa tin về ra mắt và trong hầu hết các cuộc trò chuyện dùng cách gọi tắt, "MiMo-V2.6" ám chỉ phân khúc nghìn tỷ tham số, vì đó là mô hình mà các bài đưa tin nói đến. Đây là cách diễn giải ít gây tổn hại nhất, vì nó thường quy về mô hình mà mọi người muốn nói.

Điều thứ ba là điều tốn tiền: một danh mục hoặc cấu hình trong đó "MiMo-V2.6" đã bị quy về bất kỳ checkpoint nào mà nhà cung cấp đó tình cờ phục vụ. Các kho lưu trữ được đặt tên là MiMo-V2.6-Pro-RL và MiMo-V2.6-Flash-RL, và hậu tố -RL là phả hệ hậu huấn luyện chứ không phải một adapter gắn trên mô hình nền — một chi tiết đáng biết trước khi bạn đi tìm các trọng số non-RL đi kèm với chúng, bởi vì không có cái nào cả.

Phân khúc tầm trung đã không còn tồn tại

Sự mơ hồ này là mới, và lý do là phần giữa của đội hình đã biến mất.

Artificial Analysis vẫn liệt kê một mô hình tên MiMo-V2.5, ra mắt ngày 22 tháng 4 năm 2026, đạt 25.17 trên chỉ số với mức $0.14 mỗi triệu token đầu vào và $0.28 token đầu ra, có trọng số mở. Nó nằm dưới MiMo-V2.5-Pro, mô hình đạt 26.0 trên cùng thang điểm với mức $0.435 và $0.87, ngữ cảnh 1M và tổng cộng 1023B tham số. Đó là một thế hệ ba nấc: một mô hình rẻ chỉ có tên trần, một mô hình chủ lực, và không có gì buộc bạn phải chọn giữa hai thái cực.

Thế hệ V2.6 có hai bậc mà bất kỳ ai cũng có thể gọi: Pro ở trên cùng và Flash ở dưới cùng. Không có checkpoint tầm trung nào để hấp thụ lưu lượng nằm giữa chúng, và không có tài liệu ra mắt nào mô tả một cái như vậy. Xiaomi có công bố một điểm khởi đầu MiMo-V2.6-Distill-Qwen-9B và một khung RL cùng với trọng số, nhưng một điểm khởi đầu chưng cất cho công việc huấn luyện không phải là một tầng trung được host dành cho suy luận.

Trên thực tế, điều đó có nghĩa là quyết định mà trang này mô tả — Pro hay tên gọi trần — thực chất là quyết định về việc bạn đang đứng ở nấc nào. Nếu điều bạn thực sự muốn là vị trí MiMo-V2.5 cũ, thì thứ gần nhất trong thế hệ mới là Flash, với cùng mức $0.14/$0.28 và đi kèm một tuyên bố về năng lực cao hơn nhiều.

Two-column scoreboard headed 'MiMo-V2.6-Pro vs MiMo-V2.6 — the scoreboard'. The left column, MiMo-V2.6-Pro, reads What it is a checkpoint, Index 46.3 measured, Price $0.435 / $0.87, Weights MIT on Hugging Face, Context 1M tokens, API providers one. The right column, MiMo-V2.6, reads What it is the series label, Index not measured, Price $0.14 to $0.87, Weights held by Pro and Flash, Context 1M on both, API providers none per the model cards. A footer reads 'Pro figures measured by Artificial Analysis v4.3.2; series facts per Xiaomi's release material.'

Bản nâng cấp ẩn sau cái tên

Gạt bỏ câu hỏi về tên gọi sang một bên, bên dưới nó là một sự thật rõ ràng, lớn lao, có đầy đủ bằng chứng, rằng mẫu flagship đã tiến một quãng đường dài chỉ trong một thế hệ mà không thay đổi giá.

• Điểm chỉ số — MiMo-V2.5-Pro đạt 26.0 trên Artificial Analysis Intelligence Index, so với 46.3 của Xiaomi MiMo-V2.6-Pro, cả hai đều do Artificial Analysis đo lường chứ không phải Xiaomi
• Giá mỗi token — không đổi: $0.435 đầu vào, $0.87 đầu ra, ở cả hai thế hệ
• Chi phí mỗi tác vụ chỉ số — $0.054 cho MiMo-V2.5-Pro so với $0.1332 cho MiMo-V2.6-Pro, mức tăng đến từ việc diễn đạt dài dòng chứ không phải từ thay đổi đơn giá
• Tham số — tổng 1023B và 42B hoạt động, so với tổng 1.02T và 42B hoạt động
• Ngữ cảnh — 1M token, không đổi
• Giấy phép — MIT, không đổi
• Ngày phát hành — 22 tháng 4 năm 2026, so với 21 tháng 9 năm 2026

Điểm số là phần quan trọng và cũng là phần mà cách đặt tên che khuất. Hai mươi điểm chỉ số trong năm tháng, trên một bảng giá không đổi, là một bước tiến thế hệ lớn hơn so với cách mà tin tức về bản phát hành đã khắc họa — phần lớn trong đó đổ dồn vào "mô hình open-weights hàng đầu", vốn là một tuyên bố về lĩnh vực chứ không phải về bản nâng cấp. Nếu bạn đang vận hành mẫu flagship trước đó và tự hỏi liệu việc chuyển đổi có đáng với công sức kỹ thuật hay không, thì dòng đó chính là câu trả lời, và nó là một lập luận mạnh mẽ hơn bất cứ điều gì trong tài liệu tiếp thị.

Lưu ý này cũng chính là lưu ý đi kèm với mọi con số từ Xiaomi trong bản phát hành này. Cả 26.0 và 46.3 đều là các phép đo của Artificial Analysis, điều này khiến chúng có thể so sánh với nhau và với các mô hình khác trên cùng phiên bản chỉ số. Các bảng benchmark của chính nhà cung cấp — DeepSWE v1.1, Terminal Bench, AutomationBench và những bảng còn lại — thì không phải vậy, và không nên dùng chúng để tính mức chênh lệch nâng cấp. Việc trộn một điểm số đo lường với một điểm số của nhà cung cấp để tạo ra con số "điểm tăng thêm" là lỗi phổ biến nhất trong các bài đưa tin về bản phát hành này.

Tại sao một cái tên lại là một vấn đề vận hành

Không có điểm nào trong số này là chuyện vụn vặt một khi cái nhãn đó đi vào một hệ thống. Một định danh mô hình mà phân giải thành hai checkpoint với mức chênh lệch giá 3.1x là một sự cố thanh toán chỉ chờ ngòi nổ, và có ba chỗ mà nó chắc chắn sẽ sai. Các tệp cấu hình và môi trường, nơi một chuỗi như mimo-v2.6 được ghi một lần rồi không bao giờ xem lại. Các bảng chi phí, nơi một ước tính theo token được gắn vào tên dòng sản phẩm rồi sau đó bị áp nhầm cho hạng sai. Và các dòng đánh giá, nơi một kết quả được xếp vào dòng họ rồi về sau được đọc như một thuộc tính của mẫu chủ lực.

Có một điểm thứ tư, và đây chính là điểm đã gây ảnh hưởng trực tiếp đến bản phát hành này: số lượng tham số. Xiaomi MiMo-V2.6-Pro được tài liệu ghi nhận ở mức tổng 1,02T và 42B hoạt động, còn kho Hugging Face của nó báo kích thước mô hình Safetensors là 524B. MiMo-V2.6-Flash được tài liệu ghi ở mức xấp xỉ 309B tổng và 15B hoạt động, còn kho của nó báo 159B. Không cặp nào trong hai cặp này khớp với nhau. Nếu kế hoạch hóa năng lực của bạn đọc thẻ mô hình và việc cấp phát của bạn đọc kho lưu trữ, bạn sẽ định cỡ cùng một triển khai theo hai cách khác nhau.

Hãy ghim tên checkpoint ở mọi nơi, chứ không phải tên chuỗi. Đó là toàn bộ biện pháp khắc phục, và nó chẳng tốn kém gì cho đến ngày nó giúp tiết kiệm ngân sách của cả một quý.

Screenshot of the Hugging Face model page for XiaomiMiMo/MiMo-V2.6-Pro-RL, showing the repository name, MIT licence and fp8 tags, a Safetensors panel reporting a model size of 524B parameters, an Inference Providers panel stating 'This model isn't deployed by any Inference Provider', a collection block headed MiMo-V2.6 holding three items, and the model card introduction describing MiMo-V2.6-Pro-RL as the flagship checkpoint of the MiMo-V2.6 series with native omnimodal input and a 1M-token context.

Điều này phân giải như thế nào trên bộ định tuyến

Vấn đề đặt tên là vấn đề danh mục, và danh mục chính là nơi dễ sửa nhất. Việc gọi tên các mô hình bằng định danh chính xác thông qua một API key, thay vì bằng tên dòng họ xuyên qua nhiều tài khoản nhà cung cấp, có nghĩa là chuỗi ký tự trong config của bạn cũng chính là chuỗi mà hệ thống tính phí nhìn thấy — đó chính là đặc tính mà một cái tên như "MiMo-V2.6" phá hỏng. Đó cũng là lý do chúng tôi chuyển tiếp nguyên vẹn giá niêm yết của nhà cung cấp với mức markup 0% thay vì áp biên lợi nhuận của riêng mình: giá trên trang là giá mà nhà cung cấp đã đặt, nên một bậc mà bạn nhận diện sai sẽ sai theo cùng một hướng đối với tất cả mọi người, thay vì sai theo một hướng riêng của chúng tôi.

Nói thẳng về các giới hạn: chúng tôi không lưu trữ checkpoint MiMo-V2.6 nào, nên hiện tại cả hai đều không thể được định tuyến qua chúng tôi, và theo chính kho Hugging Face của nó, cả hai đều không được triển khai bởi bất kỳ nhà cung cấp suy luận bên thứ ba nào. Con đường đến với cả hai là nền tảng riêng của Xiaomi và các danh mục có chứa nó. Nhưng kỷ luật định danh mà trang này đang lập luận áp dụng cho mọi mô hình bạn gọi, và đó là lý do một lớp định tuyến vẫn đáng có ngay cả với những mô hình bạn chưa định tuyến.

Điều cần rút ra

Nếu bạn đến đây để so sánh hai mô hình, thì việc so sánh không có sẵn — một trong những thứ này không phải là mô hình. Xiaomi MiMo-V2.6-Pro là checkpoint: 46,3 trên chỉ số, 0,435 USD và 0,87 USD mỗi triệu token, trọng số MIT, ngữ cảnh 1M, và là mục trọng số mở duy nhất trên đường Pareto chi phí của Artificial Analysis nằm phía trên tầng gần như miễn phí. MiMo-V2.6 là nhãn phía trên nó và cũng là nhãn bên cạnh nó, bao trùm một checkpoint rẻ hơn với mức giá chỉ bằng một phần ba và một tầng phục vụ nhanh hơn với mức giá gấp mười lần.

Thay vào đó, phép so sánh đáng thực hiện chính là phép so sánh mà cách đặt tên đang che giấu: mẫu flagship của thế hệ này so với mẫu cuối cùng chỉ mang một số phiên bản trần. Hai mươi điểm chỉ số, năm tháng, tỷ lệ không đổi. Đó mới là con số cần đặt trước mặt người phê duyệt việc di chuyển — không phải con số về việc đứng đầu bảng xếp hạng.

Screenshot of the Artificial Analysis model page for MiMo-V2.5-Pro, showing 'Released April 2026', an Intelligence card reading 26 ranked #24 of 114, a Speed card reading 45.9 output tokens per second, a Cost card reading $0.435 in and $0.87 out per million tokens with a 99% cache discount and $0.05 cost per Intelligence Index task ranked #3 of 114, a Verbosity card reading 110M output tokens, and a technical specifications panel listing 1M context window, 1.0T total parameters, 42B active, MIT licence and weights on Hugging Face.