
MiMo-V2.6-Pro đưa trọng số mở lên đường Pareto với 0,13 USD mỗi tác vụ
- OrcaMỚIOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 trên 1 triệu token
- orcaMỚIOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token
- deepseekMỚIDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- openaiOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- googleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- anthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- grokSpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
- metaMeta: Muse Spark 1.22026-08-0540Trí tuệ72Lập trình
- qwenQwen: Qwen3.8 Max2026-08-0345Trí tuệ76Lập trình
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Trí tuệ69Lập trình
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 trên 1 triệu token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Xiaomi MiMo-V2.6-Pro đã được đăng tải trên Hugging Face vào ngày 21 tháng 9 năm 2026, và con số được nhắc đến nhiều nhất kể từ đó là 46 — điểm số của nó trên Artificial Analysis Intelligence Index v4.3.2, mức cao nhất mà bất kỳ mô hình trọng số mở nào từng đạt được trên chỉ số tổng hợp đó. Con số quyết định liệu bạn có thực sự chạy được nó hay không thì nhỏ hơn. Artificial Analysis đã đo được 0,1332 USD chi phí tính toán cho mỗi tác vụ Intelligence Index khi đánh giá MiMo-V2.6-Pro trên hệ thống kiểm thử riêng của mình, và con số đó đưa mô hình lên đường Pareto trong biểu đồ Intelligence-versus-Cost-per-Task của trang web. Trên ngưỡng làm tròn, đây là mô hình trọng số mở duy nhất nằm trên đường đó.
Đó là một tuyên bố hẹp hơn và hữu ích hơn so với "mô hình open-weights hàng đầu", vốn là cách mà phần lớn các bài đưa tin ra mắt đã mô tả nó. Đứng đầu trên trục trí tuệ cho bạn biết mức trần. Nằm trên đường cong chi phí cho bạn biết liệu có thứ gì khác trên thị trường thực sự tốt hơn hẳn ở mức giá đó hay không. Với Xiaomi MiMo-V2.6-Pro, tại thời điểm viết bài này, thì không có gì cả.
Đường Pareto thực sự đo lường điều gì
Biểu đồ vẽ tất cả mô hình mà Artificial Analysis đã đánh giá trên hai trục: một trục là Intelligence Index, trục kia là chi phí đô-la trung bình có trọng số để tạo ra một tác vụ chỉ số. Một mô hình nằm trên đường Pareto không thể bị bất kỳ mô hình đơn lẻ nào khác đánh bại trên cả hai trục — bạn không thể tìm được thứ gì đó thông minh hơn với chi phí thấp hơn. Các điểm nằm dưới và bên trái đường này bị chi phối và rơi khỏi đường.
Chúng tôi đã tính toán lại đường biên từ dữ liệu được nhúng trong biểu đồ thay vì đọc đường bằng mắt. Dựa trên 326 mô hình có cả điểm chỉ số và chi phí đo được cho mỗi tác vụ, đường biên hiện tại gồm mười bốn điểm:
• Qwen3.5 2B (Không suy luận) — chỉ số 6.2, chi phí mỗi tác vụ làm tròn thành $0.000, trọng số mở
• Devstral 2 — chỉ số 8.6, chi phí mỗi tác vụ làm tròn thành $0.000, trọng số mở
• North Mini Code — chỉ số 9.9, chi phí mỗi tác vụ làm tròn thành $0.000, trọng số mở
• Claude Sonnet 4.6 (Không suy luận, Nỗ lực cao) — chỉ số 24.7, chi phí mỗi tác vụ làm tròn thành $0.000, đóng
• Grok Build 0.1 0616 — chỉ số 27.2, chi phí mỗi tác vụ $0.006, đóng
• GPT-5.6 Luna (cao) — chỉ số 32.1, chi phí mỗi tác vụ $0.044, đóng
• GPT-5.6 Luna (cực cao) — chỉ số 34.6, chi phí mỗi tác vụ $0.085, đóng
• Xiaomi MiMo-V2.6-Pro — chỉ số 46.3, chi phí mỗi tác vụ $0.133, trọng số mở được cấp phép MIT
• GPT-6 Astra (trung bình) — chỉ số 49.6, chi phí mỗi tác vụ $1.541, đóng
• GPT-6 Astra (cao) — chỉ số 50.9, chi phí mỗi tác vụ $1.725, đóng
• GPT-6 Astra (cực cao) — chỉ số 52.4, chi phí mỗi tác vụ $2.309, đóng
• GPT-6 Astra (tối đa) — chỉ số 52.7, chi phí mỗi tác vụ $3.258, đóng
• Claude Fable 5.1 (cực cao, dự phòng mặc định) — chỉ số 53.2, chi phí mỗi tác vụ $5.978, đóng
• Claude Fable 5.1 (tối đa, dự phòng mặc định) — chỉ số 53.4, chi phí mỗi tác vụ $7.630, đóng
Có ba điều rút ra từ danh sách đó. Bốn điểm rẻ nhất là những mô hình có chi phí đo được làm tròn về 0 ở bốn chữ số thập phân, nên phần thú vị của đường cong bắt đầu từ Grok Build 0.1 0616. Xiaomi MiMo-V2.6-Pro là một điểm khuỷu thực sự trên đường cong đó, không phải là hệ quả của việc làm tròn: điểm kế tiếp cao hơn có chi phí mỗi tác vụ cao gấp 11,6 lần để đổi lấy thêm 3,3 điểm chỉ số. Và trong số mười điểm biên có chi phí khác 0, đúng một điểm là mô hình trọng số mở — đó chính là sự thật mà cách diễn đạt “mô hình trọng số mở hàng đầu” che lấp. Mô hình trọng số mở gần nhất trên trục trí tuệ, GLM-5.3 (max) ở mức 44,8, thì không hề nằm gần đường đó: nó tốn $2,006 cho mỗi tác vụ chỉ số, gấp mười lăm lần con số của MiMo-V2.6-Pro. Kimi K3 (max) nằm ở mức 43,6 và $2,000 mỗi tác vụ.

Bảng giá không thay đổi. Nhưng hóa đơn thì có.
Xiaomi không tăng giá cho thế hệ này. MiMo-V2.6-Pro có giá niêm yết là 0,435 USD cho mỗi triệu token đầu vào và 0,87 USD cho mỗi triệu token đầu ra, với giá token đầu vào khi trúng bộ nhớ đệm là 0,0036 USD — mức giảm 99,17% — đây cũng chính là biểu giá mà mẫu flagship trước đó áp dụng. Khi pha trộn theo tỷ lệ 7:2:1 giữa trúng bộ nhớ đệm/đầu vào/đầu ra, con số đó tính ra là 0,1765 USD mỗi triệu token.
Vậy mà chi phí chạy Intelligence Index trên MiMo-V2.6-Pro lên tới 206,66 USD, tức 0,1332 USD mỗi tác vụ, trong khi cùng chỉ số đó trên MiMo-V2.5-Pro chỉ tốn 0,054 USD mỗi tác vụ. Artificial Analysis ghi nhận 140 triệu token đầu ra cho mô hình mới so với 110 triệu cho mô hình cũ, trên cùng một bộ kiểm thử. Bảng giá không đổi; mô hình chỉ đơn giản là viết nhiều hơn để trả lời cùng một câu hỏi. Đó là điểm cần nói rõ một cách trung thực đối với vị thế Pareto — Xiaomi MiMo-V2.6-Pro giành được vị trí của mình trên trục chi phí bất chấp việc trở nên dài dòng hơn, chứ không phải vì nó trở nên rẻ hơn.
Với bất kỳ ai đang lập ngân sách, cách hiểu thực tế là giá theo token giờ đây là một chỉ báo yếu về chi phí của một khối lượng công việc. Hai mô hình có cùng bảng giá có thể chênh lệch 2,5 lần về chi phí cho mỗi tác vụ hoàn thành. Chiết khấu cache là đòn bẩy tạo ra khác biệt lớn nhất: ở mức $0.0036 cho mỗi triệu token đầu vào được cache, sự khác biệt giữa một prompt tái sử dụng ngữ cảnh và một prompt không tái sử dụng lớn hơn sự khác biệt giữa hầu hết các cặp mô hình trong danh sách này.
Điểm số bao gồm và không bao gồm những gì
Con số 46 là một phép đo của bên thứ ba, và điều đó quan trọng vì gần như mọi thứ khác được công bố về MiMo-V2.6-Pro thì không phải vậy. Phiên bản chỉ mục cũng quan trọng: v4.3.2 là một tổ hợp gồm mười bài đánh giá bao quát suy luận, kiến thức, toán học và lập trình, và một điểm số chỉ có thể so sánh với các điểm số khác trên cùng phiên bản. Các số liệu do nhà cung cấp Xiaomi công bố cùng với bản phát hành — DeepSWE v1.1 ở mức 71.9, AutomationBench v1.0.6 ở mức 53.1, Toolathlon-Verified ở mức 76.9, Terminal Bench 2.1 ở mức 89.9, CyberGym ở mức 94.0 — đến từ bộ kiểm thử và trình chấm điểm của chính Xiaomi và chưa được bất kỳ ai tái lập. Chúng hữu ích như bằng chứng định hướng về việc mô hình được tinh chỉnh cho điều gì; chúng không phải là các mục trên bảng xếp hạng.
Nửa còn lại của bản phát hành là gói trọng số mở. Artificial Analysis liệt kê mô hình với tổng cộng 1,0T tham số, 42B tham số hoạt động, cửa sổ ngữ cảnh 1M token, đầu vào văn bản, hình ảnh, giọng nói và video với đầu ra văn bản, cùng giấy phép MIT với trọng số trên Hugging Face. Bản thân kho lưu trữ báo cáo kích thước mô hình Safetensors là 524B tham số — con số thứ ba không khớp với cả tổng 1,0T lẫn số lượng 42B hoạt động, và là con số mà Xiaomi vẫn chưa làm rõ. Nếu bạn đang lên kế hoạch triển khai tự lưu trữ, sự khác biệt đó đáng để giải quyết trước khi bạn cấp phát bất cứ thứ gì, vì một checkpoint FP8 524B và một checkpoint 1T là hai câu chuyện phần cứng khác nhau.

Một điểm biên mà bạn hiện không thể định tuyến.
Tình trạng sẵn có là khía cạnh hạn chế nhất của bản phát hành này. Khi Artificial Analysis đánh giá Xiaomi MiMo-V2.6-Pro, họ chỉ ghi nhận một nhà cung cấp API duy nhất cho mô hình này. Kho lưu trữ Hugging Face cho biết Xiaomi MiMo-V2.6-Pro không được triển khai bởi bất kỳ nhà cung cấp suy luận nào. Chúng tôi cũng không lưu trữ mô hình này, và chúng tôi sẽ không ngụ ý điều ngược lại — con đường đến với mô hình này hiện nay là nền tảng của chính Xiaomi và các danh mục của bên thứ ba có liệt kê nó.
Đó là một vấn đề chuyển đổi dự phòng chứ không phải vấn đề chất lượng, và đó chính là vấn đề mà một router sinh ra để giải quyết. Một API cho hàng trăm mô hình, với khả năng chuyển đổi dự phòng tự động giữa các nhà cung cấp, chính là thứ biến "hiện tại chỉ có một nhà cung cấp liệt kê mô hình này" từ một rủi ro về kiến trúc thành một chi tiết cấu hình. Đó cũng là cách bạn sẽ triển khai dần một cuộc di trú sang một mô hình mới đến vậy: gửi một phần lưu lượng đến Xiaomi MiMo-V2.6-Pro, giữ một mô hình đã được kiểm chứng ở phía sau, và để router chuyển yêu cầu thay vì ca trực on-call của bạn. Cách đó hiệu quả với những mô hình chúng tôi cung cấp. Còn với mô hình này, cho đến khi nó có thể được định tuyến, lời khuyên trung thực là hãy giữ nó ngoài đường dẫn quan trọng.
Điều gì sẽ khiến nó rời khỏi đường?
Vị thế Pareto chỉ là một ảnh chụp nhanh, không phải là một thuộc tính của mô hình. Ba điều có thể thay đổi nó. Một đợt giảm giá từ Xiaomi sẽ đẩy Xiaomi MiMo-V2.6-Pro xa hơn về phía bên trái và khiến nó khó bị đánh bại hơn — và vì chúng tôi chuyển nguyên giá niêm yết của nhà cung cấp với mức markup 0%, một đợt giảm giá như vậy sẽ có hiệu lực ngay ở phía chúng tôi cùng ngày nó xuất hiện ở bất cứ đâu. Một mô hình rẻ hơn đạt điểm trên 46,3 sẽ đánh bật nó hoàn toàn khỏi vị trí đó; GPT-6 Astra (low) hiện đã ở mức 45,8 với 0,818 đô la một tác vụ, đắt hơn nhưng lại gần đến mức đáng lo ngại trên trục trí tuệ. Và việc đánh giá độc lập MiMo-V2.6-Flash — hiện chưa có trang Artificial Analysis nào cả — có thể tiết lộ rằng người anh em rẻ hơn này đang chiếm một vị trí tốt hơn trên đường cong đối với hầu hết các loại khối lượng công việc.
Hiện tại, phát biểu có thể đứng vững được là phát biểu mang tính số học. Ở phiên bản chỉ số hiện tại, với mức giá đã công bố hiện tại, không có mô hình nào trên thị trường vừa rẻ hơn trên mỗi tác vụ vừa thông minh hơn Xiaomi MiMo-V2.6-Pro. Liệu điều đó có trụ vững qua lần tái lập độc lập đầu tiên hay không chính là câu hỏi đáng để theo dõi.

