Một thẻ tiêu đề được tạo ghi MiMo-V2.6-Pro vs GPT-5.6 Sol, với phụ đề gấp 15 lần chi phí cho mỗi tác vụ để có một điểm chỉ số nằm bên dưới và ba biểu tượng đường nét phẳng phía trên tiêu đề gợi ý một đồng hồ đo chi phí, một bảng điểm và một thông báo ghi ngày. Logo OrcaRouter được ghép vào góc dưới bên phải.
Guides & Insights

MiMo-V2.6-Pro vs GPT-5.6 Sol: Một điểm chỉ số tốn chi phí gấp mười lăm lần cho mỗi tác vụ

Tác giả

Elias Hawthorne

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình →
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

Trên Artificial Analysis Intelligence Index v4.3.2, đọc vào ngày 25 tháng 9 năm 2026, GPT-5.6 Sol ở mức nỗ lực tối đa đạt 47 điểm và MiMo-V2.6-Pro của Xiaomi đạt 46 điểm. Một điểm. Con số thực sự phân tách chúng không phải là điểm số, cũng không phải là mức giá trên mỗi token — mà là chi phí cho một tác vụ chỉ số duy nhất, thứ mà Artificial Analysis công bố là 1,99 USD cho GPT-5.6 Sol và 0,13 USD cho MiMo-V2.6-Pro. Gấp mười lăm lần số tiền cho một điểm. Và tính đến thời điểm đọc này, trang của chính đơn vị đánh giá dành cho mô hình đó có mang thông báo ngừng hỗ trợ, vì GPT-6 Sol đã thay thế nó.

Xiaomi đã công bố trọng số và báo cáo kỹ thuật của MiMo-V2.6-Pro vào ngày 21 tháng 9 năm 2026, bốn ngày trước bản đọc này; OpenAI đã phát hành GPT-5.6 Sol vào ngày 9 tháng 7 năm 2026. Cả hai sự kiện trên đều mới kể từ lần cuối cặp so sánh này được viết, và chúng kéo theo hai hướng ngược nhau. Thông báo ngừng hỗ trợ nói rằng so sánh này là với một mô hình mà OpenAI đã vượt qua từ lâu. Con số theo từng tác vụ nói rằng thứ trông như một sai số làm tròn khi cả hai mô hình được báo giá theo giá niêm yết, trên một khối lượng công việc thực tế, lại chính là toàn bộ quyết định. Điều nào trong hai điều đó quan trọng phụ thuộc vào việc bạn đang mua một mô hình hay đang thay thế một mô hình.

Hai trang bây giờ nói gì

GPT-5.6 Sol được phát hành vào ngày 9 tháng 7 năm 2026 với tư cách là mẫu chủ lực của dòng GPT-5.6. Giá niêm yết của nó là 4,00 USD cho mỗi triệu token đầu vào và 20,00 USD cho mỗi triệu token đầu ra trên API chính thức của OpenAI, với mức chiết khấu bộ nhớ đệm 90%, và trang ghi nhận 90 triệu token đầu ra được tạo ra trong toàn bộ lần chạy chỉ mục so với mức trung vị 88 triệu. Nó đạt 73 token đầu ra mỗi giây, mà cùng trang đó gọi là nhanh hơn mức trung bình so với trung vị 72 t/s. Mục chỉ mục của nó nằm ở hạng 19 trong số 210 mô hình cùng loại.

Xiaomi MiMo-V2.6-Pro là một checkpoint mixture-of-experts thưa với 1,02 nghìn tỷ tham số tổng và 42 tỷ tham số hoạt động, được cấp phép MIT, có cửa sổ ngữ cảnh 1 triệu token và đầu vào văn bản, hình ảnh, giọng nói cùng video, đầu ra văn bản. Nó được niêm yết ở mức 0,43 USD và 0,87 USD cho mỗi triệu token với chiết khấu cache 99% — bằng một phần mười mức giá đầu vào của Sol và một phần hai mươi ba mức giá đầu ra của nó. Nó đã tạo ra 140 triệu token đầu ra trong lần chạy index, và đo được 43,6 token đầu ra mỗi giây, mức mà trang của nó mô tả là chậm đáng chú ý so với trung vị 67,1 t/s.

• Chi phí tác vụ index — MiMo-V2.6-Pro $0.13; GPT-5.6 Sol $1.99 — khoảng cách là 15× • Giá niêm yết — MiMo-V2.6-Pro $0.43 / $0.87 mỗi 1M; GPT-5.6 Sol $4.00 / $20.00 • Chiết khấu cache — MiMo-V2.6-Pro 99%; GPT-5.6 Sol 90% • Token đầu ra trong lần chạy index — MiMo-V2.6-Pro 140M; GPT-5.6 Sol 90M • Tốc độ đầu ra — MiMo-V2.6-Pro 43,6 t/s, so với trung vị 67,1; GPT-5.6 Sol 73 t/s, so với trung vị 72 • Ngữ cảnh và trọng số — MiMo-V2.6-Pro 1M và được cấp phép MIT; GPT-5.6 Sol 1M và độc quyền

A two-column scoreboard titled MiMo-V2.6-Pro vs GPT-5.6 Sol - the scoreboard, subtitled Fifteen times the cost per index task, for one index point. The left column, Xiaomi MiMo-V2.6-Pro, reads Intelligence Index v4.3.2 46; cost per index task $0.13; list price $0.43 / $0.87 per 1M; cache discount 99%; output speed 43.6 tokens per second; 140M output tokens on the index run; 1M context. The right column, GPT-5.6 Sol (max), reads Intelligence Index v4.3.2 47; cost per index task $1.99; list price $4.00 / $20.00 per 1M; cache discount 90%; output speed 73 tokens per second; 90M output tokens; 1M context, and carries a tag reading Proprietary - deprecated. A footer line reads Artificial Analysis Intelligence Index v4.3.2, read 25 September 2026, and a warning line below it notes that the evaluator's GPT-5.6 Sol page now carries a deprecation notice and that it is superseded by GPT-6 Sol (max). The OrcaRouter logo is composited in the bottom-right corner.

Thông báo ngừng hỗ trợ mới là dòng quan trọng hơn.

Artificial Analysis hiện mở trang GPT-5.6 Sol với một thông báo đóng khung: “Mô hình này đã bị ngừng hỗ trợ. Chúng tôi chỉ tiếp tục đo chuẩn hiệu năng cho khối lượng công việc đầu vào mặc định 10k token”, tiếp theo là câu nói rằng OpenAI đã ra mắt một mô hình mới hơn, GPT-6 Sol (max), và nên được cân nhắc thay thế. Do đó, con số 47 trên chỉ số là kết quả đọc của một mô hình không còn là thứ nên mua nữa. Điều đó không làm cho kết quả đọc trở nên sai — nó được đo trên cùng chỉ số, cùng ngày, cùng thiết lập mức nỗ lực như 46 — nhưng nó thay đổi mục đích của việc so sánh. Nó không còn là “tôi nên dùng mẫu flagship nào”. Mà là “đỉnh của bảng độc quyền tốn bao nhiêu, tại thời điểm nó còn là đỉnh”.

Việc diễn đạt lại như vậy quan trọng hơn vẻ ngoài của nó, bởi vì các thông báo ngừng hỗ trợ trên trang đánh giá là một trong số ít nơi mà nhịp ra sản phẩm của nhà cung cấp xuất hiện dưới dạng một thay đổi dữ liệu thay vì một thông cáo báo chí. Điểm số đã bị đóng băng; mô hình không còn được cung cấp. Bất cứ thứ gì bạn xây dựng dựa trên 47 đều là đang xây dựng dựa trên một bản chụp nhanh.

Screenshot of the Artificial Analysis model page for Xiaomi MiMo-V2.6-Pro, captured 25 September 2026. The header shows an Openweights model badge with Released September 2026, 46 on the Artificial Analysis Intelligence Index, 43.6 output tokens per second, $0.43 input and $0.87 output per 1M tokens with a 99% cache discount, and $0.13 per task to evaluate on the Intelligence Index; the summary paragraph calls the model notably slow, and the verbosity line shows 140M output tokens generated on the index run against a median of 140M.

Vì sao con số theo từng tác vụ mới là con số cần lấy làm chuẩn để mô hình hóa

Đơn giá theo token tô vẽ đẹp cho các mô hình rẻ và gây hiểu lầm với những khối lượng công việc không trung tính về token. Chi phí tác vụ chỉ mục là một phép đo khác: đó là số tiền mà trình đánh giá thực sự đã chi ra để nhận được một câu trả lời từ mỗi mô hình, bao gồm cả đơn giá lẫn số token mà mô hình chọn phát ra. MiMo-V2.6-Pro phát ra nhiều token hơn Sol trong lần chạy chỉ mục — 140 triệu so với 90 triệu, khoảng 1,6 lần — và vẫn tốn $0.13 mỗi tác vụ so với $1.99. Lợi thế về đơn giá là khoảng hai mươi ba lần trên đầu ra; mức phạt vì dài dòng là 1,6×; tích của hai yếu tố này là khoảng cách mười lăm lần trên mỗi tác vụ.

Đó là phép tính mà một mô hình chi phí nên được xây dựng dựa trên, và đó là phép tính vô hình nếu bạn so sánh $0.87 với $20.00 rồi dừng lại. Nó cũng cho bạn biết điều gì sẽ phá vỡ kết luận. Nếu khối lượng công việc của bạn bị chi phối bởi các đầu ra rất ngắn, số token của Sol thu hẹp về phía của bạn và khoảng cách tỷ lệ gấp hai mươi ba lần làm phần lớn công việc, vì vậy bội số thực tế dịch chuyển về phía khoảng cách tỷ lệ thay vì rời xa nó. Nếu khối lượng công việc của bạn bị chi phối bởi các dấu vết suy luận dài, độ dài dòng 1.6× của MiMo-V2.6-Pro tích lũy và $0.13 trở thành mức trần thay vì ước tính. Con số được công bố là phép đo hình dạng của một benchmark, không phải một báo giá bạn có thể đưa cho bộ phận tài chính.

Đường độ trễ là đối trọng trung thực

Với 43.6 token đầu ra mỗi giây, MiMo-V2.6-Pro chậm hơn GPT-5.6 Sol được đo cùng ngày ở mức 73 — và chậm hơn cả những mô hình mà trang của chính nó đem ra so sánh, với trung vị là 67.1. Trang của nó cũng nói thẳng như vậy: “chậm một cách đáng chú ý”. Với một pipeline theo lô, đây là chi phí thông lượng mà bạn có thể định giá. Với một tác nhân tương tác, đó là một quyết định sản phẩm, và việc rẻ hơn mười lăm lần cho mỗi tác vụ không làm cho một mô hình chậm trở nên nhanh. Nếu ràng buộc của bạn là ngân sách mỗi lượt chứ không phải hóa đơn hàng tháng, thì tỷ lệ đáng quan tâm là 43.6 so với 73, và MiMo-V2.6-Pro thua ở đó.

Nơi điều này kết thúc trên một bộ định tuyến

Hình dạng hữu ích của sự ghép cặp này không phải là “chọn một”. Mà là cả hai mô hình đều trả lời cùng một chỉ mục và trình đánh giá công bố chi phí theo từng tác vụ cho mỗi mô hình, nhờ đó có thể phân chia dựa trên chi phí đo được thay vì dựa trên các bậc nhà cung cấp. Trên OrcaRouter, danh mục lên tới hơn 200 mô hình phía sau một khóa duy nhất, ở mức giá niêm yết của từng nhà cung cấp với 0% phụ phí — một đợt giảm giá của nhà cung cấp sẽ đến hóa đơn của bạn ngay trong cùng ngày, không cần đàm phán lại hợp đồng thứ hai — và DSL định tuyến cho phép một khối lượng công việc gửi các cuộc gọi rẻ, khối lượng lớn đến một mô hình và những cuộc gọi khó đến một mô hình khác theo tác vụ thay vì theo thương hiệu. Tính năng chuyển đổi dự phòng tự động xử lý trường hợp tuyến rẻ hơn bị suy giảm. Xiaomi MiMo-V2.6-Pro không nằm trong các tuyến của chúng tôi — chúng tôi không niêm yết một mô hình trước khi nhà cung cấp đưa nó lên hệ thống — vì vậy đối với phía đó của so sánh, câu trả lời trung thực là API của chính nhà cung cấp hoặc bất kỳ nền tảng lưu trữ nào mà bạn đã có quan hệ.

Screenshot of the Artificial Analysis model page for GPT-5.6 Sol (max), captured 25 September 2026. A boxed banner at the top reads This model is deprecated, that benchmarking continues only for the default 10k input token workload, and that OpenAI has launched a newer model, GPT-6 Sol (max), which should be considered instead. Below it the header shows an OpenAI badge, Intelligence rank 19 of 210, Speed 83 of 210, Cost 67 of 210, Verbosity 50 of 210, 47 on the Intelligence Index, $4.00 input and $20.00 output per 1M tokens, a 90% cache discount, $1.99 per task to evaluate on the Intelligence Index, and a line reading At 73 tokens per second, GPT-5.6 Sol (max) is faster than average (72).

Làm gì với cái này trước tuần sau

Có hai thứ đã thay đổi vào ngày 25 tháng 9 năm 2026 và chỉ một trong số đó là về giá. GPT-5.6 Sol mang thông báo ngừng hỗ trợ trên chỉ số nơi nó được đo ở mức 47, điều này khiến nó không còn được dùng để ra quyết định mua hàng và chỉ còn lại như một tham chiếu benchmark. MiMo-V2.6-Pro được đo ở mức $0.13 mỗi tác vụ chỉ số so với $1.99 của Sol, tức gấp mười lăm lần số tiền cho một điểm chỉ số — và nó đạt 43.6 token mỗi giây, chậm hơn mô hình mà nó đang được so sánh và chậm hơn cả trung vị cùng hạng của chính nó. Hãy đối chiếu hai con số này với lưu lượng của chính bạn trước khi một trong hai con số trở thành quyết định: chi phí mỗi tác vụ là một phép đo, không phải một biểu giá, và độ trễ là một phép đo, không phải một ý kiến. Nếu đầu ra của bạn ngắn và không tương tác, lập luận ủng hộ checkpoint mở mạnh hơn mức mà khoảng cách chỉ số gợi ý. Nếu đầu ra của bạn dài hoặc người dùng của bạn đang phải chờ, khoản tiết kiệm gấp mười lăm lần mua cho bạn một sản phẩm chậm hơn, và đó là một sự đánh đổi mà chỉ khối lượng công việc của bạn mới định giá được.

So sánh trong bài viết này1

Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày