Thẻ tiêu đề cho Mistral Large 4 so với MiniMax M3, xoay quanh mức chênh lệch 48 USD mỗi tháng trên 100 triệu token, với MiniMax M3 nhận đầu vào video và đầu ra 512K, còn Mistral Large 4 là bản xem trước chỉ dành cho hình ảnh.
Guides & Insights

Mistral Large 4 so với MiniMax M3: Cái giá của năm tháng tiến bộ

Tác giả

Elias Hawthorne

Ngày đăng

Mô hình mới nhất · 20Xem tất cả mô hình →
Benchmark: Artificial Analysis · cập nhật hằng ngày
Quay lại tất cả bài viết

MiniMax M3 là mô hình rẻ nhất trong phân khúc này và đã như vậy kể từ ngày 31 tháng 5 năm 2026. Với mức 0,30 USD cho mỗi triệu token đầu vào, 1,20 USD cho mỗi triệu token đầu ra và 0,06 USD cho mỗi triệu token được cache, nó rẻ hơn Mistral Large 4 khoảng một nửa ở đầu vào, còn ở đầu ra thì Mistral Large 4 đắt gấp đôi — và khác với mô hình mới hơn, bạn có thể mua nó ngay hôm nay mà không kèm nhãn xem trước. Mistral Large 4, một mô hình trọng số mở 1,05 nghìn tỷ tham số đang ở bản xem trước công khai kể từ ngày 6 tháng 10 năm 2026, có giá 0,68 USD và 2,09 USD, đồng thời hứa hẹn sẽ phát hành trọng số trước cuối tháng. Hai mô hình chủ lực mở trọng số, cách nhau năm tháng, và năm tháng đó chỉ hiện rõ ở đúng một nơi: điểm Intelligence Index độc lập của M3 là 29,2, trong khi điểm của Mistral Large 4 vẫn chưa tồn tại.

Đó là hình dạng trung thực của sự so sánh này, và nó thú vị hơn một bảng giá gợi ý. M3 được xây dựng xoay quanh một đặt cược kiến trúc cụ thể — MiniMax Sparse Attention, được duy trì trên một triệu token ngữ cảnh, với video là đầu vào hạng nhất — và nó thắng trên giấy ở hai hạng mục mà Mistral Large 4 không tranh chấp: độ dài đầu ra thô và video gốc. Ở mọi nơi khác, mô hình mới hơn là cái mà người mua thà có, với mức giá vẫn đủ thấp đến mức sự khác biệt hiếm khi quyết định việc mua hàng.

Hai kiến trúc, hai canh bạc

MiniMax M3 là mô hình nền tảng trọng số mở hàng đầu của MiniMax và là mô hình đầu tiên kết hợp năng lực lập trình đỉnh cao cùng hiệu năng tác nhân, cửa sổ ngữ cảnh một triệu token và khả năng đa phương thức gốc trong một bản phát hành duy nhất. Mô hình tiếp nhận văn bản, hình ảnh và video rồi trả về văn bản, và được xây dựng trên MiniMax Sparse Attention, một kiến trúc được thiết kế để duy trì ngữ cảnh lên tới 1.048.576 token với mức sàn đảm bảo là 512K. Quy trình tiền huấn luyện đã được xây dựng lại để mở rộng vượt 100 nghìn tỷ token với dữ liệu đa phương thức ngay từ bước đầu tiên thay vì gắn thêm về sau. Đầu ra tối đa của mô hình là 512.000 token.

Mistral Large 4 đặt cược theo một hướng khác. Đây là một mô hình mixture-of-experts dạng chia nhỏ, với 49 tỷ tham số hoạt động trên tổng số 1,05 nghìn tỷ, cùng bộ mã hóa thị giác 1,6 tỷ tham số, được huấn luyện từ đầu trên 3.800 GPU NVIDIA Grace Blackwell bên trong các trung tâm dữ liệu châu Âu của chính Mistral, trên dữ liệu trải rộng hơn 160 ngôn ngữ. Nó tiếp nhận văn bản và hình ảnh — không có video — trong ngữ cảnh khoảng một triệu token, và Mistral định vị nó xoay quanh triển khai có chủ quyền: hạ tầng châu Âu, trọng số mở, và khả năng chạy nó theo chính sách của riêng bạn, với an ninh mạng là trường hợp sử dụng chủ lực.

• Cửa sổ ngữ cảnh — MiniMax M3 1.048.576 token so với Mistral Large 4 khoảng 1.000.000

• Đầu ra tối đa — MiniMax M3 512.000 token so với Mistral Large 4 chưa có tài liệu

• Phương thức đầu vào — MiniMax M3: văn bản, hình ảnh và video so với Mistral Large 4: văn bản và hình ảnh

• Giá đầu vào — MiniMax M3 0,30 USD mỗi 1M so với Mistral Large 4 0,68 USD mỗi 1M

• Giá đầu ra — MiniMax M3 1,20 USD/1M so với Mistral Large 4 2,09 USD/1M

• Đầu vào đã lưu đệm — MiniMax M3 $0.06 mỗi 1M so với Mistral Large 4 $0.07 mỗi 1M

• Tham số — Mistral Large 4 tổng 1,05T / 49B hoạt động so với MiniMax M3 không được tiết lộ

• Đã phát hành — MiniMax M3 ngày 31 tháng 5 năm 2026 so với Mistral Large 4 ngày 6 tháng 10 năm 2026, bản xem trước

• Trọng số — cả hai đều theo giấy phép mở, trọng số của Mistral Large 4 được cam kết vào cuối tháng 10 năm 2026

A two-column scoreboard comparing Mistral Large 4 and MiniMax M3 on input and output price, Artificial Analysis Index, input modalities, maximum output and release date.

Bảng điểm không sát nút, và cũng không công bằng.

Trên Chỉ số Trí tuệ Artificial Analysis v4.3.2, MiniMax M3 đạt 29,2 điểm và xếp thứ 62 trong số 147 mô hình. Đó là kết quả ở giữa bảng và không phải là lời chỉ trích mô hình — Chỉ số này đã được sửa đổi sau khi M3 ra mắt và bao gồm các đánh giá chưa tồn tại vào thời điểm MiniMax đang huấn luyện. Điểm phụ về lập trình của nó kể một câu chuyện tốt hơn: 58,6 trên chỉ số AA Coding, thứ 46 trong số 138, và 65,2% trên Terminal-Bench 2.1. Nó đạt 92,9% trên GPQA Diamond, 83% về khả năng ghi nhớ ngữ cảnh dài, và 47,1% trên SciCode.

Mistral Large 4 không có điểm Index trên cùng bảng xếp hạng; trang vẫn đang hoạt động dưới tiêu đề “Mistral Large 4 Preview” và con số này không xuất hiện. Điều Mistral công bố là ML4 dẫn trước DeepSeek V4 Pro 0813 và Qwen3.8 Max trên Coding Agent Index tổng hợp với 49,8%, và trên AutomationBench — 657 quy trình làm việc doanh nghiệp trên Gmail, Sheets, Slack và Salesforce — nó đạt 59,9%, vượt Kimi K3, MiMo-V2.6-Pro và DeepSeek V4 Pro. MiniMax không được nhắc đến trong cả hai so sánh, và điều đó tự nó là một tín hiệu về việc Mistral coi mô hình nào là đối thủ thực sự.

Vậy cách hiểu công bằng là thế này: M3 là một mô hình có năng lực, rẻ, được tài liệu hóa đầy đủ, với điểm tổng quát tầm trung và hồ sơ lập trình đáng nể, đã ra đời được năm tháng. ML4 là một mô hình xem trước với mức trần được tuyên bố cao hơn, không có điểm tổng quát nào được công bố, và một tập hợp các chỉ số agentic mà Artificial Analysis đã đánh giá riêng và sẽ công bố trên Coding Agent Index khi bộ khung đánh giá đó ra mắt. Nếu bạn cần một con số ngay hôm nay, M3 cho bạn một con số. Nếu bạn có thể đợi vài tuần, ML4 cũng sẽ cho bạn một con số, và Mistral đang đặt cược rằng nó sẽ cao hơn.

Nơi M3 hoàn toàn không có bất kỳ sự cạnh tranh nào từ ML4

Hai dòng trong danh sách đó không phải là một sự đánh đổi, chúng là một sự vắng mặt.

Đầu vào video là điều đầu tiên. M3 nhận video native, cùng với văn bản và hình ảnh. Mistral Large 4 chỉ nhận văn bản và hình ảnh, không gì khác — bài phân tích chuyên sâu của chính Mistral nói về grounding trên ảnh vệ tinh gigapixel và bản vẽ kỹ thuật, vốn vẫn là công việc về hình ảnh. Nếu pipeline của bạn tiếp nhận bản ghi màn hình, cảnh quay giám sát hoặc tài liệu video, ML4 không thể là mô hình đó, bất kể giá của nó ra sao. Đó không phải là khoảng trống mà Mistral sẽ lấp đầy bằng một lần định giá lại.

Độ dài đầu ra là yếu tố thứ hai. M3 phát ra tối đa 512.000 token trong một phản hồi duy nhất. Mistral chưa công bố giới hạn đầu ra nào cho ML4. Tạo một tạo tác có cấu trúc dài trong một lần chạy — một báo cáo đầy đủ, một script di trú lớn, một đặc tả hoàn chỉnh — là loại khối lượng công việc mà giới hạn 512K đáng giá hơn một điểm Intelligence Index, và cho đến khi Mistral ghi rõ giới hạn của ML4, M3 là lựa chọn duy nhất trong hai lựa chọn mà bạn có thể lên kế hoạch cho khối lượng công việc đó.

Các con số agentic do nhà cung cấp công bố của M3 củng cố cùng một hồ sơ năng lực. MiniMax đặt nó ở mức 83,5 trên BrowseComp cho nghiên cứu web tự động, 70 trên OSWorld-verified cho sử dụng máy tính, 74,2 trên MCP Atlas cho sử dụng công cụ, 76,7 trên các rubric GDPval và 59 trên SWE Bench Pro. Những con số này đến từ các đánh giá của chính MiniMax và chưa được tái lập một cách độc lập, và chúng có vẻ lệch pha một cách kỳ lạ so với điểm Index 29,2 của mô hình — đó chính xác là lý do vì sao sự phân biệt giữa nhà cung cấp và đánh giá độc lập lại quan trọng. Một mô hình có thể dẫn đầu trên các benchmark do nhà cung cấp lựa chọn và vẫn nằm ở giữa bảng xếp hạng trên mức trung bình của mười đánh giá trung lập, và cả hai điều đó đều có thể đúng.

2x có đáng không?

Khoảng cách giá ở đây thực sự nhỏ xét về giá trị tuyệt đối, điều này làm thay đổi bài toán so với khi so lệch với một mô hình flagship đóng. Lấy ví dụ một tháng dùng 100 triệu token với tỷ lệ đầu vào/đầu ra 4:1: 80 triệu token đầu vào và 20 triệu token đầu ra. M3 tính $24 cộng $24, tổng cộng $48. Mistral Large 4 tính $54,40 cộng $41,80, tổng cộng $96,20. Mức phụ trội là khoảng $48 mỗi tháng — thực sự là một khoản tiền đáng kể ở quy mô lớn, nhưng là kiểu chênh lệch mà chỉ cần tránh được một sự cố là đã đủ bù đắp.

Bộ nhớ đệm thu hẹp khoảng cách này hơn nữa, và chỉ nghiêng về phía M3 một cách không đáng kể: $0.06 so với $0.07 cho mỗi triệu token được lưu trong bộ nhớ đệm là một sai số làm tròn ở mức giá này. Cả hai đều đủ rẻ để quyết định nên được đưa ra dựa trên năng lực và độ phù hợp chứ không phải dựa trên hóa đơn, điều này trái ngược với cách so sánh này thể hiện thoạt nhìn.

Cái mà khoản phụ trội mua được chính là khoảng cách. ML4 được huấn luyện muộn hơn năm tháng trên dữ liệu mới hơn, theo kiến trúc mixture-of-experts với một nghìn tỷ tham số và 49 tỷ tham số hoạt động, và Mistral đang chạy học tăng cường trên đó ở mức 33 tỷ token mỗi ngày theo công bố, với một quá trình huấn luyện chưa bão hòa. M3 đã hoàn thiện; ML4 vẫn đang cải thiện theo một nhịp độ được công bố. Khi một nhà cung cấp nói rằng mô hình bạn mua hôm nay là phiên bản yếu nhất mà bạn sẽ từng phải trả tiền, và khoản phụ trội so với mô hình hiện hành chưa đến một đô-la mỗi triệu token, thì mô hình mới hơn thường là lựa chọn mặc định tốt hơn. Ngoại lệ là hai khối lượng công việc ở trên, nơi mô hình cũ hơn là mô hình duy nhất phù hợp.

Định tuyến vòng qua khoảng trống

A screenshot of the OrcaRouter model page for MiniMax M3, showing the minimax/minimax-m3 route from MiniMax, its text, image and video input, and the $0.30 input and $1.20 output price per million tokens.

Đây là một sự kết hợp mà việc chạy cả hai không phải là phương án phòng hộ mà chính là câu trả lời thực sự, bởi vì hai mô hình mạnh ở những điểm không trùng nhau. Đầu vào video, đầu ra là sản phẩm dài, hoặc vòng lặp sử dụng máy tính: M3. Phân tích tài liệu và hình ảnh, các quy trình công việc tác tử, hoặc bất cứ thứ gì cần chạy trên hạ tầng của bạn theo chính sách của bạn: ML4. Không có quy tắc định tuyến nào khiến một trong hai trở nên dư thừa.

Cả hai đều nằm sau một endpoint tương thích OpenAI trên OrcaRouter với mức đánh dấu 0% và giá niêm yết của nhà cung cấp được truyền qua nguyên vẹn, điều này giữ cho mức chênh giá năm tháng luôn trung thực — nếu MiniMax cắt mức giá của M3 hoặc Mistral kết thúc mức giá xem trước, con số mà tuyến của bạn được đánh giá dựa trên đó sẽ thay đổi ngay trong cùng ngày. DSL định tuyến là thứ biến những thế mạnh rời rạc thành một bề mặt gọi duy nhất: một quy tắc kiểm tra phương thức của yêu cầu sẽ gửi các payload mang video đến M3 và mọi thứ khác đến ML4, với sự yên tâm rằng những lần chập chờn về tính khả dụng của một mô hình xem trước sẽ được hấp thụ bởi chuyển đổi dự phòng tự động thay vì lan truyền đến người dùng của bạn. Khi một đầu ra duy nhất quan trọng hơn một mức giá duy nhất, hợp nhất mô hình có thể chạy cả hai và để một hội đồng chọn, đây là một cách hợp lý để mua mức trần được Mistral tuyên bố trong khi vẫn giữ hành vi được ghi nhận của M3 làm mức sàn.

A decision card headed When each one wins, matching MiniMax M3 to video input and 512K output at $0.30 and $1.20, and Mistral Large 4 to image and document work that runs in Europe.

Phán quyết

MiniMax M là câu trả lời đúng cho hai khối lượng công việc và là câu trả lời hợp lý cho khối thứ ba. Đầu vào văn bản, tạo sinh hàng trăm nghìn token trong một lần và các tác nhân sử dụng máy tính là lãnh địa của nó, mức giá của nó là thấp nhất trong số mọi mẫu flagship ở phân khúc này, và điểm số công bố ở mức trung bình của nó nghĩa là bạn biết chính xác mình sẽ nhận được gì. Năm tháng tuổi không phải là già đối với một mô hình chưa bị soán ngôi trong ngách của nó.

Mistral Large 4 là lựa chọn mặc định tốt hơn cho mọi thứ khác. Một tháng dùng một trăm triệu token tốn thêm khoảng 48 đô la, số lượng tham số và nguồn gốc huấn luyện châu Âu cho thấy một mức trần cao hơn, các tuyên bố về an ninh mạng đủ cụ thể để có thể kiểm chứng, và trọng số mở được hứa hẹn cùng với triển khai tại chỗ giải quyết các yêu cầu mà câu chuyện doanh nghiệp chỉ có API của M3 không giải quyết được. Cái giá của canh bạc đó là bạn đang cam kết với một mô hình mà điểm Independent Intelligence Index chưa được công bố và hành vi của nó, theo Mistral, sẽ thay đổi đáng kể trong vòng vài tuần.

Hai mốc thời gian giải quyết chuyện này: cuối tháng 10 năm 2026, khi trọng số của ML4 hoặc được phát hành, hoặc lời hứa về trọng số mở bắt đầu có vẻ lung lay, và việc công bố Coding Agent Index, nơi con số 49,8% được Mistral đánh giá riêng gặp điểm lập trình 58,6% công khai của M3 trên cùng một bản sửa đổi. Cho đến lúc đó, M3 là mô hình bạn có thể xác minh còn ML4 là mô hình bạn đang đặt cược — và với mức phụ trội 48 USD mỗi tháng trên một trăm triệu token, đó không phải là một ván cược lớn.