
Xiaomi MiMo-V3-Flash: Liệu mô hình nhanh chưa phát hành có đang chạy bên trong Omen Alpha của OpenCode không?
- googleMỚIGoogle: Gemini 3.8 Flash2026-09-0259Trí tuệ76Lập trình
- qwenMỚIQwen: Qwen3.8 Max (0902)2026-09-0258Trí tuệ72Lập trình
- anthropicMỚIAnthropic: Claude Fable 5.12026-09-0166Trí tuệ82Lập trình
- AlibabaMỚIQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token
- z-aiMỚIZ.ai: GLM 5.3 Flash2026-08-2658Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 trên 1 triệu token
- z-aiZ.ai: GLM 5.32026-08-1860Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1552Trí tuệ68Lập trình
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Trí tuệ69Lập trình
- grokSpaceXAI: Grok 4.62026-08-1261Trí tuệ77Lập trình
- metaMeta: Muse Spark 1.22026-08-0557Trí tuệ72Lập trình
- qwenQwen: Qwen3.8 Max2026-08-0358Trí tuệ72Lập trình
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Trí tuệ69Lập trình
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 trên 1 triệu token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Trí tuệ78Lập trình
- googleGoogle: Gemini 3.6 Flash2026-07-2152Trí tuệ69Lập trình
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Trí tuệ49Lập trình
Xiaomi MiMo-V3-Flash chưa được Xiaomi công bố. Không có model card, không có trọng số Hugging Face, không có trang định giá và không có bài đăng ra mắt — cái tên này được nhắc đến chỉ vì một lý do duy nhất: vào ngày 4 tháng 9 năm 2026, teortaxesTex, một nhà phân tích AI độc lập nổi bật, đã công khai phát biểu rằng ông tin Omen Alpha — mô hình "tàng hình" ẩn danh mà OpenCode bắt đầu cung cấp cho những người đăng ký gói Go của mình vào sáng cùng ngày — chính là Xiaomi MiMo-V3-Flash. Việc nhận diện của ông chủ yếu dựa trên điều ông diễn giải là chuỗi suy luận (chain-of-thought) của một mô hình thuộc kỷ nguyên DeepSeek V4 GA nằm trong dấu vết suy luận hiển thị của Omen Alpha — điều này nếu đứng vững sẽ khiến Xiaomi MiMo-V3-Flash trở thành một phiên bản nhanh do Xiaomi xây dựng, được huấn luyện trên nền các trọng số V4 mở của DeepSeek. Không có gì về sự nhận diện đó được xác nhận, và bài viết này coi nó đúng như bản chất vốn có: một giả thuyết được lập luận chặt chẽ trong một trò chơi phỏng đoán đang diễn ra.
Các nguyên tắc cơ sở cho những gì tiếp theo: việc ra mắt Omen Alpha là sự thật đã được xác nhận, và nhận định của nhà phân tích là một tuyên bố được gắn nhãn. Sự tồn tại của thế hệ V3 được hỗ trợ bởi một bản xem trước hội nghị và một điểm chuẩn bị rò rỉ, cả hai đều được ghi rõ là chưa được Xiaomi xác nhận. Khẳng định rằng một mô hình tên là Xiaomi MiMo-V3-Flash tồn tại hoàn toàn là một suy luận từ hành vi, không phải là tuyên bố chính thức từ Xiaomi — và vì Xiaomi chưa đưa ra bất kỳ tuyên bố nào, nên không có điều gì được lặp lại ở đây như là sự thật.
Lời khẳng định và bốn lý do đằng sau nó
Nguyên nhân kích hoạt là một báo cáo từ nhà phát triển. Một builder thử nghiệm Omen Alpha trong OpenCode, đăng dưới tên @SPAC89, viết rằng "Omen Alpha High" — mô hình ở chế độ suy luận cao — đã hoàn thành một tác vụ lập trình đáng kể trong vòng chưa đầy mười phút, và một phiên chạy dài nhiều giờ hơn nữa đang được tiến hành. Trích dẫn bài đăng báo cáo đó, teortaxesTex nói rằng ông tin mô hình này là Xiaomi MiMo-V3-Flash và đưa ra bốn lý do, tất cả đều mang tính hành vi chứ không phải tài liệu:
• Dấu vết suy luận. Chuỗi suy nghĩ hiển thị trông giống DeepSeek V4 GA CoT — những dấu hiệu nhận biết của hắn là "hmm," "fine," và các mục checklist bắt đầu bằng dấu ✓. Ảnh chụp màn hình anh ta đính kèm cho thấy Omen Alpha đang xây dựng dở ở cài đặt "high" với một dấu vết khớp với khuôn mẫu.
Tốc độ. Mẫu máy này nhanh — đó là nhận xét mà anh ấy đang phản hồi — và phân khúc nhanh của Xiaomi trong lịch sử vẫn mang cái tên "Flash".
• Về bên vận hành. DeepSeek không triển khai quảng bá ngầm, vì vậy ngay cả khi khả năng suy luận có nguồn gốc từ DeepSeek V4 GA, thì người đứng sau Omen Alpha là một bên thứ ba đã xây dựng trên nền DeepSeek, chứ không phải chính DeepSeek.
• Sự phân cụm. Văn bản đầu ra của các mô hình Xiaomi MiMo nằm cùng cụm với DeepSeek — cách nói tắt của ông để chỉ hai thế hệ mô hình có văn bản nằm gần nhau về phân bố, điều mà một mô hình được huấn luyện từ DeepSeek sẽ trông giống như vậy. Ông nêu tên một lựa chọn thay thế khác cũng nằm cùng cụm với DeepSeek, đó là Step-4 của StepFun, và cho biết ông không chắc chắn về thế hệ hiện tại của StepFun.
Người đưa tin đáng được nhắc đến, vì cùng một sự thật có thể hiểu theo hai chiều. teortaxesTex tự nhận là một người theo dõi DeepSeek — hồ sơ X của anh ta tự gọi mình là fan DeepSeek từ năm 2023. Đó là hình mẫu của một người có thể nhận ra phong cách lập luận của DeepSeek V4 ngay khi nhìn thấy, đồng thời cũng là hình mẫu của một người có thiên hướng nhìn thấy một phong cách như vậy.
Vị trí của MiMo-V3-Flash trong dòng sản phẩm Xiaomi
Các mô hình MiMo được Xiaomi chính thức xác nhận hôm nay là MiMo-V2.5 và MiMo-V2.5-Pro, cả hai đều được mở mã nguồn theo giấy phép MIT vào cuối tháng 4 năm 2026. MiMo-V2.5-Pro là mô hình mixture-of-experts với 1,02 nghìn tỷ tham số, 42 tỷ tham số hoạt động và cửa sổ ngữ cảnh 1 triệu token; MiMo-V2.5 là phiên bản anh em nhỏ hơn, đa dụng hơn với 310 tỷ tham số. Đứng sau chúng trong cây sản phẩm là MiMo-V2-Flash (tháng 12 năm 2025, một MoE mở với 309 tỷ tham số) và MiMo-V2-Pro (tháng 3 năm 2026) — và MiMo-V2-Pro quan trọng cho câu chuyện này vì nó lần đầu tiếp cận công chúng dưới một mã danh ẩn danh, Hunter Alpha, trước khi Xiaomi nhận là của mình. Các bài kiểm tra thực địa ẩn danh không phải là ngoại lệ đối với Xiaomi; chúng là một phần trong cách Xiaomi ra mắt sản phẩm.
{{1}}Thế hệ V3 là giai đoạn mà các ghi nhận chuyển dần từ sản phẩm đã phát hành sang những bản báo cáo. Tại ICML tháng 7/2026, Luo Fuli, nhà nghiên cứu đứng đầu nhóm MiMo, đã phác thảo kiến trúc của V3.{{/1}} Trọng tâm là một thiết kế mà Xiaomi gọi là High Sparse: {{2}}một số ít các lớp full-attention đóng vai trò như một "oracle" để chọn ra các token mà các lớp thưa (sparse) xung quanh cần chú ý tới,{{/2}} {{3}}và các lớp thưa đó dùng chung bộ nhớ đệm KV (KV cache) của các lớp full-attention thay vì giữ bộ nhớ riêng.{{/3}} {{4}}Xiaomi cho biết điều này giúp giảm bộ nhớ KV cache khoảng mười lần và đã xác nhận tỷ lệ sparse-to-full 11:1 trên mô hình quy mô 80 tỷ tham số,{{/4}} {{5}}đạt được chất lượng tương đương full-attention, trong khi một baseline lai sử dụng cửa sổ trượt (hybrid sliding-window) mất khoảng bảy điểm MMLU ở cùng mức độ thưa.{{/5}} {{6}}Đây là những tuyên bố của chính nhóm nghiên cứu tại một buổi phát biểu ở hội nghị, không phải kết quả độc lập.{{/6}} Sau đó, vào ngày 21/8, một ảnh chụp màn hình điểm benchmark được cho là của MiMo-V3-Pro bắt đầu lan truyền, do Max For AI chia sẻ: {{7}}SWE-Bench Pro 72.8 — so với GLM 5.3 đạt 67.9, Kimi K3 đạt 65.8, Claude Opus 5 đạt 74.6 và GPT-5.6 Sol Max đạt 75.4 —{{/7}} {{8}}cùng Terminal-Bench 2.0 đạt 70.6 và τ3-bench đạt 76.4.{{/8}} {{9}}Xiaomi chưa xác nhận bất cứ điều gì, còn sự tồn tại lẫn thời điểm phát hành của V3 vẫn chưa được công bố.{{/9}} Điều rút ra của bài viết này hẹp hơn: {{10}}thế hệ V3 rõ ràng đang được vận hành, nhưng chưa có mô hình V3 nào được phát hành{{/10}} — chính vì vậy, một chiếc Xiaomi MiMo-V3-Flash chưa được công bố âm thầm xuất hiện sẽ là tin đáng chú ý chứ không phải chuyện thường.
Tại sao Flash — và tại sao OpenCode Go — lại phù hợp
Mức Flash là cách Xiaomi gieo mầm năng lực xử lý nhanh, rẻ; hãng cũng đã làm điều tương tự với MiMo-V2-Flash vào tháng 12. Và OpenCode Go là một bãi thử hợp lý vì nền tảng này vốn đã chạy mô hình mở hiện tại của Xiaomi: cùng một danh sách Go ghi Omen Alpha ở mức 11.600 yêu cầu mỗi 5 giờ cũng ghi MiMo-V2.5 ở mức 30.100, thuộc nhóm hạn mức hào phóng nhất trên trang. Một đội ngũ Xiaomi thử nghiệm V3-Flash bên cạnh MiMo-V2.5 của chính mình trên cùng một nền tảng sẽ có được sự so sánh trực tiếp với thế hệ trước mà không tốn chi phí tiếp thị, trên một nền tảng đã từng chạy một lượt tiết lộ ẩn danh trong tháng này. Đó là một lý lẽ cho tính hợp lý, không phải bằng chứng về danh tính.

Cấu hình sản phẩm cũng chỉ về cùng một hướng. Omen Alpha ở chế độ suy luận 'cao' hoàn thành trong chưa đầy 10 phút, khớp với hành vi bạn mong đợi ở một hạng suy luận nhanh; và các con số bên thứ ba đang lưu hành về Omen Alpha — khoảng $0.20 mỗi triệu token đầu vào và $0.66 mỗi triệu token đầu ra, theo báo chí đăng lại chứ không phải bảng giá chính thức — đưa nó vào phân khúc rẻ của thị trường, bên cạnh DeepSeek V4 Flash. Một mô hình hành xử như một bộ suy luận thế hệ DeepSeek nhanh và rẻ chính là hình ảnh của một hạng 'Flash' dựa trên DeepSeek V4. Được báo cáo và suy luận, một lần nữa, chưa được xác nhận.
Mối liên hệ với DeepSeek là điểm mấu chốt — và là bằng chứng yếu nhất
Tại sao DeepSeek V4 GA lại quan trọng: Dòng V4 của DeepSeek đã chuyển từ giai đoạn xem trước sang phát hành chung vào tháng 8 năm 2026, khi DeepSeek V4 Pro ra mắt bản GA 0813 vào ngày 13 tháng 8 kèm trọng số nguồn mở theo giấy phép MIT, cùng với phiên bản rẻ hơn là DeepSeek V4 Flash. Trọng số mở theo MIT có nghĩa là bên thứ ba có thể hợp pháp phát triển dựa trên chúng, và cách thường thấy của cộng đồng để nhận diện một mô hình như vậy là phong cách lập luận mà nó thừa hưởng: chuỗi suy nghĩ thời GA của DeepSeek có những thói quen ngôn từ rất dễ nhận biết, và chính những thói quen đó là điều teortaxesTex cho biết anh thấy trong dấu vết của Omen Alpha. Nếu anh ấy đúng rằng dấu vết đó là DeepSeek V4 GA, và đúng rằng nhà vận hành là Xiaomi, thì Xiaomi MiMo-V3-Flash chính là dòng nhanh của Xiaomi được xây dựng trên trọng số lập luận mở của DeepSeek — một lựa chọn hợp pháp nhưng đáng chú ý về mặt chiến lược, và là lựa chọn giải thích một cách gọn gàng vì sao một mô hình mang danh Xiaomi lại lập luận giống DeepSeek đến vậy.
Giờ đến phần khó. Sự tương đồng về chuỗi suy luận từng bước là lớp dấu vân tay mô hình yếu nhất, vì nó thuộc về phong cách chứ không phải cấu trúc. Việc nhận dạng mô hình ẩn danh thực sự đứng vững trong tháng này — Ox Alpha là GLM-5.3-Flash — được kết luận dựa trên bằng chứng cứng hơn nhiều: khớp tokenizer và giám định mã hóa video. Chưa có dấu vân tay cứng nào tương đương được công bố để quy Omen Alpha về Xiaomi. Hơn nữa, cách đọc chủ đạo của cộng đồng lại chỉ về hướng khác: các nhà phát triển báo cáo rằng các yêu cầu backend của Omen Alpha phân giải dưới namespace "zhipu", một số người thử nghiệm mô tả mô hình tự nhận là dựa trên GLM, và giới truyền thông đọc sự kiện ra mắt là Omen Alpha là bản phát hành ẩn danh thứ hai của Zhipu AI trong chín ngày, tiếp nối đợt Ox Alpha vốn được đọc là GLM-5.3-Flash. Nếu cách đọc đó đúng, kiểu suy luận mang màu sắc DeepSeek hoặc là sự trùng hợp về phong cách, hoặc là dấu hiệu cho thấy bản thân mô hình Zhipu cũng được huấn luyện với dấu vết DeepSeek — nhưng nó không phải sản phẩm của Xiaomi. Hai phe không thể cùng đúng, và không phe nào có được tuyên bố từ phòng thí nghiệm mà mình nêu tên.

Điều gì sẽ giải quyết được nó?
• Một tuyên bố từ Xiaomi — hoặc các trọng số. Xiaomi đã mã nguồn mở các mô hình MiMo của mình kể từ MiMo-V2-Flash, với MiMo-V2.5 và MiMo-V2.5-Pro được phát hành theo giấy phép MIT; một MiMo-V3-Flash thực sự của Xiaomi rất có thể sẽ được xác nhận theo cách GLM-5.3-Flash đã được xác nhận, với các trọng số và một thẻ mô hình trên Hugging Face.
• Một dấu vân tay chắc chắn. Việc so khớp tokenizer là bằng chứng giúp nhận diện Ox Alpha; một bài kiểm tra tokenizer xác định Omen Alpha là Xiaomi vẫn chưa được công bố.
• Lời tự khai của mô hình. Một số người thử nghiệm cho biết Omen Alpha tự mô tả mình là dựa trên GLM. Việc một mô hình tự báo cáo chỉ là dữ liệu, chứ không phải nguồn gốc xuất xứ.
• Các điểm chuẩn độc lập của Omen Alpha. Các đánh giá trung lập về mô hình ẩn danh sẽ giúp cộng đồng so sánh nó với các con số của MiMo-V3-Pro bị rò rỉ vào tháng Tám.
• Sự tiết lộ sau cửa sổ Go. Các mô hình ẩn danh trước đây được nhận là của mình sau nhiều ngày đến nhiều tuần kể từ khi ra mắt; bất kỳ ai tuyên bố Omen Alpha sẽ đặt tên chính xác cho mô hình đó.
Làm gì trong khi vẫn tiếp tục phỏng đoán
Lập trường thực tế không phụ thuộc vào việc ai đúng. Omen Alpha là một mô hình ẩn danh được truy cập qua gói thuê bao 10 đô la một tháng, và Xiaomi MiMo-V3-Flash là một cái tên chưa được xác nhận gắn liền với nó; cả hai đều không phải thứ để đặt cược một pipeline sản xuất vào lúc này. Khi một nhà sản xuất thực sự đứng ra nhận trách nhiệm và mô hình bên dưới được đưa lên các API thông thường, đó là lúc một lớp định tuyến phát huy tác dụng: OrcaRouter truyền thẳng giá niêm yết của nhà cung cấp với mức phụ giá 0%, nên một mức giá mới được công bố sẽ có hiệu lực trên chính API đó ngay ngày nhà cung cấp công bố, và cơ chế tự động chuyển đổi dự phòng cho phép bạn gửi một phần lưu lượng thực đến một mô hình mới chưa được kiểm chứng, với đường quay về một mô hình bạn đã tin dùng. Trong khi đó, điều cần để mắt rất đơn giản — liệu có ai đứng ra nhận Omen Alpha là của mình không, và liệu Xiaomi MiMo-V3-Flash có bao giờ xuất hiện trên một model card hay không? Một trong hai điều đó sẽ xảy ra.

Tính đến ngày 4 tháng 9 năm 2026, Xiaomi MiMo-V3-Flash mới chỉ là một cái tên, một hình hài sản phẩm hợp lý và một giả thuyết của nhà phân tích nổi bật — chứ chưa phải là một mô hình đã ra mắt. Thế hệ V3 đủ thực để được xem trước vào tháng 7 và bị rò rỉ vào tháng 8. Liệu lần xuất hiện công khai đầu tiên của nó có đang diễn ra ngay lúc này dưới mật danh Omen Alpha hay không là câu hỏi chỉ Xiaomi mới có thể trả lời, và hãng vẫn chưa trả lời.
So sánh trong bài viết này2
Phát hiện từ bài viết này · Benchmark: Artificial Analysis · cập nhật hằng ngày
