
Ming-Image-0.1-Design so với FLUX 3: Hai cách để một mô hình hình ảnh không khả dụng
- OrcaMỚIOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 trên 1 triệu token
- orcaMỚIOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token
- deepseekMỚIDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- openaiOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- googleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- anthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Trí tuệ69Lập trình
- grokSpaceXAI: Grok 4.62026-08-1244Trí tuệ77Lập trình
- metaMeta: Muse Spark 1.22026-08-0540Trí tuệ72Lập trình
- qwenQwen: Qwen3.8 Max2026-08-0345Trí tuệ76Lập trình
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Trí tuệ69Lập trình
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 trên 1 triệu token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Cả Ming-Image-0.1-Design và hạng hình ảnh của FLUX 3 hiện tại đều là những mô hình bạn không thể gọi. Chúng đến đó bằng những con đường trái ngược nhau. Ming-Image-0.1-Design là một sản phẩm hoàn thiện nhưng không có cửa vào: 6B trọng số theo giấy phép MIT do inclusionAI công bố lên Hugging Face vào ngày 17 tháng 9 năm 2026, được tài liệu hóa trong một model card mà phần Quick Start bảo bạn clone một repository trả về 404. FLUX 3 là một cửa vào không có gì phía sau: Black Forest Labs đã công bố dòng mô hình này vào ngày 23 tháng 7 năm 2026 với bốn hạng — Video, Image, Action và Dev — đã phát hành hạng video, và kể từ đó chưa công bố endpoint hình ảnh, mã định danh mô hình, schema yêu cầu hay mức giá nào của FLUX 3. Đây là sự so sánh giữa một mô hình tồn tại nhưng không thể chạy và một mô hình được hứa hẹn nhưng không thể định giá, một điều hữu ích hơn để biết so với từng tiêu đề riêng lẻ.
Những gì mỗi bên thực sự đã công bố
Sự phân biệt giữa kho lưu trữ và thông báo rất quan trọng, nên đây là hai thứ được đặt cạnh nhau.
• Artefact — Ming-Image-0.1-Design có trọng số thật: năm shard transformer, một VAE, một scheduler và các thành phần mllm, connector và mlp riêng biệt, tất cả đều theo giấy phép MIT so với FLUX 3, nơi thành phần duy nhất được phát hành là tier video, được cung cấp rộng rãi kể từ đầu tháng 8 năm 2026.
• Định danh — inclusionAI/Ming-Image-0.1-Design, có thể gọi dưới dạng ID repo Hugging Face, so với việc hoàn toàn không có ID mô hình hình ảnh FLUX 3 nào cả. Tài liệu endpoint của Black Forest Labs liệt kê /flux-2-max, /flux-2-pro, /flux-2-flex và các route /flux-2-klein-*; một route hình ảnh /flux-3 không hề xuất hiện.
• Cấu hình được đề xuất — 2048 x 2048 với 12 bước lấy mẫu, thang CFG 1.0, BF16, một GPU CUDA 80 GiB so với không có thông tin nào được công bố cho phân khúc hình ảnh.
• Giá — không có. Các trọng số được tải xuống miễn phí theo MIT, nhưng không có endpoint được host để mua, so với bảng giá được công bố chỉ bao gồm video, ở mức khoảng $0.06 mỗi giây ở 720p draft, $0.17 ở HD và $0.29 ở FHD.
• Code — một Quick Start không chạy được, vì kho lưu trữ inclusionAI/Ming-Image đi kèm không có trong danh sách kho lưu trữ công khai của tổ chức, so với một biểu mẫu đăng ký truy cập sớm, mở đầu bằng video, không có tài liệu nào về hạng hình ảnh phía sau.
• Điểm số độc lập — không có. Ming-Image-0.1-Design không xuất hiện trên bất kỳ bảng nào của Artificial Analysis, trong bất kỳ chế độ xem danh mục nào và trong bất kỳ chế độ xem trọng số mở nào tính đến ngày 23 tháng 9 năm 2026, so với việc cũng không có cho bất kỳ bậc FLUX 3 nào. Các mục BFL gần nhất trên bảng trực tuyến đều thuộc thế hệ trước: FLUX.2 [flex] đạt 1.065 Elo trong danh mục Thiết kế UI/UX và 1.026 trên bảng text-to-image tổng quát, với FLUX.2 [max] đạt 1.053 và FLUX.2 [dev] đạt 1.000.

Tại sao gói video đã ra mắt còn gói hình ảnh thì không
Black Forest Labs đã đưa ra một lý do, và lý do đó đáng được nêu chính xác vì nó định hình những gì có thể mong đợi. Công ty cho biết hơn 95% năng lực tính toán huấn luyện của FLUX 3 được dành cho dự đoán video. Đó là một lời giải thích mạch lạc cho việc tại sao tầng video là tầng có sản phẩm đằng sau, và đó cũng là lý do để hoài nghi giả định rằng tầng hình ảnh sẽ xuất hiện như một bước tiến nhỏ khi nó ra mắt. Khả năng này được huấn luyện thứ hai, và những lời hứa trong lộ trình gắn với nó không hề nhỏ: xử lý lời nhắc phức tạp được cải thiện, hiển thị văn bản đa ngôn ngữ độ chính xác cao, chuyển đổi phong cách, nhất quán nhân vật và thương hiệu mà không cần tinh chỉnh, và chỉnh sửa không phá hủy. Mỗi điều trong số đó là một tuyên bố chứ không phải một tính năng cho đến khi có một điểm cuối để kiểm thử.
Điều BFL thực sự bán cho ảnh tĩnh hiện nay là dòng trước đó: FLUX.2 với các biến thể max, pro, flex và klein, cùng với các bản phát hành cũ hơn FLUX Pro, Dev và Schnell, với giá khoảng một xu rưỡi đến bảy xu mỗi ảnh tùy theo gói và độ phân giải. Đó là những sản phẩm thật, có thể gọi được, và chúng là thước đo trung thực cho vị trí chất lượng hình ảnh của BFL trong khi phân khúc hình ảnh FLUX 3 vẫn đang chờ đợi.
Khoảng cách triển khai chính là sự bất đối xứng thú vị
Đây là điểm mà hai mô hình không còn là bản phản chiếu của nhau. Ming-Image-0.1-Design không có mã chạy được nhưng lại có một câu chuyện về phục vụ: thẻ mô hình đề xuất vLLM-Omni, và vào ngày 22 tháng 9, kho lưu trữ đã có thêm liên kết đến hướng dẫn cài đặt của framework đó và đến một công thức dành riêng cho mô hình. Hướng dẫn cài đặt thì truy cập được. Còn công thức thì không — tính đến ngày 23 tháng 9, nó trả về lỗi 404 — vì vậy những gì bạn có là một framework đã công nhận mô hình và một trang dành riêng cho mô hình vẫn chưa được viết. Điều đó vẫn tiến xa hơn một biểu mẫu đăng ký.
Tầng hình ảnh của FLUX 3 có đặc điểm trái ngược. Black Forest Labs là một công ty có API đang hoạt động, danh sách endpoint được tài liệu hóa, và một tầng video đang vận hành thực tế trên đó. Hạ tầng cho một endpoint hình ảnh của FLUX 3 rõ ràng là tồn tại. Điều không tồn tại là quyết định công khai nó. Không có ID mô hình bị giới hạn truy cập để đăng ký, không có ngày xác nhận danh sách chờ, và không có danh sách năng lực được công bố nào trụ được khi tiếp xúc với một schema yêu cầu.
Hệ quả thực tế: một nhóm muốn phục vụ Ming-Image-0.1-Design có thể bắt đầu ngay hôm nay bằng cách đọc hướng dẫn nhanh vLLM-Omni và tự thiết lập mô hình, trên phần cứng của chính họ, bằng chi phí của chính họ, với một giấy phép thoáng cho phép điều đó. Một nhóm muốn phục vụ FLUX 3 Image thì không thể bắt đầu dù với bất kỳ mức giá nào, vì không có gì để phục vụ.
Đọc tuyên bố hiệu suất duy nhất trong bộ
Ming-Image-0.1-Design phát hành kèm một đồ họa bảng xếp hạng bên trong kho lưu trữ của nó: một bảng UI/UX Design có tiêu đề "Bảng xếp hạng Text to Image: UI/UX Design", phần chân ghi "Điểm Elo từ các bình chọn ưu tiên mù trong Image Arena của chúng tôi", mang huy hiệu "Bảng xếp hạng Open Weights". Trong đó, mô hình đứng đầu với 1.082 Elo, trên Ideogram 4.0 (Quality) ở 1.052 và các biến thể FLUX.2 dev trong khoảng 994 đến 1.000.
Hai vấn đề khi đọc đó như một kết quả. Thứ nhất là nguồn gốc: đây là hình ảnh do nhà cung cấp công bố trong kho của chính nhà cung cấp, và chúng ta đang mô tả tệp chứ không phải xác minh nghiên cứu. Thứ hai là vào ngày 23 tháng 9, chúng tôi hoàn toàn không thể tìm thấy mô hình này trên các bảng Artificial Analysis trực tuyến, và hạng mục UI/UX Design trực tuyến là một thang đo khác — dẫn đầu là GPT Image 2.5 Flare với 1.227 Elo, còn các mục FLUX.2 mà thẻ liệt kê ghi 1.065 cho [flex], 1.053 cho [max] và 1.000 cho [dev] trên cùng bảng trực tuyến đó. Một thứ hạng được thể hiện trên một bảng mà chúng ta không thể định vị, thấp hơn khoảng 150 Elo so với bảng mà chúng ta có thể, không phải là một kết quả benchmark. Đó là một tuyên bố đang chờ một lần chạy bên ngoài.
Về phía FLUX 3, không có gì để kiểm tra, và đó chính là mấu chốt. Không có mục tiêu độ phân giải, không có số bước, không có giới hạn ảnh tham chiếu, không có số lượng tham số cho hạng mục hình ảnh. Lộ trình chỉ là một danh sách các tính từ.

Cần làm gì khi cả hai đều không khả dụng
Cả hai bên trong so sánh này hiện đều không thể định tuyến qua OrcaRouter, và cần phải nói thẳng điều đó thay vì để một trang model ngụ ý điều ngược lại: danh mục của chúng tôi không có model inclusionAI nào và cũng không có tier FLUX nào, nên những con số ở trên là của chính các nhà cung cấp và không có gì ở đây là một route mà bạn có thể gọi qua chúng tôi. Giá trị thực sự của lớp định tuyến trong một khoảng trống như thế này nằm ở ngày sau khi khoảng trống đó được lấp đầy. Bởi vì OrcaRouter chuyển tiếp giá niêm yết của nhà cung cấp với mức markup 0%, một lần điều chỉnh mức giá từ nhà cung cấp sẽ có hiệu lực ngay bên phía chúng tôi trong cùng ngày thay vì phải chờ hết một chu kỳ định giá lại, và bởi vì một lệnh gọi tạo sinh nằm sau một endpoint duy nhất cho hơn 200 model, việc thay sang bất kỳ cái nào trong hai cái này ra mắt trước chỉ là thay đổi model-ID chứ không phải một cuộc di trú. Failover tự động quan trọng vì đúng lý do mà nó vẫn luôn quan trọng với một model chưa được kiểm chứng: nếu một endpoint hình ảnh ở bản phát hành đầu tiên chao đảo dưới tải, yêu cầu sẽ được chuyển hướng thay vì thất bại.
Quyết định hôm nay hẹp hơn so với cách đặt vấn đề. Nếu bạn cần tạo ảnh trong môi trường production trong quý này, thì cả hai ứng viên đều không đạt, và câu trả lời trung thực là một tầng FLUX.2 — thực sự tồn tại, có giá, có thể gọi được và được đánh giá độc lập — với FLUX 3 Image được theo dõi như một phương án thay thế trong tương lai. Nếu bạn xây dựng các khung đánh giá, thì Ming-Image-0.1-Design là đối tượng thú vị hơn trong cặp này: trọng số đã có thể tải về ngay bây giờ, giấy phép cho phép bạn làm bất cứ điều gì mình muốn với chúng, và chỉ số Elo đáng tin cậy đầu tiên mà bất kỳ ai công bố cho nó sẽ là một tin thực sự đáng chú ý. Và nếu bạn đang theo dõi BFL, tín hiệu cần để mắt không phải là một bài blog. Đó là một tuyến /flux-3 xuất hiện cạnh các tuyến /flux-2-* trong tài liệu endpoint, vì đó chính là thời điểm tầng tạo ảnh không còn chỉ là lộ trình nữa.

