
MAI-Image-2.6-Preview: #1 về chỉnh sửa hình ảnh, #2 về tạo ảnh từ văn bản
- openaiMỚIOpenAI: GPT-6.1 Sol2026-09-2952Trí tuệ
- anthropicMỚIAnthropic: Claude Sonnet 5.52026-09-2856Trí tuệ
- typesafeMỚITypeSafe: Jev 1.132026-09-24$0.04 / $0.00 trên 1 triệu token · 127 tok/s
- OpenAIOpenAI: GPT-6 Luna2026-09-2238Trí tuệ
- OpenAIOpenAI: GPT-6 Sol2026-09-2248Trí tuệ
- AnthropicAnthropic: Claude Opus 5.52026-09-2258Trí tuệ
- xAIGrok 4.72026-09-2146Trí tuệ
- OrcaOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $7.50 trên 1 triệu token · 68 tok/s
- OrcaOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 trên 1 triệu token · 320 tok/s
- DeepSeekDeepSeek: DeepSeek V4.1 Flash2026-09-1040Trí tuệ
- OpenAIOpenAI: GPT-6 Astra2026-09-0453Trí tuệ77Lập trình
- GoogleGoogle: Gemini 3.8 Flash2026-09-0241Trí tuệ76Lập trình
- AlibabaQwen: Qwen3.8 Max (0902)2026-09-0245Trí tuệ76Lập trình
- AnthropicAnthropic: Claude Fable 5.12026-09-0153Trí tuệ82Lập trình
- TencentTencent: Hy4 preview2026-08-28$0.83 / $2.50 trên 1 triệu token · 54 tok/s
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 trên 1 triệu token · 361 tok/s
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Trí tuệ72Lập trình
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 trên 1 triệu token · 233 tok/s
- z-aiZ.ai: GLM 5.32026-08-1845Trí tuệ75Lập trình
- obsidianQwen3.8 27B2026-08-1534Trí tuệ68Lập trình
Microsoft's MAI-Image-2.6-Preview không còn chỉ là một mục trên bảng xếp hạng Arena mà bạn không thể chạm tới — giờ nó đã độc lập vươn lên dẫn đầu bảng xếp hạng. Vào ngày 25 tháng 8, Artificial Analysis, tổ chức đánh giá điểm chuẩn độc lập, đã xếp cùng bản preview đó ở vị trí số 1 trên Bảng xếp hạng Chỉnh sửa Hình ảnh và số 2 trong mục Văn bản thành Hình ảnh. Vị trí số 1 về chỉnh sửa đưa nó lên trước MAI-Image-2.5-Pro của chính Microsoft (người dẫn đầu trước đó), Reve 2.1 và GPT Image 2 của OpenAI, giúp Microsoft chiếm hai vị trí dẫn đầu trên bảng xếp hạng đó. Theo thông báo của Microsoft, mô hình này đã bước vào giai đoạn xem trước riêng tư trên MAI Playground và Microsoft Foundry vào ngày 19 tháng 8 — có kiểm soát qua lời mời, vẫn chưa có API công khai, vẫn chưa có bảng giá.
Điểm đáng chú ý là quỹ đạo tăng trưởng, không chỉ thứ hạng. Mô hình đạt vị trí số 2 trên bảng xếp hạng tạo ảnh từ văn bản của Arena có tên đúng là "mai-image-2.6-preview", nhận được khoảng 3.500 phiếu bầu trong bản ghi nhận đó, và leo 8 bậc với mức tăng +79 Elo so với MAI-Image-2.5 chỉ sau một bước nâng cấp. Kể từ đó, bức tranh đã nhanh chóng được lấp đầy: quyền truy cập xem trước riêng tư đã được mở trên MAI Playground và Microsoft Foundry vào ngày 19 tháng 8, bảng xếp hạng chỉnh sửa ảnh của Arena đã đưa bản build lên vị trí số 3, và hiện Artificial Analysis xếp nó ở vị trí số 1 về chỉnh sửa ảnh và số 2 về tạo ảnh từ văn bản. Điều này biến đây thành tín hiệu độc lập mạnh mẽ nhất cho đến nay cho thấy nỗ lực phát triển hình ảnh nội bộ của Microsoft đã thu hẹp khoảng cách với OpenAI — và API công khai vẫn chưa được phát hành rộng rãi.
Những con số chủ chốt
• Xếp hạng Arena text-to-image: Hạng 2 — điểm 1.336±11, sơ bộ, ~3.488 phiếu bầu
• Khoảng cách với vị trí số 1 (GPT Image 2 Medium): 45 Elo
• Dẫn trước số 3 (Grok Imagine Image 2.0): 20 Elo
• Vượt qua MAI-Image-2.5: +79 Elo tổng thể, +91 Elo về kết xuất văn bản
• Vị trí của phiên bản tiền nhiệm: MAI-Image-2.5 ở vị trí số 10 (1,256)
• Xếp hạng chỉnh sửa ảnh: Hạng 3 trên "Single Image Edit" của Arena — 1,420 điểm, tăng từ hạng 5
• Xếp hạng chỉnh sửa hình ảnh của Artificial Analysis: No. 1 — vượt qua MAI-Image-2.5-Pro (No. 1 trước đó), Reve 2.1 và GPT Image 2; Microsoft nắm giữ hai vị trí đầu bảng
• Xếp hạng text-to-image của Artificial Analysis: Hạng 2 — chỉ xếp sau GPT Image 2; đứng đầu ở 5 trong số 19 bảng xếp hạng hạng mục
• Bản xem trước riêng tư: được công bố ngày 19/8 trên MAI Playground và Microsoft Foundry — theo nhà cung cấp, yêu cầu lời mời, chưa có bảng giá

MAI-Image-2.6 là gì
MAI-Image-2.6 là mẫu mới nhất trong dòng mô hình tạo hình ảnh nội bộ của Microsoft, được xây dựng dưới sự dẫn dắt của Microsoft AI do Mustafa Suleyman phụ trách. Dòng sản phẩm này đã phát triển rất nhanh: MAI-Image-1 là nền tảng, MAI-Image-2 (tháng 3/2026) tạo bước nhảy về độ chân thực và khả năng hiển thị văn bản, MAI-Image-2.5 (tháng 6/2026) bổ sung đầu ra và chỉnh sửa đạt chuẩn chuyên nghiệp, trở thành công cụ bên trong Bing Image Creator, PowerPoint và OneDrive, MAI-Image-2.5-Pro (tháng 7/2026) thêm gói cao cấp 8K — và giờ 2.6 ra mắt khoảng sáu tuần sau phiên bản tiền nhiệm.
Nhịp độ cập nhật quan trọng không kém gì mô hình. Microsoft đang tung ra các cải tiến hình ảnh theo chu kỳ từ sáu đến tám tuần, gần với cách các phòng thí nghiệm tiên phong phát hành mô hình văn bản hơn là cách thị trường hình ảnh từ trước đến nay vẫn vận động. Việc ra mắt ở vị trí số 2 trên bảng xếp hạng Arena ngay khi phát hành, và đạt vị trí số 3 về chỉnh sửa một tuần sau đó, chính là kết quả khi nhịp độ đó được tích lũy.
Kết quả bảng xếp hạng, hãy đọc kỹ
Arena (tên mới của LMArena) xếp hạng các mô hình tạo ảnh dựa trên sở thích mù của con người: người xem thấy hai ảnh được tạo từ cùng một prompt và chọn ảnh tốt hơn. Artificial Analysis cũng chạy một đấu trường sở thích mù độc lập tương tự với hệ số Elo riêng. Cả hai đều là thước đo độc lập về điều mọi người thực sự thích, thay vì các benchmark do nhà cung cấp vận hành — đó là lý do vì sao vị trí ra mắt thứ 2 có trọng lượng thực sự, và vì sao việc hai bảng xếp hạng riêng biệt cùng đồng thuận về một mô hình quan trọng hơn bất kỳ con số đơn lẻ nào. Đó cũng là lý do các con số cần có những lưu ý: điểm 1.336 của Arena là sơ bộ, dựa trên khoảng 3.500 phiếu bầu so với hơn 70.000 phiếu cho mô hình đứng đầu, và mục này được gắn nhãn "preview". Elo từ các phiếu bầu đầu có thể thay đổi; hãy coi xu hướng là vững chắc và điểm số chính xác là tạm thời.

Điều thú vị hơn con số tiêu đề là các mức tăng tập trung vào đâu. Arena xếp MAI-Image-2.6 đứng đầu về hình ảnh và mô hình hóa 3D (tăng từ vị trí thứ sáu), đứng thứ hai về hoạt hình/anime/kỳ ảo (tăng từ vị trí thứ tám), thiết kế sản phẩm, thương hiệu và thiết kế thương mại (tăng từ vị trí thứ bảy), kết xuất văn bản (tăng từ vị trí thứ tám, với mức tăng +91 Elo) và nghệ thuật (tăng từ vị trí thứ tư). Microsoft cho biết mô hình đã cải thiện ở mọi hạng mục được đo lường. Sự dàn trải đó — thiết kế thương mại, 3D, văn bản và nghệ thuật — là dấu hiệu của một mô hình tạo hình ảnh đa dụng, chứ không phải một chuyên gia chỉ biết một chiêu.
Sau đó, hai điểm dữ liệu nữa đã xuất hiện. Bảng xếp hạng chỉnh sửa hình ảnh của Arena — hạng mục "Single Image Edit" — cũng xếp bản dựng mai-image-2.6-preview ở vị trí số 3 với 1.420 điểm, tăng từ vị trí số 5 và cao hơn MAI-Image-2.5 19 điểm, trong đó kết xuất văn bản là mức tăng lớn nhất (+43 điểm). Vào ngày 25 tháng 8, Artificial Analysis còn tiến xa hơn: bảng xếp hạng Image Editing Leaderboard của họ đưa bản dựng xem trước lên vị trí số 1, giành vị trí dẫn đầu từ chính MAI-Image-2.5-Pro của Microsoft (trước đó đứng số 1 với 1.272 Elo) và vượt qua Reve 2.1 cùng GPT Image 2 của OpenAI — Microsoft hiện nắm giữ hai vị trí chỉnh sửa hàng đầu trên bảng xếp hạng đó. Giám đốc mảng AI của Microsoft, Mustafa Suleyman, gọi 2.6 là "mô hình chỉnh sửa hình ảnh tốt nhất trên AA" và cho biết Microsoft nắm giữ ba trong năm vị trí hàng đầu — đó là cách đóng khung của nhà cung cấp; thứ hạng thực tế là do Artificial Analysis tự xếp. Điểm chỉnh sửa AA dành riêng cho chính bản dựng xem trước vẫn chưa được công bố, và cả hai bảng xếp hạng đều còn mới và ít phiếu bầu, vì vậy hãy coi xu hướng là đáng tin cậy, còn các con số chính xác chỉ là tạm thời.
Thực sự có gì mới (do nhà cung cấp báo cáo)
Về khả năng, các mô tả của chính Microsoft cho MAI-Image-2.6 là:
• Tăng cường hiển thị văn bản, ảnh chân dung và hình ảnh 3D
• Đầu ra thương mại và mô phỏng chân thực được trau chuốt hơn trong các trường hợp sử dụng về sản phẩm, thương hiệu và điện ảnh
• Làm việc với nhiều hình ảnh tham chiếu trong một lần tạo
• Nền tảng phong phú hơn — tuân thủ tốt hơn các chi tiết cụ thể trong lời nhắc
• Kiểm soát tốt hơn đối với suy luận, định dạng và độ phân giải
Tất cả những điều đó đều do nhà cung cấp báo cáo và chưa được tái lập độc lập. Bằng chứng độc lập là cặp bảng xếp hạng: đứng thứ 2 về text-to-image trên cả Arena lẫn Artificial Analysis, thứ 3 trên bảng xếp hạng chỉnh sửa của Arena, và thứ 1 trên bảng xếp hạng chỉnh sửa của Artificial Analysis — tất cả chỉ là sơ bộ. Cho đến khi MAI-Image-2.6 được phổ biến rộng rãi và các bên thứ ba có thể chạy các bài đánh giá có kiểm soát, hãy coi danh sách năng lực là tuyên bố của Microsoft và hai bảng xếp hạng là tín hiệu tham chiếu.
Khi bạn thực sự có thể sử dụng nó
Tuần này, MAI-Image-2.6 đã chuyển từ "chỉ có trên Arena" sang "Arena cộng thêm bản xem trước chính thức". Vào ngày 19 tháng 8, Microsoft thông báo mô hình này có sẵn trong bản xem trước riêng tư trên MAI Playground và Microsoft Foundry. Đó là tuyên bố của chính nhà cung cấp, và quyền truy cập bản xem trước được kiểm soát qua lời mời thay vì đăng ký công khai — vì vậy vẫn chưa có bảng giá hay API trả phí theo token. Dấu hiệu thực tế cần theo dõi: khi MAI-Image-2.5 trở thành mặc định trong Bing Image Creator và được triển khai vào PowerPoint và OneDrive, điều đó có nghĩa Microsoft coi nó đủ an toàn để đưa vào sản xuất. Việc triển khai 2.6 tương tự vào các nền tảng đó — hoặc việc gỡ nhãn "preview" — sẽ là tín hiệu cho thấy nó đã sẵn sàng cho các khối lượng công việc sản xuất.

Chi phí có thể là bao nhiêu
Chưa có mức giá nào cho 2.6 được công bố — bản xem trước riêng tư không có biểu giá. Điểm mốc là phần còn lại của dòng sản phẩm, tất cả đều do nhà cung cấp báo cáo:
• MAI-Image-2.5: $5 cho mỗi triệu token nhập văn bản, $8 cho đầu vào hình ảnh, $47 cho đầu ra hình ảnh
MAI-Image-2.5-Flash: $1.75 / $1.75 / $19.50 — bậc khối lượng lớn
• MAI-Image-2.5-Pro (Tháng 7 năm 2026): $5 / $8 / $106 — Đầu ra 8K, độ chính xác kết xuất văn bản 96.8%
Đó là mức chênh lệch gấp năm lần giữa mức giá xuất hình ảnh rẻ nhất và đắt nhất mà Microsoft hiện đang bán, vì vậy chi phí sản xuất của 2.6 sẽ phụ thuộc vào hạng giá mà nó được xếp vào. Với mức giá 47 đô la mỗi triệu token đầu ra của 2.5, một hình ảnh tiêu thụ khoảng một nghìn token đầu ra sẽ rơi vào khoảng năm xu — nhưng Microsoft không công bố số token cho từng hình ảnh, vì vậy hãy coi đó là phép tính, không phải báo giá.
Định giá cũng là nơi lớp định tuyến chứng tỏ giá trị của mình khi mô hình được đưa lên API công khai. Trên OrcaRouter, bất kỳ khoản phí nào Microsoft tính đều được chuyển qua với mức phụ giá 0% — giá niêm yết của nhà cung cấp, không cộng thêm gì — nên chiết khấu khi ra mắt hoặc đợt giảm giá sau đó sẽ về phía bạn trong hóa đơn ngay trong ngày được công bố. Không cần đàm phán lại, không cần hợp đồng thứ hai; mô hình xuất hiện trên cùng một khóa như mọi thứ khác.
Điều này đưa cuộc đua mô hình hình ảnh tới đâu?
Hiện tại, đầu bảng xếp hạng text-to-image của Arena: {{1}}GPT Image 2 (Medium){{/1}} với 1.381 Elo, {{2}}MAI-Image-2.6{{/2}} với 1.336, {{3}}Grok Imagine Image 2.0{{/3}} với 1.316, {{4}}Reve 2.1{{/4}} với 1.302, và {{5}}Meta's Muse Image{{/5}} với 1.282. Năm mô hình nằm trong khoảng chênh lệch 100 Elo ở vị trí dẫn đầu. Artificial Analysis cũng đưa ra kết luận chung tương tự — vị trí số 2 về text-to-image, chỉ sau GPT Image 2 — và bổ sung chi tiết theo hạng mục: bản preview dẫn đầu ở 5 trong số 19 hạng mục text-to-image (Material, Knowledge, Frontier, Retail & Ecommerce, và Marketing & Advertising), trong khi GPT Image 2 đứng đầu ở tất cả các hạng mục còn lại. Hai bảng xếp hạng dựa trên đánh giá ưu tiên độc lập cùng chỉ về một hướng là tín hiệu đáng tin cậy nhất bạn có thể có về một mô hình còn non trẻ như thế này. Khoảng cách chất lượng từng ngăn cách giữa người dẫn đầu và phần còn lại đã thu hẹp đến mức câu hỏi "mô hình hình ảnh tốt nhất" không còn hữu ích nữa — điều quan trọng bây giờ là khả năng chỉnh sửa, độ chính xác theo ngữ cảnh, tốc độ, và giá cả.
Cược của Microsoft rộng hơn bất kỳ ngôi vương bảng xếp hạng đơn lẻ nào: một bộ mô hình nội bộ bao trùm hình ảnh, giọng nói, mã nguồn và suy luận, được phân phối qua Copilot, Bing và Office. Thứ hạng trên Arena là minh chứng cho nỗ lực; sự phân phối mới thực sự là sản phẩm.
Cách dùng thử mà không đánh cược cả production vào đó
{{1}}Bản xem trước Arena miễn phí — hãy thử generate với nó ngay hôm nay nếu bạn muốn có tín hiệu thô.{{/1}} {{2}}Nếu bạn có quyền truy cập private preview, các điểm vào MAI Playground và Microsoft Foundry cho phép bạn chạy các workload thực tế trước khi cam kết.{{/2}} {{3}}Đối với những người còn lại, cách hợp lý để áp dụng một mô hình hoàn toàn mới với điểm số "sơ bộ" là định tuyến một phần lưu lượng đến nó và giữ mô hình đã được kiểm chứng của bạn làm phương án dự phòng.{{/3}} {{4}}Đó chính xác là dạng lỗi mà một lớp định tuyến được tạo ra để xử lý:{{/4}} trên OrcaRouter, bạn sẽ trỏ một endpoint tới MAI-Image-2.6 ngay khi nó được lưu trữ trên một nhà cung cấp upstream, và để cơ chế chuyển đổi dự phòng tự động xử lý các trường hợp biên mà những đánh giá còn ít phiếu trên bảng xếp hạng không thể phát hiện ra. {{5}}Một API key, 200+ mô hình, đúng giá nhà cung cấp.{{/5}}
Xem gì tiếp theo
• Liệu hạng chỉnh sửa số 1 trên Artificial Analysis và hạng số 3 trên Arena có giữ vững khi số phiếu tích lũy — cả hai bảng xếp hạng đều còn sớm và ít phiếu bầu.
• Giá API công khai và nó thuộc bậc giá nào — bản xem trước riêng tư vẫn chưa có bảng giá
• Liệu Bing Image Creator và Copilot có chuyển mặc định từ 2.5 sang 2.6 hay không
• Các điểm chuẩn độc lập khi API được mở
Liệu nhãn "preview" có được gỡ bỏ hay không — dấu hiệu cho thấy Microsoft đủ tự tin để bán nó.
FAQ
Khi nào tôi thực sự có thể sử dụng MAI-Image-2.6?
Hiện tại có thể truy cập thông qua Arena, nền tảng miễn phí. Kể từ ngày 19 tháng 8, nó cũng có bản xem trước riêng tư trên MAI Playground và Microsoft Foundry — theo thông báo của chính Microsoft, nên việc truy cập được cấp qua lời mời thay vì đăng ký công khai. Vẫn chưa có API công khai trả phí theo token và chưa có mức giá được công bố.
Kết quả chỉnh sửa ảnh mạnh mẽ đến mức nào?
Trên Bảng xếp hạng Chỉnh sửa Hình ảnh của Artificial Analysis, MAI-Image-2.6-Preview đứng số 1, vượt qua MAI-Image-2.5-Pro, Reve 2.1 và GPT Image 2 — Microsoft giữ hai vị trí dẫn đầu. Trên bảng "Single Image Edit" của Arena, nó đứng thứ 3 với 1.420 điểm, tăng từ vị trí thứ 5. Cả hai đều là kết quả bình chọn mù độc lập nhưng còn sớm và ít phiếu bầu, và điểm chỉnh sửa AA cho bản preview vẫn chưa được công bố.
Nó gần với GPT Image 2 Medium đến mức nào?
45 Elo trên bản chụp nhanh Arena text-to-image hiện tại — đủ gần để chênh lệch giữa hạng 2 / hạng 1 nằm trong phạm vi mà luồng bình chọn có thể thay đổi, và năm mô hình hàng đầu đều nằm trong khoảng 100 Elo.
Thứ hạng Arena có đáng tin cậy không?
Đây là những kết quả đánh giá sở thích con người độc lập, thực hiện mù — chính điều đó tạo nên ý nghĩa của chúng — nhưng cả hai chỉ mang tính sơ bộ (khoảng 3.500 phiếu trên bảng text-to-image) và gắn với bản xem trước. Hãy tin vào xu hướng, đừng tin vào số thập phân.
Điểm mấu chốt: MAI-Image-2.6-Preview là mô hình Microsoft đầu tiên thực sự xứng đáng góp mặt trong cuộc đua tiên phong — và nó đạt được điều đó rất nhanh: đứng thứ 2 trên bảng xếp hạng text-to-image của Arena ngay khi ra mắt, đứng thứ 1 về chỉnh sửa ảnh trên Artificial Analysis tính đến ngày 25/8, và có bản xem trước riêng tư trên chính các nền tảng của Microsoft trước khi có API công khai. Hai bảng xếp hạng độc lập hiện cùng hội tụ về một nhận định. Nếu mức giá cuối cùng rơi vào khoảng phân khúc Flash, nó sẽ trở thành một trong những lựa chọn giá trị hấp dẫn nhất trong lĩnh vực tạo ảnh năm nay. Các thứ hạng chỉnh sửa ảnh và bản xem trước sẽ trả lời câu hỏi "liệu nó có thật không." API công khai và mức giá sẽ trả lời "liệu nó có đáng để xây dựng dựa trên nó không."
