
Ming-Image-0.1-Design vs MAI Image 2.6 Preview : des poids ouverts que personne n’héberge, face à un aperçu que Microsoft facture déjà
- OrcaNOUVEAUOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 par million de tokens
- orcaNOUVEAUOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 par million de tokens
- deepseekNOUVEAUDeepSeek: DeepSeek V4.1 Flash2026-09-1040Intelligence
- openaiOpenAI: GPT-6 Astra2026-09-0453Intelligence77Code
- googleGoogle: Gemini 3.8 Flash2026-09-0241Intelligence76Code
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Intelligence76Code
- anthropicAnthropic: Claude Fable 5.12026-09-0153Intelligence82Code
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 par million de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Intelligence72Code
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 par million de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Intelligence75Code
- obsidianQwen3.8 27B2026-08-1534Intelligence68Code
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Intelligence69Code
- grokSpaceXAI: Grok 4.62026-08-1244Intelligence77Code
- metaMeta: Muse Spark 1.22026-08-0540Intelligence72Code
- qwenQwen: Qwen3.8 Max2026-08-0345Intelligence76Code
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Intelligence69Code
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 par million de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Deux modèles, tous deux décrits par leurs fabricants comme inachevés, et le mot désigne des choses opposées de chaque côté. MAI Image 2.6 Preview est inachevé au sens où Microsoft l'a livré quand même : répertorié sur le tableau indépendant comme publié le 10 août 2026, suivi à 38,90 $ les 1 000 images, classé cinquième dans la catégorie UI/UX Design avec 1 168,8 Elo sur 818 comparaisons à l'aveugle — un aperçu avec un prix et un score. Ming-Image-0.1-Design est inachevé au sens où inclusionAI a publié l'artefact et rien autour : des poids 6B sous licence MIT sur Hugging Face depuis le 17 septembre 2026, une configuration mono-GPU validée, et aucun endpoint, aucun prix, aucun fournisseur, aucun score indépendant, et un Quick Start pointant vers un dépôt GitHub qui renvoie une 404. L'un est un produit en bêta. L'autre est un fichier de poids dans un dossier. Cet article porte sur ce qui les sépare, ce qui s'avère être presque entièrement une question d'infrastructure plutôt que de qualité de modèle.
La licence est la seule dimension où le modèle ouvert l'emporte
Commencez ici, car c'est le seul endroit où la comparaison est véritablement favorable à Ming-Image-0.1-Design et où la marge est importante.
• Ming-Image-0.1-Design — licence MIT sur les poids. Téléchargez-les, modifiez-les, affinez-les, intégrez-les dans un produit commercial, hébergez-les pour vos clients, sans frais par appel pour qui que ce soit et sans conditions d’utilisation à négocier. Les métadonnées du dépôt confirment la licence et l’empaquetage safetensors/diffusers.
• MAI Image 2.6 Preview — une API commerciale selon les conditions de Microsoft. Il existe une grille tarifaire et des conditions d’utilisation, et le modèle est accessible plutôt que possédé. Rien dans les informations publiques ne suggère que Microsoft ait l’intention d’ouvrir ces poids.
C'est un véritable avantage, et il ne faut pas le balayer d'un revers de main. Une équipe disposant d'un budget GPU fixe, d'une contrainte de confidentialité ou d'un besoin de fine-tuning sur des ressources de conception propriétaires n'a aucun moyen d'accéder à MAI Image 2.6 Preview — l'API ne peut pas être auto-hébergée, et une API de préversion n'offre aucune garantie de disponibilité à long terme. Ming-Image-0.1-Design peut être exécuté sur votre propre matériel pour toujours, sous une licence que les juristes comprennent depuis des décennies.
L’avantage ne se transforme en valeur que si vous pouvez l’exécuter, ce qui nous amène au reste du tableau.
Tout le reste, vérifié une ligne à la fois
• Point de terminaison — MAI Image 2.6 Preview est servi via la propre plateforme de Microsoft sous un identifiant documenté, contrairement à Ming-Image-0.1-Design, qui n’en a aucun. Hugging Face signale que le dépôt a l’inférence désactivée et qu’il n’est déployé par aucun fournisseur d’inférence, et le guide de démarrage rapide du modèle lui-même vous dit de cloner un dépôt associé qui n’existe pas.
• Prix — 38,90 $ pour 1 000 images, soit environ 3,9 cents par image, ce qui en fait le deuxième moins cher du top cinq de la catégorie UI/UX Design, derrière Muse Image à 10,00 $ et largement en dessous de Grok Imagine Image 2.0 à 60,00 $ et de GPT Image 2.5 à 210,72 $ contre aucun prix, car il n'y a rien à acheter. Les poids sont gratuits ; le GPU CUDA de 80 GiB ne l'est pas.
• Score indépendant — 1 168,8 Elo sur 818 votes à l'aveugle dans la catégorie Conception UI/UX, cinquième place, au-dessus de Nano Banana 2 à 1 166,6 et en dessous de Grok Imagine Image 2.0 à 1 181,8. Le modèle frère, MAI-Image-2.6-Flash, se situe à 1 152,4 sur le même tableau face à rien. Le seul chiffre de Ming-Image-0.1-Design, 1 082 Elo, apparaît exclusivement sur un graphique de classement à l'intérieur du propre dépôt d'inclusionAI, sur un tableau que nous n'avons pas pu trouver sur le web public, sans nombre de votes indiqué.
• Support de déploiement — une plateforme managée avec disponibilité et support associés vs une fiche de modèle recommandant vLLM-Omni et renvoyant vers un guide d’installation qui fonctionne et une recette spécifique au modèle qui renvoie une 404. Un demi-récit de déploiement.
• Résolution et configuration — non publiées dans les chiffres que nous avons pu vérifier pour l'aperçu, contre 2048 x 2048 recommandé ou 1024 x 1024 pour la vitesse, 12 étapes d'échantillonnage, CFG 1.0, BF16, un GPU CUDA de 80 GiB.

Ce que la « préversion » vous coûte côté Microsoft
Une comparaison honnête doit noter que la colonne Microsoft n’est pas sans risques qui lui sont propres. Une préversion reste une préversion : les identifiants peuvent changer, les grilles tarifaires peuvent évoluer, les quotas peuvent être resserrés, et un point de terminaison de préversion peut être retiré ou supplanté — et Microsoft a déjà livré un homologue Flash dans la même famille, ce qui indique que la gamme évolue rapidement. Construire un pipeline de production sur un identifiant de préversion signifie accepter que ce que vous avez intégré puisse être renommé sous vos pieds.
La différence est que le risque lié à Microsoft est un risque commercial avec une contrepartie, tandis que le risque lié à Ming-Image-0.1-Design est un risque d’ingénierie sans contrepartie. Si une API en préversion change, il existe un canal de support, une fenêtre de dépréciation et un successeur documenté. Si le dépôt manquant n’apparaît jamais, il n’y a personne à qui demander — le chemin d’exécution documenté du modèle est un 404, et la seule alternative est de faire vous-même de la rétro-ingénierie du pipeline à partir de l’arborescence de fichiers.
Ce qui n'est pas impossible. Le dépôt est bien structuré pour cela : un dossier transformer avec cinq fragments, un VAE, un planificateur, et des composants mllm, connector et mlp distincts, ce qui correspond à la forme d'un pipeline multi-étapes avec un modèle de langage multimodal assurant l'encodage du texte. La fiche indique que l'amélioration des prompts peut être gérée par Ling-3.0-flash-VL ou qwen3.8-27B, deux modèles frères de la même organisation. Une équipe compétente pourrait mettre cela en place. Ce n'est simplement pas la même chose qu'un produit.
Où une couche de routage a sa place, et où elle ne l’a pas
Aucun des deux modèles de cette comparaison n’est routable via OrcaRouter aujourd’hui, et il faut le dire sans détour : notre catalogue ne contient aucune entrée Microsoft MAI ni aucune entrée inclusionAI à la date du 23 septembre 2026, donc ni le tarif de 38,90 $ ni rien d’autre de ce qui précède ne correspond à un prix auquel vous pouvez accéder par notre intermédiaire. Les deux chiffres proviennent des tarifs publiés par les fournisseurs eux-mêmes ou suivis par leur conseil d’administration.
Ce à quoi sert la couche de routage dans une confrontation comme celle-ci, c'est à combler l'écart entre maintenant et plus tard. L'économie de la génération d'images s'est dissociée de la qualité au cours du dernier trimestre — le leader de la catégorie coûte 210,72 $ pour 1 000 images, le modèle classé cinquième coûte 38,90 $, et un modèle treize points Elo en dessous coûte 10,00 $ — ce qui signifie que le modèle approprié pour une charge de travail donnée est une cible mouvante plutôt qu'un choix figé. Maintenir l'appel de génération derrière un seul point d'accès couvrant plus de 200 modèles, avec les prix catalogue des fournisseurs répercutés à 0 % de marge et un basculement automatique en cas de défaillance d'un fournisseur, transforme cette cible mouvante en un simple changement d'ID de modèle plutôt qu'en un projet d'intégration. Cela vaut plus que n'importe quel modèle de cette liste, et c'est l'argument pour ne pas souder votre pipeline à un identifiant de préversion dès le départ.

Lequel choisir, et qu’est-ce qui changerait la réponse ?
Pour quiconque livre du travail ce trimestre, la réponse est MAI Image 2.6 Preview, et ce n'est même pas serré. Il est appelable, il est bon marché pour sa catégorie de qualité, il a 818 votes indépendants à l'aveugle derrière un classement à la cinquième place, et le risque lié à la préversion est un risque commercial gérable. La seule chose à faire avant de s'engager est de traiter l'identifiant de préversion comme volatil — gardez-le dans la configuration, pas dans le code, et ayez un second modèle d'image à une ligne près au cas où l'identifiant changerait.
Ming-Image-0.1-Design vaut le téléchargement, mais ne justifie pas qu'on planifie autour de lui. Récupérez les poids si vous disposez d'une carte de 80 GiB et d'une raison de tester la génération de design riche en texte sous licence permissive, car c'est la seule chose qu'il offre que l'API de Microsoft ne peut structurellement pas fournir. N'inscrivez pas le score Elo de 1 082 dans une diapositive — c'est un graphique de fournisseur sur un classement que personne d'autre ne peut inspecter, et le dépôt du modèle lui-même affiche zéro téléchargement, ce à quoi ressemble, à ce stade, une affirmation sans témoin extérieur. Les réglages recommandés de la carte sont au moins concrets et vérifiables : 2048 x 2048 à 12 étapes d'échantillonnage, CFG 1.0, BF16.
L’événement qui réécrirait cet article est le même que celui qui réécrirait chaque comparaison de cette série : un score indépendant Ming-Image-0.1-Design, avec un nombre d’échantillons à côté, sur un classement qu’inclusionAI n’exploite pas. À ce moment-là, la question devient vraiment intéressante — un modèle 6B auto-hébergé à coût marginal nul face à une API de prévisualisation à 3,9 cents, à 1 169 Elo — et, pour la première fois, les deux côtés de la comparaison auraient un chiffre qui signifie la même chose.

