
Ming-Image-0.1-Design vs FLUX 3: Duas maneiras de um modelo de imagem não estar disponível
- OrcaNOVOOrca: OrcaCyber Zero 1.02026-09-17$3.00 / $5.00 por 1M de tokens
- orcaNOVOOrca: OrcaVerify Text 1.02026-09-16$2.00 / $0.00 por 1M de tokens
- deepseekNOVODeepSeek: DeepSeek V4.1 Flash2026-09-1040Inteligência
- openaiOpenAI: GPT-6 Astra2026-09-0453Inteligência77Código
- googleGoogle: Gemini 3.8 Flash2026-09-0241Inteligência76Código
- qwenQwen: Qwen3.8 Max (0902)2026-09-0245Inteligência76Código
- anthropicAnthropic: Claude Fable 5.12026-09-0153Inteligência82Código
- AlibabaQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiZ.ai: GLM 5.3 Flash2026-08-2642Inteligência72Código
- DeepSeekDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.22 / $0.66 por 1M de tokens
- z-aiZ.ai: GLM 5.32026-08-1845Inteligência75Código
- obsidianQwen3.8 27B2026-08-1534Inteligência68Código
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1236Inteligência69Código
- grokSpaceXAI: Grok 4.62026-08-1244Inteligência77Código
- metaMeta: Muse Spark 1.22026-08-0540Inteligência72Código
- qwenQwen: Qwen3.8 Max2026-08-0345Inteligência76Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3134Inteligência69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
Ambos Ming-Image-0.1-Design e o nível de imagem do FLUX 3 são, neste momento, modelos que não pode invocar. Chegaram lá por vias opostas. O Ming-Image-0.1-Design é um artefacto acabado sem porta de entrada: 6B de pesos licenciados sob MIT, publicados no Hugging Face pela inclusionAI a 17 de setembro de 2026, documentados num cartão de modelo cujo Quick Start lhe diz para clonar um repositório que devolve 404. O FLUX 3 é uma porta de entrada sem nada por trás: a Black Forest Labs anunciou a família a 23 de julho de 2026 como quatro níveis — Video, Image, Action e Dev —, lançou o nível de vídeo e, desde então, não publicou qualquer endpoint de imagem do FLUX 3, identificador de modelo, esquema de pedido ou preço. Isto é uma comparação entre um modelo que existe e não pode ser executado e um modelo que é prometido e não pode ser cotado, o que é uma coisa mais útil de saber do que qualquer uma das manchetes isoladamente.
O que cada lado realmente publicou
A distinção entre um repositório e um anúncio é importante, então aqui está lado a lado.
• Artefato — Ming-Image-0.1-Design tem pesos reais: cinco fragmentos de transformer, um VAE, um agendador e componentes separados mllm, connector e mlp, todos sob licença MIT, versus FLUX 3, onde o único componente disponível é a camada de vídeo, disponível em geral desde o início de agosto de 2026.
• Identificador — inclusionAI/Ming-Image-0.1-Design, invocável como um ID de repositório do Hugging Face vs. nenhum ID de modelo de imagem FLUX 3 em absoluto. A documentação do endpoint da Black Forest Labs lista /flux-2-max, /flux-2-pro, /flux-2-flex e as /flux-2-klein-* rotas; uma /flux-3 rota de imagem não aparece.
• Configuração recomendada — 2048 x 2048 com 12 etapas de amostragem, escala CFG 1,0, BF16, uma GPU CUDA de 80 GiB vs nada publicado para o nível de imagem.
• Preço — nenhum. Os pesos são gratuitos para download sob a licença MIT, mas não há endpoint hospedado para comprar, em contraste com uma tabela de preços publicada que cobre apenas vídeo, a aproximadamente US$ 0,06 por segundo em 720p draft, US$ 0,17 em HD e US$ 0,29 em FHD.
• Código — um Quick Start que não funciona, porque o repositório complementar inclusionAI/Ming-Imageestá ausente da lista de repositórios públicos da organização versus um formulário de candidatura a acesso antecipado, aberto com prioridade para vídeo, sem qualquer documentação sobre o nível de imagem por trás.
• Pontuação independente — nenhuma. O Ming-Image-0.1-Design não aparece em nenhum quadro do Artificial Analysis, em nenhuma visualização por categoria nem em nenhuma visualização de pesos abertos em 23 de setembro de 2026, tal como também não aparece nenhum nível do FLUX 3. As entradas da BFL mais próximas no quadro em direto são da geração anterior: FLUX.2 [flex] com 1 065 Elo na categoria de Design UI/UX e 1 026 no quadro geral de texto para imagem, com FLUX.2 [max] em 1 053 e FLUX.2 [dev] em 1 000.

Por que o nível de vídeo foi lançado e o nível de imagem não
A Black Forest Labs apresentou uma razão, e vale a pena declará-la com precisão porque ela molda o que se deve esperar. A empresa afirmou que mais de 95% da capacidade computacional de treinamento do FLUX 3 foi destinada à predição de vídeo. Essa é uma explicação coerente para o fato de o nível de vídeo ser aquele que tem um produto por trás, e também é o motivo para se ser cético quanto à suposição de que o nível de imagem chegará como um pequeno delta quando isso acontecer. A capacidade foi treinada em segundo lugar, e as promessas de roadmap associadas a ela não são pequenas: tratamento aprimorado de prompts complexos, renderização de texto multilíngue de alta precisão, transferência de estilo, consistência de personagem e de marca sem ajuste fino e edição não destrutiva. Cada uma dessas é uma alegação, e não um recurso, até que exista um endpoint para testar.
O que a BFL vende para imagens estáticas hoje é a linha anterior: FLUX.2 em suas variantes max, pro, flex e klein, além dos lançamentos mais antigos FLUX Pro, Dev e Schnell, por cerca de um centavo e meio a sete centavos por imagem, dependendo do nível e da resolução. Esses são produtos reais, invocáveis, e são a referência honesta de onde se encontra a qualidade de imagem da BFL enquanto a camada de imagem do FLUX 3 aguarda.
A lacuna de implantação é a assimetria interessante.
É aqui que os dois modelos deixam de ser imagens espelhadas. O Ming-Image-0.1-Design não tem código funcional, mas tem uma história de serving: o cartão do modelo recomenda o vLLM-Omni, e em 22 de setembro o repositório ganhou links para o guia de instalação desse framework e para uma receita específica do modelo. O guia de instalação resolve. A receita não — retorna 404 desde 23 de setembro — então o que você tem é um framework que reconheceu o modelo e uma página específica do modelo que ainda não foi escrita. Isso ainda está mais avançado do que um formulário de candidatura.
O nível de imagem do FLUX 3 tem o perfil oposto. A Black Forest Labs é uma empresa com uma API funcional, uma lista documentada de endpoints e um nível de vídeo em produção nela. A infraestrutura para um endpoint de imagem do FLUX 3 existe claramente. O que não existe é a decisão de expô-lo. Não há ID de modelo com acesso restrito para solicitar, nem data de confirmação da lista de espera, nem lista de capacidades publicada que sobreviva ao contato com um esquema de requisição.
A consequência prática: uma equipe que queira servir o Ming-Image-0.1-Design pode começar hoje lendo o quickstart do vLLM-Omni e integrando o modelo por conta própria, em seu próprio hardware, a seu próprio custo, com uma licença permissiva que permite isso. Uma equipe que queira servir o FLUX 3 Image não pode começar a preço algum, porque não há nada para servir.
Lendo a única alegação de desempenho no conjunto.
Ming-Image-0.1-Design inclui um gráfico de ranking dentro de seu repositório: um quadro de Design UI/UX intitulado "Ranking de Texto para Imagem: Design UI/UX", com o rodapé "Pontuações Elo de votos de preferência às cegas em nossa Image Arena", ostentando um selo "Ranking de Pesos Abertos". Nele, o modelo está em primeiro lugar com 1.082 Elo, acima do Ideogram 4.0 (Quality) com 1.052 e das variantes dev do FLUX.2 entre 994 e 1.000.
Dois problemas em interpretar isso como um resultado. O primeiro é a proveniência: é uma arte publicada pelo fornecedor no próprio repositório do fornecedor, e estamos descrevendo o arquivo em vez de verificar o estudo. O segundo é que não conseguimos encontrar o modelo nos painéis ao vivo da Artificial Analysis em 23 de setembro, e a categoria ao vivo de UI/UX Design está em uma escala diferente — seu líder é o GPT Image 2.5 Flare com 1.227 Elo, e as entradas FLUX.2 que o card lista mostram 1.065 para [flex], 1.053 para [max] e 1.000 para [dev] nesse mesmo painel ao vivo. Um ranking expresso em um painel que não conseguimos localizar, cerca de 150 Elo abaixo do painel que conseguimos, não é um resultado de benchmark. É uma alegação aguardando uma execução externa.
Do lado do FLUX 3, não há nada a verificar, e é justamente esse o ponto. Nenhuma meta de resolução, nenhum número de passos, nenhum limite de imagens de referência, nenhuma contagem de parâmetros para o nível de imagem. O roadmap é uma lista de adjetivos.

O que fazer enquanto ambos estão indisponíveis
Nenhum dos dois lados desta comparação é roteável pelo OrcaRouter hoje, e vale a pena ser direto sobre isso em vez de deixar uma página de modelo insinuar o contrário: nosso catálogo não tem nenhum modelo inclusionAI nem nenhum nível FLUX, então os números acima são dos próprios fornecedores e nada aqui é uma rota que você possa chamar por meio da gente. O que a camada de roteamento realmente vale em uma lacuna como esta é o dia seguinte ao fechamento da lacuna. Como o OrcaRouter repassa os preços de tabela dos provedores com 0% de margem, uma revisão de tarifas de um fornecedor entra em vigor do nosso lado no mesmo dia, em vez de depois de um ciclo de reprecificação, e como uma chamada de geração fica atrás de um único endpoint para mais de 200 modelos, trocar por qual desses dois for lançado primeiro é uma mudança de ID de modelo, e não uma migração. O failover automático importa pelo mesmo motivo de sempre com um modelo não comprovado: se um endpoint de imagem de primeiro lançamento oscilar sob carga, a requisição é redirecionada em vez de falhar.
A decisão de hoje é mais restrita do que o enquadramento sugere. Se você precisa de geração de imagens em produção neste trimestre, nenhum dos candidatos se qualifica, e a resposta honesta é um nível FLUX.2 — real, precificado, chamável e avaliado de forma independente — com o FLUX 3 Image acompanhado como uma futura troca. Se você constrói harnesses de avaliação, o Ming-Image-0.1-Design é o objeto mais interessante do par: os pesos podem ser baixados agora, a licença permite o que você quiser fazer com eles, e o primeiro Elo crível que alguém publicar para ele será uma genuína notícia. E se você está acompanhando a BFL, o sinal a observar não é um post de blog. É uma rota /flux-3 aparecendo ao lado das /flux-2-* na documentação dos endpoints, porque esse é o momento em que o nível de imagem deixa de ser um roadmap.

