
fal's H3 Max renderiza um clipe de 5 segundos em menos de 3 segundos — agora #1 em imagem para vídeo
- AlibabaNOVOQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 por 1M de tokens
- z-aiNOVOZ.ai: GLM 5.3 Flash2026-08-2658Inteligência72Código
- DeepSeekNOVODeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 por 1M de tokens
- z-aiNOVOZ.ai: GLM 5.32026-08-1860Inteligência75Código
- obsidianNOVOQwen3.8 27B2026-08-1552Inteligência68Código
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Inteligência69Código
- grokSpaceXAI: Grok 4.62026-08-1261Inteligência77Código
- metaMeta: Muse Spark 1.22026-08-0557Inteligência72Código
- qwenQwen: Qwen3.8 Max2026-08-0358Inteligência72Código
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Inteligência69Código
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 por 1M de tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Inteligência78Código
- googleGoogle: Gemini 3.6 Flash2026-07-2152Inteligência69Código
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Inteligência49Código
- metaMeta: Muse Spark 1.12026-07-1653Inteligência71Código
- kimiMoonshotAI: Kimi K32026-07-1560Inteligência76Código
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Inteligência71Código
O número mais surpreendente no novo lançamento do MiniMax H3 Max não é a posição no ranking, embora isso também seja digno de nota: o modelo de vídeo que a fal pós-treinou a partir do MiniMax H3 acabou de conquistar o primeiro lugar no ranking de imagem-para-vídeo do Artificial Analysis. É o número de tempo na página do próprio modelo da fal, onde um clipe de amostra de 5 segundos reporta 2,77 segundos de inferência. Isso é geração sub-tempo-real a partir de uma API pública — o clipe completo é renderizado antes que uma reprodução em tempo real do mesmo clipe terminasse — e é a razão pela qual este lançamento está atraindo atenção além do público habitual de lançamentos de modelos. O MiniMax H3 Max gera clipes de 5 a 15 segundos com áudio nativo em até 768p e, no momento, oferece um desconto de lançamento de 50% sobre o preço, que expira em 1º de setembro.
Por que "menos de 3 segundos" importa mais do que o pódio
Todo modelo de vídeo afirma ter alguma versão de rapidez, então vale a pena ser preciso sobre o que o número da fal realmente diz. Os 2,77 segundos vêm da medição de inferência na própria saída de exemplo da página do modelo fal para um clipe de cinco segundos — um número reportado pelo fornecedor, não medido de forma independente, e ainda não reproduzido em nenhum lugar onde o resto de nós possa executar. Mesmo considerando essa ressalva, é um número impressionante, porque 2,77 segundos para cinco segundos de vídeo é um fator de tempo real em torno de 0,55. Um modelo que gera um clipe mais rápido do que o clipe é reproduzido transforma a geração de vídeo de um trabalho em lote em algo que você pode colocar dentro de um loop: gerar, avaliar, regenerar, tudo dentro do tempo que uma pessoa gastaria esperando por uma única renderização.
O trade-off é o mesmo apontado pelo enquadramento de “velocidade vs. qualidade” do tweet. Um fator de tempo real de 0,55x vem do fato de a fal co-otimizar o pós-treinamento com sua própria pilha de inferência — descrição da fal, não replicada por nenhum benchmark independente além dos leaderboards — e é mais fácil de atingir em 768p do que em resoluções mais altas. Também não há almoço grátis na outra direção: o MiniMax H3 Max tem como teto 768p, então a velocidade é em parte função do teto. Você está comprando o nível mais rápido da família H3, e a escada de resoluções termina onde a velocidade começa.
Onde aterrissou nas pranchas
Os rankings com áudio da Artificial Analysis, capturados em 27/08/2026, colocaram o MiniMax H3 Max em #1 em image-to-video, com Elo 1.204 — uma vantagem de 13 pontos sobre o Dreamina Seedance 2.0 720p da ByteDance, com 1.191, e uma vantagem de 20 pontos sobre o MiniMax H3 base, com 1.184. Em text-to-video, ele fica em #3 com Elo 1.235, dentro de uma margem de seis pontos no topo: Wan 3.0 com 1.240, Gemini Omni Flash com 1.237, MiniMax H3 Max com 1.235 e o MiniMax H3 base com 1.226. Esses são escores Elo de preferência humana às cegas das próprias arenas da Artificial Analysis, não números informados pelos fornecedores, e, como toda arena, eles flutuam à medida que novos modelos e novos votos chegam.

• Imagem para vídeo (com áudio) — MiniMax H3 Max #1, Elo 1.204. Dreamina Seedance 2.0 720p #2, 1.191. MiniMax H3 #3, 1.184.
• Texto para vídeo (com áudio) — Wan 3.0 #1, 1.240. Gemini Omni Flash #2, 1.237. MiniMax H3 Max #3, 1.235. MiniMax H3 #4, 1.226.
• Data da captura — 2026-08-27; ambos os quadros mudam à medida que os votos se acumulam.
O preço de lançamento, e o relógio nele
O preço tem um prazo, que é a parte que a maioria das coberturas vai deixar passar. A fal está oferecendo um desconto de lançamento de 50% no MiniMax H3 Max que, segundo a própria página do modelo, termina em 1º de setembro. Na taxa promocional, 768p custa US$ 0,04 por segundo — US$ 2,40 por minuto — e 480p custa US$ 0,025 por segundo — US$ 1,50 por minuto. Após o desconto, as taxas padrão são US$ 0,08 por segundo em 768p (US$ 4,80 por minuto) e US$ 0,05 por segundo em 480p (US$ 3,00 por minuto).
Coloque isso ao lado do MiniMax H3 base e a promoção está fazendo a maior parte do trabalho. No mesmo painel do Artificial Analysis, o modelo base é registrado a $7.80 por minuto — mas essa é a tarifa 2K. Na resolução de 768p onde o MiniMax H3 Max realmente compete, o MiniMax H3 base custa $0.08 por segundo, ou $4.80 por minuto — exatamente o que será a tarifa padrão do pós-treinamento após 1º de setembro. Em outras palavras: a diferença atual de $2.40 contra $7.80 é, na verdade, uma comparação entre um nível 768p com desconto e um nível 2K sem desconto. A comparação justa é em 768p, e nesse caso a vantagem de preço dura até o fim do desconto.

O que fal realmente mudou
A fal descreve o MiniMax H3 Max como pós-treinado a partir do MiniMax H3 para maior aderência ao prompt e melhor estética, e depois co-otimizado com a stack de inferência personalizada da fal para maior throughput — sendo o throughput a origem da velocidade. O que é mensurável de fora é o envelope de saída: clipes de 5 a 15 segundos com áudio nativo, em até 768p, com os endpoints de texto-para-vídeo e referência-para-vídeo da mesma família disponíveis em torno dele. O teto de 768p é a verdadeira restrição a ter em mente. Isso significa que “Max” é uma afirmação sobre o leaderboard e a velocidade, não sobre a escada de resolução: os pesos abertos do MiniMax H3 base também chegam ao máximo em 768p, enquanto sua API hospedada atinge 2K por meio de um módulo de regeneração exclusivo da API. Um modelo pós-treinado derivado do lançamento aberto herda o mesmo teto.
A questão dos pesos abertos
fal declarou sua intenção de liberar os pesos do MiniMax H3 Max, o que tornaria o pós-treinamento o modelo de pesos abertos mais bem classificado em ambos os rankings com áudio — à frente do MiniMax H3 base, que detém esse título hoje. Se isso se concretiza como genuinamente aberto é a questão em aberto. O MiniMax H3 base foi aberto em 3 de agosto sob uma licença comunitária personalizada que, segundo os próprios termos da MiniMax, exclui o uso do modelo e de suas saídas na UE, no Reino Unido, na Coreia do Sul e nos EUA, e exige autorização prévia por escrito para uso comercial acima de US$ 20 milhões em receita anual. Se os pesos do H3 Max forem liberados sob algo semelhante, "aberto" carregará o mesmo território delimitado ao seu redor — com a complicação extra de que um pós-treinamento desenvolvido por terceiros fica em uma posição de licenciamento mais cinzenta do que o original.
Chamando-o a partir de um roteador.
Para fins práticos, a parte roteável desta família é o modelo base. O MiniMax H3 está no OrcaRouter hoje ao preço de tabela do provedor — US$ 0,08 por segundo a 768p, US$ 0,13 por segundo a 2K — com markup de 0% e failover automático, para que as equipes possam chamar a família H3 por meio de uma única API sem integrar um endpoint de fornecedor que tem apenas dias de existência. O MiniMax H3 Max em si ainda não é roteado; ele é servido apenas pela API do próprio desenvolvedor. É exatamente para isso que serve o hábito de failover: você pode prototipar contra o atual modelo nº 1 de imagem para vídeo sem comprometer um caminho de produção com ele, e se o H3 Max chegar a um provedor roteado, ele aparecerá ao preço de tabela no mesmo dia — com a promoção do fornecedor incluída — em vez de uma integração feita à mão que consome seu tempo e o markup deles.

O que assistir nas próximas semanas
{{1}}Três datas e decisões determinam se esta estreia será um momento ou uma nota de rodapé.{{/1}} {{2}}Primeiro, 1º de setembro:{{/2}} {{3}}quando o desconto de 50% termina,{{/3}} {{4}}o preço do 768p dobra e se iguala ao modelo básico,{{/4}} {{5}}e o "líder de imagem-para-vídeo por US$ 2,40" se torna um "líder de imagem-para-vídeo por US$ 4,80"{{/5}} {{6}}— o que muda a proposta de valor para qualquer pessoa que planeje volume sustentado.{{/6}} {{7}}Segundo, os pesos:{{/7}} {{8}}se a fal realmente os disponibiliza e sob qual licença.{{/8}} {{9}}Terceiro, a arena:{{/9}} {{10}}se a vantagem mínima de seis pontos no topo do texto-para-vídeo se sustenta à medida que os votos se acumulam.{{/10}} {{11}}Nada disso está decidido,{{/11}} {{12}}o que é exatamente a razão pela qual um modelo sub-real-time{{/12}} {{13}}que acabou de assumir o topo do ranking pela metade do preço{{/13}} {{14}}é o começo da história, e não o fim.{{/14}}
