
L'H3 Max di fal renderizza un clip di 5 secondi in meno di 3 secondi — ora #1 nella conversione da immagine a video.
- AlibabaNUOVOQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1M di token
- z-aiNUOVOZ.ai: GLM 5.3 Flash2026-08-2658Intelligenza72Codice
- DeepSeekNUOVODeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 per 1M di token
- z-aiNUOVOZ.ai: GLM 5.32026-08-1860Intelligenza75Codice
- obsidianNUOVOQwen3.8 27B2026-08-1552Intelligenza68Codice
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligenza69Codice
- grokSpaceXAI: Grok 4.62026-08-1261Intelligenza77Codice
- metaMeta: Muse Spark 1.22026-08-0557Intelligenza72Codice
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligenza72Codice
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligenza69Codice
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1M di token
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligenza78Codice
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligenza69Codice
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligenza49Codice
- metaMeta: Muse Spark 1.12026-07-1653Intelligenza71Codice
- kimiMoonshotAI: Kimi K32026-07-1560Intelligenza76Codice
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligenza71Codice
Il numero più sorprendente nel nuovo rilascio di MiniMax H3 Max non è la posizione in classifica, anche se anche quella è notevole: il modello video che fal ha post-addestrato da MiniMax H3 ha appena conquistato il primo posto nella classifica image-to-video di Artificial Analysis. È il dato sui tempi nella pagina del modello di fal, dove un clip campione di 5 secondi riporta 2,77 secondi di inferenza. Si tratta di generazione sub-real-time da un'API pubblica — il clip completo viene renderizzato prima che una riproduzione in tempo reale dello stesso clip possa terminare — ed è questo il motivo per cui questo rilascio sta attirando attenzione oltre il solito pubblico dei rilasci di modelli. MiniMax H3 Max genera clip da 5 a 15 secondi con audio nativo fino a 768p, e in questo momento offre uno sconto di lancio del 50% sul prezzo, valido fino al 1° settembre.
Perché "sotto i 3 secondi" conta più del podio
Ogni modello video sostiene una qualche versione di "veloce", quindi vale la pena essere precisi su cosa dice realmente il numero di fal. I 2,77 secondi derivano dai tempi di inferenza riportati nella pagina del modello fal sul proprio output di esempio per una clip di cinque secondi: un dato dichiarato dal fornitore, non misurato in modo indipendente, e non ancora riprodotto in nessun luogo dove possiamo eseguirlo anche noi. Anche tenendo conto di questa avvertenza, è un numero notevole, perché 2,77 secondi per cinque secondi di video corrispondono a un fattore di tempo reale intorno a 0,55. Un modello che genera una clip più velocemente di quanto la clip venga riprodotta trasforma la generazione video da un processo batch in qualcosa che puoi inserire in un ciclo: genera, giudica, rigenera, tutto nel tempo che altrimenti una persona passerebbe ad aspettare un singolo render.
Il compromesso è lo stesso a cui punta l'impostazione "velocità vs. qualità" del tweet. Un fattore real-time di 0,55x deriva dal fatto che fal co-ottimizza il post-training con il proprio stack di inferenza — la descrizione di fal, non riprodotta da alcun benchmark indipendente oltre le leaderboard — ed è più facile da raggiungere a 768p che a risoluzioni superiori. Non c'è pranzo gratis nemmeno nella direzione opposta: MiniMax H3 Max arriva al massimo a 768p, quindi la velocità è in parte funzione del tetto. Stai acquistando il livello più veloce della famiglia H3, e la scala delle risoluzioni si ferma dove inizia la velocità.
Dove è finito sui tabelloni
Le classifiche con audio di Artificial Analysis, rilevate il 27 agosto 2026, collocano MiniMax H3 Max al #1 nella generazione da immagine a video con un Elo di 1.204 — un distacco di 13 punti sul Dreamina Seedance 2.0 720p di ByteDance a 1.191 e un distacco di 20 punti sulla base MiniMax H3 a 1.184. Nella generazione da testo a video si posiziona al #3 con un Elo di 1.235, in un fotofinish di sei punti in vetta: Wan 3.0 a 1.240, Gemini Omni Flash a 1.237, MiniMax H3 Max a 1.235 e la base MiniMax H3 a 1.226. Questi sono punteggi Elo basati su preferenze umane alla cieca provenienti dalle arene di Artificial Analysis, non dati dei fornitori, e come ogni arena fluttuano man mano che arrivano nuovi modelli e nuovi voti.

• Da immagine a video (con audio) — MiniMax H3 Max #1, Elo 1.204. Dreamina Seedance 2.0 720p #2, 1.191. MiniMax H3 #3, 1.184.
• Da testo a video (con audio) — Wan 3.0 #1, 1,240. Gemini Omni Flash #2, 1,237. MiniMax H3 Max #3, 1,235. MiniMax H3 #4, 1,226.
• Data di acquisizione — 2026-08-27; entrambe le schede si spostano man mano che i voti si accumulano.
Il prezzo di lancio, e l'orologio su di esso.
I prezzi hanno una scadenza, che è l'aspetto che la maggior parte delle coperture tralascerà. fal sta offrendo uno sconto di lancio del 50% su MiniMax H3 Max che, secondo la sua stessa pagina del modello, scade il 1° settembre. Alla tariffa promozionale, 768p costa $0,04 al secondo — $2,40 al minuto — e 480p costa $0,025 al secondo — $1,50 al minuto. Dopo lo sconto, le tariffe standard sono $0,08 al secondo a 768p ($4,80 al minuto) e $0,05 al secondo a 480p ($3,00 al minuto).
Mettete questo accanto al MiniMax H3 base e la promo fa gran parte del lavoro. Nella stessa classifica di Artificial Analysis, il modello base è riportato a $7,80 al minuto — ma quella è la tariffa 2K. Alla risoluzione 768p in cui MiniMax H3 Max compete davvero, il MiniMax H3 base è listato a $0,08 al secondo, ovvero $4,80 al minuto — esattamente la tariffa standard del post-train dopo il 1° settembre. In altre parole: il divario di oggi di $2,40 contro $7,80 è in realtà un confronto tra un livello 768p scontato e un livello 2K non scontato. Il confronto pulito è a 768p, e lì il vantaggio di prezzo dura fino alla fine dello sconto.

Cosa ha effettivamente cambiato fal
fal descrive MiniMax H3 Max come derivato da un post-training di MiniMax H3 per una maggiore aderenza ai prompt e una migliore estetica, poi co-ottimizzato con lo stack di inferenza personalizzato di fal per un throughput più elevato — ed è proprio dal throughput che deriva la velocità. Ciò che si può misurare dall'esterno è la gamma di output: clip da 5 a 15 secondi con audio nativo, fino a 768p, con gli endpoint text-to-video e reference-to-video della stessa famiglia disponibili attorno ad essa. Il tetto dei 768p è il vero vincolo da ricordare. Significa che "Max" è un'affermazione su leaderboard e velocità, non sulla scala delle risoluzioni: anche i pesi open di MiniMax H3 base si fermano a 768p, mentre la sua API ospitata raggiunge i 2K tramite un modulo di rigenerazione disponibile solo via API. Un post-training derivato dalla versione open eredita lo stesso tetto.
La questione dei pesi aperti
fal ha dichiarato la propria intenzione di rilasciare i pesi di MiniMax H3 Max, il che renderebbe il post-train il modello a pesi aperti con il punteggio più alto su entrambe le classifiche con audio — davanti al MiniMax H3 base, che oggi detiene quel titolo. Se ciò si rivelerà genuinamente aperto è la questione aperta. Il MiniMax H3 base è stato aperto il 3 agosto con una licenza community personalizzata che, secondo i termini stessi di MiniMax, esclude l'uso del modello e dei suoi output nell'UE, nel Regno Unito, in Corea del Sud e negli Stati Uniti, e richiede un'autorizzazione scritta preventiva per l'uso commerciale oltre i 20 milioni di dollari di fatturato annuo. Se i pesi di H3 Max verranno rilasciati con qualcosa di simile, la parola "open" avrà lo stesso territorio tracciato attorno a sé — con l'ulteriore complicazione che un post-train costruito da terze parti si trova in una posizione di licenza più grigia rispetto all'originale.
Chiamandolo da un router.
A fini pratici, la metà instradabile di questa famiglia è il modello base. MiniMax H3 è su OrcaRouter oggi al prezzo di listino del fornitore — $0,08 al secondo a 768p, $0,13 al secondo a 2K — con ricarico 0% e failover automatico, quindi i team possono chiamare la famiglia H3 tramite un'unica API senza integrare un endpoint del fornitore che ha solo pochi giorni. MiniMax H3 Max stesso non è ancora instradato; viene servito solo tramite l'API del suo sviluppatore. È esattamente la situazione a cui serve la pratica del failover: puoi creare prototipi con l'attuale modello numero 1 da immagine a video senza scommetterci un percorso di produzione, e se H3 Max arriva su un provider instradato sarà disponibile al prezzo di listino lo stesso giorno — inclusa la promo del fornitore — invece che tramite un'integrazione artigianale che ti costa tempo e il loro ricarico.

Cosa guardare nelle prossime settimane
Tre date e decisioni determinano se questo debutto sarà un momento o una nota a margine. Primo, il 1° settembre: quando finisce lo sconto del 50%, il prezzo a 768p raddoppia fino alla parità con il modello base, e il «{{1}}$2.40 leader image-to-video{{/1}}» diventa un «{{2}}$4.80 leader image-to-video{{/2}}» — il che cambia la storia del valore per chiunque pianifichi un volume sostenuto. Secondo, i pesi: se fal li rilascerà davvero, e con quale licenza. Terzo, l'arena: se il fotofinish di sei punti in cima alla text-to-video reggerà man mano che i voti si accumulano. Niente di tutto ciò è deciso, ed è esattamente il motivo per cui un modello sub-real-time che ha appena conquistato la vetta di una classifica a metà prezzo è l'inizio della storia piuttosto che la fine.
