Card del titolo hero per l'H3 Max di fal, con la scritta 'H3 Max — clip da 5 secondi in meno di 3 secondi', con card statistiche che mostrano un'inferenza di 2,8s per una clip da 5s, #1 Image-to-Video su Artificial Analysis e una nota sulla risoluzione massima di 768p.
Guides & Insights

L'H3 Max di fal renderizza un clip di 5 secondi in meno di 3 secondi — ora #1 nella conversione da immagine a video.

Autore

Rowan Sterling

Data di pubblicazione

Ultimi modelli · 20Vedi tutti i modelli
Benchmark: Artificial Analysis · aggiornato ogni giorno
Torna a tutti gli articoli

Il numero più sorprendente nel nuovo rilascio di MiniMax H3 Max non è la posizione in classifica, anche se anche quella è notevole: il modello video che fal ha post-addestrato da MiniMax H3 ha appena conquistato il primo posto nella classifica image-to-video di Artificial Analysis. È il dato sui tempi nella pagina del modello di fal, dove un clip campione di 5 secondi riporta 2,77 secondi di inferenza. Si tratta di generazione sub-real-time da un'API pubblica — il clip completo viene renderizzato prima che una riproduzione in tempo reale dello stesso clip possa terminare — ed è questo il motivo per cui questo rilascio sta attirando attenzione oltre il solito pubblico dei rilasci di modelli. MiniMax H3 Max genera clip da 5 a 15 secondi con audio nativo fino a 768p, e in questo momento offre uno sconto di lancio del 50% sul prezzo, valido fino al 1° settembre.

Perché "sotto i 3 secondi" conta più del podio

Ogni modello video sostiene una qualche versione di "veloce", quindi vale la pena essere precisi su cosa dice realmente il numero di fal. I 2,77 secondi derivano dai tempi di inferenza riportati nella pagina del modello fal sul proprio output di esempio per una clip di cinque secondi: un dato dichiarato dal fornitore, non misurato in modo indipendente, e non ancora riprodotto in nessun luogo dove possiamo eseguirlo anche noi. Anche tenendo conto di questa avvertenza, è un numero notevole, perché 2,77 secondi per cinque secondi di video corrispondono a un fattore di tempo reale intorno a 0,55. Un modello che genera una clip più velocemente di quanto la clip venga riprodotta trasforma la generazione video da un processo batch in qualcosa che puoi inserire in un ciclo: genera, giudica, rigenera, tutto nel tempo che altrimenti una persona passerebbe ad aspettare un singolo render.

Il compromesso è lo stesso a cui punta l'impostazione "velocità vs. qualità" del tweet. Un fattore real-time di 0,55x deriva dal fatto che fal co-ottimizza il post-training con il proprio stack di inferenza — la descrizione di fal, non riprodotta da alcun benchmark indipendente oltre le leaderboard — ed è più facile da raggiungere a 768p che a risoluzioni superiori. Non c'è pranzo gratis nemmeno nella direzione opposta: MiniMax H3 Max arriva al massimo a 768p, quindi la velocità è in parte funzione del tetto. Stai acquistando il livello più veloce della famiglia H3, e la scala delle risoluzioni si ferma dove inizia la velocità.

Dove è finito sui tabelloni

Le classifiche con audio di Artificial Analysis, rilevate il 27 agosto 2026, collocano MiniMax H3 Max al #1 nella generazione da immagine a video con un Elo di 1.204 — un distacco di 13 punti sul Dreamina Seedance 2.0 720p di ByteDance a 1.191 e un distacco di 20 punti sulla base MiniMax H3 a 1.184. Nella generazione da testo a video si posiziona al #3 con un Elo di 1.235, in un fotofinish di sei punti in vetta: Wan 3.0 a 1.240, Gemini Omni Flash a 1.237, MiniMax H3 Max a 1.235 e la base MiniMax H3 a 1.226. Questi sono punteggi Elo basati su preferenze umane alla cieca provenienti dalle arene di Artificial Analysis, non dati dei fornitori, e come ogni arena fluttuano man mano che arrivano nuovi modelli e nuovi voti.

A scoreboard card for MiniMax H3 Max listing Image-to-Video #1 (Elo 1,204), Text-to-Video #3 (Elo 1,235), generation speed of a 5s clip in ~2.8s (vendor-reported), max resolution 768p, clip length 5-15s with native audio, and price $0.04/s ($2.40/min) promo ending September 1.

Da immagine a video (con audio) — MiniMax H3 Max #1, Elo 1.204. Dreamina Seedance 2.0 720p #2, 1.191. MiniMax H3 #3, 1.184.

Da testo a video (con audio) — Wan 3.0 #1, 1,240. Gemini Omni Flash #2, 1,237. MiniMax H3 Max #3, 1,235. MiniMax H3 #4, 1,226.

Data di acquisizione — 2026-08-27; entrambe le schede si spostano man mano che i voti si accumulano.

Il prezzo di lancio, e l'orologio su di esso.

I prezzi hanno una scadenza, che è l'aspetto che la maggior parte delle coperture tralascerà. fal sta offrendo uno sconto di lancio del 50% su MiniMax H3 Max che, secondo la sua stessa pagina del modello, scade il 1° settembre. Alla tariffa promozionale, 768p costa $0,04 al secondo — $2,40 al minuto — e 480p costa $0,025 al secondo — $1,50 al minuto. Dopo lo sconto, le tariffe standard sono $0,08 al secondo a 768p ($4,80 al minuto) e $0,05 al secondo a 480p ($3,00 al minuto).

Mettete questo accanto al MiniMax H3 base e la promo fa gran parte del lavoro. Nella stessa classifica di Artificial Analysis, il modello base è riportato a $7,80 al minuto — ma quella è la tariffa 2K. Alla risoluzione 768p in cui MiniMax H3 Max compete davvero, il MiniMax H3 base è listato a $0,08 al secondo, ovvero $4,80 al minuto — esattamente la tariffa standard del post-train dopo il 1° settembre. In altre parole: il divario di oggi di $2,40 contro $7,80 è in realtà un confronto tra un livello 768p scontato e un livello 2K non scontato. Il confronto pulito è a 768p, e lì il vantaggio di prezzo dura fino alla fine dello sconto.

Screenshot of the Artificial Analysis image-to-video leaderboard with audio, captured August 27 2026, showing MiniMax H3 Max at #1 with Elo 1,204 and a price of $2.40/min, ahead of Dreamina Seedance 2.0 720p and MiniMax H3.

Cosa ha effettivamente cambiato fal

fal descrive MiniMax H3 Max come derivato da un post-training di MiniMax H3 per una maggiore aderenza ai prompt e una migliore estetica, poi co-ottimizzato con lo stack di inferenza personalizzato di fal per un throughput più elevato — ed è proprio dal throughput che deriva la velocità. Ciò che si può misurare dall'esterno è la gamma di output: clip da 5 a 15 secondi con audio nativo, fino a 768p, con gli endpoint text-to-video e reference-to-video della stessa famiglia disponibili attorno ad essa. Il tetto dei 768p è il vero vincolo da ricordare. Significa che "Max" è un'affermazione su leaderboard e velocità, non sulla scala delle risoluzioni: anche i pesi open di MiniMax H3 base si fermano a 768p, mentre la sua API ospitata raggiunge i 2K tramite un modulo di rigenerazione disponibile solo via API. Un post-training derivato dalla versione open eredita lo stesso tetto.

La questione dei pesi aperti

fal ha dichiarato la propria intenzione di rilasciare i pesi di MiniMax H3 Max, il che renderebbe il post-train il modello a pesi aperti con il punteggio più alto su entrambe le classifiche con audio — davanti al MiniMax H3 base, che oggi detiene quel titolo. Se ciò si rivelerà genuinamente aperto è la questione aperta. Il MiniMax H3 base è stato aperto il 3 agosto con una licenza community personalizzata che, secondo i termini stessi di MiniMax, esclude l'uso del modello e dei suoi output nell'UE, nel Regno Unito, in Corea del Sud e negli Stati Uniti, e richiede un'autorizzazione scritta preventiva per l'uso commerciale oltre i 20 milioni di dollari di fatturato annuo. Se i pesi di H3 Max verranno rilasciati con qualcosa di simile, la parola "open" avrà lo stesso territorio tracciato attorno a sé — con l'ulteriore complicazione che un post-train costruito da terze parti si trova in una posizione di licenza più grigia rispetto all'originale.

Chiamandolo da un router.

A fini pratici, la metà instradabile di questa famiglia è il modello base. MiniMax H3 è su OrcaRouter oggi al prezzo di listino del fornitore — $0,08 al secondo a 768p, $0,13 al secondo a 2K — con ricarico 0% e failover automatico, quindi i team possono chiamare la famiglia H3 tramite un'unica API senza integrare un endpoint del fornitore che ha solo pochi giorni. MiniMax H3 Max stesso non è ancora instradato; viene servito solo tramite l'API del suo sviluppatore. È esattamente la situazione a cui serve la pratica del failover: puoi creare prototipi con l'attuale modello numero 1 da immagine a video senza scommetterci un percorso di produzione, e se H3 Max arriva su un provider instradato sarà disponibile al prezzo di listino lo stesso giorno — inclusa la promo del fornitore — invece che tramite un'integrazione artigianale che ti costa tempo e il loro ricarico.

Screenshot of the OrcaRouter model page for MiniMax H3, showing list pricing of $0.08 per second at 768P and $0.13 per second at 2K, plus performance figures.

Cosa guardare nelle prossime settimane

Tre date e decisioni determinano se questo debutto sarà un momento o una nota a margine. Primo, il 1° settembre: quando finisce lo sconto del 50%, il prezzo a 768p raddoppia fino alla parità con il modello base, e il «{{1}}$2.40 leader image-to-video{{/1}}» diventa un «{{2}}$4.80 leader image-to-video{{/2}}» — il che cambia la storia del valore per chiunque pianifichi un volume sostenuto. Secondo, i pesi: se fal li rilascerà davvero, e con quale licenza. Terzo, l'arena: se il fotofinish di sei punti in cima alla text-to-video reggerà man mano che i voti si accumulano. Niente di tutto ciò è deciso, ed è esattamente il motivo per cui un modello sub-real-time che ha appena conquistato la vetta di una classifica a metà prezzo è l'inizio della storia piuttosto che la fine.

© 2026 OrcaRouter

Per i provider

Gestisci una piattaforma di inferenza? Porta i tuoi modelli su OrcaRouter.

providers@orcarouter.ai

Unisciti alla community

Discordsupport@orcarouter.aiXGitHubYouTube