
fal's H3 Max rendert een clip van 5 seconden in minder dan 3 seconden — nu #1 in Image-to-Video
- AlibabaNIEUWQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 per 1 mln tokens
- z-aiNIEUWZ.ai: GLM 5.3 Flash2026-08-2658Intelligentie72Coderen
- DeepSeekNIEUWDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 per 1 mln tokens
- z-aiNIEUWZ.ai: GLM 5.32026-08-1860Intelligentie75Coderen
- obsidianNIEUWQwen3.8 27B2026-08-1552Intelligentie68Coderen
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligentie69Coderen
- grokSpaceXAI: Grok 4.62026-08-1261Intelligentie77Coderen
- metaMeta: Muse Spark 1.22026-08-0557Intelligentie72Coderen
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligentie72Coderen
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligentie69Coderen
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 per 1 mln tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligentie78Coderen
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligentie69Coderen
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligentie49Coderen
- metaMeta: Muse Spark 1.12026-07-1653Intelligentie71Coderen
- kimiMoonshotAI: Kimi K32026-07-1560Intelligentie76Coderen
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligentie71Coderen
Het meest verrassende getal in de nieuwe MiniMax H3 Max-release is niet de leaderboardpositie, hoewel die ook opmerkelijk is: het videomodel dat fal post-trainde op basis van MiniMax H3 heeft zojuist de #1-positie veroverd op het image-to-video-leaderboard van Artificial Analysis. Het is het timingcijfer op fal's eigen modelpagina, waar een voorbeeldclip van 5 seconden 2,77 seconden inferentie rapporteert. Dat is sub-realtime generatie via een openbare API — de volledige clip wordt gerenderd voordat een realtime afspelen van dezelfde clip zou zijn afgelopen — en dat is de reden dat deze release aandacht trekt buiten de gebruikelijke modelrelease-gemeenschap. MiniMax H3 Max genereert clips van 5 tot 15 seconden met native audio tot 768p, en momenteel geldt er een introductiekorting van 50% op de prijs, die afloopt op 1 september.
Waarom "onder 3 seconden" belangrijker is dan het podium
Elk videomodel claimt wel een of andere vorm van snelheid, dus het is de moeite waard om precies te zijn over wat het getal van fal nu eigenlijk zegt. De 2,77 seconden komen van de inferentietiming op de eigen voorbeeldoutput van de modelpagina van fal voor een clip van vijf seconden — een door de leverancier gerapporteerd cijfer, niet onafhankelijk gemeten, en nog nergens gereproduceerd waar de rest van ons het kan draaien. Zelfs met die kanttekening is het een opvallend getal, want 2,77 seconden voor vijf seconden video is een real-timefactor van ongeveer 0,55. Een model dat een clip sneller genereert dan de clip afspeelt, verandert videogeneratie van een batchjob in iets dat je in een loop kunt plaatsen: genereren, beoordelen, regenereren, allemaal binnen de tijd die iemand anderszins zou wachten op één enkele render.
De afweging is dezelfde als die waar de tweet met de formulering '{{1}}snelheid versus kwaliteit{{/1}}' op doelt. Een real-timefactor van 0,55x komt voort uit {{2}}fal die de post-train samen met zijn eigen inferentiestack optimaliseert{{/2}} — {{3}}de beschrijving van fal, die door geen enkele onafhankelijke benchmark buiten de leaderboards is gereproduceerd{{/3}} — en het is makkelijker te halen {{4}}op 768p dan op hogere resoluties{{/4}}. Ook in de andere richting is er geen gratis lunch: {{5}}MiniMax H3 Max stopt bij 768p{{/5}}, dus de snelheid is deels een functie van het plafond. Je koopt {{6}}het snelste niveau van de H3-familie{{/6}}, en {{7}}de resolutieladder stopt waar de snelheid begint{{/7}}.
Waar het op de forums terechtkwam
De leaderboards met audio van Artificial Analysis, vastgelegd op 27-08-2026, plaatsen MiniMax H3 Max op #1 in beeld-naar-video met een Elo van 1.204 — een gat van 13 punten ten opzichte van ByteDance's Dreamina Seedance 2.0 720p op 1.191 en een gat van 20 punten ten opzichte van de basis-MiniMax H3 op 1.184. In tekst-naar-video staat het op #3 met een Elo van 1.235, binnen een fotofinish van zes punten aan de top: Wan 3.0 op 1.240, Gemini Omni Flash op 1.237, MiniMax H3 Max op 1.235 en de basis-MiniMax H3 op 1.226. Dit zijn blinde Elo-scores op basis van menselijke voorkeur uit de eigen arena's van Artificial Analysis, geen leverancierscijfers, en net als elke arena verschuiven ze naarmate er nieuwe modellen en nieuwe stemmen binnenkomen.

• Afbeelding-naar-video (met audio) — MiniMax H3 Max #1, Elo 1,204. Dreamina Seedance 2.0 720p #2, 1,191. MiniMax H3 #3, 1,184.
• Tekst-naar-video (met audio) — Wan 3.0 #1, 1,240. Gemini Omni Flash #2, 1,237. MiniMax H3 Max #3, 1,235. MiniMax H3 #4, 1,226.
• Vastlegdatum — 2026-08-27; beide borden verschuiven naarmate er stemmen binnenkomen.
De introductieprijs, en de klok erop
De prijzen hebben een deadline, wat het onderdeel is dat de meeste berichtgeving zal missen. fal geeft 50% lanceringskorting op MiniMax H3 Max, die volgens de eigen modelpagina eindigt op 1 september. Tegen het promotietarief kost 768p $0,04 per seconde — $2,40 per minuut — en kost 480p $0,025 per seconde — $1,50 per minuut. Na de korting zijn de standaardtarieven $0,08 per seconde bij 768p ($4,80 per minuut) en $0,05 per seconde bij 480p ($3,00 per minuut).
Zet dat naast het basismodel MiniMax H3 en de promotie doet een groot deel van het werk. Op hetzelfde Artificial Analysis-board staat het basismodel genoteerd op $7,80 per minuut — maar dat is het 2K-tarief. Bij de 768p-resolutie waar MiniMax H3 Max daadwerkelijk concurreert, noteert het basismodel MiniMax H3 $0,08 per seconde, oftewel $4,80 per minuut — precies wat het standaardtarief van de post-train na 1 september zal zijn. Met andere woorden: de opvallende kloof van vandaag — $2,40 versus $7,80 — is eigenlijk een vergelijking tussen een afgeprijsd 768p-niveau en een niet-afgeprijsd 2K-niveau. De zuivere vergelijking is op 768p, en daar blijft het prijsvoordeel bestaan totdat de korting afloopt.

Wat fal daadwerkelijk veranderde
fal beschrijft MiniMax H3 Max als verder getraind op basis van MiniMax H3 voor betere instructietrouw en betere esthetiek, en vervolgens mede-geoptimaliseerd met fal's aangepaste inferentie-stack voor een hogere doorvoersnelheid – en die doorvoer is precies waar de snelheid vandaan komt. Wat van buitenaf meetbaar is, is het uitvoerprofiel: clips van 5 tot 15 seconden met native audio, tot 768p, met de tekst-naar-video- en referentie-naar-video-endpoints van dezelfde familie eromheen beschikbaar. Het plafond van 768p is de echte beperking om te onthouden. Het betekent dat 'Max' een claim is over de ranglijst en de snelheid, niet over de resolutieladder: de open gewichten van het basismodel MiniMax H3 eindigen eveneens op 768p, terwijl de gehoste API via een uitsluitend via API beschikbare regeneratiemodule 2K bereikt. Een post-train die is afgeleid van de open release, erft dezelfde limiet.
De open-weights kwestie
fal heeft aangegeven van plan te zijn de MiniMax H3 Max-gewichten vrij te geven, waardoor de post-train het hoogst gerangschikte open-gewichtenmodel zou worden op beide leaderboards met audio — boven de basis-MiniMax H3, die die titel vandaag in handen heeft. Of dat daadwerkelijk als open uitpakt, is de open vraag. De basis-MiniMax H3 werd op 3 augustus uitgebracht onder een aangepaste communitylicentie die, volgens MiniMax' eigen voorwaarden, gebruik van het model en de outputs daarvan in de EU, het VK, Zuid-Korea en de VS uitsluit, en voorafgaande schriftelijke toestemming vereist voor commercieel gebruik boven een jaarlijkse omzet van $20 miljoen. Als de H3 Max-gewichten onder iets soortgelijks worden uitgebracht, zal 'open' dezelfde territoriale beperking met zich meebrengen — met als extra complicatie dat een door een derde partij gebouwde post-train op licentievlak grijzer is dan het origineel.
Het aanroepen vanuit een router
Voor praktische doeleinden is de routeerbare helft van deze familie {{1}}het basismodel{{/1}}. MiniMax H3 is vandaag beschikbaar op OrcaRouter tegen de lijstprijs van de provider — $0.08 per seconde op 768p, $0.13 per seconde op 2K — met {{2}}0% opslag en automatische failover{{/2}}, zodat teams de H3-familie via één API kunnen aanroepen zonder een vendor-endpoint te integreren dat {{3}}dagen oud{{/3}} is. MiniMax H3 Max zelf wordt nog niet gerouteerd; het wordt uitsluitend via de eigen API van de ontwikkelaar aangeboden. {{4}}Dat is precies de situatie waarvoor de failover-gewoonte bedoeld is{{/4}}: je kunt prototypen tegen {{5}}het huidige #1 image-to-video-model{{/5}} zonder er een productiepad op te verwedden, en als H3 Max {{6}}een gerouteerde provider{{/6}} bereikt, verschijnt het dezelfde dag tegen {{7}}lijstprijs{{/7}} — {{8}}inclusief de promotie van de vendor{{/8}} — in plaats van via {{9}}een zelfgebouwde integratie{{/9}} die je tijd kost en hun opslag met zich meebrengt.

Wat de komende weken de moeite waard is om te bekijken
Drie data en beslissingen bepalen of dit debuut een moment of een voetnoot wordt. Ten eerste, 1 september: wanneer de 50%-korting afloopt, verdubbelt de 768p-prijs tot op gelijke hoogte met het basismodel, en wordt de "$2.40 image-to-video-leider" een "$4.80 image-to-video-leider" — wat het waardeverhaal verandert voor wie op aanhoudend volume mikt. Ten tweede, de gewichten: of fal ze daadwerkelijk uitbrengt, en onder welke licentie. Ten derde, de arena: of de fotofinish van zes punten aan de top van text-to-video standhoudt naarmate de stemmen zich opstapelen. Niets daarvan is beslist — en dat is precies waarom een sub-realtime model dat net aan de halve prijs de top van een leaderboard heeft veroverd, het begin van het verhaal is in plaats van het einde.
