
fal's H3 Max rendert einen 5-Sekunden-Clip in unter 3 Sekunden — jetzt #1 bei Bild-zu-Video
- AlibabaNEUQwen: Qwen3.8 Flash2026-08-26$0.15 / $0.47 pro 1 Mio. Tokens
- z-aiNEUZ.ai: GLM 5.3 Flash2026-08-2658Intelligenz72Coding
- DeepSeekNEUDeepSeek: DeepSeek V4 Flash Vision (Exp)2026-08-21$0.15 / $0.29 pro 1 Mio. Tokens
- z-aiNEUZ.ai: GLM 5.32026-08-1860Intelligenz75Coding
- obsidianNEUQwen3.8 27B2026-08-1552Intelligenz68Coding
- qwenQwen: Qwen3.8 27B (free)2026-08-13qwen/qwen3.8-27b-free
- deepseekDeepSeek: DeepSeek V4 Pro 08132026-08-1253Intelligenz69Coding
- grokSpaceXAI: Grok 4.62026-08-1261Intelligenz77Coding
- metaMeta: Muse Spark 1.22026-08-0557Intelligenz72Coding
- qwenQwen: Qwen3.8 Max2026-08-0358Intelligenz72Coding
- deepseekDeepSeek: DeepSeek V4 Flash 07312026-07-3152Intelligenz69Coding
- minimaxMiniMax: MiniMax-H32026-07-31minimax/minimax-h3
- qwenQwen: Qwen3.7 Flash2026-07-27$0.03 / $0.13 pro 1 Mio. Tokens
- orcaOrcaDub: OrcaDub 1.02026-07-27orca/dub
- anthropicAnthropic: Claude Opus 52026-07-2463Intelligenz78Coding
- googleGoogle: Gemini 3.6 Flash2026-07-2152Intelligenz69Coding
- googleGoogle: Gemini 3.5 Flash-Lite2026-07-2137Intelligenz49Coding
- metaMeta: Muse Spark 1.12026-07-1653Intelligenz71Coding
- kimiMoonshotAI: Kimi K32026-07-1560Intelligenz76Coding
- openaiOpenAI: GPT-5.6 Luna2026-07-0952Intelligenz71Coding
Die überraschendste Zahl im neuen MiniMax H3 Max Release ist nicht der Leaderboard-Rang, obwohl auch der bemerkenswert ist: Das Videomodell, das fal aus MiniMax H3 nachtrainiert hat, hat gerade den ersten Platz auf dem Image-to-Video-Leaderboard von Artificial Analysis belegt. Es ist die Zeitangabe auf fals eigener Modellseite, wo ein Beispiel-Clip von 5 Sekunden eine Inferenzzeit von 2,77 Sekunden meldet. Das ist Sub-Echtzeit-Generierung über eine öffentliche API – der vollständige Clip wird gerendert, bevor die Echtzeit-Wiedergabe desselben Clips zu Ende wäre – und es ist der Grund, warum dieser Release über die übliche Modell-Release-Community hinaus Aufmerksamkeit erregt. MiniMax H3 Max erzeugt Clips von 5 bis 15 Sekunden mit nativem Audio in bis zu 768p, und aktuell gibt es einen Einführungsrabatt von 50 % auf den Preis, der am 1. September ausläuft.
Warum "unter 3 Sekunden" mehr zählt als das Podium
Jedes Videomodell verspricht irgendeine Form von Schnelligkeit, daher lohnt es sich, genau zu sein, was die Zahl von fal tatsächlich aussagt. Die 2,77 Sekunden stammen aus dem Inferenz-Timing der eigenen Beispielausgabe auf der fal-Modellseite für einen Fünf-Sekunden-Clip – eine vom Anbieter gemeldete Zahl, keine unabhängig gemessene, und noch nirgendwo reproduziert, wo der Rest von uns sie ausführen kann. Selbst mit diesem Vorbehalt ist es eine bemerkenswerte Zahl, denn 2,77 Sekunden für fünf Sekunden Video entsprechen einem Echtzeitfaktor von etwa 0,55. Ein Modell, das einen Clip schneller erzeugt, als der Clip abgespielt wird, verwandelt die Videogenerierung von einem Batch-Job in etwas, das man in eine Schleife einbauen kann: generieren, bewerten, neu generieren – alles innerhalb der Zeit, die eine Person sonst auf ein einziges Rendering warten würde.
Der Trade-off ist derselbe, auf den die „Geschwindigkeit vs. Qualität“-Rahmung des Tweets hinweist. Ein Echtzeitfaktor von 0,55x resultiert daraus, dass fal das Post-Training gemeinsam mit seinem eigenen Inferenz-Stack optimiert – fal’s Beschreibung, die von keinem unabhängigen Benchmark außerhalb der Leaderboards reproduziert wurde – und bei 768p leichter zu erreichen ist als bei höheren Auflösungen. Auch in die andere Richtung gibt es kein kostenloses Mittagessen: MiniMax H3 Max endet bei 768p, also ist die Geschwindigkeit teilweise eine Funktion der Obergrenze. Du kaufst die schnellste Stufe der H3-Familie, und die Auflösungsleiter endet dort, wo die Geschwindigkeit beginnt.
Wo es auf den Boards landete
Die With-Audio-Ranglisten von Artificial Analysis, aufgenommen am 27.08.2026, setzen MiniMax H3 Max auf Platz 1 im Bereich Bild-zu-Video mit einer Elo-Zahl von 1.204 — ein Abstand von 13 Punkten gegenüber ByteDances Dreamina Seedance 2.0 720p mit 1.191 und ein Abstand von 20 Punkten gegenüber dem Basis-MiniMax H3 mit 1.184. Im Bereich Text-zu-Video belegt es Platz 3 mit einer Elo-Zahl von 1.235, innerhalb eines Sechs-Punkte-Fotofinishs an der Spitze: Wan 3.0 mit 1.240, Gemini Omni Flash mit 1.237, MiniMax H3 Max mit 1.235 und das Basis-MiniMax H3 mit 1.226. Dabei handelt es sich um blinde, auf menschlichen Präferenzen basierende Elo-Werte aus den eigenen Arenas von Artificial Analysis, nicht um Herstellerzahlen, und wie in jeder Arena verändern sie sich mit neuen Modellen und neuen Stimmen.

• Bild-zu-Video (mit Audio) — MiniMax H3 Max #1, Elo 1.204. Dreamina Seedance 2.0 720p #2, 1.191. MiniMax H3 #3, 1.184.
• Text-zu-Video (mit Audio) — Wan 3.0 #1, 1.240. Gemini Omni Flash #2, 1.237. MiniMax H3 Max #3, 1.235. MiniMax H3 #4, 1.226.
• Erfassungsdatum — 2026-08-27; beide Boards verschieben sich, während Stimmen hinzukommen.
Der Einführungspreis und die Uhr darauf
Die Sonderpreise haben eine Frist, die die meisten Berichte übersehen dürften. fal bietet einen 50% Einführungsrabatt auf MiniMax H3 Max, der laut der eigenen Modellseite am 1. September endet. Zum Aktionspreis kostet 768p 0,04 $ pro Sekunde – 2,40 $ pro Minute – und 480p kostet 0,025 $ pro Sekunde – 1,50 $ pro Minute. Nach Ablauf des Rabatts gelten die regulären Preise von 0,08 $ pro Sekunde bei 768p (4,80 $ pro Minute) und 0,05 $ pro Sekunde bei 480p (3,00 $ pro Minute).
Setzt man das neben das Basis-MiniMax-H3, dann übernimmt die Aktion einen Großteil der Arbeit. Auf demselben Artificial-Analysis-Board wird das Basismodell mit 7,80 $ pro Minute geführt – das ist jedoch der 2K-Satz. Bei der 768p-Auflösung, bei der MiniMax H3 Max tatsächlich antritt, listet das Basis-MiniMax-H3 0,08 $ pro Sekunde bzw. 4,80 $ pro Minute – genau das, was der Standardsatz des Post-Trainings nach dem 1. September sein wird. Mit anderen Worten: Die heutige Schlagzeilen-Lücke von 2,40 $ gegenüber 7,80 $ ist in Wirklichkeit ein Vergleich zwischen einem rabattierten 768p-Tarif und einem nicht rabattierten 2K-Tarif. Der saubere Vergleich erfolgt bei 768p, und dort hält der Preisvorteil an, bis der Rabatt endet.

Was fal tatsächlich verändert hat
fal beschreibt MiniMax H3 Max als aus MiniMax H3 nachtrainiert für eine stärkere Befolgung des Prompts und bessere Ästhetik, und dann co-optimiert mit fal's benutzerdefiniertem Inferenz-Stack für einen höheren Durchsatz – wobei der Durchsatz der Punkt ist, aus dem sich die Geschwindigkeit ergibt. Was von außen messbar ist, ist das Ausgabeprofil: 5- bis 15-Sekunden-Clips mit nativem Audio bei bis zu 768p, wobei die Text-zu-Video- und Referenz-zu-Video-Endpunkte derselben Familie daneben verfügbar sind. Die 768p-Obergrenze ist die eigentliche Einschränkung, die man im Kopf behalten sollte. Das bedeutet, dass „Max“ eine Aussage über die Bestenliste und die Geschwindigkeit ist, nicht über die Auflösungsleiter: Auch die offenen Gewichte des Basis-MiniMax-H3 erreichen maximal 768p, während seine gehostete API über ein ausschließlich über die API verfügbares Regenerationsmodul 2K erreicht. Ein aus der offenen Veröffentlichung abgeleitetes Post-Training erbt dieselbe Obergrenze.
Die Open-weights-Frage
fal hat erklärt, dass es die Gewichte von MiniMax H3 Max veröffentlichen will, was das Post-Train zum höchstplatzierten Open-Weights-Modell auf beiden Audio-Boards machen würde – vor dem Basis-MiniMax-H3, das diesen Titel heute innehat. Ob das wirklich als „offen“ durchgeht, ist die offene Frage. Das Basis-MiniMax-H3 wurde am 3. August unter einer benutzerdefinierten Community-Lizenz veröffentlicht, die laut den eigenen Bedingungen von MiniMax die Nutzung des Modells und seiner Ausgaben in der EU, im Vereinigten Königreich, in Südkorea und in den USA ausschließt und für die kommerzielle Nutzung mit einem Jahresumsatz von über 20 Millionen US-Dollar eine vorherige schriftliche Genehmigung erfordert. Wenn die Gewichte von H3 Max unter einer ähnlichen Lizenz erscheinen, wird „open“ dieselbe territoriale Einschränkung mit sich bringen – mit der zusätzlichen Besonderheit, dass ein von einem Dritten erstelltes Post-Train lizenzrechtlich in einer graueren Zone liegt als das Original.
Von einem Router aus aufrufen
Für praktische Zwecke ist der routbare Teil dieser Familie das Basismodell. MiniMax H3 ist heute auf OrcaRouter zum Listenpreis des Anbieters verfügbar – 0,08 $ pro Sekunde bei 768p, 0,13 $ pro Sekunde bei 2K – mit 0 % Aufschlag und automatischem Failover, sodass Teams die H3-Familie über eine einzige API ansprechen können, ohne einen Anbieter-Endpunkt zu integrieren, der bereits Tage alt ist. MiniMax H3 Max selbst ist noch nicht geroutet; es wird ausschließlich über die eigene API des Entwicklers bereitgestellt. Genau für diese Situation ist die Failover-Gewohnheit gedacht: Sie können Prototypen gegen das aktuelle #1-Bild-zu-Video-Modell entwickeln, ohne einen Produktionspfad darauf zu setzen, und falls H3 Max einen gerouteten Anbieter erreicht, erscheint es am selben Tag zum Listenpreis – inklusive der Aktion des Anbieters – statt über eine handgestrickte Integration, die Ihre Zeit beansprucht und den Aufschlag des Anbieters enthält.

Was Sie in den nächsten Wochen sehen sollten
Drei Termine und Entscheidungen bestimmen, ob dieses Debüt ein Moment oder eine Fußnote ist. Erstens: {{1}}der 1. September: Wenn der 50-Prozent-Rabatt ausläuft, verdoppelt sich der 768p-Preis und erreicht damit das Niveau des Basismodells, und aus dem „2,40-Dollar-Spitzenreiter bei Bild-zu-Video“ wird ein „4,80-Dollar-Spitzenreiter bei Bild-zu-Video“ – was das Wertversprechen für alle verändert, die langfristig hohe Mengen planen{{/1}}. Zweitens: {{2}}die Gewichte: ob fal sie tatsächlich veröffentlicht und unter welcher Lizenz{{/2}}. Drittens: {{3}}die Arena: ob das Sechs-Punkte-Fotofinish an der Spitze der Text-zu-Video-Rangliste hält, während die Stimmen eintreffen{{/3}}. Nichts davon ist entschieden, und genau deshalb ist ein Modell, das schneller als in Echtzeit arbeitet und gerade zum halben Preis die Spitze einer Rangliste erobert hat, der Anfang der Geschichte und nicht ihr Ende.
