Karta tytułowa hero dla H3 Max firmy fal z napisem „H3 Max — 5-sekundowy klip w mniej niż 3 sekundy", zawierająca karty statystyk z czasem inferencji 2,8 s dla 5-sekundowego klipu, pozycją #1 w Image-to-Video na Artificial Analysis oraz informacją o maksymalnej rozdzielczości 768p.
Guides & Insights

H3 Max od fal renderuje 5-sekundowy klip w niecałe 3 sekundy — teraz #1 w Image-to-Video.

Autor

Rowan Sterling

Data publikacji

Najnowsze modele · 20Zobacz wszystkie modele
Benchmarki: Artificial Analysis · aktualizowane codziennie
Powrót do wszystkich wpisów

Najbardziej zaskakującą liczbą w nowej wersji MiniMax H3 Max nie jest pozycja w rankingu, choć ta również robi wrażenie: model wideo, który fal dotrenował na bazie MiniMax H3, właśnie zajął pierwsze miejsce w rankingu image-to-video serwisu Artificial Analysis. Tą liczbą jest czas widniejący na stronie modelu w serwisie fal, gdzie przykładowy pięciosekundowy klip podaje 2,77 sekundy inferencji. To generowanie szybsze niż w czasie rzeczywistym z publicznego API — cały klip renderuje się, zanim skończyłoby się jego odtworzenie w czasie rzeczywistym — i to właśnie powód, dla którego ta premiera przyciąga uwagę wykraczającą poza zwykłe grono obserwatorów premier modeli. MiniMax H3 Max generuje klipy o długości od 5 do 15 sekund z natywnym dźwiękiem w rozdzielczości do 768p, a obecnie jest objęty 50% zniżką promocyjną, która wygasa 1 września.

Dlaczego "poniżej 3 sekund" liczy się bardziej niż podium.

Każdy model wideo twierdzi, że jest w jakiś sposób szybki, więc warto być precyzyjnym co do tego, co tak naprawdę mówi liczba podawana przez fal. 2,77 sekundy pochodzi z czasu wnioskowania podanego na stronie modelu fal dla jego własnego przykładowego wyjścia pięciosekundowego klipu — to wartość zgłoszona przez producenta, nie zmierzona niezależnie, i nie została jeszcze odtworzona nigdzie, gdzie reszta z nas może ją uruchomić. Nawet biorąc pod uwagę to zastrzeżenie, jest to uderzająca liczba, ponieważ 2,77 sekundy dla pięciu sekund wideo to współczynnik czasu rzeczywistego około 0,55. Model, który generuje klip szybciej, niż klip jest odtwarzany, zmienia generowanie wideo z zadania wsadowego w coś, co można umieścić w pętli: generuj, oceniaj, generuj ponownie — wszystko w czasie, w którym w przeciwnym razie czekałoby się na pojedyncze renderowanie.

To ten sam kompromis, na który wskazuje ujęcie „szybkość vs. jakość" z tweeta. Współczynnik 0,55x czasu rzeczywistego wynika z tego, że fal współoptymalizuje post-trening z własnym stosem inferencji — to opis fal, niepotwierdzony przez żaden niezależny benchmark poza listami liderów — a łatwiej go osiągnąć przy 768p niż przy wyższych rozdzielczościach. Nie ma też darmowego obiadu w drugą stronę: MiniMax H3 Max osiąga maksimum przy 768p, więc szybkość jest częściowo funkcją tego pułapu. Kupujesz najszybszy poziom rodziny H3, a drabina rozdzielczości kończy się tam, gdzie zaczyna się szybkość.

Gdzie wylądowało na tablicach

Rankingi z dźwiękiem Artificial Analysis, zarejestrowane 27 sierpnia 2026 r., plasują MiniMax H3 Max na #1 w konwersji obrazu na wideo z Elo 1 204 — 13 punktów przewagi nad Dreamina Seedance 2.0 720p od ByteDance (1 191) i 20 punktów przewagi nad podstawowym MiniMax H3 (1 184). W konwersji tekstu na wideo zajmuje #3 z Elo 1 235, w sześciopunktowym finiszu na szczycie: Wan 3.0 — 1 240, Gemini Omni Flash — 1 237, MiniMax H3 Max — 1 235 i podstawowy MiniMax H3 — 1 226. To ślepe wyniki Elo preferencji ludzkich z własnych aren Artificial Analysis, nie dane producentów, i jak na każdej arenie dryfują w miarę napływu nowych modeli i nowych głosów.

A scoreboard card for MiniMax H3 Max listing Image-to-Video #1 (Elo 1,204), Text-to-Video #3 (Elo 1,235), generation speed of a 5s clip in ~2.8s (vendor-reported), max resolution 768p, clip length 5-15s with native audio, and price $0.04/s ($2.40/min) promo ending September 1.

Image-to-Video (z dźwiękiem) — MiniMax H3 Max #1, Elo 1,204. Dreamina Seedance 2.0 720p #2, 1,191. MiniMax H3 #3, 1,184.

Tekst na wideo (z dźwiękiem) — Wan 3.0 #1, 1,240. Gemini Omni Flash #2, 1,237. MiniMax H3 Max #3, 1,235. MiniMax H3 #4, 1,226.

Data przechwycenia — 2026-08-27; obie tablice przesuwają się w miarę gromadzenia głosów.

Cena startowa i zegar na nim.

Cennik ma termin ważności, co jest szczegółem, który większość relacji pominie. fal oferuje 50% zniżki na start na MiniMax H3 Max, która — według strony modelu — kończy się 1 września. W cenie promocyjnej 768p kosztuje 0,04 USD za sekundę — 2,40 USD za minutę — a 480p kosztuje 0,025 USD za sekundę — 1,50 USD za minutę. Po zakończeniu zniżki standardowe stawki wynoszą 0,08 USD za sekundę przy 768p (4,80 USD za minutę) i 0,05 USD za sekundę przy 480p (3,00 USD za minutę).

Zestaw to z bazowym MiniMax H3, a promocja robi większość roboty. Na tej samej tablicy Artificial Analysis bazowy model notowany jest po $7.80 za minutę — ale to stawka za 2K. Przy rozdzielczości 768p, w której faktycznie konkuruje MiniMax H3 Max, bazowy MiniMax H3 wyceniany jest na $0.08 za sekundę, czyli $4.80 za minutę — dokładnie tyle, ile wyniesie standardowa stawka post-trainu po 1 września. Innymi słowy: dzisiejsza luka w nagłówku wynosząca $2.40 wobec $7.80 to tak naprawdę porównanie między przecenioną warstwą 768p a nieprzecenioną warstwą 2K. Czyste porównanie wypada na 768p i tam przewaga cenowa utrzymuje się do końca zniżki.

Screenshot of the Artificial Analysis image-to-video leaderboard with audio, captured August 27 2026, showing MiniMax H3 Max at #1 with Elo 1,204 and a price of $2.40/min, ahead of Dreamina Seedance 2.0 720p and MiniMax H3.

Co tak naprawdę zmienił fal

fal opisuje MiniMax H3 Max jako model poddany post-treningowi na bazie MiniMax H3 w celu lepszego trzymania się promptów i lepszej estetyki, a następnie współoptymalizowany z autorskim stosem inferencyjnym fal pod kątem wyższej przepustowości — a właśnie w przepustowości tkwi źródło szybkości. To, co można zmierzyć z zewnątrz, to obwiednia wyjściowa: 5–15-sekundowe klipy z natywnym dźwiękiem, w rozdzielczości do 768p, z dostępnymi wokół niej punktami końcowymi text-to-video i reference-to-video z tej samej rodziny. Sufit 768p to realne ograniczenie, o którym należy pamiętać. Oznacza to, że „Max” to deklaracja dotycząca rankingu i szybkości, a nie drabinki rozdzielczości: otwarte wagi bazowego MiniMax H3 również kończą się na 768p, podczas gdy jego hostowane API osiąga 2K dzięki modułowi regeneracji dostępnemu wyłącznie przez API. Wersja post-treningowa pochodząca z otwartego wydania dziedziczy ten sam sufit.

Kwestia otwartych wag

fal zapowiedział, że zamierza udostępnić wagi MiniMax H3 Max, co uczyniłoby post-train najwyżej sklasyfikowanym modelem o otwartych wagach na obu rankingach z audio — przed bazowym MiniMax H3, który obecnie dzierży ten tytuł. To, czy będzie to naprawdę otwarte, pozostaje pytaniem otwartym. Bazowy MiniMax H3 został otwarty 3 sierpnia na podstawie niestandardowej licencji społecznościowej, która — zgodnie z własnymi warunkami MiniMax — wyklucza korzystanie z modelu i jego wyników w UE, Wielkiej Brytanii, Korei Południowej i USA oraz wymaga wcześniejszej pisemnej zgody na wykorzystanie komercyjne przy rocznych przychodach przekraczających 20 mln USD. Jeśli wagi H3 Max zostaną udostępnione na podobnych zasadach, słowo „open” będzie miało to samo ograniczenie terytorialne — z dodatkowym niuansem, że post-train stworzony przez stronę trzecią znajduje się w bardziej szarej strefie licencyjnej niż oryginał.

Wywoływanie tego z routera

W praktyce routowalną połową tej rodziny jest model bazowy. MiniMax H3 jest dziś na OrcaRouter po cenie listowej dostawcy — 0,08 USD za sekundę przy 768p, 0,13 USD za sekundę przy 2K — z 0% narzutu i automatycznym failoverem, dzięki czemu zespoły mogą wywoływać rodzinę H3 przez jedno API bez integrowania punktu końcowego dostawcy, który jest nieaktualny. Sam MiniMax H3 Max nie jest jeszcze routowany; jest udostępniany wyłącznie przez własne API dewelopera. To jest dokładnie sytuacja, do której służy nawyk failoveru: możesz prototypować na aktualnym modelu #1 do generowania wideo z obrazu, nie stawiając na niego ścieżki produkcyjnej, a jeśli H3 Max trafi do routowanego dostawcy, pojawi się tego samego dnia po cenie listowej — wliczając promocję dostawcy — zamiast przez ręcznie skonstruowaną integrację, która zabiera twój czas i ich narzut.

Screenshot of the OrcaRouter model page for MiniMax H3, showing list pricing of $0.08 per second at 768P and $0.13 per second at 2K, plus performance figures.

Co oglądać w najbliższych tygodniach

Trzy daty i decyzje przesądzą, czy ten debiut będzie chwilą, czy przypisem. Po pierwsze, 1 września: gdy kończy się 50% rabat, cena 768p podwaja się i zrównuje z modelem bazowym, a „lider image-to-video za 2,40 dolara” staje się „liderem image-to-video za 4,80 dolara” — co zmienia historię wartości dla każdego, kto planuje stały wolumen. Po drugie, wagi: czy fal faktycznie je udostępni i na jakiej licencji. Po trzecie, arena: czy sześciopunktowy fotofinisz na szczycie text-to-video utrzyma się w miarę gromadzenia głosów. Nic z tego nie jest przesądzone, i właśnie dlatego model działający szybciej niż w czasie rzeczywistym, który właśnie za pół ceny zdobył szczyt rankingu, jest początkiem historii, a nie jej końcem.

© 2026 OrcaRouter

Dla dostawców

Prowadzisz platformę inferencyjną? Udostępnij swoje modele w OrcaRouter.

providers@orcarouter.ai

Dołącz do społeczności

Discordsupport@orcarouter.aiXGitHubYouTube