MiniMax-H3

minimax/minimax-h3
VisioneAudio
di MiniMax · 2026-07-31

MiniMax-H3 è il modello di generazione video omni-modale di MiniMax (la generazione Hailuo 3), rilasciato il 31 luglio 2026. Legge riferimenti di testo, immagine, video e audio come un unico contesto unificato e genera video di 4-15 secondi a 768P o 2K con audio stereo nativo. Fatturato al secondo di output generato: $0.08/s a 768P, $0.13/s a 2K.

Inputtext + image + video + audio
Outputvideo
p50 TTFT431 ms
PREZZO$0.08/ al secondo
p50 TTFT431 ms7 g
p95 TTFT1.32 s7 g
TRAFFICO738token / 7 g

MiniMax-H3 è il modello video omni-modale della generazione Hailuo 3 di MiniMax, rilasciato il 31 luglio 2026. Tratta riferimenti di testo, immagini, video e audio come un unico contesto unificato e…

Cos'è MiniMax-H3?

Esempi di codice

Chiama da qualsiasi SDK

Compatibile con OpenAI: mantieni il tuo SDK

  • OpenAI SDKhttps://api.orcarouter.ai/v1

Prezzi

Prezzi
Al secondo$0.0800
ValutaUSD
Fatturato per secondo di video generato, più gli input di riferimento misurati, non per chiamata API

Prestazioni

p50 TTFT
431 ms
Velocità di output
Raccolta…
p95 TTFT
1.32 s
Tasso di errore
0%

Benchmark pubblici

AA I2V Arena
1193.0 / 1500
AA T2V Arena
1237.0 / 1500
Fonte: artificial_analysis_arena

Discussioni della community

Di cosa parlano gli sviluppatori questa settimana

Hacker News2 menzioni · 7 gg1 in meno rispetto alla settimana scorsa

FAQ

Come viene fatturato MiniMax-H3?
Per secondo di video generato: $0.08 al secondo a 768P e $0.13 al secondo a 2K, per la durata dichiarata (4-15 secondi, numeri interi). A ciò si aggiungono i materiali di input: i riferimenti audio sono gratuiti, le immagini oltre le prime cinque costano $0.04 ciascuna, e un video di riferimento viene fatturato in base alla propria durata alla stessa tariffa al secondo.
Come chiamo MiniMax-H3?
Invia una richiesta POST a /v1/video/generations utilizzando il modello minimax/minimax-h3, un prompt e, opzionalmente, la durata (4-15), la dimensione (768P o 2K) e gli input di riferimento tramite metadati. Interroga GET /v1/video/generations/{task_id} finché non riesce, quindi scarica il video dall'URL restituito.
Quali input accetta?
Un prompt di testo (obbligatorio, fino a 7000 caratteri), più riferimenti immagine opzionali (inclusi primo/ultimo fotogramma), un video di riferimento e una traccia audio di riferimento.
Cosa produce?
Un singolo video da 4 a 15 secondi a 768P o 2K, con audio stereo generato nativamente insieme alle immagini — nessun passaggio audio separato necessario.

Incorpora questo badge

MiniMax: MiniMax-H3•prezzo in attesa•431ms p50•tramite OrcaRouter
HTML <a href="https://www.orcarouter.ai/models/minimax/minimax-h3" target="_blank"> <img src="https://www.orcarouter.ai/embed/minimax/minimax-h3.svg" alt="MiniMax: MiniMax-H3 su OrcaRouter" /> </a>
Markdown [![MiniMax: MiniMax-H3](https://www.orcarouter.ai/embed/minimax/minimax-h3.svg)](https://www.orcarouter.ai/models/minimax/minimax-h3)

Scheda del modello come dati

GET /api/public/models/minimax/minimax-h3Apri
Leggibile dalle macchine:/llms.txt/llms-full.txt