H3 Max promet de générer cinq secondes de vidéo IA en environ trois secondes. Cette version de MiniMax H3 optimisée par fal accélère nettement le rendu, sans devenir pour autant un flux vidéo en direct.
H3 Max est une création de fal fondée sur MiniMax H3
Le nom peut prêter à confusion. H3 Max n’est pas un nouveau modèle directement lancé par MiniMax. Il s’agit d’une version dérivée de MiniMax H3, post-entraînée par fal Research et associée à un moteur d’inférence spécifiquement optimisé par fal.
L’entreprise américaine a officialisé ce modèle le 1er septembre 2026. Elle indique avoir ajouté de nouvelles données d’entraînement, puis comparé différents points de contrôle à l’aide de préférences humaines portant sur la compréhension du prompt, l’esthétique et la qualité générale. Les optimisations de vitesse qui dégradaient les résultats auraient été écartées, affirme fal dans sa présentation technique.
MiniMax H3 fournit la base de ce travail. Le modèle original comprend du texte, des images, de la vidéo et de l’audio, et peut produire des séquences avec une bande sonore stéréo générée dans la même passe que les images. MiniMax a publié ses poids en août 2026 sous une licence communautaire, ce qui permet à des entreprises comme fal de construire leurs propres versions spécialisées.
H3 Max produit des clips de 5 à 15 secondes en 480p ou 768p. Il accepte un prompt textuel, une image de départ et, si nécessaire, une image de fin destinée à encadrer la transition. Un endpoint séparé permet également de fournir des images, vidéos ou fichiers audio de référence. Les séquences obtenues contiennent un son synchronisé pouvant réunir voix, ambiance, bruitages et musique.
Cinq secondes de vidéo en trois secondes, mais pas encore du direct
fal annonce qu’un clip de cinq secondes en 768p peut être généré en environ trois secondes. Les exemples affichés sur ses pages techniques rapportent généralement entre 2,5 et 2,8 secondes d’inférence, soit moins que la durée de la vidéo produite.
Cette mesure ne représente toutefois pas toujours l’attente complète de l’utilisateur. Le champ timings.inference de l’API correspond au temps de calcul du modèle sur l’infrastructure de fal. Il ne couvre pas nécessairement la file d’attente, le transfert des fichiers, la récupération du résultat ou la réécriture automatique du prompt.
Ce dernier point peut modifier sensiblement le délai. D’après la documentation de H3 Max, le mode d’expansion équilibré ajoute environ une seconde, tandis que le mode privilégiant la qualité peut consacrer jusqu’à 30 secondes à enrichir la demande avant même le rendu.
Plus rapide que le temps réel ne signifie donc pas diffusion vidéo en direct. H3 Max reste un service qui reçoit une requête, calcule un clip complet, puis renvoie un fichier. La vitesse atteinte ouvre la voie à des expériences plus interactives, mais elle ne garantit pas encore un flux continu dans lequel chaque image serait produite et diffusée sans interruption.
fal revendique également un débit 35 fois supérieur à celui de l’endpoint officiel de MiniMax H3 et une vitesse moyenne 15 fois plus élevée que celle de modèles de qualité comparable. Ces deux comparaisons proviennent cependant de ses propres essais. Elles ne constituent pas un benchmark indépendant de latence réalisé sous différentes charges réseau.
Les classements confirment la qualité, avec une hiérarchie mouvante
Les évaluations publiques donnent davantage de poids à l’annonce, mais elles montrent aussi pourquoi un classement doit toujours être daté.
Au 1er septembre 2026, Design Arena place H3 Max en tête de son classement image-vers-vidéo avec 1 349 points Elo. MiniMax H3 arrive juste derrière avec 1 326 points, suivi de Wan 3.0 et Seedance 2.5. Ce classement repose sur des comparaisons réalisées par des utilisateurs entre plusieurs vidéos, et non sur une mesure automatique de fidélité ou de cohérence.
La situation est différente chez Artificial Analysis. Son classement public avec audio situe actuellement H3 Max en troisième position, avec 1 235 points Elo sur 5 364 échantillons. Wan 3.0 atteint 1 242 points et Gemini Omni Flash 1 237 points.
Les intervalles de confiance des trois modèles se chevauchent. H3 Max fait donc partie du groupe de tête, mais il serait excessif d’affirmer qu’il domine désormais tous les modèles vidéo sur chaque benchmark. Le communiqué de lancement de fal citait une ancienne photographie d’Artificial Analysis dans laquelle H3 Max occupait la première place. Le classement a évolué avec l’arrivée de nouveaux votes et de nouveaux modèles.
Ces arènes mesurent surtout la préférence visuelle moyenne. Elles ne prouvent pas qu’un modèle respectera mieux tous les prompts, conservera systématiquement un personnage ou produira moins d’erreurs physiques sur une série de plans.
Un prix bas obtenu au prix d’une résolution limitée
fal facture H3 Max à la seconde de vidéo produite. Une promotion valable jusqu’au 7 septembre 2026 ramène le tarif à 0,0125 $ par seconde en 480p et 0,02 $ en 768p, selon la page actuelle du modèle. Un clip de 15 secondes en 768p revient donc temporairement à 0,30 $.
Après cette promotion, les tarifs annoncés passeront à 0,05 $ par seconde en 480p et 0,08 $ en 768p. La même séquence de 15 secondes coûtera alors 1,20 $. fal propose aussi quelques générations gratuites quotidiennes pour découvrir le modèle depuis son interface web, sans imposer d’abonnement.
La contrepartie la plus visible concerne la définition. H3 Max s’arrête au 768p, alors que MiniMax H3 peut produire jusqu’en 2K sur la plateforme officielle. Le modèle de base conserve donc un avantage pour les projets qui exigent une image plus détaillée ou un workflow d’édition plus complet.
Autre différence importante, MiniMax publie les poids de H3, tandis que fal présente H3 Max comme un modèle hébergé accessible depuis son interface et son API. Aucune version téléchargeable des poids propres à H3 Max n’est actuellement proposée dans les ressources officielles consultées.
La vitesse change surtout la manière de travailler
L’intérêt concret de H3 Max ne consiste pas encore à générer un film en continu. Il réside dans la possibilité de tester plusieurs cadrages, mouvements ou variations d’un prompt sans attendre plusieurs minutes entre chaque essai. Pour la publicité, le prototypage, les réseaux sociaux ou la prévisualisation d’une scène, ce raccourcissement du cycle peut compter davantage qu’un gain limité sur un score Elo.
Cette approche diffère de celle de services intégrés à de grandes plateformes. Gemini Omni Flash transforme par exemple des vidéos existantes directement dans l’écosystème de Google et de YouTube. fal vise plutôt les créateurs et développeurs qui veulent intégrer rapidement un modèle spécialisé dans leur propre produit.
H3 Max franchit bien le seuil symbolique d’un rendu plus court que la séquence générée dans certains scénarios. Il reste maintenant à vérifier cette avance dans des essais indépendants mesurant le délai complet, la stabilité sous forte demande et le taux de clips réellement exploitables. Pour un créateur, le meilleur modèle n’est pas seulement celui qui termine le calcul en trois secondes, mais celui qui évite de recommencer dix fois la même scène.


