AIO APEX

MiniMax lance H3, un modèle vidéo multimodal avec audio natif, le titre bondit de 17 %

Reuters
Partager:
MiniMax lance H3, un modèle vidéo multimodal avec audio natif, le titre bondit de 17 %

MiniMax a publié H3 vendredi, un nouveau modèle de génération multimodale qui traite texte, images, vidéo et audio dans un contexte unifié, et produit des vidéos 2K natives avec son stéréo intégré, en clips allant jusqu'à 15 secondes. La société chinoise d'IA a indiqué qu'elle prévoyait de rendre open source les poids du modèle d'ici quelques jours, permettant aux développeurs de télécharger et de personnaliser le système sous-jacent plutôt que de s'appuyer uniquement sur une API.

Ce lancement est important car il étend la stratégie open-weight de MiniMax à la vidéo, un domaine encore dominé par des systèmes fermés et coûteux d'OpenAI (Sora) et de Google (Veo). MiniMax s'est forgé une réputation au cours de l'année écoulée en commercialisant des modèles qui s'approchent des benchmarks propriétaires de pointe tout en facturant une fraction du prix demandé par les laboratoires américains et en publiant les poids publiquement. H3 applique la même recette à la vidéo : MiniMax affirme que générer des séquences 2K sur H3 coûte environ un tiers du prix des produits concurrents grand public, un écart de prix que l'entreprise positionne comme un levier concurrentiel direct face à Sora et Veo pour les travaux vidéo commerciaux.

Sur le plan technique, H3 introduit trois composants que MiniMax appelle Contextual Omni Representation, H3-Omni Transformer et In-Context Regeneration. Ensemble, ils permettent au modèle d'accepter des entrées mixtes — un prompt textuel accompagné d'une image de référence, d'un clip vidéo ou d'une piste audio — et de les conserver dans un espace de représentation partagé, ce qui, selon MiniMax, améliore le suivi des instructions et la compréhension multimodale par rapport à sa précédente gamme vidéo Hailuo. Le modèle vise également la compatibilité avec les puces d'IA chinoises locales, dans le cadre d'un effort plus large des entreprises chinoises d'IA pour réduire leur dépendance aux semi-conducteurs fabriqués aux États-Unis, tant pour l'entraînement que pour l'inférence.

MiniMax positionne H3 résolument vers les cas d'usage commerciaux : publicité, visuels produits pour l'e-commerce, design produit et jeux vidéo — des marchés où des clips de 15 secondes, prêts à l'emploi et avec un son synchronisé, ont plus de valeur que des contenus cinématographiques plus longs. C'est une cible plus étroite que la proposition plus large de génération créative de Sora ou Veo, mais elle correspond directement aux postes de dépenses les plus importants des studios en matière de contenu vidéo de stock et de contenu produit.

La réaction du marché a été immédiate : l'action de MiniMax Group cotée à Hong Kong (HKG : 0100) a bondi jusqu'à 17,4 % après l'annonce, avant de se stabiliser à une hausse rapportée de 15,1 % sur la journée. Une partie de ce mouvement est liée à un catalyseur distinct — les attentes croissantes des investisseurs quant à une prochaine inclusion de MiniMax dans le programme Stock Connect, qui permettrait aux investisseurs de Chine continentale d'acheter directement l'action via la liaison de négociation sud-nord et pourrait apporter des dizaines de milliards de dollars hongkongais de nouveaux flux entrants. Le lancement de H3 semble avoir amplifié cette dynamique existante plutôt que de l'avoir créée de toutes pièces.

Pour le marché de la vidéo par IA, la publication open-weight prévue de H3 est le détail à surveiller de plus près. Si MiniMax tient sa promesse d'ici quelques jours, H3 deviendrait l'un des premiers modèles vidéo multimodaux de niveau frontière dont les poids sont disponibles publiquement, offrant aux développeurs et aux petits studios une alternative auto-hébergeable aux API fermées qui définissent actuellement la catégorie — selon des informations initiales de Reuters, complétées par Investing.com et KFGO.

Initialement rapporté par Reuters. Lisez l'article original pour plus de détails.

Voir la source originale
Partager: