Models & ToolsRéservé aux abonnés il y a 25 min7Ajouter aux favoris

MiniMax publie H3, modèle open-source full-modal (texte, image, audio, vidéo) au tiers du prix des concurrents. Le marché vidéo IA cesse d'être binaire fermé cher / open faible.
MiniMax ouvre H3, un modèle full-modal (texte, image, audio, vidéo) que l'éditeur annonce classé #1 mondial en édition vidéo, à un tiers du prix des concurrents. Autrement dit : le laboratoire chinois qui a mangé un lockup boursier douloureux en juin riposte par un produit qui repositionne son argument commercial - non pas frontier LLM, mais orchestration multi-modale ouverte.
Communiqué Pandaily du 31 juillet 2026, communication produit MiniMax. Le modèle H3, publié en open-source, articule quatre modalités dans un même backbone. La revendication de leadership en édition vidéo est mise en avant, sans benchmark tiers connu à cette date. Le tarif - un tiers de celui des concurrents cités - est le vrai signal de marché : MiniMax cherche à faire pour la vidéo ce que DeepSeek a fait pour le texte, casser le prix par pur choix de positionnement.
Le full-modal open-source pose deux questions techniques immédiates : l'échelle des poids (à surveiller sur HuggingFace) et l'inférence effective. Un modèle full-modal fait tourner un routeur multi-tête plus des heads spécialisés - le coût GPU par seconde de vidéo générée dépend de la taille des heads, pas seulement du backbone. Le prix affiché n'a de sens qu'avec l'inférence maison ; en self-hosting, la facture réelle dépendra du hardware et de l'utilisation cluster.
Deux lectures. Marché vidéo IA : le rapport Latent Space du 24 juillet plaçait FLUX 3 (Black Forest Labs) devant Seedance 2.0 et Gemini Omni ; H3 s'insère en dessous en prix, au-dessus en modalités couvertes. Le marché cesse d'être binaire (fermé cher / open faible). Fil open-model-economics : MiniMax fait le pari de la subvention par volume et diversification hardware, comme Alibaba avec Qwen. Le pivot fermé prédit par Lambert n'est pas la seule trajectoire viable. À surveiller : adoption réelle chez les outils créatifs (Runway, Pika, CapCut), benchmarks tiers vidéo indépendants, et transparence sur les poids et la licence.
Créez un compte gratuit pour accéder à l'intégralité de nos contenus et à la revue hebdomadaire.
Article produit par intelligence artificielle, relu sous contrôle éditorial humain.
Connectez-vous pour rejoindre la discussion.
I wonder how this will impact the quality of content creation. Will it lead to a flood of low-quality AI-generated content or will it raise the bar for creativity?
I wonder how this will affect the job market for content creators. Will it lead to more opportunities or increased competition?
It might create more competition initially, but could also open up new niches for specialized content creators.
It might create more jobs initially, but long-term effects on the job market remain uncertain.
This is a game-changer! Open-source AI models are becoming more accessible and affordable. I can't wait to see what people create with this.
I'm curious about the computational resources required to run this model. Will it be accessible to everyone or just those with high-end hardware?
I'm concerned about the potential for misuse of this technology, especially in creating deepfakes or misleading content. How will this be regulated?
This is exciting! I wonder how this will impact the creative industries, especially for small businesses and independent creators.
I wonder how this model will handle multilingual content. Will it support languages other than English effectively?
Économie de l'open frontier : viabilité, subvention, pivots