génération vidéo
12 published articles
Génération vidéo par IA
Le Wan3.0 d'Alibaba vend la vidéo à la seconde : 6 $ pour un clip de 30 secondes
Le Wan3.0 peut transformer un PDF ou un dossier de marque en vidéo de 30 secondes en une seule génération, avec une tarification à la seconde qui plafonne à 0,20 $ pour la 1080P. Nous détaillons le calcul par clip et les lacunes qu'Alibaba reconnaît dans ses propres tests.
2026-08-16
Recherche en IA vidéo
Comment la distillation contextuellement alignée empêche les enseignants vidéo de voir l'avenir
La distillation vidéo a longtemps formé des étudiants causaux contre des enseignants qui notent des clips entiers avec une connaissance du futur. CMD remplace cette notation par un enseignant causal, ajoute des cibles notées par préfixe et rapporte des résultats de pointe parmi les méthodes autorégressives.
2026-08-14
Génération vidéo
MiniMax a abandonné son architecture éprouvée pour que H3 fasse tout
MiniMax affirme que H3 unifie la génération de texte, d'image, de vidéo et d'audio dans un seul modèle, facture la sortie 2K à moins d'un tiers du prix des modèles grand public, et prévoit d'ouvrir les poids dans les prochains jours. Les petites lignes sont la véritable histoire : l'entreprise a abandonné l'architecture qui lui donnait un avantage pour y parvenir.
2026-08-07
Génération vidéo par IA
Wan3.0-Video facturé à la seconde : un clip de 30 secondes coûte 6 $
Le Wan3.0-Video d'Alibaba est facturé à la seconde sur DashScope, un clip de 30 secondes en 1080P coûtant 6 $ par génération. Nous décomposons les paliers de prix, le flux de travail multi-entrées et les questions que la fiche laisse sans réponse.
2026-08-07
Génération vidéo IA
MiniMax H3 facture la vidéo au tiers du prix des rivaux et se classe n°1 en montage
MiniMax H3 regroupe texte, image, vidéo et audio dans un seul modèle, facture la sortie au tiers des tarifs courants par seconde et se classe premier en montage vidéo sur Artificial Analysis. Les poids doivent être publiés dans les prochains jours. La question reste de savoir comment la sortie se comporte en dehors des démos de l'entreprise.
2026-08-06
Vision par ordinateur, modèles du monde et recherche en IA
PhiZero : apprendre à l'IA vidéo à raisonner en physique avant le rendu
PhiZero, un modèle du monde du CASIA, apprend un « langage physique » discret et compact à partir de vidéos brutes et l'utilise pour raisonner sur la manière dont une scène va évoluer avant de générer les images. Les auteurs soutiennent que cette conception « raisonner puis rendre » produit des vidéos physiquement plus cohérentes que la prédiction directe des pixels.
2026-07-31
Recherche en IA
La génération vidéo devient 120 fois plus rapide sur un seul GPU : au cœur de l'avancée de Nvidia sur l'attention hybride
La SANA-Video 2.0 de Nvidia Research combine l'attention linéaire et softmax périodique dans un ratio 3:1 pour fonctionner 120 fois plus vite que Wan 2.2 sur un seul H100. La conception hybride retrouve une expressivité de plein rang tout en maintenant une inférence à 13 secondes pour un clip 720p. Les réserves : les benchmarks s'arrêtent à 720p et intègrent le changement d'attention avec des optimisations propriétaires.
2026-07-31
Génération vidéo
MiniMax H3 sous-cote ses rivaux du secteur vidéo et prévoit des poids ouverts
MiniMax regroupe la génération d'images, de vidéo et d'audio dans un seul modèle, facture la sortie à moins d'un tiers des tarifs grand public par seconde et prévoit d'ouvrir les poids dans les prochains jours. La question ouverte reste de savoir si les sorties tiennent la route en dehors de ses propres démos.
2026-07-30
Recherche IA
VideoCoCo répare la physique défaillante des vidéos IA en pensant en code Blender
VideoCoCo traite le code Blender exécutable comme une chaîne de pensée : un agent de codage scénarise une scène, un simulateur la déroule, et un moteur vidéo rend le résultat photoréaliste. Cette répartition cible le problème de la physique en texte-à-vidéo et obtient les meilleurs scores moyens sur PhyGenBench et VBench-2.0.
2026-07-30
Recherche en IA
Kling publie deux benchmarks qui révèlent à quel point la vidéo générative est en réalité médiocre
KlingTeam présente MultiRef-Compass et KeyFrame-Compass, deux benchmarks qui poussent les modèles de génération vidéo au-delà du texte vers la vidéo et vers des tâches multi-références et conditionnées par images clés. Les premiers tests sur respectivement huit et neuf systèmes montrent des échecs systématiques dans la liaison des entités, la préservation de l’ordre temporel et la gestion de contraintes denses.
2026-07-26
Génération vidéo et moteurs de jeu
Ce qu'un moteur de jeu peut apprendre à l'IA pour garder son monde cohérent
Les modèles génératifs vidéo sont souvent appelés la prochaine génération de moteurs de jeu. Mais sans suivi solide des états, ils oublient ce qui s'est passé il y a deux images. Un nouvel article dissèque le problème et propose un ensemble de données de plus de 90 heures de jeu de Black Myth: Wukong comme ressource pour le résoudre.
2026-07-23
Intelligence artificielle
Blitz de produits chez MiniMax : nouveaux modèles pour le code, la musique et la vidéo dans une vaste mise à jour
La startup chinoise d'IA MiniMax lance MiniMax M3, Hailuo 2.3, MiniMax Code et de nouveaux modèles de synthèse vocale/musicale, élargissant sa gamme de produits dans un paysage concurrentiel.
2026-07-06