SevenTnewS

génération vidéo

12 published articles

LLM & Modèles4 min read

Génération vidéo par IA

Le Wan3.0 d'Alibaba vend la vidéo à la seconde : 6 $ pour un clip de 30 secondes

Le Wan3.0 peut transformer un PDF ou un dossier de marque en vidéo de 30 secondes en une seule génération, avec une tarification à la seconde qui plafonne à 0,20 $ pour la 1080P. Nous détaillons le calcul par clip et les lacunes qu'Alibaba reconnaît dans ses propres tests.

2026-08-16

Vision & DiffusionFeatured5 min read

Recherche en IA vidéo

Comment la distillation contextuellement alignée empêche les enseignants vidéo de voir l'avenir

La distillation vidéo a longtemps formé des étudiants causaux contre des enseignants qui notent des clips entiers avec une connaissance du futur. CMD remplace cette notation par un enseignant causal, ajoute des cibles notées par préfixe et rapporte des résultats de pointe parmi les méthodes autorégressives.

2026-08-14

LLM & Modèles5 min read

Génération vidéo

MiniMax a abandonné son architecture éprouvée pour que H3 fasse tout

MiniMax affirme que H3 unifie la génération de texte, d'image, de vidéo et d'audio dans un seul modèle, facture la sortie 2K à moins d'un tiers du prix des modèles grand public, et prévoit d'ouvrir les poids dans les prochains jours. Les petites lignes sont la véritable histoire : l'entreprise a abandonné l'architecture qui lui donnait un avantage pour y parvenir.

2026-08-07

Vision & DiffusionFeatured3 min read

Génération vidéo par IA

Wan3.0-Video facturé à la seconde : un clip de 30 secondes coûte 6 $

Le Wan3.0-Video d'Alibaba est facturé à la seconde sur DashScope, un clip de 30 secondes en 1080P coûtant 6 $ par génération. Nous décomposons les paliers de prix, le flux de travail multi-entrées et les questions que la fiche laisse sans réponse.

2026-08-07

IA4 min read

Génération vidéo IA

MiniMax H3 facture la vidéo au tiers du prix des rivaux et se classe n°1 en montage

MiniMax H3 regroupe texte, image, vidéo et audio dans un seul modèle, facture la sortie au tiers des tarifs courants par seconde et se classe premier en montage vidéo sur Artificial Analysis. Les poids doivent être publiés dans les prochains jours. La question reste de savoir comment la sortie se comporte en dehors des démos de l'entreprise.

2026-08-06

Vision & Diffusion4 min read

Vision par ordinateur, modèles du monde et recherche en IA

PhiZero : apprendre à l'IA vidéo à raisonner en physique avant le rendu

PhiZero, un modèle du monde du CASIA, apprend un « langage physique » discret et compact à partir de vidéos brutes et l'utilise pour raisonner sur la manière dont une scène va évoluer avant de générer les images. Les auteurs soutiennent que cette conception « raisonner puis rendre » produit des vidéos physiquement plus cohérentes que la prédiction directe des pixels.

2026-07-31

NVIDIA Research3 min read

Recherche en IA

La génération vidéo devient 120 fois plus rapide sur un seul GPU : au cœur de l'avancée de Nvidia sur l'attention hybride

La SANA-Video 2.0 de Nvidia Research combine l'attention linéaire et softmax périodique dans un ratio 3:1 pour fonctionner 120 fois plus vite que Wan 2.2 sur un seul H100. La conception hybride retrouve une expressivité de plein rang tout en maintenant une inférence à 13 secondes pour un clip 720p. Les réserves : les benchmarks s'arrêtent à 720p et intègrent le changement d'attention avec des optimisations propriétaires.

2026-07-31

IA4 min read

Génération vidéo

MiniMax H3 sous-cote ses rivaux du secteur vidéo et prévoit des poids ouverts

MiniMax regroupe la génération d'images, de vidéo et d'audio dans un seul modèle, facture la sortie à moins d'un tiers des tarifs grand public par seconde et prévoit d'ouvrir les poids dans les prochains jours. La question ouverte reste de savoir si les sorties tiennent la route en dehors de ses propres démos.

2026-07-30

Vision & Diffusion4 min read

Recherche IA

VideoCoCo répare la physique défaillante des vidéos IA en pensant en code Blender

VideoCoCo traite le code Blender exécutable comme une chaîne de pensée : un agent de codage scénarise une scène, un simulateur la déroule, et un moteur vidéo rend le résultat photoréaliste. Cette répartition cible le problème de la physique en texte-à-vidéo et obtient les meilleurs scores moyens sur PhyGenBench et VBench-2.0.

2026-07-30

LaboratoireFeatured3 min read

Recherche en IA

Kling publie deux benchmarks qui révèlent à quel point la vidéo générative est en réalité médiocre

KlingTeam présente MultiRef-Compass et KeyFrame-Compass, deux benchmarks qui poussent les modèles de génération vidéo au-delà du texte vers la vidéo et vers des tâches multi-références et conditionnées par images clés. Les premiers tests sur respectivement huit et neuf systèmes montrent des échecs systématiques dans la liaison des entités, la préservation de l’ordre temporel et la gestion de contraintes denses.

2026-07-26

IAFeatured1 min read

Génération vidéo et moteurs de jeu

Ce qu'un moteur de jeu peut apprendre à l'IA pour garder son monde cohérent

Les modèles génératifs vidéo sont souvent appelés la prochaine génération de moteurs de jeu. Mais sans suivi solide des états, ils oublient ce qui s'est passé il y a deux images. Un nouvel article dissèque le problème et propose un ensemble de données de plus de 90 heures de jeu de Black Myth: Wukong comme ressource pour le résoudre.

2026-07-23

IAFeatured3 min read

Intelligence artificielle

Blitz de produits chez MiniMax : nouveaux modèles pour le code, la musique et la vidéo dans une vaste mise à jour

La startup chinoise d'IA MiniMax lance MiniMax M3, Hailuo 2.3, MiniMax Code et de nouveaux modèles de synthèse vocale/musicale, élargissant sa gamme de produits dans un paysage concurrentiel.

2026-07-06