LLM & Modèles5 min read
IA Open Source
L'AV-Flamingo de Nvidia s'attaque à la compréhension des longues vidéos là où la plupart des modèles échouent
Nvidia publie AV-Flamingo, un grand modèle de langage audiovisuel open source conçu pour la compréhension de vidéos longues et complexes. Il utilise un programme d'apprentissage en trois étapes et un cadre de chaîne de pensée horodatée pour gérer le raisonnement temporel et cross-modal qui fait trébucher la plupart des modèles.
2026-07-28