IA5 min read
IA multimodale
Le Qwen2.5-Omni d’Alibaba veut être le modèle qui entend, voit et parle, tout à la fois
Qwen2.5-Omni d’Alibaba Cloud traite texte, images, audio et vidéo de bout en bout, générant texte et parole naturelle en temps réel. Les benchmarks montrent qu’il surpasse ou égale souvent les modèles spécialisés, laissant entrevoir un virage vers des architectures unifiées.
2026-07-20