Qwen2.5-Omni
4 published articles
Qwen / Alibaba Cloud
Qwen2.5-Omni surpasse Gemini-1.5-Pro sur OmniBench et tient en moins de 12 Go
Le Qwen2.5-Omni open source d'Alibaba a surclassé Gemini-1.5-Pro sur OmniBench et a pris la tête du classement MMAU de raisonnement audio. Les versions quantifiées réduisent la VRAM sous 12 Go et la prise en charge de MNN apporte le chat vocal en temps réel sur les téléphones.
2026-08-07
Test de modèle
Qwen2.5-Omni : le modèle open-source qui tient enfin ce que ses concurrents promettent seulement
Analyse approfondie du modèle open-source qui traite simultanément texte, images, audio et vidéo tout en générant un flux de parole, surpassant GPT-4o-mini et Gemini sur plusieurs benchmarks, tout en tenant sur un seul GPU grand public avec quantification.
2026-08-03
Intelligence Artificielle
Le modèle 7B qui surpasse les plus grands, tourne sur un téléphone et change l'équation des coûts de l'IA
Le Qwen2.5-Omni d'Alibaba Cloud est un modèle 7B qui gère le texte, les images, l'audio et la vidéo, générant de la parole et du texte en temps réel. Son architecture Thinker-Talker et l'encodage positionnel TMRoPE permettent une interaction en streaming, et la variante 3B fonctionne sur des SoC mobiles comme le Snapdragon 8 Gen 1 à des vitesses utilisables.
2026-07-23
IA multimodale
Le Qwen2.5-Omni d’Alibaba veut être le modèle qui entend, voit et parle, tout à la fois
Qwen2.5-Omni d’Alibaba Cloud traite texte, images, audio et vidéo de bout en bout, générant texte et parole naturelle en temps réel. Les benchmarks montrent qu’il surpasse ou égale souvent les modèles spécialisés, laissant entrevoir un virage vers des architectures unifiées.
2026-07-20