NVIDIA NeMo
2 published articles
Intelligence artificielle
Latence de 480 ms, précision au niveau de Whisper, une recette ouverte : Canary de Nvidia redéfinit la reconnaissance vocale en temps réel
Les modèles Nemo Canary de Nvidia atteignent une précision équivalente à Whisper sur LibriSpeech et Common Voice avec une latence de 480 ms en streaming. La version open source inclut des scripts d'entraînement et des poids, ce qui en fait un concurrent rarement reproductible dans le domaine de la reconnaissance vocale en temps réel.
2026-07-26
NVIDIA
Nvidia et Hugging Face s'associent pour rendre l'entraînement distribué de diffusion banal
NeMo Automodel de Nvidia s'intègre désormais directement à Diffusers de Hugging Face, permettant un entraînement distribué de qualité production pour des modèles comme FLUX, Wan 2.1 et HunyuanVideo. La bibliothèque sous licence Apache 2.0 gère le parallélisme comme une bascule de configuration et permet aux points de contrôle affinés de se charger directement dans les pipelines d'inférence.
2026-07-19