synthèse vocale
3 published articles
TTS open-weight
Magpie TTS consomme 32 ms du budget de latence de votre agent vocal
Magpie TTS annonce un délai de 32 ms avant le premier audio sur un NVIDIA B200 et ajoute l'arabe, le coréen et le portugais brésilien, portant son catalogue à 12 langues. L'argument des poids ouverts : la synthèse vocale auto-hébergée ne perd plus la bataille de la latence.
2026-08-16
IA & Recherche
Un taux de victoire de 68% vient de rendre ElevenLabs vulnérable
Voxtral TTS établit un nouveau standard pour le clonage vocal multilingue, remportant 68,4% des comparaisons de préférence face à ElevenLabs Flash v2.5. L'architecture hybride du modèle et sa publication en poids ouverts pourraient remodeler le paysage de la synthèse vocale.
2026-07-24
Intelligence artificielle
Le nouveau modèle audio de Nvidia fait cinq choses à la fois et bat les spécialistes sur leur propre terrain
Audex de Nvidia unifie la compréhension audio, la génération et le raisonnement textuel en un seul modèle, égalant ou battant les systèmes spécialisés dans les benchmarks de parole et d'audio sans sacrifier les performances textuelles.
2026-07-09