SevenTnewS

IA vocale

12 published articles

LLM & Modèles4 min read

TTS open-weight

Magpie TTS consomme 32 ms du budget de latence de votre agent vocal

Magpie TTS annonce un délai de 32 ms avant le premier audio sur un NVIDIA B200 et ajoute l'arabe, le coréen et le portugais brésilien, portant son catalogue à 12 langues. L'argument des poids ouverts : la synthèse vocale auto-hébergée ne perd plus la bataille de la latence.

2026-08-16

IAFeatured4 min read

Intégrité électorale

L'IA vocale rencontre la démocratie : ElevenLabs signe le premier pacte avec une autorité électorale

ElevenLabs s'associe à l'autorité électorale du Brésil pour ajouter l'IA vocale aux services d'information électorale, tout en renforçant les garanties contre les abus. L'entreprise travaille également avec des décideurs politiques et des entreprises de détection pour protéger les élections de 2026.

2026-08-09

Tests & Benchmarks5 min read

Agents vocaux

Pourquoi Grok 4.1 Fast bat des modèles plus intelligents au téléphone

Les classements généraux choisissent les mauvais LLM pour les appels vocaux. Le classement 2026 de BenchLM place la latence en premier : Grok 4.1 Fast répond en 0.54s tandis que Claude Opus 4.6, le meilleur scoreur, a besoin de 1.78s. Les modèles rapides mènent la conversation ; les modèles de raisonnement restent sur les appels d'outils en arrière-plan.

2026-08-05

IAFeatured2 min read

Stratégie IA

Les modèles d'IA internes de Microsoft réduisent les coûts de production de 89 %

Les modèles MAI maison de Microsoft sont en production, offrant des économies de coûts spectaculaires dans plusieurs produits. Ces chiffres signalent un changement stratégique : l'entreprise rivalise désormais sur l'efficacité d'inférence, pas seulement sur la qualité des modèles.

2026-07-29

IA3 min read

Partenariat

ElevenLabs signe avec le gouvernement britannique pour intégrer l'IA vocale dans les services publics

ElevenLabs a signé un protocole d'accord avec le DSIT du gouvernement britannique pour tester l'IA vocale dans les services publics, en se concentrant sur l'accessibilité pour les personnes malvoyantes, âgées et les communautés linguistiquement diverses. L'entreprise agrandit son siège londonien et double ses effectifs au Royaume-Uni pour atteindre 200 personnes.

2026-07-28

IA3 min read

Gouvernement numérique

La Grèce signe un accord avec ElevenLabs pour intégrer l'IA vocale dans les services publics et sauver un dialecte en voie de disparition

La Grèce s'associe à ElevenLabs pour intégrer l'IA vocale dans gov.gr, les portails touristiques et la préservation des dialectes régionaux comme le crétois. L'accord a été signé par le ministre de la Gouvernance numérique et de l'IA, Dimitris Papastergiou, et marque le premier pacte d'IA vocale au niveau étatique en Europe du Sud.

2026-07-27

Actualités3 min read

Événements IA

ElevenLabs amène son sommet IA à Varsovie et défend la tech polonaise

ElevenLabs organise son troisième sommet à Varsovie, à l'Opéra national de Pologne, avec 2 500 participants, des dirigeants polonais et des fondateurs européens. L'événement marque un retour aux sources pour les fondateurs de la startup de voix IA et signale le rôle croissant de la Pologne dans l'innovation en IA.

2026-07-25

IA3 min read

Analyse des coûts

Les modèles d'IA internes de Microsoft réduisent les coûts GPU jusqu'à 89 % en production

Microsoft fait état d'une réduction de 84 % des coûts GPU pour la génération d'images et de 89 % pour la voix avec ses modèles MAI-2.5 et MAI-Voice-2-Flash désormais en production sur Bing, PowerPoint et Dynamics 365. La stratégie des modèles internes offre des avantages de coûts mesurables par rapport aux alternatives tierces.

2026-07-24

IAFeatured4 min read

IA vocale

L'IA vocale s'améliore sur les mots, mais elle ne sait toujours pas entendre comment vous les dites

Le benchmark Real World VoiceEQ de Hume, fondé sur plus d'un million d'évaluations humaines, teste plus de 40 modèles vocaux sur des dimensions ignorées par les benchmarks standards : l'émotion, l'identité du locuteur et le contexte acoustique. Les résultats montrent que les modèles de parole-à-parole varient énormément, et que même les systèmes leaders ignorent souvent les indices audio que les humains utilisent instinctivement.

2026-07-20

IA4 min read

Intelligence Artificielle

Sarvam Samvaad a rendu l'IA vocale fonctionnelle dans 11 langues indiennes. C'est la partie facile.

Sarvam Samvaad est une plateforme d'IA conversationnelle de niveau entreprise prenant en charge 11 langues indiennes avec une latence inférieure à 500 ms. Déployable via la voix, WhatsApp et le web, elle revendique un retour sur investissement de 10x et plus de 100 millions de conversations traitées. Le vrai test : tenir ces promesses à grande échelle.

2026-07-14

IAFeatured3 min read

Intelligence artificielle

Les « euh » et « hum » manquants qui rendent enfin la parole IA humaine

Avec Speech 2.8, MiniMax intègre des mots de remplissage, la respiration et les hésitations dans la synthèse vocale IA, résolvant le problème « trop parfait » qui rendait longtemps la parole synthétique robotique. Le modèle propose également un clonage vocal en 10 secondes et des améliorations de la précision interlangue.

2026-07-11

LLM & ModèlesFeatured4 min read

Intelligence Artificielle

GPT-Live d'OpenAI cesse enfin d'attendre que vous ayez fini de parler

GPT-Live d'OpenAI introduit l'audio full-duplex, permettant à l'IA d'écouter et de parler en même temps. Elle peut dire « mhmm », attendre pendant les pauses et confier le raisonnement complexe à GPT-5.5 en arrière-plan, maintenant ainsi le flux de la conversation.

2026-07-01