TTS
3 published articles
Edge AI
Le runtime exclusivement CPU d'Audio8 fait tenir le clonage vocal dans environ 1 Gio de RAM
Le runtime ONNX d'Audio8 exécute la préversion TTS 0.6B entièrement sur CPU : poids autorégressifs INT4, codec 44,1 kHz intégré, PCM en streaming et endpoint compatible OpenAI. Le service occupe environ 1 Gio de RAM sur un ordinateur portable, et ni PyTorch ni Transformers ne sont nécessaires à l'exécution.
2026-08-05
TTS Open Source
Le nouveau modèle TTS d'Audio8 clone les voix en 11 langues gratuitement
Audio8 publie Audio8-TTS Preview sous licence Apache 2.0, un modèle de 0,6B prenant en charge 11 langues, le clonage vocal zero-shot, et un codec 44,1 kHz intégré. Cette version cible les applications vocales en périphérie nécessitant rapidité et confidentialité.
2026-07-30
IA vocale
L'IA vocale s'améliore sur les mots, mais elle ne sait toujours pas entendre comment vous les dites
Le benchmark Real World VoiceEQ de Hume, fondé sur plus d'un million d'évaluations humaines, teste plus de 40 modèles vocaux sur des dimensions ignorées par les benchmarks standards : l'émotion, l'identité du locuteur et le contexte acoustique. Les résultats montrent que les modèles de parole-à-parole varient énormément, et que même les systèmes leaders ignorent souvent les indices audio que les humains utilisent instinctivement.
2026-07-20