SevenTnewS

语音克隆

5 published articles

人工智能4 min read

边缘 AI

Audio8 的纯 CPU 运行时让语音克隆在约 1 GiB 内存中运行

Audio8 的 ONNX 运行时完全在 CPU 上运行 0.6B TTS 预览版:INT4 自回归权重、内置 44.1 kHz 编解码器、流式 PCM 以及兼容 OpenAI 的端点。该服务在笔记本电脑上占用约 1 GiB 内存,运行时无需 PyTorch 或 Transformers。

2026-08-05

人工智能Featured1 min read

开源TTS

Audio8的新TTS模型免费克隆11种语言的语音

Audio8以Apache 2.0许可发布Audio8-TTS预览版,这是一个0.6B参数的模型,支持11种语言、零样本语音克隆,并捆绑了44.1 kHz编解码器。该发布针对需要速度和隐私的边缘语音应用。

2026-07-30

人工智能Featured1 min read

AI与研究

68.4%胜率让ElevenLabs显得脆弱

Voxtral TTS在多元语言语音克隆方面树立了新标杆,在偏好对比测试中以68.4%的胜率击败ElevenLabs Flash v2.5。其混合架构及开源权重发布可能重塑TTS格局。

2026-07-24

人工智能Featured3 min read

人工智能

那些缺失的‘嗯’和‘啊’终于让AI语音听起来像人类了

MiniMax 的 Speech 2.8 将原生填充词、呼吸声和犹豫感引入 AI 语音合成,解决了长期困扰合成语音的‘过于完美’问题, , 这曾让它们听起来像机器人。该模型还提供了10秒语音克隆和跨语言准确性改进。

2026-07-11

人工智能2 min read

AI语音

MiniMax Speech 2.8:原生语气词与高保真克隆,为AI语音注入人性温度

MiniMax Speech 2.8 增加了自然的语气词、10秒语音克隆和录音室级音频质量,以缩小合成语音与人类语音之间的差距。该模型修复了导致AI语音听起来机械的“过于完美”问题。

2026-07-08