ONNX 运行时
2 published articles
Hugging Face5 min read
浏览器 AI:WebGPU 内核与基准测试
Hugging Face 的 2.57 倍 WebGPU 提速附带着 176 项落败
Hugging Face 发布了 207 个采用 Apache-2.0 许可的 WebGPU 内核、一个可通过 JavaScript 运行它们的加载器,以及一款浏览器基准测试工具。其对比 ONNX Runtime Web 的主打 2.57 倍提速,是在 1,756 个测试用例中保留 809 个后得出,并记录了 176 项落败。
2026-09-16
人工智能4 min read
边缘 AI
Audio8 的纯 CPU 运行时让语音克隆在约 1 GiB 内存中运行
Audio8 的 ONNX 运行时完全在 CPU 上运行 0.6B TTS 预览版:INT4 自回归权重、内置 44.1 kHz 编解码器、流式 PCM 以及兼容 OpenAI 的端点。该服务在笔记本电脑上占用约 1 GiB 内存,运行时无需 PyTorch 或 Transformers。
2026-08-05