CPU推理
2 published articles
人工智能4 min read
边缘 AI
Audio8 的纯 CPU 运行时让语音克隆在约 1 GiB 内存中运行
Audio8 的 ONNX 运行时完全在 CPU 上运行 0.6B TTS 预览版:INT4 自回归权重、内置 44.1 kHz 编解码器、流式 PCM 以及兼容 OpenAI 的端点。该服务在笔记本电脑上占用约 1 GiB 内存,运行时无需 PyTorch 或 Transformers。
2026-08-05
大语言模型与模型5 min read
人工智能
LFM2.5-Encoders 为小模型提供了有力论据:CPU 上比 ModernBERT 快 3.7 倍
Liquid AI 的开放权重 LFM2.5-Encoders 证明了生产环境 NLP 应属于小型模型。230M 编码器在基准测试上胜过 ModernBERT-base,在笔记本电脑 CPU 上约 28 秒扫描完整文档,速度大约快 3.7 倍。
2026-08-05