NVIDIA NeMo
2 published articles
人工智能Featured2 min read
人工智能
480毫秒延迟、Whisper级别准确率、开源配方:Nvidia Canary重新定义实时ASR
英伟达的Nemo Canary模型在LibriSpeech和Common Voice上达到了Whisper级别的准确率,同时实现480毫秒延迟的流式处理。开源版本包含训练脚本和权重,使其成为实时ASR中罕见的可复现竞争者。
2026-07-26
实验室Featured3 min read
NVIDIA
Nvidia和Hugging Face联手,让分布式扩散训练变得轻松简单
Nvidia的NeMo Automodel现已直接集成Hugging Face Diffusers,为FLUX、Wan 2.1和HunyuanVideo等模型提供生产级分布式训练。这个基于Apache 2.0许可的库将并行性作为配置开关处理,并让微调后的检查点可直接加载回推理管线。
2026-07-19