分布式训练
2 published articles
实验室Featured5 min read
NVIDIA
Nvidia和Hugging Face联手,让分布式扩散训练变得轻松简单
Nvidia的NeMo Automodel现已直接集成Hugging Face Diffusers,为FLUX、Wan 2.1和HunyuanVideo等模型提供生产级分布式训练。这个基于Apache 2.0许可的库将并行性作为配置开关处理,并让微调后的检查点可直接加载回推理管线。
2026-07-19
工具与框架2 min read
基础设施深度解析
Nous Research 通过 DeepEP 扩展专家并行:MoE 预训练的现场记录
Nous Research 发布使用 DeepEP 扩展 MoE 专家并行的现场记录。详细介绍了吞吐量、配置权衡以及预训练 1T 参数 MoE 模型时遇到的瓶颈。为大规模分布式训练提供了实用的部署见解。
2026-07-19