Hugging Face
20 published articles
NVIDIA
Nvidia和Hugging Face联手,让分布式扩散训练变得轻松简单
Nvidia的NeMo Automodel现已直接集成Hugging Face Diffusers,为FLUX、Wan 2.1和HunyuanVideo等模型提供生产级分布式训练。这个基于Apache 2.0许可的库将并行性作为配置开关处理,并让微调后的检查点可直接加载回推理管线。
2026-07-19
AI研究
制约AI智能体的瓶颈不是探索,而是评估
Hugging Face的两篇新论文从相反的方向着手解决同一个核心问题:如何让AI智能体可靠地评估自身行为。AJ-Bench构建了一个针对环境感知型评判智能体的基准测试,而HeavySkill则认为最好的评判者存在于模型参数内部。
2026-07-17
网络安全
当AI攻击AI平台会发生什么:Hugging Face漏洞是网络安全新时代的蓝图
Hugging Face遭受了由自主AI代理利用其数据管道发起的入侵。该事件揭示了AI驱动的攻击性工具如何以机器速度运行,以及为什么防御者需要在自己的基础设施上运行有能力的模型以跟上节奏。
2026-07-16
云基础设施
GPU跳转撞上南墙,一次整合直接拆掉了它
通过将Hugging Face存储作为SkyPilot的一等后端进行挂载(读取时零出站费用),团队现在可以在任何有闲置GPU的云上运行训练和推理,而无需复制数据或按GB支付传输费用。该整合结合了通过hf-mount实现的惰性挂载与Xet驱动的去重技术,以保持数据传输的高效性。
2026-07-15
人工智能
Inkling揭示了开源模型市场的新分界线
Inkling是首个公开可用的近万亿参数模型,原生支持音频、图像和文本输入,同时拥有100万token的上下文窗口以及NVFP4量化版本。原始基准测试分数很强,但更具启示性的故事在于,开源生态系统如何从追赶者转变为在技术前沿的积极竞争者,以及Inkling在这一新版图中的位置。
2026-07-15
AWS集成
AWS与Hugging Face一键消除AI模型部署最棘手的环节
AWS与Hugging Face推出一键集成功能,开发者从模型页面可直接跳转至SageMaker Studio,且权限与GPU配额已预设。这意味着无需再配置IAM、申请配额或在多个仪表盘间切换。
2026-07-14
开源创新
Hugging Face 的 Moon Bot 将 Slack 变成编码代理,而这只是本周的动态
Moon Bot 将 AI 辅助编码直接带入 Slack 工作流,而 VLX-Flow 和 VLX-Seek 则致力于实时视频理解和细粒度感知。其他亮点包括医学编码器预训练方案、Qwen 上的 QLORA 蒸馏实验,以及一个用于机器学习的星际基准。
2026-06-29
开源AI研究
百万token上下文,KV缓存仅需十分之一:DeepSeek-V4的效率赌注
DeepSeek的V4预览将一款1.6万亿参数的Pro模型与一款2840亿参数的Flash变体组合在一起,两者均支持百万token上下文。论文声称其推理FLOPs仅为V3.2的27%,KV缓存仅为其10%, , 正是这些数字让该上下文的部署变得经济可行。
2026-06-22