NVIDIA Research
CUDA、Blackwell、NIM、TensorRT 及 NVIDIA 的 AI 与 GPU 研究
3 published articles
4 min read
AI 模型 | NVIDIA Nemotron 3.5 Lightning
为什么 Nemotron 3.5 Lightning 认为大多数智能体步骤不需要大模型
Nvidia 的新开源模型在本地运行,具有 3B 激活参数和 100 万 token 上下文,专为持续运行的智能体打造。Nvidia 声称吞吐量最高可达同类开源模型的 4 倍,任务完成速度快 30%。
2026-08-14
3 min read
AI研究
视频生成速度提升120倍:英伟达混合注意力机制突破单GPU极限
英伟达研究院的SANA-Video 2.0以3:1比例结合线性注意力和周期性softmax注意力,在单块H100上比Wan 2.2快120倍。混合设计恢复了全秩表达能力,同时将720p片段的推理时间控制在13秒。注意事项:基准测试止步于720p,且注意力改变与专有优化捆绑。
2026-07-31
5 min read
管控型代理研究
英伟达新型AI科学家无需接触患者数据即可工作
英伟达AI技术中心推出NAIS,这是一个受管控的代理研究系统,可在受保护的医院数据上协调端到端生物医学工作流。在一项涉及286,422人的真实世界高血压GWAS部署中,该系统产生了与专家主导分析相当的结果,同时保护了隐私并允许人类监督。
2026-07-19