NVIDIA
20 published articles
AI 模型 | NVIDIA Nemotron 3.5 Lightning
为什么 Nemotron 3.5 Lightning 认为大多数智能体步骤不需要大模型
Nvidia 的新开源模型在本地运行,具有 3B 激活参数和 100 万 token 上下文,专为持续运行的智能体打造。Nvidia 声称吞吐量最高可达同类开源模型的 4 倍,任务完成速度快 30%。
2026-08-14
人工智能与机器人
训练手术机器人更快了:Nvidia的Cosmos-H-Dreams运行速度达160帧/秒
Nvidia的Cosmos-H-Dreams将手术模拟转变为交互式实时体验。在单个GPU上以160帧/秒运行,它让外科医生、受训者和AI策略能够在生成的视频闭环中进行练习,无需实体机器人。
2026-08-01
AI研究
视频生成速度提升120倍:英伟达混合注意力机制突破单GPU极限
英伟达研究院的SANA-Video 2.0以3:1比例结合线性注意力和周期性softmax注意力,在单块H100上比Wan 2.2快120倍。混合设计恢复了全秩表达能力,同时将720p片段的推理时间控制在13秒。注意事项:基准测试止步于720p,且注意力改变与专有优化捆绑。
2026-07-31
开源AI
英伟达AV-Flamingo:攻克长视频理解,碾压多数模型
英伟达发布AV-Flamingo,一款专为长视频、复杂视频理解设计的开源音视频大语言模型。它采用三阶段课程学习法和带时间戳的思维链框架,能够处理许多模型难以应对的时间推理与跨模态推理任务。
2026-07-28
物理人工智能
英伟达40亿参数边缘模型:小视觉语言模型所不能,它能
英伟达的Cosmos 3 Edge将世界建模压缩到40亿参数,其大小类别在VANTAGE-Bench上排名第一。其双变压器设计将推理与机器人实时动作预测融为一体,全部可部署在Jetson和RTX硬件上。
2026-07-28
基础设施与融资
Together AI 8亿美元押注开放推理数学
Together AI 以 83 亿美元估值筹集 8 亿美元,由 Aramco Ventures、NVIDIA 等支持。该公司声称上一季度年化预订额超过 11.5 亿美元,得益于 Decagon、Eleven Labs 和 Cursor 等客户转向开放推理后实现 6 到 20 倍的成本降低。
2026-07-27
开放权重推理
英伟达Nemotron-4:速度快、开放,直指Llama与GPT之间的鸿沟
英伟达的Nemotron-4系列以具有竞争力的MMLU分数和声称的推理成本降低30%挑战Llama 3.3和Mistral Large。其开放许可和双尺寸策略使其成为团队大规模运行智能体工作负载的实用替代方案。
2026-07-25
开放模型协同作战
Sakana AI 将 NVIDIA Nemotron 引入其 Fugu 多智能体编排系统
Sakana AI 将 NVIDIA 的 Nemotron 开放模型系列集成到 Fugu 多智能体编排系统中。Fugu 动态选择并组合专用模型。此次合作旨在表明,协调一致的开放模型可以匹敌一体化前沿系统。
2026-07-23
管控型代理研究
英伟达新型AI科学家无需接触患者数据即可工作
英伟达AI技术中心推出NAIS,这是一个受管控的代理研究系统,可在受保护的医院数据上协调端到端生物医学工作流。在一项涉及286,422人的真实世界高血压GWAS部署中,该系统产生了与专家主导分析相当的结果,同时保护了隐私并允许人类监督。
2026-07-19
AI模型与基础设施
英伟达新嵌入模型登顶排行榜,但真正故事在于降低智能体成本
英伟达的Nemotron 3 Embed系列在RTEB基准测试中夺得头名,并推出保留80亿模型99%精度的10亿参数变体。公司数据显示,更强的检索能降低智能体系统中的下游token成本。
2026-07-18
市场动力
英伟达市值飙升,表明AI需求远未降温
英伟达市值突破3万亿美元,因AI基础设施需求持续增长。这一里程碑凸显出,尽管AMD和初创公司提供更便宜的推理芯片带来竞争,企业GPU采购依然强劲。
2026-07-16
特别报道 / 边缘AI
Nvidia DeepStream 开源:9.1版本对边缘AI意味着什么
Nvidia DeepStream视频分析SDK的完整源代码现已在GitHub上以Apache 2.0和CC-BY-4.0许可证发布,向更广泛的开发者开放了边缘AI开发。9.1版本引入了基于LLM的编码代理、Triton推理服务器集成以及用于端到端流程的整合仓库。
2026-07-16