百万上下文
3 published articles
NVIDIA Research4 min read
AI 模型 | NVIDIA Nemotron 3.5 Lightning
为什么 Nemotron 3.5 Lightning 认为大多数智能体步骤不需要大模型
Nvidia 的新开源模型在本地运行,具有 3B 激活参数和 100 万 token 上下文,专为持续运行的智能体打造。Nvidia 声称吞吐量最高可达同类开源模型的 4 倍,任务完成速度快 30%。
2026-08-14
Anthropic / ClaudeFeatured3 min read
模型发布
Anthropic 发布 Claude Sonnet 5:面向实时智能体和海量工作负载的混合推理模型
Anthropic 的 Claude Sonnet 5 提供混合推理能力,拥有 100 万 token 上下文窗口,在编码、智能体工作流和企业任务方面表现出色。以每百万输入 token 2 美元的入门价格提供,承诺将多日编码项目压缩至数小时内完成。
2026-07-09
实验室与研究Featured3 min read
AI实验室与研究
MiniMax M3自主编写CUDA内核,并开源代码
MiniMax M3在BrowseComp上取得83.5分,超越Opus 4.7的79.3分,原生支持高达100万token的上下文。在一项显著的自主性测试中,它在无需人工干预的情况下,将GPU内核峰值利用率从7.6%自我优化到71.3%。
2026-07-09