MoE
4 published articles
人工智能Featured4 min read
AI 模型
Poolside 的 Laguna XS 2.1 在相同硬件下将编程基准测试成绩提升了 5 个点
Poolside 的 Laguna XS 2.1 在保持相同 33B 总参数量-3B 激活量 MoE 架构的同时,将 SWE-bench Multilingual 成绩提升 5.4 个百分点至 63.1%。该版本包含量化检查点、推测解码草稿模型以及 OpenMDW-1.1 许可证,使本地 AI 编程更加实用。
2026-07-21
工具与框架2 min read
基础设施深度解析
Nous Research 通过 DeepEP 扩展专家并行:MoE 预训练的现场记录
Nous Research 发布使用 DeepEP 扩展 MoE 专家并行的现场记录。详细介绍了吞吐量、配置权衡以及预训练 1T 参数 MoE 模型时遇到的瓶颈。为大规模分布式训练提供了实用的部署见解。
2026-07-19
大语言模型与模型7 min read
人工智能
Inkling揭示了开源模型市场的新分界线
Inkling是首个公开可用的近万亿参数模型,原生支持音频、图像和文本输入,同时拥有100万token的上下文窗口以及NVFP4量化版本。原始基准测试分数很强,但更具启示性的故事在于,开源生态系统如何从追赶者转变为在技术前沿的积极竞争者,以及Inkling在这一新版图中的位置。
2026-07-15
大语言模型与模型Featured4 min read
Google DeepMind
Gemma 4 让其他所有开放权重模型看起来都大了10倍
Google DeepMind 的 Gemma 4 原生多模态开放权重系列引入了思考模式、无编码器架构和 MoE 选项。2.3B 模型性能与 Gemma 3 的 27B 模型相当。31B 模型登顶开放权重排行榜。
2026-07-13