开源 AI
Meta 的 30B Muse Glimmer 率先登陆 Apple Silicon,NVIDIA 支持随后跟上
Meta 发布了 Muse Glimmer,一款面向 agent 工作负载的 30B 开放权重多模态模型,Ollama 同一天在 Apple Silicon 上提供了支持。DFlash 使其在 Mac 硬件上快 1.5 到 1.8 倍。NVIDIA 和 AMD 支持将在未来几天内跟进。

开放权重只是发布的一半,另一半是运行时。Meta 和 Ollama 在同一天交付了这两部分。Meta Superintelligence Labs 为其首个发布 Muse Glimmer 开放了权重,Ollama 则立即通过其 MLX 引擎在 Apple Silicon 上提供该模型。
这个发布顺序值得停下来想一想。Ollama 的初始支持仅覆盖 Apple Silicon,NVIDIA、AMD 和其他平台将在未来几天内推出。一个开放模型的首个官方运行时是 Apple Silicon 而不是 NVIDIA,这与通常的顺序相反,它改变了 Mac 用户今天能做的事情:在本地运行 30B 的 agent 模型,无需云账户。
Apache 2.0 许可下的 30B 多模态模型
Muse Glimmer 的规格表直指 agent 工作负载。它是一个 30B 多模态模型,上下文长度超过 128K,采用 Apache 2.0 许可证发布。推理强度可在 low、medium、high 和 xhigh 之间调节;Ollama 建议在复杂编码和 agent 任务中使用 high 或 xhigh,在更看重速度时使用较低设置。
原生图像理解来自一个专用的 1.8B 参数感知编码器。Ollama 指出了三类关键任务:根据图纸或原型构建网站或应用程序、由截图驱动的计算机使用应用,以及读取文档、收据和图表。对于编码 agent 来说,这意味着在图像密集型任务中实现低延迟、连续的工具调用。
| 规格 | Muse Glimmer |
|---|---|
| 参数 | 30B 稠密 |
| 上下文长度 | 128K+ |
| 许可证 | Apache 2.0 |
| 推理强度 | low、medium、high、xhigh |
| 感知编码器 | 1.8B 参数,原生图像理解 |
| Apple Silicon 上的 DFlash 加速 | 1.5 倍至 1.8 倍 |
Claude Code、Codex 与本地 agent 群体
该模型融入 agent 生态系统,而不是局限于笔记本中。Ollama 列出了 Muse Glimmer 可以驱动的编码 agent,包括 Claude Code、Codex 和 Pi,以及用于长期运行的个人助手的 OpenClaw 和 Hermes。ollama launch 命令还支持 OpenCode 和 GitHub Copilot。
设置只需一条命令:ollama run muse-glimmer:30b-mlx。要在 Claude Code 下运行,则使用 ollama launch claude, model muse-glimmer:30b-mlx。这背后的实用模式正是 Ollama 一直在推动的:让 agent 驻留在本机,而不是调用云端。
Apple Silicon 率先获得 DFlash,NVIDIA 尚未获得任何支持
Ollama 的 MLX 引擎现在支持 DFlash,这是在其已有的多 token 预测支持基础上构建的。该公司表示,得益于 DFlash,Muse Glimmer 在 Apple Silicon 上的运行速度提高了 1.5 倍到 1.8 倍。正是这样的性能,让笔记本电脑上的连续工具调用成为可能。
苹果优先的交付是本报道的转折点,但这并不意味着该模型仅限于 Mac。正如我们在权重发布时所报道的,DFlash 草稿模型在 RTX 5090 上实现了最高 3.1 倍的解码加速,量化使模型保持在 20GB 以下。Ollama 运行时的 NVIDIA 和 AMD 版本只是还没有推出而已。
这一切并非凭空而来。MLX 引擎近期的工作增加了 NVFP4 量化,用于更高品质的 4 位模型;通过融合 Metal 内核实现 20% 的推理加速;以及快照缓存,避免多 agent 和分支工作负载重新处理共享上下文。这些正是 Glimmer 所针对的工作负载:驻留式编码 agent、长期运行的个人助理、截图驱动的计算机使用。
Meta 的开源赌注,一次一个模型
扎克伯格在 X 上介绍了这次发布,描述与规格表相符:"一个可以在本地运行的出色 30B 参数稠密模型"。他还表示,Meta 将很快开放其最新基础模型 Muse Spark 1.2 的权重。他写道:"Meta 是开源的有力支持者,我为这些发布感到自豪。"
这次发布正值 Ollama 扩大其在本地运行的范围。一个 35B 编码调优模型最近获得了对 M 系列 Mac 的支持,该公司表示正在积极努力支持未来的模型;Muse Glimmer 是这项工作的第一个可见成果。与此同时,阿里巴巴正准备发布其最大模型的权重,开源权重赛道正在变得拥挤。
单次发布不是策略。不过,这里的模式是一致的:开放权重、同日提供本地运行时、优先 Apple Silicon,以及已经预告的下一款模型。开源赌注就是这样变成习惯的。
- 来源 : Meta's 30B Muse Glimmer hits Apple Silicon first, NVIDIA support follows — 2026-08-10
每天早晨用 3 分钟掌握科技要闻
每个工作日一封邮件,只讲真正重要的 AI 与科技动态。