开源
Meta 的 30B Muse Glimmer 今日通过 Ollama 的 MLX 引擎登陆 Apple Silicon
Meta 开放了 Muse Glimmer(一个 30B 稠密模型)的权重,Ollama 在当天就将其带到 Apple Silicon。本地编码智能体获得了一个原生后端,Muse Spark 1.2 预计后续推出。

Meta 开放了 Muse Glimmer(一个 30B 参数的稠密模型)的权重,而 Ollama 在同一天就让它变得可运行。这一组合才是重点。没有本地运行时的权重发布只算作业;这一次则是直接下载。
Ollama 的帖子很直接:Muse Glimmer 今天即可通过其 MLX 引擎使用,项目方称其在 Apple Silicon 上拥有最先进的性能,并且可以原生驱动 Claude Code、Codex 以及其他常驻本地的智能体工作流。马克·扎克伯格在 X 上宣布该发布时,将 Glimmer 描述为“一个出色的 30B 参数稠密模型,可以本地运行”,并表示 Meta 将很快开放其最新基础模型 Muse Spark 1.2 的权重。“Meta 是开源的坚定支持者,我为这些发布感到自豪,”他写道。
MLX 引擎终于迎来第二个模型
时机之所以重要,是因为 Ollama 将模型放在了什么位置。其 MLX 引擎是 Mac 后端重写的核心,基于 Apple Silicon,推出时以预览形式只支持一个模型:Qwen3.5-35B-A3B,一个 35B 参数的 MoE 模型,每个 token 激活 3B 参数,针对编码任务优化,可在内存超过 32GB 的 M 系列 Mac 上运行。那次发布称 Ollama “正在积极努力支持未来的模型”。Muse Glimmer 是这一扩展真正开始的首个迹象。
引擎也在此过程中得到了升级。MLX 更新带来了 NVFP4 量化,让 4 位模型质量更高;通过融合的 Metal 内核将推理速度提升 20%;还加入了快照缓存,避免多智能体、思维模型和分支工作负载重复处理共享上下文。这些正是 Glimmer 要应对的工作负载:常驻本地而非调用云端的编码智能体。
智能体连接是关键。最近 Ollama 的工作通过单一启动命令推动了工具调用,因此 Claude Code 等编码智能体可以直接驱动本地模型。Glimmer 恰好融入这一流程:开放权重进入,常驻本地智能体输出。对于内存足够的 Mac 用户来说,路径是标准的 ollama run 流程,而不是云端控制台。
两篇帖子未提及的内容
遗漏之处和时机一样值得注意。所谓 Apple Silicon 上的最先进性能并没有附带基准数据,而且两篇帖子都没有说明 Glimmer 需要什么硬件、其上下文窗口是多少,也没有说明 Spark 1.2 具体何时发布。Ollama 的帖子在“Additional support and…”处戛然而止,因此除 MLX 之外的支持目前还是一个省略号。
两篇帖子并列表明的内容:
| 模型 | 状态 | 已知详情 |
|---|---|---|
| Muse Glimmer | 今日开放权重 | 30B 参数稠密模型;通过 Ollama 的 MLX 引擎在 Apple Silicon 上运行 |
| Muse Spark 1.2 | 权重即将开放 | Meta 最新的基础模型;未提供其他细节 |
为什么同日支持才是真正的公告
同日支持对双方都有分量。Meta 在一个开发者已经运行本地模型的地方发布了开放权重,并且工具已经就绪。Ollama 则获得了一个新的旗舰开放模型,证明其 Apple 引擎已经走出单一模型预览。两者都在强调同一个事实:模型今天就能用,而不是在某个宣布的未来日期。
对于 Ollama 所宣称的常驻智能体用例,一个 30B 稠密模型是否足够仍是一个悬而未决的问题。它与早期预览模型那种稀疏 MoE 架构不同,其 30B 稠密权重是否能胜任智能体工作负载,正是接下来几周社区测试将要回答的问题。这次发布真正确定的事项更窄,但值得一说:一个主要实验室的 30B 模型,在权重公开当天就能原生运行在 Mac 上。之后发布的任何东西都将以此作为衡量标准。
- 来源 : Ollama on X
- 来源 : Mark Zuckerberg on X
每天早晨用 3 分钟掌握科技要闻
每个工作日一封邮件,只讲真正重要的 AI 与科技动态。