SevenTnewS

Ollama

12 published articles

NVIDIA Research4 min read

AI 模型 | NVIDIA Nemotron 3.5 Lightning

为什么 Nemotron 3.5 Lightning 认为大多数智能体步骤不需要大模型

Nvidia 的新开源模型在本地运行,具有 3B 激活参数和 100 万 token 上下文,专为持续运行的智能体打造。Nvidia 声称吞吐量最高可达同类开源模型的 4 倍,任务完成速度快 30%。

2026-08-14

Meta AI3 min read

开源 AI

Meta 的 30B Muse Glimmer 率先登陆 Apple Silicon,NVIDIA 支持随后跟上

Meta 发布了 Muse Glimmer,一款面向 agent 工作负载的 30B 开放权重多模态模型,Ollama 同一天在 Apple Silicon 上提供了支持。DFlash 使其在 Mac 硬件上快 1.5 到 1.8 倍。NVIDIA 和 AMD 支持将在未来几天内跟进。

2026-08-13

Meta AIFeatured3 min read

开源

Meta 的 30B Muse Glimmer 今日通过 Ollama 的 MLX 引擎登陆 Apple Silicon

Meta 开放了 Muse Glimmer(一个 30B 稠密模型)的权重,Ollama 在当天就将其带到 Apple Silicon。本地编码智能体获得了一个原生后端,Muse Spark 1.2 预计后续推出。

2026-08-10

人工智能Featured1 min read

云瓶颈

Ollama暂停销售高级计划:开源模型正在吞噬其云资源

由于对GLM-5.2和其他前沿开放模型的需求压垮了其云服务,Ollama暂停新的Max订阅,而更大模型将于下周发布。

2026-07-26

融资Featured4 min read

融资轮

Ollama 融资8800万美元,将开源AI带入财富500强

Ollama 从 Benchmark 和 Docker 创始人 Solomon Hykes 处融资8800万美元,以扩展其开放模型平台。该平台目前被890万开发者以及85%的财富500强公司使用,旨在让本地AI所有权成为默认选择。

2026-07-09

基准与测试Featured3 min read

性能

Gemma 4 在 Ollama 0.31 中通过多令牌预测实现近 90% 的性能提升

Ollama 0.31 为 Apple Silicon 上的 Gemma 4 引入了多令牌预测,在编码基准测试中实现了近 90% 的令牌生成速度提升。加速来自一个自动调优的草稿模型和一个消除冗余权重读取的自定义 MLX 内核。

2026-06-29

Vibe编程Featured3 min read

性能更新

Ollama的MLX引擎在Apple Silicon上速度更快、内存占用更低

Ollama的MLX引擎更新带来了NVFP4量化,以实现更高质量的4位模型;通过融合Metal内核使推理速度提升20%;以及一个快照缓存系统,可消除多代理、思维模型和分支场景中共享上下文的重复处理。

2026-06-11

工具与框架Featured3 min read

本地 AI

Ollama 0.30 带来更快的 GPU 推理和原生 GGUF 模型支持

Ollama 0.30 将 NVIDIA 推理速度提升高达 20%,默认启用对 AMD 和 Intel 设备的 Vulkan GPU 支持,并扩展了 GGUF 模型兼容性,包括来自 Hugging Face 的微调模型以及对编码代理工具调用的支持。

2026-06-05

大语言模型与模型4 min read

人工智能

OpenJarvis 提供云端AI代理的本地优先替代方案

来自斯坦福大学Hazy Research和Scaling Intelligence实验室的OpenJarvis 1.0使得个人AI代理能够通过Ollama在本地运行,并可选云端接入。它包含用于晨间简报、跨文档研究和本地代码助手的预设,优先考虑效率和隐私,同时追踪能耗、成本和延迟。

2026-05-28

人工智能Featured4 min read

本地AI推理

Ollama重写Apple芯片引擎:M5时代才是真正的主角

Ollama预览MLX支持的Apple芯片推理,将Qwen3.5-35B-A3B模型在M5上的预填充速度推至1,851 tok/s。该版本还引入NVFP4量化以保证生产级一致性,并为代理工作流提供更智能的缓存机制。

2026-03-30

AI代理2 min read

AI 代理

Ollama 0.17 单条命令即可启动 OpenClaw

借助 Ollama 0.17,用户现在只需一条终端命令即可启动本地的开源 AI 助手。OpenClaw 可跨聊天应用管理收件箱、电子邮件和日历任务。

2026-02-23

AI代理2 min read

AI 代理

Ollama 为 Claude Code 引入子代理与网络搜索,无需 MCP 服务器

Ollama 现已支持 Claude Code 的并行子代理和内置网络搜索,实现更长的编码会话,且上下文噪音更少。新功能适用于任何 Ollama 云模型,无需额外配置。

2026-02-16