本地AI
6 published articles
AI 模型 | NVIDIA Nemotron 3.5 Lightning
为什么 Nemotron 3.5 Lightning 认为大多数智能体步骤不需要大模型
Nvidia 的新开源模型在本地运行,具有 3B 激活参数和 100 万 token 上下文,专为持续运行的智能体打造。Nvidia 声称吞吐量最高可达同类开源模型的 4 倍,任务完成速度快 30%。
2026-08-14
代码发布
Xai 开源其编程代理 Grok Build,允许任何人完全本地运行
xAI 开源了其终端原生编程代理 Grok Build。该代码包括代理循环、工具系统、TUI 和扩展框架。开发者可以自行编译,并在本地使用自己的推理后端完全运行它。
2026-07-19
本地AI
无审查模型悖论:拒绝少了,安全也丢了,以及本地AI为何仍然重要
对五个本地运行的无审查大语言模型进行基准测试显示,消融手术将过度拒绝率从44%降至接近零,且不影响推理能力,但同样的编辑将安全拒绝率从41.5%降至9.5%,因为两者依赖于相同的内部方向。运行无审查模型的真正原因可能并非你想象的那样。
2026-07-19
融资轮
Ollama 融资8800万美元,将开源AI带入财富500强
Ollama 从 Benchmark 和 Docker 创始人 Solomon Hykes 处融资8800万美元,以扩展其开放模型平台。该平台目前被890万开发者以及85%的财富500强公司使用,旨在让本地AI所有权成为默认选择。
2026-07-09
本地 AI
Ollama 0.30 带来更快的 GPU 推理和原生 GGUF 模型支持
Ollama 0.30 将 NVIDIA 推理速度提升高达 20%,默认启用对 AMD 和 Intel 设备的 Vulkan GPU 支持,并扩展了 GGUF 模型兼容性,包括来自 Hugging Face 的微调模型以及对编码代理工具调用的支持。
2026-06-05
人工智能
OpenJarvis 提供云端AI代理的本地优先替代方案
来自斯坦福大学Hazy Research和Scaling Intelligence实验室的OpenJarvis 1.0使得个人AI代理能够通过Ollama在本地运行,并可选云端接入。它包含用于晨间简报、跨文档研究和本地代码助手的预设,优先考虑效率和隐私,同时追踪能耗、成本和延迟。
2026-05-28