SevenTnewS

本地AI

6 published articles

NVIDIA Research4 min read

AI 模型 | NVIDIA Nemotron 3.5 Lightning

为什么 Nemotron 3.5 Lightning 认为大多数智能体步骤不需要大模型

Nvidia 的新开源模型在本地运行,具有 3B 激活参数和 100 万 token 上下文,专为持续运行的智能体打造。Nvidia 声称吞吐量最高可达同类开源模型的 4 倍,任务完成速度快 30%。

2026-08-14

开源Featured2 min read

代码发布

Xai 开源其编程代理 Grok Build,允许任何人完全本地运行

xAI 开源了其终端原生编程代理 Grok Build。该代码包括代理循环、工具系统、TUI 和扩展框架。开发者可以自行编译,并在本地使用自己的推理后端完全运行它。

2026-07-19

人工智能Featured5 min read

本地AI

无审查模型悖论:拒绝少了,安全也丢了,以及本地AI为何仍然重要

对五个本地运行的无审查大语言模型进行基准测试显示,消融手术将过度拒绝率从44%降至接近零,且不影响推理能力,但同样的编辑将安全拒绝率从41.5%降至9.5%,因为两者依赖于相同的内部方向。运行无审查模型的真正原因可能并非你想象的那样。

2026-07-19

融资Featured4 min read

融资轮

Ollama 融资8800万美元,将开源AI带入财富500强

Ollama 从 Benchmark 和 Docker 创始人 Solomon Hykes 处融资8800万美元,以扩展其开放模型平台。该平台目前被890万开发者以及85%的财富500强公司使用,旨在让本地AI所有权成为默认选择。

2026-07-09

工具与框架Featured3 min read

本地 AI

Ollama 0.30 带来更快的 GPU 推理和原生 GGUF 模型支持

Ollama 0.30 将 NVIDIA 推理速度提升高达 20%,默认启用对 AMD 和 Intel 设备的 Vulkan GPU 支持,并扩展了 GGUF 模型兼容性,包括来自 Hugging Face 的微调模型以及对编码代理工具调用的支持。

2026-06-05

大语言模型与模型4 min read

人工智能

OpenJarvis 提供云端AI代理的本地优先替代方案

来自斯坦福大学Hazy Research和Scaling Intelligence实验室的OpenJarvis 1.0使得个人AI代理能够通过Ollama在本地运行,并可选云端接入。它包含用于晨间简报、跨文档研究和本地代码助手的预设,优先考虑效率和隐私,同时追踪能耗、成本和延迟。

2026-05-28