SevenTnewS

人工智能

人工智能:大语言模型、智能体、扩散模型、计算机视觉、自然语言处理及顶级实验室最新动态。

364 published articles

Featured3 min read

产品发布

Claude Sonnet 5 来了,Anthropic 押注科学与企业市场

Anthropic 发布了 Claude Sonnet 5,这是一款更快、更强大的编程和智能体模型,同时为研究人员推出了 Claude Science,为团队推出了 Claude Tag。该公司还发布了一份关于人工智能指数级增长的政策框架。

2026-06-30

Featured5 min read

Anthropic 发布分析

Claude Sonnet 5 让 Opus 的价格差距更难合理化

Claude Sonnet 5 承诺以更低成本提供接近 Opus 级的推理和智能体性能。早期测试者报告称,在自主任务完成和多步骤复杂操作跟进方面有显著改善。通过 2026 年 8 月的入门定价,该模型使 Opus 的价格差距更难合理化。

2026-06-30

3 min read

人工智能

DeepSeek新模型让效率竞争成为AI军备竞赛的前沿

DeepSeek发布了一款新的大型语言模型,通过将赌注押在效率而非蛮力上,加剧了与主要AI实验室的竞争。该模型旨在通过优化资源利用提供强大性能,反映了行业向成本效益型AI的广泛转变。

2026-06-30

Featured5 min read

智能体基准分析

ProgramBench:最硬核编程测试中,所有公开AI模型得分均为0%

ProgramBench要求AI智能体仅凭二进制文件重构程序,无需源代码或问题描述。所有公开模型均未能完全解决任何任务,暴露出在探测、架构和停止判断方面的弱点。该基准测试是针对编程智能体超越补丁式工作流程的压力测试。

2026-06-29

4 min read

合成数据

没有老板,没有瓶颈:点对点框架重塑合成数据生成方式

Matrix是一个去中心化框架,通过分布式队列传递序列化消息,实现多智能体合成数据生成。通过消除中央协调器,在相同硬件上实现了2到15倍的吞吐量提升。

2026-06-06

Featured3 min read

本地 AI

Ollama 0.30 带来更快的 GPU 推理和原生 GGUF 模型支持

Ollama 0.30 将 NVIDIA 推理速度提升高达 20%,默认启用对 AMD 和 Intel 设备的 Vulkan GPU 支持,并扩展了 GGUF 模型兼容性,包括来自 Hugging Face 的微调模型以及对编码代理工具调用的支持。

2026-06-05

Featured5 min read

AI 基础设施

Nvidia Nemotron 3 Ultra 颠覆智能体工作流成本方程

Nemotron 3 Ultra,Nvidia 的密集-稀疏智能体模型,承诺将推理成本降低高达 30%(相比同级开源模型),同时保持前沿推理能力。凭借 100 万 token 上下文窗口和原生 NVFP4 量化,它被定位为企业工具调用工作负载的主力模型。

2026-06-04

4 min read

人工智能

OpenJarvis 提供云端AI代理的本地优先替代方案

来自斯坦福大学Hazy Research和Scaling Intelligence实验室的OpenJarvis 1.0使得个人AI代理能够通过Ollama在本地运行,并可选云端接入。它包含用于晨间简报、跨文档研究和本地代码助手的预设,优先考虑效率和隐私,同时追踪能耗、成本和延迟。

2026-05-28

7 min read

云基础设施

什么在驱动智能体?阿里云ANOLISA重写操作系统层

阿里云ANOLISA是为智能体时代设计的三层操作系统升级方案,可减少30%的令牌使用量,并将执行时间缩短类似幅度。专为高密度智能体部署而设计,它在内核层面解决了安全性、可观测性和效率低下问题。

2026-05-26

4 min read

阿里云

Anolisa v0.3 为AI智能体提供安全网和撤销按钮

阿里云智能体操作系统 Anolisa 达到 v0.3 版本,新增专用安全模块 AgentSecCore、实时成本可视化以及工作区快照功能,可在毫秒内撤销智能体操作。

2026-05-07

Featured4 min read

本地AI推理

Ollama重写Apple芯片引擎:M5时代才是真正的主角

Ollama预览MLX支持的Apple芯片推理,将Qwen3.5-35B-A3B模型在M5上的预填充速度推至1,851 tok/s。该版本还引入NVFP4量化以保证生产级一致性,并为代理工作流提供更智能的缓存机制。

2026-03-30

4 min read

AI安全研究

AI模型无法停止“边想边说”。这对安全性而言既是好消息,也是噩梦。

Claude Sonnet 4.5 仅有 2.7% 的时间能控制其思维链,而最终输出的可控性却高达 61.9%。这一差距引发了对思维链监控作为安全机制稳健性的开放性疑问,而无人知晓其存在的原因。

2026-03-09

← PreviousPage 30 / 31 · 364 articlesNext →