SevenTnewS

人工智能

人工智能:大语言模型、智能体、扩散模型、计算机视觉、自然语言处理及顶级实验室最新动态。

424 published articles

4 min read

合成数据

没有老板,没有瓶颈:点对点框架重塑合成数据生成方式

Matrix是一个去中心化框架,通过分布式队列传递序列化消息,实现多智能体合成数据生成。通过消除中央协调器,在相同硬件上实现了2到15倍的吞吐量提升。

2026-06-06

Featured3 min read

本地 AI

Ollama 0.30 带来更快的 GPU 推理和原生 GGUF 模型支持

Ollama 0.30 将 NVIDIA 推理速度提升高达 20%,默认启用对 AMD 和 Intel 设备的 Vulkan GPU 支持,并扩展了 GGUF 模型兼容性,包括来自 Hugging Face 的微调模型以及对编码代理工具调用的支持。

2026-06-05

Featured5 min read

AI 基础设施

Nvidia Nemotron 3 Ultra 颠覆智能体工作流成本方程

Nemotron 3 Ultra,Nvidia 的密集-稀疏智能体模型,承诺将推理成本降低高达 30%(相比同级开源模型),同时保持前沿推理能力。凭借 100 万 token 上下文窗口和原生 NVFP4 量化,它被定位为企业工具调用工作负载的主力模型。

2026-06-04

4 min read

人工智能

OpenJarvis 提供云端AI代理的本地优先替代方案

来自斯坦福大学Hazy Research和Scaling Intelligence实验室的OpenJarvis 1.0使得个人AI代理能够通过Ollama在本地运行,并可选云端接入。它包含用于晨间简报、跨文档研究和本地代码助手的预设,优先考虑效率和隐私,同时追踪能耗、成本和延迟。

2026-05-28

7 min read

云基础设施

什么在驱动智能体?阿里云ANOLISA重写操作系统层

阿里云ANOLISA是为智能体时代设计的三层操作系统升级方案,可减少30%的令牌使用量,并将执行时间缩短类似幅度。专为高密度智能体部署而设计,它在内核层面解决了安全性、可观测性和效率低下问题。

2026-05-26

Featured1 min read

Model Studio

Qwen3.7非高峰时段定价将API成本降低80%,美国开发者获得最佳时段

阿里云的Qwen3.7非高峰定价在覆盖美国和欧盟工作日的时段提供高达80%的API调用折扣。以下是它与GPT-5.5、Claude和Gemini的对比,以及哪些工作负载受益最大。

2026-05-20

Featured2 min read

Qwen3.7

时区漏洞让AI推理成本降低80%

Model Studio在夜间窗口期自动将Qwen3.7-Max和Qwen3.7-Plus API成本降低高达80%,该窗口期恰好覆盖美国和欧洲的工作时间。无需注册、无需修改代码,只要时机得当,任何人都能享受更便宜的推理。

2026-05-20

4 min read

阿里云

Anolisa v0.3 为AI智能体提供安全网和撤销按钮

阿里云智能体操作系统 Anolisa 达到 v0.3 版本,新增专用安全模块 AgentSecCore、实时成本可视化以及工作区快照功能,可在毫秒内撤销智能体操作。

2026-05-07

1 min read

稳定币支付

稳定币,无需加密货币:Circle瞄准企业管理支付

Circle launches a managed stablecoin payments service that lets banks and enterprises process crypto transactions without managing digital assets. The service handles wallet infrastructure, aiming to simplify stablecoin adoption for institutions wary of direct crypto exposure.

2026-03-31

Featured4 min read

本地AI推理

Ollama重写Apple芯片引擎:M5时代才是真正的主角

Ollama预览MLX支持的Apple芯片推理,将Qwen3.5-35B-A3B模型在M5上的预填充速度推至1,851 tok/s。该版本还引入NVFP4量化以保证生产级一致性,并为代理工作流提供更智能的缓存机制。

2026-03-30

Featured3 min read

多智能体架构

为什么Qoder给每个AI代理配一个老板

Qoder的专家模式用一个单一的Leader取代了点对点的多智能体消息传递,该Leader异步协调专门的专家。该架构减少了状态爆炸,在四个维度上提高了质量,并在每个任务后提取可复用的技能。

2026-03-11

4 min read

AI安全研究

AI模型无法停止“边想边说”。这对安全性而言既是好消息,也是噩梦。

Claude Sonnet 4.5 仅有 2.7% 的时间能控制其思维链,而最终输出的可控性却高达 61.9%。这一差距引发了对思维链监控作为安全机制稳健性的开放性疑问,而无人知晓其存在的原因。

2026-03-09

← PreviousPage 35 / 36 · 424 articlesNext →