SevenTnewS

人工智能

人工智能:大语言模型、智能体、扩散模型、计算机视觉、自然语言处理及顶级实验室最新动态。

565 published articles

4 min read

谷歌 AI

关闭 Gemini 水印并不会让其无法溯源

Gemini 和 Flow 生成的 AI 内容现在可以去掉可见的闪光徽标。不可见的 SynthID 和 C2PA 标记仍然保留,因此验证仍然有效。问题在于:它只对想到要查询的人有效。

2026-08-23

4 min read

AI 音乐生成

Music 3.0 用时间线取代单标签提示,让 AI 歌曲始终不跑偏

AI 曲目在展开过程中容易偏离提示:乐器退出、情绪平淡、人声风格时有时无。Music 3.0 用按时间顺序的 Structured Caption 取代单标签描述,并由 8B/0.6B Hybrid-LM 将结构与细节分开处理。

2026-08-21

5 min read

设计工具

Open Design 0.18.0 终结了“这是最新版本吗?”会议

Open Design 0.18.0 推出了带实时只读镜像的共享团队工作区,并允许 Codex 无头调用设计引擎。来自 22 位贡献者的 115 个拉取请求在两天内落地。以下是变更内容及其所契合的智能体工具趋势。

2026-08-21

5 min read

AI 透明度

Claude 的隐形水印即将到来:彻底重写即可消除它

Anthropic 将为未来的 Claude 模型添加隐形水印,以满足欧盟《人工智能法案》关于标注 AI 生成内容的规定。它免费且无法追踪,但会遗漏逐字代码、短段落和完全重写的文本。

2026-08-21

5 min read

开放权重 AI

小红书 dots3-note:280B 开源 MoE,仅激活 16B

小红书的 dots studio 发布了其首个开放权重模型 dots3-note preview:一个多模态 MoE,拥有 280B 参数、16B 激活参数和 512K 上下文窗口。这种稀疏设计旨在降低单台 8-GPU 节点上的服务成本,但模型卡尚未公布基准测试数字。

2026-08-20

5 min read

AI编程

AI编写的C++运行开销高出5-8%,评审耗时更长。修复之道在于提示词

一项对某企业C++代码库352万次代码更改的12个月研究发现,AI代码在耦合、分配和循环风格方面明显更差,计算开销高出5-8%。提示词层面的反馈挽回了11.1%的静态分析警告。

2026-08-19

4 min read

智能体记忆

TEPA:对AI智能体而言,过时记忆比没有记忆更糟

一篇新的arXiv预印本论文认为,智能体记忆存在可证伪性问题:过时的事实仍可被检索,并污染提示词。其TEPA机制会撤销已被取代的记忆;在漂移测试中,朴素记忆得分低于无记忆(0.210对0.309),而TEPA达到0.950。

2026-08-19

5 min read

测试时扩展

CoBa路由以58.9%更少的token追平best-of-16投票

CoBa,一篇新arXiv论文中提出的计算平衡路由策略,在0.01个百分点内追平best-of-16多数投票,同时将参数加权token削减58.9%。在跨MATH-500、AIME和AMC的3,129次评估中,它还完全胜过单样本解码,不过在预算不受限时,best-of-16仍保持微弱优势。

2026-08-19

4 min read

AI 研究

Muon 更快顿悟模加法,随后其解崩溃

经 Muon 训练的 Transformer 比 AdamW 更快顿悟模加法,但在每一种测试配置中都会丢失该解。论文将崩溃归因于表示-读出界面,冻结任一参数组即可阻止崩溃。傅里叶分析表明,任务电路依然存活,只是被投票压倒。

2026-08-19

3 min read

Fisher-R1 | 假设检验

AI智能体统计分析毫无差错,却仍得出错误结论

自动化假设检验的智能体能够完美地执行分析,却得出错误结论,因为大多数基准测试从不检查p值是否有效。一个包含425个任务的基准测试量化了这种差距,而一个经过强化学习训练的开放权重模型填补了其中一部分。

2026-08-19

5 min read

AI / 智能体编码研究

Blast Radius埋葬死上下文。450具尸体无一复返

一篇新的arXiv论文Blast Radius将浪费的智能体上下文视为死物质并加以可逆埋葬:在七个OpenAI模型上节省17-26%的token,450个已归档上下文,零次召回。这篇论文更宏大的目标是让智能体编码变得可持续, , 一次回收一个token。

2026-08-19

4 min read

AI智能体

PsychoAgent为AI智能体赋予情感记忆,评分者未发现优势

PsychoAgent为LLM智能体提供独立的情感记忆,使情感上显著、充满冲突的痕迹能够压过仅具主题相关性的痕迹。在三个冲突场景中,它检索到的冲突关键记忆多于两个基线(0.933对0.500和0.667),但五名盲法评分者未发现显著的质量优势。

2026-08-19

← PreviousPage 1 / 48 · 565 articlesNext →