预训练数据
2 published articles
人工智能Featured3 min read
AI完整性
AI流水线存在三个无声漏洞,每次修复都让其中一个恶化
一项评论垃圾邮件毒化研究、一篇表明AI检测器可能适得其反的论文,以及一个被捕获利用标签泄露的欺诈检测模型,都描述了相同的根本缺陷:AI管道中的代理指标一旦成为承重标准就会被人钻空子,而修复其中一个并不能解决整个模式。
2026-07-31
人工智能5 min read
AI 供应链
新研究警告:通过公开评论投毒大语言模型是可行的
华盛顿大学研究人员证明,通过自动化评论垃圾邮件投毒预训练数据是一个现实威胁。他们的 HalfLife 分析显示,0.13% 的投毒注入能够完整通过整个数据流水线,足以超过已知的攻击阈值,并影响基于 Common Crawl 训练的模型。
2026-07-26