AI透明度
2 published articles
Anthropic / Claude5 min read
AI 透明度
Claude 的隐形水印即将到来:彻底重写即可消除它
Anthropic 将为未来的 Claude 模型添加隐形水印,以满足欧盟《人工智能法案》关于标注 AI 生成内容的规定。它免费且无法追踪,但会遗漏逐字代码、短段落和完全重写的文本。
2026-08-21
人工智能5 min read
AI可解释性
神经网络的决策现在可以追溯到具体的训练样本
研究人员展示,利用Gram几何,神经网络行动分数可以表示为训练样本回报的精确加权和。这使得训练后审计信号能够识别有影响力的案例、衡量行动一致性并标记支持薄弱的情况,而无需重新训练或访问原始优化轨迹。
2026-08-03