1 published article
人工智能 · 智能体安全
SafeEvolve 是一篇于9月2日提交至 arXiv 的论文,它将运行时运行框架更新与策略训练相配对,让智能体自身的轨迹同时驱动二者。论文报告称,AgentDojo 上的攻击成功率降至三分之一,效用则略有提升。
2026-09-25