LLM 研究
2 published articles
AI代理4 min read
AI 研究:关于 agent 技能的新 arXiv 预印本
COBRA-Skills 在 50 个样本上将 agent 技能调优成本降低 55-58%
COBRA-Skills 将上下文老虎机优先级排序与技能演化相结合,相对于 SkillOpt 把 agent 技能优化成本降低 55-58%,每个基准仅使用 50 个独特样本。
2026-09-19
AI代理4 min read
AI 智能体
当智能体技能适得其反,SkillProx 像梯度下降一样修剪它们
技能本应让智能体更聪明,但它们累积的每一次修复都可能让智能体变得更笨。SkillProx 运行一个受近端梯度启发的正向-反向循环,用于诊断、回滚和删除。结果:相比最强的基于梯度的基线,平均准确率提升 3.0 个百分点。
2026-08-14