递归自我改进
2 published articles
AI代理3 min read
深度研究AI
BAAI的新研究智能体不只是搜索更长时间,它还会检查自己的作业
BAAI的AREX智能体使用递归自我改进循环,压缩长研究历史,实现高效的验证驱动型精炼。通过一种新颖的长视野强化学习方法进行训练,它们在BrowseComp、DeepSearchQA和HLE上优于可比基线。
2026-07-31
实验室与研究4 min read
Frontis-MA1 / OpenMLE
能改进AI的AI,现在可在单张RTX 4090上运行
FrontisAI的OpenMLE技术栈和35B参数的Frontis-MA1智能体将递归自我改进变成了一个可复现的实验。在单张RTX 4090上,该模型在MLE-Bench Lite中得分71.21%,领先于GPT-5.5 + Codex,并接近大得多的前沿模型。
2026-07-31