Skip to content
X · @teortaxesTex · X / Twitter

RT Xudong Han: Agent 自进化,并不会每一轮都变得更强。 这篇《Rethinking Self-Evolving Agent Skills》专门研究 Skill 在多轮迭代里到底是怎么进化的。 作者…

RT Xudong HanAgent 自进化,并不会每一轮都变得更强。这篇《Rethinking Self-Evolving Agent Skills》专门研究 Skill 在多轮迭代里到底是怎么进化的。作者做了 42 组 evolution run,一共生成 388 个候选 Skill,真正刷新验证集最好结果的只有 55 个。也就是说,大部分修改其实没有带来有效提升,很多轮次会停滞、退化,最后被回滚。还有一个很有意思的结果:最终被选中的 11 个进化 Skill,全部使用了失败轨迹作为反馈;只看成功经验的方案一次都没有胜出。失败轨迹更像是在告诉 Agent「哪里需要修」,成功轨迹则更适合保留已有能力。这也说明了自进化更像一场带验证