Skip to content
arXiv cs.LG · Papers

ContinualSkillBench: Can LLM Agents Truly Evolve Their Capabilities?

arXiv:2608.03874v1 Announce Type: cross Abstract: Modern agent frameworks equip large language models with external skill libraries to solve complex tasks. However, it remains unclear whether these systems can effectively evolve their skills and whether the resulting skills improve task-solving capabilities. To bridge