跳到正文
arXiv cs.LG· Peng Xia, Jianwen Chen, Hanyang Wang, Jiaqi Liu, Kaide Zeng, Yu Wang, Siwei Han, Yiyang Zhou, Xujiang Zhao, Haifeng Chen, Zeyu Zheng, Cihang Xie, Huaxiu Yao·· 6 小时前AI 评分30

SkillRL:通过递归技能增强强化学习进化智能体

SkillRL: Evolving Agents via Recursive Skill-Augmented Reinforcement Learning

AI 导读

研究者提出 SkillRL 框架,通过自动技能发现与递归进化,让 LLM 智能体从原始经验中提炼可复用行为模式。该方法引入经验蒸馏机制构建分层技能库 SkillBank,并配合自适应检索策略与递归进化机制,使技能库在强化学习过程中与智能体策略共同演化。

来源:arXiv cs.LG · arxiv.org