跳到正文
arXiv cs.AI· Hongji Pu, Yilun Zhao, Wenpeng Yin·· 14 小时前AI 评分36

PAPER2LLM++:让 LLM 从研究论文中持续自我进化

PAPER2LLM++: Continual Self-Evolution of LLMs from Research Papers

AI 导读

PAPER2LLM++ 是一个让 LLM 从研究论文中持续自我进化的框架,它把论文当作模型改进的证据与监督信号,而非仅用于检索的知识。对每篇新论文,它提取有证据支撑的发现,检验所报告的局限是否仍存在于当前模型,必要时转化为候选学习信号,并通过 try-evaluate-commit 流程仅在提升目标行为且不显著遗忘或损害通用能力时才提交更新。

来源:arXiv cs.AI · arxiv.org