跳到正文
arXiv cs.AI· Chang Liu, Deliang Ding·· 3 小时前AI 评分29

LLM 智能体持久记忆治理:准入与呈现如何分开评估

What to Admit and How to Present: Governing Persistent Memory in LLM Agents

AI 导读

针对 LLM 智能体持久记忆带来的谄媚与跨域泄漏问题,研究提出两种无需重训练的推理期设计:整体评估记忆条目的 FC 与拆解为类型化单元的 PS。在外部基准上,FC 和 PS 将汇总失败率分别降低 6.7 和 8.8 个百分点,开发集跨域泄漏最多下降 29.5 个百分点。收紧准入可再降跨域失败 17.5 个百分点,但两种设计均增加个性化失败,PS 未达预注册标准。

来源:arXiv cs.AI · arxiv.org