跳到正文
arXiv cs.AI· Zi Wang, Xingqiao Wang, Emmanuel Addai, Devika Ambekar, Xiaowei Xu·· 9 小时前AI 评分24

长期记忆智能体的检索可采性验证:RHELM 与 MemOps 基准上 Top-20 锚点召回率从 0.432 提升至 0.533

The Right Memory in the Wrong Context: Verifying Retrieval Admissibility in Long-Term Agent Memory

AI 导读

研究者提出检索可采性验证框架,为每个记忆-查询对分配可采、不可采或未决三种状态,并在 RHELM 和 MemOps 两个公开长期记忆基准的 3,767 条查询上做 Top-20 事后重分析,锚点召回率从 0.432 升至 0.533,80% 召回可行性从 0.237 升至 0.311,精确相似度评估减少 98.3%。

来源:arXiv cs.AI · arxiv.org