跳到正文
arXiv cs.AI· Qi Liu, Fengming Liang, Yiqun Chen, Erhan Zhang, Jiaxin Mao·· 9 小时前AI 评分24

RELER:在嵌入向量空间用强化学习直接优化检索

Learning to Retrieve via Reinforcement Learning in Embedding Space

AI 导读

研究者提出 RELER(REinforcement Learning for Retrieval),一个让现有嵌入模型在嵌入向量空间中直接学习检索并对齐任务奖励的强化学习框架,通过从以归一化编码器输出为中心的 von Mises-Fisher 分布采样查询和文档嵌入,并用 RLOO 更新编码器。

来源:arXiv cs.AI · arxiv.org