arXiv cs.AI· Shengxiang Gao, Chao Lei, Jey Han Lau, Linhao Luo, Jianzhong Qi·· 12 小时前AI 评分22
Reward on Path:为知识图谱问答学习中间监督信号
Reward on Path: Learning Intermediate Supervision Signals for Knowledge Graph Question Answering
AI 导读
针对知识图谱问答(KGQA)中答案标签监督噪声大、LLM 精炼监督成本高的问题,研究者提出 Reward on Path(RoP)框架,用非对称目标从答案标签中学习轻量的、以问题为条件的路径奖励。
来源:arXiv cs.AI · arxiv.org