arXiv cs.LG· Zizhuo Zhang, Xiong Peng, Jingwei Sun, Rong Yao, Borui Jiang, Bo Han·· 9 小时前AI 评分28
重新思考 LLM 忠实性:一种成对上下文敏感视角
Rethinking Faithfulness in LLMs: A Pairwise Context-Sensitive Perspective
AI 导读
研究者提出 Pairwise Faithfulness Benchmark(PFaithBench),评估模型能否在支持性与非支持性上下文下对同一问题切换回答与弃答。
来源:arXiv cs.LG · arxiv.org