跳到正文
arXiv cs.AI· Rachel S. Y. Teo, Yutaro Yamada, Shashank Kotyan, Yuki Imajuku, Tarin Clanuwat·· 3 小时前AI 评分27

超越模仿:LLM 辅助同行评审的框架与基准

Beyond Imitation: A Framework and Benchmark for LLM-Assisted Peer Review

AI 导读

研究提出以错误检测为核心的 LLM 辅助同行评审评估视角,并构建可扩展基准,通过向会议论文合成插入错误来检验评审系统识别逻辑矛盾的能力。同时提出 Multi-Layered Review(MLR)框架,强调先深入理解稿件再生成评审,在提升 token 效率的同时与人类评审分数高度一致,并实现高错误检测表现。研究还证实此类系统仍易受对抗性操纵,需加强鲁棒性。

来源:arXiv cs.AI · arxiv.org