跳到正文
arXiv cs.CL· Shuai Guo, Yidong Cui·· 3 小时前AI 评分29

BeliefScope:诊断大语言模型中的证据驱动修正与压力诱导偏移

BeliefScope: Diagnosing Evidence-Driven Revision and Pressure-Induced Shifts in Large Language Models

AI 导读

BeliefScope 是一个受控黑盒框架,用于区分大语言模型对同一命题的修正究竟源于相关证据还是无事实依据的方向性用户压力,通过概率报告、分类判断和行动建议等多通道测量响应变化。

来源:arXiv cs.CL · arxiv.org