跳到正文
arXiv cs.CL· Lin Tian, Marian-Andrei Rizoiu·· 1 天前AI 评分37

研究揭示大模型"审计缺口":事实回答正确不等于下游决策正确

Misinformation Without Triggers: From Factual Answers to Downstream Decisions

AI 导读

一项针对8个模型的研究发现,在剂量1000的虚假文档训练下,模型直接注入选择率高达95.8%–100%,但决策任务中的注入选择仅比真实对照训练高出1.7–14.4个百分点,形成"审计缺口"。在2019–20澳大利亚山火虚假帖文案例中,模型即使未复现被夸大的数字,仍会断言有人因纵火被捕。研究表明,正确的事实回答不能保证正确的决策,纠正事实也无法消除误导性叙事。

来源:arXiv cs.CL · arxiv.org