跳到正文
arXiv cs.AI· Peihua Mai, Zhuoyan Shao, Xinbao Qiao, Meng Zhang, Xinyue Zhou, Yan Pang·· 11 小时前AI 评分38

研究发现 LLM 存在错觉模式感知,会引发虚假推理

Illusory Pattern Perception Drives Spurious Inference in Large Language Models

AI 导读

一项被 NeurIPS 2026 接收的研究首次系统考察了大语言模型(LLM)中的错觉模式感知,发现 LLM 常比人类更易在随机数据中推断出有意义关联。模型倾向于将频繁出现的正面属性过度关联到多数群体或大型组织,并从模糊事件中构建因果叙事。研究基于稀疏自编码器(SAE)的特征可解释性框架,揭示整体频率感知与分析性认知取向与这类错觉的涌现相关。

来源:arXiv cs.AI · arxiv.org