跳到正文
arXiv cs.AI· Jing Ding, Ziqiao Ma, Jiayuan Mao, Joyce Chai, Freda Shi·· 11 小时前AI 评分22

视觉 Transformer 如何通过转喻回路为抽象概念奠基

Metonymic Circuits for Abstract Concept Grounding in Vision Transformers

AI 导读

研究揭示 Vision Transformer 通过"转喻式奠基"机制识别抽象概念:在 CLIP 和 DINO 视觉编码器上应用 Transcoders 后发现,抽象预测由"火"等具体可解释的锚概念驱动,感知原语主导浅层、类物体锚点先于抽象目标出现,含渲染文字的图像则走独立的感知到文本路径。因果干预实验验证这些转喻中间特征确实参与抽象概念奠基。该成果发表于 EMNLP 2026 主会。

来源:arXiv cs.AI · arxiv.org