arXiv cs.AI· Yue Zhang, Zun Wang, Han Lin, Yonatan Bitton, Idan Szpektor, Mohit Bansal·· 9 小时前AI 评分32
SPATIALUNCERTAIN:VLM 能否判断何时不该回答空间问题?
Seeing Isn't Knowing: Do VLMs Know When Not to Answer Spatial Questions (and Why)?
AI 导读
研究者提出 SPATIALUNCERTAIN 评测框架,用遮挡造成的证据缺失和透视造成的误导证据两类场景,考察视觉语言模型能否判断当前视角是否可靠。在八个开源与闭源 VLM 上,模型行为并不跟随视觉证据的可靠性:证据消失时不会更谨慎,透视冲突时判断更依赖投影外观而非未变的物理 3D 关系。
来源:arXiv cs.AI · arxiv.org