跳到正文
arXiv cs.CV· M. Moein Esfahani, Sepehr Salem, Mohammed Alser, Vince Calhoun·· 4 小时前AI 评分27

视觉模型学的是物理约束还是渲染捷径?一个面向物理一致性的反事实基准

Do Vision Models Learn Physical Constraints or Rendering Shortcuts? A Counterfactual Benchmark for Grounded Physical Consistency

AI 导读

研究者提出一个反事实基准,用 Mitsuba 3 从 500 个场景族生成 5,500 张图像,每族含 1 张干净图和 10 张分别涉及阴影、反射、支撑、表面响应与遮挡的违规图,用于诊断编辑图像的物理合理性。

来源:arXiv cs.CV · arxiv.org