跳到正文
arXiv cs.CV· Suhwan Cho, Yonwoo Choi, Soongjin Kim, Jicheol Park, Taegyu Lim·· 3 小时前AI 评分22

LEGO:无需 lifting 的第三人称到第一人称视频生成方法

LEGO: A Lifting-Free Approach for Exocentric-to-Egocentric Video Generation

AI 导读

LEGO 提出一种无需 lifting 的第三人称到第一人称视频生成方法,用 LVSM 风格 Transformer 直接渲染第一人称视角,省去深度估计、点云与重投影步骤。该合成器输出概率性映射,保留结构、牺牲纹理锐度,更契合扩散模型去噪恢复细节的特性,并利用分布集中度生成逐区域置信度,用于掩蔽低置信区域并引导生成器。方法持续优于现有显式流水线,且无需重训练即可泛化到其他数据集。

来源:arXiv cs.CV · arxiv.org