arXiv cs.AI· Xinyu Zhang, Zhengtong Xu, Yutian Tao, Yeping Wang, Yu She, Abdeslam Boularias·· 5 小时前AI 评分27
基于残差潜在动作的视觉特征世界模型 RLA-WM 提出
Learning Visual Feature-Based World Models via Residual Latent Action
AI 导读
研究者提出 Residual Latent Action(RLA),可从 DINO 残差中学习,并据此构建 RLA-WM 世界模型,通过 flow matching 预测 RLA 值。
来源:arXiv cs.AI · arxiv.org