跳到正文
arXiv cs.CV· Congsheng Xu, Qiaochu Yang, Fangyuan Shi, Yifan Han, Baijun Chen, Yiming Wang, Haonan Zhao, Zhe Liu, Yao Mu, Daolin Ma, Xiaokang Yang, Hesheng Wang·· 5 小时前AI 评分22

VT-MUSE:面向操作任务的多模态统一序列视触觉表征学习框架

VT-MUSE: Multimodal Unified Sequential Visuotactile Representation Learning for Manipulation

AI 导读

研究者提出 VT-MUSE,一个面向视触觉操作任务的多模态统一序列表征学习框架,通过两阶段学习解决视觉与触觉独立编码及忽略接触时序演化的问题。在仿真基准上,VT-MUSE 在所有任务上超越最强基线 11 个百分点,真实世界实验也取得显著提升。

来源:arXiv cs.CV · arxiv.org