跳到正文
arXiv cs.CV· Senqiao Yang, Chengyao Wang, Yuxin Chen, Zixuan Wang, Longxiang Tang, Haokun Gui, Jinhui Ye, Changsheng Lu, Xiaoyang Wu, Mingkang Zhu, Pengguang Chen, Shu Liu, Zhuotao Tian, Hengshuang Zhao, Bei Yu, Jiaya Jia·· 5 小时前AI 评分38

VLAct:面向视觉-语言-动作模型的表征中心持续预训练

Beyond Data Scaling: Representation-Centric Continued Pre-training for Vision-Language-Action Models

AI 导读

研究团队提出 VLAct,一种面向 VLA 模型的 VLM 骨干,通过 VLM 先验保持、多头连续动作协同监督和部分统一的跨具身动作布局,在广泛异构多具身机器人数据上进行持续预训练。

来源:arXiv cs.CV · arxiv.org