跳到正文
arXiv cs.CV· Boyao Han, Chen Shi, Jingjing Qian, ZhuoTan Tian, Li Jiang·· 3 小时前AI 评分30

VersaCamVLA:可配置相机的机器人操作 VLA 策略

VersaCamVLA: Camera-Configurable VLA Policies for Robotic Manipulation

AI 导读

VersaCamVLA 是一个相机可配置的 VLA 框架,通过统一场景 token 接口将任意数量、带位姿的 RGB 视图映射为固定大小的 latent scene token,从而解耦相机集合表示与动作学习。

来源:arXiv cs.CV · arxiv.org