跳到正文
arXiv cs.AI· Zibin Dong, Yicheng Liu, Shiduo Zhang, Baijun Ye, Yifu Yuan, Fei Ni, Jingjing Gong, Xipeng Qiu, Hang Zhao, Yinchuan Li, Jianye Hao·· 3 小时前AI 评分30

ActionCodec:什么样的动作 tokenizer 才算好

ActionCodec: What Makes for Good Action Tokenizers

AI 导读

针对 VLA 模型动作 tokenization 设计只关注重建保真度的问题,研究者从 VLA 优化视角提出信息论设计原则,包括最大化时间 token 重叠、最小化词表冗余、增强多模态互信息和 token 独立性,并据此推出动作 tokenizer ActionCodec。

来源:arXiv cs.AI · arxiv.org