跳到正文
arXiv cs.CV· JunGyu Lee, Inhwan Bae, Hae-Gon Jeon·· 9 小时前AI 评分19

MoRE:用奖励专家混合框架改进基于语言的轨迹预测

Revisiting Numerical Forecasting Models for Language-Based Trajectory Prediction

AI 导读

MoRE(Mixture of Reward Experts)通过强化学习将五个冻结的数值预测器的坐标级先验迁移到预训练语言轨迹预测器中,专家预测转为奖励并经不确定性加权共识融合。在 ETH-UCY 上,ADE 从 0.22 降至 0.20 m,FDE 从 0.32 降至 0.29 m;相对基础策略,ADE 在 SDD 上下降 17.9%、在 NBA 上下降 12.7%,且未增加推理内存或延迟。

来源:arXiv cs.CV · arxiv.org