跳到正文
arXiv cs.LG· Haoran Hao, Shahram Najam Syed, Jeffrey Ichnowski, Jeff Schneider·· 6 小时前AI 评分29

FAR:面向测试时恢复与持续策略改进的失败感知重试框架

FAR: Failure-Aware Retry for Test-Time Recovery and Continual Policy Improvement

AI 导读

机器人策略框架 FAR(Failure-Aware Retry)通过失败对比偏好适配与轻量动作扰动,让机器人在测试时从失败中学习并自主完成任务。仿真和真实操作任务中,FAR 相比标准扩散策略平均成功率分别提升 17.6% 和 11.7%,并在持续策略改进中提升了数据效率。该工作已被 CoRL 2026 接收,代码和视频已公开。

来源:arXiv cs.LG · arxiv.org