跳到正文
arXiv cs.AI· Xiaoyang Cao, Jingqi Li, Zhe Fu, Alexandre M. Bayen·· 9 小时前AI 评分18

LiRA:多智能体强化学习中为共享约束学习责任分配

Who Bears the Burden? Learning Responsibility for Shared Constraints in Multi-Agent Reinforcement Learning

AI 导读

多智能体共享成本预算时,统一 Lagrange 乘子只能约束总量、无法决定惩罚如何在各智能体间分摊,为此研究者提出 Lagrangian Responsibility Allocation(LiRA),通过有限训练周期内优化社会福利来学习每个智能体对公共乘子的分摊比例。

来源:arXiv cs.AI · arxiv.org