arXiv cs.LG· Sreejeet Maity, Aritra Mitra·· 10 小时前AI 评分17
Robust Async-Fed-Q:面向不可靠轨迹的对抗鲁棒联邦 Q-Learning
Learning from Unreliable Trajectories: Adversarially-Robust Federated Q-Learning
AI 导读
研究团队提出 Robust Async-Fed-Q,一种基于 epoch 的联邦强化学习算法,在智能体端对 Bellman 最优算子做方差缩减估计、在服务器端做鲁棒聚合,使部分智能体发送任意损坏信息时仍能保留协作的样本效率收益。
来源:arXiv cs.LG · arxiv.org