跳到正文
arXiv cs.LG· Zhilin He, Gauri Joshi·· 9 小时前AI 评分19

FedGuide:用扩散先验对齐与价值基线引导异构联邦强化学习

FedGuide: Diffusion Prior Alignment and Value Baseline Guidance for Heterogeneous Federated Reinforcement Learning

AI 导读

FedGuide 是一个面向异构环境的联邦强化学习框架,用扩散先验作为行为模型为各客户端提供个性化数据分布,并通过最优传输混合专家(OT-MoE)聚合这些先验,而非直接平均本地策略。

来源:arXiv cs.LG · arxiv.org