arXiv cs.LG· Zhilin He, Gauri Joshi·· 9 小时前AI 评分19
FedGuide:用扩散先验对齐与价值基线引导异构联邦强化学习
FedGuide: Diffusion Prior Alignment and Value Baseline Guidance for Heterogeneous Federated Reinforcement Learning
AI 导读
FedGuide 是一个面向异构环境的联邦强化学习框架,用扩散先验作为行为模型为各客户端提供个性化数据分布,并通过最优传输混合专家(OT-MoE)聚合这些先验,而非直接平均本地策略。
来源:arXiv cs.LG · arxiv.org