arXiv cs.LG· Christina Hahn, Shangbin Feng, Dean Light, Swastik Roy, Hila Gonen, Yulia Tsvetkov·· 6 小时前AI 评分27
Stackelberg Alignment:用 Stackelberg 博弈实现多 LLM 协同对齐
Multi-LLM Collaborative Alignment via Stackelberg Games
AI 导读
研究者提出 Stackelberg Alignment,一个受博弈论启发的 leader-follower 框架,把指令选择变成自适应课程:EXP3 bandit 作为 leader 按指令难度与响应可区分度分配固定采样预算,语言模型作为 follower 通过 DPO 或 GRPO 从偏好信号中学习。
来源:arXiv cs.LG · arxiv.org