跳到正文
arXiv cs.CL· Huayi Lai, Jicheng Yang, Min Yi, Chong Meng·· 4 小时前AI 评分31

MIRROR:让 LLM 个性化从模仿走向偏好内化

MIRROR: From Imitation to Internalization in LLM Personalization

AI 导读

研究者提出自蒸馏框架 MIRROR,将 LLM 个性化从模仿参考文本转向内化用户偏好:用参考条件自模型的下一 token 分布对齐模型自身生成轨迹,替代参考 token 模仿。

来源:arXiv cs.CL · arxiv.org