跳到正文
arXiv cs.CL· Jiachen Zhao, Zhengxuan Wu, David Bau, Weiyan Shi·· 4 小时前AI 评分29

人格层级模型:理解 LLM 微调中的上下文泛化

The Persona Hierarchy Model: Understanding Contextual Generalization in Fine-Tuning LLMs

AI 导读

研究者提出 Persona Hierarchy Model 解释 LLM 微调中的上下文泛化现象:共享默认人格影响跨上下文行为,修改共享人格的微调带来更广迁移,而局部人格改动则更局限于特定上下文。

来源:arXiv cs.CL · arxiv.org