arXiv cs.CL· Harshita Chopra, Kshitish Ghate, Aylin Caliskan, Tadayoshi Kohno, Chirag Shah, Natasha Jaques·· 4 小时前AI 评分30
Persona Policies(PPol):为 LLM 智能体生成真实用户画像以提升评测鲁棒性
Beyond Cooperative Simulators: Generating Realistic User Personas for Robust Evaluation of LLM Agents
AI 导读
研究者提出 Persona Policies(PPol),一种即插即用的控制层,通过进化编码智能体自动发现用户画像生成程序,为 LLM 智能体评测注入真实的行为差异。
来源:arXiv cs.CL · arxiv.org