提出多智能体社区辩论设置评估LLM规范能力
热点事件持续更新
提出多智能体社区辩论设置评估LLM规范能力
1 篇报道1 个报道来源2 小时前更新
先了解这件事
报道摘要
研究提出多智能体社区辩论环境,用合成规范控制辩论准入,以在脱离预训练暴露的条件下考察 LLM 的规范能力。基线 LLM 智能体即使学习规范能提升准确率也未能学会,且规范遵循对规范风格和驱动规范模块的模型高度敏感,缺乏泛化性。当真实规范伴随非规范性个体行为时,LLM 智能体还会不加区分地连噪声一起模仿,即使明确惩罚也无济于事。
摘自 arXiv cs.AI
最新进展10月9日 12:00
LLM 的规范能力:多智能体社区辩论下的基础、设计与挑战报道时间线
沿着报道,了解事件的不同侧面。
10月9日
- arXiv cs.AILLM 的规范能力:多智能体社区辩论下的基础、设计与挑战
研究提出多智能体社区辩论环境,用合成规范控制辩论准入,以在脱离预训练暴露的条件下考察 LLM 的规范能力。基线 LLM 智能体即使学习规范能提升准确率也未能学会,且规范遵循对规范风格和驱动规范模块的模型高度敏感,缺乏泛化性。当真实规范伴随非规范性个体行为时,LLM 智能体还会不加区分地连噪声一起模仿,即使明确惩罚也无济于事。
本事件热度走势
还没有足够的连续观测数据,暂不绘制趋势。