跳到正文
热点事件持续更新

提出多智能体社区辩论设置评估LLM规范能力

1 篇报道1 个报道来源2 小时前更新

先了解这件事

报道摘要

研究提出多智能体社区辩论环境,用合成规范控制辩论准入,以在脱离预训练暴露的条件下考察 LLM 的规范能力。基线 LLM 智能体即使学习规范能提升准确率也未能学会,且规范遵循对规范风格和驱动规范模块的模型高度敏感,缺乏泛化性。当真实规范伴随非规范性个体行为时,LLM 智能体还会不加区分地连噪声一起模仿,即使明确惩罚也无济于事。

摘自 arXiv cs.AI

报道时间线

沿着报道,了解事件的不同侧面。

10月9日
  1. arXiv cs.AI
    LLM 的规范能力:多智能体社区辩论下的基础、设计与挑战

    研究提出多智能体社区辩论环境,用合成规范控制辩论准入,以在脱离预训练暴露的条件下考察 LLM 的规范能力。基线 LLM 智能体即使学习规范能提升准确率也未能学会,且规范遵循对规范风格和驱动规范模块的模型高度敏感,缺乏泛化性。当真实规范伴随非规范性个体行为时,LLM 智能体还会不加区分地连噪声一起模仿,即使明确惩罚也无济于事。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。