跳到正文
arXiv cs.AI· Yaopei Zeng, Congchao Wang, JianHang Chen, Nan Wang, Yurui Chang, Lu Lin·· 9 小时前AI 评分30

Critic Experience Bank:为 LLM 智能体自演化的步级置信度估计

Critic Experience Bank: Self-Evolving Step-Level Confidence Estimation for LLM Agents

AI 导读

Critic Experience Bank(CEB)是一个免训练框架,将已完成轨迹的反馈转化为可复用证据,用于 LLM 智能体的步级置信度估计。它通过为动作打上事后生产力伪标签并检索相关经验,让固定 LLM 评论模型在无需参数更新或真实步级标签的情况下适应任务流。

来源:arXiv cs.AI · arxiv.org