跳到正文
arXiv cs.AI· Brendan King, Farima Fatahi Bayat, Jean-Flavien Bussotti, Pouya Pezeshkpour, Estevam Hruschka·· 10 小时前AI 评分26

Confidence Reasoning Graphs:面向 LLM 智能体的结构化置信度估计

Confidence Reasoning Graphs: Structured Confidence Estimation for LLM Agents

AI 导读

研究者提出 Confidence Reasoning Graphs(CRG),一种推理时框架,仅凭单条轨迹即可估计 LLM 智能体完成任务的成功概率,无需模型内部信号或训练数据。CRG 将任务声明分解为基于轨迹证据的子声明,逐项估计置信度后再聚合为整体置信度。在三个智能体基准、三个骨干模型和三个智能体框架上,CRG 的置信度校准与风险感知决策均优于口头表达、采样和白盒代理基线。

来源:arXiv cs.AI · arxiv.org