arXiv cs.AI· Brendan King, Farima Fatahi Bayat, Jean-Flavien Bussotti, Pouya Pezeshkpour, Estevam Hruschka·· 10 小时前AI 评分26
Confidence Reasoning Graphs:面向 LLM 智能体的结构化置信度估计
Confidence Reasoning Graphs: Structured Confidence Estimation for LLM Agents
AI 导读
研究者提出 Confidence Reasoning Graphs(CRG),一种推理时框架,仅凭单条轨迹即可估计 LLM 智能体完成任务的成功概率,无需模型内部信号或训练数据。CRG 将任务声明分解为基于轨迹证据的子声明,逐项估计置信度后再聚合为整体置信度。在三个智能体基准、三个骨干模型和三个智能体框架上,CRG 的置信度校准与风险感知决策均优于口头表达、采样和白盒代理基线。
来源:arXiv cs.AI · arxiv.org