跳到正文
arXiv cs.AI· Yunju Kang, Seonghyeon Cho, Irene Li, Yeo-Chan Yoon, Chanjun Park·· 10 小时前AI 评分27

POLAR:面向工具调用 LLM 智能体的本体引导风险预防框架

POLAR: Ontology-Guided Risk Prevention for Tool-Calling LLM Agents

AI 导读

POLAR 是一个面向小型工具调用智能体的护栏框架,通过结构化双层本体评估动作可逆性,为每个动作生成分级可逆性分数,未达阈值的调用会在执行前被剪枝。在 τ²-bench 上对六种智能体模型评测,POLAR 使其中四个模型在 airline 域的平均任务奖励提升 0.11 至 0.18 分,但十八个模型—领域组合中仅八个整体改善,retail 域及更强模型常出现回退。

来源:arXiv cs.AI · arxiv.org