arXiv cs.AI· Hongzhan Lin, Shidong Cao, Ziyang Luo, Wenhao Chai, Mong-Li Lee, Wynne Hsu·· 5 小时前AI 评分41
从证据到行动:工具调用智能体为何失败
From Evidence to Action: How Tool-Using Agents Fail
AI 导读
研究揭示工具调用智能体在证据到行动链条上的失败模式:在十种模型-框架配置中,静态动作评估能力强,但交互式执行明显偏弱。失败常始于执行前——智能体调查不完整便停止,或在所需证据建立前就行动;一旦证据齐备,单动作执行通常可靠,多动作工作流则暴露未解决的前置条件和执行不完整问题。
来源:arXiv cs.AI · arxiv.org