arXiv cs.AI· Kavienan Jegatheesan, Gayathri Lihinikaduarachchi·· 9 小时前AI 评分27
工具说谎时:工具反馈被污染下数学智能体的可靠性
When Tools Lie: Reliability of Mathematical Agents Under Corrupted Tool Feedback
AI 导读
研究用受控污染框架测试数学智能体能否识别并纠正被篡改的工具调用结果,在 31 道题上对比四种验证设计。无验证时准确率从 100% 骤降至 72.4%,强制同上下文反思可完全恢复至 100%,可选验证仅在模型主动调用时有效。显式检测后完整重启问题在 100% 情况下成功,表明验证器可用性与验证策略是数学智能体可靠性的两个独立组成部分。
来源:arXiv cs.AI · arxiv.org