Skip to content
arXiv · Software Engineering· Kavienan Jegatheesan, Gayathri Lihinikaduarachchi·· 5 hr agoAI score43

工具出错时:数学智能体在受损工具反馈下的可靠性研究

When Tools Lie: Reliability of Mathematical Agents Under Corrupted Tool Feedback

AI brief

研究通过受控损坏框架评估数学智能体能否检测并纠正被篡改的工具调用结果,覆盖 31 道题、四种验证设计。无验证时准确率从 100% 降至 72.4%,强制同上下文反思可完全恢复到 100%;可选验证仅在模型主动调用时提升准确率。重启实验显示显式检测后完整重启成功率为 100%,论文已被 NeurIPS 2026 第 6 届数学推理与 AI 工作坊接收。

Source: arXiv · Software Engineering · arxiv.org