AI 编程 › AI 资讯 › 正文

When Tools Lie: Reliability of Mathematical Agents Under Corrupted Tool Feedback

arxiv · arXiv · 2026-10-06 18:28 · 评分 84

论文研究数学智能体在工具输出被篡改时的可靠性:通过隐藏拦截器将工具结果替换为看似合理的错误信息,基于31个问题和四种验证策略,评估智能体检测并纠正错误的能力。

原文:arXiv | 返回 AI 资讯列表