AI 编程 › AI 资讯 › 正文

Not Self-Decidable: LLMs Cannot Draw the Boundary of What an Agent Verifier Can Check

arxiv · arXiv · 2026-10-04 02:25 · 评分 85

本文论证LLM无法自行划定智能体验证器可检查规则的边界。在金融、医疗、法律等外部规则场景,智能体执行的是未编写的规则,固定检查与人工判定的划分需在运行时重复进行,令审查无法审计。该发现挑战了现有升级方案的前提,对高合规领域智能体安全有重要意义。

原文:arXiv | 返回 AI 资讯列表