arxiv · arXiv · 2026-10-01 01:55 · 评分 78
论文提出WorldAuditBench,用于评测多模态智能体在交互式3D世界中的异常审计能力,如漂浮物体、可穿墙或场景不一致物体。该基准强调视觉-语言-动作模型的紧密耦合,推动3D模拟环境自动化巡检研究。
原文:arXiv | 返回 AI 资讯列表