arxiv · arXiv · 2026-09-30 14:26 · 评分 85
构建HealBench基准,含18个真实仓库的265个运行时错误;研究LLM生成修复代码以恢复程序运行状态,并针对在真实进程中执行生成代码的安全风险设计防护机制,推动运行时错误修复走向实战。
原文:arXiv | 返回 AI 资讯列表