arxiv · arXiv · 2026-09-26 01:42 · 评分 86
该研究围绕编码智能体构建了往返评测基准:根据代码描述重新生成代码并检验是否通过原测试;发现描述完整性而非长度决定保真度,并据此找到高保真描述提示,但优化结果不能迁移到新文件。
原文:arXiv | 返回 AI 资讯列表