arxiv · arXiv · 2026-09-29 01:52 · 评分 82
研究提出 Harness Learning,训练提议者模型根据执行反馈修订求解器的程序化配置,将测试时适应建模为可执行程序的元学习,提升语言模型 Agent 的泛化能力。
原文:arXiv | 返回 AI 资讯列表