arxiv · arXiv · 2026-09-29 01:46 · 评分 75
研究提出 X-Reset,通过跨本体重置策略为面向物体的强化学习提供探索引导,无需演示即可训练通用灵巧操作策略,缓解稀疏奖励下的探索难题。
原文:arXiv | 返回 AI 资讯列表