arxiv · arXiv · 2026-10-06 01:59 · 评分 78
针对具身智能体编排冻结视觉-语言-动作策略时文本记忆无法记录操作细节的问题,提出递归视频上下文学习方法,在规划与接触关键帧间动态调整视频信息,提升任务执行效果。
原文:arXiv | 返回 AI 资讯列表