arxiv · arXiv · 2026-10-04 01:15 · 评分 90
PermVLA 将动作预测的因子化顺序作为视觉-语言-动作(VLA)策略学习的正则化项。传统方法固定按从左到右顺序生成动作块,但同一专家轨迹存在多种合法分解。该方法提出因果锚定排列(CAP),以可调时序前缀采样动作揭示顺序,并用辅助目标训练单一共享策略,提升 VLA 学习效果。
原文:arXiv | 返回 AI 资讯列表