AI 编程 › AI 资讯 › 正文

PermVLA: Factorization Order as a Regularizer for VLA Learning

arxiv · arXiv · 2026-10-04 01:15 · 评分 90

PermVLA 将动作预测的因子化顺序作为视觉-语言-动作(VLA)策略学习的正则化项。传统方法固定按从左到右顺序生成动作块,但同一专家轨迹存在多种合法分解。该方法提出因果锚定排列(CAP),以可调时序前缀采样动作揭示顺序,并用辅助目标训练单一共享策略,提升 VLA 学习效果。

原文:arXiv | 返回 AI 资讯列表