AI 编程 › AI 资讯 › 正文

AeroManip-VLA: Scalable Vision-Language-Action Learning for Aerial Manipulation with RL-Generated Demonstrations

arxiv · arXiv · 2026-09-29 15:34 · 评分 84

提出AeroManip-VLA,用于空中操纵的可扩展视觉-语言-动作学习框架。针对飞行与操纵紧耦合、观测动态变化等挑战,利用RL生成的演示数据,将VLA模型扩展到空中机器人。

原文:arXiv | 返回 AI 资讯列表