arXiv · Robotics· Rui Huang, Yanlin Mu, Lidong Li, Yucong Wang, Zichen Yan, Lin Zhao·· 7 小时前AI 评分35
AeroManip-VLA:基于 RL 生成演示的可扩展视觉-语言-动作空中操控学习基准
AeroManip-VLA: Scalable Vision-Language-Action Learning for Aerial Manipulation with RL-Generated Demonstrations
AI 导读
AeroManip-VLA 是一个面向空中操控的可扩展 VLA 数据生成与策略评估基准,提供 GPU 加速的仿真框架,支持低层级载荷感知飞行与操控控制。通过可复用强化学习策略与专家任务规则自动生成涵盖抓取放置及长时序导航操控任务的演示数据,并引入自动化事件标注与轨迹分类机制。该基准支持在大规模并行环境中系统评估模仿学习与 VLA 基线方法,分析其性能特征与失败模式,便于在真实部署前进行仿真验证。
来源:arXiv · Robotics · arxiv.org