arXiv · Robotics· Yanyan Zhang, Disheng Liu, Xinpeng Li, Chaoda Song, Mohsen Hariri, Debargha Ganguly, Wang Yang, Kai Ye, Bryce Grant, Vipin Chaudhary, Yu Yin·· 3 小时前AI 评分42
Referential Guidance:视觉-语言-动作模型的组合泛化纠正与保留
Correcting WHERE, Preserving HOW: Compositional Generalization for Vision-Language-Action Models via Referential Guidance
AI 导读
论文提出 Referential Guidance(ReGuide),一种无需训练的包装器,通过语义与几何重绑定引导末端执行器到演示支持的配置位姿,使冻结策略可继续执行。在仿真和真实机器人实验中,ReGuide 在组合偏移下的成功率分别提升最多 56.8 和 75.0 个百分点,同时保持标准任务性能。
来源:arXiv · Robotics · arxiv.org