跳到正文
原文
arXiv · Robotics· Yanyan Zhang, Disheng Liu, Xinpeng Li, Chaoda Song, Mohsen Hariri, Debargha Ganguly, Wang Yang, Kai Ye, Bryce Grant, Vipin Chaudhary, Yu Yin·· 3 小时前AI 评分42

Referential Guidance:视觉-语言-动作模型的组合泛化纠正与保留

Correcting WHERE, Preserving HOW: Compositional Generalization for Vision-Language-Action Models via Referential Guidance

AI 导读

论文提出 Referential Guidance(ReGuide),一种无需训练的包装器,通过语义与几何重绑定引导末端执行器到演示支持的配置位姿,使冻结策略可继续执行。在仿真和真实机器人实验中,ReGuide 在组合偏移下的成功率分别提升最多 56.8 和 75.0 个百分点,同时保持标准任务性能。

来源:arXiv · Robotics · arxiv.org