跳到正文
原文
arXiv · Robotics· Yangang Zou, Jiajun Lu, Weitao Zhou, Haibao Yu, Bozhou Zhang, Jiawei Wang, Honglong Tian, Minglei Li, Li Zhang·· 3 小时前AI 评分40

PRICE the Action Chunks:基于物理关系的具身强化学习信用分配方法

PRICE the Action Chunks: Physical Relational Credit Assignment for Embodied Reinforcement Learning

AI 导读

PRICE 提出基于物理关系的信用分配方法,利用对应物理状态下的历史轨迹终端结果作为参考,为动作块估计成功潜力并分配信用,无需辅助评估器。在 LIBERO、RoboTwin 2.0 和真实机器人上的实验表明,该方法在任务成功率和学习速度上优于基于终端结果的基线。

来源:arXiv · Robotics · arxiv.org