arXiv · Robotics· Lemon Foxmere, Anthony Furman, Yizheng Du, Oliver Chang, Leilani Gilpin, Steve McGuire·· 3 小时前AI 评分36
机器狗新技能教学:结合强化学习与模仿学习及对抗任务选择实现多样化四足技能
Teaching a Robot Dog New Tricks: Diverse Quadruped Skills via Combined Reinforcement and Imitation Learning with Adversarial Task Selection
AI 导读
研究提出一种三阶段方法,用 8 个教师策略训练出可执行 22 项任务的单一学生策略,涵盖行走、挖掘、跳跃,并能组合成爬行等新行为。该方法采用多教师蒸馏,结合 RL 与 IL 目标,通过对抗任务选择聚焦表现最差的任务,在运动质量和指令跟踪上优于 PPO 与 distill-then-finetune 基线,部分任务可泛化。
来源:arXiv · Robotics · arxiv.org