arXiv · Robotics· Yishu Li, Liyuan Geng, Xinyi Mao, Amber Li, David Held·· 7 小时前AI 评分34
SCOUT:通过动作-结果反馈的测试时策略自适应
Scouting the Dynamics Gap: Test-Time Policy Adaptation via Action-Outcome Feedback
AI 导读
SCOUT 是一个动力学感知元学习框架,通过共享信念潜空间将动作预测策略与前向动力学模型耦合,在测试时利用动作-结果失配持续更新内部动力学信念。实验表明该方法在模拟操作基准上显著加速在线自适应,并实现稳健的仿真到现实迁移。
来源:arXiv · Robotics · arxiv.org