跳到正文
原文
arXiv · Robotics· Zhouyu Zhang, Chih-Yuan Chiu, Glen Chou·· 4 小时前AI 评分26

CF-KKT:无需不安全数据即可学习未知约束

Learning Unknown Constraints without Unsafe Data via Optimality and Counterfactual Regularization

AI 导读

研究者提出 Counterfactual KKT(CF-KKT)约束学习框架,结合学习到的动力学模型与局部最优示范,在无需已知动力学或额外高风险探索的情况下恢复未知约束。该方法利用可微动力学模型对示范施加 KKT 最优性条件,并生成奖励提升的反事实行为作为合成不可行数据。在高维机器人控制任务中,其神经约束表示在安全性与数据效率上优于现有离线 ICRL 基线。

来源:arXiv · Robotics · arxiv.org