跳到正文
原文
arXiv · Robotics· Chenglin Chen, Lujia Wang, Xinhu Zheng, Jun Ma, Haoang Li·· 3 小时前AI 评分28

EMPlan:基于奖励引导偏好优化的多模态轨迹规划方法

Efficient Multi-Modal Planning with Reward-Guided Preference Optimization for Autonomous Driving

AI 导读

EMPlan 提出一种结合稀疏锚点与偏移细化模块的多模态轨迹预测架构,通过两阶段训练(预训练 + 奖励引导微调)提升安全性与效率。方法在 NAVSIM 非反应式基准上验证,在实时约束下实现规划精度与计算效率的平衡,利用无配对偏好监督和规则奖励信号优化策略。

来源:arXiv · Robotics · arxiv.org