arXiv · Robotics· Chenglin Chen, Lujia Wang, Xinhu Zheng, Jun Ma, Haoang Li·· 3 小时前AI 评分28
EMPlan:基于奖励引导偏好优化的多模态轨迹规划方法
Efficient Multi-Modal Planning with Reward-Guided Preference Optimization for Autonomous Driving
AI 导读
EMPlan 提出一种结合稀疏锚点与偏移细化模块的多模态轨迹预测架构,通过两阶段训练(预训练 + 奖励引导微调)提升安全性与效率。方法在 NAVSIM 非反应式基准上验证,在实时约束下实现规划精度与计算效率的平衡,利用无配对偏好监督和规则奖励信号优化策略。
来源:arXiv · Robotics · arxiv.org