arXiv · Robotics· Mousumi Das, Aditeya Prajapati, Abrar Anwar, Jesse Thomason·· 3 小时前AI 评分34
SWAP:面向视觉-语言-动作模型的逐步动作策略路由
SWAP: Stepwise Action Policy Routing for Vision-Language-Action Models
AI 导读
研究者提出 SWAP(StepWise Action Policy Routing)框架,在执行中动态组合多个 VLA 策略,将策略路由建模为离线强化学习问题,由路由评论器根据当前观测在每步选择最合适的策略。
来源:arXiv · Robotics · arxiv.org