Skip to content
arXiv · Robotics· Mousumi Das, Aditeya Prajapati, Abrar Anwar, Jesse Thomason·· 4 hr agoAI score34

SWAP:面向视觉-语言-动作模型的逐步动作策略路由

SWAP: Stepwise Action Policy Routing for Vision-Language-Action Models

AI brief

研究者提出 SWAP(StepWise Action Policy Routing)框架,在执行中动态组合多个 VLA 策略,将策略路由建模为离线强化学习问题,由路由评论器根据当前观测在每步选择最合适的策略。

Source: arXiv · Robotics · arxiv.org