跳到正文
原文
arXiv · Robotics· Guoheng Sun, Chen Chen, Jin Wang, Ang Li, Teresa Lv·· 5 小时前AI 评分42

Staircase Policy:面向世界动作模型的流式推理与大动作块策略

Staircase Policy: Streaming Inference for World-Action Models with Large Action Chunks

AI 导读

STAIRCASE POLICY(S-WAM)将流匹配 VLA 转为 JEPA 风格的世界动作模型,把大动作块在去噪阶段交错切分为子块,近端动作可执行、远端动作持续精炼,并在子块边界用最新观测重预测未来潜变量以更新未执行动作。

来源:arXiv · Robotics · arxiv.org