Skip to content
arXiv · Robotics· Shangyuan Yuan, Xinda Qi, Yujiang Pu, Wenliang Guo, Xiaobo Tan·· 4 hr agoAI score31

StairVLA:面向视觉-语言-动作模型的阶段感知分层动作生成

StairVLA: Stage-Aware Hierarchical Action Generation for Vision-Language-Action Models

AI brief

StairVLA 提出阶段感知分层动作生成框架,用部分去噪动作衔接粗粒度长时程动作生成与局部细化。在 LIBERO 上,其 GR00T 风格实例将平均成功率从 96.5% 提升至 97.8%,分摊推理延迟从 115.0 ms 降至 44.2 ms 每动作块。

Source: arXiv · Robotics · arxiv.org