arXiv · Robotics· Shangyuan Yuan, Xinda Qi, Yujiang Pu, Wenliang Guo, Xiaobo Tan·· 3 小时前AI 评分31
StairVLA:面向视觉-语言-动作模型的阶段感知分层动作生成
StairVLA: Stage-Aware Hierarchical Action Generation for Vision-Language-Action Models
AI 导读
StairVLA 提出阶段感知分层动作生成框架,用部分去噪动作衔接粗粒度长时程动作生成与局部细化。在 LIBERO 上,其 GR00T 风格实例将平均成功率从 96.5% 提升至 97.8%,分摊推理延迟从 115.0 ms 降至 44.2 ms 每动作块。
来源:arXiv · Robotics · arxiv.org