arXiv · Robotics· Jie He, Wei Li, Junwen Tong, Rui Shao, Wei-Shi Zheng, Liqiang Nie·· 16 小时前AI 评分33
ProAct:面向视觉-语言-动作模型的世界校准提议到动作流程
World-Calibrated Proposal-to-Action Flow for Vision-Language-Action Models
AI 导读
ProAct 是一种世界校准的提议到动作框架,让 VLA 模型的生成源本身可预测。它通过 Proposal Expert 保持运动连续性,并用 World Expert 预测任务一致的未来,校准提议中心各向异性源。相比 $\pi_{0.5}$,ProAct 在仿真与真实任务上提升性能,去噪步数减少 50%,推理延迟最多降低 25.8%,吞吐量最多提升 34.8%。
来源:arXiv · Robotics · arxiv.org