跳到正文
原文
arXiv · Robotics· Pingrui Zhang, Yu Zhang, Pengyuan Wu, Bin Wang, Haoming Song, Xianqiang Gao, ZhaxiZhuoma, Zhigang Wang, Dong Wang, Bin Zhao, Xuelong Li·· 1 天前AI 评分27

MixVLA:面向可泛化视觉-语言-动作模型的自适应混合非不变信息

MixVLA: Adaptive Mixing of Non-Invariant Information for Generalizable Vision-Language-Action Models

AI 导读

研究者提出 MixVLA,一种模型无关的训练框架,通过自适应混合非不变信息(AMI)提升 VLA 模型在分布外条件下的零样本泛化能力,无需额外 OOD 数据或架构改动。

来源:arXiv · Robotics · arxiv.org