跳到正文
原文
arXiv · Robotics· Kazutoshi Tanaka·· 3 小时前AI 评分39

TacZero:基于通用视觉语言模型与触觉反馈的免训练 peg insertion

TacZero: Training-Free Peg Insertion Using a General-Purpose Vision-Language Model with Tactile Feedback

AI 导读

TacZero 用预训练通用视觉语言模型(VLM)解释视觉与触觉观测并选择机器人动作,无需额外的触觉或操作训练,也不依赖接触解释或动作选择的特定任务规则。系统向 VLM 输入相机图像、机器人状态以及以数值或向量形式叠加在图像上的三轴触觉响应,由 VLM 生成目标末端执行器位置与夹爪开合指令并交由底层控制器执行。

来源:arXiv · Robotics · arxiv.org