arXiv · Robotics· Kazutoshi Tanaka·· 4 hr agoAI score39
TacZero:基于通用视觉语言模型与触觉反馈的免训练 peg insertion
TacZero: Training-Free Peg Insertion Using a General-Purpose Vision-Language Model with Tactile Feedback
AI brief
TacZero 用预训练通用视觉语言模型(VLM)解释视觉与触觉观测并选择机器人动作,无需额外的触觉或操作训练,也不依赖接触解释或动作选择的特定任务规则。系统向 VLM 输入相机图像、机器人状态以及以数值或向量形式叠加在图像上的三轴触觉响应,由 VLM 生成目标末端执行器位置与夹爪开合指令并交由底层控制器执行。
Source: arXiv · Robotics · arxiv.org