跳到正文
原文
Stanford AI Lab·· 2022-01-21AI 评分36

Reward Isn't Free:斯坦福用网络语言与视频监督机器人学习

Reward Isn't Free: Supervising Robot Learning with Language and Video from the Web

AI 导读

斯坦福 SAIL 与 CRFM 合作研究指出,机器人学习中的奖励函数并非免费,硬编码奖励通常任务特定且难以扩展。文章探索利用网络上的语言与视频作为监督信号,结合大规模多样化数据集与离线学习算法,以降低对专家数据的依赖,提升机器人在陌生环境中的泛化能力。

来源:Stanford AI Lab ·