Stanford AI Lab·· 2022-01-21AI 评分36
Reward Isn't Free:斯坦福用网络语言与视频监督机器人学习
Reward Isn't Free: Supervising Robot Learning with Language and Video from the Web
AI 导读
斯坦福 SAIL 与 CRFM 合作研究指出,机器人学习中的奖励函数并非免费,硬编码奖励通常任务特定且难以扩展。文章探索利用网络上的语言与视频作为监督信号,结合大规模多样化数据集与离线学习算法,以降低对专家数据的依赖,提升机器人在陌生环境中的泛化能力。
来源:Stanford AI Lab ·