arXiv · Artificial Intelligence· Akhil Bagaria, Anita De Mello Koch, George Konidaris·· 7 小时前AI 评分12
超越状态到达:内在动机驱动的选项发现抽象学习
Going Beyond State-Reaching: Learning Abstractions for Intrinsically Motivated Option Discovery
AI 导读
该研究提出一种新算法,通过为每个子目标识别相关特征子集来学习可迁移的抽象选项,替代传统同时瞄准状态所有方面的状态到达方式。在三个稀疏奖励图像领域(包括 Atari 游戏 Montezuma's Revenge)上实现快速探索,选项泛化性更强,避免数量爆炸。
来源:arXiv · Artificial Intelligence · arxiv.org