跳到正文
原文
Lilian Weng·· 2020-06-07AI 评分32

深度强化学习中的探索策略

Exploration Strategies in Deep Reinforcement Learning

AI 导读

summary_zh: 文章讨论深度强化学习中的探索策略,涵盖 epsilon-greedy、上置信界、Boltzmann 探索与 Thompson sampling 等经典算法,以及熵损失、基于噪声的探索等深度 RL 方法。

来源:Lilian Weng · lilianweng.github.io