Lilian Weng·· 2020-06-07AI 评分32
深度强化学习中的探索策略
Exploration Strategies in Deep Reinforcement Learning
AI 导读
summary_zh: 文章讨论深度强化学习中的探索策略,涵盖 epsilon-greedy、上置信界、Boltzmann 探索与 Thompson sampling 等经典算法,以及熵损失、基于噪声的探索等深度 RL 方法。
来源:Lilian Weng · lilianweng.github.io