跳到正文
原文
Lilian Weng·· 2018-05-05AI 评分23

Implementing Deep Reinforcement Learning Models with Tensorflow + OpenAI Gym

Implementing Deep Reinforcement Learning Models with Tensorflow + OpenAI Gym

AI 导读

使用Tensorflow和OpenAI Gym实现深度强化学习模型,代码已开源在lilian/deep-reinforcement-learning-gym。Q-learning通过Bellman方程更新Q值,结合ε-greedy策略探索;使用DiscretizedObservationWrapper将连续Box观察空间离散化,并通过target network与Q网络批量更新训练。

来源:Lilian Weng · lilianweng.github.io