Lilian Weng·· 2018-02-19AI 评分36
强化学习综述:从基础概念到经典方法
A (Long) Peek into Reinforcement Learning
AI 导读
文章综述强化学习(RL)领域,介绍智能体与环境交互、通过试错学习最优策略以最大化累积奖励的核心框架。涵盖状态、动作、奖励、策略与价值函数等关键概念,并对比基于模型/无模型、在策略/离策略等经典方法分类。
来源:Lilian Weng · lilianweng.github.io
A (Long) Peek into Reinforcement Learning
文章综述强化学习(RL)领域,介绍智能体与环境交互、通过试错学习最优策略以最大化累积奖励的核心框架。涵盖状态、动作、奖励、策略与价值函数等关键概念,并对比基于模型/无模型、在策略/离策略等经典方法分类。
来源:Lilian Weng · lilianweng.github.io