跳到正文
原文
Lilian Weng·· 2018-02-19AI 评分36

强化学习综述:从基础概念到经典方法

A (Long) Peek into Reinforcement Learning

AI 导读

文章综述强化学习(RL)领域,介绍智能体与环境交互、通过试错学习最优策略以最大化累积奖励的核心框架。涵盖状态、动作、奖励、策略与价值函数等关键概念,并对比基于模型/无模型、在策略/离策略等经典方法分类。

来源:Lilian Weng · lilianweng.github.io