Lilian Weng·· 2019-06-23AI 评分27
Meta Reinforcement Learning(元强化学习)
Meta Reinforcement Learning
AI 导读
summary_zh: Meta-RL 训练智能体在未见过的任务上快速适应,在测试时通过有限交互自主调整隐藏状态,无需显式微调。Meta-RL 与普通 RL 的核心区别在于策略输入额外加入上一时刻的奖励与动作,通常采用 LSTM 作为循环策略,其隐藏状态用于追踪轨迹特征。
来源:Lilian Weng · lilianweng.github.io