跳到正文
原文
arXiv · Machine Learning Theory· Sathya Kamesh Bhethanabhotla, Efstratios Gavves, Andr\'e Biedenkapp·· 3 小时前AI 评分30

带复数记忆的强化学习(Reinforcement Learning with Complex (valued) Memories)

Reinforcement Learning with Complex (valued) Memories

AI 导读

summary_zh: 该研究提出三种复数循环神经网络(uRNN)变体作为 PPO 循环架构的即插即用替换,利用复数表示的相位自由度增强记忆能力,在 rocksample 和 Craftax 等部分可观测任务上奖励提升 2-3×。

来源:arXiv · Machine Learning Theory · arxiv.org