跳到正文
原文
arXiv · Multiagent Systems· Xiaoyang Cao, Jingqi Li, Zhe Fu, Alexandre M. Bayen·· 3 小时前AI 评分27

多智能体强化学习中共享约束的责任分配:LiRA 方法

Who Bears the Burden? Learning Responsibility for Shared Constraints in Multi-Agent Reinforcement Learning

AI 导读

研究者提出 Lagrangian Responsibility Allocation(LiRA),在多智能体强化学习中学习各智能体对共享成本约束的责任份额,在不修改原始奖励与约束的前提下重新分配拉格朗日乘子的影响。

来源:arXiv · Multiagent Systems · arxiv.org